Google ra mắt tính năng hiểu video của Gemini: có thể giảm tới 88% tiêu thụ token
Google DeepMind đã phát hành tính năng hiểu video của trí tuệ nhân tạo Gemini, hiện đã mở cho các mô hình Gemini 3.7 Flash, 3.6 Flash và 3.5 Flash-Lite. Tính năng này có thể nâng cao hiệu quả và độ chính xác của phân tích video dài thông qua việc tìm kiếm động, quét và kiểm tra các đoạn video.
So với phương pháp xử lý khung hình cố định truyền thống, nó có thể giảm tới 88% tiêu thụ token, giảm 66% chi phí phân tích và nâng cao độ chính xác lên tới 7%. Tính năng này hiện đã có sẵn thông qua Gemini API trong Google AI Studio và Gemini Enterprise Agent Platform, và trong tương lai sẽ được áp dụng cho các ứng dụng Gemini và tính năng "Hỏi YouTube" của YouTube.
Thẻ liên quan






