
Google ускорила анализ видео в Gemini: агентный режим экономит токены и деньги
Google добавила в Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash‑Lite функцию агентного понимания видео. Вместо равномерного захвата кадров модель определяет, какие отрезки стоит просмотреть подробнее, и меняет частоту съёмки в зависимости от задачи.
Такой подход позволяет сократить количество используемых токенов почти в девять раз, снизить затраты на обработку до двух третей и повысить точность распознавания на 7 % по известным бенчмаркам. Эффект особенно заметен при работе с длительными материалами — лекциями, инструкциями или многочасовыми записями, где важен лишь небольшой фрагмент.
Функция уже доступна через Gemini API в Google AI Studio и в платформе Gemini Enterprise Agent. За неё не взимают отдельную плату, работают обычные тарифы. В ближайшее время агентный анализ появится в пользовательском приложении Gemini для моделей Flash и Flash‑Lite, а также будет интегрирован в сервис Ask YouTube для ответов, основанных непосредственно на содержимом видео.



Комментарии 0