Google DeepMind представив агентне розуміння відео в моделях Gemini
Introducing agentic video understanding with Gemini

Google DeepMind запустив функцію агентного аналізу відео для моделей Gemini 3.7 Flash, 3.6 Flash та 3.5 Flash-Lite. За даними компанії, технологія знижує споживання токенів до 88% і витрати до 66%, водночас підвищуючи точність аналізу до 7%. Модель самостійно вирішує, які фрагменти відео, аудіо чи транскрипту переглядати, замість обробки з фіксованою частотою кадрів. Функція вже доступна через Gemini API та невдовзі з'явиться в застосунку Gemini і на YouTube.
Мовою оригіналу · EN
Google DeepMind launched agentic video understanding for Gemini 3.7 Flash, 3.6 Flash, and 3.5 Flash-Lite, cutting token consumption by up to 88% and costs by up to 66% while improving accuracy by up…
Читати оригінал на Google DeepMind →
Чому в стрічці: Конкретне оновлення продукту Gemini AI, що відповідає інтересу користувача до AI-релізів.