Google анонсировала новую функцию агентного видео-понимания для моделей Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite. Эта функция значительно улучшает точность анализа видео, одновременно снижая использование токенов на 88% и затраты на 66%. Теперь разработчики могут динамически сканировать и анализировать видеосегменты, что позволяет выполнять сложные задачи, такие как детектирование аномалий и подсчет объектов, с минимальными расходами.
Агентное видео-понимание отличается от статического анализа тем, что модель самостоятельно определяет, что именно анализировать и с какой скоростью, обращая внимание на нужные моменты и сигналы. Это особенно полезно для длинных видео, где традиционные методы часто вынуждают выбирать между высоким расходом ресурсов и потерей важных деталей.
Данная функция уже доступна через API Gemini в Google AI Studio и Gemini Enterprise Agent Platform. Просто включите опцию «агентное» в конфигурации API, чтобы начать улучшенный анализ. Таким образом, Gemini 3.7 Flash обеспечит наилучшее сочетание качества и эффективности при анализе видео, открывая новые возможности для разработчиков.
*компания Meta Platforms Inc. признана экстремистской организацией, ее деятельность на территории России запрещена
