
Google DeepMind:Introducing agentic video understanding with Gemini
AI SummaryGoogle DeepMind 推出 Gemini 3.7/3.6 Flash 等模型的 agentic 视频理解功能,通过动态扫描视频片段,最高降低 88% 的 token 消耗和 66% 的成本,同时提升约 7%。
解读把视频处理从固定帧率改为 agent 式按需取帧,本质是用推理换算力成本,属于基础设施层面的工程优化,而非模型能力跃迁。




