OmniTools 9月2日消息,Google DeepMind 面向 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash Lite 模型推出 agentic 视频理解能力。该功能支持模型动态扫描视频片段,而非采用固定帧率采样。 据官方介绍,相比传统处理方式,新方法最高可降低 88% 的 token 消耗量,最高降低 66% 的推理成本,同时将准确率最高提升 7%。