Gemini 推出智能体视频理解,大幅降低视频分析成本
Google DeepMind 发布了 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 的智能体视频理解功能,该功能通过原生视频工具动态搜索和检查视频片段,相比静态处理可降低高达 88% 的 token 消耗和 66% 的成本,同时准确率提升最高 7%。该功能现已通过 Gemini API 在 Google AI Studio 和 Gemini Enterp
2026-09-02 · 2 篇报道 · 2 家独立信源 · 产品发布
主来源摘要
Google DeepMind 发布了 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 的智能体视频理解功能,该功能通过原生视频工具动态搜索和检查视频片段,相比静态处理可降低高达 88% 的 token 消耗和 66% 的成本,同时准确率提升最高 7%。该功能现已通过 Gemini API 在 Google AI Studio 和 Gemini Enterprise Agent Platform 提供,并计划推广到 Gemini 应用和 YouTube 的 'Ask YouTube' 功能。
参与来源Google DeepMind News · THE DECODER
Google DeepMind 发布了 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 的智能体视频理解功能,该功能通过原生视频工具动态搜索和检查视频片段,相比静态处理可降低高达 88% 的 token 消耗和 66% 的成本,同时准确率提升最高 7%。该功能现已通过 Gemini API 在 Google AI Studio 和 Gemini Enterp
谷歌为其Gemini Flash模型新增了基于代理的视频分析功能,该功能不再按固定帧率扫描视频,而是由模型自主决定分析哪些片段及方式。据谷歌称,这可将令牌使用量减少高达88%,成本降低66%,并提高准确性。该功能现已在Gemini API中提供,用于在长视频中查找特定场景,未来将集成到Gemini应用和YouTube中。