谷歌推出智能体视频理解功能,提升Gemini模型视频分析准确率

谷歌推出智能体视频理解功能,提升Gemini模型视频分析准确率

9月2日,谷歌宣布在Gemini 3.7 Flash、3.6 Flash和3.5 Flash-Lite模型中推出智能体视频理解功能。与现有静态处理方式不同,该功能将模型核心推理与原生视频工具结合,可在视觉帧、音频和转录文本中动态搜索目标视频片段。在标准基准测试中可将分析成本降低最高66%,Token消耗量降低最高88%,同时准确率提升最高7%。该功能已在Google AI Studio和Gemini Enterprise Agent Platform上线。

原文链接:http://m.toutiao.com/group/7680881126050857524/

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注