谷歌Gemini推出智能体视频理解功能

2026年9月2日,谷歌宣布在Gemini 3.7 Flash、3.6 Flash及3.5 Flash-Lite模型中上线智能体视频理解功能。该功能通过动态调用视觉帧、音频与转录文本模态,实现目标片段的主动检索与分析,相较传统1FPS静态处理,最高降低88% Token消耗、66%成本,并提升准确率7%。功能已接入Google AI Studio与Gemini Enterprise Agent Platform,开发者仅需设置API处理模式为“agentic”即可启用,后续将扩展至Gemini应用及YouTube‘Ask YouTube’功能。

免责声明:本文内容由开放的智能模型自动生成,仅供参考。

最新文章
Copyright © DoNews 2000-2026 All Rights Reserved
京ICP备2025120072号