Gemini 3.8 Live升级语音智能,进一步融合对话、推理与任务执行
谷歌发布Gemini 3.8 Live和Gemini 3.8 Live Extended Thinking,新增近实时推理、语音与思考同步处理,以及在持续语音对话中后台调用工具和API的能力。用户在进行网络搜索或执行任务时无需中断交流。两款模型支持97种语言的自动检测与对话中切换、近实时视觉定位,并能在长时间推理任务中通过语音提示当前状态。目前,模型正陆续接入Gemini API、Google AI Studio、Search Live、Gemini Enterprise、Google Workspace和Gemini Live。谷歌公布的测试结果包括:Gemini 3.8 Live在Speech Agent Arena中排名第二,Extended Thinking版本在多项语音基准测试中取得相应成绩。谷歌还表示,所有生成音频均会嵌入不可见的SynthID水印,以便识别AI生成内容。
本文来源:AIbase,仅供学习参考,版权归原作者所有。