谷歌近日发布Gemini 3.8 Live和Gemini 3.8 Live Extended Thinking,新增近实时推理、语音与思考同步处理,以及后台工具和API调用能力。两款模型已陆续接入Gemini API、Google AI Studio,并覆盖Search Live、Gemini Enterprise、Google Workspace和Gemini Live等场景。模型支持持续语音对话中执行搜索及其他任务、自动检测并切换97种语言,并提供近实时视觉定位和任务状态提示。性能方面,Extended Thinking在Speech to Speech Quality Index中获82.6分,Gemini 3.8 Live在Speech Agent Arena排名第二。谷歌还与Agora、LiveKit等平台合作,并为模型生成音频嵌入不可见SynthID水印。