当地时间9月15日,谷歌宣布推出Gemini 3.8 Live和Gemini 3.8 Live Extended Thinking两款实时对话模型。谷歌称这是其迄今最先进的实时对话模型,在智能和并行推理方面有重大升级。
Gemini 3.8 Live面向规模部署与成本优化,可近实时处理视觉输入,在对话中自动检测并切换97种支持的语言,还能在后台执行工具与API调用;Gemini 3.8 Live Extended Thinking面向高复杂度任务,可实现推理与发言同步进行。
Gemini 3.8 Live Extended Thinking拿下Artificial Analysis语音对语音质量指数总排名第一(82.6%),τ-Voice智能体任务完成率68.6%,Big Bench Audio得分97.7%;Gemini 3.8 Live在Speech Agent Arena排名第二。
两款模型已开始推送:开发者可在Gemini API和Google AI Studio使用,企业用户可在Gemini Enterprise抢先体验,普通用户可在Gemini Live体验。谷歌所有AI生成音频均添加SynthID隐形水印。
