Google发布Gemini 3.8 Live与Gemini 3.8 Live Extended Thinking两款原生语音到语音模型,面向实时语音智能体,旨在解决语音代理在保持对话流畅的同时进行推理和调用工具的问题。两款模型已在Gemini Live API和Google AI Studio上线,属托管模型,无自托管选项。其中Extended Thinking版本在Artificial Analysis语音到语音质量指数中以82.6分位列第一,在τ-Voice取得68.6%、τ-Voice-banking取得35.1%、Big Bench Audio取得97.7%;Gemini 3.8 Live在Speech Agent Arena人类偏好评测中排名第二。新模型支持异步函数调用与实时视觉上下文等能力,Google称其在ServiceNow EVA-Bench上推动了复杂工作流的帕累托前沿,兼顾任务准确率与对话质量。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅