阶跃星辰发布 StepAudio 3 系列语音模型,一次性推出 Realtime、ASR、TTS、Gen、Music 五款模型,覆盖实时交互、语音识别、语音合成、生成与音乐等方向。其中 StepAudio 3 Realtime 在 Artificial Analysis 的 Conversational Dynamics 榜单上以 98.9% 的综合成绩登顶,多款模型位列全球第一。文章指出,语音大模型的竞争重心已从单纯的文本转语音,转向对声音的理解与组织能力。此次发布意味着国产语音模型在实时对话等核心指标上已具备全球领先水平,也反映出行业正加速向更自然、更智能的语音交互体验演进。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅