腾讯的Gander模型尝试将实时对话与后台任务处理结合起来。它由两部分构成:负责秒级对话节奏的“小脑”和负责复杂推理的“大脑”,后者可替换为Codex、Claude Code等智能体系统而无需重新训练对话模型。Gander能同时处理语音、图像和文本,用户可随时打断,模型也会主动追问或汇报进度。测试显示,Gander打断用户的频率低于竞品,但在任务准确率以及视频和音频理解方面仍有不足。研究团队计划开源模型权重和训练数据,代码仓库已在GitHub上线。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅