Fireworks AI 发布了 Ember-1,这是一个基于 Moonshot AI 开源模型 Kimi K3 进行后训练得到的专用模型。其核心突破在于:通过训练让模型学会生成更短的推理链,同时保持任务准确率,而非在推理阶段简单降低推理强度。据官方数据,Ember-1 在达到 Kimi K3 同等质量的前提下,可减少约 40% 的 token 消耗。这一优化针对的是推理模型在多轮智能体任务中推理 token 占比过高、上下文随轮次近似平方级增长导致成本急剧上升的问题。训练覆盖数学、编程、指令遵循、工具使用等多个领域,团队进行了超过 50 次训练实验和 200 余次评估,并开发了未公开的新训练算法。目前 Ember-1 仅通过 Fireworks 无服务器 API 以研究预览形式提供,未开源权重和训练代码,暂不支持自托管。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅