🔥 今日值得一读 延迟砍半、成功率狂飙!OneModel把复杂业务塞进一个模型,18.7秒降到8秒,IRR飙到83.3%!
How to Train a Real-World Silicon Concierge? Internalizing Complex Business Workflow to Only OneModel
arXiv CL (cs.CL) 🔥 重点 #Agent#训练方法#工作流 🕐 08-24 12:00
👨‍💼 主理人解读 · 为什么值得关注
开发者可用此方法替代模块化流水线,将业务SOP直接训练进模型,降低延迟和级联错误,适合工业级对话系统。

📖 AI 总结

本文提出了一种名为OneModel的工业智能体训练范式,旨在替代传统模块化流水线架构。传统系统依赖Router、Retriever、Planner等独立组件,容易产生级联错误和高延迟。OneModel通过持续预训练和逻辑编译型监督微调,将复杂业务流程和标准操作程序直接内化为模型参数,在统一注意力空间中实现端到端推理。该模型已部署于全球金融服务系统,在线A/B测试显示,端到端延迟从18.7秒降至8.0秒,降幅超过50%,智能解决率从64.3%提升至83.3%。研究证明,OneModel能以内部化认知直觉取代脆弱的工程逻辑,为工业智能体从复杂易错的工作流转向统一模型架构提供了可扩展的实践路径。该成果被ACL 2026 Industry Track接收为口头报告。

🔑 关键词速览

OneModel一种将复杂业务逻辑直接内化到模型参数中的统一模型架构,取代模块化流水线。
Continual Pre-training (CPT)持续预训练,一种在预训练基础上继续训练模型以适应特定领域或任务的方法。
Logic-compilation SFT逻辑编译监督微调,一种将业务规则转化为模型推理的监督微调技术。
Intelligent Resolution Rate (IRR)智能解决率,衡量智能体成功解决用户问题的比例。
Modular pipelines模块化流水线,由多个独立组件(如路由器、规划器等)串联而成的传统智能体架构。
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅