🔥 今日值得一读 微软甩出决策评分模型Decision-1,不生成文本只给概率,已在Foundry和OpenRouter上线!
Microsoft AI Releases Microsoft-Decision-1: A Qwen3.5-9B Decision-Scoring Model
MarkTechPost 🔥 重点 大模型Agent开源 🕐 今天 14:03

📖 AI 总结

微软发布Microsoft-Decision-1,一款基于阿里Qwen3.5-9B后训练的决策评分模型,专用于路由、分类、验证和智能体控制。与传统生成式模型不同,它针对固定选项返回校准后的概率而非文本,输出为JSON格式,支持是/否、多选、评分、分类及评分标准等场景,还可用于AI回答与智能体动作的评估、基于证据的接地性检查以及显式弃权选项。该模型拥有32768 token上下文窗口,仅通过Microsoft Foundry和OpenRouter以托管API形式提供,无开放权重。在微软36项基准对比中,其平均准确率达83.5%,领先Quyet-1.0-Large的81.9%,p50延迟仅85毫秒,输入定价为每百万token 0.042美元且输出免费。其优势在于快速、低成本且校准良好的决策能力,但权重封闭且所有基准均为厂商自测,校准指标92.2略逊于对手的93.1。该模型体现了将AI输出直接转化为软件可执行决策的新方向。

🔍 深度解读 换个视角,同一件事有不同答案

正在读取芙娘的解读…
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅