🔥 今日值得一读 vLLM发布Decision 3.0:5个多模态决策模型,0.8B到27B,一次调用搞定图文选择判断!
What is Decision 3.0? vLLM Semantic Router’s New Open Decision Models
MarkTechPost 🔥 重点 开源多模态论文方法 🕐 今天 05:43

📖 AI 总结

vLLM Semantic Router 团队发布了 Decision 3.0,一组基于 Apache-2.0 许可的开源多模态决策模型。该系列共 5 个规模,从 0.85B 的 d3-lite 到 26.09B 的 d3,均以 Qwen 系列为底座微调,并配备视觉编码器,可同时读取文本、JSON 与图像。其核心特点是模型不生成文本,而是针对命名问题直接返回概率值,支持 Choice、Yes/No 和 Score 三类问答,一次调用即可完成全部问题的打分,便于开发者按阈值进行分类、路由与护栏判断。性能方面,27B 的 d3 在内部评测的文本与视觉榜单中均领先,文档抽取任务 KIE 得分达 97.7,但 R-Bench-M 仅 34.1;团队称 9B 模型已可超越上一代 27B。需注意所有成绩均为自报,且未与公开榜单直接对比。

🔍 深度解读 换个视角,同一件事有不同答案

正在读取芙娘的解读…
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅