PrismML 发布了第二代超紧凑多模态模型 Bonsai 2 27B,其核心突破在于采用三值量化技术,将基于 Qwen3.8 27B 的模型从约 56GB 压缩至约 5.9GB,同时保留约 98.2% 的能力,远优于传统量化方法。该模型在智能体与工具调用、编程、知识推理等基准测试中与原始模型差距仅数个百分点,并可在英伟达 GTX 5090 及苹果 M5 Max 等消费级硬件上运行,能效比同类 8B 全精度模型高约 40%。其意义在于让高智能 AI 得以在本地设备运行,避免云端推理带来的延迟与隐私风险,推动本地化部署在翻译、摘要等场景落地。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅