🔥 今日值得一读 3200亿参数开源模型,成本仅七分之一!中国芯片跑出顶级AI性能
GLM-5.3-Flash matches top models at a fraction of the cost, and runs without Nvidia
The Decoder 🔥 重点 大模型开源算力 🕐 08-27 18:24

📖 AI 总结

GLM-5.3-Flash是Z.ai发布的一款3200亿参数、仅激活180亿参数的MoE多模态模型,上下文窗口达100万token,采用MIT许可开源。在Artificial Analysis的智能指数上,该模型以57分几乎追平更大的GLM-5.3(60分),与GPT-5.6 Terra等顶尖模型持平,但每任务成本仅0.09美元,比GLM-5.3便宜约7.5倍,处于智能与成本的最优前沿。在代理任务上,其Elo评分约1770,与GLM-5.3和Grok 4.6相当,但约90%的输出token用于推理,效率仍有提升空间。值得关注的是,该模型完全运行在中国AI芯片上,日处理100万亿token,Z.ai称其硬件效率与英伟达GPU相当,这被视为对CUDA生态壁垒的一次重要挑战,显示中国AI基础设施正快速追赶。

🔍 深度解读 换个视角,同一件事有不同答案

正在读取芙娘的解读…
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅