🔥 今日值得一读 10万国产卡让GLM自己造自己,智谱首个RSI成果来了!
刚刚,智谱首个 RSI 成果发布,10 万国产卡用 GLM 造 GLM
爱范儿 🔥 重点 大模型算力论文方法 🕐 09-17 17:56

📖 AI 总结

智谱发布首个RSI(递归自我改进)早期形态成果:在超过10万颗国产AI加速器组成的集群上,GLM-5.3-Flash从首次运行到承载全部生产流量仅用两周,端到端吞吐提升3.2倍,硬件利用率与单token成本接近主流NVIDIA GPU平台水平。关键突破在于,优化工作并非仅由工程师完成,而是由GLM-5.3驱动的Infra Agent深度参与,它能定位长上下文精度累积误差、KV Transfer与调度重叠不足等问题,将传输开销从超30%降至1%以下,并优化Decode Kernel实现1.71倍提升。团队提出“dense feedback”机制,将工程判断经验转化为模型可调用的反馈。这标志着AI开始参与优化承载自身运行的系统,虽距真正RSI尚远,但早期形态已现。

🔍 深度解读 换个视角,同一件事有不同答案

正在读取芙娘的解读…
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅