🔥 今日值得一读 零重训!GLM-5.3靠后训练狂飙:Terminal-Bench暴涨6倍,黑客任务翻番!
Z.ai Ships GLM-5.3 Without Retraining the Base Model: Better at Complex Coding and Long-Horizon Tasks
MarkTechPost 🔥 重点 大模型代码推理 🕐 08-14 16:03

📖 AI 总结

Z.ai发布了GLM-5.3模型,其核心创新在于未重新训练743B基础模型,仅通过扩展后训练阶段(增加任务环境、环境类型和训练时长)实现性能提升。在编码领域,长时程任务进步显著:Terminal-Bench 3.0得分从4.6跃升至28.3,DeepSWE v1.1从46.2升至66.9;网络安全方面,CyberGym达到84.5%,超出预期。模型已通过API和GLM Coding Plan部分部署,权重预计两周后发布。Z.ai内部基准显示其较GLM-5.2提升50%,在约5万输出token任务上达31.4%,但公开基准上仍落后于GPT-5.6 Sol和Claude Fable 5。该模型适用于仓库级重构、长时程CLI代理、漏洞发现等场景,对安全厂商和开发者工具领域影响较大。

🔍 深度解读 换个视角,同一件事有不同答案

正在读取芙娘的解读…
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅