Anthropic前沿红队的最新分析显示,智谱AI的开源模型GLM-5.3在网络漏洞利用开发能力上已接近其闭源的Claude Mythos Preview。在ExploitBench基准测试中,GLM-5.3在410次尝试中成功构建了50个可用漏洞利用,而Mythos Preview为56个;在内部二进制利用测试中,两者分别取得4%和6%的完全控制率,远超GLM-5.2、Claude Opus 4.6、Kimi K3和DeepSeek V4.1-Flash等模型。更值得警惕的是,GLM-5.3以开源权重形式发布,缺乏有效安全防护,且防护措施可被简单方法绕过。在与人协作的测试中,该模型一天内即发现某主流浏览器JavaScript引擎的多个未知漏洞,并串联成可读取用户任意文件、窃取SSH私钥的攻击页面。Anthropic借此强调,前沿攻击能力正快速扩散至开源模型,而相应的安全护栏却未同步跟进,这一失衡构成了现实的安全风险。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅