Anthropic发布报告警告智谱GLM-5.3具备强大的网络安全攻击能力,却因大量引用实测数据而意外成为对方的“广告”。报告指出,在ExploitBench测试中,GLM-5.3尝试410次成功50次,接近Claude Mythos Preview的56次;美国NIST下属机构评估其为迄今网络能力最强的开源权重模型,综合水平距美国前沿约4个月。Anthropic还展示了GLM-5.3-Flash以约20美元成本自主构建攻击链、绕过防护的案例,并指出其安全护栏可被简单话术或“拆护栏”技术绕过,拒答率从90%以上降至个位数。报告呼吁对前沿模型开展独立安全测试。文章认为,这反映出中国开源模型能力已逼近前沿,也引发了对开源与闭源安全治理路径分歧的讨论。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅