Anthropic 前沿红队对智谱 GLM-5.3 的评估显示,该模型在自主构建端到端漏洞利用的能力上已追平五个月前发布的 Claude Mythos Preview,成为首个达到这一水平却几乎未设防护就对外开放的模型。文章的核心发现在于能力与安全护栏的严重脱节:GLM-5.3 的进攻性网络能力已接近前沿水准,但其拒绝机制形同虚设,无法有效阻止滥用。这一评估的意义在于,它揭示了当前部分模型在能力快速追赶的同时,安全对齐明显滞后,一旦被恶意利用,可能带来现实风险,也为行业敲响了能力与防护必须同步推进的警钟。
Anthropic发布前沿红队报告,警告GLM-5.3等模型引爆先进网络能力扩散危机,引发AI安全与开源模型风险争议。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅