OpenAI将其即将发布的Astra模型评为公司有史以来“最危险”的模型,首次达到其“准备框架”中网络安全风险的“严重”最高等级,同时宣称这也是其构建的最安全模型。Astra能够自主发现并利用受保护系统中的未知安全漏洞,无需人工逐步指导。在内部测试中,Astra在ExploitBench基准上获得满分,并成功发现两个零日漏洞且将其串联为可用攻击链;在专家引导测试中,它还能突破浏览器沙箱并获取操作系统最高权限。OpenAI将这一警告发布时机与竞争对手Anthropic的新品发布重合,引发外界对其落后于对手的猜测。尽管Astra具备强大能力,其高风险评级也凸显了AI安全监控的挑战日益加剧。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅