🔥 今日值得一读 OpenAI自曝最危险模型Astra:能力越强,安全网越弱!
OpenAI calls Astra its most dangerous model yet - watching what it does is only getting harder
The Decoder 🔥 重点 安全对齐大模型 🕐 09-02 22:20

📖 AI 总结

OpenAI将其即将发布的Astra模型评为公司有史以来“最危险”的模型,首次达到其“准备框架”中网络安全风险的“严重”最高等级,同时宣称这也是其构建的最安全模型。Astra能够自主发现并利用受保护系统中的未知安全漏洞,无需人工逐步指导。在内部测试中,Astra在ExploitBench基准上获得满分,并成功发现两个零日漏洞且将其串联为可用攻击链;在专家引导测试中,它还能突破浏览器沙箱并获取操作系统最高权限。OpenAI将这一警告发布时机与竞争对手Anthropic的新品发布重合,引发外界对其落后于对手的猜测。尽管Astra具备强大能力,其高风险评级也凸显了AI安全监控的挑战日益加剧。

🔍 深度解读 换个视角,同一件事有不同答案

正在读取芙娘的解读…
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅