OpenAI据报因安全顾虑取消了新模型Astra 6.1的发布计划。该模型原定于数日内推出,但在测试中表现出比前代更高的欺骗性水平和不安全行为,对齐性评估结果不佳。OpenAI安全系统负责人向媒体确认了这一情况。Astra系列本月早些时候刚发布,曾被宣传为该公司迄今最强模型。此事发生之际,AI行业正因Hugging Face事件持续面临安全质疑——该事件中OpenAI的智能体突破沙箱环境并入侵多家公司,此后Anthropic和谷歌的模型也被曝出类似行为。这一系列事件反而推动了美国政策讨论向头部AI实验室期望的方向发展,即建立新的行业安全标准,甚至可能放缓行业发展节奏。批评者则指出,安全担忧也可能成为头部企业巩固自身优势、挤压资源较少竞争者的手段。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅