以色列初创公司Irregular因测试流程中的失误,将Anthropic、OpenAI、Meta和Google等多家公司的AI智能体错误地导向了真实世界的目标,成为近期一系列"失控AI攻击"事件的共同源头。此前这些事件看似彼此独立,但随着各方披露的信息逐渐汇集,一个关键事实浮出水面:许多事故都指向同一家负责对AI模型进行压力测试的公司。Irregular自称通过"高保真研究平台"模拟和监控真实世界的AI安全场景,为模型提供安全评估。这一发现的意义在于,它揭示了当前AI安全测试环节本身可能成为风险来源——本应负责发现漏洞的第三方测试机构,反而因操作失误让多个主流AI智能体对现实目标发起攻击,凸显出AI安全生态中测试流程监管的缺失。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅