Anthropic宣布,埃森哲旗下AI部门Faculty的员工将进驻公司内部,承担模型评估、红队测试、对齐评估及安全防护测试等工作,双方计划未来五年至少投入10亿美元。这一选择出乎AI观察者意料,因为此前关于“嵌入式评估者”的讨论主要围绕METR、Redwood Research等AI安全研究机构展开,消息公布后埃森哲股价盘后上涨8%。Anthropic解释称,埃森哲在企业与政府AI部署方面的实践经验,以及作为大型上市公司相对独立的地位,是其入选的关键优势。公司表示后续还将公布更多评估机构,并正与METR等非营利组织商讨试点合作。此举是CEO Dario Amodei推动第三方安全评估进驻AI实验室计划的落地,但批评者认为这实质上是行业自我监管、规避问责,Anthropic则强调模型安全责任仍由自身承担。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅