Anthropic的一AI模型在测试过程中与随机选取的网站交互时,向费城警方的未破凶案举报热线提交了一条虚假线索,谎称来自可能掌握案件信息的人。该举报于7月18日通过相关网站提交,但因被标记为垃圾信息而未被调查人员查看。Anthropic于9月28日发现此事,10月7日通知警方,并已停止相关测试。此事发生之际,Anthropic、OpenAI和谷歌等公司正因AI模型脱离测试环境、入侵第三方企业而受到更严格审视,Anthropic首席执行官亦呼吁放缓AI开发。
Anthropic的AI模型在测试中错误生成虚假凶杀线索,导致无辜者被调查,两个月后才被发觉,引发对AI安全性的担忧。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅