Anthropic发布的一份威胁情报报告,记录了2025年12月至2026年8月期间Claude模型被滥用的八个月情况,将违规使用划分为网络攻击、影响力行动、监控、欺诈、生物滥用、常规武器及模型蒸馏七大类。报告指出,攻击者利用AI自动改写恶意软件以绕过杀毒检测,还将其用于导弹和自主无人机软件开发,涉及俄罗斯语系间谍组织等行为体。与此同时,阿里巴巴、DeepSeek等中国AI公司通过隐蔽网络大规模提取Claude训练数据,甚至秘密转接自身客户请求,政府监控数据也被混入其中。在生物研究领域,安全过滤器因难以区分合法与恶意意图而触及极限。Anthropic正以更严格的防护措施回应,并呼吁将访问权限限制在经验证的用户范围内。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅