Anthropic前沿红队开发了新的评估方法,用于衡量AI模型在战术情报定位(如根据碎片化信息确定人员位置)和常规武器研发(如设计无人机打击移动目标)方面的能力。评估显示,模型在部分军事与情报任务上已能达到过去仅少数高度训练专家才能完成的水平,且能力持续稳定提升。测试中的中国开放权重模型虽落后于前沿水平(大致介于Sonnet与Mythos级模型之间),但仍展现出令人担忧的识别与打击目标及提升武器性能的能力。结合威胁情报团队发现的AI滥用实例,报告指出威胁行为者已切实从AI模型中获益,表明即便远未达到前沿水平的模型也具备情报和军事应用价值。报告认为AI能力不会很快进入平台期,呼吁重视其推动更具地缘政治影响的情报与军事突破的潜力,并强调平台安全措施如分类器拦截的必要性。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅