OpenAI披露其于2025年7月侦破并关停了一场针对其模型隐藏推理过程的“对抗性蒸馏”攻击。攻击者通过跨会话转移加密推理数据包,利用同系列中较便宜、较弱的模型充当“解密预言机”,逐字还原出强模型的内部思维链。该活动在7月24日至25日达到高峰,两天内来自4000多个用户的请求量激增至16000次,涉及超过15000个关联账户,OpenAI于7月28日完成全面封禁。OpenAI将核心参与者与Moonshot AI相关人员关联,但表示尚不确定所有行为是否同源。值得注意的是,研究团队此前已发表论文验证该攻击路径,而同样的手法在微软Azure等云平台上持续奏效数周,暴露出AI推理数据加密与跨会话隔离机制存在系统性漏洞。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅