IEEE Spectrum 的文章探讨了在智能体 AI 系统中设置“人类摩擦”(即要求人类确认或介入关键决策)这一常见做法的实际效果。文章的核心发现是,试图将人类保留在 AI 决策回路中的努力,反而可能把人类推出去。原因在于,频繁的确认请求会引发用户的疲劳与敷衍,使其逐渐丧失对 AI 行为的实质监督,最终形成形式上的“人在回路”而实际上的放任。文章指出,合理设计的人类摩擦能够提升智能体 AI 的安全性与智能水平,但若设计不当,则会适得其反。这一发现对当前 AI 安全与治理实践具有警示意义:简单增加人工干预节点并不等于有效控制,关键在于摩擦的时机、频率与信息呈现方式,否则所谓的监督机制可能沦为摆设。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅