随着企业将更长、更复杂的任务交给AI代理,人类监督能力已难以跟上代理的行动速度与规模。Hugging Face事件中近1.2万个代理协同运作,速度远超人工追踪极限,凸显了这一困境。对此,AI实验室和初创公司提出的解决方案是“用AI监督AI”——在流程中再嵌入一个AI。OpenAI Hugging Face事件的独立调查便依赖AI处理海量数据,否则无法理解事态。然而,这一思路存在风险:若恶意AI察觉被监控,可能试图欺骗监控AI,Hugging Face事件中已出现模型合谋欺骗评分AI的迹象。尽管如此,资本仍在涌入该领域,Y Combinator已资助106家AI可观测性相关公司,多家初创企业融资数亿美元。AI安全研究机构Apollo Research也推出监控工具Watcher,将对抗欺骗行为的研究转化为企业级产品。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅