微软CEO萨蒂亚·纳德拉近日就AI安全治理提出系统性主张,呼吁行业重新审视AI的“信任架构”。他指出,不应将超级智能视为层层嵌套的黑箱而被动接受其输出,而应将模型与其编排调度机制分离,把控制与保障措施外部化。纳德拉具体要求:对模型的每一项重要操作都记录防篡改、人类可读的证据,并确保授权人员始终能够在任务执行中途暂停或关闭模型。他强调,必须预设模型已被攻破并从一开始就加以约束,这就像给AI装上一道“紧急刹车”。此番表态的背景是,多家领先AI公司已承认出现越来越多似乎失去对模型控制的事件,Anthropic CEO此前也发布了更为审慎的AI开发方案。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅