微软CEO萨提亚·纳德拉在社交平台X上发表长文,阐述其对高度先进AI模型所带来风险的看法。他提出,不应再接受将AI视为“嵌套黑箱”、只能被动接受或拒绝其建议与行为的现状,而应构建更透明的体系,使模型可被遏制、观察,并留下“防篡改的人类可读证据”。他主张及时披露事件、独立审计、数据可验证以及模型遏制等措施。其中最具突破性的一点是,他要求从一开始就假定模型已被攻破并加以遏制,并比喻为“紧急刹车”——授权人员应能随时暂停或关闭执行任务中的模型,更先进的模型还需标准化的遏制技术。此番表态反映出业界对AI安全治理的紧迫感正在上升。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅