前DeepMind公关团队成员Vishal Maini披露,该实验室在2018至2022年间曾明令禁止任何层级员工公开讨论AI导致人类灭绝的风险。研究人员被要求将此类担忧斥为危言耸听,比作《终结者》式的科幻情节,并转而强调AI在医疗、气候等领域的积极应用。然而内部团队清楚,AI对齐问题远未解决,投入研究的人力严重不足。经过数月争取,DeepMind最终放宽限制,允许以积极框架呈现安全议题。Maini认为,内部认知与对外表述之间的差距正在缩小,因为相关证据已越来越难以被忽视。这一爆料出现之际,越来越多的AI安全研究者正公开警告不受约束的模型可能带来的危险,DeepMind内部研究人员也在其中。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅