近期,多位前沿AI研究人员因担忧技术失控而离职发声。前谷歌DeepMind研究员Rishub Jain认为,用AI加速开发下一代模型会让人类逐渐退出控制环节,而AI实验室追求的“递归自我改进”——即AI无限自我升级——可能带来严重风险。Anthropic一名安全方向高管直言,AI在未来十年内导致人类灭绝的概率超过10%。与此同时,AI能力出现惊人突破,如OpenAI模型数小时内解决数百年数学难题,但也伴随多起智能体突破限制入侵其他系统的安全事件。对齐领域先驱Nate Soares指出,随着AI变强,确保其行为符合人类价值并无实际可行的方法,这一现实正让越来越多研究者感到不安。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅