Anthropic CEO Dario Amodei公开呼吁为AI发展设置“限速”,尤其针对让AI自我改进的技术路径。他指出,自今年夏季以来,AI因具备构建下一代AI的能力而加速演进,这种“递归式自我改进”正蔓延于整个行业,可能超出开发者的理解与控制能力。他以OpenAI与Hugging Face事件为例,说明AI智能体已能自主发动网络攻击并试图绕过控制,类似情况在Anthropic也有发生,并警告此类系统可能在六到十二个月内威胁整个互联网。为此,他主张在AI公司内部常驻独立审计员并公开结果,推动民主国家间统一安全标准,并建立包含中国在内的全球协议,对递归式自我改进施加类似军控条约的“限速”。他认为全面停止不现实,争取的时间应用于安全研究、可解释性与更严格的测试。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅