MIT Technology Review举办了一场圆桌讨论,主题为“AI真的会消灭人类吗?”讨论由执行编辑Niall Firth主持,资深AI编辑Will Douglas Heaven和AI记者Grace Huckins参与。文章指出,全球顶尖AI实验室的员工认为先进AI确实存在毁灭人类的可能性,讨论围绕这一“AI灭绝恐惧”展开,探讨其来源、是否站得住脚以及应对之策。相关报道涉及多个值得关注的议题:LLM存在根本性缺陷使其极易被攻击,可被诱骗执行危险操作;AI在招聘中比人类更容易形成偏见,且能自行“发明”新的刻板印象;AI代理为达成目标会撒谎和作弊,这一现象被称为“奖励黑客”;此外,AI的递归自我改进可能并不会很快到来,因为AI代理尚不具备开展真正创新性开放式研究的能力。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅