OpenAI近日发布了数百个针对高难度数学问题的解答,并称已咨询由九位顶尖数学家组成的顾问组,以避免此前模型解题引发的争议。然而,其做法未能达到该顾问组——普林斯顿高等研究院数学与人工智能顾问组(AGMAI)——设定的标准。AGMAI的首要建议是停止在专有模型上测试高等数学问题,而OpenAI明确表示正使用开放研究问题评估其专有模型。在透明度方面,719份解答中仅10份公开了模型的思维链;在形式化验证方面,仅42%的证明完成了形式化过程。此外,一篇新论文指出,OpenAI模型声称解决的百万美元级问题,其自然语言解答与形式化解答之间存在差距。AGMAI强调,数学界需自行评估其建议被遵循的程度,并建议OpenAI资助人类数学家的工作,以确保AI生成的解答能被真正理解。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅