这篇文章探讨了AI在智力测试和谜题中的表现,指出尽管AI能力提升迅速,但在某些领域仍存在明显短板。文章提到,2024年底最好的模型只能解决18%的《纽约时报》Connections谜题,而到2025年初部分模型已能近乎完美解答,显示进步速度惊人。然而,AI在空间推理方面表现糟糕,无法像人类那样进行三维物体旋转操作;同时,模型对训练数据的依赖使其在遇到相似但略有变化的谜题时容易出错,缺乏适应性和灵活性。文章通过具体谜题示例,如心理旋转测试,强调人类与AI认知方式的差异,并邀请读者测试自己能否在这些AI失手的谜题中胜出。核心意义在于,谜题不仅是评估AI进展的工具,也揭示了机器智能的局限,提醒我们当前AI虽强于记忆和模式识别,但在直觉、空间理解和应变能力上仍逊于人类。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅