这项研究指出,当前主流世界模型(如Sora、Genie 3、JEPA等)仅模拟物理层面——物体、位置、运动与遮挡,却忽略了人类内在的信念、意图与情感等心理状态,导致对行动预测的偏差。作者以“杯子被移入柜子”为例说明:纯物理模型虽能正确呈现场景变化,却无法预判当事人随后的行为,只有追踪其信念的模型才能给出准确预测。为此,他们提出“心理世界建模”(MWM)框架,将信念、注意力、目标、规范等心理变量纳入状态空间,并将每个动作拆分为物理载体与心理载荷(如递杯子的动作可能是道歉、欺骗或关怀)。研究团队还开发了无需训练的参考实现MENTIS,通过六步流程模拟动作对物理与心理状态的双重影响。该研究强调,心理状态仅是行为与情境的推断假设,而非真实测量,系统应保持不确定性表达与假设透明。这一框架为服务机器人、医疗助手等协作型AI提供了更贴近人类行为逻辑的建模方向。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅