过去几个月,交互模型成为AI领域一个尚未形成共识却迅速升温的赛道。Loopit、Reverie AI、SigmaZ AI等团队,以及Runway、Vidu等视频生成公司,纷纷推出实时交互产品,让用户能够打断角色、拖动画面、通过摄像头参与内容生成。这些产品名称各异,底层路线也不相同:有的直接生成音视频像素,有的结合Coding与视觉生成,有的定位为下一代AI界面。文章指出,交互模型介于视频生成模型与世界模型之间,核心在于模型生成的内容不是终点,而是下一轮交互的起点,用户每次输入都会影响后续画面。这一方向的兴起,得益于Diffusion视频生成质量和速度的提升,以及Coding能力的突破。目前赛道尚未收敛,各方争夺的首先是定义问题的权利,而共同指向的问题是:在聊天框之外,AI能否以更接近人与人交流的方式,看见、听见并持续回应用户。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅