Reka AI发布了Rho-1的研究预览版,这是一个拥有190亿参数的统一模型,能够在单一神经网络中处理并生成文本、图像、视频和机器人控制动作。与大多数将任务分配给专用模型的AI系统不同,Rho-1将所有模态作为共享上下文窗口中的token运行,无需工具调用或外部模型,并能实时生成连续视频、即时响应新指令而无需重启。其关键突破在于,预测摄像机图像的同一套权重也直接驱动机器人运动;为克服机器人训练数据稀缺的问题,Reka AI构建了逆动力学模型,从普通互联网视频中提取控制信号。该模型在320块H100 GPU上训练约三个月。这一发布契合了AI研究向“世界模型”发展的趋势,也延续了Reka AI自2024年推出多模态模型Reka Core以来的技术积累。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅