🔥 今日值得一读 人形机器人首秀!29自由度全身导航,零训练直闯杂乱房间
TANGO: Humanoid Navigation in Cluttered Environments with a Whole-Body Vision-Language-Action Model
arXiv AI (cs.AI) 🔥 重点 #具身智能#VLA模型#导航 🕐 09-08 12:00
👨‍💼 主理人解读 · 为什么值得关注
开发者可用TANGO框架训练人形机器人,根据自然语言指令在复杂3D环境中自主避障导航,适用于仓储、家庭服务等场景。

📖 摘要

提出TANGO,首个全身视觉语言导航框架,实现人形机器人在杂乱环境中按语言指令行动。

🔑 关键词速览

TANGO一种用于人形机器人在杂乱环境中导航的全身视觉-语言-动作模型,直接预测关节空间动作。
whole-body vision-language-action model一种结合视觉、语言和动作的模型,能够根据语言指令和视觉输入生成全身关节动作。
29-DoF joint-space actions29个自由度的关节空间动作,指人形机器人全身关节的控制指令。
zero-shot deployment零样本部署,指模型在未见过的真实环境中直接应用,无需额外训练。
obstacle-aware motion editing障碍物感知运动编辑,一种根据障碍物信息调整运动轨迹的技术,确保无碰撞通行。
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅