在机器人领域,让四足机器人具备灵活的操作技能一直是一个充满挑战的研究课题。近日,斯坦福大学和哥伦比亚大学的研究团队提出了一个名为"UMI on Legs"的创新框架,为解决这一难题提供了新的思路。这个框架巧妙地结合了真实世界的人类示范数据和仿真训练的全身控制器,为四足机器人提供了一种可扩展的操作技能学习方法。
UMI on Legs 的核心理念是将操作策略与全身控制分离,同时建立一个有效的接口来连接这两个部分。具体来说,该框架包含以下几个关键组成部分:
UMI手持夹持器: 这是一个带有GoPro相机的手持设备,用于收集真实世界中的人类操作示范数据。研究人员可以使用UMI在各种环境中收集丰富的操作数据,而无需实际的机器人。
视觉-运动策略: 基于UMI收集的数据训练得到的策略,能够从图像输入生成夹持器的运动轨迹。
操作中心的全身控制器: 在仿真环境中训练的控制器,能够控制四足机器人的全身运动,以精确跟踪给定的末端执行器轨迹。
接口: 使用末端执行器在任务坐标系中的轨迹作为视觉-运动策略和全身控制器之间的接口。
这种设计使得现有的视觉-运动策略可以轻松地移植到四足机器人上,实现操作策略的移动化。
UMI (Universal Manipulation Interface) 是该框架中的一个关键组件。它是一个带有GoPro相机的手持夹持器,允许研究人员在不使用实际机器人的情况下收集真实世界的操作示范数据。这种方法有几个显著优势:
研究团队使用IsaacGym仿真器来训练四足机器人的全身控制器。这个控制器具有以下特点:
操作中心设计: 控制器专注于跟踪世界坐标系中的末端执行器轨迹,而不是像之前的工作那样在机体坐标系中跟踪。这使得机器人能够更好地应对外部干扰,保持操作的稳定性。
轨迹预测: 控制器能够预测未来的末端执行器轨迹,从而实现更精确的运动控制。例如,在投掷任务中,机器人可以提前调整姿态以获得更好的投掷效果。
鲁棒性: 通过在训练中引入质量、重心和关节参数的随机化,控制器具有较强的鲁棒性,能够适应不同的环境和任务。
研究团队在多个任务上对UMI on Legs进行了测试,包括抓取、非抓取操作和动态操作任务。实验结果显示,该框架在所有任务中都达到了超过70%的成功率。特别值得一提的是,研究人员成功地将一个原本为固定基座机械臂设计的操作策略,零样本迁移到了四足机器人上。
一些令人印象深刻的演示包括:
这些任务展示了UMI on Legs框架的versatility和实用性。
为了将UMI on Legs付诸实践,研究团队设计了一个名为"Espresso"的四足机器人平台。这个平台具有以下特点:
这种硬件配置使得Espresso能够灵活地执行各种操作任务,同时保持移动能力。
UMI on Legs框架为四足机器人的操作能力开辟了新的可能性。一些潜在的应用领域包括:
然而,研究团队也指出了当前框架的一些局限性,如操作策略与全身控制器之间的单向通信可能导致某些不可达目标的问题。未来的工作可能会focus on改进这一接口,实现双向通信和多个末端执行器的协调控制。
UMI on Legs 为四足机器人的操作能力提供了一个创新的解决方案。通过结合真实世界的数据收集、仿真训练和巧妙的系统设计,这个框架为机器人研究社区提供了一个可扩展、灵活的平台。随着进一步的发展和完善,我们可以期待看到更多令人惊叹的四足机器人应用在不久的将来成为现实。
对于有兴趣深入了解或尝试复现这项工作的研究者和开发者,UMI on Legs 的源代码和详细文档已在GitHub上开源。这为推动四足机器人技术的进步和创新应用提供了宝贵的资源。
选题、配图、成文,一站式创作,让内容运营更高效
讯飞绘文,一个AI集成平台,支持写作、选题、配图、排版和发布。高效生成适用于各类媒体的定制内容,加速品牌传播,提升内容营销效果。
AI辅助编程,代码自动修复
Trae是一种自适应的集成开发环境(IDE),通过自动化和多元协作改变开发流程。利用Trae,团队能够更快 速、精确地编写和部署代码,从而提高编程效率和项目交付速度。Trae具备上下文感知和代码自动完成功能,是提升开发效率的理想工具。
最强AI数据分析助手
小 浣熊家族Raccoon,您的AI智能助手,致力于通过先进的人工智能技术,为用户提供高效、便捷的智能服务。无论是日常咨询还是专业问题解答,小浣熊都能以快速、准确的响应满足您的需求,让您的生活更加智能便捷。
像人一样思考的AI智能体
imini 是一款超级AI智能体,能根据人类指令,自主思考、自主完成、并且交付结果的AI智能体。
AI数字人视频创作平台
Keevx 一款开箱即用的AI数字人视频创作平台,广泛适用于电商广告、企业培训与社媒宣传,让全球企业与个人创作者无需拍摄剪辑,就能快速生成多语言、高质量的专业视频。
一站式AI创作平台
提供 AI 驱动的图片、视频生成及数字人等功能,助力创意创作
AI办公助手,复杂任务高效处理
AI办公助手,复杂任务高效处理。办公效率低?扣子空间AI助手支持播客生成、PPT制作、网页开发及报告写作,覆盖科研、商业、舆情等领域的专家Agent 7x24小时响应,生活工作无缝切换,提升50%效率!
AI小说写作助手,一站式润色、改写、扩写
蛙蛙写作—国内先进的AI写作平台,涵盖小说、学术、社交媒体等多场景。提供续写、改写、润色等功能,助力创作者高效优化写作流程。界面简洁,功能全面,适合各类写作者提升内容品质和工作效率。
全能AI智能助手,随时解答生活与工作的多样问题
问小白,由元石科技研发的AI智能助手,快速准确地解答各种生活和工作问题,包括但不限于搜索、规划和社交互动,帮助用户在日常生活中提高效率,轻松管理个人事务。
实时语音翻译/同声传译工具
Transly是一个多场景的AI大语言模型驱动的同声传译、专业翻译助手,它拥有超精准的音频识别翻译能力,几乎零延迟的使用体验和支持多国语言可以让你带它走遍全球,无论你是留学生、商务人士、韩剧美剧爱好者,还是出国游玩、多国会议、跨国追星等等,都可以满足你所有需要同传的场景需求,线上线下通用,扫除语言障碍,让全世界的语言交流不再有国界。
最新AI工具、AI资讯
独家AI资源、AI项目落地
微信扫一扫关注公众号