当前位置:首页 > 文章列表 > 科技周边 > 人工智能 > 瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破

瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破

来源:机器之心 2024-05-05 13:06:10 0浏览 收藏

本篇文章给大家分享《瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破》,覆盖了科技周边的常见基础知识,其实一个语言的全部知识点一篇文章是不可能说完的,但希望通过这些问题,让读者对自己的掌握程度有一定的认识(B 数),从而弥补自己的不足,更好的掌握它。

机器狗在瑜伽球上稳稳当当的行走,平衡力那是相当的好:

瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破

各种场景都能拿捏,不管是平坦的人行道、还是充满挑战的草坪都能 hold 住:

瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破

甚至是研究人员踢了一脚瑜伽球,机器狗也不会歪倒:

瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破

给气球放气机器狗也能保持平衡:

瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破

上述展示都是 1 倍速,没有经过加速处理。
瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破
  • 论文地址:https://eureka-research.github.io/dr-eureka/assets/dreureka-paper.pdf
  • 项目主页:https://github.com/eureka-research/DrEureka
  • 论文标题:DrEureka: Language Model Guided Sim-To-Real Transfer

这项研究由宾夕法尼亚大学、 NVIDIA 、得克萨斯大学奥斯汀分校的研究者联合打造,并且完全开源。他们提出了 DrEureka(域随机化 Eureka),这是一种利用 LLM 实现奖励设计和域随机化参数配置的新型算法,可同时实现模拟到现实的迁移。该研究展示了 DrEureka 算法能够解决新颖的机器人任务,例如四足机器人平衡和在瑜伽球上行走,而无需迭代手动设计。

DrEureka 是基于 Eureka 完成的,后者还被评为 2023 年英伟达十大项目之一。了解 Eureka 更多内容可参考《有了 GPT-4 之后,机器人把转笔、盘核桃都学会了》。

在论文摘要部分,研究者表示将在模拟中学习到的策略迁移到现实世界是一种大规模获取机器人技能的有前途的策略。然而,模拟到现实的方法通常依赖于任务奖励函数以及模拟物理参数的手动设计和调整,这使得该过程缓慢且耗费人力。本文研究了使用大型语言模型 (LLM) 来自动化和加速模拟到现实的设计。

论文作者之一、英伟达高级科学家 Jim Fan 也参与了这项研究。此前英伟达成立 AI 实验室,领队人就是 Jim Fan,专攻具身智能。Jim Fan 表示:

「我们训练了一只机器狗能在瑜伽球上保持平衡并行走,这完全是在模拟中进行的,然后零样本迁移到现实世界,无需微调,直接运行。

对机器狗来说,走瑜伽球任务尤其困难,因为我们无法准确模拟弹力球表面。然而,DrEureka 可以轻松搜索大量模拟真实配置,并让机器狗能够在各种地形上操控球,甚至横着走!

一般来讲,从模拟到现实的迁移是通过域随机化实现的,这是一个繁琐的过程,需要机器人专家盯着每个参数并手动调整。像 GPT-4 这样的前沿 LLM 拥有大量内置的物理直觉,包括摩擦、阻尼、刚度、重力等,借助 GPT-4,DrEureka 可以熟练地调整这些参数并很好地解释其推理。」

瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破

论文介绍

DrEureka 流程如下所示,其接受任务和安全指令以及环境源代码,并运行 Eureka 以生成正则化的奖励函数和策略。然后,它在不同的模拟条件下测试该策略以构建奖励感知物理先验,并将其提供给 LLM 以生成一组域随机化 (DR) 参数。最后,使用合成的奖励和 DR 参数训练策略以进行实际部署。
瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破
Eureka 奖励设计。奖励设计组件基于 Eureka,因为它简单且具有表现力,但本文引入了一些改进,以增强其在模拟到真实环境中的适用性。伪代码如下:
瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破
奖励感知物理先验(RAPP,reward aware physics prior)。安全奖励函数可以规范策略行为以固定环境选择,但本身不足以实现模拟到现实的迁移。因此本文引入了一种简单的 RAPP 机制来限制 LLM 的基本范围。
瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破
LLM 用于域随机化。给定每个 DR 参数的 RAPP 范围,DrEureka 的最后一步指示 LLM 在 RAPP 范围的限制内生成域随机化配置。具体过程参见图 3:
瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破
该研究使用 Unitree Go1 来实验,Go1 是一个小型四足机器人,四条腿有 12 个自由度。在四足运动任务中,本文还系统地评估了 DrEureka 策略在几个现实世界地形上的性能,发现它们仍然具有鲁棒性,并且优于使用人类设计的奖励和 DR 配置训练的策略。
瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破
了解更多内容,请参考原论文。

今天关于《瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破》的内容就介绍到这里了,是不是学起来一目了然!想要了解更多关于工程,DrEureka的内容请关注golang学习网公众号!

版本声明
本文转载于:机器之心 如有侵犯,请联系study_golang@163.com删除
斯坦福李飞飞首次创业:学术休假两年,瞄准「空间智能」斯坦福李飞飞首次创业:学术休假两年,瞄准「空间智能」
上一篇
斯坦福李飞飞首次创业:学术休假两年,瞄准「空间智能」
全国铁路迎来五一假期返程客流高峰,今天预计发送旅客 1865 万人次
下一篇
全国铁路迎来五一假期返程客流高峰,今天预计发送旅客 1865 万人次
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    542次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    511次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    498次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    484次学习
查看更多
AI推荐
  • 千音漫语:智能声音创作助手,AI配音、音视频翻译一站搞定!
    千音漫语
    千音漫语,北京熠声科技倾力打造的智能声音创作助手,提供AI配音、音视频翻译、语音识别、声音克隆等强大功能,助力有声书制作、视频创作、教育培训等领域,官网:https://qianyin123.com
    216次使用
  • MiniWork:智能高效AI工具平台,一站式工作学习效率解决方案
    MiniWork
    MiniWork是一款智能高效的AI工具平台,专为提升工作与学习效率而设计。整合文本处理、图像生成、营销策划及运营管理等多元AI工具,提供精准智能解决方案,让复杂工作简单高效。
    215次使用
  • NoCode (nocode.cn):零代码构建应用、网站、管理系统,降低开发门槛
    NoCode
    NoCode (nocode.cn)是领先的无代码开发平台,通过拖放、AI对话等简单操作,助您快速创建各类应用、网站与管理系统。无需编程知识,轻松实现个人生活、商业经营、企业管理多场景需求,大幅降低开发门槛,高效低成本。
    211次使用
  • 达医智影:阿里巴巴达摩院医疗AI影像早筛平台,CT一扫多筛癌症急慢病
    达医智影
    达医智影,阿里巴巴达摩院医疗AI创新力作。全球率先利用平扫CT实现“一扫多筛”,仅一次CT扫描即可高效识别多种癌症、急症及慢病,为疾病早期发现提供智能、精准的AI影像早筛解决方案。
    218次使用
  • 智慧芽Eureka:更懂技术创新的AI Agent平台,助力研发效率飞跃
    智慧芽Eureka
    智慧芽Eureka,专为技术创新打造的AI Agent平台。深度理解专利、研发、生物医药、材料、科创等复杂场景,通过专家级AI Agent精准执行任务,智能化工作流解放70%生产力,让您专注核心创新。
    237次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议隐私政策
返回登录
  • 重置密码