「灌篮高手」模拟人形机器人,一比一照搬人类篮球招式,看一遍就能学会,无需特定任务的奖励
有志者,事竟成!如果你在学习科技周边,那么本文《「灌篮高手」模拟人形机器人,一比一照搬人类篮球招式,看一遍就能学会,无需特定任务的奖励》,就很适合你!文章讲解的知识点主要包括,若是你对本文感兴趣,或者是想搞懂其中某个知识点,就请你继续往下看吧~
投篮、运球、手指转球…这个物理模拟人形机器人会打球:
图片
会的招数还不少:
图片
一通秀技下来,原来都是跟人学的,每个动作细节都精确复制:
图片
这就是最近一项名为PhysHOI的新研究,能够让物理模拟的人形机器人通过观看人与物体交互(HOI)的演示,学习并模仿这些动作和技巧。
重点是,PhysHOI无需为每个特定任务设定具体的奖励机制,机器人可以自主学习和适应。
而且机器人的身上总共有51x3个独立控制点,所以模仿起来能做到高度逼真。
图片
一起来看具体是如何实现的。
模拟人形机器人变身「灌篮高手」
这项工作由来自北京大学、IDEA研究院、清华大学、卡内基梅隆大学的研究人员共同提出。
图片
经研究人员介绍,此前大多数类似工作,存在模仿动作孤立、需特定任务的奖励、未涉及灵巧的全身运动等局限。
图片
而他们提出的PhysHOI,应用动作捕捉技术提取HOI数据,然后使用模仿学习来学习人体运动和物体控制,解决了这些问题。
其中,HOI数据重要组成部分之一是涵盖了人体运动、物体运动、相对运动的运动学数据(Kinematic Data),记录了位置、速度、角度等信息。
另外,动态数据(Dynamic Data)反映了运动过程中的实时变动和更新,也很重要。
图片
为了弥补HOI数据中动态信息的不足,研究人员引入了接触图(contact graph,CG)。
图片
CG的节点由机器人的肢体部件和物体组成;每条边则是一个二进制接触标签,只表达“接触”或“不接触”两种状态。
此外,还可以将多个肢体部件放到一个节点中,形成一个聚合CG(Aggregated CG)。
具体来说,PhysHOI方法是:
首先通过运动捕捉获取参考HOI状态序列,包含人体运动、物体运动、交互图和接触图。
图片
然后用第一帧的信息初始化物理模拟环境,构建包含当前模拟状态和下一个参考状态的系统状态。
接下来输入策略网络生成的动作控制人形机器人,物理模拟器根据动作更新场景中人体和物体的状态,计算包含运动匹配、接触图等多个方面的奖励。
利用奖励、状态和动作样本优化策略网络,采用更新后的策略网络开始新一轮的模拟过程,如此循环直至网络收敛,最终获得能够重现参考HOI技能的控制策略。
值得一提的是,研究人员在这当中设计了一个与任务无关的HOI模仿奖励,无需针对不同任务自定义奖励函数,包括体现运动匹配度的身体和物体奖励、反映接触正确性的接触图奖励,避免了使用错误身体部位接触物体等局部最优解。
接触图奖励是关键
研究人员在两个HOI数据集上测试了PhysHOI。
其中引入了BallPlay数据集,包含多种全身篮球技能。
图片
他们在GRAB数据集的S8子集中选择了5个抓取案例,以及BallPlay数据集的8个篮球技能。
以此前的DeepMimic、AMP等方法作为基线,为公平比较,研究人员将其做了修改,以适应HOI模仿任务。
图片
结果显示,以往只使用运动学奖励的方法无法准确复现交互,球会掉落或抓握失败。
而在接触图的指导下,PhysHOI成功进行了HOI模仿。
PhysHOI在两个数据集上都获得最高的成功率,分别为95.4%和82.4%,同时也取得最低的运动误差,显著优于其它方法。
图片
消融研究表明,接触图奖励能有效避免只使用运动信息的方法陷入局部最优,指导机器人实现正确接触。
图片
如果没有接触图奖励,人形机器人可能无法控制球,或者错误地使用身体其它部位控制球:
图片
论文链接:https://arxiv.org/abs/2312.04393
今天关于《「灌篮高手」模拟人形机器人,一比一照搬人类篮球招式,看一遍就能学会,无需特定任务的奖励》的内容就介绍到这里了,是不是学起来一目了然!想要了解更多关于函数,的HOI的内容请关注golang学习网公众号!

- 上一篇
- 比亚迪预计销售300万辆汽车,计划奖励经销商约20亿

- 下一篇
- 张朝阳:鸿蒙将成为全球具有影响力的移动应用生态系统
-
- 科技周边 · 人工智能 | 14分钟前 |
- 豆包AI助你设计CI与自动化测试技巧
- 381浏览 收藏
-
- 科技周边 · 人工智能 | 19分钟前 |
- 豆包AI如何打造精致妆容?实用技巧分享
- 164浏览 收藏
-
- 科技周边 · 人工智能 | 25分钟前 |
- AI视频生成省时省钱?真实效率测评分享
- 230浏览 收藏
-
- 科技周边 · 人工智能 | 31分钟前 |
- 半固态电池为何成新能源与手机新宠?
- 464浏览 收藏
-
- 科技周边 · 人工智能 | 50分钟前 |
- AI剪辑算法揭秘:自动抓取高光镜头
- 203浏览 收藏
-
- 科技周边 · 人工智能 | 1小时前 |
- 豆包AI轻松操作数据库交互
- 391浏览 收藏
-
- 科技周边 · 人工智能 | 1小时前 |
- PerplexityAI如何实现语义搜索?
- 163浏览 收藏
-
- 科技周边 · 人工智能 | 1小时前 |
- 豆包AI如何助力园艺指导?技巧全解析
- 433浏览 收藏
-
- 科技周边 · 人工智能 | 1小时前 |
- Deepseek+DescriptAudio,打造专业音频工具
- 288浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 542次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 511次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 498次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 484次学习
-
- 千音漫语
- 千音漫语,北京熠声科技倾力打造的智能声音创作助手,提供AI配音、音视频翻译、语音识别、声音克隆等强大功能,助力有声书制作、视频创作、教育培训等领域,官网:https://qianyin123.com
- 151次使用
-
- MiniWork
- MiniWork是一款智能高效的AI工具平台,专为提升工作与学习效率而设计。整合文本处理、图像生成、营销策划及运营管理等多元AI工具,提供精准智能解决方案,让复杂工作简单高效。
- 143次使用
-
- NoCode
- NoCode (nocode.cn)是领先的无代码开发平台,通过拖放、AI对话等简单操作,助您快速创建各类应用、网站与管理系统。无需编程知识,轻松实现个人生活、商业经营、企业管理多场景需求,大幅降低开发门槛,高效低成本。
- 157次使用
-
- 达医智影
- 达医智影,阿里巴巴达摩院医疗AI创新力作。全球率先利用平扫CT实现“一扫多筛”,仅一次CT扫描即可高效识别多种癌症、急症及慢病,为疾病早期发现提供智能、精准的AI影像早筛解决方案。
- 150次使用
-
- 智慧芽Eureka
- 智慧芽Eureka,专为技术创新打造的AI Agent平台。深度理解专利、研发、生物医药、材料、科创等复杂场景,通过专家级AI Agent精准执行任务,智能化工作流解放70%生产力,让您专注核心创新。
- 159次使用
-
- GPT-4王者加冕!读图做题性能炸天,凭自己就能考上斯坦福
- 2023-04-25 501浏览
-
- 单块V100训练模型提速72倍!尤洋团队新成果获AAAI 2023杰出论文奖
- 2023-04-24 501浏览
-
- ChatGPT 真的会接管世界吗?
- 2023-04-13 501浏览
-
- VR的终极形态是「假眼」?Neuralink前联合创始人掏出新产品:科学之眼!
- 2023-04-30 501浏览
-
- 实现实时制造可视性优势有哪些?
- 2023-04-15 501浏览