当前位置：首页 > 文章列表 > 科技周边 > 人工智能 > 「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励

「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励

来源：51CTO.COM 2024-01-02 19:59:14 0浏览收藏

有志者，事竟成！如果你在学习科技周边，那么本文《「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励》，就很适合你！文章讲解的知识点主要包括，若是你对本文感兴趣，或者是想搞懂其中某个知识点，就请你继续往下看吧~

投篮、运球、手指转球…这个物理模拟人形机器人会打球：

「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励图片

会的招数还不少：

「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励图片

一通秀技下来，原来都是跟人学的，每个动作细节都精确复制：

「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励图片

这就是最近一项名为PhysHOI的新研究，能够让物理模拟的人形机器人通过观看人与物体交互（HOI）的演示，学习并模仿这些动作和技巧。

重点是，PhysHOI无需为每个特定任务设定具体的奖励机制，机器人可以自主学习和适应。

而且机器人的身上总共有51x3个独立控制点，所以模仿起来能做到高度逼真。

「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励图片

一起来看具体是如何实现的。

模拟人形机器人变身「灌篮高手」

这项工作由来自北京大学、IDEA研究院、清华大学、卡内基梅隆大学的研究人员共同提出。

「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励图片

经研究人员介绍，此前大多数类似工作，存在模仿动作孤立、需特定任务的奖励、未涉及灵巧的全身运动等局限。

「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励图片

而他们提出的PhysHOI，应用动作捕捉技术提取HOI数据，然后使用模仿学习来学习人体运动和物体控制，解决了这些问题。

其中，HOI数据重要组成部分之一是涵盖了人体运动、物体运动、相对运动的运动学数据（Kinematic Data），记录了位置、速度、角度等信息。

另外，动态数据（Dynamic Data）反映了运动过程中的实时变动和更新，也很重要。

「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励图片

为了弥补HOI数据中动态信息的不足，研究人员引入了接触图（contact graph，CG）。

「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励图片

CG的节点由机器人的肢体部件和物体组成；每条边则是一个二进制接触标签，只表达“接触”或“不接触”两种状态。

此外，还可以将多个肢体部件放到一个节点中，形成一个聚合CG（Aggregated CG）。

具体来说，PhysHOI方法是：

首先通过运动捕捉获取参考HOI状态序列，包含人体运动、物体运动、交互图和接触图。

「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励图片

然后用第一帧的信息初始化物理模拟环境，构建包含当前模拟状态和下一个参考状态的系统状态。

接下来输入策略网络生成的动作控制人形机器人，物理模拟器根据动作更新场景中人体和物体的状态，计算包含运动匹配、接触图等多个方面的奖励。

利用奖励、状态和动作样本优化策略网络，采用更新后的策略网络开始新一轮的模拟过程，如此循环直至网络收敛，最终获得能够重现参考HOI技能的控制策略。

值得一提的是，研究人员在这当中设计了一个与任务无关的HOI模仿奖励，无需针对不同任务自定义奖励函数，包括体现运动匹配度的身体和物体奖励、反映接触正确性的接触图奖励，避免了使用错误身体部位接触物体等局部最优解。

接触图奖励是关键

研究人员在两个HOI数据集上测试了PhysHOI。

其中引入了BallPlay数据集，包含多种全身篮球技能。

「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励图片

他们在GRAB数据集的S8子集中选择了5个抓取案例，以及BallPlay数据集的8个篮球技能。

以此前的DeepMimic、AMP等方法作为基线，为公平比较，研究人员将其做了修改，以适应HOI模仿任务。

「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励图片

结果显示，以往只使用运动学奖励的方法无法准确复现交互，球会掉落或抓握失败。

而在接触图的指导下，PhysHOI成功进行了HOI模仿。

PhysHOI在两个数据集上都获得最高的成功率，分别为95.4%和82.4%，同时也取得最低的运动误差，显著优于其它方法。

「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励图片

消融研究表明，接触图奖励能有效避免只使用运动信息的方法陷入局部最优，指导机器人实现正确接触。

「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励图片

如果没有接触图奖励，人形机器人可能无法控制球，或者错误地使用身体其它部位控制球：

「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励图片

论文链接：https://arxiv.org/abs/2312.04393

今天关于《「灌篮高手」模拟人形机器人，一比一照搬人类篮球招式，看一遍就能学会，无需特定任务的奖励》的内容就介绍到这里了，是不是学起来一目了然！想要了解更多关于函数,的HOI的内容请关注golang学习网公众号！

函数的HOI

版本声明

本文转载于：51CTO.COM 如有侵犯，请联系study_golang@163.com删除

比亚迪预计销售300万辆汽车，计划奖励经销商约20亿

比亚迪预计销售300万辆汽车，计划奖励经销商约20亿

上一篇: 比亚迪预计销售300万辆汽车，计划奖励经销商约20亿

张朝阳：鸿蒙将成为全球具有影响力的移动应用生态系统

下一篇: 张朝阳：鸿蒙将成为全球具有影响力的移动应用生态系统

查看更多

最新文章

科技周边 · 人工智能 | 9分钟前 | 效率培训变现绘蛙AI 批量修图

绘蛙AI修图教程及变现技巧

392浏览收藏
科技周边 · 人工智能 | 14分钟前 |

豆包AI助你设计CI与自动化测试技巧

381浏览收藏
科技周边 · 人工智能 | 19分钟前 |

豆包AI如何打造精致妆容？实用技巧分享

164浏览收藏
科技周边 · 人工智能 | 20分钟前 | AI视频制作 AI配音文字转视频摩笔天书AI 后期调整

摩笔天书AI视频制作全攻略

486浏览收藏
科技周边 · 人工智能 | 25分钟前 |

AI视频生成省时省钱？真实效率测评分享

230浏览收藏
科技周边 · 人工智能 | 31分钟前 |

半固态电池为何成新能源与手机新宠？

464浏览收藏
科技周边 · 人工智能 | 50分钟前 |

AI剪辑算法揭秘：自动抓取高光镜头

203浏览收藏
科技周边 · 人工智能 | 1小时前 |

豆包AI轻松操作数据库交互

391浏览收藏
科技周边 · 人工智能 | 1小时前 |

PerplexityAI如何实现语义搜索？

163浏览收藏
科技周边 · 人工智能 | 1小时前 | 个性化用户粘性会员中心续费率价值感知

DecktopusAI会员中心如何提升30%续费率

199浏览收藏
科技周边 · 人工智能 | 1小时前 |

豆包AI如何助力园艺指导？技巧全解析

433浏览收藏
科技周边 · 人工智能 | 1小时前 |

Deepseek+DescriptAudio，打造专业音频工具

288浏览收藏

查看更多

课程推荐

前端进阶之JavaScript设计模式

设计模式是开发人员在软件开发过程中面临一般问题时的解决方案，代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景，打造一站式知识长龙服务，适合有JS基础的同学学习。

542次学习
GO语言核心编程课程

本课程采用真实案例，全面具体可落地，从理论到实践，一步一步将GO核心编程技术、编程思想、底层实现融会贯通，使学习者贴近时代脉搏，做IT互联网时代的弄潮儿。

511次学习
简单聊聊mysql8与网络通信

如有问题加微信：Le-studyg；在课程中，我们将首先介绍MySQL8的新特性，包括性能优化、安全增强、新数据类型等，帮助学生快速熟悉MySQL8的最新功能。接着，我们将深入解析MySQL的网络通信机制，包括协议、连接管理、数据传输等，让

498次学习
JavaScript正则表达式基础与实战

在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。

487次学习
从零制作响应式网站—Grid布局

本系列教程将展示从零制作一个假想的网络科技公司官网，分为导航，轮播，关于我们，成功案例，服务流程，团队介绍，数据部分，公司动态，底部信息等内容区块。网站整体采用CSSGrid布局，支持响应式，有流畅过渡和展现动画。

484次学习

查看更多

AI推荐

千音漫语

千音漫语，北京熠声科技倾力打造的智能声音创作助手，提供AI配音、音视频翻译、语音识别、声音克隆等强大功能，助力有声书制作、视频创作、教育培训等领域，官网：https://qianyin123.com

151次使用
MiniWork

MiniWork是一款智能高效的AI工具平台，专为提升工作与学习效率而设计。整合文本处理、图像生成、营销策划及运营管理等多元AI工具，提供精准智能解决方案，让复杂工作简单高效。

143次使用
NoCode

NoCode (nocode.cn)是领先的无代码开发平台，通过拖放、AI对话等简单操作，助您快速创建各类应用、网站与管理系统。无需编程知识，轻松实现个人生活、商业经营、企业管理多场景需求，大幅降低开发门槛，高效低成本。

157次使用
达医智影

达医智影，阿里巴巴达摩院医疗AI创新力作。全球率先利用平扫CT实现“一扫多筛”，仅一次CT扫描即可高效识别多种癌症、急症及慢病，为疾病早期发现提供智能、精准的AI影像早筛解决方案。

150次使用
智慧芽Eureka

智慧芽Eureka，专为技术创新打造的AI Agent平台。深度理解专利、研发、生物医药、材料、科创等复杂场景，通过专家级AI Agent精准执行任务，智能化工作流解放70%生产力，让您专注核心创新。

159次使用

查看更多

相关文章

GPT-4王者加冕！读图做题性能炸天，凭自己就能考上斯坦福

2023-04-25 501浏览
单块V100训练模型提速72倍！尤洋团队新成果获AAAI 2023杰出论文奖

2023-04-24 501浏览
ChatGPT 真的会接管世界吗？

2023-04-13 501浏览
VR的终极形态是「假眼」？Neuralink前联合创始人掏出新产品：科学之眼！

2023-04-30 501浏览
实现实时制造可视性优势有哪些？

2023-04-15 501浏览

Golang学习网：公益在线Go学习平台，帮助Go学习者快速成长！

技术交流群

Copyright 2023 http://www.17golang.com/ All Rights Reserved ｜苏ICP备2023003363号-1

关注公众号

Golang学习网

微信登录更方便

密码登录
注册账号

登录即同意用户协议和隐私政策

返回登录

重置密码