特斯拉机器人全面进化!感知、大脑、运动控制能力升级 端到端方案初现成效
在IT行业这个发展更新速度很快的行业,只有不停止的学习,才不会被行业所淘汰。如果你是科技周边学习者,那么本文《特斯拉机器人全面进化!感知、大脑、运动控制能力升级 端到端方案初现成效》就很适合你!本篇内容主要包括##content_title##,希望对大家的知识积累有所帮助,助力实战开发!
《科创板日报》9月25日讯(编辑 郑远方)当地时间24日,特斯拉机器人官方账号Tesla Optimus更新了“具身智能首秀”。
在介绍中,特斯拉称,人形机器人Optimus(擎天柱)已可以自主对物品分类,其神经网络训练是“完全端到端的”——即可实现视频信号输入,控制信号输出。
在视频中,特斯拉机器人展示了视觉自标定、颜色分拣任务、单脚保持平衡等能力,在感知、大脑、运动与控制方面具备多项亮点:
在感知方面,通过视觉感知及关节位置编码器,Optimus便可自动校准四肢,并精准定位四肢的空间位置。
在大脑方面,凭借纯视觉技术及完全本地部署的神经网络,其可以迅速适应环境并完成多项任务。
其将蓝色与绿色积木分别分拣到对应颜色的托盘之中,即便在抓取积木过程中,有人在一旁将积木打乱,Optimus也可以立即调整并适应新环境,继续分拣积木。与此同时,其还可以将翻倒的积木摆正,并执行“打乱分类好的积木”等新任务。
在运动控制能力方面,Optimus可以精准抓取物品,在做出动作时,该机器人的四肢、躯干、手指动作都极为灵活,且与人类接近。此外,Optimus还做出多个单腿支撑的运动拉伸动作,并能在拉伸的同时保持躯干平衡。
值得注意的是,特斯拉端到端模型输入端为视频信号,即图像及音频信号的混合输入,但此次展示显示,其识别部分神经网络算法仅使用视觉信息。
中信证券认为,特斯拉V12自动驾驶的算法体系同时应用于人形机器人及汽车是可行的,且有利于加速提升识别算法的泛化能力。随着特斯拉展示了机器人端到端技术路线可能性,该方案与其FSD的运行模式类似,FSD以及Dojo的成功经验有望加速机器人迭代速度,由单一任务向多任务拓展。
分环节来看,(1)在输入端,分析师指出,本次特斯拉展现的图像识别,2D及3D相机都可实现,选配核心为成本控制因素,国内视觉镜头及相机等核心零部件厂商已具备此类产品生产能力,产品配套方案及产品性价比值得关注。
(2)在输出端,特斯拉人形机器人输出端为信号及姿态控制,关节、传感器、控制系统对输出端稳定性至关重要,此领域可选方案较多,不同厂商有望在不同价格段占据优势。
(3)在算法端,端到端框架能够直接从原始输入端到最终输出端进行训练,无需进行手动特征工程或中间阶段处理。尽管此视频未展示其具体算法,但基于其输入输出信息,建议关注基于强化学习框架的机器人控制算法。
(4)在硬件端,视频展现出特斯拉机器人的静态运动控制稳定性及用以控制平衡的IMU的较高精度,且关节模组中的“双编码器”并非存在阻滞性较强的缺点,灵巧手中的编码器也同样具备较高精度。IMU、编码器等传感环节的重要性愈发显现。
落实到具体标的上,浙商证券看好人形机器人产业化大趋势,聚焦人形机器人核心部件制造龙头。
电机:鸣志电器,关注汇川技术、江苏雷利、步科股份、伟创电气等;
丝杠:恒立液压、长盛轴承、五洲新春,关注贝斯特、鼎智科技、日发精机、秦川机床等;
重写内容:减速器品牌包括双环传动、绿的谐波、中大力德、上海机电、汉宇集团、丰立智能、大族激光、昊志机电等
传感器:华依科技、柯力传感、汉威科技、芯动联科等;
可供选择的控制器品牌包括华中数控、博众精工、新时达、埃夫特、英威腾等
轻量化:精工科技、中复神鹰、吉林化纤、吉林碳谷等公司都在追求轻量化技术
集成:三花智控、拓普集团等;
机器人整机:埃斯顿、博实股份、新松机器人等公司提供
特种机器人:晶品特装。
重写内容如下:
今天关于《特斯拉机器人全面进化!感知、大脑、运动控制能力升级 端到端方案初现成效》的内容就介绍到这里了,是不是学起来一目了然!想要了解更多关于的内容请关注golang学习网公众号!

- 上一篇
- AI技术指数级爆发:70年间算力增长6.8亿倍,3个历史阶段见证

- 下一篇
- 特斯拉人形机器人进一步进化:通过视觉自主分类实现瑜伽能力
-
- 科技周边 · 人工智能 | 1小时前 |
- 豆包AI代码加密技巧全解析
- 114浏览 收藏
-
- 科技周边 · 人工智能 | 2小时前 | 数据驱动 个性化 转化率 DecktopusAI 订阅对比页
- DecktopusAI订阅页设计对比指南
- 323浏览 收藏
-
- 科技周边 · 人工智能 | 2小时前 |
- 别克GL8陆尊内饰升级东方美学豪华体验
- 239浏览 收藏
-
- 科技周边 · 人工智能 | 3小时前 |
- 多模态AI如何解析量子数据?
- 175浏览 收藏
-
- 科技周边 · 人工智能 | 3小时前 |
- 曾毓群身家400亿,财富分配计划曝光
- 421浏览 收藏
-
- 科技周边 · 人工智能 | 3小时前 |
- 即梦AI试用期延长技巧与免费体验方法
- 152浏览 收藏
-
- 科技周边 · 人工智能 | 3小时前 |
- Gemini支持量子通信模拟吗?
- 446浏览 收藏
-
- 科技周边 · 人工智能 | 3小时前 |
- 豆包AI教程!5分钟搞定爆款梗图模板
- 190浏览 收藏
-
- 科技周边 · 人工智能 | 3小时前 |
- AIOverviews权限分级设置详解
- 173浏览 收藏
-
- 科技周边 · 人工智能 | 3小时前 | 数据分析 页面优化 DecktopusAI 众筹项目 项目创意
- DecktopusAI如何提升众筹支持率?
- 490浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 542次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 511次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 498次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 484次学习
-
- 千音漫语
- 千音漫语,北京熠声科技倾力打造的智能声音创作助手,提供AI配音、音视频翻译、语音识别、声音克隆等强大功能,助力有声书制作、视频创作、教育培训等领域,官网:https://qianyin123.com
- 207次使用
-
- MiniWork
- MiniWork是一款智能高效的AI工具平台,专为提升工作与学习效率而设计。整合文本处理、图像生成、营销策划及运营管理等多元AI工具,提供精准智能解决方案,让复杂工作简单高效。
- 211次使用
-
- NoCode
- NoCode (nocode.cn)是领先的无代码开发平台,通过拖放、AI对话等简单操作,助您快速创建各类应用、网站与管理系统。无需编程知识,轻松实现个人生活、商业经营、企业管理多场景需求,大幅降低开发门槛,高效低成本。
- 207次使用
-
- 达医智影
- 达医智影,阿里巴巴达摩院医疗AI创新力作。全球率先利用平扫CT实现“一扫多筛”,仅一次CT扫描即可高效识别多种癌症、急症及慢病,为疾病早期发现提供智能、精准的AI影像早筛解决方案。
- 213次使用
-
- 智慧芽Eureka
- 智慧芽Eureka,专为技术创新打造的AI Agent平台。深度理解专利、研发、生物医药、材料、科创等复杂场景,通过专家级AI Agent精准执行任务,智能化工作流解放70%生产力,让您专注核心创新。
- 232次使用
-
- GPT-4王者加冕!读图做题性能炸天,凭自己就能考上斯坦福
- 2023-04-25 501浏览
-
- 单块V100训练模型提速72倍!尤洋团队新成果获AAAI 2023杰出论文奖
- 2023-04-24 501浏览
-
- ChatGPT 真的会接管世界吗?
- 2023-04-13 501浏览
-
- VR的终极形态是「假眼」?Neuralink前联合创始人掏出新产品:科学之眼!
- 2023-04-30 501浏览
-
- 实现实时制造可视性优势有哪些?
- 2023-04-15 501浏览