更多精彩 >

星动纪元端到端原生机器人大模型ERA-42正式亮相,引领具身大模型进入灵巧操作时代

2024-12-23 12:32:36   来源:华夏晚报  作者: 

摘要:这是业界首次仅通过同一个具身大模型就实现了五指灵巧手像人手一样使用多种工具完成上百种灵巧复杂操作任务,展现了ERA-42行业领先的通用、灵巧操作能力。

导语:近期,星动纪元端到端原生机器人大模型ERA-42正式亮相,即“纪元原生机器人大模型”,寓意着不断探索宇宙万物的终极答案,展示了其与自研五指灵巧手星动XHAND1结合后的灵巧操作能力,已学会了使用不同工具完成100多种复杂灵巧的操作任务,并且持续在同一个模型下学习新的技能。例如,拿起桌上螺钉钻钻紧螺钉、用锤子敲打钉子、将水杯扶正后再往水杯中倒水等任务。

图片1.jpg

基于ERA-42,星动XHAND1能用不同工具完成多种灵巧操作新任务

这是业界首次仅通过同一个具身大模型就实现了五指灵巧手像人手一样使用多种工具完成上百种灵巧复杂操作任务,展现了ERA-42行业领先的通用、灵巧操作能力。模型不需要任何预编程技能,完全基于其强大的泛化和自适应力,能在不到2小时内通过收集少量数据就学会执行新的任务。同时,ERA-42还在快速不断学习更多新技能中。

图片2.jpg

基于ERA-42,星动XHAND1可完成100多种精细化、智能化的五指灵巧手操作任务

ERA-42也是世界范围内首个真正的五指灵巧手具身大模型,开启了具身大模型的通用灵巧操作时代。

1. “真正”的具身大模型才是开启通用具身智能体的密钥,需要具备以下三个要素:

一是统一一个模型泛化多种任务和环境:通过构建一个统一的原生模型,融合视觉、语言、触觉和身体姿态等全模态信息,实现对不同任务和环境的泛化能力。

二是端到端:从接收全模态数据,到生成最终输出(如决策、动作等),通过一个简洁的神经网络链路完成。该过程无需人为设计特征、预编程或干预处理步骤,使得具身智能体能够实时适应不同任务和环境,显著提升灵活性与开发效率。

三是Scaling up(规模化):真正的统一的端到端算法才允许模型通过持续的数据积累实现自我完善,使得具身大模型在数据量指数级增长的同时,不仅提升性能,还能在未知任务中展现卓越的自适应和泛化能力。

例如,被行业广泛熟知的Physical Intelligence (简称PI)发布的π0模型就具备上述要素,是典型的真正意义上的端到端具身大模型。

2. 星动纪元ERA-42是国内首个真正意义上的端到端原生机器人大模型,比肩世界领先水平

早期,星动纪元和PI几乎同期采用了端到端算法来提升其原生机器人大模型性能,PI推出的π0模型,通过结合互联网规模的视觉-语言预训练与机器人操作数据集后训练,使得机器人能够在人类环境中自主执行多种复杂任务,这是机器人从特定任务的“专家”向多任务的“通才”发展历程上的重要一步,也是具身大模型领域的一个里程碑。

图片3.jpg

星动纪元早期发布的研究成果和Physical Intelligence (PI)几乎不谋而合

星动论文HiRT: Enhancing Robotic Control with Hierarchical Robot Transformers发表在CoRL2024

而后,星动纪元又探索了另一条训练道路,采用大规模视频数据学习策略,涵盖无标注的视频数据、公开各类形态机器人的数据、人类活动数据以及遥操作数据等。并且,在上述数据的使用上,星动纪元不是直接模仿视频里的人怎么去做,而是学习行动之后会产生什么样的结果。这种方式使得学习效果不受限于数据质量,能大大降低数据收集成本,解决了数据消耗量巨大、需要大量高质量数据的行业难题。

此外,星动纪元的技术团队已将世界模型融入原生机器人大模型中,使得模型不仅具备行动能力,还具备了对物理世界的理解能力,能够对未来行动轨迹进行预测。

图片4.jpg

后期,星动纪元探索了融合世界模型的原生机器人大模型

星动论文Prediction with Action: Visual Policy Learning via Joint Denoising Process发表在NeurIPS 2024

还能迅速响应外部干扰,并在任务执行过程中持续自适应优化行为,直至任务完成。提升了机器人执行任务的高效性和准确性。

星动纪元打造的端到端原生机器人大模型ERA-42凭借其预测能力,模型具备强大的泛化、自适应和规模化能力。结合星动纪元为AI打造的全新硬件平台,可快速实现具身智能体软硬件协同进化和商业化落地。

3. 星动纪元端到端原生机器人大模型ERA-42引领具身大模型进入通用灵巧操作时代

1)相比夹爪,星动XHAND1已经可以完成100多种精细化、智能化的复杂灵巧操作任务

相比夹爪,基于ERA-42能力,五指灵巧手能够真正像人手一样使用更多种多样的工具,完成更通用、灵巧性更强、复杂度更高的百种以上操作任务。

图片5.jpg

基于ERA-42,五指灵巧手星动XHAND1相比夹爪能使用更多不同工具执行更灵巧操作

2)星动纪元原生机器人大模型ERA-42能理解物理世界和预测未来

融合世界模型后,ERA-42具备对物理世界的理解以及对未来的预测的能力,从而大幅提升了泛化能力和任务成功率。

例如,下图中上方的图片展示了真实物理世界中打开冰箱的逐帧操作,下方的图片则为ERA-42生成的环境建模与对打开冰箱任务的逐帧预测。可以看到两张图片非常接近,说明模型预测非常准确。这与其他机器人大模型直接学习行动、而忽视对世界本身理解的方式,或者仅将世界模型用于生成仿真数据的方式,存在本质的区别。

图片6.jpg

真实世界执行任务和ERA-42预测执行任务对比图

3)星动纪元原生机器人大模型ERA-42具备更强泛化能力

基于大规模视频数据的预训练,只需采集少部分数据,基于ERA-42的泛化能力,短时间内通过单一的策略灵巧手就能学会执行新的操作任务。此前,星动纪元技术团队就通过这种训练方式采集简单的红黄蓝方块抓取数据,成功实现了从未见过的多样化物体(如胡萝卜、茄子等)的抓取泛化,并相对其他模型算法在泛化任务上显著提升了成功率。

图片7.jpg

通过简单彩色方块的抓取数据实现多样化物体的泛化抓取操作

4)星动纪元原生机器人大模型ERA-42具备更强自适应性

由于融合了世界模型,ERA-42不管在单任务上,还是长序列任务上都展现出了业内领先的强大抗干扰能力。

5)星动纪元原生机器人大模型ERA-42初步体现“Scaling效应”

并且研究结果表明,随着模型规模的扩大,任务成功率也明显提升,初步体现了和大语言模型训练中类似的“Scaling效应”,即模型规模与性能之间的正相关性。

图片8.jpg

“Scaling效应”显示模型与机器人性能呈现正相关性

4.星动纪元端到端原生机器人大模型ERA-42和为AI打造的全新硬件平台协同进化,共建原生具身智能体

构建通用具身智能体需要软硬件协同迭代,就像人类的脑和身体是从小到大同步协同成长的一样。

图片9.jpg

构建原生通用具身智能体=原生机器人大模型+为AI定义的硬件平台协同进化

因此,星动纪元打造了为AI定义的全新硬件平台。以星动自研推出的五指灵巧手星动XHAND1为例,共有12个主动自由度,并采用纯电驱方式,且每个自由度都有对应的驱动源,实现全自主五指关节驱动,能执行高精度任务。星动XHAND1每个手指配备一个高分辨率(>100点)触觉阵列传感器,提供精确的三维力触觉和温度信息。单手最大握力能达80N,负载可达25kg。

图片10.jpg

星动XHAND1 —— 全自驱 真自由

星动XHAND1在作业能力上展现出的高性能在协同ERA-42后,为实现复杂灵巧操作任务奠定了基础。

依托ERA-42,星动纪元通用人形机器人执行任务的通用性和泛化性将大幅提升,结合此前发布的在复杂多样的地形上稳定行走和奔跑的运动性能,配合上下肢协同作业能力,潜在应用场景也将更加多元化,真正实现原生的通用具身智能体的产业化落地。


猜你喜欢

卷营销不如卷科研,星医联雕刻家小薄瓶引领无创缩脂潮流

创新创业星医联

近日,北京星医联科技有限公司(简称星医联)凭借其前沿的科研实力,在医美行业掀起了一场新的革命。

6小时前

主线科技新疆首张无人驾驶卡车路测牌照获批

创新创业主线科技

4月3日上午,喀什市以"智联未来・喀什启程"为主题,正式启动智能网联汽车道路测试与示范应用项目

6小时前

仅三生物完成亿元Pre-A轮融资,加速麦角硫因产业化布局

创新创业仅三生物

国际一流麦角硫因原料大厂江苏仅三生物科技有限公司(以下简称“仅三生物”)宣布完成由集富亚洲领投的亿元...

6小时前

希德森工业控制系统(上海)有限公司获中国信达天使轮融资

创新创业希德森

近日,希德森工业控制系统(上海)有限公司宣布成功获得中国信达5000万人民币的天使轮融资。

10小时前

践行“全民阅读”国家战略,句象书店打造复合型公共阅读空间创新样本

句象书店

全民阅读作为我国建设社会主义文化强国的重要路径,近年来得到国家的高度重视。

2025-03-14

数字华夏完成数千万元天使+轮融资,同创伟业独家投资

同创伟业数字华夏

数字华夏(深圳)科技有限公司(以下简称"数字华夏")今日宣布完成数千万元天使+轮融资

2025-03-14

深度:人参肽包含多种人参皂苷

大消费人参肽

人参肽,人参皂苷,这两者最直接的关系就是:人参肽中本身就含有多种人参皂苷,尤其是Rg3、Rh2,都有...

2025-03-14

亿部立富硒人参肽与普通人参肽的差别

大消费亿部立富硒人参肽

亿部立富硒人参肽,绝非普通人参肽,两者相比,亿部立有以下几个差别或者优势

2025-03-14

2025老高电商圈子旗下金冠俱乐部开年盛典:“无界未来”点燃行业新希望

创新创业老高电商圈子

2025年3月14日-深圳,深耕电商行业多年的老高电商圈子主办的“2025电商企业家开年盛典”,于2...

2025-03-14

渤海人寿“3·15”多措并举构筑消保新生态

金融科技渤海人寿

连日来,围绕“保障金融权益 助力美好生活”的“3·15”金融消费者权益保护教育宣传活动主题,渤海人寿...

2025-03-14

洲际航天携手阿拉伯信息通讯组织启动6000颗卫星星座计划

上市公司洲际航天

近日,洲际航天科技在“百星展览”活动上宣布,与阿拉伯信息通讯组织(Arab Information ...

2025-03-14

“AI+数据”驱动!太美医疗科技新一代IRV重构独立影像评估价值链

医疗健康太美医疗科技

“从IRC到IRV,我们所提供的不仅仅是高质量的独立影像评估服务,更是从产业价值出发,结合太美医疗科...

2025-03-14

官方喊你减肥了!珠江桥牌让健康美味触手可及

大消费珠江桥牌

春夏交替,万物复苏,此时,人体的新陈代谢也愈发旺盛,正是调整饮食结构,塑造健康生活的好时机。

2025-03-14

投资家网(www.investorscn.com)是国内领先的资本与产业创新综合服务平台。为活跃于中国市场的VC/PE、上市公司、创业企业、地方政府等提供专业的第三方信息服务,包括行业媒体、智库服务、会议服务及生态服务。长按右侧二维码添加"投资哥"可与小编深入交流,并可加入微信群参与官方活动,赶快行动吧。

沙特天空塔投资设立专项基金带领中国氢能独角兽扎根沙特

2016年注册于北京的中氢新能技术有限公司,下设位于大兴的装备制造公司、位于海淀区的技术研究院、材料...

挑战奔驰的明星车企,突然“翻车”了

一度无比高光的理想汽车,猝不及防遭遇重挫。

深圳天使母基金姚小雄:将来股权投资行业竞争是服务能力的竞争

2024年1月10日,由投资家网主办,财经锐眼、有时间协办,北京微金科技有限公司承办的“第十二届股权...

避免卡脖子,硬科技如何“逆境”突围?

2024年1月10日,由投资家网主办,财经锐眼、有时间协办,北京微金科技有限公司承办的“第十二届股权...

VC/PE眼中的“专精特新”

2024年1月10日,由投资家网主办,财经锐眼、有时间协办,北京微金科技有限公司承办的“第十二届股权...

分化浪潮中的坚守与突破 | 第19届中国投资年会,即将启幕

分化浪潮中的坚守与突破 | 第19届中国投资年会,即将启幕

在时代的浩渺长河中,“分化”宛如一条隐匿的脉络,贯穿于万物的生长、发展与变迁。从生命的进化到文明的演...

第二届中匈可再生能源、新材料商业投资峰会将盛大启幕

第二届中匈可再生能源、新材料商业投资峰会将盛大启幕

第二届中匈可再生能源、新材料商业投资峰会于2025年4月9日在匈牙利布达佩斯盛大启幕。

雕刻耐心|第18届中国投资年会·有限合伙人峰会在沪召开

雕刻耐心|第18届中国投资年会·有限合伙人峰会在沪召开

“中国投资年会”作为私募股权行业的年度盛会,已成功举办了18届,吸引了全国VC/PE领域从业者的广泛...

雕刻耐心|第18届中国投资年会·有限合伙人峰会即将启幕

雕刻耐心|第18届中国投资年会·有限合伙人峰会即将启幕

2024年的一级市场,“耐心”是最高命题,也引发了持续全年的讨论。