灵初智能发布端到端VLA模型PsiR0.5,仅需两小时数据实现物品、场景全面泛化

1年前 来源:华夏晚报 观看:140

近日,Figure 发布的端到端 VLA 具身大模型  Helix,采用分层架构同时实现高频控制和高泛化能力,引起了业内广泛关注。几乎同期,中国具身智能团队灵初智能发布了基于强化学习的增强版分层架构端到端 VLA  模型 Psi R0.5,这距离灵初智能团队去年底发布的 Psi R0 仅 2 个月kin即热新闻——关注每天科技社会生活新变化gihot.com

  本次发布的新模型重大升级,对于复杂场景的泛化性灵巧性CoT长程任务能力上均有显著提升,同时完成泛化抓取训练所需的数据量仅需  Helix 数据量的 0.4%!在全球范围内实现了泛化灵巧操作与训练效率的双重领先。kin即热新闻——关注每天科技社会生活新变化gihot.com

  此外,灵初智能团队连发四篇高质量论文,将团队在高效实现泛化抓取堆叠场景的物品检索利用外部环境配合抓取VLA  安全对齐方面的最新成果悉数公开,展现了中国团队在具身智能领域的强悍战斗力。kin即热新闻——关注每天科技社会生活新变化gihot.com

1.pngkin即热新闻——关注每天科技社会生活新变化gihot.com

Psi R0.5 路径演进图kin即热新闻——关注每天科技社会生活新变化gihot.com

DexGraspVLA仅需两小时灵巧手抓取数据kin即热新闻——关注每天科技社会生活新变化gihot.com

轻松实现物品、灯光、场景泛化并实现真正  CoTkin即热新闻——关注每天科技社会生活新变化gihot.com

  DexGraspVLA 是首个用于灵巧手通用抓取的  VLA(Vision-Language-Action)框架,通过少量的训练,即刻在多变环境下智能涌现灵巧操作能力,能够像人类一样快速、准确地拾取各种物品。kin即热新闻——关注每天科技社会生活新变化gihot.com

  DexGraspVLA 是一个融合视觉,语言和动作的层次化框架:kin即热新闻——关注每天科技社会生活新变化gihot.com

  · High-level  Planner:高层规划由预训练的大型视觉语言模型(VLM)实现,可理解多样化指令、自主决定抓取策略kin即热新闻——关注每天科技社会生活新变化gihot.com

  · Low-level  Controller:低层扩散策略通过实时视觉反馈闭环掌握目标物体智能涌现出灵巧操作能力kin即热新闻——关注每天科技社会生活新变化gihot.com

  整个框架的核心在于将多样化的图像输入数据通过现有的 Foundation Model 转换成 Domain-invariance  的表征,并端到端地训练下层控制模型。kin即热新闻——关注每天科技社会生活新变化gihot.com

2.pngkin即热新闻——关注每天科技社会生活新变化gihot.com

DexGraspVLA 框架图kin即热新闻——关注每天科技社会生活新变化gihot.com

  从实验结果看,灵初智能仅使用了约 2 小时的灵巧手抓取数据(2094 条轨迹 × 3.5 秒 / 条 ÷ 60 秒  / 分钟 ÷ 60 分钟 / 小时 ≈ 2 小时),泛化到上千种不同物体,位置,堆叠,灯光,背景下成功抓取,而这个数据量仅仅是 Figure 的  0.4%数据利用效率提高 250 倍kin即热新闻——关注每天科技社会生活新变化gihot.com

  同时,DexGraspVLA 相比现有方案还具有几项优势:kin即热新闻——关注每天科技社会生活新变化gihot.com

  · 根据语言指令分辨出目标物体,处理堆叠场景下的目标物体的检索并抓取kin即热新闻——关注每天科技社会生活新变化gihot.com

  · 抓取速度快(所有视频无加速,同类工作中节拍较快),闭环姿态矫正与重抓取能力(ReGrasp)kin即热新闻——关注每天科技社会生活新变化gihot.com

  · 大脑具有 CoT 长程推理能力自主推理抓取顺序并将所有物体依次抓取kin即热新闻——关注每天科技社会生活新变化gihot.com

  DexGraspVLA  展现出对光照变化背景干扰和物体姿态的强大鲁棒性和泛化性,让机器人的灵巧抓取达到人类级别。kin即热新闻——关注每天科技社会生活新变化gihot.com

  基于预训练的大模型:使用自然语言与人类交互,具有高智能的长程推理能力,能够自主理解人类话语并推理任务。因此可以一次设定多个抓取目标,通过 CoT  实现复杂流程下的自动分拣或清理。kin即热新闻——关注每天科技社会生活新变化gihot.com

  DexGraspVLA  仍然会自动分析当前姿态偏差,通过细微调整腕关节和手部角度重新尝试抓取实现非常鲁棒且高效的抓取能力达到极强的泛化能力kin即热新闻——关注每天科技社会生活新变化gihot.com

3.pngkin即热新闻——关注每天科技社会生活新变化gihot.com

Retrieval Dexteritykin即热新闻——关注每天科技社会生活新变化gihot.com

堆叠场景中的高效物体检索策略kin即热新闻——关注每天科技社会生活新变化gihot.com

  强化学习底层驱动,简单 reward 涌现复杂动作kin即热新闻——关注每天科技社会生活新变化gihot.com

  在大多数实际场景中,物品往往以无规则、堆叠的方式摆放。传统方法要求机器人逐件搬开遮挡物,不仅耗时,还对机器人自身抓取能力提出了很高的要求。kin即热新闻——关注每天科技社会生活新变化gihot.com

  为了解决这一难题,灵初智能开发了一套基于强化学习的物体检索策略 ——Retrieval  Dexterity,解决了堆叠场景中物体检索识别效率低的问题。kin即热新闻——关注每天科技社会生活新变化gihot.com

  Retrieval Dexterity  系统中未用真机数据,灵初团队没有采用真机数据进行训练而是直接在仿真环境中通过强化学习进行训练。通过在仿真环境中大规模生成复杂的堆叠场景,训练模型直至涌现出合适的检索操作,随后再将这些操作零样本迁移至现实机器人和复杂环境中。kin即热新闻——关注每天科技社会生活新变化gihot.com

4.pngkin即热新闻——关注每天科技社会生活新变化gihot.com

Retrieval Dexterity 框架图kin即热新闻——关注每天科技社会生活新变化gihot.com

  从杂乱堆叠物体中快速取出目标物体kin即热新闻——关注每天科技社会生活新变化gihot.com

  在超过 10 种不同形状、大小的生活物品测试中,Retrieval Dexterity  展现出了优秀的性能,不仅能够高效完成训练过的物体的检索任务还能将检索能力泛化到未见过的新物体上kin即热新闻——关注每天科技社会生活新变化gihot.com

  效率对比传统方法提升明显kin即热新闻——关注每天科技社会生活新变化gihot.com

  与人为设定的动作相比,Retrieval Dexterity 在所有场景中平均减少了 38%  的操作步骤与模拟的 “将所有物体抓起来并放开” 相比,该方法更是平均减少了 90%  的步骤数量。这种效率提升主要得益于多指灵巧手能够直接与遮挡物进行交互,并随时移动它们,而不需要逐个移除。kin即热新闻——关注每天科技社会生活新变化gihot.com

5.pngkin即热新闻——关注每天科技社会生活新变化gihot.com

ExDex:借力外部环境kin即热新闻——关注每天科技社会生活新变化gihot.com

抓取 “不可能” 物体kin即热新闻——关注每天科技社会生活新变化gihot.com

  外部灵巧性解决物品超过机器人末端执行器的最大开度问题kin即热新闻——关注每天科技社会生活新变化gihot.com

  当物体的底面尺寸超过机器人末端执行器的最大开度时,传统方法往往无法直接对物体进行抓取,这种情况在商场等商业场景尤为常见。为了解决这一难题,灵初智能推出了  ExDex—— 一种基于外部灵巧性(extrinsic dexterity)抓取的创新解决方案kin即热新闻——关注每天科技社会生活新变化gihot.com

  ExDex 能够利用环境特征进行非夹持式操作,凭借多指灵巧手的灵活性和操作能力,实现更丰富的环境交互。kin即热新闻——关注每天科技社会生活新变化gihot.com

  强化学习带来超越人类遥操作水平的灵巧操作kin即热新闻——关注每天科技社会生活新变化gihot.com

  通过强化学习,ExDex  涌现出自主制定策略的能力,借助周围环境抓取那些无法直接抓取的物体。例如,机器人可以将物体先推到桌面边缘或墙体边缘,再利用这些环境特征完成抓取任务。这种操作通过传统的遥操作方式几乎无法实现,充分体现了强化学习的强大优势。kin即热新闻——关注每天科技社会生活新变化gihot.com

  在对数十种不同家居物品的大量实验中,ExDex  验证了其优越的性能和对新物体的泛化能力并成功将仿真训练的策略无缝迁移到真实机器人中,实现了从仿真到现实的高效过渡。kin即热新闻——关注每天科技社会生活新变化gihot.com

SafeVLA:人机安全交互的 “守护神”kin即热新闻——关注每天科技社会生活新变化gihot.com

  当下,具身智能机器人频繁出圈,从春晚跳舞的 Unitree  人形机器人,到波兰街头遛机器狗的新奇场景,让人看到人机交互的无限可能,但安全问题也不容忽视。视觉 - 语言 -  行动模型(VLAs)在革新机器人技术时,也藏着安全隐患。kin即热新闻——关注每天科技社会生活新变化gihot.com

6.pngkin即热新闻——关注每天科技社会生活新变化gihot.com

 左图呈现了传统 VLA 模型在抓取任务中的三种典型不安全行为:1)对无关物体的严重损坏,2)目标识别错误导致危险物体的误用,以及  3)执行指令时与危险物体发生交互。右图通过导航路径示例,进一步展示了传统 VLA 在导航过程中的三种不安全行为kin即热新闻——关注每天科技社会生活新变化gihot.com

  本周,北京大学 PAIR - Lab 团队携手灵初智能重磅推出了具身安全模型  SafeVLA,通过安全对齐,让机器人在复杂场景安全高效执行任务,在对抗干扰场景中鲁棒性极高kin即热新闻——关注每天科技社会生活新变化gihot.com

  SafeVLA 把 “以人为本” 刻进  DNA,不像传统机器人只盯着任务完成它把人类安全放在首位。技术上,引入约束马尔可夫决策过程(CMDP)范式,把现实安全约束融入仿真环境大规模采样。SafeVLA  在安全性和任务执行方面均取得突破性进展分别提升 83.58% 和  3.85%充分证明了其在平衡安全与效率方面的卓越能力kin即热新闻——关注每天科技社会生活新变化gihot.com

11.gifkin即热新闻——关注每天科技社会生活新变化gihot.com

传统 VLA 模型完成任务过程中的高危行为kin即热新闻——关注每天科技社会生活新变化gihot.com

  团队开发全新仿真环境 Safety -  CHORES集成安全约束功能支持用户自定义规则代码还完全开源直接给全球研究者和开发者送福利。而且,SafeVLA  在 12 个分布外(OOD)实验里,面对光照、材质变化和复杂环境扰动,始终稳定发挥,实力碾压其他模型。kin即热新闻——关注每天科技社会生活新变化gihot.com

22.gifkin即热新闻——关注每天科技社会生活新变化gihot.com

SafeVLA 在正常测试集和 OOD 测试集上的比较,其在 OOD 环境下依然保持良好安全性和表现kin即热新闻——关注每天科技社会生活新变化gihot.com


kin即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-14-7388-0.html灵初智能发布端到端VLA模型PsiR0.5,仅需两小时数据实现物品、场景全面泛化

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:企业智能化升级关键:DeepSeek大模型技术与应用论坛来了!

下一篇:赛力斯申请注册问界智享商标

为你推荐
海外硬件网络零售平台 Newegg 近日报道称,在前几天英伟达 RTX 50 系列显卡上架销售后,仅在 20 分钟内就售罄。平台还分析了 RTX 5080 以及 5090 的用户活跃激增...
02-04
发行商Hooded Horse近日宣布,中古时期策略游戏《庄园领主》销量已突破300万份,官方对玩家的支持表示了衷心感谢。 《庄园领主》最初于2024年4月26日在Steam上发...
02-10
极目新闻记者 李博秦礼和与孙女在足球场内合影2月5日,湖北恩施利川市忠路镇江源村,73岁秦礼和正陪2岁半的孙女,在自己手工打造的笼式足球场踢足球。孩子步履蹒跚,欢笑声接连不断...
02-06
2025年综合运输春运工作专班数据显示,预计2025年2月9日(春运第27日,农历正月十二),全社会跨区域人员流动量20629万人次,其中,铁路客运量1330万人次,公路人员流动量18983万人次(高速公...
02-09
1月20日,国家能源局发布的“2024年全国油气勘探开发十大标志性成果”显示,2024年,国内油气产量当量首次超过4亿吨,连续8年保持千万吨级快速增长势头,“...
01-21
美国加州大学伯克利分校和韩国高丽大学科学家携手,从变色龙身上获得灵感,研制出一种新型电磁材料。这种材料能够模仿变色龙的变色机制,按需在吸收、传...
01-24
  2月7日,来自辽宁省邮政管理局的监测数据显示,今年春节假期(1月28日至2月4日),辽宁省快递业务揽收量1578....
02-08
  我省扩内需、促消费再迎政策加码。近日,省商务厅、省发展改革委等九部门联合印发《关于促进服务消费...
02-18
  中新经纬1月21日电 中消协发布提示称,消费者在春节期间消费要抵制餐饮浪费、抵制过度包装、谨慎选购“金包银”首饰等。  21日,中消协在官网发布消费提示:消费不踩坑 欢...
01-21
  中新经纬1月20日电 国家能源局网站20日发布2024年全社会用电量等数据。  2024年,全社会用电量98521亿千瓦时,同比增长6.8%,其中规模以上工业发电量为94181亿千瓦时。  ...
01-21
[本站 国内谍照] 海豹06家族再扩大,除了海豹06 DM-i、海豹06 GT,和已经曝光的海豹06 EV,海豹06旅行版谍照也随之曝光。新车设计看齐海豹06 DM-i,引入第五代DM插混。当然...
01-24
北京时间 1 月 24 日,据英国《金融时报》报道,欧盟已承诺帮助陷入困境的欧洲汽车行业,可能会通过实施覆盖整个欧盟的补贴计划来提振电动汽车需求。欧盟委员会执行副主...
01-24
最近,由几位优秀演员出演的电视剧《仙台有树》播出后,收视率和热度表现不俗。剧情紧凑,人物塑造生动,受到观众好评。剧中,在仙山之巅,薛冉冉成功筑基。然而,她遭遇...
02-21
《余烬之上》谁在替凶手说谎?在《余烬之上》中,有多人为凶手说谎或提供误导性信息。马洛和荔枝:在努娜死亡案件中,马洛试图为廖思远辩解,称有案发当晚他不在场的...
02-21
这里是《21健讯Daily》,欢迎与21世纪经济报道新健康团队共同关注医药健康行业最新事件!政策动向医保钱包开通地区再扩容,14省117个统筹区实现...
02-08
21世纪经济报道记者 闫硕 北京报道2月6日,礼来发布2024年第四季度及全年业绩报告。报告显示,2024年第四季度营收为135.3亿美元,同比增长45%;净...
02-08
  大众网记者 王一刚 报道  报纸王国欢迎您,纸不仅是孩子们熟知的事物,更是他们游戏,创作和探索的素材,在《报纸王国》主题活动中孩子们与报纸展开了一系列的活动,不知不...
01-21
2024年12月,杭州的天气湿冷入骨,浙江大学经济学院百人计划研究员、博士生导师...
01-22
  2024年12月30日,中国信托业协会发布《2023—2024中国信托业社会责任报告》(以下简称《报告》)...
01-24
  摘要  【“双焦”重挫,向下空间有多大?】前期利多预期兑现后,交易逻辑再次回归基本面,预计短...
02-06
天秤座的男人通常被认为是温和、理性、追求平衡的代表。他们对于爱情有着独特的追求和...
01-22
天蝎座男生是十二星座中最神秘、深沉的一种类型,他们对感情非常认真,一旦喜欢上一个人,会...
01-22
如何评价杨幂的穿搭? 时尚女王杨幂长袖外搭短袖的叠穿法,如何看上去更有层次感?一、如何评价杨幂的穿搭?杨幂的穿搭堪称完美,她的身材苗条,穿衣搭配时尚,让人过目不忘。她的黑色亮...
02-12
ysl是什么牌子的包包? lv包包和ysl包包哪个?ysl是什么牌子的包包?圣罗兰 股票代码ISYSl,不过目前已经退市。YSL(Yves Saint laurent)的简称,中文译名圣罗兰,是法国著名奢侈品牌,由193...
02-17
2月16日消息,春风送暖,甘蔗种植迎来关键时刻。中农网依托产业链优势,推动旗下广西易农通深入甘蔗种植环节,在南宁市武鸣区罗波镇板欧蔗区率先启动2025年5万亩甘蔗种植计划,通过数...
02-17
2月17日消息,据地歌网,目前京东外卖将重点在39座城市进行推广。具体来看,包括北京、上海、沈阳、深圳、中山、珠海、西安、南通、重庆、南宁、广州、昆明、杭州、哈尔滨、石家...
02-18
图源:图虫创意 编者按:春节,中国人心中最传统、最具仪式感的...
02-07
2月20日消息,全国多地中小学已经开学,途牛《2025寒假出游消费盘点》显示,今年寒假旅游热度呈现出分段式“三峰”出游的显著特征:第一波出游高峰自假期伊始就迅速形成,并在1月20日...
02-21
2024年末,一位科技创业者火了。作者 | 王思琪来源 | 投资家(ID:touzijias)2024年末,一位科技创业者火了。2025年初,这位创业者再度爆火。近日,中国科技行业因一位85后年轻人现身《...
01-24
2024年末,一位科技创业者火了。作者 | 王思琪来源 | 投资家(ID:touzijias)2024年末,一位科技创业者火了。2025年初,这位创业者再度爆火。近日,中国科技行业因一位85后年轻人现身《...
01-24
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮