灵初智能发布端到端VLA模型PsiR0.5,仅需两小时数据实现物品、场景全面泛化

10个月前 来源:华夏晚报 观看:119

近日,Figure 发布的端到端 VLA 具身大模型  Helix,采用分层架构同时实现高频控制和高泛化能力,引起了业内广泛关注。几乎同期,中国具身智能团队灵初智能发布了基于强化学习的增强版分层架构端到端 VLA  模型 Psi R0.5,这距离灵初智能团队去年底发布的 Psi R0 仅 2 个月bAm即热新闻——关注每天科技社会生活新变化gihot.com

  本次发布的新模型重大升级,对于复杂场景的泛化性灵巧性CoT长程任务能力上均有显著提升,同时完成泛化抓取训练所需的数据量仅需  Helix 数据量的 0.4%!在全球范围内实现了泛化灵巧操作与训练效率的双重领先。bAm即热新闻——关注每天科技社会生活新变化gihot.com

  此外,灵初智能团队连发四篇高质量论文,将团队在高效实现泛化抓取堆叠场景的物品检索利用外部环境配合抓取VLA  安全对齐方面的最新成果悉数公开,展现了中国团队在具身智能领域的强悍战斗力。bAm即热新闻——关注每天科技社会生活新变化gihot.com

1.pngbAm即热新闻——关注每天科技社会生活新变化gihot.com

Psi R0.5 路径演进图bAm即热新闻——关注每天科技社会生活新变化gihot.com

DexGraspVLA仅需两小时灵巧手抓取数据bAm即热新闻——关注每天科技社会生活新变化gihot.com

轻松实现物品、灯光、场景泛化并实现真正  CoTbAm即热新闻——关注每天科技社会生活新变化gihot.com

  DexGraspVLA 是首个用于灵巧手通用抓取的  VLA(Vision-Language-Action)框架,通过少量的训练,即刻在多变环境下智能涌现灵巧操作能力,能够像人类一样快速、准确地拾取各种物品。bAm即热新闻——关注每天科技社会生活新变化gihot.com

  DexGraspVLA 是一个融合视觉,语言和动作的层次化框架:bAm即热新闻——关注每天科技社会生活新变化gihot.com

  · High-level  Planner:高层规划由预训练的大型视觉语言模型(VLM)实现,可理解多样化指令、自主决定抓取策略bAm即热新闻——关注每天科技社会生活新变化gihot.com

  · Low-level  Controller:低层扩散策略通过实时视觉反馈闭环掌握目标物体智能涌现出灵巧操作能力bAm即热新闻——关注每天科技社会生活新变化gihot.com

  整个框架的核心在于将多样化的图像输入数据通过现有的 Foundation Model 转换成 Domain-invariance  的表征,并端到端地训练下层控制模型。bAm即热新闻——关注每天科技社会生活新变化gihot.com

2.pngbAm即热新闻——关注每天科技社会生活新变化gihot.com

DexGraspVLA 框架图bAm即热新闻——关注每天科技社会生活新变化gihot.com

  从实验结果看,灵初智能仅使用了约 2 小时的灵巧手抓取数据(2094 条轨迹 × 3.5 秒 / 条 ÷ 60 秒  / 分钟 ÷ 60 分钟 / 小时 ≈ 2 小时),泛化到上千种不同物体,位置,堆叠,灯光,背景下成功抓取,而这个数据量仅仅是 Figure 的  0.4%数据利用效率提高 250 倍bAm即热新闻——关注每天科技社会生活新变化gihot.com

  同时,DexGraspVLA 相比现有方案还具有几项优势:bAm即热新闻——关注每天科技社会生活新变化gihot.com

  · 根据语言指令分辨出目标物体,处理堆叠场景下的目标物体的检索并抓取bAm即热新闻——关注每天科技社会生活新变化gihot.com

  · 抓取速度快(所有视频无加速,同类工作中节拍较快),闭环姿态矫正与重抓取能力(ReGrasp)bAm即热新闻——关注每天科技社会生活新变化gihot.com

  · 大脑具有 CoT 长程推理能力自主推理抓取顺序并将所有物体依次抓取bAm即热新闻——关注每天科技社会生活新变化gihot.com

  DexGraspVLA  展现出对光照变化背景干扰和物体姿态的强大鲁棒性和泛化性,让机器人的灵巧抓取达到人类级别。bAm即热新闻——关注每天科技社会生活新变化gihot.com

  基于预训练的大模型:使用自然语言与人类交互,具有高智能的长程推理能力,能够自主理解人类话语并推理任务。因此可以一次设定多个抓取目标,通过 CoT  实现复杂流程下的自动分拣或清理。bAm即热新闻——关注每天科技社会生活新变化gihot.com

  DexGraspVLA  仍然会自动分析当前姿态偏差,通过细微调整腕关节和手部角度重新尝试抓取实现非常鲁棒且高效的抓取能力达到极强的泛化能力bAm即热新闻——关注每天科技社会生活新变化gihot.com

3.pngbAm即热新闻——关注每天科技社会生活新变化gihot.com

Retrieval DexteritybAm即热新闻——关注每天科技社会生活新变化gihot.com

堆叠场景中的高效物体检索策略bAm即热新闻——关注每天科技社会生活新变化gihot.com

  强化学习底层驱动,简单 reward 涌现复杂动作bAm即热新闻——关注每天科技社会生活新变化gihot.com

  在大多数实际场景中,物品往往以无规则、堆叠的方式摆放。传统方法要求机器人逐件搬开遮挡物,不仅耗时,还对机器人自身抓取能力提出了很高的要求。bAm即热新闻——关注每天科技社会生活新变化gihot.com

  为了解决这一难题,灵初智能开发了一套基于强化学习的物体检索策略 ——Retrieval  Dexterity,解决了堆叠场景中物体检索识别效率低的问题。bAm即热新闻——关注每天科技社会生活新变化gihot.com

  Retrieval Dexterity  系统中未用真机数据,灵初团队没有采用真机数据进行训练而是直接在仿真环境中通过强化学习进行训练。通过在仿真环境中大规模生成复杂的堆叠场景,训练模型直至涌现出合适的检索操作,随后再将这些操作零样本迁移至现实机器人和复杂环境中。bAm即热新闻——关注每天科技社会生活新变化gihot.com

4.pngbAm即热新闻——关注每天科技社会生活新变化gihot.com

Retrieval Dexterity 框架图bAm即热新闻——关注每天科技社会生活新变化gihot.com

  从杂乱堆叠物体中快速取出目标物体bAm即热新闻——关注每天科技社会生活新变化gihot.com

  在超过 10 种不同形状、大小的生活物品测试中,Retrieval Dexterity  展现出了优秀的性能,不仅能够高效完成训练过的物体的检索任务还能将检索能力泛化到未见过的新物体上bAm即热新闻——关注每天科技社会生活新变化gihot.com

  效率对比传统方法提升明显bAm即热新闻——关注每天科技社会生活新变化gihot.com

  与人为设定的动作相比,Retrieval Dexterity 在所有场景中平均减少了 38%  的操作步骤与模拟的 “将所有物体抓起来并放开” 相比,该方法更是平均减少了 90%  的步骤数量。这种效率提升主要得益于多指灵巧手能够直接与遮挡物进行交互,并随时移动它们,而不需要逐个移除。bAm即热新闻——关注每天科技社会生活新变化gihot.com

5.pngbAm即热新闻——关注每天科技社会生活新变化gihot.com

ExDex:借力外部环境bAm即热新闻——关注每天科技社会生活新变化gihot.com

抓取 “不可能” 物体bAm即热新闻——关注每天科技社会生活新变化gihot.com

  外部灵巧性解决物品超过机器人末端执行器的最大开度问题bAm即热新闻——关注每天科技社会生活新变化gihot.com

  当物体的底面尺寸超过机器人末端执行器的最大开度时,传统方法往往无法直接对物体进行抓取,这种情况在商场等商业场景尤为常见。为了解决这一难题,灵初智能推出了  ExDex—— 一种基于外部灵巧性(extrinsic dexterity)抓取的创新解决方案bAm即热新闻——关注每天科技社会生活新变化gihot.com

  ExDex 能够利用环境特征进行非夹持式操作,凭借多指灵巧手的灵活性和操作能力,实现更丰富的环境交互。bAm即热新闻——关注每天科技社会生活新变化gihot.com

  强化学习带来超越人类遥操作水平的灵巧操作bAm即热新闻——关注每天科技社会生活新变化gihot.com

  通过强化学习,ExDex  涌现出自主制定策略的能力,借助周围环境抓取那些无法直接抓取的物体。例如,机器人可以将物体先推到桌面边缘或墙体边缘,再利用这些环境特征完成抓取任务。这种操作通过传统的遥操作方式几乎无法实现,充分体现了强化学习的强大优势。bAm即热新闻——关注每天科技社会生活新变化gihot.com

  在对数十种不同家居物品的大量实验中,ExDex  验证了其优越的性能和对新物体的泛化能力并成功将仿真训练的策略无缝迁移到真实机器人中,实现了从仿真到现实的高效过渡。bAm即热新闻——关注每天科技社会生活新变化gihot.com

SafeVLA:人机安全交互的 “守护神”bAm即热新闻——关注每天科技社会生活新变化gihot.com

  当下,具身智能机器人频繁出圈,从春晚跳舞的 Unitree  人形机器人,到波兰街头遛机器狗的新奇场景,让人看到人机交互的无限可能,但安全问题也不容忽视。视觉 - 语言 -  行动模型(VLAs)在革新机器人技术时,也藏着安全隐患。bAm即热新闻——关注每天科技社会生活新变化gihot.com

6.pngbAm即热新闻——关注每天科技社会生活新变化gihot.com

 左图呈现了传统 VLA 模型在抓取任务中的三种典型不安全行为:1)对无关物体的严重损坏,2)目标识别错误导致危险物体的误用,以及  3)执行指令时与危险物体发生交互。右图通过导航路径示例,进一步展示了传统 VLA 在导航过程中的三种不安全行为bAm即热新闻——关注每天科技社会生活新变化gihot.com

  本周,北京大学 PAIR - Lab 团队携手灵初智能重磅推出了具身安全模型  SafeVLA,通过安全对齐,让机器人在复杂场景安全高效执行任务,在对抗干扰场景中鲁棒性极高bAm即热新闻——关注每天科技社会生活新变化gihot.com

  SafeVLA 把 “以人为本” 刻进  DNA,不像传统机器人只盯着任务完成它把人类安全放在首位。技术上,引入约束马尔可夫决策过程(CMDP)范式,把现实安全约束融入仿真环境大规模采样。SafeVLA  在安全性和任务执行方面均取得突破性进展分别提升 83.58% 和  3.85%充分证明了其在平衡安全与效率方面的卓越能力bAm即热新闻——关注每天科技社会生活新变化gihot.com

11.gifbAm即热新闻——关注每天科技社会生活新变化gihot.com

传统 VLA 模型完成任务过程中的高危行为bAm即热新闻——关注每天科技社会生活新变化gihot.com

  团队开发全新仿真环境 Safety -  CHORES集成安全约束功能支持用户自定义规则代码还完全开源直接给全球研究者和开发者送福利。而且,SafeVLA  在 12 个分布外(OOD)实验里,面对光照、材质变化和复杂环境扰动,始终稳定发挥,实力碾压其他模型。bAm即热新闻——关注每天科技社会生活新变化gihot.com

22.gifbAm即热新闻——关注每天科技社会生活新变化gihot.com

SafeVLA 在正常测试集和 OOD 测试集上的比较,其在 OOD 环境下依然保持良好安全性和表现bAm即热新闻——关注每天科技社会生活新变化gihot.com


bAm即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-14-7388-0.html灵初智能发布端到端VLA模型PsiR0.5,仅需两小时数据实现物品、场景全面泛化

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:企业智能化升级关键:DeepSeek大模型技术与应用论坛来了!

下一篇:赛力斯申请注册问界智享商标

为你推荐
一款名为《GrandTaking Ages VI》的游戏此前上架了索尼的 PlayStation 商店。显而易见,游戏的简写与即将推出的《GTA6》一模一样,显然是一款碰瓷的游戏。目前,这...
01-24
今日(1月27日),恐怖探索ADV《呪いの穢れ唄 鳴海龍也の回奇録》Steam页面开放,2025年4月发售,不支持中文,感兴趣的玩家可以点击此处进入商店页面。 游戏介绍: 失...
01-29
极目新闻评论员 屈旌2月9日,截至15时,哪吒2票房超78亿,已进入全球影史票房前40,今日或将突破80亿大关。据报道,《哪吒2》片尾出现了138家中国动画公司,导演饺子曾表示,本来寄希望于...
02-09
营造清朗涉军网络舆论环境——解读《互联网军事信息传播管理办法》的四大特点《互联网军事信息传播管理办法》(以下简称《办法》),以习近平新时代中国特色社会主义思想为指导,全...
02-10
1月10日,《2024中国大学、央企、城市海外网络传播力建设系列报告》发布会在北京师范大学举办。记者在会上了解到,2024年,我国部分中央企业通过将大语...
01-24
  央视网消息:1月22日,文化和旅游部发布2024年度国内旅游数据。2024年,国内出游人次56.15亿,比上...
01-24
  2月7日,来自辽宁省邮政管理局的监测数据显示,今年春节假期(1月28日至2月4日),辽宁省快递业务揽收量1578....
02-08
  “索要千万逼死丈夫”案的翟欣欣因涉嫌犯敲诈勒索罪,案件将于今日开庭。  苏享茂的哥哥苏享龙此前也曾对外发布消息,说已接法院通知,翟欣欣涉嫌敲诈勒索一案,定于2025...
01-21
  中国财政部督促注册会计师协会加强自律监督  中新社北京1月16日电 (记者 赵建华)中国财政部近日印发《关于进一步加强注册会计师协会自律监督工作的意见》(下称《意见...
01-21
1 月 21 日消息,凯翼汽车宣布旗下“2024 款改款”凯翼昆仑 iHD插混SUV 现已上市,新车共推出 9 款车型,指导价格区间为 10.99 万-17.99 万元,整理具体定价信息如下:车型定...
01-22
1 月 26 日消息,近期德国多家企业,包括能源供应商 Badenova、房屋建筑公司 Viebrockhaus 以及连锁药店 Rossmann,纷纷表示将不再购买特斯拉的新车,原因是特斯拉首席执行...
01-27
  近来,“C-Drama”(Chinese Drama,中文电视剧)成为海外新热词,讨论日益火爆。  前段时间,由《...
01-22
《余烬之上》廖知白真实存在吗?廖知白是幻想出来的吗?在《余烬之上》的剧情设定中,廖知白是真实存在的。廖知白是电视剧《余烬之上》中的角色,由孙阳饰演。他原...
02-21
21世纪经济报道记者 林昀肖 北京报道近日,人福医药发布《关于控股股东签署重整投资协议的公告》,招商创科将作为重整投资人参与其控股股东当...
01-21
21世纪经济报道记者 韩利明 上海报道日前,上海阳光医药采购网披露信息显示,根据国家医保局有关工作要求,2025年2月15日起,暂停杭州国光药业股...
02-18
  大众网记者 王一刚 报道  进入大班后,孩子们对探索自己身体秘密的情感越来越强烈。在一次手掌拓印活动中,孩子们对手上的指纹产生了浓厚的兴趣,在好奇心的推动下,孩子...
01-21
  近日,在第三届全球数字贸易博览会上发布了首批全国农村电商“领跑县”典型案例,曹县是山东省唯一上榜者。文化自信是新时代的突出优势,也是新时代文化的鲜明标识。正是...
01-21
  摘要  【绝对库存处于低位螺纹钢有望延续上涨】钢材价格自2021年见顶后回落,目前下跌周期...
01-27
  摘要  【玉米价暖量升,农民忙春耕】“立春节气过后,虽然按农历来算还没有出正月,大家还沉浸...
02-06
狮子座男人通常自信、强势和有领导力,但是如果你想吸引他的注意并征服他的心,以下几招可...
01-22
天秤男和金牛女是十分有吸引力的组合。他们之间的关系充满了浪漫和温馨,但同时也存在一...
01-22
探秘莆田珠宝产业园:璀璨背后的故事与机遇在中国东南沿海的莆田,有一个闪耀着珠宝光泽的地方,那就是莆田珠宝产业园。走进这个行业前景光明的园区,不仅能感受到璀璨的珠宝魅力,还...
02-07
ysl官网怎么退? ysl有中国官网吗?ysl官网怎么退?ysl官网你可以申请退款,然后联系下客服,就说想要退,他们会给你一个地址,然后你寄过去就可以了,他们会把钱通过原路返给你的。其实退...
02-17
2月4日消息,春节期间,“智性消费”成为年轻人消费显著特征,他们在享受假期的同时更要兼顾性价比,卡券消费在年轻人中走俏。在闲鱼平台上,春节期间卡券订单同比增长翻倍,主要涵盖美...
02-07
1月24日消息,国联股份冷链多多数字云仓(寮步仓)开仓仪式近日在东莞市寮步镇举办,标志着冷链多多禽蛋产业链仓网布局在华南地区再落一子。涂多多高级副总裁、物流部总监安珅,冷链...
02-07
需求降温,飞天茅台、红花郎红10等价格下跌春节前后,受需求...
02-21
3月6日消息,携程集团日前与拉斯海马旅游发展局(RAKTDA)在2025年柏林国际旅游展上签署了一份谅解备忘录(MOU),联合推出一系列新举措,包括加强数字化互动、深化文化故事讲述和提升营...
03-09
近年来,智能门锁已然成为智能家居领域的热门单品。然而,随着智能锁技术的快速迭代,老款产品逐渐难以满足人们日益增长的生活需求。众多用户虽有强烈的换新意愿,却在这一过程中遭...
01-21
2024年末,一位科技创业者火了。作者 | 王思琪来源 | 投资家(ID:touzijias)2024年末,一位科技创业者火了。2025年初,这位创业者再度爆火。近日,中国科技行业因一位85后年轻人现身《...
01-24
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮