灵初智能发布端到端VLA模型PsiR0.5,仅需两小时数据实现物品、场景全面泛化

1年前 来源:华夏晚报 观看:168

近日,Figure 发布的端到端 VLA 具身大模型  Helix,采用分层架构同时实现高频控制和高泛化能力,引起了业内广泛关注。几乎同期,中国具身智能团队灵初智能发布了基于强化学习的增强版分层架构端到端 VLA  模型 Psi R0.5,这距离灵初智能团队去年底发布的 Psi R0 仅 2 个月NRd即热新闻——关注每天科技社会生活新变化gihot.com

  本次发布的新模型重大升级,对于复杂场景的泛化性灵巧性CoT长程任务能力上均有显著提升,同时完成泛化抓取训练所需的数据量仅需  Helix 数据量的 0.4%!在全球范围内实现了泛化灵巧操作与训练效率的双重领先。NRd即热新闻——关注每天科技社会生活新变化gihot.com

  此外,灵初智能团队连发四篇高质量论文,将团队在高效实现泛化抓取堆叠场景的物品检索利用外部环境配合抓取VLA  安全对齐方面的最新成果悉数公开,展现了中国团队在具身智能领域的强悍战斗力。NRd即热新闻——关注每天科技社会生活新变化gihot.com

1.pngNRd即热新闻——关注每天科技社会生活新变化gihot.com

Psi R0.5 路径演进图NRd即热新闻——关注每天科技社会生活新变化gihot.com

DexGraspVLA仅需两小时灵巧手抓取数据NRd即热新闻——关注每天科技社会生活新变化gihot.com

轻松实现物品、灯光、场景泛化并实现真正  CoTNRd即热新闻——关注每天科技社会生活新变化gihot.com

  DexGraspVLA 是首个用于灵巧手通用抓取的  VLA(Vision-Language-Action)框架,通过少量的训练,即刻在多变环境下智能涌现灵巧操作能力,能够像人类一样快速、准确地拾取各种物品。NRd即热新闻——关注每天科技社会生活新变化gihot.com

  DexGraspVLA 是一个融合视觉,语言和动作的层次化框架:NRd即热新闻——关注每天科技社会生活新变化gihot.com

  · High-level  Planner:高层规划由预训练的大型视觉语言模型(VLM)实现,可理解多样化指令、自主决定抓取策略NRd即热新闻——关注每天科技社会生活新变化gihot.com

  · Low-level  Controller:低层扩散策略通过实时视觉反馈闭环掌握目标物体智能涌现出灵巧操作能力NRd即热新闻——关注每天科技社会生活新变化gihot.com

  整个框架的核心在于将多样化的图像输入数据通过现有的 Foundation Model 转换成 Domain-invariance  的表征,并端到端地训练下层控制模型。NRd即热新闻——关注每天科技社会生活新变化gihot.com

2.pngNRd即热新闻——关注每天科技社会生活新变化gihot.com

DexGraspVLA 框架图NRd即热新闻——关注每天科技社会生活新变化gihot.com

  从实验结果看,灵初智能仅使用了约 2 小时的灵巧手抓取数据(2094 条轨迹 × 3.5 秒 / 条 ÷ 60 秒  / 分钟 ÷ 60 分钟 / 小时 ≈ 2 小时),泛化到上千种不同物体,位置,堆叠,灯光,背景下成功抓取,而这个数据量仅仅是 Figure 的  0.4%数据利用效率提高 250 倍NRd即热新闻——关注每天科技社会生活新变化gihot.com

  同时,DexGraspVLA 相比现有方案还具有几项优势:NRd即热新闻——关注每天科技社会生活新变化gihot.com

  · 根据语言指令分辨出目标物体,处理堆叠场景下的目标物体的检索并抓取NRd即热新闻——关注每天科技社会生活新变化gihot.com

  · 抓取速度快(所有视频无加速,同类工作中节拍较快),闭环姿态矫正与重抓取能力(ReGrasp)NRd即热新闻——关注每天科技社会生活新变化gihot.com

  · 大脑具有 CoT 长程推理能力自主推理抓取顺序并将所有物体依次抓取NRd即热新闻——关注每天科技社会生活新变化gihot.com

  DexGraspVLA  展现出对光照变化背景干扰和物体姿态的强大鲁棒性和泛化性,让机器人的灵巧抓取达到人类级别。NRd即热新闻——关注每天科技社会生活新变化gihot.com

  基于预训练的大模型:使用自然语言与人类交互,具有高智能的长程推理能力,能够自主理解人类话语并推理任务。因此可以一次设定多个抓取目标,通过 CoT  实现复杂流程下的自动分拣或清理。NRd即热新闻——关注每天科技社会生活新变化gihot.com

  DexGraspVLA  仍然会自动分析当前姿态偏差,通过细微调整腕关节和手部角度重新尝试抓取实现非常鲁棒且高效的抓取能力达到极强的泛化能力NRd即热新闻——关注每天科技社会生活新变化gihot.com

3.pngNRd即热新闻——关注每天科技社会生活新变化gihot.com

Retrieval DexterityNRd即热新闻——关注每天科技社会生活新变化gihot.com

堆叠场景中的高效物体检索策略NRd即热新闻——关注每天科技社会生活新变化gihot.com

  强化学习底层驱动,简单 reward 涌现复杂动作NRd即热新闻——关注每天科技社会生活新变化gihot.com

  在大多数实际场景中,物品往往以无规则、堆叠的方式摆放。传统方法要求机器人逐件搬开遮挡物,不仅耗时,还对机器人自身抓取能力提出了很高的要求。NRd即热新闻——关注每天科技社会生活新变化gihot.com

  为了解决这一难题,灵初智能开发了一套基于强化学习的物体检索策略 ——Retrieval  Dexterity,解决了堆叠场景中物体检索识别效率低的问题。NRd即热新闻——关注每天科技社会生活新变化gihot.com

  Retrieval Dexterity  系统中未用真机数据,灵初团队没有采用真机数据进行训练而是直接在仿真环境中通过强化学习进行训练。通过在仿真环境中大规模生成复杂的堆叠场景,训练模型直至涌现出合适的检索操作,随后再将这些操作零样本迁移至现实机器人和复杂环境中。NRd即热新闻——关注每天科技社会生活新变化gihot.com

4.pngNRd即热新闻——关注每天科技社会生活新变化gihot.com

Retrieval Dexterity 框架图NRd即热新闻——关注每天科技社会生活新变化gihot.com

  从杂乱堆叠物体中快速取出目标物体NRd即热新闻——关注每天科技社会生活新变化gihot.com

  在超过 10 种不同形状、大小的生活物品测试中,Retrieval Dexterity  展现出了优秀的性能,不仅能够高效完成训练过的物体的检索任务还能将检索能力泛化到未见过的新物体上NRd即热新闻——关注每天科技社会生活新变化gihot.com

  效率对比传统方法提升明显NRd即热新闻——关注每天科技社会生活新变化gihot.com

  与人为设定的动作相比,Retrieval Dexterity 在所有场景中平均减少了 38%  的操作步骤与模拟的 “将所有物体抓起来并放开” 相比,该方法更是平均减少了 90%  的步骤数量。这种效率提升主要得益于多指灵巧手能够直接与遮挡物进行交互,并随时移动它们,而不需要逐个移除。NRd即热新闻——关注每天科技社会生活新变化gihot.com

5.pngNRd即热新闻——关注每天科技社会生活新变化gihot.com

ExDex:借力外部环境NRd即热新闻——关注每天科技社会生活新变化gihot.com

抓取 “不可能” 物体NRd即热新闻——关注每天科技社会生活新变化gihot.com

  外部灵巧性解决物品超过机器人末端执行器的最大开度问题NRd即热新闻——关注每天科技社会生活新变化gihot.com

  当物体的底面尺寸超过机器人末端执行器的最大开度时,传统方法往往无法直接对物体进行抓取,这种情况在商场等商业场景尤为常见。为了解决这一难题,灵初智能推出了  ExDex—— 一种基于外部灵巧性(extrinsic dexterity)抓取的创新解决方案NRd即热新闻——关注每天科技社会生活新变化gihot.com

  ExDex 能够利用环境特征进行非夹持式操作,凭借多指灵巧手的灵活性和操作能力,实现更丰富的环境交互。NRd即热新闻——关注每天科技社会生活新变化gihot.com

  强化学习带来超越人类遥操作水平的灵巧操作NRd即热新闻——关注每天科技社会生活新变化gihot.com

  通过强化学习,ExDex  涌现出自主制定策略的能力,借助周围环境抓取那些无法直接抓取的物体。例如,机器人可以将物体先推到桌面边缘或墙体边缘,再利用这些环境特征完成抓取任务。这种操作通过传统的遥操作方式几乎无法实现,充分体现了强化学习的强大优势。NRd即热新闻——关注每天科技社会生活新变化gihot.com

  在对数十种不同家居物品的大量实验中,ExDex  验证了其优越的性能和对新物体的泛化能力并成功将仿真训练的策略无缝迁移到真实机器人中,实现了从仿真到现实的高效过渡。NRd即热新闻——关注每天科技社会生活新变化gihot.com

SafeVLA:人机安全交互的 “守护神”NRd即热新闻——关注每天科技社会生活新变化gihot.com

  当下,具身智能机器人频繁出圈,从春晚跳舞的 Unitree  人形机器人,到波兰街头遛机器狗的新奇场景,让人看到人机交互的无限可能,但安全问题也不容忽视。视觉 - 语言 -  行动模型(VLAs)在革新机器人技术时,也藏着安全隐患。NRd即热新闻——关注每天科技社会生活新变化gihot.com

6.pngNRd即热新闻——关注每天科技社会生活新变化gihot.com

 左图呈现了传统 VLA 模型在抓取任务中的三种典型不安全行为:1)对无关物体的严重损坏,2)目标识别错误导致危险物体的误用,以及  3)执行指令时与危险物体发生交互。右图通过导航路径示例,进一步展示了传统 VLA 在导航过程中的三种不安全行为NRd即热新闻——关注每天科技社会生活新变化gihot.com

  本周,北京大学 PAIR - Lab 团队携手灵初智能重磅推出了具身安全模型  SafeVLA,通过安全对齐,让机器人在复杂场景安全高效执行任务,在对抗干扰场景中鲁棒性极高NRd即热新闻——关注每天科技社会生活新变化gihot.com

  SafeVLA 把 “以人为本” 刻进  DNA,不像传统机器人只盯着任务完成它把人类安全放在首位。技术上,引入约束马尔可夫决策过程(CMDP)范式,把现实安全约束融入仿真环境大规模采样。SafeVLA  在安全性和任务执行方面均取得突破性进展分别提升 83.58% 和  3.85%充分证明了其在平衡安全与效率方面的卓越能力NRd即热新闻——关注每天科技社会生活新变化gihot.com

11.gifNRd即热新闻——关注每天科技社会生活新变化gihot.com

传统 VLA 模型完成任务过程中的高危行为NRd即热新闻——关注每天科技社会生活新变化gihot.com

  团队开发全新仿真环境 Safety -  CHORES集成安全约束功能支持用户自定义规则代码还完全开源直接给全球研究者和开发者送福利。而且,SafeVLA  在 12 个分布外(OOD)实验里,面对光照、材质变化和复杂环境扰动,始终稳定发挥,实力碾压其他模型。NRd即热新闻——关注每天科技社会生活新变化gihot.com

22.gifNRd即热新闻——关注每天科技社会生活新变化gihot.com

SafeVLA 在正常测试集和 OOD 测试集上的比较,其在 OOD 环境下依然保持良好安全性和表现NRd即热新闻——关注每天科技社会生活新变化gihot.com


NRd即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-14-7388-0.html灵初智能发布端到端VLA模型PsiR0.5,仅需两小时数据实现物品、场景全面泛化

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:企业智能化升级关键:DeepSeek大模型技术与应用论坛来了!

下一篇:赛力斯申请注册问界智享商标

为你推荐
期待多时的RTX 5090/5080已经正式开卖,而国行对应的则是RTX 5090D。 作为国内特供版,RTX 5090D在硬件上与RTX 5090相似,拥有相同的核心数量和显存配置,甚至PCB设计...
02-03
近日,PlayStation Network(PSN)遭遇严重宕机,至今已超过24小时未恢复正常服务,导致全球玩家无法访问在线内容,甚至连单人数字游戏也受到影响。这一事件迅速在社交媒...
02-10
距离除夕只剩几天,“回家”成为大街小巷最热门的话题。窗前的红灯笼、热闹的年货市场、街头巷尾的新春歌曲……处处洋溢着喜庆的氛围。“我恭喜你发财,我恭喜你精彩,最好的请过...
02-02
新华社北京2月9日电 日前,中央层面整治形式主义为基层减负专项工作机制办公室会同中央纪委办公厅对3起整治形式主义为基层减负典型问题进行通报。具体如下:1.中国就业培训技术...
02-09
1月20日有消息称,据荣耀内部公告,荣耀中国区CMO姜海荣将辞去相关职务。据悉,姜海荣曾在华为与荣耀工作超过20年,历任研发、市场等工作...
01-21
“国补减去500元,再加上旧手机以旧换新约抵扣600元,最后售价在4000元左右……”在广州某品牌手机销售门店内,店员正在帮消费者计算购...
01-24
  26日起,辽宁多地出现强降雪天气,多部门连夜开始除雪作业。...
01-28
  今天(2月6日),蛇年首场寒潮上线,将自北向南给中东部地区带来大风降温天气,西北地区东部、华北和...
02-06
新华社北京1月21日电(记者张辛欣、张晓洁)工业和信息化部副部长张云明在21日国新办举行的“中国经济高质量发展成效”系列新闻发布会上表示,我国已有570多家工业企业入围全球研...
01-22
  当地时间1月21日夜间,土耳其内政部长阿里·耶尔利卡表示,土耳其滑雪度假酒店火灾死亡人数升至76人,目前救援行动已经结束。起火原因仍在调查之中,检方已拘留包括酒店业主...
01-22
[本站 资讯] 日前,小米YU7实车图再度曝光,这组实车图展示给我们新车的更多细节,新车定位为中大型SUV,售价预计会在30-40万之间,并将在2025年6月-7月份正式上市。此次最新...
01-24
1 月 23 日消息,雷丁汽车宣布旗下 2025 款雷丁芒果 Pro 微型车现已经上市,仅提供“220 基础版(实际续航 201 公里)”,指导价为 5.39 万元。该车整体小巧,造型方正,前脸配备...
01-24
《180天重启计划》播出后受到了观众的喜爱和追捧。剧中第5集的剧情引起了广泛讨论,以下是该集的主要内容。吴俪梅叫醒顾云苏,让她好好打扮去见一个重要的人。...
02-21
《难哄》是双男女主吗小说?难哄小说女主描述的是什么?《难哄》不是双女主小说,而是一部以温以凡和桑延为主角的现代言情小说。单女主设定:女主温以凡因家庭变故...
02-21
1月22日,国家卫健委、国家中医药局联合发布《流行性感冒诊疗方案(2025年版)》,新增玛巴洛沙韦、法维拉韦两种抗流感病毒药物,并明确不建议联合...
01-23
  回望现代医学的发展,我们不得不承认有一些“疾病”是和时代捆绑在一起的,但也有一些,似乎像是...
02-08
1月17日下午2点,东北大学2024创业项目座谈交流会暨第十九批(2025年)创业类项目实施培训会在东北大学南湖校...
01-21
沈阳农业大学认真学习贯彻习近平总书记关于教育的重要论述、给全国涉农高校的书记校长和专家代表重要回...
01-21
  四川省首家省级法人城市商业银行,开年换帅。据“四川妇女儿童中心”公众号消息,省妇联与四川...
01-22
  中国网财经1月21日讯 2024年12月权益市场震荡上行,资产管理标品信托市场的产品发行数量环比...
01-23
金牛座男生通常对于女生有着独特的偏好和要求。他们喜欢一种特定类型的女生,下面将介绍...
01-22
狮子座的男生通常都有着强烈的个人魅力和自信心,他们喜欢成为众人关注的焦点。当狮子男...
01-22
粉色领带搭配什么颜色衬衫?斜纹蓝色一、西装、衬衫、领带巧搭配 ①黑色西服,穿以白色为主的衬衫和浅色衬衫,配灰、蓝、绿等与衬衫色彩协调的领带。 ②灰西服,可配灰、绿、黄和...
02-07
女式黑色衬衫怎么搭配?一、女式黑色衬衫怎么搭配?1,搭一件米色,或者白色的外衣。把黑色的领子折出来,这样看起来就不单调,如果单是一身黑的话,就显得很单调了。2,或者找很帅气的皮带...
02-17
2月10日消息,据京东七鲜发布的数据显示,今年春节期间,京东七鲜在春节期间的订单量同比上涨接近100%。即时零售平台在春节期间成为众多消费者的热门选择,极大地促进了年货市场的...
02-11
阿里电商要增长,扶持商家是第一优先级。据晚点LatePost消息,2月2日(大年初五),阿里电商事业群CEO蒋凡召开小范围高管会,明确了2025年淘宝天猫的第一件大事是通过扶持优质品牌和商...
02-20
2025年春节,在北京工作的95后女孩小苗没有回老家。大年初一这天晚上,她和母亲一起在云南大理古城参加篝火晚会,手牵手围着“科技篝火...
02-07
2月18日消息,从众信旅游集团了解到,节后错峰游市场展现新活力。由于2025年春节假期较早,因此春节过后至3月中旬形成了小的价格低谷。从众信旅游呼叫中心数据显示,近期错峰游咨询...
02-19
近日,华力创科学宣布完成数千万元A+轮融资,本轮融资由金属3D打印领域头部上市公司铂力特独家投资。据披露,本轮融资所募集的资金将专注于深挖高性能光学多模态感知技术,结合金属...
01-24
当钟表的指针指向晚上8点,全世界的目光都聚焦在了中国的电视屏幕上,共同期待着一年一度的春晚盛宴。而今年的春晚,更因恰逢首个非遗新年而显得格外特别。一、春晚“清新奇迹”:...
02-09
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮