“换个角度”往往是颠覆性创新的起点

2个月前 来源:科技日报 观看:36

3月29日,2025中关村论坛年会——第十四届吴文俊人工智能科学技术奖颁奖典礼将科技进步奖特等奖授予京东科技信息技术有限公司、中国科学技术大学等共同完成的“多模态交互式数字人关键技术及产业应用”项目。中国工程院院士、清华大学信息学院院长戴琼海在颁奖典礼上评价,获奖团队通过产学研合作推动数字人技术应用,为数字经济的发展树立了标杆。2V1即热新闻——关注每天科技社会生活新变化gihot.com

“能打动评委的,或许不是形容数字人逼真度的一系列量化指标,而是真真切切呈现在他们面前的、让人一时真假难辨的数字人本身。”特等奖团队负责人、京东探索研究院院长何晓冬告诉科技日报记者,特等奖不是每年都有,要在一等奖的基础上再评审,只有得到绝大多数评委的认可才会被授予。2V1即热新闻——关注每天科技社会生活新变化gihot.com

3年前,普通人要拥有一个和自己长得像、说话像的数字人几乎是不可能的,寥寥几位名主持人的数字分身表现也有些僵硬。如今,只需一张照片或很短的视频,人人都能借助京东言犀拥有“以假乱真”的数字分身。2V1即热新闻——关注每天科技社会生活新变化gihot.com

换个角度攀登“珠峰”2V1即热新闻——关注每天科技社会生活新变化gihot.com

在虚拟世界“克隆”一个自己,这曾经被认为是行业的一座“珠峰”。2020年,英伟达创始人黄仁勋带着自己的数字分身召开发布会,不到一分钟的“再现”背后,是几百个摄像头采集数据、最新的显卡处理数据以及各类计算资源的支撑。2V1即热新闻——关注每天科技社会生活新变化gihot.com

“那时不到一分钟的数字分身‘仿真’可能需花费百万美元。”何晓冬解释,为了复刻得像,那时的技术逻辑是构建物理模型,把真实的三维世界的每个表面分割成大量很小的三角形,通过物理模型进行模拟,然后渲染面部表情,这样需要极大量的计算,且难以满足实时输出的要求。2V1即热新闻——关注每天科技社会生活新变化gihot.com

现实世界的逼真再现要处理的数据量太大了,这似乎是一个迈不过去的“大山”。2V1即热新闻——关注每天科技社会生活新变化gihot.com

研究团队没有选择“死磕”,而是逆向思维研究起信息的接收方——视网膜。2V1即热新闻——关注每天科技社会生活新变化gihot.com

“人体的视网膜是二维的,我们之所以能感知这个世界,是因为二维的信息在大脑中重构出了三维。”何晓冬说,与其先复现一个刻板的三维世界,被视网膜“降维”再由大脑重构,不如直接把“降维”后的影像给视网膜。这样既解决了重构的数据量,又没有影响大脑的感知。2V1即热新闻——关注每天科技社会生活新变化gihot.com

“换个角度解决问题”让团队找到了颠覆性创新的“更优解”。团队进一步打磨端到端(无需高颗粒度拆解)的再现技术,提升了二维的精度,做到让大脑“满意”。2V1即热新闻——关注每天科技社会生活新变化gihot.com

在动作的再现上,团队利用“常识”进一步压缩计算量。“过去每个动作都要采集,然后再重现,事实上,人类动作大多是常规的,很少有人像蜘蛛侠一样行动。”何晓冬说,通过预建模将“先验知识”告知给AI,AI在进行动作创造时就会有“依据”,共同的动作有选择,个别的动作再采集,降低了处理量,也让动作更符合常理。2V1即热新闻——关注每天科技社会生活新变化gihot.com

给多模态数据任命“领队”2V1即热新闻——关注每天科技社会生活新变化gihot.com

“我们瞄准的不是做一个‘展示品’,而是要落地直播应用。”何晓冬说,直播要和观众互动几个小时,就要解决人工智能幻觉,声音、手势、表情等协调的问题,而人对人是最敏感的,哪怕眼珠转动与声音、仪态出现一点偏差也会被视为异常。2V1即热新闻——关注每天科技社会生活新变化gihot.com

文生视频大模型Sora的产品是无声的,但想应用于直播就必须配上声音。一旦需要配音,虚拟人的声调、特有口音、是否与动作匹配等细节都可能露馅,这些使得多模态数据的联动成为必须解决的问题。2V1即热新闻——关注每天科技社会生活新变化gihot.com

如何才能让数字人知道说话的时候什么时候该亢奋,什么时候该温柔呢?2V1即热新闻——关注每天科技社会生活新变化gihot.com

“团队经过讨论决定用语音来驱动‘统领’表情、微动作等其他模态的信息。”何晓冬说,通过生成一个基础数字人,用视觉特征对其进行训练,让它学会什么时候该轻声细语、什么时候该声音激昂,声音跟它要播报的文字内容相匹配,然后再驱动多模态的协同配合,最终生成一个合乎常理的形象。2V1即热新闻——关注每天科技社会生活新变化gihot.com

由于需要长时间播报,团队还对人工智能的幻觉问题进行了专门攻关,将人工智能的幻觉率降低到可接受范围内,让它在相当长的时间里保持逼真的拟人度和情绪。2V1即热新闻——关注每天科技社会生活新变化gihot.com

在计算量降低、降本增效的基础上,京东言犀数字人实现了大规模商业化,已经服务9000多户商家、累计创造140亿元的经济价值,未来将在文旅、教育、政务等其他场景落地应用。2V1即热新闻——关注每天科技社会生活新变化gihot.com

“我们还将推出来‘千人千面’的数字人。”何晓冬说,现在大家一场直播中看的内容是一样的,未来每个人根据喜好可以定制不同的数字人服务,在文旅表演等方面都能落地。2V1即热新闻——关注每天科技社会生活新变化gihot.com

3月29日,2025中关村论坛年会——第十四届吴文俊人工智能科学技术奖颁奖典礼将科技进步奖特等奖授予京东科技信息技术有限公司、中国科学技术大学等共同完成的“多模态交互式数字人关键技术及产业应用”项目。中国工程院院士、清华大学信息学院院长戴琼海在颁奖典礼上评价,获奖团队通过产学研合作推动数字人技术应用,为数字经济的发展树立了标杆。2V1即热新闻——关注每天科技社会生活新变化gihot.com

“能打动评委的,或许不是形容数字人逼真度的一系列量化指标,而是真真切切呈现在他们面前的、让人一时真假难辨的数字人本身。”特等奖团队负责人、京东探索研究院院长何晓冬告诉科技日报记者,特等奖不是每年都有,要在一等奖的基础上再评审,只有得到绝大多数评委的认可才会被授予。2V1即热新闻——关注每天科技社会生活新变化gihot.com

3年前,普通人要拥有一个和自己长得像、说话像的数字人几乎是不可能的,寥寥几位名主持人的数字分身表现也有些僵硬。如今,只需一张照片或很短的视频,人人都能借助京东言犀拥有“以假乱真”的数字分身。2V1即热新闻——关注每天科技社会生活新变化gihot.com

换个角度攀登“珠峰”2V1即热新闻——关注每天科技社会生活新变化gihot.com

在虚拟世界“克隆”一个自己,这曾经被认为是行业的一座“珠峰”。2020年,英伟达创始人黄仁勋带着自己的数字分身召开发布会,不到一分钟的“再现”背后,是几百个摄像头采集数据、最新的显卡处理数据以及各类计算资源的支撑。2V1即热新闻——关注每天科技社会生活新变化gihot.com

“那时不到一分钟的数字分身‘仿真’可能需花费百万美元。”何晓冬解释,为了复刻得像,那时的技术逻辑是构建物理模型,把真实的三维世界的每个表面分割成大量很小的三角形,通过物理模型进行模拟,然后渲染面部表情,这样需要极大量的计算,且难以满足实时输出的要求。2V1即热新闻——关注每天科技社会生活新变化gihot.com

现实世界的逼真再现要处理的数据量太大了,这似乎是一个迈不过去的“大山”。2V1即热新闻——关注每天科技社会生活新变化gihot.com

研究团队没有选择“死磕”,而是逆向思维研究起信息的接收方——视网膜。2V1即热新闻——关注每天科技社会生活新变化gihot.com

“人体的视网膜是二维的,我们之所以能感知这个世界,是因为二维的信息在大脑中重构出了三维。”何晓冬说,与其先复现一个刻板的三维世界,被视网膜“降维”再由大脑重构,不如直接把“降维”后的影像给视网膜。这样既解决了重构的数据量,又没有影响大脑的感知。2V1即热新闻——关注每天科技社会生活新变化gihot.com

“换个角度解决问题”让团队找到了颠覆性创新的“更优解”。团队进一步打磨端到端(无需高颗粒度拆解)的再现技术,提升了二维的精度,做到让大脑“满意”。2V1即热新闻——关注每天科技社会生活新变化gihot.com

在动作的再现上,团队利用“常识”进一步压缩计算量。“过去每个动作都要采集,然后再重现,事实上,人类动作大多是常规的,很少有人像蜘蛛侠一样行动。”何晓冬说,通过预建模将“先验知识”告知给AI,AI在进行动作创造时就会有“依据”,共同的动作有选择,个别的动作再采集,降低了处理量,也让动作更符合常理。2V1即热新闻——关注每天科技社会生活新变化gihot.com

给多模态数据任命“领队”2V1即热新闻——关注每天科技社会生活新变化gihot.com

“我们瞄准的不是做一个‘展示品’,而是要落地直播应用。”何晓冬说,直播要和观众互动几个小时,就要解决人工智能幻觉,声音、手势、表情等协调的问题,而人对人是最敏感的,哪怕眼珠转动与声音、仪态出现一点偏差也会被视为异常。2V1即热新闻——关注每天科技社会生活新变化gihot.com

文生视频大模型Sora的产品是无声的,但想应用于直播就必须配上声音。一旦需要配音,虚拟人的声调、特有口音、是否与动作匹配等细节都可能露馅,这些使得多模态数据的联动成为必须解决的问题。2V1即热新闻——关注每天科技社会生活新变化gihot.com

如何才能让数字人知道说话的时候什么时候该亢奋,什么时候该温柔呢?2V1即热新闻——关注每天科技社会生活新变化gihot.com

“团队经过讨论决定用语音来驱动‘统领’表情、微动作等其他模态的信息。”何晓冬说,通过生成一个基础数字人,用视觉特征对其进行训练,让它学会什么时候该轻声细语、什么时候该声音激昂,声音跟它要播报的文字内容相匹配,然后再驱动多模态的协同配合,最终生成一个合乎常理的形象。2V1即热新闻——关注每天科技社会生活新变化gihot.com

由于需要长时间播报,团队还对人工智能的幻觉问题进行了专门攻关,将人工智能的幻觉率降低到可接受范围内,让它在相当长的时间里保持逼真的拟人度和情绪。2V1即热新闻——关注每天科技社会生活新变化gihot.com

在计算量降低、降本增效的基础上,京东言犀数字人实现了大规模商业化,已经服务9000多户商家、累计创造140亿元的经济价值,未来将在文旅、教育、政务等其他场景落地应用。2V1即热新闻——关注每天科技社会生活新变化gihot.com

“我们还将推出来‘千人千面’的数字人。”何晓冬说,现在大家一场直播中看的内容是一样的,未来每个人根据喜好可以定制不同的数字人服务,在文旅表演等方面都能落地。2V1即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-1532-0.html“换个角度”往往是颠覆性创新的起点

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:新DNA显微镜“从内到外”绘制生命3D图

下一篇:感受生命科学“最”新成果的震撼

为你推荐
  科技日报记者 刘霞  据物理学家组织网16日报道,德国基尔大学科学家研制出一款新型人工智能...
01-21
“任何一条聚变路线都面临挑战,但商业化首先要考虑燃料‘卡脖子’问题。”日前,在位于河北省廊坊市的新奥聚变技术研发中心,新奥能源研究院...
01-24
  1月26日18时至27日7时,我市普降大雪,局地暴雪,全市平均降雪量8.2毫米,四个国家站降雪量:营口市9.6毫米(...
01-28
  中新经纬1月20日电 智联招聘20日发布《2024年职场人满意度指数调研报告》(下称报告)。其中提到,商业服务(咨询/财会/法律/广告/公关/认证/外包)、文化/传媒/娱乐/体育行...
01-21
  上海外国游客消费额激增,“韩流”何以转为“韩金量”  作者:缪琦  1月中旬,也即刚刚过去的周五夜间5点左右,位于上海南京路步行街的“很久以前”羊肉串店内已经坐满了头...
01-21
[本站 资讯] 本站新闻团队策划了《2025新车大爆料》系列内容,我们将为大家盘点各个车企的最新动向,重点展望2025年新车。目前已经上线10篇内容,覆盖新势力品牌和中国品...
01-21
1 月 24 日消息,据“特斯拉”官方新闻稿,特斯拉宣布旗下首批V4超级充电站将于国内落地,相应充电站也将支持第三方汽车充电。▲ 特斯拉 V4 充电桩V4 超级充电桩号称特斯...
01-25
《余烬之上》近期热度飙升,成为众多观众热议的话题,在各大手机软件上都能看到相关资讯。第18集的剧情尤其引人关注。逊哥的车被撞翻后,从货车上走下两人,黑衣人...
02-19
随着电视剧《狂医魔徒》的热播,该剧逐渐吸引了广大粉丝的关注。一经播出,就以精彩的剧情、精良的制作和精心的演绎赢得了观众的一致好评,并且拿下了收视第一的...
02-22
1月22日,国家卫健委、国家中医药局联合发布《流行性感冒诊疗方案(2025年版)》,新增玛巴洛沙韦、法维拉韦两种抗流感病毒药物,并明确不建议联合...
01-23
21世纪经济报道记者季媛媛 上海报道 新一代药王“K药”刚刚宣布拿下294.82亿美元销售额后,“网红”司美格鲁肽随即高调宣称,2024年销售额为2...
02-06
在清华大学的倾情帮扶下,青海大学于2007年5月成立了计算机技术与应用系(现为...
01-21
    李德仁武汉大学供图  “5、4、3、2、1,点火!”随着赤橘色烈焰瞬间迸出,快舟十一号运载火...
01-21
  财中社1月20日电国信证券发布农林牧渔行业农产品研究跟踪系列报告。文中指出看好猪价2025年...
01-21
  阿里资产拍卖网络平台显示,1月11日,安邦集团持有的天津信托1.36%股权流拍。  二拍将于1月22...
01-22
天秤座的男生一向以温和、善良而受人喜爱。他们对待感情也是如此,总是慎重而细腻。然而...
01-22
天秤男是十二星座中最温和、善良的一位。他们注重平衡和和谐,追求公正和公平。然而,当天...
01-22
休闲男装搭配? 男装休闲搭配?休闲男装搭配?01.条纹衬衫+牛仔裤这一身穿搭单品款式上组合看起来不仅休闲感满满,而且还透露出非常清爽的感觉,经典怀旧的牛仔休闲裤,跟上衣浅粉条纹...
02-07
探索艾琳潮流服饰:时尚风格与个性表达的完美结合在如今这个人人追求个性和时尚的时代,艾琳潮流服饰无疑成为了许多年轻人心目中的时尚标杆。我早已深陷于这个品牌所展现的独特...
02-17
1月27日消息,云汉芯城凭借卓越的线上分销能力和创新的数字化服务,获得WAGO万可颁发的“2024最佳线上分销渠道奖”。图源:云汉芯城公众号据介绍,WAGO万可于1951年成立于德国,是一...
02-07
2月20日消息,天猫商家开年再迎利好,今日,天猫面向新入驻商家的扶持政策“蓝星计划2025”全面升级,加码“商家培育”及“经营激励”政策,帮助新商家快速落地淘宝天猫,打造爆款,实现...
02-21
听花酒又支棱起来了?近日,多名网友发帖称,看到听花酒投放的电视广告——广告画面简洁,宣传语为“听花酒,装在瓶子里的春天”,并附上咨询...
03-01
2月27日消息,“渝新同行·渝路美好”中共重庆市委社会工作部与美团合作启动活动日前举行,会上发布三个项目,包括新就业群体社会工作服务项目、“袋鼠宝贝之家”项目、美团乡村...
03-01
自去年底开始,黄金多头优势逐渐退却,国际现货黄金价格经历几次大跌后一度跌下2700关口,多空进入漫长的震荡周期,多头始终无法找到再度冲高的时机。  北京时间1月21日,国际现货...
01-24
【#浙创浙江自贸区股权投资基金登记成立# 出资额10亿】天眼查App显示,近日,浙创(浙江自贸区)股权投资基金合伙企业(有限合伙)成立,执行事务合伙人为北京浙商华盈创业投资管理有限公...
02-09
在《绝地潜兵》初代中,玩家实际上可以前往母星超级地球,进行保卫战。根据最新的泄露看来,《绝地潜兵2》的保卫站也已在制作当中,并且这场入侵我们将无法阻止。 数...
01-25
开发商 id Software 于 5 年前推出了《毁灭战士:永恒》,并即将推出《毁灭战士:黑暗纪元》。即便这是公司推出的新《毁灭战士》系列的前传,但显然它将比开发商之前...
01-28
极目新闻评论员 吴双建“我的车定速巡航功能失效了,刹车也踩不动,怎么办?”2月1日凌晨5时11分,湖北省公安厅高警总队六支队指挥中心民警石路接到群众报警求助。经过紧张的一个多...
02-04
极目新闻记者 丁鹏2月3日晚,山西大同古城一店铺因未按当地要求打开灯,多名工作人员撬锁进店将灯打开,此事引发热议。2月5日,大同市平城区古城街道办事处回应极目新闻记者,正在核...
02-05
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮