大模型既要“吃得饱”更要“吃得好”

5个月前 来源:科技日报 观看:58

前段时间,网络上流传着一些由大模型生成的“异次元篇章”。比如,有人让大模型续写《红楼梦》情节时,竟得出一幕“贾宝玉倒拔垂杨柳”的奇景,令人啼笑皆非。之所以会出现这种“混搭”和“幻觉”,是因为大模型不仅学习了原著,还“广纳博采”了不少错误信息。aoP即热新闻——关注每天科技社会生活新变化gihot.com

这些人工智能(AI)生成的“胡言乱语”虽是网友们茶余饭后的笑谈,但提醒我们要清醒认识到其背后折射出的问题:数据质量是大模型应用成败的关键。以个性化推荐AI系统为例,一些企业在开发过程中,虽然收集了大量的用户行为数据,但数据中充斥着错误的标注、重复的数据以及相互矛盾的信息,数据的量增加了,但系统推荐的准确性并没有显著提升。《自然》杂志(Nature)刊登的一篇有关大模型可靠性研究的文章指出,一个西班牙研究团队发现,包括OpenAI公司的GPT在内的几个大模型升级后,虽然参数量更大了,误答情况却更严重了。因此,大模型长得壮不壮,不仅取决于“食量”(即数据的数量),更在于食物的“质量”(即数据的质量)——吃得饱并不等同于吃得好。aoP即热新闻——关注每天科技社会生活新变化gihot.com

数据是大模型的基石,在数据质量不高、可靠性缺失的情况下,一味追求大模型参数量的增加,不仅无法提升模型性能,反而会放大偏差和谬误,产生更多不可信数据。如此一来,势必造成计算与存储资源的浪费,增加开发和维护成本,降低用户信任度。更为严重的是,这种“大模型幻觉”和“灾难性遗忘”现象如果发生在精确性要求极高的工业生产领域中,还可能引发不可预测的风险和隐患。以油气勘探为例,基于大模型给出的错误预测进行开采可能导致数亿元的资金损失,并对自然环境造成不可逆转的破坏。aoP即热新闻——关注每天科技社会生活新变化gihot.com

提升大模型性能,关键是处理好数据“质”和“量”的关系,构建大规模、高质量的数据集。应建立完善的数据收集、清洗、验证和存储机制,加强对数据质量的监控和评估,确保数据的准确性、完整性和一致性。此外,还应注重跨领域合作,引入数据科学家、AI算法工程师等多方力量,开展大模型算法合作、制定数据共享和隐私安全保密协议,推动大模型产学研用生态建设。aoP即热新闻——关注每天科技社会生活新变化gihot.com

如今,大模型的发展已迈入多模态融合阶段。通过加强数据治理,优化人工智能学习、训练和验证的“基础食材”,端上大规模、高质量、多模态数据集的“丰盛大餐”,必将助力大模型能力的提升,让人工智能更好地赋能千行百业、造福人类社会。aoP即热新闻——关注每天科技社会生活新变化gihot.com

前段时间,网络上流传着一些由大模型生成的“异次元篇章”。比如,有人让大模型续写《红楼梦》情节时,竟得出一幕“贾宝玉倒拔垂杨柳”的奇景,令人啼笑皆非。之所以会出现这种“混搭”和“幻觉”,是因为大模型不仅学习了原著,还“广纳博采”了不少错误信息。aoP即热新闻——关注每天科技社会生活新变化gihot.com

这些人工智能(AI)生成的“胡言乱语”虽是网友们茶余饭后的笑谈,但提醒我们要清醒认识到其背后折射出的问题:数据质量是大模型应用成败的关键。以个性化推荐AI系统为例,一些企业在开发过程中,虽然收集了大量的用户行为数据,但数据中充斥着错误的标注、重复的数据以及相互矛盾的信息,数据的量增加了,但系统推荐的准确性并没有显著提升。《自然》杂志(Nature)刊登的一篇有关大模型可靠性研究的文章指出,一个西班牙研究团队发现,包括OpenAI公司的GPT在内的几个大模型升级后,虽然参数量更大了,误答情况却更严重了。因此,大模型长得壮不壮,不仅取决于“食量”(即数据的数量),更在于食物的“质量”(即数据的质量)——吃得饱并不等同于吃得好。aoP即热新闻——关注每天科技社会生活新变化gihot.com

数据是大模型的基石,在数据质量不高、可靠性缺失的情况下,一味追求大模型参数量的增加,不仅无法提升模型性能,反而会放大偏差和谬误,产生更多不可信数据。如此一来,势必造成计算与存储资源的浪费,增加开发和维护成本,降低用户信任度。更为严重的是,这种“大模型幻觉”和“灾难性遗忘”现象如果发生在精确性要求极高的工业生产领域中,还可能引发不可预测的风险和隐患。以油气勘探为例,基于大模型给出的错误预测进行开采可能导致数亿元的资金损失,并对自然环境造成不可逆转的破坏。aoP即热新闻——关注每天科技社会生活新变化gihot.com

提升大模型性能,关键是处理好数据“质”和“量”的关系,构建大规模、高质量的数据集。应建立完善的数据收集、清洗、验证和存储机制,加强对数据质量的监控和评估,确保数据的准确性、完整性和一致性。此外,还应注重跨领域合作,引入数据科学家、AI算法工程师等多方力量,开展大模型算法合作、制定数据共享和隐私安全保密协议,推动大模型产学研用生态建设。aoP即热新闻——关注每天科技社会生活新变化gihot.com

如今,大模型的发展已迈入多模态融合阶段。通过加强数据治理,优化人工智能学习、训练和验证的“基础食材”,端上大规模、高质量、多模态数据集的“丰盛大餐”,必将助力大模型能力的提升,让人工智能更好地赋能千行百业、造福人类社会。aoP即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-856-0.html大模型既要“吃得饱”更要“吃得好”

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:张成伟代表:把低空安全作为初心使命

下一篇:全国人大代表、万事利集团董事长屠红燕:连续三年呼吁AI应用,加快丝绸纺织业变革

为你推荐
  据国务院国资委8月6日消息,近日,国务院国资委、国家发展改革委印发《关于规范中央企业采购管...
01-21
1月20日,哈尔滨第九届亚冬会火种采集仪式在哈尔滨太阳岛广场上举行。千年巨石太阳石后,连绵的群山造型冰雕在阳光照耀下晶莹剔透,冰雪工匠们以精湛技...
01-21
①不少人聚会喜欢在冬日里围炉煮茶轻轻松松地聊聊天。周玉婷 摄②“上门代厨”满足了消费者在家聚餐解...
01-22
  本报记者朱金宜《人民日报海外版》(2025年01月15日第12版)  冬日里,四川贡嘎山“日照金山”...
01-21
在过去的一年,很多人都知道“胖东来”。这个原本扎根在河南许昌、新乡的超市,以细致的服务和严格的品控掳获众多好感,由此被誉为零售...
01-21
新华社北京1月21日电(记者张辛欣、张晓洁)工业和信息化部副部长张云明在21日国新办举行的“中国经济高质量发展成效”系列新闻发布会上表示,我国已有570多家工业企业入围全球研...
01-22
[本站 资讯] 本站新闻团队策划了《2025新车大爆料》系列内容,我们将为大家盘点各个车企的最新动向,重点展望2025年新车。目前已经上线10篇内容,覆盖新势力品牌和中国品...
01-21
1 月 24 日消息,奥迪(Audi)昨日(1 月 23 日)在 Facebook 上发布动态,展示了一款基于 Q6 Sportback e-tron 打造的越野概念车。这款概念车外观炫酷,配备了门式车桥和巨大的...
01-25
《难哄》电视剧改编自哪本小说?宋凯茵和谁在一起了?‌《难哄》电视剧改编自晋江作者竹已的同名小说《难哄》‌‌。该剧讲述了桑延(白敬亭饰)和温以凡(章若楠饰)这...
02-20
最近播出的电视剧《我亲自出庭为儿子辩护》迅速吸引了大量观众的关注,成为许多人心中的最爱。该剧讲述了刚考上研究生的张小涛因救人被诬陷为杀人犯的故事。...
02-21
  “到了儿童季节性疾病高发期,部分医院的就诊等候时间还是比较长;还有一些地方儿童疾病的诊断和治疗能力有待提升。”在1月20日国家卫生健康委举行的新闻发布会上,国...
01-21
  2024年10月,国家医保局出台护理类立项指南(试行)和优化调整护理价格政策通知,“免陪照护服务”成为新增项目,国内多家医院开始试点“无陪护病房”。随着“无陪护病房”...
02-07
1月17日,教育部党组在华北电力大学宣布了有关任免决定,汪庆华同志任华北电...
01-21
  大众网记者 杨涛报道  日前,第十七届山东省职业院校技能大赛高职组“健身指导”赛项结果出炉,青岛港湾职业技术学院代表队凭借出色的团队表现和创新的活动设计,获第6...
01-21
    1月19日,中国地质调查发布,自然资源部中国地质调查局在甘肃安坝里北、内蒙古哈达门沟和黑...
01-21
  2025年年初,中国钢铁行业面临产量与库存双双走低的局面,创下近八年来农历季节性最低水平。春...
02-11
在星座学中,每个星座都有其独特的性格特点和相处方式。而天蝎男作为十二星座中的一员,也...
01-22
天蝎男是一个充满神秘和矛盾的星座,他们在婚后对待妻子的态度也有着独特的方式。有人说...
01-22
2015年韩国瑜伽模特T台走秀:灵动与优雅的完美结合走在时尚潮流前沿的2015年,韩国瑜伽模特T台走秀无疑成为了一个引人瞩目的盛事。这场秀不是单纯的服装展示,更是一次将瑜伽与时...
02-12
姜黄哈伦裤怎么搭? 50岁女阔腿裤搭什么上衣哈伦裤?一、姜黄哈伦裤怎么搭?场景一:和姐妹出去耍姜黄色裤子+薄荷绿衬衫超级显白的薄荷绿,和春天的气息一样,清新自然。不管是拍照还是...
02-17
2月10日消息,携程商旅获得茶百道颁发的“2024年度优秀供应商”奖项。图源:公众号“携程商旅资讯号”据了解,作为国民级茶饮品牌,茶百道发源于“天府之国”,以“好茶为底,制造新鲜...
02-11
2月12日消息,据复旦消费大数据实验室数据,网上年货节期间(1月7日至2月5日)广州市网上零售总额达956.4亿元,相比去年同期增长4.58%。各大电商平台推出丰富多彩的活动优惠,实现销售...
02-13
据中国铁路公众号消息,2025年铁路春运1月14日开始,至2月22日结束,为期40天,全国铁路预计发送旅客5.1亿人次,日均发送1275万人次,节前客...
02-08
2月20日消息,美团日前宣布将为全职及稳定兼职骑手缴纳社保,预计2025年第二季度起实施。对此,美团核心本地商业CEO王莆中在公司内网发文称,“履行好社会责任,不必用竞争思维来思考...
02-20
岁月悠悠,转眼又是一年。回首2024,中国式现代化进程持续推进,高质量发展成为各行各业奋进的目标,时代巨变催促着各行各业加速转型。作为社会“稳定器”和经济“减震器”的保险业...
01-23
近日,华力创科学宣布完成数千万元A+轮融资,本轮融资由金属3D打印领域头部上市公司铂力特独家投资。据披露,本轮融资所募集的资金将专注于深挖高性能光学多模态感知技术,结合金属...
01-24
为纪念《消逝的光芒》问世十周年,开发商Techland宣布这款后启示录丧尸题材系列迎来重要里程碑:全平台累计玩家数突破4500万。该数据涵盖初代《消逝的光芒》与续...
01-31
今日(2月6日),VR挖掘机模拟游戏《DIG VR》Steam页面公布,预计于2025年3月20日发售,游戏支持简繁体中文,感兴趣的玩家可以点击此处进入商店页面。 游戏介绍: 《DIG ...
02-07
当地时间2月2日,美国华盛顿消防部门表示,已确定两机相撞事故中55名遇难者的身份。当地时间1月29日,一架美国国内支线客机在罗纳德·里根华盛顿国家机场同一架美军直升机在半空...
02-03
安徽省政协党组成员、副主席周喜安涉嫌严重违纪违法,目前正接受中央纪委国家监委纪律审查和监察调查。(总台央视记者 宋琎)...
02-06
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮