大模型既要“吃得饱”更要“吃得好”

2周前 来源:科技日报 观看:8

前段时间,网络上流传着一些由大模型生成的“异次元篇章”。比如,有人让大模型续写《红楼梦》情节时,竟得出一幕“贾宝玉倒拔垂杨柳”的奇景,令人啼笑皆非。之所以会出现这种“混搭”和“幻觉”,是因为大模型不仅学习了原著,还“广纳博采”了不少错误信息。sOF即热新闻——关注每天科技社会生活新变化gihot.com

这些人工智能(AI)生成的“胡言乱语”虽是网友们茶余饭后的笑谈,但提醒我们要清醒认识到其背后折射出的问题:数据质量是大模型应用成败的关键。以个性化推荐AI系统为例,一些企业在开发过程中,虽然收集了大量的用户行为数据,但数据中充斥着错误的标注、重复的数据以及相互矛盾的信息,数据的量增加了,但系统推荐的准确性并没有显著提升。《自然》杂志(Nature)刊登的一篇有关大模型可靠性研究的文章指出,一个西班牙研究团队发现,包括OpenAI公司的GPT在内的几个大模型升级后,虽然参数量更大了,误答情况却更严重了。因此,大模型长得壮不壮,不仅取决于“食量”(即数据的数量),更在于食物的“质量”(即数据的质量)——吃得饱并不等同于吃得好。sOF即热新闻——关注每天科技社会生活新变化gihot.com

数据是大模型的基石,在数据质量不高、可靠性缺失的情况下,一味追求大模型参数量的增加,不仅无法提升模型性能,反而会放大偏差和谬误,产生更多不可信数据。如此一来,势必造成计算与存储资源的浪费,增加开发和维护成本,降低用户信任度。更为严重的是,这种“大模型幻觉”和“灾难性遗忘”现象如果发生在精确性要求极高的工业生产领域中,还可能引发不可预测的风险和隐患。以油气勘探为例,基于大模型给出的错误预测进行开采可能导致数亿元的资金损失,并对自然环境造成不可逆转的破坏。sOF即热新闻——关注每天科技社会生活新变化gihot.com

提升大模型性能,关键是处理好数据“质”和“量”的关系,构建大规模、高质量的数据集。应建立完善的数据收集、清洗、验证和存储机制,加强对数据质量的监控和评估,确保数据的准确性、完整性和一致性。此外,还应注重跨领域合作,引入数据科学家、AI算法工程师等多方力量,开展大模型算法合作、制定数据共享和隐私安全保密协议,推动大模型产学研用生态建设。sOF即热新闻——关注每天科技社会生活新变化gihot.com

如今,大模型的发展已迈入多模态融合阶段。通过加强数据治理,优化人工智能学习、训练和验证的“基础食材”,端上大规模、高质量、多模态数据集的“丰盛大餐”,必将助力大模型能力的提升,让人工智能更好地赋能千行百业、造福人类社会。sOF即热新闻——关注每天科技社会生活新变化gihot.com

前段时间,网络上流传着一些由大模型生成的“异次元篇章”。比如,有人让大模型续写《红楼梦》情节时,竟得出一幕“贾宝玉倒拔垂杨柳”的奇景,令人啼笑皆非。之所以会出现这种“混搭”和“幻觉”,是因为大模型不仅学习了原著,还“广纳博采”了不少错误信息。sOF即热新闻——关注每天科技社会生活新变化gihot.com

这些人工智能(AI)生成的“胡言乱语”虽是网友们茶余饭后的笑谈,但提醒我们要清醒认识到其背后折射出的问题:数据质量是大模型应用成败的关键。以个性化推荐AI系统为例,一些企业在开发过程中,虽然收集了大量的用户行为数据,但数据中充斥着错误的标注、重复的数据以及相互矛盾的信息,数据的量增加了,但系统推荐的准确性并没有显著提升。《自然》杂志(Nature)刊登的一篇有关大模型可靠性研究的文章指出,一个西班牙研究团队发现,包括OpenAI公司的GPT在内的几个大模型升级后,虽然参数量更大了,误答情况却更严重了。因此,大模型长得壮不壮,不仅取决于“食量”(即数据的数量),更在于食物的“质量”(即数据的质量)——吃得饱并不等同于吃得好。sOF即热新闻——关注每天科技社会生活新变化gihot.com

数据是大模型的基石,在数据质量不高、可靠性缺失的情况下,一味追求大模型参数量的增加,不仅无法提升模型性能,反而会放大偏差和谬误,产生更多不可信数据。如此一来,势必造成计算与存储资源的浪费,增加开发和维护成本,降低用户信任度。更为严重的是,这种“大模型幻觉”和“灾难性遗忘”现象如果发生在精确性要求极高的工业生产领域中,还可能引发不可预测的风险和隐患。以油气勘探为例,基于大模型给出的错误预测进行开采可能导致数亿元的资金损失,并对自然环境造成不可逆转的破坏。sOF即热新闻——关注每天科技社会生活新变化gihot.com

提升大模型性能,关键是处理好数据“质”和“量”的关系,构建大规模、高质量的数据集。应建立完善的数据收集、清洗、验证和存储机制,加强对数据质量的监控和评估,确保数据的准确性、完整性和一致性。此外,还应注重跨领域合作,引入数据科学家、AI算法工程师等多方力量,开展大模型算法合作、制定数据共享和隐私安全保密协议,推动大模型产学研用生态建设。sOF即热新闻——关注每天科技社会生活新变化gihot.com

如今,大模型的发展已迈入多模态融合阶段。通过加强数据治理,优化人工智能学习、训练和验证的“基础食材”,端上大规模、高质量、多模态数据集的“丰盛大餐”,必将助力大模型能力的提升,让人工智能更好地赋能千行百业、造福人类社会。sOF即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-856-0.html大模型既要“吃得饱”更要“吃得好”

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:张成伟代表:把低空安全作为初心使命

下一篇:全国人大代表、万事利集团董事长屠红燕:连续三年呼吁AI应用,加快丝绸纺织业变革

为你推荐
1月13日,由浙江大学杭州国际科创中心(以下简称“科创中心”)人形机器人创新研究院联合镜识科技有限公司、杭州凯达尔焊接机器人股份有限公司研发的四...
01-21
1月9日,国家药品监督管理局发布最新药品获批证明文件,华润三九携手中国工程院院士张伯礼及团队研发的益气清肺颗粒正式获批上市。益气清肺颗粒是以古...
01-21
  “年到元宵灯火燃,龙腾狮舞夜难眠。”元宵节作为春节后的首个传统节日,气氛主打一个“闹”字,...
02-13
近日,工业和信息化部等十三部门联合公布2024年网络安全技术应用典型案例项目名单,其中7家单位来自辽宁。...
02-18
全国多个省份陆续进入“两会时间”。1月13日,黑龙江省第十四届人民代表大会第三次会议开幕。根据2025年黑龙江省政府工作报告,2025...
01-21
  (央视财经《经济信息联播》)春节临近,很多养宠物的人也着手准备,给宠物洗澡护理穿新衣,让它们精精神神、干干净净过年。  在云南昆明的不少宠物门店里,给宠物做洗护美容...
01-22
1 月 21 日消息,在经过漫长的等待后,特斯拉终于开始要为安卓手机引入超宽带(Ultra-wideband,简称 UWB)技术支持了。这一技术将显著提升手机的定位精度,从而为用户带来更多...
01-21
春运大幕已经拉开,一汽-大众敏锐发现不少客户仍有买不到票,回家难的需求,暖心发起公益回家之旅活动,号召全国经销商,为大家筹备安心“顺风车”,致力于让每一位归心似箭的人,都能无...
01-27
  1、《滤镜》定档于2025年2月24日开播,檀健次跟李兰迪领衔主演的,这是一个充满奇幻色彩的故事。  2、一个神秘的超科技产品,让女主苏橙橙拥有了改变容貌,甚至是变成其他东...
02-17
  1、《难哄》温以凡是在桑延生日的第二天向他表白的,和桑延合租的日子里她意识到自己仍然喜欢桑延。  2、桑延无微不至的照顾和守护,让温以凡重新鼓起了勇气,她想要追回...
02-20
作者:衣晓蕾 上海市第六人民医院超声医学科公益科普支持:广东省二十一世纪教育基金会 “医生,我最近喉咙疼,还发热,是不是甲流啊?我好害怕啊!”“...
02-07
21世纪经济报道记者 韩利明 上海报道当地时间2月12日,艾伯维(NYSE:ABBV)与Xilio Therapeutics(NASDAQ:XLO)宣布达成一项合作和选择性许可协议,双方...
02-14
    何华武中国工程院供图  收到《中国科学报》的采访函后,中国工程院院士何华武亲手写下...
01-21
教育家精神深深植根于中华传统师道文化,同时也展现了新时代教师的精神风貌。新华网联合北京教育融媒体中...
01-23
  摘要  【开年显著回升!PX能否扭转颓势?】PX作为聚酯产业链中关键的原料之一,在整个产业链中...
01-28
    2024年,工业硅供应持续增长,多晶硅需求疲弱,在高供应、高库存的情况下,工业硅价格承压下跌...
02-11
射手座的男生通常充满活力和热情,他们喜欢与人交流并表达自己的感受。在亲密关系中,射手...
01-22
在爱情中,我们常常会遇到一些困惑和疑问。特别是当我们对一个人产生了好感,却无法确定对...
01-22
男士衬衫搭配什么裤子好看,男人衬衫搭配?一、男士衬衫搭配什么裤子好看,男人衬衫搭配?你可以搭配休闲裤还有商务休闲裤,或者牛仔裤都是穿着比较好看。你可以试着对比和搭配。衬衣...
02-17
独特魅力:韩国牛仔裤模特精彩T台走秀每年的时尚周总是让人期待不已,尤其是那些展现出独特风格的服装秀。我记得第一次观看韩国牛仔裤模特的T台走秀时,那种体验简直酣畅淋漓。牛...
02-17
2月7日消息,秦皇岛津峰线缆制造有限公司(以下简称:津峰线缆)董事长韩金良一行日前到访涂多多。现场,涂多多副总裁、跨境产发部常务副总经理郑德莲与津峰线缆副总经理韩冬共同签署...
02-07
2月11日消息,汇通达网络旗下“千橙云SaaS+”平台已全面接入DeepSeek。接入DeepSeek之后,千橙云SaaS+平台将实现“数字化管理”“智能化服务”“营销服务”“供应链优化”“全...
02-11
2月10日消息,美团外卖发布《年轻人春节送礼报告(2025)》,2025年春节期间,美团平台上“春节送礼”搜索量同比增速达165%,外卖餐饮礼券赠送量环比节前增长120%。其中95后消费者占比...
02-11
2月23日消息,在线旅游预订公司Booking公布2024年第四季度和全年业绩。财报显示,2024年第四季度,Booking客房预订夜数增长13%至2.61亿;总预订额同比增长约17%至372亿美元;收入同比...
02-24
预计全年扣非净利润大增1,313.65%–1,981.21%!1月21日晚,沃特股份(002886.SZ)发布2024年业绩预告,预计实现净利润和扣非净利润双双大幅增长。具体看来,公司预计去年归属于上...
01-22
全球性金融券商集团英国EBC Group平台始终致力于以领先生态,与全球交易者共塑交易的未来。 自第一届交易大赛起,为赤忱的热爱和卓越的才华提供舞台,在全球内寻找交易好手以赋能...
01-24
在2024年1月,育碧推出了《波斯王子:失落的王冠》,尽管游戏广受好评,但育碧以销量不佳为由将其开发团队解散,开发人员则被分配到了育碧的其他项目中。而最近,通过一名...
02-02
英伟达最新推出的RTX 50系列显卡,特别是RTX 5090,在全球范围内都是一卡难求,在中国台湾RTX 5090显卡同样也是供不应求。 据媒体报道,在这种供不应求的情况下,黄牛...
02-06
△以色列外交部长萨尔(资料图)以色列外交部长萨尔5日说,以色列将不参加联合国人权理事会。萨尔当天在社交媒体上说,以色列欢迎美国总统特朗普关于美国退出联合国人权理事会的决...
02-06
当地时间2月5日,美国总统特朗普签署一项行政命令,禁止跨性别运动员参加女子体育赛事。该行政命令是特朗普及其政府推进限制跨性别权利的最新举措。特朗普在竞选时曾多次承诺,如...
02-06
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮