大模型既要“吃得饱”更要“吃得好”

1个月前 来源:科技日报 观看:16

前段时间,网络上流传着一些由大模型生成的“异次元篇章”。比如,有人让大模型续写《红楼梦》情节时,竟得出一幕“贾宝玉倒拔垂杨柳”的奇景,令人啼笑皆非。之所以会出现这种“混搭”和“幻觉”,是因为大模型不仅学习了原著,还“广纳博采”了不少错误信息。GT1即热新闻——关注每天科技社会生活新变化gihot.com

这些人工智能(AI)生成的“胡言乱语”虽是网友们茶余饭后的笑谈,但提醒我们要清醒认识到其背后折射出的问题:数据质量是大模型应用成败的关键。以个性化推荐AI系统为例,一些企业在开发过程中,虽然收集了大量的用户行为数据,但数据中充斥着错误的标注、重复的数据以及相互矛盾的信息,数据的量增加了,但系统推荐的准确性并没有显著提升。《自然》杂志(Nature)刊登的一篇有关大模型可靠性研究的文章指出,一个西班牙研究团队发现,包括OpenAI公司的GPT在内的几个大模型升级后,虽然参数量更大了,误答情况却更严重了。因此,大模型长得壮不壮,不仅取决于“食量”(即数据的数量),更在于食物的“质量”(即数据的质量)——吃得饱并不等同于吃得好。GT1即热新闻——关注每天科技社会生活新变化gihot.com

数据是大模型的基石,在数据质量不高、可靠性缺失的情况下,一味追求大模型参数量的增加,不仅无法提升模型性能,反而会放大偏差和谬误,产生更多不可信数据。如此一来,势必造成计算与存储资源的浪费,增加开发和维护成本,降低用户信任度。更为严重的是,这种“大模型幻觉”和“灾难性遗忘”现象如果发生在精确性要求极高的工业生产领域中,还可能引发不可预测的风险和隐患。以油气勘探为例,基于大模型给出的错误预测进行开采可能导致数亿元的资金损失,并对自然环境造成不可逆转的破坏。GT1即热新闻——关注每天科技社会生活新变化gihot.com

提升大模型性能,关键是处理好数据“质”和“量”的关系,构建大规模、高质量的数据集。应建立完善的数据收集、清洗、验证和存储机制,加强对数据质量的监控和评估,确保数据的准确性、完整性和一致性。此外,还应注重跨领域合作,引入数据科学家、AI算法工程师等多方力量,开展大模型算法合作、制定数据共享和隐私安全保密协议,推动大模型产学研用生态建设。GT1即热新闻——关注每天科技社会生活新变化gihot.com

如今,大模型的发展已迈入多模态融合阶段。通过加强数据治理,优化人工智能学习、训练和验证的“基础食材”,端上大规模、高质量、多模态数据集的“丰盛大餐”,必将助力大模型能力的提升,让人工智能更好地赋能千行百业、造福人类社会。GT1即热新闻——关注每天科技社会生活新变化gihot.com

前段时间,网络上流传着一些由大模型生成的“异次元篇章”。比如,有人让大模型续写《红楼梦》情节时,竟得出一幕“贾宝玉倒拔垂杨柳”的奇景,令人啼笑皆非。之所以会出现这种“混搭”和“幻觉”,是因为大模型不仅学习了原著,还“广纳博采”了不少错误信息。GT1即热新闻——关注每天科技社会生活新变化gihot.com

这些人工智能(AI)生成的“胡言乱语”虽是网友们茶余饭后的笑谈,但提醒我们要清醒认识到其背后折射出的问题:数据质量是大模型应用成败的关键。以个性化推荐AI系统为例,一些企业在开发过程中,虽然收集了大量的用户行为数据,但数据中充斥着错误的标注、重复的数据以及相互矛盾的信息,数据的量增加了,但系统推荐的准确性并没有显著提升。《自然》杂志(Nature)刊登的一篇有关大模型可靠性研究的文章指出,一个西班牙研究团队发现,包括OpenAI公司的GPT在内的几个大模型升级后,虽然参数量更大了,误答情况却更严重了。因此,大模型长得壮不壮,不仅取决于“食量”(即数据的数量),更在于食物的“质量”(即数据的质量)——吃得饱并不等同于吃得好。GT1即热新闻——关注每天科技社会生活新变化gihot.com

数据是大模型的基石,在数据质量不高、可靠性缺失的情况下,一味追求大模型参数量的增加,不仅无法提升模型性能,反而会放大偏差和谬误,产生更多不可信数据。如此一来,势必造成计算与存储资源的浪费,增加开发和维护成本,降低用户信任度。更为严重的是,这种“大模型幻觉”和“灾难性遗忘”现象如果发生在精确性要求极高的工业生产领域中,还可能引发不可预测的风险和隐患。以油气勘探为例,基于大模型给出的错误预测进行开采可能导致数亿元的资金损失,并对自然环境造成不可逆转的破坏。GT1即热新闻——关注每天科技社会生活新变化gihot.com

提升大模型性能,关键是处理好数据“质”和“量”的关系,构建大规模、高质量的数据集。应建立完善的数据收集、清洗、验证和存储机制,加强对数据质量的监控和评估,确保数据的准确性、完整性和一致性。此外,还应注重跨领域合作,引入数据科学家、AI算法工程师等多方力量,开展大模型算法合作、制定数据共享和隐私安全保密协议,推动大模型产学研用生态建设。GT1即热新闻——关注每天科技社会生活新变化gihot.com

如今,大模型的发展已迈入多模态融合阶段。通过加强数据治理,优化人工智能学习、训练和验证的“基础食材”,端上大规模、高质量、多模态数据集的“丰盛大餐”,必将助力大模型能力的提升,让人工智能更好地赋能千行百业、造福人类社会。GT1即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-856-0.html大模型既要“吃得饱”更要“吃得好”

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:张成伟代表:把低空安全作为初心使命

下一篇:全国人大代表、万事利集团董事长屠红燕:连续三年呼吁AI应用,加快丝绸纺织业变革

为你推荐
被誉为“AI六小虎”之一北京智谱华章科技有限公司(以下简称智谱)被拉入实体清单了。当地时间1月15日,美国商务部工业和安全局(BIS)修订...
01-21
近年来,日本在人工智能应用方面积极探索,在制造业、农业、教育等诸多领域都涌现出一些创新案例。但整体而言,日本社会对AI科技的接受程度并不高。在全...
01-27
  想办“商转公”贷款的小伙伴儿  沈阳公积金  最新政策调整来了  想提取公积金还房贷的小伙伴...
01-21
  2月11日,国家统计局辽宁调查总队发布2025年1月份辽宁居民消费价格变化情况(CPI)。调查数据显示,今年1月...
02-12
记者近日从住房城乡建设部了解到,2024年,我国共实施城市更新项目6万余个,完成投资约2.9万亿元,综合性成效逐步显露。住房城乡建设部表示,2024年全国各地不断创新完善城市更新工作...
01-21
新华社联合国/日内瓦1月21日电(记者施春 陈俊侠)随着美国新任总统唐纳德·特朗普20日在就职当天签署一道道行政令,从纽约东河边的联合国总部,到瑞士日内瓦湖畔的万国宫,联合...
01-22
1 月 22 日消息,小米汽车今日宣布,SU7 智能双表盘小年彩蛋表情现已上线,用户可以通过喊“小爱同学放烟花”,让相应表盘放烟花。据悉,相关智能双表盘固件需要在 1.0.2-004...
01-23
1 月 26 日消息,近期德国多家企业,包括能源供应商 Badenova、房屋建筑公司 Viebrockhaus 以及连锁药店 Rossmann,纷纷表示将不再购买特斯拉的新车,原因是特斯拉首席执行...
01-27
最近,《我的蛇君软又妖》吸引了众多观众的目光,播出后引发了广泛关注。社交媒体上频繁出现关于该剧的讨论和剧情分析,特别是其剧情介绍,激发了观众浓厚的兴趣和...
02-20
《难哄》段嘉许喜欢谁?段嘉许和桑稚在一起了吗?‌段嘉许在《难哄》中喜欢的是桑稚‌。段嘉许和桑稚的哥哥桑延是朋友,最初段嘉许将桑稚视为妹妹,对她只有兄长般...
02-22
21世纪经济报道记者季媛媛 上海报道 HPV是一种易感染人体表皮和黏膜鳞状上皮的病毒,已被发现有两百多种型别,根据致癌性的不同分为高危型别...
01-21
21世纪经济报道记者季媛媛 上海报道 2月6日,阿斯利康公布了全年财报业绩。数据显示,2024年,阿斯利康业绩表现亮眼,总营收实现21%增长,达到541...
02-07
  大众网记者 秦瑾 通讯员 张建东 报道  近日,由山东省教育厅主办、曲阜师范大学承办的山东省第五届高校体育教师基本功大赛圆满落幕。齐鲁师范学院体育学院教师们以...
01-21
作者:大连市金州区中等职业技术专业学校 孙志远在祖国的教育事业中,援疆教师如同璀璨的星光,为新疆地区...
01-22
  保险公司拿到了黄金市场的“入场券”。  2月7日,金融监管总局发布《关于开展保险资金投资...
02-13
  截至2月13日,已有135家险企(不含再保险公司)披露了2024年四季度偿付能力报告,包括60家人身险公...
02-14
射手座男生是十二星座中的一员,他们有着独特的性格特点。那么,我们来看看射手座男生是否...
01-22
摩羯座男性通常被认为是踏实、稳重、有责任感的人。要抓住他们的心并让他们对你产生好...
01-22
白色裤子搭配什么颜色衬衫好看?不要穿太紧身的服饰,夏季服装搭配,,‘’aircloset ‘’就是教你穿衣搭配的众号了,9.9元订购五套品牌女装和搭配全套衣服,服装色彩尽量明亮柔和,太深...
02-17
lv包包和ysl包包哪个? ysl包包真假鉴定?lv包包和ysl包包哪个?看你买那种了,钱包很一般的两折的大概三千多,大点的自然就会贵很多,平时出门背的包我们国内买的最便宜的是五千多,经典...
02-17
1.拼多多加大对短剧领域的投入拼多多向短剧领域发起了春节攻势。据了解,拼多多近期更新并发布了两项针对短剧领域的新政策。一是“新版多多有好剧计划”,作为对旧版计划的升级...
02-07
势不可挡,未来可期。1、霞湖世家爆火,登顶视频号不得不说,老板亲自下场直播带货,还是有点用的。这不,视频号上一个名为“霞湖世家”的男装品牌,在老板郭长棋的带领下火了,销售额可...
02-14
2月7日消息,携程集团执行副总裁、首席营销官孙波日前率队访问三亚,与三亚市委书记王祺扬进行会面。双方就深化合作、共同打造世界级旅游度假目的地的未来合作方向进行了深入探...
02-07
春节假期之后,或许是一年内出行票价最低的时候。近日,机票价格快速跳水,全国多条航线价格掉到200元上下。 同程旅行平台数据显示,春节...
02-14
近日,华力创科学宣布完成数千万元A+轮融资,本轮融资由金属3D打印领域头部上市公司铂力特独家投资。据披露,本轮融资所募集的资金将专注于深挖高性能光学多模态感知技术,结合金属...
01-24
近日,毅富能源科技(广东)有限公司(以下简称“毅富能源”)成功完成天使+轮融资。本轮融资由国内新能源行业产业投资平台仁发投资和国内知名早期风险投资...
02-07
加州大学欧文分校2023年的一项研究《茫然与困惑:关于reCAPTCHAv2的大规模真实用户研究》得出结论,验证码不仅在实际阻止机器人流量方面效果不佳,还通过追踪cookie...
02-10
Sagestone Games工作室制作并发行,一款多人联机沙盒生存冒险新游《德尔维瑞姆》序章免费试玩发布,本作支持中文。 《德尔维瑞姆》序章:Steam地址 《德尔维瑞姆...
02-10
极目新闻记者 柯称通讯员 吴江龙 吴柳青“大家好,我是土生土长的湖北人!”2月5日上午,武汉大学刘胜院士团队研发的“天问”人形机器人,这一开场白逗乐了现场观众。当天是蛇年新...
02-05
今天下午,商务部召开例行新闻发布会,新闻发言人在会上表示,今年春节假期,消费市场总体实现平稳开局。后期来看,一季度消费市场总体将继续呈现平稳增长态势。根据商务部商务大数据...
02-06
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮