生成式AI“幻觉”困境如何破解

5个月前 来源:中国科技网 观看:66

人工智能(AI)技术正以前所未有的速度发展,生成式AI凭借其惊人的创造力,不断刷新人们的认知。然而,即便是看似“聪明绝顶”的AI,也难逃“幻觉”的困扰。这里的“幻觉”,指的是AI生成看似合理但实际不准确或虚假的信息。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

英国《自然》杂志网站在1月22日的报道中指出,AI“幻觉”可能会引发严重后果,科学家正各出奇招,力求降低其发生率。这些措施包括增加事实核查、对AI进行“脑部扫描”等,以促进AI的健康、高效发展。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

主因是数据模糊zGQ即热新闻——关注每天科技社会生活新变化gihot.com

各种生成式AI,包括由大语言模型驱动的聊天机器人,常常会编造信息。它们有时会模糊事实与虚构,在看似真实的陈述中夹杂错误信息。这既是其创造力的体现,也是其不足之处。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

美国佐治亚理工学院理论计算机科学家桑托什·威姆帕拉解释称,大语言模型的设计原理并非输出准确事实,而是通过模式识别生成答案。其内部复杂的运行机制迄今仍像一个“黑匣子”,人们难以洞悉其推理过程。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

美国加州Vectara公司旨在减少生成式AI的“幻觉”。其联合创始人阿姆尔·阿瓦达拉表示,在训练过程中,这些模型会压缩数万亿个单词间的关系,随后通过一个庞大的网络模型重新展开这些信息。尽管这些模型能够重构出接近98%的训练内容,但剩下2%的内容却会让其“误入歧途”,生成不准确或虚假信息。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

导致AI出现“幻觉”的原因多种多样,其中训练数据中的模糊性和错误是常见因素。也有人认为,即使训练数据准确无误,AI也有可能产生“幻觉”。这种现象与某一事实的稀缺程度密切相关。因此,即使经过人类反馈调整过的聊天机器人,也无法完全避免出错。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

多领域面临考验zGQ即热新闻——关注每天科技社会生活新变化gihot.com

AI的“幻觉”可能会给人们的工作和生活带来较大影响。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

在新闻领域,大语言模型可能生成虚假新闻事件,扰乱信息传播秩序,误导公众认知。Vectara公司针对文档内容开展的研究表明,一些聊天机器人编造事实、虚构信息的几率高达30%。世界经济论坛发布的《2025年全球风险报告》显示,错误和虚假信息是2025年全球面临的五大风险之一。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

在法律领域,它可能引用虚构的法律条文和案例。比如,2023年美国律师史蒂文·施瓦茨就因“轻信”ChatGPT,在法庭文件中引用了并不存在的法律案例。而在医学领域,它可能提供错误的诊断和治疗建议,危及患者生命。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

《自然》在报道中指出,AI“幻觉”在科学参考文献方面出现错误的情况也极为普遍。2024年的一项研究发现,各类聊天机器人在提及参考文献时的出错率在30%至90%之间。它们至少会在论文标题、第一作者或发表年份上出现偏差。虽然聊天机器人都带有警告标签,提醒用户对重要信息进行二次核实。但如果用户对聊天机器人的回复深信不疑,可能会引发一系列问题。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

多举措减少“幻觉”zGQ即热新闻——关注每天科技社会生活新变化gihot.com

为进一步提升AI的精确度,科学家正想方设法降低其“幻觉”。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

例如,增加模型训练参数和训练时长可有效减少“幻觉”。但这种方法需要付出高昂的计算成本,并可能削弱聊天机器人的其他能力,如机器学习算法对未知数据的预测和处理能力。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

此外,使用更大、更干净的数据集进行训练,也是降低AI模型“幻觉”出现的有效途径。然而,当前可用数据的有限性限制了这一方法的应用。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

检索增强生成(RAG)技术也为减少AI“幻觉”提供了新思路。该方法通过让聊天机器人在回复问题前参考给定的可信文本,从而确保回复内容的真实性,以此减少“幻觉”的产生。在医疗和法律等需要严格遵循经过验证的知识的领域,RAG技术备受青睐。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

不过,美国斯坦福大学计算机科学家米拉柯·苏兹根表示,尽管RAG能提升内容真实性,但其能力有限。苏兹根团队的研究表明,一些为法律研究开发的、号称“无幻觉”的RAG增强模型虽有所改进,但仍存在不足。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

开发者也可以使用一个与AI训练方式不同的独立系统,通过网络搜索对聊天机器人的回复进行事实核查,谷歌的“双子星”系统便是一个典型例子。该系统提供了“双重核查响应”功能:内容如果突出显示为绿色,表示其已通过网络搜索验证;内容如果突出显示为棕色,则表示其为有争议或不确定的内容。但是,这种方法计算成本高昂且耗时,而且系统仍会产生“幻觉”,因为互联网上错误信息泛滥。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

在去年6月出版的《自然》杂志上,英国牛津大学科学家刊发论文称,他们利用“语义熵”,通过概率来判断大语言模型是否出现了“幻觉”。语义熵是信息熵的一种,被用于量化物理系统中所包含的信息量。通过评估AI模型在特定提示词下生成内容的不确定性,来计算模型的困惑程度,从而为用户或模型提供警示,提醒其采取必要的循证措施,确保更准确的答案输出。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

美国卡内基梅隆AI研究人员安迪·邹采用的方法是在大语言模型回答问题时,绘制其内部计算节点的激活模式。他形象地称之为“给AI做脑部扫描”。利用不同的计算节点活动模式,可以告诉我们AI模型是在“说真话”,还是在“胡说八道”。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

人工智能(AI)技术正以前所未有的速度发展,生成式AI凭借其惊人的创造力,不断刷新人们的认知。然而,即便是看似“聪明绝顶”的AI,也难逃“幻觉”的困扰。这里的“幻觉”,指的是AI生成看似合理但实际不准确或虚假的信息。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

英国《自然》杂志网站在1月22日的报道中指出,AI“幻觉”可能会引发严重后果,科学家正各出奇招,力求降低其发生率。这些措施包括增加事实核查、对AI进行“脑部扫描”等,以促进AI的健康、高效发展。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

主因是数据模糊zGQ即热新闻——关注每天科技社会生活新变化gihot.com

各种生成式AI,包括由大语言模型驱动的聊天机器人,常常会编造信息。它们有时会模糊事实与虚构,在看似真实的陈述中夹杂错误信息。这既是其创造力的体现,也是其不足之处。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

美国佐治亚理工学院理论计算机科学家桑托什·威姆帕拉解释称,大语言模型的设计原理并非输出准确事实,而是通过模式识别生成答案。其内部复杂的运行机制迄今仍像一个“黑匣子”,人们难以洞悉其推理过程。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

美国加州Vectara公司旨在减少生成式AI的“幻觉”。其联合创始人阿姆尔·阿瓦达拉表示,在训练过程中,这些模型会压缩数万亿个单词间的关系,随后通过一个庞大的网络模型重新展开这些信息。尽管这些模型能够重构出接近98%的训练内容,但剩下2%的内容却会让其“误入歧途”,生成不准确或虚假信息。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

导致AI出现“幻觉”的原因多种多样,其中训练数据中的模糊性和错误是常见因素。也有人认为,即使训练数据准确无误,AI也有可能产生“幻觉”。这种现象与某一事实的稀缺程度密切相关。因此,即使经过人类反馈调整过的聊天机器人,也无法完全避免出错。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

多领域面临考验zGQ即热新闻——关注每天科技社会生活新变化gihot.com

AI的“幻觉”可能会给人们的工作和生活带来较大影响。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

在新闻领域,大语言模型可能生成虚假新闻事件,扰乱信息传播秩序,误导公众认知。Vectara公司针对文档内容开展的研究表明,一些聊天机器人编造事实、虚构信息的几率高达30%。世界经济论坛发布的《2025年全球风险报告》显示,错误和虚假信息是2025年全球面临的五大风险之一。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

在法律领域,它可能引用虚构的法律条文和案例。比如,2023年美国律师史蒂文·施瓦茨就因“轻信”ChatGPT,在法庭文件中引用了并不存在的法律案例。而在医学领域,它可能提供错误的诊断和治疗建议,危及患者生命。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

《自然》在报道中指出,AI“幻觉”在科学参考文献方面出现错误的情况也极为普遍。2024年的一项研究发现,各类聊天机器人在提及参考文献时的出错率在30%至90%之间。它们至少会在论文标题、第一作者或发表年份上出现偏差。虽然聊天机器人都带有警告标签,提醒用户对重要信息进行二次核实。但如果用户对聊天机器人的回复深信不疑,可能会引发一系列问题。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

多举措减少“幻觉”zGQ即热新闻——关注每天科技社会生活新变化gihot.com

为进一步提升AI的精确度,科学家正想方设法降低其“幻觉”。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

例如,增加模型训练参数和训练时长可有效减少“幻觉”。但这种方法需要付出高昂的计算成本,并可能削弱聊天机器人的其他能力,如机器学习算法对未知数据的预测和处理能力。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

此外,使用更大、更干净的数据集进行训练,也是降低AI模型“幻觉”出现的有效途径。然而,当前可用数据的有限性限制了这一方法的应用。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

检索增强生成(RAG)技术也为减少AI“幻觉”提供了新思路。该方法通过让聊天机器人在回复问题前参考给定的可信文本,从而确保回复内容的真实性,以此减少“幻觉”的产生。在医疗和法律等需要严格遵循经过验证的知识的领域,RAG技术备受青睐。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

不过,美国斯坦福大学计算机科学家米拉柯·苏兹根表示,尽管RAG能提升内容真实性,但其能力有限。苏兹根团队的研究表明,一些为法律研究开发的、号称“无幻觉”的RAG增强模型虽有所改进,但仍存在不足。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

开发者也可以使用一个与AI训练方式不同的独立系统,通过网络搜索对聊天机器人的回复进行事实核查,谷歌的“双子星”系统便是一个典型例子。该系统提供了“双重核查响应”功能:内容如果突出显示为绿色,表示其已通过网络搜索验证;内容如果突出显示为棕色,则表示其为有争议或不确定的内容。但是,这种方法计算成本高昂且耗时,而且系统仍会产生“幻觉”,因为互联网上错误信息泛滥。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

在去年6月出版的《自然》杂志上,英国牛津大学科学家刊发论文称,他们利用“语义熵”,通过概率来判断大语言模型是否出现了“幻觉”。语义熵是信息熵的一种,被用于量化物理系统中所包含的信息量。通过评估AI模型在特定提示词下生成内容的不确定性,来计算模型的困惑程度,从而为用户或模型提供警示,提醒其采取必要的循证措施,确保更准确的答案输出。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

美国卡内基梅隆AI研究人员安迪·邹采用的方法是在大语言模型回答问题时,绘制其内部计算节点的激活模式。他形象地称之为“给AI做脑部扫描”。利用不同的计算节点活动模式,可以告诉我们AI模型是在“说真话”,还是在“胡说八道”。zGQ即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-375-0.html生成式AI“幻觉”困境如何破解

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:标记速度、均匀性和多功能性超出以往,新技术可高效标记细胞蛋白质

下一篇:顶夸克遵循狭义相对论通过最强测验

为你推荐
来自美国亚利桑那大学的天文学家团队使用大型双筒望远镜干涉仪,在红外波段捕捉到了迄今为止最清晰的活动星系核(AGN)图像,并将研究结果发表在最新一期...
01-21
1月14日,记者从国家市场监管总局获悉,该局近日在国际上率先批准新建微波亮温度国家计量基准,该计量基准有利于解决射电天文、行星探索等领域微波亮温...
01-21
  近日,辽宁省防减救灾办与相关成员单位进行会商,对近期全省自然灾害风险形势开展了研判分析,结合实际对...
01-24
在全面振兴新突破三年行动“首战告捷”的基础上,2024年,辽宁实现了“攻坚连胜”,地区生产总值(GDP)增速高于...
02-11
  1月20日,北京住房公积金管理中心(以下简称“公积金中心”)发布《关于开展提取住房公积金直付...
01-21
  海报新闻记者 田阳 报道  “驳回上诉,维持原判。”1月21日,王浩文拐卖儿童案二审宣判。该案中被人熟知的“雷公”雷武泽通过朋友拿到了法院的判决结果。“雷公”告诉...
01-22
1 月 27 日消息,今日,极氪海外第 15000 台汽车在澳洲正式交付。极氪表示将在 2025 年持续深化国际化战略,重点关注销售和服务网络的拓展与升级,计划 2025 年在海外建设 ...
01-28
2 月 5 日消息,丰田汽车公司(以下简称“丰田”)与上海市政府今日就共同助力中国社会绿色低碳发展相关举措达成合作意向。丰田决定在上海市金山区成立 LEXUS 雷克萨斯纯...
02-05
《难哄》的钟思乔和谁是CP?钟思乔和向朗是情侣吗?在《难哄》中,钟思乔的CP是苏浩安。苏浩安是桑延的好兄弟,通过温以凡认识了钟思乔。两人一开始是欢喜冤家,在相...
02-19
最近,“难哄的刘楚恬有吻戏吗”引起了广泛关注。这部作品自宣传以来就备受期待,播出后也确实赢得了观众的喜爱。今天就来聊聊这个话题,希望能解答大家的好奇心...
02-20
21世纪经济报道记者 李佳英 广州报道2月4日,美国生物科技公司United Therapeutics宣布,其异种肾脏UKidney移植临床研究获美国FDA批准,标志着...
02-07
21世纪经济报道记者林昀肖 实习生苏洋 北京报道近日,天力士公告表示,其收到华润三九发来的通知,华润三九已于近日收到中国华润有限公司转发的...
02-11
  大众网记者 司心鹏 报道  12月24日上午,廉洁文化进学校暨“青春·清菏韵泽”廉洁文化馆开馆仪式在菏泽职业学院举行。市委常委、市纪委书记、市监委主任赵永强、市...
01-21
  大众网记者 秦瑾 通讯员 李永添 报道  12月24日,德州学院董仲舒书院揭牌开班仪式在厚德楼第二报告厅举行。德州市人民政府原副市长、一级巡视员董绍辉,上海交通大学...
01-21
  自营理财业务的主动关停或被动离场已成为众多中小银行不得不面对的现实。  “我已告别资...
01-22
  春节的“脚步”越来越近!近两日,上期所、郑商所、大商所、广期所陆续发布通知,对2025年春节期...
01-24
狮子座是十二星座中最具有领导力和自信心的一个星座。当他们爱上一个人时,会展现出一系...
01-22
水瓶座的男人通常具有独立、聪明、理性和创新的特点。他们对于自由和个人空间非常重视...
01-22
日系穿搭特点?一、日系穿搭的特点在穿搭方面日系风简直把休闲做到了极致,要说亚洲潮流文化发祥地,原宿绝对是一大圣地这里除了有常见的时尚大牌,还有亲民的牌子,日系穿搭的主要特...
02-07
广州哪里有YSL专柜? ysl圣罗兰的专柜在广州哪里有?广州哪里有YSL专柜?天河区 天河路218号天环广场B1-156号铺 天环广场全部店铺ysl圣罗兰的专柜在广州哪里有?环市东路白云宾馆旁...
02-17
2月9日消息,为满足消费者对品质家居好物的需求,京东“潮品家”频道升级上线,汇聚百大国际、原创家具品牌,精选时下流行的家具精品、宝藏店铺、风格趋势及热门榜单,为消费者打造一...
02-09
2月10日消息,携程商旅获得茶百道颁发的“2024年度优秀供应商”奖项。图源:公众号“携程商旅资讯号”据了解,作为国民级茶饮品牌,茶百道发源于“天府之国”,以“好茶为底,制造新鲜...
02-11
2月4日消息,途家民宿数据显示,截至2月4日,春节期间持非中国护照游客的民宿预订量同比增长3.7倍,有51个乡镇第一次迎来了外国人的订单。从平台民宿预订情况看,大理连续三年蝉联第...
02-07
2月21日消息,天猫养车日前与山西诺维兰集团正式签订战略合作,首批5家门店已完成签约,后续双方将在山西全省布局50+透明养车网络。双方将从空间重构、品牌共生、数字基建、流量...
02-22
近日,华力创科学宣布完成数千万元A+轮融资,本轮融资由金属3D打印领域头部上市公司铂力特独家投资。据披露,本轮融资所募集的资金将专注于深挖高性能光学多模态感知技术,结合金属...
01-24
近日,珠海市合心财税科技有限公司(简称“财税科技”)迎来了重要的发展里程碑。公司宣布,已完成5000万元人民币的融资,由中经金控投资有限公司(以下简称...
02-07
在今天的 Xbox Developer_Direct 中,Bethesda Softworks 和 id Software 一同宣布,《DOOM™: The Dark Ages》将于 5 月 15 日登陆 Game Pass、Xbox Series X|S...
01-25
世界流媒体巨头Netflix今后或许能够直接欣赏大型体育赛事直播了,日前有消息称Netflix正在考虑F1美国直播权,全面进军体育直播事业。 ·目前F1在美国的直播权是...
02-12
中央气象台今早6点继续发布大风黄色预警和寒潮蓝色预警。大风黄色预警:预计今天8点到明天8点,华北、内蒙古中部、宁夏、陕西北部、黄淮等地的部分地区有5~6级、阵风7~8级的偏...
02-06
为解决社会广泛关注“小案重罚”和“类案不同罚”问题,按照《国务院关于进一步规范和监督罚款设定与实施的指导意见》,市场监管总局今天发布《市场监管行政违法行为首违不罚清...
02-07
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮