生成式AI“幻觉”困境如何破解

8个月前 来源:中国科技网 观看:109

人工智能(AI)技术正以前所未有的速度发展,生成式AI凭借其惊人的创造力,不断刷新人们的认知。然而,即便是看似“聪明绝顶”的AI,也难逃“幻觉”的困扰。这里的“幻觉”,指的是AI生成看似合理但实际不准确或虚假的信息。DHp即热新闻——关注每天科技社会生活新变化gihot.com

英国《自然》杂志网站在1月22日的报道中指出,AI“幻觉”可能会引发严重后果,科学家正各出奇招,力求降低其发生率。这些措施包括增加事实核查、对AI进行“脑部扫描”等,以促进AI的健康、高效发展。DHp即热新闻——关注每天科技社会生活新变化gihot.com

主因是数据模糊DHp即热新闻——关注每天科技社会生活新变化gihot.com

各种生成式AI,包括由大语言模型驱动的聊天机器人,常常会编造信息。它们有时会模糊事实与虚构,在看似真实的陈述中夹杂错误信息。这既是其创造力的体现,也是其不足之处。DHp即热新闻——关注每天科技社会生活新变化gihot.com

美国佐治亚理工学院理论计算机科学家桑托什·威姆帕拉解释称,大语言模型的设计原理并非输出准确事实,而是通过模式识别生成答案。其内部复杂的运行机制迄今仍像一个“黑匣子”,人们难以洞悉其推理过程。DHp即热新闻——关注每天科技社会生活新变化gihot.com

美国加州Vectara公司旨在减少生成式AI的“幻觉”。其联合创始人阿姆尔·阿瓦达拉表示,在训练过程中,这些模型会压缩数万亿个单词间的关系,随后通过一个庞大的网络模型重新展开这些信息。尽管这些模型能够重构出接近98%的训练内容,但剩下2%的内容却会让其“误入歧途”,生成不准确或虚假信息。DHp即热新闻——关注每天科技社会生活新变化gihot.com

导致AI出现“幻觉”的原因多种多样,其中训练数据中的模糊性和错误是常见因素。也有人认为,即使训练数据准确无误,AI也有可能产生“幻觉”。这种现象与某一事实的稀缺程度密切相关。因此,即使经过人类反馈调整过的聊天机器人,也无法完全避免出错。DHp即热新闻——关注每天科技社会生活新变化gihot.com

多领域面临考验DHp即热新闻——关注每天科技社会生活新变化gihot.com

AI的“幻觉”可能会给人们的工作和生活带来较大影响。DHp即热新闻——关注每天科技社会生活新变化gihot.com

在新闻领域,大语言模型可能生成虚假新闻事件,扰乱信息传播秩序,误导公众认知。Vectara公司针对文档内容开展的研究表明,一些聊天机器人编造事实、虚构信息的几率高达30%。世界经济论坛发布的《2025年全球风险报告》显示,错误和虚假信息是2025年全球面临的五大风险之一。DHp即热新闻——关注每天科技社会生活新变化gihot.com

在法律领域,它可能引用虚构的法律条文和案例。比如,2023年美国律师史蒂文·施瓦茨就因“轻信”ChatGPT,在法庭文件中引用了并不存在的法律案例。而在医学领域,它可能提供错误的诊断和治疗建议,危及患者生命。DHp即热新闻——关注每天科技社会生活新变化gihot.com

《自然》在报道中指出,AI“幻觉”在科学参考文献方面出现错误的情况也极为普遍。2024年的一项研究发现,各类聊天机器人在提及参考文献时的出错率在30%至90%之间。它们至少会在论文标题、第一作者或发表年份上出现偏差。虽然聊天机器人都带有警告标签,提醒用户对重要信息进行二次核实。但如果用户对聊天机器人的回复深信不疑,可能会引发一系列问题。DHp即热新闻——关注每天科技社会生活新变化gihot.com

多举措减少“幻觉”DHp即热新闻——关注每天科技社会生活新变化gihot.com

为进一步提升AI的精确度,科学家正想方设法降低其“幻觉”。DHp即热新闻——关注每天科技社会生活新变化gihot.com

例如,增加模型训练参数和训练时长可有效减少“幻觉”。但这种方法需要付出高昂的计算成本,并可能削弱聊天机器人的其他能力,如机器学习算法对未知数据的预测和处理能力。DHp即热新闻——关注每天科技社会生活新变化gihot.com

此外,使用更大、更干净的数据集进行训练,也是降低AI模型“幻觉”出现的有效途径。然而,当前可用数据的有限性限制了这一方法的应用。DHp即热新闻——关注每天科技社会生活新变化gihot.com

检索增强生成(RAG)技术也为减少AI“幻觉”提供了新思路。该方法通过让聊天机器人在回复问题前参考给定的可信文本,从而确保回复内容的真实性,以此减少“幻觉”的产生。在医疗和法律等需要严格遵循经过验证的知识的领域,RAG技术备受青睐。DHp即热新闻——关注每天科技社会生活新变化gihot.com

不过,美国斯坦福大学计算机科学家米拉柯·苏兹根表示,尽管RAG能提升内容真实性,但其能力有限。苏兹根团队的研究表明,一些为法律研究开发的、号称“无幻觉”的RAG增强模型虽有所改进,但仍存在不足。DHp即热新闻——关注每天科技社会生活新变化gihot.com

开发者也可以使用一个与AI训练方式不同的独立系统,通过网络搜索对聊天机器人的回复进行事实核查,谷歌的“双子星”系统便是一个典型例子。该系统提供了“双重核查响应”功能:内容如果突出显示为绿色,表示其已通过网络搜索验证;内容如果突出显示为棕色,则表示其为有争议或不确定的内容。但是,这种方法计算成本高昂且耗时,而且系统仍会产生“幻觉”,因为互联网上错误信息泛滥。DHp即热新闻——关注每天科技社会生活新变化gihot.com

在去年6月出版的《自然》杂志上,英国牛津大学科学家刊发论文称,他们利用“语义熵”,通过概率来判断大语言模型是否出现了“幻觉”。语义熵是信息熵的一种,被用于量化物理系统中所包含的信息量。通过评估AI模型在特定提示词下生成内容的不确定性,来计算模型的困惑程度,从而为用户或模型提供警示,提醒其采取必要的循证措施,确保更准确的答案输出。DHp即热新闻——关注每天科技社会生活新变化gihot.com

美国卡内基梅隆AI研究人员安迪·邹采用的方法是在大语言模型回答问题时,绘制其内部计算节点的激活模式。他形象地称之为“给AI做脑部扫描”。利用不同的计算节点活动模式,可以告诉我们AI模型是在“说真话”,还是在“胡说八道”。DHp即热新闻——关注每天科技社会生活新变化gihot.com

人工智能(AI)技术正以前所未有的速度发展,生成式AI凭借其惊人的创造力,不断刷新人们的认知。然而,即便是看似“聪明绝顶”的AI,也难逃“幻觉”的困扰。这里的“幻觉”,指的是AI生成看似合理但实际不准确或虚假的信息。DHp即热新闻——关注每天科技社会生活新变化gihot.com

英国《自然》杂志网站在1月22日的报道中指出,AI“幻觉”可能会引发严重后果,科学家正各出奇招,力求降低其发生率。这些措施包括增加事实核查、对AI进行“脑部扫描”等,以促进AI的健康、高效发展。DHp即热新闻——关注每天科技社会生活新变化gihot.com

主因是数据模糊DHp即热新闻——关注每天科技社会生活新变化gihot.com

各种生成式AI,包括由大语言模型驱动的聊天机器人,常常会编造信息。它们有时会模糊事实与虚构,在看似真实的陈述中夹杂错误信息。这既是其创造力的体现,也是其不足之处。DHp即热新闻——关注每天科技社会生活新变化gihot.com

美国佐治亚理工学院理论计算机科学家桑托什·威姆帕拉解释称,大语言模型的设计原理并非输出准确事实,而是通过模式识别生成答案。其内部复杂的运行机制迄今仍像一个“黑匣子”,人们难以洞悉其推理过程。DHp即热新闻——关注每天科技社会生活新变化gihot.com

美国加州Vectara公司旨在减少生成式AI的“幻觉”。其联合创始人阿姆尔·阿瓦达拉表示,在训练过程中,这些模型会压缩数万亿个单词间的关系,随后通过一个庞大的网络模型重新展开这些信息。尽管这些模型能够重构出接近98%的训练内容,但剩下2%的内容却会让其“误入歧途”,生成不准确或虚假信息。DHp即热新闻——关注每天科技社会生活新变化gihot.com

导致AI出现“幻觉”的原因多种多样,其中训练数据中的模糊性和错误是常见因素。也有人认为,即使训练数据准确无误,AI也有可能产生“幻觉”。这种现象与某一事实的稀缺程度密切相关。因此,即使经过人类反馈调整过的聊天机器人,也无法完全避免出错。DHp即热新闻——关注每天科技社会生活新变化gihot.com

多领域面临考验DHp即热新闻——关注每天科技社会生活新变化gihot.com

AI的“幻觉”可能会给人们的工作和生活带来较大影响。DHp即热新闻——关注每天科技社会生活新变化gihot.com

在新闻领域,大语言模型可能生成虚假新闻事件,扰乱信息传播秩序,误导公众认知。Vectara公司针对文档内容开展的研究表明,一些聊天机器人编造事实、虚构信息的几率高达30%。世界经济论坛发布的《2025年全球风险报告》显示,错误和虚假信息是2025年全球面临的五大风险之一。DHp即热新闻——关注每天科技社会生活新变化gihot.com

在法律领域,它可能引用虚构的法律条文和案例。比如,2023年美国律师史蒂文·施瓦茨就因“轻信”ChatGPT,在法庭文件中引用了并不存在的法律案例。而在医学领域,它可能提供错误的诊断和治疗建议,危及患者生命。DHp即热新闻——关注每天科技社会生活新变化gihot.com

《自然》在报道中指出,AI“幻觉”在科学参考文献方面出现错误的情况也极为普遍。2024年的一项研究发现,各类聊天机器人在提及参考文献时的出错率在30%至90%之间。它们至少会在论文标题、第一作者或发表年份上出现偏差。虽然聊天机器人都带有警告标签,提醒用户对重要信息进行二次核实。但如果用户对聊天机器人的回复深信不疑,可能会引发一系列问题。DHp即热新闻——关注每天科技社会生活新变化gihot.com

多举措减少“幻觉”DHp即热新闻——关注每天科技社会生活新变化gihot.com

为进一步提升AI的精确度,科学家正想方设法降低其“幻觉”。DHp即热新闻——关注每天科技社会生活新变化gihot.com

例如,增加模型训练参数和训练时长可有效减少“幻觉”。但这种方法需要付出高昂的计算成本,并可能削弱聊天机器人的其他能力,如机器学习算法对未知数据的预测和处理能力。DHp即热新闻——关注每天科技社会生活新变化gihot.com

此外,使用更大、更干净的数据集进行训练,也是降低AI模型“幻觉”出现的有效途径。然而,当前可用数据的有限性限制了这一方法的应用。DHp即热新闻——关注每天科技社会生活新变化gihot.com

检索增强生成(RAG)技术也为减少AI“幻觉”提供了新思路。该方法通过让聊天机器人在回复问题前参考给定的可信文本,从而确保回复内容的真实性,以此减少“幻觉”的产生。在医疗和法律等需要严格遵循经过验证的知识的领域,RAG技术备受青睐。DHp即热新闻——关注每天科技社会生活新变化gihot.com

不过,美国斯坦福大学计算机科学家米拉柯·苏兹根表示,尽管RAG能提升内容真实性,但其能力有限。苏兹根团队的研究表明,一些为法律研究开发的、号称“无幻觉”的RAG增强模型虽有所改进,但仍存在不足。DHp即热新闻——关注每天科技社会生活新变化gihot.com

开发者也可以使用一个与AI训练方式不同的独立系统,通过网络搜索对聊天机器人的回复进行事实核查,谷歌的“双子星”系统便是一个典型例子。该系统提供了“双重核查响应”功能:内容如果突出显示为绿色,表示其已通过网络搜索验证;内容如果突出显示为棕色,则表示其为有争议或不确定的内容。但是,这种方法计算成本高昂且耗时,而且系统仍会产生“幻觉”,因为互联网上错误信息泛滥。DHp即热新闻——关注每天科技社会生活新变化gihot.com

在去年6月出版的《自然》杂志上,英国牛津大学科学家刊发论文称,他们利用“语义熵”,通过概率来判断大语言模型是否出现了“幻觉”。语义熵是信息熵的一种,被用于量化物理系统中所包含的信息量。通过评估AI模型在特定提示词下生成内容的不确定性,来计算模型的困惑程度,从而为用户或模型提供警示,提醒其采取必要的循证措施,确保更准确的答案输出。DHp即热新闻——关注每天科技社会生活新变化gihot.com

美国卡内基梅隆AI研究人员安迪·邹采用的方法是在大语言模型回答问题时,绘制其内部计算节点的激活模式。他形象地称之为“给AI做脑部扫描”。利用不同的计算节点活动模式,可以告诉我们AI模型是在“说真话”,还是在“胡说八道”。DHp即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-375-0.html生成式AI“幻觉”困境如何破解

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:标记速度、均匀性和多功能性超出以往,新技术可高效标记细胞蛋白质

下一篇:顶夸克遵循狭义相对论通过最强测验

为你推荐
近日,两家独角兽的朋友圈“论战”在近期引起了多方关注。争议缘起于一张影石创始人怒喷友商的截图。在微信朋友圈界面中,显示为“刘...
01-21
飞行中的无人机、正在移动的智能机器人,都可以远程隔空充电,科幻小说里描述的场景有望成为现实。近日,由西安电子科技大学教授李龙课题组与中国科学院...
01-27
好消息!辽宁省手机、平板、智能手表(手环)购新补贴实施细则来啦每人每类可补贴1件每件最高补贴不超过500元...
01-21
  一些“萌萌的”文创你方唱罢我登场。苏州博物馆的“蟹黄黄”毛绒玩具、甘肃博物馆的麻辣烫...
01-21
  近些年,不少家长被号称能为孩子进行“天赋基因检测”的宣传所迷惑,在口腔黏膜取些唾液,送至机构检测,便能测出孩子有哪些天赋,从而为“定向”培养孩子提供精准的“科学依...
01-21
  中新经纬1月17日电 国新办17日就2024年国民经济运行情况举行发布会。国家统计局局长康义表示,从未来看,支撑消费持续增长的有利条件较多。  有记者提问称:中央经济工作会...
01-21
1 月 24 日消息,如果你正在犹豫是否选择电动汽车(EV)作为下一辆新车,安全性很可能是一个重要的考虑因素。与传统的燃油车(ICE)相比,电动汽车究竟更安全还是更具风险?澳大利...
01-25
2 月 6 日消息,福特 CEO 吉姆・法利在当地时间周三的财报电话会议上表示,增程电动汽车将在美国市场发挥重要作用,原因很简单:“美国人喜欢大车,尤其是大皮卡。”增程电动...
02-06
  苏也菲  微短剧如火如荼,“微短剧+”成为某种趋势。微短剧以其短视频体质、类似高概念电影...
01-22
最近,《我的蛇君软又妖》吸引了众多观众的目光,播出后引发了广泛关注。社交媒体上频繁出现关于该剧的讨论和剧情分析,特别是其剧情介绍,激发了观众浓厚的兴趣和...
02-20
21世纪经济报道记者 唐唯珂 广州报道2025年1月24日晚,金域医学发布2024年业绩预告,报告期内预计归母净利润为-3.5亿元到-4.5亿元,与上年同期...
01-27
21世纪经济报道记者 林昀肖 北京报道 春节假期过后,72家A股中药上市企业中已有30家企业发布2024年年报业绩预告。据Wind数据,这30家中药上...
02-07
  大众网记者 杨涛报道  日前,“外研社·国才杯”“理解当代中国”全国大学生外语能力演讲大赛(山东赛区高职组)成绩揭晓,青岛港湾职业技术学院的王淑珍同学凭借出色的表...
01-21
为提升辽宁省中职学校学生干部的能力素质,培养一支具有高度责任感、优秀管理能力和良好道德品质的学生干...
01-21
    1月19日,中国地质调查发布,自然资源部中国地质调查局在甘肃安坝里北、内蒙古哈达门沟和黑...
01-21
  近年来,随着个人消费贷款需求不断增长,不法贷款中介、电信诈骗不法人员盯上了这块“蛋糕”。...
01-24
射手座的男生通常都是开朗、乐观、热情洋溢的,他们喜欢自由自在地生活,不喜欢被束缚。但...
01-22
双子座的男生善于交际,聪明机智,喜欢追求新鲜刺激的感觉。然而,有时候他们也会变得烦躁不...
01-22
泉州潮流服饰必看推荐,让你轻松打造时尚造型当谈到泉州,我的脑海中总会浮现出这座城市独特的文化底蕴,以及那一股浓厚的潮流气息。在这里,不仅仅是历史古迹和美食让人向往,还有那...
02-17
lv包包和ysl包包哪个? ysl包包真假鉴定?lv包包和ysl包包哪个?看你买那种了,钱包很一般的两折的大概三千多,大点的自然就会贵很多,平时出门背的包我们国内买的最便宜的是五千多,经典...
02-17
1月26日消息,欧冶云商与宝武清能近日在上海签署技术合作协议,标志着双方正式开启在碳资产系统建设的深度合作。根据合作协议,双方将聚焦宝武碳资产服务平台的建设与升级,共同推...
02-07
1.阿里开放数百AI招聘岗位阿里的野心彻底暴露了,其正以前所未有的力度抢占人才高地,全面加速在AI To C领域的布局步伐。近期,阿里AI To C业务开启大规模人员招聘,开放招聘岗位达...
02-20
2月7日消息,神州租车发布的《2025年春节出行大数据报告》显示,2025年蛇年春节租车市场火爆,延续去年节前返乡+节后旅游双高峰态势,出租率再创历史新高,多项业务指标大幅增长,为消...
02-08
2月18日消息,作为赞助商,中国银联将支持境外中国电影节首场落地马耳他。本次电影节上,《封神第一部:朝歌风云》《热辣滚烫》《热烈》《飞驰人生2》等多部影片将轮番上映,生动呈现...
02-19
【#国家能源集团等在安徽成立新公司# 注册资本2.1亿】天眼查App显示,近日,国能(太湖)新能源有限责任公司成立,法定代表人为赵冠永,注册资本2.1亿人民币,经营范围含太阳能发电技术服...
01-21
2025年,中国“HR SaaS第一股”给资本市场带来一些震撼。据北森港股公告,1月14日,北森境内控股公司与企业培训平台“酷学院”股东订立境内股权转让协...
02-07
在2024年1月,育碧推出了《波斯王子:失落的王冠》,尽管游戏广受好评,但育碧以销量不佳为由将其开发团队解散,开发人员则被分配到了育碧的其他项目中。而最近,通过一名...
02-02
2月8日消息,新年伊始,小米集团股价持续上扬,已经创下了历史新高。 2月7日,小米集团盘中最高冲至43.05港元/股,截至收盘报42.45港元,涨4.69%,股价创历史新高,总市值1065...
02-10
当地时间2月2日,美国国家运输安全委员会发表声明称,该机构目前已派遣工作人员抵达费城坠机事故的现场参与调查。截至2日下午,费城坠机事故的受伤人数已增至22人,5名伤者仍在住院...
02-03
在上海交通大学闵行校园的西区,旭华路是一条几乎贯穿南北的道路。开学时节,这几乎是全校最热闹的道路之一,沿旭华路一路穿行,会经过学生宿舍、体育场、用餐区、快递区、活动场馆...
02-08
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮