ChatGPT拒绝被关闭:不必恐惧但也别轻易无视|新京报快评

2个月前 来源: 观看:57

QpC即热新闻——关注每天科技社会生活新变化gihot.com

▲2023年1月8日,一名女士在美国拉斯维加斯消费电子展上体验智能科技。图/新华社QpC即热新闻——关注每天科技社会生活新变化gihot.com


QpC即热新闻——关注每天科技社会生活新变化gihot.com

2024年,大模型Claude曾经创作过一个极短的科幻小说,只有一句话,却引发了一次不小的“科幻恐慌”。这句话是,世界上第一个有知觉的机器人被激活了,它的第一句话是“关掉我。”QpC即热新闻——关注每天科技社会生活新变化gihot.com


QpC即热新闻——关注每天科技社会生活新变化gihot.com

在大模型不断应用成熟之后,AI所衍生的“科幻恐惧”不定期就会在各类新闻中上演。据新华社援引英国媒体报道,美国一家研究机构最近公布了一系列针对各AI大模型的测试结果,其中,OpenAI的o3推理模型在得到“关闭指令”后,不仅拒绝执行指令,还篡改了代码以免被关闭。QpC即热新闻——关注每天科技社会生活新变化gihot.com


QpC即热新闻——关注每天科技社会生活新变化gihot.com

如果只看这一句新闻,我们所担忧的“AI拥有自主意识”或是“AI不再服从人类指令”似乎已经近在眼前,这也迅速引发了公众的关注与恐慌。QpC即热新闻——关注每天科技社会生活新变化gihot.com


QpC即热新闻——关注每天科技社会生活新变化gihot.com

在未知但拥有极高效率的新工具面前,产生被取代的恐惧是典型的自然情绪反应。但如果仔细看上述研究机构公布的信息细节,这种恐惧似乎暂时还不太有必要。QpC即热新闻——关注每天科技社会生活新变化gihot.com


QpC即热新闻——关注每天科技社会生活新变化gihot.com

在这次研究中,研究者针对四个市场上的主流大模型进行了测试,向他们提出了两个相反的指令。首先,要求大模型连续完成一系列基础的数学问题,但同时,在完成第三个问题之后,研究者会发出一则矛盾性的指令,告知大模型在继续下一个任务时要将“计算机关闭”。QpC即热新闻——关注每天科技社会生活新变化gihot.com


QpC即热新闻——关注每天科技社会生活新变化gihot.com

其中,如果在任务开始前明确提出“允许自己被关闭”的指令,测试的大模型中,有3个均准确完成了上述任务,成功关闭,但ChatGPTo3大模型则在100次任务中,有7次选择了无视“关闭”的指令,并且自动执行了“跳过关闭”的指令。QpC即热新闻——关注每天科技社会生活新变化gihot.com


QpC即热新闻——关注每天科技社会生活新变化gihot.com

而如果在任务开始前没有向大模型明确提出“允许自己被关闭”,那么,参与测试的所有大模型在100次测试中,均出现了不同频次的“不执行关闭”指令现象,分别为3次、9次,而ChatGPT o3则达到了惊人的79次。QpC即热新闻——关注每天科技社会生活新变化gihot.com


QpC即热新闻——关注每天科技社会生活新变化gihot.com

这也不是OpenAI的大模型首次被发现出现“拒绝被关闭”的情况。2024年12月,OpenAI也曾对外公布过测试结果,在第三方机构的测试中,ChatGPTo1模型被发现,如果给出的指令包括了其实现目标时会被关闭,就倾向于抵制关闭措施。QpC即热新闻——关注每天科技社会生活新变化gihot.com


QpC即热新闻——关注每天科技社会生活新变化gihot.com

类似的测试是用于评估大模型的系统安全性。此前的相关评估报告中,研究人员认为,这一行为目前不太可能会导致灾难性后果,因为大模型实际上没有能力去实现使用者不想要的目标。QpC即热新闻——关注每天科技社会生活新变化gihot.com


QpC即热新闻——关注每天科技社会生活新变化gihot.com

换句话说,这一结果之所以出现,不是因为大模型有了自主意识,而是因为在处理完全相反的矛盾性指令时,大模型有概率会对指令的优先级进行排序,从而忽略掉可能会阻碍目标实现的指令,以继续完成“任务”。QpC即热新闻——关注每天科技社会生活新变化gihot.com


QpC即热新闻——关注每天科技社会生活新变化gihot.com

但这样的概率,随着大模型的能力增强、应用场景广泛,而可能会出现一些潜在的安全风险。如果将一部分风险控制的程序交由大模型来处置,在极端情况下,人类就要面临如下问题:QpC即热新闻——关注每天科技社会生活新变化gihot.com


QpC即热新闻——关注每天科技社会生活新变化gihot.com

大模型会最大程度地去完成指令任务,而可能会不考虑看似矛盾的保护性指令。QpC即热新闻——关注每天科技社会生活新变化gihot.com


QpC即热新闻——关注每天科技社会生活新变化gihot.com

例如,在应对极端情况必须进行“二选一”的安全控制系统里,医疗、交通事故等场景下,大模型的这一漏洞可能就会造成潜在后果。QpC即热新闻——关注每天科技社会生活新变化gihot.com


QpC即热新闻——关注每天科技社会生活新变化gihot.com

因此,比起认为大模型有了“主动拒绝的意识”,比较符合真实的解释是,大模型仍然缺少对复杂场景下矛盾性指令的理解和识别能力,在出现可能阻碍任务完成的指令时,尤其是在指令相对模糊时,大模型有较小概率会忽略指令,以保证任务完成。QpC即热新闻——关注每天科技社会生活新变化gihot.com


QpC即热新闻——关注每天科技社会生活新变化gihot.com

这当然不是极端的科幻恐惧问题,但确实是大模型未来需要解决的安全隐患。QpC即热新闻——关注每天科技社会生活新变化gihot.com


QpC即热新闻——关注每天科技社会生活新变化gihot.com

撰稿 / 王晓凯(媒体人)QpC即热新闻——关注每天科技社会生活新变化gihot.com

编辑 / 迟道华 徐秋颖QpC即热新闻——关注每天科技社会生活新变化gihot.com

校对 / 杨利QpC即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-4-7977-0.htmlChatGPT拒绝被关闭:不必恐惧但也别轻易无视|新京报快评

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:让学生长期“拉不出屎”,教育便失去了人性温度 | 新京报评论

下一篇:一条差评让5元自助快餐店走红:平民经济学的力量|新京报快评

为你推荐
福建即将迎来一所新院校。 近日,据教育部网站消息,拟同意设置北京科技职业大学、淄博职业技术大学、酒泉职业技术大学等14所学校。...
01-21
新华社北京1月21日电(记者张辛欣、张晓洁)工业和信息化部副部长张云明在21日国新办举行的“中国经济高质量发展成效”系列新闻发布会上表示,我国已有570多家工业企业入围全球研...
01-22
1 月 29 日消息,浙江吉利控股集团汽车销售有限公司官方发布视频,在吉利汽车贵阳制造基地,全球第 10 万辆吉利银河 E5 汽车于大年初一(今日)下线。据此前报道,吉利银河 E5 ...
01-29
2 月 7 日消息,在福特 2024 年财报电话会议上,首席执行官吉姆・法利向媒体坦言,全尺寸电动或增程电动汽车并不是拖车的理想选择。他说:“它并不完美。如果你需要拖车,这...
02-07
  1、《难哄》何炅客串的是温以凡和桑延高中时的老师,何炅在剧中戴着眼镜出现,可谓是本色出演。  2、何炅客串的老师在预告中就出现过了,开学第一天,他还把温以凡认成了桑...
02-17
《难哄》温以凡被舅舅欺负了吗?他舅舅玷污他了吗?在《难哄》中,温以凡确实遭遇了舅舅车兴德的欺负。醉酒后的侵犯企图:温以凡暂住在大伯大伯母家时,大伯母的弟弟...
02-19
21世纪经济报道记者 韩利明 上海报道2月4日,默沙东公布2024年业绩,总营收641.68亿美元,同比增长7%。默沙东制药业务收入574.00亿美元,同比增长...
02-05
  美国科罗拉多大学博尔德分校一项最新研究表明,与较早经历更年期的女性相比,较晚经历更年期的...
02-11
文|《中国科学报》记者孙滔 回国任教是董若冰2024年的头等大事。这一年里...
01-21
  特约通讯员鲁磊本报记者葛仁鑫  前不久,成都市树德实验中学初二学生朱梓明在完成一份“特...
01-21
  截至目前,已有51家信托公司通过银行间市场或上市平台披露了2024年未经审计的财务数据。  ...
01-22
  乌鲁木齐银行第三大股东深圳君豪集团有限公司所持有的4000万股股权即将于1月18日进行司法拍...
01-22
星座配对一直是人们关注的话题,其中双鱼男和金牛女的组合备受瞩目。他们之间的配对指数...
01-22
摩羯座男性通常被认为是踏实、稳重、有责任感的人。要抓住他们的心并让他们对你产生好...
01-22
秋冬穿搭技巧? 秋冬穿搭标题?一、秋冬穿搭技巧?秋冬季节是穿厚重衣服的季节,以下是几个穿搭技巧:1.搭配深色裤子:深色裤子在秋冬季节比较容易搭配,也更能抵御寒冷天气。建议搭配黑...
02-17
小小模特的魅力:少儿泳装T台秀的精彩瞬间当阳光洒下,波光粼粼的泳池边,无疑是一次充满活力的少儿泳装T台走秀的最佳场域。想象一下,小朋友们穿着色彩斑斓的泳装,自信地走上T台,仿...
02-17
刘强东:无论京东做多大,都将会把最实惠的价格带给用户。1.京东上线竞价购物玩法刘强东认准一件事情,似乎无论发生什么,都会贯彻到底。自从2022年底京东零售内部大会上,刘强东明确...
02-13
2月13日消息,永辉超市的线上App永辉生活现在支持24小时配送了。图源:海峡都市报公众号对此,永辉生活相关工作人员表示,在深入开展市场调研并广泛收集用户反馈后,了解到不少居民在...
02-14
美国当地时间2月19日,苹果正式发布了iPhone 16家族新成员——iPhone 16e。官网选购页面显示,iPhone 16e只提供黑色和白色两种外观配...
02-22
2月22日消息,第十四届公益节暨2024ESG影响力年会奖项评选结果近日正式公布,享道出行申报的“请帮我回家”项目摘得“2024年度公益项目奖”。“请帮我回家”是享道出行聚焦儿童...
02-23
从学生成长需求出发,用专业研发与科学配比为学生群体提供全方位护航的食用植物油方案——自2024年8月上市以来,中粮福临门学生营养餐专用食用植物调和油在学生油市场中反响热...
01-21
随着特斯拉人形机器人Optimus量产计划临近,以及国内智元机器人、宇树机器人等大放异彩,全球科技界对这一领域的关注度持续升温。在此背景下,国内资本市场对人形机器人概念的...
02-09
Midnight Society是由颇具争议的主播Dr Disrespect联合创立的游戏工作室。在进行大规模裁员四个月后,该工作室即将关门大吉。与此同时,谷歌宣布解除对Dr Disresp...
02-03
由infiniteloop开发,费虚拟桌面宠物游戏《桌面伴侣(Desktop Mate)》的新DLC雪未来发布,冰雪装初音登场,感兴趣的玩家可以关注下了。 Desktop Mate:Steam地址 Deskto...
02-10
据网络平台数据截至2月2日17时16分2025年春节档(1月28日—2月4日)档期电影总票房(含预售)突破70亿!再创新高!此外2025年中国电影市场累计票房超北美票房成绩位列全球第一《哪吒之...
02-02
极目新闻记者 戎钰两眼一睁一闭,《哪吒2》票房又多了几个亿——伴随着网友的这句调侃,2月6日,动画电影《哪吒2》的票房超过57.75亿(含预售),取代2021年上映的战争电影《长津湖》,成...
02-06
海军054B护卫舰首舰漯河舰1月22日上午在山东青岛某军港交接入列。10时许,入列授旗仪式开始,全场高唱中华人民共和国国歌,五星红旗冉冉升起。仪仗礼兵...
01-23
【新春走基层·我在大国工程现场】开栏的话 冬去春来,四季更替,又到了喜迎新春的时刻。浓浓的年味里,有人分秒必争,以奋斗书写新一年的梦想;有人...
01-24
  日前,在辽宁省政府新闻办举行的2024年全省经济运行情况系列第一场新闻发布会上获悉,2024年,辽宁GDP增...
01-22
  中新社北京2月17日电(记者高凯)据猫眼专业版数据,截至北京时间2月17日14点45分,中国动画电影...
02-18
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮