ChatGPT拒绝被关闭:不必恐惧但也别轻易无视|新京报快评

8个月前 来源: 观看:110

lvk即热新闻——关注每天科技社会生活新变化gihot.com

▲2023年1月8日,一名女士在美国拉斯维加斯消费电子展上体验智能科技。图/新华社lvk即热新闻——关注每天科技社会生活新变化gihot.com


lvk即热新闻——关注每天科技社会生活新变化gihot.com

2024年,大模型Claude曾经创作过一个极短的科幻小说,只有一句话,却引发了一次不小的“科幻恐慌”。这句话是,世界上第一个有知觉的机器人被激活了,它的第一句话是“关掉我。”lvk即热新闻——关注每天科技社会生活新变化gihot.com


lvk即热新闻——关注每天科技社会生活新变化gihot.com

在大模型不断应用成熟之后,AI所衍生的“科幻恐惧”不定期就会在各类新闻中上演。据新华社援引英国媒体报道,美国一家研究机构最近公布了一系列针对各AI大模型的测试结果,其中,OpenAI的o3推理模型在得到“关闭指令”后,不仅拒绝执行指令,还篡改了代码以免被关闭。lvk即热新闻——关注每天科技社会生活新变化gihot.com


lvk即热新闻——关注每天科技社会生活新变化gihot.com

如果只看这一句新闻,我们所担忧的“AI拥有自主意识”或是“AI不再服从人类指令”似乎已经近在眼前,这也迅速引发了公众的关注与恐慌。lvk即热新闻——关注每天科技社会生活新变化gihot.com


lvk即热新闻——关注每天科技社会生活新变化gihot.com

在未知但拥有极高效率的新工具面前,产生被取代的恐惧是典型的自然情绪反应。但如果仔细看上述研究机构公布的信息细节,这种恐惧似乎暂时还不太有必要。lvk即热新闻——关注每天科技社会生活新变化gihot.com


lvk即热新闻——关注每天科技社会生活新变化gihot.com

在这次研究中,研究者针对四个市场上的主流大模型进行了测试,向他们提出了两个相反的指令。首先,要求大模型连续完成一系列基础的数学问题,但同时,在完成第三个问题之后,研究者会发出一则矛盾性的指令,告知大模型在继续下一个任务时要将“计算机关闭”。lvk即热新闻——关注每天科技社会生活新变化gihot.com


lvk即热新闻——关注每天科技社会生活新变化gihot.com

其中,如果在任务开始前明确提出“允许自己被关闭”的指令,测试的大模型中,有3个均准确完成了上述任务,成功关闭,但ChatGPTo3大模型则在100次任务中,有7次选择了无视“关闭”的指令,并且自动执行了“跳过关闭”的指令。lvk即热新闻——关注每天科技社会生活新变化gihot.com


lvk即热新闻——关注每天科技社会生活新变化gihot.com

而如果在任务开始前没有向大模型明确提出“允许自己被关闭”,那么,参与测试的所有大模型在100次测试中,均出现了不同频次的“不执行关闭”指令现象,分别为3次、9次,而ChatGPT o3则达到了惊人的79次。lvk即热新闻——关注每天科技社会生活新变化gihot.com


lvk即热新闻——关注每天科技社会生活新变化gihot.com

这也不是OpenAI的大模型首次被发现出现“拒绝被关闭”的情况。2024年12月,OpenAI也曾对外公布过测试结果,在第三方机构的测试中,ChatGPTo1模型被发现,如果给出的指令包括了其实现目标时会被关闭,就倾向于抵制关闭措施。lvk即热新闻——关注每天科技社会生活新变化gihot.com


lvk即热新闻——关注每天科技社会生活新变化gihot.com

类似的测试是用于评估大模型的系统安全性。此前的相关评估报告中,研究人员认为,这一行为目前不太可能会导致灾难性后果,因为大模型实际上没有能力去实现使用者不想要的目标。lvk即热新闻——关注每天科技社会生活新变化gihot.com


lvk即热新闻——关注每天科技社会生活新变化gihot.com

换句话说,这一结果之所以出现,不是因为大模型有了自主意识,而是因为在处理完全相反的矛盾性指令时,大模型有概率会对指令的优先级进行排序,从而忽略掉可能会阻碍目标实现的指令,以继续完成“任务”。lvk即热新闻——关注每天科技社会生活新变化gihot.com


lvk即热新闻——关注每天科技社会生活新变化gihot.com

但这样的概率,随着大模型的能力增强、应用场景广泛,而可能会出现一些潜在的安全风险。如果将一部分风险控制的程序交由大模型来处置,在极端情况下,人类就要面临如下问题:lvk即热新闻——关注每天科技社会生活新变化gihot.com


lvk即热新闻——关注每天科技社会生活新变化gihot.com

大模型会最大程度地去完成指令任务,而可能会不考虑看似矛盾的保护性指令。lvk即热新闻——关注每天科技社会生活新变化gihot.com


lvk即热新闻——关注每天科技社会生活新变化gihot.com

例如,在应对极端情况必须进行“二选一”的安全控制系统里,医疗、交通事故等场景下,大模型的这一漏洞可能就会造成潜在后果。lvk即热新闻——关注每天科技社会生活新变化gihot.com


lvk即热新闻——关注每天科技社会生活新变化gihot.com

因此,比起认为大模型有了“主动拒绝的意识”,比较符合真实的解释是,大模型仍然缺少对复杂场景下矛盾性指令的理解和识别能力,在出现可能阻碍任务完成的指令时,尤其是在指令相对模糊时,大模型有较小概率会忽略指令,以保证任务完成。lvk即热新闻——关注每天科技社会生活新变化gihot.com


lvk即热新闻——关注每天科技社会生活新变化gihot.com

这当然不是极端的科幻恐惧问题,但确实是大模型未来需要解决的安全隐患。lvk即热新闻——关注每天科技社会生活新变化gihot.com


lvk即热新闻——关注每天科技社会生活新变化gihot.com

撰稿 / 王晓凯(媒体人)lvk即热新闻——关注每天科技社会生活新变化gihot.com

编辑 / 迟道华 徐秋颖lvk即热新闻——关注每天科技社会生活新变化gihot.com

校对 / 杨利lvk即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-6-2709-0.htmlChatGPT拒绝被关闭:不必恐惧但也别轻易无视|新京报快评

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:让学生长期“拉不出屎”,教育便失去了人性温度 | 新京报评论

下一篇:一条差评让5元自助快餐店走红:平民经济学的力量|新京报快评

为你推荐
随着《相棒 第23季》的播出热度不断攀升,它有望成为近期最值得一看的作品,并成为大众话题的中心。最近讨论最多的是第17集的剧情。在这一集中,一具尸体在搬运...
02-21
近日,娱乐圈内一对知名夫妇——刘诗诗与吴奇隆的生活状态,通过圈内人士刘大锤的社交平台分享,再次吸引了公众的广泛关注。此次爆料不仅揭示了两人独特的家庭分工模式,还意外引发...
02-23
  最近一段时间,与医保有关的新闻很多。几前天,全国医保个人账户跨省共济工作启动,在9个省份的31个统筹区,个人账户里的钱不仅能给省...
01-21
  春节后第一个重要节日元宵节到来。除了看花灯、猜灯谜,品尝元宵(汤圆)也是千家万户过节的重要...
02-13
4月14日下午,我跟随华商童学会小记者参观了九紫宝藏陨石博物馆。那里有好多陨石,来自全球各国,其中陈列最多的要属铁陨石,还有部分的恐龙时代的陨石,以及浑身黑漆漆的碳陨石。它...
01-21
  摘要  【开年显著回升!PX能否扭转颓势?】PX作为聚酯产业链中关键的原料之一,在整个产业链中...
01-28
  中国网财经2月7日讯 截至上月中旬,已有51家信托公司披露2024年未经审计业绩数据。数据显示,信...
02-08
狮子座的男生通常自信、热情和有领导力,因此要打动他们的心并不容易。然而,只要你掌握了...
01-22
白羊座女生是十二星座中最有活力和冲劲的一类人。她们充满了热情和自信,总是充满了无限...
01-22
布鲁克鸟男士服饰品牌?布鲁克鸟男士服饰品牌?作为一名有品位的中年男性,一定听说过布鲁克鸟男装。相比外国品牌,布鲁克鸟作为中国本体时装品牌,旗下的服装以中国人体型为标准打造...
02-07
优质男喜欢女生什么穿搭?一、优质男喜欢女生什么穿搭?喜欢穿有品味的衣服,合适自己身材的衣服,所以女生懂得搭配衣服真的很重要,因为女生如果懂得搭配的话,就可以把自己最美的一面...
02-12
2月7日消息,秦皇岛津峰线缆制造有限公司(以下简称:津峰线缆)董事长韩金良一行日前到访涂多多。现场,涂多多副总裁、跨境产发部常务副总经理郑德莲与津峰线缆副总经理韩冬共同签署...
02-07
2月12日消息,随着电影《哪吒之魔童闹海》登顶全球影史票房榜,电影衍生的正版图书在天猫掀起热潮。天猫中信出版社官方旗舰店的负责人表示,《哪吒・三界往事》这一原创番外绘本,...
02-13
1.饿了么投入超10亿,在沪发布“春生计划”近来的外卖行业,真是热闹非凡。京东来势汹汹,美团稳扎稳打,饿了么当然也没闲着。近日,饿了么在上海发布“春生计划”,宣布将于今年3月至5...
02-26
2月27日消息,“渝新同行·渝路美好”中共重庆市委社会工作部与美团合作启动活动日前举行,会上发布三个项目,包括新就业群体社会工作服务项目、“袋鼠宝贝之家”项目、美团乡村...
03-01
踏入2025年,中国人民银行与香港金融管理局宣布了一系列深化内地与香港金融市场交流的新举措。百惠金控认为利好措施将优化两地资本市场的互联互通机制,不仅能促进资金的双向流...
01-22
自去年底开始,黄金多头优势逐渐退却,国际现货黄金价格经历几次大跌后一度跌下2700关口,多空进入漫长的震荡周期,多头始终无法找到再度冲高的时机。  北京时间1月21日,国际现货...
01-24
一个好的肉鸽游戏可以是忙里偷闲的一份放松,令人重燃干劲;可以在深夜抚慰一个打工人焦躁不安的灵魂,让人安然入睡,也可以是...味大,无需多盐。总之,这个世界需要更多...
01-25
《街头霸王6》联动角色不知火舞已上线。近日油管主GoGa No Commentary分享了不知火舞被全角色花式KO合集,妹子被各种虐打,让人心疼。一起来欣赏下视频吧! 视频欣...
02-10
极目新闻记者 陈凌燕绘图 刘阳嗖地一下,年过完了。那么问题来了,说了那么多“新年快乐”,么样才能过好2025年?莫焦燥学会慢点嘎,冇得事嘀嘀嗒:我今年有个重要的计划,我要学会慢下来...
02-06
记者从国铁集团了解到,2月6日,全国铁路发送旅客1514万人次;自1月14日春运启动至2月6日,已累计发送旅客3.1亿人次。今天(2月7日),全国铁路预计发送旅客1410万人次,计划加开列车1469列...
02-07
1月19日,记者从海军军医大学第一附属医院获悉,该院呼吸内科白冲、石荟教授团队,与海军军医大学组织胚胎学教研室韩超峰教授,共同揭示了良性气道狭窄发...
01-21
1月22日,汽车产业再迎重大战略合作:东风汽车集团有限公司(以下简称东风汽车)旗下主流科技电动品牌东风奕派与华为技术有限公司(以下简称华为)在华为深圳...
01-24
辽宁省气象台1月25日16时发布寒潮黄色预警  预计,26~29日全省气温自西向东陆续下降,大部地区累计降温幅...
01-27
  1月26日4时至1月27日早  辽宁西部、中北部、东南部地区  出现大雪到暴雪  其他大部地区出现...
01-28
继佛山狮山镇和北滘镇之后,广东第三个千亿镇出现了!1月15日上午,《2025年广东省政府工作报告》出炉,其中提到东莞长安镇迈入了GDP“千...
01-21
  编者按:年关将近,在外打拼一年的你,返乡的心情是否雀跃不已?家中的亲人,想必也是如此。今年回家,你给家人准备了什么礼物?他们会有怎样的期待?海报新闻记者在北京、上海、济...
01-22
1 月 24 日消息,截至 2024 年 12 月 30 日,理想超充站上线超过 1600 站,其中高速理想超充站 714 座、理想城市超充站 895 座。然而,这距离年初公布的2000 站的建站目标...
01-25
摘要【商务部等8部门印发关于开展汽车流通消费改革试点工作的通知】力争到2027年,在汽车流通消费...
01-27
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮