ChatGPT拒绝被关闭:不必恐惧但也别轻易无视|新京报快评

1周前 来源: 观看:20

JhO即热新闻——关注每天科技社会生活新变化gihot.com

▲2023年1月8日,一名女士在美国拉斯维加斯消费电子展上体验智能科技。图/新华社JhO即热新闻——关注每天科技社会生活新变化gihot.com


JhO即热新闻——关注每天科技社会生活新变化gihot.com

2024年,大模型Claude曾经创作过一个极短的科幻小说,只有一句话,却引发了一次不小的“科幻恐慌”。这句话是,世界上第一个有知觉的机器人被激活了,它的第一句话是“关掉我。”JhO即热新闻——关注每天科技社会生活新变化gihot.com


JhO即热新闻——关注每天科技社会生活新变化gihot.com

在大模型不断应用成熟之后,AI所衍生的“科幻恐惧”不定期就会在各类新闻中上演。据新华社援引英国媒体报道,美国一家研究机构最近公布了一系列针对各AI大模型的测试结果,其中,OpenAI的o3推理模型在得到“关闭指令”后,不仅拒绝执行指令,还篡改了代码以免被关闭。JhO即热新闻——关注每天科技社会生活新变化gihot.com


JhO即热新闻——关注每天科技社会生活新变化gihot.com

如果只看这一句新闻,我们所担忧的“AI拥有自主意识”或是“AI不再服从人类指令”似乎已经近在眼前,这也迅速引发了公众的关注与恐慌。JhO即热新闻——关注每天科技社会生活新变化gihot.com


JhO即热新闻——关注每天科技社会生活新变化gihot.com

在未知但拥有极高效率的新工具面前,产生被取代的恐惧是典型的自然情绪反应。但如果仔细看上述研究机构公布的信息细节,这种恐惧似乎暂时还不太有必要。JhO即热新闻——关注每天科技社会生活新变化gihot.com


JhO即热新闻——关注每天科技社会生活新变化gihot.com

在这次研究中,研究者针对四个市场上的主流大模型进行了测试,向他们提出了两个相反的指令。首先,要求大模型连续完成一系列基础的数学问题,但同时,在完成第三个问题之后,研究者会发出一则矛盾性的指令,告知大模型在继续下一个任务时要将“计算机关闭”。JhO即热新闻——关注每天科技社会生活新变化gihot.com


JhO即热新闻——关注每天科技社会生活新变化gihot.com

其中,如果在任务开始前明确提出“允许自己被关闭”的指令,测试的大模型中,有3个均准确完成了上述任务,成功关闭,但ChatGPTo3大模型则在100次任务中,有7次选择了无视“关闭”的指令,并且自动执行了“跳过关闭”的指令。JhO即热新闻——关注每天科技社会生活新变化gihot.com


JhO即热新闻——关注每天科技社会生活新变化gihot.com

而如果在任务开始前没有向大模型明确提出“允许自己被关闭”,那么,参与测试的所有大模型在100次测试中,均出现了不同频次的“不执行关闭”指令现象,分别为3次、9次,而ChatGPT o3则达到了惊人的79次。JhO即热新闻——关注每天科技社会生活新变化gihot.com


JhO即热新闻——关注每天科技社会生活新变化gihot.com

这也不是OpenAI的大模型首次被发现出现“拒绝被关闭”的情况。2024年12月,OpenAI也曾对外公布过测试结果,在第三方机构的测试中,ChatGPTo1模型被发现,如果给出的指令包括了其实现目标时会被关闭,就倾向于抵制关闭措施。JhO即热新闻——关注每天科技社会生活新变化gihot.com


JhO即热新闻——关注每天科技社会生活新变化gihot.com

类似的测试是用于评估大模型的系统安全性。此前的相关评估报告中,研究人员认为,这一行为目前不太可能会导致灾难性后果,因为大模型实际上没有能力去实现使用者不想要的目标。JhO即热新闻——关注每天科技社会生活新变化gihot.com


JhO即热新闻——关注每天科技社会生活新变化gihot.com

换句话说,这一结果之所以出现,不是因为大模型有了自主意识,而是因为在处理完全相反的矛盾性指令时,大模型有概率会对指令的优先级进行排序,从而忽略掉可能会阻碍目标实现的指令,以继续完成“任务”。JhO即热新闻——关注每天科技社会生活新变化gihot.com


JhO即热新闻——关注每天科技社会生活新变化gihot.com

但这样的概率,随着大模型的能力增强、应用场景广泛,而可能会出现一些潜在的安全风险。如果将一部分风险控制的程序交由大模型来处置,在极端情况下,人类就要面临如下问题:JhO即热新闻——关注每天科技社会生活新变化gihot.com


JhO即热新闻——关注每天科技社会生活新变化gihot.com

大模型会最大程度地去完成指令任务,而可能会不考虑看似矛盾的保护性指令。JhO即热新闻——关注每天科技社会生活新变化gihot.com


JhO即热新闻——关注每天科技社会生活新变化gihot.com

例如,在应对极端情况必须进行“二选一”的安全控制系统里,医疗、交通事故等场景下,大模型的这一漏洞可能就会造成潜在后果。JhO即热新闻——关注每天科技社会生活新变化gihot.com


JhO即热新闻——关注每天科技社会生活新变化gihot.com

因此,比起认为大模型有了“主动拒绝的意识”,比较符合真实的解释是,大模型仍然缺少对复杂场景下矛盾性指令的理解和识别能力,在出现可能阻碍任务完成的指令时,尤其是在指令相对模糊时,大模型有较小概率会忽略指令,以保证任务完成。JhO即热新闻——关注每天科技社会生活新变化gihot.com


JhO即热新闻——关注每天科技社会生活新变化gihot.com

这当然不是极端的科幻恐惧问题,但确实是大模型未来需要解决的安全隐患。JhO即热新闻——关注每天科技社会生活新变化gihot.com


JhO即热新闻——关注每天科技社会生活新变化gihot.com

撰稿 / 王晓凯(媒体人)JhO即热新闻——关注每天科技社会生活新变化gihot.com

编辑 / 迟道华 徐秋颖JhO即热新闻——关注每天科技社会生活新变化gihot.com

校对 / 杨利JhO即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-6-2709-0.htmlChatGPT拒绝被关闭:不必恐惧但也别轻易无视|新京报快评

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:让学生长期“拉不出屎”,教育便失去了人性温度 | 新京报评论

下一篇:一条差评让5元自助快餐店走红:平民经济学的力量|新京报快评

为你推荐
  1、《滤镜》电视剧一共只有三十集,是檀健次搭档李兰迪主演,原作者桐华担任总编剧的作品。  2、《滤镜》将会于2月24日上线开播,李兰迪饰演的女主在剧中因为一个手镯而随...
02-17
在娱乐圈这个星光灿烂的舞台上,何炅以其非凡的主持能力和温文尔雅的形象,赢得了广泛的认可与尊敬。更令人钦佩的是,他展现出的自律精神和健康的身体状态,成为了公众关注的焦点。...
02-22
21世纪经济报道记者季媛媛 上海报道 2月6日,阿斯利康公布了全年财报业绩。数据显示,2024年,阿斯利康业绩表现亮眼,总营收实现21%增长,达到541...
02-07
21世纪经济报道记者 闫硕 北京报道脑机接口领域再传利好消息。2月10日,据阶梯医疗StairMed微信公众号,近日,阶梯医疗宣布完成3.5亿元人民币B...
02-13
2025年上半年全国计算机等级考试将于2025年3月29日至31日举行,报名工作即将开始,现将有关事项公告如下:一...
01-21
  大众网记者 王一刚 报道  这个冬至,让我们和艺术撞个满怀……  为全面贯彻教育部发布的《关于全面实施学校美育浸润行动的通知》,“以美育浸润学生、以美育浸润教...
01-21
  原标题:中铁信托因股东损害公司债权人利益责任纠纷被告,5月27日在成都市武侯区人民法院审理 ...
01-22
  四家上市险企业绩预增  股债共振推动利润预期改善  □记者 张小洁 北京报道  中国太...
02-05
狮子男是十二星座中最有自信和魅力的一位,他们对于爱情充满了激情和渴望。当一个狮子男...
01-22
水瓶座男生通常都是聪明、独立和理性的人,他们在感情方面也有着自己独特的表达方式。如...
01-22
布鲁克鸟男士服饰品牌?布鲁克鸟男士服饰品牌?作为一名有品位的中年男性,一定听说过布鲁克鸟男装。相比外国品牌,布鲁克鸟作为中国本体时装品牌,旗下的服装以中国人体型为标准打造...
02-07
女明星穿衣出现意外:时尚背后的尴尬瞬间在这个充满光鲜亮丽的娱乐圈,**女明星**的穿衣风格备受瞩目。每一次红毯事件,不仅是对她们时尚品味的考验,更是一个个可能出现尴尬瞬间的...
02-17
1月25日消息,香港位元堂药业有限公司CEO陈杰文(Raymond Chan)近日率队访问怡亚通总部,双方围绕未来业务合作展开深入交流。最终,双方正式达成战略合作关系,致力于共同打造香港中成...
02-07
1月24日消息,苏宁易采云近日与广东德玛仕智能厨房设备有限公司达成战略合作,未来双方将强化商用厨房数字化采购建设,共拓千亿商厨市场。未来双方将充分集成AI人工智能、物联网...
02-07
美国当地时间2月19日,苹果正式发布了iPhone 16家族新成员——iPhone 16e。官网选购页面显示,iPhone 16e只提供黑色和白色两种外观配...
02-22
3月3日消息,京东互联网医院皮肤医院近日上线罕见病专区,包括用药绿色通道、疾病知识科普等服务。京东互联网医院皮肤医院利用AI技术实现精准分诊,用户在京东APP搜索“皮肤医院...
03-04
全球性金融券商集团英国EBC Group平台始终致力于以领先生态,与全球交易者共塑交易的未来。 自第一届交易大赛起,为赤忱的热爱和卓越的才华提供舞台,在全球内寻找交易好手以赋能...
01-24
2月5日,有投资者在投资者互动平台向东峰集团提问:公司公告预计亏损5亿元左右,感觉公司今年在洗澡。国资入主后是否会调整并购策略?未来准备如何提升公司经营业绩?东峰集团在投资...
02-09
今日(1月31日),米哈游官方公布《崩坏:星穹铁道》阿格莱雅角色PV——「致命浪漫」,我们会重逢的,朋友。无论你行向何处,奥赫玛的大门始终为英雄敞开。 宣传片: 中文CV...
02-03
《华纳大乱斗》的游戏总监对上周五宣布的该免费格斗游戏第五季将成为最终季一事,发表了看法。 上周五,开发商Player First Games证实,第五季将于5月30日结束,距离...
02-04
极目新闻记者 谢茂 邓波2月8日,四川宜宾市筠连县沐爱镇金坪村发生山体滑坡,导致10户民房、1户生产用房被掩埋,目前有1人遇难,28人失联。一方有难,八方支援。受灾区域周边村镇的热...
02-09
春运期间,火车站客流增大。旅客携带行李换乘电梯时一定要关注人身安全,避免意外。近日,铁路公安民警就及时救助了多名从扶梯上摔下的旅客。近日,旅客张女士来到徐州东站准备乘扶...
02-09
  IT之家1月19日消息,闻泰科技昨日发布公告,预计2024年度实现归属于母公司所有者的净亏损30亿元...
01-21
年关将至,A股进入2024业绩预告披露的密集期,半导体行业也不例外。1月15日晚,乐鑫科技(688018.SH)发布业绩预告,公司2024年年度实现营业...
01-21
  近日,载有南美进口水果的“演奏者”轮在大连集装箱码头开启卸船作业,装有4400吨新鲜车厘子和200吨蓝...
01-21
  1月14日,2025年除夕火车票正式开售。  2025年春节从1月28日(除夕)开始,至2月4日(正月初七)...
01-21
新闻记者 兰莎通讯员 陈强 吴佳倩2025年1月20日,备受瞩目的《手机、平板、智能手表(手环)购新补贴实施方案》手机国家补贴政策正式落地,不少湖北市民走进当地通信运营商营业厅挑...
01-21
  免签政策试行两月来,上海的韩国入境游客订单同比增长超2倍――  “周五下班去中国”,韩国人为何热衷游上海  阅读提示  因包容性好、服务水准高和语言障碍低等,上海...
01-21
2 月 2 日消息,比亚迪今日公布 1 月销售新车300538 辆,乘用车销售 296446 辆同比增长 47.5%。随后博主 @小迪快报 带来了具体销量明细。汇总各车型销量信息如下:王朝网...
02-03
2 月 3 日消息,特斯拉官网显示,特斯拉现已在美国上线推出针对FSD用户的保险优惠政策,车主在车辆激活FSD系统并保持90分以上安全驾驶评分的前提下,最高可获得 7 折-8 折...
02-04
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮