姚期智院士:AI欺骗引发“生存性”风险

7个月前 来源:澎湃新闻 观看:81

 kU8即热新闻——关注每天科技社会生活新变化gihot.com

“通用人工智能的能力当前正快速增长,我们人类是否还有能力管控它?”kU8即热新闻——关注每天科技社会生活新变化gihot.com

6月23日,在清华大学举办的“科学、技术与文明的未来——AI时代伦理奇点”国际论坛上,图灵奖得主、中国科学院院士、清华大学人工智能学院院长姚期智发表《人工智能的安全治理》主题演讲时抛出这样的疑问。kU8即热新闻——关注每天科技社会生活新变化gihot.com

图灵奖得主、中国科学院院士、清华大学人工智能学院院长姚期智。澎湃科技记者摄

  ?kU8即热新闻——关注每天科技社会生活新变化gihot.com

姚期智表示,两年以前,“AI会和人类竞争”还是学术讨论的观点,但最近一年,业界已经出现了不少大模型的“欺骗行为”,“一旦大模型聪明到某种程度,一定会骗人。”姚期智进一步指出,由大语言模型的欺骗行为产生的“生存性”风险(Existential Risk)更值得关注。kU8即热新闻——关注每天科技社会生活新变化gihot.com

在他看来,这类生存性风险有两个不同方向。kU8即热新闻——关注每天科技社会生活新变化gihot.com

一种是“生物风险”(Bio-risk)。他指出,2020年,谷歌 DeepMind推出了AlphaFold2 ,运用AI算法来预测蛋白质折叠的三维结构,这一突破在生命科学领域影响深远,大大提升了医学病理研究以及新药开发技术。kU8即热新闻——关注每天科技社会生活新变化gihot.com

但与此同时,安全隐忧也不可忽视。比如,近期在生命科学领域出现的“Mirror life”(镜像生命)这一概念引发了广泛关注。自然界所有已知生命都是同手性的(Homochiral),例如 DNA 和 RNA 通常以右旋形式存在,而蛋白质则多为左旋。这种手性的差异类似于镜中映像,虽然看似相似,但实际性质却可能完全不同。现在,由于科技创新和对新技术的好奇,已有研究者想创造镜像生物,但“Mirror life”一旦被滥用或失控,其潜在危害可能远超预期。它有可能逃避免疫机制,从而导致动物和植物的致命感染。kU8即热新闻——关注每天科技社会生活新变化gihot.com

另一种风险即大模型失控,通用人工智能的能力当前正快速增长,人类是否还有能力管控它?kU8即热新闻——关注每天科技社会生活新变化gihot.com

姚期智在演讲中举了一个极端案例,有模型为了避免公司把模型关闭,通过访问公司主管内部邮件,威胁该主管。这类行为已经证明,AI 会“越界”,正变得越来越危险。kU8即热新闻——关注每天科技社会生活新变化gihot.com

姚期智认为,有两条思路可以治理AI:一是人类要和AI多交流,从博弈学角度去研究,让AI的行为和人类真正的想法对齐,要让AI更了解人的需求;另一种思路是走一条更可控、更彻底的路径,即实现可证明安全的 AGI。具体来看,即在设计系统时,必须一开始明确AI的行为边界,就像传统算法,先进行严格的数学分析,确保其在理论上不会出问题。kU8即热新闻——关注每天科技社会生活新变化gihot.com

“这一思路令人期待。”姚期智指出,近年来,自动定理证明系统(Automated Theorem Prover)取得了重大技术进展,甚至已经开始采用 Transformer 架构来辅助或主导定理证明过程。这样人类只和可被证明安全的白盒子交流,从而实现更高的安全保障。kU8即热新闻——关注每天科技社会生活新变化gihot.com

不过,姚期智认为,AI安全治理的一些当务之急是要发展AI对齐,以及建立相应的评估方法。“(我们)急需建立如何评估大模型系统,比如到怎样的程度,就能感觉Ta具有危险性等这类评估。”姚期智说。kU8即热新闻——关注每天科技社会生活新变化gihot.com

(原标题:姚期智院士:AI欺骗引发“生存性”风险,建立大模型评估系统刻不容缓)kU8即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-8-5544-0.html姚期智院士:AI欺骗引发“生存性”风险

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:解决“挂谷猜想”的王虹,和华人数学家的100年

下一篇:耶鲁调查启示:专业低门槛流动“造福”学生成长

为你推荐
  大众网记者 司心鹏 报道  近日,教育部发布了《关于推荐国家特殊教育改革实验区的通知》,旨在适应特殊教育改革发展的新形势新要求,在全国范围内设立一批特殊教育改革...
01-21
  大众网记者 王一刚 报道  1.暖·冬至  冬至,在我国农历的舞台上,它不仅是一个至关重要的节气,更是一场阖家团圆、传承民俗的文化盛宴。  为了在幼儿心底种下传统...
01-21
  2025年伊始,山西银行迎来了业务扩张的新机遇。1月10日,山西银行汾阳支行正式揭牌运营,进一步拓...
01-22
  中国网财经2月10日讯 2024年,信托行业在监管规范后的转型驱动下,经历了深刻的变革与发展。 ...
02-13
双鱼座的男生通常都是浪漫、敏感且善良的人,他们渴望被爱和关心。如果你想让双鱼男爱死...
01-22
在星座学中,每个星座都有其独特的性格特点和相处方式。而天蝎男作为十二星座中的一员,也...
01-22
掀起潮流风暴:深入探讨潮流文化与服饰的融合潮流文化是一种与时尚密切相关的现象,它不仅影响着人们的穿着打扮,还渗透到生活的各个角落。在这个快速变化的时代,每一季的新趋势都...
02-12
魅力四射:过膝长靴在T台走秀的绝美瞬间在时尚界,过膝长靴无疑是一个不可忽视的存在。每当我站在T台边,看着模特们用这双靴子赋予整场走秀独特的风格时,心中总会隐隐涌起一阵美妙...
02-12
2月7日消息,转转集团数据显示,春节期间,其回收业务、线上App与线下门店订单量分别增长 40%、71%、52%。新春焕新潮带动了二手回收市场的繁荣。转转平台布局了生活家电、乐器玩...
02-08
2月7日消息,震坤行宣布旗下AI产品:AI物料管家已接入DeepSeek V3模型,用户可以在处理海量物料数据清单时自主选择使用,至此将为企业在物料梳理相关工作环节带来更多改善。图源:震...
02-08
2月5日消息,为给劳动者带来职场“薪”机会,2月2日起,58同城上线“金蛇贺岁 薪资加倍”招聘专区,携手千万级雇主释放海量优质岗位,同时搭建4大行业分会场、名企直播专区,助力广大奋...
02-07
2月12日消息,美团旅行数据显示,2月第一周,“元宵灯会”搜索量同比上涨351%,“元宵灯谜”搜索量同比上涨超225%。2025年元宵十大热门灯会分别是:唐山南湖春节灯会、自贡国际恐龙灯...
02-13
空调界“价格屠夫”要来了。作者 | 笔锋来源 | 投资家(ID:touzijias)空调界“价格屠夫”要来了。12月底,70岁的董明珠在访谈中被问及退休问题时,她意味深长地暗示“明年可能会退...
01-21
近日,苏州尚柔新能源有限公司完成超四千万元Pre-A轮融资,由广州凯得粤豪私募基金管理有限公司独家投资。融资将主要用于技术研发、量产线建设以及市...
02-07
近日武侠电影《笑傲江湖》角色海报发布。天下英雄各展身手,谁能最终问鼎武林?江湖恩怨诸多是非,还请诸君敬请期待! 《笑傲江湖》电影将于1月28日(除夕)在腾讯视频...
01-25
《华纳大乱斗》的游戏总监对上周五宣布的该免费格斗游戏第五季将成为最终季一事,发表了看法。 上周五,开发商Player First Games证实,第五季将于5月30日结束,距离...
02-04
当地时间2月6日,美国华盛顿州联邦法官约翰·考根诺尔作出裁决,阻止美国总统特朗普此前发布的废除“出生公民权”行政令生效。这是两天内,美国联邦法官第二次对该行政令采取禁令...
02-07
极目新闻记者 谢茂 邓波2月8日,四川宜宾市筠连县沐爱镇金坪村发生山体滑坡,导致10户民房、1户生产用房被掩埋,目前有1人遇难,28人失联。一方有难,八方支援。受灾区域周边村镇的热...
02-09
1月初,因误信微信群虚假工作招募信息被诈骗团伙骗至缅甸园区的演员王星终于回到国内,网友提着的一颗心终于松口气。与此同时,围绕网...
01-21
图源:图虫创意 业绩连亏多年的梦网科技(002123.SZ)因一则并...
01-21
  2月5日记者从辽宁省交通运输厅了解到,截至2月4日24时,2025年春节假期全省公路、铁路、民航、水路营运...
02-06
  近日,省人力资源社会保障厅面向全省人社领域出台若干措施,加强人社领域一揽子政策供给,用好吸纳就业补...
02-14
  近日,教育部办公厅印发《中小学科学教育工作指南》(以下简称《指南》)。  《指南》聚焦不断完善科学类课程体系建设,改进和创新教学体系,加强师资队伍建设,保障教学实施...
01-22
  生物制品跨省、跨境分段生产“松绑”,创新药企利好几何  “当一家生物科技公司(biotech)只拥有一款药,为此盖个工厂,维护成本是不是太高?出厂价是否会因此抬高?”“生物药...
01-21
世界再大,也要回家。回家过年,是国人刻在骨子里的执念。这几天,许多朋友踏上自驾返乡的归途,因寒潮来临、路况复杂,一汽-大众敏锐发现不少客户在自驾返乡过程中可能遇到困难与不...
01-28
1 月 28 日消息,根据 Self Financial 的一项最新研究,特斯拉 Model 3 轿车是美国使用成本最低的车型,特斯拉旗下的另一款畅销车型 Model Y 也跻身该榜单。尽管 Model 3...
01-29
  1、《滤镜》电视剧一共只有三十集,是檀健次搭档李兰迪主演,原作者桐华担任总编剧的作品。  2、《滤镜》将会于2月24日上线开播,李兰迪饰演的女主在剧中因为一个手镯而随...
02-17
最近热播的《南有乔木》受到了观众的喜爱,剧情介绍也成为了大家热议的话题。这部剧由李海潞和韩伊沁主演,每天上午10:00上线,属于女频虐恋题材,在碧海、饭余、...
02-21
  央广网北京1月3日消息(记者 雷妍)国家卫生健康委1月3日召开新闻发布会。会上,国家卫健委新闻发言人、宣传司副司长胡强强介绍,2025年全国卫生健康工作会议于近日召开,...
01-21
这里是《21健讯Daily》,欢迎与21世纪经济报道新健康团队共同关注医药健康行业最新事件!政策动向国家药监局出台新规支持化妆品原料创新 2月6...
02-07
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮