用魔法打败魔法,南开大学最新成果让AI“识破”AI

7个月前 来源:中国新闻网 观看:73

 3n7即热新闻——关注每天科技社会生活新变化gihot.com

中新网天津8月14日电(记者 孙玲玲)记者13日从南开大学获悉,近日,南开大学计算机学院媒体计算实验室取得最新研究成果,不仅从评估的角度揭示了现有AI检测方法的性能不足,并创新性地提出了“直接差异学习”(Direct Discrepancy Learning,DDL)优化策略,教会AI用“火眼金睛”辨别人机不同,实现AI检测性能的巨大突破。相关成果论文已被计算机多媒体领域国际顶级会议ACM MM2025(ACM International Conference on Multimedia)接收。3n7即热新闻——关注每天科技社会生活新变化gihot.com

图为南开大学研究团队提出的DetectAnyLLM检测框架以及MIRAGE基准数据集亮点全析。(南开大学 供图)

  ?3n7即热新闻——关注每天科技社会生活新变化gihot.com

近日,OpenAI发布新一代人工智能模型GPT-5,再次引发全球关注。随着DeepSeek、ChatGPT、通义千问、豆包等AIGC大模型逐渐从“新奇玩具”变成学习、工作中不可或缺的“生产力工具”,其伴生问题也日益凸显:AI经常会“一本正经地胡说八道”,生成看似合理的虚假信息,造成“AI幻觉”;依赖AI工具代写作业甚至毕业论文,极大冲击着学术诚信和规范;论文AI率检测系统有待完善,论文被误判的问题时有发生……如何精准识别AI生成内容,成为亟待解决的热点问题。3n7即热新闻——关注每天科技社会生活新变化gihot.com

据了解,目前AI生成内容检测主要有两种路线,一种是“基于训练的检测方法”,使用特定数据训练一个专用的分类模型;另一种是“零样本检测方法”,直接使用一个预训练的语言模型并设计某种分类标准进行分类。3n7即热新闻——关注每天科技社会生活新变化gihot.com

图为AI生成内容检测示意图。(南开大学 供图)

  ?3n7即热新闻——关注每天科技社会生活新变化gihot.com

多项研究表明,现有检测方法在应对复杂的现实场景时常显不足。此前也曾有权威媒体报道,《荷塘月色》《流浪地球》等经典作品被某常用论文AI率检测系统检出高AI率。3n7即热新闻——关注每天科技社会生活新变化gihot.com

为何现有的AI检测工具会“误判”?论文第一作者、南开大学计算机学院计算机科学卓越班2023级本科生付嘉晨解释道:“如果把AI文本检测比作一场考试,检测器的训练数据等同于日常练习题,现有检测方法是机械刷题、死记硬背答题的固定套路,难以学会答题逻辑,一旦遇到全新难题,准确率就会显著下降。”3n7即热新闻——关注每天科技社会生活新变化gihot.com

“要想实现通用检测,理论上需收集所有大模型的数据进行训练,但在大模型迭代飞速的今天几乎不可能。”付嘉晨说,让检测器真正学会举一反三,即提升检测器的泛化性能,是提升AI文本检测性能的关键。3n7即热新闻——关注每天科技社会生活新变化gihot.com

为此,研究团队提出了DDL方法另辟蹊径,通过直接优化模型预测的文本条件概率差异与人为设定的目标值之间的差距,帮助模型学习AI文本检测的内在知识,可以精准捕捉人机文本间的深层语义差异,从而大幅提升检测器的泛化能力与鲁棒性。3n7即热新闻——关注每天科技社会生活新变化gihot.com

“使用DDL训练得到的检测器如同有了‘火眼金睛’,即便只‘学习’过DeepSeek-R1的文本,也能精准识别像GPT-5这样最新大模型生成的内容。”付嘉晨说。3n7即热新闻——关注每天科技社会生活新变化gihot.com

团队还提出了一个全面的测试基准数据集MIRAGE,使用13种主流的商用大模型(如豆包、DeepSeek、Kimi等)以及4种先进的开源大模型(如Qwen等),从AI生成、润色、重写三个角度构造了接近十万条人类-AI文本对。3n7即热新闻——关注每天科技社会生活新变化gihot.com

“MIRAGE是目前唯一聚焦于对商用大语言模型检测的基准数据集。直观地说,之前的基准数据集是由少而且能力简单的大模型命题出卷,而MIRAGE是17个能力强大的大模型联合命题,形成一套高难度、又有代表性的检测试卷。”论文通讯作者、南开大学计算机学院副教授郭春乐说。3n7即热新闻——关注每天科技社会生活新变化gihot.com

在MIRAGE的测试结果显示,现有检测器的准确率从在简单数据集上的90%骤降至约60%;而使用DDL训练的检测器仍保持85%以上的准确率。与斯坦福大学提出的DetectGPT相比,性能相对提升71.62%;与马里兰大学、卡内基梅隆大学等共同提出的Binoculars方法相比,性能相对提升68.03%。3n7即热新闻——关注每天科技社会生活新变化gihot.com

“AIGC发展日新月异,我们将持续迭代升级评估基准和技术,致力于实现更快、更准、更低成本的AI生成文本检测,以AI之力,让每一篇成果更出彩。”研究团队负责人、南开大学计算机学院教授李重仪说。3n7即热新闻——关注每天科技社会生活新变化gihot.com

(原标题:“用魔法打败魔法” 南开大学最新研究成果让AI“识破”AI)3n7即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-8-6441-0.html用魔法打败魔法,南开大学最新成果让AI“识破”AI

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:熊宇杰被提名任安徽师范大学校长

下一篇:重大突破! 青岛科技大学在《Nature》发表高水平论文

为你推荐
2025年刚过去半个多月,北京大学周欢萍教授已经连续两度在国际顶级学术刊物《...
01-21
1月17日下午2点,东北大学2024创业项目座谈交流会暨第十九批(2025年)创业类项目实施培训会在东北大学南湖校...
01-21
  原标题:盘点2024持牌消金(一)|行业进入纵深发展:头部“缩表”、腰部“赶超”,不良资产加速“甩卖...
01-22
  原标题:又见共管保险箱被撬!浙金信托一产品爆雷后被监管认定存在四大问题  来源:界面新闻 ...
01-28
每个人都有自己的喜好和偏好,而星座也可以给我们一些线索,帮助我们了解一个人的性格特点...
01-22
白羊座的男生通常充满活力、热情和冲动,他们喜欢追求刺激和新鲜感。如果你想让一个白羊...
01-22
精彩纷呈的男装T台走秀:时尚与艺术的完美交融在时尚界,T台走秀是一场视觉盛宴,不仅是品牌展示新季服装的机会,更是模特与设计师艺术灵感的碰撞。今天,我想和大家分享一些关于男装...
02-07
肚子大的男生穿搭? 肚子大男生穿搭初秋?一、肚子大的男生穿搭?一、拒绝太宽松有啤酒肚的男士,看到肚子上那一坨坨油腻腻的肥肉,内心是拒绝的,所以不愿意穿修身款显出自己的啤酒肚,...
02-12
2月10日消息,1688在京启动招商活动,本次招商的对象是产业带源头厂商,重点是正经历厂二代接班、加速数字化转型、拥抱AI技术应用和尝试跨境市场的工厂,尤其是具备小单快返和轻定...
02-11
2月14日消息,苏宁易购与美的召开2025年度战略合作会议,加力投入以旧换新。锚定年度200亿战略目标,双方将深化联合创新、服务体验、终端运营等方面合作,上新超70款新品。抢滩春季...
02-15
据红星新闻报道,2月5日,现货黄金再创新纪录,摸高至2859美元/盎司。COMEX黄金也在盘中创下历史新高,最高涨至2886美元/盎司。国内黄金...
02-07
3月1日消息,在北京大学国家发展研究院【承泽论坛】第32期,智联招聘集团总裁张月佳指出,在数字技术的加持下,更多职场人有机会成为“超级个体”,而HR是寻找与培养超级个体的关键。...
03-01
近日,华力创科学宣布完成数千万元A+轮融资,本轮融资由金属3D打印领域头部上市公司铂力特独家投资。据披露,本轮融资所募集的资金将专注于深挖高性能光学多模态感知技术,结合金属...
01-24
近日,苏州尚柔新能源有限公司完成超四千万元Pre-A轮融资,由广州凯得粤豪私募基金管理有限公司独家投资。融资将主要用于技术研发、量产线建设以及市...
02-07
RTX 5090和RTX 5080显卡在今天正式开卖,由于货源稀少,性能强劲,一上市很快就被一扫而空,导致很多潜在买家只能“望卡兴叹”。 当然,这些抢显卡的人很多并不是真正...
02-03
今日(2月14日),高达对战游戏《机动战士 GUNDAM SEED 激斗命运 复刻版》开启预购,国区售价198元,预计于2025年5月22日发售,感兴趣的玩家可以点击此处进入商店页面。 ...
02-15
新华社北京2月2日电 近日,在世界乒乓球职业大联盟(WTT)新加坡大满贯赛正赛开始前,中国乒乓球队、中国乒协围绕世界排名及WTT系列赛事的赛制,与国际乒联、WTT核心团队进行了交流。...
02-03
2月4日,泰国副总理兼国防部长普坦表示,将于当天下令对泰缅边境的缅甸地区断电,并警告如有怠慢者将被调职。△泰国副总理兼国防部长普坦(左)泰国总理佩通坦(中)此外,泰国政府当天举行...
02-04
最近,“静电颜色挑战”在网络上走红,大量网友跟风模仿。许多社交媒体博主称,当两个相爱的人接触时,如果产生的静电呈粉色,那么说明他们之间是“真爱”,而...
01-23
  中新网西安2月8日电(记者阿琳娜)记者8日从西北大学文化遗产学院获悉,通过对唐高祖李渊侄子、...
02-11
  你见过雪后的七彩丹霞吗?  刚下过雪的景致,并不令人称奇。只是白雪覆盖了起伏的山峦,与别处...
02-14
最近,不少网友发现,自己在春运开始前买好机票,结果却在春节前降价了……据报道,1月19日,有游客向记者反映,近日重新预订了一家三口春节期间从北京前往珠海的航班,同样的航班,相比半...
01-22
1 月 21 日消息,凯翼汽车宣布旗下“2024 款改款”凯翼昆仑 iHD插混SUV 现已上市,新车共推出 9 款车型,指导价格区间为 10.99 万-17.99 万元,整理具体定价信息如下:车型定...
01-22
1 月 23 日消息,从国家市场监督管理总局获悉,我国联合德国、日本、韩国、英国等国共同研制的多项智能网联汽车国际标准提案在国际标准化组织(ISO)成功立项,包括 4 项驾驶...
01-24
近日,多部新剧陆续推出,其中备受期待的《夜访吸血鬼第二季》也终于与观众见面。该剧上映后引起了广泛讨论,在各大社交平台上成为了热门话题。接下来将对《夜访...
02-20
最近,《陌上又花开》在短视频软件上引起了广泛关注,无论是颜值、演技还是剧情,都迅速吸引了观众的目光。剧中赵大爷的故事也成为了热议话题。马春秀细心照料下...
02-22
  近期,流感等呼吸道疾病进入高发期。全国流感病毒阳性率上升,尤以甲流多发。  中国疾控中心1...
01-21
2月3日,小S(徐熙娣)经纪人向媒体证实,中国台湾知名女演员大S(徐熙媛)在日本旅游期间因患流感并发肺炎不幸离世。据报道,由于大S家人都在日本,因此...
02-04
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮