AI成为数学家得力助手还要多久

8个月前 来源:新华网 观看:103

从计算机科学到医学再到国家安全,数学是众多关键应用的基石,但数学领域的进步可能需要数年时间才能实现。4aR即热新闻——关注每天科技社会生活新变化gihot.com

几百年来,数学家使用的工具依然简朴:一张纸、一支笔。他们凭借逻辑与灵感,在符号的迷宫中寻找通往真理的路径。4aR即热新闻——关注每天科技社会生活新变化gihot.com

为了打破这一局面,美国国防高级研究计划局今年4月启动了“指数性数学”计划,旨在开发一种能极大提升数学研究效率的人工智能(AI)“合著者”系统。4aR即热新闻——关注每天科技社会生活新变化gihot.com

几十年来,数学家借助计算机进行辅助计算或验证命题,如今的AI或许能更上层楼,挑战那些人类长年未解的难题。不过,从能解高中题的AI,到能协助攻克前沿数学难关的AI,中间仍隔着一道鸿沟。4aR即热新闻——关注每天科技社会生活新变化gihot.com

解决重大难题仍力不从心4aR即热新闻——关注每天科技社会生活新变化gihot.com

大型语言模型(LLM)并不擅长数学。它们常常出现“幻觉”,甚至可能被误导相信2+2=5。但新一代大型推理模型,如OpenAI的o3、Anthropic的Claude 4 Thinking等,展现出的进步令数学家眼前一亮。4aR即热新闻——关注每天科技社会生活新变化gihot.com

今年,这些模型在美国数学邀请赛中的表现接近优秀高中生水平。不同于过去“一锤定音”式的输出,这些模型开始尝试模拟数学家逐步推理的思考过程。4aR即热新闻——关注每天科技社会生活新变化gihot.com

同时,一些将LLM与某种事实核查系统相结合的新型混合模型也取得了突破。例如,谷歌“深度思维”的AlphaProof系统将语言模型与棋类AI——AlphaZero结合,成为首个取得与国际数学奥林匹克竞赛银牌得主成绩相当的系统。今年5月,谷歌的AlphaEvolve模型更进一步,在多个长期未解的数学与计算难题上找到优于人类现有方案的解法。4aR即热新闻——关注每天科技社会生活新变化gihot.com

美国《麻省理工科技评论》指出,尽管这些AI成绩亮眼,但专家们普遍认为,它们仍不具备真正的协助科研的能力。竞赛题虽难,却更像是智力游戏,有一定“套路”。真正的数学研究则更开放、更复杂。面对“P vs NP”“黎曼猜想”等重大难题时,AI仍力不从心。4aR即热新闻——关注每天科技社会生活新变化gihot.com

为了更准确地评估AI的能力,初创公司Epoch AI去年推出了FrontierMath测试,联合60多位数学家设计出全新高难度题目,避开模型已见过的训练数据,结果LLM几乎集体“交白卷”。4aR即热新闻——关注每天科技社会生活新变化gihot.com

这些测试表明,AI在数学道路上虽已迈步,但离“合著者”角色仍有很长一段路要走。4aR即热新闻——关注每天科技社会生活新变化gihot.com

需攻克“超长推理链”4aR即热新闻——关注每天科技社会生活新变化gihot.com

仔细观察数学问题会发现,它们在某些方面类似:解决问题需完成一系列连续步骤,关键在于找到这些步骤。4aR即热新闻——关注每天科技社会生活新变化gihot.com

美国加州理工学院谢尔盖·古科夫指出,困难的差异往往体现在路径的长度上。高中数学可能只需10到40步,而像黎曼猜想这样的难题,路径可能长达百万步。4aR即热新闻——关注每天科技社会生活新变化gihot.com

这类“超长路径”极难处理。就像下围棋时寻找一条制胜序列,AI必须在指数级增长的可能路径中找到正确解法。而在数学中,这个复杂度要远超棋类游戏。4aR即热新闻——关注每天科技社会生活新变化gihot.com

据物理学家组织网今年2月报道,为应对这一挑战,古科夫团队开发了一种方法,将多个步骤打包成“超级步骤”,相当于穿上“巨人靴”跨越大段路程。他们设计了一个系统,其中强化学习模型负责提出超级步骤,另一个模型负责验证其合理性。4aR即热新闻——关注每天科技社会生活新变化gihot.com

该策略在经典未解难题——安德鲁斯-柯蒂斯猜想上取得了突破。虽然尚未证明或推翻该猜想,但借助AI,科学家推翻了一个40年来被广泛引用的“反例”。这曾被视为证明该猜想错误的关键依据。4aR即热新闻——关注每天科技社会生活新变化gihot.com

牛津大学数学家马丁·布里森对此表示肯定:“排除错误路径,是科研中非常有价值的一步。”4aR即热新闻——关注每天科技社会生活新变化gihot.com

古科夫相信,这种“压缩路径”的思路适用于所有需要推理链条的领域。他希望,这种方法不仅能推动AI跳出固有模式,也为数学研究带来新突破。4aR即热新闻——关注每天科技社会生活新变化gihot.com

真正的创新和突破仍属人类4aR即热新闻——关注每天科技社会生活新变化gihot.com

跳出思维定式,正是数学家攻克难题的关键。数学常被看作机械推理,而高等数学则更像是一场实验,充满一波三折的试错与灵光乍现的顿悟。4aR即热新闻——关注每天科技社会生活新变化gihot.com

这正是AlphaEvolve等AI工具的优势所在。它通过LLM不断生成并改进解题代码,配合第二个模型评估每一轮结果,最终提出比人类更优的解法。这种方法不仅能独立探索,也支持人类随时介入,提供灵感和指令。4aR即热新闻——关注每天科技社会生活新变化gihot.com

澳大利亚悉尼大学数学家乔迪·威廉姆森强调,探索性思维是数学的核心。据英国《新科学家》网站报道,他与Meta合作开发了PatternBoost AI系统,可根据一个数学想法生成相似概念,帮助激发灵感。他说:“这就像是这里有一堆有趣的东西,我不知道是怎么回事,但你能再生成一些类似的东西吗?”4aR即热新闻——关注每天科技社会生活新变化gihot.com

这种头脑风暴在数学中至关重要,它是新想法产生的源泉。以二十面体为例——古希腊人通过纯粹推理发现了它,其形状并不存在于自然界中,却深刻影响了数学的发展。威廉姆森希望,AI未来也能协助发现类似的“新数学对象”。4aR即热新闻——关注每天科技社会生活新变化gihot.com

不过,目前AI仍缺乏真正的创造力。让AI赢棋是一回事,让它发明围棋游戏则是另一回事。像AlphaEvolve和PatternBoost这样的工具或许能作为人类直觉的“侦察兵”,帮助人们发现路径、避开死路,但专家普遍认为,真正的创新与突破,仍然属于人类。4aR即热新闻——关注每天科技社会生活新变化gihot.com

从计算机科学到医学再到国家安全,数学是众多关键应用的基石,但数学领域的进步可能需要数年时间才能实现。4aR即热新闻——关注每天科技社会生活新变化gihot.com

几百年来,数学家使用的工具依然简朴:一张纸、一支笔。他们凭借逻辑与灵感,在符号的迷宫中寻找通往真理的路径。4aR即热新闻——关注每天科技社会生活新变化gihot.com

为了打破这一局面,美国国防高级研究计划局今年4月启动了“指数性数学”计划,旨在开发一种能极大提升数学研究效率的人工智能(AI)“合著者”系统。4aR即热新闻——关注每天科技社会生活新变化gihot.com

几十年来,数学家借助计算机进行辅助计算或验证命题,如今的AI或许能更上层楼,挑战那些人类长年未解的难题。不过,从能解高中题的AI,到能协助攻克前沿数学难关的AI,中间仍隔着一道鸿沟。4aR即热新闻——关注每天科技社会生活新变化gihot.com

解决重大难题仍力不从心4aR即热新闻——关注每天科技社会生活新变化gihot.com

大型语言模型(LLM)并不擅长数学。它们常常出现“幻觉”,甚至可能被误导相信2+2=5。但新一代大型推理模型,如OpenAI的o3、Anthropic的Claude 4 Thinking等,展现出的进步令数学家眼前一亮。4aR即热新闻——关注每天科技社会生活新变化gihot.com

今年,这些模型在美国数学邀请赛中的表现接近优秀高中生水平。不同于过去“一锤定音”式的输出,这些模型开始尝试模拟数学家逐步推理的思考过程。4aR即热新闻——关注每天科技社会生活新变化gihot.com

同时,一些将LLM与某种事实核查系统相结合的新型混合模型也取得了突破。例如,谷歌“深度思维”的AlphaProof系统将语言模型与棋类AI——AlphaZero结合,成为首个取得与国际数学奥林匹克竞赛银牌得主成绩相当的系统。今年5月,谷歌的AlphaEvolve模型更进一步,在多个长期未解的数学与计算难题上找到优于人类现有方案的解法。4aR即热新闻——关注每天科技社会生活新变化gihot.com

美国《麻省理工科技评论》指出,尽管这些AI成绩亮眼,但专家们普遍认为,它们仍不具备真正的协助科研的能力。竞赛题虽难,却更像是智力游戏,有一定“套路”。真正的数学研究则更开放、更复杂。面对“P vs NP”“黎曼猜想”等重大难题时,AI仍力不从心。4aR即热新闻——关注每天科技社会生活新变化gihot.com

为了更准确地评估AI的能力,初创公司Epoch AI去年推出了FrontierMath测试,联合60多位数学家设计出全新高难度题目,避开模型已见过的训练数据,结果LLM几乎集体“交白卷”。4aR即热新闻——关注每天科技社会生活新变化gihot.com

这些测试表明,AI在数学道路上虽已迈步,但离“合著者”角色仍有很长一段路要走。4aR即热新闻——关注每天科技社会生活新变化gihot.com

需攻克“超长推理链”4aR即热新闻——关注每天科技社会生活新变化gihot.com

仔细观察数学问题会发现,它们在某些方面类似:解决问题需完成一系列连续步骤,关键在于找到这些步骤。4aR即热新闻——关注每天科技社会生活新变化gihot.com

美国加州理工学院谢尔盖·古科夫指出,困难的差异往往体现在路径的长度上。高中数学可能只需10到40步,而像黎曼猜想这样的难题,路径可能长达百万步。4aR即热新闻——关注每天科技社会生活新变化gihot.com

这类“超长路径”极难处理。就像下围棋时寻找一条制胜序列,AI必须在指数级增长的可能路径中找到正确解法。而在数学中,这个复杂度要远超棋类游戏。4aR即热新闻——关注每天科技社会生活新变化gihot.com

据物理学家组织网今年2月报道,为应对这一挑战,古科夫团队开发了一种方法,将多个步骤打包成“超级步骤”,相当于穿上“巨人靴”跨越大段路程。他们设计了一个系统,其中强化学习模型负责提出超级步骤,另一个模型负责验证其合理性。4aR即热新闻——关注每天科技社会生活新变化gihot.com

该策略在经典未解难题——安德鲁斯-柯蒂斯猜想上取得了突破。虽然尚未证明或推翻该猜想,但借助AI,科学家推翻了一个40年来被广泛引用的“反例”。这曾被视为证明该猜想错误的关键依据。4aR即热新闻——关注每天科技社会生活新变化gihot.com

牛津大学数学家马丁·布里森对此表示肯定:“排除错误路径,是科研中非常有价值的一步。”4aR即热新闻——关注每天科技社会生活新变化gihot.com

古科夫相信,这种“压缩路径”的思路适用于所有需要推理链条的领域。他希望,这种方法不仅能推动AI跳出固有模式,也为数学研究带来新突破。4aR即热新闻——关注每天科技社会生活新变化gihot.com

真正的创新和突破仍属人类4aR即热新闻——关注每天科技社会生活新变化gihot.com

跳出思维定式,正是数学家攻克难题的关键。数学常被看作机械推理,而高等数学则更像是一场实验,充满一波三折的试错与灵光乍现的顿悟。4aR即热新闻——关注每天科技社会生活新变化gihot.com

这正是AlphaEvolve等AI工具的优势所在。它通过LLM不断生成并改进解题代码,配合第二个模型评估每一轮结果,最终提出比人类更优的解法。这种方法不仅能独立探索,也支持人类随时介入,提供灵感和指令。4aR即热新闻——关注每天科技社会生活新变化gihot.com

澳大利亚悉尼大学数学家乔迪·威廉姆森强调,探索性思维是数学的核心。据英国《新科学家》网站报道,他与Meta合作开发了PatternBoost AI系统,可根据一个数学想法生成相似概念,帮助激发灵感。他说:“这就像是这里有一堆有趣的东西,我不知道是怎么回事,但你能再生成一些类似的东西吗?”4aR即热新闻——关注每天科技社会生活新变化gihot.com

这种头脑风暴在数学中至关重要,它是新想法产生的源泉。以二十面体为例——古希腊人通过纯粹推理发现了它,其形状并不存在于自然界中,却深刻影响了数学的发展。威廉姆森希望,AI未来也能协助发现类似的“新数学对象”。4aR即热新闻——关注每天科技社会生活新变化gihot.com

不过,目前AI仍缺乏真正的创造力。让AI赢棋是一回事,让它发明围棋游戏则是另一回事。像AlphaEvolve和PatternBoost这样的工具或许能作为人类直觉的“侦察兵”,帮助人们发现路径、避开死路,但专家普遍认为,真正的创新与突破,仍然属于人类。4aR即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-2620-0.htmlAI成为数学家得力助手还要多久

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:我国成功组织实施梦舟载人飞船零高度逃逸飞行试验

下一篇:从开源看“智能向善”——人工智能热的冷思考

为你推荐
  科技日报讯(记者 崔爽)记者8月30日从国家区块链技术创新中心获悉,我国首个区块链专用计算硬件...
01-21
记者1月21日从中国科学院空间应用工程与技术中心获悉,利用中国空间站高温材料科学实验柜,我国科研人员完成铟硒半导体晶体生长实验,获得完整晶体样品...
01-22
  新华社济南2月12日电(记者丛佳鑫)农历正月十四太阳落山后,山东省烟台市黄渤海新区古现街道的渔...
02-14
  受益于亚冬会带来的冰雪经济新热度,滑雪服、羽绒服、滑雪手套等装备的销量在这个冬天迎来了一波新增...
02-15
  中新经纬1月21日电 国新办21日举行“中国经济高质量发展成效”系列新闻发布会,介绍“大力推进新型工业化 推动经济高质量发展”有关情况。工业和信息化部副部长张云明在...
01-21
1 月 24 日消息,截至 2024 年 12 月 30 日,理想超充站上线超过 1600 站,其中高速理想超充站 714 座、理想城市超充站 895 座。然而,这距离年初公布的2000 站的建站目标...
01-25
2 月 2 日消息,比亚迪腾势销售事业部总经理赵长江今日发布视频分享了腾势 N9 新车“九大爆料”,其中提到了该车的上市时间、发布节奏,以及部分车型的续航能力。整理赵...
02-02
  冯海宁  中国首个机器人春晚——“福蛇跃春·智向未来”嘉年华将于20日上线。届时,来自北...
01-22
  1、《难哄》桑延是桑稚的亲哥,两人是年龄相差六岁的亲兄妹,从小打打闹闹,但兄妹感情很好。  2、桑延和桑稚生活在一个幸福有爱的家庭中,在《难哄》中白敬亭饰演桑延,桑稚...
02-14
  大城市就医紧张,一些大型三甲医院常年“一床难求”,患者住院经常需要漫长等待。能不能“哪里有床住哪里”?   试点医院住院“...
01-21
21世纪经济报道记者 韩利明 上海报道2025年作为“十四五”规划收官之年,正风肃纪反腐走向纵深。医药行业因资金链长、权力集中、利润空间大...
02-09
  大众网记者 杨涛报道  近日,2024年山东省“技能兴鲁”职业技能大赛暨第五届山东省汽车服务行业职业技能竞赛在青岛港湾职业技术学院成功举行。“技能兴鲁”职业技能...
01-21
  大众网记者 王一刚 报道  1.暖·冬至  冬至,在我国农历的舞台上,它不仅是一个至关重要的节气,更是一场阖家团圆、传承民俗的文化盛宴。  为了在幼儿心底种下传统...
01-21
  “我行现与周大生合作推出‘金蛇迎春’贺岁金钞,有限时优惠活动。一张贺岁金钞附赠一张蛇钞,...
01-22
  中国证监会1月22日消息,近日,中央金融办等六部门联合印发的《关于推动中长期资金入市工作的实...
01-24
天秤座的男人通常具有温和、善良、浪漫的性格,他们注重平衡和和谐,追求美好的事物。在婚...
01-22
天蝎座的男生通常具有神秘、深沉和独立的性格特点,因此要追求他们并赢得他们的好感需要...
01-22
她们的魅力:那些令人心动的女明星在娱乐圈中,许多女明星不只是才华横溢,更以其**迷人的外表**和独特的个性抓住了观众的心。谈到**最漂亮的女明星**,我们不由自主地想到了那些在...
02-07
格子衬衫搭配什么裙子好看?一、格子衬衫搭配什么裙子好看?  搭配方案一:格子衬衫+半身长裙  格子衬衫可以搭配有垂坠的褶皱长裙,浪漫气息完美散发。但是最好选择素色长裙,以...
02-12
2月19日消息,抖音商城38好物节日前开启商家报名,活动时间为2月27日20:00:00至3月8日23:59:59。图源:抖音电商学习中心本次38大促无预售,全程为现货开卖,平台核心玩法是官方立减15...
02-20
2月20日消息,闲鱼数据显示,过去一年中,平台上的循环订单量同比增长近50%,覆盖手机数码、家具家电、服饰、图书等品类。在线上,超1亿人在闲鱼挂出闲置物品,每天都有超400万件闲置物...
02-21
2月10日消息,美团外卖发布《年轻人春节送礼报告(2025)》,2025年春节期间,美团平台上“春节送礼”搜索量同比增速达165%,外卖餐饮礼券赠送量环比节前增长120%。其中95后消费者占比...
02-11
2月18日消息,据环球旅讯,携程集团近日宣布多名高层调整。截图图源:环球旅讯公众号任命公告具体为,陈刚出任集团首席产品官,将牵头集团AI相关产品的战略制订;谭煜东出任集团首席科...
02-19
自去年底开始,黄金多头优势逐渐退却,国际现货黄金价格经历几次大跌后一度跌下2700关口,多空进入漫长的震荡周期,多头始终无法找到再度冲高的时机。  北京时间1月21日,国际现货...
01-24
近日,华力创科学宣布完成数千万元A+轮融资,本轮融资由金属3D打印领域头部上市公司铂力特独家投资。据披露,本轮融资所募集的资金将专注于深挖高性能光学多模态感知技术,结合金属...
01-24
在《GTA5》中为魅力主角之一崔佛配音的男演员史蒂文·奥格(Steven Ogg)希望能在《GTA6》中最后一次扮演这个疯子角色。史蒂文·奥格希望崔佛能在游戏早期的某个...
01-29
近日暴雪游戏国服运营团队宣布,战网正式调整登录方式。用户需要使用网易通行证登录战网,但完全切换的时间稍作推迟,未来需要使用网易账号才能登录游戏。 暴雪游...
02-13
今明两天(2月7日至8日),寒潮继续影响我国,中东部气温将陆续迎来这轮过程的最低点,并将大面积创今冬以来气温新低。同时,全国降水范围有所缩减,主要出现在东北地区、西南地区东部、...
02-07
2月8日,抖音发布《抖音关于打击无底线博流量行为的公告》,对“张兰·俏生活”、“张兰之箖玥甄选”、“汪小菲”等账号予以无限期封禁。公告称,近期,徐熙媛(大S)女士逝世引发广泛...
02-08
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮