点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:AI成为数学家得力助手还要多久
首页> 科技频道> 头版头条 > 正文

AI成为数学家得力助手还要多久

来源:科技日报2025-06-17 09:53

  图片来源:物理学家组织网

  【今日视点】

  从计算机科学到医学再到国家安全,数学是众多关键应用的基石,但数学领域的进步可能需要数年时间才能实现。

  几百年来,数学家使用的工具依然简朴:一张纸、一支笔。他们凭借逻辑与灵感,在符号的迷宫中寻找通往真理的路径。

  为了打破这一局面,美国国防高级研究计划局今年4月启动了“指数性数学”计划,旨在开发一种能极大提升数学研究效率的人工智能(AI)“合著者”系统。

  几十年来,数学家借助计算机进行辅助计算或验证命题,如今的AI或许能更上层楼,挑战那些人类长年未解的难题。不过,从能解高中题的AI,到能协助攻克前沿数学难关的AI,中间仍隔着一道鸿沟。

  解决重大难题仍力不从心

  大型语言模型(LLM)并不擅长数学。它们常常出现“幻觉”,甚至可能被误导相信2+2=5。但新一代大型推理模型,如OpenAI的o3、Anthropic的Claude 4 Thinking等,展现出的进步令数学家眼前一亮。

  今年,这些模型在美国数学邀请赛中的表现接近优秀高中生水平。不同于过去“一锤定音”式的输出,这些模型开始尝试模拟数学家逐步推理的思考过程。

  同时,一些将LLM与某种事实核查系统相结合的新型混合模型也取得了突破。例如,谷歌“深度思维”的AlphaProof系统将语言模型与棋类AI——AlphaZero结合,成为首个取得与国际数学奥林匹克竞赛银牌得主成绩相当的系统。今年5月,谷歌的AlphaEvolve模型更进一步,在多个长期未解的数学与计算难题上找到优于人类现有方案的解法。

  美国《麻省理工科技评论》指出,尽管这些AI成绩亮眼,但专家们普遍认为,它们仍不具备真正的协助科研的能力。竞赛题虽难,却更像是智力游戏,有一定“套路”。真正的数学研究则更开放、更复杂。面对“P vs NP”“黎曼猜想”等重大难题时,AI仍力不从心。

  为了更准确地评估AI的能力,初创公司Epoch AI去年推出了FrontierMath测试,联合60多位数学家设计出全新高难度题目,避开模型已见过的训练数据,结果LLM几乎集体“交白卷”。

  这些测试表明,AI在数学道路上虽已迈步,但离“合著者”角色仍有很长一段路要走。

  需攻克“超长推理链”

  仔细观察数学问题会发现,它们在某些方面类似:解决问题需完成一系列连续步骤,关键在于找到这些步骤。

  美国加州理工学院谢尔盖·古科夫指出,困难的差异往往体现在路径的长度上。高中数学可能只需10到40步,而像黎曼猜想这样的难题,路径可能长达百万步。

  这类“超长路径”极难处理。就像下围棋时寻找一条制胜序列,AI必须在指数级增长的可能路径中找到正确解法。而在数学中,这个复杂度要远超棋类游戏。

  据物理学家组织网今年2月报道,为应对这一挑战,古科夫团队开发了一种方法,将多个步骤打包成“超级步骤”,相当于穿上“巨人靴”跨越大段路程。他们设计了一个系统,其中强化学习模型负责提出超级步骤,另一个模型负责验证其合理性。

  该策略在经典未解难题——安德鲁斯-柯蒂斯猜想上取得了突破。虽然尚未证明或推翻该猜想,但借助AI,科学家推翻了一个40年来被广泛引用的“反例”。这曾被视为证明该猜想错误的关键依据。

  牛津大学数学家马丁·布里森对此表示肯定:“排除错误路径,是科研中非常有价值的一步。”

  古科夫相信,这种“压缩路径”的思路适用于所有需要推理链条的领域。他希望,这种方法不仅能推动AI跳出固有模式,也为数学研究带来新突破。

  真正的创新和突破仍属人类

  跳出思维定式,正是数学家攻克难题的关键。数学常被看作机械推理,而高等数学则更像是一场实验,充满一波三折的试错与灵光乍现的顿悟。

  这正是AlphaEvolve等AI工具的优势所在。它通过LLM不断生成并改进解题代码,配合第二个模型评估每一轮结果,最终提出比人类更优的解法。这种方法不仅能独立探索,也支持人类随时介入,提供灵感和指令。

  澳大利亚悉尼大学数学家乔迪·威廉姆森强调,探索性思维是数学的核心。据英国《新科学家》网站报道,他与Meta合作开发了PatternBoost AI系统,可根据一个数学想法生成相似概念,帮助激发灵感。他说:“这就像是这里有一堆有趣的东西,我不知道是怎么回事,但你能再生成一些类似的东西吗?”

  这种头脑风暴在数学中至关重要,它是新想法产生的源泉。以二十面体为例——古希腊人通过纯粹推理发现了它,其形状并不存在于自然界中,却深刻影响了数学的发展。威廉姆森希望,AI未来也能协助发现类似的“新数学对象”。

  不过,目前AI仍缺乏真正的创造力。让AI赢棋是一回事,让它发明围棋游戏则是另一回事。像AlphaEvolve和PatternBoost这样的工具或许能作为人类直觉的“侦察兵”,帮助人们发现路径、避开死路,但专家普遍认为,真正的创新与突破,仍然属于人类。(记者 张佳欣)

[ 责编:焦子原 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 2026首届上海商业航天大会暨展览会开幕

  • 安徽五河:纺织服装产业转型升级助力县域经济发展

独家策划

推荐阅读
多牵头国际大科学计划  牵头组织实施国际大科学计划,是中国推动世界科技创新、应对全球共同挑战的重要路径,也是深度参与全球科技创新治理、加快建设科技强国的战略举措。
2026-03-13 10:03
12日,十四届全国人大四次会议表决通过了《中华人民共和国生态环境法典》。非洲“绿色长城”毛里塔尼亚国家署官员艾莎·穆罕默德·布哈里·娜迪称赞说,生态环境法典体现了中国系统性应对生态和气候问题的“长期坚定承诺”。
2026-03-13 10:02
谈及国际深海矿产开发局势,孙黎表示,当前全球深海采矿虽处于试验阶段,但各国布局势头迅猛,竞争日趋激烈。潘越建议,司法应该向社会积极传递“损害必偿、犯罪必究”的清晰信号,为海洋经济高质量发展清淤护航。
2026-03-13 10:12
当春风拂过河套平原,“沉睡”一冬的黄河“醒了”。
2026-03-13 10:08
3月12日,十四届全国人大四次会议表决通过《中华人民共和国生态环境法典》。根据代表意见,法典中增加了关于鼓励和引导使用再生水、推进生活节水的规定,并对未经批准擅自取用地下水的违法行为提高罚款上限。
2026-03-13 10:04
助力人与自然和谐共生  “十五五”时期,推进长江经济带发展、黄河流域生态保护和高质量发展,是一项重要工作。
2026-03-13 10:03
光明日报北京3月12日电 记者张晓华12日从国家航天局获悉,天问三号火星取样返回任务通过前期的技术攻关和深化论证,相关关键技术均取得突破性成果,工程主线正在开展初样研制,计划今年转入正样研制阶段,各项工作进展顺利。
2026-03-13 10:02
电子的单向开关,奠定了现代信息社会的基石。“在单原子层厚的石墨烯上,刻出一个大小精确、形状不对称的孔,无异于在头发丝上雕巨型画作。
2026-03-13 10:01
“十五五”时期,香港要主动参与国家战略布局,将自身的国际化优势、专业服务优势与国家的发展需求精准对接,为实现更高水平的开放合作贡献香港力量。在科研方面,香港科研基础扎实,有实力承担国家重大科研任务;香港科学家对参与国家科技计划、推动国家科技创新怀有很高的热情和积极性。
2026-03-12 10:30
心脑血管疾病已成为威胁我国人民生命健康的“头号杀手”。与此同时,心脑血管疾病发病及致残、致死呈现出明显的年轻化趋势,疾病负担持续加重,对我国推进健康中国建设、实现全民健康目标构成了挑战。
2026-03-12 10:30
对此,应该充分发掘当地的生态价值和文化价值,探索因地制宜的保护路径,保留浓郁“农味”与“地方味”,让古老农耕智慧、生态智慧在当代生活中延续生机、展现活力。这样不仅有助于实现农文旅融合发展,还能给我们的子孙后代保留良好的生态环境和生态景观,接续传承好丰厚灿烂的生态文化。
2026-03-12 10:30
今年政府工作报告提出,深化拓展“人工智能+”,促进新一代智能终端和智能体加快推广,推动重点行业领域人工智能商业化规模化应用,培育智能原生新业态新模式。张壮代表说,在竞逐人工智能创新的赛道上,柳州加速布局。
2026-03-12 10:30
记者詹媛11日从中国科技馆了解到,我国的科普大篷车项目自2000年启动实施以来,以“科普轻骑兵”的方式活跃在祖国大江南北,将前沿科技动态、趣味互动展品、优质科教资源送到基层公众身边。
2026-03-12 10:30
“龙虾”智能体通过整合调用通信软件和大语言模型,在用户本地电脑自主执行文件管理、邮件收发、数据处理等复杂任务。”魏亮说,有关方面也会持续做好安全监测,如发现相关安全风险将及时预警,为用户安全使用提供必要的技术支持。
2026-03-11 09:36
作为人类的“第二大脑”,AI for Science正在全球范围内引发科研范式的深刻变革,也成为全国两会期间代表委员关注的话题。3月7日,在全国政协十四届四次会议第二次全体会议上,全国政协委员、中国科学院院士周志华发言建议,以人工智能引领科研范式变革。
2026-03-11 09:36
全国政协委员、中国科学院院士、南京大学副校长周志华在接受光明网记者采访。
2026-03-11 07:00
以医工交叉+成果转化为抓手,凭借硬核科创成果精准攻坚,同时高标准建设国家药监局监管科学创新基地,为产业发展提供标准与工具支撑。
2026-03-11 09:33
作者:余有成 张立华 吴 飞(分别系中国人工智能学会副秘书长;复旦大学智能机器人研究院常务副院长、特聘教授;我国的独特优势,在于探索出一条“软件定义算力、算法驱动效能、人工智能+赋能场景”的创新路径。
2026-03-11 09:32
具体而言,在种植与流通环节,中药农业面临良种普及率不高、生产种植分散、标准化程度偏低等现实问题。可制定国家统筹的野生资源抚育与替代技术攻关清单,利用大数据监测价格与供给波动,增强产业链供应链韧性。
2026-03-11 09:31
光明日报北京3月10日电 记者张晓华从中国航天科技集团获悉,目前中国探月工程四期正稳步推进,2026年将研制发射嫦娥七号探测器,首次奔赴月球南极,寻找水冰存在的证据。中国航天科技集团五院研究员孙泽洲表示,在行星探测方面,未来我国还将发射天问三号和天问四号。
2026-03-11 09:30
加载更多