点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:AI成为数学家得力助手还要多久
首页> 科技频道> 综合新闻 > 正文

AI成为数学家得力助手还要多久

来源:科技日报2025-06-17 09:53

  图片来源:物理学家组织网

  【今日视点】

  从计算机科学到医学再到国家安全,数学是众多关键应用的基石,但数学领域的进步可能需要数年时间才能实现。

  几百年来,数学家使用的工具依然简朴:一张纸、一支笔。他们凭借逻辑与灵感,在符号的迷宫中寻找通往真理的路径。

  为了打破这一局面,美国国防高级研究计划局今年4月启动了“指数性数学”计划,旨在开发一种能极大提升数学研究效率的人工智能(AI)“合著者”系统。

  几十年来,数学家借助计算机进行辅助计算或验证命题,如今的AI或许能更上层楼,挑战那些人类长年未解的难题。不过,从能解高中题的AI,到能协助攻克前沿数学难关的AI,中间仍隔着一道鸿沟。

  解决重大难题仍力不从心

  大型语言模型(LLM)并不擅长数学。它们常常出现“幻觉”,甚至可能被误导相信2+2=5。但新一代大型推理模型,如OpenAI的o3、Anthropic的Claude 4 Thinking等,展现出的进步令数学家眼前一亮。

  今年,这些模型在美国数学邀请赛中的表现接近优秀高中生水平。不同于过去“一锤定音”式的输出,这些模型开始尝试模拟数学家逐步推理的思考过程。

  同时,一些将LLM与某种事实核查系统相结合的新型混合模型也取得了突破。例如,谷歌“深度思维”的AlphaProof系统将语言模型与棋类AI——AlphaZero结合,成为首个取得与国际数学奥林匹克竞赛银牌得主成绩相当的系统。今年5月,谷歌的AlphaEvolve模型更进一步,在多个长期未解的数学与计算难题上找到优于人类现有方案的解法。

  美国《麻省理工科技评论》指出,尽管这些AI成绩亮眼,但专家们普遍认为,它们仍不具备真正的协助科研的能力。竞赛题虽难,却更像是智力游戏,有一定“套路”。真正的数学研究则更开放、更复杂。面对“P vs NP”“黎曼猜想”等重大难题时,AI仍力不从心。

  为了更准确地评估AI的能力,初创公司Epoch AI去年推出了FrontierMath测试,联合60多位数学家设计出全新高难度题目,避开模型已见过的训练数据,结果LLM几乎集体“交白卷”。

  这些测试表明,AI在数学道路上虽已迈步,但离“合著者”角色仍有很长一段路要走。

  需攻克“超长推理链”

  仔细观察数学问题会发现,它们在某些方面类似:解决问题需完成一系列连续步骤,关键在于找到这些步骤。

  美国加州理工学院谢尔盖·古科夫指出,困难的差异往往体现在路径的长度上。高中数学可能只需10到40步,而像黎曼猜想这样的难题,路径可能长达百万步。

  这类“超长路径”极难处理。就像下围棋时寻找一条制胜序列,AI必须在指数级增长的可能路径中找到正确解法。而在数学中,这个复杂度要远超棋类游戏。

  据物理学家组织网今年2月报道,为应对这一挑战,古科夫团队开发了一种方法,将多个步骤打包成“超级步骤”,相当于穿上“巨人靴”跨越大段路程。他们设计了一个系统,其中强化学习模型负责提出超级步骤,另一个模型负责验证其合理性。

  该策略在经典未解难题——安德鲁斯-柯蒂斯猜想上取得了突破。虽然尚未证明或推翻该猜想,但借助AI,科学家推翻了一个40年来被广泛引用的“反例”。这曾被视为证明该猜想错误的关键依据。

  牛津大学数学家马丁·布里森对此表示肯定:“排除错误路径,是科研中非常有价值的一步。”

  古科夫相信,这种“压缩路径”的思路适用于所有需要推理链条的领域。他希望,这种方法不仅能推动AI跳出固有模式,也为数学研究带来新突破。

  真正的创新和突破仍属人类

  跳出思维定式,正是数学家攻克难题的关键。数学常被看作机械推理,而高等数学则更像是一场实验,充满一波三折的试错与灵光乍现的顿悟。

  这正是AlphaEvolve等AI工具的优势所在。它通过LLM不断生成并改进解题代码,配合第二个模型评估每一轮结果,最终提出比人类更优的解法。这种方法不仅能独立探索,也支持人类随时介入,提供灵感和指令。

  澳大利亚悉尼大学数学家乔迪·威廉姆森强调,探索性思维是数学的核心。据英国《新科学家》网站报道,他与Meta合作开发了PatternBoost AI系统,可根据一个数学想法生成相似概念,帮助激发灵感。他说:“这就像是这里有一堆有趣的东西,我不知道是怎么回事,但你能再生成一些类似的东西吗?”

  这种头脑风暴在数学中至关重要,它是新想法产生的源泉。以二十面体为例——古希腊人通过纯粹推理发现了它,其形状并不存在于自然界中,却深刻影响了数学的发展。威廉姆森希望,AI未来也能协助发现类似的“新数学对象”。

  不过,目前AI仍缺乏真正的创造力。让AI赢棋是一回事,让它发明围棋游戏则是另一回事。像AlphaEvolve和PatternBoost这样的工具或许能作为人类直觉的“侦察兵”,帮助人们发现路径、避开死路,但专家普遍认为,真正的创新与突破,仍然属于人类。(记者 张佳欣)

[ 责编:焦子原 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 中国中央歌剧院《卡门》唱响沙特

  • 电影《日掛中天》主创亮相威尼斯电影节

独家策划

推荐阅读
植物在漫长的适应性进化过程中,催生出丰富多元的物种谱系。9月2日,《细胞》在线发表了华中农业大学教授宁国贵团队的一项研究成果,该研究揭示了月季香气基因起源的新机制。
2025-09-05 10:06
今年8月,中央网信办、国家卫生健康委等四部门联合发布《关于规范“自媒体”医疗科普行为的通知》,为医疗科普立了“规矩”。
2025-09-05 10:02
数字经济时代,算力是如同水、电一样重要的基础资源。我国算力发展情况如何?未来着力点在哪儿?
2025-09-05 09:54
算法技术的赋能强化了传统意识形态风险,算法的自我进化制造了意识形态黑箱,要求我们积极探索和优化治理智能算法技术意识形态风险的新路径。
2025-09-05 09:48
日前,中国科学技术大学孙道远教授、毛竹教授团队联合国外学者在行星科学研究领域取得重大进展,该研究首次在地球以外的行星中确认了固态内核的存在。
2025-09-05 09:41
据世界气象组织2日发布的厄尔尼诺/拉尼娜现象最新通报,拉尼娜现象有可能从今年9月起回归并影响未来数月的全球天气和气候状况。拉尼娜现象是指赤道太平洋东部和中部海水大范围持续异常变冷的现象,而厄尔尼诺现象则是指太平洋赤道海域海水大范围持续异常升温的现象。
2025-09-04 09:47
这种说法缺乏科学依据。
2025-09-04 09:44
正确掌握储存技巧和使用习惯,才能发挥冰箱的功能,保障家人饮食健康。
2025-09-04 09:39
这不是惊悚小说,也不是玄幻剧,而是世代生活在海边的人们,和海洋巨兽的别样相遇——这是鲸和海豚的骨头。从意外搁浅偶然获得,到渔业生产相对频繁打捞,闽南的“新鱼骨庙”(阴庙)呈现出和历史上的鱼骨庙截然不同的样貌。
2025-09-04 09:37
9月3日,某潜艇支队某艇员队组织收看阅兵仪式直播,铿锵有力的步伐、全新亮相的装备、转型跨越的成就,让他们动容,更让他们振奋。南昌舰的入列,标志着海军驱逐舰实现由第三代向第四代的跨越,首次突破万吨级设计,在航母编队体系作战中发挥重要作用。
2025-09-04 09:32
日前,我国科学家近日成功研制出超宽带光电融合集成系统,首次实现全频段、灵活可调谐的高速无线通信,有望为未来更畅通可靠的6G无线通信提供保障。为此,北京大学、香港城市大学组成的联合研究团队,历经4年,自主研发出超宽带光电融合集成系统。
2025-09-03 10:01
近日,由中国农业科学院烟草研究所牵头完成的“基于耐盐植物和土壤调理剂的滨海盐碱地高效利用技术创制与应用”项目获2024年度青岛市科技进步奖二等奖,为滨海盐碱地的综合治理与高效利用提供了新方案。基于各项研究,团队开发了4种抗盐剂、2种盐碱地土壤调理剂等盐碱地培肥改良系列产品,为盐碱地快速培肥和障碍消减提供了有力支撑。
2025-09-03 10:01
9月1日起,由工业和信息化部等五部门联合修订的强制性国家标准《电动自行车安全技术规范》(GB 17761—2024)正式实施。新国标进一步增强了电动自行车的智能化功能,增加了北斗定位、通信和动态安全监测功能。
2025-09-03 10:00
作为第十五届全国运动会增设的群众赛事项目,被称为“空中F1”的无人机竞速备受瞩目,该项赛事决赛举办地深圳近日也掀起了无人机竞速热潮,市民和游客在公园里就能过一把“飞行瘾”。据介绍,深圳中心公园位于深圳核心区域,无论是深圳还是粤港澳大湾区其他城市的无人机爱好者,都能轻松快捷到达这里。
2025-09-03 10:00
油菜、白菜、甘蓝、萝卜是大众最熟悉的十字花科作物,也是食用油和蔬菜的主要来源,然而它们都受到同一种毁灭性病害——根肿病的威胁。基于GSL5功能研究和团队所创制的材料,他们还揭示了有趣的病菌与寄主的互作关系,即病菌致病和寄主抗病反应机制。
2025-09-03 10:00
点击羽绒服胸前的按钮,2秒即可速热,实现四档温度调节……1日,在哈尔滨举行的第七届中国国际新材料产业博览会现场,一款造型时尚的智能温控羽绒服吸引不少观展者驻足围观。
2025-09-02 10:23
当地时间9月1日,世界知识产权组织发布最新报告显示,今年的全球创新指数(GII)集群研究将风险资本交易活动作为一项新指标。全球创新指数集群排行榜于2017年创设,通过三项核心指标,识别世界级创新活动在当地的集中程度。
2025-09-02 10:21
强制性国家标准《电动自行车安全技术规范》昨起实施。为保障新国标在本市顺利推行,近日,市市场监管局组织召开在京销售电动自行车生产经营企业约谈指导会。为保障新国标平稳落地实施,本市市场监管部门将强化监督抽检,保障本市电动自行车产品质量安全。
2025-09-02 10:18
会空翻、格斗,能叠衣、调饮,善聊天、“思考”……前不久举行的2025世界机器人大会上,各类机器人本领“进化”、各显神通,展现了人工智能的巨大潜力。如今,从旅游出行的智能助手,到工厂培训的“最强大脑”,再到装备升级的有力支撑,人工智能扮演着越来越重要的角色。
2025-09-02 10:15
零碳园区的建设,对于推动我国经济社会发展全面绿色转型具有重要意义。节能降碳,光靠“外套保温”不够,在园区地上、地下,还有“血液循环”系统来“保持恒温”。
2025-09-02 10:15
加载更多