点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:AI成为数学家得力助手还要多久
首页> 科技频道> 头版头条 > 正文

AI成为数学家得力助手还要多久

来源:科技日报2025-06-17 09:53

  图片来源:物理学家组织网

  【今日视点】

  从计算机科学到医学再到国家安全,数学是众多关键应用的基石,但数学领域的进步可能需要数年时间才能实现。

  几百年来,数学家使用的工具依然简朴:一张纸、一支笔。他们凭借逻辑与灵感,在符号的迷宫中寻找通往真理的路径。

  为了打破这一局面,美国国防高级研究计划局今年4月启动了“指数性数学”计划,旨在开发一种能极大提升数学研究效率的人工智能(AI)“合著者”系统。

  几十年来,数学家借助计算机进行辅助计算或验证命题,如今的AI或许能更上层楼,挑战那些人类长年未解的难题。不过,从能解高中题的AI,到能协助攻克前沿数学难关的AI,中间仍隔着一道鸿沟。

  解决重大难题仍力不从心

  大型语言模型(LLM)并不擅长数学。它们常常出现“幻觉”,甚至可能被误导相信2+2=5。但新一代大型推理模型,如OpenAI的o3、Anthropic的Claude 4 Thinking等,展现出的进步令数学家眼前一亮。

  今年,这些模型在美国数学邀请赛中的表现接近优秀高中生水平。不同于过去“一锤定音”式的输出,这些模型开始尝试模拟数学家逐步推理的思考过程。

  同时,一些将LLM与某种事实核查系统相结合的新型混合模型也取得了突破。例如,谷歌“深度思维”的AlphaProof系统将语言模型与棋类AI——AlphaZero结合,成为首个取得与国际数学奥林匹克竞赛银牌得主成绩相当的系统。今年5月,谷歌的AlphaEvolve模型更进一步,在多个长期未解的数学与计算难题上找到优于人类现有方案的解法。

  美国《麻省理工科技评论》指出,尽管这些AI成绩亮眼,但专家们普遍认为,它们仍不具备真正的协助科研的能力。竞赛题虽难,却更像是智力游戏,有一定“套路”。真正的数学研究则更开放、更复杂。面对“P vs NP”“黎曼猜想”等重大难题时,AI仍力不从心。

  为了更准确地评估AI的能力,初创公司Epoch AI去年推出了FrontierMath测试,联合60多位数学家设计出全新高难度题目,避开模型已见过的训练数据,结果LLM几乎集体“交白卷”。

  这些测试表明,AI在数学道路上虽已迈步,但离“合著者”角色仍有很长一段路要走。

  需攻克“超长推理链”

  仔细观察数学问题会发现,它们在某些方面类似:解决问题需完成一系列连续步骤,关键在于找到这些步骤。

  美国加州理工学院谢尔盖·古科夫指出,困难的差异往往体现在路径的长度上。高中数学可能只需10到40步,而像黎曼猜想这样的难题,路径可能长达百万步。

  这类“超长路径”极难处理。就像下围棋时寻找一条制胜序列,AI必须在指数级增长的可能路径中找到正确解法。而在数学中,这个复杂度要远超棋类游戏。

  据物理学家组织网今年2月报道,为应对这一挑战,古科夫团队开发了一种方法,将多个步骤打包成“超级步骤”,相当于穿上“巨人靴”跨越大段路程。他们设计了一个系统,其中强化学习模型负责提出超级步骤,另一个模型负责验证其合理性。

  该策略在经典未解难题——安德鲁斯-柯蒂斯猜想上取得了突破。虽然尚未证明或推翻该猜想,但借助AI,科学家推翻了一个40年来被广泛引用的“反例”。这曾被视为证明该猜想错误的关键依据。

  牛津大学数学家马丁·布里森对此表示肯定:“排除错误路径,是科研中非常有价值的一步。”

  古科夫相信,这种“压缩路径”的思路适用于所有需要推理链条的领域。他希望,这种方法不仅能推动AI跳出固有模式,也为数学研究带来新突破。

  真正的创新和突破仍属人类

  跳出思维定式,正是数学家攻克难题的关键。数学常被看作机械推理,而高等数学则更像是一场实验,充满一波三折的试错与灵光乍现的顿悟。

  这正是AlphaEvolve等AI工具的优势所在。它通过LLM不断生成并改进解题代码,配合第二个模型评估每一轮结果,最终提出比人类更优的解法。这种方法不仅能独立探索,也支持人类随时介入,提供灵感和指令。

  澳大利亚悉尼大学数学家乔迪·威廉姆森强调,探索性思维是数学的核心。据英国《新科学家》网站报道,他与Meta合作开发了PatternBoost AI系统,可根据一个数学想法生成相似概念,帮助激发灵感。他说:“这就像是这里有一堆有趣的东西,我不知道是怎么回事,但你能再生成一些类似的东西吗?”

  这种头脑风暴在数学中至关重要,它是新想法产生的源泉。以二十面体为例——古希腊人通过纯粹推理发现了它,其形状并不存在于自然界中,却深刻影响了数学的发展。威廉姆森希望,AI未来也能协助发现类似的“新数学对象”。

  不过,目前AI仍缺乏真正的创造力。让AI赢棋是一回事,让它发明围棋游戏则是另一回事。像AlphaEvolve和PatternBoost这样的工具或许能作为人类直觉的“侦察兵”,帮助人们发现路径、避开死路,但专家普遍认为,真正的创新与突破,仍然属于人类。(记者 张佳欣)

[ 责编:焦子原 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 古蜀文物来京“出差”,三星堆-金沙遗址“双星耀世”

  • 各地推动高质量发展观察

独家策划

推荐阅读
随着中国第42次南极考察队队员陈龙耀从东南极西福尔丘陵地区裸露的岩壁敲下第一块岩石样本,中山站度夏地质考察工作正式启动。
2026-01-21 09:08
这套“地震断层模拟试验装置”由中国工程院院士、中国地震局工程力学研究所名誉所长谢礼立领衔的团队历时4年攻关研制完成,已成功通过验收。
2026-01-21 09:02
长期以来,半导体面临一个难题:我们知道下一代材料的性能会更好,却往往不知道如何将它制造出来。这项材料工艺革新解决了从第三代到第四代半导体都面临的共性散热难题,为后续的性能爆发奠定了关键基础。
2026-01-21 09:01
该团队通过对比研究嫦娥六号月球背面样品与嫦娥五号月球正面样品,发现嫦娥六号样品中的碳结构具有更明显的缺陷特征,这可能与月球背面经历的更强烈的微陨石撞击历史有关。
2026-01-21 09:00
近日,在国新办举行的新闻发布会上,海关总署相关负责人介绍,2025年中国高技术产品出口增长13.2%,工业机器人出口增长48.7%,并首次超过进口,我国成为工业机器人净出口国。
2026-01-21 08:56
2025年C919安全载客超过400万人次,而且今年又新开了广州往返南京的航线。
2026-01-20 07:00
工业和信息化部、国家发展改革委等五部门日前联合印发《关于开展零碳工厂建设工作的指导意见》。
2026-01-20 03:25
工业和信息化部日前印发最新修订的《优质中小企业梯度培育管理办法》,将科技型中小企业纳入优质中小企业梯度培育范围。办法自2026年4月1日起实施。
2026-01-20 03:20
近日,工业和信息化部印发最新修订的《优质中小企业梯度培育管理办法》,扩大了培育基础,首次将科技型中小企业纳入梯度培育范围。
2026-01-20 09:03
中国科学技术大学马骋教授针对全固态锂电池在循环时因需要维持良好界面接触而过于依赖外部压力、难以实际应用的问题,提出了一种低成本、较为适合商业化的解决方案。
2026-01-20 09:02
离子注入机是半导体制造关键设备,尤其是高能氢离子注入机研发难度大、技术壁垒高,我国长期依赖进口。
2026-01-20 09:02
对于行业的未来,赵同阳充满期待:“人形机器人行业未来也会出现几家顶级企业,我希望提起机器人,人们首先想到的是中国。
2026-01-20 08:57
当日9时34分,神舟二十号飞船返回舱在东风着陆场成功着陆。经现场检查确认,飞船返回舱外观总体正常,舱内下行物品状态良好,神舟二十号飞船返回任务取得圆满成功。
2026-01-19 11:36
血脑屏障横亘于血液与大脑之间,严格调控物质通行,将绝大多数药物拒之门外,这成为脑神经疾病新药研发面临的主要瓶颈之一。许多在实验室中表现优异的候选药物因无法有效透过血脑屏障,在临床试验阶段止步不前。
2026-01-19 03:10
随着国民健康意识的普遍觉醒与消费结构的深刻升级,以全谷物、豆类、薯类等为代表的杂粮,正悄然经历一场角色与意义的深刻变革。
2026-01-19 03:10
新年伊始,江苏无锡凯龙高科技股份有限公司的实验室内,一只机器人灵巧手在一个两米多高的透明检测设备中流畅地完成抓取、捏合、旋转等一连串精细动作,相关数据实时传出。这款具身智能机器人灵巧手全操作力智能检测平台于去年年底一经启动,便获得多张订单。
2026-01-19 03:10
日前,江苏徐圩核能供热发电厂1号机组核岛开始混凝土浇筑,标志着全球首个核能与石化产业大规模耦合项目进入主体工程建设阶段。这是今年我国开工建设的首台核电机组。
2026-01-19 03:10
为破解这一谜题,利用“中国天眼”的超高灵敏度优势,研究团队对重复快速射电暴FRB 20220529开展了2年多的持续监测。
2026-01-19 09:10
目前,依托DrugCLIP,团队完成了覆盖约1万个蛋白靶点、2万个蛋白口袋的虚拟筛选项目,分析筛选超过5亿个类药小分子,富集出超过200万个潜在活性分子,构建了目前已知最大规模的蛋白—配体筛选数据库。
2026-01-19 09:08
从中国地质调查局获悉,由该局广州海洋地质调查局自主研发的国内首台海底地层空间立体钻探与原位监测机器人,日前在南海1264米水深海域成功完成试验作业,各项性能全面达标,标志着我国深海勘探与地层原位监测技术取得重要突破。
2026-01-16 03:45
加载更多