点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:中国智算如何实现“DeepSeek式突围”
首页> 科技频道> 综合新闻 > 正文

中国智算如何实现“DeepSeek式突围”

来源:科技日报2025-03-31 10:21

  晶上生成式变结构计算可为我国打破算力芯片“制程工艺茧房”开辟新路径,走出一条用“三流材料、二流工艺”达成“一流能力”的系统工程级创新路线。

  图为长三角(芜湖)智算中心。 视觉中国供图

  今年以来,我国以DeepSeek为代表的大模型企业通过算法优化、有针对性的训练和开源生态协作,在使用“缩水版”GPU芯片的情况下,将千亿参数模型训练成本压缩至同类模型的1/10,走出了一条从粗放式算力堆砌向内生式效能提升的新路径。

  在全球惊叹中国非对称创新奇迹的同时,也要清醒看到,就人工智能(AI)技术和产业自主可持续发展而言,我国仍未摆脱对高端乃至“缩水版”智算芯片等物理器件的依赖。在可以预见的未来,外部环境可能更趋恶劣,封锁遏制常态化、供应链不确定性等挑战难以回避。我国亟需在智能算力层面实现“DeepSeek式突围”,用超限创新解耦当前硬件算力提升与制程工艺进步强绑定的关系。

  换言之,我国要在AI领域获得与竞争对手可博弈的能力,不仅要在算法层面继续革命、突破“算力茧房”,而且要在算法与物理层面深度融合上实现换道超车,破解“制程工艺茧房”。以生成式变结构计算、软件定义晶上系统(Software defined System on Wafer,SDSoW)为主要内容的晶上生成式体系架构,为解决算法模型与算力载体失配难题、增强软硬件协同算力可持续发展提供了新的技术路径。

  让计算架构的“鞋”适应算法的“脚”

  先进的芯片制程工艺能够提供更高的晶体管密度,提升芯片单位面积计算能力,为大模型训练和推理提供更强大的计算资源支持。然而,基于还原论的工程设计范式,芯片制程工艺艰辛迭代获得的物理算力提升,很难被大规模分布式物理系统上运行的软件算法有效利用。芯片峰值计算能力与算法系统性收益存在结构性错位,加之分布式系统在技术体制上受“大规模、低时延、高带宽”不可能三角问题制约,靠简单堆砌千张、万张乃至十万张以上GPU卡的方式,难以满足“规模定律-Scaling low”驱动的大模型训练之非线性算力增长需求。

  简而言之,由于存算分离体制的冯·诺依曼计算架构,硬件系统设计(如芯片制程、内存带宽、并发单元等)与算法模型的运算特征(如计算密度、数据流模式、精度需求等)之间存在系统性错位。即便芯片制程工艺有所进步,带来了性能增益,也会由于“逐级插损”的系统工程范式大打折扣。

  突破“制程工艺茧房”,在更高维度上寻求问题的解空间,需要变革传统刚性计算架构及技术物理实现范式。

  近80年来,传统计算架构一直沿用运算器、控制器、内存储器、输入输出设备几大件组成的冯·诺依曼计算架构。无论是复杂的AI算法,还是简单的数据处理任务,都被“硬塞”进刚性的计算架构之中,奢望“一劳永逸”地处理千变万化的应用。这就好比不管你脚多大,都必须穿37码的鞋才能走路。然而,鞋不合脚就走不快:小脚穿大鞋会绊脚;大脚穿小鞋则会感到疼,结局往往是“削足适履”。

  化解刚性架构算力与多样化算法间结构性矛盾,需要借助物理学增维求解法则,导入自适应计算架构新机理。

  2009年,受“自然界伪装大师”拟态章鱼启发,中国科学家在世界上首次提出领域专用软硬件协同变结构计算——拟态计算。如同拟态章鱼,可“随机应变”地隐匿在沙质海底或珊瑚礁等环境之中,拟态计算能让“鞋子”更好地适配穿着它走路的“脚板”。

  2018年,计算机体系结构大师、图灵奖得主大卫·帕特森和约翰·轩尼诗预言,基于软硬件协同计算语言的领域专用软硬件协同计算架构,将成为今后十年计算机体系架构黄金发展期的主流发展方向之一。前不久,特斯拉Dojo超算公布了其计算范式变革的解决方案,提出硬件架构像变形金刚般随任务变形,实现从“算法适应硬件”到“算法定义硬件”的范式转换。

  用二流零部件构建一流系统

  生成式变结构计算的核心在于按算法需求动态重构计算架构,要求算力的硬件载体能够实现以软件驱动物理结构变化,大幅度提升特定计算结构对特定算法的执行效能。SDSoW就是要推动计算架构从“刚性流水线”向“软件可塑形”跃迁,打通生成式变结构计算从理论到技术物理实现的闭环,使得基于二流器件或部件构建一流系统成为可能。

  具体来说,SDSoW具备五大能力。

  一是系统破局能力。SDSoW摆脱“核心器件决定论”思维,改变“芯粒、芯片、模组、机匣、机架、系统”的逐级堆砌、逐级插损式工程技术路线,通过晶圆级异构集成实现功能解构—晶上重组,达成功能等价、系统最优的目标,将制程工艺短板通过系统工程方法转化为非主要矛盾。

  二是整体增效能力。借助晶圆级高密度互连、超短距离、异质异构封装,获得高带宽、低延迟、低功耗的系统增益,SDSoW系统的带宽可提升一个数量级,时延可缩小一个数量级,功耗可降低一个数量级,系统效能可提升三个量级。

  三是通专融合能力。基于晶圆级系统硬件可编程/重定义架构,可通过软件实时配置或由AI大模型生成SDSoW功能和性能。在同一物理载体上,能根据不同应用需求或使用场景,实现“一平台、多样性”生成式变结构计算,既可满足专用场景特殊算力需求,又能兼顾领域内相对灵活的通用算力要求。

  四是开源协同能力。通过建立SDSoW开源社区,发布基础互连协议、动态控制器及生成式变结构计算工具链等,SDSoW可构建“中国引领、全球参与”的生态环境,以开放破垄断,形成相对Chiplet(小芯片)路线的比较优势。

  五是内生安全能力。SDSoW可从源头上应对开放生态带来的新域新质安全挑战,通过引入内生安全架构实现开放可控,即便供应链欠安全,仍能保证开放条件下该系统具有“开箱即用、默认安全”的网络弹性。

  总之,晶上生成式变结构计算可为我国打破算力芯片“制程工艺茧房”开辟新路径,走出一条用“三流材料、二流工艺”达成“一流能力”的系统工程级创新路线。通过应用与设计、算法与算力的垂直整合,解耦当前我国算力基础设施产品对芯片先进制程工艺的强依赖关系,最大程度获取体系结构与工艺进步的综合增益。晶上生成式变结构计算也能为全球智算普惠提供中国方案。

  基于晶圆级集成/封装的生成式变结构计算,开辟了算法架构突破与物理载体革命、算法工程实现与计算范式创新深度耦合的新方向。目前,应尽快推动根理论突破,重点攻关晶上热力学、异构集成理论、可重构架构数学描述等底层理论;持续加强根技术攻坚,突破晶圆级键合、3D互连、晶圆级操作系统、生成式结构计算语言/编译器等关键技术,实现从架构设计、物理实现到技术应用自主生态;多维推进根产业培育,以智能驾驶、具身智能、工业数字孪生、AI一体机等新兴市场需求为牵引,通过“场景开放+体系创新+生态聚合”三位一体模式,以超限创新、超常规举措突破“小院高墙”“遏制封锁”,蹚出一条中国特色技术平权和产业可持续发展之路。

  (中国工程院院士 邬江兴)

[ 责编:田新宇 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 粤桂协作助深山苗寨文化振兴

  • 山东青岛:小小蓝莓果 致富金豆豆

独家策划

推荐阅读
2025中关村论坛年会于3月27日至31日在北京举办,以“新质生产力与全球科技合作”为年度主题。其中将举办碳达峰碳中和科技、世界绿色设计等论坛,为新质生产力发展注入绿色动能。
2025-03-28 03:30
日前,我国自主研制的最大直径盾构机“沧渊号”成功下线,将承担世界最长公路水下盾构隧道——海太长江隧道工程左线掘进任务。大海古称“沧渊”,海太长江隧道横跨长江入海口,全长39.07公里,其中过江隧道长11.185公里,最大埋深超75米,计划于2028年建成。“沧渊号”开挖直径达16.66米,整机总长176米,总重量超5650吨,再创国产超大直径盾构机新纪录。
2025-03-28 04:00
3月27日,国家重大科技基础设施高能同步辐射光源HEPS正式宣布启动带光联调,这标志着HEPS装置建设进入冲刺阶段。HEPS是设计亮度世界最高的第四代同步辐射光源,也是我国第一台高能量同步辐射光源。截至2025年1月,经过多轮束流调试,HEPS储存环束流强度达到40毫安以上,发射度降低到93皮米弧度。
2025-03-28 04:00
3月27日,以“新质生产力与全球科技合作”为主题的2025中关村论坛年会在北京中关村国际创新中心拉开帷幕。来自100多个国家和地区的上千名嘉宾齐聚一堂,共议前沿科技趋势、共享创新思想、共谋发展机遇。
2025-03-28 03:30
近日,国家卫生健康委会同国家市场监督管理总局发布50项食品安全国家标准和9项标准修改单。截至目前,我国已累计发布食品安全国家标准1660项,包含2万多项指标,涵盖全部340余种食品类别。
2025-03-28 04:00
记者日前获悉,自去年10月全球洲际间断分布的5种崖柏属植物全部落户重庆市开州区崖柏国家林木种质资源库以来,科研团队已成功繁育崖柏实生苗30万株,崖柏扦插苗20万株,
2025-03-27 04:00
职业技能培训对劳动者提技增收、缓解就业矛盾意义重大。党中央、国务院高度重视职业技能培训工作,2024年印发《关于实施就业优先战略促进高质量充分就业的意见》,要求健全终身职业技能培训制度。
2025-03-27 05:10
长期以来,天气预报主要依赖于传统的数值天气预报模型。随着AI技术的突破,气象领域开始应用AI技术提高天气预报以及气候预测水平。2023年,《科学》杂志将“AI辅助天气预报的发展”评为世界科学十大进展,同年我国主导的AI大模型在精细化天气预报中的应用,更被评为中国科学十大进展之首。这些里程碑既展现了大气科学与AI融合的潜力,也为应对极端天气和防灾减灾创造了新机遇。
2025-03-27 05:10
当前,人工智能技术快速迭代并被应用到各行各业,从根本上改变着人类的生产生活。人工智能的发展越快,公众的期待与担忧越是急剧上升。如何平衡推进人工智能应用与治理,如何缩小科技发展带来的数字鸿沟,成为今年论坛上嘉宾热议的焦点之一。
2025-03-27 05:10
近日,国家互联网信息办公室、工业和信息化部、公安部、国家广播电视总局联合发布《人工智能生成合成内容标识办法》(以下简称《办法》)。《办法》聚焦人工智能“生成合成内容标识”关键点,通过标识提醒用户辨别虚假信息,明确相关服务主体的标识责任义务,规范内容制作、传播各环节标识行为,将于2025年9月1日起施行。如何让人工智能生成合成内容“亮明身份”,不再“真假难辨”?如何破解人工智能安全治理难题?记者就此进行了采访。
2025-03-27 05:10
当前,人口老龄化问题正在全球范围内加速蔓延,已经成为世界各国必须面对的共同挑战。世界卫生组织数据显示,预计2050年全球60岁以上人口数量将达21亿,其中包括4.26亿80岁以上的老年人。在养老领域,养老机器人不仅可以减轻社会和家庭照料老年人的负担,还可支持老年人享受高质量的居家生活,因此智能养老机器人正逐渐成为世界各国应对人口老龄化挑战的重要技术手段。
2025-03-27 05:10
目前,中国电信积极探索中央企业和国家科研院所的深度合作范式,打通基础研究和成果转化通道,推动量子技术产业化发展。
2025-03-26 10:28
至此,中国空间站舱外航天服已经圆满保障空间站任务以来的19次出舱活动,使用年限次数超出“3年15次”的寿命设计指标。
2025-03-26 10:27
中国人工智能大模型加速“出海”“出圈”,让更多澳大利亚华商和杨东东一样,开始将目光瞄准中国人工智能领域,积极寻找投资机会。
2025-03-26 10:27
随着生活水平的提高,人们的文旅需求正从“看山看水看风景”向“品文品魂品生活”转变。比如,逛博物馆,青铜器的精美纹饰固然能够吸引人的兴趣,但观众更希望了解青铜器纹饰背后的礼制密码;去故宫旅游,飞檐斗拱彰显的传统建筑之美固然让人欣喜,但榫卯结构背后的“天人合一”哲学更引人深思。山水器物背后的文化密码,具有一定的隐匿性,不易被直接观察和理解,而数智技术为游客了解这些文化密码提供了一把钥匙。
2025-03-26 04:45
记者从25日召开的中央企业“人工智能+”媒体通气会上获悉,近年来,国务院国资委持续深化中央企业“人工智能+”专项行动,着力提升中央企业在人工智能领域的竞争力。截至目前,中央企业在工业制造、能源电力、智能网联汽车等重点行业布局应用人工智能,科研、生产、客服等方面降本增效明显。
2025-03-26 04:45
25日,人类细胞谱系大科学研究设施(以下简称“细胞谱系设施”)在广东广州国际生物岛正式启动建设。这一设施是国家“十四五”重大科技基础设施,
2025-03-26 03:45
1956年,27岁的林皋带领年轻教师和同学们从零开始,通过自行设计制作的激振和测振仪器设备,在我国率先开展大坝抗震试验。
2025-03-25 09:10
2024年财政收入恢复性增长,比上年增长1.3%。在深入实施创新驱动发展战略,促进现代化产业体系加快建设方面,《报告》指出,推动加快实现高水平科技自立自强。
2025-03-25 09:09
在应用数学中心,来自东南大学通信、网络安全、电子、医学、制药等约10个学科的科研团队经常汇聚一堂,寻找交叉融合的合作点。
2025-03-25 09:05
加载更多