点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:浪潮信息发布“元脑SD200”超节点,面向万亿参数大模型创新设计
首页> 科技频道> 创新创业 > 正文

浪潮信息发布“元脑SD200”超节点,面向万亿参数大模型创新设计

来源:光明网2025-08-07 18:28

  当前,开源模型正取得飞跃式进步,推动研发范式从封闭走向开放协作。随着大模型参数量的持续提升,对算力基础设施的建设提出了更高要求。8月7日,浪潮信息发布面向万亿参数大模型的超节点AI服务器“元脑SD200”。该产品基于浪潮信息创新研发的多主机低延迟内存语义通信架构,以开放系统设计向上扩展支持64路本土GPU芯片。

  据介绍,元脑SD200可实现单机内运行超万亿参数大模型,并支持多个领先大模型机内同时运行及多智能体实时协作与按需调用,目前已率先实现商用。在实际评测中,元脑SD200运行DeepSeek R1和Kimi K2等全参模型的64卡整机推理性能实现超线性扩展。浪潮信息通过开放系统架构创新,为开源大模型的规模化落地和应用创新提供关键支撑。

浪潮信息发布“元脑SD200”超节点,面向万亿参数大模型创新设计

  随着混合专家模型(MoE)的高效架构驱动大模型参数规模持续扩展,国内外前沿大模型的参数量快速突破万亿规模,这给算力系统架构提出新的挑战。一方面,模型参数量增加和序列长度增加带来的键值缓存(KV cache)激增,需要智能计算系统具有超大显存空间承载,依靠单芯片或节点的性能提升已难以为继;且其推理过程作为通信敏感型计算,对分布式计算通信延时要求极高,需要构建更大向上扩展(Scale up)高速互连域。另一方面,智能体AI开启多模型协作的新范式,其推理过程需要生成比传统模型多近百倍的数据词元(token),导致计算量激增。

  元脑SD200超节点AI服务器是浪潮信息面向万亿参数大模型AI时代而设计,创新研发多主机低延迟内存语义通信架构,基于开放总线交换技术构建,在单机内实现了64路GPU芯片的高速统一互连,成功解决万亿大模型对超大显存空间和超低通信延时的核心需求。在开放架构之上,元脑SD200通过智能总线管理和开放的预填充-解码(Prefill-Decoder)分离推理框架实现软硬件深度协同,智能化管理复杂AI计算任务。

  在架构层面,元脑SD200基于自主研发的开放总线交换技术首创多主机三维网格系统架构,实现64路本土GPU芯片高速互连;通过创新远端GPU虚拟映射技术,突破多主机交换域统一编址难题,实现显存统一地址空间扩增8倍,单机可以提供最大4TB显存和64TB内存,为万亿参数、超长序列大模型提供充足键值缓存空间。同时,依托百纳秒级超低延迟链路,构建64卡大高速互连域统一原生内存语义通信,实测结果表明,在推理过程常见的小数据包通信场景中,全规约(All Reduce)性能表现优异,显著提升计算与通信效率。

  在系统层面,根据万亿参数大模型计算、通信需求特征,浪潮信息开发智能总线管理系统,实现超节点64卡全局最优路由的自动创建,支持不同拓扑切换,资源按需切分。对于全规约、全聚集(All Gather)等典型通信算子,开展不同数据量大小的细粒度通信策略设计,如多层级通信机制等,实现通信延时进一步降低。同时依托开放的PD分离框架,支持异步KV Cache高效传输与差异化并行策略,在提升业务服务级别目标的同时保持对多元算力的兼容性,实现计算与通信架构的深度协同优化。

  元脑SD200超节点AI服务器通过软硬协同系统创新,成功向上扩展突破芯片性能边界,在大模型场景中展示出优异的性能表现。结合优化的PD分离框架,SD200超节点满机运行DeepSeek R1全参模型推理性能超线性提升比为3.7倍,满机运行Kimi K2全参模型推理性能超线性提升比为1.7倍。 (战钊)

[ 责编:王若昕 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 第七届上海国际艺术品交易周举行

  • 扎根山村的“姐妹花”

独家策划

推荐阅读
以“智跃无界,开源致远”为主题的操作系统大会2025(以下简称“大会”)在北京举办。
2025-11-14 17:08
我国在4个国家开展6处文物古迹保护修复,49项中外联合考古项目涉及28个国家和地区,用实际行动践行全球文明倡议、不断丰富世界文明百花园。
2025-11-13 07:07
由四川省人民政府主办的2025世界动力电池大会12日在宜宾市开幕。
2025-11-13 04:55
据估算,太阳每秒钟释放的能量,可供全人类使用约70万年。模拟太阳来产生无尽的清洁能源,也因此成为人类的“终极能源梦想”。
2025-11-13 04:55
日前,中国科学院合肥物质科学研究院智能机械研究所、中科合肥智能育种加速器创新研究院联合发布重要成果:全链条机器人育种家“小海”与“海霸设施”小麦快速育种商业化服务平台同步启动,标志着我国在智能育种装备与工程化应用上取得关键突破。
2025-11-13 04:55
日前,记者从全球规模最大的恐龙蛋化石遗址——湖北青龙山恐龙蛋化石群国家级自然保护区获悉,数字化档案建设团队正为库藏的每一枚较完整恐龙蛋化石,赋予由“保护区名称—化石产地名称—库藏箱编号—标本编号”构成的唯一“身份证ID”。这标志着该保护区首次实现恐龙蛋化石专属标识管理。
2025-11-13 04:55
困扰无数人的睡眠问题,终于有一部纪录片说清楚了!
2025-11-13 08:55
国家卫生健康委百万减残工程专家委员会主任委员、中国医学科学院北京协和医学院院校长吉训明介绍,目前,全国已有20个省份成立减残工程专委会,8个省份正在积极推进。
2025-11-12 07:24
2025年是中国科学院院士、我国理论物理学奠基人、“两弹一星功勋奖章”获得者彭桓武诞辰110周年。
2025-11-12 07:23
由中国科学院昆明动物研究所牵头,联合国内外多家科研机构组成的研究团队,通过对现存及灭绝长臂猿的大规模基因组测序与比较分析,系统阐明了长臂猿科的演化历程、种群动态及其标志性长臂表型的遗传基础,为全球长臂猿的保护行动提供了新的科学见解,相关研究成果日前发表于国际学术期刊《细胞》。
2025-11-12 05:10
11月11日,长征八号甲遥五运载火箭在海南商业航天发射场成功实施转运,计划择期发射。
2025-11-12 05:10
近日,中核集团中国原子能科学研究院主导建设的量子放射性计量实验室及电离辐射计量级设备“一线多用”产研平台正式投入运行,成功填补我国在低温量子磁量热计领域的空白。
2025-11-12 05:10
在数据管理与使用方面,《实施方案》提出,实行物流公共数据分类分级管理,规范开展数据授权运营,扩大路网、轨迹、企业、人员等关键数据供给。
2025-11-11 10:03
中国科协日前发布的《中国科技期刊发展蓝皮书(2025)》显示,我国科技期刊总量持续增加,从2023年的5211种提升至2024年的5325种,整体影响力稳步提升。
2025-11-11 10:04
空天地一体化网络作为国家信息化的重要基础设施,其战略意义远超普通通信技术范畴,它不仅是我国实现信息全球覆盖、自主创新的必由之路,更是在数字时代掌握发展主动权的关键布局。
2025-11-11 10:02
拔尖创新人才培养不是考验瞬间爆发力的短跑,而是需要长期持久力的马拉松。 在课程体系搭建上,北航实验学校打造了“五级阶梯式”科技创新人才贯通培养课程群,实现从基础普及到进阶的无缝衔接。
2025-11-11 10:00
日前,国务院办公厅印发《关于加快场景培育和开放推动新场景大规模应用的实施意见》(以下简称《意见》),对相关工作作出部署。
2025-11-11 09:50
11月9日,国航C919重飞“两航起义”航线主题航班从香港飞抵天津,重温76年前“两航起义”的北飞航程,致敬“两航起义”爱国壮举。“两航”后代陈绍曾介绍,76年前,“两航起义”飞行员从香港驾驶12架飞机飞抵北京、天津,建设新中国民航事业。
2025-11-10 10:10
“超级细菌”指那些对多种抗生素具有耐药性的细菌。研究人员在一种常用药物的生产流程中意外发现一种很有前景的强效抗生素,能够杀死耐甲氧西林金黄色葡萄球菌等“超级细菌”。
2025-11-10 10:09
11月9日,2025年世界互联网大会乌镇峰会在浙江乌镇闭幕。世界互联网大会秘书长任贤良用“聚焦构建网络空间命运共同体理念”“关注创新发展热点议题”“不断擦亮峰会品牌”“持续贡献智慧力量”概括了本届峰会的特点。
2025-11-10 10:08
加载更多