科技·商业·财经

2026年超节点成算力竞赛焦点:需求、效能与交付能力成关键驱动力

   时间:2026-07-27 13:25 作者:任飞扬

在2026世界人工智能大会上,超节点成为焦点展品。华为展示了由20个机柜组成的1024卡超节点真机,中科曙光则呈现了配备沸腾冷却液的640卡超节点。百度天池、阿里云灵骏真武M890、浪潮信息元脑以及沐曦曦景S600等超节点产品均被置于展台核心位置,彰显了这一技术领域的蓬勃发展态势。

超节点技术通过高速互联将大量GPU或加速卡整合为逻辑上的超级计算机,突破了传统集群跨机器通信的带宽和延迟瓶颈,显著提升了GPU利用率并降低了单位Token成本。据华为资深人士透露,该技术已成为AI基础设施建设的核心趋势,国产超节点已具备批量交付能力,预计年底前主流算力企业将全面掌握这一技术。

追溯技术发展脉络,2024年英伟达推出的GB200 NVL72架构首次将72颗GPU纳入高速互联域,但当时市场需求有限。随着2025年大模型参数规模突破万亿级,超节点技术迎来爆发期。国内厂商如华为、百度、浪潮信息等早在2024年前后启动技术预研,2025年实现产品上市,形成三条主要技术路线:规模扩张型、经济部署型和架构创新型。

在规模扩张阵营中,华为已展示8192卡超节点技术,计划四季度批量交付。其384卡超节点已在互联网、金融、能源等领域落地750余套。中科曙光采用浸没式液冷技术实现单机柜640卡部署,构建的十万卡集群"曙光8000"已承载国家超算互联网郑州核心节点90%的算力需求。百度智能云则推进天池超节点从256卡向512卡演进,强调全栈自研能力,其交付的万卡集群已支撑文心5.1训练及能源行业80余个场景应用。

经济部署阵营的代表企业阿里云推出64卡灵骏真武M890,通过Scale-out网络扩展集群规模,并将算力形态引入公共云服务。浪潮信息同步推出32卡超节点产品,宣称可支撑万亿参数大模型推理,沐曦则以单柜64卡为基础,强调CUDA生态兼容性。这些企业认为64-128卡规模在时延控制与成本效益间达到最佳平衡。

架构创新阵营中,清微智能采用可重构数据流架构,实现芯片间直连无需交换机,已部署4096卡、500PFLOPS算力集群。东方算芯7月推出的新产品同样采用该架构,在金融、能源领域实现落地应用。摩尔线程计划年底伴随新一代GPU推出超节点产品,寒武纪也被预测将加入赛道。

技术爆发背后存在三大驱动因素:模型参数规模持续膨胀,Kimi发布的2.8万亿参数模型预示着未来三年将突破10万亿级;算力经济性显著提升,超节点虽单价较高,但通过降低风火水电等基础设施成本实现总体效益优化;工程化能力成熟,产业链已具备GPU芯片、散热、供电等核心组件的批量交付能力。

在应用场景方面,行业存在训练与推理的侧重分歧。华为认为超节点在万亿参数模型训练和Agent推理场景均具价值,沐曦则强调其在推理解码阶段的突出优势。清微智能透露其产品更多用于模型微调训练,而摩尔线程定位为面向1-5万亿参数训练的高速推理平台。

技术路线分歧还体现在生态兼容与硬件架构层面。阿里平头哥、沐曦等企业坚持CUDA兼容路线以降低迁移成本,华为昇腾、昆仑芯则构建自研生态。在互联介质选择上,铜缆与光纤之争持续,液冷技术领域则呈现风冷与浸没式液冷的代际更替。这些选择背后折射出企业对技术瓶颈、运维成本及商业价值的综合考量。

尽管存在分歧,业界在软硬协同创新方面达成共识。浪潮信息董事长彭震指出,当前基础设施发展已突破摩尔定律框架,转向算法与硬件的联合创新。沐曦CTO杨建预测,随着AI渗透至道路设计、机械制造等知识生产领域,超节点技术将开启长达二三十年的发展周期。这场算力革命正推动中国AI基础设施向每Token成本持续优化的方向演进,供应链稳定性将成为决定企业竞争力的关键因素。

 
 
更多>同类内容
全站最新
热门内容