在华为全联接大会上,华为副董事长、轮值董事长汪涛发表了以“智启新未来,打造智能世界的硅基黑土地”为主题的演讲,与产业界共同探讨如何通过合作构建强大的AI基础设施,为智能世界筑牢坚实的算力基础,迎接即将到来的机遇与挑战。

AI技术的变革速度远超以往任何一次技术革命。当前,大模型参数正快速迈向10万亿级别,预计到2030年将突破100万亿;智能体的工作模式也从按小时连续工作向按月执行任务转变;中国每日推理Token数量已增长至约500万亿,预计到2030年将达到百万万亿级。与此同时,端侧智能也在迅速发展,手机模型参数从2024年的3B提升至如今的30B,未来将进一步迈向100B级。这些变化对AI基础设施的规模、性能和可靠性提出了更高要求,只有打造更强大的AI基础设施,才能为智能世界提供坚实支撑。
华为始终聚焦AI基础设施领域,致力于打造智能世界的“硅基黑土地”。其AI战略的核心是算力,通过硬件创新和系统架构优化,围绕“超节点+集群”构建竞争力。华为坚持构建开源开放的算力生态,支持主流大模型基于昇腾进行原生训练,积极拥抱“百模千态”。同时,华为面向客户提供灵活的线上线下算力方案,加速千行百业的智能化转型;在端侧场景中,通过提供多样化算力,推动AI入端、上车,实现物联轻智能升级,让智能无处不在。华为还围绕“用算”需求构筑新一代通信网络,将智能传递给每个人、家庭和企业。
超节点已成为产、学、研领域的共识,是建设超大规模AI基础设施的必然选择。它通过物理上多个计算节点的高效互联,形成具备跨节点统一内存编址能力的计算系统,逻辑上表现为“一台计算机”。截至目前,昇腾910C超节点已部署超过1000套,昇腾950超节点也已实现规模商用。在训练十万亿级SOTA模型时,10万卡集群已成为标配,但传统服务器架构导致集群内通信时间占比超过40%,严重制约了模型浮点算力利用率(MFU)。华为马尔科夫实验室的仿真结果显示,由4K超节点组成的10万卡集群相比8卡服务器组成的集群,MFU提升了2.75倍。
华为基于灵衢UnifiedBus打造了11颗关键芯片,并发布了业界首个采用NPO(Near-Packaged Optics)技术的昇腾960超节点。昇腾960芯片的研发进度超出预期,性能实现倍增:960DT比原计划提前三个季度,将于2027年第一季度就绪;960PR比原计划提前一个季度,将于2027年第三季度就绪。未来,昇腾系列芯片将保持一年一代的演进节奏,2028年和2029年将陆续推出昇腾970、980芯片,依托τ定律创新方向,实现算力规格翻倍,访存带宽、容量和互联带宽等指标显著提升。
除了昇腾芯片,华为还基于灵衢UnifiedBus打造了系列化套片,全面覆盖计算、互联、存储和管理等关键能力。在超节点互联方面,华为研发了新一代NPO光互联产品——Hi-ONE,通过光、机、电、磁、热等要素的均衡设计,实现了单引擎7.2T的传输容量。这是业界首个量产的NPO产品,也是目前传输能力最强、唯一实现内置光源的NPO产品。Hi-ONE将“高带宽、高可靠”与“低时延、低功耗”完美融合,与灵衢总线协议共同构建了可规模扩展的超节点互联系统。华为还在全球光互联标准组织OIF提出了NPO标准立项建议,得到行业伙伴的积极响应,进一步完善了NPO产业生态。
基于昇腾960芯片和Hi-ONE,华为打造的昇腾960超节点单个规模为4096卡,最大可提供8E FP8算力和1PB HBM容量。该超节点使用5500个Hi-ONE替代了原本需要的4万8千颗800G光模块,降低了超550千瓦功耗,系统无故障运行时间提升一倍,系统可用度达到99.8%。
随着SOTA模型参数规模达到10T级,训练和推理系统已演变为复杂的算力系统,涵盖智算超节点、通算超节点和互联系统,推理系统还需部署PB级KV缓存集群。华为对鲲鹏超节点进行了全新升级,基于灵衢全光组网,最大支持4096节点,形成256TB统一内存池,显著加速Agent性能。在Agent沙箱场景中,十万级别沙箱启动速度比传统服务器方案提升30倍,沙箱密度可再提升25%;在Agent向量检索场景中,百亿千维复杂向量检索效率实现倍增。
华为还基于灵衢打造了AI记忆存储——OceanStor M900。针对Agent推理系统对多层次KV Cache架构的需求,华为提出了多层KV缓存架构,推出支持“一跳直连”的L3.5层PB级KV缓存集群。OceanStor M900采用混合介质加优化Retention算法,将SSD读写寿命提升16倍,从底层保障KV命中和长稳可靠。
华为发挥“计算+通信”综合优势,推出了全新的Agentic超节点集群,加速10万亿大模型的训练和推理。基于灵衢UnifiedBus统一互联,将多种互联协议统一为灵衢协议,大幅减少协议转换开销,实现昇腾超节点、鲲鹏超节点和KV缓存集群等子系统的平等互联。通过二层CLOS四平面组网,最大集群规模可达51.2万卡,结合多轨道拓扑技术,最大可支持100万卡昇腾超节点集群。

构建开源开放的算力生态是华为的核心战略之一。鲲鹏生态已引领千行百业数智化创新,全球开发者超过416万,生态合作伙伴超过7200家,支持560多个全球开源项目,openEuler装机量超过2000万套,成为中国服务器操作系统市场份额第一。昇腾生态已跨越拐点,CANN作为生态根基,已进入常态化开源社区运作,从“可用”迈向“易用”。CANN外部开发者占比达61%,社区月活开发者突破5200名,成为中国最活跃的开源社区;基于昇腾+CANN的原生训练模型超过40个,是国内唯一支持预训练的技术路线;昇腾已覆盖90多个主流三方社区,如PyTorch、Triton等,并在PyTorch官网成为可直接安装的算力平台,也是首个来自中国的算力平台,全球开发者可更便捷地获取昇腾生态的创新成果。
AI入端正在全面加速,华为将持续构建能力,为用户提供AI全场景极致体验。通过麒麟和昇腾组合实现端侧算力自给自治,通过盘古和三方大模型实现端侧智能好用易用,HarmonyOS作为智能无处不在的Agent OS,将从系统底层架构、运行机制和交互逻辑全面重构,支撑Agent与人共生共用。丰富的AI生态是小艺系统智能体繁荣发展的基础。华为将重点围绕AI Phone、AI PC、车和家庭场景打造四大端侧算力平台,通过端端和端云算力协同,构筑分布式群体智能,围绕个人移动空间、办公空间、车空间和家空间提供一体化的连续智能服务,实现全场景伴随。
没有网络的算力是信息孤岛,华为围绕“用算”需求构筑新一代通信网络,推动通信网络从服务于人的连接向围绕用算发生根本性变革。基于5G-A/6G、万兆光网及多级协同低时延承载网,华为打造了从中心到边缘到端的智能联接体系。
汪涛在演讲中表示:“人工智能也许是人类社会最后一次技术革命,其变革之深、之广、之快远超想象,没有任何一家公司能独自支撑整个智能世界。华为聚焦AI基础设施,坚持打造硅基黑土地,让算力触手可及;坚持软件开源开放,让开发者释放潜能;坚持拥抱百模千态,让价值多元释放;坚持合作共赢,让客户成功、伙伴成长。让我们携手,共建万物互联的智能时代。”
华为全联接大会于上海世博展览馆及世博中心举办,本届大会以“智启新未来”为主题,通过“战略全景-产业技术-生态发展”的三维视角,阐释华为全面智能化战略的最新举措,并发布创新的产品与解决方案、丰富的行业智能化应用样板点、好用易用的开发者工具与平台等。






