2026年下半年中国大型互联网企业将规模化部署超节点方案,华为、中科曙光等已推出1024卡产品
本文是 24TopNews 对公开财经信息完成重复合并后的事件分析,不是原始采访或证券推荐。
超节点是一种通过高速互联技术将多张GPU或加速卡从多台服务器深度整合为逻辑上像一台超级计算机的系统,可解决传统集群跨机器通信的带宽和延迟瓶颈,提升GPU利用率并降低单位Token成本。2026年世界人工智能大会上,华为展出了由20个机柜组成的1024卡昇腾950超节点真机,中科曙光展示了浸没式液冷640卡超节点,百度天池、阿里云灵骏真武M890、浪潮信息元脑以及沐曦曦景S600均被置于展台突出位置。新华三人士表示,超节点整机价格高于同等卡数普通服务器,但算力密度更高、空间更小,企业需在有限空间承载更多算力。DeepSeek此前未采用超节点,近期已明确计划采用并正在议价。
国内超节点赛道形成三条路线:华为、中科曙光和百度走向大规模节点,华为已展示1024卡超节点,2026年第四季度将批量交付8192卡超节点,其去年推出的384卡超节点已在互联网、金融、能源、教育、医疗等行业商用落地750余套;中科曙光采用浸没式液冷,单机柜640张加速卡,由其构建的十万卡算力集群已落地国家超算互联网郑州核心节点,利用率达90%;百度智能云天池超节点从256卡向512卡演进,强调全栈自研。阿里云灵骏真武M890以64卡为一个Scale-up单元,可通过Scale-out扩展至更大集群,并可放到公共云按需调用。浪潮信息去年推出64卡超节点,今年再推32卡产品,可支撑万亿参数大模型推理。沐曦以单柜64卡为基础,强调CUDA生态兼容和横向扩展。
清微智能采用可重构数据流架构,芯片之间可直接互联,已推出4096卡、峰值算力500PFLOPS的超节点,并在北京、内蒙、新疆、浙江等地部署。
线上推理与训练比例已接近5:1至10:1,大部分算力用于推理。超节点虽整机价格高于同卡数服务器,但算力密度更高、耗电更低,性能可提升10倍而耗电仅提升2倍。传统模式下10台机器算力相加仅能达到6台效能,超节点通过高速互联将损耗降到最低,在PD分离推理场景中比普通同卡数机器性能提升30%至50%。超节点涉及GPU、存储、通信、散热、供电、软件等多环节,目前已进入可批量落地阶段,各厂商具备整机交付能力。
在生态上,阿里平头哥、沐曦等走CUDA兼容路线,华为昇腾、昆仑芯走自研生态路线。在互联介质、液冷技术等方面存在不同选择。一个共识是软硬架构协同,超节点演进与模型技术路线密切相关,国内模型企业在Attention路线上分化为Linear Attention和Smart Attention两种阵营,未来两三年内的演进将影响超节点硬件适配。
超节点正成为AI基础设施建设的底座,美国算力约为中国的9倍。随着更多厂商具备整机交付能力,竞争焦点转向批量交付、稳定运行和降低每Token成本,供应链锁定成为重要挑战。