20260725-国盛证券有限责任公司-电子行业周报_大模型持续升级_国产超节点开启军备竞赛_13页_1mb
报告摘要
国产超节点发展与市场前景总结
核心内容概述
随着大模型参数持续膨胀,AI 基础设施正从单颗芯片性能竞争转向超节点系统的组织效率竞争。超节点作为 AI 训练与推理的核心基础设施,正成为行业关注的焦点。《超节点定义与实践白皮书》的发布标志着行业标准的确立,推动超节点进入规模化放量阶段。预计到 2028 年,国产超节点市场空间将达到 3414 亿元,2026-2028 年复合年均增长率高达 194%。
主要观点
- 行业趋势:大模型训练和推理需求激增,超节点成为 AI 基础设施的核心赛道,系统互联、通信时延、内存共享和集群调度能力成为竞争关键。
- 技术特征:超节点具备“内存语义”、“统一内存编址”、“超低时延”和“超大带宽”等核心特征,支持大模型的高效训练和推理。
- 市场潜力:国产超节点市场增长迅速,2028 年有望突破 3414 亿元,呈现爆发式增长。
- 厂商创新:国内厂商通过系统架构创新弥补单点算力不足,实现大规模部署与灵活扩展,形成差异化竞争优势。
- 应用落地:超节点已在多个行业实现规模化商用,涵盖互联网、运营商、金融、医疗、交通、制造等领域,支撑大模型的复杂应用。
关键信息
大模型参数与算力需求
- 2026 年大模型参数规模预计突破 3000 亿,2028 年将达到 5000 亿至 6000 亿。
- 参数增长直接推动算力、显存和卡数的成倍提升,超节点成为支撑大规模模型训练与推理的必要基础设施。
国产超节点产品亮点
| 厂商 | 产品名称 | 核心优势 |
|---|---|---|
| 华为 | 昇腾 950 超节点 | 支持 1024 卡规模,提供 1 EFLOPS FP8、2 EFLOPS FP4 算力,256TB 全局内存,3μs 超低 RTT 时延 |
| 摩尔线程 | MTT C256 超节点 | 支持 256 卡全互联,单机柜 GPU 密度领先,兼容现有生态,支持万卡到十万卡扩展 |
| 壁仞科技 | BR2xx 芯片+ BLink™2.0 协议 | 支持 1024 卡 Scale-up 扩展,具备内存语义、网计算、智能拥塞控制、多层链路自愈能力 |
| 沐曦股份 | 曦景 S600 超节点 | 支持 64 卡高速全互连,采用“三 0 设计”,实现计算、交换、电源、液冷模块化部署,降低运维成本 |
| 中科曙光 | 8000(登峰) | 全国产十万卡 AI 超集群,兼容 FP64 高精度科研计算与 INT8 大模型推理,支持 MoE 万亿参数模型性能提升 |
技术对比与性能提升
- 华为昇腾 950 超节点:在 BF16 密集计算性能上达到 GB200 NVL72 的 1.7 倍,HBM 总容量是后者的 3.6 倍,内存带宽是后者的 2.1 倍。
- 沐曦曦景 S600 超节点:通过 OEX 架构设计,实现 GPU 低时延、高带宽通信,支持分布式训练与推理。
- 壁仞科技 Token 工厂方案:通过五级缓存架构,实现 95% 以上的缓存命中率,大幅减少重复计算开销。
产业信号与未来展望
- 标准落地:《超节点定义与实践白皮书》发布,确立统一标准,推动行业进入规范化发展阶段。
- 生态兼容:国产超节点产品逐步兼容现有软硬件生态,支持从万卡到十万卡级集群平滑扩展。
- 大规模部署:超节点通过高效互联协议、低时延通信、高带宽传输等技术,提升集群整体性能,降低部署复杂度与成本。
- 应用场景:超节点不仅适用于大模型训练与推理,还支持 Agentic AI、MoE 模型等复杂 AI 应用,提升整体算力效率。
投资建议与风险提示
- 投资建议:详见第二章相关标的,建议关注具备超节点研发与部署能力的厂商。
- 风险提示:
- 下游需求不及预期
- 研发进展不及预期
- 地缘政治风险
结论
国产超节点正在成为 AI 基础设施竞争的新高地,凭借系统架构创新、高效互联、灵活扩展等优势,弥补单点算力不足,满足大模型训练与推理的高性能需求。随着大模型参数的持续增长和行业对高效算力基础设施的迫切需求,国产超节点有望在未来三年迎来爆发式增长,成为推动 AI 行业发展的关键力量。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载