20250323-中国银河-通信行业_推理算力重要性提升_光模块发展再加速_11页_2mb
报告摘要
推理算力重要性提升,光模块发展再加速
核心内容
2025年3月,英伟达在GPU技术大会(GTC2025)上发布了多项新技术与产品,进一步推动了AI推理算力的发展。随着AI工厂、Blackwell Ultra架构、CPO交换机及Nvidia Dynamo和Llama Nemotron等软件与硬件的联合推出,算力需求持续增长,尤其是在推理、代理式AI和物理AI领域。这标志着算力行业进入新的增长阶段,相关产业链具备较大的投资价值。
主要观点
- 算力需求持续增长:英伟达CEO黄仁勋指出,构建AGI、具身智能机器人、Omniverse和世界模型需要大量算力,预计未来算力需求将是当前的100倍。
- 硬件性能显著提升:Blackwell Ultra架构推出,性能比Hopper提升68倍,成本下降87%。预计2026年推出基于Rubin架构的GPU,性能提升达900倍,成本下降99.97%。
- 软件优化推动效率提升:Nvidia Dynamo简化推理部署与扩展,Llama Nemotron模型具备高效、准确的推理能力,有助于构建AI Agent生态。
- 光模块技术加速迭代:CPO交换机系列采用1.6T硅光引擎,预计2025年下半年量产,将带动光模块需求持续增长。
- 投资建议:算力板块在推理应用的推动下仍具备较大增长空间,建议关注运营商、光模块、光芯片及AIDC相关企业。
关键信息
硬件发展
- Blackwell Ultra架构:于2025年下半年上市,包含12层堆叠HBM3e内存,显存提升至288GB,带宽达576TB/s,性能是GB200的1.5倍。
- NVL72机柜:内置72颗Blackwell Ultra GPU和36颗Grace CPU,HBM容量20TB,支持FP4精度推理算力达1.1ExaFLOPS,FP8训练算力达1.2ExaFLOPS。
- Rubin架构GPU:预计2026年上市,性能是Blackwell Ultra的3.3倍,FP4推理算力达3.6ExaFLOPS。
- Vera Rubin NVL576机柜:预计2027年推出,算力提升至15ExaFLOPS(FP4)和5ExaFLOPS(FP8),是Blackwell Ultra的14倍。
- CPO交换机:基于1.6T硅光引擎,Spectrum-x预计2025年下半年商用,Quantum-x预计2026年下半年商用,采用微环调制器(MRM)和TSMC N6工艺,有望显著降低功耗。
软件发展
- Nvidia Dynamo:开源AI引擎栈,专注于推理部署与扩展,可提升标准Llama模型性能一倍以上,对DeepSeek等推理模型提升30倍以上。
- Llama Nemotron:基于Llama模型优化的推理模型,参数规模为48B,具备类似o1的推理能力,内置推理开关,分为Nano、Super、Ultra三档。
- NVIDIA AIQ架构:作为AI Agent模板,结合Llama Nemotron,推动AI Agent生态建设。
投资建议
- 运营商:中国移动、中国联通、中国电信等,受益于国家政策支持和算力新业务增长。
- 光模块:中际旭创、新易盛、天孚通信、光迅科技、华工科技等,随着算力需求增长,光模块产品迭代加快,量价齐升。
- 光芯片:源杰科技、仕佳光子等,国产化进程加速,具备成本和技术优势,有望提升在推理侧的渗透率。
- AIDC行业:光环新网、数据港等,算力需求推动数据中心建设与扩容,提升上架率和新机房需求。
风险提示
- AI发展不及预期:若AI技术发展不如预期,可能影响算力需求结构。
- 全球地缘政治不确定性:贸易保护和关税变化可能影响算力相关板块的利润弹性。
- 算力发展不及预期:硬件发展速度和建设意愿将影响算力行业整体增速。
建议关注的子板块
- 运营商:中国移动、中国联通、中国电信
- 光模块:中际旭创、新易盛、天孚通信、光迅科技、华工科技
- 光芯片:源杰科技、仕佳光子
- AIDC:光环新网、数据港
总结
GTC2025标志着英伟达在硬件与软件层面的双重发力,推动了推理算力的持续增长。Blackwell Ultra及后续Rubin架构GPU的推出,显著提升了算力性能并降低了成本,而Dynamo和Llama Nemotron等软件工具则进一步优化了推理部署与效率。光模块与光芯片技术加速发展,CPO交换机有望实现量产,带来行业景气度提升。在算力需求不断增长的背景下,相关细分领域具备较高的投资价值。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载