计算机行业专题研究:英伟达GTC大会发布Blackwell平台,引领加速计算新时代-240321-国联证券-17页_1mb
报告摘要
计算机行业分析总结
核心内容
NVIDIA在2024年GTC大会上发布了全新的Blackwell架构芯片平台,标志着其在加速计算领域的新突破。该平台不仅在硬件性能上实现显著提升,还在软件生态构建方面取得进展,推动AI技术在多个行业的应用。
主要观点
- Blackwell架构性能提升显著:新发布的Blackwell架构芯片在FP8性能上是上一代的2.5倍,FP4性能提升至5倍,互联速度提升2倍,可扩展至576个GPU。
- B200与GB200超级芯片:B200由两个Blackwell芯片组成,GB200超级芯片由两个B200和一个Grace CPU组成,通过NVLink实现超低功耗互连。
- GB200 NVL72计算单元:18个计算节点组成,提供720petaflops的AI训练性能和1.4exaflops的AI推理性能,是当前最强大的AI计算单元之一。
- NVIDIA DGX SuperPOD:基于GB200平台的新一代AI超级计算机,具备11.5exaflops的AI计算能力,支持FP4精度,可扩展至更大规模。
关键信息
硬件性能突破
- Blackwell芯片:单芯片FP8性能是Hopper的2.5倍,FP4性能是5倍,互联速度提升2倍,支持高达10万亿参数的AI模型。
- B200 GPU:包含2080亿个晶体管,10TB带宽互联,支持更复杂的AI任务。
- GB200超级芯片:由两个B200 GPU和一个Grace CPU组成,通过900GB/s NVLink互连,提升推理性能至30倍,训练性能提升至7倍于H100。
- GB200 NVL72:由36个CPU和72个GPU组成,提供720petaflops训练性能和1.4exaflops推理性能,支持大规模AI训练与推理。
软件生态构建
- NIM微服务:提供预构建容器和API,缩短部署时间,支持多个领域模型,如语言、语音、医疗等。
- CUDA-X微服务:包含多种GPU加速库和云API,便于集成到AI、HPC和数据处理应用中。
- Omniverse Cloud API:扩展至工业应用,支持数字孪生、实时可视化、跨场景协作等,与Apple Vision Pro结合,提供空间计算体验。
- GROOT项目:推出人形机器人通用基础模型,结合Jetson Thor和Isaac Lab等工具,推动机器人技术与具身智能发展。
投资建议
- 看好算力与应用环节:AI有望重塑各行业,算力基础设施和AI应用是主要增长点。
- 推荐关注的公司:
- 国产算力基础设施:中科曙光、浪潮信息、紫光股份等。
- AI应用领域:机器视觉(如海康威视)、办公软件(如金山办公、用友网络、泛微网络)、垂直领域(如恒生电子、宇信科技、神州信息、卫宁健康)。
- 投资评级:强于大市(维持)。
风险提示
- 技术发展不及预期:AI技术演进存在不确定性,关键技术突破可能受阻。
- 商业化进程不及预期:AI大模型的商业化路径仍需探索,可能影响市场接受度。
- 法律政策监管风险:隐私、版权、歧视性结果等问题可能引发政策限制。
- 行业竞争加剧:AI领域投融资活跃,可能导致竞争加剧。
总结
NVIDIA通过Blackwell架构及其配套的软件生态,显著提升了AI计算性能与部署效率,推动了加速计算新时代的到来。GROOT项目和Omniverse Cloud API进一步拓展了AI在机器人和工业领域的应用。同时,随着AIGC要素的正反馈循环,算力和AI应用环节将获得持续发展机会。投资建议关注国产算力基础设施与AI应用领域,但需警惕技术、商业化、政策及竞争等风险。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载