对算力网络新型智算和开放DPU发展的思考和实践-24页_3mb
报告摘要
中国移动算力网络发展与实践:基于GPU和DPU的创新探索
1. 算力网络总体进展
- 提出“算力网络”理念,实现了“算为中心、网为根基”的基础设施融合,包含网、云、数、智、安、边、端、链(ABCDNETS)等多元素深度融合。
- 构建算力网络“三横两纵”体系,全面布局OTN/OXC全光底座,打造“4+N+31+X”级算力网络基础设施布局,覆盖1000余边缘节点。
- 在算网基础设施、业务融合创新、创新技术引领三条主线推进发展,重点推动算网大脑、算力交易、算网调度等技术创新,建立面向十大方向的算力网络核心技术体系。
2. 围绕GPU打造新型智算中心
- 提出“新人工智能基础设施”理念,构建了E级超大规模单体智算中心(NICC),“智算设施、智算框架、智算运营”三要素一体推进。
- 具备五大核心技术特征:超高速智能网络(200G+)、智能算力集群(GPU等异构芯片)、高性能存储系统、极致网络带宽、高效的算力变现机制。
- 研发算力原生技术(“芯合”平台),打破传统智算生态瓶颈,实现跨架构算力统一调度。创新推出全调度以太网架构(GSE)突破传统网络性能极限,配合基于CA-BGP的算力路由体系实现算网全局优化。
3. 构建开放DPU产业生态
- 提出DPU作为新型算力基础设施“底座”的定位,形成“计算层可编程、隔离层高效转发、基础设施层资源池化”的技术架构。
- 发布业界首个DPU“1+5+4”标准化体系,包括1套总体架构、5大软件模块(管、网、存、算、安)和4大硬件系统(供、散、管、界)。
- 设立DPU创新开放实验室,推动建立开源生态体系(OIF成立算力卸载工作组)。牵头建设CFITI算力网络试验网,与中科院联合探索信息高铁,构建算力科学装置实验平台。
技术亮点
- 创新提出全调度以太网、算力原生、算力路由等原创技术,填补算力调度协议空白
- 构建基于GPU的E级智算中心,实现从CPU到异构多芯算力调度能力跃迁
- 通过DPU标准体系推动云芯片融合,打破传统软硬件耦合限制,实现资源弹性调度
- 建立算力交易与算网协同服务体系,支撑百万级并发及跨域统一调度
中国移动通过算力网络构建“算力即服务”新型基础设施,正加速推动从“以流量为中心”向“以算力为中心”的数字经济体系转型。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载