电子AI+系列专题报告(六):DeepSeek重塑开源大模型生态,AI应用爆发持续推升算力需求_42页_4mb
报告摘要
DeepSeek重塑开源大模型生态,AI应用爆发持续推升算力需求总结
一、公司概况与模型发展
DeepSeek成立于2023年7月,目标是实现通用人工智能(AGI),是专注于先进大语言模型开发的创新型科技公司。在短短一年多的时间内,DeepSeek迅速迭代其AI模型,性能对标国际闭源巨头。代表性发展包括:
- 2024年5月,发布V2模型,成为全球最强开源通用MoE模型。
- 2024年12月,发布V3模型,性能逼近GPT-4o等闭源模型,训练成本显著降低。
- 2025年1月,发布R1推理模型,性能对标OpenAI-o 1正式版,支持强化学习技术提升推理能力。
二、技术创新与核心技术
DeepSeek通过自研结构与算法优化,大幅降低训练和推理成本:
- MLA(多头潜在注意力)结构:采用低秩联合压缩技术,减少键值存储空间,显著降低内存需求。
- DeepSeekMoE架构:专家混合设计,按需调动资源,提升效率。
- DualPipe算法:优化计算通信重叠,减少空闲时间,加速训练。
- FP8混合精度训练:加快训练速度,降低GPU内存消耗。
- API缓存技术:利用硬盘缓存机制,为客户提供低至百万tokens输出仅需8元的优惠价格,最高节省90%费用。
三、市场表现与产业布局
DeepSeek应用在全球范围内快速普及:
- 被评为应用商店下载榜TOP应用,在印度市场表现尤为突出。
- 支恃海外科技巨头如微软、英伟达、亚马逊、华为云等方面迅速接入DeepSeek-R1模型。
- 正逐步构建全球化生态,吸引CSP(云服务提供商)与硬件厂商合作,加速云端部署与推理服务规模化。
四、行业影响与政策支持
报告指出,随着AI应用全面爆发,算力需求激增。DeepSeek的MLA和MoE架构降低训练成本,支持定制化ASIC芯片需求,对算力产业链(如服务器、PCB、CCL、AI芯片企业等)带来巨大机遇。
政策持续支持中国AI发展,对算力基础设施建设提供巨大推动力:
五、算力需求激增与市场规模预测
通信量将显著增长,推动服务器、芯片、PCB等领域进入爆发期。预计到2026年,全球AI服务器出货量将达237万台(CAGR 26%);中国市场2027年将超过809万台,政策与技术需求共同驱动中国AI服务器市场保持高增长。
六、风险提示
尽管前景广阔,但需关注:
- AI应用推广不及预期风险:如技术适配性、用户接受度等影响。
- 投资过热与回报不及预期风险:技术商业化周期可能较长。
- ASIC渗透率提升速度慢于预期。
- 监管政策收紧可能对行业生态造成影响。
七、投资建议
重点推荐:
- A股:中芯国际、翱捷科技、德明利、工业富联、沪电股份、联想集团等;
- 硬件层:关注英伟达、博通及国内AI芯片定制化趋势等。
八、结论
DeepSeek正在重塑开源生态,中国AI大模型正迅速追赶国际标准,未来在通用人工智能、全行业智能化变革中具有广阔的潜在空间。投资趋势集中在服务器产业链、ASIC封装、PCB高密度互联板、高速CCL等领域,相关政策支持与技术迭代加速有机结合,构建国产算力基础设施发展新路径。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载