20250205-华安证券-互联网_DeepSeek成本和性能双突破_有望加速国内AI进程_3页_388kb
报告摘要
DeepSeek成本与性能双突破 技术创新加速国内AI应用
核心内容
DeepSeek公司在AI领域取得两项重要突破:
1. 技术突破
- 发布开源模型DeepSeek-R1,在数学推理和编程任务上性能与OpenAI o1相当
- AIME2024基准测试得分率798% vs. 792%
- MATH-500基准测试得分率973% vs. 964%
- 发布多模态开源模型Janus-Pro,击败StableDiffusion和DALL-E3
2. 技术创新点
DeepSeek-V3采用多重技术创新:
- MoE架构共享专家策略提升参数效率
- 引入FP8混合精度训练框架提升计算速度
- 多头潜在注意力机制扩展模型表示空间
- 多Token预测结合优化内存管理
- 数据/模型并行策略提升算力利用效率
DeepSeek-R1创新性地结合监督学习和强化学习,提高模型初始推理能力。
3. 投资建议
建议关注以下方向:
- 云基础设施:阿里云、腾讯云、华为云、微软云、谷歌云、亚马逊云、英伟达
- 端侧AI:小米、联想
- SaaS软件:金山办公、金蝶国际
- 垂直行业应用:美图公司
4. 风险提示
- 行业竞争格局剧变风险
- 宏观经济波动风险
- 政策监管趋严风险
- 科技创新落地延迟风险
技术分析
DeepSeek-R1通过多维度优化实现性能提升:
- 混合专家模型减少冗余知识
- 混合精度训练加速计算过程
- 注意力机制扩展模型表现能力
- 内存管理优化提升训练效率
- 并行技术提高资源利用效率
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载