20250210-华龙证券-AI产业系列跟踪专题研究报告_DeepSeek重塑AI产业格局_助力AI端侧落地_12页_1015kb
报告摘要
DeepSeek模型性能综述与应用前景分析
一、核心性能表现:
DeepSeek-V3于2024年12月发布,参数规模达671B,激活37B,在148万亿token上进行训练,多项评测成绩超越Qwen-2.5-72B、Llama-3-70B等开源模型,并在性能上与GPT-4o、Claude-3.5-Sonnet持平。其生成速度从V2.5的20TPS提升至60TPS。DeepSeek-R1于2025年1月推出,推理能力对标OpenAI的o1正式版,在代码、自然语言推理等任务中表现出色,小模型蒸馏版本逼近OpenAI-o1-mini。
二、技术创新与训练优化:
- 高效训练架构:采用FP8混合精度训练框架,结合算法、框架和硬件协同设计,降低通信瓶颈,以2664万H800 GPU小时完成预训练,成本显著下降。
- 推理效能提升:引入多标记预测(MTP)和无需辅助损失的负载均衡策略,提升生成效率和推理性能,支持推测性解码。
三、生态与商业化进展:
近期,英伟达、微软、GitHub、华为云等科技巨头陆续接入DeepSeek模型,提供推理服务与开发支持。华为云昇腾服务部署的DeepSeek模型可媲美高端GPU方案,助力大规模商用。
四、投资价值与建议
DeepSeek模型的技术突破提升了中国在全球AI产业中的地位,推动内容个性化带动传媒行业增长,建议投资者关注三七互娱、姚记科技、昆仑万维、世纪天鸿、上海电影、博纳影业、光线传媒、万达电影、视觉中国、汤姆猫、实丰文化等相关标的。
五、风险提示
市场接受速度、研发落地进度、竞争压力、外部政策、以及芯片供应等因素均可能影响发展进程,需密切关注上述风险。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载