20240514-华创证券-AI+专题系列点评(十七)_DeepSeek发布第二代MoE模型_降本增效有望加速AI应用普及_9页_1mb
报告摘要
DeepSeek-V2模型发布及市场影响分析
模型降本增效,推动AI应用普及
一、核心技术优势
DeepSeek-V2是幻方量化旗下AI公司开源的第二代Mixture-of-Experts(MoE)模型,其主要优势体现在以下方面:
-
顶级性能表现:在中文综合能力评测AlignBench中排名开源模型第一,与GPT-4-Turbo、文心40等闭源模型并列第一梯队。英文综合能力评测中与LLaMA3-70B模型并列第一,超越Mixtral8x22B模型,在知识问答、数学推理、编程能力等测试中均位列前茅,支持128K超长上下文窗口。
-
极低API调用成本:采用MoE架构进行计算优化,API定价为每百万tokens输入1元、输出2元(32K上下文),相较GPT-4-Turbo每百万tokens输入72元、输出217元的定价,成本仅为后者的约百分之一。
-
创新架构设计:通过自研MLA(Multi-head Latent Attention)架构和DeepSeekMoE稀疏结构,以236B总参数、21B激活参数实现接近70B~110B密集模型的性能,显存消耗仅为后者1/5至1/100的水平。在实际部署中,DeepSeek-V2能在8卡H800机器上实现每秒输入吞吐量超10万tokens,输出超5万tokens。
二、市场影响及投资建议
投资机会
随着AI模型应用深入垂直领域,建议重点关注以下方向的标的:
-
AI+应用领域:
- 安全:永信至诚、深信服
- 办公:金山办公、福昕软件
- 法律:金桥信息、华宇软件、通达海
- 医疗:润达医疗
- 教育:佳发教育、欧玛软件、新开普
- 金融:同花顺、新致软件
- OA办公:致远互联、泛微网络
- ERP:用友网络、金蝶国际
-
算力基础设施:
- 海光信息、寒武纪、龙芯中科、润泽科技、亚康股份等服务器及硬件厂商
风险提示
- 商业化应用表现不及预期
- 用户付费意愿低
- 技术快速迭代带来的不确定性
本文分析了DeepSeek-V2的技术优势及商业化潜力,供投资者参考。
注:本文仅为技术及行业分析,不作为投资建议。市场有风险,投资需谨慎。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载