20240513-东方财富证券-信息技术行业动态点评_DeepSeek发布第二代MoE架构模型_API调用成本降低_4页_714kb
报告摘要
DeepSeek发布了第二代MoE架构模型DeepSeek-V2,这一创新大幅提升了模型参数和能力,同时显著降低了API调用成本。根据报告,DeepSeek-V2拥有236B总参数,仅激活21B参数,比同等密集模型高效,在多个榜单中表现优异,尤其在中文综合能力上与GPT-4-Turbo等闭源模型齐平,英文能力媲美LLaMA3-70B。创新点包括采用MLA架构和自研DeepSeekMoE结构,减少了计算量和显存消耗(为密集模型的1/5~1/100),使输入吞吐量达每秒10万tokens,输出每秒5万tokens。成本方面,DeepSeek-V2的API调价为每百万tokens输入1元、输出2元,远低于GPT-4-Turbo,性价比高。该模型对AI行业有积极影响,预计算力节省将推动需求增长。报告建议关注相关股票如海光信息等,并提示风险如行业竞争加剧和算力不足。总体而言,DeepSeek-V2展示了技术创新在降低成本和提升性能上的潜力,强化了AI领域的竞争格局。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载