2025年DeepSeek洞察与大模型应用-人工智能技术发展与应用实践报告_37页_6mb
报告摘要
DeepSeek公司总结
公司背景
DeepSeek是私募量化巨头幻方量化的旗下大模型企业,成立于2023年,专注于AI大模型开发。
主要模型
DeepSeek-V3于2024年12月发布,是一个基于Transformer架构的混合专家MoE模型,具有671B参数和低训练成本,性能对标GPT-4o。DeepSeek-R1于2025年1月发布,针对推理优化,结合强化学习和多阶段训练,实现与GPT-4o对比优势。
出圈原因和影响
DeepSeek-R1高性能表现和V3低训练开销引发全球热议,成为中国首个进入国际顶级模型行列的开源模型。上线20日日活超4千万,推动AI教育和普及,政府和企业加速布局AI应用,对中美科技竞争格局产生深远影响。
中美AI竞争
DeepSeek的开源战略和技术突破挑战了美国AI垄断。美国反应包括国家安全调查、芯片出口禁令草案和投资禁令,显示AI竞赛进入新阶段。
应用案例
DeepSeek在政务热线(如辽宁、北京)、公安视侦、医疗(如中山三院)、船舶设计和经济决策等领域有成功落地案例,显著提升效率和智能化水平。
局限性
尽管性能优异,DeepSeek仍面临幻觉问题、高算力需求、知识更新滞后、偏见和安全风险等挑战。B端应用需多模型组合和工程化优化。
结语
DeepSeek整体提升了中国AI生态竞争力,促进了千行百业AI融合,但需正视其局限性,并持续优化演化发展。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载