计算机行业AI模型系列(三)_DeepSeek_V4和Kimi_K2.6_性能跃升_国产算力适配加快_32页_1mb
报告摘要
计算机行业 AI 模型系列(三)总结
核心内容
模型发布与性能提升
- DeepSeek V4 于 2026 年 4 月 24 日发布,拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上实现国内与开源领域的领先。
- V4-Pro:总参数 1.6T、激活 49B,适合复杂分析和高强度推理。
- V4-Flash:总参数 284B、激活 13B,更强调效率与成本。
- Kimi K2.6 于 2026 年 4 月 20 日发布,强调长程代码任务和 Agent Swarm 编排能力。
- 在 12 小时以上连续执行、4000 多次工具调用和 14 轮迭代中完成模型推理任务。
模型架构创新
- DeepSeek V4 引入混合注意力机制(CSA/HCA),降低长上下文的计算与存储成本。
- V4-Pro 单 token 推理算力降至 V3.2 的 27%,KV cache 占用降至 10%。
- V4-Flash 进一步压缩至 10% 和 7%。
- Kimi K2.6 强调多模态输入与 Agent Swarm 机制,将复杂任务拆解为并行子任务,提高真实工作流完成率。
- 支持文本、图像和视频输入,具备更强的多模态处理能力。
成本与效率
- DeepSeek V4 在长上下文场景中显著降低单位 token 成本,适合高 token 消耗场景。
- Kimi K2.6 在 Agent Swarm 和长程代码任务中表现优异,尽管单价较高,但并行执行可能降低实际项目成本。
主要观点
国产算力与模型的协同
- DeepSeek V4 和 Kimi K2.6 与国产 AI 芯片(华为昇腾、寒武纪、壁仞)适配,标志着国产算力与模型的双向适配趋势。
- 这种协同有助于提升国产 AI 产业的自主可控能力,推动算力国产替代。
推理需求与市场影响
- 为支持 DeepSeek V4 和 Kimi K2.6 的推理需求,预计新增采购的 AI 加速卡在 11 万至 47 万张之间,新增 CPU 数量在 5 万至 24 万颗之间,新增超节点在 283 至 1236 台之间。
- 算力租赁和调度公司也将受益于模型的广泛应用。
关键信息
投资建议
- 芯片:推荐寒武纪和国产 CPU 龙头公司。
- 服务器:推荐浪潮信息、紫光股份,建议关注神州数码。
- 应用端:推荐卓易信息。
- 软件端:推荐星环科技、范式智能、税友股份、汉得信息、中望软件、赛意信息,建议关注软通动力和中国软件国际。
- 算力租赁和调度:建议关注拓维信息、首都在线、网宿科技、优刻得、宏景科技、宝信软件、云赛智联、铜牛信息、卡莱特、思特奇、并行科技。
风险提示
- 国产 AI 大模型相关应用商业化落地不及预期。
- AI 大模型行业竞争加剧。
- 国产 AI 算力产品存在供应链不稳定和性能差距导致采购量不及预期的风险。
行业评级
- 行业评级:买入
市场表现
- 相对市场表现图显示了计算机行业与沪深300指数的波动情况。
未来展望
- DeepSeek V4 和 Kimi K2.6 的发布将推动国产 AI 芯片的使用,加速算力国产替代进程。
- 模型厂商与算力厂商的紧密合作将提升国产 AI 算力在大模型训练和推理中的应用比例。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载