深度报告-2026-07-03-招银国际-2Q26大模型发展复盘及展望_关注算力利用效率提升及差异化定价能力_36页_2mb
报告摘要
2Q26 大模型发展复盘及展望总结
核心内容概述
2026年第二季度,大模型行业在智能能力与算力效率优化方面持续发展。国际厂商与国内厂商在多个维度展现强劲表现,其中Claude Fable 5的发布提升了行业整体智能能力上界,而智谱GLM 5.2的发布则帮助中国厂商在开源模型领域保持优势。同时,行业呈现两大趋势:深化编程/办公智能体能力探索,以及优化推理调用价格和性价比,以推动模型调用渗透率提升。
主要观点
智能能力提升
- Claude Fable 5 推动了大模型行业整体智能能力上界提升。
- 智谱 GLM 5.2 在中国大模型行业中表现出色,助力中国厂商维持开源模型优势。
- 国际厂商与国内厂商分别在不同领域表现突出,如语言模型、推理效率、Agent能力、编程能力、图像和视频生成等。
算力利用效率与成本优化
- 算力优化从单纯堆叠GPU转向全栈工程,包括模型稀疏化、注意力机制优化、低精度训练/推理、推理缓存、自研硬件适配等。
- DeepSeek V4 Pro/Flash、MiniMax M3、小米 MiMo-V2.5-Pro 等模型在推理效率和成本优化方面表现突出。
- Anthropic 和 OpenAI 通过API与产品层优化、自研推理芯片等方式提升算力效率。
推理调用价格与性价比
- 推理调用价格在2026年6月从约1.2美元/百万tokens下降至0.058美元/百万tokens,降幅达95%。
- 智能能力指数在40-50区间内的模型价格下降最为明显,而50-60区间内的模型价格也下降约58.5%。
- 价格下降与模型能力提升并行,中国开源模型在性价比方面更具吸引力。
关键信息
行业趋势
- 深化编程/办公智能体能力探索:包括长程工具调用、工程执行能力与原生多模态理解。
- 优化推理调用价格及性价比:推动模型调用渗透率提升。
- Agent场景成为核心驱动力:预计2030年Agent场景月均Token消耗量将超21万亿,占全球AI Token消耗量的84%。
全球AI Token消耗量预测
- 全球月均AI Token消耗量预计在2030年超过26万亿,2025-2030年复合增速为107%。
- 中国AI Token消耗量预计在2030年达到62.214万亿,复合增速为25%。
中国开源模型表现
- DeepSeek V4 在2026年6月API降价75%,调用量迅速上升。
- 中国模型在OpenRouter平台中占据周调用量前十中的七位,显示出强大的市场竞争力。
国际与国内厂商对比
- 美国厂商:Anthropic(Claude系列)、OpenAI(GPT系列)、Google(Gemini系列)等在多个维度领先。
- 中国厂商:智谱(GLM系列)、MiniMax(M3)、小米(MiMo系列)等在编程、多模态和算力适配方面表现突出。
AI应用与商业化
- B端商业化加速:云、广告、创意内容生成、Agent等成为主要商业化方向。
- C端渗透率较低:付费订阅和渗透仍处于早期阶段,未来将向按“用户+使用量”计费模式演进。
股票推荐
中国互联网板块
- 阿里巴巴(BABA US):云业务有望受益于token需求增长。
- 腾讯(700 HK):AI投资与产品进展显著。
- 快手(1024 HK):外部融资释放可灵价值。
美国互联网板块
- 微软(MSFT US):从单用户模式转向用户+使用量模式。
- 谷歌(GOOG US):全栈AI策略支撑业务增长。
- 亚马逊(AMZN US):AWS营收增长持续。
行业探索进展
长程任务与多模态操作
- 编程与办公智能体能力强化:如阿里巴巴Qwen 3.7 Max支持35小时无人值守与1000+顺序工具调用。
- 多模态输入/输出能力提升:模型从被动理解转向主动操作,如MiniMax M3支持图像、视频输入与操作。
重点厂商进展
- Google:发布Gemini 3.5/Flash,支持多模态生成与终端自动化。
- OpenAI:推出GPT-5.6系列,提升编程与智能体能力。
- Anthropic:Claude Fable 5与Opus 4.8在编程与智能体任务中表现优异。
- xAI:Grok 4.3强调非幻觉率与工具调用能力。
- Meta:推出Muse Spark,支持多模态输入与自动化。
- 智谱Z.AI:GLM-5.2在编程与工程任务中表现突出。
- MiniMax:M3在1M上下文场景下显著优化成本。
- 小米:MiMo-V2.5-Pro支持长上下文与多模态处理。
- 字节跳动:Seed 2.1 Pro/Turbo在编程与Agent场景中表现优异。
- 快手:Kling 3.0强化视频生成与生产级输出。
AI Token消耗量趋势
- 全球AI Token消耗量:预计2030年超过26万亿,2025-2030年复合增速107%。
- 中国AI Token消耗量:预计2030年达到62.214万亿,复合增速25%。
- OpenRouter平台数据:2026年6月15日当周调用量达46.66万亿,较2025年6月增长约22倍。
图像与视频模型进展
- 图像模型:海外厂商仍占主导,但中国厂商如智象未来HiDream O1 Image 1.5、字节即梦Seedance 2.0等具备竞争力。
- 视频模型:中国厂商在视频生成与处理方面更具优势,如快手可灵Kling 3.0、字节即梦Seedance 2.0、阿里巴巴HappyHorse-1.0等。
基础模型平台发展
- Anthropic:ARR反超OpenAI,预计2026年实现首个盈利季度。
- OpenAI:面临较大现金消耗压力,预计2027年现金流转正。
- xAI:仍处于亏损状态,但通过算力租赁打开新收入曲线。
- IPO进程:Anthropic、OpenAI、SpaceX均启动IPO筹备,估值锚转向公开市场。
总结
- 模型能力:国际与国内厂商在不同维度表现出色,智能能力仍是定价关键。
- 算力效率:全栈优化推动成本下降与性能提升。
- Agent场景:成为未来Token消耗量增长的核心驱动力。
- 商业化路径:B端持续加速,C端将向按使用量计费模式演进。
- 投资机会:建议关注基础设施云厂商、编程/办公Agent厂商及多模态模型与应用厂商。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载