> **来源:[研报客](https://pc.yanbaoke.cn)** ```markdown # 天風國際研究 - 新興產業總結 ## 核心內容概覽 本周天風國際研究重點關注兩大新興產業模型:**DeepSeek V4-Pro** 和 **Grok 4.6**,二者在性能與價格方面均表現突出,標誌著大模型競爭進一步向「高性能 + 高性价比」方向演進。此外,**DeepSeek Harness** 的發布,為 DeepSeek 在 Coding Agent 領域的競爭提供了更強的產品入口與執行框架。 --- ## 主要觀點 ### 1. DeepSeek V4-Pro:性能與價格雙優勢 - **性能表現**:DeepSeek V4-Pro 在多項 Agent 相關評測中表現優異,例如: - **CyberGym**:83.3 分(略高于 Fable 5 的 83.1 分) - **AutomationBench**:31.8 分(位居前列) - **Terminal Bench 2.1**:87.9 分(與 Kimi-K3 和 Fable 5 競争) - **DeepSWE**:62.7 分(高于 Opus 4.8 和 GLM-5.2) - **價格優勢**:按峰時價格計算,DeepSeek V4-Pro 的輸入/輸出價格分別為 **9/27 元/百萬 Token**,相比 Kimi-K3 的 **20/100 元/百萬 Token**,僅為其 **45%/27%**;相比 Claude Opus 5 和 Fable 5,價格更低,具備強大的成本競爭力。 - **工具使用能力**:DeepSeek V4-Pro 在工具使用方面表現突出,HLE無工具得分為42.7,接入工具後提升至60.0,顯示其在任務執行前的需求理解與方案探索能力強。 ### 2. DeepSeek Harness:推動 Coding Agent 競爭 - **架構設計**:DeepSeek Harness 采用插件式開放架構,可靈活組合模型、工具、技能、會話、沙箱等 Agent 能力。 - **多種模式**:提供標準模式、PTC 模式、極簡模式、創造模式,適應不同使用場景。 - **功能特色**:在指令不清晰時主動提問,協助用戶明確任務目標,降低前期溝通與決策成本。 - **產品補位**:Harness 的推出補足了 DeepSeek 在 Coding Agent 的產品入口,並建立自主執行框架,使其競爭維度擴展至生態與開發者體驗。 ### 3. Grok 4.6:性能進入第一梯隊,價格持續領先 - **性能評估**:Grok 4.6 在 Artificial Analysis Intelligence Index 中達 61 分,與 GPT-5.6 Sol Max 平行,略低于 Claude Opus 5(63)和 Fable 5(62)。 - **任務表現**: - **GDPVal-AA v2**:達 1753 分,高于 GPT-5.6 Sol Max(1728)和 Fable 5 Max(1741) - **CursorBench v3.2**:達 69.9%,高于 GPT-5.6 Sol Max(67.2%),接近 Fable 5 Max(70.5%) - **APEX-Agents**:達 57.5%,高于 GPT-5.6 Sol Max(56.7%) - **價格優勢**:Grok 4.6 的標準輸入/輸出價格為 **2/6 美元/百萬 Token**,相比 GPT-5.6 Sol(5/30 美元)僅為其 40%/20%;相比 Claude Opus 5(5/25 美元)為 40%/24%;相比 Fable 5(10/50 美元)為 20%/12%。 - **成本效益**:Artificial Analysis 計算其平均任務成本約為 **0.84 美元**,被列入 Intelligence-Cost per Task 的 Pareto 前沿。 ### 4. OpenRouter 平台 Token 增長情況 - **Token 數量**:2026 年 8 月 6 日至 8 月 12 日,OpenRouter 平台公開可觀察 Token 合計 **71.90 萬億**,周環比增長 **18.2%**。 - **模型調用量**: - **DeepSeek V4Flash0731**:調用量淨增 **5.79 萬億**,環比增長 **122.8%** - **DeepSeek 家族總體**:Token 總計淨增 **4.36 萬億** - **千問家族**:Token 環比增長 **142.0%**,其中 Qwen3.8Max 貢獻約 **83%** 的家族淨增量 - **市場趨勢**:顯示新模型持續承接流量,市場對高性價比模型的需求日益增長。 --- ## 關鍵信息 - **DeepSeek V4-Pro** 在 Agent 任務中表現優異,價格遠低於同級模型。 - **DeepSeek Harness** 提供靈活的插件式架構,並支援多種模式,強化 Coding Agent 競爭力。 - **Grok 4.6** 進入全球第一梯隊,並在多項任務評測中表現突出,價格優勢明顯。 - **OpenRouter 平台** 的 Token 环比增長顯示新模型快速獲取市場關注,流量向新品集中。 --- ## 風險提示 1. 大模型商業化及企業付費轉化不及預期。 2. 模型價格下降幅度超過推理成本下降。 3. 第三方平台樣本偏差及 Token 增長傳導弱化。 ```