中泰证券:计算机行业-o1进展追踪与评测-Reasoning能力究竟有多强?_22页_5mb
报告摘要
证券研究报告总结
核心内容
OpenAI最新发布的 o1 模型在推理能力方面取得了显著进展,尤其在数学、编程和科学问题上表现突出。该模型提供了两个版本:o1-preview(推理能力更强)和 o1-mini(速度更快,价格更便宜)。o1模型的推出标志着推理能力的提升,其训练方式采用 强化学习+CoT(Chain of Thoughts),使得模型能够更有效地分解问题、纠错和尝试不同的解决路径,从而提升推理性能。
主要观点
1. o1模型性能优于GPT-4o
- 推理任务:在多数推理类任务中,o1的表现明显优于GPT-4o,特别是在数学、编程和科学问题上。
- 写作任务:o1在写作类任务中的表现接近GPT-4o,但不如其在自然语言任务上的表现。
2. 推理算力需求增加
- o1模型的推理过程更为复杂,导致其对算力的需求增加。
- 提问限制:o1-preview每周限制30条消息,o1-mini限制50条消息,相比GPT-4o的无限制,这可能影响其在某些应用场景中的使用频率。
- 价格差异:o1的输入和输出价格分别为 $15/1M tokens 和 $60/1M tokens,相比GPT-4o的 $5/1M tokens 和 $15/1M tokens,价格更高。
3. 训练方式的创新
- o1通过强化学习优化其 CoT(Chain of Thoughts)推理过程,而非依赖传统的 Scaling Law(扩大模型规模)。
- 随着训练时间和推理时间的增加,o1的性能会持续提升,这表明 强化学习+CoT 可能成为模型迭代的新方向。
4. 预训练数据集的多样性
- o1模型基于 公开可用数据、合作伙伴专有数据 和 内部定制数据集 进行训练,这有助于提升模型在复杂推理任务中的表现。
- 数据处理过程中,OpenAI采用严格的 过滤和提炼机制,以减少个人信息泄露和有害内容的影响。
关键信息
1. 模型版本对比
| 模型 | 输入价格($) | 输出价格($) | 推理能力 | 适用场景 |
|---|---|---|---|---|
| o1-preview | 15/1M | 60/1M | 强 | 复杂推理任务 |
| o1-mini | 3/1M | 12/1M | 中等 | 高效、低成本场景 |
2. 投资建议
- 算力方向:建议关注 浪潮信息、神州数码、中科曙光、海光信息、首都在线、云天励飞、紫光股份 等公司。
- 模型方向:关注 科大讯飞、格灵深瞳、商汤、云从科技 等在模型研发方面有优势的企业。
- 应用方向:
- 金融场景:推荐关注 恒生电子、顶点软件、同花顺、中科软、宇信科技、百融云、京北方、天阳科技、长亮科技、新致软件。
- 医疗场景:推荐关注 卫宁健康、创业慧康、嘉和美康、医渡科技、鹰瞳科技。
- 工业场景:推荐关注 广联达、明源云、国能日新、东方电子、云鼎科技、朗新集团。
- 其他场景:推荐关注 焦点科技、万兴科技、萤石网络、鼎捷软件、拓尔思、佳发教育、神思电子、鸥玛软件、金桥信息。
3. 应用场景分析
- 数学问题:o1在数学推理任务中表现优异,能够正确回答涉及闭包与内点连通性的复杂问题。
- 编程任务:o1在设计iOS端超分辨率模型时,提供了更简洁、更易操作的解决方案,包括轻量级模型架构、模型压缩与优化策略。
- 写作任务:o1在写作任务中的回答较短,可能不如GPT-4o全面,但在某些情况下更符合用户需求。
风险提示
- AI技术落地不及预期:新技术可能因市场接受度或应用场景限制而未能达到预期效果。
- 数据更新不及时:模型训练依赖的数据更新滞后可能影响其性能表现。
- 安全风险:AI模型可能涉及数据隐私和安全问题,需谨慎处理。
重要声明
- 本报告由 中泰证券股份有限公司 发布,具有证券投资咨询业务资格。
- 报告内容基于公开资料和实地调研,力求独立、客观、公正,但不保证信息的准确性和完整性。
- 报告中的数据和结论可能随市场变化而调整,投资者应自行关注更新或修改。
- 本报告不构成投资、法律、会计或税务的最终操作建议,仅供参考。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载