20250506-中邮证券-金工周报_AI动态汇总-通义千问发布Qwen-3模型_DeepSeek发布数理证明大模型_24页_3mb
报告摘要
证券研究报告总结:
2025年4月至5月,AI领域多项重大进展引发关注。通义千问发布Qwen-3系列模型,其中旗舰模型Qwen3-235B-A22B在多项基准测试中超越DeepSeek-R1、o1、Gemini-25-Pro等竞品,小型模型Qwen3-30B-A3B参数量仅为QwQ-32B的10%,但性能更优。Qwen-3采用混合思考模式与三阶段训练框架,支持长上下文处理(32Ktoken)和高效推理,已开源六个Dense模型。DeepSeek推出Prover-V2-671B大模型,专攻形式化定理证明,通过递归子目标分解框架和双模式推理架构(非链式/链式思考),在数理证明任务中表现突出。小米开源MiMo-7B-RL模型,训练数据涵盖25Ttokens与200Btokens合成数据,后训练阶段集成13万道数学与代码题,通过SeamlessRollout系统实现强化学习效率提升229倍。
企业动态方面,亚马逊推出NovaPremier模型,作为Nova系列最强版本,支持超长上下文(100万token)处理及多工具协同任务,已接入AmazonBedrock平台;Meta发布ReasonIR-8B模型,采用双编码器架构优化检索精度,结合合成数据增强复杂推理能力,开源代码与工具;非盈利组织FutureHouse推出四个科学家智能体(Crow、Falcon、Owl、Phoenix),在文献检索、知识整合、实验设计和药物研发等任务中超越主流模型,具备高搜索准确率与多模态处理能力。
AI行业趋势显示,智能数据标注产业加速向技术驱动转型,人工智能辅助标注、合成数据生成等技术提升效率与精度,政策层面推动标准化与质量监管。技术前沿方面,浙江大学等机构研发的InfiGUI-R1智能体基于Actor2Reasoner框架,实现“感知→推理→行动”模式,通过空间推理蒸馏与强化学习增强规划与纠错能力,显著优于传统反应式智能体。此外,韩国科学技术院与DeepAutoai联合开发的Paper2Code框架,可将科研论文自动生成代码仓库,实验结果表明其在ICML、NeurIPS等会议论文上的正确性评分远超其他模型(473-477分)。
风险提示:报告基于历史数据,存在因政策或市场变化导致失效的风险,历史信息不代表未来预测。中邮证券提供投资评级(股票、行业、可转债),以6个月内相对基准指数的涨跌幅为依据,需注意数据参考及免责声明。
试读结束,高清完整版pdf/doc/ppt,请点下载