20250514-中邮证券-金工周报_AI动态汇总-英伟达Llama-Nemotron模型表现优异_小米Mi-BRAG智能引擎亮相_26页
报告摘要
证券研究报告总结如下:
-
AI重点要闻
- 英伟达发布开源模型Llama-Nemotron,包含LN-Nano8B、LN-Super49B、LN-Ultra253B三个版本。其中LN-Ultra253B全面超越DeepSeek-R1,通过五阶段训练:神经架构搜索(NAS)、垂直压缩与FFN融合、知识蒸馏与继续预训练、监督微调(SFT)和大规模强化学习。Puzzle框架优化模型推理效率,FFNFusion技术减少序列深度并提升计算资源利用率。
- 小米推出Mi-BRAG智能引擎,解决传统大模型知识更新成本高、数据泄露风险等问题。支持多文档格式解析、多模态问答及细粒度溯源,已在SuperCLUE-RAG评测中取得第一,任务完成平均长度达433,接近满分500,优于VLA模型。
- 星动纪元联合清华开源AIGC机器人大模型VPP,基于视频扩散模型实现文本指令视频动作生成。两阶段学习框架将预测时间缩短至150ms以内,控制频率超50Hz,在CalvinABC-D和Real-WorldDexterousHand任务中表现突出。
- 华为与清华合作开发园区网络智能体,通过iMasterNCE-CampusInsight系统实现网络状态数字孪生,结合DeepSeek大模型支持自然语言交互。系统可定位网络故障、优化频段和功率,提升运维效率并降低门槛。
-
企业动态
- Mistral发布Medium3大模型,参数规模适中,成本显著低于ClaudeSonnet37(输入0.4美元/百万Token,输出2美元/百万Token),在编程、STEM等任务中表现优异,且API和部署成本优于DeepSeekv3。
- 阿里开源ZeroSearch大模型搜索引擎,通过强化学习框架提升搜索能力。70亿参数模型在NQ等数据集上达成3306搜索得分,140亿参数模型达3397,超越谷歌搜索(3247)。
-
AI行业洞察
- 腾讯优化DeepEP通信框架,提升MoE和EP模型性能,在RoCE网络环境下吞吐量提升100%,IB网络提升30%,支持低精度运算(FP8)。
- Anysphere完成9亿美元融资,估值达90亿美元,与Cursor等AI编程工具竞争加剧,OpenAI亦有收购意向。
-
技术前沿
- RepliBench评估大模型“自我复制”能力,包含20个任务家族、65个子任务,测试AI获取计算资源、窃取模型权重、部署新设备及持久化驻留等能力。当前模型在15个任务中pass@10得分超50%,但受制于身份验证、权重外泄等技术瓶颈。
-
风险提示
- 报告基于历史数据,存在政策和市场环境变化导致失效风险。历史信息不构成未来预测,投资需谨慎。中邮证券具备证券投资咨询资质,信息来源于公开资料,不保证准确性,报告结论不受其他部门或利益相关方影响。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载