计算机行业AIGC系列之13Meta发布SAM分割模型或成CV大模型第一步-页_1mb
报告摘要
Meta 发布 SAM 分割模型:CV 大模型的里程碑
核心内容
Meta 在 2023 年 4 月 6 日发布了 Segment Anything Model(SAM),这是一个具有通用分割能力的图像分割模型,能够通过文本指令等方式对任意图片进行分割。SAM 的推出标志着计算机视觉领域向大模型方向迈出重要一步。
主要观点
1. SAM 的任务目标
- 实现 零样本(zero-shot) 或 简单提示(prompt) 下的图像分割。
- 覆盖多种分割任务,包括实例分割、边缘检测、目标建议等。
- 通过提示(如点、线框、文字)完成分割任务,具备较强的泛化能力。
2. 模型方法
- 结构简单高效,包含两个 encoder 和一个轻量级 mask decoder。
- 在单块 V100 显卡上,1200×800 分辨率图像生成所有 mask 仅需 2-3 秒。
- prompt 预测 mask 时间仅为 50ms,适合实时应用。
3. 数据集 SA-1B
- 包含 11 亿个 mask 和 1100 万张图像,是目前最大的分割数据集。
- 使用更高效的标注方式,一个 mask 标注平均只需 14 秒,比 COCO Mask 快 6.5 倍。
- 数据集在 Apache 2.0 开源,推动基础模型研究。
4. 应用前景
- AR/VR、内容创建、科学领域等应用潜力大。
- 零样本能力显著,但在复杂场景(如工业、自动驾驶)中仍需 fine-tuning。
- 分割+识别的结合可能是未来 CV 大模型的发展方向。
5. 对上市公司的影响
- 利好具备 摄像头和场景客户 的企业。
- 在视觉算法上有积累的公司可通过 CV 大模型 提升效率,面临机遇与挑战。
- 纯标注类型企业可能受到新方法论的冲击。
关键信息
6. 重点推荐公司
- 虹软科技:A股罕见的 AI 软件算法公司,专注图像/CV 领域,技术天然契合趋势。
- 大华股份:国内 AI 图像/视频核心公司,受益于 AI 升级。
- 当虹科技:发布跨模态 AIGC 产品,以静态照片生成三维体积视频,推动元宇宙发展。
7. 技术能力
- 虹软科技在 AI 分割 和 VR/AR 领域有深厚积累,技术优势显著。
- 与高通合作开发 认知 ISP,实现实时语义分割。
- 720° VR 技术:支持全视角显示,提升沉浸感。
8. 风险提示
- 中美技术差异,部分技术仍处于实验室阶段,存在落地风险。
- 应用场景碎片化,导致 AI 落地进度可能低于预期。
- 数据保护政策的强化可能限制 C 端 AI 应用。
未来展望
- CV 大模型可能在 2-3 年后实现与 NLP 大模型类似的多任务能力。
- 期待 无监督完成分割、检测、识别、追踪 等多种 CV 任务的通用模型。
- Zero-shot 能力仍需提升,尤其是在 文本到 mask 的转换上。
行业影响与投资建议
- 行业投资评级为 看好(Overweight),CV 大模型发展趋势明确。
- 推荐关注:虹软科技、大华股份、当虹科技。
- 投资评级说明:
- 买入(Buy):相对强于市场 20% 以上。
- 增持(Outperform):相对强于市场 5%~20%。
- 中性(Neutral):相对市场在 -5%~+5% 之间波动。
- 减持(Underperform):相对弱于市场 5% 以下。
法律声明
- 本报告仅供申万宏源证券研究所有限公司客户使用。
- 本报告基于公开信息,不保证其准确性或完整性。
- 本报告 不构成投资建议,客户应自主决策并承担风险。
- 未经许可,不得复制、分发或以其他方式使用本报告内容。
附录:部分重点公司估值表
| 证券代码 | 公司名称 | 总市值(亿元) | Wind 一致预期归母净利润(亿元) | PE(2023E) | PB(LF) |
|---|---|---|---|---|---|
| 002236.SZ | 大华股份 | 819 | 34.09 | 24 | 3.26 |
| 688088.SH | 虹软科技 | 159 | 1.69 | 94 | 6.17 |
| 688039.SH | 当虹科技 | 59 | 1.02 | 58 | 4.35 |
资料来源:Wind、申万宏源研究
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载