互联网传媒行业深度报告:多模态技术加速,AI商业宏图正启-20231218-东吴证券-40页_2mb
报告摘要
多模态技术发展与投资机会分析
核心观点
- 多模态技术为AI向通用人工智能发展提供关键路径,同时开启商业价值新篇章。
技术趋势
图文生成已成熟
- 扩散模型主导图像生成市场,Midjourney年营收超1亿美元
- 生成成本持续下降,文生图模型训练成本较GPT-3降低95%
视频生成进入爆发期
- 技术参照2021年图片生成拐点,可类比发展
- 2024年预期实现扩散模型+Transformer创新融合
其他模态进展
- 听觉模型:音乐生成领域StableAudio实现90秒连贯音频生成
- 具身智能:尚处早期阶段,主打机器人领域
国内外对比
海外技术领先
- OpenAI实现文本-图像-视频多模态整合,GPT-4V在医疗影像分析领域应用
- Google Gemini Ultra模态理解能力突破GPT-4V水平
- 元宇宙企业在3D生成领域引领
国内追赶态势
- 海外开源技术促进国内算法进步,华为/阿里在中文语料建设上有质的提升
- 国内产品强调生态整合,商业化落地较快
投资建议
重点推荐
- 昆仑万维:多模态技术研发领先
- 焦点科技、中文在线:电商/游戏AI应用
- 万兴科技、美图:视觉应用生态优势
- 盛天网络,蓝色光标:营销/教育场景应用
次要关注
- 算力基础设施龙头,如中际旭创
- AI+视频内容解决方案商,如虹软科技
风险提示
- 技术迭代速度不及预期
- 生成内容潜在伦理及安全风险监管
- 商业模式成熟期主导尚不明确
- 算力基础设施制约落地节奏
报告要点:
- 当前布局多模态技术的企业将获先发优势
- 重点关注文本/图像/视频模态整合带来的生产力跃迁
- 解决方案建议聚焦垂直应用场景而非基础技术竞争
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载