计算机行业专题报告:视频大模型最新进展如何?-240616-财通证券-15页_1mb
报告摘要
视频大模型最新进展总结
1. 多模态大模型技术进展
- OpenAI视频大模型技术发展:
- DALL·E:通过压缩数据进行学习,但仅压缩不足以实现AGI(通用人工智能),DALL·E3通过增强文本描述性,提高了文生图效率。
- CLIP:结合文本和图像信息进行训练,显著提升计算效率。OpenAI认为,在视觉学习中融入自然语言指导可以提升模型智能。
- 视觉上下文学习:未来可能成为生成式模型的应用路径,如使用文本为条件生成视频。
2. 视频大模型商业化进展
- Adobe:Firefly新增生成式扩展功能,Adobe Express推出音频生成动画工具,支持C端快速制作口播视频。
- 美图公司:升级视频生成架构,将于7月推出AI短片创作工具MOKI,提升生成可控性,加速商业化落地。
- 万兴科技:Filmora上线135版本,新增声音复刻、文生贴纸等功能,支持NVIDIA RTX视频技术,推进HDR支持。
- LumaAI:发布DreamMachine,支持文本和图像生成视频,具备多模态输入、快速生成和高质量输出。
- 快手:发布“可灵”大模型,采用类Sora的架构,支持高清视频生成和复杂场景建模。
- Pika:完成58亿美元融资,持续推进AI视频生成技术,计划深入商业化。
- Runway:发布MultiMotionBrush功能,提升视频可控性,并获得谷歌领投的7亿美元融资,进一步深化与AI合作。
3. 视频大模型应用与对比
- 头部视频大模型对比:Luma、Pika、Runway在生成质量、速度、控制面板等表现各有优势,适用场景广泛。
- 商业化挑战:目前主要聚焦于B端应用,C端商业化普及仍需时间。
4. 投资建议与风险提示
- 投资建议:
- 关注AI服务器、芯片厂商,如海光信息、寒武纪等。
- 关注边缘硬件和赋能型公司,如石头科技、虹软科技、中科创达等。
- 关注AIGC领域,如美图公司、万兴科技、科大讯飞、创维数字等。
- 风险提示:
- 技术迭代不及预期、商业化落地不及预期、竞争加剧风险、全球宏观经济风险。
总结
当前视频大模型在技术上已有显著突破,商业化进程正在加快,应用场景涵盖了影视创作、娱乐、企业服务等领域。投资方面需关注技术迭代与产业升级双重风险,同时选择具备竞争优势的硬件、软件及内容平台企业。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载