20250305-信达证券-电子_世界模型探索空间智能_AI复杂场景落地可期_16页
报告摘要
世界模型探索空间智能,AI复杂场景落地可期
研究内容进展迅速,应用场景拓展与挑战并存
长期来看,科学界希望开发一个能够模拟世界基本动态的统一模型,以实现通用人工智能。世界模型的定义尚未统一,但均涉及对现实世界动态特性的理解与预测。近年来,随着Sora模型的发布,世界模型成为研究热点。
Sora作为视频生成模型,能够进行视频创作、编辑及场景融合,表现出对世界规律的理解能力,然而也引发关于“是否理解物理世界”的争议。从架构上看,Sora基于扩散模型进行视频生成,通过压缩与潜在表示模型,生成自然动态视频。在其应用场景中,视频生成模型被广泛应用于自动驾驶和机器人技术领域。
在自动驾驶方面,传统方法存在信息传递不畅和资源消耗大的问题,而世界模型可弥补这一缺口。在机器人领域,世界模型赋予机器人在复杂环境中执行任务的能力,尤其是在新环境中提高任务完成和环境适应性。例如,BC-Z和DayDreamer等模型能够在机器人与世界模型融合过程中实现自主学习和任务执行。
当前,大模型如OpenAI的o3-mini和Grok3展示了较强的物理世界模拟能力,如o3-mini能够生成四维超立方体中的弹射程序,Grok3则能精准模拟航天器任务的3D动画。
多家企业加入,世界模型领域竞争加剧
全球头部科技企业纷纷推出世界模型产品,推动该领域加快形成技术框架。
- NVIDIA Cosmos:利用2万小时真实数据训练,具有生成可控视频、预测物理动态能力,助力机器人与自动驾驶系统开发。
- WorldLabs:李飞飞博士创立,致力于构建3D世界生成框架,从单一照片可生成高质量3D场景,目前估值超10亿美元。
- Google DeepMind Genie2:自回归潜扩散模型,可在长时间尺度上保持视频的一致性,具备视角生成和物理效果模拟能力。
此外,国产企业昆仑万维发布的Matrix-Zero在3D场景生成与视频互动方面表现优异,国产模型正成为这一领域的有力竞争者。
投资建议与风险提示
在算力下降、模型效率提升的背景下,世界模型应用落地正进入爆发阶段。大模型性能的持续优化推动了其处理物理世界的能力,有望在人形机器人、自动驾驶等高端智能硬件领域实现全面突破。
建议关注AI云侧产业链:工业富联、沪电股份、生益科技、深南电路、胜宏科技、寒武纪、海光信息。
建议关注AI端侧相关企业:蓝思科技、领益智造、鹏鼎控股、东山精密、乐鑫科技、瑞芯微、恒玄科技、全志科技、兆易创新、晶晨股份。
风险分析
报告指出,潜在风险包括宏观经济下行、客户需求不及预期、中美贸易摩擦加剧等,投资者需密切关注市场政策变化与地缘政治局势。
*免责声明:本报告内容仅供参考,不构成投资建议。实际投资需综合考虑市场环境与个人情况。
试读结束,高清完整版pdf/doc/ppt,请点下载