刚刚,李飞飞掀桌!全球首个多模态世界模型发布,几张照片省掉几百个机位
李飞飞团队于近日发布全球首个多模态世界模型,该模型可通过少量静态照片生成完整三维场景,替代传统拍摄中大量机位设置。据称,其技术能够显著降低影视及虚拟制作成本,减少对数百个摄像设备的依赖。模型基于空间智能框架,融合视觉、语言与物理规律理解,实现从二维图像到可交互三维空间的快速构建。该成果被视为AI在具身智能与内容生成领域的关键突破,或将对机器人导航、自动驾驶及虚拟现实产业产生直接影响。目前相关技术细节与开源计划尚未完全披露,但已引发行业对传统影像生产流程变革的广泛讨论。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(36氪)→
