详细解释:
2024年,谷歌云的前人工智能主管李飞飞成立了“世界实验室”,专注于开发一种新的AI模型——大世界模型。该模型能够理解三维空间中的物理对象,并生成详细的虚拟场景。用户能够通过该模型,将文字或图片转换为三维环境,如文学作品中的场景或艺术作品的环境。这一能力不仅满足了艺术与科技的结合,也为AI理解和应对现实世界提供了新的视角。
与传统的“2D转3D”工具不同,大世界模型让用户能够在虚拟空间中进行更复杂的交互,如视角切换和深度移动。这一技术不仅提升了用户的交互体验,也预示着AI在理解物理世界方面的巨大潜力。尽管当前技术仍处于早期阶段,但凭借着在三维重建和物理交互方面的一系列突破,大世界模型无疑将推动未来AI技术的发展。
这个系统同之前英伟达曾开发过的“2D转3D”模型 Instant NeRF 完全不同—— Instant NeRF 的视角没有深度变化、受阻没有物理碰撞,甚至会发生直接穿越;而 World Labs 这一工具生成的场景符合基本空间原理和物理定律。
|