观点网讯:9月2日,由有“AI教母”之称、史丹福大学教授李飞飞共同创办的AI公司World Labs,发布全球首个多模态世界模型Atlas,可用于生成精确控制视角的影片、重建3D空间,以及建立机械人模拟环境。公司计划于未来数周向部分合作伙伴开放使用。
据介绍,用户只需提供一张或多张照片,设定虚拟摄影机的位置、角度及移动轨迹,便可以生成影片。即使镜头移至原始照片未涵盖的视角,Atlas亦可补足画面,并尽量维持场景结构及视觉内容的一致性。
Atlas并非依靠“镜头推进”或“向左平移”等概略文字指令控制运镜,而是将摄影机的运动轨迹作为模型输入。World Labs将这项功能称为“像素级精准的摄影机控制”。
World Labs说,输入影像愈多,Atlas取得的空间资讯便愈完整,需要自行推测的部分也愈少。官方展示案例中,Atlas根据7张影像及预先设计的摄影机移动轨迹,生成一段长约一分钟、解像度达1440p的影片。
除了生成影片,Atlas亦能利用多张相片构建3D环境,生成原始素材未涵盖视角的画面,并输出点云及3D高斯泼溅等3D资料。World Labs声称,Atlas在相关的测试中,表现优于数款专门处理3D重建的开源模型。
除影像与3D内容生成外,World Labs也将机械人模拟列为Atlas的应用方向之一。过往为机械人建立真实场景的数码模型,通常需要使用光达、深度摄影机等专业扫描设备,成本较高,资料采集亦较耗时。World Labs展示的案例显示,Atlas只需输入少量相片,便能重建相应空间,并生成机械人沿不同路径移动时,其感测器所能取得的拟真RGB影像及深度资料,供机械人训练与测试使用。
市场分析指,未来关注焦点,不只在于影片生成品质,更在于这项技术能否成为影视制作、游戏开发、建筑设计、数字分身与机器人模拟等产业的新一代基础设施。
免责声明:本文内容与数据由观点根据公开信息整理,不构成投资建议,使用前请核实。