World Labs 发布世界模型 Atlas 支持文图音视频多模态生成
上周三
李飞飞创办的 AI 公司 World Labs 推出下一代全模态世界模型 Atlas,该模型从头预训练,原生支持文本、图像、视频和 3D 联合处理,采用多模态自回归扩散 Transformer 架构,具备相机控制视频生成、空间重建、时空模拟、文本图像生成及 360 度全景图生成等功能,将驱动 Marble 等产品,目前已进入早期访问阶段,仅面向部分合作伙伴开放。
体验专业版特色功能,拓展更丰富、更全面的相关内容。
李飞飞创办的 AI 公司 World Labs 推出下一代全模态世界模型 Atlas,该模型从头预训练,原生支持文本、图像、视频和 3D 联合处理,采用多模态自回归扩散 Transformer 架构,具备相机控制视频生成、空间重建、时空模拟、文本图像生成及 360 度全景图生成等功能,将驱动 Marble 等产品,目前已进入早期访问阶段,仅面向部分合作伙伴开放。