品玩

科技创新者的每日必读

打开APP
关闭

World Labs发布世界模型Atlas 支持文图音视频多模态生成

4小时前

品玩9月2日讯,由李飞飞创办的 AI 公司World Labs 正式宣布,推一款下一代世界模型出Atlas。

该模型为全模态模型,从头预训练,原生支持文本、图像、视频和3D联合处理。Atlas采用多模态自回归扩散Transformer架构,将所有输入整合至共享空间上下文,基于此生成后续内容,保持3D一致性。

Atlas支持相机控制视频生成,可从多张图像生成最长1分钟、1440p视频;支持空间重建,仅需少量图像即可生成3D输出,基准优异;支持时空模拟,可从视频建模,实现视频重新构图与机器人仿真;支持文本图像生成及360度全景图。

Atlas将驱动World Labs后续Marble等产品。Atlas已进入早期访问阶段,仅面向部分合作伙伴开放

取消 发布

下载品玩App,比99.9%的人更先知道关于「世界模型」的新故事

下载品玩App

比99.9%的人更先知道关于「世界模型」的新故事

iOS版本 Android版本
立即下载
AI阅读助手
以下有两点提示,请您注意:
1. 请避免输入违反公序良俗、不安全或敏感的内容,模型可能无法回答不合适的问题。
2. 我们致力于提供高质量的大模型问答服务,但无法保证回答的准确性、时效性、全面性或适用性。在使用本服务时,您需要自行判断并承担风险;
感谢您的理解与配合
该功能目前正处于内测阶段,尚未对所有用户开放。如果您想快人一步体验产品的新功能,欢迎点击下面的按钮申请参与内测 申请内测