跳到正文
原文
OpenAI News·· 2024-02-15精选AI 评分83

OpenAI 研究:视频生成模型可作为世界模拟器

Video generation models as world simulators

AI 导读

OpenAI 发布研究,探索在视频数据上大规模训练生成模型,联合在可变时长、分辨率和宽高比的视频与图像上训练文本条件扩散模型,并采用在视频和图像 latent code 的时空 patch 上运行的 Transformer 架构。其最大模型 Sora 能生成一分钟高保真视频,结果表明扩展视频生成模型是构建通用物理世界模拟器的一条有前景的路径。

推荐理由

OpenAI 首次公开 Sora 的技术路线,说明视频生成模型可扩展为物理世界模拟器。

来源:OpenAI News · openai.com