跳到正文
OpenAI News·· 2024-02-15精选AI 评分88

OpenAI 探讨将视频生成模型作为物理世界模拟器并介绍 Sora

Video generation models as world simulators

AI 导读

OpenAI 发布视频生成研究报告,其最大模型 Sora 能够生成长达 1 分钟的高保真视频。该方法在不同时长、分辨率和宽高比的视频与图像上联合训练文本条件扩散模型,并采用在潜在编码时空 patch 上运行的 Transformer 架构。OpenAI 指出,扩展视频生成模型是构建通用物理世界模拟器的可行路径。

推荐理由

OpenAI 将视频生成视为物理世界模拟器的技术路径,展示了扩散模型结合时空 Patch 架构在视频生成上的扩展潜力。

来源:OpenAI News · openai.com