跳到正文
原文
Lilian Weng:Lil'Log(RSS)·· 2024-04-12AI 评分52

Lilian Weng 长文综述扩散模型在视频生成中的应用

Diffusion Models for Video Generation

AI 导读

Lilian Weng 在 Lil'Log 发布长文,系统梳理扩散模型用于视频生成的方法。文章先讲从零训练的参数化、采样与 3D U-Net、DiT 架构(如 VDM、Imagen Video、Sora),再讲如何改造预训练图像模型生成视频(Make-A-Video、Video LDM、SVD、Lumiere),最后介绍 Text2Video-Zero、ControlVideo 等免训练适配方法。

来源:Lilian Weng:Lil'Log(RSS) · lilianweng.github.io