【NeurIPS 2023】多模态联合视频生成大模型CoDi

发布时间:2023年12月17日

Diffusion Models视频生成-博客汇总

前言:目前视频生成的大部分工作都是只能生成无声音的视频,距离真正可用的视频还有不小的差距。CoDi提出了一种并行多模态生成的大模型,可以同时生成带有音频的视频,距离真正的视频生成更近了一步。相信在不远的将来,可以AI生成的模型可以无缝平替抖音等平台的短视频。这篇博客详细解读一下这篇论文《Any-to-Any Generation via Composable Diffusion》。

目录

贡献概述

方法详解

文章来源:https://blog.csdn.net/qq_41895747/article/details/134081915
本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。