YingqingHe/Awesome-Controllable-Video-Generation

πŸš€πŸš€πŸš€A curated list of papers on controllable video generation.

β˜… 1Forks 0GitHub β†—Compare

README

visitors GitHub Awesome

πŸš€πŸš€πŸš€A curated list of papers on controllable video generation. Please join us for more comprehensive summary. If you have any additions to the list, please raise them in the issue section. 欒迎θ‘₯ε……πŸ‘

πŸ€— Introduction

πŸ“‹ Contents

πŸ’˜ Tips

  • βœ… Paper searching via catatogue: directly clicking the content of the catatogue to select the area of your research and browse related papers.
  • βœ… Paper searching via author name: Free feel to search papers of a specific author via ctrl + F and then type the author name. The dropdown list of authors will automatically expand when searching.
  • βœ… Paper searching via tag: You can also search the related papers via the following tags: customization, iteractive, human motion generation tokenizer. (More tags are ongoing)

πŸ”Ή Single Control

🌟 Character Control/ID/Video Customization/Personalization

  • Animate-A-Story: Storytelling with Retrieval-Augmented Video Generation (13 Jul 2023)

    Yingqing He, Menghan Xia, Haoxin Chen, et al. Yingqing He, Menghan Xia, Haoxin Chen, Xiaodong Cun, Yuan Gong, Jinbo Xing, Yong Zhang, Xintao Wang, Chao Weng, Ying Shan, Qifeng Chen
    Paper Code

  • VideoDrafter: Content-Consistent Multi-Scene Video Generation with LLM (2 Jan 2024)

    Fuchen Long, Zhaofan Qiu, Ting Yao, et al. Fuchen Long, Zhaofan Qiu, Ting Yao, Tao Mei
    Paper Project

  • Vlogger: Make Your Dream A Vlog (17 Jan 2024)

    Shaobin Zhuang, Kunchang Li, Xinyuan Chen, et al. Shaobin Zhuang, Kunchang Li, Xinyuan Chen, Yaohui Wang, Ziwei Liu, Yu Qiao, Yali Wang
    Paper Code

  • VideoBooth: Diffusion-based Video Generation with Image Prompts (1 Dec 2023)

    Yuming Jiang, Tianxing Wu, Shuai Yang, et al. Yuming Jiang, Tianxing Wu, Shuai Yang, Chenyang Si, Dahua Lin, Yu Qiao, Chen Change Loy, Ziwei Liu
    Paper Code

  • Magic-Me: Identity-Specific Video Customized Diffusion (14 Feb 2024)

    Ze Ma, Daquan Zhou, Chun-Hsiao Yeh, et al. Ze Ma, Daquan Zhou, Chun-Hsiao Yeh, Xue-She Wang, Xiuyu Li, Huanrui Yang, Zhen Dong, Kurt Keutzer, Jiashi Feng
    Paper Code

  • AesopAgent: Agent-driven Evolutionary System on Story-to-Video Production (12 Mar 2024)

    Jiuniu Wang, Zehua Du, Yuyuan Zhao, et al. Jiuniu Wang, Zehua Du, Yuyuan Zhao, Bo Yuan, Kexiang Wang, Jian Liang, Yaxi Zhao, Yihen Lu, Gengliang Li, Junlong Gao, Xin Tu, Zhenyu Guo
    Paper

  • Anim-Director: A Large Multimodal Model Powered Agent for Controllable Animation Video Generation (19 Aug 2024)

    Yunxin Li, Haoyuan Shi, Baotian Hu, et al. Yunxin Li, Haoyuan Shi, Baotian Hu, Longyue Wang, Jiashun Zhu, Jinyi Xu, Zhen Zhao, Min Zhang
    Paper Code

  • DisenStudio: Customized Multi-subject Text-to-Video Generation with Disentangled Spatial Control (21 May 2024)

    Hong Chen, Xin Wang, Yipeng Zhang, et al. Hong Chen, Xin Wang, Yipeng Zhang, Yuwei Zhou, Zeyang Zhang, Siao Tang, Wenwu Zhu
    Paper

  • StoryAgent: Customized Storytelling Video Generation via Multi-Agent Collaboration (7 Nov 2024)

    Panwen Hu, Jin Jiang, Jianqi Chen, et al. Panwen Hu, Jin Jiang, Jianqi Chen, Mingfei Han, Shengcai Liao, Xiaojun Chang, Xiaodan Liang
    Paper

  • MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling (24 Sep 2024)

    Yifang Men, Yuan Yao, Miaomiao Cui, et al. Yifang Men, Yuan Yao, Miaomiao Cui, Liefeng Bo
    Paper Code

  • MovieCharacter: A Tuning-Free Framework for Controllable Character Video Synthesis (28 Oct 2024)

    Di Qiu, Zheng Chen, Rui Wang, et al. Di Qiu, Zheng Chen, Rui Wang, Mingyuan Fan, Changqian Yu, Junshi Huang, Xiang Wen
    Paper

  • AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance (12 Feb 2025)

    Zhao Wang, Hao Wen, Lingting Zhu, et al. Zhao Wang, Hao Wen, Lingting Zhu, Chenming Shang, Yujiu Yang, Qi Dou
    Paper Code

  • DreamRunner: Fine-Grained Compositional Story-to-Video Generation with Retrieval-Augmented Motion Adaptation (25 Nov 2024)

    Zun Wang, Jialu Li, Han Lin, et al. Zun Wang, Jialu Li, Han Lin, Jaehong Yoon, Mohit Bansal
    Paper Code

  • Lumina-T2X: Transforming Text into Any Modality, Resolution, and Duration via Flow-based Large Diffusion Transformers (9 May 2024)

    Peng Gao, Le Zhuo, Dongyang Liu, et al. Peng Gao, Le Zhuo, Dongyang Liu, Ruoyi Du, Xu Luo, Longtian Qiu, Yuhang Zhang, Chen Lin, Rongjie Huang, Shijie Geng, Renrui Zhang, Junlin Xi, Wenqi Shao, Zhengkai Jiang, Tianshuo Yang, Weicai Ye, He Tong, Jingwen He, Yu Qiao, Hongsheng Li
    Paper Code

  • VIMI: Grounding Video Generation through Multi-modal Instruction (8 Jul 2024)

    Yuwei Fang, Willi Menapace, Aliaksandr Siarohin, et al. Yuwei Fang, Willi Menapace, Aliaksandr Siarohin, Tsai-Shien Chen, Kuan-Chien Wang, Ivan Skorokhodov, Graham Neubig, Sergey Tulyakov
    Paper

  • SubjectDrive: Scaling Generative Data in Autonomous Driving via Subject Control (28 Mar 2024)

    Zheng Chen, Di Qiu, Rui Wang, et al. Binyuan Huang, Yuqing Wen, Yucheng Zhao, Yaosi Hu, Yingfei Liu, Fan Jia, Weixin Mao, Tiancai Wang, Chi Zhang, Chang Wen Chen, Zhenzhong Chen, Xiangyu Zhang
    Paper Project

  • VideoMaker: Zero-shot Customized Video Generation with the Inherent Force of Video Diffusion Models (27 Dec 2024)

    Tao Wu, Yong Zhang, Xiaodong Cun, et al. Tao Wu, Yong Zhang, Xiaodong Cun, Zhongang Qi, Junfu Pu, Huanzhang Dou, Guangcong Zheng, Ying Shan, Xi Li
    Paper Code

  • EchoVideo: Identity-Preserving Human Video Generation by Multimodal Feature Fusion (23 Jan 2025)

    Jiangchuan Wei, Shiyue Yan, Wenfeng Lin, et al. Jiangchuan Wei, Shiyue Yan, Wenfeng Lin, Boyuan Liu, Renjie Chen, Mingyu Guo
    Paper

  • SUGAR: Subject-Driven Video Customization in a Zero-Shot Manner (13 Dec 2024)

    Yufan Zhou, Ruiyi Zhang, Jiuxiang Gu, et al. Yufan Zhou, Ruiyi Zhang, Jiuxiang Gu, Nanxuan Zhao, Jing Shi, Tong Sun
    Paper

  • Multi-subject Open-set Personalization in Video Generation (10 Jan 2025)

    Tsai-Shien Chen, Aliaksandr Siarohin, Willi Menapace, et al. Tsai-Shien Chen, Aliaksandr Siarohin, Willi Menapace, Yuwei Fang, Kwot Sin Lee, Ivan Skorokhodov, Kfir Aberman, Jun-Yan Zhu, Ming-Hsuan Yang, Sergey Tulyakov
    Paper Code

  • Movie Weaver: Tuning-Free Multi-Concept Video Personalization with Anchored Prompts (4 Feb 2025)

    Feng Liang, Haoyu Ma, Zecheng He, et al. Feng Liang, Haoyu Ma, Zecheng He, Tingbo Hou, Ji Hou, Kunpeng Li, Xiaoliang Dai, Felix Juefei-Xu, Samaneh Azadi, Animesh Sinha, Peizhao Zhang, Peter Vajda, Diana Marculescu
    Paper

  • CustomTTT: Motion and Appearance Customized Video Generation via Test-Time Training (20 Dec 2024)

    Xiuli Bi, Jian Lu, Bo Liu, et al. Xiuli Bi, Jian Lu, Bo Liu, Xiaodong Cun, Yong Zhang, Weisheng Li, Bin Xiao
    Paper Code

  • DreamRelation: Relation-Centric Video Customization (10 Mar 2025)

    Yujie Wei, Shiwei Zhang, Hangjie Yuan, et al. Yujie Wei, Shiwei Zhang, Hangjie Yuan, Biao Gong, Longxiang Tang, Xiang Wang, Haonan Qiu, Hengjia Li, Shuai Tan, Yingya Zhang, Hongming Shan
    Paper

  • Get In Video: Add Anything You Want to the Video (8 Mar 2025)

    Shaobin Zhuang, Zhipeng Huang, Binxin Yang, et al. Shaobin Zhuang, Zhipeng Huang, Binxin Yang, Ying Zhang, Fangyikang Wang, Canmiao Fu, Chong Sun, Zheng-Jun Zha, Chen Li, Yali Wang
    Paper

  • Phantom: Subject-consistent video generation via cross-modal alignment (16 Feb 2025)

    Lijie Liu, Tianxiang Ma, Bingchuan Li, et al. Lijie Liu, Tianxiang Ma, Bingchuan Li, Zhuowei Chen, Jiawei Liu, Qian He, Xinglong Wu
    Paper Code

  • Identity-Preserving Text-to-Video Generation by Frequency Decomposition (25 Mar 2024)

    Shenghai Yuan, Jinfa Huang, et al. Shenghai Yuan, Jinfa Huang, Xianyi He, Yunyuan Ge, Yujun Shi, Liuhan Chen, Jiebo Luo, Li Yuan

    Paper

  • Animate-A-Story: Storytelling with Retrieval-Augmented Video Generation

    Yingqing He, Menghan Xia, et al. Yingqing He, Menghan Xia, Haoxin Chen, Xiaodong Cun, Yuan Gong, Jinbo Xing, Yong Zhang, Xintao Wang, Chao Weng, Ying Shan, Qifeng Chen

    Paper GitHub

  • ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

    Yuzhou Huang, Ziyang Yuan, Quande Liu, et al. Yuzhou Huang, Ziyang Yuan, Quande Liu, Qiulin Wang, Xintao Wang, Ruimao Zhang, Pengfei Wan, Di Zhang, Kun Gai

    Paper

  • Videodreamer: Customized Multi-Subject Text-to-Video Generation with Disen-Mix Finetuning

    Hong Chen, Xin Wang, Guanning Zeng, et al. Hong Chen, Xin Wang, Guanning Zeng, Yipeng Zhang, Yuwei Zhou, Feilin Han, Wenwu Zhu

    Paper

  • VideoBooth: Diffusion-based Video Generation with Image Prompts

    Yuming Jiang, Tianxing Wu, et al. Yuming Jiang, Tianxing Wu, Shuai Yang, Chenyang Si, Dahua Lin, Yu Qiao, Chen Change Loy, Ziwei Liu

    Paper GitHub

  • Customcrafter: Customized Video Generation with Preserving Motion and Concept Composition Abilities

    Tao Wu, Yong Zhang, Xintao Wang, et al. Tao Wu, Yong Zhang, Xintao Wang, Xianpan Zhou, Guangcong Zheng, Zhongang Qi, Ying Shan, Xi Li

    Paper

  • Still-Moving: Customized Video Generation Without Customized Video Data

    Hila Chefer, Shiran Zada, Roni Paiss, Ariel Ephrat, et al. Hila Chefer, Shiran Zada, Roni Paiss, Ariel Ephrat, Omer Tov, Michael Rubinstein, Lior Wolf, Tali Dekel, Tomer Michaeli, Inbar Mosseri

    Paper

  • Customvideo: Customizing Text-to-Video Generation with Multiple Subjects

    Zhao Wang, Aoxue Li, et al. Zhao Wang, Aoxue Li, Lingting Zhu, Yong Guo, Qi Dou, Zhenguo Li

    Paper

  • Dreamvideo: Composing Your Dream Videos with Customized Subject and Motion

    Yujie Wei, Shiwei Zhang, Zhiwu Qing, et al. Yujie Wei, Shiwei Zhang, Zhiwu Qing, Hangjie Yuan, Zhiheng Liu, Yu Liu, Yingya Zhang, Jingren Zhou, Hongming Shan

    PaperGitHub

  • MotionBooth: Motion-Aware Customized Text-to-Video Generation

    Jianzong Wu, Xiangtai Li, Yanhong Zeng, et al. Jianzong Wu, Xiangtai Li, Yanhong Zeng, Jiangning Zhang, Qianyu Zhou, Yining Li, Yunhai Tong, Kai Chen

    Paper

  • ID-Animator: Zero-Shot Identity-Preserving Human Video Generation (25 Jun 2024)

    Xuanhua He, Quande Liu, et al. Xuanhua He, Quande Liu, Shengju Qian, Xin Wang, Tao Hu, Ke Cao, Keyu Yan, Jie Zhang

    Paper GitHub

  • PERSONALVIDEO: High ID-Fidelity Video Customization with Static Images

    Hengjia Li, Haonan Qiu, Shiwei Zhang, Xiang Wang, et al. Hengjia Li, Haonan Qiu, Shiwei Zhang, Xiang Wang, Yujie Wei, Zekun Li, Yingya Zhang, Boxi Wu, Deng Cai

    Paper

  • TaleCrafter: Interactive Story Visualization with Multiple Characters

    Yuan Gong, Youxin Pang, et al. Yuan Gong, Youxin Pang, Xiaodong Cun, Menghan Xia, Yingqing He, Haoxin Chen, Longyue Wang, Yong Zhang, Xintao Wang, Ying Shan, Yujiu Yang

    Paper GitHub

  • Dreamix: Video Diffusion Models are General Video Editors

    Eyal Molad, Eliahu Horwitz, et al. Eyal Molad, Eliahu Horwitz, Dani Valevski, Alex Rav Acha, Yossi Matias, Yael Pritch, Yaniv Leviathan, Yedid Hoshen

    Paper

  • VideoAlchemy: Open-set Personalization in Video Generation

    Tsai-Shien Chen, Aliaksandr Siarohin, et al. Tsai-Shien Chen, Aliaksandr Siarohin, Willi Menapace, Yuwei Fang, Ivan Skorokhodov, Jun-Yan Zhu, Kfir Aberman, Ming-Hsuan Yang, Sergey Tulyakov

    Paper

πŸ“ Spatial Control

πŸ•Ί Pose Control

  • TASTE-Rob: Advancing Video Generation of Task-Oriented Hand-Object Interaction for Generalizable Robotic Manipulation (14 Mar 2025)

    Hongxiang Zhao, Xingchen Liu, et al. Hongxiang Zhao, Xingchen Liu, Mutian Xu, Yiming Hao, Weikai Chen, Xiaoguang Han

    Paper Project_Page

  • AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance (12 Feb 2025)

    Zhao Wang, Hao Wen, et al. Zhao Wang, Hao Wen, Lingting Zhu, Chenming Shang, Yujiu Yang, Qi Dou

    Paper Code Project_Page

  • Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance (10 Feb 2025)

    Li Hu,Β Guangyuan Wang, et al. Li Hu,Β Guangyuan Wang,Β Zhen Shen,Β Xin Gao,Β Dechao Meng,Β Lian Zhuo,Β Peng Zhang,Β Bang Zhang,Β Liefeng Bo

    Paper Project_Page

  • Consistent Human Image and Video Generation with Spatially Conditioned Diffusion (19 Dec 2024)

    Mingdeng Cao, Chong Mou, et al. Mingdeng Cao, Chong Mou, Ziyang Yuan, Xintao Wang, Zhaoyang Zhang, Ying Shan, Yinqiang Zheng

    Paper Code

  • DirectorLLM for Human-Centric Video Generation (19 Dec 2024)

    Kunpeng Song, Tingbo Hou, et al. Kunpeng Song, Tingbo Hou, Zecheng He, Haoyu Ma, Jialiang Wang, Animesh Sinha, Sam Tsai, Yaqiao Luo, Xiaoliang Dai, Li Chen, Xide Xia, Peizhao Zhang, Peter Vajda, Ahmed Elgammal, Felix Juefei-Xu

    Paper

  • Generative Inbetweening through Frame-wise Conditions-Driven Video Generation (16 Dec 2024)

    Tianyi Zhu, Dongwei Ren, et al. Tianyi Zhu, Dongwei Ren, Qilong Wang, Xiaohe Wu, Wangmeng Zuo

    Paper Code Project_Page

  • DisPose: Disentangling Pose Guidance for Controllable Human Image Animation (12 Dec 2024)

    Hongxiang Li, Yaowei Li, et al. Hongxiang Li, Yaowei Li, Yuhang Yang, Junjie Cao, Zhihong Zhu, Xuxin Cheng, Long Chen

    Paper Code Project_Page

  • ControlNeXt: Powerful and Efficient Control for Image and Video Generation (12 Aug 2024)

    Bohao Peng, Jian Wang, et al. Bohao Peng, Jian Wang, Yuechen Zhang, Wenbo Li, Ming-Chang Yang, Jiaya Jia

    Paper Code Project_Page

  • MimicMotion: High-Quality Human Motion Video Generation with Confidence-aware Pose Guidance (28 Jun 2024)

    Yuang Zhang, Jiaxi Gu, et al. Yuang Zhang, Jiaxi Gu, Li-Wen Wang, Han Wang, Junqi Cheng, Yuefeng Zhu, Fangyuan Zou

    Paper Code Project_Page

  • Champ: Controllable and Consistent Human Image Animation with 3D Parametric Guidance (21 Mar 2024)

    Shenhao Zhu, Junming Leo Chen, et al. Shenhao Zhu, Junming Leo Chen, Zuozhuo Dai, Qingkun Su, Yinghui Xu, Xun Cao, Yao Yao, Hao Zhu, Siyu Zhu

    Paper Code Project_Page

  • Do You Guys Want to Dance: Zero-Shot Compositional Human Dance Generation with Multiple Persons (24 Jan 2024)

    Zhe Xu, Kun Wei, et al. Zhe Xu, Kun Wei, Xu Yang, Cheng Deng

    Paper

  • Generative Rendering: Controllable 4D-Guided Video Generation with 2D Diffusion Models (3 Dec 2023)

    Shengqu Cai, Duygu Ceylan, et al. Shengqu Cai, Duygu Ceylan, Matheus Gadelha, Chun-Hao Paul Huang, Tuanfeng Yang Wang, Gordon Wetzstein

    Paper Project_Page

  • Animate Anyone: Consistent and Controllable Image-to-Video Synthesis for Character Animation (28 Nov 2023)

    Li Hu, Xin Gao, et al. Li Hu, Xin Gao, Peng Zhang, Ke Sun, Bang Zhang, Liefeng Bo

    Paper Code Project_Page

  • MagicAnimate: Temporally Consistent Human Image Animation using Diffusion Model (27 Nov 2023)

    Zhongcong Xu, Jianfeng Zhang, et al. Zhongcong Xu, Jianfeng Zhang, Jun Hao Liew, Hanshu Yan, Jia-Wei Liu, Chenxu Zhang, Jiashi Feng, Mike Zheng Shou

    Paper Code Project_Page

  • MagicPose: Realistic Human Poses and Facial Expressions Retargeting with Identity-aware Diffusion (18 Nov 2023)

    Di Chang, Yichun Shi, Quankai Gao, et al. Di Chang, Yichun Shi, Quankai Gao, Jessica Fu, Hongyi Xu, Guoxian Song, Qing Yan, Yizhe Zhu, Xiao Yang, Mohammad Soleymani

    Paper Code Project_Page

  • Dancing Avatar: Pose and Text-Guided Human Motion Videos Synthesis with Image Diffusion Model (15 Aug 2023)

    Bosheng Qin, Wentao Ye, et al. Bosheng Qin, Wentao Ye, Qifan Yu, Siliang Tang, Yueting Zhuang

    Paper

  • DisCo: Disentangled Control for Realistic Human Dance Generation (30 Jun 2023)

    Tan Wang, Linjie Li, et al. Tan Wang, Linjie Li, Kevin Lin, Yuanhao Zhai, Chung-Ching Lin, Zhengyuan Yang, Hanwang Zhang, Zicheng Liu, Lijuan Wang

    Paper Code Project_Page

  • DreamPose: Fashion Image-to-Video Synthesis via Stable Diffusion (12 Apr 2023)

    Johanna Karras, Aleksander Holynski, et al. Johanna Karras, Aleksander Holynski, Ting-Chun Wang, Ira Kemelmacher-Shlizerman

    Paper Code Project_Page

  • Follow Your Pose: Pose-Guided Text-to-Video Generation using Pose-Free Videos (3 Apr 2023)

    Yue Ma, Yingqing He, et al. Yue Ma, Yingqing He, Xiaodong Cun, Xintao Wang, Siran Chen, Ying Shan, Xiu Li, Qifeng Chen

    Paper Code Project_Page

  • Point-to-Point Video Generation (5 Apr 2019)

    Tsun-Hsuan Wang, Yen-Chi Cheng, et al. Tsun-Hsuan Wang, Yen-Chi Cheng, Chieh Hubert Lin, Hwann-Tzong Chen, Min Sun

    Paper Code Project_Page

  • Pose Guided Human Video Generation (3 Apr 2023)

    Ceyuan Yang, Zhe Wang, et al. Ceyuan Yang, Zhe Wang, Xinge Zhu, Chen Huang, Jianping Shi, Dahua Lin

    Paper

πŸš— BEV-Control

  • MagicDrive: Street View Generation with Diverse 3D Geometry Control (04 Oct 2023)

    Ruiyuan Gao, Kai Chen, Enze Xie, et al. Ruiyuan Gao, Kai Chen, Enze Xie, Lanqing Hong, Zhenguo Li, Dit-Yan Yeung, Qiang Xu
    Paper Code Project

  • Panacea: Panoramic and Controllable Video Generation for Autonomous Driving (28 Nov 2023)

    Yuqing Wen, Yucheng Zhao, Yingfei Liu, et al. Yuqing Wen, Yucheng Zhao, Yingfei Liu, Fan Jia, Yanhui Wang, Chong Luo, Chi Zhang, Tiancai Wang, Xiaoyan Sun, Xiangyu Zhang
    Paper Code Project

  • DriveDreamer-2: LLM-Enhanced World Models for Diverse Driving Video Generation (11 Mar 2024)

    Guosheng Zhao, Xiaofeng Wang, Zheng Zhu, et al. Guosheng Zhao, Xiaofeng Wang, Zheng Zhu, Xinze Chen, Guan Huang, Xiaoyi Bao, Xingang Wang
    Paper Code Project

  • Unleashing Generalization of End-to-End Autonomous Driving with Controllable Long Video Generation (03 Jun 2024)

    Enhui Ma, Lijun Zhou, Tao Tang, et al. Enhui Ma, Lijun Zhou, Tao Tang, Zhan Zhang, Dong Han, Junpeng Jiang, Kun Zhan, Peng Jia, Xianpeng Lang, Haiyang Sun, Di Lin, Kaicheng Yu
    Paper Code Project

  • DiVE: DiT-based Video Generation with Enhanced Control (03 Sep 2024)

    Junpeng Jiang, Gangyi Hong, Lijun Zhou, et al. Junpeng Jiang, Gangyi Hong, Lijun Zhou, Enhui Ma, Hengtong Hu, Xia Zhou, Jie Xiang, Fan Liu, Kaicheng Yu, Haiyang Sun, Kun Zhan, Peng Jia, Miao Zhang
    Paper Code Project

  • DreamForge: Motion-Aware Autoregressive Video Generation for Multi-View Driving Scenes (06 Sep 2024)

    Jianbiao Mei, Tao Hu, Xuemeng Yang, et al. Jianbiao Mei, Tao Hu, Xuemeng Yang, Licheng Wen, Yu Yang, Tiantian Wei, Yukai Ma, Min Dou, Botian Shi, Yong Liu
    Paper Code Project

  • MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control (21 Nov 2024)

    Ruiyuan Gao, Kai Chen, Bo Xiao, et al. Ruiyuan Gao, Kai Chen, Bo Xiao, Lanqing Hong, Zhenguo Li, Qiang Xu
    Paper Code Project

  • Seeing Beyond Views: Multi-View Driving Scene Video Generation with Holistic Attention (04 Dec 2024)

    Hannan Lu, Xiaohe Wu, Shudong Wang, et al. Hannan Lu, Xiaohe Wu, Shudong Wang, Xiameng Qin, Xinyu Zhang, Junyu Han, Wangmeng Zuo, Ji Tao
    Paper Project

🎨 Style Control

  • StyleMaster: Stylize Your Video with Artistic Generation and Translation (10 Dec 2024)
    Zixuan Ye, Huijuan Huang, Xintao Wang, et al. Pengfei Wan, Di Zhang, Wenhan Luo

Paper Code citation Project_Page

  • FRESCO: Spatial-Temporal Correspondence for Zero-Shot Video Translation (19 Mar 2024)
    [CVPR 2024] Shuai Yang, Yifan Zhou, Ziwei Liu, et al. Chen Change Loy

Paper Code citation Project_Page

  • StyleCrafter: Enhancing Stylized Text-to-Video Generation with Style Adapter (1 Dec 2023)
    [TOG 2024] Gongye Liu, Menghan Xia, Yong Zhang, et al. Haoxin Chen, Jinbo Xing, Yibo Wang, Xintao Wang, Yujiu Yang, Ying Shan

Paper Code citation Project_Page

  • UniVST: A Unified Framework for Training-free Localized Video Style Transfer (26 Oct 2024)
    Quanjian Song, Mingbao Lin, Wengyi Zhan, et al. Shuicheng Yan, Liujuan Cao, Rongrong Ji

Paper Code citation

  • StyleGANEX: StyleGAN-Based Manipulation Beyond Cropped Aligned Faces (21 Jul 2023)
    [ICCV 2023] Shua Yang, Liming Jiang, Ziwei Liu, et al. Chen Change Loy

Paper Code citation Project_Page

  • Rerender A Video: Zero-Shot Text-Guided Video-to-Video Translation (13 Jun 2023)
    [Siggraph Asia 2023] Shuai Yang, Yifan Zhou, Ziwei Liu, et al. Chen Change Loy

Paper Code citation Project_Page

  • VToonify: Controllable High-Resolution Portrait Video Style Transfer (22 Sep 2022)
    [Siggraph Asia 2022] Shuai Yang, Liming Jiang, Ziwei Liu, et al. Chen Change Loy

Paper Code citation Project_Page

  • Arbitrary video style transfer via multi-channel correlation (17 Sep 2020)
    [AAAI 2020] Yingying Deng, Fan Tang, Weiming Dong, et al. Yingying Deng, Fan Tang, Weiming Dong, Haibin Huang, Chongyang Ma, Changsheng Xu

Paper Code citation

  • Fast video multi-style transfer (2020)
    [WACV 2020] Wei Gao, Yijun Li, et al. Yihang Yin, Ming-Hsuan Yang

Paper Code citation

  • Coherent online video style transfer (27 Mar 2017)
    [CVPR 2017] Dongdong Chen, Jing Liao, Lu Yuan, et al. Nenghai Yu, Gang Hua

Paper citation

  • Real-time neural style transfer for videos (2017)
    [CVPR 2017] Haozhi Huang, Hao Wang, Wenhan Luo, et al. Lin Ma, Wenhao Jiang, Xiaolong Zhu, Zhifeng Li, Wei Liu

Paper citation

πŸ“Œ Point Control

  • Diffusion as Shader: 3D-aware Video Diffusion for Versatile Video Generation Control (7 Jan 2025)
    Zekai Gu, Rui Yan, Jiahao Lu, Peng Li, et al. Zhiyang Dou, Chenyang Si, Zhen Dong, Qifeng Liu, Cheng Lin, Ziwei Liu, Wenping Wang, Yuan Liu

Paper Code citation Project_Page

  • GS-DiT: Advancing Video Generation with Pseudo 4D Gaussian Fields through Efficient Dense 3D Point Tracking (5 Jan 2025)
    Weikang Bian, Zhaoyang Huang, Xiaoyu Shi, et al. Yijin Li, Fu-Yun Wang, Hongsheng Li

Paper citation Project_Page

  • Track4Gen: Teaching Video Diffusion Models to Track Points Improves Video Generation (8 Dec 2024)
    [CVPR 2025] Hyeonho Jeong, Chun-Hao Paul Huang, et al. Jong Chul Ye, Niloy Mitra, Duygu Ceylan

Paper citation Project_Page

  • Drag-A-Video: Non-rigid Video Editing with Point-based Interaction (5 Dec 2023)
    Yao Teng, Enze Xie, Yue Wu, Haoyu Han, et al. Zhenguo Li, Xihui Liu

Paper Code citation Project_Page

  • Point-to-Point Video Generation (5 Apr 2019)
    [ICCV 2019] Tsun-Hsuan Wang, Yen-Chi Cheng, Chieh Hubert Lin, et al. Hwann-Tzong Chen, Min Sun

Paper Code citation Project_Page

πŸ“ Depth Control

  • DreamDance: Animating Human Images by Enriching 3D Geometry Cues from 2D Poses (30 Nov 2024)
    Yatian Pang, Bin Zhu, Bin Lin, et al. Mingzhe Zheng, Francis E. H. Tay, Ser-Nam Lim, Harry Yang, Li Yuan

Paper Code citation Project_Page

  • ControlNeXt: Powerful and Efficient Control for Image and Video Generation (12 Aug 2024)
    Bohao Peng, Jian Wang, Yuechen Zhang, et al. Wenbo Li, Ming-Chang Yang, Jiaya Jia

Paper Code citation Project_Page

  • Champ: Controllable and Consistent Human Image Animation with 3D Parametric Guidance (21 Mar 2024)
    [ECCV 2024] Shenhao Zhu, Junming Leo Chen, Zuozhuo Dai, et al. Qingkun Su, Yinghui Xu, Xun Cao, Yao Yao, Hao Zhu, Siyu Zhu

Paper Code citation Project_Page

  • MoonShot: Towards Controllable Video Generation and Editing with Multimodal Conditions (3 Jan 2024)
    David Junhao Zhang, Dongxu Li, Hung Le, et al. Mike Zheng Shou, Caiming Xiong, Doyen Sahoo

Paper Code citation Project_Page

  • SparseCtrl: Adding Sparse Controls to Text-to-Video Diffusion Models (28 Nov 2023)
    [ECCV 2024] Yuwei Guo, Ceyuan Yang, Anyi Rao, et al. Maneesh Agrawala, Dahua Lin, Bo Dai

Paper Code citation Project_Page

  • GD-VDM: Generated Depth for better Diffusion-based Video Generation (19 Jun 2023)
    Ariel Lapid, Idan Achituve, Lior Bracha, et al. Ethan Fetaya

Paper Code citation

  • Make-Your-Video: Customized Video Generation Using Textual and Structural Guidance (1 Jun 2023)
    [IEEE TVCG 2024] Jinbo Xing, Menghan Xia, Yuxin Liu, et al. Yuechen Zhang, Yong Zhang, Yingqing He, Hanyuan Liu, Haoxin Chen, Xiaodong Cun, Xintao Wang, Ying Shan, Tien-Tsin Wong

Paper Code citation Project_Page

  • Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning (23 May 2023)
    Weifeng Chen, Yatai Ji, Jie Wu, et al. Hefeng Wu, Pan Xie, Jiashi Li, Xin Xia, Xuefeng Xiao, Liang Lin

Paper Code citation Project_Page

  • ControlVideo: Training-free Controllable Text-to-Video Generation (22 May 2023)
    [ICLR 2024] Yabo Zhang, Yuxiang Wei, Dongsheng Jiang, et al. Xiaopeng Zhang, Wangmeng Zuo, Qi Tian

Paper Code citation Project_Page

πŸ—ΊοΈ Landmark Control

  • TASTE-Rob: Advancing Video Generation of Task-Oriented Hand-Object Interaction for Generalizable Robotic Manipulation (14 Mar 2025)

    Hongxiang Zhao, Xingchen Liu, et al. Hongxiang Zhao, Xingchen Liu, Mutian Xu, Yiming Hao, Weikai Chen, Xiaoguang Han

    Paper citation Project_Page

  • Identity-Preserving Text-to-Video Generation by Frequency Decomposition (26 Nov 2024)

    [CVPR 2025] Shenghai Yuan, Jinfa Huang, et al. Shenghai Yuan, Jinfa Huang, Xianyi He, Yunyuan Ge, Yujun Shi, Liuhan Chen, Jiebo Luo, Li Yuan

    Paper Code Project_Page

  • EchoMimicV2: Towards Striking, Simplified, and Semi-Body Human Animation (15 Nov 2024)

    [CVPR 2025] Rang Meng, Xingyu Zhang, Yuming Li, et al. Chenguang Ma
    Paper Project_Page Code

  • Takin-ADA: Emotion Controllable Audio-Driven Animation with Canonical and Landmark Loss Optimization (18 Oct 2024)

    Bin Lin, Yanzhen Yu, et al. Bin Lin, Yanzhen Yu, Jianhao Ye, Ruitao Lv, Yuguang Yang, Ruoye Xie, Pan Yu, Hongbin Zhou

    Paper Project_Page

  • EchoMimic: Lifelike Audio-Driven Portrait Animations through Editable Landmark Conditions (12 Jul 2024)

    [AAAI 2025] Zhiyuan Chen, Jiajiong Cao, Zhiquan Chen, et al. Yuming Li, Chenguang Ma
    Paper citation Project_Page Code Demo

  • LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control (3 Jul 2024)

    Jianzhu Guo, Dingyun Zhang, et al. Jianzhu Guo, Dingyun Zhang, Xiaoqiang Liu, Zhizhou Zhong, Yuan Zhang, Pengfei Wan, Di Zhang

    Paper Code Project_Page

  • Follow-Your-Emoji: Fine-Controllable and Expressive Freestyle Portrait Animation (4 Jun 2024)

    [Siggraph Asia 2024] Yue Ma, Hongyu Liu, et al. Yue Ma, Hongyu Liu, Hongfa Wang, Heng Pan, Yingqing He, Junkun Yuan, Ailing Zeng, Chengfei Cai, Heung-Yeung Shum, Wei Liu, Qifeng Chen

    Paper Code Project_Page

  • Follow Your Pose: Pose-Guided Text-to-Video Generation using Pose-Free Videos (3 Apr 2023)

    [AAAI 2024] Yue Ma, Yingqing He, et al. Yue Ma, Yingqing He, Xiaodong Cun, Xintao Wang, Siran Chen, Ying Shan, Xiu Li, Qifeng Chen

    Paper Code Project_Page

  • SadTalker: Learning Realistic 3D Motion Coefficients for Stylized Audio-Driven Single Image Talking Face Animation (22 Nov 2022)

    [CVPR 2023] Wenxuan Zhang, Xiaodong Cun, et al. Wenxuan Zhang, Xiaodong Cun, Xuan Wang, Yong Zhang, Xi Shen, Yu Guo, Ying Shan, Fei Wang

    Paper Code Project_Page

  • Depth-Aware Generative Adversarial Network for Talking Head Video Generation (13 Mar 2022)

    [CVPR 2022] Fa-Ting Hong, Longhao Zhang, et al. Fa-Ting Hong, Longhao Zhang, Li Shen, Dan Xu

    Paper Code Project_Page

✍️ Text Rendering

  • Text-Animator: Controllable Visual Text Video Generation (25 Jun 2024)

    Lin Liu, Quande Liu, Shengju Qian, et al.Yuan Zhou, Wengang Zhou, Houqiang Li, Lingxi Xie, Qi Tian
    Paper citation Project_Page

  • Wan: Open and Advanced Large-Scale Video Generative Models (2025)

    WanTeam, Ang Wang, Baole Ai, et al.Bin Wen,Chaojie Mao,Chen-Wei Xie,Di Chen,Feiwu Yu,Haiming Zhao,Jianxiao Yang,Jianyuan Zeng,Jiayu Wang,Jingfeng Zhang,Jingren Zhou,Jinkai Wang,Jixuan Chen,Kai Zhu,Kang Zhao,Keyu Yan,Lianghua Huang,Mengyang Feng,Ningyi Zhang,Pandeng Li,Pingyu Wu,Ruihang Chu,Ruili Feng,Shiwei Zhang,Siyang Sun,Tao Fang,Tianxing Wang,Tianyi Gui,Tingyu Weng,Tong Shen,Wei Lin,Wei Wang1,Wei Wang2,Wenmeng Zhou,Wente Wang,Wenting Shen,Wenyuan Yu,Xianzhong Shi,Xiaoming Huang,Xin Xu,Yan Kou,Yangyu Lv,Yifei Li,Yijing Liu,Yiming Wang,Yingya Zhang,Yitong Huang,Yong Li,You Wu,Yu Liu,Yulin Pan,Yun Zheng,Yuntao Hong,Yupeng Shi,Yutong Feng,Zeyinzi Jiang,Zhen Han,Zhi-Fan Wu,Ziyu Liu
    Paper Code

⏳ Temporal Control

🌊 Flow-Guided

  • MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model (30 May 2024)

    [ECCV 2024] Muyao Niu, Xiaodong Cun, et al. Muyao Niu, Xiaodong Cun, Xintao Wang, Yong Zhang, Ying Shan, Yinqiang Zheng

    Paper Code Project_Page

  • Motion-I2V: Consistent and Controllable Image-to-Video Generation with Explicit Motion Modeling (29 Jan 2024)

    [SIGGRAPH 2024] Xiaoyu Shi, Zhaoyang Huang, et al. Xiaoyu Shi, Zhaoyang Huang, Fu-Yun Wang, Weikang Bian, Dasong Li, Yi Zhang, Manyuan Zhang, Ka Chun Cheung, Simon See, Hongwei Qin, Jifeng Dai, Hongsheng Li

    Paper Code Project_Page

  • Motion-Conditioned Diffusion Model for Controllable Video Synthesis (27 Apr 2023)

    Tsai-Shien Chen, Chieh Hubert Lin, et al. Tsai-Shien Chen, Chieh Hubert Lin, Hung-Yu Tseng, Tsung-Yi Lin, Ming-Hsuan Yang

    Paper Project_Page

πŸ“Έ Camera-Guided

  • VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control (30 Mar 2025)

    Sherwin Bahmani, Ivan Skorokhodov, Aliaksandr Siarohin, et al.Willi Menapace, Guocheng Qian, Michael Vasilkovsky, Hsin-Ying Lee, Chaoyang Wang, Jiaxu Zou, Andrea Tagliasacchi, David B. Lindell, Sergey Tulyakov
    Paper Code

  • CineMaster: A 3D-Aware and Controllable Framework for Cinematic Text-to-Video Generation (30 Mar 2025)

    Qinghe Wang, Yawen Luo, Xiaoyu Shi, et al.Xu Jia, Huchuan Lu, Tianfan Xue, Xintao Wang, Pengfei Wan, Di Zhang, Kun Gai
    Paper

  • Direct-a-Video: Customized Video Generation with User-Directed Camera Movement and Object Motion (30 Mar 2025)

    Shiyuan Yang, Liang Hou, Haibin Huang, et al.Chongyang Ma, Pengfei Wan, Di Zhang, Xiaodong Chen, Jing Liao
    Paper Code

  • 3DTRAJMASTER: MASTERING 3D TRAJECTORY FOR MULTI-ENTITY MOTION IN VIDEO GENERATION (30 Mar 2025)

    Xiao Fu, Xian Liu, Xintao Wang, et al.Sida Peng, Menghan Xia, Xiaoyu Shi, Ziyang Yuan, Pengfei Wan, Di Zhang, Dahua Lin
    Paper

  • AC3D: Analyzing and Improving 3D Camera Control in Video Diffusion Transformers (30 Mar 2025)

    Sherwin Bahmani, Ivan Skorokhodov, Guocheng Qian, et al.Aliaksandr Siarohin, Willi Menapace, Andrea Tagliasacchi, David B. Lindell, Sergey Tulyakov
    Paper Code

  • CameraCtrl: Enabling Camera Control for Text-to-Video Generation (30 Mar 2025)

    Hao He, Yinghao Xu, Yuwei Guo, et al.Gordon Wetzstein, Bo Dai, Hongsheng Li, Ceyuan Yang
    Paper Code

  • ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis (30 Mar 2025)

    Wangbo Yu, Jinbo Xing, Li Yuan, et al.Wenbo Hu, Xiaoyu Li, Zhipeng Huang, Xiangjun Gao, Tien-Tsin Wong, Ying Shan, Yonghong Tian
    Paper Code

  • EgoSim: Egocentric Exploration in Virtual Worlds with Multi-modal Conditioning (30 Mar 2025)

    Wei Yu, Songheng Yin, Steve Easterbrook, Animesh Garg
    Paper

  • MOTIONFLOW: LEARNING IMPLICIT MOTION FLOW FOR COMPLEX CAMERA TRAJECTORY CONTROL IN VIDEO GENERATION (30 Mar 2025)

    Author list not fully provided
    Paper

  • MotionMaster: Training-free Camera Motion Transfer For Video Generation (30 Mar 2025)

    Teng Hu, Jiangning Zhang, Ran Yi, et al.Yating Wang, Hongrui Huang, Jieyu Weng, Yabiao Wang, Lizhuang Ma
    Paper Code

  • ReCamMaster: Camera-Controlled Generative Rendering from A Single Video (30 Mar 2025)

    Jianhong Bai, Menghan Xia, Xiao Fu, et al.Xintao Wang, Lianrui Mu, Jinwen Cao, Zuozhu Liu, Haoji Hu, Xiang Bai, Pengfei Wan, Di Zhang
    Paper

  • CPA: Camera-pose-awareness Diffusion Transformer for Video Generation (30 Mar 2025)

    Yuelei Wang, Jian Zhang, Pengtao Jiang, et al.Hao Zhang, Jinwei Chen, Bo Li
    Paper

  • BOOSTING CAMERA MOTION CONTROL FOR VIDEO DIFFUSION TRANSFORMERS (30 Mar 2025)

    Soon Yau Cheong, Duygu Ceylan, Armin Mustafa, et al.Andrew Gilbert, Chun-Hao Paul Huang
    Paper

  • CAVIA: CAMERA-CONTROLLABLE MULTI-VIEW VIDEO DIFFUSION WITH VIEW-INTEGRATED ATTENTION (30 Mar 2025)

    Dejia Xu, Yifan Jiang, Chen Huang, et al.Liangchen Song, Thorsten Gernoth, Liangliang Cao, Zhangyang Wang, Hao Tang
    Paper

  • Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training (30 Mar 2025)

    Zhenghong Zhou, Jie An, Jiebo Luo
    Paper

  • CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models (30 Mar 2025)

    Hao He, Ceyuan Yang, Shanchuan Lin, et al.Yinghao Xu, Meng Wei, Liangke Gui, Qi Zhao, Gordon Wetzstein, Lu Jiang, Hongsheng Li
    Paper

πŸ›€οΈ Traj-Guided

  • Direct-a-Video: Customized Video Generation with User-Directed Camera Movement and Object Motion (6 May 2024οΌ‰

    Shiyuan Yang, Liang Hou, Haibin Huang, et al.Shiyuan Yang, Liang Hou, Haibin Huang, Chongyang Ma, Pengfei Wan, Di Zhang, Xiaodong Chen, Jing Liao
    Paper Code Project_Page

  • TrailBlazer: Trajectory Control for Diffusion-Based Video Generation(Both are based on T2V, not I2V.)(8 Apr 2024οΌ‰

    Wan-Duo Kurt Ma, J.P. Lewis, W. Bastiaan Kleijn, et al.Wan-Duo Kurt Ma, J.P. Lewis, W. Bastiaan Kleijn
    Paper Code Project_Page

  • Freetraj: Tuning-free trajectory control in video diffusion models(T2V) (24 Jun 2024οΌ‰

    Haonan Qiu, Zhaoxi Chen, Zhouxia Wang, et al.Haonan Qiu, Zhaoxi Chen, Zhouxia Wang, Yingqing He, Menghan Xia, Ziwei Liu
    Paper code Project_Page

  • Peekaboo: Interactive video generation via masked-diffusion(T2V) (19 Apr 2024οΌ‰

    Yash Jain, Anshul Nasery, Vibhav Vineet, et al.Yash Jain, Anshul Nasery, Vibhav Vineet, Harkirat Behl

    Paper code Project_Page

  • MotionBooth: Motion-Aware Customized Text-to-Video Generation(29 Oct 2024οΌ‰

    Jianzong Wu, Xiangtai Li, Yanhong Zeng, et al.Jianzong Wu, Xiangtai Li, Yanhong Zeng, Jiangning Zhang, Qianyu Zhou, Yining Li, Yunhai Tong, Kai Chen
    Paper Code Project_Page

  • Collaborative video diffusion: Consistent multi-video generation with camera control(27 May 2024)

    Zhengfei Kuang, Shengqu Cai, Hao He, et al.Zhengfei Kuang, Shengqu Cai, Hao He, Yinghao Xu, Hongsheng Li, Leonidas Guibas, Gordon Wetzstein
    Paper Project_Page

  • Tora: Trajectory-oriented Diffusion Transformer for Video Generation (14 Mar 2025)

    Zhenghao Zhang, Junchao Liao, Menghao Li, et al.Zhenghao Zhang, Junchao Liao, Menghao Li, ZuoZhuo Dai, Bingxue Qiu, Siyu Zhu, Long Qin, Weizhi Wang
    Paper code Project_Page

  • Motion-Zero: A Zero-Shot Trajectory Control Framework of Moving Object (08 Jan 2025)

    Changgu Chen, Junwei Shu, Gaoqi He, et al.Changgu Chen, Junwei Shu, Gaoqi He, Changbo Wang, Yang Li
    Paper code Project_Page

  • VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control (22 Mar 2025)

    Sherwin Bahmani, Ivan Skorokhodov, Aliaksandr Siarohin, et al.Sherwin Bahmani, Ivan Skorokhodov, Aliaksandr Siarohin, Willi Menapace, Guocheng Qian, Michael Vasilkovsky, Hsin-Ying Lee, Chaoyang Wang, Jiaxu Zou, Andrea Tagliasacchi, David B. Lindell, Sergey Tulyakov
    Paper code Project_Page

  • Controllable Video Generation With Sparse Trajectories (2018)

    Zekun Hao, Xun Huang, Serge Belongie, et al.Zekun Hao, Xun Huang, Serge Belongie
    Paper code Project_Page

  • MagicMotion: Controllable Video Generation with Dense-to-Sparse Trajectory Guidance(20 Mar 2025)

    Quanhao Li, Zhen Xing, Rui Wang, et al.Quanhao Li, Zhen Xing, Rui Wang, Hui Zhang, Qi Dai, Zuxuan Wu
    Paper code Project_Page

  • MotionCanvas: Cinematic Shot Design with Controllable Image-to-Video Generation (6 Feb 2025)

    Jinbo Xing, Long Mai, Cusuh Ham, et al.Jinbo Xing, Long Mai, Cusuh Ham, Jiahui Huang, Aniruddha Mahapatra, Chi-Wing Fu, Tien-Tsin Wong, Feng Liu
    Paper

    Project_Page

πŸŽ₯ Motion Customization/Motion Mask/Motion Video(traj)

  • MotionMatcher: Motion Customization of Text-to-Video Diffusion Models via Motion Feature Matching (18 Feb 2025)

    Yen-Siang Wu, Chi-Pin Huang, Fu-En Yang, et al.Yen-Siang Wu, Chi-Pin Huang, Fu-En Yang, Yu-Chiang Frank Wang
    Paper Code Project_Page

  • SST-EM: Advanced Metrics for Evaluating Semantic, Spatial and Temporal Aspects in Video Editing (13 Jan 2025)

    Varun Biyyala, Bharat Chanderprakash Kathuria, Jialu Li, et al.Varun Biyyala, Bharat Chanderprakash Kathuria, Jialu Li, and Youshan Zhang
    Paper code Project_Page

  • MOTIONCLONE: TRAINING-FREE MOTION CLONING FOR CONTROLLABLE VIDEO GENERATION (22 Oct 2024)

    Pengyang Ling, Jiazi Bu, Pan Zhang, et al.Pengyang Ling, Jiazi Bu, Pan Zhang, Xiaoyi Dong, Yuhang Zang, Tong Wu, Huaian Chen, Jiaqi Wang, Yi Jin
    Paper Code Project_Page

  • Video Diffusion Models are Training-free Motion Interpreter and Controller (12 Nov 2024)

    Zeqi Xiao, Yifan Zhou, Shuai Yang, et al.Zeqi Xiao, Yifan Zhou, Shuai Yang, Xingang Pan
    Paper Code Project_Page

  • OnlyFlow: Optical Flow based Motion Conditioning for Video Diffusion ModelsOnlyFlow: Optical Flow based Motion Conditioning for Video Diffusion Models(15 Nov 2024 )

    Mathis Koroglu, Hugo Caselles-DuprΓ©, Guillaume Jeanneret Sanmiguel, et al.Mathis Koroglu, Hugo Caselles-DuprΓ©, Guillaume Jeanneret Sanmiguel
    Paper code Project_Page

  • Customize-A-Video: One-Shot Motion Customization of Text-to-Video Diffusion Models(28 Aug 2024)

    Yixuan Ren, Yang Zhou, Jimei Yang, et al.Yixuan Ren, Yang Zhou, Jimei Yang, Jing Shi, Difan Liu, Feng Liu, Mingi Kwon, Abhinav Shrivastava
    Paper Code Project_Page

  • MotionDirector: Motion Customization for Text-to-Video Diffusion Models (12 Oct 2023)

    Rui Zhao, Yuchao Gu, Jay Zhangjie Wu, et al.Rui Zhao, Yuchao Gu, Jay Zhangjie Wu, David Junhao Zhang, Jia-Wei Liu, Weijia Wu, Jussi Keppo, and Mike Zheng Shou
    Paper Code Project_Page

  • VMC: Video Motion Customization with Pre-trained Diffusion Models (1 Dec 2023)

    Hyeonho Jeong, Geon Yeong Park, Jong Chul Ye, et al.Hyeonho Jeong, Geon Yeong Park, Jong Chul Ye
    Paper Code Project_Page

  • AnimateAnything (MomtionMask) (2023)

    Guojun Lei, Chi Wang, Hong Li, et al.Guojun Lei, Chi Wang, Hong Li, Rong Zhang, Yikai Wang, Weiwei Xu
    Paper Code Project_Page 219

  • MotionAgent: Fine-grained Controllable Video Generation via Motion Field Agent(5 Feb 2025)

    Xinyao Liao, Xianfang Zeng, Liao WangXinyao Liao, Xianfang Zeng, Liao Wang, Gang Yu, Guosheng Lin, Chi Zhang
    Paper code Project_Page

  • Motionbooth: Motion-aware customized text-to-video generation(29 Oct 2024)

    Jianzong Wu, Xiangtai Li, Yanhong Zeng, et al.Jianzong Wu, Xiangtai Li, Yanhong Zeng, Jiangning Zhang, Qianyu Zhou, Yining Li, Yunhai Tong, Kai Chen
    Paper Code

  • Motion Prompting: Controlling Video Generation with Motion Trajectories (27 Mar 2025)

    Daniel Geng, Charles Herrmann, Junhwa Hur, et al.Daniel Geng, Charles Herrmann, Junhwa Hur, Forrester Cole, Serena Zhang, Tobias Pfaff, Tatiana Lopez-Guevara, Carl Doersch, Yusuf Aytar, Michael Rubinstein, Chen Sun, Oliver Wang, Andrew Owens, Deqing Sun
    Paper Project_Page

  • Video Motion Transfer with Diffusion Transformers(27 Mar 2025)

    Alexander Pondaven, Aliaksandr Siarohin, Sergey Tulyakov, et al.Alexander Pondaven, Aliaksandr Siarohin, Sergey Tulyakov, Philip Torr, Fabio Pizzati
    Paper Code
    Project_Page

  • MOTION INVERSION FOR VIDEO CUSTOMIZATION1(16 Oct 2024)

    Luozhou Wang, Ziyang Mai, Guibao Shen, et al.Luozhou Wang, Ziyang Mai, Guibao Shen, Yixun Liang, Xin Tao, Pengfei Wan, Di Zhang, Yijun Li, Yingcong Chen
    Paper Code Project_Page

  • Space-Time Diffusion Features for Zero-Shot Text-Driven Motion Transfer (3 Dec 2023)

    Danah Yatim, Rafail Fridman, Omer Bar-Tal, et al.Danah Yatim, Rafail Fridman, Omer Bar-Tal, Yoni Kasten, Tali Dekel
    Paper Code Project_Page

  • Spectral Motion Alignment for Video Motion Transfer using Diffusion Models (19 Dec 2024)

    Alexander Pondaven, Aliaksandr Siarohin, Sergey Tulyakov, et al.Alexander Pondaven, Aliaksandr Siarohin, Sergey Tulyakov, Philip Torr, Fabio Pizzati
    Paper Code Project_Page

  • MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models (2 Dec 2024)

    Xiaomin Li, Xu Jia, Qinghe Wang, et al.Xiaomin Li, Xu Jia, Qinghe Wang
    Paper Project_Page

  • DreamMotion: Space-Time Self-Similar Score Distillation for Zero-Shot Video Editing (15 Jul 2024)

    Hyeonho Jeong, Jinho Chang, Geon Yeong Park, et al.Hyeonho Jeong, Jinho Chang, Geon Yeong Park, and Jong Chul Ye
    Paper code Project_Page

  • DreamRelation: Relation-Centric Video Customization(10 Mar 2025)

    Yujie Wei, Shiwei Zhang, Hangjie Yuan, et al.Yujie Wei, Shiwei Zhang, Hangjie Yuan, Biao Gong, Longxiang Tang, Xiang Wang, Haonan Qiu, Hengjia Li, Shuai Tan, Yingya Zhang, Hongming Shan
    Paper code Project_Page

  • Training-Free Motion-Guided Video Generation with Enhanced Temporal Consistency Using Motion Consistency Loss(13 Jan 2025οΌ‰

    Xinyu Zhang, Zicheng Duan, Dong Gong, et al.Xinyu Zhang, Zicheng Duan, Dong Gong, Lingqiao Liu
    Paper Code Project_Page

  • DreamVideo: Composing Your Dream Videos with Customized Subject and Motion(可δ»₯single motion vediosε’Œmultiple vedios) (7 Dec 2023οΌ‰

    Yujie Wei, Shiwei Zhang, Zhiwu QingYujie Wei, Shiwei Zhang, Zhiwu Qing, Hangjie Yuan, Zhiheng Liu, Yu Liu, Yingya Zhang, Jingren Zhou, Hongming Shan
    Paper code Project_Page

  • Perception-as-Control: Fine-grained Controllable Image Animation with 3D-aware Motion Representation (7 Dec 2023οΌ‰

    Yingjie Chen, Yifang Men, Yuan Yao, et al.Yingjie Chen, Yifang Men, Yuan Yao, Miaomiao Cui, Liefeng Bo
    Paper Code Project_Page

  • InterDyn: Controllable Interactive Dynamics with Video Diffusion Models (hand mask sequence as control signal) (4 Apr 2025οΌ‰

    Rick Akkerman, Haiwen Feng, Michael J. Black, et al.Rick Akkerman, Haiwen Feng, Michael J. Black, Dimitrios Tzionas, Victoria FernΒ΄andez Abrevaya
    Paper code Project_Page

  • LHM: Large Animatable Human Reconstruction Model for Single Image to 3D in Seconds(13 Mar 2025οΌ‰

    Lingteng Qiu, Xiaodong Gu, Peihao Li, et al.Lingteng Qiu, Xiaodong Gu, Peihao Li, Qi Zuo, Weichao Shen, Junfei Zhang, Kejie Qiu, Weihao Yuan, Guanying Chen, Zilong Dong, Liefeng Bo
    Paper Code Project_Page

  • MagicMotion: Controllable Video Generation with Dense-to-Sparse Trajectory Guidance (20 Mar 2025οΌ‰

    Quanhao Li, Zhen Xing, Rui Wang, et al.Quanhao Li, Zhen Xing, Rui Wang, Hui Zhang, Qi Dai, Zuxuan Wu
    Paper Code Project_Page

  • Diffusion as Shader: 3D-aware Video Diffusion for Versatile Video Generation Control (9 Jan 2025οΌ‰

    Zekai Gu, Rui Yan, Jiahao Lu, et al.Zekai Gu, Rui Yan, Jiahao Lu, Peng Li, Zhiyang Dou, Chenyang Si, Zhen Dong, Qifeng Liu, Cheng Lin, Ziwei Liu, Wenping Wang, Yuan Liu
    Paper Code Project_Page

  • Zero-Shot Controllable Image-to-Video Animation via Motion Decomposition

    Alexander Pondaven, Aliaksandr Siarohin, Sergey Tulyakov, et al.Alexander Pondaven, Aliaksandr Siarohin, Sergey Tulyakov, Philip Torr, Fabio Pizzati
    Code Project_Page

πŸ“ Advanced Text-Conditioned

πŸ”„ In-Context

πŸ–ΌοΈ Image-guided

  • Make It Move: Controllable Image-to-Video Generation With Text Descriptions (31 Mar 2022)

    [CVPR 2022] Yaosi Hu, Chong Luo, Zhenzhong Chen
    Paper citation Code

  • Prompt Image to Life: Training-Free Text-Driven Image-to-Video Generation (2023)

    Jinxiu Liu, Yuan Yao, Bingwen Zhu, et al.Fanyi Wang, Weijian Luo, Jingwen Su, Yanhao Zhang, Yuxiao Wang, Liyuan Ma, Qi Liu, Jiebo Luo, Guo-Jun Qi
    Paper citation

  • LaMD: Latent Motion Diffusion for Video Generation (23 Apr 2023)

    Yaosi Hu, Zhenzhong Chen, Chong Luo
    Paper citation

  • VideoDoodles: Hand-Drawn Animations on Videos with Scene-Aware Canvases (26 July 2023)

    [ACM Transactions on Graphics] Emilie Yu, Kevin Blackburn-Matzen, Cuong Nguyen, et al.Oliver Wang, Rubaiat Habib Kazi, Adrien Bousseau
    Paper citation

  • Synthesizing Videos from Images for Image-to-Video Adaptation (27 Oct 2023)

    [ACM MM 2023] Junbao Zhuo, Xingyu Zhao, Shuhui Wang, et al.Huimin Ma, Qingming Huang
    Paper citation Code

  • VideoCrafter1: Open Diffusion Models for High-Quality Video Generation (30 Oct 2023)

    Haoxin Chen, Menghan Xia, Yingqing He, et al.Yong Zhang, Xiaodong Cun, Shaoshu Yang, Jinbo Xing, Yaofang Liu, Qifeng Chen, Xintao Wang, Chao Weng, Ying Shan
    Paper citation Project_Page Code Demo

  • I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models (7 Nov 2023)

    Shiwei Zhang, Jiayu Wang, Yingya Zhang, et al.Kang Zhao, Hangjie Yuan, Zhiwu Qin, Xiang Wang, Deli Zhao, Jingren Zhou
    Paper citation Project_Page Code

  • Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets (25 Nov 2023)

    Andreas Blattmann, Tim Dockhorn, Sumith Kulal, et al.Daniel Mendelevitch, Maciej Kilian, Dominik Lorenz, Yam Levi, Zion English, Vikram Voleti, Adam Letts, Varun Jampani, Robin Rombach
    Paper citation Code

  • AnimateAnything: Fine-Grained Open Domain Image Animation with Motion Guidance (4 Dec 2023)

    [TMLR 2024] Zuozhuo Dai, Zhenghao Zhang, Yao Yao, et al.Bingxue Qiu, Siyu Zhu, Long Qin, Weizhi Wang
    Paper citation Project_Page Code

  • Decouple Content and Motion for Conditional Image-to-Video Generation (14 Dec 2023)

    [AAAI 2024] Cuifeng Shen, Yulu Gan, Chen Chen, et al.Xiongwei Zhu, Lele Cheng, Tingting Gao, Jinzhi Wang
    Paper citation

  • UniVG: Towards UNIfied-modal Video Generation (17 Jan 2024)

    Ludan Ruan, Lei Tian, Chuanwei Huang, et al.Xu Zhang, Xinyan Xiao
    Paper citation Project_Page

  • Motion-i2v: Consistent and controllable image-to-video generation with explicit motion modeling (31 Jan 2024)

    [ACM SIGGRAPH 2024] Xiaoyu Shi, Zhaoyang Huang, Fu-Yun Wang, et al.Weikang Bian, Dasong Li, Yi Zhang, Manyuan Zhang, Ka Chun Cheung, Simon See, Hongwei Qin, Jifeng Dai, Hongsheng Li
    Paper citation Project_Page

  • Tuning-Free Noise Rectification for High Fidelity Image-to-Video Generation (5 Mar 2024)

    Weijie Li, Litong Gong, Yiran Zhu, et al.Fanda Fan, Biao Wang, Tiezheng Ge, Bo Zheng
    Paper citation Project_Page Code

  • AtomoVideo: High Fidelity Image-to-Video Generation (5 Mar 2024)

    Litong Gong, Yiran Zhu, Weijie Li, et al.Xiaoyang Kang, Biao Wang, Tiezheng Ge, Bo Zheng
    Paper citation Project_Page

  • Follow-Your-Click: Open-domain Regional Image Animation via Short Prompts (13 Mar 2024)

    Yue Ma, Yingqing He, Hongfa Wang, et al.Andong Wang, Chenyang Qi, Chengfei Cai, Xiu Li, Zhifeng Li, Heung-Yeung Shum, Wei Liu, Qifeng Chen
    Paper citation Project_Page Code

  • TRIP: Temporal Residual Learning with Image Noise Prior for Image-to-Video Diffusion Models (25 Mar 2024)

    [CVPR 2024] Zhongwei Zhang, Fuchen Long, Yingwei Pan, et al.Zhaofan Qiu, Ting Yao, Yang Cao, Tao Mei
    Paper citation Project_Page

  • TI2V-Zero: Zero-Shot Image Conditioning for Text-to-Video Diffusion Models (25 Apr 2024)

    [CVPR 2024] Haomiao Ni, Bernhard Egger, Suhas Lohit, et al.Anoop Cherian, Ye Wang, Toshiaki Koike-Akino, Sharon X. Huang, Tim K. Marks
    Paper citation Project_Page Code

  • AID: Adapting Image2Video Diffusion Models for Instruction-guided Video Prediction (10 Jun 2024)

    Zhen Xing, Qi Dai, Zejia Weng, et al.Zuxuan Wu, Yu-Gang Jiang
    Paper citation Project_Page Code

  • OmniTokenizer: A Joint Image-Video Tokenizer for Visual Generation (13 Jun 2024)

    [NeurIPS 2024] Junke Wang, Yi Jiang, Zehuan Yuan, et al.Binyue Peng, Zuxuan Wu, Yu-Gang Jiang
    Paper citation Code

  • ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation (1 Jul 2024)

    [TMLR 2024] Weiming Ren, Huan Yang, Ge Zhang, et al.Cong Wei, Xinrun Du, Wenhao Huang, Wenhu Chen
    Paper citation Project_Page Code Demo

  • EasyAnimate: A High-Performance Long Video Generation Method based on Transformer Architecture (5 Jul 2024)

    Jiaqi Xu, Xinyi Zou, Kunzhe Huang, et al.Yunkuo Chen, Bo Liu, MengLi Cheng, Xing Shi, Jun Huang
    Paper citation Project_Page Code Demo

  • I2V-Adapter: A General Image-to-Video Adapter for Diffusion Models (13 July 2024)

    [ACM SIGGRAPH 2024] Xun Guo1, Mingwu Zheng, Liang Hou, et al.Yuan Gao, Yufan Deng, Pengfei Wan, Di Zhang, Yufan Liu, Weiming Hu, Zhengjun Zha, Haibin Huang, Chongyang Ma
    Paper citation

  • MoVideo: Motion-Aware Video Generation with Diffusion Model (29 Jul 2024)

    [ECCV 2024] Jingyun Liang, Yuchen Fan, Kai Zhang, et al.Radu Timofte, Luc Van Gool, Rakesh Ranjan
    Paper citation Project_Page

  • Emu Video: Factorizing Text-to-Video Generation by Explicit Image Conditioning (2 Aug 2024)

    [ECCV 2024] Rohit Girdhar, Mannat Singh, Andrew Brown, et al.Quentin Duval, Samaneh Azadi, Sai Saketh Rambhatla, Akbar Shah, Xi Yin, Devi Parikh, Ishan Misra
    Paper citation Project_Page Demo

  • DreamVideo: High-Fidelity Image-to-Video Generation with Image Retention and Text Guidance (16 Sep 2024)

    [ICASSP 2025] Cong Wang, Jiaxi Gu, Panwen Hu, et al.Songcen Xu, Hang Xu, Xiaodan Liang
    Paper citation Project_Page Code

  • Structure and Content-Guided Video Synthesis with Diffusion Models (27 Sep 2024)

    [ICCV 2023] Patrick Esser, Johnathan Chiu, Parmida Atighehchian, et al.Jonathan Granskog, Anastasis Germanidis
    Paper citation Project_Page

  • PhysGen: Rigid-Body Physics-Grounded Image-to-Video Generation (27 Sep 2024)

    [ECCV 2024] Shaowei Liu, Zhongzheng Ren, Saurabh Gupta, et al.Shenlong Wang
    Paper citation Project_Page Code

  • DynamiCrafter: Animating Open-Domain Images with Video Diffusion Priors (1 Oct 2024)

    [ECCV 2024] Jinbo Xing, Menghan Xia, Yong Zhang, et al.Haoxin Chen, Wangbo Yu, Hanyuan Liu, Gongye Liu, Xintao Wang, Ying Shan, Tien-Tsin Wong
    Paper citation Project_Page Code Demo

  • I4VGen: Image as Free Stepping Stone for Text-to-Video Generation (3 Oct 2024)

    Xiefan Guo, Jinlin Liu, Miaomiao Cui, et al.Liefeng Bo, Di Huang
    Paper citation Project_Page Code

  • FrameBridge: Improving Image-to-Video Generation with Bridge Models (20 Oct 2024)

    Yuji Wang, Zehua Chen, Xiaoyu Chen, et al.Jun Zhu, Jianfei Chen
    Paper citation Project_Page

  • Identifying and Solving Conditional Image Leakage in Image-to-Video Diffusion Model (6 Nov 2024)

    [NeurIPS 2024] Min Zhao, Hongzhou Zhu, Chendong Xiang, et al.Kaiwen Zheng, Chongxuan Li, Jun Zhu
    Paper citation Project_Page Code Demo

  • Lumiere: A Space-Time Diffusion Model for Video Generation (3 Dec 2024)

    [SIGGRAPH Asia 2024] Omer Bar-Tal, Hila Chefer, Omer Tov, et al.Charles Herrmann, Roni Paiss, Shiran Zada, Ariel Ephrat, Junhwa Hur, Guanghui Liu, Amit Raj, Yuanzhen Li, Michael Rubinstein, Tomer Michaeli, Oliver Wang, Deqing Sun, Tali Dekel, Inbar Mosseri
    Paper citation Project_Page

  • MotionStone: Decoupled Motion Intensity Modulation with Diffusion Transformer for Image-to-Video Generation (8 Dec 2024)

    Shuwei Shi, Biao Gong, Xi Chen, et al.Dandan Zheng, Shuai Tan, Zizheng Yang, Yuyuan Li, Jingwen He, Kecheng Zheng, Jingdong Chen, Ming Yang, Yinqiang Zheng
    Paper citation

  • STIV: Scalable Text and Image Conditioned Video Generation (10 Dec 2024)

    Zongyu Lin, Wei Liu, Chen Chen, et al.Jiasen Lu, Wenze Hu, Tsu-Jui Fu, Jesse Allardice, Zhengfeng Lai, Liangchen Song, Bowen Zhang, Cha Chen, Yiran Fei, Yifan Jiang, Lezhi Li, Yizhou Sun, Kai-Wei Chang, Yinfei Yang
    Paper citation

  • Through-The-Mask: Mask-based Motion Trajectories for Image-to-Video Generation (6 Jan 2025)

    [CVPR 2025] Guy Yariv, Yuval Kirstain, Amit Zohar, et al.Shelly Sheynin, Yaniv Taigman, Yossi Adi, Sagie Benaim, Adam Polyak
    Paper citation Project_Page

  • Autoregressive Video Generation without Vector Quantization (9 Jan 2025)

    [ICLR 2025] Haoge Deng, Ting Pan, Haiwen Diao, et al.Zhengxiong Luo, Yufeng Cui, Huchuan Lu, Shiguang Shan, Yonggang Qi, Xinlong Wang
    Paper citation Code Demo

  • Generative Inbetweening: Adapting Image-to-Video Models for Keyframe Interpolation (12 Feb 2025)

    [ICLR 2025] Xiaojuan Wang, Boyang Zhou, Brian Curless, et al.Ira Kemelmacher-Shlizerman, Aleksander Holynski, Steven M. Seitz
    Paper citation Project_Page Code Demo

  • Adapting Image-to-Video Diffusion Models for Large-Motion Frame Interpolation (17 Feb 2025)

    Luoxu Jin, Hiroshi Watanabe
    Paper citation

  • Extrapolating and Decoupling Image-to-Video Generation Models: Motion Modeling is Easier Than You Think (2 Mar 2025)

    [CVPR 2025] Jie Tian, Xiaoye Qu, Zhenyi Lu, et al.Wei Wei, Sichen Liu, Yu Cheng
    Paper citation Code

  • HunyuanVideo: A Systematic Framework For Large Video Generative Models (11 Mar 2025)

    Weijie Kong, Qi Tian, Zijian Zhang, et al.Rox Min, Zuozhuo Dai, Jin Zhou, Jiangfeng Xiong, Xin Li, Bo Wu, Jianwei Zhang, Kathrina Wu, Qin Lin, Junkun Yuan, Yanxin Long, Aladdin Wang, Andong Wang, Changlin Li, Duojun Huang, Fang Yang, Hao Tan, Hongmei Wang, Jacob Song, Jiawang Bai, Jianbing Wu, Jinbao Xue, Joey Wang, Kai Wang, Mengyang Liu, Pengyu Li, Shuai Li, Weiyan Wang, Wenqing Yu, Xinchi Deng, Yang Li, Yi Chen, Yutao Cui, Yuanbo Peng, Zhentao Yu, Zhiyu He, Zhiyong Xu, Zixiang Zhou, Zunnan Xu, Yangyu Tao, Qinglin Lu, Songtao Liu, Dax Zhou, Hongfa Wang, Yong Yang, Di Wang, Yuhong Liu, Jie Jiang, Caesar Zhong
    Paper citation Project_Page Code

πŸ”Š Sound-Guided

  • (ECCV 22) Sound-Guided Semantic Video Generation (20 Apr 2022)

    Seung Hyun Lee, Gyeongrok Oh, Wonmin Byeon, et al. Seung Hyun Lee, Gyeongrok Oh, Wonmin Byeon, Chanyoung Kim, Won Jeong Ryoo, Sang Ho Yoon, Hyunjun Cho, Jihyun Bae, Jinkyu Kim, Sangpil Kim
    Paper Code

  • (ECCV 20) Sound2Sight: Generating Visual Dynamics from Sound and Context (23 Jul 2020)

    Anoop Cherian, Moitreya Chatterjee, Narendra Ahuja Anoop Cherian, Moitreya Chatterjee, Narendra Ahuja
    Paper Code

🎡 Audio/Music-Guided

  • AV-Link: Temporally-Aligned Diffusion Features for Cross-Modal Audio-Video Generation (19 Dec 2024)

    Moayed Haji-Ali, Willi Menapace, Aliaksandr Siarohin, et al. Moayed Haji-Ali, Willi Menapace, Aliaksandr Siarohin, Ivan Skorokhodov, Alper Canberk, Kwot Sin Lee, Vicente Ordonez, Sergey Tulyakov
    Paper Code Project

  • (AAAI 24) Diverse and Aligned Audio-to-Video Generation via Text-to-Video Model Adaptation (28 Sep 2023)

    Guy Yariv, Itai Gat, Sagie Benaim, et al. Guy Yariv, Itai Gat, Sagie Benaim, Lior Wolf, Idan Schwartz, Yossi Adi
    Paper Code Project

  • (ECCV 24) MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model (30 May 2024)

    Muyao Niu, Xiaodong Cun, Xintao Wang, et al. Muyao Niu, Xiaodong Cun, Xintao Wang, Yong Zhang, Ying Shan, Yinqiang Zheng
    Paper Code

  • (TMM) Ta2v: Text-audio guided video generation (01 Jan 2024)

    Minglu Zhao, Wenmin Wang, Tongbao Chen, et al. Minglu Zhao, Wenmin Wang, Tongbao Chen, Rui Zhang, Ruochen Li
    Paper Code

  • (ECCV 24) Audio-Synchronized Visual Animation (08 Mar 2024)

    Lin Zhang, Shentong Mo, Yijing Zhang, et al. Lin Zhang, Shentong Mo, Yijing Zhang, Pedro Morgado
    Paper Code Project

  • (ECCV 24) MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model (30 May 2024)

    Muyao Niu, Xiaodong Cun, Xintao Wang, et al. Muyao Niu, Xiaodong Cun, Xintao Wang, Yong Zhang, Ying Shan, Yinqiang Zheng
    Paper Code Project

πŸ—‚οΈ Layout Control

  • Multi-object Video Generation from Single Frame Layouts (06 May 2023)

    Yang Wu, Zhibin Liu, Hefeng Wu, et al. Yang Wu, Zhibin Liu, Hefeng Wu, Liang Lin
    Paper

  • (ICLR 24) LLM-grounded Video Diffusion Models (29 Sep 2023)

    Long Lian, Baifeng Shi, Adam Yala, et al. Long Lian, Baifeng Shi, Adam Yala, Trevor Darrell, Boyi Li
    Paper Code Project

  • DriveDreamer: Towards Real-world-driven World Models for Autonomous Driving (18 Sep 2023)

    Xiaofeng Wang, Zheng Zhu, Guan Huang, et al. Xiaofeng Wang, Zheng Zhu, Guan Huang, Xinze Chen, Jiagang Zhu, Jiwen Lu
    Paper Code Project

  • DrivingDiffusion: Layout-Guided multi-view driving scene video generation with latent diffusion model (11 Oct 2023)

    Xiaofan Li, Yifu Zhang, Xiaoqing Ye Xiaofan Li, Yifu Zhang, Xiaoqing Ye
    Paper Code Project

  • FlowZero: Zero-Shot Text-to-Video Synthesis with LLM-Driven Dynamic Scene Syntax (27 Nov 2023)

    Yu Lu, Linchao Zhu, Hehe Fan, et al. Yu Lu, Linchao Zhu, Hehe Fan, Yi Yang
    Paper Code Project

  • Panacea: Panoramic and Controllable Video Generation for Autonomous Driving (28 Nov 2023)

    Yuqing Wen, Yucheng Zhao, Yingfei Liu, et al. Yuqing Wen, Yucheng Zhao, Yingfei Liu, Fan Jia, Yanhui Wang, Chong Luo, Chi Zhang, Tiancai Wang, Xiaoyan Sun, Xiangyu Zhang
    Paper Code Project

  • TrackDiffusion: Tracklet-Conditioned Video Generation via Diffusion Models (01 Dec 2023)

    Pengxiang Li, Kai Chen, Zhili Liu, et al. Pengxiang Li, Kai Chen, Zhili Liu, Ruiyuan Gao, Lanqing Hong, Guo Zhou, Hua Yao, Dit-Yan Yeung, Huchuan Lu, Xu Jia
    Paper Code Project

  • Unleashing Generalization of End-to-End Autonomous Driving with Controllable Long Video Generation (03 Jun 2024)

    Enhui Ma, Lijun Zhou, Tao Tang, et al. Enhui Ma, Lijun Zhou, Tao Tang, Zhan Zhang, Dong Han, Junpeng Jiang, Kun Zhan, Peng Jia, Xianpeng Lang, Haiyang Sun, Di Lin, Kaicheng Yu
    Paper Code Project

  • DiVE: DiT-based Video Generation with Enhanced Control (03 Sep 2024)

    Junpeng Jiang, Gangyi Hong, Lijun Zhou, et al. Junpeng Jiang, Gangyi Hong, Lijun Zhou, Enhui Ma, Hengtong Hu, Xia Zhou, Jie Xiang, Fan Liu, Kaicheng Yu, Haiyang Sun, Kun Zhan, Peng Jia, Miao Zhang
    Paper Code Project

  • DreamForge: Motion-Aware Autoregressive Video Generation for Multi-View Driving Scenes (06 Sep 2024)

    Jianbiao Mei, Tao Hu, Xuemeng Yang, et al. Jianbiao Mei, Tao Hu, Xuemeng Yang, Licheng Wen, Yu Yang, Tiantian Wei, Yukai Ma, Min Dou, Botian Shi, Yong Liu
    Paper Code Project

  • DriveScape: Towards High-Resolution Controllable Multi-View Driving Video Generation (09 Sep 2024)

    Wei Wu, Xi Guo, Weixuan Tang, et al. Wei Wu, Xi Guo, Weixuan Tang, Tingxuan Huang, Chiyu Wang, Dongyue Chen, Chenjing Ding
    Paper Project

  • HoloDrive: Holistic 2D-3D Multi-Modal Street Scene Generation for Autonomous Driving (02 Dec 2024)

    Zehuan Wu, Jingcheng Ni, Xiaodong Wang, et al. Zehuan Wu, Jingcheng Ni, Xiaodong Wang, Yuxin Guo, Rui Chen, Lewei Lu, Jifeng Dai, Yuwen Xiong
    Paper

✏️ Sketch Control

  • Sketching the Future (STF): Applying Conditional Control Techniques to Text-to-Video Models (10 May 2023)

    Rohan Dhesikan, Vignesh Rajmohan
    Paper citation Project_Page Code Demo

  • SparseCtrl: Adding Sparse Controls to Text-to-Video Diffusion Models (28 Nov 2023)

    Yuwei Guo, Ceyuan Yang, Anyi Rao, et al. Maneesh Agrawala, Dahua Lin, Bo Dai
    Paper citation Project_Page Code

  • EasyControl: Transfer ControlNet to Video Diffusion for Controllable Generation and Interpolation (16 Sep 2024)

    Cong Wang, Jiaxi Gu, Panwen Hu, et al. Haoyu Zhao, Yuanfan Guo, Jianhua Han, Hang Xu, Xiaodan Liang
    Paper citation

  • VidSketch: Hand-drawn Sketch-Driven Video Generation with Diffusion Control (17 Feb 2025)

    Lifan Jiang, Shuang Chen, Boxi Wu, et al. Xiaotong Guan, Jiahui Zhang
    Paper citation Project_Page Code

  • A Recipe for Scaling up Text-to-Video Generation with Text-free Videos (25 Dec 2023)

    [CVPR 2024] Xiang Wang, Shiwei Zhang, Hangjie Yuan, et al. Zhiwu Qing, Biao Gong, Yingya Zhang, Yujun Shen, Changxin Gao, Nong Sang
    Paper citation Project_Page Code

  • Make Pixels Dance: High-Dynamic Video Generation (18 Nov 2023)

    [CVPR 2024] Yan Zeng, Guoqiang Wei, Jiani Zheng, et al. Jiaxin Zou, Yang Wei, Yuchen Zhang, Hang Li
    Paper citation Project_Page Demo

  • LVCD: Reference-based Lineart Video Colorization with Diffusion Models (19 Sep 2024)

    [ACM TOG and SIGGRAPH Asia 2024] Zhitong Huang, Mohan Zhang, Jing Liao
    Paper citation Project_Page Code

  • MotionClone: Training-Free Motion Cloning for Controllable Video Generation (22 Oct 2024)

    Pengyang Ling, Jiazi Bu, Pan Zhang, et al. Xiaoyi Dong, Yuhang Zang, Tong Wu, Huaian Chen, Jiaqi Wang, Yi Jin
    Paper citation Project_Page Code

  • VideoLCM: Video Latent Consistency Model (14 Dec 2023)

    Xiang Wang, Shiwei Zhang, Han Zhang, et al. Yu Liu, Yingya Zhang, Changxin Gao, Nong Sang
    Paper citation

  • Open-Sora Plan: Open-Source Large Video Generation Model (28 Nov 2024)

    Bin Lin, Yunyang Ge, Xinhua Cheng, et al. Zongjian Li, Bin Zhu, Shaodong Wang, Xianyi He, Yang Ye, Shenghai Yuan, Liuhan Chen, Tanghui Jia, Junwu Zhang, Zhenyu Tang, Yatian Pang, Bin She, Cen Yan, Zhiheng Hu, Xiaoyi Dong, Lin Chen, Zhang Pan, Xing Zhou, Shaoling Dong, Yonghong Tian, Li Yuan
    Paper citation Code

  • CameraCtrl: Enabling Camera Control for Text-to-Video Generation (13 Mar 2025)

    [ICLR 2025] Hao He, Yinghao Xu, Yuwei Guo, et al. Gordon Wetzstein, Bo Dai, Hongsheng Li, Ceyuan Yang
    Paper citation Project_Page Code Demo

  • ToonCrafter: Generative Cartoon Interpolation (19 Nov 2024)

    [ACM TOG] Jinbo Xing, Hanyuan Liu, Menghan Xia, et al. Yong Zhang, Xintao Wang, Ying Shan, Tien-Tsin Wong
    Paper citation Project_Page Code Demo

  • MagicStick: Controllable Video Editing via Control Handle Transformations (18 Nov 2024)

    [WACV 2025] Yue Ma, Xiaodong Cun, Sen Liang, et al. Jinbo Xing, Yingqing He, Chenyang Qi, Siran Chen, Qifeng Chen
    Paper citation Project_Page Code

  • AniDoc: Animation Creation Made Easier (30 Jan 2025)

    [CVPR 2025] Yihao Meng, Hao Ouyang, Hanlin Wang, et al. Qiuyu Wang, Wen Wang, Ka Leong Cheng, Zhiheng Liu, Yujun Shen, Huamin Qu
    Paper citation Project_Page Code

  • TaleCrafter: Interactive Story Visualization with Multiple Characters (30 May 2023)

    [SIGGRAPH Asia 2023] Yuan Gong, Youxin Pang, Xiaodong Cun, et al. Menghan Xia, Yingqing He, Haoxin Chen, Longyue Wang, Yong Zhang, Xintao Wang, Ying Shan, Yujiu Yang
    Paper citation Project_Page Code

  • Ctrl-Adapter: An Efficient and Versatile Framework for Adapting Diverse Controls to Any Diffusion Model (24 May 2024)

    [ICLR 2025] Han Lin, Jaemin Cho, Abhay Zala, et al. Mohit Bansal
    Paper citation Project_Page Code

🀲 Language-Gesture Controlled

πŸ”Έ Multi Control/I2V

πŸ–ΌοΈ + πŸ›€οΈ Image + Traj

  • Boximator: Generating Rich and Controllable Motions for Video Synthesis(2 Feb 2024οΌ‰

    Jiawei Wang, Yuchen Zhang, Jiaxin Zou, et al.Yan Zeng, Guoqiang Wei, Liping Yuan, Hang Li
    Paper Project_Page

  • Motion-I2V: Consistent and Controllable Image-to-Video Generation with Explicit Motion Modeling (31 Jan 2024οΌ‰

    Xiaoyu Shi, Zhaoyang Huang, Fu-Yun Wang, et al.Weikang Bian, Dasong Li, Yi Zhang, Manyuan Zhang, Ka Chun Cheung, Simon See, Hongwei Qin, Jifeng Dai, Hongsheng Li
    Paper Code Project_Page

  • DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory (16 Aug 2023οΌ‰

    Shengming Yin, Chenfei Wu, Jian Liang, et al.Jie Shi, Houqiang Li, Gong Ming, Nan Duan
    Paper Code Project_Page

  • [MCDiff] Motion-Conditioned Diffusion Model for Controllable Video Synthesis(27 Apr 2023οΌ‰

    Haitao Zhou, Chuang Wang, Rui Nie, et al.Jinlin Liu, Dongdong Yu, Qian Yu, Changhu Wang
    Paper Project_Page

  • SG-I2V: Self-Guided Trajectory Control in Image-to-Video Generation (25 Feb 2025οΌ‰

    Koichi Namekata, Sherwin Bahmani, Ziyi Wu, et al.Yash Kant, Igor Gilitschenski, David B. Lindell
    Paper Code Project_Page

  • Draganything: Motion control for anything using entity representation (15 Mar 2024οΌ‰

    Weijia Wu, Zhuang Li, Yuchao Gu, et al.Rui Zhao, Yefei He, David Junhao Zhang, Mike Zheng Shou, Yan Li, Tingting Gao, Di Zhang
    Paper Code Project_Page

  • TrackGo: A Flexible and Efficient Method for Controllable Video Generation (5 Jan 2025οΌ‰

    Haitao Zhou, Chuang Wang, Rui Nie, et al.Jinlin Liu, Dongdong Yu, Qian Yu, Changhu Wang
    Paper Project_Page

  • Motion Prompting: Controlling Video Generation with Motion Trajectories (03 Dec 2024οΌ‰

    [CVPR 2025 (Oral)] Daniel Geng, Charles Herrmann, Junhwa Hur, et al.Forrester Cole, Serena Zhang, Tobias Pfaff, Tatiana Lopez-Guevara, Carl Doersch, Yusuf Aytar, Michael Rubinstein, Chen Sun, Oliver Wang, Andrew Owens, Deqing Sun
    Paper Code Project_Page

  • InTraGen: Trajectory-controlled Video Generation for Object Interactions (25 Nov 2024οΌ‰

    Zuhao Liu, Aleksandar Yanev, Ahmad Mahmood, et al.Ivan Nikolov, Saman Motamed, Wei-Shi Zheng, Xi Wang, Luc Van Gool, Danda Pani Paudel
    Paper Code Project_Page

  • ReVideo: Remake a Video with Motion and Content(22 May 2024οΌ‰

    Zuhao Liu, Aleksandar Yanev, Ahmad Mahmood, et al.Ivan Nikolov, Saman Motamed, Wei-Shi Zheng, Xi Wang, Luc Van Gool, Danda Pani Paudel
    Paper Code Project_Page

  • LeviTor: 3D Trajectory Oriented Image-to-Video Synthesis(28 Mar 2025οΌ‰

    Hanlin Wang, Hao Ouyang, Qiuyu Wang, et al.Wen Wang, Ka Leong Cheng, Qifeng Chen, Yujun Shen, Limin Wang
    Paper Code Project_Page

  • ObjCtrl-2.5D: Training-free Object Control with Camera Poses (10 Dec 2024οΌ‰

    Zhouxia Wang, Yushi Lan, Shangchen Zhou, Chen Change Loy, et al.
    Paper Code Project_Page

  • C-Drag: Chain-of-Thought Driven Motion Controller for Video Generation (27 Feb 2025οΌ‰

    Yuhao Li, Mirana Claire Angel, Salman Khan, et al.Yu Zhu, Jinqiu Sun, Yanning Zhang, Fahad Shahbaz Khan
    Paper Code

  • DragEntity: Trajectory Guided Video Generation using Entity and Positional Relationships(14 Oct 2024οΌ‰

    Zhang Wan, Sheng Tang, Jiawei Wei
    Paper code Project_Page

  • OmniDrag: Enabling Motion Control for Omnidirectional Image-to-Video Generation (12 Dec 2024οΌ‰

    Weiqi Li, Shijie Zhao, Chong Mou, et al.Xuhan Sheng, Zhenyu Zhang, Qian Wang, Junlin Li, Li Zhang, Jian Zhang
    Paper Code Project_Page

  • MotionBridge: Dynamic Video Inbetweening with Flexible Controls (7 Jan 2025οΌ‰

    Maham Tanveer, Yang Zhou, Simon Niklaus, et al.Ali Mahdavi Amiri, Hao Zhang, Krishna Kumar Singh, Nanxuan Zhao
    Paper Code Project_Page

  • Video Diffusion Models are Training-free Motion Interpreter and Controller (19 Apr 2024οΌ‰

    Zeqi Xiao, Yifan Zhou, Shuai Yang, Xingang Pan, et al.
    Paper Code Project_Page

  • Tora: Trajectory-oriented Diffusion Transformer for Video Generation (14 Mar 2025οΌ‰

    Zhenghao Zhang, Junchao Liao, Menghao Li, et al.ZuoZhuo Dai, Bingxue Qiu, Siyu Zhu, Long Qin, Weizhi Wang
    Paper Code Project_Page

  • MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model(11 Jul 2024οΌ‰

    Muyao Niu, Xiaodong Cun, Xintao Wang, et al.Yong Zhang, Ying Shan, Yinqiang Zheng
    Paper Code Project_Page

  • IMAGE CONDUCTOR: PRECISION CONTROL FOR INTERACTIVE VIDEO SYNTHESIS (21 Jun 2024οΌ‰

    Yaowei Li, Xintao Wang, Zhaoyang Zhang, et al.Zhouxia Wang, Ziyang Yuan, Liangbin Xie, Yuexian Zou, Ying Shan
    Paper Code Project_Page

  • Perception-as-Control: Fine-grained Controllable Image Animation with 3D-aware Motion Representation(10 Mar 2025οΌ‰

    Yingjie Chen, Yifang Men, Yuan Yao, et al.Miaomiao Cui, Liefeng Bo
    Paper Code Project_Page

  • I2VControl: Disentangled and Unified Video Motion Synthesis Control

    Wanquan Feng, Tianhao Qi, Jiawei Liu, et al.Mingzhen Sun, Pengqi Tu, Tianxiang Ma, Fei Dai, Songtao Zhao, Siyu Zhou, Qian He
    Paper Project_Page

  • VidCRAFT3: Camera, Object, and Lighting Control for Image-to-Video Generation(2 Apr 2025οΌ‰

    Sixiao Zheng, Zimian Peng, Yanpeng Zhou, et al.Yi Zhu, Hang Xu, Xiangru Huang, Yanwei Fu
    Paper Code Project_Page

πŸ–ΌοΈ + πŸ“Έ Image + Camera

  • RealCam-I2V: Real-World Image-to-Video Generation with Interactive Complex Camera Control(14 Feb 2025οΌ‰

    Teng Li, Guangcong Zheng, Rui Jiang, et al.Shuigenzhan, Tao Wu, Yehao Lu, Yining Lin, Xi Li
    Paper Code Project_Page

  • Motion Prompting: Controlling Video Generation with Motion Trajectories (frame+track+text)(03 Dec 2024 οΌ‰

    Daniel Geng, Charles Herrmann, Junhwa Hur, et al.Forrester Cole, Serena Zhang, Tobias Pfaff, Tatiana Lopez-Guevara, Carl Doersch, Yusuf Aytar, Michael Rubinstein, Chen Sun, Oliver Wang, Andrew Owens, Deqing Sun
    Paper code Project_Page

  • Video Diffusion Models are Training-free Motion Interpreter and Controller(12 Nov 2024οΌ‰

    Zeqi Xiao, Yifan Zhou, Shuai Yang, Xingang Pan, et al.
    Paper Code Project_Page

  • CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation( 4 Jun 2024οΌ‰

    Dejia Xu, Weili Nie, Chao Liu, et al.Sifei Liu, Jan Kautz, Zhangyang Wang, Arash Vahdat
    Paper code Project_Page

  • CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models(13 Mar 2025οΌ‰

    Hao He, Ceyuan Yang, Shanchuan Lin, et al.Yinghao Xu, Meng Wei, Liangke Gui, Qi Zhao, Gordon Wetzstein, Lu Jiang, Hongsheng Li
    Paper code Project_Page

  • CameraCtrl: Enabling Camera Control for Text-to-Video Generation(13 Mar 2025οΌ‰

    Hao He, Yinghao Xu, Yuwei Guo, et al.Gordon Wetzstein, Bo Dai, Hongsheng Li, Ceyuan Yang
    Paper Code Project_Page

  • Optical Flow Meets Video Diffusion Model for Enhanced Camera-Controlled Video Synthesis(25 Mar 2025οΌ‰

    Wonjoon Jin, Qi Dai, Chong Luo, et al.Seung-Hwan Baek, Sunghyun Cho, POSTECH, Microsoft Research Asia
    Paper Code Project_Page

  • CamI2V: Camera-Controlled Image-to-Video Diffusion Model ( 4 Dec 2024οΌ‰

    Guangcong Zheng, Teng Li, Rui Jiang, et al.Yehao Lu, Tao Wu, Xi Li
    Paper Code Project_Page

  • Training-free Camera Control for Video Generation(25 Feb 2025οΌ‰

    Chen Hou, Zhibo Chen, et al.
    Paper Code Project_Page

  • Trajectory Attention: Enhancing Video Generation with Fine-Grained Motion Control (28 Nov 2024οΌ‰

    Zeqi Xiao, Wenqi Ouyang, Yifan Zhou, et al.Shuai Yang, Lei Yang, Jianlou Si, Xingang Pan
    Paper Code Project_Page

  • DimensionX: Create Any 3D and 4D Scenes from a Single Image with Controllable Video Diffusion (7 Nov 2024οΌ‰

    Wenqiang Sun, Shuo Chen, Fangfu Liu, et al.Zilong Chen, Yueqi Duan, Jun Zhang, Yikai Wang
    Paper Code Project_Page

  • I2V3D: Controllable Image-to-Video Generation with 3D Guidance (12 Mar 2025οΌ‰

    Zhiyuan Zhang, Dongdong Chen, Jing Liao
    Paper Project_Page

  • Perception-as-Control: Fine-grained Controllable Image Animation with 3D-aware Motion Representation(10 Mar 2025οΌ‰

    Yingjie Chen, Yifang Men, Yuan Yao, et al.Miaomiao Cui, Liefeng Bo
    Paper Code Project_Page

  • I2VControl: Disentangled and Unified Video Motion Synthesis Control

    Zhiyuan Zhang, Dongdong Chen, Jing Liao
    Paper Project_Page

  • VidCRAFT3: Camera, Object, and Lighting Control for Image-to-Video Generation(2 Apr 2025οΌ‰

    Sixiao Zheng, Zimian Peng, Yanpeng Zhou, et al.Yi Zhu, Hang Xu, Xiangru Huang, Yanwei Fu
    Paper code Project_Page

  • I2VCONTROL-CAMERA: Precise Video Camera Control with Adjustable Motion Strength (28 Feb 2025οΌ‰

    Wanquan Feng, Jiawei Liu, Pengqi Tu, et al.Tianhao Qi, Mingzhen Sun, Tianxiang Ma, Songtao Zhao, Siyu Zhou, Qian He
    Paper code Project_Page

  • EgoSim: Egocentric Exploration in Virtual Worlds with Multi-modal Conditioning

    Wei Yu, Songheng Yin, Steve Easterbrook, Animesh Garg, et al.
    code Project_Page

  • GEN3C: 3D-Informed World-Consistent Video Generation with Precise Camera Control(5 Mar 2025οΌ‰

    Xuanchi Ren, Tianchang Shen, Jiahui Huang, et al.Huan Ling, Yifan Lu, Merlin Nimier-David, Thomas MΓΌller, Alexander Keller, Sanja Fidler, Jun Gao
    Paper Code Project_Page

πŸ›€οΈ + πŸ“Έ Traj + Camera

  • MotionCtrl(16 Jul 2024οΌ‰ (no specific date provided)
    Zhouxia Wang, Ziyang Yuan, Xintao Wang, et al.Zhouxia Wang, Ziyang Yuan, Xintao Wang, Tianshui Chen, Menghan Xia, Ping Luo, Ying Shan
    Paper Project Page
    Code
  • Perception-as-Control: Fine-grained Controllable Image Animation with 3D-aware Motion Representation (no specific date provided)
    Yingjie Chen, Yifang Men, Yuan Yao, et al.Yingjie Chen, Yifang Men, Yuan Yao, Miaomiao Cui, Liefeng Bo
    Paper Project Page code
  • VidCRAFT3: Camera, Object, and Lighting Control for Image-to-Video Generation (no specific date provided)
    Sixiao Zheng, Zimian Peng, Yanpeng Zhou, et al.Sixiao Zheng, Zimian Peng, Yanpeng Zhou, Yi Zhu, Hang Xu, Xiangru Huang, Yanwei Fu
    Paper Project_Page

πŸ–ΌοΈ + πŸ”Š Image + Audio

  • A Lip Sync Expert Is All You Need for Speech to Lip Generation In The Wild (23 Aug 2020)

    [ACM MM 2020] K R Prajwal, Rudrabha Mukhopadhyay, Vinay Namboodiri, et al. C V Jawahar

    Paper citation Code

  • MakeItTalk: Speaker-Aware Talking-Head Animation (25 Feb 2021)

    [SIGGRAPH Asia 2020] Yang Zhou, Xintong Han, Eli Shechtman, et al. Jose Echevarria, Evangelos Kalogerakis, Dingzeyu Li
    Paper citation Code

  • Sadtalker: Learning Realistic 3D Motion Coefficients for Stylized Audio-Driven Single Image Talking Face Animation (22 Nov 2022)

    [CVPR 2023] Wenxuan Zhang, Xiaodong Cun, Xuan Wang, et al. Yong Zhang, Xi Shen, Yu Guo, Ying Shan, Fei Wang

    Paper citation Project_Page Code Demo

  • VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior (7 Dec 2023)

    Xusen Sun, Longhao Zhang, Hao Zhu, et al.Peng Zhang, Bang Zhang, Xinya Ji, Kangneng Zhou, Daiheng Gao, Liefeng Bo, Xun Cao

    Paper citation Project_Page Code

  • EMO: Emote Portrait Alive - Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions (27 Feb 2024)

    [ECCV 2024] Linrui Tian, Qi Wang, Bang Zhang, et al. Liefeng Bo

    Paper citation Code

  • AniPortrait: Audio-Driven Synthesis of Photorealistic Portrait Animation (26 Mar 2024)

    Huawei Wei, Zejun Yang, Zhisheng Wang
    Paper citation Code Demo

  • EDTalk: Efficient Disentanglement for Emotional Talking Head Synthesis (2 Apr 2024)

    Shuai Tan, Bin Ji, Mengxiao Bi, et al. Ye Pan
    Paper citation Project_Page Code

  • SyncTalk: The Devil is in the Synchronization for Talking Head Synthesis (28 Apr 2024)

    [CVPR 2024] Ziqiao Peng, Wentao Hu, Yue Shi, et al.Xiangyu Zhu, Xiaomei Zhang, Hao Zhao, Jun He, Hongyan Liu, Zhaoxin Fan
    Paper citation Project_Page Code

  • InstructAvatar: Text-Guided Emotion and Motion Control for Avatar Generation (24 May 2024)

    Yuchi Wang, Junliang Guo, Jianhong Bai, et al. Runyi Yu, Tianyu He, Xu Tan, Xu Sun, Jiang Bian
    Paper citation Project_Page

  • V-Express: Conditional Dropout for Progressive Training of Portrait Video Generation (4 Jun 2024)

    Cong Wang, Kuan Tian, Jun Zhang, et al. Yonghang Guan, Feng Luo, Fei Shen, Zhiwei Jiang, Qing Gu, Xiao Han, Wei Yang
    Paper citation Project_Page Code

  • Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation (16 Jun 2024)

    Mingwang Xu, Hui Li, Qingkun Su, et al.Hanlin Shang, Liwei Zhang, Ce Liu, Jingdong Wang, Yao Yao, Siyu Zhu
    Paper citation Project_Page Code Demo

  • EchoMimic: Lifelike Audio-Driven Portrait Animations through Editable Landmark Conditions (12 Jul 2024)

    [AAAI 2025] Zhiyuan Chen, Jiajiong Cao, Zhiquan Chen, et al. Yuming Li, Chenguang Ma
    Paper citation Project_Page Code Demo

  • Dreamtalk: When Expressive Talking Head Generation Meets Diffusion Probabilistic Models (10 Aug 2024)

    Yifeng Ma, Shiwei Zhang, Jiayu Wang, et al.Xiang Wang, Yingya Zhang, Zhidong Deng

    Paper citation Project_Page Code

  • MotionCraft: Crafting Whole-Body Motion with Plug-and-Play Multimodal Controls (25 Aug 2024)

    Yuxuan Bian, Ailing Zeng, Xuan Ju, et al.Xian Liu, Zhaoyang Zhang, Wei Liu, Qiang Xu

    Paper citation Project_Page Code

  • MegActor-Ξ£: Unlocking Flexible Mixed-Modal Control in Portrait Animation with Diffusion Transformer (27 Aug 2024)

    [AAAI 2025] Shurong Yang, Huadong Li, Juhao Wu, et al. Minhao Jing, Linze Li, Renhe Ji, Jiajun Liang, Haoqiang Fan, Jin Wang
    Paper citation Project_Page Code Demo

  • VASA-1: Lifelike Audio-Driven Talking Faces Generated in Real Time (31 Oct 2024)

    [NeurIPS 2024] Sicheng Xu, Guojun Chen, Yu-Xiao Guo, et al. Jiaolong Yang, Chong Li, Zhenyu Zang, Yizhong Zhang, Xin Tong, Baining Guo

    Paper citation Project_Page

  • EchoMimicV2: Towards Striking, Simplified, and Semi-Body Human Animation (15 Nov 2024)

    [CVPR 2025] Rang Meng, Xingyu Zhang, Yuming Li, et al. Chenguang Ma
    Paper citation Project_Page Code

  • SVP: Style-Enhanced Vivid Portrait Talking Head Diffusion Model (28 Nov 2024)

    Weipeng Tan, Chuming Lin, Chengming Xu, et al. Xiaozhong Ji, Junwei Zhu, Chengjie Wang, Yunsheng Wu, Yanwei Fu
    Paper citation Project_Page

  • Float: Generative Motion Latent Flow Matching for Audio-driven Talking Portrait(4 Dec 2024)

    Taekyung Ki, Dongchan Min, Gyeongsu Chae
    Paper citation Project_Page Code

  • CyberHost: A One-stage Diffusion Framework for Audio-driven Talking Body Generation (23 Jan 2025)

    [ICLR 2025] Gaojie Lin, Jianwen Jiang, Chao Liang, et al. Tianyun Zhong, Jiaqi Yang, Yanbo Zheng

    Paper Project_Page

  • OmniHuman-1: Rethinking the Scaling-Up of One-Stage Conditioned Human Animation Models (13 Feb 2025)

    Gaojie Lin, Jianwen Jiang, Jiaqi Yang, et al. Zerong Zheng, Chao Liang

    Paper citation Project_Page

  • Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model (13 Feb 2025)

    Fei Shen, Cong Wang, Junyao Gao, et al. Qin Guo, Jisheng Dang, Jinhui Tang, Tat-Seng Chua
    Paper citation

  • SayAnything: Audio-Driven Lip Synchronization with Conditional Video Diffusion (17 Feb 2025)

    Junxian Ma, Shiwen Wang, Jian Yang, et al. Junyi Hu, Jian Liang, Guosheng Lin, Jingbo chen, Kai Li, Yu Meng
    Paper citation

  • Towards High-fidelity 3D Talking Avatar with Personalized Dynamic Texture (1 Mar 2025)

    [CVPR 2025] Xuanchen Li, Jianyu Wang, Yuhao Cheng, et al. Yikun Zeng, Xingyu Ren, Wenhan Zhu, Weiming Zhao, Yichao Yan
    Paper citation Project_Page Code

  • Cafe-Talk: Generating 3D Talking Face Animation with Multimodal Coarse- and Fine-grained Control (14 Mar 2025)

    [ICLR 2025] Hejia Chen, Haoxian Zhang, Shoulong Zhang, et al. Xiaoqiang Liu, Sisi Zhuang, Yuan Zhang, Pengfei Wan, Di Zhang, Shuai Li
    Paper citation Project_Page

  • MuseTalk: Real-Time High-Fidelity Video Dubbing via Spatio-Temporal Sampling (26 Mar 2025)

    Yue Zhang, Zhizhou Zhong, Minhao Liu, et al.Zhaokang Chen, Bin Wu, Yubin Zeng, Chao Zhan, Junxin Huang, Yingjie He, Wenjiang Zhou

    Paper citation Code

  • ChatAnyone: Stylized Real-time Portrait Video Generation with Hierarchical Motion Diffusion Model (27 Mar 2025)

    Jinwei Qi, Chaonan Ji, Sheng Xu, et al. Peng Zhang, Bang Zhang, Liefeng Bo
    Paper citation Project_Page

  • Audio-visual Controlled Video Diffusion with Masked Selective State Spaces Modeling for Natural Talking Head Generation (4 Apr 2025)

    Fa-Ting Hong, Zunnan Xu, Zixiang Zhou, et al. Jun Zhou, Xiu Li, Qin Lin, Qinglin Lu, Dan Xu
    Paper citation Project_Page Code

πŸŽ₯ + πŸ“Έ Video + Camera

  • ReCapture: Generative Video Camera Controls for User-Provided Videos using Masked Video Fine-Tuning (11 Nov 2024)
    David Junhao Zhang, Roni Paiss, Shiran Zada, et al.
    Paper Project_Page
  • Reangle-A-Video: 4D Video Generation as Video-to-Video Translation
    Hyeonho Jeong, Suhyeon Lee, Jong Chul Ye
    Paper Project_Page Code
  • Redirecting Camera Trajectory for Monocular Videos via Diffusion Models (25 Mar 2025)
    Mark YU, Wenbo Hu, Jinbo Xing, et al.
    Paper Project_Page Code
  • AC3D: Analyzing and Improving 3D Camera Control in Video Diffusion Transformers
    Sherwin Bahmani, Ivan Skorokhodov, Guocheng Qian, et al.
    Project_Page Code
  • MotionDirector: Motion Customization of Text-to-Video Diffusion Models
    Rui Zhao, Yuchao Gu, Jay Zhangjie Wu, et al.
    Project_Page Code

πŸ–ΌοΈ + 🌊 Image + Flow

  • I2VControl: Disentangled and Unified Video Motion Synthesis Control (26 Nov 2024)

    Wanquan Feng, Tianhao Qi, et al. Wanquan Feng, Tianhao Qi, Jiawei Liu, Mingzhen Sun, Pengqi Tu, Tianxiang Ma, Fei Dai, Songtao Zhao, Siyu Zhou, Qian He

    Paper Project_Page

  • Motion-I2V: Consistent and Controllable Image-to-Video Generation with Explicit Motion Modeling (29 Jan 2024)

    [SIGGRAPH 2024] Xiaoyu Shi, Zhaoyang Huang, et al. Xiaoyu Shi, Zhaoyang Huang, Fu-Yun Wang, Weikang Bian, Dasong Li, Yi Zhang, Manyuan Zhang, Ka Chun Cheung, Simon See, Hongwei Qin, Jifeng Dai, Hongsheng Li

    Paper Code Project_Page

πŸ–ΌοΈ + πŸ•Ί Image + Pose

  • (ICCV 23) DreamPose: Fashion Image-to-Video Synthesis via Stable Diffusion (12 Apr 2023)

    Johanna Karras, Aleksander Holynski, Ting-Chun Wang, et al. Johanna Karras, Aleksander Holynski, Ting-Chun Wang, Ira Kemelmacher-Shlizerman
    Paper Code Project

  • (CVPR 24) DISCO: Disentangled Control for Realistic Human Dance Generation (30 Jun 2023)

    Tan Wang, Linjie Li, Kevin Lin, et al. Tan Wang, Linjie Li, Kevin Lin, Yuanhao Zhai, Chung-Ching Lin, Zhengyuan Yang, Hanwang Zhang, Zicheng Liu, Lijuan Wang
    Paper Code Project

  • (CVPR 24) MagicAnimate: Temporally Consistent Human Image Animation using Diffusion Model (27 Nov 2023)

    Zhongcong Xu, Jianfeng Zhang, Jun Hao Liew, et al. Zhongcong Xu, Jianfeng Zhang, Jun Hao Liew, Hanshu Yan, Jia-Wei Liu, Chenxu Zhang, Jiashi Feng, Mike Zheng Shou
    Paper Code Project

  • Animate Anyone: Consistent and Controllable Image-to-Video Synthesis for Character Animation (28 Nov 2023)

    Li Hu, Xin Gao, Peng Zhang, et al. Li Hu, Xin Gao, Peng Zhang, Ke Sun, Bang Zhang, Liefeng Bo
    Paper Code Project

  • DreaMoving: A Human Video Generation Framework based on Diffusion Models (8 Dec 2023)

    Mengyang Feng, Jinlin Liu, Kai Yu, et al. Mengyang Feng, Jinlin Liu, Kai Yu, Yuan Yao, Zheng Hui, Xiefan Guo, Xianhui Lin, Haolan Xue, Chen Shi, Xiaowen Li, Aojie Li, Xiaoyang Kang, Biwen Lei, Miaomiao Cui, Peiran Ren, Xuansong Xie
    Paper Code
    Project

  • (ECCV 24)Champ: Controllable and Consistent Human Image Animation with 3D Parametric Guidance (21 Mar 2024)

    Shenhao Zhu, Junming Leo Chen, Zuozhuo Dai, et al. Shenhao Zhu, Junming Leo Chen, Zuozhuo Dai, Qingkun Su, Yinghui Xu, Xun Cao, Yao Yao, Hao Zhu, Siyu Zhu
    Paper Code Project

  • (IJCAI 24οΌ‰Zero-shot High-fidelity and Pose-controllable Character Animation (21 Apr 2024)

    Bingwen Zhu, Fanyi Wang, Tianyi Lu, et al. Bingwen Zhu, Fanyi Wang, Tianyi Lu, Peng Liu, Jingwen Su, Jinxiu Liu, Yanhao Zhang, Zuxuan Wu, Guo-Jun Qi, Yu-Gang Jiang
    Paper

  • (ECCV 24) PoseCrafter: One-Shot Personalized Video Synthesis Following Flexible Pose Control (23 May 2024)

    Yong Zhong, Min Zhao, Zebin You, et al. Yong Zhong, Min Zhao, Zebin You, Xiaofeng Yu, Changwang Zhang, Chongxuan Li
    Paper Project

  • Disentangling Foreground and Background Motion for Enhanced Realism in Human Video Generation (26 May 2024)

    Jinlin Liu, Kai Yu, Mengyang Feng, et al. Jinlin Liu, Kai Yu, Mengyang Feng, Xiefan Guo, Miaomiao Cui
    Paper Project

  • VividPose: Advancing Stable Video Diffusion for Realistic Human Image Animation (28 May 2024)

    Qilin Wang, Zhengkai Jiang, Chengming Xu, et al. Qilin Wang, Zhengkai Jiang, Chengming Xu, Jiangning Zhang, Yabiao Wang, Xinyi Zhang, Yun Cao, Weijian Cao, Chengjie Wang, Yanwei Fu
    Paper Code Project

  • UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation (3 Jun 2024)

    Xiang Wang, Shiwei Zhang, Changxin Gao, et al. Xiang Wang, Shiwei Zhang, Changxin Gao, Jiayu Wang, Xiaoqiang Zhou, Yingya Zhang, Luxin Yan, Nong Sang
    Paper Code Project

  • Follow-Your-Pose v2: Multiple-Condition Guided Character Image Animation for Stable Pose Control (05 Jun 2024)

    Jingyun Xue, Hongfa Wang, Qi Tian, et al. Jingyun Xue, Hongfa Wang, Qi Tian, Yue Ma, Andong Wang, Zhiyuan Zhao, Shaobo Min, Wenzhe Zhao, Kaihao Zhang, Heung-Yeung Shum, Wei Liu, Mengyang Liu, Wenhan Luo
    Paper Project

  • MimicMotion: High-Quality Human Motion Video Generation with Confidence-aware Pose Guidance (28 Jun 2024)

    Yuang Zhang, Jiaxi Gu, Li-Wen Wang, et al. Yuang Zhang, Jiaxi Gu, Li-Wen Wang, Han Wang, Junqi Cheng, Yuefeng Zhu, Fangyuan Zou
    Paper Code Project

  • (ECCV 24) TCAN: Animating Human Images with Temporally Consistent Pose Guidance using Diffusion Models (12 Jul 2024)

    Jeongho Kim, Min-Jung Kim, Junsoo Lee, et al. Jeongho Kim, Min-Jung Kim, Junsoo Lee, Jaegul Choo
    Paper Code Project

  • (MM24) AnimateAnywhere: Context-Controllable Human Video Generation with ID-Consistent One-shot Learning (28 Oct 2024)

    Hengyuan Liu, Xiaodong Chen, Xinchen Liu, et al. Hengyuan Liu, Xiaodong Chen, Xinchen Liu, Xiaoyan Gu, Wu Liu
    Paper

  • StableAnimator: High-Quality Identity-Preserving Human Image Animation (26 Nov 2024)

    Shuyuan Tu, Zhen Xing, Xintong Han, et al. Shuyuan Tu, Zhen Xing, Xintong Han, Zhi-Qi Cheng, Qi Dai, Chong Luo, Zuxuan Wu
    Paper Code Project

  • AnchorCrafter: Animate CyberAnchors Saling Your Products via Human-Object Interacting Video Generation (26 Nov 2024)

    Ziyi Xu, Ziyao Huang, Juan Cao, et al. Ziyi Xu, Ziyao Huang, Juan Cao, Yong Zhang, Xiaodong Cun, Qing Shuai, Yuchen Wang, Linchao Bao, Jintao Li, Fan Tang
    Paper Code Project

  • OmniHuman-1: Rethinking the Scaling-Up of One-Stage Conditioned Human Animation Models (3 Feb 2025)

    Gaojie Lin, Jianwen Jiang, Jiaqi Yang, et al. Gaojie Lin, Jianwen Jiang, Jiaqi Yang, Zerong Zheng, Chao Liang
    Paper Project

✍️ + πŸ”Š Text + Sound

🌟 + πŸŽ₯ Personalized + Motion

  • Show Me What and Tell Me How: Video Synthesis via Multimodal Conditioning (4 Mar 2022)

    Ligong Han, Jian Ren, Hsin-Ying Lee, et al. Ligong Han, Jian Ren, Hsin-Ying Lee, Francesco Barbieri, Kyle Olszewski, Shervin Minaee, Dimitris Metaxas, Sergey Tulyakov
    Paper Code

  • Video ControlNet: Towards Temporally Consistent Synthetic-to-Real Video Translation Using Conditional Image Diffusion Models (30 May 2023)

    Ernie Chu, Shuo-Yen Lin, Jun-Cheng Chen Ernie Chu, Shuo-Yen Lin, Jun-Cheng Chen
    Paper

  • ControlVideo: Training-free Controllable Text-to-Video Generation (22 May 2023)

    Yabo Zhang, Yuxiang Wei, Dongsheng Jiang, et al. Yabo Zhang, Yuxiang Wei, Dongsheng Jiang, Xiaopeng Zhang, Wangmeng Zuo, Qi Tian
    Paper Code

  • Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning (23 May 2023)

    Weifeng Chen, Yatai Ji, Jie Wu, et al. Weifeng Chen, Yatai Ji, Jie Wu, Hefeng Wu, Pan Xie, Jiashi Li, Xin Xia, Xuefeng Xiao, Liang Lin
    Paper Code

  • ControlVideo: Conditional Control for One-shot Text-driven Video Editing and Beyond (26 May 2023)

    Min Zhao, Rongzhen Wang, Fan Bao, et al. Min Zhao, Rongzhen Wang, Fan Bao, Chongxuan Li, Jun Zhu
    Paper Code

  • VideoComposer: Compositional Video Synthesis with Motion Controllability (3 Jun 2023)

    Xiang Wang, Hangjie Yuan, Shiwei Zhang, et al. Xiang Wang, Hangjie Yuan, Shiwei Zhang, Dayou Chen, Jiuniu Wang, Yingya Zhang, Yujun Shen, Deli Zhao, Jingren Zhou
    Paper Code

  • Text2Video-Zero: Text-to-Image Diffusion Models are Zero-Shot Video Generators (23 Mar 2023)

    Levon Khachatryan, Andranik Movsisyan, Vahram Tadevosyan, et al. Levon Khachatryan, Andranik Movsisyan, Vahram Tadevosyan, Roberto Henschel, Zhangyang Wang, Shant Navasardyan, Humphrey Shi
    Paper Code

  • Motion-Conditioned Diffusion Model for Controllable Video Synthesis (27 Apr 2023)

    Tsai-Shien Chen, Chieh Hubert Lin, Hung-Yu Tseng, et al. Tsai-Shien Chen, Chieh Hubert Lin, Hung-Yu Tseng, Tsung-Yi Lin, Ming-Hsuan Yang
    Paper

  • Moonshot: Towards Controllable Video Generation and Editing with Multimodal Conditions (3 Jan 2024)

    David Junhao Zhang, Dongxu Li, Hung Le, et al. David Junhao Zhang, Dongxu Li, Hung Le, Mike Zheng Shou, Caiming Xiong, Doyen Sahoo
    Paper

  • Boximator: Generating Rich and Controllable Motions for Video Synthesis (2 Feb 2024)

    Jiawei Wang, Yuchen Zhang, Jiaxin Zou, et al. Jiawei Wang, Yuchen Zhang, Jiaxin Zou, Yan Zeng, Guoqiang Wei, Liping Yuan, Hang Li
    Paper

  • Customize-A-Video: One-Shot Motion Customization of Text-to-Video Diffusion Models (22 Feb 2024)

    Yixuan Ren, Yang Zhou, Jimei Yang, et al. Yixuan Ren, Yang Zhou, Jimei Yang, Jing Shi, Difan Liu, Feng Liu, Mingi Kwon, Abhinav Shrivastava
    Paper Code

  • DreamVideo-2: Zero-Shot Subject-Driven Video Customization with Precise Motion Control (17 Oct 2024)

    Yujie Wei, Shiwei Zhang, Hangjie Yuan, et al. Yujie Wei, Shiwei Zhang, Hangjie Yuan, Xiang Wang, Haonan Qiu, Rui Zhao, Yutong Feng, Feng Liu, Zhizhong Huang, Jiaxin Ye, Yingya Zhang, Hongming Shan
    Paper

  • MotionCharacter: Identity-Preserving and Motion Controllable Human Video Generation (27 Nov 2024)

    Haopeng Fang, Di Qiu, Binjie Mao, et al. Haopeng Fang, Di Qiu, Binjie Mao, Pengfei Yan, He Tang
    Paper

  • MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model (30 May 2024)

    Muyao Niu, Xiaodong Cun, Xintao Wang, et al. Muyao Niu, Xiaodong Cun, Xintao Wang, Yong Zhang, Ying Shan, Yinqiang Zheng
    Paper Code

  • Diffusion as Shader: 3D-aware Video Diffusion for Versatile Video Generation Control (7 Jan 2025)

    Zekai Gu, Rui Yan, Jiahao Lu, et al. Zekai Gu, Rui Yan, Jiahao Lu, Peng Li, Zhiyang Dou, Chenyang Si, Zhen Dong, Qifeng Liu, Cheng Lin, Ziwei Liu, Wenping Wang, Yuan Liu
    Paper Code

❓ To be sorted

🌐 Unified controllable generation

  • VACE: All-in-One Video Creation and Editing (11 Mar 2025)

    Zeyinzi Jiang, Zhen Han, Chaojie Mao, et al.Zeyinzi Jiang, Zhen Han, Chaojie Mao, Jingfeng Zhang, Yulin Pan, Yu Liu
    Paper Code

  • FullDiT: Multi-Task Video Generative Foundation Model with Full Attention (25 Mar 2025)

    Xuan Ju, Weicai Ye, Quande Liu, et al.Xuan Ju, Weicai Ye, Quande Liu, Qiulin Wang, Xintao Wang, Pengfei Wan, Di Zhang, Kun Gai, Qiang Xu
    Paper

  • Any2Caption:Interpreting Any Condition to Caption for Controllable Video Generation (31 Mar 2025)

    Shengqiong Wu, Weicai Ye, Jiahao Wang, et al.Shengqiong Wu, Weicai Ye, Jiahao Wang, Quande Liu, Xintao Wang, Pengfei Wan, Di Zhang, Kun Gai, Shuicheng Yan, Hao Fei, Tat-Seng Chua
    Paper Code

  • VideoComposer: Compositional Video Synthesis with Motion Controllability (6 Jun 2023)

    Xiang Wang, Hangjie Yuan, Shiwei Zhang, et al.Xiang Wang, Hangjie Yuan, Shiwei Zhang, Dayou Chen, Jiuniu Wang, Yingya Zhang, Yujun Shen, Deli Zhao, Jingren Zhou
    Paper Code

Contributors

mayuelalaalexhe101DuNGEOnmasssterchenyangzhu1huzhongyyuanYingqingHeWANGAndyYucheng

Issues