πππA curated list of papers on controllable video generation. Please join us for more comprehensive summary. If you have any additions to the list, please raise them in the issue section. ζ¬’θΏθ‘₯ε π
- π€ Introduction
- π Contents
- π Tips
- πΉ Single Control
- π Character Control/ID/Video Customization/Personalization
- π Spatial Control
- βοΈ Text Rendering
- β³ Temporal Control
- π Advanced Text-Conditioned
- π In-Context
- πΌοΈ Image-guided
- π Sound-Guided
- π΅ Audio/Music-Guided
- ποΈ Layout Control
- βοΈ Sketch Control
- π€² Language-Gesture Controlled
- πΈ Multi Control/I2V
- β To be sorted
- π Unified controllable generation
- πΉ Single Control
- β Paper searching via catatogue: directly clicking the content of the catatogue to select the area of your research and browse related papers.
- β
Paper searching via author name: Free feel to search papers of a specific author via
ctrl + Fand then type the author name. The dropdown list of authors will automatically expand when searching. - β
Paper searching via tag: You can also search the related papers via the following tags:
customization,iteractive,human motion generationtokenizer. (More tags are ongoing)
-
Animate-A-Story: Storytelling with Retrieval-Augmented Video Generation (13 Jul 2023)
Yingqing He, Menghan Xia, Haoxin Chen, et al.
Yingqing He, Menghan Xia, Haoxin Chen, Xiaodong Cun, Yuan Gong, Jinbo Xing, Yong Zhang, Xintao Wang, Chao Weng, Ying Shan, Qifeng Chen -
VideoDrafter: Content-Consistent Multi-Scene Video Generation with LLM (2 Jan 2024)
Fuchen Long, Zhaofan Qiu, Ting Yao, et al.
Fuchen Long, Zhaofan Qiu, Ting Yao, Tao Mei -
Vlogger: Make Your Dream A Vlog (17 Jan 2024)
Shaobin Zhuang, Kunchang Li, Xinyuan Chen, et al.
Shaobin Zhuang, Kunchang Li, Xinyuan Chen, Yaohui Wang, Ziwei Liu, Yu Qiao, Yali Wang -
VideoBooth: Diffusion-based Video Generation with Image Prompts (1 Dec 2023)
Yuming Jiang, Tianxing Wu, Shuai Yang, et al.
Yuming Jiang, Tianxing Wu, Shuai Yang, Chenyang Si, Dahua Lin, Yu Qiao, Chen Change Loy, Ziwei Liu -
Magic-Me: Identity-Specific Video Customized Diffusion (14 Feb 2024)
Ze Ma, Daquan Zhou, Chun-Hsiao Yeh, et al.
Ze Ma, Daquan Zhou, Chun-Hsiao Yeh, Xue-She Wang, Xiuyu Li, Huanrui Yang, Zhen Dong, Kurt Keutzer, Jiashi Feng -
AesopAgent: Agent-driven Evolutionary System on Story-to-Video Production (12 Mar 2024)
Jiuniu Wang, Zehua Du, Yuyuan Zhao, et al.
Jiuniu Wang, Zehua Du, Yuyuan Zhao, Bo Yuan, Kexiang Wang, Jian Liang, Yaxi Zhao, Yihen Lu, Gengliang Li, Junlong Gao, Xin Tu, Zhenyu Guo -
Anim-Director: A Large Multimodal Model Powered Agent for Controllable Animation Video Generation (19 Aug 2024)
Yunxin Li, Haoyuan Shi, Baotian Hu, et al.
Yunxin Li, Haoyuan Shi, Baotian Hu, Longyue Wang, Jiashun Zhu, Jinyi Xu, Zhen Zhao, Min Zhang -
DisenStudio: Customized Multi-subject Text-to-Video Generation with Disentangled Spatial Control (21 May 2024)
Hong Chen, Xin Wang, Yipeng Zhang, et al.
Hong Chen, Xin Wang, Yipeng Zhang, Yuwei Zhou, Zeyang Zhang, Siao Tang, Wenwu Zhu -
StoryAgent: Customized Storytelling Video Generation via Multi-Agent Collaboration (7 Nov 2024)
Panwen Hu, Jin Jiang, Jianqi Chen, et al.
Panwen Hu, Jin Jiang, Jianqi Chen, Mingfei Han, Shengcai Liao, Xiaojun Chang, Xiaodan Liang -
MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling (24 Sep 2024)
Yifang Men, Yuan Yao, Miaomiao Cui, et al.
Yifang Men, Yuan Yao, Miaomiao Cui, Liefeng Bo -
MovieCharacter: A Tuning-Free Framework for Controllable Character Video Synthesis (28 Oct 2024)
Di Qiu, Zheng Chen, Rui Wang, et al.
Di Qiu, Zheng Chen, Rui Wang, Mingyuan Fan, Changqian Yu, Junshi Huang, Xiang Wen -
AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance (12 Feb 2025)
Zhao Wang, Hao Wen, Lingting Zhu, et al.
Zhao Wang, Hao Wen, Lingting Zhu, Chenming Shang, Yujiu Yang, Qi Dou -
DreamRunner: Fine-Grained Compositional Story-to-Video Generation with Retrieval-Augmented Motion Adaptation (25 Nov 2024)
Zun Wang, Jialu Li, Han Lin, et al.
Zun Wang, Jialu Li, Han Lin, Jaehong Yoon, Mohit Bansal -
Lumina-T2X: Transforming Text into Any Modality, Resolution, and Duration via Flow-based Large Diffusion Transformers (9 May 2024)
Peng Gao, Le Zhuo, Dongyang Liu, et al.
Peng Gao, Le Zhuo, Dongyang Liu, Ruoyi Du, Xu Luo, Longtian Qiu, Yuhang Zhang, Chen Lin, Rongjie Huang, Shijie Geng, Renrui Zhang, Junlin Xi, Wenqi Shao, Zhengkai Jiang, Tianshuo Yang, Weicai Ye, He Tong, Jingwen He, Yu Qiao, Hongsheng Li -
VIMI: Grounding Video Generation through Multi-modal Instruction (8 Jul 2024)
Yuwei Fang, Willi Menapace, Aliaksandr Siarohin, et al.
Yuwei Fang, Willi Menapace, Aliaksandr Siarohin, Tsai-Shien Chen, Kuan-Chien Wang, Ivan Skorokhodov, Graham Neubig, Sergey Tulyakov -
SubjectDrive: Scaling Generative Data in Autonomous Driving via Subject Control (28 Mar 2024)
Zheng Chen, Di Qiu, Rui Wang, et al.
Binyuan Huang, Yuqing Wen, Yucheng Zhao, Yaosi Hu, Yingfei Liu, Fan Jia, Weixin Mao, Tiancai Wang, Chi Zhang, Chang Wen Chen, Zhenzhong Chen, Xiangyu Zhang -
VideoMaker: Zero-shot Customized Video Generation with the Inherent Force of Video Diffusion Models (27 Dec 2024)
Tao Wu, Yong Zhang, Xiaodong Cun, et al.
Tao Wu, Yong Zhang, Xiaodong Cun, Zhongang Qi, Junfu Pu, Huanzhang Dou, Guangcong Zheng, Ying Shan, Xi Li -
EchoVideo: Identity-Preserving Human Video Generation by Multimodal Feature Fusion (23 Jan 2025)
Jiangchuan Wei, Shiyue Yan, Wenfeng Lin, et al.
Jiangchuan Wei, Shiyue Yan, Wenfeng Lin, Boyuan Liu, Renjie Chen, Mingyu Guo -
SUGAR: Subject-Driven Video Customization in a Zero-Shot Manner (13 Dec 2024)
Yufan Zhou, Ruiyi Zhang, Jiuxiang Gu, et al.
Yufan Zhou, Ruiyi Zhang, Jiuxiang Gu, Nanxuan Zhao, Jing Shi, Tong Sun -
Multi-subject Open-set Personalization in Video Generation (10 Jan 2025)
Tsai-Shien Chen, Aliaksandr Siarohin, Willi Menapace, et al.
Tsai-Shien Chen, Aliaksandr Siarohin, Willi Menapace, Yuwei Fang, Kwot Sin Lee, Ivan Skorokhodov, Kfir Aberman, Jun-Yan Zhu, Ming-Hsuan Yang, Sergey Tulyakov -
Movie Weaver: Tuning-Free Multi-Concept Video Personalization with Anchored Prompts (4 Feb 2025)
Feng Liang, Haoyu Ma, Zecheng He, et al.
Feng Liang, Haoyu Ma, Zecheng He, Tingbo Hou, Ji Hou, Kunpeng Li, Xiaoliang Dai, Felix Juefei-Xu, Samaneh Azadi, Animesh Sinha, Peizhao Zhang, Peter Vajda, Diana Marculescu -
CustomTTT: Motion and Appearance Customized Video Generation via Test-Time Training (20 Dec 2024)
Xiuli Bi, Jian Lu, Bo Liu, et al.
Xiuli Bi, Jian Lu, Bo Liu, Xiaodong Cun, Yong Zhang, Weisheng Li, Bin Xiao -
DreamRelation: Relation-Centric Video Customization (10 Mar 2025)
Yujie Wei, Shiwei Zhang, Hangjie Yuan, et al.
Yujie Wei, Shiwei Zhang, Hangjie Yuan, Biao Gong, Longxiang Tang, Xiang Wang, Haonan Qiu, Hengjia Li, Shuai Tan, Yingya Zhang, Hongming Shan -
Get In Video: Add Anything You Want to the Video (8 Mar 2025)
Shaobin Zhuang, Zhipeng Huang, Binxin Yang, et al.
Shaobin Zhuang, Zhipeng Huang, Binxin Yang, Ying Zhang, Fangyikang Wang, Canmiao Fu, Chong Sun, Zheng-Jun Zha, Chen Li, Yali Wang -
Phantom: Subject-consistent video generation via cross-modal alignment (16 Feb 2025)
Lijie Liu, Tianxiang Ma, Bingchuan Li, et al.
Lijie Liu, Tianxiang Ma, Bingchuan Li, Zhuowei Chen, Jiawei Liu, Qian He, Xinglong Wu -
Identity-Preserving Text-to-Video Generation by Frequency Decomposition (25 Mar 2024)
Shenghai Yuan, Jinfa Huang, et al.
Shenghai Yuan, Jinfa Huang, Xianyi He, Yunyuan Ge, Yujun Shi, Liuhan Chen, Jiebo Luo, Li Yuan -
Animate-A-Story: Storytelling with Retrieval-Augmented Video Generation
Yingqing He, Menghan Xia, et al.
Yingqing He, Menghan Xia, Haoxin Chen, Xiaodong Cun, Yuan Gong, Jinbo Xing, Yong Zhang, Xintao Wang, Chao Weng, Ying Shan, Qifeng Chen -
ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning
Yuzhou Huang, Ziyang Yuan, Quande Liu, et al.
Yuzhou Huang, Ziyang Yuan, Quande Liu, Qiulin Wang, Xintao Wang, Ruimao Zhang, Pengfei Wan, Di Zhang, Kun Gai -
Videodreamer: Customized Multi-Subject Text-to-Video Generation with Disen-Mix Finetuning
Hong Chen, Xin Wang, Guanning Zeng, et al.
Hong Chen, Xin Wang, Guanning Zeng, Yipeng Zhang, Yuwei Zhou, Feilin Han, Wenwu Zhu -
VideoBooth: Diffusion-based Video Generation with Image Prompts
Yuming Jiang, Tianxing Wu, et al.
Yuming Jiang, Tianxing Wu, Shuai Yang, Chenyang Si, Dahua Lin, Yu Qiao, Chen Change Loy, Ziwei Liu -
Customcrafter: Customized Video Generation with Preserving Motion and Concept Composition Abilities
Tao Wu, Yong Zhang, Xintao Wang, et al.
Tao Wu, Yong Zhang, Xintao Wang, Xianpan Zhou, Guangcong Zheng, Zhongang Qi, Ying Shan, Xi Li -
Still-Moving: Customized Video Generation Without Customized Video Data
Hila Chefer, Shiran Zada, Roni Paiss, Ariel Ephrat, et al.
Hila Chefer, Shiran Zada, Roni Paiss, Ariel Ephrat, Omer Tov, Michael Rubinstein, Lior Wolf, Tali Dekel, Tomer Michaeli, Inbar Mosseri -
Customvideo: Customizing Text-to-Video Generation with Multiple Subjects
Zhao Wang, Aoxue Li, et al.
Zhao Wang, Aoxue Li, Lingting Zhu, Yong Guo, Qi Dou, Zhenguo Li -
Dreamvideo: Composing Your Dream Videos with Customized Subject and Motion
Yujie Wei, Shiwei Zhang, Zhiwu Qing, et al.
Yujie Wei, Shiwei Zhang, Zhiwu Qing, Hangjie Yuan, Zhiheng Liu, Yu Liu, Yingya Zhang, Jingren Zhou, Hongming Shan -
MotionBooth: Motion-Aware Customized Text-to-Video Generation
Jianzong Wu, Xiangtai Li, Yanhong Zeng, et al.
Jianzong Wu, Xiangtai Li, Yanhong Zeng, Jiangning Zhang, Qianyu Zhou, Yining Li, Yunhai Tong, Kai Chen -
ID-Animator: Zero-Shot Identity-Preserving Human Video Generation (25 Jun 2024)
Xuanhua He, Quande Liu, et al.
Xuanhua He, Quande Liu, Shengju Qian, Xin Wang, Tao Hu, Ke Cao, Keyu Yan, Jie Zhang -
PERSONALVIDEO: High ID-Fidelity Video Customization with Static Images
Hengjia Li, Haonan Qiu, Shiwei Zhang, Xiang Wang, et al.
Hengjia Li, Haonan Qiu, Shiwei Zhang, Xiang Wang, Yujie Wei, Zekun Li, Yingya Zhang, Boxi Wu, Deng Cai -
TaleCrafter: Interactive Story Visualization with Multiple Characters
Yuan Gong, Youxin Pang, et al.
Yuan Gong, Youxin Pang, Xiaodong Cun, Menghan Xia, Yingqing He, Haoxin Chen, Longyue Wang, Yong Zhang, Xintao Wang, Ying Shan, Yujiu Yang -
Dreamix: Video Diffusion Models are General Video Editors
Eyal Molad, Eliahu Horwitz, et al.
Eyal Molad, Eliahu Horwitz, Dani Valevski, Alex Rav Acha, Yossi Matias, Yael Pritch, Yaniv Leviathan, Yedid Hoshen -
VideoAlchemy: Open-set Personalization in Video Generation
Tsai-Shien Chen, Aliaksandr Siarohin, et al.
Tsai-Shien Chen, Aliaksandr Siarohin, Willi Menapace, Yuwei Fang, Ivan Skorokhodov, Jun-Yan Zhu, Kfir Aberman, Ming-Hsuan Yang, Sergey Tulyakov
-
TASTE-Rob: Advancing Video Generation of Task-Oriented Hand-Object Interaction for Generalizable Robotic Manipulation (14 Mar 2025)
Hongxiang Zhao, Xingchen Liu, et al.
Hongxiang Zhao, Xingchen Liu, Mutian Xu, Yiming Hao, Weikai Chen, Xiaoguang Han -
AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance (12 Feb 2025)
Zhao Wang, Hao Wen, et al.
Zhao Wang, Hao Wen, Lingting Zhu, Chenming Shang, Yujiu Yang, Qi Dou -
Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance (10 Feb 2025)
Li Hu,Β Guangyuan Wang, et al.
Li Hu,Β Guangyuan Wang,Β Zhen Shen,Β Xin Gao,Β Dechao Meng,Β Lian Zhuo,Β Peng Zhang,Β Bang Zhang,Β Liefeng Bo -
Consistent Human Image and Video Generation with Spatially Conditioned Diffusion (19 Dec 2024)
Mingdeng Cao, Chong Mou, et al.
Mingdeng Cao, Chong Mou, Ziyang Yuan, Xintao Wang, Zhaoyang Zhang, Ying Shan, Yinqiang Zheng -
DirectorLLM for Human-Centric Video Generation (19 Dec 2024)
Kunpeng Song, Tingbo Hou, et al.
Kunpeng Song, Tingbo Hou, Zecheng He, Haoyu Ma, Jialiang Wang, Animesh Sinha, Sam Tsai, Yaqiao Luo, Xiaoliang Dai, Li Chen, Xide Xia, Peizhao Zhang, Peter Vajda, Ahmed Elgammal, Felix Juefei-Xu -
Generative Inbetweening through Frame-wise Conditions-Driven Video Generation (16 Dec 2024)
Tianyi Zhu, Dongwei Ren, et al.
Tianyi Zhu, Dongwei Ren, Qilong Wang, Xiaohe Wu, Wangmeng Zuo -
DisPose: Disentangling Pose Guidance for Controllable Human Image Animation (12 Dec 2024)
Hongxiang Li, Yaowei Li, et al.
Hongxiang Li, Yaowei Li, Yuhang Yang, Junjie Cao, Zhihong Zhu, Xuxin Cheng, Long Chen -
ControlNeXt: Powerful and Efficient Control for Image and Video Generation (12 Aug 2024)
Bohao Peng, Jian Wang, et al.
Bohao Peng, Jian Wang, Yuechen Zhang, Wenbo Li, Ming-Chang Yang, Jiaya Jia -
MimicMotion: High-Quality Human Motion Video Generation with Confidence-aware Pose Guidance (28 Jun 2024)
Yuang Zhang, Jiaxi Gu, et al.
Yuang Zhang, Jiaxi Gu, Li-Wen Wang, Han Wang, Junqi Cheng, Yuefeng Zhu, Fangyuan Zou -
Champ: Controllable and Consistent Human Image Animation with 3D Parametric Guidance (21 Mar 2024)
Shenhao Zhu, Junming Leo Chen, et al.
Shenhao Zhu, Junming Leo Chen, Zuozhuo Dai, Qingkun Su, Yinghui Xu, Xun Cao, Yao Yao, Hao Zhu, Siyu Zhu -
Do You Guys Want to Dance: Zero-Shot Compositional Human Dance Generation with Multiple Persons (24 Jan 2024)
Zhe Xu, Kun Wei, et al.
Zhe Xu, Kun Wei, Xu Yang, Cheng Deng -
Generative Rendering: Controllable 4D-Guided Video Generation with 2D Diffusion Models (3 Dec 2023)
Shengqu Cai, Duygu Ceylan, et al.
Shengqu Cai, Duygu Ceylan, Matheus Gadelha, Chun-Hao Paul Huang, Tuanfeng Yang Wang, Gordon Wetzstein -
Animate Anyone: Consistent and Controllable Image-to-Video Synthesis for Character Animation (28 Nov 2023)
Li Hu, Xin Gao, et al.
Li Hu, Xin Gao, Peng Zhang, Ke Sun, Bang Zhang, Liefeng Bo -
MagicAnimate: Temporally Consistent Human Image Animation using Diffusion Model (27 Nov 2023)
Zhongcong Xu, Jianfeng Zhang, et al.
Zhongcong Xu, Jianfeng Zhang, Jun Hao Liew, Hanshu Yan, Jia-Wei Liu, Chenxu Zhang, Jiashi Feng, Mike Zheng Shou -
MagicPose: Realistic Human Poses and Facial Expressions Retargeting with Identity-aware Diffusion (18 Nov 2023)
Di Chang, Yichun Shi, Quankai Gao, et al.
Di Chang, Yichun Shi, Quankai Gao, Jessica Fu, Hongyi Xu, Guoxian Song, Qing Yan, Yizhe Zhu, Xiao Yang, Mohammad Soleymani -
Dancing Avatar: Pose and Text-Guided Human Motion Videos Synthesis with Image Diffusion Model (15 Aug 2023)
Bosheng Qin, Wentao Ye, et al.
Bosheng Qin, Wentao Ye, Qifan Yu, Siliang Tang, Yueting Zhuang -
DisCo: Disentangled Control for Realistic Human Dance Generation (30 Jun 2023)
Tan Wang, Linjie Li, et al.
Tan Wang, Linjie Li, Kevin Lin, Yuanhao Zhai, Chung-Ching Lin, Zhengyuan Yang, Hanwang Zhang, Zicheng Liu, Lijuan Wang -
DreamPose: Fashion Image-to-Video Synthesis via Stable Diffusion (12 Apr 2023)
Johanna Karras, Aleksander Holynski, et al.
Johanna Karras, Aleksander Holynski, Ting-Chun Wang, Ira Kemelmacher-Shlizerman -
Follow Your Pose: Pose-Guided Text-to-Video Generation using Pose-Free Videos (3 Apr 2023)
Yue Ma, Yingqing He, et al.
Yue Ma, Yingqing He, Xiaodong Cun, Xintao Wang, Siran Chen, Ying Shan, Xiu Li, Qifeng Chen -
Point-to-Point Video Generation (5 Apr 2019)
Tsun-Hsuan Wang, Yen-Chi Cheng, et al.
Tsun-Hsuan Wang, Yen-Chi Cheng, Chieh Hubert Lin, Hwann-Tzong Chen, Min Sun -
Pose Guided Human Video Generation (3 Apr 2023)
Ceyuan Yang, Zhe Wang, et al.
Ceyuan Yang, Zhe Wang, Xinge Zhu, Chen Huang, Jianping Shi, Dahua Lin
-
MagicDrive: Street View Generation with Diverse 3D Geometry Control (04 Oct 2023)
Ruiyuan Gao, Kai Chen, Enze Xie, et al.
Ruiyuan Gao, Kai Chen, Enze Xie, Lanqing Hong, Zhenguo Li, Dit-Yan Yeung, Qiang Xu -
Panacea: Panoramic and Controllable Video Generation for Autonomous Driving (28 Nov 2023)
Yuqing Wen, Yucheng Zhao, Yingfei Liu, et al.
Yuqing Wen, Yucheng Zhao, Yingfei Liu, Fan Jia, Yanhui Wang, Chong Luo, Chi Zhang, Tiancai Wang, Xiaoyan Sun, Xiangyu Zhang -
DriveDreamer-2: LLM-Enhanced World Models for Diverse Driving Video Generation (11 Mar 2024)
Guosheng Zhao, Xiaofeng Wang, Zheng Zhu, et al.
Guosheng Zhao, Xiaofeng Wang, Zheng Zhu, Xinze Chen, Guan Huang, Xiaoyi Bao, Xingang Wang -
Unleashing Generalization of End-to-End Autonomous Driving with Controllable Long Video Generation (03 Jun 2024)
Enhui Ma, Lijun Zhou, Tao Tang, et al.
Enhui Ma, Lijun Zhou, Tao Tang, Zhan Zhang, Dong Han, Junpeng Jiang, Kun Zhan, Peng Jia, Xianpeng Lang, Haiyang Sun, Di Lin, Kaicheng Yu -
DiVE: DiT-based Video Generation with Enhanced Control (03 Sep 2024)
Junpeng Jiang, Gangyi Hong, Lijun Zhou, et al.
Junpeng Jiang, Gangyi Hong, Lijun Zhou, Enhui Ma, Hengtong Hu, Xia Zhou, Jie Xiang, Fan Liu, Kaicheng Yu, Haiyang Sun, Kun Zhan, Peng Jia, Miao Zhang -
DreamForge: Motion-Aware Autoregressive Video Generation for Multi-View Driving Scenes (06 Sep 2024)
Jianbiao Mei, Tao Hu, Xuemeng Yang, et al.
Jianbiao Mei, Tao Hu, Xuemeng Yang, Licheng Wen, Yu Yang, Tiantian Wei, Yukai Ma, Min Dou, Botian Shi, Yong Liu -
MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control (21 Nov 2024)
Ruiyuan Gao, Kai Chen, Bo Xiao, et al.
Ruiyuan Gao, Kai Chen, Bo Xiao, Lanqing Hong, Zhenguo Li, Qiang Xu -
Seeing Beyond Views: Multi-View Driving Scene Video Generation with Holistic Attention (04 Dec 2024)
Hannan Lu, Xiaohe Wu, Shudong Wang, et al.
Hannan Lu, Xiaohe Wu, Shudong Wang, Xiameng Qin, Xinyu Zhang, Junyu Han, Wangmeng Zuo, Ji Tao
- StyleMaster: Stylize Your Video with Artistic Generation and Translation (10 Dec 2024)
Zixuan Ye, Huijuan Huang, Xintao Wang, et al.
Pengfei Wan, Di Zhang, Wenhan Luo
- FRESCO: Spatial-Temporal Correspondence for Zero-Shot Video Translation (19 Mar 2024)
[CVPR 2024] Shuai Yang, Yifan Zhou, Ziwei Liu, et al.
Chen Change Loy
- StyleCrafter: Enhancing Stylized Text-to-Video Generation with Style Adapter (1 Dec 2023)
[TOG 2024] Gongye Liu, Menghan Xia, Yong Zhang, et al.
Haoxin Chen, Jinbo Xing, Yibo Wang, Xintao Wang, Yujiu Yang, Ying Shan
- UniVST: A Unified Framework for Training-free Localized Video Style Transfer (26 Oct 2024)
Quanjian Song, Mingbao Lin, Wengyi Zhan, et al.
Shuicheng Yan, Liujuan Cao, Rongrong Ji
- StyleGANEX: StyleGAN-Based Manipulation Beyond Cropped Aligned Faces (21 Jul 2023)
[ICCV 2023] Shua Yang, Liming Jiang, Ziwei Liu, et al.
Chen Change Loy
- Rerender A Video: Zero-Shot Text-Guided Video-to-Video Translation (13 Jun 2023)
[Siggraph Asia 2023] Shuai Yang, Yifan Zhou, Ziwei Liu, et al.
Chen Change Loy
- VToonify: Controllable High-Resolution Portrait Video Style Transfer (22 Sep 2022)
[Siggraph Asia 2022] Shuai Yang, Liming Jiang, Ziwei Liu, et al.
Chen Change Loy
- Arbitrary video style transfer via multi-channel correlation (17 Sep 2020)
[AAAI 2020] Yingying Deng, Fan Tang, Weiming Dong, et al.
Yingying Deng, Fan Tang, Weiming Dong, Haibin Huang, Chongyang Ma, Changsheng Xu
- Fast video multi-style transfer (2020)
[WACV 2020] Wei Gao, Yijun Li, et al.
Yihang Yin, Ming-Hsuan Yang
- Coherent online video style transfer (27 Mar 2017)
[CVPR 2017] Dongdong Chen, Jing Liao, Lu Yuan, et al.
Nenghai Yu, Gang Hua
- Real-time neural style transfer for videos (2017)
[CVPR 2017] Haozhi Huang, Hao Wang, Wenhan Luo, et al.
Lin Ma, Wenhao Jiang, Xiaolong Zhu, Zhifeng Li, Wei Liu
- Diffusion as Shader: 3D-aware Video Diffusion for Versatile Video Generation Control (7 Jan 2025)
Zekai Gu, Rui Yan, Jiahao Lu, Peng Li, et al.
Zhiyang Dou, Chenyang Si, Zhen Dong, Qifeng Liu, Cheng Lin, Ziwei Liu, Wenping Wang, Yuan Liu
- GS-DiT: Advancing Video Generation with Pseudo 4D Gaussian Fields through Efficient Dense 3D Point Tracking (5 Jan 2025)
Weikang Bian, Zhaoyang Huang, Xiaoyu Shi, et al.
Yijin Li, Fu-Yun Wang, Hongsheng Li
- Track4Gen: Teaching Video Diffusion Models to Track Points Improves Video Generation (8 Dec 2024)
[CVPR 2025] Hyeonho Jeong, Chun-Hao Paul Huang, et al.
Jong Chul Ye, Niloy Mitra, Duygu Ceylan
- Drag-A-Video: Non-rigid Video Editing with Point-based Interaction (5 Dec 2023)
Yao Teng, Enze Xie, Yue Wu, Haoyu Han, et al.
Zhenguo Li, Xihui Liu
- Point-to-Point Video Generation (5 Apr 2019)
[ICCV 2019] Tsun-Hsuan Wang, Yen-Chi Cheng, Chieh Hubert Lin, et al.
Hwann-Tzong Chen, Min Sun
- DreamDance: Animating Human Images by Enriching 3D Geometry Cues from 2D Poses (30 Nov 2024)
Yatian Pang, Bin Zhu, Bin Lin, et al.
Mingzhe Zheng, Francis E. H. Tay, Ser-Nam Lim, Harry Yang, Li Yuan
- ControlNeXt: Powerful and Efficient Control for Image and Video Generation (12 Aug 2024)
Bohao Peng, Jian Wang, Yuechen Zhang, et al.
Wenbo Li, Ming-Chang Yang, Jiaya Jia
- Champ: Controllable and Consistent Human Image Animation with 3D Parametric Guidance (21 Mar 2024)
[ECCV 2024] Shenhao Zhu, Junming Leo Chen, Zuozhuo Dai, et al.
Qingkun Su, Yinghui Xu, Xun Cao, Yao Yao, Hao Zhu, Siyu Zhu
- MoonShot: Towards Controllable Video Generation and Editing with Multimodal Conditions (3 Jan 2024)
David Junhao Zhang, Dongxu Li, Hung Le, et al.
Mike Zheng Shou, Caiming Xiong, Doyen Sahoo
- SparseCtrl: Adding Sparse Controls to Text-to-Video Diffusion Models (28 Nov 2023)
[ECCV 2024] Yuwei Guo, Ceyuan Yang, Anyi Rao, et al.
Maneesh Agrawala, Dahua Lin, Bo Dai
- GD-VDM: Generated Depth for better Diffusion-based Video Generation (19 Jun 2023)
Ariel Lapid, Idan Achituve, Lior Bracha, et al.
Ethan Fetaya
- Make-Your-Video: Customized Video Generation Using Textual and Structural Guidance (1 Jun 2023)
[IEEE TVCG 2024] Jinbo Xing, Menghan Xia, Yuxin Liu, et al.
Yuechen Zhang, Yong Zhang, Yingqing He, Hanyuan Liu, Haoxin Chen, Xiaodong Cun, Xintao Wang, Ying Shan, Tien-Tsin Wong
- Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning (23 May 2023)
Weifeng Chen, Yatai Ji, Jie Wu, et al.
Hefeng Wu, Pan Xie, Jiashi Li, Xin Xia, Xuefeng Xiao, Liang Lin
- ControlVideo: Training-free Controllable Text-to-Video Generation (22 May 2023)
[ICLR 2024] Yabo Zhang, Yuxiang Wei, Dongsheng Jiang, et al.
Xiaopeng Zhang, Wangmeng Zuo, Qi Tian
-
TASTE-Rob: Advancing Video Generation of Task-Oriented Hand-Object Interaction for Generalizable Robotic Manipulation (14 Mar 2025)
Hongxiang Zhao, Xingchen Liu, et al.
Hongxiang Zhao, Xingchen Liu, Mutian Xu, Yiming Hao, Weikai Chen, Xiaoguang Han -
Identity-Preserving Text-to-Video Generation by Frequency Decomposition (26 Nov 2024)
[CVPR 2025] Shenghai Yuan, Jinfa Huang, et al.
Shenghai Yuan, Jinfa Huang, Xianyi He, Yunyuan Ge, Yujun Shi, Liuhan Chen, Jiebo Luo, Li Yuan -
EchoMimicV2: Towards Striking, Simplified, and Semi-Body Human Animation (15 Nov 2024)
[CVPR 2025] Rang Meng, Xingyu Zhang, Yuming Li, et al.
Chenguang Ma -
Takin-ADA: Emotion Controllable Audio-Driven Animation with Canonical and Landmark Loss Optimization (18 Oct 2024)
Bin Lin, Yanzhen Yu, et al.
Bin Lin, Yanzhen Yu, Jianhao Ye, Ruitao Lv, Yuguang Yang, Ruoye Xie, Pan Yu, Hongbin Zhou -
EchoMimic: Lifelike Audio-Driven Portrait Animations through Editable Landmark Conditions (12 Jul 2024)
[AAAI 2025] Zhiyuan Chen, Jiajiong Cao, Zhiquan Chen, et al.
Yuming Li, Chenguang Ma -
LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control (3 Jul 2024)
Jianzhu Guo, Dingyun Zhang, et al.
Jianzhu Guo, Dingyun Zhang, Xiaoqiang Liu, Zhizhou Zhong, Yuan Zhang, Pengfei Wan, Di Zhang -
Follow-Your-Emoji: Fine-Controllable and Expressive Freestyle Portrait Animation (4 Jun 2024)
[Siggraph Asia 2024] Yue Ma, Hongyu Liu, et al.
Yue Ma, Hongyu Liu, Hongfa Wang, Heng Pan, Yingqing He, Junkun Yuan, Ailing Zeng, Chengfei Cai, Heung-Yeung Shum, Wei Liu, Qifeng Chen -
Follow Your Pose: Pose-Guided Text-to-Video Generation using Pose-Free Videos (3 Apr 2023)
[AAAI 2024] Yue Ma, Yingqing He, et al.
Yue Ma, Yingqing He, Xiaodong Cun, Xintao Wang, Siran Chen, Ying Shan, Xiu Li, Qifeng Chen -
SadTalker: Learning Realistic 3D Motion Coefficients for Stylized Audio-Driven Single Image Talking Face Animation (22 Nov 2022)
[CVPR 2023] Wenxuan Zhang, Xiaodong Cun, et al.
Wenxuan Zhang, Xiaodong Cun, Xuan Wang, Yong Zhang, Xi Shen, Yu Guo, Ying Shan, Fei Wang -
Depth-Aware Generative Adversarial Network for Talking Head Video Generation (13 Mar 2022)
[CVPR 2022] Fa-Ting Hong, Longhao Zhang, et al.
Fa-Ting Hong, Longhao Zhang, Li Shen, Dan Xu
-
Text-Animator: Controllable Visual Text Video Generation (25 Jun 2024)
Lin Liu, Quande Liu, Shengju Qian, et al.
Yuan Zhou, Wengang Zhou, Houqiang Li, Lingxi Xie, Qi Tian -
Wan: Open and Advanced Large-Scale Video Generative Models (2025)
WanTeam, Ang Wang, Baole Ai, et al.
Bin Wen,Chaojie Mao,Chen-Wei Xie,Di Chen,Feiwu Yu,Haiming Zhao,Jianxiao Yang,Jianyuan Zeng,Jiayu Wang,Jingfeng Zhang,Jingren Zhou,Jinkai Wang,Jixuan Chen,Kai Zhu,Kang Zhao,Keyu Yan,Lianghua Huang,Mengyang Feng,Ningyi Zhang,Pandeng Li,Pingyu Wu,Ruihang Chu,Ruili Feng,Shiwei Zhang,Siyang Sun,Tao Fang,Tianxing Wang,Tianyi Gui,Tingyu Weng,Tong Shen,Wei Lin,Wei Wang1,Wei Wang2,Wenmeng Zhou,Wente Wang,Wenting Shen,Wenyuan Yu,Xianzhong Shi,Xiaoming Huang,Xin Xu,Yan Kou,Yangyu Lv,Yifei Li,Yijing Liu,Yiming Wang,Yingya Zhang,Yitong Huang,Yong Li,You Wu,Yu Liu,Yulin Pan,Yun Zheng,Yuntao Hong,Yupeng Shi,Yutong Feng,Zeyinzi Jiang,Zhen Han,Zhi-Fan Wu,Ziyu Liu
-
MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model (30 May 2024)
[ECCV 2024] Muyao Niu, Xiaodong Cun, et al.
Muyao Niu, Xiaodong Cun, Xintao Wang, Yong Zhang, Ying Shan, Yinqiang Zheng -
Motion-I2V: Consistent and Controllable Image-to-Video Generation with Explicit Motion Modeling (29 Jan 2024)
[SIGGRAPH 2024] Xiaoyu Shi, Zhaoyang Huang, et al.
Xiaoyu Shi, Zhaoyang Huang, Fu-Yun Wang, Weikang Bian, Dasong Li, Yi Zhang, Manyuan Zhang, Ka Chun Cheung, Simon See, Hongwei Qin, Jifeng Dai, Hongsheng Li -
Motion-Conditioned Diffusion Model for Controllable Video Synthesis (27 Apr 2023)
Tsai-Shien Chen, Chieh Hubert Lin, et al.
Tsai-Shien Chen, Chieh Hubert Lin, Hung-Yu Tseng, Tsung-Yi Lin, Ming-Hsuan Yang
-
VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control (30 Mar 2025)
Sherwin Bahmani, Ivan Skorokhodov, Aliaksandr Siarohin, et al.
Willi Menapace, Guocheng Qian, Michael Vasilkovsky, Hsin-Ying Lee, Chaoyang Wang, Jiaxu Zou, Andrea Tagliasacchi, David B. Lindell, Sergey Tulyakov -
CineMaster: A 3D-Aware and Controllable Framework for Cinematic Text-to-Video Generation (30 Mar 2025)
Qinghe Wang, Yawen Luo, Xiaoyu Shi, et al.
Xu Jia, Huchuan Lu, Tianfan Xue, Xintao Wang, Pengfei Wan, Di Zhang, Kun Gai -
Direct-a-Video: Customized Video Generation with User-Directed Camera Movement and Object Motion (30 Mar 2025)
Shiyuan Yang, Liang Hou, Haibin Huang, et al.
Chongyang Ma, Pengfei Wan, Di Zhang, Xiaodong Chen, Jing Liao -
3DTRAJMASTER: MASTERING 3D TRAJECTORY FOR MULTI-ENTITY MOTION IN VIDEO GENERATION (30 Mar 2025)
Xiao Fu, Xian Liu, Xintao Wang, et al.
Sida Peng, Menghan Xia, Xiaoyu Shi, Ziyang Yuan, Pengfei Wan, Di Zhang, Dahua Lin -
AC3D: Analyzing and Improving 3D Camera Control in Video Diffusion Transformers (30 Mar 2025)
Sherwin Bahmani, Ivan Skorokhodov, Guocheng Qian, et al.
Aliaksandr Siarohin, Willi Menapace, Andrea Tagliasacchi, David B. Lindell, Sergey Tulyakov -
CameraCtrl: Enabling Camera Control for Text-to-Video Generation (30 Mar 2025)
Hao He, Yinghao Xu, Yuwei Guo, et al.
Gordon Wetzstein, Bo Dai, Hongsheng Li, Ceyuan Yang -
ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis (30 Mar 2025)
Wangbo Yu, Jinbo Xing, Li Yuan, et al.
Wenbo Hu, Xiaoyu Li, Zhipeng Huang, Xiangjun Gao, Tien-Tsin Wong, Ying Shan, Yonghong Tian -
EgoSim: Egocentric Exploration in Virtual Worlds with Multi-modal Conditioning (30 Mar 2025)
Wei Yu, Songheng Yin, Steve Easterbrook, Animesh Garg
-
MOTIONFLOW: LEARNING IMPLICIT MOTION FLOW FOR COMPLEX CAMERA TRAJECTORY CONTROL IN VIDEO GENERATION (30 Mar 2025)
Author list not fully provided
-
MotionMaster: Training-free Camera Motion Transfer For Video Generation (30 Mar 2025)
Teng Hu, Jiangning Zhang, Ran Yi, et al.
Yating Wang, Hongrui Huang, Jieyu Weng, Yabiao Wang, Lizhuang Ma -
ReCamMaster: Camera-Controlled Generative Rendering from A Single Video (30 Mar 2025)
Jianhong Bai, Menghan Xia, Xiao Fu, et al.
Xintao Wang, Lianrui Mu, Jinwen Cao, Zuozhu Liu, Haoji Hu, Xiang Bai, Pengfei Wan, Di Zhang -
CPA: Camera-pose-awareness Diffusion Transformer for Video Generation (30 Mar 2025)
Yuelei Wang, Jian Zhang, Pengtao Jiang, et al.
Hao Zhang, Jinwei Chen, Bo Li -
BOOSTING CAMERA MOTION CONTROL FOR VIDEO DIFFUSION TRANSFORMERS (30 Mar 2025)
Soon Yau Cheong, Duygu Ceylan, Armin Mustafa, et al.
Andrew Gilbert, Chun-Hao Paul Huang -
CAVIA: CAMERA-CONTROLLABLE MULTI-VIEW VIDEO DIFFUSION WITH VIEW-INTEGRATED ATTENTION (30 Mar 2025)
Dejia Xu, Yifan Jiang, Chen Huang, et al.
Liangchen Song, Thorsten Gernoth, Liangliang Cao, Zhangyang Wang, Hao Tang -
Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training (30 Mar 2025)
Zhenghong Zhou, Jie An, Jiebo Luo
-
CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models (30 Mar 2025)
Hao He, Ceyuan Yang, Shanchuan Lin, et al.
Yinghao Xu, Meng Wei, Liangke Gui, Qi Zhao, Gordon Wetzstein, Lu Jiang, Hongsheng Li
-
Direct-a-Video: Customized Video Generation with User-Directed Camera Movement and Object Motion οΌ6 May 2024οΌ
Shiyuan Yang, Liang Hou, Haibin Huang, et al.
Shiyuan Yang, Liang Hou, Haibin Huang, Chongyang Ma, Pengfei Wan, Di Zhang, Xiaodong Chen, Jing Liao -
TrailBlazer: Trajectory Control for Diffusion-Based Video Generation(Both are based on T2V, not I2V.)οΌ8 Apr 2024οΌ
Wan-Duo Kurt Ma, J.P. Lewis, W. Bastiaan Kleijn, et al.
Wan-Duo Kurt Ma, J.P. Lewis, W. Bastiaan Kleijn -
Freetraj: Tuning-free trajectory control in video diffusion models(T2V) οΌ24 Jun 2024οΌ
Haonan Qiu, Zhaoxi Chen, Zhouxia Wang, et al.
Haonan Qiu, Zhaoxi Chen, Zhouxia Wang, Yingqing He, Menghan Xia, Ziwei Liu -
Peekaboo: Interactive video generation via masked-diffusion(T2V) οΌ19 Apr 2024οΌ
Yash Jain, Anshul Nasery, Vibhav Vineet, et al.
Yash Jain, Anshul Nasery, Vibhav Vineet, Harkirat Behl -
MotionBooth: Motion-Aware Customized Text-to-Video GenerationοΌ29 Oct 2024οΌ
Jianzong Wu, Xiangtai Li, Yanhong Zeng, et al.
Jianzong Wu, Xiangtai Li, Yanhong Zeng, Jiangning Zhang, Qianyu Zhou, Yining Li, Yunhai Tong, Kai Chen -
Collaborative video diffusion: Consistent multi-video generation with camera control(27 May 2024)
Zhengfei Kuang, Shengqu Cai, Hao He, et al.
Zhengfei Kuang, Shengqu Cai, Hao He, Yinghao Xu, Hongsheng Li, Leonidas Guibas, Gordon Wetzstein -
Tora: Trajectory-oriented Diffusion Transformer for Video Generation (14 Mar 2025)
Zhenghao Zhang, Junchao Liao, Menghao Li, et al.
Zhenghao Zhang, Junchao Liao, Menghao Li, ZuoZhuo Dai, Bingxue Qiu, Siyu Zhu, Long Qin, Weizhi Wang -
Motion-Zero: A Zero-Shot Trajectory Control Framework of Moving Object (08 Jan 2025)
Changgu Chen, Junwei Shu, Gaoqi He, et al.
Changgu Chen, Junwei Shu, Gaoqi He, Changbo Wang, Yang Li -
VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control (22 Mar 2025)
Sherwin Bahmani, Ivan Skorokhodov, Aliaksandr Siarohin, et al.
Sherwin Bahmani, Ivan Skorokhodov, Aliaksandr Siarohin, Willi Menapace, Guocheng Qian, Michael Vasilkovsky, Hsin-Ying Lee, Chaoyang Wang, Jiaxu Zou, Andrea Tagliasacchi, David B. Lindell, Sergey Tulyakov -
Controllable Video Generation With Sparse Trajectories (2018)
Zekun Hao, Xun Huang, Serge Belongie, et al.
Zekun Hao, Xun Huang, Serge Belongie -
MagicMotion: Controllable Video Generation with Dense-to-Sparse Trajectory Guidance(20 Mar 2025)
Quanhao Li, Zhen Xing, Rui Wang, et al.
Quanhao Li, Zhen Xing, Rui Wang, Hui Zhang, Qi Dai, Zuxuan Wu -
MotionCanvas: Cinematic Shot Design with Controllable Image-to-Video Generation (6 Feb 2025)
Jinbo Xing, Long Mai, Cusuh Ham, et al.
Jinbo Xing, Long Mai, Cusuh Ham, Jiahui Huang, Aniruddha Mahapatra, Chi-Wing Fu, Tien-Tsin Wong, Feng Liu
-
MotionMatcher: Motion Customization of Text-to-Video Diffusion Models via Motion Feature Matching (18 Feb 2025)
Yen-Siang Wu, Chi-Pin Huang, Fu-En Yang, et al.
Yen-Siang Wu, Chi-Pin Huang, Fu-En Yang, Yu-Chiang Frank Wang -
SST-EM: Advanced Metrics for Evaluating Semantic, Spatial and Temporal Aspects in Video Editing (13 Jan 2025)
Varun Biyyala, Bharat Chanderprakash Kathuria, Jialu Li, et al.
Varun Biyyala, Bharat Chanderprakash Kathuria, Jialu Li, and Youshan Zhang -
MOTIONCLONE: TRAINING-FREE MOTION CLONING FOR CONTROLLABLE VIDEO GENERATION (22 Oct 2024)
Pengyang Ling, Jiazi Bu, Pan Zhang, et al.
Pengyang Ling, Jiazi Bu, Pan Zhang, Xiaoyi Dong, Yuhang Zang, Tong Wu, Huaian Chen, Jiaqi Wang, Yi Jin -
Video Diffusion Models are Training-free Motion Interpreter and Controller (12 Nov 2024)
Zeqi Xiao, Yifan Zhou, Shuai Yang, et al.
Zeqi Xiao, Yifan Zhou, Shuai Yang, Xingang Pan -
OnlyFlow: Optical Flow based Motion Conditioning for Video Diffusion ModelsOnlyFlow: Optical Flow based Motion Conditioning for Video Diffusion Models(15 Nov 2024 )
Mathis Koroglu, Hugo Caselles-DuprΓ©, Guillaume Jeanneret Sanmiguel, et al.
Mathis Koroglu, Hugo Caselles-DuprΓ©, Guillaume Jeanneret Sanmiguel -
Customize-A-Video: One-Shot Motion Customization of Text-to-Video Diffusion Models(28 Aug 2024)
Yixuan Ren, Yang Zhou, Jimei Yang, et al.
Yixuan Ren, Yang Zhou, Jimei Yang, Jing Shi, Difan Liu, Feng Liu, Mingi Kwon, Abhinav Shrivastava -
MotionDirector: Motion Customization for Text-to-Video Diffusion Models (12 Oct 2023)
Rui Zhao, Yuchao Gu, Jay Zhangjie Wu, et al.
Rui Zhao, Yuchao Gu, Jay Zhangjie Wu, David Junhao Zhang, Jia-Wei Liu, Weijia Wu, Jussi Keppo, and Mike Zheng Shou -
VMC: Video Motion Customization with Pre-trained Diffusion Models (1 Dec 2023)
Hyeonho Jeong, Geon Yeong Park, Jong Chul Ye, et al.
Hyeonho Jeong, Geon Yeong Park, Jong Chul Ye -
AnimateAnything (MomtionMask) (2023)
Guojun Lei, Chi Wang, Hong Li, et al.
Guojun Lei, Chi Wang, Hong Li, Rong Zhang, Yikai Wang, Weiwei Xu219
-
MotionAgent: Fine-grained Controllable Video Generation via Motion Field Agent(5 Feb 2025)
Xinyao Liao, Xianfang Zeng, Liao Wang
Xinyao Liao, Xianfang Zeng, Liao Wang, Gang Yu, Guosheng Lin, Chi Zhang -
Motionbooth: Motion-aware customized text-to-video generation(29 Oct 2024)
Jianzong Wu, Xiangtai Li, Yanhong Zeng, et al.
Jianzong Wu, Xiangtai Li, Yanhong Zeng, Jiangning Zhang, Qianyu Zhou, Yining Li, Yunhai Tong, Kai Chen -
Motion Prompting: Controlling Video Generation with Motion Trajectories (27 Mar 2025)
Daniel Geng, Charles Herrmann, Junhwa Hur, et al.
Daniel Geng, Charles Herrmann, Junhwa Hur, Forrester Cole, Serena Zhang, Tobias Pfaff, Tatiana Lopez-Guevara, Carl Doersch, Yusuf Aytar, Michael Rubinstein, Chen Sun, Oliver Wang, Andrew Owens, Deqing Sun -
Video Motion Transfer with Diffusion Transformers(27 Mar 2025)
Alexander Pondaven, Aliaksandr Siarohin, Sergey Tulyakov, et al.
Alexander Pondaven, Aliaksandr Siarohin, Sergey Tulyakov, Philip Torr, Fabio Pizzati
-
MOTION INVERSION FOR VIDEO CUSTOMIZATION1(16 Oct 2024)
Luozhou Wang, Ziyang Mai, Guibao Shen, et al.
Luozhou Wang, Ziyang Mai, Guibao Shen, Yixun Liang, Xin Tao, Pengfei Wan, Di Zhang, Yijun Li, Yingcong Chen -
Space-Time Diffusion Features for Zero-Shot Text-Driven Motion Transfer (3 Dec 2023)
Danah Yatim, Rafail Fridman, Omer Bar-Tal, et al.
Danah Yatim, Rafail Fridman, Omer Bar-Tal, Yoni Kasten, Tali Dekel -
Spectral Motion Alignment for Video Motion Transfer using Diffusion Models (19 Dec 2024)
Alexander Pondaven, Aliaksandr Siarohin, Sergey Tulyakov, et al.
Alexander Pondaven, Aliaksandr Siarohin, Sergey Tulyakov, Philip Torr, Fabio Pizzati -
MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models (2 Dec 2024)
Xiaomin Li, Xu Jia, Qinghe Wang, et al.
Xiaomin Li, Xu Jia, Qinghe Wang -
DreamMotion: Space-Time Self-Similar Score Distillation for Zero-Shot Video Editing (15 Jul 2024)
Hyeonho Jeong, Jinho Chang, Geon Yeong Park, et al.
Hyeonho Jeong, Jinho Chang, Geon Yeong Park, and Jong Chul Ye -
DreamRelation: Relation-Centric Video Customization(10 Mar 2025)
Yujie Wei, Shiwei Zhang, Hangjie Yuan, et al.
Yujie Wei, Shiwei Zhang, Hangjie Yuan, Biao Gong, Longxiang Tang, Xiang Wang, Haonan Qiu, Hengjia Li, Shuai Tan, Yingya Zhang, Hongming Shan -
Training-Free Motion-Guided Video Generation with Enhanced Temporal Consistency Using Motion Consistency LossοΌ13 Jan 2025οΌ
Xinyu Zhang, Zicheng Duan, Dong Gong, et al.
Xinyu Zhang, Zicheng Duan, Dong Gong, Lingqiao Liu -
DreamVideo: Composing Your Dream Videos with Customized Subject and Motion(ε―δ»₯single motion vediosεmultiple vedios) οΌ7 Dec 2023οΌ
Yujie Wei, Shiwei Zhang, Zhiwu Qing
Yujie Wei, Shiwei Zhang, Zhiwu Qing, Hangjie Yuan, Zhiheng Liu, Yu Liu, Yingya Zhang, Jingren Zhou, Hongming Shan -
Perception-as-Control: Fine-grained Controllable Image Animation with 3D-aware Motion Representation οΌ7 Dec 2023οΌ
Yingjie Chen, Yifang Men, Yuan Yao, et al.
Yingjie Chen, Yifang Men, Yuan Yao, Miaomiao Cui, Liefeng Bo -
InterDyn: Controllable Interactive Dynamics with Video Diffusion Models (hand mask sequence as control signal) οΌ4 Apr 2025οΌ
Rick Akkerman, Haiwen Feng, Michael J. Black, et al.
Rick Akkerman, Haiwen Feng, Michael J. Black, Dimitrios Tzionas, Victoria FernΒ΄andez Abrevaya -
LHM: Large Animatable Human Reconstruction Model for Single Image to 3D in SecondsοΌ13 Mar 2025οΌ
Lingteng Qiu, Xiaodong Gu, Peihao Li, et al.
Lingteng Qiu, Xiaodong Gu, Peihao Li, Qi Zuo, Weichao Shen, Junfei Zhang, Kejie Qiu, Weihao Yuan, Guanying Chen, Zilong Dong, Liefeng Bo -
MagicMotion: Controllable Video Generation with Dense-to-Sparse Trajectory Guidance οΌ20 Mar 2025οΌ
Quanhao Li, Zhen Xing, Rui Wang, et al.
Quanhao Li, Zhen Xing, Rui Wang,βHui Zhang, Qi Dai, Zuxuan Wu -
Diffusion as Shader: 3D-aware Video Diffusion for Versatile Video Generation Control οΌ9 Jan 2025οΌ
Zekai Gu, Rui Yan, Jiahao Lu, et al.
Zekai Gu, Rui Yan, Jiahao Lu, Peng Li, Zhiyang Dou, Chenyang Si, Zhen Dong, Qifeng Liu, Cheng Lin, Ziwei Liu, Wenping Wang, Yuan Liu -
Zero-Shot Controllable Image-to-Video Animation via Motion Decomposition
Alexander Pondaven, Aliaksandr Siarohin, Sergey Tulyakov, et al.
Alexander Pondaven, Aliaksandr Siarohin, Sergey Tulyakov, Philip Torr, Fabio Pizzati
-
Make It Move: Controllable Image-to-Video Generation With Text Descriptions (31 Mar 2022)
[CVPR 2022] Yaosi Hu, Chong Luo, Zhenzhong Chen
-
Prompt Image to Life: Training-Free Text-Driven Image-to-Video Generation (2023)
Jinxiu Liu, Yuan Yao, Bingwen Zhu, et al.
Fanyi Wang, Weijian Luo, Jingwen Su, Yanhao Zhang, Yuxiao Wang, Liyuan Ma, Qi Liu, Jiebo Luo, Guo-Jun Qi -
LaMD: Latent Motion Diffusion for Video Generation (23 Apr 2023)
Yaosi Hu, Zhenzhong Chen, Chong Luo
-
VideoDoodles: Hand-Drawn Animations on Videos with Scene-Aware Canvases (26 July 2023)
[ACM Transactions on Graphics] Emilie Yu, Kevin Blackburn-Matzen, Cuong Nguyen, et al.
Oliver Wang, Rubaiat Habib Kazi, Adrien Bousseau -
Synthesizing Videos from Images for Image-to-Video Adaptation (27 Oct 2023)
[ACM MM 2023] Junbao Zhuo, Xingyu Zhao, Shuhui Wang, et al.
Huimin Ma, Qingming Huang -
VideoCrafter1: Open Diffusion Models for High-Quality Video Generation (30 Oct 2023)
Haoxin Chen, Menghan Xia, Yingqing He, et al.
Yong Zhang, Xiaodong Cun, Shaoshu Yang, Jinbo Xing, Yaofang Liu, Qifeng Chen, Xintao Wang, Chao Weng, Ying Shan -
I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models (7 Nov 2023)
Shiwei Zhang, Jiayu Wang, Yingya Zhang, et al.
Kang Zhao, Hangjie Yuan, Zhiwu Qin, Xiang Wang, Deli Zhao, Jingren Zhou -
Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets (25 Nov 2023)
Andreas Blattmann, Tim Dockhorn, Sumith Kulal, et al.
Daniel Mendelevitch, Maciej Kilian, Dominik Lorenz, Yam Levi, Zion English, Vikram Voleti, Adam Letts, Varun Jampani, Robin Rombach -
AnimateAnything: Fine-Grained Open Domain Image Animation with Motion Guidance (4 Dec 2023)
[TMLR 2024] Zuozhuo Dai, Zhenghao Zhang, Yao Yao, et al.
Bingxue Qiu, Siyu Zhu, Long Qin, Weizhi Wang -
Decouple Content and Motion for Conditional Image-to-Video Generation (14 Dec 2023)
[AAAI 2024] Cuifeng Shen, Yulu Gan, Chen Chen, et al.
Xiongwei Zhu, Lele Cheng, Tingting Gao, Jinzhi Wang -
UniVG: Towards UNIfied-modal Video Generation (17 Jan 2024)
Ludan Ruan, Lei Tian, Chuanwei Huang, et al.
Xu Zhang, Xinyan Xiao -
Motion-i2v: Consistent and controllable image-to-video generation with explicit motion modeling (31 Jan 2024)
[ACM SIGGRAPH 2024] Xiaoyu Shi, Zhaoyang Huang, Fu-Yun Wang, et al.
Weikang Bian, Dasong Li, Yi Zhang, Manyuan Zhang, Ka Chun Cheung, Simon See, Hongwei Qin, Jifeng Dai, Hongsheng Li -
Tuning-Free Noise Rectification for High Fidelity Image-to-Video Generation (5 Mar 2024)
Weijie Li, Litong Gong, Yiran Zhu, et al.
Fanda Fan, Biao Wang, Tiezheng Ge, Bo Zheng -
AtomoVideo: High Fidelity Image-to-Video Generation (5 Mar 2024)
Litong Gong, Yiran Zhu, Weijie Li, et al.
Xiaoyang Kang, Biao Wang, Tiezheng Ge, Bo Zheng -
Follow-Your-Click: Open-domain Regional Image Animation via Short Prompts (13 Mar 2024)
Yue Ma, Yingqing He, Hongfa Wang, et al.
Andong Wang, Chenyang Qi, Chengfei Cai, Xiu Li, Zhifeng Li, Heung-Yeung Shum, Wei Liu, Qifeng Chen -
TRIP: Temporal Residual Learning with Image Noise Prior for Image-to-Video Diffusion Models (25 Mar 2024)
[CVPR 2024] Zhongwei Zhang, Fuchen Long, Yingwei Pan, et al.
Zhaofan Qiu, Ting Yao, Yang Cao, Tao Mei -
TI2V-Zero: Zero-Shot Image Conditioning for Text-to-Video Diffusion Models (25 Apr 2024)
[CVPR 2024] Haomiao Ni, Bernhard Egger, Suhas Lohit, et al.
Anoop Cherian, Ye Wang, Toshiaki Koike-Akino, Sharon X. Huang, Tim K. Marks -
AID: Adapting Image2Video Diffusion Models for Instruction-guided Video Prediction (10 Jun 2024)
Zhen Xing, Qi Dai, Zejia Weng, et al.
Zuxuan Wu, Yu-Gang Jiang -
OmniTokenizer: A Joint Image-Video Tokenizer for Visual Generation (13 Jun 2024)
[NeurIPS 2024] Junke Wang, Yi Jiang, Zehuan Yuan, et al.
Binyue Peng, Zuxuan Wu, Yu-Gang Jiang -
ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation (1 Jul 2024)
[TMLR 2024] Weiming Ren, Huan Yang, Ge Zhang, et al.
Cong Wei, Xinrun Du, Wenhao Huang, Wenhu Chen -
EasyAnimate: A High-Performance Long Video Generation Method based on Transformer Architecture (5 Jul 2024)
Jiaqi Xu, Xinyi Zou, Kunzhe Huang, et al.
Yunkuo Chen, Bo Liu, MengLi Cheng, Xing Shi, Jun Huang -
I2V-Adapter: A General Image-to-Video Adapter for Diffusion Models (13 July 2024)
[ACM SIGGRAPH 2024] Xun Guo1, Mingwu Zheng, Liang Hou, et al.
Yuan Gao, Yufan Deng, Pengfei Wan, Di Zhang, Yufan Liu, Weiming Hu, Zhengjun Zha, Haibin Huang, Chongyang Ma -
MoVideo: Motion-Aware Video Generation with Diffusion Model (29 Jul 2024)
[ECCV 2024] Jingyun Liang, Yuchen Fan, Kai Zhang, et al.
Radu Timofte, Luc Van Gool, Rakesh Ranjan -
Emu Video: Factorizing Text-to-Video Generation by Explicit Image Conditioning (2 Aug 2024)
[ECCV 2024] Rohit Girdhar, Mannat Singh, Andrew Brown, et al.
Quentin Duval, Samaneh Azadi, Sai Saketh Rambhatla, Akbar Shah, Xi Yin, Devi Parikh, Ishan Misra -
DreamVideo: High-Fidelity Image-to-Video Generation with Image Retention and Text Guidance (16 Sep 2024)
[ICASSP 2025] Cong Wang, Jiaxi Gu, Panwen Hu, et al.
Songcen Xu, Hang Xu, Xiaodan Liang -
Structure and Content-Guided Video Synthesis with Diffusion Models (27 Sep 2024)
[ICCV 2023] Patrick Esser, Johnathan Chiu, Parmida Atighehchian, et al.
Jonathan Granskog, Anastasis Germanidis -
PhysGen: Rigid-Body Physics-Grounded Image-to-Video Generation (27 Sep 2024)
[ECCV 2024] Shaowei Liu, Zhongzheng Ren, Saurabh Gupta, et al.
Shenlong Wang -
DynamiCrafter: Animating Open-Domain Images with Video Diffusion Priors (1 Oct 2024)
[ECCV 2024] Jinbo Xing, Menghan Xia, Yong Zhang, et al.
Haoxin Chen, Wangbo Yu, Hanyuan Liu, Gongye Liu, Xintao Wang, Ying Shan, Tien-Tsin Wong -
I4VGen: Image as Free Stepping Stone for Text-to-Video Generation (3 Oct 2024)
Xiefan Guo, Jinlin Liu, Miaomiao Cui, et al.
Liefeng Bo, Di Huang -
FrameBridge: Improving Image-to-Video Generation with Bridge Models (20 Oct 2024)
Yuji Wang, Zehua Chen, Xiaoyu Chen, et al.
Jun Zhu, Jianfei Chen -
Identifying and Solving Conditional Image Leakage in Image-to-Video Diffusion Model (6 Nov 2024)
[NeurIPS 2024] Min Zhao, Hongzhou Zhu, Chendong Xiang, et al.
Kaiwen Zheng, Chongxuan Li, Jun Zhu -
Lumiere: A Space-Time Diffusion Model for Video Generation (3 Dec 2024)
[SIGGRAPH Asia 2024] Omer Bar-Tal, Hila Chefer, Omer Tov, et al.
Charles Herrmann, Roni Paiss, Shiran Zada, Ariel Ephrat, Junhwa Hur, Guanghui Liu, Amit Raj, Yuanzhen Li, Michael Rubinstein, Tomer Michaeli, Oliver Wang, Deqing Sun, Tali Dekel, Inbar Mosseri -
MotionStone: Decoupled Motion Intensity Modulation with Diffusion Transformer for Image-to-Video Generation (8 Dec 2024)
Shuwei Shi, Biao Gong, Xi Chen, et al.
Dandan Zheng, Shuai Tan, Zizheng Yang, Yuyuan Li, Jingwen He, Kecheng Zheng, Jingdong Chen, Ming Yang, Yinqiang Zheng -
STIV: Scalable Text and Image Conditioned Video Generation (10 Dec 2024)
Zongyu Lin, Wei Liu, Chen Chen, et al.
Jiasen Lu, Wenze Hu, Tsu-Jui Fu, Jesse Allardice, Zhengfeng Lai, Liangchen Song, Bowen Zhang, Cha Chen, Yiran Fei, Yifan Jiang, Lezhi Li, Yizhou Sun, Kai-Wei Chang, Yinfei Yang -
Through-The-Mask: Mask-based Motion Trajectories for Image-to-Video Generation (6 Jan 2025)
[CVPR 2025] Guy Yariv, Yuval Kirstain, Amit Zohar, et al.
Shelly Sheynin, Yaniv Taigman, Yossi Adi, Sagie Benaim, Adam Polyak -
Autoregressive Video Generation without Vector Quantization (9 Jan 2025)
[ICLR 2025] Haoge Deng, Ting Pan, Haiwen Diao, et al.
Zhengxiong Luo, Yufeng Cui, Huchuan Lu, Shiguang Shan, Yonggang Qi, Xinlong Wang -
Generative Inbetweening: Adapting Image-to-Video Models for Keyframe Interpolation (12 Feb 2025)
[ICLR 2025] Xiaojuan Wang, Boyang Zhou, Brian Curless, et al.
Ira Kemelmacher-Shlizerman, Aleksander Holynski, Steven M. Seitz -
Adapting Image-to-Video Diffusion Models for Large-Motion Frame Interpolation (17 Feb 2025)
Luoxu Jin, Hiroshi Watanabe
-
Extrapolating and Decoupling Image-to-Video Generation Models: Motion Modeling is Easier Than You Think (2 Mar 2025)
[CVPR 2025] Jie Tian, Xiaoye Qu, Zhenyi Lu, et al.
Wei Wei, Sichen Liu, Yu Cheng -
HunyuanVideo: A Systematic Framework For Large Video Generative Models (11 Mar 2025)
Weijie Kong, Qi Tian, Zijian Zhang, et al.
Rox Min, Zuozhuo Dai, Jin Zhou, Jiangfeng Xiong, Xin Li, Bo Wu, Jianwei Zhang, Kathrina Wu, Qin Lin, Junkun Yuan, Yanxin Long, Aladdin Wang, Andong Wang, Changlin Li, Duojun Huang, Fang Yang, Hao Tan, Hongmei Wang, Jacob Song, Jiawang Bai, Jianbing Wu, Jinbao Xue, Joey Wang, Kai Wang, Mengyang Liu, Pengyu Li, Shuai Li, Weiyan Wang, Wenqing Yu, Xinchi Deng, Yang Li, Yi Chen, Yutao Cui, Yuanbo Peng, Zhentao Yu, Zhiyu He, Zhiyong Xu, Zixiang Zhou, Zunnan Xu, Yangyu Tao, Qinglin Lu, Songtao Liu, Dax Zhou, Hongfa Wang, Yong Yang, Di Wang, Yuhong Liu, Jie Jiang, Caesar Zhong
-
οΌECCV 22) Sound-Guided Semantic Video Generation (20 Apr 2022)
Seung Hyun Lee, Gyeongrok Oh, Wonmin Byeon, et al.
Seung Hyun Lee, Gyeongrok Oh, Wonmin Byeon, Chanyoung Kim, Won Jeong Ryoo, Sang Ho Yoon, Hyunjun Cho, Jihyun Bae, Jinkyu Kim, Sangpil Kim -
οΌECCV 20) Sound2Sight: Generating Visual Dynamics from Sound and Context (23 Jul 2020)
Anoop Cherian, Moitreya Chatterjee, Narendra Ahuja
Anoop Cherian, Moitreya Chatterjee, Narendra Ahuja
-
AV-Link: Temporally-Aligned Diffusion Features for Cross-Modal Audio-Video Generation (19 Dec 2024)
Moayed Haji-Ali, Willi Menapace, Aliaksandr Siarohin, et al.
Moayed Haji-Ali, Willi Menapace, Aliaksandr Siarohin, Ivan Skorokhodov, Alper Canberk, Kwot Sin Lee, Vicente Ordonez, Sergey Tulyakov -
(AAAI 24) Diverse and Aligned Audio-to-Video Generation via Text-to-Video Model Adaptation (28 Sep 2023)
Guy Yariv, Itai Gat, Sagie Benaim, et al.
Guy Yariv, Itai Gat, Sagie Benaim, Lior Wolf, Idan Schwartz, Yossi Adi -
(ECCV 24) MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model (30 May 2024)
Muyao Niu, Xiaodong Cun, Xintao Wang, et al.
Muyao Niu, Xiaodong Cun, Xintao Wang, Yong Zhang, Ying Shan, Yinqiang Zheng -
(TMM) Ta2v: Text-audio guided video generation (01 Jan 2024)
Minglu Zhao, Wenmin Wang, Tongbao Chen, et al.
Minglu Zhao, Wenmin Wang, Tongbao Chen, Rui Zhang, Ruochen Li -
(ECCV 24) Audio-Synchronized Visual Animation (08 Mar 2024)
Lin Zhang, Shentong Mo, Yijing Zhang, et al.
Lin Zhang, Shentong Mo, Yijing Zhang, Pedro Morgado -
(ECCV 24) MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model (30 May 2024)
Muyao Niu, Xiaodong Cun, Xintao Wang, et al.
Muyao Niu, Xiaodong Cun, Xintao Wang, Yong Zhang, Ying Shan, Yinqiang Zheng
-
Multi-object Video Generation from Single Frame Layouts (06 May 2023)
Yang Wu, Zhibin Liu, Hefeng Wu, et al.
Yang Wu, Zhibin Liu, Hefeng Wu, Liang Lin -
οΌICLR 24) LLM-grounded Video Diffusion Models (29 Sep 2023)
Long Lian, Baifeng Shi, Adam Yala, et al.
Long Lian, Baifeng Shi, Adam Yala, Trevor Darrell, Boyi Li -
DriveDreamer: Towards Real-world-driven World Models for Autonomous Driving (18 Sep 2023)
Xiaofeng Wang, Zheng Zhu, Guan Huang, et al.
Xiaofeng Wang, Zheng Zhu, Guan Huang, Xinze Chen, Jiagang Zhu, Jiwen Lu -
DrivingDiffusion: Layout-Guided multi-view driving scene video generation with latent diffusion model (11 Oct 2023)
Xiaofan Li, Yifu Zhang, Xiaoqing Ye
Xiaofan Li, Yifu Zhang, Xiaoqing Ye -
FlowZero: Zero-Shot Text-to-Video Synthesis with LLM-Driven Dynamic Scene Syntax (27 Nov 2023)
Yu Lu, Linchao Zhu, Hehe Fan, et al.
Yu Lu, Linchao Zhu, Hehe Fan, Yi Yang -
Panacea: Panoramic and Controllable Video Generation for Autonomous Driving (28 Nov 2023)
Yuqing Wen, Yucheng Zhao, Yingfei Liu, et al.
Yuqing Wen, Yucheng Zhao, Yingfei Liu, Fan Jia, Yanhui Wang, Chong Luo, Chi Zhang, Tiancai Wang, Xiaoyan Sun, Xiangyu Zhang -
TrackDiffusion: Tracklet-Conditioned Video Generation via Diffusion Models (01 Dec 2023)
Pengxiang Li, Kai Chen, Zhili Liu, et al.
Pengxiang Li, Kai Chen, Zhili Liu, Ruiyuan Gao, Lanqing Hong, Guo Zhou, Hua Yao, Dit-Yan Yeung, Huchuan Lu, Xu Jia -
Unleashing Generalization of End-to-End Autonomous Driving with Controllable Long Video Generation (03 Jun 2024)
Enhui Ma, Lijun Zhou, Tao Tang, et al.
Enhui Ma, Lijun Zhou, Tao Tang, Zhan Zhang, Dong Han, Junpeng Jiang, Kun Zhan, Peng Jia, Xianpeng Lang, Haiyang Sun, Di Lin, Kaicheng Yu -
DiVE: DiT-based Video Generation with Enhanced Control (03 Sep 2024)
Junpeng Jiang, Gangyi Hong, Lijun Zhou, et al.
Junpeng Jiang, Gangyi Hong, Lijun Zhou, Enhui Ma, Hengtong Hu, Xia Zhou, Jie Xiang, Fan Liu, Kaicheng Yu, Haiyang Sun, Kun Zhan, Peng Jia, Miao Zhang -
DreamForge: Motion-Aware Autoregressive Video Generation for Multi-View Driving Scenes (06 Sep 2024)
Jianbiao Mei, Tao Hu, Xuemeng Yang, et al.
Jianbiao Mei, Tao Hu, Xuemeng Yang, Licheng Wen, Yu Yang, Tiantian Wei, Yukai Ma, Min Dou, Botian Shi, Yong Liu -
DriveScape: Towards High-Resolution Controllable Multi-View Driving Video Generation (09 Sep 2024)
Wei Wu, Xi Guo, Weixuan Tang, et al.
Wei Wu, Xi Guo, Weixuan Tang, Tingxuan Huang, Chiyu Wang, Dongyue Chen, Chenjing Ding -
HoloDrive: Holistic 2D-3D Multi-Modal Street Scene Generation for Autonomous Driving (02 Dec 2024)
Zehuan Wu, Jingcheng Ni, Xiaodong Wang, et al.
Zehuan Wu, Jingcheng Ni, Xiaodong Wang, Yuxin Guo, Rui Chen, Lewei Lu, Jifeng Dai, Yuwen Xiong
-
Sketching the Future (STF): Applying Conditional Control Techniques to Text-to-Video Models (10 May 2023)
Rohan Dhesikan, Vignesh Rajmohan
-
SparseCtrl: Adding Sparse Controls to Text-to-Video Diffusion Models (28 Nov 2023)
Yuwei Guo, Ceyuan Yang, Anyi Rao, et al.
Maneesh Agrawala, Dahua Lin, Bo Dai -
EasyControl: Transfer ControlNet to Video Diffusion for Controllable Generation and Interpolation (16 Sep 2024)
Cong Wang, Jiaxi Gu, Panwen Hu, et al.
Haoyu Zhao, Yuanfan Guo, Jianhua Han, Hang Xu, Xiaodan Liang -
VidSketch: Hand-drawn Sketch-Driven Video Generation with Diffusion Control (17 Feb 2025)
Lifan Jiang, Shuang Chen, Boxi Wu, et al.
Xiaotong Guan, Jiahui Zhang -
A Recipe for Scaling up Text-to-Video Generation with Text-free Videos (25 Dec 2023)
[CVPR 2024] Xiang Wang, Shiwei Zhang, Hangjie Yuan, et al.
Zhiwu Qing, Biao Gong, Yingya Zhang, Yujun Shen, Changxin Gao, Nong Sang -
Make Pixels Dance: High-Dynamic Video Generation (18 Nov 2023)
[CVPR 2024] Yan Zeng, Guoqiang Wei, Jiani Zheng, et al.
Jiaxin Zou, Yang Wei, Yuchen Zhang, Hang Li -
LVCD: Reference-based Lineart Video Colorization with Diffusion Models (19 Sep 2024)
[ACM TOG and SIGGRAPH Asia 2024] Zhitong Huang, Mohan Zhang, Jing Liao
-
MotionClone: Training-Free Motion Cloning for Controllable Video Generation (22 Oct 2024)
Pengyang Ling, Jiazi Bu, Pan Zhang, et al.
Xiaoyi Dong, Yuhang Zang, Tong Wu, Huaian Chen, Jiaqi Wang, Yi Jin -
VideoLCM: Video Latent Consistency Model (14 Dec 2023)
Xiang Wang, Shiwei Zhang, Han Zhang, et al.
Yu Liu, Yingya Zhang, Changxin Gao, Nong Sang -
Open-Sora Plan: Open-Source Large Video Generation Model (28 Nov 2024)
Bin Lin, Yunyang Ge, Xinhua Cheng, et al.
Zongjian Li, Bin Zhu, Shaodong Wang, Xianyi He, Yang Ye, Shenghai Yuan, Liuhan Chen, Tanghui Jia, Junwu Zhang, Zhenyu Tang, Yatian Pang, Bin She, Cen Yan, Zhiheng Hu, Xiaoyi Dong, Lin Chen, Zhang Pan, Xing Zhou, Shaoling Dong, Yonghong Tian, Li Yuan -
CameraCtrl: Enabling Camera Control for Text-to-Video Generation (13 Mar 2025)
[ICLR 2025] Hao He, Yinghao Xu, Yuwei Guo, et al.
Gordon Wetzstein, Bo Dai, Hongsheng Li, Ceyuan Yang -
ToonCrafter: Generative Cartoon Interpolation (19 Nov 2024)
[ACM TOG] Jinbo Xing, Hanyuan Liu, Menghan Xia, et al.
Yong Zhang, Xintao Wang, Ying Shan, Tien-Tsin Wong -
MagicStick: Controllable Video Editing via Control Handle Transformations (18 Nov 2024)
[WACV 2025] Yue Ma, Xiaodong Cun, Sen Liang, et al.
Jinbo Xing, Yingqing He, Chenyang Qi, Siran Chen, Qifeng Chen -
AniDoc: Animation Creation Made Easier (30 Jan 2025)
[CVPR 2025] Yihao Meng, Hao Ouyang, Hanlin Wang, et al.
Qiuyu Wang, Wen Wang, Ka Leong Cheng, Zhiheng Liu, Yujun Shen, Huamin Qu -
TaleCrafter: Interactive Story Visualization with Multiple Characters (30 May 2023)
[SIGGRAPH Asia 2023] Yuan Gong, Youxin Pang, Xiaodong Cun, et al.
Menghan Xia, Yingqing He, Haoxin Chen, Longyue Wang, Yong Zhang, Xintao Wang, Ying Shan, Yujiu Yang -
Ctrl-Adapter: An Efficient and Versatile Framework for Adapting Diverse Controls to Any Diffusion Model (24 May 2024)
[ICLR 2025] Han Lin, Jaemin Cho, Abhay Zala, et al.
Mohit Bansal
-
Boximator: Generating Rich and Controllable Motions for Video SynthesisοΌ2 Feb 2024οΌ
Jiawei Wang, Yuchen Zhang, Jiaxin Zou, et al.
Yan Zeng, Guoqiang Wei, Liping Yuan, Hang Li -
Motion-I2V: Consistent and Controllable Image-to-Video Generation with Explicit Motion Modeling οΌ31 Jan 2024οΌ
Xiaoyu Shi, Zhaoyang Huang, Fu-Yun Wang, et al.
Weikang Bian, Dasong Li, Yi Zhang, Manyuan Zhang, Ka Chun Cheung, Simon See, Hongwei Qin, Jifeng Dai, Hongsheng Li -
DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory οΌ16 Aug 2023οΌ
Shengming Yin, Chenfei Wu, Jian Liang, et al.
Jie Shi, Houqiang Li, Gong Ming, Nan Duan -
[MCDiff] Motion-Conditioned Diffusion Model for Controllable Video SynthesisοΌ27 Apr 2023οΌ
Haitao Zhou, Chuang Wang, Rui Nie, et al.
Jinlin Liu, Dongdong Yu, Qian Yu, Changhu Wang -
SG-I2V: Self-Guided Trajectory Control in Image-to-Video Generation οΌ25 Feb 2025οΌ
Koichi Namekata, Sherwin Bahmani, Ziyi Wu, et al.
Yash Kant, Igor Gilitschenski, David B. Lindell -
Draganything: Motion control for anything using entity representation οΌ15 Mar 2024οΌ
Weijia Wu, Zhuang Li, Yuchao Gu, et al.
Rui Zhao, Yefei He, David Junhao Zhang, Mike Zheng Shou, Yan Li, Tingting Gao, Di Zhang -
TrackGo: A Flexible and Efficient Method for Controllable Video Generation οΌ5 Jan 2025οΌ
Haitao Zhou, Chuang Wang, Rui Nie, et al.
Jinlin Liu, Dongdong Yu, Qian Yu, Changhu Wang -
Motion Prompting: Controlling Video Generation with Motion Trajectories οΌ03 Dec 2024οΌ
[CVPR 2025 (Oral)] Daniel Geng, Charles Herrmann, Junhwa Hur, et al.
Forrester Cole, Serena Zhang, Tobias Pfaff, Tatiana Lopez-Guevara, Carl Doersch, Yusuf Aytar, Michael Rubinstein, Chen Sun, Oliver Wang, Andrew Owens, Deqing Sun -
InTraGen: Trajectory-controlled Video Generation for Object Interactions οΌ25 Nov 2024οΌ
Zuhao Liu, Aleksandar Yanev, Ahmad Mahmood, et al.
Ivan Nikolov, Saman Motamed, Wei-Shi Zheng, Xi Wang, Luc Van Gool, Danda Pani Paudel -
ReVideo: Remake a Video with Motion and ContentοΌ22 May 2024οΌ
Zuhao Liu, Aleksandar Yanev, Ahmad Mahmood, et al.
Ivan Nikolov, Saman Motamed, Wei-Shi Zheng, Xi Wang, Luc Van Gool, Danda Pani Paudel -
LeviTor: 3D Trajectory Oriented Image-to-Video SynthesisοΌ28 Mar 2025οΌ
Hanlin Wang, Hao Ouyang, Qiuyu Wang, et al.
Wen Wang, Ka Leong Cheng, Qifeng Chen, Yujun Shen, Limin Wang -
ObjCtrl-2.5D: Training-free Object Control with Camera Poses οΌ10 Dec 2024οΌ
Zhouxia Wang, Yushi Lan, Shangchen Zhou, Chen Change Loy, et al.
-
C-Drag: Chain-of-Thought Driven Motion Controller for Video Generation οΌ27 Feb 2025οΌ
Yuhao Li, Mirana Claire Angel, Salman Khan, et al.
Yu Zhu, Jinqiu Sun, Yanning Zhang, Fahad Shahbaz Khan -
DragEntity: Trajectory Guided Video Generation using Entity and Positional RelationshipsοΌ14 Oct 2024οΌ
Zhang Wan, Sheng Tang, Jiawei Wei
-
OmniDrag: Enabling Motion Control for Omnidirectional Image-to-Video Generation οΌ12 Dec 2024οΌ
Weiqi Li, Shijie Zhao, Chong Mou, et al.
Xuhan Sheng, Zhenyu Zhang, Qian Wang, Junlin Li, Li Zhang, Jian Zhang -
MotionBridge: Dynamic Video Inbetweening with Flexible Controls οΌ7 Jan 2025οΌ
Maham Tanveer, Yang Zhou, Simon Niklaus, et al.
Ali Mahdavi Amiri, Hao Zhang, Krishna Kumar Singh, Nanxuan Zhao -
Video Diffusion Models are Training-free Motion Interpreter and Controller οΌ19 Apr 2024οΌ
Zeqi Xiao, Yifan Zhou, Shuai Yang, Xingang Pan, et al.
-
Tora: Trajectory-oriented Diffusion Transformer for Video Generation οΌ14 Mar 2025οΌ
Zhenghao Zhang, Junchao Liao, Menghao Li, et al.
ZuoZhuo Dai, Bingxue Qiu, Siyu Zhu, Long Qin, Weizhi Wang -
MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion ModelοΌ11 Jul 2024οΌ
Muyao Niu, Xiaodong Cun, Xintao Wang, et al.
Yong Zhang, Ying Shan, Yinqiang Zheng -
IMAGE CONDUCTOR: PRECISION CONTROL FOR INTERACTIVE VIDEO SYNTHESIS οΌ21 Jun 2024οΌ
Yaowei Li, Xintao Wang, Zhaoyang Zhang, et al.
Zhouxia Wang, Ziyang Yuan, Liangbin Xie, Yuexian Zou, Ying Shan -
Perception-as-Control: Fine-grained Controllable Image Animation with 3D-aware Motion RepresentationοΌ10 Mar 2025οΌ
Yingjie Chen, Yifang Men, Yuan Yao, et al.
Miaomiao Cui, Liefeng Bo -
I2VControl: Disentangled and Unified Video Motion Synthesis Control
Wanquan Feng, Tianhao Qi, Jiawei Liu, et al.
Mingzhen Sun, Pengqi Tu, Tianxiang Ma, Fei Dai, Songtao Zhao, Siyu Zhou, Qian He -
VidCRAFT3: Camera, Object, and Lighting Control for Image-to-Video GenerationοΌ2 Apr 2025οΌ
Sixiao Zheng, Zimian Peng, Yanpeng Zhou, et al.
Yi Zhu, Hang Xu, Xiangru Huang, Yanwei Fu
-
RealCam-I2V: Real-World Image-to-Video Generation with Interactive Complex Camera ControlοΌ14 Feb 2025οΌ
Teng Li, Guangcong Zheng, Rui Jiang, et al.
Shuigenzhan, Tao Wu, Yehao Lu, Yining Lin, Xi Li -
Motion Prompting: Controlling Video Generation with Motion Trajectories (frame+track+text)οΌ03 Dec 2024 οΌ
Daniel Geng, Charles Herrmann, Junhwa Hur, et al.
Forrester Cole, Serena Zhang, Tobias Pfaff, Tatiana Lopez-Guevara, Carl Doersch, Yusuf Aytar, Michael Rubinstein, Chen Sun, Oliver Wang, Andrew Owens, Deqing Sun -
Video Diffusion Models are Training-free Motion Interpreter and ControllerοΌ12 Nov 2024οΌ
Zeqi Xiao, Yifan Zhou, Shuai Yang, Xingang Pan, et al.
-
CamCo: Camera-Controllable 3D-Consistent Image-to-Video GenerationοΌ 4 Jun 2024οΌ
Dejia Xu, Weili Nie, Chao Liu, et al.
Sifei Liu, Jan Kautz, Zhangyang Wang, Arash Vahdat -
CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion ModelsοΌ13 Mar 2025οΌ
Hao He, Ceyuan Yang, Shanchuan Lin, et al.
Yinghao Xu, Meng Wei, Liangke Gui, Qi Zhao, Gordon Wetzstein, Lu Jiang, Hongsheng Li -
CameraCtrl: Enabling Camera Control for Text-to-Video GenerationοΌ13 Mar 2025οΌ
Hao He, Yinghao Xu, Yuwei Guo, et al.
Gordon Wetzstein, Bo Dai, Hongsheng Li, Ceyuan Yang -
Optical Flow Meets Video Diffusion Model for Enhanced Camera-Controlled Video SynthesisοΌ25 Mar 2025οΌ
Wonjoon Jin, Qi Dai, Chong Luo, et al.
Seung-Hwan Baek, Sunghyun Cho, POSTECH, Microsoft Research Asia -
CamI2V: Camera-Controlled Image-to-Video Diffusion Model οΌ 4 Dec 2024οΌ
Guangcong Zheng, Teng Li, Rui Jiang, et al.
Yehao Lu, Tao Wu, Xi Li -
Training-free Camera Control for Video GenerationοΌ25 Feb 2025οΌ
Chen Hou, Zhibo Chen, et al.
-
Trajectory Attention: Enhancing Video Generation with Fine-Grained Motion Control οΌ28 Nov 2024οΌ
Zeqi Xiao, Wenqi Ouyang, Yifan Zhou, et al.
Shuai Yang, Lei Yang, Jianlou Si, Xingang Pan -
DimensionX: Create Any 3D and 4D Scenes from a Single Image with Controllable Video Diffusion οΌ7 Nov 2024οΌ
Wenqiang Sun, Shuo Chen, Fangfu Liu, et al.
Zilong Chen, Yueqi Duan, Jun Zhang, Yikai Wang -
I2V3D: Controllable Image-to-Video Generation with 3D Guidance οΌ12 Mar 2025οΌ
Zhiyuan Zhang, Dongdong Chen, Jing Liao
-
Perception-as-Control: Fine-grained Controllable Image Animation with 3D-aware Motion RepresentationοΌ10 Mar 2025οΌ
Yingjie Chen, Yifang Men, Yuan Yao, et al.
Miaomiao Cui, Liefeng Bo -
I2VControl: Disentangled and Unified Video Motion Synthesis Control
Zhiyuan Zhang, Dongdong Chen, Jing Liao
-
VidCRAFT3: Camera, Object, and Lighting Control for Image-to-Video GenerationοΌ2 Apr 2025οΌ
Sixiao Zheng, Zimian Peng, Yanpeng Zhou, et al.
Yi Zhu, Hang Xu, Xiangru Huang, Yanwei Fu -
I2VCONTROL-CAMERA: Precise Video Camera Control with Adjustable Motion Strength οΌ28 Feb 2025οΌ
Wanquan Feng, Jiawei Liu, Pengqi Tu, et al.
Tianhao Qi, Mingzhen Sun, Tianxiang Ma, Songtao Zhao, Siyu Zhou, Qian He -
EgoSim: Egocentric Exploration in Virtual Worlds with Multi-modal Conditioning
Wei Yu, Songheng Yin, Steve Easterbrook, Animesh Garg, et al.
-
GEN3C: 3D-Informed World-Consistent Video Generation with Precise Camera ControlοΌ5 Mar 2025οΌ
Xuanchi Ren, Tianchang Shen, Jiahui Huang, et al.
Huan Ling, Yifan Lu, Merlin Nimier-David, Thomas MΓΌller, Alexander Keller, Sanja Fidler, Jun Gao
- MotionCtrlοΌ16 Jul 2024οΌ (no specific date provided)
Zhouxia Wang, Ziyang Yuan, Xintao Wang, et al.
Zhouxia Wang, Ziyang Yuan, Xintao Wang, Tianshui Chen, Menghan Xia, Ping Luo, Ying Shan
- Perception-as-Control: Fine-grained Controllable Image Animation with 3D-aware Motion Representation (no specific date provided)
Yingjie Chen, Yifang Men, Yuan Yao, et al.
Yingjie Chen, Yifang Men, Yuan Yao, Miaomiao Cui, Liefeng Bo - VidCRAFT3: Camera, Object, and Lighting Control for Image-to-Video Generation (no specific date provided)
Sixiao Zheng, Zimian Peng, Yanpeng Zhou, et al.
Sixiao Zheng, Zimian Peng, Yanpeng Zhou, Yi Zhu, Hang Xu, Xiangru Huang, Yanwei Fu
-
A Lip Sync Expert Is All You Need for Speech to Lip Generation In The Wild (23 Aug 2020)
[ACM MM 2020] K R Prajwal, Rudrabha Mukhopadhyay, Vinay Namboodiri, et al.
C V Jawahar -
MakeItTalk: Speaker-Aware Talking-Head Animation (25 Feb 2021)
[SIGGRAPH Asia 2020] Yang Zhou, Xintong Han, Eli Shechtman, et al.
Jose Echevarria, Evangelos Kalogerakis, Dingzeyu Li -
Sadtalker: Learning Realistic 3D Motion Coefficients for Stylized Audio-Driven Single Image Talking Face Animation (22 Nov 2022)
[CVPR 2023] Wenxuan Zhang, Xiaodong Cun, Xuan Wang, et al.
Yong Zhang, Xi Shen, Yu Guo, Ying Shan, Fei Wang -
VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior (7 Dec 2023)
Xusen Sun, Longhao Zhang, Hao Zhu, et al.
Peng Zhang, Bang Zhang, Xinya Ji, Kangneng Zhou, Daiheng Gao, Liefeng Bo, Xun Cao -
EMO: Emote Portrait Alive - Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions (27 Feb 2024)
[ECCV 2024] Linrui Tian, Qi Wang, Bang Zhang, et al.
Liefeng Bo -
AniPortrait: Audio-Driven Synthesis of Photorealistic Portrait Animation (26 Mar 2024)
Huawei Wei, Zejun Yang, Zhisheng Wang
-
EDTalk: Efficient Disentanglement for Emotional Talking Head Synthesis (2 Apr 2024)
Shuai Tan, Bin Ji, Mengxiao Bi, et al.
Ye Pan -
SyncTalk: The Devil is in the Synchronization for Talking Head Synthesis (28 Apr 2024)
[CVPR 2024] Ziqiao Peng, Wentao Hu, Yue Shi, et al.
Xiangyu Zhu, Xiaomei Zhang, Hao Zhao, Jun He, Hongyan Liu, Zhaoxin Fan -
InstructAvatar: Text-Guided Emotion and Motion Control for Avatar Generation (24 May 2024)
Yuchi Wang, Junliang Guo, Jianhong Bai, et al.
Runyi Yu, Tianyu He, Xu Tan, Xu Sun, Jiang Bian -
V-Express: Conditional Dropout for Progressive Training of Portrait Video Generation (4 Jun 2024)
Cong Wang, Kuan Tian, Jun Zhang, et al.
Yonghang Guan, Feng Luo, Fei Shen, Zhiwei Jiang, Qing Gu, Xiao Han, Wei Yang -
Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation (16 Jun 2024)
Mingwang Xu, Hui Li, Qingkun Su, et al.
Hanlin Shang, Liwei Zhang, Ce Liu, Jingdong Wang, Yao Yao, Siyu Zhu -
EchoMimic: Lifelike Audio-Driven Portrait Animations through Editable Landmark Conditions (12 Jul 2024)
[AAAI 2025] Zhiyuan Chen, Jiajiong Cao, Zhiquan Chen, et al.
Yuming Li, Chenguang Ma -
Dreamtalk: When Expressive Talking Head Generation Meets Diffusion Probabilistic Models (10 Aug 2024)
Yifeng Ma, Shiwei Zhang, Jiayu Wang, et al.
Xiang Wang, Yingya Zhang, Zhidong Deng -
MotionCraft: Crafting Whole-Body Motion with Plug-and-Play Multimodal Controls (25 Aug 2024)
Yuxuan Bian, Ailing Zeng, Xuan Ju, et al.
Xian Liu, Zhaoyang Zhang, Wei Liu, Qiang Xu -
MegActor-Ξ£: Unlocking Flexible Mixed-Modal Control in Portrait Animation with Diffusion Transformer (27 Aug 2024)
[AAAI 2025] Shurong Yang, Huadong Li, Juhao Wu, et al.
Minhao Jing, Linze Li, Renhe Ji, Jiajun Liang, Haoqiang Fan, Jin Wang -
VASA-1: Lifelike Audio-Driven Talking Faces Generated in Real Time (31 Oct 2024)
[NeurIPS 2024] Sicheng Xu, Guojun Chen, Yu-Xiao Guo, et al.
Jiaolong Yang, Chong Li, Zhenyu Zang, Yizhong Zhang, Xin Tong, Baining Guo -
EchoMimicV2: Towards Striking, Simplified, and Semi-Body Human Animation (15 Nov 2024)
[CVPR 2025] Rang Meng, Xingyu Zhang, Yuming Li, et al.
Chenguang Ma -
SVP: Style-Enhanced Vivid Portrait Talking Head Diffusion Model (28 Nov 2024)
Weipeng Tan, Chuming Lin, Chengming Xu, et al.
Xiaozhong Ji, Junwei Zhu, Chengjie Wang, Yunsheng Wu, Yanwei Fu -
Float: Generative Motion Latent Flow Matching for Audio-driven Talking Portrait(4 Dec 2024)
Taekyung Ki, Dongchan Min, Gyeongsu Chae
-
CyberHost: A One-stage Diffusion Framework for Audio-driven Talking Body Generation (23 Jan 2025)
[ICLR 2025] Gaojie Lin, Jianwen Jiang, Chao Liang, et al.
Tianyun Zhong, Jiaqi Yang, Yanbo Zheng -
OmniHuman-1: Rethinking the Scaling-Up of One-Stage Conditioned Human Animation Models (13 Feb 2025)
Gaojie Lin, Jianwen Jiang, Jiaqi Yang, et al.
Zerong Zheng, Chao Liang -
Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model (13 Feb 2025)
Fei Shen, Cong Wang, Junyao Gao, et al.
Qin Guo, Jisheng Dang, Jinhui Tang, Tat-Seng Chua -
SayAnything: Audio-Driven Lip Synchronization with Conditional Video Diffusion (17 Feb 2025)
Junxian Ma, Shiwen Wang, Jian Yang, et al.
Junyi Hu, Jian Liang, Guosheng Lin, Jingbo chen, Kai Li, Yu Meng -
Towards High-fidelity 3D Talking Avatar with Personalized Dynamic Texture (1 Mar 2025)
[CVPR 2025] Xuanchen Li, Jianyu Wang, Yuhao Cheng, et al.
Yikun Zeng, Xingyu Ren, Wenhan Zhu, Weiming Zhao, Yichao Yan -
Cafe-Talk: Generating 3D Talking Face Animation with Multimodal Coarse- and Fine-grained Control (14 Mar 2025)
[ICLR 2025] Hejia Chen, Haoxian Zhang, Shoulong Zhang, et al.
Xiaoqiang Liu, Sisi Zhuang, Yuan Zhang, Pengfei Wan, Di Zhang, Shuai Li -
MuseTalk: Real-Time High-Fidelity Video Dubbing via Spatio-Temporal Sampling (26 Mar 2025)
Yue Zhang, Zhizhou Zhong, Minhao Liu, et al.
Zhaokang Chen, Bin Wu, Yubin Zeng, Chao Zhan, Junxin Huang, Yingjie He, Wenjiang Zhou -
ChatAnyone: Stylized Real-time Portrait Video Generation with Hierarchical Motion Diffusion Model (27 Mar 2025)
Jinwei Qi, Chaonan Ji, Sheng Xu, et al.
Peng Zhang, Bang Zhang, Liefeng Bo -
Audio-visual Controlled Video Diffusion with Masked Selective State Spaces Modeling for Natural Talking Head Generation (4 Apr 2025)
Fa-Ting Hong, Zunnan Xu, Zixiang Zhou, et al.
Jun Zhou, Xiu Li, Qin Lin, Qinglin Lu, Dan Xu
- ReCapture: Generative Video Camera Controls for User-Provided Videos using Masked Video Fine-Tuning (11 Nov 2024)
David Junhao Zhang, Roni Paiss, Shiran Zada, et al.
- Reangle-A-Video: 4D Video Generation as Video-to-Video Translation
Hyeonho Jeong, Suhyeon Lee, Jong Chul Ye
- Redirecting Camera Trajectory for Monocular Videos via Diffusion Models (25 Mar 2025)
Mark YU, Wenbo Hu, Jinbo Xing, et al.
- AC3D: Analyzing and Improving 3D Camera Control in Video Diffusion Transformers
Sherwin Bahmani, Ivan Skorokhodov, Guocheng Qian, et al.
- MotionDirector: Motion Customization of Text-to-Video Diffusion Models
Rui Zhao, Yuchao Gu, Jay Zhangjie Wu, et al.
-
I2VControl: Disentangled and Unified Video Motion Synthesis Control (26 Nov 2024)
Wanquan Feng, Tianhao Qi, et al.
Wanquan Feng, Tianhao Qi, Jiawei Liu, Mingzhen Sun, Pengqi Tu, Tianxiang Ma, Fei Dai, Songtao Zhao, Siyu Zhou, Qian He -
Motion-I2V: Consistent and Controllable Image-to-Video Generation with Explicit Motion Modeling (29 Jan 2024)
[SIGGRAPH 2024] Xiaoyu Shi, Zhaoyang Huang, et al.
Xiaoyu Shi, Zhaoyang Huang, Fu-Yun Wang, Weikang Bian, Dasong Li, Yi Zhang, Manyuan Zhang, Ka Chun Cheung, Simon See, Hongwei Qin, Jifeng Dai, Hongsheng Li
-
(ICCV 23) DreamPose: Fashion Image-to-Video Synthesis via Stable Diffusion (12 Apr 2023)
Johanna Karras, Aleksander Holynski, Ting-Chun Wang, et al.
Johanna Karras, Aleksander Holynski, Ting-Chun Wang, Ira Kemelmacher-Shlizerman -
(CVPR 24) DISCO: Disentangled Control for Realistic Human Dance Generation (30 Jun 2023)
Tan Wang, Linjie Li, Kevin Lin, et al.
Tan Wang, Linjie Li, Kevin Lin, Yuanhao Zhai, Chung-Ching Lin, Zhengyuan Yang, Hanwang Zhang, Zicheng Liu, Lijuan Wang -
(CVPR 24) MagicAnimate: Temporally Consistent Human Image Animation using Diffusion Model (27 Nov 2023)
Zhongcong Xu, Jianfeng Zhang, Jun Hao Liew, et al.
Zhongcong Xu, Jianfeng Zhang, Jun Hao Liew, Hanshu Yan, Jia-Wei Liu, Chenxu Zhang, Jiashi Feng, Mike Zheng Shou -
Animate Anyone: Consistent and Controllable Image-to-Video Synthesis for Character Animation (28 Nov 2023)
Li Hu, Xin Gao, Peng Zhang, et al.
Li Hu, Xin Gao, Peng Zhang, Ke Sun, Bang Zhang, Liefeng Bo -
DreaMoving: A Human Video Generation Framework based on Diffusion Models (8 Dec 2023)
Mengyang Feng, Jinlin Liu, Kai Yu, et al.
Mengyang Feng, Jinlin Liu, Kai Yu, Yuan Yao, Zheng Hui, Xiefan Guo, Xianhui Lin, Haolan Xue, Chen Shi, Xiaowen Li, Aojie Li, Xiaoyang Kang, Biwen Lei, Miaomiao Cui, Peiran Ren, Xuansong Xie
-
(ECCV 24)Champ: Controllable and Consistent Human Image Animation with 3D Parametric Guidance (21 Mar 2024)
Shenhao Zhu, Junming Leo Chen, Zuozhuo Dai, et al.
Shenhao Zhu, Junming Leo Chen, Zuozhuo Dai, Qingkun Su, Yinghui Xu, Xun Cao, Yao Yao, Hao Zhu, Siyu Zhu -
οΌIJCAI 24οΌZero-shot High-fidelity and Pose-controllable Character Animation (21 Apr 2024)
Bingwen Zhu, Fanyi Wang, Tianyi Lu, et al.
Bingwen Zhu, Fanyi Wang, Tianyi Lu, Peng Liu, Jingwen Su, Jinxiu Liu, Yanhao Zhang, Zuxuan Wu, Guo-Jun Qi, Yu-Gang Jiang -
(ECCV 24) PoseCrafter: One-Shot Personalized Video Synthesis Following Flexible Pose Control (23 May 2024)
Yong Zhong, Min Zhao, Zebin You, et al.
Yong Zhong, Min Zhao, Zebin You, Xiaofeng Yu, Changwang Zhang, Chongxuan Li -
Disentangling Foreground and Background Motion for Enhanced Realism in Human Video Generation (26 May 2024)
Jinlin Liu, Kai Yu, Mengyang Feng, et al.
Jinlin Liu, Kai Yu, Mengyang Feng, Xiefan Guo, Miaomiao Cui -
VividPose: Advancing Stable Video Diffusion for Realistic Human Image Animation (28 May 2024)
Qilin Wang, Zhengkai Jiang, Chengming Xu, et al.
Qilin Wang, Zhengkai Jiang, Chengming Xu, Jiangning Zhang, Yabiao Wang, Xinyi Zhang, Yun Cao, Weijian Cao, Chengjie Wang, Yanwei Fu -
UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation (3 Jun 2024)
Xiang Wang, Shiwei Zhang, Changxin Gao, et al.
Xiang Wang, Shiwei Zhang, Changxin Gao, Jiayu Wang, Xiaoqiang Zhou, Yingya Zhang, Luxin Yan, Nong Sang -
Follow-Your-Pose v2: Multiple-Condition Guided Character Image Animation for Stable Pose Control (05 Jun 2024)
Jingyun Xue, Hongfa Wang, Qi Tian, et al.
Jingyun Xue, Hongfa Wang, Qi Tian, Yue Ma, Andong Wang, Zhiyuan Zhao, Shaobo Min, Wenzhe Zhao, Kaihao Zhang, Heung-Yeung Shum, Wei Liu, Mengyang Liu, Wenhan Luo -
MimicMotion: High-Quality Human Motion Video Generation with Confidence-aware Pose Guidance (28 Jun 2024)
Yuang Zhang, Jiaxi Gu, Li-Wen Wang, et al.
Yuang Zhang, Jiaxi Gu, Li-Wen Wang, Han Wang, Junqi Cheng, Yuefeng Zhu, Fangyuan Zou -
(ECCV 24) TCAN: Animating Human Images with Temporally Consistent Pose Guidance using Diffusion Models (12 Jul 2024)
Jeongho Kim, Min-Jung Kim, Junsoo Lee, et al.
Jeongho Kim, Min-Jung Kim, Junsoo Lee, Jaegul Choo -
(MM24) AnimateAnywhere: Context-Controllable Human Video Generation with ID-Consistent One-shot Learning (28 Oct 2024)
Hengyuan Liu, Xiaodong Chen, Xinchen Liu, et al.
Hengyuan Liu, Xiaodong Chen, Xinchen Liu, Xiaoyan Gu, Wu Liu -
StableAnimator: High-Quality Identity-Preserving Human Image Animation (26 Nov 2024)
Shuyuan Tu, Zhen Xing, Xintong Han, et al.
Shuyuan Tu, Zhen Xing, Xintong Han, Zhi-Qi Cheng, Qi Dai, Chong Luo, Zuxuan Wu -
AnchorCrafter: Animate CyberAnchors Saling Your Products via Human-Object Interacting Video Generation (26 Nov 2024)
Ziyi Xu, Ziyao Huang, Juan Cao, et al.
Ziyi Xu, Ziyao Huang, Juan Cao, Yong Zhang, Xiaodong Cun, Qing Shuai, Yuchen Wang, Linchao Bao, Jintao Li, Fan Tang -
OmniHuman-1: Rethinking the Scaling-Up of One-Stage Conditioned Human Animation Models (3 Feb 2025)
Gaojie Lin, Jianwen Jiang, Jiaqi Yang, et al.
Gaojie Lin, Jianwen Jiang, Jiaqi Yang, Zerong Zheng, Chao Liang
-
Show Me What and Tell Me How: Video Synthesis via Multimodal Conditioning (4 Mar 2022)
Ligong Han, Jian Ren, Hsin-Ying Lee, et al.
Ligong Han, Jian Ren, Hsin-Ying Lee, Francesco Barbieri, Kyle Olszewski, Shervin Minaee, Dimitris Metaxas, Sergey Tulyakov -
Video ControlNet: Towards Temporally Consistent Synthetic-to-Real Video Translation Using Conditional Image Diffusion Models (30 May 2023)
Ernie Chu, Shuo-Yen Lin, Jun-Cheng Chen
Ernie Chu, Shuo-Yen Lin, Jun-Cheng Chen -
ControlVideo: Training-free Controllable Text-to-Video Generation (22 May 2023)
Yabo Zhang, Yuxiang Wei, Dongsheng Jiang, et al.
Yabo Zhang, Yuxiang Wei, Dongsheng Jiang, Xiaopeng Zhang, Wangmeng Zuo, Qi Tian -
Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning (23 May 2023)
Weifeng Chen, Yatai Ji, Jie Wu, et al.
Weifeng Chen, Yatai Ji, Jie Wu, Hefeng Wu, Pan Xie, Jiashi Li, Xin Xia, Xuefeng Xiao, Liang Lin -
ControlVideo: Conditional Control for One-shot Text-driven Video Editing and Beyond (26 May 2023)
Min Zhao, Rongzhen Wang, Fan Bao, et al.
Min Zhao, Rongzhen Wang, Fan Bao, Chongxuan Li, Jun Zhu -
VideoComposer: Compositional Video Synthesis with Motion Controllability (3 Jun 2023)
Xiang Wang, Hangjie Yuan, Shiwei Zhang, et al.
Xiang Wang, Hangjie Yuan, Shiwei Zhang, Dayou Chen, Jiuniu Wang, Yingya Zhang, Yujun Shen, Deli Zhao, Jingren Zhou -
Text2Video-Zero: Text-to-Image Diffusion Models are Zero-Shot Video Generators (23 Mar 2023)
Levon Khachatryan, Andranik Movsisyan, Vahram Tadevosyan, et al.
Levon Khachatryan, Andranik Movsisyan, Vahram Tadevosyan, Roberto Henschel, Zhangyang Wang, Shant Navasardyan, Humphrey Shi -
Motion-Conditioned Diffusion Model for Controllable Video Synthesis (27 Apr 2023)
Tsai-Shien Chen, Chieh Hubert Lin, Hung-Yu Tseng, et al.
Tsai-Shien Chen, Chieh Hubert Lin, Hung-Yu Tseng, Tsung-Yi Lin, Ming-Hsuan Yang -
Moonshot: Towards Controllable Video Generation and Editing with Multimodal Conditions (3 Jan 2024)
David Junhao Zhang, Dongxu Li, Hung Le, et al.
David Junhao Zhang, Dongxu Li, Hung Le, Mike Zheng Shou, Caiming Xiong, Doyen Sahoo -
Boximator: Generating Rich and Controllable Motions for Video Synthesis (2 Feb 2024)
Jiawei Wang, Yuchen Zhang, Jiaxin Zou, et al.
Jiawei Wang, Yuchen Zhang, Jiaxin Zou, Yan Zeng, Guoqiang Wei, Liping Yuan, Hang Li -
Customize-A-Video: One-Shot Motion Customization of Text-to-Video Diffusion Models (22 Feb 2024)
Yixuan Ren, Yang Zhou, Jimei Yang, et al.
Yixuan Ren, Yang Zhou, Jimei Yang, Jing Shi, Difan Liu, Feng Liu, Mingi Kwon, Abhinav Shrivastava -
DreamVideo-2: Zero-Shot Subject-Driven Video Customization with Precise Motion Control (17 Oct 2024)
Yujie Wei, Shiwei Zhang, Hangjie Yuan, et al.
Yujie Wei, Shiwei Zhang, Hangjie Yuan, Xiang Wang, Haonan Qiu, Rui Zhao, Yutong Feng, Feng Liu, Zhizhong Huang, Jiaxin Ye, Yingya Zhang, Hongming Shan -
MotionCharacter: Identity-Preserving and Motion Controllable Human Video Generation (27 Nov 2024)
Haopeng Fang, Di Qiu, Binjie Mao, et al.
Haopeng Fang, Di Qiu, Binjie Mao, Pengfei Yan, He Tang -
MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model (30 May 2024)
Muyao Niu, Xiaodong Cun, Xintao Wang, et al.
Muyao Niu, Xiaodong Cun, Xintao Wang, Yong Zhang, Ying Shan, Yinqiang Zheng -
Diffusion as Shader: 3D-aware Video Diffusion for Versatile Video Generation Control (7 Jan 2025)
Zekai Gu, Rui Yan, Jiahao Lu, et al.
Zekai Gu, Rui Yan, Jiahao Lu, Peng Li, Zhiyang Dou, Chenyang Si, Zhen Dong, Qifeng Liu, Cheng Lin, Ziwei Liu, Wenping Wang, Yuan Liu
-
VACE: All-in-One Video Creation and Editing (11 Mar 2025)
Zeyinzi Jiang, Zhen Han, Chaojie Mao, et al.
Zeyinzi Jiang, Zhen Han, Chaojie Mao, Jingfeng Zhang, Yulin Pan, Yu Liu -
FullDiT: Multi-Task Video Generative Foundation Model with Full Attention (25 Mar 2025)
Xuan Ju, Weicai Ye, Quande Liu, et al.
Xuan Ju, Weicai Ye, Quande Liu, Qiulin Wang, Xintao Wang, Pengfei Wan, Di Zhang, Kun Gai, Qiang Xu -
Any2Caption:Interpreting Any Condition to Caption for Controllable Video Generation (31 Mar 2025)
Shengqiong Wu, Weicai Ye, Jiahao Wang, et al.
Shengqiong Wu, Weicai Ye, Jiahao Wang, Quande Liu, Xintao Wang, Pengfei Wan, Di Zhang, Kun Gai, Shuicheng Yan, Hao Fei, Tat-Seng Chua -
VideoComposer: Compositional Video Synthesis with Motion Controllability (6 Jun 2023)
Xiang Wang, Hangjie Yuan, Shiwei Zhang, et al.
Xiang Wang, Hangjie Yuan, Shiwei Zhang, Dayou Chen, Jiuniu Wang, Yingya Zhang, Yujun Shen, Deli Zhao, Jingren Zhou