@inproceedings{bb105500,
AUTHOR = "Li, B. and Wu, Y.L. and Lu, Y. and Yu, J. and Tang, L.C. and Cao, J. and Zhu, W.Q. and Sun, Y.Y. and Wu, J. and Zhu, W.B.",
TITLE = "VEU-Bench: Towards Comprehensive Understanding of Video Editing",
BOOKTITLE = CVPR25,
YEAR = "2025",
PAGES = "13671-13680",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102203"}
@inproceedings{bb105501,
AUTHOR = "Men, Y.F. and Yao, Y. and Cui, M.M. and Bo, L.",
TITLE = "MIMO: Controllable Character Video Synthesis with Spatial Decomposed
Modeling",
BOOKTITLE = CVPR25,
YEAR = "2025",
PAGES = "21181-21191",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102204"}
@inproceedings{bb105502,
AUTHOR = "Pilligua, M. and Xue, D. and Vazquez Corral, J.",
TITLE = "HyperNVD: Accelerating Neural Video Decomposition via Hypernetworks",
BOOKTITLE = CVPR25,
YEAR = "2025",
PAGES = "22933-22942",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102205"}
@inproceedings{bb105503,
AUTHOR = "Gao, J.Y. and Yang, K. and Yao, X. and Hu, Y.F.",
TITLE = "Unity in Diversity: Video Editing via Gradient-Latent Purification",
BOOKTITLE = CVPR25,
YEAR = "2025",
PAGES = "23401-23411",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102206"}
@inproceedings{bb105504,
AUTHOR = "Zhu, Y.X. and Wang, H.L. and Ma, S.L. and Zhao, W.L. and Tang, Y.S. and Chen, L. and Zhou, J.",
TITLE = "FADE: Frequency-Aware Diffusion Model Factorization for Video Editing",
BOOKTITLE = CVPR25,
YEAR = "2025",
PAGES = "28426-28435",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102207"}
@inproceedings{bb105505,
AUTHOR = "Cai, M.H. and Cun, X.D. and Li, X.Y. and Liu, W.Z. and Zhang, Z.Y. and Zhang, Y. and Shan, Y. and Yue, X.Y.",
TITLE = "DiTCtrl: Exploring Attention Control in Multi-Modal Diffusion
Transformer for Tuning-Free Multi-Prompt Longer Video Generation",
BOOKTITLE = CVPR25,
YEAR = "2025",
PAGES = "7763-7772",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102208"}
@inproceedings{bb105506,
AUTHOR = "Wang, Y.K. and Wang, L.G. and Ma, Z.Y. and Hu, Q. and Xu, K. and Guo, Y.L.",
TITLE = "VideoDirector: Precise Video Editing via Text-to-Video Models",
BOOKTITLE = CVPR25,
YEAR = "2025",
PAGES = "2589-2598",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102209"}
@inproceedings{bb105507,
AUTHOR = "Wang, S.Z. and Zhong, Y.K. and Mu, J. and Wu, K. and Xiong, M.L. and Fang, W. and Liu, M.Q. and Deng, H. and He, B. and Li, G. and Liu, Q.W.",
TITLE = "Align-A-Video: Deterministic Reward Tuning of Image Diffusion Models
for Consistent Video Editing",
BOOKTITLE = CVPR25,
YEAR = "2025",
PAGES = "2074-2083",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102210"}
@inproceedings{bb105508,
AUTHOR = "Huang, H.P. and Su, Y.C. and Yang, M.H.",
TITLE = "Generating Long-Take Videos via Effective Keyframes and Guidance",
BOOKTITLE = WACV25,
YEAR = "2025",
PAGES = "3709-3720",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102211"}
@inproceedings{bb105509,
AUTHOR = "Wang, R. and He, Y.F. and Sun, T.J. and Li, X. and Shi, T.Y.",
TITLE = "UniTMGE: Uniform Text-Motion Generation and Editing Model via
Diffusion",
BOOKTITLE = WACV25,
YEAR = "2025",
PAGES = "6104-6114",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102212"}
@inproceedings{bb105510,
AUTHOR = "Ma, Y. and Cun, X.D. and Liang, S. and Xing, J. and He, Y.Q. and Qi, C.Y. and Chen, S. and Chen, Q.F.",
TITLE = "MagicStick: Controllable Video Editing via Control Handle
Transformations",
BOOKTITLE = WACV25,
YEAR = "2025",
PAGES = "9385-9395",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102213"}
@inproceedings{bb105511,
AUTHOR = "Mahmud, T. and Munir, M. and Marculescu, R. and Marculescu, D.",
TITLE = "Ada-VE: Training-Free Consistent Video Editing Using Adaptive Motion
Prior",
BOOKTITLE = WACV25,
YEAR = "2025",
PAGES = "940-949",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102214"}
@inproceedings{bb105512,
AUTHOR = "Zhang, Y. and Ju, X. and Clark, J.J.",
TITLE = "FastVideoEdit: Leveraging Consistency Models for Efficient
Text-to-Video Editing",
BOOKTITLE = WACV25,
YEAR = "2025",
PAGES = "3657-3666",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102215"}
@inproceedings{bb105513,
AUTHOR = "Zhao, H.Y. and Lu, T.Y. and Gu, J.X. and Zhang, X. and Zheng, Q.P. and Wu, Z.X. and Xu, H. and Jiang, Y.G.",
TITLE = "Magdiff: Multi-alignment Diffusion for High-fidelity Video Generation
and Editing",
BOOKTITLE = ECCV24,
YEAR = "2024",
PAGES = "XVIII: 205-221",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102216"}
@inproceedings{bb105514,
AUTHOR = "Liang, S. and Huang, C. and Tian, Y.P. and Kumar, A. and Xu, C.L.",
TITLE = "Language-guided Joint Audio-visual Editing via One-shot Adaptation",
BOOKTITLE = ACCV24,
YEAR = "2024",
PAGES = "VI: 123-139",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102217"}
@inproceedings{bb105515,
AUTHOR = "Kahatapitiya, K. and Karjauv, A. and Abati, D. and Porikli, F.M. and Asano, Y.M. and Habibian, A.",
TITLE = "Object-centric Diffusion for Efficient Video Editing",
BOOKTITLE = ECCV24,
YEAR = "2024",
PAGES = "LVII: 91-108",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102218"}
@inproceedings{bb105516,
AUTHOR = "Deng, Y.F. and Wang, R. and Zhang, Y.H. and Tai, Y.W. and Tang, C.K.",
TITLE = "Dragvideo: Interactive Drag-style Video Editing",
BOOKTITLE = ECCV24,
YEAR = "2024",
PAGES = "LVI: 183-199",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102219"}
@inproceedings{bb105517,
AUTHOR = "Yoon, S. and Koo, G. and Hong, J.W. and Yoo, C.D.",
TITLE = "DNI: Dilutional Noise Initialization for Diffusion Video Editing",
BOOKTITLE = ECCV24,
YEAR = "2024",
PAGES = "XLVIII: 180-195",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102220"}
@inproceedings{bb105518,
AUTHOR = "Zhong, X.J. and Huang, X. and Yang, X.F. and Lin, G.S. and Wu, Q.Y.",
TITLE = "Deco: Decoupled Human-centered Diffusion Video Editing with Motion
Consistency",
BOOKTITLE = ECCV24,
YEAR = "2024",
PAGES = "XLIV: 352-370",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102221"}
@inproceedings{bb105519,
AUTHOR = "Jeong, H. and Chang, J.H. and Park, G.Y. and Ye, J.C.",
TITLE = "Dreammotion: Space-time Self-similar Score Distillation for Zero-shot
Video Editing",
BOOKTITLE = ECCV24,
YEAR = "2024",
PAGES = "XXX: 358-376",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102222"}
@inproceedings{bb105520,
AUTHOR = "Fan, X. and Bhattad, A. and Krishna, R.",
TITLE = "Videoshop: Localized Semantic Video Editing with Noise-extrapolated
Diffusion Inversion",
BOOKTITLE = ECCV24,
YEAR = "2024",
PAGES = "XII: 232-250",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102223"}
@inproceedings{bb105521,
AUTHOR = "Lee, J. and Kim, G. and Cho, S.",
TITLE = "RNA: Video Editing with Roi-based Neural Atlas",
BOOKTITLE = ACCV24,
YEAR = "2024",
PAGES = "VI: 278-293",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102224"}
@inproceedings{bb105522,
AUTHOR = "Feng, Y.T. and Gao, S.C. and Bao, Y.X. and Wang, X.D. and Han, S. and Zhang, J. and Zhang, B.C. and Yao, A.",
TITLE = "Wave: Warping Ddim Inversion Features for Zero-shot Text-to-video
Editing",
BOOKTITLE = ECCV24,
YEAR = "2024",
PAGES = "LXXVI: 38-55",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102225"}
@inproceedings{bb105523,
AUTHOR = "Chen, M.H. and Laina, I. and Vedaldi, A.",
TITLE = "DGE: Direct Gaussian 3d Editing by Consistent Multi-view Editing",
BOOKTITLE = ECCV24,
YEAR = "2024",
PAGES = "LXXIV: 74-92",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102226"}
@inproceedings{bb105524,
AUTHOR = "Song, Y. and Shin, W.S. and Lee, J. and Kim, J. and Kwak, N.",
TITLE = "Save: Protagonist Diversification with Structure Agnostic Video Editing",
BOOKTITLE = ECCV24,
YEAR = "2024",
PAGES = "LXXX: 41-57",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102227"}
@inproceedings{bb105525,
AUTHOR = "Singer, U. and Zohar, A. and Kirstain, Y. and Sheynin, S. and Polyak, A. and Parikh, D. and Taigman, Y.",
TITLE = "Video Editing via Factorized Diffusion Distillation",
BOOKTITLE = ECCV24,
YEAR = "2024",
PAGES = "LXXVI: 450-466",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102228"}
@inproceedings{bb105526,
AUTHOR = "Mou, L. and Chen, J.K. and Wang, Y.X.",
TITLE = "Instruct 4D-to-4D: Editing 4D Scenes as Pseudo-3D Scenes Using 2D
Diffusion",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "20176-20185",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102229"}
@inproceedings{bb105527,
AUTHOR = "Ma, H.Y. and Mahdizadehaghdam, S. and Wu, B. and Fan, Z.P. and Gu, Y.C. and Zhao, W.L. and Shapira, L. and Xie, X.H.",
TITLE = "MaskINT: Video Editing via Interpolative Non-autoregressive Masked
Transformers",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "7403-7412",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102230"}
@inproceedings{bb105528,
AUTHOR = "Li, X. and Ma, C. and Yang, X.K. and Yang, M.H.",
TITLE = "VidToMe: Video Token Merging for Zero-Shot Video Editing",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "7486-7495",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102231"}
@inproceedings{bb105529,
AUTHOR = "Li, M. and Li, Y. and Yang, T.Y. and Liu, Y.F. and Yue, D.X. and Lin, Z.H. and Xu, D.",
TITLE = "A Video is Worth 256 Bases: Spatial-Temporal Expectation-Maximization
Inversion for Zero-Shot Video Editing",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "7528-7537",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102232"}
@inproceedings{bb105530,
AUTHOR = "Liu, J.W. and Cao, Y.P. and Wu, J.Z.J. and Mao, W.J. and Gu, Y.C. and Zhao, R. and Keppo, J. and Shan, Y. and Shou, M.Z.",
TITLE = "DynVideo-E: Harnessing Dynamic NeRF for Large-Scale Motion- and
View-Change Human-Centric Video Editing",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "7664-7674",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102233"}
@inproceedings{bb105531,
AUTHOR = "Tu, S.Y. and Dai, Q. and Cheng, Z.Q. and Hu, H. and Han, X.T. and Wu, Z.X. and Jiang, Y.G.",
TITLE = "MotionEditor: Editing Video Motion via Content-Aware Diffusion",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "7882-7891",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102234"}
@inproceedings{bb105532,
AUTHOR = "Liu, S. and Zhang, Y.C. and Li, W.B. and Lin, Z. and Jia, J.Y.",
TITLE = "Video-P2P: Video Editing with Cross-Attention Control",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "8599-8608",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102235"}
@inproceedings{bb105533,
AUTHOR = "Zhang, G. and Zhang, T.Y. and Niu, G.L. and Tan, Z.C. and Bai, Y. and Yang, Q.",
TITLE = "CAMEL: CAusal Motion Enhancement Tailored for Lifting Text-Driven
Video Editing",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "9079-9088",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102236"}
@inproceedings{bb105534,
AUTHOR = "Harsha, S.S. and Revanur, A. and Agarwal, D. and Agrawal, S.",
TITLE = "GenVideo: One-shot target-image and shape aware video editing using
T2I diffusion models",
BOOKTITLE = GCV24,
YEAR = "2024",
PAGES = "7559-7568",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102237"}
@inproceedings{bb105535,
AUTHOR = "Feng, R. and Weng, W.M. and Wang, Y.H. and Yuan, Y.H. and Bao, J.M. and Luo, C. and Chen, Z.B. and Guo, B.",
TITLE = "CCEdit: Creative and Controllable Video Editing via Diffusion Models",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "6712-6722",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102238"}
@inproceedings{bb105536,
AUTHOR = "Soucek, T. and Damen, D. and Wray, M. and Laptev, I. and Sivic, J.",
TITLE = "GenHowTo: Learning to Generate Actions and State Transformations from
Instructional Videos",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "6561-6571",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102239"}
@inproceedings{bb105537,
AUTHOR = "Kara, O. and Kurtkaya, B. and Yesiltepe, H. and Rehg, J.M. and Yanardag, P.",
TITLE = "RAVE: Randomized Noise Shuffling for Fast and Consistent Video
Editing with Diffusion Models",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "6507-6516",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102240"}
@inproceedings{bb105538,
AUTHOR = "Chan, C.H. and Yuan, C.Y. and Sun, C. and Chen, H.T.",
TITLE = "Hashing Neural Video Decomposition with Multiplicative Residuals in
Space-Time",
BOOKTITLE = ICCV23,
YEAR = "2023",
PAGES = "7709-7719",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102241"}
@inproceedings{bb105539,
AUTHOR = "Khandelwal, A.",
TITLE = "InFusion: Inject and Attention Fusion for Multi Concept Zero-Shot
Text-based Video Editing",
BOOKTITLE = CVEU23,
YEAR = "2023",
PAGES = "3009-3018",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102242"}
@inproceedings{bb105540,
AUTHOR = "Muralikrishnan, S. and Huang, C.H.P. and Ceylan, D. and Mitra, N.J.",
TITLE = "BLiSS: Bootstrapped Linear Shape Space",
BOOKTITLE = "3DV24",
YEAR = "2024",
PAGES = "569-580",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102243"}
@inproceedings{bb105541,
AUTHOR = "Ceylan, D. and Huang, C.H.P. and Mitra, N.J.",
TITLE = "Pix2Video: Video Editing using Image Diffusion",
BOOKTITLE = ICCV23,
YEAR = "2023",
PAGES = "23149-23160",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102244"}
@inproceedings{bb105542,
AUTHOR = "Chai, W.H. and Guo, X. and Wang, G.A. and Lu, Y.",
TITLE = "StableVideo: Text-driven Consistency-aware Diffusion Video Editing",
BOOKTITLE = ICCV23,
YEAR = "2023",
PAGES = "22983-22993",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102245"}
@inproceedings{bb105543,
AUTHOR = "Qi, C.Y. and Cun, X.D. and Zhang, Y. and Lei, C.Y. and Wang, X.T. and Shan, Y. and Chen, Q.F.",
TITLE = "FateZero: Fusing Attentions for Zero-shot Text-based Video Editing",
BOOKTITLE = ICCV23,
YEAR = "2023",
PAGES = "15886-15896",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102246"}
@inproceedings{bb105544,
AUTHOR = "Ali, M.H. and Bond, A. and Karacan, L. and Birdal, T. and Erdem, E. and Ceylan, D. and Erdem, A.",
TITLE = "VidStyleODE: Disentangled Video Editing via StyleGAN and NeuralODEs",
BOOKTITLE = ICCV23,
YEAR = "2023",
PAGES = "7489-7500",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102247"}
@inproceedings{bb105545,
AUTHOR = "Lee, Y.C. and Jang, J.Z.G. and Chen, Y.T. and Qiu, E. and Huang, J.B.",
TITLE = "Shape-Aware Text-Driven Layered Video Editing",
BOOKTITLE = CVPR23,
YEAR = "2023",
PAGES = "14317-14326",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102248"}
@inproceedings{bb105546,
AUTHOR = "Fruhstuck, A. and Sarafianos, N. and Xu, Y. and Wonka, P. and Tung, T.",
TITLE = "VIVE3D: Viewpoint-Independent Video Editing using 3D-Aware GANs",
BOOKTITLE = CVPR23,
YEAR = "2023",
PAGES = "4446-4455",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102249"}
@inproceedings{bb105547,
AUTHOR = "Shen, Y.J. and Zhang, L. and Xu, K. and Jin, X.J.",
TITLE = "AutoTransition: Learning to Recommend Video Transition Effects",
BOOKTITLE = ECCV22,
YEAR = "2022",
PAGES = "XXXVIII:285-300",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102250"}
@inproceedings{bb105548,
AUTHOR = "Argaw, D.M. and Heilbron, F.C. and Lee, J.Y. and Woodson, M. and Kweon, I.S.",
TITLE = "The Anatomy of Video Editing: A Dataset and Benchmark Suite for
AI-Assisted Video Editing",
BOOKTITLE = ECCV22,
YEAR = "2022",
PAGES = "VIII:201-218",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102251"}
@inproceedings{bb105549,
AUTHOR = "Davtyan, A. and Favaro, P.",
TITLE = "Controllable Video Generation Through Global and Local Motion Dynamics",
BOOKTITLE = ECCV22,
YEAR = "2022",
PAGES = "XVII:68-84",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102252"}
@inproceedings{bb105550,
AUTHOR = "Ge, S.W. and Hayes, T. and Yang, H. and Yin, X. and Pang, G. and Jacobs, D. and Huang, J.B. and Parikh, D.",
TITLE = "Long Video Generation with Time-Agnostic VQGAN and Time-Sensitive
Transformer",
BOOKTITLE = ECCV22,
YEAR = "2022",
PAGES = "XVII:102-118",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102253"}
@inproceedings{bb105551,
AUTHOR = "Huang, J.H. and Jin, Y. and Yi, K.M. and Sigal, L.",
TITLE = "Layered Controllable Video Generation",
BOOKTITLE = ECCV22,
YEAR = "2022",
PAGES = "XVI:546-564",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102254"}
@inproceedings{bb105552,
AUTHOR = "Bar Tal, O. and Ofri Amar, D. and Fridman, R. and Kasten, Y. and Dekel, T.",
TITLE = "Text2LIVE: Text-Driven Layered Image and Video Editing",
BOOKTITLE = ECCV22,
YEAR = "2022",
PAGES = "XV:707-723",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102255"}
@inproceedings{bb105553,
AUTHOR = "Xu, Y.R. and AlBahar, B. and Huang, J.B.",
TITLE = "Temporally Consistent Semantic Video Editing",
BOOKTITLE = ECCV22,
YEAR = "2022",
PAGES = "XV:357-374",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102256"}
@inproceedings{bb105554,
AUTHOR = "Mai, L. and Liu, F.",
TITLE = "Motion-Adjustable Neural Implicit Video Representation",
BOOKTITLE = CVPR22,
YEAR = "2022",
PAGES = "10728-10737",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102257"}
@inproceedings{bb105555,
AUTHOR = "Menapace, W. and Lathuiliere, S. and Siarohin, A. and Theobalt, C. and Tulyakov, S. and Golyanik, V. and Ricci, E.",
TITLE = "Playable Environments: Video Manipulation in Space and Time",
BOOKTITLE = CVPR22,
YEAR = "2022",
PAGES = "3574-3583",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102258"}
@inproceedings{bb105556,
AUTHOR = "Fu, T.J. and Wang, X.E. and Grafton, S.T. and Eckstein, M.P. and Wang, W.Y.",
TITLE = "M3L: Language-based Video Editing via Multi-Modal Multi-Level
Transformers",
BOOKTITLE = CVPR22,
YEAR = "2022",
PAGES = "10503-10512",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102259"}
@inproceedings{bb105557,
AUTHOR = "Ardino, P. and de Nadai, M. and Lepri, B. and Ricci, E. and Lathuiliere, S.",
TITLE = "Click to Move: Controlling Video Generation with Sparse Motion",
BOOKTITLE = ICCV21,
YEAR = "2021",
PAGES = "14729-14738",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102260"}
@inproceedings{bb105558,
AUTHOR = "Kumar, B.G.V. and Subramanian, J. and Chordia, V. and Bart, E. and Fang, S.B. and Guan, K. and Bala, R.",
TITLE = "STRIVE: Scene Text Replacement In Videos",
BOOKTITLE = ICCV21,
YEAR = "2021",
PAGES = "14529-14538",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102261"}
@inproceedings{bb105559,
AUTHOR = "Koorathota, S. and Adelman, P. and Cotton, K. and Sajda, P.",
TITLE = "Editing like Humans: A Contextual, Multimodal Framework for Automated
Video Editing",
BOOKTITLE = MULA21,
YEAR = "2021",
PAGES = "1701-1709",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102262"}
@inproceedings{bb105560,
AUTHOR = "Bermudez, L. and Dabby, N. and Lin, Y.X.A. and Hilmarsdottir, S. and Sundararajan, N. and Kar, S.",
TITLE = "A Learning-Based Approach to Parametric Rotoscoping of Multi-Shape
Systems",
BOOKTITLE = WACV21,
YEAR = "2021",
PAGES = "776-785",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102263"}
@inproceedings{bb105561,
AUTHOR = "Tripathi, S. and Chandra, S. and Agrawal, A. and Tyagi, A. and Rehg, J.M. and Chari, V.",
TITLE = "Learning to Generate Synthetic Data via Compositing",
BOOKTITLE = CVPR19,
YEAR = "2019",
PAGES = "461-470",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102264"}
@inproceedings{bb105562,
AUTHOR = "Meyer, S. and Sorkine Hornung, A. and Gross, M.",
TITLE = "Phase-Based Modification Transfer for Video",
BOOKTITLE = ECCV16,
YEAR = "2016",
PAGES = "III: 633-648",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102265"}
@inproceedings{bb105563,
AUTHOR = "Taylor, W. and Qureshi, F.Z.",
TITLE = "Automatic video editing for sensor-rich videos",
BOOKTITLE = WACV16,
YEAR = "2016",
PAGES = "1-9",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102266"}
@inproceedings{bb105564,
AUTHOR = "Manickam, N. and Chandran, S.",
TITLE = "Automontage: Photo sessions made easy",
BOOKTITLE = ICIP13,
YEAR = "2013",
PAGES = "1321-1325",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102267"}
@inproceedings{bb105565,
AUTHOR = "Chen, J.W. and Paris, S. and Wang, J. and Matusik, W. and Cohen, M. and Durand, F.",
TITLE = "The video mesh: A data structure for image-based three-dimensional
video editing",
BOOKTITLE = ICCP11,
YEAR = "2011",
PAGES = "1-8",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102268"}
@inproceedings{bb105566,
AUTHOR = "Durand, F. and Cohen, M. and Chen, J.W. and Paris, S. and Wang, J. and Matusik, W.",
TITLE = "The Video Mesh: A Data Structure for Image-based Video Editing",
BOOKTITLE = CSAIL,
YEAR = "2009",
PAGES = "TR-2009-062",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102269"}
@inproceedings{bb105567,
AUTHOR = "Rajgopalan, V. and Ranganathan, A. and Rajagopalan, R. and Mudur, S.P.",
TITLE = "Keyframe-Guided Automatic Non-linear Video Editing",
BOOKTITLE = ICPR10,
YEAR = "2010",
PAGES = "3236-3239",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102270"}
@inproceedings{bb105568,
AUTHOR = "Yoshitaka, A. and Deguchi, Y.",
TITLE = "Rendition-based video editing for public contents authoring",
BOOKTITLE = ICIP09,
YEAR = "2009",
PAGES = "1825-1828",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102271"}
@inproceedings{bb105569,
AUTHOR = "Slot, K. and Truelsen, R. and Sporring, J.",
TITLE = "Content-Aware Video Editing in the Temporal Domain",
BOOKTITLE = SCIA09,
YEAR = "2009",
PAGES = "490-499",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102272"}
@inproceedings{bb105570,
AUTHOR = "Wang, H.C. and Xu, N. and Raskar, R. and Ahuja, N.",
TITLE = "Videoshop: A New Framework for Spatio-Temporal Video Editing in
Gradient Domain",
BOOKTITLE = CVPR05,
YEAR = "2005",
PAGES = "II: 1201",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102273"}
@inproceedings{bb105571,
AUTHOR = "Wang, H.C. and Raskar, R. and Ahuja, N.",
TITLE = "Seamless video editing",
BOOKTITLE = ICPR04,
YEAR = "2004",
PAGES = "III: 858-861",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102274"}
@inproceedings{bb105572,
AUTHOR = "Kumano, M. and Ariki, Y. and Amano, M. and Uehara, K. and Shunto, K. and Tsukada, K.",
TITLE = "Video editing support system based on video grammar and content
analysis",
BOOKTITLE = ICPR02,
YEAR = "2002",
PAGES = "II: 1031-1036",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102275"}
@article{bb105573,
AUTHOR = "Zhang, J. and Mei, K.Z. and Zheng, Y. and Fan, J.P.",
TITLE = "Exploiting Mid-Level Semantics for Large-Scale Complex Video
Classification",
JOURNAL = MultMed,
VOLUME = "21",
YEAR = "2019",
NUMBER = "10",
MONTH = "October",
PAGES = "2518-2530",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102276"}
@inproceedings{bb105574,
AUTHOR = "Zhang, J. and Mei, K.Z. and Wang, X. and Zheng, Y. and Fan, J.P.",
TITLE = "From Text to Video: Exploiting Mid-Level Semantics for Large-Scale
Video Classification",
BOOKTITLE = ICPR18,
YEAR = "2018",
PAGES = "1695-1700",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102277"}
@article{bb105575,
AUTHOR = "Yang, M. and Liu, J.H. and Shen, Y. and Zhao, Z. and Chen, X.J. and Wu, Q.Y. and Li, C.M.",
TITLE = "An Ensemble of Generation- and Retrieval-Based Image Captioning With
Dual Generator Generative Adversarial Network",
JOURNAL = IP,
VOLUME = "29",
YEAR = "2020",
PAGES = "9627-9640",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102278"}
@article{bb105576,
AUTHOR = "Chen, Q. and Wu, Q. and Chen, J. and Wu, Q.Y. and van den Hengel, A.J. and Tan, M.K.",
TITLE = "Scripted Video Generation With a Bottom-Up Generative Adversarial
Network",
JOURNAL = IP,
VOLUME = "29",
YEAR = "2020",
PAGES = "7454-7467",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102279"}
@article{bb105577,
AUTHOR = "Sheng, L. and Pan, J.T. and Guo, J.M. and Shao, J. and Loy, C.C.",
TITLE = "High-Quality Video Generation from Static Structural Annotations",
JOURNAL = IJCV,
VOLUME = "128",
YEAR = "2020",
NUMBER = "10-11",
MONTH = "November",
PAGES = "2552-2569",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102280"}
@article{bb105578,
AUTHOR = "Sener, F. and Saraf, R. and Yao, A.",
TITLE = "Transferring Knowledge From Text to Video:
Zero-Shot Anticipation for Procedural Actions",
JOURNAL = PAMI,
VOLUME = "45",
YEAR = "2023",
NUMBER = "6",
MONTH = "June",
PAGES = "7836-7852",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102281"}
@article{bb105579,
AUTHOR = "Liu, S.Y. and Dragotti, P.L.",
TITLE = "Sensing Diversity and Sparsity Models for Event Generation and Video
Reconstruction from Events",
JOURNAL = PAMI,
VOLUME = "45",
YEAR = "2023",
NUMBER = "10",
MONTH = "October",
PAGES = "12444-12458",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102282"}
@article{bb105580,
AUTHOR = "Koksal, A. and Ak, K.E. and Sun, Y. and Rajan, D. and Lim, J.H.",
TITLE = "Controllable Video Generation With Text-Based Instructions",
JOURNAL = MultMed,
VOLUME = "26",
YEAR = "2024",
PAGES = "190-201",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102283"}
@article{bb105581,
AUTHOR = "Liu, J.W. and Wang, W.N. and Chen, S. and Zhu, X.X. and Liu, J.",
TITLE = "Sounding Video Generator: A Unified Framework for Text-Guided
Sounding Video Generation",
JOURNAL = MultMed,
VOLUME = "26",
YEAR = "2024",
PAGES = "141-153",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102284"}
@article{bb105582,
AUTHOR = "Hu, Y. and Luo, C. and Chen, Z.Z.",
TITLE = "A Benchmark for Controllable Text-Image-to-Video Generation",
JOURNAL = MultMed,
VOLUME = "26",
YEAR = "2024",
PAGES = "1706-1719",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102285"}
@article{bb105583,
AUTHOR = "Fang, S. and Dang, T.T. and Wang, S.H. and Huang, Q.M.",
TITLE = "Linguistic Hallucination for Text-Based Video Retrieval",
JOURNAL = CirSysVideo,
VOLUME = "34",
YEAR = "2024",
NUMBER = "10",
MONTH = "October",
PAGES = "9692-9705",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102286"}
@article{bb105584,
AUTHOR = "Nadeem, M. and Sohail, S.S. and Cambria, E. and Schuller, B.W. and Hussain, A.",
TITLE = "Gender Bias in Text-to-Video Generation Models: A Case Study of Sora",
JOURNAL = IEEE_Int_Sys,
VOLUME = "40",
YEAR = "2025",
NUMBER = "3",
MONTH = "May",
PAGES = "10-15",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102287"}
@article{bb105585,
AUTHOR = "Kuang, Q. and Chen, Y.",
TITLE = "Visual-Aware Text as Query for Referring Video Object Segmentation",
JOURNAL = IVC,
VOLUME = "161",
YEAR = "2025",
PAGES = "105608",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102288"}
@article{bb105586,
AUTHOR = "He, H.G. and Yang, H. and Tuo, Z.X. and Zhou, Y. and Wang, Q.Y. and Zhang, Y.H. and Liu, Z. and Huang, W.H. and Chao, H.Y. and Yin, J.",
TITLE = "DreamStory: Open-Domain Story Visualization by LLM-Guided
Multi-Subject Consistent Diffusion",
JOURNAL = PAMI,
VOLUME = "47",
YEAR = "2025",
NUMBER = "12",
MONTH = "December",
PAGES = "11874-11891",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102289"}
@article{bb105587,
AUTHOR = "Wang, X.H. and Kang, Z.X. and Mu, Y.D.",
TITLE = "Text-Controlled Motion Mamba: Text-Instructed Temporal Grounding of
Human Motion",
JOURNAL = IP,
VOLUME = "34",
YEAR = "2025",
PAGES = "7079-7092",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102290"}
@article{bb105588,
AUTHOR = "Wang, F.M. and Wang, W.L. and Gao, D. and Huang, X. and Song, X.D. and Sun, H.Y. and Peng, C.",
TITLE = "A LLM-guided hybrid Mamba-Transformer architecture for part-to-whole
motion synthesis",
JOURNAL = CVIU,
VOLUME = "262",
YEAR = "2025",
PAGES = "104549",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102291"}
@article{bb105589,
AUTHOR = "Huang, Z.Q. and Zhang, F. and Xu, X.J. and He, Y. and Yu, J. and Dong, Z.Y. and Ma, Q.L. and Chanpaisit, N. and Si, C.Y. and Jiang, Y.M. and Wang, Y.H. and Chen, X.Y. and Chen, Y.C. and Wang, L.M. and Lin, D. and Qiao, Y. and Liu, Z.W.",
TITLE = "VBench++: Comprehensive and Versatile Benchmark Suite for Video
Generative Models",
JOURNAL = PAMI,
VOLUME = "48",
YEAR = "2026",
NUMBER = "3",
MONTH = "March",
PAGES = "3268-3285",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102292"}
@inproceedings{bb105590,
AUTHOR = "Huang, Z.Q. and He, Y. and Yu, J. and Zhang, F. and Si, C.Y. and Jiang, Y.M. and Zhang, Y.H. and Wu, T.X. and Jin, Q.Y. and Chanpaisit, N. and Wang, Y.H. and Chen, X.Y. and Wang, L.M. and Lin, D. and Qiao, Y. and Liu, Z.W.",
TITLE = "VBench: Comprehensive Benchmark Suite for Video Generative Models",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "21807-21818",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102293"}
@article{bb105591,
AUTHOR = "Chen, Y.H. and Li, H.R. and Jiang, Z.N. and Wen, H. and Zhao, D.B.",
TITLE = "TeViR: Text-to-Video Reward With Diffusion Models for Efficient
Reinforcement Learning",
JOURNAL = SMCS,
VOLUME = "56",
YEAR = "2026",
NUMBER = "2",
MONTH = "February",
PAGES = "893-905",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102294"}
@article{bb105592,
AUTHOR = "Era, Y. and Togo, R. and Maeda, K. and Ogawa, T. and Haseyama, M.",
TITLE = "Generalizing Stylized Motion Generation Method by Introducing
Metadata-Independent Learning and Unified Multiple Motion Dataset",
JOURNAL = MultMed,
VOLUME = "28",
YEAR = "2026",
PAGES = "1884-1893",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102295"}
@article{bb105593,
AUTHOR = "Hu, M.X. and Zhu, M.H. and Zhou, X. and Yan, Q.Q. and Li, S. and Liu, C.J. and Chen, Q.J.",
TITLE = "Efficient Text-Driven Motion Generation via Latent Consistency
Training",
JOURNAL = SMCS,
VOLUME = "56",
YEAR = "2026",
NUMBER = "3",
MONTH = "March",
PAGES = "1506-1519",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102296"}
@article{bb105594,
AUTHOR = "Zhang, Z.C. and Li, X.Y. and Sun, W. and Zhang, Z.C. and Liu, X.H. and Min, X.K. and Zhai, G.T.",
TITLE = "LMVQ: Label-Free Metric-Learning for General AI-Generated Video
Quality Assessment",
JOURNAL = CirSysVideo,
VOLUME = "36",
YEAR = "2026",
NUMBER = "3",
MONTH = "March",
PAGES = "3367-3381",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102297"}
@article{bb105595,
AUTHOR = "Liang, S.Y. and Liu, J.Y. and Zhai, J.C. and Fang, T.M. and Tu, R.C. and Liu, A.S. and Cao, X.C. and Tao, D.C.",
TITLE = "T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models",
JOURNAL = IJCV,
VOLUME = "134",
YEAR = "2026",
NUMBER = "4",
MONTH = "April",
PAGES = "144",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102298"}
@article{bb105596,
AUTHOR = "Shi, Y.Y. and Zou, B. and Deng, X.N. and Zhang, Y.C. and Liu, Z. and Kui, X.Y. and Xu, G. and Si, W.X.",
TITLE = "Integrating frequency-aware mamba with diffusion for 4D volumetric
image synthesis",
JOURNAL = PR,
VOLUME = "175",
YEAR = "2026",
PAGES = "113067",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102299"}
@article{bb105597,
AUTHOR = "Hu, Y. and Chen, C.W.",
TITLE = "MotionPrior: Exploring Efficient Learning of Motion Concepts for
Few-Shot Video Generation",
JOURNAL = IP,
VOLUME = "35",
YEAR = "2026",
PAGES = "3324-3338",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102300"}
@article{bb105598,
AUTHOR = "Zheng, G.C. and Li, X.",
TITLE = "CamI2V-Epipolar: Epipolar-Constrained Block Sparse Attention for
Camera-Controlled Image-to-Video Diffusion Model",
JOURNAL = SPLetters,
VOLUME = "33",
YEAR = "2026",
PAGES = "1401-1405",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102301"}
@article{bb105599,
AUTHOR = "Kwon, S. and Kim, J.Y. and Go, H. and Baek, K.",
TITLE = "Toward stable world models: Measuring and addressing world
instability in generative environments",
JOURNAL = PR,
VOLUME = "177",
YEAR = "2026",
PAGES = "113351",
BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT102302"}
Last update:Aug 19, 2026 at 13:26:35