@inproceedings{bb106300,
        AUTHOR = "Muralikrishnan, S. and Huang, C.H.P. and Ceylan, D. and Mitra, N.J.",
        TITLE = "BLiSS: Bootstrapped Linear Shape Space",
        BOOKTITLE = "3DV24",
        YEAR = "2024",
        PAGES = "569-580",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102992"}

@inproceedings{bb106301,
        AUTHOR = "Ceylan, D. and Huang, C.H.P. and Mitra, N.J.",
        TITLE = "Pix2Video: Video Editing using Image Diffusion",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "23149-23160",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102993"}

@inproceedings{bb106302,
        AUTHOR = "Chai, W.H. and Guo, X. and Wang, G.A. and Lu, Y.",
        TITLE = "StableVideo: Text-driven Consistency-aware Diffusion Video Editing",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "22983-22993",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102994"}

@inproceedings{bb106303,
        AUTHOR = "Qi, C.Y. and Cun, X.D. and Zhang, Y. and Lei, C.Y. and Wang, X.T. and Shan, Y. and Chen, Q.F.",
        TITLE = "FateZero: Fusing Attentions for Zero-shot Text-based Video Editing",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "15886-15896",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102995"}

@inproceedings{bb106304,
        AUTHOR = "Ali, M.H. and Bond, A. and Karacan, L. and Birdal, T. and Erdem, E. and Ceylan, D. and Erdem, A.",
        TITLE = "VidStyleODE: Disentangled Video Editing via StyleGAN and NeuralODEs",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "7489-7500",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102996"}

@inproceedings{bb106305,
        AUTHOR = "Lee, Y.C. and Jang, J.Z.G. and Chen, Y.T. and Qiu, E. and Huang, J.B.",
        TITLE = "Shape-Aware Text-Driven Layered Video Editing",
        BOOKTITLE = CVPR23,
        YEAR = "2023",
        PAGES = "14317-14326",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102997"}

@inproceedings{bb106306,
        AUTHOR = "Fruhstuck, A. and Sarafianos, N. and Xu, Y. and Wonka, P. and Tung, T.",
        TITLE = "VIVE3D: Viewpoint-Independent Video Editing using 3D-Aware GANs",
        BOOKTITLE = CVPR23,
        YEAR = "2023",
        PAGES = "4446-4455",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102998"}

@inproceedings{bb106307,
        AUTHOR = "Shen, Y.J. and Zhang, L. and Xu, K. and Jin, X.J.",
        TITLE = "AutoTransition: Learning to Recommend Video Transition Effects",
        BOOKTITLE = ECCV22,
        YEAR = "2022",
        PAGES = "XXXVIII:285-300",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT102999"}

@inproceedings{bb106308,
        AUTHOR = "Argaw, D.M. and Heilbron, F.C. and Lee, J.Y. and Woodson, M. and Kweon, I.S.",
        TITLE = "The Anatomy of Video Editing: A Dataset and Benchmark Suite for
AI-Assisted Video Editing",
        BOOKTITLE = ECCV22,
        YEAR = "2022",
        PAGES = "VIII:201-218",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103000"}

@inproceedings{bb106309,
        AUTHOR = "Davtyan, A. and Favaro, P.",
        TITLE = "Controllable Video Generation Through Global and Local Motion Dynamics",
        BOOKTITLE = ECCV22,
        YEAR = "2022",
        PAGES = "XVII:68-84",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103001"}

@inproceedings{bb106310,
        AUTHOR = "Ge, S.W. and Hayes, T. and Yang, H. and Yin, X. and Pang, G. and Jacobs, D. and Huang, J.B. and Parikh, D.",
        TITLE = "Long Video Generation with Time-Agnostic VQGAN and Time-Sensitive
Transformer",
        BOOKTITLE = ECCV22,
        YEAR = "2022",
        PAGES = "XVII:102-118",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103002"}

@inproceedings{bb106311,
        AUTHOR = "Huang, J.H. and Jin, Y. and Yi, K.M. and Sigal, L.",
        TITLE = "Layered Controllable Video Generation",
        BOOKTITLE = ECCV22,
        YEAR = "2022",
        PAGES = "XVI:546-564",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103003"}

@inproceedings{bb106312,
        AUTHOR = "Bar Tal, O. and Ofri Amar, D. and Fridman, R. and Kasten, Y. and Dekel, T.",
        TITLE = "Text2LIVE: Text-Driven Layered Image and Video Editing",
        BOOKTITLE = ECCV22,
        YEAR = "2022",
        PAGES = "XV:707-723",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103004"}

@inproceedings{bb106313,
        AUTHOR = "Xu, Y.R. and AlBahar, B. and Huang, J.B.",
        TITLE = "Temporally Consistent Semantic Video Editing",
        BOOKTITLE = ECCV22,
        YEAR = "2022",
        PAGES = "XV:357-374",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103005"}

@inproceedings{bb106314,
        AUTHOR = "Mai, L. and Liu, F.",
        TITLE = "Motion-Adjustable Neural Implicit Video Representation",
        BOOKTITLE = CVPR22,
        YEAR = "2022",
        PAGES = "10728-10737",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103006"}

@inproceedings{bb106315,
        AUTHOR = "Menapace, W. and Lathuiliere, S. and Siarohin, A. and Theobalt, C. and Tulyakov, S. and Golyanik, V. and Ricci, E.",
        TITLE = "Playable Environments: Video Manipulation in Space and Time",
        BOOKTITLE = CVPR22,
        YEAR = "2022",
        PAGES = "3574-3583",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103007"}

@inproceedings{bb106316,
        AUTHOR = "Fu, T.J. and Wang, X.E. and Grafton, S.T. and Eckstein, M.P. and Wang, W.Y.",
        TITLE = "M3L: Language-based Video Editing via Multi-Modal Multi-Level
Transformers",
        BOOKTITLE = CVPR22,
        YEAR = "2022",
        PAGES = "10503-10512",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103008"}

@inproceedings{bb106317,
        AUTHOR = "Ardino, P. and de Nadai, M. and Lepri, B. and Ricci, E. and Lathuiliere, S.",
        TITLE = "Click to Move: Controlling Video Generation with Sparse Motion",
        BOOKTITLE = ICCV21,
        YEAR = "2021",
        PAGES = "14729-14738",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103009"}

@inproceedings{bb106318,
        AUTHOR = "Kumar, B.G.V. and Subramanian, J. and Chordia, V. and Bart, E. and Fang, S.B. and Guan, K. and Bala, R.",
        TITLE = "STRIVE: Scene Text Replacement In Videos",
        BOOKTITLE = ICCV21,
        YEAR = "2021",
        PAGES = "14529-14538",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103010"}

@inproceedings{bb106319,
        AUTHOR = "Koorathota, S. and Adelman, P. and Cotton, K. and Sajda, P.",
        TITLE = "Editing like Humans: A Contextual, Multimodal Framework for Automated
Video Editing",
        BOOKTITLE = MULA21,
        YEAR = "2021",
        PAGES = "1701-1709",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103011"}

@inproceedings{bb106320,
        AUTHOR = "Bermudez, L. and Dabby, N. and Lin, Y.X.A. and Hilmarsdottir, S. and Sundararajan, N. and Kar, S.",
        TITLE = "A Learning-Based Approach to Parametric Rotoscoping of Multi-Shape
Systems",
        BOOKTITLE = WACV21,
        YEAR = "2021",
        PAGES = "776-785",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103012"}

@inproceedings{bb106321,
        AUTHOR = "Tripathi, S. and Chandra, S. and Agrawal, A. and Tyagi, A. and Rehg, J.M. and Chari, V.",
        TITLE = "Learning to Generate Synthetic Data via Compositing",
        BOOKTITLE = CVPR19,
        YEAR = "2019",
        PAGES = "461-470",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103013"}

@inproceedings{bb106322,
        AUTHOR = "Meyer, S. and Sorkine Hornung, A. and Gross, M.",
        TITLE = "Phase-Based Modification Transfer for Video",
        BOOKTITLE = ECCV16,
        YEAR = "2016",
        PAGES = "III: 633-648",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103014"}

@inproceedings{bb106323,
        AUTHOR = "Taylor, W. and Qureshi, F.Z.",
        TITLE = "Automatic video editing for sensor-rich videos",
        BOOKTITLE = WACV16,
        YEAR = "2016",
        PAGES = "1-9",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103015"}

@inproceedings{bb106324,
        AUTHOR = "Manickam, N. and Chandran, S.",
        TITLE = "Automontage: Photo sessions made easy",
        BOOKTITLE = ICIP13,
        YEAR = "2013",
        PAGES = "1321-1325",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103016"}

@inproceedings{bb106325,
        AUTHOR = "Chen, J.W. and Paris, S. and Wang, J. and Matusik, W. and Cohen, M. and Durand, F.",
        TITLE = "The video mesh: A data structure for image-based three-dimensional
video editing",
        BOOKTITLE = ICCP11,
        YEAR = "2011",
        PAGES = "1-8",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103017"}

@inproceedings{bb106326,
        AUTHOR = "Durand, F. and Cohen, M. and Chen, J.W. and Paris, S. and Wang, J. and Matusik, W.",
        TITLE = "The Video Mesh: A Data Structure for Image-based Video Editing",
        BOOKTITLE = CSAIL,
        YEAR = "2009",
        PAGES = "TR-2009-062",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103018"}

@inproceedings{bb106327,
        AUTHOR = "Rajgopalan, V. and Ranganathan, A. and Rajagopalan, R. and Mudur, S.P.",
        TITLE = "Keyframe-Guided Automatic Non-linear Video Editing",
        BOOKTITLE = ICPR10,
        YEAR = "2010",
        PAGES = "3236-3239",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103019"}

@inproceedings{bb106328,
        AUTHOR = "Yoshitaka, A. and Deguchi, Y.",
        TITLE = "Rendition-based video editing for public contents authoring",
        BOOKTITLE = ICIP09,
        YEAR = "2009",
        PAGES = "1825-1828",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103020"}

@inproceedings{bb106329,
        AUTHOR = "Slot, K. and Truelsen, R. and Sporring, J.",
        TITLE = "Content-Aware Video Editing in the Temporal Domain",
        BOOKTITLE = SCIA09,
        YEAR = "2009",
        PAGES = "490-499",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103021"}

@inproceedings{bb106330,
        AUTHOR = "Wang, H.C. and Xu, N. and Raskar, R. and Ahuja, N.",
        TITLE = "Videoshop: A New Framework for Spatio-Temporal Video Editing in
Gradient Domain",
        BOOKTITLE = CVPR05,
        YEAR = "2005",
        PAGES = "II: 1201",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103022"}

@inproceedings{bb106331,
        AUTHOR = "Wang, H.C. and Raskar, R. and Ahuja, N.",
        TITLE = "Seamless video editing",
        BOOKTITLE = ICPR04,
        YEAR = "2004",
        PAGES = "III: 858-861",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103023"}

@inproceedings{bb106332,
        AUTHOR = "Kumano, M. and Ariki, Y. and Amano, M. and Uehara, K. and Shunto, K. and Tsukada, K.",
        TITLE = "Video editing support system based on video grammar and content
analysis",
        BOOKTITLE = ICPR02,
        YEAR = "2002",
        PAGES = "II: 1031-1036",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ve1.html#TT103024"}

@article{bb106333,
        AUTHOR = "Zhang, J. and Mei, K.Z. and Zheng, Y. and Fan, J.P.",
        TITLE = "Exploiting Mid-Level Semantics for Large-Scale Complex Video
Classification",
        JOURNAL = MultMed,
        VOLUME = "21",
        YEAR = "2019",
        NUMBER = "10",
        MONTH = "October",
        PAGES = "2518-2530",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103025"}

@inproceedings{bb106334,
        AUTHOR = "Zhang, J. and Mei, K.Z. and Wang, X. and Zheng, Y. and Fan, J.P.",
        TITLE = "From Text to Video: Exploiting Mid-Level Semantics for Large-Scale
Video Classification",
        BOOKTITLE = ICPR18,
        YEAR = "2018",
        PAGES = "1695-1700",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103026"}

@article{bb106335,
        AUTHOR = "Yang, M. and Liu, J.H. and Shen, Y. and Zhao, Z. and Chen, X.J. and Wu, Q.Y. and Li, C.M.",
        TITLE = "An Ensemble of Generation- and Retrieval-Based Image Captioning With
Dual Generator Generative Adversarial Network",
        JOURNAL = IP,
        VOLUME = "29",
        YEAR = "2020",
        PAGES = "9627-9640",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103027"}

@article{bb106336,
        AUTHOR = "Chen, Q. and Wu, Q. and Chen, J. and Wu, Q.Y. and van den Hengel, A.J. and Tan, M.K.",
        TITLE = "Scripted Video Generation With a Bottom-Up Generative Adversarial
Network",
        JOURNAL = IP,
        VOLUME = "29",
        YEAR = "2020",
        PAGES = "7454-7467",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103028"}

@article{bb106337,
        AUTHOR = "Sheng, L. and Pan, J.T. and Guo, J.M. and Shao, J. and Loy, C.C.",
        TITLE = "High-Quality Video Generation from Static Structural Annotations",
        JOURNAL = IJCV,
        VOLUME = "128",
        YEAR = "2020",
        NUMBER = "10-11",
        MONTH = "November",
        PAGES = "2552-2569",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103029"}

@article{bb106338,
        AUTHOR = "Sener, F. and Saraf, R. and Yao, A.",
        TITLE = "Transferring Knowledge From Text to Video:
Zero-Shot Anticipation for Procedural Actions",
        JOURNAL = PAMI,
        VOLUME = "45",
        YEAR = "2023",
        NUMBER = "6",
        MONTH = "June",
        PAGES = "7836-7852",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103030"}

@article{bb106339,
        AUTHOR = "Liu, S.Y. and Dragotti, P.L.",
        TITLE = "Sensing Diversity and Sparsity Models for Event Generation and Video
Reconstruction from Events",
        JOURNAL = PAMI,
        VOLUME = "45",
        YEAR = "2023",
        NUMBER = "10",
        MONTH = "October",
        PAGES = "12444-12458",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103031"}

@article{bb106340,
        AUTHOR = "Koksal, A. and Ak, K.E. and Sun, Y. and Rajan, D. and Lim, J.H.",
        TITLE = "Controllable Video Generation With Text-Based Instructions",
        JOURNAL = MultMed,
        VOLUME = "26",
        YEAR = "2024",
        PAGES = "190-201",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103032"}

@article{bb106341,
        AUTHOR = "Liu, J.W. and Wang, W.N. and Chen, S. and Zhu, X.X. and Liu, J.",
        TITLE = "Sounding Video Generator: A Unified Framework for Text-Guided
Sounding Video Generation",
        JOURNAL = MultMed,
        VOLUME = "26",
        YEAR = "2024",
        PAGES = "141-153",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103033"}

@article{bb106342,
        AUTHOR = "Hu, Y. and Luo, C. and Chen, Z.Z.",
        TITLE = "A Benchmark for Controllable Text-Image-to-Video Generation",
        JOURNAL = MultMed,
        VOLUME = "26",
        YEAR = "2024",
        PAGES = "1706-1719",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103034"}

@article{bb106343,
        AUTHOR = "Fang, S. and Dang, T.T. and Wang, S.H. and Huang, Q.M.",
        TITLE = "Linguistic Hallucination for Text-Based Video Retrieval",
        JOURNAL = CirSysVideo,
        VOLUME = "34",
        YEAR = "2024",
        NUMBER = "10",
        MONTH = "October",
        PAGES = "9692-9705",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103035"}

@article{bb106344,
        AUTHOR = "Nadeem, M. and Sohail, S.S. and Cambria, E. and Schuller, B.W. and Hussain, A.",
        TITLE = "Gender Bias in Text-to-Video Generation Models: A Case Study of Sora",
        JOURNAL = IEEE_Int_Sys,
        VOLUME = "40",
        YEAR = "2025",
        NUMBER = "3",
        MONTH = "May",
        PAGES = "10-15",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103036"}

@article{bb106345,
        AUTHOR = "Kuang, Q. and Chen, Y.",
        TITLE = "Visual-Aware Text as Query for Referring Video Object Segmentation",
        JOURNAL = IVC,
        VOLUME = "161",
        YEAR = "2025",
        PAGES = "105608",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103037"}

@article{bb106346,
        AUTHOR = "He, H.G. and Yang, H. and Tuo, Z.X. and Zhou, Y. and Wang, Q.Y. and Zhang, Y.H. and Liu, Z. and Huang, W.H. and Chao, H.Y. and Yin, J.",
        TITLE = "DreamStory: Open-Domain Story Visualization by LLM-Guided
Multi-Subject Consistent Diffusion",
        JOURNAL = PAMI,
        VOLUME = "47",
        YEAR = "2025",
        NUMBER = "12",
        MONTH = "December",
        PAGES = "11874-11891",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103038"}

@article{bb106347,
        AUTHOR = "Wang, X.H. and Kang, Z.X. and Mu, Y.D.",
        TITLE = "Text-Controlled Motion Mamba: Text-Instructed Temporal Grounding of
Human Motion",
        JOURNAL = IP,
        VOLUME = "34",
        YEAR = "2025",
        PAGES = "7079-7092",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103039"}

@article{bb106348,
        AUTHOR = "Wang, F.M. and Wang, W.L. and Gao, D. and Huang, X. and Song, X.D. and Sun, H.Y. and Peng, C.",
        TITLE = "A LLM-guided hybrid Mamba-Transformer architecture for part-to-whole
motion synthesis",
        JOURNAL = CVIU,
        VOLUME = "262",
        YEAR = "2025",
        PAGES = "104549",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103040"}

@article{bb106349,
        AUTHOR = "Huang, Z.Q. and Zhang, F. and Xu, X.J. and He, Y. and Yu, J. and Dong, Z.Y. and Ma, Q.L. and Chanpaisit, N. and Si, C.Y. and Jiang, Y.M. and Wang, Y.H. and Chen, X.Y. and Chen, Y.C. and Wang, L.M. and Lin, D. and Qiao, Y. and Liu, Z.W.",
        TITLE = "VBench++: Comprehensive and Versatile Benchmark Suite for Video
Generative Models",
        JOURNAL = PAMI,
        VOLUME = "48",
        YEAR = "2026",
        NUMBER = "3",
        MONTH = "March",
        PAGES = "3268-3285",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103041"}

@inproceedings{bb106350,
        AUTHOR = "Huang, Z.Q. and He, Y. and Yu, J. and Zhang, F. and Si, C.Y. and Jiang, Y.M. and Zhang, Y.H. and Wu, T.X. and Jin, Q.Y. and Chanpaisit, N. and Wang, Y.H. and Chen, X.Y. and Wang, L.M. and Lin, D. and Qiao, Y. and Liu, Z.W.",
        TITLE = "VBench: Comprehensive Benchmark Suite for Video Generative Models",
        BOOKTITLE = CVPR24,
        YEAR = "2024",
        PAGES = "21807-21818",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103042"}

@article{bb106351,
        AUTHOR = "Chen, Y.H. and Li, H.R. and Jiang, Z.N. and Wen, H. and Zhao, D.B.",
        TITLE = "TeViR: Text-to-Video Reward With Diffusion Models for Efficient
Reinforcement Learning",
        JOURNAL = SMCS,
        VOLUME = "56",
        YEAR = "2026",
        NUMBER = "2",
        MONTH = "February",
        PAGES = "893-905",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103043"}

@article{bb106352,
        AUTHOR = "Era, Y. and Togo, R. and Maeda, K. and Ogawa, T. and Haseyama, M.",
        TITLE = "Generalizing Stylized Motion Generation Method by Introducing
Metadata-Independent Learning and Unified Multiple Motion Dataset",
        JOURNAL = MultMed,
        VOLUME = "28",
        YEAR = "2026",
        PAGES = "1884-1893",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103044"}

@article{bb106353,
        AUTHOR = "Hu, M.X. and Zhu, M.H. and Zhou, X. and Yan, Q.Q. and Li, S. and Liu, C.J. and Chen, Q.J.",
        TITLE = "Efficient Text-Driven Motion Generation via Latent Consistency
Training",
        JOURNAL = SMCS,
        VOLUME = "56",
        YEAR = "2026",
        NUMBER = "3",
        MONTH = "March",
        PAGES = "1506-1519",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103045"}

@article{bb106354,
        AUTHOR = "Zhang, Z.C. and Li, X.Y. and Sun, W. and Zhang, Z.C. and Liu, X.H. and Min, X.K. and Zhai, G.T.",
        TITLE = "LMVQ: Label-Free Metric-Learning for General AI-Generated Video
Quality Assessment",
        JOURNAL = CirSysVideo,
        VOLUME = "36",
        YEAR = "2026",
        NUMBER = "3",
        MONTH = "March",
        PAGES = "3367-3381",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103046"}

@article{bb106355,
        AUTHOR = "Liang, S.Y. and Liu, J.Y. and Zhai, J.C. and Fang, T.M. and Tu, R.C. and Liu, A.S. and Cao, X.C. and Tao, D.C.",
        TITLE = "T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models",
        JOURNAL = IJCV,
        VOLUME = "134",
        YEAR = "2026",
        NUMBER = "4",
        MONTH = "April",
        PAGES = "144",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103047"}

@article{bb106356,
        AUTHOR = "Shi, Y.Y. and Zou, B. and Deng, X.N. and Zhang, Y.C. and Liu, Z. and Kui, X.Y. and Xu, G. and Si, W.X.",
        TITLE = "Integrating frequency-aware mamba with diffusion for 4D volumetric
image synthesis",
        JOURNAL = PR,
        VOLUME = "175",
        YEAR = "2026",
        PAGES = "113067",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103048"}

@article{bb106357,
        AUTHOR = "Hu, Y. and Chen, C.W.",
        TITLE = "MotionPrior: Exploring Efficient Learning of Motion Concepts for
Few-Shot Video Generation",
        JOURNAL = IP,
        VOLUME = "35",
        YEAR = "2026",
        PAGES = "3324-3338",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103049"}

@article{bb106358,
        AUTHOR = "Zheng, G.C. and Li, X.",
        TITLE = "CamI2V-Epipolar: Epipolar-Constrained Block Sparse Attention for
Camera-Controlled Image-to-Video Diffusion Model",
        JOURNAL = SPLetters,
        VOLUME = "33",
        YEAR = "2026",
        PAGES = "1401-1405",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103050"}

@article{bb106359,
        AUTHOR = "Kwon, S. and Kim, J.Y. and Go, H. and Baek, K.",
        TITLE = "Toward stable world models: Measuring and addressing world
instability in generative environments",
        JOURNAL = PR,
        VOLUME = "177",
        YEAR = "2026",
        PAGES = "113351",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103051"}

@article{bb106360,
        AUTHOR = "Tu, Y.P.",
        TITLE = "PlayLife: Tracking-Shot Video Generation",
        JOURNAL = IJCV,
        VOLUME = "134",
        YEAR = "2026",
        NUMBER = "6",
        MONTH = "June",
        PAGES = "266",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103052"}

@article{bb106361,
        AUTHOR = "Yin, Z.Y. and Chen, K. and Bai, X. and Jiang, R. and Li, J.T. and Li, H.D. and Liu, J. and Xiang C, Y. and Yu, J. and Zhang, M.",
        TITLE = "A Survey: Spatiotemporal Consistency in Video Generation",
        JOURNAL = Surveys,
        VOLUME = "58",
        YEAR = "2026",
        NUMBER = "12",
        MONTH = "May",
        PAGES = "xx-yy",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103053"}

@article{bb106362,
        AUTHOR = "Pan, H.H. and Wang, Q.Q. and Zhu, G.Q. and Chen, Y.Y.",
        TITLE = "Text-to-motion retrieval by text-to-motion generation",
        JOURNAL = PR,
        VOLUME = "180",
        YEAR = "2026",
        PAGES = "113983",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103054"}

@article{bb106363,
        AUTHOR = "Fu, X.M. and Lin, J. and Liu, Y. and Wang, Y.W. and Li, G.B. and Lin, L. and Chen, Z.L.",
        TITLE = "In-Context Model Predictive Generation: Open-Vocabulary Motion
Synthesis From Language Models to Physics",
        JOURNAL = IP,
        VOLUME = "35",
        YEAR = "2026",
        PAGES = "7799-7812",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103055"}

@article{bb106364,
        AUTHOR = "Li, Y.H. and Mao, Q. and Xiao, X. and Jin, L. and Ma, S.W.",
        TITLE = "HD-Custom: Efficient Hierarchical Disentanglement for Coarse-to-Fine
Concept Customization in Subject Video Generation",
        JOURNAL = CirSysVideo,
        VOLUME = "36",
        YEAR = "2026",
        NUMBER = "8",
        MONTH = "August",
        PAGES = "11931-11946",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103056"}

@article{bb106365,
        AUTHOR = "Soleimani, E. and Khodabandelou, G.",
        TITLE = "A survey of emerging approaches and advances in video generation",
        JOURNAL = CVIU,
        VOLUME = "270",
        YEAR = "2026",
        PAGES = "104851",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103057"}

@article{bb106366,
        AUTHOR = "Li, Z. and He, Y.S. and Zhong, L. and Shen, W.C. and Zuo, Q. and Qiu, L.T. and Zhu, S.H. and Dong, Z.L. and Yang, L.T. and Xu, C. and Yuan, W.H.",
        TITLE = "MulSMo: Multimodal Stylized Motion Generation by Bidirectional
Control Flow",
        JOURNAL = IP,
        VOLUME = "35",
        YEAR = "2026",
        PAGES = "8719-8733",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103058"}

@article{bb106367,
        AUTHOR = "Ge, Y.C. and Li, C.Y. and Zhu, L.P. and Gao, J. and Lin, X.J.",
        TITLE = "MADM: Bridging Mamba and autoregressive diffusion for text-to-motion
generation",
        JOURNAL = PR,
        VOLUME = "180",
        YEAR = "2026",
        PAGES = "114459",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103059"}

@article{bb106368,
        AUTHOR = "Wang, Z. and Li, A. and Zhu, L.T. and Guo, Y. and Dou, Q. and Li, Z.G.",
        TITLE = "CustomVideo: Customizing Text-to-Video Generation With Multiple
Subjects",
        JOURNAL = MultMed,
        VOLUME = "28",
        YEAR = "2026",
        PAGES = "7137-7150",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103060"}

@inproceedings{bb106369,
        AUTHOR = "Li, X.H. and Zhu, H. and Ren, S. and Yang, L.J. and Wang, P. and Wang, H. and Shen, X.H. and Liu, Q. and Xie, C.",
        TITLE = "LVM-Lite: Training Large Vision Models with Efficient Sequential
Modeling",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "4566-4576",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103061"}

@inproceedings{bb106370,
        AUTHOR = "Wang, X.G. and Cai, B. and Patil, G.D. and Shah, Y.",
        TITLE = "VideoForge: Efficient Domain Adaptation for Video Generation Through
Quality-Driven Rewards and Enhanced LoRA",
        BOOKTITLE = VAQuality26,
        YEAR = "2026",
        PAGES = "1194-1202",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103062"}

@inproceedings{bb106371,
        AUTHOR = "Li, J. and Gao, H.A. and Li, W. and Chi, H.H. and Liu, C.Y. and Du, C.X. and Liu, Y.Q. and Gao, M.J. and Zhang, G.Y. and Zhang, Z.Z. and Yi, L. and Yao, Y. and Zhao, J.W. and Li, H.Y. and Wang, Y.K. and Zhao, H.",
        TITLE = "FB-4D: Spatial-Temporal Coherent Dynamic 3D Content Generation with
Feature Banks",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "5290-5301",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103063"}

@inproceedings{bb106372,
        AUTHOR = "Huang, Y.L. and Wei, P.X. and Dong, Z.C. and Lin, L.",
        TITLE = "Similarity-aware Probabilistic Embeddings Modeling for Video-Text
Retrieval",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "4451-4460",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103064"}

@inproceedings{bb106373,
        AUTHOR = "Zhang, C. and Song, Y. and Desai, R. and Iuzzolino, M.L. and Tighe, J. and Bertasius, G. and Kottur, S.",
        TITLE = "Enhancing Visual Planning with Auxiliary Tasks and Multi-token
Prediction",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "4190-4200",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103065"}

@inproceedings{bb106374,
        AUTHOR = "Liang, H. and Xu, D. and Bhatt, N.P. and Hu, H. and Liang, H.X. and Plataniotis, K.N.",
        TITLE = "Comp4D: Compositional 4D Scene Generation",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "3567-3577",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103066"}

@inproceedings{bb106375,
        AUTHOR = "Koo, J. and Lin, W.T. and Park, C. and Park, C. and Sung, M.",
        TITLE = "BoxSplitGen: A Generative Model for 3D Part Bounding Boxes in Varying
Granularity",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "1777-1787",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103067"}

@inproceedings{bb106376,
        AUTHOR = "Chen, L. and Gu, Y.C. and Mao, Q.",
        TITLE = "UniVid: Unifying Vision Tasks with Pre-trained Video Generation
Models",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "6754-6763",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103068"}

@inproceedings{bb106377,
        AUTHOR = "Zhang, Z.Y. and Liu, L.Q.",
        TITLE = "MoSCo: Real-time and Efficient Text-to-Motion Synthesis via Delta
Training",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "6298-6308",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103069"}

@inproceedings{bb106378,
        AUTHOR = "Han, K. and Lyu, Y.M. and Yu, W.C. and Sebe, N.",
        TITLE = "ATM: Enhanced Alignment for Text-to-Motion Generation",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "6862-6872",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103070"}

@inproceedings{bb106379,
        AUTHOR = "Chen, Y. and Guo, X. and Shi, Z.M. and Song, Z. and Zhang, J.H.",
        TITLE = "T2VWorldBench: A Benchmark for Evaluating World Knowledge in
Text-to-Video Generation",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "6474-6485",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103071"}

@inproceedings{bb106380,
        AUTHOR = "Jang, J.",
        TITLE = "CoreCaption: Core Caption based Text-to-Video Retrieval",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "6600-6610",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103072"}

@inproceedings{bb106381,
        AUTHOR = "Singh, P. and Kulkarni, K. and Raman, S. and Rangwani, H.",
        TITLE = "Synthesizing Compositional Videos from Text Description",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "6775-6784",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103073"}

@inproceedings{bb106382,
        AUTHOR = "Phung, Q. and Mai, L. and Heilbron, F.D.C. and Liu, F. and Huang, J.B. and Ham, C.",
        TITLE = "CineVerse: Consistent Keyframe Synthesis for Cinematic Scene
Composition",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "2626-2636",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103074"}

@inproceedings{bb106383,
        AUTHOR = "Prakash, T. and Susladkar, O. and Dhillon, I.S. and Mittal, S.",
        TITLE = "Pyramidal Spectrum: Frequency-based Hierarchically Vector Quantized
VAE for Videos",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "2073-2082",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103075"}

@inproceedings{bb106384,
        AUTHOR = "Brokman, J. and Rachmil, O. and Hofman, O. and Betser, R. and Giloni, A. and Vainshtein, R. and Kojima, H.",
        TITLE = "Training-free Detection of Text-to-video Generations via
Over-coherence",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "3993-4003",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103076"}

@inproceedings{bb106385,
        AUTHOR = "Kang, J. and Silva, M.B. and Sangkloy, P. and Chen, K. and Williams, N.L. and Sun, Q.",
        TITLE = "GeneVA: A Dataset of Human Annotations for Generative Text to Video
Artifacts",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "6174-6183",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103077"}

@inproceedings{bb106386,
        AUTHOR = "Hong, S.E. and Lim, S. and Hwang, J. and Chang, M. and Kang, H.",
        TITLE = "BiPO: Bidirectional Partial Occlusion Network for Text-to-Motion
Synthesis",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "32-42",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103078"}

@inproceedings{bb106387,
        AUTHOR = "Nakanose, Y. and Nakagawa, C. and Inoue, K. and Yoshioka, M.",
        TITLE = "Temporal Conditioning for Realistic Performance Video Generation from
Instrumental Sounds",
        BOOKTITLE = MVA25,
        YEAR = "2025",
        PAGES = "1-5",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103079"}

@inproceedings{bb106388,
        AUTHOR = "Sun, C.Y. and Han, J.L. and Deng, W.J. and Wang, X.L. and Qin, Z.S. and Gould, S.",
        TITLE = "3D-GPT: Procedural 3D Modeling with Large Language Models",
        BOOKTITLE = "3DV25",
        YEAR = "2025",
        PAGES = "1253-1263",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103080"}

@inproceedings{bb106389,
        AUTHOR = "Zhang, R. and Yu, B. and Min, J.J. and Xin, Y. and Wei, Z. and Shi, J.C.N. and Huang, M.Z. and Kong, X.H. and Xin, N.L. and Jiang, S.S. and Bahuguna, P. and Chan, M. and Hora, K. and Yang, L.J. and Liang, Y.Q. and Bian, R. and Liu, Y.L. and Valencia, I.C. and Tredinick, P.M. and Kozlov, I. and Jiang, S. and Huang, P. and Chen, N. and Liu, X. and Rao, A.",
        TITLE = "Generative AI for Film Creation: A Survey of Recent Advances",
        BOOKTITLE = AIConGen25,
        YEAR = "2025",
        PAGES = "6257-6269",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103081"}

@inproceedings{bb106390,
        AUTHOR = "Li, A.",
        TITLE = "Evaluating Text-to-Video Alignment: A Hierarchical Benchmark for
Video Generation Models",
        BOOKTITLE = ICIVC25,
        YEAR = "2025",
        PAGES = "583-590",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103082"}

@inproceedings{bb106391,
        AUTHOR = "Li, X.M. and Liu, Y.X. and Isobe, T. and Jia, X. and Cui, Q.P. and Zhou, D. and Li, D. and He, Y. and Lu, H.C. and Wang, Z.D. and Barsoum, E.",
        TITLE = "ReNeg: Learning Negative Embedding with Reward Guidance",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "23636-23645",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103083"}

@inproceedings{bb106392,
        AUTHOR = "Deo, A. and Bhat, S. and Karande, S.",
        TITLE = "VisualFusion: Enhancing Blog Content with Advanced Infographic
Pipeline",
        BOOKTITLE = WACV25,
        YEAR = "2025",
        PAGES = "5591-5600",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103084"}

@inproceedings{bb106393,
        AUTHOR = "Shin, C. and Choi, J.Y. and Kim, H. and Yoon, S.",
        TITLE = "Large-Scale Text-to-Image Model with Inpainting is a Zero-Shot
Subject-Driven Image Generator",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "7986-7996",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103085"}

@inproceedings{bb106394,
        AUTHOR = "Liang, F. and Ma, H.Y. and He, Z.C. and Hou, T.B. and Hou, J. and Li, K.P. and Dai, X.L. and Juefei Xu, F. and Azadi, S. and Sinha, A. and Zhang, P.Z. and Vajda, P. and Marculescu, D.",
        TITLE = "Movie Weaver: Tuning-Free Multi-Concept Video Personalization with
Anchored Prompts",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "13146-13156",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103086"}

@inproceedings{bb106395,
        AUTHOR = "Nguyen, T. and Singh, K.K. and Shi, J. and Bui, T. and Lee, Y.J. and Li, Y.H.",
        TITLE = "Yo'Chameleon: Personalized Vision and Language Generation",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "14438-14448",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103087"}

@inproceedings{bb106396,
        AUTHOR = "Wang, H.L. and Ouyang, H. and Wang, Q.Y. and Wang, W. and Cheng, K.L. and Chen, Q.F. and Shen, Y.J. and Wang, L.M.",
        TITLE = "LeviTor: 3D Trajectory Oriented Image-to-Video Synthesis",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "12490-12500",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103088"}

@inproceedings{bb106397,
        AUTHOR = "Lai, Z.H. and Vedaldi, A.",
        TITLE = "Tracktention: Leveraging Point Tracking to Attend Videos Faster and
Better",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "22809-22819",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103089"}

@inproceedings{bb106398,
        AUTHOR = "Ji, B. and Pan, Y. and Liu, Z.M. and Tan, S. and Jin, X.G. and Yang, X.K.",
        TITLE = "POMP: Physics-constrainable Motion Generative Model through Phase
Manifolds",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "22690-22701",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103090"}

@inproceedings{bb106399,
        AUTHOR = "Wang, Y.F. and Yang, P. and Xu, Z. and Sun, J.M. and Zhang, Z. and Chen, Y. and Bao, H.J. and Peng, S. and Zhou, X.W.",
        TITLE = "FreeTimeGS: Free Gaussian Primitives at Anytime Anywhere for Dynamic
Scene Reconstruction",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "21750-21760",
        BIBSOURCE = "http://www.visionbib.com/bibliography/describe490ttvid2.html#TT103091"}

Last update:Sep 30, 2026 at 11:45:00