{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,16]],"date-time":"2026-07-16T19:05:52Z","timestamp":1784228752525,"version":"3.55.0"},"publisher-location":"New York, NY, USA","reference-count":66,"publisher":"ACM","license":[{"start":{"date-parts":[[2026,7,19]],"date-time":"2026-07-19T00:00:00Z","timestamp":1784419200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0\/legalcode"}],"funder":[{"DOI":"10.13039\/501100004731","name":"Natural Science Foundation of Zhejiang Province","doi-asserted-by":"publisher","award":["LR26F010002"],"award-info":[{"award-number":["LR26F010002"]}],"id":[{"id":"10.13039\/501100004731","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2026,7,19]]},"DOI":"10.1145\/3799902.3811226","type":"proceedings-article","created":{"date-parts":[[2026,7,16]],"date-time":"2026-07-16T16:15:27Z","timestamp":1784218527000},"page":"1-11","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":0,"title":["ReRoPE: Repurposing RoPE for Relative Camera Control"],"prefix":"10.1145","author":[{"ORCID":"https:\/\/orcid.org\/0009-0008-4604-9228","authenticated-orcid":false,"given":"Chunyang","family":"Li","sequence":"first","affiliation":[{"name":"Zhejiang University, Hangzhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0006-3442-1024","authenticated-orcid":false,"given":"Yuanbo","family":"Yang","sequence":"additional","affiliation":[{"name":"Zhejiang University, Hangzhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0001-2732-2240","authenticated-orcid":false,"given":"Jiahao","family":"Shao","sequence":"additional","affiliation":[{"name":"Zhejiang University, Hangzhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0000-5198-9451","authenticated-orcid":false,"given":"Hongyu","family":"Zhou","sequence":"additional","affiliation":[{"name":"Zhejiang University, Munich, Germany"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-6541-9601","authenticated-orcid":false,"given":"Katja","family":"Schwarz","sequence":"additional","affiliation":[{"name":"Independent, Hangzhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-6662-3022","authenticated-orcid":false,"given":"Yiyi","family":"Liao","sequence":"additional","affiliation":[{"name":"Zhejiang University, Hangzhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"320","published-online":{"date-parts":[[2026,7,19]]},"reference":[{"key":"e_1_3_3_2_2_1","unstructured":"Arslan Ali Junjie Bai Maciej Bala Yogesh Balaji Aaron Blakeman Tiffany Cai Jiaxin Cao Tianshi Cao Elizabeth Cha Yu-Wei Chao et\u00a0al. 2025. World simulation with video foundation models for physical ai. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2511.00062 (2025)."},{"key":"e_1_3_3_2_3_1","doi-asserted-by":"crossref","unstructured":"Sherwin Bahmani Ivan Skorokhodov Guocheng Qian Aliaksandr Siarohin Willi Menapace Andrea Tagliasacchi David\u00a0B. Lindell and Sergey Tulyakov. 2024. AC3D: Analyzing and Improving 3D Camera Control in Video Diffusion Transformers. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2411.18673 (2024).","DOI":"10.1109\/CVPR52734.2025.02130"},{"key":"e_1_3_3_2_4_1","volume-title":"International Conference on Learning Representations (ICLR)","author":"Bahmani Sherwin","year":"2025","unstructured":"Sherwin Bahmani, Ivan Skorokhodov, Aliaksandr Siarohin, Willi Menapace, Guocheng Qian, Michael Vasilkovsky, Hsin-Ying Lee, Chaoyang Wang, Jiaxu Zou, Andrea Tagliasacchi, David\u00a0B. Lindell, and Sergey Tulyakov. 2025. VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control. In International Conference on Learning Representations (ICLR). arXiv:https:\/\/arXiv.org\/abs\/2407.12781."},{"key":"e_1_3_3_2_5_1","unstructured":"Jianhong Bai Menghan Xia Xiao Fu Xintao Wang Lianrui Mu Jinwen Cao Zuozhu Liu Haoji Hu Xiang Bai Pengfei Wan et\u00a0al. 2025b. ReCamMaster: Camera-Controlled Generative Rendering from A Single Video. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2503.11647 (2025)."},{"key":"e_1_3_3_2_6_1","unstructured":"Yunpeng Bai Haoxiang Li and Qixing Huang. 2025a. Positional Encoding Field. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2510.20385 (2025)."},{"key":"e_1_3_3_2_7_1","unstructured":"Federico Barbero Alex Vitvitskyi Christos Perivolaropoulos Razvan Pascanu and Petar Veli\u010dkovi\u0107. 2025. Round and Round We Go! What makes Rotary Positional Encodings useful? arxiv:https:\/\/arXiv.org\/abs\/2410.06205\u00a0[cs.LG]"},{"key":"e_1_3_3_2_8_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52734.2025.02023"},{"key":"e_1_3_3_2_9_1","unstructured":"Andreas Blattmann Tim Dockhorn Sumith Kulal Daniel Mendelevitch Maciej Kilian Dominik Lorenz Yam Levi Zion English Vikram Voleti Adam Letts et\u00a0al. 2023a. Stable video diffusion: Scaling latent video diffusion models to large datasets. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2311.15127 (2023)."},{"key":"e_1_3_3_2_10_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.02161"},{"key":"e_1_3_3_2_11_1","unstructured":"Chenjie Cao Jingkai Zhou shikai Li Jingyun Liang Chaohui Yu Fan Wang Xiangyang Xue and Yanwei Fu. 2025. Uni3C: Unifying Precisely 3D-Enhanced Camera and Human Motion Controls for Video Generation. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2504.14899 (2025)."},{"key":"e_1_3_3_2_12_1","unstructured":"Haoyi Duan Yunzhi Zhang Yilun Du and Jiajun Wu. 2025. Ctrl-VI: Controllable Video Synthesis via Variational Inference. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2510.07670 (2025)."},{"key":"e_1_3_3_2_13_1","unstructured":"Abhimanyu Dubey Abhinav Jauhri Abhinav Pandey Abhishek Kadian Ahmad Al-Dahle Aiesha Letman Akhil Mathur Alan Schelten Amy Yang Angela Fan et\u00a0al. 2024. The llama 3 herd of models. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2407.21783 (Meta AI Technical Report) (2024)."},{"key":"e_1_3_3_2_14_1","unstructured":"Yuwei Guo Ceyuan Yang Anyi Rao Zhengyang Liang Yaohui Wang Yu Qiao Maneesh Agrawala Dahua Lin and Bo Dai. 2023. AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning."},{"key":"e_1_3_3_2_15_1","doi-asserted-by":"crossref","unstructured":"Yuwei Guo Ceyuan Yang Ziyan Yang Zhibei Ma Zhijie Lin Zhenheng Yang Dahua Lin and Lu Jiang. 2025. Long Context Tuning for Video Generation. arxiv:https:\/\/arXiv.org\/abs\/2503.10589\u00a0[cs.CV]","DOI":"10.1109\/ICCV51701.2025.01605"},{"key":"e_1_3_3_2_16_1","unstructured":"Yoav HaCohen Nisan Chiprut Benny Brazowski Daniel Shalem Dudu Moshe Eitan Richardson Eran Levin Guy Shiran Nir Zabari Ori Gordon Poriya Panet Sapir Weissbuch Victor Kulikov Yaki Bitterman Zeev Melumian and Ofir Bibi. 2024. LTX-Video: Realtime Video Latent Diffusion. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2501.00103 (2024)."},{"key":"e_1_3_3_2_17_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51701.2025.01246"},{"key":"e_1_3_3_2_18_1","unstructured":"Hao He Hao Zheng Yinghao Xu Tong Wang Jun Wang Hongsheng Li and Ceyuan Yang. 2024. CameraCtrl: Enabling Camera Control for Text-to-Video Generation. arxiv:https:\/\/arXiv.org\/abs\/2404.02101\u00a0[cs.CV]"},{"key":"e_1_3_3_2_19_1","volume-title":"European Conference on Computer Vision (ECCV)","author":"Heo Byeongho","year":"2024","unstructured":"Byeongho Heo, Song Park, Dongyoon Han, and Sangdoo Yun. 2024. Rotary Position Embedding for Vision Transformer. In European Conference on Computer Vision (ECCV)."},{"key":"e_1_3_3_2_20_1","unstructured":"Martin Heusel Hubert Ramsauer Thomas Unterthiner Bernhard Nessler and Sepp Hochreiter. 2017. Gans trained by a two time-scale update rule converge to a local nash equilibrium. Advances in neural information processing systems 30 (2017)."},{"key":"e_1_3_3_2_21_1","first-page":"6840","volume-title":"Advances in Neural Information Processing Systems (NeurIPS)","author":"Ho Jonathan","year":"2020","unstructured":"Jonathan Ho, Ajay Jain, and Pieter Abbeel. 2020. Denoising Diffusion Probabilistic Models. In Advances in Neural Information Processing Systems (NeurIPS) , Vol.\u00a033. Curran Associates, Inc., Virtual, 6840\u20136851."},{"key":"e_1_3_3_2_22_1","unstructured":"Jonathan Ho and Tim Salimans. 2022. Classifier-free diffusion guidance. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2207.12598 (2022)."},{"key":"e_1_3_3_2_23_1","unstructured":"Wenyi Hong Ming Ding Wendi Zheng Xinghan Liu and Jie Tang. 2022. CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers. arxiv:https:\/\/arXiv.org\/abs\/2205.15868\u00a0[cs.CV]"},{"key":"e_1_3_3_2_24_1","unstructured":"Teng Hu Zhentao Yu Zhengguang Zhou Sen Liang Yuan Zhou Qin Lin and Qinglin Lu. 2025. HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation. arxiv:https:\/\/arXiv.org\/abs\/2505.04512\u00a0[cs.CV] https:\/\/arxiv.org\/abs\/2505.04512"},{"key":"e_1_3_3_2_25_1","volume-title":"NVIDIA Research Whitepapers","author":"Huang Jiahui","year":"2025","unstructured":"Jiahui Huang, Qunjie Zhou, Hesam Rabeti, Aleksandr Korovko, Huan Ling, Xuanchi Ren, Tianchang Shen, Jun Gao, Dmitry Slepichev, Chen-Hsuan Lin, Jiawei Ren, Kevin Xie, Joydeep Biswas, Laura Leal-Taixe, and Sanja Fidler. 2025c. ViPE: Video Pose Engine for 3D Geometric Perception. In NVIDIA Research Whitepapers."},{"key":"e_1_3_3_2_26_1","doi-asserted-by":"crossref","unstructured":"Tianyu Huang Wangguandong Zheng Tengfei Wang Yuhao Liu Zhenwei Wang Junta Wu Jie Jiang Hui Li Rynson\u00a0WH Lau Wangmeng Zuo and Chunchao Guo. 2025b. Voyager: Long-Range and World-Consistent Video Diffusion for Explorable 3D Scene Generation. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2506.04225 (2025).","DOI":"10.1145\/3763330"},{"key":"e_1_3_3_2_27_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.02060"},{"key":"e_1_3_3_2_28_1","unstructured":"Zhening Huang Hyeonho Jeong Xuelin Chen Yulia Gryaditskaya Tuanfeng\u00a0Y. Wang Joan Lasenby and Chun-Hao Huang. 2025a. SpaceTimePilot: Generative Rendering of Dynamic Scenes Across Space and Time. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2512.25075 (2025). https:\/\/arxiv.org\/abs\/2512.25075"},{"key":"e_1_3_3_2_29_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51701.2025.01597"},{"key":"e_1_3_3_2_30_1","unstructured":"Weijie Kong Qi Tian Zijian Zhang Rox Min Zuozhuo Dai Jin Zhou Jiangfeng Xiong Xin Li Bo Wu Jianwei Zhang et\u00a0al. 2024b. Hunyuanvideo: A systematic framework for large video generative models. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2412.03603 (2024)."},{"key":"e_1_3_3_2_31_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.00908"},{"key":"e_1_3_3_2_32_1","unstructured":"Black\u00a0Forest Labs. 2024. FLUX. https:\/\/github.com\/black-forest-labs\/flux."},{"key":"e_1_3_3_2_33_1","unstructured":"Ruilong Li Brent Yi Junchen Liu Hang Gao Yi Ma and Angjoo Kanazawa. 2025. Cameras as Relative Positional Encoding. arxiv:https:\/\/arXiv.org\/abs\/2507.10496\u00a0[cs.CV]"},{"key":"e_1_3_3_2_34_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.02092"},{"key":"e_1_3_3_2_35_1","unstructured":"Yaron Lipman Ricky\u00a0TQ Chen Heli Ben-Hamu Maximilian Nickel and Matt Le. 2022. Flow matching for generative modeling. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2210.02747 (2022)."},{"key":"e_1_3_3_2_36_1","unstructured":"Aixin Liu Bei Feng Bing Xue Bingxuan Wang Bochao Wu Chengda Lu Chenggang Zhao Chengqi Deng Chenyu Zhang Chong Ruan et\u00a0al. 2024. Deepseek-v3 technical report. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2412.19437 (2024)."},{"key":"e_1_3_3_2_37_1","doi-asserted-by":"publisher","DOI":"10.1145\/3757377.3763841"},{"key":"e_1_3_3_2_38_1","first-page":"1","volume-title":"Proceedings of the International Conference on Learning Representations (ICLR)","author":"Miyato Takeru","year":"2024","unstructured":"Takeru Miyato, Bernhard Jaeger, Max Welling, and Andreas Geiger. 2024. GTA: A Geometry-Aware Attention Mechanism for Multi-View Transformers. In Proceedings of the International Conference on Learning Representations (ICLR). OpenReview.net, Vienna, Austria, 1\u201318."},{"key":"e_1_3_3_2_39_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.00977"},{"key":"e_1_3_3_2_40_1","unstructured":"William Peebles and Saining Xie. 2022. Scalable Diffusion Models with Transformers. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2212.09748 (2022)."},{"key":"e_1_3_3_2_41_1","unstructured":"QwenTeam. 2024. Qwen2.5: A Party of Foundation Models. https:\/\/qwenlm.github.io\/blog\/qwen2.5\/"},{"key":"e_1_3_3_2_42_1","unstructured":"Xuanchi Ren Tianchang Shen Jiahui Huang Huan Ling Yifan Lu Merlin Nimier-David Thomas M\u00fcller Alexander Keller Sanja Fidler and Jun Gao. 2025. GEN3C: 3D-Informed World-Consistent Video Generation with Precise Camera Control. arxiv:https:\/\/arXiv.org\/abs\/2503.03751\u00a0[cs.CV] To appear in CVPR 2025."},{"key":"e_1_3_3_2_43_1","doi-asserted-by":"publisher","DOI":"10.1145\/3757377.3763946"},{"key":"e_1_3_3_2_44_1","unstructured":"Junyoung Seo Kazumi Fukuda Takashi Shibuya Takuya Narihira Naoki Murata Shoukang Hu Chieh-Hsin Lai Seungryong Kim and Yuki Mitsufuji. 2024. GenWarp: Single Image to Novel Views with Semantic-Preserving Generative Warping. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2405.17251 (2024)."},{"key":"e_1_3_3_2_45_1","unstructured":"Xuelun Shen Zhipeng Cai Wei Yin Matthias M\u00fcller Zijun Li Kaixuan Wang Xiaozhi Chen and Cheng Wang. 2024. Gim: Learning generalizable image matcher from internet videos. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2402.11095 (2024)."},{"key":"e_1_3_3_2_46_1","unstructured":"Oriane Sim\u00e9oni Huy\u00a0V. Vo Maximilian Seitzer Federico Baldassarre Maxime Oquab Cijo Jose Vasil Khalidov Marc Szafraniec Seungeun Yi Micha\u00ebl Ramamonjisoa Francisco Massa Daniel Haziza Luca Wehrstedt Jianyuan Wang Timoth\u00e9e Darcet Th\u00e9o Moutakanni Leonel Sentana Claire Roberts Andrea Vedaldi Jamie Tolan John Brandt Camille Couprie Julien Mairal Herv\u00e9 J\u00e9gou Patrick Labatut and Piotr Bojanowski. 2025. DINOv3. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2508.10104 (2025)."},{"key":"e_1_3_3_2_47_1","unstructured":"Jianlin Su Yu Lu Shengfeng Pan Ahmed Murtadha Bo Wen and Yunfeng Liu. 2021. RoFormer: Enhanced Transformer with Rotary Position Embedding. arxiv:https:\/\/arXiv.org\/abs\/2104.09864\u00a0[cs.CL]"},{"key":"e_1_3_3_2_48_1","volume-title":"International Conference on Computer Vision (ICCV)","author":"Sun Wenqiang","year":"2025","unstructured":"Wenqiang Sun, Shuo Chen, Fangfu Liu, Zilong Chen, Yueqi Duan, Jun Zhang, and Yikai Wang. 2025. DimensionX: Create Any 3D and 4D Scenes from a Single Image with Controllable Video Diffusion. In International Conference on Computer Vision (ICCV)."},{"key":"e_1_3_3_2_49_1","unstructured":"Hugo Touvron Thibaut Lavril Gautier Izacard Xavier Martinet Marie-Anne Lachaux Timoth\u00e9e Lacroix Baptiste Rozi\u00e8re Naman Goyal Eric Hambro Faisal Azhar et\u00a0al. 2023. Llama: Open and efficient foundation language models. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2302.13971 (Meta AI Technical Report) (2023)."},{"key":"e_1_3_3_2_50_1","unstructured":"Thomas Unterthiner Sjoerd Van\u00a0Steenkiste Karol Kurach Raphael Marinier Marcin Michalski and Sylvain Gelly. 2018. Towards accurate generative models of video: A new metric & challenges. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/1812.01717 (2018)."},{"key":"e_1_3_3_2_51_1","doi-asserted-by":"crossref","unstructured":"Basile Van\u00a0Hoorick Rundi Wu Ege Ozguroglu Kyle Sargent Ruoshi Liu Pavel Tokmakov Achal Dave Changxi Zheng and Carl Vondrick. 2024. Generative Camera Dolly: Extreme Monocular Dynamic Novel View Synthesis. European Conference on Computer Vision (ECCV) (2024).","DOI":"10.1007\/978-3-031-72691-0_18"},{"key":"e_1_3_3_2_52_1","unstructured":"Team Wan Ang Wang Baole Ai Bin Wen Chaojie Mao Chen-Wei Xie Di Chen Feiwu Yu Haiming Zhao Jianxiao Yang et\u00a0al. 2025. Wan: Open and Advanced Large-Scale Video Generative Models. arxiv:https:\/\/arXiv.org\/abs\/2503.20314\u00a0[cs.CV]"},{"key":"e_1_3_3_2_53_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52734.2025.00499"},{"key":"e_1_3_3_2_54_1","unstructured":"Yiming Wang Qihang Zhang Shengqu Cai Tong Wu Jan Ackermann Zhengfei Kuang Yang Zheng Frano Raji\u010d Siyu Tang and Gordon Wetzstein. 2025b. BulletTime: Decoupled Control of Time and Camera Pose for Video Generation. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2512.05076 (2025)."},{"key":"e_1_3_3_2_55_1","doi-asserted-by":"publisher","DOI":"10.1145\/3641519.3657518"},{"key":"e_1_3_3_2_56_1","unstructured":"Tong Wu Shuai Yang Ryan Po Yinghao Xu Ziwei Liu Dahua Lin and Gordon Wetzstein. 2025. Video World Models with Long-term Spatial Memory. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2506.05284 (2025)."},{"key":"e_1_3_3_2_57_1","unstructured":"Dejia Xu Weili Nie Chao Liu Sifei Liu Jan Kautz Zhangyang Wang and Arash Vahdat. 2024. CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2406.02509 (2024)."},{"key":"e_1_3_3_2_58_1","unstructured":"Yuhang Yang Shukai Yin Ke Chen and Sifei Liu. 2025. Diffusion as Shader: 3D-aware Video Diffusion for Versatile Video Control. arxiv:https:\/\/arXiv.org\/abs\/2501.03847\u00a0[cs.CV]"},{"key":"e_1_3_3_2_59_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52734.2025.00555"},{"key":"e_1_3_3_2_60_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.00636"},{"key":"e_1_3_3_2_61_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51701.2025.00017"},{"key":"e_1_3_3_2_62_1","unstructured":"Wangbo Yu Jinbo Xing Li Yuan Wenbo Hu Xiaoyu Li Zhipeng Huang Xiangjun Gao Tien-Tsin Wong Ying Shan and Yonghong Tian. 2024b. ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2409.02048 (2024)."},{"key":"e_1_3_3_2_63_1","unstructured":"Cheng Zhang Boying Li Meng Wei Yan-Pei Cao Camilo\u00a0Cruz Gambardella Dinh Phung and Jianfei Cai. 2025b. Unified Camera Positional Encoding for Controlled Video Generation. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2512.07237 (2025)."},{"key":"e_1_3_3_2_64_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52734.2025.00197"},{"key":"e_1_3_3_2_65_1","unstructured":"Hongfei Zhang Kanghao Chen Zixin Zhang Harold\u00a0Haodong Chen Yuanhuiyi Lyu Yuqi Zhang Shuai Yang Kun Zhou and Yingcong Chen. 2025a. DualCamCtrl: Dual-Branch Diffusion Model for Geometry-Aware Camera-Controlled Video Generation. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2511.23127 (2025)."},{"key":"e_1_3_3_2_66_1","volume-title":"International Conference on Learning Representations (ICLR)","author":"Zheng Guangcong","year":"2025","unstructured":"Guangcong Zheng, Teng Li, Rui Jiang, Yehao Lu, Tao Wu, and Xi Li. 2025. CamI2V: Camera-Controlled Image-to-Video Diffusion Model. In International Conference on Learning Representations (ICLR). arXiv:https:\/\/arXiv.org\/abs\/2410.15957."},{"key":"e_1_3_3_2_67_1","unstructured":"Jensen\u00a0(Jinghao) Zhou Hang Gao Vikram Voleti Aaryaman Vasishta Chun-Han Yao Mark Boss Philip Torr Christian Rupprecht and Varun Jampani. 2025. Stable Virtual Camera: Generative View Synthesis with Diffusion Models. arXiv preprint (2025)."}],"event":{"name":"SIGGRAPH Conference Papers '26: Special Interest Group on Computer Graphics and Interactive Techniques Conference Conference Papers","location":"Los Angeles CA USA","acronym":"SIGGRAPH Conference Papers '26","sponsor":["SIGGRAPH ACM Special Interest Group on Computer Graphics and Interactive Techniques"]},"container-title":["Proceedings of the Special Interest Group on Computer Graphics and Interactive Techniques Conference Conference Papers"],"original-title":[],"deposited":{"date-parts":[[2026,7,16]],"date-time":"2026-07-16T18:23:46Z","timestamp":1784226226000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3799902.3811226"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,7,19]]},"references-count":66,"alternative-id":["10.1145\/3799902.3811226","10.1145\/3799902"],"URL":"https:\/\/doi.org\/10.1145\/3799902.3811226","relation":{},"subject":[],"published":{"date-parts":[[2026,7,19]]},"assertion":[{"value":"2026-07-19","order":3,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}