{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,16]],"date-time":"2026-07-16T19:05:37Z","timestamp":1784228737549,"version":"3.55.0"},"publisher-location":"New York, NY, USA","reference-count":40,"publisher":"ACM","license":[{"start":{"date-parts":[[2026,7,19]],"date-time":"2026-07-19T00:00:00Z","timestamp":1784419200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by-nc-nd\/4.0\/legalcode"}],"funder":[{"DOI":"10.13039\/501100016022","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["92370119"],"award-info":[{"award-number":["92370119"]}],"id":[{"id":"10.13039\/501100016022","id-type":"DOI","asserted-by":"publisher"}]},{"name":"National Natural Science Foundation of China","award":["62376113"],"award-info":[{"award-number":["62376113"]}]}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2026,7,19]]},"DOI":"10.1145\/3799902.3811183","type":"proceedings-article","created":{"date-parts":[[2026,7,16]],"date-time":"2026-07-16T16:15:27Z","timestamp":1784218527000},"page":"1-10","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":0,"title":["SynthVerse: A Large-Scale Diverse Synthetic Dataset for Point Tracking"],"prefix":"10.1145","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-6925-9876","authenticated-orcid":false,"given":"Weiguang","family":"Zhao","sequence":"first","affiliation":[{"name":"Univeristy of Liverpool, Liverpool, United Kingdom and Xi\u2019an Jiaotong-Liverpool University, Suzhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0007-3491-685X","authenticated-orcid":false,"given":"Haoran","family":"Xu","sequence":"additional","affiliation":[{"name":"Zhejiang University, Hangzhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-1203-8279","authenticated-orcid":false,"given":"Xingyu","family":"Miao","sequence":"additional","affiliation":[{"name":"Durham University, Durham, United Kingdom"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0004-4688-7687","authenticated-orcid":false,"given":"Qin","family":"Zhao","sequence":"additional","affiliation":[{"name":"Zhejiang University, Hangzhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-8104-5432","authenticated-orcid":false,"given":"Rui","family":"Zhang","sequence":"additional","affiliation":[{"name":"Xi\u2019an Jiaotong-Liverpool University, Suzhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-3034-9639","authenticated-orcid":false,"given":"Kaizhu","family":"Huang","sequence":"additional","affiliation":[{"name":"Duke Kunshan University, Suzhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0007-1431-2629","authenticated-orcid":false,"given":"Ning","family":"Gao","sequence":"additional","affiliation":[{"name":"Shanghai AI lab, Shanghai, China and Xi\u2019an Jiaotong University, Xi\u2019an, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0002-0167-9644","authenticated-orcid":false,"given":"Peizhou","family":"Cao","sequence":"additional","affiliation":[{"name":"Beihang University, Beijing, China and Shanghai AI lab, Shanghai, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-0990-2161","authenticated-orcid":false,"given":"Mingze","family":"Sun","sequence":"additional","affiliation":[{"name":"Tsinghua University, Beijing, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-0327-4547","authenticated-orcid":false,"given":"Mulin","family":"Yu","sequence":"additional","affiliation":[{"name":"Shanghai AI lab, Shanghai, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0000-8830-3820","authenticated-orcid":false,"given":"Tao","family":"Lu","sequence":"additional","affiliation":[{"name":"Shanghai AI lab, Shanghai, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-1026-2410","authenticated-orcid":false,"given":"Linning","family":"Xu","sequence":"additional","affiliation":[{"name":"Shanghai AI lab, Shanghai, China and The Chinese University of Hong Kong, Hongkong, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-0050-3989","authenticated-orcid":false,"given":"Junting","family":"Dong","sequence":"additional","affiliation":[{"name":"Shanghai AI lab, Shanghai, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-6711-9319","authenticated-orcid":false,"given":"Jiangmiao","family":"Pang","sequence":"additional","affiliation":[{"name":"Shanghai AI lab, Shanghai, China"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"320","published-online":{"date-parts":[[2026,7,19]]},"reference":[{"key":"e_1_3_3_1_2_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.02122"},{"key":"e_1_3_3_1_3_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52734.2025.00662"},{"key":"e_1_3_3_1_4_1","unstructured":"Blender Demo Team. [n. d.]. Blender Demo. https:\/\/www.blender.org\/download\/demo-files\/."},{"key":"e_1_3_3_1_5_1","unstructured":"Blender Studio Team. [n. d.]. Blender Studio. https:\/\/studio.blender.org\/films\/."},{"key":"e_1_3_3_1_6_1","unstructured":"Blender Swap Community. [n. d.]. Blender Swap. https:\/\/blendswap.com\/."},{"key":"e_1_3_3_1_7_1","unstructured":"Wenzhe Cai Jiaqi Peng Yuqiang Yang Yujian Zhang Meng Wei Hanqing Wang Yilun Chen Tai Wang and Jiangmiao Pang. 2025. NavDP: Learning Sim-to-Real Navigation Diffusion Policy with Privileged Information Guidance. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2505.08712 (2025)."},{"key":"e_1_3_3_1_8_1","doi-asserted-by":"crossref","unstructured":"Carl Doersch Ankush Gupta Larisa Markeeva Adria Recasens Lucas Smaira Yusuf Aytar Joao Carreira Andrew Zisserman and Yi Yang. 2022. Tap-vid: A benchmark for tracking any point in a video. Advances in neural information processing systems (NeurIPS) 35 (2022) 13610\u201313626.","DOI":"10.52202\/068431-0989"},{"key":"e_1_3_3_1_9_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.00923"},{"key":"e_1_3_3_1_10_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52734.2025.01138"},{"key":"e_1_3_3_1_11_1","doi-asserted-by":"publisher","DOI":"10.1145\/3721238.3730621"},{"key":"e_1_3_3_1_12_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.00373"},{"key":"e_1_3_3_1_13_1","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-20047-2_4"},{"key":"e_1_3_3_1_14_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2015.381"},{"key":"e_1_3_3_1_15_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51701.2025.00568"},{"key":"e_1_3_3_1_16_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.01271"},{"key":"e_1_3_3_1_17_1","first-page":"18","volume-title":"European Conference on Computer Vision (ECCV)","author":"Karaev Nikita","year":"2024","unstructured":"Nikita Karaev, Ignacio Rocco, Benjamin Graham, Natalia Neverova, Andrea Vedaldi, and Christian Rupprecht. 2024. Cotracker: It is better to track together. In European Conference on Computer Vision (ECCV). Springer, 18\u201335."},{"key":"e_1_3_3_1_18_1","doi-asserted-by":"crossref","unstructured":"Skanda Koppula Ignacio Rocco Yi Yang Joe Heyward Joao Carreira Andrew Zisserman Gabriel Brostow and Carl Doersch. 2024. Tapvid-3d: A benchmark for tracking any point in 3d. Advances in neural information processing systems (NeurIPS) (2024) 82149\u201382165.","DOI":"10.52202\/079017-2611"},{"key":"e_1_3_3_1_19_1","unstructured":"Zhen Li Chuanhao Li Xiaofeng Mao Shaoheng Lin Ming Li Shitian Zhao Zhaopan Xu Xinyue Li Yukang Feng Jianwen Sun et\u00a0al. 2025. Sekai: A Video Dataset towards World Exploration. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2506.15675 (2025)."},{"key":"e_1_3_3_1_20_1","unstructured":"Xinyu Lian Zichao Yu Ruiming Liang Yitong Wang Li\u00a0Ray Luo Kaixu Chen Yuanzhen Zhou Qihong Tang Xudong Xu Zhaoyang Lyu et\u00a0al. 2025. Infinite Mobility: Scalable High-Fidelity Synthesis of Articulated Objects via Procedural Generation. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2503.13424 (2025)."},{"key":"e_1_3_3_1_21_1","unstructured":"Xingyu Miao Junting Dong Qin Zhao Yuhang Yang Junhao Chen and Yang Long. 2026. From Frames to Sequences: Temporally Consistent Human-Centric Dense Prediction. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2602.01661 (2026)."},{"key":"e_1_3_3_1_22_1","unstructured":"Mixamo. [n. d.]. Mixamo. https:\/\/www.mixamo.com\/."},{"key":"e_1_3_3_1_23_1","unstructured":"Tuan\u00a0Duc Ngo Ashkan Mirzaei Guocheng Qian Hanwen Liang Chuang Gan Evangelos Kalogerakis Peter Wonka and Chaoyang Wang. 2025a. DELTAv2: Accelerating Dense 3D Tracking. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2508.01170 (2025)."},{"key":"e_1_3_3_1_24_1","volume-title":"International Conference on Learning Representations (ICLR)","author":"Ngo Tuan\u00a0Duc","year":"2025","unstructured":"Tuan\u00a0Duc Ngo, Peiye Zhuang, Evangelos Kalogerakis, Chuang Gan, Sergey Tulyakov, Hsin-Ying Lee, and Chaoyang Wang. 2025b. DELTA: DENSE EFFICIENT LONG-RANGE 3D TRACKING FOR ANY VIDEO. In International Conference on Learning Representations (ICLR)."},{"key":"e_1_3_3_1_25_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.01842"},{"key":"e_1_3_3_1_26_1","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-58621-8_4"},{"key":"e_1_3_3_1_27_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51701.2025.00013"},{"key":"e_1_3_3_1_28_1","doi-asserted-by":"crossref","unstructured":"Javier Romero Dimitrios Tzionas and Michael\u00a0J Black. 2017. Embodied hands: modeling and capturing hands and bodies together. ACM Transactions on Graphics (TOG) 36 6 (2017) 1\u201317.","DOI":"10.1145\/3130800.3130883"},{"key":"e_1_3_3_1_29_1","unstructured":"Yang Tian Yuyin Yang Yiman Xie Zetao Cai Xu Shi Ning Gao Hangxu Liu Xuekun Jiang Zherui Qiu Feng Yuan et\u00a0al. 2025. InternData-A1: Pioneering High-Fidelity Synthetic Data for Pre-training Generalist Policy. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2511.16651 (2025)."},{"key":"e_1_3_3_1_30_1","unstructured":"Truebones Zoo Community. [n. d.]. Truebones Zoo. https:\/\/truebones.gumroad.com\/l\/skZMC."},{"key":"e_1_3_3_1_31_1","doi-asserted-by":"crossref","unstructured":"Bo Wang Jian Li Yang Yu Li Liu Zhenping Sun and Dewen Hu. 2025a. Scenetracker: Long-term scene flow estimation network. IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI) (2025).","DOI":"10.1109\/TPAMI.2025.3572489"},{"key":"e_1_3_3_1_32_1","unstructured":"Yifan Wang Jianjun Zhou Haoyi Zhu Wenzheng Chang Yang Zhou Zizun Li Junyi Chen Jiangmiao Pang Chunhua Shen and Tong He. 2025b. Permutation-Equivariant Visual Geometry Learning. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2507.13347 (2025)."},{"key":"e_1_3_3_1_33_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.00084"},{"key":"e_1_3_3_1_34_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR42600.2020.01111"},{"key":"e_1_3_3_1_35_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51701.2025.00633"},{"key":"e_1_3_3_1_36_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.01929"},{"key":"e_1_3_3_1_37_1","volume-title":"Advances in neural information processing systems (NeurIPS)","author":"Zhang Bowei","year":"2025","unstructured":"Bowei Zhang, Lei Ke, Adam\u00a0W Harley, and Katerina Fragkiadaki. 2025a. TAPIP3D: Tracking Any Point in Persistent 3D Geometry. In Advances in neural information processing systems (NeurIPS)."},{"key":"e_1_3_3_1_38_1","unstructured":"Chuhan Zhang Guillaume\u00a0Le Moing Skanda Koppula Ignacio Rocco Liliane Momeni Junyu Xie Shuyang Sun Rahul Sukthankar Jo\u00eblle\u00a0K Barral Raia Hadsell et\u00a0al. 2025b. Efficiently Reconstructing Dynamic Scenes One D4RT at a Time. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2512.08924 (2025)."},{"key":"e_1_3_3_1_39_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.01818"},{"key":"e_1_3_3_1_40_1","unstructured":"Weipeng Zhong Peizhou Cao Yichen Jin Li Luo Wenzhe Cai Jingli Lin Hanqing Wang Zhaoyang Lyu Tai Wang Bo Dai et\u00a0al. 2025. Internscenes: A large-scale simulatable indoor scene dataset with realistic layouts. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2509.10813 (2025)."},{"key":"e_1_3_3_1_41_1","unstructured":"Yang Zhou Yifan Wang Jianjun Zhou Wenzheng Chang Haoyu Guo Zizun Li Kaijing Ma Xinyue Li Yating Wang Haoyi Zhu et\u00a0al. 2025. Omniworld: A multi-domain and multi-modal dataset for 4d world modeling. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/2509.12201 (2025)."}],"event":{"name":"SIGGRAPH Conference Papers '26: Special Interest Group on Computer Graphics and Interactive Techniques Conference Conference Papers","location":"Los Angeles CA USA","acronym":"SIGGRAPH Conference Papers '26","sponsor":["SIGGRAPH ACM Special Interest Group on Computer Graphics and Interactive Techniques"]},"container-title":["Proceedings of the Special Interest Group on Computer Graphics and Interactive Techniques Conference Conference Papers"],"original-title":[],"deposited":{"date-parts":[[2026,7,16]],"date-time":"2026-07-16T18:18:12Z","timestamp":1784225892000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3799902.3811183"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,7,19]]},"references-count":40,"alternative-id":["10.1145\/3799902.3811183","10.1145\/3799902"],"URL":"https:\/\/doi.org\/10.1145\/3799902.3811183","relation":{},"subject":[],"published":{"date-parts":[[2026,7,19]]},"assertion":[{"value":"2026-07-19","order":3,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}