{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,20]],"date-time":"2026-05-20T16:44:50Z","timestamp":1779295490375,"version":"3.51.4"},"publisher-location":"New York, NY, USA","reference-count":60,"publisher":"ACM","funder":[{"DOI":"10.13039\/501100014219","name":"National Science Fund for Distinguished Young Scholars","doi-asserted-by":"publisher","award":["62025603"],"award-info":[{"award-number":["62025603"]}],"id":[{"id":"10.13039\/501100014219","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["U21B2037, U22B2051, U23A20383, U21A20472, 62176222, 62176223, 62176226, 62072386, 62072387, 62072389, 62002305, 62272401"],"award-info":[{"award-number":["U21B2037, U22B2051, U23A20383, U21A20472, 62176222, 62176223, 62176226, 62072386, 62072387, 62072389, 62002305, 62272401"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"name":"Natural Science Foundation of Fujian Province of China","award":["2021J06003, 2022J06001"],"award-info":[{"award-number":["2021J06003, 2022J06001"]}]}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2025,10,27]]},"DOI":"10.1145\/3746027.3755146","type":"proceedings-article","created":{"date-parts":[[2025,10,25]],"date-time":"2025-10-25T07:30:51Z","timestamp":1761377451000},"page":"3673-3682","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":2,"title":["Training-Free Hierarchical Scene Understanding for Gaussian Splatting with Superpoint Graphs"],"prefix":"10.1145","author":[{"ORCID":"https:\/\/orcid.org\/0009-0005-4139-7950","authenticated-orcid":false,"given":"Shaohui","family":"Dai","sequence":"first","affiliation":[{"name":"Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University, Xiamen, Fujian, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0009-0003-4325-6858","authenticated-orcid":false,"given":"Yansong","family":"Qu","sequence":"additional","affiliation":[{"name":"Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University, Xiamen, Fujian, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0009-0001-9142-8197","authenticated-orcid":false,"given":"Zheyan","family":"Li","sequence":"additional","affiliation":[{"name":"Xiamen University, Xiamen, Fujian, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-2932-8953","authenticated-orcid":false,"given":"Xinyang","family":"Li","sequence":"additional","affiliation":[{"name":"Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University, Xiamen, Fujian, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-0800-0609","authenticated-orcid":false,"given":"Shengchuan","family":"Zhang","sequence":"additional","affiliation":[{"name":"Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University, Xiamen, Fujian, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-7645-9606","authenticated-orcid":false,"given":"Liujuan","family":"Cao","sequence":"additional","affiliation":[{"name":"Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University, Xiamen, Fujian, China"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"320","published-online":{"date-parts":[[2025,10,27]]},"reference":[{"key":"e_1_3_2_1_1_1","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2012.120"},{"key":"e_1_3_2_1_2_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.00539"},{"key":"e_1_3_2_1_3_1","volume-title":"PGSR: Planar-based Gaussian Splatting for Efficient and High-Fidelity Surface Reconstruction. ArXiv preprint","author":"Chen Danpeng","year":"2024","unstructured":"Danpeng Chen, Hai Li, Weicai Ye, Yifan Wang, Weijian Xie, Shangjin Zhai, Nan Wang, Haomin Liu, Hujun Bao, and Guofeng Zhang. 2024. PGSR: Planar-based Gaussian Splatting for Efficient and High-Fidelity Surface Reconstruction. ArXiv preprint, Vol. abs\/2406.06521 (2024). https:\/\/arxiv.org\/abs\/2406.06521"},{"key":"e_1_3_2_1_4_1","volume-title":"Luc Van Gool, and Danda Pani Paudel","author":"Cheng Jiahuan","year":"2024","unstructured":"Jiahuan Cheng, Jan-Nico Zaech, Luc Van Gool, and Danda Pani Paudel. 2024. Occam's LGS: An Efficient Approach for Language Gaussian Splatting. ArXiv preprint, Vol. abs\/2412.01807 (2024). https:\/\/arxiv.org\/abs\/2412.01807"},{"key":"e_1_3_2_1_5_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2017.261"},{"key":"e_1_3_2_1_6_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA57147.2024.10610243"},{"key":"e_1_3_2_1_7_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.00512"},{"key":"e_1_3_2_1_8_1","volume-title":"WildSeg3D: Segment Any 3D Objects in the Wild from 2D Images. ArXiv preprint","author":"Guo Yansong","year":"2025","unstructured":"Yansong Guo, Jie Hu, Yansong Qu, and Liujuan Cao. 2025. WildSeg3D: Segment Any 3D Objects in the Wild from 2D Images. ArXiv preprint, Vol. abs\/2503.08407 (2025). https:\/\/arxiv.org\/abs\/2503.08407"},{"key":"e_1_3_2_1_9_1","doi-asserted-by":"publisher","DOI":"10.1145\/3641519.3657428"},{"key":"e_1_3_2_1_10_1","volume-title":"NeRF-DetS: Enhancing Multi-View 3D Object Detection with Sampling-adaptive Network of Continuous NeRF-based Representation. ArXiv preprint","author":"Huang Chi","year":"2024","unstructured":"Chi Huang, Xinyang Li, Shengchuan Zhang, Liujuan Cao, and Rongrong Ji. 2024a. NeRF-DetS: Enhancing Multi-View 3D Object Detection with Sampling-adaptive Network of Continuous NeRF-based Representation. ArXiv preprint, Vol. abs\/2404.13921 (2024). https:\/\/arxiv.org\/abs\/2404.13921"},{"key":"e_1_3_2_1_11_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV48922.2021.00546"},{"key":"e_1_3_2_1_12_1","doi-asserted-by":"publisher","DOI":"10.1145\/3592433"},{"key":"e_1_3_2_1_13_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.01807"},{"key":"e_1_3_2_1_14_1","volume-title":"Advances in Neural Information Processing Systems 35: Annual Conference on Neural Information Processing Systems 2022","author":"Kobayashi Sosuke","year":"2022","unstructured":"Sosuke Kobayashi, Eiichi Matsumoto, and Vincent Sitzmann. 2022. Decomposing NeRF for Editing via Feature Field Distillation. In Advances in Neural Information Processing Systems 35: Annual Conference on Neural Information Processing Systems 2022, NeurIPS 2022, New Orleans, LA, USA, November 28 - December 9, 2022, Sanmi Koyejo, S. Mohamed, A. Agarwal, Danielle Belgrave, K. Cho, and A. Oh (Eds.). http:\/\/papers.nips.cc\/paper_files\/paper\/2022\/hash\/93f250215e4889119807b6fac3a57aec-Abstract-Conference.html"},{"key":"e_1_3_2_1_15_1","volume-title":"Advances in Neural Information Processing Systems 38: Annual Conference on Neural Information Processing Systems 2024","author":"Kulhanek Jonas","year":"2024","unstructured":"Jonas Kulhanek, Songyou Peng, Zuzana Kukelova, Marc Pollefeys, and Torsten Sattler. 2024. WildGaussians: 3D Gaussian Splatting In the Wild. In Advances in Neural Information Processing Systems 38: Annual Conference on Neural Information Processing Systems 2024, NeurIPS 2024, Vancouver, BC, Canada, December 10 - 15, 2024, Amir Globersons, Lester Mackey, Danielle Belgrave, Angela Fan, Ulrich Paquet, Jakub M. Tomczak, and Cheng Zhang (Eds.). http:\/\/papers.nips.cc\/paper_files\/paper\/2024\/hash\/25c0fe7b157821dd3140727dc07461da-Abstract-Conference.html"},{"key":"e_1_3_2_1_16_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2019.00762"},{"key":"e_1_3_2_1_17_1","doi-asserted-by":"publisher","DOI":"10.1137\/17M1113436"},{"key":"e_1_3_2_1_18_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00479"},{"key":"e_1_3_2_1_19_1","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v39i4.32473"},{"key":"e_1_3_2_1_20_1","volume-title":"Language-driven Semantic Segmentation. In The Tenth International Conference on Learning Representations, ICLR 2022","author":"Li Boyi","year":"2022","unstructured":"Boyi Li, Kilian Q. Weinberger, Serge J. Belongie, Vladlen Koltun, and Ren\u00e9 Ranftl. 2022. Language-driven Semantic Segmentation. In The Tenth International Conference on Learning Representations, ICLR 2022, Virtual Event, April 25-29, 2022. OpenReview.net. https:\/\/openreview.net\/forum?id=RriDjddCLN"},{"key":"e_1_3_2_1_21_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.01963"},{"key":"e_1_3_2_1_22_1","volume-title":"Advances in Neural Information Processing Systems 38: Annual Conference on Neural Information Processing Systems 2024","author":"Li Xinyang","year":"2024","unstructured":"Xinyang Li, Zhangyu Lai, Linning Xu, Yansong Qu, Liujuan Cao, Shengchuan Zhang, Bo Dai, and Rongrong Ji. 2024a. Director3D: Real-world Camera Trajectory and 3D Scene Generation from Text. In Advances in Neural Information Processing Systems 38: Annual Conference on Neural Information Processing Systems 2024, NeurIPS 2024, Vancouver, BC, Canada, December 10 - 15, 2024, Amir Globersons, Lester Mackey, Danielle Belgrave, Angela Fan, Ulrich Paquet, Jakub M. Tomczak, and Cheng Zhang (Eds.). http:\/\/papers.nips.cc\/paper_files\/paper\/2024\/hash\/89566c18d5b3e9836e8e16fde010b41d-Abstract-Conference.html"},{"key":"e_1_3_2_1_23_1","volume-title":"SynergyAmodal: Deocclude Anything with Text Control. ArXiv preprint","author":"Li Xinyang","year":"1950","unstructured":"Xinyang Li, Chengjie Yi, Jiawei Lai, Mingbao Lin, Yansong Qu, Shengchuan Zhang, and Liujuan Cao. 2025b. SynergyAmodal: Deocclude Anything with Text Control. ArXiv preprint, Vol. abs\/2504.19506 (2025). https:\/\/arxiv.org\/abs\/2504.19506"},{"key":"e_1_3_2_1_24_1","volume-title":"Scenesplat: Gaussian splatting-based scene understanding with vision-language pretraining. ArXiv preprint","author":"Li Yue","year":"2025","unstructured":"Yue Li, Qi Ma, Runyi Yang, Huapeng Li, Mengjiao Ma, Bin Ren, Nikola Popovic, Nicu Sebe, Ender Konukoglu, Theo Gevers, et al., 2025a. Scenesplat: Gaussian splatting-based scene understanding with vision-language pretraining. ArXiv preprint, Vol. abs\/2503.18052 (2025). https:\/\/arxiv.org\/abs\/2503.18052"},{"key":"e_1_3_2_1_25_1","volume-title":"SuperGSeg: Open-Vocabulary 3D Segmentation with Structured Super-Gaussians. ArXiv preprint","author":"Liang Siyun","year":"2024","unstructured":"Siyun Liang, Sen Wang, Kunyi Li, Michael Niemeyer, Stefano Gasperini, Nassir Navab, and Federico Tombari. 2024. SuperGSeg: Open-Vocabulary 3D Segmentation with Structured Super-Gaussians. ArXiv preprint, Vol. abs\/2412.10231 (2024). https:\/\/arxiv.org\/abs\/2412.10231"},{"key":"e_1_3_2_1_26_1","volume-title":"OV-NeRF: Open-vocabulary Neural Radiance Fields with Vision and Language Foundation Models for 3D Semantic Understanding. ArXiv preprint","author":"Liao Guibiao","year":"2024","unstructured":"Guibiao Liao, Kaichen Zhou, Zhenyu Bao, Kanglin Liu, and Qing Li. 2024. OV-NeRF: Open-vocabulary Neural Radiance Fields with Vision and Language Foundation Models for 3D Semantic Understanding. ArXiv preprint, Vol. abs\/2402.04648 (2024). https:\/\/arxiv.org\/abs\/2402.04648"},{"key":"e_1_3_2_1_27_1","volume-title":"Advances in Neural Information Processing Systems 36: Annual Conference on Neural Information Processing Systems 2023","author":"Liu Kunhao","year":"2023","unstructured":"Kunhao Liu, Fangneng Zhan, Jiahui Zhang, Muyu Xu, Yingchen Yu, Abdulmotaleb El-Saddik, Christian Theobalt, Eric P. Xing, and Shijian Lu. 2023. Weakly Supervised 3D Open-vocabulary Segmentation. In Advances in Neural Information Processing Systems 36: Annual Conference on Neural Information Processing Systems 2023, NeurIPS 2023, New Orleans, LA, USA, December 10 - 16, 2023, Alice Oh, Tristan Naumann, Amir Globerson, Kate Saenko, Moritz Hardt, and Sergey Levine (Eds.). http:\/\/papers.nips.cc\/paper_files\/paper\/2023\/hash\/a76b693f36916a5ed84d6e5b39a0dc03-Abstract-Conference.html"},{"key":"e_1_3_2_1_28_1","volume-title":"Conference on Robot Learning. PMLR, 1610-1620","author":"Lu Shiyang","year":"2023","unstructured":"Shiyang Lu, Haonan Chang, Eric Pu Jing, Abdeslam Boularias, and Kostas Bekris. 2023. Ovir-3d: Open-vocabulary 3d instance retrieval without training on 3d data. In Conference on Robot Learning. PMLR, 1610-1620."},{"key":"e_1_3_2_1_29_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.01952"},{"key":"e_1_3_2_1_30_1","doi-asserted-by":"publisher","DOI":"10.1145\/3503250"},{"key":"e_1_3_2_1_31_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.00385"},{"key":"e_1_3_2_1_32_1","volume-title":"The Eleventh International Conference on Learning Representations, ICLR 2023","author":"Poole Ben","year":"2023","unstructured":"Ben Poole, Ajay Jain, Jonathan T. Barron, and Ben Mildenhall. 2023. DreamFusion: Text-to-3D using 2D Diffusion. In The Eleventh International Conference on Learning Representations, ICLR 2023, Kigali, Rwanda, May 1-5, 2023. OpenReview.net. https:\/\/openreview.net\/pdf?id=FjNys5c7VyY"},{"key":"e_1_3_2_1_33_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.01895"},{"key":"e_1_3_2_1_34_1","volume-title":"Drag Your Gaussian: Effective Drag-Based Editing with Score Distillation for 3D Gaussian Splatting. ArXiv preprint","author":"Qu Yansong","year":"1867","unstructured":"Yansong Qu, Dian Chen, Xinyang Li, Xiaofan Li, Shengchuan Zhang, Liujuan Cao, and Rongrong Ji. 2025a. Drag Your Gaussian: Effective Drag-Based Editing with Score Distillation for 3D Gaussian Splatting. ArXiv preprint, Vol. abs\/2501.18672 (2025). https:\/\/arxiv.org\/abs\/2501.18672"},{"key":"e_1_3_2_1_35_1","doi-asserted-by":"publisher","DOI":"10.1145\/3664647.3680852"},{"key":"e_1_3_2_1_36_1","volume-title":"DeOcc-1-to-3: 3D De-Occlusion from a Single Image via Self-Supervised Multi-View Diffusion. ArXiv preprint","author":"Qu Yansong","year":"2025","unstructured":"Yansong Qu, Shaohui Dai, Xinyang Li, Yuze Wang, You Shen, Liujuan Cao, and Rongrong Ji. 2025b. DeOcc-1-to-3: 3D De-Occlusion from a Single Image via Self-Supervised Multi-View Diffusion. ArXiv preprint, Vol. abs\/2506.21544 (2025). https:\/\/arxiv.org\/abs\/2506.21544"},{"key":"e_1_3_2_1_37_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICME55011.2023.00104"},{"key":"e_1_3_2_1_38_1","volume-title":"Proceedings of the 38th International Conference on Machine Learning, ICML 2021","volume":"8763","author":"Radford Alec","year":"2021","unstructured":"Alec Radford, Jong Wook Kim, Chris Hallacy, Aditya Ramesh, Gabriel Goh, Sandhini Agarwal, Girish Sastry, Amanda Askell, Pamela Mishkin, Jack Clark, Gretchen Krueger, and Ilya Sutskever. 2021. Learning Transferable Visual Models From Natural Language Supervision. In Proceedings of the 38th International Conference on Machine Learning, ICML 2021, 18-24 July 2021, Virtual Event (Proceedings of Machine Learning Research, Vol. 139), Marina Meila and Tong Zhang (Eds.). PMLR, 8748-8763. http:\/\/proceedings.mlr.press\/v139\/radford21a.html"},{"key":"e_1_3_2_1_39_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.01577"},{"key":"e_1_3_2_1_40_1","volume-title":"Spotlesssplats: Ignoring distractors in 3d gaussian splatting. ArXiv preprint","author":"Sabour Sara","year":"2024","unstructured":"Sara Sabour, Lily Goli, George Kopanas, Mark Matthews, Dmitry Lagun, Leonidas Guibas, Alec Jacobson, David J Fleet, and Andrea Tagliasacchi. 2024. Spotlesssplats: Ignoring distractors in 3d gaussian splatting. ArXiv preprint, Vol. abs\/2406.20055 (2024). https:\/\/arxiv.org\/abs\/2406.20055"},{"key":"e_1_3_2_1_41_1","volume-title":"Evolving High-Quality Rendering and Reconstruction in a Unified Framework with Contribution-Adaptive Regularization. ArXiv preprint","author":"Shen You","year":"2025","unstructured":"You Shen, Zhipeng Zhang, Xinyang Li, Yansong Qu, Yu Lin, Shengchuan Zhang, and Liujuan Cao. 2025. Evolving High-Quality Rendering and Reconstruction in a Unified Framework with Contribution-Adaptive Regularization. ArXiv preprint, Vol. abs\/2503.00881 (2025). https:\/\/arxiv.org\/abs\/2503.00881"},{"key":"e_1_3_2_1_42_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.00510"},{"key":"e_1_3_2_1_43_1","doi-asserted-by":"publisher","DOI":"10.1109\/3DV57658.2022.00056"},{"key":"e_1_3_2_1_44_1","doi-asserted-by":"publisher","DOI":"10.24963\/IJCAI.2021\/151"},{"key":"e_1_3_2_1_45_1","volume-title":"Look at the Sky: Sky-aware Efficient 3D Gaussian Splatting in the Wild","author":"Wang Yuze","year":"2025","unstructured":"Yuze Wang, Junyi Wang, Ruicheng Gao, Yansong Qu, Wantong Duan, Shuo Yang, and Yue Qi. 2025a. Look at the Sky: Sky-aware Efficient 3D Gaussian Splatting in the Wild. IEEE Transactions on Visualization and Computer Graphics (2025)."},{"key":"e_1_3_2_1_46_1","volume-title":"WE-GS: An In-the-wild Efficient 3D Gaussian Representation for Unconstrained Photo Collections. ArXiv preprint","author":"Wang Yuze","year":"2024","unstructured":"Yuze Wang, Junyi Wang, and Yue Qi. 2024a. WE-GS: An In-the-wild Efficient 3D Gaussian Representation for Unconstrained Photo Collections. ArXiv preprint, Vol. abs\/2406.02407 (2024). https:\/\/arxiv.org\/abs\/2406.02407"},{"key":"e_1_3_2_1_47_1","volume-title":"SCARF: Scalable Continual Learning Framework for Memory-efficient Multiple Neural Radiance Fields. In Computer Graphics Forum","author":"Wang Yuze","year":"2024","unstructured":"Yuze Wang, Junyi Wang, Chen Wang, Wantong Duan, Yongtang Bao, and Yue Qi. 2024b. SCARF: Scalable Continual Learning Framework for Memory-efficient Multiple Neural Radiance Fields. In Computer Graphics Forum, Vol. 43. Wiley Online Library, e15255."},{"key":"e_1_3_2_1_48_1","volume-title":"RISE-Editing: Rotation-invariant neural point fields with interactive segmentation for fine-grained and efficient editing. Neural Networks","author":"Wang Yuze","year":"2025","unstructured":"Yuze Wang, Junyi Wang, Chen Wang, and Yue Qi. 2025b. RISE-Editing: Rotation-invariant neural point fields with interactive segmentation for fine-grained and efficient editing. Neural Networks (2025), 107304."},{"key":"e_1_3_2_1_49_1","volume-title":"Advances in Neural Information Processing Systems 38: Annual Conference on Neural Information Processing Systems 2024","author":"Wu Yanmin","year":"2024","unstructured":"Yanmin Wu, Jiarui Meng, Haijie Li, Chenming Wu, Yahao Shi, Xinhua Cheng, Chen Zhao, Haocheng Feng, Errui Ding, Jingdong Wang, and Jian Zhang. 2024. OpenGaussian: Towards Point-Level 3D Gaussian-based Open Vocabulary Understanding. In Advances in Neural Information Processing Systems 38: Annual Conference on Neural Information Processing Systems 2024, NeurIPS 2024, Vancouver, BC, Canada, December 10 - 15, 2024, Amir Globersons, Lester Mackey, Danielle Belgrave, Angela Fan, Ulrich Paquet, Jakub M. Tomczak, and Cheng Zhang (Eds.). http:\/\/papers.nips.cc\/paper_files\/paper\/2024\/hash\/21f7b745f73ce0d1f9bcea7f40b1388e-Abstract-Conference.html"},{"key":"e_1_3_2_1_50_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.01977"},{"key":"e_1_3_2_1_51_1","volume-title":"Sam3d: Segment anything in 3d scenes. ArXiv preprint","author":"Yang Yunhan","year":"2023","unstructured":"Yunhan Yang, Xiaoyang Wu, Tong He, Hengshuang Zhao, and Xihui Liu. 2023. Sam3d: Segment anything in 3d scenes. ArXiv preprint, Vol. abs\/2306.03908 (2023). https:\/\/arxiv.org\/abs\/2306.03908"},{"key":"e_1_3_2_1_52_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.00317"},{"key":"e_1_3_2_1_53_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.01839"},{"key":"e_1_3_2_1_54_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCVW60793.2023.00219"},{"key":"e_1_3_2_1_55_1","unstructured":"Xuying Zhang Yutong Liu Yangguang Li Renrui Zhang Yufei Liu Kai Wang Wanli Ouyang Zhiwei Xiong Peng Gao Qibin Hou et al. 2024a. Tar3d: Creating high-quality 3d assets via next-part prediction. ArXiv preprint Vol. abs\/2412.16919 (2024). https:\/\/arxiv.org\/abs\/2412.16919"},{"key":"e_1_3_2_1_56_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.01847"},{"key":"e_1_3_2_1_57_1","volume-title":"Ar-1-to-3: Single image to consistent 3d object generation via next-view prediction. ArXiv preprint","author":"Zhang Xuying","year":"2025","unstructured":"Xuying Zhang, Yupeng Zhou, Kai Wang, Yikai Wang, Zhen Li, Shaohui Jiao, Daquan Zhou, Qibin Hou, and Ming-Ming Cheng. 2025. Ar-1-to-3: Single image to consistent 3d object generation via next-view prediction. ArXiv preprint, Vol. abs\/2503.12929 (2025). https:\/\/arxiv.org\/abs\/2503.12929"},{"key":"e_1_3_2_1_58_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.02048"},{"key":"e_1_3_2_1_59_1","volume-title":"European conference on computer vision. Springer, 145-163","author":"Zhu Zehao","year":"2024","unstructured":"Zehao Zhu, Zhiwen Fan, Yifan Jiang, and Zhangyang Wang. 2024. Fsgs: Real-time few-shot view synthesis using gaussian splatting. In European conference on computer vision. Springer, 145-163."},{"key":"e_1_3_2_1_60_1","volume-title":"Fmgs: Foundation model embedded 3d gaussian splatting for holistic 3d scene understanding. ArXiv preprint","author":"Zuo Xingxing","year":"2024","unstructured":"Xingxing Zuo, Pouya Samangouei, Yunwen Zhou, Yan Di, and Mingyang Li. 2024. Fmgs: Foundation model embedded 3d gaussian splatting for holistic 3d scene understanding. ArXiv preprint, Vol. abs\/2401.01970 (2024). https:\/\/arxiv.org\/abs\/2401.01970"}],"event":{"name":"MM '25: The 33rd ACM International Conference on Multimedia","location":"Dublin Ireland","acronym":"MM '25","sponsor":["SIGMM ACM Special Interest Group on Multimedia"]},"container-title":["Proceedings of the 33rd ACM International Conference on Multimedia"],"original-title":[],"link":[{"URL":"https:\/\/dl.acm.org\/doi\/pdf\/10.1145\/3746027.3755146","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,12,9]],"date-time":"2025-12-09T19:55:58Z","timestamp":1765310158000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3746027.3755146"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,10,27]]},"references-count":60,"alternative-id":["10.1145\/3746027.3755146","10.1145\/3746027"],"URL":"https:\/\/doi.org\/10.1145\/3746027.3755146","relation":{},"subject":[],"published":{"date-parts":[[2025,10,27]]},"assertion":[{"value":"2025-10-27","order":3,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}