{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,8,2]],"date-time":"2026-08-02T06:45:57Z","timestamp":1785653157205,"version":"3.56.0"},"publisher-location":"Cham","reference-count":30,"publisher":"Springer Nature Switzerland","isbn-type":[{"value":"9783032316653","type":"print"},{"value":"9783032316660","type":"electronic"}],"license":[{"start":{"date-parts":[[2026,8,3]],"date-time":"2026-08-03T00:00:00Z","timestamp":1785715200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2026,8,3]],"date-time":"2026-08-03T00:00:00Z","timestamp":1785715200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2027]]},"DOI":"10.1007\/978-3-032-31666-0_17","type":"book-chapter","created":{"date-parts":[[2026,8,2]],"date-time":"2026-08-02T05:46:34Z","timestamp":1785649594000},"page":"251-266","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["Ilov3Splat: Instance-Level Open-Vocabulary 3D Scene Understanding in\u00a0Gaussian Splatting"],"prefix":"10.1007","author":[{"ORCID":"https:\/\/orcid.org\/0009-0001-7564-2476","authenticated-orcid":false,"given":"Binh Long","family":"Nguyen","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-3466-9218","authenticated-orcid":false,"given":"Kien","family":"Nguyen","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-4316-9001","authenticated-orcid":false,"given":"Sridha","family":"Sridharan","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-8515-6324","authenticated-orcid":false,"given":"Clinton","family":"Fookes","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-8169-3560","authenticated-orcid":false,"given":"Peyman","family":"Moghadam","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2026,8,3]]},"reference":[{"key":"17_CR1","doi-asserted-by":"crossref","unstructured":"Caron, M., et al.: Emerging properties in self-supervised vision transformers. In: ICCV, pp. 9650\u20139660 (2021)","DOI":"10.1109\/ICCV48922.2021.00951"},{"key":"17_CR2","doi-asserted-by":"publisher","unstructured":"Choe, J., Park, C., Rameau, F., Park, J., Kweon, I.S.: PointMixer: MLP-mixer for point cloud understanding. In: Avidan, S., Brostow, G., Ciss\u00e9, M., Farinella, G.M., Hassner, T. (eds.) ECCV, pp. 620\u2013640. Springer, Cham (2022). https:\/\/doi.org\/10.1007\/978-3-031-19812-0_36","DOI":"10.1007\/978-3-031-19812-0_36"},{"key":"17_CR3","doi-asserted-by":"publisher","unstructured":"Choi, S., Song, H., Kim, J., Kim, T., Do, H.: Click-gaussian: interactive segmentation to any 3D gaussians. In: Leonardis, A., Ricci, E., Roth, S., Russakovsky, O., Sattler, T., Varol, G. (eds.) ECCV, pp. 289\u2013305. Springer, Cham (2024). https:\/\/doi.org\/10.1007\/978-3-031-72646-0_17","DOI":"10.1007\/978-3-031-72646-0_17"},{"key":"17_CR4","doi-asserted-by":"crossref","unstructured":"Dai, A., Chang, A.X., Savva, M., Halber, M., Funkhouser, T., Nie\u00dfner, M.: ScanNet: richly-annotated 3D reconstructions of indoor scenes. In: CVPR, pp. 5828\u20135839 (2017)","DOI":"10.1109\/CVPR.2017.261"},{"key":"17_CR5","doi-asserted-by":"crossref","unstructured":"Hausler, S., Hall, D., Mahendren, S., Moghadam, P.: Reg-NF: efficient registration of implicit surfaces within neural fields. In: ICRA, pp. 15409\u201315415 (2024)","DOI":"10.1109\/ICRA57147.2024.10610982"},{"key":"17_CR6","doi-asserted-by":"crossref","unstructured":"Ji, Y., et al.: FastLGS: speeding up language embedded gaussians with feature grid mapping. In: AAAI, vol.\u00a039, pp. 3922\u20133930 (2025)","DOI":"10.1609\/aaai.v39i4.32410"},{"key":"17_CR7","doi-asserted-by":"crossref","unstructured":"Jun-Seong, K., Kim, G., Yu-Ji, K., Wang, Y.C.F., Choe, J., Oh, T.H.: Dr. Splat: directly referring 3D gaussian splatting via direct language embedding registration. In: CVPR, pp. 14137\u201314146 (2025)","DOI":"10.1109\/CVPR52734.2025.01319"},{"issue":"4","key":"17_CR8","doi-asserted-by":"publisher","first-page":"139","DOI":"10.1145\/3592433","volume":"42","author":"B Kerbl","year":"2023","unstructured":"Kerbl, B., Kopanas, G., Leimk\u00fchler, T., Drettakis, G.: 3D gaussian splatting for real-time radiance field rendering. ACM TOG 42(4), 139\u2013140 (2023)","journal-title":"ACM TOG"},{"key":"17_CR9","doi-asserted-by":"crossref","unstructured":"Kerr, J., Kim, C.M., Goldberg, K., Kanazawa, A., Tancik, M.: Lerf: language embedded radiance fields. In: ICCV, pp. 19729\u201319739 (2023)","DOI":"10.1109\/ICCV51070.2023.01807"},{"key":"17_CR10","doi-asserted-by":"crossref","unstructured":"Kim, C.M., Wu, M., Kerr, J., Goldberg, K., Tancik, M., Kanazawa, A.: Garfield: group anything with radiance fields. In: CVPR, pp. 21530\u201321539 (2024)","DOI":"10.1109\/CVPR52733.2024.02034"},{"key":"17_CR11","unstructured":"Kirillov, A., et al.: Segment anything. In: ICCV, pp. 4015\u20134026 (2023)"},{"key":"17_CR12","doi-asserted-by":"crossref","unstructured":"Kobayashi, S., Matsumoto, E., Sitzmann, V.: Decomposing nerf for editing via feature field distillation. In: NeurIPS, vol. 35, pp. 23311\u201323330 (2022)","DOI":"10.52202\/068431-1694"},{"key":"17_CR13","unstructured":"Li, B., Weinberger, K.Q., Belongie, S., Koltun, V., Ranftl, R.: Language-driven semantic segmentation. In: ICLR (2022)"},{"key":"17_CR14","doi-asserted-by":"crossref","unstructured":"Liu, K., et al.: Weakly supervised 3D open-vocabulary segmentation. In: NeurIPS, vol. 36, pp. 53433\u201353456 (2023)","DOI":"10.52202\/075280-2325"},{"issue":"1","key":"17_CR15","doi-asserted-by":"publisher","first-page":"99","DOI":"10.1145\/3503250","volume":"65","author":"B Mildenhall","year":"2021","unstructured":"Mildenhall, B., Srinivasan, P.P., Tancik, M., Barron, J.T., Ramamoorthi, R., Ng, R.: Nerf: representing scenes as neural radiance fields for view synthesis. Commun. ACM 65(1), 99\u2013106 (2021)","journal-title":"Commun. ACM"},{"issue":"4","key":"17_CR16","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3528223.3530127","volume":"41","author":"T M\u00fcller","year":"2022","unstructured":"M\u00fcller, T., Evans, A., Schied, C., Keller, A.: Instant neural graphics primitives with a multiresolution hash encoding. ACM TOG 41(4), 1\u201315 (2022)","journal-title":"ACM TOG"},{"key":"17_CR17","doi-asserted-by":"crossref","unstructured":"Qin, M., Li, W., Zhou, J., Wang, H., Pfister, H.: LangSplat: 3D language gaussian splatting. In: CVPR, pp. 20051\u201320060 (2024)","DOI":"10.1109\/CVPR52733.2024.01895"},{"key":"17_CR18","unstructured":"Radford, A., et\u00a0al.: Learning transferable visual models from natural language supervision. In: ICML, pp. 8748\u20138763 (2021)"},{"issue":"4","key":"17_CR19","doi-asserted-by":"publisher","first-page":"193","DOI":"10.3390\/info11040193","volume":"11","author":"S Raschka","year":"2020","unstructured":"Raschka, S., Patterson, J., Nolet, C.: Machine learning in python: main developments and technology trends in data science, machine learning, and artificial intelligence. Information 11(4), 193 (2020)","journal-title":"Information"},{"key":"17_CR20","doi-asserted-by":"crossref","unstructured":"Shi, J.C., Wang, M., Duan, H.B., Guan, S.H.: Language embedded 3D gaussians for open-vocabulary scene understanding. In: CVPR, pp. 5333\u20135343 (2024)","DOI":"10.1109\/CVPR52733.2024.00510"},{"key":"17_CR21","doi-asserted-by":"crossref","unstructured":"Tancik, M., et al.: Nerfstudio: a modular framework for neural radiance field development. In: ACM SIGGRAPH, pp. 1\u201312 (2023)","DOI":"10.1145\/3588432.3591516"},{"issue":"4","key":"17_CR22","doi-asserted-by":"publisher","first-page":"532","DOI":"10.1177\/02783649241278369","volume":"44","author":"K Vidanapathirana","year":"2025","unstructured":"Vidanapathirana, K., et al.: WildScenes: a benchmark for 2D and 3D semantic segmentation in large-scale natural environments. Int. J. Robot. Res. 44(4), 532\u2013549 (2025)","journal-title":"Int. J. Robot. Res."},{"key":"17_CR23","doi-asserted-by":"crossref","unstructured":"Wu, Y., et al.: OpenGaussian: towards point-level 3D gaussian-based open vocabulary understanding. In: NeurIPS, vol. 37, pp. 19114\u201319138 (2024)","DOI":"10.52202\/079017-0604"},{"key":"17_CR24","doi-asserted-by":"crossref","unstructured":"Yang, B., Pfreundschuh, P., Siegwart, R., Hutter, M., Moghadam, P., Patil, V.: TULIP: transformer for upsampling of lidar point clouds. In: CVPR, pp. 15354\u201315364 (2024)","DOI":"10.1109\/CVPR52733.2024.01454"},{"key":"17_CR25","unstructured":"Yang, Y., Wu, X., He, T., Zhao, H., Liu, X.: Sam3D: segment anything in 3D scenes. arXiv preprint arXiv:2306.03908 (2023)"},{"key":"17_CR26","doi-asserted-by":"publisher","unstructured":"Ye, M., Danelljan, M., Yu, F., Ke, L.: Gaussian grouping: segment and edit anything in 3D scenes. In: Leonardis, A., Ricci, E., Roth, S., Russakovsky, O., Sattler, T., Varol, G. (eds.) ECCV, pp. 162\u2013179. Springer, Cham (2024). https:\/\/doi.org\/10.1007\/978-3-031-73397-0_10","DOI":"10.1007\/978-3-031-73397-0_10"},{"key":"17_CR27","doi-asserted-by":"crossref","unstructured":"Zhang, R., et al.: PointCLIP: point cloud understanding by CLIP. In: CVPR, pp. 8552\u20138562 (2022)","DOI":"10.1109\/CVPR52688.2022.00836"},{"key":"17_CR28","doi-asserted-by":"crossref","unstructured":"Zhi, S., Laidlow, T., Leutenegger, S., Davison, A.J.: In-place scene labelling and understanding with implicit scene representation. In: ICCV, pp. 15838\u201315847 (2021)","DOI":"10.1109\/ICCV48922.2021.01554"},{"key":"17_CR29","doi-asserted-by":"crossref","unstructured":"Zhou, S., et al.: Feature 3DGS: supercharging 3D gaussian splatting to enable distilled feature fields. In: CVPR, pp. 21676\u201321685 (2024)","DOI":"10.1109\/CVPR52733.2024.02048"},{"issue":"2","key":"17_CR30","doi-asserted-by":"publisher","first-page":"611","DOI":"10.1007\/s11263-024-02183-8","volume":"133","author":"X Zuo","year":"2025","unstructured":"Zuo, X., Samangouei, P., Zhou, Y., Di, Y., Li, M.: FMGS: foundation model embedded 3D gaussian splatting for holistic 3D scene understanding. IJCV 133(2), 611\u2013627 (2025)","journal-title":"IJCV"}],"container-title":["Lecture Notes in Computer Science","Pattern Recognition"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-032-31666-0_17","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,8,2]],"date-time":"2026-08-02T05:46:36Z","timestamp":1785649596000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-3-032-31666-0_17"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,8,3]]},"ISBN":["9783032316653","9783032316660"],"references-count":30,"URL":"https:\/\/doi.org\/10.1007\/978-3-032-31666-0_17","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2026,8,3]]},"assertion":[{"value":"3 August 2026","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ICPR","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"International Conference on Pattern Recognition","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Lyon","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"France","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2026","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"17 August 2026","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"22 August 2026","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"28","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"icpr2026","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"https:\/\/icpr2026.org\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}