{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,24]],"date-time":"2026-06-24T16:23:50Z","timestamp":1782318230095,"version":"3.54.5"},"publisher-location":"Cham","reference-count":85,"publisher":"Springer Nature Switzerland","isbn-type":[{"value":"9783031729195","type":"print"},{"value":"9783031729201","type":"electronic"}],"license":[{"start":{"date-parts":[[2024,10,1]],"date-time":"2024-10-01T00:00:00Z","timestamp":1727740800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,10,1]],"date-time":"2024-10-01T00:00:00Z","timestamp":1727740800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2025]]},"DOI":"10.1007\/978-3-031-72920-1_7","type":"book-chapter","created":{"date-parts":[[2024,9,30]],"date-time":"2024-09-30T08:02:57Z","timestamp":1727683377000},"page":"111-129","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":31,"title":["Watch Your Steps: Local Image and\u00a0Scene Editing by\u00a0Text Instructions"],"prefix":"10.1007","author":[{"given":"Ashkan","family":"Mirzaei","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Tristan","family":"Aumentado-Armstrong","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Marcus A.","family":"Brubaker","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Jonathan","family":"Kelly","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Alex","family":"Levinshtein","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Konstantinos G.","family":"Derpanis","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Igor","family":"Gilitschenski","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2024,10,1]]},"reference":[{"key":"7_CR1","doi-asserted-by":"crossref","unstructured":"Avrahami, O., Lischinski, D., Fried, O.: Blended diffusion for text-driven editing of natural images. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.01767"},{"key":"7_CR2","unstructured":"Balaji, Y., et al.: eDiff-I: text-to-image diffusion models with ensemble of expert denoisers. arXiv (2022)"},{"key":"7_CR3","doi-asserted-by":"crossref","unstructured":"Barron, J.T., Mildenhall, B., Tancik, M., Hedman, P., Martin-Brualla, R., Srinivasan, P.P.: Mip-NeRF: a multiscale representation for anti-aliasing neural radiance fields. In: ICCV (2021)","DOI":"10.1109\/ICCV48922.2021.00580"},{"key":"7_CR4","doi-asserted-by":"crossref","unstructured":"Barron, J.T., Mildenhall, B., Verbin, D., Srinivasan, P.P., Hedman, P.: Mip-NeRF 360: unbounded anti-aliased neural radiance fields. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.00539"},{"key":"7_CR5","doi-asserted-by":"crossref","unstructured":"Barron, J.T., Mildenhall, B., Verbin, D., Srinivasan, P.P., Hedman, P.: Zip-NeRF: anti-aliased grid-based neural radiance fields. In: ICCV (2023)","DOI":"10.1109\/ICCV51070.2023.01804"},{"key":"7_CR6","doi-asserted-by":"crossref","unstructured":"Brooks, T., Holynski, A., Efros, A.A.: InstructPix2Pix: learning to follow image editing instructions. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.01764"},{"key":"7_CR7","doi-asserted-by":"crossref","unstructured":"Ceylan, D., Huang, C.H.P., Mitra, N.J.: Pix2Video: video editing using image diffusion. In: ICCV (2023)","DOI":"10.1109\/ICCV51070.2023.02121"},{"key":"7_CR8","doi-asserted-by":"crossref","unstructured":"Chen, A., Xu, Z., Geiger, A., Yu, J., Su, H.: Tensorf: tensorial radiance fields. In: ECCV (2022)","DOI":"10.1007\/978-3-031-19824-3_20"},{"key":"7_CR9","doi-asserted-by":"crossref","unstructured":"Chen, Z., Funkhouser, T., Hedman, P., Tagliasacchi, A.: MobileNeRF: exploiting the polygon rasterization pipeline for efficient neural field rendering on mobile architectures. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.01590"},{"key":"7_CR10","unstructured":"Cheng, Y., et al.: Segment and track anything. arXiv preprint arXiv:2305.06558 (2023)"},{"key":"7_CR11","unstructured":"Couairon, G., Verbeek, J., Schwenk, H., Cord, M.: Diffedit: diffusion-based semantic image editing with mask guidance. In: ICLR (2023)"},{"key":"7_CR12","doi-asserted-by":"crossref","unstructured":"Dai, A., Siddiqui, Y., Thies, J., Valentin, J., Niessner, M.: SPSG: self-supervised photometric scene generation from RGB-D scans. In: CVPR (2021)","DOI":"10.1109\/CVPR46437.2021.00179"},{"key":"7_CR13","doi-asserted-by":"crossref","unstructured":"Deng, K., Liu, A., Zhu, J.Y., Ramanan, D.: Depth-supervised NeRF: fewer views and faster training for free. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.01254"},{"key":"7_CR14","unstructured":"Dhariwal, P., Nichol, A.: Diffusion models beat GANs on image synthesis. In: NeurIPS (2021)"},{"key":"7_CR15","unstructured":"Dong, J., Wang, Y.X.: ViCA-NeRF: view-consistency-aware 3D editing of neural radiance fields. In: NeurIPS (2023)"},{"key":"7_CR16","doi-asserted-by":"crossref","unstructured":"Gal, R., Patashnik, O., Maron, H., Chechik, G., Cohen-Or, D.: StyleGAN-NADA: clip-guided domain adaptation of image generators. TOG (2022)","DOI":"10.1145\/3528223.3530164"},{"key":"7_CR17","unstructured":"Geyer, M., Bar-Tal, O., Bagon, S., Dekel, T.: TokenFlow: consistent diffusion features for consistent video editing. In: ICLR (2024)"},{"key":"7_CR18","doi-asserted-by":"crossref","unstructured":"Haque, A., Tancik, M., Efros, A., Holynski, A., Kanazawa, A.: Instruct-NeRF2NeRF: editing 3D scenes with instructions. In: ICCV (2023)","DOI":"10.1109\/ICCV51070.2023.01808"},{"key":"7_CR19","doi-asserted-by":"crossref","unstructured":"Hedman, P., Srinivasan, P.P., Mildenhall, B., Barron, J.T., Debevec, P.: Baking neural radiance fields for real-time view synthesis. In: ICCV (2021)","DOI":"10.1109\/ICCV48922.2021.00582"},{"key":"7_CR20","unstructured":"Hertz, A., Mokady, R., Tenenbaum, J., Aberman, K., Pritch, Y., Cohen-Or, D.: Prompt-to-prompt image editing with cross attention control. In: ICLR (2023)"},{"key":"7_CR21","unstructured":"Ho, J., Jain, A., Abbeel, P.: Denoising diffusion probabilistic models. In: NeurIPS (2020)"},{"key":"7_CR22","unstructured":"Ho, J., Saharia, C., Chan, W., Fleet, D.J., Norouzi, M., Salimans, T.: Cascaded diffusion models for high fidelity image generation. JMLR (2022)"},{"key":"7_CR23","unstructured":"Ho, J., Salimans, T.: Classifier-free diffusion guidance. arXiv preprint arXiv:2207.12598 (2022)"},{"key":"7_CR24","doi-asserted-by":"crossref","unstructured":"Jain, A., Mildenhall, B., Barron, J.T., Abbeel, P., Poole, B.: Zero-shot text-guided object generation with dream fields. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.00094"},{"key":"7_CR25","unstructured":"Jheng, R.F., Wu, T.H., Yeh, J.F., Hsu, W.H.: Free-form 3D scene inpainting with dual-stream GAN. In: BMVC (2022)"},{"key":"7_CR26","doi-asserted-by":"crossref","unstructured":"Kania, K., Yi, K.M., Kowalski, M., Trzci\u0144ski, T., Tagliasacchi, A.: CoNeRF: controllable neural radiance fields. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.01807"},{"key":"7_CR27","doi-asserted-by":"crossref","unstructured":"Kawar, B., et al.: Imagic: text-based real image editing with diffusion models. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.00582"},{"key":"7_CR28","doi-asserted-by":"crossref","unstructured":"Kerbl, B., Kopanas, G., Leimk\u00fchler, T., Drettakis, G.: 3D Gaussian splatting for real-time radiance field rendering. TOG (2023)","DOI":"10.1145\/3592433"},{"key":"7_CR29","unstructured":"Kingma, D.P., Welling, M.: Auto-encoding variational Bayes. arXiv (2022)"},{"key":"7_CR30","doi-asserted-by":"crossref","unstructured":"Kuang, Z., Luan, F., Bi, S., Shu, Z., Wetzstein, G., Sunkavalli, K.: PaletteNeRF: palette-based appearance editing of neural radiance fields. arXiv (2022)","DOI":"10.1109\/CVPR52729.2023.01982"},{"key":"7_CR31","doi-asserted-by":"crossref","unstructured":"Kurz, A., Neff, T., Lv, Z., Zollh\u00f6fer, M., Steinberger, M.: AdaNeRF: adaptive sampling for real-time rendering of neural radiance fields. In: ECCV (2022)","DOI":"10.1007\/978-3-031-19790-1_16"},{"key":"7_CR32","doi-asserted-by":"crossref","unstructured":"Lazova, V., Guzov, V., Olszewski, K., Tulyakov, S., Pons-Moll, G.: Control-NeRF: editable feature volumes for scene rendering and manipulation. In: WACV (2023)","DOI":"10.1109\/WACV56688.2023.00432"},{"key":"7_CR33","doi-asserted-by":"crossref","unstructured":"Li, Z., et al.: CompNVS: novel view synthesis with scene completion. In: ECCV (2022)","DOI":"10.1007\/978-3-031-19769-7_26"},{"key":"7_CR34","doi-asserted-by":"crossref","unstructured":"Lin, C.H., et al.: Magic3D: high-resolution text-to-3D content creation. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.00037"},{"key":"7_CR35","doi-asserted-by":"crossref","unstructured":"Lin, C.H., Ma, W.C., Torralba, A., Lucey, S.: BARF: bundle-adjusting neural radiance fields. In: ICCV (2021)","DOI":"10.1109\/ICCV48922.2021.00569"},{"key":"7_CR36","doi-asserted-by":"crossref","unstructured":"Lindell, D.B., Van\u00a0Veen, D., Park, J.J., Wetzstein, G.: BACON: band-limited coordinate networks for multiscale scene representation. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.01577"},{"key":"7_CR37","unstructured":"Liu, H.K., Shen, I.C., Chen, B.Y.: NeRF-In: free-form NeRF inpainting with RGB-D priors. arXiv (2022)"},{"key":"7_CR38","doi-asserted-by":"crossref","unstructured":"Liu, N., Li, S., Du, Y., Torralba, A., Tenenbaum, J.B.: Compositional visual generation with composable diffusion models. In: ECCV (2023)","DOI":"10.1007\/978-3-031-19790-1_26"},{"key":"7_CR39","doi-asserted-by":"crossref","unstructured":"Liu, R., Wu, R., Hoorick, B.V., Tokmakov, P., Zakharov, S., Vondrick, C.: Zero-1-to-3: zero-shot one image to 3D object. arXiv (2023)","DOI":"10.1109\/ICCV51070.2023.00853"},{"key":"7_CR40","doi-asserted-by":"crossref","unstructured":"Liu, S., Zhang, X., Zhang, Z., Zhang, R., Zhu, J.Y., Russell, B.: Editing conditional radiance fields. In: ICCV (2021)","DOI":"10.1109\/ICCV48922.2021.00572"},{"key":"7_CR41","doi-asserted-by":"crossref","unstructured":"Lugmayr, A., Danelljan, M., Romero, A., Yu, F., Timofte, R., Van\u00a0Gool, L.: Repaint: inpainting using denoising diffusion probabilistic models. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.01117"},{"key":"7_CR42","unstructured":"Max, N., Chen, M.: Local and global illumination in the volume rendering integral. Technical report, Lawrence Livermore National Lab (LLNL), Livermore, CA (United States) (2005)"},{"key":"7_CR43","unstructured":"Meng, C., et al.: SDEdit: guided image synthesis and editing with stochastic differential equations. In: ICLR (2021)"},{"key":"7_CR44","doi-asserted-by":"crossref","unstructured":"Mikaeili, A., Perel, O., Safaee, M., Cohen-Or, D., Mahdavi-Amiri, A.: SKED: sketch-guided text-based 3D editing. arXiv (2023)","DOI":"10.1109\/ICCV51070.2023.01343"},{"key":"7_CR45","doi-asserted-by":"crossref","unstructured":"Mildenhall, B., et al.: Local light field fusion: practical view synthesis with prescriptive sampling guidelines. TOG (2019)","DOI":"10.1145\/3306346.3322980"},{"key":"7_CR46","doi-asserted-by":"crossref","unstructured":"Mildenhall, B., Srinivasan, P.P., Tancik, M., Barron, J.T., Ramamoorthi, R., Ng, R.: NeRF: representing scenes as neural radiance fields for view synthesis. In: ECCV (2020)","DOI":"10.1007\/978-3-030-58452-8_24"},{"key":"7_CR47","doi-asserted-by":"crossref","unstructured":"Mirzaei, A., et al.: Reference-guided controllable inpainting of neural radiance fields. In: ICCV (2023)","DOI":"10.1109\/ICCV51070.2023.01633"},{"key":"7_CR48","doi-asserted-by":"crossref","unstructured":"Mirzaei, A., et al.: SPIn-NeRF: multiview segmentation and perceptual inpainting with neural radiance fields. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.01980"},{"key":"7_CR49","doi-asserted-by":"crossref","unstructured":"Mirzaei, A., Kant, Y., Kelly, J., Gilitschenski, I.: LaTeRF: label and text driven object radiance fields. In: ECCV (2022)","DOI":"10.1007\/978-3-031-20062-5_2"},{"key":"7_CR50","doi-asserted-by":"crossref","unstructured":"Mittal, A., Soundararajan, R., Bovik, A.C.: Making a \u201ccompletely blind\u201d image quality analyzer. IEEE Signal Process. Lett. (2013)","DOI":"10.1109\/LSP.2012.2227726"},{"key":"7_CR51","doi-asserted-by":"crossref","unstructured":"M\u00fcller, T., Evans, A., Schied, C., Keller, A.: Instant neural graphics primitives with a multiresolution hash encoding. TOG (2022)","DOI":"10.1145\/3528223.3530127"},{"key":"7_CR52","unstructured":"Nichol, A.Q., et al.: GLIDE: towards photorealistic image generation and editing with text-guided diffusion models. In: ICML (2022)"},{"key":"7_CR53","doi-asserted-by":"crossref","unstructured":"Parmar, G., Singh, K.K., Zhang, R., Li, Y., Lu, J., Zhu, J.Y.: Zero-shot image-to-image translation. In: SIGGRAPH (2023)","DOI":"10.1145\/3588432.3591513"},{"key":"7_CR54","unstructured":"von Platen, P., et al.: Diffusers: state-of-the-art diffusion models (2022). https:\/\/github.com\/huggingface\/diffusers"},{"key":"7_CR55","unstructured":"Poole, B., Jain, A., Barron, J.T., Mildenhall, B.: DreamFusion: text-to-3D using 2D diffusion. In: ICLR (2023)"},{"key":"7_CR56","unstructured":"Radford, A., et al.: Learning transferable visual models from natural language supervision. In: ICML (2021)"},{"key":"7_CR57","unstructured":"Ramesh, A., Dhariwal, P., Nichol, A., Chu, C., Chen, M.: Hierarchical text-conditional image generation with CLIP latents. arXiv (2022)"},{"key":"7_CR58","doi-asserted-by":"crossref","unstructured":"Reiser, C., et al.: MERF: memory-efficient radiance fields for real-time view synthesis in unbounded scenes. arXiv (2023)","DOI":"10.1145\/3592426"},{"key":"7_CR59","unstructured":"Roeder, G., Wu, Y., Duvenaud, D.: Sticking the landing: simple, lower-variance gradient estimators for variational inference. arXiv (2017)"},{"key":"7_CR60","doi-asserted-by":"crossref","unstructured":"Rombach, R., Blattmann, A., Lorenz, D., Esser, P., Ommer, B.: High-resolution image synthesis with latent diffusion models. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.01042"},{"key":"7_CR61","doi-asserted-by":"crossref","unstructured":"Saharia, C., et al.: Palette: image-to-image diffusion models. In: SIGGRAPH (2022)","DOI":"10.1145\/3528233.3530757"},{"key":"7_CR62","doi-asserted-by":"crossref","unstructured":"Saharia, C., et al.: Photorealistic text-to-image diffusion models with deep language understanding. In: NeurIPS (2022)","DOI":"10.1145\/3528233.3530757"},{"key":"7_CR63","doi-asserted-by":"crossref","unstructured":"Saharia, C., Ho, J., Chan, W., Salimans, T., Fleet, D.J., Norouzi, M.: Image super-resolution via iterative refinement. TPAMI (2022)","DOI":"10.1109\/TPAMI.2022.3204461"},{"key":"7_CR64","doi-asserted-by":"crossref","unstructured":"Fridovich-Keil, S., Yu, A., Tancik, M., Chen, Q., Recht, B., Kanazawa, A.: Plenoxels: radiance fields without neural networks. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.00542"},{"key":"7_CR65","doi-asserted-by":"crossref","unstructured":"Sch\u00f6nberger, J.L., Frahm, J.M.: Structure-from-motion revisited. In: CVPR (2016)","DOI":"10.1109\/CVPR.2016.445"},{"key":"7_CR66","doi-asserted-by":"crossref","unstructured":"Sch\u00f6nberger, J.L., Zheng, E., Pollefeys, M., Frahm, J.M.: Pixelwise view selection for unstructured multi-view stereo. In: ECCV (2016)","DOI":"10.1007\/978-3-319-46487-9_31"},{"key":"7_CR67","unstructured":"Sohl-Dickstein, J., Weiss, E.A., Maheswaranathan, N., Ganguli, S.: Deep unsupervised learning using nonequilibrium thermodynamics. In: PMLR (2015)"},{"key":"7_CR68","unstructured":"Song, J., Meng, C., Ermon, S.: Denoising diffusion implicit models. In: ICLR (2021)"},{"key":"7_CR69","doi-asserted-by":"crossref","unstructured":"Song, S., Yu, F., Zeng, A., Chang, A.X., Savva, M., Funkhouser, T.: Semantic scene completion from a single depth image. In: CVPR (2017)","DOI":"10.1109\/CVPR.2017.28"},{"key":"7_CR70","unstructured":"Song, Y., Ermon, S.: Generative modeling by estimating gradients of the data distribution. In: NeurIPS (2020)"},{"key":"7_CR71","doi-asserted-by":"crossref","unstructured":"Tancik, M., et al.: Nerfstudio: a modular framework for neural radiance field development. In: SIGGRAPH (2023)","DOI":"10.1145\/3588432.3591516"},{"key":"7_CR72","doi-asserted-by":"crossref","unstructured":"Tewari, A., et al.: Advances in neural rendering. In: SIGGRAPH (2021)","DOI":"10.1145\/3450508.3464573"},{"key":"7_CR73","doi-asserted-by":"crossref","unstructured":"Verbin, D., Hedman, P., Mildenhall, B., Zickler, T., Barron, J.T., Srinivasan, P.P.: Ref-NeRF: structured view-dependent appearance for neural radiance fields. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.00541"},{"key":"7_CR74","doi-asserted-by":"crossref","unstructured":"Wang, C., Chai, M., He, M., Chen, D., Liao, J.: CLIP-NeRF: text-and-image driven manipulation of neural radiance fields. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.00381"},{"key":"7_CR75","doi-asserted-by":"crossref","unstructured":"Wang, C., Jiang, R., Chai, M., He, M., Chen, D., Liao, J.: NeRF-Art: text-driven neural radiance fields stylization. In: TVCG (2023)","DOI":"10.1109\/TVCG.2023.3283400"},{"key":"7_CR76","doi-asserted-by":"crossref","unstructured":"Wang, H., Du, X., Li, J., Yeh, R.A., Shakhnarovich, G.: Score Jacobian chaining: lifting pretrained 2D diffusion models for 3D generation. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.01214"},{"key":"7_CR77","doi-asserted-by":"crossref","unstructured":"Wang, Q., et al.: IBRNet: learning multi-view image-based rendering. In: CVPR (2021)","DOI":"10.1109\/CVPR46437.2021.00466"},{"key":"7_CR78","unstructured":"Wang, Z., Lu, C., Wang, Y., Bao, F., Li, C., Su, H., Zhu, J.: ProlificDreamer: high-fidelity and diverse text-to-3D generation with variational score distillation. arXiv (2023)"},{"key":"7_CR79","unstructured":"Wang, Z., Wu, S., Xie, W., Chen, M., Prisacariu, V.A.: NeRF\u2013: neural radiance fields without known camera parameters. arXiv (2021)"},{"key":"7_CR80","doi-asserted-by":"crossref","unstructured":"Weder, S., et al.: Removing objects from neural radiance fields. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.01586"},{"key":"7_CR81","doi-asserted-by":"crossref","unstructured":"Yang, B., et al.: Learning object-compositional neural radiance field for editable scene rendering. In: ICCV (2021)","DOI":"10.1109\/ICCV48922.2021.01352"},{"key":"7_CR82","doi-asserted-by":"crossref","unstructured":"Yu, A., Li, R., Tancik, M., Li, H., Ng, R., Kanazawa, A.: PlenOctrees for real-time rendering of neural radiance fields. In: ICCV (2021)","DOI":"10.1109\/ICCV48922.2021.00570"},{"key":"7_CR83","doi-asserted-by":"crossref","unstructured":"Yu, A., Ye, V., Tancik, M., Kanazawa, A.: pixelNeRF: neural radiance fields from one or few images. In: CVPR (2021)","DOI":"10.1109\/CVPR46437.2021.00455"},{"key":"7_CR84","doi-asserted-by":"crossref","unstructured":"Yuan, Y.J., Sun, Y.T., Lai, Y.K., Ma, Y., Jia, R., Gao, L.: NeRF-editing: geometry editing of neural radiance fields. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.01781"},{"key":"7_CR85","doi-asserted-by":"crossref","unstructured":"Zhang, Z., Li, B., Nie, X., Han, C., Guo, T., Liu, L.: Towards consistent video editing with text-to-image diffusion models. In: NeurIPS (2024)","DOI":"10.1109\/CVPR52729.2023.00584"}],"container-title":["Lecture Notes in Computer Science","Computer Vision \u2013 ECCV 2024"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-031-72920-1_7","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,9,30]],"date-time":"2024-09-30T08:07:33Z","timestamp":1727683653000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-3-031-72920-1_7"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,10,1]]},"ISBN":["9783031729195","9783031729201"],"references-count":85,"URL":"https:\/\/doi.org\/10.1007\/978-3-031-72920-1_7","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,10,1]]},"assertion":[{"value":"1 October 2024","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ECCV","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"European Conference on Computer Vision","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Milan","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Italy","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2024","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"29 September 2024","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"4 October 2024","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"18","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"eccv2024","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"https:\/\/eccv2024.ecva.net\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}