{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,27]],"date-time":"2026-07-27T04:59:37Z","timestamp":1785128377639,"version":"3.55.0"},"reference-count":21,"publisher":"Elsevier BV","license":[{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/tdm\/userlicense\/1.0\/"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/legal\/tdmrep-license"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-017"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-012"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-004"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62471168"],"award-info":[{"award-number":["62471168"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100004731","name":"Zhejiang Province Natural Science Foundation","doi-asserted-by":"publisher","award":["LMS26F020015"],"award-info":[{"award-number":["LMS26F020015"]}],"id":[{"id":"10.13039\/501100004731","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/100022963","name":"Key Research and Development Program of Zhejiang Province","doi-asserted-by":"publisher","award":["2025C02155"],"award-info":[{"award-number":["2025C02155"]}],"id":[{"id":"10.13039\/100022963","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["elsevier.com","sciencedirect.com"],"crossmark-restriction":true},"short-container-title":["Pattern Recognition Letters"],"published-print":{"date-parts":[[2026,9]]},"DOI":"10.1016\/j.patrec.2026.05.021","type":"journal-article","created":{"date-parts":[[2026,6,1]],"date-time":"2026-06-01T07:22:17Z","timestamp":1780298537000},"page":"22-28","update-policy":"https:\/\/doi.org\/10.1016\/elsevier_cm_policy","source":"Crossref","is-referenced-by-count":0,"special_numbering":"C","title":["Multi-modal retrieval augmented text-to-3D generation with accelerated sampling"],"prefix":"10.1016","volume":"207","author":[{"given":"Gongyi","family":"Chen","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yakai","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Genfu","family":"Yang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Ping","family":"Yang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xiangquan","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xiaoling","family":"Gu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Bei","family":"Xu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-2103-5037","authenticated-orcid":false,"given":"Zizhao","family":"Wu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"78","reference":[{"key":"10.1016\/j.patrec.2026.05.021_bib0001","article-title":"ConsistentDreamer: view-consistent meshes through balanced multi-view Gaussian optimization","author":"Sahin","year":"2025","journal-title":"Pattern Recognit. Lett."},{"key":"10.1016\/j.patrec.2026.05.021_bib0002","doi-asserted-by":"crossref","DOI":"10.1016\/j.patrec.2020.02.001","article-title":"DV-Net: dual-view network for 3D reconstruction by fusing multiple sets of gated control point clouds","author":"Jia","year":"2020","journal-title":"Pattern Recognit. Lett."},{"key":"10.1016\/j.patrec.2026.05.021_bib0003","doi-asserted-by":"crossref","DOI":"10.1016\/j.patrec.2024.07.002","article-title":"Points2NeRF: generating neural radiance fields from 3D point cloud","author":"Zimny","year":"2024","journal-title":"Pattern Recognit. Lett."},{"key":"10.1016\/j.patrec.2026.05.021_bib0004","series-title":"The Eleventh International Conference on Learning Representations, ICLR","article-title":"DreamFusion: text-to-3D using 2D diffusion","author":"Poole","year":"2023"},{"key":"10.1016\/j.patrec.2026.05.021_bib0005","series-title":"IEEE\/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2023, Vancouver, BC, Canada, June 17-24, 2023","first-page":"12619","article-title":"Score Jacobian chaining: lifting pretrained 2D diffusion models for 3D generation","author":"Wang","year":"2023"},{"key":"10.1016\/j.patrec.2026.05.021_bib0006","series-title":"IEEE\/CVF Conference on Computer Vision and Pattern Recognition, CVPR","first-page":"4456","article-title":"SDFusion: multimodal 3D shape completion, reconstruction, and generation","author":"Cheng","year":"2023"},{"key":"10.1016\/j.patrec.2026.05.021_bib0007","article-title":"Shap-E: generating conditional 3D implicit functions","author":"Jun","year":"2023","journal-title":"CoRR"},{"key":"10.1016\/j.patrec.2026.05.021_bib0008","article-title":"Long-CLIP: unlocking the long-text capability of CLIP","author":"Zhang","year":"2024","journal-title":"CoRR"},{"key":"10.1016\/j.patrec.2026.05.021_bib0009","series-title":"Proceedings of the 38th International Conference on Machine Learning, ICML 2021, 18-24 July 2021, Virtual Event","first-page":"8748","article-title":"Learning transferable visual models from natural language supervision","volume":"139","author":"Radford","year":"2021"},{"key":"10.1016\/j.patrec.2026.05.021_bib0010","series-title":"IEEE\/CVF International Conference on Computer Vision, ICCV","first-page":"9264","article-title":"Zero-1-to-3: zero-shot one image to 3D object","author":"Liu","year":"2023"},{"key":"10.1016\/j.patrec.2026.05.021_bib0011","series-title":"SIGGRAPH Asia 2023 Conference Papers, SA","first-page":"53:1","article-title":"Hyperdreamer: hyper-realistic 3D content generation and editing from a single image","author":"Wu","year":"2023"},{"key":"10.1016\/j.patrec.2026.05.021_bib0012","series-title":"IEEE\/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2023, Vancouver, BC, Canada, June 17-24, 2023","first-page":"300","article-title":"Magic3D: high-resolution text-to-3D content creation","author":"Lin","year":"2023"},{"key":"10.1016\/j.patrec.2026.05.021_bib0013","article-title":"Retrieval-augmented score distillation for text-to-3D generation","author":"Seo","year":"2024","journal-title":"CoRR"},{"key":"10.1016\/j.patrec.2026.05.021_bib0014","series-title":"9th International Conference on Learning Representations, ICLR 2021, Virtual Event, Austria, May 3-7, 2021","article-title":"Denoising diffusion implicit models","author":"Song","year":"2021"},{"key":"10.1016\/j.patrec.2026.05.021_bib0015","series-title":"Advances in Neural Information Processing Systems 35: Annual Conference on Neural Information Processing Systems 2022, NeurIPS 2022, New Orleans, LA, USA, November 28-December 9, 2022","article-title":"DPM-Solver: a fast ODE solver for diffusion probabilistic model sampling in around 10 steps","author":"Lu","year":"2022"},{"key":"10.1016\/j.patrec.2026.05.021_bib0016","series-title":"IEEE\/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2023, Vancouver, BC, Canada, June 17-24, 2023","first-page":"1179","article-title":"ULIP: learning a unified representation of language, images, and point clouds for 3D understanding","author":"Xue","year":"2023"},{"key":"10.1016\/j.patrec.2026.05.021_bib0017","series-title":"2022 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR)","article-title":"High-resolution image synthesis with latent diffusion models","author":"Rombach","year":"2022"},{"key":"10.1016\/j.patrec.2026.05.021_bib0018","unstructured":"M. Armandpour, H. Zheng, A. Sadeghian, A. Sadeghian, M. Zhou, Re-imagine the negative prompt algorithm: transform 2D diffusion into 3D, alleviate janus problem and beyond, (2023). arXiv preprint arXiv: 2304.04968."},{"key":"10.1016\/j.patrec.2026.05.021_bib0019","series-title":"Computer Vision\u2013ACCV 2018: 14th Asian Conference on Computer Vision, Perth, Australia, December 2\u20136, 2018, Revised Selected Papers, Part III 14","first-page":"100","article-title":"Text2shape: generating shapes from natural language by learning joint embeddings","author":"Chen","year":"2019"},{"key":"10.1016\/j.patrec.2026.05.021_bib0020","series-title":"IEEE\/CVF International Conference on Computer Vision, ICCV 2023, Paris, France, October 1-6, 2023","first-page":"11941","article-title":"Sigmoid loss for language image pre-training","author":"Zhai","year":"2023"},{"key":"10.1016\/j.patrec.2026.05.021_bib0021","article-title":"DPM-Solver++: fast solver for guided sampling of diffusion probabilistic models","author":"Lu","year":"2022","journal-title":"CoRR"}],"container-title":["Pattern Recognition Letters"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0167865526001947?httpAccept=text\/xml","content-type":"text\/xml","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0167865526001947?httpAccept=text\/plain","content-type":"text\/plain","content-version":"vor","intended-application":"text-mining"}],"deposited":{"date-parts":[[2026,7,27]],"date-time":"2026-07-27T04:11:18Z","timestamp":1785125478000},"score":1,"resource":{"primary":{"URL":"https:\/\/linkinghub.elsevier.com\/retrieve\/pii\/S0167865526001947"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,9]]},"references-count":21,"alternative-id":["S0167865526001947"],"URL":"https:\/\/doi.org\/10.1016\/j.patrec.2026.05.021","relation":{},"ISSN":["0167-8655"],"issn-type":[{"value":"0167-8655","type":"print"}],"subject":[],"published":{"date-parts":[[2026,9]]},"assertion":[{"value":"Elsevier","name":"publisher","label":"This article is maintained by"},{"value":"Multi-modal retrieval augmented text-to-3D generation with accelerated sampling","name":"articletitle","label":"Article Title"},{"value":"Pattern Recognition Letters","name":"journaltitle","label":"Journal Title"},{"value":"https:\/\/doi.org\/10.1016\/j.patrec.2026.05.021","name":"articlelink","label":"CrossRef DOI link to publisher maintained version"},{"value":"article","name":"content_type","label":"Content Type"},{"value":"\u00a9 2026 Elsevier B.V. All rights are reserved, including those for text and data mining, AI training, and similar technologies.","name":"copyright","label":"Copyright"}]}}