{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,16]],"date-time":"2026-06-16T02:52:42Z","timestamp":1781578362913,"version":"3.54.5"},"reference-count":32,"publisher":"Springer Science and Business Media LLC","issue":"5-6","license":[{"start":{"date-parts":[[2025,12,1]],"date-time":"2025-12-01T00:00:00Z","timestamp":1764547200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2025,12,1]],"date-time":"2025-12-01T00:00:00Z","timestamp":1764547200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"DOI":"10.13039\/501100004479","name":"Natural Science Foundation of Jiangxi Province","doi-asserted-by":"crossref","award":["20242BAB25073"],"award-info":[{"award-number":["20242BAB25073"]}],"id":[{"id":"10.13039\/501100004479","id-type":"DOI","asserted-by":"crossref"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Mobile Netw Appl"],"published-print":{"date-parts":[[2025,12]]},"DOI":"10.1007\/s11036-026-02495-8","type":"journal-article","created":{"date-parts":[[2026,2,18]],"date-time":"2026-02-18T04:19:04Z","timestamp":1771388344000},"page":"843-855","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["DLPFusion:Natural Language Prompted Infrared and Visible Image Fusion in Drone Scenarios"],"prefix":"10.1007","volume":"30","author":[{"given":"He","family":"Xiao","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yingliang","family":"Wen","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yaoyi","family":"Liu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Jiandong","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Hao","family":"Li","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Huang","family":"Li","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Qiuming","family":"Liu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2026,2,18]]},"reference":[{"issue":"8","key":"2495_CR1","doi-asserted-by":"publisher","first-page":"517","DOI":"10.3390\/drones7080517","volume":"7","author":"S Shen","year":"2023","unstructured":"Shen S, Li D, Mei L, Xu C, Ye Z, Zhang Q, Hong B, Yang W, Wang Y (2023) Dfa-net: multi-scale dense feature-aware network via integrated attention for unmanned aerial vehicle infrared and visible image fusion. Drones 7(8):517","journal-title":"Drones"},{"issue":"6","key":"2495_CR2","first-page":"6","volume":"16","author":"Q Liu","year":"2024","unstructured":"Liu Q, Wang Y, Wu Z, Wei Y, Luo Y, Zhu C (2024) Aerial light field spectrum analysis for unmanned aerial vehicle optimization sampling and rendering in large-scale scenes. IEEE Intell Trans Syst Mag 16(6):6\u201322","journal-title":"IEEE Intell Trans Syst Mag"},{"issue":"8","key":"2495_CR3","doi-asserted-by":"publisher","first-page":"10535","DOI":"10.1109\/TPAMI.2023.3261282","volume":"45","author":"X Zhang","year":"2023","unstructured":"Zhang X, Demiris Y (2023) Visible and infrared image fusion using deep learning. IEEE Trans Pattern Anal Mach Intell 45(8):10535\u201310554","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"2495_CR4","doi-asserted-by":"publisher","unstructured":"Hu X, Liu Y, Yang F (2024) PFCFuse: A Poolformer and CNN Fusion Network for Infrared-Visible Image Fusion. IEEE Trans Instrum Meas 73:1\u201314. https:\/\/doi.org\/10.1109\/TIM.2024.3450061","DOI":"10.1109\/TIM.2024.3450061"},{"key":"2495_CR5","doi-asserted-by":"publisher","first-page":"11","DOI":"10.1016\/j.inffus.2018.09.004","volume":"48","author":"J Ma","year":"2019","unstructured":"Ma J, Yu W, Liang P, Li C, Jiang J (2019) Fusiongan: A generative adversarial network for infrared and visible image fusion. Inf fusion 48:11\u201326","journal-title":"Inf fusion"},{"key":"2495_CR6","doi-asserted-by":"publisher","unstructured":"Guo L, Luo X, Liu Y, Zhang Z, Wu X (2025) SAM-guided multi-level collaborative Transformer for infrared and visible image fusion. Pattern Recognition 162:111391. https:\/\/doi.org\/10.1016\/j.patcog.2025.111391","DOI":"10.1016\/j.patcog.2025.111391"},{"key":"2495_CR7","doi-asserted-by":"crossref","unstructured":"Cai H, Dong J, Tan J, Deng J, Li S, Gao Z, Wang H, Su Z, Sumalee A, Zhong R (2025) Flightgpt: Towards generalizable and interpretable uav vision-and-language navigation with vision-language models. arXiv:2505.12835","DOI":"10.18653\/v1\/2025.emnlp-main.338"},{"key":"2495_CR8","doi-asserted-by":"publisher","first-page":"268","DOI":"10.1016\/j.inffus.2022.12.005","volume":"92","author":"M Han","year":"2023","unstructured":"Han M, Yu K, Qiu J, Li H, Wu D, Rao Y, Yang Y, Xing L, Bai H, Zhou C (2023) Boosting target-level infrared and visible image fusion with regional information coordination. Inf Fusion 92:268\u2013288","journal-title":"Inf Fusion"},{"key":"2495_CR9","doi-asserted-by":"crossref","unstructured":"Xiao H, Lin S, Xiao N, Chen Y, Yang J (2024) Mfadet-a multi-level fusion of rotation detection frame model algorithm. In: Proceedings of the 2024 international conference on intelligent perception and pattern recognition, pp 24\u201330","DOI":"10.1145\/3700035.3700040"},{"issue":"1","key":"2495_CR10","doi-asserted-by":"publisher","first-page":"502","DOI":"10.1109\/TPAMI.2020.3012548","volume":"44","author":"H Xu","year":"2020","unstructured":"Xu H, Ma J, Jiang J, Guo X (2020) Ling H U2fusion: A unified unsupervised image fusion network. IEEE Trans Pattern Anal Mach Intell 44(1):502\u2013518","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"issue":"2","key":"2495_CR11","doi-asserted-by":"publisher","first-page":"770","DOI":"10.1109\/TCSVT.2023.3289170","volume":"34","author":"S Park","year":"2023","unstructured":"Park S, Vien AG, Lee C (2023) Cross-modal transformers for infrared and visible image fusion. IEEE Trans Circ Syst Video Technol 34(2):770\u2013785","journal-title":"IEEE Trans Circ Syst Video Technol"},{"key":"2495_CR12","doi-asserted-by":"publisher","DOI":"10.1016\/j.eswa.2022.118631","volume":"211","author":"C Guo","year":"2023","unstructured":"Guo C, Fan D, Jiang Z, Zhang D (2023) Mdfn: Mask deep fusion network for visible and infrared image fusion without reference ground-truth. Expert Syst Appl 211:118631","journal-title":"Expert Syst Appl"},{"key":"2495_CR13","doi-asserted-by":"crossref","unstructured":"Xiao H, Jiang Q, Guo S, Yang J, Liu Q (2024) Af-ssd: Self-attention fusion sampling and fuzzy classification for enhanced small object detection. In: Pacific rim international conference on artificial intelligence, pp 333\u2013346","DOI":"10.1007\/978-981-96-0122-6_29"},{"issue":"03","key":"2495_CR14","doi-asserted-by":"publisher","first-page":"1850018","DOI":"10.1142\/S0219691318500182","volume":"16","author":"Y Liu","year":"2018","unstructured":"Liu Y, Chen X, Cheng J, Peng H, Wang Z (2018) Infrared and visible image fusion with convolutional neural networks. Int J Wavelets Multiresolution and Inf Process 16(03):1850018","journal-title":"Int J Wavelets Multiresolution and Inf Process"},{"key":"2495_CR15","doi-asserted-by":"publisher","first-page":"128","DOI":"10.1016\/j.inffus.2020.11.009","volume":"69","author":"Y Long","year":"2021","unstructured":"Long Y, Jia H, Zhong Y, Jiang Y, Jia Y (2021) Rxdnfuse: A aggregated residual dense network for infrared and visible image fusion. Inf Fusion 69:128\u2013141","journal-title":"Inf Fusion"},{"key":"2495_CR16","doi-asserted-by":"publisher","first-page":"79","DOI":"10.1016\/j.inffus.2022.03.007","volume":"83","author":"L Tang","year":"2022","unstructured":"Tang L, Yuan J, Zhang H, Jiang X, Ma J (2022) Piafusion: A progressive infrared and visible image fusion network based on illumination aware. Inf Fusion 83:79\u201392","journal-title":"Inf Fusion"},{"key":"2495_CR17","doi-asserted-by":"publisher","first-page":"28","DOI":"10.1016\/j.inffus.2021.12.004","volume":"82","author":"L Tang","year":"2022","unstructured":"Tang L, Yuan J, Ma J (2022) Image fusion in the loop of high-level vision tasks: A semantic-aware real-time infrared and visible image fusion network. Inf Fusion 82:28\u201342","journal-title":"Inf Fusion"},{"key":"2495_CR18","first-page":"1","volume":"70","author":"J Ma","year":"2020","unstructured":"Ma J, Zhang H, Shao Z, Liang P, Xu H (2020) Ganmcc: A generative adversarial network with multiclassification constraints for infrared and visible image fusion. IEEE Trans Inst Measure 70:1\u201314","journal-title":"IEEE Trans Inst Measure"},{"key":"2495_CR19","doi-asserted-by":"publisher","first-page":"4980","DOI":"10.1109\/TIP.2020.2977573","volume":"29","author":"J Ma","year":"2020","unstructured":"Ma J, Xu H, Jiang J, Mei X, Zhang X-P (2020) Ddcgan: A dual-discriminator conditional generative adversarial network for multi-resolution image fusion. IEEE Trans Image Process 29:4980\u20134995","journal-title":"IEEE Trans Image Process"},{"key":"2495_CR20","doi-asserted-by":"crossref","unstructured":"Zhao H, Nie R (2021) Dndt: Infrared and visible image fusion via densenet and dual-transformer. In: Proceedings - 2021 international conference on information technology and biomedical engineering, ICITBE 2021, pp 71\u201375","DOI":"10.1109\/ICITBE54178.2021.00025"},{"issue":"7","key":"2495_CR21","doi-asserted-by":"publisher","first-page":"1200","DOI":"10.1109\/JAS.2022.105686","volume":"9","author":"J Ma","year":"2022","unstructured":"Ma J, Tang L, Fan F, Huang J, Mei X, Ma Y (2022) Swinfusion: Cross-domain long-range learning for general image fusion via swin transformer. IEEE\/CAA Journal of Automatica Sinica 9(7):1200\u20131217","journal-title":"IEEE\/CAA Journal of Automatica Sinica"},{"key":"2495_CR22","doi-asserted-by":"publisher","first-page":"2077","DOI":"10.1109\/TIP.2023.3263113","volume":"32","author":"Z Chang","year":"2023","unstructured":"Chang Z, Feng Z, Yang S, Gao Q (2023) Aft: Adaptive fusion transformer for visible and infrared images. IEEE Trans Image Process 32:2077\u20132092","journal-title":"IEEE Trans Image Process"},{"key":"2495_CR23","unstructured":"Radford A, Kim JW, Hallacy C, Ramesh A, Goh G, Agarwal S, Sastry G, Askell A, Mishkin P, Clark J et al (2021) Learning transferable visual models from natural language supervision, pp 8748\u20138763"},{"key":"2495_CR24","unstructured":"Li X, Zou Y, Liu J, Jiang Z, Ma L, Fan X, Liu R (2023) From text to pixels: a context-aware semantic synergy solution for infrared and visible image fusion. arXiv:2401.00421"},{"key":"2495_CR25","doi-asserted-by":"crossref","unstructured":"Wang Y, Miao L, Zhou Z, Zhang L, Qiao Y (2024) Infrared and Visible Image Fusion with Language-Driven Loss in CLIP Embedding Space. Proc 33rd ACM Int Conf Multimed, Dublin, Ireland, 1443\u20131451. https:\/\/doi.org\/10.1145\/3746027.3755182","DOI":"10.1145\/3746027.3755182"},{"key":"2495_CR26","doi-asserted-by":"crossref","unstructured":"Shrivastava A, Gupta A, Girshick R (2016) Training region-based object detectors with online hard example mining. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 761\u2013769","DOI":"10.1109\/CVPR.2016.89"},{"issue":"5","key":"2495_CR27","doi-asserted-by":"publisher","first-page":"2614","DOI":"10.1109\/TIP.2018.2887342","volume":"28","author":"H Li","year":"2018","unstructured":"Li H, Wu X-J (2018) Densefuse: A fusion approach to infrared and visible images. IEEE Trans Image Process 28(5):2614\u20132623","journal-title":"IEEE Trans Image Process"},{"key":"2495_CR28","doi-asserted-by":"crossref","unstructured":"Zhao Z, Xu S, Zhang C, Liu J, Zhang J, Li P (2020) DIDFuse: Deep Image Decomposition for Infrared and Visible Image Fusion. Proc 29th Int Jt Conf Artif Intell, Yokohama, Japan, 2021-January:970-976","DOI":"10.24963\/ijcai.2020\/135"},{"key":"2495_CR29","doi-asserted-by":"publisher","first-page":"99","DOI":"10.1016\/j.inffus.2019.07.011","volume":"54","author":"Y Zhang","year":"2020","unstructured":"Zhang Y, Liu Y, Sun P, Yan H, Zhao X, Zhang L (2020) Ifcnn: A general image fusion framework based on convolutional neural network. Inf Fusion 54:99\u2013118","journal-title":"Inf Fusion"},{"key":"2495_CR30","doi-asserted-by":"publisher","first-page":"12797","DOI":"10.1609\/aaai.v34i07.6975","volume":"34","author":"H Zhang","year":"2020","unstructured":"Zhang H, Xu H, Xiao Y, Guo X, Ma J (2020) Rethinking the image fusion: A fast unified image fusion network based on proportional maintenance of gradient and intensity. Proceedings of the AAAI conference on artificial intelligence 34:12797\u201312804","journal-title":"Proceedings of the AAAI conference on artificial intelligence"},{"key":"2495_CR31","doi-asserted-by":"crossref","unstructured":"Liu J, Fan X, Huang Z, Wu G, Liu R, Zhong W, Luo Z (2022) Target-aware dual adversarial learning and a multi-scenario multi-modality benchmark to fuse infrared and visible for object detection. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp 5802\u20135811","DOI":"10.1109\/CVPR52688.2022.00571"},{"key":"2495_CR32","doi-asserted-by":"publisher","DOI":"10.1016\/j.cviu.2022.103407","volume":"218","author":"H Xu","year":"2022","unstructured":"Xu H, Gong M, Tian X, Huang J, Ma J (2022) Cufd: An encoder-decoder network for visible and infrared image fusion based on common and unique feature decomposition. Comput Vis Image Underst 218:103407","journal-title":"Comput Vis Image Underst"}],"container-title":["Mobile Networks and Applications"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11036-026-02495-8.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11036-026-02495-8","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11036-026-02495-8.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,6,16]],"date-time":"2026-06-16T02:27:03Z","timestamp":1781576823000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11036-026-02495-8"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,12]]},"references-count":32,"journal-issue":{"issue":"5-6","published-print":{"date-parts":[[2025,12]]}},"alternative-id":["2495"],"URL":"https:\/\/doi.org\/10.1007\/s11036-026-02495-8","relation":{},"ISSN":["1383-469X","1572-8153"],"issn-type":[{"value":"1383-469X","type":"print"},{"value":"1572-8153","type":"electronic"}],"subject":[],"published":{"date-parts":[[2025,12]]},"assertion":[{"value":"23 June 2025","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"28 January 2026","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"18 February 2026","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare no competing interests.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Competing interests"}}]}}