{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,22]],"date-time":"2026-06-22T17:54:23Z","timestamp":1782150863382,"version":"3.54.5"},"reference-count":42,"publisher":"Elsevier BV","license":[{"start":{"date-parts":[[2026,12,1]],"date-time":"2026-12-01T00:00:00Z","timestamp":1796083200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/tdm\/userlicense\/1.0\/"},{"start":{"date-parts":[[2026,12,1]],"date-time":"2026-12-01T00:00:00Z","timestamp":1796083200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/legal\/tdmrep-license"},{"start":{"date-parts":[[2026,6,15]],"date-time":"2026-06-15T00:00:00Z","timestamp":1781481600000},"content-version":"vor","delay-in-days":0,"URL":"http:\/\/creativecommons.org\/licenses\/by\/4.0\/"}],"funder":[{"DOI":"10.13039\/501100011789","name":"Department of Science and Technology of Jilin Province","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100011789","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["elsevier.com","sciencedirect.com"],"crossmark-restriction":true},"short-container-title":["Pattern Recognition"],"published-print":{"date-parts":[[2026,12]]},"DOI":"10.1016\/j.patcog.2026.114259","type":"journal-article","created":{"date-parts":[[2026,6,14]],"date-time":"2026-06-14T18:00:41Z","timestamp":1781460041000},"page":"114259","update-policy":"https:\/\/doi.org\/10.1016\/elsevier_cm_policy","source":"Crossref","is-referenced-by-count":0,"special_numbering":"PC","title":["DiffFuseNet: Infrared-visible image fusion via diffusion-guided feature alignment and feature consistency alignment"],"prefix":"10.1016","volume":"180","author":[{"given":"Yuequn","family":"Wang","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zhengwei","family":"Li","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Leqiang","family":"Yang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Wei","family":"Xu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Tianyu","family":"Lv","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Jie","family":"Liu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"78","reference":[{"key":"10.1016\/j.patcog.2026.114259_b1","doi-asserted-by":"crossref","first-page":"32","DOI":"10.1186\/s43593-025-00113-w","article-title":"Massively parallel and universal approximation of nonlinear functions using diffractive processors","volume":"5","author":"Rahman","year":"2025","journal-title":"ELight"},{"key":"10.1016\/j.patcog.2026.114259_b2","doi-asserted-by":"crossref","first-page":"315","DOI":"10.1038\/s41377-025-01898-8","article-title":"Single-shot X-ray and near-infrared (NIR) dual-mode fusion imaging based on bifunctional NIR scintillators","volume":"14","author":"Ran","year":"2025","journal-title":"Light. Sci. Appl."},{"issue":"45","key":"10.1016\/j.patcog.2026.114259_b3","doi-asserted-by":"crossref","first-page":"34685","DOI":"10.1007\/s11042-020-09301-x","article-title":"Unsupervised densely attention network for infrared and visible image fusion","volume":"79","author":"Li","year":"2020","journal-title":"Multimedia Tools Appl."},{"key":"10.1016\/j.patcog.2026.114259_b4","doi-asserted-by":"crossref","unstructured":"V. Vs, J. Valanarasu, V.M. Patel, Image fusion transformer, in: 2022 IEEE International Conference on Image Processing, ICIP, 2022, pp. 3566\u20133570.","DOI":"10.1109\/ICIP46576.2022.9897280"},{"key":"10.1016\/j.patcog.2026.114259_b5","doi-asserted-by":"crossref","DOI":"10.1016\/j.ijleo.2020.165120","article-title":"Infrared and visible image fusion with supervised convolutional neural network","volume":"219","author":"An","year":"2020","journal-title":"Optik"},{"key":"10.1016\/j.patcog.2026.114259_b6","doi-asserted-by":"crossref","first-page":"227","DOI":"10.1016\/j.infrared.2017.05.007","article-title":"Infrared and visual image fusion through infrared feature extraction and visual information preservation","volume":"83","author":"Zhang","year":"2017","journal-title":"Infrared Phys. Technol."},{"key":"10.1016\/j.patcog.2026.114259_b7","doi-asserted-by":"crossref","unstructured":"H. Zhao, R. Nie, DNDT: Infrared and visible image fusion via DenseNet and dual-transformer, in: 2021 IEEE International Conference on Information Technology and Biomedical Engineering, ITBE, 2021, pp. 71\u201375.","DOI":"10.1109\/ICITBE54178.2021.00025"},{"key":"10.1016\/j.patcog.2026.114259_b8","doi-asserted-by":"crossref","first-page":"11","DOI":"10.1016\/j.inffus.2018.09.004","article-title":"FusionGAN: A generative adversarial network for infrared and visible image fusion","volume":"48","author":"Ma","year":"2019","journal-title":"Inf. Fusion"},{"key":"10.1016\/j.patcog.2026.114259_b9","first-page":"1","article-title":"The fusion of unmatched infrared and visible images based on generative adversarial networks","volume":"2020","author":"Zhao","year":"2020","journal-title":"Math. Probl. Eng."},{"key":"10.1016\/j.patcog.2026.114259_b10","doi-asserted-by":"crossref","first-page":"153","DOI":"10.1016\/j.inffus.2018.02.004","article-title":"Infrared and visible image fusion methods and applications: A survey","volume":"45","author":"Ma","year":"2019","journal-title":"Inf. Fusion"},{"key":"10.1016\/j.patcog.2026.114259_b11","doi-asserted-by":"crossref","unstructured":"Y. Fu, X.-J. Wu, A dual-branch network for infrared and visible image fusion, in: 2020 25th International Conference on Pattern Recognition, ICPR, 2021, pp. 10675\u201310680.","DOI":"10.1109\/ICPR48806.2021.9412293"},{"key":"10.1016\/j.patcog.2026.114259_b12","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1109\/TIM.2020.3022438","article-title":"SEDRFuse: A symmetric encoder\u2013decoder with residual block network for infrared and visible image fusion","volume":"70","author":"Jian","year":"2021","journal-title":"IEEE Trans. Instrum. Meas."},{"key":"10.1016\/j.patcog.2026.114259_b13","doi-asserted-by":"crossref","unstructured":"Z. Zhao, H. Bai, J. Zhang, Y. Zhang, S. Xu, Z. Lin, R. Timofte, L. Van Gool, CDDFuse: Correlation-driven dual-branch feature decomposition for multi-modality image fusion, in: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, CVPR, 2023, pp. 5906\u20135916.","DOI":"10.1109\/CVPR52729.2023.00572"},{"issue":"5","key":"10.1016\/j.patcog.2026.114259_b14","doi-asserted-by":"crossref","first-page":"2614","DOI":"10.1109\/TIP.2018.2887342","article-title":"DenseFuse: A fusion approach to infrared and visible images","volume":"28","author":"Li","year":"2019","journal-title":"IEEE Trans. Image Process."},{"key":"10.1016\/j.patcog.2026.114259_b15","doi-asserted-by":"crossref","unstructured":"Z. Zhao, S. Xu, C. Zhang, J. Liu, J. Zhang, P. Li, DIDFuse: Deep image decomposition for infrared and visible image fusion, in: Proceedings of the 29th International Joint Conference on Artificial Intelligence, IJCAI, 2020, pp. 970\u2013976.","DOI":"10.24963\/ijcai.2020\/135"},{"issue":"12","key":"10.1016\/j.patcog.2026.114259_b16","doi-asserted-by":"crossref","first-page":"9645","DOI":"10.1109\/TIM.2020.3005230","article-title":"NestFuse: An infrared and visible image fusion architecture based on nest connection and spatial\/channel attention models","volume":"69","author":"Li","year":"2020","journal-title":"IEEE Trans. Instrum. Meas."},{"key":"10.1016\/j.patcog.2026.114259_b17","article-title":"CrossFuse: A novel cross attention mechanism based infrared and visible image fusion approach","volume":"102","author":"Li","year":"2024","journal-title":"Inf. Fusion"},{"key":"10.1016\/j.patcog.2026.114259_b18","first-page":"1","article-title":"DRF: Disentangled representation for visible and infrared image fusion","volume":"70","author":"Xu","year":"2021","journal-title":"IEEE Trans. Instrum. Meas."},{"issue":"1","key":"10.1016\/j.patcog.2026.114259_b19","doi-asserted-by":"crossref","first-page":"105","DOI":"10.1109\/TCSVT.2021.3056725","article-title":"Learning a deep multi-scale feature ensemble and an edge-attention guidance for image fusion","volume":"32","author":"Liu","year":"2022","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"10.1016\/j.patcog.2026.114259_b20","doi-asserted-by":"crossref","DOI":"10.1016\/j.cviu.2022.103407","article-title":"CUFD: An encoder\u2013decoder network for visible and infrared image fusion based on common and unique feature decomposition","volume":"218","author":"Xu","year":"2022","journal-title":"Comput. Vis. Image Underst."},{"key":"10.1016\/j.patcog.2026.114259_b21","doi-asserted-by":"crossref","unstructured":"J. Liu, X. Fan, Z. Huang, G. Wu, R. Liu, W. Zhong, Z. Luo, Target-aware dual adversarial learning and a multi-scenario multi-modality benchmark to fuse infrared and visible for object detection, in: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, CVPR, 2022, pp. 5792\u20135801.","DOI":"10.1109\/CVPR52688.2022.00571"},{"key":"10.1016\/j.patcog.2026.114259_b22","doi-asserted-by":"crossref","first-page":"72","DOI":"10.1016\/j.inffus.2021.02.023","article-title":"RFN-Nest: An end-to-end residual fusion network for infrared and visible images","volume":"73","author":"Li","year":"2021","journal-title":"Inf. Fusion"},{"issue":"7","key":"10.1016\/j.patcog.2026.114259_b23","doi-asserted-by":"crossref","first-page":"1200","DOI":"10.1109\/JAS.2022.105686","article-title":"SwinFusion: Cross-domain long-range learning for general image fusion via swin transformer","volume":"9","author":"Ma","year":"2022","journal-title":"IEEE\/CAA J. Autom. Sin."},{"key":"10.1016\/j.patcog.2026.114259_b24","doi-asserted-by":"crossref","first-page":"28","DOI":"10.1016\/j.inffus.2021.12.004","article-title":"Image fusion in the loop of high-level vision tasks: A semantic-aware real-time infrared and visible image fusion network","volume":"82","author":"Tang","year":"2022","journal-title":"Inf. Fusion"},{"key":"10.1016\/j.patcog.2026.114259_b25","doi-asserted-by":"crossref","unstructured":"Z. Huang, J. Liu, X. Fan, R. Liu, W. Zhong, Z. Luo, ReCoNet: Recurrent correction network for fast and efficient multi-modality image fusion, in: Proceedings of the European Conference on Computer Vision, ECCV, 2022, pp. 539\u2013555.","DOI":"10.1007\/978-3-031-19797-0_31"},{"key":"10.1016\/j.patcog.2026.114259_b26","doi-asserted-by":"crossref","unstructured":"H. Xu, J. Ma, J. Jiang, X. Guo, H. Ling, FusionDN: A unified densely connected network for image fusion, in: Proceedings of the AAAI Conference on Artificial Intelligence, 2020, pp. 12484\u201312491.","DOI":"10.1609\/aaai.v34i07.6936"},{"issue":"1","key":"10.1016\/j.patcog.2026.114259_b27","doi-asserted-by":"crossref","first-page":"502","DOI":"10.1109\/TPAMI.2020.3012548","article-title":"U2Fusion: A unified unsupervised image fusion network","volume":"44","author":"Xu","year":"2022","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"10.1016\/j.patcog.2026.114259_b28","article-title":"HaarFuse: A dual-branch infrared and visible light image fusion network based on haar wavelet transform","author":"Wang","year":"2025","journal-title":"Pattern Recognit."},{"key":"10.1016\/j.patcog.2026.114259_b29","doi-asserted-by":"crossref","first-page":"1818","DOI":"10.1109\/LSP.2021.3109818","article-title":"SMoA: Searching a modality-oriented architecture for infrared and visible image fusion","volume":"28","author":"Liu","year":"2021","journal-title":"IEEE Signal Process. Lett."},{"key":"10.1016\/j.patcog.2026.114259_b30","first-page":"1","article-title":"Res2Fusion: Infrared and visible image fusion based on dense Res2net and double nonlocal attention models","volume":"71","author":"Wang","year":"2022","journal-title":"IEEE Trans. Instrum. Meas."},{"key":"10.1016\/j.patcog.2026.114259_b31","doi-asserted-by":"crossref","unstructured":"Z. Wang, S. Yu, H. Duan, et al., Rethinking Multi-Focus Image Fusion: An Input Space Optimisation View, IEEE Trans. Image Process. 2026.","DOI":"10.1109\/TIP.2026.3654370"},{"key":"10.1016\/j.patcog.2026.114259_b32","unstructured":"Y. Song, J. Sohl-Dickstein, D.P. Kingma, A. Kumar, S. Ermon, B. Poole, Score-based generative modeling through stochastic differential equations, in: International Conference on Learning Representations, ICLR, 2021."},{"key":"10.1016\/j.patcog.2026.114259_b33","doi-asserted-by":"crossref","unstructured":"J. Liu, C. Zou, Y. Lyu, J. Chen, L. Zhang, From reusing to forecasting: Accelerating diffusion models with taylor-scores, in: Proceedings of the IEEE\/CVF International Conference on Computer Vision, ICCV, 2023, pp. 15853\u201315863.","DOI":"10.1109\/ICCV51701.2025.01471"},{"key":"10.1016\/j.patcog.2026.114259_b34","unstructured":"J. Han, J. Shi, P. Li, H. Ye, Q. Guo, S. Ermon, Adaptive spectral feature forecasting for diffusion sampling acceleration, in: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, CVPR, 2026."},{"key":"10.1016\/j.patcog.2026.114259_b35","series-title":"Transfusion: Predict the next token and diffuse images with one multi-modal model","author":"Zhou","year":"2024"},{"key":"10.1016\/j.patcog.2026.114259_b36","series-title":"Show-o: One single transformer to unify multimodal understanding and generation","author":"Xie","year":"2024"},{"key":"10.1016\/j.patcog.2026.114259_b37","series-title":"Lavida-o: Elastic large masked diffusion models for unified multimodal understanding and generation","author":"Li","year":"2025"},{"key":"10.1016\/j.patcog.2026.114259_b38","series-title":"Mmada: Multimodal large diffusion language models","author":"Yang","year":"2025"},{"key":"10.1016\/j.patcog.2026.114259_b39","doi-asserted-by":"crossref","DOI":"10.1016\/j.inffus.2024.102450","article-title":"Diff-IF: Multi-modality image fusion via diffusion model with fusion knowledge prior","volume":"110","author":"Yi","year":"2024","journal-title":"Inf. Fusion"},{"issue":"7","key":"10.1016\/j.patcog.2026.114259_b40","doi-asserted-by":"crossref","first-page":"4646","DOI":"10.1007\/s11263-025-02409-3","article-title":"Multi-text guidance is important: Multi-modality image fusion via large generative vision-language model","volume":"133","author":"Wang","year":"2025","journal-title":"Int. J. Comput. Vis."},{"key":"10.1016\/j.patcog.2026.114259_b41","doi-asserted-by":"crossref","first-page":"249","DOI":"10.1016\/j.dib.2017.09.038","article-title":"The TNO multiband image data collection","volume":"15","author":"Toet","year":"2017","journal-title":"Data Brief"},{"key":"10.1016\/j.patcog.2026.114259_b42","series-title":"Proceedings of the IEEE\/CVF International Conference on Computer Vision","first-page":"3496","article-title":"LLVIP: A visible-infrared paired dataset for low-light vision","author":"Jia","year":"2021"}],"container-title":["Pattern Recognition"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0031320326012240?httpAccept=text\/xml","content-type":"text\/xml","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0031320326012240?httpAccept=text\/plain","content-type":"text\/plain","content-version":"vor","intended-application":"text-mining"}],"deposited":{"date-parts":[[2026,6,22]],"date-time":"2026-06-22T17:45:31Z","timestamp":1782150331000},"score":1,"resource":{"primary":{"URL":"https:\/\/linkinghub.elsevier.com\/retrieve\/pii\/S0031320326012240"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,12]]},"references-count":42,"alternative-id":["S0031320326012240"],"URL":"https:\/\/doi.org\/10.1016\/j.patcog.2026.114259","relation":{},"ISSN":["0031-3203"],"issn-type":[{"value":"0031-3203","type":"print"}],"subject":[],"published":{"date-parts":[[2026,12]]},"assertion":[{"value":"Elsevier","name":"publisher","label":"This article is maintained by"},{"value":"DiffFuseNet: Infrared-visible image fusion via diffusion-guided feature alignment and feature consistency alignment","name":"articletitle","label":"Article Title"},{"value":"Pattern Recognition","name":"journaltitle","label":"Journal Title"},{"value":"https:\/\/doi.org\/10.1016\/j.patcog.2026.114259","name":"articlelink","label":"CrossRef DOI link to publisher maintained version"},{"value":"article","name":"content_type","label":"Content Type"},{"value":"\u00a9 2026 The Authors. Published by Elsevier Ltd.","name":"copyright","label":"Copyright"}],"article-number":"114259"}}