{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,10]],"date-time":"2026-07-10T12:55:17Z","timestamp":1783688117748,"version":"3.55.0"},"reference-count":29,"publisher":"Springer Science and Business Media LLC","issue":"1","license":[{"start":{"date-parts":[[2026,1,8]],"date-time":"2026-01-08T00:00:00Z","timestamp":1767830400000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by-nc-nd\/4.0"},{"start":{"date-parts":[[2026,1,22]],"date-time":"2026-01-22T00:00:00Z","timestamp":1769040000000},"content-version":"vor","delay-in-days":14,"URL":"https:\/\/creativecommons.org\/licenses\/by-nc-nd\/4.0"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Neural Process Lett"],"DOI":"10.1007\/s11063-025-11829-8","type":"journal-article","created":{"date-parts":[[2026,1,8]],"date-time":"2026-01-08T14:49:53Z","timestamp":1767883793000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":1,"title":["Heterogeneous Gap Bridging in Cross-Media Retrieval via Deep Association Learning with Joint Distribution and Semantic Alignments"],"prefix":"10.1007","volume":"58","author":[{"given":"Li","family":"Li","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xiaoliang","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2026,1,8]]},"reference":[{"issue":"5","key":"11829_CR1","doi-asserted-by":"publisher","first-page":"e1415","DOI":"10.1002\/widm.1415","volume":"11","author":"G Chandrasekaran","year":"2021","unstructured":"Chandrasekaran G, Nguyen TN, Hemanth D J (2021) Multimodal sentimental analysis for social media applications: a comprehensive review. Wiley Interdiscip Rev Data Min Knowl Discov 11(5):e1415","journal-title":"Wiley Interdiscip Rev Data Min Knowl Discov"},{"issue":"1","key":"11829_CR2","doi-asserted-by":"publisher","first-page":"83","DOI":"10.1002\/arcp.1063","volume":"4","author":"IA Anderson","year":"2021","unstructured":"Anderson IA, Wood W (2021) Habits and the electronic herd: the psychology behind social media\u2019s successes and failures. Consum Psychol Rev 4(1):83\u201399","journal-title":"Consum Psychol Rev"},{"issue":"15","key":"11829_CR3","doi-asserted-by":"publisher","first-page":"2152023","DOI":"10.1142\/S0218001421520236","volume":"35","author":"H Liu","year":"2021","unstructured":"Liu H, Ko YC (2021) Cross-media intelligent perception and retrieval analysis application technology based on deep learning education. Int J Pattern Recognit Artif Intell 35(15):2152023","journal-title":"Int J Pattern Recognit Artif Intell"},{"issue":"4","key":"11829_CR4","doi-asserted-by":"publisher","first-page":"1445","DOI":"10.1109\/TPAMI.2020.2975798","volume":"43","author":"C Yan","year":"2020","unstructured":"Yan C, Gong B, Wei Y, Gao Y (2020) Deep multi-view enhancement hashing for image retrieval. IEEE Trans Pattern Anal Mach Intell 43(4):1445\u20131451","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"issue":"1","key":"11829_CR5","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3295663","volume":"15","author":"J Loko\u010d","year":"2019","unstructured":"Loko\u010d J, Koval\u010d\u00edk G, M\u00fcnzer B, Sch\u00f6ffmann K, Bailer W, Gasser R, Barthel KU (2019) Interactive search or sequential browsing? A detailed analysis of the video browser showdown 2018. ACM Trans Multimed Comput Commun Appl 15(1):1\u201318","journal-title":"ACM Trans Multimed Comput Commun Appl"},{"issue":"1","key":"11829_CR6","doi-asserted-by":"publisher","first-page":"68","DOI":"10.1038\/s41746-021-00437-0","volume":"4","author":"A Esteva","year":"2021","unstructured":"Esteva A, Kale A, Paulus R, Hashimoto K, Yin W, Radev D, Socher R (2021) COVID-19 information retrieval with deep-learning based semantic search, question answering, and abstractive summarization. NPJ Digit Med 4(1):68","journal-title":"NPJ Digit Med"},{"issue":"4","key":"11829_CR7","doi-asserted-by":"publisher","first-page":"1173","DOI":"10.1109\/TCSVT.2019.2900171","volume":"30","author":"J Chi","year":"2019","unstructured":"Chi J, Peng Y (2019) Zero-shot cross-media embedding learning with dual adversarial distribution network. IEEE Trans Circuits Syst Video Technol 30(4):1173\u20131187","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"issue":"3","key":"11829_CR8","first-page":"1354","volume":"18","author":"S Hu","year":"2019","unstructured":"Hu S, Zhang LY, Wang Q, Qin Z, Wang C (2019) Towards private and scalable cross-media retrieval. IEEE Trans Depend Secure Comput 18(3):1354\u20131368","journal-title":"IEEE Trans Depend Secure Comput"},{"issue":"11","key":"11829_CR9","doi-asserted-by":"publisher","first-page":"4368","DOI":"10.1109\/TCSVT.2019.2953692","volume":"30","author":"Y Peng","year":"2019","unstructured":"Peng Y, Chi J (2019) Unsupervised cross-media retrieval using domain adaptation with scene graph. IEEE Trans Circuits Syst Video Technol 30(11):4368\u20134379","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"issue":"1s","key":"11829_CR10","first-page":"1","volume":"15","author":"X Liu","year":"2019","unstructured":"Liu X, Wang M, Zha ZJ, Hong R (2019) Cross-modality feature learning via convolutional autoencoder. ACM Trans Multimed Comput Commun Appl 15(1s):1\u201320","journal-title":"ACM Trans Multimed Comput Commun Appl"},{"issue":"7","key":"11829_CR11","doi-asserted-by":"publisher","first-page":"4765","DOI":"10.1109\/TCSVT.2021.3136330","volume":"32","author":"Y Wang","year":"2021","unstructured":"Wang Y, Peng Y (2021) MARS: learning modality-agnostic representation for scalable cross-media retrieval. IEEE Trans Circuits Syst Video Technol 32(7):4765\u20134777","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"issue":"1","key":"11829_CR12","doi-asserted-by":"publisher","first-page":"401","DOI":"10.1109\/TCSVT.2020.2974877","volume":"31","author":"X Nie","year":"2020","unstructured":"Nie X, Wang B, Li J, Hao F, Jian M, Yin Y (2020) Deep multiscale fusion hashing for cross-modal retrieval. IEEE Trans Circuits Syst Video Technol 31(1):401\u2013410","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"issue":"01","key":"11829_CR13","doi-asserted-by":"publisher","first-page":"2150018","DOI":"10.1142\/S0218126621500183","volume":"30","author":"B Qiang","year":"2021","unstructured":"Qiang B, Chen R, Xie Y, Zhou M, Pan R, Zhao T (2021) Hybrid deep neural network-based cross-modal image and text retrieval method for large-scale data. J Circuits Syst Comput 30(01):2150018","journal-title":"J Circuits Syst Comput"},{"issue":"1","key":"11829_CR14","doi-asserted-by":"publisher","first-page":"2","DOI":"10.1007\/s13735-023-00268-7","volume":"12","author":"L Mingyong","year":"2023","unstructured":"Mingyong L, Yewen L, Mingyuan G, Longfei M (2023) CLIP-based fusion-modal reconstructing hashing for large-scale unsupervised cross-modal retrieval. Int J Multimed Inf Retr 12(1):2","journal-title":"Int J Multimed Inf Retr"},{"issue":"3s","key":"11829_CR15","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3575658","volume":"19","author":"J Zhang","year":"2023","unstructured":"Zhang J, Yu Y, Tang S, Wu J, Li W (2023) Variational autoencoder with CCA for audio-visual cross-modal retrieval. ACM Trans Multimed Comput Commun Appl 19(3s):1\u201321","journal-title":"ACM Trans Multimed Comput Commun Appl"},{"issue":"07","key":"11829_CR16","doi-asserted-by":"publisher","first-page":"949","DOI":"10.1142\/S0218194021500297","volume":"31","author":"X Zhang","year":"2021","unstructured":"Zhang X, Lin J, Zhou Y (2021) DHLBT: efficient cross-modal hashing retrieval method based on deep learning using large batch training. Int J Softw Eng Knowl Eng 31(07):949\u2013971","journal-title":"Int J Softw Eng Knowl Eng"},{"key":"11829_CR17","unstructured":"Radford A, Kim JW, Hallacy C, Ramesh A, Goh G, Agarwal S, Sutskever I (2021, July) Learning transferable visual models from natural language supervision. In International conference on machine learning (pp. 8748\u20138763). PmLR."},{"issue":"1s","key":"11829_CR18","first-page":"1","volume":"17","author":"X Xu","year":"2021","unstructured":"Xu X, Tian J, Lin K, Lu H, Shao J, Shen HT (2021) Zero-shot cross-modal retrieval by assembling autoencoder and generative adversarial network. ACM Trans Multimed Comput Commun Appl 17(1s):1\u201317","journal-title":"ACM Trans Multimed Comput Commun Appl"},{"issue":"1","key":"11829_CR19","doi-asserted-by":"publisher","first-page":"46","DOI":"10.1002\/asi.24373","volume":"72","author":"W Li","year":"2021","unstructured":"Li W, Zheng Y, Zhang Y, Feng R, Zhang T, Fan W (2021) Cross-modal retrieval with dual multi-angle self-attention. J Assoc Inf Sci Technol 72(1):46\u201365","journal-title":"J Assoc Inf Sci Technol"},{"issue":"14","key":"11829_CR20","doi-asserted-by":"publisher","first-page":"3674","DOI":"10.1049\/ipr2.12176","volume":"15","author":"C Wang","year":"2021","unstructured":"Wang C, Li L, Yan C, Wang Z, Sun Y, Zhang J (2021) Cross-modal semantic correlation learning by Bi-CNN network. IET Image Process 15(14):3674\u20133684","journal-title":"IET Image Process"},{"issue":"1","key":"11829_CR21","doi-asserted-by":"publisher","first-page":"453","DOI":"10.1785\/0120220068","volume":"113","author":"RD Esfahani","year":"2023","unstructured":"Esfahani RD, Cotton F, Ohrnberger M, Scherbaum F (2023) TFCGAN: nonstationary ground\u2010motion simulation in the time\u2013frequency domain using conditional generative adversarial network (CGAN) and phase retrieval methods. Bull Seismol Soc Am 113(1):453\u2013467","journal-title":"Bull Seismol Soc Am"},{"issue":"41\u201342","key":"11829_CR22","doi-asserted-by":"publisher","first-page":"31401","DOI":"10.1007\/s11042-020-09450-z","volume":"79","author":"Q Cheng","year":"2020","unstructured":"Cheng Q, Gu X (2020) Deep attentional fine-grained similarity network with adversarial learning for cross-modal retrieval. Multimedia Tools Appl 79(41\u201342):31401\u201331428","journal-title":"Multimedia Tools Appl"},{"issue":"13\u201314","key":"11829_CR23","doi-asserted-by":"publisher","first-page":"9419","DOI":"10.1007\/s11042-019-7605-5","volume":"79","author":"Q Wu","year":"2020","unstructured":"Wu Q (2020) Image retrieval method based on deep learning semantic feature extraction and regularization softmax. Multimedia Tools Appl 79(13\u201314):9419\u20139433","journal-title":"Multimedia Tools Appl"},{"issue":"6","key":"11829_CR24","doi-asserted-by":"publisher","first-page":"3340","DOI":"10.3390\/s23063340","volume":"23","author":"Q Zhang","year":"2023","unstructured":"Zhang Q, Sun X (2023) Bilateral cross-modal fusion network for robot grasp detection. Sensors 23(6):3340","journal-title":"Sensors"},{"issue":"2","key":"11829_CR25","doi-asserted-by":"publisher","first-page":"1086","DOI":"10.1109\/TCYB.2020.2985716","volume":"52","author":"Z Ji","year":"2020","unstructured":"Ji Z, Wang H, Han J et al (2020) SMAN: Stacked multimodal attention network for cross-modal image\u2013text retrieval. IEEE Trans Cybern 52(2):1086\u20131097","journal-title":"IEEE Trans Cybern"},{"issue":"27","key":"11829_CR26","doi-asserted-by":"publisher","first-page":"38297","DOI":"10.1007\/s11042-022-13153-y","volume":"81","author":"J Kaur","year":"2022","unstructured":"Kaur J, Singh W (2022) Tools, techniques, datasets and application areas for object detection in an image: a review. Multimedia Tools Appl 81(27):38297\u201338351","journal-title":"Multimedia Tools Appl"},{"issue":"11","key":"11829_CR27","doi-asserted-by":"publisher","first-page":"2850","DOI":"10.1109\/TMM.2019.2911456","volume":"21","author":"X Huang","year":"2019","unstructured":"Huang X, Peng Y (2019) TPCKT: two-level progressive cross-media knowledge transfer. IEEE Trans Multimed 21(11):2850\u20132862","journal-title":"IEEE Trans Multimed"},{"issue":"3","key":"11829_CR28","doi-asserted-by":"publisher","first-page":"280","DOI":"10.1007\/s41019-021-00162-4","volume":"6","author":"M Zhu","year":"2021","unstructured":"Zhu M, Shen D, Xu L, Wang X (2021) Scalable multi-grained cross-modal similarity query with interpretability. Data Sci Eng 6(3):280\u2013293","journal-title":"Data Sci Eng"},{"issue":"3","key":"11829_CR29","first-page":"1403","volume":"13","author":"Z Zong","year":"2019","unstructured":"Zong Z, Han A, Gong Q (2019) Semi-supervised cross-media feature learning via efficient L 2, q norm. KSII Trans Internet Inf Syst (TIIS) 13(3):1403\u20131417","journal-title":"KSII Trans Internet Inf Syst (TIIS)"}],"container-title":["Neural Processing Letters"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11063-025-11829-8","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11063-025-11829-8.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11063-025-11829-8.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,2,14]],"date-time":"2026-02-14T07:25:13Z","timestamp":1771053913000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11063-025-11829-8"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,1,8]]},"references-count":29,"journal-issue":{"issue":"1","published-online":{"date-parts":[[2026,2]]}},"alternative-id":["11829"],"URL":"https:\/\/doi.org\/10.1007\/s11063-025-11829-8","relation":{},"ISSN":["1573-773X"],"issn-type":[{"value":"1573-773X","type":"electronic"}],"subject":[],"published":{"date-parts":[[2026,1,8]]},"assertion":[{"value":"10 January 2024","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"27 December 2025","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"8 January 2026","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare no competing interests.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}}],"article-number":"16"}}