{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,11,12]],"date-time":"2025-11-12T03:33:12Z","timestamp":1762918392987,"version":"3.37.3"},"reference-count":49,"publisher":"Springer Science and Business Media LLC","issue":"7","license":[{"start":{"date-parts":[[2024,9,9]],"date-time":"2024-09-09T00:00:00Z","timestamp":1725840000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,9,9]],"date-time":"2024-09-09T00:00:00Z","timestamp":1725840000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["SN COMPUT. SCI."],"DOI":"10.1007\/s42979-024-03210-8","type":"journal-article","created":{"date-parts":[[2024,9,9]],"date-time":"2024-09-09T12:03:08Z","timestamp":1725883388000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":1,"title":["Tri-factorized Modular Hypergraph Autoencoder for Multimodal Semantic Analysis"],"prefix":"10.1007","volume":"5","author":[{"ORCID":"https:\/\/orcid.org\/0000-0003-1840-5412","authenticated-orcid":false,"given":"Shaily","family":"Malik","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Geetika","family":"Dhand","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Kavita","family":"Sheoran","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Divya","family":"Jatain","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Vaani","family":"Garg","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2024,9,9]]},"reference":[{"key":"3210_CR1","unstructured":"Lee, Daniel D., and H. Sebastian Seung. 2001. \u201cAlgorithms for nonnegative matrix factorization.\u201d Advances in neural information processing systems. 556\u2013562"},{"key":"3210_CR2","first-page":"385","volume-title":"Proceedings Ninth IEEE International Conference on Computer Vision","author":"X He","year":"2003","unstructured":"He X, Yan S, Yuxiao Hu, Zhang H-J. Learning a locality preserving subspace for visual recognition. In: Proceedings Ninth IEEE International Conference on Computer Vision. NY: IEEE; 2003. p. 385\u201392."},{"issue":"2","key":"3210_CR3","doi-asserted-by":"publisher","first-page":"026113","DOI":"10.1103\/PhysRevE.69.026113","volume":"69","author":"MEJ Newman","year":"2004","unstructured":"Newman MEJ, Girvan M. Finding and evaluating community structure in networks. Phys Rev E. 2004;69(2):026113.","journal-title":"Phys Rev E"},{"key":"3210_CR4","doi-asserted-by":"crossref","unstructured":"Ding, Chris, Tao Li, Wei Peng, and Haesun Park. 2006. \"Orthogonal nonnegative matrix t-factorizations for clustering.\" In\u00a0Proceedings of the 12th ACM SIGKDD international conference on Knowledge discovery and data mining. 126\u2013135","DOI":"10.1145\/1150402.1150420"},{"issue":"10","key":"3210_CR5","doi-asserted-by":"publisher","first-page":"2756","DOI":"10.1162\/neco.2007.19.10.2756","volume":"19","author":"C-J Lin","year":"2007","unstructured":"Lin C-J. Projected gradient methods for nonnegative matrix factorization. Neural Comput. 2007;19(10):2756\u201379.","journal-title":"Neural Comput"},{"key":"3210_CR6","doi-asserted-by":"crossref","unstructured":"Rasiwasia, Nikhil, Jose Costa Pereira, Emanuele Coviello, Gabriel Doyle, Gert RG Lanckriet, Roger Levy, and Nuno Vasconcelos. 2010. \"A new approach to cross-modal multimedia retrieval.\" In\u00a0Proceedings of the 18th ACM international conference on Multimedia, pp. 251\u2013260.","DOI":"10.1145\/1873951.1873987"},{"key":"3210_CR7","doi-asserted-by":"crossref","unstructured":"Cui, Peng, Fei Wang, Shaowei Liu, MingdongOu, Shiqiang Yang, and Lifeng Sun. 2011. \"Who should share what? item-level social influence prediction for users and posts ranking.\" In\u00a0Proceedings of the 34th international ACM SIGIR conference on Research and development in Information Retrieval, pp. 185\u2013194.","DOI":"10.1145\/2009916.2009945"},{"issue":"9","key":"3210_CR8","doi-asserted-by":"publisher","first-page":"2508","DOI":"10.1162\/NECO_a_00320","volume":"24","author":"F Tai","year":"2012","unstructured":"Tai F, Lin H-T. Multilabel classification with principal label space transformation. Neural Comput. 2012;24(9):2508\u201342.","journal-title":"Neural Comput"},{"issue":"3","key":"3210_CR9","first-page":"405","volume":"28","author":"W Bi","year":"2013","unstructured":"Bi W, Kwok J. Efficient Multilabel Classification with Many Labels. Proceedings of the 30th Int Conference Mach Learn PMLR. 2013;28(3):405\u201313.","journal-title":"Proceedings of the 30th Int Conference Mach Learn PMLR"},{"issue":"7","key":"3210_CR10","doi-asserted-by":"publisher","first-page":"1442","DOI":"10.1109\/TPAMI.2014.2366144","volume":"37","author":"O Dikmen","year":"2014","unstructured":"Dikmen O, Yang Z, ErkkiOja. Learning the information divergence. IEEE Transact Pattern Anal Mach Intel. 2014;37(7):1442\u201354.","journal-title":"IEEE Transact Pattern Anal Mach Intel"},{"key":"3210_CR11","doi-asserted-by":"crossref","unstructured":"Feng, Fangxiang, Xiaojie Wang, and Ruifan Li. 2014. \"Cross-modal retrieval with correspondence autoencoder.\" In\u00a0Proceedings of the 22nd ACM international conference on Multimedia, pp. 7\u201316","DOI":"10.1145\/2647868.2654902"},{"key":"3210_CR12","doi-asserted-by":"crossref","unstructured":"Silberer, Carina, and Mirella Lapata. 2014. \"Learning grounded meaning representations with autoencoders.\" In\u00a0Proceedings of the 52nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), pp. 721\u2013732","DOI":"10.3115\/v1\/P14-1068"},{"key":"3210_CR13","unstructured":"Zijia Lin, Guiguang Ding, Mingqing Hu, and Jianmin Wang, \"Multilabel classification via feature-aware implicit label space encoding\" In Proceedings of the 31st International Conference on International Conference on Machine Learning - Volume 32 (ICML'14). JMLR.org, II\u2013325\u2013II\u2013333."},{"key":"3210_CR14","doi-asserted-by":"publisher","first-page":"801","DOI":"10.1109\/FSKD.2015.7382045","volume-title":"2015 12th international conference on fuzzy systems and knowledge discovery (fskd)","author":"H Xu","year":"2015","unstructured":"Xu H, Zeng W, JieGui PQ, Zhu X, Wang L. Exploring similarity between academic paper and patent based on Latent Semantic Analysis and Vector Space Model. In: 2015 12th international conference on fuzzy systems and knowledge discovery (fskd). NY: IEEE; 2015. p. 801\u20135."},{"key":"3210_CR15","first-page":"347","volume-title":"International conference on intelligent text processing and computational linguistics","author":"A Sajadi","year":"2015","unstructured":"Sajadi A, Milios EE, Ke\u0161elj V, Janssen JCM. Domain-specific semantic relatedness from Wikipedia structure: A case study in biomedical text. In: International conference on intelligent text processing and computational linguistics. Cham: Springer; 2015. p. 347\u201360."},{"key":"3210_CR16","doi-asserted-by":"crossref","unstructured":"Zhou, Xiaowei, Menglong Zhu, and Kostas Daniilidis. 2015. \"Multi-image matching via fast alternating minimization.\" In\u00a0Proceedings of the IEEE International Conference on Computer Vision. 4032\u20134040","DOI":"10.1109\/ICCV.2015.459"},{"key":"3210_CR17","doi-asserted-by":"publisher","first-page":"250","DOI":"10.1016\/j.neucom.2016.02.016","volume":"193","author":"T Yao","year":"2016","unstructured":"Yao T, Kong X, Haiyan Fu, Tian Qi. Semantic consistency hashing for cross-modal retrieval. Neurocomputing. 2016;193:250\u20139.","journal-title":"Neurocomputing"},{"key":"3210_CR18","doi-asserted-by":"crossref","unstructured":"Huang, Xin, Yuxin Peng, and Mingkuan Yuan. \"Cross-modal common representation learning by hybrid transfer network.\"\u00a0arXiv preprint arXiv:1706.00153\u00a0(2017).","DOI":"10.24963\/ijcai.2017\/263"},{"key":"3210_CR19","doi-asserted-by":"crossref","unstructured":"Kodirov, Elyor, Tao Xiang, and Shaogang Gong. \"Semantic autoencoder for zero-shot learning.\" In\u00a0Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 3174\u20133183. 2017.","DOI":"10.1109\/CVPR.2017.473"},{"key":"3210_CR20","doi-asserted-by":"publisher","first-page":"943","DOI":"10.1109\/ICME.2017.8019340","volume-title":"2017 IEEE International Conference on Multimedia and Expo (ICME)","author":"X Huang","year":"2017","unstructured":"Huang X, Peng Y. Cross-modal deep metric learning with multi-task regularization. In: 2017 IEEE International Conference on Multimedia and Expo (ICME). NY: IEEE; 2017. p. 943\u20138."},{"issue":"1","key":"3210_CR21","doi-asserted-by":"publisher","first-page":"102","DOI":"10.1109\/TIP.2018.2863040","volume":"28","author":"D Mandal","year":"2018","unstructured":"Mandal D, Chaudhury KN, Biswas S. Generalized semantic preserving hashing for cross-modal retrieval. IEEE Trans Image Process. 2018;28(1):102\u201312.","journal-title":"IEEE Trans Image Process"},{"key":"3210_CR22","unstructured":"Yu, Jun, Xiao-Jun Wu, and Josef Kittler. \"Learning Discriminative Hashing Codes for Cross-Modal Retrieval based on Multiorder Statistical Features.\"\u00a0arXiv preprint arXiv:1808.04152\u00a0(2018)."},{"key":"3210_CR23","doi-asserted-by":"crossref","unstructured":"Wang, Shaonan, Jiajun Zhang, and ChengqingZong. \"Associative multichannel autoencoder for multimodal word representation.\" In\u00a0Proceedings of the 2018 Conference on Empirical Methods in Natural Language Processing, pp. 115\u2013124. 2018.","DOI":"10.18653\/v1\/D18-1011"},{"key":"3210_CR24","doi-asserted-by":"publisher","first-page":"1893","DOI":"10.1016\/j.neucom.2017.10.032","volume":"275","author":"J He","year":"2018","unstructured":"He J, Ma B, Wang S, Liu Y, Huang Q. Multilabel double-layer learning for cross-modal retrieval. Neurocomputing. 2018;275:1893\u2013902.","journal-title":"Neurocomputing"},{"key":"3210_CR25","doi-asserted-by":"crossref","unstructured":"Ye, Fanghua, Chuan Chen, and Zibin Zheng. \"Deep autoencoder-like nonnegative matrix factorization for community detection.\" In\u00a0Proceedings of the 27th ACM International Conference on Information and Knowledge Management, pp. 1393\u20131402. 2018.","DOI":"10.1145\/3269206.3271697"},{"issue":"21","key":"3210_CR26","doi-asserted-by":"publisher","first-page":"28665","DOI":"10.1007\/s11042-018-6006-5","volume":"77","author":"X Liu","year":"2018","unstructured":"Liu X, Li An, Ji-Xiang Du, Peng S-J, Fan W. Efficient cross-modal retrieval via flexible supervised collective matrix factorization hashing. Multimedia Tools Applicat. 2018;77(21):28665\u201383.","journal-title":"Multimedia Tools Applicat"},{"issue":"1","key":"3210_CR27","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1038\/s41598-018-34688-x","volume":"8","author":"D Talwar","year":"2018","unstructured":"Talwar D, AanchalMongia DS, Majumdar A. AutoImpute: Autoencoder based imputation of single-cell RNA-seq data. Sci Rep. 2018;8(1):1\u201311.","journal-title":"Sci Rep"},{"issue":"2","key":"3210_CR28","doi-asserted-by":"publisher","first-page":"423","DOI":"10.1109\/TPAMI.2018.2798607","volume":"41","author":"T Baltru\u0161aitis","year":"2018","unstructured":"Baltru\u0161aitis T, Ahuja C, Morency L-P. Multimodal machine learning: A survey and taxonomy. IEEE Trans Pattern Anal Mach Intell. 2018;41(2):423\u201343.","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"issue":"2\u20133","key":"3210_CR29","doi-asserted-by":"publisher","first-page":"208","DOI":"10.1007\/s10791-017-9318-6","volume":"21","author":"F Carrara","year":"2018","unstructured":"Carrara F, Esuli A, TizianoFagni FF, Fern\u00e1ndez AM. Picture it in your mind: Generating high level visual representations from textual descriptions. Informat Retri J. 2018;21(2\u20133):208\u201329.","journal-title":"Informat Retri J"},{"issue":"5","key":"3210_CR30","doi-asserted-by":"publisher","first-page":"1193","DOI":"10.3390\/s19051193","volume":"19","author":"J Liu","year":"2019","unstructured":"Liu J, Li Y, Tian X, Sangaiah AK, Wang J. Towards semantic sensor data: An ontology approach. Sensors. 2019;19(5):1193.","journal-title":"Sensors"},{"key":"3210_CR31","doi-asserted-by":"publisher","first-page":"31233","DOI":"10.1109\/ACCESS.2019.2903310","volume":"7","author":"L Hu","year":"2019","unstructured":"Hu L, Gong Y, Xing Y, Wang F. Semantic representation with heterogeneous information network using matrix factorization for clustering in the Internet of Things. IEEE Access. 2019;7:31233\u201342.","journal-title":"IEEE Access"},{"key":"3210_CR32","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1016\/j.artmed.2018.08.006","volume":"93","author":"S Henry","year":"2019","unstructured":"Henry S, McQuilkin A, McInnes BT. Association measures for estimating semantic similarity and relatedness between biomedical concepts. Artif Intell Med. 2019;93:1\u201310.","journal-title":"Artif Intell Med"},{"key":"3210_CR33","unstructured":"Franzoni, Valentina, Michele Lepri, and Alfredo Milani. \"Topological and semantic graph-based author disambiguation on dblp data in neo4j.\"\u00a0arXiv preprint arXiv:1901.08977\u00a0(2019)."},{"key":"3210_CR34","doi-asserted-by":"publisher","first-page":"163","DOI":"10.1016\/j.future.2018.12.064","volume":"95","author":"N Alhakbani","year":"2019","unstructured":"Alhakbani N, Hassan MM, Ykhlef M, Fortino G. An efficient event matching system for semantic smart data in the Internet of Things (IoT) environment. Future Generat Comput Syst. 2019;95:163\u201374.","journal-title":"Future Generat Comput Syst"},{"key":"3210_CR35","doi-asserted-by":"publisher","first-page":"165","DOI":"10.1016\/j.neucom.2018.11.042","volume":"331","author":"Y Wu","year":"2019","unstructured":"Wu Y, Wang S, Huang Q. Multimodal semantic autoencoder for cross-modal retrieval. Neurocomputing. 2019;331:165\u201375.","journal-title":"Neurocomputing"},{"key":"3210_CR36","doi-asserted-by":"publisher","first-page":"45","DOI":"10.1016\/j.neucom.2018.10.082","volume":"345","author":"W Cao","year":"2019","unstructured":"Cao W, Lin Q, He Z, He Z. Hybrid representation learning for cross-modal retrieval. Neurocomputing. 2019;345:45\u201357.","journal-title":"Neurocomputing"},{"key":"3210_CR37","doi-asserted-by":"crossref","unstructured":"Zhen, Liangli, Peng Hu, Xu Wang, and Dezhong Peng. 2019. \"Deep supervised cross-modal retrieval.\" In\u00a0Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 10394\u201310403","DOI":"10.1109\/CVPR.2019.01064"},{"key":"3210_CR38","doi-asserted-by":"crossref","unstructured":"Hu, Peng, Liangli Zhen, Dezhong Peng, and Pei Liu. 2019. \"Scalable deep multimodal learning for cross-modal retrieval.\" In\u00a0Proceedings of the 42Nd International ACM SIGIR Conference on Research and Development in Information Retrieval, pp. 635\u2013644.","DOI":"10.1145\/3331184.3331213"},{"issue":"3","key":"3210_CR39","doi-asserted-by":"publisher","first-page":"424","DOI":"10.1016\/j.ipm.2018.10.011","volume":"56","author":"D-T Vo","year":"2019","unstructured":"Vo D-T, Bagheri E. Feature-enriched matrix factorization for relation extraction. Inf Process Manage. 2019;56(3):424\u201344.","journal-title":"Inf Process Manage"},{"key":"3210_CR40","doi-asserted-by":"publisher","first-page":"59","DOI":"10.1016\/j.ins.2019.03.066","volume":"490","author":"M Jang","year":"2019","unstructured":"Jang M, SeungwanSeo, and Pilsung Kang. Recurrent neural network-based semantic variational autoencoder for sequence-to-sequence learning. Informat Sci. 2019;490:59\u201373.","journal-title":"Informat Sci"},{"key":"3210_CR41","doi-asserted-by":"publisher","first-page":"18","DOI":"10.1016\/j.bdr.2019.04.001","volume":"16","author":"R Corizzo","year":"2019","unstructured":"Corizzo R, Ceci M, Japkowicz N. Anomaly detection and repair for accurate predictions in geo-distributed big data. Big Data Rese. 2019;16:18\u201335.","journal-title":"Big Data Rese"},{"key":"3210_CR42","doi-asserted-by":"publisher","first-page":"26","DOI":"10.1016\/j.knosys.2019.01.019","volume":"167","author":"F Huang","year":"2019","unstructured":"Huang F, Zhang X, Zhao Z, Jie Xu, Li Z. Image\u2013text sentiment analysis via deep multimodal attentive fusion. Knowl-Based Syst. 2019;167:26\u201337.","journal-title":"Knowl-Based Syst"},{"key":"3210_CR43","doi-asserted-by":"publisher","first-page":"335","DOI":"10.1016\/j.patrec.2019.01.002","volume":"130","author":"H Zhang","year":"2020","unstructured":"Zhang H, Wang T, Dai G. Semi-supervised cross-modal common representation learning with vector-valued manifold regularization. Pattern Recogn Lett. 2020;130:335\u201344.","journal-title":"Pattern Recogn Lett"},{"key":"3210_CR44","doi-asserted-by":"publisher","first-page":"358","DOI":"10.1016\/j.neucom.2019.12.086","volume":"385","author":"T Yao","year":"2020","unstructured":"Yao T, Han Y, Wang R, Kong X, Yan L, Haiyan Fu, Tian Qi. Efficient discrete supervised hashing for large-scale cross-modal retrieval. Neurocomputing. 2020;385:358\u201367.","journal-title":"Neurocomputing"},{"key":"3210_CR45","doi-asserted-by":"publisher","first-page":"100336","DOI":"10.1016\/j.cosrev.2020.100336","volume":"39","author":"P Kaur","year":"2021","unstructured":"Kaur P, Pannu HS, Malhi AK. Comparative analysis on cross-modal information retrieval: A review. Comput Sci Rev. 2021;39:100336.","journal-title":"Comput Sci Rev"},{"key":"3210_CR46","unstructured":"Zhu, L., Wang, T., Li, F., Li, J., Zhang, Z., Shen, H. T. (2023). Cross-modal retrieval: a systematic review of methods and future directions.\u00a0arXiv preprint arXiv:2308.14263."},{"key":"3210_CR47","unstructured":"Fang, M., Ji, S., Zuo, J., Huang, H., Xia, Y., Zhu, J., ... & Zhao, Z. (2024). ACE: A Generative Cross-Modal Retrieval Framework with Coarse-To-Fine Semantic Modeling.\u00a0arXiv preprint arXiv:2406.17507."},{"key":"3210_CR48","doi-asserted-by":"crossref","unstructured":"Kim, M., Kim, H. B., Moon, J., Choi, J., & Kim, S. T. (2024). Do You Remember? Dense Video Captioning with Cross-Modal Memory Retrieval. In\u00a0Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition\u00a0(pp. 13894\u201313904).","DOI":"10.1109\/CVPR52733.2024.01318"},{"issue":"8","key":"3210_CR49","first-page":"8716","volume":"38","author":"Y Li","year":"2024","unstructured":"Li Y, Yang N, Wang L, Wei F, Li W. Learning to rank in generative retrieval. In\u00a0Proceedings of The AAAI on Artif Intell. 2024;38(8):8716\u201323.","journal-title":"In\u00a0Proceedings of The AAAI on Artif Intell"}],"container-title":["SN Computer Science"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s42979-024-03210-8.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s42979-024-03210-8\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s42979-024-03210-8.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,11,27]],"date-time":"2024-11-27T22:33:47Z","timestamp":1732746827000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s42979-024-03210-8"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,9,9]]},"references-count":49,"journal-issue":{"issue":"7","published-online":{"date-parts":[[2024,10]]}},"alternative-id":["3210"],"URL":"https:\/\/doi.org\/10.1007\/s42979-024-03210-8","relation":{},"ISSN":["2661-8907"],"issn-type":[{"type":"electronic","value":"2661-8907"}],"subject":[],"published":{"date-parts":[[2024,9,9]]},"assertion":[{"value":"21 May 2024","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"4 August 2024","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"9 September 2024","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare that they have no conflicts of interest to report regarding the present study.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of Interest"}},{"value":"Yes, All the authors have informed consent for this work.","order":3,"name":"Ethics","group":{"name":"EthicsHeading","label":"Informed Consent"}},{"value":"Not Applicable.","order":4,"name":"Ethics","group":{"name":"EthicsHeading","label":"Research Involving Human and Animals Research"}}],"article-number":"867"}}