{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,12]],"date-time":"2026-06-12T04:58:54Z","timestamp":1781240334773,"version":"3.54.1"},"reference-count":56,"publisher":"Springer Science and Business Media LLC","issue":"8","license":[{"start":{"date-parts":[[2026,6,1]],"date-time":"2026-06-01T00:00:00Z","timestamp":1780272000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2026,6,1]],"date-time":"2026-06-01T00:00:00Z","timestamp":1780272000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["92467103"],"award-info":[{"award-number":["92467103"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["92367302"],"award-info":[{"award-number":["92367302"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"name":"Major Science and Technology Special Project of Henan Province","award":["201300210400"],"award-info":[{"award-number":["201300210400"]}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Appl Intell"],"published-print":{"date-parts":[[2026,6]]},"DOI":"10.1007\/s10489-026-07327-6","type":"journal-article","created":{"date-parts":[[2026,6,12]],"date-time":"2026-06-12T04:35:05Z","timestamp":1781238905000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["Modality-balanced federated learning via cross-client regional prototypes and gradient weighting"],"prefix":"10.1007","volume":"56","author":[{"given":"Mengmeng","family":"Li","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xin","family":"He","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Jinhua","family":"Chen","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2026,6,12]]},"reference":[{"key":"7327_CR1","doi-asserted-by":"publisher","first-page":"2693","DOI":"10.1109\/TIFS.2025.3530700","volume":"20","author":"S Wang","year":"2025","unstructured":"Wang S, Gai K, Yu J, Zhang Z, Zhu L (2025) Pravfed: practical heterogeneous vertical federated learning via representation learning. IEEE Trans Inf Forensics Secur 20:2693\u20132705","journal-title":"IEEE Trans Inf Forensics Secur"},{"key":"7327_CR2","doi-asserted-by":"crossref","unstructured":"Wu C, Zhong H, Chen G, Alhusaini N, Zhao S, Zhang Y (2024) Optimizing Multimodal Federated Learning: Novel Approaches for Efficient Model Aggregation and Client Sampling, in Proceedings of the 2024 International Conference on Networking and Network Applications (NaNA), Yinchuan City, China, pp. 137\u2013146","DOI":"10.1109\/NaNA63151.2024.00030"},{"key":"7327_CR3","unstructured":"Yan K, Cui S, Wuerkaixi A, Zhang J, Han B, Niu G, Sugiyama M, Zhang C (2024) Balancing Similarity and Complementarity for Federated Learning, in Proceedings of the 41st International Conference on Machine Learning, Vienna, Austria, pp. 55739\u201355758"},{"key":"7327_CR4","unstructured":"Li T, Kumar Sahu A, Zaheer M, Sanjabi M, Talwalkar A, Smith V (2020) Federated Optimization in Heterogeneous Networks, in Proceedings of Machine Learning and Systems, Austin, TX, USA, 2\u20134 March, pp. 429\u2013450"},{"issue":"3","key":"7327_CR5","doi-asserted-by":"publisher","first-page":"1079","DOI":"10.28991\/HIJ-2025-06-03-020","volume":"6","author":"TX Wu","year":"2025","unstructured":"Wu TX, Han PY, Yin OS, You LZ, San HF (2025) A review on federated learning on sensor-based human activity recognition. HighTech Innov J 6(3):1079\u20131103","journal-title":"HighTech Innov J"},{"issue":"2","key":"7327_CR6","doi-asserted-by":"publisher","first-page":"659","DOI":"10.28991\/ESJ-2025-09-02-09","volume":"9","author":"RM Negara","year":"2025","unstructured":"Negara RM, Syambas NR, Mulyana E, Fajri RM, Budiana MS (2025) CacheCraft: a topology-aware PageRank centrality algorithm for cache optimization in Named Data Networking. Emerg Sci J 9(2):659\u2013676","journal-title":"Emerg Sci J"},{"issue":"1","key":"7327_CR7","doi-asserted-by":"publisher","first-page":"468","DOI":"10.28991\/ESJ-2025-09-01-026","volume":"9","author":"SR Sekaran","year":"2025","unstructured":"Sekaran SR, Pang YH, Yin OS, You LZ (2025) HSTCN-NuSVC: a homogeneous stacked deep ensemble learner for classifying human actions using smartphones. Emerg Sci J 9(1):468\u2013484","journal-title":"Emerg Sci J"},{"key":"7327_CR8","doi-asserted-by":"publisher","first-page":"112484","DOI":"10.1016\/j.knosys.2024.112484","volume":"304","author":"Q Yin","year":"2024","unstructured":"Yin Q, Feng Z, Li X, Chen S, Wu H, Han G (2024) Tackling data-heterogeneity variations in federated learning via adaptive aggregate weights. Knowl Based Syst 304:112484","journal-title":"Knowl Based Syst"},{"issue":"3","key":"7327_CR9","doi-asserted-by":"publisher","first-page":"918","DOI":"10.28991\/HIJ-2025-06-03-011","volume":"6","author":"G Zhenyu","year":"2025","unstructured":"Zhenyu G, Yaoben G (2025) Using PID-BP digital virtual reality for non-heritage protection: recognition and assessment. HighTech Innov J 6(3):918\u2013932","journal-title":"HighTech Innov J"},{"key":"7327_CR10","doi-asserted-by":"crossref","unstructured":"Chen H, Zhang Y, Krompass D, Gu J, Tresp V (2024) FedDAT: An Approach for Foundation Model Finetuning in Multi-modal Heterogeneous Federated Learning, in Proceedings of the AAAI Conference on Artificial Intelligence, Vancouver, Canada, pp. 11285\u201311293","DOI":"10.1609\/aaai.v38i10.29007"},{"issue":"6","key":"7327_CR11","doi-asserted-by":"publisher","first-page":"3318","DOI":"10.1109\/TMC.2021.3136853","volume":"22","author":"H Yu","year":"2023","unstructured":"Yu H, Chen Z, Zhang X, Chen X, Zhuang F, Xiong H (2023) Fedhar: semi-supervised online learning for personalized federated human activity recognition. IEEE Trans Mob Comput 22(6):3318\u20133332","journal-title":"IEEE Trans Mob Comput"},{"key":"7327_CR12","unstructured":"Yu Q, Liu Y, Wang Y, Xu K, Liu J (2023) Multimodal Federated Learning via Contrastive Representation Ensemble, in Proceedings of the Eleventh International Conference on Learning Representations, Kigali, Rwanda, May 1\u20135"},{"key":"7327_CR13","doi-asserted-by":"crossref","unstructured":"Zhao Y, Barnaghi P, Haddadi H (2022) Multimodal Federated Learning on IoT Data, in Proceedings of the 2022 IEEE\/ACM Seventh International Conference on Internet-of-Things Design and Implementation (IoTDI), Milano, Italy, pp. 43\u201354","DOI":"10.1109\/IoTDI54339.2022.00011"},{"key":"7327_CR14","doi-asserted-by":"crossref","unstructured":"Ouyang X, Xie Z, Fu H, Cheng S, Pan L, Ling N, Xing G, Zhou J, Huang J (2023) Harmony: Heterogeneous Multi-Modal Federated Learning Through Disentangled Model Training, In Proceedings of the 21st Annual International Conference on Mobile Systems, Applications and Services, New York, NY, USA, pp. 530\u2013543","DOI":"10.1145\/3581791.3596844"},{"key":"7327_CR15","doi-asserted-by":"crossref","unstructured":"Fan Y, Xu W, Wang H, Huo F, Chen J, Guo S (2024) Overcome Modal Bias in Multi-modal Federated Learning via Balanced Modality Selection, in Proceedings of the 18th European Conference on Computer Vision, Milan, Italy, September 29-October 4, pp. 178\u2013195","DOI":"10.1007\/978-3-031-73004-7_11"},{"key":"7327_CR16","doi-asserted-by":"crossref","unstructured":"Qi F, Li S (2024) Adaptive Hyper-Graph Aggregation for Modality-Agnostic Federated Learning, in Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, Seattle, WA, USA, pp. 12312\u201312321","DOI":"10.1109\/CVPR52733.2024.01170"},{"key":"7327_CR17","doi-asserted-by":"crossref","unstructured":"Peng Y, Bian J, Xu J (2024) Fedmm: Federated Multi-Modal Learning with Modality Heterogeneity in Computational Pathology, in Proceedings of the ICASSP 2024\u20132024 IEEE International Conference on Acoustics, Seoul, Republic of Korea, pp. 1696\u20131700","DOI":"10.1109\/ICASSP48485.2024.10448255"},{"key":"7327_CR18","doi-asserted-by":"crossref","unstructured":"Yuan L, Han D-J, Pandi Chellapandi V, Zak SH, Brinton CG (2024) FedMFS: Federated Multimodal Fusion Learning with Selective Modality Communication, in Proceedings of the ICC 2024 - IEEE International Conference on Communications, Denver, CO, USA, pp. 287\u2013292","DOI":"10.1109\/ICC51166.2024.10622194"},{"issue":"6","key":"7327_CR19","doi-asserted-by":"publisher","first-page":"4843","DOI":"10.1109\/TCSVT.2023.3337134","volume":"34","author":"J Fu","year":"2024","unstructured":"Fu J, Gao J, Bao B-K, Xu C (2024) Multimodal imbalance-aware gradient modulation for weakly-supervised audio-visual video parsing. IEEE Trans Circuits Syst Video Technol 34(6):4843\u20134856","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"7327_CR20","doi-asserted-by":"crossref","unstructured":"Chen S, Jiang H, Ouyang T, Lin M, Zhang X, Chen X (2025) MFEL-HAM: Multimodal Federated Edge Learning with Heterogeneity-Aware Modality Balancing, in Proceedings of the 2025 IEEE 31th International Conference on Parallel and Distributed Systems (ICPADS), Hefei, China, pp. 1\u20138","DOI":"10.1109\/ICPADS67057.2025.11323174"},{"key":"7327_CR21","doi-asserted-by":"publisher","DOI":"10.1109\/tmc.2025.3548954","author":"J Guo","year":"2025","unstructured":"Guo J, Fu Y, Zhai Z, Li X, Deng Y, Yue S (2025) MASA: multimodal federated learning through modality-aware and secure aggregation. IEEE Trans Mob Comput. https:\/\/doi.org\/10.1109\/tmc.2025.3548954","journal-title":"IEEE Trans Mob Comput"},{"key":"7327_CR22","unstructured":"Wang J, Liu Q, Liang H, Joshi G, Vincent Poor H (2020) Tackling the Objective Inconsistency Problem in Heterogeneous Federated Optimization, in Proceedings of the 34th International Conference on Neural Information Processing Systems (NIPS\u201920), Vancouver, BC, Canada, 6\u201312 December, 2020, pp. 7611\u20137623"},{"issue":"7","key":"7327_CR23","doi-asserted-by":"publisher","first-page":"12459","DOI":"10.1109\/JIOT.2023.3333419","volume":"11","author":"Z Lian","year":"2024","unstructured":"Lian Z, Cao J, Zhu Z, Zhou X, Liu W (2024) GOFL: an accurate and efficient federated learning framework based on gradient optimization in heterogeneous IoT systems. IEEE Internet Things J 11(7):12459\u201312474","journal-title":"IEEE Internet Things J"},{"issue":"8","key":"7327_CR24","first-page":"8432","volume":"36","author":"Y Tan","year":"2022","unstructured":"Tan Y, Guodong Long L, Liu TZ, Qinghua L, Jiang J, Zhang C (2022) FedProto: Federated Prototype Learning Across Heterogeneous Clients. Proc AAAI Conf Artif Intell 36(8):8432\u20138440","journal-title":"Proc AAAI Conf Artif Intell"},{"key":"7327_CR25","doi-asserted-by":"crossref","unstructured":"Dai Y, Chen Z, Li J, Heinecke S, Sun L, Xu R (2023) Tackling Data Heterogeneity in Federated Learning with Class Prototypes, in Proceedings of the Thirty-Seventh AAAI Conference on Artificial Intelligence, 2023, pp. 7314\u20137322","DOI":"10.1609\/aaai.v37i6.25891"},{"key":"7327_CR26","doi-asserted-by":"crossref","unstructured":"Huang W, Ye M, Shi Z, Li H, Du B (2023) Rethinking Federated Learning with Domain Shift: A Prototype View, in Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, 2023, pp. 16312\u201316322","DOI":"10.1109\/CVPR52729.2023.01565"},{"key":"7327_CR27","doi-asserted-by":"crossref","unstructured":"Zhang J, Liu Y, Hua Y, Cao J (2024) An Upload-Efficient Scheme for Transferring Knowledge from a Server-Side Pre-trained Generator to Clients in Heterogeneous Federated Learning, in Proceedings of the 2024 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR), Seattle, WA, USA, 2024, pp. 12109\u201312119","DOI":"10.1109\/CVPR52733.2024.01151"},{"key":"7327_CR28","doi-asserted-by":"publisher","first-page":"110","DOI":"10.1016\/j.neucom.2022.01.063","volume":"480","author":"B Xiong","year":"2022","unstructured":"Xiong B, Yang X, Qi F, Xu C (2022) A unified framework for multimodal federated learning. Neurocomputing 480:110\u2013118","journal-title":"Neurocomputing"},{"key":"7327_CR29","doi-asserted-by":"publisher","DOI":"10.1109\/TNNLS.2026.3658522","author":"G Bao","year":"2026","unstructured":"Bao G, Zhang Q, Miao D, Gong Z, Hu L (2026) Incomplete multimodal federated learning via masking and contrasting prototypes. IEEE Trans Neural Netw Learn Syst. https:\/\/doi.org\/10.1109\/TNNLS.2026.3658522","journal-title":"IEEE Trans Neural Netw Learn Syst"},{"issue":"4","key":"7327_CR30","doi-asserted-by":"publisher","first-page":"1931","DOI":"10.1109\/TMI.2024.3523378","volume":"44","author":"H Song","year":"2025","unstructured":"Song H, Wang J, Zhou J, Wang L (2025) Tackling modality-heterogeneous client drift holistically for heterogeneous multimodal federated learning. IEEE Trans Med Imaging 44(4):1931\u20131941","journal-title":"IEEE Trans Med Imaging"},{"key":"7327_CR31","doi-asserted-by":"crossref","unstructured":"Sun G, Mendieta M, Dutta A, Li X, Chen C (2024) Towards Multi-Modal Transformers in Federated Learning, in Proceedings of the 18th European Conference on Computer Vision, Milan, Italy, September 29 - October 4, 2024, pp. 229\u2013246","DOI":"10.1007\/978-3-031-72633-0_13"},{"key":"7327_CR32","doi-asserted-by":"crossref","unstructured":"Alfasly S, Lu J, Xu C, Zou Y (2022) Learnable Irrelevant Modality Dropout for Multimodal Action Recognition on Modality-Specific Annotated Videos, in Proceedings of the 2022 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR), New Orleans, LA, USA, 2022, pp. 20176\u201320185","DOI":"10.1109\/CVPR52688.2022.01957"},{"key":"7327_CR33","doi-asserted-by":"crossref","unstructured":"Wang W, Tran D, Feiszli M (2020) What Makes Training Multi-modal Classification Networks Hard, in Proceedings of the 2020 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR), Seattle, WA, USA, 2020, pp. 12692\u201312702","DOI":"10.1109\/CVPR42600.2020.01271"},{"key":"7327_CR34","unstructured":"Du C, Li T, Liu Y, Wen Z, Hua T, Wang Y, Zhao H (2021) Improving Multi-Modal Learning with Uni-Modal Teachers, 2021, ArXiv abs\/2106.11059"},{"key":"7327_CR35","doi-asserted-by":"crossref","unstructured":"Peng X, Wei Y, Deng A, Wang D, Di Hu (2022) Balanced Multimodal Learning via On-the-fly Gradient Modulation, in Proceedings of the 2022 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR), Jun. 2022, pp. 8228\u20138237","DOI":"10.1109\/CVPR52688.2022.00806"},{"key":"7327_CR36","doi-asserted-by":"crossref","unstructured":"Fan Y, Xu W, Wang H, Wang J, Guo S (2023) PMR: Prototypical Modal Rebalance for Multimodal Learning, in Proceedings of the 2023 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR), Vancouver, BC, Canada, 2023, pp. 20029\u201320038","DOI":"10.1109\/CVPR52729.2023.01918"},{"key":"7327_CR37","doi-asserted-by":"crossref","unstructured":"Wei Y, Feng R, Wang Z, Di Hu (2024) Enhancing Multimodal Cooperation via Sample-Level Modality Valuation, In Proceedings of the 2024 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR), Seattle, WA, USA, 2024, pp. 27328\u201327337","DOI":"10.1109\/CVPR52733.2024.02581"},{"key":"7327_CR38","unstructured":"Ravikumar Balakrishnan, Tian Li, Tianyi Zhou, Nageen Himayat, Virginia Smith, and Jeff Bilmes. Diverse Client Selection for Federated Learning via Submodular Maximization, in Proceedings of the International Conference on Learning Representations, 2022."},{"key":"7327_CR39","doi-asserted-by":"crossref","unstructured":"Mirzasoleiman B, Badanidiyuru A, Karbasi A, Vondrak J, Krause (2015) Lazier Than Lazy Greedy, in Proceedings of the AAAI Conference on Artificial Intelligence. 29(1)","DOI":"10.1609\/aaai.v29i1.9486"},{"issue":"3","key":"7327_CR40","doi-asserted-by":"publisher","first-page":"645","DOI":"10.1109\/TNN.2005.845141","volume":"16","author":"R Xu","year":"2005","unstructured":"Xu R, Wunsch D (2005) Survey of clustering algorithms. IEEE Trans Neural Netw 16(3):645\u2013678","journal-title":"IEEE Trans Neural Netw"},{"issue":"20","key":"7327_CR41","doi-asserted-by":"publisher","first-page":"20243","DOI":"10.1109\/JIOT.2022.3175149","volume":"9","author":"P Tian","year":"2022","unstructured":"Tian P, Liao W, Yu W, Blasch ian E (2022) WSCC: a weight-similarity-based client clustering approach for Non-IID federated learning. IEEE Internet Things J 9(20):20243\u201320256","journal-title":"IEEE Internet Things J"},{"key":"7327_CR42","doi-asserted-by":"publisher","first-page":"1318","DOI":"10.1007\/s11227-025-07728-3","volume":"81","author":"J Chen","year":"2025","unstructured":"Chen J, Li M, He X (2025) FedCK: addressing label distribution skew in federated learning via clustering-efficient and knowledge distillation. J Supercomput 81:1318","journal-title":"J Supercomput"},{"key":"7327_CR43","doi-asserted-by":"crossref","unstructured":"Xiang W, Li Y, He R, Gao M, An M (2017) A novel artificial bee colony algorithm based on the cosine similarity, computers & industrial engineering. 115","DOI":"10.1016\/j.cie.2017.10.022"},{"issue":"1","key":"7327_CR44","doi-asserted-by":"publisher","first-page":"108127","DOI":"10.1016\/j.engappai.2024.108127","volume":"133","author":"C Gao","year":"2024","unstructured":"Gao C, Lia W, He L, Zhong L (2024) A distance and cosine similarity-based fitness evaluation mechanism for large-scale many-objective optimization. Eng Appl Artif Intell 133(1):108127","journal-title":"Eng Appl Artif Intell"},{"key":"7327_CR45","doi-asserted-by":"publisher","first-page":"103909","DOI":"10.1016\/j.inffus.2025.103909","volume":"127","author":"S Li","year":"2025","unstructured":"Li S, Wei X, Wang H, Su Y, Susilo W (2025) Cerflan: communication-efficient norm bounding for robust federated learning. Inf Fusion 127:103909","journal-title":"Inf Fusion"},{"key":"7327_CR46","doi-asserted-by":"crossref","unstructured":"Tian Y, Shi J, Li B, Duan Z, Xu C (2018) Audio-Visual Event Localization in Unconstrained Videos, in Proceedings of the European Conference on Computer Vision (ECCV), 2018, pp. 247\u2013263","DOI":"10.1007\/978-3-030-01216-8_16"},{"key":"7327_CR47","doi-asserted-by":"crossref","unstructured":"Owens A, Efros AA (2018) Audio-Visual Scene Analysis with Self-Supervised Multisensory Features, in Proceedings of the European Conference on Computer Vision (ECCV), 2018, pp. 631\u2013648","DOI":"10.1007\/978-3-030-01231-1_39"},{"issue":"4","key":"7327_CR48","doi-asserted-by":"publisher","first-page":"377","DOI":"10.1109\/TAFFC.2014.2336244","volume":"5","author":"H Cao","year":"2014","unstructured":"Cao H, Cooper DG, Keutmann MK, Gur RC, Nenkova A, Verma R (2014) CREMA-D: crowd-sourced emotional multimodal actors dataset. IEEE Trans Affect Comput 5(4):377\u2013390","journal-title":"IEEE Trans Affect Comput"},{"key":"7327_CR49","unstructured":"Harry Hsu T-M, Qi H, Brown M (2019) Measuring the effects of non-identical data distribution for federated visual classification, arXiv preprint arXiv:1909.06335"},{"key":"7327_CR50","doi-asserted-by":"crossref","unstructured":"He K, Zhang X, Ren S, Sun J (2016) Deep residual learning for image recognition, in Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, 2016, pp. 770\u2013778","DOI":"10.1109\/CVPR.2016.90"},{"issue":"3","key":"7327_CR51","doi-asserted-by":"publisher","first-page":"400","DOI":"10.1214\/aoms\/1177729586","volume":"22","author":"H Robbins","year":"1951","unstructured":"Robbins H, Robbins SM (1951) A stochastic approximation method. Ann Math Stat 22(3):400\u2013407","journal-title":"Ann Math Stat"},{"key":"7327_CR52","unstructured":"McMahan B, Moore E, Ramage D, Hampson S, Aguera y Arcas B (2017) Communication-Efficient Learning of Deep Networks from Decentralized Data, in Proceedings of the 20th International Conference on Artificial Intelligence and Statistics, 20\u201322 Apr 2017, pp. 1273\u20131282"},{"key":"7327_CR53","unstructured":"Cho YJ, Wang J, Joshi G (2020) Client Selection in Federated Learning: Convergence Analysis and Power-of-Choice Selection Strategies, 2020, arXiv preprint arXiv:2010.01243"},{"key":"7327_CR54","doi-asserted-by":"crossref","unstructured":"Chen J, Zhang A (2022) Fedmsplit: Correlation-Adaptive Federated Multi-Task Learning Across Multimodal Split Networks, in Proceedings of the 28th ACM SIGKDD Conference on Knowledge Discovery and Data Mining, 2022, pp. 87\u201396","DOI":"10.1145\/3534678.3539384"},{"key":"7327_CR55","unstructured":"Xiao F, Jae Lee Y, Grauman K, Malik J, Feichtenhofer C (2020) Audiovisual Slowfast Networks for Video Recognition, 2020, ArXiv, abs\/2001.08740"},{"key":"7327_CR56","first-page":"14200","volume":"34","author":"A Nagrani","year":"2021","unstructured":"Nagrani A, Yang S, Arnab A, Jansen A, Schmid C, Sun C (2021) Attention bot tlenecks for multimodal fusion. Adv Neural Inf Process Syst 34:14200\u201314213","journal-title":"Adv Neural Inf Process Syst"}],"container-title":["Applied Intelligence"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s10489-026-07327-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s10489-026-07327-6","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s10489-026-07327-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,6,12]],"date-time":"2026-06-12T04:35:49Z","timestamp":1781238949000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s10489-026-07327-6"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,6]]},"references-count":56,"journal-issue":{"issue":"8","published-print":{"date-parts":[[2026,6]]}},"alternative-id":["7327"],"URL":"https:\/\/doi.org\/10.1007\/s10489-026-07327-6","relation":{},"ISSN":["0924-669X","1573-7497"],"issn-type":[{"value":"0924-669X","type":"print"},{"value":"1573-7497","type":"electronic"}],"subject":[],"published":{"date-parts":[[2026,6]]},"assertion":[{"value":"27 June 2025","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"30 May 2026","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"12 June 2026","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare that they have no known competing financial interests or personal relationships that could have appeared to influence the work reported in this paper.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflicts of interest"}}],"article-number":"304"}}