{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,12,6]],"date-time":"2025-12-06T08:14:30Z","timestamp":1765008870859,"version":"3.46.0"},"publisher-location":"New York, NY, USA","reference-count":29,"publisher":"ACM","content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2025,12,9]]},"DOI":"10.1145\/3743093.3771040","type":"proceedings-article","created":{"date-parts":[[2025,12,6]],"date-time":"2025-12-06T08:06:16Z","timestamp":1765008376000},"page":"1-7","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":0,"title":["CDFN: Credibility-Driven Fusion Network for Multimodal Sentiment Analysis"],"prefix":"10.1145","author":[{"ORCID":"https:\/\/orcid.org\/0009-0000-1342-920X","authenticated-orcid":false,"given":"Chengyu","family":"Liu","sequence":"first","affiliation":[{"name":"Shanghai DianJi University, Shanghai, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0009-0002-4830-2430","authenticated-orcid":false,"given":"Chengguang","family":"Liu","sequence":"additional","affiliation":[{"name":"Nanjing University of Information Science and Technology, Nanjing, Jiangsu, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0009-0004-3352-7279","authenticated-orcid":false,"given":"Xiqing","family":"Wei","sequence":"additional","affiliation":[{"name":"Shanghai DianJi University, Shanghai, China"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"320","published-online":{"date-parts":[[2025,12,6]]},"reference":[{"key":"e_1_3_3_1_2_2","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2019.00949"},{"key":"e_1_3_3_1_3_2","doi-asserted-by":"crossref","unstructured":"Huiting Fan Xingnan Zhang Yingying Xu Jiangxiong Fang Shiqing Zhang Xiaoming Zhao and Jun Yu. 2024. Transformer-based multimodal feature enhancement networks for multimodal depression detection integrating video audio and remote photoplethysmograph signals. Information Fusion 104 (2024) 102161.","DOI":"10.1016\/j.inffus.2023.102161"},{"key":"e_1_3_3_1_4_2","doi-asserted-by":"crossref","unstructured":"Ming Fang Siyu Peng Yujia Liang Chih-Cheng Hung and Shuhua Liu. 2023. A multimodal fusion model with multi-level attention mechanism for depression detection. Biomedical Signal Processing and Control 82 (2023) 104561.","DOI":"10.1016\/j.bspc.2022.104561"},{"key":"e_1_3_3_1_5_2","doi-asserted-by":"crossref","unstructured":"Yue Gao Yangqing Fu Ming Sun and Feng Gao. 2024. Multi-modal hierarchical empathetic framework for social robots with affective body control. IEEE Transactions on Affective Computing 15 3 (2024) 1621\u20131633.","DOI":"10.1109\/TAFFC.2024.3356511"},{"key":"e_1_3_3_1_6_2","doi-asserted-by":"publisher","DOI":"10.1145\/3394171.3413678"},{"key":"e_1_3_3_1_7_2","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP43922.2022.9747397"},{"key":"e_1_3_3_1_8_2","doi-asserted-by":"crossref","unstructured":"Jiehui Huang Jun Zhou Zhenchao Tang Jiaying Lin and Calvin Yu-Chian Chen. 2024. TMBL: Transformer-based multimodal binding learning model for multimodal sentiment analysis. Knowledge-Based Systems 285 (2024) 111346.","DOI":"10.1016\/j.knosys.2023.111346"},{"key":"e_1_3_3_1_9_2","unstructured":"Chengguang Liu Shanmin Wang Qingshan Liu Yang Wang and Fei Wang. 2025. Mitigating Symptom Heterogeneity in Multimodal Depression Estimation Via Level Separation and Deviation Regression. IEEE Transactions on Affective Computing (2025)."},{"key":"e_1_3_3_1_10_2","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-46314-3_3"},{"key":"e_1_3_3_1_11_2","unstructured":"Laurens van\u00a0der Maaten and Geoffrey Hinton. 2008. Visualizing data using t-SNE. Journal of machine learning research 9 Nov (2008) 2579\u20132605."},{"key":"e_1_3_3_1_12_2","doi-asserted-by":"crossref","unstructured":"Muhammad Muzammel Hanan Salam and Alice Othmani. 2021. End-to-end multimodal clinical depression recognition using deep neural networks: A comparative analysis. Computer Methods and Programs in Biomedicine 211 (2021) 106433.","DOI":"10.1016\/j.cmpb.2021.106433"},{"key":"e_1_3_3_1_13_2","doi-asserted-by":"publisher","DOI":"10.1109\/IJCNN52387.2021.9534330"},{"key":"e_1_3_3_1_14_2","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2020.acl-main.214"},{"key":"e_1_3_3_1_15_2","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v34i05.6431"},{"key":"e_1_3_3_1_16_2","doi-asserted-by":"crossref","unstructured":"Zemin Tang Qi Xiao Yunchuan Qin Xu Zhou Joey\u00a0Tianyi Zhou and Kenli Li. 2024. Multi-view interactive representations for multimodal sentiment analysis. IEEE Transactions on Consumer Electronics 70 1 (2024) 4095\u20134107.","DOI":"10.1109\/TCE.2024.3357480"},{"key":"e_1_3_3_1_17_2","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/P19-1656"},{"key":"e_1_3_3_1_18_2","doi-asserted-by":"crossref","unstructured":"Md\u00a0Azher Uddin Joolekha\u00a0Bibi Joolee and Kyung-Ah Sohn. 2022. Deep multi-modal network based automated depression severity estimation. IEEE transactions on affective computing 14 3 (2022) 2153\u20132167.","DOI":"10.1109\/TAFFC.2022.3179478"},{"key":"e_1_3_3_1_19_2","doi-asserted-by":"crossref","unstructured":"Di Wang Shuai Liu Quan Wang Yumin Tian Lihuo He and Xinbo Gao. 2022. Cross-modal enhancement network for multimodal sentiment analysis. IEEE Transactions on Multimedia 25 (2022) 4909\u20134921.","DOI":"10.1109\/TMM.2022.3183830"},{"key":"e_1_3_3_1_20_2","doi-asserted-by":"crossref","unstructured":"Lan Wang Junjie Peng Cangzhi Zheng Tong Zhao and Li\u2019an Zhu. 2024. A cross modal hierarchical fusion multimodal sentiment analysis method based on multi-task learning. Information Processing & Management 61 3 (2024) 103675.","DOI":"10.1016\/j.ipm.2024.103675"},{"key":"e_1_3_3_1_21_2","doi-asserted-by":"crossref","unstructured":"Shanmin Wang Hui Shuai Chengguang Liu and Qingshan Liu. 2022. Bias-based soft label learning for facial expression recognition. IEEE Transactions on Affective Computing 14 4 (2022) 3257\u20133268.","DOI":"10.1109\/TAFFC.2022.3220291"},{"key":"e_1_3_3_1_22_2","first-page":"623","volume-title":"European Conference on Computer Vision","author":"Wei Ping-Cheng","year":"2022","unstructured":"Ping-Cheng Wei, Kunyu Peng, Alina Roitberg, Kailun Yang, Jiaming Zhang, and Rainer Stiefelhagen. 2022. Multi-modal depression estimation based on sub-attentional fusion. In European Conference on Computer Vision. Springer, 623\u2013639."},{"key":"e_1_3_3_1_23_2","doi-asserted-by":"crossref","unstructured":"Bo Yang Lijun Wu Jinhua Zhu Bo Shao Xiaola Lin and Tie-Yan Liu. 2022. Multimodal sentiment analysis with two-phase multi-task learning. IEEE\/ACM Transactions on Audio Speech and Language Processing 30 (2022) 2015\u20132024.","DOI":"10.1109\/TASLP.2022.3178204"},{"key":"e_1_3_3_1_24_2","doi-asserted-by":"publisher","DOI":"10.1145\/3474085.3475585"},{"key":"e_1_3_3_1_25_2","doi-asserted-by":"crossref","unstructured":"Amir Zadeh Minghai Chen Soujanya Poria Erik Cambria and Louis-Philippe Morency. 2017. Tensor fusion network for multimodal sentiment analysis. arXiv preprint arXiv:https:\/\/arXiv.org\/abs\/1707.07250 (2017).","DOI":"10.18653\/v1\/D17-1115"},{"key":"e_1_3_3_1_26_2","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v32i1.12021"},{"key":"e_1_3_3_1_27_2","doi-asserted-by":"crossref","unstructured":"Amir Zadeh Rowan Zellers Eli Pincus and Louis-Philippe Morency. 2016. Multimodal sentiment intensity analysis in videos: Facial gestures and verbal messages. IEEE Intelligent Systems 31 6 (2016) 82\u201388.","DOI":"10.1109\/MIS.2016.94"},{"key":"e_1_3_3_1_28_2","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/P18-1208"},{"key":"e_1_3_3_1_29_2","unstructured":"Yuhang Zhang Chengrui Wang and Weihong Deng. 2021. Relative uncertainty learning for facial expression recognition. Advances in Neural Information Processing Systems 34 (2021) 17616\u201317627."},{"key":"e_1_3_3_1_30_2","doi-asserted-by":"crossref","unstructured":"Xianbing Zhao Yinxin Chen Sicen Liu and Buzhou Tang. 2022. Shared-private memory networks for multimodal sentiment analysis. IEEE Transactions on Affective Computing 14 4 (2022) 2889\u20132900.","DOI":"10.1109\/TAFFC.2022.3222023"}],"event":{"name":"MMAsia '25: ACM Multimedia Asia","location":"Kuala Lumpur Malaysia","acronym":"MMAsia '25","sponsor":["SIGMM ACM Special Interest Group on Multimedia"]},"container-title":["Proceedings of the 7th ACM International Conference on Multimedia in Asia"],"original-title":[],"link":[{"URL":"https:\/\/dl.acm.org\/doi\/pdf\/10.1145\/3743093.3771040","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,12,6]],"date-time":"2025-12-06T08:10:53Z","timestamp":1765008653000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3743093.3771040"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,12,6]]},"references-count":29,"alternative-id":["10.1145\/3743093.3771040","10.1145\/3743093"],"URL":"https:\/\/doi.org\/10.1145\/3743093.3771040","relation":{},"subject":[],"published":{"date-parts":[[2025,12,6]]},"assertion":[{"value":"2025-12-06","order":3,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}