{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,15]],"date-time":"2026-07-15T18:06:47Z","timestamp":1784138807656,"version":"3.55.0"},"publisher-location":"New York, NY, USA","reference-count":19,"publisher":"ACM","license":[{"start":{"date-parts":[[2026,7,19]],"date-time":"2026-07-19T00:00:00Z","timestamp":1784419200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0\/legalcode"}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2026,7,20]]},"DOI":"10.1145\/3805712.3809947","type":"proceedings-article","created":{"date-parts":[[2026,7,15]],"date-time":"2026-07-15T17:06:26Z","timestamp":1784135186000},"page":"4250-4255","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":0,"title":["MEG-RAG: Quantifying Multi-modal Evidence Grounding for Evidence Selection in RAG"],"prefix":"10.1145","author":[{"ORCID":"https:\/\/orcid.org\/0009-0008-7746-8150","authenticated-orcid":false,"given":"Xihang","family":"Wang","sequence":"first","affiliation":[{"name":"Zhejiang University, Hangzhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0008-2032-4762","authenticated-orcid":false,"given":"Zihan","family":"Wang","sequence":"additional","affiliation":[{"name":"Peking University, Beijing, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-1630-424X","authenticated-orcid":false,"given":"Chengkai","family":"Huang","sequence":"additional","affiliation":[{"name":"University of New South Wales, Sydney, NSW, Australia and Macquarie University, Sydney, Australia"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-3326-4147","authenticated-orcid":false,"given":"Quan Z.","family":"Sheng","sequence":"additional","affiliation":[{"name":"Macquarie University, Sydney, NSW, Australia"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-4149-839X","authenticated-orcid":false,"given":"Lina","family":"Yao","sequence":"additional","affiliation":[{"name":"University of New South Wales, Sydney, NSW, Australia and CSIRO\u2019s Data61, Sydney, Australia"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"320","published-online":{"date-parts":[[2026,7,19]]},"reference":[{"key":"e_1_3_2_1_1_1","first-page":"2024","article-title":"Llama 3.2: Revolutionizing edge ai and vision with open, customizable models","volume":"20","author":"Meta","year":"2024","unstructured":"Meta AI. 2024. Llama 3.2: Revolutionizing edge ai and vision with open, customizable models. Meta AI Blog., Vol. 20 (2024), 2024.","journal-title":"Meta AI Blog."},{"key":"e_1_3_2_1_2_1","unstructured":"Shuai Bai Keqin Chen Xuejing Liu Jialin Wang Wenbin Ge Sibo Song Kai Dang Peng Wang Shijie Wang Jun Tang et al. 2025. Qwen2. 5-VL Technical Report. eprint arXiv: 2502.13923 (2025)."},{"key":"e_1_3_2_1_3_1","doi-asserted-by":"publisher","DOI":"10.1145\/1102351.1102363"},{"key":"e_1_3_2_1_4_1","volume-title":"MLLM Is a Strong Reranker: Advancing Multimodal Retrieval-augmented Generation via Knowledge-enhanced Reranking and Noise-injected Training. CoRR","author":"Chen Zhanpeng","year":"2024","unstructured":"Zhanpeng Chen, Chengjin Xu, Yiyan Qi, and Jian Guo. 2024. MLLM Is a Strong Reranker: Advancing Multimodal Retrieval-augmented Generation via Knowledge-enhanced Reranking and Noise-injected Training. CoRR, Vol. abs\/2407.21439 (2024)."},{"key":"e_1_3_2_1_5_1","volume-title":"Word association norms, mutual information, and lexicography. Computational linguistics","author":"Church Kenneth","year":"1990","unstructured":"Kenneth Church and Patrick Hanks. 1990. Word association norms, mutual information, and lexicography. Computational linguistics, Vol. 16, 1 (1990), 22-29."},{"key":"e_1_3_2_1_6_1","unstructured":"Chengkai Huang Junda Wu Yu Xia Zixu Yu Ruhan Wang Tong Yu Ruiyi Zhang Ryan A Rossi Branislav Kveton Dongruo Zhou et al. 2025a. Towards agentic recommender systems in the era of multimodal large language models. arXiv preprint arXiv:2503.16734 (2025)."},{"key":"e_1_3_2_1_7_1","volume-title":"Proceedings of the 31st International Conference on Computational Linguistics. 1403-1412","author":"Huang Chengkai","year":"2025","unstructured":"Chengkai Huang, Yu Xia, Rui Wang, Kaige Xie, Tong Yu, Julian McAuley, and Lina Yao. 2025b. Embedding-informed adaptive retrieval-augmented generation of large language models. In Proceedings of the 31st International Conference on Computational Linguistics. 1403-1412."},{"key":"e_1_3_2_1_8_1","volume-title":"2026 a. Doctor-RAG: Failure-Aware Repair for Agentic Retrieval-Augmented Generation. arXiv preprint arXiv:2604.00865","author":"Jiao Shuguang","year":"2026","unstructured":"Shuguang Jiao, Chengkai Huang, Shuhan Qi, Xuan Wang, Yifan Li, and Lina Yao. 2026 a. Doctor-RAG: Failure-Aware Repair for Agentic Retrieval-Augmented Generation. arXiv preprint arXiv:2604.00865 (2026)."},{"key":"e_1_3_2_1_9_1","doi-asserted-by":"publisher","DOI":"10.1145\/3774904.3792103"},{"key":"e_1_3_2_1_10_1","unstructured":"Jina AI. 2025. Jina Reranker M0: Multilingual & Multimodal Document Reranker."},{"key":"e_1_3_2_1_11_1","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2024.blackboxnlp-1.18"},{"key":"e_1_3_2_1_12_1","volume-title":"Llava-next-interleave: Tackling multi-image, video, and 3d in large multimodal models. arXiv preprint arXiv:2407.07895","author":"Li Feng","year":"2024","unstructured":"Feng Li, Renrui Zhang, Hao Zhang, Yuanhan Zhang, Bo Li, Wei Li, Zejun Ma, and Chunyuan Li. 2024. Llava-next-interleave: Tackling multi-image, video, and 3d in large multimodal models. arXiv preprint arXiv:2407.07895 (2024)."},{"key":"e_1_3_2_1_13_1","doi-asserted-by":"publisher","DOI":"10.1145\/3746027.3755625"},{"key":"e_1_3_2_1_14_1","volume-title":"SpeechAgent: An End-to-End Mobile Infrastructure for Speech Impairment Assistance. arXiv preprint arXiv:2510.20113","author":"Lou Haowei","year":"2025","unstructured":"Haowei Lou, Chengkai Huang, Hye-young Paik, Yongquan Hu, Aaron Quigley, Wen Hu, and Lina Yao. 2025. SpeechAgent: An End-to-End Mobile Infrastructure for Speech Impairment Assistance. arXiv preprint arXiv:2510.20113 (2025)."},{"key":"e_1_3_2_1_15_1","volume-title":"A survey of multimodal retrieval-augmented generation. arXiv preprint arXiv:2504.08748","author":"Mei Lang","year":"2025","unstructured":"Lang Mei, Siyu Mo, Zhihan Yang, and Chong Chen. 2025. A survey of multimodal retrieval-augmented generation. arXiv preprint arXiv:2504.08748 (2025)."},{"key":"e_1_3_2_1_16_1","volume-title":"Srimat T Chakradhar, and Sennur Ulukus.","author":"Mortaheb Matin","year":"2025","unstructured":"Matin Mortaheb, Mohammad A Amir Khojastepour, Srimat T Chakradhar, and Sennur Ulukus. 2025. Re-ranking the context for multimodal retrieval augmented generation. arXiv preprint arXiv:2501.04695 (2025)."},{"key":"e_1_3_2_1_17_1","volume-title":"Junda Wu, Chengkai Huang, Lina Yao, Julian McAuley, and Jingbo Shang.","author":"Wang Chuhan","year":"2026","unstructured":"Chuhan Wang, Xintong Li, Jennifer Yuntong Zhang, Junda Wu, Chengkai Huang, Lina Yao, Julian McAuley, and Jingbo Shang. 2026. SceneAlign: Aligning Multimodal Reasoning to Scene Graphs in Complex Visual Scenes. arXiv preprint arXiv:2601.05600 (2026)."},{"key":"e_1_3_2_1_18_1","volume-title":"MM-R5: MultiModal Reasoning-Enhanced ReRanker via Reinforcement Learning for Document Retrieval. arXiv preprint arXiv:2506.12364","author":"Xu Mingjun","year":"2025","unstructured":"Mingjun Xu, Jinhan Dong, Jue Hou, Zehui Wang, Sihang Li, Zhifeng Gao, Renxin Zhong, and Hengxing Cai. 2025. MM-R5: MultiModal Reasoning-Enhanced ReRanker via Reinforcement Learning for Document Retrieval. arXiv preprint arXiv:2506.12364 (2025)."},{"key":"e_1_3_2_1_19_1","volume-title":"MemWeaver: Weaving Hybrid Memories for Traceable Long-Horizon Agentic Reasoning. arXiv preprint arXiv:2601.18204","author":"Ye Juexiang","year":"2026","unstructured":"Juexiang Ye, Xue Li, Xinyu Yang, Chengkai Huang, Lanshun Nie, Lina Yao, and Dechen Zhan. 2026. MemWeaver: Weaving Hybrid Memories for Traceable Long-Horizon Agentic Reasoning. arXiv preprint arXiv:2601.18204 (2026)."}],"event":{"name":"SIGIR '26: The 49th International ACM SIGIR Conference on Research and Development in Information Retrieval","location":"Melbourne VIC Australia","sponsor":["SIGIR ACM Special Interest Group on Information Retrieval"]},"container-title":["Proceedings of the 49th International ACM SIGIR Conference on Research and Development in Information Retrieval"],"original-title":[],"deposited":{"date-parts":[[2026,7,15]],"date-time":"2026-07-15T17:16:14Z","timestamp":1784135774000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3805712.3809947"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,7,19]]},"references-count":19,"alternative-id":["10.1145\/3805712.3809947","10.1145\/3805712"],"URL":"https:\/\/doi.org\/10.1145\/3805712.3809947","relation":{},"subject":[],"published":{"date-parts":[[2026,7,19]]},"assertion":[{"value":"2026-07-19","order":3,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}