{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,12]],"date-time":"2026-06-12T00:02:10Z","timestamp":1781222530478,"version":"3.54.1"},"publisher-location":"Singapore","reference-count":15,"publisher":"Springer Nature Singapore","isbn-type":[{"value":"9789819698653","type":"print"},{"value":"9789819698660","type":"electronic"}],"license":[{"start":{"date-parts":[[2025,1,1]],"date-time":"2025-01-01T00:00:00Z","timestamp":1735689600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2025,1,1]],"date-time":"2025-01-01T00:00:00Z","timestamp":1735689600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2025]]},"DOI":"10.1007\/978-981-96-9866-0_22","type":"book-chapter","created":{"date-parts":[[2025,7,23]],"date-time":"2025-07-23T09:23:19Z","timestamp":1753262599000},"page":"254-263","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["From Ambiguity to Precision: Multimodal Chain Reasoning with Dynamic Visual Grounding for Fine-Grained Recognition"],"prefix":"10.1007","author":[{"ORCID":"https:\/\/orcid.org\/0000-0001-6959-1089","authenticated-orcid":false,"given":"Jiarui","family":"Xie","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0002-9652-9568","authenticated-orcid":false,"given":"Jie","family":"Yang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2025,7,24]]},"reference":[{"key":"22_CR1","unstructured":"He, H., Li, G., Geng, Z., et al.: Analyzing and boosting the power of fine-grained visual recognition for multi-modal large language models. In: International Conference on Learning Representations (ICLR) (2025)"},{"key":"22_CR2","doi-asserted-by":"crossref","unstructured":"Hendricks, L.A., Akata, Z., Rohrbach, M., et al.: Generating visual explanations. In: European Conference on Computer Vision (ECCV), pp. 1\u201313 (2016)","DOI":"10.1007\/978-3-319-46493-0_1"},{"key":"22_CR3","unstructured":"Dosovitskiy, A., Beyer, L., Kolesnikov, A., et al.: An image is worth 16x16 words: transformers for image recognition at scale. arXiv preprint arXiv:2010.11929 (2020)"},{"key":"22_CR4","doi-asserted-by":"crossref","unstructured":"Fu, J., Zheng, H., Mei, T.: Look closer to see better: recurrent attention convolutional neural network for fine-grained image recognition. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 1\u201313 (2017)","DOI":"10.1109\/CVPR.2017.476"},{"issue":"1","key":"22_CR5","doi-asserted-by":"publisher","first-page":"32","DOI":"10.1007\/s11263-016-0981-7","volume":"123","author":"R Krishna","year":"2017","unstructured":"Krishna, R., Zhu, Y., Groth, O., et al.: Visual genome: connecting language and vision using crowdsourced dense image annotations. Int. J. Comput. Vision 123(1), 32\u201373 (2017)","journal-title":"Int. J. Comput. Vision"},{"key":"22_CR6","doi-asserted-by":"crossref","unstructured":"Xu, D., Zhu, Y., Choy, C.B., et al.: Scene graph generation by iterative message passing. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 1\u201313 (2017)","DOI":"10.1109\/CVPR.2017.330"},{"key":"22_CR7","unstructured":"Kipf, T.N., Welling, M.: Semi-supervised classification with graph convolutional networks. In: International Conference on Learning Representations (ICLR), pp. 1\u201313 (2017)"},{"key":"22_CR8","unstructured":"Veli\u010dkovi\u0107, P., Cucurull, G., Casanova, A., et al.: Graph attention networks. In: International Conference on Learning Representations (ICLR), pp. 1\u201313 (2018)"},{"key":"22_CR9","unstructured":"Wei, J., Wang, X., Schuurmans, D., et al.: Chain-of-thought prompting elicits reasoning in large language models. arXiv preprint arXiv:2201.11903 (2022)"},{"key":"22_CR10","unstructured":"Zhang, Z., Zhang, A., Li, M., et al.: Multimodal chain-of-thought reasoning in language models. Trans. Mach. Learn. Res. (TMLR) (2024)"},{"key":"22_CR11","doi-asserted-by":"crossref","unstructured":"Chen, Z., Zhou, Q., Shen, Y., et al.: Visual chain-of-thought prompting for knowledge-based visual reasoning. In: AAAI Conference on Artificial Intelligence (AAAI), pp. 1\u201313 (2024)","DOI":"10.1609\/aaai.v38i2.27888"},{"key":"22_CR12","unstructured":"Shao, H., Qian, S., Xiao, H., et al.: Visual CoT: Unleashing chain-of-thought reasoning in multi-modal large language models. arXiv preprint arXiv:2403.16999 (2023)"},{"key":"22_CR13","doi-asserted-by":"crossref","unstructured":"Bera, A., Wharton, Z., Liu, Y., et al.: SR-GNN: spatial relation-aware graph neural network for fine-grained image categorization. IEEE Trans. Image Process. (2023)","DOI":"10.1109\/TIP.2022.3205215"},{"key":"22_CR14","unstructured":"Li, J., Li, D., Savarese, S., et al.: BLIP-2: bootstrapping language-image pre-training with frozen image encoders and large language models. arXiv preprint arXiv:2301.12597 (2023)"},{"key":"22_CR15","unstructured":"Liu, H., Li, C., Wu, Q., et al.: Visual instruction tuning. In: Advances in Neural Information Processing Systems (NeurIPS), pp. 1\u201313 (2023)"}],"container-title":["Lecture Notes in Computer Science","Advanced Intelligent Computing Technology and Applications"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-981-96-9866-0_22","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,6,11]],"date-time":"2026-06-11T23:02:42Z","timestamp":1781218962000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-981-96-9866-0_22"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025]]},"ISBN":["9789819698653","9789819698660"],"references-count":15,"URL":"https:\/\/doi.org\/10.1007\/978-981-96-9866-0_22","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2025]]},"assertion":[{"value":"24 July 2025","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"The authors have no competing interests to declare that are relevant to the content of this article.","order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Disclosure of Interests"}},{"value":"ICIC","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"International Conference on Intelligent Computing","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Ningbo","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"China","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2025","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"26 July 2025","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"29 July 2025","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"21","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"icic2025","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"http:\/\/www.ic-icc.cn\/icg\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}