{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,8,1]],"date-time":"2026-08-01T16:30:17Z","timestamp":1785601817116,"version":"3.56.0"},"publisher-location":"Singapore","reference-count":32,"publisher":"Springer Nature Singapore","isbn-type":[{"value":"9789819533510","type":"print"},{"value":"9789819533527","type":"electronic"}],"license":[{"start":{"date-parts":[[2025,11,17]],"date-time":"2025-11-17T00:00:00Z","timestamp":1763337600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2025,11,17]],"date-time":"2025-11-17T00:00:00Z","timestamp":1763337600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2026]]},"DOI":"10.1007\/978-981-95-3352-7_31","type":"book-chapter","created":{"date-parts":[[2025,11,16]],"date-time":"2025-11-16T14:08:53Z","timestamp":1763302133000},"page":"367-379","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":5,"title":["Overview of\u00a0the\u00a0NLPCC 2025 Shared Task 4: Multi-modal, Multilingual, and\u00a0Multi-hop Medical Instructional Video Question Answering Challenge"],"prefix":"10.1007","author":[{"given":"Bin","family":"Li","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Shenxi","family":"Liu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yixuan","family":"Weng","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yue","family":"Du","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yuhang","family":"Tian","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Shoujun","family":"Zhou","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2025,11,17]]},"reference":[{"key":"31_CR1","doi-asserted-by":"crossref","unstructured":"Li, B., et\u00a0al.: Overview of the NLPCC 2023 shared task: chinese medical instructional video question answering. In: CCF International Conference on Natural Language Processing and Chinese Computing, pp. 233\u2013242. Springer (2023)","DOI":"10.1007\/978-3-031-44699-3_21"},{"key":"31_CR2","doi-asserted-by":"crossref","unstructured":"Li, B., Weng, Y., Song, Q., Liang, L., Min, X., Zhou, S.: Overview of the NLPCC 2024 shared task 7: Multi-lingual medical instructional video question answering. In: CCF International Conference on Natural Language Processing and Chinese Computing, pp. 429\u2013439. Springer (2024)","DOI":"10.1007\/978-981-97-9443-0_38"},{"key":"31_CR3","doi-asserted-by":"crossref","unstructured":"Wang, Y., Zhong, J., Kumar, R.: A systematic review of machine learning applications in infectious disease prediction, diagnosis, and outbreak forecasting (2025)","DOI":"10.2139\/ssrn.5324815"},{"key":"31_CR4","doi-asserted-by":"crossref","unstructured":"Lu, S., Liu, Y., Kong, A.W.: TF-icon: diffusion-based training-free cross-domain image composition. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 2294\u20132305 (2023)","DOI":"10.1109\/ICCV51070.2023.00218"},{"key":"31_CR5","doi-asserted-by":"publisher","DOI":"10.1016\/j.neunet.2024.107096","volume":"184","author":"Yu Xinlei","year":"2025","unstructured":"Xinlei, Yu., et al.: Ich-prnet: a cross-modal intracerebral haemorrhage prognostic prediction method using joint-attention interaction mechanism. Neural Netw. 184, 107096 (2025)","journal-title":"Neural Netw."},{"key":"31_CR6","doi-asserted-by":"crossref","unstructured":"Yu, X., et al.: Ich-SCNET: Intracerebral hemorrhage segmentation and prognosis classification network using clip-guided sam mechanism. In: 2024 IEEE International Conference on Bioinformatics and Biomedicine (BIBM), pp. 2795\u20132800. IEEE (2024)","DOI":"10.1109\/BIBM62325.2024.10822098"},{"key":"31_CR7","unstructured":"Ba\u010di\u0107, B., Vasile, C., Feng, C., Ciuc\u0103, M.G.: Towards nation-wide analytical healthcare infrastructures: a privacy-preserving augmented knee rehabilitation case study. arXiv preprint arXiv:2412.20733 (2024)"},{"key":"31_CR8","doi-asserted-by":"crossref","unstructured":"Wen, Z., Li, B.: Learning to unify audio, visual and text for audio-enhanced multilingual visual answer localization. arXiv preprint arXiv:2411.02851 (2024)","DOI":"10.1109\/ICME59968.2025.11209406"},{"key":"31_CR9","volume-title":"and Yunpu Ma","author":"J Bi","year":"2025","unstructured":"Bi, J., et al.: and Yunpu Ma. Self-pruning intrinsic selection method for training-free multimodal data selection, Prism (2025)"},{"key":"31_CR10","unstructured":"Lu, S., Zhou, Z., Lu, J., Zhu, Y., Kong, A.W.: Robust watermarking using generative priors against image editing: from benchmarking to advances. arXiv preprint arXiv:2410.18775 (2024)"},{"key":"31_CR11","doi-asserted-by":"crossref","unstructured":"Li, L., Lu, S., Ren, Y., Kong, A.W.: Set you straight: auto-steering denoising trajectories to sidestep unwanted concepts. arXiv preprint arXiv:2504.12782 (2025)","DOI":"10.1145\/3746027.3754546"},{"key":"31_CR12","doi-asserted-by":"crossref","unstructured":"Xia, F., et al.: Lingyi: medical conversational question answering system based on multi-modal knowledge graphs. arXiv preprint arXiv:2204.09220 (2022)","DOI":"10.18653\/v1\/2022.emnlp-demos.15"},{"key":"31_CR13","doi-asserted-by":"crossref","unstructured":"Bi, J., et al.: Llava steering: cisual instruction tuning with 500x fewer parameters through modality linear representation-steering (2025)","DOI":"10.18653\/v1\/2025.acl-long.739"},{"key":"31_CR14","doi-asserted-by":"crossref","unstructured":"Weng, Y., Li, B.: Visual answer localization with cross-modal mutual knowledge transfer. In: ICASSP 2023-2023 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), pp. 1\u20135. IEEE (2023)","DOI":"10.1109\/ICASSP49357.2023.10095026"},{"key":"31_CR15","doi-asserted-by":"crossref","unstructured":"Zhong, J., Wang, Y.: Enhancing thyroid disease prediction using machine learning: a comparative study of ensemble models and class balancing techniques (2025)","DOI":"10.21203\/rs.3.rs-5994101\/v1"},{"issue":"9","key":"31_CR16","doi-asserted-by":"publisher","first-page":"1476","DOI":"10.3390\/math13091476","volume":"13","author":"S Qiu","year":"2025","unstructured":"Qiu, S., et al.: A generative adversarial network-based investor sentiment indicator: superior predictability for the stock market. Mathematics 13(9), 1476 (2025)","journal-title":"Mathematics"},{"issue":"1","key":"31_CR17","doi-asserted-by":"publisher","first-page":"353","DOI":"10.1109\/JIOT.2023.3285601","volume":"11","author":"P Jing","year":"2024","unstructured":"Jing, P., Cui, K., Zhang, J., Li, Y., Yuting, S.: Multimodal high-order relationship inference network for fashion compatibility modeling in internet of multimedia things. IEEE Internet Things J. 11(1), 353\u2013365 (2024)","journal-title":"IEEE Internet Things J."},{"key":"31_CR18","doi-asserted-by":"crossref","unstructured":"Ke, Z., Zhou, S., Zhou, Y., Chang, C., Zhang, R.: Detection of AI deepfake and fraud in online payments using GAN-based models. arXiv preprint arXiv:2501.07033 (2025)","DOI":"10.1109\/ICAACE65325.2025.11020513"},{"key":"31_CR19","unstructured":"He, Y., et al.: Enhancing intent understanding for ambiguous prompts through human-machine co-adaptation. arXiv preprint arXiv:2501.15167 (2025)"},{"key":"31_CR20","doi-asserted-by":"crossref","unstructured":"Lu, S., Wang, Z., Li, L., Liu, Y., Kong, A.M.: Mace: mass concept erasure in diffusion models. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 6430\u20136440 (2024)","DOI":"10.1109\/CVPR52733.2024.00615"},{"key":"31_CR21","doi-asserted-by":"crossref","unstructured":"Yi, Q., et al.: Score: story coherence and retrieval enhancement for AI narratives. arXiv preprint arXiv:2503.23512 (2025)","DOI":"10.2139\/ssrn.5243040"},{"key":"31_CR22","doi-asserted-by":"crossref","unstructured":"Li, B., Weng, Y., Sun, B., Li, S.: Learning to locate visual answer in video corpus using question. In: ICASSP 2023 - 2023 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), pp.1\u20135 (2023)","DOI":"10.1109\/ICASSP49357.2023.10096391"},{"key":"31_CR23","doi-asserted-by":"crossref","unstructured":"Zhang, H., Zheng, C., He, Y., Zhao, Y., Lai, Y.: Improving multilingual temporal answering grounding in single video via LLM-based translation and OCR enhancement. In: CCF International Conference on Natural Language Processing and Chinese Computing, pp. 145\u2013156. Springer (2024)","DOI":"10.1007\/978-981-97-9443-0_12"},{"key":"31_CR24","doi-asserted-by":"crossref","unstructured":"Zhou, Z., Liu, J., Cheng, S., Luo, H., Gu, Y., Ye, J.: Improving cross-modal visual answer localization in chinese medical instructional video using language prompts. In: CCF International Conference on Natural Language Processing and Chinese Computing, pp. 221\u2013232. Springer (2023)","DOI":"10.1007\/978-3-031-44699-3_20"},{"key":"31_CR25","doi-asserted-by":"crossref","unstructured":"Yu, G., et al.: Mqua: multi-level query-video augmentation for multilingual video corpus retrieval. In: CCF International Conference on Natural Language Processing and Chinese Computing, pp. 353\u2013364. Springer (2024)","DOI":"10.1007\/978-981-97-9443-0_31"},{"key":"31_CR26","doi-asserted-by":"crossref","unstructured":"Lei, N., et al.: A two-stage chinese medical video retrieval framework with LLM. In: CCF International Conference on Natural Language Processing and Chinese Computing, pp. 211\u2013220. Springer (2023)","DOI":"10.1007\/978-3-031-44699-3_19"},{"key":"31_CR27","doi-asserted-by":"crossref","unstructured":"Ma, T., Hu, Y., Jiang, S., Yin, Z., Zang, T.: Multilingual temporal answer grounding in video corpus with enhanced visual-textual integration. In: CCF International Conference on Natural Language Processing and Chinese Computing, pp. 471\u2013483. Springer (2024)","DOI":"10.1007\/978-981-97-9443-0_42"},{"key":"31_CR28","doi-asserted-by":"crossref","unstructured":"Cheng, S., Zhou, Z., Liu, J., Ye, J., Luo, H., Gu, Y.: A unified framework for optimizing video corpus retrieval and temporal answer grounding: fine-grained modality alignment and local-global optimization. In: CCF International Conference on Natural Language Processing and Chinese Computing, pp. 199\u2013210. Springer (2023)","DOI":"10.1007\/978-3-031-44699-3_18"},{"key":"31_CR29","doi-asserted-by":"crossref","unstructured":"Cui, K., et al.: Correlation-aware cross-modal attention network for fashion compatibility modeling in UGC systems. ACM Transactions on Multimedia Computing, Communications and Applications (2024)","DOI":"10.1145\/3698772"},{"key":"31_CR30","unstructured":"Feng, F., Yang, Y., Cer, D., Arivazhagan, N., Wang, W.: Language-agnostic BERT sentence embedding. arXiv preprint arXiv:2007.01852 (2020)"},{"key":"31_CR31","doi-asserted-by":"crossref","unstructured":"Li, B., Weng, Y., Xia, F., Sun, B., Li, S.: Vpai_lab at medvidqa 2022: a two-stage cross-modal fusion method for medical instructional video classification. In: Proceedings of the 21st Workshop on Biomedical Language Processing, pp. 212\u2013219 (2022)","DOI":"10.18653\/v1\/2022.bionlp-1.21"},{"key":"31_CR32","doi-asserted-by":"publisher","first-page":"9120","DOI":"10.1109\/TMM.2023.3246796","volume":"25","author":"P Jing","year":"2023","unstructured":"Jing, P., Cui, K., Guan, W., Nie, L., Yuting, S.: Category-aware multimodal attention network for fashion compatibility modeling. IEEE Trans. Multimedia 25, 9120\u20139131 (2023)","journal-title":"IEEE Trans. Multimedia"}],"container-title":["Lecture Notes in Computer Science","Natural Language Processing and Chinese Computing"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-981-95-3352-7_31","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,8,1]],"date-time":"2026-08-01T04:43:50Z","timestamp":1785559430000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-981-95-3352-7_31"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,11,17]]},"ISBN":["9789819533510","9789819533527"],"references-count":32,"URL":"https:\/\/doi.org\/10.1007\/978-981-95-3352-7_31","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2025,11,17]]},"assertion":[{"value":"17 November 2025","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"NLPCC","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"CCF International Conference on Natural Language Processing and Chinese Computing","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Urumqi","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"China","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2025","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"7 August 2025","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"9 August 2025","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"14","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"nlpcc2025","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"http:\/\/tcci.ccf.org.cn\/conference\/2025\/index.php","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}