{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,12,9]],"date-time":"2025-12-09T08:29:54Z","timestamp":1765268994739,"version":"3.41.0"},"publisher-location":"New York, NY, USA","reference-count":22,"publisher":"ACM","license":[{"start":{"date-parts":[[2024,11,22]],"date-time":"2024-11-22T00:00:00Z","timestamp":1732233600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.acm.org\/publications\/policies\/copyright_policy#Background"}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2024,11,22]]},"DOI":"10.1145\/3708568.3708578","type":"proceedings-article","created":{"date-parts":[[2025,2,27]],"date-time":"2025-02-27T14:55:47Z","timestamp":1740668147000},"page":"62-68","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":2,"title":["Enhanced Multi-Modal Heart Segmentation Approach based on Swin-Transformer for Small Datasets"],"prefix":"10.1145","author":[{"ORCID":"https:\/\/orcid.org\/0009-0008-8541-8970","authenticated-orcid":false,"given":"Yuqiao","family":"Yuan","sequence":"first","affiliation":[{"name":"Dalian University of Technology, Dalian, China,"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-2856-7290","authenticated-orcid":false,"given":"Yi","family":"Li","sequence":"additional","affiliation":[{"name":"Dalian University of Technology, Dalian, China,"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-9926-5230","authenticated-orcid":false,"given":"Haiyan","family":"Fu","sequence":"additional","affiliation":[{"name":"Dalian University of Technology, Dalian, China,"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-1057-7973","authenticated-orcid":false,"given":"Bo","family":"Wang","sequence":"additional","affiliation":[{"name":"Dalian University of Technology, Dalian, China,"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-9123-140X","authenticated-orcid":false,"given":"Yanqing","family":"Guo","sequence":"additional","affiliation":[{"name":"Dalian University of Technology, Dalian, China,"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"320","published-online":{"date-parts":[[2025,2,27]]},"reference":[{"key":"e_1_3_3_1_1_2","volume-title":"Jeremiah Mwangi, Borjana Pervan, Pablo Perel, Daniel Pi\u00f1eiro, Sean Taylor, and Fausto Pinto. World heart report 2023: Confronting the world's number one killer. Technical report","author":"Cesare Mariachiara Di","year":"2023","unstructured":"Mariachiara Di Cesare, Honor Bixby, Thomas Gaziano, Lisa Hadeed, Chodziwadziwa Kabudula, Diana Vaca McGhie, Jeremiah Mwangi, Borjana Pervan, Pablo Perel, Daniel Pi\u00f1eiro, Sean Taylor, and Fausto Pinto. World heart report 2023: Confronting the world's number one killer. Technical report, Geneva, Switzerland, 2023."},{"key":"e_1_3_3_1_2_2","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-24574-4_28"},{"key":"e_1_3_3_1_3_2","volume-title":"Neural Information Processing Systems","author":"Vaswani Ashish","year":"2017","unstructured":"Ashish Vaswani, Noam M. Shazeer, Niki Parmar, Jakob Uszkoreit, Llion Jones, Aidan N. Gomez, Lukasz Kaiser, and Illia Polosukhin. Attention is all you need. In Neural Information Processing Systems, 2017."},{"key":"e_1_3_3_1_4_2","volume-title":"Magnetic resonance imaging \u2014 Wikipedia, the free encyclopedia","author":"Wikipedia","year":"2024","unstructured":"Wikipedia contributors. Magnetic resonance imaging \u2014 Wikipedia, the free encyclopedia, 2024."},{"key":"e_1_3_3_1_5_2","doi-asserted-by":"crossref","unstructured":"Thorsten M. Buzug. Computed Tomography pages 311\u2013342. Springer Berlin Heidelberg Berlin Heidelberg 2011.","DOI":"10.1007\/978-3-540-74658-4_16"},{"key":"e_1_3_3_1_6_2","doi-asserted-by":"publisher","DOI":"10.18178\/joig.9.1.9-14"},{"key":"e_1_3_3_1_7_2","doi-asserted-by":"publisher","DOI":"10.1118\/1.597891"},{"key":"e_1_3_3_1_8_2","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2015.7298965"},{"key":"e_1_3_3_1_9_2","doi-asserted-by":"crossref","unstructured":"Optic Disc and Optic Cup Segmentation on Retinal Image Based on Multimap Localization and U-Net Convolutional Neural Network \" Journal of Image and Graphics Vol. 10 No. 3 pp. 109-115 September 2022.","DOI":"10.18178\/joig.10.3.109-115"},{"key":"e_1_3_3_1_10_2","volume-title":"Athens, Greece","author":"\u00c7i\u00e7ek \u00d6zg\u00fcn","year":"2016","unstructured":"\u00d6zg\u00fcn \u00c7i\u00e7ek, Ahmed Abdulkadir, Soeren S Lienkamp, Thomas Brox, and Olaf Ronneberger. 3d u-net: learning dense volumetric segmentation from sparse annotation. In Medical Image Computing and Computer-Assisted Intervention\u2013MICCAI 2016: 19th International Conference, Athens, Greece, October 17-21, 2016, Proceedings, Part II 19, pages 424\u2013432. Springer, 2016."},{"key":"e_1_3_3_1_11_2","first-page":"11","volume-title":"Nima Tajbakhsh, and Jianming Liang. Unet++: A nested u-net architecture for medical image segmentation. In Deep Learning in Medical Image Analysis and Multimodal Learning for Clinical Decision Support","author":"Zhou Zongwei","year":"2018","unstructured":"Zongwei Zhou, Md Mahfuzur Rahman Siddiquee, Nima Tajbakhsh, and Jianming Liang. Unet++: A nested u-net architecture for medical image segmentation. In Deep Learning in Medical Image Analysis and Multimodal Learning for Clinical Decision Support, pages 3\u201311, Cham, 2018. Springer International Publishing."},{"key":"e_1_3_3_1_12_2","doi-asserted-by":"publisher","DOI":"10.1109\/3DV.2016.79"},{"key":"e_1_3_3_1_13_2","volume-title":"An image is worth 16x16 words: Transformers for image recognition at scale. ArXiv, abs\/2010.11929","author":"Dosovitskiy Alexey","year":"2020","unstructured":"Alexey Dosovitskiy, Lucas Beyer, Alexander Kolesnikov, Dirk Weissenborn, Xiaohua Zhai, Thomas Unterthiner, Mostafa Dehghani, Matthias Minderer, Georg Heigold, Sylvain Gelly, Jakob Uszkoreit, and Neil Houlsby. An image is worth 16x16 words: Transformers for image recognition at scale. ArXiv, abs\/2010.11929, 2020."},{"key":"e_1_3_3_1_14_2","first-page":"10022","volume-title":"Proceedings of the IEEE\/CVF International Conference on Computer Vision (ICCV)","author":"Liu Ze","year":"2021","unstructured":"Ze Liu, Yutong Lin, Yue Cao, Han Hu, Yixuan Wei, Zheng Zhang, Stephen Lin, and Baining Guo. Swin transformer: Hierarchical vision transformer using shifted windows. In Proceedings of the IEEE\/CVF International Conference on Computer Vision (ICCV), pages 10012\u201310022, October 2021."},{"key":"e_1_3_3_1_15_2","volume-title":"Transunet: Transformers make strong encoders for medical image segmentation. ArXiv, abs\/2102.04306","author":"Chen Jieneng","year":"2021","unstructured":"Jieneng Chen, Yongyi Lu, Qihang Yu, Xiangde Luo, Ehsan Adeli, Yan Wang, Le Lu, Alan L Yuille, and Yuyin Zhou. Transunet: Transformers make strong encoders for medical image segmentation. ArXiv, abs\/2102.04306, 2021."},{"key":"e_1_3_3_1_16_2","doi-asserted-by":"publisher","DOI":"10.1109\/WACV51458.2022.00181"},{"key":"e_1_3_3_1_17_2","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2017.324"},{"key":"e_1_3_3_1_18_2","volume-title":"Dice loss for data-imbalanced nlp tasks. ArXiv, abs\/1911.02855","author":"Li Xiaoya","year":"2019","unstructured":"Xiaoya Li, Xiaofei Sun, Yuxian Meng, Junjun Liang, Fei Wu, and Jiwei Li. Dice loss for data-imbalanced nlp tasks. ArXiv, abs\/1911.02855, 2019."},{"key":"e_1_3_3_1_19_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2020.101851"},{"key":"e_1_3_3_1_20_2","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2019.101537"},{"key":"e_1_3_3_1_21_2","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-32245-8_11"},{"key":"e_1_3_3_1_22_2","doi-asserted-by":"publisher","DOI":"10.1142\/S0218195920500028"}],"event":{"name":"VSIP 2024: 2024 the 6th International Conference on Video, Signal and Image Processing","acronym":"VSIP 2024","location":"Ningbo Hainan China"},"container-title":["Proceedings of the 2024 6th International Conference on Video, Signal and Image Processing"],"original-title":[],"link":[{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3708568.3708578","content-type":"unspecified","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/dl.acm.org\/doi\/pdf\/10.1145\/3708568.3708578","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,6,19]],"date-time":"2025-06-19T01:57:03Z","timestamp":1750298223000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3708568.3708578"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,11,22]]},"references-count":22,"alternative-id":["10.1145\/3708568.3708578","10.1145\/3708568"],"URL":"https:\/\/doi.org\/10.1145\/3708568.3708578","relation":{},"subject":[],"published":{"date-parts":[[2024,11,22]]},"assertion":[{"value":"2025-02-27","order":3,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}