{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,23]],"date-time":"2026-06-23T07:51:55Z","timestamp":1782201115417,"version":"3.54.5"},"reference-count":40,"publisher":"Springer Science and Business Media LLC","issue":"8","license":[{"start":{"date-parts":[[2026,6,1]],"date-time":"2026-06-01T00:00:00Z","timestamp":1780272000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2026,6,1]],"date-time":"2026-06-01T00:00:00Z","timestamp":1780272000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"name":"Key Laboratory of Spine and Spinal Cord Injury 461 Repair and Regeneration (Tongji University), Ministry of Education","award":["No.BZ2023002"],"award-info":[{"award-number":["No.BZ2023002"]}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Vis Comput"],"published-print":{"date-parts":[[2026,6]]},"DOI":"10.1007\/s00371-026-04521-y","type":"journal-article","created":{"date-parts":[[2026,6,11]],"date-time":"2026-06-11T15:15:41Z","timestamp":1781190941000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["Efficient multi-granularity medical image segmentation with group-mix attention U-Net"],"prefix":"10.1007","volume":"42","author":[{"given":"Kaiyu","family":"Zhang","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yingdong","family":"Pei","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Fei","family":"Wu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Ling","family":"Yin","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yingqi","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2026,6,11]]},"reference":[{"issue":"1","key":"4521_CR1","doi-asserted-by":"publisher","first-page":"71","DOI":"10.1016\/j.vrih.2023.08.005","volume":"6","author":"M Li","year":"2024","unstructured":"Li, M., et al.: Importance-aware 3d volume visualization for medical content-based image retrieval-a preliminary study. Virtual Reality & Intell. Hardware 6(1), 71\u201381 (2024)","journal-title":"Virtual Reality & Intell. Hardware"},{"key":"4521_CR2","doi-asserted-by":"crossref","unstructured":"Augmented reality-based interactive scheme for robot-assisted percutaneous renal puncture navigation. Computer Animation and Virtual Worlds 36(1), 70009 (2025)","DOI":"10.1002\/cav.70009"},{"key":"4521_CR3","doi-asserted-by":"crossref","unstructured":"Toward fluoroscopy guided robotic needle insertion for radio frequency ablation. Computer Animation and Virtual Worlds 36(3), 70025 (2025)","DOI":"10.1002\/cav.70025"},{"key":"4521_CR4","unstructured":"Dosovitskiy, A., Beyer, L., Kolesnikov, A., Weissenborn, D., Zhai, X., Unterthiner, T., Dehghani, M., Minderer, M., Heigold, G., Gelly, S., Uszkoreit, J., Houlsby, N.: An image is worth 16x16 words: Transformers for image recognition at scale. ArXiv arXiv:2010.11929 (2020)"},{"key":"4521_CR5","doi-asserted-by":"crossref","unstructured":"Ronneberger, O., Fischer, P., Brox, T.: U-net: Convolutional networks for biomedical image segmentation. In: International Conference on Medical Image Computing and Computer-assisted Intervention, pp. 234\u2013241 (2015). Springer","DOI":"10.1007\/978-3-319-24574-4_28"},{"issue":"6","key":"4521_CR6","doi-asserted-by":"publisher","first-page":"1856","DOI":"10.1109\/TMI.2019.2959609","volume":"39","author":"Z Zhou","year":"2019","unstructured":"Zhou, Z., Siddiquee, M.M.R., Tajbakhsh, N., Liang, J.: Unet++: Redesigning skip connections to exploit multiscale features in image segmentation. IEEE Trans. Med. Imaging 39(6), 1856\u20131867 (2019)","journal-title":"IEEE Trans. Med. Imaging"},{"key":"4521_CR7","doi-asserted-by":"crossref","unstructured":"Huang, H., Lin, L., Tong, R., Hu, H., Zhang, Q., Iwamoto, Y., Han, X., Chen, Y., Wu, J.: Unet 3+: A full-scale connected unet for medical image segmentation. In: ICASSP 2020 - 2020 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), 1055\u20131059 (2020)","DOI":"10.1109\/ICASSP40776.2020.9053405"},{"key":"4521_CR8","unstructured":"Oktay, O., Schlemper, J., Folgoc, L.L., Lee, M.J., Heinrich, M.P., Misawa, K., Mori, K., McDonagh, S.G., Hammerla, N.Y., Kainz, B., Glocker, B., Rueckert, D.: Attention u-net: Learning where to look for the pancreas. ArXiv arXiv:1804.03999 (2018)"},{"key":"4521_CR9","doi-asserted-by":"publisher","first-page":"749","DOI":"10.1109\/LGRS.2018.2802944","volume":"15","author":"Z Zhang","year":"2017","unstructured":"Zhang, Z., Liu, Q., Wang, Y.: Road extraction by deep residual u-net. IEEE Geosci. Remote Sens. Lett. 15, 749\u2013753 (2017)","journal-title":"IEEE Geosci. Remote Sens. Lett."},{"key":"4521_CR10","unstructured":"Chen, J., Lu, Y., Yu, Q., Luo, X., Adeli, E., Wang, Y., Lu, L., Yuille, A.L., Zhou, Y.: Transunet: Transformers make strong encoders for medical image segmentation. ArXiv arXiv:2102.04306 (2021)"},{"key":"4521_CR11","unstructured":"Cao, H., Wang, Y., Chen, J., Jiang, D., Zhang, X., Tian, Q., Wang, M.: Swin-unet: Unet-like pure transformer for medical image segmentation. In: ECCV Workshops (2021). https:\/\/api.semanticscholar.org\/CorpusID:234469981"},{"key":"4521_CR12","doi-asserted-by":"crossref","unstructured":"Heidari, M., Kazerouni, A., Soltany, M., Azad, R., Aghdam, E.K., Cohen-Adad, J., Merhof, D.: Hiformer: Hierarchical multi-scale representations using transformers for medical image segmentation. In: Proceedings of the IEEE\/CVF Winter Conference on Applications of Computer Vision, pp. 6202\u20136212 (2023)","DOI":"10.1109\/WACV56688.2023.00614"},{"key":"4521_CR13","unstructured":"Huang, X., Deng, Z., Li, D., Yuan, X.: MISSFormer: An Effective Medical Image Segmentation Transformer (2021). arXiv:2109.07162v1"},{"key":"4521_CR14","doi-asserted-by":"publisher","first-page":"4036","DOI":"10.1109\/TIP.2023.3293771","volume":"32","author":"H-Y Zhou","year":"2023","unstructured":"Zhou, H.-Y., Guo, J., Zhang, Y., Han, X., Yu, L., Wang, L., Yu, Y.: nnformer: Volumetric medical image segmentation via a 3d transformer. IEEE Trans. Image Process. 32, 4036\u20134045 (2023)","journal-title":"IEEE Trans. Image Process."},{"key":"4521_CR15","unstructured":"Ge, C., Ding, X., Tong, Z., Yuan, L., Wang, J., Song, Y., Luo, P.: Advancing vision transformers with group-mix attention. arXiv preprint arXiv:2311.15157 (2023)"},{"key":"4521_CR16","unstructured":"Vaswani, A., Shazeer, N., Parmar, N., Uszkoreit, J., Jones, L., Gomez, A.N., Kaiser, \u0141., Polosukhin, I.: Attention is all you need. Advances in neural information processing systems 30 (2017)"},{"key":"4521_CR17","doi-asserted-by":"crossref","unstructured":"Liu, Z., Lin, Y., Cao, Y., Hu, H., Wei, Y., Zhang, Z., Lin, S., Guo, B.: Swin transformer: Hierarchical vision transformer using shifted windows. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 10012\u201310022 (2021)","DOI":"10.1109\/ICCV48922.2021.00986"},{"issue":"9","key":"4521_CR18","doi-asserted-by":"publisher","first-page":"3377","DOI":"10.1109\/TMI.2024.3398728","volume":"43","author":"A Shaker","year":"2024","unstructured":"Shaker, A., Maaz, M., Rasheed, H., Khan, S., Yang, M.-H., Khan, F.S.: Unetr++: delving into efficient and accurate 3d medical image segmentation. IEEE Trans. Med. Imag. 43(9), 3377\u20133390 (2024)","journal-title":"IEEE Trans. Med. Imag."},{"key":"4521_CR19","doi-asserted-by":"crossref","unstructured":"Yao, C., Hu, M., Li, Q., Zhai, G., Zhang, X.-P.: Transclaw u-net: claw u-net with transformers for medical image segmentation. In: 2022 5th International Conference on Information Communication and Signal Processing (ICICSP), pp. 280\u2013284 (2022). IEEE","DOI":"10.1109\/ICICSP55539.2022.10050624"},{"key":"4521_CR20","doi-asserted-by":"crossref","unstructured":"Long, J., Shelhamer, E., Darrell, T.: Fully convolutional networks for semantic segmentation. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 3431\u20133440 (2015)","DOI":"10.1109\/CVPR.2015.7298965"},{"key":"4521_CR21","doi-asserted-by":"crossref","unstructured":"Milletari, F., Navab, N., Ahmadi, S.-A.: V-net: Fully convolutional neural networks for volumetric medical image segmentation. In: 2016 Fourth International Conference on 3D Vision (3DV), pp. 565\u2013571 (2016). Ieee","DOI":"10.1109\/3DV.2016.79"},{"key":"4521_CR22","doi-asserted-by":"crossref","unstructured":"\u00c7i\u00e7ek, \u00d6., Abdulkadir, A., Lienkamp, S.S., Brox, T., Ronneberger, O.: 3d u-net: learning dense volumetric segmentation from sparse annotation. In: International Conference on Medical Image Computing and Computer-assisted Intervention, pp. 424\u2013432 (2016). Springer","DOI":"10.1007\/978-3-319-46723-8_49"},{"key":"4521_CR23","doi-asserted-by":"crossref","unstructured":"Hatamizadeh, A., Nath, V., Tang, Y., Yang, D., Roth, H.R., Xu, D.: Swin unetr: Swin transformers for semantic segmentation of brain tumors in mri images. In: International MICCAI Brainlesion Workshop, pp. 272\u2013284 (2021). Springer","DOI":"10.1007\/978-3-031-08999-2_22"},{"issue":"9","key":"4521_CR24","doi-asserted-by":"publisher","first-page":"3377","DOI":"10.1109\/TMI.2024.3398728","volume":"43","author":"A Shaker","year":"2024","unstructured":"Shaker, A., Maaz, M., Rasheed, H., Khan, S., Yang, M.-H., Khan, F.S.: Unetr++: delving into efficient and accurate 3d medical image segmentation. IEEE Trans. Med. Imag. 43(9), 3377\u20133390 (2024)","journal-title":"IEEE Trans. Med. Imag."},{"key":"4521_CR25","doi-asserted-by":"crossref","unstructured":"Roy, S., Koehler, G., Ulrich, C., Baumgartner, M., Petersen, J., Isensee, F., Jaeger, P.F., Maier-Hein, K.H.: Mednext: transformer-driven scaling of convnets for medical image segmentation. In: International Conference on Medical Image Computing and Computer-Assisted Intervention, pp. 405\u2013415 (2023). Springer","DOI":"10.1007\/978-3-031-43901-8_39"},{"key":"4521_CR26","doi-asserted-by":"crossref","unstructured":"Wang, H., Cao, P., Wang, J., Zaiane, O.R.: Uctransnet: rethinking the skip connections in u-net from a channel-wise perspective with transformer. In: Proceedings of the AAAI Conference on Artificial Intelligence, vol. 36, pp. 2441\u20132449 (2022)","DOI":"10.1609\/aaai.v36i3.20144"},{"key":"4521_CR27","doi-asserted-by":"crossref","unstructured":"Xu, G., Wu, X., Zhang, X., He, X.: LeViT-UNet: Make Faster Encoders with Transformer for Medical Image Segmentation (2021). arXiv:2107.08623","DOI":"10.2139\/ssrn.4116174"},{"key":"4521_CR28","doi-asserted-by":"crossref","unstructured":"Azad, R., Arimond, R., Aghdam, E.K., Kazerouni, A., Merhof, D.: Dae-former: Dual attention-guided efficient transformer for medical image segmentation. In: International Workshop on Predictive Intelligence in Medicine, pp. 83\u201395 (2023). Springer","DOI":"10.1007\/978-3-031-46005-0_8"},{"key":"4521_CR29","doi-asserted-by":"crossref","unstructured":"Hu, J., Shen, L., Sun, G.: Squeeze-and-excitation networks. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 7132\u20137141 (2018)","DOI":"10.1109\/CVPR.2018.00745"},{"key":"4521_CR30","doi-asserted-by":"crossref","unstructured":"Roy, A.G., Navab, N., Wachinger, C.: Concurrent spatial and channel \u2018squeeze & excitation\u2019in fully convolutional networks. In: International Conference on Medical Image Computing and Computer-assisted Intervention, pp. 421\u2013429 (2018). Springer","DOI":"10.1007\/978-3-030-00928-1_48"},{"key":"4521_CR31","doi-asserted-by":"crossref","unstructured":"Woo, S., Park, J., Lee, J.-Y., Kweon, I.S.: Cbam: Convolutional block attention module. In: Proceedings of the European Conference on Computer Vision (ECCV), pp. 3\u201319 (2018)","DOI":"10.1007\/978-3-030-01234-2_1"},{"key":"4521_CR32","unstructured":"Ma, J., Li, F., Wang, B.: U-mamba: Enhancing long-range dependency for biomedical image segmentation. arXiv preprint arXiv:2401.04722 (2024)"},{"key":"4521_CR33","volume-title":"Vm-unet: Vision mamba unet for medical image segmentation","author":"J Ruan","year":"2024","unstructured":"Ruan, J., Li, J., Xiang, S.: Vm-unet: Vision mamba unet for medical image segmentation. ACM Transactions on Multimedia Computing, Communications and Applications (2024)"},{"issue":"8","key":"4521_CR34","doi-asserted-by":"publisher","first-page":"5855","DOI":"10.1007\/s00371-024-03756-x","volume":"41","author":"F Lastname","year":"2025","unstructured":"Lastname, F.: Cavmamba: convolution-augmented vmamba for medical image segmentation. Vis. Comput. 41(8), 5855\u20135872 (2025)","journal-title":"Vis. Comput."},{"key":"4521_CR35","doi-asserted-by":"crossref","unstructured":"Ecsu-net: an embedded clustering sliced u-net coupled with fusing strategy for efficient intervertebral disc segmentation and classification. IEEE Transactions on Image Processing 31, 880\u2013893 (2021)","DOI":"10.1109\/TIP.2021.3136619"},{"key":"4521_CR36","doi-asserted-by":"crossref","unstructured":"Eapt: efficient attention pyramid transformer for image processing. IEEE Transactions on Multimedia 25, 50\u201361 (2021)","DOI":"10.1109\/TMM.2021.3120873"},{"key":"4521_CR37","first-page":"1","volume":"41","author":"F Lastname","year":"2025","unstructured":"Lastname, F.: Dmtnet: Dual-domain adaptive multi-scale feature fusion network with transformer for small target detection. Vis. Comput. 41, 1\u201317 (2025)","journal-title":"Vis. Comput."},{"issue":"11","key":"4521_CR38","doi-asserted-by":"publisher","first-page":"2514","DOI":"10.1109\/TMI.2018.2837502","volume":"37","author":"O Bernard","year":"2018","unstructured":"Bernard, O., Lalande, A., Zotti, C., Cervenansky, F., Yang, X., Heng, P.-A., Cetin, I., Lekadir, K., Camara, O., Ballester, M.A.G., et al.: Deep learning techniques for automatic mri cardiac multi-structures segmentation and diagnosis: is the problem solved? IEEE Trans. Med. Imag. 37(11), 2514\u20132525 (2018)","journal-title":"IEEE Trans. Med. Imag."},{"key":"4521_CR39","doi-asserted-by":"publisher","DOI":"10.1016\/j.patcog.2025.111378","volume":"162","author":"Z Ren","year":"2025","unstructured":"Ren, Z., Li, Y., Wang, L., Xu, L.: Lite-mixednet: Lightweight and efficient hybrid network for medical image segmentation. Pattern Recogn. 162, 111378 (2025)","journal-title":"Pattern Recogn."},{"key":"4521_CR40","doi-asserted-by":"publisher","DOI":"10.1016\/j.cmpb.2024.108526","volume":"260","author":"Y Chen","year":"2025","unstructured":"Chen, Y., Su, D., Luo, J.: Laplacian-guided hierarchical transformer: A network for medical image segmentation. Comput. Methods Programs Biomed. 260, 108526 (2025)","journal-title":"Comput. Methods Programs Biomed."}],"container-title":["The Visual Computer"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00371-026-04521-y.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s00371-026-04521-y","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00371-026-04521-y.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,6,23]],"date-time":"2026-06-23T07:44:06Z","timestamp":1782200646000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s00371-026-04521-y"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,6]]},"references-count":40,"journal-issue":{"issue":"8","published-print":{"date-parts":[[2026,6]]}},"alternative-id":["4521"],"URL":"https:\/\/doi.org\/10.1007\/s00371-026-04521-y","relation":{},"ISSN":["0178-2789","1432-2315"],"issn-type":[{"value":"0178-2789","type":"print"},{"value":"1432-2315","type":"electronic"}],"subject":[],"published":{"date-parts":[[2026,6]]},"assertion":[{"value":"30 December 2025","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"3 May 2026","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"11 June 2026","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare that they have no known competing financial interests or personal relationships that could have appeared to influence the work reported in this paper.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}},{"value":"The study does not involve any human or animal study.","order":3,"name":"Ethics","group":{"name":"EthicsHeading","label":"Informed consent"}}],"article-number":"333"}}