{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,21]],"date-time":"2026-06-21T05:53:00Z","timestamp":1782021180074,"version":"3.54.5"},"reference-count":43,"publisher":"Springer Science and Business Media LLC","issue":"2","license":[{"start":{"date-parts":[[2026,2,3]],"date-time":"2026-02-03T00:00:00Z","timestamp":1770076800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2026,2,3]],"date-time":"2026-02-03T00:00:00Z","timestamp":1770076800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"name":"The Chongqing Technology Innovation & Application Development Key Project","award":["No.CSTB2022TIAD-KPX0167"],"award-info":[{"award-number":["No.CSTB2022TIAD-KPX0167"]}]},{"name":"Southwest Hospital Cultivation Project of Clinical Innovative Technologies","award":["2025CXJS26"],"award-info":[{"award-number":["2025CXJS26"]}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimedia Systems"],"published-print":{"date-parts":[[2026,4]]},"DOI":"10.1007\/s00530-025-02197-3","type":"journal-article","created":{"date-parts":[[2026,2,3]],"date-time":"2026-02-03T07:45:44Z","timestamp":1770104744000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":1,"title":["GFPP-MAE: gradient-guided frequency reconstruction and position predictions advance MAE for 3D CT image segmentation"],"prefix":"10.1007","volume":"32","author":[{"given":"Yuping","family":"Peng","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xing","family":"Wu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xing","family":"Xiao","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Chengliang","family":"Wang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Hongqian","family":"Wang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2026,2,3]]},"reference":[{"key":"2197_CR1","doi-asserted-by":"crossref","unstructured":"Buzug, T.M.: Computed tomography. Springer Handbook of Medical Technology, pp. 311\u2013342. Springer, Berlin, Heidelberg (2011)","DOI":"10.1007\/978-3-540-74658-4_16"},{"issue":"4","key":"2197_CR2","doi-asserted-by":"publisher","first-page":"489","DOI":"10.1007\/s40846-024-00881-9","volume":"44","author":"T Wang","year":"2024","unstructured":"Wang, T., Tzeng, Y., Hong, J., Liu, H., Wu, K., Fu, H., Lee, Y., Yin, W., Wu, Y.: Deep learning models for aorta segmentation in computed tomography images: A systematic review and meta-analysis. Booktitle Med. Biol. Engineer. 44(4), 489\u2013498 (2024)","journal-title":"Booktitle Med. Biol. Engineer."},{"key":"2197_CR3","doi-asserted-by":"publisher","DOI":"10.1016\/j.compbiomed.2023.107321","volume":"164","author":"L Zhi","year":"2023","unstructured":"Zhi, L., Jiang, W., Zhang, S., Zhou, T.: Deep neural network pulmonary nodule segmentation methods for ct images: Literature review and experimental comparisons. Comput. Biol. Med. 164, 107321 (2023)","journal-title":"Comput. Biol. Med."},{"issue":"5","key":"2197_CR4","doi-asserted-by":"publisher","first-page":"3151","DOI":"10.1007\/s11831-024-10067-w","volume":"31","author":"VK Kanaujia","year":"2024","unstructured":"Kanaujia, V.K., Kumar, A., Yadav, S.P.: Advancements in automatic kidney segmentation using deep learning frameworks and volumetric segmentation techniques for ct imaging: A review. Archives of Computational Methods in Engineering 31(5), 3151\u20133169 (2024)","journal-title":"Archives of Computational Methods in Engineering"},{"key":"2197_CR5","doi-asserted-by":"publisher","first-page":"9052","DOI":"10.1109\/TPAMI.2024.3415112","volume":"46","author":"J Gui","year":"2024","unstructured":"Gui, J., Chen, T., Zhang, J., Cao, Q., Sun, Z., Luo, H., Tao, D.: A survey on self-supervised learning: Algorithms, applications, and future trends. IEEE Trans. Pattern Anal. Mach. Intell. 46, 9052\u20139071 (2024)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"2197_CR6","doi-asserted-by":"crossref","unstructured":"He, K., Chen, X., Xie, S., Li, Y., Doll\u00e1r, P., Girshick, R.: Masked autoencoders are scalable vision learners. In: Conference on computer vision and pattern recognition, pp. 16000\u201316009 (2022)","DOI":"10.1109\/CVPR52688.2022.01553"},{"key":"2197_CR7","unstructured":"Xie, J., Li, W., Zhan, X., Liu, Z., Ong, Y.-S., Loy, C.C.: Masked frequency modeling for self-supervised visual pre-training. In: International conference on learning representations (2023)"},{"key":"2197_CR8","doi-asserted-by":"crossref","unstructured":"Wang, W., Wang, J., Chen, C., Jiao, J., Cai, Y., Song, S., Li, J.: Fremim: Fourier transform meets masked image modeling for medical image segmentation. In: Winter conference on applications of computer vision, pp. 7860\u20137870 (2024)","DOI":"10.1109\/WACV57701.2024.00768"},{"key":"2197_CR9","first-page":"46134","volume":"36","author":"H Wang","year":"2023","unstructured":"Wang, H., Fan, J., Wang, Y., Song, K., Wang, T., Zhang, Z.: Droppos: Pre-training vision transformers by reconstructing dropped positions. Adv. Neural. Inf. Process. Syst. 36, 46134\u201346151 (2023)","journal-title":"Adv. Neural. Inf. Process. Syst."},{"key":"2197_CR10","doi-asserted-by":"publisher","first-page":"14290","DOI":"10.52202\/068431-1039","volume":"35","author":"G Li","year":"2022","unstructured":"Li, G., Zheng, H., Liu, D., Wang, C., Su, B., Zheng, C.: Semmae: Semantic-guided masking for learning masked autoencoders. Adv. Neural. Inf. Process. Syst. 35, 14290\u201314302 (2022)","journal-title":"Adv. Neural. Inf. Process. Syst."},{"key":"2197_CR11","doi-asserted-by":"crossref","unstructured":"Chen, H., Zhang, W., Wang, Y., Yang, X.: Improving masked autoencoders by learning where to mask. In: Chinese conference on pattern recognition and computer vision, pp. 377\u2013390 (2023). Springer","DOI":"10.1007\/978-981-99-8543-2_31"},{"key":"2197_CR12","doi-asserted-by":"crossref","unstructured":"\u00c7i\u00e7ek, \u00d6., Abdulkadir, A., Lienkamp, S.S., Brox, T., Ronneberger, O.: 3d u-net: learning dense volumetric segmentation from sparse annotation. In: International conference on medical image computing and computer-assisted intervention, pp. 424\u2013432 (2016). Springer","DOI":"10.1007\/978-3-319-46723-8_49"},{"key":"2197_CR13","doi-asserted-by":"crossref","unstructured":"Milletari, F., Navab, N., Ahmadi, S.-A.: V-net: Fully convolutional neural networks for volumetric medical image segmentation. In: International conference on 3D vision, pp. 565\u2013571 (2016). IEEE","DOI":"10.1109\/3DV.2016.79"},{"key":"2197_CR14","doi-asserted-by":"crossref","unstructured":"Hatamizadeh, A., Tang, Y., Nath, V., Yang, D., Myronenko, A., Landman, B., Roth, H.R., Xu, D.: Unetr: Transformers for 3d medical image segmentation. In: Winter conference on applications of computer vision, pp. 574\u2013584 (2022)","DOI":"10.1109\/WACV51458.2022.00181"},{"key":"2197_CR15","doi-asserted-by":"crossref","unstructured":"Hatamizadeh, A., Nath, V., Tang, Y., Yang, D., Roth, H.R., Xu, D.: Swin unetr: Swin transformers for semantic segmentation of brain tumors in mri images. In: International miccai brainlesion workshop, pp. 272\u2013284 (2021). Springer","DOI":"10.1007\/978-3-031-08999-2_22"},{"key":"2197_CR16","doi-asserted-by":"publisher","first-page":"3377","DOI":"10.1109\/TMI.2024.3398728","volume":"43","author":"AM Shaker","year":"2024","unstructured":"Shaker, A.M., Maaz, M., Rasheed, H., Khan, S., Yang, M., Khan, F.S.: Unetr++: delving into efficient and accurate 3d medical image segmentation. IEEE Trans. Med. Imaging 43, 3377\u20133390 (2024)","journal-title":"IEEE Trans. Med. Imaging"},{"key":"2197_CR17","doi-asserted-by":"crossref","unstructured":"Noroozi, M., Favaro, P.: Unsupervised learning of visual representations by solving jigsaw puzzles. In: European conference on computer vision, pp. 69\u201384 (2016). Springer","DOI":"10.1007\/978-3-319-46466-4_5"},{"key":"2197_CR18","unstructured":"Gidaris, S., Singh, P., Komodakis, N.: Unsupervised representation learning by predicting image rotations. In: International conference on learning representations (2018)"},{"key":"2197_CR19","doi-asserted-by":"crossref","unstructured":"Zhang, R., Isola, P., Efros, A.A.: Colorful image colorization. In: European conference on computer vision, pp. 649\u2013666 (2016). Springer","DOI":"10.1007\/978-3-319-46487-9_40"},{"key":"2197_CR20","doi-asserted-by":"crossref","unstructured":"Pathak, D., Krahenbuhl, P., Donahue, J., Darrell, T., Efros, A.A.: Context encoders: Feature learning by inpainting. In: Conference on computer vision and pattern recognition, pp. 2536\u20132544 (2016)","DOI":"10.1109\/CVPR.2016.278"},{"key":"2197_CR21","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2020.101840","volume":"67","author":"Z Zhou","year":"2021","unstructured":"Zhou, Z., Sodha, V., Pang, J., Gotway, M.B., Liang, J.: Models genesis. Med. Image Anal. 67, 101840 (2021)","journal-title":"Med. Image Anal."},{"key":"2197_CR22","doi-asserted-by":"crossref","unstructured":"Tao, X., Li, Y., Zhou, W., Ma, K., Zheng, Y.: Revisiting rubik\u2019s cube: self-supervised learning with volume-wise transformation for 3d medical image segmentation. In: International conference on medical image computing and computer-assisted intervention, pp. 238\u2013248 (2020). Springer","DOI":"10.1007\/978-3-030-59719-1_24"},{"key":"2197_CR23","doi-asserted-by":"crossref","unstructured":"Tang, Y., Yang, D., Li, W., Roth, H.R., Landman, B., Xu, D., Nath, V., Hatamizadeh, A.: Self-supervised pre-training of swin transformers for 3d medical image analysis. In: Conference on computer vision and pattern recognition, pp. 20730\u201320740 (2022)","DOI":"10.1109\/CVPR52688.2022.02007"},{"key":"2197_CR24","doi-asserted-by":"crossref","unstructured":"Wang, Y., Li, Z., Mei, J., Wei, Z., Liu, L., Wang, C., Sang, S., Yuille, A.L., Xie, C., Zhou, Y.: Swinmm: masked multi-view with swin transformers for 3d medical image segmentation. In: International conference on medical image computing and computer-assisted intervention, pp. 486\u2013496 (2023). Springer","DOI":"10.1007\/978-3-031-43898-1_47"},{"key":"2197_CR25","unstructured":"Chen, T., Kornblith, S., Norouzi, M., Hinton, G.: A simple framework for contrastive learning of visual representations. In: International conference on machine learning, pp. 1597\u20131607 (2020). PMLR"},{"key":"2197_CR26","doi-asserted-by":"crossref","unstructured":"He, K., Fan, H., Wu, Y., Xie, S., Girshick, R.: Momentum contrast for unsupervised visual representation learning. In: Conference on computer vision and pattern recognition, pp. 9729\u20139738 (2020)","DOI":"10.1109\/CVPR42600.2020.00975"},{"key":"2197_CR27","first-page":"21271","volume":"33","author":"J Grill","year":"2020","unstructured":"Grill, J., Strub, F., Altch\u00e9, F., Tallec, C., Richemond, P., Buchatskaya, E., Doersch, C., Avila Pires, B., Guo, Z., Gheshlaghi Azar, M., et al.: Bootstrap your own latent-a new approach to self-supervised learning. Adv. Neural. Inf. Process. Syst. 33, 21271\u201321284 (2020)","journal-title":"Adv. Neural. Inf. Process. Syst."},{"key":"2197_CR28","doi-asserted-by":"crossref","unstructured":"Ye, Y., Zhang, J., Chen, Z., Xia, Y.: Desd: Self-supervised learning with deep self-distillation for 3d medical image segmentation. In: International conference on medical image computing and computer-assisted intervention, pp. 545\u2013555 (2022). Springer","DOI":"10.1007\/978-3-031-16440-8_52"},{"key":"2197_CR29","doi-asserted-by":"crossref","unstructured":"Zhou, H., Lu, C., Yang, S., Han, X., Yu, Y.: Preservational learning improves self-supervised medical image models by reconstructing diverse contexts. In: International conference on computer vision, pp. 3499\u20133509 (2021)","DOI":"10.1109\/ICCV48922.2021.00348"},{"issue":"7","key":"2197_CR30","doi-asserted-by":"crossref","first-page":"8020","DOI":"10.1109\/TPAMI.2023.3236459","volume":"45","author":"H Zhou","year":"2023","unstructured":"Zhou, H., Lu, C., Chen, C., Yang, S., Yu, Y.: A unified visual information preservation framework for self-supervised pre-training in medical image analysis. IEEE Trans. Pattern Anal. Mach. Intell. 45(7), 8020\u20138035 (2023)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"2197_CR31","doi-asserted-by":"crossref","unstructured":"Wu, L., Zhuang, J., Chen, H.: Voco: A simple-yet-effective volume contrastive learning framework for 3d medical image analysis. In: Conference on computer vision and pattern recognition, pp. 22873\u201322882 (2024)","DOI":"10.1109\/CVPR52733.2024.02158"},{"key":"2197_CR32","doi-asserted-by":"crossref","unstructured":"Chen, Z., Agarwal, D., Aggarwal, K., Safta, W., Balan, M.M., Brown, K.: Masked image modeling advances 3d medical image analysis. In: Winter conference on applications of computer vision, pp. 1970\u20131980 (2023)","DOI":"10.1109\/WACV56688.2023.00201"},{"key":"2197_CR33","doi-asserted-by":"crossref","unstructured":"Zhou, L., Liu, H., Bae, J., He, J., Samaras, D., Prasanna, P.: Self pre-training with masked autoencoders for medical image classification and segmentation. In: IEEE international symposium on biomedical imaging, pp. 1\u20136 (2023). IEEE","DOI":"10.1109\/ISBI53787.2023.10230477"},{"key":"2197_CR34","doi-asserted-by":"crossref","unstructured":"Zhuang, J., Luo, L., Wang, Q., Wu, M., Luo, L., Chen, H.: Advancing volumetric medical image segmentation via global-local masked autoencoders. IEEE Transactions on Medical Imaging (2025)","DOI":"10.1109\/TMI.2025.3569782"},{"key":"2197_CR35","unstructured":"Valanarasu, J.M.J., Tang, Y., Yang, D., Xu, Z., Zhao, C., Li, W., Patel, V.M., Landman, B.A., Xu, D., He, Y., et al.: Disruptive autoencoders: Leveraging low-level features for 3d medical image pre-training. In: The international conference on medical imaging with deep learning, pp. 1553\u20131570 (2024). PMLR"},{"issue":"4","key":"2197_CR36","doi-asserted-by":"publisher","first-page":"2115","DOI":"10.1109\/JBHI.2024.3360239","volume":"28","author":"Z Xing","year":"2024","unstructured":"Xing, Z., Zhu, L., Yu, L., Xing, Z., Wan, L.: Hybrid masked image modeling for 3d medical image segmentation. IEEE J. Biomed. Health Inform. 28(4), 2115\u20132125 (2024)","journal-title":"IEEE J. Biomed. Health Inform."},{"key":"2197_CR37","doi-asserted-by":"crossref","unstructured":"Zhuang, J., Wu, L., Wang, Q., Fei, P., Vardhanabhuti, V., Luo, L., Chen, H.: Mim: Mask in mask self-supervised pre-training for 3d medical image analysis. IEEE Transactions on Medical Imaging (2025)","DOI":"10.1109\/TMI.2025.3564382"},{"key":"2197_CR38","unstructured":"Dosovitskiy, A., Beyer, L., Kolesnikov, A., Weissenborn, D., Zhai, X., Unterthiner, T., Dehghani, M., Minderer, M., Heigold, G., Gelly, S., et al.: An image is worth 16x16 words: Transformers for image recognition at scale. In: International conference on learning representations (2020)"},{"issue":"1","key":"2197_CR39","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1016\/j.media.2015.06.009","volume":"26","author":"T Okada","year":"2015","unstructured":"Okada, T., Linguraru, M.G., Hori, M., Summers, R.M., Tomiyama, N., Sato, Y.: Abdominal multi-organ segmentation from ct images using conditional shape-location and unsupervised intensity priors. Med. Image Anal. 26(1), 1\u201318 (2015)","journal-title":"Med. Image Anal."},{"key":"2197_CR40","unstructured":"Landman, B., Xu, Z., Igelsias, J., Styner, M., Langerak, T., Klein, A.: Miccai multi-atlas labeling beyond the cranial vault\u2013workshop and challenge. Proc. MICCAI Multi-Atlas Labeling Beyond Cranial Vault\u2013Workshop Challenge, vol. 5, p. 12 (2015). Munich, Germany"},{"issue":"1","key":"2197_CR41","doi-asserted-by":"publisher","first-page":"4128","DOI":"10.1038\/s41467-022-30695-9","volume":"13","author":"M Antonelli","year":"2022","unstructured":"Antonelli, M., Reinke, A., Bakas, S., Farahani, K., Kopp-Schneider, A., Landman, B.A., Litjens, G., Menze, B., Ronneberger, O., Summers, R.M., et al.: The medical segmentation decathlon. Nat. Commun. 13(1), 4128 (2022)","journal-title":"Nat. Commun."},{"key":"2197_CR42","first-page":"36722","volume":"35","author":"Y Ji","year":"2022","unstructured":"Ji, Y., Bai, H., Ge, C., Yang, J., Zhu, Y., Zhang, R., Li, Z., Zhanng, L., Ma, W., Wan, X., et al.: Amos: A large-scale abdominal multi-organ benchmark for versatile medical image segmentation. Adv. Neural. Inf. Process. Syst. 35, 36722\u201336732 (2022)","journal-title":"Adv. Neural. Inf. Process. Syst."},{"key":"2197_CR43","doi-asserted-by":"publisher","DOI":"10.1016\/j.bspc.2023.105702","volume":"89","author":"L Zhang","year":"2024","unstructured":"Zhang, L., Zuo, Y., Jia, Y., Li, D., Zeng, R., Li, D., Chen, J., Wang, W.: Ds-former: A dual-stream encoding-based transformer for 3d medical image segmentation. Biomed. Signal Process. Control 89, 105702 (2024)","journal-title":"Biomed. Signal Process. Control"}],"container-title":["Multimedia Systems"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00530-025-02197-3.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s00530-025-02197-3","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00530-025-02197-3.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,4,2]],"date-time":"2026-04-02T11:36:59Z","timestamp":1775129819000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s00530-025-02197-3"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,2,3]]},"references-count":43,"journal-issue":{"issue":"2","published-print":{"date-parts":[[2026,4]]}},"alternative-id":["2197"],"URL":"https:\/\/doi.org\/10.1007\/s00530-025-02197-3","relation":{"has-preprint":[{"id-type":"doi","id":"10.21203\/rs.3.rs-7711032\/v1","asserted-by":"object"}]},"ISSN":["0942-4962","1432-1882"],"issn-type":[{"value":"0942-4962","type":"print"},{"value":"1432-1882","type":"electronic"}],"subject":[],"published":{"date-parts":[[2026,2,3]]},"assertion":[{"value":"25 September 2025","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"26 December 2025","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"3 February 2026","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"This work is supported by The Chongqing Technology Innovation & Application Development Key Project (No.CSTB2022TIAD-KPX0167) and Southwest Hospital Cultivation Project of Clinical Innovative Technologies(2025CXJS26). 20","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}}],"article-number":"133"}}