{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,4,22]],"date-time":"2026-04-22T18:30:32Z","timestamp":1776882632460,"version":"3.51.2"},"reference-count":44,"publisher":"Springer Science and Business Media LLC","issue":"4","license":[{"start":{"date-parts":[[2023,7,8]],"date-time":"2023-07-08T00:00:00Z","timestamp":1688774400000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2023,7,8]],"date-time":"2023-07-08T00:00:00Z","timestamp":1688774400000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["72071116"],"award-info":[{"award-number":["72071116"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100007928","name":"Ningbo Municipal Bureau of Science and Technolog","doi-asserted-by":"publisher","award":["2019B10026"],"award-info":[{"award-number":["2019B10026"]}],"id":[{"id":"10.13039\/501100007928","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Vis Comput"],"published-print":{"date-parts":[[2024,4]]},"DOI":"10.1007\/s00371-023-02930-x","type":"journal-article","created":{"date-parts":[[2023,7,8]],"date-time":"2023-07-08T18:01:58Z","timestamp":1688839318000},"page":"2457-2470","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":4,"title":["Data augmentation by morphological mixup for solving Raven\u2019s progressive matrices"],"prefix":"10.1007","volume":"40","author":[{"given":"Wentao","family":"He","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-4619-6590","authenticated-orcid":false,"given":"Jianfeng","family":"Ren","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Ruibin","family":"Bai","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2023,7,8]]},"reference":[{"key":"2930_CR1","first-page":"1","volume":"39","author":"DS Ametefe","year":"2022","unstructured":"Ametefe, D.S., Sarnin, S.S., Ali, D.M., Muhammad, Z.Z.: Fingerprint pattern classification using deep transfer learning and data augmentation. Vis. Comput. 39, 1\u201314 (2022)","journal-title":"Vis. Comput."},{"key":"2930_CR2","unstructured":"Amizadeh, S., Palangi, H., Polozov, A., Huang, Y., Koishida, K.: Neuro-symbolic visual reasoning: Disentangling \u201cVisual\u201d from \u201cReasoning\u201d. In: Proc. 37th Int. Conf. Mach. Learn. vol.\u00a0119, pp. 279\u2013290 (2020)"},{"key":"2930_CR3","doi-asserted-by":"crossref","unstructured":"Antol, S., Agrawal, A., Lu, J., Mitchell, M., Batra, D., Lawrence\u00a0Zitnick, C., Parikh, D.: VQA: Visual question answering. In: Proc. IEEE Int. Conf. Comput. Vis. pp. 2425\u20132433 (2015)","DOI":"10.1109\/ICCV.2015.279"},{"issue":"12","key":"2930_CR4","doi-asserted-by":"publisher","first-page":"2481","DOI":"10.1109\/TPAMI.2016.2644615","volume":"39","author":"V Badrinarayanan","year":"2017","unstructured":"Badrinarayanan, V., Kendall, A., Cipolla, R.: SegNet: a deep convolutional encoder-decoder architecture for image segmentation. IEEE Trans. Pattern Anal. Mach. Intell. 39(12), 2481\u20132495 (2017)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"2930_CR5","doi-asserted-by":"crossref","unstructured":"Ding, R., Ren, J., Yu, H., Li, J.: Dynamic texture recognition using PDV hashing and dictionary learning on multi-scale volume local binary pattern. In: Proc. IEEE Int. Conf. Acoustics, Speech Signal Process. pp. 1840\u20131844 (2022)","DOI":"10.1109\/ICASSP43922.2022.9747106"},{"issue":"6","key":"2930_CR6","doi-asserted-by":"publisher","first-page":"2014","DOI":"10.1109\/TPAMI.2019.2961896","volume":"43","author":"N Dvornik","year":"2021","unstructured":"Dvornik, N., Mairal, J., Schmid, C.: On the importance of visual context for data augmentation in scene understanding. IEEE Trans. Pattern Anal. Mach. Intell. 43(6), 2014\u20132028 (2021)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"6","key":"2930_CR7","first-page":"189","volume":"6","author":"M Ebadi","year":"2021","unstructured":"Ebadi, M., Ebrahimi, A.: Video data compression by progressive iterative approximation. Int. J. Interact. Multimed. Artif. Intell. 6(6), 189\u2013195 (2021)","journal-title":"Int. J. Interact. Multimed. Artif. Intell."},{"key":"2930_CR8","doi-asserted-by":"crossref","unstructured":"Guo, H., Mao, Y., Zhang, R.: Mixup as locally linear out-of-manifold regularization. In: Proc. 33rd AAAI Conf. Artif. Intell. vol.\u00a033, pp. 3714\u20133722 (2019)","DOI":"10.1609\/aaai.v33i01.33013714"},{"issue":"1","key":"2930_CR9","doi-asserted-by":"publisher","first-page":"119","DOI":"10.1007\/s00371-019-01786-4","volume":"37","author":"S Hashemi Hosseinabad","year":"2021","unstructured":"Hashemi Hosseinabad, S., Safayani, M., Mirzaei, A.: Multiple answers to a question: a new approach for visual question answering. Vis. Comput. 37(1), 119\u2013131 (2021)","journal-title":"Vis. Comput."},{"key":"2930_CR10","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., Sun, J.: Deep residual learning for image recognition. In: Proc. IEEE Conf. Comput. Vis. Pattern Recognit. pp. 770\u2013778 (2016)","DOI":"10.1109\/CVPR.2016.90"},{"key":"2930_CR11","unstructured":"He, W., Ren, J., Bai, R., Jiang, X.: Two-stage rule-induction visual reasoning on RPMs with an application to video prediction. arXiv preprint arXiv:2111.12301 (2021)"},{"key":"2930_CR12","doi-asserted-by":"crossref","unstructured":"He, W., Zhang, J., Ren, J., Bai, R., Jiang, X.: Hierarchical Con\u2013ViT with attention-based relational reasoner for visual analogical reasoning. In: Proc. 37th AAAI Conf. Artif. Intell. vol. 37, pp. 22\u201330 (2023)","DOI":"10.1609\/aaai.v37i1.25072"},{"key":"2930_CR13","doi-asserted-by":"crossref","unstructured":"Hu, S., Ma, Y., Liu, X., Wei, Y., Bai, S.: Stratified rule-aware network for abstract visual reasoning. In: Proc. 35th AAAI Conf. Artif. Intell. 35(2), 1567\u20131574 (2021)","DOI":"10.1609\/aaai.v35i2.16248"},{"key":"2930_CR14","unstructured":"Inoue, H.: Data augmentation by pairing samples for images classification. arXiv preprint arXiv:1801.02929 (2018)"},{"issue":"2","key":"2930_CR15","doi-asserted-by":"publisher","first-page":"509","DOI":"10.1007\/s00371-020-02031-z","volume":"38","author":"MJ Khan","year":"2022","unstructured":"Khan, M.J., Khan, M.J., Siddiqui, A.M., Khurshid, K.: An automated and efficient convolutional architecture for disguise-invariant face recognition using noise-based data augmentation and deep transfer learning. Vis. Comput. 38(2), 509\u2013523 (2022)","journal-title":"Vis. Comput."},{"key":"2930_CR16","doi-asserted-by":"crossref","unstructured":"Kong, W., Ye, S., Yao, C., Ren, J.: Confidence-based event-centric online video question answering on a newly constructed ATBS dataset. In: Proc. IEEE Int. Conf. Acoustics, Speech Signal Process. (2023)","DOI":"10.1109\/ICASSP49357.2023.10095044"},{"key":"2930_CR17","first-page":"1097","volume":"25","author":"A Krizhevsky","year":"2012","unstructured":"Krizhevsky, A., Sutskever, I., Hinton, G.E.: Imagenet classification with deep convolutional neural networks. Proc. NeurIPS 25, 1097\u20131105 (2012)","journal-title":"Proc. NeurIPS"},{"key":"2930_CR18","doi-asserted-by":"publisher","first-page":"58774","DOI":"10.1109\/ACCESS.2018.2872698","volume":"6","author":"D Liang","year":"2018","unstructured":"Liang, D., Yang, F., Zhang, T., Yang, P.: Understanding mixup training methods. IEEE. Access 6, 58774\u201358783 (2018)","journal-title":"Access"},{"key":"2930_CR19","doi-asserted-by":"publisher","first-page":"123","DOI":"10.1016\/j.neucom.2020.02.094","volume":"401","author":"S Liu","year":"2020","unstructured":"Liu, S., Guo, H., Hu, J.G., Zhao, X., Zhao, C., Wang, T., Zhu, Y., Wang, J., Tang, M.: A novel data augmentation scheme for pedestrian detection with attribute preserving GAN. Neurocomputing 401, 123\u2013132 (2020)","journal-title":"Neurocomputing"},{"issue":"3","key":"2930_CR20","doi-asserted-by":"publisher","first-page":"445","DOI":"10.1007\/s00371-018-1566-y","volume":"35","author":"X Liu","year":"2019","unstructured":"Liu, X., Xu, Q., Wang, N.: A survey on deep neural network-based image captioning. Vis. Comput. 35(3), 445\u2013470 (2019)","journal-title":"Vis. Comput."},{"issue":"7","key":"2930_CR21","doi-asserted-by":"publisher","first-page":"3050","DOI":"10.1109\/TNNLS.2020.3049011","volume":"33","author":"Z Mai","year":"2022","unstructured":"Mai, Z., Hu, G., Chen, D., Shen, F., Shen, H.T.: Metamixup: Learning adaptive interpolation policy of mixup with metalearning. IEEE Trans. Neural Netw. Learn. Syst. 33(7), 3050\u20133064 (2022)","journal-title":"IEEE Trans. Neural Netw. Learn. Syst."},{"issue":"6","key":"2930_CR22","doi-asserted-by":"publisher","first-page":"586","DOI":"10.1109\/34.24793","volume":"11","author":"P Maragos","year":"1989","unstructured":"Maragos, P.: A representation theory for morphological image and signal processing. IEEE Trans. Pattern Anal. Mach. Intell. 11(6), 586\u2013599 (1989)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"15","key":"2930_CR23","doi-asserted-by":"publisher","first-page":"6907","DOI":"10.1002\/jsfa.12052","volume":"102","author":"K Nazari","year":"2022","unstructured":"Nazari, K., Ebadi, M.J., Berahmand, K.: Diagnosis of alternaria disease and leafminer pest on tomato leaves using image processing techniques. J. Sci. Food Agric. 102(15), 6907\u20136920 (2022)","journal-title":"J. Sci. Food Agric."},{"key":"2930_CR24","doi-asserted-by":"publisher","first-page":"107709","DOI":"10.1016\/j.patcog.2020.107709","volume":"111","author":"J Ren","year":"2021","unstructured":"Ren, J., Jiang, X.: A three-step classification framework to handle complex data distribution for radar UAV detection. Pattern Recognit. 111, 107709 (2021)","journal-title":"Pattern Recognit."},{"key":"2930_CR25","unstructured":"Santoro, A., Hill, F., Barrett, D., Morcos, A., Lillicrap, T.: Measuring abstract reasoning in neural networks. In: Proc. 35th Int. Conf. Mach. Learn. pp. 4477\u20134486 (2018)"},{"issue":"1","key":"2930_CR26","doi-asserted-by":"publisher","first-page":"60","DOI":"10.1186\/s40537-019-0197-0","volume":"6","author":"C Shorten","year":"2019","unstructured":"Shorten, C., Khoshgoftaar, T.M.: A survey on image data augmentation for deep learning. J. Big Data 6(1), 60 (2019)","journal-title":"J. Big Data"},{"key":"2930_CR27","doi-asserted-by":"crossref","unstructured":"Song, X., Jin, J., Yao, C., Wang, S., Ren, J., Bai, R.: Siamese-discriminant deep reinforcement learning for solving jigsaw puzzles with large eroded gaps. In: Proc. 37th AAAI Conf. Artif. Intell. vol. 37, 2303\u20132311 (2023)","DOI":"10.1609\/aaai.v37i2.25325"},{"key":"2930_CR28","doi-asserted-by":"crossref","unstructured":"Song, X., Yang, X., Ren, J., Bai, R., Jiang, X.: Solving jigsaw puzzle of large eroded gaps using puzzlet discriminant network. In: Proc. IEEE Int. Conf. Acoustics, Speech Signal Process. (2023)","DOI":"10.1109\/ICASSP49357.2023.10096300"},{"key":"2930_CR29","doi-asserted-by":"crossref","unstructured":"Summers, C., Dinneen, M.J.: Improved mixed-example data augmentation. In: Proc. IEEE Winter Conf. Appl. Comput. Vis. pp. 1262\u20131270 (2019)","DOI":"10.1109\/WACV.2019.00139"},{"issue":"9","key":"2930_CR30","doi-asserted-by":"publisher","first-page":"2917","DOI":"10.1109\/TCSVT.2019.2935128","volume":"30","author":"R Takahashi","year":"2019","unstructured":"Takahashi, R., Matsubara, T., Uehara, K.: Data augmentation using random image cropping and patching for deep CNNs. IEEE Trans. Circuits Syst. Video Technol. 30(9), 2917\u20132931 (2019)","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"2930_CR31","unstructured":"Verma, V., Lamb, A., Beckham, C., Najafi, A., Mitliagkas, I., Lopez-Paz, D., Bengio, Y.: Manifold mixup: Better representations by interpolating hidden states. In: Proc. 36th Int. Conf. Mach. Learn. pp. 6438\u20136447 (2019)"},{"key":"2930_CR32","doi-asserted-by":"publisher","first-page":"120094","DOI":"10.1016\/j.eswa.2023.120094","volume":"225","author":"S Wang","year":"2023","unstructured":"Wang, S., Ren, J., Bai, R.: A semi-supervised adaptive discriminative discretization method improving discrimination power of regularized naive Bayes. Expert Syst. Appl. 225, 120094 (2023)","journal-title":"Expert Syst. Appl."},{"key":"2930_CR33","doi-asserted-by":"publisher","first-page":"331","DOI":"10.1016\/j.patcog.2018.11.030","volume":"88","author":"X Wang","year":"2019","unstructured":"Wang, X., Jiang, X., Ren, J.: Blood vessel segmentation from fundus image by a cascade classification framework. Pattern Recognit. 88, 331\u2013341 (2019)","journal-title":"Pattern Recognit."},{"key":"2930_CR34","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1007\/s00371-022-02524-z","volume":"38","author":"F Yan","year":"2022","unstructured":"Yan, F., Silamu, W., Li, Y., Chai, Y.: SPCA-Net: a based on spatial position relationship co-attention network for visual question answering. Vis. Comput. 38, 1\u201312 (2022)","journal-title":"Vis. Comput."},{"key":"2930_CR35","doi-asserted-by":"crossref","unstructured":"Zhang, C., Gao, F., Jia, B., Zhu, Y., Zhu, S.C.: RAVEN: A dataset for relational and analogical visual reasoning. In: Proc. IEEE Conf. Comput. Vis. Pattern Recognit. pp. 5317\u20135327 (2019)","DOI":"10.1109\/CVPR.2019.00546"},{"key":"2930_CR36","unstructured":"Zhang, C., Jia, B., Gao, F., Zhu, Y., Lu, H., Zhu, S.C.: Learning perceptual inference by contrasting. In: Proc. NeurIPS. pp. 1075\u20131087 (2019)"},{"key":"2930_CR37","unstructured":"Zhang, H., Cisse, M., Dauphin, Y.N., Lopez-Paz, D.: Mixup: beyond empirical risk minimization. In: Proc. 6th Int. Conf. Learn. Represent. (2018)"},{"key":"2930_CR38","doi-asserted-by":"publisher","first-page":"3000","DOI":"10.1109\/TIP.2023.3266161","volume":"32","author":"J Zhang","year":"2023","unstructured":"Zhang, J., Ren, J., Zhang, Q., Liu, J., Jiang, X.: Spatial context-aware object-attentional network for multi-label image classification. IEEE Trans. Image Process. 32, 3000\u20133012 (2023)","journal-title":"IEEE Trans. Image Process."},{"key":"2930_CR39","doi-asserted-by":"crossref","unstructured":"Zhang, J., Zhang, Q., Ren, J., Zhao, Y., Liu, J.: Spatial-context-aware deep neural network for multi-class image classification. In: Proc. IEEE Int. Conf. Acoustics, Speech Signal Process. pp. 1960\u20131964 (2022)","DOI":"10.1109\/ICASSP43922.2022.9746921"},{"key":"2930_CR40","unstructured":"Zheng, K., Zha, Z.J., Wei, W.: Abstract reasoning with distracting features. In: Proc. NeurIPS. pp. 5842\u20135853 (2019)"},{"key":"2930_CR41","doi-asserted-by":"crossref","unstructured":"Zhong, Z., Zheng, L., Kang, G., Li, S., Yang, Y.: Random erasing data augmentation. In: Proc. 34th AAAI Conf. Artif. Intell. pp. 13001\u201313008 (2020)","DOI":"10.1609\/aaai.v34i07.7000"},{"issue":"11","key":"2930_CR42","doi-asserted-by":"publisher","first-page":"1583","DOI":"10.1007\/s00371-018-1559-x","volume":"35","author":"F Zhou","year":"2019","unstructured":"Zhou, F., Hu, Y., Shen, X.: MSANet: multimodal self-augmentation and adversarial network for RGB-D object recognition. Vis. Comput. 35(11), 1583\u20131594 (2019)","journal-title":"Vis. Comput."},{"key":"2930_CR43","doi-asserted-by":"crossref","unstructured":"Zhu, J.Y., Park, T., Isola, P., Efros, A.A.: Unpaired image-to-image translation using cycle-consistent adversarial networks. In: Proc. IEEE Int. Conf. Comput. Vis. pp. 2223\u20132232 (2017)","DOI":"10.1109\/ICCV.2017.244"},{"key":"2930_CR44","doi-asserted-by":"publisher","first-page":"8332","DOI":"10.1109\/TIP.2021.3114987","volume":"30","author":"T Zhuo","year":"2021","unstructured":"Zhuo, T., Huang, Q., Kankanhalli, M.: Unsupervised abstract reasoning for Raven\u2019s problem matrices. IEEE Trans. Image Process. 30, 8332\u20138341 (2021)","journal-title":"IEEE Trans. Image Process."}],"container-title":["The Visual Computer"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00371-023-02930-x.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s00371-023-02930-x\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00371-023-02930-x.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,4,5]],"date-time":"2024-04-05T17:08:10Z","timestamp":1712336890000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s00371-023-02930-x"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2023,7,8]]},"references-count":44,"journal-issue":{"issue":"4","published-print":{"date-parts":[[2024,4]]}},"alternative-id":["2930"],"URL":"https:\/\/doi.org\/10.1007\/s00371-023-02930-x","relation":{},"ISSN":["0178-2789","1432-2315"],"issn-type":[{"value":"0178-2789","type":"print"},{"value":"1432-2315","type":"electronic"}],"subject":[],"published":{"date-parts":[[2023,7,8]]},"assertion":[{"value":"28 May 2023","order":1,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"8 July 2023","order":2,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare that they have no conflicts of interest to this work.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}}]}}