{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,1]],"date-time":"2026-06-01T20:04:11Z","timestamp":1780344251154,"version":"3.54.1"},"reference-count":45,"publisher":"Springer Science and Business Media LLC","issue":"4","license":[{"start":{"date-parts":[[2023,6,19]],"date-time":"2023-06-19T00:00:00Z","timestamp":1687132800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2023,6,19]],"date-time":"2023-06-19T00:00:00Z","timestamp":1687132800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Vis Comput"],"published-print":{"date-parts":[[2024,4]]},"DOI":"10.1007\/s00371-023-02920-z","type":"journal-article","created":{"date-parts":[[2023,6,19]],"date-time":"2023-06-19T12:02:06Z","timestamp":1687176126000},"page":"2347-2361","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":8,"title":["MultiCut-MultiMix: a two-level data augmentation method for detecting small and densely distributed objects in large-size images"],"prefix":"10.1007","volume":"40","author":[{"given":"Zhimeng","family":"Xin","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Tongwei","family":"Lu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yuzhou","family":"Li","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xinge","family":"You","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2023,6,19]]},"reference":[{"key":"2920_CR1","doi-asserted-by":"crossref","unstructured":"Lorenz, K.S., Serrano, F., Salama, P., Delp, E.J.: Segmentation and registration based analysis of microscopy images. In: Proceedings of International Conference on Image Processing (ICIP), Cairo, Egypt, pp. 4213\u20134216 (2009)","DOI":"10.1109\/ICIP.2009.5413531"},{"issue":"7","key":"2920_CR2","doi-asserted-by":"publisher","first-page":"1965","DOI":"10.1007\/s00371-020-01957-8","volume":"37","author":"G Rohith","year":"2021","unstructured":"Rohith, G., Kumar, L.S.: Paradigm shifts in super-resolution techniques for remote sensing applications. Vis. Comput. 37(7), 1965\u20132008 (2021)","journal-title":"Vis. Comput."},{"issue":"6","key":"2920_CR3","doi-asserted-by":"publisher","first-page":"755","DOI":"10.1007\/s00371-012-0710-3","volume":"28","author":"W Hua","year":"2012","unstructured":"Hua, W., Wang, R., Zeng, X., Tang, Y., Wang, H., Bao, H.: Compressing repeated content within large-scale remote sensing images. Vis. Comput. 28(6), 755\u2013764 (2012)","journal-title":"Vis. Comput."},{"key":"2920_CR4","doi-asserted-by":"publisher","DOI":"10.1016\/j.ijleo.2020.165356","volume":"221","author":"OA Shawky","year":"2020","unstructured":"Shawky, O.A., Hagag, A., El-Dahshan, E.-S.A., Ismail, M.A.: Remote sensing image scene classification using CNN-MLP with data augmentation. Optik 221, 165356 (2020)","journal-title":"Optik"},{"issue":"7","key":"2920_CR5","doi-asserted-by":"publisher","first-page":"1707","DOI":"10.1007\/s00371-020-01933-2","volume":"37","author":"M Wu","year":"2021","unstructured":"Wu, M., Jin, X., Jiang, Q., Lee, S.-J., Liang, W., Lin, G., Yao, S.: Remote sensing image colorization using symmetrical multi-scale DCGAN in YUV color space. Vis. Comput. 37(7), 1707\u20131729 (2021)","journal-title":"Vis. Comput."},{"issue":"1","key":"2920_CR6","doi-asserted-by":"publisher","first-page":"118","DOI":"10.1007\/s00371-004-0275-x","volume":"21","author":"M Sadgal","year":"2005","unstructured":"Sadgal, M., El Fazziki, A., Ait Ouahman, A.: Aerial image processing and object recognition. Vis. Comput. 21(1), 118\u2013123 (2005)","journal-title":"Vis. Comput."},{"issue":"9","key":"2920_CR7","doi-asserted-by":"publisher","first-page":"1007348","DOI":"10.1371\/journal.pcbi.1007348","volume":"15","author":"AX Lu","year":"2019","unstructured":"Lu, A.X., Kraus, O.Z., Cooper, S., Moses, A.M.: Learning unsupervised feature representations for single cell microscopy images with paired cell inpainting. PLoS Comput. Biol. 15(9), 1007348 (2019)","journal-title":"PLoS Comput. Biol."},{"key":"2920_CR8","doi-asserted-by":"publisher","first-page":"11","DOI":"10.1016\/j.isprsjprs.2016.03.014","volume":"117","author":"G Cheng","year":"2016","unstructured":"Cheng, G., Han, J.: A survey on object detection in optical remote sensing images. ISPRS J. Photogramm. Remote. Sens. 117, 11\u201328 (2016)","journal-title":"ISPRS J. Photogramm. Remote. Sens."},{"key":"2920_CR9","doi-asserted-by":"crossref","unstructured":"Aftab, U., Siddiqui, G.F.: Big data augmentation with data warehouse: a survey. In: Proceedings of IEEE Big Data, Seattle, WA, USA, pp. 2775\u20132784 (2018)","DOI":"10.1109\/BigData.2018.8622182"},{"key":"2920_CR10","doi-asserted-by":"crossref","unstructured":"Shin, H., Lee, K., Lee, C.: Data augmentation method of object detection for deep learning in maritime image. In: Proceedings of IEEE BigComp, Busan, Korea (South), pp. 463\u2013466 (2020)","DOI":"10.1109\/BigComp48618.2020.00-25"},{"key":"2920_CR11","doi-asserted-by":"crossref","unstructured":"Ametefe, D.S., Sarnin, S.S., Ali, D.M., Muhammad, Z.Z.: Fingerprint pattern classification using deep transfer learning and data augmentation. Vis. Comput. (2022)","DOI":"10.1007\/s00371-022-02437-x"},{"issue":"2","key":"2920_CR12","doi-asserted-by":"publisher","first-page":"217","DOI":"10.1007\/s00371-020-01794-9","volume":"37","author":"H Ben Fredj","year":"2021","unstructured":"Ben Fredj, H., Bouguezzi, S., Souani, C.: Face recognition in unconstrained environment with CNN. Vis. Comput. 37(2), 217\u2013226 (2021)","journal-title":"Vis. Comput."},{"key":"2920_CR13","unstructured":"Antoniou, A., Storkey, A., Edwards, H.: Data Augmentation Generative Adversarial Networks. arXiv e-prints, 1711\u201304340 (2017) arXiv:1711.04340 [stat.ML]"},{"key":"2920_CR14","unstructured":"Zoph, B., Cubuk, E.D., Ghiasi, G., Lin, T.-Y., Shlens, J., Le, Q.V.: Learning Data Augmentation Strategies for Object Detection. arXiv e-prints, 1906\u201311172 (2019) arXiv:1906.11172 [cs.CV]"},{"issue":"11","key":"2920_CR15","doi-asserted-by":"publisher","first-page":"1583","DOI":"10.1007\/s00371-018-1559-x","volume":"35","author":"F Zhou","year":"2019","unstructured":"Zhou, F., Hu, Y., Shen, X.: MSANet: multimodal self-augmentation and adversarial network for RGB-D object recognition. Vis. Comput. 35(11), 1583\u20131594 (2019)","journal-title":"Vis. Comput."},{"issue":"6","key":"2920_CR16","doi-asserted-by":"publisher","first-page":"2091","DOI":"10.1007\/s00371-021-02270-8","volume":"38","author":"N Li","year":"2022","unstructured":"Li, N., Ai, H.: EfiLoc: large-scale visual indoor localization with efficient correlation between sparse features and 3D points. Vis. Comput. 38(6), 2091\u20132106 (2022)","journal-title":"Vis. Comput."},{"issue":"2","key":"2920_CR17","doi-asserted-by":"publisher","first-page":"509","DOI":"10.1007\/s00371-020-02031-z","volume":"38","author":"MJ Khan","year":"2022","unstructured":"Khan, M.J., Khan, M.J., Siddiqui, A.M., Khurshid, K.: An automated and efficient convolutional architecture for disguise-invariant face recognition using noise-based data augmentation and deep transfer learning. Vis. Comput. 38(2), 509\u2013523 (2022)","journal-title":"Vis. Comput."},{"issue":"6","key":"2920_CR18","doi-asserted-by":"publisher","first-page":"1415","DOI":"10.1007\/s00371-020-01878-6","volume":"37","author":"M Asad","year":"2021","unstructured":"Asad, M., Yang, J., He, J., Shamsolmoali, P., He, X.: Multi-frame feature-fusion-based model for violence detection. Vis. Comput. 37(6), 1415\u20131431 (2021)","journal-title":"Vis. Comput."},{"key":"2920_CR19","doi-asserted-by":"publisher","DOI":"10.1016\/j.autcon.2020.103198","volume":"115","author":"S Bang","year":"2020","unstructured":"Bang, S., Baek, F., Park, S., Kim, W., Kim, H.: Image augmentation to improve construction resource detection using generative adversarial networks, cut-and-paste, and image transformation techniques. Autom. Constr. 115, 103198 (2020)","journal-title":"Autom. Constr."},{"key":"2920_CR20","doi-asserted-by":"publisher","first-page":"144","DOI":"10.1016\/j.cogsys.2018.06.014","volume":"52","author":"Y Xi","year":"2018","unstructured":"Xi, Y., Zheng, J., Li, X., Xu, X., Ren, J., Xie, G.: SR-POD: sample rotation based on principal-axis orientation distribution for data augmentation in deep object detection. Cogn. Syst. Res. 52, 144\u2013154 (2018)","journal-title":"Cogn. Syst. Res."},{"issue":"2","key":"2920_CR21","doi-asserted-by":"publisher","first-page":"125","DOI":"10.3390\/info11020125","volume":"11","author":"A Buslaev","year":"2020","unstructured":"Buslaev, A., Iglovikov, V.I., Khvedchenya, E., Parinov, A., Druzhinin, M., Kalinin, A.A.: Albumentations: Fast and flexible image augmentations. Information 11(2), 125 (2020)","journal-title":"Information"},{"key":"2920_CR22","unstructured":"Van Etten, A.: You only look twice: rapid multi-scale object detection in satellite imagery. In: Proceedings of IEEE Conference on Computer Vision and Pattern Recognition (CVPR), Salt Lake, USA (2018) [cs.CV]"},{"issue":"1","key":"2920_CR23","first-page":"1929","volume":"15","author":"N Srivastava","year":"2014","unstructured":"Srivastava, N., Hinton, G., Krizhevsky, A., Sutskever, I., Salakhutdinov, R.: Dropout: a simple way to prevent neural networks from overfitting. J. Mach. Learn. Res. 15(1), 1929\u20131958 (2014)","journal-title":"J. Mach. Learn. Res."},{"key":"2920_CR24","doi-asserted-by":"publisher","DOI":"10.1016\/j.patcog.2021.108067","volume":"119","author":"X Yu","year":"2021","unstructured":"Yu, X., Zhao, Y., Gao, Y., Xiong, S.: Maskcov: a random mask covariance network for ultra-fine-grained visual categorization. Pattern Recogn. 119, 108067 (2021)","journal-title":"Pattern Recogn."},{"key":"2920_CR25","unstructured":"Bochkovskiy, A., Wang, C.-Y., Liao, H.-Y.M.: YOLOv4: optimal speed and accuracy of object detection. In: Proceedings of IEEE Conference on Computer Vision and Pattern Recognition (CVPR), Seattle, WA, USA (2020)"},{"key":"2920_CR26","unstructured":"DeVries, T., Taylor, G.W.: Improved regularization of convolutional neural networks with cutout. arXiv preprint arXiv:1708.04552 (2017)"},{"key":"2920_CR27","doi-asserted-by":"crossref","unstructured":"Yun, S., Han, D., Chun, S., Oh, S.J., Yoo, Y., Choe, J.: Cutmix: Regularization strategy to train strong classifiers with localizable features. In: Proceedings of IEEE Conference on International Conference on Computer Vision (ICCV), Seoul, Korea (South), pp. 6022\u20136031 (2019)","DOI":"10.1109\/ICCV.2019.00612"},{"key":"2920_CR28","doi-asserted-by":"crossref","unstructured":"Yoo, J., Ahn, N., Sohn, K.-A.: Rethinking data augmentation for image super-resolution: a comprehensive analysis and a new strategy. In: Proceedings of IEEE Conference on Computer Vision and Pattern Recognition (CVPR), Seattle, WA, USA, pp. 8372\u20138381 (2020)","DOI":"10.1109\/CVPR42600.2020.00840"},{"key":"2920_CR29","unstructured":"Zhang, H., Cisse, M., Dauphin, Y.N., Lopez-Paz, D.: mixup: Beyond Empirical Risk Minimization. In: Proceedings of 6th International Conference on Learning Representations (ICLR), Vancouver, Canada (2018) [cs.LG]"},{"key":"2920_CR30","unstructured":"Redmon, J., Farhadi, A.: YOLOv3: An Incremental Improvement. In: Proceedings of IEEE Conference on Computer Vision and Pattern Recognition (CVPR), Salt Lake, USA (2018)"},{"key":"2920_CR31","doi-asserted-by":"crossref","unstructured":"Redmon, J., Farhadi, A.: Yolo9000: Better, faster, stronger. In: Proceedings of IEEE Conference on Computer Vision and Pattern Recognition (CVPR), Honolulu, HI, USA, pp. 6517\u20136525 (2017)","DOI":"10.1109\/CVPR.2017.690"},{"key":"2920_CR32","doi-asserted-by":"crossref","unstructured":"Xie, S., Girshick, R., Doll\u00e1r, P., Tu, Z., He, K.: Aggregated residual transformations for deep neural networks. In: Proceedings of IEEE Conference on Computer Vision and Pattern Recognition (CVPR), Honolulu, HI, USA, pp. 5987\u20135995 (2017)","DOI":"10.1109\/CVPR.2017.634"},{"key":"2920_CR33","doi-asserted-by":"crossref","unstructured":"Huang, G., Liu, Z., Van Der Maaten, L., Weinberger, K.Q.: Densely connected convolutional networks. In: Proceedings of IEEE Conference on Computer Vision and Pattern Recognition (CVPR), Honolulu, HI, USA, pp. 2261\u20132269 (2017)","DOI":"10.1109\/CVPR.2017.243"},{"key":"2920_CR34","doi-asserted-by":"crossref","unstructured":"Girshick, R.: Fast R-CNN. In: Proceedings of IEEE Conference on International Conference on Computer Vision (ICCV), Santiago, Chile, pp. 1440\u20131448 (2015)","DOI":"10.1109\/ICCV.2015.169"},{"issue":"6","key":"2920_CR35","doi-asserted-by":"publisher","first-page":"1137","DOI":"10.1109\/TPAMI.2016.2577031","volume":"39","author":"S Ren","year":"2017","unstructured":"Ren, S., He, K., Girshick, R., Sun, J.: Faster R-CNN: towards real-time object detection with region proposal networks. IEEE Trans. Pattern Anal. Mach. Intell. 39(6), 1137\u20131149 (2017)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"2920_CR36","doi-asserted-by":"publisher","first-page":"42","DOI":"10.1016\/j.neucom.2018.03.030","volume":"299","author":"X Sun","year":"2018","unstructured":"Sun, X., Wu, P., Hoi, S.C.H.: Face detection using deep learning: an improved faster RCNN approach. Neurocomputing 299, 42\u201350 (2018)","journal-title":"Neurocomputing"},{"key":"2920_CR37","doi-asserted-by":"publisher","first-page":"60","DOI":"10.1016\/j.ins.2020.06.035","volume":"541","author":"B Wei","year":"2020","unstructured":"Wei, B., Hao, K., Gao, L., Tang, X.-S.: Detecting textile micro-defects: a novel and efficient method based on visual gain mechanism. Inf. Sci. 541, 60\u201374 (2020)","journal-title":"Inf. Sci."},{"key":"2920_CR38","doi-asserted-by":"crossref","unstructured":"Lin, T.-Y., Doll\u00e1r, P., Girshick, R., He, K., Hariharan, B., Belongie, S.: Feature pyramid networks for object detection. In: 2017 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 936\u2013944 (2017)","DOI":"10.1109\/CVPR.2017.106"},{"key":"2920_CR39","doi-asserted-by":"crossref","unstructured":"Yu, J., Jiang, Y., Wang, Z., Cao, Z., Huang, T.: Unitbox: an advanced object detection network. In: Proceedings of the 2016 ACM Multimedia Conference (ACM MM), Amsterdam, United kingdom, pp. 516\u2013520 (2016)","DOI":"10.1145\/2964284.2967274"},{"key":"2920_CR40","doi-asserted-by":"crossref","unstructured":"Rezatofighi, H., Tsoi, N., Gwak, J., Sadeghian, A., Reid, I., Savarese, S.: Generalized intersection over union: a metric and a loss for bounding box regression. In: Proceedings of IEEE Conference on Computer Vision and Pattern Recognition (CVPR), Long Beach, CA, USA, pp. 658\u2013666 (2019)","DOI":"10.1109\/CVPR.2019.00075"},{"key":"2920_CR41","doi-asserted-by":"crossref","unstructured":"Zheng, Z., Wang, P., Liu, W., Li, J., Ye, R., Ren, D.: Distance-iou loss: Faster and better learning for bounding box regression. In: Proceedings of 34th AAAI Conference on Articial Intelligence (AAAI), New York, USA (2020)","DOI":"10.1609\/aaai.v34i07.6999"},{"key":"2920_CR42","doi-asserted-by":"crossref","unstructured":"Szegedy, C., Vanhoucke, V., Ioffe, S., Shlens, J., Wojna, Z.: Rethinking the inception architecture for computer vision. In: Proceedings of IEEE Conference on Computer Vision and Pattern Recognition (CVPR), Las Vegas, NV, USA, pp. 2818\u20132826 (2016)","DOI":"10.1109\/CVPR.2016.308"},{"key":"2920_CR43","unstructured":"Misra, D.: Mish: A Self Regularized Non-Monotonic Activation Function. arXiv e-prints, 1908\u201308681 (2019) arXiv:1908.08681 [cs.LG]"},{"key":"2920_CR44","doi-asserted-by":"crossref","unstructured":"Neubeck, A., Van Gool, L.: Efficient non-maximum suppression. In: Proceedings of IEEE International Conference on Pattern Recognition (ICPR), Hong Kong, China, vol. 3, pp. 850\u2013855 (2006)","DOI":"10.1109\/ICPR.2006.479"},{"key":"2920_CR45","doi-asserted-by":"crossref","unstructured":"Zhu, H., Chen, X., Dai, W., Fu, K., Ye, Q., Jiao, J.: Orientation robust object detection in aerial images using deep convolutional neural network. In: Proceedings of IEEE International Conference on Image Processing (ICIP), Quebec, QC, Canada, pp. 3735\u20133739 (2015)","DOI":"10.1109\/ICIP.2015.7351502"}],"container-title":["The Visual Computer"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00371-023-02920-z.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s00371-023-02920-z\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00371-023-02920-z.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,4,5]],"date-time":"2024-04-05T17:04:13Z","timestamp":1712336653000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s00371-023-02920-z"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2023,6,19]]},"references-count":45,"journal-issue":{"issue":"4","published-print":{"date-parts":[[2024,4]]}},"alternative-id":["2920"],"URL":"https:\/\/doi.org\/10.1007\/s00371-023-02920-z","relation":{},"ISSN":["0178-2789","1432-2315"],"issn-type":[{"value":"0178-2789","type":"print"},{"value":"1432-2315","type":"electronic"}],"subject":[],"published":{"date-parts":[[2023,6,19]]},"assertion":[{"value":"28 May 2023","order":1,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"19 June 2023","order":2,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare that they have no known competing financial interests or personal relationships that could have appeared to influence the work reported in this paper.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}}]}}