{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,23]],"date-time":"2026-07-23T18:05:38Z","timestamp":1784829938939,"version":"3.55.0"},"reference-count":76,"publisher":"Springer Science and Business Media LLC","issue":"3","license":[{"start":{"date-parts":[[2020,4,23]],"date-time":"2020-04-23T00:00:00Z","timestamp":1587600000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0"},{"start":{"date-parts":[[2020,4,23]],"date-time":"2020-04-23T00:00:00Z","timestamp":1587600000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0"}],"funder":[{"name":"Business and Local Government Data Research Centre","award":["ES\/L011859\/1"],"award-info":[{"award-number":["ES\/L011859\/1"]}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["SN COMPUT. SCI."],"published-print":{"date-parts":[[2020,5]]},"abstract":"<jats:title>Abstract<\/jats:title><jats:p>Missing data is a significant issue in many real-world datasets, yet there are no robust methods for dealing with it appropriately. In this paper, we propose a robust approach to dealing with missing data in classification problems: Multiple Imputation Ensembles (MIE). Our method integrates two approaches: multiple imputation and ensemble methods and compares two types of ensembles: bagging and stacking. We also propose a robust experimental set-up using 20 benchmark datasets from the UCI machine learning repository. For each dataset, we introduce increasing amounts of data Missing Completely at Random. Firstly, we use a number of single\/multiple imputation methods to recover the missing values and then ensemble a number of different classifiers built on the imputed data. We assess the quality of the imputation by using dissimilarity measures. We also evaluate the MIE performance by comparing classification accuracy on the complete and imputed data. Furthermore, we use the accuracy of simple imputation as a benchmark for comparison. We find that our proposed approach combining multiple imputation with ensemble techniques outperform others, particularly as missing data increases.<\/jats:p>","DOI":"10.1007\/s42979-020-00131-0","type":"journal-article","created":{"date-parts":[[2020,4,23]],"date-time":"2020-04-23T14:02:55Z","timestamp":1587650575000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":45,"title":["Multiple Imputation Ensembles (MIE) for Dealing with Missing Data"],"prefix":"10.1007","volume":"1","author":[{"given":"Aliya","family":"Aleryani","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Wenjia","family":"Wang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Beatriz","family":"de la Iglesia","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2020,4,23]]},"reference":[{"issue":"3","key":"131_CR1","doi-asserted-by":"publisher","first-page":"273","DOI":"10.1111\/j.1467-9876.2007.00613.x","volume":"57","author":"K Abayomi","year":"2008","unstructured":"Abayomi K, Gelman A, Levy M. Diagnostics for multivariate imputations. J R Stat Soc Ser C (Appl Stat). 2008;57(3):273\u201391.","journal-title":"J R Stat Soc Ser C (Appl Stat)"},{"key":"131_CR2","doi-asserted-by":"crossref","unstructured":"Aleryani A, Wang W, De\u00a0La\u00a0Iglesia B. Dealing with missing data and uncertainty in the context of data mining. In: International conference on hybrid artificial intelligence systems, Springer, p. 289\u2013301; 2018.","DOI":"10.1007\/978-3-319-92639-1_24"},{"issue":"1","key":"131_CR3","doi-asserted-by":"publisher","first-page":"40","DOI":"10.1002\/mpr.329","volume":"20","author":"MJ Azur","year":"2011","unstructured":"Azur MJ, Stuart EA, Frangakis C, Leaf PJ. Multiple imputation by chained equations: what is it and how does it work? Int J Methods Psychiatr Res. 2011;20(1):40\u20139.","journal-title":"Int J Methods Psychiatr Res"},{"issue":"5\u20136","key":"131_CR4","doi-asserted-by":"publisher","first-page":"519","DOI":"10.1080\/713827181","volume":"17","author":"GE Batista","year":"2003","unstructured":"Batista GE, Monard MC. An analysis of four missing data treatment methods for supervised learning. Appl Artif Intell. 2003;17(5\u20136):519\u201333.","journal-title":"Appl Artif Intell"},{"key":"131_CR5","doi-asserted-by":"crossref","unstructured":"Boser BE, Guyon IM, Vapnik VN. A training algorithm for optimal margin classifiers. In: Proceedings of the fifth annual workshop on Computational learning theory, ACM, p. 144\u2013152; 1992.","DOI":"10.1145\/130385.130401"},{"issue":"2","key":"131_CR6","first-page":"123","volume":"24","author":"L Breiman","year":"1996","unstructured":"Breiman L. Bagging predictors. Mach Learn. 1996;24(2):123\u201340.","journal-title":"Mach Learn"},{"issue":"1","key":"131_CR7","doi-asserted-by":"publisher","first-page":"5","DOI":"10.1023\/A:1010933404324","volume":"45","author":"L Breiman","year":"2001","unstructured":"Breiman L. Random forests. Mach Learn. 2001;45(1):5\u201332.","journal-title":"Mach Learn"},{"key":"131_CR8","doi-asserted-by":"crossref","unstructured":"Buuren Sv, Groothuis-Oudshoorn K. Mice: multivariate imputation by chained equations in r. J Stat Softw. 2010; 1\u201368","DOI":"10.18637\/jss.v045.i03"},{"issue":"3","key":"131_CR9","first-page":"719","volume":"13","author":"SS Chae","year":"2006","unstructured":"Chae SS, Kim JM, Yang WY. Cluster analysis with balancing weight on mixed-type data. Commun Stat Appl Methods. 2006;13(3):719\u201332.","journal-title":"Commun Stat Appl Methods"},{"key":"131_CR10","unstructured":"Chai X, Deng L, Yang Q, Ling CX. Test-cost sensitive naive Bayes classification. In: ICDM\u201904. Fourth IEEE international conference on data mining, IEEE, p. 51\u201358; 2004."},{"issue":"1","key":"131_CR11","doi-asserted-by":"publisher","first-page":"6085","DOI":"10.1038\/s41598-018-24271-9","volume":"8","author":"Z Che","year":"2018","unstructured":"Che Z, Purushotham S, Cho K, Sontag D, Liu Y. Recurrent neural networks for multivariate time series with missing values. Sci Rep. 2018;8(1):6085.","journal-title":"Sci Rep"},{"key":"131_CR12","doi-asserted-by":"publisher","first-page":"249","DOI":"10.1016\/j.knosys.2017.06.010","volume":"132","author":"X Chen","year":"2017","unstructured":"Chen X, Wei Z, Li Z, Liang J, Cai Y, Zhang B. Ensemble correlation-based low-rank matrix completion with applications to traffic data imputation. Knowl Based Syst. 2017;132:249\u201362.","journal-title":"Knowl Based Syst"},{"key":"131_CR13","unstructured":"Cherkauer KJ. Human expert-level performance on a scientific image analysis task by a system using combined artificial neural networks. In: Working notes of the AAAI workshop on integrating multiple learned models, vol.\u00a021, Citeseer; 1996."},{"issue":"1","key":"131_CR14","first-page":"43","volume":"8","author":"SS Choi","year":"2010","unstructured":"Choi SS, Cha SH, Tappert CC. A survey of binary similarity and distance measures. J Syst Cybern Inform. 2010;8(1):43\u20138.","journal-title":"J Syst Cybern Inform"},{"key":"131_CR15","unstructured":"Clark D, Schreter Z, Adams A. A quantitative comparison of dystal and backpropagation. In: Australian conference on neural networks; 1996."},{"issue":"3","key":"131_CR16","first-page":"273","volume":"20","author":"C Cortes","year":"1995","unstructured":"Cortes C, Vapnik V. Support-vector networks. Mach Learn. 1995;20(3):273\u201397.","journal-title":"Mach Learn"},{"key":"131_CR17","doi-asserted-by":"crossref","unstructured":"Dempster AP, Laird NM, Rubin DB. Maximum likelihood from incomplete data via the EM algorithm. J R Stat Soc Ser B (Mthodol); 1977, 1\u201338.","DOI":"10.1111\/j.2517-6161.1977.tb01600.x"},{"issue":"Jan","key":"131_CR18","first-page":"1","volume":"7","author":"J Dem\u0161ar","year":"2006","unstructured":"Dem\u0161ar J. Statistical comparisons of classifiers over multiple data sets. J Mach Learn Res. 2006;7(Jan):1\u201330.","journal-title":"J Mach Learn Res"},{"key":"131_CR19","doi-asserted-by":"crossref","unstructured":"Dietterich TG. Ensemble methods in machine learning. In: International workshop on multiple classifier systems, Springer, p. 1\u201315; 2000.","DOI":"10.1007\/3-540-45014-9_1"},{"key":"131_CR20","unstructured":"Dietterich TG. Ensemble learning. In: The handbook of brain theory and neural networks, vol. 2, p. 110\u201325; 2002."},{"key":"131_CR21","doi-asserted-by":"crossref","unstructured":"Dittman D, Khoshgoftaar TM, Wald R, Napolitano A. Random forest: a reliable tool for patient response prediction. In: 2011 IEEE international conference on bioinformatics and biomedicine workshops (BIBMW), IEEE, p. 289\u2013296; 2011.","DOI":"10.1109\/BIBMW.2011.6112389"},{"issue":"1","key":"131_CR22","doi-asserted-by":"publisher","first-page":"222","DOI":"10.1186\/2193-1801-2-222","volume":"2","author":"Y Dong","year":"2013","unstructured":"Dong Y, Peng CYJ. Principled missing data methods for researchers. SpringerPlus. 2013;2(1):222.","journal-title":"SpringerPlus"},{"issue":"12","key":"131_CR23","doi-asserted-by":"publisher","first-page":"3692","DOI":"10.1016\/j.patcog.2008.05.019","volume":"41","author":"A Farhangfar","year":"2008","unstructured":"Farhangfar A, Kurgan L, Dy J. Impact of imputation of missing values on classification error for discrete data. Pattern Recognit. 2008;41(12):3692\u2013705.","journal-title":"Pattern Recognit"},{"issue":"3","key":"131_CR24","doi-asserted-by":"publisher","first-page":"282","DOI":"10.1177\/1094428103255532","volume":"6","author":"M Fichman","year":"2003","unstructured":"Fichman M, Cummings JN. Multiple imputation for missing data: making the most of what you know. Organ Res Methods. 2003;6(3):282\u2013308.","journal-title":"Organ Res Methods"},{"key":"131_CR25","unstructured":"Frank E, Witten IH. Generating accurate rule sets without global optimization. In: Shavlik J (ed.) Fifteenth international conference on machine learning, Morgan Kaufmann, p. 144\u2013151; 1998."},{"key":"131_CR26","unstructured":"Frank E, Witten IH. Generating accurate rule sets without global optimization; 1998."},{"issue":"1","key":"131_CR27","doi-asserted-by":"publisher","first-page":"119","DOI":"10.1006\/jcss.1997.1504","volume":"55","author":"Y Freund","year":"1997","unstructured":"Freund Y, Schapire RE. A decision-theoretic generalization of on-line learning and an application to boosting. J Comput Syst Sci. 1997;55(1):119\u201339.","journal-title":"J Comput Syst Sci"},{"issue":"4","key":"131_CR28","doi-asserted-by":"publisher","first-page":"1309","DOI":"10.1007\/s11045-016-0393-4","volume":"28","author":"H Gao","year":"2017","unstructured":"Gao H, Jian S, Peng Y, Liu X. A subspace ensemble framework for classification with high dimensional missing data. Multidimens Syst Signal Process. 2017;28(4):1309\u201324.","journal-title":"Multidimens Syst Signal Process"},{"issue":"10","key":"131_CR29","doi-asserted-by":"publisher","first-page":"2044","DOI":"10.1016\/j.ins.2009.12.010","volume":"180","author":"S Garc\u00eda","year":"2010","unstructured":"Garc\u00eda S, Fern\u00e1ndez A, Luengo J, Herrera F. Advanced nonparametric tests for multiple comparisons in the design of experiments in computational intelligence and data mining: e. Inf Sci. 2010;180(10):2044\u201364.","journal-title":"Inf Sci"},{"issue":"2","key":"131_CR30","doi-asserted-by":"publisher","first-page":"263","DOI":"10.1007\/s00521-009-0295-6","volume":"19","author":"PJ Garc\u00eda-Laencina","year":"2010","unstructured":"Garc\u00eda-Laencina PJ, Sancho-G\u00f3mez JL, Figueiras-Vidal AR. Pattern classification with missing data: a review. Neural Comput Appl. 2010;19(2):263\u201382.","journal-title":"Neural Comput Appl"},{"key":"131_CR31","doi-asserted-by":"publisher","first-page":"52","DOI":"10.1016\/j.eswa.2017.07.026","volume":"89","author":"U Garciarena","year":"2017","unstructured":"Garciarena U, Santana R. An extensive analysis of the interaction between missing data types, imputation methods, and supervised classifiers. Expert Syst Appl. 2017;89:52\u201365.","journal-title":"Expert Syst Appl"},{"key":"131_CR32","unstructured":"George-Nektarios T. Weka classifiers summary. Athens: Athens University of Economics and Bussiness Intracom-Telecom; 2013."},{"key":"131_CR33","doi-asserted-by":"crossref","unstructured":"Gower JC. A general coefficient of similarity and some of its properties. Biometrics. 1971; p. 857\u2013871.","DOI":"10.2307\/2528823"},{"key":"131_CR34","doi-asserted-by":"crossref","unstructured":"Grzymala-Busse JW, Hu M. A comparison of several approaches to missing attribute values in data mining. In: International conference on rough sets and current trends in computing, Springer, p. 378\u2013385; 2000.","DOI":"10.1007\/3-540-45554-X_46"},{"issue":"6","key":"131_CR35","doi-asserted-by":"publisher","first-page":"653","DOI":"10.1177\/0962280208101273","volume":"19","author":"Y He","year":"2010","unstructured":"He Y, Zaslavsky AM, Landrum M, Harrington D, Catalano P. Multiple imputation in a large-scale complex survey: a practical guide. Stat Methods Med Res. 2010;19(6):653\u201370.","journal-title":"Stat Methods Med Res"},{"issue":"10","key":"131_CR36","doi-asserted-by":"publisher","first-page":"1102","DOI":"10.1016\/j.jclinepi.2006.01.015","volume":"59","author":"GJ van der Heijden","year":"2006","unstructured":"van der Heijden GJ, Donders ART, Stijnen T, Moons KG. Imputation of missing values is superior to complete case analysis and the missing-indicator method in multivariable diagnostic research: a clinical example. J Clin Epidemiol. 2006;59(10):1102\u20139.","journal-title":"J Clin Epidemiol"},{"issue":"2","key":"131_CR37","doi-asserted-by":"publisher","first-page":"561","DOI":"10.1111\/j.1540-5907.2010.00447.x","volume":"54","author":"J Honaker","year":"2010","unstructured":"Honaker J, King G. What to do about missing values in time-series cross-section data. Am J Polit Sci. 2010;54(2):561\u201381.","journal-title":"Am J Polit Sci"},{"issue":"7","key":"131_CR38","doi-asserted-by":"publisher","first-page":"1","DOI":"10.18637\/jss.v045.i07","volume":"45","author":"J Honaker","year":"2011","unstructured":"Honaker J, King G, Blackwell M, et al. Amelia ii: a program for missing data. J Stat Softw. 2011;45(7):1\u201347.","journal-title":"J Stat Softw"},{"key":"131_CR39","doi-asserted-by":"crossref","unstructured":"Horton N, Kleinman KP. Much ado about nothing: a comparison of missing data methods and software to fit incomplete data regression models. Am Stat. 2007;61:79\u201390. https:\/\/EconPapers.repec.org\/RePEc:bes:amstat:v:61:y:2007:m:february:p:79-90.","DOI":"10.1198\/000313007X172556"},{"issue":"1","key":"131_CR40","doi-asserted-by":"publisher","first-page":"79","DOI":"10.1198\/000313007X172556","volume":"61","author":"NJ Horton","year":"2007","unstructured":"Horton NJ, Kleinman KP. Much ado about nothing: a comparison of missing data methods and software to fit incomplete data regression models. Am Stat. 2007;61(1):79\u201390.","journal-title":"Am Stat"},{"issue":"1","key":"131_CR41","doi-asserted-by":"publisher","first-page":"13","DOI":"10.1002\/(SICI)1097-0258(20000115)19:1<13::AID-SIM279>3.0.CO;2-5","volume":"19","author":"PJ Kelly","year":"2000","unstructured":"Kelly PJ, Lim LLY. Survival analysis for recurrent event data: an application to childhood infectious diseases. Stat Med. 2000;19(1):13\u201333.","journal-title":"Stat Med"},{"key":"131_CR42","unstructured":"Kennickell A.B. Imputation of the 1989 survey of consumer finances: stochastic relaxation and multiple imputation. In: Proceedings of the survey research methods section of the American Statistical Association, vol.\u00a01; 1991."},{"issue":"1","key":"131_CR43","doi-asserted-by":"publisher","first-page":"51","DOI":"10.1186\/1472-6947-11-51","volume":"11","author":"M Khalilia","year":"2011","unstructured":"Khalilia M, Chakraborty S, Popescu M. Predicting disease risks from highly imbalanced data using random forest. BMC Med Inform Decis Making. 2011;11(1):51.","journal-title":"BMC Med Inform Decis Making"},{"issue":"4","key":"131_CR44","doi-asserted-by":"publisher","first-page":"355","DOI":"10.1093\/aje\/kwn071","volume":"168","author":"MA Klebanoff","year":"2008","unstructured":"Klebanoff MA, Cole SR. Use of multiple imputation in the epidemiologic literature. Am J Epidemiol. 2008;168(4):355\u20137.","journal-title":"Am J Epidemiol"},{"key":"131_CR45","unstructured":"Kohavi R, Becker B, Sommerfield D. Improving simple bayes; 1997."},{"key":"131_CR46","doi-asserted-by":"crossref","unstructured":"Kotsiantis SB, Zaharakis I, Pintelas P. Supervised machine learning: a review of classification techniques; 2007.","DOI":"10.1007\/s10462-007-9052-3"},{"key":"131_CR47","unstructured":"Lichman M. UCI machine learning repository; 2013. http:\/\/archive.ics.uci.edu\/ml"},{"key":"131_CR48","volume-title":"Statistical analysis with missing data","author":"RJ Little","year":"2014","unstructured":"Little RJ, Rubin DB. Statistical analysis with missing data. New York: Wiley; 2014."},{"key":"131_CR49","doi-asserted-by":"publisher","first-page":"85","DOI":"10.1016\/j.patcog.2015.10.001","volume":"52","author":"Z Liu","year":"2016","unstructured":"Liu Z, Pan Q, Dezert J, Martin A. Adaptive imputation of missing values for incomplete pattern classification. Pattern Recognit. 2016;52:85\u201395.","journal-title":"Pattern Recognit"},{"issue":"3","key":"131_CR50","doi-asserted-by":"publisher","first-page":"328","DOI":"10.1177\/1094428103254673","volume":"6","author":"DA Newman","year":"2003","unstructured":"Newman DA. Longitudinal modeling with randomly and systematically missing data: a simulation of ad hoc, maximum likelihood, and multiple imputation techniques. Organ Res Methods. 2003;6(3):328\u201362.","journal-title":"Organ Res Methods"},{"key":"131_CR51","volume-title":"C4. 5: programs for machine learning","author":"JR Quinlan","year":"2014","unstructured":"Quinlan JR. C4. 5: programs for machine learning. Amsterdam: Elsevier; 2014."},{"key":"131_CR52","unstructured":"Quinlan JR, et\u00a0al. Bagging, boosting, and c4. 5. In: The association for the advancement of artificial intelligence (AAAI), vol. 1, p. 725\u2013730; 1996."},{"key":"131_CR53","doi-asserted-by":"crossref","unstructured":"Raja P, Thangavel K. Soft clustering based missing value imputation. In: Annual convention of the computer society of India, Springer, p. 119\u2013133; 2016.","DOI":"10.1007\/978-981-10-3274-5_10"},{"issue":"1\u20132","key":"131_CR54","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1007\/s10462-009-9124-7","volume":"33","author":"L Rokach","year":"2010","unstructured":"Rokach L. Ensemble-based classifiers. Artif Intell Rev. 2010;33(1\u20132):1\u201339.","journal-title":"Artif Intell Rev"},{"issue":"434","key":"131_CR55","doi-asserted-by":"publisher","first-page":"473","DOI":"10.1080\/01621459.1996.10476908","volume":"91","author":"DB Rubin","year":"1996","unstructured":"Rubin DB. Multiple imputation after 18+ years. J Am Stat Assoc. 1996;91(434):473\u201389.","journal-title":"J Am Stat Assoc"},{"issue":"4","key":"131_CR56","doi-asserted-by":"publisher","first-page":"585","DOI":"10.1002\/sim.4780100410","volume":"10","author":"DB Rubin","year":"1991","unstructured":"Rubin DB, Schenker N. Multiple imputation in health-are databases: an overview and some applications. Stat Med. 1991;10(4):585\u201398.","journal-title":"Stat Med"},{"key":"131_CR57","doi-asserted-by":"publisher","DOI":"10.1201\/9781439821862","volume-title":"Analysis of incomplete multivariate data","author":"JL Schafer","year":"1997","unstructured":"Schafer JL. Analysis of incomplete multivariate data. Boca Raton: CRC Press; 1997."},{"issue":"1","key":"131_CR58","doi-asserted-by":"publisher","first-page":"3","DOI":"10.1177\/096228029900800102","volume":"8","author":"JL Schafer","year":"1999","unstructured":"Schafer JL. Multiple imputation: a primer. Stat Methods Med Res. 1999;8(1):3\u201315.","journal-title":"Stat Methods Med Res"},{"issue":"1","key":"131_CR59","first-page":"153","volume":"3","author":"J Scheffer","year":"2002","unstructured":"Scheffer J. Dealing with missing data. Res Lett Inf Math Sci. 2002;3(1):153\u201360.","journal-title":"Res Lett Inf Math Sci"},{"key":"131_CR60","volume-title":"Advances in kernel methods: support vector learning","author":"B Sch\u00f6lkopf","year":"1999","unstructured":"Sch\u00f6lkopf B, Burges CJ, Smola AJ. Advances in kernel methods: support vector learning. New York: MIT press; 1999."},{"key":"131_CR61","doi-asserted-by":"publisher","first-page":"68","DOI":"10.1016\/j.eswa.2018.07.057","volume":"115","author":"AM Sefidian","year":"2019","unstructured":"Sefidian AM, Daneshpour N. Missing value imputation using a novel grey based fuzzy c-means, mutual information based feature selection, and regression model. Expert Syst Appl. 2019;115:68\u201394.","journal-title":"Expert Syst Appl"},{"key":"131_CR62","doi-asserted-by":"publisher","first-page":"65","DOI":"10.1016\/j.asoc.2014.09.052","volume":"29","author":"EL Silva-Ram\u00edrez","year":"2015","unstructured":"Silva-Ram\u00edrez EL, Pino-Mej\u00edas R, L\u00f3pez-Coello M. Single imputation with multilayer perceptron and multiple imputation combining multilayer perceptron and k-nearest neighbours for monotone patterns. Appl Soft Comput. 2015;29:65\u201374.","journal-title":"Appl Soft Comput"},{"issue":"4","key":"131_CR63","doi-asserted-by":"publisher","first-page":"478","DOI":"10.1093\/aje\/kwq137","volume":"172","author":"M Spratt","year":"2010","unstructured":"Spratt M, Carpenter J, Sterne JA, Carlin JB, Heron J, Henderson J, Tilling K. Strategies for multiple imputation in longitudinal studies. Am J Epidemiol. 2010;172(4):478\u201387.","journal-title":"Am J Epidemiol"},{"key":"131_CR64","doi-asserted-by":"crossref","unstructured":"van Stein B, Kowalczyk W. An incremental algorithm for repairing training sets with missing values. In: International conference on information processing and management of uncertainty in knowledge-based systems, Springer, p. 175\u2013186; 2016.","DOI":"10.1007\/978-3-319-40581-0_15"},{"key":"131_CR65","doi-asserted-by":"publisher","first-page":"b2393","DOI":"10.1136\/bmj.b2393","volume":"338","author":"JA Sterne","year":"2009","unstructured":"Sterne JA, White IR, Carlin JB, Spratt M, Royston P, Kenward MG, Wood AM, Carpenter JR. Multiple imputation for missing data in epidemiological and clinical research: potential and pitfalls. BMJ. 2009;338:b2393.","journal-title":"BMJ"},{"key":"131_CR66","volume-title":"Introduction to data mining","author":"PN Tan","year":"2006","unstructured":"Tan PN, et al. Introduction to data mining. Bengaluru: Pearson Education India; 2006."},{"key":"131_CR67","doi-asserted-by":"publisher","first-page":"271","DOI":"10.1613\/jair.594","volume":"10","author":"KM Ting","year":"1999","unstructured":"Ting KM, Witten IH. Issues in stacked generalization. J Artif Intell Res. 1999;10:271\u201389.","journal-title":"J Artif Intell Res"},{"key":"131_CR68","doi-asserted-by":"crossref","unstructured":"Tran CT, Zhang M, Andreae P. A genetic programming-based imputation method for classification with missing data. In: European conference on genetic programming, Springer, p. 149\u2013163, 2016.","DOI":"10.1007\/978-3-319-30668-1_10"},{"key":"131_CR69","doi-asserted-by":"crossref","unstructured":"Tran CT, Zhang M, Andreae P, Xue B, Bui LT. Multiple imputation and ensemble learning for classification with incomplete data. In: The 20th Asia Pacific symposium on intelligent and evolutionary systems, IES 2016, Canberra, Australia, November 2016, Proceedings, Springer, pp. 401\u2013415; 2017.","DOI":"10.1007\/978-3-319-49049-6_29"},{"key":"131_CR70","doi-asserted-by":"publisher","first-page":"848","DOI":"10.1016\/j.asoc.2018.09.026","volume":"73","author":"CT Tran","year":"2018","unstructured":"Tran CT, Zhang M, Andreae P, Xue B, Bui LT. Improving performance of classification on incomplete data using feature selection and clustering. Appl Soft Comput. 2018;73:848\u201361.","journal-title":"Appl Soft Comput"},{"key":"131_CR71","unstructured":"Tukey JW. Exploratory data analysis, vol. 2. Reading, MA; 1977."},{"issue":"3","key":"131_CR72","doi-asserted-by":"publisher","first-page":"219","DOI":"10.1177\/0962280206074463","volume":"16","author":"S Van Buuren","year":"2007","unstructured":"Van Buuren S. Multiple imputation of discrete and continuous data by fully conditional specification. Stat Methods Med Res. 2007;16(3):219\u201342.","journal-title":"Stat Methods Med Res"},{"issue":"6","key":"131_CR73","doi-asserted-by":"publisher","first-page":"681","DOI":"10.1002\/(SICI)1097-0258(19990330)18:6<681::AID-SIM71>3.0.CO;2-R","volume":"18","author":"S Van Buuren","year":"1999","unstructured":"Van Buuren S, Boshuizen HC, Knook DL, et al. Multiple imputation of missing blood pressure covariates in survival analysis. Stat Med. 1999;18(6):681\u201394.","journal-title":"Stat Med"},{"key":"131_CR74","volume-title":"The nature of statistical learning theory","author":"V Vapnik","year":"2013","unstructured":"Vapnik V. The nature of statistical learning theory. Berlin: Springer; 2013."},{"key":"131_CR75","volume-title":"Data mining: practical machine learning tools and techniques","author":"IH Witten","year":"2016","unstructured":"Witten IH, Frank E, Hall MA, Pal CJ. Data mining: practical machine learning tools and techniques. Burlington: Morgan Kaufmann; 2016."},{"issue":"2","key":"131_CR76","doi-asserted-by":"publisher","first-page":"241","DOI":"10.1016\/S0893-6080(05)80023-1","volume":"5","author":"DH Wolpert","year":"1992","unstructured":"Wolpert DH. Stacked generalization. Neural Netw. 1992;5(2):241\u201359.","journal-title":"Neural Netw"}],"container-title":["SN Computer Science"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s42979-020-00131-0.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s42979-020-00131-0\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s42979-020-00131-0.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,10,22]],"date-time":"2022-10-22T04:05:11Z","timestamp":1666411511000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s42979-020-00131-0"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2020,4,23]]},"references-count":76,"journal-issue":{"issue":"3","published-print":{"date-parts":[[2020,5]]}},"alternative-id":["131"],"URL":"https:\/\/doi.org\/10.1007\/s42979-020-00131-0","relation":{},"ISSN":["2662-995X","2661-8907"],"issn-type":[{"value":"2662-995X","type":"print"},{"value":"2661-8907","type":"electronic"}],"subject":[],"published":{"date-parts":[[2020,4,23]]},"assertion":[{"value":"31 December 2019","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"30 March 2020","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"23 April 2020","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Compliance with Ethical Standards"}},{"value":"The authors declare that they have no conflict of interest.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}}],"article-number":"134"}}