{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,8,18]],"date-time":"2026-08-18T00:06:11Z","timestamp":1787011571185,"version":"build-2736575974"},"reference-count":140,"publisher":"Emerald","issue":"4","license":[{"start":{"date-parts":[[2021,4,2]],"date-time":"2021-04-02T00:00:00Z","timestamp":1617321600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.emerald.com\/insight\/site-policies"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["DTA"],"published-print":{"date-parts":[[2021,8,5]]},"abstract":"<jats:sec>\n                    <jats:title content-type=\"abstract-subheading\">Purpose<\/jats:title>\n                    <jats:p>The primary aim of this study is to review the studies from different dimensions including type of methods, experimentation setup and evaluation metrics used in the novel approaches proposed for data imputation, particularly in the machine learning (ML) area. This ultimately provides an understanding about how well the proposed framework is evaluated and what type and ratio of missingness are addressed in the proposals. The review questions in this study are (1) what are the ML-based imputation methods studied and proposed during 2010\u20132020? (2) How the experimentation setup, characteristics of data sets and missingness are employed in these studies? (3) What metrics were used for the evaluation of imputation method?<\/jats:p>\n                  <\/jats:sec>\n                  <jats:sec>\n                    <jats:title content-type=\"abstract-subheading\">Design\/methodology\/approach<\/jats:title>\n                    <jats:p>The review process went through the standard identification, screening and selection process. The initial search on electronic databases for missing value imputation (MVI) based on ML algorithms returned a large number of papers totaling at 2,883. Most of the papers at this stage were not exactly an MVI technique relevant to this study. The literature reviews are first scanned in the title for relevancy, and 306 literature reviews were identified as appropriate. Upon reviewing the abstract text, 151 literature reviews that are not eligible for this study are dropped. This resulted in 155 research papers suitable for full-text review. From this, 117 papers are used in assessment of the review questions.<\/jats:p>\n                  <\/jats:sec>\n                  <jats:sec>\n                    <jats:title content-type=\"abstract-subheading\">Findings<\/jats:title>\n                    <jats:p>This study shows that clustering- and instance-based algorithms are the most proposed MVI methods. Percentage of correct prediction (PCP) and root mean square error (RMSE) are most used evaluation metrics in these studies. For experimentation, majority of the studies sourced the data sets from publicly available data set repositories. A common approach is that the complete data set is set as baseline to evaluate the effectiveness of imputation on the test data sets with artificially induced missingness. The data set size and missingness ratio varied across the experimentations, while missing datatype and mechanism are pertaining to the capability of imputation. Computational expense is a concern, and experimentation using large data sets appears to be a challenge.<\/jats:p>\n                  <\/jats:sec>\n                  <jats:sec>\n                    <jats:title content-type=\"abstract-subheading\">Originality\/value<\/jats:title>\n                    <jats:p>\n                      It is understood from the review that there is no single universal solution to missing data problem. Variants of ML approaches work well with the missingness based on the characteristics of the data set. Most of the methods reviewed lack generalization with regard to applicability. Another concern related to applicability is the complexity of the formulation and implementation of the algorithm. Imputations based on\n                      <jats:italic>k<\/jats:italic>\n                      -nearest neighbors (kNN) and clustering algorithms which are simple and easy to implement make it popular across various domains.\n                    <\/jats:p>\n                  <\/jats:sec>","DOI":"10.1108\/dta-12-2020-0298","type":"journal-article","created":{"date-parts":[[2021,3,31]],"date-time":"2021-03-31T01:43:49Z","timestamp":1617155029000},"page":"558-585","source":"Crossref","is-referenced-by-count":70,"title":["A systematic review of machine learning-based missing value imputation techniques"],"prefix":"10.1108","volume":"55","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-5270-5497","authenticated-orcid":false,"given":"Tressy","family":"Thomas","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-9557-0043","authenticated-orcid":false,"given":"Enayat","family":"Rajabi","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"140","published-online":{"date-parts":[[2021,4,2]]},"reference":[{"key":"key2022092811512887300_ref001","doi-asserted-by":"publisher","first-page":"113","DOI":"10.1007\/978-3-319-41920-6_9","article-title":"K-means over incomplete datasets using mean euclidean distance","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics)","year":"2016"},{"key":"key2022092811512887300_ref002","doi-asserted-by":"publisher","first-page":"125","DOI":"10.1007\/978-3-030-00856-7_8","article-title":"A new way of handling missing data in multi-source classification based on adaptive imputation","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 11163 LNCS","year":"2018"},{"key":"key2022092811512887300_ref003","doi-asserted-by":"publisher","first-page":"130","DOI":"10.5220\/0009578201300137","volume-title":"Best Fit Missing Value Imputation (BFMVI) Algorithm for Incomplete Data in the Internet of Things","year":"2020"},{"key":"key2022092811512887300_ref004","doi-asserted-by":"publisher","first-page":"345","DOI":"10.1007\/978-3-030-03991-2_33","article-title":"A hybrid GP-KNN imputation for symbolic regression with missing values","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 11320 LNAI","year":"2018"},{"key":"key2022092811512887300_ref005","doi-asserted-by":"publisher","first-page":"566","DOI":"10.1007\/978-3-030-41299-9_44","article-title":"Genetic programming-based simultaneous feature selection and imputation for symbolic regression with incomplete data","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 12047 LNCS","year":"2020"},{"key":"key2022092811512887300_ref006","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1007\/978-3-030-44094-7_1","article-title":"Hessian complexity measure for genetic programming-based imputation predictor selection in symbolic regression with incomplete data","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 12101 LNCS","year":"2020"},{"issue":"1","key":"key2022092811512887300_ref007","doi-asserted-by":"publisher","first-page":"555","DOI":"10.1007\/s00500-019-03972-x","article-title":"A nifty collaborative analysis to predicting a novel tool (DRFLLS) for missing values estimation","volume":"24","year":"2020","journal-title":"Soft Computing"},{"key":"key2022092811512887300_ref008","doi-asserted-by":"publisher","first-page":"45","DOI":"10.1007\/978-3-319-53480-0_5","article-title":"Improving imputation accuracy in ordinal data using classification","volume":"557","year":"2017","journal-title":"Advances in Intelligent Systems and Computing"},{"issue":"3","key":"key2022092811512887300_ref009","doi-asserted-by":"publisher","DOI":"10.1007\/s42979-020-00131-0","article-title":"Multiple imputation ensembles (MIE) for dealing with missing data","volume":"1","year":"2020","journal-title":"SN Computer Science"},{"key":"key2022092811512887300_ref010","doi-asserted-by":"publisher","first-page":"1144","DOI":"10.1007\/978-3-030-33582-3_107","volume-title":"Missing Data Imputation Techniques for Software Effort Estimation: A Study of Recent Issues and Challenges","year":"2020"},{"key":"key2022092811512887300_ref011","doi-asserted-by":"publisher","first-page":"152","DOI":"10.1016\/j.neucom.2016.04.015","article-title":"Missing data imputation using fuzzy-rough methods","volume":"205","year":"2016","journal-title":"Neurocomputing"},{"issue":"1","key":"key2022092811512887300_ref012","doi-asserted-by":"publisher","DOI":"10.1186\/s13059-019-1837-6","article-title":"DeepImpute: an accurate, fast, and scalable deep neural network method to impute single-cell RNA-seq data","volume":"20","year":"2019","journal-title":"Genome Biology"},{"issue":"1","key":"key2022092811512887300_ref013","doi-asserted-by":"publisher","first-page":"106","DOI":"10.1186\/s12955-019-1181-2","article-title":"Impact of missing data on bias and precision when estimating change in patient-reported outcomes from a clinical registry","volume":"17","year":"2019","journal-title":"Health and Quality of Life Outcomes"},{"key":"key2022092811512887300_ref014","doi-asserted-by":"publisher","first-page":"635","DOI":"10.1007\/978-3-319-92058-0_61","article-title":"A game-theoretic rough set approach for handling missing data in clustering","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 10868 LNAI","year":"2018"},{"key":"key2022092811512887300_ref015","doi-asserted-by":"publisher","first-page":"68","DOI":"10.2316\/P.2017.852-033","article-title":"Microarray missing data imputation using regression","year":"2017"},{"issue":"2","key":"key2022092811512887300_ref016","doi-asserted-by":"publisher","DOI":"10.1007\/s00180-020-00987-z","article-title":"BEST: a decision tree algorithm that handles missing values","volume":"35","year":"2020","journal-title":"Computational Statistics"},{"key":"key2022092811512887300_ref017","doi-asserted-by":"publisher","first-page":"83","DOI":"10.1007\/978-3-030-12927-9_4","article-title":"Optimization problem of k-NN classifier for missing values case","volume-title":"Studies in Fuzziness and Soft Computing","year":"2020"},{"key":"key2022092811512887300_ref018","doi-asserted-by":"publisher","DOI":"10.1101\/744789","article-title":"Machine learning based imputation techniques for estimating phylogenetic trees from incomplete distance matrices","year":"2019","journal-title":"BioRxiv"},{"issue":"3","key":"key2022092811512887300_ref019","doi-asserted-by":"publisher","first-page":"199","DOI":"10.1214\/ss\/1009213726","article-title":"Statistical modeling: the two cultures","volume":"16","year":"2001","journal-title":"Statistical Science"},{"key":"key2022092811512887300_ref020","doi-asserted-by":"publisher","first-page":"916","DOI":"10.1109\/ICMLC.2015.7340675","article-title":"Novel imputation for time series data","year":"2015"},{"key":"key2022092811512887300_ref021","unstructured":"Christina, M., Su, Z. and Weistreich, D. (2018), \u201cManaging missing data in patient registries\u201d, Vol. 22, doi: 10.23970\/AHRQREGISTRIESMISSDATA."},{"issue":"3","key":"key2022092811512887300_ref022","doi-asserted-by":"publisher","first-page":"443","DOI":"10.1007\/s10994-015-5530-z","article-title":"A dynamic ensemble approach to robust classification in the presence of missing data","volume":"102","year":"2016","journal-title":"Machine Learning"},{"key":"key2022092811512887300_ref023","doi-asserted-by":"publisher","first-page":"87","DOI":"10.1007\/978-3-030-01768-2_8","article-title":"Missing data imputation via denoising autoencoders: the untold story","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 11191 LNCS","year":"2018"},{"issue":"2","key":"key2022092811512887300_ref024","doi-asserted-by":"publisher","DOI":"10.1007\/s41666-020-00069-1","article-title":"A combined interpolation and weighted K-nearest neighbours approach for the imputation of longitudinal ICU laboratory data","volume":"2","year":"2020","journal-title":"Journal of Healthcare Informatics Research"},{"key":"key2022092811512887300_ref025","doi-asserted-by":"publisher","first-page":"267","DOI":"10.1007\/978-3-030-00202-2_22","article-title":"K-CCM: a center-based algorithm for clustering categorical data with missing values","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 11144 LNAI","year":"2018"},{"issue":"2","key":"key2022092811512887300_ref026","doi-asserted-by":"publisher","DOI":"10.21767\/2472-1956.100013","article-title":"Missing value imputation using stratified supervised learning for cardiovascular data","volume":"1","year":"2016","journal-title":"Journal of Informatics and Data Mining"},{"key":"key2022092811512887300_ref027","doi-asserted-by":"publisher","first-page":"517","DOI":"10.1007\/978-3-030-31654-9_44","article-title":"DAEimp: denoising autoencoder-based imputation of sleep heart health study for identification of cardiovascular diseases","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 11857 LNCS","year":"2019"},{"issue":"4","key":"key2022092811512887300_ref028","doi-asserted-by":"publisher","DOI":"10.1007\/s42452-019-0383-x","article-title":"Missing data imputation with fuzzy feature selection for diabetes dataset","volume":"1","year":"2019","journal-title":"SN Applied Sciences"},{"issue":"2","key":"key2022092811512887300_ref029","doi-asserted-by":"publisher","first-page":"227","DOI":"10.1007\/s00357-012-9108-1","article-title":"Accurate tree-based missing data imputation and data fusion within the statistical learning paradigm","volume":"29","year":"2012","journal-title":"Journal of Classification"},{"key":"key2022092811512887300_ref030","doi-asserted-by":"publisher","first-page":"203","DOI":"10.1007\/978-3-030-01520-6_18","volume-title":"Distance Estimation for Incomplete Data by Extreme Learning Machine","year":"2019"},{"key":"key2022092811512887300_ref031","article-title":"Applied missing data analysis","year":"2010","journal-title":"The Guilford Press"},{"key":"key2022092811512887300_ref032","doi-asserted-by":"publisher","first-page":"551","DOI":"10.1007\/978-3-319-91476-3_46","article-title":"Missing data imputation by LOLIMOT and FSVM\/FSVR algorithms with a novel approach: a comparative study","volume":"854","year":"2018","journal-title":"Communications in Computer and Information Science"},{"key":"key2022092811512887300_ref033","unstructured":"Frank, A. and Asuncion, A. (2010), \u201c{UCI} machine learning repository\u201d, available at: http:\/\/archive.ics.uci.edu\/ml."},{"key":"key2022092811512887300_ref034","doi-asserted-by":"publisher","first-page":"2137","DOI":"10.4028\/www.scientific.net\/AMR.605-607.2137","article-title":"Particle swarm optimization least square support machine based missing data imputation algorithm in wireless sensor network for nuclear power plant's environmental radiation monitor","volume":"605\u2013607","year":"2013","journal-title":"Advanced Materials Research"},{"key":"key2022092811512887300_ref035","doi-asserted-by":"publisher","first-page":"81","DOI":"10.1007\/978-3-319-14063-6_8","volume-title":"Sample-Based Extreme Learning Machine Regression With Absent Data","year":"2015"},{"key":"key2022092811512887300_ref036","doi-asserted-by":"publisher","first-page":"1251","DOI":"10.1109\/ICMLA.2015.29","article-title":"Random forest with random projection to impute missing gene expression data","year":"2016"},{"key":"key2022092811512887300_ref037","unstructured":"Gong, W., Tschiatschek, S., Turner, R.E., Nowozin, S., Miguel Hern\u00e1ndez-Lobato, J. and Zhang, C. (2019), \u201cIcebreaker: element-wise efficient information acquisition with a bayesian deep latent Gaussian model\u201d, available at: https:\/\/github.com\/microsoft\/Icebreaker."},{"key":"key2022092811512887300_ref038","doi-asserted-by":"publisher","first-page":"563","DOI":"10.1007\/978-3-030-36614-8_43","article-title":"Application of machine learning algorithms to handle missing values in precipitation data","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 11965 LNCS","year":"2019"},{"key":"key2022092811512887300_ref039","doi-asserted-by":"publisher","first-page":"815","DOI":"10.1007\/978-981-13-1501-5_71","article-title":"A novel transfer learning-based missing value imputation on discipline diverse real test datasets\u2014a comparative study with different machine learning algorithms","volume":"814","year":"2019","journal-title":"Advances in Intelligent Systems and Computing"},{"key":"key2022092811512887300_ref040","doi-asserted-by":"publisher","first-page":"189","DOI":"10.1109\/SAINT.2010.18","article-title":"Missing data imputation using regression tree model for sparse data collected via wide area ubiquitous network","year":"2010"},{"key":"key2022092811512887300_ref041","doi-asserted-by":"publisher","first-page":"59","DOI":"10.1007\/978-3-642-14049-5_7","article-title":"Fuzzy clustering of incomplete data based on cluster dispersion","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 6178 LNAI","year":"2010"},{"key":"key2022092811512887300_ref042","doi-asserted-by":"publisher","first-page":"694","DOI":"10.1007\/978-3-319-24553-9_85","article-title":"Scandent tree: a random forest learning method for incomplete multimodal datasets","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 9349","year":"2015"},{"key":"key2022092811512887300_ref043","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1007\/978-3-319-33810-1_1","article-title":"Dealing with missing values in software project datasets: a systematic mapping study","volume-title":"Studies in Computational Intelligence","year":"2016"},{"key":"key2022092811512887300_ref044","doi-asserted-by":"publisher","first-page":"115","DOI":"10.1007\/978-3-319-21024-7_8","article-title":"A novel algorithm for the integration of the imputation of missing values and clustering","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 9166","year":"2015"},{"issue":"2","key":"key2022092811512887300_ref045","doi-asserted-by":"publisher","first-page":"155","DOI":"10.1504\/IJBIDM.2013.057737","article-title":"Imputation of missing values for semi-supervised data using the proximity in random forests","volume":"8","year":"2013","journal-title":"International Journal of Business Intelligence and Data Mining"},{"key":"key2022092811512887300_ref046","doi-asserted-by":"publisher","first-page":"450","DOI":"10.1109\/ICMLC.2018.8526985","article-title":"A missing data imputation method with distance function","year":"2018"},{"key":"key2022092811512887300_ref047","doi-asserted-by":"crossref","unstructured":"Jerez, J.M., Molina, I., Garc\u00eda-Laencina, P.J., Alba, E., Ribelles, N., Mart\u00edn, M. and Franco, L. (2010), \u201cMissing data imputation using statistical and machine learning methods in a real breast cancer problem\u201d, doi: 10.1016\/j.artmed.2010.05.002.","DOI":"10.1016\/j.artmed.2010.05.002"},{"key":"key2022092811512887300_ref048","doi-asserted-by":"publisher","first-page":"441","DOI":"10.1007\/978-3-319-22053-6_47","article-title":"CKNNI: an improved KNN-based missing value handling technique","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 9227","year":"2015"},{"key":"key2022092811512887300_ref049","doi-asserted-by":"publisher","first-page":"445","DOI":"10.1109\/ICSMC.2012.6377764","article-title":"Cluster-based KNN missing value imputation for DNA microarray data","year":"2012"},{"key":"key2022092811512887300_ref050","doi-asserted-by":"publisher","first-page":"559","DOI":"10.1109\/ISCIT.2013.6645921","article-title":"An improvement of missing value imputation in DNA microarray data using cluster-based LLS method","year":"2013"},{"issue":"2","key":"key2022092811512887300_ref051","doi-asserted-by":"publisher","first-page":"165","DOI":"10.1504\/IJDMB.2016.076535","article-title":"A cluster-directed framework for neighbour based imputation of missing value in microarray data","volume":"15","year":"2016","journal-title":"International Journal of Data Mining and Bioinformatics"},{"issue":"62","key":"key2022092811512887300_ref052","doi-asserted-by":"publisher","first-page":"195","DOI":"10.21660\/2019.62.71789","article-title":"A hybrid self organizing map imputation (SOMI) with Na\u00efve Bayes for imputation missing data classification","volume":"17","year":"2019","journal-title":"International Journal of GEOMATE"},{"issue":"10","key":"key2022092811512887300_ref053","doi-asserted-by":"publisher","DOI":"10.3390\/en10101668","article-title":"Learning-based adaptive imputation method with kNN algorithm for missing power data","volume":"10","year":"2017","journal-title":"Energies"},{"issue":"1","key":"key2022092811512887300_ref054","doi-asserted-by":"publisher","first-page":"492","DOI":"10.1186\/s12859-019-3110-0","article-title":"Random forest-based imputation outperforms other methods for imputing LC-MS metabolomics data: a comparative study","volume":"20","year":"2019","journal-title":"BMC Bioinformatics"},{"key":"key2022092811512887300_ref055","doi-asserted-by":"publisher","first-page":"138","DOI":"10.1007\/978-3-030-29374-1_12","article-title":"A spatio-temporal data imputation model for supporting analytics at the edge","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 11701 LNCS","year":"2019"},{"issue":"8","key":"key2022092811512887300_ref056","doi-asserted-by":"publisher","first-page":"2615","DOI":"10.1007\/s11269-019-02209-8","article-title":"A study on Bayesian principal component analysis for addressing missing rainfall data","volume":"33","year":"2019","journal-title":"Water Resources Management"},{"key":"key2022092811512887300_ref057","doi-asserted-by":"publisher","first-page":"223","DOI":"10.1007\/978-3-030-22796-8_24","article-title":"Imputation using a correlation-enhanced auto-associative neural network with dynamic processing of missing values","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 11554 LNCS","year":"2019"},{"issue":"3","key":"key2022092811512887300_ref058","doi-asserted-by":"publisher","first-page":"259","DOI":"10.1023\/A:1008334909089","article-title":"Imputation of missing data in industrial databases","volume":"11","year":"1999","journal-title":"Applied Intelligence"},{"issue":"4","key":"key2022092811512887300_ref059","doi-asserted-by":"publisher","first-page":"1283","DOI":"10.1007\/s00362-018-1043-8","article-title":"Block tensor train decomposition for missing data estimation","volume":"59","year":"2018","journal-title":"Statistical Papers"},{"issue":"12","key":"key2022092811512887300_ref060","doi-asserted-by":"publisher","DOI":"10.1007\/s11306-018-1451-8","article-title":"NS-kNN: a modified k-nearest neighbors approach for imputing metabolomics data","volume":"14","year":"2018","journal-title":"Metabolomics"},{"key":"key2022092811512887300_ref061","doi-asserted-by":"publisher","first-page":"259","DOI":"10.1007\/978-3-319-41000-5_26","article-title":"Missing data estimation in high-dimensional datasets: a swarm intelligence-deep neural network approach","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 9712 LNCS","year":"2016"},{"key":"key2022092811512887300_ref062","doi-asserted-by":"publisher","first-page":"103","DOI":"10.1007\/978-3-030-01180-2_7","volume-title":"Missing Data Estimation Using Ant-Lion Optimizer Algorithm","year":"2019"},{"key":"key2022092811512887300_ref063","doi-asserted-by":"publisher","first-page":"41","DOI":"10.1007\/978-3-030-01180-2_3","volume-title":"Missing Data Estimation Using Bat Algorithm","year":"2019"},{"key":"key2022092811512887300_ref064","doi-asserted-by":"publisher","first-page":"57","DOI":"10.1007\/978-3-030-01180-2_4","volume-title":"Missing Data Estimation Using Cuckoo Search Algorithm","year":"2019"},{"key":"key2022092811512887300_ref065","doi-asserted-by":"publisher","first-page":"115","DOI":"10.1007\/978-3-030-01180-2_8","volume-title":"Missing Data Estimation Using Invasive Weed Optimization Algorithm","year":"2019"},{"key":"key2022092811512887300_ref066","doi-asserted-by":"publisher","first-page":"561","DOI":"10.1007\/978-3-319-61824-1_61","article-title":"A deep learning-cuckoo search method for missing data estimation in high-dimensional datasets","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 10385 LNCS","year":"2017"},{"key":"key2022092811512887300_ref067","doi-asserted-by":"publisher","first-page":"297","DOI":"10.1109\/BIBM.2014.6999172","article-title":"Semi-supervised imputation for microarray missing value estimation","year":"2014"},{"issue":"9","key":"key2022092811512887300_ref068","doi-asserted-by":"publisher","DOI":"10.1186\/1471-2164-16-S9-S1","article-title":"A hybrid imputation approach for microarray missing value estimation","volume":"16","year":"2015","journal-title":"BMC Genomics"},{"issue":"8","key":"key2022092811512887300_ref069","doi-asserted-by":"publisher","first-page":"2933","DOI":"10.1109\/TITS.2018.2869768","article-title":"Missing value imputation for traffic-related time series data based on a multi-view learning method","volume":"20","year":"2019","journal-title":"IEEE Transactions on Intelligent Transportation Systems"},{"key":"key2022092811512887300_ref070","doi-asserted-by":"publisher","first-page":"111","DOI":"10.1186\/s12918-018-0630-6","article-title":"A multiple kernel density clustering algorithm for incomplete datasets in bioinformatics","volume":"12","year":"2018","journal-title":"BMC Systems Biology"},{"issue":"2","key":"key2022092811512887300_ref071","doi-asserted-by":"publisher","first-page":"1487","DOI":"10.1007\/s10462-019-09709-4","article-title":"Missing value imputation: a review and analysis of the literature (2006\u20132017)","volume":"53","year":"2020","journal-title":"Artificial Intelligence Review"},{"issue":"3","key":"key2022092811512887300_ref072","doi-asserted-by":"publisher","first-page":"860","DOI":"10.1007\/s10489-019-01560-y","article-title":"Data-driven missing data imputation in cluster monitoring system based on deep neural network","volume":"50","year":"2020","journal-title":"Applied Intelligence"},{"key":"key2022092811512887300_ref073","unstructured":"Lingard, H.C. and Rowlinson, S. (2006), \u201cThe importance of sample size when using factor analysis in construction management research\u201d, available at: https:\/\/www.researchgate.net\/publication\/238622991."},{"issue":"1","key":"key2022092811512887300_ref074","doi-asserted-by":"publisher","first-page":"8","DOI":"10.3390\/data2010008","article-title":"An overview and evaluation of recent machine learning imputation methods using cardiac imaging data","volume":"2","year":"2017","journal-title":"Data"},{"key":"key2022092811512887300_ref075","doi-asserted-by":"publisher","first-page":"486","DOI":"10.1007\/978-3-030-29516-5_38","article-title":"A hierarchical missing value imputation method by correlation-based K-nearest neighbors","volume-title":"Advances in Intelligent Systems and Computing","year":"2020"},{"key":"key2022092811512887300_ref076","doi-asserted-by":"publisher","first-page":"52930","DOI":"10.1109\/ACCESS.2018.2868729","article-title":"An imputation method for missing data based on an extreme learning machine auto-encoder","volume":"6","year":"2018","journal-title":"IEEE Access"},{"key":"key2022092811512887300_ref077","doi-asserted-by":"publisher","first-page":"239","DOI":"10.1007\/978-3-662-45261-5_25","article-title":"Affinity Propagation clustering with incomplete data","volume":"462","year":"2014","journal-title":"Communications in Computer and Information Science"},{"key":"key2022092811512887300_ref078","doi-asserted-by":"publisher","article-title":"A novel index measure imputation algorithm for missing data values: a machine learning approach","year":"2012","DOI":"10.1109\/ICCIC.2012.6510198"},{"key":"key2022092811512887300_ref079","doi-asserted-by":"publisher","first-page":"173","DOI":"10.1109\/ICSSIT46314.2019.8987895","article-title":"A novel algorithm for missing data imputation on machine learning","year":"2019"},{"issue":"2","key":"key2022092811512887300_ref080","doi-asserted-by":"publisher","first-page":"513","DOI":"10.1007\/s41237-017-0024-x","article-title":"A note on large-scale logistic prediction: using an approximate graphical model to deal with collinearity and missing data","volume":"44","year":"2017","journal-title":"Behaviormetrika"},{"key":"key2022092811512887300_ref081","doi-asserted-by":"publisher","first-page":"108","DOI":"10.1007\/978-3-319-53480-0_11","article-title":"Radial basis function neural networks for datasets with missing values","volume-title":"Advances in Intelligent Systems and Computing","year":"2017"},{"issue":"3","key":"key2022092811512887300_ref082","doi-asserted-by":"publisher","first-page":"2345","DOI":"10.1007\/s11063-019-10012-0","article-title":"Artificial neural networks with random weights for incomplete datasets","volume":"50","year":"2019","journal-title":"Neural Processing Letters"},{"key":"key2022092811512887300_ref083","volume-title":"Missing Data Imputation in Dynamic Environments Saif Eddin Ayari","author":"Missing Data Imputation In Dynamic Environments Saif Eddin Ayari","year":"2018"},{"issue":"12","key":"key2022092811512887300_ref084","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1002\/ecj.11449","article-title":"A missing value imputation method using a Bayesian network with weighted learning","volume":"95","year":"2012","journal-title":"Electronics and Communications in Japan"},{"issue":"1","key":"key2022092811512887300_ref085","doi-asserted-by":"publisher","first-page":"18","DOI":"10.2174\/1574893608999140109120957","article-title":"A review on missing value imputation algorithms for microarray gene expression data","volume":"9","year":"2014","journal-title":"Current Bioinformatics"},{"key":"key2022092811512887300_ref086","doi-asserted-by":"publisher","first-page":"171","DOI":"10.1007\/978-981-10-2471-9_17","article-title":"Correlated cluster-based imputation for treatment of missing values","volume-title":"Advances in Intelligent Systems and Computing","year":"2017"},{"issue":"3","key":"key2022092811512887300_ref087","doi-asserted-by":"publisher","first-page":"8070","DOI":"10.35940\/ijrte.C6435.098319","article-title":"Missing data imputation in high dimensional data set using local similarity","volume":"8","year":"2019","journal-title":"International Journal of Recent Technology and Engineering"},{"key":"key2022092811512887300_ref088","doi-asserted-by":"publisher","first-page":"165","DOI":"10.1007\/978-1-84882-983-1_12","article-title":"A kernel extension to handle missing data","volume-title":"Research and Development in Intelligent Systems XXVI","year":"2010"},{"issue":"1","key":"key2022092811512887300_ref089","doi-asserted-by":"publisher","first-page":"211","DOI":"10.1007\/s00362-015-0694-y","article-title":"A kernel PLS based classification method with missing data handling","volume":"58","year":"2017","journal-title":"Statistical Papers"},{"key":"key2022092811512887300_ref090","doi-asserted-by":"publisher","first-page":"135","DOI":"10.1007\/978-981-13-6661-1_11","article-title":"A hybrid missing data imputation method for constructing city mobility indices","volume":"996","year":"2019","journal-title":"Communications in Computer and Information Science"},{"issue":"6","key":"key2022092811512887300_ref091","doi-asserted-by":"publisher","first-page":"2419","DOI":"10.1007\/s10115-019-01427-1","article-title":"Missing data imputation using decision trees and fuzzy clustering with iterative learning","volume":"62","year":"2020","journal-title":"Knowledge and Information Systems"},{"key":"key2022092811512887300_ref092","doi-asserted-by":"publisher","first-page":"214","DOI":"10.1109\/ICCKE48569.2019.8964808","article-title":"A genetic asexual reproduction optimization algorithm for imputing missing values","year":"2019"},{"issue":"3","key":"key2022092811512887300_ref093","doi-asserted-by":"publisher","first-page":"614","DOI":"10.1007\/s10489-015-0666-x","article-title":"Missing data imputation by K nearest neighbours based on grey relational structure and mutual information","volume":"43","year":"2015","journal-title":"Applied Intelligence"},{"key":"key2022092811512887300_ref094","doi-asserted-by":"publisher","first-page":"600","DOI":"10.1007\/978-3-642-14834-7_56","article-title":"Missing value imputation based on k-mean clustering with weighted distance","volume":"94","year":"2010","journal-title":"Communications in Computer and Information Science"},{"issue":"2","key":"key2022092811512887300_ref095","doi-asserted-by":"publisher","first-page":"573","DOI":"10.1111\/j.1540-6237.2007.00472.x","article-title":"Estimating missing values from the general social survey: an application of multiple imputation","volume":"88","year":"2007","journal-title":"Social Science Quarterly"},{"key":"key2022092811512887300_ref096","doi-asserted-by":"publisher","first-page":"26","DOI":"10.1007\/978-3-030-13709-0_3","article-title":"Feature based multivariate data imputation","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 11331 LNCS","year":"2019"},{"issue":"3","key":"key2022092811512887300_ref097","doi-asserted-by":"publisher","first-page":"431","DOI":"10.1515\/jisys-2014-0172","article-title":"DBSCANI: noise-resistant method for missing value imputation","volume":"25","year":"2016","journal-title":"Journal of Intelligent Systems"},{"key":"key2022092811512887300_ref098","doi-asserted-by":"publisher","first-page":"152","DOI":"10.1007\/978-3-030-04167-0_14","article-title":"Data imputation of wind turbine using generative adversarial nets with deep learning models","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 11301 LNCS","year":"2018"},{"key":"key2022092811512887300_ref099","doi-asserted-by":"publisher","first-page":"51","DOI":"10.1016\/j.knosys.2013.08.023","article-title":"Missing value imputation using decision trees and decision forests by splitting and merging records: two novel techniques","volume":"53","year":"2013","journal-title":"Knowledge-Based Systems"},{"key":"key2022092811512887300_ref100","doi-asserted-by":"publisher","first-page":"119","DOI":"10.1007\/978-981-10-3274-5_10","article-title":"Soft clustering based missing value imputation","volume":"679","year":"2016","journal-title":"Communications in Computer and Information Science"},{"issue":"6","key":"key2022092811512887300_ref101","doi-asserted-by":"publisher","first-page":"4361","DOI":"10.1007\/s00500-019-04199-6","article-title":"Missing value imputation using unsupervised machine learning techniques","volume":"24","year":"2020","journal-title":"Soft Computing"},{"issue":"14","key":"key2022092811512887300_ref102","doi-asserted-by":"publisher","first-page":"10033","DOI":"10.1007\/s00521-019-04535-9","article-title":"A novel fuzzy rough clustering parameter-based missing value imputation","volume":"32","year":"2020","journal-title":"Neural Computing and Applications"},{"key":"key2022092811512887300_ref103","doi-asserted-by":"publisher","first-page":"1834","DOI":"10.1109\/FUZZ-IEEE.2016.7737913","article-title":"Imputation of missing data using fuzzy neighborhood density-based clustering","year":"2016"},{"key":"key2022092811512887300_ref104","doi-asserted-by":"publisher","first-page":"104805","DOI":"10.1016\/j.knosys.2019.06.013","article-title":"Similarity-learning information-fusion schemes for missing data imputation","volume":"187","year":"2020","journal-title":"Knowledge-Based Systems"},{"issue":"6","key":"key2022092811512887300_ref105","doi-asserted-by":"publisher","first-page":"1349","DOI":"10.1007\/s00521-011-0574-x","article-title":"Fuzzy min-max neural networks for categorical data: application to missing data imputation","volume":"21","year":"2012","journal-title":"Neural Computing and Applications"},{"issue":"3","key":"key2022092811512887300_ref106","doi-asserted-by":"publisher","DOI":"10.1093\/biomet\/63.3.581","article-title":"Inference and missing data","volume":"63","year":"1976","journal-title":"Biometrika"},{"key":"key2022092811512887300_ref107","doi-asserted-by":"publisher","first-page":"143","DOI":"10.1007\/978-3-319-43742-2_13","article-title":"Missing data","volume-title":"Secondary Analysis of Electronic Health Records","year":"2016"},{"key":"key2022092811512887300_ref108","doi-asserted-by":"publisher","first-page":"91","DOI":"10.1007\/978-3-319-51281-5_10","article-title":"A study of data imputation using fuzzy c-means with particle swarm optimization","volume-title":"Advances in Intelligent Systems and Computing, 549 AISC","year":"2017"},{"issue":"4","key":"key2022092811512887300_ref109","doi-asserted-by":"publisher","DOI":"10.3390\/ijgi9040227","article-title":"Missing data imputation for geolocation-based price prediction using KNN-MCF method","volume":"9","year":"2020","journal-title":"ISPRS International Journal of Geo-Information"},{"issue":"2","key":"key2022092811512887300_ref110","doi-asserted-by":"publisher","first-page":"147","DOI":"10.1037\/1082-989X.7.2.147","article-title":"Missing data: our view of the state of the art","volume":"7","year":"2002","journal-title":"Psychological Methods"},{"key":"key2022092811512887300_ref111","doi-asserted-by":"publisher","first-page":"68","DOI":"10.1016\/j.eswa.2018.07.057","article-title":"Missing value imputation using a novel grey based fuzzy c-means, mutual information based feature selection, and regression model","volume":"115","year":"2019","journal-title":"Expert Systems with Applications"},{"issue":"1","key":"key2022092811512887300_ref112","doi-asserted-by":"publisher","DOI":"10.1186\/s12859-017-1547-6","article-title":"Distribution based nearest neighbor imputation for truncated high dimensional data with applications to pre-clinical and clinical metabolomics studies","volume":"18","year":"2017","journal-title":"BMC Bioinformatics"},{"key":"key2022092811512887300_ref113","doi-asserted-by":"publisher","first-page":"551","DOI":"10.1007\/978-3-030-00018-9_48","article-title":"Power missing data filling based on improved k-means algorithm and RBF neural network","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 11067 LNCS","year":"2018"},{"key":"key2022092811512887300_ref114","doi-asserted-by":"publisher","first-page":"53","DOI":"10.1007\/978-981-13-1927-3_6","article-title":"Imputation of multivariate attribute values in big data","volume":"105","year":"2019","journal-title":"Smart Innovation, Systems and Technologies"},{"key":"key2022092811512887300_ref115","doi-asserted-by":"publisher","first-page":"440","DOI":"10.1016\/j.compag.2017.09.033","article-title":"Kriging-based approach to predict missing air temperature data","volume":"142","year":"2017","journal-title":"Computers and Electronics in Agriculture"},{"issue":"1","key":"key2022092811512887300_ref116","doi-asserted-by":"publisher","first-page":"121","DOI":"10.1016\/j.neunet.2010.09.008","article-title":"Missing value imputation on missing completely at random data using multilayer perceptrons","volume":"24","year":"2011","journal-title":"Neural Networks"},{"key":"key2022092811512887300_ref117","doi-asserted-by":"publisher","first-page":"61","DOI":"10.1007\/978-81-322-2550-8_7","article-title":"Missing value imputation with unsupervised kohonen self organizing map","volume-title":"Emerging Research in Computing, Information, Communication and Applications","year":"2015"},{"key":"key2022092811512887300_ref118","article-title":"Missing data: the hidden problem","volume-title":"Draw More Valid Conclusion with SPSS Missing Data Analysis","author":"SPSS","year":"2004"},{"issue":"1","key":"key2022092811512887300_ref119","doi-asserted-by":"publisher","first-page":"112","DOI":"10.1093\/bioinformatics\/btr597","article-title":"Missforest-non-parametric missing value imputation for mixed-type data","volume":"28","year":"2012","journal-title":"Bioinformatics"},{"issue":"4","key":"key2022092811512887300_ref120","doi-asserted-by":"publisher","DOI":"10.3390\/en13040982","article-title":"Energetic map data imputation: a machine learning approach","volume":"13","year":"2020","journal-title":"Energies"},{"key":"key2022092811512887300_ref121","doi-asserted-by":"publisher","first-page":"215","DOI":"10.1007\/978-3-030-35288-2_18","article-title":"Sharpening the BLADE: missing data imputation using supervised machine learning","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 11919 LNAI","year":"2019"},{"issue":"11","key":"key2022092811512887300_ref122","doi-asserted-by":"publisher","first-page":"2009","DOI":"10.1080\/02626667.2013.862334","article-title":"Estimation des donn\u00e9es manquantes des pr\u00e9cipitations en utilisant la proximit\u00e9 optimale d'imputation m\u00e9trique base, la classification du plus proche voisin et m\u00e9thodes d'interpolation \u00e0 base de cluster","volume":"59","year":"2014","journal-title":"Hydrological Sciences Journal"},{"key":"key2022092811512887300_ref123","doi-asserted-by":"publisher","first-page":"471","DOI":"10.1007\/978-3-319-55849-3_31","article-title":"Bagging and feature selection for classification with incomplete data","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 10199 LNCS","year":"2017"},{"key":"key2022092811512887300_ref124","doi-asserted-by":"publisher","first-page":"577","DOI":"10.1007\/978-3-030-03991-2_53","article-title":"Genetic programming with interval functions and ensemble learning for classification with incomplete data","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 11320 LNAI","year":"2018"},{"key":"key2022092811512887300_ref125","doi-asserted-by":"publisher","first-page":"310","DOI":"10.1007\/978-3-319-25783-9_28","article-title":"An ensemble learning approach based on missing-valued tables","volume-title":"Lecture Notes in Computer Science (Including Subseries Lecture Notes in Artificial Intelligence and Lecture Notes in Bioinformatics), 9437","year":"2015"},{"key":"key2022092811512887300_ref126","doi-asserted-by":"publisher","DOI":"10.1201\/b11826","article-title":"Flexible imputation of missing data","volume-title":"Flexible Imputation of Missing Data","year":"2012"},{"key":"key2022092811512887300_ref127","doi-asserted-by":"publisher","first-page":"175","DOI":"10.1007\/978-3-319-40581-0_15","article-title":"An incremental algorithm for repairing training sets with missing values","volume":"611","year":"2016","journal-title":"Communications in Computer and Information Science"},{"key":"key2022092811512887300_ref128","volume-title":"Missing Value Imputation Using Subspace Methods with Applications on Survey Data Title of Thesis Missing Value Imputation Using Subspace Methods with Applications on Survey Data","year":"2012"},{"issue":"1","key":"key2022092811512887300_ref129","doi-asserted-by":"publisher","first-page":"60","DOI":"10.1016\/j.neucom.2014.02.061","article-title":"Self-organization and missing values in SOM and GTM","volume":"147","year":"2015","journal-title":"Neurocomputing"},{"issue":"6","key":"key2022092811512887300_ref130","doi-asserted-by":"publisher","first-page":"945","DOI":"10.1080\/10543400903238959","article-title":"Addressing and advancing the problem of missing data","volume":"19","year":"2009","journal-title":"Journal of Biopharmaceutical Statistics"},{"issue":"1","key":"key2022092811512887300_ref131","doi-asserted-by":"publisher","DOI":"10.1186\/s12859-015-0770-2","article-title":"Whole genome SNP genotype piecemeal imputation","volume":"16","year":"2015","journal-title":"BMC Bioinformatics"},{"key":"key2022092811512887300_ref132","first-page":"11526","article-title":"Doubly robust joint learning for recommendation on data missing not at random","year":"2019"},{"issue":"1","key":"key2022092811512887300_ref133","doi-asserted-by":"publisher","DOI":"10.1007\/s13755-019-0082-4","article-title":"Imputation techniques on missing values in breast cancer treatment and fertility data","volume":"7","year":"2019","journal-title":"Health Information Science and Systems"},{"issue":"4","key":"key2022092811512887300_ref134","doi-asserted-by":"publisher","first-page":"365","DOI":"10.1007\/s41666-020-00076-2","article-title":"A multi-directional approach for missing value estimation in multivariate time series clinical data","volume":"4","year":"2020","journal-title":"Journal of Healthcare Informatics Research"},{"key":"key2022092811512887300_ref135","doi-asserted-by":"publisher","first-page":"159","DOI":"10.2991\/978-94-91216-80-0_9","volume-title":"A Data Imputation Method With Support Vector Machines for Activity-Based Transportation Models","year":"2013"},{"key":"key2022092811512887300_ref136","doi-asserted-by":"publisher","DOI":"10.1186\/s12918-018-0638-y","article-title":"MISC: missing imputation for single-cell RNA sequencing data","volume":"12","year":"2018","journal-title":"BMC Systems Biology"},{"issue":"1","key":"key2022092811512887300_ref137","doi-asserted-by":"publisher","first-page":"123","DOI":"10.1007\/s10489-009-0207-6","article-title":"Shell-neighbor method and its application in missing data imputation","volume":"35","year":"2011","journal-title":"Applied Intelligence"},{"issue":"8","key":"key2022092811512887300_ref138","doi-asserted-by":"publisher","first-page":"16","DOI":"10.1007\/s13131-013-0337-x","article-title":"Robust LS-SVM regression for ore grade estimation in a seafloor hydrothermal sulphide deposit","volume":"32","year":"2013","journal-title":"Acta Oceanologica Sinica"},{"key":"key2022092811512887300_ref139","unstructured":"Zhang, H., Xie, P. and Xing, E. (2018), \u201cMissing value imputation based on deep generative models\u201d, available at: http:\/\/arxiv.org\/abs\/1808.01684."},{"issue":"1","key":"key2022092811512887300_ref140","doi-asserted-by":"publisher","first-page":"69","DOI":"10.1007\/s10614-016-9581-4","article-title":"AdaBoost models for corporate bankruptcy prediction with missing data","volume":"50","year":"2017","journal-title":"Computational Economics"}],"container-title":["Data Technologies and Applications"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/www.emerald.com\/insight\/content\/doi\/10.1108\/DTA-12-2020-0298\/full\/xml","content-type":"application\/xml","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/www.emerald.com\/insight\/content\/doi\/10.1108\/DTA-12-2020-0298\/full\/html","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,7,24]],"date-time":"2025-07-24T23:15:31Z","timestamp":1753398931000},"score":1,"resource":{"primary":{"URL":"http:\/\/www.emerald.com\/dta\/article\/55\/4\/558-585\/87100"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2021,4,2]]},"references-count":140,"journal-issue":{"issue":"4","published-online":{"date-parts":[[2021,4,2]]},"published-print":{"date-parts":[[2021,8,5]]}},"alternative-id":["10.1108\/DTA-12-2020-0298"],"URL":"https:\/\/doi.org\/10.1108\/dta-12-2020-0298","relation":{},"ISSN":["2514-9288"],"issn-type":[{"value":"2514-9288","type":"print"}],"subject":[],"published":{"date-parts":[[2021,4,2]]}}}