{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,4,8]],"date-time":"2026-04-08T20:31:00Z","timestamp":1775680260188,"version":"3.50.1"},"reference-count":35,"publisher":"Springer Science and Business Media LLC","issue":"1","license":[{"start":{"date-parts":[[2016,10,3]],"date-time":"2016-10-03T00:00:00Z","timestamp":1475452800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0"},{"start":{"date-parts":[[2016,10,3]],"date-time":"2016-10-03T00:00:00Z","timestamp":1475452800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["BMC Bioinformatics"],"abstract":"<jats:title>Abstract<\/jats:title>\n                  <jats:sec>\n                    <jats:title>Background<\/jats:title>\n                    <jats:p>\n                      In omics data integration studies, it is common, for a variety of reasons, for some individuals to not be present in all data tables. Missing row values are challenging to deal with because most statistical methods cannot be directly applied to incomplete datasets. To overcome this issue, we propose a multiple imputation (MI) approach in a multivariate framework. In this study, we focus on multiple factor analysis (MFA) as a tool to compare and integrate multiple layers of information. MI involves filling the missing rows with plausible values, resulting in\n                      <jats:italic>M<\/jats:italic>\n                      completed datasets. MFA is then applied to each completed dataset to produce\n                      <jats:italic>M<\/jats:italic>\n                      different configurations (the matrices of coordinates of individuals). Finally, the\n                      <jats:italic>M<\/jats:italic>\n                      configurations are combined to yield a single consensus solution.\n                    <\/jats:p>\n                  <\/jats:sec>\n                  <jats:sec>\n                    <jats:title>Results<\/jats:title>\n                    <jats:p>We assessed the performance of our method, named MI-MFA, on two real omics datasets. Incomplete artificial datasets with different patterns of missingness were created from these data. The MI-MFA results were compared with two other approaches i.e., regularized iterative MFA (RI-MFA) and mean variable imputation (MVI-MFA). For each configuration resulting from these three strategies, the suitability of the solution was determined against the true MFA configuration obtained from the original data and a comprehensive graphical comparison showing how the MI-, RI- or MVI-MFA configurations diverge from the true configuration was produced. Two approaches i.e., confidence ellipses and convex hulls, to visualize and assess the uncertainty due to missing values were also described. We showed how the areas of ellipses and convex hulls increased with the number of missing individuals. A free and easy-to-use code was proposed to implement the MI-MFA method in the R statistical environment.<\/jats:p>\n                  <\/jats:sec>\n                  <jats:sec>\n                    <jats:title>Conclusions<\/jats:title>\n                    <jats:p>We believe that MI-MFA provides a useful and attractive method for estimating the coordinates of individuals on the first MFA components despite missing rows. MI-MFA configurations were close to the true configuration even when many individuals were missing in several data tables. This method takes into account the uncertainty of MI-MFA configurations induced by the missing rows, thereby allowing the reliability of the results to be evaluated.<\/jats:p>\n                  <\/jats:sec>","DOI":"10.1186\/s12859-016-1273-5","type":"journal-article","created":{"date-parts":[[2016,10,3]],"date-time":"2016-10-03T07:10:42Z","timestamp":1475478642000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":62,"title":["Handling missing rows in multi-omics data integration: multiple imputation in multiple factor analysis framework"],"prefix":"10.1186","volume":"17","author":[{"given":"Valentin","family":"Voillet","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Philippe","family":"Besse","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Laurence","family":"Liaubet","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Magali","family":"San Cristobal","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-3432-6909","authenticated-orcid":false,"given":"Ignacio","family":"Gonz\u00e1lez","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2016,10,3]]},"reference":[{"issue":"Suppl 2","key":"1273_CR1","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1186\/1752-0509-8-S2-I1","volume":"8","author":"D Gomez-Cabrero","year":"2014","unstructured":"Gomez-Cabrero D, Abugessaisa I, Maier D, Teschendorff A, Merkenschlager M, Gisel A, Ballestar E, Bongcam-Rudloff E, Conesa A, Tegner J. Data integration in the era of omics: Current and future challenges. BMC Syst Biol. 2014; 8(Suppl 2):1.","journal-title":"BMC Syst Biol"},{"issue":"4","key":"1273_CR2","doi-asserted-by":"publisher","first-page":"353","DOI":"10.1076\/edre.7.4.353.8937","volume":"7","author":"TD Pigott","year":"2001","unstructured":"Pigott TD. A review of methods for missing data. Educ Res Eval. 2001; 7(4):353\u201383.","journal-title":"Educ Res Eval"},{"key":"1273_CR3","volume-title":"Multiple Imputation for Non-Response in Surveys","author":"DB Rubin","year":"2004","unstructured":"Rubin DB. Multiple Imputation for Non-Response in Surveys. Hoboken: Wiley-Interscience; 2004."},{"key":"1273_CR4","doi-asserted-by":"publisher","first-page":"592","DOI":"10.1016\/j.tree.2008.06.014","volume":"23","author":"S Nakagawa","year":"2008","unstructured":"Nakagawa S, Freckleton RP. Missing inaction: the dangers of ignoring missing data. Trends Ecol Evol. 2008; 23:592\u20136.","journal-title":"Trends Ecol Evol"},{"key":"1273_CR5","doi-asserted-by":"publisher","DOI":"10.1002\/9781119013563","volume-title":"Statistical Analysis with Missing Data","author":"RJA Little","year":"2002","unstructured":"Little RJA, Rubin DB. Statistical Analysis with Missing Data, 2nd edn. Hoboken: Wiley; 2002."},{"issue":"2","key":"1273_CR6","doi-asserted-by":"publisher","first-page":"323","DOI":"10.1007\/s11336-004-1168-9","volume":"71","author":"M van de Velden","year":"2006","unstructured":"van de Velden M, Bijmolt THA. Generalized canonical correlation analysis of matrices with missing rows: a simulation study. Psychometrika. 2006; 71(2):323\u201331.","journal-title":"Psychometrika"},{"issue":"02","key":"1273_CR7","doi-asserted-by":"publisher","first-page":"173","DOI":"10.1142\/S0218339009002831","volume":"17","author":"I Gonz\u00e1lez","year":"2009","unstructured":"Gonz\u00e1lez I, D\u00e9jean S, Martin PGP, Gon\u00e7alves O, Besse P, Baccini A. Highlighting relationships between heterogeneous biological data through graphical displays based on regularized canonical correlation analysis. J Biol Syst. 2009; 17(02):173\u201399.","journal-title":"J Biol Syst"},{"issue":"2","key":"1273_CR8","doi-asserted-by":"publisher","first-page":"391","DOI":"10.1016\/j.ejor.2014.01.008","volume":"238","author":"A Tenenhaus","year":"2014","unstructured":"Tenenhaus A, Tenenhaus M. Regularized generalized canonical correlation analysis for multiblock or multigroup data analysis. Eur J Oper Res. 2014; 238(2):391\u2013403.","journal-title":"Eur J Oper Res"},{"issue":"2","key":"1273_CR9","doi-asserted-by":"publisher","first-page":"77","DOI":"10.1016\/j.foodqual.2013.04.013","volume":"30","author":"F Husson","year":"2013","unstructured":"Husson F, Josse J. Handling missing values in multiple factor analysis. Food Qual Prefer. 2013; 30(2):77\u201385.","journal-title":"Food Qual Prefer"},{"issue":"3","key":"1273_CR10","doi-asserted-by":"publisher","first-page":"231","DOI":"10.1007\/s11634-011-0086-7","volume":"5","author":"J Josse","year":"2011","unstructured":"Josse J, Pag\u00e8s J, Husson F. Multiple imputation in principal component analysis. Adv Data Anal Classif. 2011; 5(3):231\u201346.","journal-title":"Adv Data Anal Classif"},{"issue":"2","key":"1273_CR11","first-page":"79","volume":"153","author":"J Josse","year":"2012","unstructured":"Josse J, Husson F. Missing values in exploratory multivariate data analysis methods. Journal de la SFdS. 2012; 153(2):79\u201399.","journal-title":"Journal de la SFdS"},{"key":"1273_CR12","doi-asserted-by":"publisher","DOI":"10.1201\/9781439821862","volume-title":"Analysis of Incomplete Multivariate Data","author":"JL Schafer","year":"1997","unstructured":"Schafer JL. Analysis of Incomplete Multivariate Data, 1st edn. Chapman & Hall: CRC Press, Taylor & Francis Group; 1997."},{"issue":"12","key":"1273_CR13","doi-asserted-by":"publisher","first-page":"1049","DOI":"10.1080\/10629360600810434","volume":"76","author":"S van Buuren","year":"2006","unstructured":"van Buuren S, Brand JPL, Groothuis-Oudshoorn CGM, Rubin DB. Fully conditional specification in multivariate imputation. J Stat Comput Simul. 2006; 76(12):1049\u201364.","journal-title":"J Stat Comput Simul"},{"key":"1273_CR14","doi-asserted-by":"publisher","first-page":"219","DOI":"10.1177\/0962280206074463","volume":"16","author":"S van Buuren","year":"2007","unstructured":"van Buuren S. Multiple imputation of discrete and continuous data by fully conditional specification. Stat Methods Med Res. 2007; 16:219\u201342.","journal-title":"Stat Methods Med Res"},{"key":"1273_CR15","doi-asserted-by":"publisher","first-page":"581","DOI":"10.1093\/biomet\/63.3.581","volume":"63","author":"DB Rubin","year":"1976","unstructured":"Rubin DB. Inference and missing data. Biometrika. 1976; 63:581\u201392.","journal-title":"Biometrika"},{"issue":"1","key":"1273_CR16","doi-asserted-by":"publisher","first-page":"121","DOI":"10.1016\/0167-9473(94)90135-X","volume":"18","author":"B Escofier","year":"1994","unstructured":"Escofier B, Pag\u00e8s J. Multiple factor analysis (AFMULT package). Comput Stat Data Anal. 1994; 18(1):121\u201340.","journal-title":"Comput Stat Data Anal"},{"key":"1273_CR17","first-page":"1","volume":"12","author":"G Kalton","year":"1986","unstructured":"Kalton G, Kasprzyk D. The treatment of missing survey data. Survey Methodol. 1986; 12:1\u201316.","journal-title":"Survey Methodol"},{"issue":"1","key":"1273_CR18","doi-asserted-by":"publisher","first-page":"40","DOI":"10.1111\/j.1751-5823.2010.00103.x","volume":"78","author":"RR Andridge","year":"2010","unstructured":"Andridge RR, Little RJA. A review of hot deck imputation for survey non-response. Int Stat Rev. 2010; 78(1):40\u201364.","journal-title":"Int Stat Rev"},{"issue":"02","key":"1273_CR19","doi-asserted-by":"publisher","first-page":"425","DOI":"10.1017\/S0007123412000312","volume":"43","author":"SJ Cranmer","year":"2013","unstructured":"Cranmer SJ, Gill J. We have to be discrete about this: A non-parametric imputation technique for missing categorical data. British J Polit Sci. 2013; 43(02):425\u201349.","journal-title":"British J Polit Sci"},{"issue":"3","key":"1273_CR20","first-page":"307","volume":"42","author":"M Reilly","year":"1993","unstructured":"Reilly M. Data analysis using hot deck multiple imputation. J Royal Stat Soc. 1993; 42(3):307\u201313.","journal-title":"J Royal Stat Soc"},{"key":"1273_CR21","doi-asserted-by":"crossref","unstructured":"Milan L, Whittaker J. Application of the parametric bootstrap to models that incorporate a singular value decomposition. J Royal Stat Soc; 44(1):31\u201349. 1995.","DOI":"10.2307\/2986193"},{"issue":"1","key":"1273_CR22","doi-asserted-by":"publisher","first-page":"97","DOI":"10.1016\/0167-9473(94)90134-1","volume":"18","author":"C Lavit","year":"1994","unstructured":"Lavit C, Escoufier Y, Sabatier R, Traissac P. The ACT (STATIS method). Comput Stat Data Anal. 1994; 18(1):97\u2013119.","journal-title":"Comput Stat Data Anal"},{"issue":"3","key":"1273_CR23","first-page":"257","volume":"25","author":"P Robert","year":"1976","unstructured":"Robert P, Escoufier Y. A unifying tool for linear multivariate statistical methods: The RV coefficient. J Royal Stat Soc. 1976; 25(3):257\u201365.","journal-title":"J Royal Stat Soc"},{"key":"1273_CR24","volume-title":"R: A Language and Environment for Statistical Computing","author":"RC Team","year":"2015","unstructured":"Team RC. R: A Language and Environment for Statistical Computing. Vienna: R Foundation for Statistical Computing; 2015. R Foundation for Statistical Computing."},{"issue":"1","key":"1273_CR25","doi-asserted-by":"publisher","first-page":"1","DOI":"10.18637\/jss.v025.i01","volume":"25","author":"S L\u00ea","year":"2008","unstructured":"L\u00ea S, Josse J, Husson F. FactoMineR: An R package for multivariate analysis. J Stat Softw. 2008; 25(1):1\u201318.","journal-title":"J Stat Softw"},{"issue":"2","key":"1273_CR26","first-page":"47","volume":"7","author":"S Dray","year":"2007","unstructured":"Dray S, Dufour AB, Chessel D. The ade4 package-II: Two-table and K-table methods. R News. 2007; 7(2):47\u201352.","journal-title":"R News"},{"key":"1273_CR27","unstructured":"Husson F, Josse J. missMDA: Handling Missing Values With\/in Multivariate Data Analysis (Principal Component Methods). 2014. R package version 1.7.3. https:\/\/CRAN.r-project.org\/web\/packages\/missMDA\/missMDA.pdf."},{"issue":"2","key":"1273_CR28","doi-asserted-by":"crossref","first-page":"285","DOI":"10.1111\/j.2517-6161.1991.tb01825.x","volume":"53","author":"C Goodall","year":"1991","unstructured":"Goodall C. Procrustes methods in the statistical analysis of shape. J Royal Stat Soc Series B (Methodol). 1991; 53(2):285\u2013339.","journal-title":"J Royal Stat Soc Series B (Methodol)"},{"key":"1273_CR29","doi-asserted-by":"crossref","unstructured":"Bushel PR, Wolfinger RD, Gibson G. Simultaneous clustering of gene expression data with clinical chemistry and pathological evaluations reveals phenotypic prototypes. BMC Syst Biol. 2007;1(15).","DOI":"10.1186\/1752-0509-1-15"},{"key":"1273_CR30","unstructured":"L\u00ea Cao KA, Gonz\u00e1lez I, D\u00e9jean S, Rohart F, Benoit Gautier B, Monget P, Coquery J, Yao F, Liquet B. mixOmics: Omics Data Integration Project. 2015. R package version 5.0-4. http:\/\/CRAN.R-project.org\/package=mixOmics."},{"issue":"5","key":"1273_CR31","doi-asserted-by":"publisher","first-page":"1080","DOI":"10.1158\/1535-7163.MCT-09-0965","volume":"9","author":"H Liu","year":"2010","unstructured":"Liu H, D\u2019Andrade P, Fulmer-Smentek S, Lorenzi P, Kohn KW, Weinstein JN, Pommier Y, Reinhold WC. mRNA and microRNA expression profiles of the NCI-60 integrated with drug activities. Mol Cancer Ther. 2010; 9(5):1080\u201391.","journal-title":"Mol Cancer Ther"},{"issue":"24","key":"1273_CR32","doi-asserted-by":"publisher","first-page":"14229","DOI":"10.1073\/pnas.2331323100","volume":"100","author":"S Nishizuka","year":"2003","unstructured":"Nishizuka S, Charboneau L, Young L, Major S, Reinhold WC, Waltham M, Kouros-Mehr H, Bussey KJ, Lee JK, Espina V, Munson PJ, Petricoin E, Liotta LA, Weinstein JN. Proteomic profiling of the NCI-60 cancer cell lines using new high-density reverse-phase lysate microarrays. Proc Natl Acad Sci USA. 2003; 100(24):14229\u201334.","journal-title":"Proc Natl Acad Sci USA"},{"issue":"14","key":"1273_CR33","doi-asserted-by":"publisher","first-page":"3499","DOI":"10.1158\/0008-5472.CAN-12-1370","volume":"72","author":"WC Reinhold","year":"2012","unstructured":"Reinhold WC, Sunshine M, Liu H, Varma S, Kohn KW, Morris J, Doroshow J, Pommier Y. CellMiner: A web-based suite of genomic and pharmacologic tools to explore transcript and drug patterns in the NCI-60 cell line set. Cancer Res. 2012; 72(14):3499\u2013511.","journal-title":"Cancer Res"},{"issue":"1","key":"1273_CR34","doi-asserted-by":"publisher","first-page":"162","DOI":"10.1186\/1471-2105-15-162","volume":"15","author":"C Meng","year":"2014","unstructured":"Meng C, Kuster B, Culhane A, Gholami AM. A multivariate approach to the integration of multi-omics datasets. BMC Bioinforma. 2014; 15(1):162.","journal-title":"BMC Bioinforma"},{"issue":"2","key":"1273_CR35","doi-asserted-by":"publisher","first-page":"242","DOI":"10.1007\/s00357-014-9154-y","volume":"31","author":"JR van Ginkel","year":"2014","unstructured":"van Ginkel JR, Kroonenberg PM. Using generalized procrustes analysis for multiple imputation in principal component analysis. J Classif. 2014; 31(2):242\u201369.","journal-title":"J Classif"}],"container-title":["BMC Bioinformatics"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1186\/s12859-016-1273-5.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1186\/s12859-016-1273-5\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1186\/s12859-016-1273-5.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,6,19]],"date-time":"2024-06-19T14:44:09Z","timestamp":1718808249000},"score":1,"resource":{"primary":{"URL":"https:\/\/bmcbioinformatics.biomedcentral.com\/articles\/10.1186\/s12859-016-1273-5"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2016,10,3]]},"references-count":35,"journal-issue":{"issue":"1","published-online":{"date-parts":[[2016,12]]}},"alternative-id":["1273"],"URL":"https:\/\/doi.org\/10.1186\/s12859-016-1273-5","relation":{"has-review":[{"id-type":"doi","id":"10.3410\/f.726822656.793529462","asserted-by":"object"}]},"ISSN":["1471-2105"],"issn-type":[{"value":"1471-2105","type":"electronic"}],"subject":[],"published":{"date-parts":[[2016,10,3]]},"assertion":[{"value":"15 March 2016","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"21 September 2016","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"3 October 2016","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}],"article-number":"402"}}