{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,27]],"date-time":"2026-06-27T01:18:44Z","timestamp":1782523124802,"version":"3.54.5"},"reference-count":196,"publisher":"Springer Science and Business Media LLC","issue":"1","license":[{"start":{"date-parts":[[2016,9,1]],"date-time":"2016-09-01T00:00:00Z","timestamp":1472688000000},"content-version":"unspecified","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Netw Model Anal Health Inform Bioinforma"],"published-print":{"date-parts":[[2016,12]]},"DOI":"10.1007\/s13721-016-0135-4","type":"journal-article","created":{"date-parts":[[2016,9,2]],"date-time":"2016-09-02T21:20:28Z","timestamp":1472851228000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":48,"title":["Big data analytics in bioinformatics: architectures, techniques, tools and issues"],"prefix":"10.1007","volume":"5","author":[{"given":"Hirak","family":"Kashyap","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Hasin Afzal","family":"Ahmed","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Nazrul","family":"Hoque","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Swarup","family":"Roy","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Dhruba Kumar","family":"Bhattacharyya","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2016,9,1]]},"reference":[{"key":"135_CR1","doi-asserted-by":"crossref","unstructured":"Aggarwal CC, Reddy CK (eds)(2013) Data clustering: algorithms and applications. CRC Press","DOI":"10.1201\/b15410"},{"key":"135_CR2","doi-asserted-by":"crossref","unstructured":"Agrawal R, Imieli\u0144ski T, Swami A (1993) Mining association rules between sets of items in large databases. In: ACM SIGMOD Record, vol\u00a022. ACM, pp 207\u2013216","DOI":"10.1145\/170035.170072"},{"issue":"6","key":"135_CR3","doi-asserted-by":"crossref","first-page":"962","DOI":"10.1109\/69.553164","volume":"8","author":"R Agrawal","year":"1996","unstructured":"Agrawal R, Shafer JC (1996) Parallel mining of association rules. IEEE Trans Knowl Data Eng 8(6):962\u2013969","journal-title":"IEEE Trans Knowl Data Eng"},{"key":"135_CR4","unstructured":"Agrawal R, Srikant R et\u00a0al (1994) Fast algorithms for mining association rules. In: Proc. 20th int. conf. very large data bases, VLDB, vol 1215, pp 487\u2013499"},{"issue":"6","key":"135_CR5","doi-asserted-by":"crossref","first-page":"1239","DOI":"10.1109\/TCBB.2014.2323054","volume":"11","author":"H Ahmed","year":"2014","unstructured":"Ahmed H, Mahanta P, Bhattacharyya D, Kalita J (2014) Shifting-and-scaling correlation based biclustering algorithm. Comput Biol Bioinf IEEE ACM Trans 11(6):1239\u20131252","journal-title":"Comput Biol Bioinf IEEE ACM Trans"},{"key":"135_CR6","doi-asserted-by":"crossref","unstructured":"Ahmed H, Mahanta P, Bhattacharyya D, Kalita J, Ghosh A (2011) Intersected coexpressed subcube miner: an effective triclustering algorithm. In: Information and communication technologies (WICT), 2011 World Congress. IEEE, pp 846\u2013851","DOI":"10.1109\/WICT.2011.6141358"},{"issue":"1","key":"135_CR7","doi-asserted-by":"crossref","first-page":"356","DOI":"10.1186\/1471-2105-12-356","volume":"12","author":"SV Angiuoli","year":"2011","unstructured":"Angiuoli SV, Matalka M, Gussman A, Galens K, Vangala M, Riley DR, Arze C, White JR, White O, Fricke WF (2011) CloVR: a virtual machine for automated and portable sequence analysis from the desktop using cloud computing. BMC Bioinf 12(1):356","journal-title":"BMC Bioinf"},{"key":"135_CR8","unstructured":"Arefin AS, Berretta R, Moscato P (2013) A GPU-based method for computing eigenvector centrality of gene-expression networks. In: Proceedings of the eleventh Australasian symposium on parallel and distributed computing, vol 140. Australian Computer Society, Inc., pp 3\u201311"},{"issue":"1","key":"135_CR9","doi-asserted-by":"crossref","first-page":"61","DOI":"10.1023\/A:1026482903537","volume":"12","author":"Y Aumann","year":"1999","unstructured":"Aumann Y, Feldman R, Lipshtat O, Manilla H (1999) Borders: an efficient algorithm for association generation in dynamic databases. J Intell Inf Syst 12(1):61\u201373","journal-title":"J Intell Inf Syst"},{"issue":"1","key":"135_CR11","doi-asserted-by":"crossref","first-page":"2","DOI":"10.1186\/1471-2105-4-2","volume":"4","author":"GD Bader","year":"2003","unstructured":"Bader GD, Hogue CW (2003) An automated method for finding molecular complexes in large protein interaction networks. BMC Bioinf 4(1):2","journal-title":"BMC Bioinf"},{"key":"135_CR12","doi-asserted-by":"crossref","unstructured":"Bagyamathi M, Inbarani HH (2015) A novel hybridized rough set and improved harmony search based feature selection for protein sequence classification. In: Hassanien AE, Azar AT, Snasael V, Kacprzyk J, Abawajy JH (eds) Big data in complex systems, vol 9. Springer, pp 173\u2013204","DOI":"10.1007\/978-3-319-11056-1_6"},{"issue":"8","key":"135_CR13","doi-asserted-by":"crossref","first-page":"2208","DOI":"10.1109\/TIP.2006.875220","volume":"15","author":"A Baraldi","year":"2006","unstructured":"Baraldi A, Bruzzone L, Blonda P (2006) A multiscale expectation-maximization semisupervised classifier suitable for badly posed image classification. Image Process IEEE Trans 15(8):2208\u20132225","journal-title":"Image Process IEEE Trans"},{"key":"135_CR14","unstructured":"Barbu A, She Y, Ding L, Gramajo G (2013) Feature selection with annealing for big data learning. arXiv:1310.2880 (preprint)"},{"key":"135_CR15","doi-asserted-by":"crossref","first-page":"143","DOI":"10.4137\/EBO.S5861","volume":"6","author":"MS Barker","year":"2010","unstructured":"Barker MS, Dlugosch KM, Dinh L, Challa RS, Kane NC, King MG, Rieseberg LH (2010) EvoPipes. net: bioinformatic tools for ecological and evolutionary genomics. Evol Bioinf Online 6:143","journal-title":"Evol Bioinf Online"},{"key":"135_CR16","doi-asserted-by":"crossref","first-page":"373","DOI":"10.1089\/10665270360688075","volume":"10","author":"A Ben-Dor","year":"2003","unstructured":"Ben-Dor A, Chor B, Karp R, Yakhini Z (2003) Discovering local structure in gene expression data: the order-preserving submatrix problem. J Comput Biol 10:373\u2013384","journal-title":"J Comput Biol"},{"key":"135_CR17","doi-asserted-by":"crossref","unstructured":"Ber\u00e9nyi Z, Vajk I (2009) Probabilistic model for a distributed feature selection method. In: Soft computing applications, 2009. SOFA\u201909. 3rd International Workshop. IEEE, pp 27\u201332","DOI":"10.1109\/SOFA.2009.5254884"},{"key":"135_CR18","doi-asserted-by":"crossref","unstructured":"Bergmann S, Ihmels J, Barkai N (2003) Iterative signature algorithm for the analysis of large-scale gene expression data. Phys Rev E 67:031,902\u2013031,919","DOI":"10.1103\/PhysRevE.67.031902"},{"key":"135_CR19","doi-asserted-by":"crossref","unstructured":"Berkhin P (2006) A survey of clustering data mining techniques. In: Kogan J, Nicholas C, Teboulle M (eds) Grouping multidimensional data. Springer, Berlin, Heidelberg, pp 25\u201371","DOI":"10.1007\/3-540-28349-8_2"},{"key":"135_CR20","unstructured":"Bhatia S, Prakash P, Pillai G (2008) Svm based decision support system for heart disease classification with integer-coded genetic algorithm to select critical features. In: Proceedings of the world congress on engineering and computer science, WCECS, pp 22\u201324"},{"key":"135_CR21","doi-asserted-by":"crossref","unstructured":"Bhattacharyya DK, Kalita JK (2013) Network anomaly detection: a machine learning perspective","DOI":"10.1201\/b15088"},{"key":"135_CR22","volume-title":"Pattern recognition and machine learning","author":"CM Bishop","year":"2006","unstructured":"Bishop CM et al (2006) Pattern recognition and machine learning, vol 4. Springer, New York"},{"key":"135_CR23","doi-asserted-by":"crossref","unstructured":"Blum A (2015) Semi-supervised learning (2015)","DOI":"10.1007\/978-3-642-27848-8_766-1"},{"key":"135_CR24","doi-asserted-by":"crossref","first-page":"136","DOI":"10.1016\/j.asoc.2015.01.035","volume":"30","author":"V Bol\u00f3n-Canedo","year":"2015","unstructured":"Bol\u00f3n-Canedo V, S\u00e1nchez-Maro\u00f1o N, Alonso-Betanzos A (2015) Distributed feature selection: an application to microarray data classification. Appl Soft Comput 30:136\u2013150","journal-title":"Appl Soft Comput"},{"issue":"5","key":"135_CR25","doi-asserted-by":"crossref","first-page":"182","DOI":"10.1016\/j.tig.2014.02.005","volume":"30","author":"H Bolouri","year":"2014","unstructured":"Bolouri H (2014) Modeling genomic regulatory networks with big data. Trends Genet 30(5):182\u2013191","journal-title":"Trends Genet"},{"issue":"2007","key":"135_CR26","first-page":"21","volume":"11","author":"D Borthakur","year":"2007","unstructured":"Borthakur D (2007) The hadoop distributed file system: architecture and design. Hadoop Project Website 11(2007):21","journal-title":"Hadoop Project Website"},{"key":"135_CR27","unstructured":"Bradley PS, Fayyad UM, Reina C et\u00a0al (1998) Scaling clustering algorithms to large databases. In: KDD, pp 9\u201315"},{"key":"135_CR28","doi-asserted-by":"crossref","unstructured":"Brin S, Motwani R, Ullman JD, Tsur S (1997) Dynamic itemset counting and implication rules for market basket data. In: ACM SIGMOD Record, vol\u00a026. ACM, pp 255\u2013264","DOI":"10.1145\/253260.253325"},{"issue":"1","key":"135_CR29","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1109\/TKDE.2007.190669","volume":"20","author":"D Cai","year":"2008","unstructured":"Cai D, He X, Han J (2008) Srda: an efficient algorithm for large-scale discriminant analysis. Knowl Data Eng IEEE Trans 20(1):1\u201312","journal-title":"Knowl Data Eng IEEE Trans"},{"key":"135_CR30","unstructured":"Calaway R, Edlefsen L, Gong L, Fast S (2016) Big data decision trees with r. Revolution"},{"issue":"suppl 1","key":"135_CR31","doi-asserted-by":"crossref","first-page":"D685","DOI":"10.1093\/nar\/gkq1039","volume":"39","author":"EG Cerami","year":"2011","unstructured":"Cerami EG, Gross BE, Demir E, Rodchenkov I, Babur \u00d6, Anwar N, Schultz N, Bader GD, Sander C (2011) Pathway commons, a web resource for biological pathway data. Nucleic Acids Res 39(suppl 1):D685\u2013D690","journal-title":"Nucleic Acids Res"},{"key":"135_CR32","doi-asserted-by":"crossref","unstructured":"Chakraborty S, Nagwani N (2011) Analysis and study of incremental k-means clustering algorithm. In: High performance architecture and grid computing. Springer, Berlin, Heidelberg, pp 338\u2013341","DOI":"10.1007\/978-3-642-22577-2_46"},{"key":"135_CR33","doi-asserted-by":"crossref","unstructured":"Chaudhuri K, Kakade SM, Livescu K, Sridharan K (2009) Multi-view clustering via canonical correlation analysis. In: Proceedings of the 26th annual international conference on machine learning. ACM, pp 129\u2013136","DOI":"10.1145\/1553374.1553391"},{"issue":"1","key":"135_CR34","first-page":"1","volume":"13","author":"N Chen","year":"2002","unstructured":"Chen N, Chen AZ, Zhou LX (2002) An incremental grid density-based clustering algorithm. J Softw 13(1):1\u20137","journal-title":"J Softw"},{"key":"135_CR35","first-page":"93","volume":"8","author":"Y Cheng","year":"2000","unstructured":"Cheng Y, Church GM (2000) Biclustering of expression data. Ismb 8:93\u2013103","journal-title":"Ismb"},{"key":"135_CR36","doi-asserted-by":"crossref","unstructured":"Cheung DW, Han J, Ng VT, Fu AW, Fu Y (1996) A fast distributed algorithm for mining association rules. In: Parallel and distributed information systems, 1996. Fourth International Conference. IEEE, pp 31\u201342","DOI":"10.1109\/PDIS.1996.568665"},{"key":"135_CR37","doi-asserted-by":"crossref","unstructured":"Cheung DW, Xiao Y (1998) Effect of data skewness in parallel mining of association rules. In: Research and development in knowledge discovery and data mining. Springer, Berlin, Heidelberg, pp 48\u201360","DOI":"10.1007\/3-540-64383-4_5"},{"key":"135_CR38","unstructured":"Chien BC, Lin ZL, Hong TP (2001) An efficient clustering algorithm for mining fuzzy quantitative association rules. In: IFSA World Congress and 20th NAFIPS International Conference, 2001. Joint 9th, vol\u00a03. IEEE, pp 1306\u20131311"},{"key":"135_CR39","doi-asserted-by":"crossref","unstructured":"Choudhury A, Nair PB, Keane AJ et\u00a0al (2002) A data parallel approach for large-scale gaussian process modeling. In: SDM. SIAM, pp 95\u2013111","DOI":"10.1137\/1.9781611972726.6"},{"key":"135_CR40","unstructured":"Cisco (2015) Cisco visual networking index: global mobile data traffic forecast update, 2014\u20132019. Cisco Public Information"},{"key":"135_CR41","unstructured":"Croft D, OKelly G, Wu G, Haw R, Gillespie M, Matthews L, Caudy M, Garapati P, Gopinath G, Jassal B et\u00a0al (2010) Reactome: a database of reactions, pathways and biological processes. Nucleic Acids Res, p gkq1018"},{"issue":"2","key":"135_CR42","doi-asserted-by":"crossref","first-page":"e1672","DOI":"10.1371\/journal.pone.0001672","volume":"3","author":"M Davidich","year":"2008","unstructured":"Davidich M, Bornholdt S (2008) Boolean network model predicts cell cycle sequence of fission yeast. PLoS One 3(2):e1672","journal-title":"PLoS One"},{"issue":"6","key":"135_CR43","doi-asserted-by":"crossref","first-page":"R112","DOI":"10.1186\/gb-2007-8-6-r112","volume":"8","author":"A Day","year":"2007","unstructured":"Day A, Carlson MR, Dong J, O\u2019Connor BD, Nelson SF (2007) Celsius: a community resource for Affymetrix microarray data. Genome Biol 8(6):R112","journal-title":"Genome Biol"},{"issue":"12","key":"135_CR44","doi-asserted-by":"crossref","first-page":"e8491","DOI":"10.1371\/journal.pone.0008491","volume":"4","author":"A Day","year":"2009","unstructured":"Day A, Dong J, Funari VA, Harry B, Strom SP, Cohn DH, Nelson SF (2009) Disease gene characterization through large-scale co-expression analysis. PLoS One 4(12):e8491","journal-title":"PLoS One"},{"key":"135_CR45","unstructured":"Dean J, Ghemawat S (2005) Mapreduce: simplified data processing on large clusters. In: OSDI $$\\backslash $$ \\ \u201904, pp 137\u2013150"},{"issue":"1","key":"135_CR46","doi-asserted-by":"crossref","first-page":"107","DOI":"10.1145\/1327452.1327492","volume":"51","author":"J Dean","year":"2008","unstructured":"Dean J, Ghemawat S (2008) Mapreduce: simplified data processing on large clusters. Commun ACM 51(1):107\u2013113","journal-title":"Commun ACM"},{"issue":"2","key":"135_CR47","doi-asserted-by":"crossref","first-page":"245","DOI":"10.1016\/j.compbiomed.2011.11.015","volume":"42","author":"F Divina","year":"2011","unstructured":"Divina F, Pontes B, Gir\u00e1ldez R, Aguilar-Ruiz JS (2011) An effective measure for assessing the quality of biclusters. Comput Biol Med 42(2):245\u2013256","journal-title":"Comput Biol Med"},{"key":"135_CR48","doi-asserted-by":"crossref","unstructured":"Jiang D, Pei J, Ramanathan M, Tang C, Zhang A (2004) Mining coherent gene clusters from gene-sample-time microarray data. In: In Proc of the 10 th ACM SIGKDD Conference (KDD\u201904)","DOI":"10.1145\/1014052.1014101"},{"key":"135_CR49","unstructured":"Djuric N (2014) Big data algorithms for visualization and supervised learning. Ph.D. thesis, Temple University"},{"key":"135_CR50","unstructured":"Duda RO, Hart PE, Stork DG (2012) Pattern classification. Wiley, New York"},{"issue":"1","key":"135_CR51","doi-asserted-by":"crossref","first-page":"44","DOI":"10.1016\/j.neuroimage.2009.08.024","volume":"49","author":"Ecker C, Rocha-Rego V, Johnston P, Mourao-Miranda J, Marquand A, Daly EM, Brammer MJ, Murphy C, Murphy DG, Consortium MA et al","year":"2010","unstructured":"Ecker C, Rocha-Rego V, Johnston P, Mourao-Miranda J, Marquand A, Daly EM, Brammer MJ, Murphy C, Murphy DG, Consortium MA et al (2010) Investigating the predictive value of whole-brain structural mr scans in autism: a pattern classification approach. Neuroimage 49(1):44\u201356","journal-title":"Neuroimage"},{"key":"135_CR52","doi-asserted-by":"crossref","unstructured":"Ekanayake J, Li H, Zhang B, Gunarathne T, Bae SH, Qiu J, Fox G (2010) Twister: a runtime for iterative mapreduce. In: Proceedings of the 19th ACM international symposium on high performance distributed computing. ACM, pp 810\u2013818","DOI":"10.1145\/1851476.1851593"},{"key":"135_CR53","unstructured":"EMBL-European Bioinformatics Institute (2014) EMBL-EBI annual scientific report 2013"},{"key":"135_CR54","unstructured":"Ester M, Kriegel HP, Sander J, Xu X (1996) A density-based algorithm for discovering clusters in large spatial databases with noise. In: Kdd, vol 96, pp 226\u2013231"},{"issue":"1","key":"135_CR55","doi-asserted-by":"crossref","first-page":"e8","DOI":"10.1371\/journal.pbio.0050008","volume":"5","author":"J Faith","year":"2007","unstructured":"Faith J, Hayete B, Thaden J, Mogno I, Wierzbowski J, Cottarel G, Kasif S, Collins J, Gardner T (2007) Large-scale mapping and validation of escherichia coli transcriptional regulation from a compendium of expression profiles. PLoS Biol 5(1):e8","journal-title":"PLoS Biol"},{"issue":"4","key":"135_CR56","doi-asserted-by":"crossref","first-page":"435","DOI":"10.1007\/s13347-012-0093-4","volume":"25","author":"L Floridi","year":"2012","unstructured":"Floridi L (2012) Big data and their epistemological challenge. Philos Technol 25(4):435\u2013437","journal-title":"Philos Technol"},{"key":"135_CR10","doi-asserted-by":"crossref","unstructured":"Fogel DB (2006) Evolutionary computation: toward a new philosophy of machine intelligence, vol 1. Wiley, New York","DOI":"10.1002\/0471749214"},{"issue":"3\u20134","key":"135_CR57","doi-asserted-by":"crossref","first-page":"601","DOI":"10.1089\/106652700750050961","volume":"7","author":"N Friedman","year":"2000","unstructured":"Friedman N, Linial M, Nachman I, Pe\u2019er D (2000) Using bayesian networks to analyze expression data. J Comput Biol 7(3\u20134):601\u2013620","journal-title":"J Comput Biol"},{"key":"135_CR58","doi-asserted-by":"crossref","unstructured":"Garg A, Mangla A, Gupta N, Bhatnagar V (2006) Pbirch: a scalable parallel clustering algorithm for incremental data. In: Database engineering and applications symposium, 2006. IDEAS\u201906. 10th International. IEEE, pp 315\u2013316","DOI":"10.1109\/IDEAS.2006.36"},{"issue":"4","key":"135_CR59","doi-asserted-by":"crossref","first-page":"76","DOI":"10.1038\/scientificamerican1004-76","volume":"291","author":"N Gershenfeld","year":"2004","unstructured":"Gershenfeld N, Krikorian R, Cohen D (2004) The internet of things. Sci Am 291(4):76","journal-title":"Sci Am"},{"key":"135_CR60","doi-asserted-by":"crossref","unstructured":"Giveki D, Salimi H, Bahmanyar G, Khademian Y (2012) Automatic detection of diabetes diagnosis using feature weighted support vector machines based on mutual information and modified cuckoo search. arXiv:1201.2173 (preprint)","DOI":"10.5120\/9371-9528"},{"issue":"8","key":"135_CR61","doi-asserted-by":"crossref","first-page":"R86","DOI":"10.1186\/gb-2010-11-8-r86","volume":"11","author":"J Goecks","year":"2010","unstructured":"Goecks J, Nekrutenko A, Taylor J et al (2010) Galaxy: a comprehensive approach for supporting accessible, reproducible, and transparent computational research in the life sciences. Genome Biol 11(8):R86","journal-title":"Genome Biol"},{"issue":"6","key":"135_CR62","doi-asserted-by":"crossref","first-page":"789","DOI":"10.1016\/0167-8191(96)00024-5","volume":"22","author":"W Gropp","year":"1996","unstructured":"Gropp W, Lusk E, Doss N, Skjellum A (1996) A high-performance, portable implementation of the mpi message passing interface standard. Parallel Comput 22(6):789\u2013828","journal-title":"Parallel Comput"},{"issue":"7","key":"135_CR63","doi-asserted-by":"crossref","first-page":"1121","DOI":"10.1101\/gr.226602","volume":"12","author":"P Grosu","year":"2002","unstructured":"Grosu P, Townsend JP, Hartl DL, Cavalieri D (2002) Pathway Processor: a tool for integrating whole-genome expression results into metabolic networks. Genome Res 12(7):1121\u20131126","journal-title":"Genome Res"},{"key":"135_CR64","doi-asserted-by":"crossref","unstructured":"Guha S, Rastogi R, Shim K (1998) Cure: an efficient clustering algorithm for large databases. In: ACM SIGMOD record, vol\u00a027. ACM, pp 73\u201384","DOI":"10.1145\/276304.276312"},{"key":"135_CR65","first-page":"1157","volume":"3","author":"I Guyon","year":"2003","unstructured":"Guyon I, Elisseeff A (2003) An introduction to variable and feature selection. J Mach Learn Res 3:1157\u20131182","journal-title":"J Mach Learn Res"},{"key":"135_CR66","doi-asserted-by":"crossref","unstructured":"Hall LO, Chawla N, Bowyer KW (1998) Decision tree learning on very large data sets. In: Systems, man, and cybernetics, 1998. 1998 IEEE international conference, vol\u00a03. IEEE, pp 2579\u20132584","DOI":"10.1109\/ICSMC.1998.725047"},{"key":"135_CR67","unstructured":"Hall MA, Smith LA (1999) Feature selection for machine learning: comparing a correlation-based filter approach to the wrapper. In: FLAIRS conference, vol 1999, pp 235\u2013239"},{"issue":"11","key":"135_CR68","doi-asserted-by":"crossref","first-page":"2123","DOI":"10.3174\/ajnr.A3126","volume":"33","author":"S Haller","year":"2012","unstructured":"Haller S, Badoud S, Nguyen D, Garibotto V, Lovblad K, Burkhard P (2012) Individual detection of patients with parkinson disease using support vector machine analysis of diffusion tensor imaging data: initial results. Am J Neuroradiol 33(11):2123\u20132128","journal-title":"Am J Neuroradiol"},{"issue":"2","key":"135_CR69","doi-asserted-by":"crossref","first-page":"14","DOI":"10.1145\/380995.381002","volume":"2","author":"J Han","year":"2000","unstructured":"Han J, Pei J (2000) Mining frequent patterns by pattern-growth: methodology and implications. ACM SIGKDD Explor Newsl 2(2):14\u201320","journal-title":"ACM SIGKDD Explor Newsl"},{"key":"135_CR70","unstructured":"Hinneburg A, Keim DA (1998) An efficient approach to clustering in large multimedia databases with noise. In: KDD, vol 98, pp 58\u201365"},{"issue":"6","key":"135_CR71","doi-asserted-by":"crossref","first-page":"82","DOI":"10.1109\/MSP.2012.2205597","volume":"29","author":"G Hinton","year":"2012","unstructured":"Hinton G, Deng L, Yu D, Dahl GE, Mohamed AR, Jaitly N, Senior A, Vanhoucke V, Nguyen P, Sainath TN et al (2012) Deep neural networks for acoustic modeling in speech recognition: the shared views of four research groups. Signal Process Mag IEEE 29(6):82\u201397","journal-title":"Signal Process Mag IEEE"},{"issue":"5786","key":"135_CR72","doi-asserted-by":"crossref","first-page":"504","DOI":"10.1126\/science.1127647","volume":"313","author":"GE Hinton","year":"2006","unstructured":"Hinton GE, Salakhutdinov RR (2006) Reducing the dimensionality of data with neural networks. Science 313(5786):504\u2013507","journal-title":"Science"},{"key":"135_CR73","doi-asserted-by":"crossref","unstructured":"Hoi SC, Wang J, Zhao P, Jin R (2012) Online feature selection for mining big data. In: Proceedings of the 1st international workshop on big data, streams and heterogeneous source mining: algorithms, systems, programming models and applications. ACM, pp 93\u2013100","DOI":"10.1145\/2351316.2351329"},{"key":"135_CR74","unstructured":"H\u00f6ppner F (1999) Fuzzy cluster analysis: methods for classification, data analysis and image recognition"},{"issue":"14","key":"135_CR75","doi-asserted-by":"crossref","first-page":"6371","DOI":"10.1016\/j.eswa.2014.04.019","volume":"41","author":"N Hoque","year":"2014","unstructured":"Hoque N, Bhattacharyya D, Kalita J (2014) Mifs-nd: a mutual information-based feature selection method. Expert Syst Appl 41(14):6371\u20136385","journal-title":"Expert Syst Appl"},{"key":"135_CR76","doi-asserted-by":"crossref","unstructured":"Houtsma M, Swami A (1995) Set-oriented mining for association rules in relational databases. In: Data engineering, 1995. Proceedings of the Eleventh International Conference. IEEE, pp 25\u201333","DOI":"10.1109\/ICDE.1995.380413"},{"key":"135_CR77","unstructured":"Hsieh CJ, Si S, Dhillon IS (2013) A divide-and-conquer solver for kernel support vector machines. arXiv:1311.0914 (preprint)"},{"issue":"3","key":"135_CR78","doi-asserted-by":"crossref","first-page":"283","DOI":"10.1023\/A:1009769707641","volume":"2","author":"Z Huang","year":"1998","unstructured":"Huang Z (1998) Extensions to the k-means algorithm for clustering large data sets with categorical values. Data Mining Knowl Discov 2(3):283\u2013304","journal-title":"Data Mining Knowl Discov"},{"issue":"3","key":"135_CR79","doi-asserted-by":"crossref","first-page":"283","DOI":"10.1007\/BF02291704","volume":"39","author":"LJ Hubert","year":"1974","unstructured":"Hubert LJ (1974) Some applications of graph theory to clustering. Psychometrika 39(3):283\u2013309","journal-title":"Psychometrika"},{"issue":"1","key":"135_CR80","doi-asserted-by":"crossref","first-page":"55","DOI":"10.1109\/TIT.1968.1054102","volume":"14","author":"GP Hughes","year":"1968","unstructured":"Hughes GP (1968) On the mean accuracy of statistical pattern recognizers. Inf Theory IEEE Trans 14(1):55\u201363","journal-title":"Inf Theory IEEE Trans"},{"issue":"2","key":"135_CR82","doi-asserted-by":"crossref","first-page":"153","DOI":"10.1109\/34.574797","volume":"19","author":"A Jain","year":"1997","unstructured":"Jain A, Zongker D (1997) Feature selection: Evaluation, application, and small sample performance. Pattern Anal Mach Intell IEEE Trans 19(2):153\u2013158","journal-title":"Pattern Anal Mach Intell IEEE Trans"},{"issue":"3","key":"135_CR83","doi-asserted-by":"crossref","first-page":"264","DOI":"10.1145\/331499.331504","volume":"31","author":"AK Jain","year":"1999","unstructured":"Jain AK, Murty MN, Flynn PJ (1999) Data clustering: a review. ACM Comput Surv (CSUR) 31(3):264\u2013323","journal-title":"ACM Comput Surv (CSUR)"},{"key":"135_CR84","unstructured":"Janecek A, Gansterer WN, Demel M, Ecker G (2008) On the relationship between feature selection and classification accuracy. In: FSDM, pp 90\u2013105"},{"key":"135_CR85","doi-asserted-by":"crossref","unstructured":"Jiang H, Zhou S, Guan J, Zheng Y (2006) gtricluster: a more general and effective 3d clustering algorithm for gene-sample-time microarray data. In: BioDM\u201906, pp 48\u201359","DOI":"10.1007\/11691730_6"},{"key":"135_CR86","doi-asserted-by":"crossref","unstructured":"Judd D, McKinley PK, Jain, AK (1996) Large-scale parallel data clustering. In: Pattern recognition, 1996. Proceedings of the 13th International Conference, vol\u00a04. IEEE, pp 488\u2013493","DOI":"10.1109\/ICPR.1996.547613"},{"key":"135_CR87","doi-asserted-by":"crossref","unstructured":"Kailing K, Kriegel HP, Pryakhin A, Schubert M (2004) Clustering multi-represented objects with noise. In: Advances in knowledge discovery and data mining. Springer, Berlin, Heidelberg, pp 394\u2013403","DOI":"10.1007\/978-3-540-24775-3_48"},{"issue":"1","key":"135_CR88","doi-asserted-by":"crossref","first-page":"27","DOI":"10.1093\/nar\/28.1.27","volume":"28","author":"M Kanehisa","year":"2000","unstructured":"Kanehisa M, Goto S (2000) KEGG: kyoto encyclopedia of genes and genomes. Nucleic Acids Res 28(1):27\u201330","journal-title":"Nucleic Acids Res"},{"issue":"8","key":"135_CR89","doi-asserted-by":"crossref","first-page":"68","DOI":"10.1109\/2.781637","volume":"32","author":"G Karypis","year":"1999","unstructured":"Karypis G, Han EH, Kumar V (1999) Chameleon: hierarchical clustering using dynamic modeling. Computer 32(8):68\u201375","journal-title":"Computer"},{"key":"135_CR90","unstructured":"Kaufman L, Rousseeuw P (1987) Clustering by means of medoids. North-Holland"},{"key":"135_CR91","doi-asserted-by":"crossref","unstructured":"Kaufman L, Rousseeuw PJ (1990) Finding groups in data. An introduction to cluster analysis. Wiley Series in Probability and Mathematical Statistics. Applied Probability and Statistics, vol 1. Wiley, New York","DOI":"10.1002\/9780470316801"},{"key":"135_CR92","unstructured":"Kaufman L, Rousseeuw PJ (2009) Finding groups in data: an introduction to cluster analysis. Wiley, Hoboken, NJ"},{"issue":"suppl 2","key":"135_CR93","doi-asserted-by":"crossref","first-page":"W83","DOI":"10.1093\/nar\/gkh411","volume":"32","author":"BP Kelley","year":"2004","unstructured":"Kelley BP, Yuan B, Lewitter F, Sharan R, Stockwell BR, Ideker T (2004) PathBLAST: a tool for alignment of protein interaction networks. Nucleic Acids Res 32(suppl 2):W83\u2013W88","journal-title":"Nucleic Acids Res"},{"key":"135_CR94","doi-asserted-by":"crossref","unstructured":"Kira K, Rendell LA (1992) A practical approach to feature selection. In: Proceedings of the ninth international workshop on Machine learning, pp 249\u2013256","DOI":"10.1016\/B978-1-55860-247-2.50037-1"},{"issue":"4","key":"135_CR95","doi-asserted-by":"crossref","first-page":"703","DOI":"10.1101\/gr.648603","volume":"13","author":"Y Kluger","year":"2003","unstructured":"Kluger Y, Basri R, Chang J, Gerstein M (2003) Spectral biclustering of microarray data: coclustering genes and conditions. Genome Res 13(4):703\u2013716","journal-title":"Genome Res"},{"issue":"9","key":"135_CR96","doi-asserted-by":"crossref","first-page":"1464","DOI":"10.1109\/5.58325","volume":"78","author":"T Kohonen","year":"1990","unstructured":"Kohonen T (1990) The self-organizing map. Proc IEEE 78(9):1464\u20131480","journal-title":"Proc IEEE"},{"key":"135_CR97","unstructured":"Kraska T, Talwalkar A, Duchi JC, Griffith R, Franklin MJ, Jordan MI (2013) Mlbase: a distributed machine-learning system. In: CIDR"},{"issue":"3","key":"135_CR98","doi-asserted-by":"crossref","first-page":"231","DOI":"10.1002\/widm.30","volume":"1","author":"HP Kriegel","year":"2011","unstructured":"Kriegel HP, Kr\u00f6ger P, Sander J, Zimek A (2011) Density-based clustering. Wiley Interdiscip Rev Data Mining Knowl Discov 1(3):231\u2013240","journal-title":"Wiley Interdiscip Rev Data Mining Knowl Discov"},{"key":"135_CR99","unstructured":"Kumar A, Daum\u00e9 H (2011) A co-training approach for multi-view spectral clustering. In: Proceedings of the 28th international conference on machine learning (ICML-11), pp 393\u2013400"},{"issue":"4","key":"135_CR100","doi-asserted-by":"crossref","first-page":"299","DOI":"10.1093\/bib\/bbn017","volume":"9","author":"S Kumar","year":"2008","unstructured":"Kumar S, Nei M, Dudley J, Tamura K (2008) MEGA: a biologist-centric software for evolutionary analysis of DNA and protein sequences. Brief Bioinf 9(4):299\u2013306","journal-title":"Brief Bioinf"},{"key":"135_CR101","unstructured":"Kurtz S (2003) The vmatch large scale sequence analysis software. Ref Type: Computer Program, pp 4\u201312"},{"issue":"1","key":"135_CR102","doi-asserted-by":"crossref","first-page":"559","DOI":"10.1186\/1471-2105-9-559","volume":"9","author":"P Langfelder","year":"2008","unstructured":"Langfelder P, Horvath S (2008) WGCNA: an R package for weighted correlation network analysis. BMC Bioinf 9(1):559","journal-title":"BMC Bioinf"},{"issue":"11","key":"135_CR103","doi-asserted-by":"crossref","first-page":"R134","DOI":"10.1186\/gb-2009-10-11-r134","volume":"10","author":"B Langmead","year":"2009","unstructured":"Langmead B, Schatz MC, Lin J, Pop M, Salzberg SL (2009) Searching for SNPs with cloud computing. Genome Biol 10(11):R134","journal-title":"Genome Biol"},{"issue":"3","key":"135_CR104","doi-asserted-by":"crossref","first-page":"R25","DOI":"10.1186\/gb-2009-10-3-r25","volume":"10","author":"B Langmead","year":"2009","unstructured":"Langmead B, Trapnell C, Pop M, Salzberg SL et al (2009) Ultrafast and memory-efficient alignment of short DNA sequences to the human genome. Genome Biol 10(3):R25","journal-title":"Genome Biol"},{"issue":"6","key":"135_CR105","doi-asserted-by":"crossref","first-page":"1085","DOI":"10.1101\/gr.1910904","volume":"14","author":"H Lee","year":"2004","unstructured":"Lee H, Hsu A, Sajdak J, Qin J, Pavlidis P (2004) Coexpression analysis of human genes across many microarray data sets. Genome Res 14(6):1085\u20131094","journal-title":"Genome Res"},{"issue":"6","key":"135_CR106","doi-asserted-by":"crossref","first-page":"1124","DOI":"10.1101\/gr.088013.108","volume":"19","author":"R Li","year":"2009","unstructured":"Li R, Li Y, Fang X, Yang H, Wang J, Kristiansen K, Wang J (2009) SNP detection for massively parallel whole-genome resequencing. Genome Res 19(6):1124\u20131132","journal-title":"Genome Res"},{"issue":"3","key":"135_CR107","doi-asserted-by":"crossref","first-page":"275","DOI":"10.1016\/0167-8191(89)90036-7","volume":"11","author":"X Li","year":"1989","unstructured":"Li X, Fang Z (1989) Parallel clustering algorithms. Parallel Comput 11(3):275\u2013290","journal-title":"Parallel Comput"},{"key":"135_CR108","unstructured":"Liang, M., Zhang, F., Jin, G., Zhu, J (2014) FastGCN: a GPU accelerated tool for fast gene co-expression networks. PLoS One 10(1):e0116,776\u2013e0116,776"},{"issue":"493","key":"135_CR109","doi-asserted-by":"crossref","first-page":"232","DOI":"10.1198\/jasa.2011.tm10113","volume":"106","author":"D Lin","year":"2011","unstructured":"Lin D, Foster DP, Ungar LH (2011) Vif regression: a fast regression algorithm for large data. J Am Stat Assoc 106(493):232\u2013247","journal-title":"J Am Stat Assoc"},{"issue":"1","key":"135_CR110","doi-asserted-by":"crossref","first-page":"101","DOI":"10.1007\/s00429-013-0641-4","volume":"220","author":"F Liu","year":"2015","unstructured":"Liu F, Guo W, Fouche JP, Wang Y, Wang W, Ding J, Zeng L, Qiu C, Gong Q, Zhang W et al (2015) Multivariate classification of social anxiety disorder using whole brain functional connectivity. Brain Struct Funct 220(1):101\u2013115","journal-title":"Brain Struct Funct"},{"issue":"7","key":"135_CR111","doi-asserted-by":"crossref","first-page":"e40968","DOI":"10.1371\/journal.pone.0040968","volume":"7","author":"F Liu","year":"2002","unstructured":"Liu F, Guo W, Yu D, Gao Q, Gao K, Xue Z, Du H, Zhang J, Tan C, Liu Z et\u00a0al (2012) Classification of different therapeutic responses of major depressive disorder with multivariate pattern analysis method based on structural MR scans. PLoS One 7(7):e40968","journal-title":"PLoS One"},{"key":"135_CR112","doi-asserted-by":"crossref","unstructured":"Liu F, Suk HI, Wee CY, Chen H, Shen D (2013) High-order graph matching based feature selection for Alzheimers disease identification. In: Medical image computing and computer-assisted intervention\u2013MICCAI 2013. Springer, Berlin, Heidelberg, pp 311\u2013318","DOI":"10.1007\/978-3-642-40763-5_39"},{"key":"135_CR113","doi-asserted-by":"crossref","first-page":"466","DOI":"10.1016\/j.neuroimage.2013.09.015","volume":"84","author":"F Liu","year":"2014","unstructured":"Liu F, Wee CY, Chen H, Shen D (2014) Inter-modality relationship constrained multi-modality multi-task feature selection for alzheimer\u2019s disease and mild cognitive impairment identification. NeuroImage 84:466\u2013475","journal-title":"NeuroImage"},{"issue":"2","key":"135_CR114","doi-asserted-by":"crossref","first-page":"221","DOI":"10.1007\/s10548-014-0386-2","volume":"28","author":"F Liu","year":"2014","unstructured":"Liu F, Xie B, Wang Y, Guo W, Fouche JP, Long Z, Wang W, Chen H, Li M, Duan X et al (2014) Characterization of post-traumatic stress disorder using resting-state fmri with a multi-level parametric classification approach. Brain Topogr 28(2):221\u2013237","journal-title":"Brain Topogr"},{"issue":"2","key":"135_CR115","doi-asserted-by":"crossref","first-page":"491","DOI":"10.1016\/j.ejor.2006.08.045","volume":"180","author":"M L\u00f3pez","year":"2007","unstructured":"L\u00f3pez M, Still G (2007) Semi-infinite programming. Eur J Oper Res 180(2):491\u2013518","journal-title":"Eur J Oper Res"},{"issue":"8","key":"135_CR116","doi-asserted-by":"crossref","first-page":"716","DOI":"10.14778\/2212351.2212354","volume":"5","author":"Y Low","year":"2012","unstructured":"Low Y, Bickson D, Gonzalez J, Guestrin C, Kyrola A, Hellerstein JM (2012) Distributed graphlab: a framework for machine learning and data mining in the cloud. Proc VLDB Endow 5(8):716\u2013727","journal-title":"Proc VLDB Endow"},{"key":"135_CR117","unstructured":"Low Y, Gonzalez JE, Kyrola A, Bickson D, Guestrin CE, Hellerstein J (2014) Graphlab: a new framework for parallel machine learning. arXiv:1408.2041 (preprint)"},{"issue":"14","key":"135_CR118","doi-asserted-by":"crossref","first-page":"1830","DOI":"10.1093\/bioinformatics\/btt285","volume":"29","author":"W Luo","year":"2013","unstructured":"Luo W, Brouwer C (2013) Pathview: an R\/Bioconductor package for pathway-based data integration and visualization. Bioinformatics 29(14):1830\u20131831","journal-title":"Bioinformatics"},{"issue":"5","key":"135_CR119","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1186\/gm340","volume":"4","author":"PB Madhamshettiwar","year":"2012","unstructured":"Madhamshettiwar PB, Maetschke SR, Davis MJ, Reverter A, Ragan MA (2012) Gene regulatory network inference: evaluation and application to ovarian cancer allows the prioritization of drug targets. Genome Med 4(5):1\u201316","journal-title":"Genome Med"},{"key":"135_CR120","doi-asserted-by":"crossref","unstructured":"Malewicz G, Austern MH, Bik AJ, Dehnert JC, Horn I, Leiser N, Czajkowski G (2010) Pregel: a system for large-scale graph processing. In: Proceedings of the 2010 ACM SIGMOD international conference on management of data. ACM, pp 135\u2013146","DOI":"10.1145\/1807167.1807184"},{"issue":"3","key":"135_CR121","doi-asserted-by":"crossref","first-page":"241","DOI":"10.1023\/A:1009796218281","volume":"1","author":"H Mannila","year":"1997","unstructured":"Mannila H, Toivonen H (1997) Levelwise search and borders of theories in knowledge discovery. Data Mining Knowl Discov 1(3):241\u2013258","journal-title":"Data Mining Knowl Discov"},{"issue":"Suppl 1","key":"135_CR122","doi-asserted-by":"crossref","first-page":"S7","DOI":"10.1186\/1471-2105-7-S1-S7","volume":"7","author":"A Margolin","year":"2006","unstructured":"Margolin A, Nemenman I, Basso K, Wiggins C, Stolovitzky G, Favera R, Califano A (2006) Aracne: an algorithm for the reconstruction of gene regulatory networks in a mammalian cellular context. BMC Bioinf 7(Suppl 1):S7","journal-title":"BMC Bioinf"},{"issue":"7453","key":"135_CR123","doi-asserted-by":"crossref","first-page":"255","DOI":"10.1038\/498255a","volume":"498","author":"V Marx","year":"2013","unstructured":"Marx V (2013) Biology: the big challenges of big data. Nature 498(7453):255\u2013260","journal-title":"Nature"},{"key":"135_CR124","doi-asserted-by":"crossref","unstructured":"Matsunaga A, Tsugawa M, Fortes J (2008) Cloudblast: combining mapreduce and virtualization on distributed resources for bioinformatics applications. In: eScience, 2008. eScience\u201908. IEEE fourth international conference. IEEE, pp 222\u2013229","DOI":"10.1109\/eScience.2008.62"},{"issue":"1","key":"135_CR125","doi-asserted-by":"crossref","first-page":"305","DOI":"10.1186\/1471-2105-14-305","volume":"14","author":"DG McArt","year":"2013","unstructured":"McArt DG, Bankhead P, Dunne PD, Salto-Tellez M, Hamilton P, Zhang SD (2013) cudaMap: a GPU accelerated program for gene expression connectivity mapping. BMC Bioinf 14(1):305","journal-title":"BMC Bioinf"},{"issue":"1","key":"135_CR126","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1155\/2007\/79879","volume":"2007","author":"P Meyer","year":"2007","unstructured":"Meyer P, Kontos K, Lafitte F, Bontempi G (2007) Information-theoretic inference of large transcriptional regulatory networks. EURASIP J Bioinf Syst Biol 2007(1):1\u20139","journal-title":"EURASIP J Bioinf Syst Biol"},{"key":"135_CR127","volume-title":"Machine learning","author":"TM Mitchell","year":"1997","unstructured":"Mitchell TM (1997) Machine learning, vol 45. McGraw Hill, Burr Ridge"},{"key":"135_CR128","doi-asserted-by":"crossref","unstructured":"Moens S, Aksehirli E, Goethals B (2013) Frequent itemset mining for big data. In: Big data, 2013 IEEE international conference. IEEE, pp 111\u2013118","DOI":"10.1109\/BigData.2013.6691742"},{"key":"135_CR129","unstructured":"Mohri M, Rostamizadeh A, Talwalkar A (2012) Foundations of machine learning. MIT Press"},{"issue":"suppl 2","key":"135_CR130","doi-asserted-by":"crossref","first-page":"W368","DOI":"10.1093\/nar\/gkn256","volume":"36","author":"J Mosquera","year":"2008","unstructured":"Mosquera J, S\u00e1nchez-Pla A (2008) Serbgo: searching for the best go tool. Nucleic Acids Res 36(suppl 2):W368\u2013W371","journal-title":"Nucleic Acids Res"},{"issue":"1","key":"135_CR131","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1186\/s40537-014-0007-7","volume":"2","author":"MM Najafabadi","year":"2015","unstructured":"Najafabadi MM, Villanustre F, Khoshgoftaar TM, Seliya N, Wald R, Muharemagic E (2015) Deep learning applications and challenges in big data analytics. J Big Data 2(1):1\u201321","journal-title":"J Big Data"},{"key":"135_CR132","unstructured":"Nei F, Huang Y, Wang X, Huang H (2014) New primal svm solver with linear computational cost for big data classifications. In: Proceedings of the 31st international conference on machine learning, JMLR, pp 1\u20139"},{"issue":"9","key":"135_CR133","doi-asserted-by":"crossref","first-page":"667","DOI":"10.1038\/nrg3305","volume":"13","author":"A Nekrutenko","year":"2012","unstructured":"Nekrutenko A, Taylor J (2012) Next-generation sequencing data interpretation: enhancing reproducibility and accessibility. Nat Rev Genet 13(9):667\u2013672","journal-title":"Nat Rev Genet"},{"issue":"5","key":"135_CR134","doi-asserted-by":"crossref","first-page":"471","DOI":"10.1038\/nmeth.1938","volume":"9","author":"T Nepusz","year":"2012","unstructured":"Nepusz T, Yu H, Paccanaro A (2012) Detecting overlapping protein complexes in protein-protein interaction networks. Nat Methods 9(5):471\u2013472","journal-title":"Nat Methods"},{"issue":"5","key":"135_CR135","doi-asserted-by":"crossref","first-page":"1003","DOI":"10.1109\/TKDE.2002.1033770","volume":"14","author":"RT Ng","year":"2002","unstructured":"Ng RT, Han J (2002) Clarans: a method for clustering objects for spatial data mining. Knowl Data Eng IEEE Trans 14(5):1003\u20131016","journal-title":"Knowl Data Eng IEEE Trans"},{"key":"135_CR136","unstructured":"Ngiam J, Khosla A, Kim M, Nam J, Lee H, Ng AY (2011) Multimodal deep learning. In: Proceedings of the 28th international conference on machine learning (ICML-11), pp 689\u2013696"},{"issue":"23","key":"135_CR137","doi-asserted-by":"crossref","first-page":"3014","DOI":"10.1093\/bioinformatics\/btt528","volume":"29","author":"H Nordberg","year":"2013","unstructured":"Nordberg H, Bhatia K, Wang K, Wang Z (2013) BioPig: a Hadoop-based analytic toolkit for large-scale sequence data. Bioinformatics 29(23):3014\u20133019","journal-title":"Bioinformatics"},{"issue":"2","key":"135_CR138","doi-asserted-by":"crossref","first-page":"0096","DOI":"10.1109\/MIS.2013.39","volume":"28","author":"DE O\u2019Leary","year":"2013","unstructured":"O\u2019Leary DE (2013) Artificial intelligence and big data. IEEE Intell Syst 28(2):0096\u201399","journal-title":"IEEE Intell Syst"},{"issue":"8","key":"135_CR139","doi-asserted-by":"crossref","first-page":"909","DOI":"10.1109\/TKDE.2004.25","volume":"16","author":"C Ordonez","year":"2004","unstructured":"Ordonez C, Omiecinski E (2004) Efficient disk-based k-means clustering for relational databases. Knowl Data Eng IEEE Trans 16(8):909\u2013921","journal-title":"Knowl Data Eng IEEE Trans"},{"issue":"11","key":"135_CR140","doi-asserted-by":"crossref","first-page":"1092","DOI":"10.14778\/2536222.2536234","volume":"6","author":"M Ovsiannikov","year":"2013","unstructured":"Ovsiannikov M, Rus S, Reeves D, Sutter P, Rao S, Kelly J (2013) The quantcast file system. Proc VLDB Endow 6(11):1092\u20131101","journal-title":"Proc VLDB Endow"},{"key":"135_CR141","unstructured":"Owen S, Anil R, Dunning T, Friedman E (2011) Mahout in action. Manning, Shelter Island, NY"},{"key":"135_CR142","unstructured":"Page M, Molina M, Gordon J (2013) The mobile economy 2013. ATKearney [Online]. http:\/\/www.atkearney.com\/documents\/10192\/760890\/The_Mobile_Economy_2013. pdf . Accessed 09 Feb 2015"},{"key":"135_CR143","doi-asserted-by":"crossref","unstructured":"Pareto V (1964) Cours d\u2019\u00e9conomie politique. Droz, Gen\u00e8ve","DOI":"10.3917\/droz.paret.1964.01"},{"key":"135_CR144","unstructured":"Park BH, Kargupta H (2002) Distributed data mining: algorithms, systems, and applications. In: Data mining handbook, pp 341\u2013358"},{"key":"135_CR145","doi-asserted-by":"crossref","unstructured":"Park JS, Chen MS, Yu PS (1995) An effective hash-based algorithm for mining association rules","DOI":"10.1145\/223784.223813"},{"key":"135_CR146","doi-asserted-by":"crossref","unstructured":"Park JS, Chen MS, Yu PS (1995) Efficient parallel data mining for association rules. In: Proceedings of the fourth international conference on Information and knowledge management. ACM, pp 31\u201336","DOI":"10.1145\/221270.221320"},{"issue":"1","key":"135_CR147","doi-asserted-by":"crossref","first-page":"267","DOI":"10.1186\/1471-2105-14-267","volume":"14","author":"YS Park","year":"2013","unstructured":"Park YS, Schmidt M, Martin ER, Pericak-Vance MA, Chung RH (2013) Pathway-PDT: a flexible pathway analysis tool for nuclear families. BMC Bioinf 14(1):267","journal-title":"BMC Bioinf"},{"issue":"12","key":"135_CR148","doi-asserted-by":"crossref","first-page":"3364","DOI":"10.1109\/TBME.2012.2212438","volume":"60","author":"JH Phan","year":"2013","unstructured":"Phan JH, Young AN, Wang MD (2013) omniBiomarker: a web-based application for knowledge-driven biomarker identification. Biomed Eng IEEE Trans 60(12):3364\u20133367","journal-title":"Biomed Eng IEEE Trans"},{"key":"135_CR149","doi-asserted-by":"crossref","first-page":"242","DOI":"10.1007\/978-3-642-16001-1_21","volume":"6282","author":"B Pontes","year":"2010","unstructured":"Pontes B, Gir\u00e1ldez R, Aguilar-Ruiz J (2010) Measuring the quality of shifting and scaling patterns in biclusters. Pattern Recognit Bioinf 6282:242\u2013252","journal-title":"Pattern Recognit Bioinf"},{"issue":"9","key":"135_CR150","doi-asserted-by":"crossref","first-page":"1122","DOI":"10.1093\/bioinformatics\/btl060","volume":"22","author":"A Preli\u0107","year":"2006","unstructured":"Preli\u0107 A, Bleuler S, Zimmermann P, Wille A, B\u00fchlmann P, Gruissem W, Hennig L, Thiele L, Zitzler E (2006) A systematic comparison and evaluation of biclustering methods for gene expression data. Bioinformatics 22(9):1122\u20131129","journal-title":"Bioinformatics"},{"issue":"5","key":"135_CR151","doi-asserted-by":"crossref","first-page":"1155","DOI":"10.1175\/MWR2906.1","volume":"133","author":"AE Raftery","year":"2005","unstructured":"Raftery AE, Gneiting T, Balabdaoui F, Polakowski M (2005) Using bayesian model averaging to calibrate forecast ensembles. Mon Weather Rev 133(5):1155\u20131174","journal-title":"Mon Weather Rev"},{"key":"135_CR152","doi-asserted-by":"crossref","unstructured":"Rana O, Walker D, Li M, Lynden S, Ward M (2000) Paddmas: parallel and distributed data mining application suite. In: Parallel and distributed processing symposium, 2000. IPDPS 2000. Proceedings. 14th International. IEEE, pp 387\u2013392","DOI":"10.1109\/IPDPS.2000.846010"},{"issue":"10","key":"135_CR153","doi-asserted-by":"crossref","first-page":"1060","DOI":"10.1001\/jama.2013.276733","volume":"310","author":"M Reed","year":"2013","unstructured":"Reed M, Huang J, Brand R, Graetz I, Neugebauer R, Fireman B, Jaffe M, Ballard DW, Hsu J (2013) Implementation of an outpatient electronic health record and emergency department visits, hospitalizations, and office visits among patients with diabetes. JAMA 310(10):1060\u20131065","journal-title":"JAMA"},{"issue":"Suppl 1","key":"135_CR154","doi-asserted-by":"crossref","first-page":"S61","DOI":"10.1186\/1471-2105-11-S1-S61","volume":"11","author":"CG Rivera","year":"2010","unstructured":"Rivera CG, Vakil R, Bader JS (2010) NeMo: network module identification in Cytoscape. BMC Bioinf 11(Suppl 1):S61","journal-title":"BMC Bioinf"},{"key":"135_CR155","unstructured":"Robison RJ (2014) How big is the human genome? Precis Med"},{"key":"135_CR156","unstructured":"Rojahn SY (2012) Breaking the genome bottleneck. MIT Technol Rev"},{"issue":"3","key":"135_CR157","first-page":"32","volume":"3","author":"S Roy","year":"2008","unstructured":"Roy S, Bhattacharyya DK (2008) Opam: an efficient one pass association mining technique without candidate generation. J Convergence Inf Technol 3(3):32\u201338","journal-title":"J Convergence Inf Technol"},{"issue":"Suppl 7","key":"135_CR158","doi-asserted-by":"crossref","first-page":"S10","DOI":"10.1186\/1471-2105-15-S7-S10","volume":"15","author":"S Roy","year":"2014","unstructured":"Roy S, Bhattacharyya DK, Kalita JK (2014) Reconstruction of gene co-expression network from microarray data using local expression patterns. BMC Bioinf 15(Suppl 7):S10","journal-title":"BMC Bioinf"},{"key":"135_CR159","doi-asserted-by":"publisher","first-page":"91","DOI":"10.1007\/7651_2015_280","volume":"1375","author":"S Roy","year":"2015","unstructured":"Roy S, Bhattacharyya DK, Kalita JK (2015) Analysis of gene expression patterns using biclustering. Methods Mol Biol 1375:91\u2013103. doi: 10.1007\/7651_2015_280","journal-title":"Methods Mol Biol"},{"key":"135_CR160","unstructured":"Savasere A, Omiecinski ER, Navathe SB (1995) An efficient algorithm for mining association rules in large databases"},{"issue":"1","key":"135_CR161","doi-asserted-by":"crossref","first-page":"119","DOI":"10.1093\/bioinformatics\/btt601","volume":"30","author":"A Schumacher","year":"2014","unstructured":"Schumacher A, Pireddu L, Niemenmaa M, Kallio A, Korpelainen E, Zanetti G, Heljanko K (2014) SeqPig: simple and scalable scripting for large sequencing data sets in Hadoop. Bioinformatics 30(1):119\u2013120","journal-title":"Bioinformatics"},{"issue":"3\u20134","key":"135_CR162","doi-asserted-by":"crossref","first-page":"289","DOI":"10.1007\/s007780050009","volume":"8","author":"G Sheikholeslami","year":"2000","unstructured":"Sheikholeslami G, Chatterjee S, Zhang A (2000) Wavecluster: a wavelet-based clustering approach for spatial data in very large databases. VLDB J 8(3\u20134):289\u2013304","journal-title":"VLDB J"},{"key":"135_CR163","doi-asserted-by":"crossref","unstructured":"Shi W, Guo YF, Jin C, Xue X (2008) An improved generalized discriminant analysis for large-scale data set. In: Machine learning and applications, 2008. ICMLA\u201908. Seventh International Conference. IEEE, pp 769\u2013772","DOI":"10.1109\/ICMLA.2008.41"},{"key":"135_CR164","doi-asserted-by":"crossref","unstructured":"Shvachko K, Kuang H, Radia S, Chansler R (2010) The hadoop distributed file system. In: Mass storage systems and technologies (MSST), 2010 IEEE 26th Symposium. IEEE, pp 1\u201310","DOI":"10.1109\/MSST.2010.5496972"},{"issue":"4","key":"135_CR165","doi-asserted-by":"crossref","first-page":"253","DOI":"10.4258\/hir.2010.16.4.253","volume":"16","author":"YJ Son","year":"2010","unstructured":"Son YJ, Kim HG, Kim EH, Choi S, Lee SK (2010) Application of support vector machine for prediction of medication adherence in heart failure patients. Healthc Inf Res 16(4):253\u2013259","journal-title":"Healthc Inf Res"},{"key":"135_CR166","doi-asserted-by":"crossref","unstructured":"Srikant R, Agrawal R (1996) Mining quantitative association rules in large relational tables. In: ACM SIGMOD record, vol\u00a025. ACM, pp 1\u201312","DOI":"10.1145\/233269.233311"},{"issue":"6","key":"135_CR167","doi-asserted-by":"crossref","first-page":"1068","DOI":"10.1007\/s10439-007-9313-y","volume":"35","author":"TH Stokes","year":"2007","unstructured":"Stokes TH, Moffitt RA, Phan JH, Wang MD (2007) chip artifact CORRECTion (caCORRECT): a bioinformatics system for quality assurance of genomics and proteomics array data. Ann Biomed Eng 35(6):1068\u20131080","journal-title":"Ann Biomed Eng"},{"issue":"1","key":"135_CR168","first-page":"1371","volume":"15","author":"M Tan","year":"2014","unstructured":"Tan M, Tsang IW, Wang L (2014) Towards ultrahigh dimensional feature selection for big data. J Mach Learn Res 15(1):1371\u20131429","journal-title":"J Mach Learn Res"},{"key":"135_CR169","unstructured":"Tan PN, Steinbach K, Kumar V (2006) Data mining cluster analysis: basic concepts and algorithms"},{"issue":"9","key":"135_CR170","doi-asserted-by":"crossref","first-page":"2981","DOI":"10.1073\/pnas.0308661100","volume":"101","author":"A Tanay","year":"2004","unstructured":"Tanay A, Sharan R, Kupiec M, Shamir R (2004) Revealing modularity and organization in the yeast molecular network by integrated analysis of highly heterogeneous genome wide data. Proc Natl Acad Sci 101(9):2981\u20132986","journal-title":"Proc Natl Acad Sci"},{"key":"135_CR171","unstructured":"Thomas S, Bodagala S, Alsabti K, Ranka S (1997) An efficient algorithm for the incremental updation of association rules in large databases. In: KDD, pp 263\u2013266"},{"issue":"1","key":"135_CR172","doi-asserted-by":"crossref","first-page":"29","DOI":"10.1007\/s12065-013-0098-7","volume":"7","author":"SA Thomas","year":"2014","unstructured":"Thomas SA, Jin Y (2014) Reconstructing biological gene regulatory networks: where optimization meets big data. Evol Intell 7(1):29\u201347","journal-title":"Evol Intell"},{"key":"135_CR173","first-page":"134","volume":"96","author":"H Toivonen","year":"1996","unstructured":"Toivonen H et al (1996) Sampling large databases for association rules. VLDB 96:134\u2013145","journal-title":"VLDB"},{"issue":"9","key":"135_CR174","doi-asserted-by":"publisher","first-page":"3785","DOI":"10.1093\/nar\/gkr1265","volume":"40","author":"GC Tseng","year":"2012","unstructured":"Tseng GC, Ghosh D, Feingold E (2012) Comprehensive literature review and statistical considerations for microarray meta-analysis. Nucleic Acids Res 40(9):3785\u20133799. doi: 10.1093\/nar\/gkr1265","journal-title":"Nucleic Acids Res"},{"key":"135_CR175","doi-asserted-by":"crossref","unstructured":"Tsiliki G, Vlachakis D, Kossida S (2014) On integrating multi-experiment microarray data. Philos Trans R Soc Lond A Math Phys Eng Sci 372(2016):20130,136","DOI":"10.1098\/rsta.2013.0136"},{"key":"135_CR176","unstructured":"Turner V, Gantz J, Reinsel D, Minton S (2014) The digital universe of opportunities: rich data and the increasing value of the internet of things. International Data Corporation, White Paper, IDC_1672"},{"issue":"1","key":"135_CR81","doi-asserted-by":"crossref","first-page":"399","DOI":"10.1186\/1471-2105-9-399","volume":"9","author":"MP Iersel van","year":"2008","unstructured":"van Iersel MP, Kelder T, Pico AR, Hanspers K, Coort S, Conklin BR, Evelo C (2008) Presenting and exploring biological pathways with PathVisio. BMC Bioinf 9(1):399","journal-title":"BMC Bioinf"},{"key":"135_CR177","doi-asserted-by":"crossref","unstructured":"Widyantoro DH, Ioerger TR, Yen J (2002) An incremental approach to building a cluster hierarchy. In: Data mining, 2002. ICDM 2003. Proceedings. 2002 IEEE International Conference. IEEE, pp 705\u2013708","DOI":"10.1109\/ICDM.2002.1184034"},{"key":"135_CR178","doi-asserted-by":"crossref","unstructured":"Wright R, Yang Z (2004) Privacy-preserving bayesian network structure computation on distributed heterogeneous data. In: Proceedings of the tenth ACM SIGKDD international conference on Knowledge discovery and data mining. ACM, pp 713\u2013718","DOI":"10.1145\/1014052.1014145"},{"key":"135_CR179","doi-asserted-by":"crossref","unstructured":"Xu X, J\u00e4ger J, Kriegel HP (2002) A fast parallel clustering algorithm for large spatial databases. In: High performance data mining. Springer, US, pp 263\u2013290","DOI":"10.1007\/0-306-47011-X_3"},{"key":"135_CR180","doi-asserted-by":"crossref","unstructured":"Yang J, Wang H, Wang W, Yu P (2003) Enhanced biclustering on expression data. In: Proceedings of Third IEEE Symposium on Bioinformatics and Bioengineering, pp 321\u2013327","DOI":"10.1109\/BIBE.2003.1188969"},{"issue":"6","key":"135_CR181","doi-asserted-by":"crossref","first-page":"808","DOI":"10.1093\/bioinformatics\/btt616","volume":"30","author":"P Yang","year":"2014","unstructured":"Yang P, Patrick E, Tan SX, Fazakerley DJ, Burchfield J, Gribben C, Prior MJ, James DE, Yang YH (2014) Direction pathway analysis of large-scale proteomics data reveals novel features of the insulin action pathway. Bioinformatics 30(6):808\u2013814","journal-title":"Bioinformatics"},{"issue":"4","key":"135_CR182","doi-asserted-by":"crossref","first-page":"568","DOI":"10.1109\/TKDE.2010.150","volume":"23","author":"WH Yang","year":"2011","unstructured":"Yang WH, Dai DQ, Yan H (2011) Finding correlated biclusters from gene expression data. Knowl Data Eng IEEE Trans 23(4):568\u2013584","journal-title":"Knowl Data Eng IEEE Trans"},{"key":"135_CR183","doi-asserted-by":"crossref","unstructured":"Ye J, Chow JH, Chen J, Zheng Z (2009) Stochastic gradient boosted distributed decision trees. In: Proceedings of the 18th ACM conference on Information and knowledge management. ACM, pp 2061\u20132064","DOI":"10.1145\/1645953.1646301"},{"issue":"2","key":"135_CR184","doi-asserted-by":"crossref","first-page":"50","DOI":"10.5213\/inj.2014.18.2.50","volume":"18","author":"C Yoo","year":"2014","unstructured":"Yoo C, Ramirez L, Liuzzi J (2014) Big data analysis using modern statistical and machine learning methods in medicine. Int Neurourol J 18(2):50\u201357","journal-title":"Int Neurourol J"},{"issue":"4","key":"135_CR185","doi-asserted-by":"crossref","first-page":"831","DOI":"10.1016\/j.urology.2010.12.008","volume":"77","author":"T Yuasa","year":"2011","unstructured":"Yuasa T, Urakami S, Yamamoto S, Yonese J, Nakano K, Kodaira M, Takahashi S, Hatake K, Inamura K, Ishikwa Y et al (2011) Tumor size is a potential predictor of response to tyrosine kinase inhibitors in renal cell cancer. Urology 77(4):831\u2013835","journal-title":"Urology"},{"key":"135_CR186","unstructured":"Zaharia M, Chowdhury M, Das T, Dave A, Ma J, McCauley M, Franklin MJ, Shenker S, Stoica I (2012) Resilient distributed datasets: a fault-tolerant abstraction for in-memory cluster computing. In: Proceedings of the 9th USENIX conference on Networked Systems Design and Implementation. USENIX Association, p 2"},{"issue":"16","key":"135_CR187","doi-asserted-by":"crossref","first-page":"2209","DOI":"10.1093\/bioinformatics\/bts366","volume":"28","author":"AC Zambon","year":"2012","unstructured":"Zambon AC, Gaj S, Ho I, Hanspers K, Vranizan K, Evelo CT, Conklin BR, Pico AR, Salomonis N (2012) GO-Elite: a flexible solution for pathway and ontology over-representation. Bioinformatics 28(16):2209\u20132210","journal-title":"Bioinformatics"},{"key":"135_CR188","doi-asserted-by":"crossref","first-page":"39","DOI":"10.1016\/j.fss.2014.08.014","volume":"258","author":"A Zeng","year":"2015","unstructured":"Zeng A, Li T, Liu D, Zhang J, Chen H (2015) A fuzzy rough set approach for incremental feature selection on hybrid information systems. Fuzzy Sets Syst 258:39\u201360","journal-title":"Fuzzy Sets Syst"},{"key":"135_CR189","unstructured":"Zeng HJ, Chen Z, Ma WY (2002) A unified framework for clustering heterogeneous web objects. In: Web information systems engineering, 2002. WISE 2002. In: Proceedings of the third international conference. IEEE, pp 161\u2013170"},{"key":"135_CR190","doi-asserted-by":"crossref","unstructured":"Zhang S, Wu X, Zhang J, Zhang C (2005) A decremental algorithm for maintaining frequent itemsets in dynamic databases. In: Data warehousing and knowledge discovery. Springer, Berlin, Heidelberg, pp 305\u2013314","DOI":"10.1007\/11546849_30"},{"key":"135_CR191","doi-asserted-by":"crossref","unstructured":"Zhang T, Ramakrishnan R, Livny M (1996) Birch: an efficient data clustering method for very large databases. In: ACM SIGMOD record, vol\u00a025. ACM, pp 103\u2013114","DOI":"10.1145\/233269.233324"},{"key":"135_CR192","doi-asserted-by":"publisher","unstructured":"Zhao L, Zaki MJ (2005) Tricluster: an effective algorithm for mining coherent clusters in 3D microarray data. ACM, pp 694\u2013705. doi: 10.1145\/1066157.1066236","DOI":"10.1145\/1066157.1066236"},{"key":"135_CR193","doi-asserted-by":"crossref","first-page":"481545","DOI":"10.1155\/2013\/481545","volume":"2013","author":"S Zhao","year":"2013","unstructured":"Zhao S, Prenger K, Smith L (2013) Stormbow: a cloud-based tool for reads mapping and expression quantification in large-scale RNA-Seq studies. ISRN Bioinform 2013:481545","journal-title":"ISRN Bioinform"},{"issue":"1","key":"135_CR194","doi-asserted-by":"crossref","first-page":"425","DOI":"10.1186\/1471-2164-14-425","volume":"14","author":"S Zhao","year":"2013","unstructured":"Zhao S, Prenger K, Smith L, Messina T, Fan H, Jaeger E, Stephens S (2013) Rainbow: a tool for large-scale whole-genome sequencing data analysis using cloud computing. BMC Genomics 14(1):425","journal-title":"BMC Genomics"},{"key":"135_CR195","doi-asserted-by":"crossref","unstructured":"Zhao W, Ma H, He Q (2009) Parallel k-means clustering based on mapreduce. In: Cloud computing. Springer, Berlin, Heidelberg, pp 674\u2013679","DOI":"10.1007\/978-3-642-10665-1_71"},{"issue":"4","key":"135_CR196","doi-asserted-by":"crossref","first-page":"62","DOI":"10.1109\/MCI.2014.2350953","volume":"9","author":"Z Zhou","year":"2014","unstructured":"Zhou Z, Chawla N, Jin Y, Williams G (2014) Big data opportunities and challenges: discussions from data analytics perspectives [discussion forum]. Comput Intell Mag IEEE 9(4):62\u201374","journal-title":"Comput Intell Mag IEEE"}],"container-title":["Network Modeling Analysis in Health Informatics and Bioinformatics"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s13721-016-0135-4.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s13721-016-0135-4\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s13721-016-0135-4","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s13721-016-0135-4.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2023,8,19]],"date-time":"2023-08-19T23:14:06Z","timestamp":1692486846000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s13721-016-0135-4"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2016,9,1]]},"references-count":196,"journal-issue":{"issue":"1","published-print":{"date-parts":[[2016,12]]}},"alternative-id":["135"],"URL":"https:\/\/doi.org\/10.1007\/s13721-016-0135-4","relation":{},"ISSN":["2192-6662","2192-6670"],"issn-type":[{"value":"2192-6662","type":"print"},{"value":"2192-6670","type":"electronic"}],"subject":[],"published":{"date-parts":[[2016,9,1]]},"article-number":"28"}}