{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2024,9,9]],"date-time":"2024-09-09T13:31:17Z","timestamp":1725888677577},"publisher-location":"Cham","reference-count":46,"publisher":"Springer International Publishing","isbn-type":[{"type":"print","value":"9783319597720"},{"type":"electronic","value":"9783319597737"}],"license":[{"start":{"date-parts":[[2017,1,1]],"date-time":"2017-01-01T00:00:00Z","timestamp":1483228800000},"content-version":"unspecified","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2017]]},"DOI":"10.1007\/978-3-319-59773-7_26","type":"book-chapter","created":{"date-parts":[[2017,5,26]],"date-time":"2017-05-26T09:13:19Z","timestamp":1495789999000},"page":"249-258","source":"Crossref","is-referenced-by-count":1,"title":["Big Data Infrastructure: A Survey"],"prefix":"10.1007","author":[{"given":"Jaime","family":"Salvador","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Zoila","family":"Ruiz","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jose","family":"Garcia-Rodriguez","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2017,5,27]]},"reference":[{"issue":"3","key":"26_CR1","doi-asserted-by":"crossref","first-page":"87","DOI":"10.1016\/j.bdr.2015.04.001","volume":"2","author":"OY Al-Jarrah","year":"2015","unstructured":"Al-Jarrah, O.Y., Yoo, P.D., Muhaidat, S., Karagiannidis, G.K., Taha, K.: Efficient machine learning for big data: a review. Big Data Res. 2(3), 87\u201393 (2015)","journal-title":"Big Data Res."},{"key":"26_CR2","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1016\/j.bdr.2016.07.002","volume":"6","author":"S Aridhi","year":"2016","unstructured":"Aridhi, S., Mephu, E.: Big graph mining: frameworks and techniques. Big Data Res. 6, 1\u201310 (2016)","journal-title":"Big Data Res."},{"key":"26_CR3","doi-asserted-by":"crossref","unstructured":"Armbrust, M., Ghodsi, A., Zaharia, M., Xin, R.S., Lian, C., Huai, Y., Liu, D., Bradley, J.K., Meng, X., Kaftan, T., Franklin, M.J.: Spark SQL: relational data processing in spark michael. In: Proceedings of the ACM SIGMOD International Conference on Management of Data - SIGMOD 2015, pp. 1383\u20131394 (2015)","DOI":"10.1145\/2723372.2742797"},{"key":"26_CR4","first-page":"489","volume":"27","author":"M Bertolucci","year":"2016","unstructured":"Bertolucci, M., Carlini, E., Dazzi, P., Lulli, A., Ricci, L.: Static and dynamic big data partitioning on apache spark. Adv. Parallel Comput. 27, 489\u2013498 (2016)","journal-title":"Adv. Parallel Comput."},{"key":"26_CR5","unstructured":"Borthakur, D.: HDFS architecture guide. Hadoop Apache Project, 1\u201313 (2008). https:\/\/hadoop.apache.org\/docs\/r1.2.1\/hdfs_design.pdf"},{"key":"26_CR6","series-title":"Advances in Intelligent and Soft Computing","doi-asserted-by":"crossref","first-page":"443","DOI":"10.1007\/978-3-642-12433-4_53","volume-title":"Trends in Practical Applications of Agents and Multiagent Systems","author":"SJL Castillo","year":"2010","unstructured":"Castillo, S.J.L., del Castillo, J.R.F., Sotos, L.G.: Algorithms of machine learning for K-clustering. In: Demazeau, Y., et al. (eds.) Trends in Practical Applications of Agents and Multiagent Systems. AISC, vol. 71, pp. 443\u2013452. Springer, Heidelberg (2010)"},{"key":"26_CR7","doi-asserted-by":"crossref","unstructured":"Catanzaro, B., Sundaram, N., Keutzer, K.: Fast support vector machine training and classication on graphics processors. In: Machine Learning, pp. 104\u2013111 (2008)","DOI":"10.1145\/1390156.1390170"},{"issue":"1","key":"26_CR8","doi-asserted-by":"crossref","first-page":"23","DOI":"10.1186\/s40537-015-0029-9","volume":"2","author":"M Crawford","year":"2015","unstructured":"Crawford, M., Khoshgoftaar, T.M., Prusa, J.D., Richter, A.N., Al Najada, H.: Survey of review spam detection using machine learning techniques. J. Big Data 2(1), 23 (2015)","journal-title":"J. Big Data"},{"key":"26_CR9","unstructured":"Dean, J., Ghemawat, S.: MapReduce: simplified data processing on large clusters. In: Proceedings of 6th Symposium on Operating Systems Design and Implementation, pp. 137\u2013149 (2004)"},{"issue":"8","key":"26_CR10","first-page":"17737","volume":"5","author":"Nagina","year":"2016","unstructured":"Nagina, Dhingra, S.: Scheduling algorithms in big data: a survey. Int. J. Eng. Comput. Sci. 5(8), 17737\u201317743 (2016)","journal-title":"Int. J. Eng. Comput. Sci."},{"issue":"2","key":"26_CR11","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1145\/2481244.2481246","volume":"14","author":"W Fan","year":"2013","unstructured":"Fan, W., Bifet, A.: Mining big data: current status, and forecast to the future. ACM SIGKDD Explor. Newslett. 14(2), 1\u20135 (2013)","journal-title":"ACM SIGKDD Explor. Newslett."},{"issue":"2","key":"26_CR12","doi-asserted-by":"crossref","first-page":"137","DOI":"10.1016\/j.ijinfomgt.2014.10.007","volume":"35","author":"A Gandomi","year":"2015","unstructured":"Gandomi, A., Haider, M.: Beyond the hype: big data concepts, methods, and analytics. Int. J. Inf. Manag. 35(2), 137\u2013144 (2015)","journal-title":"Int. J. Inf. Manag."},{"key":"26_CR13","doi-asserted-by":"crossref","unstructured":"Ghemawat, S., Gobioff, H., Leung, S.: Google file system (2003)","DOI":"10.1145\/945445.945450"},{"key":"26_CR14","doi-asserted-by":"crossref","unstructured":"Guller, M.: Big Data Analytics with Spark (2015). ISBN 9781484209653","DOI":"10.1007\/978-1-4842-0964-6"},{"key":"26_CR15","series-title":"Advances in Intelligent Systems and Computing","doi-asserted-by":"publisher","first-page":"692","DOI":"10.1007\/978-3-319-48308-5_66","volume-title":"Proceedings of the International Conference on Advanced Intelligent Systems and Informatics 2016","author":"MM Hafez","year":"2017","unstructured":"Hafez, M.M., Shehab, M.E., El Fakharany, E., Abdel Ghfar Hegazy, A.E.F.: Effective selection of machine learning algorithms for big data analytics using apache spark. In: Hassanien, A.E., Shaalan, K., Gaber, T., Azar, A.T., Tolba, M.F. (eds.) AISI 2016. AISC, vol. 533, pp. 692\u2013704. Springer, Cham (2017). doi: 10.1007\/978-3-319-48308-5_66"},{"issue":"1","key":"26_CR16","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1007\/s11192-016-2008-0","volume":"109","author":"IAT Hashem","year":"2016","unstructured":"Hashem, I.A.T., Anuar, N.B., Gani, A., Yaqoob, I., Xia, F., Khan, S.U.: MapReduce: review and open challenges. Scientometrics 109(1), 1\u201334 (2016)","journal-title":"Scientometrics"},{"issue":"4","key":"26_CR17","first-page":"327","volume":"27","author":"Q He","year":"2014","unstructured":"He, Q., Li, N., Luo, W.J., Shi, Z.Z.: A survey of machine learning for big data processing. Moshi Shibie yu Rengong Zhineng\/Pattern Recogn. Artif. Intell. 27(4), 327\u2013336 (2014)","journal-title":"Moshi Shibie yu Rengong Zhineng\/Pattern Recogn. Artif. Intell."},{"key":"26_CR18","doi-asserted-by":"crossref","first-page":"24","DOI":"10.1016\/j.neunet.2015.08.011","volume":"78","author":"VJ Hodge","year":"2016","unstructured":"Hodge, V.J., Keefe, S.O., Austin, J.: Hadoop neural network for parallel and distributed feature selection. Neural Netw. 78, 24\u201335 (2016)","journal-title":"Neural Netw."},{"key":"26_CR19","unstructured":"Holmes, A.: Hadoop in Practice. Manning, 2nd edn. (2015). ISBN 9781617292224"},{"issue":"1","key":"26_CR20","doi-asserted-by":"crossref","first-page":"10","DOI":"10.1186\/2192-113X-1-10","volume":"1","author":"J Issa","year":"2012","unstructured":"Issa, J., Figueira, S.: Hadoop and memcached: performance and power characterization and analysis. J. Cloud Comput.: Adv. Syst. Appl. 1(1), 10 (2012)","journal-title":"J. Cloud Comput.: Adv. Syst. Appl."},{"key":"26_CR21","doi-asserted-by":"crossref","first-page":"517","DOI":"10.1016\/j.procs.2015.04.025","volume":"50","author":"JC Jackson","year":"2015","unstructured":"Jackson, J.C., Vijayakumar, V., Quadir, M.A., Bharathi, C.: Survey on programming models and environments for cluster, cloud, and grid computing that defends big data. Procedia Comput. Sci. 50, 517\u2013523 (2015)","journal-title":"Procedia Comput. Sci."},{"issue":"December 2015","key":"26_CR22","first-page":"571","volume":"78","author":"A Jain","year":"2016","unstructured":"Jain, A., Bhatnagar, V.: Crime data analysis using pig with Hadoop. Phys. Procedia 78(December 2015), 571\u2013578 (2016)","journal-title":"Phys. Procedia"},{"issue":"1","key":"26_CR23","doi-asserted-by":"crossref","first-page":"369","DOI":"10.1007\/s10586-014-0400-1","volume":"18","author":"H Jiang","year":"2015","unstructured":"Jiang, H., Chen, Y., Qiao, Z., Weng, T.H., Li, K.C.: Scaling up MapReduce-based big data processing on multi-GPU systems. Cluster Comput. 18(1), 369\u2013383 (2015)","journal-title":"Cluster Comput."},{"key":"26_CR24","doi-asserted-by":"crossref","first-page":"70","DOI":"10.1016\/j.cosrev.2015.05.002","volume":"17","author":"C Kacfah Emani","year":"2015","unstructured":"Kacfah Emani, C., Cullot, N., Nicolle, C.: Understandable big data: a survey. Comput. Sci. Rev. 17, 70\u201381 (2015)","journal-title":"Comput. Sci. Rev."},{"issue":"3","key":"26_CR25","doi-asserted-by":"crossref","first-page":"199","DOI":"10.1023\/A:1026351106797","volume":"53","author":"T Kamishima","year":"2003","unstructured":"Kamishima, T., Motoyoshi, F.: Learning from cluster examples. Mach. Learn. 53(3), 199\u2013233 (2003)","journal-title":"Mach. Learn."},{"issue":"3","key":"26_CR26","first-page":"317","volume":"4","author":"M Kiran","year":"2013","unstructured":"Kiran, M., Kumar, A., Mukherjee, S., Ravi Prakash, G.: Verification and validation of MapReduce program model for parallel support vector machine algorithm on Hadoop cluster. Int. Conf. Adv. Comput. Communi. Syst. (ICACCS) 4(3), 317\u2013325 (2013)","journal-title":"Int. Conf. Adv. Comput. Communi. Syst. (ICACCS)"},{"key":"26_CR27","unstructured":"Kirk, D., Hwu, W.-M.W.: Processors, Programming Massively Parallel: A Hands-on Approach (2010). ISBN 0123814723"},{"key":"26_CR28","unstructured":"Kraska, T., Talwalkar, A., Duchi, J., Griffith, R., Franklin, M., Jordan, M.: MLbase: a distributed machine-learning system. In: 6th Biennial Conference on Innovative Data Systems Research (CIDR 2013) (2013)"},{"issue":"1","key":"26_CR29","doi-asserted-by":"crossref","first-page":"24","DOI":"10.1186\/s40537-015-0032-1","volume":"2","author":"S Landset","year":"2015","unstructured":"Landset, S., Khoshgoftaar, T.M., Richter, A.N., Hasanin, T.: A survey of open source tools for machine learning with big data in the Hadoop ecosystem. J. Big Data 2(1), 24 (2015)","journal-title":"J. Big Data"},{"key":"26_CR30","first-page":"1","volume":"17","author":"X Meng","year":"2016","unstructured":"Meng, X., Bradley, J., Yavuz, B., Sparks, E., Venkataraman, S., Liu, D., Freeman, J., Tsai, D.B., Amde, M., Owen, S., Xin, D., Xin, R., Franklin, M.J., Zadeh, R., Zaharia, M., Talwalkar, A.: MLlib: machine learning in apache spark. J. Mach. Learn. Res. 17, 1\u20137 (2016)","journal-title":"J. Mach. Learn. Res."},{"issue":"3","key":"26_CR31","doi-asserted-by":"crossref","first-page":"217","DOI":"10.1023\/A:1024016609528","volume":"52","author":"DS Modha","year":"2003","unstructured":"Modha, D.S., Spangler, W.S.: Feature weighting in k-means clustering. Mach. Learn. 52(3), 217\u2013237 (2003)","journal-title":"Mach. Learn."},{"key":"26_CR32","doi-asserted-by":"crossref","first-page":"9","DOI":"10.1016\/j.bdr.2016.02.002","volume":"5","author":"M Naimur Rahman","year":"2016","unstructured":"Naimur Rahman, M., Esmailpour, A., Zhao, J.: Machine learning with big data an efficient electricity generation forecasting system. Big Data Res. 5, 9\u201315 (2016)","journal-title":"Big Data Res."},{"issue":"8","key":"26_CR33","first-page":"48","volume":"3","author":"D Namiot","year":"2015","unstructured":"Namiot, D.: On big data stream processing. Int. J. Open Inf. Technol. 3(8), 48\u201351 (2015)","journal-title":"Int. J. Open Inf. Technol."},{"key":"26_CR34","doi-asserted-by":"crossref","unstructured":"Nguyen, T.T.T., Armitage, G.: A survey of techniques for internet traffic classification using machine learning. IEEE Commun. Surveys Tutorials 10(4) (2008)","DOI":"10.1109\/SURV.2008.080406"},{"key":"26_CR35","series-title":"Lecture Notes in Business Information Processing","doi-asserted-by":"publisher","first-page":"28","DOI":"10.1007\/978-3-319-19027-3_3","volume-title":"Business Information Systems","author":"N Spangenberg","year":"2015","unstructured":"Spangenberg, N., Roth, M., Franczyk, B.: Evaluating new approaches of big data analytics frameworks. In: Abramowicz, W. (ed.) BIS 2015. LNBIP, vol. 208, pp. 28\u201337. Springer, Cham (2015). doi: 10.1007\/978-3-319-19027-3_3"},{"key":"26_CR36","unstructured":"Owen, S., Anil, R., Dunning, T., Friedman, E.: Mahout in Action. Manning (2012). ISBN 9781935182689"},{"issue":"1","key":"26_CR37","doi-asserted-by":"crossref","first-page":"6","DOI":"10.1186\/s40537-016-0041-8","volume":"3","author":"P P\u00e4\u00e4kk\u00f6nen","year":"2016","unstructured":"P\u00e4\u00e4kk\u00f6nen, P.: Feasibility analysis of AsterixDB and Spark streaming with Cassandra for stream-based processing. J. Big Data 3(1), 6 (2016)","journal-title":"J. Big Data"},{"key":"26_CR38","unstructured":"Ram\u00edrez-Gallego, S., Mouri\u00f1o-Tal\u00edn, H., Mart\u00ednez-Rego, D., Bol\u00f3n-Canedo, V., Benitez, J.M., Alonso-Betanzos, A., Herrera, F.: Un Framework de Selecci\u00f3n de Caracter\u00edsticas basado en la Teor\u00eda de la Informaci\u00f3n para Big Data sobre Apache Spark"},{"key":"26_CR39","series-title":"Lecture Notes in Business Information Processing","doi-asserted-by":"publisher","first-page":"125","DOI":"10.1007\/978-3-642-36318-4_6","volume-title":"Business Intelligence","author":"M Saecker","year":"2013","unstructured":"Saecker, M., Markl, V.: Big data analytics on modern hardware architectures: a technology survey. In: Aufaure, M.-A., Zim\u00e1nyi, E. (eds.) Business Intelligence. LNBIP, vol. 138, pp. 125\u2013149. Springer, Heidelberg (2013). doi: 10.1007\/978-3-642-36318-4_6"},{"issue":"3","key":"26_CR40","doi-asserted-by":"crossref","first-page":"145","DOI":"10.1007\/s41060-016-0027-9","volume":"1","author":"S Salloum","year":"2016","unstructured":"Salloum, S., Dautov, R., Chen, X., Peng, P.X., Huang, J.Z.: Big data analytics on Apache Spark. Int. J. Data Sci. Anal. 1(3), 145\u2013164 (2016)","journal-title":"Int. J. Data Sci. Anal."},{"key":"26_CR41","doi-asserted-by":"crossref","first-page":"596","DOI":"10.1016\/j.procs.2015.04.091","volume":"50","author":"B Saraladevi","year":"2015","unstructured":"Saraladevi, B., Pazhaniraja, N., Paul, P.V., Basha, M.S.S., Dhavachelvan, P.: Big data and Hadoop-a study in security perspective. Procedia Comput. Sci. 50, 596\u2013601 (2015)","journal-title":"Procedia Comput. Sci."},{"issue":"September 2012","key":"26_CR42","first-page":"45","volume":"910","author":"CE Seminario","year":"2012","unstructured":"Seminario, C.E., Wilson, D.C.: Case study evaluation of mahout as a recommender platform. CEUR Workshop Proc. 910(September 2012), 45\u201350 (2012)","journal-title":"CEUR Workshop Proc."},{"issue":"1","key":"26_CR43","doi-asserted-by":"crossref","first-page":"8","DOI":"10.1186\/s40537-014-0008-6","volume":"2","author":"D Singh","year":"2015","unstructured":"Singh, D., Reddy, C.K.: A survey on platforms for big data analytics. J. Big Data 2(1), 8 (2015)","journal-title":"J. Big Data"},{"issue":"1","key":"26_CR44","doi-asserted-by":"crossref","first-page":"19","DOI":"10.1186\/s40537-016-0051-6","volume":"3","author":"R Singh","year":"2016","unstructured":"Singh, R., Kaur, P.J.: Analyzing performance of Apache Tez and MapReduce with Hadoop multinode cluster on Amazon cloud. J. Big Data 3(1), 19 (2016)","journal-title":"J. Big Data"},{"key":"26_CR45","doi-asserted-by":"crossref","unstructured":"Walunj, S.G., Sadafale, K.: An online recommendation system for e-commerce based on apache mahout framework. In: Proceedings of the Annual Conference on Computers and People Research, pp. 153\u2013158 (2013)","DOI":"10.1145\/2487294.2487328"},{"key":"26_CR46","unstructured":"Zaharia, M., Chowdhury, M., Franklin, M.J., Shenker, S., Stoica, I.: Spark: cluster computing with working sets. In: HotCloud 2010 Proceedings of the 2nd USENIX Conference on Hot Topics in Cloud Computing, p. 10 (2010)"}],"container-title":["Lecture Notes in Computer Science","Biomedical Applications Based on Natural and Artificial Computing"],"original-title":[],"link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-319-59773-7_26","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2019,9,25]],"date-time":"2019-09-25T04:42:57Z","timestamp":1569386577000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/978-3-319-59773-7_26"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2017]]},"ISBN":["9783319597720","9783319597737"],"references-count":46,"URL":"https:\/\/doi.org\/10.1007\/978-3-319-59773-7_26","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"type":"print","value":"0302-9743"},{"type":"electronic","value":"1611-3349"}],"subject":[],"published":{"date-parts":[[2017]]}}}