{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,5,3]],"date-time":"2025-05-03T10:10:01Z","timestamp":1746267001708,"version":"3.40.4"},"reference-count":139,"publisher":"Auerbach Publications","isbn-type":[{"type":"print","value":"9781466581500"},{"type":"electronic","value":"9781466581517"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2014,6,24]]},"DOI":"10.1201\/b17112-3","type":"book-chapter","created":{"date-parts":[[2014,6,12]],"date-time":"2014-06-12T19:37:30Z","timestamp":1402601850000},"page":"39-106","source":"Crossref","is-referenced-by-count":5,"title":["MapReduce Family of Large-Scale Data-Processing Systems"],"prefix":"10.1201","author":[{"given":"Sherif","family":"Sakr","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Anna","family":"Liu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Ayman","family":"Fayoumi","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"301","published-online":{"date-parts":[[2014,6,12]]},"reference":[{"key":"p_2","doi-asserted-by":"publisher","DOI":"10.1007\/s00778-008-0125-y"},{"issue":"1","key":"p_3","first-page":"922","volume":"2","author":"Abouzeid Azza","year":"2009","journal-title":"PVLDB"},{"key":"p_4","doi-asserted-by":"crossref","unstructured":"Azza Abouzied, Kamil Bajda-Pawlikowski, Jiewen Huang, Daniel J. Abadi, and Avi Silberschatz. HadoopDB in action: Building real world applications. InSIGMOD, 2010.","DOI":"10.1145\/1807167.1807294"},{"key":"p_5","doi-asserted-by":"crossref","unstructured":"Foto N. Afrati, Anish Das Sarma, David Menestrina, Aditya G. Parameswaran, and Jeffrey D. Ullman. Fuzzy joins using MapReduce. InICDE, pp.498-509, 2012.","DOI":"10.1109\/ICDE.2012.66"},{"key":"p_6","doi-asserted-by":"crossref","first-page":"99","DOI":"10.1145\/1739041.1739056","author":"Afrati Foto N.","year":"2010","journal-title":"EDBT"},{"key":"p_7","doi-asserted-by":"publisher","DOI":"10.1109\/TKDE.2011.47"},{"issue":"2","key":"p_8","first-page":"1625","volume":"3","author":"Alexandrov Alexander","year":"2010","journal-title":"PVLDB"},{"key":"p_9","first-page":"223","author":"Alvaro Peter","year":"2010","journal-title":"EuroSys"},{"key":"p_10","unstructured":"Ahmed M. Aly, Asmaa Sallam, Bala M. Gnanasekaran, Long-Van Nguyen-Dinh, Walid G. Aref, Mourad Ouzzaniy, and Arif Ghafoor. M3: Stream processing on main-memory MapReduce. InICDE, 2012."},{"volume-title":"Anthony D. Joseph, Randy H. Katz, Andrew Konwinski, Gunho Lee, David A. Patterson, Ariel Rabkin, Ion Stoica, and Matei Zaharia. Above the clouds: A Berkeley view of cloud computing","year":"2009","author":"Armbrust Michael","key":"p_11"},{"key":"p_12","first-page":"137","author":"Babu Shivnath","year":"2010","journal-title":"SoCC"},{"key":"p_13","doi-asserted-by":"crossref","unstructured":"Andrey Balmin, Tim Kaldewey, and Sandeep Tata. Clydesdale: Structured data processing on hadoop. InSIGMOD Conference, pp.705-708, 2012.","DOI":"10.1145\/2213836.2213938"},{"key":"p_14","doi-asserted-by":"publisher","DOI":"10.1109\/MC.2007.443"},{"key":"p_15","first-page":"119","author":"Battr\u00e9 Dominic","year":"2010","journal-title":"SoCC"},{"key":"p_16","doi-asserted-by":"publisher","DOI":"10.1007\/s10619-011-7082-y"},{"key":"p_17","doi-asserted-by":"publisher","DOI":"10.1109\/MC.2006.29"},{"issue":"12","key":"p_18","first-page":"1272","volume":"4","author":"Beyer Kevin S.","year":"2011","journal-title":"PVLDB"},{"key":"p_19","doi-asserted-by":"crossref","unstructured":"Pramod Bhatotia, Alexander Wieder, Rodrigo Rodrigues, Umut A. Acar, and Rafael Pasquini. Incoop: MapReduce for incremental computations. InSOCC, 2011.","DOI":"10.1145\/2038916.2038923"},{"key":"p_20","doi-asserted-by":"crossref","unstructured":"Spyros Blanas, Jignesh M. Patel, Vuk Ercegovac, Jun Rao, Eugene J. Shekita, and Yuanyuan Tian. A comparison of join algorithms for log processing in mapreduce. InSIGMOD, pp.975-986, 2010.","DOI":"10.1145\/1807167.1807273"},{"volume-title":"December","year":"2010","author":"Boag Scott","key":"p_21"},{"volume-title":"PVLDB, 5(2)","year":"2012","author":"Borkar Vinayak","key":"p_22"},{"key":"p_23","unstructured":"Vinayak R. Borkar, Michael J. Carey, Raman Grover, Nicola Onose, and Rares Vernica. Hyracks: A exible and extensible foundation for data-intensive computing. InICDE, pp.1151-1162, 2011."},{"key":"p_24","doi-asserted-by":"publisher","DOI":"10.1145\/2247596.2247598"},{"issue":"1","key":"p_25","first-page":"285","volume":"3","author":"Bu Yingyi","year":"2010","journal-title":"PVLDB"},{"key":"p_26","doi-asserted-by":"publisher","DOI":"10.1007\/s00778-012-0269-7"},{"key":"p_27","doi-asserted-by":"crossref","unstructured":"Michael J. Cafarella and Christopher R\u00e9. Manimal: Relational optimization for dataintensive programs. InWebDB, 2010.","DOI":"10.1145\/1859127.1859141"},{"key":"p_28","doi-asserted-by":"crossref","unstructured":"Ariel Cary, Zhengguo Sun, Vagelis Hristidis, and Naphtali Rishe. Experiences on processing spatial data with MapReduce. InSSDBM, pp.302-319, 2009.","DOI":"10.1007\/978-3-642-02279-1_24"},{"issue":"2","key":"p_29","first-page":"1265","volume":"1","author":"Chaiken Ronnie","year":"2008","journal-title":"PVLDB"},{"key":"p_30","first-page":"363","author":"Chambers Craig","year":"2010","journal-title":"PLDI"},{"key":"p_31","unstructured":"Fay Chang, Jeffrey Dean, Sanjay Ghemawat, Wilson C. Hsieh, Deborah A. Wallach, Michael Burrows, Tushar Chandra, Andrew Fikes, and Robert Gruber. Bigtable: A distributed storage system for structured data. InOSDI, pp.205-218, 2006."},{"key":"p_32","doi-asserted-by":"publisher","DOI":"10.1145\/1365815.1365816"},{"issue":"12","key":"p_33","first-page":"1318","volume":"4","author":"Chattopadhyay Biswapesh","year":"2011","journal-title":"PVLDB"},{"key":"p_34","unstructured":"Rishan Chen, Xuetian Weng, Bingsheng He, and Mao Yang. Large graph processing in the cloud. InSIGMOD, pp.1123-1126, 2010."},{"issue":"2","key":"p_35","first-page":"1459","volume":"3","author":"Chen Songting","year":"2010","journal-title":"PVLDB"},{"key":"p_36","unstructured":"Hung Chih Yang, Ali Dasdan, Ruey-Lung Hsiao, and Douglas Stott Parker Jr. Map-reduce-merge: Simpli ed relational data processing on large clusters. InSIGMOD, pp.1029-1040, 2007."},{"key":"p_37","doi-asserted-by":"crossref","unstructured":"Hung Chih Yang and D. Stott Parker. Traverse: Simpli ed indexing on large mapreduce-merge clusters. InDASFAA, pp.308-322, 2009.","DOI":"10.1007\/978-3-642-00887-0_27"},{"issue":"1","key":"p_38","first-page":"1153","volume":"1","author":"Condie Tyson","year":"2008","journal-title":"PVLDB"},{"key":"p_39","unstructured":"Tyson Condie, Neil Conway, Peter Alvaro, Joseph M. Hellerstein, Khaled Elmeleegy, and Russell Sears. MapReduce online. InNSDI, pp.313-328, 2010."},{"key":"p_40","unstructured":"Tyson Condie, Neil Conway, Peter Alvaro, Joseph M. Hellerstein, John Gerth, Justin Talbot, Khaled Elmeleegy, and Russell Sears. Online aggregation and continuous query support in MapReduce. InSIGMOD Conference, pp.1115-1118, 2010."},{"key":"p_41","first-page":"690","author":"Ferreira Cordeiro Robson Leonardo","year":"2011","journal-title":"KDD"},{"key":"p_42","doi-asserted-by":"crossref","unstructured":"Sudipto Das, Yannis Sismanis, Kevin S. Beyer, Rainer Gemulla, Peter J. Haas, and John McPherson. Ricardo: Integrating R and Hadoop. InSIGMOD, pp.987-998, 2010.","DOI":"10.1145\/1807167.1807275"},{"key":"p_43","unstructured":"Jeffrey Dean and Sanjay Ghemawat. MapReduce: Simpli ed data processing on large clusters. InOSDI, pp.137-150, 2004."},{"key":"p_44","doi-asserted-by":"publisher","DOI":"10.1145\/1327452.1327492"},{"key":"p_45","doi-asserted-by":"publisher","DOI":"10.1145\/1629175.1629198"},{"key":"p_46","doi-asserted-by":"publisher","DOI":"10.1145\/129888.129894"},{"issue":"1","key":"p_47","first-page":"518","volume":"3","author":"Dittrich Jens","year":"2010","journal-title":"PVLDB"},{"key":"p_48","doi-asserted-by":"crossref","unstructured":"Jaliya Ekanayake, Hui Li, Bingjing Zhang, Thilina Gunarathne, Seung-Hee Bae, Judy Qiu, and Geoffrey Fox. Twister: A runtime for iterative MapReduce. InHPDC, pp.810-818, 2010.","DOI":"10.1145\/1851476.1851593"},{"issue":"6","key":"p_49","first-page":"586","volume":"5","author":"Elghandour Iman","year":"2012","journal-title":"PVLDB"},{"key":"p_50","doi-asserted-by":"crossref","unstructured":"Iman Elghandour and Ashraf Aboulnaga. ReStore: Reusing results of MapReduce jobs in pig. InSIGMOD Conference, pp.701-704, 2012.","DOI":"10.1145\/2213836.2213937"},{"issue":"9","key":"p_51","first-page":"575","volume":"4","author":"Eltabakh Mohamed Y.","year":"2011","journal-title":"PVLDB"},{"key":"p_52","first-page":"681","author":"Ene Alina","year":"2011","journal-title":"KDD"},{"key":"p_53","unstructured":"Leonidas Fegaras, Chengkai Li, Upa Gupta, and Jijo Philip. XML query optimization in Map-Reduce. InWebDB, 2011."},{"issue":"7","key":"p_54","first-page":"419","volume":"4","author":"Floratou Avrilia","year":"2011","journal-title":"PVLDB"},{"issue":"2","key":"p_55","first-page":"1402","volume":"2","author":"Friedman Eric","year":"2009","journal-title":"PVLDB"},{"volume-title":"Programming Pig. O'Reilly Media","year":"2011","author":"Gates Alan","key":"p_56"},{"issue":"2","key":"p_57","first-page":"1414","volume":"2","author":"Gates Alan","year":"2009","journal-title":"PVLDB"},{"key":"p_58","doi-asserted-by":"crossref","unstructured":"Sanjay Ghemawat, Howard Gobioff, and Shun-Tak Leung. The Google le system. InSOSP, pp.29-43, 2003.","DOI":"10.1145\/1165389.945450"},{"key":"p_59","first-page":"334","author":"Ghoting Amol","year":"2011","journal-title":"KDD"},{"key":"p_60","doi-asserted-by":"crossref","unstructured":"Amol Ghoting, Rajasekar Krishnamurthy, Edwin P. D. Pednault, Berthold Reinwald, Vikas Sindhwani, Shirish Tatikonda, Yuanyuan Tian, and Shivakumar Vaithyanathan. SystemML: Declarative machine learning on MapReduce. InICDE, pp.231-242, 2011.","DOI":"10.1109\/ICDE.2011.5767930"},{"key":"p_61","unstructured":"Yunhong Gu and Robert L. Grossman. Lessons learned from a year's worth of benchmarks of large data clouds. InSC-MTAGS, 2009."},{"key":"p_62","doi-asserted-by":"publisher","DOI":"10.1007\/s007780100054"},{"key":"p_63","unstructured":"Yongqiang He, Rubao Lee, Yin Huai, Zheng Shao, Namit Jain, Xiaodong Zhang, and Zhiwei Xu. RCFile: A fast and space-ef cient data placement structure in MapReducebased warehouse systems. InICDE, pp.1199-1208, 2011."},{"key":"p_64","unstructured":"Arvid Heise, Astrid Rheinlaender, Marcus Leich, Ulf Leser, and Felix Naumann. Meteor\/Sopremo: An extensible query language and operator model. InBigData, 2012."},{"volume-title":"CoRR, abs\/1106.0940","year":"2011","author":"Herodotou Herodotos","key":"p_65"},{"issue":"11","key":"p_66","first-page":"1111","volume":"4","author":"Herodotou Herodotos","year":"2011","journal-title":"PVLDB"},{"issue":"12","key":"p_67","first-page":"1446","volume":"4","author":"Herodotou Herodotos","year":"2011","journal-title":"PVLDB"},{"key":"p_68","unstructured":"Herodotos Herodotou, Harold Lim, Gang Luo, Nedyalko Borisov, Liang Dong, Fatma Bilgen Cetin, and Shivnath Babu. Star sh: A self-tuning system for big data analytics. InCIDR, pp.261-272, 2011."},{"key":"p_69","unstructured":"Tony Hey, Stewart Tansley, and Kristin Tolle, editors. The Fourth Paradigm: Data-Intensive Scientific Discovery. Microsoft Research, October 2009."},{"key":"p_70","unstructured":"Benjamin Hindman, Andy Konwinski, Matei Zaharia, and Ion Stoica. A common substrate for cluster computing. In HotCloud, USENIX Workshop, 2009."},{"issue":"11","key":"p_71","first-page":"1123","volume":"4","author":"Huang Jiewen","year":"2011","journal-title":"PVLDB"},{"key":"p_72","doi-asserted-by":"publisher","DOI":"10.1109\/TKDE.2011.103"},{"key":"p_73","doi-asserted-by":"publisher","DOI":"10.1145\/1272996.1273005"},{"key":"p_74","first-page":"251","author":"Iu Ming-Yee","year":"2010","journal-title":"EuroSys"},{"issue":"6","key":"p_75","first-page":"385","volume":"4","author":"Jahani Eaman","year":"2011","journal-title":"PVLDB"},{"key":"p_76","doi-asserted-by":"publisher","DOI":"10.1109\/TKDE.2010.248"},{"issue":"1","key":"p_77","first-page":"472","volume":"3","author":"Jiang Dawei","year":"2010","journal-title":"PVLDB"},{"key":"p_78","doi-asserted-by":"crossref","unstructured":"Alekh Jindal, Jorge-Arnulfo Quiane-Ruiz, and Jens Dittrich. Trojan data layouts: Right shoes for a running elephant. InSoCC, 2011.","DOI":"10.1145\/2038916.2038937"},{"key":"p_79","doi-asserted-by":"publisher","DOI":"10.1145\/2247596.2247600"},{"key":"p_80","unstructured":"Shahan Khatchadourian, Mariano P. Consens, and J\u00e9r\u00f4me Sim\u00e9on. Having a ChuQL at XML on the Cloud. InAMW, 2011."},{"issue":"12","key":"p_81","first-page":"1426","volume":"4","author":"Kim HyeongSik","year":"2011","journal-title":"PVLDB"},{"volume-title":"PVLDB, 5(12)","year":"2012","author":"Kolb Lars","key":"p_82"},{"key":"p_83","doi-asserted-by":"crossref","unstructured":"Lars Kolb, Andreas Thor, and Erhard Rahm. Load balancing for MapReduce-based entity resolution. InICDE, pp.618-629, 2012.","DOI":"10.1109\/ICDE.2012.22"},{"key":"p_84","doi-asserted-by":"crossref","first-page":"657","DOI":"10.1145\/1739041.1739120","author":"Kumar Vibhore","year":"2010","journal-title":"EDBT"},{"key":"p_85","doi-asserted-by":"publisher","DOI":"10.1145\/279227.279229"},{"issue":"1","key":"p_86","first-page":"129","volume":"3","author":"Lang Willis","year":"2010","journal-title":"PVLDB"},{"key":"p_87","doi-asserted-by":"crossref","unstructured":"Silvio Lattanzi, Benjamin Moseley, Siddharth Suri, and Sergei Vassilvitskii. Filtering: A method for solving graph problems in MapReduce. InSPAA, pp.85-94, 2011.","DOI":"10.1145\/1989493.1989505"},{"key":"p_88","doi-asserted-by":"crossref","unstructured":"Rubao Lee, Tian Luo, Yin Huai, Fusheng Wang, Yongqiang He, and Xiaodong Zhang. YSmart: Yet another SQL-to-MapReduce translator. InICDCS, pp.25-36, 2011.","DOI":"10.1109\/ICDCS.2011.26"},{"key":"p_89","doi-asserted-by":"publisher","DOI":"10.1145\/1740390.1740405"},{"key":"p_90","doi-asserted-by":"crossref","unstructured":"Boduo Li, Edward Mazur, Yanlei Diao, Andrew McGregor, and Prashant J. Shenoy. A platform for scalable one-pass analytics using MapReduce. InSIGMOD Conference, pp.985-996, 2011.","DOI":"10.1145\/1989323.1989426"},{"volume-title":"PVLDB, 5(12)","year":"2012","author":"Lim Harold","key":"p_91"},{"key":"p_92","doi-asserted-by":"crossref","unstructured":"Jimmy J. Lin. Brute force and indexed approaches to pairwise document similarity comparisons with MapReduce. InSIGIR, pp.155-162, 2009.","DOI":"10.1145\/1571941.1571970"},{"key":"p_93","doi-asserted-by":"crossref","unstructured":"Yuting Lin, Divyakant Agrawal, Chun Chen, Beng Chin Ooi, and Sai Wu. Llama: Leveraging columnar storage for scalable join processing in the MapReduce framework. InSIGMOD Conference, pp.961-972, 2011.","DOI":"10.1145\/1989323.1989424"},{"issue":"2","key":"p_94","first-page":"1472","volume":"1","author":"Logothetis Dionysios","year":"2008","journal-title":"PVLDB"},{"key":"p_95","doi-asserted-by":"crossref","unstructured":"Boon Thau Loo, Tyson Condie, Joseph M. Hellerstein, Petros Maniatis, Timothy Roscoe, and Ion Stoica. Implementing declarative overlays. InSOSP, pp.75-90, 2005.","DOI":"10.1145\/1095809.1095818"},{"key":"p_96","first-page":"340","author":"Low Yucheng","year":"2010","journal-title":"UAI"},{"issue":"8","key":"p_97","first-page":"716","volume":"5","author":"Low Yucheng","year":"2012","journal-title":"PVLDB"},{"key":"p_98","doi-asserted-by":"crossref","unstructured":"Grzegorz Malewicz, Matthew H. Austern, Aart J. C. Bik, James C. Dehnert, Ilan Horn, Naty Leiser, and Grzegorz Czajkowski. Pregel: A system for large-scale graph processing. InSIGMOD, pp.135-146, 2010.","DOI":"10.1145\/1807167.1807184"},{"issue":"1","key":"p_99","first-page":"330","volume":"3","author":"Melnik Sergey","year":"2010","journal-title":"PVLDB"},{"key":"p_100","doi-asserted-by":"publisher","DOI":"10.1145\/1953122.1953148"},{"issue":"8","key":"p_101","first-page":"704","volume":"5","author":"Metwally Ahmed","year":"2012","journal-title":"PVLDB"},{"issue":"7","key":"p_102","first-page":"460","volume":"4","author":"Francisci Morales Gianmarco De","year":"2011","journal-title":"PVLDB"},{"key":"p_103","doi-asserted-by":"crossref","unstructured":"Kristi Morton, Magdalena Balazinska, and Dan Grossman. ParaTimer: A progress indicator for MapReduce DAGs. InSIGMOD Conference, pp.507-518, 2010.","DOI":"10.1145\/1807167.1807223"},{"key":"p_104","doi-asserted-by":"crossref","unstructured":"Kristi Morton, Abram Friesen, Magdalena Balazinska, and Dan Grossman. Estimating the progress of MapReduce pipelines. InICDE, pp.681-684, 2010.","DOI":"10.1109\/ICDE.2010.5447919"},{"key":"p_105","doi-asserted-by":"crossref","unstructured":"Jaeseok Myung, Jongheum Yeon, and Sang Goo Lee. SPARQL basic graph pattern processing with iterative MapReduce. InMDAC, 2010.","DOI":"10.1145\/1779599.1779605"},{"volume-title":"PVLDB, 1(1)","year":"2008","author":"Neumann Thomas","key":"p_106"},{"issue":"1","key":"p_107","first-page":"494","volume":"3","author":"Nykiel Tomasz","year":"2010","journal-title":"PVLDB"},{"key":"p_108","unstructured":"Martin Odersky, Lex Spoon, and Bill Venners. Programming in Scala: A Comprehensive Step-by-Step Guide. Artima, 2011."},{"key":"p_109","unstructured":"Christopher Olston, Benjamin Reed, Utkarsh Srivastava, Ravi Kumar, and Andrew Tomkins. Pig latin: A not-so-foreign language for data processing. InSIGMOD, pp.1099-1110, 2008."},{"issue":"2","key":"p_110","first-page":"1426","volume":"2","author":"Panda Biswanath","year":"2009","journal-title":"PVLDB"},{"key":"p_111","doi-asserted-by":"crossref","unstructured":"Spiros Papadimitriou and Jimeng Sun. DisCo: Distributed co-clustering with Map-Reduce: A case study towards petabyte-scale end-to-end mining. InICDM, pp.512-521, 2008.","DOI":"10.1109\/ICDM.2008.142"},{"key":"p_112","doi-asserted-by":"publisher","DOI":"10.1145\/1327452.1327491"},{"key":"p_113","doi-asserted-by":"crossref","unstructured":"Andrew Pavlo, Erik Paulson, Alexander Rasin, Daniel J. Abadi, David J. DeWitt, Samuel Madden, and Michael Stonebraker. A comparison of approaches to large-scale data analysis. InSIGMOD, pp.165-178, 2009.","DOI":"10.1145\/1559845.1559865"},{"issue":"4","key":"p_114","doi-asserted-by":"crossref","first-page":"277","DOI":"10.1155\/2005\/962135","volume":"13","author":"Pike Rob","year":"2005","journal-title":"Scientific Programming"},{"key":"p_115","unstructured":"Jorge-Arnulfo Quian\u00e9-Ruiz, Christoph Pinkel, J\u00f6rg Schad, and Jens Dittrich. RAFT at work: Speeding-up mapreduce applications under task and node failures. InSIGMOD Conference, pp.1225-1228, 2011."},{"key":"p_116","doi-asserted-by":"crossref","unstructured":"Jorge-Arnulfo Quian\u00e9-Ruiz, Christoph Pinkel, J\u00f6rg Schad, and Jens Dittrich. RAFTing MapReduce: Fast recovery on the RAFT. InICDE, pp.589-600, 2011.","DOI":"10.1109\/ICDE.2011.5767877"},{"key":"p_117","first-page":"46","author":"Ravindra Padmashree","year":"2011","journal-title":"ESWC (2)"},{"key":"p_118","doi-asserted-by":"crossref","unstructured":"Alexander Sch\u00e4tzle, Martin Przyjaciel-Zablocki, Thomas Hornung, and Georg Lausen. PigSPARQL: Mapping SPARQL to Pig Latin. InSWIM, pp.65-84, 2011.","DOI":"10.1145\/1999299.1999303"},{"key":"p_119","doi-asserted-by":"crossref","unstructured":"Patricia G. Selinger, Morton M. Astrahan, Donald D. Chamberlin, Raymond A. Lorie, and Thomas G. Price. Access path selection in a relational database management system. InSIGMOD Conference, pp.23-34, 1979.","DOI":"10.1145\/582095.582099"},{"issue":"1","key":"p_120","first-page":"4","volume":"9","author":"Stonebraker Michael","year":"1986","journal-title":"IEEE Database Engineering Bulletin"},{"key":"p_121","doi-asserted-by":"publisher","DOI":"10.1145\/1629175.1629197"},{"key":"p_122","doi-asserted-by":"crossref","unstructured":"Philip Stutz, Abraham Bernstein, and William W. Cohen. Signal\/Collect: Graph Algorithms for the (Semantic) Web. In International Semantic Web Conference (1), pp.764-780, 2010.","DOI":"10.1007\/978-3-642-17746-0_48"},{"issue":"2","key":"p_123","first-page":"1626","volume":"2","author":"Thusoo Ashish","year":"2009","journal-title":"PVLDB"},{"key":"p_124","doi-asserted-by":"crossref","unstructured":"Ashish Thusoo, Joydeep Sen Sarma, Namit Jain, Zheng Shao, Prasad Chakka, Ning Zhang, Suresh Anthony, Hao Liu, and Raghotham Murthy. Hive - A petabyte scale data warehouse using Hadoop. InICDE, pp.996-1005, 2010.","DOI":"10.1109\/ICDE.2010.5447738"},{"key":"p_125","unstructured":"Ashish Thusoo, Zheng Shao, Suresh Anthony, Dhruba Borthakur, Namit Jain, Joy-deep Sen Sarma, Raghotham Murthy, and Hao Liu. Data warehousing and analytics infrastructure at facebook. InSIGMOD Conference, pp.1013-1020, 2010."},{"volume-title":"Principles of Database and Knowledge-Base Systems: Volume II: The New Technologies","year":"1990","author":"Ullman Jeffrey D.","key":"p_126"},{"key":"p_127","doi-asserted-by":"publisher","DOI":"10.1145\/79173.79181"},{"key":"p_128","doi-asserted-by":"crossref","unstructured":"Rares Vernica, Michael J. Carey, and Chen Li. Ef cient parallel set-similarity joins using MapReduce. InSIGMOD, pp.495-506, 2010.","DOI":"10.1145\/1807167.1807222"},{"key":"p_129","unstructured":"Chaokun Wang, Jianmin Wang, Xuemin Lin, Wei Wang, Haixun Wang, Hongsong Li, Wanpeng Tian, Jun Xu, and Rui Li. MapDupReducer: Detecting near duplicates over massive data sets. InSIGMOD, pp.1119-1122, 2010."},{"key":"p_130","unstructured":"Guozhang Wang, Wenlei Xie, Alan Demers, and Johannes Gehrke. Asynchronous Large-Scale Graph Processing Made Easy. InCIDR, 2013."},{"volume-title":"Hadoop: The Definitive Guide. O'Reilly Media","year":"2012","author":"White Tom","key":"p_131"},{"key":"p_132","doi-asserted-by":"publisher","DOI":"10.1145\/2000824.2000825"},{"key":"p_133","unstructured":"Yuan Yu, Michael Isard, Dennis Fetterly, Mihai Budiu, \u00dalfar Erlingsson, Pradeep Kumar Gunda, and Jon Currey. DryadLINQ: A system for general-purpose distributed data-parallel computing using a high-level language. InOSDI, pp.1-14, 2008."},{"key":"p_134","first-page":"265","author":"Zaharia Matei","year":"2010","journal-title":"EuroSys"},{"key":"p_135","unstructured":"Matei Zaharia, Mosharaf Chowdhury, Tathagata Das, Ankur Dave, Justin Ma, Murphy McCauley, Michael J. Franklin, Scott Shenker, and Ion Stoica. Resilient distributed data sets: A fault-tolerant abstraction for in-memory cluster computing. InNSDI, 2012."},{"key":"p_136","unstructured":"Matei Zaharia, Mosharaf Chowdhury, Michael J. Franklin, Scott Shenker, and Ion Stoica. Spark: Cluster computing with working sets. InHotCloud, 2010."},{"key":"p_137","unstructured":"Matei Zaharia, Andy Konwinski, Anthony D. Joseph, Randy H. Katz, and Ion Stoica. Improving MapReduce performance in heterogeneous environments. InOSDI, pp.29-42, 2008."},{"key":"p_138","doi-asserted-by":"publisher","DOI":"10.1007\/s10723-012-9204-9"},{"key":"p_139","unstructured":"Jingren Zhou, Per-\u00c5ke Larson, and Ronnie Chaiken. Incorporating partitioning and parallel plans into the SCOPE optimizer. InICDE, pp.1060-1071, 2010."},{"issue":"2","key":"p_140","first-page":"17","volume":"28","author":"Zukowski Marcin","year":"2005","journal-title":"IEEE Data Engineering Bulletin"}],"container-title":["Large Scale and Big Data"],"original-title":[],"language":"en","deposited":{"date-parts":[[2025,5,3]],"date-time":"2025-05-03T09:48:44Z","timestamp":1746265724000},"score":1,"resource":{"primary":{"URL":"http:\/\/www.crcnetbase.com\/doi\/abs\/10.1201\/b17112-3"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2014,6,12]]},"ISBN":["9781466581500","9781466581517"],"references-count":139,"alternative-id":["10.1201\/b17112-3","10.1201\/b17112"],"URL":"https:\/\/doi.org\/10.1201\/b17112-3","relation":{},"subject":[],"published":{"date-parts":[[2014,6,12]]}}}