{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,2,21]],"date-time":"2025-02-21T07:40:16Z","timestamp":1740123616746,"version":"3.37.3"},"reference-count":19,"publisher":"Springer Science and Business Media LLC","issue":"2","license":[{"start":{"date-parts":[[2020,5,28]],"date-time":"2020-05-28T00:00:00Z","timestamp":1590624000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"},{"start":{"date-parts":[[2020,5,28]],"date-time":"2020-05-28T00:00:00Z","timestamp":1590624000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["J Supercomput"],"published-print":{"date-parts":[[2021,2]]},"DOI":"10.1007\/s11227-020-03338-3","type":"journal-article","created":{"date-parts":[[2020,5,28]],"date-time":"2020-05-28T09:02:58Z","timestamp":1590656578000},"page":"1879-1896","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":4,"title":["High throughput BLAST algorithm using spark and cassandra"],"prefix":"10.1007","volume":"77","author":[{"ORCID":"https:\/\/orcid.org\/0000-0003-2910-6709","authenticated-orcid":false,"given":"Fernando","family":"Cores","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-1352-9555","authenticated-orcid":false,"given":"Fernando","family":"Guirado","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-9352-9338","authenticated-orcid":false,"given":"Josep Lluis","family":"Lerida","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2020,5,28]]},"reference":[{"issue":"5","key":"3338_CR1","doi-asserted-by":"publisher","first-page":"e0155461","DOI":"10.1371\/journal.pone.0155461","volume":"11","author":"JM Abu\u00edn","year":"2016","unstructured":"Abu\u00edn JM, Pichel JC, Pena TF, Amigo J (2016) Sparkbwa: speeding up the alignment of high-throughput dna sequencing data. PloS ONE 11(5):e0155461","journal-title":"PloS ONE"},{"issue":"3","key":"3338_CR2","doi-asserted-by":"publisher","first-page":"403","DOI":"10.1016\/S0022-2836(05)80360-2","volume":"215","author":"SF Altschul","year":"1990","unstructured":"Altschul SF, Gish W, Miller W, Myers EW, Lipman DJ (1990) Basic local alignment search tool. J Mol Biol 215(3):403\u2013410","journal-title":"J Mol Biol"},{"issue":"1","key":"3338_CR3","doi-asserted-by":"publisher","first-page":"59","DOI":"10.1038\/nmeth.3176","volume":"12","author":"B Buchfink","year":"2015","unstructured":"Buchfink B, Xie C, Huson DH (2015) Fast and sensitive protein alignment using diamond. Nat Methods 12(1):59\u201360","journal-title":"Nat Methods"},{"key":"3338_CR4","volume-title":"Cassandra: the definitive guide: distributed data at web scale","author":"J Carpenter","year":"2016","unstructured":"Carpenter J, Hewitt E (2016) Cassandra: the definitive guide: distributed data at web scale. O\u2019Reilly Media, Inc, Sebastopol"},{"issue":"1","key":"3338_CR5","doi-asserted-by":"publisher","first-page":"318","DOI":"10.1186\/s12859-017-1723-8","volume":"18","author":"Rodrigo M de Castro","year":"2017","unstructured":"de Castro Rodrigo M, Tostes CdS, D\u00e1vila AMR, Senger H, da Silva FAB (2017) Sparkblast: scalable blast processing using in-memory operations. BMC Bioinf 18(1):318. https:\/\/doi.org\/10.1186\/s12859-017-1723-8","journal-title":"BMC Bioinf"},{"key":"3338_CR6","unstructured":"Coulouris G et al (2016) Blast benchmaks. https:\/\/fiehnlab.ucdavis.edu\/staff\/kind\/collector\/benchmark\/blast-benchmark"},{"issue":"1","key":"3338_CR7","doi-asserted-by":"publisher","first-page":"72","DOI":"10.1145\/1629175.1629198","volume":"53","author":"J Dean","year":"2010","unstructured":"Dean J, Ghemawat S (2010) Mapreduce: a flexible data processing tool. Commun ACM 53(1):72\u201377","journal-title":"Commun ACM"},{"issue":"8","key":"3338_CR8","first-page":"giy098","volume":"7","author":"R Guo","year":"2018","unstructured":"Guo R, Zhao Y, Zou Q, Fang X, Peng S (2018) Bioinformatics applications on apache spark. GigaScience 7(8):giy098","journal-title":"GigaScience"},{"key":"3338_CR9","unstructured":"Karun AK, Chitharanjan K (2013) A review on hadoop\u2014hdfs infrastructure extensions. In: 2013 IEEE Conference on Information & Communication Technologies (ICT), pp 132\u2013137"},{"key":"3338_CR10","unstructured":"Li X, Tan G, Zhang C, Li X, Zhang Z, Sun N (2016) Accelerating large-scale genomic analysis with spark. In: 2016 IEEE International Conference on Bioinformatics and Biomedicine (BIBM), IEEE, pp 747\u2013751"},{"issue":"3","key":"3338_CR11","doi-asserted-by":"publisher","first-page":"1310","DOI":"10.1007\/s11227-018-2424-4","volume":"75","author":"J Llad\u00f3s","year":"2019","unstructured":"Llad\u00f3s J, Cores F, Guirado F (2019) Optimization of consistency-based multiple sequence alignment using big data technologies. J Supercomput. 75(3):1310\u20131322https:\/\/doi.org\/10.1007\/s11227-018-2424-4","journal-title":"J Supercomput."},{"key":"3338_CR12","doi-asserted-by":"crossref","unstructured":"Matsunaga A, Tsugawa M, Fortes J (2008) Cloudblast: Combining mapreduce and virtualization on distributed resources for bioinformatics applications. In: 2008 IEEE Fourth International Conference on eScience, IEEE, pp 222\u2013229","DOI":"10.1109\/eScience.2008.62"},{"key":"3338_CR13","doi-asserted-by":"crossref","unstructured":"Mushtaq H, Ahmed N, Al-Ars Z (2017) Streaming distributed dna sequence alignment using apache spark. In: 2017 IEEE 17th International Conference on Bioinformatics and Bioengineering (BIBE), IEEE, pp 188\u2013193","DOI":"10.1109\/BIBE.2017.00-57"},{"key":"3338_CR14","doi-asserted-by":"publisher","unstructured":"Nothaft FA, Massie M, Danford T, Zhang Z, Laserson U, Yeksigian C, Kottalam J, Ahuja A, Hammerbacher J, Linderman M, Franklin MJ, Joseph AD, Patterson DA (2015) Rethinking data-intensive science using scalable analytics systems. In: Proceedings of the 2015 ACM SIGMOD International Conference on Management of Data, SIGMOD \u201915, ACM, New York, pp 631\u2013646.https:\/\/doi.org\/10.1145\/2723372.2742787","DOI":"10.1145\/2723372.2742787"},{"issue":"4","key":"3338_CR15","doi-asserted-by":"publisher","first-page":"586","DOI":"10.1016\/j.molcel.2015.05.004","volume":"58","author":"JA Reuter","year":"2015","unstructured":"Reuter JA, Spacek DV, Snyder MP (2015) High-throughput sequencing technologies. Molecular Cell 58(4):586\u2013597","journal-title":"Molecular Cell"},{"issue":"1","key":"3338_CR16","doi-asserted-by":"publisher","first-page":"34","DOI":"10.1109\/MITP.2017.6","volume":"19","author":"S Sakr","year":"2017","unstructured":"Sakr S (2017) Big data processing stacks. IT Professional 19(1):34\u201341","journal-title":"IT Professional"},{"issue":"1","key":"3338_CR17","doi-asserted-by":"publisher","first-page":"195","DOI":"10.1016\/0022-2836(81)90087-5","volume":"147","author":"TF Smith","year":"1981","unstructured":"Smith TF, Waterman MS et al (1981) Identification of common molecular subsequences. J Mol Biol 147(1):195\u2013197","journal-title":"J Mol Biol"},{"key":"3338_CR18","doi-asserted-by":"crossref","unstructured":"Xu B, Li C, Zhuang H, Wang J, Wang Q, Zhou X (2017) Efficient distributed smith-waterman algorithm based on apache spark. In: 2017 IEEE 10th International Conference on Cloud Computing (CLOUD), IEEE, pp 608\u2013615","DOI":"10.1109\/CLOUD.2017.83"},{"issue":"11","key":"3338_CR19","doi-asserted-by":"publisher","first-page":"2114","DOI":"10.1109\/JPROC.2016.2591592","volume":"104","author":"Y Zhang","year":"2016","unstructured":"Zhang Y, Cao T, Li S, Tian X, Yuan L, Jia H, Vasilakos AV (2016) Parallel processing systems for big data: a survey. Proceed IEEE 104(11):2114\u20132136","journal-title":"Proceed IEEE"}],"container-title":["The Journal of Supercomputing"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11227-020-03338-3.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11227-020-03338-3\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11227-020-03338-3.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2021,5,27]],"date-time":"2021-05-27T23:56:56Z","timestamp":1622159816000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11227-020-03338-3"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2020,5,28]]},"references-count":19,"journal-issue":{"issue":"2","published-print":{"date-parts":[[2021,2]]}},"alternative-id":["3338"],"URL":"https:\/\/doi.org\/10.1007\/s11227-020-03338-3","relation":{},"ISSN":["0920-8542","1573-0484"],"issn-type":[{"type":"print","value":"0920-8542"},{"type":"electronic","value":"1573-0484"}],"subject":[],"published":{"date-parts":[[2020,5,28]]},"assertion":[{"value":"28 May 2020","order":1,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}]}}