{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,2,21]],"date-time":"2025-02-21T07:39:58Z","timestamp":1740123598675,"version":"3.37.3"},"reference-count":22,"publisher":"Springer Science and Business Media LLC","issue":"7","license":[{"start":{"date-parts":[[2023,12,8]],"date-time":"2023-12-08T00:00:00Z","timestamp":1701993600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2023,12,8]],"date-time":"2023-12-08T00:00:00Z","timestamp":1701993600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"DOI":"10.13039\/501100012166","name":"National Key Research and Development Program of China","doi-asserted-by":"publisher","award":["2021YFB0300101"],"award-info":[{"award-number":["2021YFB0300101"]}],"id":[{"id":"10.13039\/501100012166","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62102427"],"award-info":[{"award-number":["62102427"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["J Supercomput"],"published-print":{"date-parts":[[2024,5]]},"DOI":"10.1007\/s11227-023-05766-3","type":"journal-article","created":{"date-parts":[[2023,12,8]],"date-time":"2023-12-08T18:02:09Z","timestamp":1702058529000},"page":"9471-9493","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["SNCL: a supernode OpenCL implementation for hybrid computing arrays"],"prefix":"10.1007","volume":"80","author":[{"given":"Tao","family":"Tang","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Kai","family":"Lu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Lin","family":"Peng","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yingbo","family":"Cui","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jianbin","family":"Fang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Chun","family":"Huang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Ruibo","family":"Wang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Canqun","family":"Yang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yifei","family":"Guo","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2023,12,8]]},"reference":[{"key":"5766_CR1","unstructured":"Barak A, Shiloh A (2013) The virtualcl (vcl) cluster platform. http:\/\/www.mosix.cs.huji.ac.il\/vcl\/VCL%5C_wp.pdf (acedido em 2011)"},{"issue":"1","key":"5766_CR2","doi-asserted-by":"publisher","first-page":"46","DOI":"10.1109\/99.660313","volume":"5","author":"L Dagum","year":"1998","unstructured":"Dagum L, Menon R (1998) Openmp: an industry standard API for shared-memory programming. IEEE Comput Sci Eng 5(1):46\u201355","journal-title":"IEEE Comput Sci Eng"},{"key":"5766_CR3","doi-asserted-by":"crossref","unstructured":"Duato J, Pena AJ, Silla F, Mayo R, Quintana-Ort\u00ed ES (2010) rcuda: Reducing the number of gpu-based accelerators in high performance clusters. In: 2010 international conference on high performance computing & simulation. IEEE, pp 224\u2013231","DOI":"10.1109\/HPCS.2010.5547126"},{"key":"5766_CR4","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1007\/s11432-016-5588-7","volume":"59","author":"H Fu","year":"2016","unstructured":"Fu H, Liao J, Yang J, Wang L, Song Z, Huang X, Yang C, Xue W, Liu F, Qiao F et al (2016) The Sunway Taihulight supercomputer: system and applications. Sci China Inf Sci 59:1\u201316","journal-title":"Sci China Inf Sci"},{"key":"5766_CR5","doi-asserted-by":"crossref","unstructured":"Grauer-Gray S, Xu L, Searles R, Ayalasomayajula S, Cavazos J (2012) Auto-tuning a high-level language targeted to GPU codes. In: 2012 innovative parallel computing (InPar). IEEE, pp 1\u201310","DOI":"10.1109\/InPar.2012.6339595"},{"issue":"11","key":"5766_CR6","first-page":"2340","volume":"42","author":"Y Jingwei","year":"2016","unstructured":"Jingwei Y, Kai M, Xiang L (2016) Virtualized GPU computing platform in clustered system environment. J Beijing Univ Aeronaut Astronsutics 42(11):2340\u20132348","journal-title":"J Beijing Univ Aeronaut Astronsutics"},{"issue":"3","key":"5766_CR7","doi-asserted-by":"publisher","first-page":"508","DOI":"10.3390\/sym13030508","volume":"13","author":"J Kang","year":"2021","unstructured":"Kang J, Yu H (2021) Gpgpu task scheduling technique for reducing the performance deviation of multiple GPGPU tasks in RPC-based GPU virtualization environments. Symmetry 13(3):508","journal-title":"Symmetry"},{"key":"5766_CR8","doi-asserted-by":"crossref","unstructured":"Kegel P, Steuwer M, Gorlatch S (2012) dopencl: towards a uniform programming approach for distributed heterogeneous multi-\/many-core systems. In: 2012 IEEE 26th international parallel and distributed processing symposium workshops & PhD forum. IEEE, pp 174\u2013186","DOI":"10.1109\/IPDPSW.2012.16"},{"key":"5766_CR9","unstructured":"Khronos: Khronos news, https:\/\/www.khronos.org\/"},{"key":"5766_CR10","unstructured":"KhronosGroup: Icd loader, https:\/\/github.com\/KhronosGroup\/OpenCL-ICD-Loader\/"},{"key":"5766_CR11","doi-asserted-by":"crossref","unstructured":"Kim J, Seo S, Lee J, Nah J, Jo G, Lee J (2012) Snucl: an opencl framework for heterogeneous cpu\/gpu clusters. In: Proceedings of the 26th ACM international conference on Supercomputing. pp 341\u2013352","DOI":"10.1145\/2304576.2304623"},{"issue":"2","key":"5766_CR12","doi-asserted-by":"publisher","first-page":"259","DOI":"10.1007\/s11390-015-1520-7","volume":"30","author":"XK Liao","year":"2015","unstructured":"Liao XK, Pang ZB, Wang KF, Lu YT, Xie M, Xia J, Dong DZ, Suo G (2015) High performance interconnect network for Tianhe system. J Comput Sci Technol 30(2):259\u2013272","journal-title":"J Comput Sci Technol"},{"key":"5766_CR13","doi-asserted-by":"publisher","first-page":"315","DOI":"10.1016\/B978-0-12-415992-1.00015-8","volume-title":"Programming massively parallel processors","author":"Y Lin","year":"2013","unstructured":"Lin Y, Grover V (2013) Chapter 15 - parallel programming with OpenACC. In: Kirk DB, Mei WH (eds) Programming massively parallel processors, 2nd edn. Morgan Kaufmann, Boston, pp 315\u2013337","edition":"2"},{"issue":"2","key":"5766_CR14","doi-asserted-by":"publisher","first-page":"150","DOI":"10.1007\/s42514-022-00095-y","volume":"4","author":"K Lu","year":"2022","unstructured":"Lu K, Wang Y, Guo Y, Huang C, Liu S, Wang R, Fang J, Tang T, Chen Z, Liu B et al (2022) Mt-3000: a heterogeneous multi-zone processor for HPC. CCF Trans High Perform Comput 4(2):150\u2013164","journal-title":"CCF Trans High Perform Comput"},{"issue":"2","key":"5766_CR15","doi-asserted-by":"publisher","first-page":"40","DOI":"10.1145\/1365490.1365500","volume":"6","author":"J Nickolls","year":"2008","unstructured":"Nickolls J, Buck I, Garland M, Skadron K (2008) Scalable parallel programming with cuda: Is cuda the parallel programming model that application developers have been waiting for? Queue 6(2):40\u201353","journal-title":"Queue"},{"key":"5766_CR16","doi-asserted-by":"crossref","unstructured":"Reano C, Silla F (2017) A comparative performance analysis of remote GPU virtualization over three generations of gpus. In: 2017 46th international conference on parallel processing workshops (ICPPW). IEEE, pp 121\u2013128","DOI":"10.1109\/ICPPW.2017.29"},{"issue":"6","key":"5766_CR17","doi-asserted-by":"publisher","first-page":"804","DOI":"10.1109\/TC.2011.112","volume":"61","author":"L Shi","year":"2011","unstructured":"Shi L, Chen H, Sun J, Li K (2011) vcuda: GPU-accelerated high-performance computing in virtual machines. IEEE Trans Comput 61(6):804\u2013816","journal-title":"IEEE Trans Comput"},{"issue":"3","key":"5766_CR18","doi-asserted-by":"publisher","first-page":"66","DOI":"10.1109\/MCSE.2010.69","volume":"12","author":"JE Stone","year":"2010","unstructured":"Stone JE, Gohara D, Shi G (2010) Opencl: a parallel programming standard for heterogeneous computing systems. Comput Sci Eng 12(3):66","journal-title":"Comput Sci Eng"},{"key":"5766_CR19","doi-asserted-by":"publisher","first-page":"102055","DOI":"10.1016\/j.sysarc.2021.102055","volume":"116","author":"D Tang","year":"2021","unstructured":"Tang D, Li L, Ma J, Liu X, Qi Z, Guan H (2021) gremote: cloud rendering on GPU resource pool based on API-forwarding. J Syst Architect 116:102055","journal-title":"J Syst Architect"},{"key":"5766_CR20","unstructured":"Top500: Top 500 (2023) https:\/\/www.top500.org\/"},{"key":"5766_CR21","doi-asserted-by":"crossref","unstructured":"Zhang C (2015) Mars: A 64-core armv8 processor. In: 2015 IEEE hot chips 27 symposium (HCS). IEEE, pp 1\u201323","DOI":"10.1109\/HOTCHIPS.2015.7477454"},{"key":"5766_CR22","doi-asserted-by":"crossref","unstructured":"Zhang P, Fang J, Yang C, Tang T, Huang C, Wang Z (2018) Mocl: an efficient opencl implementation for the matrix-2000 architecture. In: Proceedings of the 15th ACM international conference on computing frontiers. pp 26\u201335","DOI":"10.1145\/3203217.3203244"}],"container-title":["The Journal of Supercomputing"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11227-023-05766-3.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11227-023-05766-3\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11227-023-05766-3.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,4,18]],"date-time":"2024-04-18T13:29:30Z","timestamp":1713446970000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11227-023-05766-3"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2023,12,8]]},"references-count":22,"journal-issue":{"issue":"7","published-print":{"date-parts":[[2024,5]]}},"alternative-id":["5766"],"URL":"https:\/\/doi.org\/10.1007\/s11227-023-05766-3","relation":{},"ISSN":["0920-8542","1573-0484"],"issn-type":[{"type":"print","value":"0920-8542"},{"type":"electronic","value":"1573-0484"}],"subject":[],"published":{"date-parts":[[2023,12,8]]},"assertion":[{"value":"26 October 2023","order":1,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"8 December 2023","order":2,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors have no competing interests as defined by Springer, or other interests that might be perceived to influence the results or discussion reported in this paper.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}},{"value":"Not applicable.","order":3,"name":"Ethics","group":{"name":"EthicsHeading","label":"Ethical approval"}}]}}