{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,1,24]],"date-time":"2026-01-24T04:45:58Z","timestamp":1769229958923,"version":"3.49.0"},"reference-count":63,"publisher":"Springer Science and Business Media LLC","issue":"5","license":[{"start":{"date-parts":[[2016,9,22]],"date-time":"2016-09-22T00:00:00Z","timestamp":1474502400000},"content-version":"unspecified","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"funder":[{"name":"the Key Program of National Natural Science Foundation of China","award":["61133005"],"award-info":[{"award-number":["61133005"]}]},{"name":"the Key Program of National Natural Science Foundation of China","award":["61432005"],"award-info":[{"award-number":["61432005"]}]},{"DOI":"10.13039\/501100001809","name":"the National Natural Science Foundation of China","doi-asserted-by":"crossref","award":["61370095"],"award-info":[{"award-number":["61370095"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"crossref"}]},{"DOI":"10.13039\/501100001809","name":"the National Natural Science Foundation of China","doi-asserted-by":"crossref","award":["61472124"],"award-info":[{"award-number":["61472124"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"crossref"}]},{"DOI":"10.13039\/501100001809","name":"the National Natural Science Foundation of China","doi-asserted-by":"crossref","award":["61572175"],"award-info":[{"award-number":["61572175"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"crossref"}]},{"name":"Science and technology project of Hunan Province","award":["2015SK20062"],"award-info":[{"award-number":["2015SK20062"]}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["J Supercomput"],"published-print":{"date-parts":[[2017,5]]},"DOI":"10.1007\/s11227-016-1881-x","type":"journal-article","created":{"date-parts":[[2016,9,22]],"date-time":"2016-09-22T08:19:16Z","timestamp":1474532356000},"page":"1760-1781","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":21,"title":["A parallel solving method for block-tridiagonal equations on CPU\u2013GPU heterogeneous computing systems"],"prefix":"10.1007","volume":"73","author":[{"given":"Wangdong","family":"Yang","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Kenli","family":"Li","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Keqin","family":"Li","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2016,9,22]]},"reference":[{"issue":"5","key":"1881_CR1","doi-asserted-by":"publisher","first-page":"11","DOI":"10.1109\/MC.2005.160","volume":"38","author":"D Geer","year":"2005","unstructured":"Geer D (2005) Chip makers turn to multicore processors. Computer 38(5):11\u201313","journal-title":"Computer"},{"key":"1881_CR2","volume-title":"Elliptic problems in linear difference equations over a network","author":"LH Thomas","year":"1949","unstructured":"Thomas LH (1949) Elliptic problems in linear difference equations over a network. Watson Sci. Comput. Lab. Rept. Columbia University, New York"},{"key":"1881_CR3","doi-asserted-by":"publisher","first-page":"289","DOI":"10.1145\/355656.355657","volume":"1","author":"HS Stone","year":"1975","unstructured":"Stone HS (1975) Parallel tridiagonal equation solvers. ACM Trans Math Softw 1:289\u2013307","journal-title":"ACM Trans Math Softw"},{"issue":"4","key":"1881_CR4","doi-asserted-by":"publisher","first-page":"484","DOI":"10.1137\/0713042","volume":"13","author":"D Heller","year":"1976","unstructured":"Heller D (1976) Some aspects of the cyclic reduction algorithm for block tridiagonal linear systems. SIAM J Numer Anal 13(4):484\u2013496","journal-title":"SIAM J Numer Anal"},{"issue":"18","key":"1881_CR5","doi-asserted-by":"publisher","first-page":"6392","DOI":"10.1016\/j.jcp.2010.04.049","volume":"229","author":"SP Hirshman","year":"2010","unstructured":"Hirshman SP, Perumalla KS, Lynch VE, Sanchez R (2010) Bcyclic: a parallel block tridiagonal matrix cyclic solver. J Comput Phys 229(18):6392\u20136404","journal-title":"J Comput Phys"},{"key":"1881_CR6","volume-title":"Tridiagonal system solvers internal report","author":"J Lamas-Rodr\u0131guez","year":"2011","unstructured":"Lamas-Rodr\u0131guez J, Heras D, B\u00f3o M, Arg\u00fcello F (2011) Tridiagonal system solvers internal report. Department of Electronics and Computer Science Internal Report, University of Santiago de Compostela, Spain"},{"key":"1881_CR7","doi-asserted-by":"publisher","first-page":"627","DOI":"10.1137\/0707049","volume":"7","author":"BL Buzbee","year":"1970","unstructured":"Buzbee BL, Golub GH, Nielson CW (1970) On direct methods for solving poisson\u2019s equations. SIAM J Numer Anal 7:627\u2013656","journal-title":"SIAM J Numer Anal"},{"key":"1881_CR8","doi-asserted-by":"publisher","first-page":"95","DOI":"10.1145\/321250.321259","volume":"12","author":"RWA Hockney","year":"1965","unstructured":"Hockney RWA (1965) fast direct solution of Poisson\u2019s equation using fourier analysis. J ACM 12:95\u2013113","journal-title":"J ACM"},{"key":"1881_CR9","doi-asserted-by":"publisher","first-page":"27","DOI":"10.1145\/321738.321741","volume":"20","author":"HS Stone","year":"1973","unstructured":"Stone HS (1973) An efficient parallel algorithm for the solution of a tridiagonal linear system of equations. J ACM 20:27\u201338","journal-title":"J ACM"},{"key":"1881_CR10","doi-asserted-by":"publisher","unstructured":"Bondeli S (1990) Divide and conquer: a parallel algorithm for the solution of a tridiagonal linear system of equations. In: Joint International Conference on Vector and Parallel Processing, CONPAR 90, vol. IV. Springer, Berlin, pp 419\u2013434","DOI":"10.1007\/3-540-53065-7_92"},{"key":"1881_CR11","doi-asserted-by":"publisher","first-page":"170","DOI":"10.1145\/355945.355947","volume":"7","author":"HH Wang","year":"1981","unstructured":"Wang HH (1981) A parallel method for tridiagonal equations. ACM Trans Math Softw 7:170\u2013183","journal-title":"ACM Trans Math Softw"},{"key":"1881_CR12","doi-asserted-by":"publisher","unstructured":"Lorenzo PAR, M\u00fcller A, Murakami Y, Wylie BJN (1996) High performance fortran interfacing to scalapack. In: Proceedings of the Third International Workshop on Applied Parallel Computing, Industrial Computation and Optimization, pp 457\u2013466","DOI":"10.1007\/3-540-62095-8_49"},{"key":"1881_CR13","volume-title":"Siesta: an scalable island equilibrium solver for toroidal applications","author":"R Sanchez","year":"2010","unstructured":"Sanchez R, Hirshman S, Lynch V (2010) Siesta: an scalable island equilibrium solver for toroidal applications. American Physical Society, Providence"},{"issue":"3","key":"1881_CR14","doi-asserted-by":"publisher","first-page":"179","DOI":"10.1111\/j.1467-8659.1986.tb00296.x","volume":"5","author":"HR Arabnia","year":"1986","unstructured":"Arabnia HR, Oliver MA (1986) Fast operations on raster images with SIMD machine architectures. Comput Graph Forum 5(3):179\u2013188","journal-title":"Comput Graph Forum"},{"issue":"30","key":"1881_CR15","doi-asserted-by":"publisher","first-page":"425","DOI":"10.1093\/comjnl\/30.5.425","volume":"30","author":"HR Arabnia","year":"1987","unstructured":"Arabnia HR, Oliver MA (1987) A transputer network for the arbitrary rotation of digitised images. Comput J 30(30):425\u2013432","journal-title":"Comput J"},{"issue":"1","key":"1881_CR16","doi-asserted-by":"publisher","first-page":"3","DOI":"10.1111\/j.1467-8659.1987.tb00340.x","volume":"6","author":"HR Arabnia","year":"1987","unstructured":"Arabnia HR, Oliver MA (1987) Arbitrary rotation of raster images with simd machine architectures. Comput Graphics Forum 6(1):3\u201311","journal-title":"Comput Graphics Forum"},{"issue":"8","key":"1881_CR17","doi-asserted-by":"publisher","first-page":"3","DOI":"10.1111\/j.1467-8659.1989.tb00448.x","volume":"8","author":"HR Arabnia","year":"1989","unstructured":"Arabnia HR, Oliver MA (1989) A transputer network for fast operations on digitised images. Comput Graphics Forum 8(8):3\u201311","journal-title":"Comput Graphics Forum"},{"issue":"2","key":"1881_CR18","doi-asserted-by":"publisher","first-page":"188","DOI":"10.1016\/0743-7315(90)90028-N","volume":"10","author":"HR Arabnia","year":"1990","unstructured":"Arabnia HR (1990) A parallel algorithm for the arbitrary rotation of digitized images using process-and-data-decomposition approach. J Parallel Distrib Comput 10(2):188\u2013192","journal-title":"J Parallel Distrib Comput"},{"key":"1881_CR19","unstructured":"Arabnia HR (1995) Distributed stereo-correlation algorithm. In: Proceedings of the International Conference on Computer Communications and Networks, pp 707\u2013711"},{"issue":"2","key":"1881_CR20","doi-asserted-by":"publisher","first-page":"201","DOI":"10.1142\/S0218001495000110","volume":"9","author":"SM Bhandarkar","year":"2011","unstructured":"Bhandarkar SM, Arabnia HR, Smith JW (2011) A reconfigurable architecture for image processing and computer vision. Int J Pattern Recognit Artif Intell 9(2):201\u2013229","journal-title":"Int J Pattern Recognit Artif Intell"},{"issue":"1","key":"1881_CR21","doi-asserted-by":"publisher","first-page":"107","DOI":"10.1006\/jpdc.1995.1011","volume":"24","author":"SM Bhandarkar","year":"1995","unstructured":"Bhandarkar SM, Arabnia HR (1995) The hough transform on a reconfigurable multi-ring network. J Parallel Distrib Comput 24(1):107\u2013114","journal-title":"J Parallel Distrib Comput"},{"issue":"11","key":"1881_CR22","doi-asserted-by":"publisher","first-page":"1783","DOI":"10.1016\/0167-8191(95)00032-9","volume":"21","author":"SM Bhandarkar","year":"1995","unstructured":"Bhandarkar SM, Arabnia HR (1995) The refine multiprocessor theoretical properties and algorithms. Parallel Comput 21(11):1783\u20131805","journal-title":"Parallel Comput"},{"issue":"3","key":"1881_CR23","doi-asserted-by":"publisher","first-page":"243","DOI":"10.1007\/BF00130109","volume":"10","author":"HR Arabnia","year":"1996","unstructured":"Arabnia HR, Bhandarkar SM (1996) Parallel stereocorrelation on a reconfigurable multi-ring network. J Supercomput 10(3):243\u2013269","journal-title":"J Supercomput"},{"issue":"1","key":"1881_CR24","doi-asserted-by":"publisher","first-page":"43","DOI":"10.1023\/A:1022804606389","volume":"25","author":"MA Wani","year":"2003","unstructured":"Wani MA, Arabnia HR (2003) Parallel edge-region-based segmentation algorithm targeted at reconfigurable multiring network. J Supercomput 25(1):43\u201362","journal-title":"J Supercomput"},{"key":"1881_CR25","unstructured":"Thapliyal H, Srinivas MB, Arabnia HR (2005) A need of quantum computing: Reversible logic synthesis of parallel binary adder-subtractor. In: International Conference on Embedded Systems and Applications. ESA, Las Vegas"},{"key":"1881_CR26","first-page":"438","volume":"2","author":"H Thapliyal","year":"2006","unstructured":"Thapliyal H, Arabnia H, Vinod AP (2006) Combined integer and floating point multiplication architecture (CIFM) for fpgas and its reversible logic implementation. Comput Sci 2:438\u2013442","journal-title":"Comput Sci"},{"key":"1881_CR27","unstructured":"Gopineedi PD, Thapliyal H, Srinivas MB, Arabnia HR (2006) Novel and efficient 4: 2 and 5: 2 compressors with minimum number of transistors designed for low-power operations. In: International Conference on Embedded Systems Applications, Las Vegas, pp 160\u2013168"},{"key":"1881_CR28","unstructured":"Thapliyal H, Arabnia HR (2006) Reversible programmable logic array (RPLA) using fredkin and feynman gates for industrial electronics and applications. Computer Science"},{"key":"1881_CR29","unstructured":"Thapliyal H, Arabnia HR, Bajpai R, Sharma KK (2007) Combined integer and variable precision (CIVP) floating point multiplication architecture for fpgas. Comput Sci"},{"key":"1881_CR30","doi-asserted-by":"crossref","DOI":"10.1007\/978-3-642-00212-0_6","volume-title":"Efficient reversible logic design of BCD subtractors","author":"H Thapliyal","year":"2009","unstructured":"Thapliyal H, Arabnia HR, Srinivas MB (2009) Efficient reversible logic design of BCD subtractors. Springer, Berlin"},{"key":"1881_CR31","unstructured":"Balasubramanian P, Edwards DA, Arabnia HR (2011) Robust asynchronous carry lookahead adders. In: International Conference on Computer Design, pp 321\u2013324"},{"key":"1881_CR32","unstructured":"Balasubramanian P, Arabnia HR, Arisaka R (2012) Rb_dsop: a rule based disjoint sum of products synthesis method. In: International Conference on Computer Design"},{"key":"1881_CR33","doi-asserted-by":"crossref","unstructured":"Thapliyal H, Jayashree HV, Nagamani AN, Arabnia HR (2013) Progress in reversible processor design: a novel methodology for reversible carry look-ahead adder","DOI":"10.1007\/978-3-642-35840-1_4"},{"issue":"10","key":"1881_CR34","doi-asserted-by":"publisher","first-page":"2598","DOI":"10.1016\/j.cpc.2014.06.006","volume":"185","author":"J Lee","year":"2014","unstructured":"Lee J, Wright JC (2014) A block-tridiagonal solver with two-level parallelization for finite element-spectral codes. Comput Phys Commun 185(10):2598\u20132608","journal-title":"Comput Phys Commun"},{"issue":"4","key":"1881_CR35","doi-asserted-by":"publisher","first-page":"15","DOI":"10.1016\/0898-1221(92)90003-Z","volume":"24","author":"V Ruggiero","year":"1992","unstructured":"Ruggiero V, Galligani E (1992) A parallel algorithm for solving block tridiagonal linear systems. Comput Math Appl 24(4):15\u201321","journal-title":"Comput Math Appl"},{"issue":"7","key":"1881_CR36","doi-asserted-by":"publisher","first-page":"2135","DOI":"10.1016\/j.matcom.2008.09.009","volume":"79","author":"HB Li","year":"2009","unstructured":"Li HB, Huang TZ, Zhang Y, Liu XP, Li H (2009) On some new approximate factorization methods for block tridiagonal matrices suitable for vector and parallel processors. Math Comput Simul 79(7):2135\u20132147","journal-title":"Math Comput Simul"},{"key":"1881_CR37","volume-title":"Iterative krylov methods for large linear systems","author":"A Henk","year":"2003","unstructured":"Henk A, Vorst VD (2003) Iterative krylov methods for large linear systems, vol 13. Cambridge University Press, Cambridge xiv+221"},{"key":"1881_CR38","volume-title":"Numerical methods for grid equations","author":"A\u00a0A Samarskii","year":"1989","unstructured":"Samarskii A\u00a0A, Nikolaev E\u00a0S (1989) Numerical methods for grid equations. Birkh\u00e4user, Basel"},{"issue":"120","key":"1881_CR39","doi-asserted-by":"publisher","first-page":"859","DOI":"10.1090\/S0025-5718-1972-0323087-4","volume":"26","author":"JM Varah","year":"1972","unstructured":"Varah JM (1972) On the solution of block-tridiagonal systems arising from certain finite-difference equations. Math Comput 26(120):859\u2013868","journal-title":"Math Comput"},{"issue":"s 6\u20137","key":"1881_CR40","first-page":"475","volume":"39","author":"AV Terekhov","year":"2011","unstructured":"Terekhov AV (2011) A fast parallel algorithm for solving block-tridiagonal systems of linear equations including the domain decomposition method. Parallel Comput 39(s 6\u20137):475\u2013484","journal-title":"Parallel Comput"},{"issue":"4","key":"1881_CR41","doi-asserted-by":"publisher","first-page":"15","DOI":"10.1016\/0898-1221(92)90003-Z","volume":"24","author":"V Ruggiero","year":"1992","unstructured":"Ruggiero V, Galligani E (1992) A parallel algorithm for solving block tridiagonal linear systems. Comput Math Appl 24(4):15\u201321","journal-title":"Comput Math Appl"},{"issue":"2008","key":"1881_CR42","first-page":"871","volume":"58","author":"MH Gutknecht","year":"2007","unstructured":"Gutknecht MH, Schmelzer T (2007) Updating the qr decomposition of block tridiagonal and block hessenberg matrices. Appl Numer Math 58(2008):871\u2013883","journal-title":"Appl Numer Math"},{"issue":"2","key":"1881_CR43","doi-asserted-by":"publisher","first-page":"248","DOI":"10.1016\/j.cam.2006.02.029","volume":"202","author":"MH Koulaei","year":"2007","unstructured":"Koulaei MH, Toutounian F (2007) On computing of block ilu preconditioner for block tridiagonal systems. J Comput Appl Math 202(2):248\u2013257","journal-title":"J Comput Appl Math"},{"issue":"2","key":"1881_CR44","doi-asserted-by":"publisher","first-page":"181","DOI":"10.1177\/1094342013501126","volume":"28","author":"W Yang","year":"2014","unstructured":"Yang W, Li K, Liu Y, Shi L, Wang C (2014) Optimization of quasi diagonal matrix-vector multiplication on gpu. Int J High Perform Comput Appl 28(2):181\u2013193","journal-title":"Int J High Perform Comput Appl"},{"key":"1881_CR45","doi-asserted-by":"publisher","unstructured":"Li K, Yang W, Li K (2015) Performance analysis and optimization for SPMV on GPU using probabilistic modeling. IEEE Trans Parallel Distrib Syst 26:196\u2013205. doi: 10.1109\/TPDS.2014.2308221","DOI":"10.1109\/TPDS.2014.2308221"},{"issue":"9","key":"1881_CR46","doi-asserted-by":"publisher","first-page":"2623","DOI":"10.1109\/TC.2014.2366731","volume":"64","author":"W Yang","year":"2015","unstructured":"Yang W, Li K, Mo Z, Li K (2015) Performance optimization using partitioned SPMV on GPUs and multicore cpus. IEEE Trans Comput 64(9):2623\u20132636","journal-title":"IEEE Trans Comput"},{"issue":"11","key":"1881_CR47","doi-asserted-by":"publisher","first-page":"67","DOI":"10.1016\/j.procs.2012.04.008","volume":"9","author":"E DAzevedo","year":"2012","unstructured":"DAzevedo E, Hill J\u00a0C (2012) Parallel lu factorization on GPU cluster. Proc Comp Sci 9(11):67\u201375","journal-title":"Proc Comp Sci"},{"key":"1881_CR48","volume-title":"A hybridization methodology for high-performance linear algebra software for GPUs, Chap 34","author":"S Tomov","year":"2012","unstructured":"Tomov S (2012) A hybridization methodology for high-performance linear algebra software for GPUs, Chap 34. Elsevier, Amsterdam"},{"key":"1881_CR49","doi-asserted-by":"crossref","unstructured":"Agullo E, Demmel J, Dongarra J, Hadri B, Kurzak J, Langou J, Ltaief H, Luszczek P, Tomov S (2009) Numerical linear algebra on emerging architectures: the plasma and magma projects. J Phys Conf Seri, p 012037","DOI":"10.1088\/1742-6596\/180\/1\/012037"},{"key":"1881_CR50","doi-asserted-by":"publisher","unstructured":"Davidson A, Zhang Y, Owens JD (2011) An auto-tuned method for solving large tridiagonal systems on the gpu. In: Proceedings of the 2011 IEEE International Parallel Distributed Processing Symposium, pp 956\u2013965","DOI":"10.1109\/IPDPS.2011.92"},{"issue":"1","key":"1881_CR51","doi-asserted-by":"publisher","first-page":"22","DOI":"10.1109\/TPDS.2010.61","volume":"22","author":"D G\u00f6ddeke","year":"2011","unstructured":"G\u00f6ddeke D, Strzodka R (2011) Cyclic reduction tridiagonal solvers on GPUs applied to mixed-precision multigrid. IEEE Trans Parallel Distrib Syst 22(1):22\u201332","journal-title":"IEEE Trans Parallel Distrib Syst"},{"issue":"4","key":"1881_CR52","doi-asserted-by":"publisher","first-page":"31:1","DOI":"10.1145\/2830568","volume":"42","author":"E L\u00e1szl\u00f3","year":"2016","unstructured":"L\u00e1szl\u00f3 E, Giles M, Appleyard J (2016) Manycore algorithms for batch scalar and block tridiagonal solvers. ACM Trans Math Softw 42(4):31:1\u201331:36","journal-title":"ACM Trans Math Softw"},{"key":"1881_CR53","unstructured":"NVIDIA (213) NVIDIA CUDA C programming guide, Tech. Rep"},{"key":"1881_CR54","unstructured":"NVIDIA (2015) Cusolver library, Tech. Rep"},{"key":"1881_CR55","unstructured":"NVIDIA (2015) Cusparse library, Tech. Rep"},{"key":"1881_CR56","unstructured":"PARALUTION Labs UG & Co. KG (2015) Paralution\u2014user manual, Tech. Rep., Gaggenau"},{"issue":"1","key":"1881_CR57","doi-asserted-by":"publisher","first-page":"200","DOI":"10.1007\/s11227-014-1143-8","volume":"69","author":"L Ziane\u00a0Khodja","year":"2014","unstructured":"Ziane\u00a0Khodja L, Couturier R, Giersch A, Bahi J (2014) Parallel sparse linear solver with gmres method using minimization techniques of communications for gpu clusters. J Supercomput 69(1):200\u2013224. doi: 10.1007\/s11227-014-1143-8","journal-title":"J Supercomput"},{"key":"1881_CR58","doi-asserted-by":"publisher","unstructured":"Couturier R, Denis C, Jzquel F (2008) Gremlins: a large sparse linear solver for grid environment. Parallel Comput 34(6C8):380\u2013391. Parallel Matrix Algorithms and Applications. http:\/\/www.sciencedirect.com\/science\/article\/pii\/S0167819107001354","DOI":"10.1016\/j.parco.2007.12.002"},{"issue":"3","key":"1881_CR59","doi-asserted-by":"publisher","first-page":"1517","DOI":"10.1007\/s11227-011-0563-y","volume":"59","author":"F Jezequel","year":"2012","unstructured":"Jezequel F, Couturier R, Denis C (2012) Solving large sparse linear systems in a grid environment: the gremlins code versus the petsc library. J Supercomput 59(3):1517\u20131532. doi: 10.1007\/s11227-011-0563-y","journal-title":"J Supercomput"},{"key":"1881_CR60","unstructured":"Smith B (2001) PETSC: portable, extensible toolkit for scientific computation. Encyclopedia of Parallel Computing, pp 1530\u20131539"},{"key":"1881_CR61","volume-title":"The theory of matrices in numerical analysis","author":"AS Householder","year":"1964","unstructured":"Householder AS (1964) The theory of matrices in numerical analysis. Dover, New York"},{"issue":"1","key":"1881_CR62","first-page":"8","volume":"38","author":"T\u00a0A Davis","year":"2011","unstructured":"Davis T\u00a0A (2011) Algorithm 915, suitesparseqr: multifrontal multithreaded rank-revealing sparse qr factorization. ACM Trans Math Softw (TOMS) 38(1):8","journal-title":"ACM Trans Math Softw (TOMS)"},{"key":"1881_CR63","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/0000000.0000000","volume":"1","author":"TA Davis","year":"2015","unstructured":"Davis TA, Yeralan SN, Ranka S (2015) Algorithm 9xx: sparse qr factorization on the GPU. ACM Trans Math Softw 1:1\u201328. doi: 10.1145\/0000000.0000000","journal-title":"ACM Trans Math Softw"}],"container-title":["The Journal of Supercomputing"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s11227-016-1881-x\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11227-016-1881-x.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11227-016-1881-x.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2019,9,13]],"date-time":"2019-09-13T18:03:06Z","timestamp":1568397786000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s11227-016-1881-x"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2016,9,22]]},"references-count":63,"journal-issue":{"issue":"5","published-print":{"date-parts":[[2017,5]]}},"alternative-id":["1881"],"URL":"https:\/\/doi.org\/10.1007\/s11227-016-1881-x","relation":{},"ISSN":["0920-8542","1573-0484"],"issn-type":[{"value":"0920-8542","type":"print"},{"value":"1573-0484","type":"electronic"}],"subject":[],"published":{"date-parts":[[2016,9,22]]}}}