{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,25]],"date-time":"2026-06-25T07:45:54Z","timestamp":1782373554435,"version":"3.54.5"},"reference-count":38,"publisher":"Springer Science and Business Media LLC","issue":"8","license":[{"start":{"date-parts":[[2016,3,24]],"date-time":"2016-03-24T00:00:00Z","timestamp":1458777600000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["J Supercomput"],"published-print":{"date-parts":[[2017,8]]},"DOI":"10.1007\/s11227-016-1701-3","type":"journal-article","created":{"date-parts":[[2016,3,24]],"date-time":"2016-03-24T11:30:59Z","timestamp":1458819059000},"page":"3411-3432","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":17,"title":["Efficient implementation of Jacobi iterative method for large sparse linear systems on graphic processing units"],"prefix":"10.1007","volume":"73","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-9004-006X","authenticated-orcid":false,"given":"Abal-Kassim","family":"Cheik Ahamed","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Fr\u00e9d\u00e9ric","family":"Magoul\u00e8s","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2016,3,24]]},"reference":[{"issue":"3\u20134","key":"1701_CR1","doi-asserted-by":"crossref","first-page":"315","DOI":"10.1023\/A:1019158207224","volume":"15","author":"J Bahi","year":"1997","unstructured":"Bahi J, Miellou JC, Rhofir K (1997) Asynchronous multisplitting methods for nonlinear fixed point problems. Numer Algorithms 15(3\u20134):315\u2013345","journal-title":"Numer Algorithms"},{"key":"1701_CR2","doi-asserted-by":"crossref","unstructured":"Bahi JM (2000) Asynchronous iterative algorithms for nonexpansive linear systems. J Parallel Distrib Comput 60(1):92\u2013112","DOI":"10.1006\/jpdc.1999.1587"},{"key":"1701_CR3","doi-asserted-by":"crossref","DOI":"10.1201\/9781584888093","volume-title":"Parallel iterative algorithms: from sequential to grid computing","author":"JM Bahi","year":"2007","unstructured":"Bahi JM, Contassot-Vivier S, Couturier R (2007) Parallel iterative algorithms: from sequential to grid computing. CRC Press, Boca Raton"},{"key":"1701_CR4","unstructured":"Bahi JM, Couturier R, Khodja LZ (2011) Parallel GMRES implementation for solving sparse linear systems on GPU clusters. Society for Computer Simulation International, San Diego, pp 12\u201319"},{"key":"1701_CR5","unstructured":"Bell N, Garland M (2008) Efficient sparse matrix\u2013vector multiplication on CUDA. Nvidia Technical Report NVR-2008-004, Nvidia Corporation"},{"key":"1701_CR6","doi-asserted-by":"publisher","unstructured":"Bell N, Garland M (2009) Implementing sparse matrix\u2013vector multiplication on throughput-oriented processors. In: Proceedings of the conference on high performance computing networking, storage and analysis (SC\u201909), Portland. ACM, New York, pp 18:1\u201318:11. doi: 10.1145\/1654059.1654078","DOI":"10.1145\/1654059.1654078"},{"key":"1701_CR7","doi-asserted-by":"publisher","unstructured":"Bolz J, Farmer I, Grinspun E, Schr\u00f6oder P (2003) Sparse matrix solvers on the GPU: conjugate gradients and multigrid. ACM Trans Graph 22(3):917. doi: 10.1145\/882262.882364","DOI":"10.1145\/882262.882364"},{"key":"1701_CR8","doi-asserted-by":"crossref","first-page":"32","DOI":"10.1007\/978-3-642-02652-2_7","volume-title":"Model checking software","author":"D Bo\u0161na\u010dki","year":"2009","unstructured":"Bo\u0161na\u010dki D, Edelkamp S, Sulewski D (2009) Efficient probabilistic model checking on general purpose graphics processors. In: P\u0103s\u0103reanu CS (ed) Model checking software, vol 5578. Springer, Berlin, pp 32\u201349"},{"key":"1701_CR9","doi-asserted-by":"publisher","unstructured":"Cheik Ahamed A-K, Magoul\u00e8s F (2012) Fast sparse matrix\u2013vector multiplication on graphics processing unit for finite element analysis. In: 14th IEEE international conference on high performance computing and communications (HPCC\u201912), Liverpool. IEEE, pp 1307\u20131314. doi: 10.1109\/HPCC.2012.193","DOI":"10.1109\/HPCC.2012.193"},{"key":"1701_CR10","doi-asserted-by":"publisher","unstructured":"Cheik Ahamed A-K, Magoul\u00e8s F (2012) Iterative methods for sparse linear systems on graphics processing unit. In: 14th IEEE international conference on high performance computing and communications (HPCC\u201912), Liverpool. IEEE, pp 836\u2013842. doi: 10.1109\/HPCC.2012.118","DOI":"10.1109\/HPCC.2012.118"},{"key":"1701_CR11","doi-asserted-by":"publisher","unstructured":"Cheik Ahamed A-K, Magoul\u00e8s F (2014) Parallel sub-structuring methods for solving sparse linear systems on a cluster of GPUs. In: 16th IEEE international conference on high performance computing and communications (HPCC\u201914), Paris. IEEE, pp 121\u2013128. doi: 10.1109\/HPCC.2014.24","DOI":"10.1109\/HPCC.2014.24"},{"key":"1701_CR12","doi-asserted-by":"publisher","unstructured":"Cheik Ahamed A-K, Magoul\u00e8s F (2013) Iterative Krylov methods for gravity problems on graphics processing unit. In: 12th international symposium on distributed computing and applications to business, engineering and science (DCABES), Kingston. IEEE, pp 16\u201320. doi: 10.1109\/DCABES.2013.10","DOI":"10.1109\/DCABES.2013.10"},{"key":"1701_CR13","unstructured":"Cheik Ahamed A-K, Magoul\u00e8s F (2014) A stochastic-based optimized Schwarz method for the gravimetry equations on GPU clusters. In: Erhel J, Gander MJ, Halpern L, Pichot G, Sassi T, Widlund O (eds) Domain decomposition methods in science and engineering XXI, vol 98. Springer, New York, pp 687\u2013695"},{"key":"1701_CR14","doi-asserted-by":"publisher","unstructured":"Cheik Ahamed A-K, Magoul\u00e8s F (2014) Energy consumption analysis on graphics processing units. In: 13th international symposium on distributed computing and applications to business, engineering and science (DCABES), Xianning. IEEE, pp 46\u201350. doi: 10.1109\/DCABES.2014.13","DOI":"10.1109\/DCABES.2014.13"},{"key":"1701_CR15","doi-asserted-by":"publisher","unstructured":"Cheik\u00a0Ahamed A-K, Magoul\u00e8s F (2014) Iterative Krylov methods for acoustic problems on graphics processing unit. In: 13th international symposium on distributed computing and applications to business, engineering and science (DCABES), Xianning. IEEE, pp 19\u201323. doi: 10.1109\/DCABES.2014.7","DOI":"10.1109\/DCABES.2014.7"},{"key":"1701_CR16","doi-asserted-by":"crossref","unstructured":"Cormie-Bowins E (2012) A comparison of sequential and GPU implementations of iterative methods to compute reachability probabilities. arXiv:1210.6412","DOI":"10.4204\/EPTCS.99.5"},{"key":"1701_CR17","doi-asserted-by":"publisher","unstructured":"Davidson A, Zhang Y, Owens JD (2011) An auto-tuned method for solving large tridiagonal systems on the GPU. In: Proceedings of the 2011 IEEE international parallel and distributed processing symposium (IPDPS\u201911), Anchorage. IEEE Computer Society, pp 956\u2013965. doi: 10.1109\/IPDPS.2011.92","DOI":"10.1109\/IPDPS.2011.92"},{"key":"1701_CR18","volume-title":"Physical and chemical hydrogeology","author":"PA Domenico","year":"1998","unstructured":"Domenico PA, Schwartz FW (1998) Physical and chemical hydrogeology, vol 44. Wiley, New York"},{"key":"1701_CR19","unstructured":"Eaton TT, Hart DJ, Bradbury KR, Wang HF (2000) Hydraulic conductivity and specific storage of the Maquoketa shale. Final Report for the University of Wisconsin Water Resources Institute. Open-File Report 00-01. Madison, Wisconsin: Wisconsin Geological and Natural History Survey"},{"key":"1701_CR20","unstructured":"Gomes GAA (2009) Linear solvers for stable fluids: GPU vs CPU. In: 17th Encontro Portugues de Computacao Grafica (EPCG\u201909), pp 145\u2013153"},{"key":"1701_CR21","doi-asserted-by":"publisher","unstructured":"Gravvanis GA, Filelis-Papadopoulos CK, Giannoutakis KM (2012) Solving finite difference linear systems on GPUs: CUDA based parallel explicit preconditioned biconjugate conjugate gradient type methods. J Supercomput 61(3):590\u2013604. doi: 10.1007\/s11227-011-0619-z","DOI":"10.1007\/s11227-011-0619-z"},{"key":"1701_CR22","doi-asserted-by":"publisher","unstructured":"Guo P, Wang L (2010) Auto-tuning CUDA parameters for sparse matrix\u2013vector multiplication on GPUs. In: 2010 international conference on computational and information sciences (ICCIS), Chengdu. IEEE, pp 1154\u20131157. doi: 10.1109\/ICCIS.2010.285","DOI":"10.1109\/ICCIS.2010.285"},{"key":"1701_CR23","doi-asserted-by":"publisher","unstructured":"Hassani R, Fazely A, Choudhury RUA, Luksch P (2013) Analysis of sparse matrix\u2013vector multiplication using iterative method in CUDA. In: IEEE, pp 262\u2013266. doi: 10.1109\/NAS.2013.41","DOI":"10.1109\/NAS.2013.41"},{"key":"1701_CR24","doi-asserted-by":"crossref","unstructured":"Jacobsen DA, Thibault JC, Senocak I (2010) An MPI-CUDA implementation for massively parallel incompressible flow computations on multi-GPU clusters. In: 48th AIAA aerospace sciences meeting and exhibit, vol 16","DOI":"10.2514\/6.2010-522"},{"key":"1701_CR25","unstructured":"Kreutzer M, Hager G, Wellein G, Fehske H, Basermann A, Bishop AR (2011) Sparse matrix\u2013vector multiplication on GPGPU clusters: a new storage format and a scalable implementation. CoRR. arXiv:1112.5588"},{"key":"1701_CR26","doi-asserted-by":"publisher","unstructured":"Magoul\u00e8s F, Cerise R, Callet P (2013) A beam-tracing domain decomposition method for sound holography in church acoustics. In: IEEE, pp 61\u201365. doi: 10.1109\/DCABES.2013.18","DOI":"10.1109\/DCABES.2013.18"},{"issue":"3","key":"1701_CR27","doi-asserted-by":"publisher","first-page":"284","DOI":"10.1177\/1094342015576774","volume":"29","author":"F Magoul\u00e8s","year":"2015","unstructured":"Magoul\u00e8s F, Cheik Ahamed A-K (2015) Alinea: an advanced linear algebra library for massively parallel computations on graphics processing units. Int J High Perform Comput Appl 29(3):284\u2013310. doi: 10.1177\/1094342015576774","journal-title":"Int J High Perform Comput Appl"},{"key":"1701_CR28","doi-asserted-by":"publisher","unstructured":"Magoul\u00e8s F, Cheik Ahamed A-K, Suzuki A (2015) Green computing on graphics processing units. Concurrency Computat Pract Exp. 1\u201321. doi: 10.1002\/cpe.3692","DOI":"10.1002\/cpe.3692"},{"key":"1701_CR29","doi-asserted-by":"publisher","unstructured":"Magoul\u00e8s F, Cheik\u00a0Ahamed A-K, Putanowicz R (2014) Auto-tuned Krylov methods on cluster of graphics processing unit. Int J Comput Math 92(6):1222\u20131250. doi: 10.1080\/00207160.2014.930137","DOI":"10.1080\/00207160.2014.930137"},{"key":"1701_CR30","doi-asserted-by":"publisher","unstructured":"Magoul\u00e8s F, Cheik\u00a0Ahamed A-K, Putanowicz R (2015) Optimized Schwarz method without overlap for the gravitational potential equation on cluster of graphics processing unit. Int J Comput Math 1\u201326. doi: 10.1080\/00207160.2015.1011628","DOI":"10.1080\/00207160.2015.1011628"},{"key":"1701_CR31","doi-asserted-by":"publisher","unstructured":"Magoul\u00e8s F, Cheik\u00a0Ahamed A-K, Putanowicz R (2015) Fast iterative solvers for large compressed-sparse row linear systems on graphics processing unit. Pollack Period Int J Eng Inf Sci Akad\u00e9miai Kiad\u00f3 10(1):3\u201318. doi: 10.1556\/Pollack.10.2015.1.1","DOI":"10.1556\/Pollack.10.2015.1.1"},{"key":"1701_CR32","unstructured":"Margaris A, Souravlas S, Roumeliotis M (2014) Parallel implementations of the Jacobi linear algebraic systems solve. CoRR. arXiv:1403.5805"},{"key":"1701_CR33","doi-asserted-by":"publisher","unstructured":"Mu D, Chen P, Wang L (2013) Accelerating the discontinuous Galerkin method for seismic wave propagation simulations using multiple GPUs with CUDA and MPI. Earthq Sci 26(6):377\u2013393. doi: 10.1007\/s11589-013-0047-7","DOI":"10.1007\/s11589-013-0047-7"},{"key":"1701_CR34","doi-asserted-by":"publisher","unstructured":"Ren L, Chen X, Wang Y, Zhang C, Yang H (2012) Sparse LU factorization for parallel circuit simulation on GPU. In: Proceedings of the 49th annual design automation conference (DAC\u201912). ACM, New York, pp 1125\u20131130. doi: 10.1145\/2228360.2228565","DOI":"10.1145\/2228360.2228565"},{"issue":"8","key":"1701_CR35","doi-asserted-by":"crossref","first-page":"1183","DOI":"10.1002\/cpe.2916","volume":"25","author":"HHB S\u00f8rensen","year":"2013","unstructured":"S\u00f8rensen HHB (2013) Auto-tuning of level 1 and level 2 BLAS for GPUs. Concurr Comput Pract Exp 25(8):1183\u20131198","journal-title":"Concurr Comput Pract Exp"},{"key":"1701_CR36","doi-asserted-by":"publisher","unstructured":"Suchoski B, Severn C, Shantharam M, Raghavan P (2012) Adapting sparse triangular solution to GPUs. In: IEEE, pp 140\u2013148. doi: 10.1109\/ICPPW.2012.23","DOI":"10.1109\/ICPPW.2012.23"},{"key":"1701_CR37","unstructured":"Suski B (2006) Caract\u00e9risation et suivi des \u00e9coulements hydriques dans les milieux poreux par la m\u00e9thode du Potentiel Spontan\u00e9. Th\u00e8se. Ph.D. thesis"},{"key":"1701_CR38","doi-asserted-by":"publisher","unstructured":"Xu S, Lin HX, Xue W (2010) Sparse matrix\u2013vector multiplication optimizations based on matrix bandwidth reduction using NVIDIA CUDA. In: IEEE, pp 609\u2013614. doi: 10.1109\/DCABES.2010.162","DOI":"10.1109\/DCABES.2010.162"}],"container-title":["The Journal of Supercomputing"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s11227-016-1701-3\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11227-016-1701-3.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11227-016-1701-3","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11227-016-1701-3.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2019,9,5]],"date-time":"2019-09-05T19:35:08Z","timestamp":1567712108000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s11227-016-1701-3"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2016,3,24]]},"references-count":38,"journal-issue":{"issue":"8","published-print":{"date-parts":[[2017,8]]}},"alternative-id":["1701"],"URL":"https:\/\/doi.org\/10.1007\/s11227-016-1701-3","relation":{},"ISSN":["0920-8542","1573-0484"],"issn-type":[{"value":"0920-8542","type":"print"},{"value":"1573-0484","type":"electronic"}],"subject":[],"published":{"date-parts":[[2016,3,24]]}}}