{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,3]],"date-time":"2026-07-03T20:17:46Z","timestamp":1783109866248,"version":"3.54.6"},"reference-count":102,"publisher":"Springer Science and Business Media LLC","issue":"6","license":[{"start":{"date-parts":[[2025,7,25]],"date-time":"2025-07-25T00:00:00Z","timestamp":1753401600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by-nc-nd\/4.0"},{"start":{"date-parts":[[2025,7,25]],"date-time":"2025-07-25T00:00:00Z","timestamp":1753401600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by-nc-nd\/4.0"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["J. King Saud Univ. Comput. Inf. Sci."],"published-print":{"date-parts":[[2025,8]]},"DOI":"10.1007\/s44443-025-00128-w","type":"journal-article","created":{"date-parts":[[2025,7,25]],"date-time":"2025-07-25T15:36:29Z","timestamp":1753457789000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":5,"title":["Hajj-FQA: A benchmark Arabic dataset for developing question-answering systems on Hajj fatwas"],"prefix":"10.1007","volume":"37","author":[{"given":"Hayfa A.","family":"Aleid","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-0983-2861","authenticated-orcid":false,"given":"Aqil M.","family":"Azmi","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2025,7,25]]},"reference":[{"key":"128_CR1","doi-asserted-by":"crossref","unstructured":"Abdallah A, Kasem M, Abdalla M, Mahmoud M, Elkasaby M, Elbendary Y et\u00a0al (2024) ArabicaQA: A Comprehensive Dataset for Arabic Question Answering. In: Proceedings of the 47th International ACM SIGIR Conference on Research and Development in Information Retrieval, pp 2049\u20132059","DOI":"10.1145\/3626772.3657889"},{"key":"128_CR2","doi-asserted-by":"crossref","unstructured":"Abdel Azim H, Waheed MT, Mohammed A (2025) Large language models-based metric for generative question answering systems. IAES Intern J Artif Intel (IJ-AI) 14(1):152\u2013161","DOI":"10.11591\/ijai.v14.i1.pp151-158"},{"key":"128_CR3","unstructured":"Abdelaziz N, Elsayed E, El-Sayed M (2021) FAAQA-QAD: A Frequently Asked Arabic Question Answering Dataset for Diseases Detection System. In: Proceedings of the 12th Language Resources and Evaluation Conference, pp 3109\u20133116"},{"key":"128_CR4","doi-asserted-by":"crossref","unstructured":"Abdul-Mageed M, Elmadany A, Nagoudi EMB (2021) ARBERT & MARBERT: Deep Bidirectional Transformers for Arabic. In: Zong C, Xia F, Li W, Navigli R (eds) Proceedings of the 59th Annual Meeting of the Association for Computational Linguistics and the 11th International Joint Conference on Natural Language Processing (Volume 1: Long Papers). Online: Association for Computational Linguistics, pp 7088\u20137105","DOI":"10.18653\/v1\/2021.acl-long.551"},{"key":"128_CR5","doi-asserted-by":"crossref","unstructured":"Adamopoulou E, Moussiades L (2020a) Chatbots: History, technology, and applications. Mach Learn Appl 2:100006","DOI":"10.1016\/j.mlwa.2020.100006"},{"key":"128_CR6","doi-asserted-by":"crossref","unstructured":"Adamopoulou E, Moussiades L (2020b) An Overview of Chatbot Technology. In: Maglogiannis I, Iliadis L, Pimenidis E (eds) Artificial Intelligence Applications and Innovations. Springer International Publishing, Cham, pp 373\u2013383","DOI":"10.1007\/978-3-030-49186-4_31"},{"issue":"6","key":"128_CR7","doi-asserted-by":"publisher","first-page":"652","DOI":"10.3844\/ajassp.2011.652.661","volume":"8","author":"M Akour","year":"2011","unstructured":"Akour M, Abufardeh S, Magel K, Al-Radaideh Q (2011) QArabPro: A rule based question answering system for reading comprehension tests in Arabic. Am J Appl Sci 8(6):652\u2013661","journal-title":"Am J Appl Sci"},{"issue":"8","key":"128_CR8","doi-asserted-by":"publisher","first-page":"101709","DOI":"10.1016\/j.jksuci.2023.101709","volume":"35","author":"H Alami","year":"2023","unstructured":"Alami H, El Mahdaouy A, Benlahbib N, En-Nahnahi N, Berrada I, Alaoui Ouatik SE (2023) DAQAS: Deep Arabic Question Answering System based on duplicate question detection and machine reading comprehension. J King Saud Univ - Comput Inf Sci 35(8):101709","journal-title":"J King Saud Univ - Comput Inf Sci"},{"issue":"3","key":"128_CR9","doi-asserted-by":"publisher","first-page":"729","DOI":"10.1007\/s10579-022-09577-5","volume":"56","author":"E Albilali","year":"2022","unstructured":"Albilali E, Al-Twairesh N, Hosny M (2022) Constructing Arabic Reading Comprehension Datasets: Arabic WikiReading and KaifLematha. Lang Res Eval 56(3):729\u2013764","journal-title":"Lang Res Eval"},{"key":"128_CR10","doi-asserted-by":"crossref","unstructured":"Alhawasi H, Youssef A (2024) Using LLMs for Evaluating QA Systems: Exploration and Assessment. In: 2024 2nd International Conference on Foundation and Large Language Models (FLLM), pp 462\u2013469","DOI":"10.1109\/FLLM63129.2024.10852500"},{"key":"128_CR11","doi-asserted-by":"publisher","first-page":"534","DOI":"10.1007\/978-3-030-22354-0_47","volume-title":"Complex, Intelligent, and Software Intensive Systems","author":"EH Almansor","year":"2020","unstructured":"Almansor EH, Hussain FK (2020) Survey on Intelligent Chatbots: State-of-the-Art and Future Research Directions. In: Barolli L, Hussain FK, Ikeda M (eds) Complex, Intelligent, and Software Intensive Systems. Springer International Publishing, Cham, pp 534\u2013543"},{"key":"128_CR12","unstructured":"Almazrouei E et\u00a0al (2023) The Falcon Series of Open Language Models. arxiv:2311.16867"},{"key":"128_CR13","doi-asserted-by":"publisher","first-page":"117384","DOI":"10.1016\/j.eswa.2022.117384","volume":"203","author":"HA Almuzaini","year":"2022","unstructured":"Almuzaini HA, Azmi AM (2022) An unsupervised annotation of Arabic texts using multi-label topic modeling and genetic algorithm. Expert Syst Appl 203:117384","journal-title":"Expert Syst Appl"},{"key":"128_CR14","doi-asserted-by":"publisher","first-page":"191","DOI":"10.18653\/v1\/2023.arabicnlp-1.17","volume":"2023","author":"S Alrowili","year":"2023","unstructured":"Alrowili S, Vijay-Shanker K (2023) ArTrivia: Harvesting Arabic Wikipedia to Build A New Arabic Question Answering Dataset. Proceedings of ArabicNLP 2023:191\u2013207","journal-title":"Proceedings of ArabicNLP"},{"issue":"3","key":"128_CR15","doi-asserted-by":"publisher","first-page":"667","DOI":"10.3390\/ai4030035","volume":"4","author":"TN Alruqi","year":"2023","unstructured":"Alruqi TN, Alzahrani SM (2023) Evaluation of an Arabic Chatbot Based on Extractive Question-Answering Transfer Learning and Language Transformers. AI 4(3):667\u2013691","journal-title":"AI"},{"key":"128_CR16","doi-asserted-by":"publisher","first-page":"111004","DOI":"10.1016\/j.dib.2024.111004","volume":"57","author":"N Al-Shameri","year":"2024","unstructured":"Al-Shameri N, Al-Khalifa H (2024) Arabic paraphrased parallel synthetic dataset. Data Brief 57:111004","journal-title":"Data Brief"},{"issue":"8","key":"128_CR17","first-page":"662","volume":"13","author":"AS Alsheddi","year":"2022","unstructured":"Alsheddi AS, Alhenaki LS (2022) English and Arabic Chatbots: A Systematic Literature Review. Int J Adv Comput Sci Appl 13(8):662\u2013675","journal-title":"Int J Adv Comput Sci Appl"},{"key":"128_CR18","doi-asserted-by":"crossref","unstructured":"Alsubhi K, Jamal A, Alhothali A (2021) Pre-trained transformer-based approach for arabic question answering: A comparative study. arXiv preprint arxiv:2111.05671","DOI":"10.7717\/peerj-cs.952"},{"issue":"8","key":"128_CR19","doi-asserted-by":"publisher","first-page":"4139","DOI":"10.3390\/app15084139","volume":"15","author":"HR Alsulami","year":"2025","unstructured":"Alsulami HR, Almansour AA (2025) Exploring GPT-4 Capabilities in Generating Paraphrased Sentences for the Arabic Language. Appl Sci 15(8):4139","journal-title":"Appl Sci"},{"issue":"8","key":"128_CR20","doi-asserted-by":"publisher","first-page":"101662","DOI":"10.1016\/j.jksuci.2023.101662","volume":"35","author":"SS Al-Thanyyan","year":"2023","unstructured":"Al-Thanyyan SS, Azmi AM (2023) Simplification of Arabic text: A hybrid approach integrating machine translation and transformer-based lexical model. J King Saud Univ-Comput Inf Sci 35(8):101662","journal-title":"J King Saud Univ-Comput Inf Sci"},{"key":"128_CR21","doi-asserted-by":"publisher","first-page":"8867","DOI":"10.1007\/s00521-024-09525-0","volume":"36","author":"TH Alwaneen","year":"2024","unstructured":"Alwaneen TH (2024) Azmi AM (2024) Stacked dynamic memory-coattention network for answering why-questions in Arabic. Neural Comput Appl 36:8867\u20138883","journal-title":"Neural Comput Appl"},{"issue":"1","key":"128_CR22","doi-asserted-by":"publisher","first-page":"207","DOI":"10.1007\/s10462-021-10031-1","volume":"55","author":"TH Alwaneen","year":"2022","unstructured":"Alwaneen TH, Azmi AM, Aboalsamh HA, Cambria E, Hussain A (2022) Arabic question answering system: A survey. Artif Intell Rev 55(1):207\u2013253","journal-title":"Artif Intell Rev"},{"key":"128_CR23","unstructured":"Antoun W, Baly F, Hajj H (2020) AraBERT: Transformer-based Model for Arabic Language Understanding. In: Proceedings of the 4th Workshop on Open-Source Arabic Corpora and Processing Tools (LREC 2020), pp 9\u201315"},{"key":"128_CR24","unstructured":"Antoun W, Baly F, Hajj H (2021) AraELECTRA: Pre-Training Text Discriminators for Arabic Language Understanding. In: Proceedings of the Sixth Arabic Natural Language Processing Workshop. Kyiv, Ukraine (Virtual): Association for Computational Linguistics, pp 191\u2013195"},{"key":"128_CR25","doi-asserted-by":"crossref","unstructured":"Artetxe M, Ruder S, Yogatama D (2020) On the Cross-lingual Transferability of Monolingual Representations. In: Jurafsky D, Chai J, Schluter N, Tetreault J (eds) Proceedings of the 58th Annual Meeting of the Association for Computational Linguistics. Online: Association for Computational Linguistics, pp 4623\u20134637","DOI":"10.18653\/v1\/2020.acl-main.421"},{"key":"128_CR26","doi-asserted-by":"crossref","unstructured":"Atef A, Mattar B, Sherif S, Elrefai E, Torki M (2020) AQAD: 17,000+ Arabic questions for machine comprehension of text. In 2020 IEEE\/ACS 17th International Conference on Computer Systems and Applications (AICCSA), pp 1\u20136","DOI":"10.1109\/AICCSA50499.2020.9316526"},{"key":"128_CR27","unstructured":"Azmi AM, AlShenaifi N (2014) Handling \u201cwhy\u201d questions in Arabic. In: Proceedings of the Fifth International Conference on Arabic Language Processing (CITALA 2014)"},{"issue":"1","key":"128_CR28","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/2950049","volume":"35","author":"AM Azmi","year":"2016","unstructured":"Azmi AM, Alshenaifi NA (2016) Answering Arabic why-questions: Baseline vs. RST-based approach. ACM Trans Inf Syst (TOIS) 35(1):1\u201319","journal-title":"ACM Trans Inf Syst (TOIS)"},{"issue":"6","key":"128_CR29","doi-asserted-by":"publisher","first-page":"877","DOI":"10.1017\/S1351324917000304","volume":"23","author":"AM Azmi","year":"2017","unstructured":"Azmi AM, Alshenaifi NA (2017) LEMAZA: An Arabic why-question answering system. Nat Lang Eng 23(6):877\u2013903","journal-title":"Nat Lang Eng"},{"issue":"2","key":"128_CR30","doi-asserted-by":"publisher","first-page":"1369","DOI":"10.1007\/s10462-019-09692-w","volume":"52","author":"AM Azmi","year":"2019","unstructured":"Azmi AM, Al-Qabbany AO, Hussain A (2019) Computational and natural language processing based studies of hadith literature: A survey. Artif Intell Rev 52(2):1369\u20131414","journal-title":"Artif Intell Rev"},{"key":"128_CR31","unstructured":"Banerjee S, Lavie A (2005) METEOR: An automatic metric for MT evaluation with improved correlation with human judgments. In: Proceedings of the acl workshop on intrinsic and extrinsic evaluation of machine translation and\/or summarization, pp 65\u201372"},{"issue":"2","key":"128_CR32","doi-asserted-by":"publisher","first-page":"103227","DOI":"10.1016\/j.ipm.2022.103227","volume":"60","author":"M Bani-Almarjeh","year":"2023","unstructured":"Bani-Almarjeh M, Kurdy MB (2023) Arabic abstractive text summarization using RNN-based and transformer-based architectures. Inf Process Manag 60(2):103227","journal-title":"Inf Process Manag"},{"key":"128_CR33","unstructured":"Bari MS, Alnumay Y, Alzahrani NA, Alotaibi NM, Alyahya HA, AlRashed S et\u00a0al (2024) ALLaM: Large Language Models for Arabic and English. arXiv preprint arxiv:2407.15390"},{"issue":"7","key":"128_CR34","doi-asserted-by":"publisher","first-page":"6801","DOI":"10.1007\/s10462-022-10313-2","volume":"56","author":"MH Bashir","year":"2023","unstructured":"Bashir MH, Azmi AM, Nawaz H, Zaghouani W, Diab M, Al-Fuqaha A et al (2023) Arabic natural language processing for Qur\u2019anic research: A systematic review. Artif Intell Rev 56(7):6801\u20136854","journal-title":"Artif Intell Rev"},{"key":"128_CR35","unstructured":"Bayan\u00a0Kmainasi M, Ezzat\u00a0Shahroor A, Al-Ghraibah A (2025) Can Large Language Models Predict the Outcome of Judicial Decisions? arXiv e-prints, p. arXiv\u20132501"},{"key":"128_CR36","doi-asserted-by":"crossref","unstructured":"Biltawi MM, Awajan A, Tedmori S (2023) Arabic Span Extraction-based Reading Comprehension Benchmark (ASER) and Neural Baseline Models. ACM Trans Asian Low-Resour Lang Inf Process 22(5):127:1\u2013127:29","DOI":"10.1145\/3579047"},{"key":"128_CR37","doi-asserted-by":"publisher","first-page":"63876","DOI":"10.1109\/ACCESS.2021.3074950","volume":"9","author":"MM Biltawi","year":"2021","unstructured":"Biltawi MM, Tedmori S, Awajan A (2021) Arabic Question Answering Systems: Gap Analysis. IEEE Access 9:63876\u201363904","journal-title":"IEEE Access"},{"key":"128_CR38","doi-asserted-by":"publisher","first-page":"135","DOI":"10.1162\/tacl_a_00051","volume":"5","author":"P Bojanowski","year":"2017","unstructured":"Bojanowski P, Grave E, Joulin A, Mikolov T (2017) Enriching Word Vectors with Subword Information. Trans Assoc Comput Linguist 5:135\u2013146","journal-title":"Trans Assoc Comput Linguist"},{"key":"128_CR39","unstructured":"Chen M, Tworek J, Jun H, Yuan Q, Pinto HPDO, Kaplan J et\u00a0al (2021) Evaluating Large Language Models Trained on Code. arxiv:2107.03374"},{"key":"128_CR40","unstructured":"Clark JH et\u00a0al (2020) TyDi QA: A Benchmark for Information-Seeking Question Answering in Typologically Diverse Languages. In: Jurafsky D, Chai J, Schluter N, Tetreault J (eds) Proceedings of the 58th Annual Meeting of the Association for Computational Linguistics. arxiv:2003.05002"},{"key":"128_CR41","doi-asserted-by":"crossref","unstructured":"Conneau A, Khandelwal K, Goyal N, Chaudhary V, Wenzek G, Guzm\u00e1n F, et\u00a0al (2020) Unsupervised Cross-lingual Representation Learning at Scale. In: Proceedings of the 58th Annual Meeting of the Association for Computational Linguistics, pp 8440\u20138451","DOI":"10.18653\/v1\/2020.acl-main.747"},{"key":"128_CR42","unstructured":"Devlin J, Chang MW, Lee K, Toutanova K (2019) BERT: Pre-training of deep bidirectional transformers for language understanding. In: Proceedings of the 2019 conference of the North American chapter of the association for computational linguistics: human language technologies, volume 1 (long and short papers), pp 4171\u20134186"},{"key":"128_CR43","doi-asserted-by":"publisher","first-page":"23842","DOI":"10.1109\/ACCESS.2022.3155521","volume":"10","author":"A Fuad","year":"2022","unstructured":"Fuad A, Al-Yahya M (2022) Recent Developments in Arabic Conversational AI: A Literature Review. IEEE Access 10:23842\u201323859","journal-title":"IEEE Access"},{"key":"128_CR44","unstructured":"Fu L, Yan P, Peng Y, Zeng S, Lin X, Zhou W (2023) Gpt-score: Evaluate as you desire. arXiv preprint arXiv:2305.04353"},{"key":"128_CR45","doi-asserted-by":"crossref","unstructured":"Hammo B, Abu-Salem H, Lytinen SL, Evens M (2002) QARAB: A: Question answering system to support the Arabic language. In: Proceedings of the ACL-02 workshop on Computational approaches to semitic languages","DOI":"10.3115\/1118637.1118644"},{"key":"128_CR46","doi-asserted-by":"crossref","unstructured":"Hamza A, Alaoui\u00a0Ouatik SE, Zidani KA, En-Nahnahi N (2022) Arabic duplicate questions detection based on contextual representation, class label matching, and structured self attention. J King Saud Univ - Comput Inf Sci 34(6, Part B):3758\u20133765","DOI":"10.1016\/j.jksuci.2020.11.032"},{"key":"128_CR47","unstructured":"He P, Gao J, Chen W (2023) DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing. arxiv:2111.09543"},{"key":"128_CR48","unstructured":"He P, Liu X, Gao J, Chen W (2021) DeBERTa: Decoding-enhanced BERT with Disentangled Attention. arxiv:2006.03654"},{"key":"128_CR49","doi-asserted-by":"crossref","unstructured":"Huang H, Yu F, Zhu J, Sun X, Cheng H, Dingjie S et\u00a0al (2024) AceGPT, Localizing Large Language Models in Arabic. In: Proceedings of the 2024 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies (Volume 1: Long Papers), pp 8139\u20138163","DOI":"10.18653\/v1\/2024.naacl-long.450"},{"key":"128_CR50","doi-asserted-by":"publisher","first-page":"946","DOI":"10.1007\/978-3-030-15035-8_93","volume-title":"Web, Artificial Intelligence and Network Applications","author":"S Hussain","year":"2019","unstructured":"Hussain S, Ameri Sianaki O, Ababneh N (2019) A Survey on Conversational Agents\/Chatbots Classification and Design Techniques. In: Barolli L, Takizawa M, Xhafa F, Enokido T (eds) Web, Artificial Intelligence and Network Applications. Springer International Publishing, Cham, pp 946\u2013956"},{"key":"128_CR51","unstructured":"Ibrahim B, Arifin M, Abd\u00a0Rashid SZ.: The Role of Fatwa and Mufti in Contemporary Muslim Society. https:\/\/www.openurl.ebsco.com\/contentitem\/"},{"key":"128_CR52","unstructured":"Inoue G, Alhafni B, Baimukan N, Bouamor H, Habash N (2021) The Interplay of Variant, Size, and Task Type in Arabic Pre-trained Language Models. arxiv:2103.06678"},{"key":"128_CR53","doi-asserted-by":"crossref","unstructured":"Ismail WS, Homsi MN. DAWQAS: A Dataset for Arabic Why Question Answering System. In: Shaalan K, ElBeltagy SR, editors. Arabic Computational Linguistics. vol. 142 of Procedia Computer Science. Amsterdam: Elsevier Science Bv; 2018. p. 123\u2013131","DOI":"10.1016\/j.procs.2018.10.467"},{"key":"128_CR54","unstructured":"Kahil N (2024) Inside Qatar\u2019s AI project that aims to preserve the Arabic language. Wired"},{"key":"128_CR55","doi-asserted-by":"crossref","unstructured":"Khallaf N, Sharoff S, Soliman R (2022) Towards Arabic Sentence Simplification via Classification and Generative Approaches. In: Bouamor H, Al-Khalifa H, Darwish K, Rambow O, Bougares F, Abdelali A et\u00a0al. (eds) Proceedings of the Seventh Arabic Natural Language Processing Workshop (WANLP), pp 43\u201352","DOI":"10.18653\/v1\/2022.wanlp-1.5"},{"key":"128_CR56","doi-asserted-by":"crossref","unstructured":"Koubaa A, Ammar A, Ghouti L, Najar O, Sibaee S (2024) ArabianGPT: Native Arabic GPT-based Large Language Model. arxiv:2402.15313","DOI":"10.20944\/preprints202402.1409.v1"},{"key":"128_CR57","doi-asserted-by":"crossref","unstructured":"Lan W, Chen Y, Xu W, Ritter A (2020a) An Empirical Study of Pre-trained Transformers for Arabic Information Extraction. In: Webber B, Cohn T, He Y, Liu Y (eds) Proceedings of the 2020 Conference on Empirical Methods in Natural Language Processing (EMNLP). Online: Association for Computational Linguistics, pp 4727\u20134734","DOI":"10.18653\/v1\/2020.emnlp-main.382"},{"key":"128_CR58","unstructured":"Lan Z, Chen M, Goodman S, Gimpel K, Sharma P, Soricut R (2020b) ALBERT: A Lite BERT for Self-supervised Learning of Language Representations. arxiv:1909.11942"},{"issue":"2\u20133","key":"128_CR59","doi-asserted-by":"publisher","first-page":"259","DOI":"10.1080\/01638539809545028","volume":"25","author":"TK Landauer","year":"1998","unstructured":"Landauer TK, Foltz PW, Laham D (1998) An introduction to latent semantic analysis. Discourse Process 25(2\u20133):259\u2013284","journal-title":"Discourse Process"},{"key":"128_CR60","doi-asserted-by":"crossref","unstructured":"Lee H, Yoon S, Dernoncourt F, Kim DS, Bui T, Shin J et\u00a0al (2020) KPQA: A metric for generative question answering using keyphrase weights. arXiv preprint arxiv:2005.00192","DOI":"10.18653\/v1\/2021.naacl-main.170"},{"key":"128_CR61","doi-asserted-by":"crossref","unstructured":"Lewis P, Oguz B, Rinott R, Riedel S, Schwenk H (2020) MLQA: Evaluating Cross-lingual Extractive Question Answering. In: Jurafsky D, Chai J, Schluter N, Tetreault J (eds) Proceedings of the 58th Annual Meeting of the Association for Computational Linguistics. Online: Association for Computational Linguistics, pp 7315\u20137330","DOI":"10.18653\/v1\/2020.acl-main.653"},{"key":"128_CR62","doi-asserted-by":"crossref","unstructured":"Liang D, Gonen H, Mao Y, Hou R, Goyal N, Ghazvininejad M, et\u00a0al (2023) XLM-V: Overcoming the Vocabulary Bottleneck in Multilingual Masked Language Models. In: Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing, pp 13142\u201313152","DOI":"10.18653\/v1\/2023.emnlp-main.813"},{"key":"128_CR63","doi-asserted-by":"crossref","unstructured":"Li S, Che Y, Yang J, Li Q, Tian T (2024) A question answer chatbot using term frequency-inverse document frequency and Markov chain. In: International Conference on Computer Graphics, Artificial Intelligence, and Data Processing (ICCAID 2023). SPIE, pp 966\u2013971","DOI":"10.1117\/12.3026489"},{"key":"128_CR64","unstructured":"Liu Y et\u00a0al (2019) RoBERTa: A Robustly Optimized BERT Pretraining Approach. arxiv:1907.11692"},{"issue":"6","key":"128_CR65","doi-asserted-by":"publisher","DOI":"10.1016\/j.ipm.2022.103068","volume":"59","author":"R Malhas","year":"2022","unstructured":"Malhas R, Elsayed T (2022) Arabic machine reading comprehension on the Holy Qur\u2019an using CL-AraBERT. Inf Process Manag 59(6):103068","journal-title":"Inf Process Manag"},{"key":"128_CR66","unstructured":"Malin C (2024) First LLM trained exclusively on Saudi data sets. Middle East AI News"},{"issue":"10B","key":"128_CR67","doi-asserted-by":"publisher","first-page":"8909","DOI":"10.1016\/j.jksuci.2022.08.020","volume":"34","author":"ZM Mannaa","year":"2022","unstructured":"Mannaa ZM, Azmi AM, Aboalsamh HA (2022) Computer-assisted i\u2018raab of Arabic sentences for teaching grammar to students. J King Saud Univ-Comput Inf Sci 34(10B):8909\u20138926","journal-title":"J King Saud Univ-Comput Inf Sci"},{"key":"128_CR68","doi-asserted-by":"crossref","unstructured":"Masri S, Raddad Y, Khandaqji F, Ashqar HI, Elhenawy M (2024) Transformer models in education: Summarizing science textbooks with arabart, MT5, arat5, and mBART. In: International Conference on Intelligent Systems, Blockchain, and Communication Technologies. Springer, pp 286\u2013300","DOI":"10.1007\/978-3-031-82377-0_25"},{"key":"128_CR69","first-page":"107","volume-title":"Buitelaar P","author":"D Maynard","year":"2008","unstructured":"Maynard D, Li Y, Peters W (2008) NLP Techniques for Term Extraction and Ontology Population. In: Cimiano P (ed) Buitelaar P. Bridging the Gap between Text and Knowledge. IOS Press, Ontology Learning and Population, pp 107\u2013127"},{"key":"128_CR70","volume-title":"1st International Conference on Learning Representations, ICLR 2013, Scottsdale, Arizona, USA, May 2\u20134, 2013","author":"T Mikolov","year":"2013","unstructured":"Mikolov T, Chen K, Corrado G, Dean J (2013) Efficient Estimation of Word Representations in Vector Space. In: Bengio Y, LeCun Y (eds) 1st International Conference on Learning Representations, ICLR 2013, Scottsdale, Arizona, USA, May 2\u20134, 2013. Workshop Track Proceedings"},{"key":"128_CR71","doi-asserted-by":"crossref","unstructured":"Mozannar H, Maamary E, El Hajal K, Hajj (2019) Neural Arabic Question Answering. In Proceedings of the Fourth Arabic Natural Language Processing Workshop, pp 108\u2013118","DOI":"10.18653\/v1\/W19-4612"},{"key":"128_CR72","unstructured":"Nagoudi EMB, Elmadany A, Abdul-Mageed M.: AraT5: Text-to-Text Transformers for Arabic Language Generation. arxiv:2109.12068"},{"key":"128_CR73","unstructured":"Nakano R, Hilton J, Balaji S, Wu J, Ouyang L, Kim C et\u00a0al (2022) WebGPT: Browser-assisted question-answering with human feedback. arxiv:2112.09332"},{"key":"128_CR74","unstructured":"Noor (2022) The World\u2019s Largest Arabic NLP model. Technology Innovation Institute"},{"key":"128_CR75","doi-asserted-by":"crossref","unstructured":"Obeidat R, Al-Harbi M, Al-Ayyoub M, Alawneh L (2024) ArQuAD: An Expert-Annotated Arabic Machine Reading Comprehension Dataset. Cogn Comput","DOI":"10.1007\/s12559-024-10248-6"},{"key":"128_CR76","unstructured":"OpenAI (2024) Introducing ChatGPT. OpenAI"},{"key":"128_CR77","unstructured":"OpenAI et\u00a0al (2024) GPT-4 Technical Report. arxiv:2303.08774"},{"key":"128_CR78","doi-asserted-by":"crossref","unstructured":"Pennington J, Socher R, Manning CD (2014) Glove: Global Vectors for Word Representation. In: EMNLP, pp 1532\u20131543","DOI":"10.3115\/v1\/D14-1162"},{"key":"128_CR79","doi-asserted-by":"crossref","unstructured":"Peters ME et\u00a0al (2018) Deep Contextualized Word Representations. In: Walker M, Ji H, Stent A (eds) Proceedings of the 2018 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies, Volume 1 (Long Papers). New Orleans, Louisiana: Association for Computational Linguistics, pp 2227\u20132237","DOI":"10.18653\/v1\/N18-1202"},{"key":"128_CR80","unstructured":"Radford A, Narasimhan K, Salimans T, Sutskever I (2018) Improving Language Understanding by Generative Pre-Training. https:\/\/cdn.openai.com\/research-covers\/language-unsupervised\/language_understanding_paper.pdf"},{"key":"128_CR81","unstructured":"Radford A, Wu J, Child R, Luan D, Amodei D, Sutskever I (2019) Language Models are Unsupervised Multitask Learners. https:\/\/cdn.openai.com\/better-language-models\/language_models_are_unsupervised_multitask_learners.pdf"},{"issue":"140","key":"128_CR82","first-page":"1","volume":"21","author":"C Raffel","year":"2020","unstructured":"Raffel C, Shazeer N, Roberts A, Lee K, Narang S, Matena M et al (2020) Exploring the limits of transfer learning with a unified text-to-text transformer. J Mach Learn Res 21(140):1\u201367","journal-title":"J Mach Learn Res"},{"key":"128_CR83","doi-asserted-by":"crossref","unstructured":"Rajpurkar P, Jia R, Liang P (2016) Squad: 100,000+ questions for machine comprehension of text. In: Proceedings of the 2016 conference on empirical methods in natural language processing, pp 2383\u20132392","DOI":"10.18653\/v1\/D16-1264"},{"key":"128_CR84","doi-asserted-by":"publisher","first-page":"336","DOI":"10.1007\/978-981-10-6544-6_31","volume-title":"Information, Communication and Computing Technology","author":"K Ramesh","year":"2017","unstructured":"Ramesh K, Ravishankaran S, Joshi A, Chandrasekaran K (2017) A Survey of Design Techniques for Conversational Agents. In: Kaushik S, Gupta D, Kharb L, Chahal D (eds) Information, Communication and Computing Technology. Springer, Singapore, pp 336\u2013350"},{"key":"128_CR85","unstructured":"Saad MK, Ashour W (2010) OSAC: Open source Arabic corpora. In: 6th International Conference on Electrical and Computer Systems (EECS \u201910)"},{"key":"128_CR86","doi-asserted-by":"crossref","unstructured":"Safaya A, Abdullatif M, Yuret D (2020) KUISAIL at SemEval-2020 Task 12: BERT-CNN for Offensive Speech Identification in Social Media. In: Proceedings of the Fourteenth Workshop on Semantic Evaluation. Barcelona (online): International Committee for Computational Linguistics, pp 2054\u20132059","DOI":"10.18653\/v1\/2020.semeval-1.271"},{"key":"128_CR87","unstructured":"Sanh V, Debut L, Chaumond J, Wolf T (2020) DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter. arxiv:1910.01108"},{"issue":"3","key":"128_CR88","first-page":"261","volume":"9","author":"Y Saoudi","year":"2023","unstructured":"Saoudi Y, Gammoudi MM (2023) Trends and Challenges of Arabic Chatbots: Literature Review. Jordanian J Comput Info Technol 9(3):261\u2013286","journal-title":"Jordanian J Comput Info Technol"},{"key":"128_CR89","unstructured":"Sengupta N et\u00a0al (2023) Jais and Jais-chat: Arabic-Centric Foundation and Instruction-Tuned Open Generative Large Language Models. arxiv:2308.16149"},{"key":"128_CR90","unstructured":"Sidhoum AH, Mataoui M, Sebbak F, Sma\u00efli K (2022) ACQAD: A dataset for arabic complex question answering. In: International Conference on Cyber Security, Artificial Inteligence and Theoretical Computer Science, Boumerd\u00e8s, Algeria"},{"key":"128_CR91","doi-asserted-by":"crossref","unstructured":"Siu, SC (2023) ChatGPT and GPT-4 for Professional Translators: Exploring the Potential of Large Language Models in Translation. Computational Linguistics & Natural Language Processing eJournal, 5(24)","DOI":"10.2139\/ssrn.4448091"},{"key":"128_CR92","unstructured":"Talafha B, Ali M, Za\u2019ter ME, Seelawi H, Tuffaha I, Samir M et\u00a0al (2020) Multi-dialect Arabic BERT for Country-level Dialect Identification. In: Zitouni I, Abdul-Mageed M, Bouamor H, Bougares F, El-Haj M, Tomeh N et\u00a0al (eds) Proceedings of the Fifth Arabic Natural Language Processing Workshop. Barcelona, Spain (Online): Association for Computational Linguistics, pp 111\u2013118"},{"key":"128_CR93","unstructured":"Team G, Anil R, Borgeaud S, Wu Y, Alayrac JB, Yu J, et al (2024) Gemini: A family of highly capable multimodal models. arXiv preprint arxiv:2312.11805, 10"},{"key":"128_CR94","unstructured":"Touvron H, Lavril T, Izacard G, Martinet X, Lachaux MA, Lacroix T et\u00a0al (2023a) LLaMA: Open and efficient foundation language models. arXiv preprint arxiv:2302.13971"},{"key":"128_CR95","unstructured":"Touvron H, Martin L, Stone K, Albert P, Almahairi A, Babaei Y et\u00a0al (2023b) Llama 2: Open foundation and fine-tuned chat models. arXiv preprint arxiv:2307.09288"},{"issue":"2","key":"128_CR96","first-page":"1308","volume":"5","author":"A Trivedi","year":"2019","unstructured":"Trivedi A, Gor V, Thakkar Z (2019) Chatbot generation and integration: A review. Inter J Adv Res Ideas Innov Technol 5(2):1308\u20131311","journal-title":"Inter J Adv Res Ideas Innov Technol"},{"key":"128_CR97","first-page":"1","volume-title":"Advances in Neural Information Processing Systems","author":"A Vaswani","year":"2017","unstructured":"Vaswani A, Shazeer N, Parmar N, Uszkoreit J, Jones L, Gomez AN et al (2017) Attention is All you Need. In: Guyon I, Luxburg UV, Bengio S, Wallach H, Fergus R, Vishwanathan S et al (eds) Advances in Neural Information Processing Systems, vol 30. Inc, Curran Associates, pp 1\u201311"},{"issue":"2","key":"128_CR98","doi-asserted-by":"publisher","first-page":"393","DOI":"10.1016\/j.csl.2006.06.008","volume":"21","author":"JD Williams","year":"2007","unstructured":"Williams JD, Young S (2007) Partially observable Markov decision processes for spoken dialog systems. Comput Speech Lang 21(2):393\u2013422","journal-title":"Comput Speech Lang"},{"key":"128_CR99","doi-asserted-by":"crossref","unstructured":"Xue L, Constant N, Roberts A, Kale M, Al-Rfou R, Siddhant A et\u00a0al (2021) mT5: A Massively Multilingual Pre-trained Text-to-Text Transformer. In: Toutanova K, Rumshisky A, Zettlemoyer L, Hakkani-Tur D, Beltagy I, Bethard S, et\u00a0al. (eds) Proceedings of the 2021 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies. Association for Computational Linguistics, pp 483\u2013498","DOI":"10.18653\/v1\/2021.naacl-main.41"},{"issue":"21","key":"128_CR100","doi-asserted-by":"publisher","first-page":"7640","DOI":"10.3390\/app10217640","volume":"10","author":"C Zeng","year":"2020","unstructured":"Zeng C, Li S, Li Q, Hu J, Hu J (2020) A Survey on Machine Reading Comprehension-Tasks, Evaluation Metrics and Benchmark Datasets. Applied Sciences 10(21):7640","journal-title":"Applied Sciences"},{"key":"128_CR101","unstructured":"Zhang T, Kishore V, Wu F, Weinberger KQ, Artetxe M (2019) Bertscore: Evaluating text generation with bert. In: International conference on learning representations"},{"issue":"3","key":"128_CR102","doi-asserted-by":"publisher","first-page":"275","DOI":"10.1016\/j.eng.2019.12.014","volume":"6","author":"M Zhou","year":"2020","unstructured":"Zhou M, Duan N, Liu S, Shum HY (2020) Progress in Neural NLP: Modeling, Learning, and Reasoning. Engineering 6(3):275\u2013290","journal-title":"Engineering"}],"container-title":["Journal of King Saud University Computer and Information Sciences"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s44443-025-00128-w.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s44443-025-00128-w\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s44443-025-00128-w.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,9,7]],"date-time":"2025-09-07T23:51:52Z","timestamp":1757289112000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s44443-025-00128-w"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,7,25]]},"references-count":102,"journal-issue":{"issue":"6","published-print":{"date-parts":[[2025,8]]}},"alternative-id":["128"],"URL":"https:\/\/doi.org\/10.1007\/s44443-025-00128-w","relation":{},"ISSN":["1319-1578","2213-1248"],"issn-type":[{"value":"1319-1578","type":"print"},{"value":"2213-1248","type":"electronic"}],"subject":[],"published":{"date-parts":[[2025,7,25]]},"assertion":[{"value":"21 February 2025","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"20 June 2025","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"25 July 2025","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare that they have no conflict of interest.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of Interest"}},{"value":"This article does not contain any studies with human participants or animals performed by the authors.","order":3,"name":"Ethics","group":{"name":"EthicsHeading","label":"Ethical approval"}}],"article-number":"135"}}