{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,4,22]],"date-time":"2026-04-22T08:20:24Z","timestamp":1776846024973,"version":"3.51.2"},"reference-count":58,"publisher":"IEEE","license":[{"start":{"date-parts":[[2025,9,22]],"date-time":"2025-09-22T00:00:00Z","timestamp":1758499200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2025,9,22]],"date-time":"2025-09-22T00:00:00Z","timestamp":1758499200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"funder":[{"DOI":"10.13039\/100031060","name":"EuroHPC JU","doi-asserted-by":"publisher","id":[{"id":"10.13039\/100031060","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/100016682","name":"VMWare","doi-asserted-by":"publisher","id":[{"id":"10.13039\/100016682","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2025,9,22]]},"DOI":"10.1109\/synasc69064.2025.00031","type":"proceedings-article","created":{"date-parts":[[2026,4,21]],"date-time":"2026-04-21T19:47:14Z","timestamp":1776800834000},"page":"168-175","source":"Crossref","is-referenced-by-count":0,"title":["LLMic: Building a Romanian Foundation Language Model"],"prefix":"10.1109","author":[{"given":"Vlad-Andrei","family":"B\u0103doiu","sequence":"first","affiliation":[{"name":"University Politehnica of Bucharest,Computer Science and Engineering,Bucharest,Romania"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Alexandru M.","family":"Gherghescu","sequence":"additional","affiliation":[{"name":"University Politehnica of Bucharest,Computer Science and Engineering,Bucharest,Romania"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Alexandru","family":"Agache","sequence":"additional","affiliation":[{"name":"University Politehnica of Bucharest,Computer Science and Engineering,Bucharest,Romania"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Mihai-Valentin","family":"Dumitru","sequence":"additional","affiliation":[{"name":"University Politehnica of Bucharest,Computer Science and Engineering,Bucharest,Romania"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Costin","family":"Raiciu","sequence":"additional","affiliation":[{"name":"University Politehnica of Bucharest,Computer Science and Engineering,Bucharest,Romania"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref1","volume-title":"Gpt-4 architecture, datasets, costs and more leaked","author":"Hesse","year":"2024"},{"key":"ref2","first-page":"1877","article-title":"Language models are few-shot learners","volume":"33","author":"Brown","year":"2020","journal-title":"Advances in neural information processing systems"},{"key":"ref3","article-title":"Emergent abilities of large language models","author":"Wei","journal-title":"Transactions on Machine Learning Research"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.3390\/info16080688"},{"key":"ref5","article-title":"The llama 3 herd of models","author":"Dubey","year":"2024","journal-title":"arXiv preprint"},{"key":"ref6","article-title":"Deepseek-v3 technical report","author":"Liu","year":"2024","journal-title":"arXiv preprint"},{"key":"ref7","article-title":"Qwen technical report","author":"Bai","year":"2023","journal-title":"arXiv preprint"},{"key":"ref8","article-title":"Mistral 7b","author":"Jiang","year":"2023","journal-title":"arXiv preprint"},{"key":"ref9","article-title":"Chatbot arena: An open platform for evaluating 11 ms by human preference","author":"Chiang","year":"2024","journal-title":"arXiv preprint"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2024.acl-long.840"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.52202\/079017-0970"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.52202\/079017-3697"},{"key":"ref13","first-page":"30016","article-title":"Training compute-optimal large language models","volume-title":"Proceedings of the 36th International Conference on Neural Information Processing Systems","author":"Hoffmann","year":"2022"},{"key":"ref14","article-title":"A survey of large language models for european languages","author":"Ali","year":"2024","journal-title":"arXiv preprint"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2024.acl-long.841"},{"key":"ref16","article-title":"Llm360: Towards fully transparent opensource 11 ms","author":"Liu","year":"2023","journal-title":"arXiv preprint"},{"key":"ref17","article-title":"Llama: Open and efficient foundation language models","author":"Touvron","year":"2023","journal-title":"arXiv preprint"},{"key":"ref18","article-title":"Gemma: Open models based on gemini research and technology","author":"Team","year":"2024","journal-title":"arXiv preprint"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2024.findings-emnlp.681"},{"key":"ref20","article-title":"Introducing bode: A fine-tuned large language model for portuguese prompt-based task","author":"Garcia","year":"2024","journal-title":"arXiv preprint"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2024.acl-long.309"},{"key":"ref22","article-title":"Language detection on CommonCrawl datasets","author":"Crawl","year":"2024","journal-title":"Common Crawl Foundation"},{"key":"ref23","article-title":"The refinedweb dataset for falcon llm: outperforming curated corpora with web data, and web data only","author":"Penedo","year":"2023","journal-title":"arXiv preprint"},{"key":"ref24","article-title":"Datacomp-1m: In search of the next generation of training sets for language models","author":"Li","year":"2024","journal-title":"arXiv preprint"},{"key":"ref25","first-page":"4003","article-title":"Ccnet: Extracting high quality monolingual datasets from web crawl data","volume-title":"Proceedings of the Twelfth Language Resources and Evaluation Conference","author":"Wenzek","year":"2020"},{"key":"ref26","article-title":"Fasttext. zip: Compressing text classification models","author":"Joulin","year":"2016","journal-title":"arXiv preprint"},{"key":"ref27","article-title":"Scaling language models: Methods, analysis & insights from training gopher","author":"Rae","year":"2021","journal-title":"arXiv preprint"},{"issue":"140","key":"ref28","first-page":"1","article-title":"Exploring the limits of transfer learning with a unified text-to-text transformer","volume":"21","author":"Raffel","year":"2020","journal-title":"Journal of machine learning research"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1609\/icwsm.v14i1.7347"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2020.acl-main.417"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.acl-long.243"},{"key":"ref32","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2022.bigscience-1.9"},{"key":"ref33","article-title":"Attention is all you need","author":"Vaswani","year":"2017","journal-title":"Advances in Neural Information Processing Systems"},{"key":"ref34","article-title":"Gemma: Open models based on gemini research and technology","author":"Team","year":"2024","journal-title":"arXiv preprint"},{"key":"ref35","article-title":"Llama 2: Open foundation and fine-tuned chat models","author":"Touvron","year":"2023","journal-title":"arXiv preprint"},{"key":"ref36","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2023.emnlp-main.298"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.1016\/j.neucom.2023.127063"},{"key":"ref38","doi-asserted-by":"publisher","DOI":"10.1016\/j.neunet.2017.12.012"},{"key":"ref39","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2020.emnlp-demos.6"},{"key":"ref40","doi-asserted-by":"publisher","DOI":"10.14778\/3611540.3611569"},{"key":"ref41","article-title":"Liger kernel: Efficient triton kernels for 11 m training","author":"Hsu","year":"2024","journal-title":"arXiv preprint"},{"key":"ref42","first-page":"9","article-title":"Asynchronous pipelines for processing huge corpora on medium to low resource infrastructures","volume-title":"Proceedings of the Workshop on Challenges in the Management of Large Corpora (CMLC-7) 2019. Cardiff, 22nd July 2019","author":"Su\u00e1rez"},{"issue":"140","key":"ref43","first-page":"1","article-title":"Exploring the limits of transfer learning with a unified text-to-text transformer","volume":"21","author":"Raffel","year":"2020","journal-title":"Journal of machine learning research"},{"key":"ref44","article-title":"Tinystories: How small can language models be and still speak coherent english?","author":"Eldan","year":"2023","journal-title":"arXiv preprint"},{"key":"ref45","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/w16-2301"},{"key":"ref46","doi-asserted-by":"publisher","DOI":"10.1162\/tacl_a_00343"},{"key":"ref47","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.emnlp-main.98"},{"key":"ref48","article-title":"The pile: An 800 gb dataset of diverse text for language modeling","author":"Gao","year":"2020","journal-title":"arXiv preprint"},{"key":"ref49","doi-asserted-by":"publisher","DOI":"10.52202\/068431-2306"},{"key":"ref50","article-title":"The refinedweb dataset for falcon llm: outperforming curated corpora with web data, and web data only","author":"Penedo","year":"2023","journal-title":"arXiv preprint"},{"key":"ref51","article-title":"Zyda: A 1.3 t dataset for open language modeling","author":"Tokpanov","year":"2024","journal-title":"arXiv preprint"},{"key":"ref52","article-title":"Map-neo: Highly capable and transparent bilingual large language model series","author":"Zhang","year":"2024","journal-title":"arXiv preprint"},{"key":"ref53","first-page":"3761","article-title":"The marcell legislative corpus","volume-title":"Proceedings of the Twelfth Language Resources and Evaluation Conference","author":"V\u00e1radi","year":"2020"},{"key":"ref54","article-title":"The reference corpus of the contemporary romanian language (corola)","volume-title":"Proceedings of the Eleventh International Conference on Language Resources and Evaluation (LREC 2018)","author":"Mititelu","year":"2018"},{"key":"ref55","first-page":"339","article-title":"Rombac: The romanian balanced annotated corpus","author":"Ion","year":"2012","journal-title":"LREC"},{"key":"ref56","first-page":"3291","article-title":"Resources in underrepresented languages: Building a representative romanian corpus","volume-title":"Proceedings of the Twelfth Language Resources and Evaluation Conference","author":"Midrigan-Ciochina","year":"2020"},{"key":"ref57","doi-asserted-by":"publisher","DOI":"10.3828\/mlo.v0i0.364"},{"key":"ref58","doi-asserted-by":"publisher","DOI":"10.26615\/978-954-452-072-4_102"}],"event":{"name":"2025 27th International Symposium on Symbolic and Numeric Algorithms for Scientific Computing (SYNASC)","location":"Timisoara, Romania","start":{"date-parts":[[2025,9,22]]},"end":{"date-parts":[[2025,9,25]]}},"container-title":["2025 27th International Symposium on Symbolic and Numeric Algorithms for Scientific Computing (SYNASC)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx8\/11479419\/11479422\/11479526.pdf?arnumber=11479526","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,4,22]],"date-time":"2026-04-22T07:22:10Z","timestamp":1776842530000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/11479526\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,9,22]]},"references-count":58,"URL":"https:\/\/doi.org\/10.1109\/synasc69064.2025.00031","relation":{},"subject":[],"published":{"date-parts":[[2025,9,22]]}}}