{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,8,4]],"date-time":"2026-08-04T10:07:52Z","timestamp":1785838072586,"version":"3.56.0"},"reference-count":175,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","license":[{"start":{"date-parts":[[2024,1,1]],"date-time":"2024-01-01T00:00:00Z","timestamp":1704067200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by-nc-nd\/4.0\/"},{"start":{"date-parts":[[2024,1,1]],"date-time":"2024-01-01T00:00:00Z","timestamp":1704067200000},"content-version":"am","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by-nc-nd\/4.0\/"}],"funder":[{"name":"Northwestern Mutual Data Science Institute and NSF","award":["1950826"],"award-info":[{"award-number":["1950826"]}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Access"],"published-print":{"date-parts":[[2024]]},"DOI":"10.1109\/access.2024.3349952","type":"journal-article","created":{"date-parts":[[2024,1,4]],"date-time":"2024-01-04T19:58:32Z","timestamp":1704398312000},"page":"6518-6531","source":"Crossref","is-referenced-by-count":144,"title":["A Survey of Text Classification With Transformers: How Wide? How Large? How Long? How Accurate? How Expensive? How Safe?"],"prefix":"10.1109","volume":"12","author":[{"ORCID":"https:\/\/orcid.org\/0000-0001-5153-0376","authenticated-orcid":false,"given":"John","family":"Fields","sequence":"first","affiliation":[{"name":"Business Analytics, Concordia University Wisconsin-Ann Arbor, Mequon, WI, USA"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0005-8869-9083","authenticated-orcid":false,"given":"Kevin","family":"Chovanec","sequence":"additional","affiliation":[{"name":"Department of Computer Science, Marquette University, Milwaukee, WI, USA"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Praveen","family":"Madiraju","sequence":"additional","affiliation":[{"name":"Department of Computer Science, Marquette University, Milwaukee, WI, USA"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1145\/3439726"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1145\/3605943"},{"key":"ref3","first-page":"5999","article-title":"Attention is all you need","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","volume":"30","author":"Vaswani"},{"key":"ref4","volume-title":"Improving Language Understanding by Generative Pre-Training","author":"Radford","year":"2023"},{"key":"ref5","article-title":"BERT: Pre-training of deep bidirectional transformers for language understanding","author":"Devlin","year":"2018","journal-title":"arXiv:1810.04805"},{"key":"ref6","article-title":"Guidelines for performing systematic literature reviews in software engineering","volume":"5","author":"Keele","year":"2007"},{"key":"ref7","volume-title":"Connected Papers","year":"2023"},{"key":"ref8","article-title":"Aristotle\u2019s categories","volume-title":"The Stanford Encyclopedia Philosophy","author":"Studtmann","year":"2021"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1145\/321075.321084"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.7551\/mitpress\/11043.003.0009"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2020.emnlp-demos.6"},{"key":"ref12","article-title":"A survey on text classification: From shallow to deep learning","author":"Li","year":"2020","journal-title":"arXiv:2008.00364"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.3390\/info13020083"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.naacl-main.324"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1016\/j.metrad.2023.100017"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1109\/AITB48515.2019.8947435"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1016\/j.eswa.2018.10.003"},{"key":"ref18","article-title":"Leveraging affective bidirectional transformers for offensive language detection","author":"Elmadany","year":"2020","journal-title":"arXiv:2006.01266"},{"key":"ref19","article-title":"Are pretrained transformers robust in intent classification? A missing ingredient in evaluation of out-of-scope intent detection","author":"Zhang","year":"2021","journal-title":"arXiv:2106.04564"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2022.acl-long.551"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.3390\/app9194062"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.naacl-industry.16"},{"key":"ref23","article-title":"How would stance detection techniques evolve after the launch of ChatGPT?","author":"Zhang","year":"2022","journal-title":"arXiv:2212.14548"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1016\/j.patrec.2023.02.016"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/D19-1383"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1145\/3394486.3403368"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.3390\/info10040150"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1007\/s11431-020-1647-3"},{"key":"ref29","article-title":"RoBERTa: A robustly optimized BERT pretraining approach","author":"Liu","year":"2019","journal-title":"arXiv:1907.11692"},{"key":"ref30","first-page":"5754","article-title":"XLNet: Generalized autoregressive pretraining for language understanding","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","volume":"32","author":"Yang"},{"key":"ref31","first-page":"1877","article-title":"Language models are few-shot learners","volume-title":"Proc. Adv. Neur. Inf. Process. Sys.","volume":"33","author":"Brown"},{"key":"ref32","volume-title":"Introducing LLaMA: A Foundational, 65-Billion-Parameter Language Model","year":"2023"},{"key":"ref33","volume-title":"An Important Next Step on Our AI Journey","author":"Pichai","year":"2023"},{"key":"ref34","article-title":"GPT-4 technical report","volume-title":"arXiv:2303.08774","year":"2023"},{"key":"ref35","volume-title":"Bloomberg\u2019s 50-Billion Parameter Large Language Model, Purpose-Built From Scratch for Finance","year":"2023"},{"key":"ref36","volume-title":"Free Dolly: Introducing the World\u2019s First Truly Open Instruction-Tuned LLM","year":"2023"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.1787\/13d38f92-en"},{"key":"ref38","volume-title":"Amazon Titan","year":"2023"},{"key":"ref39","doi-asserted-by":"publisher","DOI":"10.1002\/pra2.927"},{"key":"ref40","volume-title":"Llama 2","year":"2023"},{"key":"ref41","doi-asserted-by":"publisher","DOI":"10.1016\/j.neucom.2022.10.071"},{"key":"ref42","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-21348-0_24"},{"key":"ref43","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2018.2798607"},{"key":"ref44","article-title":"Elon Musk creates new artificial intelligence company X.AI","author":"Jin","year":"2023","journal-title":"Wall St. J."},{"key":"ref45","volume-title":"Google DeepMind: Bringing Together Two World-Class AI Teams","author":"Pichai","year":"2023"},{"key":"ref46","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2022.emnlp-main.534"},{"key":"ref47","article-title":"SEMI-FND: Stacked ensemble based multimodal inference for faster fake news detection","author":"Singh","year":"2022","journal-title":"arXiv:2205.08159"},{"key":"ref48","volume-title":"ChatGPT","year":"2023"},{"key":"ref49","volume-title":"Try Bard, an AI Experiment by Google","year":"2023"},{"key":"ref50","doi-asserted-by":"publisher","DOI":"10.1145\/3543848"},{"key":"ref51","first-page":"197","article-title":"Multimodal machine learning for automated ICD coding","volume-title":"Proc. 4th Mach. Learn. Healthcare Conf.","volume":"106","author":"Xu"},{"key":"ref52","doi-asserted-by":"publisher","DOI":"10.5121\/csit.2023.130803"},{"key":"ref53","doi-asserted-by":"publisher","DOI":"10.1007\/s11633-022-1410-8"},{"key":"ref54","doi-asserted-by":"publisher","DOI":"10.1162\/tacl_a_00544"},{"key":"ref55","doi-asserted-by":"publisher","DOI":"10.1109\/TNNLS.2022.3229161"},{"key":"ref56","first-page":"18932","article-title":"Revisiting deep learning models for tabular data","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","volume":"34","author":"Gorishniy"},{"key":"ref57","doi-asserted-by":"publisher","DOI":"10.1016\/j.inffus.2021.11.011"},{"key":"ref58","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.maiworkshop-1.10"},{"key":"ref59","article-title":"Scaling laws for neural language models","author":"Kaplan","year":"2020","journal-title":"arXiv:2001.08361"},{"key":"ref60","doi-asserted-by":"publisher","DOI":"10.1145\/3065386"},{"key":"ref61","doi-asserted-by":"publisher","DOI":"10.1007\/978-1-4842-8844-3"},{"key":"ref62","doi-asserted-by":"publisher","DOI":"10.1007\/978-1-4842-4470-8_7"},{"key":"ref63","volume-title":"ChatGPT reaches 100 million users two months after launch","author":"Milmo","year":"2023"},{"key":"ref64","article-title":"Scaling data-constrained language models","author":"Muennighoff","year":"2023","journal-title":"arXiv:2305.16264"},{"key":"ref65","article-title":"Pythia: A suite for analyzing large language models across training and scaling","author":"Biderman","year":"2023","journal-title":"arXiv:2304.01373"},{"key":"ref66","doi-asserted-by":"publisher","DOI":"10.1145\/3586074"},{"key":"ref67","volume-title":"OpenAI\u2019s GPT-3 Language Model: A Technical Overview","author":"Li","year":"2020"},{"key":"ref68","article-title":"Harnessing the power of LLMs in practice: A survey on ChatGPT and beyond","author":"Yang","year":"2023","journal-title":"arXiv:2304.13712"},{"key":"ref69","article-title":"Big bird: Transformers for longer sequences","author":"Zaheer","year":"2020","journal-title":"arXiv:2007.14062"},{"key":"ref70","article-title":"LongFormer: The long-document transformer","author":"Beltagy","year":"2020","journal-title":"arXiv:2004.05150"},{"key":"ref71","article-title":"DeID-GPT: Zero-shot medical text de-identification by GPT-4","author":"Liu","year":"2023","journal-title":"arXiv:2303.11032"},{"key":"ref72","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/P19-1499"},{"key":"ref73","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2022.findings-emnlp.534"},{"key":"ref74","doi-asserted-by":"publisher","DOI":"10.2139\/ssrn.4389233"},{"key":"ref75","volume-title":"Multimodal-Toolkit: Multimodal Model for Text and Tabular Data With Huggingface Transformers as Building Block for Text Data","year":"2023"},{"key":"ref76","volume-title":"Papers With Code\u2014The Latest in Machine Learning","year":"2023"},{"key":"ref77","doi-asserted-by":"publisher","DOI":"10.1038\/s42256-021-00339-6"},{"key":"ref78","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/P19-1355"},{"key":"ref79","article-title":"AMMUS: A survey of transformer-based pretrained models in natural language processing","author":"Subramanyam Kalyan","year":"2021","journal-title":"arXiv:2108.05542"},{"key":"ref80","article-title":"Scaling language models: Methods, analysis & insights from training gopher","author":"Rae","year":"2021","journal-title":"arXiv:2112.11446"},{"key":"ref81","article-title":"Efficient large scale language modeling with mixtures of experts","author":"Artetxe","year":"2021","journal-title":"arXiv:2112.10684"},{"key":"ref82","article-title":"Training compute-optimal large language models","author":"Hoffmann","year":"2022","journal-title":"arXiv:2203.15556"},{"key":"ref83","first-page":"2206","article-title":"Improving language models by retrieving from trillions of tokens","volume-title":"Proc. 39th Int. Conf. Mach. Learn.","volume":"162","author":"Borgeaud"},{"key":"ref84","first-page":"2633","article-title":"Extracting training data from large language models","volume-title":"Proc. 30th USENIX Secur. Symp.","author":"Carlini"},{"key":"ref85","article-title":"Quantifying memorization across neural language models","author":"Carlini","year":"2022","journal-title":"arXiv:2202.07646"},{"key":"ref86","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.emnlp-main.98"},{"key":"ref87","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2022.acl-short.18"},{"key":"ref88","first-page":"10697","article-title":"Deduplicating training data mitigates privacy risks in language models","volume-title":"Proc. 39th Int. Conf. Mach. Learn.","volume":"162","author":"Kandpal"},{"key":"ref89","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2022.findings-emnlp.148"},{"key":"ref90","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2022.emnlp-main.119"},{"key":"ref91","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.naacl-main.73"},{"key":"ref92","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2022.findings-emnlp.484"},{"key":"ref93","article-title":"Large language models can be strong differentially private learners","author":"Li","year":"2021","journal-title":"arXiv:2110.05679"},{"key":"ref94","article-title":"Differentially private fine-tuning of language models","author":"Yu","year":"2021","journal-title":"arXiv:2110.06500"},{"key":"ref95","article-title":"Selective differential privacy for language modeling","author":"Shi","year":"2021","journal-title":"arXiv:2108.12944"},{"key":"ref96","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.privatenlp-1.3"},{"key":"ref97","doi-asserted-by":"publisher","DOI":"10.1145\/3531146.3534642"},{"key":"ref98","article-title":"On transferability of bias mitigation effects in language model fine-tuning","author":"Jin","year":"2020","journal-title":"arXiv:2010.12864"},{"key":"ref99","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-62077-6_14"},{"key":"ref100","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.naacl-main.189"},{"key":"ref101","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.gebnlp-1.8"},{"key":"ref102","doi-asserted-by":"publisher","DOI":"10.1007\/s12559-021-09881-2"},{"key":"ref103","doi-asserted-by":"publisher","DOI":"10.1371\/journal.pone.0237861"},{"key":"ref104","doi-asserted-by":"publisher","DOI":"10.1145\/3465416.3483299"},{"key":"ref105","first-page":"1275","article-title":"Bigger data or fairer data? Augmenting BERT via active sampling for educational text classification","volume-title":"Proc. 29th Int. Conf. Comput. Linguistics","author":"Sha"},{"key":"ref106","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/W19-3810"},{"key":"ref107","doi-asserted-by":"publisher","DOI":"10.1145\/3442381.3449904"},{"key":"ref108","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.findings-acl.294"},{"key":"ref109","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.eacl-main.190"},{"key":"ref110","article-title":"Interpretable bias mitigation for textual data: Reducing gender bias in patient notes while maintaining classification performance","author":"Minot","year":"2021","journal-title":"arXiv:2103.05841"},{"key":"ref111","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.nuse-1.5"},{"key":"ref112","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.acl-long.416"},{"key":"ref113","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2020.emnlp-main.473"},{"key":"ref114","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2020.findings-emnlp.301"},{"key":"ref115","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2020.findings-emnlp.311"},{"key":"ref116","doi-asserted-by":"publisher","DOI":"10.1145\/3571884.3604316"},{"key":"ref117","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2023.emnlp-main.453"},{"key":"ref118","doi-asserted-by":"publisher","DOI":"10.1145\/3458723"},{"key":"ref119","article-title":"ExBERT: A visual analysis tool to explore learned representations in transformers models","author":"Hoover","year":"2019","journal-title":"arXiv:1910.05276"},{"key":"ref120","doi-asserted-by":"publisher","DOI":"10.1145\/3366424.3383542"},{"key":"ref121","volume-title":"Introducing Transformers Interpret\u2014Explainable AI for Transformers","author":"Pierse","year":"2021"},{"key":"ref122","doi-asserted-by":"publisher","DOI":"10.1038\/s41598-021-03100-6"},{"key":"ref123","doi-asserted-by":"publisher","DOI":"10.1016\/j.knosys.2021.107530"},{"key":"ref124","doi-asserted-by":"publisher","DOI":"10.1111\/exsy.13403"},{"key":"ref125","volume-title":"A BERT-Based Explainable System for COVID-19 Misinformation Identification","author":"Moe","year":"2023"},{"key":"ref126","doi-asserted-by":"publisher","DOI":"10.3390\/diagnostics13071251"},{"key":"ref127","doi-asserted-by":"publisher","DOI":"10.1109\/CSDE56538.2022.10089294"},{"key":"ref128","article-title":"InstructABSA: Instruction learning for aspect based sentiment analysis","author":"Scaria","year":"2023","journal-title":"arXiv:2302.08624"},{"key":"ref129","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2023.findings-acl.558"},{"key":"ref130","article-title":"Utilizing BERT for aspect-based sentiment analysis via constructing auxiliary sentence","author":"Sun","year":"2019","journal-title":"arXiv:1903.09588"},{"key":"ref131","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v34i05.6376"},{"key":"ref132","first-page":"1410","article-title":"Rep the set: Neural networks for learning set representations","volume-title":"Proc. 23rd Int. Conf. Artif. Intell. Statist.","volume":"108","author":"Skianis"},{"key":"ref133","doi-asserted-by":"publisher","DOI":"10.1145\/3206098.3206111"},{"key":"ref134","first-page":"748","article-title":"BilBOWA: Fast bilingual distributed representations without word alignments","volume-title":"Proc. 32nd Int. Conf. Int. Conf. Mach. Learn.","volume":"37","author":"Gouws"},{"key":"ref135","article-title":"DocBERT: BERT for document classification","author":"Adhikari","year":"2019","journal-title":"arXiv:1904.08398"},{"key":"ref136","first-page":"1449","article-title":"VICTOR: A dataset for Brazilian legal documents classification","volume-title":"Proc. 12th Lang. Resour. Eval. Conf.","author":"de Araujo"},{"key":"ref137","doi-asserted-by":"publisher","DOI":"10.1007\/s11063-021-10444-7"},{"key":"ref138","article-title":"PatentBERT: Patent classification with fine-tuning a pre-trained BERT model","author":"Lee","year":"2019","journal-title":"arXiv:1906.02124"},{"key":"ref139","article-title":"Dataset of propaganda techniques of the state-sponsored information operation of the people\u2019s republic of China","author":"Chang","year":"2021","journal-title":"arXiv:2106.07544"},{"key":"ref140","doi-asserted-by":"publisher","DOI":"10.5220\/0008940304940505"},{"key":"ref141","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-68763-2_48"},{"key":"ref142","article-title":"Automated concatenation of embeddings for structured prediction","author":"Wang","year":"2020","journal-title":"arXiv:2010.05006"},{"key":"ref143","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2022.findings-acl.67"},{"key":"ref144","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2022.naacl-main.140"},{"key":"ref145","article-title":"Enhancing label consistency on document-level named entity recognition","author":"Jeong","year":"2022","journal-title":"arXiv:2210.12949"},{"key":"ref146","article-title":"A frustratingly easy approach for entity and relation extraction","author":"Zhong","year":"2020","journal-title":"arXiv:2010.12812"},{"key":"ref147","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2020.emnlp-main.381"},{"key":"ref148","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v34i05.6428"},{"key":"ref149","article-title":"PaLM: Scaling language modeling with pathways","author":"Chowdhery","year":"2022","journal-title":"arXiv:2204.02311"},{"key":"ref150","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.starsem-1.7"},{"key":"ref151","article-title":"VNHSGE: Vietnamese high school graduation examination dataset for large language models","author":"Dao","year":"2023","journal-title":"arXiv:2305.12199"},{"key":"ref152","article-title":"Finetuned language models are zero-shot learners","author":"Wei","year":"2021","journal-title":"arXiv:2109.01652"},{"key":"ref153","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-47240-4_19"},{"key":"ref154","article-title":"No parameter left behind: How distillation and model size affect zero-shot retrieval","author":"Moraes Rosa","year":"2022","journal-title":"arXiv:2206.02873"},{"key":"ref155","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2022.findings-emnlp.183"},{"key":"ref156","article-title":"Large language models can self-improve","author":"Huang","year":"2022","journal-title":"arXiv:2210.11610"},{"key":"ref157","article-title":"PaLM 2 technical report","volume-title":"arXiv:2305.10403","author":"Anil","year":"2023"},{"key":"ref158","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2022.acl-long.551"},{"key":"ref159","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.acl-long.240"},{"key":"ref160","doi-asserted-by":"publisher","DOI":"10.1109\/TASLP.2023.3284516"},{"key":"ref161","article-title":"Learning associative inference using fast weight memory","author":"Schlag","year":"2020","journal-title":"arXiv:2011.07831"},{"key":"ref162","article-title":"MuLD: The multitask long document benchmark","author":"Hudson","year":"2022","journal-title":"arXiv:2202.07362"},{"key":"ref163","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/D19-1371"},{"key":"ref164","article-title":"AraBERT: Transformer-based model for Arabic language understanding","author":"Antoun","year":"2020","journal-title":"arXiv:2003.00104"},{"key":"ref165","doi-asserted-by":"publisher","DOI":"10.1109\/TASLP.2021.3124365"},{"key":"ref166","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/W19-4621"},{"key":"ref167","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2023.findings-eacl.50"},{"key":"ref168","first-page":"6256","article-title":"Unsupervised data augmentation for consistency training","volume-title":"Proc. NIPS","volume":"33","author":"Xie"},{"key":"ref169","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/S17-2094"},{"key":"ref170","article-title":"FinBERT: Financial sentiment analysis with pre-trained language models","author":"Araci","year":"2019","journal-title":"arXiv:1908.10063"},{"key":"ref171","doi-asserted-by":"publisher","DOI":"10.1145\/3394486.3403242"},{"key":"ref172","article-title":"Bridging the domain gap in cross-lingual document classification","author":"Lai","year":"2019","journal-title":"arXiv:1909.07009"},{"key":"ref173","article-title":"Leveraging monolingual data for crosslingual compositional word representations","author":"Soyer","year":"2014","journal-title":"arXiv:1412.6334"},{"key":"ref174","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/D19-1572"},{"key":"ref175","doi-asserted-by":"publisher","DOI":"10.1609\/icwsm.v15i1.18082"}],"container-title":["IEEE Access"],"original-title":[],"link":[{"URL":"https:\/\/ieeexplore.ieee.org\/ielam\/6287639\/10380310\/10380590-aam.pdf","content-type":"application\/pdf","content-version":"am","intended-application":"syndication"},{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/6287639\/10380310\/10380590.pdf?arnumber=10380590","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,1,22]],"date-time":"2024-01-22T20:53:23Z","timestamp":1705956803000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/10380590\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024]]},"references-count":175,"URL":"https:\/\/doi.org\/10.1109\/access.2024.3349952","relation":{},"ISSN":["2169-3536"],"issn-type":[{"value":"2169-3536","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024]]}}}