{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,6,19]],"date-time":"2025-06-19T05:06:38Z","timestamp":1750309598886,"version":"3.41.0"},"publisher-location":"New York, NY, USA","reference-count":15,"publisher":"ACM","license":[{"start":{"date-parts":[[2024,11,22]],"date-time":"2024-11-22T00:00:00Z","timestamp":1732233600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.acm.org\/publications\/policies\/copyright_policy#Background"}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2024,11,22]]},"DOI":"10.1145\/3722237.3722239","type":"proceedings-article","created":{"date-parts":[[2025,4,30]],"date-time":"2025-04-30T06:54:35Z","timestamp":1745996075000},"page":"7-10","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":0,"title":["FL-former: Chinese automatic speech recognition architecture under the federated large model"],"prefix":"10.1145","author":[{"ORCID":"https:\/\/orcid.org\/0009-0006-4131-0402","authenticated-orcid":false,"given":"Jianfeng","family":"Chen","sequence":"first","affiliation":[{"name":"Xiamen University, Xiamen, Fujian, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0009-0001-1020-6016","authenticated-orcid":false,"given":"Zhongliang","family":"Li","sequence":"additional","affiliation":[{"name":"Xiamen University, Xiamen, Fujian, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0009-0001-6059-6614","authenticated-orcid":false,"given":"Shaowei","family":"Shen","sequence":"additional","affiliation":[{"name":"Xiamen University, Xiamen, Fujian, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-7663-4235","authenticated-orcid":false,"given":"Jie","family":"Yang","sequence":"additional","affiliation":[{"name":"Xiamen University, Xiamen, Fujian, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-1878-9065","authenticated-orcid":false,"given":"Zhibin","family":"Gao","sequence":"additional","affiliation":[{"name":"Jimei University, Xiamen, Fujian, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-1620-1504","authenticated-orcid":false,"given":"Lianfen","family":"Huang","sequence":"additional","affiliation":[{"name":"Xiamen University, Xiamen, Fujian, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-5703-4285","authenticated-orcid":false,"given":"Yifeng","family":"Zhao","sequence":"additional","affiliation":[{"name":"Xiamen University, Xiamen, Fujian, China"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"320","published-online":{"date-parts":[[2025,4,29]]},"reference":[{"key":"e_1_3_3_1_1_2","first-page":"1273","volume-title":"et al","author":"McMahan B.","year":"2017","unstructured":"McMahan, B., Moore, E., Ramage, D. et al. 2017. Communication-efficient learning of deep networks from decentralized data. In\u00a0Artificial intelligence and statistics. pp. 1273-1282. PMLR. http:\/\/proceedings.mlr.press\/v54\/mcmahan17a\/mcmahan17a.pdf"},{"key":"e_1_3_3_1_2_2","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP39728"},{"key":"e_1_3_3_1_3_2","first-page":"981","volume-title":"et al","author":"Dimitriadis D.","year":"2020","unstructured":"Dimitriadis, D., Ken'ichi Kumatani, R. G. et al. 2020. A Federated Approach in Training Acoustic Models. In\u00a0Interspeech. Shanghai. pp.981-985. https:\/\/www.isca-archive.org\/interspeech_2020\/dimitriadis20_interspeech.pdf"},{"key":"e_1_3_3_1_4_2","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP43922.2022.9747161"},{"key":"e_1_3_3_1_5_2","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2018.8462682"},{"key":"e_1_3_3_1_6_2","doi-asserted-by":"publisher","unstructured":"Sriram A. Jun H. Satheesh S.et al. 2017. Cold fusion: Training seq2seq models together with language models.\u00a0arXiv preprint arXiv:1708.06426. 10.48550\/arXiv.1708.06426.","DOI":"10.48550\/arXiv.1708.06426"},{"key":"e_1_3_3_1_7_2","volume-title":"et al","author":"Brown T. B.","year":"2020","unstructured":"Brown, T. B., Mann, B., Ryder, N. et al. 2020. Language models are few-shot learners.\u00a0Advances in neural information processing systems,\u00a033, 1877-1901. https:\/\/proceedings.neurips.cc\/paper_files\/paper\/2020\/file\/1457c0d6bfcb4967418bfb8ac142f64a-Paper.pdf"},{"key":"e_1_3_3_1_8_2","doi-asserted-by":"publisher","unstructured":"Achiam J. Adler S. Agarwal S.et al. 2023. Gpt-4 technical report.\u00a0arXiv preprint arXiv:2303.08774. 10.48550\/arXiv.2303.08774.","DOI":"10.48550\/arXiv.2303.08774"},{"key":"e_1_3_3_1_9_2","doi-asserted-by":"publisher","DOI":"10.1109\/ASRU57964.2023.10389732"},{"key":"e_1_3_3_1_10_2","unstructured":"Chen C. Hu Y. Yang C. H. H.et al. 2024. Hyporadise: An open baseline for generative speech recognition with large language models.\u00a0Advances in Neural Information Processing Systems 36. https:\/\/proceedings.neurips.cc\/paper_files\/paper\/2023\/file\/6492267465a7ac507be1f9d1174e78d -Paper-Datasets_and_Benchmarks.pdf"},{"key":"e_1_3_3_1_11_2","volume-title":"Conformer: Convolution-augmented transformer for speech recognition.\u00a0arXiv preprint arXiv:2005.08100. https:\/\/arxiv.org\/abs\/2005.08100","author":"Gulati A.","year":"2020","unstructured":"Gulati, A., Qin, J., Chiu, C. C.et al. 2020. Conformer: Convolution-augmented transformer for speech recognition.\u00a0arXiv preprint arXiv:2005.08100. https:\/\/arxiv.org\/abs\/2005.08100"},{"key":"e_1_3_3_1_12_2","doi-asserted-by":"publisher","unstructured":"Cui Y. Yang Z. & Yao X. 2023. Efficient and effective text encoding for chinese llama and alpaca.\u00a0arXiv preprint arXiv:2304.08177. 10.48550\/arXiv.2304.08177.","DOI":"10.48550\/arXiv.2304.08177"},{"key":"e_1_3_3_1_13_2","first-page":"1","volume-title":"et al","author":"Bu H.","year":"2017","unstructured":"Bu, H., Du, J., Na, X. et al. 2017. AISHELL-1: An open-source Mandarin speech corpus and a speech recognition baseline.in Proc. O-COCOSDA. pp.1-5. https:\/\/arxiv.org\/pdf\/1709.05522"},{"key":"e_1_3_3_1_14_2","doi-asserted-by":"crossref","unstructured":"Yang Z. Chen Y. Luo L.et al. 2022. Open source magicdata-ramc: A rich annotated mandarin conversational (ramc) speech dataset. arXiv preprint arXiv:2203.16844. https:\/\/arxiv.org\/pdf\/2203.16844.","DOI":"10.21437\/Interspeech.2022-729"},{"key":"e_1_3_3_1_15_2","first-page":"6182","volume-title":"Wenetspeech: A 10000+ hours multi-domain mandarin corpus for speech recognition. In ICASSP.","author":"Zhang B.","year":"2022","unstructured":"Zhang, B., Lv, H., Guo, P.et al. 2022. Wenetspeech: A 10000+ hours multi-domain mandarin corpus for speech recognition. In ICASSP. pp. 6182-6186. https:\/\/arxiv.org\/pdf\/2110.03370"}],"event":{"name":"ICAIE 2024: 2024 3rd International Conference on Artificial Intelligence and Education","acronym":"ICAIE 2024","location":"Xiamen China"},"container-title":["Proceedings of the 2024 3rd International Conference on Artificial Intelligence and Education"],"original-title":[],"link":[{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3722237.3722239","content-type":"unspecified","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/dl.acm.org\/doi\/pdf\/10.1145\/3722237.3722239","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,6,19]],"date-time":"2025-06-19T01:57:05Z","timestamp":1750298225000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3722237.3722239"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,11,22]]},"references-count":15,"alternative-id":["10.1145\/3722237.3722239","10.1145\/3722237"],"URL":"https:\/\/doi.org\/10.1145\/3722237.3722239","relation":{},"subject":[],"published":{"date-parts":[[2024,11,22]]},"assertion":[{"value":"2025-04-29","order":3,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}