{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,3,26]],"date-time":"2025-03-26T06:14:23Z","timestamp":1742969663318,"version":"3.40.3"},"publisher-location":"Singapore","reference-count":22,"publisher":"Springer Nature Singapore","isbn-type":[{"type":"print","value":"9789819794362"},{"type":"electronic","value":"9789819794379"}],"license":[{"start":{"date-parts":[[2024,11,1]],"date-time":"2024-11-01T00:00:00Z","timestamp":1730419200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,11,1]],"date-time":"2024-11-01T00:00:00Z","timestamp":1730419200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2025]]},"DOI":"10.1007\/978-981-97-9437-9_30","type":"book-chapter","created":{"date-parts":[[2024,10,31]],"date-time":"2024-10-31T16:28:58Z","timestamp":1730392138000},"page":"382-393","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["Exploring the\u00a0Potential of\u00a0Prompting Methods in\u00a0Low-Resource Speech Recognition with\u00a0Whisper"],"prefix":"10.1007","author":[{"given":"Yaqi","family":"Chen","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Wenlin","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Hao","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Xukui","family":"Yang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Dan","family":"Qu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2024,11,1]]},"reference":[{"unstructured":"Zhang, Y., et al.: Google usm: scaling automatic speech recognition beyond 100 languages. ArXiv, vol. abs\/2303.01037 (2023). https:\/\/api.semanticscholar.org\/CorpusID:257280021","key":"30_CR1"},{"unstructured":"Lewis, P.M.A.: Ethnologue: languages of the world (2009). https:\/\/api.semanticscholar.org\/CorpusID:150542535","key":"30_CR2"},{"unstructured":"Baevski, A., Zhou, Y., \u00a0Mohamed, A., Auli, M.: wav2vec 2.0: a framework for self-supervised learning of speech representations. In: Larochelle, H., \u00a0Ranzato, M., \u00a0Hadsell, R., Balcan, M., \u00a0Lin, H. (eds.) Advances in Neural Information Processing Systems 33: Annual Conference on Neural Information Processing Systems 2020, NeurIPS 2020, December 6-12, 2020, virtual (2020). https:\/\/proceedings.neurips.cc\/paper\/2020\/hash\/92d1e1eb1cd6f9fba3227870bb6d7f07-Abstract.html","key":"30_CR3"},{"unstructured":"Radford, A., Kim, J.W., \u00a0Xu, T., \u00a0Brockman, G., \u00a0McLeavey, C., Sutskever, I.: Robust speech recognition via large-scale weak supervision. In: Krause, A., et al. (eds.) International Conference on Machine Learning, ICML 2023, 23-29 July 2023, Honolulu, Hawaii, USA, ser. Proceedings of Machine Learning Research, vol. 202.\u00a0PMLR, 2023, pp. 28\u00a0492\u201328\u00a0518 (2023). https:\/\/proceedings.mlr.press\/v202\/radford23a.html","key":"30_CR4"},{"unstructured":"Pratap, V., et al.: Scaling speech technology to 1, 000+ languages. ArXiv, vol. abs\/2305.13516 (2023). https:\/\/api.semanticscholar.org\/CorpusID:258841617","key":"30_CR5"},{"unstructured":"Houlsby, N., et al.: Parameter-efficient transfer learning for NLP. In: Chaudhuri, K., Salakhutdinov, R. (eds.) Proceedings of the 36th International Conference on Machine Learning, ICML 2019, 9-15 June 2019, Long Beach, California, USA, ser. Proceedings of Machine Learning Research, vol.\u00a097.\u00a0PMLR, 2019, pp. 2790\u20132799 (2019). http:\/\/proceedings.mlr.press\/v97\/houlsby19a.html","key":"30_CR6"},{"doi-asserted-by":"crossref","unstructured":"Thomas, B., \u00a0Kessler, S., \u00a0Karout, S.: Efficient adapter transfer of self-supervised speech models for automatic speech recognition. In: ICASSP 2022 - 2022 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), pp. 7102\u20137106 (2022). https:\/\/api.semanticscholar.org\/CorpusID:246634891","key":"30_CR7","DOI":"10.1109\/ICASSP43922.2022.9746223"},{"unstructured":"Hu, E.J., et al.: Lora: low-rank adaptation of large language models. In: The Tenth International Conference on Learning Representations, ICLR 2022, Virtual Event, April 25-29, 2022.\u00a0\u00a0\u00a0OpenReview.net (2022). https:\/\/openreview.net\/forum?id=nZeVKeeFYf9","key":"30_CR8"},{"doi-asserted-by":"crossref","unstructured":"Lester, B., \u00a0Al-Rfou, R., \u00a0Constant, N.: The power of scale for parameter-efficient prompt tuning. In: Conference on Empirical Methods in Natural Language Processing (2021). https:\/\/api.semanticscholar.org\/CorpusID:233296808","key":"30_CR9","DOI":"10.18653\/v1\/2021.emnlp-main.243"},{"doi-asserted-by":"crossref","unstructured":"Liu, P., \u00a0Yuan, W., \u00a0Fu, J., \u00a0Jiang, Z., \u00a0Hayashi, H., \u00a0Neubig, G.: Pre-train, prompt, and predict: a systematic survey of prompting methods in natural language processing. ACM Computing Surveys, vol.\u00a055, pp. 1 \u2013 35 (2021). https:\/\/api.semanticscholar.org\/CorpusID:236493269","key":"30_CR10","DOI":"10.1145\/3560815"},{"doi-asserted-by":"crossref","unstructured":"Li, X.L., \u00a0Liang, P.: Prefix-tuning: Optimizing continuous prompts for generation. In: Proceedings of the 59th Annual Meeting of the Association for Computational Linguistics and the 11th International Joint Conference on Natural Language Processing (Volume 1: Long Papers), vol. abs\/2101.00190 (2021). https:\/\/api.semanticscholar.org\/CorpusID:230433941","key":"30_CR11","DOI":"10.18653\/v1\/2021.acl-long.353"},{"doi-asserted-by":"crossref","unstructured":"Liu, X., \u00a0Ji, K., \u00a0Fu, Y., \u00a0Du, Z., \u00a0Yang, Z., \u00a0Tang, J.: P-tuning v2: prompt tuning can be comparable to fine-tuning universally across scales and tasks. ArXiv, vol. abs\/2110.07602 (2021). https:\/\/api.semanticscholar.org\/CorpusID:238857040","key":"30_CR12","DOI":"10.18653\/v1\/2022.acl-short.8"},{"doi-asserted-by":"crossref","unstructured":"Chang, K.-W., Tseng, W.-C., Li, S.-W., \u00a0yi\u00a0Lee, H.: An exploration of prompt tuning on generative spoken language model for speech processing tasks. In: Interspeech (2022). https:\/\/api.semanticscholar.org\/CorpusID:263874398","key":"30_CR13","DOI":"10.21437\/Interspeech.2022-10610"},{"doi-asserted-by":"crossref","unstructured":"Chang, K.-W., et al.: Prompting and adapter tuning for self-supervised encoder-decoder speech model. In: 2023 IEEE Automatic Speech Recognition and Understanding Workshop (ASRU), pp. 1\u20138 (2023). https:\/\/api.semanticscholar.org\/CorpusID:263620468","key":"30_CR14","DOI":"10.1109\/ASRU57964.2023.10389731"},{"doi-asserted-by":"crossref","unstructured":"Liao, F.T., Chan, Y.-C., Chen, Y.-C., Hsu, C.-J., \u00a0shan Shiu, D.: Zero-shot domain-sensitive speech recognition with prompt-conditioning fine-tuning. In: 2023 IEEE Automatic Speech Recognition and Understanding Workshop (ASRU), pp. 1\u20138, 2023. https:\/\/api.semanticscholar.org\/CorpusID:259991073","key":"30_CR15","DOI":"10.1109\/ASRU57964.2023.10389617"},{"doi-asserted-by":"crossref","unstructured":"Peng, P., \u00a0Yan, B., \u00a0Watanabe, S., Harwath, D.F.: Prompting the hidden talent of web-scale speech models for zero-shot task generalization. ArXiv, vol. abs\/2305.11095 (2023).https:\/\/api.semanticscholar.org\/CorpusID:258762742","key":"30_CR16","DOI":"10.21437\/Interspeech.2023-2032"},{"unstructured":"Ma, R., Qian, M., Gales, M.J.F., \u00a0Knill, K.: Adapting an asr foundation model for spoken language assessment. ArXiv, vol. abs\/2307.09378 (2023). https:\/\/api.semanticscholar.org\/CorpusID:259951359","key":"30_CR17"},{"unstructured":"Ma, H., \u00a0Peng, Z., \u00a0Shao, M., \u00a0Li, J., \u00a0Liu, J.: Extending whisper with prompt tuning to target-speaker asr. ArXiv, vol. abs\/2312.08079 (2023). https:\/\/api.semanticscholar.org\/CorpusID:266191685","key":"30_CR18"},{"doi-asserted-by":"crossref","unstructured":"Liu, X., et al.: P-tuning: prompt tuning can be comparable to fine-tuning across scales and tasks. In: Annual Meeting of the Association for Computational Linguistics (2022). https:\/\/api.semanticscholar.org\/CorpusID:248780177","key":"30_CR19","DOI":"10.18653\/v1\/2022.acl-short.8"},{"doi-asserted-by":"crossref","unstructured":"Razdaibiedina, A., et al.: Residual prompt tuning: Improving prompt tuning with residual reparameterization. In: Annual Meeting of the Association for Computational Linguistics (2023). https:\/\/api.semanticscholar.org\/CorpusID:258557553","key":"30_CR20","DOI":"10.18653\/v1\/2023.findings-acl.421"},{"unstructured":"Ardila, R., et al.: Common voice: a massively-multilingual speech corpus.ArXiv, vol. abs\/1912.06670 (2019). https:\/\/api.semanticscholar.org\/CorpusID:209376338","key":"30_CR21"},{"doi-asserted-by":"crossref","unstructured":"Conneau, A., et al.: Fleurs: few-shot learning evaluation of universal representations of speech. In: 2022 IEEE Spoken Language Technology Workshop (SLT), pp. 798\u2013805, 2022. https:\/\/api.semanticscholar.org\/CorpusID:249062909","key":"30_CR22","DOI":"10.1109\/SLT54892.2023.10023141"}],"container-title":["Lecture Notes in Computer Science","Natural Language Processing and Chinese Computing"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-981-97-9437-9_30","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,10,31]],"date-time":"2024-10-31T16:33:07Z","timestamp":1730392387000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-981-97-9437-9_30"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,11,1]]},"ISBN":["9789819794362","9789819794379"],"references-count":22,"URL":"https:\/\/doi.org\/10.1007\/978-981-97-9437-9_30","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"type":"print","value":"0302-9743"},{"type":"electronic","value":"1611-3349"}],"subject":[],"published":{"date-parts":[[2024,11,1]]},"assertion":[{"value":"1 November 2024","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"NLPCC","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"CCF International Conference on Natural Language Processing and Chinese Computing","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Hangzhou","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"China","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2024","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2 November 2024","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"4 November 2024","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"13","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"nlpcc2024","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"http:\/\/tcci.ccf.org.cn\/conference\/2024\/index.php","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}