{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,11,7]],"date-time":"2025-11-07T09:51:33Z","timestamp":1762509093703,"version":"3.37.3"},"reference-count":33,"publisher":"Springer Science and Business Media LLC","issue":"31","license":[{"start":{"date-parts":[[2024,2,20]],"date-time":"2024-02-20T00:00:00Z","timestamp":1708387200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,2,20]],"date-time":"2024-02-20T00:00:00Z","timestamp":1708387200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimed Tools Appl"],"DOI":"10.1007\/s11042-024-18383-w","type":"journal-article","created":{"date-parts":[[2024,2,20]],"date-time":"2024-02-20T07:03:26Z","timestamp":1708412606000},"page":"75731-75755","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":3,"title":["Recognition of score words in freestyle kayaking using improved DTW matching"],"prefix":"10.1007","volume":"83","author":[{"given":"Qiyuan","family":"Zhang","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-7490-6695","authenticated-orcid":false,"given":"Xiaochen","family":"Yuan","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Chan-Tong","family":"Lam","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2024,2,20]]},"reference":[{"issue":"1","key":"18383_CR1","first-page":"524","volume":"6","author":"M Yadav","year":"2018","unstructured":"Yadav M, Alam MA (2018) Dynamic time warping (DTW) algorithm in speech: A review. Intl J Res Electron Comput Eng 6(1):524\u2013528","journal-title":"Intl J Res Electron Comput Eng"},{"issue":"2","key":"18383_CR2","doi-asserted-by":"publisher","first-page":"297","DOI":"10.1002\/j.1538-7305.1975.tb02840.x","volume":"54","author":"LR Rabiner","year":"1975","unstructured":"Rabiner LR, Sambur MR (1975) An algorithm for determining the endpoints of isolated utterances. Bell Syst Tech J 54(2):297\u2013315","journal-title":"Bell Syst Tech J"},{"issue":"3","key":"18383_CR3","first-page":"1","volume":"242","author":"J Lu","year":"2020","unstructured":"Lu J, Han X (2020) Novel speech endpoint detection algorithm for voice detectors in interaction of intelligent terminals. Sens Transducers 242(3):1\u20135","journal-title":"Sens Transducers"},{"issue":"1","key":"18383_CR4","first-page":"1","volume":"40","author":"J Yang","year":"2020","unstructured":"Yang J, Li Z, Su P (2020) Review of speech segmentation and endpoint detection. J Comput Appl 40(1):1\u20137","journal-title":"J Comput Appl"},{"issue":"12","key":"18383_CR5","doi-asserted-by":"publisher","first-page":"1269","DOI":"10.1007\/s00371-012-0768-y","volume":"29","author":"M Rashid","year":"2013","unstructured":"Rashid M, Abu-Bakar S, Mokji M (2013) Human emotion recognition from videos using spatio-temporal and audio features. Vis Comput 29(12):1269\u20131275","journal-title":"Vis Comput"},{"key":"18383_CR6","unstructured":"Zheng Y, Gao S (2020) Speech endpoint detection based on fractal dimension with adaptive threshold. Journal of Northeastern University (Natural Science). 41(1): p. 7"},{"key":"18383_CR7","doi-asserted-by":"crossref","unstructured":"Lu L, Li J, Gong Y (2022) Endpoint Detection for Streaming End-to-End Multi-Talker ASR. in ICASSP 2022\u20132022 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)","DOI":"10.1109\/ICASSP43922.2022.9747323"},{"issue":"1","key":"18383_CR8","doi-asserted-by":"publisher","first-page":"1261","DOI":"10.1007\/s11042-019-08222-8","volume":"79","author":"F Daneshfar","year":"2020","unstructured":"Daneshfar F, Kabudian SJ (2020) Speech emotion recognition using discriminative dimension reduction by employing a modified quantum-behaved particle swarm optimization algorithm. Multimed Tools Appl 79(1):1261\u20131289","journal-title":"Multimed Tools Appl"},{"issue":"1","key":"18383_CR9","doi-asserted-by":"publisher","first-page":"21","DOI":"10.1007\/s11042-012-1318-3","volume":"72","author":"M Federico","year":"2014","unstructured":"Federico M, Furini M (2014) An automatic caption alignment mechanism for off-the-shelf speech recognition technologies. Multimed Tools Appl 72(1):21\u201340","journal-title":"Multimed Tools Appl"},{"issue":"5","key":"18383_CR10","doi-asserted-by":"publisher","first-page":"6785","DOI":"10.1007\/s11042-016-3354-x","volume":"76","author":"Z Huang","year":"2017","unstructured":"Huang Z et al (2017) Unsupervised domain adaptation for speech emotion recognition using PCANet. Multimed Tools Appl 76(5):6785\u20136799","journal-title":"Multimed Tools Appl"},{"key":"18383_CR11","doi-asserted-by":"crossref","unstructured":"Naithani K, Thakkar V, Semwal A (2018) English Language Speech Recognition Using MFCC and HMM. in 2018 International Conference on Research in Intelligent and Computing in Engineering (RICE)","DOI":"10.1109\/RICE.2018.8509046"},{"issue":"5","key":"18383_CR12","doi-asserted-by":"publisher","first-page":"5571","DOI":"10.1007\/s11042-017-5292-7","volume":"78","author":"AM Badshah","year":"2019","unstructured":"Badshah AM et al (2019) Deep features-based speech emotion recognition for smart affective services. Multimed Tools Appl 78(5):5571\u20135589","journal-title":"Multimed Tools Appl"},{"issue":"1","key":"18383_CR13","doi-asserted-by":"publisher","first-page":"466","DOI":"10.1007\/s00034-020-01486-8","volume":"40","author":"M Fahad","year":"2021","unstructured":"Fahad M et al (2021) DNN-HMM-based speaker-adaptive emotion recognition using MFCC and epoch-based features. Circ Syst Signal Process 40(1):466\u2013489","journal-title":"Circ Syst Signal Process"},{"issue":"6","key":"18383_CR14","doi-asserted-by":"publisher","first-page":"2403","DOI":"10.3390\/su12062403","volume":"12","author":"A Ismail","year":"2020","unstructured":"Ismail A, Abdlerazek S, El-Henawy IM (2020) Development of smart healthcare system based on speech recognition using support vector machine and dynamic time warping. Sustainability 12(6):2403","journal-title":"Sustainability"},{"key":"18383_CR15","doi-asserted-by":"crossref","unstructured":"AlTalmas T et al. (2018) Analysis of two adjacent articulation Quranic letters based on MFCC and DTW. in 2018 7th International Conference on Computer and Communication Engineering (ICCCE)","DOI":"10.1109\/ICCCE.2018.8539291"},{"key":"18383_CR16","doi-asserted-by":"publisher","first-page":"171","DOI":"10.1016\/j.patcog.2017.09.020","volume":"74","author":"J Zhao","year":"2018","unstructured":"Zhao J, Itti L (2018) shapeDTW: Shape dynamic time warping. Pattern Recogn 74:171\u2013184","journal-title":"Pattern Recogn"},{"issue":"7","key":"18383_CR17","doi-asserted-by":"publisher","first-page":"9961","DOI":"10.1007\/s11042-020-10118-x","volume":"80","author":"G Agarwal","year":"2021","unstructured":"Agarwal G, Om H (2021) Performance of deer hunting optimization based deep learning algorithm for speech emotion recognition. Multimed Tools Appl 80(7):9961\u20139992","journal-title":"Multimed Tools Appl"},{"key":"18383_CR18","doi-asserted-by":"publisher","first-page":"2838","DOI":"10.1016\/j.procs.2015.05.444","volume":"51","author":"C-J Hsu","year":"2015","unstructured":"Hsu C-J et al (2015) Flexible dynamic time warping for time series classification. Procedia Comput Sci 51:2838\u20132842","journal-title":"Procedia Comput Sci"},{"key":"18383_CR19","doi-asserted-by":"crossref","unstructured":"Anggraeni D et al. (2018) The implementation of speech recognition using mel-frequency cepstrum coefficients (MFCC) and support vector machine (SVM) method based on python to control robot arm. in IOP Conference Series: Materials Science and Engineering","DOI":"10.1088\/1757-899X\/288\/1\/012042"},{"key":"18383_CR20","doi-asserted-by":"crossref","unstructured":"Liu J et al. (2021) Speech Disorders Classification in Phonetic Exams with MFCC and DTW. in 2021 IEEE 7th International Conference on Collaboration and Internet Computing (CIC)","DOI":"10.1109\/CIC52973.2021.00015"},{"issue":"5","key":"18383_CR21","first-page":"617","volume":"10","author":"C Vimala","year":"2015","unstructured":"Vimala C, Radha V (2015) Isolated speech recognition system for Tamil language using statistical pattern matching and machine learning techniques. J Eng Sci Technol (JESTEC) 10(5):617\u2013632","journal-title":"J Eng Sci Technol (JESTEC)"},{"issue":"11","key":"18383_CR22","doi-asserted-by":"publisher","first-page":"987","DOI":"10.1007\/s00371-008-0271-7","volume":"24","author":"R Reif","year":"2008","unstructured":"Reif R, Walch D (2008) Augmented & Virtual Reality applications in the field of logistics. Vis Comput 24(11):987\u2013994","journal-title":"Vis Comput"},{"key":"18383_CR23","doi-asserted-by":"crossref","unstructured":"Palaz D, Collobert R (2015) Analysis of CNN-based speech recognition system using raw speech as input. in REP_WORK","DOI":"10.21437\/Interspeech.2015-3"},{"key":"18383_CR24","unstructured":"Liang S, Yan W (2022) Multilingual speech recognition based on the end-to-end framework. Multimedia Tools and Applications"},{"key":"18383_CR25","doi-asserted-by":"crossref","unstructured":"Palaz D, Doss MM, Collobert R (2015) Convolutional neural networks-based continuous speech recognition using raw speech signal. in 2015 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)","DOI":"10.1109\/ICASSP.2015.7178781"},{"key":"18383_CR26","doi-asserted-by":"crossref","unstructured":"Fauziya F, Nijhawan G (2014) A Comparative study of phoneme recognition using GMM-HMM and ANN based acoustic modeling. International Journal of Computer Applications. 98(6)","DOI":"10.5120\/17186-7366"},{"key":"18383_CR27","doi-asserted-by":"crossref","unstructured":"Passricha V, Aggarwal RK (2018) Convolutional neural networks for raw speech recognition. IntechOpen. 21\u201340","DOI":"10.5772\/intechopen.80026"},{"issue":"1","key":"18383_CR28","doi-asserted-by":"publisher","first-page":"204","DOI":"10.1186\/2193-1801-3-204","volume":"3","author":"H Ali","year":"2014","unstructured":"Ali H et al (2014) DWT features performance analysis for automatic speech recognition of Urdu. Springerplus 3(1):204","journal-title":"Springerplus"},{"key":"18383_CR29","unstructured":"Burgos W (2014) Gammatone and MFCC features in speaker recognition. Florida Institute of Technology"},{"key":"18383_CR30","unstructured":"Qi J et al. (2013) Auditory features based on gammatone filters for robust speech recognition. in 2013 IEEE International Symposium on Circuits and Systems (ISCAS)"},{"key":"18383_CR31","doi-asserted-by":"crossref","unstructured":"Chuctaya HFC, Mercado RNM, Gaona JJG (2018) Isolated automatic speech recognition of Quechua numbers using MFCC, DTW and KNN. International Journal of Advanced Computer Science and Applications. 9(10)","DOI":"10.14569\/IJACSA.2018.091003"},{"key":"18383_CR32","doi-asserted-by":"crossref","unstructured":"Permanasari Y, Harahap EH, Ali EP (2019) Speech recognition using dynamic time warping (DTW). in J Phys","DOI":"10.1088\/1742-6596\/1366\/1\/012091"},{"key":"18383_CR33","doi-asserted-by":"crossref","unstructured":"Zhang Q, Yuan X, Lam CT (2022) Recognition of Score Word in Freestyle Kayaking. in 2022 IEEE 12th International Conference on Electronics Information and Emergency Communication (ICEIEC). IEEE","DOI":"10.1109\/ICEIEC54567.2022.9835045"}],"container-title":["Multimedia Tools and Applications"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-024-18383-w.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11042-024-18383-w\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-024-18383-w.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,9,3]],"date-time":"2024-09-03T08:33:34Z","timestamp":1725352414000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11042-024-18383-w"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,2,20]]},"references-count":33,"journal-issue":{"issue":"31","published-online":{"date-parts":[[2024,9]]}},"alternative-id":["18383"],"URL":"https:\/\/doi.org\/10.1007\/s11042-024-18383-w","relation":{},"ISSN":["1573-7721"],"issn-type":[{"type":"electronic","value":"1573-7721"}],"subject":[],"published":{"date-parts":[[2024,2,20]]},"assertion":[{"value":"6 January 2023","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"7 September 2023","order":2,"name":"revised","label":"Revised","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"19 January 2024","order":3,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"20 February 2024","order":4,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare that they have no known competing financial interests or personal relationships that could have appeared to influence the work reported in this paper.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}}]}}