{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,8]],"date-time":"2026-07-08T16:05:56Z","timestamp":1783526756941,"version":"3.55.0"},"reference-count":42,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","license":[{"start":{"date-parts":[[2020,1,1]],"date-time":"2020-01-01T00:00:00Z","timestamp":1577836800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0\/legalcode"}],"funder":[{"DOI":"10.13039\/501100003448","name":"Greek General Secretariat of Research and Technology","doi-asserted-by":"publisher","award":["T1E\u0394K-02469 EPIKOINONO"],"award-info":[{"award-number":["T1E\u0394K-02469 EPIKOINONO"]}],"id":[{"id":"10.13039\/501100003448","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Access"],"published-print":{"date-parts":[[2020]]},"DOI":"10.1109\/access.2020.2993650","type":"journal-article","created":{"date-parts":[[2020,5,12]],"date-time":"2020-05-12T00:08:04Z","timestamp":1589242084000},"page":"91170-91180","source":"Crossref","is-referenced-by-count":78,"title":["Continuous Sign Language Recognition Through Cross-Modal Alignment of Video and Text Embeddings in a Joint-Latent Space"],"prefix":"10.1109","volume":"8","author":[{"ORCID":"https:\/\/orcid.org\/0000-0003-4664-2626","authenticated-orcid":false,"given":"Ilias","family":"Papastratis","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-1584-7047","authenticated-orcid":false,"given":"Kosmas","family":"Dimitropoulos","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Dimitrios","family":"Konstantinidis","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-3814-6710","authenticated-orcid":false,"given":"Petros","family":"Daras","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref39","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00812"},{"key":"ref38","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2019.8682700"},{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.1109\/TIP.2019.2917867"},{"key":"ref32","doi-asserted-by":"publisher","DOI":"10.1109\/TCYB.2016.2535122"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.24963\/ijcai.2019\/106"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/TIP.2019.2941267"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.1214\/aoms\/1177732360"},{"key":"ref36","first-page":"1","article-title":"Recurrent neural network based language model","author":"mikolov","year":"2010","journal-title":"Proc 11th Annu Conf Int Speech Commun Assoc"},{"key":"ref35","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/E17-1096"},{"key":"ref34","doi-asserted-by":"publisher","DOI":"10.1109\/TIP.2019.2957930"},{"key":"ref10","first-page":"1521","article-title":"Hidden conditional random fields for gesture recognition","volume":"2","author":"wang","year":"2006","journal-title":"Proc IEEE Comput Soc Conf Comput Vis Pattern Recognit (CVPR)"},{"key":"ref40","article-title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift","author":"ioffe","year":"2015","journal-title":"arXiv 1502 03167"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.23919\/EUSIPCO.2018.8553163"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2017.502"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1016\/j.patcog.2017.12.007"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/TMM.2018.2889563"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-018-1121-3"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2019.2911077"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2019.00429"},{"key":"ref18","first-page":"1","article-title":"Machine recognition of auslan signs using powergloves: Towards large-lexicon recognition of sign language","volume":"165","author":"kadous","year":"1996","journal-title":"Proc Workshop Integr Gesture Lang Speech"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2016.412"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1109\/ICME.2019.00223"},{"key":"ref4","first-page":"2205","article-title":"Sign language recognition using sub-units","volume":"13","author":"cooper","year":"2012","journal-title":"J Mach Learn Res"},{"key":"ref27","first-page":"894","article-title":"Soft-DTW: A differentiable loss function for time-series","volume":"70","author":"cuturi","year":"2017","journal-title":"Proc 34th Int Conf Mach Learn"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1109\/3DTV.2018.8478467"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1016\/j.cviu.2015.09.013"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.24963\/ijcai.2019\/105"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/IST.2018.8577085"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1109\/ICME.2016.7552950"},{"key":"ref7","first-page":"1","article-title":"Towards a video corpus for signer-independent continuous sign language recognition","author":"von agris","year":"2007","journal-title":"Gesture in Human-Computer Interaction and Simulation"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/TMM.2014.2374357"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.5244\/C.30.136"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1017\/CBO9781139163910"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2017.364"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2017.332"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1145\/1143844.1143891"},{"key":"ref42","first-page":"1","article-title":"Hierarchical LSTM for sign language translation","author":"guo","year":"2018","journal-title":"Proc 32nd AAAI Conf Artif Intell"},{"key":"ref24","first-page":"1","article-title":"Video-based sign language recognition without temporal segmentation","author":"huang","year":"2018","journal-title":"Proc 32nd AAAI Conf Artif Intell"},{"key":"ref41","doi-asserted-by":"publisher","DOI":"10.1145\/3240508.3240671"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2017.175"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.24963\/ijcai.2018\/123"},{"key":"ref25","article-title":"SF-Net: Structured feature network for continuous sign language recognition","author":"yang","year":"2019","journal-title":"arXiv 1908 01341"}],"container-title":["IEEE Access"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/6287639\/8948470\/09090828.pdf?arnumber=9090828","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2021,12,17]],"date-time":"2021-12-17T19:51:59Z","timestamp":1639770719000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/9090828\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2020]]},"references-count":42,"URL":"https:\/\/doi.org\/10.1109\/access.2020.2993650","relation":{},"ISSN":["2169-3536"],"issn-type":[{"value":"2169-3536","type":"electronic"}],"subject":[],"published":{"date-parts":[[2020]]}}}