{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,23]],"date-time":"2026-07-23T01:56:50Z","timestamp":1784771810707,"version":"3.55.0"},"reference-count":57,"publisher":"Springer Science and Business Media LLC","issue":"1","license":[{"start":{"date-parts":[[2024,11,22]],"date-time":"2024-11-22T00:00:00Z","timestamp":1732233600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,11,22]],"date-time":"2024-11-22T00:00:00Z","timestamp":1732233600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"name":"Development Project of Ship Situational Intelligent Awareness System","award":["MC-201920-X01"],"award-info":[{"award-number":["MC-201920-X01"]}]},{"name":"Development Project of Ship Situational Intelligent Awareness System","award":["MC-201920-X01"],"award-info":[{"award-number":["MC-201920-X01"]}]},{"name":"Development Project of Ship Situational Intelligent Awareness System","award":["MC-201920-X01"],"award-info":[{"award-number":["MC-201920-X01"]}]},{"name":"Young Talent Fund of Association for Science and Technology in Shaanxi","award":["qsy007"],"award-info":[{"award-number":["qsy007"]}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Machine Vision and Applications"],"published-print":{"date-parts":[[2025,1]]},"DOI":"10.1007\/s00138-024-01633-0","type":"journal-article","created":{"date-parts":[[2024,11,22]],"date-time":"2024-11-22T03:37:44Z","timestamp":1732246664000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":12,"title":["Continuous sign language recognition based on motor attention mechanism and frame-level self-distillation"],"prefix":"10.1007","volume":"36","author":[{"given":"Qidan","family":"Zhu","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Jing","family":"Li","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Fei","family":"Yuan","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Quan","family":"Gan","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2024,11,22]]},"reference":[{"key":"1633_CR1","doi-asserted-by":"crossref","unstructured":"Hu, L., Gao, L., Liu, Z., Feng, W.: Continuous sign language recognition with correlation network. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 2529\u20132539 (2023)","DOI":"10.1109\/CVPR52729.2023.00249"},{"key":"1633_CR2","doi-asserted-by":"publisher","DOI":"10.1016\/j.patcog.2022.109233","volume":"136","author":"P Xie","year":"2023","unstructured":"Xie, P., Cui, Z., Du, Y., Zhao, M., Cui, J., Wang, B., Hu, X.: Multi-scale local-temporal similarity fusion for continuous sign language recognition. Pattern Recogn. 136, 109233 (2023)","journal-title":"Pattern Recogn."},{"key":"1633_CR3","first-page":"17 043","volume":"35","author":"Y Chen","year":"2022","unstructured":"Chen, Y., Zuo, R., Wei, F., Wu, Y., Liu, S., Mak, B.: Two-stream network for sign language recognition and translation. Adv. Neural. Inf. Process. Syst. 35, 17 043-17 056 (2022)","journal-title":"Adv. Neural. Inf. Process. Syst."},{"key":"1633_CR4","doi-asserted-by":"publisher","DOI":"10.1016\/j.patcog.2020.107392","volume":"105","author":"H Li","year":"2020","unstructured":"Li, H., Wang, W.: Reinterpreting ctc training as iterative fitting. Pattern Recogn. 105, 107392 (2020)","journal-title":"Pattern Recogn."},{"key":"1633_CR5","unstructured":"Zhu, Q., Li, J., Yuan, F., Gan, Q.: Multi-scale temporal network for continuous sign language recognition, arXiv preprint arXiv:2204.03864, (2022)"},{"issue":"07","key":"1633_CR6","first-page":"13 009","volume":"34","author":"H Zhou","year":"2020","unstructured":"Zhou, H., Zhou, W., Zhou, Y., Li, H.: Spatial-temporal multi-cue network for continuous sign language recognition. Proc. AAAI Conf. Artif. Intell. 34(07), 13 009-13 016 (2020)","journal-title":"Proc. AAAI Conf. Artif. Intell."},{"issue":"9","key":"1633_CR7","doi-asserted-by":"publisher","first-page":"2822","DOI":"10.1109\/TCSVT.2018.2870740","volume":"29","author":"J Huang","year":"2018","unstructured":"Huang, J., Zhou, W., Li, H., Li, W.: Attention-based 3D-CNNs for large-vocabulary sign language recognition. IEEE Trans. Circuits Syst. Video Technol. 29(9), 2822\u20132832 (2018)","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"issue":"8","key":"1633_CR8","doi-asserted-by":"publisher","first-page":"1086","DOI":"10.1109\/TCSVT.2004.831970","volume":"14","author":"N Habili","year":"2004","unstructured":"Habili, N., Lim, C.C., Moini, A.: Segmentation of the face and hands in sign language video sequences using color and motion cues. IEEE Trans. Circuits Syst. Video Technol. 14(8), 1086\u20131097 (2004)","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"issue":"2","key":"1633_CR9","doi-asserted-by":"crossref","first-page":"1431","DOI":"10.1109\/TSC.2022.3173791","volume":"23","author":"J Zhang","year":"2023","unstructured":"Zhang, J., Wang, Q., Wang, Q., Zheng, Z.: Multimodal fusion framework based on statistical attention and contrastive attention for sign language recognition. IEEE Trans. Mob. Comput. 23(2), 1431\u201343 (2023)","journal-title":"IEEE Trans. Mob. Comput."},{"key":"1633_CR10","doi-asserted-by":"publisher","first-page":"115","DOI":"10.1016\/j.neucom.2022.05.051","volume":"500","author":"Y Du","year":"2022","unstructured":"Du, Y., Xie, P., Wang, M., Hu, X., Zhao, Z., Liu, J.: Full transformer network with masking future for word-level sign language recognition. Neurocomputing 500, 115\u2013123 (2022)","journal-title":"Neurocomputing"},{"key":"1633_CR11","doi-asserted-by":"crossref","unstructured":"Yin, K., Read, J.: Better sign language translation with stmc-transformer, arXiv preprint arXiv:2004.00588, (2020)","DOI":"10.18653\/v1\/2020.coling-main.525"},{"issue":"9","key":"1633_CR12","doi-asserted-by":"publisher","first-page":"11221","DOI":"10.1109\/TPAMI.2023.3269220","volume":"45","author":"H Hu","year":"2023","unstructured":"Hu, H., Zhao, W., Zhou, W., Li, H.: Signbert+: Hand-model-aware self-supervised pre-training for sign language understanding. IEEE Trans. Pattern Anal. Mach. Intell. 45(9), 11221\u201339 (2023)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"1633_CR13","doi-asserted-by":"publisher","first-page":"2662","DOI":"10.1109\/TMM.2021.3087006","volume":"24","author":"J Zhao","year":"2021","unstructured":"Zhao, J., Qi, W., Zhou, W., Duan, N., Zhou, M., Li, H.: Conditional sentence generation and cross-modal reranking for sign language translation. IEEE Trans. Multimed. 24, 2662\u20132672 (2021)","journal-title":"IEEE Trans. Multimed."},{"key":"1633_CR14","unstructured":"Min, Y., Hao, A., Chai, X., Chen, X.: Visual alignment constraint for continuous sign language recognition. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 11\u00a0542\u201311\u00a0551 (2021)"},{"key":"1633_CR15","doi-asserted-by":"crossref","unstructured":"Hu, J., Shen, L., Sun, G.: Squeeze-and-excitation networks. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 7132\u20137141 (2018)","DOI":"10.1109\/CVPR.2018.00745"},{"key":"1633_CR16","doi-asserted-by":"crossref","unstructured":"Woo, S., Park, J., Lee, J.-Y., Kweon, I.\u00a0S.: Cbam: Convolutional block attention module. In: Proceedings of the European Conference on Computer Vision (ECCV), pp. 3\u201319 (2018)","DOI":"10.1007\/978-3-030-01234-2_1"},{"key":"1633_CR17","doi-asserted-by":"crossref","unstructured":"Lee, M., Lee, S., Son, S., Park, G., Kwak, N.: Motion feature network: Fixed motion filter for action recognition. In: Proceedings of the European Conference on Computer Vision (ECCV), pp. 387\u2013403 (2018)","DOI":"10.1007\/978-3-030-01249-6_24"},{"key":"1633_CR18","doi-asserted-by":"crossref","unstructured":"Zhang, G., Zhu, Y., Wang, H., Chen, Y., Wu, G., Wang, L.: Extracting motion and appearance via inter-frame attention for efficient video frame interpolation. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 5682\u20135692 (2023)","DOI":"10.1109\/CVPR52729.2023.00550"},{"key":"1633_CR19","doi-asserted-by":"publisher","first-page":"108","DOI":"10.1016\/j.cviu.2015.09.013","volume":"141","author":"O Koller","year":"2015","unstructured":"Koller, O., Forster, J., Ney, H.: Continuous sign language recognition: towards large vocabulary statistical recognition systems handling multiple signers. Comput. Vis. Image Underst. 141, 108\u2013125 (2015)","journal-title":"Comput. Vis. Image Underst."},{"key":"1633_CR20","doi-asserted-by":"crossref","unstructured":"Camgoz, N.\u00a0C., Hadfield, S., Koller, O., Ney, H., Bowden, R.: Neural sign language translation. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 7784\u20137793 (2018)","DOI":"10.1109\/CVPR.2018.00812"},{"key":"1633_CR21","doi-asserted-by":"crossref","unstructured":"Zhou, H., Zhou, W., Qi, W., Pu, J., Li, H.: Improving sign language translation with monolingual data by sign back-translation. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 1316\u20131325 (2021)","DOI":"10.1109\/CVPR46437.2021.00137"},{"issue":"7","key":"1633_CR22","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1109\/LSENS.2022.3185181","volume":"6","author":"AK Talukdar","year":"2022","unstructured":"Talukdar, A.K., Bhuyan, M.: Vision-based continuous sign language spotting using gaussian hidden markov model. IEEE Sens. Lett. 6(7), 1\u20134 (2022)","journal-title":"IEEE Sens. Lett."},{"key":"1633_CR23","doi-asserted-by":"crossref","unstructured":"Zhang, J., Zhou, W., Li, H.: A threshold-based hmm-dtw approach for continuous sign language recognition. In: Proceedings of International Conference on Internet Multimedia Computing and Service, pp. 237\u2013240 (2014)","DOI":"10.1145\/2632856.2632931"},{"issue":"3","key":"1633_CR24","doi-asserted-by":"publisher","first-page":"751","DOI":"10.1109\/TMM.2014.2298382","volume":"16","author":"L-C Wang","year":"2014","unstructured":"Wang, L.-C., Wang, R., Kong, D.-H., Yin, B.-C.: Similarity assessment model for chinese sign language videos. IEEE Trans. Multimed. 16(3), 751\u2013761 (2014)","journal-title":"IEEE Trans. Multimed."},{"key":"1633_CR25","doi-asserted-by":"publisher","first-page":"1311","DOI":"10.1007\/s11263-018-1121-3","volume":"126","author":"O Koller","year":"2018","unstructured":"Koller, O., Zargaran, S., Ney, H., Bowden, R.: Deep sign: Enabling robust statistical continuous sign language recognition via hybrid cnn-hmms. Int. J. Comput. Vision 126, 1311\u20131325 (2018)","journal-title":"Int. J. Comput. Vision"},{"issue":"9","key":"1633_CR26","doi-asserted-by":"publisher","first-page":"2306","DOI":"10.1109\/TPAMI.2019.2911077","volume":"42","author":"O Koller","year":"2019","unstructured":"Koller, O., Camgoz, N.C., Ney, H., Bowden, R.: Weakly supervised learning with multi-stream cnn-lstm-hmms to discover sequential parallelism in sign language videos. IEEE Trans. Pattern Anal. Mach. Intell. 42(9), 2306\u20132320 (2019)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"1633_CR27","doi-asserted-by":"publisher","first-page":"45","DOI":"10.1016\/j.neucom.2020.12.006","volume":"434","author":"L Gao","year":"2021","unstructured":"Gao, L., Li, H., Liu, Z., Liu, Z., Wan, L., Feng, W.: Rnn-transducer based chinese sign language recognition. Neurocomputing 434, 45\u201354 (2021)","journal-title":"Neurocomputing"},{"key":"1633_CR28","doi-asserted-by":"publisher","first-page":"1575","DOI":"10.1109\/TIP.2019.2941267","volume":"29","author":"D Guo","year":"2019","unstructured":"Guo, D., Zhou, W., Li, A., Li, H., Wang, M.: Hierarchical recurrent deep fusion using adaptive clip summarization for sign language translation. IEEE Trans. Image Process. 29, 1575\u20131590 (2019)","journal-title":"IEEE Trans. Image Process."},{"issue":"3","key":"1633_CR29","doi-asserted-by":"publisher","first-page":"1138","DOI":"10.1109\/TCSVT.2020.2999384","volume":"31","author":"C Wei","year":"2020","unstructured":"Wei, C., Zhao, J., Zhou, W., Li, H.: Semantic boundary detection with reinforcement learning for continuous sign language recognition. IEEE Trans. Circuits Syst. Video Technol. 31(3), 1138\u20131149 (2020)","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"1633_CR30","doi-asserted-by":"publisher","first-page":"216 718","DOI":"10.1109\/ACCESS.2020.3039539","volume":"8","author":"Q Xiao","year":"2020","unstructured":"Xiao, Q., Chang, X., Zhang, X., Liu, X.: Multi-information spatial-temporal lstm fusion continuous sign language neural machine translation. IEEE Access 8, 216 718-216 728 (2020)","journal-title":"Ieee Access"},{"key":"1633_CR31","doi-asserted-by":"crossref","unstructured":"Papadimitriou, K., Potamianos, G.: Multimodal sign language recognition via temporal deformable convolutional sequence learning. In Interspeech, pp. 2752\u20132756 (2020)","DOI":"10.21437\/Interspeech.2020-2691"},{"issue":"7","key":"1633_CR32","doi-asserted-by":"publisher","first-page":"1880","DOI":"10.1109\/TMM.2018.2889563","volume":"21","author":"R Cui","year":"2019","unstructured":"Cui, R., Liu, H., Zhang, C.: A deep neural framework for continuous sign language recognition by iterative training. IEEE Trans. Multimed. 21(7), 1880\u20131891 (2019)","journal-title":"IEEE Trans. Multimed."},{"issue":"8","key":"1633_CR33","doi-asserted-by":"publisher","first-page":"5213","DOI":"10.1109\/TCSVT.2021.3137023","volume":"32","author":"J Fu","year":"2021","unstructured":"Fu, J., Gao, J., Xu, C.: Learning semantic-aware spatial-temporal attention for interpretable action recognition. IEEE Trans. Circuits Syst. Video Technol. 32(8), 5213\u20135224 (2021)","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"1633_CR34","first-page":"13 627","volume":"35","author":"Y Zhao","year":"2022","unstructured":"Zhao, Y., Li, Z., Guo, X., Lu, Y.: Alignment-guided temporal attention for video action recognition. Adv. Neural. Inf. Process. Syst. 35, 13 627-13 639 (2022)","journal-title":"Adv. Neural. Inf. Process. Syst."},{"key":"1633_CR35","doi-asserted-by":"crossref","unstructured":"Hu, J., Ni, L.: Transformer with sequence relative position for continuous sign language translation. In: International Conference on Advanced Algorithms and Neural Networks (AANN 2022), vol. 12285. SPIE, pp. 170\u2013176 (2022)","DOI":"10.1117\/12.2637117"},{"key":"1633_CR36","doi-asserted-by":"crossref","unstructured":"Jiang, B., Wang, M., Gan, W., Wu, W., Yan, J.: Stm: Spatiotemporal and motion encoding for action recognition. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 2000\u20132009 (2019)","DOI":"10.1109\/ICCV.2019.00209"},{"key":"1633_CR37","doi-asserted-by":"crossref","unstructured":"Diba, A., Fayyaz, M., Sharma, V., Arzani, M.\u00a0M., Yousefzadeh, R., Gall, J., Van Gool, L.: Spatio-temporal channel correlation networks for action classification. In: Proceedings of the European Conference on Computer Vision (ECCV), pp. 284\u2013299 (2018)","DOI":"10.1007\/978-3-030-01225-0_18"},{"key":"1633_CR38","doi-asserted-by":"crossref","unstructured":"Wang, H., Tran, D., Torresani, L., Feiszli, M.: Video modeling with correlation networks. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 352\u2013361 (2020)","DOI":"10.1109\/CVPR42600.2020.00043"},{"key":"1633_CR39","doi-asserted-by":"crossref","unstructured":"Bucilu\u01ce, C., Caruana, R., Niculescu-Mizil, A.: Model compression. In: Proceedings of the 12th ACM SIGKDD International Conference on Knowledge Discovery and Data Mining, pp. 535\u2013541 (2006)","DOI":"10.1145\/1150402.1150464"},{"key":"1633_CR40","unstructured":"Hinton, G., Vinyals, O., Dean, J.: Distilling the knowledge in a neural network, arXiv preprint arXiv:1503.02531,(2015)"},{"key":"1633_CR41","doi-asserted-by":"crossref","unstructured":"Zhu, Q., Li, J., Yuan, F., Gan, Q.: Continuous sign language recognition based on cross-resolution knowledge distillation, arXiv preprint arXiv:2303.06820 (2023)","DOI":"10.1007\/s13369-024-09479-4"},{"key":"1633_CR42","unstructured":"Komodakis, N., Zagoruyko, S.: Paying more attention to attention: Improving the performance of convolutional neural networks via attention transfer. In: ICLR (2017)"},{"key":"1633_CR43","doi-asserted-by":"crossref","unstructured":"Hou, Y., Ma, Z., Liu, C., Loy, C.\u00a0C.: Learning lightweight lane detection cnns by self attention distillation. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 1013\u20131021 (2019)","DOI":"10.1109\/ICCV.2019.00110"},{"key":"1633_CR44","doi-asserted-by":"crossref","unstructured":"Zhang, L., Song, J., Gao, A., Chen, J., Bao, C., Ma, K.: Be your own teacher: Improve the performance of convolutional neural networks via self distillation. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 3713\u20133722 (2019)","DOI":"10.1109\/ICCV.2019.00381"},{"key":"1633_CR45","doi-asserted-by":"crossref","unstructured":"Ji, M., Shin, S., Hwang, S., Park, G., Moon, I.-C.: Refine myself by teaching myself: Feature refinement via self-knowledge distillation. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 10\u00a0664\u201310\u00a0673 (2021)","DOI":"10.1109\/CVPR46437.2021.01052"},{"key":"1633_CR46","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., Sun, J.: Deep residual learning for image recognition. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 770\u2013778 (2016)","DOI":"10.1109\/CVPR.2016.90"},{"key":"1633_CR47","doi-asserted-by":"crossref","unstructured":"Huang, J., Zhou, W., Zhang, Q., Li, H., Li, W.: Video-based sign language recognition without temporal segmentation. In: Proceedings of the AAAI Conference on Artificial Intelligence, vol.\u00a032, no.\u00a01, (2018)","DOI":"10.1609\/aaai.v32i1.11903"},{"key":"1633_CR48","doi-asserted-by":"crossref","unstructured":"Koller, O., Zargaran, S., Ney, H.: Re-sign: Re-aligned end-to-end sequence modelling with deep recurrent cnn-hmms. In Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 4297\u20134305 (2017)","DOI":"10.1109\/CVPR.2017.364"},{"key":"1633_CR49","unstructured":"Camgoz, N.\u00a0C., Koller, O., Hadfield, S., Bowden, R.: Sign language transformers: Joint end-to-end sign language recognition and translation. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 10\u00a0023\u201310\u00a0033 (2020)"},{"key":"1633_CR50","doi-asserted-by":"crossref","unstructured":"Cheng, K.L., Yang, Z., Chen, Q., Tai, Y.-W.: Fully convolutional networks for continuous sign language recognition. In: Computer Vision-ECCV, 16th European Conference, Glasgow, UK, August 23\u201328, 2020, Proceedings, Part XXIV 16. Springer 2020, pp. 697\u2013714 (2020)","DOI":"10.1007\/978-3-030-58586-0_41"},{"issue":"1","key":"1633_CR51","first-page":"854","volume":"37","author":"L Hu","year":"2023","unstructured":"Hu, L., Gao, L., Liu, Z., Feng, W.: Self-emphasizing network for continuous sign language recognition. Proc. AAAI Conf. Artif. Intell. 37(1), 854\u2013862 (2023)","journal-title":"Proc. AAAI Conf. Artif. Intell."},{"key":"1633_CR52","doi-asserted-by":"crossref","unstructured":"Zuo, R., Mak, B.: C2slr: Consistency-enhanced continuous sign language recognition. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 5131\u20135140 (2022)","DOI":"10.1109\/CVPR52688.2022.00507"},{"key":"1633_CR53","doi-asserted-by":"crossref","unstructured":"Yin, W., Hou, Y., Guo, Z., Liu, K.: Spatial temporal enhanced network for continuous sign language recognition. IEEE Transactions on Circuits and Systems for Video Technology (2023)","DOI":"10.1109\/TCSVT.2023.3296668"},{"key":"1633_CR54","doi-asserted-by":"crossref","unstructured":"Kan, J., Hu, K., Hagenbuchner, M., Tsoi, A.\u00a0C., Bennamoun, M., Wang, Z.: Sign language translation with hierarchical spatio-temporal graph neural network. In Proceedings of the IEEE\/CVF Winter Conference on Applications of Computer Vision, pp. 3367\u20133376 (2022)","DOI":"10.1109\/WACV51458.2022.00219"},{"key":"1633_CR55","doi-asserted-by":"crossref","unstructured":"Guo, L., Xue, W., Guo, Q., Zhou, Y., Yuan, T., Chen, S.: Conditional diffusion feature refinement for continuous sign language recognition, arXiv preprint arXiv:2305.03614, (2023)","DOI":"10.1109\/CVPR52729.2023.01037"},{"key":"1633_CR56","unstructured":"Kingma, D.\u00a0P., Ba, J.: Adam: A method for stochastic optimization, arXiv preprint arXiv:1412.6980, (2014)"},{"key":"1633_CR57","doi-asserted-by":"crossref","unstructured":"Selvaraju, R.\u00a0R., Cogswell, M., Das, A., Vedantam, R., Parikh, D., Batra, D.: Grad-cam: visual explanations from deep networks via gradient-based localization. In: Proceedings of the IEEE International Conference on Computer Vision, pp. 618\u2013626 (2017)","DOI":"10.1109\/ICCV.2017.74"}],"container-title":["Machine Vision and Applications"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00138-024-01633-0.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s00138-024-01633-0\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00138-024-01633-0.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,1,18]],"date-time":"2025-01-18T10:29:18Z","timestamp":1737196158000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s00138-024-01633-0"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,11,22]]},"references-count":57,"journal-issue":{"issue":"1","published-print":{"date-parts":[[2025,1]]}},"alternative-id":["1633"],"URL":"https:\/\/doi.org\/10.1007\/s00138-024-01633-0","relation":{},"ISSN":["0932-8092","1432-1769"],"issn-type":[{"value":"0932-8092","type":"print"},{"value":"1432-1769","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,11,22]]},"assertion":[{"value":"22 August 2024","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"21 October 2024","order":2,"name":"revised","label":"Revised","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"1 November 2024","order":3,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"22 November 2024","order":4,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare that they have no known competing financial interests or personal relationships that could have appeared to influence the work reported in this paper.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}},{"value":"The project uses publicly available data that has been subject to an exemption.","order":3,"name":"Ethics","group":{"name":"EthicsHeading","label":"Ethical approval"}}],"article-number":"7"}}