{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,1,24]],"date-time":"2026-01-24T18:32:39Z","timestamp":1769279559286,"version":"3.49.0"},"reference-count":34,"publisher":"Springer Science and Business Media LLC","issue":"5","license":[{"start":{"date-parts":[[2022,12,22]],"date-time":"2022-12-22T00:00:00Z","timestamp":1671667200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2022,12,22]],"date-time":"2022-12-22T00:00:00Z","timestamp":1671667200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["61861032"],"award-info":[{"award-number":["61861032"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["61865012"],"award-info":[{"award-number":["61865012"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100010857","name":"Jiangxi Provincial Department of Science and Technology","doi-asserted-by":"publisher","award":["GJJ190955"],"award-info":[{"award-number":["GJJ190955"]}],"id":[{"id":"10.13039\/501100010857","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["SIViP"],"published-print":{"date-parts":[[2023,7]]},"DOI":"10.1007\/s11760-022-02449-z","type":"journal-article","created":{"date-parts":[[2022,12,22]],"date-time":"2022-12-22T04:21:19Z","timestamp":1671682879000},"page":"2323-2331","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":6,"title":["Learning convolutional self-attention module for unmanned aerial vehicle tracking"],"prefix":"10.1007","volume":"17","author":[{"given":"Jun","family":"Wang","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Chenchen","family":"Meng","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Chengzhi","family":"Deng","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yuanyun","family":"Wang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2022,12,22]]},"reference":[{"key":"2449_CR1","unstructured":"Krizhevsky, A., Sutskever, I., Hinton, G.E.: Imagenet classification with deep convolutional neural networks. In: Advances in Neural Information Processing Systems, pp. 1097\u20131105 (2012)"},{"key":"2449_CR2","unstructured":"Simonyan, K., Zisserman, A.: Very deep convolutional networks for large-scale image recognition. arXiv preprint arXiv:1409.1556 (2014)"},{"key":"2449_CR3","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., Sun, J.: Deep residual learning for image recognition. In: IEEE Conference on Computer Vision and Pattern Recognition, pp. 770\u2013778 (2016)","DOI":"10.1109\/CVPR.2016.90"},{"key":"2449_CR4","doi-asserted-by":"crossref","unstructured":"Srinivas, A., Lin, T.-Y., Parmar, N., Shlens, J., Abbeel, P., Vaswani, A.: Bottleneck transformers for visual recognition. In: IEEE Conference on Computer Vision and Pattern Recognition, pp. 16519\u201316529 (2021)","DOI":"10.1109\/CVPR46437.2021.01625"},{"key":"2449_CR5","doi-asserted-by":"crossref","unstructured":"Li, B., Yan, J., Wu, W., Zhu, Z., Hu, X.: High performance visual tracking with Siamese region proposal network. In: IEEE Conference on Computer Vision and Pattern Recognition, pp. 8971\u20138980 (2018)","DOI":"10.1109\/CVPR.2018.00935"},{"key":"2449_CR6","unstructured":"Huang, L., Zhao, X., Huang, K.: Got-10k: A large high-diversity benchmark for generic object tracking in the wild. In: IEEE Transactions on Pattern Analysis and Machine Intelligence (2019)"},{"key":"2449_CR7","doi-asserted-by":"publisher","first-page":"211","DOI":"10.1007\/s11263-015-0816-y","volume":"2015","author":"O Russakovsky","year":"2015","unstructured":"Russakovsky, O., Deng, J., Su, H., Krause, J., Satheesh, S., Ma, S., Huang, Z., Karpathy, A., Khosla, A., Bernstein, M., et al.: Imagenet large scale visual recognition challenge. Int. J. Comput. Vis. 2015, 211\u2013252 (2015)","journal-title":"Int. J. Comput. Vis."},{"key":"2449_CR8","doi-asserted-by":"publisher","DOI":"10.1007\/s11760-022-02177-4","author":"J Wang","year":"2022","unstructured":"Wang, J., Meng, C., Deng, C., Wang, Y.: Learning attentionmodules for visual tracking. Signal Image Video Process. (2022). https:\/\/doi.org\/10.1007\/s11760-022-02177-4","journal-title":"Signal Image Video Process."},{"key":"2449_CR9","doi-asserted-by":"crossref","unstructured":"Bertinetto, L., Valmadre, J., Henriques, J.F., Vedaldi, A., Torr, P.H.: Fully-convolutional siamese networks for object tracking. In: European Conference on Computer Vision. Springer, pp. 850\u2013865 (2016)","DOI":"10.1007\/978-3-319-48881-3_56"},{"key":"2449_CR10","doi-asserted-by":"crossref","unstructured":"Li, F., Tian, C., Zuo, W., Zhang, L., Yang, M.-H.: Learning spatial-temporal regularized correlation filters for visual tracking. In: IEEE Conference on Computer Vision and Pattern Recognition, pp. 4904\u20134913 (2018)","DOI":"10.1109\/CVPR.2018.00515"},{"key":"2449_CR11","doi-asserted-by":"crossref","unstructured":"Yu, Y., Xiong, Y., Huang, W., Scott, M.R.: Deformable Siamese attention networks for visual object tracking. In: IEEE Conference on Computer Vision and Pattern Recognition, pp. 6728\u20136737 (2020)","DOI":"10.1109\/CVPR42600.2020.00676"},{"key":"2449_CR12","doi-asserted-by":"crossref","unstructured":"Chen, X., Yan, B., Zhu, J., Wang, D., Yang, X., Lu, H.: Transformer tracking. In: IEEE Conference on Computer Vision and Pattern Recognition, pp. 8126\u20138135 (2021)","DOI":"10.1109\/CVPR46437.2021.00803"},{"key":"2449_CR13","doi-asserted-by":"crossref","unstructured":"Zhang, Z., Peng, H.: Deeper and wider Siamese networks for real-time visual tracking. In: IEEE Conference on Computer Vision and Pattern Recognition, pp. 4591\u20134600 (2019)","DOI":"10.1109\/CVPR.2019.00472"},{"key":"2449_CR14","unstructured":"Vaswani, A., Shazeer, N., Parmar, N., Uszkoreit, J., Jones, L., Gomez, A.N., Kaiser, \u0141., Polosukhin, I.: Attention is all you need. In: Advances in Neural Information Processing Systems, pp. 5998\u20136008 (2017)"},{"key":"2449_CR15","doi-asserted-by":"crossref","unstructured":"Bello, I., Zoph, B., Vaswani, A., Shlens, J., Le, Q.V.: Attention augmented convolutional networks. In: IEEE International Conference on Computer Vision, pp. 3286\u20133295 (2019)","DOI":"10.1109\/ICCV.2019.00338"},{"key":"2449_CR16","unstructured":"Ramachandran, P., Parmar, N., Vaswani, A., Bello, I., Levskaya, A., Shlens, J.: Stand-alone self-attention in vision models. arXiv preprint arXiv:1906.05909 (2019)"},{"key":"2449_CR17","doi-asserted-by":"publisher","first-page":"1834","DOI":"10.1109\/TPAMI.2014.2388226","volume":"2015","author":"Y Wu","year":"2015","unstructured":"Wu, Y., Lim, J., Yang, M.H.: Object tracking benchmark. IEEE Trans. Pattern Anal. Mach. Intell. 2015, 1834\u20131848 (2015)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"2449_CR18","doi-asserted-by":"crossref","unstructured":"Li, S., Yeung, D.-Y.: Visual object tracking for unmanned aerial vehicles: a benchmark and new motion models. In: AAAI Conference on Artificial Intelligence (2017)","DOI":"10.1609\/aaai.v31i1.11205"},{"key":"2449_CR19","doi-asserted-by":"crossref","unstructured":"Mueller, M., Smith, N., Ghanem, B.: A benchmark and simulator for uav tracking. In: European Conference on Computer Vision, pp. 445\u2013461 (2016)","DOI":"10.1007\/978-3-319-46448-0_27"},{"key":"2449_CR20","doi-asserted-by":"crossref","unstructured":"Li, Y., Zhu, J., Hoi, S.C., Song, W., Wang, Z., Liu, H.: Robust estimation of similarity transformation for visual object tracking. In: AAAI Conference on Artificial Intelligence, pp. 8666\u20138673 (2019)","DOI":"10.1609\/aaai.v33i01.33018666"},{"key":"2449_CR21","doi-asserted-by":"crossref","unstructured":"Wang, N., Song, Y., Ma, C., Zhou, W., Liu, W., Li, H.: Unsupervised deep tracking. In: IEEE Conference on Computer Vision and Pattern Recognition, pp. 1308\u20131317 (2019)","DOI":"10.1109\/CVPR.2019.00140"},{"key":"2449_CR22","doi-asserted-by":"crossref","unstructured":"Choi, J., Chang, H.J., Fischer, T., Yun, S., Lee, K., Jeong, J., Demiris, Y., Choi, J.Y.: Context-aware deep feature compression for high-speed visual tracking. In: IEEE Conference on Computer Vision and Pattern Recognition, pp. 479\u2013488 (2018)","DOI":"10.1109\/CVPR.2018.00057"},{"key":"2449_CR23","doi-asserted-by":"crossref","unstructured":"Li, X., Ma, C., Wu, B., He, Z., Yang, M.-H.: Target-aware deep tracking. In: IEEE Conference on Computer Vision and Pattern Recognition, pp. 1369\u20131378 (2019)","DOI":"10.1109\/CVPR.2019.00146"},{"key":"2449_CR24","doi-asserted-by":"crossref","unstructured":"Dunnhofer, M., Martinel, N., Micheloni, C.: Tracking-by-trackers with a distilled and reinforced model. In: Asian Conference on Computer Vision (2020)","DOI":"10.1007\/978-3-030-69532-3_38"},{"key":"2449_CR25","doi-asserted-by":"crossref","unstructured":"Pu, S., Song, Y., Ma, C., Zhang, H., Yang, M.-H.: Learning recurrent memory activation networks for visual tracking. In: IEEE Transactions on Image Processing, vol.\u00a030. IEEE, pp. 725\u2013738 (2021)","DOI":"10.1109\/TIP.2020.3038356"},{"key":"2449_CR26","doi-asserted-by":"crossref","unstructured":"Lu, X., Ma, C., Shen, J., Yang, X., Reid, I., Yang, M.-H.: Deep object tracking with shrinkage loss. In: IEEE Transactions on Pattern Analysis and Machine Intelligence. IEEE (2020)","DOI":"10.1109\/TPAMI.2020.3041332"},{"key":"2449_CR27","doi-asserted-by":"crossref","unstructured":"Abdelpakey, M.H., Shehata, M.S.: Dp-siam: Dynamic policy Siamese network for robust object tracking. In: IEEE Transactions on Image Processing, vol.\u00a029. IEEE, pp. 1479\u20131492 (2019)","DOI":"10.1109\/TIP.2019.2942506"},{"key":"2449_CR28","doi-asserted-by":"crossref","unstructured":"Li, Y., Fu, C., Ding, F., Huang, Z., Lu, G.: Autotrack: towards high-performance visual tracking for uav with automatic spatio-temporal regularization. In: IEEE Conference on Computer Vision and Pattern Recognition, pp. 11923\u201311932 (2020)","DOI":"10.1109\/CVPR42600.2020.01194"},{"key":"2449_CR29","doi-asserted-by":"crossref","unstructured":"Huang, Z., Fu, C., Li, Y., Lin, F., Lu, P.: Learning aberrance repressed correlation filters for real-time uav tracking. In: IEEE International Conference on Computer Vision, pp. 2891\u20132900 (2019)","DOI":"10.1109\/ICCV.2019.00298"},{"key":"2449_CR30","doi-asserted-by":"crossref","unstructured":"Wang, N., Zhou, W., Tian, Q., Hong, R., Wang, M., Li, H.: Multi-cue correlation filters for robust visual tracking. In: IEEE Conference on Computer Vision and Pattern Recognition, pp. 4844\u20134853 (2018)","DOI":"10.1109\/CVPR.2018.00509"},{"key":"2449_CR31","doi-asserted-by":"crossref","unstructured":"Cao, Z., Fu, C., Ye, J., Li, B., Li, Y.: Hift: hierarchical feature transformer for aerial tracking. In: IEEE International Conference on Computer Vision, pp. 15457\u201315466 (2021)","DOI":"10.1109\/ICCV48922.2021.01517"},{"key":"2449_CR32","doi-asserted-by":"crossref","unstructured":"Danelljan, M., Bhat, G., Shahbaz\u00a0Khan, F., Felsberg, M.: Eco: efficient convolution operators for tracking. In: IEEE Conference on Computer Vision and Pattern Recognition, pp. 6638\u20136646 (2017)","DOI":"10.1109\/CVPR.2017.733"},{"key":"2449_CR33","doi-asserted-by":"crossref","unstructured":"Zheng, G., Fu, C., Ye, J., Lin, F., Ding, F.: Mutation sensitive correlation filter for real-time uav tracking with adaptive hybrid label. arXiv preprint arXiv:2106.08073 (2021)","DOI":"10.1109\/ICRA48506.2021.9561931"},{"key":"2449_CR34","doi-asserted-by":"crossref","unstructured":"Real, E., Shlens, J., Mazzocchi, S., Pan, X., Vanhoucke, V.: Youtube-boundingboxes: a large high-precision human-annotated data set for object detection in video. In: IEEE Conference on Computer Vision and Pattern Recognition, pp. 5296\u20135305 (2017)","DOI":"10.1109\/CVPR.2017.789"}],"container-title":["Signal, Image and Video Processing"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11760-022-02449-z.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11760-022-02449-z\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11760-022-02449-z.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,10,10]],"date-time":"2024-10-10T21:36:09Z","timestamp":1728596169000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11760-022-02449-z"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2022,12,22]]},"references-count":34,"journal-issue":{"issue":"5","published-print":{"date-parts":[[2023,7]]}},"alternative-id":["2449"],"URL":"https:\/\/doi.org\/10.1007\/s11760-022-02449-z","relation":{},"ISSN":["1863-1703","1863-1711"],"issn-type":[{"value":"1863-1703","type":"print"},{"value":"1863-1711","type":"electronic"}],"subject":[],"published":{"date-parts":[[2022,12,22]]},"assertion":[{"value":"14 March 2022","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"17 June 2022","order":2,"name":"revised","label":"Revised","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"13 December 2022","order":3,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"22 December 2022","order":4,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}]}}