{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,5,3]],"date-time":"2025-05-03T04:02:17Z","timestamp":1746244937914,"version":"3.40.4"},"reference-count":66,"publisher":"Springer Science and Business Media LLC","issue":"13","license":[{"start":{"date-parts":[[2024,5,29]],"date-time":"2024-05-29T00:00:00Z","timestamp":1716940800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,5,29]],"date-time":"2024-05-29T00:00:00Z","timestamp":1716940800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimed Tools Appl"],"DOI":"10.1007\/s11042-024-19465-5","type":"journal-article","created":{"date-parts":[[2024,5,29]],"date-time":"2024-05-29T08:03:59Z","timestamp":1716969839000},"page":"12163-12188","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":1,"title":["A multi-level hybrid siamese network using box adaptive and classification approach for robust tracking"],"prefix":"10.1007","volume":"84","author":[{"given":"Sachin Sakthi","family":"K S","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jae Hoon","family":"Jeong","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Young Hoon","family":"Joo","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2024,5,29]]},"reference":[{"issue":"10","key":"19465_CR1","doi-asserted-by":"publisher","first-page":"6642","DOI":"10.1109\/TCSVT.2022.3177320","volume":"32","author":"L Yan","year":"2022","unstructured":"Yan L, Ma S, Wang Q, Chen Y, Zhang X, Savakis A, Liu D (2022) Video captioning using global-local representation. IEEE Trans Circuits Syst Video Technol 32(10):6642\u20136656","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"issue":"1","key":"19465_CR2","doi-asserted-by":"publisher","first-page":"393","DOI":"10.1109\/TCSVT.2022.3202574","volume":"33","author":"L Yan","year":"2022","unstructured":"Yan L, Wang Q, Ma S, Wang J, Yu C (2022) Solve the puzzle of instance segmentation in videos: A weakly supervised framework with spatio-temporal collaboration. IEEE Trans Circuits Syst Video Technol 33(1):393\u2013406","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"19465_CR3","doi-asserted-by":"crossref","unstructured":"Liu D, Cui Y, Tan W, Chen Y (2021) Sg-net: Spatial granularity network for one-stage video instance segmentation. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 9816\u20139825","DOI":"10.1109\/CVPR46437.2021.00969"},{"key":"19465_CR4","doi-asserted-by":"crossref","unstructured":"Cui Y, Yan L, Cao Z, Liu D (2021) Tf-blender: Temporal feature blender for video object detection. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 8138\u20138147","DOI":"10.1109\/ICCV48922.2021.00803"},{"key":"19465_CR5","doi-asserted-by":"crossref","unstructured":"Bolme DS, Beveridge JR, Draper BA, Lui YM (2010) Visual object tracking using adaptive correlation filters. In: 2010 IEEE Computer Society Conference on Computer Vision and Pattern Recognition, pp. 2544\u20132550. IEEE","DOI":"10.1109\/CVPR.2010.5539960"},{"issue":"3","key":"19465_CR6","doi-asserted-by":"publisher","first-page":"583","DOI":"10.1109\/TPAMI.2014.2345390","volume":"37","author":"JF Henriques","year":"2015","unstructured":"Henriques JF, Caseiro R, Martins P, Batista J (2015) High-speed tracking with kernelized correlation filters. IEEE Trans Pattern Anal Mach Intell 37(3):583\u2013596","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"19465_CR7","doi-asserted-by":"crossref","unstructured":"Kiani\u00a0Galoogahi H, Fagg A, Lucey S (2017) Learning background-aware correlation filters for visual tracking. In: Proceedings of the IEEE International Conference on Computer Vision, pp. 1135\u20131143","DOI":"10.1109\/ICCV.2017.129"},{"key":"19465_CR8","doi-asserted-by":"publisher","first-page":"23963","DOI":"10.1007\/s11042-021-10804-4","volume":"80","author":"S Fang","year":"2021","unstructured":"Fang S, Ma Y, Li Z, Zhang B (2021) A visual tracking algorithm via confidence-based multi-feature correlation filtering. Multimedia Tools and Applications. 80:23963\u201323982","journal-title":"Multimedia Tools and Applications."},{"issue":"11","key":"19465_CR9","doi-asserted-by":"publisher","first-page":"5596","DOI":"10.1109\/TIP.2019.2919201","volume":"28","author":"T Xu","year":"2019","unstructured":"Xu T, Feng Z-H, Wu X-J, Kittler J (2019) Learning adaptive discriminative correlation filters via temporal consistency preserving spatial feature selection for robust visual object tracking. IEEE Trans Image Process 28(11):5596\u20135609","journal-title":"IEEE Trans Image Process"},{"key":"19465_CR10","doi-asserted-by":"crossref","unstructured":"Danelljan M, Bhat G, Shahbaz\u00a0Khan F, Felsberg, M (2017) Eco: Efficient convolution operators for tracking. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 6638\u20136646","DOI":"10.1109\/CVPR.2017.733"},{"key":"19465_CR11","doi-asserted-by":"publisher","first-page":"2355","DOI":"10.1007\/s11042-020-09644-5","volume":"80","author":"J Yan","year":"2021","unstructured":"Yan J, Zhong L, Yao Y, Xu X, Du C (2021) Dual-template adaptive correlation filter for real-time object tracking. Multimedia Tools and Applications. 80:2355\u20132376","journal-title":"Multimedia Tools and Applications."},{"key":"19465_CR12","doi-asserted-by":"crossref","unstructured":"Bertinetto L, Valmadre J, Henriques JF, Vedaldi A, Torr PH (2016) Fully-convolutional siamese networks for object tracking. In: Computer Vision\u2013ECCV 2016 Workshops: Amsterdam, The Netherlands, October 8-10 and 15-16, 2016, Proceedings, Part II 14, pp. 850\u2013865. Springer","DOI":"10.1007\/978-3-319-48881-3_56"},{"key":"19465_CR13","doi-asserted-by":"crossref","unstructured":"He A, Luo C, Tian X, Zeng W (2018) A twofold siamese network for real-time object tracking. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 4834\u20134843","DOI":"10.1109\/CVPR.2018.00508"},{"key":"19465_CR14","doi-asserted-by":"crossref","unstructured":"Valmadre J, Bertinetto L, Henriques J, Vedaldi A, Torr PH (2017) End-to-end representation learning for correlation filter based tracking. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 2805\u20132813","DOI":"10.1109\/CVPR.2017.531"},{"key":"19465_CR15","doi-asserted-by":"crossref","unstructured":"Li B, Yan J, Wu W, Zhu Z, Hu X (2018) High performance visual tracking with siamese region proposal network. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 8971\u20138980","DOI":"10.1109\/CVPR.2018.00935"},{"key":"19465_CR16","doi-asserted-by":"crossref","unstructured":"Zhu Z, Wang Q, Li B, Wu W, Yan J, Hu W (2018) Distractor-aware siamese networks for visual object tracking. In: Proceedings of the European Conference on Computer Vision (ECCV), pp. 101\u2013117","DOI":"10.1007\/978-3-030-01240-3_7"},{"key":"19465_CR17","doi-asserted-by":"crossref","unstructured":"Fan H, Ling H (2019) Siamese cascaded region proposal networks for real-time visual tracking. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 7952\u20137961","DOI":"10.1109\/CVPR.2019.00814"},{"key":"19465_CR18","doi-asserted-by":"crossref","unstructured":"Li B, Wu W, Wang Q, Zhang F, Xing J, Yan J (2019) Siamrpn++: Evolution of siamese visual tracking with very deep networks. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 4282\u20134291","DOI":"10.1109\/CVPR.2019.00441"},{"issue":"9","key":"19465_CR19","doi-asserted-by":"publisher","first-page":"1834","DOI":"10.1109\/TPAMI.2014.2388226","volume":"37","author":"Y Wu","year":"2015","unstructured":"Wu Y, Lim J, Yang M-H (2015) Object tracking benchmark. IEEE Trans Pattern Anal Mach Intell 37(9):1834\u20131848","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"19465_CR20","doi-asserted-by":"crossref","unstructured":"Mueller M, Smith N, Ghanem B (2016) A benchmark and simulator for uav tracking. In: Proceedings of the European Conference on Computer Vision (ECCV), pp. 445\u2013461. Springer","DOI":"10.1007\/978-3-319-46448-0_27"},{"issue":"5","key":"19465_CR21","doi-asserted-by":"publisher","first-page":"1562","DOI":"10.1109\/TPAMI.2019.2957464","volume":"43","author":"L Huang","year":"2019","unstructured":"Huang L, Zhao X, Huang K (2019) Got-10k: A large high-diversity benchmark for generic object tracking in the wild. IEEE Trans Pattern Anal Mach Intell 43(5):1562\u20131577","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"19465_CR22","unstructured":"Kristan M, Leonardis A, Matas J, Felsberg M, Pflugfelder R, Cehovin\u00a0Zajc L, Vojir T, Bhat G, Lukezic A, Eldesokey A et\u00a0al (2018) The sixth visual object tracking vot2018 challenge results. In: Proceedings of the European Conference on Computer Vision (ECCV) Workshops, pp. 0\u20130"},{"key":"19465_CR23","doi-asserted-by":"crossref","unstructured":"Kristan M, Matas J, Leonardis A, Felsberg M, Pflugfelder R, Kamarainen J-K, Cehovin\u00a0Zajc L, Drbohlav O, Lukezic A, Berg A et\u00a0al (2019) The seventh visual object tracking vot2019 challenge results. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision Workshops, pp. 0\u20130","DOI":"10.1109\/ICCVW.2019.00276"},{"key":"19465_CR24","doi-asserted-by":"publisher","first-page":"439","DOI":"10.1007\/s11263-020-01387-y","volume":"129","author":"H Fan","year":"2021","unstructured":"Fan H, Bai H, Lin L, Yang F, Chu P, Deng G, Yu S, Harshit Huang M, Liu J et al (2021) Lasot: A high-quality large-scale single object tracking benchmark. Int J Comput Vis 129:439\u2013461","journal-title":"Int J Comput Vis"},{"key":"19465_CR25","doi-asserted-by":"crossref","unstructured":"Bolme, D.S., Beveridge, J.R., Draper, B.A., Lui, Y.M.: Visual object tracking using adaptive correlation filters. In: 2010 IEEE Computer Society Conference on Computer Vision and Pattern Recognition, pp. 2544\u20132550 (2010). IEEE","DOI":"10.1109\/CVPR.2010.5539960"},{"issue":"3","key":"19465_CR26","doi-asserted-by":"publisher","first-page":"583","DOI":"10.1109\/TPAMI.2014.2345390","volume":"37","author":"JF Henriques","year":"2014","unstructured":"Henriques JF, Caseiro R, Martins P, Batista J (2014) High-speed tracking with kernelized correlation filters. IEEE Trans Pattern Anal Mach Intell 37(3):583\u2013596","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"19465_CR27","doi-asserted-by":"publisher","first-page":"15095","DOI":"10.1007\/s11042-018-6562-8","volume":"79","author":"J Zhang","year":"2020","unstructured":"Zhang J, Jin X, Sun J, Wang J, Sangaiah AK (2020) Spatial and semantic convolutional features for robust visual object tracking. Multimedia Tools and Applications. 79:15095\u201315115","journal-title":"Multimedia Tools and Applications."},{"key":"19465_CR28","doi-asserted-by":"crossref","unstructured":"Bertinetto L, Valmadre J, Golodetz S, Miksik O, Torr PH (2016) Staple: Complementary learners for real-time tracking. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 1401\u20131409","DOI":"10.1109\/CVPR.2016.156"},{"issue":"8","key":"19465_CR29","doi-asserted-by":"publisher","first-page":"1561","DOI":"10.1109\/TPAMI.2016.2609928","volume":"39","author":"M Danelljan","year":"2016","unstructured":"Danelljan M, H\u00e4ger G, Khan FS, Felsberg M (2016) Discriminative scale space tracking. IEEE Trans Pattern Anal Mach Intell 39(8):1561\u20131575","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"19465_CR30","doi-asserted-by":"crossref","unstructured":"Li Y, Zhu J (2015) A scale adaptive kernel correlation filter tracker with feature integration. In: Computer Vision-ECCV 2014 Workshops: Zurich, Switzerland, September 6-7 and 12, 2014, Proceedings, Part II 13, pp. 254\u2013265. Springer","DOI":"10.1007\/978-3-319-16181-5_18"},{"key":"19465_CR31","unstructured":"Vaswani, A., Shazeer, N., Parmar, N., Uszkoreit, J., Jones, L., Gomez, A.N., Kaiser, \u0141., Polosukhin, I.: Attention is all you need. Advances in neural information processing systems. 30 (2017)"},{"key":"19465_CR32","doi-asserted-by":"crossref","unstructured":"Chen X, Yan B, Zhu J, Wang D, Yang X, Lu H (2021) Transformer tracking. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 8126\u20138135","DOI":"10.1109\/CVPR46437.2021.00803"},{"key":"19465_CR33","doi-asserted-by":"crossref","unstructured":"Wang N, Zhou W, Wang J, Li H (2021) Transformer meets tracker: Exploiting temporal context for robust visual tracking. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 1571\u20131580","DOI":"10.1109\/CVPR46437.2021.00162"},{"key":"19465_CR34","doi-asserted-by":"crossref","unstructured":"Yan B, Peng H, Fu J, Wang D, Lu H (2021) Learning spatio-temporal transformer for visual tracking. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 10448\u201310457","DOI":"10.1109\/ICCV48922.2021.01028"},{"key":"19465_CR35","doi-asserted-by":"crossref","unstructured":"Chen B, Li P, Bai L, Qiao L, Shen Q, Li B, Gan W, Wu W, Ouyang W (2022) Backbone is all your need: A simplified architecture for visual object tracking. In: European Conference on Computer Vision, pp. 375\u2013392. Springer","DOI":"10.1007\/978-3-031-20047-2_22"},{"key":"19465_CR36","doi-asserted-by":"crossref","unstructured":"Gao S, Zhou C, Ma C, Wang X, Yuan J (2022) Aiatrack: Attention in attention for transformer visual tracking. In: European Conference on Computer Vision, pp. 146\u2013164. Springer","DOI":"10.1007\/978-3-031-20047-2_9"},{"key":"19465_CR37","doi-asserted-by":"crossref","unstructured":"Cui Y, Jiang C, Wang L, Wu G (2022) Mixformer: End-to-end tracking with iterative mixed attention. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 13608\u201313618","DOI":"10.1109\/CVPR52688.2022.01324"},{"key":"19465_CR38","doi-asserted-by":"crossref","unstructured":"Guo Q, Feng W, Zhou C, Huang R, Wan L, Wang S (2017) Learning dynamic siamese network for visual object tracking. In: Proceedings of the IEEE International Conference on Computer Vision, pp. 1763\u20131771","DOI":"10.1109\/ICCV.2017.196"},{"key":"19465_CR39","doi-asserted-by":"publisher","first-page":"15469","DOI":"10.1007\/s11042-021-10574-z","volume":"80","author":"J Zhu","year":"2021","unstructured":"Zhu J, Zhang G, Zhou S, Li K (2021) Relation-aware siamese region proposal network for visual object tracking. Multimedia Tools and Applications. 80:15469\u201315485","journal-title":"Multimedia Tools and Applications."},{"key":"19465_CR40","doi-asserted-by":"crossref","unstructured":"Wang Q, Teng Z, Xing J, Gao J, Hu W, Maybank S (2018) Learning attentions: residual attentional siamese network for high performance online visual tracking. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 4854\u20134863","DOI":"10.1109\/CVPR.2018.00510"},{"key":"19465_CR41","doi-asserted-by":"crossref","unstructured":"Wang G, Luo C, Xiong Z, Zeng W (2019) Spm-tracker: Series-parallel matching for real-time visual object tracking. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 3643\u20133652","DOI":"10.1109\/CVPR.2019.00376"},{"key":"19465_CR42","doi-asserted-by":"crossref","unstructured":"Wang Q, Zhang L, Bertinetto L, Hu W, Torr PH (2019) Fast online object tracking and segmentation: A unifying approach. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 1328\u20131338","DOI":"10.1109\/CVPR.2019.00142"},{"key":"19465_CR43","doi-asserted-by":"crossref","unstructured":"Zhang Z, Peng H (2019) Deeper and wider siamese networks for real-time visual tracking. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 4591\u20134600","DOI":"10.1109\/CVPR.2019.00472"},{"key":"19465_CR44","doi-asserted-by":"crossref","unstructured":"Law H, Deng J (2018) Cornernet: Detecting objects as paired keypoints. In: Proceedings of the European Conference on Computer Vision (ECCV), pp. 734\u2013750","DOI":"10.1007\/978-3-030-01264-9_45"},{"key":"19465_CR45","doi-asserted-by":"crossref","unstructured":"Yang Z, Liu S, Hu H, Wang L, Lin S (2019) Reppoints: Point set representation for object detection. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 9657\u20139666","DOI":"10.1109\/ICCV.2019.00975"},{"key":"19465_CR46","doi-asserted-by":"crossref","unstructured":"Zhu C, He Y, Savvides M (2019) Feature selective anchor-free module for single-shot object detection. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 840\u2013849","DOI":"10.1109\/CVPR.2019.00093"},{"issue":"11","key":"19465_CR47","doi-asserted-by":"publisher","first-page":"2709","DOI":"10.1109\/TPAMI.2018.2865311","volume":"41","author":"C Ma","year":"2018","unstructured":"Ma C, Huang J-B, Yang X, Yang M-H (2018) Robust visual tracking via hierarchical convolutional features. IEEE Trans Pattern Anal Mach Intell 41(11):2709\u20132723","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"19465_CR48","doi-asserted-by":"crossref","unstructured":"Yu J, Jiang Y, Wang Z, Cao Z, Huang T (2016) Unitbox: An advanced object detection network. In: Proceedings of the 24th ACM International Conference on Multimedia, pp. 516\u2013520","DOI":"10.1145\/2964284.2967274"},{"key":"19465_CR49","doi-asserted-by":"crossref","unstructured":"Tian Z, Shen C, Chen H, He T (2019) Fcos: Fully convolutional one-stage object detection. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 9627\u20139636","DOI":"10.1109\/ICCV.2019.00972"},{"key":"19465_CR50","doi-asserted-by":"publisher","first-page":"211","DOI":"10.1007\/s11263-015-0816-y","volume":"115","author":"O Russakovsky","year":"2015","unstructured":"Russakovsky O, Deng J, Su H, Krause J, Satheesh S, Ma S, Huang Z, Karpathy A, Khosla A, Bernstein M et al (2015) Imagenet large scale visual recognition challenge. Int J Comput Vision 115:211\u2013252","journal-title":"Int J Comput Vision"},{"key":"19465_CR51","doi-asserted-by":"crossref","unstructured":"Real E, Shlens J, Mazzocchi S, Pan X, Vanhoucke V (2017) Youtube-boundingboxes: A large high-precision human-annotated data set for object detection in video. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 5296\u20135305","DOI":"10.1109\/CVPR.2017.789"},{"key":"19465_CR52","doi-asserted-by":"crossref","unstructured":"Lin T-Y, Maire M, Belongie S, Hays J, Perona P, Ramanan D, Doll\u00e1r P, Zitnick CL (2014) Microsoft coco: Common objects in context. In: Computer Vision\u2013ECCV 2014: 13th European Conference, Zurich, Switzerland, September 6-12, 2014, Proceedings, Part V 13, pp. 740\u2013755. Springer","DOI":"10.1007\/978-3-319-10602-1_48"},{"issue":"2","key":"19465_CR53","doi-asserted-by":"publisher","first-page":"98","DOI":"10.1007\/s11063-024-11556-6","volume":"56","author":"Z Xin","year":"2024","unstructured":"Xin Z, Yu J, He X, Song Y, Li H (2024) Siamraan: Siamese residual attentional aggregation network for visual object tracking. Neural Process Lett 56(2):98","journal-title":"Neural Process Lett"},{"key":"19465_CR54","doi-asserted-by":"crossref","unstructured":"Liu J, Wang H, Ma C, Su Y, Yang X (2024) Siamdmu: Siamese dual mask update network for visual object tracking. IEEE Transactions on Emerging Topics in Computational Intelligence","DOI":"10.1109\/TETCI.2024.3353674"},{"key":"19465_CR55","doi-asserted-by":"crossref","unstructured":"Cao Z, Huang Z, Pan L, Zhang S, Liu Z, Fu C (2023) Towards real-world visual tracking with temporal contexts. IEEE Transactions on Pattern Analysis and Machine Intelligence","DOI":"10.1109\/TPAMI.2023.3307174"},{"key":"19465_CR56","doi-asserted-by":"publisher","DOI":"10.1016\/j.eswa.2023.121651","volume":"238","author":"X Li","year":"2024","unstructured":"Li X, Wei G, Jiang M, Zhou W (2024) Hierarchical siamese network for real-time visual tracking. Expert Syst Appl 238:121651","journal-title":"Expert Syst Appl"},{"key":"19465_CR57","doi-asserted-by":"crossref","unstructured":"Danelljan M, Bhat G, Khan FS, Felsberg M (2019) Atom: Accurate tracking by overlap maximization. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 4660\u20134669","DOI":"10.1109\/CVPR.2019.00479"},{"key":"19465_CR58","doi-asserted-by":"publisher","first-page":"12549","DOI":"10.1609\/aaai.v34i07.6944","volume":"34","author":"Y Xu","year":"2020","unstructured":"Xu Y, Wang Z, Li Z, Yuan Y, Yu G (2020) Siamfc++: Towards robust and accurate visual tracking with target estimation guidelines. Proceedings of the AAAI Conference on Artificial Intelligence 34:12549\u201312556","journal-title":"Proceedings of the AAAI Conference on Artificial Intelligence"},{"key":"19465_CR59","doi-asserted-by":"crossref","unstructured":"Nam H, Han B (2016) Learning multi-domain convolutional neural networks for visual tracking. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 4293\u20134302","DOI":"10.1109\/CVPR.2016.465"},{"key":"19465_CR60","doi-asserted-by":"crossref","unstructured":"Danelljan M, Hager G, Shahbaz\u00a0Khan F, Felsberg M (2015) Learning spatially regularized correlation filters for visual tracking. In: Proceedings of the IEEE International Conference on Computer Vision, pp. 4310\u20134318","DOI":"10.1109\/ICCV.2015.490"},{"key":"19465_CR61","doi-asserted-by":"crossref","unstructured":"Li F, Tian C, Zuo W, Zhang L, Yang M-H (2018) Learning spatial-temporal regularized correlation filters for visual tracking. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 4904\u20134913","DOI":"10.1109\/CVPR.2018.00515"},{"key":"19465_CR62","doi-asserted-by":"crossref","unstructured":"Held D, Thrun S, Savarese S (2016) Learning to track at 100 fps with deep regression networks. In: Computer Vision\u2013ECCV 2016: 14th European Conference, Amsterdam, The Netherlands, October 11\u201314, 2016, Proceedings, Part I 14, pp. 749\u2013765 . Springer","DOI":"10.1007\/978-3-319-46448-0_45"},{"key":"19465_CR63","doi-asserted-by":"crossref","unstructured":"Henriques JF, Caseiro R, Martins P, Batista J (2012) Exploiting the circulant structure of tracking-by-detection with kernels. In: Proceedings of the European Conference on Computer Vision (ECCV), pp. 702\u2013715. Springer","DOI":"10.1007\/978-3-642-33765-9_50"},{"key":"19465_CR64","doi-asserted-by":"crossref","unstructured":"Danelljan M, Robinson A, Shahbaz\u00a0Khan F, Felsberg M (2016) Beyond correlation filters: Learning continuous convolution operators for visual tracking. In: Computer Vision\u2013ECCV 2016: 14th European Conference, Amsterdam, The Netherlands, October 11-14, 2016, Proceedings, Part V 14, pp. 472\u2013488. Springer","DOI":"10.1007\/978-3-319-46454-1_29"},{"key":"19465_CR65","doi-asserted-by":"publisher","first-page":"6101","DOI":"10.1609\/aaai.v35i7.16760","volume":"35","author":"D Liu","year":"2021","unstructured":"Liu D, Cui Y, Yan L, Mousas C, Yang B, Chen Y (2021) Densernet: Weakly supervised visual localization using multi-scale feature aggregation. Proceedings of the AAAI Conference on Artificial Intelligence 35:6101\u20136109","journal-title":"Proceedings of the AAAI Conference on Artificial Intelligence"},{"key":"19465_CR66","unstructured":"Cui Y, Han C, Liu D (2023) Cml-mots: Collaborative multi-task learning for multi-object tracking and segmentation. arXiv preprint arXiv:2311.00987"}],"container-title":["Multimedia Tools and Applications"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-024-19465-5.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11042-024-19465-5\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-024-19465-5.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,5,2]],"date-time":"2025-05-02T03:26:36Z","timestamp":1746156396000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11042-024-19465-5"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,5,29]]},"references-count":66,"journal-issue":{"issue":"13","published-online":{"date-parts":[[2025,4]]}},"alternative-id":["19465"],"URL":"https:\/\/doi.org\/10.1007\/s11042-024-19465-5","relation":{},"ISSN":["1573-7721"],"issn-type":[{"type":"electronic","value":"1573-7721"}],"subject":[],"published":{"date-parts":[[2024,5,29]]},"assertion":[{"value":"21 February 2024","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"3 May 2024","order":2,"name":"revised","label":"Revised","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"19 May 2024","order":3,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"29 May 2024","order":4,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The author declares that they have no conflict of interest.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}}]}}