{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,14]],"date-time":"2026-05-14T23:09:22Z","timestamp":1778800162659,"version":"3.51.4"},"reference-count":63,"publisher":"Elsevier BV","license":[{"start":{"date-parts":[[2026,5,1]],"date-time":"2026-05-01T00:00:00Z","timestamp":1777593600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/tdm\/userlicense\/1.0\/"},{"start":{"date-parts":[[2026,5,1]],"date-time":"2026-05-01T00:00:00Z","timestamp":1777593600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/legal\/tdmrep-license"},{"start":{"date-parts":[[2026,5,1]],"date-time":"2026-05-01T00:00:00Z","timestamp":1777593600000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-017"},{"start":{"date-parts":[[2026,5,1]],"date-time":"2026-05-01T00:00:00Z","timestamp":1777593600000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"},{"start":{"date-parts":[[2026,5,1]],"date-time":"2026-05-01T00:00:00Z","timestamp":1777593600000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-012"},{"start":{"date-parts":[[2026,5,1]],"date-time":"2026-05-01T00:00:00Z","timestamp":1777593600000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2026,5,1]],"date-time":"2026-05-01T00:00:00Z","timestamp":1777593600000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-004"}],"funder":[{"DOI":"10.13039\/501100002701","name":"Ministry of Education","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100002701","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100003725","name":"National Research Foundation of Korea","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100003725","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["elsevier.com","sciencedirect.com"],"crossmark-restriction":true},"short-container-title":["Computer Vision and Image Understanding"],"published-print":{"date-parts":[[2026,5]]},"DOI":"10.1016\/j.cviu.2026.104785","type":"journal-article","created":{"date-parts":[[2026,4,25]],"date-time":"2026-04-25T15:43:00Z","timestamp":1777131780000},"page":"104785","update-policy":"https:\/\/doi.org\/10.1016\/elsevier_cm_policy","source":"Crossref","is-referenced-by-count":0,"special_numbering":"C","title":["Enhancing feature representation in Siamese networks for object tracking with ranking-based loss"],"prefix":"10.1016","volume":"268","author":[{"given":"Sachin Sakthi","family":"K.S.","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Young Hoon","family":"Joo","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jae Hoon","family":"Jeong","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"78","reference":[{"key":"10.1016\/j.cviu.2026.104785_b1","series-title":"Computer Vision\u2013ECCV 2016 Workshops: Amsterdam, the Netherlands, October 8-10 and 15-16, 2016, Proceedings, Part II 14","first-page":"850","article-title":"Fully-convolutional Siamese networks for object tracking","author":"Bertinetto","year":"2016"},{"key":"10.1016\/j.cviu.2026.104785_b2","series-title":"2010 IEEE Computer Society Conference on Computer Vision and Pattern Recognition","first-page":"2544","article-title":"Visual object tracking using adaptive correlation filters","author":"Bolme","year":"2010"},{"key":"10.1016\/j.cviu.2026.104785_b3","doi-asserted-by":"crossref","unstructured":"Cai,\u00a0W., Liu,\u00a0Q., Wang,\u00a0Y., 2024. Hiptrack: Visual tracking with historical prompts. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition. pp. 19258\u201319267.","DOI":"10.1109\/CVPR52733.2024.01822"},{"key":"10.1016\/j.cviu.2026.104785_b4","doi-asserted-by":"crossref","unstructured":"Cao,\u00a0Z., Fu,\u00a0C., Ye,\u00a0J., Li,\u00a0B., Li,\u00a0Y., 2021. Hift: Hierarchical feature transformer for aerial tracking. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision. pp. 15457\u201315466.","DOI":"10.1109\/ICCV48922.2021.01517"},{"key":"10.1016\/j.cviu.2026.104785_b5","doi-asserted-by":"crossref","DOI":"10.1109\/TPAMI.2023.3307174","article-title":"Towards real-world visual tracking with temporal contexts","author":"Cao","year":"2023","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"10.1016\/j.cviu.2026.104785_b6","article-title":"Transformer tracking with high-low frequency attention","author":"Chen","year":"2025","journal-title":"Comput. Vis. Image Underst."},{"issue":"4","key":"10.1016\/j.cviu.2026.104785_b7","first-page":"5158","article-title":"SiamBAN: Target-aware tracking with Siamese box adaptive network","volume":"45","author":"Chen","year":"2022","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"10.1016\/j.cviu.2026.104785_b8","first-page":"1","article-title":"Joint classification and regression for visual tracking with fully convolutional Siamese networks","author":"Cui","year":"2022","journal-title":"Int. J. Comput. Vis."},{"key":"10.1016\/j.cviu.2026.104785_b9","doi-asserted-by":"crossref","unstructured":"Danelljan,\u00a0M., Bhat,\u00a0G., Khan,\u00a0F.S., Felsberg,\u00a0M., 2019. Atom: Accurate tracking by overlap maximization. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition. pp. 4660\u20134669.","DOI":"10.1109\/CVPR.2019.00479"},{"key":"10.1016\/j.cviu.2026.104785_b10","doi-asserted-by":"crossref","unstructured":"Danelljan,\u00a0M., Bhat,\u00a0G., Shahbaz\u00a0Khan,\u00a0F., Felsberg,\u00a0M., 2017. Eco: Efficient convolution operators for tracking. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition. pp. 6638\u20136646.","DOI":"10.1109\/CVPR.2017.733"},{"issue":"8","key":"10.1016\/j.cviu.2026.104785_b11","doi-asserted-by":"crossref","first-page":"1561","DOI":"10.1109\/TPAMI.2016.2609928","article-title":"Discriminative scale space tracking","volume":"39","author":"Danelljan","year":"2016","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"10.1016\/j.cviu.2026.104785_b12","doi-asserted-by":"crossref","unstructured":"Danelljan,\u00a0M., Hager,\u00a0G., Shahbaz\u00a0Khan,\u00a0F., Felsberg,\u00a0M., 2015. Learning spatially regularized correlation filters for visual tracking. In: Proceedings of the IEEE International Conference on Computer Vision. pp. 4310\u20134318.","DOI":"10.1109\/ICCV.2015.490"},{"key":"10.1016\/j.cviu.2026.104785_b13","doi-asserted-by":"crossref","unstructured":"Dong,\u00a0X., Shen,\u00a0J., 2018. Triplet loss in Siamese network for object tracking. In: Proceedings of the European Conference on Computer Vision. ECCV, pp. 459\u2013474.","DOI":"10.1007\/978-3-030-01261-8_28"},{"issue":"7","key":"10.1016\/j.cviu.2026.104785_b14","first-page":"8049","article-title":"Adaptive Siamese tracking with a compact latent network","volume":"45","author":"Dong","year":"2022","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"5","key":"10.1016\/j.cviu.2026.104785_b15","doi-asserted-by":"crossref","first-page":"1515","DOI":"10.1109\/TPAMI.2019.2956703","article-title":"Dynamical hyperparameter optimization via deep reinforcement learning in tracking","volume":"43","author":"Dong","year":"2019","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"4","key":"10.1016\/j.cviu.2026.104785_b16","doi-asserted-by":"crossref","first-page":"763","DOI":"10.1109\/TMM.2016.2631884","article-title":"Occlusion-aware real-time object tracking","volume":"19","author":"Dong","year":"2016","journal-title":"IEEE Trans. Multimed."},{"key":"10.1016\/j.cviu.2026.104785_b17","doi-asserted-by":"crossref","first-page":"439","DOI":"10.1007\/s11263-020-01387-y","article-title":"Lasot: A high-quality large-scale single object tracking benchmark","volume":"129","author":"Fan","year":"2021","journal-title":"Int. J. Comput. Vis."},{"key":"10.1016\/j.cviu.2026.104785_b18","doi-asserted-by":"crossref","unstructured":"Fan,\u00a0H., Ling,\u00a0H., 2019. Siamese cascaded region proposal networks for real-time visual tracking. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition. pp. 7952\u20137961.","DOI":"10.1109\/CVPR.2019.00814"},{"key":"10.1016\/j.cviu.2026.104785_b19","doi-asserted-by":"crossref","unstructured":"Guo,\u00a0Q., Feng,\u00a0W., Zhou,\u00a0C., Huang,\u00a0R., Wan,\u00a0L., Wang,\u00a0S., 2017. Learning dynamic Siamese network for visual object tracking. In: Proceedings of the IEEE International Conference on Computer Vision. pp. 1763\u20131771.","DOI":"10.1109\/ICCV.2017.196"},{"key":"10.1016\/j.cviu.2026.104785_b20","doi-asserted-by":"crossref","unstructured":"Guo,\u00a0D., Shao,\u00a0Y., Cui,\u00a0Y., Wang,\u00a0Z., Zhang,\u00a0L., Shen,\u00a0C., 2021. Graph attention tracking. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition. pp. 9543\u20139552.","DOI":"10.1109\/CVPR46437.2021.00942"},{"key":"10.1016\/j.cviu.2026.104785_b21","doi-asserted-by":"crossref","unstructured":"Han,\u00a0W., Dong,\u00a0X., Khan,\u00a0F.S., Shao,\u00a0L., Shen,\u00a0J., 2021. Learning to fuse asymmetric feature maps in Siamese trackers. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition. pp. 16570\u201316580.","DOI":"10.1109\/CVPR46437.2021.01630"},{"issue":"11","key":"10.1016\/j.cviu.2026.104785_b22","doi-asserted-by":"crossref","first-page":"7363","DOI":"10.1109\/TPAMI.2024.3400873","article-title":"Asymmetric convolution: An efficient and generalized method to fuse feature maps in multiple vision tasks","volume":"46","author":"Han","year":"2024","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"1","key":"10.1016\/j.cviu.2026.104785_b23","doi-asserted-by":"crossref","first-page":"87","DOI":"10.1109\/TPAMI.2022.3152247","article-title":"A survey on vision transformer","volume":"45","author":"Han","year":"2023","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"3","key":"10.1016\/j.cviu.2026.104785_b24","doi-asserted-by":"crossref","first-page":"583","DOI":"10.1109\/TPAMI.2014.2345390","article-title":"High-speed tracking with kernelized correlation filters","volume":"37","author":"Henriques","year":"2014","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"3","key":"10.1016\/j.cviu.2026.104785_b25","doi-asserted-by":"crossref","first-page":"583","DOI":"10.1109\/TPAMI.2014.2345390","article-title":"High-speed tracking with kernelized correlation filters","volume":"37","author":"Henriques","year":"2015","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"10.1016\/j.cviu.2026.104785_b26","article-title":"Flexible dual-branch Siamese network: Learning location quality estimation and regression distribution for visual tracking","author":"Hu","year":"2023","journal-title":"IEEE Trans. Comput. Soc. Syst."},{"issue":"5","key":"10.1016\/j.cviu.2026.104785_b27","doi-asserted-by":"crossref","first-page":"1562","DOI":"10.1109\/TPAMI.2019.2957464","article-title":"Got-10k: A large high-diversity benchmark for generic object tracking in the wild","volume":"43","author":"Huang","year":"2019","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"10.1016\/j.cviu.2026.104785_b28","doi-asserted-by":"crossref","unstructured":"Kiani\u00a0Galoogahi,\u00a0H., Fagg,\u00a0A., Lucey,\u00a0S., 2017. Learning background-aware correlation filters for visual tracking. In: Proceedings of the IEEE International Conference on Computer Vision. pp. 1135\u20131143.","DOI":"10.1109\/ICCV.2017.129"},{"key":"10.1016\/j.cviu.2026.104785_b29","unstructured":"Kristan,\u00a0M., Leonardis,\u00a0A., Matas,\u00a0J., Felsberg,\u00a0M., Pflugfelder,\u00a0R., \u010cehovin\u00a0Zajc,\u00a0L., Vojir,\u00a0T., Bhat,\u00a0G., Lukezic,\u00a0A., Eldesokey,\u00a0A., et al., 2018. The sixth visual object tracking vot2018 challenge results. In: Proceedings of the European Conference on Computer Vision (ECCV) Workshops."},{"key":"10.1016\/j.cviu.2026.104785_b30","unstructured":"Kristan,\u00a0M., Matas,\u00a0J., Leonardis,\u00a0A., Felsberg,\u00a0M., Pflugfelder,\u00a0R., Kamarainen,\u00a0J.-K., \u010cehovin\u00a0Zajc,\u00a0L., Drbohlav,\u00a0O., Lukezic,\u00a0A., Berg,\u00a0A., et al., 2019. The seventh visual object tracking vot2019 challenge results. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision Workshops."},{"key":"10.1016\/j.cviu.2026.104785_b31","first-page":"1","article-title":"A multi-level hybrid Siamese network using box adaptive and classification approach for robust tracking","author":"KS","year":"2024","journal-title":"Multimedia Tools Appl."},{"key":"10.1016\/j.cviu.2026.104785_b32","doi-asserted-by":"crossref","unstructured":"Li,\u00a0X., Huang,\u00a0Y., He,\u00a0Z., Wang,\u00a0Y., Lu,\u00a0H., Yang,\u00a0M.-H., 2023. Citetracker: Correlating image and text for visual tracking. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision. pp. 9974\u20139983.","DOI":"10.1109\/ICCV51070.2023.00915"},{"key":"10.1016\/j.cviu.2026.104785_b33","article-title":"Hierarchical Siamese network for real-time visual tracking","volume":"238","author":"Li","year":"2024","journal-title":"Expert Syst. Appl."},{"key":"10.1016\/j.cviu.2026.104785_b34","doi-asserted-by":"crossref","unstructured":"Li,\u00a0B., Wu,\u00a0W., Wang,\u00a0Q., Zhang,\u00a0F., Xing,\u00a0J., Yan,\u00a0J., 2019. Siamrpn++: Evolution of Siamese visual tracking with very deep networks. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition. pp. 4282\u20134291.","DOI":"10.1109\/CVPR.2019.00441"},{"key":"10.1016\/j.cviu.2026.104785_b35","doi-asserted-by":"crossref","unstructured":"Li,\u00a0B., Yan,\u00a0J., Wu,\u00a0W., Zhu,\u00a0Z., Hu,\u00a0X., 2018. High performance visual tracking with Siamese region proposal network. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition. pp. 8971\u20138980.","DOI":"10.1109\/CVPR.2018.00935"},{"key":"10.1016\/j.cviu.2026.104785_b36","doi-asserted-by":"crossref","unstructured":"Lin,\u00a0T.-Y., Doll\u00e1r,\u00a0P., Girshick,\u00a0R., He,\u00a0K., Hariharan,\u00a0B., Belongie,\u00a0S., 2017. Feature pyramid networks for object detection. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition. pp. 2117\u20132125.","DOI":"10.1109\/CVPR.2017.106"},{"key":"10.1016\/j.cviu.2026.104785_b37","series-title":"Computer Vision\u2013ECCV 2014: 13th European Conference, Zurich, Switzerland, September 6-12, 2014, Proceedings, Part V 13","first-page":"740","article-title":"Microsoft coco: Common objects in context","author":"Lin","year":"2014"},{"key":"10.1016\/j.cviu.2026.104785_b38","article-title":"SiamDMU: Siamese dual mask update network for visual object tracking","author":"Liu","year":"2024","journal-title":"IEEE Trans. Emerg. Top. Comput. Intell."},{"key":"10.1016\/j.cviu.2026.104785_b39","article-title":"Distractor suppression Siamese network with task-aware attention for visual tracking","author":"Liu","year":"2025","journal-title":"Comput. Vis. Image Underst."},{"key":"10.1016\/j.cviu.2026.104785_b40","series-title":"Proceedings of the European Conference on Computer Vision","first-page":"445","article-title":"A benchmark and simulator for uav tracking","author":"Mueller","year":"2016"},{"key":"10.1016\/j.cviu.2026.104785_b41","series-title":"Cross-modality fusion transformer for multispectral object detection","author":"Qingyun","year":"2021"},{"key":"10.1016\/j.cviu.2026.104785_b42","doi-asserted-by":"crossref","unstructured":"Real,\u00a0E., Shlens,\u00a0J., Mazzocchi,\u00a0S., Pan,\u00a0X., Vanhoucke,\u00a0V., 2017. Youtube-boundingboxes: A large high-precision human-annotated data set for object detection in video. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition. pp. 5296\u20135305.","DOI":"10.1109\/CVPR.2017.789"},{"key":"10.1016\/j.cviu.2026.104785_b43","doi-asserted-by":"crossref","first-page":"211","DOI":"10.1007\/s11263-015-0816-y","article-title":"Imagenet large scale visual recognition challenge","volume":"115","author":"Russakovsky","year":"2015","journal-title":"Int. J. Comput. Vis."},{"key":"10.1016\/j.cviu.2026.104785_b44","article-title":"Keypoint prediction enhanced Siamese networks with attention for accurate visual object tracking","volume":"268","author":"Sachin Sakthi","year":"2025","journal-title":"Expert Syst. Appl."},{"issue":"12","key":"10.1016\/j.cviu.2026.104785_b45","doi-asserted-by":"crossref","first-page":"8896","DOI":"10.1109\/TPAMI.2021.3127492","article-title":"Distilled Siamese networks for visual tracking","volume":"44","author":"Shen","year":"2021","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"10.1016\/j.cviu.2026.104785_b46","doi-asserted-by":"crossref","unstructured":"Song,\u00a0Z., Luo,\u00a0R., Yu,\u00a0J., Chen,\u00a0Y.-P.P., Yang,\u00a0W., 2023. Compact transformer tracker with correlative masked modeling. In: Proceedings of the AAAI Conference on Artificial Intelligence. vol. 37, pp. 2321\u20132329.","DOI":"10.1609\/aaai.v37i2.25327"},{"key":"10.1016\/j.cviu.2026.104785_b47","doi-asserted-by":"crossref","unstructured":"Sun,\u00a0C., Wang,\u00a0D., Lu,\u00a0H., Yang,\u00a0M.-H., 2018. Learning spatial-aware regressions for visual tracking. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition. pp. 8962\u20138970.","DOI":"10.1109\/CVPR.2018.00934"},{"key":"10.1016\/j.cviu.2026.104785_b48","doi-asserted-by":"crossref","unstructured":"Tang,\u00a0F., Ling,\u00a0Q., 2022. Ranking-based Siamese visual tracking. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition. pp. 8741\u20138750.","DOI":"10.1109\/CVPR52688.2022.00854"},{"key":"10.1016\/j.cviu.2026.104785_b49","article-title":"Attention is all you need","volume":"30","author":"Vaswani","year":"2017","journal-title":"Adv. Neural Inf. Process. Syst."},{"issue":"23","key":"10.1016\/j.cviu.2026.104785_b50","doi-asserted-by":"crossref","first-page":"12712","DOI":"10.3390\/app132312712","article-title":"Transformer-based visual object tracking with global feature enhancement","volume":"13","author":"Wang","year":"2023","journal-title":"Appl. Sci."},{"key":"10.1016\/j.cviu.2026.104785_b51","doi-asserted-by":"crossref","unstructured":"Wang,\u00a0Q., Zhang,\u00a0L., Bertinetto,\u00a0L., Hu,\u00a0W., Torr,\u00a0P.H., 2019. Fast online object tracking and segmentation: A unifying approach. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition. pp. 1328\u20131338.","DOI":"10.1109\/CVPR.2019.00142"},{"issue":"9","key":"10.1016\/j.cviu.2026.104785_b52","doi-asserted-by":"crossref","first-page":"1834","DOI":"10.1109\/TPAMI.2014.2388226","article-title":"Object tracking benchmark","volume":"37","author":"Wu","year":"2015","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"2","key":"10.1016\/j.cviu.2026.104785_b53","doi-asserted-by":"crossref","first-page":"98","DOI":"10.1007\/s11063-024-11556-6","article-title":"SiamRAAN: Siamese residual attentional aggregation network for visual object tracking","volume":"56","author":"Xin","year":"2024","journal-title":"Neural Process. Lett."},{"key":"10.1016\/j.cviu.2026.104785_b54","doi-asserted-by":"crossref","DOI":"10.1016\/j.cviu.2024.104203","article-title":"An end-to-end tracking framework via multi-view and temporal feature aggregation","author":"Yang","year":"2024","journal-title":"Comput. Vis. Image Underst."},{"key":"10.1016\/j.cviu.2026.104785_b55","doi-asserted-by":"crossref","DOI":"10.1016\/j.knosys.2020.105697","article-title":"Robust visual tracking with correlation filters and metric learning","volume":"195","author":"Yuan","year":"2020","journal-title":"Knowl.-Based Syst."},{"key":"10.1016\/j.cviu.2026.104785_b56","doi-asserted-by":"crossref","DOI":"10.1016\/j.cviu.2024.104125","article-title":"Spatial attention inference model for cascaded Siamese tracking with dynamic residual update strategy","volume":"248","author":"Zhang","year":"2024","journal-title":"Comput. Vis. Image Underst."},{"key":"10.1016\/j.cviu.2026.104785_b57","doi-asserted-by":"crossref","unstructured":"Zhang,\u00a0Z., Peng,\u00a0H., 2019. Deeper and wider Siamese networks for real-time visual tracking. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition. pp. 4591\u20134600.","DOI":"10.1109\/CVPR.2019.00472"},{"key":"10.1016\/j.cviu.2026.104785_b58","series-title":"Computer Vision\u2013ECCV 2020: 16th European Conference, Glasgow, UK, August 23\u201328, 2020, Proceedings, Part XXI 16","first-page":"771","article-title":"Ocean: Object-aware anchor-free tracking","author":"Zhang","year":"2020"},{"key":"10.1016\/j.cviu.2026.104785_b59","doi-asserted-by":"crossref","DOI":"10.1016\/j.dsp.2024.104491","article-title":"Global semantic-guided graph attention network for Siamese tracking with ranking loss","volume":"149","author":"Zhang","year":"2024","journal-title":"Digit. Signal Process."},{"key":"10.1016\/j.cviu.2026.104785_b60","doi-asserted-by":"crossref","DOI":"10.1016\/j.patcog.2020.107679","article-title":"Adaptive feature fusion for visual object tracking","volume":"111","author":"Zhao","year":"2021","journal-title":"Pattern Recognit."},{"key":"10.1016\/j.cviu.2026.104785_b61","doi-asserted-by":"crossref","first-page":"544","DOI":"10.1016\/j.neucom.2021.05.111","article-title":"IoU-guided Siamese region proposal network for real-time visual tracking","volume":"462","author":"Zhou","year":"2021","journal-title":"Neurocomputing"},{"key":"10.1016\/j.cviu.2026.104785_b62","series-title":"2022 22nd IEEE International Symposium on Cluster, Cloud and Internet Computing","first-page":"307","article-title":"Adaptive multi-feature fusion visual target tracking based on Siamese neural network with cross-attention mechanism","author":"Zhou","year":"2022"},{"key":"10.1016\/j.cviu.2026.104785_b63","doi-asserted-by":"crossref","unstructured":"Zhu,\u00a0Z., Wang,\u00a0Q., Li,\u00a0B., Wu,\u00a0W., Yan,\u00a0J., Hu,\u00a0W., 2018. Distractor-aware Siamese networks for visual object tracking. In: Proceedings of the European Conference on Computer Vision. ECCV, pp. 101\u2013117.","DOI":"10.1007\/978-3-030-01240-3_7"}],"container-title":["Computer Vision and Image Understanding"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S1077314226001529?httpAccept=text\/xml","content-type":"text\/xml","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S1077314226001529?httpAccept=text\/plain","content-type":"text\/plain","content-version":"vor","intended-application":"text-mining"}],"deposited":{"date-parts":[[2026,5,14]],"date-time":"2026-05-14T22:33:59Z","timestamp":1778798039000},"score":1,"resource":{"primary":{"URL":"https:\/\/linkinghub.elsevier.com\/retrieve\/pii\/S1077314226001529"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,5]]},"references-count":63,"alternative-id":["S1077314226001529"],"URL":"https:\/\/doi.org\/10.1016\/j.cviu.2026.104785","relation":{},"ISSN":["1077-3142"],"issn-type":[{"value":"1077-3142","type":"print"}],"subject":[],"published":{"date-parts":[[2026,5]]},"assertion":[{"value":"Elsevier","name":"publisher","label":"This article is maintained by"},{"value":"Enhancing feature representation in Siamese networks for object tracking with ranking-based loss","name":"articletitle","label":"Article Title"},{"value":"Computer Vision and Image Understanding","name":"journaltitle","label":"Journal Title"},{"value":"https:\/\/doi.org\/10.1016\/j.cviu.2026.104785","name":"articlelink","label":"CrossRef DOI link to publisher maintained version"},{"value":"article","name":"content_type","label":"Content Type"},{"value":"\u00a9 2026 Elsevier Inc. All rights are reserved, including those for text and data mining, AI training, and similar technologies.","name":"copyright","label":"Copyright"}],"article-number":"104785"}}