{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,2]],"date-time":"2026-07-02T14:16:32Z","timestamp":1783001792600,"version":"3.54.5"},"publisher-location":"Cham","reference-count":39,"publisher":"Springer International Publishing","isbn-type":[{"value":"9783319464473","type":"print"},{"value":"9783319464480","type":"electronic"}],"license":[{"start":{"date-parts":[[2016,1,1]],"date-time":"2016-01-01T00:00:00Z","timestamp":1451606400000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"},{"start":{"date-parts":[[2016,1,1]],"date-time":"2016-01-01T00:00:00Z","timestamp":1451606400000},"content-version":"vor","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2016]]},"DOI":"10.1007\/978-3-319-46448-0_45","type":"book-chapter","created":{"date-parts":[[2016,9,16]],"date-time":"2016-09-16T08:27:24Z","timestamp":1474014444000},"page":"749-765","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":692,"title":["Learning to Track at 100 FPS with Deep Regression Networks"],"prefix":"10.1007","author":[{"given":"David","family":"Held","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Sebastian","family":"Thrun","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Silvio","family":"Savarese","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2016,9,17]]},"reference":[{"key":"45_CR1","unstructured":"Andriluka, M., Roth, S., Schiele, B.: People-tracking-by-detection and people-detection-by-tracking. In: IEEE Conference on Computer Vision and Pattern Recognition, 2008. CVpPR 2008, pp. 1\u20138. IEEE (2008)"},{"key":"45_CR2","unstructured":"Ba, J., Mnih, V., Kavukcuoglu, K.: Multiple object recognition with visual attention. arXiv preprint arXiv:1412.7755 (2014)"},{"key":"45_CR3","unstructured":"Babenko, B., Yang, M.H., Belongie, S.: Visual tracking with online multiple instance learning. In: IEEE Conference on Computer Vision and Pattern Recognition, 2009. CVPPR 2009, pp. 983\u2013990. IEEE (2009)"},{"key":"45_CR4","unstructured":"Bazzani, L., Larochelle, H., Murino, V.,Ting, J.a., Freitas, N.D.: Learning attentional policies for tracking and recognition in video with deep networks. In: Proceedings of the 28th International Conference on Machine Learning (ICML-2011), pp. 937\u2013944 (2011)"},{"key":"45_CR5","doi-asserted-by":"crossref","unstructured":"Bo, L., Ren, X., Fox, D.: Multipath sparse coding using hierarchical matching pursuit. In: 2013 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 660\u2013667. IEEE (2013)","DOI":"10.1109\/CVPR.2013.91"},{"key":"45_CR6","doi-asserted-by":"crossref","unstructured":"Cehovin, L., Kristan, M., Leonardis, A.: Is my new tracker really better than yours? In: 2014 IEEE Winter Conference on Applications of Computer Vision (WACV), pp. 540\u2013547. IEEE (2014)","DOI":"10.1109\/WACV.2014.6836055"},{"key":"45_CR7","doi-asserted-by":"crossref","unstructured":"Danelljan, M., Hager, G., Shahbaz Khan, F., Felsberg, M.: Learning spatially regularized correlation filters for visual tracking. In: Proceedings of the IEEE International Conference on Computer Vision (ICCV), pp. 4310\u20134318 (2015)","DOI":"10.1109\/ICCV.2015.490"},{"key":"45_CR8","unstructured":"Deng, J., Dong, W., Socher, R., Li, L.J., Li, K., Fei-Fei, L.: ImageNet: a large-scale hierarchical image database. In: IEEE Conference on Computer Vision and Pattern Recognition, 2009. CVPPR 2009, pp. 248\u2013255. IEEE (2009)"},{"key":"45_CR9","doi-asserted-by":"crossref","unstructured":"Donahue, J., Hendricks, L.A., Guadarrama, S., Rohrbach, M., Venugopalan, S., Saenko, K., Darrell, T.: Long-term recurrent convolutional networks for visual recognition and description. arXiv preprint arXiv:1411.4389 (2014)","DOI":"10.21236\/ADA623249"},{"key":"45_CR10","doi-asserted-by":"crossref","unstructured":"Dosovitskiy, A., Fischery, P., Ilg, E., Hazirbas, C., Golkov, V., van der Smagt, P., Cremers, D., Brox, T., et al.: FlowNet: learning optical flow with convolutional networks. In: 2015 IEEE International Conference on Computer Vision (ICCV), pp. 2758\u20132766. IEEE (2015)","DOI":"10.1109\/ICCV.2015.316"},{"issue":"10","key":"45_CR11","doi-asserted-by":"publisher","first-page":"1610","DOI":"10.1109\/TNN.2010.2066286","volume":"21","author":"J Fan","year":"2010","unstructured":"Fan, J., Xu, W., Wu, Y., Gong, Y.: Human tracking using convolutional neural networks. IEEE Trans. Neural Netw. 21(10), 1610\u20131623 (2010)","journal-title":"IEEE Trans. Neural Netw."},{"key":"45_CR12","doi-asserted-by":"crossref","unstructured":"Geiger, A.: Probabilistic models for 3D urban scene understanding from movable platforms. Ph.D. thesis, KIT (2013)","DOI":"10.1109\/TPAMI.2013.185"},{"key":"45_CR13","doi-asserted-by":"crossref","unstructured":"Girshick, R., Donahue, J., Darrell, T., Malik, J.: Rich feature hierarchies for accurate object detection and semantic segmentation. In: 2014 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 580\u2013587. IEEE (2014)","DOI":"10.1109\/CVPR.2014.81"},{"key":"45_CR14","doi-asserted-by":"crossref","unstructured":"Han, X., Leung, T., Jia, Y., Sukthankar, R., Berg, A.C.: MatchNet: unifying feature and metric learning for patch-based matching. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 3279\u20133286 (2015)","DOI":"10.1109\/CVPR.2015.7298948"},{"key":"45_CR15","doi-asserted-by":"crossref","unstructured":"Hare, S., Saffari, A., Torr, P.H.: Struck: structured output tracking with kernels. In: 2011 IEEE International Conference on Computer Vision (ICCV), pp. 263\u2013270. IEEE (2011)","DOI":"10.1109\/ICCV.2011.6126251"},{"key":"45_CR16","unstructured":"Hong, S., You, T., Kwak, S., Han, B.: Online tracking by learning discriminative saliency map with convolutional neural network. In: Proceedings of the 32nd International Conference on Machine Learning, 6\u201311 July 2015, Lille (2015)"},{"key":"45_CR17","doi-asserted-by":"crossref","unstructured":"Jia, Y., Shelhamer, E., Donahue, J., Karayev, S., Long, J., Girshick, R., Guadarrama, S., Darrell, T.: Caffe: Convolutional architecture for fast feature embedding. arXiv preprint arXiv:1408.5093 (2014)","DOI":"10.1145\/2647868.2654889"},{"key":"45_CR18","doi-asserted-by":"crossref","unstructured":"Jin, J., Dundar, A., Bates, J., Farabet, C., Culurciello, E.: Tracking with deep neural networks. In: 2013 47th Annual Conference on Information Sciences and Systems (CISS), pp. 1\u20135. IEEE (2013)","DOI":"10.1109\/CISS.2013.6552287"},{"issue":"7","key":"45_CR19","doi-asserted-by":"publisher","first-page":"1409","DOI":"10.1109\/TPAMI.2011.239","volume":"34","author":"Z Kalal","year":"2012","unstructured":"Kalal, Z., Mikolajczyk, K., Matas, J.: Tracking-learning-detection. IEEE Trans. Pattern Anal. Mach. Intell. 34(7), 1409\u20131422 (2012)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"45_CR20","doi-asserted-by":"crossref","unstructured":"Karpathy, A., Toderici, G., Shetty, S., Leung, T., Sukthankar, R., Fei-Fei, L.: Large-scale video classification with convolutional neural networks. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 1725\u20131732 (2014)","DOI":"10.1109\/CVPR.2014.223"},{"key":"45_CR21","unstructured":"Kristan, M., Matas, J., Leonardis, A., Felsberg, M., Cehovin, L., Fernandez, G., Vojir, T., Hager, G., Nebehay, G., Pflugfelder, R.: The visual object tracking vot2015 challenge results. In: Proceedings of the IEEE International Conference on Computer Vision (ICCV) Workshops, pp. 1\u201323 (2015)"},{"key":"45_CR22","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"191","DOI":"10.1007\/978-3-319-16181-5_14","volume-title":"Computer Vision - ECCV 2014 Workshops","author":"M Kristan","year":"2015","unstructured":"Kristan, M., et al.: The visual object tracking VOT2014 challenge results. In: Agapito, L., Bronstein, M.M., Rother, C. (eds.) ECCV 2014. LNCS, vol. 8926, pp. 191\u2013217. Springer, Heidelberg (2015). doi: 10.1007\/978-3-319-16181-5_14"},{"key":"45_CR23","unstructured":"Krizhevsky, A., Sutskever, I., Hinton, G.E.: ImageNet classification with deep convolutional neural networks. In: Advances in Neural Information Processing Systems, pp. 1097\u20131105 (2012)"},{"issue":"10","key":"45_CR24","doi-asserted-by":"publisher","first-page":"2964","DOI":"10.1016\/j.patcog.2015.02.012","volume":"48","author":"J Kuen","year":"2015","unstructured":"Kuen, J., Lim, K.M., Lee, C.P.: Self-taught learning of a deep invariant representation for visual tracking via temporal slowness principle. Pattern Recognit. 48(10), 2964\u20132982 (2015)","journal-title":"Pattern Recognit."},{"key":"45_CR25","doi-asserted-by":"crossref","unstructured":"Levi, G., Hassner, T.: Age and gender classification using convolutional neural networks. In: 2015 IEEE Conference on Computer Vision and Pattern Recognition Workshop (CVPRW) (2015)","DOI":"10.1109\/CVPRW.2015.7301352"},{"key":"45_CR26","doi-asserted-by":"crossref","unstructured":"Li, H., Li, Y., Porikli, F.: DeepTrack: learning discriminative feature representations by convolutional neural networks for visual tracking. In: Proceedings of the British Machine Vision Conference. BMVA Press (2014)","DOI":"10.5244\/C.28.56"},{"key":"45_CR27","doi-asserted-by":"crossref","unstructured":"Li, H., Li, Y., Porikli, F.: DeepTrack: learning discriminative feature representations online for robust visual tracking. arXiv preprint arXiv:1503.00072 (2015)","DOI":"10.5244\/C.28.56"},{"key":"45_CR28","doi-asserted-by":"crossref","unstructured":"Long, J., Shelhamer, E., Darrell, T.: Fully convolutional networks for semantic segmentation. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 3431\u20133440 (2015)","DOI":"10.1109\/CVPR.2015.7298965"},{"key":"45_CR29","unstructured":"Mnih, V., Heess, N., Graves, A., et al.: Recurrent models of visual attention. In: Advances in Neural Information Processing Systems, pp. 2204\u20132212 (2014)"},{"key":"45_CR30","doi-asserted-by":"crossref","unstructured":"Nam, H., Han, B.: Learning multi-domain convolutional neural networks for visual tracking. arXiv preprint arXiv:1510.07945 (2015)","DOI":"10.1109\/CVPR.2016.465"},{"key":"45_CR31","unstructured":"Russakovsky, O., Deng, J., Su, H., Krause, J., Satheesh, S., Ma, S., Huang, Z., Karpathy, A., Khosla, A., Bernstein, M., et al.: ImageNet large scale visual recognition challenge. Int. J. Comput. Vis. 1\u201342 (2014)"},{"issue":"7","key":"45_CR32","doi-asserted-by":"publisher","first-page":"1442","DOI":"10.1109\/TPAMI.2013.230","volume":"36","author":"AW Smeulders","year":"2014","unstructured":"Smeulders, A.W., Chu, D.M., Cucchiara, R., Calderara, S., Dehghan, A., Shah, M.: Visual tracking: an experimental survey. IEEE Trans. Pattern Anal. Mach. Intell. 36(7), 1442\u20131468 (2014)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"45_CR33","doi-asserted-by":"crossref","unstructured":"Tao, R., Gavves, E., Smeulders, A.W.M.: Siamese instance search for tracking. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (2016)","DOI":"10.1109\/CVPR.2016.158"},{"key":"45_CR34","doi-asserted-by":"crossref","unstructured":"Wang, L., Ouyang, W., Wang, X., Lu, H.: Visual tracking with fully convolutional networks. In: Proceedings of the IEEE International Conference on Computer Vision (ICCV), pp. 3119\u20133127 (2015)","DOI":"10.1109\/ICCV.2015.357"},{"key":"45_CR35","unstructured":"Wang, N., Li, S., Gupta, A., Yeung, D.Y.: Transferring rich feature hierarchies for robust visual tracking. arXiv preprint arXiv:1501.04587 (2015)"},{"key":"45_CR36","doi-asserted-by":"crossref","unstructured":"Wang, N., Shi, J., Yeung, D.Y., Jia, J.: Understanding and diagnosing visual tracking systems. arXiv preprint arXiv:1504.06055 (2015)","DOI":"10.1109\/ICCV.2015.355"},{"key":"45_CR37","unstructured":"Wang, N., Yeung, D.Y.: Learning a deep compact image representation for visual tracking. In: Advances in Neural Information Processing Systems, pp. 809\u2013817 (2013)"},{"key":"45_CR38","doi-asserted-by":"crossref","unstructured":"Zagoruyko, S., Komodakis, N.: Learning to compare image patches via convolutional neural networks. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 4353\u20134361 (2015)","DOI":"10.1109\/CVPR.2015.7299064"},{"key":"45_CR39","doi-asserted-by":"crossref","unstructured":"Zhang, K., Liu, Q., Wu, Y., Yang, M.H.: Robust visual tracking via convolutional networks. arXiv preprint arXiv:1501.04505 (2015)","DOI":"10.1109\/TIP.2016.2531283"}],"container-title":["Lecture Notes in Computer Science","Computer Vision \u2013 ECCV 2016"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-319-46448-0_45","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,6,10]],"date-time":"2025-06-10T19:14:51Z","timestamp":1749582891000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/978-3-319-46448-0_45"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2016]]},"ISBN":["9783319464473","9783319464480"],"references-count":39,"URL":"https:\/\/doi.org\/10.1007\/978-3-319-46448-0_45","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2016]]},"assertion":[{"value":"17 September 2016","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ECCV","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"European Conference on Computer Vision","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Amsterdam","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"The Netherlands","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2016","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"8 October 2016","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"16 October 2016","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"14","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"eccv2016","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"http:\/\/www.eccv2016.org\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"This content has been made available to all.","name":"free","label":"Free to read"}]}}