{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,1,27]],"date-time":"2026-01-27T22:35:10Z","timestamp":1769553310775,"version":"3.49.0"},"publisher-location":"Cham","reference-count":42,"publisher":"Springer International Publishing","isbn-type":[{"value":"9783030208899","type":"print"},{"value":"9783030208905","type":"electronic"}],"license":[{"start":{"date-parts":[[2019,1,1]],"date-time":"2019-01-01T00:00:00Z","timestamp":1546300800000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2019]]},"DOI":"10.1007\/978-3-030-20890-5_37","type":"book-chapter","created":{"date-parts":[[2019,6,1]],"date-time":"2019-06-01T11:18:34Z","timestamp":1559387914000},"page":"575-591","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":27,"title":["Coarse-to-Fine: A RNN-Based Hierarchical Attention Model for Vehicle Re-identification"],"prefix":"10.1007","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-8200-1845","authenticated-orcid":false,"given":"Xiu-Shen","family":"Wei","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-3168-1852","authenticated-orcid":false,"given":"Chen-Lin","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-3584-795X","authenticated-orcid":false,"given":"Lingqiao","family":"Liu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-8648-8718","authenticated-orcid":false,"given":"Chunhua","family":"Shen","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-2085-7568","authenticated-orcid":false,"given":"Jianxin","family":"Wu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2019,6,2]]},"reference":[{"key":"37_CR1","doi-asserted-by":"crossref","unstructured":"Chatfield, K., Simonyan, K., Vedaldi, A.: Return of the devil in the details: delving deep into convolutional nets. arXiv preprint \n                      arXiv:1405.3531\n                      \n                     (2014)","DOI":"10.5244\/C.28.6"},{"key":"37_CR2","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"214","DOI":"10.1007\/978-3-319-54193-8_14","volume-title":"Computer Vision \u2013 ACCV 2016","author":"C Chen","year":"2017","unstructured":"Chen, C., Liu, M.-Y., Tuzel, O., Xiao, J.: R-CNN for small object detection. In: Lai, S.-H., Lepetit, V., Nishino, K., Sato, Y. (eds.) ACCV 2016. LNCS, vol. 10115, pp. 214\u2013230. Springer, Cham (2017). \n                      https:\/\/doi.org\/10.1007\/978-3-319-54193-8_14"},{"key":"37_CR3","doi-asserted-by":"crossref","unstructured":"Cho, K., et al.: Learning phrase representations using RNN encoder-decoder for statistical machine translation. In: EMNLP, pp. 1724\u20131735, October 2014","DOI":"10.3115\/v1\/D14-1179"},{"key":"37_CR4","unstructured":"Chung, J., Gulcehre, C., Cho, K., Bengio, Y.: Empirical evaluation of gated recurrent neural networks on sequence modeling. arXiv preprint \n                      arXiv:1412.3555\n                      \n                     (2014)"},{"issue":"1","key":"37_CR5","first-page":"28","volume":"14","author":"RS Feris","year":"2015","unstructured":"Feris, R.S., Siddiquie, B., Zhai, Y., Datta, A., Brown, L.M., Pankanti, S.: Large-scale vehicle detection, indexing, and search in urban surveillance videos. IEEE TMM 14(1), 28\u201342 (2015)","journal-title":"IEEE TMM"},{"key":"37_CR6","unstructured":"Gao, H., Mao, J., Zhou, J., Huang, Z., Wang, L., Xu, W.: Are you talking to a machine? Dataset and methods for multilingual image question answering. In: NIPS, pp. 2296\u20132304, December 2015"},{"key":"37_CR7","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., Sun, J.: Deep residual learning for image recognition. In: CVPR, pp. 770\u2013778, June 2016","DOI":"10.1109\/CVPR.2016.90"},{"issue":"8","key":"37_CR8","doi-asserted-by":"publisher","first-page":"1735","DOI":"10.1162\/neco.1997.9.8.1735","volume":"9","author":"S Hochreiter","year":"1997","unstructured":"Hochreiter, S., Schmidhuber, J.: Long shot-term memory. Neural Comput. 9(8), 1735\u20131780 (1997)","journal-title":"Neural Comput."},{"key":"37_CR9","doi-asserted-by":"crossref","unstructured":"Hou, S., Feng, Y., Wang, Z.: VegFru: a domain-specific dataset for fine-grained visual categorization. In: ICCV, pp. 541\u2013549, October 2017","DOI":"10.1109\/ICCV.2017.66"},{"key":"37_CR10","doi-asserted-by":"crossref","unstructured":"J\u00e9gou, H., Douze, M., Schmid, C., P\u00e9rez, P.: Aggregating local descriptors into a compact image representation. In: CVPR, pp. 3304\u20133311, June 2010","DOI":"10.1109\/CVPR.2010.5540039"},{"key":"37_CR11","doi-asserted-by":"crossref","unstructured":"Johnson, J., Karpathy, A., Fei-Fei, L.: DenseCap: fully convolutional localization networks for dense captioning. In: CVPR, pp. 4565\u20134574, June 2016","DOI":"10.1109\/CVPR.2016.494"},{"key":"37_CR12","unstructured":"Jozefowicz, R., Zaremba, W., Sutskever, I.: An empirical exploration of recurrent network architectures. In: ICML, pp. 2342\u20132350, July 2015"},{"key":"37_CR13","unstructured":"Kanac, A., Zhu, X., Gong, S.: Vehicle re-identification by fine-grained cross-level deep learning. In: BMVC, pp. 770\u2013781, September 2017"},{"key":"37_CR14","unstructured":"Krizhevsky, A., Sutskever, I., Hinton, G.E.: ImageNet classification with deep convolutional neural networks. In: NIPS, pp. 1097\u20131105, December 2012"},{"key":"37_CR15","doi-asserted-by":"crossref","unstructured":"Liao, S., Hu, Y., Zhu, X., Li, S.Z.: Person re-identification by local maximal occurrence representation and metric learning. In: CVPR, pp. 2197\u20132206, June 2015","DOI":"10.1109\/CVPR.2015.7298832"},{"key":"37_CR16","doi-asserted-by":"crossref","unstructured":"Liu, H., Tian, Y., Wang, Y., Pang, L., Huang, T.: Deep relative distance learning: tell the difference between similar vehicles. In: CVPR, pp. 2167\u20132175, June 2016","DOI":"10.1109\/CVPR.2016.238"},{"issue":"11","key":"37_CR17","doi-asserted-by":"publisher","first-page":"2305","DOI":"10.1109\/TPAMI.2016.2637921","volume":"39","author":"L Liu","year":"2016","unstructured":"Liu, L., Shen, C., van den Hengel, A.: Cross-convolutional-layer pooling for image recognition. IEEE TPAMI 39(11), 2305\u20132313 (2016)","journal-title":"IEEE TPAMI"},{"key":"37_CR18","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"21","DOI":"10.1007\/978-3-319-46448-0_2","volume-title":"Computer Vision \u2013 ECCV 2016","author":"W Liu","year":"2016","unstructured":"Liu, W., et al.: SSD: single shot MultiBox detector. In: Leibe, B., Matas, J., Sebe, N., Welling, M. (eds.) ECCV 2016. LNCS, vol. 9905, pp. 21\u201337. Springer, Cham (2016). \n                      https:\/\/doi.org\/10.1007\/978-3-319-46448-0_2"},{"key":"37_CR19","doi-asserted-by":"crossref","unstructured":"Liu, X., Lin, W., Ma, H., Fu, H.: Large-scale vehicle re-identification in urban suveillance videos. In: ICME, pp. 1\u20136, July 2016","DOI":"10.1109\/ICME.2016.7553002"},{"key":"37_CR20","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"869","DOI":"10.1007\/978-3-319-46475-6_53","volume-title":"Computer Vision \u2013 ECCV 2016","author":"X Liu","year":"2016","unstructured":"Liu, X., Liu, W., Mei, T., Ma, H.: A deep learning-based approach to progressive vehicle re-identification for urban surveillance. In: Leibe, B., Matas, J., Sebe, N., Welling, M. (eds.) ECCV 2016. LNCS, vol. 9906, pp. 869\u2013884. Springer, Cham (2016). \n                      https:\/\/doi.org\/10.1007\/978-3-319-46475-6_53"},{"key":"37_CR21","doi-asserted-by":"crossref","unstructured":"Long, J., Shelhamer, E., Darrell, T.: Fully convolutional networks for semantic segmentation. In: CVPR, pp. 3431\u20133440, June 2015","DOI":"10.1109\/CVPR.2015.7298965"},{"issue":"3","key":"37_CR22","doi-asserted-by":"publisher","first-page":"222","DOI":"10.1007\/s11263-013-0636-x","volume":"105","author":"J S\u00e1nchez","year":"2013","unstructured":"S\u00e1nchez, J., Perronnin, F., Mensink, T., Verbeek, J.: Image classification with the fisher vector: theory and practice. IJCV 105(3), 222\u2013245 (2013)","journal-title":"IJCV"},{"key":"37_CR23","doi-asserted-by":"crossref","unstructured":"Shen, Y., Xiao, T., Li, H., Yi, S., Wang, X.: Learning deep neural networks for vehicle Re-ID with visual-spatio-temporal path proposals. In: ICCV, pp. 1900\u20131909, October 2017","DOI":"10.1109\/ICCV.2017.210"},{"key":"37_CR24","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"360","DOI":"10.1007\/978-3-319-16811-1_24","volume-title":"Computer Vision \u2013 ACCV 2014","author":"B Singh","year":"2015","unstructured":"Singh, B., Han, X., Wu, Z., Davis, L.S.: PSPGC: part-based seeds for parametric graph-cuts. In: Cremers, D., Reid, I., Saito, H., Yang, M.-H. (eds.) ACCV 2014. LNCS, vol. 9005, pp. 360\u2013375. Springer, Cham (2015). \n                      https:\/\/doi.org\/10.1007\/978-3-319-16811-1_24"},{"key":"37_CR25","doi-asserted-by":"crossref","unstructured":"Sochor, J., Herout, A., Havel, J.: BoxCars: 3D boxes as CNN input for improved fine-grained vehicle recognition. In: CVPR, pp. 3006\u20133015, June 2016","DOI":"10.1109\/CVPR.2016.328"},{"key":"37_CR26","unstructured":"Sutskever, I., Vinyals, O., Le, Q.V.: Sequence to sequence learning with neural networks. In: NIPS, pp. 3104\u20133112, December 2014"},{"key":"37_CR27","doi-asserted-by":"crossref","unstructured":"Szegedy, C., et al.: Going deeper with convolutions. In: CVPR, pp. 1\u20139, June 2015","DOI":"10.1109\/CVPR.2015.7298594"},{"key":"37_CR28","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"101","DOI":"10.1007\/978-3-319-54193-8_7","volume-title":"Computer Vision \u2013 ACCV 2016","author":"YH Tan","year":"2017","unstructured":"Tan, Y.H., Chan, C.S.: phi-LSTM: a phrase-based hierarchical LSTM model for image captioning. In: Lai, S.-H., Lepetit, V., Nishino, K., Sato, Y. (eds.) ACCV 2016. LNCS, vol. 10115, pp. 101\u2013117. Springer, Cham (2017). \n                      https:\/\/doi.org\/10.1007\/978-3-319-54193-8_7"},{"key":"37_CR29","unstructured":"Tieleman, T., Hinton, G.E.: Neural networks for machine learning. Coursera (Lecture 65 - RMSprop)"},{"issue":"2","key":"37_CR30","doi-asserted-by":"publisher","first-page":"192","DOI":"10.1049\/ip-vis:20041147","volume":"152","author":"M Varela","year":"2005","unstructured":"Varela, M., Velastin, S.A.: Intelligent distributed surveillance systems: a review. IEEE Trans. Vis. Image Signal Process. 152(2), 192\u2013204 (2005)","journal-title":"IEEE Trans. Vis. Image Signal Process."},{"issue":"7","key":"37_CR31","first-page":"1512","volume":"18","author":"JVD Weijier","year":"2009","unstructured":"Weijier, J.V.D., Schmid, C., Verbeek, J., Larlus, D.: Learning color names for real-world applications. IEEE TIP 18(7), 1512\u20131523 (2009)","journal-title":"IEEE TIP"},{"issue":"10","key":"37_CR32","doi-asserted-by":"publisher","first-page":"2993","DOI":"10.1016\/j.patcog.2015.04.005","volume":"48","author":"JVD Weijier","year":"2015","unstructured":"Weijier, J.V.D., Schmid, C., Verbeek, J., Larlus, D.: Deep feature learning with relative distance comparison for person re-identification. Pattern Recogn. 48(10), 2993\u20133003 (2015)","journal-title":"Pattern Recogn."},{"key":"37_CR33","doi-asserted-by":"crossref","unstructured":"Wu, Q., Shen, C., Liu, L., Dick, A., van den Hengel, A.: What value to explicit high level concepts have in vision to language problems? In: CVPR, pp. 203\u2013212, June 2016","DOI":"10.1109\/CVPR.2016.29"},{"key":"37_CR34","doi-asserted-by":"crossref","unstructured":"Wu, Q., Wang, P., Shen, C., Dick, A., van den Hengel, A.: Ask me anything: free-form visual question answering based on knowledge from external sources. In: CVPR, pp. 4622\u20134630, June 2016","DOI":"10.1109\/CVPR.2016.500"},{"key":"37_CR35","unstructured":"Xu, K., et al.: Show, attend and tell: neural image caption generation with visual attention. In: ICML, pp. 2048\u20132057, July 2015"},{"key":"37_CR36","doi-asserted-by":"crossref","unstructured":"Yang, L., Luo, P., Loy, C.C., Tang, X.: A large-scale car dataset fro fine-grained categorization and verification. In: CVPR, pp. 3973\u20133981, June 2015","DOI":"10.1109\/CVPR.2015.7299023"},{"issue":"4","key":"37_CR37","doi-asserted-by":"publisher","first-page":"1624","DOI":"10.1109\/TITS.2011.2158001","volume":"12","author":"J Zhang","year":"2011","unstructured":"Zhang, J., Wang, F.Y., Lin, W.H., Xu, X., Chen, C.: Data-driven intelligent transportation systems: a survey. IEEE Trans. Intell. Transp. Syst. 12(4), 1624\u20131639 (2011)","journal-title":"IEEE Trans. Intell. Transp. Syst."},{"key":"37_CR38","doi-asserted-by":"crossref","unstructured":"Zheng, L., Shen, L., Tian, L., Wang, S., Wang, J., Tian, Q.: Scalable person re-identification: a benchmark. In: ICCV, pp. 1116\u20131124, December 2015","DOI":"10.1109\/ICCV.2015.133"},{"key":"37_CR39","unstructured":"Zheng, L., Yang, Y., Hauptmann, A.G.: Person re-identification: Past, present and future. arXiv preprint \n                      arXiv:1610.02984\n                      \n                     (2016)"},{"issue":"38","key":"37_CR40","first-page":"1","volume":"5","author":"Y Zheng","year":"2014","unstructured":"Zheng, Y., Capra, L., Wolfson, O., Yang, H.: Urban computing: concepts, methodologies, and applications. ACM Trans. Intell. Syst. Technol. 5(38), 1\u201355 (2014)","journal-title":"ACM Trans. Intell. Syst. Technol."},{"key":"37_CR41","unstructured":"Zheng, Z., Zheng, L., Yang, Y.: A discriminatively learned CNN embedding for person re-identification. arXiv preprint \n                      arXiv:1611.05666\n                      \n                     (2016)"},{"key":"37_CR42","doi-asserted-by":"crossref","unstructured":"Zhou, Y., Shao, L.: Viewpoint-aware attentive multi-view inference for vehicle re-identification. In: CVPR, pp. 6489\u20136498, June 2018","DOI":"10.1109\/CVPR.2018.00679"}],"container-title":["Lecture Notes in Computer Science","Computer Vision \u2013 ACCV 2018"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-030-20890-5_37","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2019,6,1]],"date-time":"2019-06-01T11:26:38Z","timestamp":1559388398000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/978-3-030-20890-5_37"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2019]]},"ISBN":["9783030208899","9783030208905"],"references-count":42,"URL":"https:\/\/doi.org\/10.1007\/978-3-030-20890-5_37","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2019]]},"assertion":[{"value":"2 June 2019","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ACCV","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Asian Conference on Computer Vision","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Perth, WA","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Australia","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2018","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2 December 2018","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"6 December 2018","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"14","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"accv2018","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"http:\/\/accv2018.net\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Double-blind","order":1,"name":"type","label":"Type","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}},{"value":"Microsoft CMT","order":2,"name":"conference_management_system","label":"Conference Management System","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}},{"value":"979","order":3,"name":"number_of_submissions_sent_for_review","label":"Number of Submissions Sent for Review","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}},{"value":"274","order":4,"name":"number_of_full_papers_accepted","label":"Number of Full Papers Accepted","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}},{"value":"0","order":5,"name":"number_of_short_papers_accepted","label":"Number of Short Papers Accepted","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}},{"value":"28% - The value is computed by the equation \"Number of Full Papers Accepted \/ Number of Submissions Sent for Review * 100\" and then rounded to a whole number.","order":6,"name":"acceptance_rate_of_full_papers","label":"Acceptance Rate of Full Papers","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}},{"value":"3","order":7,"name":"average_number_of_reviews_per_paper","label":"Average Number of Reviews per Paper","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}},{"value":"2.7","order":8,"name":"average_number_of_papers_per_reviewer","label":"Average Number of Papers per Reviewer","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}},{"value":"No","order":9,"name":"external_reviewers_involved","label":"External Reviewers Involved","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information"}}]}}