{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,8]],"date-time":"2026-05-08T16:38:02Z","timestamp":1778258282209,"version":"3.51.4"},"reference-count":43,"publisher":"Springer Science and Business Media LLC","issue":"3","license":[{"start":{"date-parts":[[2015,12,22]],"date-time":"2015-12-22T00:00:00Z","timestamp":1450742400000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Int J Comput Vis"],"published-print":{"date-parts":[[2016,9]]},"DOI":"10.1007\/s11263-015-0875-0","type":"journal-article","created":{"date-parts":[[2015,12,22]],"date-time":"2015-12-22T14:26:59Z","timestamp":1450794419000},"page":"291-306","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":29,"title":["Circulant Temporal Encoding for Video Retrieval and Temporal Alignment"],"prefix":"10.1007","volume":"119","author":[{"given":"Matthijs","family":"Douze","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"J\u00e9r\u00f4me","family":"Revaud","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jakob","family":"Verbeek","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Herv\u00e9","family":"J\u00e9gou","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Cordelia","family":"Schmid","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2015,12,22]]},"reference":[{"key":"875_CR1","doi-asserted-by":"crossref","unstructured":"Arandjelovic, R., & Zisserman, A. (2012). Three things everyone should know to improve object retrieval. In CVPR.","DOI":"10.1109\/CVPR.2012.6248018"},{"key":"875_CR2","doi-asserted-by":"crossref","unstructured":"Ballan, L., Brostow, G.\u00a0J., Puwein, J., & Pollefeys, M. (2010). Unstructured video-based rendering: Interactive exploration of casually captured videos. In ACM Siggraph.","DOI":"10.1145\/1833349.1778824"},{"key":"875_CR3","volume-title":"Pattern recognition and machine learning","author":"CM Bishop","year":"2007","unstructured":"Bishop, C. M. (2007). Pattern recognition and machine learning. Berlin: Springer."},{"key":"875_CR4","doi-asserted-by":"crossref","unstructured":"Bolme, D., Beveridge, J., Draper, B., & Lui, Y. (2010). Visual object tracking using adaptive correlation filters. In CVPR.","DOI":"10.1109\/CVPR.2010.5539960"},{"issue":"4","key":"875_CR5","doi-asserted-by":"crossref","first-page":"325","DOI":"10.1145\/146370.146374","volume":"24","author":"LG Brown","year":"1992","unstructured":"Brown, L. G. (1992). A survey of image registration techniques. ACM Computing Surveys, 24(4), 325\u2013376.","journal-title":"ACM Computing Surveys"},{"issue":"11","key":"875_CR6","doi-asserted-by":"crossref","first-page":"1409","DOI":"10.1109\/TPAMI.2002.1046148","volume":"24","author":"Y Caspi","year":"2002","unstructured":"Caspi, Y., & Irani, M. (2002). Spatio-temporal alignment of sequences. Transactions on PAMI, 24(11), 1409\u20131424.","journal-title":"Transactions on PAMI"},{"key":"875_CR7","doi-asserted-by":"crossref","unstructured":"Chu, W.-S., Zhou, F., & de\u00a0la Torre, F. (2012). Unsupervised temporal commonality discovery. In ECCV.","DOI":"10.1007\/978-3-642-33765-9_27"},{"key":"875_CR8","doi-asserted-by":"crossref","unstructured":"Douze, M., J\u00e9gou, H., Schmid, C., & P\u00e9rez, P. (2010). Compact video description for copy detection with precise temporal alignment. In ECCV.","DOI":"10.1007\/978-3-642-15549-9_38"},{"key":"875_CR9","doi-asserted-by":"crossref","unstructured":"Dubout, C., & Fleuret, F. (2012). Exact acceleration of linear object detectors. In ECCV.","DOI":"10.1007\/978-3-642-33712-3_22"},{"issue":"10","key":"875_CR10","doi-asserted-by":"crossref","first-page":"2371","DOI":"10.1109\/TPAMI.2013.56","volume":"35","author":"G Evangelidis","year":"2013","unstructured":"Evangelidis, G., & Bauckhage, C. (2013). Efficient subframe video alignment using short descriptors. Transactions on PAMI, 35(10), 2371\u20132386.","journal-title":"Transactions on PAMI"},{"issue":"3","key":"875_CR11","doi-asserted-by":"crossref","first-page":"414","DOI":"10.1109\/TPAMI.2008.104","volume":"31","author":"J-S Franco","year":"2009","unstructured":"Franco, J.-S., & Boyer, E. (2009). Efficient polyhedral modeling from silhouettes. Transactions on PAMI, 31(3), 414\u2013427.","journal-title":"Transactions on PAMI"},{"key":"875_CR12","doi-asserted-by":"crossref","unstructured":"Hasler, N., Rosenhahn, B., Thorm\u00e4hlen, T., Wand, M., Gall, J., & Seidel, H.-P. (2009). Markerless motion capture with unsynchronized moving cameras. In CVPR.","DOI":"10.1109\/CVPR.2009.5206859"},{"key":"875_CR13","doi-asserted-by":"crossref","unstructured":"Henriques, J., Carreira, J., Caseiro, R., & Batista, J. (2013). Beyond hard negative mining: Efficient detector learning via block-circulant decomposition. In ICCV.","DOI":"10.1109\/ICCV.2013.343"},{"key":"875_CR14","doi-asserted-by":"crossref","unstructured":"Henriques, J., Caseiro, R., Martins, P., & Batista, J. (2012). Exploiting the circulant structure of tracking-by-detection with kernels. In ECCV.","DOI":"10.1007\/978-3-642-33765-9_50"},{"key":"875_CR15","unstructured":"Hoai, M., & de\u00a0la Torre, F. (2012). Maximum margin temporal clustering. In AISTATS."},{"key":"875_CR16","doi-asserted-by":"crossref","unstructured":"Jain, M., Benmokhtar, R., Gros, P., & J\u00e9gou, H. (2012). Hamming embedding similarity-based image classification. In ICMR.","DOI":"10.1145\/2324796.2324820"},{"key":"875_CR17","doi-asserted-by":"crossref","unstructured":"J\u00e9gou, H., & Chum, O. (2012). Negative evidences and co-occurences in image retrieval: The benefit of PCA and whitening. In ECCV.","DOI":"10.1007\/978-3-642-33709-3_55"},{"key":"875_CR18","doi-asserted-by":"crossref","unstructured":"J\u00e9gou, H., Douze, M., & Schmid, C. (2008). Hamming embedding and weak geometric consistency for large scale image search. In ECCV.","DOI":"10.1007\/978-3-540-88682-2_24"},{"issue":"1","key":"875_CR19","doi-asserted-by":"crossref","first-page":"117","DOI":"10.1109\/TPAMI.2010.57","volume":"33","author":"H J\u00e9gou","year":"2011","unstructured":"J\u00e9gou, H., Douze, M., & Schmid, C. (2011). Product quantization for nearest neighbor search. Transactions on PAMI, 33(1), 117\u2013128.","journal-title":"Transactions on PAMI"},{"key":"875_CR20","doi-asserted-by":"crossref","unstructured":"Jiang, H., Liu, H., Tan, P., Zhang, G., & Bao, H. (2012). 3D Reconstruction of dynamic scenes with multiple handheld cameras. In ECCV.","DOI":"10.1007\/978-3-642-33709-3_43"},{"key":"875_CR21","doi-asserted-by":"crossref","unstructured":"Kalker, T., Depovere, G., Haitsma, J., & Maes, M. (1999). A video watermarking system for broadcast monitoring. In SPIE Conference on Security and watermarking of multimedia contents.","DOI":"10.1117\/12.344661"},{"issue":"3","key":"875_CR22","doi-asserted-by":"crossref","first-page":"618","DOI":"10.1109\/TPAMI.2010.118","volume":"33","author":"A Karpenko","year":"2011","unstructured":"Karpenko, A., & Aarabi, P. (2011). Tiny videos: A large data set for nonparametric video retrieval and frame classification. Transactions on PAMI, 33(3), 618\u2013630.","journal-title":"Transactions on PAMI"},{"key":"875_CR23","doi-asserted-by":"crossref","unstructured":"Kennedy, L., & Naaman, M. (2009). Less talk, more rock: Automated organization of community-contributed collections of concert videos. In WWW.","DOI":"10.1145\/1526709.1526752"},{"key":"875_CR24","doi-asserted-by":"crossref","unstructured":"Kuehne, H., Jhuang, H., Garrote, E., Poggio, T., & Serre, T. (2011). HMDB: a large video database for human motion recognition. In ICCV.","DOI":"10.1109\/ICCV.2011.6126543"},{"key":"875_CR25","doi-asserted-by":"crossref","DOI":"10.1017\/CBO9780511541087","volume-title":"Correlation pattern recognition","author":"B Kumar","year":"2005","unstructured":"Kumar, B., Mahalanobis, A., & Juday, R. (2005). Correlation pattern recognition. Cambridge: Cambridge University Press."},{"key":"875_CR26","doi-asserted-by":"crossref","unstructured":"Law-To, J., Chen, L., Joly, A., Laptev, I., Buisson, O., Gouet-Brunet, V., Boujemaa, N., & Stentiford, F. (2007). Video copy detection: A comparative study. In CIVR.","DOI":"10.1145\/1282280.1282336"},{"issue":"2","key":"875_CR27","doi-asserted-by":"crossref","first-page":"91","DOI":"10.1023\/B:VISI.0000029664.99615.94","volume":"60","author":"D Lowe","year":"2004","unstructured":"Lowe, D. (2004). Distinctive image features from scale-invariant keypoints. IJCV, 60(2), 91\u2013110.","journal-title":"IJCV"},{"key":"875_CR28","volume-title":"A wavelet tour of singal processing","author":"S Mallat","year":"2008","unstructured":"Mallat, S. (2008). A wavelet tour of singal processing. Berlin: Springer."},{"key":"875_CR29","doi-asserted-by":"crossref","unstructured":"Nowak, E., Jurie, F., & Triggs, B. (2006). Sampling strategies for bag-of-features image classification. In ECCV.","DOI":"10.1007\/11744085_38"},{"key":"875_CR30","doi-asserted-by":"crossref","unstructured":"Oneata, D., Verbeek, J., & Schmid, C. (2013). Action and event recognition with fisher vectors on a compact feature set. In ICCV.","DOI":"10.1109\/ICCV.2013.228"},{"key":"875_CR31","unstructured":"Over, P., Awad, G., Michel, M., Fiscus, J., Sanders, G., Kraaij, W., Smeaton, A., & Qu\u00e9not, G. (2014). Trecvid 2014\u2014An overview of the goals, tasks, data, evaluation mechanisms and metrics. In Proceedings of TRECVID 2014. NIST, USA."},{"key":"875_CR32","unstructured":"Petit, B., Lesage, J.-D., Menier, C., Allard, J., Franco, J.-S., Raffin, B., Boyer, E., & Faure, F. (2009). Multicamera real-time 3D modeling for telepresence and remote collaboration. International Journal of Digital Multimedia Broadcasting, 2010. https:\/\/hal.inria.fr\/inria-00436467v3 ."},{"key":"875_CR33","doi-asserted-by":"crossref","unstructured":"Revaud, J., Douze, M., Schmid, C., & J\u00e9gou, H. (Mar. 2013). Event retrieval in large video collections with circulant temporal encoding. In CVPR, Portland, United States.","DOI":"10.1109\/CVPR.2013.318"},{"issue":"3","key":"875_CR34","doi-asserted-by":"crossref","first-page":"222","DOI":"10.1007\/s11263-013-0636-x","volume":"105","author":"J S\u00e1nchez","year":"2013","unstructured":"S\u00e1nchez, J., Perronnin, F., Mensink, T., & Verbeek, J. (2013). Image classification with the fisher vector: Theory and practice. IJCV, 105(3), 222\u2013245.","journal-title":"IJCV"},{"key":"875_CR35","doi-asserted-by":"crossref","unstructured":"Smeaton, A.\u00a0F., Over, P., & Kraaij, W. (2006). Evaluation campaigns and trecvid. In MIR.","DOI":"10.1145\/1178677.1178722"},{"key":"875_CR36","doi-asserted-by":"crossref","unstructured":"Song, J., Yang, Y., Huang, Z., Shen, H., & Hong, R. (2011). Multiple feature hashing for real-time large scale near-duplicate video retrieval. In ACM Multimedia.","DOI":"10.1145\/2072298.2072354"},{"key":"875_CR37","unstructured":"Soomro, K., Zamir, A., & Shah, M. (2012). UCF101: A dataset of 101 human actions classes from videos in the wild. Technical Report CRCV-TR-12-01."},{"key":"875_CR38","doi-asserted-by":"crossref","unstructured":"Tuytelaars, T., & Van Gool,\u00a0L. (2004). Synchronizing video sequences. In CVPR.","DOI":"10.1109\/CVPR.2004.1315108"},{"key":"875_CR39","unstructured":"Wang, H., & Schmid, C. (2013). Action Recognition with ImprovedTrajectories. In ICCV, (pp. 3551\u20133558). Sydney, Australia,IEEE."},{"issue":"4","key":"875_CR40","first-page":"77","volume":"33","author":"O Wang","year":"2014","unstructured":"Wang, O., Schroers, C., Zimmer, H., Gross, M., & Sorkine-Hornung, A. (2014). Videosnapping: Interactive synchronization of multiple videos. ACM Transactions on Graphics (TOG), 33(4), 77.","journal-title":"ACM Transactions on Graphics (TOG)"},{"key":"875_CR41","doi-asserted-by":"crossref","unstructured":"Wu, X., Hauptmann, A.\u00a0G., & Ngo, C.-W. (2007). Practical elimination of near-duplicates from web video search. In ACM Multimedia.","DOI":"10.1145\/1291233.1291280"},{"key":"875_CR42","doi-asserted-by":"crossref","unstructured":"Xiong, C., & Corso, J. (2012). Coaction discovery: Segmentation of common actions across multiple videos. In International Workshop on Multimedia Data Mining.","DOI":"10.1145\/2343862.2343865"},{"key":"875_CR43","doi-asserted-by":"crossref","unstructured":"Yeh, M.-C., & Cheng, K.-T. (2009). Video copy detection by fast sequence matching. In CIVR.","DOI":"10.1145\/1646396.1646449"}],"container-title":["International Journal of Computer Vision"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11263-015-0875-0.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s11263-015-0875-0\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11263-015-0875-0","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2019,6,1]],"date-time":"2019-06-01T12:19:19Z","timestamp":1559391559000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s11263-015-0875-0"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2015,12,22]]},"references-count":43,"journal-issue":{"issue":"3","published-print":{"date-parts":[[2016,9]]}},"alternative-id":["875"],"URL":"https:\/\/doi.org\/10.1007\/s11263-015-0875-0","relation":{},"ISSN":["0920-5691","1573-1405"],"issn-type":[{"value":"0920-5691","type":"print"},{"value":"1573-1405","type":"electronic"}],"subject":[],"published":{"date-parts":[[2015,12,22]]}}}