{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,7]],"date-time":"2026-05-07T16:25:06Z","timestamp":1778171106117,"version":"3.51.4"},"reference-count":35,"publisher":"IEEE","license":[{"start":{"date-parts":[[2021,1,10]],"date-time":"2021-01-10T00:00:00Z","timestamp":1610236800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"},{"start":{"date-parts":[[2021,1,10]],"date-time":"2021-01-10T00:00:00Z","timestamp":1610236800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2021,1,10]],"date-time":"2021-01-10T00:00:00Z","timestamp":1610236800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62022011"],"award-info":[{"award-number":["62022011"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2021,1,10]]},"DOI":"10.1109\/icpr48806.2021.9412213","type":"proceedings-article","created":{"date-parts":[[2021,5,6]],"date-time":"2021-05-06T02:15:54Z","timestamp":1620267354000},"page":"3744-3750","source":"Crossref","is-referenced-by-count":10,"title":["Towards Practical Compressed Video Action Recognition: A Temporal Enhanced Multi-Stream Network"],"prefix":"10.1109","author":[{"given":"Bing","family":"Li","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Longteng","family":"Kong","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Dongming","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Xiuguo","family":"Bao","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Di","family":"Huang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yunhong","family":"Wang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref33","article-title":"Adam: A method for stochastic optimization","author":"kingma","year":"2014","journal-title":"ArXiv Preprint"},{"key":"ref32","article-title":"Ucf101: A dataset of 101 human actions classes from videos in the wild","author":"soomro","year":"2012","journal-title":"ArXiv Preprint"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2011.6126543"},{"key":"ref30","first-page":"3104","article-title":"Sequence to sequence learning with neural networks","author":"sutskever","year":"2014","journal-title":"Advances in Neural IInformation Processing Systems"},{"key":"ref35","first-page":"8026","article-title":"Pytorch: An imperative style, high-performance deep learning library","author":"paszke","year":"2019","journal-title":"Advances in Neural IInformation Processing Systems"},{"key":"ref34","first-page":"4601","article-title":"Professor forcing: A new algorithm for training recurrent networks","author":"goyal","year":"2016","journal-title":"Advances in Neural IInformation Processing Systems"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2016.297"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/TIP.2018.2791180"},{"key":"ref12","article-title":"Compressed video action recognition with refined motion vector","author":"cao","year":"2019","journal-title":"ArXiv Preprint"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2019.00136"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW50498.2020.00350"},{"key":"ref15","article-title":"Flow-distilled ip two-stream networks for compressed video actionrecognition","author":"huang","year":"2019","journal-title":"ArXiv Preprint"},{"key":"ref16","article-title":"Mobile video action recognition","author":"huo","year":"2019","journal-title":"ArXiv Preprint"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2017.361"},{"key":"ref18","first-page":"886","article-title":"Histograms of oriented gradients for human detection","author":"dalal","year":"2005","journal-title":"IEEE Computer Vision and Pattern Recognition"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2008.4587756"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00631"},{"key":"ref4","first-page":"831","article-title":"Temporal relational reasoning in videos","volume":"11205","author":"zhou","year":"0","journal-title":"European Conference on Computer Vision"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2017.590"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-540-74936-3_22"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1109\/WACV.2018.00173"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2016.90"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2016.213"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-013-0683-3"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2019.00563"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2015.510"},{"key":"ref9","first-page":"1942","article-title":"Learning activity progression in lstms for activity detection and early detection","author":"ma","year":"2016","journal-title":"IEEE Computer Vision and Pattern Recognition"},{"key":"ref1","first-page":"568","article-title":"Two-stream convolutional networks for action recognition in videos","author":"simonyan","year":"2014","journal-title":"Advances in Neural IInformation Processing Systems"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-012-0594-8"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00931"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2013.441"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2019.00718"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2017.179"},{"key":"ref26","article-title":"Temporal 3d convnets: New architecture and transfer learning for video classification","author":"diba","year":"2017","journal-title":"ArXiv Preprint"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2012.59"}],"event":{"name":"2020 25th International Conference on Pattern Recognition (ICPR)","location":"Milan, Italy","start":{"date-parts":[[2021,1,10]]},"end":{"date-parts":[[2021,1,15]]}},"container-title":["2020 25th International Conference on Pattern Recognition (ICPR)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/9411940\/9411911\/09412213.pdf?arnumber=9412213","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,5,10]],"date-time":"2022-05-10T15:40:53Z","timestamp":1652197253000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/9412213\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2021,1,10]]},"references-count":35,"URL":"https:\/\/doi.org\/10.1109\/icpr48806.2021.9412213","relation":{},"subject":[],"published":{"date-parts":[[2021,1,10]]}}}