{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2024,9,7]],"date-time":"2024-09-07T01:51:19Z","timestamp":1725673879325},"reference-count":27,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2018,9]]},"DOI":"10.1109\/bigmm.2018.8499470","type":"proceedings-article","created":{"date-parts":[[2018,10,22]],"date-time":"2018-10-22T20:35:25Z","timestamp":1540240525000},"page":"1-6","source":"Crossref","is-referenced-by-count":2,"title":["Deep Residual Feature Learning for Action Prediction"],"prefix":"10.1109","author":[{"given":"Shuangshuang","family":"Guo","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Laiyun","family":"Qing","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jun","family":"Miao","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Lijuan","family":"Duan","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"doi-asserted-by":"publisher","key":"ref10","DOI":"10.1109\/CVPR.2016.18"},{"doi-asserted-by":"publisher","key":"ref11","DOI":"10.1109\/ICCV.2011.6126349"},{"doi-asserted-by":"publisher","key":"ref12","DOI":"10.1109\/CVPR.2013.343"},{"doi-asserted-by":"publisher","key":"ref13","DOI":"10.1109\/ICCV.2015.365"},{"doi-asserted-by":"publisher","key":"ref14","DOI":"10.1109\/TIP.2017.2751145"},{"key":"ref15","first-page":"300","article-title":"Learning human interaction by interactive phrases","author":"kong","year":"2012","journal-title":"ECCV"},{"doi-asserted-by":"publisher","key":"ref16","DOI":"10.1109\/CVPR.2017.390"},{"key":"ref17","doi-asserted-by":"crossref","DOI":"10.1609\/aaai.v32i1.12324","article-title":"Action Prediction from Videos via Memorizing Hard-to-Predict Samples","author":"kong","year":"2018","journal-title":"AAAI"},{"doi-asserted-by":"publisher","key":"ref18","DOI":"10.1109\/CVPR.2016.214"},{"doi-asserted-by":"publisher","key":"ref19","DOI":"10.1109\/ICCV.2017.39"},{"doi-asserted-by":"publisher","key":"ref4","DOI":"10.1109\/CVPR.2015.7298594"},{"doi-asserted-by":"publisher","key":"ref27","DOI":"10.1109\/CVPR.2015.7298878"},{"key":"ref3","first-page":"448","article-title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift","author":"ioffe","year":"2015","journal-title":"ICML"},{"doi-asserted-by":"publisher","key":"ref6","DOI":"10.1109\/ICCV.2011.6126543"},{"year":"2012","author":"soomro","journal-title":"UCFI0l A dataset of 101 human actions classes from videos in the wild","key":"ref5"},{"doi-asserted-by":"publisher","key":"ref8","DOI":"10.1109\/ICCV.2017.194"},{"year":"2017","author":"kay","journal-title":"The kinetics human action video dataset","key":"ref7"},{"doi-asserted-by":"publisher","key":"ref2","DOI":"10.1109\/CVPR.2016.90"},{"key":"ref9","first-page":"613","article-title":"Generating videos with scene dynamics","author":"vondrick","year":"2016","journal-title":"NIPS"},{"key":"ref1","first-page":"1097","article-title":"Imagenet classification with deep convolutional neural networks","author":"krizhevsky","year":"2012","journal-title":"NIPS"},{"key":"ref20","first-page":"428","article-title":"Human detection using oriented histograms of flow and appearance","author":"dalal","year":"2006","journal-title":"ECCV"},{"doi-asserted-by":"publisher","key":"ref22","DOI":"10.1109\/5254.708428"},{"doi-asserted-by":"publisher","key":"ref21","DOI":"10.1109\/ICCV.2003.1238378"},{"key":"ref24","first-page":"20","article-title":"Temporal segment networks: Towards good practices for deep action recognition","author":"wang","year":"2016","journal-title":"ECCV"},{"key":"ref23","first-page":"568","article-title":"Two-stream convolutional networks for action recognition in videos","author":"simonyan","year":"2014","journal-title":"NIPS"},{"year":"2017","author":"tran","journal-title":"Convnet architecture search for spatiotemporal feature learning","key":"ref26"},{"key":"ref25","first-page":"4489","article-title":"C3D: Generic Features for Video Analysis","author":"tran","year":"2016","journal-title":"ICCV"}],"event":{"name":"2018 IEEE Fourth International Conference on Multimedia Big Data (BigMM)","start":{"date-parts":[[2018,9,13]]},"location":"Xi'an","end":{"date-parts":[[2018,9,16]]}},"container-title":["2018 IEEE Fourth International Conference on Multimedia Big Data (BigMM)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/8482104\/8499056\/08499470.pdf?arnumber=8499470","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2023,9,6]],"date-time":"2023-09-06T03:51:53Z","timestamp":1693972313000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/8499470\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2018,9]]},"references-count":27,"URL":"https:\/\/doi.org\/10.1109\/bigmm.2018.8499470","relation":{},"subject":[],"published":{"date-parts":[[2018,9]]}}}