{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,4,3]],"date-time":"2026-04-03T04:30:51Z","timestamp":1775190651026,"version":"3.50.1"},"reference-count":184,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"11","license":[{"start":{"date-parts":[[2013,11,1]],"date-time":"2013-11-01T00:00:00Z","timestamp":1383264000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Trans. Circuits Syst. Video Technol."],"published-print":{"date-parts":[[2013,11]]},"DOI":"10.1109\/tcsvt.2013.2270402","type":"journal-article","created":{"date-parts":[[2013,6,20]],"date-time":"2013-06-20T18:02:17Z","timestamp":1371751337000},"page":"1993-2008","source":"Crossref","is-referenced-by-count":170,"title":["Video-Based Human Behavior Understanding: A Survey"],"prefix":"10.1109","volume":"23","author":[{"given":"Paulo Vinicius Koerich","family":"Borges","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Nicola","family":"Conci","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Andrea","family":"Cavallaro","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref170","first-page":"1","article-title":"High five: Recognising human interactions in TV shows","author":"patron-perez","year":"2010","journal-title":"Proc British Mach Vision Conf"},{"key":"ref172","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1561\/2200000001","article-title":"Graphical models, exponential families, and variational inference","volume":"1","author":"wainwright","year":"2008","journal-title":"Found Trends Mach Learn"},{"key":"ref171","author":"wolf","year":"2012","journal-title":"The Liris Human Activities Dataset and the Icpr 2012 Human Activities Recognition and Localization Competition"},{"key":"ref174","article-title":"Cost-sensitive top-down\/bottom-up inference for multiscale activity recognition","author":"amer","year":"2012","journal-title":"Proc Eur Conf Comput Vision"},{"key":"ref173","article-title":"Activity forecasting","author":"kitani","year":"2012","journal-title":"Proc Eur Conf Comput Vision"},{"key":"ref176","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-642-33718-5_6"},{"key":"ref175","first-page":"215","article-title":"A unified framework for multitarget tracking and collective activity recognition","author":"choi","year":"2012","journal-title":"Proc Eur Conf Comput Vision"},{"key":"ref178","year":"2012","journal-title":"Xtion Pro"},{"key":"ref177","first-page":"1873","article-title":"Modeling 3-D human poses from uncalibrated monocular images","author":"wei","year":"2009","journal-title":"Proc IEEE Int Conf Comput Vision"},{"key":"ref168","author":"patron-perez","year":"2010","journal-title":"Tv Interactions Dataset"},{"key":"ref169","year":"2013","journal-title":"CMU Graphics Lab Motion Capture Database"},{"key":"ref39","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-008-0194-9"},{"key":"ref38","first-page":"181","volume":"4","author":"bouwmans","year":"2010","journal-title":"Statistical Background Modeling for Foreground Detection A Survey"},{"key":"ref33","first-page":"423","article-title":"A pose-invariant descriptor for human detection and segmentation","author":"lin","year":"2008","journal-title":"Proc Eur Conf Comput Vis"},{"key":"ref32","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2005.272"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2009.5206754"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2009.167"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2011.5995574"},{"key":"ref36","year":"2012","journal-title":"Person Dataset"},{"key":"ref35","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-005-6644-8"},{"key":"ref34","doi-asserted-by":"publisher","DOI":"10.1109\/TITS.2007.894194"},{"key":"ref181","doi-asserted-by":"publisher","DOI":"10.1109\/TITS.2009.2032770"},{"key":"ref180","doi-asserted-by":"publisher","DOI":"10.1016\/j.patcog.2010.05.014"},{"key":"ref184","doi-asserted-by":"publisher","DOI":"10.5244\/C.25.109"},{"key":"ref183","first-page":"610","article-title":"Efficiently scaling up video annotation with crowdsourced marketplaces","author":"vondrick","year":"2010","journal-title":"Proc Eur Conf Comput Vision"},{"key":"ref182","doi-asserted-by":"publisher","DOI":"10.1109\/ICIP.2012.6467059"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2001.990517"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2005.177"},{"key":"ref179","year":"2013","journal-title":"Microsoft Kinect"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1109\/TCSVT.2008.928213"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/TCSVT.2008.2005594"},{"key":"ref22","doi-asserted-by":"crossref","first-page":"193","DOI":"10.7551\/mitpress\/3838.003.0014","article-title":"Making sense of human behavior: Action parsing and intentional inference","author":"baird","year":"2001","journal-title":"Proc Intentions Intentionality Foundations Soc Cogn"},{"key":"ref21","volume":"2","author":"maslow","year":"1970","journal-title":"Motivation and Personality"},{"key":"ref24","volume":"3","author":"doise","year":"1984","journal-title":"Social Interaction in Individual Development"},{"key":"ref23","author":"thibaut","year":"1959","journal-title":"The Social Psychology of Groups"},{"key":"ref26","first-page":"26","article-title":"Detecting pedestrians with stereo vision: Safe operation of autonomous ground vehicles in dynamic environments","author":"howard","year":"2007","journal-title":"Proc 13th Int Symp Robotics Res"},{"key":"ref101","author":"ryoo","year":"2010","journal-title":"UT-Interaction Dataset ICPR Contest on Semantic Description of Human Activities (SDHA)"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-006-9038-7"},{"key":"ref100","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2011.6126349"},{"key":"ref50","author":"manolakis","year":"2000","journal-title":"Statistical and Adaptive Signal Processing"},{"key":"ref51","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-006-8575-4"},{"key":"ref154","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2009.5459224"},{"key":"ref153","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2009.5206641"},{"key":"ref156","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-642-11756-5_2"},{"key":"ref155","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2009.5459260"},{"key":"ref150","volume":"6","author":"hall","year":"1966","journal-title":"The Hidden Dimension"},{"key":"ref152","doi-asserted-by":"publisher","DOI":"10.1103\/PhysRevE.51.4282"},{"key":"ref151","author":"hall","year":"1973","journal-title":"The Silent Language"},{"key":"ref146","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2007.383137"},{"key":"ref147","year":"2011","journal-title":"Gesture Dataset"},{"key":"ref148","author":"marcel","year":"2000","journal-title":"Hand Posture and Gesture Datasets"},{"key":"ref149","doi-asserted-by":"publisher","DOI":"10.1007\/978-1-4471-4640-7_10"},{"key":"ref59","doi-asserted-by":"publisher","DOI":"10.1109\/TITS.2009.2018961"},{"key":"ref58","doi-asserted-by":"publisher","DOI":"10.1109\/TCSVT.2010.2087570"},{"key":"ref57","first-page":"662","article-title":"Feature sets for people and luggage recognition in airport surveillance under real-time constraints","author":"rosell","year":"2008","journal-title":"Proc VISIGRAPP"},{"key":"ref56","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2011.5995698"},{"key":"ref55","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2007.383072"},{"key":"ref54","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2009.5459372"},{"key":"ref53","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2003.1238420"},{"key":"ref52","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2010.5540102"},{"key":"ref40","doi-asserted-by":"publisher","DOI":"10.1109\/TCSVT.2012.2203217"},{"key":"ref167","year":"2007","journal-title":"The Behave Dataset"},{"key":"ref166","author":"koppula","year":"2013","journal-title":"Learning human activities and object affordances from RGB-D videos"},{"key":"ref165","doi-asserted-by":"publisher","DOI":"10.1162\/jmlr.2003.3.4-5.993"},{"key":"ref164","first-page":"2044","article-title":"4-dimensional local spatio-temporal features for human activity recognition","author":"zhang","year":"2011","journal-title":"Proc IEEE\/RSJ Int Conf Intell Robots Syst"},{"key":"ref163","doi-asserted-by":"publisher","DOI":"10.1145\/2370216.2370248"},{"key":"ref162","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2011.5995558"},{"key":"ref161","first-page":"452","article-title":"Improving data association by joint modeling of pedestrian trajectories and groupings","author":"pellegrini","year":"2010","journal-title":"Proc Eur Conf Comput Vision"},{"key":"ref160","first-page":"1470","article-title":"Recognizing human group activities with localized causalities","author":"ni","year":"2009","journal-title":"Proc IEEE Conf Comput Vision Pattern Recogn"},{"key":"ref4","first-page":"211","article-title":"A 3-D facial expression database for facial behavior research","author":"yin","year":"2006","journal-title":"Proc IEEE Int Conf Autom Face Gesture Recogn"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1145\/1274940.1274966"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1016\/j.patcog.2011.10.023"},{"key":"ref5","first-page":"191","article-title":"The aware home: A living laboratory for ubiquitous computing research","author":"kidd","year":"1999","journal-title":"Proc Cooperative Build Integr Inform Org Arch"},{"key":"ref159","doi-asserted-by":"publisher","DOI":"10.1109\/PASSAT\/SocialCom.2011.32"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2011.157"},{"key":"ref7","author":"snoek","year":"2009","journal-title":"The Mediamill Trecvid 2008 Semantic Video Search Engine"},{"key":"ref49","doi-asserted-by":"publisher","DOI":"10.1017\/CBO9780511609602"},{"key":"ref157","first-page":"111","article-title":"Real time detection of social interactions in surveillance video","author":"rota","year":"2012","journal-title":"Proc 3rd Int Workshop Anal Retrieval Tracked Events Motion Imagery Streams Eur Conf Comput Vision"},{"key":"ref158","doi-asserted-by":"publisher","DOI":"10.1145\/1878039.1878048"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-012-0532-9"},{"key":"ref46","doi-asserted-by":"publisher","DOI":"10.1109\/34.868681"},{"key":"ref45","doi-asserted-by":"publisher","DOI":"10.1016\/j.patrec.2008.03.007"},{"key":"ref48","doi-asserted-by":"publisher","DOI":"10.1016\/j.cviu.2004.04.004"},{"key":"ref47","doi-asserted-by":"publisher","DOI":"10.1109\/CISP.2008.718"},{"key":"ref42","doi-asserted-by":"publisher","DOI":"10.1016\/0031-3203(94)90079-5"},{"key":"ref41","first-page":"1","article-title":"Recognizing people by their gait: The shape of motion","volume":"1","author":"little","year":"1998","journal-title":"Videre J Comput Vision Res"},{"key":"ref44","article-title":"Real-time object tracking and classification using a static camera","author":"johnsen","year":"2009","journal-title":"Proc IEEE Int Conf Robotics Autom Workshop People Detect Track"},{"key":"ref43","doi-asserted-by":"publisher","DOI":"10.1016\/j.imavis.2006.01.033"},{"key":"ref127","first-page":"1007","article-title":"Action recognition using rank-1 approximation of joint self-similarity volume","author":"sun","year":"2011","journal-title":"Proc IEEE Int Conf Comput Vision"},{"key":"ref126","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2010.214"},{"key":"ref125","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2007.4409011"},{"key":"ref124","first-page":"570","article-title":"Human activity recognition using sequences of postures","author":"kellokumpu","year":"2005","journal-title":"Proc IAPR Conf Mach Vis Appl"},{"key":"ref73","year":"2005","journal-title":"Computational Vision Group?University of Reading U K"},{"key":"ref72","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2007.4409092"},{"key":"ref129","doi-asserted-by":"crossref","first-page":"1499","DOI":"10.1109\/TCSVT.2008.2005597","article-title":"Expandable data-driven graphical modeling of human actions based on salient postures","volume":"18","author":"li","year":"2008","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"ref71","first-page":"90","article-title":"Detection of multiple, partially occluded humans in a single image by Bayesian combination of edgelet part detectors","volume":"1","author":"wu","year":"2005","journal-title":"Proc IEEE Int Conf Comput Vision"},{"key":"ref128","doi-asserted-by":"publisher","DOI":"10.1109\/ACV.1998.732852"},{"key":"ref70","first-page":"1","article-title":"Cluster boosted tree classifier for multiview, multipose object detection","author":"wu","year":"2007","journal-title":"Proc IEEE Int Conf Comput Vision"},{"key":"ref76","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.1992.223161"},{"key":"ref130","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2011.5995316"},{"key":"ref77","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2011.5995707"},{"key":"ref74","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-005-1838-7"},{"key":"ref75","doi-asserted-by":"publisher","DOI":"10.1109\/ICPR.2004.1334462"},{"key":"ref133","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2005.28"},{"key":"ref134","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2008.4587756"},{"key":"ref131","first-page":"47","article-title":"Human activity detection from RGBD images","author":"sung","year":"2011","journal-title":"Proc AAAI Workshop Pattern Activity Intent Recognit"},{"key":"ref78","doi-asserted-by":"publisher","DOI":"10.1016\/j.patrec.2008.02.023"},{"key":"ref132","first-page":"842","article-title":"Unstructured human activity detection from RGBD images","author":"sung","year":"2012","journal-title":"Proc IEEE Int Conf Robotics Autom"},{"key":"ref79","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2012.6247806"},{"key":"ref136","doi-asserted-by":"publisher","DOI":"10.1016\/j.cviu.2006.07.013"},{"key":"ref135","doi-asserted-by":"publisher","DOI":"10.1007\/s00138-012-0450-4"},{"key":"ref138","first-page":"59","article-title":"3DPEs: 3-D people dataset for surveillance and forensics","author":"baltieri","year":"2011","journal-title":"Proc 1st Int ACM Workshop Multimedia Access 3-D Human Objects"},{"key":"ref137","doi-asserted-by":"publisher","DOI":"10.1109\/AVSS.2010.63"},{"key":"ref60","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW.2011.5981800"},{"key":"ref139","first-page":"1","article-title":"Trajectory analysis and semantic region modeling using a nonparametric Bayesian model","author":"wang","year":"2008","journal-title":"Proc IEEE Conf Comput Vision Pattern Recogn"},{"key":"ref62","author":"dalal","year":"2006","journal-title":"Finding People in Images and Videos"},{"key":"ref61","doi-asserted-by":"publisher","DOI":"10.1016\/j.cviu.2006.08.009"},{"key":"ref63","doi-asserted-by":"crossref","first-page":"23","DOI":"10.1007\/3-540-59119-2_166","author":"freund","year":"1995","journal-title":"Computational Learning Theory"},{"key":"ref64","doi-asserted-by":"publisher","DOI":"10.1109\/ICPR.2008.4761703"},{"key":"ref140","year":"0","journal-title":"Edinburgh Informatics Forum Pedestrian Database"},{"key":"ref65","doi-asserted-by":"publisher","DOI":"10.1109\/ICPR.2010.758"},{"key":"ref141","author":"kadous","year":"2002","journal-title":"Temporal Classification Extending the Classification Paradigm to Multivariate Time Series"},{"key":"ref66","doi-asserted-by":"crossref","first-page":"1003","DOI":"10.1109\/TPAMI.2011.176","article-title":"Vision-based analysis of small groups in pedestrian crowds","volume":"34","author":"ge","year":"2012","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"ref142","year":"0","journal-title":"Two Handed Gesture Dataset"},{"key":"ref67","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW.2011.5981811"},{"key":"ref143","author":"holte","year":"2004","journal-title":"Pointing and Command Gestures Under Mixed Illumination Conditions Video Sequence Dataset"},{"key":"ref68","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2011.6095074"},{"key":"ref144","doi-asserted-by":"publisher","DOI":"10.1109\/AFGR.2000.840674"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-540-72348-6_3"},{"key":"ref69","year":"2000","journal-title":"CBCL Pedestrian Database"},{"key":"ref145","year":"0","journal-title":"FGnet Pointing'04 Benchmark Data"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2007.70731"},{"key":"ref109","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2009.5206492"},{"key":"ref95","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-012-0594-8"},{"key":"ref108","doi-asserted-by":"publisher","DOI":"10.1016\/j.cviu.2011.03.003"},{"key":"ref94","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2011.6126443"},{"key":"ref107","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2010.60"},{"key":"ref93","first-page":"2004","article-title":"Hierarchical spatio-temporal context modeling for action recognition","author":"sun","year":"2009","journal-title":"Proc IEEE Conf Comput Vision Pattern Recogn"},{"key":"ref92","first-page":"1933","article-title":"Selection and context for action recognition","author":"han","year":"2009","journal-title":"Proc IEEE Int Conf Comput Vision"},{"key":"ref106","doi-asserted-by":"publisher","DOI":"10.1109\/ICIP.2010.5653507"},{"key":"ref91","doi-asserted-by":"publisher","DOI":"10.5244\/C.24.95"},{"key":"ref105","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2011.5995470"},{"key":"ref90","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2009.5206779"},{"key":"ref104","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2012.6247807"},{"key":"ref103","first-page":"1282","article-title":"What are they doing?: Collective activity classification using spatio-temporal relationship among people","author":"choi","year":"2009","journal-title":"Proc IEEE Int Conf Comput Vision Workshops"},{"key":"ref102","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-012-0534-7"},{"key":"ref111","first-page":"1365","article-title":"Poselets: Body part detectors trained using 3-D human pose annotations","author":"bourdev","year":"2009","journal-title":"Proc IEEE Int Conf Comput Vision"},{"key":"ref112","first-page":"1378","article-title":"Object bank: A high-level image representation for scene classification and semantic feature sparsification","volume":"24","author":"li","year":"2010","journal-title":"Proc Adv Neural Inf Process Syst"},{"key":"ref110","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2013.342"},{"key":"ref98","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2008.4587727"},{"key":"ref99","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2011.5995555"},{"key":"ref96","first-page":"1996","article-title":"Recognizing realistic actions from videos in the wild","author":"liu","year":"2009","journal-title":"Proc IEEE Conf Comput Vision Pattern Recogn"},{"key":"ref97","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2009.5206557"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2010.69"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2008.260"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2009.122"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2009.5206631"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2011.155"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1109\/TCSVT.2008.927109"},{"key":"ref118","doi-asserted-by":"publisher","DOI":"10.1016\/j.imavis.2006.01.012"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1016\/j.cviu.2006.08.002"},{"key":"ref82","doi-asserted-by":"publisher","DOI":"10.1109\/ICME.2007.4284738"},{"key":"ref117","doi-asserted-by":"publisher","DOI":"10.1109\/TIT.1962.1057692"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1016\/j.imavis.2009.11.014"},{"key":"ref81","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2011.6126397"},{"key":"ref84","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-007-0122-4"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1145\/1922649.1922653"},{"key":"ref119","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2010.5539877"},{"key":"ref19","doi-asserted-by":"crossref","first-page":"103","DOI":"10.1007\/3-540-46616-9_10","article-title":"Vision-based gesture recognition: A review","author":"wu","year":"1999","journal-title":"Proc Gesture-Based Commun Human Comput Interaction"},{"key":"ref83","doi-asserted-by":"publisher","DOI":"10.1109\/VSPETS.2005.1570899"},{"key":"ref114","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2009.5459154"},{"key":"ref113","author":"messing","year":"2011","journal-title":"Human activity recognition in video Extending statistical features across time space and semantic context"},{"key":"ref116","doi-asserted-by":"publisher","DOI":"10.1109\/34.910878"},{"key":"ref80","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2011.5995407"},{"key":"ref115","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2011.5995444"},{"key":"ref120","first-page":"9","article-title":"Action recognition based on a bag of 3-D points","author":"li","year":"2010","journal-title":"Proc IEEE Conf Comput Vision Pattern Recogn"},{"key":"ref89","doi-asserted-by":"publisher","DOI":"10.5244\/C.2.23"},{"key":"ref121","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2007.383298"},{"key":"ref122","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-642-15387-7_41"},{"key":"ref123","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW.2011.5981803"},{"key":"ref85","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2007.4408988"},{"key":"ref86","first-page":"1","article-title":"Learning human actions via information maximization","author":"liu","year":"2008","journal-title":"Proc IEEE Conf Comput Vision Pattern Recogn"},{"key":"ref87","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2009.5459361"},{"key":"ref88","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2003.1238378"}],"container-title":["IEEE Transactions on Circuits and Systems for Video Technology"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/76\/6648684\/06544585.pdf?arnumber=6544585","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,5,12]],"date-time":"2024-05-12T18:22:17Z","timestamp":1715538137000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/6544585"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2013,11]]},"references-count":184,"journal-issue":{"issue":"11"},"URL":"https:\/\/doi.org\/10.1109\/tcsvt.2013.2270402","relation":{},"ISSN":["1051-8215","1558-2205"],"issn-type":[{"value":"1051-8215","type":"print"},{"value":"1558-2205","type":"electronic"}],"subject":[],"published":{"date-parts":[[2013,11]]}}}