{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,5,30]],"date-time":"2025-05-30T04:13:46Z","timestamp":1748578426109,"version":"3.41.0"},"publisher-location":"Cham","reference-count":24,"publisher":"Springer International Publishing","isbn-type":[{"type":"print","value":"9783319232300"},{"type":"electronic","value":"9783319232317"}],"license":[{"start":{"date-parts":[[2015,1,1]],"date-time":"2015-01-01T00:00:00Z","timestamp":1420070400000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2015]]},"DOI":"10.1007\/978-3-319-23231-7_22","type":"book-chapter","created":{"date-parts":[[2015,8,20]],"date-time":"2015-08-20T02:51:21Z","timestamp":1440039081000},"page":"236-245","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":4,"title":["A Strict Pyramidal Deep Neural Network for Action Recognition"],"prefix":"10.1007","author":[{"given":"Ihsan","family":"Ullah","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Alfredo","family":"Petrosino","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2015,8,21]]},"reference":[{"key":"22_CR1","doi-asserted-by":"crossref","unstructured":"Schindler, K., Van Gool, L.: Action Snippets: How many frames does human action recognition require? In: 26th IEEE Conference on Computer Vision and Pattern Recognition, CVPR (2008)","DOI":"10.1109\/CVPR.2008.4587730"},{"key":"22_CR2","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"crossref","first-page":"727","DOI":"10.1007\/978-3-319-10605-2_47","volume-title":"Computer Vision \u2013 ECCV 2014","author":"X Yang","year":"2014","unstructured":"Yang, X., Tian, Y.L.: Action Recognition using super sparse coding vector with spatio-temporal awareness. In: Fleet, D., Pajdla, T., Schiele, B., Tuytelaars, T. (eds.) ECCV 2014, Part II. LNCS, vol. 8690, pp. 727\u2013741. Springer, Heidelberg (2014)"},{"key":"22_CR3","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"crossref","first-page":"502","DOI":"10.1007\/978-3-319-14442-9_55","volume-title":"MultiMedia Modeling","author":"W Liu","year":"2015","unstructured":"Liu, W., Wang, Z., Tao, D., Yu, J.: Hessian regularized sparse coding for human action recognition. In: He, X., Luo, S., Tao, D., Xu, C., Yang, J., Hasan, M.A. (eds.) MMM 2015, Part II. LNCS, vol. 8936, pp. 502\u2013511. Springer, Heidelberg (2015)"},{"issue":"15","key":"22_CR4","doi-asserted-by":"publisher","first-page":"1990","DOI":"10.1016\/j.patrec.2013.04.025","volume":"34","author":"R Melfi","year":"2013","unstructured":"Melfi, R., Kondra, S., Petrosino, A.: Human activity modeling by spatio temporal textural appearance. Pattern Recognition Letters 34(15), 1990\u20131994 (2013)","journal-title":"Pattern Recognition Letters"},{"key":"22_CR5","doi-asserted-by":"crossref","unstructured":"Efros, A.-A., Berg, A.C., Mori, G., Malik, J.: Recognizing action at a distance. In: Proceedings Ninth IEEE International Conference on Computer Vision, pp. 726\u2013733. IEEE Computer Society (2003)","DOI":"10.1109\/ICCV.2003.1238420"},{"key":"22_CR6","doi-asserted-by":"crossref","unstructured":"Sch\u00fcldt, C., Laptev, I., Caputo, B.: Recognizing human actions: a local SVM approach. In: Proceedings - International Conference on Pattern Recognition, vol. 3, pp. 32\u201336 (2004)","DOI":"10.1109\/ICPR.2004.1334462"},{"issue":"4 PART 2","key":"22_CR7","doi-asserted-by":"publisher","first-page":"1234","DOI":"10.1109\/TMM.2012.2191268","volume":"14","author":"L Ballan","year":"2012","unstructured":"Ballan, L., Bertini, M., Del Bimbo, A., Seidenari, L., Serra, G.: Effective codebooks for human action representation and classification in unconstrained videos. IEEE Transactions on Multimedia 14(4 PART 2), 1234\u20131245 (2012)","journal-title":"IEEE Transactions on Multimedia"},{"issue":"2","key":"22_CR8","doi-asserted-by":"publisher","first-page":"236","DOI":"10.1109\/TCSVT.2012.2203731","volume":"23","author":"D Wu","year":"2013","unstructured":"Wu, D., Shao, L.: Silhouette analysis-based action recognition via exploiting human poses. IEEE Transactions on Circuits and Systems for Video Technology 23(2), 236\u2013243 (2013)","journal-title":"IEEE Transactions on Circuits and Systems for Video Technology"},{"issue":"15","key":"22_CR9","doi-asserted-by":"publisher","first-page":"1799","DOI":"10.1016\/j.patrec.2013.01.021","volume":"34","author":"AA Chaaraoui","year":"2013","unstructured":"Chaaraoui, A.A., Climent-Prez, P., Flrez-Revuelta, F.: Silhouette-based human action recognition using sequences of key poses. Pattern Recognition Letters 34(15), 1799\u20131807 (2013). Smart Approaches for Human Action Recognition","journal-title":"Pattern Recognition Letters"},{"issue":"8","key":"22_CR10","doi-asserted-by":"publisher","first-page":"1798","DOI":"10.1109\/TPAMI.2013.50","volume":"35","author":"Y Bengio","year":"2013","unstructured":"Bengio, Y., Courville, A., Vincent, P.: Representation learning: A review and new perspectives. IEEE Trans. Pattern Anal. Mach. Intell. 35(8), 1798\u20131828 (2013)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"22_CR11","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"140","DOI":"10.1007\/978-3-642-15567-3_11","volume-title":"Computer Vision \u2013 ECCV 2010","author":"GW Taylor","year":"2010","unstructured":"Taylor, G.W., Fergus, R., LeCun, Y., Bregler, C.: Convolutional learning of spatio-temporal features. In: Daniilidis, K., Maragos, P., Paragios, N. (eds.) ECCV 2010, Part VI. LNCS, vol. 6316, pp. 140\u2013153. Springer, Heidelberg (2010)"},{"key":"22_CR12","unstructured":"Freitas, N.D.: Deep learning of invariant spatio temporal features from video. In: Workshop on Deep Learning and Unsupervised Feature Learning in NIPS, pp. 1\u20139 (2010)"},{"key":"22_CR13","doi-asserted-by":"crossref","unstructured":"Le, Q.V., Zou, W.Y., Yeung, S.Y., Ng, A.Y.: Learning hierarchical invariant spatio-temporal features for action recognition with independent subspace analysis. In: Proceedings of the IEEE Computer Society Conference on Computer Vision and Pattern Recognition, pp. 3361\u20133368 (2011)","DOI":"10.1109\/CVPR.2011.5995496"},{"issue":"1","key":"22_CR14","doi-asserted-by":"publisher","first-page":"221","DOI":"10.1109\/TPAMI.2012.59","volume":"35","author":"S Ji","year":"2013","unstructured":"Ji, S., Yang, M., Yu, K.: 3D convolutional neural networks for human action recognition. IEEE transactions on pattern analysis and machine intelligence 35(1), 221\u201331 (2013)","journal-title":"IEEE transactions on pattern analysis and machine intelligence"},{"key":"22_CR15","unstructured":"Krizhevsky, A., Sutskever, I., Hinton, G.E.: Imagenet classification with deep convolutional neural networks. In: Advances in Neural Information Processing Systems, pp. 1097\u20131105 (2012)"},{"key":"22_CR16","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"29","DOI":"10.1007\/978-3-642-25446-8_4","volume-title":"Human Behavior Understanding","author":"M Baccouche","year":"2011","unstructured":"Baccouche, M., Mamalet, F., Wolf, C., Garcia, C., Baskurt, A.: Sequential deep learning for human action recognition. In: Salah, A.A., Lepri, B. (eds.) HBU 2011. LNCS, vol. 7065, pp. 29\u201339. Springer, Heidelberg (2011)"},{"issue":"1","key":"22_CR17","doi-asserted-by":"publisher","first-page":"221","DOI":"10.1109\/TPAMI.2012.59","volume":"35","author":"S Ji","year":"2013","unstructured":"Ji, S., Xu, W., Yang, M., Yu, K.: 3d convolutional neural networks for human action recognition. IEEE Transactions on Pattern Analysis and Machine Intelligence 35(1), 221\u2013231 (2013)","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"issue":"2","key":"22_CR18","doi-asserted-by":"publisher","first-page":"472","DOI":"10.1109\/72.991433","volume":"13","author":"V Cantoni","year":"2002","unstructured":"Cantoni, V., Petrosino, A.: Neural recognition in a pyramidal structure. IEEE Transactions on Neural Networks 13(2), 472\u2013480 (2002)","journal-title":"IEEE Transactions on Neural Networks"},{"issue":"2","key":"22_CR19","doi-asserted-by":"publisher","first-page":"329","DOI":"10.1109\/TNN.2006.884677","volume":"18","author":"SL Phung","year":"2007","unstructured":"Phung, S.L., Bouzerdoum, A.: A pyramidal neural network for visual pattern recognition. IEEE transactions on neural networks \/ a publication of the IEEE Neural Networks Council 18(2), 329\u2013343 (2007)","journal-title":"IEEE transactions on neural networks \/ a publication of the IEEE Neural Networks Council"},{"issue":"2","key":"22_CR20","doi-asserted-by":"publisher","first-page":"119","DOI":"10.1016\/0893-6080(88)90014-7","volume":"1","author":"K Fukushima","year":"1988","unstructured":"Fukushima, K.: Neocognitron: A hierarchical neural network capable of visual pattern recognition. Neural Networks 1(2), 119\u2013130 (1988)","journal-title":"Neural Networks"},{"issue":"11","key":"22_CR21","doi-asserted-by":"publisher","first-page":"2278","DOI":"10.1109\/5.726791","volume":"86","author":"Y Lecun","year":"1998","unstructured":"Lecun, Y., Bottou, L., Bengio, Y., Haffner, P.: Gradient-based learning applied to document recognition. Proceedings of the IEEE 86(11), 2278\u20132324 (1998)","journal-title":"Proceedings of the IEEE"},{"key":"22_CR22","unstructured":"Maas, A.L., Hannun, A.Y., Ng, A.Y.: Rectifier nonlinearities improve neural network acoustic models. In: Proc. ICML, vol. 30 (2013)"},{"key":"22_CR23","doi-asserted-by":"crossref","unstructured":"Doll\u00e1r, P., Rabaud, V., Cottrell, G., Belongie, S.: Behavior recognition via sparse spatio-temporal features. In: Proceedings - 2nd Joint IEEE International Workshop on Visual Surveillance and Performance Evaluation of Tracking and Surveillance, VS-PETS 2005, pp. 65\u201372 (2005)","DOI":"10.1109\/VSPETS.2005.1570899"},{"key":"22_CR24","doi-asserted-by":"publisher","first-page":"65","DOI":"10.1016\/j.cviu.2013.11.006","volume":"122","author":"L Maddalena","year":"2014","unstructured":"Maddalena, L., Petrosino, A.: The 3dsobs+ algorithm for moving object detection. Computer Vision and Image Understanding 122, 65\u201373 (2014)","journal-title":"Computer Vision and Image Understanding"}],"container-title":["Lecture Notes in Computer Science","Image Analysis and Processing \u2014 ICIAP 2015"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-319-23231-7_22","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,5,30]],"date-time":"2025-05-30T02:39:59Z","timestamp":1748572799000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/978-3-319-23231-7_22"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2015]]},"ISBN":["9783319232300","9783319232317"],"references-count":24,"URL":"https:\/\/doi.org\/10.1007\/978-3-319-23231-7_22","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"type":"print","value":"0302-9743"},{"type":"electronic","value":"1611-3349"}],"subject":[],"published":{"date-parts":[[2015]]},"assertion":[{"value":"21 August 2015","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}}]}}