{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,24]],"date-time":"2026-06-24T05:27:00Z","timestamp":1782278820086,"version":"3.54.5"},"reference-count":229,"publisher":"Springer Science and Business Media LLC","issue":"5","license":[{"start":{"date-parts":[[2018,3,26]],"date-time":"2018-03-26T00:00:00Z","timestamp":1522022400000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Vis Comput"],"published-print":{"date-parts":[[2019,5]]},"DOI":"10.1007\/s00371-018-1499-5","type":"journal-article","created":{"date-parts":[[2018,3,26]],"date-time":"2018-03-26T05:16:46Z","timestamp":1522041406000},"page":"753-776","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":124,"title":["Convolutional neural networks for crowd behaviour analysis: a survey"],"prefix":"10.1007","volume":"35","author":[{"given":"Gaurav","family":"Tripathi","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Kuldeep","family":"Singh","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Dinesh Kumar","family":"Vishwakarma","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2018,3,26]]},"reference":[{"issue":"7","key":"1499_CR1","doi-asserted-by":"publisher","first-page":"1527","DOI":"10.1162\/neco.2006.18.7.1527","volume":"18","author":"GE Hinton","year":"2006","unstructured":"Hinton, G.E., Osindero, S., Teh, Y.W.: A fast learning algorithm for deep belief nets. Neural Comput. 18(7), 1527\u20131554 (2006)","journal-title":"Neural Comput."},{"issue":"8","key":"1499_CR2","doi-asserted-by":"publisher","first-page":"1798","DOI":"10.1109\/TPAMI.2013.50","volume":"35","author":"Y Bengio","year":"2013","unstructured":"Bengio, Y., Courville, A., Vincent, P.: Representation learning: a review and new perspectives. IEEE Trans. Pattern Anal. Mach. Intell. 35(8), 1798\u20131828 (2013)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"1499_CR3","unstructured":"Deng, L.: An overview of deep-structured learning for information processing. In: Asian-Pacific Signal and Information Processing Annual Summit and Conference (APSIPA-ASC), Oct. 2011"},{"issue":"3","key":"1499_CR4","doi-asserted-by":"publisher","first-page":"71","DOI":"10.1016\/j.physrep.2012.03.004","volume":"517","author":"T Vicsek","year":"2012","unstructured":"Vicsek, T., Zafeiris, A.: Collective motion. Phys. Rep. 517(3), 71\u2013140 (2012)","journal-title":"Phys. Rep."},{"issue":"6","key":"1499_CR5","doi-asserted-by":"publisher","first-page":"82","DOI":"10.1109\/MSP.2012.2205597","volume":"29","author":"G Hinton","year":"2012","unstructured":"Hinton, G.: Deep neural networks for acoustic modelling in speech recognition. IEEE Signal Process. Mag. 29(6), 82\u201397 (2012)","journal-title":"IEEE Signal Process. Mag."},{"issue":"1","key":"1499_CR6","doi-asserted-by":"publisher","first-page":"145","DOI":"10.1109\/MSP.2010.939038","volume":"28","author":"D Yu","year":"2011","unstructured":"Yu, D., Deng, L.: Deep learning and its applications to signal and information processing. IEEE Signal Process. Mag. 28(1), 145\u2013154 (2011)","journal-title":"IEEE Signal Process. Mag."},{"issue":"4","key":"1499_CR7","doi-asserted-by":"publisher","first-page":"13","DOI":"10.1109\/MCI.2010.938364","volume":"5","author":"I Arel","year":"2010","unstructured":"Arel, I., Rose, C., Karnowski, T.: Deep machine learning\u2014a new frontier in artificial intelligence. IEEE Comput. Intell. Mag. 5(4), 13\u201318 (2010)","journal-title":"IEEE Comput. Intell. Mag."},{"key":"1499_CR8","doi-asserted-by":"publisher","first-page":"e2","DOI":"10.1017\/atsip.2013.9","volume":"3","author":"L Deng","year":"2014","unstructured":"Deng, L.: A tutorial survey of architectures, algorithms, and applications for deep learning. APSIPA Trans. Signal Inf. Process. 3, e2 (2014)","journal-title":"APSIPA Trans. Signal Inf. Process."},{"issue":"4","key":"1499_CR9","doi-asserted-by":"publisher","first-page":"193","DOI":"10.1007\/BF00344251","volume":"36","author":"K Fukushima","year":"1980","unstructured":"Fukushima, K.: Neocognitron: a self-organizing neural network model for a mechanism of pattern recognition unaffected by shift in position. Biol. Cybern. 36(4), 193\u2013202 (1980)","journal-title":"Biol. Cybern."},{"issue":"4","key":"1499_CR10","doi-asserted-by":"publisher","first-page":"711","DOI":"10.1109\/42.476112","volume":"14","author":"S-C Lo","year":"1995","unstructured":"Lo, S.-C., Lou, S.-L., Lin, J.-S., Freedman, M.T., Chien, M.V., Mun, S.K.: Artificial convolution neural network techniques and applications for lung nodule detection. IEEE Trans. Med. Imaging 14(4), 711\u2013718 (1995)","journal-title":"IEEE Trans. Med. Imaging"},{"key":"1499_CR11","doi-asserted-by":"crossref","unstructured":"Lecun, Y.B.L., Bengio, Y., Haffner, P.: Gradient-based learning applied to document recognition. In: Proceedings of the IEEE (1998)","DOI":"10.1109\/5.726791"},{"key":"1499_CR12","unstructured":"Krizhevsky, A., Sutskever, I., Geoffrey, E.H.: Imagenet classification with deep convolutional neural networks. In: Advances in Neural Information Processing Systems (NIPS 2012), vol. 25 (2012)"},{"issue":"3","key":"1499_CR13","first-page":"1","volume":"115","author":"O Russakovsky","year":"2014","unstructured":"Russakovsky, O., Deng, J., Su, H., Krause, J., Satheesh, S., Ma, S., Huang, Z., Karpathy, A., Khosla, A., Bernstein, M., Berg, A.C., Fei-Fei, L.: ImageNet large scale visual recognition challenge. Int. J. Comput. Vis. 115(3), 1\u201342 (2014)","journal-title":"Int. J. Comput. Vis."},{"issue":"3","key":"1499_CR14","doi-asserted-by":"publisher","first-page":"231","DOI":"10.1006\/cviu.2000.0897","volume":"81","author":"TB Moeslund","year":"2001","unstructured":"Moeslund, T.B., Granum, E.: A survey of computer vision-based human motion capture. Comput. Vis. Image Underst. 81(3), 231\u2013268 (2001)","journal-title":"Comput. Vis. Image Underst."},{"key":"1499_CR15","first-page":"1","volume-title":"Pattern Recognition & Machine Learning","author":"CM Bishop","year":"2006","unstructured":"Bishop, C.M.: Pattern Recognition & Machine Learning, vol. 128, 1st edn, pp. 1\u201358. Springer, New York (2006)","edition":"1"},{"issue":"1","key":"1499_CR16","doi-asserted-by":"publisher","first-page":"41","DOI":"10.1109\/MC.2003.1160055","volume":"36","author":"JO Kephart","year":"2003","unstructured":"Kephart, J.O., Chess, D.M.: The vision of autonomic computing. Computer 36(1), 41\u201350 (2003)","journal-title":"Computer"},{"issue":"2","key":"1499_CR17","doi-asserted-by":"publisher","first-page":"48","DOI":"10.1109\/MCE.2016.2640698","volume":"6","author":"J Lemley","year":"2017","unstructured":"Lemley, J., Bazrafkan, S., Corcoran, P.: Deep learning for consumer devices and services: pushing the limits for machine learning, artificial intelligence, and computer vision. IEEE Consum. Electron. Mag. 6(2), 48\u201356 (2017)","journal-title":"IEEE Consum. Electron. Mag."},{"key":"1499_CR18","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1016\/j.cviu.2016.09.001","volume":"15","author":"M Leo","year":"2017","unstructured":"Leo, M., Medioni, G., Trivedi, M., Kanade, T., Farinella, G.: Computer vision for assistive technologies. Comput. Vis. Image Underst. 15, 1\u201315 (2017)","journal-title":"Comput. Vis. Image Underst."},{"key":"1499_CR19","doi-asserted-by":"crossref","unstructured":"Liu, D., Wang, Z., Nasrabadi, N., Huang, T.: Learning a mixture of deep networks for single image super-resolution. In: Asian Conference on Computer Vision (2017)","DOI":"10.1007\/978-3-319-54187-7_10"},{"issue":"3","key":"1499_CR20","doi-asserted-by":"publisher","first-page":"33","DOI":"10.1145\/1118178.1118215","volume":"49","author":"JM Wing","year":"2006","unstructured":"Wing, J.M.: Computational thinking. Commun. ACM 49(3), 33\u201335 (2006)","journal-title":"Commun. ACM"},{"issue":"1","key":"1499_CR21","doi-asserted-by":"publisher","first-page":"77","DOI":"10.1016\/S0004-3702(02)00399-5","volume":"146","author":"Y Sun","year":"2003","unstructured":"Sun, Y., Fisher, R.: Object-based visual attention for computer vision. Artif. Intell. 146(1), 77\u2013123 (2003)","journal-title":"Artif. Intell."},{"key":"1499_CR22","doi-asserted-by":"publisher","first-page":"85","DOI":"10.1016\/j.neunet.2014.09.003","volume":"61","author":"J Schmidhuber","year":"2015","unstructured":"Schmidhuber, J.: Deep learning in neural networks: an overview. Neural Netw. 61, 85\u2013117 (2015)","journal-title":"Neural Netw."},{"key":"1499_CR23","unstructured":"Gu, J., Wang, Z., Kuen, J., Ma, L., Shahroudy, A., Shuai, B., Liu, T., Wang, X., Wang, G.: Recent advances in convolutional neural networks. eprint arXiv:1512.07108 , Dec. 2015"},{"key":"1499_CR24","doi-asserted-by":"publisher","first-page":"436","DOI":"10.1038\/nature14539","volume":"521","author":"Y LeCun","year":"2015","unstructured":"LeCun, Y., Bengio, Y., Hinton, G.: Deep learning. Nature 521, 436\u2013444 (2015)","journal-title":"Nature"},{"issue":"5786","key":"1499_CR25","doi-asserted-by":"publisher","first-page":"504","DOI":"10.1126\/science.1127647","volume":"313","author":"GE Hinton","year":"2006","unstructured":"Hinton, G.E., Salakhutdinov, R.R.: Reducing the dimensionality of data with neural networks. Science 313(5786), 504\u2013507 (2006)","journal-title":"Science"},{"key":"1499_CR26","doi-asserted-by":"crossref","unstructured":"Bengio, Y., Lamblin, P., Popovici, D., Larochelle, H.: Greedy layer-wise training of deep networks. In: International Conference on Neural Information Processing Systems (2007)","DOI":"10.7551\/mitpress\/7503.003.0024"},{"key":"1499_CR27","first-page":"3371","volume":"11","author":"P Vincent","year":"2010","unstructured":"Vincent, P., Larochelle, H., Lajoie, I., Bengio, Y., Manzagol, P.-A.: Stacked denoising autoencoders: learning useful representations in a deep network with a local denoising criterion. J. Mach. Learn. Res. 11, 3371\u20133408 (2010)","journal-title":"J. Mach. Learn. Res."},{"issue":"1","key":"1499_CR28","doi-asserted-by":"publisher","first-page":"215","DOI":"10.1113\/jphysiol.1968.sp008455","volume":"195","author":"DH Hubel","year":"1968","unstructured":"Hubel, D.H., Wiesel, T.N.: Receptive fields and functional architecture of monkey striate cortex. J. Physiol. 195(1), 215\u2013243 (1968)","journal-title":"J. Physiol."},{"key":"1499_CR29","unstructured":"LeCun, Y., Cortes, C., Burges, C.J.: MNIST handwritten digit database (2010)"},{"issue":"281","key":"1499_CR30","first-page":"145","volume":"533","author":"V Gewin","year":"2016","unstructured":"Gewin, V.: Turning point: intelligence programmer. Nature 533(281), 145\u2013284 (2016)","journal-title":"Nature"},{"key":"1499_CR31","unstructured":"Clark, C., Storkey, A.: Teaching deep convolutional neural networks to play go. arXiv preprint arXiv:1412.3409 (2014)"},{"key":"1499_CR32","unstructured":"Wallach, I., Dzamba, M., Heifets, A.: AtomNet: a deep convolutional neural network for bioactivity prediction in structure-based drug discovery. arXiv preprint arXiv:1510.02855 (2015)"},{"key":"1499_CR33","unstructured":"Weisstein, E.W.: Convolution. From MathWorld\u2014a Wolfram web resource (2009)"},{"key":"1499_CR34","doi-asserted-by":"crossref","unstructured":"Zeiler, M.D., Fergus, R.: Visualizing and understanding convolutional networks. In: ECCV (2014)","DOI":"10.1007\/978-3-319-10590-1_53"},{"key":"1499_CR35","unstructured":"Simonyan, K., Zisserman, A.: Very deep convolutional networks for large-scale image recognition. arXiv:1409.1556 (2014)"},{"key":"1499_CR36","doi-asserted-by":"crossref","unstructured":"Szegedy, C., et al.: Going deeper with convolutions. In: IEEE Conference on Computer Vision and Pattern Recognition, Boston (2015)","DOI":"10.1109\/CVPR.2015.7298594"},{"key":"1499_CR37","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., Sun, J.: Deep residual learning for image recognition. eprint arXiv:1512.03385 (2015)","DOI":"10.1109\/CVPR.2016.90"},{"key":"1499_CR38","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., Sun, J.: Identity mappings in deep residual networks. In: European Conference on Computer Vision, Amsterdam (2016)","DOI":"10.1007\/978-3-319-46493-0_38"},{"key":"1499_CR39","doi-asserted-by":"crossref","unstructured":"Zagoruyko, S., Komodakis, N.: Wide residual networks. arXiv preprint arXiv:1605.07146 (2016)","DOI":"10.5244\/C.30.87"},{"key":"1499_CR40","unstructured":"Singh, S., Hoiem, D., Forsyth, D.: Swapout: learning an ensemble of deep architectures. arXiv preprint arXiv:1605.06465 (2016)"},{"key":"1499_CR41","unstructured":"Targ, S., Almeida, D., Lyman, K.: Resnet in resnet: generalizing residual architectures. arXiv preprint arXiv:1603.08029 (2016)"},{"key":"1499_CR42","doi-asserted-by":"publisher","DOI":"10.1109\/TCSVT.2017.2654543","author":"K Zhang","year":"2016","unstructured":"Zhang, K., Sun, M., Han, T.X., Yuan, X., Guo, L., Liu, T.: Residual networks of residual networks: multilevel residual networks. IEEE Trans. Circuits Syst. Video Technol. (2016). https:\/\/doi.org\/10.1109\/TCSVT.2017.2654543","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"1499_CR43","unstructured":"Ngiam, J., Chen, Z., Chia, D., Koh, P.W., Le, Q.V., Ng, A.Y.: Tiled convolutional neural networks. In: NIPS (2010)"},{"key":"1499_CR44","unstructured":"Wang, Z., Oates, T.: Encoding time series as images for visual inspection and classification using tiled convolutional neural networks. In: AAAI Workshop (2015)"},{"key":"1499_CR45","unstructured":"Yu, F., Koltun, V.: Multi-scale context aggregation by dilated convolutions. In ICLR (2016)"},{"key":"1499_CR46","unstructured":"Kalchbrenner, N., Espeholt, L., Simonyan, K., Oord, A., Graves, A., Kavukcuoglu, K.: Neural machine translation in linear time. arXiv preprint arXiv:1610.10099 (2016)"},{"key":"1499_CR47","unstructured":"Sercu, T., Goel, V.: Dense prediction on sequences with time-dilated convolutions for speech recognition. In: NIPS Workshop (2016)"},{"key":"1499_CR48","unstructured":"Oord, V.D., Dieleman, S., Zen, H., Simonyan, K., Vinyals, O., Graves, A., Kalchbrenner, N., Senior, A., Kavukcuoglu, K.: Wavenet: a generative model for raw audio. arXiv preprint arXiv:1609.03499 (2016)"},{"key":"1499_CR49","unstructured":"Lin, M., Chen, Q., Yan, S.: Network in network. arXiv:1312.4400 (2013)"},{"key":"1499_CR50","doi-asserted-by":"crossref","unstructured":"Szegedy, C., Ioe, S., Vanhoucke, V., Alemi, A.: Inceptionv4, Inception-ResNet and the impact of residual connections on learning. arXiv:1602.07261 (2016)","DOI":"10.1609\/aaai.v31i1.11231"},{"key":"1499_CR51","doi-asserted-by":"crossref","unstructured":"Long, J., Shelhamer, E., Darrell, T.: Fully convolutional networks for semantic segmentation. arXiv:1411.4038 (2015)","DOI":"10.1109\/CVPR.2015.7298965"},{"key":"1499_CR52","doi-asserted-by":"crossref","unstructured":"Zeiler, M.D., Krishnan, D., Taylor, G.W., Fergus, R.: Deconvolutional networks. In: CVPR (2010)","DOI":"10.1109\/CVPR.2010.5539957"},{"key":"1499_CR53","doi-asserted-by":"crossref","unstructured":"Zeiler, M.D., Taylor, G.W., Fergus, R.: Adaptive deconvolutional networks for mid and high level feature learning. In: ICCV (2011)","DOI":"10.1109\/ICCV.2011.6126474"},{"key":"1499_CR54","unstructured":"Bruna, J., Szlam, A., LeCun, Y.: Signal recovery from pooling representations. eprint arXiv:1311.4025 (2014)"},{"key":"1499_CR55","doi-asserted-by":"crossref","unstructured":"Gulcehre, C., Cho, K., Pascanu, R., Bengio, Y.: Learned-norm pooling for deep feedforward and recurrent neural networks. In: Joint European Conference on Machine Learning and Knowledge Discovery in Databases (2014)","DOI":"10.1007\/978-3-662-44848-9_34"},{"issue":"5","key":"1499_CR56","doi-asserted-by":"publisher","first-page":"743","DOI":"10.1016\/S0042-6989(97)00183-1","volume":"38","author":"EP Simoncelli","year":"1998","unstructured":"Simoncelli, E.P., Heeger, D.J.: A model of neuronal responses in visual area MT. Vis. Res. 38(5), 743\u2013761 (1998)","journal-title":"Vis. Res."},{"issue":"2","key":"1499_CR57","doi-asserted-by":"publisher","first-page":"81","DOI":"10.1080\/09548980701418942","volume":"18","author":"A Hyv\u00e4rinen","year":"2007","unstructured":"Hyv\u00e4rinen, A., K\u00f6ster, U.: Complex cell pooling and the statistics of natural images. Netw. Comput. Neural Syst. 18(2), 81\u2013100 (2007)","journal-title":"Netw. Comput. Neural Syst."},{"key":"1499_CR58","unstructured":"Hinton, G.E., Srivastava, N., Krizhevsky, A., Sutskever, I., Salakhutdinov, R.R.: Improving neural networks by preventing co-adaptation SOF feature detectors. eprint arXiv:1207.0580 (2012)"},{"key":"1499_CR59","unstructured":"Wan, L., Zeiler, M., Zhang, S., Cun, Y.L., Fergus, R.: Regularization of neural networks using dropconnect. In: PMLR (2013)"},{"key":"1499_CR60","unstructured":"Zeiler, M.D., Fergus, R.: Stochastic pooling for regularization of deep convolutional neural networks. eprint arXiv:1301.3557 (2013)"},{"key":"1499_CR61","unstructured":"Rippel, O., Snoek, J., Adams, R.P.: Spectral representations for convolutional neural networks. In: NIPS, Montreal (2015)"},{"issue":"2","key":"1499_CR62","doi-asserted-by":"publisher","first-page":"210","DOI":"10.1007\/s11263-013-0658-4","volume":"106","author":"Y Gong","year":"2014","unstructured":"Gong, Y., Ke, Q., Isard, M., Lazebnik, S.: A multi-view embedding space for modeling internet images, tags, and their semantics. Int. J. Comput. Vis. 106(2), 210\u2013233 (2014)","journal-title":"Int. J. Comput. Vis."},{"issue":"9","key":"1499_CR63","doi-asserted-by":"publisher","first-page":"1704","DOI":"10.1109\/TPAMI.2011.235","volume":"34","author":"H J\u00e9gou","year":"2012","unstructured":"J\u00e9gou, H., Perronnin, F., Douze, M., Sanchez, J., Perez, P., Schmid, C.: Aggregating local image descriptors into compact codes. IEEE Trans. Pattern Anal. Mach. Intell. 34(9), 1704\u20131716 (2012)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"1499_CR64","unstructured":"Nair, V., Hinton, G.E.: Rectified linear units improve restricted Boltzmann machines. In: International Conference on International Conference on Machine Learning, Haifa (2010)"},{"key":"1499_CR65","unstructured":"Maas, A.L., Hannun, Y., Ng, A.Y.: Rectifier nonlinearities improve neural network acoustic models. In: ICML Workshop on Deep Learning for Audio, Speech and Language Processing (2013)"},{"key":"1499_CR66","unstructured":"Goodfellow, I.J., Warde-Farley, D., Mirza, M., Courville, A., Bengio, Y.: Maxout networks. In: International Conference on Machine Learning, Atlanta (2013)"},{"key":"1499_CR67","unstructured":"Springenberg, J.T., Riedmiller, M.: Improving deep neural networks with probabilistic maxout units. arXiv preprint arXiv:1312.6116 (2013)"},{"key":"1499_CR68","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., Sun, J.: Delving deep into rectifiers: surpassing human-level performance on ImageNet classification, In: IEEE International Conference on Computer Vision (2015)","DOI":"10.1109\/ICCV.2015.123"},{"key":"1499_CR69","unstructured":"Xu, B., Wang, N., Chen, T., Li, M.: Empirical evaluation of rectified activations in convolutional network. arXiv preprint arXiv:1505.00853 (2015)"},{"key":"1499_CR70","unstructured":"Clevert, D.-A., Unterthiner, T., Hochreiter, S.: Fast and accurate deep network learning by exponential linear units (ELUs). arXiv preprint arXiv:1511.07289 (2015)"},{"key":"1499_CR71","doi-asserted-by":"crossref","unstructured":"Bottou, L.: Large-scale machine learning with stochastic gradient descent. In: International Conference on Computational Statistics (COMPSTAT\u20192010) (2010)","DOI":"10.1007\/978-3-7908-2604-3_16"},{"key":"1499_CR72","doi-asserted-by":"crossref","unstructured":"Wijnhoven, R.G., dde With, P.H.N: Fast training of object detection using stochastic gradient descent. In: 2010 20th International Conference on Pattern Recognition (ICPR). IEEE (2010)","DOI":"10.1109\/ICPR.2010.112"},{"key":"1499_CR73","unstructured":"Zinkevich, M.A., Weimer, M., Smola, A., Li, L.: Parallelized stochastic gradient descent. In: NIPS, Vancouver (2010)"},{"key":"1499_CR74","unstructured":"Recht, B., Re, C., Wright, S., Niu, F.: Hogwild: a lock-free approach to parallelizing stochastic gradient descent. In: NIPS (2011)"},{"key":"1499_CR75","doi-asserted-by":"crossref","unstructured":"Bengio, Y.: Deep learning of representations: looking forward. In: International Conference on Statistical Language and Speech Processing (2013)","DOI":"10.1007\/978-3-642-39593-2_1"},{"key":"1499_CR76","unstructured":"Dean, G., Corrado, G.S., Monga, R., Chen, K., Devin, M., Le, Q.V., Mao, M.Z., Ranzato, M., Senior, A., Tucker, P., Yang, K., Ng, A.Y.: Large scale distributed deep networks. In: NIPS. Lake Tahoe, Nevada (2012)"},{"key":"1499_CR77","doi-asserted-by":"crossref","unstructured":"Zhuang, Y., Chin, W.-S., Juan, Y.-C., Lin, C.-J.: A fast parallel SGD for matrix factorization in shared memory systems. In: ACM Conference on Recommender Systems, Hong Kong (2013)","DOI":"10.1145\/2507157.2507164"},{"key":"1499_CR78","unstructured":"Thoma, M.: Analysis and optimization of convolutional neural network architectures. arXiv preprint arXiv:1707.09725 (2017)"},{"key":"1499_CR79","doi-asserted-by":"crossref","unstructured":"Ooi, B.C., et al.: SINGA: a distributed deep learning platform. In: ACM International Conference on Multimedia, Brisbane, (2015)","DOI":"10.1145\/2733373.2807410"},{"key":"1499_CR80","doi-asserted-by":"crossref","unstructured":"Jia, Y., et al.: Caffe: convolutional architecture for fast feature embedding. In: ACM International Conference on Multimedia, Orlando (2014)","DOI":"10.1145\/2647868.2654889"},{"key":"1499_CR81","unstructured":"http:\/\/deeplearning4j.org\/ . Last visited 27 May 2017"},{"key":"1499_CR82","first-page":"1755","volume":"10","author":"DE King","year":"2009","unstructured":"King, D.E.: Dlib-ml: a machine learning toolkit. J. Mach. Learn. Res. 10, 1755\u20131758 (2009)","journal-title":"J. Mach. Learn. Res."},{"key":"1499_CR83","doi-asserted-by":"crossref","unstructured":"Seide, F.: Keynote: the computer science behind the Microsoft Cognitive Toolkit: An open source large-scale deep learning toolkit for Windows and Linux. In: IEEE\/ACM International Symposium on Code Generation and Optimization (CGO) (2017)","DOI":"10.1109\/CGO.2017.7863722"},{"key":"1499_CR84","unstructured":"Chen, T., et al.: Mxnet: a flexible and efficient machine learning library for heterogeneous distributed systems. arXiv preprint arXiv:1512.01274 (2015)"},{"key":"1499_CR85","unstructured":"Lopez, R.: Open NN: an open source neural networks C++ library [software] (2014)"},{"key":"1499_CR86","unstructured":"Abadi, M., Agarwal, A., Barham, P., Brevdo, E., Chen, Z., Citro, C., Ghemawat, S.: TensorFlow: large scale machine learning on heterogeneous distributed systems. arXiv preprint arXiv:1603.04467 (2016)"},{"key":"1499_CR87","unstructured":"Bastien, F., Lamblin, P., Pascanu, R., Bergstra, J., Goodfellow, I., Bergeron, A., Bouchard, N., Warde-Farley, D., Bengio, Y.: Theano: new features and speed improvements. In: Deep Learning and Unsupervised Feature Learning NIPS 2012 Workshop (2012)"},{"key":"1499_CR88","unstructured":"Collobert, K.K.C.F.R.: Torch7: a matlab-like environment for machine learning. In: BigLearn, NIPS Workshop (No. EPFL-CONF-192376) (2011)"},{"key":"1499_CR89","doi-asserted-by":"crossref","unstructured":"Wu, S., Moore, B.E., Shah, M.: Chaotic invariants of Lagrangian particle trajectories for anomaly detection in crowded scenes. In: IEEE Conference on Computer Vision and Pattern Recognition, San Francisco (2010)","DOI":"10.1109\/CVPR.2010.5539882"},{"key":"1499_CR90","doi-asserted-by":"publisher","first-page":"139","DOI":"10.1016\/j.neucom.2015.12.070","volume":"186","author":"MS Zitouni","year":"2016","unstructured":"Zitouni, M.S., Bhaskar, H., Dias, J., Al-Mualla, M.: Advances and trends in visual crowd analysis: a systematic survey and evaluation of crowd modelling techniques. Neurocomputing 186, 139\u2013159 (2016)","journal-title":"Neurocomputing"},{"key":"1499_CR91","doi-asserted-by":"crossref","unstructured":"Rodriguez, M., Laptev, I., Sivic, J., Audibert, J.Y.: Density-aware person detection and tracking in crowds. In: IEEE International Conference on Computer Vision (2011)","DOI":"10.1109\/ICCV.2011.6126526"},{"key":"1499_CR92","doi-asserted-by":"publisher","first-page":"144","DOI":"10.1016\/j.neucom.2014.06.011","volume":"143","author":"D Xu","year":"2014","unstructured":"Xu, D., Song, R., Wu, X., Li, N., Feng, W., Qian, H.: Video anomaly detection based on a hierarchical activity discovery within spatio-temporal context. Neurocomputing 143, 144\u2013152 (2014)","journal-title":"Neurocomputing"},{"key":"1499_CR93","doi-asserted-by":"publisher","first-page":"124","DOI":"10.1016\/j.neucom.2014.01.019","volume":"136","author":"Z Cheng","year":"2014","unstructured":"Cheng, Z., Qin, L., Huang, Q., Yan, S., Tian, Q.: Recognizing human group action by layered model with multiple cues. Neurocomputing 136, 124\u2013135 (2014)","journal-title":"Neurocomputing"},{"key":"1499_CR94","doi-asserted-by":"publisher","first-page":"377","DOI":"10.1016\/j.neucom.2013.12.040","volume":"133","author":"R Liang","year":"2014","unstructured":"Liang, R., Zhu, Y., Wang, H.: Counting crowd flow based on feature points. Neurocomputing 133, 377\u2013384 (2014)","journal-title":"Neurocomputing"},{"issue":"5\u20136","key":"1499_CR95","doi-asserted-by":"publisher","first-page":"345","DOI":"10.1007\/s00138-008-0132-4","volume":"19","author":"B Zhan","year":"2008","unstructured":"Zhan, B., Monekosso, D.N., Remagnino, P., Velastin, S.A., Xu, L.-Q.: Crowd analysis: a survey. Mach. Vis. Appl. Mach. Vis. Appl. 19(5\u20136), 345\u2013357 (2008)","journal-title":"Mach. Vis. Appl. Mach. Vis. Appl."},{"key":"1499_CR96","first-page":"1","volume":"99","author":"F Rodrigues","year":"2017","unstructured":"Rodrigues, F., Lourenco, M., Ribeiro, B., Pereira, F.: Learning supervised topic models for classification and regression from crowds. IEEE Trans. Pattern Anal. Mach. Intell. 99, 1\u20131 (2017)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"1499_CR97","doi-asserted-by":"crossref","unstructured":"Ali, S., Shah, M.: A Lagrangian particle dynamics approach for crowd flow segmentation and stability analysis. In: IEEE Conference on Computer Vision and Pattern Recognition, Minneapolis, pp. 1\u20136 (2007)","DOI":"10.1109\/CVPR.2007.382977"},{"key":"1499_CR98","first-page":"3099","volume":"4","author":"AM McIvor","year":"2000","unstructured":"McIvor, A.M.: Background subtraction techniques, image and vision computing. Proc. Image Vis. Comput. 4, 3099\u20133104 (2000)","journal-title":"Proc. Image Vis. Comput."},{"issue":"3","key":"1499_CR99","doi-asserted-by":"publisher","first-page":"231","DOI":"10.1023\/A:1008195307933","volume":"38","author":"MJ Black","year":"2000","unstructured":"Black, M.J., Fleet, D.J.: Probabilistic detection and tracking of motion bound-aries. Int. J. Comput. Vis. 38(3), 231\u2013245 (2000)","journal-title":"Int. J. Comput. Vis."},{"issue":"4","key":"1499_CR100","doi-asserted-by":"publisher","first-page":"296","DOI":"10.1049\/iet-cvi.2011.0138","volume":"6","author":"G Garcia-Bunster","year":"2012","unstructured":"Garcia-Bunster, G., Torres-Torriti, M., Oberli, C.: Crowded pedestrian counting at bus stops from perspective transformations of foreground areas. IET Comput. Vis. 6(4), 296\u2013305 (2012)","journal-title":"IET Comput. Vis."},{"issue":"6","key":"1499_CR101","doi-asserted-by":"publisher","first-page":"2129","DOI":"10.1109\/JSEN.2013.2245889","volume":"13","author":"DY Chen","year":"2013","unstructured":"Chen, D.Y., Huang, P.C.: Visual-based human crowds behavior analysis based on graph modeling and matching. IEEE Sens. J. 13(6), 2129\u20132138 (2013)","journal-title":"IEEE Sens. J."},{"key":"1499_CR102","unstructured":"Stauffer, C., Grimson, W.E.L.W.: Adaptive background mixture models for real-time tracking. In: IEEE Conference Computer Vision and Pattern Recognition (1999)"},{"issue":"5","key":"1499_CR103","doi-asserted-by":"publisher","first-page":"909","DOI":"10.1109\/TPAMI.2007.70738","volume":"30","author":"AB Chan","year":"2008","unstructured":"Chan, A.B., Vasconcelos, N.: Modeling, clustering, and segmenting video with mixtures of dynamic textures. IEEE Trans. Pattern Anal. Mach. Intell. 30(5), 909\u2013926 (2008)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"5","key":"1499_CR104","first-page":"66","volume":"27","author":"JCSJ Junior","year":"2010","unstructured":"Junior, J.C.S.J., Musse, S.R., Jung, C.R.: Crowd analysis using computer vision techniques. IEEE Signal Process. Mag. 27(5), 66\u201377 (2010)","journal-title":"IEEE Signal Process. Mag."},{"key":"1499_CR105","unstructured":"http:\/\/www.desibrandstrategy.com\/why-tirupati-tirumala-needs-smarter-analytics\/ . Accessed 17 June 2017"},{"key":"1499_CR106","unstructured":"http:\/\/l7.alamy.com\/zooms\/dab050fbd7424ff597ca74599e8eb7f9\/holi-celebration-in-dauji-temple-dauji-uttar-pradesh-india-asia-d2r9h0.jpg . Accessed 17 June 2017"},{"key":"1499_CR107","unstructured":"https:\/\/cdn.theatlantic.com\/assets\/media\/img\/photo\/2011\/03\/holi-the-festival-of-colors-2011\/h15_19113087\/main_900.jpg?1420521857 . Accessed 17 June 2017"},{"key":"1499_CR108","unstructured":"https:\/\/en.wikipedia.org\/wiki\/List_of_human_stampedes_in_Hindu_temples . Accessed 30 Dec 2017"},{"key":"1499_CR109","unstructured":"http:\/\/edition.cnn.com\/2017\/05\/22\/europe\/manchester-arena-incident\/ . Accessed 23 May 2017"},{"key":"1499_CR110","unstructured":"http:\/\/www.dailynewsegypt.com\/2015\/02\/09\/28-football-fans-killed-deliberate-massacre-ultras\/ . Accessed 9 Feb 2015"},{"key":"1499_CR111","unstructured":"http:\/\/robertchaen.com\/2015\/01\/01\/7935\/ . Accessed 1 Jan 2015"},{"key":"1499_CR112","unstructured":"https:\/\/en.wikipedia.org\/wiki\/List_of_terrorist_incidents_in_India . Accessed 11 Feb 2018"},{"key":"1499_CR113","unstructured":"Dimokranitou, A., Tsechpenakis, G.: Adversarial autoencoders for anomalous event detection in images. Thesis, Purdue University (2017)"},{"key":"1499_CR114","doi-asserted-by":"crossref","unstructured":"Saxena, S.: Crowd behavior recognition for video surveillance. In: International Conference on Advanced Concepts for Intelligent Vision Systems (2008)","DOI":"10.1007\/978-3-540-88458-3_88"},{"key":"1499_CR115","doi-asserted-by":"crossref","unstructured":"Husni, M., Suryana, N.: Crowd event detection in computer vision. In: International Conference on Signal Processing Systems (ICSPS) (2010)","DOI":"10.1109\/ICSPS.2010.5555536"},{"key":"1499_CR116","doi-asserted-by":"crossref","unstructured":"Mehran, R., Oyama, A., Shah, M.: Abnormal crowd behavior detection using social force model. In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR) (2009)","DOI":"10.1109\/CVPRW.2009.5206641"},{"key":"1499_CR117","doi-asserted-by":"crossref","unstructured":"Rodriguez, M., Ali, S., Kanade, T.: Tracking in unstructured crowded scenes. In: International Conference on Computer Vision (2009)","DOI":"10.1109\/ICCV.2009.5459301"},{"key":"1499_CR118","doi-asserted-by":"crossref","unstructured":"Ozturk, O., Yamasaki, T., Aizawa, K.: Detecting dominant motion flows in unstructured\/structured crowd scenes. In: International Conference on Pattern Recognition (ICPR), Istanbul (2010)","DOI":"10.1109\/ICPR.2010.862"},{"issue":"1","key":"1499_CR119","first-page":"1","volume":"4","author":"NNA Sjarif","year":"2012","unstructured":"Sjarif, N.N.A., Shamsuddin, S.M., Hashim, S.Z.: Detection of abnormal behaviors in crowd scene: a review. Int. J. Adv. Soft Comput. Appl. 4(1), 1\u201333 (2012)","journal-title":"Int. J. Adv. Soft Comput. Appl."},{"key":"1499_CR120","doi-asserted-by":"crossref","unstructured":"Yu, H., Zhou, Y., Simmons, J., Przybyla, C.P., Lin, Y., Fan, X., Mi, Y., Wang, S.: Groupwise tracking of crowded similar-appearance targets from low-continuity image sequences. In: 2016 IEEE Conference on Computer Vision and Pattern Recognition (CVPR) (2016)","DOI":"10.1109\/CVPR.2016.109"},{"key":"1499_CR121","doi-asserted-by":"crossref","unstructured":"Ihaddadene, N., Djeraba, C.: Real-time crowd motion analysis. In: International Conference on Pattern Recognition, Tampa (2008)","DOI":"10.1109\/ICPR.2008.4761041"},{"issue":"4","key":"1499_CR122","doi-asserted-by":"publisher","first-page":"497","DOI":"10.1142\/S0219525908001854","volume":"11","author":"A Johansson","year":"2008","unstructured":"Johansson, A., Helbing, D., Al-Abideen, H.Z., Al-Bosta, S.: From crowd dynamics to crowd safety: a video-based analysis. Adv. Complex Syst. 11(4), 497\u2013527 (2008)","journal-title":"Adv. Complex Syst."},{"key":"1499_CR123","doi-asserted-by":"crossref","unstructured":"Cao, T., Wu, X., Guo, J., Yu, S., Xu, Y.: Abnormal crowd motion analysis. In: IEEE International Conference on Robotics and Biomimetics (ROBIO), Guilin (2009)","DOI":"10.1109\/ROBIO.2009.5420408"},{"key":"1499_CR124","doi-asserted-by":"crossref","unstructured":"Hassner, T., Itcher, Y., Kliper-Gross, O.: Violent flows: Real-time detection of violent crowd behavior. In: IEEE Computer Society Conference on Computer Vision and Pattern Recognition Workshops (CVPRW). IEEE, Providence (2012)","DOI":"10.1109\/CVPRW.2012.6239348"},{"key":"1499_CR125","doi-asserted-by":"crossref","unstructured":"Krausz, B., Bauckhage, C.: Automatic detection of dangerous motion behavior in human crowds. In: IEEE International Conference on Advanced Video and Signal-Based Surveillance (AVSS), Klagenfurt (2011)","DOI":"10.1109\/AVSS.2011.6027326"},{"key":"1499_CR126","doi-asserted-by":"crossref","unstructured":"Liao, H., Xiang, J., Sun, W., Feng, Q., Dai, J.: An abnormal event recognition in crowd scene. In: International Conference on Image and Graphics (ICIG), Hefei (2011)","DOI":"10.1109\/ICIG.2011.66"},{"issue":"3","key":"1499_CR127","doi-asserted-by":"publisher","first-page":"501","DOI":"10.1007\/s00138-011-0341-0","volume":"23","author":"B Wang","year":"2012","unstructured":"Wang, B., Ye, M., Li, X., Zhao, F., Ding, J.: Abnormal crowd behavior detection using high-frequency and spatio-temporal features. Mach. Vis. Appl. 23(3), 501\u2013511 (2012)","journal-title":"Mach. Vis. Appl."},{"issue":"1","key":"1499_CR128","doi-asserted-by":"publisher","first-page":"102","DOI":"10.1109\/JSTSP.2013.2237882","volume":"7","author":"M Andersson","year":"2013","unstructured":"Andersson, M., Gustafsson, F., St-Laurent, L., Prevost, D.: Recognition of anomalous motion patterns in urban surveillance. IEEE J. Sel. Top. Signal Process. 7(1), 102\u2013110 (2013)","journal-title":"IEEE J. Sel. Top. Signal Process."},{"key":"1499_CR129","doi-asserted-by":"publisher","first-page":"64","DOI":"10.1016\/j.patrec.2013.11.017","volume":"44","author":"S-H Cho","year":"2014","unstructured":"Cho, S.-H., Kang, H.-B.: Abnormal behavior detection using hybrid agents in crowded scenes. Pattern Recognit. Lett. 44, 64\u201370 (2014)","journal-title":"Pattern Recognit. Lett."},{"issue":"1","key":"1499_CR130","doi-asserted-by":"publisher","first-page":"206","DOI":"10.1109\/TITS.2009.2030963","volume":"11","author":"J Candamo","year":"2010","unstructured":"Candamo, J., Shreve, M., Goldgof, D.B., Sapper, D.B., Kasturi, R.: Understanding transit scenes: a survey on human behavior-recognition algorithms. IEEE Trans. Intell. Transp. Syst. 11(1), 206\u2013224 (2010)","journal-title":"IEEE Trans. Intell. Transp. Syst."},{"issue":"5","key":"1499_CR131","doi-asserted-by":"publisher","first-page":"1003","DOI":"10.1109\/TPAMI.2011.176","volume":"34","author":"W Ge","year":"2012","unstructured":"Ge, W., Collins, R.T., Ruback, R.B.: Vision-based analysis of small groups in pedestrian crowds. IEEE Trans. Pattern Anal. Mach. Intell. 34(5), 1003\u20131016 (2012)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"10","key":"1499_CR132","doi-asserted-by":"publisher","first-page":"2064","DOI":"10.1109\/TPAMI.2012.123","volume":"34","author":"B Solmaz","year":"2012","unstructured":"Solmaz, B., Moore, B.E., Shah, M.: Identifying behaviors in crowd scenes using stability analysis for dynamical systems. IEEE Trans. Pattern Anal. Mach. Intell. 34(10), 2064\u20132070 (2012)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"3","key":"1499_CR133","doi-asserted-by":"publisher","first-page":"307","DOI":"10.1016\/j.cviu.2011.08.006","volume":"116","author":"B Krausz","year":"2012","unstructured":"Krausz, B., Bauckhage, C.: Loveparade 2010: automatic video analysis of a crowd disaster. Comput. Vis. Image Underst. 116(3), 307\u2013319 (2012)","journal-title":"Comput. Vis. Image Underst."},{"key":"1499_CR134","doi-asserted-by":"crossref","unstructured":"Ge, W., Collins, R.T., Ruback, B.: Automatically detecting the small group structure of a crowd. In: Workshop on Applications of Computer Vision (WACV), Snowbird (2009)","DOI":"10.1109\/WACV.2009.5403123"},{"key":"1499_CR135","doi-asserted-by":"crossref","unstructured":"Dee, H.M., Caplier, A.: Crowd behaviour analysis using histograms of motion direction. In: International Conference on Image Processing (ICIP), Hong Kong (2010)","DOI":"10.1109\/ICIP.2010.5653573"},{"key":"1499_CR136","doi-asserted-by":"crossref","unstructured":"Subburaman, V.B., Descamps, A., Carincotte, C.: Counting people in the crowd using a generic head detector. In: International Conference on Advanced Video and Signal-Based Surveillance (AVSS), Beijing (2012)","DOI":"10.1109\/AVSS.2012.87"},{"key":"1499_CR137","doi-asserted-by":"publisher","first-page":"347","DOI":"10.1007\/978-1-4614-8483-7_14","volume-title":"Modeling, Simulation and Visual Analysis of Crowds: A Multidisciplinary Perspective","author":"CC Loy","year":"2013","unstructured":"Loy, C.C., Chen, K., Gong, S., Xiang, T.: Crowd counting and profiling: methodology and evaluation. In: Ali, S., Nishino, K., Manocha, D., Shah, M. (eds.) Modeling, Simulation and Visual Analysis of Crowds: A Multidisciplinary Perspective, pp. 347\u2013382. Springer, New York (2013)"},{"key":"1499_CR138","unstructured":"Ullah, H., Conci, N.: Crowd motion segmentation and anomaly detection via multi-label optimization. In: ICPR Workshop on Pattern Recognition and Crowd Analysis (2012)"},{"key":"1499_CR139","doi-asserted-by":"crossref","unstructured":"Krisp, J.M., Peters, S., Burkert, F.: Visualizing crowd movement patterns using a directed kernel density estimation. In: Earth Observation of Global Changes (EOGC), pp. 255\u2013268. Springer, Berlin (2013)","DOI":"10.1007\/978-3-642-32714-8_17"},{"key":"1499_CR140","doi-asserted-by":"crossref","unstructured":"Ullah, H., Conci, N.: Structured learning for crowd motion segmentation. In: International Conference on Image Processing (ICIP), Melbourne (2013)","DOI":"10.1109\/ICIP.2013.6738170"},{"key":"1499_CR141","doi-asserted-by":"crossref","unstructured":"Ullah, H., Ullah, M., Conci, N.: Dominant motion analysis in regular and irregular crowd scenes. In: International Workshop on Human Behavior Understanding (2014)","DOI":"10.1007\/978-3-319-11839-0_6"},{"key":"1499_CR142","doi-asserted-by":"crossref","unstructured":"Li, W., Wu, X., Matsumoto, K., Zhao, H.-A.: Crowd density estimation: an improved approach. In: International Conference on Signal Processing (ICSP), Beijing (2010)","DOI":"10.1109\/ICOSP.2010.5655522"},{"key":"1499_CR143","doi-asserted-by":"crossref","unstructured":"Hsu, W.-L., Lin, K.-F., Tsai, C.-L.: Crowd density estimation based on frequency analysis. In: International Conference on Intelligent Information Hiding and Multimedia Signal Processing (IIH-MSP), Dalian (2011)","DOI":"10.1109\/IIHMSP.2011.49"},{"issue":"4","key":"1499_CR144","doi-asserted-by":"publisher","first-page":"047204","DOI":"10.1117\/1.OE.51.4.047204","volume":"51","author":"Z Zhang","year":"2012","unstructured":"Zhang, Z., Li, M.: Crowd density estimation based on statistical analysis of local intra-crowd motions for public area surveillance. Opt. Eng. 51(4), 047204 (2012)","journal-title":"Opt. Eng."},{"issue":"9","key":"1499_CR145","doi-asserted-by":"publisher","first-page":"1014","DOI":"10.1016\/j.cviu.2012.05.005","volume":"116","author":"B Zhou","year":"2012","unstructured":"Zhou, B., Zhang, F., Peng, L.: Higher-order SVD analysis for crowd density estimation. Comput. Vis. Image Underst. 116(9), 1014\u20131021 (2012)","journal-title":"Comput. Vis. Image Underst."},{"issue":"10","key":"1499_CR146","doi-asserted-by":"publisher","first-page":"1986","DOI":"10.1109\/TPAMI.2015.2396051","volume":"37","author":"H Idrees","year":"2015","unstructured":"Idrees, H., Soomro, K., Shah, M.: Detecting humans in dense crowds using locally-consistent scale prior and global occlusion reasoning. IEEE Trans. Pattern Anal. Mach. Intell. 37(10), 1986\u20131998 (2015)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"11","key":"1499_CR147","doi-asserted-by":"publisher","first-page":"1533","DOI":"10.1007\/s00371-014-1032-4","volume":"31","author":"AS Rao","year":"2015","unstructured":"Rao, A.S., Gubbi, J., Marusic, S., Palaniswami, M.: Estimation of crowd density by clustering motion cues. Vis. Comput. 31(11), 1533\u20131552 (2015)","journal-title":"Vis. Comput."},{"issue":"3","key":"1499_CR148","doi-asserted-by":"publisher","first-page":"585","DOI":"10.1016\/S0031-3203(02)00100-0","volume":"36","author":"L Wang","year":"2003","unstructured":"Wang, L., Hu, W., Tan, T.: Recent developments in human motion analysis. Pattern Recognit. 36(3), 585\u2013601 (2003)","journal-title":"Pattern Recognit."},{"issue":"3","key":"1499_CR149","doi-asserted-by":"publisher","first-page":"334","DOI":"10.1109\/TSMCC.2004.829274","volume":"34","author":"W Hu","year":"2004","unstructured":"Hu, W., Tan, T., Wang, L., Maybank, S.: A survey on visual surveillance of object motion and behaviors. IEEE Trans. Syst. Man Cybern. 34(3), 334\u2013352 (2004)","journal-title":"IEEE Trans. Syst. Man Cybern."},{"issue":"6","key":"1499_CR150","doi-asserted-by":"publisher","first-page":"1257","DOI":"10.1109\/TSMCC.2012.2215319","volume":"42","author":"AA Sodemann","year":"2012","unstructured":"Sodemann, A.A., Ross, M.P., Borghetti, B.J.: A review of anomaly detection in automated surveillance. IEEE Trans. Syst. Man Cybern. Part C (Appl. Rev.) 42(6), 1257\u20131272 (2012)","journal-title":"IEEE Trans. Syst. Man Cybern. Part C (Appl. Rev.)"},{"issue":"4","key":"1499_CR151","doi-asserted-by":"publisher","first-page":"747","DOI":"10.1007\/s10462-012-9341-3","volume":"42","author":"D Gowsikhaa","year":"2014","unstructured":"Gowsikhaa, D., Abirami, S., Baskaran, R.: Automated human behavior analysis from surveillance videos: a survey. Artif. Intell. Rev. 42(4), 747\u2013765 (2014)","journal-title":"Artif. Intell. Rev."},{"key":"1499_CR152","doi-asserted-by":"publisher","first-page":"17","DOI":"10.1007\/978-3-642-41512-8_2","volume-title":"Intelligent Multimedia Surveillance","author":"M Thida","year":"2013","unstructured":"Thida, M., Yong, Y., Climent-P\u00e9rez, P., Eng, H., Remagnino, P.: A literature review on video analytics of crowded scenes. In: Atrey, P., Kankanhalli, M., Cavallaro, A. (eds.) Intelligent Multimedia Surveillance, pp. 17\u201336. Springer, Berlin (2013)"},{"issue":"1","key":"1499_CR153","first-page":"4","volume":"1","author":"H Jo","year":"2013","unstructured":"Jo, H., Chug, K., Sethi, R.: A review of physics-based methods for group and crowd analysis in computer vision. J. Postdr. Res. 1(1), 4\u20137 (2013)","journal-title":"J. Postdr. Res."},{"issue":"10","key":"1499_CR154","doi-asserted-by":"publisher","first-page":"983","DOI":"10.1007\/s00371-012-0752-6","volume":"29","author":"S Vishwakarma","year":"2013","unstructured":"Vishwakarma, S., Agrawal, A.: A survey on activity recognition and behavior understanding in video surveillance. Vis. Comput. 29(10), 983\u20131009 (2013)","journal-title":"Vis. Comput."},{"issue":"20","key":"1499_CR155","doi-asserted-by":"publisher","first-page":"6935","DOI":"10.1016\/j.eswa.2015.05.023","volume":"42","author":"P Afsar","year":"2015","unstructured":"Afsar, P., Cortez, P., Santos, H.: Automatic visual detection of human behavior: a review from 2000 to 2014. Expert Syst. Appl. 42(20), 6935\u20136956 (2015)","journal-title":"Expert Syst. Appl."},{"issue":"3","key":"1499_CR156","doi-asserted-by":"publisher","first-page":"367","DOI":"10.1109\/TCSVT.2014.2358029","volume":"25","author":"T Li","year":"2015","unstructured":"Li, T., Chang, H., Wang, M., Ni, B., Hong, R., Yan, S.: Crowded scene analysis: a survey. IEEE Trans. Circuits Syst. Video Technol. 25(3), 367\u2013386 (2015)","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"1499_CR157","doi-asserted-by":"publisher","first-page":"342","DOI":"10.1016\/j.neucom.2015.11.021","volume":"177","author":"VJ Kok","year":"2016","unstructured":"Kok, V.J., Lim, M.K., Chan, C.S.: Crowd behavior analysis: a review where physics meets biology. Neurocomputing 177, 342\u2013362 (2016)","journal-title":"Neurocomputing"},{"issue":"2","key":"1499_CR158","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3052930","volume":"13","author":"JM Grant","year":"2017","unstructured":"Grant, J.M., Flynn, P.J.: Crowd scene understanding from video: a survey. ACM Trans. Multimed. Comput. Commun. Appl. 13(2), 1\u201323 (2017)","journal-title":"ACM Trans. Multimed. Comput. Commun. Appl."},{"issue":"1","key":"1499_CR159","doi-asserted-by":"publisher","first-page":"169","DOI":"10.1146\/annurev.fluid.35.101101.161136","volume":"35","author":"RL Hughes","year":"2003","unstructured":"Hughes, R.L.: The flow of human crowds. Annu. Rev. Fluid Mech. 35(1), 169\u2013182 (2003)","journal-title":"Annu. Rev. Fluid Mech."},{"key":"1499_CR160","unstructured":"Leggett, R.: Real-time crowd simulation: a review. http:\/\/www.leggettnet.org.uk\/docs\/crowdsimulation.pdf (2004). Accessed 19 Jan 2015 (2004)"},{"key":"1499_CR161","volume-title":"The Perfect Swarm: The Science of Complexity in Everyday Life","author":"L Fisher","year":"2009","unstructured":"Fisher, L.: The Perfect Swarm: The Science of Complexity in Everyday Life. Basic Books, New York (2009)"},{"issue":"12","key":"1499_CR162","doi-asserted-by":"publisher","first-page":"64","DOI":"10.1145\/2043174.2043192","volume":"54","author":"BE Moore","year":"2011","unstructured":"Moore, B.E., Ali, S., Mehran, R., Shah, M.: Visual crowd surveillance through a hydrodynamics lens. Commun. ACM 54(12), 64\u201373 (2011)","journal-title":"Commun. ACM"},{"issue":"3","key":"1499_CR163","doi-asserted-by":"publisher","first-page":"613","DOI":"10.1109\/TCSVT.2016.2593647","volume":"27","author":"J Shao","year":"2017","unstructured":"Shao, J., Loy, C.C., Kang, K., Wang, X.: Crowded scene understanding by deeply learned volumetric slices. IEEE Trans. Circuits Syst. Video Technol. 27(3), 613\u2013623 (2017)","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"1499_CR164","doi-asserted-by":"crossref","unstructured":"Andrearczyk, V., Whelan, P.F.: Convolutional neural network on three orthogonal planes for dynamic texture classification. arXiv preprint arXiv:1703.05530 (2017)","DOI":"10.1016\/j.patcog.2017.10.030"},{"issue":"4","key":"1499_CR165","doi-asserted-by":"publisher","first-page":"1992","DOI":"10.1109\/TIP.2017.2670780","volume":"26","author":"M Sabokrou","year":"2017","unstructured":"Sabokrou, M., Fayyaz, M., Fathy, M., Klette, R.: Deep-cascade: cascading 3D deep neural networks for fast anomaly detection and localization in crowded scenes. IEEE Trans. Image Process. 26(4), 1992\u20132004 (2017)","journal-title":"IEEE Trans. Image Process."},{"key":"1499_CR166","unstructured":"Kumagai, S., Hotta, K., Kurita, T.: Mixture of counting CNNs: adaptive integration of CNNs specialized to specific appearance for crowd counting. arXiv preprint arXiv:1703.09393 (2017)"},{"key":"1499_CR167","doi-asserted-by":"crossref","unstructured":"Zeng, L., Xu, X., Cai, B., Qiu, S., Zhang, T.: Multi-scale Convolutional Neural Networks for Crowd Counting. arXiv preprint arXiv:1702.02359 (2017)","DOI":"10.1109\/ICIP.2017.8296324"},{"key":"1499_CR168","doi-asserted-by":"crossref","unstructured":"Zhuang, N., Yusufu, T., Ye, J., Hua, K.A.: Group activity recognition with differential recurrent convolutional neural networks. In: International Conference on Automatic Face & Gesture Recognition (FG 2017) (2017)","DOI":"10.1109\/FG.2017.70"},{"key":"1499_CR169","doi-asserted-by":"crossref","unstructured":"Ahsan, U., Sun, C., Hays, J., Essa, I.: Complex event recognition from images with few training examples. In: IEEE Winter Conference on Applications of Computer Vision (WACV), Santa Rosa (2017)","DOI":"10.1109\/WACV.2017.80"},{"key":"1499_CR170","unstructured":"Zhang, C., Li, H., Wang, X., Yang, X.: Cross-scene crowd counting via deep convolutional neural networks. In: IEEE Conference on Computer Vision and Pattern Recognition, Boston (2015)"},{"key":"1499_CR171","unstructured":"Kang, K., Wang, X.: Fully convolutional neural networks for crowd segmentation. arXiv preprint arXiv:1411.4464 (2014)"},{"key":"1499_CR172","doi-asserted-by":"crossref","unstructured":"Yun, S., Yun, K., Choi, J., Choi, J.Y.: Density-aware pedestrian proposal networks for robust people detection in crowded scenes. In: European Conference on Computer Vision (2016)","DOI":"10.1007\/978-3-319-48881-3_45"},{"key":"1499_CR173","doi-asserted-by":"crossref","unstructured":"Walach, E., Wolf, L.: Learning to count with CNN boosting. In: European Conference on Computer Vision (2016)","DOI":"10.1007\/978-3-319-46475-6_41"},{"key":"1499_CR174","first-page":"26","volume":"4","author":"T Tieleman","year":"2012","unstructured":"Tieleman, T., Hinton, G.: Lecture 6.5\u2013RmsProp: divide the gradient by a running average of its recent magnitude. COURSERA Neural Netw. Mach. Learn. 4, 26\u201331 (2012)","journal-title":"COURSERA Neural Netw. Mach. Learn."},{"key":"1499_CR175","unstructured":"Carvalho, J., Marques, M., Costeira, J.P.: Understanding people flow in transportation hubs. arXiv preprint arXiv:1705.00027 (2017)"},{"key":"1499_CR176","doi-asserted-by":"crossref","unstructured":"Boominathan, L., Kruthiventi, S.S., Babu, R.V.: CrowdNet: a deep convolutional network for dense crowd counting. In: ACM on Multimedia Conference, Amsterdam (2016)","DOI":"10.1145\/2964284.2967300"},{"key":"1499_CR177","unstructured":"Chen, L.C., Papandreou, G., Kokkinos, I., Murphy, K., Yuille, A.L.: Deep Lab: semantic image segmentation with deep convolutional nets and fully connected CRFs. IEEE Trans. Pattern Anal. Mach. Intell. 40(4), 834\u2013848 (2018)"},{"key":"1499_CR178","doi-asserted-by":"crossref","unstructured":"Onoro-Rubio, D., L\u00f3pez-Sastre, R.J.: Towards perspective-free object counting with deep learning. In: European Conference on Computer Vision (2016)","DOI":"10.1007\/978-3-319-46478-7_38"},{"key":"1499_CR179","unstructured":"Kang, D., Dhar, D., Chan, A.B.: Crowd counting by adapting convolutional neural networks with side information. arXiv preprint arXiv:1611.06748 (2016)"},{"key":"1499_CR180","doi-asserted-by":"crossref","unstructured":"Marsden, M., McGuinness, K., Little, S., O\u2019Connor, N.E.: Fully convolutional crowd counting on highly congested scenes. arXiv preprint arXiv:1612.00220 (2016)","DOI":"10.5220\/0006097300270033"},{"key":"1499_CR181","doi-asserted-by":"crossref","unstructured":"Zhao, Z., Li, H., Zhao, R., Wang, X.: Crossing-line crowd counting with two-phase deep neural networks. In: European Conference on Computer Vision (2016)","DOI":"10.1007\/978-3-319-46484-8_43"},{"key":"1499_CR182","doi-asserted-by":"crossref","unstructured":"Sourtzinos, P., Velastin, S.A., Jara, M., Zegers, P., Makris, D.: People counting in videos by fusing temporal cues from spatial context-aware convolutional neural networks. In: European Conference on Computer Vision (2016)","DOI":"10.1007\/978-3-319-48881-3_46"},{"key":"1499_CR183","doi-asserted-by":"crossref","unstructured":"Chattopadhyay, P., Vedantam, R., Selvaraju, R.R., Batra, D., Parikh, D.: Counting everyday objects in everyday scenes. arXiv preprint arXiv:1604.03505 (2016)","DOI":"10.1109\/CVPR.2017.471"},{"key":"1499_CR184","unstructured":"Kingma, D., Ba, J.: Adam: a method for stochastic optimization. arXiv preprint arXiv:1412.6980 (2014)"},{"key":"1499_CR185","first-page":"1","volume":"99","author":"B Sheng","year":"2016","unstructured":"Sheng, B., Shen, C., Lin, G., Li, J., Yang, W., Sun, C.: Crowd counting via weighted VLAD on dense attribute feature maps. IEEE Trans. Circuits Syst. Video Technol. 99, 1\u20131 (2016)","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"1499_CR186","unstructured":"Yi, S.: Pedestrian Behavior Modeling and Understanding in Crowds. Thesis, The Chinese University of Hong Kong, Hong Kong (2016)"},{"issue":"10","key":"1499_CR187","doi-asserted-by":"publisher","first-page":"3016","DOI":"10.1016\/j.patcog.2015.04.001","volume":"48","author":"L Cao","year":"2015","unstructured":"Cao, L., Zhang, X., Ren, W., Huang, K.: Large scale crowd analysis based on convolutional neural network. Pattern Recognit. 48(10), 3016\u20133024 (2015)","journal-title":"Pattern Recognit."},{"key":"1499_CR188","doi-asserted-by":"publisher","first-page":"530","DOI":"10.1016\/j.jvcir.2016.03.021","volume":"38","author":"Y Hu","year":"2016","unstructured":"Hu, Y., Chang, H., Nian, F., Wang, Y., Li, T.: Dense crowd counting from still images with convolutional neural networks. J. Vis. Commun. Image Represent. 38, 530\u2013539 (2016)","journal-title":"J. Vis. Commun. Image Represent."},{"key":"1499_CR189","doi-asserted-by":"crossref","unstructured":"Shao, J., Loy, C.C., Kang, K., Wang, X.: Slicing convolutional neural network for crowd video understanding. In: IEEE Conference on Computer Vision and Pattern Recognition, Las Vegas (2016)","DOI":"10.1109\/CVPR.2016.606"},{"key":"1499_CR190","doi-asserted-by":"crossref","unstructured":"Burney, A., Syed, T.Q.: Crowd video classification using convolutional neural networks. In: International Conference on Frontiers of Information Technology (FIT), Islamabad (2016)","DOI":"10.1109\/FIT.2016.052"},{"key":"1499_CR191","unstructured":"Ravanbakhsh, M., Nabi, M., Mousavi, H., Sangineto, E., Sebe, N.: Plug-and-play cnn for crowd motion analysis: an application in abnormal event detection. arXiv preprint arXiv:1610.00307 (2016)"},{"key":"1499_CR192","doi-asserted-by":"crossref","unstructured":"Zhang, Y., Zhou, D., Chen, S., Gao, S., Ma, Y.: Single-image crowd counting via multi-column convolutional neural network. In: IEEE Conference on Computer Vision and Pattern Recognition, Las Vegas (2016)","DOI":"10.1109\/CVPR.2016.70"},{"key":"1499_CR193","doi-asserted-by":"crossref","unstructured":"Wang, T., Li, G., Lei, J., Li, S., Xu, S.: Crowd counting based on MMCNN in still images. In: Scandinavian Conference on Image Analysis (2017)","DOI":"10.1007\/978-3-319-59126-1_39"},{"key":"1499_CR194","unstructured":"Sabokrou, M., Fayyaz, M., Fathy, M., Moayedd, Z., Klette, R.: Fully convolutional neural network for fast anomaly detection in crowded scenes. arXiv preprint arXiv:1609.00866 (2016)"},{"key":"1499_CR195","doi-asserted-by":"publisher","first-page":"81","DOI":"10.1016\/j.engappai.2015.04.006","volume":"43","author":"M Fu","year":"2015","unstructured":"Fu, M., Xua, P., Lia, X., Liua, Q., Yea, M., Zhu, C.: Fast crowd density estimation with convolutional neural networks. Eng. Appl. Artif. Intell. 43, 81\u201388 (2015)","journal-title":"Eng. Appl. Artif. Intell."},{"key":"1499_CR196","doi-asserted-by":"crossref","unstructured":"Karpathy, A., Toderici, G., Shetty, S., Leung, T., Sukthankar, R., Fei-Fei, L.: Large-scale video classification with convolutional neural networks. In: IEEE conference on Computer Vision and Pattern Recognition, Columbus (2014)","DOI":"10.1109\/CVPR.2014.223"},{"key":"1499_CR197","doi-asserted-by":"crossref","unstructured":"Wang, C., Zhang, H., Yang, L., Liu, S., Cao, X.: Deep people counting in extremely dense crowds. In: Proceedings of the 23rd ACM International Conference on Multimedia, Brisbane, Australia (2015)","DOI":"10.1145\/2733373.2806337"},{"key":"1499_CR198","doi-asserted-by":"crossref","unstructured":"Sindagi, V.A., Patel, V.M.: CNN-based cascaded multi-task learning of high-level prior and density estimation for crowd counting. In: 2017 14th IEEE International Conference on Advanced Video and Signal Based Surveillance (AVSS) (2017)","DOI":"10.1109\/AVSS.2017.8078491"},{"key":"1499_CR199","doi-asserted-by":"crossref","unstructured":"Sam, D.B., Surya, S., Babu, R.V.: Switching convolutional neural network for crowd counting. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (2017)","DOI":"10.1109\/CVPR.2017.429"},{"key":"1499_CR200","doi-asserted-by":"crossref","unstructured":"Sindagi, V.A., Patel, V.M.: Generating high-quality crowd density maps using contextual pyramid CNNs. In: IEEE International Conference on Computer Vision, Venice, Italy (2017)","DOI":"10.1109\/ICCV.2017.206"},{"key":"1499_CR201","doi-asserted-by":"crossref","unstructured":"Xiong, F., Shi, X., Yeung, D.-Y.: Spatiotemporal modeling for crowd counting in videos. arXiv preprint arXiv:1707.07890 (2017)","DOI":"10.1109\/ICCV.2017.551"},{"key":"1499_CR202","doi-asserted-by":"crossref","unstructured":"Liu, B., Vasconcelos, N.: Bayesian model adaptation for crowd counts. In: Proceedings of the IEEE International Conference on Computer Vision (2015)","DOI":"10.1109\/ICCV.2015.475"},{"key":"1499_CR203","doi-asserted-by":"publisher","unstructured":"Sindagi, V.A., Patel, V.M.: A survey of recent advances in CNN-based single image crowd counting and density estimation. Pattern Recognit. Lett. (2017). https:\/\/doi.org\/10.1016\/j.patrec.2017.07.007","DOI":"10.1016\/j.patrec.2017.07.007"},{"key":"1499_CR204","doi-asserted-by":"crossref","unstructured":"Pham, V.-Q., Kozakaya, T., Yamaguchi, O., Okada, R.: Count forest: co-voting uncertain number of targets using random forest for crowd density estimation. In: Proceedings of the IEEE International Conference on Computer Vision (2015)","DOI":"10.1109\/ICCV.2015.372"},{"key":"1499_CR205","doi-asserted-by":"crossref","unstructured":"Shao, J., Kang, K., Loy, C.C., Wang, X.: Deeply learned attributes for crowded scene understanding. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (2015)","DOI":"10.1109\/CVPR.2015.7299097"},{"key":"1499_CR206","doi-asserted-by":"crossref","unstructured":"Alahi, A., Goel, K., Ramanathan, V., Robicquet, A., Fei-Fei, L., Savarese, S.: Social LSTM: human trajectory prediction in crowded spaces. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 961\u2013971 (2016)","DOI":"10.1109\/CVPR.2016.110"},{"key":"1499_CR207","doi-asserted-by":"crossref","unstructured":"Gutoski, M., Aquino, N.M.R., Ribeiro, M., Lazzaretti, E.A., Lopes, S.H.: Detection of video anomalies using convolutional autoencoders and one-class support vector machines. http:\/\/cbic2017.org\/","DOI":"10.21528\/CBIC2017-49"},{"key":"1499_CR208","doi-asserted-by":"publisher","first-page":"548","DOI":"10.1016\/j.neucom.2016.09.063","volume":"219","author":"Y Feng","year":"2017","unstructured":"Feng, Y., Yuan, Y., Lu, X.: Learning deep event models for crowd anomaly detection. Neurocomputing 219, 548\u2013556 (2017)","journal-title":"Neurocomputing"},{"key":"1499_CR209","doi-asserted-by":"publisher","first-page":"358","DOI":"10.1016\/j.image.2016.06.007","volume":"47","author":"S Zhou","year":"2016","unstructured":"Zhou, S., Shen, W., Zeng, D., Fang, M., Wei, Y., Zhang, Z.: Spatial-temporal convolutional neural networks for anomaly detection and localization in crowded scenes. Sig. Process. Image Commun. 47, 358\u2013368 (2016)","journal-title":"Sig. Process. Image Commun."},{"key":"1499_CR210","doi-asserted-by":"crossref","unstructured":"Smeureanu, S., Ionescu, R.T., Popescu, M., Alexe, B.: Deep appearance features for abnormal behavior detection in video. In: Image Analysis and Processing\u2014ICIAP 2017, Catania, Italy (2017)","DOI":"10.1007\/978-3-319-68548-9_70"},{"key":"1499_CR211","doi-asserted-by":"publisher","DOI":"10.1007\/s11042-017-5244-2","author":"J Sun","year":"2017","unstructured":"Sun, J., Shao, J., He, C.: Abnormal event detection for video surveillance using deep one-class learning. Multimed. Tools Appl. (2017). https:\/\/doi.org\/10.1007\/s11042-017-5244-2","journal-title":"Multimed. Tools Appl."},{"key":"1499_CR212","doi-asserted-by":"crossref","unstructured":"Hinami, R., Mei, T., Satoh, S.: Joint detection and recounting of abnormal events by learning deep generic knowledge. arXiv preprint arXiv:1709.09121 (2017)","DOI":"10.1109\/ICCV.2017.391"},{"issue":"12","key":"1499_CR213","doi-asserted-by":"publisher","first-page":"1627","DOI":"10.1016\/j.patrec.2010.05.009","volume":"31","author":"R P\u00e9teri","year":"2010","unstructured":"P\u00e9teri, R., Fazekas, S., Huiskes, M.J.: Dyntex: a comprehensive database of dynamic textures. Pattern Recognit. Lett. 31(12), 1627\u20131632 (2010)","journal-title":"Pattern Recognit. Lett."},{"issue":"2","key":"1499_CR214","doi-asserted-by":"publisher","first-page":"91","DOI":"10.1023\/A:1021669406132","volume":"51","author":"G Doretto","year":"2003","unstructured":"Doretto, G., Chiuso, A., Wu, Y.N., Soatto, S.: Dynamic textures. Int. J. Comput. Vis. 51(2), 91\u2013109 (2003)","journal-title":"Int. J. Comput. Vis."},{"key":"1499_CR215","doi-asserted-by":"crossref","unstructured":"Ghanem, B., Ahuja, N.: Maximum margin distance learning for dynamic texture recognition. In: Computer Vision\u2013ECCV 2010 (2010)","DOI":"10.1007\/978-3-642-15552-9_17"},{"key":"1499_CR216","unstructured":"Chan, A.B., Sheng John, Z., Vasconcelos, L.N.: Privacy preserving crowd monitoring: counting people without people models or tracking. In: IEEE Conference on IEEE Computer Vision and Pattern Recognition, 2008, CVPR 2008 (2008)"},{"key":"1499_CR217","doi-asserted-by":"crossref","unstructured":"Chen, K., Loy, C.C., Gong, S., Xiang, T.: Feature mining for localised crowd counting. In: BMVC (2012)","DOI":"10.5244\/C.26.21"},{"key":"1499_CR218","doi-asserted-by":"crossref","unstructured":"Idrees, H., Saleemi, I., Seibert, C., Shah, M.: Multi-source multi-scale counting in extremely dense crowd images. In: IEEE Conference on Computer Vision and Pattern Recognition (2013)","DOI":"10.1109\/CVPR.2013.329"},{"key":"1499_CR219","doi-asserted-by":"publisher","first-page":"1","DOI":"10.5465\/19416521003654160","volume":"4","author":"S Blunsden","year":"2010","unstructured":"Blunsden, S., Fisher, R.B.: The BEHAVE video dataset: ground truthed video for multi-person behavior classification. Ann. BMVA 4, 1\u201312 (2010)","journal-title":"Ann. BMVA"},{"key":"1499_CR220","doi-asserted-by":"crossref","unstructured":"Papadopoulos, S., Schinas, E., Mezaris, V., Troncy, R., Kompatsiaris, I.: Social event detection at mediaeval 2012: challenges, dataset and evaluation. In: Proceedings of MediaEval 2012 Workshop (2012)","DOI":"10.1145\/2483977.2483989"},{"key":"1499_CR221","unstructured":"Li, L., Su, H., Xing, E., Fei-Fei, L.: Object bank: a high-level image representation for scene classification and semantic feature sparsification. In: NIPS (2010)"},{"issue":"1","key":"1499_CR222","doi-asserted-by":"publisher","first-page":"98","DOI":"10.1007\/s11263-014-0733-5","volume":"111","author":"M Everingham","year":"2015","unstructured":"Everingham, M., Eslami, S.M.A., Gool, L.V., Williams, C.K.I., Winn, J., Zisserman, A.: The pascal visual object classes challenge: a retrospective. Int. J. Comput. Vis. 111(1), 98\u2013136 (2015)","journal-title":"Int. J. Comput. Vis."},{"key":"1499_CR223","doi-asserted-by":"crossref","unstructured":"Lin, T.-Y., Maire, M., Belongie, S., Hays, J., Perona, P., Ramanan, D., Dollar, P., Zitnick, C.L.: Microsoft COCO: common objects in context. In: ECCV, pp. 740\u2013755 (2014)","DOI":"10.1007\/978-3-319-10602-1_48"},{"issue":"4","key":"1499_CR224","doi-asserted-by":"publisher","first-page":"743","DOI":"10.1109\/TPAMI.2011.155","volume":"34","author":"P Dollar","year":"2012","unstructured":"Dollar, P., Wojek, C., Schiele, B., Perona, P.: Pedestrian detection: an evaluation of the state of the art. IEEE Trans. Pattern Anal. Mach. Intell. 34(4), 743\u2013761 (2012)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"1499_CR225","doi-asserted-by":"crossref","unstructured":"Shang, C., Ai, H., Bai, B.: End-to-end crowd counting via joint learning local and global count. In: 2016 IEEE International Conference on Image Processing (ICIP), Phoenix (2016)","DOI":"10.1109\/ICIP.2016.7532551"},{"key":"1499_CR226","doi-asserted-by":"crossref","unstructured":"Conigliaro, D., Rota, P., Setti, F., Bassetti, C., Conci, N., Sebe, N., Cristani, M.: The S-Hock Dataset: analyzing crowds at the stadium. In: The IEEE Conference on Computer Vision and Pattern Recognition (CVPR) (2015)","DOI":"10.1109\/CVPR.2015.7298815"},{"key":"1499_CR227","doi-asserted-by":"crossref","unstructured":"Shao, J., Change Loy, C., Wang, X.: Scene-independent group profiling in crowd. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (2014)","DOI":"10.1109\/CVPR.2014.285"},{"issue":"3","key":"1499_CR228","doi-asserted-by":"publisher","first-page":"499","DOI":"10.1007\/s11263-017-1005-y","volume":"123","author":"S Wu","year":"2017","unstructured":"Wu, S., Yang, H., Zheng, S., Su, H., Fan, Y., Yang, M.-H.: Crowd behavior analysis via curl and divergence of motion trajectories. Int. J. Comput. Vis. 123(3), 499\u2013519 (2017)","journal-title":"Int. J. Comput. Vis."},{"key":"1499_CR229","doi-asserted-by":"crossref","unstructured":"Yoo, Y., Yun, K., Yun, S., Hong, J., Jeong, H., Young Choi, J.: Visual path prediction in complex scenes with crowded moving objects. In: The IEEE Conference on Computer Vision and Pattern Recognition (CVPR) (2016)","DOI":"10.1109\/CVPR.2016.292"}],"container-title":["The Visual Computer"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s00371-018-1499-5.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s00371-018-1499-5\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s00371-018-1499-5.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2023,9,1]],"date-time":"2023-09-01T19:50:17Z","timestamp":1693597817000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s00371-018-1499-5"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2018,3,26]]},"references-count":229,"journal-issue":{"issue":"5","published-print":{"date-parts":[[2019,5]]}},"alternative-id":["1499"],"URL":"https:\/\/doi.org\/10.1007\/s00371-018-1499-5","relation":{},"ISSN":["0178-2789","1432-2315"],"issn-type":[{"value":"0178-2789","type":"print"},{"value":"1432-2315","type":"electronic"}],"subject":[],"published":{"date-parts":[[2018,3,26]]},"assertion":[{"value":"26 March 2018","order":1,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}]}}