{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,10,30]],"date-time":"2025-10-30T10:51:06Z","timestamp":1761821466829,"version":"3.37.3"},"reference-count":38,"publisher":"Springer Science and Business Media LLC","issue":"6","license":[{"start":{"date-parts":[[2022,7,19]],"date-time":"2022-07-19T00:00:00Z","timestamp":1658188800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"},{"start":{"date-parts":[[2022,7,19]],"date-time":"2022-07-19T00:00:00Z","timestamp":1658188800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"crossref","award":["61832001"],"award-info":[{"award-number":["61832001"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"crossref"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimedia Systems"],"published-print":{"date-parts":[[2022,12]]},"DOI":"10.1007\/s00530-022-00978-8","type":"journal-article","created":{"date-parts":[[2022,7,19]],"date-time":"2022-07-19T09:02:55Z","timestamp":1658221375000},"page":"2453-2464","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":6,"title":["ENet: event based highlight generation network for broadcast sports videos"],"prefix":"10.1007","volume":"28","author":[{"given":"Abdullah Aman","family":"Khan","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yunbo","family":"Rao","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jie","family":"Shao","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2022,7,19]]},"reference":[{"doi-asserted-by":"crossref","unstructured":"Khan, A.A., Lin, H., Tumrani, S., Wang, Z., Shao, J.: Detection and localization of scorebox in long duration broadcast sports videos. In: Proceedings of the 5th International Symposium on Artificial Intelligence and Robotics, ISAIR 2020, p. 115740 (2020)","key":"978_CR1","DOI":"10.1117\/12.2575834"},{"unstructured":"Gong, B., Chao, W., Grauman, K., Sha, F.: Diverse sequential subset selection for supervised video summarization. In: Advances in Neural Information Processing Systems 27: Annual Conference on Neural Information Processing Systems 2014, pp. 2069\u20132077 (2014)","key":"978_CR2"},{"doi-asserted-by":"crossref","unstructured":"Zhao, B., Xing, E.P.: Quasi real-time summarization for consumer videos. In: 2014 IEEE Conference on Computer Vision and Pattern Recognition, CVPR 2014, pp. 2513\u20132520 (2014)","key":"978_CR3","DOI":"10.1109\/CVPR.2014.322"},{"doi-asserted-by":"crossref","unstructured":"Andonian, A., Fosco, C., Monfort, M., Lee, A., Feris, R., Vondrick, C., Oliva, A.: We have so much in common: Modeling semantic relational set abstractions in videos. In: Computer Vision - ECCV 2020 - 16th European Conference, Proceedings, Part XVIII, pp. 18\u201334 (2020)","key":"978_CR4","DOI":"10.1007\/978-3-030-58523-5_2"},{"doi-asserted-by":"crossref","unstructured":"Betting, J.L.F., Romano, V., Bosman, L.W.J., Al-Ars, Z., Zeeuw, C.I.D., Strydis, C.: Stairway to abstraction: an iterative algorithm for whisker detection in video frames. In: 11th IEEE Latin American Symposium on Circuits & Systems, LASCAS 2020, pp. 1\u20134 (2020)","key":"978_CR5","DOI":"10.1109\/LASCAS45839.2020.9068992"},{"doi-asserted-by":"crossref","unstructured":"Chen, Y., Yuan, H., Li, Y.: Object-oriented state abstraction in reinforcement learning for video games. In: IEEE Conference on Games, CoG 2019, pp. 1\u20134 (2019)","key":"978_CR6","DOI":"10.1109\/CIG.2019.8848099"},{"issue":"4","key":"978_CR7","doi-asserted-by":"publisher","first-page":"1695","DOI":"10.1007\/s00034-018-0932-3","volume":"38","author":"AR Yamghani","year":"2019","unstructured":"Yamghani, A.R., Zargari, F.: Compressed domain video abstraction based on i-frame of HEVC coded videos. Circ. Syst. Signal Process. 38(4), 1695\u20131716 (2019)","journal-title":"Circ. Syst. Signal Process."},{"doi-asserted-by":"crossref","unstructured":"Islam, M.R., Paul, M., Antolovich, M., Kabir, A.: Sports highlights generation using decomposed audio information. In: IEEE International Conference on Multimedia & Expo Workshops, ICME Workshops 2019, pp. 579\u2013584 (2019)","key":"978_CR8","DOI":"10.1109\/ICMEW.2019.00105"},{"key":"978_CR9","doi-asserted-by":"publisher","first-page":"107779","DOI":"10.1016\/j.compeleceng.2022.107779","volume":"99","author":"AA Khan","year":"2022","unstructured":"Khan, A.A., Shao, J.: Spnet: A deep network for broadcast sports video highlight generation. Comput. Electr. Eng. 99, 107779 (2022)","journal-title":"Comput. Electr. Eng."},{"key":"978_CR10","doi-asserted-by":"publisher","first-page":"115784","DOI":"10.1016\/j.image.2020.115784","volume":"83","author":"Z Pan","year":"2020","unstructured":"Pan, Z., Li, C.: Robust basketball sports recognition by leveraging motion block estimation. Signal Process. Image Commun. 83, 115784 (2020)","journal-title":"Signal Process. Image Commun."},{"issue":"1","key":"978_CR11","doi-asserted-by":"publisher","first-page":"74","DOI":"10.1111\/jcal.12312","volume":"35","author":"G Rekik","year":"2019","unstructured":"Rekik, G., Khacharem, A., Belkhir, Y., Bali, N., Jarraya, M.: The instructional benefits of dynamic visualizations in the acquisition of basketball tactical actions. J. Comput. Assist. Learn. 35(1), 74\u201381 (2019)","journal-title":"J. Comput. Assist. Learn."},{"unstructured":"Cai, J., Tang, X.: RGB video based tennis action recognition using a deep weighted long short-term memory. arXiv:1808.00845 (2018)","key":"978_CR12"},{"doi-asserted-by":"crossref","unstructured":"Ghosh, A., Jawahar, C.V.: Smarttennistv: Automatic indexing of tennis videos. In: Computer Vision, Pattern Recognition, Image Processing, and Graphics - 6th National Conference, NCVPRIPG 2017, pp. 24\u201333 (2017)","key":"978_CR13","DOI":"10.1007\/978-981-13-0020-2_3"},{"doi-asserted-by":"crossref","unstructured":"Agyeman, R., Muhammad, R., Choi, G.S.: Soccer video summarization using deep learning. In: 2nd IEEE Conference on Multimedia Information Processing and Retrieval, MIPR 2019 (2019)","key":"978_CR14","DOI":"10.1109\/MIPR.2019.00055"},{"doi-asserted-by":"crossref","unstructured":"Deng, G., Liu, L., Zuo, J.: Scoring framework of soccer matches using possession trajectory data. In: Proceedings of the ACM Turing Celebration Conference - China, ACM TUR-C 2019, pp. 59\u20131592 (2019)","key":"978_CR15","DOI":"10.1145\/3321408.3322842"},{"key":"978_CR16","doi-asserted-by":"publisher","first-page":"94258","DOI":"10.1109\/ACCESS.2020.2990941","volume":"8","author":"D He","year":"2020","unstructured":"He, D., Li, L., An, L.: Study on sports volleyball tracking technology based on image processing and 3d space matching. IEEE Access 8, 94258\u201394267 (2020)","journal-title":"IEEE Access"},{"issue":"6","key":"978_CR17","doi-asserted-by":"publisher","first-page":"745","DOI":"10.1007\/s00530-020-00684-3","volume":"26","author":"H Shingrakhia","year":"2020","unstructured":"Shingrakhia, H., Patel, H.: Emperor penguin optimized event recognition and summarization for cricket highlight generation. Multimed. Syst. 26(6), 745\u2013759 (2020)","journal-title":"Multimed. Syst."},{"issue":"3","key":"978_CR18","doi-asserted-by":"publisher","first-page":"1945","DOI":"10.1007\/s11063-020-10200-3","volume":"52","author":"AA Khan","year":"2020","unstructured":"Khan, A.A., Shao, J., Ali, W., Tumrani, S.: Content-aware summarization of broadcast sports videos: An audio-visual feature extraction approach. Neural Process. Lett. 52(3), 1945\u20131968 (2020)","journal-title":"Neural Process. Lett."},{"doi-asserted-by":"crossref","unstructured":"Yan, C., Li, X., Li, G.: A new action recognition framework for video highlights summarization in sporting events. In: 16th International Conference on Computer Science & Education, ICCSE 2021, pp. 653\u2013666 (2021)","key":"978_CR19","DOI":"10.1109\/ICCSE51940.2021.9569708"},{"issue":"3","key":"978_CR20","doi-asserted-by":"publisher","first-page":"483","DOI":"10.3390\/app9030483","volume":"9","author":"RA Minhas","year":"2019","unstructured":"Minhas, R.A., Javed, A., Irtaza, A., Mahmood, M.T., Joo, Y.B.: Shot classification of field sports videos using alexnet convolutional neural network. Appl. Sci. 9(3), 483 (2019)","journal-title":"Appl. Sci."},{"issue":"6","key":"978_CR21","doi-asserted-by":"publisher","first-page":"1702","DOI":"10.3390\/s20061702","volume":"20","author":"M Rafiq","year":"2020","unstructured":"Rafiq, M., Rafiq, G., Agyeman, R., Choi, G.S., Jin, S.: Scene classification for sports video summarization using transfer learning. Sensors 20(6), 1702 (2020)","journal-title":"Sensors"},{"doi-asserted-by":"crossref","unstructured":"Sanabria, M., Sherly, Precioso, F., Menguy, T.: A deep architecture for multimodal summarization of soccer games. In: Proceedings Proceedings of the 2nd International Workshop on Multimedia Content Analysis in Sports, MMSports@MM 2019, pp. 16\u201324 (2019)","key":"978_CR22","DOI":"10.1145\/3347318.3355524"},{"doi-asserted-by":"crossref","unstructured":"Turchini, F., Seidenari, L., Galteri, L., Ferracani, A., Becchi, G., Bimbo, A.D.: Flexible automatic football filming and summarization. In: Proceedings Proceedings of the 2nd International Workshop on Multimedia Content Analysis in Sports, MMSports@MM 2019, pp. 108\u2013114 (2019)","key":"978_CR23","DOI":"10.1145\/3347318.3355526"},{"doi-asserted-by":"crossref","unstructured":"Datt, M., Mukhopadhyay, J.: Content based video summarization: Finding interesting temporal sequences of frames. In: 2018 IEEE International Conference on Image Processing, ICIP 2018, Athens, Greece, October 7\u201310, 2018, pp. 1268\u20131272 (2018)","key":"978_CR24","DOI":"10.1109\/ICIP.2018.8451282"},{"doi-asserted-by":"crossref","unstructured":"Venkataramanan, A., Laviale, M., Figus, C., Usseglio-Polatera, P., Pradalier, C.: Tackling inter-class similarity and intra-class variance for microscopic image-based classification. In: Computer Vision Systems - 13th International Conference, ICVS 2021, pp. 93\u2013103 (2021)","key":"978_CR25","DOI":"10.1007\/978-3-030-87156-7_8"},{"key":"978_CR26","doi-asserted-by":"publisher","first-page":"103870","DOI":"10.1016\/j.imavis.2020.103870","volume":"94","author":"C Zalluhoglu","year":"2020","unstructured":"Zalluhoglu, C., Ikizler-Cinbis, N.: Collective sports: A multi-task dataset for collective activity recognition. Image Vis. Comput. 94, 103870 (2020)","journal-title":"Image Vis. Comput."},{"doi-asserted-by":"crossref","unstructured":"Khan, A.A., Tumrani, S., Jiang, C., Shao, J.: RICAPS: residual inception and cascaded capsule network for broadcast sports video classification. In: MMAsia 2020: ACM Multimedia Asia, pp. 43\u20131437 (2020)","key":"978_CR27","DOI":"10.1145\/3444685.3446296"},{"doi-asserted-by":"crossref","unstructured":"Hara, K., Kataoka, H., Satoh, Y.: Can spatiotemporal 3d cnns retrace the history of 2d cnns and imagenet? In: 2018 IEEE Conference on Computer Vision and Pattern Recognition, CVPR 2018, pp. 6546\u20136555 (2018)","key":"978_CR28","DOI":"10.1109\/CVPR.2018.00685"},{"doi-asserted-by":"crossref","unstructured":"Szegedy, C., Ioffe, S., Vanhoucke, V., Alemi, A.A.: Inception-v4, inception-resnet and the impact of residual connections on learning. In: Proceedings of the Thirty-First AAAI Conference on Artificial Intelligence, pp. 4278\u20134284 (2017)","key":"978_CR29","DOI":"10.1609\/aaai.v31i1.11231"},{"doi-asserted-by":"crossref","unstructured":"Szegedy, C., Vanhoucke, V., Ioffe, S., Shlens, J., Wojna, Z.: Rethinking the inception architecture for computer vision. In: 2016 IEEE Conference on Computer Vision and Pattern Recognition, CVPR 2016, pp. 2818\u20132826 (2016)","key":"978_CR30","DOI":"10.1109\/CVPR.2016.308"},{"unstructured":"Simonyan, K., Zisserman, A.: Very deep convolutional networks for large-scale image recognition. In: Bengio, Y., LeCun, Y. (eds.) 3rd International Conference on Learning Representations, ICLR 2015 (2015)","key":"978_CR31"},{"doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., Sun, J.: Deep residual learning for image recognition. In: 2016 IEEE Conference on Computer Vision and Pattern Recognition, CVPR 2016, pp. 770\u2013778 (2016)","key":"978_CR32","DOI":"10.1109\/CVPR.2016.90"},{"doi-asserted-by":"crossref","unstructured":"Huang, G., Liu, Z., van\u00a0der Maaten, L., Weinberger, K.Q.: Densely connected convolutional networks. In: 2017 IEEE Conference on Computer Vision and Pattern Recognition, CVPR 2017, pp. 2261\u20132269 (2017)","key":"978_CR33","DOI":"10.1109\/CVPR.2017.243"},{"doi-asserted-by":"crossref","unstructured":"Carreira, J., Zisserman, A.: Quo vadis, action recognition? A new model and the kinetics dataset. In: 2017 IEEE Conference on Computer Vision and Pattern Recognition, CVPR 2017, pp. 4724\u20134733 (2017)","key":"978_CR34","DOI":"10.1109\/CVPR.2017.502"},{"unstructured":"Weng, X., Kitani, K.: Learning spatio-temporal features with two-stream deep 3d cnns for lipreading. In: 30th British Machine Vision Conference 2019, BMVC 2019, p. 269 (2019)","key":"978_CR35"},{"doi-asserted-by":"crossref","unstructured":"Tran, D., Bourdev, L.D., Fergus, R., Torresani, L., Paluri, M.: Learning spatiotemporal features with 3d convolutional networks. In: 2015 IEEE International Conference on Computer Vision, ICCV 2015, pp. 4489\u20134497 (2015)","key":"978_CR36","DOI":"10.1109\/ICCV.2015.510"},{"issue":"4","key":"978_CR37","doi-asserted-by":"publisher","first-page":"677","DOI":"10.1109\/TPAMI.2016.2599174","volume":"39","author":"J Donahue","year":"2017","unstructured":"Donahue, J., Hendricks, L.A., Rohrbach, M., Venugopalan, S., Guadarrama, S., Saenko, K., Darrell, T.: Long-term recurrent convolutional networks for visual recognition and description. IEEE Trans. Pattern Anal. Mach. Intell. 39(4), 677\u2013691 (2017)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"doi-asserted-by":"crossref","unstructured":"Kalfaoglu, M.E., Kalkan, S., Alatan, A.A.: Late temporal modeling in 3d CNN architectures with BERT for action recognition. In: Computer Vision - ECCV 2020 Workshops, Proceedings, Part V, pp. 731\u2013747 (2020)","key":"978_CR38","DOI":"10.1007\/978-3-030-68238-5_48"}],"container-title":["Multimedia Systems"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00530-022-00978-8.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s00530-022-00978-8\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00530-022-00978-8.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,11,23]],"date-time":"2022-11-23T00:33:10Z","timestamp":1669163590000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s00530-022-00978-8"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2022,7,19]]},"references-count":38,"journal-issue":{"issue":"6","published-print":{"date-parts":[[2022,12]]}},"alternative-id":["978"],"URL":"https:\/\/doi.org\/10.1007\/s00530-022-00978-8","relation":{},"ISSN":["0942-4962","1432-1882"],"issn-type":[{"type":"print","value":"0942-4962"},{"type":"electronic","value":"1432-1882"}],"subject":[],"published":{"date-parts":[[2022,7,19]]},"assertion":[{"value":"4 May 2022","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"2 July 2022","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"19 July 2022","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}]}}