{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2024,8,6]],"date-time":"2024-08-06T02:41:32Z","timestamp":1722912092795},"reference-count":56,"publisher":"Springer Science and Business Media LLC","issue":"1","license":[{"start":{"date-parts":[[2011,10,13]],"date-time":"2011-10-13T00:00:00Z","timestamp":1318464000000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/creativecommons.org\/licenses\/by\/2.0"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["EURASIP J. Adv. Signal Process."],"published-print":{"date-parts":[[2011,12]]},"DOI":"10.1186\/1687-6180-2011-89","type":"journal-article","created":{"date-parts":[[2012,1,3]],"date-time":"2012-01-03T21:32:28Z","timestamp":1325626348000},"source":"Crossref","is-referenced-by-count":1,"title":["Joint modality fusion and temporal context exploitation for semantic video analysis"],"prefix":"10.1186","volume":"2011","author":[{"given":"Georgios Th","family":"Papadopoulos","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Vasileios","family":"Mezaris","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Ioannis","family":"Kompatsiaris","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Michael G.","family":"Strintzis","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2011,10,13]]},"reference":[{"issue":"4","key":"87_CR1","doi-asserted-by":"publisher","first-page":"541","DOI":"10.1109\/JPROC.2008.916338","volume":"96","author":"A Hanjalic","year":"2008","unstructured":"Hanjalic A, Lienhart R, Ma W, Smith J: The holy grail of multimedia information retrieval: so close or yet so far away? Proc IEEE 2008,96(4):541-547.","journal-title":"Proc IEEE"},{"issue":"4","key":"87_CR2","doi-asserted-by":"publisher","first-page":"545","DOI":"10.1016\/j.is.2006.09.001","volume":"32","author":"A Smeaton","year":"2007","unstructured":"Smeaton A: Techniques used and open challenges to the analysis, indexing and retrieval of digital video. Inf Syst 2007,32(4):545-559. 10.1016\/j.is.2006.09.001","journal-title":"Inf Syst"},{"key":"87_CR3","first-page":"829","volume-title":"IEEE International Conference on Multimedia and Expo (ICME)","author":"W Zhu","year":"2001","unstructured":"Zhu W, Toklu C, Liou S: Automatic news video segmentation and categorization based on closed-captioned text. IEEE International Conference on Multimedia and Expo (ICME) 2001, 829-832."},{"issue":"10","key":"87_CR4","doi-asserted-by":"publisher","first-page":"1529","DOI":"10.1109\/TCSVT.2009.2022705","volume":"19","author":"HL Wang","year":"2009","unstructured":"Wang HL, Cheong L-F: Taxonomy of directing semantics for film shot classification. IEEE Trans Circuits Syst Video Technol 2009,19(10):1529-1542.","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"issue":"1","key":"87_CR5","doi-asserted-by":"publisher","first-page":"5","DOI":"10.1023\/B:MTAP.0000046380.27575.a5","volume":"25","author":"C Snoek","year":"2005","unstructured":"Snoek C, Worring M: Multimodal video indexing: a review of the state-of-the-art. Multimedia Tools Appl 2005,25(1):5-35.","journal-title":"Multimedia Tools Appl"},{"issue":"6","key":"87_CR6","doi-asserted-by":"publisher","first-page":"12","DOI":"10.1109\/79.888862","volume":"17","author":"Y Wang","year":"2000","unstructured":"Wang Y, Liu Z, Huang J: Multimedia content analysis-using both audio and visual clues. Signal Process Mag IEEE 2000,17(6):12-36. 10.1109\/79.888862","journal-title":"Signal Process Mag IEEE"},{"issue":"2","key":"87_CR7","doi-asserted-by":"publisher","first-page":"101","DOI":"10.1109\/MSP.2006.1598086","volume":"23","author":"J Luo","year":"2006","unstructured":"Luo J, Boutell M, Brown C: Pictures are not taken in a vacuum. Signal Process Mag IEEE 2006,23(2):101-114.","journal-title":"Signal Process Mag IEEE"},{"issue":"3","key":"87_CR8","doi-asserted-by":"publisher","first-page":"336","DOI":"10.1109\/TCSVT.2007.890633","volume":"17","author":"D Vallet","year":"2007","unstructured":"Vallet D, Castells P, Fernandez M, Mylonas P, Avrithis Y: Personalized content retrieval in context using ontological knowledge. IEEE Trans Circuits Syst Video Technol 2007,17(3):336.","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"87_CR9","doi-asserted-by":"crossref","unstructured":"Papadopoulos GT, Mezaris V, Kompatsiaris I, Strintzis MG: Combining global and local information for knowledge-assisted image analysis and classification. EURASIP J Adv Signal Process 2007.,2007(2):","DOI":"10.1155\/2007\/45842"},{"key":"87_CR10","doi-asserted-by":"crossref","first-page":"299","DOI":"10.1145\/1386352.1386393","volume-title":"Proceedings of International Conference on Content-Based Image and Video Retrieval","author":"D Byrne","year":"2008","unstructured":"Byrne D, Wilkins P, Jones G, Smeaton A, Connor NO': Measuring the impact of temporal context on video retrieval. Proceedings of International Conference on Content-Based Image and Video Retrieval 2008, 299-308."},{"issue":"2","key":"87_CR11","doi-asserted-by":"publisher","first-page":"257","DOI":"10.1109\/5.18626","volume":"77","author":"L Rabiner","year":"1989","unstructured":"Rabiner L: A tutorial on hidden Markov models and selected applications in speech recognition. Proc IEEE 1989,77(2):257-286. 10.1109\/5.18626","journal-title":"Proc IEEE"},{"issue":"3","key":"87_CR12","doi-asserted-by":"publisher","first-page":"538","DOI":"10.1109\/TMM.2005.843346","volume":"7","author":"J Huang","year":"2005","unstructured":"Huang J, Liu Z, Wang Y: Joint scene classification and segmentation based on hidden Markov model. IEEE Trans Multimedia 2005,7(3):538-550.","journal-title":"IEEE Trans Multimedia"},{"issue":"11","key":"87_CR13","doi-asserted-by":"publisher","first-page":"1576","DOI":"10.1109\/TCSVT.2008.2005614","volume":"18","author":"J Zhou","year":"2008","unstructured":"Zhou J, Zhang X-P: An ica mixture hidden markov model for video content analysis. IEEE Trans Circuits Syst Video Technol 2008,18(11):1576-1586.","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"issue":"3","key":"87_CR14","doi-asserted-by":"publisher","first-page":"372","DOI":"10.1016\/j.cviu.2008.08.007","volume":"113","author":"X Gao","year":"2009","unstructured":"Gao X, Yang Y, Tao D, Li X: Discriminative optical flow tensor for video semantic analysis. Comput Vis Image Underst 2009,113(3):372-383. 10.1016\/j.cviu.2008.08.007","journal-title":"Comput Vis Image Underst"},{"key":"87_CR15","volume-title":"Learning Bayesian Networks","author":"R Neapolitan","year":"2003","unstructured":"Neapolitan R: Learning Bayesian Networks. Prentice Hall Upper Saddle River, NJ; 2003."},{"key":"87_CR16","volume-title":"Learning in graphical models","author":"D Heckerman","year":"1998","unstructured":"Heckerman D: A tutorial on learning with Bayesian networks. In Learning in graphical models. MIT Press Cambridge, MA; 1998."},{"key":"87_CR17","doi-asserted-by":"publisher","first-page":"170","DOI":"10.1155\/S1110865703211173","volume":"2","author":"W Adams","year":"2003","unstructured":"Adams W, Iyengar G, Lin C, Naphade M, Neti C, Nock H, Smith J: Semantic indexing of multimedia content using visual, audio, and text cues. EURASIP J Appl Signal Process 2003, 2: 170-185.","journal-title":"EURASIP J Appl Signal Process"},{"issue":"12","key":"87_CR18","doi-asserted-by":"publisher","first-page":"1713","DOI":"10.1109\/TCSVT.2008.2004934","volume":"18","author":"M-H Hung","year":"2008","unstructured":"Hung M-H, Hsieh C-H: Event detection of broadcast baseball videos. IEEE Trans Circuits Syst Video Technol 2008,18(12):1713-1726.","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"87_CR19","volume-title":"Machine Learning for Multimedia Content Analysis","author":"Y Gong","year":"2007","unstructured":"Gong Y, Xu W: Machine Learning for Multimedia Content Analysis. Springer, New York; 2007."},{"issue":"9","key":"87_CR20","doi-asserted-by":"publisher","first-page":"1520","DOI":"10.1109\/TPAMI.2007.70801","volume":"30","author":"E Bruno","year":"2008","unstructured":"Bruno E, Moenne-Loccoz N, Marchand-Maillet S: Design of multimodal dissimilarity spaces for retrieval of video documents. IEEE Trans Pattern Anal Mach Intell 2008,30(9):1520-1533.","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"issue":"2","key":"87_CR21","doi-asserted-by":"publisher","first-page":"252","DOI":"10.1109\/TMM.2007.911830","volume":"10","author":"M Shyu","year":"2008","unstructured":"Shyu M, Xie Z, Chen M, Chen S: Video semantic event\/concept detection using a subspace-based multimedia data mining framework. IEEE Trans Multimedia 2008,10(2):252-259.","journal-title":"IEEE Trans Multimedia"},{"issue":"4","key":"87_CR22","doi-asserted-by":"publisher","first-page":"607","DOI":"10.1109\/TMM.2008.921735","volume":"10","author":"S Hoi","year":"2008","unstructured":"Hoi S, Lyu M: A multimodal and multilevel ranking scheme for large-scale video retrieval. IEEE Trans Multimedia 2008,10(4):607-619.","journal-title":"IEEE Trans Multimedia"},{"issue":"5","key":"87_CR23","doi-asserted-by":"publisher","first-page":"1009","DOI":"10.1109\/TSMCA.2010.2046729","volume":"40","author":"D Tjondronegoro","year":"2010","unstructured":"Tjondronegoro D, Chen Y: Knowledge-discounted event detection in sports video. IEEE Trans Syst Man Cybern Part A Syst Hum 2010,40(5):1009-1024.","journal-title":"IEEE Trans Syst Man Cybern Part A Syst Hum"},{"issue":"3","key":"87_CR24","doi-asserted-by":"publisher","first-page":"421","DOI":"10.1109\/TMM.2008.917346","volume":"10","author":"C Xu","year":"2008","unstructured":"Xu C, Wang J, Lu L, Zhang Y: A novel framework for semantic annotation and personalized retrieval of sports video. IEEE Trans Multimedia 2008,10(3):421-436.","journal-title":"IEEE Trans Multimedia"},{"key":"87_CR25","first-page":"33","volume-title":"Proceedings of ACM International Workshop on Multimedia Information Retrieval","author":"J Yang","year":"2006","unstructured":"Yang J, Hauptmann A: Exploring temporal consistency for video analysis and retrieval. Proceedings of ACM International Workshop on Multimedia Information Retrieval 2006, 33-42."},{"issue":"11","key":"87_CR26","doi-asserted-by":"publisher","first-page":"1422","DOI":"10.1109\/TCSVT.2005.856903","volume":"15","author":"G Xu","year":"2005","unstructured":"Xu G, Ma Y, Zhang H, Yang S: An HMM-based framework for video semantic analysis. IEEE Trans Circuits Syst Video Technol 2005,15(11):1422-1433.","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"issue":"7","key":"87_CR27","doi-asserted-by":"publisher","first-page":"767","DOI":"10.1016\/j.patrec.2004.01.005","volume":"25","author":"L Xie","year":"2004","unstructured":"Xie L, Xu P, Chang S, Divakaran A, Sun H: Structure analysis of soccer video with domain knowledge and hidden Markov models. Pattern Recognit Lett 2004,25(7):767-775. 10.1016\/j.patrec.2004.01.005","journal-title":"Pattern Recognit Lett"},{"key":"87_CR28","first-page":"289","volume-title":"IEEE International Conference on Multimedia and Expo (ICME)","author":"K Wan","year":"2008","unstructured":"Wan K: Exploiting story-level context to improve video search. IEEE International Conference on Multimedia and Expo (ICME) 2008, 289-292."},{"key":"87_CR29","doi-asserted-by":"crossref","first-page":"971","DOI":"10.1145\/1291233.1291446","volume-title":"Proceedings of International Conference on Multimedia","author":"W Hsu","year":"2007","unstructured":"Hsu W, Kennedy L, Chang S: Video search reranking through random walk over document-level context graph. Proceedings of International Conference on Multimedia 2007, 971-980."},{"issue":"4","key":"87_CR30","doi-asserted-by":"publisher","first-page":"287","DOI":"10.1016\/j.image.2010.02.001","volume":"25","author":"J You","year":"2010","unstructured":"You J, Liu G, Perkis A: A semantic framework for video genre classification and event analysis. Signal Process Image Commun 2010,25(4):287-302. 10.1016\/j.image.2010.02.001","journal-title":"Signal Process Image Commun"},{"issue":"7","key":"87_CR31","doi-asserted-by":"publisher","first-page":"1301","DOI":"10.1109\/TMM.2009.2030828","volume":"11","author":"Y Ding","year":"2009","unstructured":"Ding Y, Fan G: Sports video mining via multichannel segmental hidden Markov models. IEEE Trans Multimedia 2009,11(7):1301.","journal-title":"IEEE Trans Multimedia"},{"key":"87_CR32","first-page":"345","volume":"2","author":"X Gibert","year":"2003","unstructured":"Gibert X, Li H, Doermann D: Sports video classification using HMMs. IEEE Int Conf Multimedia Expo (ICME) 2003, 2: 345-348.","journal-title":"IEEE Int Conf Multimedia Expo (ICME)"},{"issue":"10","key":"87_CR33","doi-asserted-by":"publisher","first-page":"1513","DOI":"10.1109\/TCSVT.2009.2026932","volume":"19","author":"GT Papadopoulos","year":"2009","unstructured":"Papadopoulos GT, Briassouli A, Mezaris V, Kompatsiaris I, Strintzis MG: Statistical motion information extraction and representation for semantic video analysis. IEEE Transactions Circuits Syst Video Technol 2009,19(10):1513-1528.","journal-title":"IEEE Transactions Circuits Syst Video Technol"},{"key":"87_CR34","doi-asserted-by":"publisher","first-page":"78","DOI":"10.1117\/12.257312","volume":"2916","author":"V Kobla","year":"1996","unstructured":"Kobla V, Doermann D, Lin K: Archiving, indexing, and retrieval of video in the compressed domain. Proceedings of SPIE Conference on Multimedia Storage Archiving Systems 1996, 2916: 78-89.","journal-title":"Proceedings of SPIE Conference on Multimedia Storage Archiving Systems"},{"key":"87_CR35","first-page":"674","volume":"3","author":"B Lucas","year":"1981","unstructured":"Lucas B, Kanade T: An iterative image registration technique with an application to stereo vision. International Joint Conference on Artifical Intelligence 1981, 3: 674-679.","journal-title":"International Joint Conference on Artifical Intelligence"},{"key":"87_CR36","first-page":"277","volume-title":"Proceedings of the International Conference on Computational Intelligence and Multimedia Applications (ICCIMA)","author":"M Geetha","year":"2007","unstructured":"Geetha M, Palanivel S: HMM Based Automatic Video Classification Using Static and Dynamic Features. Proceedings of the International Conference on Computational Intelligence and Multimedia Applications (ICCIMA) 2007, 277-281."},{"key":"87_CR37","volume-title":"IEEE International Conference on Multimedia and Expo (ICME)","author":"Z Xiong","year":"2003","unstructured":"Xiong Z, Radhakrishnan R, Divakaran A, Huang T: Comparing MFCC and MPEG-7 audio features for feature extraction, maximum likelihood HMM and entropic prior HMM for sports audio classification. IEEE International Conference on Multimedia and Expo (ICME) 2003., 3:"},{"issue":"3","key":"87_CR38","doi-asserted-by":"publisher","first-page":"585","DOI":"10.1109\/TMM.2006.870726","volume":"8","author":"C Cheng","year":"2006","unstructured":"Cheng C, Hsu C: Fusion of audio and motion information on HMM-based highlight extraction for baseball games. IEEE Trans Multimedia 2006,8(3):585-599.","journal-title":"IEEE Trans Multimedia"},{"key":"87_CR39","doi-asserted-by":"publisher","first-page":"633","DOI":"10.1007\/11612704_63","volume":"3852","author":"M Kolekar","year":"2006","unstructured":"Kolekar M, Sengupta S: A hierarchical framework for generic sports video classification. Comput Vis ACCV 2006, 3852: 633-642. 10.1007\/11612704_63","journal-title":"Comput Vis ACCV"},{"key":"87_CR40","first-page":"1497","volume-title":"Proceedings of IEEE International Conference on Multimedia and Expo, IEEE","author":"S Ikbal","year":"2008","unstructured":"Ikbal S, Faruquie T: HMM based event detection in audio conversation. Proceedings of IEEE International Conference on Multimedia and Expo, IEEE 2008, 1497-1500."},{"key":"87_CR41","volume-title":"International Conference on Intelligent Systems Design and Applications","author":"B Zhang","year":"2006","unstructured":"Zhang B, Dou W, Chen L: Audio content-based highlight detection using adaptive Hidden Markov Model. International Conference on Intelligent Systems Design and Applications 2006."},{"key":"87_CR42","first-page":"611","volume":"1","author":"D Zhang","year":"2005","unstructured":"Zhang D, Gatica-Perez D, Bengio S, McCowan I: Semi-supervised adapted hmms for unusual event detection. IEEE Comput Soc Conf Comput Vis Pattern Recognit 2005, 1: 611-618.","journal-title":"IEEE Comput Soc Conf Comput Vis Pattern Recognit"},{"issue":"3","key":"87_CR43","doi-asserted-by":"publisher","first-page":"576","DOI":"10.1109\/TMM.2006.888013","volume":"9","author":"J Wang","year":"2007","unstructured":"Wang J, Chng E, Xu C, Lu H, Tian Q: Generation of personalized music sports video using multimodal cues. IEEE Trans Multimedia 2007,9(3):576-588.","journal-title":"IEEE Trans Multimedia"},{"key":"87_CR44","first-page":"4","volume-title":"IEEE International Conference on Multimedia and Expo","author":"M Xu","year":"2005","unstructured":"Xu M, Chia L, Jin J: Affective content analysis in comedy and horror videos by audio emotional event detection. IEEE International Conference on Multimedia and Expo 2005, 4."},{"key":"87_CR45","volume-title":"Pattern Recognition and Machine Learning","author":"C Bishop","year":"2006","unstructured":"Bishop C: Pattern Recognition and Machine Learning. Springer; 2006."},{"key":"87_CR46","volume-title":"IEEE International Conference on Multimedia and Expo (ICME)","author":"M Petkovic","year":"2002","unstructured":"Petkovic M, Mihajlovic V, Jonker W, Djordjevic-Kajan S: Multi-modal extraction of highlights from TV formula 1 programs. IEEE International Conference on Multimedia and Expo (ICME) 2002."},{"key":"87_CR47","first-page":"237","volume-title":"Video Semantic Content Analysis Framework Based on Ontology Combined MPEG-7, vol. 4918\/2008","author":"B Liang","year":"2008","unstructured":"Liang B, Lao S, Zhang W, Jones G, Smeaton AF: Video Semantic Content Analysis Framework Based on Ontology Combined MPEG-7, vol. 4918\/2008. Springer, Berlin\/Heidelberg; 2008:237-250."},{"key":"87_CR48","first-page":"1150","volume-title":"IEEE International Conference on Multimedia and Expo (ICME)","author":"M Barnard","year":"2005","unstructured":"Barnard M, Odobez J: Sports Event Recognition Using Layered HMMs. IEEE International Conference on Multimedia and Expo (ICME) 2005, 1150-1153."},{"key":"87_CR49","first-page":"21","volume-title":"Proceedings of the 26th annual conference on Computer graphics and interactive techniques","author":"M Brand","year":"1999","unstructured":"Brand M: Voice puppetry. In Proceedings of the 26th annual conference on Computer graphics and interactive techniques. ACM Press\/Addison-Wesley Publishing Co. New York, NY, USA; 1999:21-28."},{"issue":"1","key":"87_CR50","doi-asserted-by":"publisher","first-page":"41","DOI":"10.1023\/A:1007469218079","volume":"32","author":"S Fine","year":"1998","unstructured":"Fine S, Singer Y, Tishby N: The hierarchical hidden Markov model: analysis and applications. Mach Learn 1998,32(1):41-62. 10.1023\/A:1007469218079","journal-title":"Mach Learn"},{"key":"87_CR51","doi-asserted-by":"crossref","unstructured":"Oliver N, Horvitz E, Garg A: Layered representations for human activity recognition. Fourth IEEE International Conference on Multimodal Interfaces 2002.,3(8):","DOI":"10.1109\/ICMI.2002.1166960"},{"issue":"10","key":"87_CR52","doi-asserted-by":"publisher","first-page":"357","DOI":"10.1109\/TASSP.1980.1163420","volume":"28","author":"S Davis","year":"1980","unstructured":"Davis S, Mermelstein P: Comparison of parametric representations for monosylabic word recognition in continuously spoken sentences. IEEE Trans Acoust Speech Signal Process 1980,28(10):357-366.","journal-title":"IEEE Trans Acoust Speech Signal Process"},{"key":"87_CR53","unstructured":"Hidden Markov Model Toolkit, HTK. [ http:\/\/htk.eng.cam.ac.uk\/ ]"},{"key":"87_CR54","volume-title":"Proceedings of Conference on Uncertainty in Artificial Intelligence","author":"FV Jensen","year":"1994","unstructured":"Jensen FV, Jensen F: Optimal junction trees. Proceedings of Conference on Uncertainty in Artificial Intelligence 1994."},{"key":"87_CR55","first-page":"841","volume":"2","author":"A Ng","year":"2002","unstructured":"Ng A, Jordan M: On discriminative versus generative classifiers: a comparison of logistic regression and naive bayes. Adv Neural Inf Process Syst 2002, 2: 841-848.","journal-title":"Adv Neural Inf Process Syst"},{"key":"87_CR56","volume-title":"A guide to chi-squared testing","author":"P Greenwood","year":"1996","unstructured":"Greenwood P, Nikulin M: A guide to chi-squared testing. Wiley-Interscience; 1996."}],"container-title":["EURASIP Journal on Advances in Signal Processing"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/article\/10.1186\/1687-6180-2011-89\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1186\/1687-6180-2011-89.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1186\/1687-6180-2011-89.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2021,12,24]],"date-time":"2021-12-24T04:59:53Z","timestamp":1640321993000},"score":1,"resource":{"primary":{"URL":"https:\/\/asp-eurasipjournals.springeropen.com\/articles\/10.1186\/1687-6180-2011-89"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2011,10,13]]},"references-count":56,"journal-issue":{"issue":"1","published-print":{"date-parts":[[2011,12]]}},"alternative-id":["87"],"URL":"https:\/\/doi.org\/10.1186\/1687-6180-2011-89","relation":{},"ISSN":["1687-6180"],"issn-type":[{"value":"1687-6180","type":"electronic"}],"subject":[],"published":{"date-parts":[[2011,10,13]]},"article-number":"89"}}