{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,5,3]],"date-time":"2025-05-03T04:28:51Z","timestamp":1746246531379,"version":"3.40.4"},"reference-count":43,"publisher":"Springer Science and Business Media LLC","issue":"4","license":[{"start":{"date-parts":[[2013,12,13]],"date-time":"2013-12-13T00:00:00Z","timestamp":1386892800000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["Multimedia Systems"],"published-print":{"date-parts":[[2014,7]]},"DOI":"10.1007\/s00530-013-0350-0","type":"journal-article","created":{"date-parts":[[2013,12,12]],"date-time":"2013-12-12T04:53:29Z","timestamp":1386824009000},"page":"347-361","source":"Crossref","is-referenced-by-count":9,"title":["Multiple style exploration for story unit segmentation of broadcast news video"],"prefix":"10.1007","volume":"20","author":[{"given":"Bailan","family":"Feng","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Zhineng","family":"Chen","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Rong","family":"Zheng","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Bo","family":"Xu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2013,12,13]]},"reference":[{"key":"350_CR1","unstructured":"Ardissono, L., Kobsa, A., Maybury, M. (eds.): Personalized digital television. Kluwer, Norwell (2004)"},{"issue":"1","key":"350_CR2","doi-asserted-by":"crossref","first-page":"276","DOI":"10.1109\/TASL.2011.2160853","volume":"20","author":"L Xie","year":"2012","unstructured":"Xie, L., Zheng, L.L., Liu, Z.H., Zhang, Y.N.: Laplacian eigenmaps for automatic story segmentation of broadcast news. IEEE Trans. Audio Speech Language Process. 20(1), 276\u2013289 (2012)","journal-title":"IEEE Trans. Audio Speech Language Process."},{"key":"350_CR3","unstructured":"Zhai, Y., Rasheed, Z., Shah, M.: University of Central Florida at TRECVID 2003. In: Proc. TRECVID Workshop (2003)"},{"issue":"3","key":"350_CR4","doi-asserted-by":"crossref","first-page":"393","DOI":"10.1109\/TMM.2008.917362","volume":"10","author":"JQ Wang","year":"2008","unstructured":"Wang, J.Q., Duan, L.Y., Liu, Q.S., Lu, H.Q., Jin, J.S.: A multimodal scheme for program segmentation and representation in broadcast video streams. IEEE Trans. Multimedia 10(3), 393\u2013408 (2008)","journal-title":"IEEE Trans. Multimedia"},{"key":"350_CR5","doi-asserted-by":"crossref","unstructured":"Santo, M.D., Foggia, P., Percannella, G., Sansone, C., Vento, M.: An unsupervised algorithm for anchor shot detection. In: Proc. IEEE ICPR, pp. 1238\u20131241 (2006)","DOI":"10.1109\/ICPR.2006.266"},{"key":"350_CR6","unstructured":"Hsu, W.H., Kenney, L.S., Chang, S.F., Franz, M., Smith, J.: Columbia-IBM news video story segmentation in TRECVID 2004. In: Proc. ACM CIVR, pp. 1\u201311 (2005)"},{"issue":"9","key":"350_CR7","doi-asserted-by":"crossref","first-page":"765","DOI":"10.1109\/TCSVT.2002.800510","volume":"12","author":"X Gao","year":"2002","unstructured":"Gao, X., Tang, X.: Unsupervised video-shot segmentation and model-free anchorperson detection for news video story parsing. IEEE Trans. Circuits System Video Technol. 12(9), 765\u2013776 (2002)","journal-title":"IEEE Trans. Circuits System Video Technol."},{"key":"350_CR8","doi-asserted-by":"crossref","first-page":"503","DOI":"10.1016\/S0167-8655(00)00113-6","volume":"22","author":"M Bertini","year":"2001","unstructured":"Bertini, M., Bimbo, A.D., Pala, P.: Content-based indexing and retrieval of TV news. Pattern Recogn. Lett. 22, 503\u2013516 (2001)","journal-title":"Pattern Recogn. Lett."},{"issue":"1\u20132","key":"350_CR9","doi-asserted-by":"crossref","first-page":"127","DOI":"10.1016\/S0167-6393(00)00028-5","volume":"32","author":"E Shriberg","year":"2000","unstructured":"Shriberg, E., Stolcke, A., Hakkani-T\u00fcr, D., T\u00fcr, G.: Prosody-based automatic segmentation of speech into sentences and topics. Speech Commun. 32(1\u20132), 127\u2013154 (2000)","journal-title":"Speech Commun."},{"issue":"1","key":"350_CR10","doi-asserted-by":"crossref","first-page":"31","DOI":"10.1162\/089120101300346796","volume":"27","author":"G T\u00fcr","year":"2001","unstructured":"T\u00fcr, G., Hakkani-T\u00fcr, D.: Integrating prosodic and lexical cues for automatic topic segmentation. Comput. Linguist. 27(1), 31\u201357 (2001)","journal-title":"Comput. Linguist."},{"issue":"3\u20134","key":"350_CR11","doi-asserted-by":"crossref","first-page":"284","DOI":"10.1016\/j.specom.2005.03.015","volume":"46","author":"CY Tseng","year":"2005","unstructured":"Tseng, C.Y., Pin, S.H., Lee, Y., Wang, H.M., Chen, Y.C.: Fluent speech prosody: framework and modeling. Speech Commun. 46(3\u20134), 284\u2013309 (2005)","journal-title":"Speech Commun."},{"key":"350_CR12","doi-asserted-by":"crossref","unstructured":"Xie, L., Liu, C., Meng, H.: Combined use of speaker and tone-normalized pitch reset with pause duration for automatic story segmentation in mandarin broadcast news. In: Proc. HLT-NAACL, pp. 193\u2013199 (2007)","DOI":"10.3115\/1614108.1614157"},{"issue":"4","key":"350_CR13","doi-asserted-by":"crossref","first-page":"237","DOI":"10.1007\/s00530-008-0141-1","volume":"14","author":"L Xie","year":"2008","unstructured":"Xie, L.: Discovering salient prosodic cues and their interactions for automatic story segmentation in mandarin broadcast news. Multimedia Syst. 14(4), 237\u2013253 (2008)","journal-title":"Multimedia Syst."},{"issue":"1","key":"350_CR14","first-page":"33","volume":"23","author":"MA Hearst","year":"1997","unstructured":"Hearst, M.A.: TextTiling: segmenting text into multi-paragraph subtopic passages. Comput. Liguist. 23(1), 33\u201364 (1997)","journal-title":"Comput. Liguist."},{"issue":"1","key":"350_CR15","first-page":"3","volume":"17","author":"N Stokes","year":"2004","unstructured":"Stokes, N., Carthy, J., Smeaton, A.: SeLeCT: a lexical cohesion based news story segmentation system. J. AI Commun. 17(1), 3\u201312 (2004)","journal-title":"J. AI Commun."},{"key":"350_CR16","doi-asserted-by":"crossref","unstructured":"Chan, S.K., Xie, L., Meng, H.M.L.: Modeling the statistical behavior of lexical chains to capture word cohesiveness for automatic story segmentation. In: Proc. Interspeech, pp. 2408\u20132411 (2007)","DOI":"10.21437\/Interspeech.2007-685"},{"key":"350_CR17","doi-asserted-by":"crossref","unstructured":"Poulisse, G.J., Moens, M.F.: Multimodal news story segmentation. In: Proc. Int. Conf. on intelligent human computer interaction, pp. 95\u2013101 (2009)","DOI":"10.1007\/978-81-8489-203-1_7"},{"issue":"2","key":"350_CR18","doi-asserted-by":"crossref","first-page":"187","DOI":"10.1023\/A:1023622605600","volume":"6","author":"L Chaisorn","year":"2003","unstructured":"Chaisorn, L., Chua, T.S., Lee, C.H.: A multi-modal approach to story segmentation for news video. World Wide Web Internet Web Inf. Systems 6(2), 187\u2013208 (2003)","journal-title":"World Wide Web Internet Web Inf. Systems"},{"key":"350_CR19","unstructured":"Liu, M.M., Zheng, L.L., Leung, C.C., Xie, L., Ma, B., Li, H.Z.: Broadcast news story segmentation using probabilistic latent semantic analysis and laplacian eigenmaps. In: Pro. APSIPA-ASC, pp. 356\u2013360 (2011)"},{"key":"350_CR20","doi-asserted-by":"crossref","unstructured":"Xu, S., Feng, B.L., Chen, Z.N., Xu, B.: A general framework of video segmentation to logical unit based on conditional random fields. In: Proc. ACM ICMR (2013)","DOI":"10.1145\/2461466.2461506"},{"key":"350_CR21","unstructured":"Wang, X., Xie, L., Ma, B., Chng, E.S., Li, H.: Modeling broadcast news prosody using conditional random fields for story segmenation. In: Proc. APSIPA ASC (2010)"},{"issue":"7","key":"350_CR22","doi-asserted-by":"crossref","first-page":"971","DOI":"10.1109\/TPAMI.2002.1017623","volume":"24","author":"T Ojala","year":"2002","unstructured":"Ojala, T., Pietikainen, M., Maenpaa, T.: Multiresolution gray-scale and rotation invariant texture classification with local binary patterns. IEEE Trans. Pattern Analysis Mach. Intell. 24(7), 971\u2013987 (2002)","journal-title":"IEEE Trans. Pattern Analysis Mach. Intell."},{"key":"350_CR23","unstructured":"Maitra, R., Peterson, A.D., Ghosh, A.P.: A systematic evaluation of different methods for initializing the K-means clustering algorithm. IEEE Trans. Knowledge Data Eng, 1\u201311 (2010)"},{"issue":"1","key":"350_CR24","doi-asserted-by":"crossref","first-page":"34","DOI":"10.1109\/34.982883","volume":"24","author":"MH Yang","year":"2002","unstructured":"Yang, M.H., Kriegman, D., Ahuja, N.: Detecting faces in images: a survey. IEEE Trans. Pattern Analysis Mach. Intell. 24(1), 34\u201358 (2002)","journal-title":"IEEE Trans. Pattern Analysis Mach. Intell."},{"issue":"9","key":"350_CR25","doi-asserted-by":"crossref","first-page":"765","DOI":"10.1109\/TCSVT.2002.800510","volume":"12","author":"X Gao","year":"2002","unstructured":"Gao, X., Tang, X.: Unsupervised video-shot segmentation and model-free anchorperson detection for news video story parsing. IEEE Trans. Circuits System Video Technol. 12(9), 765\u2013776 (2002)","journal-title":"IEEE Trans. Circuits System Video Technol."},{"key":"350_CR26","unstructured":"He, S.N., Yu, J.B.: A novel chinese continuous speech endpoint detection method based on time domain features of the word structure. In: Proc. IEEE ICCCAS, pp. 992\u2013996 (2002)"},{"issue":"7","key":"350_CR27","first-page":"5","volume":"29","author":"SY Yang","year":"2005","unstructured":"Yang, S.Y., Zhou, Y.Y., Huang, S.X.: A survey of endpoint detection methods for speech signal. Inf. Technol. 29(7), 5\u20138 (2005)","journal-title":"Inf. Technol."},{"issue":"3","key":"350_CR28","first-page":"214","volume":"22","author":"SQ Zhu","year":"2005","unstructured":"Zhu, S.Q., Qiu, X.H.: Research on endpoint detection of speech signals. Comput. Simul. 22(3), 214\u2013216 (2005)","journal-title":"Comput. Simul."},{"key":"350_CR29","doi-asserted-by":"crossref","unstructured":"Zhang, S.L., Zhang, S.W., Xu, B.: A two-level method for unsupervised speaker-based audio segmentation. In: Proc. IEEE ICPR, pp. 298\u2013301 (2006)","DOI":"10.1109\/ICPR.2006.189"},{"key":"350_CR30","unstructured":"Liang, J.E., Meng, M., Wang, X.R., Ding, P., Xu, B.: An improved mandarin keyword spotting system using mce training and context-enhanced verfication. In: Proc. IEEE ICASSP, pp. 1145\u20131148 (2006)"},{"key":"350_CR31","doi-asserted-by":"crossref","unstructured":"Feng, B.L., Ding, P., Chen, J.S., Bai, J.F., Xu, S., Xu, B.: Multi-modal information fusion for news story segmentation in broadcast video. In: Proc. IEEE ICASSP, pp. 1417\u20131420 (2012)","DOI":"10.1109\/ICASSP.2012.6288156"},{"key":"350_CR32","doi-asserted-by":"crossref","unstructured":"Chua, T.S., Chang, S.F., Chaisorn, L., Hsu, W.: Story boundary detection in large broadcast news video archives\u2014techniques, experience and trends. In: Proc. ACM MM, pp. 656\u2013659 (2004)","DOI":"10.1145\/1027527.1027679"},{"issue":"12","key":"350_CR33","doi-asserted-by":"crossref","first-page":"1835","DOI":"10.1109\/TCSVT.2011.2148470","volume":"21","author":"J Cao","year":"2011","unstructured":"Cao, J., Ngo, C.W., Zhang, Y.D., Li, J.T.: Tracking web video topics: discovery, visualization and monitoring. IEEE Trans. Circuits Systems Video Technol 21(12), 1835\u20131846 (2011)","journal-title":"IEEE Trans. Circuits Systems Video Technol"},{"issue":"1","key":"350_CR34","doi-asserted-by":"crossref","first-page":"53","DOI":"10.1007\/s11042-010-0604-1","volume":"55","author":"ZN Chen","year":"2011","unstructured":"Chen, Z.N., Cao, J., Xia, T., Song, Y.C., Zhang, Y.D., Li, J.T.: Web video retagging. Multimedia Tools Appl. 55(1), 53\u201382 (2011)","journal-title":"Multimedia Tools Appl."},{"key":"350_CR35","doi-asserted-by":"crossref","unstructured":"Chen, Z.N., Cao, J., Song, Y.C., Guo, J.B, Zhang, Y.D., Li, J.T.: Context-oriented web video tag recommendation. In: Proc. WWW, pp. 1079\u20131080 (2010)","DOI":"10.1145\/1772690.1772813"},{"issue":"1","key":"350_CR36","first-page":"21","volume":"27","author":"BL Feng","year":"2011","unstructured":"Feng, B.L., Cao, J., Bao, L., Zhang, Y.D., Lin, S.X., Bao, X.G., Yun, X.C.: Graph-based multi-space semantic correlation diffusion for video retrieval. Visual Comput. Int. J. Comput. Graphics 27(1), 21\u201334 (2011)","journal-title":"Visual Comput. Int. J. Comput. Graphics"},{"issue":"4","key":"350_CR37","doi-asserted-by":"crossref","first-page":"1644","DOI":"10.1109\/TIP.2012.2236341","volume":"22","author":"T Yao","year":"2013","unstructured":"Yao, T., Ngo, C.W., Mei, T.: Circular reranking for visual search. IEEE Trans. Image Process. 22(4), 1644\u20131655 (2013)","journal-title":"IEEE Trans. Image Process."},{"key":"350_CR38","doi-asserted-by":"crossref","unstructured":"Hsu, W., Kennedy, L., Huang, C.W., Chang, S.F., Lin, C.Y., Iyengar, G.: News video story segmentation using fusion of multi-level multi-modal features in TRECVID 2003. In: Proc. IEEE ICASSP, pp. 645\u2013648 (2004)","DOI":"10.1109\/ICASSP.2004.1326627"},{"key":"350_CR39","unstructured":"Hsu, W, Chang, S.F., Huang, C.W., Kennedy, L., Lin, C.Y., Iyengar, G.: Discovery and fusion of salient multi-modal features towards news story segmentation. IS&T\/SPIE Electronic Imaging. (2004)"},{"key":"350_CR40","doi-asserted-by":"crossref","unstructured":"Wang, X.X., Xie, L., Lu, M.M., Ma, B., Chng, E.S., Li, H.Z.: Broadcast news story segmentation using conditional random fields and multimodal features. IEICE Trans. Inf. Systems, 95-D(5), 1206\u20131215 (2012)","DOI":"10.1587\/transinf.E95.D.1206"},{"key":"350_CR41","doi-asserted-by":"crossref","unstructured":"Lu, M.M., Xie, L., Fu, Z.H., Jiang, D.M., Zhang, Y.N.: Multi-modal feature integration for story boundary detection in broadcast news. International Symposium on Chinese Spoken Language Processing, pp. 420\u2013425 (2010)","DOI":"10.1109\/ISCSLP.2010.5684854"},{"key":"350_CR42","unstructured":"Noreau, N.: HTK(v.3.1): basic tutorial. Technical Report (2002)"},{"key":"350_CR43","unstructured":"Kudo, T.: CRF++: yet another CRF toolkit. Technical Report (2005)"}],"container-title":["Multimedia Systems"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s00530-013-0350-0.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s00530-013-0350-0\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s00530-013-0350-0","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,5,1]],"date-time":"2025-05-01T04:27:14Z","timestamp":1746073634000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s00530-013-0350-0"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2013,12,13]]},"references-count":43,"journal-issue":{"issue":"4","published-print":{"date-parts":[[2014,7]]}},"alternative-id":["350"],"URL":"https:\/\/doi.org\/10.1007\/s00530-013-0350-0","relation":{},"ISSN":["0942-4962","1432-1882"],"issn-type":[{"type":"print","value":"0942-4962"},{"type":"electronic","value":"1432-1882"}],"subject":[],"published":{"date-parts":[[2013,12,13]]}}}