{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,1,2]],"date-time":"2026-01-02T07:24:34Z","timestamp":1767338674162,"version":"3.40.3"},"publisher-location":"Cham","reference-count":35,"publisher":"Springer International Publishing","isbn-type":[{"type":"print","value":"9783030110116"},{"type":"electronic","value":"9783030110123"}],"license":[{"start":{"date-parts":[[2019,1,1]],"date-time":"2019-01-01T00:00:00Z","timestamp":1546300800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2019,1,1]],"date-time":"2019-01-01T00:00:00Z","timestamp":1546300800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2019]]},"DOI":"10.1007\/978-3-030-11012-3_27","type":"book-chapter","created":{"date-parts":[[2019,1,28]],"date-time":"2019-01-28T17:50:19Z","timestamp":1548697819000},"page":"331-345","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":9,"title":["Give Ear to My Face: Modelling Multimodal Attention to Social Interactions"],"prefix":"10.1007","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-5572-0924","authenticated-orcid":false,"given":"Giuseppe","family":"Boccignone","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-8479-9950","authenticated-orcid":false,"given":"Vittorio","family":"Cuculo","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-8210-4457","authenticated-orcid":false,"given":"Alessandro","family":"D\u2019Amelio","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-9274-4047","authenticated-orcid":false,"given":"Giuliano","family":"Grossi","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-8534-4413","authenticated-orcid":false,"given":"Raffaella","family":"Lanzarotti","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2019,1,29]]},"reference":[{"issue":"3","key":"27_CR1","doi-asserted-by":"publisher","first-page":"7","DOI":"10.1167\/13.3.7","volume":"13","author":"BA Anderson","year":"2013","unstructured":"Anderson, B.A.: A value-driven mechanism of attentional selection. J. Vis. 13(3), 7 (2013)","journal-title":"J. Vis."},{"issue":"8","key":"27_CR2","doi-asserted-by":"publisher","first-page":"437","DOI":"10.1016\/j.tics.2012.06.010","volume":"16","author":"E Awh","year":"2012","unstructured":"Awh, E., Belopolsky, A.V., Theeuwes, J.: Top-down versus bottom-up attentional control: a failed theoretical dichotomy. Trends Cogn. Sci. 16(8), 437\u2013443 (2012)","journal-title":"Trends Cogn. Sci."},{"issue":"9","key":"27_CR3","doi-asserted-by":"publisher","first-page":"507","DOI":"10.1016\/S0166-2236(03)00233-9","volume":"26","author":"KC Berridge","year":"2003","unstructured":"Berridge, K.C., Robinson, T.E.: Parsing reward. Trends Neurosci. 26(9), 507\u2013513 (2003)","journal-title":"Trends Neurosci."},{"issue":"2","key":"27_CR4","doi-asserted-by":"publisher","first-page":"266","DOI":"10.1109\/TCYB.2013.2253460","volume":"44","author":"G Boccignone","year":"2014","unstructured":"Boccignone, G., Ferraro, M.: Ecological sampling of gaze shifts. IEEE Trans. Cybern. 44(2), 266\u2013279 (2014)","journal-title":"IEEE Trans. Cybern."},{"issue":"1","key":"27_CR5","doi-asserted-by":"publisher","first-page":"185","DOI":"10.1109\/TPAMI.2012.89","volume":"35","author":"A Borji","year":"2013","unstructured":"Borji, A., Itti, L.: State-of-the-art in visual attention modeling. IEEE Trans. Pattern Anal. Mach. Intell. 35(1), 185\u2013207 (2013)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"27_CR6","doi-asserted-by":"publisher","first-page":"95","DOI":"10.1016\/j.visres.2015.01.010","volume":"116","author":"ND Bruce","year":"2015","unstructured":"Bruce, N.D., Wloka, C., Frosst, N., Rahman, S., Tsotsos, J.K.: On computational modeling of visual saliency: examining what\u2019s right, and what\u2019s left. Vis. Res. 116, 95\u2013112 (2015)","journal-title":"Vis. Res."},{"key":"27_CR7","doi-asserted-by":"publisher","unstructured":"Bylinskii, Z., Judd, T., Oliva, A., Torralba, A., Durand, F.: What do different evaluation metrics tell us about saliency models? IEEE Trans. Pattern Anal. Mach. Intell. 1 (2018). https:\/\/doi.org\/10.1109\/TPAMI.2018.2815601","DOI":"10.1109\/TPAMI.2018.2815601"},{"key":"27_CR8","unstructured":"Cerf, M., Harel, J., Einh\u00e4user, W., Koch, C.: Predicting human gaze using low-level saliency combined with face detection. In: Advances in Neural Information Processing Systems, vol. 20 (2008)"},{"issue":"22","key":"27_CR9","doi-asserted-by":"publisher","first-page":"2233","DOI":"10.1016\/j.visres.2010.05.013","volume":"50","author":"S Chikkerur","year":"2010","unstructured":"Chikkerur, S., Serre, T., Tan, C., Poggio, T.: What and where: a Bayesian inference theory of attention. Vis. Res. 50(22), 2233\u20132247 (2010)","journal-title":"Vis. Res."},{"key":"27_CR10","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"251","DOI":"10.1007\/978-3-319-54427-4_19","volume-title":"Computer Vision \u2013 ACCV 2016 Workshops","author":"JS Chung","year":"2017","unstructured":"Chung, J.S., Zisserman, A.: Out of time: automated lip sync in the wild. In: Chen, C.-S., Lu, J., Ma, K.-K. (eds.) ACCV 2016. LNCS, vol. 10117, pp. 251\u2013263. Springer, Cham (2017). https:\/\/doi.org\/10.1007\/978-3-319-54427-4_19"},{"key":"27_CR11","doi-asserted-by":"crossref","unstructured":"Chung, J.S., Zisserman, A.: Lip reading in profile. In: BMVC (2017)","DOI":"10.1007\/978-3-319-54184-6_6"},{"key":"27_CR12","doi-asserted-by":"crossref","unstructured":"Coutrot, A., Guyader, N.: An efficient audiovisual saliency model to predict eye positions when looking at conversations. In: 23rd European Signal Processing Conference, pp. 1531\u20131535, August 2015","DOI":"10.1109\/EUSIPCO.2015.7362640"},{"issue":"8","key":"27_CR13","doi-asserted-by":"publisher","first-page":"5","DOI":"10.1167\/14.8.5","volume":"14","author":"A Coutrot","year":"2014","unstructured":"Coutrot, A., Guyader, N.: How saliency, faces, and sound influence gaze in dynamic social scenes. J. Vis. 14(8), 5 (2014)","journal-title":"J. Vis."},{"issue":"14","key":"27_CR14","doi-asserted-by":"publisher","first-page":"18","DOI":"10.1167\/8.14.18","volume":"8","author":"W. Einhauser","year":"2008","unstructured":"Einh\u00e4user, W., Spain, M., Perona, P.: Objects predict fixations better than early saliency. J. Vis. 8(14) (2008). https:\/\/doi.org\/10.1167\/8.14.18, http:\/\/www.journalofvision.org\/content\/8\/14\/18.abstract","journal-title":"Journal of Vision"},{"key":"27_CR15","series-title":"Multimedia Systems and Applications","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1007\/978-0-387-76316-3_8","volume-title":"Multimodal Processing and Interaction","author":"G Evangelopoulos","year":"2008","unstructured":"Evangelopoulos, G., Rapantzikos, K., Maragos, P., Avrithis, Y., Potamianos, A.: Audiovisual attention modeling and salient event detection. In: Maragos, P., Potamianos, A., Gros, P. (eds.) Multimodal Processing and Interaction. MMSA, pp. 1\u201321. Springer, Boston (2008). https:\/\/doi.org\/10.1007\/978-0-387-76316-3_8"},{"issue":"3","key":"27_CR16","doi-asserted-by":"publisher","first-page":"319","DOI":"10.1016\/j.cognition.2010.09.003","volume":"117","author":"T Foulsham","year":"2010","unstructured":"Foulsham, T., Cheng, J.T., Tracy, J.L., Henrich, J., Kingstone, A.: Gaze allocation in a dynamic situation: effects of social status and speaking. Cognition 117(3), 319\u2013331 (2010)","journal-title":"Cognition"},{"key":"27_CR17","doi-asserted-by":"crossref","unstructured":"Hu, P., Ramanan, D.: Finding tiny faces. In: 2017 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), pp. 1522\u20131530. IEEE (2017)","DOI":"10.1109\/CVPR.2017.166"},{"issue":"1714","key":"27_CR18","doi-asserted-by":"publisher","first-page":"20160101","DOI":"10.1098\/rstb.2016.0101","volume":"372","author":"EM Kaya","year":"2017","unstructured":"Kaya, E.M., Elhilali, M.: Modelling auditory attention. Phil. Trans. R. Soc. B 372(1714), 20160101 (2017)","journal-title":"Phil. Trans. R. Soc. B"},{"issue":"21","key":"27_CR19","doi-asserted-by":"publisher","first-page":"1943","DOI":"10.1016\/j.cub.2005.09.040","volume":"15","author":"C Kayser","year":"2005","unstructured":"Kayser, C., Petkov, C.I., Lippert, M., Logothetis, N.K.: Mechanisms for allocating auditory attention: an auditory saliency map. Curr. Biol. 15(21), 1943\u20131947 (2005)","journal-title":"Curr. Biol."},{"key":"27_CR20","doi-asserted-by":"publisher","first-page":"72","DOI":"10.1016\/j.visres.2016.01.005","volume":"121","author":"O Le Meur","year":"2016","unstructured":"Le Meur, O., Coutrot, A.: Introducing context-dependent and spatially-variant viewing biases in saccadic models. Vis. Res. 121, 72\u201384 (2016)","journal-title":"Vis. Res."},{"key":"27_CR21","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"468","DOI":"10.1007\/978-3-642-53842-1_40","volume-title":"Image and Video Technology","author":"J Nakajima","year":"2014","unstructured":"Nakajima, J., Sugimoto, A., Kawamoto, K.: Incorporating audio signals into constructing a visual saliency map. In: Klette, R., Rivera, M., Satoh, S. (eds.) PSIVT 2013. LNCS, vol. 8333, pp. 468\u2013480. Springer, Heidelberg (2014). https:\/\/doi.org\/10.1007\/978-3-642-53842-1_40"},{"issue":"11","key":"27_CR22","doi-asserted-by":"publisher","first-page":"3266","DOI":"10.1109\/TIP.2015.2431438","volume":"24","author":"P Napoletano","year":"2015","unstructured":"Napoletano, P., Boccignone, G., Tisato, F.: Attentive monitoring of multiple video streams driven by a bayesian foraging strategy. IEEE Trans. Image Process. 24(11), 3266\u20133281 (2015)","journal-title":"IEEE Trans. Image Process."},{"issue":"10","key":"27_CR23","doi-asserted-by":"publisher","first-page":"11","DOI":"10.1167\/7.10.11","volume":"7","author":"S Onat","year":"2007","unstructured":"Onat, S., Libertus, K., K\u00f6nig, P.: Integrating audiovisual information for the control of overt attention. J. Vis. 7(10), 11 (2007)","journal-title":"J. Vis."},{"issue":"482","key":"27_CR24","doi-asserted-by":"publisher","first-page":"681","DOI":"10.1198\/016214508000000337","volume":"103","author":"T Park","year":"2008","unstructured":"Park, T., Casella, G.: The Bayesian lasso. J. Am. Stat. Assoc. 103(482), 681\u2013686 (2008)","journal-title":"J. Am. Stat. Assoc."},{"issue":"4","key":"27_CR25","doi-asserted-by":"publisher","first-page":"1793","DOI":"10.1109\/TIP.2017.2785623","volume":"27","author":"IM Rahman","year":"2018","unstructured":"Rahman, I.M., Hollitt, C., Zhang, M.: Feature map quality score estimation through regression. IEEE Trans. Image Process. 27(4), 1793\u20131808 (2018)","journal-title":"IEEE Trans. Image Process."},{"key":"27_CR26","doi-asserted-by":"crossref","unstructured":"Rodr\u00edguez-Hidalgo, A., Pel\u00e1ez-Moreno, C., Gallardo-Antol\u00edn, A.: Towards multimodal saliency detection: an enhancement of audio-visual correlation estimation. In: Proceedings of 16th International Conference on Cognitive Informatics and Cognitive Computing, pp. 438\u2013443. IEEE (2017)","DOI":"10.1109\/ICCI-CC.2017.8109785"},{"issue":"5","key":"27_CR27","doi-asserted-by":"publisher","first-page":"9","DOI":"10.1167\/11.5.9","volume":"11","author":"A Sch\u00fctz","year":"2011","unstructured":"Sch\u00fctz, A., Braun, D., Gegenfurtner, K.: Eye movements and perception: a selective review. J. Vis. 11(5), 9 (2011)","journal-title":"J. Vis."},{"issue":"12","key":"27_CR28","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1167\/9.12.15","volume":"9","author":"H Seo","year":"2009","unstructured":"Seo, H., Milanfar, P.: Static and space-time visual saliency detection by self-resemblance. J. Vis. 9(12), 1\u201327 (2009)","journal-title":"J. Vis."},{"issue":"5","key":"27_CR29","doi-asserted-by":"publisher","first-page":"182","DOI":"10.1016\/j.tics.2008.02.003","volume":"12","author":"BG Shinn-Cunningham","year":"2008","unstructured":"Shinn-Cunningham, B.G.: Object-based auditory and visual attention. Trends Cogn. Sci. 12(5), 182\u2013186 (2008)","journal-title":"Trends Cogn. Sci."},{"key":"27_CR30","doi-asserted-by":"publisher","first-page":"7666","DOI":"10.1038\/srep07666","volume":"5","author":"Y Suda","year":"2015","unstructured":"Suda, Y., Kitazawa, S.: A model of face selection in viewing video stories. Sci. Rep. 5, 7666 (2015)","journal-title":"Sci. Rep."},{"issue":"5","key":"27_CR31","doi-asserted-by":"publisher","first-page":"5","DOI":"10.1167\/11.5.5","volume":"11","author":"B Tatler","year":"2011","unstructured":"Tatler, B., Hayhoe, M., Land, M., Ballard, D.: Eye guidance in natural vision: Reinterpreting salience. J. Vis. 11(5), 5 (2011)","journal-title":"J. Vis."},{"issue":"6\u20137","key":"27_CR32","doi-asserted-by":"publisher","first-page":"1029","DOI":"10.1080\/13506280902764539","volume":"17","author":"B Tatler","year":"2009","unstructured":"Tatler, B., Vincent, B.: The prominence of behavioural biases in eye guidance. Vis. Cogn. 17(6\u20137), 1029\u20131054 (2009)","journal-title":"Vis. Cogn."},{"key":"27_CR33","doi-asserted-by":"publisher","first-page":"153","DOI":"10.1023\/A:1023052124951","volume":"53","author":"A Torralba","year":"2003","unstructured":"Torralba, A.: Contextual priming for object detection. Int. J. Comput. Vis. 53, 153\u2013167 (2003)","journal-title":"Int. J. Comput. Vis."},{"issue":"3","key":"27_CR34","doi-asserted-by":"publisher","first-page":"10","DOI":"10.1167\/13.3.10","volume":"13","author":"JM Wolfe","year":"2013","unstructured":"Wolfe, J.M.: When is it time to move to the next raspberry bush? Foraging rules in human visual search. J. Vis. 13(3), 10 (2013)","journal-title":"J. Vis."},{"key":"27_CR35","doi-asserted-by":"publisher","first-page":"100","DOI":"10.1016\/j.cobeha.2016.06.009","volume":"11","author":"SCH Yang","year":"2016","unstructured":"Yang, S.C.H., Wolpert, D.M., Lengyel, M.: Theoretical perspectives on active sensing. Curr. Opin. Behav. Sci. 11, 100\u2013108 (2016)","journal-title":"Curr. Opin. Behav. Sci."}],"container-title":["Lecture Notes in Computer Science","Computer Vision \u2013 ECCV 2018 Workshops"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-030-11012-3_27","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2023,1,28]],"date-time":"2023-01-28T03:13:19Z","timestamp":1674875599000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-3-030-11012-3_27"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2019]]},"ISBN":["9783030110116","9783030110123"],"references-count":35,"URL":"https:\/\/doi.org\/10.1007\/978-3-030-11012-3_27","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"type":"print","value":"0302-9743"},{"type":"electronic","value":"1611-3349"}],"subject":[],"published":{"date-parts":[[2019]]},"assertion":[{"value":"29 January 2019","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ECCV","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"European Conference on Computer Vision","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Munich","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Germany","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2018","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"8 September 2018","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"14 September 2018","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"15","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"eccv2018","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"https:\/\/eccv2018.org\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"This content has been made available to all.","name":"free","label":"Free to read"}]}}