{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,15]],"date-time":"2026-05-15T10:25:21Z","timestamp":1778840721551,"version":"3.51.4"},"reference-count":30,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2018,10]]},"DOI":"10.1109\/icip.2018.8451158","type":"proceedings-article","created":{"date-parts":[[2018,9,7]],"date-time":"2018-09-07T13:59:22Z","timestamp":1536328762000},"page":"336-340","source":"Crossref","is-referenced-by-count":1,"title":["Attention-Enhanced Sensorimotor Object Recognition"],"prefix":"10.1109","author":[{"given":"Spyridon","family":"Thermos","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Georgios Th.","family":"Papadopulos","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Petros","family":"Daras","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Gerasimos","family":"Potamianos","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2009.5206848"},{"key":"ref10","first-page":"408","article-title":"Reasoning about object affordances in a knowledge base representation","author":"zhu","year":"2014","journal-title":"Proc European Conference on Computer Vision (ECCV)"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1523\/JNEUROSCI.0597-14.2014"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1038\/nn.4244"},{"key":"ref13","first-page":"1097","article-title":"ImageNet classification with deep convolutional neural networks","author":"krizhevsky","year":"2012","journal-title":"Proc Neural Information Processing Systems (NIPS)"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2016.90"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1016\/j.neuropsychologia.2015.07.010"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1016\/j.bandl.2012.08.003"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2016.213"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1109\/TCSVT.2016.2643161"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/JPROC.2003.817150"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2015.7353446"},{"key":"ref4","first-page":"406","article-title":"Affordance-based object recognition using interactions obtained from a utility maximization principle","author":"kluth","year":"2014","journal-title":"Proc European Conference on Computer Vision Workshops (ECCVW)"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2015.7138986"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2016.609"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2017.13"},{"key":"ref29","article-title":"Very deep convolutional networks for large-scale image recognition","author":"simonyan","year":"2015","journal-title":"Proc of the Int Conf on Learning Representations (ICLR)"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/TAMD.2015.2463728"},{"key":"ref8","first-page":"67","article-title":"The theory of affordances","author":"gibson","year":"1977","journal-title":"Perceiving Acting and Knowing Toward an Ecological Psychology"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2017.234"},{"key":"ref2","first-page":"647","article-title":"DeCAF: A deep convolutional activation feature for generic visual recognition","author":"donahue","year":"2014","journal-title":"Proc Int Conf on Machine Learning (ICML)"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2015.7298958"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1006\/cviu.1995.1048"},{"key":"ref20","doi-asserted-by":"crossref","first-page":"24","DOI":"10.1109\/ICASSP.2003.1198707","article-title":"Frame-dependent multi-stream reliability indicators for audio-visual speech recognition","volume":"i","author":"garg","year":"2003","journal-title":"Proc IEEE Int Conf Acoust Speech Signal Process (ICASSP)"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2017.450"},{"key":"ref21","first-page":"579","article-title":"Audio-visual speech activity detection in a two-speaker scenario incorporating depth information from a profile or frontal view","author":"thermos","year":"2016","journal-title":"Proc IEEE Spoken Language Technology Workshop (SLT)"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1162\/neco.2007.19.3.757"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1109\/ICCVW.2017.368"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-662-13015-5_35"},{"key":"ref25","first-page":"746","article-title":"Stream confidence estimation for audio-visual speech recognition","volume":"3","author":"potamianos","year":"2000","journal-title":"Proc Int Conf Spoken Language Processing (ICSLP)"}],"event":{"name":"2018 25th IEEE International Conference on Image Processing (ICIP)","location":"Athens","start":{"date-parts":[[2018,10,7]]},"end":{"date-parts":[[2018,10,10]]}},"container-title":["2018 25th IEEE International Conference on Image Processing (ICIP)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/8436606\/8451009\/08451158.pdf?arnumber=8451158","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,1,26]],"date-time":"2022-01-26T05:13:51Z","timestamp":1643174031000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/8451158\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2018,10]]},"references-count":30,"URL":"https:\/\/doi.org\/10.1109\/icip.2018.8451158","relation":{},"subject":[],"published":{"date-parts":[[2018,10]]}}}