{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,6,18]],"date-time":"2025-06-18T04:12:19Z","timestamp":1750219939345,"version":"3.41.0"},"publisher-location":"New York, NY, USA","reference-count":27,"publisher":"ACM","license":[{"start":{"date-parts":[[2022,11,7]],"date-time":"2022-11-07T00:00:00Z","timestamp":1667779200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.acm.org\/publications\/policies\/copyright_policy#Background"}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2022,11,7]]},"DOI":"10.1145\/3536221.3556567","type":"proceedings-article","created":{"date-parts":[[2022,11,4]],"date-time":"2022-11-04T15:54:14Z","timestamp":1667577254000},"page":"476-486","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":4,"title":["Continual Learning about Objects in the Wild: An Interactive Approach"],"prefix":"10.1145","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-6283-0590","authenticated-orcid":false,"given":"Dan","family":"Bohus","sequence":"first","affiliation":[{"name":"Microsoft Research, United States"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-4972-7027","authenticated-orcid":false,"given":"Sean","family":"Andrist","sequence":"additional","affiliation":[{"name":"Microsoft Research, United States"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-4975-0462","authenticated-orcid":false,"given":"Ashley","family":"Feniello","sequence":"additional","affiliation":[{"name":"Microsoft Research, United States"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-1481-0501","authenticated-orcid":false,"given":"Nick","family":"Saw","sequence":"additional","affiliation":[{"name":"Microsoft Research, United States"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-8823-0614","authenticated-orcid":false,"given":"Eric","family":"Horvitz","sequence":"additional","affiliation":[{"name":"Microsoft, United States"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"320","published-online":{"date-parts":[[2022,11,7]]},"reference":[{"key":"e_1_3_2_1_1_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW56347.2022.00413"},{"key":"e_1_3_2_1_2_1","volume-title":"Developing Mixed Reality Applications with Platform for Situated Intelligence. In IEEE Conference on Virtual Reality and 3D User Interfaces \u2013 Abstracts and Workshops (VRW). IEEE, 48\u201350","author":"Andrist Sean","year":"2022","unstructured":"Sean Andrist , Dan Bohus , Ashley Feniello , and Nick Saw . 2022 . Developing Mixed Reality Applications with Platform for Situated Intelligence. In IEEE Conference on Virtual Reality and 3D User Interfaces \u2013 Abstracts and Workshops (VRW). IEEE, 48\u201350 . Sean Andrist, Dan Bohus, Ashley Feniello, and Nick Saw. 2022. Developing Mixed Reality Applications with Platform for Situated Intelligence. In IEEE Conference on Virtual Reality and 3D User Interfaces \u2013 Abstracts and Workshops (VRW). IEEE, 48\u201350."},{"key":"e_1_3_2_1_3_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW50498.2020.00119"},{"key":"e_1_3_2_1_4_1","unstructured":"Dan Bohus Sean Andrist Ashley Feniello Nick Saw Mihai Jalobeanu Patrick Sweeney Anne\u00a0Loomis Thompson and Eric Horvitz. 2021. Platform for Situated Intelligence. arxiv:2103.15975\u00a0[cs.AI]  Dan Bohus Sean Andrist Ashley Feniello Nick Saw Mihai Jalobeanu Patrick Sweeney Anne\u00a0Loomis Thompson and Eric Horvitz. 2021. Platform for Situated Intelligence. arxiv:2103.15975\u00a0[cs.AI]"},{"key":"e_1_3_2_1_5_1","first-page":"1970","article-title":"Se (3)-transformers: 3d roto-translation equivariant attention networks","volume":"33","author":"Fuchs Fabian","year":"2020","unstructured":"Fabian Fuchs , Daniel Worrall , Volker Fischer , and Max Welling . 2020 . Se (3)-transformers: 3d roto-translation equivariant attention networks . Advances in Neural Information Processing Systems 33 (2020), 1970 \u2013 1981 . Fabian Fuchs, Daniel Worrall, Volker Fischer, and Max Welling. 2020. Se (3)-transformers: 3d roto-translation equivariant attention networks. Advances in Neural Information Processing Systems 33 (2020), 1970\u20131981.","journal-title":"Advances in Neural Information Processing Systems"},{"key":"e_1_3_2_1_6_1","doi-asserted-by":"crossref","unstructured":"Kristen Grauman Andrew Westbury Eugene Byrne Zachary Chavis Antonino Furnari Rohit Girdhar Jackson Hamburger Hao Jiang Miao Liu Xingyu Liu Miguel Martin Tushar Nagarajan Ilija Radosavovic Santhosh\u00a0Kumar Ramakrishnan Fiona Ryan Jayant Sharma Michael Wray Mengmeng Xu Eric\u00a0Zhongcong Xu Chen Zhao Siddhant Bansal Dhruv Batra Vincent Cartillier Sean Crane Tien Do Morrie Doulaty Akshay Erapalli Christoph Feichtenhofer Adriano Fragomeni Qichen Fu Christian Fuegen Abrham Gebreselasie Cristina Gonzalez James Hillis Xuhua Huang Yifei Huang Wenqi Jia Weslie Khoo Jachym Kolar Satwik Kottur Anurag Kumar Federico Landini Chao Li Yanghao Li Zhenqiang Li Karttikeya Mangalam Raghava Modhugu Jonathan Munro Tullie Murrell Takumi Nishiyasu Will Price Paola\u00a0Ruiz Puentes Merey Ramazanova Leda Sari Kiran Somasundaram Audrey Southerland Yusuke Sugano Ruijie Tao Minh Vo Yuchen Wang Xindi Wu Takuma Yagi Yunyi Zhu Pablo Arbelaez David Crandall Dima Damen Giovanni\u00a0Maria Farinella Bernard Ghanem Vamsi\u00a0Krishna Ithapu C.\u00a0V. Jawahar Hanbyul Joo Kris Kitani Haizhou Li Richard Newcombe Aude Oliva Hyun\u00a0Soo Park James\u00a0M. Rehg Yoichi Sato Jianbo Shi Mike\u00a0Zheng Shou Antonio Torralba Lorenzo Torresani Mingfei Yan and Jitendra Malik. 2021. Ego4D: Around the World in 3 000 Hours of Egocentric Video. arXiv preprint arXiv:2110.07058(2021).  Kristen Grauman Andrew Westbury Eugene Byrne Zachary Chavis Antonino Furnari Rohit Girdhar Jackson Hamburger Hao Jiang Miao Liu Xingyu Liu Miguel Martin Tushar Nagarajan Ilija Radosavovic Santhosh\u00a0Kumar Ramakrishnan Fiona Ryan Jayant Sharma Michael Wray Mengmeng Xu Eric\u00a0Zhongcong Xu Chen Zhao Siddhant Bansal Dhruv Batra Vincent Cartillier Sean Crane Tien Do Morrie Doulaty Akshay Erapalli Christoph Feichtenhofer Adriano Fragomeni Qichen Fu Christian Fuegen Abrham Gebreselasie Cristina Gonzalez James Hillis Xuhua Huang Yifei Huang Wenqi Jia Weslie Khoo Jachym Kolar Satwik Kottur Anurag Kumar Federico Landini Chao Li Yanghao Li Zhenqiang Li Karttikeya Mangalam Raghava Modhugu Jonathan Munro Tullie Murrell Takumi Nishiyasu Will Price Paola\u00a0Ruiz Puentes Merey Ramazanova Leda Sari Kiran Somasundaram Audrey Southerland Yusuke Sugano Ruijie Tao Minh Vo Yuchen Wang Xindi Wu Takuma Yagi Yunyi Zhu Pablo Arbelaez David Crandall Dima Damen Giovanni\u00a0Maria Farinella Bernard Ghanem Vamsi\u00a0Krishna Ithapu C.\u00a0V. Jawahar Hanbyul Joo Kris Kitani Haizhou Li Richard Newcombe Aude Oliva Hyun\u00a0Soo Park James\u00a0M. Rehg Yoichi Sato Jianbo Shi Mike\u00a0Zheng Shou Antonio Torralba Lorenzo Torresani Mingfei Yan and Jitendra Malik. 2021. Ego4D: Around the World in 3 000 Hours of Egocentric Video. arXiv preprint arXiv:2110.07058(2021).","DOI":"10.1109\/CVPR52688.2022.01842"},{"key":"e_1_3_2_1_7_1","volume-title":"Teachable machines for accessibility. ACM SIGACCESS Accessibility and Computing119","author":"Kacorri Hernisa","year":"2017","unstructured":"Hernisa Kacorri . 2017. Teachable machines for accessibility. ACM SIGACCESS Accessibility and Computing119 ( 2017 ), 10\u201318. Hernisa Kacorri. 2017. Teachable machines for accessibility. ACM SIGACCESS Accessibility and Computing119 (2017), 10\u201318."},{"key":"e_1_3_2_1_8_1","doi-asserted-by":"publisher","DOI":"10.1145\/3332165.3347927"},{"key":"e_1_3_2_1_9_1","doi-asserted-by":"publisher","DOI":"10.1145\/3290605.3300566"},{"key":"#cr-split#-e_1_3_2_1_10_1.1","unstructured":"Liunian\u00a0Harold Li Pengchuan Zhang Haotian Zhang Jianwei Yang Chunyuan Li Yiwu Zhong Lijuan Wang Lu Yuan Lei Zhang Jenq-Neng Hwang Kai-Wei Chang and Jianfeng Gao. 2021. Grounded Language-Image Pre-training. https:\/\/doi.org\/10.48550\/ARXIV.2112.03857 10.48550\/ARXIV.2112.03857"},{"key":"#cr-split#-e_1_3_2_1_10_1.2","doi-asserted-by":"crossref","unstructured":"Liunian\u00a0Harold Li Pengchuan Zhang Haotian Zhang Jianwei Yang Chunyuan Li Yiwu Zhong Lijuan Wang Lu Yuan Lei Zhang Jenq-Neng Hwang Kai-Wei Chang and Jianfeng Gao. 2021. Grounded Language-Image Pre-training. https:\/\/doi.org\/10.48550\/ARXIV.2112.03857","DOI":"10.1109\/CVPR52688.2022.01069"},{"key":"e_1_3_2_1_11_1","volume-title":"Conference on Robot Learning. PMLR, 17\u201326","author":"Lomonaco Vincenzo","year":"2017","unstructured":"Vincenzo Lomonaco and Davide Maltoni . 2017 . Core50: a new dataset and benchmark for continuous object recognition . In Conference on Robot Learning. PMLR, 17\u201326 . Vincenzo Lomonaco and Davide Maltoni. 2017. Core50: a new dataset and benchmark for continuous object recognition. In Conference on Robot Learning. PMLR, 17\u201326."},{"key":"e_1_3_2_1_12_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV48922.2021.01064"},{"key":"e_1_3_2_1_13_1","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2015.7353481"},{"key":"e_1_3_2_1_14_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2019.00937"},{"key":"e_1_3_2_1_15_1","volume-title":"Proceedings of the IEEE conference on computer vision and pattern recognition. 652\u2013660","author":"Qi R","year":"2017","unstructured":"Charles\u00a0 R Qi , Hao Su , Kaichun Mo , and Leonidas\u00a0 J Guibas . 2017 . Pointnet: Deep learning on point sets for 3d classification and segmentation . In Proceedings of the IEEE conference on computer vision and pattern recognition. 652\u2013660 . Charles\u00a0R Qi, Hao Su, Kaichun Mo, and Leonidas\u00a0J Guibas. 2017. Pointnet: Deep learning on point sets for 3d classification and segmentation. In Proceedings of the IEEE conference on computer vision and pattern recognition. 652\u2013660."},{"key":"e_1_3_2_1_16_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2016.609"},{"key":"e_1_3_2_1_17_1","volume-title":"International Conference on Machine Learning. PMLR, 8748\u20138763","author":"Radford Alec","year":"2021","unstructured":"Alec Radford , Jong\u00a0Wook Kim , Chris Hallacy , Aditya Ramesh , Gabriel Goh , Sandhini Agarwal , Girish Sastry , Amanda Askell , Pamela Mishkin , Jack Clark , 2021 . Learning transferable visual models from natural language supervision . In International Conference on Machine Learning. PMLR, 8748\u20138763 . Alec Radford, Jong\u00a0Wook Kim, Chris Hallacy, Aditya Ramesh, Gabriel Goh, Sandhini Agarwal, Girish Sastry, Amanda Askell, Pamela Mishkin, Jack Clark, 2021. Learning transferable visual models from natural language supervision. In International Conference on Machine Learning. PMLR, 8748\u20138763."},{"key":"e_1_3_2_1_18_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2017.587"},{"key":"e_1_3_2_1_19_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA40945.2020.9196887"},{"key":"e_1_3_2_1_20_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2015.114"},{"key":"e_1_3_2_1_21_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR42600.2020.01220"},{"key":"e_1_3_2_1_22_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2019.00346"},{"key":"e_1_3_2_1_23_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV48922.2021.01065"},{"key":"e_1_3_2_1_24_1","volume-title":"Proceedings of the IEEE conference on computer vision and pattern recognition. 1912\u20131920","author":"Wu Zhirong","year":"2015","unstructured":"Zhirong Wu , Shuran Song , Aditya Khosla , Fisher Yu , Linguang Zhang , Xiaoou Tang , and Jianxiong Xiao . 2015 . 3d shapenets: A deep representation for volumetric shapes . In Proceedings of the IEEE conference on computer vision and pattern recognition. 1912\u20131920 . Zhirong Wu, Shuran Song, Aditya Khosla, Fisher Yu, Linguang Zhang, Xiaoou Tang, and Jianxiong Xiao. 2015. 3d shapenets: A deep representation for volumetric shapes. In Proceedings of the IEEE conference on computer vision and pattern recognition. 1912\u20131920."},{"key":"e_1_3_2_1_25_1","volume-title":"Florence: A New Foundation Model for Computer Vision. arXiv preprint arXiv:2111.11432(2021).","author":"Yuan Lu","year":"2021","unstructured":"Lu Yuan , Dongdong Chen , Yi-Ling Chen , Noel Codella , Xiyang Dai , Jianfeng Gao , Houdong Hu , Xuedong Huang , Boxin Li , Chunyuan Li , 2021 . Florence: A New Foundation Model for Computer Vision. arXiv preprint arXiv:2111.11432(2021). Lu Yuan, Dongdong Chen, Yi-Ling Chen, Noel Codella, Xiyang Dai, Jianfeng Gao, Houdong Hu, Xuedong Huang, Boxin Li, Chunyuan Li, 2021. Florence: A New Foundation Model for Computer Vision. arXiv preprint arXiv:2111.11432(2021)."},{"key":"e_1_3_2_1_26_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR46437.2021.01227"}],"event":{"name":"ICMI '22: INTERNATIONAL CONFERENCE ON MULTIMODAL INTERACTION","sponsor":["SIGCHI ACM Special Interest Group on Computer-Human Interaction"],"location":"Bengaluru India","acronym":"ICMI '22"},"container-title":["Proceedings of the 2022 International Conference on Multimodal Interaction"],"original-title":[],"link":[{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3536221.3556567","content-type":"unspecified","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/dl.acm.org\/doi\/pdf\/10.1145\/3536221.3556567","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,6,17]],"date-time":"2025-06-17T17:48:52Z","timestamp":1750182532000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3536221.3556567"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2022,11,7]]},"references-count":27,"alternative-id":["10.1145\/3536221.3556567","10.1145\/3536221"],"URL":"https:\/\/doi.org\/10.1145\/3536221.3556567","relation":{},"subject":[],"published":{"date-parts":[[2022,11,7]]},"assertion":[{"value":"2022-11-07","order":2,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}