{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,4,30]],"date-time":"2026-04-30T17:27:01Z","timestamp":1777570021536,"version":"3.51.4"},"publisher-location":"New York, NY, USA","reference-count":40,"publisher":"ACM","license":[{"start":{"date-parts":[[2022,1,7]],"date-time":"2022-01-07T00:00:00Z","timestamp":1641513600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0\/"}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2022,1,7]]},"DOI":"10.1145\/3512388.3512399","type":"proceedings-article","created":{"date-parts":[[2022,3,29]],"date-time":"2022-03-29T02:28:13Z","timestamp":1648520893000},"page":"72-78","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":11,"title":["SpikeFormer: Image Reconstruction from the Sequence of Spike Camera Based on Transformer"],"prefix":"10.1145","author":[{"given":"Chen","family":"She","sequence":"first","affiliation":[{"name":"School of Computer Science and Technology, University of Chinese Academy of Sciences, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Laiyun","family":"Qing","sequence":"additional","affiliation":[{"name":"School of Computer Science and Technology, University of Chinese Academy of Sciences, China"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"320","published-online":{"date-parts":[[2022,3,28]]},"reference":[{"key":"e_1_3_2_1_1_1","doi-asserted-by":"crossref","unstructured":"Anurag Arnab Mostafa Dehghani Georg Heigold Chen Sun MarioLu\u010di\u0107 and Cordelia Schmid. 2021. ViViT: A Video Vision Transformer.arXiv:2103.15691[cs.CV].  Anurag Arnab Mostafa Dehghani Georg Heigold Chen Sun MarioLu\u010di\u0107 and Cordelia Schmid. 2021. ViViT: A Video Vision Transformer.arXiv:2103.15691[cs.CV].","DOI":"10.1109\/ICCV48922.2021.00676"},{"key":"e_1_3_2_1_2_1","volume-title":"Simultaneous Optical Flow and Intensity Estimation from an Event Camera. CVPR","author":"Bardow Patrick","year":"2016","unstructured":"Patrick Bardow , Andrew J. Davison , and Stefan Leutenegger . 2016. Simultaneous Optical Flow and Intensity Estimation from an Event Camera. CVPR ( 2016 ). Patrick Bardow, Andrew J. Davison, and Stefan Leutenegger. 2016. Simultaneous Optical Flow and Intensity Estimation from an Event Camera. CVPR (2016)."},{"key":"e_1_3_2_1_3_1","volume-title":"A 240 \u00d7 180 130 dB 3 \u03bcs Latency Global Shutter Spatiotemporal Vision Sensor","author":"Brandli Christian","year":"2014","unstructured":"Christian Brandli , Raphael Berner , Minhao Yang , Shih-Chii Liu , and Tobi Del-bruck. 2014. A 240 \u00d7 180 130 dB 3 \u03bcs Latency Global Shutter Spatiotemporal Vision Sensor . IEEE Journal of Solid-State Circuits ( 2014 ). Christian Brandli, Raphael Berner, Minhao Yang, Shih-Chii Liu, and Tobi Del-bruck. 2014. A 240 \u00d7 180 130 dB 3 \u03bcs Latency Global Shutter Spatiotemporal Vision Sensor. IEEE Journal of Solid-State Circuits (2014)."},{"key":"e_1_3_2_1_4_1","volume-title":"End-to-End Object Detection with Transformers. ECCV","author":"Carion Nicolas","year":"2020","unstructured":"Nicolas Carion , Francisco Massa , Gabriel Synnaeve , Nicolas Usunier , Alexan-der Kirillov, and Sergey Zagoruyko . 2020. End-to-End Object Detection with Transformers. ECCV ( 2020 ). Nicolas Carion, Francisco Massa, Gabriel Synnaeve, Nicolas Usunier, Alexan-der Kirillov, and Sergey Zagoruyko. 2020. End-to-End Object Detection with Transformers. ECCV (2020)."},{"key":"e_1_3_2_1_5_1","volume-title":"Pre-Trained Image Processing Transformer. CVPR","author":"Chen Hanting","year":"2021","unstructured":"Hanting Chen , Yunhe Wang , Tianyu Guo , Chang Xu , Yiping Deng , Zhenhua Liu , Siwei Ma , Chunjing Xu , Chao Xu , and Wen Gao . 2021. Pre-Trained Image Processing Transformer. CVPR ( 2021 ). Hanting Chen, Yunhe Wang, Tianyu Guo, Chang Xu, Yiping Deng, Zhenhua Liu, Siwei Ma, Chunjing Xu, Chao Xu, and Wen Gao. 2021. Pre-Trained Image Processing Transformer. CVPR (2021)."},{"key":"e_1_3_2_1_6_1","volume-title":"Proceedings of the 2019 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies, NAACL-HLT","author":"Devlin Jacob","year":"2019","unstructured":"Jacob Devlin , Ming-Wei Chang , Kenton Lee , and Kristina Toutanova . 2019 . BERT: Pre-training of Deep Bidirectional Transformers for Language Under-standing . In Proceedings of the 2019 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies, NAACL-HLT (2019). Jacob Devlin, Ming-Wei Chang, Kenton Lee, and Kristina Toutanova. 2019.BERT: Pre-training of Deep Bidirectional Transformers for Language Under-standing. In Proceedings of the 2019 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies, NAACL-HLT (2019)."},{"key":"e_1_3_2_1_7_1","volume-title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale. ICLR","author":"Dosovitskiy Alexey","year":"2021","unstructured":"Alexey Dosovitskiy , Lucas Beyer , Alexander Kolesnikov , Dirk Weissenborn , Xiaohua Zhai , Thomas Unterthiner , Mostafa Dehghani , Matthias Minderer , GeorgHeigold, Sylvain Gelly , Jakob Uszkoreit , and Neil Houlsby . 2021. An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale. ICLR ( 2021 ). Alexey Dosovitskiy, Lucas Beyer, Alexander Kolesnikov, Dirk Weissenborn, Xiaohua Zhai, Thomas Unterthiner, Mostafa Dehghani, Matthias Minderer, GeorgHeigold, Sylvain Gelly, Jakob Uszkoreit, and Neil Houlsby. 2021. An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale. ICLR (2021)."},{"key":"e_1_3_2_1_8_1","unstructured":"Kaiming He Georgia Gkioxari Piotr Doll\u00e1r and Ross Girshick. 2017. Mask R-CNN. ICCV (2017).  Kaiming He Georgia Gkioxari Piotr Doll\u00e1r and Ross Girshick. 2017. Mask R-CNN. ICCV (2017)."},{"key":"e_1_3_2_1_9_1","volume-title":"Deep Residual Learning for Image Recognition. CVPR","author":"He Kaiming","year":"2016","unstructured":"Kaiming He , Xiangyu Zhang , Shaoqing Ren , and Jian Sun . 2016. Deep Residual Learning for Image Recognition. CVPR ( 2016 ). Kaiming He, Xiangyu Zhang, Shaoqing Ren, and Jian Sun. 2016. Deep Residual Learning for Image Recognition. CVPR (2016)."},{"key":"e_1_3_2_1_10_1","volume-title":"Bruce","author":"Amirul Islam Md.","year":"2020","unstructured":"Md. Amirul Islam , Sen Jia , and Neil D. B . Bruce . 2020 . How much Position Information Do Convolutional Neural Networks Encode? ICLR ( 2020). Md. Amirul Islam, Sen Jia, and Neil D. B. Bruce. 2020. How much Position Information Do Convolutional Neural Networks Encode? ICLR (2020)."},{"key":"e_1_3_2_1_11_1","volume-title":"A 128\u00d7128 120dB 15 \u03bcs Latency Asynchronous Temporal Contrast Vision Sensor","author":"Lichtsteiner Patrick","year":"2008","unstructured":"Patrick Lichtsteiner , Christoph Posch , and Tobi Delbruck . 2008. A 128\u00d7128 120dB 15 \u03bcs Latency Asynchronous Temporal Contrast Vision Sensor . IEEE Journal of Solid-State Circuits ( 2008 ). Patrick Lichtsteiner, Christoph Posch, and Tobi Delbruck. 2008. A 128\u00d7128 120dB 15 \u03bcs Latency Asynchronous Temporal Contrast Vision Sensor. IEEE Journal of Solid-State Circuits (2008)."},{"key":"e_1_3_2_1_12_1","doi-asserted-by":"publisher","DOI":"10.1109\/LSP.2010.2043888"},{"key":"e_1_3_2_1_13_1","doi-asserted-by":"crossref","unstructured":"G. Munda C. Reinbacher and T. Pock. 2018. Real-Time Intensity-Image Reconstruction for Event Cameras Using Manifold Regularisation. International Journal of Computer Vision (2018).  G. Munda C. Reinbacher and T. Pock. 2018. Real-Time Intensity-Image Reconstruction for Event Cameras Using Manifold Regularisation. International Journal of Computer Vision (2018).","DOI":"10.1007\/s11263-018-1106-2"},{"key":"e_1_3_2_1_14_1","volume-title":"de Croon","author":"Paredes-Valles Federico","year":"2021","unstructured":"Federico Paredes-Valles and Guido C. H. E . de Croon . 2021 . Back to Event Basics : Self-Supervised Learning of Image Reconstruction for Event Cameras via Photometric Constancy. CVPR ( 2021). Federico Paredes-Valles and Guido C. H. E. de Croon. 2021. Back to Event Basics: Self-Supervised Learning of Image Reconstruction for Event Cameras via Photometric Constancy. CVPR (2021)."},{"key":"e_1_3_2_1_15_1","volume-title":"Proceedings of The 2nd Conference on Robot Learning (Proceedings of Machine Learning Research","author":"Rebecq Henri","year":"2018","unstructured":"Henri Rebecq , Daniel Gehrig , and Davide Scaramuzza . 2018 . ESIM: an Open Event Camera Simulator . In Proceedings of The 2nd Conference on Robot Learning (Proceedings of Machine Learning Research , Vol. 87). Henri Rebecq, Daniel Gehrig, and Davide Scaramuzza. 2018. ESIM: an Open Event Camera Simulator. In Proceedings of The 2nd Conference on Robot Learning (Proceedings of Machine Learning Research, Vol. 87)."},{"key":"e_1_3_2_1_16_1","volume-title":"Bringing Modern Computer Vision to Event Cameras. CVPR","author":"Rebecq Henri","year":"2019","unstructured":"Henri Rebecq , Ren\u00e9 Ranftl , Vladlen Koltun , and Davide Scaramuzza . 2019.Events-to-Video : Bringing Modern Computer Vision to Event Cameras. CVPR ( 2019 ). Henri Rebecq, Ren\u00e9 Ranftl, Vladlen Koltun, and Davide Scaramuzza. 2019.Events-to-Video: Bringing Modern Computer Vision to Event Cameras. CVPR (2019)."},{"key":"e_1_3_2_1_17_1","volume-title":"Ross B. Girshick, and Ali Farhadi.","author":"Redmon Joseph","year":"2016","unstructured":"Joseph Redmon , Santosh Kumar Divvala , Ross B. Girshick, and Ali Farhadi. 2016 .You Only Look Once: Unified , Real-Time Object Detection. CVPR ( 2016) Joseph Redmon, Santosh Kumar Divvala, Ross B. Girshick, and Ali Farhadi. 2016.You Only Look Once: Unified, Real-Time Object Detection. CVPR (2016)"},{"key":"e_1_3_2_1_18_1","volume-title":"Faster R-CNN: Towards Real-Time Object Detection with Region Proposal Networks","author":"Ren Shaoqing","year":"2017","unstructured":"Shaoqing Ren , Kaiming He , Ross B. Girshick , and Jian Sun . 2017. Faster R-CNN: Towards Real-Time Object Detection with Region Proposal Networks . IEEE Trans. Pattern Anal. Mach. Intell . ( 2017 ). Shaoqing Ren, Kaiming He, Ross B. Girshick, and Jian Sun. 2017. Faster R-CNN: Towards Real-Time Object Detection with Region Proposal Networks. IEEE Trans. Pattern Anal. Mach. Intell. (2017)."},{"key":"e_1_3_2_1_19_1","volume-title":"U-Net: Convolutional Networks for Biomedical Image Segmentation. MICCAI","author":"Ronneberger Olaf","year":"2015","unstructured":"Olaf Ronneberger , Philipp Fischer , and Thomas Brox . 2015. U-Net: Convolutional Networks for Biomedical Image Segmentation. MICCAI ( 2015 ). Olaf Ronneberger, Philipp Fischer, and Thomas Brox. 2015. U-Net: Convolutional Networks for Biomedical Image Segmentation. MICCAI (2015)."},{"key":"e_1_3_2_1_20_1","volume-title":"Continuous-Time Intensity Estimation Using Event Cameras. ACCV","author":"Scheerlinck Cedric","year":"2018","unstructured":"Cedric Scheerlinck , Nick Barnes , and Robert Mahony . 2019. Continuous-Time Intensity Estimation Using Event Cameras. ACCV ( 2018 ). Cedric Scheerlinck, Nick Barnes, and Robert Mahony. 2019. Continuous-Time Intensity Estimation Using Event Cameras. ACCV (2018)."},{"key":"e_1_3_2_1_21_1","volume-title":"Very Deep Convolutional Net-works for Large-Scale Image Recognition. ICLR","author":"Simonyan Karen","year":"2015","unstructured":"Karen Simonyan and Andrew Zisserman . 2015. Very Deep Convolutional Net-works for Large-Scale Image Recognition. ICLR ( 2015 ). Karen Simonyan and Andrew Zisserman. 2015. Very Deep Convolutional Net-works for Large-Scale Image Recognition. ICLR (2015)."},{"key":"e_1_3_2_1_22_1","doi-asserted-by":"crossref","unstructured":"Timo Stoffregen Cedric Scheerlinck Davide Scaramuzza Tom Drummond NickBarnes Lindsay Kleeman and Robert Mahony. 2020. Reducing the Sim-to-Real Gap for Event Cameras. arXiv:2003.09078[cs.CV].  Timo Stoffregen Cedric Scheerlinck Davide Scaramuzza Tom Drummond NickBarnes Lindsay Kleeman and Robert Mahony. 2020. Reducing the Sim-to-Real Gap for Event Cameras. arXiv:2003.09078[cs.CV].","DOI":"10.1007\/978-3-030-58583-9_32"},{"key":"e_1_3_2_1_23_1","volume-title":"undefinedukasz Kaiser, and Illia Polosukhin","author":"Vaswani Ashish","year":"2017","unstructured":"Ashish Vaswani , Noam Shazeer , Niki Parmar , Jakob Uszkoreit , Llion Jones , Aidan N. Gomez , undefinedukasz Kaiser, and Illia Polosukhin . 2017 . Attention is All You Need. NIPS ( 2017). Ashish Vaswani, Noam Shazeer, Niki Parmar, Jakob Uszkoreit, Llion Jones,Aidan N. Gomez, undefinedukasz Kaiser, and Illia Polosukhin. 2017. Attention is All You Need. NIPS (2017)."},{"key":"e_1_3_2_1_24_1","volume-title":"Autofocusing of ISAR images based on entropy minimization","author":"Xi Li","year":"1999","unstructured":"Li Xi , Liu Guosui , and Jinlin Ni. 1999. Autofocusing of ISAR images based on entropy minimization . IEEE Trans. Aerospace Electron. Systems( 1999 ). Li Xi, Liu Guosui, and Jinlin Ni. 1999. Autofocusing of ISAR images based on entropy minimization. IEEE Trans. Aerospace Electron. Systems(1999)."},{"key":"e_1_3_2_1_25_1","unstructured":"Enze Xie Wenhai Wang Zhiding Yu Anima Anandkumar Jose M. Alvarez and Ping Luo. 2021. SegFormer: Simple and Efficient Design for Semantic Segmentation with Transformers.  Enze Xie Wenhai Wang Zhiding Yu Anima Anandkumar Jose M. Alvarez and Ping Luo. 2021. SegFormer: Simple and Efficient Design for Semantic Segmentation with Transformers."},{"key":"e_1_3_2_1_26_1","doi-asserted-by":"crossref","unstructured":"S. Yousefi M. Rahman N. Kehtarnavaz and M. Gamadia. 2011. A new auto-focus sharpness function for digital and smart-phone cameras. ICCE (2011).  S. Yousefi M. Rahman N. Kehtarnavaz and M. Gamadia. 2011. A new auto-focus sharpness function for digital and smart-phone cameras. ICCE (2011).","DOI":"10.1109\/ICCE.2011.5722691"},{"key":"e_1_3_2_1_27_1","volume-title":"Multi-Stage Progressive Image Restoration. CVPR","author":"Zamir Syed Waqas","year":"2021","unstructured":"Syed Waqas Zamir , Aditya Arora , Salman Khan , Munawar Hayat , Fahad ShahbazKhan , Ming-Hsuan Yang , and Ling Shao . 2021. Multi-Stage Progressive Image Restoration. CVPR ( 2021 ). Syed Waqas Zamir, Aditya Arora, Salman Khan, Munawar Hayat, Fahad ShahbazKhan, Ming-Hsuan Yang, and Ling Shao. 2021. Multi-Stage Progressive Image Restoration. CVPR (2021)."},{"key":"e_1_3_2_1_28_1","volume-title":"High-Speed Motion Scene Reconstruction for Spike Camera via Motion Aligned Filtering. ISCAS","author":"Zhao Jing","year":"2020","unstructured":"Jing Zhao , Ruiqin Xiong , and Tiejun Huang . 2020. High-Speed Motion Scene Reconstruction for Spike Camera via Motion Aligned Filtering. ISCAS ( 2020 ). Jing Zhao, Ruiqin Xiong, and Tiejun Huang. 2020. High-Speed Motion Scene Reconstruction for Spike Camera via Motion Aligned Filtering. ISCAS (2020)."},{"key":"e_1_3_2_1_29_1","volume-title":"Learning to Reconstruct Dynamic Scene from Continuous SpikeStream. CVPR","author":"Zhao Jing","year":"2021","unstructured":"Jing Zhao , Ruiqin Xiong , Hangfan Liu , Jian Zhang , and Tiejun Huang . 2021.Spk2ImgNet : Learning to Reconstruct Dynamic Scene from Continuous SpikeStream. CVPR ( 2021 ). Jing Zhao, Ruiqin Xiong, Hangfan Liu, Jian Zhang, and Tiejun Huang. 2021.Spk2ImgNet: Learning to Reconstruct Dynamic Scene from Continuous SpikeStream. CVPR (2021)."},{"key":"e_1_3_2_1_30_1","doi-asserted-by":"crossref","unstructured":"Sixiao Zheng Jiachen Lu Hengshuang Zhao Xiatian Zhu Zekun Luo YabiaoWang Yanwei Fu Jianfeng Feng Tao Xiang Philip H.S. Torr and Li Zhang. 2021.Rethinking Semantic Segmentation from a Sequence-to-Sequence Perspective with Transformers. CVPR (2021).  Sixiao Zheng Jiachen Lu Hengshuang Zhao Xiatian Zhu Zekun Luo YabiaoWang Yanwei Fu Jianfeng Feng Tao Xiang Philip H.S. Torr and Li Zhang. 2021.Rethinking Semantic Segmentation from a Sequence-to-Sequence Perspective with Transformers. CVPR (2021).","DOI":"10.1109\/CVPR46437.2021.00681"},{"key":"e_1_3_2_1_31_1","doi-asserted-by":"crossref","unstructured":"Y. Zheng L. Zheng Z. Yu B. Shi and T. Huang. 2021. High-speed Image Reconstruction through Short-term Plasticity for Spiking Cameras. CVPR (2021).  Y. Zheng L. Zheng Z. Yu B. Shi and T. Huang. 2021. High-speed Image Reconstruction through Short-term Plasticity for Spiking Cameras. CVPR (2021).","DOI":"10.1109\/CVPR46437.2021.00629"},{"key":"e_1_3_2_1_32_1","volume-title":"A Retina-Inspired Sampling Method for Visual Texture Reconstruction. ICME","author":"Zhu Lin","year":"2019","unstructured":"Lin Zhu , Siwei Dong , Tiejun Huang , and Yonghong Tian . 2019. A Retina-Inspired Sampling Method for Visual Texture Reconstruction. ICME ( 2019 ). Lin Zhu, Siwei Dong, Tiejun Huang, and Yonghong Tian. 2019. A Retina-Inspired Sampling Method for Visual Texture Reconstruction. ICME (2019)."},{"key":"e_1_3_2_1_33_1","volume-title":"Retina-Like Visual Image Reconstruction via Spiking Neural Model. CVPR","author":"Zhu Lin","year":"2020","unstructured":"Lin Zhu , Siwei Dong , Jianing Li , Tiejun Huang , and Yonghong Tian . 2020. Retina-Like Visual Image Reconstruction via Spiking Neural Model. CVPR ( 2020 ). Lin Zhu, Siwei Dong, Jianing Li, Tiejun Huang, and Yonghong Tian. 2020. Retina-Like Visual Image Reconstruction via Spiking Neural Model. CVPR (2020)."},{"key":"e_1_3_2_1_34_1","unstructured":"Zhendong Wang Xiaodong Cun Jianmin Bao and Jianzhuang Liu. 2021.Uformer: A General U-Shaped Transformer for Image Restoration.arXivpreprint arXiv:2106.03106(2021).  Zhendong Wang Xiaodong Cun Jianmin Bao and Jianzhuang Liu. 2021.Uformer: A General U-Shaped Transformer for Image Restoration.arXivpreprint arXiv:2106.03106(2021)."},{"key":"e_1_3_2_1_35_1","unstructured":"Kai Han An Xiao Enhua Wu Jianyuan Guo Chunjing Xu and Yunhe Wang.2021. Transformer in Transformer.  Kai Han An Xiao Enhua Wu Jianyuan Guo Chunjing Xu and Yunhe Wang.2021. Transformer in Transformer."},{"key":"e_1_3_2_1_36_1","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/P19-1285"},{"key":"e_1_3_2_1_37_1","unstructured":"Mostafa Dehghani Stephan Gouws Oriol Vinyals Jakob Uszkoreit and \u0141ukaszKaiser. 2019. Universal Transformers.  Mostafa Dehghani Stephan Gouws Oriol Vinyals Jakob Uszkoreit and \u0141ukaszKaiser. 2019. Universal Transformers."},{"key":"e_1_3_2_1_38_1","doi-asserted-by":"publisher","DOI":"10.12720\/joig.1.1.12-16"},{"issue":"2","key":"e_1_3_2_1_39_1","first-page":"94","volume":"1","author":"Zefreh K. Zarei","year":"2013","unstructured":"K. Zarei Zefreh , W. van Aarle , K. J. Batenburg , and J. Sijbers , \"Super-Resolution of License Plate Images using Algebraic Reconstruction Technique,\" Journal of Image and Graphics , Vol. 1 , No. 2 , pp. 94 - 98 , June 2013 . doi: 10.12720\/joig.1.2.94-98. 10.12720\/joig.1.2.94-98 K. Zarei Zefreh, W. van Aarle, K. J. Batenburg, and J. Sijbers, \"Super-Resolution of License Plate Images using Algebraic Reconstruction Technique,\" Journal of Image and Graphics, Vol. 1, No. 2, pp. 94-98, June 2013. doi: 10.12720\/joig.1.2.94-98.","journal-title":"\"Super-Resolution of License Plate Images using Algebraic Reconstruction Technique,\" Journal of Image and Graphics"},{"key":"e_1_3_2_1_40_1","volume-title":"andQingming Huang","author":"Chen Weidong","year":"2021","unstructured":"Weidong Chen , Guorong Li , Xinfeng Zhang , Hongyang Yu , Shuhui Wang , andQingming Huang . 2021 . Cascade Cross-modal Attention Network for Video Ac-tor and Action Segmentation from a Sentence. MM ( 2021). Weidong Chen, Guorong Li, Xinfeng Zhang, Hongyang Yu, Shuhui Wang, andQingming Huang. 2021. Cascade Cross-modal Attention Network for Video Ac-tor and Action Segmentation from a Sentence. MM (2021)."}],"event":{"name":"ICIGP 2022: 2022 the 5th International Conference on Image and Graphics Processing","location":"Beijing China","acronym":"ICIGP 2022"},"container-title":["2022 the 5th International Conference on Image and Graphics Processing (ICIGP)"],"original-title":[],"link":[{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3512388.3512399","content-type":"unspecified","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/dl.acm.org\/doi\/pdf\/10.1145\/3512388.3512399","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,6,17]],"date-time":"2025-06-17T20:11:42Z","timestamp":1750191102000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3512388.3512399"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2022,1,7]]},"references-count":40,"alternative-id":["10.1145\/3512388.3512399","10.1145\/3512388"],"URL":"https:\/\/doi.org\/10.1145\/3512388.3512399","relation":{},"subject":[],"published":{"date-parts":[[2022,1,7]]},"assertion":[{"value":"2022-03-28","order":2,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}