{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,2,10]],"date-time":"2026-02-10T20:35:01Z","timestamp":1770755701932,"version":"3.50.0"},"reference-count":78,"publisher":"Association for Computing Machinery (ACM)","issue":"6","license":[{"start":{"date-parts":[[2024,3,8]],"date-time":"2024-03-08T00:00:00Z","timestamp":1709856000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.acm.org\/publications\/policies\/copyright_policy#Background"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"crossref","award":["62072141"],"award-info":[{"award-number":["62072141"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"crossref"}]}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":["ACM Trans. Multimedia Comput. Commun. Appl."],"published-print":{"date-parts":[[2024,6,30]]},"abstract":"<jats:p>Existing human matting methods are incapable of accurately estimating the alpha mattes of arbitrarily selected humans from a group photo. An alternative solution is to apply them to the corresponding cropped image patches. However, this option obtains an inaccurate alpha estimation due to the interference of the body parts of the neighboring humans. In addition, these methods are only trained on finely annotated synthetic data, which causes poor performance in real-world scenarios due to the domain shift. To address these problems, we propose human selective matting (HSMatt), which performs matting for arbitrarily selected humans from a group photo given only a simple bounding box as guidance. Specifically, we design a global\u2013local context network to extract both local and global semantic context features. A human-aware trimap network is then proposed to generate human-aware trimaps for the selected humans, which adopts stacked bidirectional inference modules with intermediate supervision to progressively refine the estimated trimap. Finally, a partially supervised matting network is introduced to estimate the alpha matte, which uses a sample-varying loss to train the network on both the finely annotated synthetic data and coarsely annotated real-world data, resulting in high accuracy and good generalization. To evaluate the proposed HSMatt, we construct the first human selective matting dataset, named HSM-200K, which contains over 200,000 human images with instance-level alpha matte annotations. Experimental results demonstrate that the proposed HSMatt outperforms state-of-the-art methods.<\/jats:p>","DOI":"10.1145\/3640017","type":"journal-article","created":{"date-parts":[[2024,1,15]],"date-time":"2024-01-15T11:27:44Z","timestamp":1705318064000},"page":"1-23","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":1,"title":["Human Selective Matting"],"prefix":"10.1145","volume":"20","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-2408-3344","authenticated-orcid":false,"given":"Qinglin","family":"Liu","sequence":"first","affiliation":[{"name":"Harbin Institute of Technology, Weihai, Shandong, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-3902-7510","authenticated-orcid":false,"given":"Quanling","family":"Meng","sequence":"additional","affiliation":[{"name":"Harbin Institute of Technology, Weihai, Shandong, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-8735-1561","authenticated-orcid":false,"given":"Xiaoqian","family":"Lv","sequence":"additional","affiliation":[{"name":"Harbin Institute of Technology, Weihai, Shandong, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-4181-310X","authenticated-orcid":false,"given":"Zonglin","family":"Li","sequence":"additional","affiliation":[{"name":"Harbin Institute of Technology, Weihai, Shandong, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-4805-3115","authenticated-orcid":false,"given":"Wei","family":"Yu","sequence":"additional","affiliation":[{"name":"Harbin Institute of Technology, Weihai, Shandong, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-5200-3420","authenticated-orcid":false,"given":"Shengping","family":"Zhang","sequence":"additional","affiliation":[{"name":"Harbin Institute of Technology, Weihai, Shandong, China"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"320","published-online":{"date-parts":[[2024,3,8]]},"reference":[{"key":"e_1_3_1_2_2","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2012.120"},{"key":"e_1_3_1_3_2","volume-title":"CVPR","author":"Aksoy Yagiz","year":"2017","unstructured":"Yagiz Aksoy, Tun\u00e7 Ozan Aydin, and Marc Pollefeys. 2017. Designing effective inter-pixel information flow for natural image matting. In CVPR."},{"key":"e_1_3_1_4_2","unstructured":"Arie Berman Arpag Dadourian and Paul Vlahos. 2000. Method for removing from an image the background surrounding a selected object. U.S. Patent US6134346A."},{"key":"e_1_3_1_5_2","first-page":"438","volume-title":"CVPR","author":"Borji Ali","year":"2012","unstructured":"Ali Borji. 2012. Boosting bottom-up and top-down visual features for saliency estimation. In CVPR. IEEE, 438\u2013445."},{"key":"e_1_3_1_6_2","volume-title":"ICCV","author":"Cai Shaofan","year":"2019","unstructured":"Shaofan Cai, Xiaoshuai Zhang, Haoqiang Fan, Haibin Huang, Jiangyu Liu, Jiaming Liu, Jiaying Liu, Jue Wang, and Jian Sun. 2019. Disentangled image matting. In ICCV."},{"key":"e_1_3_1_7_2","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2017.2699184"},{"key":"e_1_3_1_8_2","volume-title":"ACM MM","author":"Chen Quan","year":"2018","unstructured":"Quan Chen, Tiezheng Ge, Yanyu Xu, Zhiqiang Zhang, Xinxin Yang, and Kun Gai. 2018. Semantic human matting. In ACM MM."},{"key":"e_1_3_1_9_2","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2013.18"},{"key":"e_1_3_1_10_2","volume-title":"ACM MM","author":"Chen Shifeng","year":"2007","unstructured":"Shifeng Chen, Zhenguo Li, Jianzhuang Liu, and Xiaoou Tang. 2007. Image matting using linear optimization. In ACM MM."},{"key":"e_1_3_1_11_2","volume-title":"SIGGRAPH Asia","author":"Chen Tao","year":"2009","unstructured":"Tao Chen, Ming Ming Cheng, Ping Tan, Ariel Shamir, and Shi Min Hu. 2009. Sketch2Photo: Internet image montage. In SIGGRAPH Asia."},{"issue":"3","key":"e_1_3_1_12_2","first-page":"1526","article-title":"Robust multi-focus image fusion using edge model and multi-matting","volume":"27","author":"Chen Yibo","year":"2018","unstructured":"Yibo Chen, Jingwei Guan, and Wai Kuen Cham. 2018. Robust multi-focus image fusion using edge model and multi-matting. TIP 27, 3 (2018), 1526\u20131541.","journal-title":"TIP"},{"key":"e_1_3_1_13_2","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2016.2606397"},{"key":"e_1_3_1_14_2","volume-title":"CVPR","author":"Chuang Yung-Yu","year":"2001","unstructured":"Yung-Yu Chuang, B. Curless, D. H. Salesin, and R. Szeliski. 2001. A Bayesian approach to digital matting. In CVPR."},{"key":"e_1_3_1_15_2","article-title":"Pexels.com","author":"Contributors Pexels","year":"2023","unstructured":"Pexels Contributors. 2023. Pexels.com. https:\/\/www.pexels.com. (2023).","journal-title":"https:\/\/www.pexels.com"},{"key":"e_1_3_1_16_2","article-title":"Supervisely.com","author":"Contributors Supervisely","year":"2023","unstructured":"Supervisely Contributors. 2023. Supervisely.com. https:\/\/supervisely.com\/. (2023).","journal-title":"https:\/\/supervisely.com\/"},{"key":"e_1_3_1_17_2","first-page":"11707","volume-title":"CVPR","author":"Dai Yutong","year":"2022","unstructured":"Yutong Dai, Brian Price, He Zhang, and Chunhua Shen. 2022. Boosting robustness of image matting with context assembling and strong data augmentation. In CVPR. 11707\u201311716."},{"key":"e_1_3_1_18_2","first-page":"2393","volume-title":"CVPR","author":"Ding Henghui","year":"2018","unstructured":"Henghui Ding, Xudong Jiang, Bing Shuai, Ai Qun Liu, and Gang Wang. 2018. Context contrasted feature and gated multi-scale aggregation for scene segmentation. In CVPR. 2393\u20132402."},{"key":"e_1_3_1_19_2","doi-asserted-by":"publisher","DOI":"10.1109\/TIP.2022.3155958"},{"key":"e_1_3_1_20_2","article-title":"QueryInst: Parallelly supervised mask query for instance segmentation","author":"Fang Yuxin","year":"2021","unstructured":"Yuxin Fang, Shusheng Yang, Xinggang Wang, Yu Li, Chen Fang, Ying Shan, Bin Feng, and Wenyu Liu. 2021. QueryInst: Parallelly supervised mask query for instance segmentation. arXiv preprint arXiv:2105.01928 (2021).","journal-title":"arXiv preprint arXiv:2105.01928"},{"key":"e_1_3_1_21_2","article-title":"F, b, alpha matting","author":"Forte Marco","year":"2020","unstructured":"Marco Forte and Fran\u00e7ois Piti\u00e9. 2020. F, b, alpha matting. arXiv preprint arXiv:2003.07711 (2020).","journal-title":"arXiv preprint arXiv:2003.07711"},{"key":"e_1_3_1_22_2","doi-asserted-by":"publisher","DOI":"10.1016\/S1364-6613(99)01294-2"},{"key":"e_1_3_1_23_2","doi-asserted-by":"publisher","DOI":"10.1111\/j.1467-8659.2009.01627.x"},{"key":"e_1_3_1_24_2","volume-title":"ECCV","author":"Gong Ke","year":"2018","unstructured":"Ke Gong, Xiaodan Liang, Yicheng Li, Yimin Chen, Ming Yang, and Liang Lin. 2018. Instance-level human parsing via part grouping network. In ECCV."},{"issue":"4","key":"e_1_3_1_25_2","first-page":"1356","article-title":"Integrated foreground segmentation and boundary matting for live videos","volume":"24","author":"Gong Minglun","year":"2015","unstructured":"Minglun Gong, Yiming Qian, and Li Cheng. 2015. Integrated foreground segmentation and boundary matting for live videos. TIP 24, 4 (2015), 1356\u20131370.","journal-title":"TIP"},{"key":"e_1_3_1_26_2","article-title":"Random walks for interactive alpha-matting","author":"Grady Leo","year":"2005","unstructured":"Leo Grady and R\u00fcdiger Westermann. 2005. Random walks for interactive alpha-matting. VIIP (2005).","journal-title":"VIIP"},{"key":"e_1_3_1_27_2","volume-title":"IConSIP","author":"Gupta Vikas","year":"2016","unstructured":"Vikas Gupta and Shanmuganathan Raman. 2016. Automatic trimap generation for image matting. In IConSIP."},{"key":"e_1_3_1_28_2","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2018.2844175"},{"key":"e_1_3_1_29_2","volume-title":"CVPR","author":"He Kaiming","year":"2010","unstructured":"Kaiming He, Jian Sun, and Xiaoou Tang. 2010. Fast matting using large kernel matting Laplacian matrices. In CVPR."},{"key":"e_1_3_1_30_2","volume-title":"ICCV","author":"He Kaiming","year":"2015","unstructured":"Kaiming He, Xiangyu Zhang, Shaoqing Ren, and Jian Sun. 2015. Delving deep into rectifiers: Surpassing human-level performance on ImageNet classification. In ICCV."},{"key":"e_1_3_1_31_2","volume-title":"CVPR","author":"He Kaiming","year":"2016","unstructured":"Kaiming He, Xiangyu Zhang, Shaoqing Ren, and Jian Sun. 2016. Deep residual learning for image recognition. In CVPR."},{"key":"e_1_3_1_32_2","volume-title":"APSIPA ASC","author":"Hsieh Chang-Lin","year":"2013","unstructured":"Chang-Lin Hsieh and Ming-Sui Lee. 2013. Automatic trimap generation for digital image matting. In APSIPA ASC."},{"key":"e_1_3_1_33_2","doi-asserted-by":"publisher","DOI":"10.1109\/34.730558"},{"key":"e_1_3_1_34_2","volume-title":"CVPR","author":"Ke Lei","year":"2022","unstructured":"Lei Ke, Martin Danelljan, Xia Li, Yu-Wing Tai, Chi-Keung Tang, and Fisher Yu. 2022. Mask transfiner for high-quality instance segmentation. In CVPR."},{"key":"e_1_3_1_35_2","volume-title":"AAAI","author":"Ke Zhanghan","year":"2022","unstructured":"Zhanghan Ke, Jiayu Sun, Kaican Li, Qiong Yan, and Rynson W. H. Lau. 2022. MODNet: Real-time trimap-free portrait matting via objective decomposition. In AAAI."},{"key":"e_1_3_1_36_2","article-title":"Adam: A method for stochastic optimization","author":"Kingma Diederik P.","year":"2014","unstructured":"Diederik P. Kingma and Jimmy Ba. 2014. Adam: A method for stochastic optimization. arXiv preprint arXiv:1412.6980 (2014).","journal-title":"arXiv preprint arXiv:1412.6980"},{"key":"e_1_3_1_37_2","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2007.1177"},{"key":"e_1_3_1_38_2","first-page":"3501","volume-title":"ACM MM","author":"Li Jizhizi","year":"2021","unstructured":"Jizhizi Li, Sihan Ma, Jing Zhang, and Dacheng Tao. 2021. Privacy-preserving portrait matting. In ACM MM. 3501\u20133509."},{"key":"e_1_3_1_39_2","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-021-01541-0"},{"key":"e_1_3_1_40_2","article-title":"Deep image matting: A comprehensive survey","author":"Li Jizhizi","year":"2023","unstructured":"Jizhizi Li, Jing Zhang, and Dacheng Tao. 2023. Deep image matting: A comprehensive survey. arXiv preprint arXiv:2304.04672 (2023).","journal-title":"arXiv preprint arXiv:2304.04672"},{"key":"e_1_3_1_41_2","volume-title":"AAAI","author":"Li Yaoyi","year":"2020","unstructured":"Yaoyi Li and Hongtao Lu. 2020. Natural image matting via guided contextual attention. In AAAI."},{"key":"e_1_3_1_42_2","first-page":"8762","volume-title":"CVPR","author":"Lin Shanchuan","year":"2021","unstructured":"Shanchuan Lin, Andrey Ryabtsev, Soumyadip Sengupta, Brian L. Curless, Steven M. Seitz, and Ira Kemelmacher-Shlizerman. 2021. Real-time high-resolution background matting. In CVPR. 8762\u20138771."},{"key":"e_1_3_1_43_2","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2018.2858826"},{"key":"e_1_3_1_44_2","first-page":"8563","volume-title":"CVPR","author":"Liu Jinlin","year":"2020","unstructured":"Jinlin Liu, Yuan Yao, Wendi Hou, Miaomiao Cui, Xuansong Xie, Changshui Zhang, and Xian-sheng Hua. 2020. Boosting semantic human matting with coarse annotations. In CVPR. 8563\u20138572."},{"key":"e_1_3_1_45_2","volume-title":"ACM MM","author":"Liu Qinglin","year":"2021","unstructured":"Qinglin Liu, Haozhe Xie, Shengping Zhang, Bineng Zhong, and Rongrong Ji. 2021. Long-range feature propagating for natural image matting. In ACM MM."},{"key":"e_1_3_1_46_2","first-page":"7555","volume-title":"ICCV","author":"Liu Yuhao","year":"2021","unstructured":"Yuhao Liu, Jiake Xie, Xiao Shi, Yu Qiao, Yujie Huang, Yong Tang, and Xin Yang. 2021. Tripartite information mining and integration for image matting. In ICCV. 7555\u20137564."},{"key":"e_1_3_1_47_2","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2020.3004474"},{"key":"e_1_3_1_48_2","volume-title":"BMVC","author":"Lutz Sebastian","year":"2018","unstructured":"Sebastian Lutz, Konstantinos Amplianitis, and Aljosa Smolic. 2018. AlphaGAN: Generative adversarial networks for natural image matting. In BMVC."},{"key":"e_1_3_1_49_2","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-023-01797-8"},{"key":"e_1_3_1_50_2","first-page":"11696","volume-title":"CVPR","author":"Park GyuTae","year":"2022","unstructured":"GyuTae Park, SungJoon Son, JaeYoung Yoo, SeHo Kim, and Nojun Kwak. 2022. MatteFormer: Transformer-based image matting via prior-tokens. In CVPR. 11696\u201311706."},{"key":"e_1_3_1_51_2","volume-title":"NIPS","author":"Paszke Adam","year":"2019","unstructured":"Adam Paszke, Sam Gross, Francisco Massa, Adam Lerer, James Bradbury, Gregory Chanan, Trevor Killeen, Zeming Lin, Natalia Gimelshein, Luca Antiga, Alban Desmaison, Andreas Kopf, Edward Yang, Zachary DeVito, Martin Raison, Alykhan Tejani, Sasank Chilamkurthy, Benoit Steiner, Lu Fang, Junjie Bai, and Soumith Chintala. 2019. PyTorch: An imperative style, high-performance deep learning library. In NIPS."},{"issue":"2","key":"e_1_3_1_52_2","article-title":"Hierarchical and progressive image matting","volume":"19","author":"Qiao Yu","year":"2023","unstructured":"Yu Qiao, Yuhao Liu, Ziqi Wei, Yuxin Wang, Qiang Cai, Guofeng Zhang, and Xin Yang. 2023. Hierarchical and progressive image matting. ACM TOMM 19, 2 (2023).","journal-title":"ACM TOMM"},{"key":"e_1_3_1_53_2","volume-title":"CVPR","author":"Qiao Yu","year":"2020","unstructured":"Yu Qiao, Yuhao Liu, Xin Yang, Dongsheng Zhou, Mingliang Xu, Qiang Zhang, and Xiaopeng Wei. 2020. Attention-guided hierarchical structure aggregation for image matting. In CVPR."},{"key":"e_1_3_1_54_2","first-page":"107404","article-title":"U2-Net: Going deeper with nested u-structure for salient object detection","volume":"106","author":"Qin Xuebin","year":"2020","unstructured":"Xuebin Qin, Zichen Zhang, Chenyang Huang, Masood Dehghan, Osmar Zaiane, and Martin Jagersand. 2020. U2-Net: Going deeper with nested u-structure for salient object detection. PR 106 (2020), 107404.","journal-title":"PR"},{"key":"e_1_3_1_55_2","volume-title":"CVPR","author":"Ruzon M. A.","year":"2000","unstructured":"M. A. Ruzon and C. Tomasi. 2000. Alpha estimation in natural images. In CVPR."},{"key":"e_1_3_1_56_2","volume-title":"CVPR","author":"Shahrian Ehsan","year":"2013","unstructured":"Ehsan Shahrian, Deepu Rajan, Brian Price, and Scott Cohen. 2013. Improving image matting using comprehensive sampling sets. In CVPR."},{"key":"e_1_3_1_57_2","first-page":"92","volume-title":"ECCV","author":"Shen Xiaoyong","year":"2016","unstructured":"Xiaoyong Shen, Xin Tao, Hongyun Gao, Chao Zhou, and Jiaya Jia. 2016. Deep automatic portrait matting. In ECCV. Springer, 92\u2013107."},{"key":"e_1_3_1_58_2","doi-asserted-by":"publisher","DOI":"10.1145\/1015706.1015721"},{"key":"e_1_3_1_59_2","volume-title":"CVPR","author":"Sun Yanan","year":"2021","unstructured":"Yanan Sun, Chi-Keung Tang, and Yu-Wing Tai. 2021. Semantic image matting. In CVPR."},{"key":"e_1_3_1_60_2","volume-title":"CVPR","author":"Sun Yanan","year":"2022","unstructured":"Yanan Sun, Chi-Keung Tang, and Yu-Wing Tai. 2022. Human instance matting via mutual guidance and multi-instance refinement. In CVPR."},{"key":"e_1_3_1_61_2","first-page":"6975","volume-title":"CVPR","author":"Sun Yanan","year":"2021","unstructured":"Yanan Sun, Guanzhi Wang, Qiao Gu, Chi-Keung Tang, and Yu-Wing Tai. 2021. Deep video matting via spatio-temporal alignment and aggregation. In CVPR. 6975\u20136984."},{"key":"e_1_3_1_62_2","volume-title":"ICIP","author":"Tang Huan","year":"2019","unstructured":"Huan Tang, Yujie Huang, Ming\u2019E. Jing, Yibo Fan, and Xiaoyang Zeng. 2019. Very deep residual network for image matting. In ICIP."},{"key":"e_1_3_1_63_2","volume-title":"CVPR","author":"Tang Jingwei","year":"2019","unstructured":"Jingwei Tang, Yagiz Aksoy, Cengiz Oztireli, Markus Gross, and Tunc Ozan Aydin. 2019. Learning-based sampling for natural image matting. In CVPR."},{"key":"e_1_3_1_64_2","volume-title":"BMVC","author":"Tian Xin","year":"2020","unstructured":"Xin Tian, Ke Xu, Xin Yang, Baocai Yin, and Rynson W. H. Lau. 2020. Weakly-supervised salient instance detection. In BMVC."},{"key":"e_1_3_1_65_2","volume-title":"CVPR","author":"Wang Jue","year":"2007","unstructured":"Jue Wang and M. F. Cohen. 2007. Optimized color sampling for robust matting. In CVPR."},{"key":"e_1_3_1_66_2","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-011-0471-x"},{"key":"e_1_3_1_67_2","first-page":"5968","volume-title":"CVPR","author":"Wang Wenguan","year":"2019","unstructured":"Wenguan Wang, Jianbing Shen, Ming-Ming Cheng, and Ling Shao. 2019. An iterative and cooperative top-down and bottom-up inference network for salient object detection. In CVPR. 5968\u20135977."},{"issue":"11","key":"e_1_3_1_68_2","first-page":"8587","article-title":"SOLO: A simple framework for instance segmentation","volume":"44","author":"Wang Xinlong","year":"2022","unstructured":"Xinlong Wang, Rufeng Zhang, Chunhua Shen, Tao Kong, and Lei Li. 2022. SOLO: A simple framework for instance segmentation. TPAMI 44, 11 (2022), 8587\u20138601.","journal-title":"TPAMI"},{"key":"e_1_3_1_69_2","volume-title":"ECCV","author":"Wu Yuxin","year":"2018","unstructured":"Yuxin Wu and Kaiming He. 2018. Group normalization. In ECCV."},{"key":"e_1_3_1_70_2","volume-title":"CVPR","author":"Xu Ning","year":"2017","unstructured":"Ning Xu, Brian Price, Scott Cohen, and Thomas Huang. 2017. Deep image matting. In CVPR."},{"key":"e_1_3_1_71_2","article-title":"Unified interactive image matting","author":"Yang Stephen D. H.","year":"2022","unstructured":"Stephen D. H. Yang, Bin Wang, Weijia Li, YiQi Lin, and Conghui He. 2022. Unified interactive image matting. arXiv preprint arXiv:2205.08324 (2022).","journal-title":"arXiv preprint arXiv:2205.08324"},{"issue":"4","key":"e_1_3_1_72_2","article-title":"Smart scribbles for image matting","volume":"16","author":"Yang Xin","year":"2020","unstructured":"Xin Yang, Yu Qiao, Shaozhe Chen, Shengfeng He, Baocai Yin, Qiang Zhang, Xiaopeng Wei, and Rynson W. H. Lau. 2020. Smart scribbles for image matting. ACM TOMM 16, 4 (2020).","journal-title":"ACM TOMM"},{"key":"e_1_3_1_73_2","volume-title":"CVPR","author":"Yu Qihang","year":"2021","unstructured":"Qihang Yu, Jianming Zhang, He Zhang, Yilin Wang, Zhe Lin, Ning Xu, Yutong Bai, and Alan Yuille. 2021. Mask guided matting via progressive refinement network. In CVPR."},{"key":"e_1_3_1_74_2","volume-title":"ICCV","author":"Yu Zijian","year":"2021","unstructured":"Zijian Yu, Xuhui Li, Huijuan Huang, Wen Zheng, and Li Chen. 2021. Cascade image matting with deformable graph refinement. In ICCV."},{"key":"e_1_3_1_75_2","volume-title":"CVPR","author":"Zhang Yunke","year":"2019","unstructured":"Yunke Zhang, Lixue Gong, Lubin Fan, Peiran Ren, and Weiwei Xu. 2019. A late fusion CNN for digital matting. In CVPR."},{"key":"e_1_3_1_76_2","first-page":"5128","volume-title":"ACM MM","author":"Zhang Yunke","year":"2021","unstructured":"Yunke Zhang, Chi Wang, Miaomiao Cui, Peiran Ren, Xuansong Xie, Xian-Sheng Hua, Hujun Bao, Qixing Huang, and Weiwei Xu. 2021. Attention-guided temporally coherent video object matting. In ACM MM. 5128\u20135137."},{"key":"e_1_3_1_77_2","first-page":"792","volume-title":"ACM MM","author":"Zhao Jian","year":"2018","unstructured":"Jian Zhao, Jianshu Li, Yu Cheng, Terence Sim, Shuicheng Yan, and Jiashi Feng. 2018. Understanding humans in crowded scenes: Deep nested adversarial learning and a new benchmark for multi-human parsing. In ACM MM. 792\u2013800."},{"key":"e_1_3_1_78_2","volume-title":"ICCV","author":"Zhao Jia-Xing","year":"2019","unstructured":"Jia-Xing Zhao, Jiang-Jiang Liu, Deng-Ping Fan, Yang Cao, Jufeng Yang, and Ming-Ming Cheng. 2019. EGNet: Edge guidance network for salient object detection. In ICCV."},{"key":"e_1_3_1_79_2","volume-title":"ACM MM","author":"Zhu Bingke","year":"2017","unstructured":"Bingke Zhu, Yingying Chen, Jinqiao Wang, Si Liu, Bo Zhang, and Ming Tang. 2017. Fast deep matting for portrait animation on mobile phone. In ACM MM."}],"container-title":["ACM Transactions on Multimedia Computing, Communications, and Applications"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3640017","content-type":"unspecified","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/dl.acm.org\/doi\/pdf\/10.1145\/3640017","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,6,18]],"date-time":"2025-06-18T22:54:02Z","timestamp":1750287242000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3640017"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,3,8]]},"references-count":78,"journal-issue":{"issue":"6","published-print":{"date-parts":[[2024,6,30]]}},"alternative-id":["10.1145\/3640017"],"URL":"https:\/\/doi.org\/10.1145\/3640017","relation":{},"ISSN":["1551-6857","1551-6865"],"issn-type":[{"value":"1551-6857","type":"print"},{"value":"1551-6865","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,3,8]]},"assertion":[{"value":"2023-05-23","order":0,"name":"received","label":"Received","group":{"name":"publication_history","label":"Publication History"}},{"value":"2023-12-26","order":1,"name":"accepted","label":"Accepted","group":{"name":"publication_history","label":"Publication History"}},{"value":"2024-03-08","order":2,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}