{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,9,17]],"date-time":"2025-09-17T16:28:20Z","timestamp":1758126500681,"version":"3.40.3"},"publisher-location":"Singapore","reference-count":41,"publisher":"Springer Nature Singapore","isbn-type":[{"type":"print","value":"9789819609710"},{"type":"electronic","value":"9789819609727"}],"license":[{"start":{"date-parts":[[2024,12,10]],"date-time":"2024-12-10T00:00:00Z","timestamp":1733788800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,12,10]],"date-time":"2024-12-10T00:00:00Z","timestamp":1733788800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2025]]},"DOI":"10.1007\/978-981-96-0972-7_25","type":"book-chapter","created":{"date-parts":[[2024,12,9]],"date-time":"2024-12-09T08:12:26Z","timestamp":1733731946000},"page":"428-444","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":1,"title":["DFIMat: Decoupled Flexible Interactive Matting in\u00a0Multi-person Scenarios"],"prefix":"10.1007","author":[{"ORCID":"https:\/\/orcid.org\/0009-0005-6114-1020","authenticated-orcid":false,"given":"Siyi","family":"Jiao","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-8467-5862","authenticated-orcid":false,"given":"Wenzheng","family":"Zeng","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-2736-3920","authenticated-orcid":false,"given":"Changxin","family":"Gao","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-9167-1496","authenticated-orcid":false,"given":"Nong","family":"Sang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2024,12,10]]},"reference":[{"key":"25_CR1","unstructured":"Achiam, J., Adler, S., Agarwal, S., Ahmad, L., Akkaya, I., Aleman, F.L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et\u00a0al.: Gpt-4 technical report. arXiv preprint arXiv:2303.08774 (2023)"},{"key":"25_CR2","doi-asserted-by":"crossref","unstructured":"Cai, S., Zhang, X., Fan, H., Huang, H., Liu, J., Liu, J., Liu, J., Wang, J., Sun, J.: Disentangled image matting. In: CVPR. pp. 8819\u20138828 (2019)","DOI":"10.1109\/ICCV.2019.00891"},{"key":"25_CR3","doi-asserted-by":"crossref","unstructured":"Chen, Q., Ge, T., Xu, Y., Zhang, Z., Yang, X., Gai, K.: Semantic human matting. In: ACM MM. pp. 618\u2013626 (2018)","DOI":"10.1145\/3240508.3240610"},{"key":"25_CR4","doi-asserted-by":"crossref","unstructured":"Cheng, B., Misra, I., Schwing, A.G., Kirillov, A., Girdhar, R.: Masked-attention mask transformer for universal image segmentation. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition. pp. 1290\u20131299 (2022)","DOI":"10.1109\/CVPR52688.2022.00135"},{"key":"25_CR5","unstructured":"Cheng, H., Xu, S., Jiang, X., Wang, R.: Deep image matting with flexible guidance input. arXiv preprint arXiv:2110.10898 (2021)"},{"key":"25_CR6","doi-asserted-by":"publisher","first-page":"2421","DOI":"10.1109\/TIP.2022.3155958","volume":"31","author":"H Ding","year":"2022","unstructured":"Ding, H., Zhang, H., Liu, C., Jiang, X.: Deep interactive image matting with feature propagation. IEEE Trans. Image Process. 31, 2421\u20132432 (2022)","journal-title":"IEEE Trans. Image Process."},{"key":"25_CR7","doi-asserted-by":"publisher","first-page":"2040","DOI":"10.1109\/TIP.2022.3150295","volume":"31","author":"X Fang","year":"2022","unstructured":"Fang, X., Zhang, S.H., Chen, T., Wu, X., Shamir, A., Hu, S.M.: User-guided deep human image matting using arbitrary trimaps. IEEE Trans. Image Process. 31, 2040\u20132052 (2022)","journal-title":"IEEE Trans. Image Process."},{"key":"25_CR8","doi-asserted-by":"crossref","unstructured":"Hou, Q., Liu, F.: Context-aware image matting for simultaneous foreground and alpha estimation. In: CVPR. pp. 4130\u20134139 (2019)","DOI":"10.1109\/ICCV.2019.00423"},{"key":"25_CR9","doi-asserted-by":"crossref","unstructured":"Kamath, A., Singh, M., LeCun, Y., Synnaeve, G., Misra, I., Carion, N.: Mdetr-modulated detection for end-to-end multi-modal understanding. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision. pp. 1780\u20131790 (2021)","DOI":"10.1109\/ICCV48922.2021.00180"},{"key":"25_CR10","doi-asserted-by":"crossref","unstructured":"Ke, Z., Sun, J., Li, K., Yan, Q., Lau, R.W.: Modnet: Real-time trimap-free portrait matting via objective decomposition. In: AAAI. vol.\u00a036, pp. 1140\u20131147 (2022)","DOI":"10.1609\/aaai.v36i1.19999"},{"key":"25_CR11","doi-asserted-by":"crossref","unstructured":"Khattak, M.U., Rasheed, H., Maaz, M., Khan, S., Khan, F.S.: Maple: Multi-modal prompt learning. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition. pp. 19113\u201319122 (2023)","DOI":"10.1109\/CVPR52729.2023.01832"},{"key":"25_CR12","unstructured":"Kingma, D.P., Ba, J.: Adam: A method for stochastic optimization. arXiv preprint arXiv:1412.6980 (2014)"},{"key":"25_CR13","doi-asserted-by":"crossref","unstructured":"Kirillov, A., Mintun, E., Ravi, N., Mao, H., Rolland, C., Gustafson, L., Xiao, T., Whitehead, S., Berg, A.C., Lo, W.Y., et\u00a0al.: Segment anything. arXiv preprint arXiv:2304.02643 (2023)","DOI":"10.1109\/ICCV51070.2023.00371"},{"key":"25_CR14","doi-asserted-by":"crossref","unstructured":"Li, J., Ma, S., Zhang, J., Tao, D.: Privacy-preserving portrait matting. In: ACM MM. pp. 3501\u20133509 (2021)","DOI":"10.1145\/3474085.3475512"},{"issue":"2","key":"25_CR15","doi-asserted-by":"publisher","first-page":"246","DOI":"10.1007\/s11263-021-01541-0","volume":"130","author":"J Li","year":"2022","unstructured":"Li, J., Zhang, J., Maybank, S.J., Tao, D.: Bridging composite and real: towards end-to-end deep image matting. IJCV 130(2), 246\u2013266 (2022)","journal-title":"IJCV"},{"key":"25_CR16","doi-asserted-by":"crossref","unstructured":"Li, J., Zhang, J., Tao, D.: Deep automatic natural image matting. arXiv preprint arXiv:2107.07235 (2021)","DOI":"10.24963\/ijcai.2021\/111"},{"key":"25_CR17","doi-asserted-by":"crossref","unstructured":"Li, J., Zhang, J., Tao, D.: Referring image matting. In: CVPR. pp. 22448\u201322457 (2023)","DOI":"10.1109\/CVPR52729.2023.02150"},{"key":"25_CR18","doi-asserted-by":"crossref","unstructured":"Li, Y., Lu, H.: Natural image matting via guided contextual attention. In: AAAI. pp. 11450\u201311457 (2020)","DOI":"10.1609\/aaai.v34i07.6809"},{"key":"25_CR19","doi-asserted-by":"crossref","unstructured":"Lin, S., Yang, L., Saleemi, I., Sengupta, S.: Robust high-resolution video matting with temporal guidance. In: Proceedings of the IEEE\/CVF Winter Conference on Applications of Computer Vision. pp. 238\u2013247 (2022)","DOI":"10.1109\/WACV51458.2022.00319"},{"key":"25_CR20","doi-asserted-by":"crossref","unstructured":"Liu, J., Yao, Y., Hou, W., Cui, M., Xie, X., Zhang, C., Hua, X.s.: Boosting semantic human matting with coarse annotations. In: CVPR. pp. 8563\u20138572 (2020)","DOI":"10.1109\/CVPR42600.2020.00859"},{"key":"25_CR21","doi-asserted-by":"crossref","unstructured":"Liu, Y., Xie, J., Shi, X., Qiao, Y., Huang, Y., Tang, Y., Yang, X.: Tripartite information mining and integration for image matting. In: ICCV. pp. 7555\u20137564 (2021)","DOI":"10.1109\/ICCV48922.2021.00746"},{"key":"25_CR22","doi-asserted-by":"crossref","unstructured":"Lu, H., Dai, Y., Shen, C., Xu, S.: Indices matter: Learning to index for deep image matting. In: ICCV. pp. 3266\u20133275 (2019)","DOI":"10.1109\/ICCV.2019.00336"},{"key":"25_CR23","unstructured":"Lutz, S., Amplianitis, K., Smolic, A.: Alphagan: Generative adversarial networks for natural image matting. arXiv preprint arXiv:1807.10088 (2018)"},{"key":"25_CR24","unstructured":"Ma, S., Li, J., Zhang, J., Zhang, H., Tao, D.: Rethinking portrait matting with privacy preserving. IJCV pp. 1\u201326 (2023)"},{"key":"25_CR25","doi-asserted-by":"crossref","unstructured":"Park, G., Son, S., Yoo, J., Kim, S., Kwak, N.: Matteformer: Transformer-based image matting via prior-tokens. In: CVPR. pp. 11696\u201311706 (2022)","DOI":"10.1109\/CVPR52688.2022.01140"},{"key":"25_CR26","doi-asserted-by":"crossref","unstructured":"Qiao, Y., Liu, Y., Yang, X., Zhou, D., Xu, M., Zhang, Q., Wei, X.: Attention-guided hierarchical structure aggregation for image matting. In: CVPR. pp. 13676\u201313685 (2020)","DOI":"10.1109\/CVPR42600.2020.01369"},{"key":"25_CR27","doi-asserted-by":"crossref","unstructured":"Rombach, R., Blattmann, A., Lorenz, D., Esser, P., Ommer, B.: High-resolution image synthesis with latent diffusion models. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition. pp. 10684\u201310695 (2022)","DOI":"10.1109\/CVPR52688.2022.01042"},{"key":"25_CR28","first-page":"36479","volume":"35","author":"C Saharia","year":"2022","unstructured":"Saharia, C., Chan, W., Saxena, S., Li, L., Whang, J., Denton, E.L., Ghasemipour, K., Gontijo Lopes, R., Karagol Ayan, B., Salimans, T., et al.: Photorealistic text-to-image diffusion models with deep language understanding. Adv. Neural. Inf. Process. Syst. 35, 36479\u201336494 (2022)","journal-title":"Adv. Neural. Inf. Process. Syst."},{"key":"25_CR29","doi-asserted-by":"crossref","unstructured":"Shahrian, E., Rajan, D., Price, B., Cohen, S.: Improving image matting using comprehensive sampling sets. In: CVPR. pp. 636\u2013643 (2013)","DOI":"10.1109\/CVPR.2013.88"},{"key":"25_CR30","doi-asserted-by":"crossref","unstructured":"Sun, Y., Tang, C.K., Tai, Y.W.: Human instance matting via mutual guidance and multi-instance refinement. In: CVPR. pp. 2647\u20132656 (2022)","DOI":"10.1109\/CVPR52688.2022.00267"},{"key":"25_CR31","doi-asserted-by":"crossref","unstructured":"Tang, J., Aksoy, Y., Oztireli, C., Gross, M., Aydin, T.O.: Learning-based sampling for natural image matting. In: CVPR. pp. 3055\u20133063 (2019)","DOI":"10.1109\/CVPR.2019.00317"},{"key":"25_CR32","doi-asserted-by":"crossref","unstructured":"Wei, T., Chen, D., Zhou, W., Liao, J., Zhao, H., Zhang, W., Yu, N.: Improved image matting via real-time user clicks and uncertainty estimation. In: CVPR. pp. 15374\u201315383 (2021)","DOI":"10.1109\/CVPR46437.2021.01512"},{"key":"25_CR33","unstructured":"Wu, W., Zhao, Y., Chen, H., Gu, Y., Zhao, R., He, Y., Zhou, H., Shou, M.Z., Shen, C.: Datasetdm: Synthesizing data with perception annotations using diffusion models. arXiv preprint arXiv:2308.06160 (2023)"},{"key":"25_CR34","doi-asserted-by":"crossref","unstructured":"Xu, N., Price, B., Cohen, S., Huang, T.: Deep image matting. In: CVPR. pp. 2970\u20132979 (2017)","DOI":"10.1109\/CVPR.2017.41"},{"key":"25_CR35","doi-asserted-by":"crossref","unstructured":"Yang, X., Qiao, Y., Chen, S., He, S., Yin, B., Zhang, Q., Wei, X., Lau, R.W.: Smart scribbles for image matting. ACM Transactions on Multimedia Computing, Communications, and Applications (TOMM) 16(4), 1\u201321 (2020)","DOI":"10.1145\/3408323"},{"key":"25_CR36","unstructured":"Yang, X., Xu, K., Chen, S., He, S., Yin, B.Y., Lau, R.: Active matting. Advances in Neural Information Processing Systems 31 (2018)"},{"key":"25_CR37","doi-asserted-by":"crossref","unstructured":"Yao, J., Wang, X., Ye, L., Liu, W.: Matte anything: Interactive natural image matting with segment anything model. Image and Vision Computing p. 105067 (2024)","DOI":"10.1016\/j.imavis.2024.105067"},{"key":"25_CR38","doi-asserted-by":"crossref","unstructured":"Yu, Q., Zhang, J., Zhang, H., Wang, Y., Lin, Z., Xu, N., Bai, Y., Yuille, A.: Mask guided matting via progressive refinement network. In: CVPR. pp. 1154\u20131163 (2021)","DOI":"10.1109\/CVPR46437.2021.00121"},{"key":"25_CR39","doi-asserted-by":"crossref","unstructured":"Zhang, Y., Gong, L., Fan, L., Ren, P., Huang, Q., Bao, H., Xu, W.: A late fusion cnn for digital matting. In: CVPR. pp. 7469\u20137478 (2019)","DOI":"10.1109\/CVPR.2019.00765"},{"key":"25_CR40","doi-asserted-by":"crossref","unstructured":"Zou, X., Dou, Z.Y., Yang, J., Gan, Z., Li, L., Li, C., Dai, X., Behl, H., Wang, J., Yuan, L., et\u00a0al.: Generalized decoding for pixel, image, and language. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition. pp. 15116\u201315127 (2023)","DOI":"10.1109\/CVPR52729.2023.01451"},{"key":"25_CR41","unstructured":"Zou, X., Yang, J., Zhang, H., Li, F., Li, L., Gao, J., Lee, Y.J.: Segment everything everywhere all at once. arXiv preprint arXiv:2304.06718 (2023)"}],"container-title":["Lecture Notes in Computer Science","Computer Vision \u2013 ACCV 2024"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-981-96-0972-7_25","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,12,9]],"date-time":"2024-12-09T09:11:00Z","timestamp":1733735460000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-981-96-0972-7_25"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,12,10]]},"ISBN":["9789819609710","9789819609727"],"references-count":41,"URL":"https:\/\/doi.org\/10.1007\/978-981-96-0972-7_25","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"type":"print","value":"0302-9743"},{"type":"electronic","value":"1611-3349"}],"subject":[],"published":{"date-parts":[[2024,12,10]]},"assertion":[{"value":"10 December 2024","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ACCV","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Asian Conference on Computer Vision","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Hanoi","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Vietnam","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2024","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"8 December 2024","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"12 December 2024","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"17","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"accv2024","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}