{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,12,10]],"date-time":"2025-12-10T04:07:02Z","timestamp":1765339622377,"version":"3.46.0"},"publisher-location":"New York, NY, USA","reference-count":24,"publisher":"ACM","funder":[{"DOI":"10.13039\/501100012166","name":"National Key Research and Development Program of China","doi-asserted-by":"publisher","award":["2024YFE0203200"],"award-info":[{"award-number":["2024YFE0203200"]}],"id":[{"id":"10.13039\/501100012166","id-type":"DOI","asserted-by":"publisher"}]},{"name":"National Nature Science Foundation of China","award":["U24A20329"],"award-info":[{"award-number":["U24A20329"]}]}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2025,10,27]]},"DOI":"10.1145\/3746027.3754470","type":"proceedings-article","created":{"date-parts":[[2025,10,25]],"date-time":"2025-10-25T06:54:15Z","timestamp":1761375255000},"page":"13507-13509","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":0,"title":["Edit-by-Example: Adaptive Exemplar-Based Image Editing"],"prefix":"10.1145","author":[{"ORCID":"https:\/\/orcid.org\/0009-0005-1937-658X","authenticated-orcid":false,"given":"Yaojie","family":"Li","sequence":"first","affiliation":[{"name":"University of Science and Technology of China, Hefei, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-1940-6137","authenticated-orcid":false,"given":"Yiheng","family":"Zhang","sequence":"additional","affiliation":[{"name":"HiDream.ai, Beijing, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-7485-9198","authenticated-orcid":false,"given":"Zhaofan","family":"Qiu","sequence":"additional","affiliation":[{"name":"HiDream.ai, Beijing, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-4344-8898","authenticated-orcid":false,"given":"Yingwei","family":"Pan","sequence":"additional","affiliation":[{"name":"HiDream.ai, Beijing, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-1633-7575","authenticated-orcid":false,"given":"Wu","family":"Liu","sequence":"additional","affiliation":[{"name":"University of Science and Technology of China, Hefei, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-7587-101X","authenticated-orcid":false,"given":"Ting","family":"Yao","sequence":"additional","affiliation":[{"name":"HiDream.ai, Beijing, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-5990-7307","authenticated-orcid":false,"given":"Tao","family":"Mei","sequence":"additional","affiliation":[{"name":"HiDream.ai, Beijing, China"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"320","published-online":{"date-parts":[[2025,10,27]]},"reference":[{"key":"e_1_3_2_1_1_1","volume-title":"Gradio: Hassle-Free Sharing and Testing of ML Models in the Wild. arXiv preprint arXiv:1906.02569","author":"Abid Abubakar","year":"2019","unstructured":"Abubakar Abid, Ali Abdalla, Ali Abid, Dawood Khan, Abdulrahman Alfozan, and James Zou. 2019. Gradio: Hassle-Free Sharing and Testing of ML Models in the Wild. arXiv preprint arXiv:1906.02569 (2019)."},{"key":"e_1_3_2_1_2_1","unstructured":"Shuai Bai Keqin Chen Xuejing Liu Jialin Wang Wenbin Ge Sibo Song Kai Dang Peng Wang Shijie Wang Jun Tang et al. 2025. Qwen2. 5-vl technical report. arXiv preprint arXiv:2502.13923 (2025)."},{"key":"e_1_3_2_1_3_1","unstructured":"Amir Bar Yossi Gandelsman Trevor Darrell Amir Globerson and Alexei Efros. 2022. Visual prompting via image inpainting. In NeurIPS."},{"key":"e_1_3_2_1_4_1","doi-asserted-by":"crossref","unstructured":"Tim Brooks Aleksander Holynski and Alexei A Efros. 2023. Instructpix2pix: Learning to follow image editing instructions. In CVPR.","DOI":"10.1109\/CVPR52729.2023.01764"},{"key":"e_1_3_2_1_5_1","doi-asserted-by":"crossref","unstructured":"Qi Cai Jingwen Chen Yang Chen Yehao Li Fuchen Long Yingwei Pan Zhaofan Qiu Yiheng Zhang Fengbin Gao Peihan Xu et al. 2025. HiDream-I1: A High-Efficient Image Generative Foundation Model with Sparse Diffusion Transformer. arXiv preprint arXiv:2505.22705 (2025).","DOI":"10.1145\/3746027.3756870"},{"key":"e_1_3_2_1_6_1","volume-title":"Lomoe: Localized multi-object editing via multi-diffusion. In ACM MM.","author":"Chakrabarty Goirik","year":"2024","unstructured":"Goirik Chakrabarty, Aditya Chandrasekar, Ramya Hebbalaguppe, and Prathosh AP. 2024. Lomoe: Localized multi-object editing via multi-diffusion. In ACM MM."},{"key":"e_1_3_2_1_7_1","volume-title":"Bert: Pre-training of deep bidirectional transformers for language understanding. In NAACL.","author":"Devlin Jacob","year":"2019","unstructured":"Jacob Devlin, Ming-Wei Chang, Kenton Lee, and Kristina Toutanova. 2019. Bert: Pre-training of deep bidirectional transformers for language understanding. In NAACL."},{"key":"e_1_3_2_1_8_1","volume-title":"Analogist: Out-of-the-box visual in-context learning with image diffusion model. ACM Trans. Graph.","author":"Gu Zheng","year":"2024","unstructured":"Zheng Gu, Shiyuan Yang, Jing Liao, Jing Huo, and Yang Gao. 2024. Analogist: Out-of-the-box visual in-context learning with image diffusion model. ACM Trans. Graph. (2024)."},{"key":"e_1_3_2_1_9_1","volume-title":"ACE: All-round Creator and Editor","author":"Han Zhen","year":"2025","unstructured":"Zhen Han, Zeyinzi Jiang, Yulin Pan, Jingfeng Zhang, Chaojie Mao, Chen-Wei Xie, Yu Liu, and Jingren Zhou. 2025. ACE: All-round Creator and Editor Following Instructions via Diffusion Transformer. In ICLR."},{"key":"e_1_3_2_1_10_1","doi-asserted-by":"crossref","unstructured":"Alexander Kirillov Eric Mintun Nikhila Ravi Hanzi Mao Chloe Rolland Laura Gustafson Tete Xiao Spencer Whitehead Alexander C Berg Wan-Yen Lo et al. 2023. Segment anything. In ICCV.","DOI":"10.1109\/ICCV51070.2023.00371"},{"key":"e_1_3_2_1_11_1","doi-asserted-by":"crossref","unstructured":"Bolin Lai Felix Juefei-Xu Miao Liu Xiaoliang Dai Nikhil Mehta Chenguang Zhu Zeyi Huang James M. Rehg Sangmin Lee Ning Zhang and Tong Xiao. 2025. Unleashing In-context Learning of Autoregressive Models for Few-shot Image Manipulation. In CVPR.","DOI":"10.1109\/CVPR52734.2025.01710"},{"key":"e_1_3_2_1_12_1","unstructured":"Bingyan Liu Chengyu Wang Jun Huang and Kui Jia. 2024b. Attentive Linguistic Tracking in Diffusion Models for Training-free Text-guided Image Editing. In ACM MM."},{"key":"e_1_3_2_1_13_1","unstructured":"Shilong Liu Zhaoyang Zeng Tianhe Ren Feng Li Hao Zhang Jie Yang Qing Jiang Chunyuan Li Jianwei Yang Hang Su et al. 2024c. Grounding dino: Marrying dino with grounded pre-training for open-set object detection. In ECCV."},{"key":"e_1_3_2_1_14_1","volume-title":"Lmagent: A large-scale multimodal agents society for multi-user simulation. arXiv preprint arXiv:2412.09237","author":"Liu Yijun","year":"2024","unstructured":"Yijun Liu, Wu Liu, Xiaoyan Gu, Yong Rui, Xiaodong He, and Yongdong Zhang. 2024a. Lmagent: A large-scale multimodal agents society for multi-user simulation. arXiv preprint arXiv:2412.09237 (2024)."},{"key":"e_1_3_2_1_15_1","volume-title":"Freeenhance: Tuning-free image enhancement via content-consistent noising-and-denoising process. In ACM MM.","author":"Luo Yang","year":"2024","unstructured":"Yang Luo, Yiheng Zhang, Zhaofan Qiu, Ting Yao, Zhineng Chen, Yu-Gang Jiang, and Tao Mei. 2024. Freeenhance: Tuning-free image enhancement via content-consistent noising-and-denoising process. In ACM MM."},{"key":"e_1_3_2_1_16_1","volume-title":"Instructgie: Towards generalizable image editing. In ECCV.","author":"Meng Zichong","year":"2024","unstructured":"Zichong Meng, Changdi Yang, Jun Liu, Hao Tang, Pu Zhao, and Yanzhi Wang. 2024. Instructgie: Towards generalizable image editing. In ECCV."},{"key":"e_1_3_2_1_17_1","doi-asserted-by":"crossref","unstructured":"Shelly Sheynin Adam Polyak Uriel Singer Yuval Kirstain Amit Zohar Oron Ashual Devi Parikh and Yaniv Taigman. 2024. Emu edit: Precise image editing via recognition and generation tasks. In CVPR.","DOI":"10.1109\/CVPR52733.2024.00847"},{"key":"e_1_3_2_1_18_1","volume-title":"Abhinav Java, Avadhoot Jadhav, Silky Singh, Surgan Jandial, and Balaji Krishnamurthy.","author":"Srivastava Ashutosh","year":"2025","unstructured":"Ashutosh Srivastava, Tarun Ram Menta, Abhinav Java, Avadhoot Jadhav, Silky Singh, Surgan Jandial, and Balaji Krishnamurthy. 2025. REEDIT: Multimodal Exemplar-Based Image Editing. In WACV."},{"key":"e_1_3_2_1_19_1","unstructured":"Zhendong Wang Yifan Jiang Yadong Lu Pengcheng He Weizhu Chen Zhangyang Wang Mingyuan Zhou et al. 2023. In-context learning unlocked for diffusion models. In NeurIPS."},{"key":"e_1_3_2_1_20_1","unstructured":"Qifan Yu Wei Chow Zhongqi Yue Kaihang Pan Yang Wu Xiaoyang Wan Juncheng Li Siliang Tang Hanwang Zhang and Yueting Zhuang. 2025. AnyEdit: Mastering Unified High-Quality Image Editing for Any Idea. In CVPR."},{"key":"e_1_3_2_1_21_1","volume-title":"Magicbrush: A manually annotated dataset for instruction-guided image editing. In NeurIPS.","author":"Zhang Kai","year":"2023","unstructured":"Kai Zhang, Lingbo Mo, Wenhu Chen, Huan Sun, and Yu Su. 2023. Magicbrush: A manually annotated dataset for instruction-guided image editing. In NeurIPS."},{"key":"e_1_3_2_1_22_1","volume-title":"Hive: Harnessing human feedback for instructional visual editing. In CVPR.","author":"Zhang Shu","year":"2024","unstructured":"Shu Zhang, Xinyi Yang, Yihao Feng, Can Qin, Chia-Chih Chen, Ning Yu, Zeyuan Chen, Huan Wang, Silvio Savarese, Stefano Ermon, et al., 2024. Hive: Harnessing human feedback for instructional visual editing. In CVPR."},{"key":"e_1_3_2_1_23_1","doi-asserted-by":"crossref","unstructured":"Zhongwei Zhang Fuchen Long Zhaofan Qiu Yingwei Pan Wu Liu Ting Yao and Tao Mei. 2025. MotionPro: A Precise Motion Controller for Image-to-Video Generation. In CVPR.","DOI":"10.1109\/CVPR52734.2025.02603"},{"key":"e_1_3_2_1_24_1","volume-title":"Liang Chen, Shuzheng Si, Rujie Wu, Kaikai An, Peiyu Yu, Minjia Zhang, Qing Li, and Baobao Chang.","author":"Zhao Haozhe","year":"2024","unstructured":"Haozhe Zhao, Xiaojian Shawn Ma, Liang Chen, Shuzheng Si, Rujie Wu, Kaikai An, Peiyu Yu, Minjia Zhang, Qing Li, and Baobao Chang. 2024. Ultraedit: Instruction-based fine-grained image editing at scale. In NeurIPS."}],"event":{"name":"MM '25: The 33rd ACM International Conference on Multimedia","sponsor":["SIGMM ACM Special Interest Group on Multimedia"],"location":"Dublin Ireland","acronym":"MM '25"},"container-title":["Proceedings of the 33rd ACM International Conference on Multimedia"],"original-title":[],"link":[{"URL":"https:\/\/dl.acm.org\/doi\/pdf\/10.1145\/3746027.3754470","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,12,10]],"date-time":"2025-12-10T04:03:34Z","timestamp":1765339414000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3746027.3754470"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,10,27]]},"references-count":24,"alternative-id":["10.1145\/3746027.3754470","10.1145\/3746027"],"URL":"https:\/\/doi.org\/10.1145\/3746027.3754470","relation":{},"subject":[],"published":{"date-parts":[[2025,10,27]]},"assertion":[{"value":"2025-10-27","order":3,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}