{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,8,21]],"date-time":"2025-08-21T16:49:22Z","timestamp":1755794962434,"version":"3.44.0"},"publisher-location":"New York, NY, USA","reference-count":41,"publisher":"ACM","license":[{"start":{"date-parts":[[2025,7,20]],"date-time":"2025-07-20T00:00:00Z","timestamp":1752969600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.acm.org\/publications\/policies\/copyright_policy#Background"}],"funder":[{"name":"China NSF grant","award":["62025204, 62202296, 62272293"],"award-info":[{"award-number":["62025204, 62202296, 62272293"]}]},{"name":"Tencent WeChat Research Program"},{"name":"SJTU-Huawei Explore X Gift Fund"},{"name":"National Key R\\&D Program of China","award":["2022ZD0119100"],"award-info":[{"award-number":["2022ZD0119100"]}]}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2025,7,20]]},"DOI":"10.1145\/3690624.3709211","type":"proceedings-article","created":{"date-parts":[[2025,4,4]],"date-time":"2025-04-04T18:48:32Z","timestamp":1743792512000},"page":"224-235","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":0,"title":["Personalized Language Model Learning on Text Data Without User Identifiers"],"prefix":"10.1145","author":[{"ORCID":"https:\/\/orcid.org\/0000-0001-6095-4947","authenticated-orcid":false,"given":"Yucheng","family":"Ding","sequence":"first","affiliation":[{"name":"Shanghai Jiao Tong University, Shanghai, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0009-0006-4711-7777","authenticated-orcid":false,"given":"Yangwenjian","family":"Tan","sequence":"additional","affiliation":[{"name":"Shanghai Jiao Tong University, Shanghai, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-1092-2864","authenticated-orcid":false,"given":"Xiangyu","family":"Liu","sequence":"additional","affiliation":[{"name":"WeChat AI, Tencent, Beijing, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-1650-4233","authenticated-orcid":false,"given":"Chaoyue","family":"Niu","sequence":"additional","affiliation":[{"name":"Shanghai Jiao Tong University, Shanghai, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-8158-2377","authenticated-orcid":false,"given":"Fandong","family":"Meng","sequence":"additional","affiliation":[{"name":"WeChat AI, Tencent Inc., Beijing, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-5899-5165","authenticated-orcid":false,"given":"Jie","family":"Zhou","sequence":"additional","affiliation":[{"name":"WeChat AI, Tencent Inc., Beijing, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-6204-1313","authenticated-orcid":false,"given":"Ning","family":"Liu","sequence":"additional","affiliation":[{"name":"Shanghai Jiao Tong University, Shanghai, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-0965-9058","authenticated-orcid":false,"given":"Fan","family":"Wu","sequence":"additional","affiliation":[{"name":"Shanghai Jiao Tong University, Shanghai, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-6934-1685","authenticated-orcid":false,"given":"Guihai","family":"Chen","sequence":"additional","affiliation":[{"name":"Shanghai Jiao Tong University, Shanghai, China"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"320","published-online":{"date-parts":[[2025,7,20]]},"reference":[{"key":"e_1_3_2_2_1_1","unstructured":"Apple. 2017. Deep Learning for Siri's Voice: On-device Deep Mixture Density Networks for Hybrid Unit Selection Synthesis. https:\/\/machinelearning.apple.com\/research\/siri-voices"},{"key":"e_1_3_2_2_2_1","doi-asserted-by":"publisher","DOI":"10.26483\/ijarcs.v8i7.4225"},{"key":"e_1_3_2_2_3_1","volume-title":"LEAF: A Benchmark for Federated Settings. CoRR","author":"Caldas Sebastian","year":"2018","unstructured":"Sebastian Caldas, Peter Wu, Tian Li, Jakub Kone\u010dn\u00fd, H. Brendan McMahan, Virginia Smith, and Ameet Talwalkar. 2018. LEAF: A Benchmark for Federated Settings. CoRR, Vol. abs\/1812.01097 (2018)."},{"key":"e_1_3_2_2_4_1","volume-title":"EMNLP\/IJCNLP (1)","author":"Chan Zhangming","year":"1931","unstructured":"Zhangming Chan, Juntao Li, Xiaopeng Yang, Xiuying Chen, Wenpeng Hu, Dongyan Zhao, and Rui Yan. 2019. Modeling Personalization in Continuous Space for Response Generation via Augmented Wasserstein Autoencoders. In EMNLP\/IJCNLP (1). Association for Computational Linguistics, 1931--1940."},{"key":"e_1_3_2_2_5_1","doi-asserted-by":"crossref","unstructured":"Bo Chen Yichao Wang Zhirong Liu Ruiming Tang Wei Guo Hongkun Zheng Weiwei Yao Muyu Zhang and Xiuqiang He. 2021. Enhancing Explicit and Implicit Feature Interactions via Information Sharing for Parallel Deep CTR Models. In CIKM. ACM 3757--3766.","DOI":"10.1145\/3459637.3481915"},{"key":"e_1_3_2_2_6_1","volume-title":"Rajiv Mathews, Adeline Wong, Cyril Allauzen, Fran\u00e7oise Beaufays, and Michael Riley.","author":"Chen Mingqing","year":"2019","unstructured":"Mingqing Chen, Ananda Theertha Suresh, Rajiv Mathews, Adeline Wong, Cyril Allauzen, Fran\u00e7oise Beaufays, and Michael Riley. 2019. Federated Learning of N-Gram Language Models. In CoNLL. Association for Computational Linguistics, 121--130."},{"volume-title":"ACL (1)","author":"Cheng Hao","key":"e_1_3_2_2_7_1","unstructured":"Hao Cheng, Shuo Wang, Wensheng Lu, Wei Zhang, Mingyang Zhou, Kezhong Lu, and Hao Liao. 2023. Explainable Recommendation with Personalized Review Retrieval and Aspect Learning. In ACL (1). Association for Computational Linguistics, 51--64."},{"key":"e_1_3_2_2_8_1","volume-title":"ICML (Proceedings of Machine Learning Research","volume":"2099","author":"Collins Liam","year":"2021","unstructured":"Liam Collins, Hamed Hassani, Aryan Mokhtari, and Sanjay Shakkottai. 2021. Exploiting Shared Representations for Personalized Federated Learning. In ICML (Proceedings of Machine Learning Research, Vol. 139). PMLR, 2089--2099."},{"key":"e_1_3_2_2_9_1","volume-title":"Mohammad Mahdi Kamani, and Mehrdad Mahdavi","author":"Deng Yuyang","year":"2020","unstructured":"Yuyang Deng, Mohammad Mahdi Kamani, and Mehrdad Mahdavi. 2020. Adaptive Personalized Federated Learning. CoRR, Vol. abs\/2003.13461 (2020)."},{"key":"e_1_3_2_2_10_1","volume-title":"Generative Input: Towards Next-Generation Input Methods Paradigm. CoRR","author":"Ding Keyu","year":"2023","unstructured":"Keyu Ding, Yongcan Wang, Zihang Xu, Zhenzhen Jia, Shijin Wang, Cong Liu, and Enhong Chen. 2023. Generative Input: Towards Next-Generation Input Methods Paradigm. CoRR, Vol. abs\/2311.01166 (2023)."},{"key":"e_1_3_2_2_11_1","volume-title":"Ozdaglar","author":"Fallah Alireza","year":"2020","unstructured":"Alireza Fallah, Aryan Mokhtari, and Asuman E. Ozdaglar. 2020. Personalized Federated Learning with Theoretical Guarantees: A Model-Agnostic Meta-Learning Approach. In NeurIPS."},{"key":"e_1_3_2_2_12_1","first-page":"2009","article-title":"Twitter sentiment classification using distant supervision. CS224N project report","volume":"1","author":"Go Alec","year":"2009","unstructured":"Alec Go, Richa Bhayani, and Lei Huang. 2009. Twitter sentiment classification using distant supervision. CS224N project report, Stanford, Vol. 1, 12 (2009), 2009.","journal-title":"Stanford"},{"key":"e_1_3_2_2_13_1","unstructured":"Google. 2024. https:\/\/assistant.google.com\/. https:\/\/assistant.google.com\/"},{"key":"e_1_3_2_2_14_1","doi-asserted-by":"crossref","unstructured":"Huifeng Guo Ruiming Tang Yunming Ye Zhenguo Li and Xiuqiang He. 2017. DeepFM: A Factorization-Machine based Neural Network for CTR Prediction. In IJCAI. ijcai.org 1725--1731.","DOI":"10.24963\/ijcai.2017\/239"},{"key":"e_1_3_2_2_15_1","volume-title":"Federated Learning for Mobile Keyboard Prediction. CoRR","author":"Hard Andrew","year":"2018","unstructured":"Andrew Hard, Kanishka Rao, Rajiv Mathews, Fran\u00e7oise Beaufays, Sean Augenstein, Hubert Eichner, Chlo\u00e9 Kiddon, and Daniel Ramage. 2018. Federated Learning for Mobile Keyboard Prediction. CoRR, Vol. abs\/1811.03604 (2018)."},{"key":"e_1_3_2_2_16_1","volume-title":"McAuley","author":"Hou Yupeng","year":"2024","unstructured":"Yupeng Hou, Jiacheng Li, Zhankui He, An Yan, Xiusi Chen, and Julian J. McAuley. 2024. Bridging Language and Items for Retrieval and Recommendation. CoRR, Vol. abs\/2403.03952 (2024)."},{"key":"e_1_3_2_2_17_1","volume-title":"ICML (Proceedings of Machine Learning Research","volume":"5143","author":"Karimireddy Sai Praneeth","year":"2020","unstructured":"Sai Praneeth Karimireddy, Satyen Kale, Mehryar Mohri, Sashank J. Reddi, Sebastian U. Stich, and Ananda Theertha Suresh. 2020. SCAFFOLD: Stochastic Controlled Averaging for Federated Learning. In ICML (Proceedings of Machine Learning Research, Vol. 119). PMLR, 5132--5143."},{"key":"e_1_3_2_2_18_1","volume-title":"Kingma and Max Welling","author":"Diederik","year":"2014","unstructured":"Diederik P. Kingma and Max Welling. 2014. Auto-Encoding Variational Bayes. In ICLR."},{"volume-title":"EMNLP (1)","author":"Lester Brian","key":"e_1_3_2_2_19_1","unstructured":"Brian Lester, Rami Al-Rfou, and Noah Constant. 2021. The Power of Scale for Parameter-Efficient Prompt Tuning. In EMNLP (1). Association for Computational Linguistics, 3045--3059."},{"key":"e_1_3_2_2_20_1","volume-title":"BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","author":"Lewis Mike","year":"2020","unstructured":"Mike Lewis, Yinhan Liu, Naman Goyal, Marjan Ghazvininejad, Abdelrahman Mohamed, Omer Levy, Veselin Stoyanov, and Luke Zettlemoyer. 2020. BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension. In ACL. Association for Computational Linguistics, 7871--7880."},{"key":"e_1_3_2_2_21_1","volume-title":"Dolan","author":"Li Jiwei","year":"2016","unstructured":"Jiwei Li, Michel Galley, Chris Brockett, Georgios P. Spithourakis, Jianfeng Gao, and William B. Dolan. 2016. A Persona-Based Neural Conversation Model. In ACL (1). The Association for Computer Linguistics."},{"key":"e_1_3_2_2_22_1","volume-title":"Think Locally","author":"Liang Paul Pu","year":"2020","unstructured":"Paul Pu Liang, Terrance Liu, Ziyin Liu, Ruslan Salakhutdinov, and Louis-Philippe Morency. 2020. Think Locally, Act Globally: Federated Learning with Local and Global Representations. CoRR, Vol. abs\/2001.01523 (2020)."},{"key":"e_1_3_2_2_23_1","volume-title":"RECAP: Retrieval-Enhanced Context-Aware Prefix Encoder for Personalized Dialogue Response Generation. In ACL (1)","author":"Liu Shuai","year":"2023","unstructured":"Shuai Liu, Hyundong Cho, Marjorie Freedman, Xuezhe Ma, and Jonathan May. 2023. RECAP: Retrieval-Enhanced Context-Aware Prefix Encoder for Personalized Dialogue Response Generation. In ACL (1). Association for Computational Linguistics, 8404--8419."},{"key":"e_1_3_2_2_24_1","volume-title":"AISTATS (Proceedings of Machine Learning Research","volume":"1282","author":"McMahan Brendan","year":"2017","unstructured":"Brendan McMahan, Eider Moore, Daniel Ramage, Seth Hampson, and Blaise Ag\u00fcera y Arcas. 2017. Communication-Efficient Learning of Deep Networks from Decentralized Data. In AISTATS (Proceedings of Machine Learning Research, Vol. 54). PMLR, 1273--1282."},{"key":"e_1_3_2_2_25_1","unstructured":"H. Brendan McMahan Daniel Ramage Kunal Talwar and Li Zhang. 2018. Learning Differentially Private Recurrent Language Models. In ICLR (Poster). OpenReview.net."},{"volume-title":"Product-Based Neural Networks for User Response Prediction","author":"Qu Yanru","key":"e_1_3_2_2_26_1","unstructured":"Yanru Qu, Han Cai, Kan Ren, Weinan Zhang, Yong Yu, Ying Wen, and Jun Wang. 2016. Product-Based Neural Networks for User Response Prediction. In ICDM. IEEE Computer Society, 1149--1154."},{"key":"e_1_3_2_2_27_1","unstructured":"Alec Radford Jeffrey Wu Rewon Child David Luan Dario Amodei Ilya Sutskever et al. 2019. Language models are unsupervised multitask learners. OpenAI blog Vol. 1 8 (2019) 9."},{"key":"e_1_3_2_2_28_1","article-title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","volume":"21","author":"Raffel Colin","year":"2020","unstructured":"Colin Raffel, Noam Shazeer, Adam Roberts, Katherine Lee, Sharan Narang, Michael Matena, Yanqi Zhou, Wei Li, and Peter J. Liu. 2020. Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer. J. Mach. Learn. Res., Vol. 21 (2020), 140:1--140:67.","journal-title":"J. Mach. Learn. Res."},{"key":"e_1_3_2_2_29_1","volume-title":"ACL (1)","author":"Tan Minghuan","year":"1899","unstructured":"Minghuan Tan, Yong Dai, Duyu Tang, Zhangyin Feng, Guoping Huang, Jing Jiang, Jiwei Li, and Shuming Shi. 2022. Exploring and Adapting Chinese GPT to Pinyin Input Method. In ACL (1). Association for Computational Linguistics, 1899--1909."},{"key":"e_1_3_2_2_30_1","doi-asserted-by":"crossref","unstructured":"Hongyan Tang Junning Liu Ming Zhao and Xudong Gong. 2020. Progressive Layered Extraction (PLE): A Novel Multi-Task Learning (MTL) Model for Personalized Recommendations. In RecSys. ACM 269--278.","DOI":"10.1145\/3383313.3412236"},{"key":"e_1_3_2_2_31_1","unstructured":"Duolingo Team. 2023. Introducing Duolingo Max a learning experience powered by GPT-4. https:\/\/blog.duolingo.com\/duolingo-max\/"},{"key":"e_1_3_2_2_32_1","volume-title":"Identifiability of finite mixtures. The annals of Mathematical statistics","author":"Teicher Henry","year":"1963","unstructured":"Henry Teicher. 1963. Identifiability of finite mixtures. The annals of Mathematical statistics (1963), 1265--1269."},{"volume-title":"Facebook messenger bots and their application for business. In 2016 24th Telecommunications Forum (TELFOR)","author":"Vukovic Dijana R","key":"e_1_3_2_2_33_1","unstructured":"Dijana R Vukovic and Igor M Dujlovic. 2016. Facebook messenger bots and their application for business. In 2016 24th Telecommunications Forum (TELFOR). IEEE, 1--4."},{"key":"e_1_3_2_2_34_1","volume-title":"Personalized Response Generation via Generative Split Memory Network","author":"Wu Yuwei","year":"1956","unstructured":"Yuwei Wu, Xuezhe Ma, and Diyi Yang. 2021. Personalized Response Generation via Generative Split Memory Network. In NAACL-HLT. Association for Computational Linguistics, 1956--1970."},{"key":"e_1_3_2_2_35_1","doi-asserted-by":"publisher","DOI":"10.1145\/3287075"},{"key":"e_1_3_2_2_36_1","doi-asserted-by":"publisher","DOI":"10.1214\/aoms\/1177698520"},{"volume-title":"Personalization Disentanglement for Federated Learning","author":"Yan Peng","key":"e_1_3_2_2_37_1","unstructured":"Peng Yan and Guodong Long. 2023. Personalization Disentanglement for Federated Learning. In ICME. IEEE, 318--323."},{"key":"e_1_3_2_2_38_1","doi-asserted-by":"crossref","unstructured":"Yikai Yan Chaoyue Niu Renjie Gu Fan Wu Shaojie Tang Lifeng Hua Chengfei Lyu and Guihai Chen. 2022. On-Device Learning for Model Personalization with Large-Scale Cloud-Coordinated Domain Adaption. In KDD. ACM 2180--2190.","DOI":"10.1145\/3534678.3539263"},{"key":"e_1_3_2_2_39_1","volume-title":"ICML (Proceedings of Machine Learning Research","volume":"26310","author":"Zhang Xu","year":"2022","unstructured":"Xu Zhang, Yinchuan Li, Wenpeng Li, Kaiyang Guo, and Yunfeng Shao. 2022. Personalized Federated Learning via Variational Bayesian Inference. In ICML (Proceedings of Machine Learning Research, Vol. 162). PMLR, 26293--26310."},{"key":"e_1_3_2_2_40_1","doi-asserted-by":"crossref","unstructured":"Guorui Zhou Xiaoqiang Zhu Chengru Song Ying Fan Han Zhu Xiao Ma Yanghui Yan Junqi Jin Han Li and Kun Gai. 2018. Deep Interest Network for Click-Through Rate Prediction. In KDD. ACM 1059--1068.","DOI":"10.1145\/3219819.3219823"},{"key":"e_1_3_2_2_41_1","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-94947-5_13"}],"event":{"name":"KDD '25: The 31st ACM SIGKDD Conference on Knowledge Discovery and Data Mining","sponsor":["SIGMOD ACM Special Interest Group on Management of Data","SIGKDD ACM Special Interest Group on Knowledge Discovery in Data"],"location":"Toronto ON Canada","acronym":"KDD '25"},"container-title":["Proceedings of the 31st ACM SIGKDD Conference on Knowledge Discovery and Data Mining V.1"],"original-title":[],"link":[{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3690624.3709211","content-type":"unspecified","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/dl.acm.org\/doi\/pdf\/10.1145\/3690624.3709211","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,8,16]],"date-time":"2025-08-16T15:44:38Z","timestamp":1755359078000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3690624.3709211"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,7,20]]},"references-count":41,"alternative-id":["10.1145\/3690624.3709211","10.1145\/3690624"],"URL":"https:\/\/doi.org\/10.1145\/3690624.3709211","relation":{},"subject":[],"published":{"date-parts":[[2025,7,20]]},"assertion":[{"value":"2025-07-20","order":3,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}