{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,6,18]],"date-time":"2025-06-18T04:28:03Z","timestamp":1750220883382,"version":"3.41.0"},"publisher-location":"New York, NY, USA","reference-count":21,"publisher":"ACM","license":[{"start":{"date-parts":[[2019,11,3]],"date-time":"2019-11-03T00:00:00Z","timestamp":1572739200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.acm.org\/publications\/policies\/copyright_policy#Background"}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2019,11,3]]},"DOI":"10.1145\/3357384.3358075","type":"proceedings-article","created":{"date-parts":[[2019,11,4]],"date-time":"2019-11-04T14:11:35Z","timestamp":1572876695000},"page":"2073-2076","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":9,"title":["MarlRank"],"prefix":"10.1145","author":[{"given":"Shihao","family":"Zou","sequence":"first","affiliation":[{"name":"University of Alberta &amp; University of College London &amp; Huawei, Edmonton, Canada"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Zhonghua","family":"Li","sequence":"additional","affiliation":[{"name":"Huawei, Shenzhen, China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Mohammad","family":"Akbari","sequence":"additional","affiliation":[{"name":"University College London, London, United Kingdom"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jun","family":"Wang","sequence":"additional","affiliation":[{"name":"University College London, London, United Kingdom"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Peng","family":"Zhang","sequence":"additional","affiliation":[{"name":"Tianjin University, Tianjin, China"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"320","published-online":{"date-parts":[[2019,11,3]]},"reference":[{"key":"e_1_3_2_1_1_1","doi-asserted-by":"crossref","unstructured":"Chris Burges Tal Shaked Erin Renshaw Ari Lazier Matt Deeds Nicole Hamilton and Greg Hullender. 2005. Learning to rank using gradient descent. In ICML .  Chris Burges Tal Shaked Erin Renshaw Ari Lazier Matt Deeds Nicole Hamilton and Greg Hullender. 2005. Learning to rank using gradient descent. In ICML .","DOI":"10.1145\/1102351.1102363"},{"key":"e_1_3_2_1_2_1","unstructured":"Chris J.C. Burges. 2010. From RankNet to LambdaRank to LambdaMART: An Overview.  Chris J.C. Burges. 2010. From RankNet to LambdaRank to LambdaMART: An Overview."},{"key":"e_1_3_2_1_3_1","unstructured":"Christopher J Burges Robert Ragno and Quoc V Le. 2007. Learning to rank with nonsmooth cost functions. In NeurIPS .  Christopher J Burges Robert Ragno and Quoc V Le. 2007. Learning to rank with nonsmooth cost functions. In NeurIPS ."},{"key":"e_1_3_2_1_4_1","doi-asserted-by":"crossref","unstructured":"Zhe Cao Tao Qin Tie-Yan Liu Ming-Feng Tsai and Hang Li. 2007. Learning to Rank: From Pairwise Approach to Listwise Approach. In ICML .  Zhe Cao Tao Qin Tie-Yan Liu Ming-Feng Tsai and Hang Li. 2007. Learning to Rank: From Pairwise Approach to Listwise Approach. In ICML .","DOI":"10.1145\/1273496.1273513"},{"key":"e_1_3_2_1_5_1","doi-asserted-by":"crossref","unstructured":"Soumen Chakrabarti Rajiv Khanna Uma Sawant and Chiru Bhattacharyya. 2008. Structured Learning for Non-smooth Ranking Losses. In KDD .  Soumen Chakrabarti Rajiv Khanna Uma Sawant and Chiru Bhattacharyya. 2008. Structured Learning for Non-smooth Ranking Losses. In KDD .","DOI":"10.1145\/1401890.1401906"},{"key":"e_1_3_2_1_6_1","doi-asserted-by":"crossref","unstructured":"Yue Feng Jun Xu Yanyan Lan Jiafeng Guo Wei Zeng and Xueqi Cheng. 2018. From Greedy Selection to Exploratory Decision-Making: Diverse Ranking with Policy-Value Networks. In SIGIR .  Yue Feng Jun Xu Yanyan Lan Jiafeng Guo Wei Zeng and Xueqi Cheng. 2018. From Greedy Selection to Exploratory Decision-Making: Diverse Ranking with Policy-Value Networks. In SIGIR .","DOI":"10.1145\/3209978.3209979"},{"key":"e_1_3_2_1_7_1","volume-title":"An efficient boosting algorithm for combining preferences. JMLR","author":"Freund Yoav","year":"2003","unstructured":"Yoav Freund , Raj Iyer , Robert E Schapire , and Yoram Singer . 2003. An efficient boosting algorithm for combining preferences. JMLR ( 2003 ). Yoav Freund, Raj Iyer, Robert E Schapire, and Yoram Singer. 2003. An efficient boosting algorithm for combining preferences. JMLR (2003)."},{"key":"e_1_3_2_1_8_1","doi-asserted-by":"crossref","unstructured":"Ralf Herbrich Thore Graepel and Klaus Obermayer. 1999. Support vector learning for ordinal regression. (1999).  Ralf Herbrich Thore Graepel and Klaus Obermayer. 1999. Support vector learning for ordinal regression. (1999).","DOI":"10.1049\/cp:19991091"},{"key":"e_1_3_2_1_9_1","doi-asserted-by":"publisher","DOI":"10.1561\/9781601982452"},{"key":"e_1_3_2_1_10_1","unstructured":"Ryan Lowe Yi Wu Aviv Tamar Jean Harb Pieter Abbeel and Igor Mordatch. 2017. Multi-Agent Actor-Critic for Mixed Cooperative-Competitive Environments. NeurIPS .  Ryan Lowe Yi Wu Aviv Tamar Jean Harb Pieter Abbeel and Igor Mordatch. 2017. Multi-Agent Actor-Critic for Mixed Cooperative-Competitive Environments. NeurIPS ."},{"key":"e_1_3_2_1_11_1","doi-asserted-by":"publisher","DOI":"10.1145\/2600428.2609629"},{"key":"e_1_3_2_1_12_1","doi-asserted-by":"crossref","unstructured":"Liang Pang Yanyan Lan Jiafeng Guo Jun Xu Jingfang Xu and Xueqi Cheng. 2017. DeepRank: A New Deep Architecture for Relevance Ranking in Information Retrieval. In CIKM .  Liang Pang Yanyan Lan Jiafeng Guo Jun Xu Jingfang Xu and Xueqi Cheng. 2017. DeepRank: A New Deep Architecture for Relevance Ranking in Information Retrieval. In CIKM .","DOI":"10.1145\/3132847.3132914"},{"key":"e_1_3_2_1_13_1","doi-asserted-by":"crossref","unstructured":"Yelong Shen Xiaodong He Jianfeng Gao Li Deng and Gr\u00e9goire Mesnil. 2014. Learning Semantic Representations Using Convolutional Neural Networks for Web Search. In WWW Companion .  Yelong Shen Xiaodong He Jianfeng Gao Li Deng and Gr\u00e9goire Mesnil. 2014. Learning Semantic Representations Using Convolutional Neural Networks for Web Search. In WWW Companion .","DOI":"10.1145\/2567948.2577348"},{"key":"e_1_3_2_1_14_1","volume-title":"et almbox","author":"Silver David","year":"2017","unstructured":"David Silver , Julian Schrittwieser , Karen Simonyan , Ioannis Antonoglou , Aja Huang , Arthur Guez , Thomas Hubert , Lucas Baker , Matthew Lai , Adrian Bolton , et almbox . 2017 . Mastering the game of Go without human knowledge. Nature ( 2017). David Silver, Julian Schrittwieser, Karen Simonyan, Ioannis Antonoglou, Aja Huang, Arthur Guez, Thomas Hubert, Lucas Baker, Matthew Lai, Adrian Bolton, et almbox. 2017. Mastering the game of Go without human knowledge. Nature (2017)."},{"volume-title":"Introduction to reinforcement learning","author":"Sutton Richard S","key":"e_1_3_2_1_15_1","unstructured":"Richard S Sutton and Andrew G Barto . 1998. Introduction to reinforcement learning . MIT press Cambridge . Richard S Sutton and Andrew G Barto. 1998. Introduction to reinforcement learning .MIT press Cambridge."},{"key":"e_1_3_2_1_16_1","doi-asserted-by":"publisher","DOI":"10.1145\/3077136.3080786"},{"key":"e_1_3_2_1_17_1","doi-asserted-by":"crossref","unstructured":"Zeng Wei Jun Xu Yanyan Lan Jiafeng Guo and Xueqi Cheng. 2017. Reinforcement learning to rank with Markov decision process. In SIGIR .  Zeng Wei Jun Xu Yanyan Lan Jiafeng Guo and Xueqi Cheng. 2017. Reinforcement learning to rank with Markov decision process. In SIGIR .","DOI":"10.1145\/3077136.3080685"},{"key":"e_1_3_2_1_18_1","doi-asserted-by":"crossref","unstructured":"Jun Xu and Hang Li. 2007. Adarank: a boosting algorithm for information retrieval. In SIGIR .  Jun Xu and Hang Li. 2007. Adarank: a boosting algorithm for information retrieval. In SIGIR .","DOI":"10.1145\/1277741.1277809"},{"key":"e_1_3_2_1_19_1","unstructured":"Jun Xu Tie-Yan Liu Min Lu Hang Li and Wei-Ying Ma. [n. d.]. Directly optimizing evaluation measures in learning to rank. In SIGIR .  Jun Xu Tie-Yan Liu Min Lu Hang Li and Wei-Ying Ma. [n. d.]. Directly optimizing evaluation measures in learning to rank. In SIGIR ."},{"key":"e_1_3_2_1_20_1","doi-asserted-by":"crossref","unstructured":"Sicong Zhang Jiyun Luo and Hui Yang. 2014. A POMDP Model for Content-free Document Re-ranking. In SIGIR .  Sicong Zhang Jiyun Luo and Hui Yang. 2014. A POMDP Model for Content-free Document Re-ranking. In SIGIR .","DOI":"10.1145\/2600428.2609529"},{"key":"e_1_3_2_1_21_1","volume-title":"Xing Xie, and Zhenhui Li.","author":"Zheng Guanjie","year":"2018","unstructured":"Guanjie Zheng , Fuzheng Zhang , Zihan Zheng , Yang Xiang , Nicholas Jing Yuan , Xing Xie, and Zhenhui Li. 2018 . DRN : A Deep Reinforcement Learning Framework for News Recommendation. In WWW . Guanjie Zheng, Fuzheng Zhang, Zihan Zheng, Yang Xiang, Nicholas Jing Yuan, Xing Xie, and Zhenhui Li. 2018. DRN: A Deep Reinforcement Learning Framework for News Recommendation. In WWW ."}],"event":{"name":"CIKM '19: The 28th ACM International Conference on Information and Knowledge Management","sponsor":["SIGWEB ACM Special Interest Group on Hypertext, Hypermedia, and Web","SIGIR ACM Special Interest Group on Information Retrieval"],"location":"Beijing China","acronym":"CIKM '19"},"container-title":["Proceedings of the 28th ACM International Conference on Information and Knowledge Management"],"original-title":[],"link":[{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3357384.3358075","content-type":"unspecified","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/dl.acm.org\/doi\/pdf\/10.1145\/3357384.3358075","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,6,17]],"date-time":"2025-06-17T23:44:18Z","timestamp":1750203858000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3357384.3358075"}},"subtitle":["Multi-agent Reinforced Learning to Rank"],"short-title":[],"issued":{"date-parts":[[2019,11,3]]},"references-count":21,"alternative-id":["10.1145\/3357384.3358075","10.1145\/3357384"],"URL":"https:\/\/doi.org\/10.1145\/3357384.3358075","relation":{},"subject":[],"published":{"date-parts":[[2019,11,3]]},"assertion":[{"value":"2019-11-03","order":2,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}