{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,1,28]],"date-time":"2026-01-28T21:58:47Z","timestamp":1769637527954,"version":"3.49.0"},"reference-count":28,"publisher":"IEEE","license":[{"start":{"date-parts":[[2021,5,30]],"date-time":"2021-05-30T00:00:00Z","timestamp":1622332800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2021,5,30]],"date-time":"2021-05-30T00:00:00Z","timestamp":1622332800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2021,5,30]]},"DOI":"10.1109\/icra48506.2021.9562019","type":"proceedings-article","created":{"date-parts":[[2021,10,20]],"date-time":"2021-10-20T00:28:35Z","timestamp":1634689715000},"page":"8814-8820","source":"Crossref","is-referenced-by-count":22,"title":["Decentralized Circle Formation Control for Fish-like Robots in the Real-world via Reinforcement Learning"],"prefix":"10.1109","author":[{"given":"Tianhao","family":"Zhang","sequence":"first","affiliation":[{"name":"Peking University,The State Key Laboratory of Turbulence and Complex Systems, Intelligent Biomimetic Design Lab, College of Engineering,Beijing,China,100871"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yueheng","family":"Li","sequence":"additional","affiliation":[{"name":"Peking University,The State Key Laboratory of Turbulence and Complex Systems, Intelligent Biomimetic Design Lab, College of Engineering,Beijing,China,100871"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Shuai","family":"Li","sequence":"additional","affiliation":[{"name":"Peking University,The State Key Laboratory of Turbulence and Complex Systems, Intelligent Biomimetic Design Lab, College of Engineering,Beijing,China,100871"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Qiwei","family":"Ye","sequence":"additional","affiliation":[{"name":"Microsoft Research Asia,Beijing,China,100871"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Chen","family":"Wang","sequence":"additional","affiliation":[{"name":"Peking University,The State Key Laboratory of Turbulence and Complex Systems, Intelligent Biomimetic Design Lab, College of Engineering,Beijing,China,100871"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Guangming","family":"Xie","sequence":"additional","affiliation":[{"name":"Peking University,The State Key Laboratory of Turbulence and Complex Systems, Intelligent Biomimetic Design Lab, College of Engineering,Beijing,China,100871"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1016\/j.automatica.2015.01.014"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/TAC.2018.2790259"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.23919\/ACC45564.2020.9147392"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1088\/1748-3190\/ab1052"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1089\/soro.2019.0174"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1109\/TSMC.2016.2645699"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1109\/TSMC.2017.2785794"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/ICARCV.2012.6485313"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1109\/TSMC.2019.2963246"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1007\/s10458-019-09421-1"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1609\/aaai.v34i05.6212"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1016\/j.physrep.2012.03.004"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1016\/B978-1-4832-2828-0.50006-4"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1038\/s41467-020-19086-0"},{"key":"ref6","article-title":"Path-following control of fish-like robots: A deep reinforcement learning approach","author":"zhang","year":"2020","journal-title":"21st IFAC World Congr"},{"key":"ref5","first-page":"4237","article-title":"CPG-based locomotion control of a robotic fish: Using linear oscillators and reducing control parameters via PSO","volume":"7","author":"wang","year":"2011","journal-title":"International Journal of Innovative Computing Information and Control"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1109\/TAC.2019.2946338"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/TAC.2017.2712758"},{"key":"ref2","doi-asserted-by":"crossref","DOI":"10.1093\/oso\/9780198508175.001.0001","author":"krause","year":"2002","journal-title":"Living in Groups"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1016\/j.automatica.2018.04.005"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1002\/9781444342536"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-28929-8"},{"key":"ref22","first-page":"6379","article-title":"Multi-agent actor-critic for mixed cooperative-competitive environments","author":"lowe","year":"2017","journal-title":"Advances in neural information processing systems"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1016\/j.neucom.2015.04.066"},{"key":"ref24","first-page":"2085","article-title":"Value-decomposition networks for cooperative multi-agent learning based on team reward","author":"sunehag","year":"2018","journal-title":"AAMAS"},{"key":"ref23","article-title":"Continuous control with deep reinforcement learning","author":"lillicrap","year":"2015"},{"key":"ref26","article-title":"QTRAN: Learning to factorize with transformation for cooperative multi-agent reinforcement learning","author":"son","year":"2019"},{"key":"ref25","article-title":"QMIX: Monotonic value function factorisation for deep multi-agent reinforcement learning","author":"rashid","year":"2018"}],"event":{"name":"2021 IEEE International Conference on Robotics and Automation (ICRA)","location":"Xi'an, China","start":{"date-parts":[[2021,5,30]]},"end":{"date-parts":[[2021,6,5]]}},"container-title":["2021 IEEE International Conference on Robotics and Automation (ICRA)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/9560720\/9560666\/09562019.pdf?arnumber=9562019","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2023,11,11]],"date-time":"2023-11-11T11:32:57Z","timestamp":1699702377000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/9562019\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2021,5,30]]},"references-count":28,"URL":"https:\/\/doi.org\/10.1109\/icra48506.2021.9562019","relation":{},"subject":[],"published":{"date-parts":[[2021,5,30]]}}}