{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,8]],"date-time":"2026-07-08T16:32:19Z","timestamp":1783528339050,"version":"3.55.0"},"reference-count":27,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2018,5]]},"DOI":"10.1109\/icra.2018.8461113","type":"proceedings-article","created":{"date-parts":[[2018,9,21]],"date-time":"2018-09-21T18:28:03Z","timestamp":1537554483000},"page":"6252-6259","source":"Crossref","is-referenced-by-count":424,"title":["Towards Optimally Decentralized Multi-Robot Collision Avoidance via Deep Reinforcement Learning"],"prefix":"10.1109","author":[{"given":"Pinxin","family":"Long","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Tingxiang","family":"Fanl","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xinyi","family":"Liao","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Wenxi","family":"Liu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Hao","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Jia","family":"Pan","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2017.2651371"},{"key":"ref11","first-page":"1527","article-title":"From perception to decision: A data-driven approach to end-to-end motion planning for autonomous ground robots","author":"pfeiffer","year":"2017","journal-title":"International Conference on Robotics and Automation"},{"key":"ref12","first-page":"739","article-title":"Off-road obstacle avoidance through end-to-end learning","author":"muller","year":"2006","journal-title":"Advances in neural information processing systems"},{"key":"ref13","author":"zhang","year":"2016","journal-title":"Deep reinforcement learning with successor features for navigation across similar environments"},{"key":"ref14","author":"sergeant","year":"0","journal-title":"Multimodal deep autoencoders for control of a mobile robot"},{"key":"ref15","first-page":"1765","article-title":"Learning monocular reactive uav control in cluttered natural environments","author":"ross","year":"2013","journal-title":"International Conference on Robotics and Automation"},{"key":"ref16","article-title":"Virtual-to-real deep reinforcement learning: Continuous control of mobile robots for mapless navigation","author":"tai","year":"2017","journal-title":"International Conference on Intelligent Robots and Systems"},{"key":"ref17","author":"kahn","year":"2017","journal-title":"Uncertainty-aware reinforcement learning for collision avoidance"},{"key":"ref18","first-page":"4584","article-title":"Smooth and collision-free navigation for multiple robots under differential-drive constraints","author":"snape","year":"2010","journal-title":"International Conference on Intelligent Robots and Systems"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-642-32723-0_15"},{"key":"ref4","first-page":"1192","article-title":"Collision avoidance under bounded localization uncertainty","author":"claes","year":"2012","journal-title":"International Conference on Intelligent Robots and Systems"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1145\/1553374.1553380"},{"key":"ref3","first-page":"147","article-title":"Multi-robot collision avoidance with localization uncertainty","volume":"1","author":"hennes","year":"2012","journal-title":"International Conference on Autonomous Agents and Multiagent Systems"},{"key":"ref6","first-page":"1928","article-title":"Reciprocal velocity obstacles for real-time multi-agent navigation","author":"van","year":"2008","journal-title":"International Conference on Robotics and Automation"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1177\/0278364915576234"},{"key":"ref8","first-page":"285","article-title":"Decentralized non-communicating multiagent collision avoidance with deep reinforcement learning","author":"chen","year":"2017","journal-title":"International Conference on Robotics and Automation"},{"key":"ref7","article-title":"Implicit coordination in crowded multi-agent navigation","author":"godoy","year":"2016","journal-title":"Proc of the Thirtieth AAAI Conference on Artificial Intelligence"},{"key":"ref2","doi-asserted-by":"crossref","first-page":"696","DOI":"10.1109\/TRO.2011.2120810","article-title":"The hybrid reciprocal velocity obstacle","volume":"27","author":"snape","year":"2011","journal-title":"Transactions on Robotics"},{"key":"ref9","author":"chen","year":"2017","journal-title":"Socially aware motion planning with deep reinforcement learning"},{"key":"ref1","doi-asserted-by":"crossref","first-page":"3","DOI":"10.1007\/978-3-642-19457-3_1","author":"van den berg","year":"2011","journal-title":"International Symposium on Robotics Research"},{"key":"ref20","first-page":"807","article-title":"Rectified linear units improve restricted boltzmann machines","author":"nair","year":"2010","journal-title":"International Conference on Machine Learning"},{"key":"ref22","author":"schulman","year":"2017","journal-title":"Proximal policy optimization algorithms"},{"key":"ref21","first-page":"3357","article-title":"Target-driven visual navigation in indoor scenes using deep reinforcement learning","author":"zhu","year":"2017","journal-title":"International Conference on Robotics and Automation"},{"key":"ref24","first-page":"1889","article-title":"Trust region policy optimization","author":"schulman","year":"2015","journal-title":"International Conference on Machine Learning"},{"key":"ref23","author":"heess","year":"2017","journal-title":"Emergence of locomotion behaviours in rich environments"},{"key":"ref26","author":"schulman","year":"2015","journal-title":"High-dimensional continuous control using generalized advantage estimation"},{"key":"ref25","author":"kingma","year":"2014","journal-title":"Adam A method for stochastic optimization"}],"event":{"name":"2018 IEEE International Conference on Robotics and Automation (ICRA)","location":"Brisbane, QLD","start":{"date-parts":[[2018,5,21]]},"end":{"date-parts":[[2018,5,25]]}},"container-title":["2018 IEEE International Conference on Robotics and Automation (ICRA)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/8449910\/8460178\/08461113.pdf?arnumber=8461113","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2020,8,23]],"date-time":"2020-08-23T21:33:23Z","timestamp":1598218403000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/8461113\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2018,5]]},"references-count":27,"URL":"https:\/\/doi.org\/10.1109\/icra.2018.8461113","relation":{},"subject":[],"published":{"date-parts":[[2018,5]]}}}