{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,4,22]],"date-time":"2026-04-22T20:29:35Z","timestamp":1776889775295,"version":"3.51.2"},"reference-count":23,"publisher":"IEEE","license":[{"start":{"date-parts":[[2025,6,17]],"date-time":"2025-06-17T00:00:00Z","timestamp":1750118400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2025,6,17]],"date-time":"2025-06-17T00:00:00Z","timestamp":1750118400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2025,6,17]]},"DOI":"10.1109\/vtc2025-spring65109.2025.11174792","type":"proceedings-article","created":{"date-parts":[[2025,9,30]],"date-time":"2025-09-30T17:36:40Z","timestamp":1759253800000},"page":"1-6","source":"Crossref","is-referenced-by-count":3,"title":["UAV Trajectory Optimization for Radio Map Updating: A Transformer-Based DRL Approach"],"prefix":"10.1109","author":[{"given":"Jiahao","family":"Li","sequence":"first","affiliation":[{"name":"College of Electronic and Information Engineering, Nanjing University of Aeronautics and Astronautics,Nanjing,China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Bo","family":"Zhou","sequence":"additional","affiliation":[{"name":"College of Electronic and Information Engineering, Nanjing University of Aeronautics and Astronautics,Nanjing,China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Xinyi","family":"Ma","sequence":"additional","affiliation":[{"name":"College of Electronic and Information Engineering, Nanjing University of Aeronautics and Astronautics,Nanjing,China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Qihui","family":"Wu","sequence":"additional","affiliation":[{"name":"College of Electronic and Information Engineering, Nanjing University of Aeronautics and Astronautics,Nanjing,China"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/MWC.2019.1800146"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/DYSPAN.2012.6478166"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1109\/TAP.2011.2144556"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP48485.2024.10447286"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/JSEN.2024.3357430"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1109\/LCOMM.2023.3265214"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/JIOT.2024.3399409"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1109\/MNET.011.2000076"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/TWC.2022.3197087"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1002\/9781119115151"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/JIOT.2022.3176903"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/TWC.2019.2902559"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/TWC.2017.2688328"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/PIMRC.2012.6362597"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1109\/TCCN.2017.2653189"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1109\/INFOCOM.2019.8737512"},{"key":"ref17","first-page":"4344","article-title":"Learning by playing solving sparse reward tasks from scratch","volume-title":"International conference on machine learning","author":"Riedmiller","year":"2018"},{"key":"ref18","first-page":"278","article-title":"Policy invariance under reward transformations: Theory and application to reward shaping","volume-title":"International conference on machine learning","volume":"99","author":"Ng","year":"1999"},{"key":"ref19","article-title":"Prioritized experience replay","author":"Schaul","year":"2015","journal-title":"arXiv preprint"},{"key":"ref20","article-title":"Playing atari with deep reinforcement learning","author":"Mnih","year":"2013","journal-title":"arXiv preprint"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1109\/TCOMM.2022.3148364"},{"key":"ref22","article-title":"Attention is all you need","author":"Vaswani","year":"2017","journal-title":"Neural Information Processing Systems"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1049\/el:19911328"}],"event":{"name":"2025 IEEE 101st Vehicular Technology Conference (VTC2025-Spring)","location":"Oslo, Norway","start":{"date-parts":[[2025,6,17]]},"end":{"date-parts":[[2025,6,20]]}},"container-title":["2025 IEEE 101st Vehicular Technology Conference (VTC2025-Spring)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx8\/11174123\/11174275\/11174792.pdf?arnumber=11174792","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,10,1]],"date-time":"2025-10-01T05:55:28Z","timestamp":1759298128000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/11174792\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,6,17]]},"references-count":23,"URL":"https:\/\/doi.org\/10.1109\/vtc2025-spring65109.2025.11174792","relation":{},"subject":[],"published":{"date-parts":[[2025,6,17]]}}}