{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,1]],"date-time":"2026-05-01T07:36:33Z","timestamp":1777620993733,"version":"3.51.4"},"reference-count":87,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"10","license":[{"start":{"date-parts":[[2024,10,1]],"date-time":"2024-10-01T00:00:00Z","timestamp":1727740800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"},{"start":{"date-parts":[[2024,10,1]],"date-time":"2024-10-01T00:00:00Z","timestamp":1727740800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2024,10,1]],"date-time":"2024-10-01T00:00:00Z","timestamp":1727740800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IIEEE Trans. Software Eng."],"published-print":{"date-parts":[[2024,10]]},"DOI":"10.1109\/tse.2024.3452595","type":"journal-article","created":{"date-parts":[[2024,8,30]],"date-time":"2024-08-30T17:35:02Z","timestamp":1725039302000},"page":"2695-2708","source":"Crossref","is-referenced-by-count":11,"title":["RLocator: Reinforcement Learning for Bug Localization"],"prefix":"10.1109","volume":"50","author":[{"ORCID":"https:\/\/orcid.org\/0000-0001-5965-615X","authenticated-orcid":false,"given":"Partha","family":"Chakraborty","sequence":"first","affiliation":[{"name":"David R. Cheriton School of Computer Science, University of Waterloo, Waterloo, ON, Canada"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-2621-6104","authenticated-orcid":false,"given":"Mahmoud","family":"Alfadel","sequence":"additional","affiliation":[{"name":"Department of Computer Science, University of Calgary, Calgary, AB, Canada"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-4533-4728","authenticated-orcid":false,"given":"Meiyappan","family":"Nagappan","sequence":"additional","affiliation":[{"name":"David R. Cheriton School of Computer Science, University of Waterloo, Waterloo, ON, Canada"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1145\/1806799.1806829"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1145\/1117696.1117704"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1109\/ICSE.2012.6227210"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1016\/j.infsof.2018.03.003"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/ACCESS.2019.2936948"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1145\/3387904.3389281"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/TKDE.2022.3225329"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1145\/3510003.3510042"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/ASE.2015.73"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1145\/3077136.3080685"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/DEXA.2010.30"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1145\/2983921"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1145\/1277741.1277790"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/tnn.1998.712192"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1002\/9781118557426.ch1"},{"key":"ref16","article-title":"Rethinking what makes reinforcement learning different from supervised learning","year":"2021"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1177\/0278364913495721"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1007\/s10664-022-10237-z"},{"key":"ref19","article-title":"Optimizing audio recommendations for the long-term: A reinforcement learning perspective","author":"Maystre","year":"2023"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1145\/3289600.3290999"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1145\/3477600"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/TSE.2022.3194188"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1145\/2884781.2884804"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1016\/j.jss.2021.110961"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/APSEC51365.2020.00068"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1145\/3397271.3401200"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.48550\/arXiv.1810.04805"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2020.findings-emnlp.139"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.3390\/info11090421"},{"key":"ref30","first-page":"2052","article-title":"Off-policy deep reinforcement learning without exploration","volume-title":"Proc. 36th Int. Conf. Mach. Learn.","volume":"97","author":"Fujimoto","year":"2019"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.1109\/TNNLS.2021.3121870"},{"key":"ref32","doi-asserted-by":"publisher","DOI":"10.1145\/3465403"},{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.1145\/2939672.2939785"},{"key":"ref34","doi-asserted-by":"publisher","DOI":"10.1007\/s00500-021-05689-2"},{"key":"ref35","doi-asserted-by":"publisher","DOI":"10.1145\/2009916.2010070"},{"key":"ref36","doi-asserted-by":"publisher","DOI":"10.1007\/BFb0026666"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.1109\/MSR.2010.5463280"},{"key":"ref38","doi-asserted-by":"publisher","DOI":"10.1145\/2063576.2063584"},{"key":"ref39","article-title":"Rlocator: Reinforcement learning for bug localization","year":"2024"},{"key":"ref40","doi-asserted-by":"publisher","DOI":"10.1109\/TSE.2021.3070549"},{"key":"ref41","doi-asserted-by":"publisher","DOI":"10.1145\/3238147.3238206"},{"key":"ref42","doi-asserted-by":"publisher","DOI":"10.1145\/3038912.3052569"},{"key":"ref43","doi-asserted-by":"publisher","DOI":"10.1145\/2647868.2654915"},{"key":"ref44","doi-asserted-by":"publisher","DOI":"10.1016\/B978-0-12-819764-6.00008-9"},{"key":"ref45","doi-asserted-by":"publisher","DOI":"10.1145\/3397271.3401075"},{"key":"ref46","doi-asserted-by":"publisher","DOI":"10.1162\/neco.1997.9.8.1735"},{"key":"ref47","doi-asserted-by":"publisher","DOI":"10.1145\/3132847.3132914"},{"key":"ref48","doi-asserted-by":"publisher","DOI":"10.1109\/TSE.2019.2920771"},{"key":"ref49","first-page":"166","article-title":"Learning unified features from natural and programming languages for locating buggy source code","author":"Huo","year":"2016","journal-title":"Proc. Int. Joint Conf. Artif. Intell. (IJCAI)"},{"key":"ref50","article-title":"Deep recurrent q-learning for partially observable MDPs","author":"Hausknecht","year":"2015"},{"key":"ref51","article-title":"Neural combinatorial optimization with reinforcement learning","author":"Bello","year":"2016"},{"key":"ref52","first-page":"1861","article-title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","volume-title":"Proc. 35th Int. Conf. Mach. Learn.,","volume":"8","author":"Haarnoja","year":"2018"},{"key":"ref53","doi-asserted-by":"publisher","DOI":"10.1109\/TEVC.2019.2895748"},{"key":"ref54","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2023.acl-industry.42"},{"key":"ref55","doi-asserted-by":"publisher","DOI":"10.1145\/3447332.3447334"},{"key":"ref56","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-78753-4_6"},{"key":"ref57","doi-asserted-by":"publisher","DOI":"10.1145\/2635868.2635874"},{"key":"ref58","doi-asserted-by":"publisher","DOI":"10.1145\/3213846.3213856"},{"key":"ref59","doi-asserted-by":"publisher","DOI":"10.1002\/smr.567"},{"key":"ref60","doi-asserted-by":"publisher","DOI":"10.1145\/2786805.2786859"},{"key":"ref61","doi-asserted-by":"publisher","DOI":"10.1109\/MSR.2013.6624044"},{"key":"ref62","doi-asserted-by":"publisher","DOI":"10.1016\/j.infsof.2018.08.002"},{"key":"ref63","doi-asserted-by":"publisher","DOI":"10.1016\/S0022-5371(81)90301-7"},{"key":"ref64","doi-asserted-by":"publisher","DOI":"10.1007\/s10515-023-00379-9"},{"key":"ref65","doi-asserted-by":"publisher","DOI":"10.1109\/QRS51102.2020.00034"},{"key":"ref66","doi-asserted-by":"publisher","DOI":"10.1007\/s10664-020-09882-z"},{"key":"ref67","first-page":"151","article-title":"Understanding the impact of entropy on policy optimization","volume-title":"Proc. 36th Int. Conf. Mach. Learn.","volume":"97","author":"Ahmed","year":"2019"},{"key":"ref68","doi-asserted-by":"publisher","DOI":"10.3390\/s22155845"},{"key":"ref69","first-page":"1928","article-title":"Asynchronous methods for deep reinforcement learning","volume-title":"Proc. 33rd Int. Conf. Mach. Learn.,","volume":"48","author":"Mnih","year":"2016"},{"key":"ref70","doi-asserted-by":"publisher","DOI":"10.1145\/3106237.3106255"},{"key":"ref71","doi-asserted-by":"publisher","DOI":"10.1109\/QRS.2016.28"},{"key":"ref72","doi-asserted-by":"publisher","DOI":"10.1145\/1453101.1453146"},{"key":"ref73","doi-asserted-by":"publisher","DOI":"10.1109\/TSE.2010.63"},{"key":"ref74","doi-asserted-by":"publisher","DOI":"10.1016\/j.jss.2022.111429"},{"key":"ref75","doi-asserted-by":"publisher","DOI":"10.1145\/3468264.3468580"},{"key":"ref76","doi-asserted-by":"publisher","DOI":"10.1145\/3345628"},{"key":"ref77","doi-asserted-by":"publisher","DOI":"10.1007\/s10664-021-10022-4"},{"key":"ref78","doi-asserted-by":"publisher","DOI":"10.1109\/SANER50967.2021.00024"},{"key":"ref79","doi-asserted-by":"publisher","DOI":"10.1145\/3360588"},{"key":"ref80","doi-asserted-by":"publisher","DOI":"10.1007\/s10618-021-00755-7"},{"key":"ref81","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/N18-1202"},{"key":"ref82","doi-asserted-by":"publisher","DOI":"10.1016\/S0004-3702(99)00052-1"},{"key":"ref83","doi-asserted-by":"publisher","DOI":"10.1145\/3510003.3510136"},{"key":"ref84","doi-asserted-by":"publisher","DOI":"10.1007\/3-540-46693-2_14"},{"key":"ref85","doi-asserted-by":"publisher","DOI":"10.3390\/en16124636"},{"key":"ref86","doi-asserted-by":"publisher","DOI":"10.1145\/3540250.3549165"},{"key":"ref87","doi-asserted-by":"publisher","DOI":"10.1109\/TSC.2020.3006214"}],"container-title":["IEEE Transactions on Software Engineering"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx8\/32\/10721226\/10659717.pdf?arnumber=10659717","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,10,18]],"date-time":"2024-10-18T17:29:32Z","timestamp":1729272572000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/10659717\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,10]]},"references-count":87,"journal-issue":{"issue":"10"},"URL":"https:\/\/doi.org\/10.1109\/tse.2024.3452595","relation":{},"ISSN":["0098-5589","1939-3520","2326-3881"],"issn-type":[{"value":"0098-5589","type":"print"},{"value":"1939-3520","type":"electronic"},{"value":"2326-3881","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,10]]}}}