{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,11,5]],"date-time":"2025-11-05T14:02:10Z","timestamp":1762351330327,"version":"3.37.3"},"reference-count":22,"publisher":"IEEE","license":[{"start":{"date-parts":[[2022,7,18]],"date-time":"2022-07-18T00:00:00Z","timestamp":1658102400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2022,7,18]],"date-time":"2022-07-18T00:00:00Z","timestamp":1658102400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["61902415,61732018"],"award-info":[{"award-number":["61902415,61732018"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2022,7,18]]},"DOI":"10.1109\/icme52920.2022.9859878","type":"proceedings-article","created":{"date-parts":[[2022,8,26]],"date-time":"2022-08-26T19:45:18Z","timestamp":1661543118000},"page":"1-6","source":"Crossref","is-referenced-by-count":2,"title":["Searching Latent Sub-Goals in Hierarchical Reinforcement Learning as Riemannian Manifold Optimization"],"prefix":"10.1109","author":[{"given":"Sidun","family":"Liu","sequence":"first","affiliation":[{"name":"National University of Defense Technology,Science and Technology on Parallel and Distributed Laboratory,Hunan,China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Peng","family":"Qiao","sequence":"additional","affiliation":[{"name":"National University of Defense Technology,Science and Technology on Parallel and Distributed Laboratory,Hunan,China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yong","family":"Dou","sequence":"additional","affiliation":[{"name":"National University of Defense Technology,Science and Technology on Parallel and Distributed Laboratory,Hunan,China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Ruochun","family":"Jin","sequence":"additional","affiliation":[{"name":"National University of Defense Technology,Science and Technology on Parallel and Distributed Laboratory,Hunan,China"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/TNNLS.2017.2650943"},{"key":"ref11","article-title":"Manifold regularization: A geometric framework for learning from labeled and unlabeled examples","volume":"7","author":"belkin","year":"2006","journal-title":"Journal of Machine Learning Research"},{"key":"ref12","article-title":"Manifold embeddings for model-based reinforcement learning under partial observability","volume":"22","author":"bush","year":"2009","journal-title":"Advances in neural information processing systems"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1007\/s40305-020-00295-9"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00469"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1137\/17M1116787"},{"key":"ref16","first-page":"4592","article-title":"Riemannian svrg: Fast stochastic optimization on riemannian manifolds","volume":"29","author":"zhang","year":"2016","journal-title":"Advances in neural information processing systems"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR42600.2020.00772"},{"key":"ref18","article-title":"Generative adversarial nets","author":"goodfellow","year":"0","journal-title":"Proc of International Conference on Neural Information Processing"},{"key":"ref19","first-page":"5769","article-title":"Improved training of wasserstein gans","author":"gulrajani","year":"0","journal-title":"Proceedings of the 31st International Conference on Neural Information Processing Systems"},{"key":"ref4","article-title":"Near-optimal representation learning for hierarchical reinforcement learning","author":"nachum","year":"0","journal-title":"2018 International Conference on Learning Representations"},{"key":"ref3","article-title":"Generating adjacency-constrained subgoals in hierarchical reinforcement learning","volume":"33","author":"zhang","year":"2020","journal-title":"Advances in neural information processing systems"},{"key":"ref6","article-title":"Optimization techniques on riemannian manifolds","volume":"3","author":"smith","year":"1994","journal-title":"Fields Institute Communications"},{"key":"ref5","first-page":"3307","article-title":"Data-efficient hierarchical reinforcement learning","author":"nachum","year":"0","journal-title":"Proceedings of the 32Nd International Conference on Neural Information Processing Systems"},{"key":"ref8","article-title":"Learning multi-level hierarchies with hind-sight","author":"levy","year":"0","journal-title":"International Conference on Learning Representations"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2012.6386109"},{"key":"ref2","first-page":"3540","article-title":"Feudal networks for hierarchical reinforcement learning","author":"vezhnevets","year":"0","journal-title":"International Conference on Machine Learning"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1016\/S0004-3702(99)00052-1"},{"key":"ref9","first-page":"5055","article-title":"Hindsight experience replay","author":"andrychowicz","year":"0","journal-title":"Proceedings of the 31st International Conference on Neural Information Processing Systems"},{"key":"ref20","article-title":"Implementation matters in deep policy gradients: A case study on ppo and trpo","author":"engstrom","year":"2020","journal-title":"ArXiv Preprint"},{"key":"ref22","first-page":"1587","article-title":"Addressing function approximation error in actor-critic methods","author":"fujimoto","year":"0","journal-title":"International Conference on Machine Learning"},{"key":"ref21","first-page":"1312","article-title":"Universal value function approximators","author":"schaul","year":"0","journal-title":"International Conference on Machine Learning"}],"event":{"name":"2022 IEEE International Conference on Multimedia and Expo (ICME)","start":{"date-parts":[[2022,7,18]]},"location":"Taipei, Taiwan","end":{"date-parts":[[2022,7,22]]}},"container-title":["2022 IEEE International Conference on Multimedia and Expo (ICME)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/9859562\/9858923\/09859878.pdf?arnumber=9859878","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,9,19]],"date-time":"2022-09-19T20:25:03Z","timestamp":1663619103000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/9859878\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2022,7,18]]},"references-count":22,"URL":"https:\/\/doi.org\/10.1109\/icme52920.2022.9859878","relation":{},"subject":[],"published":{"date-parts":[[2022,7,18]]}}}