{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,2,10]],"date-time":"2026-02-10T17:13:40Z","timestamp":1770743620342,"version":"3.49.0"},"publisher-location":"Cham","reference-count":35,"publisher":"Springer International Publishing","isbn-type":[{"value":"9783030954581","type":"print"},{"value":"9783030954598","type":"electronic"}],"license":[{"start":{"date-parts":[[2022,1,1]],"date-time":"2022-01-01T00:00:00Z","timestamp":1640995200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"},{"start":{"date-parts":[[2022,1,1]],"date-time":"2022-01-01T00:00:00Z","timestamp":1640995200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2022]]},"DOI":"10.1007\/978-3-030-95459-8_11","type":"book-chapter","created":{"date-parts":[[2022,2,17]],"date-time":"2022-02-17T19:02:27Z","timestamp":1645124547000},"page":"174-190","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":5,"title":["Multilevel Monte-Carlo for Solving POMDPs Online"],"prefix":"10.1007","author":[{"given":"Marcus","family":"Hoerger","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Hanna","family":"Kurniawati","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Alberto","family":"Elfes","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2022,2,17]]},"reference":[{"key":"11_CR1","doi-asserted-by":"crossref","unstructured":"Agha-Mohammadi, A.A., Chakravorty, S., Amato, N.M.: FIRM: feedback controller-based information-state roadmap-a framework for motion planning under uncertainty. In: 2011 IEEE\/RSJ International Conference on Intelligent Robots and Systems (IROS), pp. 4284\u20134291. IEEE (2011)","DOI":"10.1109\/IROS.2011.6095010"},{"issue":"1","key":"11_CR2","doi-asserted-by":"publisher","first-page":"146","DOI":"10.1137\/110840546","volume":"10","author":"DF Anderson","year":"2012","unstructured":"Anderson, D.F., Higham, D.J.: Multilevel Monte Carlo for continuous time Markov chains, with applications in biochemical kinetics. Multiscale Model. Simul. 10(1), 146\u2013179 (2012)","journal-title":"Multiscale Model. Simul."},{"issue":"2","key":"11_CR3","doi-asserted-by":"publisher","first-page":"174","DOI":"10.1109\/78.978374","volume":"50","author":"MS Arulampalam","year":"2002","unstructured":"Arulampalam, M.S., Maskell, S., Gordon, N., Clapp, T.: A tutorial on particle filters for online nonlinear\/non-Gaussian Bayesian tracking. IEEE Trans. Signal Process. 50(2), 174\u2013188 (2002)","journal-title":"IEEE Trans. Signal Process."},{"issue":"2\u20133","key":"11_CR4","doi-asserted-by":"publisher","first-page":"235","DOI":"10.1023\/A:1013689704352","volume":"47","author":"P Auer","year":"2002","unstructured":"Auer, P., Cesa-Bianchi, N., Fischer, P.: Finite-time analysis of the multiarmed bandit problem. Mach. Learn. 47(2\u20133), 235\u2013256 (2002)","journal-title":"Mach. Learn."},{"key":"11_CR5","doi-asserted-by":"crossref","unstructured":"Bai, H., Hsu, D.: Unmanned aircraft collision avoidance using continuous-state POMDPs. In: Robotics: Science and Systems VII, vol. 1, pp. 1\u20138 (2012)","DOI":"10.15607\/RSS.2011.VII.001"},{"issue":"9","key":"11_CR6","doi-asserted-by":"publisher","first-page":"1288","DOI":"10.1177\/0278364914528255","volume":"33","author":"H Bai","year":"2014","unstructured":"Bai, H., Hsu, D., Lee, W.S.: Integrated perception and planning in the continuous space: a POMDP approach. Int. J. Robot. Res. 33(9), 1288\u20131302 (2014)","journal-title":"Int. J. Robot. Res."},{"key":"11_CR7","doi-asserted-by":"publisher","first-page":"661","DOI":"10.1016\/j.jcp.2016.03.027","volume":"314","author":"C Bierig","year":"2016","unstructured":"Bierig, C., Chernov, A.: Approximation of probability density functions by the multilevel Monte Carlo maximum entropy method. J. Comput. Phys. 314, 661\u2013681 (2016)","journal-title":"J. Comput. Phys."},{"issue":"3","key":"11_CR8","doi-asserted-by":"publisher","first-page":"607","DOI":"10.1287\/opre.1070.0496","volume":"56","author":"MB Giles","year":"2008","unstructured":"Giles, M.B.: Multilevel Monte Carlo path simulation. Oper. Res. 56(3), 607\u2013617 (2008)","journal-title":"Oper. Res."},{"key":"11_CR9","doi-asserted-by":"publisher","first-page":"259","DOI":"10.1017\/S096249291500001X","volume":"24","author":"MB Giles","year":"2015","unstructured":"Giles, M.B.: Multilevel Monte Carlo methods. Acta Numer. 24, 259\u2013328 (2015)","journal-title":"Acta Numer."},{"key":"11_CR10","doi-asserted-by":"crossref","unstructured":"He, R., Brunskill, E., Roy, N.: PUMA: planning under uncertainty with macro-actions. In: Proceedings of the National Conference on Artificial Intelligence, vol.\u00a02 (2010)","DOI":"10.1609\/aaai.v24i1.7749"},{"key":"11_CR11","series-title":"LNCS","doi-asserted-by":"publisher","first-page":"58","DOI":"10.1007\/3-540-45346-6_5","volume-title":"Large-Scale Scientific Computing","author":"S Heinrich","year":"2001","unstructured":"Heinrich, S.: Multilevel Monte Carlo methods. In: Margenov, S., Wa\u015bniewski, J., Yalamov, P. (eds.) Large-Scale Scientific Computing. LNCS, pp. 58\u201367. Springer, Heidelberg (2001). https:\/\/doi.org\/10.1007\/3-540-45346-6_5"},{"key":"11_CR12","doi-asserted-by":"crossref","unstructured":"Hoerger, M., Kurniawati, H., Elfes, A.: A software framework for planning under partial observability. In: Proceedings of the IEEE\/RSJ International Conference on Intelligent Robots and Systems (IROS), pp. 1\u20139. IEEE (2018)","DOI":"10.1109\/IROS.2018.8593714"},{"key":"11_CR13","unstructured":"Hoey, J., Poupart, P.: Solving POMDPs with continuous or large discrete observation spaces. In: Proceedings of the 19th International Joint Conference on Artificial Intelligence, IJCAI 2005, pp. 1332\u20131338. Morgan Kaufmann Publishers Inc., San Francisco (2005)"},{"key":"11_CR14","doi-asserted-by":"crossref","unstructured":"Horowitz, M., Burdick, J.: Interactive non-prehensile manipulation for grasping via POMDPs. In: 2013 IEEE International Conference on Robotics and Automation (ICRA), pp. 3257\u20133264. IEEE (2013)","DOI":"10.1109\/ICRA.2013.6631031"},{"key":"11_CR15","doi-asserted-by":"crossref","unstructured":"Hsiao, K., Kaelbling, L.P., Lozano-Perez, T.: Grasping POMDPs. In: 2007 IEEE International Conference on Robotics and Automation, pp. 4685\u20134692. IEEE (2007)","DOI":"10.1109\/ROBOT.2007.364201"},{"key":"11_CR16","unstructured":"Klimenko, D., Song, J., Kurniawati, H.: TAPIR: a software toolkit for approximating and adapting POMDP solutions online. In: Proceedings of the Australasian Conference on Robotics and Automation (2014)"},{"key":"11_CR17","series-title":"LNCS","doi-asserted-by":"publisher","first-page":"282","DOI":"10.1007\/11871842_29","volume-title":"ECML 2006","author":"L Kocsis","year":"2006","unstructured":"Kocsis, L., Szepesv\u00e1ri, C.: Bandit based Monte-Carlo planning. In: F\u00fcrnkranz, J., Scheffer, T., Spiliopoulou, M. (eds.) ECML 2006. LNCS, vol. 4212, pp. 282\u2013293. Springer, Heidelberg (2006). https:\/\/doi.org\/10.1007\/11871842_29"},{"issue":"3","key":"11_CR18","doi-asserted-by":"publisher","first-page":"308","DOI":"10.1177\/0278364910386986","volume":"30","author":"H Kurniawati","year":"2011","unstructured":"Kurniawati, H., Du, Y., Hsu, D., Lee, W.S.: Motion planning under uncertainty for robotic tasks with long time horizons. Int. J. Robot. Res. 30(3), 308\u2013323 (2011)","journal-title":"Int. J. Robot. Res."},{"key":"11_CR19","doi-asserted-by":"crossref","unstructured":"Kurniawati, H., Hsu, D., Lee, W.S.: SARSOP: efficient point-based POMDP planning by approximating optimally reachable belief spaces. In: Proceedings of the Robotics: Science and Systems (2008)","DOI":"10.15607\/RSS.2008.IV.009"},{"key":"11_CR20","unstructured":"Kurniawati, H., Yadav, V.: An online POMDP solver for uncertainty planning in dynamic environment. In: Proceedings of the International Symposium on Robotics Research (2013)"},{"key":"11_CR21","doi-asserted-by":"crossref","unstructured":"Luo, Y., Bai, H., Hsu, D., Lee, W.S.: Importance sampling for online planning under uncertainty. Int. J. Robot. Res. 38, 162\u2013181 (2018). p. 0278364918780322","DOI":"10.1177\/0278364918780322"},{"key":"11_CR22","unstructured":"Owen, A.B.: Monte Carlo Theory, Methods and Examples (2013)"},{"issue":"3","key":"11_CR23","doi-asserted-by":"publisher","first-page":"441","DOI":"10.1287\/moor.12.3.441","volume":"12","author":"CH Papadimitriou","year":"1987","unstructured":"Papadimitriou, C.H., Tsitsiklis, J.N.: The complexity of Markov decision processes. Math. Oper. Res. 12(3), 441\u2013450 (1987)","journal-title":"Math. Oper. Res."},{"key":"11_CR24","unstructured":"Pineau, J., Gordon, G., Thrun, S.: Point-based value iteration: an anytime algorithm for POMDPs (2003)"},{"key":"11_CR25","doi-asserted-by":"crossref","unstructured":"Rhee, C., Glynn, P.W.: A new approach to unbiased estimation for SDE\u2019s. In: Proceedings of the Winter Simulation Conference, p.\u00a017. Winter Simulation Conference (2012)","DOI":"10.1109\/WSC.2012.6465150"},{"key":"11_CR26","doi-asserted-by":"crossref","unstructured":"Seiler, K.M., Kurniawati, H., Singh, S.P.: An online and approximate solver for POMDPs with continuous action space. In: 2015 IEEE International Conference on Robotics and Automation (ICRA), pp. 2290\u20132297. IEEE (2015)","DOI":"10.1109\/ICRA.2015.7139503"},{"key":"11_CR27","unstructured":"Silver, D., Veness, J.: Monte-Carlo planning in large POMDPs. In: Advances in Neural Information Processing Systems, pp. 2164\u20132172 (2010)"},{"key":"11_CR28","unstructured":"Smith, R.: Open dynamics engine. http:\/\/www.ode.org\/"},{"key":"11_CR29","unstructured":"Smith, T., Simmons, R.: Point-based POMDP algorithms: improved analysis and implementation (2005)"},{"key":"11_CR30","unstructured":"Somani, A., Ye, N., Hsu, D., Lee, W.S.: DESPOT: Online POMDP planning with regularization. In: Advances In Neural Information Processing Systems, pp. 1772\u20131780 (2013)"},{"key":"11_CR31","unstructured":"Sondik, E.J.: The optimal control of partially observable Markov decision processes. Ph.D. thesis, Stanford, California (1971)"},{"key":"11_CR32","volume-title":"Robot Modeling and Control","author":"MW Spong","year":"2006","unstructured":"Spong, M.W., Hutchinson, S., Vidyasagar, M.: Robot Modeling and Control, vol. 3. Wiley, New York (2006)"},{"key":"11_CR33","doi-asserted-by":"crossref","unstructured":"Sunberg, Z.N., Kochenderfer, M.J.: Online algorithms for POMDPs with continuous state, action, and observation spaces. In: Twenty-Eighth International Conference on Automated Planning and Scheduling (2018)","DOI":"10.1609\/icaps.v28i1.13882"},{"key":"11_CR34","volume-title":"Reinforcement Learning: An Introduction","author":"R Sutton","year":"2012","unstructured":"Sutton, R., Barto, A.: Reinforcement Learning: An Introduction. MIT Press, Cambridge (2012)"},{"key":"11_CR35","doi-asserted-by":"crossref","unstructured":"Wang, E., Kurniawati, H., Kroese, D.P.: An on-line planner for POMDPs with large discrete action space: a quantile-based approach. In: ICAPS, pp. 273\u2013277. AAAI Press (2018)","DOI":"10.1609\/icaps.v28i1.13906"}],"container-title":["Springer Proceedings in Advanced Robotics","Robotics Research"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-030-95459-8_11","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2023,1,27]],"date-time":"2023-01-27T08:13:51Z","timestamp":1674807231000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-3-030-95459-8_11"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2022]]},"ISBN":["9783030954581","9783030954598"],"references-count":35,"URL":"https:\/\/doi.org\/10.1007\/978-3-030-95459-8_11","relation":{},"ISSN":["2511-1256","2511-1264"],"issn-type":[{"value":"2511-1256","type":"print"},{"value":"2511-1264","type":"electronic"}],"subject":[],"published":{"date-parts":[[2022]]},"assertion":[{"value":"17 February 2022","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ISRR","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"The International Symposium of Robotics Research","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Hanoi","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Vietnam","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2019","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"6 October 2019","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"10 October 2019","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"isrr2019","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"http:\/\/h2t-projects.webarchiv.kit.edu\/Projects\/ISRR2019\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}