{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,13]],"date-time":"2026-07-13T06:11:07Z","timestamp":1783923067889,"version":"3.55.0"},"publisher-location":"Singapore","reference-count":23,"publisher":"Springer Nature Singapore","isbn-type":[{"value":"9789819234400","type":"print"},{"value":"9789819234417","type":"electronic"}],"license":[{"start":{"date-parts":[[2026,7,14]],"date-time":"2026-07-14T00:00:00Z","timestamp":1783987200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2026,7,14]],"date-time":"2026-07-14T00:00:00Z","timestamp":1783987200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2027]]},"DOI":"10.1007\/978-981-92-3441-7_11","type":"book-chapter","created":{"date-parts":[[2026,7,13]],"date-time":"2026-07-13T05:35:09Z","timestamp":1783920909000},"page":"121-133","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["MS-LSDT: Multi-Scale Long\u2013Short Goal-Conditioned Decision Transformers for Offline Surgical Robot Learning in SurRoL"],"prefix":"10.1007","author":[{"given":"Zhaoye","family":"Wu","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Chenxi","family":"Huang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Wei","family":"Zhou","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yunxiang","family":"Yang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yujun","family":"Chen","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yulong","family":"Fu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zhaoan","family":"Yang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0004-8599-5306","authenticated-orcid":false,"given":"Kunzhai","family":"Huang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Qinglang","family":"Guo","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2026,7,14]]},"reference":[{"key":"11_CR1","volume-title":"Proceedings International Conference on Machine Learning (ICML)","author":"S Fujimoto","year":"2019","unstructured":"Fujimoto, S., Meger, D., Precup, D.: Off-policy deep reinforcement learning without exploration. In: Proceedings International Conference on Machine Learning (ICML) (2019)"},{"key":"11_CR2","unstructured":"Kumar, A., Fu, J., Tucker, G., Levine, S.: BEAR: stabilizing offline Q-learning via bootstrapping error reduction. arXiv preprint https:\/\/arxiv.org\/abs\/1906.00949, (2019)"},{"key":"11_CR3","unstructured":"Wu, Y., Tucker, G., Nachum, O.: Behavior regularized offline reinforcement learning. arXiv preprint https:\/\/arxiv.org\/abs\/1911.11361, (2019)"},{"key":"11_CR4","volume-title":"Advances in Neural Information Processing Systems (NeurIPS)","author":"A Kumar","year":"2020","unstructured":"Kumar, A., Zhou, A., Tucker, G., Levine, S.: Conservative Q-learning for offline reinforcement learning. In: Advances in Neural Information Processing Systems (NeurIPS) (2020)"},{"key":"11_CR5","volume-title":"International Conference on Learning Representations (ICLR)","author":"I Kostrikov","year":"2022","unstructured":"Kostrikov, I., Nair, A., Levine, S.: Offline reinforcement learning with implicit Q-learning. In: International Conference on Learning Representations (ICLR) (2022)"},{"key":"11_CR6","volume-title":"Advances in Neural Information Processing Systems (NeurIPS)","author":"S Fujimoto","year":"2021","unstructured":"Fujimoto, S., Gu, S.S.: A minimalist approach to offline reinforcement learning. In: Advances in Neural Information Processing Systems (NeurIPS) (2021)"},{"key":"11_CR7","unstructured":"Peng, X. B., Kumar, A., Zhang, G., Levine, S.: Advantage-weighted regression: simple and scalable off-policy reinforcement learning. arXiv preprint https:\/\/arxiv.org\/abs\/1910.00177, (2019)"},{"key":"11_CR8","volume-title":"NeurIPS Offline Reinforcement Learning Workshop","author":"A Nair","year":"2020","unstructured":"Nair, A., Dalal, M., Gupta, A., Levine, S.: AWAC: Accelerating online reinforcement learning with offline datasets. In: NeurIPS Offline Reinforcement Learning Workshop (2020)"},{"key":"11_CR9","unstructured":"Yu, T. et al.: MOPO: model-based offline policy optimization. arXiv preprint https:\/\/arxiv.org\/abs\/2005.13239, (2020)"},{"key":"11_CR10","unstructured":"Kidambi, R., Rajeswaran, A., Netrapalli, P., Joachims, T.: MOReL: model-based offline reinforcement learning. arXiv preprint https:\/\/arxiv.org\/abs\/2005.05951, (2020)"},{"key":"11_CR11","volume-title":"Advances in Neural Information Processing Systems (NeurIPS)","author":"L Chen","year":"2021","unstructured":"Chen, L. et al.: Decision transformer: Reinforcement learning via sequence modeling. In: Advances in Neural Information Processing Systems (NeurIPS) (2021)"},{"key":"11_CR12","unstructured":"Vaswani, A. et al.: Attention is all you need. arXiv preprint https:\/\/arxiv.org\/abs\/1706.03762, (2017)"},{"key":"11_CR13","doi-asserted-by":"crossref","unstructured":"Fu, J., Long, Y., Chen, K., Wei, W., Dou, Q.: Multi-objective cross-task learning via goal-conditioned GPT-based decision transformers for surgical robot task automation. arXiv preprint https:\/\/arxiv.org\/abs\/2405.18757, (2024)","DOI":"10.1109\/ICRA57147.2024.10611051"},{"key":"11_CR14","unstructured":"Zhang, Y. et al.: SurRoL: an open-source reinforcement learning centered and dVRK compatible platform for surgical robot learning. arXiv preprint https:\/\/arxiv.org\/abs\/2108.13035, (2021)"},{"key":"11_CR15","unstructured":"Fu, J., Kumar, A., Nachum, O., Tucker, G., Levine, S.: D4RL: datasets for deep data-driven reinforcement learning. arXiv preprint https:\/\/arxiv.org\/abs\/2004.07219, (2020)"},{"key":"11_CR16","unstructured":"Mandlekar, A. et al.: RoboMimic: a benchmark for robot imitation learning. arXiv preprint https:\/\/arxiv.org\/abs\/2108.03298, (2021)"},{"key":"11_CR17","unstructured":"Levine, S., Kumar, A., Tucker, G., Fu, J.: Offline reinforcement learning: tutorial, review, and perspectives on open problems. arXiv preprint https:\/\/arxiv.org\/abs\/2005.01643, (2020)"},{"key":"11_CR18","volume-title":"Proceedings of Interspeech","author":"A Gulati","year":"2020","unstructured":"Gulati, A. et al.: Conformer: Convolution-augmented transformer for speech recognition. In: Proceedings of Interspeech (2020)"},{"key":"11_CR19","volume-title":"Proceedings of the IEEE\/CVF International Conference on Computer Vision (ICCV)","author":"H Wu","year":"2021","unstructured":"Wu, H. et al.: CvT: Introducing convolutions to vision transformers. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision (ICCV) (2021)"},{"key":"11_CR20","unstructured":"Dai, Z., Liu, H., Le, Q. V., Tan, M.: CoAtNet: marrying convolution and attention for all data sizes. arXiv preprint https:\/\/arxiv.org\/abs\/2106.04803, (2021)"},{"key":"11_CR21","volume-title":"International Conference on Learning Representations (ICLR)","author":"F Wu","year":"2019","unstructured":"Wu, F., Fan, A., Baevski, A., Dauphin, Y.N., Auli, M.: Pay less attention with lightweight and dynamic convolutions. In: International Conference on Learning Representations (ICLR) (2019)"},{"key":"11_CR22","unstructured":"Howard, A. G. et al.: MobileNets: efficient convolutional neural networks for mobile vision applications. arXiv preprint https:\/\/arxiv.org\/abs\/1704.04861, (2017)"},{"key":"11_CR23","volume-title":"Advances in Neural Information Processing Systems (NeurIPS)","author":"M Andrychowicz","year":"2017","unstructured":"Andrychowicz, M. et al.: Hindsight experience replay. In: Advances in Neural Information Processing Systems (NeurIPS) (2017)"}],"container-title":["Lecture Notes in Computer Science","Advanced Intelligent Computing Technology and Applications"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-981-92-3441-7_11","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,7,13]],"date-time":"2026-07-13T05:35:11Z","timestamp":1783920911000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-981-92-3441-7_11"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,7,14]]},"ISBN":["9789819234400","9789819234417"],"references-count":23,"URL":"https:\/\/doi.org\/10.1007\/978-981-92-3441-7_11","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2026,7,14]]},"assertion":[{"value":"14 July 2026","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ICIC","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"International Conference on Intelligent Computing","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Toronto","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Canada","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2026","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"22 July 2026","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"26 July 2026","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"22","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"icic2026a","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"http:\/\/www.ic-icc.cn\/2026\/index.htm","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}