{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,6]],"date-time":"2026-06-06T18:00:35Z","timestamp":1780768835316,"version":"3.54.1"},"reference-count":59,"publisher":"Elsevier BV","license":[{"start":{"date-parts":[[2026,10,1]],"date-time":"2026-10-01T00:00:00Z","timestamp":1790812800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/tdm\/userlicense\/1.0\/"},{"start":{"date-parts":[[2026,10,1]],"date-time":"2026-10-01T00:00:00Z","timestamp":1790812800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/legal\/tdmrep-license"},{"start":{"date-parts":[[2026,5,15]],"date-time":"2026-05-15T00:00:00Z","timestamp":1778803200000},"content-version":"vor","delay-in-days":0,"URL":"http:\/\/creativecommons.org\/licenses\/by\/4.0\/"}],"funder":[{"DOI":"10.13039\/501100006360","name":"Federal Ministry for Economic Affairs and Energy","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100006360","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["elsevier.com","sciencedirect.com"],"crossmark-restriction":true},"short-container-title":["Expert Systems with Applications"],"published-print":{"date-parts":[[2026,10]]},"DOI":"10.1016\/j.eswa.2026.132893","type":"journal-article","created":{"date-parts":[[2026,5,19]],"date-time":"2026-05-19T15:18:18Z","timestamp":1779203898000},"page":"132893","update-policy":"https:\/\/doi.org\/10.1016\/elsevier_cm_policy","source":"Crossref","is-referenced-by-count":0,"special_numbering":"C","title":["Deep reinforcement learning with instance-invariant baseline regularization for joint retrieval and relocation scheduling in multi-deep warehouses"],"prefix":"10.1016","volume":"328","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-4455-6997","authenticated-orcid":false,"given":"Funing","family":"Li","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0008-3910-6300","authenticated-orcid":false,"given":"Jifeng","family":"Zhou","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-4521-2096","authenticated-orcid":false,"given":"Yuan","family":"Tian","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-2863-2216","authenticated-orcid":false,"given":"Ruben","family":"Noortwyck","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0009-5739-4489","authenticated-orcid":false,"given":"Aya","family":"Ounissi","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Bingyuan","family":"Hong","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Kai","family":"Wen","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0006-0912-3922","authenticated-orcid":false,"given":"Qi","family":"Kang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-0091-1632","authenticated-orcid":false,"given":"Robert","family":"Schulz","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"78","reference":[{"key":"10.1016\/j.eswa.2026.132893_bib0001","doi-asserted-by":"crossref","first-page":"57","DOI":"10.1007\/s00170-016-9962-9","article-title":"Design and manage deep lane storage system layout. An iterative decision-support model","volume":"92","author":"Accorsi","year":"2017","journal-title":"The International Journal of Advanced Manufacturing Technology"},{"key":"10.1016\/j.eswa.2026.132893_bib0002","first-page":"13566","article-title":"Rudder: Return decomposition for delayed rewards","volume":"32","author":"Arjona-Medina","year":"2019","journal-title":"Advances in Neural Information Processing Systems"},{"issue":"3","key":"10.1016\/j.eswa.2026.132893_bib0003","doi-asserted-by":"crossref","first-page":"1699","DOI":"10.1111\/itor.12454","article-title":"A multistage heuristic for storage and retrieval problems in a warehouse with random storage","volume":"27","author":"Ballest\u00edn","year":"2020","journal-title":"International Transactions in Operational Research"},{"key":"10.1016\/j.eswa.2026.132893_bib0004","doi-asserted-by":"crossref","DOI":"10.1016\/j.cie.2021.107221","article-title":"Solving the online batching problem using deep reinforcement learning","volume":"156","author":"Cals","year":"2021","journal-title":"Computers & Industrial Engineering"},{"issue":"1","key":"10.1016\/j.eswa.2026.132893_bib0005","doi-asserted-by":"crossref","first-page":"96","DOI":"10.1016\/j.ejor.2011.12.039","article-title":"A mathematical formulation and complexity considerations for the blocks relocation problem","volume":"219","author":"Caserta","year":"2012","journal-title":"European Journal of Operational Research"},{"key":"10.1016\/j.eswa.2026.132893_bib0006","doi-asserted-by":"crossref","DOI":"10.1016\/j.eswa.2024.124589","article-title":"Deep reinforcement learning driven cost minimization for batch order scheduling in robotic mobile fulfillment systems","volume":"255","author":"Cheng","year":"2024","journal-title":"Expert Systems with Applications"},{"key":"10.1016\/j.eswa.2026.132893_bib0007","series-title":"Advances in neural information processing systems","first-page":"10707","article-title":"Shared experience actor-critic for multi-agent reinforcement learning","volume":"Vol. 33","author":"Christianos","year":"2020"},{"key":"10.1016\/j.eswa.2026.132893_bib0008","doi-asserted-by":"crossref","DOI":"10.1016\/j.eswa.2022.118680","article-title":"Integrated warehouse assignment and carton configuration optimization using deep clustering-based evolutionary algorithms","volume":"212","author":"Das","year":"2023","journal-title":"Expert Systems with Applications"},{"issue":"7897","key":"10.1016\/j.eswa.2026.132893_bib0009","doi-asserted-by":"crossref","first-page":"414","DOI":"10.1038\/s41586-021-04301-9","article-title":"Magnetic control of tokamak plasmas through deep reinforcement learning","volume":"602","author":"Degrave","year":"2022","journal-title":"Nature"},{"issue":"1","key":"10.1016\/j.eswa.2026.132893_bib0010","doi-asserted-by":"crossref","first-page":"269","DOI":"10.1007\/BF01386390","article-title":"A note on two problems in connexion with graphs","volume":"1","author":"Dijkstra","year":"1959","journal-title":"Numerische Mathematik"},{"issue":"2","key":"10.1016\/j.eswa.2026.132893_bib0011","doi-asserted-by":"crossref","first-page":"630","DOI":"10.1016\/j.ejor.2023.10.006","article-title":"Automated storage and retrieval system design with variant lane depths","volume":"314","author":"Dong","year":"2024","journal-title":"European Journal of Operational Research"},{"issue":"1","key":"10.1016\/j.eswa.2026.132893_bib0012","doi-asserted-by":"crossref","first-page":"111","DOI":"10.1007\/s10479-021-03967-8","article-title":"Retrieval scheduling in crane-based 3d automated retrieval and storage systems with shuttles","volume":"302","author":"Dong","year":"2021","journal-title":"Annals of Operations Research"},{"key":"10.1016\/j.eswa.2026.132893_bib0013","doi-asserted-by":"crossref","first-page":"1919","DOI":"10.1007\/s00170-019-03985-8","article-title":"Analytical models for cycle time and throughput evaluation of multi-shuttle deep-lane AVS\/RS","volume":"104","author":"D\u2019Antonio","year":"2019","journal-title":"The International Journal of Advanced Manufacturing Technology"},{"key":"10.1016\/j.eswa.2026.132893_bib0014","doi-asserted-by":"crossref","first-page":"1811","DOI":"10.1007\/s00170-017-0313-2","article-title":"Analytical models for the evaluation of deep-lane autonomous vehicle storage and retrieval system performance","volume":"94","author":"D\u2019Antonio","year":"2018","journal-title":"The International Journal of Advanced Manufacturing Technology"},{"issue":"1","key":"10.1016\/j.eswa.2026.132893_bib0015","doi-asserted-by":"crossref","first-page":"859","DOI":"10.1007\/s00170-019-04831-7","article-title":"An approach for a performance calculation of shuttle-based storage and retrieval systems with multiple-deep storage","volume":"107","author":"Eder","year":"2020","journal-title":"The International Journal of Advanced Manufacturing Technology"},{"issue":"1","key":"10.1016\/j.eswa.2026.132893_bib0016","doi-asserted-by":"crossref","first-page":"274","DOI":"10.1111\/itor.13135","article-title":"A reinforcement learning approach for transaction scheduling in a shuttle-based storage and retrieval system","volume":"31","author":"Ekren","year":"2024","journal-title":"International Transactions in Operational Research"},{"issue":"12","key":"10.1016\/j.eswa.2026.132893_bib0017","doi-asserted-by":"crossref","first-page":"6087","DOI":"10.1007\/s00170-025-16917-6","article-title":"Throughput of multiple-deep AS\/RS for heterogeneous paper reels depending on the number of stock keeping units, average filling levels, and order reorganization","volume":"141","author":"Fittinghoff","year":"2025","journal-title":"The International Journal of Advanced Manufacturing Technology"},{"key":"10.1016\/j.eswa.2026.132893_bib0018","unstructured":"Grand View Research (2024). Same day delivery market size, share & trends analysis report, 2025\u20132030. https:\/\/www.grandviewresearch.com\/industry-analysis\/same-day-delivery-market."},{"key":"10.1016\/j.eswa.2026.132893_bib0019","first-page":"1471","article-title":"Variance reduction techniques for gradient estimates in reinforcement learning","volume":"5","author":"Greensmith","year":"2004","journal-title":"Journal of Machine Learning Research"},{"issue":"3","key":"10.1016\/j.eswa.2026.132893_bib0020","doi-asserted-by":"crossref","first-page":"539","DOI":"10.1016\/j.ejor.2009.07.031","article-title":"Research on warehouse design and performance evaluation: A comprehensive review","volume":"203","author":"Gu","year":"2010","journal-title":"European Journal of Operational Research"},{"key":"10.1016\/j.eswa.2026.132893_bib0021","series-title":"Advances in neural information processing systems (NeurIPS)","first-page":"1025","article-title":"Inductive representation learning on large graphs","volume":"vol. 30","author":"Hamilton","year":"2017"},{"issue":"7","key":"10.1016\/j.eswa.2026.132893_bib0022","doi-asserted-by":"crossref","first-page":"787","DOI":"10.1038\/s42256-024-00861-3","article-title":"Lifelike agility and play in quadrupedal robots using reinforcement learning and generative pre-trained models","volume":"6","author":"Han","year":"2024","journal-title":"Nature Machine Intelligence"},{"issue":"2","key":"10.1016\/j.eswa.2026.132893_bib0023","doi-asserted-by":"crossref","first-page":"820","DOI":"10.1016\/j.ejor.2022.03.042","article-title":"Reinforcement learning for multi-item retrieval in the puzzle-based storage system","volume":"305","author":"He","year":"2023","journal-title":"European Journal of Operational Research"},{"key":"10.1016\/j.eswa.2026.132893_bib0024","doi-asserted-by":"crossref","DOI":"10.1016\/j.eswa.2025.128259","article-title":"Reinforcement learning-based simulation optimization for an integrated manufacturing-warehouse system: A two-stage approach","volume":"290","author":"Hosseini","year":"2025","journal-title":"Expert Systems with Applications"},{"issue":"20","key":"10.1016\/j.eswa.2026.132893_bib0025","doi-asserted-by":"crossref","DOI":"10.3390\/su152014891","article-title":"A simulation-based experimental design for analyzing energy consumption and order tardiness in warehousing systems","volume":"15","author":"Jeon","year":"2023","journal-title":"Sustainability"},{"key":"10.1016\/j.eswa.2026.132893_bib0026","doi-asserted-by":"crossref","DOI":"10.1016\/j.ijpe.2023.109088","article-title":"Deep reinforcement learning for one-warehouse multi-retailer inventory management","volume":"267","author":"Kaynov","year":"2024","journal-title":"International Journal of Production Economics"},{"issue":"6","key":"10.1016\/j.eswa.2026.132893_bib0027","doi-asserted-by":"crossref","first-page":"3455","DOI":"10.1007\/s11831-024-10084-9","article-title":"Design and performance measures of AVS\/r systems: A bibliometric literature review","volume":"31","author":"K\u0131z\u0131l\u0131rmak","year":"2024","journal-title":"Archives of Computational Methods in Engineering"},{"key":"10.1016\/j.eswa.2026.132893_bib0028","doi-asserted-by":"crossref","DOI":"10.1016\/j.tre.2020.102083","article-title":"Request acceptance in same-day delivery","volume":"143","author":"Klapp","year":"2020","journal-title":"Transportation Research Part E: Logistics and Transportation Review"},{"key":"10.1016\/j.eswa.2026.132893_bib0029","series-title":"2024\u202fIEEE\/RSJ International conference on intelligent robots and systems (IROS)","first-page":"677","article-title":"Scalable multi-agent reinforcement learning for warehouse logistics with robotic and human co-workers","author":"Krnjaic","year":"2024"},{"issue":"9","key":"10.1016\/j.eswa.2026.132893_bib0030","doi-asserted-by":"crossref","first-page":"2519","DOI":"10.1080\/00207543.2015.1061717","article-title":"Travel time model for double-deep shuttle-based storage and retrieval systems","volume":"54","author":"Lerher","year":"2016","journal-title":"International Journal of Production Research"},{"key":"10.1016\/j.eswa.2026.132893_bib0031","series-title":"Warehousing and material handling systems for the digital industry: The new challenges for the digital circular economy","first-page":"333","article-title":"Design and operation of single-and multi-deep shuttle-based storage and retrieval systems (SBS\/RS)","author":"Lerher","year":"2024"},{"key":"10.1016\/j.eswa.2026.132893_bib0032","doi-asserted-by":"crossref","first-page":"2503","DOI":"10.1007\/s10845-025-02654-w","article-title":"Topology-aware and highly generalizable deep reinforcement learning for efficient retrieval in multi-deep storage systems","volume":"37","author":"Li","year":"2026","journal-title":"Journal of Intelligent Manufacturing"},{"key":"10.1016\/j.eswa.2026.132893_bib0033","doi-asserted-by":"crossref","DOI":"10.1016\/j.asoc.2025.113283","article-title":"Intelligent optimization of e-commerce order packing using deep reinforcement learning with heuristic strategies","volume":"179","author":"Liang","year":"2025","journal-title":"Applied Soft Computing"},{"issue":"6","key":"10.1016\/j.eswa.2026.132893_bib0034","doi-asserted-by":"crossref","first-page":"2372","DOI":"10.1080\/00207543.2025.2609978","article-title":"Scheduling optimization of hybrid multi-deep robotic mobile fulfillment systems","volume":"64","author":"Liu","year":"2026","journal-title":"International Journal of Production Research"},{"issue":"2","key":"10.1016\/j.eswa.2026.132893_bib0035","doi-asserted-by":"crossref","first-page":"131","DOI":"10.23919\/CSMS.2021.0013","article-title":"Scheduling storage process of shuttle-based storage and retrieval systems based on reinforcement learning","volume":"1","author":"Luo","year":"2021","journal-title":"Complex System Modeling and Simulation"},{"issue":"3","key":"10.1016\/j.eswa.2026.132893_bib0036","doi-asserted-by":"crossref","first-page":"1449","DOI":"10.1007\/s00170-024-13160-3","article-title":"Space efficiency and throughput performance in AVS\/RS under variant lane depths","volume":"131","author":"Lupi","year":"2024","journal-title":"The International Journal of Advanced Manufacturing Technology"},{"key":"10.1016\/j.eswa.2026.132893_bib0037","doi-asserted-by":"crossref","DOI":"10.1016\/j.cor.2025.107112","article-title":"Deep reinforcement learning for dynamic order picking in warehouse operations","volume":"182","author":"Mahmoudinazlou","year":"2025","journal-title":"Computers & Operations Research"},{"issue":"9","key":"10.1016\/j.eswa.2026.132893_bib0038","doi-asserted-by":"crossref","first-page":"3403","DOI":"10.1007\/s00170-021-08169-x","article-title":"Relocation and storage assignment strategy evaluation in a multiple-deep tier captive automated vehicle storage and retrieval system with undetermined retrieval sequence","volume":"118","author":"Marolt","year":"2022","journal-title":"The International Journal of Advanced Manufacturing Technology"},{"issue":"15","key":"10.1016\/j.eswa.2026.132893_bib0039","doi-asserted-by":"crossref","first-page":"4991","DOI":"10.1080\/00207543.2022.2087568","article-title":"Model of a multiple-deep automated vehicles storage and retrieval system following the combination of depth-first storage and depth-first relocation strategies","volume":"61","author":"Marolt","year":"2023","journal-title":"International Journal of Production Research"},{"key":"10.1016\/j.eswa.2026.132893_bib0040","series-title":"Proceedings of the neural information processing systems track on datasets and benchmarks (NeurIPS)","article-title":"Benchmarking multi-agent deep reinforcement learning algorithms in cooperative tasks","author":"Papoudakis","year":"2021"},{"key":"10.1016\/j.eswa.2026.132893_bib0041","doi-asserted-by":"crossref","DOI":"10.1016\/j.cie.2025.111095","article-title":"Scheduling optimisation in a multi-deep tier-to-tier four-way shuttle storage and retrieval system","volume":"204","author":"Ren","year":"2025","journal-title":"Computers & Industrial Engineering"},{"key":"10.1016\/j.eswa.2026.132893_bib0042","first-page":"1","article-title":"Dynamic crane scheduling for green automated warehousing: Learning-based simulation-optimization approach","author":"Rizqi","year":"2025","journal-title":"Flexible Services and Manufacturing Journal"},{"key":"10.1016\/j.eswa.2026.132893_bib0043","unstructured":"Schulman, J., Wolski, F., Dhariwal, P., Radford, A., & Klimov, O. (2017). Proximal policy optimization algorithms. arXiv preprint arXiv: 1707.06347."},{"issue":"2","key":"10.1016\/j.eswa.2026.132893_bib0044","doi-asserted-by":"crossref","first-page":"141","DOI":"10.1007\/s10732-018-9390-0","article-title":"A reactive GRASP metaheuristic for the container retrieval problem to reduce crane\u2019s working time","volume":"25","author":"da Silva Firmino","year":"2019","journal-title":"Journal of Heuristics"},{"key":"10.1016\/j.eswa.2026.132893_bib0045","series-title":"Reinforcement learning: An introduction","author":"Sutton","year":"2018"},{"issue":"3","key":"10.1016\/j.eswa.2026.132893_bib0046","doi-asserted-by":"crossref","first-page":"200","DOI":"10.1016\/j.icte.2020.05.003","article-title":"Implementing action mask in proximal policy optimization (PPO) algorithm","volume":"6","author":"Tang","year":"2020","journal-title":"ICT Express"},{"issue":"1","key":"10.1016\/j.eswa.2026.132893_bib0047","doi-asserted-by":"crossref","first-page":"3930","DOI":"10.1038\/s41467-025-59288-y","article-title":"Interactive symbolic regression with co-design mechanism through offline reinforcement learning","volume":"16","author":"Tian","year":"2025","journal-title":"Nature Communications"},{"key":"10.1016\/j.eswa.2026.132893_bib0048","series-title":"Advances in neural information processing systems (neurIPS)","first-page":"5998","article-title":"Attention is all you need","volume":"Vol. 30","author":"Vaswani","year":"2017"},{"key":"10.1016\/j.eswa.2026.132893_bib0049","doi-asserted-by":"crossref","first-page":"81","DOI":"10.1016\/j.jmsy.2024.11.010","article-title":"Flexible robotic cell scheduling with graph neural network based deep reinforcement learning","volume":"78","author":"Wang","year":"2025","journal-title":"Journal of Manufacturing Systems"},{"issue":"3","key":"10.1016\/j.eswa.2026.132893_bib0050","doi-asserted-by":"crossref","first-page":"229","DOI":"10.1023\/A:1022672621406","article-title":"Simple statistical gradient-following algorithms for connectionist reinforcement learning","volume":"8","author":"Williams","year":"1992","journal-title":"Machine Learning"},{"issue":"3","key":"10.1016\/j.eswa.2026.132893_bib0051","doi-asserted-by":"crossref","first-page":"757","DOI":"10.1080\/00207543.2014.921351","article-title":"Travel time analysis for the double-deep dual-shuttle AS\/RS","volume":"53","author":"Xu","year":"2015","journal-title":"International Journal of Production Research"},{"issue":"3","key":"10.1016\/j.eswa.2026.132893_bib0052","doi-asserted-by":"crossref","first-page":"861","DOI":"10.1007\/s10586-018-2873-9","article-title":"Optimal dimensions for multi-deep storage systems under class-based storage policies","volume":"22","author":"Xu","year":"2019","journal-title":"Cluster Computing"},{"issue":"21","key":"10.1016\/j.eswa.2026.132893_bib0053","doi-asserted-by":"crossref","first-page":"7333","DOI":"10.1080\/00207543.2022.2148011","article-title":"Data-driven hierarchical learning and real-time decision-making of equipment scheduling and location assignment in automatic high-density storage systems","volume":"61","author":"Xu","year":"2023","journal-title":"International Journal of Production Research"},{"key":"10.1016\/j.eswa.2026.132893_bib0054","doi-asserted-by":"crossref","DOI":"10.1016\/j.engappai.2025.113448","article-title":"Real-time transaction scheduling in multiple-deep tier-to-tier shuttle-based storage and retrieval systems by using deep q-learning","volume":"165","author":"Xu","year":"2026","journal-title":"Engineering Applications of Artificial Intelligence"},{"key":"10.1016\/j.eswa.2026.132893_bib0055","doi-asserted-by":"crossref","DOI":"10.1016\/j.tre.2022.102712","article-title":"Reinforcement learning for logistics and supply chain management: Methodologies, state of the art, and future opportunities","volume":"162","author":"Yan","year":"2022","journal-title":"Transportation Research Part E: Logistics and Transportation Review"},{"issue":"2","key":"10.1016\/j.eswa.2026.132893_bib0056","doi-asserted-by":"crossref","first-page":"696","DOI":"10.1016\/j.ejor.2022.11.037","article-title":"Scheduling shuttles in deep-lane shuttle-based storage systems","volume":"308","author":"Yang","year":"2023","journal-title":"European Journal of Operational Research"},{"key":"10.1016\/j.eswa.2026.132893_bib0057","series-title":"NeurIPS","article-title":"The surprising effectiveness of PPO in cooperative multi-agent games","author":"Yu","year":"2022"},{"key":"10.1016\/j.eswa.2026.132893_bib0058","first-page":"3562","article-title":"Learn whatnot to learn: Action elimination with deep reinforcement learning","volume":"31","author":"Zahavy","year":"2018","journal-title":"Advances in Neural Information Processing Systems"},{"key":"10.1016\/j.eswa.2026.132893_bib0059","doi-asserted-by":"crossref","DOI":"10.1016\/j.asoc.2025.114277","article-title":"A multi-agent reinforcement learning with multi-task learning and graph edge attention networks for dynamic flexible job shop scheduling","volume":"187","author":"Zhao","year":"2026","journal-title":"Applied Soft Computing"}],"container-title":["Expert Systems with Applications"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0957417426018051?httpAccept=text\/xml","content-type":"text\/xml","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0957417426018051?httpAccept=text\/plain","content-type":"text\/plain","content-version":"vor","intended-application":"text-mining"}],"deposited":{"date-parts":[[2026,6,6]],"date-time":"2026-06-06T17:38:43Z","timestamp":1780767523000},"score":1,"resource":{"primary":{"URL":"https:\/\/linkinghub.elsevier.com\/retrieve\/pii\/S0957417426018051"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,10]]},"references-count":59,"alternative-id":["S0957417426018051"],"URL":"https:\/\/doi.org\/10.1016\/j.eswa.2026.132893","relation":{},"ISSN":["0957-4174"],"issn-type":[{"value":"0957-4174","type":"print"}],"subject":[],"published":{"date-parts":[[2026,10]]},"assertion":[{"value":"Elsevier","name":"publisher","label":"This article is maintained by"},{"value":"Deep reinforcement learning with instance-invariant baseline regularization for joint retrieval and relocation scheduling in multi-deep warehouses","name":"articletitle","label":"Article Title"},{"value":"Expert Systems with Applications","name":"journaltitle","label":"Journal Title"},{"value":"https:\/\/doi.org\/10.1016\/j.eswa.2026.132893","name":"articlelink","label":"CrossRef DOI link to publisher maintained version"},{"value":"article","name":"content_type","label":"Content Type"},{"value":"\u00a9 2026 The Author(s). Published by Elsevier Ltd.","name":"copyright","label":"Copyright"}],"article-number":"132893"}}