{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,8,7]],"date-time":"2026-08-07T08:47:55Z","timestamp":1786092475711,"version":"3.56.0"},"reference-count":56,"publisher":"Elsevier BV","license":[{"start":{"date-parts":[[2026,12,1]],"date-time":"2026-12-01T00:00:00Z","timestamp":1796083200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/tdm\/userlicense\/1.0\/"},{"start":{"date-parts":[[2026,12,1]],"date-time":"2026-12-01T00:00:00Z","timestamp":1796083200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/legal\/tdmrep-license"},{"start":{"date-parts":[[2026,12,1]],"date-time":"2026-12-01T00:00:00Z","timestamp":1796083200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-017"},{"start":{"date-parts":[[2026,12,1]],"date-time":"2026-12-01T00:00:00Z","timestamp":1796083200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"},{"start":{"date-parts":[[2026,12,1]],"date-time":"2026-12-01T00:00:00Z","timestamp":1796083200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-012"},{"start":{"date-parts":[[2026,12,1]],"date-time":"2026-12-01T00:00:00Z","timestamp":1796083200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2026,12,1]],"date-time":"2026-12-01T00:00:00Z","timestamp":1796083200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-004"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62172417"],"award-info":[{"award-number":["62172417"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62472424"],"award-info":[{"award-number":["62472424"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["elsevier.com","sciencedirect.com"],"crossmark-restriction":true},"short-container-title":["Pattern Recognition"],"published-print":{"date-parts":[[2026,12]]},"DOI":"10.1016\/j.patcog.2026.114141","type":"journal-article","created":{"date-parts":[[2026,6,4]],"date-time":"2026-06-04T15:14:10Z","timestamp":1780586050000},"page":"114141","update-policy":"https:\/\/doi.org\/10.1016\/elsevier_cm_policy","source":"Crossref","is-referenced-by-count":0,"special_numbering":"PB","title":["Dynamic Prompt Memory Network for video shadow detection"],"prefix":"10.1016","volume":"180","author":[{"ORCID":"https:\/\/orcid.org\/0000-0003-2734-915X","authenticated-orcid":false,"given":"Rui","family":"Yao","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zhicheng","family":"Li","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Hancheng","family":"Zhu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Kunyang","family":"Sun","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Jiaqi","family":"Zhao","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zhiwen","family":"Shao","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Abdulmotaleb El","family":"Saddik","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"78","reference":[{"key":"10.1016\/j.patcog.2026.114141_b1","doi-asserted-by":"crossref","DOI":"10.1016\/j.patcog.2025.112001","article-title":"An end-to-end shadow removal framework with an intuitive interaction scheme","volume":"170","author":"Yuan","year":"2026","journal-title":"Pattern Recognit."},{"key":"10.1016\/j.patcog.2026.114141_b2","doi-asserted-by":"crossref","DOI":"10.1016\/j.patcog.2024.111126","article-title":"Image shadow removal via multi-scale deep Retinex decomposition","volume":"159","author":"Huang","year":"2025","journal-title":"Pattern Recognit."},{"issue":"24","key":"10.1016\/j.patcog.2026.114141_b3","doi-asserted-by":"crossref","first-page":"3997","DOI":"10.1111\/mice.13451","article-title":"Generative adversarial network based on domain adaptation for crack segmentation in shadow environments","volume":"40","author":"Zhang","year":"2025","journal-title":"Comput.-Aided Civ. Infrastruct. Eng."},{"key":"10.1016\/j.patcog.2026.114141_b4","doi-asserted-by":"crossref","DOI":"10.1016\/j.patcog.2025.112048","article-title":"Cross-alignment for efficient visual object tracking","volume":"170","author":"Wang","year":"2026","journal-title":"Pattern Recognit."},{"key":"10.1016\/j.patcog.2026.114141_b5","series-title":"CVPR","first-page":"3116","article-title":"Video shadow detection via spatio-temporal interpolation consistency training","author":"Lu","year":"2022"},{"key":"10.1016\/j.patcog.2026.114141_b6","series-title":"ECCV","first-page":"705","article-title":"Learning shadow correspondence for video shadow detection","author":"Ding","year":"2022"},{"issue":"4","key":"10.1016\/j.patcog.2026.114141_b7","doi-asserted-by":"crossref","first-page":"166","DOI":"10.1007\/s11263-025-02715-w","article-title":"Video shadow detection with intra-and inter-video cooperation","volume":"134","author":"Wan","year":"2026","journal-title":"Int. J. Comput. Vis."},{"key":"10.1016\/j.patcog.2026.114141_b8","series-title":"ACM MM","first-page":"166","article-title":"Timeline and boundary guided diffusion network for video shadow detection","author":"Zhou","year":"2024"},{"key":"10.1016\/j.patcog.2026.114141_b9","series-title":"CVPR","first-page":"10449","article-title":"Scotch and soda: A transformer video shadow detection framework","author":"Liu","year":"2023"},{"key":"10.1016\/j.patcog.2026.114141_b10","series-title":"CVPR","first-page":"2715","article-title":"Triple-cooperative video shadow detection","author":"Chen","year":"2021"},{"issue":"5","key":"10.1016\/j.patcog.2026.114141_b11","first-page":"3782","article-title":"Detect any shadow: Segment anything for video shadow detection","volume":"34","author":"Wang","year":"2024","journal-title":"TCSVT"},{"key":"10.1016\/j.patcog.2026.114141_b12","series-title":"European Conference on Computer Vision","first-page":"196","article-title":"Two-stage video shadow detection via temporal-spatial adaption","author":"Duan","year":"2024"},{"key":"10.1016\/j.patcog.2026.114141_b13","first-page":"1925","article-title":"Revisiting shadow detection: A new benchmark dataset for complex world","volume":"30","author":"Hu","year":"2021","journal-title":"TIP"},{"key":"10.1016\/j.patcog.2026.114141_b14","article-title":"Image shadow detection and removal via illumination estimation and chromaticity guidance","author":"Li","year":"2025","journal-title":"IEEE Trans. Autom. Sci. Eng."},{"key":"10.1016\/j.patcog.2026.114141_b15","series-title":"CVPR","first-page":"5167","article-title":"Distraction-aware shadow detection","author":"Zheng","year":"2019"},{"key":"10.1016\/j.patcog.2026.114141_b16","series-title":"CVPR","first-page":"5611","article-title":"A multi-task mean teacher for semi-supervised shadow detection","author":"Chen","year":"2020"},{"issue":"1","key":"10.1016\/j.patcog.2026.114141_b17","doi-asserted-by":"crossref","DOI":"10.1049\/ipr2.70031","article-title":"Structure-aware transformer for shadow detection","volume":"19","author":"Sun","year":"2025","journal-title":"IET Image Process."},{"key":"10.1016\/j.patcog.2026.114141_b18","series-title":"ACM MM","first-page":"1202","article-title":"Sddnet: Style-guided dual-layer disentanglement network for shadow detection","author":"Cong","year":"2023"},{"key":"10.1016\/j.patcog.2026.114141_b19","series-title":"ICCV","first-page":"12687","article-title":"SILT: Shadow-aware iterative label tuning for learning to detect shadows from noisy labels","author":"Yang","year":"2023"},{"key":"10.1016\/j.patcog.2026.114141_b20","series-title":"Delving into dark regions for robust shadow detection","author":"Guan","year":"2024"},{"key":"10.1016\/j.patcog.2026.114141_b21","series-title":"ICCV","first-page":"4015","article-title":"Segment anything","author":"Kirillov","year":"2023"},{"key":"10.1016\/j.patcog.2026.114141_b22","series-title":"IJCAI","first-page":"1425","article-title":"Structure-aware spatial-temporal interaction network for video shadow detection","author":"Wei","year":"2024"},{"key":"10.1016\/j.patcog.2026.114141_b23","series-title":"ECCV","first-page":"54","article-title":"Videomatch: Matching based video object segmentation","author":"Hu","year":"2018"},{"key":"10.1016\/j.patcog.2026.114141_b24","doi-asserted-by":"crossref","DOI":"10.1109\/TPAMI.2026.3684742","article-title":"Learning when and how to update memory for video object segmentation","author":"Qiao","year":"2026","journal-title":"PAMI"},{"key":"10.1016\/j.patcog.2026.114141_b25","doi-asserted-by":"crossref","DOI":"10.1109\/TPAMI.2026.3692914","article-title":"Mask-guided self-supervised video object segmentation","author":"Quan","year":"2026","journal-title":"PAMI"},{"key":"10.1016\/j.patcog.2026.114141_b26","series-title":"ICASSP","first-page":"10362","article-title":"Beyond single video boundaries: Unified unsupervised video object segmentation with historical, future, and cross-video reasoning","author":"Fan","year":"2026"},{"key":"10.1016\/j.patcog.2026.114141_b27","series-title":"CVPR","first-page":"3623","article-title":"See more, know more: Unsupervised video object segmentation with co-attention siamese networks","author":"Lu","year":"2019"},{"key":"10.1016\/j.patcog.2026.114141_b28","series-title":"AAAI","first-page":"1245","article-title":"Iteratively selecting an easy reference frame makes unsupervised video object segmentation easier","volume":"vol. 36","author":"Lee","year":"2022"},{"issue":"10","key":"10.1016\/j.patcog.2026.114141_b29","doi-asserted-by":"crossref","first-page":"7509","DOI":"10.1007\/s00371-025-03820-0","article-title":"Unsupervised video object segmentation with mask transformer: boosting accuracy and efficiency through feature fusion","volume":"41","author":"Qu","year":"2025","journal-title":"Vis. Comput."},{"issue":"9","key":"10.1016\/j.patcog.2026.114141_b30","first-page":"1","article-title":"Pre-train, prompt, and predict: A systematic survey of prompting methods in natural language processing","volume":"55","author":"Liu","year":"2023","journal-title":"ACM Comput. Surv."},{"key":"10.1016\/j.patcog.2026.114141_b31","series-title":"ECCV","first-page":"709","article-title":"Visual prompt tuning","author":"Jia","year":"2022"},{"key":"10.1016\/j.patcog.2026.114141_b32","series-title":"ICCV","first-page":"17445","article-title":"E2VPT: An effective and efficient approach for visual prompt tuning","author":"Han","year":"2023"},{"key":"10.1016\/j.patcog.2026.114141_b33","series-title":"IEEE International Conference on Automatic Face and Gesture Recognition","first-page":"1","article-title":"Attention prompt tuning: Parameter-efficient adaptation of pre-trained models for action recognition","author":"Bandara","year":"2024"},{"key":"10.1016\/j.patcog.2026.114141_b34","series-title":"ECCV","first-page":"105","article-title":"Prompting visual-language models for efficient video understanding","author":"Ju","year":"2022"},{"key":"10.1016\/j.patcog.2026.114141_b35","series-title":"CVPR","first-page":"6565","article-title":"Vop: Text-video co-operative prompt tuning for cross-modal retrieval","author":"Huang","year":"2023"},{"key":"10.1016\/j.patcog.2026.114141_b36","series-title":"ICCV","first-page":"21741","article-title":"Ddp: Diffusion model for dense visual prediction","author":"Ji","year":"2023"},{"key":"10.1016\/j.patcog.2026.114141_b37","series-title":"ICCV","first-page":"9226","article-title":"Video object segmentation using space-time memory networks","author":"Oh","year":"2019"},{"key":"10.1016\/j.patcog.2026.114141_b38","article-title":"DINOv2: Learning robust visual features without supervision","author":"Oquab","year":"2024","journal-title":"Trans. Mach. Learn. Res. J."},{"key":"10.1016\/j.patcog.2026.114141_b39","series-title":"ICLR","article-title":"An image is worth 16x16 words: Transformers for image recognition at scale","author":"Dosovitskiy","year":"2021"},{"key":"10.1016\/j.patcog.2026.114141_b40","first-page":"9912","article-title":"Unsupervised learning of visual features by contrasting cluster assignments","volume":"33","author":"Caron","year":"2020","journal-title":"NIPS"},{"key":"10.1016\/j.patcog.2026.114141_b41","first-page":"16344","article-title":"Flashattention: Fast and memory-efficient exact attention with io-awareness","volume":"35","author":"Dao","year":"2022","journal-title":"NIPS"},{"key":"10.1016\/j.patcog.2026.114141_b42","series-title":"CVPR","first-page":"17773","article-title":"TransNeXt: Robust foveal visual perception for vision transformers","author":"Shi","year":"2024"},{"key":"10.1016\/j.patcog.2026.114141_b43","series-title":"ICCV","first-page":"6027","article-title":"Learning to upsample by learning to sample","author":"Liu","year":"2023"},{"key":"10.1016\/j.patcog.2026.114141_b44","series-title":"2016 Fourth International Conference on 3D Vision","first-page":"565","article-title":"V-net: Fully convolutional neural networks for volumetric medical image segmentation","author":"Milletari","year":"2016"},{"key":"10.1016\/j.patcog.2026.114141_b45","series-title":"CVPR","first-page":"2117","article-title":"Feature pyramid networks for object detection","author":"Lin","year":"2017"},{"key":"10.1016\/j.patcog.2026.114141_b46","series-title":"IJCAI","article-title":"R3net: Recurrent residual refinement network for saliency detection","volume":"vol. 684690","author":"Deng","year":"2018"},{"key":"10.1016\/j.patcog.2026.114141_b47","first-page":"12077","article-title":"SegFormer: Simple and efficient design for semantic segmentation with transformers","volume":"34","author":"Xie","year":"2021","journal-title":"NIPS"},{"key":"10.1016\/j.patcog.2026.114141_b48","series-title":"CVPR","first-page":"9481","article-title":"Feelvos: Fast end-to-end embedding learning for video object segmentation","author":"Voigtlaender","year":"2019"},{"key":"10.1016\/j.patcog.2026.114141_b49","first-page":"11781","article-title":"Rethinking space-time networks with improved memory coverage for efficient video object segmentation","volume":"34","author":"Cheng","year":"2021","journal-title":"NIPS"},{"key":"10.1016\/j.patcog.2026.114141_b50","series-title":"ICCV","first-page":"909","article-title":"A generalist framework for panoptic segmentation of images and videos","author":"Chen","year":"2023"},{"key":"10.1016\/j.patcog.2026.114141_b51","series-title":"ECCV","first-page":"121","article-title":"Bidirectional feature pyramid network with recurrent attention residual modules for shadow detection","author":"Zhu","year":"2018"},{"key":"10.1016\/j.patcog.2026.114141_b52","article-title":"Learning motion-guided multi-scale memory features for video shadow detection","author":"Lin","year":"2024","journal-title":"TCSVT"},{"key":"10.1016\/j.patcog.2026.114141_b53","series-title":"MMSegmentation: Openmmlab semantic segmentation toolbox and benchmark","author":"Contributors","year":"2020"},{"key":"10.1016\/j.patcog.2026.114141_b54","series-title":"ICLR","article-title":"LoRA: Low-rank adaptation of large language models","author":"Hu","year":"2022"},{"issue":"11","key":"10.1016\/j.patcog.2026.114141_b55","first-page":"4187","article-title":"Learning from synthetic shadows for shadow detection and removal","volume":"31","author":"Inoue","year":"2020","journal-title":"IEEE TCVST"},{"key":"10.1016\/j.patcog.2026.114141_b56","series-title":"Beit v2: Masked image modeling with vector-quantized visual tokenizers","author":"Peng","year":"2022"}],"container-title":["Pattern Recognition"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0031320326011064?httpAccept=text\/xml","content-type":"text\/xml","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0031320326011064?httpAccept=text\/plain","content-type":"text\/plain","content-version":"vor","intended-application":"text-mining"}],"deposited":{"date-parts":[[2026,8,7]],"date-time":"2026-08-07T08:15:17Z","timestamp":1786090517000},"score":1,"resource":{"primary":{"URL":"https:\/\/linkinghub.elsevier.com\/retrieve\/pii\/S0031320326011064"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,12]]},"references-count":56,"alternative-id":["S0031320326011064"],"URL":"https:\/\/doi.org\/10.1016\/j.patcog.2026.114141","relation":{},"ISSN":["0031-3203"],"issn-type":[{"value":"0031-3203","type":"print"}],"subject":[],"published":{"date-parts":[[2026,12]]},"assertion":[{"value":"Elsevier","name":"publisher","label":"This article is maintained by"},{"value":"Dynamic Prompt Memory Network for video shadow detection","name":"articletitle","label":"Article Title"},{"value":"Pattern Recognition","name":"journaltitle","label":"Journal Title"},{"value":"https:\/\/doi.org\/10.1016\/j.patcog.2026.114141","name":"articlelink","label":"CrossRef DOI link to publisher maintained version"},{"value":"article","name":"content_type","label":"Content Type"},{"value":"\u00a9 2026 Elsevier Ltd. All rights are reserved, including those for text and data mining, AI training, and similar technologies.","name":"copyright","label":"Copyright"}],"article-number":"114141"}}