{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,24]],"date-time":"2026-07-24T12:03:49Z","timestamp":1784894629067,"version":"3.55.0"},"reference-count":47,"publisher":"Springer Science and Business Media LLC","issue":"9","license":[{"start":{"date-parts":[[2026,7,1]],"date-time":"2026-07-01T00:00:00Z","timestamp":1782864000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2026,7,1]],"date-time":"2026-07-01T00:00:00Z","timestamp":1782864000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"name":"the Science and Technology Key Project of Henan Province","award":["252102210018"],"award-info":[{"award-number":["252102210018"]}]},{"DOI":"10.13039\/501100001809","name":"the National Natural Science Foundation of China","doi-asserted-by":"crossref","award":["62272421"],"award-info":[{"award-number":["62272421"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"crossref"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Vis Comput"],"published-print":{"date-parts":[[2026,7]]},"DOI":"10.1007\/s00371-026-04552-5","type":"journal-article","created":{"date-parts":[[2026,7,15]],"date-time":"2026-07-15T19:08:27Z","timestamp":1784142507000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["Semantic-guided GAN with frequency-enhanced transformer for non-line-of-sight reconstruction"],"prefix":"10.1007","volume":"42","author":[{"given":"Shaohui","family":"Jin","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zhihang","family":"Yan","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Mengge","family":"Liu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Sai","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xiu","family":"Ye","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Hao","family":"Liu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Mingliang","family":"Xu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2026,7,15]]},"reference":[{"issue":"20","key":"4552_CR1","doi-asserted-by":"publisher","first-page":"32349","DOI":"10.1364\/OE.439372","volume":"29","author":"C Pei","year":"2021","unstructured":"Pei, C., Zhang, A., Deng, Y., Xu, F., Wu, J., Li, D.U.-L., et al.: Dynamic non-line-of-sight imaging system based on the optimization of point spread functions. Opt. Express 29(20), 32349\u201332364 (2021)","journal-title":"Opt. Express"},{"issue":"1","key":"4552_CR2","doi-asserted-by":"publisher","first-page":"6526","DOI":"10.1038\/s41467-021-26721-x","volume":"12","author":"JH Nam","year":"2021","unstructured":"Nam, J.H., Brandt, E., Bauer, S., Liu, X., Renna, M., Tosi, A., et al.: Low-latency time-of-flight non-line-of-sight imaging at 5 frames per second. Nat. Commun. 12(1), 6526 (2021)","journal-title":"Nat. Commun."},{"key":"4552_CR3","doi-asserted-by":"crossref","unstructured":"Fujimura, Y., Kushida, T., Funatomi, T., Mukaigawa, Y.: Nlos-neus: Non-line-of-sight neural implicit surface. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 10532\u201310541. (2023)","DOI":"10.1109\/ICCV51070.2023.00966"},{"issue":"6","key":"4552_CR4","doi-asserted-by":"publisher","first-page":"318","DOI":"10.1038\/s42254-020-0174-8","volume":"2","author":"D Faccio","year":"2020","unstructured":"Faccio, D., Velten, A., Wetzstein, G.: Non-line-of-sight imaging. Nature Rev. Phy. 2(6), 318\u2013327 (2020)","journal-title":"Nature Rev. Phy."},{"key":"4552_CR5","doi-asserted-by":"crossref","unstructured":"Heide, F., Xiao, L., Heidrich, W., Hullin, M.B.: Diffuse mirrors: 3d reconstruction from diffuse indirect illumination using inexpensive time-of-flight sensors. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 3222\u20133229. (2014)","DOI":"10.1109\/CVPR.2014.418"},{"key":"4552_CR6","doi-asserted-by":"crossref","unstructured":"Kirmani, A., Hutchison, T., Davis, J., Raskar, R.: Looking around the corner using transient imaging. In: IEEE 12th International Conference on Computer Vision, pp. 159\u2013166. IEEE (2009)","DOI":"10.1109\/ICCV.2009.5459160"},{"issue":"1","key":"4552_CR7","doi-asserted-by":"publisher","first-page":"745","DOI":"10.1038\/ncomms1747","volume":"3","author":"A Velten","year":"2012","unstructured":"Velten, A., Willwacher, T., Gupta, O., Veeraraghavan, A., Bawendi, M.G., Raskar, R.: Recovering three-dimensional shape around a corner using ultrafast time-of-flight imaging. Nat. Commun. 3(1), 745 (2012)","journal-title":"Nat. Commun."},{"key":"4552_CR8","doi-asserted-by":"crossref","unstructured":"Li, Y., Peng, J., Ye, J., Zhang, Y., Xu, F., Xiong, Z.: Nlost: Non-line-of-sight imaging with transformer. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 13313\u201313322. (2023)","DOI":"10.1109\/CVPR52729.2023.01279"},{"key":"4552_CR9","doi-asserted-by":"crossref","unstructured":"Wang, J., Liu, X., Xiao, L., Shi, Z., Qiu, L., Fu, X.: Non-line-of-sight imaging with signal superresolution network. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 17420\u201317429. (2023)","DOI":"10.1109\/CVPR52729.2023.01671"},{"key":"4552_CR10","unstructured":"Gutierrez, D., Marco, J.: Looking around flatland: End-to-end 2d real-time nlos imaging. IEEE Transactions on Computational Imaging (2025)"},{"key":"4552_CR11","doi-asserted-by":"crossref","unstructured":"Laurenzis, M., Velten, A.: Non-line-of-sight active imaging of scattered photons. In: Electro-Optical Remote Sensing, Photonic Technologies, and Applications VII; and Military Applications in Hyperspectral Imaging and High Spatial Resolution Sensing, vol. 8897, pp. 47\u201353. (2013) . (SPIE)","DOI":"10.1117\/12.2028776"},{"issue":"3","key":"4552_CR12","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3269977","volume":"38","author":"F Heide","year":"2019","unstructured":"Heide, F., O\u2019Toole, M., Zang, K., Lindell, D.B., Diamond, S., Wetzstein, G.: Non-line-of-sight imaging with partial occluders and surface normals. ACM Transactions on Graphics (ToG) 38(3), 1\u201310 (2019)","journal-title":"ACM Transactions on Graphics (ToG)"},{"issue":"7696","key":"4552_CR13","doi-asserted-by":"publisher","first-page":"338","DOI":"10.1038\/nature25489","volume":"555","author":"M O\u2019Toole","year":"2018","unstructured":"O\u2019Toole, M., Lindell, D.B., Wetzstein, G.: Confocal non-line-of-sight imaging based on the light-cone transform. Nature 555(7696), 338\u2013341 (2018)","journal-title":"Nature"},{"issue":"4","key":"4552_CR14","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3306346.3322937","volume":"38","author":"DB Lindell","year":"2019","unstructured":"Lindell, D.B., Wetzstein, G., O\u2019Toole, M.: Wave-based non-line-of-sight imaging using fast fk migration. ACM Transactions on Graphics (ToG) 38(4), 1\u201313 (2019)","journal-title":"ACM Transactions on Graphics (ToG)"},{"key":"4552_CR15","doi-asserted-by":"crossref","unstructured":"Velten, A.: Non-line-of-sight imaging using phasor field virtual waves. In: Emerging Imaging and Sensing Technologies for Security and Defence V; and Advanced Manufacturing Technologies for Micro-and Nanosystems in Security and Defence III, vol. 11540, p. 115400 (2020). SPIE","DOI":"10.1117\/12.2574737"},{"key":"4552_CR16","doi-asserted-by":"crossref","unstructured":"Grau Chopite, J., Hullin, M.B., Wand, M., Iseringhausen, J.: Deep non-line-of-sight reconstruction. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 960\u2013969. (2020)","DOI":"10.1109\/CVPR42600.2020.00104"},{"key":"4552_CR17","doi-asserted-by":"publisher","DOI":"10.1016\/j.optlaseng.2022.107369","volume":"161","author":"Y Cao","year":"2023","unstructured":"Cao, Y., Liang, R., Zhu, W., Zhao, B., Chen, H., Shen, L., et al.: Dynamic-excitation-based steady-state non-line-of-sight imaging via multi-branch convolutional neural network. Opt. Lasers Eng. 161, 107369 (2023)","journal-title":"Opt. Lasers Eng."},{"key":"4552_CR18","doi-asserted-by":"publisher","first-page":"59095","DOI":"10.52202\/075280-2578","volume":"36","author":"Y Li","year":"2023","unstructured":"Li, Y., Zhang, Y., Ye, J., Xu, F., Xiong, Z.: Deep non-line-of-sight imaging from under-scanning measurements. Adv. Neural. Inf. Process. Syst. 36, 59095\u201359106 (2023)","journal-title":"Adv. Neural. Inf. Process. Syst."},{"key":"4552_CR19","unstructured":"Radford, A., Kim, J.W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., et al.: Learning transferable visual models from natural language supervision. In: International Conference on Machine Learning, pp. 8748\u20138763 (2021). PmLR"},{"key":"4552_CR20","doi-asserted-by":"crossref","unstructured":"Sun, Z., Fang, Y., Wu, T., Zhang, P., Zang, Y., Kong, S., et al.: Alpha-clip: A clip model focusing on wherever you want. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 13019\u201313029 (2024)","DOI":"10.1109\/CVPR52733.2024.01237"},{"key":"4552_CR21","doi-asserted-by":"crossref","unstructured":"Li, B., Li, X., Zhu, H., Jin, Y., Feng, R., Zhang, Z., et al.: Sed: Semantic-aware discriminator for image super-resolution. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 25784\u201325795 (2024)","DOI":"10.1109\/CVPR52733.2024.02436"},{"key":"4552_CR22","doi-asserted-by":"crossref","unstructured":"Cao, Y., Zhang, J., Frittoli, L., Cheng, Y., Shen, W., Boracchi, G.: Adaclip: Adapting clip with hybrid learnable prompts for zero-shot anomaly detection. In: European Conference on Computer Vision, pp. 55\u201372. Springer (2024)","DOI":"10.1007\/978-3-031-72761-0_4"},{"key":"4552_CR23","unstructured":"Zang, Y., Li, W., Zhou, K., Huang, C., Loy, C.C.: Unified vision and language prompt learning, (2022). arXiv:2210.07225 arXiv preprint"},{"issue":"1","key":"4552_CR24","doi-asserted-by":"publisher","first-page":"1645","DOI":"10.1038\/s41467-020-15157-4","volume":"11","author":"X Liu","year":"2020","unstructured":"Liu, X., Bauer, S., Velten, A.: Phasor field diffraction based reconstruction for fast non-line-of-sight imaging systems. Nat. Commun. 11(1), 1645 (2020)","journal-title":"Nat. Commun."},{"issue":"6","key":"4552_CR25","first-page":"1","volume":"39","author":"W Chen","year":"2020","unstructured":"Chen, W., Wei, F., Kutulakos, K.N., Rusinkiewicz, S., Heide, F.: Learned feature embeddings for non-line-of-sight imaging and recognition. ACM Transactions on Graphics (ToG) 39(6), 1\u201318 (2020)","journal-title":"ACM Transactions on Graphics (ToG)"},{"key":"4552_CR26","doi-asserted-by":"crossref","unstructured":"Yu, Y., Shen, S., Wang, Z., Huang, B., Wang, Y., Peng, X., et al.: Enhancing non-line-of-sight imaging via learnable inverse kernel and attention mechanisms. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 10563\u201310573 (2023)","DOI":"10.1109\/ICCV51070.2023.00969"},{"key":"4552_CR27","doi-asserted-by":"crossref","unstructured":"Su, X., Hong, Y., Ye, J.-t., Xu, F., Yuan, X.: Model-guided iterative diffusion sampling for nlos reconstruction. IEEE Journal of Selected Topics in Quantum Electronics 30(1: Single-Photon Technologies and Applications), 1\u201311 (2024)","DOI":"10.1109\/JSTQE.2024.3350971"},{"key":"4552_CR28","volume-title":"Auto-encoding variational bayes","author":"DP Kingma","year":"2013","unstructured":"Kingma, D.P., Welling, M., et al.: Auto-encoding variational bayes. Banff, Canada (2013)"},{"key":"4552_CR29","doi-asserted-by":"crossref","unstructured":"Wang, T.-C., Liu, M.-Y., Zhu, J.-Y., Tao, A., Kautz, J., Catanzaro, B.: High-resolution image synthesis and semantic manipulation with conditional gans. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 8798\u20138807. (2018)","DOI":"10.1109\/CVPR.2018.00917"},{"key":"4552_CR30","unstructured":"Nichol, A.Q., Dhariwal, P.: Improved denoising diffusion probabilistic models. In: International Conference on Machine Learning, pp. 8162\u20138171. (2021) . (PMLR)"},{"key":"4552_CR31","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1109\/TGRS.2025.3569550","volume":"63","author":"Y Li","year":"2025","unstructured":"Li, Y., Wang, L., Chen, S.: Smile: Spatial-spectral mamba interactive learning for infrared small target detection. IEEE Trans. Geosci. Remote Sens. 63, 1\u201314 (2025). https:\/\/doi.org\/10.1109\/TGRS.2025.3569550","journal-title":"IEEE Trans. Geosci. Remote Sens."},{"key":"4552_CR32","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1109\/TGRS.2025.3624449","volume":"63","author":"Y Li","year":"2025","unstructured":"Li, Y., Wang, L., Chen, S.: Frequency-spatial interaction reinforcement paradigm for infrared small target detection. IEEE Trans. Geosci. Remote Sens. 63, 1\u201315 (2025). https:\/\/doi.org\/10.1109\/TGRS.2025.3624449","journal-title":"IEEE Trans. Geosci. Remote Sens."},{"issue":"2","key":"4552_CR33","doi-asserted-by":"publisher","first-page":"1655","DOI":"10.1109\/TCSVT.2025.3601598","volume":"36","author":"Y Xue","year":"2026","unstructured":"Xue, Y., Jin, G., Zhong, B., Shen, T., Tan, L., Xue, C., Zheng, Y.: Fmtrack: Frequency-aware interaction and multi-expert fusion for rgb-t tracking. IEEE Trans. Circuits Syst. Video Technol. 36(2), 1655\u20131667 (2026). https:\/\/doi.org\/10.1109\/TCSVT.2025.3601598","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"issue":"10","key":"4552_CR34","doi-asserted-by":"publisher","first-page":"2886","DOI":"10.1038\/s41591-024-03139-8","volume":"30","author":"J Li","year":"2024","unstructured":"Li, J., Guan, Z., Wang, J., Cheung, C.Y., Zheng, Y., Lim, L.-L., Lim, C.C., Ruamviboonsuk, P., Raman, R., Corsino, L., et al.: Integrated image-based deep learning and language models for primary diabetes care. Nat. Med. 30(10), 2886\u20132896 (2024)","journal-title":"Nat. Med."},{"key":"4552_CR35","doi-asserted-by":"crossref","unstructured":"Xinming, X., Haoxuan, L., Zhouyu, G., Dian, Z., Yiming, Q., Yang, W., Huating, L., Chwee Teck, L., Tien Yin, W., Enhua, W., et al.: Urgent needs, opportunities and challenges of virtual reality in healthcare and medicine in the era of large language models. Virtual Reality & Intelligent Hardware 7(5), 453\u2013467 (2025)","DOI":"10.1016\/j.vrih.2025.08.001"},{"key":"4552_CR36","unstructured":"Vaswani, A., Shazeer, N., Parmar, N., Uszkoreit, J., Jones, L., Gomez, A.N., et al.: Attention is all you need. Advances in neural information processing systems 30 (2017)"},{"issue":"8","key":"4552_CR37","first-page":"9","volume":"1","author":"A Radford","year":"2019","unstructured":"Radford, A., Wu, J., Child, R., Luan, D., Amodei, D., Sutskever, I., et al.: Language models are unsupervised multitask learners. OpenAI blog 1(8), 9 (2019)","journal-title":"OpenAI blog"},{"issue":"1","key":"4552_CR38","doi-asserted-by":"publisher","first-page":"303","DOI":"10.1007\/s00371-024-03326-1","volume":"41","author":"Y Yu","year":"2025","unstructured":"Yu, Y., Yang, Y., Xing, J.: Pmgan: pretrained model-based generative adversarial network for text-to-image generation. Vis. Comput. 41(1), 303\u2013314 (2025)","journal-title":"Vis. Comput."},{"issue":"2","key":"4552_CR39","doi-asserted-by":"publisher","first-page":"127","DOI":"10.1016\/j.vrih.2024.08.002","volume":"7","author":"T Peng","year":"2025","unstructured":"Peng, T., Yin, W., Liu, J., Li, L., Hu, X.: Deconfounded fashion image captioning with transformer and multimodal retrieval. Virtual Reality & Intelligent Hardware 7(2), 127\u2013138 (2025)","journal-title":"Virtual Reality & Intelligent Hardware"},{"key":"4552_CR40","doi-asserted-by":"crossref","unstructured":"Yang, J., Qiu, P., Zhang, Y., Marcus, D.S., Sotiras, A.: D-net: Dynamic large kernel with dynamic feature fusion for volumetric medical image segmentation, (2024). arXiv:2403.10674 arXiv preprint","DOI":"10.2139\/ssrn.5093171"},{"key":"4552_CR41","doi-asserted-by":"crossref","unstructured":"Liu, X., Bauer, S., Velten, A.: Analysis of feature visibility in non-line-of-sight measurements. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 10140\u201310148. (2019)","DOI":"10.1109\/CVPR.2019.01038"},{"key":"4552_CR42","unstructured":"Rahaman, N., Baratin, A., Arpit, D., Draxler, F., Lin, M., Hamprecht, F., et al.: On the spectral bias of neural networks. In: International Conference on Machine Learning, pp. 5301\u20135310 (2019). PMLR"},{"key":"4552_CR43","first-page":"12104","volume":"33","author":"T Karras","year":"2020","unstructured":"Karras, T., Aittala, M., Hellsten, J., Laine, S., Lehtinen, J., Aila, T.: Training generative adversarial networks with limited data. Adv. Neural. Inf. Process. Syst. 33, 12104\u201312114 (2020)","journal-title":"Adv. Neural. Inf. Process. Syst."},{"key":"4552_CR44","doi-asserted-by":"crossref","unstructured":"Kirillov, A., Mintun, E., Ravi, N., Mao, H., Rolland, C., Gustafson, L., et al.: Segment anything. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 4015\u20134026 (2023)","DOI":"10.1109\/ICCV51070.2023.00371"},{"key":"4552_CR45","doi-asserted-by":"crossref","unstructured":"Yang, Y., Soatto, S.: Fda: Fourier domain adaptation for semantic segmentation. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 4085\u20134095. (2020)","DOI":"10.1109\/CVPR42600.2020.00414"},{"key":"4552_CR46","doi-asserted-by":"publisher","first-page":"109381","DOI":"10.52202\/079017-3472","volume":"37","author":"X Cui","year":"2024","unstructured":"Cui, X., Yue, H., Li, S., Yin, X., Hou, Y., Meng, Y., Zou, K., Hu, X., Yang, J.: Virtual scanning: Unsupervised non-line-of-sight imaging from irregularly undersampled transients. Adv. Neural. Inf. Process. Syst. 37, 109381\u2013109406 (2024)","journal-title":"Adv. Neural. Inf. Process. Syst."},{"key":"4552_CR47","unstructured":"Song, J., Meng, C., Ermon, S.: Denoising diffusion implicit models, (2020). arXiv:2010.02502 arXiv preprint"}],"container-title":["The Visual Computer"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00371-026-04552-5.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s00371-026-04552-5","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00371-026-04552-5.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,7,24]],"date-time":"2026-07-24T11:38:34Z","timestamp":1784893114000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s00371-026-04552-5"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,7]]},"references-count":47,"journal-issue":{"issue":"9","published-print":{"date-parts":[[2026,7]]}},"alternative-id":["4552"],"URL":"https:\/\/doi.org\/10.1007\/s00371-026-04552-5","relation":{},"ISSN":["0178-2789","1432-2315"],"issn-type":[{"value":"0178-2789","type":"print"},{"value":"1432-2315","type":"electronic"}],"subject":[],"published":{"date-parts":[[2026,7]]},"assertion":[{"value":"7 March 2026","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"21 May 2026","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"15 July 2026","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"The authors declare no conflict of interest.","order":1,"name":"Ethics","label":"Conflict of interest","group":{"name":"EthicsHeading","label":"Declarations"}}],"article-number":"414"}}