{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,31]],"date-time":"2026-07-31T04:58:02Z","timestamp":1785473882153,"version":"3.56.0"},"reference-count":40,"publisher":"Springer Science and Business Media LLC","issue":"4","license":[{"start":{"date-parts":[[2025,5,15]],"date-time":"2025-05-15T00:00:00Z","timestamp":1747267200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2025,5,15]],"date-time":"2025-05-15T00:00:00Z","timestamp":1747267200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"name":"National Key Research and Development Program of China","award":["2022YFE0100100"],"award-info":[{"award-number":["2022YFE0100100"]}]},{"DOI":"10.13039\/501100019065","name":"Tianjin Municipal Science and Technology Program","doi-asserted-by":"publisher","award":["19ZXZNGX00050"],"award-info":[{"award-number":["19ZXZNGX00050"]}],"id":[{"id":"10.13039\/501100019065","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Machine Vision and Applications"],"published-print":{"date-parts":[[2025,7]]},"DOI":"10.1007\/s00138-025-01694-9","type":"journal-article","created":{"date-parts":[[2025,5,15]],"date-time":"2025-05-15T09:29:32Z","timestamp":1747301372000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":2,"title":["Panet: polarization-aware instance segmentation in autonomous driving"],"prefix":"10.1007","volume":"36","author":[{"given":"Caimei","family":"Wang","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Hui","family":"Xie","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Fan","family":"Guo","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Kang","family":"Song","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2025,5,15]]},"reference":[{"key":"1694_CR1","doi-asserted-by":"crossref","unstructured":"De\u00a0Brabandere, B., Neven, D., Van\u00a0Gool, L.: Semantic instance segmentation for autonomous driving. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (CVPR) Workshops (2017)","DOI":"10.1109\/CVPRW.2017.66"},{"issue":"11","key":"1694_CR2","doi-asserted-by":"publisher","first-page":"21405","DOI":"10.1109\/TITS.2022.3177615","volume":"23","author":"H Wang","year":"2022","unstructured":"Wang, H., Chen, Y., Cai, Y., Chen, L., Li, Y., Sotelo, M.A., Li, Z.: Sfnet-n: an improved sfnet algorithm for semantic segmentation of low-light autonomous driving road scenes. IEEE Trans. Intell. Transp. Syst. 23(11), 21405\u201321417 (2022). https:\/\/doi.org\/10.1109\/TITS.2022.3177615","journal-title":"IEEE Trans. Intell. Transp. Syst."},{"key":"1694_CR3","doi-asserted-by":"crossref","unstructured":"Fu, G., Zhang, Q., Song, C., Lin, Q., Xiao, C.: Specular highlight removal for real-world images. In: Computer Graphics Forum, vol. 38, pp. 253\u2013263. Wiley (2019)","DOI":"10.1111\/cgf.13834"},{"issue":"3","key":"1694_CR4","doi-asserted-by":"publisher","first-page":"209","DOI":"10.1109\/TCE.2022.3188968","volume":"68","author":"Q Bao","year":"2022","unstructured":"Bao, Q., Liu, Y., Gang, B., Yang, W., Liao, Q.: S 2 net: shadow mask-based semantic-aware network for single-image shadow removal. IEEE Trans. Consum. Electron. 68(3), 209\u2013220 (2022)","journal-title":"IEEE Trans. Consum. Electron."},{"issue":"12","key":"1694_CR5","doi-asserted-by":"publisher","first-page":"21129","DOI":"10.1109\/TITS.2024.3461468","volume":"25","author":"W Liu","year":"2024","unstructured":"Liu, W., Wang, S., Zhu, J., Xie, X., Zhang, L.: Domain adaptation transformer for unsupervised driving-scene segmentation in adverse conditions. IEEE Trans. Intell. Transp. Syst. 25(12), 21129\u201321141 (2024). https:\/\/doi.org\/10.1109\/TITS.2024.3461468","journal-title":"IEEE Trans. Intell. Transp. Syst."},{"key":"1694_CR6","unstructured":"Hendrycks, D., Dietterich, T.: Benchmarking neural network robustness to common corruptions and perturbations. arXiv preprint arXiv:1903.12261 (2019)"},{"key":"1694_CR7","unstructured":"Hendrycks, D., Mu, N., Cubuk, E.D., Zoph, B., Gilmer, J., Lakshminarayanan, B.: Augmix: a simple data processing method to improve robustness and uncertainty. arXiv preprint arXiv:1912.02781 (2019)"},{"issue":"1","key":"1694_CR8","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1186\/s40537-019-0197-0","volume":"6","author":"C Shorten","year":"2019","unstructured":"Shorten, C., Khoshgoftaar, T.M.: A survey on image data augmentation for deep learning. J. Big Data 6(1), 1\u201348 (2019)","journal-title":"J. Big Data"},{"key":"1694_CR9","doi-asserted-by":"crossref","unstructured":"Hazirbas, C., Ma, L., Domokos, C., Cremers, D.: Fusenet: Incorporating depth into semantic segmentation via fusion-based cnn architecture. In: Asian Conference on Computer Vision, pp. 213\u2013228. Springer (2016)","DOI":"10.1007\/978-3-319-54181-5_14"},{"key":"1694_CR10","doi-asserted-by":"crossref","unstructured":"Cheng, B., Collins, M.D., Zhu, Y., Liu, T., Huang, T.S., Adam, H., Chen, L.-C.: Panoptic-deeplab: a simple, strong, and fast baseline for bottom-up panoptic segmentation. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 12475\u201312485 (2020)","DOI":"10.1109\/CVPR42600.2020.01249"},{"key":"1694_CR11","doi-asserted-by":"crossref","unstructured":"He, K., Gkioxari, G., Dollar, P., Girshick, R.: Mask r-cnn. In: Proceedings of the IEEE International Conference on Computer Vision, pp. 2961\u20132969 (2017)","DOI":"10.1109\/ICCV.2017.322"},{"key":"1694_CR12","first-page":"17721","volume":"33","author":"X Wang","year":"2020","unstructured":"Wang, X., Zhang, R., Kong, T., Li, L., Shen, C.: Solov2: dynamic and fast instance segmentation. Adv. Neural Inf. Process. Syst. 33, 17721\u201317732 (2020)","journal-title":"Adv. Neural Inf. Process. Syst."},{"key":"1694_CR13","doi-asserted-by":"crossref","unstructured":"Wang, X., Girshick, R., Gupta, A., He, K.: Non-local neural networks. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 7794\u20137803 (2018)","DOI":"10.1109\/CVPR.2018.00813"},{"issue":"11","key":"1694_CR14","doi-asserted-by":"publisher","first-page":"1059","DOI":"10.1109\/34.61705","volume":"12","author":"LB Wolff","year":"1990","unstructured":"Wolff, L.B.: Polarization-based material classification from specular reflection. IEEE Trans. Pattern Anal. Mach. Intell. 12(11), 1059\u20131071 (1990)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"issue":"6","key":"1694_CR15","doi-asserted-by":"publisher","first-page":"1653","DOI":"10.1109\/TIP.2006.871114","volume":"15","author":"GA Atkinson","year":"2006","unstructured":"Atkinson, G.A., Hancock, E.R.: Recovery of surface orientation from diffuse polarization. IEEE Trans. Image Process. 15(6), 1653\u20131664 (2006)","journal-title":"IEEE Trans. Image Process."},{"key":"1694_CR16","doi-asserted-by":"crossref","unstructured":"Ba, Y., Gilbert, A., Wang, F., Yang, J., Chen, R., Wang, Y., Yan, L., Shi, B., Kadambi, A.: Deep shape from polarization. In: Computer Vision\u2014ECCV 2020: 16th European Conference, Glasgow, UK, August 23\u201328, 2020, Proceedings, Part XXIV 16, pp. 554\u2013571. Springer (2020)","DOI":"10.1007\/978-3-030-58586-0_33"},{"issue":"4","key":"1694_CR17","doi-asserted-by":"publisher","first-page":"4802","DOI":"10.1364\/OE.416130","volume":"29","author":"K Xiang","year":"2021","unstructured":"Xiang, K., Yang, K., Wang, K.: Polarization-driven semantic segmentation via efficient attention-bridged fusion. Opt. Express 29(4), 4802\u20134820 (2021)","journal-title":"Opt. Express"},{"key":"1694_CR18","doi-asserted-by":"publisher","DOI":"10.1016\/j.cviu.2022.103495","volume":"222","author":"C Ruffino","year":"2022","unstructured":"Ruffino, C., Blin, R., Ainouz, S., Gasso, G., H\u00e9rault, R., Meriaudeau, F., Canu, S.: Physically-admissible polarimetric data augmentation for road-scene analysis. Comput. Vis. Image Underst. 222, 103495 (2022)","journal-title":"Comput. Vis. Image Underst."},{"key":"1694_CR19","doi-asserted-by":"publisher","first-page":"74","DOI":"10.1016\/j.patrec.2022.09.019","volume":"163","author":"S Oprisescu","year":"2022","unstructured":"Oprisescu, S., Coliban, R.-M., Ivanovici, M.: Polarization-based optical characterization for color texture analysis and segmentation. Pattern Recogn. Lett. 163, 74\u201381 (2022)","journal-title":"Pattern Recogn. Lett."},{"key":"1694_CR20","doi-asserted-by":"publisher","DOI":"10.1016\/j.imavis.2022.104401","volume":"120","author":"W Gu","year":"2022","unstructured":"Gu, W., Bai, S., Kong, L.: A review on 2d instance segmentation based on deep neural networks. Image Vis. Comput. 120, 104401 (2022)","journal-title":"Image Vis. Comput."},{"issue":"11","key":"1694_CR21","first-page":"8587","volume":"44","author":"X Wang","year":"2021","unstructured":"Wang, X., Zhang, R., Shen, C., Kong, T., Li, L.: Solo: a simple framework for instance segmentation. IEEE Trans. Pattern Anal. Mach. Intell. 44(11), 8587\u20138601 (2021)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"1694_CR22","doi-asserted-by":"publisher","DOI":"10.1016\/j.array.2022.100258","volume":"16","author":"A Mumuni","year":"2022","unstructured":"Mumuni, A., Mumuni, F.: Data augmentation: a comprehensive survey of modern approaches. Array 16, 100258 (2022)","journal-title":"Array"},{"key":"1694_CR23","doi-asserted-by":"publisher","unstructured":"Zhang, J., Zhang, R., LIU, Y., Yuan, W.: Multimodal image semantic segmentation based on attention mechanism. Chin. J. Liq. Cryst. Displays 38(7), 975\u2013984 (2023). https:\/\/doi.org\/10.37188\/cjlcd.2022-0309","DOI":"10.37188\/cjlcd.2022-0309"},{"key":"1694_CR24","doi-asserted-by":"crossref","unstructured":"Kirillov, A., Girshick, R., He, K., Doll\u00e1r, P.: Panoptic feature pyramid networks. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 6399\u20136408 (2019)","DOI":"10.1109\/CVPR.2019.00656"},{"issue":"2","key":"1694_CR25","doi-asserted-by":"publisher","first-page":"81","DOI":"10.1016\/S0262-8856(96)01123-7","volume":"15","author":"LB Wolff","year":"1997","unstructured":"Wolff, L.B.: Polarization vision: a new sensory approach to image understanding. Image Vis. Comput. 15(2), 81\u201393 (1997)","journal-title":"Image Vis. Comput."},{"issue":"1","key":"1694_CR26","doi-asserted-by":"publisher","first-page":"73","DOI":"10.1109\/TPAMI.2004.1261080","volume":"26","author":"D Miyazaki","year":"2004","unstructured":"Miyazaki, D., Kagesawa, M., Ikeuchi, K.: Transparent surface modeling from a pair of polarization images. IEEE Trans. Pattern Anal. Mach. Intell. 26(1), 73\u201382 (2004)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"1694_CR27","doi-asserted-by":"crossref","unstructured":"Kalra, A., Taamazyan, V., Rao, S.K., Venkataraman, K., Raskar, R., Kadambi, A.: Deep polarization cues for transparent object segmentation. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 8602\u20138611 (2020)","DOI":"10.1109\/CVPR42600.2020.00863"},{"key":"1694_CR28","doi-asserted-by":"publisher","first-page":"1198457","DOI":"10.3389\/fphy.2023.1198457","volume":"11","author":"X Li","year":"2023","unstructured":"Li, X., Liu, Z., Cai, Y., Pan, C., Song, J., Wang, J., Shao, X.: Polarization 3d imaging technology: a review. Front. Phys. 11, 1198457 (2023)","journal-title":"Front. Phys."},{"key":"1694_CR29","doi-asserted-by":"crossref","unstructured":"Zhou, C., Teng, M., Lyu, Y., Li, S., Xu, C., Shi, B.: Polarization-aware low-light image enhancement. In: Proceedings of the AAAI Conference on Artificial Intelligence, vol. 37, pp. 3742\u20133750 (2023)","DOI":"10.1609\/aaai.v37i3.25486"},{"issue":"10","key":"1694_CR30","doi-asserted-by":"publisher","first-page":"17873","DOI":"10.1109\/TITS.2022.3157901","volume":"23","author":"H-F Wang","year":"2022","unstructured":"Wang, H.-F., Shan, Y.-H., Hao, T., Zhao, X.-M., Song, S.-Z., Huang, H., Zhang, J.-J.: Vehicle-road environment perception under low-visibility condition based on polarization features via deep learning. IEEE Trans. Intell. Transp. Syst. 23(10), 17873\u201317886 (2022)","journal-title":"IEEE Trans. Intell. Transp. Syst."},{"issue":"4","key":"1694_CR31","doi-asserted-by":"publisher","first-page":"2761","DOI":"10.1007\/s11831-023-09884-2","volume":"30","author":"V Rani","year":"2023","unstructured":"Rani, V., Nabi, S.T., Kumar, M., Mittal, A., Kumar, K.: Self-supervised learning: a succinct review. Arch. Comput. Methods Eng. 30(4), 2761\u20132775 (2023)","journal-title":"Arch. Comput. Methods Eng."},{"key":"1694_CR32","doi-asserted-by":"publisher","DOI":"10.1016\/j.dsp.2024.104496","volume":"149","author":"Z Lu","year":"2024","unstructured":"Lu, Z., Chen, Y.: Self-supervised monocular depth estimation on water scenes via specular reflection prior. Digit. Signal Process. 149, 104496 (2024)","journal-title":"Digit. Signal Process."},{"issue":"1\u20132","key":"1694_CR33","doi-asserted-by":"publisher","first-page":"155","DOI":"10.1016\/S0004-3702(03)00079-1","volume":"151","author":"M Dash","year":"2003","unstructured":"Dash, M., Liu, H.: Consistency-based search in feature selection. Artif. Intell. 151(1\u20132), 155\u2013176 (2003)","journal-title":"Artif. Intell."},{"key":"1694_CR34","unstructured":"Chen, T., Kornblith, S., Norouzi, M., Hinton, G.: A simple framework for contrastive learning of visual representations. In: International Conference on Machine Learning, pp. 1597\u20131607. PMLR (2020)"},{"issue":"5","key":"1694_CR35","doi-asserted-by":"publisher","first-page":"1143","DOI":"10.1007\/s11760-021-02063-5","volume":"16","author":"Z Lu","year":"2022","unstructured":"Lu, Z., Chen, Y.: Single image super-resolution based on a modified u-net with mixed gradient loss. Signal Image Video Process. 16(5), 1143\u20131151 (2022)","journal-title":"Signal Image Video Process."},{"key":"1694_CR36","doi-asserted-by":"crossref","unstructured":"Godard, C., Mac\u00a0Aodha, O., Brostow, G.J.: Unsupervised monocular depth estimation with left-right consistency. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 270\u2013279 (2017)","DOI":"10.1109\/CVPR.2017.699"},{"issue":"8","key":"1694_CR37","doi-asserted-by":"publisher","first-page":"10235","DOI":"10.1007\/s11063-023-11325-x","volume":"55","author":"Z Lu","year":"2023","unstructured":"Lu, Z., Chen, Y.: Joint self-supervised depth and optical flow estimation towards dynamic objects. Neural Process. Lett. 55(8), 10235\u201310249 (2023)","journal-title":"Neural Process. Lett."},{"key":"1694_CR38","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., Sun, J.: Deep residual learning for image recognition. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 770\u2013778 (2016)","DOI":"10.1109\/CVPR.2016.90"},{"key":"1694_CR39","doi-asserted-by":"crossref","unstructured":"Cordts, M., Omran, M., Ramos, S., Rehfeld, T., Enzweiler, M., Benenson, R., Franke, U., Roth, S., Schiele, B.: The cityscapes dataset for semantic urban scene understanding. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 3213\u20133223 (2016)","DOI":"10.1109\/CVPR.2016.350"},{"key":"1694_CR40","doi-asserted-by":"publisher","unstructured":"Kalra, A., Taamazyan, V., Rao, S.K., Venkataraman, K., Raskar, R., Kadambi, A.: Deep polarization cues for transparent object segmentation. In: 2020 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pp. 8599\u20138608 (2020). https:\/\/doi.org\/10.1109\/CVPR42600.2020.00863","DOI":"10.1109\/CVPR42600.2020.00863"}],"container-title":["Machine Vision and Applications"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00138-025-01694-9.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s00138-025-01694-9\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00138-025-01694-9.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,9,6]],"date-time":"2025-09-06T14:52:08Z","timestamp":1757170328000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s00138-025-01694-9"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,5,15]]},"references-count":40,"journal-issue":{"issue":"4","published-print":{"date-parts":[[2025,7]]}},"alternative-id":["1694"],"URL":"https:\/\/doi.org\/10.1007\/s00138-025-01694-9","relation":{},"ISSN":["0932-8092","1432-1769"],"issn-type":[{"value":"0932-8092","type":"print"},{"value":"1432-1769","type":"electronic"}],"subject":[],"published":{"date-parts":[[2025,5,15]]},"assertion":[{"value":"9 February 2025","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"31 March 2025","order":2,"name":"revised","label":"Revised","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"18 April 2025","order":3,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"15 May 2025","order":4,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare no conflict of interest.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}}],"article-number":"81"}}