{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,3,19]],"date-time":"2026-03-19T16:35:21Z","timestamp":1773938121069,"version":"3.50.1"},"reference-count":59,"publisher":"Springer Science and Business Media LLC","issue":"5","license":[{"start":{"date-parts":[[2024,9,16]],"date-time":"2024-09-16T00:00:00Z","timestamp":1726444800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,9,16]],"date-time":"2024-09-16T00:00:00Z","timestamp":1726444800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"crossref","award":["62102003"],"award-info":[{"award-number":["62102003"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"crossref"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimedia Systems"],"published-print":{"date-parts":[[2024,10]]},"DOI":"10.1007\/s00530-024-01459-w","type":"journal-article","created":{"date-parts":[[2024,9,16]],"date-time":"2024-09-16T15:03:44Z","timestamp":1726499024000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":2,"title":["Triple fusion and feature pyramid decoder for RGB-D semantic segmentation"],"prefix":"10.1007","volume":"30","author":[{"given":"Bin","family":"Ge","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Xu","family":"Zhu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Zihan","family":"Tang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Chenxing","family":"Xia","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yiming","family":"Lu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Zhuang","family":"Chen","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2024,9,16]]},"reference":[{"key":"1459_CR1","doi-asserted-by":"crossref","unstructured":"Yang, L., Liang, X., Wang, T., Xing, E.: Real-to-virtual domain unification for end-to-end autonomous driving. In: Proceedings of the European Conference on Computer Vision (ECCV), pp. 530\u2013545 (2018)","DOI":"10.1007\/978-3-030-01225-0_33"},{"key":"1459_CR2","doi-asserted-by":"publisher","first-page":"460","DOI":"10.1016\/j.neunet.2022.10.034","volume":"157","author":"X Xiao","year":"2023","unstructured":"Xiao, X., Zhao, Y., Zhang, F., Luo, B., Yu, L., Chen, B., Yang, C.: Baseg: boundary aware semantic segmentation for autonomous driving. Neural Netw. 157, 460\u2013470 (2023)","journal-title":"Neural Netw."},{"key":"1459_CR3","doi-asserted-by":"publisher","first-page":"107256","DOI":"10.1016\/j.patcog.2020.107256","volume":"102","author":"A L\u00f3pez-Cifuentes","year":"2020","unstructured":"L\u00f3pez-Cifuentes, A., Escudero-Vinolo, M., Besc\u00f3s, J., Garc\u00eda-Mart\u00edn, \u00c1.: Semantic-aware scene recognition. Pattern Recognit. 102, 107256 (2020)","journal-title":"Pattern Recognit."},{"key":"1459_CR4","doi-asserted-by":"publisher","first-page":"108420","DOI":"10.1016\/j.patcog.2021.108420","volume":"124","author":"J Wei","year":"2022","unstructured":"Wei, J., Wu, Z., Wang, L., Bui, T.D., Qu, L., Yap, P.-T., Xia, Y., Li, G., Shen, D.: A cascaded nested network for 3T brain MR image segmentation guided by 7T labeling. Pattern Recognit. 124, 108420 (2022)","journal-title":"Pattern Recognit."},{"key":"1459_CR5","doi-asserted-by":"crossref","unstructured":"Long, J., Shelhamer, E., Darrell, T.: Fully convolutional networks for semantic segmentation. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 3431\u20133440 (2015)","DOI":"10.1109\/CVPR.2015.7298965"},{"key":"1459_CR6","doi-asserted-by":"crossref","unstructured":"Ronneberger, O., Fischer, P., Brox, T.: U-net: convolutional networks for biomedical image segmentation. In: Medical Image Computing and Computer-Assisted Intervention\u2013MICCAI 2015: 18th International Conference, Munich, Germany, October 5\u20139, 2015, Proceedings, Part III 18, pp. 234\u2013241. Springer (2015)","DOI":"10.1007\/978-3-319-24574-4_28"},{"issue":"4","key":"1459_CR7","doi-asserted-by":"publisher","first-page":"834","DOI":"10.1109\/TPAMI.2017.2699184","volume":"40","author":"L-C Chen","year":"2017","unstructured":"Chen, L.-C., Papandreou, G., Kokkinos, I., Murphy, K., Yuille, A.L.: Deeplab: semantic image segmentation with deep convolutional nets, atrous convolution, and fully connected crfs. IEEE Trans. Pattern Anal. Mach. Intell. 40(4), 834\u2013848 (2017)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"1459_CR8","doi-asserted-by":"publisher","first-page":"9180391","DOI":"10.1155\/2019\/9180391","volume":"2019","author":"X Xu","year":"2019","unstructured":"Xu, X., Li, G., Xie, G., Ren, J., Xie, X., et al.: Weakly supervised deep semantic segmentation using CNN and ELM with semantic candidate regions. Complexity 2019, 9180391 (2019)","journal-title":"Complexity"},{"key":"1459_CR9","doi-asserted-by":"crossref","unstructured":"Lin, T.-Y., Doll\u00e1r, P., Girshick, R., He, K., Hariharan, B., Belongie, S.: Feature pyramid networks for object detection. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 2117\u20132125 (2017)","DOI":"10.1109\/CVPR.2017.106"},{"issue":"8","key":"1459_CR10","doi-asserted-by":"publisher","first-page":"1795","DOI":"10.3390\/s19081795","volume":"19","author":"X Lin","year":"2019","unstructured":"Lin, X., S\u00e1nchez-Escobedo, D., Casas, J.R., Pard\u00e0s, M.: Depth estimation and semantic segmentation from a single RGB image using a hybrid convolutional neural network. Sensors 19(8), 1795 (2019)","journal-title":"Sensors"},{"key":"1459_CR11","doi-asserted-by":"publisher","first-page":"303","DOI":"10.1007\/s11263-009-0275-4","volume":"88","author":"M Everingham","year":"2010","unstructured":"Everingham, M., Van Gool, L., Williams, C.K., Winn, J., Zisserman, A.: The pascal visual object classes (VOC) challenge. Int. J. Comput. Vis. 88, 303\u2013338 (2010)","journal-title":"Int. J. Comput. Vis."},{"key":"1459_CR12","doi-asserted-by":"crossref","unstructured":"Mottaghi, R., Chen, X., Liu, X., Cho, N.-G., Lee, S.-W., Fidler, S., Urtasun, R., Yuille, A.: The role of context for object detection and semantic segmentation in the wild. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 891\u2013898 (2014)","DOI":"10.1109\/CVPR.2014.119"},{"key":"1459_CR13","doi-asserted-by":"crossref","unstructured":"Lin, T.-Y., Maire, M., Belongie, S., Hays, J., Perona, P., Ramanan, D., Doll\u00e1r, P., Zitnick, C.L.: Microsoft coco: common objects in context. In: Computer Vision\u2014ECCV 2014: 13th European Conference, Zurich, Switzerland, September 6\u201312, 2014, Proceedings, Part V 13, pp. 740\u2013755. Springer (2014)","DOI":"10.1007\/978-3-319-10602-1_48"},{"key":"1459_CR14","doi-asserted-by":"crossref","unstructured":"Cordts, M., Omran, M., Ramos, S., Rehfeld, T., Enzweiler, M., Benenson, R., Franke, U., Roth, S., Schiele, B.: The cityscapes dataset for semantic urban scene understanding. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 3213\u20133223 (2016)","DOI":"10.1109\/CVPR.2016.350"},{"key":"1459_CR15","doi-asserted-by":"crossref","unstructured":"Lin, G., Milan, A., Shen, C., Reid, I.: Refinenet: multi-path refinement networks for high-resolution semantic segmentation. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 1925\u20131934 (2017)","DOI":"10.1109\/CVPR.2017.549"},{"issue":"12","key":"1459_CR16","doi-asserted-by":"publisher","first-page":"2481","DOI":"10.1109\/TPAMI.2016.2644615","volume":"39","author":"V Badrinarayanan","year":"2017","unstructured":"Badrinarayanan, V., Kendall, A., Cipolla, R.: Segnet: a deep convolutional encoder\u2013decoder architecture for image segmentation. IEEE Trans. Pattern Anal. Mach. Intell. 39(12), 2481\u20132495 (2017)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"1459_CR17","doi-asserted-by":"publisher","first-page":"108468","DOI":"10.1016\/j.patcog.2021.108468","volume":"124","author":"H Zhou","year":"2022","unstructured":"Zhou, H., Qi, L., Huang, H., Yang, X., Wan, Z., Wen, X.: CANet: co-attention network for RGB-D semantic segmentation. Pattern Recognit. 124, 108468 (2022)","journal-title":"Pattern Recognit."},{"key":"1459_CR18","doi-asserted-by":"crossref","unstructured":"Ying, X., Chuah, M.C.: Uctnet: uncertainty-aware cross-modal transformer network for indoor RGB-D semantic segmentation. In: European Conference on Computer Vision, pp. 20\u201337. Springer (2022)","DOI":"10.1007\/978-3-031-20056-4_2"},{"key":"1459_CR19","doi-asserted-by":"publisher","first-page":"106729","DOI":"10.1016\/j.engappai.2023.106729","volume":"125","author":"E Yang","year":"2023","unstructured":"Yang, E., Zhou, W., Qian, X., Lei, J., Yu, L.: Drnet: dual-stage refinement network with boundary inference for RGB-D semantic segmentation of indoor scenes. Eng. Appl. Artif. Intell. 125, 106729 (2023)","journal-title":"Eng. Appl. Artif. Intell."},{"key":"1459_CR20","doi-asserted-by":"crossref","unstructured":"Cao, J., Leng, H., Lischinski, D., Cohen-Or, D., Tu, C., Li, Y.: Shapeconv: shape-aware convolutional layer for indoor RGB-D semantic segmentation. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 7088\u20137097 (2021)","DOI":"10.1109\/ICCV48922.2021.00700"},{"key":"1459_CR21","first-page":"12077","volume":"34","author":"E Xie","year":"2021","unstructured":"Xie, E., Wang, W., Yu, Z., Anandkumar, A., Alvarez, J.M., Luo, P.: Segformer: simple and efficient design for semantic segmentation with transformers. Adv. Neural Inf. Process. Syst. 34, 12077\u201312090 (2021)","journal-title":"Adv. Neural Inf. Process. Syst."},{"key":"1459_CR22","doi-asserted-by":"crossref","unstructured":"Romeo, L., Devanna, R., Marani, R., Matranga, G., Biddoccu, M., Milella, A.: Scale-invariant semantic segmentation of natural RGB-D images combining decision tree and deep learning models. In: Multimodal Sensing and Artificial Intelligence: Technologies and Applications III, vol. 12621, pp. 257\u2013260. SPIE (2023)","DOI":"10.1117\/12.2677371"},{"key":"1459_CR23","doi-asserted-by":"publisher","first-page":"106311","DOI":"10.1016\/j.engappai.2023.106311","volume":"123","author":"J Yoon","year":"2023","unstructured":"Yoon, J., Han, J., Nguyen, T.P.: Logistics box recognition in robotic industrial de-palletising procedure with systematic RGB-D image processing supported by multiple deep learning methods. Eng. Appl. Artif. Intell. 123, 106311 (2023)","journal-title":"Eng. Appl. Artif. Intell."},{"key":"1459_CR24","doi-asserted-by":"publisher","first-page":"108469","DOI":"10.1016\/j.knosys.2022.108469","volume":"243","author":"Y Li","year":"2022","unstructured":"Li, Y., Ouyang, S., Zhang, Y.: Combining deep learning and ontology reasoning for remote sensing image semantic segmentation. Knowl.-Based Syst. 243, 108469 (2022)","journal-title":"Knowl.-Based Syst."},{"key":"1459_CR25","doi-asserted-by":"crossref","unstructured":"Zhao, H., Shi, J., Qi, X., Wang, X., Jia, J.: Pyramid scene parsing network. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 2881\u20132890 (2017)","DOI":"10.1109\/CVPR.2017.660"},{"key":"1459_CR26","doi-asserted-by":"crossref","unstructured":"Noh, H., Hong, S., Han, B.: Learning deconvolution network for semantic segmentation. In: Proceedings of the IEEE International Conference on Computer Vision, pp. 1520\u20131528 (2015)","DOI":"10.1109\/ICCV.2015.178"},{"key":"1459_CR27","doi-asserted-by":"crossref","unstructured":"Chaurasia, A., Culurciello, E.: Linknet: exploiting encoder representations for efficient semantic segmentation. In: 2017 IEEE Visual Communications and Image Processing (VCIP), pp. 1\u20134. IEEE (2017)","DOI":"10.1109\/VCIP.2017.8305148"},{"key":"1459_CR28","doi-asserted-by":"crossref","unstructured":"Ding, H., Jiang, X., Shuai, B., Liu, A.Q., Wang, G.: Context contrasted feature and gated multi-scale aggregation for scene segmentation. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 2393\u20132402 (2018)","DOI":"10.1109\/CVPR.2018.00254"},{"key":"1459_CR29","doi-asserted-by":"crossref","unstructured":"He, J., Deng, Z., Qiao, Y.: Dynamic multi-scale filters for semantic segmentation. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 3562\u20133572 (2019)","DOI":"10.1109\/ICCV.2019.00366"},{"key":"1459_CR30","doi-asserted-by":"crossref","unstructured":"He, J., Deng, Z., Zhou, L., Wang, Y., Qiao, Y.: Adaptive pyramid context network for semantic segmentation. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 7519\u20137528 (2019)","DOI":"10.1109\/CVPR.2019.00770"},{"key":"1459_CR31","doi-asserted-by":"publisher","first-page":"2066","DOI":"10.1109\/TIP.2019.2941644","volume":"29","author":"Z Huang","year":"2019","unstructured":"Huang, Z., Wang, C., Wang, X., Liu, W., Wang, J.: Semantic image segmentation by scale-adaptive networks. IEEE Trans. Image Process. 29, 2066\u20132077 (2019)","journal-title":"IEEE Trans. Image Process."},{"issue":"8","key":"1459_CR32","doi-asserted-by":"publisher","first-page":"0255397","DOI":"10.1371\/journal.pone.0255397","volume":"16","author":"M Knolle","year":"2021","unstructured":"Knolle, M., Kaissis, G., Jungmann, F., Ziegelmayer, S., Sasse, D., Makowski, M., Rueckert, D., Braren, R.: Efficient, high-performance semantic segmentation using multi-scale feature extraction. PLoS ONE 16(8), 0255397 (2021)","journal-title":"PLoS ONE"},{"issue":"9","key":"1459_CR33","doi-asserted-by":"publisher","first-page":"0274249","DOI":"10.1371\/journal.pone.0274249","volume":"17","author":"S Li","year":"2022","unstructured":"Li, S., Wan, L., Tang, L., Zhang, Z.: Mfeafn: multi-scale feature enhanced adaptive fusion network for image semantic segmentation. PLoS ONE 17(9), 0274249 (2022)","journal-title":"PLoS ONE"},{"key":"1459_CR34","doi-asserted-by":"crossref","unstructured":"Hazirbas, C., Ma, L., Domokos, C., Cremers, D.: Fusenet: incorporating depth into semantic segmentation via fusion-based CNN architecture. In: Computer Vision\u2014ACCV 2016: 13th Asian Conference on Computer Vision, Taipei, Taiwan, November 20\u201324, 2016, Revised Selected Papers, Part I 13, pp. 213\u2013228. Springer (2017)","DOI":"10.1007\/978-3-319-54181-5_14"},{"key":"1459_CR35","unstructured":"Jiang, J., Zheng, L., Luo, F., Zhang, Z.: Rednet: residual encoder\u2013decoder network for indoor RGB-D semantic segmentation (2018). arXiv preprint arXiv:1806.01054"},{"key":"1459_CR36","doi-asserted-by":"crossref","unstructured":"Eigen, D., Fergus, R.: Predicting depth, surface normals and semantic labels with a common multi-scale convolutional architecture. In: Proceedings of the IEEE International Conference on Computer Vision, pp. 2650\u20132658 (2015)","DOI":"10.1109\/ICCV.2015.304"},{"key":"1459_CR37","doi-asserted-by":"crossref","unstructured":"He, Y., Chiu, W.-C., Keuper, M., Fritz, M.: Std2p: RGBD semantic segmentation using spatio-temporal data-driven pooling. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 4837\u20134846 (2017)","DOI":"10.1109\/CVPR.2017.757"},{"key":"1459_CR38","doi-asserted-by":"crossref","unstructured":"Hu, X., Yang, K., Fei, L., Wang, K.: Acnet: attention based network to exploit complementary features for RGBD semantic segmentation. In: 2019 IEEE International Conference on Image Processing (ICIP), pp. 1440\u20131444. IEEE (2019)","DOI":"10.1109\/ICIP.2019.8803025"},{"key":"1459_CR39","doi-asserted-by":"crossref","unstructured":"Gupta, S., Girshick, R., Arbel\u00e1ez, P., Malik, J.: Learning rich features from RGB-D images for object detection and segmentation. In: Computer Vision\u2014ECCV 2014: 13th European Conference, Zurich, Switzerland, September 6\u201312, 2014, Proceedings, Part VII 13, pp. 345\u2013360. Springer (2014)","DOI":"10.1007\/978-3-319-10584-0_23"},{"key":"1459_CR40","doi-asserted-by":"publisher","first-page":"2313","DOI":"10.1109\/TIP.2021.3049332","volume":"30","author":"L-Z Chen","year":"2021","unstructured":"Chen, L.-Z., Lin, Z., Wang, Z., Yang, Y.-L., Cheng, M.-M.: Spatial information guided convolution for real-time RGBD semantic segmentation. IEEE Trans. Image Process. 30, 2313\u20132324 (2021)","journal-title":"IEEE Trans. Image Process."},{"key":"1459_CR41","doi-asserted-by":"crossref","unstructured":"Nascimento, M.G.d., Fawcett, R., Prisacariu, V.A.: Dsconv: efficient convolution operator. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 5148\u20135157 (2019)","DOI":"10.1109\/ICCV.2019.00525"},{"key":"1459_CR42","doi-asserted-by":"crossref","unstructured":"Silberman, N., Hoiem, D., Kohli, P., Fergus, R.: Indoor segmentation and support inference from RGBD images. In: Computer Vision\u2014ECCV 2012: 12th European Conference on Computer Vision, Florence, Italy, October 7\u201313, 2012, Proceedings, Part V 12, pp. 746\u2013760. Springer (2012)","DOI":"10.1007\/978-3-642-33715-4_54"},{"key":"1459_CR43","doi-asserted-by":"crossref","unstructured":"Song, S., Lichtenberg, S.P., Xiao, J.: Sun RGB-D: a RGB-D scene understanding benchmark suite. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 567\u2013576 (2015)","DOI":"10.1109\/CVPR.2015.7298655"},{"key":"1459_CR44","unstructured":"Janoch, A., Darrell, T., Abbeel, P., Malik, J.: The berkeley 3d object dataset. Techn. Report No. UCB\/EECS-2012-85, University of California at Berkeley (2012)"},{"key":"1459_CR45","doi-asserted-by":"crossref","unstructured":"Xiao, J., Owens, A., Torralba, A.: Sun3d: a database of big spaces reconstructed using SFM and object labels. In: Proceedings of the IEEE International Conference on Computer Vision, pp. 1625\u20131632 (2013)","DOI":"10.1109\/ICCV.2013.458"},{"key":"1459_CR46","doi-asserted-by":"crossref","unstructured":"Qi, X., Liao, R., Jia, J., Fidler, S., Urtasun, R.: 3d graph neural networks for RGBD semantic segmentation. In: Proceedings of the IEEE International Conference on Computer Vision, pp. 5199\u20135208 (2017)","DOI":"10.1109\/ICCV.2017.556"},{"key":"1459_CR47","doi-asserted-by":"crossref","unstructured":"Wang, J., Wang, Z., Tao, D., See, S., Wang, G.: Learning common and specific features for RGB-D semantic segmentation with deconvolutional networks. In: Computer Vision\u2014ECCV 2016: 14th European Conference, Amsterdam, The Netherlands, October 11\u201314, 2016, Proceedings, Part V 14, pp. 664\u2013679. Springer (2016)","DOI":"10.1007\/978-3-319-46454-1_40"},{"key":"1459_CR48","doi-asserted-by":"crossref","unstructured":"Lin, D., Chen, G., Cohen-Or, D., Heng, P.-A., Huang, H.: Cascaded feature network for semantic segmentation of RGB-D images. In: Proceedings of the IEEE International Conference on Computer Vision, pp. 1311\u20131319 (2017)","DOI":"10.1109\/ICCV.2017.147"},{"key":"1459_CR49","doi-asserted-by":"publisher","first-page":"658","DOI":"10.1109\/LSP.2021.3066071","volume":"28","author":"G Zhang","year":"2021","unstructured":"Zhang, G., Xue, J.-H., Xie, P., Yang, S., Wang, G.: Non-local aggregation for RGB-D semantic segmentation. IEEE Signal Process. Lett. 28, 658\u2013662 (2021)","journal-title":"IEEE Signal Process. Lett."},{"key":"1459_CR50","unstructured":"Yu, L., Gao, Y., Zhou, J., Zhang, J., Wu, Q.: Multi-layer feature aggregation for deep scene parsing models (2020). arXiv preprint arXiv:2011.02572"},{"key":"1459_CR51","unstructured":"Bai, L., Yang, J., Tian, C., Sun, Y., Mao, M., Xu, Y., Xu, W.: Dcanet: differential convolution attention network for RGB-D semantic segmentation (2022). arXiv preprint arXiv:2210.06747"},{"issue":"21","key":"1459_CR52","doi-asserted-by":"publisher","first-page":"8520","DOI":"10.3390\/s22218520","volume":"22","author":"L Zhu","year":"2022","unstructured":"Zhu, L., Kang, Z., Zhou, M., Yang, X., Wang, Z., Cao, Z., Ye, C.: Cmanet: cross-modality attention network for indoor-scene semantic segmentation. Sensors 22(21), 8520 (2022)","journal-title":"Sensors"},{"issue":"8","key":"1459_CR53","doi-asserted-by":"publisher","first-page":"1828","DOI":"10.3390\/math11081828","volume":"11","author":"X Tang","year":"2023","unstructured":"Tang, X., Li, B., Guo, J., Chen, W., Zhang, D., Huang, F.: A cross-modal feature fusion model based on convnext for RGB-D semantic segmentation. Mathematics 11(8), 1828 (2023)","journal-title":"Mathematics"},{"key":"1459_CR54","doi-asserted-by":"publisher","first-page":"23512","DOI":"10.1109\/JSEN.2023.3304637","volume":"23","author":"Y Zhang","year":"2023","unstructured":"Zhang, Y., Xiong, C., Liu, J., Ye, X., Sun, G.: Spatial-information guided adaptive context-aware network for efficient RGB-D semantic segmentation. IEEE Sens. J. 23, 23512\u201323521 (2023)","journal-title":"IEEE Sens. J."},{"key":"1459_CR55","doi-asserted-by":"publisher","first-page":"589","DOI":"10.1007\/s13042-023-01927-1","volume":"15","author":"J Ni","year":"2023","unstructured":"Ni, J., Zhang, Z., Shen, K., Tang, G., Yang, S.X.: An improved deep network-based RGB-D semantic segmentation method for indoor scenes. Int. J. Mach. Learn. Cybern. 15, 589\u2013604 (2023)","journal-title":"Int. J. Mach. Learn. Cybern."},{"key":"1459_CR56","unstructured":"Park, S.-J., Hong, K.-S., Lee, S.: Rdfnet: RGB-D multi-level residual feature fusion for indoor semantic segmentation. In: Proceedings of the IEEE International Conference on Computer Vision, pp. 4980\u20134989 (2017)"},{"key":"1459_CR57","doi-asserted-by":"crossref","unstructured":"Wang, W., Neumann, U.: Depth-aware CNN for RGB-D segmentation. In: Proceedings of the European Conference on Computer Vision (ECCV), pp. 135\u2013150 (2018)","DOI":"10.1007\/978-3-030-01252-6_9"},{"key":"1459_CR58","doi-asserted-by":"crossref","unstructured":"Seichter, D., Fischedick, S.B., K\u00f6hler, M., Gro\u00df, H.-M.: Efficient multi-task RGB-D scene analysis for indoor environments. In: 2022 International Joint Conference on Neural Networks (IJCNN), pp. 1\u201310. IEEE (2022)","DOI":"10.1109\/IJCNN55064.2022.9892852"},{"issue":"24","key":"1459_CR59","doi-asserted-by":"publisher","first-page":"24161","DOI":"10.1109\/JSEN.2022.3218601","volume":"22","author":"P Wu","year":"2022","unstructured":"Wu, P., Guo, R., Tong, X., Su, S., Zuo, Z., Sun, B., Wei, J.: Link-RGBD: Cross-guided feature fusion network for RGBD semantic segmentation. IEEE Sens. J. 22(24), 24161\u201324175 (2022)","journal-title":"IEEE Sens. J."}],"container-title":["Multimedia Systems"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00530-024-01459-w.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s00530-024-01459-w\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s00530-024-01459-w.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,10,28]],"date-time":"2024-10-28T18:13:43Z","timestamp":1730139223000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s00530-024-01459-w"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,9,16]]},"references-count":59,"journal-issue":{"issue":"5","published-print":{"date-parts":[[2024,10]]}},"alternative-id":["1459"],"URL":"https:\/\/doi.org\/10.1007\/s00530-024-01459-w","relation":{},"ISSN":["0942-4962","1432-1882"],"issn-type":[{"value":"0942-4962","type":"print"},{"value":"1432-1882","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,9,16]]},"assertion":[{"value":"4 December 2023","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"19 August 2024","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"16 September 2024","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare no conflict of interest.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflict of interest"}}],"article-number":"272"}}