{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,6]],"date-time":"2026-06-06T05:11:15Z","timestamp":1780722675129,"version":"3.54.1"},"reference-count":68,"publisher":"Springer Science and Business Media LLC","issue":"10","license":[{"start":{"date-parts":[[2022,4,7]],"date-time":"2022-04-07T00:00:00Z","timestamp":1649289600000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2022,4,7]],"date-time":"2022-04-07T00:00:00Z","timestamp":1649289600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["J Ambient Intell Human Comput"],"published-print":{"date-parts":[[2023,10]]},"DOI":"10.1007\/s12652-022-03829-6","type":"journal-article","created":{"date-parts":[[2022,4,7]],"date-time":"2022-04-07T05:02:51Z","timestamp":1649307771000},"page":"13627-13645","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":7,"title":["Overview of RGBD semantic segmentation based on deep learning"],"prefix":"10.1007","volume":"14","author":[{"ORCID":"https:\/\/orcid.org\/0000-0003-4342-7015","authenticated-orcid":false,"given":"Hongyan","family":"Zhang","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Victor S.","family":"Sheng","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xuefeng","family":"Xi","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zhiming","family":"Cui","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Huan","family":"Rong","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2022,4,7]]},"reference":[{"key":"3829_CR1","doi-asserted-by":"publisher","unstructured":"Armeni I, Sax S. Zamir AR, Savarese S (2017) Joint 2d-3d-semantic data for indoor scene understanding. https:\/\/doi.org\/10.48550\/arXiv.1702.01105","DOI":"10.48550\/arXiv.1702.01105"},{"issue":"12","key":"3829_CR2","doi-asserted-by":"publisher","first-page":"2481","DOI":"10.1109\/TPAMI.2016.2644615","volume":"39","author":"V Badrinarayanan","year":"2017","unstructured":"Badrinarayanan V, Kendall A, Cipolla R (2017) Segnet: a deep convolutional encoder-decoder architecture for image segmentation. IEEE Trans Pattern Anal Mach Intell 39(12):2481\u20132495","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"3829_CR3","doi-asserted-by":"crossref","unstructured":"Chang A, Dai A, Funkhouser T, Halber M, Niessner M, Savva M, Zhang Y (2017) Matterport3d: learning from rgb-d data in indoor environments. arXiv preprint arXiv:1709.06158","DOI":"10.1109\/3DV.2017.00081"},{"key":"3829_CR4","doi-asserted-by":"publisher","first-page":"2313","DOI":"10.1109\/TIP.2021.3049332","volume":"30","author":"LZ Chen","year":"2021","unstructured":"Chen LZ, Lin Z, Wang Z, Yang YL, Cheng MM (2021a) Spatial information guided convolution for real-time RGBD semantic segmentation. IEEE Trans Image Process 30:2313\u20132324","journal-title":"IEEE Trans Image Process"},{"key":"3829_CR5","doi-asserted-by":"crossref","unstructured":"Chen X, Lin K Y, Wang J, Wu W, Qian C, Li H, Zeng G (2020, August) Bi-directional cross-modality feature propagation with separation-and-aggregation gate for RGB-D semantic segmentation. In: European conference on computer vision. Springer, Cham, pp 561\u2013577","DOI":"10.1007\/978-3-030-58621-8_33"},{"key":"3829_CR6","unstructured":"Chen S, Zhu X, Liu W, He X, Liu J (2021b) Global-local propagation network for RGB-D semantic segmentation. arXiv preprint arXiv:2101.10801"},{"key":"3829_CR7","doi-asserted-by":"crossref","unstructured":"Cheng Y, Cai R, Li Z, Zhao X, Huang, K (2017) Locality-sensitive deconvolution networks with gated fusion for rgb-d indoor semantic segmentation. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 3029\u20133037","DOI":"10.1109\/CVPR.2017.161"},{"key":"3829_CR8","doi-asserted-by":"crossref","unstructured":"Cordts M, Omran M, Ramos S, Rehfeld T, Enzweiler M, Benenson R, Schiele B (2016) The cityscapes dataset for semantic urban scene understanding. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 3213\u20133223","DOI":"10.1109\/CVPR.2016.350"},{"key":"3829_CR9","unstructured":"Couprie C, Farabet C, Najman L, LeCun, Y (2013) Indoor semantic segmentation using depth information. arXiv preprint arXiv:1301.3572"},{"key":"3829_CR10","doi-asserted-by":"crossref","unstructured":"Dai A, Chang AX, Savva M, Halber M, Funkhouser T, Nie\u00dfner M (2017) Scannet: richly-annotated 3d reconstructions of indoor scenes. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 5828\u20135839","DOI":"10.1109\/CVPR.2017.261"},{"key":"3829_CR11","unstructured":"Deng L, Yang M, Li T, He Y, Wang C (2019) RFBNet: deep multimodal networks with residual fusion blocks for RGB-D semantic segmentation. arXiv preprint arXiv:1907.00135"},{"key":"3829_CR12","doi-asserted-by":"crossref","unstructured":"Gao X, Yu J, Li J (2019, July) RGBD semantic segmentation based on global convolutional network. In: Proceedings of the 2019 4th international conference on robotics, control and automation, pp 192\u2013197","DOI":"10.1145\/3351180.3351182"},{"key":"3829_CR13","doi-asserted-by":"crossref","unstructured":"Giannone G, Chidlovskii B (2019) Learning common representation from RGB and depth images. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition workshops, pp 0\u20130","DOI":"10.1109\/CVPRW.2019.00054"},{"issue":"2","key":"3829_CR14","doi-asserted-by":"publisher","first-page":"133","DOI":"10.1007\/s11263-014-0777-6","volume":"112","author":"S Gupta","year":"2015","unstructured":"Gupta S, Arbel\u00e1ez P, Girshick R, Malik J (2015) Indoor scene understanding with rgb-d images: bottom-up segmentation, object detection and semantic segmentation. Int J Comput Vision 112(2):133\u2013149","journal-title":"Int J Comput Vision"},{"key":"3829_CR15","doi-asserted-by":"crossref","unstructured":"Gupta S, Girshick R, Arbel\u00e1ez P, Malik, J (2014) Learning rich features from RGB-D images for object detection and segmentation. In: European conference on computer vision Springer, Cham, pp 345\u2013360","DOI":"10.1007\/978-3-319-10584-0_23"},{"key":"3829_CR16","doi-asserted-by":"crossref","unstructured":"Hazirbas C, Ma L, Domokos C, Cremers D (2016) Fusenet: incorporating depth into semantic segmentation via fusion-based cnn architecture. In: Asian conference on computer vision. Springer, Cham, pp 213\u2013228","DOI":"10.1007\/978-3-319-54181-5_14"},{"issue":"9","key":"3829_CR17","doi-asserted-by":"publisher","first-page":"1904","DOI":"10.1109\/TPAMI.2015.2389824","volume":"37","author":"K He","year":"2015","unstructured":"He K, Zhang X, Ren S, Sun J (2015) Spatial pyramid pooling in deep convolutional networks for visual recognition. IEEE Trans Pattern Anal Mach Intell 37(9):1904\u20131916","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"3829_CR18","doi-asserted-by":"crossref","unstructured":"He K, Zhang X, Ren S, Sun J (2016) Deep residual learning for image recognition. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 770\u2013778","DOI":"10.1109\/CVPR.2016.90"},{"key":"3829_CR19","doi-asserted-by":"crossref","unstructured":"He Y, Chiu WC, Keuper M, Fritz M (2017) Std2p: Rgbd semantic segmentation using spatio-temporal data-driven pooling. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 4837\u20134846","DOI":"10.1109\/CVPR.2017.757"},{"key":"3829_CR20","unstructured":"Hinton G, Vinyals O, Dean J (2015) Distilling the knowledge in a neural network. arXiv preprint arXiv:1503.02531, 2(7)"},{"key":"3829_CR21","doi-asserted-by":"crossref","unstructured":"Hu X, Yang K, Fei L, Wang K (2019) Acnet: attention based network to exploit complementary features for rgbd semantic segmentation. In: 2019 IEEE international conference on image processing (ICIP). IEEE, pp 1440\u20131444","DOI":"10.1109\/ICIP.2019.8803025"},{"key":"3829_CR22","doi-asserted-by":"crossref","unstructured":"Janoch A, Karayev S, Jia Y, Barron JT, Fritz M, Saenko K, Darrell T (2013) A category-level 3d object dataset: putting the kinect to work. In: Consumer depth cameras for computer vision. Springer, London, pp 141\u2013165","DOI":"10.1007\/978-1-4471-4640-7_8"},{"issue":"01","key":"3829_CR23","doi-asserted-by":"publisher","first-page":"147","DOI":"10.1142\/S0219530519410148","volume":"19","author":"F Jia","year":"2021","unstructured":"Jia F, Liu J, Tai XC (2021) A regularized convolutional neural network for semantic image segmentation. Anal Appl 19(01):147\u2013165","journal-title":"Anal Appl"},{"key":"3829_CR24","doi-asserted-by":"crossref","unstructured":"Jiang J, Zhang Z, Huang Y, Zheng L (2017) Incorporating depth into both cnn and crf for indoor semantic segmentation. In: 2017 8th IEEE international conference on software engineering and service science (ICSESS). IEEE, pp 525\u2013530","DOI":"10.1109\/ICSESS.2017.8342970"},{"key":"3829_CR25","unstructured":"Jiang J, Zheng L, Luo F, Zhang Z (2018) Rednet: residual encoder-decoder network for indoor rgb-d semantic segmentation. arXiv preprint arXiv:1806.01054"},{"key":"3829_CR26","doi-asserted-by":"crossref","unstructured":"Jiao J, Wei Y, Jie Z, Shi H, Lau RW, Huang TS (2019) Geometry-aware distillation for indoor semantic segmentation. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp 2869\u20132878","DOI":"10.1109\/CVPR.2019.00298"},{"key":"3829_CR27","unstructured":"Kosiorek A (2017) \u795e\u7ecf\u7f51\u7edc\u4e2d\u7684\u6ce8\u610f\u529b\u673a\u5236. \u673a\u5668\u4eba\u4ea7\u4e1a, 6"},{"key":"3829_CR28","doi-asserted-by":"crossref","unstructured":"Lambert J, Liu Z, Sener O, Hays J, Koltun V (2020) MSeg: a composite dataset for multi-domain semantic segmentation. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, p 2879\u20132888","DOI":"10.1109\/CVPR42600.2020.00295"},{"key":"3829_CR29","doi-asserted-by":"crossref","unstructured":"Li Z, Gan Y, Liang X, Yu Y, Cheng H, Lin L (2016) Lstm-cf: unifying context modeling and fusion with lstms for rgb-d scene labeling. In: European conference on computer vision. Springer, Cham, p 541\u2013557","DOI":"10.1007\/978-3-319-46475-6_34"},{"key":"3829_CR30","doi-asserted-by":"crossref","unstructured":"Li Y, Zhang J, Cheng Y, Huang K, Tan T (2017) Semantics-guided multi-level RGB-D feature fusion for indoor semantic segmentation. In: 2017 IEEE international conference on image processing (ICIP), pp 1262\u20131266. IEEE.","DOI":"10.1109\/ICIP.2017.8296484"},{"issue":"10","key":"3829_CR31","doi-asserted-by":"publisher","first-page":"2642","DOI":"10.1109\/TPAMI.2019.2923513","volume":"42","author":"D Lin","year":"2019","unstructured":"Lin D, Huang H (2019) Zig-zag network for semantic segmentation of RGB-D images. IEEE Trans Pattern Anal Mach Intell 42(10):2642\u20132655","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"issue":"8","key":"3829_CR32","doi-asserted-by":"publisher","first-page":"1795","DOI":"10.3390\/s19081795","volume":"19","author":"X Lin","year":"2019","unstructured":"Lin X, S\u00e1nchez-Escobedo D, Casas JR, Pard\u00e0s M (2019) Depth estimation and semantic segmentation from a single RGB image using a hybrid convolutional neural network. Sensors 19(8):1795","journal-title":"Sensors"},{"key":"3829_CR33","doi-asserted-by":"crossref","unstructured":"Lin D, Chen G, Cohen-Or D, Heng PA, Huang H (2017a) Cascaded feature network for semantic segmentation of RGB-D images. In: Proceedings of the IEEE international conference on computer vision, pp 1311\u20131319","DOI":"10.1109\/ICCV.2017.147"},{"key":"3829_CR34","doi-asserted-by":"crossref","unstructured":"Lin G, Milan A, Shen C, Reid I (2017b) Refinenet: multi-path refinement networks for high-resolution semantic segmentation. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 1925\u20131934","DOI":"10.1109\/CVPR.2017.549"},{"key":"3829_CR35","doi-asserted-by":"crossref","unstructured":"Lin D, Ji Y, Lischinski D, Cohen-Or D, Huang H (2018) Multi-scale context intertwining for semantic segmentation. In: Proceedings of the European conference on computer vision (ECCV), pp 603\u2013619","DOI":"10.1007\/978-3-030-01219-9_37"},{"issue":"17","key":"3829_CR36","doi-asserted-by":"publisher","first-page":"22475","DOI":"10.1007\/s11042-018-6056-8","volume":"77","author":"H Liu","year":"2018","unstructured":"Liu H, Wu W, Wang X, Qian Y (2018a) RGB-D joint modelling with scene geometric information for indoor semantic segmentation. Multimed Tools Appl 77(17):22475\u201322488","journal-title":"Multimed Tools Appl"},{"issue":"11","key":"3829_CR37","doi-asserted-by":"publisher","first-page":"5655","DOI":"10.1109\/TNNLS.2017.2787781","volume":"29","author":"J Liu","year":"2018","unstructured":"Liu J, Wang Y, Li Y, Fu J, Li J, Lu H (2018b) Collaborative deconvolutional neural networks for joint depth estimation and semantic segmentation. IEEE Trans Neural Netw Learning Syst 29(11):5655\u20135666","journal-title":"IEEE Trans Neural Netw Learning Syst"},{"key":"3829_CR38","doi-asserted-by":"crossref","unstructured":"Liu Y, Chen K, Liu C, Qin Z, Luo Z, Wang J (2019) Structured knowledge distillation for semantic segmentation. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 2604\u20132613","DOI":"10.1109\/CVPR.2019.00271"},{"key":"3829_CR39","doi-asserted-by":"crossref","unstructured":"Long J, Shelhamer E, Darrell T (2015) Fully convolutional networks for semantic segmentation. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp. 3431\u20133440","DOI":"10.1109\/CVPR.2015.7298965"},{"key":"3829_CR40","unstructured":"McCormac J, Handa A, Leutenegger S, Davison AJ (2016) Scenenet rgb-d: 5m photorealistic images of synthetic indoor trajectories with ground truth. arXiv preprint arXiv:1612.05079."},{"key":"3829_CR41","doi-asserted-by":"crossref","unstructured":"Nakajima Y, Kang B, Saito H, Kitani K (2019) Incremental class discovery for semantic segmentation with RGBD sensing. In: Proceedings of the IEEE\/CVF international conference on computer vision, pp 972\u2013981","DOI":"10.1109\/ICCV.2019.00106"},{"key":"3829_CR42","unstructured":"Park SJ, Hong KS, Lee S (2017) Rdfnet: Rgb-d multi-level residual feature fusion for indoor semantic segmentation. In: Proceedings of the IEEE international conference on computer vision, pp 4980\u20134989"},{"key":"3829_CR43","doi-asserted-by":"crossref","unstructured":"Qi X, Liao R, Jia J, Fidler S, Urtasun R (2017) 3d graph neural networks for rgbd semantic segmentation. In: Proceedings of the IEEE international conference on computer vision, pp 5199\u20135208","DOI":"10.1109\/ICCV.2017.556"},{"key":"3829_CR44","doi-asserted-by":"crossref","unstructured":"Schneider L, Jasch M, Fr\u00f6hlich B, Weber T, Franke U, Pollefeys M, R\u00e4tsch M (2017) Multimodal neural networks: Rgb-d for semantic segmentation and object detection. In: Scandinavian conference on image analysis Springer, Cham, pp 98\u2013109","DOI":"10.1007\/978-3-319-59126-1_9"},{"key":"3829_CR45","doi-asserted-by":"crossref","unstructured":"Seichter D, K\u00f6hler M, Lewandowski B, Wengefeld T, Gross HM (2021) Efficient rgb-d semantic segmentation for indoor scene analysis. In: 2021 IEEE international conference on robotics and automation (ICRA). IEEE, pp 13525\u201313531","DOI":"10.1109\/ICRA48506.2021.9561675"},{"key":"3829_CR46","doi-asserted-by":"crossref","unstructured":"Shi W, Zhu D, Zhang G, Chen L, Wang L, Li J, Zhang X (2019) Multilevel Cross-Aware RGBD Semantic Segmentation of Indoor Environments. In: 2019 IEEE international conference on cyborg and bionic systems (CBS). IEEE, pp 346\u2013351","DOI":"10.1109\/CBS46900.2019.9114405"},{"key":"3829_CR47","doi-asserted-by":"crossref","unstructured":"Silberman N, Hoiem D, Kohli P, Fergus R (2012) Indoor segmentation and support inference from rgbd images. In: European conference on computer vision, Springer, Berlin, Heidelberg, pp 746\u2013760","DOI":"10.1007\/978-3-642-33715-4_54"},{"key":"3829_CR48","doi-asserted-by":"crossref","unstructured":"Song S, Lichtenberg SP, Xiao J (2015) Sun rgb-d: a rgb-d scene understanding benchmark suite. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 567\u2013576","DOI":"10.1109\/CVPR.2015.7298655"},{"key":"3829_CR49","doi-asserted-by":"crossref","unstructured":"Su W, Wang Z (2016) Regularized fully convolutional networks for RGB-D semantic segmentation. In: 2016 visual communications and image processing (VCIP). IEEE, pp. 1\u20134","DOI":"10.1109\/VCIP.2016.7805508"},{"key":"3829_CR50","doi-asserted-by":"crossref","unstructured":"Su Y, Yuan Y, Jiang Z (2021) Deep feature selection-and-fusion for RGB-D semantic segmentation. In: 2021 IEEE international conference on multimedia and expo (ICME) IEEE, pp 1\u20136","DOI":"10.1109\/ICME51207.2021.9428155"},{"issue":"4","key":"3829_CR51","doi-asserted-by":"publisher","first-page":"5558","DOI":"10.1109\/LRA.2020.3007457","volume":"5","author":"L Sun","year":"2020","unstructured":"Sun L, Yang K, Hu X, Hu W, Wang K (2020) Real-time fusion network for RGB-D semantic segmentation incorporating unexpected obstacle detection for road-driving images. IEEE Robot Autom Lett 5(4):5558\u20135565","journal-title":"IEEE Robot Autom Lett"},{"key":"3829_CR52","doi-asserted-by":"crossref","unstructured":"Uhrig J, Schneider N, Schneider L, Franke U, Brox T, Geiger A (2017, October) Sparsity invariant cnns. In: 2017 international conference on 3D Vision (3DV) IEEE, pp 11\u201320","DOI":"10.1109\/3DV.2017.00012"},{"key":"3829_CR53","doi-asserted-by":"publisher","first-page":"89575","DOI":"10.1109\/ACCESS.2020.2993570","volume":"8","author":"Y Wang","year":"2020","unstructured":"Wang Y, Chen Q, Chen S, Wu J (2020b) Multi-scale convolutional features network for semantic segmentation in indoor scenes. IEEE Access 8:89575\u201389583","journal-title":"IEEE Access"},{"key":"3829_CR54","doi-asserted-by":"crossref","unstructured":"Wang W, Neumann U (2018) Depth-aware cnn for rgb-d segmentation. In: Proceedings of the European conference on computer vision (ECCV), pp 135\u2013150","DOI":"10.1007\/978-3-030-01252-6_9"},{"key":"3829_CR55","doi-asserted-by":"crossref","unstructured":"Wang J, Wang Z, Tao D, See S, Wang G (2016) Learning common and specific features for RGB-D semantic segmentation with deconvolutional networks. In: European conference on computer vision. Springer, Cham, pp 664\u2013679","DOI":"10.1007\/978-3-319-46454-1_40"},{"issue":"1","key":"3829_CR56","doi-asserted-by":"publisher","first-page":"012138","DOI":"10.1088\/1742-6596\/1637\/1\/012138","volume":"1637","author":"G Wang","year":"2020","unstructured":"Wang G, Wang Z, Chen Y, Wang G, Chen J (2020) Indoor scene semantic segmentation based on RGB-D image and convolution neural network. J Phys Conf Ser 1637(1):012138","journal-title":"J Phys Conf Ser"},{"key":"3829_CR57","doi-asserted-by":"crossref","unstructured":"Xiao J, Owens A, Torralba A (2013) Sun3d: a database of big spaces reconstructed using sfm and object labels. In: Proceedings of the IEEE international conference on computer vision, pp 1625\u20131632","DOI":"10.1109\/ICCV.2013.458"},{"key":"3829_CR58","doi-asserted-by":"crossref","unstructured":"Xing Y, Wang J, Chen X, Zeng G (2019a) 2.5 D convolution for RGB-D semantic segmentation. In: 2019a IEEE international conference on image processing (ICIP). IEEE, pp 1410\u20131414","DOI":"10.1109\/ICIP.2019.8803757"},{"key":"3829_CR59","doi-asserted-by":"crossref","unstructured":"Xing Y, Wang J, Chen X, Zeng G (2019b) Coupling two-stream RGB-D semantic segmentation network by idempotent mappings. In: 2019b IEEE international conference on image processing (ICIP). IEEE, pp 1850\u20131854","DOI":"10.1109\/ICIP.2019.8803146"},{"key":"3829_CR60","doi-asserted-by":"publisher","first-page":"1115","DOI":"10.1109\/LSP.2021.3084855","volume":"28","author":"Y Yue","year":"2021","unstructured":"Yue Y, Zhou W, Lei J, Yu L (2021) Two-stage cascaded decoder for semantic segmentation of RGB-D images. IEEE Signal Process Lett 28:1115\u20131119","journal-title":"IEEE Signal Process Lett"},{"key":"3829_CR61","doi-asserted-by":"publisher","first-page":"658","DOI":"10.1109\/LSP.2021.3066071","volume":"28","author":"G Zhang","year":"2021","unstructured":"Zhang G, Xue JH, Xie P, Yang S, Wang G (2021) Non-local aggregation for RGB-D semantic segmentation. IEEE Signal Process Lett 28:658\u2013662","journal-title":"IEEE Signal Process Lett"},{"key":"3829_CR62","doi-asserted-by":"crossref","unstructured":"Zhang Z, Cui Z, Xu C, Jie Z, Li X, Yang J (2018) Joint task-recursive learning for semantic segmentation and depth estimation. In: Proceedings of the European conference on computer vision (ECCV), pp 235\u2013251","DOI":"10.1007\/978-3-030-01249-6_15"},{"key":"3829_CR63","doi-asserted-by":"crossref","unstructured":"Zhang Z, Cui Z, Xu C, Yan Y, Sebe N, Yang J (2019) Pattern-affinitive propagation across depth, surface normal and semantic segmentation. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp 4106\u20134115","DOI":"10.1109\/CVPR.2019.00423"},{"issue":"1","key":"3829_CR64","first-page":"9283","volume":"33","author":"M Zhen","year":"2019","unstructured":"Zhen M, Wang J, Zhou L, Fang T, Quan L (2019) Learning fully dense neural networks for image semantic segmentation. Proc AAAI Conf Artif Intell 33(1):9283\u20139290","journal-title":"Proc AAAI Conf Artif Intell"},{"key":"3829_CR65","doi-asserted-by":"crossref","unstructured":"Zheng Z, Xie D, Chen C, Zhu Z (2020) Multi-resolution cascaded network with depth-similar residual module for real-time semantic segmentation on RGB-D images. In: 2020 IEEE international conference on networking, sensing and control (ICNSC). IEEE, pp 1\u20136","DOI":"10.1109\/ICNSC48988.2020.9238079"},{"key":"3829_CR67","doi-asserted-by":"crossref","unstructured":"Zhou L, Xu C, Cui Z, Yang J (2019) KIL: knowledge interactiveness learning for joint depth estimation and semantic segmentation. In: Asian conference on pattern recognition, Springer, Cham, pp 835\u2013848","DOI":"10.1007\/978-3-030-41404-7_59"},{"key":"3829_CR68","doi-asserted-by":"crossref","unstructured":"Zhou H, Qi L, Wan Z, Huang H, Yang X (2020a) RGB-D Co-attention network for semantic segmentation. In: Proceedings of the Asian conference on computer vision","DOI":"10.1007\/978-3-030-69525-5_31"},{"issue":"4","key":"3829_CR66","doi-asserted-by":"publisher","first-page":"73","DOI":"10.1109\/MIS.2020.2999462","volume":"36","author":"W Zhou","year":"2020","unstructured":"Zhou W, Yuan J, Lei J, Luo T (2020b) TSNet: Three-stream self-attention network for RGB-D indoor semantic segmentation. IEEE Intell Syst 36(4):73\u201378","journal-title":"IEEE Intell Syst"}],"container-title":["Journal of Ambient Intelligence and Humanized Computing"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s12652-022-03829-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s12652-022-03829-6\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s12652-022-03829-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,9,21]],"date-time":"2024-09-21T18:55:12Z","timestamp":1726944912000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s12652-022-03829-6"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2022,4,7]]},"references-count":68,"journal-issue":{"issue":"10","published-print":{"date-parts":[[2023,10]]}},"alternative-id":["3829"],"URL":"https:\/\/doi.org\/10.1007\/s12652-022-03829-6","relation":{},"ISSN":["1868-5137","1868-5145"],"issn-type":[{"value":"1868-5137","type":"print"},{"value":"1868-5145","type":"electronic"}],"subject":[],"published":{"date-parts":[[2022,4,7]]},"assertion":[{"value":"20 April 2021","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"10 March 2022","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"7 April 2022","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}]}}