{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,23]],"date-time":"2026-07-23T05:37:08Z","timestamp":1784785028295,"version":"3.55.0"},"reference-count":70,"publisher":"Springer Science and Business Media LLC","issue":"8","license":[{"start":{"date-parts":[[2023,5,18]],"date-time":"2023-05-18T00:00:00Z","timestamp":1684368000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2023,5,18]],"date-time":"2023-05-18T00:00:00Z","timestamp":1684368000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Int J Comput Vis"],"published-print":{"date-parts":[[2023,8]]},"DOI":"10.1007\/s11263-023-01801-1","type":"journal-article","created":{"date-parts":[[2023,5,19]],"date-time":"2023-05-19T01:01:52Z","timestamp":1684458112000},"page":"2153-2171","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":22,"title":["Lightweight and Progressively-Scalable Networks for Semantic Segmentation"],"prefix":"10.1007","volume":"131","author":[{"given":"Yiheng","family":"Zhang","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-7587-101X","authenticated-orcid":false,"given":"Ting","family":"Yao","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zhaofan","family":"Qiu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Tao","family":"Mei","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2023,5,18]]},"reference":[{"key":"1801_CR1","doi-asserted-by":"publisher","first-page":"44","DOI":"10.1007\/978-3-540-88682-2_5","volume":"5302","author":"GJ Brostow","year":"2008","unstructured":"Brostow, G. J., Shotton, J., Fauqueur, J., & Cipolla, R. (2008). Segmentation and recognition using structure from motion point clouds. European Conference on Computer Vision (ECCV), 5302, 44\u201357. https:\/\/doi.org\/10.1007\/978-3-540-88682-2_5","journal-title":"European Conference on Computer Vision (ECCV)"},{"key":"1801_CR2","doi-asserted-by":"publisher","unstructured":"Chen, L.C., Yang, Y., Wang, J., Xu, W., & Yuille, A.L. (2016). Attention to scale: Scale-aware semantic image segmentation. In 2016 IEEE conference on computer vision and pattern recognition (CVPR) (pp. 3640\u20133649).https:\/\/doi.org\/10.1109\/CVPR.2016.396.","DOI":"10.1109\/CVPR.2016.396"},{"key":"1801_CR3","first-page":"8713","volume":"31","author":"LC Chen","year":"2018","unstructured":"Chen, L. C., Collins, M., Zhu, Y., Papandreou, G., Zoph, B., Schroff, F., Adam, H., & Shlens, J. (2018). Searching for efficient multi-scale architectures for dense image prediction. Advances in Neural Information Processing Systems (NeurIPS), 31, 8713\u20138724.","journal-title":"Advances in Neural Information Processing Systems (NeurIPS)"},{"issue":"4","key":"1801_CR4","doi-asserted-by":"publisher","first-page":"834","DOI":"10.1109\/TPAMI.2017.2699184","volume":"40","author":"LC Chen","year":"2018","unstructured":"Chen, L. C., Papandreou, G., Kokkinos, I., Murphy, K., & Yuille, A. L. (2018). Deeplab: Semantic image segmentation with deep convolutional nets, atrous convolution, and fully connected crfs. IEEE Transactions on Pattern Analysis and Machine Intelligence, 40(4), 834\u2013848. https:\/\/doi.org\/10.1109\/TPAMI.2017.2699184","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"1801_CR5","doi-asserted-by":"publisher","first-page":"801","DOI":"10.1007\/978-3-030-01234-2\\_49","volume":"11211","author":"LC Chen","year":"2018","unstructured":"Chen, L. C., Zhu, Y., Papandreou, G., Schroff, F., & Adam, H. (2018). Encoder-decoder with atrous separable convolution for semantic image segmentation. European Conference on Computer Vision (ECCV), 11211, 801\u2013818. https:\/\/doi.org\/10.1007\/978-3-030-01234-2_49","journal-title":"European Conference on Computer Vision (ECCV)"},{"key":"1801_CR6","unstructured":"Chen, W., Gong, X., Liu, X., Zhang, Q., Li, Y., & Wang, Z. (2020). Fasterseg: Searching for faster real-time semantic segmentation. In International conference on learning representations (ICLR)"},{"key":"1801_CR7","doi-asserted-by":"publisher","unstructured":"Chollet, F. (2017). Xception: Deep learning with depthwise separable convolutions. In 2017 IEEE conference on computer vision and pattern recognition (CVPR) (pp 1800\u20131807). https:\/\/doi.org\/10.1109\/CVPR.2017.195.","DOI":"10.1109\/CVPR.2017.195"},{"key":"1801_CR8","doi-asserted-by":"publisher","unstructured":"Cordts, M., Omran, M., Ramos, S., Rehfeld, T., Enzweiler, M., Benenson, R., Franke, U., Roth, S., & Schiele, B. (2016). The cityscapes dataset for semantic urban scene understanding. In 2016 IEEE conference on computer vision and pattern recognition (CVPR) (pp. 3213\u20133223). https:\/\/doi.org\/10.1109\/CVPR.2016.350.","DOI":"10.1109\/CVPR.2016.350"},{"key":"1801_CR9","doi-asserted-by":"publisher","unstructured":"Ding, M., Lian, X., Yang, L., Wang, P., Jin, X., Lu, Z., & Luo, P. (2021a). Hr-nas: Searching efficient high-resolution neural architectures with lightweight transformers. In 2021 IEEE conference on computer vision and pattern recognition (CVPR) (pp. 2982\u20132992). https:\/\/doi.org\/10.1109\/CVPR46437.2021.00300.","DOI":"10.1109\/CVPR46437.2021.00300"},{"key":"1801_CR10","doi-asserted-by":"publisher","unstructured":"Ding, X., Zhang, X., Ma, N., Han, J., Ding, G., & Sun, J. (2021b). Repvgg: Making vgg-style convnets great again. In 2021 IEEE\/CVF conference on computer vision and pattern recognition (CVPR) (pp. 13728\u201313737). https:\/\/doi.org\/10.1109\/CVPR46437.2021.01352.","DOI":"10.1109\/CVPR46437.2021.01352"},{"key":"1801_CR11","doi-asserted-by":"publisher","unstructured":"Fan, M., Lai, S., Huang, J., Wei, X., Chai, Z., Luo, J., & Wei, X. (2021) Rethinking bisenet for real-time semantic segmentation. In 2021 IEEE\/CVF conference on computer vision and pattern recognition (CVPR) (pp. 9711\u20139720). https:\/\/doi.org\/10.1109\/CVPR46437.2021.00959","DOI":"10.1109\/CVPR46437.2021.00959"},{"key":"1801_CR12","doi-asserted-by":"publisher","unstructured":"Fu, J., Liu, J., Wang, Y., Li, Y., Bao, Y., Tang, J., & Lu, H. (2019) Adaptive context network for scene parsing. In 2019 IEEE\/CVF international conference on computer vision (ICCV) (pp. 6747\u20136756). https:\/\/doi.org\/10.1109\/ICCV.2019.00685.","DOI":"10.1109\/ICCV.2019.00685"},{"key":"1801_CR13","doi-asserted-by":"publisher","first-page":"519","DOI":"10.1007\/978-3-319-46487-9\\_32","volume":"9907","author":"G Ghiasi","year":"2016","unstructured":"Ghiasi, G., & Fowlkesl, C. C. (2016). Laplacian pyramid reconstruction and refinement for semantic segmentation. European Conference on Computer Vision (ECCV), 9907, 519\u2013534. https:\/\/doi.org\/10.1007\/978-3-319-46487-9_32","journal-title":"European Conference on Computer Vision (ECCV)"},{"key":"1801_CR14","doi-asserted-by":"publisher","unstructured":"Gholami, A., Kwon, K., Wu, B., Tai, Z., Yue, X., Jin, P., Zhao, S., & Keutzer, K. (2018). Squeezenext: Hardware-aware neural network design. In 2018 IEEE\/CVF conference on computer vision and pattern recognition workshops (CVPRW) (pp. 1719\u2013171909). https:\/\/doi.org\/10.1109\/CVPRW.2018.00215.","DOI":"10.1109\/CVPRW.2018.00215"},{"key":"1801_CR15","doi-asserted-by":"publisher","unstructured":"Goldberg, D.E., & Deb, K. (1990) A comparative analysis of selection schemes used in genetic algorithms. In Foundations of genetic algorithms (pp 69\u201393). https:\/\/doi.org\/10.1016\/b978-0-08-050684-5.50008-2.","DOI":"10.1016\/b978-0-08-050684-5.50008-2"},{"key":"1801_CR16","doi-asserted-by":"publisher","unstructured":"Han, K., Wang, Y., Tian, Q., Guo, J., Xu, C., & Xu, C. (2020) Ghostnet: More features from cheap operations. In 2020 IEEE\/CVF conference on computer vision and pattern recognition (CVPR) (pp. 1577\u20131586). https:\/\/doi.org\/10.1109\/CVPR42600.2020.00165.","DOI":"10.1109\/CVPR42600.2020.00165"},{"key":"1801_CR17","unstructured":"Han, S., Mao, H., & Dally, W.J. (2016). Deep compression: Compressing deep neural networks with pruning, trained quantization and huffman coding. In International conference on learning representations (ICLR)."},{"key":"1801_CR18","doi-asserted-by":"publisher","unstructured":"He, K., Zhang, X., Ren, S., & Sun, J. (2016). Deep residual learning for image recognition. In 2016 IEEE conference on computer vision and pattern recognition (CVPR) (pp. 770\u2013778). https:\/\/doi.org\/10.1109\/CVPR.2016.90.","DOI":"10.1109\/CVPR.2016.90"},{"key":"1801_CR19","unstructured":"Hong, Y., Pan, H., Sun, W., & Jia, Y. (2021) Deep dual-resolution networks for real-time and accurate semantic segmentation of road scenes. ArXiv:2101.06085."},{"key":"1801_CR20","unstructured":"Howard, A.G., Zhu, M., Chen, B., Kalenichenko, D., Wang, W., Weyand, T., Andreetto, M., & Adam, H. (2017). Mobilenets: Efficient convolutional neural networks for mobile vision applications. ArXiv:1704.04861"},{"key":"1801_CR21","first-page":"1106","volume":"25","author":"A Krizhevsky","year":"2012","unstructured":"Krizhevsky, A., Sutskever, I., & Hinton, G. E. (2012). Imagenet classification with deep convolutional neural networks. Advances in Neural Information Processing Systems (NIPS), 25, 1106\u20131114.","journal-title":"Advances in Neural Information Processing Systems (NIPS)"},{"key":"1801_CR22","doi-asserted-by":"publisher","unstructured":"Ladick\u00fd, L., Russell, C., Kohli, P., & Torr, P.H. (2009). Associative hierarchical crfs for object class image segmentation. In 2009 IEEE 12th international conference on computer vision (pp. 739\u2013746). https:\/\/doi.org\/10.1109\/ICCV.2009.5459248","DOI":"10.1109\/ICCV.2009.5459248"},{"key":"1801_CR23","unstructured":"Li, G., Yun, I., Kim, J., & Kim, J. (2019). Dabnet: Depth-wise asymmetric bottleneck for real-time semantic segmentation. In British machine vision conference (BMVC)"},{"key":"1801_CR24","doi-asserted-by":"publisher","unstructured":"Li, H., Xiong, P., Fan, H., & Sun, J. (2019a). Dfanet: Deep feature aggregation for real-time semantic segmentation. In 2019 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR) (pp. 9514\u20139523). https:\/\/doi.org\/10.1109\/CVPR.2019.00975.","DOI":"10.1109\/CVPR.2019.00975"},{"key":"1801_CR25","unstructured":"Li, P., Dong, X., Yu, X., & Yang, Y. (2020a) When humans meet machines: Towards efficient segmentation networks. In British machine vision conference (BMVC)"},{"key":"1801_CR26","doi-asserted-by":"publisher","unstructured":"Li, X., Zhou, Y., Pan, Z., & Feng, J. (2019b) Partial order pruning: For best speed\/accuracy trade-off in neural architecture search. In 2019 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR) (pp. 9137\u20139145). https:\/\/doi.org\/10.1109\/CVPR.2019.00936.","DOI":"10.1109\/CVPR.2019.00936"},{"key":"1801_CR27","doi-asserted-by":"publisher","first-page":"775","DOI":"10.1007\/978-3-030-58452-8\\_45","volume":"12346","author":"X Li","year":"2020","unstructured":"Li, X., You, A., Zhu, Z., Zhao, H., Yang, M., Yang, K., Tan, S., & Tong, Y. (2020). Semantic flow for fast and accurate scene parsing. European Conference on Computer Vision (ECCV), 12346, 775\u2013793. https:\/\/doi.org\/10.1007\/978-3-030-58452-8_45","journal-title":"European Conference on Computer Vision (ECCV)"},{"key":"1801_CR28","unstructured":"Li, X., Zhang, J., Yang, Y., Cheng, G., Yang, K., Tong, Y., & Tao, D. (2022) Sfnet: Faster, accurate, and domain agnostic semantic segmentation via semantic flow. ArXiv:2207.04415"},{"key":"1801_CR29","doi-asserted-by":"publisher","unstructured":"Lin, D., Shen, D., Shen, S., Ji, Y., Lischinski, D., Cohen-Or, D., & Huang, H. (2019) Zigzagnet: Fusing top-down and bottom-up context for object segmentation. In 2019 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR) (pp. 7482\u20137491). https:\/\/doi.org\/10.1109\/CVPR.2019.00767.","DOI":"10.1109\/CVPR.2019.00767"},{"key":"1801_CR30","doi-asserted-by":"publisher","unstructured":"Lin, P., Sun, P., Cheng, G., Xie, S., Li, X., & Shi, J. (2020) Graph-guided architecture search for real-time semantic segmentation. In 2020 IEEE\/CVF conference on computer vision and pattern recognition (CVPR) (pp. 4202\u20134211). https:\/\/doi.org\/10.1109\/CVPR42600.2020.00426.","DOI":"10.1109\/CVPR42600.2020.00426"},{"key":"1801_CR31","doi-asserted-by":"publisher","first-page":"740","DOI":"10.1007\/978-3-319-10602-1\\_48","volume":"8693","author":"TY Lin","year":"2014","unstructured":"Lin, T. Y., Maire, M., Belongie, S., Hays, J., Perona, P., Ramanan, D., Doll\u00e1r, P., & Zitnick, C. L. (2014). Microsoft coco: Common objects in context. European Conference on Computer Vision (ECCV), 8693, 740\u2013755. https:\/\/doi.org\/10.1007\/978-3-319-10602-1_48","journal-title":"European Conference on Computer Vision (ECCV)"},{"key":"1801_CR32","doi-asserted-by":"publisher","first-page":"19","DOI":"10.1007\/978-3-030-01246-5\\_2","volume":"11205","author":"C Liu","year":"2017","unstructured":"Liu, C., Zoph, B., Shlens, J., Hua, W., Li, L. J., Fei-Fei, L., Yuille, A. L., Huang, J., & Murphy, K. P. (2017). Progressive neural architecture search. European Conference on Computer Vision (ECCV), 11205, 19\u201335. https:\/\/doi.org\/10.1007\/978-3-030-01246-5_2","journal-title":"European Conference on Computer Vision (ECCV)"},{"key":"1801_CR33","doi-asserted-by":"publisher","unstructured":"Liu, C., Chen, L.C., Schroff, F., Adam, H., Hua, W., Yuille, A.L., & Fei-Fei, L. (2019a) Auto-deeplab: Hierarchical neural architecture search for semantic image segmentation. In 2019 IEEE\/CVF conference on computer vision and pattern recognition (CVPR) (pp. 82\u201392). https:\/\/doi.org\/10.1109\/CVPR.2019.00017.","DOI":"10.1109\/CVPR.2019.00017"},{"key":"1801_CR34","unstructured":"Liu, H., Simonyan, K., & Yang, Y. (2019b). DARTS: Differentiable architecture search. In International conference on learning representations (ICLR)"},{"key":"1801_CR35","doi-asserted-by":"publisher","unstructured":"Long, J., Shelhamer, E., & Darrell, T. (2015). Fully convolutional networks for semantic segmentation. In 2015 IEEE conference on computer vision and pattern recognition (CVPR) (pp. 3431\u20133440). https:\/\/doi.org\/10.1109\/CVPR.2015.7298965.","DOI":"10.1109\/CVPR.2015.7298965"},{"key":"1801_CR36","doi-asserted-by":"publisher","first-page":"116","DOI":"10.1007\/978-3-030-01264-9\\_8","volume":"11218","author":"N Ma","year":"2018","unstructured":"Ma, N., Zhang, X., Zheng, H. T., & Sun, J. (2018). Shufflenet v2: Practical guidelines for efficient CNN architecture design. European Conference on Computer Vision (ECCV), 11218, 116\u2013131. https:\/\/doi.org\/10.1007\/978-3-030-01264-9_8","journal-title":"European Conference on Computer Vision (ECCV)"},{"key":"1801_CR37","doi-asserted-by":"publisher","unstructured":"Nirkin, Y., Wolf, L., & Hassner, T. (2021) Hyperseg: Patch-wise hypernetwork for real-time semantic segmentation. In 2021 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR) (pp. 4060\u20134069). https:\/\/doi.org\/10.1109\/CVPR46437.2021.00405.","DOI":"10.1109\/CVPR46437.2021.00405"},{"key":"1801_CR38","unstructured":"Paszke, A., Gross, S., Massa, F., Lerer, A., Bradbury, J., Chanan, G., Killeen, T., Lin, Z., Gimelshein, N., & Antiga, L., et al. (2019). Pytorch: An imperative style, high-performance deep learning library. In Advances in Neural Information Processing Systems (NeurIPS) (Vol.\u00a032, pp. 8024\u20138035)."},{"key":"1801_CR39","doi-asserted-by":"publisher","unstructured":"Peng, C., Zhang, X., Yu, G., Luo, G., & Sun, J. (2017) Large kernel matters\u2014Improve semantic segmentation by global convolutional network. In 2017 IEEE Conference on Computer Vision and Pattern Recognition (CVPR) (pp. 1743\u20131751). https:\/\/doi.org\/10.1109\/CVPR.2017.189.","DOI":"10.1109\/CVPR.2017.189"},{"key":"1801_CR40","unstructured":"Poudel, R.P., Liwicki, S., & Cipolla, R. (2019) Fast-scnn: Fast semantic segmentation network. In British Machine Vision Conference (BMVC)"},{"key":"1801_CR41","doi-asserted-by":"publisher","DOI":"10.1016\/j.patcog.2020.107404","volume":"106","author":"X Qin","year":"2020","unstructured":"Qin, X., Zhang, Z., Huang, C., Dehghan, M., Zaiane, O. R., & Jagersand, M. (2020). U2-net: Going deeper with nested u-structure for salient object detection. Pattern Recognition, 106, 107404. https:\/\/doi.org\/10.1016\/j.patcog.2020.107404","journal-title":"Pattern Recognition"},{"issue":"4","key":"1801_CR42","doi-asserted-by":"publisher","first-page":"939","DOI":"10.1109\/TMM.2017.2759504","volume":"20","author":"Z Qiu","year":"2017","unstructured":"Qiu, Z., Yao, T., & Mei, T. (2017). Learning deep spatio-temporal dependence for semantic video segmentation. IEEE Transactions on Multimedia, 20(4), 939\u2013949. https:\/\/doi.org\/10.1109\/TMM.2017.2759504","journal-title":"IEEE Transactions on Multimedia"},{"key":"1801_CR43","unstructured":"Qiu, Z., Yao, T., Zhang, Y., Zhang, Y., & Mei, T. (2019) Scheduled differentiable architecture search for visual recognition. ArXiv:1909.10236"},{"key":"1801_CR44","unstructured":"Real, E., Moore, S., Selle, A., Saxena, S., Suematsu, Y.L., Tan, J., Le, Q.V., & Kurakin, A. (2017). Large-scale evolution of image classifiers. In 34th International Conference on Machine Learning (ICML) (Vol.\u00a070, pp. 2902\u20132911)."},{"issue":"3","key":"1801_CR45","doi-asserted-by":"publisher","first-page":"211","DOI":"10.1007\/s11263-015-0816-y","volume":"115","author":"O Russakovsky","year":"2015","unstructured":"Russakovsky, O., Deng, J., Su, H., Krause, J., Satheesh, S., Ma, S., Huang, Z., Karpathy, A., Khosla, A., Bernstein, M. S., Berg, A. C., & Fei-Fei, L. (2015). Imagenet large scale visual recognition challenge. International Journal of Computer Vision (IJCV), 115(3), 211\u2013252. https:\/\/doi.org\/10.1007\/s11263-015-0816-y","journal-title":"International Journal of Computer Vision (IJCV)"},{"key":"1801_CR46","doi-asserted-by":"publisher","unstructured":"Sandler, M., Howard, A., Zhu, M., Zhmoginov, A., & Chen, L.C. (2018) Mobilenetv2: Inverted residuals and linear bottlenecks. In: 2018 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (pp. 4510\u20134520). https:\/\/doi.org\/10.1109\/CVPR.2018.00474","DOI":"10.1109\/CVPR.2018.00474"},{"key":"1801_CR47","unstructured":"Si, H., Zhang, Z., & Lu, F. (2020). Real-time semantic segmentation via multiply spatial fusion network. In British Machine Vision Conference (BMVC)"},{"issue":"5","key":"1801_CR48","doi-asserted-by":"publisher","first-page":"1506","DOI":"10.1007\/s11263-021-01433-3","volume":"129","author":"P Sun","year":"2021","unstructured":"Sun, P., Wu, J., Li, S., Lin, P., Huang, J., & Li, X. (2021). Real-time semantic segmentation via auto depth, downsampling joint decision and feature aggregation. International Journal of Computer Vision (IJCV), 129(5), 1506\u20131525. https:\/\/doi.org\/10.1007\/s11263-021-01433-3","journal-title":"International Journal of Computer Vision (IJCV)"},{"key":"1801_CR49","doi-asserted-by":"publisher","unstructured":"Szegedy, C., Vanhoucke, V., Ioffe, S., Shlens, J., & Wojna, Z. (2016) Rethinking the inception architecture for computer vision. In 2016 IEEE conference on computer vision and pattern recognition (CVPR) (pp. 2818\u20132826). https:\/\/doi.org\/10.1109\/CVPR.2016.308.","DOI":"10.1109\/CVPR.2016.308"},{"key":"1801_CR50","unstructured":"Tan, M., & Le, Q.V. (2019) Efficientnet: Rethinking model scaling for convolutional neural networks. In 36th International Conference on Machine Learning (ICML) (Vol\u00a097, pp. 6105\u20136114)"},{"key":"1801_CR51","unstructured":"Tao, A., Sapra, K., & Catanzaro, B. (2020) Hierarchical multi-scale attention for semantic segmentation. ArXiv:2005.10821"},{"issue":"10","key":"1801_CR52","doi-asserted-by":"publisher","first-page":"3349","DOI":"10.1109\/TPAMI.2020.2983686","volume":"43","author":"J Wang","year":"2021","unstructured":"Wang, J., Sun, K., Cheng, T., Jiang, B., Deng, C., Zhao, Y., Liu, D., Mu, Y., Tan, M., Wang, X., Liu, W., & Xiao, B. (2021). Deep high-resolution representation learning for visual recognition. IEEE Transactions on Pattern Analysis and Machine Intelligence, 43(10), 3349\u20133364. https:\/\/doi.org\/10.1109\/TPAMI.2020.2983686","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"1801_CR53","doi-asserted-by":"publisher","unstructured":"Wang, L., Lu, H., Wang, Y., Feng, M., Wang, D., Yin, B., & Ruan, X. (2017). Learning to detect salient objects with image-level supervision. In 2017 IEEE Conference on Computer Vision and Pattern Recognition (CVPR) (pp. 136\u2013145). https:\/\/doi.org\/10.1109\/CVPR.2017.404.","DOI":"10.1109\/CVPR.2017.404"},{"key":"1801_CR54","unstructured":"Wu, B., Li, C., Zhang, H., Dai, X., Zhang, P., Yu, M., Wang, J., Lin, Y., & Vajda, P. (2021a). Fbnetv5: Neural architecture search for multiple tasks in one run. ArXiv:2111.10007"},{"key":"1801_CR55","doi-asserted-by":"publisher","unstructured":"Wu, Y., Li, X., Shi, C., Tong, Y., Hua, Y., Song, T., Ma, R., & Guan, H. (2021b). Fast and accurate scene parsing via bi-direction alignment networks. In 2021 IEEE International Conference on Image Processing (ICIP) (pp. 2508\u20132512). https:\/\/doi.org\/10.1109\/ICIP42928.2021.9506720","DOI":"10.1109\/ICIP42928.2021.9506720"},{"key":"1801_CR56","doi-asserted-by":"publisher","first-page":"325","DOI":"10.1007\/978-3-030-01261-8\\_20","volume":"11217","author":"C Yu","year":"2018","unstructured":"Yu, C., Wang, J., Peng, C., Gao, C., Yu, G., & Sang, N. (2018). Bisenet: Bilateral segmentation network for real-time semantic segmentation. European Conference on Computer Vision (ECCV), 11217, 325\u2013341. https:\/\/doi.org\/10.1007\/978-3-030-01261-8_20","journal-title":"European Conference on Computer Vision (ECCV)"},{"issue":"11","key":"1801_CR57","doi-asserted-by":"publisher","first-page":"3051","DOI":"10.1007\/s11263-021-01515-2","volume":"129","author":"C Yu","year":"2021","unstructured":"Yu, C., Gao, C., Wang, J., Yu, G., Shen, C., & Sang, N. (2021). Bisenet v2: Bilateral network with guided aggregation for real-time semantic segmentation. International Journal of Computer Vision (IJCV), 129(11), 3051\u20133068. https:\/\/doi.org\/10.1007\/s11263-021-01515-2","journal-title":"International Journal of Computer Vision (IJCV)"},{"key":"1801_CR58","doi-asserted-by":"publisher","unstructured":"Yu, C., Xiao, B., Gao, C., Yuan, L., Zhang, L., Sang, N., & Wang, J. (2021b) Lite-hrnet: A lightweight high-resolution network. In 2021 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR) (pp. 10435\u201310445). https:\/\/doi.org\/10.1109\/CVPR46437.2021.01030.","DOI":"10.1109\/CVPR46437.2021.01030"},{"key":"1801_CR59","doi-asserted-by":"publisher","unstructured":"Yu, F., Koltun, V., & Funkhouser, T. (2017) Dilated residual networks. In 2017 IEEE Conference on Computer Vision and Pattern Recognition (CVPR) (pp. 636\u2013644). https:\/\/doi.org\/10.1109\/CVPR.2017.75.","DOI":"10.1109\/CVPR.2017.75"},{"key":"1801_CR60","unstructured":"Yu, F., Xian, W., Chen, Y., Liu, F., Liao, M., Madhavan, V., & Darrell, T. (2018b) Bdd100k: A diverse driving video database with scalable annotation tooling. ArXiv:1805.04687"},{"issue":"8","key":"1801_CR61","doi-asserted-by":"publisher","first-page":"2375","DOI":"10.1007\/s11263-021-01465-9","volume":"129","author":"Y Yuan","year":"2021","unstructured":"Yuan, Y., Huang, L., Guo, J., Zhang, C., Chen, X., & Wang, J. (2021). Ocnet: Object context for semantic segmentation. International Journal of Computer Vision (IJCV), 129(8), 2375\u20132398. https:\/\/doi.org\/10.1007\/s11263-021-01465-9","journal-title":"International Journal of Computer Vision (IJCV)"},{"key":"1801_CR62","doi-asserted-by":"publisher","unstructured":"Zhang, J., Pan, Y., Yao, T., Zhao, H., & Mei, T. (2019a) dabnn: A super fast inference framework for binary neural networks on arm devices. In Proceedings of the 27th ACM international conference on multimedia (pp. 2272\u20132275). https:\/\/doi.org\/10.1145\/3343031.3350534.","DOI":"10.1145\/3343031.3350534"},{"key":"1801_CR63","doi-asserted-by":"publisher","unstructured":"Zhang, X., Zhou, X., Lin, M., & Sun, J. (2018) Shufflenet: An extremely efficient convolutional neural network for mobile devices. In 2018 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (pp. 6848\u20136856). https:\/\/doi.org\/10.1109\/CVPR.2018.00716","DOI":"10.1109\/CVPR.2018.00716"},{"key":"1801_CR64","doi-asserted-by":"publisher","unstructured":"Zhang, X., Xu, H., Mo, H., Tan, J., Yang, C., Wang, L., & Ren, W. (2021) Dcnas: Densely connected neural architecture search for semantic image segmentation. In 2021 IEEE Conference on Computer Vision and Pattern Recognition (CVPR) (pp. 13956\u201313967). https:\/\/doi.org\/10.1109\/CVPR46437.2021.01374.","DOI":"10.1109\/CVPR46437.2021.01374"},{"key":"1801_CR65","doi-asserted-by":"publisher","unstructured":"Zhang, Y., Qiu, Z., Liu, J., Yao, T., Liu, D., & Mei, T. (2019b) Customizable architecture search for semantic segmentation. In 2019 IEEE\/CVF conference on computer vision and pattern recognition (CVPR) (pp 11633\u201311642). https:\/\/doi.org\/10.1109\/CVPR.2019.01191.","DOI":"10.1109\/CVPR.2019.01191"},{"key":"1801_CR66","doi-asserted-by":"publisher","unstructured":"Zhao, H., Shi, J., Qi, X., Wang, X., & Jia, J. (2017). Pyramid scene parsing network. In 2017 IEEE Conference on Computer Vision and Pattern Recognition (CVPR) (pp. 6230\u20136239). https:\/\/doi.org\/10.1109\/CVPR.2017.660.","DOI":"10.1109\/CVPR.2017.660"},{"key":"1801_CR67","doi-asserted-by":"publisher","first-page":"405","DOI":"10.1007\/978-3-030-01219-9\\_25","volume":"11207","author":"H Zhao","year":"2018","unstructured":"Zhao, H., Qi, X., Shen, X., Shi, J., & Jia, J. (2018). Icnet for real-time semantic segmentation on high-resolution images. European Conference on Computer Vision (ECCV), 11207, 405\u2013420. https:\/\/doi.org\/10.1007\/978-3-030-01219-9_25","journal-title":"European Conference on Computer Vision (ECCV)"},{"key":"1801_CR68","unstructured":"Zhou, X., Wang, D., & Kr\u00e4henb\u00fchl, P. (2019) Objects as points. ArXiv:1904.07850"},{"key":"1801_CR69","unstructured":"Zoph, B., & Le, Q.V. (2017) Neural architecture search with reinforcement learning. In International Conference on Learning Representations (ICLR)"},{"key":"1801_CR70","doi-asserted-by":"publisher","unstructured":"Zoph, B., Vasudevan, V., Shlens, J., & Le, Q.V. (2018) Learning transferable architectures for scalable image recognition. In 2018 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (pp. 8697\u20138710). https:\/\/doi.org\/10.1109\/CVPR.2018.00907.","DOI":"10.1109\/CVPR.2018.00907"}],"container-title":["International Journal of Computer Vision"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11263-023-01801-1.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11263-023-01801-1\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11263-023-01801-1.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2023,7,17]],"date-time":"2023-07-17T07:13:06Z","timestamp":1689577986000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11263-023-01801-1"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2023,5,18]]},"references-count":70,"journal-issue":{"issue":"8","published-print":{"date-parts":[[2023,8]]}},"alternative-id":["1801"],"URL":"https:\/\/doi.org\/10.1007\/s11263-023-01801-1","relation":{},"ISSN":["0920-5691","1573-1405"],"issn-type":[{"value":"0920-5691","type":"print"},{"value":"1573-1405","type":"electronic"}],"subject":[],"published":{"date-parts":[[2023,5,18]]},"assertion":[{"value":"27 July 2022","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"17 April 2023","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"18 May 2023","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}]}}