{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,30]],"date-time":"2026-07-30T14:23:50Z","timestamp":1785421430096,"version":"3.56.0"},"publisher-location":"Cham","reference-count":75,"publisher":"Springer Nature Switzerland","isbn-type":[{"value":"9783031198359","type":"print"},{"value":"9783031198366","type":"electronic"}],"license":[{"start":{"date-parts":[[2022,1,1]],"date-time":"2022-01-01T00:00:00Z","timestamp":1640995200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"},{"start":{"date-parts":[[2022,1,1]],"date-time":"2022-01-01T00:00:00Z","timestamp":1640995200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2022]]},"DOI":"10.1007\/978-3-031-19836-6_29","type":"book-chapter","created":{"date-parts":[[2022,10,21]],"date-time":"2022-10-21T09:04:58Z","timestamp":1666343098000},"page":"510-528","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":51,"title":["Image Coding for\u00a0Machines with\u00a0Omnipotent Feature Learning"],"prefix":"10.1007","author":[{"given":"Ruoyu","family":"Feng","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xin","family":"Jin","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zongyu","family":"Guo","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Runsen","family":"Feng","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Yixin","family":"Gao","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Tianyu","family":"He","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zhizheng","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Simeng","family":"Sun","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Zhibo","family":"Chen","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2022,10,22]]},"reference":[{"issue":"12","key":"29_CR1","doi-asserted-by":"publisher","first-page":"2481","DOI":"10.1109\/TPAMI.2016.2644615","volume":"39","author":"V Badrinarayanan","year":"2017","unstructured":"Badrinarayanan, V., Kendall, A., Cipolla, R.: Segnet: a deep convolutional encoder-decoder architecture for image segmentation. TPAMI 39(12), 2481\u20132495 (2017)","journal-title":"TPAMI"},{"key":"29_CR2","doi-asserted-by":"crossref","unstructured":"Baji\u0107, I.V., Lin, W., Tian, Y.: Collaborative intelligence: challenges and opportunities. In: ICASSP 2021\u20132021 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), pp. 8493\u20138497. IEEE (2021)","DOI":"10.1109\/ICASSP39728.2021.9413943"},{"key":"29_CR3","unstructured":"Ball\u00e9, J., Laparra, V., Simoncelli, E.P.: End-to-end optimized image compression. In: ICLR (2017)"},{"key":"29_CR4","unstructured":"Ball\u00e9, J., Minnen, D., Singh, S., Hwang, S.J., Johnston, N.: Variational image compression with a scale hyperprior. In: ICLR (2018)"},{"key":"29_CR5","doi-asserted-by":"crossref","unstructured":"Bolya, D., Zhou, C., Xiao, F., Lee, Y.J.: Yolact: real-time instance segmentation. In: ICCV, pp. 9157\u20139166 (2019)","DOI":"10.1109\/ICCV.2019.00925"},{"key":"29_CR6","doi-asserted-by":"crossref","unstructured":"Bross, B., et al.: Overview of the versatile video coding (VVC) standard and its applications. In: TCSVT (2021)","DOI":"10.1145\/3510450.3517315"},{"key":"29_CR7","doi-asserted-by":"crossref","unstructured":"Cai, Q., Chen, Z., Wu, D., Liu, S., Li, X.: A novel video coding strategy in HEVC for object detection. In: TCSVT (2021)","DOI":"10.1109\/TCSVT.2021.3056134"},{"key":"29_CR8","unstructured":"Caron, M., Misra, I., Mairal, J., Goyal, P., Bojanowski, P., Joulin, A.: Unsupervised learning of visual features by contrasting cluster assignments. arXiv preprint arXiv:2006.09882 (2020)"},{"issue":"4","key":"29_CR9","doi-asserted-by":"publisher","first-page":"834","DOI":"10.1109\/TPAMI.2017.2699184","volume":"40","author":"LC Chen","year":"2017","unstructured":"Chen, L.C., Papandreou, G., Kokkinos, I., Murphy, K., Yuille, A.L.: DeepLab: semantic image segmentation with deep convolutional nets, atrous convolution, and fully connected CRFs. TPAMI 40(4), 834\u2013848 (2017)","journal-title":"TPAMI"},{"key":"29_CR10","doi-asserted-by":"crossref","unstructured":"Chen, L.C., Zhu, Y., Papandreou, G., Schroff, F., Adam, H.: Encoder-decoder with atrous separable convolution for semantic image segmentation. In: ECCV, pp. 801\u2013818 (2018)","DOI":"10.1007\/978-3-030-01234-2_49"},{"key":"29_CR11","unstructured":"Chen, T., Kornblith, S., Norouzi, M., Hinton, G.: A simple framework for contrastive learning of visual representations. In: ICML, pp. 1597\u20131607. PMLR (2020)"},{"key":"29_CR12","unstructured":"Chen, X., Fan, H., Girshick, R., He, K.: Improved baselines with momentum contrastive learning. arXiv preprint arXiv:2003.04297 (2020)"},{"key":"29_CR13","doi-asserted-by":"crossref","unstructured":"Chen, X., He, K.: Exploring simple Siamese representation learning. In: CVPR, pp. 15750\u201315758 (2021)","DOI":"10.1109\/CVPR46437.2021.01549"},{"issue":"2","key":"29_CR14","doi-asserted-by":"publisher","first-page":"566","DOI":"10.1109\/TCSVT.2019.2892608","volume":"30","author":"Z Chen","year":"2019","unstructured":"Chen, Z., He, T., Jin, X., Wu, F.: Learning for video compression. IEEE Trans. Circuits Syst. Video Technol. 30(2), 566\u2013576 (2019)","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"29_CR15","doi-asserted-by":"crossref","unstructured":"Chen, Z., Duan, L.Y., Wang, S., Lin, W., Kot, A.C.: Data representation in hybrid coding framework for feature maps compression. In: 2020 IEEE International Conference on Image Processing (ICIP), pp. 3094\u20133098. IEEE (2020)","DOI":"10.1109\/ICIP40778.2020.9190843"},{"key":"29_CR16","doi-asserted-by":"crossref","unstructured":"Chen, Z., Fan, K., Wang, S., Duan, L.Y., Lin, W., Kot, A.: Lossy intermediate deep learning feature compression and evaluation. In: ACM MM, pp. 2414\u20132422 (2019)","DOI":"10.1145\/3343031.3350849"},{"key":"29_CR17","first-page":"2230","volume":"29","author":"Z Chen","year":"2019","unstructured":"Chen, Z., Fan, K., Wang, S., Duan, L., Lin, W., Kot, A.C.: Toward intelligent sensing: intermediate deep feature compression. TIP 29, 2230\u20132243 (2019)","journal-title":"TIP"},{"key":"29_CR18","unstructured":"Chen, Z., Lin, W., Wang, S., Duan, L., Kot, A.C.: Intermediate deep feature compression: the next battlefield of intelligent sensing. arXiv preprint arXiv:1809.06196 (2018)"},{"key":"29_CR19","doi-asserted-by":"crossref","unstructured":"Cheng, B., et al.: Panoptic-deeplab: a simple, strong, and fast baseline for bottom-up panoptic segmentation. In: CVPR, pp. 12475\u201312485 (2020)","DOI":"10.1109\/CVPR42600.2020.01249"},{"key":"29_CR20","doi-asserted-by":"crossref","unstructured":"Cheng, Z., Sun, H., Takeuchi, M., Katto, J.: Learned image compression with discretized gaussian mixture likelihoods and attention modules. In: CVPR, pp. 7939\u20137948 (2020)","DOI":"10.1109\/CVPR42600.2020.00796"},{"key":"29_CR21","doi-asserted-by":"crossref","unstructured":"Choi, H., Bajic, I.V.: High efficiency compression for object detection. In: 2018 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), pp. 1792\u20131796. IEEE (2018)","DOI":"10.1109\/ICASSP.2018.8462653"},{"key":"29_CR22","unstructured":"Codevilla, F., Simard, J.G., Goroshin, R., Pal, C.: Learned image compression for machine perception. arXiv preprint arXiv:2111.02249 (2021)"},{"key":"29_CR23","unstructured":"Contributors, M.: MMSegmentation: Openmmlab semantic segmentation toolbox and benchmark. https:\/\/github.com\/open-mmlab\/mmsegmentation (2020)"},{"key":"29_CR24","doi-asserted-by":"crossref","unstructured":"Cordts, M., et al.: The cityscapes dataset for semantic urban scene understanding. In: CVPR, pp. 3213\u20133223 (2016)","DOI":"10.1109\/CVPR.2016.350"},{"key":"29_CR25","doi-asserted-by":"crossref","unstructured":"Deng, J., Dong, W., Socher, R., Li, L.J., Li, K., Fei-Fei, L.: Imagenet: a large-scale hierarchical image database. In: CVPR, pp. 248\u2013255. IEEE (2009)","DOI":"10.1109\/CVPR.2009.5206848"},{"key":"29_CR26","first-page":"8680","volume":"29","author":"L Duan","year":"2020","unstructured":"Duan, L., Liu, J., Yang, W., Huang, T., Gao, W.: Video coding for machines: a paradigm of collaborative compression and intelligent analytics. TIP 29, 8680\u20138695 (2020)","journal-title":"TIP"},{"issue":"2","key":"29_CR27","doi-asserted-by":"publisher","first-page":"303","DOI":"10.1007\/s11263-009-0275-4","volume":"88","author":"M Everingham","year":"2010","unstructured":"Everingham, M., Van Gool, L., Williams, C.K., Winn, J., Zisserman, A.: The pascal visual object classes (VOC) challenge. IJCV 88(2), 303\u2013338 (2010)","journal-title":"IJCV"},{"key":"29_CR28","unstructured":"Grill, J.B., et al.: Bootstrap your own latent: a new approach to self-supervised learning. arXiv preprint arXiv:2006.07733 (2020)"},{"issue":"4","key":"29_CR29","doi-asserted-by":"publisher","first-page":"2329","DOI":"10.1109\/TCSVT.2021.3089491","volume":"32","author":"Z Guo","year":"2021","unstructured":"Guo, Z., Zhang, Z., Feng, R., Chen, Z.: Causal contextual prediction for learned image compression. IEEE Trans. Circuits Syst. Video Technol. 32(4), 2329\u20132341 (2021)","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"29_CR30","unstructured":"Guo, Z., Zhang, Z., Feng, R., Chen, Z.: Soft then hard: rethinking the quantization in neural image compression. In: International Conference on Machine Learning, pp. 3920\u20133929. PMLR (2021)"},{"key":"29_CR31","doi-asserted-by":"crossref","unstructured":"He, K., Fan, H., Wu, Y., Xie, S., Girshick, R.: Momentum contrast for unsupervised visual representation learning. In: CVPR, pp. 9729\u20139738 (2020)","DOI":"10.1109\/CVPR42600.2020.00975"},{"key":"29_CR32","doi-asserted-by":"crossref","unstructured":"He, K., Gkioxari, G., Doll\u00e1r, P., Girshick, R.: Mask r-cnn. In: ICCV, pp. 2961\u20132969 (2017)","DOI":"10.1109\/ICCV.2017.322"},{"key":"29_CR33","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., Sun, J.: Deep residual learning for image recognition. In: CVPR, pp. 770\u2013778 (2016)","DOI":"10.1109\/CVPR.2016.90"},{"key":"29_CR34","doi-asserted-by":"crossref","unstructured":"He, T., Sun, S., Guo, Z., Chen, Z.: Beyond coding: detection-driven image compression with semantically structured bit-stream. In: 2019 Picture Coding Symposium (PCS), pp. 1\u20135. IEEE (2019)","DOI":"10.1109\/PCS48520.2019.8954525"},{"key":"29_CR35","doi-asserted-by":"crossref","unstructured":"Hu, Y., Yang, S., Yang, W., Duan, L.Y., Liu, J.: Towards coding for human and machine vision: a scalable image coding approach. In: 2020 IEEE International Conference on Multimedia and Expo (ICME), pp. 1\u20136. IEEE (2020)","DOI":"10.1109\/ICME46284.2020.9102750"},{"key":"29_CR36","doi-asserted-by":"crossref","unstructured":"Huang, Z., Jia, C., Wang, S., Ma, S.: Visual analysis motivated rate-distortion model for image coding. In: 2021 IEEE International Conference on Multimedia and Expo (ICME), pp. 1\u20136. IEEE (2021)","DOI":"10.1109\/ICME51207.2021.9428417"},{"key":"29_CR37","unstructured":"Jing, L., Tian, Y.: Self-supervised visual feature learning with deep neural networks: a survey. In: TPAMI (2020)"},{"key":"29_CR38","doi-asserted-by":"crossref","unstructured":"Johnston, N., et al.: Improved lossy image compression with priming and spatially adaptive bit rates for recurrent networks. In: CVPR, pp. 4385\u20134393 (2018)","DOI":"10.1109\/CVPR.2018.00461"},{"key":"29_CR39","doi-asserted-by":"crossref","unstructured":"Kim, J.H., Heo, B., Lee, J.S.: Joint global and local hierarchical priors for learned image compression. arXiv preprint arXiv:2112.04487 (2021)","DOI":"10.1109\/CVPR52688.2022.00590"},{"key":"29_CR40","doi-asserted-by":"crossref","unstructured":"Kirillov, A., He, K., Girshick, R., Rother, C., Doll\u00e1r, P.: Panoptic segmentation. In: CVPR, pp. 9404\u20139413 (2019)","DOI":"10.1109\/CVPR.2019.00963"},{"key":"29_CR41","doi-asserted-by":"crossref","unstructured":"Le, N., Zhang, H., Cricri, F., Ghaznavi-Youvalari, R., Rahtu, E.: Image coding for machines: an end-to-end learned approach. In: ICASSP 2021\u20132021 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), pp. 1590\u20131594. IEEE (2021)","DOI":"10.1109\/ICASSP39728.2021.9414465"},{"key":"29_CR42","unstructured":"Li, M., Zuo, W., Gu, S., You, J., Zhang, D.: Learning content-weighted deep image compression. In: TPAMI (2020)"},{"key":"29_CR43","doi-asserted-by":"crossref","unstructured":"Li, M., Zuo, W., Gu, S., Zhao, D., Zhang, D.: Learning convolutional networks for content-weighted image compression. In: CVPR, pp. 3214\u20133223 (2018)","DOI":"10.1109\/CVPR.2018.00339"},{"key":"29_CR44","doi-asserted-by":"crossref","unstructured":"Li, X., Shi, J., Chen, Z.: Task-driven semantic coding via reinforcement learning. arXiv preprint arXiv:2106.03511 (2021)","DOI":"10.1109\/TIP.2021.3091909"},{"key":"29_CR45","doi-asserted-by":"crossref","unstructured":"Lin, T.Y., Doll\u00e1r, P., Girshick, R., He, K., Hariharan, B., Belongie, S.: Feature pyramid networks for object detection. In: CVPR, pp. 2117\u20132125 (2017)","DOI":"10.1109\/CVPR.2017.106"},{"key":"29_CR46","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"740","DOI":"10.1007\/978-3-319-10602-1_48","volume-title":"Computer Vision","author":"T-Y Lin","year":"2014","unstructured":"Lin, T.-Y., et al.: Microsoft coco: common objects in context. In: Fleet, D., Pajdla, T., Schiele, B., Tuytelaars, T. (eds.) ECCV 2014. LNCS, vol. 8693, pp. 740\u2013755. Springer, Cham (2014). https:\/\/doi.org\/10.1007\/978-3-319-10602-1_48"},{"key":"29_CR47","doi-asserted-by":"crossref","unstructured":"Liu, S., Qi, L., Qin, H., Shi, J., Jia, J.: Path aggregation network for instance segmentation. In: CVPR, pp. 8759\u20138768 (2018)","DOI":"10.1109\/CVPR.2018.00913"},{"key":"29_CR48","doi-asserted-by":"crossref","unstructured":"Long, J., Shelhamer, E., Darrell, T.: Fully convolutional networks for semantic segmentation. In: CVPR, pp. 3431\u20133440 (2015)","DOI":"10.1109\/CVPR.2015.7298965"},{"key":"29_CR49","unstructured":"Loshchilov, I., Hutter, F.: Decoupled weight decay regularization. arXiv preprint arXiv:1711.05101 (2017)"},{"key":"29_CR50","doi-asserted-by":"crossref","unstructured":"Mentzer, F., Agustsson, E., Tschannen, M., Timofte, R., Van Gool, L.: Conditional probability models for deep image compression. In: CVPR, pp. 4394\u20134402 (2018)","DOI":"10.1109\/CVPR.2018.00462"},{"key":"29_CR51","first-page":"11913","volume":"33","author":"F Mentzer","year":"2020","unstructured":"Mentzer, F., Toderici, G.D., Tschannen, M., Agustsson, E.: High-fidelity generative image compression. NeurIPS 33, 11913\u201311924 (2020)","journal-title":"NeurIPS"},{"key":"29_CR52","unstructured":"Minnen, D., Ball\u00e9, J., Toderici, G.: Joint autoregressive and hierarchical priors for learned image compression. In: NeurIPS (2018)"},{"key":"29_CR53","doi-asserted-by":"crossref","unstructured":"Minnen, D., Singh, S.: Channel-wise autoregressive entropy models for learned image compression. In: 2020 IEEE International Conference on Image Processing (ICIP), pp. 3339\u20133343. IEEE (2020)","DOI":"10.1109\/ICIP40778.2020.9190935"},{"key":"29_CR54","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"483","DOI":"10.1007\/978-3-319-46484-8_29","volume-title":"Computer Vision","author":"A Newell","year":"2016","unstructured":"Newell, A., Yang, K., Deng, J.: Stacked hourglass networks for human pose estimation. In: Leibe, B., Matas, J., Sebe, N., Welling, M. (eds.) ECCV 2016. LNCS, vol. 9912, pp. 483\u2013499. Springer, Cham (2016). https:\/\/doi.org\/10.1007\/978-3-319-46484-8_29"},{"key":"29_CR55","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"69","DOI":"10.1007\/978-3-319-46466-4_5","volume-title":"Computer Vision","author":"M Noroozi","year":"2016","unstructured":"Noroozi, M., Favaro, P.: Unsupervised learning of visual representations by solving jigsaw puzzles. In: Leibe, B., Matas, J., Sebe, N., Welling, M. (eds.) ECCV 2016. LNCS, vol. 9910, pp. 69\u201384. Springer, Cham (2016). https:\/\/doi.org\/10.1007\/978-3-319-46466-4_5"},{"key":"29_CR56","unstructured":"Oord, A.v.d., Li, Y., Vinyals, O.: Representation learning with contrastive predictive coding. arXiv preprint arXiv:1807.03748 (2018)"},{"key":"29_CR57","doi-asserted-by":"crossref","unstructured":"Pathak, D., Krahenbuhl, P., Donahue, J., Darrell, T., Efros, A.A.: Context encoders: Feature learning by inpainting. In: CVPR, pp. 2536\u20132544 (2016)","DOI":"10.1109\/CVPR.2016.278"},{"issue":"1","key":"29_CR58","doi-asserted-by":"publisher","first-page":"3","DOI":"10.1016\/S0923-5965(01)00024-8","volume":"17","author":"M Rabbani","year":"2002","unstructured":"Rabbani, M., Joshi, R.: An overview of the jpeg 2000 still image compression standard. Signal Process. Image Commun. 17(1), 3\u201348 (2002)","journal-title":"Signal Process. Image Commun."},{"key":"29_CR59","doi-asserted-by":"crossref","unstructured":"Redmon, J., Divvala, S., Girshick, R., Farhadi, A.: You only look once: Unified, real-time object detection. In: CVPR, pp. 779\u2013788 (2016)","DOI":"10.1109\/CVPR.2016.91"},{"key":"29_CR60","doi-asserted-by":"crossref","unstructured":"Redmon, J., Farhadi, A.: Yolo9000: better, faster, stronger. In: CVPR, pp. 7263\u20137271 (2017)","DOI":"10.1109\/CVPR.2017.690"},{"key":"29_CR61","first-page":"91","volume":"28","author":"S Ren","year":"2015","unstructured":"Ren, S., He, K., Girshick, R., Sun, J.: Faster r-cnn: towards real-time object detection with region proposal networks. NeurIPS 28, 91\u201399 (2015)","journal-title":"NeurIPS"},{"key":"29_CR62","doi-asserted-by":"crossref","unstructured":"Singh, S., Abu-El-Haija, S., Johnston, N., Ball\u00e9, J., Shrivastava, A., Toderici, G.: End-to-end learning of compressible features. In: 2020 IEEE International Conference on Image Processing (ICIP), pp. 3349\u20133353. IEEE (2020)","DOI":"10.1109\/ICIP40778.2020.9190860"},{"key":"29_CR63","doi-asserted-by":"crossref","unstructured":"Song, M., Choi, J., Han, B.: Variable-rate deep image compression through spatially-adaptive feature transform. In: ICCV, pp. 2380\u20132389 (2021)","DOI":"10.1109\/ICCV48922.2021.00238"},{"issue":"12","key":"29_CR64","first-page":"1649","volume":"22","author":"GJ Sullivan","year":"2012","unstructured":"Sullivan, G.J., Ohm, J.R., Han, W.J., Wiegand, T.: Overview of the high efficiency video coding (HEVC) standard. TCSVT 22(12), 1649\u20131668 (2012)","journal-title":"TCSVT"},{"key":"29_CR65","unstructured":"Sun, S., He, T., Chen, Z.: Semantic structured image coding framework for multiple intelligent applications. In: TCSVT (2020)"},{"key":"29_CR66","unstructured":"Toderici, G., et al.: Variable rate image compression with recurrent neural networks. arXiv preprint arXiv:1511.06085 (2015)"},{"key":"29_CR67","doi-asserted-by":"crossref","unstructured":"Wallace, G.K.: The jpeg still picture compression standard. IEEE Trans. Consum. Electron. 38(1), xviii-xxxiv (1992)","DOI":"10.1109\/30.125072"},{"key":"29_CR68","doi-asserted-by":"crossref","unstructured":"Wiegand, T., Sullivan, G.J., Bjontegaard, G., Luthra, A.: Overview of the h. 264\/avc video coding standard. TCSVT 13(7), 560\u2013576 (2003)","DOI":"10.1109\/TCSVT.2003.815165"},{"issue":"6","key":"29_CR69","doi-asserted-by":"publisher","first-page":"3978","DOI":"10.1109\/TCSVT.2021.3119660","volume":"32","author":"Y Wu","year":"2021","unstructured":"Wu, Y., Li, X., Zhang, Z., Jin, X., Chen, Z.: Learned block-based hybrid image compression. IEEE Trans. Circuits Syst. Video Technol. 32(6), 3978\u20133990 (2021)","journal-title":"IEEE Trans. Circuits Syst. Video Technol."},{"key":"29_CR70","unstructured":"Wu, Y., Kirillov, A., Massa, F., Lo, W.Y., Girshick, R.: Detectron2. https:\/\/github.com\/facebookresearch\/detectron2 (2019)"},{"key":"29_CR71","doi-asserted-by":"crossref","unstructured":"Wu, Z., Xiong, Y., Yu, S.X., Lin, D.: Unsupervised feature learning via non-parametric instance discrimination. In: CVPR, pp. 3733\u20133742 (2018)","DOI":"10.1109\/CVPR.2018.00393"},{"key":"29_CR72","doi-asserted-by":"crossref","unstructured":"Xia, S., Liang, K., Yang, W., Duan, L.Y., Liu, J.: An emerging coding paradigm VCM: a scalable coding approach beyond feature and signal. In: 2020 IEEE International Conference on Multimedia and Expo (ICME), pp. 1\u20136. IEEE (2020)","DOI":"10.1109\/ICME46284.2020.9102843"},{"key":"29_CR73","first-page":"573","volume":"33","author":"Y Yang","year":"2020","unstructured":"Yang, Y., Bamler, R., Mandt, S.: Improving inference for neural image compression. Adv. Neural Inf. Process. Syst. 33, 573\u2013584 (2020)","journal-title":"Adv. Neural Inf. Process. Syst."},{"key":"29_CR74","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"649","DOI":"10.1007\/978-3-319-46487-9_40","volume-title":"Computer Vision","author":"R Zhang","year":"2016","unstructured":"Zhang, R., Isola, P., Efros, A.A.: Colorful image colorization. In: Leibe, B., Matas, J., Sebe, N., Welling, M. (eds.) ECCV 2016. LNCS, vol. 9907, pp. 649\u2013666. Springer, Cham (2016). https:\/\/doi.org\/10.1007\/978-3-319-46487-9_40"},{"key":"29_CR75","doi-asserted-by":"crossref","unstructured":"Zhao, H., Shi, J., Qi, X., Wang, X., Jia, J.: Pyramid scene parsing network. In: CVPR, pp. 2881\u20132890 (2017)","DOI":"10.1109\/CVPR.2017.660"}],"container-title":["Lecture Notes in Computer Science","Computer Vision \u2013 ECCV 2022"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-031-19836-6_29","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,10,24]],"date-time":"2022-10-24T23:12:10Z","timestamp":1666653130000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-3-031-19836-6_29"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2022]]},"ISBN":["9783031198359","9783031198366"],"references-count":75,"URL":"https:\/\/doi.org\/10.1007\/978-3-031-19836-6_29","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2022]]},"assertion":[{"value":"22 October 2022","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ECCV","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"European Conference on Computer Vision","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Tel Aviv","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Israel","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2022","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"23 October 2022","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"27 October 2022","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"17","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"eccv2022","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"https:\/\/eccv2022.ecva.net\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Double-blind","order":1,"name":"type","label":"Type","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information (provided by the conference organizers)"}},{"value":"CMT","order":2,"name":"conference_management_system","label":"Conference Management System","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information (provided by the conference organizers)"}},{"value":"5804","order":3,"name":"number_of_submissions_sent_for_review","label":"Number of Submissions Sent for Review","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information (provided by the conference organizers)"}},{"value":"1645","order":4,"name":"number_of_full_papers_accepted","label":"Number of Full Papers Accepted","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information (provided by the conference organizers)"}},{"value":"0","order":5,"name":"number_of_short_papers_accepted","label":"Number of Short Papers Accepted","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information (provided by the conference organizers)"}},{"value":"28% - The value is computed by the equation \"Number of Full Papers Accepted \/ Number of Submissions Sent for Review * 100\" and then rounded to a whole number.","order":6,"name":"acceptance_rate_of_full_papers","label":"Acceptance Rate of Full Papers","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information (provided by the conference organizers)"}},{"value":"3.21","order":7,"name":"average_number_of_reviews_per_paper","label":"Average Number of Reviews per Paper","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information (provided by the conference organizers)"}},{"value":"3.91","order":8,"name":"average_number_of_papers_per_reviewer","label":"Average Number of Papers per Reviewer","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information (provided by the conference organizers)"}},{"value":"Yes","order":9,"name":"external_reviewers_involved","label":"External Reviewers Involved","group":{"name":"ConfEventPeerReviewInformation","label":"Peer Review Information (provided by the conference organizers)"}}]}}