{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,7]],"date-time":"2026-05-07T12:45:42Z","timestamp":1778157942336,"version":"3.51.4"},"reference-count":50,"publisher":"Springer Science and Business Media LLC","issue":"11","license":[{"start":{"date-parts":[[2021,8,16]],"date-time":"2021-08-16T00:00:00Z","timestamp":1629072000000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"},{"start":{"date-parts":[[2021,8,16]],"date-time":"2021-08-16T00:00:00Z","timestamp":1629072000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"}],"funder":[{"DOI":"10.13039\/100000001","name":"National Science Foundation","doi-asserted-by":"publisher","award":["1747751"],"award-info":[{"award-number":["1747751"]}],"id":[{"id":"10.13039\/100000001","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Int J Comput Vis"],"published-print":{"date-parts":[[2021,11]]},"DOI":"10.1007\/s11263-021-01503-6","type":"journal-article","created":{"date-parts":[[2021,8,16]],"date-time":"2021-08-16T07:04:02Z","timestamp":1629097442000},"page":"2947-2964","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":19,"title":["Deep Learning Geometry Compression Artifacts Removal for Video-Based Point Cloud Compression"],"prefix":"10.1007","volume":"129","author":[{"given":"Wei","family":"Jia","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Li","family":"Li","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-8246-177X","authenticated-orcid":false,"given":"Zhu","family":"Li","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Shan","family":"Liu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2021,8,16]]},"reference":[{"key":"1503_CR1","unstructured":"Andrivon, P., Ricard, J., Guede, C., Nakagami, O., Graziosi, D., & Tabatabai, A. (2020). Patch border filtering specification in V-PCC. Document ISO\/IEC JTC1\/SC29\/WG11 m51501, Geneva, CH."},{"key":"1503_CR2","unstructured":"Biswas, S., Liu, J., Wong, K., Wang, S., Urtasun, R. (2020). Muscle: Multi sweep compression of lidar using deep entropy models. In: Larochelle, H., Ranzato, M., Hadsell, R. Balcan, M.F. Lin, H. (eds.) Advances in Neural Information Processing Systems, vol.\u00a033, pp. 22170\u201322181. Curran Associates, Inc. https:\/\/proceedings.neurips.cc\/paper\/2020\/file\/fc152e73692bc3c934d248f639d9e963-Paper.pdf."},{"key":"1503_CR3","unstructured":"Bross, B., Chen, J., Liu, S. (2019). Versatile Video Coding (Draft 4). Document ITU-T SG 16 WP 3 and ISO\/IEC JTC 1\/SC 29\/WG 11 JVET-M1001-v6, Marrakech, MA."},{"key":"1503_CR4","doi-asserted-by":"crossref","unstructured":"Bruder, G., Steinicke, F., N\u00fcchter, A. (2014). Poster: Immersive point cloud virtual environments. In: 2014 IEEE symposium on 3D user interfaces (3DUI), pp. 161\u2013162. IEEE.","DOI":"10.1109\/3DUI.2014.6798870"},{"key":"1503_CR5","unstructured":"Budagavi, M., Faramarzi, E., Ho, T., Najaf-Zadeh, H., Sinharoy, I. (2017). Samsungs response to cfp for point cloud compression (category 2). Document ISO\/IEC JTC1\/SC29\/WG11 m41808, Macau, China."},{"key":"1503_CR6","unstructured":"Cai, K., & Ricard, J., C.G., Llach, J., Chevet, J.C. (2018). Geometry image coding improvements. Document ISO\/IEC JTC1\/SC29\/WG11 m42111, Gwangju, Korea."},{"key":"1503_CR7","doi-asserted-by":"crossref","unstructured":"Chen, X., Ma, H., Wan, J., Li, B., Xia, T. (2017). Multi-view 3d object detection network for autonomous driving. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 1907\u20131915.","DOI":"10.1109\/CVPR.2017.691"},{"issue":"2","key":"1503_CR8","doi-asserted-by":"publisher","first-page":"337","DOI":"10.1109\/TMM.2013.2286580","volume":"16","author":"J Chen","year":"2014","unstructured":"Chen, J., Lin, C., Hsu, P., & Chen, C. (2014). Point cloud encoding for 3d building model retrieval. IEEE Transactions on Multimedia, 16(2), 337\u2013345.","journal-title":"IEEE Transactions on Multimedia"},{"key":"1503_CR9","doi-asserted-by":"crossref","unstructured":"Choy, C., Gwak, J., Savarese, S. (2019). 4d spatio-temporal convnets: Minkowski convolutional neural networks. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 3075\u20133084.","DOI":"10.1109\/CVPR.2019.00319"},{"key":"1503_CR10","unstructured":"Committee, M. (2020). V-PCC codec description. Document ISO\/IEC JTC1\/SC29\/WG11 w19526, Italy."},{"key":"1503_CR11","unstructured":"Culture 3D cloud. http:\/\/c3dc.fr\/."},{"key":"1503_CR12","unstructured":"Dawar, N., Najaf-Zadeh, H., Joshi, R., Budagavi, M. (2018). PCC TMC2 Interleaving in geometry and texture layers. Document ISO\/IEC JTC1\/SC29\/WG11 m43723, Ljubljana, Slovenia."},{"issue":"8","key":"1503_CR13","doi-asserted-by":"publisher","first-page":"3886","DOI":"10.1109\/TIP.2017.2707807","volume":"26","author":"RL de Queiroz","year":"2017","unstructured":"de Queiroz, R. L., & Chou, P. A. (2017). Motion-compensated compression of dynamic voxelized point clouds. IEEE Transactions on Image Processing, 26(8), 3886\u20133895.","journal-title":"IEEE Transactions on Image Processing"},{"key":"1503_CR14","unstructured":"d\u2019Eon, E., Harrison, B., Myers, T., Chou, P. (2017). Input to ad hoc groups on mpeg point cloud compression and jpeg pleno. Document ISO\/IEC JTC1\/SC29\/WG11 m40059, Geneva, Switzerland."},{"issue":"7","key":"1503_CR15","doi-asserted-by":"publisher","first-page":"46","DOI":"10.1109\/MC.2014.185","volume":"47","author":"H Fuchs","year":"2014","unstructured":"Fuchs, H., State, A., & Bazin, J. C. (2014). Immersive 3d telepresence. Computer, 47(7), 46\u201352.","journal-title":"Computer"},{"key":"1503_CR16","doi-asserted-by":"crossref","unstructured":"Gojcic, Z., Zhou, C., Wegner, J.D., Guibas, L.J., Birdal, T. (2020). Learning multiview 3d point cloud registration. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 1759\u20131769.","DOI":"10.1109\/CVPR42600.2020.00183"},{"key":"1503_CR17","unstructured":"Graziosi, D., Tabatabai, A. (2019). [V-PCC] New contribution on geometry padding. Document ISO\/IEC JTC1\/SC29\/WG11 m47496, Geneva, CH."},{"issue":"4","key":"1503_CR18","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3072959.3083722","volume":"36","author":"K Guo","year":"2017","unstructured":"Guo, K., Xu, F., Yu, T., Liu, X., Dai, Q., & Liu, Y. (2017). Real-time geometry, albedo, and motion reconstruction using a single rgb-d camera. ACM Transactions on Graphics (ToG), 36(4), 1.","journal-title":"ACM Transactions on Graphics (ToG)"},{"key":"1503_CR19","doi-asserted-by":"crossref","unstructured":"He, L., Zhu, W., Xu, Y. (2017). Best-effort projection based attribute compression for 3d point cloud. In: 2017 23rd Asia-Pacific conference on communications (APCC), pp. 1\u20136. IEEE.","DOI":"10.23919\/APCC.2017.8304078"},{"key":"1503_CR20","doi-asserted-by":"crossref","unstructured":"Huang, T., Liu, Y. (2019). 3d point cloud geometry compression on deep learning. In: Proceedings of the 27th ACM international conference on multimedia, pp. 890\u2013898.","DOI":"10.1145\/3343031.3351061"},{"key":"1503_CR21","doi-asserted-by":"crossref","unstructured":"Huang, L., Wang, S., Wong, K., Liu, J., Urtasun, R. (2020). Octsqueeze: Octree-structured entropy model for lidar compression. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp. 1313\u20131323.","DOI":"10.1109\/CVPR42600.2020.00139"},{"issue":"3","key":"1503_CR22","doi-asserted-by":"publisher","first-page":"118","DOI":"10.1109\/MSP.2019.2900721","volume":"36","author":"ES Jang","year":"2019","unstructured":"Jang, E. S., Preda, M., Mammou, K., Tourapis, A. M., Kim, J., Graziosi, D. B., et al. (2019). Video-based point-cloud-compression standard in mpeg: from evidence collection to committee draft [standards in a nutshell]. IEEE Signal Processing Magazine, 36(3), 118\u2013123.","journal-title":"IEEE Signal Processing Magazine"},{"key":"1503_CR23","doi-asserted-by":"crossref","unstructured":"Kammerl, J., Blodow, N., Rusu, R.B., Gedikli, S., Beetz, M., Steinbach, E. (2012). Real-time compression of point cloud streams. In: 2012 IEEE international conference on robotics and automation, pp. 778\u2013785. IEEE.","DOI":"10.1109\/ICRA.2012.6224647"},{"key":"1503_CR24","unstructured":"Kingma, D.P., Ba, J. (2014). Adam: A method for stochastic optimization. Preprint arXiv:1412.6980"},{"key":"1503_CR25","unstructured":"Lasserre, S., Llach, J., Guede, C., Ricard, J. (2017). Technicolor\u2019s response to the cfpp for point cloud compression. Document ISO\/IEC JTC1\/SC29\/WG11 m41822, Macau, China."},{"key":"1503_CR26","unstructured":"Li, Y., Liu, S., Kawamura, K. (2019). Methodology and reporting template for neural network coding tool testing. Document ITU-T SG 16 WP 3 and ISO\/IEC JTC 1\/SC 29\/WG 11 JVET-M1006-v1, Marrakech, MA."},{"key":"1503_CR27","doi-asserted-by":"publisher","first-page":"289","DOI":"10.1109\/TIP.2019.2931621","volume":"29","author":"L Li","year":"2019","unstructured":"Li, L., Li, Z., Zakharchenko, V., Chen, J., & Li, H. (2019). Advanced 3d motion prediction for video-based dynamic point cloud compression. IEEE Transactions on Image Processing, 29, 289\u2013302.","journal-title":"IEEE Transactions on Image Processing"},{"key":"1503_CR28","unstructured":"Mammou, K., Tourapis, A.M., Singer, D., Su, Y. (2017). Video-based and hierarchical approaches point cloud compression. Document ISO\/IEC JTC1\/SC29\/WG11 m41649, Macau, China."},{"issue":"4","key":"1503_CR29","doi-asserted-by":"publisher","first-page":"828","DOI":"10.1109\/TCSVT.2016.2543039","volume":"27","author":"R Mekuria","year":"2016","unstructured":"Mekuria, R., Blom, K., & Cesar, P. (2016). Design, implementation, and evaluation of a point cloud codec for tele-immersive video. IEEE Transactions on Circuits and Systems for Video Technology, 27(4), 828\u2013842.","journal-title":"IEEE Transactions on Circuits and Systems for Video Technology"},{"key":"1503_CR30","unstructured":"Mobile Mapping System. http:\/\/www.mitsubishielectric.com\/bu\/mms\/index.html."},{"key":"1503_CR31","unstructured":"Nakagami, O. (2018). PCC TMC2 low complexity geometry smoothing. Document ISO\/IEC JTC1\/SC29\/WG11 m43501, Ljubjana, SI."},{"key":"1503_CR32","unstructured":"Olivier, Y., Llach, J. (2018). Per patch projection optimization for TMC2. Document ISO\/IEC JTC1\/SC29\/WG11 m43723, San Diego, CA, US."},{"key":"1503_CR33","unstructured":"Point Cloud Compression Category 2 Reference Software TMC2-8.0. http:\/\/mpegx.int-evry.fr\/software\/MPEG\/PCC\/TM\/mpeg-pcc-tmc2."},{"key":"1503_CR34","unstructured":"Preda, M. (2017). Report on pcc cfp answers. Document ISO\/IEC JTC1\/SC29\/WG11 w17251, Macau, China."},{"key":"1503_CR35","unstructured":"Qi, C.R., Su, H., Mo, K., Guibas, L.J.(2017) Pointnet: Deep learning on point sets for 3d classification and segmentation. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp. 652\u2013660."},{"key":"1503_CR36","doi-asserted-by":"crossref","unstructured":"Quach, M., Valenzise, G., Dufaux, F.(2019). Learning convolutional transforms for lossy point cloud geometry compression. In: 2019 IEEE international conference on image processing (ICIP), pp. 4320\u20134324. IEEE.","DOI":"10.1109\/ICIP.2019.8803413"},{"key":"1503_CR37","unstructured":"Rhyu, S., Oh, Y., Woo, J.(2018). PCC CE2.13 report on texture and depth padding improvement. Document ISO\/IEC JTC1\/SC29\/WG11 m43667, Ljubjana, SI."},{"key":"1503_CR38","unstructured":"Schwarz, S., Martin-Cocher, G., Flynn, D., Budagavi, M. (2018). Common test conditions for point cloud compression. Document ISO\/IEC JTC1\/SC29\/WG11 w17766, Ljubljana, Slovenia."},{"issue":"1","key":"1503_CR39","doi-asserted-by":"publisher","first-page":"133","DOI":"10.1109\/JETCAS.2018.2885981","volume":"9","author":"S Schwarz","year":"2018","unstructured":"Schwarz, S., Preda, M., Baroncini, V., Budagavi, M., Cesar, P., Chou, P. A., et al. (2018). Emerging mpeg standards for point cloud compression. IEEE Journal on Emerging and Selected Topics in Circuits and Systems, 9(1), 133\u2013148.","journal-title":"IEEE Journal on Emerging and Selected Topics in Circuits and Systems"},{"key":"1503_CR40","doi-asserted-by":"crossref","unstructured":"Sportillo, D., Paljic, A., Boukhris, M., Fuchs, P., Ojeda, L., Roussarie, V.(2017). An immersive virtual reality system for semi-autonomous driving simulation: A comparison between realistic and 6-dof controller-based interaction. In: Proceedings of the 9th international conference on computer and automation engineering, pp. 6\u201310.","DOI":"10.1145\/3057039.3057079"},{"issue":"12","key":"1503_CR41","doi-asserted-by":"publisher","first-page":"1649","DOI":"10.1109\/TCSVT.2012.2221191","volume":"22","author":"GJ Sullivan","year":"2012","unstructured":"Sullivan, G. J., Ohm, J. R., Han, W. J., & Wiegand, T. (2012). Overview of the high efficiency video coding (HEVC) standard. IEEE Transactions on circuits and systems for video technology, 22(12), 1649\u20131668.","journal-title":"IEEE Transactions on circuits and systems for video technology"},{"key":"1503_CR42","doi-asserted-by":"publisher","first-page":"110","DOI":"10.1016\/j.robot.2016.11.012","volume":"89","author":"Y Sun","year":"2017","unstructured":"Sun, Y., Liu, M., & Meng, M. Q. H. (2017). Improving rgb-d slam in dynamic environments: A motion removal approach. Robotics and Autonomous Systems, 89, 110\u2013122.","journal-title":"Robotics and Autonomous Systems"},{"key":"1503_CR43","doi-asserted-by":"crossref","unstructured":"Sun, X., Ma, H., Sun, Y., & Liu, M. (2019). A novel point cloud compression algorithm based on clustering. IEEE Robotics and Automation Letters, 4(2), 2132\u20132139.","DOI":"10.1109\/LRA.2019.2900747"},{"issue":"4","key":"1503_CR44","doi-asserted-by":"publisher","first-page":"1765","DOI":"10.1109\/TIP.2016.2529506","volume":"25","author":"D Thanou","year":"2016","unstructured":"Thanou, D., Chou, P. A., & Frossard, P. (2016). Graph-based compression of dynamic 3d point cloud sequences. IEEE Transactions on Image Processing, 25(4), 1765\u20131778.","journal-title":"IEEE Transactions on Image Processing"},{"key":"1503_CR45","doi-asserted-by":"crossref","unstructured":"Tian, D., Ochimizu, H., Feng, C., Cohen, R., Vetro, A. (2017). Geometric distortion metrics for point cloud compression. In: 2017 IEEE International Conference on Image Processing (ICIP), pp. 3460\u20133464. IEEE.","DOI":"10.1109\/ICIP.2017.8296925"},{"key":"1503_CR46","doi-asserted-by":"crossref","unstructured":"Tu, C., Takeuchi, E., Carballo, A., Takeda, K. (2019). Point cloud compression for 3d lidar sensor using recurrent neural network with residual blocks. In: 2019 International Conference on Robotics and Automation (ICRA), pp. 3274\u20133280. IEEE.","DOI":"10.1109\/ICRA.2019.8794264"},{"key":"1503_CR47","unstructured":"Tu, C., Takeuchi, E., Miyajima, C., Takeda, K. (2016). Compressing continuous point cloud data using image compression methods. In: 2016 IEEE 19th international conference on intelligent transportation systems (ITSC), pp. 1712\u20131719. IEEE."},{"key":"1503_CR48","unstructured":"Tulvan, C., Mekuria, R., Li, Z., Laserre, S. (2016). Use cases for point cloud compression (pcc)."},{"key":"1503_CR49","doi-asserted-by":"crossref","unstructured":"Voulodimos, A., Doulamis, N., Doulamis, A., & Protopapadakis, E. (2018). Deep learning for computer vision: A brief review. Computational Intelligence and Neuroscience,2018.","DOI":"10.1155\/2018\/7068349"},{"issue":"7","key":"1503_CR50","doi-asserted-by":"publisher","first-page":"560","DOI":"10.1109\/TCSVT.2003.815165","volume":"13","author":"T Wiegand","year":"2003","unstructured":"Wiegand, T., Sullivan, G. J., Bjontegaard, G., & Luthra, A. (2003). Overview of the H. 264\/AVC video coding standard. IEEE Transactions on Circuits and Systems for Video Technology, 13(7), 560\u2013576.","journal-title":"IEEE Transactions on Circuits and Systems for Video Technology"}],"container-title":["International Journal of Computer Vision"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11263-021-01503-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11263-021-01503-6\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11263-021-01503-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2021,10,17]],"date-time":"2021-10-17T09:48:09Z","timestamp":1634464089000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11263-021-01503-6"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2021,8,16]]},"references-count":50,"journal-issue":{"issue":"11","published-print":{"date-parts":[[2021,11]]}},"alternative-id":["1503"],"URL":"https:\/\/doi.org\/10.1007\/s11263-021-01503-6","relation":{},"ISSN":["0920-5691","1573-1405"],"issn-type":[{"value":"0920-5691","type":"print"},{"value":"1573-1405","type":"electronic"}],"subject":[],"published":{"date-parts":[[2021,8,16]]},"assertion":[{"value":"17 December 2020","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"8 July 2021","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"16 August 2021","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}]}}