{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2024,7,2]],"date-time":"2024-07-02T04:35:41Z","timestamp":1719894941534},"reference-count":44,"publisher":"Springer Science and Business Media LLC","issue":"1","license":[{"start":{"date-parts":[[2020,3,16]],"date-time":"2020-03-16T00:00:00Z","timestamp":1584316800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0"},{"start":{"date-parts":[[2020,3,16]],"date-time":"2020-03-16T00:00:00Z","timestamp":1584316800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["J Image Video Proc."],"published-print":{"date-parts":[[2020,12]]},"abstract":"<jats:title>Abstract<\/jats:title><jats:p>In this paper, two methods of zoom motion estimation for color and depth videos by using depth information are proposed. Color and depth videos are independently estimated for zoom motion. Zoom for color video is scaled by spatial domain, and depth video is scaled by both spatial and depth domains. For color video, instead of existing methods of zoom motion estimation that apply all of possible zoom ratios for a current block, the zoom ratio of the proposed method is determined as the ratio of the average depth values of the current and reference blocks. Then, the reference block is resized by multiplying the zoom ratio and the reference block is mapped to the current block. For depth video, the reference block is first scaled in the spatial direction by the same methodology used for color video and then scaled by a distance ratio from a camera to the objects. Compared to the conventional motion estimation method, the proposed method reduces MSE by up to about 30% for the color video and up to about 85% for the depth video.<\/jats:p>","DOI":"10.1186\/s13640-020-00499-2","type":"journal-article","created":{"date-parts":[[2020,3,16]],"date-time":"2020-03-16T13:07:07Z","timestamp":1584364027000},"update-policy":"http:\/\/dx.doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":3,"title":["Zoom motion estimation for color and depth videos using depth information"],"prefix":"10.1186","volume":"2020","author":[{"given":"Soon-kak","family":"Kwon","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Dong-seok","family":"Lee","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2020,3,16]]},"reference":[{"key":"499_CR1","unstructured":"H.264: Advanced Video Coding for Generic Audiovisual Services. ITU-T Rec. H.264. https:\/\/www.itu.int\/rec\/T-REC-H.264\/en. Accessed 1 June 2019."},{"key":"499_CR2","doi-asserted-by":"publisher","DOI":"10.1002\/0470869615","volume-title":"H.264 and MPEG-4 Video Compression: Video Coding for Next-Generation Multimedia","author":"I. E. G. Richardson","year":"2003","unstructured":"I. E. G. Richardson, H.264 and MPEG-4 Video Compression: Video Coding for Next-Generation Multimedia (Wiley, NJ, 2003)."},{"issue":"7","key":"499_CR3","doi-asserted-by":"publisher","first-page":"560","DOI":"10.1109\/TCSVT.2003.815165","volume":"13","author":"T. Wiegand","year":"2003","unstructured":"T. Wiegand, G. J. Sullivan, G. Bjontegaard, A. Luthra, Overview of the h.264\/AVC video coding standard. IEEE Trans. Circ. Syst. Video Technol.13(7), 560\u2013576 (2003).","journal-title":"IEEE Trans. Circ. Syst. Video Technol."},{"issue":"2","key":"499_CR4","doi-asserted-by":"publisher","first-page":"186","DOI":"10.1016\/j.jvcir.2005.05.010","volume":"17","author":"S. K. Kwon","year":"2006","unstructured":"S. K. Kwon, A. Tamhankar, K. R. Rao, Overview of h.264\/MPEG-4 part 10. J. Vis. Commun. Image Represent.17(2), 186\u2013216 (2006).","journal-title":"J. Vis. Commun. Image Represent."},{"issue":"12","key":"499_CR5","doi-asserted-by":"publisher","first-page":"1649","DOI":"10.1109\/TCSVT.2012.2221191","volume":"22","author":"G. J. Sullivan","year":"2012","unstructured":"G. J. Sullivan, J. R. Ohm, W. J. Han, T. Wiegand, Overview of the high efficiency video coding (HEVC) standard. IEEE Trans. Circ. Syst. Video Technol.22(12), 1649\u20131668 (2012).","journal-title":"IEEE Trans. Circ. Syst. Video Technol."},{"issue":"13","key":"499_CR6","first-page":"26","volume":"132","author":"D. Patel","year":"2015","unstructured":"D. Patel, T. Lad, D. Shah, Review on intra-prediction in high efficiency video coding (HEVC) standard. Int. J. Comput. Appl.132(13), 26\u201329 (2015).","journal-title":"Int. J. Comput. Appl."},{"issue":"4","key":"499_CR7","doi-asserted-by":"publisher","first-page":"523","DOI":"10.1109\/PROC.1985.13183","volume":"73","author":"H. G. Musmann","year":"1985","unstructured":"H. G. Musmann, P. Pirsch, H. Grallert, Advances in picture coding. Proc. IEEE. 73(4), 523\u2013548 (1985).","journal-title":"Proc. IEEE"},{"issue":"12","key":"499_CR8","doi-asserted-by":"publisher","first-page":"1799","DOI":"10.1109\/TCOM.1981.1094950","volume":"29","author":"J. Jain","year":"1981","unstructured":"J. Jain, A. Jain, Displacement measurement and its application in interframe image coding. IEEE Trans. Commun.29(12), 1799\u20131808 (1981).","journal-title":"IEEE Trans. Commun."},{"issue":"1","key":"499_CR9","doi-asserted-by":"publisher","first-page":"75","DOI":"10.1109\/76.554419","volume":"7","author":"H. Jozawa","year":"1997","unstructured":"H. Jozawa, K. Kamikura, A. Sagata, H. Kotera, H. Watanabe, Two-stage motion compensation using adaptive global mc and local affine mc. IEEE Trans. Circ. Syst. Video Technol.7(1), 75\u201385 (1997).","journal-title":"IEEE Trans. Circ. Syst. Video Technol."},{"issue":"2","key":"499_CR10","doi-asserted-by":"publisher","first-page":"197","DOI":"10.1109\/TCSVT.2004.841690","volume":"15","author":"T. Wiegand","year":"2005","unstructured":"T. Wiegand, E. Steinbach, B. Girod, Affine multipicture motion-compensated prediction. IEEE Trans. Circ. Syst. Video Technol.15(2), 197\u2013209 (2005).","journal-title":"IEEE Trans. Circ. Syst. Video Technol."},{"issue":"10","key":"499_CR11","doi-asserted-by":"publisher","first-page":"1388","DOI":"10.1109\/TCSVT.2007.903777","volume":"17","author":"R. C. Kordasiewicz","year":"2007","unstructured":"R. C. Kordasiewicz, M. D. Gallant, S. Shirani, Affine motion prediction based on translational motion vectors. IEEE Trans. Circ. Syst. Video Technol.17(10), 1388\u20131394 (2007).","journal-title":"IEEE Trans. Circ. Syst. Video Technol."},{"issue":"3","key":"499_CR12","doi-asserted-by":"publisher","first-page":"339","DOI":"10.1109\/76.305878","volume":"4","author":"Y. Nakaya","year":"1994","unstructured":"Y. Nakaya, H. Harashima, Motion compensation based on spatial transformations. IEEE Trans. Circ. Syst. Video Technol.4(3), 339\u2013356 (1994).","journal-title":"IEEE Trans. Circ. Syst. Video Technol."},{"key":"499_CR13","doi-asserted-by":"publisher","unstructured":"M. Karczewicz, J. Nieweglowski, J. Lainema, O. Kalevo, in Proceedings of First International Workshop on Wireless Image\/Video Communications. Video coding using motion compensation with polynomial motion vector fields, (1996), pp. 26\u201331. https:\/\/doi.org\/10.1109\/wivc.1996.624638.","DOI":"10.1109\/wivc.1996.624638"},{"key":"499_CR14","doi-asserted-by":"publisher","unstructured":"M. R. Pickering, M. R. Frater, J. F. Arnold, in 2006 International Conference on Image Processing. Enhanced motion compensation using elastic image registration, (2006), pp. 1061\u20131064. https:\/\/doi.org\/10.1109\/icip.2006.312738.","DOI":"10.1109\/icip.2006.312738"},{"issue":"8","key":"499_CR15","doi-asserted-by":"publisher","first-page":"1934","DOI":"10.1109\/TCSVT.2017.2699919","volume":"28","author":"L. Li","year":"2018","unstructured":"L. Li, H. Li, D. Liu, Z. Li, H. Yang, S. Lin, H. Chen, F. Wu, An efficient four-parameter affine motion model for video coding. IEEE Trans. Circ. Syst. Video Technol.28(8), 1934\u20131948 (2018). https:\/\/doi.org\/10.1109\/TCSVT.2017.2699919.","journal-title":"IEEE Trans. Circ. Syst. Video Technol."},{"issue":"11","key":"499_CR16","doi-asserted-by":"publisher","first-page":"2437","DOI":"10.1109\/TCSVT.2016.2589818","volume":"27","author":"N. Zhang","year":"2017","unstructured":"N. Zhang, X. Fan, D. Zhao, W. Gao, Merge mode for deformable block motion information derivation. IEEE Trans. Circ. Syst. Video Technol.27(11), 2437\u20132449 (2017). https:\/\/doi.org\/10.1109\/TCSVT.2016.2589818.","journal-title":"IEEE Trans. Circ. Syst. Video Technol."},{"issue":"11","key":"499_CR17","doi-asserted-by":"publisher","first-page":"1625","DOI":"10.1109\/TCSVT.2010.2087474","volume":"20","author":"L. Po","year":"2010","unstructured":"L. Po, K. Wong, K. Cheung, K. Ng, Subsampled block-matching for zoom motion compensated prediction. IEEE Trans. Circ. Syst. Video Technol.20(11), 1625\u20131637 (2010).","journal-title":"IEEE Trans. Circ. Syst. Video Technol."},{"issue":"9","key":"499_CR18","doi-asserted-by":"publisher","first-page":"1280","DOI":"10.1109\/TCSVT.2012.2198137","volume":"22","author":"H. S. Kim","year":"2012","unstructured":"H. S. Kim, J. H. Lee, C. K. Kim, B. G. Kim, Zoom motion estimation using block-based fast local area scaling. IEEE Trans. Circ. Syst. Video Technol.22(9), 1280\u20131291 (2012).","journal-title":"IEEE Trans. Circ. Syst. Video Technol."},{"key":"499_CR19","doi-asserted-by":"publisher","unstructured":"L. Superiori, M. Rupp, in 2009 10th Workshop on Image Analysis for Multimedia Interactive Services. Detection of pan and zoom in soccer sequences based on H.264\/AVC motion information, (2009), pp. 41\u201344. https:\/\/doi.org\/10.1109\/wiamis.2009.5031427.","DOI":"10.1109\/wiamis.2009.5031427"},{"key":"499_CR20","doi-asserted-by":"publisher","unstructured":"R. Takada, S. Orihashi, Y. Matsuo, J. Katto, in 2015 IEEE International Conference on Consumer Electronics (ICCE). Improvement of 8k UHDTV picture quality for H.265\/HVEC by global zoom estimation, (2015), pp. 58\u201359. https:\/\/doi.org\/10.1109\/icce.2015.7066317.","DOI":"10.1109\/icce.2015.7066317"},{"key":"499_CR21","doi-asserted-by":"publisher","first-page":"197","DOI":"10.1016\/j.patrec.2015.09.012","volume":"68","author":"D. Shukla","year":"2015","unstructured":"D. Shukla, R. K. Jha, A. Ojha, Unsteady camera zoom stabilization using slope estimation over interest warping vectors. Pattern Recogn. Lett.68:, 197\u2013204 (2015).","journal-title":"Pattern Recogn. Lett."},{"key":"499_CR22","doi-asserted-by":"publisher","unstructured":"X. Shen, J. Wang, Q. Yang, P. Chen, F. Liang, in 2017 IEEE Visual Communications and Image Processing (VCIP). Feature based inter prediction optimization for non-translational video coding in cloud, (2017), pp. 1\u20134. https:\/\/doi.org\/10.1109\/vcip.2017.8305066.","DOI":"10.1109\/vcip.2017.8305066"},{"key":"499_CR23","doi-asserted-by":"publisher","unstructured":"G. Luo, Y. Zhu, Z. Weng, Z. Li, A disocclusion inpainting framework for depth-based view synthesis. Trans. Pattern Anal. Mach. Intell. (Early Access), IEEE, 1\u201314 (2019). https:\/\/doi.org\/10.1109\/tpami.2019.2899837.","DOI":"10.1109\/tpami.2019.2899837"},{"key":"499_CR24","doi-asserted-by":"publisher","unstructured":"X. Qi, Z. Liu, Q. Chen, J. Jia, in 2019 IEEE Conference on Computer Vision and Pattern Recognition. 3D motion decomposition for RGBD future dynamic scene synthesis, (2019), pp. 7673\u20137682. https:\/\/doi.org\/10.1109\/cvpr.2019.00786.","DOI":"10.1109\/cvpr.2019.00786"},{"issue":"2","key":"499_CR25","doi-asserted-by":"publisher","first-page":"439","DOI":"10.1007\/s12652-017-0660-8","volume":"10","author":"M. Wu","year":"2019","unstructured":"M. Wu, X. Li, C. Liu, M. Liu, N. Zhao, J. Wang, X. Wan, Z. Rao, L. Zhu, Robust global motion estimation for video security based on improved k-means clustering. J. Ambient Intell. Humanized Comput.10(2), 439\u2013448 (2019).","journal-title":"J. Ambient Intell. Humanized Comput."},{"key":"499_CR26","doi-asserted-by":"publisher","unstructured":"G. Fanelli, M. Dantone, L. Van Gool, in 2013 10th IEEE International Conference and Workshops on Automatic Face and Gesture Recognition (FG). Real time 3d face alignment with random forests-based active appearance models, (2013), pp. 1\u20138. https:\/\/doi.org\/10.1109\/fg.2013.6553713.","DOI":"10.1109\/fg.2013.6553713"},{"key":"499_CR27","unstructured":"M. Dantone, J. Gall, G. Fanelli, L. Van Gool, in 2012 IEEE Conference on Computer Vision and Pattern Recognition. Real-time facial feature detection using conditional regression forests, (2012), pp. 2578\u20132585."},{"issue":"11","key":"499_CR28","doi-asserted-by":"publisher","first-page":"1534","DOI":"10.1109\/TSMC.2014.2331215","volume":"44","author":"R. Min","year":"2014","unstructured":"R. Min, N. Kose, J. Dugelay, Kinectfacedb: A kinect database for face recognition. IEEE Trans. Syst. Man Cybernet. Syst.44(11), 1534\u20131548 (2014).","journal-title":"IEEE Trans. Syst. Man Cybernet. Syst."},{"key":"499_CR29","doi-asserted-by":"publisher","unstructured":"J. Sturm, N. Engelhard, F. Endres, W. Burgard, D. Cremers, in 2012 IEEE\/RSJ International Conference on Intelligent Robots and Systems. A benchmark for the evaluation of rgb-d slam systems, (2012), pp. 573\u2013580. https:\/\/doi.org\/10.1109\/iros.2012.6385773.","DOI":"10.1109\/iros.2012.6385773"},{"key":"499_CR30","doi-asserted-by":"publisher","unstructured":"F. Pomerleau, S. Magnenat, F. Colas, M. Liu, R. Siegwart, in 2011 IEEE\/RSJ International Conference on Intelligent Robots and Systems. Tracking a depth camera: Parameter exploration for fast ICP, (2011), pp. 3824\u20133829. https:\/\/doi.org\/10.1109\/iros.2011.6094861.","DOI":"10.1109\/iros.2011.6094861"},{"key":"499_CR31","doi-asserted-by":"publisher","unstructured":"M. Siddiqui, G. Medioni, in 2010 IEEE Computer Society Conference on Computer Vision and Pattern Recognition - Workshops. Human pose estimation from a single view point, real-time range sensor, (2010), pp. 1\u20138. https:\/\/doi.org\/10.1109\/cvprw.2010.5543618.","DOI":"10.1109\/cvprw.2010.5543618"},{"issue":"3","key":"499_CR32","doi-asserted-by":"publisher","first-page":"319","DOI":"10.1016\/j.patrec.2007.10.011","volume":"29","author":"R. Mu\u00f1oz Salinas","year":"2008","unstructured":"R. Mu\u00f1oz Salinas, R. Medina Carnicer, F. J. Madrid Cuevas, A. Carmona Poyato, Depth silhouettes for gesture recognition. Pattern Recogn. Lett.29(3), 319\u2013329 (2008).","journal-title":"Pattern Recogn. Lett."},{"key":"499_CR33","doi-asserted-by":"publisher","unstructured":"P. Suryanarayan, A. Subramanian, D. Mandalapu, in 2010 20th International Conference on Pattern Recognition. Dynamic hand pose recognition using depth data, (2010), pp. 3105\u20133108. https:\/\/doi.org\/10.1109\/icpr.2010.760.","DOI":"10.1109\/icpr.2010.760"},{"key":"499_CR34","first-page":"1","volume-title":"1st International Workshop on Kinect in Pervasive Computing","author":"J. Preis","year":"2012","unstructured":"J. Preis, M. Kessel, M. Werner, C. Linnhoff-Popien, in 1st International Workshop on Kinect in Pervasive Computing. Gait recognition with kinect (New CastleUK, 2012), pp. 1\u20134."},{"key":"499_CR35","doi-asserted-by":"publisher","unstructured":"S. Song, J. Xiao, in 2013 IEEE International Conference on Computer Vision. Tracking revisited using RGBD camera: Unified benchmark and baselines, (2013), pp. 233\u2013240. https:\/\/doi.org\/10.1109\/iccv.2013.36.","DOI":"10.1109\/iccv.2013.36"},{"key":"499_CR36","unstructured":"J. Sung, C. Ponce, B. Selman, A. Saxena, in Workshops at the Twenty-fifth AAAI Conference on Artificial Intelligence. Human activity detection from RGBD images, (2011), pp. 47\u201355."},{"key":"499_CR37","doi-asserted-by":"publisher","unstructured":"L. Spinello, K. O. Arras, in 2011 IEEE\/RSJ International Conference on Intelligent Robots and Systems. People detection in RGB-D data, (2011), pp. 3838\u20133843. https:\/\/doi.org\/10.1109\/iros.2011.6095074.","DOI":"10.1109\/iros.2011.6095074"},{"key":"499_CR38","doi-asserted-by":"publisher","unstructured":"M. Luber, L. Spinello, K. O. Arras, in 2011 IEEE\/RSJ International Conference on Intelligent Robots and Systems. People tracking in RGB-D data with on-line boosted target models, (2011), pp. 3844\u20133849. https:\/\/doi.org\/10.1109\/iros.2011.6095075.","DOI":"10.1109\/iros.2011.6095075"},{"key":"499_CR39","doi-asserted-by":"publisher","unstructured":"K. Lai, L. Bo, X. Ren, D. Fox, in 2011 IEEE International Conference on Robotics and Automation. A large-scale hierarchical multi-view RGB-D object dataset, (2011), pp. 1817\u20131824. https:\/\/doi.org\/10.1109\/icra.2011.5980382.","DOI":"10.1109\/icra.2011.5980382"},{"key":"499_CR40","doi-asserted-by":"publisher","unstructured":"S. Gasparrini, E. Cippitelli, E. Gambi, S. Spinsante, J. W\u00e5hsl\u00e9n, I. Orhan, T. Lindh, in International Conference on ICT Innovations. Proposal and experimental evaluation of fall detection solution based on wearable and depth data fusion (Springer, 2015), pp. 99\u2013108. https:\/\/doi.org\/10.1007\/978-3-319-25733-4_11.","DOI":"10.1007\/978-3-319-25733-4_11"},{"key":"499_CR41","doi-asserted-by":"publisher","unstructured":"P. Ammirato, P. Poirson, E. Park, J. Ko\u0161eck\u00e1, A. C. Berg, in 2017 IEEE International Conference on Robotics and Automation (ICRA). A dataset for developing and benchmarking active vision, (2017), pp. 1378\u20131385. https:\/\/doi.org\/10.1109\/icra.2017.7989164.","DOI":"10.1109\/icra.2017.7989164"},{"issue":"1-2","key":"499_CR42","doi-asserted-by":"publisher","first-page":"61","DOI":"10.1007\/s00138-016-0802-6","volume":"28","author":"M. Kraft","year":"2016","unstructured":"M. Kraft, M. Nowicki, A. Schmidt, M. Fularz, P. Skrzypczy\u0144ski, Toward evaluation of visual navigation algorithms on RGB-D data from the first- and second-generation kinect. Mach. Vis. Appl.28(1-2), 61\u201374 (2016).","journal-title":"Mach. Vis. Appl."},{"issue":"12","key":"499_CR43","doi-asserted-by":"publisher","first-page":"715","DOI":"10.3390\/sym10120715","volume":"10","author":"D. S. Lee","year":"2018","unstructured":"D. S. Lee, S. K. Kwon, Intra prediction of depth picture with plane modeling. Symmetry. 10(12), 715 (2018).","journal-title":"Symmetry"},{"key":"499_CR44","doi-asserted-by":"publisher","unstructured":"N. Silberman, D. Hoiem, P. Kohli, R. Fergus, in European Conference on Computer Vision. Indoor segmentation and support inference from RGBD images (Springer, 2012), pp. 746\u2013760. https:\/\/doi.org\/10.1007\/978-3-642-33715-4_54.","DOI":"10.1007\/978-3-642-33715-4_54"}],"container-title":["EURASIP Journal on Image and Video Processing"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1186\/s13640-020-00499-2.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/article\/10.1186\/s13640-020-00499-2\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1186\/s13640-020-00499-2.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2021,3,16]],"date-time":"2021-03-16T00:11:42Z","timestamp":1615853502000},"score":1,"resource":{"primary":{"URL":"https:\/\/jivp-eurasipjournals.springeropen.com\/articles\/10.1186\/s13640-020-00499-2"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2020,3,16]]},"references-count":44,"journal-issue":{"issue":"1","published-print":{"date-parts":[[2020,12]]}},"alternative-id":["499"],"URL":"https:\/\/doi.org\/10.1186\/s13640-020-00499-2","relation":{},"ISSN":["1687-5281"],"issn-type":[{"value":"1687-5281","type":"electronic"}],"subject":[],"published":{"date-parts":[[2020,3,16]]},"assertion":[{"value":"5 June 2019","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"3 March 2020","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"16 March 2020","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"The authors declare that they have no competing interests.","order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Competing interests"}}],"article-number":"11"}}