{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,6,18]],"date-time":"2025-06-18T04:20:50Z","timestamp":1750220450622,"version":"3.41.0"},"publisher-location":"New York, NY, USA","reference-count":28,"publisher":"ACM","license":[{"start":{"date-parts":[[2020,12,9]],"date-time":"2020-12-09T00:00:00Z","timestamp":1607472000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.acm.org\/publications\/policies\/copyright_policy#Background"}],"funder":[{"DOI":"10.13039\/501100012389","name":"National Institute of Information and Communications Technology","doi-asserted-by":"publisher","award":["21403"],"award-info":[{"award-number":["21403"]}],"id":[{"id":"10.13039\/501100012389","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2020,12,9]]},"DOI":"10.1145\/3448823.3448827","type":"proceedings-article","created":{"date-parts":[[2021,3,4]],"date-time":"2021-03-04T11:33:39Z","timestamp":1614857619000},"page":"1-6","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":2,"title":["Semi-supervised Learning Combining 2DCNNs and Video Compression for Action Recognition"],"prefix":"10.1145","author":[{"given":"Hayato","family":"Terao","sequence":"first","affiliation":[{"name":"Hokkaido University, Hokkaido, Japan"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Wataru","family":"Noguchi","sequence":"additional","affiliation":[{"name":"Hokkaido University, Hokkaido, Japan"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Hiroyuki","family":"Iizuka","sequence":"additional","affiliation":[{"name":"Hokkaido University, Hokkaido, Japan"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Masahito","family":"Yamamoto","sequence":"additional","affiliation":[{"name":"Hokkaido University, Hokkaido, Japan"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"320","published-online":{"date-parts":[[2021,3,4]]},"reference":[{"key":"e_1_3_2_1_1_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00675"},{"key":"e_1_3_2_1_2_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2017.502"},{"key":"e_1_3_2_1_3_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00685"},{"key":"e_1_3_2_1_4_1","volume-title":"Compressed Video Action Recognition. In 2018 IEEE\/CVF Conference on Computer Vision and Pattern Recognition, June 18--23","author":"Wu Chao-Yuan","year":"2018","unstructured":"Chao-Yuan Wu , Manzil Zaheer , Hexiang Hu , R. Manmatha , Alexander J. Smola , and Philipp Kr\u00e4henb\u00fchl . 2018 . Compressed Video Action Recognition. In 2018 IEEE\/CVF Conference on Computer Vision and Pattern Recognition, June 18--23 , 2018, Salt Lake City, UT. IEEE, 6026--6035. Chao-Yuan Wu, Manzil Zaheer, Hexiang Hu, R. Manmatha, Alexander J. Smola, and Philipp Kr\u00e4henb\u00fchl. 2018. Compressed Video Action Recognition. In 2018 IEEE\/CVF Conference on Computer Vision and Pattern Recognition, June 18--23, 2018, Salt Lake City, UT. IEEE, 6026--6035."},{"key":"e_1_3_2_1_5_1","volume-title":"Deep Residual Learning for Image Recognition. In 2016 IEEE Conference on Computer Vision and Pattern Recognition, June 27--30","author":"He Kaiming","year":"2016","unstructured":"Kaiming He , Xiangyu Zhang , Shaoqing Ren , and Jian Sun . 2016 . Deep Residual Learning for Image Recognition. In 2016 IEEE Conference on Computer Vision and Pattern Recognition, June 27--30 , 2016, Las Vegas, NV. IEEE, 770--778. Kaiming He, Xiangyu Zhang, Shaoqing Ren, and Jian Sun. 2016. Deep Residual Learning for Image Recognition. In 2016 IEEE Conference on Computer Vision and Pattern Recognition, June 27--30, 2016, Las Vegas, NV. IEEE, 770--778."},{"key":"e_1_3_2_1_6_1","volume-title":"DMC-net: Generating Discriminative Motion Cues for Fast Compressed Video Action Recognition. In 2019 IEEE\/CVF Conference on Computer Vision and Pattern Recognition, June 15--20","author":"Shou Zheng","year":"2019","unstructured":"Zheng Shou , Xudong Lin , Yannis Kalantidis , Laura Sevilla-Lara , Marcus Rohrbach , Shih-Fu Chang , and Zhicheng Yan . 2019 . DMC-net: Generating Discriminative Motion Cues for Fast Compressed Video Action Recognition. In 2019 IEEE\/CVF Conference on Computer Vision and Pattern Recognition, June 15--20 , 2019, Long Beach, CA. IEEE, 1268--1277. Zheng Shou, Xudong Lin, Yannis Kalantidis, Laura Sevilla-Lara, Marcus Rohrbach, Shih-Fu Chang, and Zhicheng Yan. 2019. DMC-net: Generating Discriminative Motion Cues for Fast Compressed Video Action Recognition. In 2019 IEEE\/CVF Conference on Computer Vision and Pattern Recognition, June 15--20, 2019, Long Beach, CA. IEEE, 1268--1277."},{"key":"e_1_3_2_1_7_1","unstructured":"Kihyuk Sohn David Berthelot Chun-Liang Li Zizhao Zhang Nicholas Carlini Ekin D. Cubuk Alex Kurakin Han Zhang and Colin Raffel. 2020. FixMatch: Simplifying Semi-Supervised Learning with Consistency and Confidence. arXiv:2001.07685.  Kihyuk Sohn David Berthelot Chun-Liang Li Zizhao Zhang Nicholas Carlini Ekin D. Cubuk Alex Kurakin Han Zhang and Colin Raffel. 2020. FixMatch: Simplifying Semi-Supervised Learning with Consistency and Confidence. arXiv:2001.07685."},{"key":"e_1_3_2_1_8_1","volume-title":"Large-scale Video Classification with Convolutional Neural Networks. In 2014 IEEE Conference on Computer Vision and Pattern Recognition, June 23--28","author":"Karpathy Andrej","year":"2014","unstructured":"Andrej Karpathy , George Toderici , Sanketh Shetty , Thomas Leung , Rahul Sukthankar , and Li Fei-Fei . 2014 . Large-scale Video Classification with Convolutional Neural Networks. In 2014 IEEE Conference on Computer Vision and Pattern Recognition, June 23--28 , 2014, Columbus, OH. IEEE, 1725--1732. Andrej Karpathy, George Toderici, Sanketh Shetty, Thomas Leung, Rahul Sukthankar, and Li Fei-Fei. 2014. Large-scale Video Classification with Convolutional Neural Networks. In 2014 IEEE Conference on Computer Vision and Pattern Recognition, June 23--28, 2014, Columbus, OH. IEEE, 1725--1732."},{"key":"e_1_3_2_1_9_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2015.510"},{"key":"e_1_3_2_1_10_1","volume-title":"Advances in Neural Information Processing Systems 30 (NIPS","author":"Tarvainen Antti","year":"2017","unstructured":"Antti Tarvainen , and Harri Valpola . 2017. Mean Teachers are Better Role Models: Weight-averaged Consistency Targets Improve Semi-supervised Deep Learning Results . In Advances in Neural Information Processing Systems 30 (NIPS 2017 ), December 4--9, 2017, Long Beach, CA, USA. Curran Associates, Inc ., 1195--1204. Antti Tarvainen, and Harri Valpola. 2017. Mean Teachers are Better Role Models: Weight-averaged Consistency Targets Improve Semi-supervised Deep Learning Results. In Advances in Neural Information Processing Systems 30 (NIPS 2017), December 4--9, 2017, Long Beach, CA, USA. Curran Associates, Inc., 1195--1204."},{"key":"e_1_3_2_1_11_1","volume-title":"Mimic the Raw Domain: Accelerating Action Recognition in the Compressed Domain. In 2020 IEEE\/CVF Conference on Computer Vision and Pattern Recognition Workshops (CVPRW), June 14--19","author":"Battash Barak","year":"2020","unstructured":"Barak Battash , Haim Barad , Hanlin Tang , and Amit Bleiweiss . 2020 . Mimic the Raw Domain: Accelerating Action Recognition in the Compressed Domain. In 2020 IEEE\/CVF Conference on Computer Vision and Pattern Recognition Workshops (CVPRW), June 14--19 , 2020, Seattle, WA. IEEE, 2926--2934. Barak Battash, Haim Barad, Hanlin Tang, and Amit Bleiweiss. 2020. Mimic the Raw Domain: Accelerating Action Recognition in the Compressed Domain. In 2020 IEEE\/CVF Conference on Computer Vision and Pattern Recognition Workshops (CVPRW), June 14--19, 2020, Seattle, WA. IEEE, 2926--2934."},{"key":"e_1_3_2_1_12_1","volume-title":"Raffel","author":"Berthelot David","year":"2019","unstructured":"David Berthelot , Nicholas Carlini , Ian Goodfellow , Nicolas Papernot , Avital Oliver , and Colin A . Raffel . 2019 . MixMatch: A Holistic Approach to Semi-supervised Learning. In Advances in Neural Information Processing Systems 32 (NeurIPS 2019), December 8--14, 2019, Vancouver, Canada. Curran Associates, Inc ., 5049--5059. David Berthelot, Nicholas Carlini, Ian Goodfellow, Nicolas Papernot, Avital Oliver, and Colin A. Raffel. 2019. MixMatch: A Holistic Approach to Semi-supervised Learning. In Advances in Neural Information Processing Systems 32 (NeurIPS 2019), December 8--14, 2019, Vancouver, Canada. Curran Associates, Inc., 5049--5059."},{"key":"e_1_3_2_1_13_1","first-page":"4","article-title":"MPEG: A Video Compression Standard for Multimedia Applications","volume":"34","author":"Gall Didier Le","year":"1991","unstructured":"Didier Le Gall . 1991 . MPEG: A Video Compression Standard for Multimedia Applications . Communications of the ACM 34 , 4 (Apr 1991), 46--58. DOI: https:\/\/doi.org\/10.1145\/103085.103090 10.1145\/103085.103090 Didier Le Gall. 1991. MPEG: A Video Compression Standard for Multimedia Applications. Communications of the ACM 34, 4 (Apr 1991), 46--58. DOI: https:\/\/doi.org\/10.1145\/103085.103090","journal-title":"Communications of the ACM"},{"key":"e_1_3_2_1_14_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2019.8682450"},{"key":"e_1_3_2_1_15_1","volume-title":"Pseudo-Label: The Simple and Efficient Semi-supervised Learning Method for Deep Neural Networks. In Workshop on Challenges in Representation Learning, ICML 3, 2 (Jun","author":"Lee Fong-Hyun","year":"2013","unstructured":"Fong-Hyun Lee . 2013 . Pseudo-Label: The Simple and Efficient Semi-supervised Learning Method for Deep Neural Networks. In Workshop on Challenges in Representation Learning, ICML 3, 2 (Jun , 2013). Fong-Hyun Lee. 2013. Pseudo-Label: The Simple and Efficient Semi-supervised Learning Method for Deep Neural Networks. In Workshop on Challenges in Representation Learning, ICML 3, 2 (Jun, 2013)."},{"key":"e_1_3_2_1_16_1","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW50498.2020.00359"},{"key":"e_1_3_2_1_17_1","volume-title":"Remixmatch: Semi-supervised Learning with Distribution Alignment and Augmentation Anchoring. In International Conference on Learning Representations","author":"Berthelot David","year":"2020","unstructured":"David Berthelot , Nicholas Carlini , Ekin D. Cubuk , Alex Kurakin , Kihyuk Sohn , Han Zhang , and Colin Raffel . 2020 . Remixmatch: Semi-supervised Learning with Distribution Alignment and Augmentation Anchoring. In International Conference on Learning Representations , April 30- May 1, 2020, Addis Ababa, Ethiopia. David Berthelot, Nicholas Carlini, Ekin D. Cubuk, Alex Kurakin, Kihyuk Sohn, Han Zhang, and Colin Raffel. 2020. Remixmatch: Semi-supervised Learning with Distribution Alignment and Augmentation Anchoring. In International Conference on Learning Representations, April 30- May 1, 2020, Addis Ababa, Ethiopia."},{"key":"e_1_3_2_1_18_1","volume-title":"Ekin Dogus Cubuk, and Ian Goodfellow","author":"Oliver Avital","year":"2018","unstructured":"Avital Oliver , Augustus Odena , Colin A. Raffel , Ekin Dogus Cubuk, and Ian Goodfellow . 2018 . Realistic Evaluation of Deep Semi-supervised Learning Algorithms. In Advances in Neural Information Processing Systems 31 (NeurIPS 2018), December 3--8, 2018, Montreal, Canada. Curran Associates, Inc ., 3235--3245. Avital Oliver, Augustus Odena, Colin A. Raffel, Ekin Dogus Cubuk, and Ian Goodfellow. 2018. Realistic Evaluation of Deep Semi-supervised Learning Algorithms. In Advances in Neural Information Processing Systems 31 (NeurIPS 2018), December 3--8, 2018, Montreal, Canada. Curran Associates, Inc., 3235--3245."},{"key":"e_1_3_2_1_19_1","volume-title":"Advances in Neural Information Processing Systems 29 (NIPS","author":"Sajjadi Mehdi","year":"2016","unstructured":"Mehdi Sajjadi , Mehran Javanmardi , and Tolga Tasdizen . 2016. Regularization with Stochastic Transformations and Perturbations for Deep Semi-supervised Learning . In Advances in Neural Information Processing Systems 29 (NIPS 2016 ), December 5--10, 2016, Barcelona, Spain. Curran Associates, Inc ., 1163--1171. Mehdi Sajjadi, Mehran Javanmardi, and Tolga Tasdizen. 2016. Regularization with Stochastic Transformations and Perturbations for Deep Semi-supervised Learning. In Advances in Neural Information Processing Systems 29 (NIPS 2016), December 5--10, 2016, Barcelona, Spain. Curran Associates, Inc., 1163--1171."},{"key":"e_1_3_2_1_20_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2019.00156"},{"key":"e_1_3_2_1_21_1","volume-title":"Advances in Neural Information Processing Systems 17 (NIPS","author":"Grandvalet Yves","year":"2004","unstructured":"Yves Grandvalet , and Yoshua Bengio . 2005. Semi-supervised Learning by Entropy Minimization . In Advances in Neural Information Processing Systems 17 (NIPS 2004 ), December 13--18, 2004, Vancouver, Canada . 529--536. Yves Grandvalet, and Yoshua Bengio. 2005. Semi-supervised Learning by Entropy Minimization. In Advances in Neural Information Processing Systems 17 (NIPS 2004), December 13--18, 2004, Vancouver, Canada. 529--536."},{"key":"e_1_3_2_1_22_1","unstructured":"Samuli Laine and Timo Aila. 2016. Temporal Ensembling for Semi-supervised Learning. arXiv:1610.02242.  Samuli Laine and Timo Aila. 2016. Temporal Ensembling for Semi-supervised Learning. arXiv:1610.02242."},{"key":"e_1_3_2_1_23_1","volume-title":"Temporal Segment Networks: Towards Good Practices for Deep Action Recognition. In European Conference on Computer Vision","author":"Wang Limin","year":"2016","unstructured":"Limin Wang , Yuanjun Xiong , Zhe Wang , Yu Qiao , Dahua Lin , Xiaoou Tang , and Luc Van Gool . 2016 . Temporal Segment Networks: Towards Good Practices for Deep Action Recognition. In European Conference on Computer Vision , October, 2016, Amsterdam, Netherlands. Springer, Cham, 20--36. Limin Wang, Yuanjun Xiong, Zhe Wang, Yu Qiao, Dahua Lin, Xiaoou Tang, and Luc Van Gool. 2016. Temporal Segment Networks: Towards Good Practices for Deep Action Recognition. In European Conference on Computer Vision, October, 2016, Amsterdam, Netherlands. Springer, Cham, 20--36."},{"key":"e_1_3_2_1_24_1","volume-title":"Advances in Neural Information Processing Systems 27 (NIPS","author":"Simonyan Karen","year":"2014","unstructured":"Karen Simonyan , and Andrew Zisserman . 2014. Two-stream Convolutional Networks for Action Recognition in Videos . In Advances in Neural Information Processing Systems 27 (NIPS 2014 ), December 8--13, 2014, Montreal, Canada. Curran Associates, Inc ., 568--576. Karen Simonyan, and Andrew Zisserman. 2014. Two-stream Convolutional Networks for Action Recognition in Videos. In Advances in Neural Information Processing Systems 27 (NIPS 2014), December 8--13, 2014, Montreal, Canada. Curran Associates, Inc., 568--576."},{"key":"e_1_3_2_1_25_1","volume-title":"Amir Roshan Zamir, and Mubarak Shah","author":"Soomro Khurram","year":"2012","unstructured":"Khurram Soomro , Amir Roshan Zamir, and Mubarak Shah . 2012 . UCF101: A Dataset of 101 Human Actions Classes from Videos in the Wild . arXiv:1212.0402. Khurram Soomro, Amir Roshan Zamir, and Mubarak Shah. 2012. UCF101: A Dataset of 101 Human Actions Classes from Videos in the Wild. arXiv:1212.0402."},{"key":"e_1_3_2_1_26_1","volume-title":"Le","author":"Xie Qizhe","year":"2019","unstructured":"Qizhe Xie , Zihang Dai , Eduard Hovy , Minh-Thang Luong , and Quoc V . Le . 2019 . Unsupervised Data Augmentation for Consistency Training . arXiv:1904.12848. Qizhe Xie, Zihang Dai, Eduard Hovy, Minh-Thang Luong, and Quoc V. Le. 2019. Unsupervised Data Augmentation for Consistency Training. arXiv:1904.12848."},{"key":"e_1_3_2_1_27_1","doi-asserted-by":"crossref","unstructured":"Longlong Jing Toufiq Parag Zhe Wu Yingli Tian and Hongcheng Wang. 2020. VideoSSL: Semi-supervised Learning for Video Classification. arXiv:2003.00197.  Longlong Jing Toufiq Parag Zhe Wu Yingli Tian and Hongcheng Wang. 2020. VideoSSL: Semi-supervised Learning for Video Classification. arXiv:2003.00197.","DOI":"10.1109\/WACV48630.2021.00115"},{"key":"e_1_3_2_1_28_1","first-page":"8","article-title":"Virtual Adversarial Training: A Regularization Method for Supervised and Semi-supervised Learning","volume":"41","author":"Miyato Takeru","year":"2018","unstructured":"Takeru Miyato , Shin-Ichi Maeda , Masanori Koyama , and Shin Ishii . 2018 . Virtual Adversarial Training: A Regularization Method for Supervised and Semi-supervised Learning . IEEE Transactions on Pattern Analysis and Machine Intelligence 41 , 8 (Aug. 2019), 1979--1993. DOI: https:\/\/doi.org\/10.1109\/TPAMI.2018.2858821 10.1109\/TPAMI.2018.2858821 Takeru Miyato, Shin-Ichi Maeda, Masanori Koyama, and Shin Ishii. 2018. Virtual Adversarial Training: A Regularization Method for Supervised and Semi-supervised Learning. IEEE Transactions on Pattern Analysis and Machine Intelligence 41, 8 (Aug. 2019), 1979--1993. DOI: https:\/\/doi.org\/10.1109\/TPAMI.2018.2858821","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"}],"event":{"name":"ICVISP 2020: 2020 4th International Conference on Vision, Image and Signal Processing","acronym":"ICVISP 2020","location":"Bangkok Thailand"},"container-title":["Proceedings of the 2020 4th International Conference on Vision, Image and Signal Processing"],"original-title":[],"link":[{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3448823.3448827","content-type":"unspecified","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/dl.acm.org\/doi\/pdf\/10.1145\/3448823.3448827","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,6,17]],"date-time":"2025-06-17T20:47:53Z","timestamp":1750193273000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3448823.3448827"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2020,12,9]]},"references-count":28,"alternative-id":["10.1145\/3448823.3448827","10.1145\/3448823"],"URL":"https:\/\/doi.org\/10.1145\/3448823.3448827","relation":{},"subject":[],"published":{"date-parts":[[2020,12,9]]},"assertion":[{"value":"2021-03-04","order":2,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}