{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,4,29]],"date-time":"2026-04-29T16:34:32Z","timestamp":1777480472069,"version":"3.51.4"},"reference-count":43,"publisher":"Springer Science and Business Media LLC","issue":"4","license":[{"start":{"date-parts":[[2021,7,20]],"date-time":"2021-07-20T00:00:00Z","timestamp":1626739200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"},{"start":{"date-parts":[[2021,7,20]],"date-time":"2021-07-20T00:00:00Z","timestamp":1626739200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Appl Intell"],"published-print":{"date-parts":[[2022,3]]},"DOI":"10.1007\/s10489-021-02527-8","type":"journal-article","created":{"date-parts":[[2021,7,20]],"date-time":"2021-07-20T04:02:38Z","timestamp":1626753758000},"page":"4258-4273","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":4,"title":["Primitive-contrastive network: data-efficient self-supervised learning from robot demonstration videos"],"prefix":"10.1007","volume":"52","author":[{"given":"Pengfei","family":"Sun","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Zhile","family":"Yang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Tianren","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Shangqi","family":"Guo","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-4813-2494","authenticated-orcid":false,"given":"Feng","family":"Chen","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2021,7,20]]},"reference":[{"key":"2527_CR1","doi-asserted-by":"crossref","unstructured":"Cheng G, Ramirez-Amaro K, Beetz M, Kuniyoshi Y (2019) Purposive learning: Robot reasoning about the meanings of human activities. Sci Robot 4(26)","DOI":"10.1126\/scirobotics.aav1530"},{"key":"2527_CR2","doi-asserted-by":"crossref","unstructured":"Morimoto J (2017) Soft humanoid motor learning. Sci Robot 2(13)","DOI":"10.1126\/scirobotics.aaq0989"},{"issue":"2","key":"2527_CR3","doi-asserted-by":"publisher","first-page":"3533","DOI":"10.1109\/LRA.2020.2977835","volume":"5","author":"A Bonardi","year":"2020","unstructured":"Bonardi A, James S, Davison A J (2020) Learning one-shot imitation from humans without humans. IEEE Robot Autom Lett 5(2):3533\u20133539","journal-title":"IEEE Robot Autom Lett"},{"key":"2527_CR4","doi-asserted-by":"crossref","unstructured":"Jing L, Tian Y (2020) Self-supervised visual feature learning with deep neural networks: A survey. IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)","DOI":"10.1109\/TPAMI.2020.2992393"},{"key":"2527_CR5","doi-asserted-by":"crossref","unstructured":"Sermanet P, Lynch C, Hsu J, Levine S (2017) Time-contrastive networks: Self-supervised learning from multi-view observation. In: Comput Vis Pattern Recogn Worksh:486\u2013487","DOI":"10.1109\/CVPRW.2017.69"},{"key":"2527_CR6","doi-asserted-by":"crossref","unstructured":"Lee M A, Zhu Y, Srinivasan K, Shah P, Savarese S, Fei-Fei L, Garg A, Bohg J (2019) Making sense of vision and touch: Self-supervised learning of multimodal representations for contact-rich tasks. In: International Conference on Robotics and Automation (ICRA). IEEE, pp 8943\u20138950","DOI":"10.1109\/ICRA.2019.8793485"},{"issue":"3","key":"2527_CR7","doi-asserted-by":"publisher","first-page":"325","DOI":"10.1109\/THMS.2015.2493536","volume":"46","author":"JF-S Lin","year":"2016","unstructured":"Lin J F-S, Karg M, Kuli\u0107 D (2016) Movement primitive segmentation for human motion modeling: A framework for analysis. IEEE Trans Human-Mach Syst 46(3):325\u2013339","journal-title":"IEEE Trans Human-Mach Syst"},{"key":"2527_CR8","doi-asserted-by":"publisher","first-page":"92","DOI":"10.1016\/j.neucom.2019.01.087","volume":"345","author":"F Li","year":"2019","unstructured":"Li F, Jiang Q, Zhang S, Wei M, Song R (2019) Robot skill acquisition in assembly process using deep reinforcement learning. Neurocomputing 345:92\u2013102","journal-title":"Neurocomputing"},{"key":"2527_CR9","doi-asserted-by":"crossref","unstructured":"Lu G, Zhang X, Ouyang W, Chen L, Gao Z, Xu D (2020) An end-to-end learning framework for video compression. IEEE transactions on pattern analysis and machine intelligence (TPAMI)","DOI":"10.1109\/TPAMI.2020.2988453"},{"issue":"3","key":"2527_CR10","doi-asserted-by":"publisher","first-page":"1544","DOI":"10.1109\/LRA.2018.2801475","volume":"3","author":"D Park","year":"2018","unstructured":"Park D, Hoshi Y, Kemp C C (2018) A multimodal anomaly detector for robot-assisted feeding using an lstm-based variational autoencoder. IEEE Robot Autom Lett 3(3):1544\u20131551","journal-title":"IEEE Robot Autom Lett"},{"key":"2527_CR11","unstructured":"Laskin M, Srinivas A, Abbeel P (2020) Curl: Contrastive unsupervised representations for reinforcement learning. In: International Conference on Machine Learning. PMLR, pp 5639\u20135650"},{"issue":"9","key":"2527_CR12","doi-asserted-by":"publisher","first-page":"4671","DOI":"10.1109\/TIP.2019.2908065","volume":"28","author":"S Zhou","year":"2019","unstructured":"Zhou S, Wang J, Meng D, Liang Y, Gong Y, Zheng N (2019) Discriminative feature learning with foreground attention for person re-identification. IEEE Trans Image Process 28(9):4671\u20134684","journal-title":"IEEE Trans Image Process"},{"key":"2527_CR13","doi-asserted-by":"crossref","unstructured":"Chen J, Yang X, Jia Q, Liao C (2020) Denao: Monocular depth estimation network with auxiliary optical flow. IEEE transactions on pattern analysis and machine intelligence (TPAMI)","DOI":"10.1109\/TPAMI.2020.2977021"},{"key":"2527_CR14","doi-asserted-by":"crossref","unstructured":"Ibarz J, Tan J, Finn C, Kalakrishnan M, Pastor P, Levine S (2021) How to train your robot with deep reinforcement learning: lessons we have learned. Int J Robot Res:0278364920987859","DOI":"10.1177\/0278364920987859"},{"key":"2527_CR15","unstructured":"Higgins I, Matthey L, Pal A, Burgess C, Glorot X, Botvinick M, Mohamed S, Lerchner A (2016) beta-vae: Learning basic visual concepts with a constrained variational framework"},{"issue":"2","key":"2527_CR16","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3054912","volume":"50","author":"A Hussein","year":"2017","unstructured":"Hussein A, Gaber M M, Elyan E, Jayne C (2017) Imitation learning: A survey of learning methods. ACM Comput Surv (CSUR) 50(2):1\u201335","journal-title":"ACM Comput Surv (CSUR)"},{"issue":"9","key":"2527_CR17","doi-asserted-by":"publisher","first-page":"592","DOI":"10.1080\/01691864.2020.1729237","volume":"34","author":"F Sasaki","year":"2020","unstructured":"Sasaki F, Yohira T, Kawaguchi A (2020) Adversarial behavioral cloning. Adv Robot 34 (9):592\u2013598","journal-title":"Adv Robot"},{"issue":"1","key":"2527_CR18","first-page":"1334","volume":"17","author":"S Levine","year":"2016","unstructured":"Levine S, Finn C, Darrell T, Abbeel P (2016) End-to-end training of deep visuomotor policies. J Mach Learn Res 17(1):1334\u20131373","journal-title":"J Mach Learn Res"},{"key":"2527_CR19","unstructured":"Xiang G, Su J (2019) Task-oriented deep reinforcement learning for robotic skill acquisition and control. IEEE transactions on cybernetics"},{"key":"2527_CR20","unstructured":"Finn C, Levine S, Abbeel P (2016) Guided cost learning: Deep inverse optimal control via policy optimization. In: International conference on machine learning. PMLR, pp 49\u201358"},{"key":"2527_CR21","doi-asserted-by":"crossref","unstructured":"Strudel R, Pashevich A, Kalevatykh I, Laptev I, Sivic J, Schmid C (2020) Learning to combine primitive skills: A step towards versatile robotic manipulation. In: International Conference on Robotics and Automation. IEEE, pp 4637\u20134643","DOI":"10.1109\/ICRA40945.2020.9196619"},{"issue":"8","key":"2527_CR22","doi-asserted-by":"publisher","first-page":"910","DOI":"10.1177\/0278364919850295","volume":"38","author":"MJ Aein","year":"2019","unstructured":"Aein M J, Aksoy E E, W\u00f6rg\u00f6tter F (2019) Library of actions: Implementing a generic robot execution framework by using manipulation action semantics. Int J Robot Res 38(8):910\u2013 934","journal-title":"Int J Robot Res"},{"issue":"8","key":"2527_CR23","doi-asserted-by":"publisher","first-page":"879","DOI":"10.1177\/0278364917713116","volume":"36","author":"R Lioutikov","year":"2017","unstructured":"Lioutikov R, Neumann G, Maeda G, Peters J (2017) Learning movement primitive libraries through probabilistic segmentation. Int J Robot Res 36(8):879\u2013894","journal-title":"Int J Robot Res"},{"key":"2527_CR24","doi-asserted-by":"crossref","unstructured":"Gutzeit L, Fabisch A, Petzoldt C, Wiese H, Kirchner F (2019) Automated robot skill learning from demonstration for various robot systems. In: Joint German\/Austrian Conference on Artificial Intelligence. Springer, pp 168\u2013181","DOI":"10.1007\/978-3-030-30179-8_14"},{"key":"2527_CR25","doi-asserted-by":"publisher","first-page":"152","DOI":"10.1016\/j.robot.2017.03.010","volume":"92","author":"Y Tanaka","year":"2017","unstructured":"Tanaka Y (2017) Velocity-based robotic assistance for refining motor skill training in a complex target-hitting task using a bio-mimetic trajectory generation model: A pilot study. Robot Auton Syst 92:152\u2013161","journal-title":"Robot Auton Syst"},{"issue":"2","key":"2527_CR26","doi-asserted-by":"publisher","first-page":"1153","DOI":"10.1109\/TII.2018.2826064","volume":"15","author":"C Yang","year":"2018","unstructured":"Yang C, Zeng C, Cong Y, Wang N, Wang M (2018) A learning framework of adaptive manipulative skills from human to robot. IEEE Trans Ind Inf 15(2):1153\u20131161","journal-title":"IEEE Trans Ind Inf"},{"issue":"13-14","key":"2527_CR27","doi-asserted-by":"publisher","first-page":"1595","DOI":"10.1177\/0278364917743319","volume":"36","author":"S Krishnan","year":"2017","unstructured":"Krishnan S, Garg A, Patil S, Lea C, Hager G, Abbeel P, Goldberg K (2017) Transition state clustering: Unsupervised surgical trajectory segmentation for robot learning. Int J Robot Res 36 (13-14):1595\u20131618","journal-title":"Int J Robot Res"},{"issue":"4","key":"2527_CR28","doi-asserted-by":"publisher","first-page":"4452","DOI":"10.1109\/LRA.2019.2932610","volume":"4","author":"E Pignat","year":"2019","unstructured":"Pignat E, Calinon S (2019) Bayesian gaussian mixture model for robotic policy imitation. IEEE Robot Autom Lett 4(4):4452\u2013 4458","journal-title":"IEEE Robot Autom Lett"},{"issue":"3","key":"2527_CR29","doi-asserted-by":"publisher","first-page":"634","DOI":"10.1109\/TMM.2017.2749159","volume":"20","author":"X Wang","year":"2017","unstructured":"Wang X, Gao L, Wang P, Sun X, Liu X (2017) Two-stream 3-d convnet fusion for action recognition in videos with arbitrary size and length. IEEE Trans Multimed 20(3):634\u2013644","journal-title":"IEEE Trans Multimed"},{"key":"2527_CR30","unstructured":"Kaehler A, Bradski G (2016) Learning opencv 3: computer vision in c++ with the opencv library. O\u2019Reilly Media, Inc."},{"issue":"4","key":"2527_CR31","doi-asserted-by":"publisher","first-page":"4386","DOI":"10.1109\/LRA.2019.2932874","volume":"4","author":"H Wang","year":"2019","unstructured":"Wang H, Sun Y, Liu M (2019) Self-supervised drivable area and road anomaly segmentation using rgb-d data for robotic wheelchairs. IEEE Robot Autom Lett 4(4):4386\u2013 4393","journal-title":"IEEE Robot Autom Lett"},{"key":"2527_CR32","doi-asserted-by":"publisher","first-page":"95","DOI":"10.1016\/j.patcog.2019.04.014","volume":"93","author":"P Fr\u00e4nti","year":"2019","unstructured":"Fr\u00e4nti P, Sieranoja S (2019) How much can k-means be improved by using better initialization and repeats?. Pattern Recogn 93:95\u2013112","journal-title":"Pattern Recogn"},{"key":"2527_CR33","unstructured":"Xie J, Girshick R, Farhadi A (2016) Unsupervised deep embedding for clustering analysis. In: International conference on machine learning. PMLR, pp 478\u2013487"},{"key":"2527_CR34","doi-asserted-by":"crossref","unstructured":"Sermanet P, Xu K, Levine S (2017) Unsupervised perceptual rewards for imitation learning. In: Robotics: Science and Systems, vol 13","DOI":"10.15607\/RSS.2017.XIII.050"},{"key":"2527_CR35","unstructured":"Sharma P, Mohan L, Pinto L, Gupta A (2018) Multiple interactions made easy (mime): Large scale demonstrations data for imitation. In: Conference on robot learning. PMLR, pp 906\u2013915"},{"key":"2527_CR36","doi-asserted-by":"crossref","unstructured":"Ren C-X, Ge P, Yang P, Yan S (2020) Learning target-domain-specific classifier for partial domain adaptation. IEEE Transactions on Neural Networks and Learning Systems","DOI":"10.1109\/TNNLS.2020.2995648"},{"key":"2527_CR37","doi-asserted-by":"crossref","unstructured":"Kobayashi T (2020) q-vae for disentangled representation learning and latent dynamical systems. In: IEEE Robotics and Automation Letters, vol 5, pp 5669\u20135676","DOI":"10.1109\/LRA.2020.3010206"},{"issue":"2","key":"2527_CR38","doi-asserted-by":"publisher","first-page":"3019","DOI":"10.1109\/LRA.2020.2974707","volume":"5","author":"S James","year":"2020","unstructured":"James S, Ma Z, Arrojo D R, Davison A J (2020) Rlbench: The robot learning benchmark & learning environment. IEEE Robot Autom Lett 5(2):3019\u20133026","journal-title":"IEEE Robot Autom Lett"},{"issue":"2","key":"2527_CR39","doi-asserted-by":"publisher","first-page":"336","DOI":"10.1007\/s11263-019-01228-7","volume":"128","author":"RR Selvaraju","year":"2020","unstructured":"Selvaraju R R, Cogswell M, Das A, Vedantam R, Parikh D, Batra D (2020) Grad-cam: Visual explanations from deep networks via gradient-based localization. Int J Comput Vis 128(2):336\u2013 359","journal-title":"Int J Comput Vis"},{"key":"2527_CR40","doi-asserted-by":"publisher","first-page":"107037","DOI":"10.1016\/j.patcog.2019.107037","volume":"98","author":"J Li","year":"2020","unstructured":"Li J, Liu X, Zhang M, Wang D (2020) Spatio-temporal deformable 3d convnets with attention for action recognition. Pattern Recogn 98:107037","journal-title":"Pattern Recogn"},{"issue":"4","key":"2527_CR41","doi-asserted-by":"publisher","first-page":"1417","DOI":"10.1109\/TNNLS.2019.2919948","volume":"31","author":"P Ge","year":"2019","unstructured":"Ge P, Ren C-X, Dai D-Q, Feng J, Yan S (2019) Dual adversarial autoencoders for clustering. IEEE Trans Neural Netw Learn Syst 31(4):1417\u20131424","journal-title":"IEEE Trans Neural Netw Learn Syst"},{"key":"2527_CR42","unstructured":"Jeon W, Seo S, Kim K-E (2018) A bayesian approach to generative adversarial imitation learning. In: NeurIPS, pp 7440\u20137450"},{"key":"2527_CR43","doi-asserted-by":"crossref","unstructured":"Sun J, Yu L, Dong P, Lu B, Zhou B (2021) Adversarial inverse reinforcement learning with self-attention dynamics model. IEEE Robotics and Automation Letters","DOI":"10.1109\/LRA.2021.3061397"}],"container-title":["Applied Intelligence"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s10489-021-02527-8.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s10489-021-02527-8\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s10489-021-02527-8.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,2,22]],"date-time":"2022-02-22T06:49:54Z","timestamp":1645512594000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s10489-021-02527-8"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2021,7,20]]},"references-count":43,"journal-issue":{"issue":"4","published-print":{"date-parts":[[2022,3]]}},"alternative-id":["2527"],"URL":"https:\/\/doi.org\/10.1007\/s10489-021-02527-8","relation":{},"ISSN":["0924-669X","1573-7497"],"issn-type":[{"value":"0924-669X","type":"print"},{"value":"1573-7497","type":"electronic"}],"subject":[],"published":{"date-parts":[[2021,7,20]]},"assertion":[{"value":"10 May 2021","order":1,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"20 July 2021","order":2,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Compliance with Ethical Standards"}},{"value":"The authors declare that they have no conflict of interest.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"<!--Emphasis Type='Bold' removed-->Conflict of interest"}}]}}