{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,24]],"date-time":"2026-07-24T14:50:41Z","timestamp":1784904641887,"version":"3.55.0"},"publisher-location":"Cham","reference-count":70,"publisher":"Springer Nature Switzerland","isbn-type":[{"value":"9783031732461","type":"print"},{"value":"9783031732478","type":"electronic"}],"license":[{"start":{"date-parts":[[2024,11,1]],"date-time":"2024-11-01T00:00:00Z","timestamp":1730419200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,11,1]],"date-time":"2024-11-01T00:00:00Z","timestamp":1730419200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2025]]},"DOI":"10.1007\/978-3-031-73247-8_11","type":"book-chapter","created":{"date-parts":[[2024,10,31]],"date-time":"2024-10-31T12:02:20Z","timestamp":1730376140000},"page":"178-195","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":6,"title":["T-MAE : Temporal Masked Autoencoders for\u00a0Point Cloud Representation Learning"],"prefix":"10.1007","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-5952-5341","authenticated-orcid":false,"given":"Weijie","family":"Wei","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Fatemeh Karimi","family":"Nejadasl","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Theo","family":"Gevers","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-1183-9958","authenticated-orcid":false,"given":"Martin R.","family":"Oswald","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2024,11,1]]},"reference":[{"key":"11_CR1","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"850","DOI":"10.1007\/978-3-319-48881-3_56","volume-title":"Computer Vision \u2013 ECCV 2016 Workshops","author":"L Bertinetto","year":"2016","unstructured":"Bertinetto, L., Valmadre, J., Henriques, J.F., Vedaldi, A., Torr, P.H.S.: Fully-convolutional siamese networks for object tracking. In: Hua, G., J\u00e9gou, H. (eds.) ECCV 2016. LNCS, vol. 9914, pp. 850\u2013865. Springer, Cham (2016). https:\/\/doi.org\/10.1007\/978-3-319-48881-3_56"},{"key":"11_CR2","doi-asserted-by":"crossref","unstructured":"Boulch, A., Sautier, C., Michele, B., Puy, G., Marlet, R.: Also: automotive lidar self-supervision by occupancy estimation. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.01293"},{"key":"11_CR3","doi-asserted-by":"crossref","unstructured":"Bromley, J., Guyon, I., LeCun, Y., S\u00e4ckinger, E., Shah, R.: Signature verification using a \u201csiamese\" time delay neural network. In: NeurIPS, p. 737\u2013744 (1993)","DOI":"10.1142\/9789812797926_0003"},{"key":"11_CR4","doi-asserted-by":"crossref","unstructured":"Caesar, H., et al.: nuScenes: a multimodal dataset for autonomous driving. In: CVPR (2020)","DOI":"10.1109\/CVPR42600.2020.01164"},{"key":"11_CR5","series-title":"Lecture Notes in Computer Science (Lecture Notes in Artificial Intelligence)","doi-asserted-by":"publisher","first-page":"160","DOI":"10.1007\/978-3-642-37456-2_14","volume-title":"Advances in Knowledge Discovery and Data Mining","author":"RJGB Campello","year":"2013","unstructured":"Campello, R.J.G.B., Moulavi, D., Sander, J.: Density-based clustering based on hierarchical density estimates. In: Pei, J., Tseng, V.S., Cao, L., Motoda, H., Xu, G. (eds.) PAKDD 2013. LNCS (LNAI), vol. 7819, pp. 160\u2013172. Springer, Heidelberg (2013). https:\/\/doi.org\/10.1007\/978-3-642-37456-2_14"},{"key":"11_CR6","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"213","DOI":"10.1007\/978-3-030-58452-8_13","volume-title":"Computer Vision \u2013 ECCV 2020","author":"N Carion","year":"2020","unstructured":"Carion, N., Massa, F., Synnaeve, G., Usunier, N., Kirillov, A., Zagoruyko, S.: End-to-End object detection with transformers. In: Vedaldi, A., Bischof, H., Brox, T., Frahm, J.-M. (eds.) ECCV 2020. LNCS, vol. 12346, pp. 213\u2013229. Springer, Cham (2020). https:\/\/doi.org\/10.1007\/978-3-030-58452-8_13"},{"key":"11_CR7","unstructured":"Caron, M., Misra, I., Mairal, J., Goyal, P., Bojanowski, P., Joulin, A.: Unsupervised learning of visual features by contrasting cluster assignments. In: NeurIPS (2021)"},{"key":"11_CR8","doi-asserted-by":"crossref","unstructured":"Caron, M., et al.: Emerging properties in self-supervised vision transformers. In: ICCV (2021)","DOI":"10.1109\/ICCV48922.2021.00951"},{"key":"11_CR9","doi-asserted-by":"crossref","unstructured":"Chen, X., Milioto, A., Palazzolo, E., Gigu\u00e8re, P., Behley, J., Stachniss, C.: Suma++: efficient lidar-based semantic slam. In: IROS, pp. 4530\u20134537 (2019)","DOI":"10.1109\/IROS40897.2019.8967704"},{"key":"11_CR10","doi-asserted-by":"crossref","unstructured":"Chen, X., He, K.: Exploring simple siamese representation learning. In: CVPR, pp. 15745\u201315753 (2021)","DOI":"10.1109\/CVPR46437.2021.01549"},{"key":"11_CR11","doi-asserted-by":"crossref","unstructured":"Chen, X., Xie, S., He, K.: An empirical study of training self-supervised vision transformers. In: ICCV (2021)","DOI":"10.1109\/ICCV48922.2021.00950"},{"key":"11_CR12","doi-asserted-by":"crossref","unstructured":"Chen, Z., et al.: Siamese detr. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.01509"},{"key":"11_CR13","doi-asserted-by":"crossref","unstructured":"Dellenbach, P., Deschaud, J.E., Jacquet, B., Goulette, F.: Ct-icp: real-time elastic lidar odometry with loop closure. In: ICRA (2022)","DOI":"10.1109\/ICRA46639.2022.9811849"},{"key":"11_CR14","unstructured":"Devlin, J., Chang, M.W., Lee, K., Toutanova, K.: BERT: pre-training of deep bidirectional transformers for language understanding. In: NAACL (2019)"},{"key":"11_CR15","unstructured":"Dosovitskiy, A., et al.: An image is worth 16$$\\times $$16 words: transformers for image recognition at scale. In: ICLR (2021)"},{"key":"11_CR16","doi-asserted-by":"crossref","unstructured":"Fan, L., et al.: Embracing single stride 3d object detector with sparse transformer. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.00827"},{"key":"11_CR17","unstructured":"Fei, B., et al.: Self-supervised learning for pre-training 3d point clouds: a survey. arXiv:2305.04691 (2023)"},{"key":"11_CR18","unstructured":"Feichtenhofer, C., Fan, H., Li, Y., He, K.: Masked autoencoders as spatiotemporal learners. In: NeurIPS (2022)"},{"key":"11_CR19","doi-asserted-by":"crossref","unstructured":"Graham, B., Engelcke, M., van\u00a0der Maaten, L.: 3d semantic segmentation with submanifold sparse convolutional networks. In: CVPR (2018)","DOI":"10.1109\/CVPR.2018.00961"},{"key":"11_CR20","unstructured":"Grill, J.B., et al.: Bootstrap your own latent: a new approach to self-supervised learning. In: NeurIPS (2020)"},{"key":"11_CR21","doi-asserted-by":"crossref","unstructured":"Guo, Q., Feng, W., Zhou, C., Huang, R., Wan, L., Wang, S.: Learning dynamic siamese network for visual object tracking. In: ICCV, pp. 1781\u20131789. IEEE (2017)","DOI":"10.1109\/ICCV.2017.196"},{"key":"11_CR22","unstructured":"Gupta, A., Wu, J., Deng, J., Fei-Fei, L.: Siamese masked autoencoders. In: NeurIPS (2023)"},{"key":"11_CR23","doi-asserted-by":"crossref","unstructured":"He, A., Luo, C., Tian, X., Zeng, W.: A twofold siamese network for real-time object tracking. In: CVPR (2018)","DOI":"10.1109\/CVPR.2018.00508"},{"key":"11_CR24","doi-asserted-by":"crossref","unstructured":"He, K., Chen, X., Xie, S., Li, Y., Doll\u00e1r, P., Girshick, R.: Masked autoencoders are scalable vision learners. In: CVPR (2021)","DOI":"10.1109\/CVPR52688.2022.01553"},{"key":"11_CR25","doi-asserted-by":"crossref","unstructured":"Hou, J., Graham, B., Nie\u00dfner, M., Xie, S.: Exploring data-efficient 3d scene understanding with contrastive scene contexts. In: CVPR (2021)","DOI":"10.1109\/CVPR46437.2021.01533"},{"key":"11_CR26","doi-asserted-by":"crossref","unstructured":"Huang, B., Zhao, Z., Zhang, G., Qiao, Y., Wang, L.: Mgmae: motion guided masking for video masked autoencoding. In: ICCV (2023)","DOI":"10.1109\/ICCV51070.2023.01241"},{"key":"11_CR27","doi-asserted-by":"crossref","unstructured":"Huang, S., Xie, Y., Zhu, S.C., Zhu, Y.: Spatio-temporal self-supervised representation learning for 3d point clouds. In: ICCV (2021)","DOI":"10.1109\/ICCV48922.2021.00647"},{"key":"11_CR28","doi-asserted-by":"crossref","unstructured":"Jiang, J., Lu, X., Zhao, L., Dazeley, R., Wang, M.: Masked autoencoders in 3D point cloud representation learning. IEEE Trans. Multimedia (2023)","DOI":"10.1109\/TMM.2023.3314973"},{"key":"11_CR29","doi-asserted-by":"crossref","unstructured":"Lang, A.H., Vora, S., Caesar, H., Zhou, L., Yang, J., Beijbom, O.: PointPillars: fast encoders for object detection from point clouds. In: CVPR, pp. 12697\u201312705 (2019)","DOI":"10.1109\/CVPR.2019.01298"},{"key":"11_CR30","doi-asserted-by":"crossref","unstructured":"Li, L., Heizmann, M.: A closer look at invariances in self-supervised pre-training for 3d vision. In: ECCV (2022)","DOI":"10.1007\/978-3-031-20056-4_38"},{"key":"11_CR31","doi-asserted-by":"crossref","unstructured":"Liang, H., et al.: Exploring geometry-aware contrast and clustering harmonization for self-supervised 3d object detection. In: ICCV, pp. 3273\u20133282 (2021)","DOI":"10.1109\/ICCV48922.2021.00328"},{"key":"11_CR32","doi-asserted-by":"crossref","unstructured":"Lin, Z., Wang, Y.: BEV-MAE: bird\u2019s eye view masked autoencoders for outdoor point cloud pre-training. In: AAAI (2024)","DOI":"10.1609\/aaai.v38i4.28141"},{"key":"11_CR33","doi-asserted-by":"crossref","unstructured":"Liu, H., Cai, M., Lee, Y.J.: Masked discrimination for self-supervised learning on point clouds. In: ECCV (2022)","DOI":"10.1007\/978-3-031-20086-1_38"},{"key":"11_CR34","doi-asserted-by":"crossref","unstructured":"Liu, L., et al.: CPCM: contextual point cloud modeling for weakly-supervised point cloud semantic segmentation. In: ICCV (2023)","DOI":"10.1109\/ICCV51070.2023.01688"},{"key":"11_CR35","unstructured":"Mao, J., et al.: One million scenes for autonomous driving: once dataset. In: NeurIPS (2021)"},{"key":"11_CR36","doi-asserted-by":"crossref","unstructured":"Mao, Y., Deng, J., Zhou, W., Fang, Y., Ouyang, W., Li, H.: Masked motion predictors are strong 3d action representation learners. In: ICCV (2023)","DOI":"10.1109\/ICCV51070.2023.00934"},{"key":"11_CR37","unstructured":"Min, C., Xu, X., Zhao, D., Xiao, L., Nie, Y., Dai, B.: Occupancy-MAE: self-supervised pre-training large-scale lidar point clouds with masked occupancy autoencoders. IEEE Trans. Intell. Veh. (2022)"},{"key":"11_CR38","doi-asserted-by":"crossref","unstructured":"Nunes, L., Marcuzzi, R., Chen, X., Behley, J., Stachniss, C.: SegContrast: 3D point cloud feature representation learning through self-supervised segment discrimination. IEEE Rob. Autom. Lett. (RA-L) 7(2), 2116\u20132123 (2022)","DOI":"10.1109\/LRA.2022.3142440"},{"key":"11_CR39","doi-asserted-by":"crossref","unstructured":"Nunes, L., Wiesmann, L., Marcuzzi, R., Chen, X., Behley, J., Stachniss, C.: Temporal consistent 3d LiDAR representation learning for semantic perception in autonomous driving. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.00505"},{"key":"11_CR40","doi-asserted-by":"crossref","unstructured":"Pang, B., Xia, H., Lu, C.: Unsupervised 3d point cloud representation learning by triangle constrained contrast for autonomous driving. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.00506"},{"key":"11_CR41","doi-asserted-by":"publisher","first-page":"604","DOI":"10.1007\/978-3-031-20086-1_35","volume-title":"ECCV 2022","author":"Y Pang","year":"2022","unstructured":"Pang, Y., Wang, W., Tay, F.E.H., Liu, W., Tian, Y., Yuan, L.: Masked autoencoders for point cloud self-supervised learning. In: Avidan, S., Brostow, G., Ciss\u00e9, M., Farinella, G.M., Hassner, T. (eds.) ECCV 2022, vol. 13662, pp. 604\u2013621. Springer, Cham (2022). https:\/\/doi.org\/10.1007\/978-3-031-20086-1_35"},{"key":"11_CR42","doi-asserted-by":"crossref","unstructured":"Peng, X., Wang, K., Zhu, Z., Wang, M., You, Y.: Crafting better contrastive views for siamese representation learning. In: CVPR, pp. 16010\u201316019. IEEE (2022)","DOI":"10.1109\/CVPR52688.2022.01556"},{"key":"11_CR43","doi-asserted-by":"crossref","unstructured":"Rao, Y., Liu, B., Wei, Y., Lu, J., Hsieh, C.J., Zhou, J.: Randomrooms: unsupervised pre-training from synthetic shapes and randomized layouts for 3d object detection. In: ICCV (2021)","DOI":"10.1109\/ICCV48922.2021.00327"},{"key":"11_CR44","doi-asserted-by":"crossref","unstructured":"Sch\u00f6nberger, J.L., Frahm, J.M.: Structure-from-motion revisited. In: Conference on Computer Vision and Pattern Recognition (CVPR) (2016)","DOI":"10.1109\/CVPR.2016.445"},{"key":"11_CR45","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"501","DOI":"10.1007\/978-3-319-46487-9_31","volume-title":"Computer Vision \u2013 ECCV 2016","author":"JL Sch\u00f6nberger","year":"2016","unstructured":"Sch\u00f6nberger, J.L., Zheng, E., Frahm, J.-M., Pollefeys, M.: Pixelwise view selection for unstructured multi-view stereo. In: Leibe, B., Matas, J., Sebe, N., Welling, M. (eds.) ECCV 2016. LNCS, vol. 9907, pp. 501\u2013518. Springer, Cham (2016). https:\/\/doi.org\/10.1007\/978-3-319-46487-9_31"},{"key":"11_CR46","doi-asserted-by":"crossref","unstructured":"Shi, S., et al.: Pv-rcnn: point-voxel feature set abstraction for 3d object detection. In: CVPR (2020)","DOI":"10.1109\/CVPR42600.2020.01054"},{"key":"11_CR47","doi-asserted-by":"crossref","unstructured":"Sun, P., et al.: Scalability in perception for autonomous driving: waymo open dataset. In: CVPR, pp. 2443\u20132451 (2020)","DOI":"10.1109\/CVPR42600.2020.00252"},{"key":"11_CR48","doi-asserted-by":"publisher","unstructured":"Sun, P., et al.: Swformer: sparse window transformer for 3d object detection in point clouds. In: ECCV 2022, pp. 426\u2013442. Springer, Heidelberg (2022). https:\/\/doi.org\/10.1007\/978-3-031-20080-9_25","DOI":"10.1007\/978-3-031-20080-9_25"},{"key":"11_CR49","doi-asserted-by":"crossref","unstructured":"Tao, R., Gavves, E., Smeulders, A.W.M.: Siamese instance search for tracking. In: CVPR (2016)","DOI":"10.1109\/CVPR.2016.158"},{"key":"11_CR50","doi-asserted-by":"crossref","unstructured":"Tian, K., Zhou, S., Guan, J.: Deepcluster: a general clustering framework based on deep learning. In: Machine Learning and Knowledge Discovery in Databases, pp. 809\u2013825 (2017)","DOI":"10.1007\/978-3-319-71246-8_49"},{"key":"11_CR51","doi-asserted-by":"crossref","unstructured":"Tian, X., Ran, H., Wang, Y., Zhao, H.: GeoMAE: masked geometric target prediction for self-supervised point cloud pre-training. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.01304"},{"key":"11_CR52","unstructured":"Tong, Z., Song, Y., Wang, J., Wang, L.: VideoMAE: masked autoencoders are data-efficient learners for self-supervised video pre-training. In: NeurIPS (2022)"},{"key":"11_CR53","unstructured":"Vaswani, A., et al.: Attention is all you need. In: NeurIPS, p.\u00a011 (2017)"},{"key":"11_CR54","doi-asserted-by":"crossref","unstructured":"Wei, C., Fan, H., Xie, S., Wu, C.Y., Yuille, A., Feichtenhofer, C.: Masked feature prediction for self-supervised visual pre-training. In: CVPR, pp. 14648\u201314658. IEEE, New Orleans (2022)","DOI":"10.1109\/CVPR52688.2022.01426"},{"key":"11_CR55","doi-asserted-by":"crossref","unstructured":"Wu, Y., Zhang, T., Ke, W., Susstrunk, S., Salzmann, M.: Spatiotemporal self-supervised learning for point clouds in the wild. In: CVPR, pp. 5251\u20135260 (2023)","DOI":"10.1109\/CVPR52729.2023.00508"},{"issue":"9","key":"11_CR56","doi-asserted-by":"publisher","first-page":"11321","DOI":"10.1109\/TPAMI.2023.3262786","volume":"45","author":"A Xiao","year":"2023","unstructured":"Xiao, A., Huang, J., Guan, D., Zhang, X., Lu, S., Shao, L.: Unsupervised point cloud representation learning with deep neural networks: a survey. IEEE Trans. Pattern Anal. Mach. Intell. 45(9), 11321\u201311339 (2023)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"11_CR57","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"574","DOI":"10.1007\/978-3-030-58580-8_34","volume-title":"Computer Vision \u2013 ECCV 2020","author":"S Xie","year":"2020","unstructured":"Xie, S., Gu, J., Guo, D., Qi, C.R., Guibas, L., Litany, O.: PointContrast: unsupervised pre-training for 3D point cloud understanding. In: Vedaldi, A., Bischof, H., Brox, T., Frahm, J.-M. (eds.) ECCV 2020. LNCS, vol. 12348, pp. 574\u2013591. Springer, Cham (2020). https:\/\/doi.org\/10.1007\/978-3-030-58580-8_34"},{"key":"11_CR58","doi-asserted-by":"crossref","unstructured":"Xu, R., et al.: MV-JAR: masked voxel jigsaw and reconstruction for LiDAR-based self-supervised pre-training. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.01292"},{"key":"11_CR59","doi-asserted-by":"crossref","unstructured":"Yamada, R., Kataoka, H., Chiba, N., Domae, Y., Ogata, T.: Point cloud pre-training with natural 3d structures. In: CVPR, pp. 21251\u201321261 (2022)","DOI":"10.1109\/CVPR52688.2022.02060"},{"key":"11_CR60","unstructured":"Yan, X., et al.: Let images give you more:point cloud cross-modal training for shape analysis. In: NeurIPS (2022)"},{"issue":"10","key":"11_CR61","doi-asserted-by":"publisher","first-page":"3337","DOI":"10.3390\/s18103337","volume":"18","author":"Y Yan","year":"2018","unstructured":"Yan, Y., Mao, Y., Li, B.: Second: sparsely embedded convolutional detection. Sensors 18(10), 3337 (2018)","journal-title":"Sensors"},{"key":"11_CR62","doi-asserted-by":"crossref","unstructured":"Yang, H., et al.: GD-MAE: generative decoder for MAE pre-training on LiDAR point clouds. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.00907"},{"key":"11_CR63","doi-asserted-by":"publisher","unstructured":"Yang, H., et al.: Graph r-cnn: towards accurate 3d object detection with semantic-decorated local graph. In: ECCV 2022, pp. 662\u2013679. Springer, Heidelberg (2022). https:\/\/doi.org\/10.1007\/978-3-031-20074-8_38","DOI":"10.1007\/978-3-031-20074-8_38"},{"key":"11_CR64","doi-asserted-by":"publisher","unstructured":"Yin, J., et al.: Proposalcontrast: unsupervised pre-training for lidar-based 3d object detection. In: ECCV 2022, pp. 17\u201333. Springer, Heidelberg (2022). https:\/\/doi.org\/10.1007\/978-3-031-19842-7_2","DOI":"10.1007\/978-3-031-19842-7_2"},{"key":"11_CR65","doi-asserted-by":"crossref","unstructured":"Yin, T., Zhou, X., Kr\u00e4henb\u00fchl, P.: Center-based 3d object detection and tracking. In: CVPR (2021)","DOI":"10.1109\/CVPR46437.2021.01161"},{"key":"11_CR66","doi-asserted-by":"crossref","unstructured":"Yu, X., Tang, L., Rao, Y., Huang, T., Zhou, J., Lu, J.: Point-BERT: pre-training 3d point cloud transformers with masked point modeling. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.01871"},{"key":"11_CR67","unstructured":"Zhang, R., et al.: Point-M2AE: multi-scale masked autoencoders for hierarchical point cloud pre-training. In: NeurIPS (2022)"},{"key":"11_CR68","doi-asserted-by":"crossref","unstructured":"Zhang, R., Wang, L., Qiao, Y., Gao, P., Li, H.: Learning 3D representations from 2D pre-trained models via image-to-point masked autoencoders. In: CVPR (2023)","DOI":"10.1109\/CVPR52729.2023.02085"},{"key":"11_CR69","doi-asserted-by":"crossref","unstructured":"Zhang, Y., Hu, Q., Xu, G., Ma, Y., Wan, J., Guo, Y.: Not all points are equal: learning highly efficient point-based detectors for 3d lidar point clouds. In: CVPR (2022)","DOI":"10.1109\/CVPR52688.2022.01838"},{"key":"11_CR70","doi-asserted-by":"crossref","unstructured":"Zhang, Z., Girdhar, R., Joulin, A., Misra, I.: Self-supervised pretraining of 3d features on any point-cloud. In: ICCV (2021)","DOI":"10.1109\/ICCV48922.2021.01009"}],"container-title":["Lecture Notes in Computer Science","Computer Vision \u2013 ECCV 2024"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-031-73247-8_11","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,10,31]],"date-time":"2024-10-31T12:06:29Z","timestamp":1730376389000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-3-031-73247-8_11"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,11,1]]},"ISBN":["9783031732461","9783031732478"],"references-count":70,"URL":"https:\/\/doi.org\/10.1007\/978-3-031-73247-8_11","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,11,1]]},"assertion":[{"value":"1 November 2024","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ECCV","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"European Conference on Computer Vision","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Milan","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Italy","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2024","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"29 September 2024","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"4 October 2024","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"18","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"eccv2024","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"https:\/\/eccv2024.ecva.net\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}