{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,27]],"date-time":"2026-07-27T09:02:02Z","timestamp":1785142922150,"version":"3.55.0"},"reference-count":53,"publisher":"Elsevier BV","license":[{"start":{"date-parts":[[2026,8,1]],"date-time":"2026-08-01T00:00:00Z","timestamp":1785542400000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/tdm\/userlicense\/1.0\/"},{"start":{"date-parts":[[2026,8,1]],"date-time":"2026-08-01T00:00:00Z","timestamp":1785542400000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/legal\/tdmrep-license"},{"start":{"date-parts":[[2026,8,1]],"date-time":"2026-08-01T00:00:00Z","timestamp":1785542400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-017"},{"start":{"date-parts":[[2026,8,1]],"date-time":"2026-08-01T00:00:00Z","timestamp":1785542400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"},{"start":{"date-parts":[[2026,8,1]],"date-time":"2026-08-01T00:00:00Z","timestamp":1785542400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-012"},{"start":{"date-parts":[[2026,8,1]],"date-time":"2026-08-01T00:00:00Z","timestamp":1785542400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2026,8,1]],"date-time":"2026-08-01T00:00:00Z","timestamp":1785542400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-004"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["42501556"],"award-info":[{"award-number":["42501556"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100004608","name":"Natural Science Foundation of Jiangsu Province","doi-asserted-by":"publisher","award":["24KJB170010"],"award-info":[{"award-number":["24KJB170010"]}],"id":[{"id":"10.13039\/501100004608","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100004608","name":"Natural Science Foundation of Jiangsu Province","doi-asserted-by":"publisher","award":["BK20241069"],"award-info":[{"award-number":["BK20241069"]}],"id":[{"id":"10.13039\/501100004608","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100008114","name":"Nanjing Institute of Technology","doi-asserted-by":"publisher","id":[{"id":"10.13039\/501100008114","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["elsevier.com","sciencedirect.com"],"crossmark-restriction":true},"short-container-title":["Information Fusion"],"published-print":{"date-parts":[[2026,8]]},"DOI":"10.1016\/j.inffus.2026.104208","type":"journal-article","created":{"date-parts":[[2026,2,5]],"date-time":"2026-02-05T01:09:00Z","timestamp":1770253740000},"page":"104208","update-policy":"https:\/\/doi.org\/10.1016\/elsevier_cm_policy","source":"Crossref","is-referenced-by-count":1,"special_numbering":"C","title":["Cross-modal contrastive learning for 3D point cloud-text fusion via implicit semantic alignment"],"prefix":"10.1016","volume":"132","author":[{"ORCID":"https:\/\/orcid.org\/0000-0001-5819-1215","authenticated-orcid":false,"given":"Xiangtian","family":"Zheng","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Chen","family":"Ji","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0003-0548-6740","authenticated-orcid":false,"given":"Wei","family":"Cai","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xianghua","family":"Tang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xiaolin","family":"Yang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Liang","family":"Cheng","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"78","reference":[{"key":"10.1016\/j.inffus.2026.104208_bib0001","first-page":"1","article-title":"Diff-pcg: diffusion point cloud generation conditioned on continuous normalizing flow","author":"Yu","year":"2024","journal-title":"Vis. Comput."},{"key":"10.1016\/j.inffus.2026.104208_bib0002","series-title":"Proceedings of the Computer Vision and Pattern Recognition Conference","first-page":"22182","article-title":"Point clouds meets physics: dynamic acoustic field fitting network for point cloud understanding","author":"Wang","year":"2025"},{"key":"10.1016\/j.inffus.2026.104208_bib0003","unstructured":"C. Wang, X. Fang, P. Tiwari, DyPolySeg: Taylor series-inspired dynamic polynomial fitting network for few-shot point cloud semantic segmentation, in: Forty-second International Conference on Machine Learning."},{"key":"10.1016\/j.inffus.2026.104208_bib0004","doi-asserted-by":"crossref","DOI":"10.1109\/ACCESS.2023.3326374","article-title":"Characterization of the quality of experience and immersion of point cloud video sequences through a subjective study","author":"Nguyen","year":"2023","journal-title":"IEEE Access"},{"key":"10.1016\/j.inffus.2026.104208_bib0005","series-title":"European Conference on Computer Vision","first-page":"75","article-title":"Gpsformer: a global perception and local structure fitting-based transformer for point cloud understanding","author":"Wang","year":"2024"},{"key":"10.1016\/j.inffus.2026.104208_bib0006","first-page":"1","article-title":"Both efficiency and safety in V2V broadcast communications: a communications scheme based on multilevel-\u03bcTESLA and evolutionary game theory","author":"Chen","year":"2025","journal-title":"IEEE Trans. Veh. Technol."},{"key":"10.1016\/j.inffus.2026.104208_bib0007","series-title":"Conference on Robot Learning","first-page":"1038","article-title":"Toolflownet: robotic manipulation with tools via predicting tool flow from point clouds","author":"Seita","year":"2023"},{"key":"10.1016\/j.inffus.2026.104208_sbref0008","doi-asserted-by":"crossref","DOI":"10.1016\/j.iot.2025.101781","article-title":"A lightweight UAV secure communication scheme integrating cross-domain group authentication and reputation awareness","volume":"34","author":"Chen","year":"2025","journal-title":"Internet Things"},{"issue":"4","key":"10.1016\/j.inffus.2026.104208_bib0009","doi-asserted-by":"crossref","first-page":"5128","DOI":"10.1109\/TVT.2023.3334754","article-title":"Digital forensics for automotive intelligent networked terminal devices","volume":"73","author":"Chen","year":"2024","journal-title":"IEEE Trans. Veh. Technol."},{"key":"10.1016\/j.inffus.2026.104208_bib0010","series-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","first-page":"652","article-title":"Pointnet: deep learning on point sets for 3d classification and segmentation","author":"Qi","year":"2017"},{"key":"10.1016\/j.inffus.2026.104208_bib0011","article-title":"Pointnet++: deep hierarchical feature learning on point sets in a metric space","volume":"30","author":"Qi","year":"2017","journal-title":"Adv. Neural Inf. Process. Syst."},{"key":"10.1016\/j.inffus.2026.104208_bib0012","series-title":"Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition","first-page":"5589","article-title":"Pointasnl: robust point clouds processing using nonlocal neural networks with adaptive sampling","author":"Yan","year":"2020"},{"key":"10.1016\/j.inffus.2026.104208_bib0013","article-title":"PMMNet: a dual branch fusion network of point cloud and multi-view for intracranial aneurysm classification and segmentation","author":"Cao","year":"2024","journal-title":"IEEE J. Biomed. Health Inform."},{"issue":"5","key":"10.1016\/j.inffus.2026.104208_bib0014","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1145\/3326362","article-title":"Dynamic graph cnn for learning on point clouds","volume":"38","author":"Wang","year":"2019","journal-title":"ACM Trans. Graph."},{"key":"10.1016\/j.inffus.2026.104208_bib0015","series-title":"Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition","first-page":"5565","article-title":"Pointweb: enhancing local neighborhood features for point cloud processing","author":"Zhao","year":"2019"},{"key":"10.1016\/j.inffus.2026.104208_bib0016","article-title":"Pointcnn: convolution on x-transformed points","volume":"31","author":"Li","year":"2018","journal-title":"Adv. Neural Inf. Process. Syst."},{"key":"10.1016\/j.inffus.2026.104208_bib0017","unstructured":"X. Ma, C. Qin, H. You, H. Ran, Y. Fu, Rethinking network design and local geometry in point cloud: A simple residual MLP framework, arXiv: 2202.07123(2022)."},{"key":"10.1016\/j.inffus.2026.104208_bib0018","first-page":"23192","article-title":"Pointnext: revisiting pointnet++ with improved training and scaling strategies","volume":"35","author":"Qian","year":"2022","journal-title":"Adv. Neural Inf. Process. Syst."},{"key":"10.1016\/j.inffus.2026.104208_bib0019","article-title":"PCDNF: revisiting learning-based point cloud denoising via joint normal filtering","author":"Liu","year":"2023","journal-title":"IEEE Trans. Vis. Comput. Graph."},{"key":"10.1016\/j.inffus.2026.104208_bib0020","article-title":"PointDifformer: robust point cloud registration with neural diffusion and transformer","author":"She","year":"2024","journal-title":"IEEE Trans. Geosci. Remote Sens."},{"key":"10.1016\/j.inffus.2026.104208_bib0021","doi-asserted-by":"crossref","DOI":"10.1016\/j.patcog.2022.109051","article-title":"DcTr: noise-robust point cloud completion by dual-channel transformer with cross-attention","volume":"133","author":"Fei","year":"2023","journal-title":"Pattern Recognit."},{"key":"10.1016\/j.inffus.2026.104208_bib0022","first-page":"67960","article-title":"Dit-3d: exploring plain diffusion transformers for 3d shape generation","volume":"36","author":"Mo","year":"2023","journal-title":"Adv. Neural Inf. Process. Syst."},{"key":"10.1016\/j.inffus.2026.104208_bib0023","series-title":"Proceedings of the 13th ACM Conference on Security and Privacy in Wireless and Mobile Networks","first-page":"242","article-title":"Spotr: gps spoofing detection via device fingerprinting","author":"Foruhandeh","year":"2020"},{"key":"10.1016\/j.inffus.2026.104208_bib0024","series-title":"Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition","first-page":"5525","article-title":"KPConvX: modernizing kernel point convolution with kernel attention","author":"Thomas","year":"2024"},{"key":"10.1016\/j.inffus.2026.104208_bib0025","series-title":"Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition","first-page":"20943","article-title":"Oneformer3d: one transformer for unified point cloud segmentation","author":"Kolodiazhnyi","year":"2024"},{"key":"10.1016\/j.inffus.2026.104208_bib0026","doi-asserted-by":"crossref","DOI":"10.1016\/j.patcog.2023.109796","article-title":"APUNet: attention-guided upsampling network for sparse and non-uniform point cloud","volume":"143","author":"Zhao","year":"2023","journal-title":"Pattern Recognit."},{"key":"10.1016\/j.inffus.2026.104208_bib0027","series-title":"European Conference on Computer Vision","first-page":"426","article-title":"Swformer: sparse window transformer for 3d object detection in point clouds","author":"Sun","year":"2022"},{"key":"10.1016\/j.inffus.2026.104208_bib0028","unstructured":"W. Ren, W. Ma, H. Yang, C. Wei, G. Zhang, W. Chen, Vamba: understanding hour-long videos with hybrid mamba-transformers, arXiv: 2503.11579(2025)."},{"key":"10.1016\/j.inffus.2026.104208_bib0029","doi-asserted-by":"crossref","first-page":"149","DOI":"10.1016\/j.matcom.2024.07.039","article-title":"Robust anti-disturbance interval type-2 fuzzy control for interconnected nonlinear PDE systems via conjunct observer","volume":"227","author":"Song","year":"2025","journal-title":"Math. Comput. Simul."},{"issue":"16","key":"10.1016\/j.inffus.2026.104208_bib0030","doi-asserted-by":"crossref","first-page":"10990","DOI":"10.1002\/rnc.7553","article-title":"Interval observer design for unobservable switched nonlinear partial differential equation systems and its application","volume":"34","author":"Song","year":"2024","journal-title":"Int. J. Robust Nonlinear Contr."},{"key":"10.1016\/j.inffus.2026.104208_bib0031","series-title":"Advances in Neural Information Processing Systems","article-title":"Pointmamba: a simple state space model for point cloud analysis","author":"Liang","year":"2024"},{"key":"10.1016\/j.inffus.2026.104208_bib0032","unstructured":"T. Zhang, X. Li, H. Yuan, S. Ji, S. Yan, Point could mamba: point cloud learning via state space model, arXiv: 2403.00762(2024)."},{"key":"10.1016\/j.inffus.2026.104208_bib0033","unstructured":"Y. Li, W. Yang, B. Fei, 3dmambacomplete: exploring structured state space model for point cloud completion, arXiv: 2404.07106(2024)."},{"key":"10.1016\/j.inffus.2026.104208_bib0034","unstructured":"Y. Qiao, Z. Yu, L. Guo, S. Chen, Z. Zhao, M. Sun, Q. Wu, J. Liu, Vl-mamba: exploring state space models for multimodal learning, arXiv: 2403.13600(2024)."},{"issue":"1","key":"10.1016\/j.inffus.2026.104208_bib0035","doi-asserted-by":"crossref","first-page":"231","DOI":"10.1109\/JAS.2023.123432","article-title":"Point cloud classification using content-based transformer via clustering in feature space","volume":"11","author":"Liu","year":"2023","journal-title":"IEEE\/CAA J. Autom. Sin."},{"key":"10.1016\/j.inffus.2026.104208_bib0036","series-title":"Proceedings of the IEEE\/CVF International Conference on Computer Vision","first-page":"16259","article-title":"Point transformer","author":"Zhao","year":"2021"},{"key":"10.1016\/j.inffus.2026.104208_bib0037","series-title":"European Conference on Computer Vision","first-page":"604","article-title":"Masked autoencoders for point cloud self-supervised learning","author":"Pang","year":"2022"},{"key":"10.1016\/j.inffus.2026.104208_bib0038","first-page":"27061","article-title":"Point-m2ae: multi-scale masked autoencoders for hierarchical point cloud pre-training","volume":"35","author":"Zhang","year":"2022","journal-title":"Adv. Neural Inf. Process. Syst."},{"key":"10.1016\/j.inffus.2026.104208_bib0039","doi-asserted-by":"crossref","DOI":"10.1016\/j.displa.2023.102610","article-title":"PCTN: point cloud data transformation network","volume":"81","author":"Wang","year":"2024","journal-title":"Displays"},{"key":"10.1016\/j.inffus.2026.104208_bib0040","article-title":"Attention is all you need","volume":"30","author":"Vaswani","year":"2017","journal-title":"Adv. Neural Inf. Process. Syst."},{"key":"10.1016\/j.inffus.2026.104208_bib0041","series-title":"Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition","first-page":"19313","article-title":"Point-bert: pre-training 3d point cloud transformers with masked point modeling","author":"Yu","year":"2022"},{"key":"10.1016\/j.inffus.2026.104208_sbref0042","series-title":"ACM Multimedia","article-title":"Mamba3d: enhancing local features for 3D point cloud analysis via state space model","author":"Han","year":"2024"},{"key":"10.1016\/j.inffus.2026.104208_bib0043","series-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","first-page":"1912","article-title":"3d shapenets: a deep representation for volumetric shapes","author":"Wu","year":"2015"},{"key":"10.1016\/j.inffus.2026.104208_bib0044","series-title":"Proceedings of the IEEE\/CVF International Conference on Computer Vision","first-page":"1588","article-title":"Revisiting point cloud classification: a new benchmark dataset and classification model on real-world data","author":"Uy","year":"2019"},{"issue":"6","key":"10.1016\/j.inffus.2026.104208_bib0045","doi-asserted-by":"crossref","first-page":"1","DOI":"10.1145\/2980179.2980238","article-title":"A scalable active framework for region annotation in 3d shape collections","volume":"35","author":"Yi","year":"2016","journal-title":"ACM Trans. Graph."},{"key":"10.1016\/j.inffus.2026.104208_bib0046","series-title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","first-page":"1534","article-title":"3d semantic parsing of large-scale indoor spaces","author":"Armeni","year":"2016"},{"key":"10.1016\/j.inffus.2026.104208_bib0047","series-title":"Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition","first-page":"5333","article-title":"Attention-based point cloud edge sampling","author":"Wu","year":"2023"},{"key":"10.1016\/j.inffus.2026.104208_bib0048","doi-asserted-by":"crossref","DOI":"10.1016\/j.patcog.2023.109800","article-title":"MKConv: multidimensional feature representation for point cloud analysis","volume":"143","author":"Woo","year":"2023","journal-title":"Pattern Recognit."},{"key":"10.1016\/j.inffus.2026.104208_bib0049","series-title":"Proceedings of the IEEE\/CVF International Conference on Computer Vision","first-page":"6411","article-title":"Kpconv: flexible and deformable convolution for point clouds","author":"Thomas","year":"2019"},{"key":"10.1016\/j.inffus.2026.104208_bib0050","series-title":"Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition","first-page":"8489","article-title":"Contrastive boundary learning for point cloud segmentation","author":"Tang","year":"2022"},{"key":"10.1016\/j.inffus.2026.104208_bib0051","article-title":"A large-scale network construction and lightweighting method for point cloud semantic segmentation","author":"Han","year":"2024","journal-title":"IEEE Trans. Image Process."},{"key":"10.1016\/j.inffus.2026.104208_bib0052","article-title":"A computer oriented geodetic data base and a new technique in file sequencing","author":"Morton","year":"1966","journal-title":"IBM Ltd., Ottawa"},{"key":"10.1016\/j.inffus.2026.104208_bib0053","first-page":"1","article-title":"\u00dcber die stetige abbildung einer linie auf ein fl\u00e4chenst\u00fcck","author":"Hilbert","year":"1935","journal-title":"Dritter Band: Analysis\u00b7 Grundlagen der Mathematik\u00b7 Physik Verschiedenes: Nebst Einer Lebensgeschichte"}],"container-title":["Information Fusion"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S1566253526000874?httpAccept=text\/xml","content-type":"text\/xml","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S1566253526000874?httpAccept=text\/plain","content-type":"text\/plain","content-version":"vor","intended-application":"text-mining"}],"deposited":{"date-parts":[[2026,5,1]],"date-time":"2026-05-01T07:12:18Z","timestamp":1777619538000},"score":1,"resource":{"primary":{"URL":"https:\/\/linkinghub.elsevier.com\/retrieve\/pii\/S1566253526000874"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,8]]},"references-count":53,"alternative-id":["S1566253526000874"],"URL":"https:\/\/doi.org\/10.1016\/j.inffus.2026.104208","relation":{},"ISSN":["1566-2535"],"issn-type":[{"value":"1566-2535","type":"print"}],"subject":[],"published":{"date-parts":[[2026,8]]},"assertion":[{"value":"Elsevier","name":"publisher","label":"This article is maintained by"},{"value":"Cross-modal contrastive learning for 3D point cloud-text fusion via implicit semantic alignment","name":"articletitle","label":"Article Title"},{"value":"Information Fusion","name":"journaltitle","label":"Journal Title"},{"value":"https:\/\/doi.org\/10.1016\/j.inffus.2026.104208","name":"articlelink","label":"CrossRef DOI link to publisher maintained version"},{"value":"article","name":"content_type","label":"Content Type"},{"value":"\u00a9 2026 Elsevier B.V. All rights are reserved, including those for text and data mining, AI training, and similar technologies.","name":"copyright","label":"Copyright"}],"article-number":"104208"}}