{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,4,14]],"date-time":"2026-04-14T11:51:39Z","timestamp":1776167499141,"version":"3.50.1"},"reference-count":65,"publisher":"Springer Science and Business Media LLC","issue":"1","license":[{"start":{"date-parts":[[2026,3,6]],"date-time":"2026-03-06T00:00:00Z","timestamp":1772755200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by-nc-nd\/4.0"},{"start":{"date-parts":[[2026,4,14]],"date-time":"2026-04-14T00:00:00Z","timestamp":1776124800000},"content-version":"vor","delay-in-days":39,"URL":"https:\/\/creativecommons.org\/licenses\/by-nc-nd\/4.0"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["J Cloud Comp"],"DOI":"10.1186\/s13677-026-00872-y","type":"journal-article","created":{"date-parts":[[2026,3,6]],"date-time":"2026-03-06T16:07:56Z","timestamp":1772813276000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":0,"title":["LMM-guided knowledge distillation for power operation object detection in cloud-edge environment"],"prefix":"10.1186","volume":"15","author":[{"given":"Bingyang","family":"Li","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Xiangyang","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Lin","family":"Li","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jingjing","family":"Du","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Pan","family":"Wang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2026,3,6]]},"reference":[{"issue":"3","key":"872_CR1","doi-asserted-by":"publisher","first-page":"2204","DOI":"10.1109\/TII.2020.2998818","volume":"17","author":"J Yang","year":"2020","unstructured":"Yang J, Wang C, Jiang B, Song H, Meng Q (2020) Visual perception enabled industry intelligence: state of the art, challenges and prospects. IEEE Trans Ind Inf 17(3):2204\u20132219","journal-title":"IEEE Trans Ind Inf"},{"issue":"3","key":"872_CR2","doi-asserted-by":"publisher","first-page":"1864","DOI":"10.1109\/LRA.2018.2795645","volume":"3","author":"D Kappler","year":"2018","unstructured":"Kappler D, Meier F, Issac J, Mainprice J, Cifuentes CG, W\u00fcthrich M, Berenz V, Schaal S, Ratliff N, Bohg J (2018) Real-time perception meets reactive motion generation. IEEE Robot Automation Lett 3(3):1864\u20131871","journal-title":"IEEE Robot Automation Lett"},{"key":"872_CR3","first-page":"1","volume":"71","author":"C Xu","year":"2022","unstructured":"Xu C, Li Q, Zhou Q, Zhang S, Yu D, Ma Y (2022) Power line-guided automatic electric transmission line inspection system. IEEE Trans Instrum Meas 71:1\u201318","journal-title":"IEEE Trans Instrum Meas"},{"issue":"3","key":"872_CR4","doi-asserted-by":"publisher","first-page":"725","DOI":"10.1109\/TCSVT.2019.2897984","volume":"30","author":"K Liao","year":"2019","unstructured":"Liao K, Lin C, Zhao Y, Gabbouj M (2019) Dr-gan: automatic radial distortion rectification using conditional gan in real-time. IEEE Trans Circuits Syst Video Technol 30(3):725\u2013733","journal-title":"IEEE Trans Circuits Syst Video Technol"},{"key":"872_CR5","doi-asserted-by":"crossref","unstructured":"Ye Q, Xu H, Ye J, Yan M, Hu A, Liu H, Qian Q, Zhang J, Huang F (2024) Mplug-owl2: revolutionizing multi-modal large language model with modality collaboration. In Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp 13040\u201313051","DOI":"10.1109\/CVPR52733.2024.01239"},{"key":"872_CR6","doi-asserted-by":"publisher","first-page":"42816","DOI":"10.1109\/ACCESS.2024.3378568","volume":"12","author":"M Hussain","year":"2024","unstructured":"Hussain M (2024) Yolov1 to v8: unveiling each variant\u2013a comprehensive review of yolo. IEEE Access. 12:42816\u201342833","journal-title":"IEEE Access."},{"key":"872_CR7","doi-asserted-by":"crossref","unstructured":"Wu J, Gan W, Chen Z, Wan S, Yu PS (2023) Multimodal large language models: A survey. In 2023 IEEE International Conference on Big Data (BigData), IEEE, pp. 2247\u20132256","DOI":"10.1109\/BigData59044.2023.10386743"},{"issue":"22","key":"872_CR8","doi-asserted-by":"publisher","first-page":"22184","DOI":"10.1109\/JIOT.2021.3103138","volume":"9","author":"J Zhang","year":"2021","unstructured":"Zhang J, Bhuiyan MZA, Yang X, Wang T, Xu X, Hayajneh T, Khan F (2021) Anticoncealer: reliable detection of adversary concealed behaviors in edgeaiassisted iot. IEEE Internet Things J 9(22):22184\u201322193","journal-title":"IEEE Internet Things J"},{"key":"872_CR9","doi-asserted-by":"crossref","unstructured":"Li Z, Yang B, Liu Q, Ma Z, Zhang S, Yang J, Sun Y, Liu Y, Bai X (2024) Monkey: image resolution and text label are important things for large multimodal models. In Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp 26763\u201326773","DOI":"10.1109\/CVPR52733.2024.02527"},{"issue":"4","key":"872_CR10","doi-asserted-by":"publisher","first-page":"447","DOI":"10.1007\/s11633-022-1410-8","volume":"20","author":"X Wang","year":"2023","unstructured":"Wang X, Chen G, Qian G, Gao P, Wei X-Y, Wang Y, Tian Y, Gao W (2023) Large-scale multi-modal pre-trained models: A comprehensive survey. Mach Intel Res 20(4):447\u2013482","journal-title":"Mach Intel Res"},{"issue":"3","key":"872_CR11","first-page":"3200","volume":"45","author":"Z Sun","year":"2022","unstructured":"Sun Z, Ke Q, Rahmani H, Bennamoun M, Wang G, Liu J (2022) Human action recognition from various data modalities: a review. IEEE T Pattern Anal 45(3):3200\u20133225","journal-title":"Ieee T Pattern Anal"},{"key":"872_CR12","doi-asserted-by":"crossref","unstructured":"Liu Y, Duan H, Zhang Y, Li B, Zhang S, Zhao W, Yuan Y, Wang J, He C, Liu Z et al (2024) Mmbench: is your multi-modal model an all-around player? In European Conference on Computer Vision, Springer, pp. 216\u2013233","DOI":"10.1007\/978-3-031-72658-3_13"},{"issue":"4","key":"872_CR13","doi-asserted-by":"crossref","first-page":"379","DOI":"10.1049\/iet-cvi.2018.5325","volume":"13","author":"Y Wang","year":"2019","unstructured":"Wang Y, Zhang J, Li X (2019) Efficient complex isar object recognition using adaptive deep relation learning. IET Comput Vision 13(4):379\u2013387","journal-title":"IET Comput Vision"},{"key":"872_CR14","doi-asserted-by":"crossref","unstructured":"Chen L, Li J, Dong X, Zhang P, He C, Wang J, Zhao F, Lin D (2024) Sharegpt4v: improving large multi-modal models with better captions. In European Conference on Computer Vision, Springer, pp. 370\u2013387","DOI":"10.1007\/978-3-031-72643-9_22"},{"key":"872_CR15","doi-asserted-by":"crossref","unstructured":"Tang P, Wang X, Wang A, Yan Y, Liu W, Huang J, Yuille A (2018) Weakly supervised region proposal network and object detection. In Proceedings of the European Conference on Computer Vision (ECCV), pp 352\u2013368","DOI":"10.1007\/978-3-030-01252-6_22"},{"key":"872_CR16","doi-asserted-by":"crossref","unstructured":"Xie X, Cheng G, Wang J, Yao X, Han J (2021) Oriented r-cnn for object detection. In Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp 3520\u20133529","DOI":"10.1109\/ICCV48922.2021.00350"},{"key":"872_CR17","doi-asserted-by":"crossref","unstructured":"He K, Gkioxari G, Doll\u00e1r P, Girshick R (2017) Mask r-cnn. In Proceedings of the IEEE International Conference on Computer Vision, pp 2961\u20132969","DOI":"10.1109\/ICCV.2017.322"},{"issue":"8","key":"872_CR18","first-page":"3769","volume":"12","author":"S-N Huang","year":"2018","unstructured":"Huang S-N, Huang D-J, Khuhro MA (2018) Social pedestrian group detection based on spatiotemporal-oriented energy for crowd video understanding. KSII Trans Internet Inf Syst 12(8):3769\u20133789","journal-title":"KSII Trans Internet Inf Syst"},{"key":"872_CR19","doi-asserted-by":"crossref","unstructured":"Girshick R (2015) Fast r-cnn. In Proceedings of the IEEE International Conference on Computer Vision, pp 1440\u20131448","DOI":"10.1109\/ICCV.2015.169"},{"key":"872_CR20","doi-asserted-by":"crossref","unstructured":"Sarma K, Sasikala C, Surendra K, Erukala S, Aruna S (2024) A comparative study on faster r-cnn, yolo and ssd object detection algorithms on hids system. In AIP Conference Proceedings, vol 2971. AIP Publishing LLC, p. 060044","DOI":"10.1063\/5.0195857"},{"key":"872_CR21","first-page":"0073","volume":"1613","author":"X Wang","year":"2023","unstructured":"Wang X, Li H, Yue X, Meng L (2023) A comprehensive survey on object detection yolo. Proceedings 1613:0073. http:\/\/ceur-ws.orgISSN","journal-title":"Proceedings"},{"issue":"4","key":"872_CR22","doi-asserted-by":"publisher","first-page":"1115","DOI":"10.1007\/s11554-021-01105-y","volume":"18","author":"Y Tong","year":"2021","unstructured":"Tong Y, Sun W (2021) The role of film and television big data in real-time image detection and processing in the internet of things era. J Real Time Image Process 18(4):1115\u20131127","journal-title":"J Real Time Image Process"},{"issue":"2","key":"872_CR23","doi-asserted-by":"publisher","first-page":"338","DOI":"10.1109\/TCC.2015.2511764","volume":"8","author":"L Qi","year":"2015","unstructured":"Qi L, Dou W, Hu C, Zhou Y, Yu J (2015) A context-aware service evaluation approach over big data for cloud applications. IEEE Trans Cloud Comput 8(2):338\u2013348","journal-title":"IEEE Trans Cloud Comput"},{"key":"872_CR24","doi-asserted-by":"crossref","unstructured":"Sarwar N, Alharthi RS, Mujlid HM, Almalki FA (2025) Enhancing iot communication in fog computing: a lightweight remote user authentication and key management scheme utilizing ecc. J Cloud Comput","DOI":"10.1186\/s13677-025-00816-y"},{"key":"872_CR25","volume-title":"Group collaborative unsupervised deep metric learning for feature embedding","author":"Z Chen","year":"2025","unstructured":"Chen Z, Kan S, Li M (2025) Group collaborative unsupervised deep metric learning for feature embedding. Tsinghua Sci Technol"},{"issue":"6","key":"872_CR26","doi-asserted-by":"publisher","first-page":"1307","DOI":"10.26599\/BDMA.2025.9020025","volume":"8","author":"X Jia","year":"2025","unstructured":"Jia X, Gu B, Chen J, Gao L, Pang W, Lv G, Qu Y, Cui L (2025) Dynamic batch processing with flexidecode scheduler for efficient llm inference in iiot. Big Data Min Analytics 8(6):1307\u20131323","journal-title":"Big Data Min Analytics"},{"key":"872_CR27","volume-title":"Kdllm: copyrightpreserving llm based on knowledge distillation","author":"S Shrestha","year":"2025","unstructured":"Shrestha S, Xu H, Xie Z, Seo D, Joe Y, Kim W, Li Y (2025) Kdllm: copyrightpreserving llm based on knowledge distillation. Tsinghua Sci Technol"},{"issue":"3","key":"872_CR28","doi-asserted-by":"publisher","first-page":"1365","DOI":"10.26599\/TST.2025.9010166","volume":"31","author":"G Cai","year":"2026","unstructured":"Cai G, Tian R, Yang L, Jia Y, Li L, Wang J (2026) Efficient inference for edge large language models: a survey. Tsinghua Sci Technol 31(3):1365\u20131380","journal-title":"Tsinghua Sci Technol"},{"issue":"2","key":"872_CR29","doi-asserted-by":"publisher","first-page":"496","DOI":"10.26599\/BDMA.2024.9020090","volume":"8","author":"P Wang","year":"2025","unstructured":"Wang P, Lu W, Lu C, Zhou R, Li M, Qin L (2025) Large language model for medical images: a survey of taxonomy, systematic review, and future trends. Big Data Min Analytics 8(2):496\u2013517","journal-title":"Big Data Min Analytics"},{"key":"872_CR30","volume-title":"Ft-hashrag: combining hash retrieval-augmented generation with fine-tuning for universal explainable recommendation","author":"Z Zhang","year":"2025","unstructured":"Zhang Z, Hao B, Wang Y, Wei X, Niu Q, Li Y (2025) Ft-hashrag: combining hash retrieval-augmented generation with fine-tuning for universal explainable recommendation. Tsinghua Sci Technol"},{"issue":"3","key":"872_CR31","doi-asserted-by":"publisher","first-page":"534","DOI":"10.26599\/BDMA.2024.9020076","volume":"8","author":"R Wei","year":"2025","unstructured":"Wei R, Yan R, Qu H, Li X, Ye Q, Fu L (2025) Svmfn-fsar: semantic-guided video multimodal fusion network for few-shot action recognition. Big Data Min Analytics 8(3):534\u2013550","journal-title":"Big Data Min Analytics"},{"key":"872_CR32","doi-asserted-by":"crossref","unstructured":"Redmon J, Farhadi A (2017) Yolo9000: better, faster, stronger. In Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp 7263\u20137271","DOI":"10.1109\/CVPR.2017.690"},{"key":"872_CR33","doi-asserted-by":"crossref","unstructured":"Shen T, Wang H, Qin C, Sun R, Song Y, Lian D, Zhu H, Chen E (2025) Prompting is not enough: exploring knowledge integration and controllable generation on large language models. Big Data Min Analytics","DOI":"10.26599\/BDMA.2025.9020052"},{"issue":"9","key":"872_CR34","doi-asserted-by":"publisher","first-page":"28039","DOI":"10.1007\/s11042-023-16570-9","volume":"83","author":"B Xiao","year":"2024","unstructured":"Xiao B, Nguyen M, Yan WQ (2024) Fruit ripeness identification using yolov8 model. Multimedia Tools Appl 83(9):28039\u201328056","journal-title":"Multimedia Tools Appl"},{"key":"872_CR35","doi-asserted-by":"publisher","first-page":"63754","DOI":"10.1109\/ACCESS.2024.3396224","volume":"12","author":"ZJ Khow","year":"2024","unstructured":"Khow ZJ, Tan Y-F, Karim HA, Rashid HAA (2024) Improved yolov8 model for a comprehensive approach to object detection and distance estimation. IEEE Access 12:63754\u201363767","journal-title":"IEEE Access"},{"key":"872_CR36","unstructured":"Koroteev MV (2021) Bert: a review of applications in natural language processing and understanding. arXiv preprint arXiv:2103.11943"},{"key":"872_CR37","doi-asserted-by":"crossref","unstructured":"Lewis M, Liu Y, Goyal N, Ghazvininejad M, Mohamed A, Levy O, Stoyanov V, Zettlemoyer L (2020) Bart: denoising sequence-to-sequence pre-training for natural language generation, translation, and comprehension. In Proceedings of the 58th Annual Meeting of the Association for Computational Linguistics, pp 7871\u20137880","DOI":"10.18653\/v1\/2020.acl-main.703"},{"issue":"1","key":"872_CR38","doi-asserted-by":"publisher","first-page":"61","DOI":"10.1186\/s13677-025-00791-4","volume":"14","author":"C Song","year":"2025","unstructured":"Song C, Yu H, Gil J-M (2025) Mkrp: multiple k registry placement for fast container deployment on edge computing. J Cloud Comput 14(1):61","journal-title":"J Cloud Comput"},{"key":"872_CR39","unstructured":"Achiam J, Adler S, Agarwal S, Ahmad L, Akkaya I, Aleman FL, Almeida D, Altenschmidt J, Altman S, Anadkat S et al (2023) Gpt-4 technical report. arXiv preprint arXiv: 2303.08774"},{"key":"872_CR40","unstructured":"Touvron H, Lavril T, Izacard G, Martinet X, Lachaux M-A, Lacroix T, Rozi\u00e8re B, Goyal N, Hambro E, Azhar F et al (2023) Llama: open and efficient foundation language models. arXiv preprint arXiv:2302.13971"},{"key":"872_CR41","doi-asserted-by":"publisher","first-page":"102473","DOI":"10.1016\/j.compmedimag.2024.102473","volume":"119","author":"M Ali","year":"2025","unstructured":"Ali M, Wu T, Hu H, Luo Q, Xu D, Zheng W, Jin N, Yang C, Yao J (2025) A review of the segment anything model (sam) for medical image analysis: accomplishments and perspectives. Computerized Med Imag Graphics 119:102473","journal-title":"Computerized Med Imag Graphics"},{"key":"872_CR42","doi-asserted-by":"crossref","unstructured":"Zhang D, Yu Y, Dong J, Li C, Su D, Chu C, Yu D (2024) Mm-llms: recent advances in multimodal large language models. arXiv preprint arXiv:2401.13601","DOI":"10.18653\/v1\/2024.findings-acl.738"},{"issue":"1","key":"872_CR43","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3771772","volume":"44","author":"L Qi","year":"2025","unstructured":"Qi L, Xie J, Hu C, Xu X, Xiang H, Dai H, Gu R, Zhang X, Dou W (2025) Knowledge-driven reasoning for compatible and interpretable api recommendation via teacher llm distillation. ACM Trans Inf Syst 44(1):1\u201330","journal-title":"ACM Trans Inf Syst"},{"key":"872_CR44","unstructured":"Wu S, Fei H, Qu L, Ji W, Chua T-S (2024) Next-gpt: any-to-any multimodal llm. In Forty-first International Conference on Machine Learning"},{"issue":"6","key":"872_CR45","doi-asserted-by":"publisher","first-page":"103510","DOI":"10.1016\/j.ipm.2023.103510","volume":"60","author":"S Qi","year":"2023","unstructured":"Qi S, Cao Z, Rao J, Wang L, Xiao J, Wang X (2023) What is the limitation of multimodal llms? a deeper look into multimodal llms through prompt probing. Inf Process Manag 60(6):103510","journal-title":"Inf Process Manag"},{"key":"872_CR46","unstructured":"Bai S, Chen K, Liu X, Wang J, Ge W, Song S, Dang K, Wang P, Wang S, Tang J et al (2025) Qwen2. 5-vl technical report. arXiv preprint arXiv: 2502.13923"},{"issue":"2","key":"872_CR47","doi-asserted-by":"publisher","first-page":"771","DOI":"10.1109\/TCSS.2022.3168595","volume":"10","author":"S Wu","year":"2022","unstructured":"Wu S, Shen S, Xu X, Chen Y, Zhou X, Liu D, Xue X, Qi L (2022) Popularityaware and diverse web apis recommendation based on correlation graph. IEEE Trans Comput Soc Syst 10(2):771\u2013782","journal-title":"IEEE Trans Comput Soc Syst"},{"key":"872_CR48","doi-asserted-by":"crossref","unstructured":"Wu K, Peng H, Chen M, Fu J, Chao H (2021) Rethinking and improving relative position encoding for vision transformer. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 10033\u201310041","DOI":"10.1109\/ICCV48922.2021.00988"},{"issue":"4","key":"872_CR49","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3620677","volume":"15","author":"Y Liu","year":"2024","unstructured":"Liu Y, Zhou X, Kou H, Zhao Y, Xu X, Zhang X, Qi L (2024) Privacy-preserving point-of-interest recommendation based on simplified graph convolutional network for geological traveling. ACM Trans Intell Syst Technol 15(4):1\u201317","journal-title":"ACM Trans Intell Syst Technol"},{"key":"872_CR50","unstructured":"Hong W, Yu W, Gu X, Wang G, Gan G, Tang H, Cheng J, Qi J, Ji J, Pan L et al (2025) Glm-4.1 v-thinking: towards versatile multimodal reasoning with scalable reinforcement learning. arXiv e-prints, 2507"},{"key":"872_CR51","doi-asserted-by":"crossref","unstructured":"Liu S, Zeng Z, Ren T, Li F, Zhang H, Yang J, Jiang Q, Li C, Yang J, Su H et al (2024) Grounding dino: marrying dino with grounded pre-training for open-set object detection. In European Conference on Computer Vision, Springer, pp. 38\u201355","DOI":"10.1007\/978-3-031-72970-6_3"},{"key":"872_CR52","doi-asserted-by":"crossref","unstructured":"Qi L, Yan B, Wang W, Hu C, Dai F, Xu X, Dou W, Zhou X (2025) St-bernt: a spatiotemporal $$\\lambda$$-bernstein graph convolutional network with transformer for multi-site air quality prediction in distributed unmanned agent systems. IEEE Internet Things J","DOI":"10.1109\/JIOT.2025.3617922"},{"key":"872_CR53","doi-asserted-by":"crossref","unstructured":"Li LH, Zhang P, Zhang H, Yang J, Li C, Zhong Y, Wang L, Yuan L, Zhang L, Hwang J-N et al (2022) Grounded language-image pre-training. In Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp 10965\u201310975","DOI":"10.1109\/CVPR52688.2022.01069"},{"key":"872_CR54","doi-asserted-by":"crossref","unstructured":"Xu X, Hu Y, Cui G, Qi L, Dou W, Cai Z (2025) Cadec: a combinatorial auction for dynamic distributed dnn inference scheduling in edge-cloud networks. In: IEEE Transactions on Mobile Computing","DOI":"10.1109\/TMC.2025.3567459"},{"issue":"6","key":"872_CR55","first-page":"5444","volume":"35","author":"L Qi","year":"2022","unstructured":"Qi L, Lin W, Zhang X, Dou W, Xu X, Chen J (2022) A correlation graph based approach for personalized and compatible web apis recommendation in mobile app development. IEEE Trans Knowl Data Eng 35(6):5444\u20135457","journal-title":"IEEE Trans Knowl Data Eng"},{"key":"872_CR56","doi-asserted-by":"crossref","unstructured":"Gu R, Wang S, Dai H, Chen X, Wang Z, Bao W, Zheng J, Tu Y, Huang Y, Qi L et al (2024) Fluid-shuttle: efficient cloud data transmission based on serverless computing compression. In IEEE\/ACM Transactions on Networking","DOI":"10.1109\/TNET.2024.3402561"},{"issue":"10","key":"872_CR57","doi-asserted-by":"publisher","first-page":"3161","DOI":"10.1109\/JSAC.2023.3310077","volume":"41","author":"L Qi","year":"2023","unstructured":"Qi L, Xu X, Wu X, Ni Q, Yuan Y, Zhang X (2023) Digital-twin-enabled 6g mobile network video streaming using mobile crowdsourcing. IEEE J Sel Areas Commun 41(10):3161\u20133174","journal-title":"IEEE J Sel Areas Commun"},{"issue":"6","key":"872_CR58","first-page":"1","volume":"43","author":"F Wang","year":"2025","unstructured":"Wang F, Qi L, Liu W, Yu B, Chen J, Xu Y (2025) Inter-and intra-similarity preserved counterfactual incentive effect estimation for recommendation systems. ACM Trans Inf Syst 43(6):1\u201324","journal-title":"ACM Trans Inf Syst"},{"key":"872_CR59","unstructured":"Ren S, He K, Girshick R, Sun J (2015) Faster r-cnn: towards real-time object detection with region proposal networks. Adv Neural Inf Process Syst 28"},{"key":"872_CR60","doi-asserted-by":"crossref","unstructured":"Chen H, Wang Y, Wang G, Qiao Y (2018) Lstd: a low-shot transfer detector for object detection. Proc The AAAI Conf Artif Intel 32","DOI":"10.1609\/aaai.v32i1.11716"},{"key":"872_CR61","doi-asserted-by":"crossref","unstructured":"Kang B, Liu Z, Wang X, Yu F, Feng J, Darrell T (2019) Few-shot object detection via feature reweighting. In Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp 8420\u20138429","DOI":"10.1109\/ICCV.2019.00851"},{"key":"872_CR62","doi-asserted-by":"crossref","unstructured":"Qiao L, Zhao Y, Li Z, Qiu X, Wu J, Zhang C (2021) Defrcn: decoupled faster rcnn for few-shot object detection. In Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp 8681\u20138690","DOI":"10.1109\/ICCV48922.2021.00856"},{"key":"872_CR63","doi-asserted-by":"publisher","first-page":"390","DOI":"10.1016\/j.neucom.2021.04.116","volume":"455","author":"H Yang","year":"2021","unstructured":"Yang H, Lin Y, Zhang H, Zhang Y, Xu B (2021) Towards improving classification power for one-shot object detection. Neurocomputing 455:390\u2013400","journal-title":"Neurocomputing"},{"key":"872_CR64","doi-asserted-by":"crossref","unstructured":"Chen Y, Chen Q, Hu Q, Cheng J (2025) Dual assignment of labels for end-to-end fully convolutional object detection. Pattern Recognit 111877","DOI":"10.1016\/j.patcog.2025.111877"},{"key":"872_CR65","doi-asserted-by":"crossref","unstructured":"Wu X, Sahoo D, Hoi S (2020) Meta-rcnn: meta learning for few-shot object detection. In Proceedings of the 28th ACM International Conference on Multimedia, pp 1679\u20131687","DOI":"10.1145\/3394171.3413832"}],"container-title":["Journal of Cloud Computing"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/article\/10.1186\/s13677-026-00872-y","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1186\/s13677-026-00872-y.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1186\/s13677-026-00872-y.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,4,14]],"date-time":"2026-04-14T10:57:14Z","timestamp":1776164234000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1186\/s13677-026-00872-y"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,3,6]]},"references-count":65,"journal-issue":{"issue":"1","published-online":{"date-parts":[[2026,12]]}},"alternative-id":["872"],"URL":"https:\/\/doi.org\/10.1186\/s13677-026-00872-y","relation":{},"ISSN":["2192-113X"],"issn-type":[{"value":"2192-113X","type":"electronic"}],"subject":[],"published":{"date-parts":[[2026,3,6]]},"assertion":[{"value":"8 January 2026","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"15 February 2026","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"6 March 2026","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"No GenAI tools to generate scientific content have been used. Some standard AI tools such as Grammarly for grammatical corrections have been applied.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Disclosure"}},{"value":"The authors declare no competing interests.","order":3,"name":"Ethics","group":{"name":"EthicsHeading","label":"Competing interests"}}],"article-number":"59"}}