{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,3,23]],"date-time":"2026-03-23T16:59:51Z","timestamp":1774285191211,"version":"3.50.1"},"reference-count":94,"publisher":"Springer Science and Business Media LLC","issue":"17","license":[{"start":{"date-parts":[[2024,7,9]],"date-time":"2024-07-09T00:00:00Z","timestamp":1720483200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,7,9]],"date-time":"2024-07-09T00:00:00Z","timestamp":1720483200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimed Tools Appl"],"DOI":"10.1007\/s11042-024-19731-6","type":"journal-article","created":{"date-parts":[[2024,7,9]],"date-time":"2024-07-09T08:02:01Z","timestamp":1720512121000},"page":"18263-18304","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":7,"title":["SORDI.ai: large-scale synthetic object recognition dataset generation for industries"],"prefix":"10.1007","volume":"84","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-2426-0857","authenticated-orcid":false,"given":"Chafic","family":"Abou\u00a0Akar","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Jimmy","family":"Tekli","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Joe","family":"Khalil","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Anthony","family":"Yaghi","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Youssef","family":"Haddad","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Abdallah","family":"Makhoul","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Marc","family":"Kamradt","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2024,7,9]]},"reference":[{"issue":"4","key":"19731_CR1","doi-asserted-by":"publisher","first-page":"917","DOI":"10.1287\/trsc.2018.0873","volume":"53","author":"K Azadeh","year":"2019","unstructured":"Azadeh K, De Koster R, Roy D (2019) Robotized and automated warehouse systems: Review and recent developments. Transp Sci 53(4):917\u2013945","journal-title":"Transp Sci"},{"key":"19731_CR2","unstructured":"Rutinowski J, Youssef H, Gouda A, Reining C, Roidl M (2022) The potential of deep learning based computer vision in warehousing logistics. Logistics Journal: Proceedings 2022(18)"},{"key":"19731_CR3","unstructured":"Naumann A, Hertlein F, Doerr L, Thoma S, Furmans K (2023) Literature review: Computer vision applications in transportation logistics and warehousing. arXiv preprint arXiv:2304.06009"},{"issue":"2","key":"19731_CR4","doi-asserted-by":"publisher","first-page":"937","DOI":"10.3390\/app12020937","volume":"12","author":"J Arents","year":"2022","unstructured":"Arents J, Greitans M (2022) Smart industrial robot control trends, challenges and opportunities within manufacturing. Appl Sci 12(2):937","journal-title":"Appl Sci"},{"key":"19731_CR5","doi-asserted-by":"crossref","unstructured":"Zhou L, Zhang L, Konz N (2022) Computer vision techniques in manufacturing. IEEE Transactions on Systems, Man, and Cybernetics: Systems","DOI":"10.36227\/techrxiv.17125652.v2"},{"key":"19731_CR6","doi-asserted-by":"publisher","first-page":"306","DOI":"10.1016\/j.procs.2022.12.226","volume":"217","author":"S-O Bezrucav","year":"2023","unstructured":"Bezrucav S-O, Mandischer N, Corves B (2023) Artificial intelligence task planning of cooperating low-cost mobile manipulators: A case study on a fully autonomous manufacturing application. Procedia Computer Science 217:306\u2013315","journal-title":"Procedia Computer Science"},{"key":"19731_CR7","doi-asserted-by":"publisher","first-page":"101635","DOI":"10.1016\/j.sysarc.2019.101635","volume":"99","author":"S Mittal","year":"2019","unstructured":"Mittal S, Vaishay S (2019) A survey of techniques for optimizing deep learning on gpus. J Syst Architect 99:101635","journal-title":"J Syst Architect"},{"issue":"6","key":"19731_CR8","doi-asserted-by":"publisher","first-page":"420","DOI":"10.1007\/s42979-021-00815-1","volume":"2","author":"IH Sarker","year":"2021","unstructured":"Sarker IH (2021) Deep learning: a comprehensive overview on techniques, taxonomy, applications and research directions. SN Computer Science 2(6):420","journal-title":"SN Computer Science"},{"issue":"3","key":"19731_CR9","doi-asserted-by":"publisher","first-page":"685","DOI":"10.1007\/s12525-021-00475-2","volume":"31","author":"C Janiesch","year":"2021","unstructured":"Janiesch C, Zschech P, Heinrich K (2021) Machine learning and deep learning. Electron Mark 31(3):685\u2013695","journal-title":"Electron Mark"},{"key":"19731_CR10","doi-asserted-by":"crossref","unstructured":"Sun C, Shrivastava A, Singh S, Gupta A (2017) Revisiting unreasonable effectiveness of data in deep learning era. In: Proceedings of the IEEE international conference on computer vision, pp 843\u2013852","DOI":"10.1109\/ICCV.2017.97"},{"key":"19731_CR11","doi-asserted-by":"publisher","first-page":"129","DOI":"10.1016\/j.neucom.2022.01.022","volume":"495","author":"A Salari","year":"2022","unstructured":"Salari A, Djavadifar A, Liu X, Najjaran H (2022) Object recognition datasets and challenges: A review. Neurocomputing 495:129\u2013152","journal-title":"Neurocomputing"},{"key":"19731_CR12","unstructured":"Andrews J, Zhao D, Thong W, Modas A, Papakyriakopoulos O, Xiang A (2024) Ethical considerations for responsible data curation. Adv Neural Inf Process Syst 36"},{"key":"19731_CR13","doi-asserted-by":"crossref","unstructured":"Abou\u00a0Akar C, Tekli J, Jess D, Khoury M, Kamradt M, Guthe M (2022) Synthetic object recognition dataset for industries. In: 2022 35th SIBGRAPI conference on graphics, patterns and images (SIBGRAPI), vol\u00a01, pp 150\u2013155. IEEE","DOI":"10.1109\/SIBGRAPI55357.2022.9991784"},{"key":"19731_CR14","doi-asserted-by":"crossref","unstructured":"Ayle M, Tekli J, El-Zini J, El-Asmar B, Awad M (2020) Bar-a reinforcement learning agent for bounding-box automated refinement. In: Proceedings of the AAAI conference on artificial intelligence, vol 34, pp 2561\u20132568","DOI":"10.1609\/aaai.v34i03.5639"},{"issue":"27","key":"19731_CR15","doi-asserted-by":"publisher","first-page":"42173","DOI":"10.1007\/s11042-023-14664-y","volume":"82","author":"J Tekli","year":"2023","unstructured":"Tekli J, Al Bouna B, Tekli G, Couturier R (2023) A framework for evaluating image obfuscation under deep learning-assisted privacy attacks. Multimed Tools Appl 82(27):42173\u201342205","journal-title":"Multimed Tools Appl"},{"key":"19731_CR16","doi-asserted-by":"crossref","unstructured":"Tekli J, Al\u00a0Bouna B, Couturier R, Tekli G, Al\u00a0Zein Z, Kamradt M (2019) A framework for evaluating image obfuscation under deep learning-assisted privacy attacks. In: 2019 17th International conference on privacy, security and trust (PST), pp 1\u201310. IEEE","DOI":"10.1109\/PST47121.2019.8949040"},{"key":"19731_CR17","doi-asserted-by":"publisher","first-page":"8","DOI":"10.1186\/s13640-024-00623-6","volume":"1","author":"J Rutinowski","year":"2024","unstructured":"Rutinowski J, Youssef H, Franke S, Priyanta IF, Polachowski F, Roidl M (2024) Reining C (2024) Semi-automated computer vision-based tracking of multiple industrial entities: a framework and dataset creation approach. EURASIP J Image Video Process 1:8","journal-title":"EURASIP J Image Video Process"},{"issue":"23","key":"19731_CR18","doi-asserted-by":"publisher","first-page":"7901","DOI":"10.3390\/s21237901","volume":"21","author":"L Eversberg","year":"2021","unstructured":"Eversberg L, Lambrecht J (2021) Generating images with physics-based rendering for an industrial object detection task: Realism versus domain randomization. Sensors 21(23):7901","journal-title":"Sensors"},{"key":"19731_CR19","doi-asserted-by":"crossref","unstructured":"Tobin J, Fong R, Ray A, Schneider J, Zaremba W, Abbeel P (2017) Domain randomization for transferring deep neural networks from simulation to the real world. In: 2017 IEEE\/RSJ international conference on intelligent robots and systems (IROS), pp 23\u201330. IEEE","DOI":"10.1109\/IROS.2017.8202133"},{"key":"19731_CR20","doi-asserted-by":"crossref","unstructured":"Tremblay J, Prakash A, Acuna D, Brophy M, Jampani V, Anil C, To T, Cameracci E, Boochoon S, Birchfield S (2018a) Training deep networks with synthetic data: Bridging the reality gap by domain randomization. In: Proceedings of the IEEE conference on computer vision and pattern recognition workshops, pp 969\u2013977","DOI":"10.1109\/CVPRW.2018.00143"},{"key":"19731_CR21","doi-asserted-by":"crossref","unstructured":"Tremblay J, To T, Birchfield S (2018b) Falling things: A synthetic dataset for 3d object detection and pose estimation. In: Proceedings of the IEEE conference on computer vision and pattern recognition workshops, pp 2038\u20132041","DOI":"10.1109\/CVPRW.2018.00275"},{"key":"19731_CR22","doi-asserted-by":"publisher","first-page":"434","DOI":"10.1016\/j.procir.2022.05.004","volume":"107","author":"L Block","year":"2022","unstructured":"Block L, Raiser A, Sch\u00f6n L, Braun F, Riedel O (2022) Image-bot: Generating synthetic object detection datasets for small and medium-sized manufacturing companies. Procedia CIRP 107:434\u2013439","journal-title":"Procedia CIRP"},{"key":"19731_CR23","doi-asserted-by":"crossref","unstructured":"Georgakis G, Mousavian A, Berg AC, Kosecka J (2017) Synthesizing training data for object detection in indoor scenes. Robotics: Science and Systems (RSS)","DOI":"10.15607\/RSS.2017.XIII.043"},{"issue":"6","key":"19731_CR24","doi-asserted-by":"publisher","first-page":"3013","DOI":"10.3390\/s23063013","volume":"23","author":"J Dirr","year":"2023","unstructured":"Dirr J, Gebauer D, Yao J, Daub R (2023) Automatic image generation pipeline for instance segmentation of deformable linear objects. Sensors 23(6):3013","journal-title":"Sensors"},{"key":"19731_CR25","doi-asserted-by":"crossref","unstructured":"Greff K, Belletti F, Beyer L, Doersch C, Du Y, Duckworth D, Fleet DJ, Gnanapragasam D, Golemo F, Herrmann C et\u00a0al (2022) Kubric: A scalable dataset generator. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp 3749\u20133761","DOI":"10.1109\/CVPR52688.2022.00373"},{"key":"19731_CR26","unstructured":"Denninger M, Sundermeyer M, Winkelbauer D, Olefir D, Hodan T, Zidan Y, Elbadrawy M, Knauer M, Katam H, Lodhi A (2020) Blenderproc: Reducing the reality gap with photorealistic rendering. In: International Conference on Robotics: Sciene and Systems, RSS 2020"},{"key":"19731_CR27","unstructured":"To T, Tremblay J, McKay D, Yamaguchi Y, Leung K, Balanon A, Cheng J, Hodge W, Birchfield S (2018) Ndds: Nvidia deep learning dataset synthesizer. In: CVPR 2018 workshop on real world challenges and new benchmarks for deep learning in robotic vision, Salt Lake City, UT, June, vol\u00a022"},{"key":"19731_CR28","unstructured":"Borkman S, Crespi A, Dhakad S, Ganguly S, Hogins J, Jhang Y-C, Kamalzadeh M, Li B, Leal S, Parisi P et\u00a0al (2021) Unity perception: Generate synthetic data for computer vision. arXiv preprint arXiv:2107.04259"},{"key":"19731_CR29","doi-asserted-by":"publisher","first-page":"287","DOI":"10.1016\/j.procir.2022.05.251","volume":"109","author":"P Trentsios","year":"2022","unstructured":"Trentsios P, Wolf M, Gerhard D (2022) Overcoming the sim-to-real gap in autonomous robots. Procedia CIRP 109:287\u2013292","journal-title":"Procedia CIRP"},{"key":"19731_CR30","doi-asserted-by":"crossref","unstructured":"Zhao W, Queralta JP, Westerlund T (2020) Sim-to-real transfer in deep reinforcement learning for robotics: a survey. In: 2020 IEEE symposium series on computational intelligence (SSCI), pp 737\u2013744. IEEE","DOI":"10.1109\/SSCI47803.2020.9308468"},{"key":"19731_CR31","doi-asserted-by":"crossref","unstructured":"Gaidon A, Wang Q, Cabon Y, Vig E (2016) Virtual worlds as proxy for multi-object tracking analysis. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 4340\u20134349","DOI":"10.1109\/CVPR.2016.470"},{"key":"19731_CR32","doi-asserted-by":"publisher","first-page":"1101","DOI":"10.1016\/j.procir.2022.05.115","volume":"107","author":"O Schmedemann","year":"2022","unstructured":"Schmedemann O, Baa\u00df M, Schoepflin D, Sch\u00fcppstuhl T (2022) Procedural synthetic training data generation for ai-based defect detection in industrial surface inspection. Procedia CIRP 107:1101\u20131106","journal-title":"Procedia CIRP"},{"issue":"9","key":"19731_CR33","doi-asserted-by":"publisher","first-page":"2180","DOI":"10.1109\/TPAMI.2017.2747150","volume":"40","author":"S Fan","year":"2017","unstructured":"Fan S, Ng T-T, Koenig BL, Herberg JS, Jiang M, Shen Z, Zhao Q (2017) Image visual realism: From human perception to machine computation. IEEE Trans Pattern Anal Mach Intell 40(9):2180\u20132193","journal-title":"IEEE Trans Pattern Anal Mach Intell"},{"key":"19731_CR34","doi-asserted-by":"crossref","unstructured":"Fan S, Ng T-T, Herberg JS, Koenig BL, Tan CY-C, Wang R (2014) An automated estimator of image visual realism based on human cognition. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 4201\u20134208","DOI":"10.1109\/CVPR.2014.535"},{"key":"19731_CR35","unstructured":"Grushko S, Vysock\u1ef3 A, Chlebek J, Prokop P (2023) Hadr: Applying domain randomization for generating synthetic multimodal dataset for hand instance segmentation in cluttered industrial environments. arXiv preprint arXiv:2304.05826"},{"key":"19731_CR36","doi-asserted-by":"crossref","unstructured":"Tsirikoglou A, Eilertsen G, Unger J (2020) A survey of image synthesis methods for visual machine learning. In: Computer graphics forum, vol\u00a039, pp 426\u2013451. Wiley Online Library","DOI":"10.1111\/cgf.14047"},{"key":"19731_CR37","doi-asserted-by":"crossref","unstructured":"Muratore F, Ramos F, Turk G, Yu W, Gienger M, Peters J (2022a) Robot learning from randomized simulations: A review. Frontiers in Robotics and AI, pp\u00a031","DOI":"10.3389\/frobt.2022.799893"},{"key":"19731_CR38","doi-asserted-by":"crossref","unstructured":"Alghonaim R, Johns E (2021) Benchmarking domain randomisation for visual sim-to-real transfer. In: 2021 IEEE international conference on robotics and automation (ICRA), pp 12802\u201312808. IEEE","DOI":"10.1109\/ICRA48506.2021.9561134"},{"key":"19731_CR39","doi-asserted-by":"crossref","unstructured":"Zakharov S, Ambru\u0219 R, Guizilini V, Kehl W, Gaidon A (2022) Photo-realistic neural domain randomization. In: Computer Vision\u2013ECCV 2022: 17th European Conference, Tel Aviv, Israel, October 23\u201327, 2022, Proceedings, Part XXV, pp 310\u2013327. Springer","DOI":"10.1007\/978-3-031-19806-9_18"},{"key":"19731_CR40","unstructured":"Ibrahim T (2022) Guided domain randomization with meta reinforcement learning"},{"key":"19731_CR41","unstructured":"Muratore F, Gruner T, Wiese F, Belousov B, Gienger M, Peters J (2022b) Neural posterior domain randomization. In: Conference on robot learning, pp 1532\u20131542. PMLR"},{"key":"19731_CR42","doi-asserted-by":"crossref","unstructured":"Zakharov S, Kehl W, Ilic S (2019) Deceptionnet: Network-driven domain randomization. In: Proceedings of the IEEE\/CVF international conference on computer vision, pp 532\u2013541","DOI":"10.1109\/ICCV.2019.00062"},{"key":"19731_CR43","unstructured":"Mehta B, Diaz M, Golemo F, Pal CJ, Paull L (2020) Active domain randomization. In: Conference on robot learning, pp 1162\u20131176. PMLR"},{"key":"19731_CR44","first-page":"13049","volume":"33","author":"M Dennis","year":"2020","unstructured":"Dennis M, Jaques N, Vinitsky E, Bayen A, Russell S, Critch A, Levine S (2020) Emergent complexity and zero-shot transfer via unsupervised environment design. Adv Neural Inf Process Syst 33:13049\u201313061","journal-title":"Adv Neural Inf Process Syst"},{"key":"19731_CR45","doi-asserted-by":"crossref","unstructured":"Prakash A, Boochoon S, Brophy M, Acuna D, Cameracci E, State G, Shapira O, Birchfield S (2019) Structured domain randomization: Bridging the reality gap by context-aware synthetic data. In: 2019 International conference on robotics and automation (ICRA), pp 7249\u20137255. IEEE","DOI":"10.1109\/ICRA.2019.8794443"},{"key":"19731_CR46","doi-asserted-by":"crossref","unstructured":"Kar A, Prakash A, Liu M-Y, Cameracci E, Yuan J, Rusiniak M, Acuna D, Torralba A, Fidler S (2019) Meta-sim: Learning to generate synthetic datasets. In: Proceedings of the IEEE\/CVF international conference on computer vision, pp 4551\u20134560","DOI":"10.1109\/ICCV.2019.00465"},{"key":"19731_CR47","doi-asserted-by":"crossref","unstructured":"Devaranjan J, Kar A, Fidler S (2020) Meta-sim2: Unsupervised learning of scene structure for synthetic data generation. In: Computer Vision\u2013ECCV 2020: 16th European Conference, Glasgow, UK, August 23\u201328, 2020, Proceedings, Part XVII 16, pp 715\u2013733. Springer","DOI":"10.1007\/978-3-030-58520-4_42"},{"key":"19731_CR48","doi-asserted-by":"crossref","unstructured":"Abou\u00a0Akar C, Luckow A, Obeid A, Beddawi C, Kamradt M, Makhoul A (2023a) Enhancing complex image synthesis with conditional generative models and rule extraction. In: 2023 International conference on machine learning and applications (ICMLA), pp 136\u2013143. IEEE","DOI":"10.1109\/ICMLA58977.2023.00027"},{"key":"19731_CR49","doi-asserted-by":"crossref","unstructured":"Moonen S, Vanherle B, de\u00a0Hoog J, Bourgana T, Bey-Temsamani A, Michiels N (2023) Cad2render: A modular toolkit for gpu-accelerated photorealistic synthetic data generation for the manufacturing industry. In: Proceedings of the IEEE\/CVF winter conference on applications of computer vision, pp 583\u2013592","DOI":"10.1109\/WACVW58289.2023.00065"},{"key":"19731_CR50","unstructured":"Morrical N, Tremblay J, Lin Y, Tyree S, Birchfield S, Pascucci V, Wald I (2021) NViSII: A scriptable tool for photorealistic image generation. In: ICLR Workshop on synthetic data generation"},{"key":"19731_CR51","unstructured":"Gupta K, Worker N (2022) Closing the Sim2Real Gap with NVIDIA Isaac Sim and NVIDIA Isaac Replicator. https:\/\/developer.nvidia.com\/blog\/closing-the-sim2real-gap-with-nvidia-isaac-sim-and-nvidia-isaac-replicator\/. Accessed 17 May 2023"},{"key":"19731_CR52","unstructured":"Omniverse, NVIDIA (2023a) Replicator. https:\/\/docs.omniverse.nvidia.com\/prod_extensions\/prod_extensions\/ext_replicator.html. Accessed 18 May 2023"},{"key":"19731_CR53","doi-asserted-by":"crossref","unstructured":"Zhu X, Bilal T, M\u00e5rtensson P, Hanson L, Bj\u00f6rkman M, Maki A (2023) Towards sim-to-real industrial parts classification with synthetic dataset. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition (CVPR) workshops","DOI":"10.1109\/CVPRW59228.2023.00468"},{"key":"19731_CR54","unstructured":"Zhu X (2023) Synthetic Industrial Parts dataset (SIP-17). https:\/\/www.kaggle.com\/datasets\/mandymm\/synthetic-industrial-parts-dataset-sip-17. Accessed 2 June 2023"},{"key":"19731_CR55","unstructured":"Synthetic Corrosion (2022) Synthetic corrosion dataset dataset. https:\/\/universe.roboflow.com\/synthetic-corrosion\/synthetic-corrosion-dataset. https:\/\/universe.roboflow.com\/synthetic-corrosion\/synthetic-corrosion-dataset. visited on 2023-06-02"},{"key":"19731_CR56","doi-asserted-by":"crossref","unstructured":"De Roovere P, Moonen S, Michiels N, wyffels F (2024) Sim-to-real dataset of industrial metal objects. Machines 12(2):99","DOI":"10.3390\/machines12020099"},{"key":"19731_CR57","doi-asserted-by":"crossref","unstructured":"De\u00a0Roovere P, Moonen S, Michiels N, Wyffels F (2023) Dataset of Industrial Metal Objects. https:\/\/pderoovere.github.io\/dimo\/. Accessed 2 June 2023","DOI":"10.3390\/machines12020099"},{"key":"19731_CR58","doi-asserted-by":"crossref","unstructured":"Zhu J-Y, Park T, Isola P, Efros AA (2017) Unpaired image-to-image translation using cycle-consistent adversarial networks. In: Proceedings of the IEEE international conference on computer vision, pp 2223\u20132232","DOI":"10.1109\/ICCV.2017.244"},{"issue":"2","key":"19731_CR59","first-page":"66","volume":"8","author":"A Petsiuk","year":"2024","unstructured":"Petsiuk A, Singh H, Dadhwal H, Pearce JM (2024) Synthetic-to-real composite semantic segmentation in additive manufacturing. J Manuf Mater Process 8(2):66","journal-title":"J Manuf Mater Process"},{"key":"19731_CR60","unstructured":"Knitt M, Schyga J, Adamanov A, Hinckeldeyn J, Kreutzfeldt J (2022a) Estimating the pose of a euro pallet with an rgb camera based on synthetic training data. arXiv preprint arXiv:2210.06001"},{"key":"19731_CR61","unstructured":"Knitt M, Schyga J, Adamanov A, Hinckeldeyn J, Kreutzfeldt J (2022b) Palloc6d-estimating the pose of a euro pallet with an rgb camera based on synthetic training data"},{"key":"19731_CR62","doi-asserted-by":"crossref","unstructured":"Mayershofer C, Ge T, Fottner J (2021) Towards fully-synthetic training for industrial applications. In: LISS 2020: Proceedings of the 10th international conference on logistics, informatics and service sciences, pp 765\u2013782. Springer","DOI":"10.1007\/978-981-33-4359-7_53"},{"key":"19731_CR63","unstructured":"Pixar Animation Studios (2021a) Introduction to USD. https:\/\/openusd.org\/release\/intro.html. Accessed 18 May 2023"},{"key":"19731_CR64","unstructured":"Pixar Animation Studios (2021b) Usdz File Format Specification. https:\/\/openusd.org\/release\/spec_usdz.html. Accessed 5 June 2023"},{"key":"19731_CR65","doi-asserted-by":"crossref","unstructured":"Paulin G, Ivasic-Kos M (2023) Review and analysis of synthetic dataset generation methods and techniques for application in computer vision. Artificial Intelligence Review, pp 1\u201345","DOI":"10.1007\/s10462-022-10358-3"},{"key":"19731_CR66","doi-asserted-by":"crossref","unstructured":"Hinterstoisser S, Pauly O, Heibel H, Martina M, Bokeloh M (2019) An annotation saved is an annotation earned: Using fully synthetic training for object detection. In: Proceedings of the IEEE\/CVF international conference on computer vision workshops, pp 0\u20130","DOI":"10.1109\/ICCVW.2019.00340"},{"key":"19731_CR67","doi-asserted-by":"crossref","unstructured":"Lin T-Y, Maire M, Belongie S, Hays J, Perona P, Ramanan D, Doll\u00e1r P, Zitnick CL (2014) Microsoft coco: Common objects in context. In: Computer Vision\u2013ECCV 2014: 13th European Conference, Zurich, Switzerland, September 6-12, 2014, Proceedings, Part V 13, pp 740\u2013755. Springer","DOI":"10.1007\/978-3-319-10602-1_48"},{"key":"19731_CR68","unstructured":"Cordts M, Omran M, Ramos S, Scharw\u00e4chter T, Enzweiler M, Benenson R, Franke U, Roth S, Schiele B (2015) The cityscapes dataset. In: CVPR Workshop on the future of datasets in vision, vol\u00a02. sn"},{"key":"19731_CR69","doi-asserted-by":"crossref","unstructured":"Deng J, Dong W, Socher R, Li L-J, Li K,\u00a0Fei-Fei L (2009) Imagenet: A large-scale hierarchical image database. In: 2009 IEEE conference on computer vision and pattern recognition, pp 248\u2013255. Ieee","DOI":"10.1109\/CVPR.2009.5206848"},{"key":"19731_CR70","doi-asserted-by":"crossref","unstructured":"Calli B, Singh A, Walsman A, Srinivasa S, Abbeel P, Dollar AM (2015) The ycb object and model set: Towards common benchmarks for manipulation research. In: 2015 international conference on advanced robotics (ICAR), pp 510\u2013517. IEEE","DOI":"10.1109\/ICAR.2015.7251504"},{"key":"19731_CR71","unstructured":"NVIDIA Developer (2023) vMaterials. https:\/\/developer.nvidia.com\/vmaterials. Accessed 5 June 2023"},{"key":"19731_CR72","unstructured":"NVIDIA Omniverse (2023a) Omniverse MDL Materials. https:\/\/docs.omniverse.nvidia.com\/prod_materials-and-rendering\/prod_materials-and-rendering\/materials.html\/. Accessed 18 May 2023"},{"key":"19731_CR73","unstructured":"NVIDIA Omniverse (2023b) Annotators Information. https:\/\/docs.omniverse.nvidia.com\/prod_extensions\/prod_extensions\/ext_replicator\/annotators_details.html. Accessed 4 June 2023"},{"key":"19731_CR74","unstructured":"BMW\u00a0TechOffice\u00a0MUNICH (2023a) LabelTool lite. https:\/\/github.com\/BMW-InnovationLab\/BMW-Labeltool-Lite. Accessed 5 June 2023"},{"key":"19731_CR75","unstructured":"BMW\u00a0TechOffice\u00a0MUNICH (2023b) Tensorflow 2 Object Detection Training GUI for Linux. https:\/\/github.com\/BMW-InnovationLab\/BMW-TensorFlow-Training-GUI. Accessed 5 June 2023"},{"key":"19731_CR76","unstructured":"BMW\u00a0TechOffice\u00a0MUNICH (2023c) BMW AI Evaluation GUI. https:\/\/github.com\/BMW-InnovationLab\/SORDI-AI-Evaluation-GUI. Accessed 5 June 2023"},{"key":"19731_CR77","doi-asserted-by":"crossref","unstructured":"He K, Zhang X, Ren S, Sun J (2016) Deep residual learning for image recognition. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 770\u2013778","DOI":"10.1109\/CVPR.2016.90"},{"key":"19731_CR78","doi-asserted-by":"crossref","unstructured":"Tan M, Pang R, Le QV (2020) Efficientdet: Scalable and efficient object detection. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp 10781\u201310790","DOI":"10.1109\/CVPR42600.2020.01079"},{"key":"19731_CR79","unstructured":"Tensorflow (2021) TensorFlow 2 Detection Model Zoo. https:\/\/github.com\/tensorflow\/models\/blob\/master\/research\/object_detection\/g3doc\/tf2_detection_zoo.md. Accessed 5 June 2023"},{"key":"19731_CR80","doi-asserted-by":"crossref","unstructured":"Wang C-Y, Bochkovskiy A, Liao H-YM (2023) Yolov7: Trainable bag-of-freebies sets new state-of-the-art for real-time object detectors. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp 7464\u20137475","DOI":"10.1109\/CVPR52729.2023.00721"},{"key":"19731_CR81","unstructured":"Weng L (2019) Domain Randomization for Sim2Real Transfer. https:\/\/lilianweng.github.io\/posts\/2019-05-05-domain-randomization\/. Accessed 18 May 2023"},{"key":"19731_CR82","doi-asserted-by":"crossref","unstructured":"Abou\u00a0Akar C, Semaan A, Haddad Y, Kamradt M, Makhoul A (2023b) Mixing domains for smartly picking and using limited datasets in industrial object detection. In: International conference on computer vision systems, pp 270\u2013282. Springer","DOI":"10.1007\/978-3-031-44137-0_23"},{"key":"19731_CR83","unstructured":"NVIDIA Omniverse (2023c) Physics Core. https:\/\/docs.omniverse.nvidia.com\/extensions\/latest\/ext_physics.html. Accessed 11 August 2023"},{"key":"19731_CR84","doi-asserted-by":"crossref","unstructured":"Rombach R, Blattmann A, Lorenz D, Esser P, Ommer B (2022) High-resolution image synthesis with latent diffusion models. In: Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition, pp 10684\u201310695","DOI":"10.1109\/CVPR52688.2022.01042"},{"key":"19731_CR85","doi-asserted-by":"crossref","unstructured":"Croitoru F-A, Hondru V, Ionescu RT, Shah M (2023) Diffusion models in vision: A survey. IEEE Transactions on Pattern Analysis and Machine Intelligence","DOI":"10.1109\/TPAMI.2023.3261988"},{"issue":"2","key":"19731_CR86","first-page":"1","volume":"54","author":"Z Wang","year":"2021","unstructured":"Wang Z, She Q, Ward TE (2021) Generative adversarial networks in computer vision: A survey and taxonomy. ACM Computing Surveys (CSUR) 54(2):1\u201338","journal-title":"ACM Computing Surveys (CSUR)"},{"key":"19731_CR87","doi-asserted-by":"crossref","unstructured":"Abou\u00a0Akar C, Abdel\u00a0Massih R, Yaghi A, Khalil J, Kamradt M, Makhoul A (2024) Generative adversarial network applications in industry 4.0: A review. International Journal of Computer Vision 1\u201360","DOI":"10.1007\/s11263-023-01966-9"},{"key":"19731_CR88","doi-asserted-by":"publisher","first-page":"126","DOI":"10.1016\/j.inffus.2021.02.014","volume":"72","author":"P Shamsolmoali","year":"2021","unstructured":"Shamsolmoali P, Zareapoor M, Granger E, Zhou H, Wang R, Celebi ME, Yang J (2021) Image synthesis with adversarial networks: A comprehensive survey and case studies. Inf Fusion 72:126\u2013146","journal-title":"Inf Fusion"},{"issue":"10s","key":"19731_CR89","doi-asserted-by":"publisher","first-page":"1","DOI":"10.1145\/3505244","volume":"54","author":"S Khan","year":"2022","unstructured":"Khan S, Naseer M, Hayat M, Zamir SW, Khan FS, Shah M (2022) Transformers in vision: A survey. ACM computing surveys (CSUR) 54(10s):1\u201341","journal-title":"ACM computing surveys (CSUR)"},{"key":"19731_CR90","unstructured":"Jaunet T, Bono G, Vuillemot R, Wolf C (2021) Visualizing the sim2real gap in robot ego-pose estimation. In: eXplainable AI approaches for debugging and diagnosis. https:\/\/openreview.net\/forum?id=SkvZsABQXE"},{"key":"19731_CR91","unstructured":"Tsirikoglou A, Kronander J, Wrenninge M, Unger J (2017) Procedural modeling and physically based rendering for synthetic data generation in automotive applications. arXiv preprint arXiv:1710.06270"},{"key":"19731_CR92","first-page":"108","volume":"11144","author":"D Schraml","year":"2019","unstructured":"Schraml D (2019) (2019) Physically based synthetic image generation for machine learning: a review of pertinent literature. Photon Educ Meas Sci 11144:108\u2013120","journal-title":"Photon Educ Meas Sci"},{"key":"19731_CR93","doi-asserted-by":"crossref","unstructured":"Hoda\u0148 T, Vineet V, Gal R, Shalev E, Hanzelka J, Connell T, Urbina P, Sinha SN, Guenter B (2019) Photorealistic image synthesis for object instance detection. In: 2019 IEEE international conference on image processing (ICIP), pp 66\u201370. IEEE","DOI":"10.1109\/ICIP.2019.8803821"},{"key":"19731_CR94","unstructured":"Omniverse, NVIDIA (2023b) Randomizer Tool. https:\/\/docs.omniverse.nvidia.com\/prod_extensions\/prod_extensions\/ext_randomizer-tool.html. Accessed 18 May 2023"}],"container-title":["Multimedia Tools and Applications"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-024-19731-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11042-024-19731-6\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-024-19731-6.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,5,24]],"date-time":"2025-05-24T08:42:07Z","timestamp":1748076127000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11042-024-19731-6"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,7,9]]},"references-count":94,"journal-issue":{"issue":"17","published-online":{"date-parts":[[2025,5]]}},"alternative-id":["19731"],"URL":"https:\/\/doi.org\/10.1007\/s11042-024-19731-6","relation":{},"ISSN":["1573-7721"],"issn-type":[{"value":"1573-7721","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,7,9]]},"assertion":[{"value":"20 October 2023","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"17 June 2024","order":2,"name":"revised","label":"Revised","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"19 June 2024","order":3,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"9 July 2024","order":4,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}},{"order":1,"name":"Ethics","group":{"name":"EthicsHeading","label":"Declarations"}},{"value":"The authors declare that they have no conflict of interest.","order":2,"name":"Ethics","group":{"name":"EthicsHeading","label":"Conflicts of interest"}}]}}