{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,18]],"date-time":"2026-06-18T05:51:11Z","timestamp":1781761871287,"version":"3.54.5"},"reference-count":65,"publisher":"IEEE","license":[{"start":{"date-parts":[[2026,5,25]],"date-time":"2026-05-25T00:00:00Z","timestamp":1779667200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2026,5,25]],"date-time":"2026-05-25T00:00:00Z","timestamp":1779667200000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2026,5,25]]},"DOI":"10.1109\/fg67764.2026.11557018","type":"proceedings-article","created":{"date-parts":[[2026,6,17]],"date-time":"2026-06-17T19:37:10Z","timestamp":1781725030000},"page":"1-11","source":"Crossref","is-referenced-by-count":0,"title":["Training-Free Multi-Concept LoRA Composition with Prompt-Aware Weighting"],"prefix":"10.1109","author":[{"given":"Georgios","family":"Tsoumplekas","sequence":"first","affiliation":[{"name":"Kingston University,Department of Networks and Digital Media,London,UK"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Stella","family":"Bounareli","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Vasileios","family":"Argyriou","sequence":"additional","affiliation":[{"name":"Kingston University,Department of Networks and Digital Media,London,UK"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.acl-long.568"},{"key":"ref2","article-title":"Imagen 3","author":"Baldridge","year":"2024","journal-title":"arXiv preprint arXiv:2408.07009"},{"key":"ref3","article-title":"Jedi: The force of jensenshannon divergence in disentangling diffusion models","author":"Bill","year":"2025","journal-title":"arXiv preprint arXiv:2505.19166"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2017.116"},{"key":"ref5","article-title":"Sam 3: Segment anything with concepts","author":"Carion","year":"2025","journal-title":"arXiv preprint arXiv:2511.16719"},{"key":"ref6","article-title":"Consislora: Enhancing content and style consistency for lora-based style transfer","author":"Chen","year":"2025","journal-title":"arXiv preprint arXiv:2503.10614"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52734.2025.00455"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.01118"},{"key":"ref9","article-title":"Lorashop: Training-free multi-concept image generation and editing with rectified flow transformers","author":"Dalva","year":"2025","journal-title":"arXiv preprint arXiv:2505.23758"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2019.00482"},{"key":"ref11","first-page":"6637","article-title":"Compositional visual generation with energy based models","volume":"33","author":"Du","year":"2020","journal-title":"Advances in Neural Information Processing Systems"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.52202\/079017-0571"},{"key":"ref13","article-title":"Loratorio: An intrinsic approach to lora skill composition","author":"Foteinopoulou","year":"2025","journal-title":"arXiv preprint arXiv:2508.11624"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-72684-2_11"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.52202\/075280-0699"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2021.emnlp-main.595"},{"key":"ref17","first-page":"6840","article-title":"Denoising diffusion probabilistic models","volume":"33","author":"Ho","year":"2020","journal-title":"Advances in neural information processing systems"},{"key":"ref18","article-title":"Classifier-free diffusion guidance","volume-title":"NeurIPS 2021 Workshop on Deep Generative Models and Downstream Applications","author":"Ho"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.52202\/068431-0628"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.00591"},{"issue":"2","key":"ref21","first-page":"3","article-title":"Lora: Low-rank adaptation of large language models","volume":"1","author":"Hu","year":"2022","journal-title":"ICLR"},{"key":"ref22","article-title":"Lorahub: Efficient cross-task generalization via dynamic lora composition","volume-title":"First Conference on Language Modeling.","author":"Huang"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW67362.2025.00070"},{"key":"ref24","article-title":"Hunyuanvideo: A systematic framework for large video generative models","author":"Kong","year":"2024","journal-title":"arXiv preprint arXiv:2412.03603"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/cvpr52729.2023.00192"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.00848"},{"key":"ref27","article-title":"The double-ellipsoid geometry of CLIP","volume-title":"Forty-second International Conference on Machine Learning","author":"Levi"},{"key":"ref28","article-title":"Autolora: Automatic lora retrieval and fine-grained gated fusion for text-to-image generation","author":"Li","year":"2025","journal-title":"arXiv preprint arXiv:2508.02107"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-19790-1_26"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.52202\/075280-2508"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.52202\/068431-0418"},{"key":"ref32","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51701.2025.01681"},{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.1145\/3581783.3612137"},{"key":"ref34","article-title":"DINOv2: Learning robust visual features without supervision","author":"Oquab","year":"2024","journal-title":"Transactions on Machine Learning Research"},{"key":"ref35","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52734.2025.01217"},{"key":"ref36","doi-asserted-by":"publisher","DOI":"10.52202\/075280-1048"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.00387"},{"key":"ref38","article-title":"Tara: Token-aware lora for composable personalization in diffusion models","author":"Peng","year":"2025","journal-title":"arXiv preprint arXiv:2508.08812"},{"key":"ref39","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.00761"},{"key":"ref40","article-title":"SDXL: Improving latent diffusion models for high-resolution image synthesis","volume-title":"The Twelfth International Conference on Learning Representations","author":"Podell"},{"key":"ref41","first-page":"644","article-title":"Lora soups: Merging loras for practical skill composition tasks","volume-title":"Proceedings of the 31st International Conference on Computational Linguistics: Industry Track","author":"Prabhakar"},{"key":"ref42","first-page":"8748","article-title":"Learning transferable visual models from natural language supervision","volume-title":"International conference on machine learning","author":"Radford"},{"key":"ref43","first-page":"8821","article-title":"Zero-shot text-to-image generation","volume-title":"International conference on machine learning","author":"Ramesh"},{"key":"ref44","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.01042"},{"key":"ref45","article-title":"Multlfg: Trainingfree multi-lora composition using frequency-domain guidance","author":"Roy","year":"2025","journal-title":"arXiv preprint arXiv:2505.20525"},{"key":"ref46","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.02155"},{"key":"ref47","doi-asserted-by":"publisher","DOI":"10.52202\/068431-2643"},{"key":"ref48","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-73232-4_24"},{"key":"ref49","first-page":"16132","article-title":"rar: Learning to merge loras via hypernetworks for subjectstyle conditioned image generation","volume-title":"Proceedings of the IEEE\/CVF International Conference on Computer Vision","author":"Shenaj"},{"key":"ref50","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52734.2025.01231"},{"key":"ref51","article-title":"Make-a-video: Text-to-video generation without text-video data","volume-title":"The Eleventh International Conference on Learning Representations","author":"Singer"},{"key":"ref52","first-page":"2256","article-title":"Deep unsupervised learning using nonequilibrium thermodynamics","volume-title":"International conference on machine learning","author":"Sohl-Dickstein"},{"key":"ref53","article-title":"Denoising diffusion implicit models","volume-title":"International Conference on Learning Representations","author":"Song"},{"key":"ref54","article-title":"p+: Extended textual conditioning in text-to-image generation","author":"Voynov","year":"2023","journal-title":"arXiv preprint arXiv:2303.09522"},{"key":"ref55","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51701.2025.01490"},{"key":"ref56","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-024-02227-z"},{"key":"ref57","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51701.2025.01634"},{"key":"ref58","doi-asserted-by":"publisher","DOI":"10.1109\/TIP.2025.3633153"},{"key":"ref59","article-title":"Minicpm-v: A gpt-4v level mllm on your phone","author":"Yao","year":"2024","journal-title":"arXiv preprint arXiv:2408.01800"},{"key":"ref60","article-title":"Rethinking inter-lora orthogonality in adapter merging: Insights from orthogonal monte carlo dropout","author":"Zhang","year":"2025","journal-title":"arXiv preprint arXiv:2510.03262"},{"key":"ref61","article-title":"Subject or style: Adaptive and trainingfree mixture of loras","author":"Zhang","year":"2025","journal-title":"arXiv preprint arXiv:2508.02165"},{"key":"ref62","article-title":"Freelora: Enabling trainingfree lora fusion for autoregressive multi-subject personalization","author":"Zheng","year":"2025","journal-title":"arXiv preprint arXiv:2507.01792"},{"key":"ref63","article-title":"Decouple and orthogonalize: A data-free framework for lora merging","author":"Zheng","year":"2025","journal-title":"arXiv preprint arXiv:2505.15875"},{"key":"ref64","article-title":"Multi-lora composition for image generation","author":"Zhong","journal-title":"Transactions on Machine Learning Research."},{"key":"ref65","article-title":"Cached multi-lora composition for multi-concept image generation","volume-title":"The Thirteenth International Conference on Learning Representations","author":"Zou"}],"event":{"name":"2026 IEEE 20th International Conference on Automatic Face and Gesture Recognition (FG)","location":"Kyoto, Japan","start":{"date-parts":[[2026,5,25]]},"end":{"date-parts":[[2026,5,29]]}},"container-title":["2026 IEEE 20th International Conference on Automatic Face and Gesture Recognition (FG)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx8\/11556508\/11556510\/11557018.pdf?arnumber=11557018","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,6,18]],"date-time":"2026-06-18T04:53:07Z","timestamp":1781758387000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/11557018\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,5,25]]},"references-count":65,"URL":"https:\/\/doi.org\/10.1109\/fg67764.2026.11557018","relation":{},"subject":[],"published":{"date-parts":[[2026,5,25]]}}}