{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,21]],"date-time":"2026-05-21T14:11:27Z","timestamp":1779372687825,"version":"3.53.1"},"reference-count":60,"publisher":"Elsevier BV","license":[{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/tdm\/userlicense\/1.0\/"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.elsevier.com\/legal\/tdmrep-license"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-017"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-012"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2026,9,1]],"date-time":"2026-09-01T00:00:00Z","timestamp":1788220800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-004"}],"content-domain":{"domain":["elsevier.com","sciencedirect.com"],"crossmark-restriction":true},"short-container-title":["Expert Systems with Applications"],"published-print":{"date-parts":[[2026,9]]},"DOI":"10.1016\/j.eswa.2026.132856","type":"journal-article","created":{"date-parts":[[2026,5,14]],"date-time":"2026-05-14T17:31:59Z","timestamp":1778779919000},"page":"132856","update-policy":"https:\/\/doi.org\/10.1016\/elsevier_cm_policy","source":"Crossref","is-referenced-by-count":0,"special_numbering":"C","title":["SLIQ-ViT: Sensitivity-aware log-uniform integer quantization for efficient vision transformers"],"prefix":"10.1016","volume":"327","author":[{"ORCID":"https:\/\/orcid.org\/0009-0002-8749-4834","authenticated-orcid":false,"given":"Ruiting","family":"Sun","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0000-5941-7466","authenticated-orcid":false,"given":"Honglu","family":"He","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-6036-4074","authenticated-orcid":false,"given":"Guanwen","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-9715-6957","authenticated-orcid":false,"given":"Wei","family":"Zhou","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"78","reference":[{"key":"10.1016\/j.eswa.2026.132856_bib0001","series-title":"International conference on machine learning","first-page":"135","article-title":"AttnLRP: Attention-aware layer-wise relevance propagation for transformers","author":"Achtibat","year":"2024"},{"key":"10.1016\/j.eswa.2026.132856_bib0002","series-title":"Information science and applications (ICISA) 2016","first-page":"913","article-title":"Layer-wise relevance propagation for deep neural network architectures","author":"Binder","year":"2016"},{"issue":"5","key":"10.1016\/j.eswa.2026.132856_bib0003","doi-asserted-by":"crossref","first-page":"1483","DOI":"10.1109\/TPAMI.2019.2956516","article-title":"Cascade r-CNN: High quality object detection and instance segmentation","volume":"43","author":"Cai","year":"2019","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"10.1016\/j.eswa.2026.132856_bib0004","series-title":"Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition","first-page":"2349","article-title":"Rethinking differentiable search for mixed-precision neural networks","author":"Cai","year":"2020"},{"key":"10.1016\/j.eswa.2026.132856_bib0005","series-title":"Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition","first-page":"782","article-title":"Transformer interpretability beyond attention visualization","author":"Chefer","year":"2021"},{"key":"10.1016\/j.eswa.2026.132856_bib0006","unstructured":"Chen, J., Zhang, J., Yang, Y., Lian, D., Chen, E. et al. (2025a). Adaptive sampled softmax with inverted multi-index: Methods, theory and applications. arXiv: 2501.08563."},{"key":"10.1016\/j.eswa.2026.132856_bib0007","article-title":"Gresmark: A swin transformer-based watermarking framework with geometric attack resilience","volume":"304","author":"Chen","year":"2025","journal-title":"Expert Systems with Applications"},{"key":"10.1016\/j.eswa.2026.132856_bib0008","series-title":"Proceedings of the IEEE\/CVF international conference on computer vision","first-page":"589","article-title":"Visformer: The vision-friendly transformer","author":"Chen","year":"2021"},{"issue":"4","key":"10.1016\/j.eswa.2026.132856_bib0009","doi-asserted-by":"crossref","first-page":"5225","DOI":"10.1109\/TITS.2025.3545621","article-title":"Parallel heterogeneous networks with adaptive routing for online video lane detection","volume":"26","author":"Cheng","year":"2025","journal-title":"IEEE Transactions on Intelligent Transportation Systems"},{"key":"10.1016\/j.eswa.2026.132856_bib0010","series-title":"2009\u202fIEEE Conference on computer vision and pattern recognition","first-page":"248","article-title":"Imagenet: A large-scale hierarchical image database","author":"Deng","year":"2009"},{"key":"10.1016\/j.eswa.2026.132856_bib0011","doi-asserted-by":"crossref","first-page":"10088","DOI":"10.52202\/075280-0441","article-title":"Qlora: Efficient finetuning of quantized llms","volume":"36","author":"Dettmers","year":"2023","journal-title":"Advances in Neural Information Processing Systems"},{"key":"10.1016\/j.eswa.2026.132856_bib0012","series-title":"Proceedings of the 30th ACM international conference on multimedia","first-page":"5380","article-title":"Towards accurate post-training quantization for vision transformer","author":"Ding","year":"2022"},{"key":"10.1016\/j.eswa.2026.132856_bib0013","series-title":"International conference on learning representations","first-page":"1","article-title":"An image is worth 16x16 words: Transformers for image recognition at scale","author":"Dosovitskiy","year":"2021"},{"issue":"3","key":"10.1016\/j.eswa.2026.132856_bib0014","doi-asserted-by":"crossref","first-page":"211","DOI":"10.1007\/BF02288367","article-title":"The approximation of one matrix by another of lower rank","volume":"1","author":"Eckart","year":"1936","journal-title":"Psychometrika"},{"key":"10.1016\/j.eswa.2026.132856_bib0015","series-title":"Low-power computer vision","first-page":"291","article-title":"A survey of quantization methods for efficient neural network inference","author":"Gholami","year":"2022"},{"key":"10.1016\/j.eswa.2026.132856_bib0016","series-title":"Proceedings of the 61st ACM\/IEEE design automation conference","first-page":"1","article-title":"Aptq: Attention-aware post-training mixed-precision quantization for large language models","author":"Guan","year":"2024"},{"key":"10.1016\/j.eswa.2026.132856_bib0017","doi-asserted-by":"crossref","DOI":"10.1016\/j.eswa.2023.123083","article-title":"A lightweight residual network based on improved knowledge transfer and quantized distillation for cross-domain fault diagnosis of rolling bearings","volume":"245","author":"Guo","year":"2024","journal-title":"Expert Systems with Applications"},{"key":"10.1016\/j.eswa.2026.132856_bib0018","unstructured":"Habib, G., Saleem, T. J., & Lall, B. (2023). Knowledge distillation in vision transformers: A critical review. arXiv: 2302.02108."},{"issue":"1","key":"10.1016\/j.eswa.2026.132856_bib0019","doi-asserted-by":"crossref","first-page":"87","DOI":"10.1109\/TPAMI.2022.3152247","article-title":"A survey on vision transformer","volume":"45","author":"Han","year":"2022","journal-title":"IEEE Transactions on Pattern Analysis and Machine Intelligence"},{"key":"10.1016\/j.eswa.2026.132856_bib0020","series-title":"Proceedings of the 41st international conference on machine learning","first-page":"17783","article-title":"LoRA+ efficient low rank adaptation of large models","author":"Hayou","year":"2024"},{"key":"10.1016\/j.eswa.2026.132856_bib0021","series-title":"Proceedings of the IEEE international conference on computer vision","first-page":"2961","article-title":"Mask r-cnn","author":"He","year":"2017"},{"key":"10.1016\/j.eswa.2026.132856_bib0022","series-title":"International conference on learning representations","first-page":"1","article-title":"LoRA: Low-rank adaptation of large language models","author":"Hu","year":"2022"},{"key":"10.1016\/j.eswa.2026.132856_bib0023","doi-asserted-by":"crossref","DOI":"10.1016\/j.eswa.2025.128853","article-title":"Multi-phase transformer for remote sensing image super-resolution","volume":"295","author":"Hu","year":"2026","journal-title":"Expert Systems with Applications"},{"key":"10.1016\/j.eswa.2026.132856_bib0024","first-page":"1","article-title":"Quantization variation: A new perspective on training transformers with low-bit precision","volume":"10","author":"Huang","year":"2024","journal-title":"Transactions on Machine Learning Research"},{"key":"10.1016\/j.eswa.2026.132856_bib0025","doi-asserted-by":"crossref","DOI":"10.1016\/j.neucom.2025.130061","article-title":"Agqb-vit: Adaptive granularity quantizer with bias for post-training quantization of vision transformers","volume":"637","author":"Huo","year":"2025","journal-title":"Neurocomputing"},{"issue":"Suppl 3","key":"10.1016\/j.eswa.2026.132856_bib0026","doi-asserted-by":"crossref","first-page":"2917","DOI":"10.1007\/s10462-023-10595-0","article-title":"A survey of the vision transformers and their CNN-transformer based variants","volume":"56","author":"Khan","year":"2023","journal-title":"Artificial Intelligence Review"},{"key":"10.1016\/j.eswa.2026.132856_bib0027","first-page":"34451","article-title":"Q-vit: Accurate and fully quantized low-bit vision transformer","volume":"35","author":"Li","year":"2022","journal-title":"Advances in Neural Information Processing Systems"},{"key":"10.1016\/j.eswa.2026.132856_bib0028","series-title":"Proceedings of the IEEE\/CVF international conference on computer vision","first-page":"17065","article-title":"I-vit: Integer-only quantization for efficient vision transformer inference","author":"Li","year":"2023"},{"key":"10.1016\/j.eswa.2026.132856_bib0029","series-title":"Proceedings of the IEEE\/CVF international conference on computer vision","first-page":"17227","article-title":"Repq-vit: Scale reparameterization for post-training quantization of vision transformers","author":"Li","year":"2023"},{"key":"10.1016\/j.eswa.2026.132856_bib0030","series-title":"European conference on computer vision","first-page":"740","article-title":"Microsoft coco: Common objects in context","author":"Lin","year":"2014"},{"key":"10.1016\/j.eswa.2026.132856_bib0031","series-title":"Proceedings of the thirty-first international joint conference on artificial intelligence","first-page":"1173","article-title":"Fq-vit: Post-training quantization for fully quantized vision transformer","author":"Lin","year":"2022"},{"key":"10.1016\/j.eswa.2026.132856_bib0032","series-title":"Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition","first-page":"24427","article-title":"Pd-quant: Post-training quantization based on prediction difference metric","author":"Liu","year":"2023"},{"key":"10.1016\/j.eswa.2026.132856_bib0033","series-title":"Forty-first international conference on machine learning","first-page":"32100","article-title":"Dora: Weight-decomposed low-rank adaptation","author":"Liu","year":"2024"},{"key":"10.1016\/j.eswa.2026.132856_bib0034","series-title":"Proceedings of the IEEE\/CVF international conference on computer vision","first-page":"10012","article-title":"Swin transformer: Hierarchical vision transformer using shifted windows","author":"Liu","year":"2021"},{"key":"10.1016\/j.eswa.2026.132856_bib0035","first-page":"28092","article-title":"Post-training quantization for vision transformer","volume":"34","author":"Liu","year":"2021","journal-title":"Advances in Neural Information Processing Systems"},{"key":"10.1016\/j.eswa.2026.132856_bib0036","series-title":"Proceedings of the AAAI conference on artificial intelligence","first-page":"9029","article-title":"Ompq: Orthogonal mixed precision quantization","volume":"vol. 37","author":"Ma","year":"2023"},{"key":"10.1016\/j.eswa.2026.132856_bib0037","unstructured":"Pan, J., Wang, C., Zheng, K., Li, Y., Wang, Z., & Feng, B. (2023). Smoothquant+: Accurate and efficient 4-bit post-training weightquantization for llm. arXiv: 2312.03788."},{"key":"10.1016\/j.eswa.2026.132856_bib0038","series-title":"2025 25th international conference on digital signal processing (DSP)","first-page":"1","article-title":"Lrp-qvit: Mixed-precision vision transformer quantization using layer importance score","author":"Ranjan","year":"2025"},{"key":"10.1016\/j.eswa.2026.132856_bib0039","doi-asserted-by":"crossref","unstructured":"Ranjan, N., & Savakis, A. (2025b). Mix-QVit: Mixed-precision vision transformer quantization driven by layer importance and quantization sensitivity. arXiv: 2501.06357.","DOI":"10.1109\/DSP65409.2025.11075195"},{"issue":"11","key":"10.1016\/j.eswa.2026.132856_bib0040","doi-asserted-by":"crossref","first-page":"4025","DOI":"10.1109\/TCAD.2023.3248503","article-title":"Joint optimization of dimension reduction and mixed-precision quantization for activation compression of neural networks","volume":"42","author":"Tai","year":"2023","journal-title":"IEEE Transactions on Computer-Aided Design of Integrated Circuits and Systems"},{"key":"10.1016\/j.eswa.2026.132856_bib0041","series-title":"2022\u202fIEEE Workshop on signal processing systems (siPS)","first-page":"1","article-title":"Learnable mixed-precision and dimension reduction co-design for low-storage activation","author":"Tai","year":"2022"},{"key":"10.1016\/j.eswa.2026.132856_bib0042","unstructured":"Tai, Y.-S. et al. (2024). Mptq-vit: Mixed-precision post-training quantization for vision transformer. arXiv: 2401.14895."},{"key":"10.1016\/j.eswa.2026.132856_bib0043","series-title":"International conference on machine learning","first-page":"10347","article-title":"Training data-efficient image transformers & distillation through attention","author":"Touvron","year":"2021"},{"key":"10.1016\/j.eswa.2026.132856_bib0044","series-title":"Proceedings of the 17th conference of the european chapter of the association for computational linguistics","first-page":"3274","article-title":"DyloRA: Parameter-efficient tuning of pre-trained models using dynamic search-free low-rank adaptation","author":"Valipour","year":"2023"},{"key":"10.1016\/j.eswa.2026.132856_bib0045","first-page":"6000","article-title":"Attention is all you need","volume":"30","author":"Vaswani","year":"2017","journal-title":"Advances in Neural Information Processing Systems"},{"issue":"4","key":"10.1016\/j.eswa.2026.132856_bib0046","doi-asserted-by":"crossref","DOI":"10.1117\/1.JEI.30.4.043028","article-title":"Deep progressive attention for person re-identification","volume":"30","author":"Wang","year":"2021","journal-title":"Journal of Electronic Imaging"},{"key":"10.1016\/j.eswa.2026.132856_bib0047","series-title":"Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition","first-page":"8612","article-title":"Haq: Hardware-aware automated quantization with mixed precision","author":"Wang","year":"2019"},{"key":"10.1016\/j.eswa.2026.132856_bib0048","series-title":"Proceedings of the IEEE\/CVF international conference on computer vision","first-page":"5291","article-title":"Generalizable mixed-precision quantization via attribution rank preservation","author":"Wang","year":"2021"},{"key":"10.1016\/j.eswa.2026.132856_bib0049","series-title":"European conference on computer vision","first-page":"411","article-title":"Adalog: Post-training quantization for vision transformers with adaptive logarithm quantizer","author":"Wu","year":"2024"},{"key":"10.1016\/j.eswa.2026.132856_bib0050","series-title":"Proceedings of the computer vision and pattern recognition conference","first-page":"14891","article-title":"Fima-q: Post-training quantization for vision transformers by fisher information matrix approximation","author":"Wu","year":"2025"},{"key":"10.1016\/j.eswa.2026.132856_bib0051","series-title":"Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition","first-page":"4794","article-title":"Vision transformer with deformable attention","author":"Xia","year":"2022"},{"key":"10.1016\/j.eswa.2026.132856_bib0052","series-title":"International conference on machine learning","first-page":"38087","article-title":"Smoothquant: Accurate and efficient post-training quantization for large language models","author":"Xiao","year":"2023"},{"key":"10.1016\/j.eswa.2026.132856_bib0053","series-title":"2023 International joint conference on neural networks (IJCNN)","first-page":"1","article-title":"Patch-wise mixed-precision quantization of vision transformer","author":"Xiao","year":"2023"},{"key":"10.1016\/j.eswa.2026.132856_bib0054","series-title":"Proceedings of the AAAI conference on artificial intelligence","first-page":"16193","article-title":"Ptmq: Post-training multi-bit quantization of neural networks","volume":"Vol. 38","author":"Xu","year":"2024"},{"key":"10.1016\/j.eswa.2026.132856_bib0055","unstructured":"Yang, L., Gong, H., Lin, H., Wu, Y., Sun, Z., & Gu, Q. (2024). Dopq-vit: Towards distribution-friendly and outlier-aware post-training quantization for vision transformers. arXiv: 2408.03291."},{"key":"10.1016\/j.eswa.2026.132856_bib0056","series-title":"European conference on computer vision","first-page":"191","article-title":"Ptq4vit: Post-training quantization for vision transformers with twin uniform quantization","author":"Yuan","year":"2022"},{"key":"10.1016\/j.eswa.2026.132856_bib0057","series-title":"Proceedings of the IEEE\/CVF conference on computer vision and pattern recognition","first-page":"12104","article-title":"Scaling vision transformers","author":"Zhai","year":"2022"},{"issue":"3","key":"10.1016\/j.eswa.2026.132856_bib0058","doi-asserted-by":"crossref","DOI":"10.1117\/1.JEI.30.3.033034","article-title":"Fpga accelerator for cnn: An exploration of the kernel structured sparsity and hybrid arithmetic computation","volume":"30","author":"Zhang","year":"2021","journal-title":"Journal of Electronic Imaging"},{"key":"10.1016\/j.eswa.2026.132856_bib0059","unstructured":"Zhang, Q., Chen, M., Bukharin, A., Karampatziakis, N., He, P., Cheng, Y., Chen, W., & Zhao, T. (2023). Adalora: Adaptive budget allocation for parameter-efficient fine-tuning. arXiv: 2303.10512."},{"key":"10.1016\/j.eswa.2026.132856_bib0060","series-title":"International conference on machine learning","first-page":"61664","article-title":"Erq: Error reduction for post-training quantization of vision transformers","author":"Zhong","year":"2024"}],"container-title":["Expert Systems with Applications"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0957417426017690?httpAccept=text\/xml","content-type":"text\/xml","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/api.elsevier.com\/content\/article\/PII:S0957417426017690?httpAccept=text\/plain","content-type":"text\/plain","content-version":"vor","intended-application":"text-mining"}],"deposited":{"date-parts":[[2026,5,21]],"date-time":"2026-05-21T13:37:57Z","timestamp":1779370677000},"score":1,"resource":{"primary":{"URL":"https:\/\/linkinghub.elsevier.com\/retrieve\/pii\/S0957417426017690"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,9]]},"references-count":60,"alternative-id":["S0957417426017690"],"URL":"https:\/\/doi.org\/10.1016\/j.eswa.2026.132856","relation":{},"ISSN":["0957-4174"],"issn-type":[{"value":"0957-4174","type":"print"}],"subject":[],"published":{"date-parts":[[2026,9]]},"assertion":[{"value":"Elsevier","name":"publisher","label":"This article is maintained by"},{"value":"SLIQ-ViT: Sensitivity-aware log-uniform integer quantization for efficient vision transformers","name":"articletitle","label":"Article Title"},{"value":"Expert Systems with Applications","name":"journaltitle","label":"Journal Title"},{"value":"https:\/\/doi.org\/10.1016\/j.eswa.2026.132856","name":"articlelink","label":"CrossRef DOI link to publisher maintained version"},{"value":"article","name":"content_type","label":"Content Type"},{"value":"\u00a9 2026 Elsevier Ltd. All rights are reserved, including those for text and data mining, AI training, and similar technologies.","name":"copyright","label":"Copyright"}],"article-number":"132856"}}