{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,13]],"date-time":"2026-06-13T04:42:19Z","timestamp":1781325739722,"version":"3.54.1"},"reference-count":79,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"4","license":[{"start":{"date-parts":[[2025,4,1]],"date-time":"2025-04-01T00:00:00Z","timestamp":1743465600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"},{"start":{"date-parts":[[2025,4,1]],"date-time":"2025-04-01T00:00:00Z","timestamp":1743465600000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2025,4,1]],"date-time":"2025-04-01T00:00:00Z","timestamp":1743465600000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"funder":[{"DOI":"10.13039\/501100018537","name":"National Science and Technology Major Project","doi-asserted-by":"publisher","award":["2022ZD0118202"],"award-info":[{"award-number":["2022ZD0118202"]}],"id":[{"id":"10.13039\/501100018537","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100014219","name":"National Science Fund for Distinguished Young Scholars","doi-asserted-by":"publisher","award":["62025603"],"award-info":[{"award-number":["62025603"]}],"id":[{"id":"10.13039\/501100014219","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["U21B2037"],"award-info":[{"award-number":["U21B2037"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["U22B2051"],"award-info":[{"award-number":["U22B2051"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62176222"],"award-info":[{"award-number":["62176222"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62176223"],"award-info":[{"award-number":["62176223"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62176226"],"award-info":[{"award-number":["62176226"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62072386"],"award-info":[{"award-number":["62072386"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62072387"],"award-info":[{"award-number":["62072387"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62072389"],"award-info":[{"award-number":["62072389"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62002305"],"award-info":[{"award-number":["62002305"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62272401"],"award-info":[{"award-number":["62272401"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["624B2119"],"award-info":[{"award-number":["624B2119"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"name":"Natural Science Foundation of Fujian Province of China","award":["2021J01002"],"award-info":[{"award-number":["2021J01002"]}]},{"name":"Natural Science Foundation of Fujian Province of China","award":["2022J06001"],"award-info":[{"award-number":["2022J06001"]}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Trans. Pattern Anal. Mach. Intell."],"published-print":{"date-parts":[[2025,4]]},"DOI":"10.1109\/tpami.2025.3528042","type":"journal-article","created":{"date-parts":[[2025,1,13]],"date-time":"2025-01-13T19:51:08Z","timestamp":1736797868000},"page":"2676-2692","source":"Crossref","is-referenced-by-count":15,"title":["Towards Accurate Post-Training Quantization of Vision Transformers via Error Reduction"],"prefix":"10.1109","volume":"47","author":[{"ORCID":"https:\/\/orcid.org\/0000-0003-0268-4672","authenticated-orcid":false,"given":"Yunshan","family":"Zhong","sequence":"first","affiliation":[{"name":"Institute of Artificial Intelligence, Department of Artificial Intelligence, School of Informatics, and Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University, Xiamen, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0008-1314-4018","authenticated-orcid":false,"given":"You","family":"Huang","sequence":"additional","affiliation":[{"name":"Department of Artificial Intelligence, School of Informatics, and Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University, Xiamen, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0003-3786-5374","authenticated-orcid":false,"given":"Jiawei","family":"Hu","sequence":"additional","affiliation":[{"name":"Department of Artificial Intelligence, School of Informatics, and Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University, Xiamen, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-4409-7030","authenticated-orcid":false,"given":"Yuxin","family":"Zhang","sequence":"additional","affiliation":[{"name":"Department of Artificial Intelligence, School of Informatics, and Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University, Xiamen, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-9163-2932","authenticated-orcid":false,"given":"Rongrong","family":"Ji","sequence":"additional","affiliation":[{"name":"Institute of Artificial Intelligence, Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University, Xiamen, China"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.48550\/arXiv.2010.11929"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV48922.2021.00986"},{"key":"ref3","first-page":"10 347","article-title":"Training data-efficient image transformers & distillation through attention","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Touvron"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-58452-8_13"},{"key":"ref5","article-title":"Deformable DETR: Deformable transformers for end-to-end object detection","author":"Zhu","year":"2020"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR46437.2021.00681"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV48922.2021.00676"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.01185"},{"key":"ref9","first-page":"9164","article-title":"Learning efficient vision transformers via fine-grained manifold distillation","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Hao"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW56347.2022.00411"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.00614"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.01565"},{"key":"ref13","first-page":"28 092","article-title":"Post-training quantization for vision transformer","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Liu"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.01574"},{"key":"ref15","article-title":"Quantizing deep convolutional networks for efficient inference: A whitepaper","author":"Krishnamoorthi","year":"2018"},{"key":"ref16","first-page":"1","article-title":"Learned step size quantization","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Esser"},{"key":"ref17","first-page":"7950","article-title":"Post training 4-bit quantization of convolutional networks for rapid-deployment","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Banner"},{"key":"ref18","first-page":"34 451","article-title":"Q-Vit: Accurate and fully quantized low-bit vision transformer","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Li"},{"key":"ref19","first-page":"1","article-title":"Additive powers-of-two quantization: An efficient non-uniform discretization for neural networks","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Li"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2019.00495"},{"key":"ref21","first-page":"21 813","article-title":"Oscillation-free quantization for low-bit vision transformers","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Liu"},{"key":"ref22","article-title":"Variation-aware vision transformer quantization","author":"Xijie Huang","year":"2023"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1109\/TNNLS.2023.3301007"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-20083-0_10"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.24963\/ijcai.2022\/164"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.01946"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.01557"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/2023.emnlp-main.565"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.01580"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-19775-8_12"},{"key":"ref31","first-page":"61664","article-title":"ERQ: Error reduction for post-training quantization of vision transformers","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Zhong"},{"key":"ref32","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR46437.2021.01212"},{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.1109\/ICCVW54120.2021.00210"},{"key":"ref34","doi-asserted-by":"publisher","DOI":"10.1109\/ICCVW54120.2021.00355"},{"key":"ref35","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2023.102802"},{"key":"ref36","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.01183"},{"key":"ref37","first-page":"1","article-title":"MobileViT: Light-weight, general-purpose, and mobile-friendly vision transformer","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Mehta"},{"key":"ref38","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-19803-8_5"},{"key":"ref39","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV51070.2023.01583"},{"key":"ref40","first-page":"1","article-title":"BRECQ: Pushing the limit of post-training quantization by block reconstruction","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Li"},{"key":"ref41","first-page":"1","article-title":"QDrop: Randomly dropping quantization for extremely low-bit post-training quantization","volume-title":"Proc. Int. Conf. Learn. Representations","author":"Wei"},{"key":"ref42","first-page":"307","article-title":"CLAMP-ViT: Contrastive data-free learning for adaptive post-training quantization of ViTs","volume-title":"Proc. Eur. Conf. Comput. Vis.","author":"Ramachandran"},{"key":"ref43","doi-asserted-by":"publisher","DOI":"10.1145\/3503161.3547826"},{"key":"ref44","article-title":"GPTQ: Accurate post-training compression for generative pretrained transformers","author":"Frantar","year":"2022"},{"key":"ref45","first-page":"4475","article-title":"Optimal brain compression: A framework for accurate post-training quantization and pruning","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Frantar"},{"key":"ref46","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52733.2024.01527"},{"key":"ref47","first-page":"33811","article-title":"Outlier-aware slicing for post-training quantization in vision transformer","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Ma"},{"key":"ref48","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-58536-5_5"},{"key":"ref49","article-title":"RPTQ: Reorder-based post-training quantization for large language models","author":"Yuan","year":"2023"},{"key":"ref50","first-page":"1","article-title":"Incremental network quantization: Towards lossless CNNs with low-precision weights","volume-title":"Proc. 11th Int. Conf. Learn. Representations","author":"Zhou"},{"key":"ref51","first-page":"7197","article-title":"Up or down? Adaptive rounding for post-training quantization","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Nagel"},{"key":"ref52","doi-asserted-by":"publisher","DOI":"10.1007\/s10107-016-1036-0"},{"key":"ref53","first-page":"62414","article-title":"Pruning versus quantization: Which is better","volume-title":"Proc. Int. Conf. Neural Inf. Process. Syst.","author":"Kuzmin"},{"key":"ref54","first-page":"972","article-title":"Self-normalizing neural networks","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Klambauer"},{"key":"ref55","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2019.01167"},{"key":"ref56","first-page":"21 508","article-title":"Entropy-driven mixed-precision quantization for deep network design","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Sun"},{"key":"ref57","first-page":"5308","article-title":"Robust quantization: One model to rule them all","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Chmiel"},{"key":"ref58","first-page":"1","article-title":"DuQuant: Distributing outliers via dual transformation makes stronger quantized LLMs","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Lin"},{"key":"ref59","article-title":"SpinQuant\u2013LLM quantization with learned rotations","author":"Liu","year":"2024"},{"key":"ref60","first-page":"1","article-title":"OmniQuant: Omnidirectionally calibrated quantization for large language models","volume-title":"Proc. 11th Int. Conf. Learn. Representations","author":"Shao"},{"key":"ref61","first-page":"38 087","article-title":"SmoothQuant: Accurate and efficient post-training quantization for large language models","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Xiao"},{"key":"ref62","first-page":"7197","article-title":"Up or down? Adaptive rounding for post-training quantization","volume-title":"Proc. Int. Conf. Mach. Learn.","author":"Nagel"},{"key":"ref63","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.02340"},{"key":"ref64","article-title":"EasyQuant: Post-training quantization via scale optimization","author":"Wu","year":"2020"},{"key":"ref65","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.01554"},{"key":"ref66","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-015-0816-y"},{"key":"ref67","article-title":"PyTorch image models","author":"Wightman","year":"2019"},{"key":"ref68","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2017.322"},{"key":"ref69","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00644"},{"key":"ref70","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-10602-1_48"},{"key":"ref71","doi-asserted-by":"publisher","DOI":"10.5244\/C.26.135"},{"key":"ref72","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2017.19"},{"key":"ref73","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2001.937655"},{"key":"ref74","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2015.7299156"},{"key":"ref75","doi-asserted-by":"publisher","DOI":"10.1109\/TIP.2003.819861"},{"key":"ref76","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW.2017.149"},{"key":"ref77","first-page":"8026","article-title":"PyTorch: An imperative style, high-performance deep learning library","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","author":"Paszke"},{"key":"ref78","first-page":"411","article-title":"AdaLog: Post-training quantization for vision transformers with adaptive logarithm quantizer","volume-title":"Proc. Eur. Conf. Comput. Vis.","author":"Wu"},{"key":"ref79","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52729.2023.00567"}],"container-title":["IEEE Transactions on Pattern Analysis and Machine Intelligence"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx8\/34\/10916529\/10839431.pdf?arnumber=10839431","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,3,7]],"date-time":"2025-03-07T18:39:56Z","timestamp":1741372796000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/10839431\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,4]]},"references-count":79,"journal-issue":{"issue":"4"},"URL":"https:\/\/doi.org\/10.1109\/tpami.2025.3528042","relation":{},"ISSN":["0162-8828","2160-9292","1939-3539"],"issn-type":[{"value":"0162-8828","type":"print"},{"value":"2160-9292","type":"electronic"},{"value":"1939-3539","type":"electronic"}],"subject":[],"published":{"date-parts":[[2025,4]]}}}