{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,19]],"date-time":"2026-06-19T05:52:44Z","timestamp":1781848364963,"version":"3.54.5"},"reference-count":32,"publisher":"IEEE","license":[{"start":{"date-parts":[[2026,5,24]],"date-time":"2026-05-24T00:00:00Z","timestamp":1779580800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2026,5,24]],"date-time":"2026-05-24T00:00:00Z","timestamp":1779580800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2026,5,24]]},"DOI":"10.1109\/iscas66217.2026.11562358","type":"proceedings-article","created":{"date-parts":[[2026,6,18]],"date-time":"2026-06-18T20:06:41Z","timestamp":1781813201000},"page":"1904-1908","source":"Crossref","is-referenced-by-count":0,"title":["Composit: A Dual-Precision Posit MAC and a Composite Quantisation Scheme for Accelerated Mixed-Precision Neural Network Inference"],"prefix":"10.1109","author":[{"given":"Shruti","family":"Singh","sequence":"first","affiliation":[{"name":"International Institute of Information Technology Bangalore"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Aravind","family":"Voggu","sequence":"additional","affiliation":[{"name":"International Institute of Information Technology Bangalore"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Madhav","family":"Rao","sequence":"additional","affiliation":[{"name":"International Institute of Information Technology Bangalore"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref1","article-title":"Attention Is All You Need","author":"Vaswani","year":"2023"},{"key":"ref2","first-page":"6","article-title":"Discovering Low-Precision Networks Close to Full-Precision Networks for Efficient Inference","volume-title":"2019 Fifth Workshop on Energy Efficient Machine Learning and Cognitive Computing - NeurIPS Edition (EMC2-NIPS)","author":"McKinstry"},{"key":"ref3","doi-asserted-by":"crossref","DOI":"10.1109\/ICCV.2019.00038","article-title":"HAWQ: Hessian AWare Quantization of Neural Networks with Mixed-Precision","author":"Dong","year":"2019"},{"key":"ref4","article-title":"HAWQ-V2: Hessian Aware trace-Weighted Quantization of Neural Networks","author":"Dong","year":"2019"},{"key":"ref5","first-page":"267","article-title":"Minerva: Enabling Low-Power, Highly-Accurate Deep Neural Network Accelerators","volume-title":"2016 ACM\/IEEE 43rd Annual International Symposium on Computer Architecture (ISCA)","author":"Reagen"},{"key":"ref6","first-page":"4932","article-title":"Nonuniform-to-Uniform Quantization: Towards Accurate Quantization via Generalized Straight-Through Estimation","volume-title":"2022 1EEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR)","author":"Liu"},{"key":"ref7","doi-asserted-by":"crossref","DOI":"10.1109\/CVPR42600.2020.01318","article-title":"ZeroQ: A Novel Zero Shot Quantization Framework","author":"Cai","year":"2020"},{"key":"ref8","first-page":"1","article-title":"IEEE Standard for Floating-Point Arithmetic","volume-title":"IEEE Std 754-2019 (Revision of IEEE 754-2008)","year":"2019"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/ACCESS.2020.2996936"},{"key":"ref10","article-title":"A Study of BFLOAT16 for Deep Learning Training","author":"Kalamkar","year":"2019"},{"key":"ref11","first-page":"7908","article-title":"Positnn: Training Deep Neural Networks with Mixed Low-Precision Posit","volume-title":"ICASSP 2021 - 2021 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)","author":"Raposo"},{"key":"ref12","first-page":"53","article-title":"PositNN Framework: Tapered Precision Deep Learning Inference for the Edge","volume-title":"2019 IEEE Space Computing Conference (SCC)","author":"Langroudi"},{"key":"ref13","first-page":"1","article-title":"POCO: Hardware Characterization of Activation Functions using POSIT-CORDIC Architecture","volume-title":"2024 IEEE International Symposium on Circuits and Systems (ISCAS)","author":"Basavaraju"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.14529\/jsfi170206"},{"issue":"8","key":"ref15","first-page":"1414","article-title":"Low-Precision Mixed-Computation Models for Inference on Edge","volume-title":"IEEE Transactions on Very Large Scale Integration (VLSI) Systems","volume":"32","author":"Azizi","year":"2024"},{"key":"ref16","first-page":"57 627","article-title":"Impact of Mixed Precision Techniques on Training and Inference Efficiency of Deep Neural Networks","volume-title":"IEEE Access","volume":"11","author":"Dorrich","year":"2023"},{"key":"ref17","first-page":"1","article-title":"Mixed-precision architecture based on computational memory for training deep neural networks","volume-title":"2018 IEEE International Symposium on Circuits and Systems (ISCAS)","author":"Nandakumar"},{"key":"ref18","article-title":"zeroby0\/composit: A composite Posit format and Torch + CUDA kernels for accelerated mixed-precision arithmetic","author":"Aravind"},{"key":"ref19","first-page":"74 586","article-title":"PACoGen: A Hardware Posit Arithmetic Core Generator","volume-title":"IEEE Access","volume":"7","author":"Jaiswal","year":"2019"},{"key":"ref20","article-title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library","author":"Paszke","year":"2019"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-09779-9_3"},{"key":"ref22","article-title":"Deep Residual Learning for Image Recognition","author":"He","year":"2015"},{"key":"ref23","doi-asserted-by":"crossref","DOI":"10.1109\/ICCV.2019.00140","article-title":"Searching for MobileNetV3","author":"Howard","year":"2019"},{"key":"ref24","article-title":"MobileNetV4 \u2013 Universal Models for the Mobile Ecosystem","author":"Qin","year":"2024"},{"key":"ref25","first-page":"6105","article-title":"EfficientNet: Rethinking Model Scaling for Convolutional Neural Networks","volume-title":"Proceedings of the 36th International Conference on Machine Learning","author":"Tan"},{"key":"ref26","article-title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","author":"Dosovitskiy","year":"2021"},{"key":"ref27","doi-asserted-by":"crossref","DOI":"10.1109\/CVPR52729.2023.01386","article-title":"EfficientViT: Memory Efficient Vision Transformer with Cascaded Group Attention","author":"Liu","year":"2023"},{"key":"ref28","article-title":"CIFAR-10 and CIFAR-100 datasets","author":"Krizhevsky","year":"2009"},{"key":"ref29","first-page":"248","article-title":"ImageNet: A large-scale hierarchical image database","volume-title":"2009 IEEE Conference on Computer Vision and Pattern Recognition","author":"Deng"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/CSTIC58779.2023.10219214"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.1080\/03610918908812806"},{"key":"ref32","doi-asserted-by":"publisher","DOI":"10.1137\/23M1548323"}],"event":{"name":"2026 IEEE International Symposium on Circuits and Systems (ISCAS)","location":"Shanghai, China","start":{"date-parts":[[2026,5,24]]},"end":{"date-parts":[[2026,5,28]]}},"container-title":["2026 IEEE International Symposium on Circuits and Systems (ISCAS)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx8\/11561899\/11561804\/11562358.pdf?arnumber=11562358","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,6,19]],"date-time":"2026-06-19T05:26:31Z","timestamp":1781846791000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/11562358\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,5,24]]},"references-count":32,"URL":"https:\/\/doi.org\/10.1109\/iscas66217.2026.11562358","relation":{},"subject":[],"published":{"date-parts":[[2026,5,24]]}}}