{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,5]],"date-time":"2026-06-05T13:06:52Z","timestamp":1780664812164,"version":"3.54.1"},"publisher-location":"New York, NY, USA","reference-count":119,"publisher":"ACM","license":[{"start":{"date-parts":[[2026,4,26]],"date-time":"2026-04-26T00:00:00Z","timestamp":1777161600000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0\/legalcode"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62472384"],"award-info":[{"award-number":["62472384"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62441236"],"award-info":[{"award-number":["62441236"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["U24A20326"],"award-info":[{"award-number":["U24A20326"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100018537","name":"National Science and Technology Major Project","doi-asserted-by":"publisher","award":["2022ZD0117000"],"award-info":[{"award-number":["2022ZD0117000"]}],"id":[{"id":"10.13039\/501100018537","id-type":"DOI","asserted-by":"publisher"}]},{"name":"Major Project of the Zhejiang Provincial Natural Science Foundation","award":["LD26F020002"],"award-info":[{"award-number":["LD26F020002"]}]}],"content-domain":{"domain":["dl.acm.org"],"crossmark-restriction":true},"short-container-title":[],"published-print":{"date-parts":[[2026,4,27]]},"DOI":"10.1145\/3767295.3803594","type":"proceedings-article","created":{"date-parts":[[2026,4,24]],"date-time":"2026-04-24T20:20:04Z","timestamp":1777062004000},"page":"879-898","update-policy":"https:\/\/doi.org\/10.1145\/crossmark-policy","source":"Crossref","is-referenced-by-count":0,"title":["SmartNS: Enabling Line-rate and Flexible Network Stack with SmartNIC"],"prefix":"10.1145","author":[{"ORCID":"https:\/\/orcid.org\/0009-0009-7432-5485","authenticated-orcid":false,"given":"Xuzheng","family":"Chen","sequence":"first","affiliation":[{"name":"Zhejiang University, Hang Zhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-1720-3704","authenticated-orcid":false,"given":"Jie","family":"Zhang","sequence":"additional","affiliation":[{"name":"Zhejiang University, Hang Zhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0009-5336-8224","authenticated-orcid":false,"given":"Baolin","family":"Zhu","sequence":"additional","affiliation":[{"name":"Zhejiang University, Hang Zhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-7550-9379","authenticated-orcid":false,"given":"Xueying","family":"Zhu","sequence":"additional","affiliation":[{"name":"Zhejiang University, Hang Zhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-1566-3117","authenticated-orcid":false,"given":"Zhongqing","family":"Chen","sequence":"additional","affiliation":[{"name":"Alibaba Group, Hang Zhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0003-6115-5516","authenticated-orcid":false,"given":"Ting","family":"Fu","sequence":"additional","affiliation":[{"name":"Alibaba Group, Hang Zhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0001-7057-0194","authenticated-orcid":false,"given":"Shu","family":"Ma","sequence":"additional","affiliation":[{"name":"Alibaba Group, Hang Zhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0009-0001-5145-6097","authenticated-orcid":false,"given":"Lingjun","family":"Zhu","sequence":"additional","affiliation":[{"name":"Alibaba Group, Hang Zhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-0057-6678","authenticated-orcid":false,"given":"Chao","family":"Shi","sequence":"additional","affiliation":[{"name":"Alibaba Group, Hang Zhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-6702-6753","authenticated-orcid":false,"given":"Yin","family":"Zhang","sequence":"additional","affiliation":[{"name":"Zhejiang University, Hang Zhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-9542-7095","authenticated-orcid":false,"given":"Yuanchao","family":"Shu","sequence":"additional","affiliation":[{"name":"Zhejiang University, Hang Zhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-4221-2162","authenticated-orcid":false,"given":"Peng","family":"Cheng","sequence":"additional","affiliation":[{"name":"Zhejiang University, Hang Zhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-8550-9241","authenticated-orcid":false,"given":"Zeke","family":"Wang","sequence":"additional","affiliation":[{"name":"Zhejiang University, Hang Zhou, China"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"320","published-online":{"date-parts":[[2026,4,26]]},"reference":[{"key":"e_1_3_2_1_1_1","doi-asserted-by":"publisher","DOI":"10.1109\/MICRO56248.2022.00042"},{"key":"e_1_3_2_1_2_1","volume-title":"Skip it: Take control of your cache! In ASPLOS","author":"Anand Shashank","year":"2024","unstructured":"Shashank Anand, Michal Friedman, Michael Giardino, and Gustavo Alonso. Skip it: Take control of your cache! In ASPLOS, 2024."},{"key":"e_1_3_2_1_3_1","volume-title":"NSDI","author":"Arashloo Mina Tahmasbi","year":"2020","unstructured":"Mina Tahmasbi Arashloo, Alexey Lavrov, Manya Ghobadi, Jennifer Rexford, David Walker, and David Wentzlaff. Enabling programmable transport protocols in {High-Speed}{NICs}. In NSDI, 2020."},{"key":"e_1_3_2_1_4_1","volume-title":"NSDI","author":"Bai Wei","year":"2023","unstructured":"Wei Bai, Shanim Sainul Abdeen, Ankit Agrawal, Krishan Kumar Attre, Paramvir Bahl, Ameya Bhagat, Gowri Bhaskara, Tanya Brokhman, Lei Cao, Ahmad Cheema, et al. Empowering azure storage with {RDMA}. In NSDI, 2023."},{"key":"e_1_3_2_1_5_1","volume-title":"https:\/\/gtmteknoloji.com\/wp-content\/uploads\/2020\/08\/PS1100R-PB100.pdf","author":"R.","year":"2020","unstructured":"Broadcom. BCM958804-PS1100R. https:\/\/gtmteknoloji.com\/wp-content\/uploads\/2020\/08\/PS1100R-PB100.pdf, 2020."},{"key":"e_1_3_2_1_6_1","doi-asserted-by":"publisher","DOI":"10.1145\/3452296.3472888"},{"key":"e_1_3_2_1_7_1","volume-title":"SIGCOMM","author":"Cai Qizhe","year":"2022","unstructured":"Qizhe Cai, Midhul Vuppalapati, Jaehyun Hwang, Christos Kozyrakis, and Rachit Agarwal. Towards \u03bc s tail latency and terabit ethernet: disaggregating the host network stack. In SIGCOMM, 2022."},{"key":"e_1_3_2_1_8_1","volume-title":"TON","author":"Chen Guo","year":"2019","unstructured":"Guo Chen, Yuanwei Lu, Bojie Li, Kun Tan, Yongqiang Xiong, Peng Cheng, Jiansong Zhang, and Thomas Moscibroda. Mp-rdma: enabling rdma with multi-path transport in datacenters. TON, 2019."},{"key":"e_1_3_2_1_9_1","volume-title":"Libr: Yet another rdma perftest. https:\/\/github.com\/carlzhang4\/libr","author":"Chen Xuzheng","year":"2025","unstructured":"Xuzheng Chen and Jie Zhang. Libr: Yet another rdma perftest. https:\/\/github.com\/carlzhang4\/libr, 2025."},{"key":"e_1_3_2_1_10_1","volume-title":"Demystifying datapath accelerator enhanced off-path smartnic. arXiv preprint arXiv:2402.03041","author":"Chen Xuzheng","year":"2024","unstructured":"Xuzheng Chen, Jie Zhang, Ting Fu, Yifan Shen, Shu Ma, Kun Qian, Lingjun Zhu, Chao Shi, Yin Zhang, Ming Liu, et al. Demystifying datapath accelerator enhanced off-path smartnic. arXiv preprint arXiv:2402.03041, 2024."},{"key":"e_1_3_2_1_11_1","volume-title":"https:\/\/www.dpdk.org\/","author":"Data Plane Development Kit DPDK.","year":"2025","unstructured":"DPDK. Data Plane Development Kit. https:\/\/www.dpdk.org\/, 2025."},{"key":"e_1_3_2_1_12_1","volume-title":"NSDI","author":"Dragojevi\u0107 Aleksandar","year":"2014","unstructured":"Aleksandar Dragojevi\u0107, Dushyanth Narayanan, Miguel Castro, and Orion Hodson. {FaRM}: Fast remote memory. In NSDI, 2014."},{"key":"e_1_3_2_1_13_1","doi-asserted-by":"publisher","DOI":"10.1145\/2815400.2815425"},{"key":"e_1_3_2_1_14_1","doi-asserted-by":"publisher","DOI":"10.1145\/3445814.3446724"},{"key":"e_1_3_2_1_15_1","doi-asserted-by":"publisher","DOI":"10.1145\/3302424.3303977"},{"key":"e_1_3_2_1_16_1","doi-asserted-by":"publisher","DOI":"10.1145\/3302424.3303977"},{"key":"e_1_3_2_1_17_1","volume-title":"ATC","author":"Farshin Alireza","year":"2020","unstructured":"Alireza Farshin, Amir Roozbeh, Gerald Q Maguire Jr, and Dejan Kosti\u0107. Reexamining direct cache access to optimize {I\/O} intensive applications for multi-hundred-gigabit networks. In ATC, 2020."},{"key":"e_1_3_2_1_18_1","volume-title":"OSDI","author":"Fried Joshua","year":"2020","unstructured":"Joshua Fried, Zhenyuan Ruan, Amy Ousterhout, and Adam Belay. Caladan: Mitigating interference at microsecond timescales. In OSDI, 2020."},{"key":"e_1_3_2_1_19_1","doi-asserted-by":"publisher","DOI":"10.1145\/3651890.3672233"},{"key":"e_1_3_2_1_20_1","volume-title":"perftest: Infiniband verbs performance tests. https:\/\/github.com\/linux-rdma\/perftest","year":"2025","unstructured":"sshaulnv gilr8, HassanKhadour. perftest: Infiniband verbs performance tests. https:\/\/github.com\/linux-rdma\/perftest, 2025."},{"key":"e_1_3_2_1_21_1","volume-title":"https:\/\/github.com\/opencomputeproject\/OCP-NET-Falcon","author":"Falcon Google","year":"2024","unstructured":"Google Falcon. Google Falcon. https:\/\/github.com\/opencomputeproject\/OCP-NET-Falcon, 2024."},{"key":"e_1_3_2_1_22_1","doi-asserted-by":"publisher","DOI":"10.1145\/2934872.2934908"},{"key":"e_1_3_2_1_23_1","doi-asserted-by":"publisher","DOI":"10.1109\/CCGrid57682.2023.00014"},{"key":"e_1_3_2_1_24_1","volume-title":"SIGCOMM","author":"He Zhiqiang","year":"2020","unstructured":"Zhiqiang He, Dongyang Wang, Binzhang Fu, Kun Tan, Bei Hua, Zhi-Li Zhang, and Kai Zheng. Masq: Rdma for virtual private cloud. In SIGCOMM, 2020."},{"key":"e_1_3_2_1_25_1","volume-title":"OSDI","author":"Ibanez Stephen","year":"2021","unstructured":"Stephen Ibanez, Alex Mallery, Serhat Arslan, Theo Jepsen, Muhammad Shahbaz, Changhoon Kim, and Nick McKeown. The nanopu: A nanosecond network stack for datacenters. In OSDI, 2021."},{"key":"e_1_3_2_1_26_1","volume-title":"Infiniband architecture. https:\/\/www.infinibandta.org\/","year":"2008","unstructured":"Infiniband. Infiniband architecture. https:\/\/www.infinibandta.org\/, 2008."},{"key":"e_1_3_2_1_27_1","volume-title":"RoCEv2 Update from the IBTA. https:\/\/www.openfabrics.org\/images\/eventpresos\/workshops2014\/DevWorkshop\/presos\/Wednesday\/pdf\/02_RoCEv2forOFA.pdf","year":"2014","unstructured":"Infiniband. RoCEv2 Update from the IBTA. https:\/\/www.openfabrics.org\/images\/eventpresos\/workshops2014\/DevWorkshop\/presos\/Wednesday\/pdf\/02_RoCEv2forOFA.pdf, 2014."},{"key":"e_1_3_2_1_28_1","volume-title":"Intel Crystal Beach DMA. https:\/\/www.dpdk.org\/wp-content\/uploads\/sites\/35\/2018\/12\/JiayuHu_Accelerating_paravirtio_with_CBDMA.pdf","year":"2024","unstructured":"Intel. Intel Crystal Beach DMA. https:\/\/www.dpdk.org\/wp-content\/uploads\/sites\/35\/2018\/12\/JiayuHu_Accelerating_paravirtio_with_CBDMA.pdf, 2024."},{"key":"e_1_3_2_1_29_1","volume-title":"https:\/\/www.intel.com\/content\/dam\/doc\/white-paper\/i-o-acceleration-technology-paper.pdf","author":"Intel","year":"2024","unstructured":"Intel. Intel I\/O acceleration technology. https:\/\/www.intel.com\/content\/dam\/doc\/white-paper\/i-o-acceleration-technology-paper.pdf, 2024."},{"key":"e_1_3_2_1_30_1","volume-title":"Intel Memory Latency Checker. https:\/\/www.intel.com\/content\/www\/us\/en\/developer\/articles\/tool\/intelr-memory-latency-checker.html","year":"2024","unstructured":"Intel. Intel Memory Latency Checker. https:\/\/www.intel.com\/content\/www\/us\/en\/developer\/articles\/tool\/intelr-memory-latency-checker.html, 2024."},{"key":"e_1_3_2_1_31_1","volume-title":"Intel\u00ae Infrastructure Processing Unit. https:\/\/www.intel.com\/content\/www\/us\/en\/products\/details\/network-io\/ipu.html","year":"2024","unstructured":"Intel. Intel\u00ae Infrastructure Processing Unit. https:\/\/www.intel.com\/content\/www\/us\/en\/products\/details\/network-io\/ipu.html, 2024."},{"key":"e_1_3_2_1_32_1","volume-title":"JEDEC DDR5 compare. https:\/\/www.jedec.org\/category\/technology-focus-area\/main-memory-ddr3-ddr4-sdram","author":"JEDEC.","year":"2024","unstructured":"JEDEC. JEDEC DDR5 compare. https:\/\/www.jedec.org\/category\/technology-focus-area\/main-memory-ddr3-ddr4-sdram, 2024."},{"key":"e_1_3_2_1_33_1","doi-asserted-by":"publisher","DOI":"10.1145\/3676641.3716265"},{"key":"e_1_3_2_1_34_1","volume-title":"NSDI","author":"Kaffes Kostis","year":"2019","unstructured":"Kostis Kaffes, Timothy Chong, Jack Tigar Humphries, Adam Belay, David Mazi\u00e8res, and Christos Kozyrakis. Shinjuku: Preemptive scheduling for {\u03bcsecond-scale} tail latency. In NSDI, 2019."},{"key":"e_1_3_2_1_35_1","volume-title":"ATC","author":"Kalia Anuj","year":"2016","unstructured":"Anuj Kalia, Michael Kaminsky, and David G Andersen. Design guidelines for high performance { RDMA} systems. In ATC, 2016."},{"key":"e_1_3_2_1_36_1","volume-title":"OSDI","author":"Kalia Anuj","year":"2016","unstructured":"Anuj Kalia, Michael Kaminsky, and David G Andersen. {FaSST}: Fast, scalable and simple distributed transactions with two-sided rdma datagram rpcs. In OSDI, 2016."},{"key":"e_1_3_2_1_37_1","volume-title":"ISCA","author":"Karandikar Sagar","year":"2023","unstructured":"Sagar Karandikar, Aniruddha N Udipi, Junsun Choi, Joonho Whangbo, Jerry Zhao, Svilen Kanev, Edwin Lim, Jyrki Alakuijala, Vrishab Madduri, Yakun Sophia Shao, et al. Cdpu: Co-designing compression and decompression processing units for hyperscale systems. In ISCA, 2023."},{"key":"e_1_3_2_1_38_1","doi-asserted-by":"publisher","DOI":"10.1145\/3302424.3303985"},{"key":"e_1_3_2_1_39_1","volume-title":"NSDI","author":"Kim Daehyeok","year":"2019","unstructured":"Daehyeok Kim, Tianlong Yu, Hongqiang Harry Liu, Yibo Zhu, Jitu Padhye, Shachar Raindel, Chuanxiong Guo, Vyas Sekar, and Srinivasan Seshan. {FreeFlow}: Software-based virtual {RDMA} networking for containerized clouds. In NSDI, 2019."},{"key":"e_1_3_2_1_40_1","doi-asserted-by":"publisher","DOI":"10.1145\/3477132.3483565"},{"key":"e_1_3_2_1_41_1","volume-title":"NSDI","author":"Kim Taehyun","year":"2023","unstructured":"Taehyun Kim, Deondre Martin Ng, Junzhi Gong, Youngjin Kwon, Minlan Yu, and KyoungSoo Park. Rearchitecting the tcp stack for i\/o-offloaded content delivery. In NSDI, 2023."},{"key":"e_1_3_2_1_42_1","volume-title":"NSDI","author":"Kong Xinhao","year":"2023","unstructured":"Xinhao Kong, Jingrong Chen, Wei Bai, Yechen Xu, Mahmoud Elhaddad, Shachar Raindel, Jitendra Padhye, Alvin R Lebeck, and Danyang Zhuo. Understanding { RDMA} microarchitecture resources for performance isolation. In NSDI, 2023."},{"key":"e_1_3_2_1_43_1","doi-asserted-by":"publisher","DOI":"10.1145\/3578338.3593571"},{"key":"e_1_3_2_1_44_1","doi-asserted-by":"publisher","DOI":"10.1145\/3387514.3406591"},{"key":"e_1_3_2_1_45_1","doi-asserted-by":"publisher","DOI":"10.1145\/3620665.3640401"},{"key":"e_1_3_2_1_46_1","doi-asserted-by":"publisher","DOI":"10.1145\/3651890.3672245"},{"key":"e_1_3_2_1_47_1","volume-title":"From rdma to rdca: Toward high-speed last mile of data center networks using remote direct cache access. arXiv preprint arXiv:2211.05975","author":"Li Qiang","year":"2022","unstructured":"Qiang Li, Qiao Xiang, Derui Liu, Yuxin Wang, Haonan Qiu, Xiaoliang Wang, Jie Zhang, Ridi Wen, Haohao Song, Gexiao Tian, et al. From rdma to rdca: Toward high-speed last mile of data center networks using remote direct cache access. arXiv preprint arXiv:2211.05975, 2022."},{"key":"e_1_3_2_1_48_1","volume-title":"APNet","author":"Li Qijing","year":"2025","unstructured":"Qijing Li, Xinyang Huang, Bowen Liu, Pengbo Li, Junxue Zhang, and Kai Chen. Cache-aware i\/o rate control for rdma. In APNet, 2025."},{"key":"e_1_3_2_1_49_1","doi-asserted-by":"publisher","DOI":"10.1145\/3718958.3750480"},{"key":"e_1_3_2_1_50_1","volume-title":"Deepseek-v3 technical report. arXiv preprint arXiv:2412.19437","author":"Liu Aixin","year":"2024","unstructured":"Aixin Liu, Bei Feng, Bing Xue, Bingxuan Wang, Bochao Wu, Chengda Lu, Chenggang Zhao, Chengqi Deng, Chenyu Zhang, Chong Ruan, et al. Deepseek-v3 technical report. arXiv preprint arXiv:2412.19437, 2024."},{"key":"e_1_3_2_1_51_1","doi-asserted-by":"publisher","DOI":"10.1145\/3718958.3750488"},{"key":"e_1_3_2_1_52_1","doi-asserted-by":"publisher","DOI":"10.1145\/3620666.3651327"},{"key":"e_1_3_2_1_53_1","doi-asserted-by":"publisher","DOI":"10.1145\/3341302.3342079"},{"key":"e_1_3_2_1_54_1","volume-title":"NSDI","author":"Lou Jiaqi","year":"2024","unstructured":"Jiaqi Lou, Xinhao Kong, Jinghan Huang, Wei Bai, Nam Sung Kim, and Danyang Zhuo. Harmonic: Hardware-assisted {RDMA} performance isolation for public clouds. In NSDI, 2024."},{"key":"e_1_3_2_1_55_1","doi-asserted-by":"publisher","DOI":"10.1145\/3341301.3359657"},{"key":"e_1_3_2_1_56_1","volume-title":"ConnectX\u00ae-6 DX Card. https:\/\/www.nvidia.com\/content\/dam\/en-zz\/Solutions\/networking\/ethernet-adapters\/connectX-6-dx-datasheet.pdf","year":"2022","unstructured":"Mellanox. ConnectX\u00ae-6 DX Card. https:\/\/www.nvidia.com\/content\/dam\/en-zz\/Solutions\/networking\/ethernet-adapters\/connectX-6-dx-datasheet.pdf, 2022."},{"key":"e_1_3_2_1_57_1","volume-title":"ConnectX\u00ae-7 EN Card. https:\/\/www.nvidia.com\/content\/dam\/en-zz\/Solutions\/networking\/ethernet-adapters\/connectx-7-datasheet-Final.pdf","year":"2023","unstructured":"Mellanox. ConnectX\u00ae-7 EN Card. https:\/\/www.nvidia.com\/content\/dam\/en-zz\/Solutions\/networking\/ethernet-adapters\/connectx-7-datasheet-Final.pdf, 2023."},{"key":"e_1_3_2_1_58_1","volume-title":"ConnectX\u00ae-8 EN Card. https:\/\/resources.nvidia.com\/en-us-accelerated-networking-resource-library\/connectx-datasheet-c","year":"2024","unstructured":"Mellanox. ConnectX\u00ae-8 EN Card. https:\/\/resources.nvidia.com\/en-us-accelerated-networking-resource-library\/connectx-datasheet-c, 2024."},{"key":"e_1_3_2_1_59_1","doi-asserted-by":"publisher","DOI":"10.1145\/3544216.3544238"},{"key":"e_1_3_2_1_60_1","volume-title":"Hwan Doh, and Arvind Krishnamurthy. Gimbal: enabling multi-tenant storage disaggregation on smartnic jbofs. In SIGCOMM","author":"Min Jaehong","year":"2021","unstructured":"Jaehong Min, Ming Liu, Tapan Chugh, Chenxingyu Zhao, Andrew Wei, In Hwan Doh, and Arvind Krishnamurthy. Gimbal: enabling multi-tenant storage disaggregation on smartnic jbofs. In SIGCOMM, 2021."},{"key":"e_1_3_2_1_61_1","doi-asserted-by":"publisher","DOI":"10.1145\/3230543.3230557"},{"key":"e_1_3_2_1_62_1","volume-title":"NSDI","author":"Moon YoungGyoun","year":"2020","unstructured":"YoungGyoun Moon, SeungEon Lee, Muhammad Asim Jamshed, and KyoungSoo Park. AccelTCP: Accelerating network applications with stateful TCP offloading. In NSDI, 2020."},{"key":"e_1_3_2_1_63_1","volume-title":"TON","author":"Niu Zhixiong","year":"2021","unstructured":"Zhixiong Niu, Qiang Su, Peng Cheng, Yongqiang Xiong, Dongsu Han, Keith Winstein, Chun Jason Xue, and Hong Xu. Netkernel: Making network stack part of the virtualized infrastructure. TON, 2021."},{"key":"e_1_3_2_1_64_1","doi-asserted-by":"publisher","DOI":"10.1145\/3319647.3325827"},{"key":"e_1_3_2_1_65_1","volume-title":"NVIDIA BLUEFIELD-2 DPU. https:\/\/www.nvidia.com\/content\/dam\/en-zz\/Solutions\/Data-Center\/documents\/datasheet-nvidia-bluefield-2-dpu.pdf","year":"2022","unstructured":"Nvidia. NVIDIA BLUEFIELD-2 DPU. https:\/\/www.nvidia.com\/content\/dam\/en-zz\/Solutions\/Data-Center\/documents\/datasheet-nvidia-bluefield-2-dpu.pdf, 2022."},{"key":"e_1_3_2_1_66_1","volume-title":"DOCA Software Framework. https:\/\/developer.nvidia.com\/networking\/doca","author":"NVIDIA.","year":"2024","unstructured":"NVIDIA. DOCA Software Framework. https:\/\/developer.nvidia.com\/networking\/doca, 2024."},{"key":"e_1_3_2_1_67_1","volume-title":"https:\/\/docs.nvidia.com\/networking\/display\/bluefielddpubspv422\/link+aggregation","author":"Aggregation Link","year":"2024","unstructured":"Nvidia. Link Aggregation. https:\/\/docs.nvidia.com\/networking\/display\/bluefielddpubspv422\/link+aggregation, 2024."},{"key":"e_1_3_2_1_68_1","volume-title":"https:\/\/docs.nvidia.com\/doca\/sdk\/mmap+advise\/index.html","author":"NVIDIA.","year":"2024","unstructured":"Nvidia. NVIDIA. https:\/\/docs.nvidia.com\/doca\/sdk\/mmap+advise\/index.html, 2024."},{"key":"e_1_3_2_1_69_1","volume-title":"NVIDIA BLUEFIELD-3 DPU. https:\/\/www.nvidia.com\/content\/dam\/en-zz\/Solutions\/Data-Center\/documents\/datasheet-nvidia-bluefield-3-dpu.pdf","year":"2024","unstructured":"Nvidia. NVIDIA BLUEFIELD-3 DPU. https:\/\/www.nvidia.com\/content\/dam\/en-zz\/Solutions\/Data-Center\/documents\/datasheet-nvidia-bluefield-3-dpu.pdf, 2024."},{"key":"e_1_3_2_1_70_1","volume-title":"https:\/\/github.com\/Mellanox\/devx","author":"NVIDIA","year":"2024","unstructured":"Nvidia. NVIDIA DevX. https:\/\/github.com\/Mellanox\/devx, 2024."},{"key":"e_1_3_2_1_71_1","volume-title":"Cache Invalidate Operation. https:\/\/docs.nvidia.com\/doca\/sdk\/mmap+advise\/index.html#src-3543226633_id.MmapAdvisev2.10.0-CacheInvalidateOperation","author":"NVIDIA.","year":"2025","unstructured":"NVIDIA. Cache Invalidate Operation. https:\/\/docs.nvidia.com\/doca\/sdk\/mmap+advise\/index.html#src-3543226633_id.MmapAdvisev2.10.0-CacheInvalidateOperation, 2025."},{"key":"e_1_3_2_1_72_1","volume-title":"NSDI","author":"Ousterhout Amy","year":"2019","unstructured":"Amy Ousterhout, Joshua Fried, Jonathan Behrens, Adam Belay, and Hari Balakrishnan. Shenango: Achieving high {CPU} efficiency for latency-sensitive datacenter workloads. In NSDI, 2019."},{"key":"e_1_3_2_1_73_1","volume-title":"Splitwise: Efficient generative llm inference using phase splitting","author":"Patel Pratyush","year":"2024","unstructured":"Pratyush Patel, Esha Choukse, Chaojie Zhang, Aashaka Shah, \u00cd\u00f1igo Goiri, Saeed Maleki, and Ricardo Bianchini. Splitwise: Efficient generative llm inference using phase splitting. In ISCA. IEEE, 2024."},{"key":"e_1_3_2_1_74_1","volume-title":"NSDI","author":"Pfaff Ben","year":"2015","unstructured":"Ben Pfaff, Justin Pettit, Teemu Koponen, Ethan Jackson, Andy Zhou, Jarno Rajahalme, Jesse Gross, Alex Wang, Joe Stringer, Pravin Shelar, et al. The design and implementation of open {vSwitch}. In NSDI, 2015."},{"key":"e_1_3_2_1_75_1","volume-title":"OSDI","author":"Pismenny Boris","year":"2023","unstructured":"Boris Pismenny, Adam Morrison, and Dan Tsafrir. {ShRing}: Networking with shared receive rings. In OSDI, 2023."},{"key":"e_1_3_2_1_76_1","doi-asserted-by":"publisher","DOI":"10.1145\/3132747.3132780"},{"key":"e_1_3_2_1_77_1","volume-title":"SIGCOMM","author":"Qian Kun","year":"2024","unstructured":"Kun Qian, Yongqing Xi, Jiamin Cao, Jiaqi Gao, Yichi Xu, Yu Guan, Binzhang Fu, Xuemei Shi, Fangbo Zhu, Rui Miao, et al. Alibaba hpn: A data center network for large language model training. In SIGCOMM, 2024."},{"key":"e_1_3_2_1_78_1","volume-title":"FAST","author":"Qin Ruoyu","year":"2025","unstructured":"Ruoyu Qin, Zheming Li, Weiran He, Jialei Cui, Feng Ren, Mingxing Zhang, Yongwei Wu, Weimin Zheng, and Xinran Xu. Mooncake: Trading more storage for less computation\u2014a {KVCache-centric} architecture for serving {LLM} chatbot. In FAST, 2025."},{"key":"e_1_3_2_1_79_1","doi-asserted-by":"publisher","DOI":"10.1109\/HCS61935.2024.10664947"},{"key":"e_1_3_2_1_80_1","volume-title":"RDMA core userspace libraries and daemons. https:\/\/github.com\/linux-rdma\/rdma-core","author":"Core RDMA","year":"2024","unstructured":"RDMA Core. RDMA core userspace libraries and daemons. https:\/\/github.com\/linux-rdma\/rdma-core, 2024."},{"key":"e_1_3_2_1_81_1","doi-asserted-by":"publisher","DOI":"10.1145\/3617232.3624857"},{"key":"e_1_3_2_1_82_1","volume-title":"OSDI","author":"Ren Zhenghang","year":"2025","unstructured":"Zhenghang Ren, Yuxuan Li, Zilong Wang, Xinyang Huang, Wenxue Li, Kaiqiang Xu, Xudong Liao, Yijun Sun, Bowen Liu, Han Tian, et al. Enabling efficient {GPU} communication over multiple {NICs} with {FuseLink}. In OSDI, 2025."},{"key":"e_1_3_2_1_83_1","volume-title":"OSDI","author":"Sadok Hugo","year":"2023","unstructured":"Hugo Sadok, Nirav Atre, Zhipeng Zhao, Daniel S Berger, James C Hoe, Aurojit Panda, Justine Sherry, and Ren Wang. {Ens\u03c9 }: A streaming interface for {NIC-Application} communication. In OSDI, 2023."},{"key":"e_1_3_2_1_84_1","volume-title":"ASPLOS","author":"Schuh Henry N","year":"2021","unstructured":"Henry N Schuh, Weihao Liang, Ming Liu, Jacob Nelson, and Arvind Krishnamurthy. Xenic: Smartnic-accelerated distributed transactions. In ASPLOS, 2021."},{"key":"e_1_3_2_1_85_1","doi-asserted-by":"publisher","DOI":"10.1109\/MM.2020.3016891"},{"key":"e_1_3_2_1_86_1","volume-title":"ATC","author":"Shalev Leah","year":"2010","unstructured":"Leah Shalev, Julian Satran, Eran Borovik, and Muli Ben-Yehuda. IsoStack\u2014Highly efficient network processing on dedicated cores. In ATC, 2010."},{"key":"e_1_3_2_1_87_1","volume-title":"NSDI","author":"Shashidhara Rajath","year":"2022","unstructured":"Rajath Shashidhara, Tim Stamler, Antoine Kaufmann, and Simon Peter. {FlexTOE}: Flexible {TCP} offload with {Fine-Grained} parallelism. In NSDI, 2022."},{"key":"e_1_3_2_1_88_1","volume-title":"OSDI","author":"Shu Junyi","year":"2024","unstructured":"Junyi Shu, Kun Qian, Ennan Zhai, Xuanzhe Liu, and Xin Jin. Burstable cloud block storage with data processing units. In OSDI, 2024."},{"key":"e_1_3_2_1_89_1","doi-asserted-by":"publisher","DOI":"10.1145\/3582016.3582027"},{"key":"e_1_3_2_1_90_1","doi-asserted-by":"publisher","DOI":"10.1145\/3342195.3387519"},{"key":"e_1_3_2_1_91_1","doi-asserted-by":"publisher","DOI":"10.1145\/3387514.3405897"},{"key":"e_1_3_2_1_92_1","volume-title":"OSDI","author":"Skiadopoulos Athinagoras","year":"2024","unstructured":"Athinagoras Skiadopoulos, Zhiqiang Xie, Mark Zhao, Qizhe Cai, Saksham Agarwal, Jacob Adelmann, David Ahern, Carlo Contavalli, Michael Goldflam, Vitaly Mayatskikh, et al. High-throughput and flexible host networking for accelerated computing. In OSDI, 2024."},{"key":"e_1_3_2_1_93_1","volume-title":"Meili: Enabling smart-nic as a service in the cloud. arXiv preprint arXiv:2312.11871","author":"Su Qiang","year":"2023","unstructured":"Qiang Su, Shaofeng Wu, Zhixiong Niu, Ran Shu, Peng Cheng, Yongqiang Xiong, Zaoxing Liu, and Hong Xu. Meili: Enabling smart-nic as a service in the cloud. arXiv preprint arXiv:2312.11871, 2023."},{"key":"e_1_3_2_1_94_1","doi-asserted-by":"publisher","DOI":"10.1145\/3613424.3614256"},{"key":"e_1_3_2_1_95_1","doi-asserted-by":"publisher","DOI":"10.1109\/INFOCOM53939.2023.10228968"},{"key":"e_1_3_2_1_96_1","volume-title":"NSDI","author":"Tootoonchian Amin","year":"2018","unstructured":"Amin Tootoonchian, Aurojit Panda, Chang Lan, Melvin Walls, Katerina Argyraki, Sylvia Ratnasamy, and Scott Shenker. {ResQ}: Enabling {SLOs} in network function virtualization. In NSDI, 2018."},{"key":"e_1_3_2_1_97_1","doi-asserted-by":"publisher","DOI":"10.1145\/3132747.3132762"},{"key":"e_1_3_2_1_98_1","doi-asserted-by":"publisher","DOI":"10.1145\/3651890.3672271"},{"key":"e_1_3_2_1_99_1","volume-title":"NSDI","author":"Wang Hao","year":"2024","unstructured":"Hao Wang, Han Tian, Jingrong Chen, Xinchen Wan, Jiacheng Xia, Gaoxiong Zeng, Wei Bai, Junchen Jiang, Yong Wang, and Kai Chen. Towards {Domain-Specific} network transport for distributed {DNN} training. In NSDI, 2024."},{"key":"e_1_3_2_1_100_1","doi-asserted-by":"publisher","DOI":"10.1109\/ICNP52444.2021.9651935"},{"key":"e_1_3_2_1_101_1","volume-title":"NSDI","author":"Wang Zilong","year":"2023","unstructured":"Zilong Wang, Layong Luo, Qingsong Ning, Chaoliang Zeng, Wenxue Li, Xinchen Wan, Peng Xie, Tao Feng, Ke Cheng, Xiongfei Geng, et al. {SRNIC}: A scalable architecture for {RDMA}{NICs}. In NSDI, 2023."},{"key":"e_1_3_2_1_102_1","volume-title":"OSDI","author":"Wei Xingda","year":"2023","unstructured":"Xingda Wei, Rongxin Cheng, Yuhan Yang, Rong Chen, and Haibo Chen. Characterizing off-path smartnic for accelerating distributed systems. In OSDI, 2023."},{"key":"e_1_3_2_1_103_1","volume-title":"Hybrid is better! In OSDI","author":"Wei Xingda","year":"2018","unstructured":"Xingda Wei, Zhiyuan Dong, Rong Chen, and Haibo Chen. Deconstructing {RDMA-enabled} distributed transactions: Hybrid is better! In OSDI, 2018."},{"key":"e_1_3_2_1_104_1","volume-title":"ATC","author":"Wei Xingda","year":"2022","unstructured":"Xingda Wei, Fangming Lu, Rong Chen, and Haibo Chen. {KRCORE}: A microsecond-scale {RDMA} control plane for elastic computing. In ATC, 2022."},{"key":"e_1_3_2_1_105_1","volume-title":"ATC","author":"Xu Yunhong","year":"2022","unstructured":"Yunhong Xu, Keqiang He, Rui Wang, Minlan Yu, Nick Duffield, Hassan Wassel, Shidong Zhang, Leon Poutievski, Junlan Zhou, and Amin Vahdat. Hashing design in modern networks: Challenges and mitigation techniques. In ATC, 2022."},{"key":"e_1_3_2_1_106_1","doi-asserted-by":"publisher","DOI":"10.1145\/3603269.3604837"},{"key":"e_1_3_2_1_107_1","volume-title":"Don't forget the i\/o when allocating your llc","author":"Yuan Yifan","year":"2021","unstructured":"Yifan Yuan, Mohammad Alian, Yipeng Wang, Ren Wang, Ilia Kurakin, Charlie Tai, and Nam Sung Kim. Don't forget the i\/o when allocating your llc. In ISCA. IEEE, 2021."},{"key":"e_1_3_2_1_108_1","doi-asserted-by":"publisher","DOI":"10.1109\/PADSW.2018.8645059"},{"key":"e_1_3_2_1_109_1","volume-title":"Rpcacc: A high-performance and reconfigurable pcie-attached rpc accelerator. arXiv preprint arXiv:2411.07632","author":"Zhang Jie","year":"2024","unstructured":"Jie Zhang, Hongjing Huang, Xuzheng Chen, Xiang Li, Ming Liu, and Zeke Wang. Rpcacc: A high-performance and reconfigurable pcie-attached rpc accelerator. arXiv preprint arXiv:2411.07632, 2024."},{"key":"e_1_3_2_1_110_1","volume-title":"ISCA","author":"Zhang Jie","year":"2023","unstructured":"Jie Zhang, Hongjing Huang, Lingjun Zhu, Shu Ma, Dazhong Rong, Yijun Hou, Mo Sun, Chaojie Gu, Peng Cheng, Chao Shi, et al. Smartds: Middle-tier-centric smartnic enabling application-aware message split for disaggregated block storage. In ISCA, 2023."},{"key":"e_1_3_2_1_111_1","volume-title":"Dds: Dpu-optimized disaggregated storage. arXiv preprint arXiv:2407.13618","author":"Zhang Qizhen","year":"2024","unstructured":"Qizhen Zhang, Philip Bernstein, Badrish Chandramouli, Jiasheng Hu, and Yiming Zheng. Dds: Dpu-optimized disaggregated storage. arXiv preprint arXiv:2407.13618, 2024."},{"key":"e_1_3_2_1_112_1","doi-asserted-by":"publisher","DOI":"10.1145\/3514221.3517856"},{"key":"e_1_3_2_1_113_1","volume-title":"NSDI","author":"Zhang Yiwen","year":"2022","unstructured":"Yiwen Zhang, Yue Tan, Brent Stephens, and Mosharaf Chowdhury. Justitia: Software {Multi-Tenancy} in hardware {Kernel-Bypass} networks. In NSDI, 2022."},{"key":"e_1_3_2_1_114_1","volume-title":"NSDI","author":"Zhao Chenxingyu","year":"2025","unstructured":"Chenxingyu Zhao, Jaehong Min, Ming Liu, and Arvind Krishnamurthy. {White-Boxing} {RDMA} with {Packet-Granular} software control. In NSDI, 2025."},{"key":"e_1_3_2_1_115_1","volume-title":"CoNEXT","author":"Zhao Yimeng","year":"2019","unstructured":"Yimeng Zhao, Ahmed Saeed, Ellen Zegura, and Mostafa Ammar. Zd: a scalable zero-drop network stack at end hosts. In CoNEXT, 2019."},{"key":"e_1_3_2_1_116_1","volume-title":"OSDI","author":"Zhong Yinmin","year":"2024","unstructured":"Yinmin Zhong, Shengyu Liu, Junda Chen, Jianbo Hu, Yibo Zhu, Xuanzhe Liu, Xin Jin, and Hao Zhang. {DistServe}: Disaggregating prefill and decoding for goodput-optimized large language model serving. In OSDI, 2024."},{"key":"e_1_3_2_1_117_1","volume-title":"ATC","author":"Zhu Lingjun","year":"2023","unstructured":"Lingjun Zhu, Yifan Shen, Erci Xu, Bo Shi, Ting Fu, Shu Ma, Shuguang Chen, Zhongyu Wang, Haonan Wu, Xingyu Liao, et al. Deploying user-space {TCP} at cloud scale with {LUNA}. In ATC, 2023."},{"key":"e_1_3_2_1_118_1","doi-asserted-by":"publisher","DOI":"10.1145\/2785956.2787484"},{"key":"e_1_3_2_1_119_1","volume-title":"ATC","author":"Zuo Pengfei","year":"2021","unstructured":"Pengfei Zuo, Jiazhao Sun, Liu Yang, Shuangwu Zhang, and Yu Hua. One-sided { RDMA-Conscious} extendible hashing for disaggregated memory. In ATC, 2021."}],"event":{"name":"EUROSYS '26: 21st European Conference on Computer Systems","location":"McEwan Hall\/The University of Edinburgh Edinburgh Scotland UK","acronym":"EUROSYS '26","sponsor":["SIGOPS ACM Special Interest Group on Operating Systems"]},"container-title":["Proceedings of the 21st European Conference on Computer Systems"],"original-title":[],"link":[{"URL":"https:\/\/dl.acm.org\/doi\/pdf\/10.1145\/3767295.3803594","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2026,6,5]],"date-time":"2026-06-05T12:19:34Z","timestamp":1780661974000},"score":1,"resource":{"primary":{"URL":"https:\/\/dl.acm.org\/doi\/10.1145\/3767295.3803594"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2026,4,26]]},"references-count":119,"alternative-id":["10.1145\/3767295.3803594","10.1145\/3767295"],"URL":"https:\/\/doi.org\/10.1145\/3767295.3803594","relation":{},"subject":[],"published":{"date-parts":[[2026,4,26]]},"assertion":[{"value":"2026-04-26","order":3,"name":"published","label":"Published","group":{"name":"publication_history","label":"Publication History"}}]}}