{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,3,11]],"date-time":"2026-03-11T16:47:49Z","timestamp":1773247669553,"version":"3.50.1"},"reference-count":31,"publisher":"IEEE","license":[{"start":{"date-parts":[[2025,6,22]],"date-time":"2025-06-22T00:00:00Z","timestamp":1750550400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2025,6,22]],"date-time":"2025-06-22T00:00:00Z","timestamp":1750550400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2025,6,22]]},"DOI":"10.1109\/dac63849.2025.11132897","type":"proceedings-article","created":{"date-parts":[[2025,9,15]],"date-time":"2025-09-15T17:35:41Z","timestamp":1757957741000},"page":"1-7","source":"Crossref","is-referenced-by-count":1,"title":["Hardware Generation with High Flexibility using Reinforcement Learning Enhanced LLMs"],"prefix":"10.1109","author":[{"given":"Yifang","family":"Zhao","sequence":"first","affiliation":[{"name":"University of Science and Technology of China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Weimin","family":"Fu","sequence":"additional","affiliation":[{"name":"Kansas State University"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Shijie","family":"Li","sequence":"additional","affiliation":[{"name":"University of Science and Technology of China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yi-Xiang","family":"Hu","sequence":"additional","affiliation":[{"name":"University of Science and Technology of China"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Xiaolong","family":"Guo","sequence":"additional","affiliation":[{"name":"Kansas State University"}],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yier","family":"Jin","sequence":"additional","affiliation":[{"name":"University of Science and Technology of China"}],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/T-ED.1976.18467"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.23919\/date.2017.7927194"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1109\/socc.2015.7406927"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1109\/tvlsi.2021.3105028"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/12.83619"},{"key":"ref6","article-title":"Gpt-4 Technical Report","volume-title":"ArXiv, Tech. Rep. abs\/2303.08774","year":"2023"},{"key":"ref7","first-page":"349","article-title":"Hardware phi-1.5b: A large language model encodes hardware domain specific knowledge","volume-title":"Proceedings of the 29th Asia and South Pacific Design Automation Conference","author":"Fu"},{"key":"ref8","first-page":"1","article-title":"Invited paper: Verilogeval: Evaluating large language models for verilog code generation","volume-title":"IEEE\/ACM International Conference on Computer Aided Design, ICCAD 2023","author":"Liu"},{"key":"ref9","article-title":"Betterv: Controlled verilog generation with discriminative guidance","volume-title":"Forty-first International Conference on Machine Learning, ICML 2024","author":"Pei"},{"key":"ref10","article-title":"Autochip: Automating HDL generation using LLM feedback","volume":"abs\/2311.04887","author":"Thakur","year":"2023","journal-title":"CoRR"},{"key":"ref11","article-title":"Reinforcement learning from human feedback: Progress and challenges","author":"Schulman","year":"2023","journal-title":"Berkeley EECS Colloquium. YouTube"},{"key":"ref12","first-page":"228","article-title":"On the importance of data size in probing fine-tuned models","author":"Mehrafarin","year":"2022","journal-title":"Findings of the Association for Computational Linguistics: ACL 2022"},{"key":"ref13","first-page":"10879","article-title":"The dawn after the dark: An empirical study on factuality hallucination in large language models","volume-title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics","volume":"1","author":"Li"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1145\/3380446.3430634"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1109\/mlcad58807.2023.10299874"},{"key":"ref16","article-title":"Chipgpt: How far are we from natural language hardware design","volume":"abs\/2305.14019","author":"Chang","year":"2023","journal-title":"CoRR"},{"key":"ref17","first-page":"212","article-title":"Generating secure hardware using chatgpt resistant to cwes","author":"Nair","year":"2023","journal-title":"IACR Cryptol. ePrint Arch."},{"key":"ref18","article-title":"Meet claude","year":"2023"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/tcsi.2024.3487486"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/asianhost59942.2023.10409307"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1109\/LAD62341.2024.10691788"},{"key":"ref22","article-title":"Chipnemo: Domain-adapted 1 lms for chip design","author":"Liu","year":"2024"},{"key":"ref23","article-title":"RLHF workflow: From reward modeling to online RLHF","volume":"abs\/2405.07863","author":"Dong","year":"2024","journal-title":"CoRR"},{"key":"ref24","first-page":"42994307","article-title":"Deep reinforcement learning from human p","volume-title":"Advances in Neural Information Processing Systems 30: Annual Conference on Neural Information Processing Systems 2017","author":"Christiano"},{"key":"ref25","article-title":"Training language models to follow instructions with human feedback","volume-title":"Advances in Neural Information Processing Systems 35: Annual Conference on Neural Information Processing Systems 2022, NeurIPS 2022","author":"Ouyang"},{"key":"ref26","article-title":"Direct preference optimization: Your language model is secretly a reward model","volume-title":"Advances in Neural Information Processing Systems 36: Annual Conference on Neural Information Processing Systems 2023, NeurIPS 2023","author":"Rafailov"},{"key":"ref27","article-title":"Deepseek-coder: When the large language model meets programming - the rise of code intelligence","author":"Guo"},{"key":"ref28","article-title":"Synopsys design compiler","author":"Compiler","year":"2016","journal-title":"Pages\/default. aspx"},{"key":"ref29","article-title":"Rtlcoder dataset"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/asp-dac58780.2024.10473904"},{"key":"ref31","article-title":"Hello gpt-4o","year":"2024"}],"event":{"name":"2025 62nd ACM\/IEEE Design Automation Conference (DAC)","location":"San Francisco, CA, USA","start":{"date-parts":[[2025,6,22]]},"end":{"date-parts":[[2025,6,25]]}},"container-title":["2025 62nd ACM\/IEEE Design Automation Conference (DAC)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx8\/11132383\/11132091\/11132897.pdf?arnumber=11132897","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,9,16]],"date-time":"2025-09-16T05:24:43Z","timestamp":1758000283000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/11132897\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2025,6,22]]},"references-count":31,"URL":"https:\/\/doi.org\/10.1109\/dac63849.2025.11132897","relation":{},"subject":[],"published":{"date-parts":[[2025,6,22]]}}}