TB or Not TB: Coverage-Driven Direct Preference Optimization for Verilog Stimulus Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nadimi, Bardia, Filom, Khashayar, Chen, Deming, Zheng, Hao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Multi-Expert Large Language Model Architecture for Verilog Code Generation
par: Nadimi, Bardia, et autres
Publié: (2024)
par: Nadimi, Bardia, et autres
Publié: (2024)
VeriMind: Agentic LLM for Automated Verilog Generation with a Novel Evaluation Metric
par: Nadimi, Bardia, et autres
Publié: (2025)
par: Nadimi, Bardia, et autres
Publié: (2025)
PyraNet: A Multi-Layered Hierarchical Dataset for Verilog
par: Nadimi, Bardia, et autres
Publié: (2024)
par: Nadimi, Bardia, et autres
Publié: (2024)
Rate or Fate? RLV$^\varepsilon$R: Reinforcement Learning with Verifiable Noisy Rewards
par: Rad, Ali, et autres
Publié: (2026)
par: Rad, Ali, et autres
Publié: (2026)
VeriReason: Reinforcement Learning with Testbench Feedback for Reasoning-Enhanced Verilog Generation
par: Wang, Yiting, et autres
Publié: (2025)
par: Wang, Yiting, et autres
Publié: (2025)
hdl2v: A Code Translation Dataset for Enhanced LLM Verilog Generation
par: Hong, Charles, et autres
Publié: (2025)
par: Hong, Charles, et autres
Publié: (2025)
AI based SystemVerilog TB generation
par: Bhavin Shah
Publié: (2017)
par: Bhavin Shah
Publié: (2017)
Mechanistic interpretability of large language models with applications to the financial services industry
par: Golgoon, Ashkan, et autres
Publié: (2024)
par: Golgoon, Ashkan, et autres
Publié: (2024)
CoopetitiveV: Leveraging LLM-powered Coopetitive Multi-Agent Prompting for High-quality Verilog Generation
par: Mi, Zhendong, et autres
Publié: (2024)
par: Mi, Zhendong, et autres
Publié: (2024)
Orthogonal Finetuning for Direct Preference Optimization
par: Yang, Chenxu, et autres
Publié: (2024)
par: Yang, Chenxu, et autres
Publié: (2024)
$\textbf{PLUM}$: Improving Code LMs with Execution-Guided On-Policy Preference Learning Driven By Synthetic Test Cases
par: Zhang, Dylan, et autres
Publié: (2024)
par: Zhang, Dylan, et autres
Publié: (2024)
Filtered Direct Preference Optimization
par: Morimura, Tetsuro, et autres
Publié: (2024)
par: Morimura, Tetsuro, et autres
Publié: (2024)
Direct Preference Optimization with an Offset
par: Amini, Afra, et autres
Publié: (2024)
par: Amini, Afra, et autres
Publié: (2024)
ECCO: Evidence-Driven Causal Reasoning for Compiler Optimization
par: Pan, Haolin, et autres
Publié: (2026)
par: Pan, Haolin, et autres
Publié: (2026)
Entropy Controllable Direct Preference Optimization
par: Omura, Motoki, et autres
Publié: (2024)
par: Omura, Motoki, et autres
Publié: (2024)
Unintentional Unalignment: Likelihood Displacement in Direct Preference Optimization
par: Razin, Noam, et autres
Publié: (2024)
par: Razin, Noam, et autres
Publié: (2024)
EvolVE: Evolutionary Search for LLM-based Verilog Generation and Optimization
par: Hsin, Wei-Po, et autres
Publié: (2026)
par: Hsin, Wei-Po, et autres
Publié: (2026)
Direct Nash Optimization: Teaching Language Models to Self-Improve with General Preferences
par: Rosset, Corby, et autres
Publié: (2024)
par: Rosset, Corby, et autres
Publié: (2024)
A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications
par: Xiao, Wenyi, et autres
Publié: (2024)
par: Xiao, Wenyi, et autres
Publié: (2024)
From Large to Small: Transferring CUDA Optimization Expertise via Reasoning Graph
par: Gong, Junfeng, et autres
Publié: (2025)
par: Gong, Junfeng, et autres
Publié: (2025)
ChipSeek: Optimizing Verilog Generation via EDA-Integrated Reinforcement Learning
par: Chen, Zhirong, et autres
Publié: (2025)
par: Chen, Zhirong, et autres
Publié: (2025)
BetterV: Controlled Verilog Generation with Discriminative Guidance
par: Pei, Zehua, et autres
Publié: (2024)
par: Pei, Zehua, et autres
Publié: (2024)
PassNet: Scaling Large Language Models for Graph Compiler Pass Generation
par: Liu, Yiqun, et autres
Publié: (2026)
par: Liu, Yiqun, et autres
Publié: (2026)
Magellan: Autonomous Discovery of Novel Compiler Optimization Heuristics with AlphaEvolve
par: Chen, Hongzheng, et autres
Publié: (2026)
par: Chen, Hongzheng, et autres
Publié: (2026)
TGDPO: Harnessing Token-Level Reward Guidance for Enhancing Direct Preference Optimization
par: Zhu, Mingkang, et autres
Publié: (2025)
par: Zhu, Mingkang, et autres
Publié: (2025)
AlphaDPO: Adaptive Reward Margin for Direct Preference Optimization
par: Wu, Junkang, et autres
Publié: (2024)
par: Wu, Junkang, et autres
Publié: (2024)
Towards Robust Alignment of Language Models: Distributionally Robustifying Direct Preference Optimization
par: Wu, Junkang, et autres
Publié: (2024)
par: Wu, Junkang, et autres
Publié: (2024)
Chain of Execution Supervision Promotes General Reasoning in Large Language Models
par: Chen, Nuo, et autres
Publié: (2025)
par: Chen, Nuo, et autres
Publié: (2025)
AutoPDL: Automatic Prompt Optimization for LLM Agents
par: Spiess, Claudio, et autres
Publié: (2025)
par: Spiess, Claudio, et autres
Publié: (2025)
From Reasoning to Code: GRPO Optimization for Underrepresented Languages
par: Pennino, Federico, et autres
Publié: (2025)
par: Pennino, Federico, et autres
Publié: (2025)
Inducing Robustness in a 2 Dimensional Direct Preference Optimization Paradigm
par: Shashidhar, Sarvesh, et autres
Publié: (2025)
par: Shashidhar, Sarvesh, et autres
Publié: (2025)
Differential Information Distribution: A Bayesian Perspective on Direct Preference Optimization
par: Won, Yunjae, et autres
Publié: (2025)
par: Won, Yunjae, et autres
Publié: (2025)
Online DPO: Online Direct Preference Optimization with Fast-Slow Chasing
par: Qi, Biqing, et autres
Publié: (2024)
par: Qi, Biqing, et autres
Publié: (2024)
REASONING COMPILER: LLM-Guided Optimizations for Efficient Model Serving
par: Tang, Annabelle Sujun, et autres
Publié: (2025)
par: Tang, Annabelle Sujun, et autres
Publié: (2025)
The Importance of Online Data: Understanding Preference Fine-tuning via Coverage
par: Song, Yuda, et autres
Publié: (2024)
par: Song, Yuda, et autres
Publié: (2024)
TSO: Self-Training with Scaled Preference Optimization
par: Chen, Kaihui, et autres
Publié: (2024)
par: Chen, Kaihui, et autres
Publié: (2024)
SoD$^2$: Statically Optimizing Dynamic Deep Neural Network
par: Niu, Wei, et autres
Publié: (2024)
par: Niu, Wei, et autres
Publié: (2024)
ProofOptimizer: Training Language Models to Simplify Proofs without Human Demonstrations
par: Gu, Alex, et autres
Publié: (2025)
par: Gu, Alex, et autres
Publié: (2025)
Direct Preference Optimization: Your Language Model is Secretly a Reward Model
par: Rafailov, Rafael, et autres
Publié: (2023)
par: Rafailov, Rafael, et autres
Publié: (2023)
Tilus: A Tile-Level GPGPU Programming Language for Low-Precision Computation
par: Ding, Yaoyao, et autres
Publié: (2025)
par: Ding, Yaoyao, et autres
Publié: (2025)
Documents similaires
-
A Multi-Expert Large Language Model Architecture for Verilog Code Generation
par: Nadimi, Bardia, et autres
Publié: (2024) -
VeriMind: Agentic LLM for Automated Verilog Generation with a Novel Evaluation Metric
par: Nadimi, Bardia, et autres
Publié: (2025) -
PyraNet: A Multi-Layered Hierarchical Dataset for Verilog
par: Nadimi, Bardia, et autres
Publié: (2024) -
Rate or Fate? RLV$^\varepsilon$R: Reinforcement Learning with Verifiable Noisy Rewards
par: Rad, Ali, et autres
Publié: (2026) -
VeriReason: Reinforcement Learning with Testbench Feedback for Reasoning-Enhanced Verilog Generation
par: Wang, Yiting, et autres
Publié: (2025)