Reinforcement Learning from Automatic Feedback for High-Quality Unit Test Generation
Fuente:
arXiv
Saved in:
| Main Authors: | Steenhoek, Benjamin, Tufano, Michele, Sundaresan, Neel, Svyatkovskiy, Alexey |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Reinforcement Learning from Automatic Feedback for High-Quality Unit Test Generation
by: Steenhoek, Benjamin, et al.
Published: (2023)
by: Steenhoek, Benjamin, et al.
Published: (2023)
Enabling Global, Human-Centered Explanations for LLMs:From Tokens to Interpretable Code and Test Generation
by: Khati, Dipin, et al.
Published: (2025)
by: Khati, Dipin, et al.
Published: (2025)
AutoDev: Automated AI-Driven Development
by: Tufano, Michele, et al.
Published: (2024)
by: Tufano, Michele, et al.
Published: (2024)
Leveraging Reward Models for Guiding Code Review Comment Generation
by: Sghaier, Oussama Ben, et al.
Published: (2025)
by: Sghaier, Oussama Ben, et al.
Published: (2025)
Towards Verified Code Reasoning by LLMs
by: Sistla, Meghana, et al.
Published: (2025)
by: Sistla, Meghana, et al.
Published: (2025)
PrismaDV: Automated Task-Aware Data Unit Test Generation
by: Chen, Hao, et al.
Published: (2026)
by: Chen, Hao, et al.
Published: (2026)
FeedbackLLM: Metadata driven Multi-Agentic Language Agnostic Test Case Generator with Evolving prompt and Coverage Feedback
by: Jasti, Kushal, et al.
Published: (2026)
by: Jasti, Kushal, et al.
Published: (2026)
Closing the Gap: A User Study on the Real-world Usefulness of AI-powered Vulnerability Detection & Repair in the IDE
by: Steenhoek, Benjamin, et al.
Published: (2024)
by: Steenhoek, Benjamin, et al.
Published: (2024)
Learning to Generate Unit Tests for Automated Debugging
by: Prasad, Archiki, et al.
Published: (2025)
by: Prasad, Archiki, et al.
Published: (2025)
RM -RF: Reward Model for Run-Free Unit Test Evaluation
by: Bruches, Elena, et al.
Published: (2026)
by: Bruches, Elena, et al.
Published: (2026)
Adaptive Reinforcement Learning for Dynamic Configuration Allocation in Pre-Production Testing
by: Zhu, Yu
Published: (2025)
by: Zhu, Yu
Published: (2025)
CPP-UT-Bench: Can LLMs Write Complex Unit Tests in C++?
by: Bhargava, Vaishnavi, et al.
Published: (2024)
by: Bhargava, Vaishnavi, et al.
Published: (2024)
FRANC: A Lightweight Framework for High-Quality Code Generation
by: Siddiq, Mohammed Latif, et al.
Published: (2023)
by: Siddiq, Mohammed Latif, et al.
Published: (2023)
On Extending the Automatic Test Markup Language (ATML) for Machine Learning
by: Cody, Tyler, et al.
Published: (2024)
by: Cody, Tyler, et al.
Published: (2024)
To Err is Machine: Vulnerability Detection Challenges LLM Reasoning
by: Steenhoek, Benjamin, et al.
Published: (2024)
by: Steenhoek, Benjamin, et al.
Published: (2024)
Automatic Generation of High-Performance RL Environments
by: Karten, Seth, et al.
Published: (2026)
by: Karten, Seth, et al.
Published: (2026)
Domain-Adaptable Reinforcement Learning for Code Generation with Dense Rewards
by: Jolfaei, Erfan Aghadavoodi, et al.
Published: (2026)
by: Jolfaei, Erfan Aghadavoodi, et al.
Published: (2026)
GRAPH-GRPO-LEX: Contract Graph Modeling and Reinforcement Learning with Group Relative Policy Optimization
by: Dechtiar, Moriya, et al.
Published: (2025)
by: Dechtiar, Moriya, et al.
Published: (2025)
Reinforcement Learning for Testing Interdependent Requirements in Autonomous Vehicles: An Empirical Study
by: Wu, Jiahui, et al.
Published: (2025)
by: Wu, Jiahui, et al.
Published: (2025)
Parameter-Efficient Fine-Tuning of Large Language Models for Unit Test Generation: An Empirical Study
by: Storhaug, André, et al.
Published: (2024)
by: Storhaug, André, et al.
Published: (2024)
Automatically Generating Single-Responsibility Unit Tests
by: Galindo-Gutierrez, Geraldine
Published: (2025)
by: Galindo-Gutierrez, Geraldine
Published: (2025)
CoCoST: Automatic Complex Code Generation with Online Searching and Correctness Testing
by: He, Xinyi, et al.
Published: (2024)
by: He, Xinyi, et al.
Published: (2024)
Latent Regularization in Generative Test Input Generation
by: Merabishvili, Giorgi, et al.
Published: (2026)
by: Merabishvili, Giorgi, et al.
Published: (2026)
An Exploratory Study on Automatic Identification of Assumptions in the Development of Deep Learning Frameworks
by: Yang, Chen, et al.
Published: (2024)
by: Yang, Chen, et al.
Published: (2024)
Otter: Generating Tests from Issues to Validate SWE Patches
by: Ahmed, Toufique, et al.
Published: (2025)
by: Ahmed, Toufique, et al.
Published: (2025)
Using Quality Attribute Scenarios for ML Model Test Case Generation
by: Brower-Sinning, Rachel, et al.
Published: (2024)
by: Brower-Sinning, Rachel, et al.
Published: (2024)
Automatically Testing Functional Properties of Code Translation Models
by: Eniser, Hasan Ferit, et al.
Published: (2023)
by: Eniser, Hasan Ferit, et al.
Published: (2023)
Copilot Evaluation Harness: Evaluating LLM-Guided Software Programming
by: Agarwal, Anisha, et al.
Published: (2024)
by: Agarwal, Anisha, et al.
Published: (2024)
PyTorch-based Geometric Learning with Non-CUDA Processing Units: Experiences from Intel Gaudi-v2 HPUs
by: Bu, Fanchen, et al.
Published: (2025)
by: Bu, Fanchen, et al.
Published: (2025)
Quality-Driven Selective Mutation for Deep Learning
by: Ahmed, Zaheed, et al.
Published: (2026)
by: Ahmed, Zaheed, et al.
Published: (2026)
ENCORE: Ensemble Learning using Convolution Neural Machine Translation for Automatic Program Repair
by: Lutellier, Thibaud, et al.
Published: (2019)
by: Lutellier, Thibaud, et al.
Published: (2019)
The Fault in our Stars: Quality Assessment of Code Generation Benchmarks
by: Siddiq, Mohammed Latif, et al.
Published: (2024)
by: Siddiq, Mohammed Latif, et al.
Published: (2024)
SQAPlanner: Generating Data-Informed Software Quality Improvement Plans
by: Rajapaksha, Dilini, et al.
Published: (2021)
by: Rajapaksha, Dilini, et al.
Published: (2021)
Targeted Deep Learning System Boundary Testing
by: Weißl, Oliver, et al.
Published: (2024)
by: Weißl, Oliver, et al.
Published: (2024)
Automated Trustworthiness Testing for Machine Learning Classifiers
by: Cho, Steven, et al.
Published: (2024)
by: Cho, Steven, et al.
Published: (2024)
HyperNet-Adaptation for Diffusion-Based Test Case Generation
by: Weißl, Oliver, et al.
Published: (2026)
by: Weißl, Oliver, et al.
Published: (2026)
RefactorBench: Evaluating Stateful Reasoning in Language Agents Through Code
by: Gautam, Dhruv, et al.
Published: (2025)
by: Gautam, Dhruv, et al.
Published: (2025)
Enhancing Code Quality with Generative AI: Boosting Developer Warning Compliance
by: Chang, Hansen, et al.
Published: (2025)
by: Chang, Hansen, et al.
Published: (2025)
Assessing the Quality and Security of AI-Generated Code: A Quantitative Analysis
by: Sabra, Abbas, et al.
Published: (2025)
by: Sabra, Abbas, et al.
Published: (2025)
Saving SWE-Bench: A Benchmark Mutation Approach for Realistic Agent Evaluation
by: Garg, Spandan, et al.
Published: (2025)
by: Garg, Spandan, et al.
Published: (2025)
Similar Items
-
Reinforcement Learning from Automatic Feedback for High-Quality Unit Test Generation
by: Steenhoek, Benjamin, et al.
Published: (2023) -
Enabling Global, Human-Centered Explanations for LLMs:From Tokens to Interpretable Code and Test Generation
by: Khati, Dipin, et al.
Published: (2025) -
AutoDev: Automated AI-Driven Development
by: Tufano, Michele, et al.
Published: (2024) -
Leveraging Reward Models for Guiding Code Review Comment Generation
by: Sghaier, Oussama Ben, et al.
Published: (2025) -
Towards Verified Code Reasoning by LLMs
by: Sistla, Meghana, et al.
Published: (2025)