Automatic Generation of High-Performance RL Environments
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Karten, Seth, Appapogu, Rahul Dev, Jin, Chi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Talking with Verifiers: Automatic Specification Generation for Neural Network Verification
par: Elboher, Yizhak Y., et autres
Publié: (2026)
par: Elboher, Yizhak Y., et autres
Publié: (2026)
Automatic Generation of Executable BPMN Models from Medical Guidelines
par: Sekar, Praveen Kumar Menaka, et autres
Publié: (2026)
par: Sekar, Praveen Kumar Menaka, et autres
Publié: (2026)
Usability and Performance Analysis of Embedded Development Environment for On-device Learning
par: Scaffi, Enzo, et autres
Publié: (2024)
par: Scaffi, Enzo, et autres
Publié: (2024)
Kevin: Multi-Turn RL for Generating CUDA Kernels
par: Baronio, Carlo, et autres
Publié: (2025)
par: Baronio, Carlo, et autres
Publié: (2025)
Bridging Online and Offline RL: Contextual Bandit Learning for Multi-Turn Code Generation
par: Chen, Ziru, et autres
Publié: (2026)
par: Chen, Ziru, et autres
Publié: (2026)
Automatic Detection of LLM-Generated Code: A Comparative Case Study of Contemporary Models Across Function and Class Granularities
par: Rahman, Musfiqur, et autres
Publié: (2024)
par: Rahman, Musfiqur, et autres
Publié: (2024)
MIST-RL: Mutation-based Incremental Suite Testing via Reinforcement Learning
par: Zhu, Sicheng, et autres
Publié: (2026)
par: Zhu, Sicheng, et autres
Publié: (2026)
Automatic Programming: Large Language Models and Beyond
par: Lyu, Michael R., et autres
Publié: (2024)
par: Lyu, Michael R., et autres
Publié: (2024)
Predicting Configuration Performance in Multiple Environments with Sequential Meta-learning
par: Gong, Jingzhi, et autres
Publié: (2024)
par: Gong, Jingzhi, et autres
Publié: (2024)
REAP: Automatic Curation of Coding Agent Benchmarks from Interactive Production Usage
par: Jha, Smriti, et autres
Publié: (2026)
par: Jha, Smriti, et autres
Publié: (2026)
Assuring the Safety of Reinforcement Learning Components: AMLAS-RL
par: Imrie, Calum Corrie, et autres
Publié: (2025)
par: Imrie, Calum Corrie, et autres
Publié: (2025)
Beyond Synthetic Benchmarks: Evaluating LLM Performance on Real-World Class-Level Code Generation
par: Rahman, Musfiqur, et autres
Publié: (2025)
par: Rahman, Musfiqur, et autres
Publié: (2025)
The Impact of Environment Configurations on the Stability of AI-Enabled Systems
par: Rahman, Musfiqur, et autres
Publié: (2024)
par: Rahman, Musfiqur, et autres
Publié: (2024)
How Efficient is LLM-Generated Code? A Rigorous & High-Standard Benchmark
par: Qiu, Ruizhong, et autres
Publié: (2024)
par: Qiu, Ruizhong, et autres
Publié: (2024)
PIPer: On-Device Environment Setup via Online Reinforcement Learning
par: Kovrigin, Alexander, et autres
Publié: (2025)
par: Kovrigin, Alexander, et autres
Publié: (2025)
JARVIS: A Multi-Agent Code Assistant for High-Quality EDA Script Generation
par: Pasandi, Ghasem, et autres
Publié: (2025)
par: Pasandi, Ghasem, et autres
Publié: (2025)
Benchmarking Reward Hack Detection in Code Environments via Contrastive Analysis
par: Deshpande, Darshan, et autres
Publié: (2026)
par: Deshpande, Darshan, et autres
Publié: (2026)
CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification
par: Xu, Jiacheng, et autres
Publié: (2025)
par: Xu, Jiacheng, et autres
Publié: (2025)
SetupBench: Assessing Software Engineering Agents' Ability to Bootstrap Development Environments
par: Arora, Avi, et autres
Publié: (2025)
par: Arora, Avi, et autres
Publié: (2025)
Generative AI to Generate Test Data Generators
par: Baudry, Benoit, et autres
Publié: (2024)
par: Baudry, Benoit, et autres
Publié: (2024)
Deep Configuration Performance Learning: A Systematic Survey and Taxonomy
par: Gong, Jingzhi, et autres
Publié: (2024)
par: Gong, Jingzhi, et autres
Publié: (2024)
A Regression Framework for Understanding Prompt Component Impact on LLM Performance
par: Lauziere, Andrew, et autres
Publié: (2026)
par: Lauziere, Andrew, et autres
Publié: (2026)
Hardness, Structural Knowledge, and Opportunity: An Analytical Framework for Modular Performance Modeling
par: Gheibi, Omid, et autres
Publié: (2025)
par: Gheibi, Omid, et autres
Publié: (2025)
On the Impact of Black-box Deployment Strategies for Edge AI on Latency and Model Performance
par: Singh, Jaskirat, et autres
Publié: (2024)
par: Singh, Jaskirat, et autres
Publié: (2024)
Heterogeneous Directed Hypergraph Neural Network over abstract syntax tree (AST) for Code Classification
par: Yang, Guang, et autres
Publié: (2023)
par: Yang, Guang, et autres
Publié: (2023)
LLM Benchmarking with LLaMA2: Evaluating Code Development Performance Across Multiple Programming Languages
par: Diehl, Patrick, et autres
Publié: (2025)
par: Diehl, Patrick, et autres
Publié: (2025)
Operational Robustness of LLMs on Code Generation
par: Paul, Debalina Ghosh, et autres
Publié: (2026)
par: Paul, Debalina Ghosh, et autres
Publié: (2026)
Can Coding Agents Be General Agents?
par: Ivanov, Maksim, et autres
Publié: (2026)
par: Ivanov, Maksim, et autres
Publié: (2026)
Optimizing AI-Assisted Code Generation
par: Torka, Simon, et autres
Publié: (2024)
par: Torka, Simon, et autres
Publié: (2024)
Toward Training Superintelligent Software Agents through Self-Play SWE-RL
par: Wei, Yuxiang, et autres
Publié: (2025)
par: Wei, Yuxiang, et autres
Publié: (2025)
PerfRL: A Small Language Model Framework for Efficient Code Optimization
par: Duan, Shukai, et autres
Publié: (2023)
par: Duan, Shukai, et autres
Publié: (2023)
Understanding LLM-Driven Test Oracle Generation
par: Bodicoat, Adam, et autres
Publié: (2026)
par: Bodicoat, Adam, et autres
Publié: (2026)
Code Generation by Differential Test Time Scaling
par: He, Yifeng, et autres
Publié: (2026)
par: He, Yifeng, et autres
Publié: (2026)
Clover: Closed-Loop Verifiable Code Generation
par: Sun, Chuyue, et autres
Publié: (2023)
par: Sun, Chuyue, et autres
Publié: (2023)
Functional Overlap Reranking for Neural Code Generation
par: To, Hung Quoc, et autres
Publié: (2023)
par: To, Hung Quoc, et autres
Publié: (2023)
Generating Streamlining Constraints with Large Language Models
par: Voboril, Florentina, et autres
Publié: (2024)
par: Voboril, Florentina, et autres
Publié: (2024)
A Theoretical Analysis of Test-Driven Code Generation
par: Menet, Nicolas, et autres
Publié: (2026)
par: Menet, Nicolas, et autres
Publié: (2026)
Protocode: Prototype-Driven Interpretability for Code Generation in LLMs
par: Bodla, Krishna Vamshi, et autres
Publié: (2025)
par: Bodla, Krishna Vamshi, et autres
Publié: (2025)
Mutation-Guided LLM-based Test Generation at Meta
par: Foster, Christopher, et autres
Publié: (2025)
par: Foster, Christopher, et autres
Publié: (2025)
Enhancing LLM-Based Test Generation by Eliminating Covered Code
par: Xu, WeiZhe, et autres
Publié: (2026)
par: Xu, WeiZhe, et autres
Publié: (2026)
Documents similaires
-
Talking with Verifiers: Automatic Specification Generation for Neural Network Verification
par: Elboher, Yizhak Y., et autres
Publié: (2026) -
Automatic Generation of Executable BPMN Models from Medical Guidelines
par: Sekar, Praveen Kumar Menaka, et autres
Publié: (2026) -
Usability and Performance Analysis of Embedded Development Environment for On-device Learning
par: Scaffi, Enzo, et autres
Publié: (2024) -
Kevin: Multi-Turn RL for Generating CUDA Kernels
par: Baronio, Carlo, et autres
Publié: (2025) -
Bridging Online and Offline RL: Contextual Bandit Learning for Multi-Turn Code Generation
par: Chen, Ziru, et autres
Publié: (2026)