Co-Evolving LLM Coder and Unit Tester via Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wang, Yinjie, Yang, Ling, Tian, Ye, Shen, Ke, Wang, Mengdi |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models
von: Wang, Yinjie, et al.
Veröffentlicht: (2025)
von: Wang, Yinjie, et al.
Veröffentlicht: (2025)
ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization
von: Wang, Yinjie, et al.
Veröffentlicht: (2025)
von: Wang, Yinjie, et al.
Veröffentlicht: (2025)
GenEnv: Difficulty-Aligned Co-Evolution Between LLM Agents and Environment Simulators
von: Guo, Jiacheng, et al.
Veröffentlicht: (2025)
von: Guo, Jiacheng, et al.
Veröffentlicht: (2025)
RLAnything: Forge Environment, Policy, and Reward Model in Completely Dynamic RL System
von: Wang, Yinjie, et al.
Veröffentlicht: (2026)
von: Wang, Yinjie, et al.
Veröffentlicht: (2026)
EvolveCoder: Evolving Test Cases via Adversarial Verification for Code Reinforcement Learning
von: Ruan, Chi, et al.
Veröffentlicht: (2026)
von: Ruan, Chi, et al.
Veröffentlicht: (2026)
Critique-Coder: Enhancing Coder Models by Critique Reinforcement Learning
von: Ruan, Chi, et al.
Veröffentlicht: (2025)
von: Ruan, Chi, et al.
Veröffentlicht: (2025)
OpenClaw-RL: Train Any Agent Simply by Talking
von: Wang, Yinjie, et al.
Veröffentlicht: (2026)
von: Wang, Yinjie, et al.
Veröffentlicht: (2026)
Code-A1: Adversarial Evolving of Code LLM and Test LLM via Reinforcement Learning
von: Wang, Aozhe, et al.
Veröffentlicht: (2026)
von: Wang, Aozhe, et al.
Veröffentlicht: (2026)
Demystifying Reinforcement Learning in Agentic Reasoning
von: Yu, Zhaochen, et al.
Veröffentlicht: (2025)
von: Yu, Zhaochen, et al.
Veröffentlicht: (2025)
DiffuTester: Accelerating Unit Test Generation for Diffusion LLMs via Mining Structural Pattern
von: Yang, Lekang, et al.
Veröffentlicht: (2025)
von: Yang, Lekang, et al.
Veröffentlicht: (2025)
STELLA: Self-Evolving LLM Agent for Biomedical Research
von: Jin, Ruofan, et al.
Veröffentlicht: (2025)
von: Jin, Ruofan, et al.
Veröffentlicht: (2025)
ReasonFlux: Hierarchical LLM Reasoning via Scaling Thought Templates
von: Yang, Ling, et al.
Veröffentlicht: (2025)
von: Yang, Ling, et al.
Veröffentlicht: (2025)
CoEvolve: Training LLM Agents via Agent-Data Mutual Evolution
von: Yang, Shidong, et al.
Veröffentlicht: (2026)
von: Yang, Shidong, et al.
Veröffentlicht: (2026)
UnitCoder: Scalable Iterative Code Synthesis with Unit Test Guidance
von: Ma, Yichuan, et al.
Veröffentlicht: (2025)
von: Ma, Yichuan, et al.
Veröffentlicht: (2025)
$\mathcal{B}$-Coder: Value-Based Deep Reinforcement Learning for Program Synthesis
von: Yu, Zishun, et al.
Veröffentlicht: (2023)
von: Yu, Zishun, et al.
Veröffentlicht: (2023)
WebRL: Training LLM Web Agents via Self-Evolving Online Curriculum Reinforcement Learning
von: Qi, Zehan, et al.
Veröffentlicht: (2024)
von: Qi, Zehan, et al.
Veröffentlicht: (2024)
RefineCoder: Iterative Improving of Large Language Models via Adaptive Critique Refinement for Code Generation
von: Zhou, Changzhi, et al.
Veröffentlicht: (2025)
von: Zhou, Changzhi, et al.
Veröffentlicht: (2025)
ReasonFlux-PRM: Trajectory-Aware PRMs for Long Chain-of-Thought Reasoning in LLMs
von: Zou, Jiaru, et al.
Veröffentlicht: (2025)
von: Zou, Jiaru, et al.
Veröffentlicht: (2025)
JumpCoder: Go Beyond Autoregressive Coder via Online Modification
von: Chen, Mouxiang, et al.
Veröffentlicht: (2024)
von: Chen, Mouxiang, et al.
Veröffentlicht: (2024)
StepCoder: Improve Code Generation with Reinforcement Learning from Compiler Feedback
von: Dou, Shihan, et al.
Veröffentlicht: (2024)
von: Dou, Shihan, et al.
Veröffentlicht: (2024)
The Evolving Landscape of LLM- and VLM-Integrated Reinforcement Learning
von: Schoepp, Sheila, et al.
Veröffentlicht: (2025)
von: Schoepp, Sheila, et al.
Veröffentlicht: (2025)
COMAP: Co-Evolving World Models and Agent Policies for LLM Agents
von: Liu, Youwei, et al.
Veröffentlicht: (2026)
von: Liu, Youwei, et al.
Veröffentlicht: (2026)
EvolveR: Self-Evolving LLM Agents through an Experience-Driven Lifecycle
von: Wu, Rong, et al.
Veröffentlicht: (2025)
von: Wu, Rong, et al.
Veröffentlicht: (2025)
MaintainCoder: Maintainable Code Generation Under Dynamic Requirements
von: Wang, Zhengren, et al.
Veröffentlicht: (2025)
von: Wang, Zhengren, et al.
Veröffentlicht: (2025)
UniCoder: Scaling Code Large Language Model via Universal Code
von: Sun, Tao, et al.
Veröffentlicht: (2024)
von: Sun, Tao, et al.
Veröffentlicht: (2024)
SkillGraph: Skill-Augmented Reinforcement Learning for Agents via Evolving Skill Graphs
von: Li, Xiaoyuan, et al.
Veröffentlicht: (2026)
von: Li, Xiaoyuan, et al.
Veröffentlicht: (2026)
SPELL: Self-Play Reinforcement Learning for Evolving Long-Context Language Models
von: Yang, Ziyi, et al.
Veröffentlicht: (2025)
von: Yang, Ziyi, et al.
Veröffentlicht: (2025)
ReflexiCoder: Teaching Large Language Models to Self-Reflect on Generated Code and Self-Correct It via Reinforcement Learning
von: Jiang, Juyong, et al.
Veröffentlicht: (2026)
von: Jiang, Juyong, et al.
Veröffentlicht: (2026)
EvolveRouter: Co-Evolving Routing and Prompt for Multi-Agent Question Answering
von: Huang, Jiatan, et al.
Veröffentlicht: (2026)
von: Huang, Jiatan, et al.
Veröffentlicht: (2026)
Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization
von: Zhang, Wenqi, et al.
Veröffentlicht: (2024)
von: Zhang, Wenqi, et al.
Veröffentlicht: (2024)
DolphCoder: Echo-Locating Code Large Language Models with Diverse and Multi-Objective Instruction Tuning
von: Wang, Yejie, et al.
Veröffentlicht: (2024)
von: Wang, Yejie, et al.
Veröffentlicht: (2024)
MemRL: Self-Evolving Agents via Runtime Reinforcement Learning on Episodic Memory
von: Zhang, Shengtao, et al.
Veröffentlicht: (2026)
von: Zhang, Shengtao, et al.
Veröffentlicht: (2026)
KAT-Coder Technical Report
von: Zhan, Zizheng, et al.
Veröffentlicht: (2025)
von: Zhan, Zizheng, et al.
Veröffentlicht: (2025)
Towards Transparent RAG: Fostering Evidence Traceability in LLM Generation via Reinforcement Learning
von: Ren, Jingyi, et al.
Veröffentlicht: (2025)
von: Ren, Jingyi, et al.
Veröffentlicht: (2025)
SuperCoder: Assembly Program Superoptimization with Large Language Models
von: Wei, Anjiang, et al.
Veröffentlicht: (2025)
von: Wei, Anjiang, et al.
Veröffentlicht: (2025)
Reinforcement Learning-based Knowledge Distillation with LLM-as-a-Judge
von: Shen, Yiyang, et al.
Veröffentlicht: (2026)
von: Shen, Yiyang, et al.
Veröffentlicht: (2026)
AutoTool: Dynamic Tool Selection and Integration for Agentic Reasoning
von: Zou, Jiaru, et al.
Veröffentlicht: (2025)
von: Zou, Jiaru, et al.
Veröffentlicht: (2025)
Mem$^2$Evolve: Towards Self-Evolving Agents via Co-Evolutionary Capability Expansion and Experience Distillation
von: Cheng, Zihao, et al.
Veröffentlicht: (2026)
von: Cheng, Zihao, et al.
Veröffentlicht: (2026)
FuzzCoder: Byte-level Fuzzing Test via Large Language Model
von: Yang, Liqun, et al.
Veröffentlicht: (2024)
von: Yang, Liqun, et al.
Veröffentlicht: (2024)
KAT-Coder-V2 Technical Report
von: Li, Fengxiang, et al.
Veröffentlicht: (2026)
von: Li, Fengxiang, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models
von: Wang, Yinjie, et al.
Veröffentlicht: (2025) -
ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization
von: Wang, Yinjie, et al.
Veröffentlicht: (2025) -
GenEnv: Difficulty-Aligned Co-Evolution Between LLM Agents and Environment Simulators
von: Guo, Jiacheng, et al.
Veröffentlicht: (2025) -
RLAnything: Forge Environment, Policy, and Reward Model in Completely Dynamic RL System
von: Wang, Yinjie, et al.
Veröffentlicht: (2026) -
EvolveCoder: Evolving Test Cases via Adversarial Verification for Code Reinforcement Learning
von: Ruan, Chi, et al.
Veröffentlicht: (2026)