EvolveCoder: Evolving Test Cases via Adversarial Verification for Code Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Ruan, Chi, Jiang, Dongfu, Zeng, Huaye, Nie, Ping, Chen, Wenhu |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
ACECODER: Acing Coder RL via Automated Test-Case Synthesis
von: Zeng, Huaye, et al.
Veröffentlicht: (2025)
von: Zeng, Huaye, et al.
Veröffentlicht: (2025)
Critique-Coder: Enhancing Coder Models by Critique Reinforcement Learning
von: Ruan, Chi, et al.
Veröffentlicht: (2025)
von: Ruan, Chi, et al.
Veröffentlicht: (2025)
Code-A1: Adversarial Evolving of Code LLM and Test LLM via Reinforcement Learning
von: Wang, Aozhe, et al.
Veröffentlicht: (2026)
von: Wang, Aozhe, et al.
Veröffentlicht: (2026)
Co-Evolving LLM Coder and Unit Tester via Reinforcement Learning
von: Wang, Yinjie, et al.
Veröffentlicht: (2025)
von: Wang, Yinjie, et al.
Veröffentlicht: (2025)
MANTIS: Interleaved Multi-Image Instruction Tuning
von: Jiang, Dongfu, et al.
Veröffentlicht: (2024)
von: Jiang, Dongfu, et al.
Veröffentlicht: (2024)
VisCoder: Fine-Tuning LLMs for Executable Python Visualization Code Generation
von: Ni, Yuansheng, et al.
Veröffentlicht: (2025)
von: Ni, Yuansheng, et al.
Veröffentlicht: (2025)
RewardHarness: Self-Evolving Agentic Post-Training
von: Zhang, Yuxuan, et al.
Veröffentlicht: (2026)
von: Zhang, Yuxuan, et al.
Veröffentlicht: (2026)
ARGUS: Policy-Adaptive Ad Governance via Evolving Reinforcement with Adversarial Umpiring
von: Ji, Deyi, et al.
Veröffentlicht: (2026)
von: Ji, Deyi, et al.
Veröffentlicht: (2026)
VisCoder2: Building Multi-Language Visualization Coding Agents
von: Ni, Yuansheng, et al.
Veröffentlicht: (2025)
von: Ni, Yuansheng, et al.
Veröffentlicht: (2025)
VerlTool: Towards Holistic Agentic Reinforcement Learning with Tool Use
von: Jiang, Dongfu, et al.
Veröffentlicht: (2025)
von: Jiang, Dongfu, et al.
Veröffentlicht: (2025)
ScholarCopilot: Training Large Language Models for Academic Writing with Accurate Citations
von: Wang, Yubo, et al.
Veröffentlicht: (2025)
von: Wang, Yubo, et al.
Veröffentlicht: (2025)
LatentEvolve: Self-Evolving Test-Time Scaling in Latent Space
von: Zhang, Guibin, et al.
Veröffentlicht: (2025)
von: Zhang, Guibin, et al.
Veröffentlicht: (2025)
SEIF: Self-Evolving Reinforcement Learning for Instruction Following
von: Ren, Qingyu, et al.
Veröffentlicht: (2026)
von: Ren, Qingyu, et al.
Veröffentlicht: (2026)
ThetaEvolve: Test-time Learning on Open Problems
von: Wang, Yiping, et al.
Veröffentlicht: (2025)
von: Wang, Yiping, et al.
Veröffentlicht: (2025)
General-Reasoner: Advancing LLM Reasoning Across All Domains
von: Ma, Xueguang, et al.
Veröffentlicht: (2025)
von: Ma, Xueguang, et al.
Veröffentlicht: (2025)
VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation
von: Ku, Max, et al.
Veröffentlicht: (2023)
von: Ku, Max, et al.
Veröffentlicht: (2023)
StructEval: Benchmarking LLMs' Capabilities to Generate Structural Outputs
von: Yang, Jialin, et al.
Veröffentlicht: (2025)
von: Yang, Jialin, et al.
Veröffentlicht: (2025)
A Symbolic Adversarial Learning Framework for Evolving Fake News Generation and Detection
von: Tian, Chong, et al.
Veröffentlicht: (2025)
von: Tian, Chong, et al.
Veröffentlicht: (2025)
EVOR: Evolving Retrieval for Code Generation
von: Su, Hongjin, et al.
Veröffentlicht: (2024)
von: Su, Hongjin, et al.
Veröffentlicht: (2024)
PEARL: Self-Evolving Assistant for Time Management with Reinforcement Learning
von: Li, Bingxuan, et al.
Veröffentlicht: (2026)
von: Li, Bingxuan, et al.
Veröffentlicht: (2026)
WebExplorer: Explore and Evolve for Training Long-Horizon Web Agents
von: Liu, Junteng, et al.
Veröffentlicht: (2025)
von: Liu, Junteng, et al.
Veröffentlicht: (2025)
EvolveSearch: An Iterative Self-Evolving Search Agent
von: Zhang, Dingchu, et al.
Veröffentlicht: (2025)
von: Zhang, Dingchu, et al.
Veröffentlicht: (2025)
Evo-Memory: Benchmarking LLM Agent Test-time Learning with Self-Evolving Memory
von: Wei, Tianxin, et al.
Veröffentlicht: (2025)
von: Wei, Tianxin, et al.
Veröffentlicht: (2025)
Learning to Self-Evolve
von: Chen, Xiaoyin, et al.
Veröffentlicht: (2026)
von: Chen, Xiaoyin, et al.
Veröffentlicht: (2026)
SkillGraph: Skill-Augmented Reinforcement Learning for Agents via Evolving Skill Graphs
von: Li, Xiaoyuan, et al.
Veröffentlicht: (2026)
von: Li, Xiaoyuan, et al.
Veröffentlicht: (2026)
MemRL: Self-Evolving Agents via Runtime Reinforcement Learning on Episodic Memory
von: Zhang, Shengtao, et al.
Veröffentlicht: (2026)
von: Zhang, Shengtao, et al.
Veröffentlicht: (2026)
TIGERScore: Towards Building Explainable Metric for All Text Generation Tasks
von: Jiang, Dongfu, et al.
Veröffentlicht: (2023)
von: Jiang, Dongfu, et al.
Veröffentlicht: (2023)
SPELL: Self-Play Reinforcement Learning for Evolving Long-Context Language Models
von: Yang, Ziyi, et al.
Veröffentlicht: (2025)
von: Yang, Ziyi, et al.
Veröffentlicht: (2025)
Raising the Bar: Investigating the Values of Large Language Models via Generative Evolving Testing
von: Jiang, Han, et al.
Veröffentlicht: (2024)
von: Jiang, Han, et al.
Veröffentlicht: (2024)
OpenResearcher: A Fully Open Pipeline for Long-Horizon Deep Research Trajectory Synthesis
von: Li, Zhuofeng, et al.
Veröffentlicht: (2026)
von: Li, Zhuofeng, et al.
Veröffentlicht: (2026)
MobEvolve: An Agentic Self-Evolving Heuristic System for Interpretable Human Mobility Generation
von: He, Junlin, et al.
Veröffentlicht: (2026)
von: He, Junlin, et al.
Veröffentlicht: (2026)
StepCoder: Improve Code Generation with Reinforcement Learning from Compiler Feedback
von: Dou, Shihan, et al.
Veröffentlicht: (2024)
von: Dou, Shihan, et al.
Veröffentlicht: (2024)
The Evolving Landscape of LLM- and VLM-Integrated Reinforcement Learning
von: Schoepp, Sheila, et al.
Veröffentlicht: (2025)
von: Schoepp, Sheila, et al.
Veröffentlicht: (2025)
Deep Self-Evolving Reasoning
von: Liu, Zihan, et al.
Veröffentlicht: (2025)
von: Liu, Zihan, et al.
Veröffentlicht: (2025)
SPC: Evolving Self-Play Critic via Adversarial Games for LLM Reasoning
von: Chen, Jiaqi, et al.
Veröffentlicht: (2025)
von: Chen, Jiaqi, et al.
Veröffentlicht: (2025)
UnitCoder: Scalable Iterative Code Synthesis with Unit Test Guidance
von: Ma, Yichuan, et al.
Veröffentlicht: (2025)
von: Ma, Yichuan, et al.
Veröffentlicht: (2025)
WebRL: Training LLM Web Agents via Self-Evolving Online Curriculum Reinforcement Learning
von: Qi, Zehan, et al.
Veröffentlicht: (2024)
von: Qi, Zehan, et al.
Veröffentlicht: (2024)
TraceCoder: Towards Traceable ICD Coding via Multi-Source Knowledge Integration
von: Ren, Mucheng, et al.
Veröffentlicht: (2025)
von: Ren, Mucheng, et al.
Veröffentlicht: (2025)
Verilog-Evolve: Feedback-Driven and Skill-Evolving Verilog Generation
von: Pei, Zehua, et al.
Veröffentlicht: (2026)
von: Pei, Zehua, et al.
Veröffentlicht: (2026)
KnowCoder-X: Boosting Multilingual Information Extraction via Code
von: Zuo, Yuxin, et al.
Veröffentlicht: (2024)
von: Zuo, Yuxin, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
ACECODER: Acing Coder RL via Automated Test-Case Synthesis
von: Zeng, Huaye, et al.
Veröffentlicht: (2025) -
Critique-Coder: Enhancing Coder Models by Critique Reinforcement Learning
von: Ruan, Chi, et al.
Veröffentlicht: (2025) -
Code-A1: Adversarial Evolving of Code LLM and Test LLM via Reinforcement Learning
von: Wang, Aozhe, et al.
Veröffentlicht: (2026) -
Co-Evolving LLM Coder and Unit Tester via Reinforcement Learning
von: Wang, Yinjie, et al.
Veröffentlicht: (2025) -
MANTIS: Interleaved Multi-Image Instruction Tuning
von: Jiang, Dongfu, et al.
Veröffentlicht: (2024)