WarriorCoder: Learning from Expert Battles to Augment Code Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Feng, Huawen, Zhao, Pu, Sun, Qingfeng, Xu, Can, Yang, Fangkai, Wang, Lu, Ma, Qianli, Lin, Qingwei, Rajmohan, Saravan, Zhang, Dongmei, Zhang, Qi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ExeCoder: Empowering Large Language Models with Executability Representation for Code Translation
di: He, Minghua, et al.
Pubblicazione: (2025)
di: He, Minghua, et al.
Pubblicazione: (2025)
WarriorMath: Enhancing the Mathematical Ability of Large Language Models with a Defect-aware Framework
di: Chen, Yue, et al.
Pubblicazione: (2025)
di: Chen, Yue, et al.
Pubblicazione: (2025)
DoVer: Intervention-Driven Auto Debugging for LLM Multi-Agent Systems
di: Ma, Ming, et al.
Pubblicazione: (2025)
di: Ma, Ming, et al.
Pubblicazione: (2025)
Pretrain Value, Not Reward: Decoupled Value Policy Optimization
di: Huang, Chenghua, et al.
Pubblicazione: (2025)
di: Huang, Chenghua, et al.
Pubblicazione: (2025)
From Reasoning to Answer: Empirical, Attention-Based and Mechanistic Insights into Distilled DeepSeek R1 Models
di: Zhang, Jue, et al.
Pubblicazione: (2025)
di: Zhang, Jue, et al.
Pubblicazione: (2025)
WizardCoder: Empowering Code Large Language Models with Evol-Instruct
di: Luo, Ziyang, et al.
Pubblicazione: (2023)
di: Luo, Ziyang, et al.
Pubblicazione: (2023)
AutoRAG-HP: Automatic Online Hyper-Parameter Tuning for Retrieval-Augmented Generation
di: Fu, Jia, et al.
Pubblicazione: (2024)
di: Fu, Jia, et al.
Pubblicazione: (2024)
AgentGen: Enhancing Planning Abilities for Large Language Model based Agent via Environment and Task Generation
di: Hu, Mengkang, et al.
Pubblicazione: (2024)
di: Hu, Mengkang, et al.
Pubblicazione: (2024)
Self-Evolved Reward Learning for LLMs
di: Huang, Chenghua, et al.
Pubblicazione: (2024)
di: Huang, Chenghua, et al.
Pubblicazione: (2024)
Learning to Refine: Self-Refinement of Parallel Reasoning in LLMs
di: Wang, Qibin, et al.
Pubblicazione: (2025)
di: Wang, Qibin, et al.
Pubblicazione: (2025)
AXIS: Efficient Human-Agent-Computer Interaction with API-First LLM-Based Agents
di: Lu, Junting, et al.
Pubblicazione: (2024)
di: Lu, Junting, et al.
Pubblicazione: (2024)
The Vision of Autonomic Computing: Can LLMs Make It a Reality?
di: Zhang, Zhiyang, et al.
Pubblicazione: (2024)
di: Zhang, Zhiyang, et al.
Pubblicazione: (2024)
VEM: Environment-Free Exploration for Training GUI Agent with Value Environment Model
di: Zheng, Jiani, et al.
Pubblicazione: (2025)
di: Zheng, Jiani, et al.
Pubblicazione: (2025)
RepoGenesis: Benchmarking End-to-End Microservice Generation from Readme to Repository
di: Peng, Zhiyuan, et al.
Pubblicazione: (2026)
di: Peng, Zhiyuan, et al.
Pubblicazione: (2026)
Thread: A Logic-Based Data Organization Paradigm for How-To Question Answering with Retrieval Augmented Generation
di: An, Kaikai, et al.
Pubblicazione: (2024)
di: An, Kaikai, et al.
Pubblicazione: (2024)
EfficientRAG: Efficient Retriever for Multi-Hop Question Answering
di: Zhuang, Ziyuan, et al.
Pubblicazione: (2024)
di: Zhuang, Ziyuan, et al.
Pubblicazione: (2024)
LLM Reasoning as Trajectories: Step-Specific Representation Geometry and Correctness Signals
di: Sun, Lihao, et al.
Pubblicazione: (2026)
di: Sun, Lihao, et al.
Pubblicazione: (2026)
Skeleton-Guided-Translation: A Benchmarking Framework for Code Repository Translation with Fine-Grained Quality Evaluation
di: Zhang, Xing, et al.
Pubblicazione: (2025)
di: Zhang, Xing, et al.
Pubblicazione: (2025)
AdaptFlow: Adaptive Workflow Optimization via Meta-Learning
di: Zhu, Runchuan, et al.
Pubblicazione: (2025)
di: Zhu, Runchuan, et al.
Pubblicazione: (2025)
A Tale of Two Graphs: Separating Knowledge Exploration from Outline Structure for Open-Ended Deep Research
di: Shi, Zhuofan, et al.
Pubblicazione: (2026)
di: Shi, Zhuofan, et al.
Pubblicazione: (2026)
Contrastive Attribution in the Wild: An Interpretability Analysis of LLM Failures on Realistic Benchmarks
di: Tan, Rongyuan, et al.
Pubblicazione: (2026)
di: Tan, Rongyuan, et al.
Pubblicazione: (2026)
Large Language Models can Deliver Accurate and Interpretable Time Series Anomaly Detection
di: Liu, Jun, et al.
Pubblicazione: (2024)
di: Liu, Jun, et al.
Pubblicazione: (2024)
Enabling Autonomic Microservice Management through Self-Learning Agents
di: Yu, Fenglin, et al.
Pubblicazione: (2025)
di: Yu, Fenglin, et al.
Pubblicazione: (2025)
Text2Grad: Reinforcement Learning from Natural Language Feedback
di: Wang, Hanyang, et al.
Pubblicazione: (2025)
di: Wang, Hanyang, et al.
Pubblicazione: (2025)
Beyond State Consistency: Behavior Consistency in Text-Based World Models
di: Huang, Youling, et al.
Pubblicazione: (2026)
di: Huang, Youling, et al.
Pubblicazione: (2026)
Nissist: An Incident Mitigation Copilot based on Troubleshooting Guides
di: An, Kaikai, et al.
Pubblicazione: (2024)
di: An, Kaikai, et al.
Pubblicazione: (2024)
AI Delegates with a Dual Focus: Ensuring Privacy and Strategic Self-Disclosure
di: Zhang, Zhiyang, et al.
Pubblicazione: (2024)
di: Zhang, Zhiyang, et al.
Pubblicazione: (2024)
COIN: Chance-Constrained Imitation Learning for Uncertainty-aware Adaptive Resource Oversubscription Policy
di: Wang, Lu, et al.
Pubblicazione: (2024)
di: Wang, Lu, et al.
Pubblicazione: (2024)
MEETING DELEGATE: Benchmarking LLMs on Attending Meetings on Our Behalf
di: Hu, Lingxiang, et al.
Pubblicazione: (2025)
di: Hu, Lingxiang, et al.
Pubblicazione: (2025)
Token-level Proximal Policy Optimization for Query Generation
di: Ouyang, Yichen, et al.
Pubblicazione: (2024)
di: Ouyang, Yichen, et al.
Pubblicazione: (2024)
Call Me When Necessary: LLMs can Efficiently and Faithfully Reason over Structured Environments
di: Cheng, Sitao, et al.
Pubblicazione: (2024)
di: Cheng, Sitao, et al.
Pubblicazione: (2024)
Contrastive Learning with Negative Sampling Correction
di: Wang, Lu, et al.
Pubblicazione: (2024)
di: Wang, Lu, et al.
Pubblicazione: (2024)
Large Language Model-Brained GUI Agents: A Survey
di: Zhang, Chaoyun, et al.
Pubblicazione: (2024)
di: Zhang, Chaoyun, et al.
Pubblicazione: (2024)
Large Action Models: From Inception to Implementation
di: Wang, Lu, et al.
Pubblicazione: (2024)
di: Wang, Lu, et al.
Pubblicazione: (2024)
TaskWeaver: A Code-First Agent Framework
di: Qiao, Bo, et al.
Pubblicazione: (2023)
di: Qiao, Bo, et al.
Pubblicazione: (2023)
Navigating the Unknown: A Chat-Based Collaborative Interface for Personalized Exploratory Tasks
di: Peng, Yingzhe, et al.
Pubblicazione: (2024)
di: Peng, Yingzhe, et al.
Pubblicazione: (2024)
Distill Not Only Data but Also Rewards: Can Smaller Language Models Surpass Larger Ones?
di: Zhang, Yudi, et al.
Pubblicazione: (2025)
di: Zhang, Yudi, et al.
Pubblicazione: (2025)
RuAG: Learned-rule-augmented Generation for Large Language Models
di: Zhang, Yudi, et al.
Pubblicazione: (2024)
di: Zhang, Yudi, et al.
Pubblicazione: (2024)
Sharingan: Extract User Action Sequence from Desktop Recordings
di: Chen, Yanting, et al.
Pubblicazione: (2024)
di: Chen, Yanting, et al.
Pubblicazione: (2024)
AgentMath: Empowering Mathematical Reasoning for Large Language Models via Tool-Augmented Agent
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ExeCoder: Empowering Large Language Models with Executability Representation for Code Translation
di: He, Minghua, et al.
Pubblicazione: (2025) -
WarriorMath: Enhancing the Mathematical Ability of Large Language Models with a Defect-aware Framework
di: Chen, Yue, et al.
Pubblicazione: (2025) -
DoVer: Intervention-Driven Auto Debugging for LLM Multi-Agent Systems
di: Ma, Ming, et al.
Pubblicazione: (2025) -
Pretrain Value, Not Reward: Decoupled Value Policy Optimization
di: Huang, Chenghua, et al.
Pubblicazione: (2025) -
From Reasoning to Answer: Empirical, Attention-Based and Mechanistic Insights into Distilled DeepSeek R1 Models
di: Zhang, Jue, et al.
Pubblicazione: (2025)