GrandCode: Achieving Grandmaster Level in Competitive Programming via Agentic Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | DeepReinforce Team, Li, Xiaoya, Sun, Xiaofei, Wang, Guoyin, Su, Songqiao, Shum, Chris, Li, Jiwei |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
CUDA-L2: Surpassing cuBLAS Performance for Matrix Multiplication through Reinforcement Learning
von: Su, Songqiao, et al.
Veröffentlicht: (2025)
von: Su, Songqiao, et al.
Veröffentlicht: (2025)
CUDA-L1: Improving CUDA Optimization via Contrastive Reinforcement Learning
von: Li, Xiaoya, et al.
Veröffentlicht: (2025)
von: Li, Xiaoya, et al.
Veröffentlicht: (2025)
CRINN: Contrastive Reinforcement Learning for Approximate Nearest Neighbor Search
von: Li, Xiaoya, et al.
Veröffentlicht: (2025)
von: Li, Xiaoya, et al.
Veröffentlicht: (2025)
Turn That Frown Upside Down: FaceID Customization via Cross-Training Data
von: Wang, Shuhe, et al.
Veröffentlicht: (2025)
von: Wang, Shuhe, et al.
Veröffentlicht: (2025)
Belice / Leroy "Grandmaster" Young
von: Young, Leroy Grandmaster
von: Young, Leroy Grandmaster
Are Human-generated Demonstrations Necessary for In-context Learning?
von: Li, Rui, et al.
Veröffentlicht: (2023)
von: Li, Rui, et al.
Veröffentlicht: (2023)
Reinforcement Learning Enhanced LLMs: A Survey
von: Wang, Shuhe, et al.
Veröffentlicht: (2024)
von: Wang, Shuhe, et al.
Veröffentlicht: (2024)
Template-assisted Contrastive Learning of Task-oriented Dialogue Sentence Embeddings
von: Oh, Minsik, et al.
Veröffentlicht: (2023)
von: Oh, Minsik, et al.
Veröffentlicht: (2023)
FaceID-6M: A Large-Scale, Open-Source FaceID Customization Dataset
von: Wang, Shuhe, et al.
Veröffentlicht: (2025)
von: Wang, Shuhe, et al.
Veröffentlicht: (2025)
Instruction Tuning for Large Language Models: A Survey
von: Zhang, Shengyu, et al.
Veröffentlicht: (2023)
von: Zhang, Shengyu, et al.
Veröffentlicht: (2023)
Similarity-based Neighbor Selection for Graph LLMs
von: Li, Rui, et al.
Veröffentlicht: (2024)
von: Li, Rui, et al.
Veröffentlicht: (2024)
PK-ICR: Persona-Knowledge Interactive Context Retrieval for Grounded Dialogue
von: Oh, Minsik, et al.
Veröffentlicht: (2023)
von: Oh, Minsik, et al.
Veröffentlicht: (2023)
The media chess Grandmaster: cultural capital intensified by social capital
von: Januário, Jéssica dos Anjos
Veröffentlicht: (2024)
von: Januário, Jéssica dos Anjos
Veröffentlicht: (2024)
Tracing the Thought of a Grandmaster-level Chess-Playing Transformer
von: Lin, Rui, et al.
Veröffentlicht: (2026)
von: Lin, Rui, et al.
Veröffentlicht: (2026)
Solvita: Enhancing Large Language Models for Competitive Programming via Agentic Evolution
von: Li, Han, et al.
Veröffentlicht: (2026)
von: Li, Han, et al.
Veröffentlicht: (2026)
Scaling Agentic Verifier for Competitive Coding
von: Ma, Zeyao, et al.
Veröffentlicht: (2026)
von: Ma, Zeyao, et al.
Veröffentlicht: (2026)
From Laboratory to Real-World Applications: Benchmarking Agentic Code Reasoning at the Repository Level
von: Li, Jia, et al.
Veröffentlicht: (2026)
von: Li, Jia, et al.
Veröffentlicht: (2026)
Piecewise SOS-Convex Moment Optimization and Applications via Exact Semi-Definite Programs
von: Huang, Queenie Yingkun, et al.
Veröffentlicht: (2024)
von: Huang, Queenie Yingkun, et al.
Veröffentlicht: (2024)
CodeContests+: High-Quality Test Case Generation for Competitive Programming
von: Wang, Zihan, et al.
Veröffentlicht: (2025)
von: Wang, Zihan, et al.
Veröffentlicht: (2025)
Achieving Human Level Competitive Robot Table Tennis
von: D'Ambrosio, David B., et al.
Veröffentlicht: (2024)
von: D'Ambrosio, David B., et al.
Veröffentlicht: (2024)
DORS: DDC Online Retrieval System.
von: Liu, Songqiao, et al.
Veröffentlicht: (1991)
von: Liu, Songqiao, et al.
Veröffentlicht: (1991)
TrajAudit: Automated Failure Diagnosis for Agentic Coding Systems
von: Wang, Minxing, et al.
Veröffentlicht: (2026)
von: Wang, Minxing, et al.
Veröffentlicht: (2026)
AutoCode: LLMs as Problem Setters for Competitive Programming
von: Zhou, Shang, et al.
Veröffentlicht: (2025)
von: Zhou, Shang, et al.
Veröffentlicht: (2025)
Training One Model to Master Cross-Level Agentic Actions via Reinforcement Learning
von: He, Kaichen, et al.
Veröffentlicht: (2025)
von: He, Kaichen, et al.
Veröffentlicht: (2025)
Co-Evolution of Types and Dependencies: Towards Repository-Level Type Inference for Python Code
von: Sun, Shuo, et al.
Veröffentlicht: (2025)
von: Sun, Shuo, et al.
Veröffentlicht: (2025)
Packing Analysis: Packing Is More Appropriate for Large Models or Datasets in Supervised Fine-tuning
von: Wang, Shuhe, et al.
Veröffentlicht: (2024)
von: Wang, Shuhe, et al.
Veröffentlicht: (2024)
Toward Causal-Visual Programming: Enhancing Agentic Reasoning in Low-Code Environments
von: Xu, Jiexi, et al.
Veröffentlicht: (2025)
von: Xu, Jiexi, et al.
Veröffentlicht: (2025)
Competitive Learning for Achieving Content-specific Filters in Video Coding for Machines
von: Zhang, Honglei, et al.
Veröffentlicht: (2024)
von: Zhang, Honglei, et al.
Veröffentlicht: (2024)
Mediating Self‐Oxidation and Competitive Adsorption for Achieving High‐Selective Urea Oxidation Catalysis at Industrial‐Level Current Densities
von: Pengfei Qiao, et al.
Veröffentlicht: (2024)
von: Pengfei Qiao, et al.
Veröffentlicht: (2024)
Estimation of Grouped Time-Varying Network Vector Autoregression Models
von: Li, Degui, et al.
Veröffentlicht: (2023)
von: Li, Degui, et al.
Veröffentlicht: (2023)
RefineRL: Advancing Competitive Programming with Self-Refinement Reinforcement Learning
von: Fu, Shaopeng, et al.
Veröffentlicht: (2026)
von: Fu, Shaopeng, et al.
Veröffentlicht: (2026)
DeepCode: Open Agentic Coding
von: Li, Zongwei, et al.
Veröffentlicht: (2025)
von: Li, Zongwei, et al.
Veröffentlicht: (2025)
Human-Level Competitive Pokémon via Scalable Offline Reinforcement Learning with Transformers
von: Grigsby, Jake, et al.
Veröffentlicht: (2025)
von: Grigsby, Jake, et al.
Veröffentlicht: (2025)
Performance-bounded Online Ensemble Learning Method Based on Multi-armed bandits and Its Applications in Real-time Safety Assessment
von: Hu, Songqiao, et al.
Veröffentlicht: (2025)
von: Hu, Songqiao, et al.
Veröffentlicht: (2025)
Lite-RVFL: A Lightweight Random Vector Functional-Link Neural Network for Learning Under Concept Drift
von: Hu, Songqiao, et al.
Veröffentlicht: (2025)
von: Hu, Songqiao, et al.
Veröffentlicht: (2025)
AgentGL: Towards Agentic Graph Learning with LLMs via Reinforcement Learning
von: Sun, Yuanfu, et al.
Veröffentlicht: (2026)
von: Sun, Yuanfu, et al.
Veröffentlicht: (2026)
CanaryBench: Stress Testing Privacy Leakage in Cluster-Level Conversation Summaries
von: Mehta, Deep
Veröffentlicht: (2026)
von: Mehta, Deep
Veröffentlicht: (2026)
AnomalyAgent: Agentic Industrial Anomaly Synthesis via Tool-Augmented Reinforcement Learning
von: Su, Jiaming, et al.
Veröffentlicht: (2026)
von: Su, Jiaming, et al.
Veröffentlicht: (2026)
ARIADNE: Agentic Reward-Informed Adaptive Decision Exploration via Blackboard-Driven MCTS for Competitive Program Generation
von: Wei, Minnan, et al.
Veröffentlicht: (2026)
von: Wei, Minnan, et al.
Veröffentlicht: (2026)
On-Policy RL Meets Off-Policy Experts: Harmonizing Supervised Fine-Tuning and Reinforcement Learning via Dynamic Weighting
von: Zhang, Wenhao, et al.
Veröffentlicht: (2025)
von: Zhang, Wenhao, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
CUDA-L2: Surpassing cuBLAS Performance for Matrix Multiplication through Reinforcement Learning
von: Su, Songqiao, et al.
Veröffentlicht: (2025) -
CUDA-L1: Improving CUDA Optimization via Contrastive Reinforcement Learning
von: Li, Xiaoya, et al.
Veröffentlicht: (2025) -
CRINN: Contrastive Reinforcement Learning for Approximate Nearest Neighbor Search
von: Li, Xiaoya, et al.
Veröffentlicht: (2025) -
Turn That Frown Upside Down: FaceID Customization via Cross-Training Data
von: Wang, Shuhe, et al.
Veröffentlicht: (2025) -
Belice / Leroy "Grandmaster" Young
von: Young, Leroy Grandmaster