Salvato in:
| Autori principali: | Xu, Manjie, Yin, Isabella, Tu, Xinyi, Zhang, Chi, Zhu, Yixin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2601.18352 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Learning to Plan with Personalized Preferences
di: Xu, Manjie, et al.
Pubblicazione: (2025)
di: Xu, Manjie, et al.
Pubblicazione: (2025)
Code Execution as Grounded Supervision for LLM Reasoning
di: Jung, Dongwon, et al.
Pubblicazione: (2025)
di: Jung, Dongwon, et al.
Pubblicazione: (2025)
Boosting Chart-to-Code Generation in MLLM via Dual Preference-Guided Refinement
di: Zhang, Zhihan, et al.
Pubblicazione: (2025)
di: Zhang, Zhihan, et al.
Pubblicazione: (2025)
CodeI/O: Condensing Reasoning Patterns via Code Input-Output Prediction
di: Li, Junlong, et al.
Pubblicazione: (2025)
di: Li, Junlong, et al.
Pubblicazione: (2025)
Heterogeneous Adversarial Play in Interactive Environments
di: Xu, Manjie, et al.
Pubblicazione: (2025)
di: Xu, Manjie, et al.
Pubblicazione: (2025)
Improving LLM Code Reasoning via Semantic Equivalence Self-Play with Formal Verification
di: Barone, Antonio Valerio Miceli, et al.
Pubblicazione: (2026)
di: Barone, Antonio Valerio Miceli, et al.
Pubblicazione: (2026)
CodeGraph: Enhancing Graph Reasoning of LLMs with Code
di: Cai, Qiaolong, et al.
Pubblicazione: (2024)
di: Cai, Qiaolong, et al.
Pubblicazione: (2024)
Context Pruning for Coding Agents via Multi-Rubric Latent Reasoning
di: Wang, Jingjing, et al.
Pubblicazione: (2026)
di: Wang, Jingjing, et al.
Pubblicazione: (2026)
R1-Code-Interpreter: LLMs Reason with Code via Supervised and Multi-stage Reinforcement Learning
di: Chen, Yongchao, et al.
Pubblicazione: (2025)
di: Chen, Yongchao, et al.
Pubblicazione: (2025)
CodeRL+: Improving Code Generation via Reinforcement with Execution Semantics Alignment
di: Jiang, Xue, et al.
Pubblicazione: (2025)
di: Jiang, Xue, et al.
Pubblicazione: (2025)
Enhancing Code Generation via Bidirectional Comment-Level Mutual Grounding
di: Di, Yifeng, et al.
Pubblicazione: (2025)
di: Di, Yifeng, et al.
Pubblicazione: (2025)
CRANE: Constrained Reasoning Injection for Code Agents via Nullspace Editing
di: Zhu, Mingzhi, et al.
Pubblicazione: (2026)
di: Zhu, Mingzhi, et al.
Pubblicazione: (2026)
Controlled Self-Evolution for Algorithmic Code Optimization
di: Hu, Tu, et al.
Pubblicazione: (2026)
di: Hu, Tu, et al.
Pubblicazione: (2026)
SemCoder: Training Code Language Models with Comprehensive Semantics Reasoning
di: Ding, Yangruibo, et al.
Pubblicazione: (2024)
di: Ding, Yangruibo, et al.
Pubblicazione: (2024)
Code-driven Number Sequence Calculation: Enhancing the inductive Reasoning Abilities of Large Language Models
di: Chen, Kedi, et al.
Pubblicazione: (2025)
di: Chen, Kedi, et al.
Pubblicazione: (2025)
CodePMP: Scalable Preference Model Pretraining for Large Language Model Reasoning
di: Yu, Huimu, et al.
Pubblicazione: (2024)
di: Yu, Huimu, et al.
Pubblicazione: (2024)
DynaCode: A Dynamic Complexity-Aware Code Benchmark for Evaluating Large Language Models in Code Generation
di: Hu, Wenhao, et al.
Pubblicazione: (2025)
di: Hu, Wenhao, et al.
Pubblicazione: (2025)
Code to Think, Think to Code: A Survey on Code-Enhanced Reasoning and Reasoning-Driven Code Intelligence in LLMs
di: Yang, Dayu, et al.
Pubblicazione: (2025)
di: Yang, Dayu, et al.
Pubblicazione: (2025)
CodeMind: Evaluating Large Language Models for Code Reasoning
di: Liu, Changshu, et al.
Pubblicazione: (2024)
di: Liu, Changshu, et al.
Pubblicazione: (2024)
UTMath: Math Evaluation with Unit Test via Reasoning-to-Coding Thoughts
di: Yang, Bo, et al.
Pubblicazione: (2024)
di: Yang, Bo, et al.
Pubblicazione: (2024)
KodCode: A Diverse, Challenging, and Verifiable Synthetic Dataset for Coding
di: Xu, Zhangchen, et al.
Pubblicazione: (2025)
di: Xu, Zhangchen, et al.
Pubblicazione: (2025)
To Code or not to Code? Adaptive Tool Integration for Math Language Models via Expectation-Maximization
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
Reinforced Efficient Reasoning via Semantically Diverse Exploration
di: Zhao, Ziqi, et al.
Pubblicazione: (2026)
di: Zhao, Ziqi, et al.
Pubblicazione: (2026)
CRScore: Grounding Automated Evaluation of Code Review Comments in Code Claims and Smells
di: Naik, Atharva, et al.
Pubblicazione: (2024)
di: Naik, Atharva, et al.
Pubblicazione: (2024)
RLEF: Grounding Code LLMs in Execution Feedback with Reinforcement Learning
di: Gehring, Jonas, et al.
Pubblicazione: (2024)
di: Gehring, Jonas, et al.
Pubblicazione: (2024)
OctoBench: Benchmarking Scaffold-Aware Instruction Following in Repository-Grounded Agentic Coding
di: Ding, Deming, et al.
Pubblicazione: (2026)
di: Ding, Deming, et al.
Pubblicazione: (2026)
Towards Effective Code-Integrated Reasoning
di: Bai, Fei, et al.
Pubblicazione: (2025)
di: Bai, Fei, et al.
Pubblicazione: (2025)
EHRAgent: Code Empowers Large Language Models for Few-shot Complex Tabular Reasoning on Electronic Health Records
di: Shi, Wenqi, et al.
Pubblicazione: (2024)
di: Shi, Wenqi, et al.
Pubblicazione: (2024)
ReCode: Reinforcing Code Generation with Reasoning-Process Rewards
di: Fan, Lishui, et al.
Pubblicazione: (2025)
di: Fan, Lishui, et al.
Pubblicazione: (2025)
What Really Improves Mathematical Reasoning: Structured Reasoning Signals Beyond Pure Code
di: Zhao, Yuze, et al.
Pubblicazione: (2026)
di: Zhao, Yuze, et al.
Pubblicazione: (2026)
SciCode: A Research Coding Benchmark Curated by Scientists
di: Tian, Minyang, et al.
Pubblicazione: (2024)
di: Tian, Minyang, et al.
Pubblicazione: (2024)
SmartSwitch: Advancing LLM Reasoning by Overcoming Underthinking via Promoting Deeper Thought Exploration
di: Zhang, Xichen, et al.
Pubblicazione: (2025)
di: Zhang, Xichen, et al.
Pubblicazione: (2025)
Sequence-Level Certainty Reduces Hallucination In Knowledge-Grounded Dialogue Generation
di: Wan, Yixin, et al.
Pubblicazione: (2023)
di: Wan, Yixin, et al.
Pubblicazione: (2023)
CATArena: Evaluating Evolutionary Capabilities of Code Agents via Iterative Tournaments
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
MuMath-Code: Combining Tool-Use Large Language Models with Multi-perspective Data Augmentation for Mathematical Reasoning
di: Yin, Shuo, et al.
Pubblicazione: (2024)
di: Yin, Shuo, et al.
Pubblicazione: (2024)
Coding Agents are Effective Long-Context Processors
di: Cao, Weili, et al.
Pubblicazione: (2026)
di: Cao, Weili, et al.
Pubblicazione: (2026)
SRA-MCTS: Self-driven Reasoning Augmentation with Monte Carlo Tree Search for Code Generation
di: Xu, Bin, et al.
Pubblicazione: (2024)
di: Xu, Bin, et al.
Pubblicazione: (2024)
AceReason-Nemotron: Advancing Math and Code Reasoning through Reinforcement Learning
di: Chen, Yang, et al.
Pubblicazione: (2025)
di: Chen, Yang, et al.
Pubblicazione: (2025)
Coding Triangle: How Does Large Language Model Understand Code?
di: Zhang, Taolin, et al.
Pubblicazione: (2025)
di: Zhang, Taolin, et al.
Pubblicazione: (2025)
Doc2SoarGraph: Discrete Reasoning over Visually-Rich Table-Text Documents via Semantic-Oriented Hierarchical Graphs
di: Zhu, Fengbin, et al.
Pubblicazione: (2023)
di: Zhu, Fengbin, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Learning to Plan with Personalized Preferences
di: Xu, Manjie, et al.
Pubblicazione: (2025) -
Code Execution as Grounded Supervision for LLM Reasoning
di: Jung, Dongwon, et al.
Pubblicazione: (2025) -
Boosting Chart-to-Code Generation in MLLM via Dual Preference-Guided Refinement
di: Zhang, Zhihan, et al.
Pubblicazione: (2025) -
CodeI/O: Condensing Reasoning Patterns via Code Input-Output Prediction
di: Li, Junlong, et al.
Pubblicazione: (2025) -
Heterogeneous Adversarial Play in Interactive Environments
di: Xu, Manjie, et al.
Pubblicazione: (2025)