What Makes Large Language Models Reason in (Multi-Turn) Code Generation?
Fuente:
arXiv
Guardado en:
| Autores principales: | Zheng, Kunhao, Decugis, Juliette, Gehring, Jonas, Cohen, Taco, Negrevergne, Benjamin, Synnaeve, Gabriel |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Extrapolative Weight Averaging Reveals Correctness-Efficiency Frontiers in Code RL
por: Zheng, Kunhao, et al.
Publicado: (2026)
por: Zheng, Kunhao, et al.
Publicado: (2026)
The KoLMogorov Test: Compression by Code Generation
por: Yoran, Ori, et al.
Publicado: (2025)
por: Yoran, Ori, et al.
Publicado: (2025)
RLEF: Grounding Code LLMs in Execution Feedback with Reinforcement Learning
por: Gehring, Jonas, et al.
Publicado: (2024)
por: Gehring, Jonas, et al.
Publicado: (2024)
Improving Diversity in Language Models: When Temperature Fails, Change the Loss
por: Verine, Alexandre, et al.
Publicado: (2025)
por: Verine, Alexandre, et al.
Publicado: (2025)
Beyond pass@k: Redundancy-Aware RLVR for Multi-Sample Code Generation
por: Florian, Le Bronnec, et al.
Publicado: (2026)
por: Florian, Le Bronnec, et al.
Publicado: (2026)
Meta Large Language Model Compiler: Foundation Models of Compiler Optimization
por: Cummins, Chris, et al.
Publicado: (2024)
por: Cummins, Chris, et al.
Publicado: (2024)
Better & Faster Large Language Models via Multi-token Prediction
por: Gloeckle, Fabian, et al.
Publicado: (2024)
por: Gloeckle, Fabian, et al.
Publicado: (2024)
A Deep Dive into Scaling RL for Code Generation with Synthetic Data and Curricula
por: Sancaktar, Cansu, et al.
Publicado: (2026)
por: Sancaktar, Cansu, et al.
Publicado: (2026)
Soft Policy Optimization: Online Off-Policy RL for Sequence Models
por: Cohen, Taco, et al.
Publicado: (2025)
por: Cohen, Taco, et al.
Publicado: (2025)
BigO(Bench) -- Can LLMs Generate Code with Controlled Time and Space Complexity?
por: Chambon, Pierre, et al.
Publicado: (2025)
por: Chambon, Pierre, et al.
Publicado: (2025)
TurnBench-MS: A Benchmark for Evaluating Multi-Turn, Multi-Step Reasoning in Large Language Models
por: Zhang, Yiran, et al.
Publicado: (2025)
por: Zhang, Yiran, et al.
Publicado: (2025)
Don't Overthink it. Preferring Shorter Thinking Chains for Improved LLM Reasoning
por: Hassid, Michael, et al.
Publicado: (2025)
por: Hassid, Michael, et al.
Publicado: (2025)
CodeIt: Self-Improving Language Models with Prioritized Hindsight Replay
por: Butt, Natasha, et al.
Publicado: (2024)
por: Butt, Natasha, et al.
Publicado: (2024)
What's Wrong with Your Code Generated by Large Language Models? An Extensive Study
por: Dou, Shihan, et al.
Publicado: (2024)
por: Dou, Shihan, et al.
Publicado: (2024)
CogMem: A Cognitive Memory Architecture for Sustained Multi-Turn Reasoning in Large Language Models
por: Zhang, Yiran, et al.
Publicado: (2025)
por: Zhang, Yiran, et al.
Publicado: (2025)
Consistency of Large Reasoning Models Under Multi-Turn Attacks
por: Li, Yubo, et al.
Publicado: (2026)
por: Li, Yubo, et al.
Publicado: (2026)
Reasoning-Augmented Conversation for Multi-Turn Jailbreak Attacks on Large Language Models
por: Ying, Zonghao, et al.
Publicado: (2025)
por: Ying, Zonghao, et al.
Publicado: (2025)
Getting the most out of your tokenizer for pre-training and domain adaptation
por: Dagan, Gautier, et al.
Publicado: (2024)
por: Dagan, Gautier, et al.
Publicado: (2024)
Modeling and Predicting Multi-Turn Answer Instability in Large Language Models
por: He, Jiahang, et al.
Publicado: (2025)
por: He, Jiahang, et al.
Publicado: (2025)
Optimizing Language Models for Inference Time Objectives using Reinforcement Learning
por: Tang, Yunhao, et al.
Publicado: (2025)
por: Tang, Yunhao, et al.
Publicado: (2025)
What can Large Language Models Capture about Code Functional Equivalence?
por: Maveli, Nickil, et al.
Publicado: (2024)
por: Maveli, Nickil, et al.
Publicado: (2024)
Large Language Models Know What Makes Exemplary Contexts
por: Long, Quanyu, et al.
Publicado: (2024)
por: Long, Quanyu, et al.
Publicado: (2024)
GraphIF: Enhancing Multi-Turn Instruction Following for Large Language Models with Relation Graph Prompt
por: Li, Zhenhe, et al.
Publicado: (2025)
por: Li, Zhenhe, et al.
Publicado: (2025)
A Survey on Multi-Turn Interaction Capabilities of Large Language Models
por: Zhang, Chen, et al.
Publicado: (2025)
por: Zhang, Chen, et al.
Publicado: (2025)
Parrot: Enhancing Multi-Turn Instruction Following for Large Language Models
por: Sun, Yuchong, et al.
Publicado: (2023)
por: Sun, Yuchong, et al.
Publicado: (2023)
Beyond Single-Turn: A Survey on Multi-Turn Interactions with Large Language Models
por: Li, Yubo, et al.
Publicado: (2025)
por: Li, Yubo, et al.
Publicado: (2025)
Code Llama: Open Foundation Models for Code
por: Rozière, Baptiste, et al.
Publicado: (2023)
por: Rozière, Baptiste, et al.
Publicado: (2023)
Multi-Agent Large Language Models for Conversational Task-Solving
por: Becker, Jonas
Publicado: (2024)
por: Becker, Jonas
Publicado: (2024)
The Larger the Better? Improved LLM Code-Generation via Budget Reallocation
por: Hassid, Michael, et al.
Publicado: (2024)
por: Hassid, Michael, et al.
Publicado: (2024)
Collaborative Rational Speech Act: Pragmatic Reasoning for Multi-Turn Dialog
por: Estienne, Lautaro, et al.
Publicado: (2025)
por: Estienne, Lautaro, et al.
Publicado: (2025)
CodeMind: Evaluating Large Language Models for Code Reasoning
por: Liu, Changshu, et al.
Publicado: (2024)
por: Liu, Changshu, et al.
Publicado: (2024)
Quantifying Conversational Reliability of Large Language Models under Multi-Turn Interaction
por: Myung, Jiyoon
Publicado: (2026)
por: Myung, Jiyoon
Publicado: (2026)
Toward Training Superintelligent Software Agents through Self-Play SWE-RL
por: Wei, Yuxiang, et al.
Publicado: (2025)
por: Wei, Yuxiang, et al.
Publicado: (2025)
Evaluating the Generalization Capabilities of Large Language Models on Code Reasoning
por: Yang, Rem, et al.
Publicado: (2025)
por: Yang, Rem, et al.
Publicado: (2025)
Multi-Programming Language Ensemble for Code Generation in Large Language Model
por: Xue, Tengfei, et al.
Publicado: (2024)
por: Xue, Tengfei, et al.
Publicado: (2024)
Making Large Language Models Better Reasoners with Orchestrated Streaming Experiences
por: Liu, Xiangyang, et al.
Publicado: (2025)
por: Liu, Xiangyang, et al.
Publicado: (2025)
CodeIP: A Grammar-Guided Multi-Bit Watermark for Large Language Models of Code
por: Guan, Batu, et al.
Publicado: (2024)
por: Guan, Batu, et al.
Publicado: (2024)
Assessing LLM Text Detection in Educational Contexts: Does Human Contribution Affect Detection?
por: Gehring, Lukas, et al.
Publicado: (2025)
por: Gehring, Lukas, et al.
Publicado: (2025)
Making Long-Context Language Models Better Multi-Hop Reasoners
por: Li, Yanyang, et al.
Publicado: (2024)
por: Li, Yanyang, et al.
Publicado: (2024)
MT-Eval: A Multi-Turn Capabilities Evaluation Benchmark for Large Language Models
por: Kwan, Wai-Chung, et al.
Publicado: (2024)
por: Kwan, Wai-Chung, et al.
Publicado: (2024)
Ejemplares similares
-
Extrapolative Weight Averaging Reveals Correctness-Efficiency Frontiers in Code RL
por: Zheng, Kunhao, et al.
Publicado: (2026) -
The KoLMogorov Test: Compression by Code Generation
por: Yoran, Ori, et al.
Publicado: (2025) -
RLEF: Grounding Code LLMs in Execution Feedback with Reinforcement Learning
por: Gehring, Jonas, et al.
Publicado: (2024) -
Improving Diversity in Language Models: When Temperature Fails, Change the Loss
por: Verine, Alexandre, et al.
Publicado: (2025) -
Beyond pass@k: Redundancy-Aware RLVR for Multi-Sample Code Generation
por: Florian, Le Bronnec, et al.
Publicado: (2026)