Self-Execution Simulation Improves Coding Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Maimon, Gallil, Yoran, Ori, Kreuk, Felix, Hassid, Michael, Cohen, Gal, Chambon, Pierre, Adi, Yossi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Scaling Analysis of Interleaved Speech-Text Language Models
par: Maimon, Gallil, et autres
Publié: (2025)
par: Maimon, Gallil, et autres
Publié: (2025)
Slamming: Training a Speech Language Model on One GPU in a Day
par: Maimon, Gallil, et autres
Publié: (2025)
par: Maimon, Gallil, et autres
Publié: (2025)
Salmon: A Suite for Acoustic Language Model Evaluation
par: Maimon, Gallil, et autres
Publié: (2024)
par: Maimon, Gallil, et autres
Publié: (2024)
StressTest: Can YOUR Speech LM Handle the Stress?
par: Yosha, Iddo, et autres
Publié: (2025)
par: Yosha, Iddo, et autres
Publié: (2025)
The Larger the Better? Improved LLM Code-Generation via Budget Reallocation
par: Hassid, Michael, et autres
Publié: (2024)
par: Hassid, Michael, et autres
Publié: (2024)
Auto-Regressive vs Flow-Matching: a Comparative Study of Modeling Paradigms for Text-to-Music Generation
par: Tal, Or, et autres
Publié: (2025)
par: Tal, Or, et autres
Publié: (2025)
Textually Pretrained Speech Language Models
par: Hassid, Michael, et autres
Publié: (2023)
par: Hassid, Michael, et autres
Publié: (2023)
Don't Overthink it. Preferring Shorter Thinking Chains for Improved LLM Reasoning
par: Hassid, Michael, et autres
Publié: (2025)
par: Hassid, Michael, et autres
Publié: (2025)
On Pruning State-Space LLMs
par: Ghattas, Tamer, et autres
Publié: (2025)
par: Ghattas, Tamer, et autres
Publié: (2025)
Extrapolative Weight Averaging Reveals Correctness-Efficiency Frontiers in Code RL
par: Zheng, Kunhao, et autres
Publié: (2026)
par: Zheng, Kunhao, et autres
Publié: (2026)
CodeIt: Self-Improving Language Models with Prioritized Hindsight Replay
par: Butt, Natasha, et autres
Publié: (2024)
par: Butt, Natasha, et autres
Publié: (2024)
Transformers are Multi-State RNNs
par: Oren, Matanel, et autres
Publié: (2024)
par: Oren, Matanel, et autres
Publié: (2024)
LaMI: Augmenting Large Language Models via Late Multi-Image Fusion
par: Yariv, Guy, et autres
Publié: (2024)
par: Yariv, Guy, et autres
Publié: (2024)
Unsupervised Speech Segmentation: A General Approach Using Speech Language Models
par: Elmakies, Avishai, et autres
Publié: (2025)
par: Elmakies, Avishai, et autres
Publié: (2025)
PAST: Phonetic-Acoustic Speech Tokenizer
par: Har-Tuv, Nadav, et autres
Publié: (2025)
par: Har-Tuv, Nadav, et autres
Publié: (2025)
Preventing Rogue Agents Improves Multi-Agent Collaboration
par: Barbi, Ohav, et autres
Publié: (2025)
par: Barbi, Ohav, et autres
Publié: (2025)
The KoLMogorov Test: Compression by Code Generation
par: Yoran, Ori, et autres
Publié: (2025)
par: Yoran, Ori, et autres
Publié: (2025)
On the Semantic Latent Space of Diffusion-Based Text-to-Speech Models
par: Varshavsky-Hassid, Miri, et autres
Publié: (2024)
par: Varshavsky-Hassid, Miri, et autres
Publié: (2024)
CodeCloak: A Method for Evaluating and Mitigating Code Leakage by LLM Code Assistants
par: Noah, Amit Finkman, et autres
Publié: (2024)
par: Noah, Amit Finkman, et autres
Publié: (2024)
Making Retrieval-Augmented Language Models Robust to Irrelevant Context
par: Yoran, Ori, et autres
Publié: (2023)
par: Yoran, Ori, et autres
Publié: (2023)
Selective Attention Improves Transformer
par: Leviathan, Yaniv, et autres
Publié: (2024)
par: Leviathan, Yaniv, et autres
Publié: (2024)
Self-play with Execution Feedback: Improving Instruction-following Capabilities of Large Language Models
par: Dong, Guanting, et autres
Publié: (2024)
par: Dong, Guanting, et autres
Publié: (2024)
Prompt Repetition Improves Non-Reasoning LLMs
par: Leviathan, Yaniv, et autres
Publié: (2025)
par: Leviathan, Yaniv, et autres
Publié: (2025)
Self-Improving World Modelling with Latent Actions
par: Qiu, Yifu, et autres
Publié: (2026)
par: Qiu, Yifu, et autres
Publié: (2026)
NExT: Teaching Large Language Models to Reason about Code Execution
par: Ni, Ansong, et autres
Publié: (2024)
par: Ni, Ansong, et autres
Publié: (2024)
Code Simulation Challenges for Large Language Models
par: La Malfa, Emanuele, et autres
Publié: (2024)
par: La Malfa, Emanuele, et autres
Publié: (2024)
Self-Taught Optimizer (STOP): Recursively Self-Improving Code Generation
par: Zelikman, Eric, et autres
Publié: (2023)
par: Zelikman, Eric, et autres
Publié: (2023)
Quality Matters: Evaluating Synthetic Data for Tool-Using LLMs
par: Iskander, Shadi, et autres
Publié: (2024)
par: Iskander, Shadi, et autres
Publié: (2024)
CWM: An Open-Weights LLM for Research on Code Generation with World Models
par: FAIR CodeGen team, et autres
Publié: (2025)
par: FAIR CodeGen team, et autres
Publié: (2025)
Self-Infilling Code Generation
par: Zheng, Lin, et autres
Publié: (2023)
par: Zheng, Lin, et autres
Publié: (2023)
Self-AMPLIFY: Improving Small Language Models with Self Post Hoc Explanations
par: Bhan, Milan, et autres
Publié: (2024)
par: Bhan, Milan, et autres
Publié: (2024)
Training Language Models on Synthetic Edit Sequences Improves Code Synthesis
par: Piterbarg, Ulyana, et autres
Publié: (2024)
par: Piterbarg, Ulyana, et autres
Publié: (2024)
From Loops to Oops: Fallback Behaviors of Language Models Under Uncertainty
par: Ivgi, Maor, et autres
Publié: (2024)
par: Ivgi, Maor, et autres
Publié: (2024)
$\textbf{PLUM}$: Improving Code LMs with Execution-Guided On-Policy Preference Learning Driven By Synthetic Test Cases
par: Zhang, Dylan, et autres
Publié: (2024)
par: Zhang, Dylan, et autres
Publié: (2024)
Improving LLM Code Reasoning via Semantic Equivalence Self-Play with Formal Verification
par: Barone, Antonio Valerio Miceli, et autres
Publié: (2026)
par: Barone, Antonio Valerio Miceli, et autres
Publié: (2026)
Improving Search Agent with One Line of Code
par: Li, Jian, et autres
Publié: (2026)
par: Li, Jian, et autres
Publié: (2026)
Deep Bayesian Active Learning for Preference Modeling in Large Language Models
par: Melo, Luckeciano C., et autres
Publié: (2024)
par: Melo, Luckeciano C., et autres
Publié: (2024)
SelfCodeAlign: Self-Alignment for Code Generation
par: Wei, Yuxiang, et autres
Publié: (2024)
par: Wei, Yuxiang, et autres
Publié: (2024)
Can LLMs Compress (and Decompress)? Evaluating Code Understanding and Execution via Invertibility
par: Maveli, Nickil, et autres
Publié: (2026)
par: Maveli, Nickil, et autres
Publié: (2026)
Superscopes: Amplifying Internal Feature Representations for Language Model Interpretation
par: Jacobi, Jonathan, et autres
Publié: (2025)
par: Jacobi, Jonathan, et autres
Publié: (2025)
Documents similaires
-
Scaling Analysis of Interleaved Speech-Text Language Models
par: Maimon, Gallil, et autres
Publié: (2025) -
Slamming: Training a Speech Language Model on One GPU in a Day
par: Maimon, Gallil, et autres
Publié: (2025) -
Salmon: A Suite for Acoustic Language Model Evaluation
par: Maimon, Gallil, et autres
Publié: (2024) -
StressTest: Can YOUR Speech LM Handle the Stress?
par: Yosha, Iddo, et autres
Publié: (2025) -
The Larger the Better? Improved LLM Code-Generation via Budget Reallocation
par: Hassid, Michael, et autres
Publié: (2024)