ExecVerify: White-Box RL with Verifiable Stepwise Rewards for Code Execution Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Tang, Lingxiao, Ye, He, Chu, Zhaoyang, Ye, Muyang, Liu, Zhongxin, Ren, Xiaoxue, Bao, Lingfeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
An Iterative Test-and-Repair Framework for Competitive Code Generation
di: Tang, Lingxiao, et al.
Pubblicazione: (2026)
di: Tang, Lingxiao, et al.
Pubblicazione: (2026)
CodeReasoner: Enhancing the Code Reasoning Ability with Reinforcement Learning
di: Tang, Lingxiao, et al.
Pubblicazione: (2025)
di: Tang, Lingxiao, et al.
Pubblicazione: (2025)
LLM4SZZ: Enhancing SZZ Algorithm with Context-Enhanced Assessment on Large Language Models
di: Tang, Lingxiao, et al.
Pubblicazione: (2025)
di: Tang, Lingxiao, et al.
Pubblicazione: (2025)
An Execution-Verified Multi-Language Benchmark for Code Semantic Reasoning
di: Li, Yikun, et al.
Pubblicazione: (2026)
di: Li, Yikun, et al.
Pubblicazione: (2026)
SolContractEval: A Benchmark for Evaluating Contract-Level Solidity Code Generation
di: Ye, Zhifan, et al.
Pubblicazione: (2025)
di: Ye, Zhifan, et al.
Pubblicazione: (2025)
Towards Verified Code Reasoning by LLMs
di: Sistla, Meghana, et al.
Pubblicazione: (2025)
di: Sistla, Meghana, et al.
Pubblicazione: (2025)
Instructive Code Retriever: Learn from Large Language Model's Feedback for Code Intelligence Tasks
di: Lu, Jiawei, et al.
Pubblicazione: (2024)
di: Lu, Jiawei, et al.
Pubblicazione: (2024)
FGIT: Fault-Guided Fine-Tuning for Code Generation
di: Fan, Lishui, et al.
Pubblicazione: (2025)
di: Fan, Lishui, et al.
Pubblicazione: (2025)
StepCodeReasoner: Aligning Code Reasoning with Stepwise Execution Traces via Reinforcement Learning
di: Wang, Hao, et al.
Pubblicazione: (2026)
di: Wang, Hao, et al.
Pubblicazione: (2026)
AdaCoder: An Adaptive Planning and Multi-Agent Framework for Function-Level Code Generation
di: Zhu, Yueheng, et al.
Pubblicazione: (2025)
di: Zhu, Yueheng, et al.
Pubblicazione: (2025)
ReCode: Reinforcing Code Generation with Reasoning-Process Rewards
di: Fan, Lishui, et al.
Pubblicazione: (2025)
di: Fan, Lishui, et al.
Pubblicazione: (2025)
VERINA: Benchmarking Verifiable Code Generation
di: Ye, Zhe, et al.
Pubblicazione: (2025)
di: Ye, Zhe, et al.
Pubblicazione: (2025)
CodeDPO: Aligning Code Models with Self Generated and Verified Source Code
di: Zhang, Kechi, et al.
Pubblicazione: (2024)
di: Zhang, Kechi, et al.
Pubblicazione: (2024)
Enhancing Project-Specific Code Completion by Inferring Internal API Information
di: Deng, Le, et al.
Pubblicazione: (2025)
di: Deng, Le, et al.
Pubblicazione: (2025)
Beyond Execution: Static-Analysis Rewards and Hint-Conditioned Diffusion RL for Code Generation
di: Ouyang, Shuyin, et al.
Pubblicazione: (2026)
di: Ouyang, Shuyin, et al.
Pubblicazione: (2026)
Servicifying zk-SNARKs Execution for Verifiable Off-chain Computations
di: Domenech, Alvaro Alonso, et al.
Pubblicazione: (2024)
di: Domenech, Alvaro Alonso, et al.
Pubblicazione: (2024)
ATLAS: Automated Toolkit for Large-Scale Verified Code Synthesis
di: Baksys, Mantas, et al.
Pubblicazione: (2025)
di: Baksys, Mantas, et al.
Pubblicazione: (2025)
VerifyThisBench: Generating Code, Specifications, and Proofs All at Once
di: Deng, Xun, et al.
Pubblicazione: (2025)
di: Deng, Xun, et al.
Pubblicazione: (2025)
PEACE: Towards Efficient Project-Level Efficiency Optimization via Hybrid Code Editing
di: Ren, Xiaoxue, et al.
Pubblicazione: (2025)
di: Ren, Xiaoxue, et al.
Pubblicazione: (2025)
Reasoning Through Execution: Unifying Process and Outcome Rewards for Code Generation
di: Yu, Zhuohao, et al.
Pubblicazione: (2024)
di: Yu, Zhuohao, et al.
Pubblicazione: (2024)
CRScore++: Reinforcement Learning with Verifiable Tool and AI Feedback for Code Review
di: Kapadnis, Manav Nitin, et al.
Pubblicazione: (2025)
di: Kapadnis, Manav Nitin, et al.
Pubblicazione: (2025)
TransferFuzz: Fuzzing with Historical Trace for Verifying Propagated Vulnerability Code
di: Li, Siyuan, et al.
Pubblicazione: (2024)
di: Li, Siyuan, et al.
Pubblicazione: (2024)
WybeCoder: Verified Imperative Code Generation
di: Gloeckle, Fabian, et al.
Pubblicazione: (2026)
di: Gloeckle, Fabian, et al.
Pubblicazione: (2026)
SIEVE: Towards Verifiable Certification for Code-datasets
di: Mbodji, Fatou Ndiaye, et al.
Pubblicazione: (2025)
di: Mbodji, Fatou Ndiaye, et al.
Pubblicazione: (2025)
FlexFL: Flexible and Effective Fault Localization with Open-Source Large Language Models
di: Xu, Chuyang, et al.
Pubblicazione: (2024)
di: Xu, Chuyang, et al.
Pubblicazione: (2024)
Learning to Solve and Verify: A Self-Play Framework for Code and Test Generation
di: Lin, Zi, et al.
Pubblicazione: (2025)
di: Lin, Zi, et al.
Pubblicazione: (2025)
Scoring Verifiers: Evaluating Synthetic Verification for Code and Reasoning
di: Ficek, Aleksander, et al.
Pubblicazione: (2025)
di: Ficek, Aleksander, et al.
Pubblicazione: (2025)
MACAA: Belief-Revision Multi-Agent Reasoning for Code Authorship Verification
di: Ye, Jingwei, et al.
Pubblicazione: (2026)
di: Ye, Jingwei, et al.
Pubblicazione: (2026)
Crash-free Deductive Verifiers
di: Nauta, Wander, et al.
Pubblicazione: (2026)
di: Nauta, Wander, et al.
Pubblicazione: (2026)
Verify Linearizability of Concurrent Stacks
di: Wen, Tangliu
Pubblicazione: (2021)
di: Wen, Tangliu
Pubblicazione: (2021)
Improving Retrieval-Augmented Code Comment Generation by Retrieving for Generation
di: Lu, Hanzhen, et al.
Pubblicazione: (2024)
di: Lu, Hanzhen, et al.
Pubblicazione: (2024)
KBX: Verified Model Synchronization via Formal Bidirectional Transformation
di: Zhao, Jianhong, et al.
Pubblicazione: (2024)
di: Zhao, Jianhong, et al.
Pubblicazione: (2024)
Aletheia: What Makes RLVR For Code Verifiers Tick?
di: Venkatkrishna, Vatsal, et al.
Pubblicazione: (2026)
di: Venkatkrishna, Vatsal, et al.
Pubblicazione: (2026)
Issue Localization via LLM-Driven Iterative Code Graph Searching
di: Jiang, Zhonghao, et al.
Pubblicazione: (2025)
di: Jiang, Zhonghao, et al.
Pubblicazione: (2025)
COFFE: A Code Efficiency Benchmark for Code Generation
di: Peng, Yun, et al.
Pubblicazione: (2025)
di: Peng, Yun, et al.
Pubblicazione: (2025)
EffiReasonTrans: RL-Optimized Reasoning for Code Translation
di: Wang, Yanlin, et al.
Pubblicazione: (2025)
di: Wang, Yanlin, et al.
Pubblicazione: (2025)
Talk Less, Verify More: Improving LLM Assistants with Semantic Checks and Execution Feedback
di: Sun, Yan, et al.
Pubblicazione: (2026)
di: Sun, Yan, et al.
Pubblicazione: (2026)
Verify Implementation Equivalence of Large Models
di: Zhan, Qi, et al.
Pubblicazione: (2026)
di: Zhan, Qi, et al.
Pubblicazione: (2026)
Can Large Language Models Serve as Evaluators for Code Summarization?
di: Wu, Yang, et al.
Pubblicazione: (2024)
di: Wu, Yang, et al.
Pubblicazione: (2024)
Edit, But Verify: An Empirical Audit of Instructed Code-Editing Benchmarks
di: Ebrahimi, Amir M., et al.
Pubblicazione: (2026)
di: Ebrahimi, Amir M., et al.
Pubblicazione: (2026)
Documenti analoghi
-
An Iterative Test-and-Repair Framework for Competitive Code Generation
di: Tang, Lingxiao, et al.
Pubblicazione: (2026) -
CodeReasoner: Enhancing the Code Reasoning Ability with Reinforcement Learning
di: Tang, Lingxiao, et al.
Pubblicazione: (2025) -
LLM4SZZ: Enhancing SZZ Algorithm with Context-Enhanced Assessment on Large Language Models
di: Tang, Lingxiao, et al.
Pubblicazione: (2025) -
An Execution-Verified Multi-Language Benchmark for Code Semantic Reasoning
di: Li, Yikun, et al.
Pubblicazione: (2026) -
SolContractEval: A Benchmark for Evaluating Contract-Level Solidity Code Generation
di: Ye, Zhifan, et al.
Pubblicazione: (2025)