Bridging Online and Offline RL: Contextual Bandit Learning for Multi-Turn Code Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Ziru, Chen, Dongdong, Jin, Ruinan, Liang, Yingbin, Xie, Yujia, Sun, Huan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Improving Code Localization with Repository Memory
di: Wang, Boshi, et al.
Pubblicazione: (2025)
di: Wang, Boshi, et al.
Pubblicazione: (2025)
Contextualized Code Pretraining for Code Generation
di: Liu, Chen, et al.
Pubblicazione: (2026)
di: Liu, Chen, et al.
Pubblicazione: (2026)
Show and Tell: Prompt Strategies for Style Control in Multi-Turn LLM Code Generation
di: Bohr, Jeremiah
Pubblicazione: (2025)
di: Bohr, Jeremiah
Pubblicazione: (2025)
Bridging Code Graphs and Large Language Models for Better Code Understanding
di: Chen, Zeqi, et al.
Pubblicazione: (2025)
di: Chen, Zeqi, et al.
Pubblicazione: (2025)
Contextualized Data-Wrangling Code Generation in Computational Notebooks
di: Huang, Junjie, et al.
Pubblicazione: (2024)
di: Huang, Junjie, et al.
Pubblicazione: (2024)
CodeRL+: Improving Code Generation via Reinforcement with Execution Semantics Alignment
di: Jiang, Xue, et al.
Pubblicazione: (2025)
di: Jiang, Xue, et al.
Pubblicazione: (2025)
CodeBenchGen: Creating Scalable Execution-based Code Generation Benchmarks
di: Xie, Yiqing, et al.
Pubblicazione: (2024)
di: Xie, Yiqing, et al.
Pubblicazione: (2024)
Python Symbolic Execution with LLM-powered Code Generation
di: Wang, Wenhan, et al.
Pubblicazione: (2024)
di: Wang, Wenhan, et al.
Pubblicazione: (2024)
CodeScout: Contextual Problem Statement Enhancement for Software Agents
di: Suri, Manan, et al.
Pubblicazione: (2026)
di: Suri, Manan, et al.
Pubblicazione: (2026)
ArtifactsBench: Bridging the Visual-Interactive Gap in LLM Code Generation Evaluation
di: Zhang, Chenchen, et al.
Pubblicazione: (2025)
di: Zhang, Chenchen, et al.
Pubblicazione: (2025)
Enhancing Code LLMs with Reinforcement Learning in Code Generation: A Survey
di: Wang, Junqiao, et al.
Pubblicazione: (2024)
di: Wang, Junqiao, et al.
Pubblicazione: (2024)
IndicEval-XL: Bridging Linguistic Diversity in Code Generation Across Indic Languages
di: Singh, Ujjwal, et al.
Pubblicazione: (2025)
di: Singh, Ujjwal, et al.
Pubblicazione: (2025)
GenX: Mastering Code and Test Generation with Execution Feedback
di: Wang, Nan, et al.
Pubblicazione: (2024)
di: Wang, Nan, et al.
Pubblicazione: (2024)
RGD: Multi-LLM Based Agent Debugger via Refinement and Generation Guidance
di: Jin, Haolin, et al.
Pubblicazione: (2024)
di: Jin, Haolin, et al.
Pubblicazione: (2024)
CodeOCR: On the Effectiveness of Vision Language Models in Code Understanding
di: Shi, Yuling, et al.
Pubblicazione: (2026)
di: Shi, Yuling, et al.
Pubblicazione: (2026)
Coeditor: Leveraging Contextual Changes for Multi-round Code Auto-editing
di: Wei, Jiayi, et al.
Pubblicazione: (2023)
di: Wei, Jiayi, et al.
Pubblicazione: (2023)
ClassEval-Pro: A Cross-Domain Benchmark for Class-Level Code Generation
di: Chen, Yeheng, et al.
Pubblicazione: (2026)
di: Chen, Yeheng, et al.
Pubblicazione: (2026)
Code Fingerprints: Disentangled Attribution of LLM-Generated Code
di: Guo, Jiaxun, et al.
Pubblicazione: (2026)
di: Guo, Jiaxun, et al.
Pubblicazione: (2026)
Is Your AI-Generated Code Really Safe? Evaluating Large Language Models on Secure Code Generation with CodeSecEval
di: Wang, Jiexin, et al.
Pubblicazione: (2024)
di: Wang, Jiexin, et al.
Pubblicazione: (2024)
CodeRAG-Bench: Can Retrieval Augment Code Generation?
di: Wang, Zora Zhiruo, et al.
Pubblicazione: (2024)
di: Wang, Zora Zhiruo, et al.
Pubblicazione: (2024)
Bridge and Hint: Extending Pre-trained Language Models for Long-Range Code
di: Chen, Yujia, et al.
Pubblicazione: (2024)
di: Chen, Yujia, et al.
Pubblicazione: (2024)
CodeFlowBench: A Multi-turn, Iterative Benchmark for Complex Code Generation
di: Wang, Sizhe, et al.
Pubblicazione: (2025)
di: Wang, Sizhe, et al.
Pubblicazione: (2025)
Divide-and-Conquer Meets Consensus: Unleashing the Power of Functions in Code Generation
di: Chen, Jingchang, et al.
Pubblicazione: (2024)
di: Chen, Jingchang, et al.
Pubblicazione: (2024)
CYCLE: Learning to Self-Refine the Code Generation
di: Ding, Yangruibo, et al.
Pubblicazione: (2024)
di: Ding, Yangruibo, et al.
Pubblicazione: (2024)
KCoEvo: A Knowledge Graph Augmented Framework for Evolutionary Code Generation
di: Kang, Jiazhen, et al.
Pubblicazione: (2026)
di: Kang, Jiazhen, et al.
Pubblicazione: (2026)
Benchmarking Correctness and Security in Multi-Turn Code Generation
di: Rawal, Ruchit, et al.
Pubblicazione: (2025)
di: Rawal, Ruchit, et al.
Pubblicazione: (2025)
EvoCodeBench: An Evolving Code Generation Benchmark with Domain-Specific Evaluations
di: Li, Jia, et al.
Pubblicazione: (2024)
di: Li, Jia, et al.
Pubblicazione: (2024)
SpecMind: Cognitively Inspired, Interactive Multi-Turn Framework for Postcondition Inference
di: Le, Cuong Chi, et al.
Pubblicazione: (2026)
di: Le, Cuong Chi, et al.
Pubblicazione: (2026)
Towards Exception Safety Code Generation with Intermediate Representation Agents Framework
di: Zhang, Xuanming, et al.
Pubblicazione: (2024)
di: Zhang, Xuanming, et al.
Pubblicazione: (2024)
InstructCoder: Instruction Tuning Large Language Models for Code Editing
di: Li, Kaixin, et al.
Pubblicazione: (2023)
di: Li, Kaixin, et al.
Pubblicazione: (2023)
Showing LLM-Generated Code Selectively Based on Confidence of LLMs
di: Li, Jia, et al.
Pubblicazione: (2024)
di: Li, Jia, et al.
Pubblicazione: (2024)
Iterative Refinement of Project-Level Code Context for Precise Code Generation with Compiler Feedback
di: Bi, Zhangqian, et al.
Pubblicazione: (2024)
di: Bi, Zhangqian, et al.
Pubblicazione: (2024)
LLMSniffer: Detecting LLM-Generated Code via GraphCodeBERT and Supervised Contrastive Learning
di: Dihan, Mahir Labib, et al.
Pubblicazione: (2026)
di: Dihan, Mahir Labib, et al.
Pubblicazione: (2026)
Self-Improving Code Generation via Semantic Entropy and Behavioral Consensus
di: Zhang, Huan, et al.
Pubblicazione: (2026)
di: Zhang, Huan, et al.
Pubblicazione: (2026)
Environment-Aware Code Generation: How far are We?
di: Wu, Tongtong, et al.
Pubblicazione: (2026)
di: Wu, Tongtong, et al.
Pubblicazione: (2026)
IntentCoding: Amplifying User Intent in Code Generation
di: Fang, Zheng, et al.
Pubblicazione: (2026)
di: Fang, Zheng, et al.
Pubblicazione: (2026)
Beyond pass@k: Redundancy-Aware RLVR for Multi-Sample Code Generation
di: Florian, Le Bronnec, et al.
Pubblicazione: (2026)
di: Florian, Le Bronnec, et al.
Pubblicazione: (2026)
MEMCoder: Multi-dimensional Evolving Memory for Private-Library-Oriented Code Generation
di: Li, Mofei, et al.
Pubblicazione: (2026)
di: Li, Mofei, et al.
Pubblicazione: (2026)
Evaluation of Code LLMs on Geospatial Code Generation
di: Gramacki, Piotr, et al.
Pubblicazione: (2024)
di: Gramacki, Piotr, et al.
Pubblicazione: (2024)
CodeR: Issue Resolving with Multi-Agent and Task Graphs
di: Chen, Dong, et al.
Pubblicazione: (2024)
di: Chen, Dong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Improving Code Localization with Repository Memory
di: Wang, Boshi, et al.
Pubblicazione: (2025) -
Contextualized Code Pretraining for Code Generation
di: Liu, Chen, et al.
Pubblicazione: (2026) -
Show and Tell: Prompt Strategies for Style Control in Multi-Turn LLM Code Generation
di: Bohr, Jeremiah
Pubblicazione: (2025) -
Bridging Code Graphs and Large Language Models for Better Code Understanding
di: Chen, Zeqi, et al.
Pubblicazione: (2025) -
Contextualized Data-Wrangling Code Generation in Computational Notebooks
di: Huang, Junjie, et al.
Pubblicazione: (2024)