Training Language Models to Generate Quality Code with Program Analysis Feedback
Fuente:
arXiv
Guardado en:
| Autores principales: | Yao, Feng, Wang, Zilong, Liu, Liyuan, Cui, Junxia, Zhong, Li, Fu, Xiaohan, Mai, Haohui, Krishnan, Vish, Gao, Jianfeng, Shang, Jingbo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Finish First, Perfect Later: Test-Time Token-Level Cross-Validation for Diffusion Large Language Models
por: Tian, Runchu, et al.
Publicado: (2025)
por: Tian, Runchu, et al.
Publicado: (2025)
Beyond Scaling: Predicting Patent Approval with Domain-specific Fine-grained Claim Dependency Graph
por: Gao, Xiaochen Kev, et al.
Publicado: (2024)
por: Gao, Xiaochen Kev, et al.
Publicado: (2024)
Text Generation Beyond Discrete Token Sampling
por: Zhuang, Yufan, et al.
Publicado: (2025)
por: Zhuang, Yufan, et al.
Publicado: (2025)
VeriLocc: End-to-End Cross-Architecture Register Allocation via LLM
por: Jin, Lesheng, et al.
Publicado: (2025)
por: Jin, Lesheng, et al.
Publicado: (2025)
Memorize or Generalize? Evaluating LLM Code Generation with Code Rewriting
por: Zhang, Lizhe, et al.
Publicado: (2025)
por: Zhang, Lizhe, et al.
Publicado: (2025)
Debug like a Human: A Large Language Model Debugger via Verifying Runtime Execution Step-by-step
por: Zhong, Li, et al.
Publicado: (2024)
por: Zhong, Li, et al.
Publicado: (2024)
Toward Student-Oriented Teacher Network Training For Knowledge Distillation
por: Dong, Chengyu, et al.
Publicado: (2022)
por: Dong, Chengyu, et al.
Publicado: (2022)
Vector-ICL: In-context Learning with Continuous Vector Representations
por: Zhuang, Yufan, et al.
Publicado: (2024)
por: Zhuang, Yufan, et al.
Publicado: (2024)
Learning a Decision Tree Algorithm with Transformers
por: Zhuang, Yufan, et al.
Publicado: (2024)
por: Zhuang, Yufan, et al.
Publicado: (2024)
Towards Few-shot Entity Recognition in Document Images: A Graph Neural Network Approach Robust to Image Manipulation
por: Krishnan, Prashant, et al.
Publicado: (2023)
por: Krishnan, Prashant, et al.
Publicado: (2023)
Test-time Recursive Thinking: Self-Improvement without External Feedback
por: Zhuang, Yufan, et al.
Publicado: (2026)
por: Zhuang, Yufan, et al.
Publicado: (2026)
Cuckoo: An IE Free Rider Hatched by Massive Nutrition in LLM's Nest
por: Peng, Letian, et al.
Publicado: (2025)
por: Peng, Letian, et al.
Publicado: (2025)
A Value-Based Approach to AI Ethics: Accountability, Transparency, Explainability, and Usability
por: Vish Iyer
Publicado: (2025)
por: Vish Iyer
Publicado: (2025)
DOCMASTER: A Unified Platform for Annotation, Training, & Inference in Document Question-Answering
por: Nguyen, Alex, et al.
Publicado: (2024)
por: Nguyen, Alex, et al.
Publicado: (2024)
MetaIE: Distilling a Meta Model from LLM for All Kinds of Information Extraction Tasks
por: Peng, Letian, et al.
Publicado: (2024)
por: Peng, Letian, et al.
Publicado: (2024)
Bringing Textual Prompt to AI-Generated Image Quality Assessment
por: Qu, Bowen, et al.
Publicado: (2024)
por: Qu, Bowen, et al.
Publicado: (2024)
EvoLen: Evolution-Guided Tokenization for DNA Language Model
por: Huang, Nan, et al.
Publicado: (2026)
por: Huang, Nan, et al.
Publicado: (2026)
OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation
por: Wang, Zilong, et al.
Publicado: (2024)
por: Wang, Zilong, et al.
Publicado: (2024)
Can ChatGPT replace StackOverflow? A Study on Robustness and Reliability of Large Language Model Code Generation
por: Zhong, Li, et al.
Publicado: (2023)
por: Zhong, Li, et al.
Publicado: (2023)
Improving Code Generation by Training with Natural Language Feedback
por: Chen, Angelica, et al.
Publicado: (2023)
por: Chen, Angelica, et al.
Publicado: (2023)
Evaluating the Smooth Control of Attribute Intensity in Text Generation with LLMs
por: Zhou, Shang, et al.
Publicado: (2024)
por: Zhou, Shang, et al.
Publicado: (2024)
Smaller Language Models are capable of selecting Instruction-Tuning Training Data for Larger Language Models
por: Mekala, Dheeraj, et al.
Publicado: (2024)
por: Mekala, Dheeraj, et al.
Publicado: (2024)
Revisiting Evolutionary Program Repair via Code Language Model
por: Wang, Yunan, et al.
Publicado: (2024)
por: Wang, Yunan, et al.
Publicado: (2024)
The Price of Format: Diversity Collapse in LLMs
por: Yun, Longfei, et al.
Publicado: (2025)
por: Yun, Longfei, et al.
Publicado: (2025)
MinD-3D++: Advancing fMRI-Based 3D Reconstruction with High-Quality Textured Mesh Generation and a Comprehensive Dataset
por: Gao, Jianxiong, et al.
Publicado: (2024)
por: Gao, Jianxiong, et al.
Publicado: (2024)
Watermarks for Language Models via Probabilistic Automata
por: Wang, Yangkun, et al.
Publicado: (2025)
por: Wang, Yangkun, et al.
Publicado: (2025)
Heuristic Bundle Upper Bound Based Polyhedral Bundle Method for Semidefinite Programming
por: Cui, Zilong, et al.
Publicado: (2025)
por: Cui, Zilong, et al.
Publicado: (2025)
ChipMATE: Multi-Agent Training via Reinforcement Learning for Enhanced RTL Generation
por: Yu, Zhongkai, et al.
Publicado: (2026)
por: Yu, Zhongkai, et al.
Publicado: (2026)
A Tale of LLMs and Induced Small Proxies: Scalable Agents for Knowledge Mining
por: Zhang, Sipeng, et al.
Publicado: (2025)
por: Zhang, Sipeng, et al.
Publicado: (2025)
Data Contamination Can Cross Language Barriers
por: Yao, Feng, et al.
Publicado: (2024)
por: Yao, Feng, et al.
Publicado: (2024)
Matching Skeleton-based Activity Representations with Heterogeneous Signals for HAR
por: Li, Shuheng, et al.
Publicado: (2025)
por: Li, Shuheng, et al.
Publicado: (2025)
AReaL-Hex: Accommodating Asynchronous RL Training over Heterogeneous GPUs
por: Yan, Ran, et al.
Publicado: (2025)
por: Yan, Ran, et al.
Publicado: (2025)
Sketch Then Generate: Providing Incremental User Feedback and Guiding LLM Code Generation through Language-Oriented Code Sketches
por: Zhu-Tian, Chen, et al.
Publicado: (2024)
por: Zhu-Tian, Chen, et al.
Publicado: (2024)
CodeContests-O: Powering LLMs via Feedback-Driven Iterative Test Case Generation
por: Cai, Jianfeng, et al.
Publicado: (2026)
por: Cai, Jianfeng, et al.
Publicado: (2026)
Improving the Quality of Life for Older Adult Residents in Long‐Term Care Facilities: Experiences From COVID‐19 Pandemic and Future Preparedness
por: Haohui Deng, et al.
Publicado: (2025)
por: Haohui Deng, et al.
Publicado: (2025)
Correlation and Navigation in the Vocabulary Key Representation Space of Language Models
por: Peng, Letian, et al.
Publicado: (2024)
por: Peng, Letian, et al.
Publicado: (2024)
AutoCode: LLMs as Problem Setters for Competitive Programming
por: Zhou, Shang, et al.
Publicado: (2025)
por: Zhou, Shang, et al.
Publicado: (2025)
Unlocking Private Healthcare in China: Large Language Model–Based Policy Analysis and Empirical Evidence on Patient Choice
por: Kai Liu, et al.
Publicado: (2026)
por: Kai Liu, et al.
Publicado: (2026)
No Man is an Island: Towards Fully Automatic Programming by Code Search, Code Generation and Program Repair
por: Zhang, Quanjun, et al.
Publicado: (2024)
por: Zhang, Quanjun, et al.
Publicado: (2024)
Learning to Solve and Verify: A Self-Play Framework for Code and Test Generation
por: Lin, Zi, et al.
Publicado: (2025)
por: Lin, Zi, et al.
Publicado: (2025)
Ejemplares similares
-
Finish First, Perfect Later: Test-Time Token-Level Cross-Validation for Diffusion Large Language Models
por: Tian, Runchu, et al.
Publicado: (2025) -
Beyond Scaling: Predicting Patent Approval with Domain-specific Fine-grained Claim Dependency Graph
por: Gao, Xiaochen Kev, et al.
Publicado: (2024) -
Text Generation Beyond Discrete Token Sampling
por: Zhuang, Yufan, et al.
Publicado: (2025) -
VeriLocc: End-to-End Cross-Architecture Register Allocation via LLM
por: Jin, Lesheng, et al.
Publicado: (2025) -
Memorize or Generalize? Evaluating LLM Code Generation with Code Rewriting
por: Zhang, Lizhe, et al.
Publicado: (2025)