CodeFort: Robust Training for Code Generation Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Yuhao, Wang, Shiqi, Qian, Haifeng, Wang, Zijian, Shang, Mingyue, Liu, Linbo, Gouda, Sanjay Krishna, Ray, Baishakhi, Ramanathan, Murali Krishna, Ma, Xiaofei, Deoras, Anoop |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LibEvolutionEval: A Benchmark and Study for Version-Specific Code Generation
por: Kuhar, Sachit, et al.
Publicado: (2024)
por: Kuhar, Sachit, et al.
Publicado: (2024)
Code-Aware Prompting: A study of Coverage Guided Test Generation in Regression Setting using LLM
por: Ryan, Gabriel, et al.
Publicado: (2024)
por: Ryan, Gabriel, et al.
Publicado: (2024)
Structural Code Search using Natural Language Queries
por: Limpanukorn, Ben, et al.
Publicado: (2025)
por: Limpanukorn, Ben, et al.
Publicado: (2025)
LeDex: Training LLMs to Better Self-Debug and Explain Code
por: Jiang, Nan, et al.
Publicado: (2024)
por: Jiang, Nan, et al.
Publicado: (2024)
CodeAssistBench (CAB): Dataset & Benchmarking for Multi-turn Chat-Based Code Assistance
por: Kim, Myeongsoo, et al.
Publicado: (2025)
por: Kim, Myeongsoo, et al.
Publicado: (2025)
Constrained Decoding for Fill-in-the-Middle Code Language Models via Efficient Left and Right Quotienting of Context-Sensitive Grammars
por: Melcer, Daniel, et al.
Publicado: (2024)
por: Melcer, Daniel, et al.
Publicado: (2024)
UTFix: Change Aware Unit Test Repairing using LLM
por: Rahman, Shanto, et al.
Publicado: (2025)
por: Rahman, Shanto, et al.
Publicado: (2025)
SpecTra: Enhancing the Code Translation Ability of Language Models by Generating Multi-Modal Specifications
por: Nitin, Vikram, et al.
Publicado: (2024)
por: Nitin, Vikram, et al.
Publicado: (2024)
Repoformer: Selective Retrieval for Repository-Level Code Completion
por: Wu, Di, et al.
Publicado: (2024)
por: Wu, Di, et al.
Publicado: (2024)
CODESTRUCT: Code Agents over Structured Action Spaces
por: Kim, Myeongsoo, et al.
Publicado: (2026)
por: Kim, Myeongsoo, et al.
Publicado: (2026)
BASS: Batched Attention-optimized Speculative Sampling
por: Qian, Haifeng, et al.
Publicado: (2024)
por: Qian, Haifeng, et al.
Publicado: (2024)
On Mitigating Code LLM Hallucinations with API Documentation
por: Jain, Nihal, et al.
Publicado: (2024)
por: Jain, Nihal, et al.
Publicado: (2024)
MigrationBench: Repository-Level Code Migration Benchmark from Java 8
por: Liu, Linbo, et al.
Publicado: (2025)
por: Liu, Linbo, et al.
Publicado: (2025)
C2SaferRust: Transforming C Projects into Safer Rust with NeuroSymbolic Techniques
por: Nitin, Vikram, et al.
Publicado: (2025)
por: Nitin, Vikram, et al.
Publicado: (2025)
CYCLE: Learning to Self-Refine the Code Generation
por: Ding, Yangruibo, et al.
Publicado: (2024)
por: Ding, Yangruibo, et al.
Publicado: (2024)
Dynamic Benchmarking of Reasoning Capabilities in Code Large Language Models Under Data Contamination
por: Chen, Simin, et al.
Publicado: (2025)
por: Chen, Simin, et al.
Publicado: (2025)
SpecAgent: A Speculative Retrieval and Forecasting Agent for Code Completion
por: Ma, George, et al.
Publicado: (2025)
por: Ma, George, et al.
Publicado: (2025)
SemCoder: Training Code Language Models with Comprehensive Semantics Reasoning
por: Ding, Yangruibo, et al.
Publicado: (2024)
por: Ding, Yangruibo, et al.
Publicado: (2024)
EditLord: Learning Code Transformation Rules for Code Editing
por: Li, Weichen, et al.
Publicado: (2025)
por: Li, Weichen, et al.
Publicado: (2025)
Yuga: Automatically Detecting Lifetime Annotation Bugs in the Rust Language
por: Nitin, Vikram, et al.
Publicado: (2023)
por: Nitin, Vikram, et al.
Publicado: (2023)
Code Quality Analysis of Translations from C to Rust
por: Tadesse, Biruk, et al.
Publicado: (2026)
por: Tadesse, Biruk, et al.
Publicado: (2026)
Automated Code Editing with Search-Generate-Modify
por: Liu, Changshu, et al.
Publicado: (2023)
por: Liu, Changshu, et al.
Publicado: (2023)
CodeSense: a Real-World Benchmark and Dataset for Code Semantic Reasoning
por: Roy, Monoshi Kumar, et al.
Publicado: (2025)
por: Roy, Monoshi Kumar, et al.
Publicado: (2025)
Learning Code Preference via Synthetic Evolution
por: Liu, Jiawei, et al.
Publicado: (2024)
por: Liu, Jiawei, et al.
Publicado: (2024)
Coherence Collapse: Diagnosing Why Code Agents Fail After Reaching the Right Code
por: Kim, Myeongsoo, et al.
Publicado: (2026)
por: Kim, Myeongsoo, et al.
Publicado: (2026)
CWEval: Outcome-driven Evaluation on Functionality and Security of LLM Code Generation
por: Peng, Jinjun, et al.
Publicado: (2025)
por: Peng, Jinjun, et al.
Publicado: (2025)
Code Reasoning for Software Engineering Tasks: A Survey and A Call to Action
por: Pujar, Saurabh, et al.
Publicado: (2025)
por: Pujar, Saurabh, et al.
Publicado: (2025)
On the Effectiveness of Training Data Optimization for LLM-based Code Generation: An Empirical Study
por: Kuang, Shiqi, et al.
Publicado: (2025)
por: Kuang, Shiqi, et al.
Publicado: (2025)
Planning-Aware Code Infilling via Horizon-Length Prediction
por: Ding, Yifeng, et al.
Publicado: (2024)
por: Ding, Yifeng, et al.
Publicado: (2024)
Breaking the Code: Security Assessment of AI Code Agents Through Systematic Jailbreaking Attacks
por: Saha, Shoumik, et al.
Publicado: (2025)
por: Saha, Shoumik, et al.
Publicado: (2025)
Protocode: Prototype-Driven Interpretability for Code Generation in LLMs
por: Bodla, Krishna Vamshi, et al.
Publicado: (2025)
por: Bodla, Krishna Vamshi, et al.
Publicado: (2025)
Vulnerability Detection with Code Language Models: How Far Are We?
por: Ding, Yangruibo, et al.
Publicado: (2024)
por: Ding, Yangruibo, et al.
Publicado: (2024)
FaultLine: Automated Proof-of-Vulnerability Generation Using LLM Agents
por: Nitin, Vikram, et al.
Publicado: (2025)
por: Nitin, Vikram, et al.
Publicado: (2025)
TerraFormer: Automated Infrastructure-as-Code with LLMs Fine-Tuned via Policy-Guided Verifier Feedback
por: Jana, Prithwish, et al.
Publicado: (2026)
por: Jana, Prithwish, et al.
Publicado: (2026)
Unveiling Code Pre-Trained Models: Investigating Syntax and Semantics Capacities
por: Ma, Wei, et al.
Publicado: (2022)
por: Ma, Wei, et al.
Publicado: (2022)
CodeCoT: Tackling Code Syntax Errors in CoT Reasoning for Code Generation
por: Huang, Dong, et al.
Publicado: (2023)
por: Huang, Dong, et al.
Publicado: (2023)
ScarfBench: A Benchmark for Cross-Framework Application Migration in Enterprise Java
por: Pavuluri, Advait, et al.
Publicado: (2026)
por: Pavuluri, Advait, et al.
Publicado: (2026)
EffiBench: Benchmarking the Efficiency of Automatically Generated Code
por: Huang, Dong, et al.
Publicado: (2024)
por: Huang, Dong, et al.
Publicado: (2024)
Trustworthy AI Software Engineers
por: Aleti, Aldeida, et al.
Publicado: (2026)
por: Aleti, Aldeida, et al.
Publicado: (2026)
Red Teaming Program Repair Agents: When Correct Patches can Hide Vulnerabilities
por: Chen, Simin, et al.
Publicado: (2025)
por: Chen, Simin, et al.
Publicado: (2025)
Ejemplares similares
-
LibEvolutionEval: A Benchmark and Study for Version-Specific Code Generation
por: Kuhar, Sachit, et al.
Publicado: (2024) -
Code-Aware Prompting: A study of Coverage Guided Test Generation in Regression Setting using LLM
por: Ryan, Gabriel, et al.
Publicado: (2024) -
Structural Code Search using Natural Language Queries
por: Limpanukorn, Ben, et al.
Publicado: (2025) -
LeDex: Training LLMs to Better Self-Debug and Explain Code
por: Jiang, Nan, et al.
Publicado: (2024) -
CodeAssistBench (CAB): Dataset & Benchmarking for Multi-turn Chat-Based Code Assistance
por: Kim, Myeongsoo, et al.
Publicado: (2025)