Task Abstention for Large Language Models in Code Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhou, Yanke, Tan, Yuhao, Xu, Senrong, Li, Zenan, Yao, Yuan, Chen, Taolue, Ma, Xiaoxing |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Uncertainty Quantification for LLM-based Code Generation
par: Xu, Senrong, et autres
Publié: (2026)
par: Xu, Senrong, et autres
Publié: (2026)
Less is More: Towards Green Code Large Language Models via Unified Structural Pruning
par: Yang, Guang, et autres
Publié: (2024)
par: Yang, Guang, et autres
Publié: (2024)
GeoCode-GPT: A Large Language Model for Geospatial Code Generation Tasks
par: Hou, Shuyang, et autres
Publié: (2024)
par: Hou, Shuyang, et autres
Publié: (2024)
Synthesizing Inductive Invariants for Distributed Protocols via IC3 and Large Language Models
par: Cao, Weining, et autres
Publié: (2026)
par: Cao, Weining, et autres
Publié: (2026)
TaskEval: Assessing Difficulty of Code Generation Tasks for Large Language Models
par: Tambon, Florian, et autres
Publié: (2024)
par: Tambon, Florian, et autres
Publié: (2024)
Personality-Guided Code Generation Using Large Language Models
par: Guo, Yaoqi, et autres
Publié: (2024)
par: Guo, Yaoqi, et autres
Publié: (2024)
CODE-DITING: A Reasoning-Based Metric for Functional Alignment in Code Evaluation
par: Yang, Guang, et autres
Publié: (2025)
par: Yang, Guang, et autres
Publié: (2025)
Large Language Model Guided Self-Debugging Code Generation
par: Adnan, Muntasir, et autres
Publié: (2025)
par: Adnan, Muntasir, et autres
Publié: (2025)
ModiGen: A Large Language Model-Based Workflow for Multi-Task Modelica Code Generation
par: Xiang, Jiahui, et autres
Publié: (2025)
par: Xiang, Jiahui, et autres
Publié: (2025)
Large Language Models as Test Case Generators: Performance Evaluation and Enhancement
par: Li, Kefan, et autres
Publié: (2024)
par: Li, Kefan, et autres
Publié: (2024)
Flow2Code: Evaluating Large Language Models for Flowchart-based Code Generation Capability
par: He, Mengliang, et autres
Publié: (2025)
par: He, Mengliang, et autres
Publié: (2025)
A Deep Dive Into Large Language Model Code Generation Mistakes: What and Why?
par: Chen, QiHong, et autres
Publié: (2024)
par: Chen, QiHong, et autres
Publié: (2024)
A Tertiary Review of Large Language Model-Based Code Generating Tasks: Trends, Challenges, and Future Directions
par: Chochlov, Muslim, et autres
Publié: (2026)
par: Chochlov, Muslim, et autres
Publié: (2026)
Beyond Autoregression: An Empirical Study of Diffusion Large Language Models for Code Generation
par: Li, Chengze, et autres
Publié: (2025)
par: Li, Chengze, et autres
Publié: (2025)
CodeFort: Robust Training for Code Generation Models
par: Zhang, Yuhao, et autres
Publié: (2024)
par: Zhang, Yuhao, et autres
Publié: (2024)
CrossPL: Evaluating Large Language Models on Cross Programming Language Code Generation
par: Xiong, Zhanhang, et autres
Publié: (2025)
par: Xiong, Zhanhang, et autres
Publié: (2025)
Enhancing High-Quality Code Generation in Large Language Models with Comparative Prefix-Tuning
par: Jiang, Yuan, et autres
Publié: (2025)
par: Jiang, Yuan, et autres
Publié: (2025)
Code Red! On the Harmfulness of Applying Off-the-shelf Large Language Models to Programming Tasks
par: Al-Kaswan, Ali, et autres
Publié: (2025)
par: Al-Kaswan, Ali, et autres
Publié: (2025)
Towards Advancing Code Generation with Large Language Models: A Research Roadmap
par: Jin, Haolin, et autres
Publié: (2025)
par: Jin, Haolin, et autres
Publié: (2025)
CodeCoT: Tackling Code Syntax Errors in CoT Reasoning for Code Generation
par: Huang, Dong, et autres
Publié: (2023)
par: Huang, Dong, et autres
Publié: (2023)
Nova: Generative Language Models for Assembly Code with Hierarchical Attention and Contrastive Learning
par: Jiang, Nan, et autres
Publié: (2023)
par: Jiang, Nan, et autres
Publié: (2023)
Bugs in Large Language Models Generated Code: An Empirical Study
par: Tambon, Florian, et autres
Publié: (2024)
par: Tambon, Florian, et autres
Publié: (2024)
What Makes Code Generation Ethically Sourced?
par: Xu, Zhuolin, et autres
Publié: (2025)
par: Xu, Zhuolin, et autres
Publié: (2025)
RobuNFR: Evaluating the Robustness of Large Language Models on Non-Functional Requirements Aware Code Generation
par: Lin, Feng, et autres
Publié: (2025)
par: Lin, Feng, et autres
Publié: (2025)
Exploring and Unleashing the Power of Large Language Models in Automated Code Translation
par: Yang, Zhen, et autres
Publié: (2024)
par: Yang, Zhen, et autres
Publié: (2024)
AutoCoder: Enhancing Code Large Language Model with \textsc{AIEV-Instruct}
par: Lei, Bin, et autres
Publié: (2024)
par: Lei, Bin, et autres
Publié: (2024)
Output Format Biases in the Evaluation of Large Language Models for Code Translation
par: Macedo, Marcos, et autres
Publié: (2024)
par: Macedo, Marcos, et autres
Publié: (2024)
SOEN-101: Code Generation by Emulating Software Process Models Using Large Language Model Agents
par: Lin, Feng, et autres
Publié: (2024)
par: Lin, Feng, et autres
Publié: (2024)
Combining Large Language Models with Static Analyzers for Code Review Generation
par: Jaoua, Imen, et autres
Publié: (2025)
par: Jaoua, Imen, et autres
Publié: (2025)
A Comparative Analysis of Large Language Models for Code Documentation Generation
par: Dvivedi, Shubhang Shekhar, et autres
Publié: (2023)
par: Dvivedi, Shubhang Shekhar, et autres
Publié: (2023)
CRPE: Expanding The Reasoning Capability of Large Language Model for Code Generation
par: Gui, Ningxin, et autres
Publié: (2025)
par: Gui, Ningxin, et autres
Publié: (2025)
Model-Driven Quantum Code Generation Using Large Language Models and Retrieval-Augmented Generation
par: Siavash, Nazanin, et autres
Publié: (2025)
par: Siavash, Nazanin, et autres
Publié: (2025)
Beyond Functional Correctness: Investigating Coding Style Inconsistencies in Large Language Models
par: Wang, Yanlin, et autres
Publié: (2024)
par: Wang, Yanlin, et autres
Publié: (2024)
Beyond Output Correctness: Benchmarking and Evaluating Large Language Model Reasoning in Coding Tasks
par: Li, Yuangang, et autres
Publié: (2026)
par: Li, Yuangang, et autres
Publié: (2026)
CodeGolf Bench: A Multi-Language Benchmark for Evaluating Concise Code Generation Capabilities of Large Language Models
par: Padwal, Vedant
Publié: (2026)
par: Padwal, Vedant
Publié: (2026)
SimdBench: Benchmarking Large Language Models for SIMD-Intrinsic Code Generation
par: He, Yibo, et autres
Publié: (2025)
par: He, Yibo, et autres
Publié: (2025)
CoCo-Bench: A Comprehensive Code Benchmark For Multi-task Large Language Model Evaluation
par: Yin, Wenjing, et autres
Publié: (2025)
par: Yin, Wenjing, et autres
Publié: (2025)
RTLRewriter: Methodologies for Large Models aided RTL Code Optimization
par: Yao, Xufeng, et autres
Publié: (2024)
par: Yao, Xufeng, et autres
Publié: (2024)
Evaluating Large Language Models for Code Review
par: Cihan, Umut, et autres
Publié: (2025)
par: Cihan, Umut, et autres
Publié: (2025)
SWE-Compass: Towards Unified Evaluation of Agentic Coding Abilities for Large Language Models
par: Xu, Jingxuan, et autres
Publié: (2025)
par: Xu, Jingxuan, et autres
Publié: (2025)
Documents similaires
-
Uncertainty Quantification for LLM-based Code Generation
par: Xu, Senrong, et autres
Publié: (2026) -
Less is More: Towards Green Code Large Language Models via Unified Structural Pruning
par: Yang, Guang, et autres
Publié: (2024) -
GeoCode-GPT: A Large Language Model for Geospatial Code Generation Tasks
par: Hou, Shuyang, et autres
Publié: (2024) -
Synthesizing Inductive Invariants for Distributed Protocols via IC3 and Large Language Models
par: Cao, Weining, et autres
Publié: (2026) -
TaskEval: Assessing Difficulty of Code Generation Tasks for Large Language Models
par: Tambon, Florian, et autres
Publié: (2024)