Assessing Code Understanding in LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Laneve, Cosimo, Spanò, Alvise, Ressi, Dalila, Rossi, Sabina, Bugliesi, Michele |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Reentrancy Detection in the Age of LLMs
par: Ressi, Dalila, et autres
Publié: (2026)
par: Ressi, Dalila, et autres
Publié: (2026)
ECO: Enhanced Code Optimization via Performance-Aware Prompting for Code-LLMs
par: Kim, Su-Hyeon, et autres
Publié: (2025)
par: Kim, Su-Hyeon, et autres
Publié: (2025)
Assessing GPT-4-Vision's Capabilities in UML-Based Code Generation
par: Antal, Gábor, et autres
Publié: (2024)
par: Antal, Gábor, et autres
Publié: (2024)
Smaller = Weaker? Benchmarking Robustness of Quantized LLMs in Code Generation
par: Fang, Sen, et autres
Publié: (2025)
par: Fang, Sen, et autres
Publié: (2025)
AutoCode: LLMs as Problem Setters for Competitive Programming
par: Zhou, Shang, et autres
Publié: (2025)
par: Zhou, Shang, et autres
Publié: (2025)
Code Repair with LLMs gives an Exploration-Exploitation Tradeoff
par: Tang, Hao, et autres
Publié: (2024)
par: Tang, Hao, et autres
Publié: (2024)
Agentic Code Reasoning
par: Ugare, Shubham, et autres
Publié: (2026)
par: Ugare, Shubham, et autres
Publié: (2026)
Beyond Code Pairs: Dialogue-Based Data Generation for LLM Code Translation
par: Chen, Le, et autres
Publié: (2025)
par: Chen, Le, et autres
Publié: (2025)
REINFOREST: Reinforcing Semantic Code Similarity for Cross-Lingual Code Search Models
par: Saieva, Anthony, et autres
Publié: (2023)
par: Saieva, Anthony, et autres
Publié: (2023)
Assessing the Interpretability of Programmatic Policies with Large Language Models
par: Bashir, Zahra, et autres
Publié: (2023)
par: Bashir, Zahra, et autres
Publié: (2023)
Is Functional Correctness Enough to Evaluate Code Language Models? Exploring Diversity of Generated Codes
par: Chon, Heejae, et autres
Publié: (2024)
par: Chon, Heejae, et autres
Publié: (2024)
CodeIF-Bench: Evaluating Instruction-Following Capabilities of Large Language Models in Interactive Code Generation
par: Wang, Peiding, et autres
Publié: (2025)
par: Wang, Peiding, et autres
Publié: (2025)
Do Large Code Models Understand Programming Concepts? Counterfactual Analysis for Code Predicates
par: Hooda, Ashish, et autres
Publié: (2024)
par: Hooda, Ashish, et autres
Publié: (2024)
A Preliminary Study of Multilingual Code Language Models for Code Generation Task Using Translated Benchmarks
par: Dandamudi, Rohit, et autres
Publié: (2024)
par: Dandamudi, Rohit, et autres
Publié: (2024)
Dynamic Stability of LLM-Generated Code
par: Rajput, Prateek, et autres
Publié: (2025)
par: Rajput, Prateek, et autres
Publié: (2025)
AI-Mediated Code Comment Improvement
par: Dhakal, Maria, et autres
Publié: (2025)
par: Dhakal, Maria, et autres
Publié: (2025)
Can LLMs Reason About Program Semantics? A Comprehensive Evaluation of LLMs on Formal Specification Inference
par: Le-Cong, Thanh, et autres
Publié: (2025)
par: Le-Cong, Thanh, et autres
Publié: (2025)
Effective LLM-Driven Code Generation with Pythoness
par: Levin, Kyla H., et autres
Publié: (2025)
par: Levin, Kyla H., et autres
Publié: (2025)
Can LLMs Enable Verification in Mainstream Programming?
par: Shefer, Aleksandr, et autres
Publié: (2025)
par: Shefer, Aleksandr, et autres
Publié: (2025)
AInsteinBench: Benchmarking Coding Agents on Scientific Repositories
par: Duston, Titouan, et autres
Publié: (2025)
par: Duston, Titouan, et autres
Publié: (2025)
AI-Assisted Fixes to Code Review Comments at Scale
par: Maddila, Chandra, et autres
Publié: (2025)
par: Maddila, Chandra, et autres
Publié: (2025)
Insights from the Usage of the Ansible Lightspeed Code Completion Service
par: Sahoo, Priyam, et autres
Publié: (2024)
par: Sahoo, Priyam, et autres
Publié: (2024)
A Problem-Oriented Perspective and Anchor Verification for Code Optimization
par: Ye, Tong, et autres
Publié: (2024)
par: Ye, Tong, et autres
Publié: (2024)
Raw Pointer Rewriting with LLMs for Translating C to Safer Rust
par: Gao, Yifei, et autres
Publié: (2025)
par: Gao, Yifei, et autres
Publié: (2025)
The New Compiler Stack: A Survey on the Synergy of LLMs and Compilers
par: Zhang, Shuoming, et autres
Publié: (2026)
par: Zhang, Shuoming, et autres
Publié: (2026)
Hydra: Efficient, Correct Code Generation via Checkpoint-and-Rollback Support
par: Du, Alexander, et autres
Publié: (2026)
par: Du, Alexander, et autres
Publié: (2026)
Executing as You Generate: Hiding Execution Latency in LLM Code Generation
par: Sun, Zhensu, et autres
Publié: (2026)
par: Sun, Zhensu, et autres
Publié: (2026)
Self-Improving Code Generation via Semantic Entropy and Behavioral Consensus
par: Zhang, Huan, et autres
Publié: (2026)
par: Zhang, Huan, et autres
Publié: (2026)
CodeMind: Evaluating Large Language Models for Code Reasoning
par: Liu, Changshu, et autres
Publié: (2024)
par: Liu, Changshu, et autres
Publié: (2024)
From Code Generation to Software Testing: AI Copilot with Context-Based RAG
par: Wang, Yuchen, et autres
Publié: (2025)
par: Wang, Yuchen, et autres
Publié: (2025)
AutoMCQ -- Automatically Generate Code Comprehension Questions using GenAI
par: Goodfellow, Martin, et autres
Publié: (2025)
par: Goodfellow, Martin, et autres
Publié: (2025)
Structured Program Synthesis using LLMs: Results and Insights from the IPARC Challenge
par: Surana, Shraddha, et autres
Publié: (2025)
par: Surana, Shraddha, et autres
Publié: (2025)
Leveraging LLMs to support co-evolution between definitions and instances of textual DSLs
par: Zhang, Weixing, et autres
Publié: (2025)
par: Zhang, Weixing, et autres
Publié: (2025)
Reverse Chain: A Generic-Rule for LLMs to Master Multi-API Planning
par: Zhang, Yinger, et autres
Publié: (2023)
par: Zhang, Yinger, et autres
Publié: (2023)
Analysis of AdvFusion: Adapter-based Multilingual Learning for Code Large Language Models
par: Esmaeili, Amirreza, et autres
Publié: (2025)
par: Esmaeili, Amirreza, et autres
Publié: (2025)
Learning to Guarantee Type Correctness in Code Generation through Type-Guided Program Synthesis
par: Huang, Zhechong, et autres
Publié: (2025)
par: Huang, Zhechong, et autres
Publié: (2025)
LecPrompt: A Prompt-based Approach for Logical Error Correction with CodeBERT
par: Xu, Zhenyu, et autres
Publié: (2024)
par: Xu, Zhenyu, et autres
Publié: (2024)
Steerable Instruction Following Coding Data Synthesis with Actor-Parametric Schema Co-Evolution
par: Huang, Tinglin, et autres
Publié: (2026)
par: Huang, Tinglin, et autres
Publié: (2026)
PerfCodeGen: Improving Performance of LLM Generated Code with Execution Feedback
par: Peng, Yun, et autres
Publié: (2024)
par: Peng, Yun, et autres
Publié: (2024)
Code Broker: A Multi-Agent System for Automated Code Quality Assessment
par: Attrah, Samer
Publié: (2026)
par: Attrah, Samer
Publié: (2026)
Documents similaires
-
Reentrancy Detection in the Age of LLMs
par: Ressi, Dalila, et autres
Publié: (2026) -
ECO: Enhanced Code Optimization via Performance-Aware Prompting for Code-LLMs
par: Kim, Su-Hyeon, et autres
Publié: (2025) -
Assessing GPT-4-Vision's Capabilities in UML-Based Code Generation
par: Antal, Gábor, et autres
Publié: (2024) -
Smaller = Weaker? Benchmarking Robustness of Quantized LLMs in Code Generation
par: Fang, Sen, et autres
Publié: (2025) -
AutoCode: LLMs as Problem Setters for Competitive Programming
par: Zhou, Shang, et autres
Publié: (2025)