On the Effectiveness of LLM-as-a-judge for Code Generation and Summarization
Fuente:
arXiv
Salvato in:
| Autori principali: | Crupi, Giuseppe, Tufano, Rosalia, Velasco, Alejandro, Mastropaolo, Antonio, Poshyvanyk, Denys, Bavota, Gabriele |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Improving Code Generation via Small Language Model-as-a-judge
di: Crupi, Giuseppe, et al.
Pubblicazione: (2026)
di: Crupi, Giuseppe, et al.
Pubblicazione: (2026)
Studying Quality Improvements Recommended via Manual and Automated Code Review
di: Crupi, Giuseppe, et al.
Pubblicazione: (2026)
di: Crupi, Giuseppe, et al.
Pubblicazione: (2026)
On the Generalizability of Transformer Models to Code Completions of Different Lengths
di: Cooper, Nathan, et al.
Pubblicazione: (2025)
di: Cooper, Nathan, et al.
Pubblicazione: (2025)
Towards Summarizing Code Snippets Using Pre-Trained Transformers
di: Mastropaolo, Antonio, et al.
Pubblicazione: (2024)
di: Mastropaolo, Antonio, et al.
Pubblicazione: (2024)
Automating Code Review: A Systematic Literature Review
di: Tufano, Rosalia, et al.
Pubblicazione: (2025)
di: Tufano, Rosalia, et al.
Pubblicazione: (2025)
Code Review Automation: Strengths and Weaknesses of the State of the Art
di: Tufano, Rosalia, et al.
Pubblicazione: (2024)
di: Tufano, Rosalia, et al.
Pubblicazione: (2024)
SEART Data Hub: Streamlining Large-Scale Source Code Mining and Pre-Processing
di: Dabić, Ozren, et al.
Pubblicazione: (2024)
di: Dabić, Ozren, et al.
Pubblicazione: (2024)
A Path Less Traveled: Reimagining Software Engineering Automation via a Neurosymbolic Paradigm
di: Mastropaolo, Antonio, et al.
Pubblicazione: (2025)
di: Mastropaolo, Antonio, et al.
Pubblicazione: (2025)
Unveiling ChatGPT's Usage in Open Source Projects: A Mining-based Study
di: Tufano, Rosalia, et al.
Pubblicazione: (2024)
di: Tufano, Rosalia, et al.
Pubblicazione: (2024)
Developers and Generative AI: A Study of Self-Admitted Usage in Open Source Projects
di: Tufano, Rosalia, et al.
Pubblicazione: (2026)
di: Tufano, Rosalia, et al.
Pubblicazione: (2026)
Quality In, Quality Out: Investigating Training Data's Role in AI Code Generation
di: Improta, Cristina, et al.
Pubblicazione: (2025)
di: Improta, Cristina, et al.
Pubblicazione: (2025)
Leveraging Reward Models for Guiding Code Review Comment Generation
di: Sghaier, Oussama Ben, et al.
Pubblicazione: (2025)
di: Sghaier, Oussama Ben, et al.
Pubblicazione: (2025)
Guidelines to Prompt Large Language Models for Code Generation: An Empirical Characterization
di: Midolo, Alessandro, et al.
Pubblicazione: (2026)
di: Midolo, Alessandro, et al.
Pubblicazione: (2026)
Toward Neurosymbolic Program Comprehension
di: Velasco, Alejandro, et al.
Pubblicazione: (2025)
di: Velasco, Alejandro, et al.
Pubblicazione: (2025)
Evaluating the Impact of Post-Training Quantization on Large Language Models for Code Generation
di: Giagnorio, Alessandro, et al.
Pubblicazione: (2025)
di: Giagnorio, Alessandro, et al.
Pubblicazione: (2025)
Enabling Global, Human-Centered Explanations for LLMs:From Tokens to Interpretable Code and Test Generation
di: Khati, Dipin, et al.
Pubblicazione: (2025)
di: Khati, Dipin, et al.
Pubblicazione: (2025)
Deep Learning-based Code Reviews: A Paradigm Shift or a Double-Edged Sword?
di: Tufano, Rosalia, et al.
Pubblicazione: (2024)
di: Tufano, Rosalia, et al.
Pubblicazione: (2024)
Resource-Efficient & Effective Code Summarization
di: Afrin, Saima, et al.
Pubblicazione: (2025)
di: Afrin, Saima, et al.
Pubblicazione: (2025)
How the Training Procedure Impacts the Performance of Deep Learning-based Vulnerability Patching
di: Mastropaolo, Antonio, et al.
Pubblicazione: (2024)
di: Mastropaolo, Antonio, et al.
Pubblicazione: (2024)
A Causal Perspective on Measuring, Explaining and Mitigating Smells in LLM-Generated Code
di: Velasco, Alejandro, et al.
Pubblicazione: (2025)
di: Velasco, Alejandro, et al.
Pubblicazione: (2025)
Which Syntactic Capabilities Are Statistically Learned by Masked Language Models for Code?
di: Velasco, Alejandro, et al.
Pubblicazione: (2024)
di: Velasco, Alejandro, et al.
Pubblicazione: (2024)
SnipGen: A Mining Repository Framework for Evaluating LLMs for Code
di: Rodriguez-Cardenas, Daniel, et al.
Pubblicazione: (2025)
di: Rodriguez-Cardenas, Daniel, et al.
Pubblicazione: (2025)
A Taxonomy of Self-Admitted Technical Debt in Deep Learning Systems
di: Pepe, Federica, et al.
Pubblicazione: (2024)
di: Pepe, Federica, et al.
Pubblicazione: (2024)
Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?
di: Vitale, Antonio, et al.
Pubblicazione: (2025)
di: Vitale, Antonio, et al.
Pubblicazione: (2025)
Prompt-Driven Code Summarization: A Systematic Literature Review
di: Farjana, Afia, et al.
Pubblicazione: (2026)
di: Farjana, Afia, et al.
Pubblicazione: (2026)
Detecting and Correcting Hallucinations in LLM-Generated Code via Deterministic AST Analysis
di: Khati, Dipin, et al.
Pubblicazione: (2026)
di: Khati, Dipin, et al.
Pubblicazione: (2026)
Enhancing Code Generation for Low-Resource Languages: No Silver Bullet
di: Giagnorio, Alessandro, et al.
Pubblicazione: (2025)
di: Giagnorio, Alessandro, et al.
Pubblicazione: (2025)
An Empirical Study on the Effects of System Prompts in Instruction-Tuned Models for Code Generation
di: Cheng, Zaiyu, et al.
Pubblicazione: (2026)
di: Cheng, Zaiyu, et al.
Pubblicazione: (2026)
Understanding Privacy Risks in Code Models Through Training Dynamics: A Causal Approach
di: Yang, Hua, et al.
Pubblicazione: (2025)
di: Yang, Hua, et al.
Pubblicazione: (2025)
Towards More Trustworthy Deep Code Models by Enabling Out-of-Distribution Detection
di: Yan, Yanfu, et al.
Pubblicazione: (2025)
di: Yan, Yanfu, et al.
Pubblicazione: (2025)
Deep Learning-based Code Completion: On the Impact on Performance of Contextual Information
di: Ciniselli, Matteo, et al.
Pubblicazione: (2025)
di: Ciniselli, Matteo, et al.
Pubblicazione: (2025)
Toward Explaining Large Language Models in Software Engineering Tasks
di: Vitale, Antonio, et al.
Pubblicazione: (2025)
di: Vitale, Antonio, et al.
Pubblicazione: (2025)
How Propense Are Large Language Models at Producing Code Smells? A Benchmarking Study
di: Velasco, Alejandro, et al.
Pubblicazione: (2024)
di: Velasco, Alejandro, et al.
Pubblicazione: (2024)
Rethinking Software Empirical Studies with Structural Causal Models
di: Rodriguez-Cardenas, Daniel, et al.
Pubblicazione: (2026)
di: Rodriguez-Cardenas, Daniel, et al.
Pubblicazione: (2026)
Not All Tokens Matter: Data-Centric Optimization for Efficient Code Summarization
di: Afrin, Saima, et al.
Pubblicazione: (2026)
di: Afrin, Saima, et al.
Pubblicazione: (2026)
Why Personalizing Deep Learning-Based Code Completion Tools Matters
di: Giagnorio, Alessandro, et al.
Pubblicazione: (2025)
di: Giagnorio, Alessandro, et al.
Pubblicazione: (2025)
On the Generalizability of Deep Learning-based Code Completion Across Programming Language Versions
di: Ciniselli, Matteo, et al.
Pubblicazione: (2024)
di: Ciniselli, Matteo, et al.
Pubblicazione: (2024)
Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?
di: O'Brien, Conor, et al.
Pubblicazione: (2024)
di: O'Brien, Conor, et al.
Pubblicazione: (2024)
How Do Semantically Equivalent Code Transformations Impact Membership Inference on LLMs for Code?
di: Yang, Hua, et al.
Pubblicazione: (2025)
di: Yang, Hua, et al.
Pubblicazione: (2025)
Toward a Theory of Causation for Interpreting Neural Code Models
di: Palacio, David N., et al.
Pubblicazione: (2023)
di: Palacio, David N., et al.
Pubblicazione: (2023)
Documenti analoghi
-
Improving Code Generation via Small Language Model-as-a-judge
di: Crupi, Giuseppe, et al.
Pubblicazione: (2026) -
Studying Quality Improvements Recommended via Manual and Automated Code Review
di: Crupi, Giuseppe, et al.
Pubblicazione: (2026) -
On the Generalizability of Transformer Models to Code Completions of Different Lengths
di: Cooper, Nathan, et al.
Pubblicazione: (2025) -
Towards Summarizing Code Snippets Using Pre-Trained Transformers
di: Mastropaolo, Antonio, et al.
Pubblicazione: (2024) -
Automating Code Review: A Systematic Literature Review
di: Tufano, Rosalia, et al.
Pubblicazione: (2025)