Fine-grained Approaches for Confidence Calibration of LLMs in Automated Code Revision
Fuente:
arXiv
Saved in:
| Main Authors: | Lin, Hong Yi, Liu, Chunhua, Gao, Haoyu, Thongtanunam, Patanamon, Treude, Christoph |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Hallucinations in Code Change to Natural Language Generation: Prevalence and Evaluation of Detection Metrics
by: Liu, Chunhua, et al.
Published: (2025)
by: Liu, Chunhua, et al.
Published: (2025)
Enhancing Neural Code Representation with Additional Context
by: Nguyen, Huy, et al.
Published: (2025)
by: Nguyen, Huy, et al.
Published: (2025)
Exploring the Potential of Large Language Models in Fine-Grained Review Comment Classification
by: Nguyen, Linh, et al.
Published: (2025)
by: Nguyen, Linh, et al.
Published: (2025)
CodeReviewQA: The Code Review Comprehension Assessment for Large Language Models
by: Lin, Hong Yi, et al.
Published: (2025)
by: Lin, Hong Yi, et al.
Published: (2025)
Improving Automated Code Reviews: Learning from Experience
by: Lin, Hong Yi, et al.
Published: (2024)
by: Lin, Hong Yi, et al.
Published: (2024)
Too Noisy To Learn: Enhancing Data Quality for Code Review Comment Generation
by: Liu, Chunhua, et al.
Published: (2025)
by: Liu, Chunhua, et al.
Published: (2025)
Encoding Version History Context for Better Code Representation
by: Nguyen, Huy, et al.
Published: (2024)
by: Nguyen, Huy, et al.
Published: (2024)
HalluJudge: A Reference-Free Hallucination Detection for Context Misalignment in Code Review Automation
by: Tantithamthavorn, Kla, et al.
Published: (2026)
by: Tantithamthavorn, Kla, et al.
Published: (2026)
Leveraging Reviewer Experience in Code Review Comment Generation
by: Lin, Hong Yi, et al.
Published: (2024)
by: Lin, Hong Yi, et al.
Published: (2024)
When AI Models Become Dependencies: Studying the Evolution of Pre-Trained Model Reuse in Downstream Software Systems
by: Banyongrakkul, Peerachai, et al.
Published: (2026)
by: Banyongrakkul, Peerachai, et al.
Published: (2026)
From Release to Adoption: Challenges in Reusing Pre-trained AI Models for Downstream Developers
by: Banyongrakkul, Peerachai, et al.
Published: (2025)
by: Banyongrakkul, Peerachai, et al.
Published: (2025)
Toward Effective Secure Code Reviews: An Empirical Study of Security-Related Coding Weaknesses
by: Charoenwet, Wachiraphan, et al.
Published: (2023)
by: Charoenwet, Wachiraphan, et al.
Published: (2023)
Enhancing Code Review through Fuzzing and Likely Invariants
by: Charoenwet, Wachiraphan, et al.
Published: (2025)
by: Charoenwet, Wachiraphan, et al.
Published: (2025)
An Empirical Study of Static Analysis Tools for Secure Code Review
by: Charoenwet, Wachiraphan, et al.
Published: (2024)
by: Charoenwet, Wachiraphan, et al.
Published: (2024)
AI-Assisted Code Review as a Scaffold for Code Quality and Self-Regulated Learning: An Experience Report
by: Oliveira, Eduardo, et al.
Published: (2026)
by: Oliveira, Eduardo, et al.
Published: (2026)
AgenticSCR: An Autonomous Agentic Secure Code Review for Immature Vulnerabilities Detection
by: Charoenwet, Wachiraphan, et al.
Published: (2026)
by: Charoenwet, Wachiraphan, et al.
Published: (2026)
Code Ownership: The Principles, Differences, and Their Associations with Software Quality
by: Thongtanunam, Patanamon, et al.
Published: (2024)
by: Thongtanunam, Patanamon, et al.
Published: (2024)
Should Code Models Learn Pedagogically? A Preliminary Evaluation of Curriculum Learning for Real-World Software Engineering Tasks
by: Khant, Kyi Shin, et al.
Published: (2025)
by: Khant, Kyi Shin, et al.
Published: (2025)
Accountable Agents in Software Engineering: An Analysis of Terms of Service and a Research Roadmap
by: Treude, Christoph
Published: (2026)
by: Treude, Christoph
Published: (2026)
A Systematic Literature Review on Reasons and Approaches for Accurate Effort Estimations in Agile
by: Pasuksmit, Jirat, et al.
Published: (2024)
by: Pasuksmit, Jirat, et al.
Published: (2024)
Automatic Programming: Large Language Models and Beyond
by: Lyu, Michael R., et al.
Published: (2024)
by: Lyu, Michael R., et al.
Published: (2024)
Walking the Tightrope of LLMs for Software Development: A Practitioners' Perspective
by: Ferino, Samuel, et al.
Published: (2025)
by: Ferino, Samuel, et al.
Published: (2025)
Novice Developers' Perspectives on Adopting LLMs for Software Development: A Systematic Literature Review
by: Ferino, Samuel, et al.
Published: (2025)
by: Ferino, Samuel, et al.
Published: (2025)
Effective Code Membership Inference for Code Completion Models via Adversarial Prompts
by: Jiang, Yuan, et al.
Published: (2025)
by: Jiang, Yuan, et al.
Published: (2025)
Automatically Recommend Code Updates: Are We There Yet?
by: Liu, Yue, et al.
Published: (2022)
by: Liu, Yue, et al.
Published: (2022)
Schedule-and-Calibrate: Utility-Guided Multi-Task Reinforcement Learning for Code LLMs
by: Chen, Yujia, et al.
Published: (2026)
by: Chen, Yujia, et al.
Published: (2026)
Benchmarking LLMs for Fine-Grained Code Review with Enriched Context in Practice
by: Hu, Ruida, et al.
Published: (2025)
by: Hu, Ruida, et al.
Published: (2025)
Generative AI and Empirical Software Engineering: A Paradigm Shift
by: Treude, Christoph, et al.
Published: (2025)
by: Treude, Christoph, et al.
Published: (2025)
Open Source Software Development Tool Installation: Challenges and Strategies For Novice Developers
by: Salerno, Larissa, et al.
Published: (2024)
by: Salerno, Larissa, et al.
Published: (2024)
Open the Oyster: Empirical Evaluation and Improvement of Code Reasoning Confidence in LLMs
by: Wang, Shufan, et al.
Published: (2025)
by: Wang, Shufan, et al.
Published: (2025)
Adaptive Confidence Gating in Multi-Agent Collaboration for Efficient and Optimized Code Generation
by: Zhang, Haoji, et al.
Published: (2026)
by: Zhang, Haoji, et al.
Published: (2026)
Enhancing High-Quality Code Generation in Large Language Models with Comparative Prefix-Tuning
by: Jiang, Yuan, et al.
Published: (2025)
by: Jiang, Yuan, et al.
Published: (2025)
RedCoder: Automated Multi-Turn Red Teaming for Code LLMs
by: Mo, Wenjie Jacky, et al.
Published: (2025)
by: Mo, Wenjie Jacky, et al.
Published: (2025)
Integrating Symbolic Execution into the Fine-Tuning of Code-Generating LLMs
by: Sakharova, Marina, et al.
Published: (2025)
by: Sakharova, Marina, et al.
Published: (2025)
Free and Customizable Code Documentation with LLMs: A Fine-Tuning Approach
by: Chakrabarty, Sayak, et al.
Published: (2024)
by: Chakrabarty, Sayak, et al.
Published: (2024)
Automated Customization of LLMs for Enterprise Code Repositories Using Semantic Scopes
by: Finkler, Ulrich, et al.
Published: (2026)
by: Finkler, Ulrich, et al.
Published: (2026)
LogReasoner: Empowering LLMs with Expert-like Coarse-to-Fine Reasoning for Automated Log Analysis
by: Ma, Lipeng, et al.
Published: (2025)
by: Ma, Lipeng, et al.
Published: (2025)
MarsCode Agent: AI-native Automated Bug Fixing
by: Liu, Yizhou, et al.
Published: (2024)
by: Liu, Yizhou, et al.
Published: (2024)
AutoAssert 1: A LoRA Fine-Tuned LLM Model for Efficient Automated Assertion Generation
by: Zhong, Yi, et al.
Published: (2025)
by: Zhong, Yi, et al.
Published: (2025)
Issue-Oriented Agent-Based Framework for Automated Review Comment Generation
by: Li, Shuochuan, et al.
Published: (2025)
by: Li, Shuochuan, et al.
Published: (2025)
Similar Items
-
Hallucinations in Code Change to Natural Language Generation: Prevalence and Evaluation of Detection Metrics
by: Liu, Chunhua, et al.
Published: (2025) -
Enhancing Neural Code Representation with Additional Context
by: Nguyen, Huy, et al.
Published: (2025) -
Exploring the Potential of Large Language Models in Fine-Grained Review Comment Classification
by: Nguyen, Linh, et al.
Published: (2025) -
CodeReviewQA: The Code Review Comprehension Assessment for Large Language Models
by: Lin, Hong Yi, et al.
Published: (2025) -
Improving Automated Code Reviews: Learning from Experience
by: Lin, Hong Yi, et al.
Published: (2024)