Calibration of Large Language Models on Code Summarization
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Virk, Yuvraj, Devanbu, Premkumar, Ahmed, Toufique |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Automatic Semantic Augmentation of Language Model Prompts (for Code Summarization)
von: Ahmed, Toufique, et al.
Veröffentlicht: (2023)
von: Ahmed, Toufique, et al.
Veröffentlicht: (2023)
CoDocBench: A Dataset for Code-Documentation Alignment in Software Maintenance
von: Pai, Kunal, et al.
Veröffentlicht: (2025)
von: Pai, Kunal, et al.
Veröffentlicht: (2025)
Towards Understanding What Code Language Models Learned
von: Ahmed, Toufique, et al.
Veröffentlicht: (2023)
von: Ahmed, Toufique, et al.
Veröffentlicht: (2023)
Can LLMs Replace Manual Annotation of Software Engineering Artifacts?
von: Ahmed, Toufique, et al.
Veröffentlicht: (2024)
von: Ahmed, Toufique, et al.
Veröffentlicht: (2024)
Studying LLM Performance on Closed- and Open-source Data
von: Ahmed, Toufique, et al.
Veröffentlicht: (2024)
von: Ahmed, Toufique, et al.
Veröffentlicht: (2024)
Ecosystem of Large Language Models for Code
von: Yang, Zhou, et al.
Veröffentlicht: (2024)
von: Yang, Zhou, et al.
Veröffentlicht: (2024)
Trojans in Large Language Models of Code: A Critical Review through a Trigger-Based Taxonomy
von: Hussain, Aftab, et al.
Veröffentlicht: (2024)
von: Hussain, Aftab, et al.
Veröffentlicht: (2024)
Prompting and Fine-tuning Large Language Models for Automated Code Review Comment Generation
von: Haider, Md. Asif, et al.
Veröffentlicht: (2024)
von: Haider, Md. Asif, et al.
Veröffentlicht: (2024)
Calibration and Correctness of Language Models for Code
von: Spiess, Claudio, et al.
Veröffentlicht: (2024)
von: Spiess, Claudio, et al.
Veröffentlicht: (2024)
Robustness, Security, Privacy, Explainability, Efficiency, and Usability of Large Language Models for Code
von: Yang, Zhou, et al.
Veröffentlicht: (2024)
von: Yang, Zhou, et al.
Veröffentlicht: (2024)
Localized Calibrated Uncertainty in Code Language Models
von: Gros, David, et al.
Veröffentlicht: (2025)
von: Gros, David, et al.
Veröffentlicht: (2025)
Analyzing the Performance of Large Language Models on Code Summarization
von: Haldar, Rajarshi, et al.
Veröffentlicht: (2024)
von: Haldar, Rajarshi, et al.
Veröffentlicht: (2024)
A Survey of Trojans in Neural Models of Source Code: Taxonomy and Techniques
von: Hussain, Aftab, et al.
Veröffentlicht: (2023)
von: Hussain, Aftab, et al.
Veröffentlicht: (2023)
Mercury: A Code Efficiency Benchmark for Code Large Language Models
von: Du, Mingzhe, et al.
Veröffentlicht: (2024)
von: Du, Mingzhe, et al.
Veröffentlicht: (2024)
Bridging Code Graphs and Large Language Models for Better Code Understanding
von: Chen, Zeqi, et al.
Veröffentlicht: (2025)
von: Chen, Zeqi, et al.
Veröffentlicht: (2025)
CodeReviewQA: The Code Review Comprehension Assessment for Large Language Models
von: Lin, Hong Yi, et al.
Veröffentlicht: (2025)
von: Lin, Hong Yi, et al.
Veröffentlicht: (2025)
AutoCodeBench: Large Language Models are Automatic Code Benchmark Generators
von: Chou, Jason, et al.
Veröffentlicht: (2025)
von: Chou, Jason, et al.
Veröffentlicht: (2025)
RepairAgent: An Autonomous, LLM-Based Agent for Program Repair
von: Bouzenia, Islem, et al.
Veröffentlicht: (2024)
von: Bouzenia, Islem, et al.
Veröffentlicht: (2024)
TDD-Bench Verified: Can LLMs Generate Tests for Issues Before They Get Resolved?
von: Ahmed, Toufique, et al.
Veröffentlicht: (2024)
von: Ahmed, Toufique, et al.
Veröffentlicht: (2024)
CodeJudge-Eval: Can Large Language Models be Good Judges in Code Understanding?
von: Zhao, Yuwei, et al.
Veröffentlicht: (2024)
von: Zhao, Yuwei, et al.
Veröffentlicht: (2024)
Assertion-Aware Test Code Summarization with Large Language Models
von: Mollah, Anamul Haque, et al.
Veröffentlicht: (2025)
von: Mollah, Anamul Haque, et al.
Veröffentlicht: (2025)
Large Language Models for Code Summarization
von: Szalontai, Balázs, et al.
Veröffentlicht: (2024)
von: Szalontai, Balázs, et al.
Veröffentlicht: (2024)
Leveraging Print Debugging to Improve Code Generation in Large Language Models
von: Hu, Xueyu, et al.
Veröffentlicht: (2024)
von: Hu, Xueyu, et al.
Veröffentlicht: (2024)
A Survey of using Large Language Models for Generating Infrastructure as Code
von: Srivatsa, Kalahasti Ganesh, et al.
Veröffentlicht: (2024)
von: Srivatsa, Kalahasti Ganesh, et al.
Veröffentlicht: (2024)
Enhanced Automated Code Vulnerability Repair using Large Language Models
von: de-Fitero-Dominguez, David, et al.
Veröffentlicht: (2024)
von: de-Fitero-Dominguez, David, et al.
Veröffentlicht: (2024)
InstructCoder: Instruction Tuning Large Language Models for Code Editing
von: Li, Kaixin, et al.
Veröffentlicht: (2023)
von: Li, Kaixin, et al.
Veröffentlicht: (2023)
Is Your AI-Generated Code Really Safe? Evaluating Large Language Models on Secure Code Generation with CodeSecEval
von: Wang, Jiexin, et al.
Veröffentlicht: (2024)
von: Wang, Jiexin, et al.
Veröffentlicht: (2024)
What's Wrong with Your Code Generated by Large Language Models? An Extensive Study
von: Dou, Shihan, et al.
Veröffentlicht: (2024)
von: Dou, Shihan, et al.
Veröffentlicht: (2024)
ScaleBox: Enabling High-Fidelity and Scalable Code Verification for Large Language Models
von: Zheng, Jiasheng, et al.
Veröffentlicht: (2026)
von: Zheng, Jiasheng, et al.
Veröffentlicht: (2026)
Semantic Source Code Segmentation using Small and Large Language Models
von: Dahou, Abdelhalim, et al.
Veröffentlicht: (2025)
von: Dahou, Abdelhalim, et al.
Veröffentlicht: (2025)
CodeOCR: On the Effectiveness of Vision Language Models in Code Understanding
von: Shi, Yuling, et al.
Veröffentlicht: (2026)
von: Shi, Yuling, et al.
Veröffentlicht: (2026)
Novel Preprocessing Technique for Data Embedding in Engineering Code Generation Using Large Language Model
von: Lin, Yu-Chen, et al.
Veröffentlicht: (2023)
von: Lin, Yu-Chen, et al.
Veröffentlicht: (2023)
CodeJudge: Evaluating Code Generation with Large Language Models
von: Tong, Weixi, et al.
Veröffentlicht: (2024)
von: Tong, Weixi, et al.
Veröffentlicht: (2024)
CodeMirage: Hallucinations in Code Generated by Large Language Models
von: Agarwal, Vibhor, et al.
Veröffentlicht: (2024)
von: Agarwal, Vibhor, et al.
Veröffentlicht: (2024)
A Code Comprehension Benchmark for Large Language Models for Code
von: Havare, Jayant, et al.
Veröffentlicht: (2025)
von: Havare, Jayant, et al.
Veröffentlicht: (2025)
LongCodeZip: Compress Long Context for Code Language Models
von: Shi, Yuling, et al.
Veröffentlicht: (2025)
von: Shi, Yuling, et al.
Veröffentlicht: (2025)
R2C2-Coder: Enhancing and Benchmarking Real-world Repository-level Code Completion Abilities of Code Large Language Models
von: Deng, Ken, et al.
Veröffentlicht: (2024)
von: Deng, Ken, et al.
Veröffentlicht: (2024)
HumanEval Pro and MBPP Pro: Evaluating Large Language Models on Self-invoking Code Generation
von: Yu, Zhaojian, et al.
Veröffentlicht: (2024)
von: Yu, Zhaojian, et al.
Veröffentlicht: (2024)
EnStack: An Ensemble Stacking Framework of Large Language Models for Enhanced Vulnerability Detection in Source Code
von: Ridoy, Shahriyar Zaman, et al.
Veröffentlicht: (2024)
von: Ridoy, Shahriyar Zaman, et al.
Veröffentlicht: (2024)
Using Large Language Models for Student-Code Guided Test Case Generation in Computer Science Education
von: Kumar, Nischal Ashok, et al.
Veröffentlicht: (2024)
von: Kumar, Nischal Ashok, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Automatic Semantic Augmentation of Language Model Prompts (for Code Summarization)
von: Ahmed, Toufique, et al.
Veröffentlicht: (2023) -
CoDocBench: A Dataset for Code-Documentation Alignment in Software Maintenance
von: Pai, Kunal, et al.
Veröffentlicht: (2025) -
Towards Understanding What Code Language Models Learned
von: Ahmed, Toufique, et al.
Veröffentlicht: (2023) -
Can LLMs Replace Manual Annotation of Software Engineering Artifacts?
von: Ahmed, Toufique, et al.
Veröffentlicht: (2024) -
Studying LLM Performance on Closed- and Open-source Data
von: Ahmed, Toufique, et al.
Veröffentlicht: (2024)