Human-Aligned Code Readability Assessment with Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Ouédraogo, Wendkûuni C., Li, Yinghua, Dang, Xueqi, Borsukiewicz, Pawel, Zhou, Xin, Koyuncu, Anil, Klein, Jacques, Lo, David, Bissyandé, Tegawendé F. |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Rethinking Cognitive Complexity for Unit Tests: Toward a Readability-Aware Metric Grounded in Developer Perception
by: Ouédraogo, Wendkûuni C., et al.
Published: (2025)
by: Ouédraogo, Wendkûuni C., et al.
Published: (2025)
Beyond Surface Similarity: Evaluating LLM-Based Test Refactorings with Structural and Semantic Awareness
by: Ouédraogo, Wendkûuni C., et al.
Published: (2025)
by: Ouédraogo, Wendkûuni C., et al.
Published: (2025)
Test smells in LLM-Generated Unit Tests
by: Ouédraogo, Wendkûuni C., et al.
Published: (2024)
by: Ouédraogo, Wendkûuni C., et al.
Published: (2024)
Large-scale, Independent and Comprehensive study of the power of LLMs for test case generation
by: Ouédraogo, Wendkûuni C., et al.
Published: (2024)
by: Ouédraogo, Wendkûuni C., et al.
Published: (2024)
Enriching Automatic Test Case Generation by Extracting Relevant Test Inputs from Bug Reports
by: Ouédraogo, Wendkûuni C., et al.
Published: (2023)
by: Ouédraogo, Wendkûuni C., et al.
Published: (2023)
An Empirical Study of AI Techniques in Mobile Applications
by: Li, Yinghua, et al.
Published: (2022)
by: Li, Yinghua, et al.
Published: (2022)
Boosting Open-Source LLMs for Program Repair via Reasoning Transfer and LLM-Guided Reinforcement Learning
by: Tang, Xunzhu, et al.
Published: (2025)
by: Tang, Xunzhu, et al.
Published: (2025)
AndroLibZoo: A Reliable Dataset of Libraries Based on Software Dependency Analysis
by: Samhi, Jordan, et al.
Published: (2023)
by: Samhi, Jordan, et al.
Published: (2023)
Evaluating Large Language Models in detecting Secrets in Android Apps
by: Alecci, Marco, et al.
Published: (2025)
by: Alecci, Marco, et al.
Published: (2025)
Programming Language Confusion: When Code LLMs Can't Keep their Languages Straight
by: Moumoula, Micheline Bénédicte, et al.
Published: (2025)
by: Moumoula, Micheline Bénédicte, et al.
Published: (2025)
The Struggles of LLMs in Cross-lingual Code Clone Detection
by: Moumoula, Micheline Bénédicte, et al.
Published: (2024)
by: Moumoula, Micheline Bénédicte, et al.
Published: (2024)
Beyond Language Barriers: Multi-Agent Coordination for Multi-Language Code Generation
by: Moumoula, Micheline Bénédicte, et al.
Published: (2025)
by: Moumoula, Micheline Bénédicte, et al.
Published: (2025)
Reinforcement Learning-Guided Chain-of-Draft for Token-Efficient Code Generation
by: Tang, Xunzhu, et al.
Published: (2025)
by: Tang, Xunzhu, et al.
Published: (2025)
How Secure is Secure Code Generation? Adversarial Prompts Put LLM Defenses to the Test
by: Tessa, Melissa, et al.
Published: (2026)
by: Tessa, Melissa, et al.
Published: (2026)
Learned or Memorized ? Quantifying Memorization Advantage in Code LLMs
by: Euraste, Djiré Albérick, et al.
Published: (2026)
by: Euraste, Djiré Albérick, et al.
Published: (2026)
The Code Barrier: What LLMs Actually Understand?
by: Nikiema, Serge Lionel, et al.
Published: (2025)
by: Nikiema, Serge Lionel, et al.
Published: (2025)
Revisiting Code Similarity Evaluation with Abstract Syntax Tree Edit Distance
by: Song, Yewei, et al.
Published: (2024)
by: Song, Yewei, et al.
Published: (2024)
Measuring LLM Code Generation Stability via Structural Entropy
by: Song, Yewei, et al.
Published: (2025)
by: Song, Yewei, et al.
Published: (2025)
Software Security in Software-Defined Networking: A Systematic Literature Review
by: Diouf, Moustapha Awwalou, et al.
Published: (2025)
by: Diouf, Moustapha Awwalou, et al.
Published: (2025)
Call Graph Soundness in Android Static Analysis
by: Samhi, Jordan, et al.
Published: (2024)
by: Samhi, Jordan, et al.
Published: (2024)
CodeAgent: Autonomous Communicative Agents for Code Review
by: Tang, Xunzhu, et al.
Published: (2024)
by: Tang, Xunzhu, et al.
Published: (2024)
SIEVE: Towards Verifiable Certification for Code-datasets
by: Mbodji, Fatou Ndiaye, et al.
Published: (2025)
by: Mbodji, Fatou Ndiaye, et al.
Published: (2025)
Patch-CLIP: A Patch-Text Pre-Trained Model
by: Tang, Xunzhu, et al.
Published: (2023)
by: Tang, Xunzhu, et al.
Published: (2023)
MORepair: Teaching LLMs to Repair Code via Multi-Objective Fine-tuning
by: Yang, Boyang, et al.
Published: (2024)
by: Yang, Boyang, et al.
Published: (2024)
Unlocking LLM Repair Capabilities Through Cross-Language Translation and Multi-Agent Refinement
by: Luo, Wenqiang, et al.
Published: (2025)
by: Luo, Wenqiang, et al.
Published: (2025)
Correctness isnt Efficiency: Runtime Memory Divergence in LLM-Generated Code
by: Rajput, Prateek, et al.
Published: (2026)
by: Rajput, Prateek, et al.
Published: (2026)
Historian: Reducing Manual Validation in APR Benchmarking via Evidence-Based Assessment
by: Moslemi, Sahand, et al.
Published: (2026)
by: Moslemi, Sahand, et al.
Published: (2026)
ContractTrace: Retracing Smart Contract Versions for Security Analyses
by: Mbodji, Fatou Ndiaye, et al.
Published: (2024)
by: Mbodji, Fatou Ndiaye, et al.
Published: (2024)
In-Context Code-Text Learning for Bimodal Software Engineering
by: Tang, Xunzhu, et al.
Published: (2024)
by: Tang, Xunzhu, et al.
Published: (2024)
CREF: An LLM-based Conversational Software Repair Framework for Programming Tutors
by: Yang, Boyang, et al.
Published: (2024)
by: Yang, Boyang, et al.
Published: (2024)
Beyond Real Faces: Synthetic Datasets Can Achieve Reliable Recognition Performance without Privacy Compromise
by: Borsukiewicz, Paweł, et al.
Published: (2025)
by: Borsukiewicz, Paweł, et al.
Published: (2025)
Enhancing Text-to-SQL Translation for Financial System Design
by: Song, Yewei, et al.
Published: (2023)
by: Song, Yewei, et al.
Published: (2023)
DetectBERT: Towards Full App-Level Representation Learning to Detect Android Malware
by: Sun, Tiezhu, et al.
Published: (2024)
by: Sun, Tiezhu, et al.
Published: (2024)
MT4DP: Data Poisoning Attack Detection for DL-based Code Search Models via Metamorphic Testing
by: Chen, Gong, et al.
Published: (2025)
by: Chen, Gong, et al.
Published: (2025)
Hotfixing Large Language Models for Code
by: Yang, Zhou, et al.
Published: (2024)
by: Yang, Zhou, et al.
Published: (2024)
Characterizing Build Compromises Through Vulnerability Disclosure Analysis
by: Diao, Maimouna Tamah, et al.
Published: (2025)
by: Diao, Maimouna Tamah, et al.
Published: (2025)
Personalized Code Readability Assessment: Are We There Yet?
by: Vitale, Antonio, et al.
Published: (2025)
by: Vitale, Antonio, et al.
Published: (2025)
LLM for Mobile: An Initial Roadmap
by: Chen, Daihang, et al.
Published: (2024)
by: Chen, Daihang, et al.
Published: (2024)
MalLoc: Toward Fine-grained Android Malicious Payload Localization via LLMs
by: Sun, Tiezhu, et al.
Published: (2025)
by: Sun, Tiezhu, et al.
Published: (2025)
Security smells in infrastructure as code: a taxonomy update beyond the seven sins
by: War, Aicha, et al.
Published: (2025)
by: War, Aicha, et al.
Published: (2025)
Similar Items
-
Rethinking Cognitive Complexity for Unit Tests: Toward a Readability-Aware Metric Grounded in Developer Perception
by: Ouédraogo, Wendkûuni C., et al.
Published: (2025) -
Beyond Surface Similarity: Evaluating LLM-Based Test Refactorings with Structural and Semantic Awareness
by: Ouédraogo, Wendkûuni C., et al.
Published: (2025) -
Test smells in LLM-Generated Unit Tests
by: Ouédraogo, Wendkûuni C., et al.
Published: (2024) -
Large-scale, Independent and Comprehensive study of the power of LLMs for test case generation
by: Ouédraogo, Wendkûuni C., et al.
Published: (2024) -
Enriching Automatic Test Case Generation by Extracting Relevant Test Inputs from Bug Reports
by: Ouédraogo, Wendkûuni C., et al.
Published: (2023)