Measuring LLM Code Generation Stability via Structural Entropy
Fuente:
arXiv
Saved in:
| Main Authors: | Song, Yewei, Sun, Tiezhu, Tang, Xunzhu, Rajput, Prateek, Bissyande, Tegawende F., Klein, Jacques |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Revisiting Code Similarity Evaluation with Abstract Syntax Tree Edit Distance
by: Song, Yewei, et al.
Published: (2024)
by: Song, Yewei, et al.
Published: (2024)
Boosting Open-Source LLMs for Program Repair via Reasoning Transfer and LLM-Guided Reinforcement Learning
by: Tang, Xunzhu, et al.
Published: (2025)
by: Tang, Xunzhu, et al.
Published: (2025)
Reinforcement Learning-Guided Chain-of-Draft for Token-Efficient Code Generation
by: Tang, Xunzhu, et al.
Published: (2025)
by: Tang, Xunzhu, et al.
Published: (2025)
Dynamic Stability of LLM-Generated Code
by: Rajput, Prateek, et al.
Published: (2025)
by: Rajput, Prateek, et al.
Published: (2025)
CallNavi, A Challenge and Empirical Study on LLM Function Calling and Routing
by: Song, Yewei, et al.
Published: (2025)
by: Song, Yewei, et al.
Published: (2025)
MalLoc: Toward Fine-grained Android Malicious Payload Localization via LLMs
by: Sun, Tiezhu, et al.
Published: (2025)
by: Sun, Tiezhu, et al.
Published: (2025)
Correctness isnt Efficiency: Runtime Memory Divergence in LLM-Generated Code
by: Rajput, Prateek, et al.
Published: (2026)
by: Rajput, Prateek, et al.
Published: (2026)
CodeAgent: Autonomous Communicative Agents for Code Review
by: Tang, Xunzhu, et al.
Published: (2024)
by: Tang, Xunzhu, et al.
Published: (2024)
Enhancing Text-to-SQL Translation for Financial System Design
by: Song, Yewei, et al.
Published: (2023)
by: Song, Yewei, et al.
Published: (2023)
Evaluation Drift in LLM Personality Induction: Are We Moving the Goalpost?
by: Rajput, Prateek, et al.
Published: (2026)
by: Rajput, Prateek, et al.
Published: (2026)
Patch-CLIP: A Patch-Text Pre-Trained Model
by: Tang, Xunzhu, et al.
Published: (2023)
by: Tang, Xunzhu, et al.
Published: (2023)
Test smells in LLM-Generated Unit Tests
by: Ouédraogo, Wendkûuni C., et al.
Published: (2024)
by: Ouédraogo, Wendkûuni C., et al.
Published: (2024)
MT4DP: Data Poisoning Attack Detection for DL-based Code Search Models via Metamorphic Testing
by: Chen, Gong, et al.
Published: (2025)
by: Chen, Gong, et al.
Published: (2025)
AndroLibZoo: A Reliable Dataset of Libraries Based on Software Dependency Analysis
by: Samhi, Jordan, et al.
Published: (2023)
by: Samhi, Jordan, et al.
Published: (2023)
How Secure is Secure Code Generation? Adversarial Prompts Put LLM Defenses to the Test
by: Tessa, Melissa, et al.
Published: (2026)
by: Tessa, Melissa, et al.
Published: (2026)
DetectBERT: Towards Full App-Level Representation Learning to Detect Android Malware
by: Sun, Tiezhu, et al.
Published: (2024)
by: Sun, Tiezhu, et al.
Published: (2024)
In-Context Code-Text Learning for Bimodal Software Engineering
by: Tang, Xunzhu, et al.
Published: (2024)
by: Tang, Xunzhu, et al.
Published: (2024)
An Empirical Study of AI Techniques in Mobile Applications
by: Li, Yinghua, et al.
Published: (2022)
by: Li, Yinghua, et al.
Published: (2022)
Evaluating Large Language Models in detecting Secrets in Android Apps
by: Alecci, Marco, et al.
Published: (2025)
by: Alecci, Marco, et al.
Published: (2025)
Programming Language Confusion: When Code LLMs Can't Keep their Languages Straight
by: Moumoula, Micheline Bénédicte, et al.
Published: (2025)
by: Moumoula, Micheline Bénédicte, et al.
Published: (2025)
Learned or Memorized ? Quantifying Memorization Advantage in Code LLMs
by: Euraste, Djiré Albérick, et al.
Published: (2026)
by: Euraste, Djiré Albérick, et al.
Published: (2026)
Beyond Language Barriers: Multi-Agent Coordination for Multi-Language Code Generation
by: Moumoula, Micheline Bénédicte, et al.
Published: (2025)
by: Moumoula, Micheline Bénédicte, et al.
Published: (2025)
The Code Barrier: What LLMs Actually Understand?
by: Nikiema, Serge Lionel, et al.
Published: (2025)
by: Nikiema, Serge Lionel, et al.
Published: (2025)
The Struggles of LLMs in Cross-lingual Code Clone Detection
by: Moumoula, Micheline Bénédicte, et al.
Published: (2024)
by: Moumoula, Micheline Bénédicte, et al.
Published: (2024)
Software Security in Software-Defined Networking: A Systematic Literature Review
by: Diouf, Moustapha Awwalou, et al.
Published: (2025)
by: Diouf, Moustapha Awwalou, et al.
Published: (2025)
MORepair: Teaching LLMs to Repair Code via Multi-Objective Fine-tuning
by: Yang, Boyang, et al.
Published: (2024)
by: Yang, Boyang, et al.
Published: (2024)
Beyond Surface Similarity: Evaluating LLM-Based Test Refactorings with Structural and Semantic Awareness
by: Ouédraogo, Wendkûuni C., et al.
Published: (2025)
by: Ouédraogo, Wendkûuni C., et al.
Published: (2025)
Call Graph Soundness in Android Static Analysis
by: Samhi, Jordan, et al.
Published: (2024)
by: Samhi, Jordan, et al.
Published: (2024)
Unlocking LLM Repair Capabilities Through Cross-Language Translation and Multi-Agent Refinement
by: Luo, Wenqiang, et al.
Published: (2025)
by: Luo, Wenqiang, et al.
Published: (2025)
SIEVE: Towards Verifiable Certification for Code-datasets
by: Mbodji, Fatou Ndiaye, et al.
Published: (2025)
by: Mbodji, Fatou Ndiaye, et al.
Published: (2025)
Code Fingerprints: Disentangled Attribution of LLM-Generated Code
by: Guo, Jiaxun, et al.
Published: (2026)
by: Guo, Jiaxun, et al.
Published: (2026)
CREF: An LLM-based Conversational Software Repair Framework for Programming Tutors
by: Yang, Boyang, et al.
Published: (2024)
by: Yang, Boyang, et al.
Published: (2024)
Enriching Automatic Test Case Generation by Extracting Relevant Test Inputs from Bug Reports
by: Ouédraogo, Wendkûuni C., et al.
Published: (2023)
by: Ouédraogo, Wendkûuni C., et al.
Published: (2023)
LLMSniffer: Detecting LLM-Generated Code via GraphCodeBERT and Supervised Contrastive Learning
by: Dihan, Mahir Labib, et al.
Published: (2026)
by: Dihan, Mahir Labib, et al.
Published: (2026)
Human-Aligned Code Readability Assessment with Large Language Models
by: Ouédraogo, Wendkûuni C., et al.
Published: (2025)
by: Ouédraogo, Wendkûuni C., et al.
Published: (2025)
LLM for Mobile: An Initial Roadmap
by: Chen, Daihang, et al.
Published: (2024)
by: Chen, Daihang, et al.
Published: (2024)
Measuring the Influence of Incorrect Code on Test Generation
by: Huang, Dong, et al.
Published: (2024)
by: Huang, Dong, et al.
Published: (2024)
Enhancing Code LLMs with Reinforcement Learning in Code Generation: A Survey
by: Wang, Junqiao, et al.
Published: (2024)
by: Wang, Junqiao, et al.
Published: (2024)
Showing LLM-Generated Code Selectively Based on Confidence of LLMs
by: Li, Jia, et al.
Published: (2024)
by: Li, Jia, et al.
Published: (2024)
BanglaForge: LLM Collaboration with Self-Refinement for Bangla Code Generation
by: Dihan, Mahir Labib, et al.
Published: (2025)
by: Dihan, Mahir Labib, et al.
Published: (2025)
Similar Items
-
Revisiting Code Similarity Evaluation with Abstract Syntax Tree Edit Distance
by: Song, Yewei, et al.
Published: (2024) -
Boosting Open-Source LLMs for Program Repair via Reasoning Transfer and LLM-Guided Reinforcement Learning
by: Tang, Xunzhu, et al.
Published: (2025) -
Reinforcement Learning-Guided Chain-of-Draft for Token-Efficient Code Generation
by: Tang, Xunzhu, et al.
Published: (2025) -
Dynamic Stability of LLM-Generated Code
by: Rajput, Prateek, et al.
Published: (2025) -
CallNavi, A Challenge and Empirical Study on LLM Function Calling and Routing
by: Song, Yewei, et al.
Published: (2025)