Crash Report Enhancement with Large Language Models: An Empirical Study
Fuente:
arXiv
Saved in:
| Main Authors: | Fahim, S M Farah Al, Rafi, Md Nakhla, Ma, Zeyang, Kim, Dong Jae, Tse-Hsun, Chen |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Order Matters! An Empirical Study on Large Language Models' Input Order Bias in Software Fault Localization
by: Rafi, Md Nakhla, et al.
Published: (2024)
by: Rafi, Md Nakhla, et al.
Published: (2024)
A Multi-Agent Approach to Fault Localization via Graph-Based Retrieval and Reflexion
by: Rafi, Md Nakhla, et al.
Published: (2024)
by: Rafi, Md Nakhla, et al.
Published: (2024)
Towards Better Graph Neural Network-based Fault Localization Through Enhanced Code Representation
by: Rafi, Md Nakhla, et al.
Published: (2024)
by: Rafi, Md Nakhla, et al.
Published: (2024)
LibreLog: Accurate and Efficient Unsupervised Log Parsing Using Open-Source Large Language Models
by: Ma, Zeyang, et al.
Published: (2024)
by: Ma, Zeyang, et al.
Published: (2024)
Back to the Future! Studying Data Cleanness in Defects4J and its Impact on Fault Localization
by: Rafi, Md Nakhla, et al.
Published: (2023)
by: Rafi, Md Nakhla, et al.
Published: (2023)
CI-Repair-Bench: A Repository-Aware Benchmark for Automated Patch Validation via CI Workflows
by: Muna, Rabeya Khatun, et al.
Published: (2026)
by: Muna, Rabeya Khatun, et al.
Published: (2026)
Studying and Benchmarking Large Language Models For Log Level Suggestion
by: Heng, Yi Wen, et al.
Published: (2024)
by: Heng, Yi Wen, et al.
Published: (2024)
LLMParser: An Exploratory Study on Using Large Language Models for Log Parsing
by: Ma, Zeyang, et al.
Published: (2024)
by: Ma, Zeyang, et al.
Published: (2024)
Evaluating Software Process Models for Multi-Agent Class-Level Code Generation
by: Shafin, Wasique Islam, et al.
Published: (2025)
by: Shafin, Wasique Islam, et al.
Published: (2025)
SBEST: Spectrum-Based Fault Localization Without Fault-Triggering Tests
by: Rafi, Md Nakhla, et al.
Published: (2024)
by: Rafi, Md Nakhla, et al.
Published: (2024)
Empowering AIOps: Leveraging Large Language Models for IT Operations Management
by: Vitui, Arthur, et al.
Published: (2025)
by: Vitui, Arthur, et al.
Published: (2025)
RobuNFR: Evaluating the Robustness of Large Language Models on Non-Functional Requirements Aware Code Generation
by: Lin, Feng, et al.
Published: (2025)
by: Lin, Feng, et al.
Published: (2025)
An Empirical Study on the Characteristics of Database Access Bugs in Java Applications
by: Liu, Wei, et al.
Published: (2024)
by: Liu, Wei, et al.
Published: (2024)
Identifying Performance-Sensitive Configurations in Software Systems through Code Analysis with LLM Agents
by: Wang, Zehao, et al.
Published: (2024)
by: Wang, Zehao, et al.
Published: (2024)
Discovery of Timeline and Crowd Reaction of Software Vulnerability Disclosures
by: Heng, Yi Wen, et al.
Published: (2024)
by: Heng, Yi Wen, et al.
Published: (2024)
SOEN-101: Code Generation by Emulating Software Process Models Using Large Language Model Agents
by: Lin, Feng, et al.
Published: (2024)
by: Lin, Feng, et al.
Published: (2024)
SLICET5: Static Program Slicing using Language Models with Copy Mechanism and Constrained Decoding
by: He, Pengfei, et al.
Published: (2025)
by: He, Pengfei, et al.
Published: (2025)
Towards Structured, State-Aware, and Execution-Grounded Reasoning for Software Engineering Agents
by: Tse-Hsun, et al.
Published: (2026)
by: Tse-Hsun, et al.
Published: (2026)
On Rank Aggregating Test Prioritizations
by: Mondal, Shouvick, et al.
Published: (2024)
by: Mondal, Shouvick, et al.
Published: (2024)
Studying the Impact of Early Test Termination Due to Assertion Failure on Code Coverage and Spectrum-based Fault Localization
by: Uddin, Md. Ashraf, et al.
Published: (2025)
by: Uddin, Md. Ashraf, et al.
Published: (2025)
An Empirical Study of Python Library Migration Using Large Language Models
by: Islam, Md Mohayeminul, et al.
Published: (2025)
by: Islam, Md Mohayeminul, et al.
Published: (2025)
CODEPROMPTZIP: Code-specific Prompt Compression for Retrieval-Augmented Generation in Coding Tasks with LMs
by: He, Pengfei, et al.
Published: (2025)
by: He, Pengfei, et al.
Published: (2025)
SWE-Refactor: A Repository-Level Benchmark for Real-World LLM-Based Code Refactoring
by: Xu, Yisen, et al.
Published: (2026)
by: Xu, Yisen, et al.
Published: (2026)
Failure-Aware Enhancements for Large Language Model (LLM) Code Generation: An Empirical Study on Decision Framework
by: Shen, Jianru, et al.
Published: (2026)
by: Shen, Jianru, et al.
Published: (2026)
Enhancement Report Approval Prediction: A Comparative Study of Large Language Models
by: Zuo, Haosheng, et al.
Published: (2025)
by: Zuo, Haosheng, et al.
Published: (2025)
Large Language Models for Automated Web-Form-Test Generation: An Empirical Study
by: Li, Tao, et al.
Published: (2024)
by: Li, Tao, et al.
Published: (2024)
Model Compression vs. Adversarial Robustness: An Empirical Study on Language Models for Code
by: Awal, Md. Abdul, et al.
Published: (2025)
by: Awal, Md. Abdul, et al.
Published: (2025)
Evaluating the Effectiveness and Efficiency of Demonstration Retrievers in RAG for Coding Tasks
by: He, Pengfei, et al.
Published: (2024)
by: He, Pengfei, et al.
Published: (2024)
Large Language Models for Fault Localization: An Empirical Study
by: Xiao, YingJian, et al.
Published: (2025)
by: Xiao, YingJian, et al.
Published: (2025)
Why do Machine Learning Notebooks Crash? An Empirical Study on Public Python Jupyter Notebooks
by: Wang, Yiran, et al.
Published: (2024)
by: Wang, Yiran, et al.
Published: (2024)
Static Program Slicing Using Language Models With Dataflow-Aware Pretraining and Constrained Decoding
by: He, Pengfei, et al.
Published: (2026)
by: He, Pengfei, et al.
Published: (2026)
Stack Trace-Based Crash Deduplication with Transformer Adaptation
by: Mamun, Md Afif Al, et al.
Published: (2025)
by: Mamun, Md Afif Al, et al.
Published: (2025)
An Empirical Study on the Code Refactoring Capability of Large Language Models
by: Cordeiro, Jonathan, et al.
Published: (2024)
by: Cordeiro, Jonathan, et al.
Published: (2024)
Large Language Models for Mobile GUI Text Input Generation: An Empirical Study
by: Cui, Chenhui, et al.
Published: (2024)
by: Cui, Chenhui, et al.
Published: (2024)
A Large-scale Empirical Study on Fine-tuning Large Language Models for Unit Testing
by: Shang, Ye, et al.
Published: (2024)
by: Shang, Ye, et al.
Published: (2024)
A Comprehensive Framework for Evaluating API-oriented Code Generation in Large Language Models
by: Wu, Yixi, et al.
Published: (2024)
by: Wu, Yixi, et al.
Published: (2024)
A Survey of Code Review Benchmarks and Evaluation Practices in Pre-LLM and LLM Era
by: Khan, Taufiqul Islam, et al.
Published: (2026)
by: Khan, Taufiqul Islam, et al.
Published: (2026)
An Empirical Evaluation of Pre-trained Large Language Models for Repairing Declarative Formal Specifications
by: Alhanahnah, Mohannad, et al.
Published: (2024)
by: Alhanahnah, Mohannad, et al.
Published: (2024)
Guidelines for Empirical Studies in Software Engineering involving Large Language Models
by: Baltes, Sebastian, et al.
Published: (2025)
by: Baltes, Sebastian, et al.
Published: (2025)
KGym: A Platform and Dataset to Benchmark Large Language Models on Linux Kernel Crash Resolution
by: Mathai, Alex, et al.
Published: (2024)
by: Mathai, Alex, et al.
Published: (2024)
Similar Items
-
Order Matters! An Empirical Study on Large Language Models' Input Order Bias in Software Fault Localization
by: Rafi, Md Nakhla, et al.
Published: (2024) -
A Multi-Agent Approach to Fault Localization via Graph-Based Retrieval and Reflexion
by: Rafi, Md Nakhla, et al.
Published: (2024) -
Towards Better Graph Neural Network-based Fault Localization Through Enhanced Code Representation
by: Rafi, Md Nakhla, et al.
Published: (2024) -
LibreLog: Accurate and Efficient Unsupervised Log Parsing Using Open-Source Large Language Models
by: Ma, Zeyang, et al.
Published: (2024) -
Back to the Future! Studying Data Cleanness in Defects4J and its Impact on Fault Localization
by: Rafi, Md Nakhla, et al.
Published: (2023)