Studying and Benchmarking Large Language Models For Log Level Suggestion
Fuente:
arXiv
Saved in:
| Main Authors: | Heng, Yi Wen, Ma, Zeyang, Li, Zhenhao, Kim, Dong Jae, Tse-Hsun, Chen |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
LibreLog: Accurate and Efficient Unsupervised Log Parsing Using Open-Source Large Language Models
by: Ma, Zeyang, et al.
Published: (2024)
by: Ma, Zeyang, et al.
Published: (2024)
LLMParser: An Exploratory Study on Using Large Language Models for Log Parsing
by: Ma, Zeyang, et al.
Published: (2024)
by: Ma, Zeyang, et al.
Published: (2024)
Discovery of Timeline and Crowd Reaction of Software Vulnerability Disclosures
by: Heng, Yi Wen, et al.
Published: (2024)
by: Heng, Yi Wen, et al.
Published: (2024)
Crash Report Enhancement with Large Language Models: An Empirical Study
by: Fahim, S M Farah Al, et al.
Published: (2025)
by: Fahim, S M Farah Al, et al.
Published: (2025)
RobuNFR: Evaluating the Robustness of Large Language Models on Non-Functional Requirements Aware Code Generation
by: Lin, Feng, et al.
Published: (2025)
by: Lin, Feng, et al.
Published: (2025)
Evaluating Software Process Models for Multi-Agent Class-Level Code Generation
by: Shafin, Wasique Islam, et al.
Published: (2025)
by: Shafin, Wasique Islam, et al.
Published: (2025)
Empowering AIOps: Leveraging Large Language Models for IT Operations Management
by: Vitui, Arthur, et al.
Published: (2025)
by: Vitui, Arthur, et al.
Published: (2025)
Order Matters! An Empirical Study on Large Language Models' Input Order Bias in Software Fault Localization
by: Rafi, Md Nakhla, et al.
Published: (2024)
by: Rafi, Md Nakhla, et al.
Published: (2024)
SWE-Refactor: A Repository-Level Benchmark for Real-World LLM-Based Code Refactoring
by: Xu, Yisen, et al.
Published: (2026)
by: Xu, Yisen, et al.
Published: (2026)
Identifying Performance-Sensitive Configurations in Software Systems through Code Analysis with LLM Agents
by: Wang, Zehao, et al.
Published: (2024)
by: Wang, Zehao, et al.
Published: (2024)
Defects4Log: Benchmarking LLMs for Logging Code Defect Detection and Reasoning
by: Wang, Xin, et al.
Published: (2025)
by: Wang, Xin, et al.
Published: (2025)
A Multi-Agent Approach to Fault Localization via Graph-Based Retrieval and Reflexion
by: Rafi, Md Nakhla, et al.
Published: (2024)
by: Rafi, Md Nakhla, et al.
Published: (2024)
SOEN-101: Code Generation by Emulating Software Process Models Using Large Language Model Agents
by: Lin, Feng, et al.
Published: (2024)
by: Lin, Feng, et al.
Published: (2024)
PopSweeper: Automatically Detecting and Resolving App-Blocking Pop-Ups to Assist Automated Mobile GUI Testing
by: Guo, Linqiang, et al.
Published: (2024)
by: Guo, Linqiang, et al.
Published: (2024)
Towards Better Graph Neural Network-based Fault Localization Through Enhanced Code Representation
by: Rafi, Md Nakhla, et al.
Published: (2024)
by: Rafi, Md Nakhla, et al.
Published: (2024)
SLICET5: Static Program Slicing using Language Models with Copy Mechanism and Constrained Decoding
by: He, Pengfei, et al.
Published: (2025)
by: He, Pengfei, et al.
Published: (2025)
MobileUPReg: Identifying User-Perceived Performance Regressions in Mobile OS Versions
by: Liu, Wei, et al.
Published: (2025)
by: Liu, Wei, et al.
Published: (2025)
Towards Structured, State-Aware, and Execution-Grounded Reasoning for Software Engineering Agents
by: Tse-Hsun, et al.
Published: (2026)
by: Tse-Hsun, et al.
Published: (2026)
Screencast-Based Analysis of User-Perceived GUI Responsiveness
by: Liu, Wei, et al.
Published: (2025)
by: Liu, Wei, et al.
Published: (2025)
On Rank Aggregating Test Prioritizations
by: Mondal, Shouvick, et al.
Published: (2024)
by: Mondal, Shouvick, et al.
Published: (2024)
CI-Repair-Bench: A Repository-Aware Benchmark for Automated Patch Validation via CI Workflows
by: Muna, Rabeya Khatun, et al.
Published: (2026)
by: Muna, Rabeya Khatun, et al.
Published: (2026)
An Empirical Study on the Characteristics of Database Access Bugs in Java Applications
by: Liu, Wei, et al.
Published: (2024)
by: Liu, Wei, et al.
Published: (2024)
LLM-SrcLog: Towards Proactive and Unified Log Template Extraction via Large Language Models
by: Sun, Jiaqi, et al.
Published: (2025)
by: Sun, Jiaqi, et al.
Published: (2025)
A Survey of Code Review Benchmarks and Evaluation Practices in Pre-LLM and LLM Era
by: Khan, Taufiqul Islam, et al.
Published: (2026)
by: Khan, Taufiqul Islam, et al.
Published: (2026)
Are Benchmark Tests Strong Enough? Mutation-Guided Diagnosis and Augmentation of Regression Suites
by: Li, Chenglin, et al.
Published: (2026)
by: Li, Chenglin, et al.
Published: (2026)
From Historical Patches to Repair Plans: Outcome-Conditioned Reasoning for Repository-Level Program Repair
by: Li, Chenglin, et al.
Published: (2026)
by: Li, Chenglin, et al.
Published: (2026)
MANTRA: Enhancing Automated Method-Level Refactoring with Contextual RAG and Multi-Agent LLM Collaboration
by: Xu, Yisen, et al.
Published: (2025)
by: Xu, Yisen, et al.
Published: (2025)
Back to the Future! Studying Data Cleanness in Defects4J and its Impact on Fault Localization
by: Rafi, Md Nakhla, et al.
Published: (2023)
by: Rafi, Md Nakhla, et al.
Published: (2023)
CODEPROMPTZIP: Code-specific Prompt Compression for Retrieval-Augmented Generation in Coding Tasks with LMs
by: He, Pengfei, et al.
Published: (2025)
by: He, Pengfei, et al.
Published: (2025)
LLM4Perf: Large Language Models Are Effective Samplers for Multi-Objective Performance Modeling
by: Wang, Xin, et al.
Published: (2025)
by: Wang, Xin, et al.
Published: (2025)
Towards Secure Logging: Characterizing and Benchmarking Logging Code Security Issues with LLMs
by: Yuan, He Yang, et al.
Published: (2026)
by: Yuan, He Yang, et al.
Published: (2026)
Logging Like Humans for LLMs: Rethinking Logging via Execution and Runtime Feedback
by: Wang, Xin, et al.
Published: (2026)
by: Wang, Xin, et al.
Published: (2026)
Studying the Impact of Early Test Termination Due to Assertion Failure on Code Coverage and Spectrum-based Fault Localization
by: Uddin, Md. Ashraf, et al.
Published: (2025)
by: Uddin, Md. Ashraf, et al.
Published: (2025)
LogParser-LLM: Advancing Efficient Log Parsing with Large Language Models
by: Zhong, Aoxiao, et al.
Published: (2024)
by: Zhong, Aoxiao, et al.
Published: (2024)
Evaluating the Effectiveness and Efficiency of Demonstration Retrievers in RAG for Coding Tasks
by: He, Pengfei, et al.
Published: (2024)
by: He, Pengfei, et al.
Published: (2024)
Towards Explainable Vulnerability Detection with Large Language Models
by: Mao, Qiheng, et al.
Published: (2024)
by: Mao, Qiheng, et al.
Published: (2024)
Static Program Slicing Using Language Models With Dataflow-Aware Pretraining and Constrained Decoding
by: He, Pengfei, et al.
Published: (2026)
by: He, Pengfei, et al.
Published: (2026)
Single-Language Evidence Is Insufficient for Automated Logging: A Multilingual Benchmark and Empirical Study with LLMs
by: Zhong, Renyi, et al.
Published: (2026)
by: Zhong, Renyi, et al.
Published: (2026)
A Comprehensive Framework for Evaluating API-oriented Code Generation in Large Language Models
by: Wu, Yixi, et al.
Published: (2024)
by: Wu, Yixi, et al.
Published: (2024)
LogLSHD: Fast Log Parsing with Locality-Sensitive Hashing and Dynamic Time Warping
by: Huang, Shu-Wei, et al.
Published: (2025)
by: Huang, Shu-Wei, et al.
Published: (2025)
Similar Items
-
LibreLog: Accurate and Efficient Unsupervised Log Parsing Using Open-Source Large Language Models
by: Ma, Zeyang, et al.
Published: (2024) -
LLMParser: An Exploratory Study on Using Large Language Models for Log Parsing
by: Ma, Zeyang, et al.
Published: (2024) -
Discovery of Timeline and Crowd Reaction of Software Vulnerability Disclosures
by: Heng, Yi Wen, et al.
Published: (2024) -
Crash Report Enhancement with Large Language Models: An Empirical Study
by: Fahim, S M Farah Al, et al.
Published: (2025) -
RobuNFR: Evaluating the Robustness of Large Language Models on Non-Functional Requirements Aware Code Generation
by: Lin, Feng, et al.
Published: (2025)