AL-Bench: A Benchmark for Automatic Logging
Fuente:
arXiv
Salvato in:
| Autori principali: | Tan, Boyin, Xu, Junjielong, Zhu, Zhouruixing, He, Pinjia |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Prompting for Automatic Log Template Extraction
di: Xu, Junjielong, et al.
Pubblicazione: (2023)
di: Xu, Junjielong, et al.
Pubblicazione: (2023)
SWE-Manager: Selecting and Synthesizing Golden Proposals Before Coding
di: Tan, Boyin, et al.
Pubblicazione: (2026)
di: Tan, Boyin, et al.
Pubblicazione: (2026)
Scalable Supervising Software Agents with Patch Reasoner
di: Xu, Junjielong, et al.
Pubblicazione: (2025)
di: Xu, Junjielong, et al.
Pubblicazione: (2025)
UniSage: A Unified and Post-Analysis-Aware Sampling for Microservices
di: Zhu, Zhouruixing, et al.
Pubblicazione: (2025)
di: Zhu, Zhouruixing, et al.
Pubblicazione: (2025)
MicLog: Towards Accurate and Efficient LLM-based Log Parsing via Progressive Meta In-Context Learning
di: Yu, Jianbo, et al.
Pubblicazione: (2026)
di: Yu, Jianbo, et al.
Pubblicazione: (2026)
Aligning the Objective of LLM-based Program Repair
di: Xu, Junjielong, et al.
Pubblicazione: (2024)
di: Xu, Junjielong, et al.
Pubblicazione: (2024)
DeLog: An Efficient Log Compression Framework with Pattern Signature Synthesis
di: Yu, Siyu, et al.
Pubblicazione: (2026)
di: Yu, Siyu, et al.
Pubblicazione: (2026)
A Goal-Driven Survey on Root Cause Analysis
di: Fang, Aoyang, et al.
Pubblicazione: (2025)
di: Fang, Aoyang, et al.
Pubblicazione: (2025)
Rethinking the Evaluation of Microservice RCA with a Fault Propagation-Aware Benchmark
di: Fang, Aoyang, et al.
Pubblicazione: (2025)
di: Fang, Aoyang, et al.
Pubblicazione: (2025)
BackportBench: A Multilingual Benchmark for Automated Backporting of Patches
di: Zhong, Zhiqing, et al.
Pubblicazione: (2025)
di: Zhong, Zhiqing, et al.
Pubblicazione: (2025)
Unlocking the Power of Numbers: Log Compression via Numeric Token Parsing
di: Yu, Siyu, et al.
Pubblicazione: (2024)
di: Yu, Siyu, et al.
Pubblicazione: (2024)
LogPTR: Variable-Aware Log Parsing with Pointer Network
di: Wu, Yifan, et al.
Pubblicazione: (2024)
di: Wu, Yifan, et al.
Pubblicazione: (2024)
SPES: Towards Optimizing Performance-Resource Trade-Off for Serverless Functions
di: Lee, Cheryl, et al.
Pubblicazione: (2024)
di: Lee, Cheryl, et al.
Pubblicazione: (2024)
On the Influence of Data Resampling for Deep Learning-Based Log Anomaly Detection: Insights and Recommendations
di: Ma, Xiaoxue, et al.
Pubblicazione: (2024)
di: Ma, Xiaoxue, et al.
Pubblicazione: (2024)
Go Static: Contextualized Logging Statement Generation
di: Li, Yichen, et al.
Pubblicazione: (2024)
di: Li, Yichen, et al.
Pubblicazione: (2024)
Exploring the Effectiveness of LLMs in Automated Logging Generation: An Empirical Study
di: Li, Yichen, et al.
Pubblicazione: (2023)
di: Li, Yichen, et al.
Pubblicazione: (2023)
UTBoost: Rigorous Evaluation of Coding Agents on SWE-Bench
di: Yu, Boxi, et al.
Pubblicazione: (2025)
di: Yu, Boxi, et al.
Pubblicazione: (2025)
LILAC: Log Parsing using LLMs with Adaptive Parsing Cache
di: Jiang, Zhihan, et al.
Pubblicazione: (2023)
di: Jiang, Zhihan, et al.
Pubblicazione: (2023)
AutoCodeBench: Large Language Models are Automatic Code Benchmark Generators
di: Chou, Jason, et al.
Pubblicazione: (2025)
di: Chou, Jason, et al.
Pubblicazione: (2025)
SWE-ABS: Adversarial Benchmark Strengthening Exposes Inflated Success Rates on Test-based Benchmark
di: Yu, Boxi, et al.
Pubblicazione: (2026)
di: Yu, Boxi, et al.
Pubblicazione: (2026)
Gleaner: A Semantically-Rich and Efficient Online Sampler for Microservice Diagnostics
di: Yang, Yifan, et al.
Pubblicazione: (2026)
di: Yang, Yifan, et al.
Pubblicazione: (2026)
EffiBench: Benchmarking the Efficiency of Automatically Generated Code
di: Huang, Dong, et al.
Pubblicazione: (2024)
di: Huang, Dong, et al.
Pubblicazione: (2024)
InferLog: Accelerating LLM Inference for Online Log Parsing via ICL-oriented Prefix Caching
di: Wang, Yilun, et al.
Pubblicazione: (2025)
di: Wang, Yilun, et al.
Pubblicazione: (2025)
FrontendBench: A Benchmark for Evaluating LLMs on Front-End Development via Automatic Evaluation
di: Zhu, Hongda, et al.
Pubblicazione: (2025)
di: Zhu, Hongda, et al.
Pubblicazione: (2025)
Defects4Log: Benchmarking LLMs for Logging Code Defect Detection and Reasoning
di: Wang, Xin, et al.
Pubblicazione: (2025)
di: Wang, Xin, et al.
Pubblicazione: (2025)
An Empirical Study on Package-Level Deprecation in Python Ecosystem
di: Zhong, Zhiqing, et al.
Pubblicazione: (2024)
di: Zhong, Zhiqing, et al.
Pubblicazione: (2024)
DSCodeBench: A Realistic Benchmark for Data Science Code Generation
di: Ouyang, Shuyin, et al.
Pubblicazione: (2025)
di: Ouyang, Shuyin, et al.
Pubblicazione: (2025)
DynaCausal: Dynamic Causality-Aware Root Cause Analysis for Distributed Microservices
di: Zhang, Songhan, et al.
Pubblicazione: (2025)
di: Zhang, Songhan, et al.
Pubblicazione: (2025)
Studying and Benchmarking Large Language Models For Log Level Suggestion
di: Heng, Yi Wen, et al.
Pubblicazione: (2024)
di: Heng, Yi Wen, et al.
Pubblicazione: (2024)
SWE Context Bench: A Benchmark for Context Learning in Coding
di: Zhu, Jiayuan, et al.
Pubblicazione: (2026)
di: Zhu, Jiayuan, et al.
Pubblicazione: (2026)
JMigBench: A Benchmark for Evaluating LLMs on Source Code Migration (Java 8 to Java 11)
di: Amin, Nishil, et al.
Pubblicazione: (2026)
di: Amin, Nishil, et al.
Pubblicazione: (2026)
ZeroLog: Zero-Label Generalizable Cross-System Log-based Anomaly Detection
di: Zhao, Xinlong, et al.
Pubblicazione: (2025)
di: Zhao, Xinlong, et al.
Pubblicazione: (2025)
SWE-Bench+: Enhanced Coding Benchmark for LLMs
di: Aleithan, Reem, et al.
Pubblicazione: (2024)
di: Aleithan, Reem, et al.
Pubblicazione: (2024)
RubberDuckBench: A Benchmark for AI Coding Assistants
di: Mohammed, Ferida, et al.
Pubblicazione: (2026)
di: Mohammed, Ferida, et al.
Pubblicazione: (2026)
DyPyBench: A Benchmark of Executable Python Software
di: Bouzenia, Islem, et al.
Pubblicazione: (2024)
di: Bouzenia, Islem, et al.
Pubblicazione: (2024)
PandasBench: A Benchmark for the Pandas API
di: Broihier, Alex, et al.
Pubblicazione: (2025)
di: Broihier, Alex, et al.
Pubblicazione: (2025)
Single-Language Evidence Is Insufficient for Automated Logging: A Multilingual Benchmark and Empirical Study with LLMs
di: Zhong, Renyi, et al.
Pubblicazione: (2026)
di: Zhong, Renyi, et al.
Pubblicazione: (2026)
Towards Secure Logging: Characterizing and Benchmarking Logging Code Security Issues with LLMs
di: Yuan, He Yang, et al.
Pubblicazione: (2026)
di: Yuan, He Yang, et al.
Pubblicazione: (2026)
LogDx-CI: Benchmarking Log Reduction Tools for LLM Root-Cause Diagnosis
di: Qin, Bowen
Pubblicazione: (2026)
di: Qin, Bowen
Pubblicazione: (2026)
Unified Semantic Log Parsing and Causal Graph Construction for Attack Attribution
di: Tan, Zhuoran, et al.
Pubblicazione: (2024)
di: Tan, Zhuoran, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Prompting for Automatic Log Template Extraction
di: Xu, Junjielong, et al.
Pubblicazione: (2023) -
SWE-Manager: Selecting and Synthesizing Golden Proposals Before Coding
di: Tan, Boyin, et al.
Pubblicazione: (2026) -
Scalable Supervising Software Agents with Patch Reasoner
di: Xu, Junjielong, et al.
Pubblicazione: (2025) -
UniSage: A Unified and Post-Analysis-Aware Sampling for Microservices
di: Zhu, Zhouruixing, et al.
Pubblicazione: (2025) -
MicLog: Towards Accurate and Efficient LLM-based Log Parsing via Progressive Meta In-Context Learning
di: Yu, Jianbo, et al.
Pubblicazione: (2026)