ErrorPrism: Reconstructing Error Propagation Paths in Cloud Service Systems
Fuente:
arXiv
Saved in:
| Main Authors: | Pu, Junsong, Li, Yichen, Chen, Zhuangbin, Liu, Jinyang, Jiang, Zhihan, Chen, Jianjun, Shi, Rui, Zheng, Zibin, Zhang, Tieying |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Tracezip: Efficient Distributed Tracing via Trace Compression
by: Chen, Zhuangbin, et al.
Published: (2025)
by: Chen, Zhuangbin, et al.
Published: (2025)
TypeScript Repository Indexing for Code Agent Retrieval
by: Pu, Junsong, et al.
Published: (2026)
by: Pu, Junsong, et al.
Published: (2026)
LogPrism: Unifying Structure and Variable Encoding for Effective Log Compression
by: Liu, Yang, et al.
Published: (2026)
by: Liu, Yang, et al.
Published: (2026)
LogPilot: Intent-aware and Scalable Alert Diagnosis for Large-scale Online Service Systems
by: Jiang, Zhihan, et al.
Published: (2025)
by: Jiang, Zhihan, et al.
Published: (2025)
MASPrism: Lightweight Failure Attribution for Multi-Agent Systems Using Prefill-Stage Signals
by: Liu, Yang, et al.
Published: (2026)
by: Liu, Yang, et al.
Published: (2026)
Cast: Automated Resilience Testing for Production Cloud Service Systems
by: Chen, Zhuangbin, et al.
Published: (2026)
by: Chen, Zhuangbin, et al.
Published: (2026)
COCA: Generative Root Cause Analysis for Distributed Systems with Code Knowledge
by: Li, Yichen, et al.
Published: (2025)
by: Li, Yichen, et al.
Published: (2025)
TraceMesh: Scalable and Streaming Sampling for Distributed Traces
by: Chen, Zhuangbin, et al.
Published: (2024)
by: Chen, Zhuangbin, et al.
Published: (2024)
MicroRacer: Detecting Concurrency Bugs for Cloud Service Systems
by: Deng, Zhiling, et al.
Published: (2025)
by: Deng, Zhiling, et al.
Published: (2025)
Metronome: Differentiated Delay Scheduling for Serverless Functions
by: Chen, Zhuangbin, et al.
Published: (2025)
by: Chen, Zhuangbin, et al.
Published: (2025)
An Empirical Study of Interaction Bugs in ROS-based Software
by: Chen, Zhixiang, et al.
Published: (2025)
by: Chen, Zhixiang, et al.
Published: (2025)
A Large-Scale Evaluation for Log Parsing Techniques: How Far Are We?
by: Jiang, Zhihan, et al.
Published: (2023)
by: Jiang, Zhihan, et al.
Published: (2023)
LILAC: Log Parsing using LLMs with Adaptive Parsing Cache
by: Jiang, Zhihan, et al.
Published: (2023)
by: Jiang, Zhihan, et al.
Published: (2023)
LUNAR: Unsupervised LLM-based Log Parsing
by: Huang, Junjie, et al.
Published: (2024)
by: Huang, Junjie, et al.
Published: (2024)
FaultProfIT: Hierarchical Fault Profiling of Incident Tickets in Large-scale Cloud Systems
by: Huang, Junjie, et al.
Published: (2024)
by: Huang, Junjie, et al.
Published: (2024)
Adaptive and Efficient Log Parsing as a Cloud Service
by: Li, Zeyan, et al.
Published: (2025)
by: Li, Zeyan, et al.
Published: (2025)
Flow-of-Action: SOP Enhanced LLM-Based Multi-Agent System for Root Cause Analysis
by: Pei, Changhua, et al.
Published: (2025)
by: Pei, Changhua, et al.
Published: (2025)
PathFuzzing: Worst Case Analysis by Fuzzing Symbolic-Execution Paths
by: Chen, Zimu, et al.
Published: (2025)
by: Chen, Zimu, et al.
Published: (2025)
MAS-FIRE: Fault Injection and Reliability Evaluation for LLM-Based Multi-Agent Systems
by: Jia, Jin, et al.
Published: (2026)
by: Jia, Jin, et al.
Published: (2026)
Face It Yourselves: An LLM-Based Two-Stage Strategy to Localize Configuration Errors via Logs
by: Shan, Shiwen, et al.
Published: (2024)
by: Shan, Shiwen, et al.
Published: (2024)
Identifying Performance Issues in Cloud Service Systems Based on Relational-Temporal Features
by: Gu, Wenwei, et al.
Published: (2023)
by: Gu, Wenwei, et al.
Published: (2023)
ComBench: A Repo-level Real-world Benchmark for Compilation Error Repair
by: Li, Jia, et al.
Published: (2026)
by: Li, Jia, et al.
Published: (2026)
Leveraging Propagated Infection to Crossfire Mutants
by: Du, Hang, et al.
Published: (2024)
by: Du, Hang, et al.
Published: (2024)
MTAD: Tools and Benchmarks for Multivariate Time Series Anomaly Detection
by: Liu, Jinyang, et al.
Published: (2024)
by: Liu, Jinyang, et al.
Published: (2024)
PALM: Path-aware LLM-based Test Generation with Comprehension
by: Wu, Yaoxuan, et al.
Published: (2025)
by: Wu, Yaoxuan, et al.
Published: (2025)
Demystifying and Extracting Fault-indicating Information from Logs for Failure Diagnosis
by: Huang, Junjie, et al.
Published: (2024)
by: Huang, Junjie, et al.
Published: (2024)
TickIt: Leveraging Large Language Models for Automated Ticket Escalation
by: Liu, Fengrui, et al.
Published: (2025)
by: Liu, Fengrui, et al.
Published: (2025)
KPIRoot+: An Efficient Integrated Framework for Anomaly Detection and Root Cause Analysis in Large-Scale Cloud Systems
by: Gu, Wenwei, et al.
Published: (2025)
by: Gu, Wenwei, et al.
Published: (2025)
AgentEval: DAG-Structured Step-Level Evaluation for Agentic Workflows with Error Propagation Tracking
by: Guo, Dongxin, et al.
Published: (2026)
by: Guo, Dongxin, et al.
Published: (2026)
Reflective Unit Test Generation for Precise Type Error Detection with Large Language Models
by: Yang, Chen, et al.
Published: (2025)
by: Yang, Chen, et al.
Published: (2025)
ChangePrism: Visualizing the Essence of Code Changes
by: Chen, Lei, et al.
Published: (2025)
by: Chen, Lei, et al.
Published: (2025)
L4: Diagnosing Large-scale LLM Training Failures via Automated Log Analysis
by: Jiang, Zhihan, et al.
Published: (2025)
by: Jiang, Zhihan, et al.
Published: (2025)
Go Static: Contextualized Logging Statement Generation
by: Li, Yichen, et al.
Published: (2024)
by: Li, Yichen, et al.
Published: (2024)
A Mathematics-Guided Approach to Floating-Point Error Detection
by: Tan, Youshuai, et al.
Published: (2025)
by: Tan, Youshuai, et al.
Published: (2025)
Trace Sampling 2.0: Code Knowledge Enhanced Span-level Sampling for Distributed Tracing
by: Wu, Yulun, et al.
Published: (2025)
by: Wu, Yulun, et al.
Published: (2025)
Computing Floating-Point Errors by Injecting Perturbations
by: Tan, Youshuai, et al.
Published: (2025)
by: Tan, Youshuai, et al.
Published: (2025)
A Comprehensive Study on Large Language Models for Mutation Testing
by: Wang, Bo, et al.
Published: (2024)
by: Wang, Bo, et al.
Published: (2024)
KRONE: Scalable LLM-Augmented Log Anomaly Detection via Hierarchical Abstraction
by: Ma, Lei, et al.
Published: (2026)
by: Ma, Lei, et al.
Published: (2026)
Identifying Smart Contract Security Issues in Code Snippets from Stack Overflow
by: Chen, Jiachi, et al.
Published: (2024)
by: Chen, Jiachi, et al.
Published: (2024)
Comment Traps: How Defective Commented-out Code Augment Defects in AI-Assisted Code Generation
by: Huang, Yuan, et al.
Published: (2025)
by: Huang, Yuan, et al.
Published: (2025)
Similar Items
-
Tracezip: Efficient Distributed Tracing via Trace Compression
by: Chen, Zhuangbin, et al.
Published: (2025) -
TypeScript Repository Indexing for Code Agent Retrieval
by: Pu, Junsong, et al.
Published: (2026) -
LogPrism: Unifying Structure and Variable Encoding for Effective Log Compression
by: Liu, Yang, et al.
Published: (2026) -
LogPilot: Intent-aware and Scalable Alert Diagnosis for Large-scale Online Service Systems
by: Jiang, Zhihan, et al.
Published: (2025) -
MASPrism: Lightweight Failure Attribution for Multi-Agent Systems Using Prefill-Stage Signals
by: Liu, Yang, et al.
Published: (2026)