TraceMesh: Scalable and Streaming Sampling for Distributed Traces
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Zhuangbin, Jiang, Zhihan, Su, Yuxin, Lyu, Michael R., Zheng, Zibin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Metronome: Differentiated Delay Scheduling for Serverless Functions
por: Chen, Zhuangbin, et al.
Publicado: (2025)
por: Chen, Zhuangbin, et al.
Publicado: (2025)
L4: Diagnosing Large-scale LLM Training Failures via Automated Log Analysis
por: Jiang, Zhihan, et al.
Publicado: (2025)
por: Jiang, Zhihan, et al.
Publicado: (2025)
SPES: Towards Optimizing Performance-Resource Trade-Off for Serverless Functions
por: Lee, Cheryl, et al.
Publicado: (2024)
por: Lee, Cheryl, et al.
Publicado: (2024)
ShuffleBench: A Benchmark for Large-Scale Data Shuffling Operations with Distributed Stream Processing Frameworks
por: Henning, Sören, et al.
Publicado: (2024)
por: Henning, Sören, et al.
Publicado: (2024)
CARISMA: CAR-Integrated Service Mesh Architecture
por: Klein, Kevin, et al.
Publicado: (2024)
por: Klein, Kevin, et al.
Publicado: (2024)
A Comprehensive Benchmarking Analysis of Fault Recovery in Stream Processing Frameworks
por: Vogel, Adriano, et al.
Publicado: (2024)
por: Vogel, Adriano, et al.
Publicado: (2024)
Building Castles in the Cloud: Architecting Resilient and Scalable Infrastructure
por: Gundla, Naresh Kumar
Publicado: (2024)
por: Gundla, Naresh Kumar
Publicado: (2024)
A Scalable Clustered Architecture for Cyber-Physical Systems
por: Cabral, Bernardo
Publicado: (2024)
por: Cabral, Bernardo
Publicado: (2024)
AI-NativeBench: An Open-Source White-Box Agentic Benchmark Suite for AI-Native Systems
por: Wang, Zirui, et al.
Publicado: (2026)
por: Wang, Zirui, et al.
Publicado: (2026)
MegaFlow: Large-Scale Distributed Orchestration System for the Agentic Era
por: Zhang, Lei, et al.
Publicado: (2026)
por: Zhang, Lei, et al.
Publicado: (2026)
ExaWorks Software Development Kit: A Robust and Scalable Collection of Interoperable Workflow Technologies
por: Turilli, Matteo, et al.
Publicado: (2024)
por: Turilli, Matteo, et al.
Publicado: (2024)
Model-guided Fuzzing of Distributed Systems
por: Gulcan, Ege Berkay, et al.
Publicado: (2024)
por: Gulcan, Ege Berkay, et al.
Publicado: (2024)
LLM-HPC++: Evaluating LLM-Generated Modern C++ and MPI+OpenMP Codes for Scalable Mandelbrot Set Computation
por: Diehl, Patrick, et al.
Publicado: (2025)
por: Diehl, Patrick, et al.
Publicado: (2025)
Efficiently Reproducing Distributed Workflows in Notebook-based Systems
por: Azaz, Talha, et al.
Publicado: (2026)
por: Azaz, Talha, et al.
Publicado: (2026)
Multi-Grained Specifications for Distributed System Model Checking and Verification
por: Ouyang, Lingzhi, et al.
Publicado: (2024)
por: Ouyang, Lingzhi, et al.
Publicado: (2024)
Configurable Runtime Orchestration for Dynamic Data Retrieval in Distributed Systems
por: Kandiraju, Abhiram
Publicado: (2026)
por: Kandiraju, Abhiram
Publicado: (2026)
A Survey on Failure Analysis and Fault Injection in AI Systems
por: Yu, Guangba, et al.
Publicado: (2024)
por: Yu, Guangba, et al.
Publicado: (2024)
A Lightweight Hybrid Publish/Subscribe Event Fabric for IPC and Modular Distributed Systems
por: Gkoulis, Dimitris
Publicado: (2026)
por: Gkoulis, Dimitris
Publicado: (2026)
AI for Distributed Systems Design: Scalable Cloud Optimization Through Repeated LLMs Sampling And Simulators
por: Tagliabue, Jacopo
Publicado: (2025)
por: Tagliabue, Jacopo
Publicado: (2025)
High-level Stream Processing: A Complementary Analysis of Fault Recovery
por: Vogel, Adriano, et al.
Publicado: (2024)
por: Vogel, Adriano, et al.
Publicado: (2024)
gFaaS: Enabling Generic Functions in Serverless Computing
por: Chadha, Mohak, et al.
Publicado: (2024)
por: Chadha, Mohak, et al.
Publicado: (2024)
When Should I Run My Application Benchmark?: Studying Cloud Performance Variability for the Case of Stream Processing Applications
por: Henning, Sören, et al.
Publicado: (2025)
por: Henning, Sören, et al.
Publicado: (2025)
ATOM: Asynchronous Training of Massive Models for Deep Learning in a Decentralized Environment
por: Wu, Xiaofeng, et al.
Publicado: (2024)
por: Wu, Xiaofeng, et al.
Publicado: (2024)
From Edge to HPC: Investigating Cross-Facility Data Streaming Architectures
por: George, Anjus, et al.
Publicado: (2025)
por: George, Anjus, et al.
Publicado: (2025)
Large Language Models as Realistic Microservice Trace Generators
por: Kim, Donghyun, et al.
Publicado: (2024)
por: Kim, Donghyun, et al.
Publicado: (2024)
Evaluating Asynchronous Semantics in Trace-Discovered Resilience Models: A Case Study on the OpenTelemetry Demo
por: Krasnovsky, Anatoly A.
Publicado: (2025)
por: Krasnovsky, Anatoly A.
Publicado: (2025)
Supercharging Federated Learning with Flower and NVIDIA FLARE
por: Roth, Holger R., et al.
Publicado: (2024)
por: Roth, Holger R., et al.
Publicado: (2024)
Wherefore Art Thou? Provenance-Guided Automatic Online Debugging with Lumos
por: Chen, Jingyuan, et al.
Publicado: (2026)
por: Chen, Jingyuan, et al.
Publicado: (2026)
MPI Errors Detection using GNN Embedding and Vector Embedding over LLVM IR
por: Karchi, Jad El, et al.
Publicado: (2024)
por: Karchi, Jad El, et al.
Publicado: (2024)
AlertGuardian: Intelligent Alert Life-Cycle Management for Large-scale Cloud Systems
por: Yu, Guangba, et al.
Publicado: (2026)
por: Yu, Guangba, et al.
Publicado: (2026)
Prink: $k_s$-Anonymization for Streaming Data in Apache Flink
por: Groneberg, Philip, et al.
Publicado: (2025)
por: Groneberg, Philip, et al.
Publicado: (2025)
Optimizing OpenFaaS on Kubernetes: Comparative Analysis of Language Runtimes and Cluster Distributions
por: Ataie, Ehsan, et al.
Publicado: (2026)
por: Ataie, Ehsan, et al.
Publicado: (2026)
CodeAD: Synthesize Code of Rules for Log-based Anomaly Detection with LLMs
por: Huang, Junjie, et al.
Publicado: (2025)
por: Huang, Junjie, et al.
Publicado: (2025)
SeBS-Flow: Benchmarking Serverless Cloud Function Workflows
por: Schmid, Larissa, et al.
Publicado: (2024)
por: Schmid, Larissa, et al.
Publicado: (2024)
CloudHeatMap: Heatmap-Based Monitoring for Large-Scale Cloud Systems
por: Sohana, Sarah, et al.
Publicado: (2024)
por: Sohana, Sarah, et al.
Publicado: (2024)
Adaptable TeaStore
por: Bliudze, Simon, et al.
Publicado: (2024)
por: Bliudze, Simon, et al.
Publicado: (2024)
Histrio: a Serverless Actor System
por: Buttiglieri, Giorgio Natale, et al.
Publicado: (2024)
por: Buttiglieri, Giorgio Natale, et al.
Publicado: (2024)
Carbon-aware Software Services
por: Forti, Stefano, et al.
Publicado: (2024)
por: Forti, Stefano, et al.
Publicado: (2024)
Learning Recovery Strategies for Dynamic Self-healing in Reactive Systems
por: Sanabria, Mateo, et al.
Publicado: (2024)
por: Sanabria, Mateo, et al.
Publicado: (2024)
LLOR: Automated Repair of OpenMP Programs
por: Bora, Utpal, et al.
Publicado: (2024)
por: Bora, Utpal, et al.
Publicado: (2024)
Ejemplares similares
-
Metronome: Differentiated Delay Scheduling for Serverless Functions
por: Chen, Zhuangbin, et al.
Publicado: (2025) -
L4: Diagnosing Large-scale LLM Training Failures via Automated Log Analysis
por: Jiang, Zhihan, et al.
Publicado: (2025) -
SPES: Towards Optimizing Performance-Resource Trade-Off for Serverless Functions
por: Lee, Cheryl, et al.
Publicado: (2024) -
ShuffleBench: A Benchmark for Large-Scale Data Shuffling Operations with Distributed Stream Processing Frameworks
por: Henning, Sören, et al.
Publicado: (2024) -
CARISMA: CAR-Integrated Service Mesh Architecture
por: Klein, Kevin, et al.
Publicado: (2024)