JANUS: Resilient and Adaptive Data Transmission for Enabling Timely and Efficient Cross-Facility Scientific Workflows
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Esaulov, Vladislav, Chen, Jieyang, Podhorszki, Norbert, Suter, Fred, Klasky, Scott, Bourgeois, Anu G, Wan, Lipeng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HPDR: High-Performance Portable Scientific Data Reduction Framework
par: Chen, Jieyang, et autres
Publié: (2025)
par: Chen, Jieyang, et autres
Publié: (2025)
Error-controlled Progressive Retrieval of Scientific Data under Derivable Quantities of Interest
par: Wu, Xuan, et autres
Publié: (2024)
par: Wu, Xuan, et autres
Publié: (2024)
CGSim: A Simulation Framework for Large Scale Distributed Computing Environment
par: Vatsavai, Sairam Sri, et autres
Publié: (2025)
par: Vatsavai, Sairam Sri, et autres
Publié: (2025)
Enabling High-Throughput Parallel I/O in Particle-in-Cell Monte Carlo Simulations with openPMD and Darshan I/O Monitoring
par: Williams, Jeremy J., et autres
Publié: (2024)
par: Williams, Jeremy J., et autres
Publié: (2024)
HP-MDR: High-performance and Portable Data Refactoring and Progressive Retrieval with Advanced GPUs
par: Li, Yanliang, et autres
Publié: (2025)
par: Li, Yanliang, et autres
Publié: (2025)
Automated Calibration of Parallel and Distributed Computing Simulators: A Case Study
par: McDonald, Jesse, et autres
Publié: (2024)
par: McDonald, Jesse, et autres
Publié: (2024)
Characterizing Adaptive Mesh Refinement on Heterogeneous Platforms with Parthenon-VIBE
par: Poptani, Akash, et autres
Publié: (2025)
par: Poptani, Akash, et autres
Publié: (2025)
FACT: Compositional Kernel Synthesis with a Three-Stage Agentic Workflow
par: Heidari, Sina, et autres
Publié: (2026)
par: Heidari, Sina, et autres
Publié: (2026)
QoSFlow: Ensuring Service Quality of Distributed Workflows Using Interpretable Sensitivity Models
par: Rashid, Md Hasanur, et autres
Publié: (2026)
par: Rashid, Md Hasanur, et autres
Publié: (2026)
Denoising Application Performance Models with Noise-Resilient Priors
par: de Morais, Gustavo, et autres
Publié: (2025)
par: de Morais, Gustavo, et autres
Publié: (2025)
RAPID-LLM: Resilience-Aware Performance analysis of Infrastructure for Distributed LLM Training and Inference
par: Karfakis, George, et autres
Publié: (2025)
par: Karfakis, George, et autres
Publié: (2025)
Comprehensive Plugin-Based Monitoring of Nexflow Workflow Executions
par: Kharma, Sami, et autres
Publié: (2026)
par: Kharma, Sami, et autres
Publié: (2026)
CARAT: Client-Side Adaptive RPC and Cache Co-Tuning for Parallel File Systems
par: Rashid, Md Hasanur, et autres
Publié: (2026)
par: Rashid, Md Hasanur, et autres
Publié: (2026)
LEO: Tracing GPU Stall Root Causes via Cross-Vendor Backward Slicing
par: Xia, Yuning, et autres
Publié: (2026)
par: Xia, Yuning, et autres
Publié: (2026)
AcceleratedKernels.jl: Cross-Architecture Parallel Algorithms from a Unified, Transpiled Codebase
par: Nicusan, Andrei-Leonard, et autres
Publié: (2025)
par: Nicusan, Andrei-Leonard, et autres
Publié: (2025)
AARC: Automated Affinity-aware Resource Configuration for Serverless Workflows
par: Jin, Lingxiao, et autres
Publié: (2025)
par: Jin, Lingxiao, et autres
Publié: (2025)
Towards Portability at Scale: A Cross-Architecture Performance Evaluation of a GPU-enabled Shallow Water Solver
par: Villalobos, Johansell, et autres
Publié: (2025)
par: Villalobos, Johansell, et autres
Publié: (2025)
Iterating Pointers: Enabling Static Analysis for Loop-based Pointers
par: Lepori, Andrea, et autres
Publié: (2025)
par: Lepori, Andrea, et autres
Publié: (2025)
Extracting Practical, Actionable Energy Insights from Supercomputer Telemetry and Logs
par: Cornelius, Melanie, et autres
Publié: (2025)
par: Cornelius, Melanie, et autres
Publié: (2025)
Scaling Large-scale GNN Training to Thousands of Processors on CPU-based Supercomputers
par: Zhuang, Chen, et autres
Publié: (2024)
par: Zhuang, Chen, et autres
Publié: (2024)
Profiling and optimization of multi-card GPU machine learning jobs
par: Lawenda, Marcin, et autres
Publié: (2025)
par: Lawenda, Marcin, et autres
Publié: (2025)
Optimal Parallel Scheduling under Concave Speedup Functions
par: Li, Chengzhang, et autres
Publié: (2025)
par: Li, Chengzhang, et autres
Publié: (2025)
WebAssembly and Unikernels: A Comparative Study for Serverless at the Edge
par: Besozzi, Valerio, et autres
Publié: (2025)
par: Besozzi, Valerio, et autres
Publié: (2025)
Efficient GPU-Centered Singular Value Decomposition Using the Divide-and-Conquer Method
par: Liu, Shifang, et autres
Publié: (2025)
par: Liu, Shifang, et autres
Publié: (2025)
Resource Management Schemes for Cloud-Native Platforms with Computing Containers of Docker and Kubernetes
par: Mao, Ying, et autres
Publié: (2020)
par: Mao, Ying, et autres
Publié: (2020)
Staging Blocked Evaluation over Structured Sparse Matrices
par: Das, Pratyush, et autres
Publié: (2024)
par: Das, Pratyush, et autres
Publié: (2024)
Cloud Performance Decomposition for Long-Term Performance Engineering: A Case Study
par: Debnath, Shimul, et autres
Publié: (2026)
par: Debnath, Shimul, et autres
Publié: (2026)
Collaborative Processing for Multi-Tenant Inference on Memory-Constrained Edge TPUs
par: Ng, Nathan, et autres
Publié: (2026)
par: Ng, Nathan, et autres
Publié: (2026)
Preliminary report: Initial evaluation of StdPar implementations on AMD GPUs for HPC
par: Lin, Wei-Chen, et autres
Publié: (2024)
par: Lin, Wei-Chen, et autres
Publié: (2024)
Serving Chain-structured Jobs with Large Memory Footprints with Application to Large Foundation Model Serving
par: Sun, Tingyang, et autres
Publié: (2026)
par: Sun, Tingyang, et autres
Publié: (2026)
Reducing Tail Latencies Through Environment- and Neighbour-aware Thread Management
par: Jeffery, Andrew, et autres
Publié: (2024)
par: Jeffery, Andrew, et autres
Publié: (2024)
Dissecting the software-based measurement of CPU energy consumption: a comparative analysis
par: Raffin, Guillaume, et autres
Publié: (2024)
par: Raffin, Guillaume, et autres
Publié: (2024)
Bridding OT and PaaS in Edge-to-Cloud Continuum
par: Barrios, Carlos J, et autres
Publié: (2025)
par: Barrios, Carlos J, et autres
Publié: (2025)
Minos: Systematically Classifying Performance and Power Characteristics of GPU Workloads on HPC Clusters
par: Jain, Rutwik, et autres
Publié: (2026)
par: Jain, Rutwik, et autres
Publié: (2026)
Hardware-Agnostic and Insightful Efficiency Metrics for Accelerated Systems: Definition and Implementation within TALP
par: Rahimi, Ghazal, et autres
Publié: (2026)
par: Rahimi, Ghazal, et autres
Publié: (2026)
Node Compass: Multilevel Tracing and Debugging of Request Executions in JavaScript-Based Web-Servers
par: Kabamba, Herve Mbikayi, et autres
Publié: (2023)
par: Kabamba, Herve Mbikayi, et autres
Publié: (2023)
Beyond Thread States: Diagnosing Performance Degradation with eBPF and Thread Dynamics
par: Landau, Diogo, et autres
Publié: (2026)
par: Landau, Diogo, et autres
Publié: (2026)
Asymptotically Optimal Scheduling of Multiple Parallelizable Job Classes
par: Berg, Benjamin, et autres
Publié: (2024)
par: Berg, Benjamin, et autres
Publié: (2024)
High-Performance Portable GPU Primitives for Arbitrary Types and Operators in Julia
par: Pilliat, Emmanuel
Publié: (2026)
par: Pilliat, Emmanuel
Publié: (2026)
SmartWatts: Self-Calibrating Software-Defined Power Meter for Containers
par: Fieni, Guillaume, et autres
Publié: (2020)
par: Fieni, Guillaume, et autres
Publié: (2020)
Documents similaires
-
HPDR: High-Performance Portable Scientific Data Reduction Framework
par: Chen, Jieyang, et autres
Publié: (2025) -
Error-controlled Progressive Retrieval of Scientific Data under Derivable Quantities of Interest
par: Wu, Xuan, et autres
Publié: (2024) -
CGSim: A Simulation Framework for Large Scale Distributed Computing Environment
par: Vatsavai, Sairam Sri, et autres
Publié: (2025) -
Enabling High-Throughput Parallel I/O in Particle-in-Cell Monte Carlo Simulations with openPMD and Darshan I/O Monitoring
par: Williams, Jeremy J., et autres
Publié: (2024) -
HP-MDR: High-performance and Portable Data Refactoring and Progressive Retrieval with Advanced GPUs
par: Li, Yanliang, et autres
Publié: (2025)