Enregistré dans:
| Auteurs principaux: | Zarkadas, Ioannis, Tomlinson, Amanda, Cidon, Asaf, Kasikci, Baris, Weisse, Ofir |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2503.14781 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
An Auto-tuning Method for Run-time Data Transformation for Sparse Matrix-Vector Multiplication
par: Katagiri, Takahiro, et autres
Publié: (2024)
par: Katagiri, Takahiro, et autres
Publié: (2024)
A Comparison of the Performance of the Molecular Dynamics Simulation Package GROMACS Implemented in the SYCL and CUDA Programming Models
par: Apanasevich, L., et autres
Publié: (2024)
par: Apanasevich, L., et autres
Publié: (2024)
PlantD: Performance, Latency ANalysis, and Testing for Data Pipelines -- An Open Source Measurement, Testing, and Simulation Framework
par: Bogart, Christopher, et autres
Publié: (2025)
par: Bogart, Christopher, et autres
Publié: (2025)
Modeling the Impact of Fiber Latency on Compute-Communication Overlap in Geo-Distributed Multi-Datacenter AI Training
par: Papavasileiou, Ioannis, et autres
Publié: (2026)
par: Papavasileiou, Ioannis, et autres
Publié: (2026)
When Should I Run My Application Benchmark?: Studying Cloud Performance Variability for the Case of Stream Processing Applications
par: Henning, Sören, et autres
Publié: (2025)
par: Henning, Sören, et autres
Publié: (2025)
Cloud Performance Decomposition for Long-Term Performance Engineering: A Case Study
par: Debnath, Shimul, et autres
Publié: (2026)
par: Debnath, Shimul, et autres
Publié: (2026)
LLload: Simplifying Real-Time Job Monitoring for HPC Users
par: Byun, Chansup, et autres
Publié: (2024)
par: Byun, Chansup, et autres
Publié: (2024)
Reducing Tail Latencies Through Environment- and Neighbour-aware Thread Management
par: Jeffery, Andrew, et autres
Publié: (2024)
par: Jeffery, Andrew, et autres
Publié: (2024)
Experimental Assessment of Containers Running on Top of Virtual Machines
par: Aqasizade, Hossein, et autres
Publié: (2024)
par: Aqasizade, Hossein, et autres
Publié: (2024)
PICO: Performance Insights for Collective Operations
par: Pasqualoni, Saverio, et autres
Publié: (2025)
par: Pasqualoni, Saverio, et autres
Publié: (2025)
CGSim: A Simulation Framework for Large Scale Distributed Computing Environment
par: Vatsavai, Sairam Sri, et autres
Publié: (2025)
par: Vatsavai, Sairam Sri, et autres
Publié: (2025)
Automated Calibration of Parallel and Distributed Computing Simulators: A Case Study
par: McDonald, Jesse, et autres
Publié: (2024)
par: McDonald, Jesse, et autres
Publié: (2024)
Unleashing the Power of Preemptive Priority-based Scheduling for Real-Time GPU Tasks
par: Wang, Yidi, et autres
Publié: (2024)
par: Wang, Yidi, et autres
Publié: (2024)
Should I Run My Cloud Benchmark on Black Friday?
par: Henning, Sören, et autres
Publié: (2025)
par: Henning, Sören, et autres
Publié: (2025)
A Performance Analysis of BFT Consensus for Blockchains
par: Chan, J. D., et autres
Publié: (2024)
par: Chan, J. D., et autres
Publié: (2024)
Scalable GPU Performance Variability Analysis framework
par: Lahiry, Ankur, et autres
Publié: (2025)
par: Lahiry, Ankur, et autres
Publié: (2025)
Automated Programmatic Performance Analysis of Parallel Programs
par: Cankur, Onur, et autres
Publié: (2024)
par: Cankur, Onur, et autres
Publié: (2024)
BurstGPT: A Real-world Workload Dataset to Optimize LLM Serving Systems
par: Wang, Yuxin, et autres
Publié: (2024)
par: Wang, Yuxin, et autres
Publié: (2024)
Temporal Load Imbalance on Ondes3D Seismic Simulator for Different Multicore Architectures
par: Solórzano, Ana Luisa Veroneze, et autres
Publié: (2024)
par: Solórzano, Ana Luisa Veroneze, et autres
Publié: (2024)
Performance Debugging through Microarchitectural Sensitivity and Causality Analysis
par: Dutilleul, Alban, et autres
Publié: (2024)
par: Dutilleul, Alban, et autres
Publié: (2024)
Denoising Application Performance Models with Noise-Resilient Priors
par: de Morais, Gustavo, et autres
Publié: (2025)
par: de Morais, Gustavo, et autres
Publié: (2025)
Kubernetes in Action: Exploring the Performance of Kubernetes Distributions in the Cloud
par: Aqasizade, Hossein, et autres
Publié: (2024)
par: Aqasizade, Hossein, et autres
Publié: (2024)
Performance Impact of Containerized METADOCK 2 on Heterogeneous Platforms
par: Banegas-Luna, Antonio Jesús, et autres
Publié: (2025)
par: Banegas-Luna, Antonio Jesús, et autres
Publié: (2025)
Taking GPU Programming Models to Task for Performance Portability
par: Davis, Joshua H., et autres
Publié: (2024)
par: Davis, Joshua H., et autres
Publié: (2024)
eBPF-Based Instrumentation for Generalisable Diagnosis of Performance Degradation
par: Landau, Diogo, et autres
Publié: (2025)
par: Landau, Diogo, et autres
Publié: (2025)
KEET: Explaining Performance of GPU Kernels Using LLM Agents
par: Davis, Joshua H., et autres
Publié: (2026)
par: Davis, Joshua H., et autres
Publié: (2026)
Counting Without Running: Evaluating LLMs' Reasoning About Code Complexity
par: Bolet, Gregory, et autres
Publié: (2025)
par: Bolet, Gregory, et autres
Publié: (2025)
High-Performance Portable GPU Primitives for Arbitrary Types and Operators in Julia
par: Pilliat, Emmanuel
Publié: (2026)
par: Pilliat, Emmanuel
Publié: (2026)
SProBench: Stream Processing Benchmark for High Performance Computing Infrastructure
par: Kulkarni, Apurv Deepak, et autres
Publié: (2025)
par: Kulkarni, Apurv Deepak, et autres
Publié: (2025)
Understanding Inference Scaling for LLMs: Bottlenecks, Trade-offs, and Performance Principles
par: Arif, Moiz, et autres
Publié: (2026)
par: Arif, Moiz, et autres
Publié: (2026)
GROMACS Unplugged: How Power Capping and Frequency Shapes Performance on GPUs
par: Afzal, Ayesha, et autres
Publié: (2025)
par: Afzal, Ayesha, et autres
Publié: (2025)
Scalable Systems and Software Architectures for High-Performance Computing on cloud platforms
par: Ramesh, Risshab Srinivas
Publié: (2024)
par: Ramesh, Risshab Srinivas
Publié: (2024)
Enhancing Performance Insight at Scale: A Heterogeneous Framework for Exascale Diagnostics
par: Grbic, Dragana
Publié: (2026)
par: Grbic, Dragana
Publié: (2026)
Evaluating HPC-Style CPU Performance and Cost in Virtualized Cloud Infrastructures
par: Tharwani, Jay, et autres
Publié: (2025)
par: Tharwani, Jay, et autres
Publié: (2025)
Performance optimization of BLAS algorithms with band matrices for RISC-V processors
par: Pirova, Anna, et autres
Publié: (2025)
par: Pirova, Anna, et autres
Publié: (2025)
Towards High-Performance and Portable Molecular Docking on CPUs through Vectorization
par: Accordi, Gianmarco, et autres
Publié: (2025)
par: Accordi, Gianmarco, et autres
Publié: (2025)
RAID Organizations for Improved Reliability and Performance: A Not Entirely Unbiased Tutorial
par: Thomasian, Alexander
Publié: (2023)
par: Thomasian, Alexander
Publié: (2023)
Minos: Systematically Classifying Performance and Power Characteristics of GPU Workloads on HPC Clusters
par: Jain, Rutwik, et autres
Publié: (2026)
par: Jain, Rutwik, et autres
Publié: (2026)
Beyond Thread States: Diagnosing Performance Degradation with eBPF and Thread Dynamics
par: Landau, Diogo, et autres
Publié: (2026)
par: Landau, Diogo, et autres
Publié: (2026)
Cost-Performance Evaluation of General Compute Instances: AWS, Azure, GCP, and OCI
par: Tharwani, Jay, et autres
Publié: (2024)
par: Tharwani, Jay, et autres
Publié: (2024)
Documents similaires
-
An Auto-tuning Method for Run-time Data Transformation for Sparse Matrix-Vector Multiplication
par: Katagiri, Takahiro, et autres
Publié: (2024) -
A Comparison of the Performance of the Molecular Dynamics Simulation Package GROMACS Implemented in the SYCL and CUDA Programming Models
par: Apanasevich, L., et autres
Publié: (2024) -
PlantD: Performance, Latency ANalysis, and Testing for Data Pipelines -- An Open Source Measurement, Testing, and Simulation Framework
par: Bogart, Christopher, et autres
Publié: (2025) -
Modeling the Impact of Fiber Latency on Compute-Communication Overlap in Geo-Distributed Multi-Datacenter AI Training
par: Papavasileiou, Ioannis, et autres
Publié: (2026) -
When Should I Run My Application Benchmark?: Studying Cloud Performance Variability for the Case of Stream Processing Applications
par: Henning, Sören, et autres
Publié: (2025)