LLAMP: Assessing Network Latency Tolerance of HPC Applications with Linear Programming
Fuente:
arXiv
Salvato in:
| Autori principali: | Shen, Siyuan, Huang, Langwen, Chrapek, Marcin, Schneider, Timo, Dayal, Jai, Gajbe, Manisha, Wisniewski, Robert, Hoefler, Torsten |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FPsPIN: An FPGA-based Open-Hardware Research Platform for Processing in the Network
di: Schneider, Timo, et al.
Pubblicazione: (2024)
di: Schneider, Timo, et al.
Pubblicazione: (2024)
EDAN: Towards Understanding Memory Parallelism and Latency Sensitivity in HPC
di: Shen, Siyuan, et al.
Pubblicazione: (2025)
di: Shen, Siyuan, et al.
Pubblicazione: (2025)
Software Resource Disaggregation for HPC with Serverless Computing
di: Copik, Marcin, et al.
Pubblicazione: (2024)
di: Copik, Marcin, et al.
Pubblicazione: (2024)
Inductive Loop Analysis for Practical HPC Application Optimization
di: Schaad, Philipp, et al.
Pubblicazione: (2025)
di: Schaad, Philipp, et al.
Pubblicazione: (2025)
Performance Analysis of HPC applications on the Aurora Supercomputer: Exploring the Impact of HBM-Enabled Intel Xeon Max CPUs
di: Ibeid, Huda, et al.
Pubblicazione: (2025)
di: Ibeid, Huda, et al.
Pubblicazione: (2025)
EvalNet: A Practical Toolchain for Generation and Analysis of Extreme-Scale Interconnects
di: Besta, Maciej, et al.
Pubblicazione: (2021)
di: Besta, Maciej, et al.
Pubblicazione: (2021)
Wattlytics: A Web Platform for Co-Optimizing Performance, Energy, and TCO in HPC Clusters
di: Afzal, Ayesha, et al.
Pubblicazione: (2026)
di: Afzal, Ayesha, et al.
Pubblicazione: (2026)
Hazel: Secure and Efficient Disaggregated Storage
di: Chrapek, Marcin, et al.
Pubblicazione: (2025)
di: Chrapek, Marcin, et al.
Pubblicazione: (2025)
ADELIA: Automatic Differentiation for Efficient Laplace Inference Approximations
di: Boudaoud, Afif, et al.
Pubblicazione: (2026)
di: Boudaoud, Afif, et al.
Pubblicazione: (2026)
PICO: Performance Insights for Collective Operations
di: Pasqualoni, Saverio, et al.
Pubblicazione: (2025)
di: Pasqualoni, Saverio, et al.
Pubblicazione: (2025)
Iterating Pointers: Enabling Static Analysis for Loop-based Pointers
di: Lepori, Andrea, et al.
Pubblicazione: (2025)
di: Lepori, Andrea, et al.
Pubblicazione: (2025)
GigaAPI for GPU Parallelization
di: Suvarna, M., et al.
Pubblicazione: (2025)
di: Suvarna, M., et al.
Pubblicazione: (2025)
UPMEM Unleashed: Software Secrets for Speed
di: Chmielewski, Krystian, et al.
Pubblicazione: (2025)
di: Chmielewski, Krystian, et al.
Pubblicazione: (2025)
Dissecting the NVIDIA Hopper Architecture through Microbenchmarking and Multiple Level Analysis
di: Luo, Weile, et al.
Pubblicazione: (2025)
di: Luo, Weile, et al.
Pubblicazione: (2025)
Experimental Assessment of Containers Running on Top of Virtual Machines
di: Aqasizade, Hossein, et al.
Pubblicazione: (2024)
di: Aqasizade, Hossein, et al.
Pubblicazione: (2024)
Compiler Support for Speculation in Decoupled Access/Execute Architectures
di: Szafarczyk, Robert, et al.
Pubblicazione: (2025)
di: Szafarczyk, Robert, et al.
Pubblicazione: (2025)
Profiling Concurrent Vision Inference Workloads on NVIDIA Jetson -- Extended
di: Chakraborty, Abhinaba, et al.
Pubblicazione: (2025)
di: Chakraborty, Abhinaba, et al.
Pubblicazione: (2025)
Exploring and Evaluating Real-world CXL: Use Cases and System Adoption
di: Wang, Xi, et al.
Pubblicazione: (2024)
di: Wang, Xi, et al.
Pubblicazione: (2024)
Parallelizing a modern GPU simulator
di: Huerta, Rodrigo, et al.
Pubblicazione: (2025)
di: Huerta, Rodrigo, et al.
Pubblicazione: (2025)
Can Asymmetric Tile Buffering Be Beneficial?
di: Wang, Chengyue, et al.
Pubblicazione: (2025)
di: Wang, Chengyue, et al.
Pubblicazione: (2025)
Exploiting long vectors with a CFD code: a co-design show case
di: Blancafort, Marc, et al.
Pubblicazione: (2024)
di: Blancafort, Marc, et al.
Pubblicazione: (2024)
Fusing Depthwise and Pointwise Convolutions for Efficient Inference on GPUs
di: Qararyah, Fareed, et al.
Pubblicazione: (2024)
di: Qararyah, Fareed, et al.
Pubblicazione: (2024)
Simopt -- Simulation pass for Speculative Optimisation of FPGA-CAD flow
di: Wadhwa, Eashan, et al.
Pubblicazione: (2024)
di: Wadhwa, Eashan, et al.
Pubblicazione: (2024)
OSMOSIS: Enabling Multi-Tenancy in Datacenter SmartNICs
di: Khalilov, Mikhail, et al.
Pubblicazione: (2023)
di: Khalilov, Mikhail, et al.
Pubblicazione: (2023)
Usability Evaluation of Cloud for HPC Applications
di: Sochat, Vanessa, et al.
Pubblicazione: (2025)
di: Sochat, Vanessa, et al.
Pubblicazione: (2025)
Denoising Application Performance Models with Noise-Resilient Priors
di: de Morais, Gustavo, et al.
Pubblicazione: (2025)
di: de Morais, Gustavo, et al.
Pubblicazione: (2025)
Ultra Ethernet's Design Principles and Architectural Innovations
di: Hoefler, Torsten, et al.
Pubblicazione: (2025)
di: Hoefler, Torsten, et al.
Pubblicazione: (2025)
Extrae.jl: Julia bindings for the Extrae HPC Profiler
di: Sanchez-Ramirez, Sergio, et al.
Pubblicazione: (2025)
di: Sanchez-Ramirez, Sergio, et al.
Pubblicazione: (2025)
CrossPipe: Towards Optimal Pipeline Schedules for Cross-Datacenter Training
di: Chen, Tiancheng, et al.
Pubblicazione: (2025)
di: Chen, Tiancheng, et al.
Pubblicazione: (2025)
Linear Layouts: Robust Code Generation of Efficient Tensor Computation Using $\mathbb{F}_2$
di: Zhou, Keren, et al.
Pubblicazione: (2025)
di: Zhou, Keren, et al.
Pubblicazione: (2025)
LLload: Simplifying Real-Time Job Monitoring for HPC Users
di: Byun, Chansup, et al.
Pubblicazione: (2024)
di: Byun, Chansup, et al.
Pubblicazione: (2024)
Optimizing Communication for Latency Sensitive HPC Applications on up to 48 FPGAs Using ACCL
di: Meyer, Marius, et al.
Pubblicazione: (2024)
di: Meyer, Marius, et al.
Pubblicazione: (2024)
TAPA: A Scalable Task-Parallel Dataflow Programming Framework for Modern FPGAs with Co-Optimization of HLS and Physical Design
di: Guo, Licheng, et al.
Pubblicazione: (2022)
di: Guo, Licheng, et al.
Pubblicazione: (2022)
Evaluating HPC-Style CPU Performance and Cost in Virtualized Cloud Infrastructures
di: Tharwani, Jay, et al.
Pubblicazione: (2025)
di: Tharwani, Jay, et al.
Pubblicazione: (2025)
Operational Strategies for Non-Disruptive Scheduling Transitions in Production HPC Systems
di: MacLachlan, Glen, et al.
Pubblicazione: (2026)
di: MacLachlan, Glen, et al.
Pubblicazione: (2026)
The Hitchhiker's Guide to Programming and Optimizing Cache Coherent Heterogeneous Systems: CXL, NVLink-C2C, and AMD Infinity Fabric
di: Wang, Zixuan, et al.
Pubblicazione: (2024)
di: Wang, Zixuan, et al.
Pubblicazione: (2024)
Understanding Data Movement in Tightly Coupled Heterogeneous Systems: A Case Study with the Grace Hopper Superchip
di: Fusco, Luigi, et al.
Pubblicazione: (2024)
di: Fusco, Luigi, et al.
Pubblicazione: (2024)
Preliminary report: Initial evaluation of StdPar implementations on AMD GPUs for HPC
di: Lin, Wei-Chen, et al.
Pubblicazione: (2024)
di: Lin, Wei-Chen, et al.
Pubblicazione: (2024)
Minos: Systematically Classifying Performance and Power Characteristics of GPU Workloads on HPC Clusters
di: Jain, Rutwik, et al.
Pubblicazione: (2026)
di: Jain, Rutwik, et al.
Pubblicazione: (2026)
Vector-Centric Machine Learning Systems: A Cross-Stack Approach
di: Jiang, Wenqi
Pubblicazione: (2025)
di: Jiang, Wenqi
Pubblicazione: (2025)
Documenti analoghi
-
FPsPIN: An FPGA-based Open-Hardware Research Platform for Processing in the Network
di: Schneider, Timo, et al.
Pubblicazione: (2024) -
EDAN: Towards Understanding Memory Parallelism and Latency Sensitivity in HPC
di: Shen, Siyuan, et al.
Pubblicazione: (2025) -
Software Resource Disaggregation for HPC with Serverless Computing
di: Copik, Marcin, et al.
Pubblicazione: (2024) -
Inductive Loop Analysis for Practical HPC Application Optimization
di: Schaad, Philipp, et al.
Pubblicazione: (2025) -
Performance Analysis of HPC applications on the Aurora Supercomputer: Exploring the Impact of HBM-Enabled Intel Xeon Max CPUs
di: Ibeid, Huda, et al.
Pubblicazione: (2025)