A Practical Two-Stage Framework for GPU Resource and Power Prediction in Heterogeneous HPC Systems
Fuente:
arXiv
Salvato in:
| Autori principali: | Oztop, Beste, Kulkarni, Dhruva, Zhao, Zhengji, Coskun, Ayse Kivilcim, Konate, Kadidia |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Minos: Systematically Classifying Performance and Power Characteristics of GPU Workloads on HPC Clusters
di: Jain, Rutwik, et al.
Pubblicazione: (2026)
di: Jain, Rutwik, et al.
Pubblicazione: (2026)
Inductive Loop Analysis for Practical HPC Application Optimization
di: Schaad, Philipp, et al.
Pubblicazione: (2025)
di: Schaad, Philipp, et al.
Pubblicazione: (2025)
Understanding Power Consumption Metric on Heterogeneous Memory Systems
di: Proaño, Andrès Rubio, et al.
Pubblicazione: (2024)
di: Proaño, Andrès Rubio, et al.
Pubblicazione: (2024)
On the Partitioning of GPU Power among Multi-Instances
di: Vamja, Tirth, et al.
Pubblicazione: (2025)
di: Vamja, Tirth, et al.
Pubblicazione: (2025)
Operational Strategies for Non-Disruptive Scheduling Transitions in Production HPC Systems
di: MacLachlan, Glen, et al.
Pubblicazione: (2026)
di: MacLachlan, Glen, et al.
Pubblicazione: (2026)
Data-Driven Analysis to Understand GPU Hardware Resource Usage of Optimizations
di: Islam, Tanzima Z., et al.
Pubblicazione: (2024)
di: Islam, Tanzima Z., et al.
Pubblicazione: (2024)
Usability Evaluation of Cloud for HPC Applications
di: Sochat, Vanessa, et al.
Pubblicazione: (2025)
di: Sochat, Vanessa, et al.
Pubblicazione: (2025)
Staging Blocked Evaluation over Structured Sparse Matrices
di: Das, Pratyush, et al.
Pubblicazione: (2024)
di: Das, Pratyush, et al.
Pubblicazione: (2024)
Unleashing the Power of Preemptive Priority-based Scheduling for Real-Time GPU Tasks
di: Wang, Yidi, et al.
Pubblicazione: (2024)
di: Wang, Yidi, et al.
Pubblicazione: (2024)
Parallel I/O Characterization and Optimization on Large-Scale HPC Systems: A 360-Degree Survey
di: Ather, Hammad, et al.
Pubblicazione: (2024)
di: Ather, Hammad, et al.
Pubblicazione: (2024)
Extrae.jl: Julia bindings for the Extrae HPC Profiler
di: Sanchez-Ramirez, Sergio, et al.
Pubblicazione: (2025)
di: Sanchez-Ramirez, Sergio, et al.
Pubblicazione: (2025)
LLload: Simplifying Real-Time Job Monitoring for HPC Users
di: Byun, Chansup, et al.
Pubblicazione: (2024)
di: Byun, Chansup, et al.
Pubblicazione: (2024)
"Two-Stagification": Job Dispatching in Large-Scale Clusters via a Two-Stage Architecture
di: Yildiz, Mert, et al.
Pubblicazione: (2025)
di: Yildiz, Mert, et al.
Pubblicazione: (2025)
Arkade: k-Nearest Neighbor Search With Non-Euclidean Distances using GPU Ray Tracing
di: Mandarapu, Durga, et al.
Pubblicazione: (2023)
di: Mandarapu, Durga, et al.
Pubblicazione: (2023)
Evaluating HPC-Style CPU Performance and Cost in Virtualized Cloud Infrastructures
di: Tharwani, Jay, et al.
Pubblicazione: (2025)
di: Tharwani, Jay, et al.
Pubblicazione: (2025)
An Online Probabilistic Distributed Tracing System
di: Toslali, M., et al.
Pubblicazione: (2024)
di: Toslali, M., et al.
Pubblicazione: (2024)
Preliminary report: Initial evaluation of StdPar implementations on AMD GPUs for HPC
di: Lin, Wei-Chen, et al.
Pubblicazione: (2024)
di: Lin, Wei-Chen, et al.
Pubblicazione: (2024)
HeteGen: Heterogeneous Parallel Inference for Large Language Models on Resource-Constrained Devices
di: Zhao, Xuanlei, et al.
Pubblicazione: (2024)
di: Zhao, Xuanlei, et al.
Pubblicazione: (2024)
Enhancing Performance Insight at Scale: A Heterogeneous Framework for Exascale Diagnostics
di: Grbic, Dragana
Pubblicazione: (2026)
di: Grbic, Dragana
Pubblicazione: (2026)
The Energy Cost of Execution-Idle in GPU Clusters
di: Lei, Yiran, et al.
Pubblicazione: (2026)
di: Lei, Yiran, et al.
Pubblicazione: (2026)
Scalable GPU Performance Variability Analysis framework
di: Lahiry, Ankur, et al.
Pubblicazione: (2025)
di: Lahiry, Ankur, et al.
Pubblicazione: (2025)
SProBench: Stream Processing Benchmark for High Performance Computing Infrastructure
di: Kulkarni, Apurv Deepak, et al.
Pubblicazione: (2025)
di: Kulkarni, Apurv Deepak, et al.
Pubblicazione: (2025)
THEAS: Efficient Power Management in Multi-Core CPUs via Cache-Aware Resource Scheduling
di: Muhammad, Said, et al.
Pubblicazione: (2025)
di: Muhammad, Said, et al.
Pubblicazione: (2025)
Disaggregated Design for GPU-Based Volumetric Data Structures
di: Meneghin, Massimiliano, et al.
Pubblicazione: (2025)
di: Meneghin, Massimiliano, et al.
Pubblicazione: (2025)
Taking GPU Programming Models to Task for Performance Portability
di: Davis, Joshua H., et al.
Pubblicazione: (2024)
di: Davis, Joshua H., et al.
Pubblicazione: (2024)
EfiMon: A Process Analyser for Granular Power Consumption Prediction
di: León-Vega, Luis G., et al.
Pubblicazione: (2024)
di: León-Vega, Luis G., et al.
Pubblicazione: (2024)
Profiling and optimization of multi-card GPU machine learning jobs
di: Lawenda, Marcin, et al.
Pubblicazione: (2025)
di: Lawenda, Marcin, et al.
Pubblicazione: (2025)
CUTHERMO: Understanding GPU Memory Inefficiencies with Heat Map Profiling
di: Zhao, Yanbo, et al.
Pubblicazione: (2025)
di: Zhao, Yanbo, et al.
Pubblicazione: (2025)
KEET: Explaining Performance of GPU Kernels Using LLM Agents
di: Davis, Joshua H., et al.
Pubblicazione: (2026)
di: Davis, Joshua H., et al.
Pubblicazione: (2026)
High-Performance Portable GPU Primitives for Arbitrary Types and Operators in Julia
di: Pilliat, Emmanuel
Pubblicazione: (2026)
di: Pilliat, Emmanuel
Pubblicazione: (2026)
Efficient allocation of image recognition and LLM tasks on multi-GPU system
di: Lawenda, Marcin, et al.
Pubblicazione: (2025)
di: Lawenda, Marcin, et al.
Pubblicazione: (2025)
Characterizing Production GPU Workloads using System-wide Telemetry Data
di: Cankur, Onur, et al.
Pubblicazione: (2025)
di: Cankur, Onur, et al.
Pubblicazione: (2025)
Efficient GPU-Centered Singular Value Decomposition Using the Divide-and-Conquer Method
di: Liu, Shifang, et al.
Pubblicazione: (2025)
di: Liu, Shifang, et al.
Pubblicazione: (2025)
Dissecting CPU-GPU Unified Physical Memory on AMD MI300A APUs
di: Wahlgren, Jacob, et al.
Pubblicazione: (2025)
di: Wahlgren, Jacob, et al.
Pubblicazione: (2025)
LEO: Tracing GPU Stall Root Causes via Cross-Vendor Backward Slicing
di: Xia, Yuning, et al.
Pubblicazione: (2026)
di: Xia, Yuning, et al.
Pubblicazione: (2026)
Fast and Scalable Mixed Precision Euclidean Distance Calculations Using GPU Tensor Cores
di: Curless, Brian, et al.
Pubblicazione: (2025)
di: Curless, Brian, et al.
Pubblicazione: (2025)
HybridGen: Efficient LLM Generative Inference via CPU-GPU Hybrid Computing
di: Lin, Mao, et al.
Pubblicazione: (2026)
di: Lin, Mao, et al.
Pubblicazione: (2026)
THAPI: Tracing Heterogeneous APIs
di: Bekele, Solomon, et al.
Pubblicazione: (2025)
di: Bekele, Solomon, et al.
Pubblicazione: (2025)
Towards Portability at Scale: A Cross-Architecture Performance Evaluation of a GPU-enabled Shallow Water Solver
di: Villalobos, Johansell, et al.
Pubblicazione: (2025)
di: Villalobos, Johansell, et al.
Pubblicazione: (2025)
FastDecode: High-Throughput GPU-Efficient LLM Serving using Heterogeneous Pipelines
di: He, Jiaao, et al.
Pubblicazione: (2024)
di: He, Jiaao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Minos: Systematically Classifying Performance and Power Characteristics of GPU Workloads on HPC Clusters
di: Jain, Rutwik, et al.
Pubblicazione: (2026) -
Inductive Loop Analysis for Practical HPC Application Optimization
di: Schaad, Philipp, et al.
Pubblicazione: (2025) -
Understanding Power Consumption Metric on Heterogeneous Memory Systems
di: Proaño, Andrès Rubio, et al.
Pubblicazione: (2024) -
On the Partitioning of GPU Power among Multi-Instances
di: Vamja, Tirth, et al.
Pubblicazione: (2025) -
Operational Strategies for Non-Disruptive Scheduling Transitions in Production HPC Systems
di: MacLachlan, Glen, et al.
Pubblicazione: (2026)