Agora: Bridging the GPU Cloud Resource-Price Disconnect
Fuente:
arXiv
Salvato in:
| Autori principali: | McDougall, Ian, Scott, Noah, Huh, Joon, Kandasamy, Kirthevasan, Sankaralingam, Karthikeyan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Kitsune: Enabling Dataflow Execution on GPUs
di: Davies, Michael, et al.
Pubblicazione: (2025)
di: Davies, Michael, et al.
Pubblicazione: (2025)
ParvaGPU: Efficient Spatial GPU Sharing for Large-Scale DNN Inference in Cloud Environments
di: Lee, Munkyu, et al.
Pubblicazione: (2024)
di: Lee, Munkyu, et al.
Pubblicazione: (2024)
Understanding GPU Resource Interference One Level Deeper
di: Elvinger, Paul, et al.
Pubblicazione: (2025)
di: Elvinger, Paul, et al.
Pubblicazione: (2025)
Optimal Resource Efficiency with Fairness in Heterogeneous GPU Clusters
di: Mo, Zizhao, et al.
Pubblicazione: (2024)
di: Mo, Zizhao, et al.
Pubblicazione: (2024)
VDCores: Resource Decoupled Programming and Execution for Asynchronous GPU
di: He, Zijian, et al.
Pubblicazione: (2026)
di: He, Zijian, et al.
Pubblicazione: (2026)
Host-Side Telemetry for Performance Diagnosis in Cloud and HPC GPU Infrastructure
di: Darzi, Erfan, et al.
Pubblicazione: (2025)
di: Darzi, Erfan, et al.
Pubblicazione: (2025)
LaissezCloud: Continuous Resource Renegotiation for the Public Cloud
di: Harith, Tejas, et al.
Pubblicazione: (2026)
di: Harith, Tejas, et al.
Pubblicazione: (2026)
A Multi-Objective Framework for Optimizing GPU-Enabled VM Placement in Cloud Data Centers with Multi-Instance GPU Technology
di: Siavashi, Ahmad, et al.
Pubblicazione: (2025)
di: Siavashi, Ahmad, et al.
Pubblicazione: (2025)
Boosting LLM Serving through Spatial-Temporal GPU Resource Sharing
di: Lin, Zejia, et al.
Pubblicazione: (2025)
di: Lin, Zejia, et al.
Pubblicazione: (2025)
GPU Memory and Utilization Estimation for Training-Aware Resource Management: Opportunities and Limitations
di: Yousefzadeh-Asl-Miandoab, Ehsan, et al.
Pubblicazione: (2026)
di: Yousefzadeh-Asl-Miandoab, Ehsan, et al.
Pubblicazione: (2026)
Torpor: GPU-Enabled Serverless Computing for Low-Latency, Resource-Efficient Inference
di: Yu, Minchen, et al.
Pubblicazione: (2023)
di: Yu, Minchen, et al.
Pubblicazione: (2023)
Scientific Workflow Scheduling in Cloud Considering Cold Start and Variable Pricing Model
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2025)
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2025)
SiPipe: Bridging the CPU-GPU Utilization Gap for Efficient Pipeline-Parallel LLM Inference
di: He, Yongchao, et al.
Pubblicazione: (2025)
di: He, Yongchao, et al.
Pubblicazione: (2025)
Lumos: Performance Characterization of WebAssembly as a Serverless Runtime in the Edge-Cloud Continuum
di: Marcelino, Cynthia, et al.
Pubblicazione: (2025)
di: Marcelino, Cynthia, et al.
Pubblicazione: (2025)
Dilu: Enabling GPU Resourcing-on-Demand for Serverless DL Serving via Introspective Elasticity
di: Lv, Cunchi, et al.
Pubblicazione: (2025)
di: Lv, Cunchi, et al.
Pubblicazione: (2025)
A Bring-Your-Own-Model Approach for ML-Driven Storage Placement in Warehouse-Scale Computers
di: Yang, Chenxi, et al.
Pubblicazione: (2025)
di: Yang, Chenxi, et al.
Pubblicazione: (2025)
Scheduling Deep Learning Jobs in Multi-Tenant GPU Clusters via Wise Resource Sharing
di: Luo, Yizhou, et al.
Pubblicazione: (2024)
di: Luo, Yizhou, et al.
Pubblicazione: (2024)
Distributed Resource Selection for Self-Organising Cloud-Edge Systems
di: Renau, Quentin, et al.
Pubblicazione: (2025)
di: Renau, Quentin, et al.
Pubblicazione: (2025)
Understanding the Landscape of Ampere GPU Memory Errors
di: Zhu, Zhu, et al.
Pubblicazione: (2025)
di: Zhu, Zhu, et al.
Pubblicazione: (2025)
SpecInF: Exploiting Idle GPU Resources in Distributed DL Training via Speculative Inference Filling
di: Lv, Cunchi, et al.
Pubblicazione: (2025)
di: Lv, Cunchi, et al.
Pubblicazione: (2025)
HPCAdvisor: A Tool for Assisting Users in Selecting HPC Resources in the Cloud
di: Netto, Marco A. S.
Pubblicazione: (2024)
di: Netto, Marco A. S.
Pubblicazione: (2024)
Orchestrated Co-scheduling, Resource Partitioning, and Power Capping on CPU-GPU Heterogeneous Systems via Machine Learning
di: Saba, Issa, et al.
Pubblicazione: (2024)
di: Saba, Issa, et al.
Pubblicazione: (2024)
Parallel GPU-Enabled Algorithms for SpGEMM on Arbitrary Semirings with Hybrid Communication
di: McFarland, Thomas, et al.
Pubblicazione: (2025)
di: McFarland, Thomas, et al.
Pubblicazione: (2025)
Collaborative Multi-Agent Reinforcement Learning Approach for Elastic Cloud Resource Scaling
di: Fang, Bruce, et al.
Pubblicazione: (2025)
di: Fang, Bruce, et al.
Pubblicazione: (2025)
ICPS: Real-Time Resource Configuration for Cloud Serverless Functions Considering Affinity
di: Chen, Long, et al.
Pubblicazione: (2025)
di: Chen, Long, et al.
Pubblicazione: (2025)
Improving GPU Multi-Tenancy Through Dynamic Multi-Instance GPU Reconfiguration
di: Wang, Tianyu, et al.
Pubblicazione: (2024)
di: Wang, Tianyu, et al.
Pubblicazione: (2024)
Cloud Resource Allocation with Convex Optimization
di: Boghani, Shayan, et al.
Pubblicazione: (2025)
di: Boghani, Shayan, et al.
Pubblicazione: (2025)
Data-Driven Analysis to Understand GPU Hardware Resource Usage of Optimizations
di: Islam, Tanzima Z., et al.
Pubblicazione: (2024)
di: Islam, Tanzima Z., et al.
Pubblicazione: (2024)
Flora: Efficient Cloud Resource Selection for Big Data Processing via Job Classification
di: Will, Jonathan, et al.
Pubblicazione: (2025)
di: Will, Jonathan, et al.
Pubblicazione: (2025)
Modeling Anomaly Detection in Cloud Services: Analysis of the Properties that Impact Latency and Resource Consumption
di: Grabher, Gabriel Job Antunes, et al.
Pubblicazione: (2025)
di: Grabher, Gabriel Job Antunes, et al.
Pubblicazione: (2025)
HybridFlow: Resource-Adaptive Subtask Routing for Efficient Edge-Cloud LLM Inference
di: Dong, Jiangwen, et al.
Pubblicazione: (2025)
di: Dong, Jiangwen, et al.
Pubblicazione: (2025)
Quantifying Autoscaler Vulnerabilities: An Empirical Study of Resource Misallocation Induced by Cloud Infrastructure Faults
di: Park, Gijun
Pubblicazione: (2026)
di: Park, Gijun
Pubblicazione: (2026)
H-EYE: Holistic Resource Modeling and Management for Diversely Scaled Edge-Cloud Systems
di: Dagli, Ismet, et al.
Pubblicazione: (2024)
di: Dagli, Ismet, et al.
Pubblicazione: (2024)
Accelerating Biclique Counting on GPU
di: Qiu, Linshan, et al.
Pubblicazione: (2024)
di: Qiu, Linshan, et al.
Pubblicazione: (2024)
GPU Sharing with Triples Mode
di: Byun, Chansup, et al.
Pubblicazione: (2024)
di: Byun, Chansup, et al.
Pubblicazione: (2024)
Accelerating Intra-Node GPU-to-GPU Communication Through Multi-Path Transfers with CUDA Graphs
di: Sojoodi, Amirhossein, et al.
Pubblicazione: (2026)
di: Sojoodi, Amirhossein, et al.
Pubblicazione: (2026)
ARRC: Explainable, Workflow-Integrated Recommender for Sustainable Resource Optimization Across the Edge-Cloud Continuum
di: Jahnke, Brian-Frederik, et al.
Pubblicazione: (2025)
di: Jahnke, Brian-Frederik, et al.
Pubblicazione: (2025)
COUNTER: Cluster GCN based Energy Efficient Resource Management for Sustainable Cloud Computing Environments
di: Wang, Han, et al.
Pubblicazione: (2025)
di: Wang, Han, et al.
Pubblicazione: (2025)
A Dynamic Approach to Load Balancing in Cloud Infrastructure: Enhancing Energy Efficiency and Resource Utilization
di: Sakib, Shadman, et al.
Pubblicazione: (2025)
di: Sakib, Shadman, et al.
Pubblicazione: (2025)
Resource Slicing through Intelligent Orchestration of Energy-aware IoT services in Edge-Cloud Continuum
di: Shahid, Hafiz Faheem, et al.
Pubblicazione: (2024)
di: Shahid, Hafiz Faheem, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Kitsune: Enabling Dataflow Execution on GPUs
di: Davies, Michael, et al.
Pubblicazione: (2025) -
ParvaGPU: Efficient Spatial GPU Sharing for Large-Scale DNN Inference in Cloud Environments
di: Lee, Munkyu, et al.
Pubblicazione: (2024) -
Understanding GPU Resource Interference One Level Deeper
di: Elvinger, Paul, et al.
Pubblicazione: (2025) -
Optimal Resource Efficiency with Fairness in Heterogeneous GPU Clusters
di: Mo, Zizhao, et al.
Pubblicazione: (2024) -
VDCores: Resource Decoupled Programming and Execution for Asynchronous GPU
di: He, Zijian, et al.
Pubblicazione: (2026)