Coordinating GPU Data Centers and Power Grid Regulation Service for Exogenous Carbon Benefits
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jahanshahi, Ali, Golrouye, Sara Rashidi, Anderson, Osten, Yu, Nanpeng, Wong, Daniel |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Unleashing the Power of Preemptive Priority-based Scheduling for Real-Time GPU Tasks
par: Wang, Yidi, et autres
Publié: (2024)
par: Wang, Yidi, et autres
Publié: (2024)
Sustainable Grid through Distributed Data Centers: Spinning AI Demand for Grid Stabilization and Optimization
par: Evans, Scott C, et autres
Publié: (2025)
par: Evans, Scott C, et autres
Publié: (2025)
A Multi-Objective Framework for Optimizing GPU-Enabled VM Placement in Cloud Data Centers with Multi-Instance GPU Technology
par: Siavashi, Ahmad, et autres
Publié: (2025)
par: Siavashi, Ahmad, et autres
Publié: (2025)
GCAPS: GPU Context-Aware Preemptive Priority-based Scheduling for Real-Time Tasks
par: Wang, Yidi, et autres
Publié: (2024)
par: Wang, Yidi, et autres
Publié: (2024)
FaaSTube: Optimizing GPU-oriented Data Transfer for Serverless Computing
par: Wu, Hao, et autres
Publié: (2024)
par: Wu, Hao, et autres
Publié: (2024)
Coordinated Power Management on Heterogeneous Systems
par: Zheng, Zhong, et autres
Publié: (2025)
par: Zheng, Zhong, et autres
Publié: (2025)
Optimizing Bloom Filters for Modern GPU Architectures
par: Jünger, Daniel, et autres
Publié: (2025)
par: Jünger, Daniel, et autres
Publié: (2025)
Advancing Environmental Sustainability in Data Centers via Carbon Depreciation Models
par: Ji, Shixin, et autres
Publié: (2024)
par: Ji, Shixin, et autres
Publié: (2024)
GICC: A High-Performance Runtime for GPU-Initiated Communication and Coordination in Modern HPC Systems
par: Shan, Baodi, et autres
Publié: (2026)
par: Shan, Baodi, et autres
Publié: (2026)
AI-focused HPC Data Centers Can Provide More Power Grid Flexibility and at Lower Cost
par: Zhou, Yihong, et autres
Publié: (2024)
par: Zhou, Yihong, et autres
Publié: (2024)
GPU Sharing with Triples Mode
par: Byun, Chansup, et autres
Publié: (2024)
par: Byun, Chansup, et autres
Publié: (2024)
A Digital Twin-based Multi-Agent Reinforcement Learning Framework for Vehicle-to-Grid Coordination
par: Hua, Zhengchang, et autres
Publié: (2025)
par: Hua, Zhengchang, et autres
Publié: (2025)
GPZ: GPU-Accelerated Lossy Compressor for Particle Data
par: Li, Ruoyu, et autres
Publié: (2025)
par: Li, Ruoyu, et autres
Publié: (2025)
From Barrier to Bridge: The Case for AI Data Center/Power Grid Co-Design
par: Bashir, Noman, et autres
Publié: (2026)
par: Bashir, Noman, et autres
Publié: (2026)
On the Partitioning of GPU Power among Multi-Instances
par: Vamja, Tirth, et autres
Publié: (2025)
par: Vamja, Tirth, et autres
Publié: (2025)
Methodology for GPU Frequency Switching Latency Measurement
par: Velicka, Daniel, et autres
Publié: (2025)
par: Velicka, Daniel, et autres
Publié: (2025)
Characterizing Compute-Communication Overlap in GPU-Accelerated Distributed Deep Learning: Performance and Power Implications
par: Lee, Seonho, et autres
Publié: (2025)
par: Lee, Seonho, et autres
Publié: (2025)
Understanding Data Movement in AMD Multi-GPU Systems with Infinity Fabric
par: Schieffer, Gabin, et autres
Publié: (2024)
par: Schieffer, Gabin, et autres
Publié: (2024)
Characterizing Production GPU Workloads using System-wide Telemetry Data
par: Cankur, Onur, et autres
Publié: (2025)
par: Cankur, Onur, et autres
Publié: (2025)
TX-Digital Twin: Visualizing Supercomputer GPU Performance Data Stream
par: Baskakova, Elena, et autres
Publié: (2026)
par: Baskakova, Elena, et autres
Publié: (2026)
Orchestrated Co-scheduling, Resource Partitioning, and Power Capping on CPU-GPU Heterogeneous Systems via Machine Learning
par: Saba, Issa, et autres
Publié: (2024)
par: Saba, Issa, et autres
Publié: (2024)
Efficient GPU-Centered Singular Value Decomposition Using the Divide-and-Conquer Method
par: Liu, Shifang, et autres
Publié: (2025)
par: Liu, Shifang, et autres
Publié: (2025)
Improving GPU Multi-Tenancy Through Dynamic Multi-Instance GPU Reconfiguration
par: Wang, Tianyu, et autres
Publié: (2024)
par: Wang, Tianyu, et autres
Publié: (2024)
A GPU-accelerated Molecular Docking Workflow with Kubernetes and Apache Airflow
par: Medeiros, Daniel, et autres
Publié: (2024)
par: Medeiros, Daniel, et autres
Publié: (2024)
NCCLZ: Compression-Enabled GPU Collectives with Decoupled Quantization and Entropy Coding
par: Wang, Jiamin, et autres
Publié: (2026)
par: Wang, Jiamin, et autres
Publié: (2026)
PICO: Accelerating All k-Core Paradigms on GPU
par: Zhao, Chen, et autres
Publié: (2024)
par: Zhao, Chen, et autres
Publié: (2024)
Power-Aware Scheduling for Multi-Center HPC Electricity Cost Optimization
par: Hossain, Abrar, et autres
Publié: (2025)
par: Hossain, Abrar, et autres
Publié: (2025)
Understanding the Landscape of Ampere GPU Memory Errors
par: Zhu, Zhu, et autres
Publié: (2025)
par: Zhu, Zhu, et autres
Publié: (2025)
Cooling Matters: Benchmarking Large Language Models and Vision-Language Models on Liquid-Cooled Versus Air-Cooled H100 GPU Systems
par: Latif, Imran, et autres
Publié: (2025)
par: Latif, Imran, et autres
Publié: (2025)
Torpor: GPU-Enabled Serverless Computing for Low-Latency, Resource-Efficient Inference
par: Yu, Minchen, et autres
Publié: (2023)
par: Yu, Minchen, et autres
Publié: (2023)
Accelerating Biclique Counting on GPU
par: Qiu, Linshan, et autres
Publié: (2024)
par: Qiu, Linshan, et autres
Publié: (2024)
ParvaGPU: Efficient Spatial GPU Sharing for Large-Scale DNN Inference in Cloud Environments
par: Lee, Munkyu, et autres
Publié: (2024)
par: Lee, Munkyu, et autres
Publié: (2024)
Accelerating Intra-Node GPU-to-GPU Communication Through Multi-Path Transfers with CUDA Graphs
par: Sojoodi, Amirhossein, et autres
Publié: (2026)
par: Sojoodi, Amirhossein, et autres
Publié: (2026)
Computational Grids
par: Foster, Ian, et autres
Publié: (2025)
par: Foster, Ian, et autres
Publié: (2025)
TURNIP: A "Nondeterministic" GPU Runtime with CPU RAM Offload
par: Ding, Zhimin, et autres
Publié: (2024)
par: Ding, Zhimin, et autres
Publié: (2024)
Minos: Systematically Classifying Performance and Power Characteristics of GPU Workloads on HPC Clusters
par: Jain, Rutwik, et autres
Publié: (2026)
par: Jain, Rutwik, et autres
Publié: (2026)
SIMT/GPU Data Race Verification using ISCC and Intermediary Code Representations: A Case Study
par: Osterhout, Andrew, et autres
Publié: (2025)
par: Osterhout, Andrew, et autres
Publié: (2025)
Unleashing the Power of Tree-of-Thoughts for Edge-Enabled AIGC Service Provisioning
par: Liu, Zhang, et autres
Publié: (2026)
par: Liu, Zhang, et autres
Publié: (2026)
Disaggregated Design for GPU-Based Volumetric Data Structures
par: Meneghin, Massimiliano, et autres
Publié: (2025)
par: Meneghin, Massimiliano, et autres
Publié: (2025)
DuaLip-GPU Technical Report
par: Dexter, Gregory, et autres
Publié: (2026)
par: Dexter, Gregory, et autres
Publié: (2026)
Documents similaires
-
Unleashing the Power of Preemptive Priority-based Scheduling for Real-Time GPU Tasks
par: Wang, Yidi, et autres
Publié: (2024) -
Sustainable Grid through Distributed Data Centers: Spinning AI Demand for Grid Stabilization and Optimization
par: Evans, Scott C, et autres
Publié: (2025) -
A Multi-Objective Framework for Optimizing GPU-Enabled VM Placement in Cloud Data Centers with Multi-Instance GPU Technology
par: Siavashi, Ahmad, et autres
Publié: (2025) -
GCAPS: GPU Context-Aware Preemptive Priority-based Scheduling for Real-Time Tasks
par: Wang, Yidi, et autres
Publié: (2024) -
FaaSTube: Optimizing GPU-oriented Data Transfer for Serverless Computing
par: Wu, Hao, et autres
Publié: (2024)