EasyRider: Mitigating Power Transients in Datacenter-Scale Training Workloads
Fuente:
arXiv
Guardado en:
| Autores principales: | Jensen, Dillon, Nnorom Jr., Obi, Wilkins, Grant, Budd, Hugo, Rajagopal, Ram, Rivas-Davila, Juan, Levis, Phil |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Power Stabilization for AI Training Datacenters
por: Choukse, Esha, et al.
Publicado: (2025)
por: Choukse, Esha, et al.
Publicado: (2025)
Generic and ML Workloads in an HPC Datacenter: Node Energy, Job Failures, and Node-Job Analysis
por: Chu, Xiaoyu, et al.
Publicado: (2024)
por: Chu, Xiaoyu, et al.
Publicado: (2024)
CvxCluster: Solving Large, Complex, Granular Resource Allocation Problems 100-1000x Faster
por: Nnorom Jr, Obi, et al.
Publicado: (2026)
por: Nnorom Jr, Obi, et al.
Publicado: (2026)
DDC: A Vision for a Disaggregated Datacenter
por: Ewais, Mohammad, et al.
Publicado: (2024)
por: Ewais, Mohammad, et al.
Publicado: (2024)
Optimizing Software Defined Battery Systems for Transformer Protection
por: Martin, Sonia, et al.
Publicado: (2025)
por: Martin, Sonia, et al.
Publicado: (2025)
Workload-Aware Early-Stage Power Delivery Network Optimization via Architectural Power Traces
por: Hayes, Oran, et al.
Publicado: (2026)
por: Hayes, Oran, et al.
Publicado: (2026)
EnergAIzer: Fast and Accurate GPU Power Estimation Framework for AI Workloads
por: Lee, Kyungmi, et al.
Publicado: (2026)
por: Lee, Kyungmi, et al.
Publicado: (2026)
Towards Efficient LUT-based PIM: A Scalable and Low-Power Approach for Modern Workloads
por: Khabbazan, Bahareh, et al.
Publicado: (2025)
por: Khabbazan, Bahareh, et al.
Publicado: (2025)
Workload Characterization for Branch Predictability
por: Vikas, FNU, et al.
Publicado: (2025)
por: Vikas, FNU, et al.
Publicado: (2025)
AgilePkgC: An Agile System Idle State Architecture for Energy Proportional Datacenter Servers
por: Antoniou, Georgia, et al.
Publicado: (2022)
por: Antoniou, Georgia, et al.
Publicado: (2022)
A4: Microarchitecture-Aware LLC Management for Datacenter Servers with Emerging I/O Devices
por: Park, Haneul, et al.
Publicado: (2025)
por: Park, Haneul, et al.
Publicado: (2025)
How Much Progress Has There Been in NVIDIA Datacenter GPUs?
por: Del Sozzo, Emanuele, et al.
Publicado: (2026)
por: Del Sozzo, Emanuele, et al.
Publicado: (2026)
Towards An Approach to Identify Divergences in Hardware Designs for HPC Workloads
por: Popovici, Doru Thom, et al.
Publicado: (2025)
por: Popovici, Doru Thom, et al.
Publicado: (2025)
Architectural Classification of XR Workloads: Cross-Layer Archetypes and Implications
por: Shi, Xinyu, et al.
Publicado: (2026)
por: Shi, Xinyu, et al.
Publicado: (2026)
Allspark: Workload Orchestration for Visual Transformers on Processing In-Memory Systems
por: Ge, Mengke, et al.
Publicado: (2024)
por: Ge, Mengke, et al.
Publicado: (2024)
SDT: Cutting Datacenter Tax Through Simultaneous Data-Delivery Threads
por: Mamandipoor, Amin, et al.
Publicado: (2025)
por: Mamandipoor, Amin, et al.
Publicado: (2025)
Nexus Machine: An Active Message Inspired Reconfigurable Architecture for Irregular Workloads
por: Juneja, Rohan, et al.
Publicado: (2025)
por: Juneja, Rohan, et al.
Publicado: (2025)
Communication Characterization of AI Workloads for Large-scale Multi-chiplet Accelerators
por: Musavi, Mariam, et al.
Publicado: (2024)
por: Musavi, Mariam, et al.
Publicado: (2024)
TROOP: At-the-Roofline Performance for Vector Processors on Low Operational Intensity Workloads
por: Purayil, Navaneeth Kunhi, et al.
Publicado: (2025)
por: Purayil, Navaneeth Kunhi, et al.
Publicado: (2025)
Understanding the Performance Horizon of the Latest ML Workloads with NonGEMM Workloads
por: Karami, Rachid, et al.
Publicado: (2024)
por: Karami, Rachid, et al.
Publicado: (2024)
Workload-Aware Hardware Accelerator Mining for Distributed Deep Learning Training
por: Adnan, Muhammad, et al.
Publicado: (2024)
por: Adnan, Muhammad, et al.
Publicado: (2024)
Messaging-based Adaptive Vector Computing (MAVeC) Accelerator for AI Workloads
por: Chowdhury, Md. Rownak Hossain, et al.
Publicado: (2024)
por: Chowdhury, Md. Rownak Hossain, et al.
Publicado: (2024)
T-REX: A 68-567 μs/token, 0.41-3.95 μJ/token Transformer Accelerator with Reduced External Memory Access and Enhanced Hardware Utilization in 16nm FinFET
por: Moon, Seunghyun, et al.
Publicado: (2025)
por: Moon, Seunghyun, et al.
Publicado: (2025)
CIMinus: Empowering Sparse DNN Workloads Modeling and Exploration on SRAM-based CIM Architectures
por: Qi, Yingjie, et al.
Publicado: (2025)
por: Qi, Yingjie, et al.
Publicado: (2025)
Mapping Space Exploration for Multi-Chiplet Accelerators Targeting LLM Inference Serving Workloads
por: Li, Boyu, et al.
Publicado: (2025)
por: Li, Boyu, et al.
Publicado: (2025)
WaSP: Warp Scheduling to Mimic Prefetching in Graphics Workloads
por: Joseph, Diya, et al.
Publicado: (2024)
por: Joseph, Diya, et al.
Publicado: (2024)
DEER: Deep Runahead for Instruction Prefetching on Modern Mobile Workloads
por: Vahdatniya, Parmida, et al.
Publicado: (2025)
por: Vahdatniya, Parmida, et al.
Publicado: (2025)
Characterization and Mitigation of Training Instabilities in Microscaling Formats
por: Su, Huangyuan, et al.
Publicado: (2025)
por: Su, Huangyuan, et al.
Publicado: (2025)
3D-TrIM: A Memory-Efficient Spatial Computing Architecture for Convolution Workloads
por: Sestito, Cristian, et al.
Publicado: (2025)
por: Sestito, Cristian, et al.
Publicado: (2025)
SLTarch: Towards Scalable Point-Based Neural Rendering by Taming Workload Imbalance and Memory Irregularity
por: Li, Xingyang, et al.
Publicado: (2025)
por: Li, Xingyang, et al.
Publicado: (2025)
Multi-Objective Hardware-Mapping Co-Optimisation for Multi-DNN Workloads on Chiplet-based Accelerators
por: Das, Abhijit, et al.
Publicado: (2022)
por: Das, Abhijit, et al.
Publicado: (2022)
UB-Mesh: a Hierarchically Localized nD-FullMesh Datacenter Network Architecture
por: Liao, Heng, et al.
Publicado: (2025)
por: Liao, Heng, et al.
Publicado: (2025)
Survey of Disaggregated Memory: Cross-layer Technique Insights for Next-Generation Datacenters
por: Wang, Jing, et al.
Publicado: (2025)
por: Wang, Jing, et al.
Publicado: (2025)
Characterizing and Optimizing Realistic Workloads on a Commercial Compute-in-SRAM Device
por: Zhang, Niansong, et al.
Publicado: (2025)
por: Zhang, Niansong, et al.
Publicado: (2025)
HCiM: ADC-Less Hybrid Analog-Digital Compute in Memory Accelerator for Deep Learning Workloads
por: Negi, Shubham, et al.
Publicado: (2024)
por: Negi, Shubham, et al.
Publicado: (2024)
Spatzformer: An Efficient Reconfigurable Dual-Core RISC-V V Cluster for Mixed Scalar-Vector Workloads
por: Perotti, Matteo, et al.
Publicado: (2024)
por: Perotti, Matteo, et al.
Publicado: (2024)
THERMOS: Thermally-Aware Multi-Objective Scheduling of AI Workloads on Heterogeneous Multi-Chiplet PIM Architectures
por: Kanani, Alish, et al.
Publicado: (2025)
por: Kanani, Alish, et al.
Publicado: (2025)
Empirical Measurements of AI Training Power Demand on a GPU-Accelerated Node
por: Latif, Imran, et al.
Publicado: (2024)
por: Latif, Imran, et al.
Publicado: (2024)
EasyDRAM: An FPGA-based Infrastructure for Fast and Accurate End-to-End Evaluation of Emerging DRAM Techniques
por: Canpolat, Oğuzhan, et al.
Publicado: (2025)
por: Canpolat, Oğuzhan, et al.
Publicado: (2025)
Dual-Issue Execution of Mixed Integer and Floating-Point Workloads on Energy-Efficient In-Order RISC-V Cores
por: Colagrande, Luca, et al.
Publicado: (2025)
por: Colagrande, Luca, et al.
Publicado: (2025)
Ejemplares similares
-
Power Stabilization for AI Training Datacenters
por: Choukse, Esha, et al.
Publicado: (2025) -
Generic and ML Workloads in an HPC Datacenter: Node Energy, Job Failures, and Node-Job Analysis
por: Chu, Xiaoyu, et al.
Publicado: (2024) -
CvxCluster: Solving Large, Complex, Granular Resource Allocation Problems 100-1000x Faster
por: Nnorom Jr, Obi, et al.
Publicado: (2026) -
DDC: A Vision for a Disaggregated Datacenter
por: Ewais, Mohammad, et al.
Publicado: (2024) -
Optimizing Software Defined Battery Systems for Transformer Protection
por: Martin, Sonia, et al.
Publicado: (2025)