EaCO: Resource Sharing Dynamics and Its Impact on Energy Efficiency for DNN Training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Haghshenas, Kawsar, Hashemi, Mona |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Dynamic Approach to Load Balancing in Cloud Infrastructure: Enhancing Energy Efficiency and Resource Utilization
par: Sakib, Shadman, et autres
Publié: (2025)
par: Sakib, Shadman, et autres
Publié: (2025)
Salted Inference: Enhancing Privacy while Maintaining Efficiency of Split Inference in Mobile Computing
par: Malekzadeh, Mohammad, et autres
Publié: (2023)
par: Malekzadeh, Mohammad, et autres
Publié: (2023)
Training DNN Models over Heterogeneous Clusters with Optimal Performance
par: Nie, Chengyi, et autres
Publié: (2024)
par: Nie, Chengyi, et autres
Publié: (2024)
Parcae: Proactive, Liveput-Optimized DNN Training on Preemptible Instances
par: Duan, Jiangfei, et autres
Publié: (2024)
par: Duan, Jiangfei, et autres
Publié: (2024)
Performance Characterization of Containerized DNN Training and Inference on Edge Accelerators
par: K., Prashanthi S., et autres
Publié: (2023)
par: K., Prashanthi S., et autres
Publié: (2023)
Fulcrum: Optimizing Concurrent DNN Training and Inferencing on Edge Accelerators
par: K., Prashanthi S., et autres
Publié: (2025)
par: K., Prashanthi S., et autres
Publié: (2025)
SWIFT: Expedited Failure Recovery for Large-scale DNN Training
par: Zhong, Yuchen, et autres
Publié: (2023)
par: Zhong, Yuchen, et autres
Publié: (2023)
ParvaGPU: Efficient Spatial GPU Sharing for Large-Scale DNN Inference in Cloud Environments
par: Lee, Munkyu, et autres
Publié: (2024)
par: Lee, Munkyu, et autres
Publié: (2024)
Nezha: Breaking Multi-Rail Network Barriers for Distributed DNN Training
par: Yu, Enda, et autres
Publié: (2024)
par: Yu, Enda, et autres
Publié: (2024)
Poplar: Efficient Scaling of Distributed DNN Training on Heterogeneous GPU Clusters
par: Zhang, WenZheng, et autres
Publié: (2024)
par: Zhang, WenZheng, et autres
Publié: (2024)
A Flexible Programmable Pipeline Parallelism Framework for Efficient DNN Training
par: Jiang, Lijuan, et autres
Publié: (2025)
par: Jiang, Lijuan, et autres
Publié: (2025)
Optimizing Resource Allocation and Energy Efficiency in Federated Fog Computing for IoT
par: Shah, Syed Sarmad, et autres
Publié: (2025)
par: Shah, Syed Sarmad, et autres
Publié: (2025)
Pagoda: An Energy and Time Roofline Study for DNN Workloads on Edge Accelerators
par: K., Prashanthi S., et autres
Publié: (2025)
par: K., Prashanthi S., et autres
Publié: (2025)
HAP: SPMD DNN Training on Heterogeneous GPU Clusters with Automated Program Synthesis
par: Zhang, Shiwei, et autres
Publié: (2024)
par: Zhang, Shiwei, et autres
Publié: (2024)
AdaOper: Energy-efficient and Responsive Concurrent DNN Inference on Mobile Devices
par: Lin, Zheng, et autres
Publié: (2024)
par: Lin, Zheng, et autres
Publié: (2024)
A Survey of End-to-End Modeling for Distributed DNN Training: Workloads, Simulators, and TCO
par: Svedas, Jonas, et autres
Publié: (2025)
par: Svedas, Jonas, et autres
Publié: (2025)
Collaborative Inference in DNN-based Satellite Systems with Dynamic Task Streams
par: Guan, Jinglong, et autres
Publié: (2023)
par: Guan, Jinglong, et autres
Publié: (2023)
The Case for Time-Shared Computing Resources
par: Jacquet, Pierre, et autres
Publié: (2025)
par: Jacquet, Pierre, et autres
Publié: (2025)
Memory Efficient and Staleness Free Pipeline Parallel DNN Training Framework with Improved Convergence Speed
par: Dutta, Ankita, et autres
Publié: (2025)
par: Dutta, Ankita, et autres
Publié: (2025)
GMLake: Efficient and Transparent GPU Memory Defragmentation for Large-scale DNN Training with Virtual Memory Stitching
par: Guo, Cong, et autres
Publié: (2024)
par: Guo, Cong, et autres
Publié: (2024)
TiMePReSt: Time and Memory Efficient Pipeline Parallel DNN Training with Removed Staleness
par: Dutta, Ankita, et autres
Publié: (2024)
par: Dutta, Ankita, et autres
Publié: (2024)
Infer-EDGE: Dynamic DNN Inference Optimization in 'Just-in-time' Edge-AI Implementations
par: Mounesan, Motahare, et autres
Publié: (2025)
par: Mounesan, Motahare, et autres
Publié: (2025)
Shared Virtual Memory: Its Design and Performance Implications for Diverse Applications
par: Cooper, Bennett, et autres
Publié: (2024)
par: Cooper, Bennett, et autres
Publié: (2024)
Dynamic Service Scheduling and Resource Management in Energy-Harvesting Multi-access Edge Computing
par: Chen, Shuyi, et autres
Publié: (2025)
par: Chen, Shuyi, et autres
Publié: (2025)
AdaBridge: Dynamic Data and Computation Reuse for Efficient Multi-task DNN Co-evolution in Edge Systems
par: Wang, Lehao, et autres
Publié: (2024)
par: Wang, Lehao, et autres
Publié: (2024)
Modality Inflation: Energy Characterization and Optimization Opportunities for MLLM Inference
par: Moghadampanah, Mona, et autres
Publié: (2025)
par: Moghadampanah, Mona, et autres
Publié: (2025)
Optimal Resource Efficiency with Fairness in Heterogeneous GPU Clusters
par: Mo, Zizhao, et autres
Publié: (2024)
par: Mo, Zizhao, et autres
Publié: (2024)
Boosting LLM Serving through Spatial-Temporal GPU Resource Sharing
par: Lin, Zejia, et autres
Publié: (2025)
par: Lin, Zejia, et autres
Publié: (2025)
Workload Buoyancy: Keeping Apps Afloat by Identifying Shared Resource Bottlenecks
par: Larsson, Oliver, et autres
Publié: (2026)
par: Larsson, Oliver, et autres
Publié: (2026)
Schedule-Level Shared-Prefix Reuse for LLM RL Training
par: Li, Pengbo, et autres
Publié: (2026)
par: Li, Pengbo, et autres
Publié: (2026)
Blockchain-enabled Energy Trading and Battery-based Sharing in Microgrids
par: Zekiye, Abdulrezzak, et autres
Publié: (2024)
par: Zekiye, Abdulrezzak, et autres
Publié: (2024)
EdgeServing: Deadline-Aware Multi-DNN Serving at the Edge
par: Cao, Jiahe, et autres
Publié: (2026)
par: Cao, Jiahe, et autres
Publié: (2026)
PaSE: Parallelization Strategies for Efficient DNN Training
par: Elango, Venmugil
Publié: (2024)
par: Elango, Venmugil
Publié: (2024)
DRust: Language-Guided Distributed Shared Memory with Fine Granularity, Full Transparency, and Ultra Efficiency
par: Ma, Haoran, et autres
Publié: (2024)
par: Ma, Haoran, et autres
Publié: (2024)
A Scalable State Sharing Protocol for Low-Resource Validator Nodes in Blockchain Networks
par: Hias, Ruben, et autres
Publié: (2024)
par: Hias, Ruben, et autres
Publié: (2024)
SuperSFL: Resource-Heterogeneous Federated Split Learning with Weight-Sharing Super-Networks
par: Asif, Abdullah Al, et autres
Publié: (2026)
par: Asif, Abdullah Al, et autres
Publié: (2026)
Jiagu: Optimizing Serverless Computing Resource Utilization with Harmonized Efficiency and Practicability
par: Liu, Qingyuan, et autres
Publié: (2024)
par: Liu, Qingyuan, et autres
Publié: (2024)
Collaborative Satellite Computing through Adaptive DNN Task Splitting and Offloading
par: Peng, Shifeng, et autres
Publié: (2024)
par: Peng, Shifeng, et autres
Publié: (2024)
Online Optimization of DNN Inference Network Utility in Collaborative Edge Computing
par: Li, Rui, et autres
Publié: (2024)
par: Li, Rui, et autres
Publié: (2024)
Ocularone-Bench: Benchmarking DNN Models on GPUs to Assist the Visually Impaired
par: Raj, Suman, et autres
Publié: (2025)
par: Raj, Suman, et autres
Publié: (2025)
Documents similaires
-
A Dynamic Approach to Load Balancing in Cloud Infrastructure: Enhancing Energy Efficiency and Resource Utilization
par: Sakib, Shadman, et autres
Publié: (2025) -
Salted Inference: Enhancing Privacy while Maintaining Efficiency of Split Inference in Mobile Computing
par: Malekzadeh, Mohammad, et autres
Publié: (2023) -
Training DNN Models over Heterogeneous Clusters with Optimal Performance
par: Nie, Chengyi, et autres
Publié: (2024) -
Parcae: Proactive, Liveput-Optimized DNN Training on Preemptible Instances
par: Duan, Jiangfei, et autres
Publié: (2024) -
Performance Characterization of Containerized DNN Training and Inference on Edge Accelerators
par: K., Prashanthi S., et autres
Publié: (2023)