Optimizing Fine-Grained Parallelism Through Dynamic Load Balancing on Multi-Socket Many-Core Systems
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Wenyi, Gonthier, Maxime, Nookala, Poornima, Pan, Haochen, Foster, Ian, Raicu, Ioan, Chard, Kyle |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
WRATH: Workload Resilience Across Task Hierarchies in Task-based Parallel Programming Frameworks
di: Zhou, Sicheng, et al.
Pubblicazione: (2025)
di: Zhou, Sicheng, et al.
Pubblicazione: (2025)
Octopus: Experiences with a Hybrid Event-Driven Architecture for Distributed Scientific Computing
di: Pan, Haochen, et al.
Pubblicazione: (2024)
di: Pan, Haochen, et al.
Pubblicazione: (2024)
TaPS: A Performance Evaluation Suite for Task-based Execution Frameworks
di: Pauloski, J. Gregory, et al.
Pubblicazione: (2024)
di: Pauloski, J. Gregory, et al.
Pubblicazione: (2024)
Core Hours and Carbon Credits: Incentivizing Sustainability in HPC
di: Kamatar, Alok, et al.
Pubblicazione: (2025)
di: Kamatar, Alok, et al.
Pubblicazione: (2025)
Addressing Reproducibility Challenges in HPC with Continuous Integration
di: Hayot-Sasson, Valérie, et al.
Pubblicazione: (2025)
di: Hayot-Sasson, Valérie, et al.
Pubblicazione: (2025)
DynoStore: A wide-area distribution system for the management of data over heterogeneous storage
di: Sanchez-Gallegos, Dante D., et al.
Pubblicazione: (2025)
di: Sanchez-Gallegos, Dante D., et al.
Pubblicazione: (2025)
Experiences with Model Context Protocol Servers for Science and High Performance Computing
di: Pan, Haochen, et al.
Pubblicazione: (2025)
di: Pan, Haochen, et al.
Pubblicazione: (2025)
Icicle: Scalable Metadata Indexing and Real-Time Monitoring for HPC File Systems
di: Pan, Haochen, et al.
Pubblicazione: (2026)
di: Pan, Haochen, et al.
Pubblicazione: (2026)
D-Rex: Heterogeneity-Aware Reliability Framework and Adaptive Algorithms for Distributed Storage
di: Gonthier, Maxime, et al.
Pubblicazione: (2025)
di: Gonthier, Maxime, et al.
Pubblicazione: (2025)
UniFaaS: Programming across Distributed Cyberinfrastructure with Federated Function Serving
di: Li, Yifei, et al.
Pubblicazione: (2024)
di: Li, Yifei, et al.
Pubblicazione: (2024)
Accelerating Python Applications with Dask and ProxyStore
di: Pauloski, J. Gregory, et al.
Pubblicazione: (2024)
di: Pauloski, J. Gregory, et al.
Pubblicazione: (2024)
Steering a Fleet: Adaptation for Large-Scale, Workflow-Based Experiments
di: Pruyne, Jim, et al.
Pubblicazione: (2024)
di: Pruyne, Jim, et al.
Pubblicazione: (2024)
Object Proxy Patterns for Accelerating Distributed Applications
di: Pauloski, J. Gregory, et al.
Pubblicazione: (2024)
di: Pauloski, J. Gregory, et al.
Pubblicazione: (2024)
Parsl+CWL: Towards Combining the Python and CWL Ecosystems
di: Karle, Nishchay, et al.
Pubblicazione: (2024)
di: Karle, Nishchay, et al.
Pubblicazione: (2024)
Empowering Scientific Workflows with Federated Agents
di: Kamatar, Alok, et al.
Pubblicazione: (2025)
di: Kamatar, Alok, et al.
Pubblicazione: (2025)
Load Balanced Parallel Node Generation for Meshless Numerical Methods
di: Vehovar, Jon, et al.
Pubblicazione: (2026)
di: Vehovar, Jon, et al.
Pubblicazione: (2026)
Flight: A FaaS-Based Framework for Complex and Hierarchical Federated Learning
di: Hudson, Nathaniel, et al.
Pubblicazione: (2024)
di: Hudson, Nathaniel, et al.
Pubblicazione: (2024)
XaaS Containers: Performance-Portable Representation With Source and IR Containers
di: Copik, Marcin, et al.
Pubblicazione: (2025)
di: Copik, Marcin, et al.
Pubblicazione: (2025)
GreenFaaS: Maximizing Energy Efficiency of HPC Workloads with FaaS
di: Kamatar, Alok, et al.
Pubblicazione: (2024)
di: Kamatar, Alok, et al.
Pubblicazione: (2024)
Fine-grained MoE Load Balancing with Linear Programming
di: Zhao, Chenqi, et al.
Pubblicazione: (2025)
di: Zhao, Chenqi, et al.
Pubblicazione: (2025)
Topology-Aware Knowledge Propagation in Decentralized Learning
di: Sakarvadia, Mansi, et al.
Pubblicazione: (2025)
di: Sakarvadia, Mansi, et al.
Pubblicazione: (2025)
Employing Artificial Intelligence to Steer Exascale Workflows with Colmena
di: Ward, Logan, et al.
Pubblicazione: (2024)
di: Ward, Logan, et al.
Pubblicazione: (2024)
TensorSocket: Shared Data Loading for Deep Learning Training
di: Robroek, Ties, et al.
Pubblicazione: (2024)
di: Robroek, Ties, et al.
Pubblicazione: (2024)
Automated, Reliable, and Efficient Continental-Scale Replication of 7.3 Petabytes of Climate Simulation Data: A Case Study
di: Lacinski, Lukasz, et al.
Pubblicazione: (2024)
di: Lacinski, Lukasz, et al.
Pubblicazione: (2024)
NeutronTP: Load-Balanced Distributed Full-Graph GNN Training with Tensor Parallelism
di: Ai, Xin, et al.
Pubblicazione: (2024)
di: Ai, Xin, et al.
Pubblicazione: (2024)
Exploring Fine-grained Task Parallelism on Simultaneous Multithreading Cores
di: Los, Denis, et al.
Pubblicazione: (2024)
di: Los, Denis, et al.
Pubblicazione: (2024)
S-HPLB: Efficient LLM Attention Serving via Sparsity-Aware Head Parallelism Load Balance
di: Liu, Di, et al.
Pubblicazione: (2026)
di: Liu, Di, et al.
Pubblicazione: (2026)
Tackling the Data-Parallel Load Balancing Bottleneck in LLM Serving: Practical Online Routing at Scale
di: Bu, Tianci, et al.
Pubblicazione: (2026)
di: Bu, Tianci, et al.
Pubblicazione: (2026)
Balancing Pipeline Parallelism with Vocabulary Parallelism
di: Yeung, Man Tsung, et al.
Pubblicazione: (2024)
di: Yeung, Man Tsung, et al.
Pubblicazione: (2024)
Linear Complexity $\mathcal{H}^2$ Direct Solver for Fine-Grained Parallel Architectures
di: Boukaram, Wajih, et al.
Pubblicazione: (2025)
di: Boukaram, Wajih, et al.
Pubblicazione: (2025)
Efficient Data-Parallel Continual Learning with Asynchronous Distributed Rehearsal Buffers
di: Bouvier, Thomas, et al.
Pubblicazione: (2024)
di: Bouvier, Thomas, et al.
Pubblicazione: (2024)
Experiences Building Enterprise-Level Privacy-Preserving Federated Learning to Power AI for Science
di: Li, Zilinghan, et al.
Pubblicazione: (2025)
di: Li, Zilinghan, et al.
Pubblicazione: (2025)
Pro-Prophet: A Systematic Load Balancing Method for Efficient Parallel Training of Large-scale MoE Models
di: Wang, Wei, et al.
Pubblicazione: (2024)
di: Wang, Wei, et al.
Pubblicazione: (2024)
Fine-Grained Energy Prediction For Parallellized LLM Inference With PIE-P
di: Dutt, Anurag, et al.
Pubblicazione: (2025)
di: Dutt, Anurag, et al.
Pubblicazione: (2025)
Efficient MoE Inference with Fine-Grained Scheduling of Disaggregated Expert Parallelism
di: Pan, Xinglin, et al.
Pubblicazione: (2025)
di: Pan, Xinglin, et al.
Pubblicazione: (2025)
Computational Grids
di: Foster, Ian, et al.
Pubblicazione: (2025)
di: Foster, Ian, et al.
Pubblicazione: (2025)
Many Hands Make Light Work: Accelerating Edge Inference via Multi-Client Collaborative Caching
di: Liang, Wenyi, et al.
Pubblicazione: (2024)
di: Liang, Wenyi, et al.
Pubblicazione: (2024)
Para-B&B: Load-Balanced Deterministic Parallelization of Solving MIP
di: Zhang, Jinyu, et al.
Pubblicazione: (2026)
di: Zhang, Jinyu, et al.
Pubblicazione: (2026)
PSI/J: A Portable Interface for Submitting, Monitoring, and Managing Jobs
di: Hategan-Marandiuc, Mihael, et al.
Pubblicazione: (2023)
di: Hategan-Marandiuc, Mihael, et al.
Pubblicazione: (2023)
Distributed Load Balancing with Workload-Dependent Service Rates
di: Zhang, Wenxin, et al.
Pubblicazione: (2024)
di: Zhang, Wenxin, et al.
Pubblicazione: (2024)
Documenti analoghi
-
WRATH: Workload Resilience Across Task Hierarchies in Task-based Parallel Programming Frameworks
di: Zhou, Sicheng, et al.
Pubblicazione: (2025) -
Octopus: Experiences with a Hybrid Event-Driven Architecture for Distributed Scientific Computing
di: Pan, Haochen, et al.
Pubblicazione: (2024) -
TaPS: A Performance Evaluation Suite for Task-based Execution Frameworks
di: Pauloski, J. Gregory, et al.
Pubblicazione: (2024) -
Core Hours and Carbon Credits: Incentivizing Sustainability in HPC
di: Kamatar, Alok, et al.
Pubblicazione: (2025) -
Addressing Reproducibility Challenges in HPC with Continuous Integration
di: Hayot-Sasson, Valérie, et al.
Pubblicazione: (2025)