Plexus: Taming Billion-edge Graphs with 3D Parallel Full-graph GNN Training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ranjan, Aditya K., Singh, Siddharth, Wei, Cunyang, Bhatele, Abhinav |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Communication-free Sampling and 4D Hybrid Parallelism for Scalable Mini-batch GNN Training
par: Wei, Cunyang, et autres
Publié: (2026)
par: Wei, Cunyang, et autres
Publié: (2026)
A 4D Hybrid Algorithm to Scale Parallel Training to Thousands of GPUs
par: Singh, Siddharth, et autres
Publié: (2023)
par: Singh, Siddharth, et autres
Publié: (2023)
The Big Send-off: Scalable and Performant Collectives for Deep Learning
par: Singh, Siddharth, et autres
Publié: (2025)
par: Singh, Siddharth, et autres
Publié: (2025)
HPC-Coder: Modeling Parallel Programs using Large Language Models
par: Nichols, Daniel, et autres
Publié: (2023)
par: Nichols, Daniel, et autres
Publié: (2023)
HPC-Coder-V2: Studying Code LLMs Across Low-Resource Parallel Languages
par: Chaturvedi, Aman, et autres
Publié: (2024)
par: Chaturvedi, Aman, et autres
Publié: (2024)
Democratizing AI: Open-source Scalable LLM Training on GPU-based Supercomputers
par: Singh, Siddharth, et autres
Publié: (2025)
par: Singh, Siddharth, et autres
Publié: (2025)
Can Large Language Models Write Parallel Code?
par: Nichols, Daniel, et autres
Publié: (2024)
par: Nichols, Daniel, et autres
Publié: (2024)
Pipit: Scripting the analysis of parallel execution traces
par: Bhatele, Abhinav, et autres
Publié: (2023)
par: Bhatele, Abhinav, et autres
Publié: (2023)
NeutronTP: Load-Balanced Distributed Full-Graph GNN Training with Tensor Parallelism
par: Ai, Xin, et autres
Publié: (2024)
par: Ai, Xin, et autres
Publié: (2024)
Automated Programmatic Performance Analysis of Parallel Programs
par: Cankur, Onur, et autres
Publié: (2024)
par: Cankur, Onur, et autres
Publié: (2024)
ResiHP: Taming LLM Training Failures with Dynamic Hybrid Parallelism
par: Ma, Tenghui, et autres
Publié: (2026)
par: Ma, Tenghui, et autres
Publié: (2026)
GriNNder: Breaking the Memory Capacity Wall in Full-Graph GNN Training with Storage Offloading
par: Song, Jaeyong, et autres
Publié: (2026)
par: Song, Jaeyong, et autres
Publié: (2026)
Characterizing Production GPU Workloads using System-wide Telemetry Data
par: Cankur, Onur, et autres
Publié: (2025)
par: Cankur, Onur, et autres
Publié: (2025)
ParEval-Repo: A Benchmark Suite for Evaluating LLMs with Repository-level HPC Translation Tasks
par: Davis, Joshua H., et autres
Publié: (2025)
par: Davis, Joshua H., et autres
Publié: (2025)
ML-based Modeling to Predict I/O Performance on Different Storage Sub-systems
par: Xu, Yiheng, et autres
Publié: (2023)
par: Xu, Yiheng, et autres
Publié: (2023)
Analytics of Longitudinal System Monitoring Data for Performance Prediction
par: Costello, Ian J., et autres
Publié: (2020)
par: Costello, Ian J., et autres
Publié: (2020)
Understanding and Improving Communication Performance in Multi-node LLM Inference
par: Singhania, Prajwal, et autres
Publié: (2025)
par: Singhania, Prajwal, et autres
Publié: (2025)
CondenseGraph: Communication-Efficient Distributed GNN Training via On-the-Fly Graph Condensation
par: Zhang, Zizhao, et autres
Publié: (2026)
par: Zhang, Zizhao, et autres
Publié: (2026)
Performance-Aligned LLMs for Generating Fast Code
par: Nichols, Daniel, et autres
Publié: (2024)
par: Nichols, Daniel, et autres
Publié: (2024)
D3-GNN: Dynamic Distributed Dataflow for Streaming Graph Neural Networks
par: Guliyev, Rustam, et autres
Publié: (2024)
par: Guliyev, Rustam, et autres
Publié: (2024)
RapidGNN: Communication Efficient Large-Scale Distributed Training of Graph Neural Networks
par: Niam, Arefin, et autres
Publié: (2025)
par: Niam, Arefin, et autres
Publié: (2025)
UnifyFL: Enabling Decentralized Cross-Silo Federated Learning
par: S, Sarang, et autres
Publié: (2025)
par: S, Sarang, et autres
Publié: (2025)
GreenDyGNN: Runtime-Adaptive Energy-Efficient Communication for Distributed GNN Training
par: Niam, Arefin, et autres
Publié: (2026)
par: Niam, Arefin, et autres
Publié: (2026)
HopGNN: Boosting Distributed GNN Training Efficiency via Feature-Centric Model Migration
par: Chen, Weijian, et autres
Publié: (2024)
par: Chen, Weijian, et autres
Publié: (2024)
Scalable and Adaptive Parallel Training of Graph Transformer on Large Graphs
par: Lin, Jun-Liang, et autres
Publié: (2026)
par: Lin, Jun-Liang, et autres
Publié: (2026)
DistShap: Scalable GNN Explanations with Distributed Shapley Values
par: Akkas, Selahattin, et autres
Publié: (2025)
par: Akkas, Selahattin, et autres
Publié: (2025)
Training Through Failure: Effects of Data Consistency in Parallel Machine Learning Training
par: Cao, Ray, et autres
Publié: (2024)
par: Cao, Ray, et autres
Publié: (2024)
ATLAS: Efficient Out-of-Core Inference for Billion-Scale Graph Neural Networks
par: Naman, Pranjal, et autres
Publié: (2026)
par: Naman, Pranjal, et autres
Publié: (2026)
Collaborative Split Federated Learning with Parallel Training and Aggregation
par: Papageorgiou, Yiannis, et autres
Publié: (2025)
par: Papageorgiou, Yiannis, et autres
Publié: (2025)
Incremental GNN Embedding Computation on Streaming Graphs
par: Wang, Qiange, et autres
Publié: (2026)
par: Wang, Qiange, et autres
Publié: (2026)
A Unified CPU-GPU Protocol for GNN Training
par: Lin, Yi-Chien, et autres
Publié: (2024)
par: Lin, Yi-Chien, et autres
Publié: (2024)
TACO: Efficient Communication Compression of Intermediate Tensors for Scalable Tensor-Parallel LLM Training
par: Liu, Man, et autres
Publié: (2026)
par: Liu, Man, et autres
Publié: (2026)
GraphPipe: Improving Performance and Scalability of DNN Training with Graph Pipeline Parallelism
par: Jeon, Byungsoo, et autres
Publié: (2024)
par: Jeon, Byungsoo, et autres
Publié: (2024)
BANG: Billion-Scale Approximate Nearest Neighbor Search using a Single GPU
par: V., Karthik, et autres
Publié: (2024)
par: V., Karthik, et autres
Publié: (2024)
RIPPLE++: An Incremental Framework for Efficient GNN Inference on Evolving Graphs
par: Naman, Pranjal, et autres
Publié: (2026)
par: Naman, Pranjal, et autres
Publié: (2026)
Ripple: Scalable Incremental GNN Inferencing on Large Streaming Graphs
par: Naman, Pranjal, et autres
Publié: (2025)
par: Naman, Pranjal, et autres
Publié: (2025)
Chameleon: Taming Dynamic Operator Sequences for Memory-Intensive LLM Training
par: Wang, Zibo, et autres
Publié: (2025)
par: Wang, Zibo, et autres
Publié: (2025)
Taming the Chaos: Coordinated Autoscaling for Heterogeneous and Disaggregated LLM Inference
par: Li, Rongzhi, et autres
Publié: (2025)
par: Li, Rongzhi, et autres
Publié: (2025)
Accelerating Long-Tail Generation in Synchronous RLHF Training via Adaptive Tensor Parallelism
par: Zhao, Long, et autres
Publié: (2026)
par: Zhao, Long, et autres
Publié: (2026)
CaPGNN: Optimizing Parallel Graph Neural Network Training with Joint Caching and Resource-Aware Graph Partitioning
par: Song, Xianfeng, et autres
Publié: (2025)
par: Song, Xianfeng, et autres
Publié: (2025)
Documents similaires
-
Communication-free Sampling and 4D Hybrid Parallelism for Scalable Mini-batch GNN Training
par: Wei, Cunyang, et autres
Publié: (2026) -
A 4D Hybrid Algorithm to Scale Parallel Training to Thousands of GPUs
par: Singh, Siddharth, et autres
Publié: (2023) -
The Big Send-off: Scalable and Performant Collectives for Deep Learning
par: Singh, Siddharth, et autres
Publié: (2025) -
HPC-Coder: Modeling Parallel Programs using Large Language Models
par: Nichols, Daniel, et autres
Publié: (2023) -
HPC-Coder-V2: Studying Code LLMs Across Low-Resource Parallel Languages
par: Chaturvedi, Aman, et autres
Publié: (2024)