ScaleFold: Reducing AlphaFold Initial Training Time to 10 Hours
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Feiwen, Nowaczynski, Arkadiusz, Li, Rundong, Xin, Jie, Song, Yifei, Marcinkiewicz, Michal, Eryilmaz, Sukru Burc, Yang, Jun, Andersch, Michael |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fold-CP: A Context Parallelism Framework for Biomolecular Modeling
di: Lin, Dejun, et al.
Pubblicazione: (2026)
di: Lin, Dejun, et al.
Pubblicazione: (2026)
APACE: AlphaFold2 and advanced computing as a service for accelerated discovery in biophysics
di: Park, Hyun, et al.
Pubblicazione: (2023)
di: Park, Hyun, et al.
Pubblicazione: (2023)
MoE Parallel Folding: Heterogeneous Parallelism Mappings for Efficient Large-Scale MoE Model Training with Megatron Core
di: Liu, Dennis, et al.
Pubblicazione: (2025)
di: Liu, Dennis, et al.
Pubblicazione: (2025)
GPU Acceleration of a Conjugate Exponential Model for Cancer Tissue Heterogeneity
di: Chaudhuri, Anik, et al.
Pubblicazione: (2024)
di: Chaudhuri, Anik, et al.
Pubblicazione: (2024)
Towards Scalable Proteomics: Opportunistic SMC Samplers on HTCondor
di: Carter, Matthew, et al.
Pubblicazione: (2025)
di: Carter, Matthew, et al.
Pubblicazione: (2025)
Search via Parallel Lévy Walks on $\mathbb{Z}^2$
di: Clementi, Andrea, et al.
Pubblicazione: (2020)
di: Clementi, Andrea, et al.
Pubblicazione: (2020)
Comparing CPU and GPU compute of PERMANOVA on MI300A
di: Sfiligoi, Igor
Pubblicazione: (2025)
di: Sfiligoi, Igor
Pubblicazione: (2025)
Folding Tensor and Sequence Parallelism for Memory-Efficient Transformer Training & Inference
di: Shyam, Vasu, et al.
Pubblicazione: (2026)
di: Shyam, Vasu, et al.
Pubblicazione: (2026)
Zen-Attention: A Compiler Framework for Dynamic Attention Folding on AMD NPUs
di: Deshmukh, Aadesh, et al.
Pubblicazione: (2025)
di: Deshmukh, Aadesh, et al.
Pubblicazione: (2025)
Revolutionizing MRI Data Processing Using FSL: Preliminary Findings with the Fugaku Supercomputer
di: Lyu, Tianxiang, et al.
Pubblicazione: (2024)
di: Lyu, Tianxiang, et al.
Pubblicazione: (2024)
Accelerating DNA Read Mapping with Digital Processing-in-Memory
di: Ben-Hur, Rotem, et al.
Pubblicazione: (2024)
di: Ben-Hur, Rotem, et al.
Pubblicazione: (2024)
brainlife.io: A decentralized and open source cloud platform to support neuroscience research
di: Hayashi, Soichi, et al.
Pubblicazione: (2023)
di: Hayashi, Soichi, et al.
Pubblicazione: (2023)
Cryo-RALib -- a modular library for accelerating alignment in cryo-EM
di: Chung, Szu-Chi, et al.
Pubblicazione: (2020)
di: Chung, Szu-Chi, et al.
Pubblicazione: (2020)
Optimization and Application of Cloud-based Deep Learning Architecture for Multi-Source Data Prediction
di: Zhang, Yang, et al.
Pubblicazione: (2024)
di: Zhang, Yang, et al.
Pubblicazione: (2024)
Circuit Folding: Scalable and Graph-Based Circuit Cutting via Modular Structure Exploitation
di: Kan, Shuwen, et al.
Pubblicazione: (2024)
di: Kan, Shuwen, et al.
Pubblicazione: (2024)
Non-Federated Multi-Task Split Learning for Heterogeneous Sources
di: Zheng, Yilin, et al.
Pubblicazione: (2024)
di: Zheng, Yilin, et al.
Pubblicazione: (2024)
Two-Fold Byzantine Fault Tolerance Algorithm: Byzantine Consensus in Blockchain
di: Shakournia, Mohammad R., et al.
Pubblicazione: (2025)
di: Shakournia, Mohammad R., et al.
Pubblicazione: (2025)
Optimal Parallel Scheduling under Concave Speedup Functions
di: Li, Chengzhang, et al.
Pubblicazione: (2025)
di: Li, Chengzhang, et al.
Pubblicazione: (2025)
Multiscale Parallel Simulation of Malignant Pleural Mesothelioma via Adaptive Domain Partitioning -- an Efficiency Analysis Study
di: Dolganov, Anton, et al.
Pubblicazione: (2025)
di: Dolganov, Anton, et al.
Pubblicazione: (2025)
FedRBE -- a decentralized privacy-preserving federated batch effect correction tool for omics data based on limma
di: Burankova, Yuliya, et al.
Pubblicazione: (2024)
di: Burankova, Yuliya, et al.
Pubblicazione: (2024)
AMSP: Reducing Communication Overhead of ZeRO for Efficient LLM Training
di: Chen, Qiaoling, et al.
Pubblicazione: (2023)
di: Chen, Qiaoling, et al.
Pubblicazione: (2023)
Understanding and Reducing Metadata-Driven Host Overheads in Sampling-Based GNN Training
di: Gong, Yidong, et al.
Pubblicazione: (2026)
di: Gong, Yidong, et al.
Pubblicazione: (2026)
exaCB: Reproducible Continuous Benchmark Collections at Scale Leveraging an Incremental Approach
di: Badwaik, Jayesh, et al.
Pubblicazione: (2026)
di: Badwaik, Jayesh, et al.
Pubblicazione: (2026)
Optimizing Distributed Training Approaches for Scaling Neural Networks
di: Baligodugula, Vishnu Vardhan, et al.
Pubblicazione: (2025)
di: Baligodugula, Vishnu Vardhan, et al.
Pubblicazione: (2025)
Reducing the Impact of I/O Contention in Numerical Weather Prediction Workflows at Scale Using DAOS
di: Manubens, Nicolau, et al.
Pubblicazione: (2024)
di: Manubens, Nicolau, et al.
Pubblicazione: (2024)
MegaFold: System-Level Optimizations for Accelerating Protein Structure Prediction Models
di: La, Hoa, et al.
Pubblicazione: (2025)
di: La, Hoa, et al.
Pubblicazione: (2025)
MegaScale-Omni: A Hyper-Scale, Workload-Resilient System for MultiModal LLM Training in Production
di: Xue, Chunyu, et al.
Pubblicazione: (2026)
di: Xue, Chunyu, et al.
Pubblicazione: (2026)
Poplar: Efficient Scaling of Distributed DNN Training on Heterogeneous GPU Clusters
di: Zhang, WenZheng, et al.
Pubblicazione: (2024)
di: Zhang, WenZheng, et al.
Pubblicazione: (2024)
HexiScale: Facilitating Large Language Model Training over Heterogeneous Hardware
di: Yan, Ran, et al.
Pubblicazione: (2024)
di: Yan, Ran, et al.
Pubblicazione: (2024)
An Engineering Journey Training Large Language Models at Scale on Alps: The Apertus Experience
di: Coles, Jonathan, et al.
Pubblicazione: (2026)
di: Coles, Jonathan, et al.
Pubblicazione: (2026)
RapidGNN: Communication Efficient Large-Scale Distributed Training of Graph Neural Networks
di: Niam, Arefin, et al.
Pubblicazione: (2025)
di: Niam, Arefin, et al.
Pubblicazione: (2025)
EMLIO: Minimizing I/O Latency and Energy Consumption for Large-Scale AI Training
di: Jamil, Hasibul, et al.
Pubblicazione: (2025)
di: Jamil, Hasibul, et al.
Pubblicazione: (2025)
PRISM: Probabilistic Runtime Insights and Scalable Performance Modeling for Large-Scale Distributed Training
di: Golden, Alicia, et al.
Pubblicazione: (2025)
di: Golden, Alicia, et al.
Pubblicazione: (2025)
Design and Analysis of an Extreme-Scale, High-Performance, and Modular Agent-Based Simulation Platform
di: Breitwieser, Lukas Johannes
Pubblicazione: (2025)
di: Breitwieser, Lukas Johannes
Pubblicazione: (2025)
Hexa-MoE: Efficient and Heterogeneous-aware Training for Mixture-of-Experts
di: Luo, Shuqing, et al.
Pubblicazione: (2024)
di: Luo, Shuqing, et al.
Pubblicazione: (2024)
Implementing True MPI Sessions and Evaluating MPI Initialization Scalability
di: Zhou, Hui, et al.
Pubblicazione: (2026)
di: Zhou, Hui, et al.
Pubblicazione: (2026)
An Initial Evaluation of Distributed Graph Algorithms using NWGraph and HPX
di: Mohammadiporshokooh, Karame, et al.
Pubblicazione: (2026)
di: Mohammadiporshokooh, Karame, et al.
Pubblicazione: (2026)
Initialization Matters: Unraveling the Impact of Pre-Training on Federated Learning
di: Jhunjhunwala, Divyansh, et al.
Pubblicazione: (2025)
di: Jhunjhunwala, Divyansh, et al.
Pubblicazione: (2025)
A Scalable Recipe on SuperMUC-NG Phase 2: Efficient Large-Scale Training of Language Models
di: Rajgopal, Ajay Navilarekal, et al.
Pubblicazione: (2026)
di: Rajgopal, Ajay Navilarekal, et al.
Pubblicazione: (2026)
Oases: Efficient Large-Scale Model Training on Commodity Servers via Overlapped and Automated Tensor Model Parallelism
di: Li, Shengwei, et al.
Pubblicazione: (2023)
di: Li, Shengwei, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Fold-CP: A Context Parallelism Framework for Biomolecular Modeling
di: Lin, Dejun, et al.
Pubblicazione: (2026) -
APACE: AlphaFold2 and advanced computing as a service for accelerated discovery in biophysics
di: Park, Hyun, et al.
Pubblicazione: (2023) -
MoE Parallel Folding: Heterogeneous Parallelism Mappings for Efficient Large-Scale MoE Model Training with Megatron Core
di: Liu, Dennis, et al.
Pubblicazione: (2025) -
GPU Acceleration of a Conjugate Exponential Model for Cancer Tissue Heterogeneity
di: Chaudhuri, Anik, et al.
Pubblicazione: (2024) -
Towards Scalable Proteomics: Opportunistic SMC Samplers on HTCondor
di: Carter, Matthew, et al.
Pubblicazione: (2025)