Breaking the Training Barrier of Billion-Parameter Universal Machine Learning Interatomic Potentials
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhou, Yuanchang, Wang, Hongyu, Du, Yiming, Wang, Yan, Li, Mingzhen, Hu, Siyu, Zhang, Xiangyu, Liu, Weijian, Wang, Chen, Guo, Zhuoqiang, Wang, Long, Bu, Jingde, Lu, Yutong, Tan, Guangming, Jia, Weile |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
JanusPipe: Efficient Pipeline Parallel Training for Machine Learning Interatomic Potentials
di: Wang, Hongyu, et al.
Pubblicazione: (2026)
di: Wang, Hongyu, et al.
Pubblicazione: (2026)
FastCHGNet: Training one Universal Interatomic Potential to 1.5 Hours with 32 GPUs
di: Zhou, Yuanchang, et al.
Pubblicazione: (2024)
di: Zhou, Yuanchang, et al.
Pubblicazione: (2024)
Deep Learning-Enabled Supercritical Flame Simulation at Detailed Chemistry and Real-Fluid Accuracy Towards Trillion-Cell Scale
di: Guo, Zhuoqiang, et al.
Pubblicazione: (2025)
di: Guo, Zhuoqiang, et al.
Pubblicazione: (2025)
Large-scale Neural Network Quantum States for ab initio Quantum Chemistry Simulations on Fugaku
di: Xu, Hongtao, et al.
Pubblicazione: (2025)
di: Xu, Hongtao, et al.
Pubblicazione: (2025)
Large Scale Finite-Temperature Real-time Time Dependent Density Functional Theory Calculation with Hybrid Functional on ARM and GPU Systems
di: Liu, Rongrong, et al.
Pubblicazione: (2025)
di: Liu, Rongrong, et al.
Pubblicazione: (2025)
Scaling Molecular Dynamics with ab initio Accuracy to 149 Nanoseconds per Day
di: Li, Jianxiong, et al.
Pubblicazione: (2024)
di: Li, Jianxiong, et al.
Pubblicazione: (2024)
Nezha: Breaking Multi-Rail Network Barriers for Distributed DNN Training
di: Yu, Enda, et al.
Pubblicazione: (2024)
di: Yu, Enda, et al.
Pubblicazione: (2024)
HYDRA: Breaking the Global Ordering Barrier in Multi-BFT Consensus
di: Lyu, Hanzheng, et al.
Pubblicazione: (2025)
di: Lyu, Hanzheng, et al.
Pubblicazione: (2025)
Efficient Long Context Fine-tuning with Chunk Flow
di: Yuan, Xiulong, et al.
Pubblicazione: (2025)
di: Yuan, Xiulong, et al.
Pubblicazione: (2025)
SDSL-Solver: Scalable Distributed Sparse Linear Solvers for Large-Scale Interior Point Methods
di: Yang, Shaofeng, et al.
Pubblicazione: (2026)
di: Yang, Shaofeng, et al.
Pubblicazione: (2026)
Scaling Neural-Network-Based Molecular Dynamics with Long-Range Electrostatic Interactions to 51 Nanoseconds per Day
di: Li, Jianxiong, et al.
Pubblicazione: (2025)
di: Li, Jianxiong, et al.
Pubblicazione: (2025)
HAP: SPMD DNN Training on Heterogeneous GPU Clusters with Automated Program Synthesis
di: Zhang, Shiwei, et al.
Pubblicazione: (2024)
di: Zhang, Shiwei, et al.
Pubblicazione: (2024)
HopGNN: Boosting Distributed GNN Training Efficiency via Feature-Centric Model Migration
di: Chen, Weijian, et al.
Pubblicazione: (2024)
di: Chen, Weijian, et al.
Pubblicazione: (2024)
SWIFT: Expedited Failure Recovery for Large-scale DNN Training
di: Zhong, Yuchen, et al.
Pubblicazione: (2023)
di: Zhong, Yuchen, et al.
Pubblicazione: (2023)
Will LLMs Scaling Hit the Wall? Breaking Barriers via Distributed Resources on Massive Edge Devices
di: Shen, Tao, et al.
Pubblicazione: (2025)
di: Shen, Tao, et al.
Pubblicazione: (2025)
ATLAS: Efficient Out-of-Core Inference for Billion-Scale Graph Neural Networks
di: Naman, Pranjal, et al.
Pubblicazione: (2026)
di: Naman, Pranjal, et al.
Pubblicazione: (2026)
AMPED: Accelerating MTTKRP for Billion-Scale Sparse Tensor Decomposition on Multiple GPUs
di: Wijeratne, Sasindu, et al.
Pubblicazione: (2025)
di: Wijeratne, Sasindu, et al.
Pubblicazione: (2025)
BANG: Billion-Scale Approximate Nearest Neighbor Search using a Single GPU
di: V., Karthik, et al.
Pubblicazione: (2024)
di: V., Karthik, et al.
Pubblicazione: (2024)
Investigating Sharding Advancements, Methodologies, and Adoption Potential in Hedera
di: Wang, Ziwei, et al.
Pubblicazione: (2025)
di: Wang, Ziwei, et al.
Pubblicazione: (2025)
Federated Full-Parameter Tuning of Billion-Sized Language Models with Communication Cost under 18 Kilobytes
di: Qin, Zhen, et al.
Pubblicazione: (2023)
di: Qin, Zhen, et al.
Pubblicazione: (2023)
DSig: Breaking the Barrier of Signatures in Data Centers
di: Aguilera, Marcos K., et al.
Pubblicazione: (2024)
di: Aguilera, Marcos K., et al.
Pubblicazione: (2024)
Schedule-Level Shared-Prefix Reuse for LLM RL Training
di: Li, Pengbo, et al.
Pubblicazione: (2026)
di: Li, Pengbo, et al.
Pubblicazione: (2026)
GriNNder: Breaking the Memory Capacity Wall in Full-Graph GNN Training with Storage Offloading
di: Song, Jaeyong, et al.
Pubblicazione: (2026)
di: Song, Jaeyong, et al.
Pubblicazione: (2026)
Heta: Distributed Training of Heterogeneous Graph Neural Networks
di: Zhong, Yuchen, et al.
Pubblicazione: (2024)
di: Zhong, Yuchen, et al.
Pubblicazione: (2024)
MeCeFO: Enhancing LLM Training Robustness via Fault-Tolerant Optimization
di: Hu, Rizhen, et al.
Pubblicazione: (2025)
di: Hu, Rizhen, et al.
Pubblicazione: (2025)
Characterizing the Dilemma of Performance and Index Size in Billion-Scale Vector Search and Breaking It with Second-Tier Memory
di: Cheng, Rongxin, et al.
Pubblicazione: (2024)
di: Cheng, Rongxin, et al.
Pubblicazione: (2024)
HARP: Orchestrating Automated Parallel Training on Heterogeneous GPU Clusters
di: Liang, Antian, et al.
Pubblicazione: (2025)
di: Liang, Antian, et al.
Pubblicazione: (2025)
Mosaic: Towards Efficient Training of Multimodal Models with Spatial Resource Multiplexing
di: Wang, Yanbo, et al.
Pubblicazione: (2026)
di: Wang, Yanbo, et al.
Pubblicazione: (2026)
Accelerating Distributed MoE Training and Inference with Lina
di: Li, Jiamin, et al.
Pubblicazione: (2022)
di: Li, Jiamin, et al.
Pubblicazione: (2022)
TSUE: A Two-Stage Data Update Method for an Erasure Coded Cluster File System
di: Wei, Zheng, et al.
Pubblicazione: (2025)
di: Wei, Zheng, et al.
Pubblicazione: (2025)
Overcoming Memory Constraints in Quantum Circuit Simulation with a High-Fidelity Compression Framework
di: Zhang, Boyuan, et al.
Pubblicazione: (2024)
di: Zhang, Boyuan, et al.
Pubblicazione: (2024)
Accelerating Compound LLM Training Workloads with Maestro
di: Yuan, Xiulong, et al.
Pubblicazione: (2026)
di: Yuan, Xiulong, et al.
Pubblicazione: (2026)
LoRA-C: Parameter-Efficient Fine-Tuning of Robust CNN for IoT Devices
di: Ding, Chuntao, et al.
Pubblicazione: (2024)
di: Ding, Chuntao, et al.
Pubblicazione: (2024)
Neutron particle transport 3D method of characteristic Multi GPU platform Parallel Computing
di: Zhou, Faguo, et al.
Pubblicazione: (2025)
di: Zhou, Faguo, et al.
Pubblicazione: (2025)
StarTrail: Concentric Ring Sequence Parallelism for Efficient Near-Infinite-Context Transformer Model Training
di: Liu, Ziming, et al.
Pubblicazione: (2024)
di: Liu, Ziming, et al.
Pubblicazione: (2024)
Extracting the Potential of Emerging Hardware Accelerators for Symmetric Eigenvalue Decomposition
di: Wang, Hansheng, et al.
Pubblicazione: (2024)
di: Wang, Hansheng, et al.
Pubblicazione: (2024)
Adaptra: Straggler-Resilient Hybrid-Parallel Training with Pipeline Adaptation
di: Wu, Tianyuan, et al.
Pubblicazione: (2025)
di: Wu, Tianyuan, et al.
Pubblicazione: (2025)
On the Performance and Memory Footprint of Distributed Training: An Empirical Study on Transformers
di: Lu, Zhengxian, et al.
Pubblicazione: (2024)
di: Lu, Zhengxian, et al.
Pubblicazione: (2024)
DiffusionPipe: Training Large Diffusion Models with Efficient Pipelines
di: Tian, Ye, et al.
Pubblicazione: (2024)
di: Tian, Ye, et al.
Pubblicazione: (2024)
Barrier-Augmented Lagrangian for GPU-based Elastodynamic Contact
di: Guo, Dewen, et al.
Pubblicazione: (2024)
di: Guo, Dewen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
JanusPipe: Efficient Pipeline Parallel Training for Machine Learning Interatomic Potentials
di: Wang, Hongyu, et al.
Pubblicazione: (2026) -
FastCHGNet: Training one Universal Interatomic Potential to 1.5 Hours with 32 GPUs
di: Zhou, Yuanchang, et al.
Pubblicazione: (2024) -
Deep Learning-Enabled Supercritical Flame Simulation at Detailed Chemistry and Real-Fluid Accuracy Towards Trillion-Cell Scale
di: Guo, Zhuoqiang, et al.
Pubblicazione: (2025) -
Large-scale Neural Network Quantum States for ab initio Quantum Chemistry Simulations on Fugaku
di: Xu, Hongtao, et al.
Pubblicazione: (2025) -
Large Scale Finite-Temperature Real-time Time Dependent Density Functional Theory Calculation with Hybrid Functional on ARM and GPU Systems
di: Liu, Rongrong, et al.
Pubblicazione: (2025)