A Triple-Inertial Accelerated Alternating Optimization Method for Deep Learning Training
Fuente:
arXiv
Guardado en:
| Autores principales: | Yan, Chengcheng, Xu, Jiawei, Wang, Qingsong, Peng, Zheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Neural Network Training via Stochastic Alternating Minimization with Trainable Step Sizes
por: Yan, Chengcheng, et al.
Publicado: (2025)
por: Yan, Chengcheng, et al.
Publicado: (2025)
Training with Confidence: Catching Silent Errors in Deep Learning Training with Automated Proactive Checks
por: Jiang, Yuxuan, et al.
Publicado: (2025)
por: Jiang, Yuxuan, et al.
Publicado: (2025)
Enhancing Deep Learning with Optimized Gradient Descent: Bridging Numerical Methods and Neural Network Training
por: Ma, Yuhan, et al.
Publicado: (2024)
por: Ma, Yuhan, et al.
Publicado: (2024)
XQC: Well-conditioned Optimization Accelerates Deep Reinforcement Learning
por: Palenicek, Daniel, et al.
Publicado: (2025)
por: Palenicek, Daniel, et al.
Publicado: (2025)
MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts
por: Jin, Peng, et al.
Publicado: (2024)
por: Jin, Peng, et al.
Publicado: (2024)
QuAIL: Quality-Aware Inertial Learning for Robust Training under Data Corruption
por: Sabella, Mattia, et al.
Publicado: (2026)
por: Sabella, Mattia, et al.
Publicado: (2026)
CrossQuant: A Post-Training Quantization Method with Smaller Quantization Kernel for Precise Large Language Model Compression
por: Liu, Wenyuan, et al.
Publicado: (2024)
por: Liu, Wenyuan, et al.
Publicado: (2024)
MoNTA: Accelerating Mixture-of-Experts Training with Network-Traffc-Aware Parallel Optimization
por: Guo, Jingming, et al.
Publicado: (2024)
por: Guo, Jingming, et al.
Publicado: (2024)
Deep Learning for Multivariate Time Series Imputation: A Survey
por: Wang, Jun, et al.
Publicado: (2024)
por: Wang, Jun, et al.
Publicado: (2024)
Efficient Deep Learning Board: Training Feedback Is Not All You Need
por: Gong, Lina, et al.
Publicado: (2024)
por: Gong, Lina, et al.
Publicado: (2024)
Plasticine: Accelerating Research in Plasticity-Motivated Deep Reinforcement Learning
por: Yuan, Mingqi, et al.
Publicado: (2025)
por: Yuan, Mingqi, et al.
Publicado: (2025)
TriCon-SF: A Triple-Shuffle and Contribution-Aware Serial Federated Learning Framework for Heterogeneous Healthcare Data
por: Yan, Yuping, et al.
Publicado: (2025)
por: Yan, Yuping, et al.
Publicado: (2025)
Beyond Precision: Training-Inference Mismatch is an Optimization Problem and Simple LR Scheduling Fixes It
por: Zhang, Yaxiang, et al.
Publicado: (2026)
por: Zhang, Yaxiang, et al.
Publicado: (2026)
Deep Learning Model Acceleration and Optimization Strategies for Real-Time Recommendation Systems
por: Shao, Junli, et al.
Publicado: (2025)
por: Shao, Junli, et al.
Publicado: (2025)
Adaptive Friction in Deep Learning: Enhancing Optimizers with Sigmoid and Tanh Function
por: Zheng, Hongye, et al.
Publicado: (2024)
por: Zheng, Hongye, et al.
Publicado: (2024)
DoorINet: Door Heading Prediction through Inertial Deep Learning
por: Zakharchenko, Aleksei, et al.
Publicado: (2024)
por: Zakharchenko, Aleksei, et al.
Publicado: (2024)
Provable Acceleration of Nesterov's Accelerated Gradient Method over Heavy Ball Method in Training Over-Parameterized Neural Networks
por: Liu, Xin, et al.
Publicado: (2022)
por: Liu, Xin, et al.
Publicado: (2022)
A Survey on Deep Learning based Time Series Analysis with Frequency Transformation
por: Yi, Kun, et al.
Publicado: (2023)
por: Yi, Kun, et al.
Publicado: (2023)
A Historical Trajectory Assisted Optimization Method for Zeroth-Order Federated Learning
por: Wu, Chenlin, et al.
Publicado: (2024)
por: Wu, Chenlin, et al.
Publicado: (2024)
Part II: ROLL Flash -- Accelerating RLVR and Agentic Training with Asynchrony
por: Lu, Han, et al.
Publicado: (2025)
por: Lu, Han, et al.
Publicado: (2025)
GSR-GNN: Training Acceleration and Memory-Saving Framework of Deep GNNs on Circuit Graph
por: Luo, Yuebo, et al.
Publicado: (2026)
por: Luo, Yuebo, et al.
Publicado: (2026)
Acceleration for Deep Reinforcement Learning using Parallel and Distributed Computing: A Survey
por: Liu, Zhihong, et al.
Publicado: (2024)
por: Liu, Zhihong, et al.
Publicado: (2024)
IDInit: A Universal and Stable Initialization Method for Neural Network Training
por: Pan, Yu, et al.
Publicado: (2025)
por: Pan, Yu, et al.
Publicado: (2025)
Learning to Optimize for Reinforcement Learning
por: Lan, Qingfeng, et al.
Publicado: (2023)
por: Lan, Qingfeng, et al.
Publicado: (2023)
GRExplainer: A Universal Explanation Method for Temporal Graph Neural Networks
por: Li, Xuyan, et al.
Publicado: (2025)
por: Li, Xuyan, et al.
Publicado: (2025)
SPAP: Structured Pruning via Alternating Optimization and Penalty Methods
por: Hu, Hanyu, et al.
Publicado: (2025)
por: Hu, Hanyu, et al.
Publicado: (2025)
A Closer Look at Time Steps is Worthy of Triple Speed-Up for Diffusion Model Training
por: Wang, Kai, et al.
Publicado: (2024)
por: Wang, Kai, et al.
Publicado: (2024)
Advanced Deep Learning Methods for Protein Structure Prediction and Design
por: Zhang, Yichao, et al.
Publicado: (2025)
por: Zhang, Yichao, et al.
Publicado: (2025)
Deep Reinforcement Learning for Solving the Fleet Size and Mix Vehicle Routing Problem
por: Wan, Pengfu, et al.
Publicado: (2025)
por: Wan, Pengfu, et al.
Publicado: (2025)
Deep Learning and Machine Learning, Advancing Big Data Analytics and Management: Tensorflow Pretrained Models
por: Chen, Keyu, et al.
Publicado: (2024)
por: Chen, Keyu, et al.
Publicado: (2024)
InertialAR: Autoregressive 3D Molecule Generation with Inertial Frames
por: Li, Haorui, et al.
Publicado: (2025)
por: Li, Haorui, et al.
Publicado: (2025)
LION-DG: Layer-Informed Initialization with Deep Gradient Protocols for Accelerated Neural Network Training
por: Kim, Hyunjun
Publicado: (2026)
por: Kim, Hyunjun
Publicado: (2026)
MixGCN: Scalable GCN Training by Mixture of Parallelism and Mixture of Accelerators
por: Wan, Cheng, et al.
Publicado: (2025)
por: Wan, Cheng, et al.
Publicado: (2025)
Relative Policy-Transition Optimization for Fast Policy Transfer
por: Xu, Jiawei, et al.
Publicado: (2022)
por: Xu, Jiawei, et al.
Publicado: (2022)
Slow-Fast Inference: Training-Free Inference Acceleration via Within-Sentence Support Stability
por: Xie, Xingyu, et al.
Publicado: (2026)
por: Xie, Xingyu, et al.
Publicado: (2026)
A Generic Layer Pruning Method for Signal Modulation Recognition Deep Learning Models
por: Lu, Yao, et al.
Publicado: (2024)
por: Lu, Yao, et al.
Publicado: (2024)
Joint Link Adaptation and Device Scheduling Approach for URLLC Industrial IoT Network: A DRL-based Method with Bayesian Optimization
por: Gao, Wei, et al.
Publicado: (2025)
por: Gao, Wei, et al.
Publicado: (2025)
iMoT: Inertial Motion Transformer for Inertial Navigation
por: Nguyen, Son Minh, et al.
Publicado: (2024)
por: Nguyen, Son Minh, et al.
Publicado: (2024)
Towards Faster Training of Diffusion Models: An Inspiration of A Consistency Phenomenon
por: Xu, Tianshuo, et al.
Publicado: (2024)
por: Xu, Tianshuo, et al.
Publicado: (2024)
On the Surprising Efficacy of Distillation as an Alternative to Pre-Training Small Models
por: Farhat, Sean, et al.
Publicado: (2024)
por: Farhat, Sean, et al.
Publicado: (2024)
Ejemplares similares
-
Neural Network Training via Stochastic Alternating Minimization with Trainable Step Sizes
por: Yan, Chengcheng, et al.
Publicado: (2025) -
Training with Confidence: Catching Silent Errors in Deep Learning Training with Automated Proactive Checks
por: Jiang, Yuxuan, et al.
Publicado: (2025) -
Enhancing Deep Learning with Optimized Gradient Descent: Bridging Numerical Methods and Neural Network Training
por: Ma, Yuhan, et al.
Publicado: (2024) -
XQC: Well-conditioned Optimization Accelerates Deep Reinforcement Learning
por: Palenicek, Daniel, et al.
Publicado: (2025) -
MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts
por: Jin, Peng, et al.
Publicado: (2024)