Enhancing Deep Learning with Optimized Gradient Descent: Bridging Numerical Methods and Neural Network Training
Fuente:
arXiv
Salvato in:
| Autori principali: | Ma, Yuhan, Sun, Dan, Gao, Erdi, Sang, Ningjing, Li, Iris, Huang, Guanming |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Research on Optimization of Natural Language Processing Model Based on Multimodal Deep Learning
di: Sun, Dan, et al.
Pubblicazione: (2024)
di: Sun, Dan, et al.
Pubblicazione: (2024)
Reconstructing Deep Neural Networks: Unleashing the Optimization Potential of Natural Gradient Descent
di: Liu, Weihua, et al.
Pubblicazione: (2024)
di: Liu, Weihua, et al.
Pubblicazione: (2024)
Text classification optimization algorithm based on graph neural network
di: Gao, Erdi, et al.
Pubblicazione: (2024)
di: Gao, Erdi, et al.
Pubblicazione: (2024)
Enhancing Convolutional Neural Networks with Higher-Order Numerical Difference Methods
di: Wang, Qi, et al.
Pubblicazione: (2024)
di: Wang, Qi, et al.
Pubblicazione: (2024)
Cross-Entropy Optimization for Hyperparameter Optimization in Stochastic Gradient-based Approaches to Train Deep Neural Networks
di: Li, Kevin, et al.
Pubblicazione: (2024)
di: Li, Kevin, et al.
Pubblicazione: (2024)
Trapezoidal Gradient Descent for Effective Reinforcement Learning in Spiking Networks
di: Pan, Yuhao, et al.
Pubblicazione: (2024)
di: Pan, Yuhao, et al.
Pubblicazione: (2024)
Fine-tuning Multi-hop Question Answering with Hierarchical Graph Network
di: Xiong, Guanming
Pubblicazione: (2020)
di: Xiong, Guanming
Pubblicazione: (2020)
On the Convergence of (Stochastic) Gradient Descent for Kolmogorov--Arnold Networks
di: Gao, Yihang, et al.
Pubblicazione: (2024)
di: Gao, Yihang, et al.
Pubblicazione: (2024)
Q-Newton: Hybrid Quantum-Classical Scheduling for Accelerating Neural Network Training with Newton's Gradient Descent
di: Li, Pingzhi, et al.
Pubblicazione: (2024)
di: Li, Pingzhi, et al.
Pubblicazione: (2024)
MAPGD: Multi-Agent Prompt Gradient Descent for Collaborative Prompt Optimization
di: Han, Yichen, et al.
Pubblicazione: (2025)
di: Han, Yichen, et al.
Pubblicazione: (2025)
Optimization, Generalization and Differential Privacy Bounds for Gradient Descent on Kolmogorov-Arnold Networks
di: Wang, Puyu, et al.
Pubblicazione: (2026)
di: Wang, Puyu, et al.
Pubblicazione: (2026)
Elastic Multi-Gradient Descent for Parallel Continual Learning
di: Lyu, Fan, et al.
Pubblicazione: (2024)
di: Lyu, Fan, et al.
Pubblicazione: (2024)
Learning Associative Memories with Gradient Descent
di: Cabannes, Vivien, et al.
Pubblicazione: (2024)
di: Cabannes, Vivien, et al.
Pubblicazione: (2024)
Contrastive Self-Supervised Learning As Neural Manifold Packing
di: Zhang, Guanming, et al.
Pubblicazione: (2025)
di: Zhang, Guanming, et al.
Pubblicazione: (2025)
Optimizing ML Training with Metagradient Descent
di: Engstrom, Logan, et al.
Pubblicazione: (2025)
di: Engstrom, Logan, et al.
Pubblicazione: (2025)
Activation-Descent Regularization for Input Optimization of ReLU Networks
di: Yu, Hongzhan, et al.
Pubblicazione: (2024)
di: Yu, Hongzhan, et al.
Pubblicazione: (2024)
Implementation and Evaluation of a Gradient Descent-Trained Defensible Blackboard Architecture System
di: Milbrath, Jordan, et al.
Pubblicazione: (2024)
di: Milbrath, Jordan, et al.
Pubblicazione: (2024)
Revisiting the Initial Steps in Adaptive Gradient Descent Optimization
di: Abuduweili, Abulikemu, et al.
Pubblicazione: (2024)
di: Abuduweili, Abulikemu, et al.
Pubblicazione: (2024)
Gradient-Free Training of Quantized Neural Networks
di: Cohen, Noa, et al.
Pubblicazione: (2024)
di: Cohen, Noa, et al.
Pubblicazione: (2024)
Transformers Learn to Implement Multi-step Gradient Descent with Chain of Thought
di: Huang, Jianhao, et al.
Pubblicazione: (2025)
di: Huang, Jianhao, et al.
Pubblicazione: (2025)
Beyond Rate Coding: Surrogate Gradients Enable Spike Timing Learning in Spiking Neural Networks
di: Yu, Ziqiao, et al.
Pubblicazione: (2025)
di: Yu, Ziqiao, et al.
Pubblicazione: (2025)
Turning Stale Gradients into Stable Gradients: Coherent Coordinate Descent with Implicit Landscape Smoothing for Lightweight Zeroth-Order Optimization
di: Liang, Chen, et al.
Pubblicazione: (2026)
di: Liang, Chen, et al.
Pubblicazione: (2026)
LION-DG: Layer-Informed Initialization with Deep Gradient Protocols for Accelerated Neural Network Training
di: Kim, Hyunjun
Pubblicazione: (2026)
di: Kim, Hyunjun
Pubblicazione: (2026)
Hierarchical Zero-Order Optimization for Deep Neural Networks
di: Cao, Sansheng, et al.
Pubblicazione: (2026)
di: Cao, Sansheng, et al.
Pubblicazione: (2026)
Signal-Adaptive Trust Regions for Gradient-Free Optimization of Recurrent Spiking Neural Networks
di: Li, Jinhao, et al.
Pubblicazione: (2026)
di: Li, Jinhao, et al.
Pubblicazione: (2026)
Stochastic Gradient Sampling for Enhancing Neural Networks Training
di: Yun, Juyoung
Pubblicazione: (2023)
di: Yun, Juyoung
Pubblicazione: (2023)
GLinSAT: The General Linear Satisfiability Neural Network Layer By Accelerated Gradient Descent
di: Zeng, Hongtai, et al.
Pubblicazione: (2024)
di: Zeng, Hongtai, et al.
Pubblicazione: (2024)
Enhancing Stochastic Gradient Descent: A Unified Framework and Novel Acceleration Methods for Faster Convergence
di: Deng, Yichuan, et al.
Pubblicazione: (2024)
di: Deng, Yichuan, et al.
Pubblicazione: (2024)
The Initialization Determines Whether In-Context Learning Is Gradient Descent
di: Xie, Shifeng, et al.
Pubblicazione: (2025)
di: Xie, Shifeng, et al.
Pubblicazione: (2025)
Conflict-Averse Gradient Descent for Multi-task Learning
di: Liu, Bo, et al.
Pubblicazione: (2021)
di: Liu, Bo, et al.
Pubblicazione: (2021)
Single-agent Reinforcement Learning Model for Regional Adaptive Traffic Signal Control
di: Li, Qiang, et al.
Pubblicazione: (2025)
di: Li, Qiang, et al.
Pubblicazione: (2025)
Stochastic Re-weighted Gradient Descent via Distributionally Robust Optimization
di: Kumar, Ramnath, et al.
Pubblicazione: (2023)
di: Kumar, Ramnath, et al.
Pubblicazione: (2023)
KPFlow: An Operator Perspective on Dynamic Collapse Under Gradient Descent Training of Recurrent Networks
di: Hazelden, James, et al.
Pubblicazione: (2025)
di: Hazelden, James, et al.
Pubblicazione: (2025)
Gradient Descent Algorithm Survey
di: Fucheng, Deng, et al.
Pubblicazione: (2025)
di: Fucheng, Deng, et al.
Pubblicazione: (2025)
Axiomatization of Gradient Smoothing in Neural Networks
di: Zhou, Linjiang, et al.
Pubblicazione: (2024)
di: Zhou, Linjiang, et al.
Pubblicazione: (2024)
A Numerical Gradient Inversion Attack in Variational Quantum Neural-Networks
di: Papadopoulos, Georgios, et al.
Pubblicazione: (2025)
di: Papadopoulos, Georgios, et al.
Pubblicazione: (2025)
Self-Abstraction Learning for Effective and Stable Training of Deep Neural Networks
di: Cho, Wonyong, et al.
Pubblicazione: (2026)
di: Cho, Wonyong, et al.
Pubblicazione: (2026)
A Triple-Inertial Accelerated Alternating Optimization Method for Deep Learning Training
di: Yan, Chengcheng, et al.
Pubblicazione: (2025)
di: Yan, Chengcheng, et al.
Pubblicazione: (2025)
Geodesic Gradient Descent: A Generic and Learning-rate-free Optimizer on Objective Function-induced Manifolds
di: Hu, Liwei, et al.
Pubblicazione: (2026)
di: Hu, Liwei, et al.
Pubblicazione: (2026)
Beyond the Mean: Fisher-Orthogonal Projection for Natural Gradient Descent in Large Batch Training
di: Lu, Yishun, et al.
Pubblicazione: (2025)
di: Lu, Yishun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Research on Optimization of Natural Language Processing Model Based on Multimodal Deep Learning
di: Sun, Dan, et al.
Pubblicazione: (2024) -
Reconstructing Deep Neural Networks: Unleashing the Optimization Potential of Natural Gradient Descent
di: Liu, Weihua, et al.
Pubblicazione: (2024) -
Text classification optimization algorithm based on graph neural network
di: Gao, Erdi, et al.
Pubblicazione: (2024) -
Enhancing Convolutional Neural Networks with Higher-Order Numerical Difference Methods
di: Wang, Qi, et al.
Pubblicazione: (2024) -
Cross-Entropy Optimization for Hyperparameter Optimization in Stochastic Gradient-based Approaches to Train Deep Neural Networks
di: Li, Kevin, et al.
Pubblicazione: (2024)