AdamNX: An Adam improvement algorithm based on a novel exponential decay mechanism for the second-order moment estimate
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhu, Meng, Xiao, Quan, Min, Weidong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FlowAdam: Implicit Regularization via Geometry-Aware Soft Momentum Injection
par: Singh, Devender, et autres
Publié: (2026)
par: Singh, Devender, et autres
Publié: (2026)
Fusing Rewards and Preferences in Reinforcement Learning
par: Khorasani, Sadegh, et autres
Publié: (2025)
par: Khorasani, Sadegh, et autres
Publié: (2025)
Hidden Failure Modes of Gradient Modification under Adam in Continual Learning, and Adaptive Decoupled Moment Routing as a Repair
par: Hu, Yuelin, et autres
Publié: (2026)
par: Hu, Yuelin, et autres
Publié: (2026)
AI and Machine Learning Approaches for Predicting Nanoparticles Toxicity The Critical Role of Physiochemical Properties
par: Yousaf, Iqra
Publié: (2024)
par: Yousaf, Iqra
Publié: (2024)
Deep Memory Search: A Metaheuristic Approach for Optimizing Heuristic Search
par: Hedar, Abdel-Rahman, et autres
Publié: (2024)
par: Hedar, Abdel-Rahman, et autres
Publié: (2024)
Kourkoutas-Beta: A Sunspike-Driven Adam Optimizer with Desert Flair
par: Kassinos, Stavros C.
Publié: (2025)
par: Kassinos, Stavros C.
Publié: (2025)
Predicting and improving test-time scaling laws via reward tail-guided search
par: Li, Muheng, et autres
Publié: (2026)
par: Li, Muheng, et autres
Publié: (2026)
NoRIN: Backbone-Adaptive Reversible Normalization for Time-Series Forecasting
par: Zhang, Shun, et autres
Publié: (2026)
par: Zhang, Shun, et autres
Publié: (2026)
TIFeD: a Tiny Integer-based Federated learning algorithm with Direct feedback alignment
par: Colombo, Luca, et autres
Publié: (2024)
par: Colombo, Luca, et autres
Publié: (2024)
Adaptive Epsilon Adversarial Training for Robust Gravitational Wave Parameter Estimation Using Normalizing Flows
par: Yang, Yiqian, et autres
Publié: (2024)
par: Yang, Yiqian, et autres
Publié: (2024)
rmlnomogram: An R package to construct an explainable nomogram for any machine learning algorithms
par: Sufriyana, Herdiantri, et autres
Publié: (2025)
par: Sufriyana, Herdiantri, et autres
Publié: (2025)
Versatile Ordering Network: An Attention-based Neural Network for Ordering Across Scales and Quality Metrics
par: Yu, Zehua, et autres
Publié: (2024)
par: Yu, Zehua, et autres
Publié: (2024)
ZetA: A Riemann Zeta-Scaled Extension of Adam for Deep Learning
par: BC, Samiksha
Publié: (2025)
par: BC, Samiksha
Publié: (2025)
Securing Reliability: A Brief Overview on Enhancing In-Context Learning for Foundation Models
par: Huang, Yunpeng, et autres
Publié: (2024)
par: Huang, Yunpeng, et autres
Publié: (2024)
Adam Improves Muon: Adaptive Moment Estimation with Orthogonalized Momentum
par: Zhang, Minxin, et autres
Publié: (2026)
par: Zhang, Minxin, et autres
Publié: (2026)
KerZOO: Kernel Function Informed Zeroth-Order Optimization for Accurate and Accelerated LLM Fine-Tuning
par: Mi, Zhendong, et autres
Publié: (2025)
par: Mi, Zhendong, et autres
Publié: (2025)
2Mamba2Furious: Linear in Complexity, Competitive in Accuracy
par: Mongaras, Gabriel, et autres
Publié: (2026)
par: Mongaras, Gabriel, et autres
Publié: (2026)
Rewarding Beliefs, Not Actions: Consistency-Guided Credit Assignment for Long-Horizon Agents
par: Tang, Wenjie, et autres
Publié: (2026)
par: Tang, Wenjie, et autres
Publié: (2026)
FluidWorld: Reaction-Diffusion Dynamics as a Predictive Substrate for World Models
par: Polly, Fabien
Publié: (2026)
par: Polly, Fabien
Publié: (2026)
I-GLIDE: Input Groups for Latent Health Indicators in Degradation Estimation
par: Thil, Lucas, et autres
Publié: (2025)
par: Thil, Lucas, et autres
Publié: (2025)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
par: Fadli, Samih
Publié: (2025)
par: Fadli, Samih
Publié: (2025)
Tactile-Proprioceptive Sensor Fusion for Contact Wrench Estimation in Whole-Body Physical Human-Robot Interaction
par: Min, Junha, et autres
Publié: (2026)
par: Min, Junha, et autres
Publié: (2026)
Mamba base PKD for efficient knowledge compression
par: Medina, José, et autres
Publié: (2025)
par: Medina, José, et autres
Publié: (2025)
Towards geological inference with process-based and deep generative modeling, part 1: training on fluvial deposits
par: Rongier, Guillaume, et autres
Publié: (2025)
par: Rongier, Guillaume, et autres
Publié: (2025)
Perfecting Aircraft Maneuvers with Reinforcement Learning
par: Cilan, Atahan, et autres
Publié: (2026)
par: Cilan, Atahan, et autres
Publié: (2026)
Towards geological inference with process-based and deep generative modeling, part 2: inversion of fluvial deposits and latent-space disentanglement
par: Rongier, Guillaume, et autres
Publié: (2025)
par: Rongier, Guillaume, et autres
Publié: (2025)
Data structure > labels? Unsupervised heuristics for SVM hyperparameter estimation
par: Cholewa, Michał, et autres
Publié: (2021)
par: Cholewa, Michał, et autres
Publié: (2021)
Minimum Description Length based Granular-Ball Tree Regularization for Spectral Clustering
par: Xian, Zeqiang, et autres
Publié: (2026)
par: Xian, Zeqiang, et autres
Publié: (2026)
Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law
par: He, Yanjin, et autres
Publié: (2025)
par: He, Yanjin, et autres
Publié: (2025)
FSC-Net: Fast-Slow Consolidation Networks for Continual Learning
par: Gorrim, Mohamed El
Publié: (2025)
par: Gorrim, Mohamed El
Publié: (2025)
Action-Dependent Optimality-Preserving Reward Shaping
par: Forbes, Grant C., et autres
Publié: (2025)
par: Forbes, Grant C., et autres
Publié: (2025)
TFMAdapter: Lightweight Instance-Level Adaptation of Foundation Models for Forecasting with Covariates
par: Dange, Afrin, et autres
Publié: (2025)
par: Dange, Afrin, et autres
Publié: (2025)
Downsized and Compromised?: Assessing the Faithfulness of Model Compression
par: Kamal, Moumita, et autres
Publié: (2025)
par: Kamal, Moumita, et autres
Publié: (2025)
How Many Ratings per Item are Necessary for Reliable Significance Testing?
par: Homan, Christopher, et autres
Publié: (2024)
par: Homan, Christopher, et autres
Publié: (2024)
Learning Stochastic Nonlinear Dynamics with Embedded Latent Transfer Operators
par: Ke, Naichang, et autres
Publié: (2025)
par: Ke, Naichang, et autres
Publié: (2025)
Deep Variational Inference Symbolic Regression
par: Butterworth, James, et autres
Publié: (2026)
par: Butterworth, James, et autres
Publié: (2026)
Potential-Based Reward Shaping For Intrinsic Motivation
par: Forbes, Grant C., et autres
Publié: (2024)
par: Forbes, Grant C., et autres
Publié: (2024)
Intervening to Learn and Compose Causally Disentangled Representations
par: Markham, Alex, et autres
Publié: (2025)
par: Markham, Alex, et autres
Publié: (2025)
How to Boost Any Loss Function
par: Nock, Richard, et autres
Publié: (2024)
par: Nock, Richard, et autres
Publié: (2024)
Learning Transferable Predictability Representations
par: Goswami, Diyali, et autres
Publié: (2026)
par: Goswami, Diyali, et autres
Publié: (2026)
Documents similaires
-
FlowAdam: Implicit Regularization via Geometry-Aware Soft Momentum Injection
par: Singh, Devender, et autres
Publié: (2026) -
Fusing Rewards and Preferences in Reinforcement Learning
par: Khorasani, Sadegh, et autres
Publié: (2025) -
Hidden Failure Modes of Gradient Modification under Adam in Continual Learning, and Adaptive Decoupled Moment Routing as a Repair
par: Hu, Yuelin, et autres
Publié: (2026) -
AI and Machine Learning Approaches for Predicting Nanoparticles Toxicity The Critical Role of Physiochemical Properties
par: Yousaf, Iqra
Publié: (2024) -
Deep Memory Search: A Metaheuristic Approach for Optimizing Heuristic Search
par: Hedar, Abdel-Rahman, et autres
Publié: (2024)