Combining Adam and its Inverse Counterpart to Enhance Generalization of Deep Learning Optimizers
Fuente:
arXiv
Salvato in:
| Autori principali: | Shi, Tao, Chen, Liangming, Jin, Long, Zhou, Mengchu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Method for Enhancing Generalization of Adam by Multiple Integrations
di: Jin, Long, et al.
Pubblicazione: (2024)
di: Jin, Long, et al.
Pubblicazione: (2024)
CLAIRE: Compressed Latent Autoencoder for Industrial Representation and Evaluation -- A Deep Learning Framework for Smart Manufacturing
di: Ghahramani, Mohammadhossein, et al.
Pubblicazione: (2026)
di: Ghahramani, Mohammadhossein, et al.
Pubblicazione: (2026)
Adam-SHANG: A Convergent Adam-Type Method for Stochastic Smooth Convex Optimization
di: Yu, Yaxin, et al.
Pubblicazione: (2026)
di: Yu, Yaxin, et al.
Pubblicazione: (2026)
Edge-AI-Driven Learning-to-Rank for Decentralized Task Allocation in Circular Smart Manufacturing
di: Ghahramani, Mohammadhossein, et al.
Pubblicazione: (2026)
di: Ghahramani, Mohammadhossein, et al.
Pubblicazione: (2026)
Adam-HNAG: A Convergent Reformulation of Adam with Accelerated Rate
di: Yu, Yaxin, et al.
Pubblicazione: (2026)
di: Yu, Yaxin, et al.
Pubblicazione: (2026)
Understanding Adam Optimizer via Online Learning of Updates: Adam is FTRL in Disguise
di: Ahn, Kwangjun, et al.
Pubblicazione: (2024)
di: Ahn, Kwangjun, et al.
Pubblicazione: (2024)
Robustness Against Weak or Invalid Instruments: Exploring Nonlinear Treatment Models with Machine Learning
di: Guo, Zijian, et al.
Pubblicazione: (2022)
di: Guo, Zijian, et al.
Pubblicazione: (2022)
HomeAdam: Adam and AdamW Algorithms Sometimes Go Home to Obtain Better Provable Generalization
di: Huang, Feihu, et al.
Pubblicazione: (2026)
di: Huang, Feihu, et al.
Pubblicazione: (2026)
A Heavy-Load-Enhanced and Changeable-Periodicity-Perceived Workload Prediction Network
di: Chen, Feiyi, et al.
Pubblicazione: (2023)
di: Chen, Feiyi, et al.
Pubblicazione: (2023)
AdamMCMC: Combining Metropolis Adjusted Langevin with Momentum-based Optimization
di: Bieringer, Sebastian, et al.
Pubblicazione: (2023)
di: Bieringer, Sebastian, et al.
Pubblicazione: (2023)
Generative Deep Learning Framework for Inverse Design of Fuels
di: Yalamanchi, Kiran K., et al.
Pubblicazione: (2025)
di: Yalamanchi, Kiran K., et al.
Pubblicazione: (2025)
Convergence Guarantees for RMSProp and Adam in Generalized-smooth Non-convex Optimization with Affine Noise Variance
di: Zhang, Qi, et al.
Pubblicazione: (2024)
di: Zhang, Qi, et al.
Pubblicazione: (2024)
Do Latent-CoT Models Think Step-by-Step? A Mechanistic Study on Sequential Reasoning Tasks
di: Liang, Jia, et al.
Pubblicazione: (2026)
di: Liang, Jia, et al.
Pubblicazione: (2026)
Acoustic Structure Inverse Design and Optimization Using Deep Learning
di: Sun, Xuecong, et al.
Pubblicazione: (2021)
di: Sun, Xuecong, et al.
Pubblicazione: (2021)
Towards a Mechanistic Understanding of Propositional Logical Reasoning in Large Language Models
di: Chen, Danchun, et al.
Pubblicazione: (2026)
di: Chen, Danchun, et al.
Pubblicazione: (2026)
FedAdamW: A Communication-Efficient Optimizer with Convergence and Generalization Guarantees for Federated Large Models
di: Liu, Junkang, et al.
Pubblicazione: (2025)
di: Liu, Junkang, et al.
Pubblicazione: (2025)
In-Run Data Shapley for Adam Optimizer
di: Ding, Meng, et al.
Pubblicazione: (2026)
di: Ding, Meng, et al.
Pubblicazione: (2026)
DP-AdamW: Investigating Decoupled Weight Decay and Bias Correction in Private Deep Learning
di: Chooi, Jay, et al.
Pubblicazione: (2025)
di: Chooi, Jay, et al.
Pubblicazione: (2025)
HQViT: Hybrid Quantum Vision Transformer for Image Classification
di: Zhang, Hui, et al.
Pubblicazione: (2025)
di: Zhang, Hui, et al.
Pubblicazione: (2025)
Compressed Models are NOT Trust-equivalent to Their Large Counterparts
di: Rai, Rohit Raj, et al.
Pubblicazione: (2025)
di: Rai, Rohit Raj, et al.
Pubblicazione: (2025)
Decentralized Online Learning for Random Inverse Problems Over Graphs
di: Zhang, Xiwei, et al.
Pubblicazione: (2023)
di: Zhang, Xiwei, et al.
Pubblicazione: (2023)
WarpAdam: A new Adam optimizer based on Meta-Learning approach
di: Pan, Chengxi, et al.
Pubblicazione: (2024)
di: Pan, Chengxi, et al.
Pubblicazione: (2024)
Optimizing Search Advertising Strategies: Integrating Reinforcement Learning with Generalized Second-Price Auctions for Enhanced Ad Ranking and Bidding
di: Zhou, Chang, et al.
Pubblicazione: (2024)
di: Zhou, Chang, et al.
Pubblicazione: (2024)
Mechanistic Data Attribution: Tracing the Training Origins of Interpretable LLM Units
di: Chen, Jianhui, et al.
Pubblicazione: (2026)
di: Chen, Jianhui, et al.
Pubblicazione: (2026)
Federated Transfer Learning with Differential Privacy
di: Li, Mengchu, et al.
Pubblicazione: (2024)
di: Li, Mengchu, et al.
Pubblicazione: (2024)
Recursive Deep Inverse Reinforcement Learning
di: Ghanem, Paul, et al.
Pubblicazione: (2025)
di: Ghanem, Paul, et al.
Pubblicazione: (2025)
DP-FedAdamW: An Efficient Optimizer for Differentially Private Federated Large Models
di: Liu, Jin, et al.
Pubblicazione: (2026)
di: Liu, Jin, et al.
Pubblicazione: (2026)
Q-LocalAdam: Memory-Efficient Client-Side Adaptive Optimization for Edge Federated Learning
di: Waykole, Vedant, et al.
Pubblicazione: (2026)
di: Waykole, Vedant, et al.
Pubblicazione: (2026)
Understanding the Generalization of Stochastic Gradient Adam in Learning Neural Networks
di: Tang, Xuan, et al.
Pubblicazione: (2025)
di: Tang, Xuan, et al.
Pubblicazione: (2025)
Counterpart Fairness -- Addressing Systematic between-group Differences in Fairness Evaluation
di: Wang, Yifei, et al.
Pubblicazione: (2023)
di: Wang, Yifei, et al.
Pubblicazione: (2023)
Towards Generalized Inverse Reinforcement Learning
di: Dong, Chaosheng, et al.
Pubblicazione: (2024)
di: Dong, Chaosheng, et al.
Pubblicazione: (2024)
AdamO: A Collapse-Suppressed Optimizer for Offline RL
di: Qiao, Nan, et al.
Pubblicazione: (2026)
di: Qiao, Nan, et al.
Pubblicazione: (2026)
Enhancing Portfolio Optimization with Deep Learning Insights
di: Luo, Brandon, et al.
Pubblicazione: (2026)
di: Luo, Brandon, et al.
Pubblicazione: (2026)
Scalable Kernel Inverse Optimization
di: Long, Youyuan, et al.
Pubblicazione: (2024)
di: Long, Youyuan, et al.
Pubblicazione: (2024)
Compositional Generative Inverse Design
di: Wu, Tailin, et al.
Pubblicazione: (2024)
di: Wu, Tailin, et al.
Pubblicazione: (2024)
DeepSPoC: A Deep Learning-Based PDE Solver Governed by Sequential Propagation of Chaos
di: Du, Kai, et al.
Pubblicazione: (2024)
di: Du, Kai, et al.
Pubblicazione: (2024)
BTTackler: A Diagnosis-based Framework for Efficient Deep Learning Hyperparameter Optimization
di: Pei, Zhongyi, et al.
Pubblicazione: (2026)
di: Pei, Zhongyi, et al.
Pubblicazione: (2026)
Generative Inverse Design of Metamaterials with Functional Responses by Interpretable Learning
di: Chen, Wei "Wayne", et al.
Pubblicazione: (2023)
di: Chen, Wei "Wayne", et al.
Pubblicazione: (2023)
SOPHON: Non-Fine-Tunable Learning to Restrain Task Transferability For Pre-trained Models
di: Deng, Jiangyi, et al.
Pubblicazione: (2024)
di: Deng, Jiangyi, et al.
Pubblicazione: (2024)
Tight Generalization Bounds for Noiseless Inverse Optimization
di: Fatemi, Pouria, et al.
Pubblicazione: (2026)
di: Fatemi, Pouria, et al.
Pubblicazione: (2026)
Documenti analoghi
-
A Method for Enhancing Generalization of Adam by Multiple Integrations
di: Jin, Long, et al.
Pubblicazione: (2024) -
CLAIRE: Compressed Latent Autoencoder for Industrial Representation and Evaluation -- A Deep Learning Framework for Smart Manufacturing
di: Ghahramani, Mohammadhossein, et al.
Pubblicazione: (2026) -
Adam-SHANG: A Convergent Adam-Type Method for Stochastic Smooth Convex Optimization
di: Yu, Yaxin, et al.
Pubblicazione: (2026) -
Edge-AI-Driven Learning-to-Rank for Decentralized Task Allocation in Circular Smart Manufacturing
di: Ghahramani, Mohammadhossein, et al.
Pubblicazione: (2026) -
Adam-HNAG: A Convergent Reformulation of Adam with Accelerated Rate
di: Yu, Yaxin, et al.
Pubblicazione: (2026)