CLion: Efficient Cautious Lion Optimizer with Enhanced Generalization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Feihu, Zhang, Guanyi, Chen, Songcan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HomeAdam: Adam and AdamW Algorithms Sometimes Go Home to Obtain Better Provable Generalization
par: Huang, Feihu, et autres
Publié: (2026)
par: Huang, Feihu, et autres
Publié: (2026)
LiMuon: Light and Fast Muon Optimizer for Large Models
par: Huang, Feihu, et autres
Publié: (2025)
par: Huang, Feihu, et autres
Publié: (2025)
MiMuon: Mixed Muon Optimizer with Improved Generalization for Large Models
par: Huang, Feihu, et autres
Publié: (2026)
par: Huang, Feihu, et autres
Publié: (2026)
Adaptive Federated Minimax Optimization with Lower Complexities
par: Huang, Feihu, et autres
Publié: (2022)
par: Huang, Feihu, et autres
Publié: (2022)
Enhanced Adaptive Gradient Algorithms for Nonconvex-PL Minimax Optimization
par: Huang, Feihu, et autres
Publié: (2023)
par: Huang, Feihu, et autres
Publié: (2023)
Optimal Hessian/Jacobian-Free Nonconvex-PL Bilevel Optimization
par: Huang, Feihu
Publié: (2024)
par: Huang, Feihu
Publié: (2024)
Cautious Weight Decay
par: Chen, Lizhang, et autres
Publié: (2025)
par: Chen, Lizhang, et autres
Publié: (2025)
Faster Adaptive Decentralized Learning Algorithms
par: Huang, Feihu, et autres
Publié: (2024)
par: Huang, Feihu, et autres
Publié: (2024)
Convergence Analysis of the Lion Optimizer in Centralized and Distributed Settings
par: Jiang, Wei, et autres
Publié: (2025)
par: Jiang, Wei, et autres
Publié: (2025)
Communication-Efficient Federated Bilevel Optimization with Local and Global Lower Level Problems
par: Li, Junyi, et autres
Publié: (2023)
par: Li, Junyi, et autres
Publié: (2023)
Lions and Muons: Optimization via Stochastic Frank-Wolfe
par: Sfyraki, Maria-Eleni, et autres
Publié: (2025)
par: Sfyraki, Maria-Eleni, et autres
Publié: (2025)
Solving Sparse \& High-Dimensional-Output Regression via Compression
par: Li, Renyuan, et autres
Publié: (2024)
par: Li, Renyuan, et autres
Publié: (2024)
Lion Secretly Solves Constrained Optimization: As Lyapunov Predicts
par: Chen, Lizhang, et autres
Publié: (2023)
par: Chen, Lizhang, et autres
Publié: (2023)
Faster Rates for No-Regret Learning in General Games via Cautious Optimism
par: Soleymani, Ashkan, et autres
Publié: (2025)
par: Soleymani, Ashkan, et autres
Publié: (2025)
Cautious Optimism: A Meta-Algorithm for Near-Constant Regret in General Games
par: Soleymani, Ashkan, et autres
Publié: (2025)
par: Soleymani, Ashkan, et autres
Publié: (2025)
Communication Efficient Distributed Training with Distributed Lion
par: Liu, Bo, et autres
Publié: (2024)
par: Liu, Bo, et autres
Publié: (2024)
Subspace Optimization for Efficient Federated Learning under Heterogeneous Data
par: Zhu, Shuchen, et autres
Publié: (2026)
par: Zhu, Shuchen, et autres
Publié: (2026)
Efficient Tail-Aware Generative Optimization via Flow Model Fine-Tuning
par: Wang, Zifan, et autres
Publié: (2026)
par: Wang, Zifan, et autres
Publié: (2026)
Efficient Curvature-Aware Hypergradient Approximation for Bilevel Optimization
par: Dong, Youran, et autres
Publié: (2025)
par: Dong, Youran, et autres
Publié: (2025)
Enhancing Unsupervised Feature Selection via Double Sparsity Constrained Optimization
par: Xiu, Xianchao, et autres
Publié: (2025)
par: Xiu, Xianchao, et autres
Publié: (2025)
Efficient Stochastic Approximation of Minimax Excess Risk Optimization
par: Zhang, Lijun, et autres
Publié: (2023)
par: Zhang, Lijun, et autres
Publié: (2023)
An Efficient Stochastic Algorithm for Decentralized Nonconvex-Strongly-Concave Minimax Optimization
par: Chen, Lesi, et autres
Publié: (2022)
par: Chen, Lesi, et autres
Publié: (2022)
DisCo-DSO: Coupling Discrete and Continuous Optimization for Efficient Generative Design in Hybrid Spaces
par: Pettit, Jacob F., et autres
Publié: (2024)
par: Pettit, Jacob F., et autres
Publié: (2024)
Efficient First-Order Optimization on the Pareto Set for Multi-Objective Learning under Preference Guidance
par: Chen, Lisha, et autres
Publié: (2025)
par: Chen, Lisha, et autres
Publié: (2025)
Tensor Network Generator-Enhanced Optimization for Traveling Salesman Problem
par: Sakai, Ryo, et autres
Publié: (2026)
par: Sakai, Ryo, et autres
Publié: (2026)
Efficient Sign-Based Optimization: Accelerating Convergence via Variance Reduction
par: Jiang, Wei, et autres
Publié: (2024)
par: Jiang, Wei, et autres
Publié: (2024)
Improving Generalization and Convergence by Enhancing Implicit Regularization
par: Wang, Mingze, et autres
Publié: (2024)
par: Wang, Mingze, et autres
Publié: (2024)
Provably Efficient Exploration in Policy Optimization
par: Cai, Qi, et autres
Publié: (2019)
par: Cai, Qi, et autres
Publié: (2019)
Zeroth-Order Methods for Stochastic Nonconvex Nonsmooth Composite Optimization
par: Chen, Ziyi, et autres
Publié: (2025)
par: Chen, Ziyi, et autres
Publié: (2025)
Landscape of Policy Optimization for Finite Horizon MDPs with General State and Action
par: Chen, Xin, et autres
Publié: (2024)
par: Chen, Xin, et autres
Publié: (2024)
LORENZA: Enhancing Generalization in Low-Rank Gradient LLM Training via Efficient Zeroth-Order Adaptive SAM
par: Refael, Yehonathan, et autres
Publié: (2025)
par: Refael, Yehonathan, et autres
Publié: (2025)
Enhancing Fractional Gradient Descent with Learned Optimizers
par: Sobotka, Jan, et autres
Publié: (2025)
par: Sobotka, Jan, et autres
Publié: (2025)
Inexact Column Generation for Bayesian Network Structure Learning via Difference-of-Submodular Optimization
par: Yang, Yiran, et autres
Publié: (2025)
par: Yang, Yiran, et autres
Publié: (2025)
Distributionally Robust Multi-Objective Optimization
par: Yang, Yufeng, et autres
Publié: (2026)
par: Yang, Yufeng, et autres
Publié: (2026)
Analyzing Neural Network-Based Generative Diffusion Models through Convex Optimization
par: Zhang, Fangzhao, et autres
Publié: (2024)
par: Zhang, Fangzhao, et autres
Publié: (2024)
Fairness-informed Pareto Optimization : An Efficient Bilevel Framework
par: Tanji, Sofiane, et autres
Publié: (2026)
par: Tanji, Sofiane, et autres
Publié: (2026)
Exploiting Similarity for Computation and Communication-Efficient Decentralized Optimization
par: Takezawa, Yuki, et autres
Publié: (2025)
par: Takezawa, Yuki, et autres
Publié: (2025)
Stochastic Smoothed Primal-Dual Algorithms for Nonconvex Optimization with Linear Inequality Constraints
par: Huang, Ruichuan, et autres
Publié: (2025)
par: Huang, Ruichuan, et autres
Publié: (2025)
Analyzing and Enhancing the Backward-Pass Convergence of Unrolled Optimization
par: Kotary, James, et autres
Publié: (2023)
par: Kotary, James, et autres
Publié: (2023)
An Energy-Based Self-Adaptive Learning Rate for Stochastic Gradient Descent: Enhancing Unconstrained Optimization with VAV method
par: Zhang, Jiahao, et autres
Publié: (2024)
par: Zhang, Jiahao, et autres
Publié: (2024)
Documents similaires
-
HomeAdam: Adam and AdamW Algorithms Sometimes Go Home to Obtain Better Provable Generalization
par: Huang, Feihu, et autres
Publié: (2026) -
LiMuon: Light and Fast Muon Optimizer for Large Models
par: Huang, Feihu, et autres
Publié: (2025) -
MiMuon: Mixed Muon Optimizer with Improved Generalization for Large Models
par: Huang, Feihu, et autres
Publié: (2026) -
Adaptive Federated Minimax Optimization with Lower Complexities
par: Huang, Feihu, et autres
Publié: (2022) -
Enhanced Adaptive Gradient Algorithms for Nonconvex-PL Minimax Optimization
par: Huang, Feihu, et autres
Publié: (2023)