Stabilizing Sharpness-aware Minimization Through A Simple Renormalization Strategy
Fuente:
arXiv
Salvato in:
| Autori principali: | Tan, Chengli, Zhang, Jiangshe, Liu, Junmin, Wang, Yicheng, Hao, Yunda |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards Understanding The Calibration Benefits of Sharpness-Aware Minimization
di: Tan, Chengli, et al.
Pubblicazione: (2025)
di: Tan, Chengli, et al.
Pubblicazione: (2025)
Learning Non-Vacuous Generalization Bounds from Optimization
di: Tan, Chengli, et al.
Pubblicazione: (2022)
di: Tan, Chengli, et al.
Pubblicazione: (2022)
Stability Analysis of Sharpness-Aware Minimization
di: Kim, Hoki, et al.
Pubblicazione: (2023)
di: Kim, Hoki, et al.
Pubblicazione: (2023)
FairSAM: Fair Classification on Corrupted Data Through Sharpness-Aware Minimization
di: Dai, Yucong, et al.
Pubblicazione: (2025)
di: Dai, Yucong, et al.
Pubblicazione: (2025)
Membership Privacy Risks of Sharpness Aware Minimization
di: Kim, Young In, et al.
Pubblicazione: (2023)
di: Kim, Young In, et al.
Pubblicazione: (2023)
Navigating Potholes with Geometry-Aware Sharpness Minimization
di: Dufort-Labbé, Simon, et al.
Pubblicazione: (2026)
di: Dufort-Labbé, Simon, et al.
Pubblicazione: (2026)
Revisiting Sharpness-Aware Minimization: A More Faithful and Effective Implementation
di: Chen, Jianlong, et al.
Pubblicazione: (2026)
di: Chen, Jianlong, et al.
Pubblicazione: (2026)
Fast Graph Sharpness-Aware Minimization for Enhancing and Accelerating Few-Shot Node Classification
di: Luo, Yihong, et al.
Pubblicazione: (2024)
di: Luo, Yihong, et al.
Pubblicazione: (2024)
SAMOSA: Sharpness Aware Minimization for Open Set Active learning
di: Kim, Young In, et al.
Pubblicazione: (2025)
di: Kim, Young In, et al.
Pubblicazione: (2025)
Gradient Compression May Hurt Generalization: A Remedy by Synthetic Data Guided Sharpness Aware Minimization
di: Gu, Yujie, et al.
Pubblicazione: (2026)
di: Gu, Yujie, et al.
Pubblicazione: (2026)
Unpacking the Implicit Norm Dynamics of Sharpness-Aware Minimization in Tensorized Models
di: Cao, Tianxiao, et al.
Pubblicazione: (2025)
di: Cao, Tianxiao, et al.
Pubblicazione: (2025)
Bi-LoRA: Efficient Sharpness-Aware Minimization for Fine-Tuning Large-Scale Models
di: Liu, Yuhang, et al.
Pubblicazione: (2025)
di: Liu, Yuhang, et al.
Pubblicazione: (2025)
Economic span selection of bridge based on deep reinforcement learning
di: Zhang, Leye, et al.
Pubblicazione: (2024)
di: Zhang, Leye, et al.
Pubblicazione: (2024)
Attributing Data for Sharpness-Aware Minimization
di: Ren, Chenyang, et al.
Pubblicazione: (2025)
di: Ren, Chenyang, et al.
Pubblicazione: (2025)
SASSHA: Sharpness-aware Adaptive Second-order Optimization with Stable Hessian Approximation
di: Shin, Dahun, et al.
Pubblicazione: (2025)
di: Shin, Dahun, et al.
Pubblicazione: (2025)
Towards Understanding the Role of Sharpness-Aware Minimization Algorithms for Out-of-Distribution Generalization
di: Schapiro, Samuel, et al.
Pubblicazione: (2024)
di: Schapiro, Samuel, et al.
Pubblicazione: (2024)
X-SAM: Boosting Sharpness-Aware Minimization with Dominant-Eigenvector Gradient Correction
di: Duan, Hongru, et al.
Pubblicazione: (2026)
di: Duan, Hongru, et al.
Pubblicazione: (2026)
Sharpness-Aware Minimization in Logit Space Efficiently Enhances Direct Preference Optimization
di: Luo, Haocheng, et al.
Pubblicazione: (2026)
di: Luo, Haocheng, et al.
Pubblicazione: (2026)
Minor First, Major Last: A Depth-Induced Implicit Bias of Sharpness-Aware Minimization
di: Moon, Chaewon, et al.
Pubblicazione: (2026)
di: Moon, Chaewon, et al.
Pubblicazione: (2026)
Unveiling m-Sharpness Through the Structure of Stochastic Gradient Noise
di: Luo, Haocheng, et al.
Pubblicazione: (2025)
di: Luo, Haocheng, et al.
Pubblicazione: (2025)
On the Duality Between Sharpness-Aware Minimization and Adversarial Training
di: Zhang, Yihao, et al.
Pubblicazione: (2024)
di: Zhang, Yihao, et al.
Pubblicazione: (2024)
Enhancing Robustness of Offline Reinforcement Learning Under Data Corruption via Sharpness-Aware Minimization
di: Xu, Le, et al.
Pubblicazione: (2025)
di: Xu, Le, et al.
Pubblicazione: (2025)
Branching Strategies Based on Subgraph GNNs: A Study on Theoretical Promise versus Practical Reality
di: Zhou, Junru, et al.
Pubblicazione: (2025)
di: Zhou, Junru, et al.
Pubblicazione: (2025)
Generative Risk Minimization for Out-of-Distribution Generalization on Graphs
di: Wang, Song, et al.
Pubblicazione: (2025)
di: Wang, Song, et al.
Pubblicazione: (2025)
SGD at the Edge of Stability: The Stochastic Sharpness Gap
di: Liao, Fangshuo, et al.
Pubblicazione: (2026)
di: Liao, Fangshuo, et al.
Pubblicazione: (2026)
Seismic First Break Picking in a Higher Dimension Using Deep Graph Learning
di: Wang, Hongtao, et al.
Pubblicazione: (2024)
di: Wang, Hongtao, et al.
Pubblicazione: (2024)
TCR-GPT: Integrating Autoregressive Model and Reinforcement Learning for T-Cell Receptor Repertoires Generation
di: Lin, Yicheng, et al.
Pubblicazione: (2024)
di: Lin, Yicheng, et al.
Pubblicazione: (2024)
Sharpness-Aware Black-Box Optimization
di: Ye, Feiyang, et al.
Pubblicazione: (2024)
di: Ye, Feiyang, et al.
Pubblicazione: (2024)
SPGCL: Simple yet Powerful Graph Contrastive Learning via SVD-Guided Structural Perturbation
di: Deng, Hao, et al.
Pubblicazione: (2026)
di: Deng, Hao, et al.
Pubblicazione: (2026)
Representation Stability in a Minimal Continual Learning Agent
di: Subramanian, Vishnu
Pubblicazione: (2026)
di: Subramanian, Vishnu
Pubblicazione: (2026)
Increasing Model Capacity for Free: A Simple Strategy for Parameter Efficient Fine-tuning
di: Song, Haobo, et al.
Pubblicazione: (2024)
di: Song, Haobo, et al.
Pubblicazione: (2024)
Dynamic Adversarial Reinforcement Learning for Robust Multimodal Large Language Models
di: Bao, Yicheng, et al.
Pubblicazione: (2026)
di: Bao, Yicheng, et al.
Pubblicazione: (2026)
SIPO: Stabilized and Improved Preference Optimization for Aligning Diffusion Models
di: Yang, Xiaomeng, et al.
Pubblicazione: (2025)
di: Yang, Xiaomeng, et al.
Pubblicazione: (2025)
BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens
di: Wen, Hao, et al.
Pubblicazione: (2025)
di: Wen, Hao, et al.
Pubblicazione: (2025)
When Does Learning Renormalize? Sufficient Conditions for Power Law Spectral Dynamics
di: Zhang, Yizhou
Pubblicazione: (2025)
di: Zhang, Yizhou
Pubblicazione: (2025)
Make Graph Neural Networks Great Again: A Generic Integration Paradigm of Topology-Free Patterns for Traffic Speed Prediction
di: Zhou, Yicheng, et al.
Pubblicazione: (2024)
di: Zhou, Yicheng, et al.
Pubblicazione: (2024)
Deep Networks Favor Simple Data
di: Lu, Weyl, et al.
Pubblicazione: (2026)
di: Lu, Weyl, et al.
Pubblicazione: (2026)
Revisiting Transformer Layer Parameterization Through Causal Energy Minimization
di: Xu, Jin, et al.
Pubblicazione: (2026)
di: Xu, Jin, et al.
Pubblicazione: (2026)
A Fast and Flat Federated Learning Method via Weighted Momentum and Sharpness-Aware Minimization
di: Li, Tianle, et al.
Pubblicazione: (2025)
di: Li, Tianle, et al.
Pubblicazione: (2025)
An Embarrassingly Simple Approach to Enhance Transformer Performance in Genomic Selection for Crop Breeding
di: Chen, Renqi, et al.
Pubblicazione: (2024)
di: Chen, Renqi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Towards Understanding The Calibration Benefits of Sharpness-Aware Minimization
di: Tan, Chengli, et al.
Pubblicazione: (2025) -
Learning Non-Vacuous Generalization Bounds from Optimization
di: Tan, Chengli, et al.
Pubblicazione: (2022) -
Stability Analysis of Sharpness-Aware Minimization
di: Kim, Hoki, et al.
Pubblicazione: (2023) -
FairSAM: Fair Classification on Corrupted Data Through Sharpness-Aware Minimization
di: Dai, Yucong, et al.
Pubblicazione: (2025) -
Membership Privacy Risks of Sharpness Aware Minimization
di: Kim, Young In, et al.
Pubblicazione: (2023)