Unpacking the Implicit Norm Dynamics of Sharpness-Aware Minimization in Tensorized Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Cao, Tianxiao, Atarashi, Kyohei, Kashima, Hisashi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Probability Bounding: Post-Hoc Calibration via Box-Constrained Softmax
por: Atarashi, Kyohei, et al.
Publicado: (2025)
por: Atarashi, Kyohei, et al.
Publicado: (2025)
Robust Anomaly Detection Under Normality Distribution Shift in Dynamic Graphs
por: Xu, Xiaoyang, et al.
Publicado: (2025)
por: Xu, Xiaoyang, et al.
Publicado: (2025)
Enhancing Chess Reinforcement Learning with Graph Representation
por: Rigaux, Tomas, et al.
Publicado: (2024)
por: Rigaux, Tomas, et al.
Publicado: (2024)
Minor First, Major Last: A Depth-Induced Implicit Bias of Sharpness-Aware Minimization
por: Moon, Chaewon, et al.
Publicado: (2026)
por: Moon, Chaewon, et al.
Publicado: (2026)
XicorAttention: Time Series Transformer Using Attention with Nonlinear Correlation
por: Kimura, Daichi, et al.
Publicado: (2025)
por: Kimura, Daichi, et al.
Publicado: (2025)
Treatment Effect Estimation with Differentiated Networked Effect on Graph Data
por: Lin, Xiaofeng, et al.
Publicado: (2026)
por: Lin, Xiaofeng, et al.
Publicado: (2026)
Stability Analysis of Sharpness-Aware Minimization
por: Kim, Hoki, et al.
Publicado: (2023)
por: Kim, Hoki, et al.
Publicado: (2023)
Membership Privacy Risks of Sharpness Aware Minimization
por: Kim, Young In, et al.
Publicado: (2023)
por: Kim, Young In, et al.
Publicado: (2023)
Navigating Potholes with Geometry-Aware Sharpness Minimization
por: Dufort-Labbé, Simon, et al.
Publicado: (2026)
por: Dufort-Labbé, Simon, et al.
Publicado: (2026)
Towards Understanding The Calibration Benefits of Sharpness-Aware Minimization
por: Tan, Chengli, et al.
Publicado: (2025)
por: Tan, Chengli, et al.
Publicado: (2025)
Fast Graph Sharpness-Aware Minimization for Enhancing and Accelerating Few-Shot Node Classification
por: Luo, Yihong, et al.
Publicado: (2024)
por: Luo, Yihong, et al.
Publicado: (2024)
Transfer Learning with Pre-trained Conditional Generative Models
por: Yamaguchi, Shin'ya, et al.
Publicado: (2022)
por: Yamaguchi, Shin'ya, et al.
Publicado: (2022)
SAMOSA: Sharpness Aware Minimization for Open Set Active learning
por: Kim, Young In, et al.
Publicado: (2025)
por: Kim, Young In, et al.
Publicado: (2025)
Revisiting Sharpness-Aware Minimization: A More Faithful and Effective Implementation
por: Chen, Jianlong, et al.
Publicado: (2026)
por: Chen, Jianlong, et al.
Publicado: (2026)
Bi-LoRA: Efficient Sharpness-Aware Minimization for Fine-Tuning Large-Scale Models
por: Liu, Yuhang, et al.
Publicado: (2025)
por: Liu, Yuhang, et al.
Publicado: (2025)
FairSAM: Fair Classification on Corrupted Data Through Sharpness-Aware Minimization
por: Dai, Yucong, et al.
Publicado: (2025)
por: Dai, Yucong, et al.
Publicado: (2025)
Towards Understanding the Role of Sharpness-Aware Minimization Algorithms for Out-of-Distribution Generalization
por: Schapiro, Samuel, et al.
Publicado: (2024)
por: Schapiro, Samuel, et al.
Publicado: (2024)
X-SAM: Boosting Sharpness-Aware Minimization with Dominant-Eigenvector Gradient Correction
por: Duan, Hongru, et al.
Publicado: (2026)
por: Duan, Hongru, et al.
Publicado: (2026)
Sharpness-Aware Minimization in Logit Space Efficiently Enhances Direct Preference Optimization
por: Luo, Haocheng, et al.
Publicado: (2026)
por: Luo, Haocheng, et al.
Publicado: (2026)
Attributing Data for Sharpness-Aware Minimization
por: Ren, Chenyang, et al.
Publicado: (2025)
por: Ren, Chenyang, et al.
Publicado: (2025)
Enhancing Robustness of Offline Reinforcement Learning Under Data Corruption via Sharpness-Aware Minimization
por: Xu, Le, et al.
Publicado: (2025)
por: Xu, Le, et al.
Publicado: (2025)
Gradient Compression May Hurt Generalization: A Remedy by Synthetic Data Guided Sharpness Aware Minimization
por: Gu, Yujie, et al.
Publicado: (2026)
por: Gu, Yujie, et al.
Publicado: (2026)
The Geometry of Grokking: Norm Minimization on the Zero-Loss Manifold
por: Musat, Tiberiu
Publicado: (2025)
por: Musat, Tiberiu
Publicado: (2025)
On the Duality Between Sharpness-Aware Minimization and Adversarial Training
por: Zhang, Yihao, et al.
Publicado: (2024)
por: Zhang, Yihao, et al.
Publicado: (2024)
Reward Sharpness-Aware Fine-Tuning for Diffusion Models
por: Kim, Kwanyoung, et al.
Publicado: (2026)
por: Kim, Kwanyoung, et al.
Publicado: (2026)
Long-Term Outlier Prediction Through Outlier Score Modeling
por: Aoki, Yuma, et al.
Publicado: (2026)
por: Aoki, Yuma, et al.
Publicado: (2026)
Sharpness-Aware Teleportation on Riemannian Manifolds
por: Truong, Tuan, et al.
Publicado: (2023)
por: Truong, Tuan, et al.
Publicado: (2023)
Sharpness-Aware Black-Box Optimization
por: Ye, Feiyang, et al.
Publicado: (2024)
por: Ye, Feiyang, et al.
Publicado: (2024)
Exploring Causes and Mitigation of Hallucinations in Large Vision Language Models
por: Sun, Yaqi, et al.
Publicado: (2025)
por: Sun, Yaqi, et al.
Publicado: (2025)
Stabilizing Sharpness-aware Minimization Through A Simple Renormalization Strategy
por: Tan, Chengli, et al.
Publicado: (2024)
por: Tan, Chengli, et al.
Publicado: (2024)
Tractable Sharpness-Aware Learning of Probabilistic Circuits
por: Suresh, Hrithik, et al.
Publicado: (2025)
por: Suresh, Hrithik, et al.
Publicado: (2025)
NCSAM Noise-Compensated Sharpness-Aware Minimization for Noisy Label Learning
por: Xu, Jiayu, et al.
Publicado: (2026)
por: Xu, Jiayu, et al.
Publicado: (2026)
FedSCAM (Federated Sharpness-Aware Minimization with Clustered Aggregation and Modulation): Scam-resistant SAM for Robust Federated Optimization in Heterogeneous Environments
por: Rahil, Sameer, et al.
Publicado: (2025)
por: Rahil, Sameer, et al.
Publicado: (2025)
Implicit Neural Differential Model for Spatiotemporal Dynamics
por: Akhare, Deepak, et al.
Publicado: (2025)
por: Akhare, Deepak, et al.
Publicado: (2025)
A Generalized Model for Multidimensional Intransitivity
por: Duan, Jiuding, et al.
Publicado: (2024)
por: Duan, Jiuding, et al.
Publicado: (2024)
TIDES: Implicit Time-Awareness in Selective State Space Models
por: Soydan, Taylan, et al.
Publicado: (2026)
por: Soydan, Taylan, et al.
Publicado: (2026)
Unpacking Tokenization: Evaluating Text Compression and its Correlation with Model Performance
por: Goldman, Omer, et al.
Publicado: (2024)
por: Goldman, Omer, et al.
Publicado: (2024)
Forget Sharpness: Perturbed Forgetting of Model Biases Within SAM Dynamics
por: Vani, Ankit, et al.
Publicado: (2024)
por: Vani, Ankit, et al.
Publicado: (2024)
Sharpen Your Flow: Sharpness-Aware Sampling for Flow Matching
por: Gupta, Aditi, et al.
Publicado: (2026)
por: Gupta, Aditi, et al.
Publicado: (2026)
Transferable Delay-Aware Reinforcement Learning via Implicit Causal Graph Modeling
por: Zhao, Chenran, et al.
Publicado: (2026)
por: Zhao, Chenran, et al.
Publicado: (2026)
Ejemplares similares
-
Probability Bounding: Post-Hoc Calibration via Box-Constrained Softmax
por: Atarashi, Kyohei, et al.
Publicado: (2025) -
Robust Anomaly Detection Under Normality Distribution Shift in Dynamic Graphs
por: Xu, Xiaoyang, et al.
Publicado: (2025) -
Enhancing Chess Reinforcement Learning with Graph Representation
por: Rigaux, Tomas, et al.
Publicado: (2024) -
Minor First, Major Last: A Depth-Induced Implicit Bias of Sharpness-Aware Minimization
por: Moon, Chaewon, et al.
Publicado: (2026) -
XicorAttention: Time Series Transformer Using Attention with Nonlinear Correlation
por: Kimura, Daichi, et al.
Publicado: (2025)