Adaptively Sampling-Reusing-Mixing Decomposed Gradients to Speed Up Sharpness Aware Minimization
Fuente:
arXiv
Saved in:
| Main Authors: | Deng, Jiaxin, Pang, Junbiao |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Asymptotic Unbiased Sample Sampling to Speed Up Sharpness-Aware Minimization
by: Deng, Jiaxin, et al.
Published: (2024)
by: Deng, Jiaxin, et al.
Published: (2024)
NCSAM Noise-Compensated Sharpness-Aware Minimization for Noisy Label Learning
by: Xu, Jiayu, et al.
Published: (2026)
by: Xu, Jiayu, et al.
Published: (2026)
Effective Gradient Sample Size via Variation Estimation for Accelerating Sharpness aware Minimization
by: Deng, Jiaxin, et al.
Published: (2024)
by: Deng, Jiaxin, et al.
Published: (2024)
Bilateral Sharpness-Aware Minimization for Flatter Minima
by: Deng, Jiaxin, et al.
Published: (2024)
by: Deng, Jiaxin, et al.
Published: (2024)
Learning from Loss Landscape: Generalizable Mixed-Precision Quantization via Adaptive Sharpness-Aware Gradient Aligning
by: Ma, Lianbo, et al.
Published: (2025)
by: Ma, Lianbo, et al.
Published: (2025)
Efficiently Training A Flat Neural Network Before It has been Quantizated
by: Xia, Peng, et al.
Published: (2025)
by: Xia, Peng, et al.
Published: (2025)
Uncertainty-aware Long-tailed Weights Model the Utility of Pseudo-labels for Semi-supervised Learning
by: Wu, Jiaqi, et al.
Published: (2025)
by: Wu, Jiaqi, et al.
Published: (2025)
Attributing Data for Sharpness-Aware Minimization
by: Ren, Chenyang, et al.
Published: (2025)
by: Ren, Chenyang, et al.
Published: (2025)
Sharpness-Aware Minimization with Z-Score Gradient Filtering
by: Yun, Vincent-Daniel
Published: (2025)
by: Yun, Vincent-Daniel
Published: (2025)
A Channel-ensemble Approach: Unbiased and Low-variance Pseudo-labels is Critical for Semi-supervised Classification
by: Wu, Jiaqi, et al.
Published: (2024)
by: Wu, Jiaqi, et al.
Published: (2024)
Fast Sampling Through The Reuse Of Attention Maps In Diffusion Models
by: Hunter, Rosco, et al.
Published: (2023)
by: Hunter, Rosco, et al.
Published: (2023)
Decompose the model: Mechanistic interpretability in image models with Generalized Integrated Gradients (GIG)
by: Kim, Yearim, et al.
Published: (2024)
by: Kim, Yearim, et al.
Published: (2024)
Catch-Up Mix: Catch-Up Class for Struggling Filters in CNN
by: Kang, Minsoo, et al.
Published: (2024)
by: Kang, Minsoo, et al.
Published: (2024)
Towards Compact and Robust DNNs via Compression-aware Sharpness Minimization
by: He, Jialuo, et al.
Published: (2026)
by: He, Jialuo, et al.
Published: (2026)
Stabilizing Quantization-Aware Training by Implicit-Regularization on Hessian Matrix
by: Pang, Junbiao, et al.
Published: (2025)
by: Pang, Junbiao, et al.
Published: (2025)
BackMix: Mitigating Shortcut Learning in Echocardiography with Minimal Supervision
by: Bransby, Kit Mills, et al.
Published: (2024)
by: Bransby, Kit Mills, et al.
Published: (2024)
Adaptive Sampling Scheduler
by: Wang, Qi, et al.
Published: (2025)
by: Wang, Qi, et al.
Published: (2025)
S2AP: Score-space Sharpness Minimization for Adversarial Pruning
by: Piras, Giorgio, et al.
Published: (2025)
by: Piras, Giorgio, et al.
Published: (2025)
Multi-Source Collaborative Gradient Discrepancy Minimization for Federated Domain Generalization
by: Wei, Yikang, et al.
Published: (2024)
by: Wei, Yikang, et al.
Published: (2024)
Improving Progressive Generation with Decomposable Flow Matching
by: Haji-Ali, Moayed, et al.
Published: (2025)
by: Haji-Ali, Moayed, et al.
Published: (2025)
Gradient-Free Classifier Guidance for Diffusion Model Sampling
by: Shenoy, Rahul, et al.
Published: (2024)
by: Shenoy, Rahul, et al.
Published: (2024)
VisPCO: Visual Token Pruning Configuration Optimization via Budget-Aware Pareto-Frontier Learning for Vision-Language Models
by: Ji, Huawei, et al.
Published: (2026)
by: Ji, Huawei, et al.
Published: (2026)
The Effects of Mixed Sample Data Augmentation are Class Dependent
by: Lee, Haeil, et al.
Published: (2023)
by: Lee, Haeil, et al.
Published: (2023)
Inductive Convolution Nuclear Norm Minimization for Tensor Completion with Arbitrary Sampling
by: Li, Wei, et al.
Published: (2026)
by: Li, Wei, et al.
Published: (2026)
Region-Adaptive Sampling for Diffusion Transformers
by: Liu, Ziming, et al.
Published: (2025)
by: Liu, Ziming, et al.
Published: (2025)
The Sampling-Gaussian for stereo matching
by: Pan, Baiyu, et al.
Published: (2024)
by: Pan, Baiyu, et al.
Published: (2024)
Foresight: Adaptive Layer Reuse for Accelerated and High-Quality Text-to-Video Generation
by: Adnan, Muhammad, et al.
Published: (2025)
by: Adnan, Muhammad, et al.
Published: (2025)
From Reusing to Forecasting: Accelerating Diffusion Models with TaylorSeers
by: Liu, Jiacheng, et al.
Published: (2025)
by: Liu, Jiacheng, et al.
Published: (2025)
Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks
by: Zou, Jinping, et al.
Published: (2024)
by: Zou, Jinping, et al.
Published: (2024)
Sharp Eyes and Memory for VideoLLMs: Information-Aware Visual Token Pruning for Efficient and Reliable VideoLLM Reasoning
by: Qin, Jialong, et al.
Published: (2025)
by: Qin, Jialong, et al.
Published: (2025)
SkipViT: Speeding Up Vision Transformers with a Token-Level Skip Connection
by: Ataiefard, Foozhan, et al.
Published: (2024)
by: Ataiefard, Foozhan, et al.
Published: (2024)
FRDiff : Feature Reuse for Universal Training-free Acceleration of Diffusion Models
by: So, Junhyuk, et al.
Published: (2023)
by: So, Junhyuk, et al.
Published: (2023)
Gradient-Direction-Aware Density Control for 3D Gaussian Splatting
by: Zhou, Zheng, et al.
Published: (2025)
by: Zhou, Zheng, et al.
Published: (2025)
Decomposed Vision-Language Alignment for Fine-Grained Open-Vocabulary Segmentation
by: Wang, Chenhao, et al.
Published: (2026)
by: Wang, Chenhao, et al.
Published: (2026)
AuthSig: Safeguarding Scanned Signatures Against Unauthorized Reuse in Paperless Workflows
by: Zhang, RuiQiang, et al.
Published: (2025)
by: Zhang, RuiQiang, et al.
Published: (2025)
ProReflow: Progressive Reflow with Decomposed Velocity
by: Ke, Lei, et al.
Published: (2025)
by: Ke, Lei, et al.
Published: (2025)
Decomposing Complex Visual Comprehension into Atomic Visual Skills for Vision Language Models
by: Chae, Hyunsik, et al.
Published: (2025)
by: Chae, Hyunsik, et al.
Published: (2025)
Modality-Collaborative Low-Rank Decomposers for Few-Shot Video Domain Adaptation
by: Wanyan, Yuyang, et al.
Published: (2025)
by: Wanyan, Yuyang, et al.
Published: (2025)
MEC-Quant: Maximum Entropy Coding for Extremely Low Bit Quantization-Aware Training
by: Pang, Junbiao, et al.
Published: (2025)
by: Pang, Junbiao, et al.
Published: (2025)
DL-QAT: Weight-Decomposed Low-Rank Quantization-Aware Training for Large Language Models
by: Ke, Wenjin, et al.
Published: (2025)
by: Ke, Wenjin, et al.
Published: (2025)
Similar Items
-
Asymptotic Unbiased Sample Sampling to Speed Up Sharpness-Aware Minimization
by: Deng, Jiaxin, et al.
Published: (2024) -
NCSAM Noise-Compensated Sharpness-Aware Minimization for Noisy Label Learning
by: Xu, Jiayu, et al.
Published: (2026) -
Effective Gradient Sample Size via Variation Estimation for Accelerating Sharpness aware Minimization
by: Deng, Jiaxin, et al.
Published: (2024) -
Bilateral Sharpness-Aware Minimization for Flatter Minima
by: Deng, Jiaxin, et al.
Published: (2024) -
Learning from Loss Landscape: Generalizable Mixed-Precision Quantization via Adaptive Sharpness-Aware Gradient Aligning
by: Ma, Lianbo, et al.
Published: (2025)