Agnostic Sharpness-Aware Minimization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nguyen, Van-Anh, Tran, Quyen, Truong, Tuan, Do, Thanh-Toan, Phung, Dinh, Le, Trung |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Diversity-Aware Agnostic Ensemble of Sharpness Minimizers
par: Bui, Anh, et autres
Publié: (2024)
par: Bui, Anh, et autres
Publié: (2024)
Sharpness-Aware Minimization in Logit Space Efficiently Enhances Direct Preference Optimization
par: Luo, Haocheng, et autres
Publié: (2026)
par: Luo, Haocheng, et autres
Publié: (2026)
Optimizing Specific and Shared Parameters for Efficient Parameter Tuning
par: Nguyen, Van-Anh, et autres
Publié: (2025)
par: Nguyen, Van-Anh, et autres
Publié: (2025)
Explicit Eigenvalue Regularization Improves Sharpness-Aware Minimization
par: Luo, Haocheng, et autres
Publié: (2025)
par: Luo, Haocheng, et autres
Publié: (2025)
Connective Viewpoints of Signal-to-Noise Diffusion Models
par: Doan, Khanh, et autres
Publié: (2024)
par: Doan, Khanh, et autres
Publié: (2024)
Promoting Ensemble Diversity with Interactive Bayesian Distributional Robustness for Fine-tuning Foundation Models
par: Pham, Ngoc-Quan, et autres
Publié: (2025)
par: Pham, Ngoc-Quan, et autres
Publié: (2025)
Sharpness-Aware Teleportation on Riemannian Manifolds
par: Truong, Tuan, et autres
Publié: (2023)
par: Truong, Tuan, et autres
Publié: (2023)
Improving Generalization with Flat Hilbert Bayesian Inference
par: Truong, Tuan, et autres
Publié: (2024)
par: Truong, Tuan, et autres
Publié: (2024)
Class-Prototype Conditional Diffusion Model with Gradient Projection for Continual Learning
par: Doan, Khanh, et autres
Publié: (2023)
par: Doan, Khanh, et autres
Publié: (2023)
Sharpness-Aware Data Generation for Zero-shot Quantization
par: Hoang-Anh, Dung, et autres
Publié: (2025)
par: Hoang-Anh, Dung, et autres
Publié: (2025)
Leveraging Hierarchical Taxonomies in Prompt-based Continual Learning
par: Tran, Quyen, et autres
Publié: (2024)
par: Tran, Quyen, et autres
Publié: (2024)
KOPPA: Improving Prompt-based Continual Learning with Key-Query Orthogonal Projection and Prototype-based One-Versus-All
par: Tran, Quyen, et autres
Publié: (2023)
par: Tran, Quyen, et autres
Publié: (2023)
Why Domain Generalization Fail? A View of Necessity and Sufficiency
par: Vuong, Long-Tung, et autres
Publié: (2025)
par: Vuong, Long-Tung, et autres
Publié: (2025)
Model and Feature Diversity for Bayesian Neural Networks in Mutual Learning
par: Pham, Cuong, et autres
Publié: (2024)
par: Pham, Cuong, et autres
Publié: (2024)
Beyond Losses Reweighting: Empowering Multi-Task Learning via the Generalization Perspective
par: Phan, Hoang, et autres
Publié: (2022)
par: Phan, Hoang, et autres
Publié: (2022)
MetaAug: Meta-Data Augmentation for Post-Training Quantization
par: Pham, Cuong, et autres
Publié: (2024)
par: Pham, Cuong, et autres
Publié: (2024)
A Class-aware Optimal Transport Approach with Higher-Order Moment Matching for Unsupervised Domain Adaptation
par: Nguyen, Tuan, et autres
Publié: (2024)
par: Nguyen, Tuan, et autres
Publié: (2024)
Unveiling m-Sharpness Through the Structure of Stochastic Gradient Noise
par: Luo, Haocheng, et autres
Publié: (2025)
par: Luo, Haocheng, et autres
Publié: (2025)
Generalization Bounds for Robust Contrastive Learning: From Theory to Practice
par: Tran, Ngoc N., et autres
Publié: (2023)
par: Tran, Ngoc N., et autres
Publié: (2023)
Enhancing Dataset Distillation via Non-Critical Region Refinement
par: Tran, Minh-Tuan, et autres
Publié: (2025)
par: Tran, Minh-Tuan, et autres
Publié: (2025)
CASUAL: Conditional Support Alignment for Domain Adaptation with Label Shift
par: Nguyen, Anh T, et autres
Publié: (2023)
par: Nguyen, Anh T, et autres
Publié: (2023)
Layer-Wise High-Impact Parameter Ratio Optimization in Post-Training Quantization for Large Language Models
par: Pham, Cuong, et autres
Publié: (2025)
par: Pham, Cuong, et autres
Publié: (2025)
Text-Enhanced Data-free Approach for Federated Class-Incremental Learning
par: Tran, Minh-Tuan, et autres
Publié: (2024)
par: Tran, Minh-Tuan, et autres
Publié: (2024)
Frequency Attention for Knowledge Distillation
par: Pham, Cuong, et autres
Publié: (2024)
par: Pham, Cuong, et autres
Publié: (2024)
Rethinking Output Alignment For 1-bit Post-Training Quantization of Large Language Models
par: Hoang, Dung Anh, et autres
Publié: (2025)
par: Hoang, Dung Anh, et autres
Publié: (2025)
Test-Time Instance-Specific Parameter Composition: A New Paradigm for Adaptive Generative Modeling
par: Tran, Minh-Tuan, et autres
Publié: (2026)
par: Tran, Minh-Tuan, et autres
Publié: (2026)
Adaptive Layer-Wise Transformations for Post-Training Quantization of Large Language Models
par: Pham, Cuong, et autres
Publié: (2025)
par: Pham, Cuong, et autres
Publié: (2025)
LightSAM: Parameter-Agnostic Sharpness-Aware Minimization
par: Cheng, Yifei, et autres
Publié: (2025)
par: Cheng, Yifei, et autres
Publié: (2025)
An Optimal Transport-driven Approach for Cultivating Latent Space in Online Incremental Learning
par: Tran, Quyen, et autres
Publié: (2022)
par: Tran, Quyen, et autres
Publié: (2022)
Revisiting Prefix-tuning: Statistical Benefits of Reparameterization among Prompts
par: Le, Minh, et autres
Publié: (2024)
par: Le, Minh, et autres
Publié: (2024)
Gradient-Aligned Calibration for Post-Training Quantization of Diffusion Models
par: Hoang, Dung Anh, et autres
Publié: (2026)
par: Hoang, Dung Anh, et autres
Publié: (2026)
Towards the Identifiability in Noisy Label Learning: A Multinomial Mixture Modelling Approach
par: Nguyen, Cuong, et autres
Publié: (2023)
par: Nguyen, Cuong, et autres
Publié: (2023)
Enhancing Domain Adaptation through Prompt Gradient Alignment
par: Phan, Hoang, et autres
Publié: (2024)
par: Phan, Hoang, et autres
Publié: (2024)
RepLoRA: Reparameterizing Low-Rank Adaptation via the Perspective of Mixture of Experts
par: Truong, Tuan, et autres
Publié: (2025)
par: Truong, Tuan, et autres
Publié: (2025)
BSO: Safety Alignment Is Density Ratio Matching
par: Nguyen, Tien-Phat, et autres
Publié: (2026)
par: Nguyen, Tien-Phat, et autres
Publié: (2026)
Safety Game: Inference-Time Alignment of Black-Box LLMs via Constrained Optimization
par: Nguyen, Tuan, et autres
Publié: (2025)
par: Nguyen, Tuan, et autres
Publié: (2025)
Sharpness-Guided Group Relative Policy Optimization via Probability Shaping
par: Le, Tue, et autres
Publié: (2025)
par: Le, Tue, et autres
Publié: (2025)
Leveraging Large Language Models for Information Verification -- an Engineering Approach
par: Hung, Nguyen Nang, et autres
Publié: (2025)
par: Hung, Nguyen Nang, et autres
Publié: (2025)
Hiding and Recovering Knowledge in Text-to-Image Diffusion Models via Learnable Prompts
par: Bui, Anh, et autres
Publié: (2024)
par: Bui, Anh, et autres
Publié: (2024)
VFOG: Variance-Reduced Fast Optimistic Gradient Methods for a Class of Nonmonotone Generalized Equations
par: Tran-Dinh, Quoc, et autres
Publié: (2025)
par: Tran-Dinh, Quoc, et autres
Publié: (2025)
Documents similaires
-
Diversity-Aware Agnostic Ensemble of Sharpness Minimizers
par: Bui, Anh, et autres
Publié: (2024) -
Sharpness-Aware Minimization in Logit Space Efficiently Enhances Direct Preference Optimization
par: Luo, Haocheng, et autres
Publié: (2026) -
Optimizing Specific and Shared Parameters for Efficient Parameter Tuning
par: Nguyen, Van-Anh, et autres
Publié: (2025) -
Explicit Eigenvalue Regularization Improves Sharpness-Aware Minimization
par: Luo, Haocheng, et autres
Publié: (2025) -
Connective Viewpoints of Signal-to-Noise Diffusion Models
par: Doan, Khanh, et autres
Publié: (2024)