Bayesian Natural Gradient Fine-Tuning of CLIP Models via Kalman Filtering
Fuente:
arXiv
Salvato in:
| Autori principali: | Abdi, Hossein, Sun, Mingfei, Pan, Wei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Gradient Regularized Natural Gradients
di: Dash, Satya Prakash, et al.
Pubblicazione: (2026)
di: Dash, Satya Prakash, et al.
Pubblicazione: (2026)
LoKO: Low-Rank Kalman Optimizer for Online Fine-Tuning of Large Models
di: Abdi, Hossein, et al.
Pubblicazione: (2024)
di: Abdi, Hossein, et al.
Pubblicazione: (2024)
Randomized Advantage Transformation (RAT): Computing Natural Policy Gradients via Direct Backpropagation
di: Sun, Mingfei
Pubblicazione: (2026)
di: Sun, Mingfei
Pubblicazione: (2026)
Rank-1 Approximation of Inverse Fisher for Natural Policy Gradients in Deep Reinforcement Learning
di: Huo, Yingxiao, et al.
Pubblicazione: (2026)
di: Huo, Yingxiao, et al.
Pubblicazione: (2026)
Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data Scheduler
di: Hu, Zixuan, et al.
Pubblicazione: (2025)
di: Hu, Zixuan, et al.
Pubblicazione: (2025)
MoFO: Momentum-Filtered Optimizer for Mitigating Forgetting in LLM Fine-Tuning
di: Chen, Yupeng, et al.
Pubblicazione: (2024)
di: Chen, Yupeng, et al.
Pubblicazione: (2024)
Kalman Bayesian Transformer
di: Jing, Haoming, et al.
Pubblicazione: (2025)
di: Jing, Haoming, et al.
Pubblicazione: (2025)
ADReFT: Adaptive Decision Repair for Safe Autonomous Driving via Reinforcement Fine-Tuning
di: Cheng, Mingfei, et al.
Pubblicazione: (2025)
di: Cheng, Mingfei, et al.
Pubblicazione: (2025)
Computation-Aware Kalman Filtering with Model Selection for Neural Dynamics
di: Huml, JR, et al.
Pubblicazione: (2026)
di: Huml, JR, et al.
Pubblicazione: (2026)
Precision Tracked Transformer via Kalman Filtering, Kriging and Process Noise
di: Long, Bo, et al.
Pubblicazione: (2026)
di: Long, Bo, et al.
Pubblicazione: (2026)
Diffusion Fine-Tuning via Reparameterized Policy Gradient of the Soft Q-Function
di: Kang, Hyeongyu, et al.
Pubblicazione: (2025)
di: Kang, Hyeongyu, et al.
Pubblicazione: (2025)
QuantLRM: Quantization of Large Reasoning Models via Fine-Tuning Signals
di: Zhang, Nan, et al.
Pubblicazione: (2026)
di: Zhang, Nan, et al.
Pubblicazione: (2026)
Policy Gradient with Adaptive Entropy Annealing for Continual Fine-Tuning
di: Zhang, Yaqian, et al.
Pubblicazione: (2026)
di: Zhang, Yaqian, et al.
Pubblicazione: (2026)
Kalman Filter for Online Classification of Non-Stationary Data
di: Titsias, Michalis K., et al.
Pubblicazione: (2023)
di: Titsias, Michalis K., et al.
Pubblicazione: (2023)
Fine-Tuning Discrete Diffusion Models with Policy Gradient Methods
di: Zekri, Oussama, et al.
Pubblicazione: (2025)
di: Zekri, Oussama, et al.
Pubblicazione: (2025)
A Bayesian Hybrid Parameter-Efficient Fine-Tuning Method for Large Language Models
di: Chai, Yidong, et al.
Pubblicazione: (2025)
di: Chai, Yidong, et al.
Pubblicazione: (2025)
Robust and Efficient Zeroth-Order LLM Fine-Tuning via Adaptive Bayesian Subspace Optimizer
di: Feng, Jian, et al.
Pubblicazione: (2026)
di: Feng, Jian, et al.
Pubblicazione: (2026)
The Kalman Evolve: Closing the Gap in Kalman Filtering via Interpretable Algorithm Discovery
di: Saketos, Vasileios, et al.
Pubblicazione: (2026)
di: Saketos, Vasileios, et al.
Pubblicazione: (2026)
Fine-Tuning Diffusion Models via Intermediate Distribution Shaping
di: Anil, Gautham Govind, et al.
Pubblicazione: (2025)
di: Anil, Gautham Govind, et al.
Pubblicazione: (2025)
Fine-Tuning Adaptive Stochastic Optimizers: Determining the Optimal Hyperparameter $ε$ via Gradient Magnitude Histogram Analysis
di: Silva, Gustavo, et al.
Pubblicazione: (2023)
di: Silva, Gustavo, et al.
Pubblicazione: (2023)
FedPFT: Federated Proxy Fine-Tuning of Foundation Models
di: Peng, Zhaopeng, et al.
Pubblicazione: (2024)
di: Peng, Zhaopeng, et al.
Pubblicazione: (2024)
Memory-Efficient Fine-Tuning via Low-Rank Activation Compression
di: Shi, Jiang-Xin, et al.
Pubblicazione: (2025)
di: Shi, Jiang-Xin, et al.
Pubblicazione: (2025)
H2Tune: Federated Foundation Model Fine-Tuning with Hybrid Heterogeneity
di: Guo, Wei, et al.
Pubblicazione: (2025)
di: Guo, Wei, et al.
Pubblicazione: (2025)
Exploring Gradient Subspaces: Addressing and Overcoming LoRA's Limitations in Federated Fine-Tuning of Large Language Models
di: Mahla, Navyansh, et al.
Pubblicazione: (2024)
di: Mahla, Navyansh, et al.
Pubblicazione: (2024)
Neural Bayesian Filtering
di: Solinas, Christopher, et al.
Pubblicazione: (2025)
di: Solinas, Christopher, et al.
Pubblicazione: (2025)
Continual Gradient Low-Rank Projection Fine-Tuning for LLMs
di: Wang, Chenxu, et al.
Pubblicazione: (2025)
di: Wang, Chenxu, et al.
Pubblicazione: (2025)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
di: Wang, Shumin, et al.
Pubblicazione: (2026)
di: Wang, Shumin, et al.
Pubblicazione: (2026)
iPINNER: An Iterative Physics-Informed Neural Network with Ensemble Kalman Filter
di: Lu, Binghang, et al.
Pubblicazione: (2025)
di: Lu, Binghang, et al.
Pubblicazione: (2025)
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
di: Li, Ziniu, et al.
Pubblicazione: (2024)
di: Li, Ziniu, et al.
Pubblicazione: (2024)
Thompson Sampling via Fine-Tuning of LLMs
di: Menet, Nicolas, et al.
Pubblicazione: (2025)
di: Menet, Nicolas, et al.
Pubblicazione: (2025)
SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
di: Kim, Gyuhak, et al.
Pubblicazione: (2025)
di: Kim, Gyuhak, et al.
Pubblicazione: (2025)
Filter-then-Weight: Online Data Selection and Reweighting for LLM Fine-Tuning
di: Wang, Fangxin, et al.
Pubblicazione: (2026)
di: Wang, Fangxin, et al.
Pubblicazione: (2026)
APAR: Modeling Irregular Target Functions in Tabular Regression via Arithmetic-Aware Pre-Training and Adaptive-Regularized Fine-Tuning
di: Wu, Hong-Wei, et al.
Pubblicazione: (2024)
di: Wu, Hong-Wei, et al.
Pubblicazione: (2024)
Zeroth-Order Fine-Tuning of LLMs in Random Subspaces
di: Yu, Ziming, et al.
Pubblicazione: (2024)
di: Yu, Ziming, et al.
Pubblicazione: (2024)
$α$-LoRA: Effective Fine-Tuning via Base Model Rescaling
di: Firdoussi, Aymane El, et al.
Pubblicazione: (2025)
di: Firdoussi, Aymane El, et al.
Pubblicazione: (2025)
Bridging Model-Based Optimization and Generative Modeling via Conservative Fine-Tuning of Diffusion Models
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024)
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024)
K-Score: Kalman Filter as a Principled Alternative to Reward Normalization in Reinforcement Learning
di: Xia, Zixuan, et al.
Pubblicazione: (2026)
di: Xia, Zixuan, et al.
Pubblicazione: (2026)
GIFT: Global stabilisation via Intrinsic Fine Tuning
di: Young, Rory, et al.
Pubblicazione: (2026)
di: Young, Rory, et al.
Pubblicazione: (2026)
LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently
di: Zhang, Yuanhe, et al.
Pubblicazione: (2025)
di: Zhang, Yuanhe, et al.
Pubblicazione: (2025)
A Stronger Mixture of Low-Rank Experts for Fine-Tuning Foundation Models
di: Sun, Mengyang, et al.
Pubblicazione: (2025)
di: Sun, Mengyang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Gradient Regularized Natural Gradients
di: Dash, Satya Prakash, et al.
Pubblicazione: (2026) -
LoKO: Low-Rank Kalman Optimizer for Online Fine-Tuning of Large Models
di: Abdi, Hossein, et al.
Pubblicazione: (2024) -
Randomized Advantage Transformation (RAT): Computing Natural Policy Gradients via Direct Backpropagation
di: Sun, Mingfei
Pubblicazione: (2026) -
Rank-1 Approximation of Inverse Fisher for Natural Policy Gradients in Deep Reinforcement Learning
di: Huo, Yingxiao, et al.
Pubblicazione: (2026) -
Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data Scheduler
di: Hu, Zixuan, et al.
Pubblicazione: (2025)