Control Theoretic Approach to Fine-Tuning and Transfer Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Bayram, Erkan, Liu, Shenyu, Belabbas, Mohamed-Ali, Başar, Tamer |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Geometric Foundations of Tuning without Forgetting in Neural ODEs
di: Bayram, Erkan, et al.
Pubblicazione: (2025)
di: Bayram, Erkan, et al.
Pubblicazione: (2025)
Control Disturbance Rejection in Neural ODEs
di: Bayram, Erkan, et al.
Pubblicazione: (2025)
di: Bayram, Erkan, et al.
Pubblicazione: (2025)
Constructing Stochastic Matrices for Weighted Averaging in Gossip Networks
di: Bayram, Erkan, et al.
Pubblicazione: (2025)
di: Bayram, Erkan, et al.
Pubblicazione: (2025)
Revisiting LQR Control from the Perspective of Receding-Horizon Policy Gradient
di: Zhang, Xiangyuan, et al.
Pubblicazione: (2023)
di: Zhang, Xiangyuan, et al.
Pubblicazione: (2023)
Age of Coded Updates In Gossip Networks Under Memory and Memoryless Schemes
di: Bayram, Erkan, et al.
Pubblicazione: (2024)
di: Bayram, Erkan, et al.
Pubblicazione: (2024)
InterQ: A DQN Framework for Optimal Intermittent Control
di: Aggarwal, Shubham, et al.
Pubblicazione: (2025)
di: Aggarwal, Shubham, et al.
Pubblicazione: (2025)
Age of $k$-out-of-$n$ Systems on a Gossip Network
di: Bayram, Erkan, et al.
Pubblicazione: (2024)
di: Bayram, Erkan, et al.
Pubblicazione: (2024)
The Silence that Speaks: Neural Estimation via Communication Gaps
di: Aggarwal, Shubham, et al.
Pubblicazione: (2025)
di: Aggarwal, Shubham, et al.
Pubblicazione: (2025)
On Infinite-horizon Minimum Energy Control
di: Belabbas, Mohamed-Ali, et al.
Pubblicazione: (2025)
di: Belabbas, Mohamed-Ali, et al.
Pubblicazione: (2025)
Structure Matters: Dynamic Policy Gradient
di: Klein, Sara, et al.
Pubblicazione: (2024)
di: Klein, Sara, et al.
Pubblicazione: (2024)
Near Optimal Convergence to Coarse Correlated Equilibrium in General-Sum Markov Games
di: Yorulmaz, Asrin Efe, et al.
Pubblicazione: (2025)
di: Yorulmaz, Asrin Efe, et al.
Pubblicazione: (2025)
Controlgym: Large-Scale Control Environments for Benchmarking Reinforcement Learning Algorithms
di: Zhang, Xiangyuan, et al.
Pubblicazione: (2023)
di: Zhang, Xiangyuan, et al.
Pubblicazione: (2023)
Meta-Learning for Repeated Bayesian Persuasion
di: Turna, Ata Poyraz, et al.
Pubblicazione: (2026)
di: Turna, Ata Poyraz, et al.
Pubblicazione: (2026)
Convergence and sample complexity of natural policy gradient primal-dual methods for constrained MDPs
di: Ding, Dongsheng, et al.
Pubblicazione: (2022)
di: Ding, Dongsheng, et al.
Pubblicazione: (2022)
Learning How to Strategically Disclose Information
di: Velicheti, Raj Kiriti, et al.
Pubblicazione: (2024)
di: Velicheti, Raj Kiriti, et al.
Pubblicazione: (2024)
Graphons and the $H$-property
di: Belabbas, Mohamed-Ali, et al.
Pubblicazione: (2024)
di: Belabbas, Mohamed-Ali, et al.
Pubblicazione: (2024)
Dynamic Global Feedback Stabilization: why do the twist?
di: Belabbas, Mohamed-Ali, et al.
Pubblicazione: (2024)
di: Belabbas, Mohamed-Ali, et al.
Pubblicazione: (2024)
On the invariance of super-linearization under polynomial automorphisms
di: Harshana, Anmol, et al.
Pubblicazione: (2025)
di: Harshana, Anmol, et al.
Pubblicazione: (2025)
Disentangling Resilience from Robustness: Contextual Dualism, Interactionism, and Game-Theoretic Paradigms
di: Zhu, Quanyan, et al.
Pubblicazione: (2024)
di: Zhu, Quanyan, et al.
Pubblicazione: (2024)
Precise Insulin Delivery for Artificial Pancreas: A Reinforcement Learning Optimized Adaptive Fuzzy Control Approach
di: Mameche, Omar, et al.
Pubblicazione: (2025)
di: Mameche, Omar, et al.
Pubblicazione: (2025)
Transfer Learning in Bayesian Optimization for Aircraft Design
di: Tfaily, Ali, et al.
Pubblicazione: (2026)
di: Tfaily, Ali, et al.
Pubblicazione: (2026)
A Control Theoretic Framework for Adaptive Gradient Optimizers in Machine Learning
di: Chakrabarti, Kushal, et al.
Pubblicazione: (2022)
di: Chakrabarti, Kushal, et al.
Pubblicazione: (2022)
Variational Contraction Conditions for Iterative Algorithms in Multi-Population Discrete-Time Regularized Mean-Field Games
di: Aydın, Uğur, et al.
Pubblicazione: (2026)
di: Aydın, Uğur, et al.
Pubblicazione: (2026)
A Hessian-Free Actor-Critic Algorithm for Bi-Level Reinforcement Learning with Applications to LLM Fine-Tuning
di: Zeng, Sihan, et al.
Pubblicazione: (2026)
di: Zeng, Sihan, et al.
Pubblicazione: (2026)
Online Learning for Supervisory Switching Control
di: Sun, Haoyuan, et al.
Pubblicazione: (2026)
di: Sun, Haoyuan, et al.
Pubblicazione: (2026)
Zero-Order Optimization for LLM Fine-Tuning via Learnable Direction Sampling
di: Parfenov, Valery, et al.
Pubblicazione: (2026)
di: Parfenov, Valery, et al.
Pubblicazione: (2026)
Efficient Tail-Aware Generative Optimization via Flow Model Fine-Tuning
di: Wang, Zifan, et al.
Pubblicazione: (2026)
di: Wang, Zifan, et al.
Pubblicazione: (2026)
LoFT: Low-Rank Adaptation That Behaves Like Full Fine-Tuning
di: Tastan, Nurbek, et al.
Pubblicazione: (2025)
di: Tastan, Nurbek, et al.
Pubblicazione: (2025)
Theoretical Analysis on how Learning Rate Warmup Accelerates Convergence
di: Liu, Yuxing, et al.
Pubblicazione: (2025)
di: Liu, Yuxing, et al.
Pubblicazione: (2025)
A Soft Inducement Framework for Incentive-Aided Steering of No-Regret Players
di: Yorulmaz, Asrin Efe, et al.
Pubblicazione: (2025)
di: Yorulmaz, Asrin Efe, et al.
Pubblicazione: (2025)
Policy Transfer for Continuous-Time Reinforcement Learning: A (Rough) Differential Equation Approach
di: Guo, Xin, et al.
Pubblicazione: (2025)
di: Guo, Xin, et al.
Pubblicazione: (2025)
Towards Robust Learning to Optimize with Theoretical Guarantees
di: Song, Qingyu, et al.
Pubblicazione: (2025)
di: Song, Qingyu, et al.
Pubblicazione: (2025)
Gradient-Informed Monte Carlo Fine-Tuning of Diffusion Models for Low-Thrust Trajectory Design
di: Graebner, Jannik, et al.
Pubblicazione: (2025)
di: Graebner, Jannik, et al.
Pubblicazione: (2025)
Reevaluating Theoretical Analysis Methods for Optimization in Deep Learning
di: Tran, Hoang, et al.
Pubblicazione: (2024)
di: Tran, Hoang, et al.
Pubblicazione: (2024)
Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning
di: Zhao, Hanyang, et al.
Pubblicazione: (2025)
di: Zhao, Hanyang, et al.
Pubblicazione: (2025)
A Theoretical Analysis of Self-Supervised Learning for Vision Transformers
di: Huang, Yu, et al.
Pubblicazione: (2024)
di: Huang, Yu, et al.
Pubblicazione: (2024)
Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence
di: Han, Yinbin, et al.
Pubblicazione: (2024)
di: Han, Yinbin, et al.
Pubblicazione: (2024)
A Heuristic Approach for Performance Tuning in RL-based Quadrotor Control via Reward Design and Termination Conditions
di: Suarez, Fausto Mauricio Lagos, et al.
Pubblicazione: (2026)
di: Suarez, Fausto Mauricio Lagos, et al.
Pubblicazione: (2026)
Learning-to-Optimize with PAC-Bayesian Guarantees: Theoretical Considerations and Practical Implementation
di: Sucker, Michael, et al.
Pubblicazione: (2024)
di: Sucker, Michael, et al.
Pubblicazione: (2024)
A Theoretical and Experimental Study of a Novel Adaptive Learning Algorithm
di: Kumari, Sakshi, et al.
Pubblicazione: (2026)
di: Kumari, Sakshi, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Geometric Foundations of Tuning without Forgetting in Neural ODEs
di: Bayram, Erkan, et al.
Pubblicazione: (2025) -
Control Disturbance Rejection in Neural ODEs
di: Bayram, Erkan, et al.
Pubblicazione: (2025) -
Constructing Stochastic Matrices for Weighted Averaging in Gossip Networks
di: Bayram, Erkan, et al.
Pubblicazione: (2025) -
Revisiting LQR Control from the Perspective of Receding-Horizon Policy Gradient
di: Zhang, Xiangyuan, et al.
Pubblicazione: (2023) -
Age of Coded Updates In Gossip Networks Under Memory and Memoryless Schemes
di: Bayram, Erkan, et al.
Pubblicazione: (2024)