Discounted Adaptive Online Learning: Towards Better Regularization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Zhiyu, Bombara, David, Yang, Heng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improving Adaptive Online Learning Using Refined Discretization
par: Zhang, Zhiyu, et autres
Publié: (2023)
par: Zhang, Zhiyu, et autres
Publié: (2023)
The Benefit of Being Bayesian in Online Conformal Prediction
par: Zhang, Zhiyu, et autres
Publié: (2024)
par: Zhang, Zhiyu, et autres
Publié: (2024)
Online Recommendations for Agents with Discounted Adaptive Preferences
par: Agarwal, Arpit, et autres
Publié: (2023)
par: Agarwal, Arpit, et autres
Publié: (2023)
Discounted Online Convex Optimization: Uniform Regret Across a Continuous Interval
par: Yang, Wenhao, et autres
Publié: (2025)
par: Yang, Wenhao, et autres
Publié: (2025)
Imitation Learning from Observation with Automatic Discount Scheduling
par: Liu, Yuyang, et autres
Publié: (2023)
par: Liu, Yuyang, et autres
Publié: (2023)
Reducing Reward Dependence in RL Through Adaptive Confidence Discounting
par: Satici, Muhammed Yusuf, et autres
Publié: (2025)
par: Satici, Muhammed Yusuf, et autres
Publié: (2025)
Towards Better Spherical Sliced-Wasserstein Distance Learning with Data-Adaptive Discriminative Projection Direction
par: Zhang, Hongliang, et autres
Publié: (2024)
par: Zhang, Hongliang, et autres
Publié: (2024)
Online Linear Regression in Dynamic Environments via Discounting
par: Jacobsen, Andrew, et autres
Publié: (2024)
par: Jacobsen, Andrew, et autres
Publié: (2024)
Fast TRAC: A Parameter-Free Optimizer for Lifelong Reinforcement Learning
par: Muppidi, Aneesh, et autres
Publié: (2024)
par: Muppidi, Aneesh, et autres
Publié: (2024)
Nonstationary Generalized Linear Bandits with Discounted Online Mirror Descent
par: Lee, Joongkyu, et autres
Publié: (2026)
par: Lee, Joongkyu, et autres
Publié: (2026)
Towards Robust Continual Learning with Bayesian Adaptive Moment Regularization
par: Foster, Jack, et autres
Publié: (2023)
par: Foster, Jack, et autres
Publié: (2023)
Adaptive Discounting of Training Time Attacks
par: Bector, Ridhima, et autres
Publié: (2024)
par: Bector, Ridhima, et autres
Publié: (2024)
Learning to Reason Efficiently with Discounted Reinforcement Learning
par: Ayoub, Alex, et autres
Publié: (2025)
par: Ayoub, Alex, et autres
Publié: (2025)
Operationalizing Stein's Method for Online Linear Optimization: CLT-Based Optimal Tradeoffs
par: Zhang, Zhiyu, et autres
Publié: (2026)
par: Zhang, Zhiyu, et autres
Publié: (2026)
Randomized Neural Network with Adaptive Forward Regularization for Online Task-free Class Incremental Learning
par: Wang, Junda, et autres
Publié: (2025)
par: Wang, Junda, et autres
Publié: (2025)
Logarithmic Regret for Online KL-Regularized Reinforcement Learning
par: Zhao, Heyang, et autres
Publié: (2025)
par: Zhao, Heyang, et autres
Publié: (2025)
Reducing Blackwell and Average Optimality to Discounted MDPs via the Blackwell Discount Factor
par: Grand-Clément, Julien, et autres
Publié: (2023)
par: Grand-Clément, Julien, et autres
Publié: (2023)
Reinforcement Learning with Quasi-Hyperbolic Discounting
par: Eshwar, S. R., et autres
Publié: (2024)
par: Eshwar, S. R., et autres
Publié: (2024)
Bridging the Gap Between Average and Discounted TD Learning
par: Tian, Haoxing, et autres
Publié: (2026)
par: Tian, Haoxing, et autres
Publié: (2026)
Selective Learning: Towards Robust Calibration with Dynamic Regularization
par: Han, Zongbo, et autres
Publié: (2024)
par: Han, Zongbo, et autres
Publié: (2024)
Multimodal Learning with Uncertainty Quantification based on Discounted Belief Fusion
par: Bezirganyan, Grigor, et autres
Publié: (2024)
par: Bezirganyan, Grigor, et autres
Publié: (2024)
Imitation Learning in Discounted Linear MDPs without exploration assumptions
par: Viano, Luca, et autres
Publié: (2024)
par: Viano, Luca, et autres
Publié: (2024)
Adapting Prediction Sets to Distribution Shifts Without Labels
par: Kasa, Kevin, et autres
Publié: (2024)
par: Kasa, Kevin, et autres
Publié: (2024)
Reinforcement Learning for Exponential Utility: Algorithms and Convergence in Discounted MDPs
par: Thoppe, Gugan, et autres
Publié: (2026)
par: Thoppe, Gugan, et autres
Publié: (2026)
When Less Latent Leads to Better Relay: Information-Preserving Compression for Latent Multi-Agent LLM Collaboration
par: Li, Yiping, et autres
Publié: (2026)
par: Li, Yiping, et autres
Publié: (2026)
Understanding Adam Optimizer via Online Learning of Updates: Adam is FTRL in Disguise
par: Ahn, Kwangjun, et autres
Publié: (2024)
par: Ahn, Kwangjun, et autres
Publié: (2024)
Decoupling Time and Risk: Risk-Sensitive Reinforcement Learning with General Discounting
par: Moghimi, Mehrdad, et autres
Publié: (2026)
par: Moghimi, Mehrdad, et autres
Publié: (2026)
AdaGamma: State-Dependent Discounting for Temporal Adaptation in Reinforcement Learning
par: Wang, Yaomin, et autres
Publié: (2026)
par: Wang, Yaomin, et autres
Publié: (2026)
Adaptive Online Learning of Quantum States
par: Chen, Xinyi, et autres
Publié: (2022)
par: Chen, Xinyi, et autres
Publié: (2022)
Inertial Quadratic Majorization Minimization with Application to Kernel Regularized Learning
par: Heng, Qiang, et autres
Publié: (2025)
par: Heng, Qiang, et autres
Publié: (2025)
Control, Transport and Sampling: Towards Better Loss Design
par: Jiang, Qijia, et autres
Publié: (2024)
par: Jiang, Qijia, et autres
Publié: (2024)
Decentralized Online Regularized Learning Over Random Time-Varying Graphs
par: Zhang, Xiwei, et autres
Publié: (2022)
par: Zhang, Xiwei, et autres
Publié: (2022)
Reinforcement Learning for Infinite-Horizon Average-Reward Linear MDPs via Approximation by Discounted-Reward MDPs
par: Hong, Kihyuk, et autres
Publié: (2024)
par: Hong, Kihyuk, et autres
Publié: (2024)
Teaching RL Agents to Act Better: VLM as Action Advisor for Online Reinforcement Learning
par: Wu, Xiefeng, et autres
Publié: (2025)
par: Wu, Xiefeng, et autres
Publié: (2025)
On the Sample Complexity of Discounted Reinforcement Learning with Optimized Certainty Equivalents
par: Mortensen, Oliver, et autres
Publié: (2026)
par: Mortensen, Oliver, et autres
Publié: (2026)
Two Heads are Actually Better than One: Towards Better Adversarial Robustness via Transduction and Rejection
par: Palumbo, Nils, et autres
Publié: (2023)
par: Palumbo, Nils, et autres
Publié: (2023)
Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer
par: Yang, Yaodong, et autres
Publié: (2025)
par: Yang, Yaodong, et autres
Publié: (2025)
Reinforcement Learning with Adaptive Regularization for Safe Control of Critical Systems
par: Tian, Haozhe, et autres
Publié: (2024)
par: Tian, Haozhe, et autres
Publié: (2024)
AdaCubic: An Adaptive Cubic Regularization Optimizer for Deep Learning
par: Tsingalis, Ioannis, et autres
Publié: (2026)
par: Tsingalis, Ioannis, et autres
Publié: (2026)
RIZE: Adaptive Regularization for Imitation Learning
par: Karimi, Adib, et autres
Publié: (2025)
par: Karimi, Adib, et autres
Publié: (2025)
Documents similaires
-
Improving Adaptive Online Learning Using Refined Discretization
par: Zhang, Zhiyu, et autres
Publié: (2023) -
The Benefit of Being Bayesian in Online Conformal Prediction
par: Zhang, Zhiyu, et autres
Publié: (2024) -
Online Recommendations for Agents with Discounted Adaptive Preferences
par: Agarwal, Arpit, et autres
Publié: (2023) -
Discounted Online Convex Optimization: Uniform Regret Across a Continuous Interval
par: Yang, Wenhao, et autres
Publié: (2025) -
Imitation Learning from Observation with Automatic Discount Scheduling
par: Liu, Yuyang, et autres
Publié: (2023)