Provably Efficient and Agile Randomized Q-Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, He, Xu, Xingyu, Chi, Yuejie |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Provably Robust Score-Based Diffusion Posterior Sampling for Plug-and-Play Image Reconstruction
par: Xu, Xingyu, et autres
Publié: (2024)
par: Xu, Xingyu, et autres
Publié: (2024)
The Sample-Communication Complexity Trade-off in Federated Q-Learning
par: Salgia, Sudeep, et autres
Publié: (2024)
par: Salgia, Sudeep, et autres
Publié: (2024)
Agentic Transformers Provably Learn to Search via Reinforcement Learning
par: Yang, Tong, et autres
Publié: (2026)
par: Yang, Tong, et autres
Publié: (2026)
Communication-Efficient Federated Optimization over Semi-Decentralized Networks
par: Wang, He, et autres
Publié: (2023)
par: Wang, He, et autres
Publié: (2023)
Transformers Provably Learn Chain-of-Thought Reasoning with Length Generalization
par: Huang, Yu, et autres
Publié: (2025)
par: Huang, Yu, et autres
Publié: (2025)
Sample Complexity of Average-Reward Q-Learning: From Single-agent to Federated Reinforcement Learning
par: Jiao, Yuchen, et autres
Publié: (2026)
par: Jiao, Yuchen, et autres
Publié: (2026)
Multi-head Transformers Provably Learn Symbolic Multi-step Reasoning via Gradient Descent
par: Yang, Tong, et autres
Publié: (2025)
par: Yang, Tong, et autres
Publié: (2025)
Distributionally Robust Model-Based Offline Reinforcement Learning with Near-Optimal Sample Complexity
par: Shi, Laixi, et autres
Publié: (2022)
par: Shi, Laixi, et autres
Publié: (2022)
Incentivize without Bonus: Provably Efficient Model-based Online Multi-agent RL for Markov Games
par: Yang, Tong, et autres
Publié: (2025)
par: Yang, Tong, et autres
Publié: (2025)
Polynomial Convergence of Riemannian Diffusion Models
par: Xu, Xingyu, et autres
Publié: (2026)
par: Xu, Xingyu, et autres
Publié: (2026)
The Power of Preconditioning in Overparameterized Low-Rank Matrix Sensing
par: Xu, Xingyu, et autres
Publié: (2023)
par: Xu, Xingyu, et autres
Publié: (2023)
Sample Complexity of Offline Distributionally Robust Linear Markov Decision Processes
par: Wang, He, et autres
Publié: (2024)
par: Wang, He, et autres
Publié: (2024)
Provably Sample-Efficient Robust Reinforcement Learning with Average Reward
par: Roch, Zachary, et autres
Publié: (2025)
par: Roch, Zachary, et autres
Publié: (2025)
Sample-Efficient Robust Multi-Agent Reinforcement Learning in the Face of Environmental Uncertainty
par: Shi, Laixi, et autres
Publié: (2024)
par: Shi, Laixi, et autres
Publié: (2024)
Accelerating Convergence of Score-Based Diffusion Models, Provably
par: Li, Gen, et autres
Publié: (2024)
par: Li, Gen, et autres
Publié: (2024)
Is Q-Learning Minimax Optimal? A Tight Sample Complexity Analysis
par: Li, Gen, et autres
Publié: (2021)
par: Li, Gen, et autres
Publié: (2021)
Provably Efficient Exploration in Policy Optimization
par: Cai, Qi, et autres
Publié: (2019)
par: Cai, Qi, et autres
Publié: (2019)
Prompt-prompted Adaptive Structured Pruning for Efficient LLM Generation
par: Dong, Harry, et autres
Publié: (2024)
par: Dong, Harry, et autres
Publié: (2024)
Exploration from a Primal-Dual Lens: Value-Incentivized Actor-Critic Methods for Sample-Efficient Online RL
par: Yang, Tong, et autres
Publié: (2025)
par: Yang, Tong, et autres
Publié: (2025)
Statistical and Algorithmic Foundations of Reinforcement Learning
par: Chi, Yuejie, et autres
Publié: (2025)
par: Chi, Yuejie, et autres
Publié: (2025)
A Theoretical Analysis of Self-Supervised Learning for Vision Transformers
par: Huang, Yu, et autres
Publié: (2024)
par: Huang, Yu, et autres
Publié: (2024)
Vertical Federated Learning with Missing Features During Training and Inference
par: Valdeira, Pedro, et autres
Publié: (2024)
par: Valdeira, Pedro, et autres
Publié: (2024)
Federated Offline Reinforcement Learning: Collaborative Single-Policy Coverage Suffices
par: Woo, Jiin, et autres
Publié: (2024)
par: Woo, Jiin, et autres
Publié: (2024)
Provably and Practically Efficient Adversarial Imitation Learning with General Function Approximation
par: Xu, Tian, et autres
Publié: (2024)
par: Xu, Tian, et autres
Publié: (2024)
Get More with LESS: Synthesizing Recurrence with KV Cache Compression for Efficient LLM Inference
par: Dong, Harry, et autres
Publié: (2024)
par: Dong, Harry, et autres
Publié: (2024)
Provable Learning of Random Hierarchy Models and Hierarchical Shallow-to-Deep Chaining
par: Ren, Yunwei, et autres
Publié: (2026)
par: Ren, Yunwei, et autres
Publié: (2026)
Contrastive UCB: Provably Efficient Contrastive Self-Supervised Learning in Online Reinforcement Learning
par: Qiu, Shuang, et autres
Publié: (2022)
par: Qiu, Shuang, et autres
Publié: (2022)
Eidetic Learning: an Efficient and Provable Solution to Catastrophic Forgetting
par: Dronen, Nicholas, et autres
Publié: (2025)
par: Dronen, Nicholas, et autres
Publié: (2025)
Provably Efficient Interactive-Grounded Learning with Personalized Reward
par: Zhang, Mengxiao, et autres
Publié: (2024)
par: Zhang, Mengxiao, et autres
Publié: (2024)
Provable and Practical: Efficient Exploration in Reinforcement Learning via Langevin Monte Carlo
par: Ishfaq, Haque, et autres
Publié: (2023)
par: Ishfaq, Haque, et autres
Publié: (2023)
Diverse Randomized Value Functions: A Provably Pessimistic Approach for Offline Reinforcement Learning
par: Yu, Xudong, et autres
Publié: (2024)
par: Yu, Xudong, et autres
Publié: (2024)
Federated Natural Policy Gradient and Actor Critic Methods for Multi-task Reinforcement Learning
par: Yang, Tong, et autres
Publié: (2023)
par: Yang, Tong, et autres
Publié: (2023)
Provably Efficient Reinforcement Learning with Multinomial Logit Function Approximation
par: Li, Long-Fei, et autres
Publié: (2024)
par: Li, Long-Fei, et autres
Publié: (2024)
In-Context Learning with Representations: Contextual Generalization of Trained Transformers
par: Yang, Tong, et autres
Publié: (2024)
par: Yang, Tong, et autres
Publié: (2024)
Learning Equilibria from Data: Provably Efficient Multi-Agent Imitation Learning
par: Freihaut, Till, et autres
Publié: (2025)
par: Freihaut, Till, et autres
Publié: (2025)
Characterizing the Accuracy-Communication-Privacy Trade-off in Distributed Stochastic Convex Optimization
par: Salgia, Sudeep, et autres
Publié: (2025)
par: Salgia, Sudeep, et autres
Publié: (2025)
RA-PbRL: Provably Efficient Risk-Aware Preference-Based Reinforcement Learning
par: Zhao, Yujie, et autres
Publié: (2024)
par: Zhao, Yujie, et autres
Publié: (2024)
Breaking the Sample Size Barrier in Model-Based Reinforcement Learning with a Generative Model
par: Li, Gen, et autres
Publié: (2020)
par: Li, Gen, et autres
Publié: (2020)
Beyond Centralization: Provable Communication Efficient Decentralized Multi-Task Learning
par: Kang, Donghwa, et autres
Publié: (2025)
par: Kang, Donghwa, et autres
Publié: (2025)
Provably Efficient Off-Policy Adversarial Imitation Learning with Convergence Guarantees
par: Chen, Yilei, et autres
Publié: (2024)
par: Chen, Yilei, et autres
Publié: (2024)
Documents similaires
-
Provably Robust Score-Based Diffusion Posterior Sampling for Plug-and-Play Image Reconstruction
par: Xu, Xingyu, et autres
Publié: (2024) -
The Sample-Communication Complexity Trade-off in Federated Q-Learning
par: Salgia, Sudeep, et autres
Publié: (2024) -
Agentic Transformers Provably Learn to Search via Reinforcement Learning
par: Yang, Tong, et autres
Publié: (2026) -
Communication-Efficient Federated Optimization over Semi-Decentralized Networks
par: Wang, He, et autres
Publié: (2023) -
Transformers Provably Learn Chain-of-Thought Reasoning with Length Generalization
par: Huang, Yu, et autres
Publié: (2025)