Transition Transfer $Q$-Learning for Composite Markov Decision Processes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chai, Jinhang, Chen, Elynn, Yang, Lin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning
par: Chai, Jinhang, et autres
Publié: (2025)
par: Chai, Jinhang, et autres
Publié: (2025)
Low-Rank Plus Sparse Matrix Transfer Learning under Growing Representations and Ambient Dimensions
par: Chai, Jinhang, et autres
Publié: (2026)
par: Chai, Jinhang, et autres
Publié: (2026)
One-Step Bellman Alignment Enables Provably Efficient Transfer in Online RL
par: Chen, Elynn, et autres
Publié: (2026)
par: Chen, Elynn, et autres
Publié: (2026)
Structured Matrix Learning under Arbitrary Entrywise Dependence and Estimation of Markov Transition Kernel
par: Chai, Jinhang, et autres
Publié: (2024)
par: Chai, Jinhang, et autres
Publié: (2024)
Data-Driven Knowledge Transfer in Batch $Q^*$ Learning
par: Chen, Elynn, et autres
Publié: (2024)
par: Chen, Elynn, et autres
Publié: (2024)
Transfer Q-learning
par: Chen, Elynn, et autres
Publié: (2022)
par: Chen, Elynn, et autres
Publié: (2022)
Transfer Learning for Contextual Joint Assortment-Pricing under Cross-Market Heterogeneity
par: Chen, Elynn, et autres
Publié: (2026)
par: Chen, Elynn, et autres
Publié: (2026)
On Convergence of Average-Reward Q-Learning in Weakly Communicating Markov Decision Processes
par: Wan, Yi, et autres
Publié: (2024)
par: Wan, Yi, et autres
Publié: (2024)
Transition Constrained Bayesian Optimization via Markov Decision Processes
par: Folch, Jose Pablo, et autres
Publié: (2024)
par: Folch, Jose Pablo, et autres
Publié: (2024)
Provably Efficient Reward Transfer in Reinforcement Learning with Discrete Markov Decision Processes
par: Vora, Kevin, et autres
Publié: (2025)
par: Vora, Kevin, et autres
Publié: (2025)
Federated Control in Markov Decision Processes
par: Jin, Hao, et autres
Publié: (2024)
par: Jin, Hao, et autres
Publié: (2024)
Learning in Markov Decision Processes with Exogenous Dynamics
par: Maran, Davide, et autres
Publié: (2026)
par: Maran, Davide, et autres
Publié: (2026)
A Cantor-Kantorovich Metric Between Markov Decision Processes with Application to Transfer Learning
par: Banse, Adrien, et autres
Publié: (2024)
par: Banse, Adrien, et autres
Publié: (2024)
Multi-Timescale Ensemble Q-learning for Markov Decision Process Policy Optimization
par: Bozkus, Talha, et autres
Publié: (2024)
par: Bozkus, Talha, et autres
Publié: (2024)
Monitored Markov Decision Processes
par: Parisi, Simone, et autres
Publié: (2024)
par: Parisi, Simone, et autres
Publié: (2024)
Learning Utilities from Demonstrations in Markov Decision Processes
par: Lazzati, Filippo, et autres
Publié: (2024)
par: Lazzati, Filippo, et autres
Publié: (2024)
Transfer Faster, Price Smarter: Minimax Dynamic Pricing under Cross-Market Preference Shift
par: Zhang, Yi, et autres
Publié: (2025)
par: Zhang, Yi, et autres
Publié: (2025)
A Unified Theory of Compositionality, Modularity, and Interpretability in Markov Decision Processes
par: Ringstrom, Thomas J., et autres
Publié: (2025)
par: Ringstrom, Thomas J., et autres
Publié: (2025)
Prior-Aligned Meta-RL: Thompson Sampling with Learned Priors and Guarantees in Finite-Horizon MDPs
par: Zhou, Runlin, et autres
Publié: (2025)
par: Zhou, Runlin, et autres
Publié: (2025)
Generalized Linear Markov Decision Process
par: Zhang, Sinian, et autres
Publié: (2025)
par: Zhang, Sinian, et autres
Publié: (2025)
MATE: Solving Contextual Markov Decision Processes with Memory of Accumulated Transition Embeddings
par: Hwang, Himchan, et autres
Publié: (2026)
par: Hwang, Himchan, et autres
Publié: (2026)
Learning Markov Decision Processes under Fully Bandit Feedback
par: Zhuo, Zhengjia, et autres
Publié: (2026)
par: Zhuo, Zhengjia, et autres
Publié: (2026)
Non-stationary and Varying-discounting Markov Decision Processes for Reinforcement Learning
par: Chen, Zhizuo, et autres
Publié: (2025)
par: Chen, Zhizuo, et autres
Publié: (2025)
Horizon-Free Regret for Linear Markov Decision Processes
par: Zhang, Zihan, et autres
Publié: (2024)
par: Zhang, Zihan, et autres
Publié: (2024)
Robust $Q$-learning Algorithm for Markov Decision Processes under Wasserstein Uncertainty
par: Neufeld, Ariel, et autres
Publié: (2022)
par: Neufeld, Ariel, et autres
Publié: (2022)
Learning Deterministic Policies with Policy Gradients in Constrained Markov Decision Processes
par: Montenegro, Alessandro, et autres
Publié: (2025)
par: Montenegro, Alessandro, et autres
Publié: (2025)
Interaction-Grounded Learning for Contextual Markov Decision Processes with Personalized Feedback
par: Zhang, Mengxiao, et autres
Publié: (2026)
par: Zhang, Mengxiao, et autres
Publié: (2026)
Impact of Markov Decision Process Design on Sim-to-Real Reinforcement Learning
par: Krau, Tatjana, et autres
Publié: (2026)
par: Krau, Tatjana, et autres
Publié: (2026)
Learning Constrained Markov Decision Processes With Non-stationary Rewards and Constraints
par: Stradi, Francesco Emanuele, et autres
Publié: (2024)
par: Stradi, Francesco Emanuele, et autres
Publié: (2024)
Weakly Time-Coupled Approximation of Markov Decision Processes
par: Soheili, Negar, et autres
Publié: (2026)
par: Soheili, Negar, et autres
Publié: (2026)
Best-of-Both-Worlds for Heavy-Tailed Markov Decision Processes
par: Chen, Yu, et autres
Publié: (2026)
par: Chen, Yu, et autres
Publié: (2026)
Optimistic Actor-Critic with Parametric Policies for Linear Markov Decision Processes
par: Lin, Max Qiushi, et autres
Publié: (2026)
par: Lin, Max Qiushi, et autres
Publié: (2026)
Optimal Decision Tree Policies for Markov Decision Processes
par: Vos, Daniël, et autres
Publié: (2023)
par: Vos, Daniël, et autres
Publié: (2023)
SMART Fine-tuning Factor Augmented Neural Lasso
par: Chai, Jinhang, et autres
Publié: (2026)
par: Chai, Jinhang, et autres
Publié: (2026)
Policy Testing in Markov Decision Processes
par: Ariu, Kaito, et autres
Publié: (2025)
par: Ariu, Kaito, et autres
Publié: (2025)
Learn A Flexible Exploration Model for Parameterized Action Markov Decision Processes
par: Wang, Zijian, et autres
Publié: (2025)
par: Wang, Zijian, et autres
Publié: (2025)
Dynamic Deep-Reinforcement-Learning Algorithm in Partially Observable Markov Decision Processes
par: Omi, Saki, et autres
Publié: (2023)
par: Omi, Saki, et autres
Publié: (2023)
Act as You Learn: Adaptive Decision-Making in Non-Stationary Markov Decision Processes
par: Luo, Baiting, et autres
Publié: (2024)
par: Luo, Baiting, et autres
Publié: (2024)
Markov Decision Processes under External Temporal Processes
par: Ayyagari, Ranga Shaarad, et autres
Publié: (2023)
par: Ayyagari, Ranga Shaarad, et autres
Publié: (2023)
The regret lower bound for communicating Markov Decision Processes
par: Boone, Victor, et autres
Publié: (2025)
par: Boone, Victor, et autres
Publié: (2025)
Documents similaires
-
Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning
par: Chai, Jinhang, et autres
Publié: (2025) -
Low-Rank Plus Sparse Matrix Transfer Learning under Growing Representations and Ambient Dimensions
par: Chai, Jinhang, et autres
Publié: (2026) -
One-Step Bellman Alignment Enables Provably Efficient Transfer in Online RL
par: Chen, Elynn, et autres
Publié: (2026) -
Structured Matrix Learning under Arbitrary Entrywise Dependence and Estimation of Markov Transition Kernel
par: Chai, Jinhang, et autres
Publié: (2024) -
Data-Driven Knowledge Transfer in Batch $Q^*$ Learning
par: Chen, Elynn, et autres
Publié: (2024)