Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Chai, Jinhang, Chen, Elynn, Fan, Jianqing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Transition Transfer $Q$-Learning for Composite Markov Decision Processes
di: Chai, Jinhang, et al.
Pubblicazione: (2025)
di: Chai, Jinhang, et al.
Pubblicazione: (2025)
Structured Matrix Learning under Arbitrary Entrywise Dependence and Estimation of Markov Transition Kernel
di: Chai, Jinhang, et al.
Pubblicazione: (2024)
di: Chai, Jinhang, et al.
Pubblicazione: (2024)
Low-Rank Plus Sparse Matrix Transfer Learning under Growing Representations and Ambient Dimensions
di: Chai, Jinhang, et al.
Pubblicazione: (2026)
di: Chai, Jinhang, et al.
Pubblicazione: (2026)
One-Step Bellman Alignment Enables Provably Efficient Transfer in Online RL
di: Chen, Elynn, et al.
Pubblicazione: (2026)
di: Chen, Elynn, et al.
Pubblicazione: (2026)
Data-Driven Knowledge Transfer in Batch $Q^*$ Learning
di: Chen, Elynn, et al.
Pubblicazione: (2024)
di: Chen, Elynn, et al.
Pubblicazione: (2024)
SMART Fine-tuning Factor Augmented Neural Lasso
di: Chai, Jinhang, et al.
Pubblicazione: (2026)
di: Chai, Jinhang, et al.
Pubblicazione: (2026)
Localized exploration in contextual dynamic pricing achieves dimension-free regret
di: Chai, Jinhang, et al.
Pubblicazione: (2024)
di: Chai, Jinhang, et al.
Pubblicazione: (2024)
Transfer Q-learning
di: Chen, Elynn, et al.
Pubblicazione: (2022)
di: Chen, Elynn, et al.
Pubblicazione: (2022)
Q-Learning with Shift-Aware Upper Confidence Bound in Non-Stationary Reinforcement Learning
di: Bui, Ha Manh, et al.
Pubblicazione: (2025)
di: Bui, Ha Manh, et al.
Pubblicazione: (2025)
Q-value Regularized Transformer for Offline Reinforcement Learning
di: Hu, Shengchao, et al.
Pubblicazione: (2024)
di: Hu, Shengchao, et al.
Pubblicazione: (2024)
Model-Based Reinforcement Learning for Offline Zero-Sum Markov Games
di: Yan, Yuling, et al.
Pubblicazione: (2022)
di: Yan, Yuling, et al.
Pubblicazione: (2022)
Transfer Learning for Contextual Joint Assortment-Pricing under Cross-Market Heterogeneity
di: Chen, Elynn, et al.
Pubblicazione: (2026)
di: Chen, Elynn, et al.
Pubblicazione: (2026)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
Imagination-Limited Q-Learning for Offline Reinforcement Learning
di: Liu, Wenhui, et al.
Pubblicazione: (2025)
di: Liu, Wenhui, et al.
Pubblicazione: (2025)
Mildly Conservative Q-Learning for Offline Reinforcement Learning
di: Lyu, Jiafei, et al.
Pubblicazione: (2022)
di: Lyu, Jiafei, et al.
Pubblicazione: (2022)
Adaptive $Q$-Aid for Conditional Supervised Learning in Offline Reinforcement Learning
di: Kim, Jeonghye, et al.
Pubblicazione: (2024)
di: Kim, Jeonghye, et al.
Pubblicazione: (2024)
Optimal Dynamic Regret by Transformers for Non-Stationary Reinforcement Learning
di: Chen, Baiyuan, et al.
Pubblicazione: (2025)
di: Chen, Baiyuan, et al.
Pubblicazione: (2025)
Adaptive Q-Chunking for Offline-to-Online Reinforcement Learning
di: Gireesh, Nandiraju, et al.
Pubblicazione: (2026)
di: Gireesh, Nandiraju, et al.
Pubblicazione: (2026)
Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement Learning
di: Mao, Yixiu, et al.
Pubblicazione: (2025)
di: Mao, Yixiu, et al.
Pubblicazione: (2025)
Offline Learning for Combinatorial Multi-armed Bandits
di: Liu, Xutong, et al.
Pubblicazione: (2025)
di: Liu, Xutong, et al.
Pubblicazione: (2025)
Inverse Reinforcement Learning from Non-Stationary Learning Agents
di: Sivakumar, Kavinayan P., et al.
Pubblicazione: (2024)
di: Sivakumar, Kavinayan P., et al.
Pubblicazione: (2024)
Exclusively Penalized Q-learning for Offline Reinforcement Learning
di: Yeom, Junghyuk, et al.
Pubblicazione: (2024)
di: Yeom, Junghyuk, et al.
Pubblicazione: (2024)
Wavelet Predictive Representations for Non-Stationary Reinforcement Learning
di: Wang, Min, et al.
Pubblicazione: (2025)
di: Wang, Min, et al.
Pubblicazione: (2025)
Causal Flow Q-Learning for Robust Offline Reinforcement Learning
di: Li, Mingxuan, et al.
Pubblicazione: (2026)
di: Li, Mingxuan, et al.
Pubblicazione: (2026)
On the Complexity of Offline Reinforcement Learning with $Q^\star$-Approximation and Partial Coverage
di: Liu, Haolin, et al.
Pubblicazione: (2026)
di: Liu, Haolin, et al.
Pubblicazione: (2026)
Robust Transfer Learning with Unreliable Source Data
di: Fan, Jianqing, et al.
Pubblicazione: (2023)
di: Fan, Jianqing, et al.
Pubblicazione: (2023)
Model-based Offline Reinforcement Learning with Lower Expectile Q-Learning
di: Park, Kwanyoung, et al.
Pubblicazione: (2024)
di: Park, Kwanyoung, et al.
Pubblicazione: (2024)
Peng's Q($λ$) for Conservative Value Estimation in Offline Reinforcement Learning
di: Kim, Byeongchan, et al.
Pubblicazione: (2026)
di: Kim, Byeongchan, et al.
Pubblicazione: (2026)
Efficient Restarts in Non-Stationary Model-Free Reinforcement Learning
di: Nonaka, Hiroshi, et al.
Pubblicazione: (2025)
di: Nonaka, Hiroshi, et al.
Pubblicazione: (2025)
DARLING: Detection Augmented Reinforcement Learning with Non-Stationary Guarantees
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2026)
di: Gerogiannis, Argyrios, et al.
Pubblicazione: (2026)
FlowQ: Energy-Guided Flow Policies for Offline Reinforcement Learning
di: Alles, Marvin, et al.
Pubblicazione: (2025)
di: Alles, Marvin, et al.
Pubblicazione: (2025)
PIQL: Projective Implicit Q-Learning with Support Constraint for Offline Reinforcement Learning
di: Han, Xinchen, et al.
Pubblicazione: (2025)
di: Han, Xinchen, et al.
Pubblicazione: (2025)
DeepAveragers: Offline Reinforcement Learning by Solving Derived Non-Parametric MDPs
di: Shrestha, Aayam, et al.
Pubblicazione: (2020)
di: Shrestha, Aayam, et al.
Pubblicazione: (2020)
Q-value Regularized Decision ConvFormer for Offline Reinforcement Learning
di: Yan, Teng, et al.
Pubblicazione: (2024)
di: Yan, Teng, et al.
Pubblicazione: (2024)
Scrutinize What We Ignore: Reining In Task Representation Shift Of Context-Based Offline Meta Reinforcement Learning
di: Zhang, Hai, et al.
Pubblicazione: (2024)
di: Zhang, Hai, et al.
Pubblicazione: (2024)
One-Step Flow Q-Learning: Addressing the Diffusion Policy Bottleneck in Offline Reinforcement Learning
di: Nguyen, Thanh, et al.
Pubblicazione: (2025)
di: Nguyen, Thanh, et al.
Pubblicazione: (2025)
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
di: Zhao, Kai, et al.
Pubblicazione: (2023)
di: Zhao, Kai, et al.
Pubblicazione: (2023)
Multi-Label Transfer Learning in Non-Stationary Data Streams
di: Du, Honghui, et al.
Pubblicazione: (2025)
di: Du, Honghui, et al.
Pubblicazione: (2025)
Expert Q-learning: Deep Reinforcement Learning with Coarse State Values from Offline Expert Examples
di: Meng, Li, et al.
Pubblicazione: (2021)
di: Meng, Li, et al.
Pubblicazione: (2021)
ComaDICE: Offline Cooperative Multi-Agent Reinforcement Learning with Stationary Distribution Shift Regularization
di: Bui, The Viet, et al.
Pubblicazione: (2024)
di: Bui, The Viet, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Transition Transfer $Q$-Learning for Composite Markov Decision Processes
di: Chai, Jinhang, et al.
Pubblicazione: (2025) -
Structured Matrix Learning under Arbitrary Entrywise Dependence and Estimation of Markov Transition Kernel
di: Chai, Jinhang, et al.
Pubblicazione: (2024) -
Low-Rank Plus Sparse Matrix Transfer Learning under Growing Representations and Ambient Dimensions
di: Chai, Jinhang, et al.
Pubblicazione: (2026) -
One-Step Bellman Alignment Enables Provably Efficient Transfer in Online RL
di: Chen, Elynn, et al.
Pubblicazione: (2026) -
Data-Driven Knowledge Transfer in Batch $Q^*$ Learning
di: Chen, Elynn, et al.
Pubblicazione: (2024)