Inverse Q-Learning Done Right: Offline Imitation Learning in $Q^π$-Realizable MDPs
Fuente:
arXiv
Salvato in:
| Autori principali: | Moulin, Antoine, Neu, Gergely, Viano, Luca |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Optimistically Optimistic Exploration for Provably Efficient Infinite-Horizon Reinforcement and Imitation Learning
di: Moulin, Antoine, et al.
Pubblicazione: (2025)
di: Moulin, Antoine, et al.
Pubblicazione: (2025)
Imitation Learning in Discounted Linear MDPs without exploration assumptions
di: Viano, Luca, et al.
Pubblicazione: (2024)
di: Viano, Luca, et al.
Pubblicazione: (2024)
IL-SOAR : Imitation Learning with Soft Optimistic Actor cRitic
di: Viel, Stefano, et al.
Pubblicazione: (2025)
di: Viel, Stefano, et al.
Pubblicazione: (2025)
Offline RL via Feature-Occupancy Gradient Ascent
di: Neu, Gergely, et al.
Pubblicazione: (2024)
di: Neu, Gergely, et al.
Pubblicazione: (2024)
Learning Equilibria from Data: Provably Efficient Multi-Agent Imitation Learning
di: Freihaut, Till, et al.
Pubblicazione: (2025)
di: Freihaut, Till, et al.
Pubblicazione: (2025)
Quantile Q-Learning: Revisiting Offline Extreme Q-Learning with Quantile Regression
di: Gao, Xinming, et al.
Pubblicazione: (2025)
di: Gao, Xinming, et al.
Pubblicazione: (2025)
Split the Differences, Pool the Rest: Provably Efficient Multi-Objective Imitation
di: Sheebaelhamd, Ziyad, et al.
Pubblicazione: (2026)
di: Sheebaelhamd, Ziyad, et al.
Pubblicazione: (2026)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
Imagination-Limited Q-Learning for Offline Reinforcement Learning
di: Liu, Wenhui, et al.
Pubblicazione: (2025)
di: Liu, Wenhui, et al.
Pubblicazione: (2025)
Mildly Conservative Q-Learning for Offline Reinforcement Learning
di: Lyu, Jiafei, et al.
Pubblicazione: (2022)
di: Lyu, Jiafei, et al.
Pubblicazione: (2022)
DO-IQS: Dynamics-Aware Offline Inverse Q-Learning for Optimal Stopping with Unknown Gain Functions
di: Kuchko, Anna
Pubblicazione: (2025)
di: Kuchko, Anna
Pubblicazione: (2025)
Q-value Regularized Transformer for Offline Reinforcement Learning
di: Hu, Shengchao, et al.
Pubblicazione: (2024)
di: Hu, Shengchao, et al.
Pubblicazione: (2024)
UNIQ: Offline Inverse Q-learning for Avoiding Undesirable Demonstrations
di: Hoang, Huy, et al.
Pubblicazione: (2024)
di: Hoang, Huy, et al.
Pubblicazione: (2024)
Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning
di: Chai, Jinhang, et al.
Pubblicazione: (2025)
di: Chai, Jinhang, et al.
Pubblicazione: (2025)
Adaptive $Q$-Aid for Conditional Supervised Learning in Offline Reinforcement Learning
di: Kim, Jeonghye, et al.
Pubblicazione: (2024)
di: Kim, Jeonghye, et al.
Pubblicazione: (2024)
Adaptive Q-Chunking for Offline-to-Online Reinforcement Learning
di: Gireesh, Nandiraju, et al.
Pubblicazione: (2026)
di: Gireesh, Nandiraju, et al.
Pubblicazione: (2026)
Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement Learning
di: Mao, Yixiu, et al.
Pubblicazione: (2025)
di: Mao, Yixiu, et al.
Pubblicazione: (2025)
Commit to the Bit: Reactive Reinforcement Learning Done Right
di: Eberhard, Onno, et al.
Pubblicazione: (2026)
di: Eberhard, Onno, et al.
Pubblicazione: (2026)
Exclusively Penalized Q-learning for Offline Reinforcement Learning
di: Yeom, Junghyuk, et al.
Pubblicazione: (2024)
di: Yeom, Junghyuk, et al.
Pubblicazione: (2024)
Causal Flow Q-Learning for Robust Offline Reinforcement Learning
di: Li, Mingxuan, et al.
Pubblicazione: (2026)
di: Li, Mingxuan, et al.
Pubblicazione: (2026)
Generalisation in Multitask Fitted Q-Iteration and Offline Q-learning
di: Manda, Kausthubh, et al.
Pubblicazione: (2025)
di: Manda, Kausthubh, et al.
Pubblicazione: (2025)
Model-based Offline Reinforcement Learning with Lower Expectile Q-Learning
di: Park, Kwanyoung, et al.
Pubblicazione: (2024)
di: Park, Kwanyoung, et al.
Pubblicazione: (2024)
Peng's Q($λ$) for Conservative Value Estimation in Offline Reinforcement Learning
di: Kim, Byeongchan, et al.
Pubblicazione: (2026)
di: Kim, Byeongchan, et al.
Pubblicazione: (2026)
Offline-Online Reinforcement Learning for Linear Mixture MDPs
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
Quantizer Design for Finite Model Approximations, Model Learning, and Quantized Q-Learning for MDPs with Unbounded Spaces
di: Bicer, Osman, et al.
Pubblicazione: (2025)
di: Bicer, Osman, et al.
Pubblicazione: (2025)
Extrinsicaly Rewarded Soft Q Imitation Learning with Discriminator
di: Furuyama, Ryoma, et al.
Pubblicazione: (2024)
di: Furuyama, Ryoma, et al.
Pubblicazione: (2024)
Trajectory Data Suffices for Statistically Efficient Learning in Offline RL with Linear $q^π$-Realizability and Concentrability
di: Tkachuk, Volodymyr, et al.
Pubblicazione: (2024)
di: Tkachuk, Volodymyr, et al.
Pubblicazione: (2024)
Frozen Policy Iteration: Computationally Efficient RL under Linear $Q^π$ Realizability for Deterministic Dynamics
di: Ke, Yijing, et al.
Pubblicazione: (2026)
di: Ke, Yijing, et al.
Pubblicazione: (2026)
Q-value Regularized Decision ConvFormer for Offline Reinforcement Learning
di: Yan, Teng, et al.
Pubblicazione: (2024)
di: Yan, Teng, et al.
Pubblicazione: (2024)
PIQL: Projective Implicit Q-Learning with Support Constraint for Offline Reinforcement Learning
di: Han, Xinchen, et al.
Pubblicazione: (2025)
di: Han, Xinchen, et al.
Pubblicazione: (2025)
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
di: Zhao, Kai, et al.
Pubblicazione: (2023)
di: Zhao, Kai, et al.
Pubblicazione: (2023)
Behavior-Adaptive Q-Learning: A Unifying Framework for Offline-to-Online RL
di: Zu, Lipeng, et al.
Pubblicazione: (2025)
di: Zu, Lipeng, et al.
Pubblicazione: (2025)
Offline Imitation Learning with Variational Counterfactual Reasoning
di: He, Bowei, et al.
Pubblicazione: (2023)
di: He, Bowei, et al.
Pubblicazione: (2023)
Q-learning for Quantile MDPs: A Decomposition, Performance, and Convergence Analysis
di: Hau, Jia Lin, et al.
Pubblicazione: (2024)
di: Hau, Jia Lin, et al.
Pubblicazione: (2024)
One-Step Flow Q-Learning: Addressing the Diffusion Policy Bottleneck in Offline Reinforcement Learning
di: Nguyen, Thanh, et al.
Pubblicazione: (2025)
di: Nguyen, Thanh, et al.
Pubblicazione: (2025)
Online combinatorial optimization with stochastic decision sets and adversarial losses
di: Neu, Gergely, et al.
Pubblicazione: (2026)
di: Neu, Gergely, et al.
Pubblicazione: (2026)
Online-to-PAC Conversions: Generalization Bounds via Regret Analysis
di: Lugosi, Gábor, et al.
Pubblicazione: (2023)
di: Lugosi, Gábor, et al.
Pubblicazione: (2023)
Residual Q-Learning: Offline and Online Policy Customization without Value
di: Li, Chenran, et al.
Pubblicazione: (2023)
di: Li, Chenran, et al.
Pubblicazione: (2023)
Entropy-regularized Diffusion Policy with Q-Ensembles for Offline Reinforcement Learning
di: Zhang, Ruoqi, et al.
Pubblicazione: (2024)
di: Zhang, Ruoqi, et al.
Pubblicazione: (2024)
On the Complexity of Offline Reinforcement Learning with $Q^\star$-Approximation and Partial Coverage
di: Liu, Haolin, et al.
Pubblicazione: (2026)
di: Liu, Haolin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Optimistically Optimistic Exploration for Provably Efficient Infinite-Horizon Reinforcement and Imitation Learning
di: Moulin, Antoine, et al.
Pubblicazione: (2025) -
Imitation Learning in Discounted Linear MDPs without exploration assumptions
di: Viano, Luca, et al.
Pubblicazione: (2024) -
IL-SOAR : Imitation Learning with Soft Optimistic Actor cRitic
di: Viel, Stefano, et al.
Pubblicazione: (2025) -
Offline RL via Feature-Occupancy Gradient Ascent
di: Neu, Gergely, et al.
Pubblicazione: (2024) -
Learning Equilibria from Data: Provably Efficient Multi-Agent Imitation Learning
di: Freihaut, Till, et al.
Pubblicazione: (2025)