Is Value Functions Estimation with Classification Plug-and-play for Offline Reinforcement Learning?
Fuente:
arXiv
Salvato in:
| Autori principali: | Tarasov, Denis, Brilliantov, Kirill, Kharlapenko, Dmitrii |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Role of Deep Learning Regularizations on Actors in Offline RL
di: Tarasov, Denis, et al.
Pubblicazione: (2024)
di: Tarasov, Denis, et al.
Pubblicazione: (2024)
VIPO: Value Function Inconsistency Penalized Offline Reinforcement Learning
di: Chen, Xuyang, et al.
Pubblicazione: (2025)
di: Chen, Xuyang, et al.
Pubblicazione: (2025)
$k$-server-bench: Automating Potential Discovery for the $k$-Server Conjecture
di: Brilliantov, Kirill, et al.
Pubblicazione: (2026)
di: Brilliantov, Kirill, et al.
Pubblicazione: (2026)
Scaling sparse feature circuit finding for in-context learning
di: Kharlapenko, Dmitrii, et al.
Pubblicazione: (2025)
di: Kharlapenko, Dmitrii, et al.
Pubblicazione: (2025)
Diverse Randomized Value Functions: A Provably Pessimistic Approach for Offline Reinforcement Learning
di: Yu, Xudong, et al.
Pubblicazione: (2024)
di: Yu, Xudong, et al.
Pubblicazione: (2024)
Offline Safe Reinforcement Learning Using Trajectory Classification
di: Gong, Ze, et al.
Pubblicazione: (2024)
di: Gong, Ze, et al.
Pubblicazione: (2024)
Stable Offline Value Function Learning with Bisimulation-based Representations
di: Pavse, Brahma S., et al.
Pubblicazione: (2024)
di: Pavse, Brahma S., et al.
Pubblicazione: (2024)
Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning
di: Ma, Yunchang, et al.
Pubblicazione: (2025)
di: Ma, Yunchang, et al.
Pubblicazione: (2025)
Listwise Reward Estimation for Offline Preference-based Reinforcement Learning
di: Choi, Heewoong, et al.
Pubblicazione: (2024)
di: Choi, Heewoong, et al.
Pubblicazione: (2024)
Guided Flow Policy: Learning from High-Value Actions in Offline Reinforcement Learning
di: Tiofack, Franki Nguimatsia, et al.
Pubblicazione: (2025)
di: Tiofack, Franki Nguimatsia, et al.
Pubblicazione: (2025)
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
di: Bai, Chenjia, et al.
Pubblicazione: (2024)
di: Bai, Chenjia, et al.
Pubblicazione: (2024)
Option-aware Temporally Abstracted Value for Offline Goal-Conditioned Reinforcement Learning
di: Ahn, Hongjoon, et al.
Pubblicazione: (2025)
di: Ahn, Hongjoon, et al.
Pubblicazione: (2025)
Offline Trajectory Optimization for Offline Reinforcement Learning
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
Expressive Value Learning for Scalable Offline Reinforcement Learning
di: Espinosa-Dice, Nicolas, et al.
Pubblicazione: (2025)
di: Espinosa-Dice, Nicolas, et al.
Pubblicazione: (2025)
Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems
di: Nuzhin, Egor E., et al.
Pubblicazione: (2024)
di: Nuzhin, Egor E., et al.
Pubblicazione: (2024)
Align Your Intents: Offline Imitation Learning via Optimal Transport
di: Bobrin, Maksim, et al.
Pubblicazione: (2024)
di: Bobrin, Maksim, et al.
Pubblicazione: (2024)
Yes, Q-learning Helps Offline In-Context RL
di: Tarasov, Denis, et al.
Pubblicazione: (2025)
di: Tarasov, Denis, et al.
Pubblicazione: (2025)
AD4RL: Autonomous Driving Benchmarks for Offline Reinforcement Learning with Value-based Dataset
di: Lee, Dongsu, et al.
Pubblicazione: (2024)
di: Lee, Dongsu, et al.
Pubblicazione: (2024)
The Role of Inherent Bellman Error in Offline Reinforcement Learning with Linear Function Approximation
di: Golowich, Noah, et al.
Pubblicazione: (2024)
di: Golowich, Noah, et al.
Pubblicazione: (2024)
Preference Elicitation for Offline Reinforcement Learning
di: Pace, Alizée, et al.
Pubblicazione: (2024)
di: Pace, Alizée, et al.
Pubblicazione: (2024)
Simple Ingredients for Offline Reinforcement Learning
di: Cetin, Edoardo, et al.
Pubblicazione: (2024)
di: Cetin, Edoardo, et al.
Pubblicazione: (2024)
State-Constrained Offline Reinforcement Learning
di: Hepburn, Charles A., et al.
Pubblicazione: (2024)
di: Hepburn, Charles A., et al.
Pubblicazione: (2024)
Dataset Distillation for Offline Reinforcement Learning
di: Light, Jonathan, et al.
Pubblicazione: (2024)
di: Light, Jonathan, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning with Imputed Rewards
di: Romeo, Carlo, et al.
Pubblicazione: (2024)
di: Romeo, Carlo, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning with Imbalanced Datasets
di: Jiang, Li, et al.
Pubblicazione: (2023)
di: Jiang, Li, et al.
Pubblicazione: (2023)
The Generalization Gap in Offline Reinforcement Learning
di: Mediratta, Ishita, et al.
Pubblicazione: (2023)
di: Mediratta, Ishita, et al.
Pubblicazione: (2023)
Expert Q-learning: Deep Reinforcement Learning with Coarse State Values from Offline Expert Examples
di: Meng, Li, et al.
Pubblicazione: (2021)
di: Meng, Li, et al.
Pubblicazione: (2021)
Is Value Learning Really the Main Bottleneck in Offline RL?
di: Park, Seohong, et al.
Pubblicazione: (2024)
di: Park, Seohong, et al.
Pubblicazione: (2024)
OffSim: Offline Simulator for Model-based Offline Inverse Reinforcement Learning
di: Ahn, Woo-Jin, et al.
Pubblicazione: (2025)
di: Ahn, Woo-Jin, et al.
Pubblicazione: (2025)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
Imagination-Limited Q-Learning for Offline Reinforcement Learning
di: Liu, Wenhui, et al.
Pubblicazione: (2025)
di: Liu, Wenhui, et al.
Pubblicazione: (2025)
Mildly Conservative Q-Learning for Offline Reinforcement Learning
di: Lyu, Jiafei, et al.
Pubblicazione: (2022)
di: Lyu, Jiafei, et al.
Pubblicazione: (2022)
Percentile Criterion Optimization in Offline Reinforcement Learning
di: Lobo, Elita A., et al.
Pubblicazione: (2024)
di: Lobo, Elita A., et al.
Pubblicazione: (2024)
Doubly Mild Generalization for Offline Reinforcement Learning
di: Mao, Yixiu, et al.
Pubblicazione: (2024)
di: Mao, Yixiu, et al.
Pubblicazione: (2024)
KAN v.s. MLP for Offline Reinforcement Learning
di: Guo, Haihong, et al.
Pubblicazione: (2024)
di: Guo, Haihong, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning with Behavioral Supervisor Tuning
di: Srinivasan, Padmanaba, et al.
Pubblicazione: (2024)
di: Srinivasan, Padmanaba, et al.
Pubblicazione: (2024)
Mutual Information Regularized Offline Reinforcement Learning
di: Ma, Xiao, et al.
Pubblicazione: (2022)
di: Ma, Xiao, et al.
Pubblicazione: (2022)
Abstraction for Offline Goal-Conditioned Reinforcement Learning
di: Wibault, Clarisse, et al.
Pubblicazione: (2026)
di: Wibault, Clarisse, et al.
Pubblicazione: (2026)
Offline Reinforcement Learning with Generative Trajectory Policies
di: Feng, Xinsong, et al.
Pubblicazione: (2025)
di: Feng, Xinsong, et al.
Pubblicazione: (2025)
Behavior Preference Regression for Offline Reinforcement Learning
di: Srinivasan, Padmanaba, et al.
Pubblicazione: (2025)
di: Srinivasan, Padmanaba, et al.
Pubblicazione: (2025)
Documenti analoghi
-
The Role of Deep Learning Regularizations on Actors in Offline RL
di: Tarasov, Denis, et al.
Pubblicazione: (2024) -
VIPO: Value Function Inconsistency Penalized Offline Reinforcement Learning
di: Chen, Xuyang, et al.
Pubblicazione: (2025) -
$k$-server-bench: Automating Potential Discovery for the $k$-Server Conjecture
di: Brilliantov, Kirill, et al.
Pubblicazione: (2026) -
Scaling sparse feature circuit finding for in-context learning
di: Kharlapenko, Dmitrii, et al.
Pubblicazione: (2025) -
Diverse Randomized Value Functions: A Provably Pessimistic Approach for Offline Reinforcement Learning
di: Yu, Xudong, et al.
Pubblicazione: (2024)