Discovering Multiple Solutions from a Single Task in Offline Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Osa, Takayuki, Harada, Tatsuya |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Robustifying a Policy in Multi-Agent RL with Diverse Cooperative Behaviors and Adversarial Style Sampling for Assistive Tasks
di: Osa, Takayuki, et al.
Pubblicazione: (2024)
di: Osa, Takayuki, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning with Wasserstein Regularization via Optimal Transport Maps
di: Omura, Motoki, et al.
Pubblicazione: (2025)
di: Omura, Motoki, et al.
Pubblicazione: (2025)
Symmetric Q-learning: Reducing Skewness of Bellman Error in Online Reinforcement Learning
di: Omura, Motoki, et al.
Pubblicazione: (2024)
di: Omura, Motoki, et al.
Pubblicazione: (2024)
Revisiting Regularized Policy Optimization for Stable and Efficient Reinforcement Learning in Two-Player Games
di: Ota, Kazuki, et al.
Pubblicazione: (2026)
di: Ota, Kazuki, et al.
Pubblicazione: (2026)
Rethinking Policy Diversity in Ensemble Policy Gradient in Large-Scale Reinforcement Learning
di: Shitanda, Naoki, et al.
Pubblicazione: (2026)
di: Shitanda, Naoki, et al.
Pubblicazione: (2026)
Offline Reinforcement Learning from Datasets with Structured Non-Stationarity
di: Ackermann, Johannes, et al.
Pubblicazione: (2024)
di: Ackermann, Johannes, et al.
Pubblicazione: (2024)
Gradual Transition from Bellman Optimality Operator to Bellman Operator in Online Reinforcement Learning
di: Omura, Motoki, et al.
Pubblicazione: (2025)
di: Omura, Motoki, et al.
Pubblicazione: (2025)
Stabilizing Extreme Q-learning by Maclaurin Expansion
di: Omura, Motoki, et al.
Pubblicazione: (2024)
di: Omura, Motoki, et al.
Pubblicazione: (2024)
Cross-Embodiment Offline Reinforcement Learning for Heterogeneous Robot Datasets
di: Abe, Haruki, et al.
Pubblicazione: (2026)
di: Abe, Haruki, et al.
Pubblicazione: (2026)
Distorted Distributional Policy Evaluation for Offline Reinforcement Learning
di: Iwaki, Ryo, et al.
Pubblicazione: (2026)
di: Iwaki, Ryo, et al.
Pubblicazione: (2026)
A Continual Offline Reinforcement Learning Benchmark for Navigation Tasks
di: Kobanda, Anthony, et al.
Pubblicazione: (2025)
di: Kobanda, Anthony, et al.
Pubblicazione: (2025)
Entropy Regularized Task Representation Learning for Offline Meta-Reinforcement Learning
di: Nakhaei, Mohammadreza, et al.
Pubblicazione: (2024)
di: Nakhaei, Mohammadreza, et al.
Pubblicazione: (2024)
Skills Regularized Task Decomposition for Multi-task Offline Reinforcement Learning
di: Yoo, Minjong, et al.
Pubblicazione: (2024)
di: Yoo, Minjong, et al.
Pubblicazione: (2024)
Optimization Solution Functions as Deterministic Policies for Offline Reinforcement Learning
di: Khattar, Vanshaj, et al.
Pubblicazione: (2024)
di: Khattar, Vanshaj, et al.
Pubblicazione: (2024)
Task-Aware Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
di: Fan, Ziqing, et al.
Pubblicazione: (2024)
di: Fan, Ziqing, et al.
Pubblicazione: (2024)
Urban-Focused Multi-Task Offline Reinforcement Learning with Contrastive Data Sharing
di: Zhao, Xinbo, et al.
Pubblicazione: (2024)
di: Zhao, Xinbo, et al.
Pubblicazione: (2024)
HarmoDT: Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
di: Hu, Shengchao, et al.
Pubblicazione: (2024)
di: Hu, Shengchao, et al.
Pubblicazione: (2024)
Model-Based Reinforcement Learning with Multi-Task Offline Pretraining
di: Pan, Minting, et al.
Pubblicazione: (2023)
di: Pan, Minting, et al.
Pubblicazione: (2023)
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
di: Wang, Changhong, et al.
Pubblicazione: (2024)
di: Wang, Changhong, et al.
Pubblicazione: (2024)
Using Curiosity for an Even Representation of Tasks in Continual Offline Reinforcement Learning
di: Pathmanathan, Pankayaraj, et al.
Pubblicazione: (2023)
di: Pathmanathan, Pankayaraj, et al.
Pubblicazione: (2023)
Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning
di: He, Jinmin, et al.
Pubblicazione: (2025)
di: He, Jinmin, et al.
Pubblicazione: (2025)
Offline Trajectory Optimization for Offline Reinforcement Learning
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
Federated Offline Reinforcement Learning: Collaborative Single-Policy Coverage Suffices
di: Woo, Jiin, et al.
Pubblicazione: (2024)
di: Woo, Jiin, et al.
Pubblicazione: (2024)
Discovering Minimal Reinforcement Learning Environments
di: Liesen, Jarek, et al.
Pubblicazione: (2024)
di: Liesen, Jarek, et al.
Pubblicazione: (2024)
Equivariant Offline Reinforcement Learning
di: Tangri, Arsh, et al.
Pubblicazione: (2024)
di: Tangri, Arsh, et al.
Pubblicazione: (2024)
Federated Offline Reinforcement Learning
di: Zhou, Doudou, et al.
Pubblicazione: (2022)
di: Zhou, Doudou, et al.
Pubblicazione: (2022)
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
di: Bai, Chenjia, et al.
Pubblicazione: (2024)
di: Bai, Chenjia, et al.
Pubblicazione: (2024)
Soft Conflict-Resolution Decision Transformer for Offline Multi-Task Reinforcement Learning
di: Wang, Shudong, et al.
Pubblicazione: (2025)
di: Wang, Shudong, et al.
Pubblicazione: (2025)
Offline Meta-Reinforcement Learning with Flow-Based Task Inference and Adaptive Correction of Feature Overgeneralization
di: Wang, Min, et al.
Pubblicazione: (2026)
di: Wang, Min, et al.
Pubblicazione: (2026)
Epistemic Robust Offline Reinforcement Learning
di: Chenreddy, Abhilash Reddy, et al.
Pubblicazione: (2026)
di: Chenreddy, Abhilash Reddy, et al.
Pubblicazione: (2026)
Offline Multitask Representation Learning for Reinforcement Learning
di: Ishfaq, Haque, et al.
Pubblicazione: (2024)
di: Ishfaq, Haque, et al.
Pubblicazione: (2024)
Hybrid Reinforcement Learning from Offline Observation Alone
di: Song, Yuda, et al.
Pubblicazione: (2024)
di: Song, Yuda, et al.
Pubblicazione: (2024)
DistML.js: Installation-free Distributed Deep Learning Framework for Web Browsers
di: Hidaka, Masatoshi, et al.
Pubblicazione: (2024)
di: Hidaka, Masatoshi, et al.
Pubblicazione: (2024)
GEMSS: A Variational Bayesian Method for Discovering Multiple Sparse Solutions in Classification and Regression Problems
di: Henclová, Kateřina, et al.
Pubblicazione: (2026)
di: Henclová, Kateřina, et al.
Pubblicazione: (2026)
Temporal Abstraction in Reinforcement Learning with Offline Data
di: Ayyagari, Ranga Shaarad, et al.
Pubblicazione: (2024)
di: Ayyagari, Ranga Shaarad, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning with Domain-Unlabeled Data
di: Nishimori, Soichiro, et al.
Pubblicazione: (2024)
di: Nishimori, Soichiro, et al.
Pubblicazione: (2024)
Rethinking Optimal Transport in Offline Reinforcement Learning
di: Asadulaev, Arip, et al.
Pubblicazione: (2024)
di: Asadulaev, Arip, et al.
Pubblicazione: (2024)
Sparse Offline Reinforcement Learning with Corruption Robustness
di: Tran, Nam Phuong, et al.
Pubblicazione: (2025)
di: Tran, Nam Phuong, et al.
Pubblicazione: (2025)
Information-Directed Offline-to-Online Reinforcement Learning
di: Chen, Keru
Pubblicazione: (2026)
di: Chen, Keru
Pubblicazione: (2026)
Making Offline RL Online: Collaborative World Models for Offline Visual Reinforcement Learning
di: Wang, Qi, et al.
Pubblicazione: (2023)
di: Wang, Qi, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Robustifying a Policy in Multi-Agent RL with Diverse Cooperative Behaviors and Adversarial Style Sampling for Assistive Tasks
di: Osa, Takayuki, et al.
Pubblicazione: (2024) -
Offline Reinforcement Learning with Wasserstein Regularization via Optimal Transport Maps
di: Omura, Motoki, et al.
Pubblicazione: (2025) -
Symmetric Q-learning: Reducing Skewness of Bellman Error in Online Reinforcement Learning
di: Omura, Motoki, et al.
Pubblicazione: (2024) -
Revisiting Regularized Policy Optimization for Stable and Efficient Reinforcement Learning in Two-Player Games
di: Ota, Kazuki, et al.
Pubblicazione: (2026) -
Rethinking Policy Diversity in Ensemble Policy Gradient in Large-Scale Reinforcement Learning
di: Shitanda, Naoki, et al.
Pubblicazione: (2026)