DeepAveragers: Offline Reinforcement Learning by Solving Derived Non-Parametric MDPs
Fuente:
arXiv
Salvato in:
| Autori principali: | Shrestha, Aayam, Lee, Stefan, Tadepalli, Prasad, Fern, Alan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2020
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Hierarchical Object-Oriented POMDP Planning for Object Rearrangement
di: Mangannavar, Rajesh, et al.
Pubblicazione: (2024)
di: Mangannavar, Rajesh, et al.
Pubblicazione: (2024)
Online Optimization for Offline Safe Reinforcement Learning
di: Chemingui, Yassine, et al.
Pubblicazione: (2025)
di: Chemingui, Yassine, et al.
Pubblicazione: (2025)
Constraint-Adaptive Policy Switching for Offline Safe Reinforcement Learning
di: Chemingui, Yassine, et al.
Pubblicazione: (2024)
di: Chemingui, Yassine, et al.
Pubblicazione: (2024)
Combining Planning and Reinforcement Learning for Solving Relational Multiagent Domains
di: Prabhakar, Nikhilesh, et al.
Pubblicazione: (2025)
di: Prabhakar, Nikhilesh, et al.
Pubblicazione: (2025)
Provable Offline Reinforcement Learning for Structured Cyclic MDPs
di: Lee, Kyungbok, et al.
Pubblicazione: (2026)
di: Lee, Kyungbok, et al.
Pubblicazione: (2026)
Solving Continual Offline Reinforcement Learning with Decision Transformer
di: Huang, Kaixin, et al.
Pubblicazione: (2024)
di: Huang, Kaixin, et al.
Pubblicazione: (2024)
Grounding Vision and Language to 3D Masks for Long-Horizon Box Rearrangement
di: Malik, Ashish, et al.
Pubblicazione: (2026)
di: Malik, Ashish, et al.
Pubblicazione: (2026)
Graph Neural Network Based Action Ranking for Planning
di: Mangannavar, Rajesh, et al.
Pubblicazione: (2024)
di: Mangannavar, Rajesh, et al.
Pubblicazione: (2024)
No-Regret Reinforcement Learning in Smooth MDPs
di: Maran, Davide, et al.
Pubblicazione: (2024)
di: Maran, Davide, et al.
Pubblicazione: (2024)
Learning Multi-Modal Whole-Body Control for Real-World Humanoid Robots
di: Dugar, Pranay, et al.
Pubblicazione: (2024)
di: Dugar, Pranay, et al.
Pubblicazione: (2024)
ACPO: A Policy Optimization Algorithm for Average MDPs with Constraints
di: Agnihotri, Akhil, et al.
Pubblicazione: (2023)
di: Agnihotri, Akhil, et al.
Pubblicazione: (2023)
Offline Reinforcement Learning with Universal Horizon Models
di: Chung, Hojun, et al.
Pubblicazione: (2026)
di: Chung, Hojun, et al.
Pubblicazione: (2026)
Generating Physically Realistic and Directable Human Motions from Multi-Modal Inputs
di: Shrestha, Aayam, et al.
Pubblicazione: (2025)
di: Shrestha, Aayam, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning from Datasets with Structured Non-Stationarity
di: Ackermann, Johannes, et al.
Pubblicazione: (2024)
di: Ackermann, Johannes, et al.
Pubblicazione: (2024)
Light-Weight Benchmarks Reveal the Hidden Hardware Cost of Zero-Shot Tabular Foundation Models
di: Gangwani, Ishaan, et al.
Pubblicazione: (2025)
di: Gangwani, Ishaan, et al.
Pubblicazione: (2025)
Offline Trajectory Optimization for Offline Reinforcement Learning
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
Forecasting in Offline Reinforcement Learning for Non-stationary Environments
di: Ada, Suzan Ece, et al.
Pubblicazione: (2025)
di: Ada, Suzan Ece, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning with Penalized Action Noise Injection
di: Oh, JunHyeok, et al.
Pubblicazione: (2025)
di: Oh, JunHyeok, et al.
Pubblicazione: (2025)
Adaptive Replay Buffer for Offline-to-Online Reinforcement Learning
di: Song, Chihyeon, et al.
Pubblicazione: (2025)
di: Song, Chihyeon, et al.
Pubblicazione: (2025)
Model-based Offline Reinforcement Learning with Lower Expectile Q-Learning
di: Park, Kwanyoung, et al.
Pubblicazione: (2024)
di: Park, Kwanyoung, et al.
Pubblicazione: (2024)
FairDICE: Fairness-Driven Offline Multi-Objective Reinforcement Learning
di: Kim, Woosung, et al.
Pubblicazione: (2025)
di: Kim, Woosung, et al.
Pubblicazione: (2025)
OffSim: Offline Simulator for Model-based Offline Inverse Reinforcement Learning
di: Ahn, Woo-Jin, et al.
Pubblicazione: (2025)
di: Ahn, Woo-Jin, et al.
Pubblicazione: (2025)
Solving Multi-Model MDPs by Coordinate Ascent and Dynamic Programming
di: Su, Xihong, et al.
Pubblicazione: (2024)
di: Su, Xihong, et al.
Pubblicazione: (2024)
Self-attention-based Diffusion Model for Time-series Imputation in Partial Blackout Scenarios
di: Islam, Mohammad Rafid Ul, et al.
Pubblicazione: (2025)
di: Islam, Mohammad Rafid Ul, et al.
Pubblicazione: (2025)
No More Marching: Learning Humanoid Locomotion for Short-Range SE(2) Targets
di: Dugar, Pranay, et al.
Pubblicazione: (2025)
di: Dugar, Pranay, et al.
Pubblicazione: (2025)
A Computationally Efficient Algorithm for Infinite-Horizon Average-Reward Linear MDPs
di: Hong, Kihyuk, et al.
Pubblicazione: (2025)
di: Hong, Kihyuk, et al.
Pubblicazione: (2025)
Exclusively Penalized Q-learning for Offline Reinforcement Learning
di: Yeom, Junghyuk, et al.
Pubblicazione: (2024)
di: Yeom, Junghyuk, et al.
Pubblicazione: (2024)
A Recipe for Stable Offline Multi-agent Reinforcement Learning
di: Lee, Dongsu, et al.
Pubblicazione: (2026)
di: Lee, Dongsu, et al.
Pubblicazione: (2026)
Impoola: The Power of Average Pooling for Image-Based Deep Reinforcement Learning
di: Trumpp, Raphael, et al.
Pubblicazione: (2025)
di: Trumpp, Raphael, et al.
Pubblicazione: (2025)
GTA: Generative Trajectory Augmentation with Guidance for Offline Reinforcement Learning
di: Lee, Jaewoo, et al.
Pubblicazione: (2024)
di: Lee, Jaewoo, et al.
Pubblicazione: (2024)
Global Convergence for Average Reward Constrained MDPs with Primal-Dual Actor Critic Algorithm
di: Xu, Yang, et al.
Pubblicazione: (2025)
di: Xu, Yang, et al.
Pubblicazione: (2025)
Reward Generation via Large Vision-Language Model in Offline Reinforcement Learning
di: Lee, Younghwan, et al.
Pubblicazione: (2025)
di: Lee, Younghwan, et al.
Pubblicazione: (2025)
Projection by Convolution: Optimal Sample Complexity for Reinforcement Learning in Continuous-Space MDPs
di: Maran, Davide, et al.
Pubblicazione: (2024)
di: Maran, Davide, et al.
Pubblicazione: (2024)
Sample and Oracle Efficient Reinforcement Learning for MDPs with Linearly-Realizable Value Functions
di: Mhammedi, Zakaria
Pubblicazione: (2024)
di: Mhammedi, Zakaria
Pubblicazione: (2024)
Preference Elicitation for Offline Reinforcement Learning
di: Pace, Alizée, et al.
Pubblicazione: (2024)
di: Pace, Alizée, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning with Imbalanced Datasets
di: Jiang, Li, et al.
Pubblicazione: (2023)
di: Jiang, Li, et al.
Pubblicazione: (2023)
Simple Ingredients for Offline Reinforcement Learning
di: Cetin, Edoardo, et al.
Pubblicazione: (2024)
di: Cetin, Edoardo, et al.
Pubblicazione: (2024)
State-Constrained Offline Reinforcement Learning
di: Hepburn, Charles A., et al.
Pubblicazione: (2024)
di: Hepburn, Charles A., et al.
Pubblicazione: (2024)
The Generalization Gap in Offline Reinforcement Learning
di: Mediratta, Ishita, et al.
Pubblicazione: (2023)
di: Mediratta, Ishita, et al.
Pubblicazione: (2023)
Dataset Distillation for Offline Reinforcement Learning
di: Light, Jonathan, et al.
Pubblicazione: (2024)
di: Light, Jonathan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Hierarchical Object-Oriented POMDP Planning for Object Rearrangement
di: Mangannavar, Rajesh, et al.
Pubblicazione: (2024) -
Online Optimization for Offline Safe Reinforcement Learning
di: Chemingui, Yassine, et al.
Pubblicazione: (2025) -
Constraint-Adaptive Policy Switching for Offline Safe Reinforcement Learning
di: Chemingui, Yassine, et al.
Pubblicazione: (2024) -
Combining Planning and Reinforcement Learning for Solving Relational Multiagent Domains
di: Prabhakar, Nikhilesh, et al.
Pubblicazione: (2025) -
Provable Offline Reinforcement Learning for Structured Cyclic MDPs
di: Lee, Kyungbok, et al.
Pubblicazione: (2026)