Identifying Latent Actions and Dynamics from Offline Data via Demonstrator Diversity
Fuente:
arXiv
Salvato in:
| Autore principale: | Schur, Felix |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
How to Leverage Diverse Demonstrations in Offline Imitation Learning
di: Yue, Sheng, et al.
Pubblicazione: (2024)
di: Yue, Sheng, et al.
Pubblicazione: (2024)
Prediction-Intervention Games and Invariant Sets
di: Kühne, Linus, et al.
Pubblicazione: (2026)
di: Kühne, Linus, et al.
Pubblicazione: (2026)
Many Experiments, Few Repetitions, Unpaired Data, and Sparse Effects: Is Causal Inference Possible?
di: Schur, Felix, et al.
Pubblicazione: (2026)
di: Schur, Felix, et al.
Pubblicazione: (2026)
Constrained Latent Action Policies for Model-Based Offline Reinforcement Learning
di: Alles, Marvin, et al.
Pubblicazione: (2024)
di: Alles, Marvin, et al.
Pubblicazione: (2024)
HIQL: Offline Goal-Conditioned RL with Latent States as Actions
di: Park, Seohong, et al.
Pubblicazione: (2023)
di: Park, Seohong, et al.
Pubblicazione: (2023)
Leveraging Offline Data in Linear Latent Contextual Bandits
di: Kausik, Chinmaya, et al.
Pubblicazione: (2024)
di: Kausik, Chinmaya, et al.
Pubblicazione: (2024)
CLAM: Continuous Latent Action Models for Robot Learning from Unlabeled Demonstrations
di: Liang, Anthony, et al.
Pubblicazione: (2025)
di: Liang, Anthony, et al.
Pubblicazione: (2025)
SAMG: Offline-to-Online Reinforcement Learning via State-Action-Conditional Offline Model Guidance
di: Zhang, Liyu, et al.
Pubblicazione: (2024)
di: Zhang, Liyu, et al.
Pubblicazione: (2024)
Penalizing Infeasible Actions and Reward Scaling in Reinforcement Learning with Offline Data
di: Kim, Jeonghye, et al.
Pubblicazione: (2025)
di: Kim, Jeonghye, et al.
Pubblicazione: (2025)
UNIQ: Offline Inverse Q-learning for Avoiding Undesirable Demonstrations
di: Hoang, Huy, et al.
Pubblicazione: (2024)
di: Hoang, Huy, et al.
Pubblicazione: (2024)
SPRINQL: Sub-optimal Demonstrations driven Offline Imitation Learning
di: Hoang, Huy, et al.
Pubblicazione: (2024)
di: Hoang, Huy, et al.
Pubblicazione: (2024)
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
di: Yang, Rui, et al.
Pubblicazione: (2023)
di: Yang, Rui, et al.
Pubblicazione: (2023)
DAWM: Diffusion Action World Models for Offline Reinforcement Learning via Action-Inferred Transitions
di: Li, Zongyue, et al.
Pubblicazione: (2025)
di: Li, Zongyue, et al.
Pubblicazione: (2025)
Transferring Causal Effects using Proxies
di: Iglesias-Alonso, Manuel, et al.
Pubblicazione: (2025)
di: Iglesias-Alonso, Manuel, et al.
Pubblicazione: (2025)
Action-Free Offline-to-Online RL via Discretised State Policies
di: Neggatu, Natinael Solomon, et al.
Pubblicazione: (2026)
di: Neggatu, Natinael Solomon, et al.
Pubblicazione: (2026)
Imitation Learning from Suboptimal Demonstrations via Meta-Learning An Action Ranker
di: Fan, Jiangdong, et al.
Pubblicazione: (2024)
di: Fan, Jiangdong, et al.
Pubblicazione: (2024)
Latent Adversarial Regularization for Offline Preference Optimization
di: Jiang, Enyi, et al.
Pubblicazione: (2026)
di: Jiang, Enyi, et al.
Pubblicazione: (2026)
On Sample-Efficient Offline Reinforcement Learning: Data Diversity, Posterior Sampling, and Beyond
di: Nguyen-Tang, Thanh, et al.
Pubblicazione: (2024)
di: Nguyen-Tang, Thanh, et al.
Pubblicazione: (2024)
Robust Policy Expansion for Offline-to-Online RL under Diverse Data Corruption
di: He, Longxiang, et al.
Pubblicazione: (2025)
di: He, Longxiang, et al.
Pubblicazione: (2025)
Learning What to Do and What Not To Do: Offline Imitation from Expert and Undesirable Demonstrations
di: Hoang, Huy, et al.
Pubblicazione: (2025)
di: Hoang, Huy, et al.
Pubblicazione: (2025)
A Unified Linear Programming Framework for Offline Reward Learning from Human Demonstrations and Feedback
di: Kim, Kihyun, et al.
Pubblicazione: (2024)
di: Kim, Kihyun, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning with Penalized Action Noise Injection
di: Oh, JunHyeok, et al.
Pubblicazione: (2025)
di: Oh, JunHyeok, et al.
Pubblicazione: (2025)
Scalable Offline Model-Based RL with Action Chunks
di: Park, Kwanyoung, et al.
Pubblicazione: (2025)
di: Park, Kwanyoung, et al.
Pubblicazione: (2025)
Offline Learning of Controllable Diverse Behaviors
di: Petitbois, Mathieu, et al.
Pubblicazione: (2025)
di: Petitbois, Mathieu, et al.
Pubblicazione: (2025)
Uncertainty-based Offline Variational Bayesian Reinforcement Learning for Robustness under Diverse Data Corruptions
di: Yang, Rui, et al.
Pubblicazione: (2024)
di: Yang, Rui, et al.
Pubblicazione: (2024)
Learning Causally Invariant Reward Functions from Diverse Demonstrations
di: Ovinnikov, Ivan, et al.
Pubblicazione: (2024)
di: Ovinnikov, Ivan, et al.
Pubblicazione: (2024)
Offline-to-online Reinforcement Learning for Image-based Grasping with Scarce Demonstrations
di: Chan, Bryan, et al.
Pubblicazione: (2024)
di: Chan, Bryan, et al.
Pubblicazione: (2024)
Scaling Offline Model-Based RL via Jointly-Optimized World-Action Model Pretraining
di: Cheng, Jie, et al.
Pubblicazione: (2024)
di: Cheng, Jie, et al.
Pubblicazione: (2024)
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
di: Zhang, Tianle, et al.
Pubblicazione: (2024)
di: Zhang, Tianle, et al.
Pubblicazione: (2024)
Offline Diversity Maximization Under Imitation Constraints
di: Vlastelica, Marin, et al.
Pubblicazione: (2023)
di: Vlastelica, Marin, et al.
Pubblicazione: (2023)
Offline Behavioral Data Selection
di: Lei, Shiye, et al.
Pubblicazione: (2025)
di: Lei, Shiye, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning with OOD State Correction and OOD Action Suppression
di: Mao, Yixiu, et al.
Pubblicazione: (2024)
di: Mao, Yixiu, et al.
Pubblicazione: (2024)
Two-Step Offline Preference-Based Reinforcement Learning with Constrained Actions
di: Xu, Yinglun, et al.
Pubblicazione: (2023)
di: Xu, Yinglun, et al.
Pubblicazione: (2023)
Guided Flow Policy: Learning from High-Value Actions in Offline Reinforcement Learning
di: Tiofack, Franki Nguimatsia, et al.
Pubblicazione: (2025)
di: Tiofack, Franki Nguimatsia, et al.
Pubblicazione: (2025)
Tackling Data Corruption in Offline Reinforcement Learning via Sequence Modeling
di: Xu, Jiawei, et al.
Pubblicazione: (2024)
di: Xu, Jiawei, et al.
Pubblicazione: (2024)
Disentangling Policy from Offline Task Representation Learning via Adversarial Data Augmentation
di: Jia, Chengxing, et al.
Pubblicazione: (2024)
di: Jia, Chengxing, et al.
Pubblicazione: (2024)
Diversity By Design: Leveraging Distribution Matching for Offline Model-Based Optimization
di: Yao, Michael S., et al.
Pubblicazione: (2025)
di: Yao, Michael S., et al.
Pubblicazione: (2025)
Counterfactual Identifiability via Dynamic Optimal Transport
di: Ribeiro, Fabio De Sousa, et al.
Pubblicazione: (2025)
di: Ribeiro, Fabio De Sousa, et al.
Pubblicazione: (2025)
Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning
di: Reizinger, Patrik, et al.
Pubblicazione: (2025)
di: Reizinger, Patrik, et al.
Pubblicazione: (2025)
Automatic Reward Shaping from Confounded Offline Data
di: Li, Mingxuan, et al.
Pubblicazione: (2025)
di: Li, Mingxuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
How to Leverage Diverse Demonstrations in Offline Imitation Learning
di: Yue, Sheng, et al.
Pubblicazione: (2024) -
Prediction-Intervention Games and Invariant Sets
di: Kühne, Linus, et al.
Pubblicazione: (2026) -
Many Experiments, Few Repetitions, Unpaired Data, and Sparse Effects: Is Causal Inference Possible?
di: Schur, Felix, et al.
Pubblicazione: (2026) -
Constrained Latent Action Policies for Model-Based Offline Reinforcement Learning
di: Alles, Marvin, et al.
Pubblicazione: (2024) -
HIQL: Offline Goal-Conditioned RL with Latent States as Actions
di: Park, Seohong, et al.
Pubblicazione: (2023)