Expressive Value Learning for Scalable Offline Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Espinosa-Dice, Nicolas, Brantley, Kiante, Sun, Wen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Scaling Offline RL via Efficient and Expressive Shortcut Models
par: Espinosa-Dice, Nicolas, et autres
Publié: (2025)
par: Espinosa-Dice, Nicolas, et autres
Publié: (2025)
CORE: Towards Scalable and Efficient Causal Discovery with Reinforcement Learning
par: Sauter, Andreas W. M., et autres
Publié: (2024)
par: Sauter, Andreas W. M., et autres
Publié: (2024)
Bounded Ratio Reinforcement Learning
par: Ao, Yunke, et autres
Publié: (2026)
par: Ao, Yunke, et autres
Publié: (2026)
Why Online Reinforcement Learning is Causal
par: Schulte, Oliver, et autres
Publié: (2024)
par: Schulte, Oliver, et autres
Publié: (2024)
Understanding Goal Generalisation in Sequential Reinforcement Learning
par: Brown, Jason Ross, et autres
Publié: (2026)
par: Brown, Jason Ross, et autres
Publié: (2026)
Path-Coupled Bellman Flows for Distributional Reinforcement Learning
par: Xu, Boyang, et autres
Publié: (2026)
par: Xu, Boyang, et autres
Publié: (2026)
An Idiosyncrasy of Time-discretization in Reinforcement Learning
par: De Asis, Kris, et autres
Publié: (2024)
par: De Asis, Kris, et autres
Publié: (2024)
OER: Offline Experience Replay for Continual Offline Reinforcement Learning
par: Gai, Sibo, et autres
Publié: (2023)
par: Gai, Sibo, et autres
Publié: (2023)
Multi-Task Reinforcement Learning with Language-Encoded Gated Policy Networks
par: Arora, Rushiv
Publié: (2025)
par: Arora, Rushiv
Publié: (2025)
Reinforcement Learning for Scalable and Trustworthy Intelligent Systems
par: Lan, Guangchen
Publié: (2026)
par: Lan, Guangchen
Publié: (2026)
Safe Reinforcement Learning with Preference-based Constraint Inference
par: Li, Chenglin, et autres
Publié: (2026)
par: Li, Chenglin, et autres
Publié: (2026)
Data-Incremental Continual Offline Reinforcement Learning
par: Gai, Sibo, et autres
Publié: (2024)
par: Gai, Sibo, et autres
Publié: (2024)
Deep Memory Search: A Metaheuristic Approach for Optimizing Heuristic Search
par: Hedar, Abdel-Rahman, et autres
Publié: (2024)
par: Hedar, Abdel-Rahman, et autres
Publié: (2024)
When Actions Disappear: Adversarial Action Removal in Self-Play Reinforcement Learning
par: Kujur, Arahan
Publié: (2026)
par: Kujur, Arahan
Publié: (2026)
Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems
par: Nuzhin, Egor E., et autres
Publié: (2024)
par: Nuzhin, Egor E., et autres
Publié: (2024)
GIRL: Generative Imagination Reinforcement Learning via Information-Theoretic Hallucination Control
par: Hiremath, Prakul Sunil
Publié: (2026)
par: Hiremath, Prakul Sunil
Publié: (2026)
FastForward Pruning: Efficient LLM Pruning via Single-Step Reinforcement Learning
par: Yuan, Xin, et autres
Publié: (2025)
par: Yuan, Xin, et autres
Publié: (2025)
Fusing Rewards and Preferences in Reinforcement Learning
par: Khorasani, Sadegh, et autres
Publié: (2025)
par: Khorasani, Sadegh, et autres
Publié: (2025)
Hierarchical Universal Value Function Approximators
par: Arora, Rushiv
Publié: (2024)
par: Arora, Rushiv
Publié: (2024)
Machine Learning vs Deep Learning: The Generalization Problem
par: Bay, Yong Yi, et autres
Publié: (2024)
par: Bay, Yong Yi, et autres
Publié: (2024)
SALE-Based Offline Reinforcement Learning with Ensemble Q-Networks
par: Chun, Zheng
Publié: (2025)
par: Chun, Zheng
Publié: (2025)
Deep Reinforcement Learning for Adverse Garage Scenario Generation
par: Li, Kai
Publié: (2024)
par: Li, Kai
Publié: (2024)
Behavior Learning (BL): Learning Hierarchical Optimization Structures from Data
par: Ma, Zhenyao, et autres
Publié: (2026)
par: Ma, Zhenyao, et autres
Publié: (2026)
MTDrive: Multi-turn Interactive Reinforcement Learning for Autonomous Driving
par: Li, Xidong, et autres
Publié: (2026)
par: Li, Xidong, et autres
Publié: (2026)
Social Interpretable Reinforcement Learning
par: Custode, Leonardo Lucio, et autres
Publié: (2024)
par: Custode, Leonardo Lucio, et autres
Publié: (2024)
Scaling Value Iteration Networks to 5000 Layers for Extreme Long-Term Planning
par: Wang, Yuhui, et autres
Publié: (2024)
par: Wang, Yuhui, et autres
Publié: (2024)
DataRater: Meta-Learned Dataset Curation
par: Calian, Dan A., et autres
Publié: (2025)
par: Calian, Dan A., et autres
Publié: (2025)
Learning to Construct Knowledge through Sparse Reference Selection with Reinforcement Learning
par: Yin, Shao-An
Publié: (2025)
par: Yin, Shao-An
Publié: (2025)
Evidential Deep Active Learning for Semi-Supervised Classification
par: Zhao, Shenkai, et autres
Publié: (2025)
par: Zhao, Shenkai, et autres
Publié: (2025)
A Simple Generalisation of the Implicit Dynamics of In-Context Learning
par: Innocenti, Francesco, et autres
Publié: (2025)
par: Innocenti, Francesco, et autres
Publié: (2025)
Extrinsicaly Rewarded Soft Q Imitation Learning with Discriminator
par: Furuyama, Ryoma, et autres
Publié: (2024)
par: Furuyama, Ryoma, et autres
Publié: (2024)
Integrating Causality with Neurochaos Learning: Proposed Approach and Research Agenda
par: Narendra, Nanjangud C., et autres
Publié: (2025)
par: Narendra, Nanjangud C., et autres
Publié: (2025)
SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks
par: Vincze, Mátyás, et autres
Publié: (2024)
par: Vincze, Mátyás, et autres
Publié: (2024)
Upside Down Reinforcement Learning with Policy Generators
par: Di Ventura, Jacopo, et autres
Publié: (2025)
par: Di Ventura, Jacopo, et autres
Publié: (2025)
Hybrid-AIRL: Enhancing Inverse Reinforcement Learning with Supervised Expert Guidance
par: Silue, Bram, et autres
Publié: (2025)
par: Silue, Bram, et autres
Publié: (2025)
Compositional Concept-Based Neuron-Level Interpretability for Deep Reinforcement Learning
par: Jiang, Zeyu, et autres
Publié: (2025)
par: Jiang, Zeyu, et autres
Publié: (2025)
TACO: Tackling Over-correction in Federated Learning with Tailored Adaptive Correction
par: Liu, Weijie, et autres
Publié: (2025)
par: Liu, Weijie, et autres
Publié: (2025)
Load and Renewable Energy Forecasting Using Deep Learning for Grid Stability
par: Sarkar, Kamal
Publié: (2025)
par: Sarkar, Kamal
Publié: (2025)
Learning Agents With Prioritization and Parameter Noise in Continuous State and Action Space
par: Mangannavar, Rajesh, et autres
Publié: (2024)
par: Mangannavar, Rajesh, et autres
Publié: (2024)
DELTA: Variational Disentangled Learning for Privacy-Preserving Data Reprogramming
par: Malarkkan, Arun Vignesh, et autres
Publié: (2025)
par: Malarkkan, Arun Vignesh, et autres
Publié: (2025)
Documents similaires
-
Scaling Offline RL via Efficient and Expressive Shortcut Models
par: Espinosa-Dice, Nicolas, et autres
Publié: (2025) -
CORE: Towards Scalable and Efficient Causal Discovery with Reinforcement Learning
par: Sauter, Andreas W. M., et autres
Publié: (2024) -
Bounded Ratio Reinforcement Learning
par: Ao, Yunke, et autres
Publié: (2026) -
Why Online Reinforcement Learning is Causal
par: Schulte, Oliver, et autres
Publié: (2024) -
Understanding Goal Generalisation in Sequential Reinforcement Learning
par: Brown, Jason Ross, et autres
Publié: (2026)