Unleashing the Power of Pre-trained Language Models for Offline Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Shi, Ruizhe, Liu, Yuyao, Ze, Yanjie, Du, Simon S., Xu, Huazhe |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2023
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Rethinking Transformers in Solving POMDPs
von: Lu, Chenhao, et al.
Veröffentlicht: (2024)
von: Lu, Chenhao, et al.
Veröffentlicht: (2024)
Diffusion Reward: Learning Rewards via Conditional Video Diffusion
von: Huang, Tao, et al.
Veröffentlicht: (2023)
von: Huang, Tao, et al.
Veröffentlicht: (2023)
Pre-training with Synthetic Data Helps Offline Reinforcement Learning
von: Wang, Zecheng, et al.
Veröffentlicht: (2023)
von: Wang, Zecheng, et al.
Veröffentlicht: (2023)
Learning Visual Quadrupedal Loco-Manipulation from Demonstrations
von: He, Zhengmao, et al.
Veröffentlicht: (2024)
von: He, Zhengmao, et al.
Veröffentlicht: (2024)
Uni-O4: Unifying Online and Offline Deep Reinforcement Learning with Multi-Step On-Policy Optimization
von: Lei, Kun, et al.
Veröffentlicht: (2023)
von: Lei, Kun, et al.
Veröffentlicht: (2023)
Unleashing The Power of Pre-Trained Language Models for Irregularly Sampled Time Series
von: Zhang, Weijia, et al.
Veröffentlicht: (2024)
von: Zhang, Weijia, et al.
Veröffentlicht: (2024)
SLCA++: Unleash the Power of Sequential Fine-tuning for Continual Learning with Pre-training
von: Zhang, Gengwei, et al.
Veröffentlicht: (2024)
von: Zhang, Gengwei, et al.
Veröffentlicht: (2024)
3D Diffusion Policy: Generalizable Visuomotor Policy Learning via Simple 3D Representations
von: Ze, Yanjie, et al.
Veröffentlicht: (2024)
von: Ze, Yanjie, et al.
Veröffentlicht: (2024)
Sample-Efficient Policy Constraint Offline Deep Reinforcement Learning based on Sample Filtering
von: Chen, Yuanhao, et al.
Veröffentlicht: (2025)
von: Chen, Yuanhao, et al.
Veröffentlicht: (2025)
Diffusion Policies with Offline and Inverse Reinforcement Learning for Promoting Physical Activity in Older Adults Using Wearable Sensors
von: Liu, Chang, et al.
Veröffentlicht: (2025)
von: Liu, Chang, et al.
Veröffentlicht: (2025)
Policy-Based Trajectory Clustering in Offline Reinforcement Learning
von: Hu, Hao, et al.
Veröffentlicht: (2025)
von: Hu, Hao, et al.
Veröffentlicht: (2025)
Online Pre-Training for Offline-to-Online Reinforcement Learning
von: Shin, Yongjae, et al.
Veröffentlicht: (2025)
von: Shin, Yongjae, et al.
Veröffentlicht: (2025)
Unveiling Markov Heads in Pretrained Language Models for Offline Reinforcement Learning
von: Zhao, Wenhao, et al.
Veröffentlicht: (2024)
von: Zhao, Wenhao, et al.
Veröffentlicht: (2024)
Offline Safe Reinforcement Learning Using Trajectory Classification
von: Gong, Ze, et al.
Veröffentlicht: (2024)
von: Gong, Ze, et al.
Veröffentlicht: (2024)
Failure-Aware RL: Reliable Offline-to-Online Reinforcement Learning with Self-Recovery for Real-World Manipulation
von: Li, Huanyu, et al.
Veröffentlicht: (2026)
von: Li, Huanyu, et al.
Veröffentlicht: (2026)
BrainGPT: Unleashing the Potential of EEG Generalist Foundation Model by Autoregressive Pre-training
von: Yue, Tongtian, et al.
Veröffentlicht: (2024)
von: Yue, Tongtian, et al.
Veröffentlicht: (2024)
The Crucial Role of Samplers in Online Direct Preference Optimization
von: Shi, Ruizhe, et al.
Veröffentlicht: (2024)
von: Shi, Ruizhe, et al.
Veröffentlicht: (2024)
Decoding-Time Language Model Alignment with Multiple Objectives
von: Shi, Ruizhe, et al.
Veröffentlicht: (2024)
von: Shi, Ruizhe, et al.
Veröffentlicht: (2024)
A Pre-trained Data Deduplication Model based on Active Learning
von: Shi, Haochen, et al.
Veröffentlicht: (2023)
von: Shi, Haochen, et al.
Veröffentlicht: (2023)
PEAC: Unsupervised Pre-training for Cross-Embodiment Reinforcement Learning
von: Ying, Chengyang, et al.
Veröffentlicht: (2024)
von: Ying, Chengyang, et al.
Veröffentlicht: (2024)
Knockoff-Guided Feature Selection via A Single Pre-trained Reinforced Agent
von: Wang, Xinyuan, et al.
Veröffentlicht: (2024)
von: Wang, Xinyuan, et al.
Veröffentlicht: (2024)
MOTO: Offline Pre-training to Online Fine-tuning for Model-based Robot Learning
von: Rafailov, Rafael, et al.
Veröffentlicht: (2024)
von: Rafailov, Rafael, et al.
Veröffentlicht: (2024)
Model-based Offline Quantum Reinforcement Learning
von: Eisenmann, Simon, et al.
Veröffentlicht: (2024)
von: Eisenmann, Simon, et al.
Veröffentlicht: (2024)
Session-Level Dynamic Ad Load Optimization using Offline Robust Reinforcement Learning
von: Liu, Tao, et al.
Veröffentlicht: (2025)
von: Liu, Tao, et al.
Veröffentlicht: (2025)
Offline Regularised Reinforcement Learning for Large Language Models Alignment
von: Richemond, Pierre Harvey, et al.
Veröffentlicht: (2024)
von: Richemond, Pierre Harvey, et al.
Veröffentlicht: (2024)
Entropy Regularizing Activation: Boosting Continuous Control, Large Language Models, and Image Classification with Activation as Entropy Constraints
von: Kang, Zilin, et al.
Veröffentlicht: (2025)
von: Kang, Zilin, et al.
Veröffentlicht: (2025)
Distributionally Robust Model-Based Offline Reinforcement Learning with Near-Optimal Sample Complexity
von: Shi, Laixi, et al.
Veröffentlicht: (2022)
von: Shi, Laixi, et al.
Veröffentlicht: (2022)
LOST: Low-rank and Sparse Pre-training for Large Language Models
von: Li, Jiaxi, et al.
Veröffentlicht: (2025)
von: Li, Jiaxi, et al.
Veröffentlicht: (2025)
MLCopilot: Unleashing the Power of Large Language Models in Solving Machine Learning Tasks
von: Zhang, Lei, et al.
Veröffentlicht: (2023)
von: Zhang, Lei, et al.
Veröffentlicht: (2023)
PreRoutGNN for Timing Prediction with Order Preserving Partition: Global Circuit Pre-training, Local Delay Learning and Attentional Cell Modeling
von: Zhong, Ruizhe, et al.
Veröffentlicht: (2024)
von: Zhong, Ruizhe, et al.
Veröffentlicht: (2024)
MOBODY: Model Based Off-Dynamics Offline Reinforcement Learning
von: Guo, Yihong, et al.
Veröffentlicht: (2025)
von: Guo, Yihong, et al.
Veröffentlicht: (2025)
Offline Trajectory Optimization for Offline Reinforcement Learning
von: Zhao, Ziqi, et al.
Veröffentlicht: (2024)
von: Zhao, Ziqi, et al.
Veröffentlicht: (2024)
Mix-LN: Unleashing the Power of Deeper Layers by Combining Pre-LN and Post-LN
von: Li, Pengxiang, et al.
Veröffentlicht: (2024)
von: Li, Pengxiang, et al.
Veröffentlicht: (2024)
Cross-domain Random Pre-training with Prototypes for Reinforcement Learning
von: Liu, Xin, et al.
Veröffentlicht: (2023)
von: Liu, Xin, et al.
Veröffentlicht: (2023)
VLGOR: Visual-Language Knowledge Guided Offline Reinforcement Learning for Generalizable Agents
von: Liu, Pengsen, et al.
Veröffentlicht: (2026)
von: Liu, Pengsen, et al.
Veröffentlicht: (2026)
Aligning Pre-trained Models for Spoken Language Translation
von: Sedláček, Šimon, et al.
Veröffentlicht: (2024)
von: Sedláček, Šimon, et al.
Veröffentlicht: (2024)
Model Merging in Pre-training of Large Language Models
von: Li, Yunshui, et al.
Veröffentlicht: (2025)
von: Li, Yunshui, et al.
Veröffentlicht: (2025)
Energy-Guided Diffusion Sampling for Offline-to-Online Reinforcement Learning
von: Liu, Xu-Hui, et al.
Veröffentlicht: (2024)
von: Liu, Xu-Hui, et al.
Veröffentlicht: (2024)
DrM: Mastering Visual Reinforcement Learning through Dormant Ratio Minimization
von: Xu, Guowei, et al.
Veröffentlicht: (2023)
von: Xu, Guowei, et al.
Veröffentlicht: (2023)
A Forget-and-Grow Strategy for Deep Reinforcement Learning Scaling in Continuous Control
von: Kang, Zilin, et al.
Veröffentlicht: (2025)
von: Kang, Zilin, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Rethinking Transformers in Solving POMDPs
von: Lu, Chenhao, et al.
Veröffentlicht: (2024) -
Diffusion Reward: Learning Rewards via Conditional Video Diffusion
von: Huang, Tao, et al.
Veröffentlicht: (2023) -
Pre-training with Synthetic Data Helps Offline Reinforcement Learning
von: Wang, Zecheng, et al.
Veröffentlicht: (2023) -
Learning Visual Quadrupedal Loco-Manipulation from Demonstrations
von: He, Zhengmao, et al.
Veröffentlicht: (2024) -
Uni-O4: Unifying Online and Offline Deep Reinforcement Learning with Multi-Step On-Policy Optimization
von: Lei, Kun, et al.
Veröffentlicht: (2023)