Debiased Offline Representation Learning for Fast Online Adaptation in Non-stationary Dynamics
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Xinyu, Qiu, Wenjie, Li, Yi-Chen, Yuan, Lei, Jia, Chengxing, Zhang, Zongzhang, Yu, Yang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Disentangling Policy from Offline Task Representation Learning via Adversarial Data Augmentation
von: Jia, Chengxing, et al.
Veröffentlicht: (2024)
von: Jia, Chengxing, et al.
Veröffentlicht: (2024)
Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
von: Gao, Chen-Xiao, et al.
Veröffentlicht: (2024)
von: Gao, Chen-Xiao, et al.
Veröffentlicht: (2024)
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
von: Gao, Chen-Xiao, et al.
Veröffentlicht: (2025)
von: Gao, Chen-Xiao, et al.
Veröffentlicht: (2025)
Q-Adapter: Customizing Pre-trained LLMs to New Preferences with Forgetting Mitigation
von: Li, Yi-Chen, et al.
Veröffentlicht: (2024)
von: Li, Yi-Chen, et al.
Veröffentlicht: (2024)
Forecasting in Offline Reinforcement Learning for Non-stationary Environments
von: Ada, Suzan Ece, et al.
Veröffentlicht: (2025)
von: Ada, Suzan Ece, et al.
Veröffentlicht: (2025)
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
von: Wang, Changhong, et al.
Veröffentlicht: (2024)
von: Wang, Changhong, et al.
Veröffentlicht: (2024)
Policy Expansion for Bridging Offline-to-Online Reinforcement Learning
von: Zhang, Haichao, et al.
Veröffentlicht: (2023)
von: Zhang, Haichao, et al.
Veröffentlicht: (2023)
$\text{Alpha}^2$: Discovering Logical Formulaic Alphas using Deep Reinforcement Learning
von: Xu, Feng, et al.
Veröffentlicht: (2024)
von: Xu, Feng, et al.
Veröffentlicht: (2024)
Debiasing Reward Models by Representation Learning with Guarantees
von: Ng, Ignavier, et al.
Veröffentlicht: (2025)
von: Ng, Ignavier, et al.
Veröffentlicht: (2025)
ACT: Empowering Decision Transformer with Dynamic Programming via Advantage Conditioning
von: Gao, Chen-Xiao, et al.
Veröffentlicht: (2023)
von: Gao, Chen-Xiao, et al.
Veröffentlicht: (2023)
Customized Retrieval-Augmented Generation with LLM for Debiasing Recommendation Unlearning
von: Zhang, Haichao, et al.
Veröffentlicht: (2025)
von: Zhang, Haichao, et al.
Veröffentlicht: (2025)
BORA: Bridging Offline Reinforcement Learning and Online Residual Adaptation for Real-World Dexterous VLA Models
von: Chen, Zhongxi, et al.
Veröffentlicht: (2026)
von: Chen, Zhongxi, et al.
Veröffentlicht: (2026)
When to Trust Your Simulator: Dynamics-Aware Hybrid Offline-and-Online Reinforcement Learning
von: Niu, Haoyi, et al.
Veröffentlicht: (2022)
von: Niu, Haoyi, et al.
Veröffentlicht: (2022)
Debiased Contrastive Representation Learning for Mitigating Dual Biases in Recommender Systems
von: Huang, Zhirong, et al.
Veröffentlicht: (2024)
von: Huang, Zhirong, et al.
Veröffentlicht: (2024)
Offline-to-Online Reinforcement Learning with Classifier-Free Diffusion Generation
von: Huang, Xiao, et al.
Veröffentlicht: (2025)
von: Huang, Xiao, et al.
Veröffentlicht: (2025)
Contrastive Representation for Data Filtering in Cross-Domain Offline Reinforcement Learning
von: Wen, Xiaoyu, et al.
Veröffentlicht: (2024)
von: Wen, Xiaoyu, et al.
Veröffentlicht: (2024)
Deep Frequency Derivative Learning for Non-stationary Time Series Forecasting
von: Fan, Wei, et al.
Veröffentlicht: (2024)
von: Fan, Wei, et al.
Veröffentlicht: (2024)
ROLeR: Effective Reward Shaping in Offline Reinforcement Learning for Recommender Systems
von: Zhang, Yi, et al.
Veröffentlicht: (2024)
von: Zhang, Yi, et al.
Veröffentlicht: (2024)
Rethinking Relation Extraction: Beyond Shortcuts to Generalization with a Debiased Benchmark
von: He, Liang, et al.
Veröffentlicht: (2025)
von: He, Liang, et al.
Veröffentlicht: (2025)
OLLIE: Imitation Learning from Offline Pretraining to Online Finetuning
von: Yue, Sheng, et al.
Veröffentlicht: (2024)
von: Yue, Sheng, et al.
Veröffentlicht: (2024)
Causal Debiasing Medical Multimodal Representation Learning with Missing Modalities
von: Zhu, Xiaoguang, et al.
Veröffentlicht: (2025)
von: Zhu, Xiaoguang, et al.
Veröffentlicht: (2025)
OrcaRouter: A Production-Oriented LLM Router with Hybrid Offline-Online Learning
von: Bao, Zhenghua, et al.
Veröffentlicht: (2026)
von: Bao, Zhenghua, et al.
Veröffentlicht: (2026)
ODRL: A Benchmark for Off-Dynamics Reinforcement Learning
von: Lyu, Jiafei, et al.
Veröffentlicht: (2024)
von: Lyu, Jiafei, et al.
Veröffentlicht: (2024)
SAMG: Offline-to-Online Reinforcement Learning via State-Action-Conditional Offline Model Guidance
von: Zhang, Liyu, et al.
Veröffentlicht: (2024)
von: Zhang, Liyu, et al.
Veröffentlicht: (2024)
An Offline Adaptation Framework for Constrained Multi-Objective Reinforcement Learning
von: Lin, Qian, et al.
Veröffentlicht: (2024)
von: Lin, Qian, et al.
Veröffentlicht: (2024)
Model-Based Proactive Cost Generation for Learning Safe Policies Offline with Limited Violation Data
von: Xue, Ruiqi, et al.
Veröffentlicht: (2026)
von: Xue, Ruiqi, et al.
Veröffentlicht: (2026)
Offline Trajectory Optimization for Offline Reinforcement Learning
von: Zhao, Ziqi, et al.
Veröffentlicht: (2024)
von: Zhao, Ziqi, et al.
Veröffentlicht: (2024)
Debiased Model-based Representations for Sample-efficient Continuous Control
von: Lyu, Jiafei, et al.
Veröffentlicht: (2026)
von: Lyu, Jiafei, et al.
Veröffentlicht: (2026)
Debiasing Online Preference Learning via Preference Feature Preservation
von: Kim, Dongyoung, et al.
Veröffentlicht: (2025)
von: Kim, Dongyoung, et al.
Veröffentlicht: (2025)
Offline-to-Online Multi-Agent Reinforcement Learning with Offline Value Function Memory and Sequential Exploration
von: Zhong, Hai, et al.
Veröffentlicht: (2024)
von: Zhong, Hai, et al.
Veröffentlicht: (2024)
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
von: Yang, Rui, et al.
Veröffentlicht: (2023)
von: Yang, Rui, et al.
Veröffentlicht: (2023)
A Simple Unified Uncertainty-Guided Framework for Offline-to-Online Reinforcement Learning
von: Guo, Siyuan, et al.
Veröffentlicht: (2023)
von: Guo, Siyuan, et al.
Veröffentlicht: (2023)
Debiased Multimodal Understanding for Human Language Sequences
von: Xu, Zhi, et al.
Veröffentlicht: (2024)
von: Xu, Zhi, et al.
Veröffentlicht: (2024)
Localized Dynamics-Aware Domain Adaption for Off-Dynamics Offline Reinforcement Learning
von: Xia, Zhangjie, et al.
Veröffentlicht: (2026)
von: Xia, Zhangjie, et al.
Veröffentlicht: (2026)
Any-step Dynamics Model Improves Future Predictions for Online and Offline Reinforcement Learning
von: Lin, Haoxin, et al.
Veröffentlicht: (2024)
von: Lin, Haoxin, et al.
Veröffentlicht: (2024)
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
von: Zhao, Kai, et al.
Veröffentlicht: (2023)
von: Zhao, Kai, et al.
Veröffentlicht: (2023)
Reward Models in Deep Reinforcement Learning: A Survey
von: Yu, Rui, et al.
Veröffentlicht: (2025)
von: Yu, Rui, et al.
Veröffentlicht: (2025)
Learning Hierarchical and Geometry-Aware Graph Representations for Text-to-CAD
von: Gong, Shengjie, et al.
Veröffentlicht: (2026)
von: Gong, Shengjie, et al.
Veröffentlicht: (2026)
Debiasing Algorithm through Model Adaptation
von: Limisiewicz, Tomasz, et al.
Veröffentlicht: (2023)
von: Limisiewicz, Tomasz, et al.
Veröffentlicht: (2023)
Online Optimization for Offline Safe Reinforcement Learning
von: Chemingui, Yassine, et al.
Veröffentlicht: (2025)
von: Chemingui, Yassine, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Disentangling Policy from Offline Task Representation Learning via Adversarial Data Augmentation
von: Jia, Chengxing, et al.
Veröffentlicht: (2024) -
Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
von: Gao, Chen-Xiao, et al.
Veröffentlicht: (2024) -
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
von: Gao, Chen-Xiao, et al.
Veröffentlicht: (2025) -
Q-Adapter: Customizing Pre-trained LLMs to New Preferences with Forgetting Mitigation
von: Li, Yi-Chen, et al.
Veröffentlicht: (2024) -
Forecasting in Offline Reinforcement Learning for Non-stationary Environments
von: Ada, Suzan Ece, et al.
Veröffentlicht: (2025)