Temporal Difference Learning with Constrained Initial Representations
Fuente:
arXiv
Salvato in:
| Autori principali: | Lyu, Jiafei, Yang, Jingwen, Qiao, Zhongjian, Liu, Runze, Liu, Zeyuan, Ye, Deheng, Lu, Zongqing, Li, Xiu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Cross-Domain Policy Adaptation by Capturing Representation Mismatch
di: Lyu, Jiafei, et al.
Pubblicazione: (2024)
di: Lyu, Jiafei, et al.
Pubblicazione: (2024)
Cross-Domain Offline Policy Adaptation via Selective Transition Correction
di: Yan, Mengbei, et al.
Pubblicazione: (2026)
di: Yan, Mengbei, et al.
Pubblicazione: (2026)
Mind the Model, Not the Agent: The Primacy Bias in Model-based RL
di: Qiao, Zhongjian, et al.
Pubblicazione: (2023)
di: Qiao, Zhongjian, et al.
Pubblicazione: (2023)
SEABO: A Simple Search-Based Method for Offline Imitation Learning
di: Lyu, Jiafei, et al.
Pubblicazione: (2024)
di: Lyu, Jiafei, et al.
Pubblicazione: (2024)
SUMO: Search-Based Uncertainty Estimation for Model-Based Offline Reinforcement Learning
di: Qiao, Zhongjian, et al.
Pubblicazione: (2024)
di: Qiao, Zhongjian, et al.
Pubblicazione: (2024)
Mildly Conservative Q-Learning for Offline Reinforcement Learning
di: Lyu, Jiafei, et al.
Pubblicazione: (2022)
di: Lyu, Jiafei, et al.
Pubblicazione: (2022)
PROF: An LLM-based Reward Code Preference Optimization Framework for Offline Imitation Learning
di: Sun, Shengjie, et al.
Pubblicazione: (2025)
di: Sun, Shengjie, et al.
Pubblicazione: (2025)
Understanding What Affects the Generalization Gap in Visual Reinforcement Learning: Theory and Empirical Evidence
di: Lyu, Jiafei, et al.
Pubblicazione: (2024)
di: Lyu, Jiafei, et al.
Pubblicazione: (2024)
Debiased Model-based Representations for Sample-efficient Continuous Control
di: Lyu, Jiafei, et al.
Pubblicazione: (2026)
di: Lyu, Jiafei, et al.
Pubblicazione: (2026)
PEARL: Zero-shot Cross-task Preference Alignment and Robust Reward Learning for Robotic Manipulation
di: Liu, Runze, et al.
Pubblicazione: (2023)
di: Liu, Runze, et al.
Pubblicazione: (2023)
Efficient Cross-Domain Offline Reinforcement Learning with Dynamics- and Value-Aligned Data Filtering
di: Qiao, Zhongjian, et al.
Pubblicazione: (2025)
di: Qiao, Zhongjian, et al.
Pubblicazione: (2025)
ODRL: A Benchmark for Off-Dynamics Reinforcement Learning
di: Lyu, Jiafei, et al.
Pubblicazione: (2024)
di: Lyu, Jiafei, et al.
Pubblicazione: (2024)
Dual-Robust Cross-Domain Offline Reinforcement Learning Against Dynamics Shifts
di: Qiao, Zhongjian, et al.
Pubblicazione: (2025)
di: Qiao, Zhongjian, et al.
Pubblicazione: (2025)
A Large Language Model-Driven Reward Design Framework via Dynamic Feedback for Reinforcement Learning
di: Sun, Shengjie, et al.
Pubblicazione: (2024)
di: Sun, Shengjie, et al.
Pubblicazione: (2024)
VLP: Vision-Language Preference Learning for Embodied Manipulation
di: Liu, Runze, et al.
Pubblicazione: (2025)
di: Liu, Runze, et al.
Pubblicazione: (2025)
Model-based Offline RL via Robust Value-Aware Model Learning with Implicitly Differentiable Adaptive Weighting
di: Qiao, Zhongjian, et al.
Pubblicazione: (2026)
di: Qiao, Zhongjian, et al.
Pubblicazione: (2026)
Unifying Value Alignment and Assignment in Cross-Domain Offline Reinforcement Learning with Heterogeneous Datasets
di: Qiao, Zhongjian, et al.
Pubblicazione: (2026)
di: Qiao, Zhongjian, et al.
Pubblicazione: (2026)
ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning
di: Liu, Zeyuan, et al.
Pubblicazione: (2025)
di: Liu, Zeyuan, et al.
Pubblicazione: (2025)
A Two-stage Reinforcement Learning-based Approach for Multi-entity Task Allocation
di: Gong, Aicheng, et al.
Pubblicazione: (2024)
di: Gong, Aicheng, et al.
Pubblicazione: (2024)
CDSA: Conservative Denoising Score-based Algorithm for Offline Reinforcement Learning
di: Liu, Zeyuan, et al.
Pubblicazione: (2024)
di: Liu, Zeyuan, et al.
Pubblicazione: (2024)
Exploration and Anti-Exploration with Distributional Random Network Distillation
di: Yang, Kai, et al.
Pubblicazione: (2024)
di: Yang, Kai, et al.
Pubblicazione: (2024)
EntroPIC: Towards Stable Long-Term Training of LLMs via Entropy Stabilization with Proportional-Integral Control
di: Yang, Kai, et al.
Pubblicazione: (2025)
di: Yang, Kai, et al.
Pubblicazione: (2025)
CORD: Generalizable Cooperation via Role Diversity
di: Matsuyama, Kanefumi, et al.
Pubblicazione: (2025)
di: Matsuyama, Kanefumi, et al.
Pubblicazione: (2025)
Tackling Non-Stationarity in Reinforcement Learning via Causal-Origin Representation
di: Zhang, Wanpeng, et al.
Pubblicazione: (2023)
di: Zhang, Wanpeng, et al.
Pubblicazione: (2023)
World Models with Hints of Large Language Models for Goal Achieving
di: Liu, Zeyuan, et al.
Pubblicazione: (2024)
di: Liu, Zeyuan, et al.
Pubblicazione: (2024)
UI-Voyager: A Self-Evolving GUI Agent Learning via Failed Experience
di: Lin, Zichuan, et al.
Pubblicazione: (2026)
di: Lin, Zichuan, et al.
Pubblicazione: (2026)
Pre-trained Visual Dynamics Representations for Efficient Policy Learning
di: Luo, Hao, et al.
Pubblicazione: (2024)
di: Luo, Hao, et al.
Pubblicazione: (2024)
Multi-Agent Coordination via Multi-Level Communication
di: Ding, Ziluo, et al.
Pubblicazione: (2022)
di: Ding, Ziluo, et al.
Pubblicazione: (2022)
Exploration by Random Distribution Distillation
di: Fang, Zhirui, et al.
Pubblicazione: (2025)
di: Fang, Zhirui, et al.
Pubblicazione: (2025)
Sample-Efficient Policy Constraint Offline Deep Reinforcement Learning based on Sample Filtering
di: Chen, Yuanhao, et al.
Pubblicazione: (2025)
di: Chen, Yuanhao, et al.
Pubblicazione: (2025)
Novelty-Guided Data Reuse for Efficient and Diversified Multi-Agent Reinforcement Learning
di: Chen, Yangkun, et al.
Pubblicazione: (2024)
di: Chen, Yangkun, et al.
Pubblicazione: (2024)
Disentanglement in Difference: Directly Learning Semantically Disentangled Representations by Maximizing Inter-Factor Differences
di: Zhang, Xingshen, et al.
Pubblicazione: (2025)
di: Zhang, Xingshen, et al.
Pubblicazione: (2025)
Can Temporal-Difference and Q-Learning Learn Representation? A Mean-Field Theory
di: Zhang, Yufeng, et al.
Pubblicazione: (2020)
di: Zhang, Yufeng, et al.
Pubblicazione: (2020)
Cross-Embodiment Dexterous Grasping with Reinforcement Learning
di: Yuan, Haoqi, et al.
Pubblicazione: (2024)
di: Yuan, Haoqi, et al.
Pubblicazione: (2024)
LACONIC: Length-Aware Constrained Reinforcement Learning for LLM
di: Liu, Chang, et al.
Pubblicazione: (2026)
di: Liu, Chang, et al.
Pubblicazione: (2026)
Temporal Difference Learning for High-Dimensional PIDEs with Jumps
di: Lu, Liwei, et al.
Pubblicazione: (2023)
di: Lu, Liwei, et al.
Pubblicazione: (2023)
Learning Versatile Skills with Curriculum Masking
di: Tang, Yao, et al.
Pubblicazione: (2024)
di: Tang, Yao, et al.
Pubblicazione: (2024)
Enhancing Unsupervised Feature Selection via Double Sparsity Constrained Optimization
di: Xiu, Xianchao, et al.
Pubblicazione: (2025)
di: Xiu, Xianchao, et al.
Pubblicazione: (2025)
Efficient Residual Learning with Mixture-of-Experts for Universal Dexterous Grasping
di: Huang, Ziye, et al.
Pubblicazione: (2024)
di: Huang, Ziye, et al.
Pubblicazione: (2024)
MLLM as Retriever: Interactively Learning Multimodal Retrieval for Embodied Agents
di: Yue, Junpeng, et al.
Pubblicazione: (2024)
di: Yue, Junpeng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Cross-Domain Policy Adaptation by Capturing Representation Mismatch
di: Lyu, Jiafei, et al.
Pubblicazione: (2024) -
Cross-Domain Offline Policy Adaptation via Selective Transition Correction
di: Yan, Mengbei, et al.
Pubblicazione: (2026) -
Mind the Model, Not the Agent: The Primacy Bias in Model-based RL
di: Qiao, Zhongjian, et al.
Pubblicazione: (2023) -
SEABO: A Simple Search-Based Method for Offline Imitation Learning
di: Lyu, Jiafei, et al.
Pubblicazione: (2024) -
SUMO: Search-Based Uncertainty Estimation for Model-Based Offline Reinforcement Learning
di: Qiao, Zhongjian, et al.
Pubblicazione: (2024)