TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Yuhui, Li, Haoran, Jiang, Zhennan, Wen, Haowei, Zhao, Dongbin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
World4RL: Diffusion World Models for Policy Refinement with Reinforcement Learning for Robotic Manipulation
di: Jiang, Zhennan, et al.
Pubblicazione: (2025)
di: Jiang, Zhennan, et al.
Pubblicazione: (2025)
ConRFT: A Reinforced Fine-tuning Method for VLA Models via Consistency Policy
di: Chen, Yuhui, et al.
Pubblicazione: (2025)
di: Chen, Yuhui, et al.
Pubblicazione: (2025)
CL3R: 3D Reconstruction and Contrastive Learning for Enhanced Robotic Manipulation Representations
di: Cui, Wenbo, et al.
Pubblicazione: (2025)
di: Cui, Wenbo, et al.
Pubblicazione: (2025)
Generalizing Consistency Policy to Visual RL with Prioritized Proximal Experience Regularization
di: Li, Haoran, et al.
Pubblicazione: (2024)
di: Li, Haoran, et al.
Pubblicazione: (2024)
WoVR: World Models as Reliable Simulators for Post-Training VLA Policies with RL
di: Jiang, Zhennan, et al.
Pubblicazione: (2026)
di: Jiang, Zhennan, et al.
Pubblicazione: (2026)
Survey of Vision-Language-Action Models for Embodied Manipulation
di: Li, Haoran, et al.
Pubblicazione: (2025)
di: Li, Haoran, et al.
Pubblicazione: (2025)
ViVa: A Video-Generative Value Model for Robot Reinforcement Learning
di: Lv, Jindi, et al.
Pubblicazione: (2026)
di: Lv, Jindi, et al.
Pubblicazione: (2026)
Text2Reward: Reward Shaping with Language Models for Reinforcement Learning
di: Xie, Tianbao, et al.
Pubblicazione: (2023)
di: Xie, Tianbao, et al.
Pubblicazione: (2023)
Posterior Optimization with Clipped Objective for Bridging Efficiency and Stability in Generative Policy Learning
di: Chen, Yuhui, et al.
Pubblicazione: (2026)
di: Chen, Yuhui, et al.
Pubblicazione: (2026)
RoboGPT-R1: Enhancing Robot Planning with Reinforcement Learning
di: Liu, Jinrui, et al.
Pubblicazione: (2025)
di: Liu, Jinrui, et al.
Pubblicazione: (2025)
RoboAlign-R1: Distilled Multimodal Reward Alignment for Robot Video World Models
di: Wu, Hao, et al.
Pubblicazione: (2026)
di: Wu, Hao, et al.
Pubblicazione: (2026)
Dual-Granularity Contrastive Reward via Generated Episodic Guidance for Efficient Embodied RL
di: Liu, Xin, et al.
Pubblicazione: (2026)
di: Liu, Xin, et al.
Pubblicazione: (2026)
Reward Training Wheels: Adaptive Auxiliary Rewards for Robotics Reinforcement Learning
di: Wang, Linji, et al.
Pubblicazione: (2025)
di: Wang, Linji, et al.
Pubblicazione: (2025)
Actor-Critic for Continuous Action Chunks: A Reinforcement Learning Framework for Long-Horizon Robotic Manipulation with Sparse Reward
di: Yang, Jiarui, et al.
Pubblicazione: (2025)
di: Yang, Jiarui, et al.
Pubblicazione: (2025)
Safe CoR: A Dual-Expert Approach to Integrating Imitation Learning and Safe Reinforcement Learning Using Constraint Rewards
di: Kwon, Hyeokjin, et al.
Pubblicazione: (2024)
di: Kwon, Hyeokjin, et al.
Pubblicazione: (2024)
ComSD: Balancing Behavioral Quality and Diversity in Unsupervised Skill Discovery
di: Liu, Xin, et al.
Pubblicazione: (2023)
di: Liu, Xin, et al.
Pubblicazione: (2023)
TimeRewarder: Learning Dense Reward from Passive Videos via Frame-wise Temporal Distance
di: Liu, Yuyang, et al.
Pubblicazione: (2025)
di: Liu, Yuyang, et al.
Pubblicazione: (2025)
ViSA-Flow: Accelerating Robot Skill Learning via Large-Scale Video Semantic Action Flow
di: Chen, Changhe, et al.
Pubblicazione: (2025)
di: Chen, Changhe, et al.
Pubblicazione: (2025)
Residual Reward Models for Preference-based Reinforcement Learning
di: Cao, Chenyang, et al.
Pubblicazione: (2025)
di: Cao, Chenyang, et al.
Pubblicazione: (2025)
Language-Model-Assisted Bi-Level Programming for Reward Learning from Internet Videos
di: Mahesheka, Harsh, et al.
Pubblicazione: (2024)
di: Mahesheka, Harsh, et al.
Pubblicazione: (2024)
RL-100: Performant Robotic Manipulation with Real-World Reinforcement Learning
di: Lei, Kun, et al.
Pubblicazione: (2025)
di: Lei, Kun, et al.
Pubblicazione: (2025)
Diffusion-Reward Adversarial Imitation Learning
di: Lai, Chun-Mao, et al.
Pubblicazione: (2024)
di: Lai, Chun-Mao, et al.
Pubblicazione: (2024)
Constraints as Rewards: Reinforcement Learning for Robots without Reward Functions
di: Ishihara, Yu, et al.
Pubblicazione: (2025)
di: Ishihara, Yu, et al.
Pubblicazione: (2025)
Dependency-Aware CAV Task Scheduling via Diffusion-Based Reinforcement Learning
di: Cheng, Xiang, et al.
Pubblicazione: (2024)
di: Cheng, Xiang, et al.
Pubblicazione: (2024)
Reducing Risk for Assistive Reinforcement Learning Policies with Diffusion Models
di: Tytarenko, Andrii
Pubblicazione: (2024)
di: Tytarenko, Andrii
Pubblicazione: (2024)
Transformable Gaussian Reward Function for Socially-Aware Navigation with Deep Reinforcement Learning
di: Kim, Jinyeob, et al.
Pubblicazione: (2024)
di: Kim, Jinyeob, et al.
Pubblicazione: (2024)
Reinforcement Learning for AMR Charging Decisions: The Impact of Reward and Action Space Design
di: Bischoff, Janik, et al.
Pubblicazione: (2025)
di: Bischoff, Janik, et al.
Pubblicazione: (2025)
TeLL-Drive: Enhancing Autonomous Driving with Teacher LLM-Guided Deep Reinforcement Learning
di: Xu, Chengkai, et al.
Pubblicazione: (2025)
di: Xu, Chengkai, et al.
Pubblicazione: (2025)
Reward-Punishment Reinforcement Learning with Maximum Entropy
di: Wang, Jiexin, et al.
Pubblicazione: (2024)
di: Wang, Jiexin, et al.
Pubblicazione: (2024)
ZeroWBC: Learning Natural Visuomotor Humanoid Control Directly from Human Egocentric Video
di: Yang, Haoran, et al.
Pubblicazione: (2026)
di: Yang, Haoran, et al.
Pubblicazione: (2026)
Variational OOD State Correction for Offline Reinforcement Learning
di: Jiang, Ke, et al.
Pubblicazione: (2025)
di: Jiang, Ke, et al.
Pubblicazione: (2025)
Open-World Drone Active Tracking with Goal-Centered Rewards
di: Sun, Haowei, et al.
Pubblicazione: (2024)
di: Sun, Haowei, et al.
Pubblicazione: (2024)
Aligning Text-to-Image Diffusion Models with Reward Backpropagation
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2023)
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2023)
DreamSmooth: Improving Model-based Reinforcement Learning via Reward Smoothing
di: Lee, Vint, et al.
Pubblicazione: (2023)
di: Lee, Vint, et al.
Pubblicazione: (2023)
Learning to Bridge the Gap: Efficient Novelty Recovery with Planning and Reinforcement Learning
di: Li, Alicia, et al.
Pubblicazione: (2024)
di: Li, Alicia, et al.
Pubblicazione: (2024)
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
di: Zheng, Yinan, et al.
Pubblicazione: (2024)
di: Zheng, Yinan, et al.
Pubblicazione: (2024)
D-VLA: A High-Concurrency Distributed Asynchronous Reinforcement Learning Framework for Vision-Language-Action Models
di: Guo, Yucheng, et al.
Pubblicazione: (2026)
di: Guo, Yucheng, et al.
Pubblicazione: (2026)
Subwords as Skills: Tokenization for Sparse-Reward Reinforcement Learning
di: Yunis, David, et al.
Pubblicazione: (2023)
di: Yunis, David, et al.
Pubblicazione: (2023)
DISCOVER: Automated Curricula for Sparse-Reward Reinforcement Learning
di: Diaz-Bone, Leander, et al.
Pubblicazione: (2025)
di: Diaz-Bone, Leander, et al.
Pubblicazione: (2025)
RLRC: Reinforcement Learning-based Recovery for Compressed Vision-Language-Action Models
di: Chen, Yuxuan, et al.
Pubblicazione: (2025)
di: Chen, Yuxuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
World4RL: Diffusion World Models for Policy Refinement with Reinforcement Learning for Robotic Manipulation
di: Jiang, Zhennan, et al.
Pubblicazione: (2025) -
ConRFT: A Reinforced Fine-tuning Method for VLA Models via Consistency Policy
di: Chen, Yuhui, et al.
Pubblicazione: (2025) -
CL3R: 3D Reconstruction and Contrastive Learning for Enhanced Robotic Manipulation Representations
di: Cui, Wenbo, et al.
Pubblicazione: (2025) -
Generalizing Consistency Policy to Visual RL with Prioritized Proximal Experience Regularization
di: Li, Haoran, et al.
Pubblicazione: (2024) -
WoVR: World Models as Reliable Simulators for Post-Training VLA Policies with RL
di: Jiang, Zhennan, et al.
Pubblicazione: (2026)