LGR2: Language Guided Reward Relabeling for Accelerating Hierarchical Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Singh, Utsav, Bhattacharyya, Pramit, Namboodiri, Vinay P. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
PEAR: Primitive Enabled Adaptive Relabeling for Boosting Hierarchical Reinforcement Learning
por: Singh, Utsav, et al.
Publicado: (2023)
por: Singh, Utsav, et al.
Publicado: (2023)
PIPER: Primitive-Informed Preference-based Hierarchical Reinforcement Learning via Hindsight Relabeling
por: Singh, Utsav, et al.
Publicado: (2024)
por: Singh, Utsav, et al.
Publicado: (2024)
CRISP: Curriculum Inducing Primitive Informed Subgoal Prediction for Hierarchical Reinforcement Learning
por: Singh, Utsav, et al.
Publicado: (2023)
por: Singh, Utsav, et al.
Publicado: (2023)
DHP: Discrete Hierarchical Planning for Hierarchical Reinforcement Learning Agents
por: Sharma, Shashank, et al.
Publicado: (2025)
por: Sharma, Shashank, et al.
Publicado: (2025)
Text2Reward: Reward Shaping with Language Models for Reinforcement Learning
por: Xie, Tianbao, et al.
Publicado: (2023)
por: Xie, Tianbao, et al.
Publicado: (2023)
DIPPER: Direct Preference Optimization to Accelerate Primitive-Enabled Hierarchical Reinforcement Learning
por: Singh, Utsav, et al.
Publicado: (2024)
por: Singh, Utsav, et al.
Publicado: (2024)
Chain of Uncertain Rewards with Large Language Models for Reinforcement Learning
por: Mo, Shentong
Publicado: (2026)
por: Mo, Shentong
Publicado: (2026)
PREDILECT: Preferences Delineated with Zero-Shot Language-based Reasoning in Reinforcement Learning
por: Holk, Simon, et al.
Publicado: (2024)
por: Holk, Simon, et al.
Publicado: (2024)
The RL/LLM Taxonomy Tree: Reviewing Synergies Between Reinforcement Learning and Large Language Models
por: Pternea, Moschoula, et al.
Publicado: (2024)
por: Pternea, Moschoula, et al.
Publicado: (2024)
Mental Modeling of Reinforcement Learning Agents by Language Models
por: Lu, Wenhao, et al.
Publicado: (2024)
por: Lu, Wenhao, et al.
Publicado: (2024)
Intrinsic Language-Guided Exploration for Complex Long-Horizon Robotic Manipulation Tasks
por: Triantafyllidis, Eleftherios, et al.
Publicado: (2023)
por: Triantafyllidis, Eleftherios, et al.
Publicado: (2023)
MRS: Multi-Resolution Skills for HRL Agents
por: Sharma, Shashank, et al.
Publicado: (2025)
por: Sharma, Shashank, et al.
Publicado: (2025)
Survey on Large Language Model-Enhanced Reinforcement Learning: Concept, Taxonomy, and Methods
por: Cao, Yuji, et al.
Publicado: (2024)
por: Cao, Yuji, et al.
Publicado: (2024)
Language Guided Skill Discovery
por: Rho, Seungeun, et al.
Publicado: (2024)
por: Rho, Seungeun, et al.
Publicado: (2024)
Online Intrinsic Rewards for Decision Making Agents from Large Language Model Feedback
por: Zheng, Qinqing, et al.
Publicado: (2024)
por: Zheng, Qinqing, et al.
Publicado: (2024)
Learning Instruction-Following Policies through Open-Ended Instruction Relabeling with Large Language Models
por: Zhang, Zhicheng, et al.
Publicado: (2025)
por: Zhang, Zhicheng, et al.
Publicado: (2025)
Personalizing Reinforcement Learning from Human Feedback with Variational Preference Learning
por: Poddar, Sriyash, et al.
Publicado: (2024)
por: Poddar, Sriyash, et al.
Publicado: (2024)
Video-Language Critic: Transferable Reward Functions for Language-Conditioned Robotics
por: Alakuijala, Minttu, et al.
Publicado: (2024)
por: Alakuijala, Minttu, et al.
Publicado: (2024)
SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning
por: Li, Haozhan, et al.
Publicado: (2025)
por: Li, Haozhan, et al.
Publicado: (2025)
SPRINT: Scalable Policy Pre-Training via Language Instruction Relabeling
por: Zhang, Jesse, et al.
Publicado: (2023)
por: Zhang, Jesse, et al.
Publicado: (2023)
Grounding Large Language Models In Embodied Environment With Imperfect World Models
por: Liu, Haolan, et al.
Publicado: (2024)
por: Liu, Haolan, et al.
Publicado: (2024)
Teaching Embodied Reinforcement Learning Agents: Informativeness and Diversity of Language Use
por: Xi, Jiajun, et al.
Publicado: (2024)
por: Xi, Jiajun, et al.
Publicado: (2024)
REBEL: Reward Regularization-Based Approach for Robotic Reinforcement Learning from Human Feedback
por: Chakraborty, Souradip, et al.
Publicado: (2023)
por: Chakraborty, Souradip, et al.
Publicado: (2023)
Anticipate & Act : Integrating LLMs and Classical Planning for Efficient Task Execution in Household Environments
por: Arora, Raghav, et al.
Publicado: (2025)
por: Arora, Raghav, et al.
Publicado: (2025)
SAME: Learning Generic Language-Guided Visual Navigation with State-Adaptive Mixture of Experts
por: Zhou, Gengze, et al.
Publicado: (2024)
por: Zhou, Gengze, et al.
Publicado: (2024)
Directional Alignment Mitigates Reward Hacking in Reinforcement Learning for Language Models
por: Deng, Wenlong, et al.
Publicado: (2026)
por: Deng, Wenlong, et al.
Publicado: (2026)
AdaptBot: Combining LLM with Knowledge Graphs and Human Input for Generic-to-Specific Task Decomposition and Knowledge Refinement
por: Singh, Shivam, et al.
Publicado: (2025)
por: Singh, Shivam, et al.
Publicado: (2025)
Curriculum Reinforcement Learning for Complex Reward Functions
por: Freitag, Kilian, et al.
Publicado: (2024)
por: Freitag, Kilian, et al.
Publicado: (2024)
On-Robot Reinforcement Learning with Goal-Contrastive Rewards
por: Biza, Ondrej, et al.
Publicado: (2024)
por: Biza, Ondrej, et al.
Publicado: (2024)
Hierarchical Open-Vocabulary 3D Scene Graphs for Language-Grounded Robot Navigation
por: Werby, Abdelrhman, et al.
Publicado: (2024)
por: Werby, Abdelrhman, et al.
Publicado: (2024)
LLM-based Multi-Agent Reinforcement Learning: Current and Future Directions
por: Sun, Chuanneng, et al.
Publicado: (2024)
por: Sun, Chuanneng, et al.
Publicado: (2024)
ConformalNL2LTL: Translating Natural Language Instructions into Temporal Logic Formulas with Conformal Correctness Guarantees
por: Sundarsingh, David Smith, et al.
Publicado: (2025)
por: Sundarsingh, David Smith, et al.
Publicado: (2025)
Dynamic Reward Adjustment in Multi-Reward Reinforcement Learning for Counselor Reflection Generation
por: Min, Do June, et al.
Publicado: (2024)
por: Min, Do June, et al.
Publicado: (2024)
Distilled Feature Fields Enable Few-Shot Language-Guided Manipulation
por: Shen, William, et al.
Publicado: (2023)
por: Shen, William, et al.
Publicado: (2023)
Agreeing to Interact in Human-Robot Interaction using Large Language Models and Vision Language Models
por: Sasabuchi, Kazuhiro, et al.
Publicado: (2025)
por: Sasabuchi, Kazuhiro, et al.
Publicado: (2025)
Revisiting Sparse Rewards for Goal-Reaching Reinforcement Learning
por: Vasan, Gautham, et al.
Publicado: (2024)
por: Vasan, Gautham, et al.
Publicado: (2024)
LLMs for Robotic Object Disambiguation
por: Jiang, Connie, et al.
Publicado: (2024)
por: Jiang, Connie, et al.
Publicado: (2024)
Reducing Text Bias in Synthetically Generated MCQAs for VLMs in Autonomous Driving
por: Kulgod, Sutej, et al.
Publicado: (2026)
por: Kulgod, Sutej, et al.
Publicado: (2026)
Constrained Group Relative Policy Optimization
por: Girgis, Roger, et al.
Publicado: (2026)
por: Girgis, Roger, et al.
Publicado: (2026)
VITA-E: Natural Embodied Interaction with Concurrent Seeing, Hearing, Speaking, and Acting
por: Liu, Xiaoyu, et al.
Publicado: (2025)
por: Liu, Xiaoyu, et al.
Publicado: (2025)
Ejemplares similares
-
PEAR: Primitive Enabled Adaptive Relabeling for Boosting Hierarchical Reinforcement Learning
por: Singh, Utsav, et al.
Publicado: (2023) -
PIPER: Primitive-Informed Preference-based Hierarchical Reinforcement Learning via Hindsight Relabeling
por: Singh, Utsav, et al.
Publicado: (2024) -
CRISP: Curriculum Inducing Primitive Informed Subgoal Prediction for Hierarchical Reinforcement Learning
por: Singh, Utsav, et al.
Publicado: (2023) -
DHP: Discrete Hierarchical Planning for Hierarchical Reinforcement Learning Agents
por: Sharma, Shashank, et al.
Publicado: (2025) -
Text2Reward: Reward Shaping with Language Models for Reinforcement Learning
por: Xie, Tianbao, et al.
Publicado: (2023)