PrefMMT: Modeling Human Preferences in Preference-based Reinforcement Learning with Multimodal Transformers
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhao, Dezhong, Wang, Ruiqi, Suh, Dayoon, Kim, Taehyeon, Yuan, Ziqin, Min, Byung-Cheol, Chen, Guohua |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Personalization in Human-Robot Interaction through Preference-based Action Representation Learning
por: Wang, Ruiqi, et al.
Publicado: (2024)
por: Wang, Ruiqi, et al.
Publicado: (2024)
PrefCLM: Enhancing Preference-based Reinforcement Learning with Crowdsourced Large Language Models
por: Wang, Ruiqi, et al.
Publicado: (2024)
por: Wang, Ruiqi, et al.
Publicado: (2024)
PrefMoE: Robust Preference Modeling with Mixture-of-Experts Reward Learning
por: Yuan, Ziqin, et al.
Publicado: (2026)
por: Yuan, Ziqin, et al.
Publicado: (2026)
PRIMT: Preference-based Reinforcement Learning with Multimodal Feedback and Trajectory Synthesis from Foundation Models
por: Wang, Ruiqi, et al.
Publicado: (2025)
por: Wang, Ruiqi, et al.
Publicado: (2025)
Adaptive Task Allocation in Multi-Human Multi-Robot Teams under Team Heterogeneity and Dynamic Information Uncertainty
por: Yuan, Ziqin, et al.
Publicado: (2024)
por: Yuan, Ziqin, et al.
Publicado: (2024)
REBEL: Rule-based and Experience-enhanced Learning with LLMs for Initial Task Allocation in Multi-Human Multi-Robot Teaming
por: Gupte, Arjun, et al.
Publicado: (2024)
por: Gupte, Arjun, et al.
Publicado: (2024)
Semantic Layering in Room Segmentation via LLMs
por: Kim, Taehyeon, et al.
Publicado: (2024)
por: Kim, Taehyeon, et al.
Publicado: (2024)
Few-Shot Demonstration-Driven Task Coordination and Trajectory Execution for Multi-Robot Systems
por: Kim, Taehyeon, et al.
Publicado: (2025)
por: Kim, Taehyeon, et al.
Publicado: (2025)
SafePlan: Leveraging Formal Logic and Chain-of-Thought Reasoning for Enhanced Safety in LLM-based Robotic Task Planning
por: Obi, Ike, et al.
Publicado: (2025)
por: Obi, Ike, et al.
Publicado: (2025)
Multi-Robot Cooperative Socially-Aware Navigation Using Multi-Agent Reinforcement Learning
por: Wang, Weizheng, et al.
Publicado: (2023)
por: Wang, Weizheng, et al.
Publicado: (2023)
Modeling and Evaluating Trust Dynamics in Multi-Human Multi-Robot Task Allocation
por: Obi, Ike, et al.
Publicado: (2024)
por: Obi, Ike, et al.
Publicado: (2024)
Pre-Execution Safety Gate & Task Safety Contracts for LLM-Controlled Robot Systems
por: Obi, Ike, et al.
Publicado: (2026)
por: Obi, Ike, et al.
Publicado: (2026)
Unifying Large Language Model and Deep Reinforcement Learning for Human-in-Loop Interactive Socially-aware Navigation
por: Wang, Weizheng, et al.
Publicado: (2024)
por: Wang, Weizheng, et al.
Publicado: (2024)
PlaceFormer: Transformer-based Visual Place Recognition using Multi-Scale Patch Selection and Fusion
por: Kannan, Shyam Sundar, et al.
Publicado: (2024)
por: Kannan, Shyam Sundar, et al.
Publicado: (2024)
RIME: Robust Preference-based Reinforcement Learning with Noisy Preferences
por: Cheng, Jie, et al.
Publicado: (2024)
por: Cheng, Jie, et al.
Publicado: (2024)
Multimodal Audio-based Disease Prediction with Transformer-based Hierarchical Fusion Network
por: Cai, Jinjin, et al.
Publicado: (2024)
por: Cai, Jinjin, et al.
Publicado: (2024)
Residual Reward Models for Preference-based Reinforcement Learning
por: Cao, Chenyang, et al.
Publicado: (2025)
por: Cao, Chenyang, et al.
Publicado: (2025)
Learning from Demonstration Framework for Multi-Robot Systems Using Interaction Keypoints and Soft Actor-Critic Methods
por: Venkatesh, Vishnunandan L. N., et al.
Publicado: (2024)
por: Venkatesh, Vishnunandan L. N., et al.
Publicado: (2024)
Human-Robot Cooperative Distribution Coupling for Hamiltonian-Constrained Social Navigation
por: Wang, Weizheng, et al.
Publicado: (2024)
por: Wang, Weizheng, et al.
Publicado: (2024)
ZeroCAP: Zero-Shot Multi-Robot Context Aware Pattern Formation via Large Language Models
por: Venkatesh, Vishnunandan L. N., et al.
Publicado: (2024)
por: Venkatesh, Vishnunandan L. N., et al.
Publicado: (2024)
Cognitive Load-based Affective Workload Allocation for Multi-human Multi-robot Teams
por: Jo, Wonse, et al.
Publicado: (2023)
por: Jo, Wonse, et al.
Publicado: (2023)
OHP-RL: Online Human Preference as Guidance in Reinforcement Learning for Robot Manipulation
por: Mo, Yunyang, et al.
Publicado: (2026)
por: Mo, Yunyang, et al.
Publicado: (2026)
PrefGen: Multimodal Preference Learning for Preference-Conditioned Image Generation
por: Mo, Wenyi, et al.
Publicado: (2025)
por: Mo, Wenyi, et al.
Publicado: (2025)
Hypergraph-based Coordinated Task Allocation and Socially-aware Navigation for Multi-Robot Systems
por: Wang, Weizheng, et al.
Publicado: (2024)
por: Wang, Weizheng, et al.
Publicado: (2024)
HELM: Human-Preferred Exploration with Language Models
por: Liao, Shuhao, et al.
Publicado: (2025)
por: Liao, Shuhao, et al.
Publicado: (2025)
Learning Human-Robot Handshaking Preferences for Quadruped Robots
por: Chappuis, Alessandra, et al.
Publicado: (2024)
por: Chappuis, Alessandra, et al.
Publicado: (2024)
Personalizing Reinforcement Learning from Human Feedback with Variational Preference Learning
por: Poddar, Sriyash, et al.
Publicado: (2024)
por: Poddar, Sriyash, et al.
Publicado: (2024)
PRISM: Preference Refinement via Implicit Scene Modeling for 3D Vision-Language Preference-Based Reinforcement Learning
por: Sun, Yirong, et al.
Publicado: (2025)
por: Sun, Yirong, et al.
Publicado: (2025)
ZeroSCD: Zero-Shot Street Scene Change Detection
por: Kannan, Shyam Sundar, et al.
Publicado: (2024)
por: Kannan, Shyam Sundar, et al.
Publicado: (2024)
SMART-LLM: Smart Multi-Agent Robot Task Planning using Large Language Models
por: Kannan, Shyam Sundar, et al.
Publicado: (2023)
por: Kannan, Shyam Sundar, et al.
Publicado: (2023)
Multi-Agent LLM Actor-Critic Framework for Social Robot Navigation
por: Wang, Weizheng, et al.
Publicado: (2025)
por: Wang, Weizheng, et al.
Publicado: (2025)
TREND: Tri-teaching for Robust Preference-based Reinforcement Learning with Demonstrations
por: Huang, Shuaiyi, et al.
Publicado: (2025)
por: Huang, Shuaiyi, et al.
Publicado: (2025)
Human Implicit Preference-Based Policy Fine-tuning for Multi-Agent Reinforcement Learning in USV Swarm
por: Kim, Hyeonjun, et al.
Publicado: (2025)
por: Kim, Hyeonjun, et al.
Publicado: (2025)
HALO: Human Preference Aligned Offline Reward Learning for Robot Navigation
por: Seneviratne, Gershom, et al.
Publicado: (2025)
por: Seneviratne, Gershom, et al.
Publicado: (2025)
Learning Human Preferences Over Robot Behavior as Soft Planning Constraints
por: Narcomey, Austin, et al.
Publicado: (2024)
por: Narcomey, Austin, et al.
Publicado: (2024)
Predictive Preference Learning from Human Interventions
por: Cai, Haoyuan, et al.
Publicado: (2025)
por: Cai, Haoyuan, et al.
Publicado: (2025)
LAPP: Large Language Model Feedback for Preference-Driven Reinforcement Learning
por: Jian, Pingcheng, et al.
Publicado: (2025)
por: Jian, Pingcheng, et al.
Publicado: (2025)
PREDILECT: Preferences Delineated with Zero-Shot Language-based Reasoning in Reinforcement Learning
por: Holk, Simon, et al.
Publicado: (2024)
por: Holk, Simon, et al.
Publicado: (2024)
Preference-Based Long-Horizon Robotic Stacking with Multimodal Large Language Models
por: Yu, Wanming, et al.
Publicado: (2025)
por: Yu, Wanming, et al.
Publicado: (2025)
Learning to Discern: Imitating Heterogeneous Human Demonstrations with Preference and Representation Learning
por: Kuhar, Sachit, et al.
Publicado: (2023)
por: Kuhar, Sachit, et al.
Publicado: (2023)
Ejemplares similares
-
Personalization in Human-Robot Interaction through Preference-based Action Representation Learning
por: Wang, Ruiqi, et al.
Publicado: (2024) -
PrefCLM: Enhancing Preference-based Reinforcement Learning with Crowdsourced Large Language Models
por: Wang, Ruiqi, et al.
Publicado: (2024) -
PrefMoE: Robust Preference Modeling with Mixture-of-Experts Reward Learning
por: Yuan, Ziqin, et al.
Publicado: (2026) -
PRIMT: Preference-based Reinforcement Learning with Multimodal Feedback and Trajectory Synthesis from Foundation Models
por: Wang, Ruiqi, et al.
Publicado: (2025) -
Adaptive Task Allocation in Multi-Human Multi-Robot Teams under Team Heterogeneity and Dynamic Information Uncertainty
por: Yuan, Ziqin, et al.
Publicado: (2024)