PRISM: Preference Refinement via Implicit Scene Modeling for 3D Vision-Language Preference-Based Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sun, Yirong, Chen, Yanjun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PREDILECT: Preferences Delineated with Zero-Shot Language-based Reasoning in Reinforcement Learning
par: Holk, Simon, et autres
Publié: (2024)
par: Holk, Simon, et autres
Publié: (2024)
DecisionNCE: Embodied Multimodal Representations via Implicit Preference Learning
par: Li, Jianxiong, et autres
Publié: (2024)
par: Li, Jianxiong, et autres
Publié: (2024)
SceneVerse: Scaling 3D Vision-Language Learning for Grounded Scene Understanding
par: Jia, Baoxiong, et autres
Publié: (2024)
par: Jia, Baoxiong, et autres
Publié: (2024)
Personalizing Reinforcement Learning from Human Feedback with Variational Preference Learning
par: Poddar, Sriyash, et autres
Publié: (2024)
par: Poddar, Sriyash, et autres
Publié: (2024)
Integrating Chain-of-Thought for Multimodal Alignment: A Study on 3D Vision-Language Learning
par: Chen, Yanjun, et autres
Publié: (2025)
par: Chen, Yanjun, et autres
Publié: (2025)
Do 3D Large Language Models Really Understand 3D Spatial Relationships?
par: Ma, Xianzheng, et autres
Publié: (2026)
par: Ma, Xianzheng, et autres
Publié: (2026)
DivScene: Towards Open-Vocabulary Object Navigation with Large Vision Language Models in Diverse Scenes
par: Wang, Zhaowei, et autres
Publié: (2024)
par: Wang, Zhaowei, et autres
Publié: (2024)
Stable Language Guidance for Vision-Language-Action Models
par: Zhan, Zhihao, et autres
Publié: (2026)
par: Zhan, Zhihao, et autres
Publié: (2026)
Calib3D: Calibrating Model Preferences for Reliable 3D Scene Understanding
par: Kong, Lingdong, et autres
Publié: (2024)
par: Kong, Lingdong, et autres
Publié: (2024)
VARP: Reinforcement Learning from Vision-Language Model Feedback with Agent Regularized Preferences
par: Singh, Anukriti, et autres
Publié: (2025)
par: Singh, Anukriti, et autres
Publié: (2025)
3D-VLA: A 3D Vision-Language-Action Generative World Model
par: Zhen, Haoyu, et autres
Publié: (2024)
par: Zhen, Haoyu, et autres
Publié: (2024)
Affordances-Oriented Planning using Foundation Models for Continuous Vision-Language Navigation
par: Chen, Jiaqi, et autres
Publié: (2024)
par: Chen, Jiaqi, et autres
Publié: (2024)
EdgeVLA: Efficient Vision-Language-Action Models
par: Budzianowski, Paweł, et autres
Publié: (2025)
par: Budzianowski, Paweł, et autres
Publié: (2025)
Preference-Based Planning in Stochastic Environments: From Partially-Ordered Temporal Goals to Most Preferred Policies
par: Rahmani, Hazhar, et autres
Publié: (2024)
par: Rahmani, Hazhar, et autres
Publié: (2024)
OpenFMNav: Towards Open-Set Zero-Shot Object Navigation via Vision-Language Foundation Models
par: Kuang, Yuxuan, et autres
Publié: (2024)
par: Kuang, Yuxuan, et autres
Publié: (2024)
World Modeling Makes a Better Planner: Dual Preference Optimization for Embodied Task Planning
par: Wang, Siyin, et autres
Publié: (2025)
par: Wang, Siyin, et autres
Publié: (2025)
Preference-Driven Active 3D Scene Representation for Robotic Inspection in Nuclear Decommissioning
par: Meng, Zhen, et autres
Publié: (2025)
par: Meng, Zhen, et autres
Publié: (2025)
MaxMin-RLHF: Alignment with Diverse Human Preferences
par: Chakraborty, Souradip, et autres
Publié: (2024)
par: Chakraborty, Souradip, et autres
Publié: (2024)
NavCoT: Boosting LLM-Based Vision-and-Language Navigation via Learning Disentangled Reasoning
par: Lin, Bingqian, et autres
Publié: (2024)
par: Lin, Bingqian, et autres
Publié: (2024)
Retrieval-Augmented Hierarchical in-Context Reinforcement Learning and Hindsight Modular Reflections for Task Planning with LLMs
par: Sun, Chuanneng, et autres
Publié: (2024)
par: Sun, Chuanneng, et autres
Publié: (2024)
Mental Modeling of Reinforcement Learning Agents by Language Models
par: Lu, Wenhao, et autres
Publié: (2024)
par: Lu, Wenhao, et autres
Publié: (2024)
PrefMMT: Modeling Human Preferences in Preference-based Reinforcement Learning with Multimodal Transformers
par: Zhao, Dezhong, et autres
Publié: (2024)
par: Zhao, Dezhong, et autres
Publié: (2024)
Red-Teaming Vision-Language-Action Models via Quality Diversity Prompt Generation for Robust Robot Policies
par: Srikanth, Siddharth, et autres
Publié: (2026)
par: Srikanth, Siddharth, et autres
Publié: (2026)
Mechanistic Finetuning of Vision-Language-Action Models via Few-Shot Demonstrations
par: Mitra, Chancharik, et autres
Publié: (2025)
par: Mitra, Chancharik, et autres
Publié: (2025)
VLP: Vision-Language Preference Learning for Embodied Manipulation
par: Liu, Runze, et autres
Publié: (2025)
par: Liu, Runze, et autres
Publié: (2025)
RoboSpatial: Teaching Spatial Understanding to 2D and 3D Vision-Language Models for Robotics
par: Song, Chan Hee, et autres
Publié: (2024)
par: Song, Chan Hee, et autres
Publié: (2024)
Text2Reward: Reward Shaping with Language Models for Reinforcement Learning
par: Xie, Tianbao, et autres
Publié: (2023)
par: Xie, Tianbao, et autres
Publié: (2023)
Aligning Large Language Models with Implicit Preferences from User-Generated Content
par: Tan, Zhaoxuan, et autres
Publié: (2025)
par: Tan, Zhaoxuan, et autres
Publié: (2025)
InfiFPO: Implicit Model Fusion via Preference Optimization in Large Language Models
par: Gu, Yanggan, et autres
Publié: (2025)
par: Gu, Yanggan, et autres
Publié: (2025)
Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments
par: Wang, Qiuyue, et autres
Publié: (2026)
par: Wang, Qiuyue, et autres
Publié: (2026)
Survey on Large Language Model-Enhanced Reinforcement Learning: Concept, Taxonomy, and Methods
par: Cao, Yuji, et autres
Publié: (2024)
par: Cao, Yuji, et autres
Publié: (2024)
ZING-3D: Zero-shot Incremental 3D Scene Graphs via Vision-Language Models
par: Saxena, Pranav, et autres
Publié: (2025)
par: Saxena, Pranav, et autres
Publié: (2025)
SYNAPSE: SYmbolic Neural-Aided Preference Synthesis Engine
par: Modak, Sadanand, et autres
Publié: (2024)
par: Modak, Sadanand, et autres
Publié: (2024)
3D-MoE: A Mixture-of-Experts Multi-modal LLM for 3D Vision and Pose Diffusion via Rectified Flow
par: Ma, Yueen, et autres
Publié: (2025)
par: Ma, Yueen, et autres
Publié: (2025)
Preference Distillation via Value based Reinforcement Learning
par: Kwon, Minchan, et autres
Publié: (2025)
par: Kwon, Minchan, et autres
Publié: (2025)
The Better You Learn, The Smarter You Prune: Towards Efficient Vision-language-action Models via Differentiable Token Pruning
par: Jiang, Titong, et autres
Publié: (2025)
par: Jiang, Titong, et autres
Publié: (2025)
Towards Multimodal Social Conversations with Robots: Using Vision-Language Models
par: Janssens, Ruben, et autres
Publié: (2025)
par: Janssens, Ruben, et autres
Publié: (2025)
Temporal Preference Optimization for Long-Form Video Understanding
par: Li, Rui, et autres
Publié: (2025)
par: Li, Rui, et autres
Publié: (2025)
Weighted-Reward Preference Optimization for Implicit Model Fusion
par: Yang, Ziyi, et autres
Publié: (2024)
par: Yang, Ziyi, et autres
Publié: (2024)
AgentRefine: Enhancing Agent Generalization through Refinement Tuning
par: Fu, Dayuan, et autres
Publié: (2025)
par: Fu, Dayuan, et autres
Publié: (2025)
Documents similaires
-
PREDILECT: Preferences Delineated with Zero-Shot Language-based Reasoning in Reinforcement Learning
par: Holk, Simon, et autres
Publié: (2024) -
DecisionNCE: Embodied Multimodal Representations via Implicit Preference Learning
par: Li, Jianxiong, et autres
Publié: (2024) -
SceneVerse: Scaling 3D Vision-Language Learning for Grounded Scene Understanding
par: Jia, Baoxiong, et autres
Publié: (2024) -
Personalizing Reinforcement Learning from Human Feedback with Variational Preference Learning
par: Poddar, Sriyash, et autres
Publié: (2024) -
Integrating Chain-of-Thought for Multimodal Alignment: A Study on 3D Vision-Language Learning
par: Chen, Yanjun, et autres
Publié: (2025)