Towards Automated Semantic Interpretability in Reinforcement Learning via Vision-Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Zhaoxin, Xi-Jia, Zhang, Altundas, Batuhan, Chen, Letian, Paleja, Rohan, Gombolay, Matthew |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Towards Learning Scalable Agile Dynamic Motion Planning for Robosoccer Teams with Policy Optimization
by: Ho, Brandon, et al.
Published: (2025)
by: Ho, Brandon, et al.
Published: (2025)
Improvement of Optimization using Learning Based Models in Mixed Integer Linear Programming Tasks
by: Wang, Xiaoke, et al.
Published: (2025)
by: Wang, Xiaoke, et al.
Published: (2025)
Interactive Distillation for Cooperative Multi-Agent Reinforcement Learning
by: Cho, Minwoo, et al.
Published: (2026)
by: Cho, Minwoo, et al.
Published: (2026)
Fast Lifelong Adaptive Inverse Reinforcement Learning from Demonstrations
by: Chen, Letian, et al.
Published: (2022)
by: Chen, Letian, et al.
Published: (2022)
Faster Model Predictive Control via Self-Supervised Initialization Learning
by: Li, Zhaoxin, et al.
Published: (2024)
by: Li, Zhaoxin, et al.
Published: (2024)
ELEMENTAL: Interactive Learning from Demonstrations and Vision-Language Models for Reward Design in Robotics
by: Chen, Letian, et al.
Published: (2024)
by: Chen, Letian, et al.
Published: (2024)
Differentiable Belief-based Opponent Shaping
by: Sane, Aarav G, et al.
Published: (2026)
by: Sane, Aarav G, et al.
Published: (2026)
Event-Grounded Sparse Autoencoders for Vision-Language-Action Policies
by: Jin, Xinchen, et al.
Published: (2026)
by: Jin, Xinchen, et al.
Published: (2026)
Beyond Partner Diversity: An Influence-Based Team Steering Framework for Zero-Shot Human-Machine Teaming
by: Sheng, Wei, et al.
Published: (2026)
by: Sheng, Wei, et al.
Published: (2026)
Towards Interpretable Deep Reinforcement Learning Models via Inverse Reinforcement Learning
by: Xie, Sean, et al.
Published: (2022)
by: Xie, Sean, et al.
Published: (2022)
Learning to Inject: Automated Prompt Injection via Reinforcement Learning
by: Chen, Xin, et al.
Published: (2026)
by: Chen, Xin, et al.
Published: (2026)
On the Statistical Efficiency of Mean-Field Reinforcement Learning with General Function Approximation
by: Huang, Jiawei, et al.
Published: (2023)
by: Huang, Jiawei, et al.
Published: (2023)
Reward Generation via Large Vision-Language Model in Offline Reinforcement Learning
by: Lee, Younghwan, et al.
Published: (2025)
by: Lee, Younghwan, et al.
Published: (2025)
VisionThink: Smart and Efficient Vision Language Model via Reinforcement Learning
by: Yang, Senqiao, et al.
Published: (2025)
by: Yang, Senqiao, et al.
Published: (2025)
Private Attribute Inference from Images with Vision-Language Models
by: Tömekçe, Batuhan, et al.
Published: (2024)
by: Tömekçe, Batuhan, et al.
Published: (2024)
Learning Molecular Chirality via Chiral Determinant Kernels
by: Shi, Runhan, et al.
Published: (2026)
by: Shi, Runhan, et al.
Published: (2026)
Towards Interpretable Reinforcement Learning with Constrained Normalizing Flow Policies
by: Rietz, Finn, et al.
Published: (2024)
by: Rietz, Finn, et al.
Published: (2024)
VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning
by: Wang, Haozhe, et al.
Published: (2025)
by: Wang, Haozhe, et al.
Published: (2025)
Vision-Language Models are Zero-Shot Reward Models for Reinforcement Learning
by: Rocamonde, Juan, et al.
Published: (2023)
by: Rocamonde, Juan, et al.
Published: (2023)
DISPO: Enhancing Training Efficiency and Stability in Reinforcement Learning for Large Language Model Mathematical Reasoning
by: Karaman, Batuhan K., et al.
Published: (2026)
by: Karaman, Batuhan K., et al.
Published: (2026)
CPGD: Toward Stable Rule-based Reinforcement Learning for Language Models
by: Liu, Zongkai, et al.
Published: (2025)
by: Liu, Zongkai, et al.
Published: (2025)
ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization
by: Yang, Letian, et al.
Published: (2026)
by: Yang, Letian, et al.
Published: (2026)
Automated Reinforcement Learning: An Overview
by: Afshar, Reza Refaei, et al.
Published: (2022)
by: Afshar, Reza Refaei, et al.
Published: (2022)
Fine-tuning Large Language Model for Automated Algorithm Design
by: Liu, Fei, et al.
Published: (2025)
by: Liu, Fei, et al.
Published: (2025)
Efficient Reinforcement Learning for Large Language Models with Intrinsic Exploration
by: Sun, Yan, et al.
Published: (2025)
by: Sun, Yan, et al.
Published: (2025)
Group Fairness in Multi-Task Reinforcement Learning
by: Song, Kefan, et al.
Published: (2025)
by: Song, Kefan, et al.
Published: (2025)
Why Would You Suggest That? Human Trust in Language Model Responses
by: Sharma, Manasi, et al.
Published: (2024)
by: Sharma, Manasi, et al.
Published: (2024)
Interpretable Physics Reasoning and Performance Taxonomy in Vision-Language Models
by: Pawar, Pranav, et al.
Published: (2025)
by: Pawar, Pranav, et al.
Published: (2025)
The Interpretability of Codebooks in Model-Based Reinforcement Learning is Limited
by: Eaton, Kenneth, et al.
Published: (2024)
by: Eaton, Kenneth, et al.
Published: (2024)
Interpreting Emergent Planning in Model-Free Reinforcement Learning
by: Bush, Thomas, et al.
Published: (2025)
by: Bush, Thomas, et al.
Published: (2025)
Teaching Language Models to Critique via Reinforcement Learning
by: Xie, Zhihui, et al.
Published: (2025)
by: Xie, Zhihui, et al.
Published: (2025)
Heterogeneity-aware Personalized Federated Learning via Adaptive Dual-Agent Reinforcement Learning
by: Chen, Xi, et al.
Published: (2025)
by: Chen, Xi, et al.
Published: (2025)
Conformal Symplectic Optimization for Stable Reinforcement Learning
by: Lyu, Yao, et al.
Published: (2024)
by: Lyu, Yao, et al.
Published: (2024)
Towards Interpretable Deep Generative Models via Causal Representation Learning
by: Moran, Gemma E., et al.
Published: (2025)
by: Moran, Gemma E., et al.
Published: (2025)
Data-Centric Interpretability for LLM-based Multi-Agent Reinforcement Learning
by: Yan, John, et al.
Published: (2026)
by: Yan, John, et al.
Published: (2026)
ARM-FM: Automated Reward Machines via Foundation Models for Compositional Reinforcement Learning
by: Castanyer, Roger Creus, et al.
Published: (2025)
by: Castanyer, Roger Creus, et al.
Published: (2025)
dUltra: Ultra-Fast Diffusion Language Models via Reinforcement Learning
by: Chen, Shirui, et al.
Published: (2025)
by: Chen, Shirui, et al.
Published: (2025)
RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback
by: Wang, Yufei, et al.
Published: (2024)
by: Wang, Yufei, et al.
Published: (2024)
An Automated Reinforcement Learning Reward Design Framework with Large Language Model for Cooperative Platoon Coordination
by: Wei, Dixiao, et al.
Published: (2025)
by: Wei, Dixiao, et al.
Published: (2025)
Reaction Prediction via Interaction Modeling of Symmetric Difference Shingle Sets
by: Shi, Runhan, et al.
Published: (2025)
by: Shi, Runhan, et al.
Published: (2025)
Similar Items
-
Towards Learning Scalable Agile Dynamic Motion Planning for Robosoccer Teams with Policy Optimization
by: Ho, Brandon, et al.
Published: (2025) -
Improvement of Optimization using Learning Based Models in Mixed Integer Linear Programming Tasks
by: Wang, Xiaoke, et al.
Published: (2025) -
Interactive Distillation for Cooperative Multi-Agent Reinforcement Learning
by: Cho, Minwoo, et al.
Published: (2026) -
Fast Lifelong Adaptive Inverse Reinforcement Learning from Demonstrations
by: Chen, Letian, et al.
Published: (2022) -
Faster Model Predictive Control via Self-Supervised Initialization Learning
by: Li, Zhaoxin, et al.
Published: (2024)