MA-VLCM: A Vision Language Critic Model for Value Estimation of Policies in Multi-Agent Team Settings
Fuente:
arXiv
Salvato in:
| Autori principali: | Shaik, Shahil, Parameshwaran, Aditya, Nayak, Anshul, Smereka, Jonathon M., Wang, Yue |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Generalized Advantage Estimation for Distributional Policy Gradients
di: Shaik, Shahil, et al.
Pubblicazione: (2025)
di: Shaik, Shahil, et al.
Pubblicazione: (2025)
Multi-Agent Deep Reinforcement Learning Under Constrained Communications
di: Shaik, Shahil, et al.
Pubblicazione: (2026)
di: Shaik, Shahil, et al.
Pubblicazione: (2026)
Belief-Aware VLM Model for Human-like Reasoning
di: Nayak, Anshul, et al.
Pubblicazione: (2026)
di: Nayak, Anshul, et al.
Pubblicazione: (2026)
Event-Grounded Sparse Autoencoders for Vision-Language-Action Policies
di: Jin, Xinchen, et al.
Pubblicazione: (2026)
di: Jin, Xinchen, et al.
Pubblicazione: (2026)
Actor-Critic Cooperative Compensation to Model Predictive Control for Off-Road Autonomous Vehicles Under Unknown Dynamics
di: Gupta, Prakhar, et al.
Pubblicazione: (2025)
di: Gupta, Prakhar, et al.
Pubblicazione: (2025)
Red-Teaming Vision-Language-Action Models via Quality Diversity Prompt Generation for Robust Robot Policies
di: Srikanth, Siddharth, et al.
Pubblicazione: (2026)
di: Srikanth, Siddharth, et al.
Pubblicazione: (2026)
Safety Verification and Navigation for Autonomous Vehicles based on Signal Temporal Logic Constraints
di: Parameshwaran, Aditya, et al.
Pubblicazione: (2024)
di: Parameshwaran, Aditya, et al.
Pubblicazione: (2024)
V-VLAPS: Value-Guided Planning for Vision-Language-Action Models
di: Ren, Ke, et al.
Pubblicazione: (2026)
di: Ren, Ke, et al.
Pubblicazione: (2026)
Improving Value Estimation Critically Enhances Vanilla Policy Gradient
di: Wang, Tao, et al.
Pubblicazione: (2025)
di: Wang, Tao, et al.
Pubblicazione: (2025)
Vision-Language-Policy Model for Dynamic Robot Task Planning
di: Wang, Jin, et al.
Pubblicazione: (2025)
di: Wang, Jin, et al.
Pubblicazione: (2025)
Scalable and Interpretable Verification of Image-based Neural Network Controllers for Autonomous Vehicles
di: Parameshwaran, Aditya, et al.
Pubblicazione: (2025)
di: Parameshwaran, Aditya, et al.
Pubblicazione: (2025)
ALOE: Action-Level Off-Policy Evaluation for Vision-Language-Action Model Post-Training
di: Yang, Rushuai, et al.
Pubblicazione: (2026)
di: Yang, Rushuai, et al.
Pubblicazione: (2026)
WMPO: World Model-based Policy Optimization for Vision-Language-Action Models
di: Zhu, Fangqi, et al.
Pubblicazione: (2025)
di: Zhu, Fangqi, et al.
Pubblicazione: (2025)
Low-Rank Agent-Specific Adaptation (LoRASA) for Multi-Agent Policy Learning
di: Zhang, Beining, et al.
Pubblicazione: (2025)
di: Zhang, Beining, et al.
Pubblicazione: (2025)
Vision Language Models are In-Context Value Learners
di: Ma, Yecheng Jason, et al.
Pubblicazione: (2024)
di: Ma, Yecheng Jason, et al.
Pubblicazione: (2024)
A Vision-Language-Action-Critic Model for Robotic Real-World Reinforcement Learning
di: Zhai, Shaopeng, et al.
Pubblicazione: (2025)
di: Zhai, Shaopeng, et al.
Pubblicazione: (2025)
Improving Pre-Trained Vision-Language-Action Policies with Model-Based Search
di: Neary, Cyrus, et al.
Pubblicazione: (2025)
di: Neary, Cyrus, et al.
Pubblicazione: (2025)
Multi-Agent Reinforcement Learning for Unmanned Aerial Vehicle Coordination by Multi-Critic Policy Gradient Optimization
di: Alon, Yoav, et al.
Pubblicazione: (2020)
di: Alon, Yoav, et al.
Pubblicazione: (2020)
MA3DSG: Multi-Agent 3D Scene Graph Generation for Large-Scale Indoor Environments
di: Kim, Yirum, et al.
Pubblicazione: (2026)
di: Kim, Yirum, et al.
Pubblicazione: (2026)
UAV-CodeAgents: Scalable UAV Mission Planning via Multi-Agent ReAct and Vision-Language Reasoning
di: Sautenkov, Oleg, et al.
Pubblicazione: (2025)
di: Sautenkov, Oleg, et al.
Pubblicazione: (2025)
RePO-VLA: Recovery-Driven Policy Optimization for Vision-Language-Action Models
di: Liufu, Weijia, et al.
Pubblicazione: (2026)
di: Liufu, Weijia, et al.
Pubblicazione: (2026)
Multi-Agent Planning Using Visual Language Models
di: Brienza, Michele, et al.
Pubblicazione: (2024)
di: Brienza, Michele, et al.
Pubblicazione: (2024)
Temporal Logic Guided Safe Navigation for Autonomous Vehicles
di: Parameshwaran, Aditya, et al.
Pubblicazione: (2025)
di: Parameshwaran, Aditya, et al.
Pubblicazione: (2025)
Assigning Credit with Partial Reward Decoupling in Multi-Agent Proximal Policy Optimization
di: Kapoor, Aditya, et al.
Pubblicazione: (2024)
di: Kapoor, Aditya, et al.
Pubblicazione: (2024)
Cooperation and Fairness in Multi-Agent Reinforcement Learning
di: Aloor, Jasmine Jerry, et al.
Pubblicazione: (2024)
di: Aloor, Jasmine Jerry, et al.
Pubblicazione: (2024)
Large Reward Models: Generalizable Online Robot Reward Generation with Vision-Language Models
di: Wu, Yanru, et al.
Pubblicazione: (2026)
di: Wu, Yanru, et al.
Pubblicazione: (2026)
Information-Theoretic Graph Fusion with Vision-Language-Action Model for Policy Reasoning and Dual Robotic Control
di: Li, Shunlei, et al.
Pubblicazione: (2025)
di: Li, Shunlei, et al.
Pubblicazione: (2025)
Cog-GA: A Large Language Models-based Generative Agent for Vision-Language Navigation in Continuous Environments
di: Li, Zhiyuan, et al.
Pubblicazione: (2024)
di: Li, Zhiyuan, et al.
Pubblicazione: (2024)
GAgent: An Adaptive Rigid-Soft Gripping Agent with Vision Language Models for Complex Lighting Environments
di: Li, Zhuowei, et al.
Pubblicazione: (2024)
di: Li, Zhuowei, et al.
Pubblicazione: (2024)
ContextVLA: Vision-Language-Action Model with Amortized Multi-Frame Context
di: Jang, Huiwon, et al.
Pubblicazione: (2025)
di: Jang, Huiwon, et al.
Pubblicazione: (2025)
Task Success is not Enough: Investigating the Use of Video-Language Models as Behavior Critics for Catching Undesirable Agent Behaviors
di: Guan, Lin, et al.
Pubblicazione: (2024)
di: Guan, Lin, et al.
Pubblicazione: (2024)
Reflective Planning: Vision-Language Models for Multi-Stage Long-Horizon Robotic Manipulation
di: Feng, Yunhai, et al.
Pubblicazione: (2025)
di: Feng, Yunhai, et al.
Pubblicazione: (2025)
MAD-PINN: A Decentralized Physics-Informed Machine Learning Framework for Safe and Optimal Multi-Agent Control
di: Tayal, Manan, et al.
Pubblicazione: (2025)
di: Tayal, Manan, et al.
Pubblicazione: (2025)
Learning Multi-Robot Coordination through Locality-Based Factorized Multi-Agent Actor-Critic Algorithm
di: Shek, Chak Lam, et al.
Pubblicazione: (2025)
di: Shek, Chak Lam, et al.
Pubblicazione: (2025)
TGRPO :Fine-tuning Vision-Language-Action Model via Trajectory-wise Group Relative Policy Optimization
di: Chen, Zengjue, et al.
Pubblicazione: (2025)
di: Chen, Zengjue, et al.
Pubblicazione: (2025)
AT-Drone: Benchmarking Adaptive Teaming in Multi-Drone Pursuit
di: Li, Yang, et al.
Pubblicazione: (2025)
di: Li, Yang, et al.
Pubblicazione: (2025)
Adaptive Domain Modeling with Language Models: A Multi-Agent Approach to Task Planning
di: Babu, Harisankar, et al.
Pubblicazione: (2025)
di: Babu, Harisankar, et al.
Pubblicazione: (2025)
ProgressVLA: Progress-Guided Diffusion Policy for Vision-Language Robotic Manipulation
di: Yan, Hongyu, et al.
Pubblicazione: (2026)
di: Yan, Hongyu, et al.
Pubblicazione: (2026)
Robust Finetuning of Vision-Language-Action Robot Policies via Parameter Merging
di: Yadav, Yajat, et al.
Pubblicazione: (2025)
di: Yadav, Yajat, et al.
Pubblicazione: (2025)
MA-CoNav: A Master-Slave Multi-Agent Framework with Hierarchical Collaboration and Dual-Level Reflection for Long-Horizon Embodied VLN
di: Luo, Ling, et al.
Pubblicazione: (2026)
di: Luo, Ling, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Generalized Advantage Estimation for Distributional Policy Gradients
di: Shaik, Shahil, et al.
Pubblicazione: (2025) -
Multi-Agent Deep Reinforcement Learning Under Constrained Communications
di: Shaik, Shahil, et al.
Pubblicazione: (2026) -
Belief-Aware VLM Model for Human-like Reasoning
di: Nayak, Anshul, et al.
Pubblicazione: (2026) -
Event-Grounded Sparse Autoencoders for Vision-Language-Action Policies
di: Jin, Xinchen, et al.
Pubblicazione: (2026) -
Actor-Critic Cooperative Compensation to Model Predictive Control for Off-Road Autonomous Vehicles Under Unknown Dynamics
di: Gupta, Prakhar, et al.
Pubblicazione: (2025)