Advancing Autonomous VLM Agents via Variational Subgoal-Conditioned Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wu, Qingyuan, Liu, Jianheng, Hao, Jianye, Wang, Jun, Shao, Kun |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
DistRL: An Asynchronous Distributed Reinforcement Learning Framework for On-Device Control Agents
von: Wang, Taiyi, et al.
Veröffentlicht: (2024)
von: Wang, Taiyi, et al.
Veröffentlicht: (2024)
Probabilistic Subgoal Representations for Hierarchical Reinforcement learning
von: Wang, Vivienne Huiling, et al.
Veröffentlicht: (2024)
von: Wang, Vivienne Huiling, et al.
Veröffentlicht: (2024)
Subgoal-based Reward Shaping to Improve Efficiency in Reinforcement Learning
von: Okudo, Takato, et al.
Veröffentlicht: (2021)
von: Okudo, Takato, et al.
Veröffentlicht: (2021)
Transfer Reinforcement Learning in Heterogeneous Action Spaces using Subgoal Mapping
von: Sivakumar, Kavinayan P., et al.
Veröffentlicht: (2024)
von: Sivakumar, Kavinayan P., et al.
Veröffentlicht: (2024)
MODULI: Unlocking Preference Generalization via Diffusion Models for Offline Multi-Objective Reinforcement Learning
von: Yuan, Yifu, et al.
Veröffentlicht: (2024)
von: Yuan, Yifu, et al.
Veröffentlicht: (2024)
Strict Subgoal Execution: Reliable Long-Horizon Planning in Hierarchical Reinforcement Learning
von: Hwang, Jaebak, et al.
Veröffentlicht: (2025)
von: Hwang, Jaebak, et al.
Veröffentlicht: (2025)
Subgoal Graph-Augmented Planning for LLM-Guided Open-World Reinforcement Learning
von: Fan, Shanwei, et al.
Veröffentlicht: (2025)
von: Fan, Shanwei, et al.
Veröffentlicht: (2025)
Towards Efficient Online Tuning of VLM Agents via Counterfactual Soft Reinforcement Learning
von: Feng, Lang, et al.
Veröffentlicht: (2025)
von: Feng, Lang, et al.
Veröffentlicht: (2025)
Learning Hidden Subgoals under Temporal Ordering Constraints in Reinforcement Learning
von: Xu, Duo, et al.
Veröffentlicht: (2024)
von: Xu, Duo, et al.
Veröffentlicht: (2024)
Teaching RL Agents to Act Better: VLM as Action Advisor for Online Reinforcement Learning
von: Wu, Xiefeng, et al.
Veröffentlicht: (2025)
von: Wu, Xiefeng, et al.
Veröffentlicht: (2025)
Subgoal Search For Complex Reasoning Tasks
von: Czechowski, Konrad, et al.
Veröffentlicht: (2021)
von: Czechowski, Konrad, et al.
Veröffentlicht: (2021)
Beyond Syntax: Action Semantics Learning for App Agents
von: Tang, Bohan, et al.
Veröffentlicht: (2025)
von: Tang, Bohan, et al.
Veröffentlicht: (2025)
Highway Reinforcement Learning
von: Wang, Yuhui, et al.
Veröffentlicht: (2024)
von: Wang, Yuhui, et al.
Veröffentlicht: (2024)
Goal-Space Planning with Subgoal Models
von: Lo, Chunlok, et al.
Veröffentlicht: (2022)
von: Lo, Chunlok, et al.
Veröffentlicht: (2022)
SubgoalXL: Subgoal-based Expert Learning for Theorem Proving
von: Zhao, Xueliang, et al.
Veröffentlicht: (2024)
von: Zhao, Xueliang, et al.
Veröffentlicht: (2024)
A Subgoal-driven Framework for Improving Long-Horizon LLM Agents
von: Wang, Taiyi, et al.
Veröffentlicht: (2026)
von: Wang, Taiyi, et al.
Veröffentlicht: (2026)
Agent Q: Advanced Reasoning and Learning for Autonomous AI Agents
von: Putta, Pranav, et al.
Veröffentlicht: (2024)
von: Putta, Pranav, et al.
Veröffentlicht: (2024)
Research on Autonomous Robots Navigation based on Reinforcement Learning
von: Wang, Zixiang, et al.
Veröffentlicht: (2024)
von: Wang, Zixiang, et al.
Veröffentlicht: (2024)
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
von: Bai, Chenjia, et al.
Veröffentlicht: (2024)
von: Bai, Chenjia, et al.
Veröffentlicht: (2024)
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
von: Zhao, Kai, et al.
Veröffentlicht: (2023)
von: Zhao, Kai, et al.
Veröffentlicht: (2023)
Prioritized Trajectory Replay: A Replay Memory for Data-driven Reinforcement Learning
von: Liu, Jinyi, et al.
Veröffentlicht: (2023)
von: Liu, Jinyi, et al.
Veröffentlicht: (2023)
AppVLM: A Lightweight Vision Language Model for Online App Control
von: Papoudakis, Georgios, et al.
Veröffentlicht: (2025)
von: Papoudakis, Georgios, et al.
Veröffentlicht: (2025)
DynaSearcher: Dynamic Knowledge Graph Augmented Search Agent via Multi-Reward Reinforcement Learning
von: Hao, Chuzhan, et al.
Veröffentlicht: (2025)
von: Hao, Chuzhan, et al.
Veröffentlicht: (2025)
SheetAgent: Towards A Generalist Agent for Spreadsheet Reasoning and Manipulation via Large Language Models
von: Chen, Yibin, et al.
Veröffentlicht: (2024)
von: Chen, Yibin, et al.
Veröffentlicht: (2024)
Towards Safe Reinforcement Learning via Constraining Conditional Value-at-Risk
von: Ying, Chengyang, et al.
Veröffentlicht: (2022)
von: Ying, Chengyang, et al.
Veröffentlicht: (2022)
Protein-Conditioned Multi-Objective Reinforcement Learning for Full-Length mRNA Design
von: Shao, Zixi, et al.
Veröffentlicht: (2026)
von: Shao, Zixi, et al.
Veröffentlicht: (2026)
MENTOR: Guiding Hierarchical Reinforcement Learning with Human Feedback and Dynamic Distance Constraint
von: Zhou, Xinglin, et al.
Veröffentlicht: (2024)
von: Zhou, Xinglin, et al.
Veröffentlicht: (2024)
Goal Exploration via Adaptive Skill Distribution for Goal-Conditioned Reinforcement Learning
von: Wu, Lisheng, et al.
Veröffentlicht: (2024)
von: Wu, Lisheng, et al.
Veröffentlicht: (2024)
ML-Agent: Reinforcing LLM Agents for Autonomous Machine Learning Engineering
von: Liu, Zexi, et al.
Veröffentlicht: (2025)
von: Liu, Zexi, et al.
Veröffentlicht: (2025)
Kolb-Based Experiential Learning for Generalist Agents with Human-Level Kaggle Data Science Performance
von: Grosnit, Antoine, et al.
Veröffentlicht: (2024)
von: Grosnit, Antoine, et al.
Veröffentlicht: (2024)
Enhancing Inverse Reinforcement Learning through Encoding Dynamic Information in Reward Shaping
von: Zhan, Simon Sinong, et al.
Veröffentlicht: (2024)
von: Zhan, Simon Sinong, et al.
Veröffentlicht: (2024)
LiteGUI: Distilling Compact GUI Agents with Reinforcement Learning
von: Wu, Yubin, et al.
Veröffentlicht: (2026)
von: Wu, Yubin, et al.
Veröffentlicht: (2026)
Belief-Based Offline Reinforcement Learning for Delay-Robust Policy Optimization
von: Zhan, Simon Sinong, et al.
Veröffentlicht: (2025)
von: Zhan, Simon Sinong, et al.
Veröffentlicht: (2025)
GROW: Aligning GRPO with State-Action Modeling for Open-World VLM Agents
von: Wu, Xiongbin, et al.
Veröffentlicht: (2026)
von: Wu, Xiongbin, et al.
Veröffentlicht: (2026)
KARL: Knowledge Agents via Reinforcement Learning
von: Chang, Jonathan D., et al.
Veröffentlicht: (2026)
von: Chang, Jonathan D., et al.
Veröffentlicht: (2026)
Learning Dynamics of VLM Finetuning
von: Zhang, Jusheng, et al.
Veröffentlicht: (2025)
von: Zhang, Jusheng, et al.
Veröffentlicht: (2025)
Subgoal Discovery Using a Free Energy Paradigm and State Aggregations
von: Mesbah, Amirhossein, et al.
Veröffentlicht: (2024)
von: Mesbah, Amirhossein, et al.
Veröffentlicht: (2024)
Variational Delayed Policy Optimization
von: Wu, Qingyuan, et al.
Veröffentlicht: (2024)
von: Wu, Qingyuan, et al.
Veröffentlicht: (2024)
Offline Multi-Agent Reinforcement Learning via In-Sample Sequential Policy Optimization
von: Liu, Zongkai, et al.
Veröffentlicht: (2024)
von: Liu, Zongkai, et al.
Veröffentlicht: (2024)
PMAT: Optimizing Action Generation Order in Multi-Agent Reinforcement Learning
von: Hu, Kun, et al.
Veröffentlicht: (2025)
von: Hu, Kun, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
DistRL: An Asynchronous Distributed Reinforcement Learning Framework for On-Device Control Agents
von: Wang, Taiyi, et al.
Veröffentlicht: (2024) -
Probabilistic Subgoal Representations for Hierarchical Reinforcement learning
von: Wang, Vivienne Huiling, et al.
Veröffentlicht: (2024) -
Subgoal-based Reward Shaping to Improve Efficiency in Reinforcement Learning
von: Okudo, Takato, et al.
Veröffentlicht: (2021) -
Transfer Reinforcement Learning in Heterogeneous Action Spaces using Subgoal Mapping
von: Sivakumar, Kavinayan P., et al.
Veröffentlicht: (2024) -
MODULI: Unlocking Preference Generalization via Diffusion Models for Offline Multi-Objective Reinforcement Learning
von: Yuan, Yifu, et al.
Veröffentlicht: (2024)