PhGPO: Pheromone-Guided Policy Optimization for Long-Horizon Tool Planning
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Yu, Cai, Guangfeng, Yang, Shengtian, Luo, Han, Han, Shuo, He, Xu, Li, Dong, Feng, Lei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Hierarchy-of-Groups Policy Optimization for Long-Horizon Agentic Tasks
di: He, Shuo, et al.
Pubblicazione: (2026)
di: He, Shuo, et al.
Pubblicazione: (2026)
GPO: Growing Policy Optimization for Legged Robot Locomotion and Whole-Body Control
di: Liao, Shuhao, et al.
Pubblicazione: (2026)
di: Liao, Shuhao, et al.
Pubblicazione: (2026)
Ratio-Variance Regularized Policy Optimization for Efficient LLM Fine-tuning
di: Luo, Yu, et al.
Pubblicazione: (2026)
di: Luo, Yu, et al.
Pubblicazione: (2026)
Compositional Diffusion with Guided Search for Long-Horizon Planning
di: Mishra, Utkarsh A, et al.
Pubblicazione: (2025)
di: Mishra, Utkarsh A, et al.
Pubblicazione: (2025)
Beyond Policy Optimization: A Data Curation Flywheel for Sparse-Reward Long-Horizon Planning
di: Wang, Yutong, et al.
Pubblicazione: (2025)
di: Wang, Yutong, et al.
Pubblicazione: (2025)
Long-Horizon Plan Execution in Large Tool Spaces through Entropy-Guided Branching
di: Wei, Rongzhe, et al.
Pubblicazione: (2026)
di: Wei, Rongzhe, et al.
Pubblicazione: (2026)
Reflective Planning: Vision-Language Models for Multi-Stage Long-Horizon Robotic Manipulation
di: Feng, Yunhai, et al.
Pubblicazione: (2025)
di: Feng, Yunhai, et al.
Pubblicazione: (2025)
ToolScope: An Agentic Framework for Vision-Guided and Long-Horizon Tool Use
di: Deng, Mengjie, et al.
Pubblicazione: (2025)
di: Deng, Mengjie, et al.
Pubblicazione: (2025)
VideoSeek: Long-Horizon Video Agent with Tool-Guided Seeking
di: Lin, Jingyang, et al.
Pubblicazione: (2026)
di: Lin, Jingyang, et al.
Pubblicazione: (2026)
Language-Guided Long Horizon Manipulation with LLM-based Planning and Visual Perception
di: Zhou, Changshi, et al.
Pubblicazione: (2025)
di: Zhou, Changshi, et al.
Pubblicazione: (2025)
Milestone-Guided Policy Learning for Long-Horizon Language Agents
di: Wang, Zixuan, et al.
Pubblicazione: (2026)
di: Wang, Zixuan, et al.
Pubblicazione: (2026)
MemPO: Self-Memory Policy Optimization for Long-Horizon Agents
di: Li, Ruoran, et al.
Pubblicazione: (2026)
di: Li, Ruoran, et al.
Pubblicazione: (2026)
OCR-Memory: Optical Context Retrieval for Long-Horizon Agent Memory
di: Li, Jinze, et al.
Pubblicazione: (2026)
di: Li, Jinze, et al.
Pubblicazione: (2026)
VLM-TDP: VLM-guided Trajectory-conditioned Diffusion Policy for Robust Long-Horizon Manipulation
di: Huang, Kefeng, et al.
Pubblicazione: (2025)
di: Huang, Kefeng, et al.
Pubblicazione: (2025)
Learning for Long-Horizon Planning via Neuro-Symbolic Abductive Imitation
di: Shao, Jie-Jing, et al.
Pubblicazione: (2024)
di: Shao, Jie-Jing, et al.
Pubblicazione: (2024)
NOD-TAMP: Generalizable Long-Horizon Planning with Neural Object Descriptors
di: Cheng, Shuo, et al.
Pubblicazione: (2023)
di: Cheng, Shuo, et al.
Pubblicazione: (2023)
UI-Copilot: Advancing Long-Horizon GUI Automation via Tool-Integrated Policy Optimization
di: Lu, Zhengxi, et al.
Pubblicazione: (2026)
di: Lu, Zhengxi, et al.
Pubblicazione: (2026)
EvoTool: Self-Evolving Tool-Use Policy Optimization in LLM Agents via Blame-Aware Mutation and Diversity-Aware Selection
di: Yang, Shuo, et al.
Pubblicazione: (2026)
di: Yang, Shuo, et al.
Pubblicazione: (2026)
Learning-Guided Rolling Horizon Optimization for Long-Horizon Flexible Job-Shop Scheduling
di: Li, Sirui, et al.
Pubblicazione: (2025)
di: Li, Sirui, et al.
Pubblicazione: (2025)
Beyond Entangled Planning: Task-Decoupled Planning for Long-Horizon Agents
di: Li, Yunfan, et al.
Pubblicazione: (2026)
di: Li, Yunfan, et al.
Pubblicazione: (2026)
ESCAPE: Episodic Spatial Memory and Adaptive Execution Policy for Long-Horizon Mobile Manipulation
di: Qian, Jingjing, et al.
Pubblicazione: (2026)
di: Qian, Jingjing, et al.
Pubblicazione: (2026)
Online Causal Kalman Filtering for Stable and Effective Policy Optimization
di: He, Shuo, et al.
Pubblicazione: (2026)
di: He, Shuo, et al.
Pubblicazione: (2026)
GPO-V: Jailbreak Diffusion Vision Language Model by Global Probability Optimization
di: Pan, Yu, et al.
Pubblicazione: (2026)
di: Pan, Yu, et al.
Pubblicazione: (2026)
Any House Any Task: Scalable Long-Horizon Planning for Abstract Human Tasks
di: Liu, Zhihong, et al.
Pubblicazione: (2026)
di: Liu, Zhihong, et al.
Pubblicazione: (2026)
Guiding Long-Horizon Task and Motion Planning with Vision Language Models
di: Yang, Zhutian, et al.
Pubblicazione: (2024)
di: Yang, Zhutian, et al.
Pubblicazione: (2024)
Empowering LLMs with Parameterized Skills for Adversarial Long-Horizon Planning
di: Cui, Sijia, et al.
Pubblicazione: (2025)
di: Cui, Sijia, et al.
Pubblicazione: (2025)
Entropy-Guided k-Guard Sampling for Long-Horizon Autoregressive Video Generation
di: Han, Yizhao, et al.
Pubblicazione: (2026)
di: Han, Yizhao, et al.
Pubblicazione: (2026)
On Linear Power Control Policies for Energy Harvesting Communications
di: Garmaroudi, Hafez M., et al.
Pubblicazione: (2022)
di: Garmaroudi, Hafez M., et al.
Pubblicazione: (2022)
MoMaStage: Skill-State Graph Guided Planning and Closed-Loop Execution for Long-Horizon Indoor Mobile Manipulation
di: Li, Chenxu, et al.
Pubblicazione: (2026)
di: Li, Chenxu, et al.
Pubblicazione: (2026)
STMA: A Spatio-Temporal Memory Agent for Long-Horizon Embodied Task Planning
di: Lei, Mingcong, et al.
Pubblicazione: (2025)
di: Lei, Mingcong, et al.
Pubblicazione: (2025)
GPO Monthly Catalog...Quick Reference Guide [and] ERIC...Quick Reference Guide.
di: Worrell, Diane
Pubblicazione: (1991)
di: Worrell, Diane
Pubblicazione: (1991)
The topology and isochronicity on complex Hamiltonian systems with homogeneous nonlinearities
di: Dong, Guangfeng, et al.
Pubblicazione: (2023)
di: Dong, Guangfeng, et al.
Pubblicazione: (2023)
LiLo-VLA: Compositional Long-Horizon Manipulation via Linked Object-Centric Policies
di: Yang, Yue, et al.
Pubblicazione: (2026)
di: Yang, Yue, et al.
Pubblicazione: (2026)
Strict Subgoal Execution: Reliable Long-Horizon Planning in Hierarchical Reinforcement Learning
di: Hwang, Jaebak, et al.
Pubblicazione: (2025)
di: Hwang, Jaebak, et al.
Pubblicazione: (2025)
Structured Preference Optimization for Vision-Language Long-Horizon Task Planning
di: Liang, Xiwen, et al.
Pubblicazione: (2025)
di: Liang, Xiwen, et al.
Pubblicazione: (2025)
Refining Compositional Diffusion for Reliable Long-Horizon Planning
di: Lee, Kyowoon, et al.
Pubblicazione: (2026)
di: Lee, Kyowoon, et al.
Pubblicazione: (2026)
DeepPlanning: Benchmarking Long-Horizon Agentic Planning with Verifiable Constraints
di: Zhang, Yinger, et al.
Pubblicazione: (2026)
di: Zhang, Yinger, et al.
Pubblicazione: (2026)
In-the-Flow Agentic System Optimization for Effective Planning and Tool Use
di: Li, Zhuofeng, et al.
Pubblicazione: (2025)
di: Li, Zhuofeng, et al.
Pubblicazione: (2025)
ToolTree: Efficient LLM Agent Tool Planning via Dual-Feedback Monte Carlo Tree Search and Bidirectional Pruning
di: Yang, Shuo, et al.
Pubblicazione: (2026)
di: Yang, Shuo, et al.
Pubblicazione: (2026)
Prometheus: Towards Long-Horizon Codebase Navigation for Repository-Level Problem Solving
di: Pan, Yue, et al.
Pubblicazione: (2025)
di: Pan, Yue, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Hierarchy-of-Groups Policy Optimization for Long-Horizon Agentic Tasks
di: He, Shuo, et al.
Pubblicazione: (2026) -
GPO: Growing Policy Optimization for Legged Robot Locomotion and Whole-Body Control
di: Liao, Shuhao, et al.
Pubblicazione: (2026) -
Ratio-Variance Regularized Policy Optimization for Efficient LLM Fine-tuning
di: Luo, Yu, et al.
Pubblicazione: (2026) -
Compositional Diffusion with Guided Search for Long-Horizon Planning
di: Mishra, Utkarsh A, et al.
Pubblicazione: (2025) -
Beyond Policy Optimization: A Data Curation Flywheel for Sparse-Reward Long-Horizon Planning
di: Wang, Yutong, et al.
Pubblicazione: (2025)