Expanding LLM Agent Boundaries with Strategy-Guided Exploration
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Szot, Andrew, Kirchhof, Michael, Attia, Omar, Toshev, Alexander |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
From Multimodal LLMs to Generalist Embodied Agents: Methods and Lessons
par: Szot, Andrew, et autres
Publié: (2024)
par: Szot, Andrew, et autres
Publié: (2024)
Grounding Multimodal Large Language Models in Actions
par: Szot, Andrew, et autres
Publié: (2024)
par: Szot, Andrew, et autres
Publié: (2024)
GRACE: A Language Model Framework for Explainable Inverse Reinforcement Learning
par: Sapora, Silvia, et autres
Publié: (2025)
par: Sapora, Silvia, et autres
Publié: (2025)
Scaling Synthetic Task Generation for Agents via Exploration
par: Ramrakhya, Ram, et autres
Publié: (2025)
par: Ramrakhya, Ram, et autres
Publié: (2025)
Large Language Models as Generalizable Policies for Embodied Tasks
par: Szot, Andrew, et autres
Publié: (2023)
par: Szot, Andrew, et autres
Publié: (2023)
Uncertainties of Latent Representations in Computer Vision
par: Kirchhof, Michael
Publié: (2024)
par: Kirchhof, Michael
Publié: (2024)
Position: Uncertainty Quantification Needs Reassessment for Large-language Model Agents
par: Kirchhof, Michael, et autres
Publié: (2025)
par: Kirchhof, Michael, et autres
Publié: (2025)
Does RL Expand the Capability Boundary of LLM Agents? A PASS@(k,T) Analysis
par: Zhai, Zhiyuan, et autres
Publié: (2026)
par: Zhai, Zhiyuan, et autres
Publié: (2026)
Benchmarking Uncertainty Disentanglement: Specialized Uncertainties for Specialized Tasks
par: Mucsányi, Bálint, et autres
Publié: (2024)
par: Mucsányi, Bálint, et autres
Publié: (2024)
Ferret-UI Lite: Lessons from Building Small On-Device GUI Agents
par: Yang, Zhen, et autres
Publié: (2025)
par: Yang, Zhen, et autres
Publié: (2025)
Navigate the Unknown: Enhancing LLM Reasoning with Intrinsic Motivation Guided Exploration
par: Gao, Jingtong, et autres
Publié: (2025)
par: Gao, Jingtong, et autres
Publié: (2025)
Accurate and Diverse LLM Mathematical Reasoning via Automated PRM-Guided GFlowNets
par: Younsi, Adam, et autres
Publié: (2025)
par: Younsi, Adam, et autres
Publié: (2025)
ReLIC: A Recipe for 64k Steps of In-Context Reinforcement Learning for Embodied AI
par: Elawady, Ahmad, et autres
Publié: (2024)
par: Elawady, Ahmad, et autres
Publié: (2024)
Guiding Exploration in Reinforcement Learning Through LLM-Augmented Observations
par: Jain, Vaibhav, et autres
Publié: (2025)
par: Jain, Vaibhav, et autres
Publié: (2025)
Can LLMs Guide Their Own Exploration? Gradient-Guided Reinforcement Learning for LLM Reasoning
par: Liang, Zhenwen, et autres
Publié: (2025)
par: Liang, Zhenwen, et autres
Publié: (2025)
NonZero: Interaction-Guided Exploration for Multi-Agent Monte Carlo Tree Search
par: Tang, Sizhe, et autres
Publié: (2026)
par: Tang, Sizhe, et autres
Publié: (2026)
Boundary Exploration for Bayesian Optimization With Unknown Physical Constraints
par: Tian, Yunsheng, et autres
Publié: (2024)
par: Tian, Yunsheng, et autres
Publié: (2024)
APEX: Autonomous Policy Exploration for Self-Evolving LLM Agents
par: Li, Yibo, et autres
Publié: (2026)
par: Li, Yibo, et autres
Publié: (2026)
Reinforcement Learning via Auxiliary Task Distillation
par: Harish, Abhinav Narayan, et autres
Publié: (2024)
par: Harish, Abhinav Narayan, et autres
Publié: (2024)
Pretrained Visual Uncertainties
par: Kirchhof, Michael, et autres
Publié: (2024)
par: Kirchhof, Michael, et autres
Publié: (2024)
KEA: Keeping Exploration Alive by Proactively Coordinating Exploration Strategies
par: Yang, Shih-Min, et autres
Publié: (2025)
par: Yang, Shih-Min, et autres
Publié: (2025)
BrokenBind: Universal Modality Exploration beyond Dataset Boundaries
par: Huang, Zhuo, et autres
Publié: (2026)
par: Huang, Zhuo, et autres
Publié: (2026)
BED-LLM: Intelligent Information Gathering with LLMs and Bayesian Experimental Design
par: Choudhury, Deepro, et autres
Publié: (2025)
par: Choudhury, Deepro, et autres
Publié: (2025)
Pretraining with hierarchical memories: separating long-tail and common knowledge
par: Pouransari, Hadi, et autres
Publié: (2025)
par: Pouransari, Hadi, et autres
Publié: (2025)
Decoupling Exploration and Policy Optimization: Uncertainty Guided Tree Search for Hard Exploration
par: Mhammedi, Zakaria, et autres
Publié: (2026)
par: Mhammedi, Zakaria, et autres
Publié: (2026)
STEVE-Audio: Expanding the Goal Conditioning Modalities of Embodied Agents in Minecraft
par: Lenzen, Nicholas, et autres
Publié: (2024)
par: Lenzen, Nicholas, et autres
Publié: (2024)
Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents
par: Song, Yifan, et autres
Publié: (2024)
par: Song, Yifan, et autres
Publié: (2024)
Trained on Tokens, Calibrated on Concepts: The Emergence of Semantic Calibration in LLMs
par: Nakkiran, Preetum, et autres
Publié: (2025)
par: Nakkiran, Preetum, et autres
Publié: (2025)
Cerberus: Multi-Agent Reasoning and Coverage-Guided Exploration for Static Detection of Runtime Errors
par: Dhulipala, Hridya, et autres
Publié: (2025)
par: Dhulipala, Hridya, et autres
Publié: (2025)
Datasets, Documents, and Repetitions: The Practicalities of Unequal Data Quality
par: Fang, Alex, et autres
Publié: (2025)
par: Fang, Alex, et autres
Publié: (2025)
UGCE: User-Guided Incremental Counterfactual Exploration
par: Fragkathoulas, Christos, et autres
Publié: (2025)
par: Fragkathoulas, Christos, et autres
Publié: (2025)
Preference-Guided Reinforcement Learning for Efficient Exploration
par: Wang, Guojian, et autres
Publié: (2024)
par: Wang, Guojian, et autres
Publié: (2024)
Meta-RL Induces Exploration in Language Agents
par: Jiang, Yulun, et autres
Publié: (2025)
par: Jiang, Yulun, et autres
Publié: (2025)
UltraCUA: A Foundation Model for Computer Use Agents with Hybrid Action
par: Yang, Yuhao, et autres
Publié: (2025)
par: Yang, Yuhao, et autres
Publié: (2025)
Nudging the Boundaries of LLM Reasoning
par: Chen, Justin Chih-Yao, et autres
Publié: (2025)
par: Chen, Justin Chih-Yao, et autres
Publié: (2025)
Neural SPH: Improved Neural Modeling of Lagrangian Fluid Dynamics
par: Toshev, Artur P., et autres
Publié: (2024)
par: Toshev, Artur P., et autres
Publié: (2024)
Learning Rate Annealing Improves Tuning Robustness in Stochastic Optimization
par: Attia, Amit, et autres
Publié: (2025)
par: Attia, Amit, et autres
Publié: (2025)
How Free is Parameter-Free Stochastic Optimization?
par: Attia, Amit, et autres
Publié: (2024)
par: Attia, Amit, et autres
Publié: (2024)
Towards Mitigation of Hallucination for LLM-empowered Agents: Progressive Generalization Bound Exploration and Watchdog Monitor
par: Liu, Siyuan, et autres
Publié: (2025)
par: Liu, Siyuan, et autres
Publié: (2025)
Reinforcement Learning by Guided Safe Exploration
par: Yang, Qisong, et autres
Publié: (2023)
par: Yang, Qisong, et autres
Publié: (2023)
Documents similaires
-
From Multimodal LLMs to Generalist Embodied Agents: Methods and Lessons
par: Szot, Andrew, et autres
Publié: (2024) -
Grounding Multimodal Large Language Models in Actions
par: Szot, Andrew, et autres
Publié: (2024) -
GRACE: A Language Model Framework for Explainable Inverse Reinforcement Learning
par: Sapora, Silvia, et autres
Publié: (2025) -
Scaling Synthetic Task Generation for Agents via Exploration
par: Ramrakhya, Ram, et autres
Publié: (2025) -
Large Language Models as Generalizable Policies for Embodied Tasks
par: Szot, Andrew, et autres
Publié: (2023)