Empowering LLMs with Parameterized Skills for Adversarial Long-Horizon Planning
Fuente:
arXiv
Salvato in:
| Autori principali: | Cui, Sijia, Xu, Shuai, He, Aiyao, Wang, Yanna, Xu, Bo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TUMS: Enhancing Tool-use Abilities of LLMs with Multi-structure Handlers
di: He, Aiyao, et al.
Pubblicazione: (2025)
di: He, Aiyao, et al.
Pubblicazione: (2025)
Self-Guided Function Calling in Large Language Models via Stepwise Experience Recall
di: Cui, Sijia, et al.
Pubblicazione: (2025)
di: Cui, Sijia, et al.
Pubblicazione: (2025)
EcoGym: Evaluating LLMs for Long-Horizon Plan-and-Execute in Interactive Economies
di: Hu, Xavier, et al.
Pubblicazione: (2026)
di: Hu, Xavier, et al.
Pubblicazione: (2026)
Strategy-Augmented Planning for Large Language Models via Opponent Exploitation
di: Xu, Shuai, et al.
Pubblicazione: (2025)
di: Xu, Shuai, et al.
Pubblicazione: (2025)
FLAME: Empowering Frozen LLMs for Knowledge Graph Completion
di: Xue, Bo, et al.
Pubblicazione: (2024)
di: Xue, Bo, et al.
Pubblicazione: (2024)
The Cognitive Bandwidth Bottleneck: Shifting Long-Horizon Agent from Planning with Actions to Planning with Schemas
di: Xu, Baixuan, et al.
Pubblicazione: (2025)
di: Xu, Baixuan, et al.
Pubblicazione: (2025)
Plan-and-Act: Improving Planning of Agents for Long-Horizon Tasks
di: Erdogan, Lutfi Eren, et al.
Pubblicazione: (2025)
di: Erdogan, Lutfi Eren, et al.
Pubblicazione: (2025)
KG-Hopper: Empowering Compact Open LLMs with Knowledge Graph Reasoning via Reinforcement Learning
di: Wang, Shuai, et al.
Pubblicazione: (2026)
di: Wang, Shuai, et al.
Pubblicazione: (2026)
CARES: Comprehensive Evaluation of Safety and Adversarial Robustness in Medical LLMs
di: Chen, Sijia, et al.
Pubblicazione: (2025)
di: Chen, Sijia, et al.
Pubblicazione: (2025)
Structured Preference Optimization for Vision-Language Long-Horizon Task Planning
di: Liang, Xiwen, et al.
Pubblicazione: (2025)
di: Liang, Xiwen, et al.
Pubblicazione: (2025)
DeepPlanning: Benchmarking Long-Horizon Agentic Planning with Verifiable Constraints
di: Zhang, Yinger, et al.
Pubblicazione: (2026)
di: Zhang, Yinger, et al.
Pubblicazione: (2026)
Can RL Teach Long-Horizon Reasoning to LLMs? Expressiveness Is Key
di: Wang, Tianle, et al.
Pubblicazione: (2026)
di: Wang, Tianle, et al.
Pubblicazione: (2026)
Homogeneous Keys, Heterogeneous Values: Exploiting Local KV Cache Asymmetry for Long-Context LLMs
di: Cui, Wanyun, et al.
Pubblicazione: (2025)
di: Cui, Wanyun, et al.
Pubblicazione: (2025)
Optimus-1: Hybrid Multimodal Memory Empowered Agents Excel in Long-Horizon Tasks
di: Li, Zaijing, et al.
Pubblicazione: (2024)
di: Li, Zaijing, et al.
Pubblicazione: (2024)
WebAnchor: Anchoring Agent Planning to Stabilize Long-Horizon Web Reasoning
di: Yu, Xinmiao, et al.
Pubblicazione: (2026)
di: Yu, Xinmiao, et al.
Pubblicazione: (2026)
Planning Transformer: Long-Horizon Offline Reinforcement Learning with Planning Tokens
di: Clinton, Joseph, et al.
Pubblicazione: (2024)
di: Clinton, Joseph, et al.
Pubblicazione: (2024)
Fine-Mem: Fine-Grained Feedback Alignment for Long-Horizon Memory Management
di: Ma, Weitao, et al.
Pubblicazione: (2026)
di: Ma, Weitao, et al.
Pubblicazione: (2026)
Connecting the Dots: Benchmarking Reflective Memory in Long-Horizon Dialogue
di: Lin, Jingjie, et al.
Pubblicazione: (2026)
di: Lin, Jingjie, et al.
Pubblicazione: (2026)
StructMem: Structured Memory for Long-Horizon Behavior in LLMs
di: Xu, Buqiang, et al.
Pubblicazione: (2026)
di: Xu, Buqiang, et al.
Pubblicazione: (2026)
OdysseyBench: Evaluating LLM Agents on Long-Horizon Complex Office Application Workflows
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
Iterative Deployment Improves Planning Skills in LLMs
di: Corrêa, Augusto B., et al.
Pubblicazione: (2025)
di: Corrêa, Augusto B., et al.
Pubblicazione: (2025)
WebExplorer: Explore and Evolve for Training Long-Horizon Web Agents
di: Liu, Junteng, et al.
Pubblicazione: (2025)
di: Liu, Junteng, et al.
Pubblicazione: (2025)
UltraHorizon: Benchmarking Agent Capabilities in Ultra Long-Horizon Scenarios
di: Luo, Haotian, et al.
Pubblicazione: (2025)
di: Luo, Haotian, et al.
Pubblicazione: (2025)
FS-Researcher: Test-Time Scaling for Long-Horizon Research Tasks with File-System-Based Agents
di: Zhu, Chiwei, et al.
Pubblicazione: (2026)
di: Zhu, Chiwei, et al.
Pubblicazione: (2026)
Table-as-Search: Formulate Long-Horizon Agentic Information Seeking as Table Completion
di: Lan, Tian, et al.
Pubblicazione: (2026)
di: Lan, Tian, et al.
Pubblicazione: (2026)
FraudShield: Knowledge Graph Empowered Defense for LLMs against Fraud Attacks
di: Xu, Naen, et al.
Pubblicazione: (2026)
di: Xu, Naen, et al.
Pubblicazione: (2026)
EvoSpark: Endogenous Interactive Agent Societies for Unified Long-Horizon Narrative Evolution
di: He, Shiyu, et al.
Pubblicazione: (2026)
di: He, Shiyu, et al.
Pubblicazione: (2026)
Implicit Strategic Optimization: Rethinking Long-Horizon Decision-Making in Adversarial Poker Environments
di: Xia, Boyang, et al.
Pubblicazione: (2026)
di: Xia, Boyang, et al.
Pubblicazione: (2026)
LH-Deception: Simulating and Understanding LLM Deceptive Behaviors in Long-Horizon Interactions
di: Xu, Yang, et al.
Pubblicazione: (2025)
di: Xu, Yang, et al.
Pubblicazione: (2025)
OCR-Memory: Optical Context Retrieval for Long-Horizon Agent Memory
di: Li, Jinze, et al.
Pubblicazione: (2026)
di: Li, Jinze, et al.
Pubblicazione: (2026)
Context as a Tool: Context Management for Long-Horizon SWE-Agents
di: Liu, Shukai, et al.
Pubblicazione: (2025)
di: Liu, Shukai, et al.
Pubblicazione: (2025)
Search More, Think Less: Rethinking Long-Horizon Agentic Search for Efficiency and Generalization
di: Chen, Qianben, et al.
Pubblicazione: (2026)
di: Chen, Qianben, et al.
Pubblicazione: (2026)
MGM-Omni: Scaling Omni LLMs to Personalized Long-Horizon Speech
di: Wang, Chengyao, et al.
Pubblicazione: (2025)
di: Wang, Chengyao, et al.
Pubblicazione: (2025)
ReSum: Unlocking Long-Horizon Search Intelligence via Context Summarization
di: Wu, Xixi, et al.
Pubblicazione: (2025)
di: Wu, Xixi, et al.
Pubblicazione: (2025)
Why Reasoning Fails to Plan: A Planning-Centric Analysis of Long-Horizon Decision Making in LLM Agents
di: Wang, Zehong, et al.
Pubblicazione: (2026)
di: Wang, Zehong, et al.
Pubblicazione: (2026)
Beyond Ten Turns: Unlocking Long-Horizon Agentic Search with Large-Scale Asynchronous RL
di: Gao, Jiaxuan, et al.
Pubblicazione: (2025)
di: Gao, Jiaxuan, et al.
Pubblicazione: (2025)
HiMAP-Travel: Hierarchical Multi-Agent Planning for Long-Horizon Constrained Travel
di: Bui, The Viet, et al.
Pubblicazione: (2026)
di: Bui, The Viet, et al.
Pubblicazione: (2026)
Long-Horizon Plan Execution in Large Tool Spaces through Entropy-Guided Branching
di: Wei, Rongzhe, et al.
Pubblicazione: (2026)
di: Wei, Rongzhe, et al.
Pubblicazione: (2026)
Gavel: Agent Meets Checklist for Evaluating LLMs on Long-Context Legal Summarization
di: Dou, Yao, et al.
Pubblicazione: (2026)
di: Dou, Yao, et al.
Pubblicazione: (2026)
STReasoner: Empowering LLMs for Spatio-Temporal Reasoning in Time Series via Spatial-Aware Reinforcement Learning
di: Ni, Juntong, et al.
Pubblicazione: (2026)
di: Ni, Juntong, et al.
Pubblicazione: (2026)
Documenti analoghi
-
TUMS: Enhancing Tool-use Abilities of LLMs with Multi-structure Handlers
di: He, Aiyao, et al.
Pubblicazione: (2025) -
Self-Guided Function Calling in Large Language Models via Stepwise Experience Recall
di: Cui, Sijia, et al.
Pubblicazione: (2025) -
EcoGym: Evaluating LLMs for Long-Horizon Plan-and-Execute in Interactive Economies
di: Hu, Xavier, et al.
Pubblicazione: (2026) -
Strategy-Augmented Planning for Large Language Models via Opponent Exploitation
di: Xu, Shuai, et al.
Pubblicazione: (2025) -
FLAME: Empowering Frozen LLMs for Knowledge Graph Completion
di: Xue, Bo, et al.
Pubblicazione: (2024)