PLAY2PROMPT: Zero-shot Tool Instruction Optimization for LLM Agents via Tool Play
Fuente:
arXiv
Salvato in:
| Autori principali: | Fang, Wei, Zhang, Yang, Qian, Kaizhi, Glass, James, Zhu, Yada |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond Single-Shot: Multi-step Tool Retrieval via Query Planning
di: Fang, Wei, et al.
Pubblicazione: (2026)
di: Fang, Wei, et al.
Pubblicazione: (2026)
Tool-Star: Empowering LLM-Brained Multi-Tool Reasoner via Reinforcement Learning
di: Dong, Guanting, et al.
Pubblicazione: (2025)
di: Dong, Guanting, et al.
Pubblicazione: (2025)
EnvScaler: Scaling Tool-Interactive Environments for LLM Agent via Programmatic Synthesis
di: Song, Xiaoshuai, et al.
Pubblicazione: (2026)
di: Song, Xiaoshuai, et al.
Pubblicazione: (2026)
LLM Agents Making Agent Tools
di: Wölflein, Georg, et al.
Pubblicazione: (2025)
di: Wölflein, Georg, et al.
Pubblicazione: (2025)
M$^2$PT: Multimodal Prompt Tuning for Zero-shot Instruction Learning
di: Wang, Taowen, et al.
Pubblicazione: (2024)
di: Wang, Taowen, et al.
Pubblicazione: (2024)
ToolPlanner: A Tool Augmented LLM for Multi Granularity Instructions with Path Planning and Feedback
di: Wu, Qinzhuo, et al.
Pubblicazione: (2024)
di: Wu, Qinzhuo, et al.
Pubblicazione: (2024)
Divide-Then-Aggregate: An Efficient Tool Learning Method via Parallel Tool Invocation
di: Zhu, Dongsheng, et al.
Pubblicazione: (2025)
di: Zhu, Dongsheng, et al.
Pubblicazione: (2025)
SMART: Self-Aware Agent for Tool Overuse Mitigation
di: Qian, Cheng, et al.
Pubblicazione: (2025)
di: Qian, Cheng, et al.
Pubblicazione: (2025)
DiCoRe: Enhancing Zero-shot Event Detection via Divergent-Convergent LLM Reasoning
di: Parekh, Tanmay, et al.
Pubblicazione: (2025)
di: Parekh, Tanmay, et al.
Pubblicazione: (2025)
LoopTool: Closing the Data-Training Loop for Robust LLM Tool Calls
di: Zhang, Kangning, et al.
Pubblicazione: (2025)
di: Zhang, Kangning, et al.
Pubblicazione: (2025)
Incentivizing Agentic Reasoning in LLM Judges via Tool-Integrated Reinforcement Learning
di: Xu, Ran, et al.
Pubblicazione: (2025)
di: Xu, Ran, et al.
Pubblicazione: (2025)
ChemAmp: Amplified Chemistry Tools via Composable Agents
di: Li, Zhucong, et al.
Pubblicazione: (2025)
di: Li, Zhucong, et al.
Pubblicazione: (2025)
AgentMath: Empowering Mathematical Reasoning for Large Language Models via Tool-Augmented Agent
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
CreativityBench: Evaluating Agent Creative Reasoning via Affordance-Based Tool Repurposing
di: Qian, Cheng, et al.
Pubblicazione: (2026)
di: Qian, Cheng, et al.
Pubblicazione: (2026)
ToolRL: Reward is All Tool Learning Needs
di: Qian, Cheng, et al.
Pubblicazione: (2025)
di: Qian, Cheng, et al.
Pubblicazione: (2025)
A Zero-shot and Few-shot Study of Instruction-Finetuned Large Language Models Applied to Clinical and Biomedical Tasks
di: Labrak, Yanis, et al.
Pubblicazione: (2023)
di: Labrak, Yanis, et al.
Pubblicazione: (2023)
Current Agents Fail to Leverage World Model as Tool for Foresight
di: Qian, Cheng, et al.
Pubblicazione: (2026)
di: Qian, Cheng, et al.
Pubblicazione: (2026)
ToolSandbox: A Stateful, Conversational, Interactive Evaluation Benchmark for LLM Tool Use Capabilities
di: Lu, Jiarui, et al.
Pubblicazione: (2024)
di: Lu, Jiarui, et al.
Pubblicazione: (2024)
MCP-AgentBench: Evaluating Real-World Language Agent Performance with MCP-Mediated Tools
di: Guo, Zikang, et al.
Pubblicazione: (2025)
di: Guo, Zikang, et al.
Pubblicazione: (2025)
DiZiNER: Disagreement-guided Instruction Refinement via Pilot Annotation Simulation for Zero-shot Named Entity Recognition
di: Kim, Siun, et al.
Pubblicazione: (2026)
di: Kim, Siun, et al.
Pubblicazione: (2026)
Tool Unlearning for Tool-Augmented LLMs
di: Cheng, Jiali, et al.
Pubblicazione: (2025)
di: Cheng, Jiali, et al.
Pubblicazione: (2025)
An LLM-Tool Compiler for Fused Parallel Function Calling
di: Singh, Simranjit, et al.
Pubblicazione: (2024)
di: Singh, Simranjit, et al.
Pubblicazione: (2024)
ToolACE: Winning the Points of LLM Function Calling
di: Liu, Weiwen, et al.
Pubblicazione: (2024)
di: Liu, Weiwen, et al.
Pubblicazione: (2024)
MeNTi: Bridging Medical Calculator and LLM Agent with Nested Tool Calling
di: Zhu, Yakun, et al.
Pubblicazione: (2024)
di: Zhu, Yakun, et al.
Pubblicazione: (2024)
Evaluating Tool-Augmented Agents in Remote Sensing Platforms
di: Singh, Simranjit, et al.
Pubblicazione: (2024)
di: Singh, Simranjit, et al.
Pubblicazione: (2024)
LLM4Causal: Democratized Causal Tools for Everyone via Large Language Model
di: Jiang, Haitao, et al.
Pubblicazione: (2023)
di: Jiang, Haitao, et al.
Pubblicazione: (2023)
Generation-driven Contrastive Self-training for Zero-shot Text Classification with Instruction-following LLM
di: Zhang, Ruohong, et al.
Pubblicazione: (2023)
di: Zhang, Ruohong, et al.
Pubblicazione: (2023)
PORTool: Importance-Aware Policy Optimization with Rewarded Tree for Multi-Tool-Integrated Reasoning
di: Wu, Feijie, et al.
Pubblicazione: (2025)
di: Wu, Feijie, et al.
Pubblicazione: (2025)
To Code or not to Code? Adaptive Tool Integration for Math Language Models via Expectation-Maximization
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
STAC: When Innocent Tools Form Dangerous Chains to Jailbreak LLM Agents
di: Li, Jing-Jing, et al.
Pubblicazione: (2025)
di: Li, Jing-Jing, et al.
Pubblicazione: (2025)
SkillGraph: Graph Foundation Priors for LLM Agent Tool Sequence Recommendation
di: Liu, Hao, et al.
Pubblicazione: (2026)
di: Liu, Hao, et al.
Pubblicazione: (2026)
The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs
di: Baidya, Avinash, et al.
Pubblicazione: (2025)
di: Baidya, Avinash, et al.
Pubblicazione: (2025)
PathCoT: Chain-of-Thought Prompting for Zero-shot Pathology Visual Reasoning
di: Zhou, Junjie, et al.
Pubblicazione: (2025)
di: Zhou, Junjie, et al.
Pubblicazione: (2025)
Tool Learning with Foundation Models
di: Qin, Yujia, et al.
Pubblicazione: (2023)
di: Qin, Yujia, et al.
Pubblicazione: (2023)
Better LLM Reasoning via Dual-Play
di: Zhang, Zhengxin, et al.
Pubblicazione: (2025)
di: Zhang, Zhengxin, et al.
Pubblicazione: (2025)
SPIRAL: Self-Play on Zero-Sum Games Incentivizes Reasoning via Multi-Agent Multi-Turn Reinforcement Learning
di: Liu, Bo, et al.
Pubblicazione: (2025)
di: Liu, Bo, et al.
Pubblicazione: (2025)
LLMs as Zero-shot Graph Learners: Alignment of GNN Representations with LLM Token Embeddings
di: Wang, Duo, et al.
Pubblicazione: (2024)
di: Wang, Duo, et al.
Pubblicazione: (2024)
The Amazing Agent Race: Strong Tool Users, Weak Navigators
di: Kim, Zae Myung, et al.
Pubblicazione: (2026)
di: Kim, Zae Myung, et al.
Pubblicazione: (2026)
Tools Fail: Detecting Silent Errors in Faulty Tools
di: Sun, Jimin, et al.
Pubblicazione: (2024)
di: Sun, Jimin, et al.
Pubblicazione: (2024)
ToolFactory: Automating Tool Generation by Leveraging LLM to Understand REST API Documentations
di: Ni, Xinyi, et al.
Pubblicazione: (2025)
di: Ni, Xinyi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Beyond Single-Shot: Multi-step Tool Retrieval via Query Planning
di: Fang, Wei, et al.
Pubblicazione: (2026) -
Tool-Star: Empowering LLM-Brained Multi-Tool Reasoner via Reinforcement Learning
di: Dong, Guanting, et al.
Pubblicazione: (2025) -
EnvScaler: Scaling Tool-Interactive Environments for LLM Agent via Programmatic Synthesis
di: Song, Xiaoshuai, et al.
Pubblicazione: (2026) -
LLM Agents Making Agent Tools
di: Wölflein, Georg, et al.
Pubblicazione: (2025) -
M$^2$PT: Multimodal Prompt Tuning for Zero-shot Instruction Learning
di: Wang, Taowen, et al.
Pubblicazione: (2024)