To Call or Not to Call: A Framework to Assess and Optimize LLM Tool Calling
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, Qinyuan, Das, Soumi, Amani, Mahsa, Nag, Arijit, Lee, Seungeon, Gummadi, Krishna P., Ravichander, Abhilasha, Zafar, Muhammad Bilal |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
In Agents We Trust, but Who Do Agents Trust? Latent Source Preferences Steer LLM Generations
di: Khan, Mohammad Aflah, et al.
Pubblicazione: (2026)
di: Khan, Mohammad Aflah, et al.
Pubblicazione: (2026)
LoRA on the Go: Instance-level Dynamic LoRA Selection and Merging
di: Lee, Seungeon, et al.
Pubblicazione: (2025)
di: Lee, Seungeon, et al.
Pubblicazione: (2025)
Rote Learning Considered Useful: Generalizing over Memorized Data in LLMs
di: Wu, Qinyuan, et al.
Pubblicazione: (2025)
di: Wu, Qinyuan, et al.
Pubblicazione: (2025)
Revisiting Privacy, Utility, and Efficiency Trade-offs when Fine-Tuning Large Language Models
di: Das, Soumi, et al.
Pubblicazione: (2025)
di: Das, Soumi, et al.
Pubblicazione: (2025)
To Call or Not to Call: Diagnosing Intrinsic Over-Calling Bias in LLM Agents
di: Shi, Wei, et al.
Pubblicazione: (2026)
di: Shi, Wei, et al.
Pubblicazione: (2026)
GeoX: Mastering Geospatial Reasoning Through Self-Play and Verifiable Rewards
di: Ahn, Kyeongjin, et al.
Pubblicazione: (2026)
di: Ahn, Kyeongjin, et al.
Pubblicazione: (2026)
Characterizing Web Search in The Age of Generative AI
di: Kirsten, Elisabeth, et al.
Pubblicazione: (2025)
di: Kirsten, Elisabeth, et al.
Pubblicazione: (2025)
Asynchronous LLM Function Calling
di: Gim, In, et al.
Pubblicazione: (2024)
di: Gim, In, et al.
Pubblicazione: (2024)
ToolACE: Winning the Points of LLM Function Calling
di: Liu, Weiwen, et al.
Pubblicazione: (2024)
di: Liu, Weiwen, et al.
Pubblicazione: (2024)
UniToolCall: Unifying Tool-Use Representation, Data, and Evaluation for LLM Agents
di: Liang, Yijuan, et al.
Pubblicazione: (2026)
di: Liang, Yijuan, et al.
Pubblicazione: (2026)
An LLM-Tool Compiler for Fused Parallel Function Calling
di: Singh, Simranjit, et al.
Pubblicazione: (2024)
di: Singh, Simranjit, et al.
Pubblicazione: (2024)
Fractional Rotation, Full Potential? Investigating Performance and Convergence of Partial RoPE
di: Khan, Mohammad Aflah, et al.
Pubblicazione: (2026)
di: Khan, Mohammad Aflah, et al.
Pubblicazione: (2026)
LoopTool: Closing the Data-Training Loop for Robust LLM Tool Calls
di: Zhang, Kangning, et al.
Pubblicazione: (2025)
di: Zhang, Kangning, et al.
Pubblicazione: (2025)
Causality Laundering: Denial-Feedback Leakage in Tool-Calling LLM Agents
di: Chinaei, Mohammad Hossein
Pubblicazione: (2026)
di: Chinaei, Mohammad Hossein
Pubblicazione: (2026)
Interleaved Tool-Call Reasoning for Protein Function Understanding
di: Fan, Chuanliu, et al.
Pubblicazione: (2026)
di: Fan, Chuanliu, et al.
Pubblicazione: (2026)
Tool Calling is Linearly Readable and Steerable in Language Models
di: Wu, Zekun, et al.
Pubblicazione: (2026)
di: Wu, Zekun, et al.
Pubblicazione: (2026)
MeNTi: Bridging Medical Calculator and LLM Agent with Nested Tool Calling
di: Zhu, Yakun, et al.
Pubblicazione: (2024)
di: Zhu, Yakun, et al.
Pubblicazione: (2024)
From Allies to Adversaries: Manipulating LLM Tool-Calling through Adversarial Injection
di: Wang, Haowei, et al.
Pubblicazione: (2024)
di: Wang, Haowei, et al.
Pubblicazione: (2024)
The Algorithmic Self-Portrait: Deconstructing Memory in ChatGPT
di: Dash, Abhisek, et al.
Pubblicazione: (2026)
di: Dash, Abhisek, et al.
Pubblicazione: (2026)
Switchcraft: AI Model Router for Agentic Tool Calling
di: Agarwal, Sharad, et al.
Pubblicazione: (2026)
di: Agarwal, Sharad, et al.
Pubblicazione: (2026)
HALoGEN: Fantastic LLM Hallucinations and Where to Find Them
di: Ravichander, Abhilasha, et al.
Pubblicazione: (2025)
di: Ravichander, Abhilasha, et al.
Pubblicazione: (2025)
When2Call: When (not) to Call Tools
di: Ross, Hayley, et al.
Pubblicazione: (2025)
di: Ross, Hayley, et al.
Pubblicazione: (2025)
Verification-Guided Context Optimization for Tool Calling via Hierarchical LLMs-as-Editors
di: Li, Henger, et al.
Pubblicazione: (2025)
di: Li, Henger, et al.
Pubblicazione: (2025)
Proof-of-Use: Mitigating Tool-Call Hacking in Deep Research Agents
di: Ma, SHengjie, et al.
Pubblicazione: (2025)
di: Ma, SHengjie, et al.
Pubblicazione: (2025)
MiniScope: A Least Privilege Framework for Authorizing Tool Calling Agents
di: Zhu, Jinhao, et al.
Pubblicazione: (2025)
di: Zhu, Jinhao, et al.
Pubblicazione: (2025)
IM-Chat: A Multi-agent LLM Framework Integrating Tool-Calling and Diffusion Modeling for Knowledge Transfer in Injection Molding Industry
di: Lee, Junhyeong, et al.
Pubblicazione: (2025)
di: Lee, Junhyeong, et al.
Pubblicazione: (2025)
Enhancing Tool Calling in LLMs with the International Tool Calling Dataset
di: Zhang, Zuoyu, et al.
Pubblicazione: (2026)
di: Zhang, Zuoyu, et al.
Pubblicazione: (2026)
Optimizing Agentic Language Model Inference via Speculative Tool Calls
di: Nichols, Daniel, et al.
Pubblicazione: (2025)
di: Nichols, Daniel, et al.
Pubblicazione: (2025)
What Has Been Lost with Synthetic Evaluation?
di: Gill, Alexander, et al.
Pubblicazione: (2025)
di: Gill, Alexander, et al.
Pubblicazione: (2025)
Digging Into the Internal: Causality-Based Analysis of LLM Function Calling
di: Ji, Zhenlan, et al.
Pubblicazione: (2025)
di: Ji, Zhenlan, et al.
Pubblicazione: (2025)
Ghost Tool Calls: Issue-Time Privacy for Speculative Agent Tools
di: Mohammadi, Bardia, et al.
Pubblicazione: (2026)
di: Mohammadi, Bardia, et al.
Pubblicazione: (2026)
ASA: Training-Free Representation Engineering for Tool-Calling Agents
di: Wang, Youjin, et al.
Pubblicazione: (2026)
di: Wang, Youjin, et al.
Pubblicazione: (2026)
Latent Preference Modeling for Cross-Session Personalized Tool Calling
di: Yoon, Yejin, et al.
Pubblicazione: (2026)
di: Yoon, Yejin, et al.
Pubblicazione: (2026)
ToolWeave: Structured Synthesis of Complex Multi-Turn Tool-Calling Dialogues
di: Khandelwal, Dinesh, et al.
Pubblicazione: (2026)
di: Khandelwal, Dinesh, et al.
Pubblicazione: (2026)
AWARE-US: Preference-Aware Infeasibility Resolution in Tool-Calling Agents
di: Kurmaz, Mehmet
Pubblicazione: (2026)
di: Kurmaz, Mehmet
Pubblicazione: (2026)
Mind the GAP: Text Safety Does Not Transfer to Tool-Call Safety in LLM Agents
di: Cartagena, Arnold, et al.
Pubblicazione: (2026)
di: Cartagena, Arnold, et al.
Pubblicazione: (2026)
Reinforcement Learning for Tool-Calling Agents in Fast Healthcare Interoperability Resources (FHIR)
di: Knorr, Marius S., et al.
Pubblicazione: (2026)
di: Knorr, Marius S., et al.
Pubblicazione: (2026)
Reinforced Agent: Inference-Time Feedback for Tool-Calling Agents
di: Ta, Anh, et al.
Pubblicazione: (2026)
di: Ta, Anh, et al.
Pubblicazione: (2026)
CarbonCall: Sustainability-Aware Function Calling for Large Language Models on Edge Devices
di: Paramanayakam, Varatheepan, et al.
Pubblicazione: (2025)
di: Paramanayakam, Varatheepan, et al.
Pubblicazione: (2025)
Beyond Max Tokens: Stealthy Resource Amplification via Tool Calling Chains in LLM Agents
di: Zhou, Kaiyu, et al.
Pubblicazione: (2026)
di: Zhou, Kaiyu, et al.
Pubblicazione: (2026)
Documenti analoghi
-
In Agents We Trust, but Who Do Agents Trust? Latent Source Preferences Steer LLM Generations
di: Khan, Mohammad Aflah, et al.
Pubblicazione: (2026) -
LoRA on the Go: Instance-level Dynamic LoRA Selection and Merging
di: Lee, Seungeon, et al.
Pubblicazione: (2025) -
Rote Learning Considered Useful: Generalizing over Memorized Data in LLMs
di: Wu, Qinyuan, et al.
Pubblicazione: (2025) -
Revisiting Privacy, Utility, and Efficiency Trade-offs when Fine-Tuning Large Language Models
di: Das, Soumi, et al.
Pubblicazione: (2025) -
To Call or Not to Call: Diagnosing Intrinsic Over-Calling Bias in LLM Agents
di: Shi, Wei, et al.
Pubblicazione: (2026)