TUMS: Enhancing Tool-use Abilities of LLMs with Multi-structure Handlers
Fuente:
arXiv
Salvato in:
| Autori principali: | He, Aiyao, Cui, Sijia, Xu, Shuai, Wang, Yanna, Xu, Bo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Empowering LLMs with Parameterized Skills for Adversarial Long-Horizon Planning
di: Cui, Sijia, et al.
Pubblicazione: (2025)
di: Cui, Sijia, et al.
Pubblicazione: (2025)
Self-Guided Function Calling in Large Language Models via Stepwise Experience Recall
di: Cui, Sijia, et al.
Pubblicazione: (2025)
di: Cui, Sijia, et al.
Pubblicazione: (2025)
StepTool: Enhancing Multi-Step Tool Usage in LLMs via Step-Grained Reinforcement Learning
di: Yu, Yuanqing, et al.
Pubblicazione: (2024)
di: Yu, Yuanqing, et al.
Pubblicazione: (2024)
Do LLMs Have the Generalization Ability in Conducting Causal Inference?
di: Wang, Chen, et al.
Pubblicazione: (2024)
di: Wang, Chen, et al.
Pubblicazione: (2024)
Agentic MIP Research: Accelerated Constraint Handler Generation
di: Xu, Liding, et al.
Pubblicazione: (2026)
di: Xu, Liding, et al.
Pubblicazione: (2026)
PreAct: Prediction Enhances Agent's Planning Ability
di: Fu, Dayuan, et al.
Pubblicazione: (2024)
di: Fu, Dayuan, et al.
Pubblicazione: (2024)
Enhancing Reasoning Abilities of Small LLMs with Cognitive Alignment
di: Cai, Wenrui, et al.
Pubblicazione: (2025)
di: Cai, Wenrui, et al.
Pubblicazione: (2025)
Strategy-Augmented Planning for Large Language Models via Opponent Exploitation
di: Xu, Shuai, et al.
Pubblicazione: (2025)
di: Xu, Shuai, et al.
Pubblicazione: (2025)
Beyond SFT: Reinforcement Learning for Safer Large Reasoning Models with Better Reasoning Ability
di: Jia, Jinghan, et al.
Pubblicazione: (2025)
di: Jia, Jinghan, et al.
Pubblicazione: (2025)
From Complex to Simple: Enhancing Multi-Constraint Complex Instruction Following Ability of Large Language Models
di: He, Qianyu, et al.
Pubblicazione: (2024)
di: He, Qianyu, et al.
Pubblicazione: (2024)
Predictable Emergent Abilities of LLMs: Proxy Tasks Are All You Need
di: Zhang, Bo-Wen, et al.
Pubblicazione: (2024)
di: Zhang, Bo-Wen, et al.
Pubblicazione: (2024)
Atomic Thinking of LLMs: Decoupling and Exploring Mathematical Reasoning Abilities
di: Kuang, Jiayi, et al.
Pubblicazione: (2025)
di: Kuang, Jiayi, et al.
Pubblicazione: (2025)
Route Before Retrieve: Activating Latent Routing Abilities of LLMs for RAG vs. Long-Context Selection
di: Chen, Yiwen, et al.
Pubblicazione: (2026)
di: Chen, Yiwen, et al.
Pubblicazione: (2026)
Teaching LLMs to Refine with Tools
di: Yu, Dian, et al.
Pubblicazione: (2024)
di: Yu, Dian, et al.
Pubblicazione: (2024)
PANDA: Preference Adaptation for Enhancing Domain-Specific Abilities of LLMs
di: Liu, An, et al.
Pubblicazione: (2024)
di: Liu, An, et al.
Pubblicazione: (2024)
CITI: Enhancing Tool Utilizing Ability in Large Language Models without Sacrificing General Performance
di: Hao, Yupu, et al.
Pubblicazione: (2024)
di: Hao, Yupu, et al.
Pubblicazione: (2024)
Beyond Surface Structure: A Causal Assessment of LLMs' Comprehension Ability
di: Han, Yujin, et al.
Pubblicazione: (2024)
di: Han, Yujin, et al.
Pubblicazione: (2024)
Topic-Guided Reinforcement Learning with LLMs for Enhancing Multi-Document Summarization
di: Li, Chuyuan, et al.
Pubblicazione: (2025)
di: Li, Chuyuan, et al.
Pubblicazione: (2025)
Distill Visual Chart Reasoning Ability from LLMs to MLLMs
di: He, Wei, et al.
Pubblicazione: (2024)
di: He, Wei, et al.
Pubblicazione: (2024)
Enhancing the Medical Context-Awareness Ability of LLMs via Multifaceted Self-Refinement Learning
di: Zhou, Yuxuan, et al.
Pubblicazione: (2025)
di: Zhou, Yuxuan, et al.
Pubblicazione: (2025)
How Far Are We on the Decision-Making of LLMs? Evaluating LLMs' Gaming Ability in Multi-Agent Environments
di: Huang, Jen-tse, et al.
Pubblicazione: (2024)
di: Huang, Jen-tse, et al.
Pubblicazione: (2024)
Understanding the Ability of LLMs to Handle Character-Level Perturbation
di: Zhuo, Anyuan, et al.
Pubblicazione: (2025)
di: Zhuo, Anyuan, et al.
Pubblicazione: (2025)
Darkness Visible: Reading the Exception Handler of a Language Model
di: Balogh, Peter
Pubblicazione: (2026)
di: Balogh, Peter
Pubblicazione: (2026)
Evaluating the Pre-Consultation Ability of LLMs using Diagnostic Guidelines
di: Seo, Jean, et al.
Pubblicazione: (2026)
di: Seo, Jean, et al.
Pubblicazione: (2026)
Test-Time Policy Adaptation for Enhanced Multi-Turn Interactions with LLMs
di: Wei, Chenxing, et al.
Pubblicazione: (2025)
di: Wei, Chenxing, et al.
Pubblicazione: (2025)
Model Fusion with Multi-LoRA Inference for Tool-Enhanced Game Dialogue Agents
di: Wang, Kangxu, et al.
Pubblicazione: (2025)
di: Wang, Kangxu, et al.
Pubblicazione: (2025)
Reachability is Decidable for ATM-Typable Finitary PCF with Effect Handlers
di: Endo, Ryunosuke, et al.
Pubblicazione: (2025)
di: Endo, Ryunosuke, et al.
Pubblicazione: (2025)
Measuring Bargaining Abilities of LLMs: A Benchmark and A Buyer-Enhancement Method
di: Xia, Tian, et al.
Pubblicazione: (2024)
di: Xia, Tian, et al.
Pubblicazione: (2024)
NesTools: A Dataset for Evaluating Nested Tool Learning Abilities of Large Language Models
di: Han, Han, et al.
Pubblicazione: (2024)
di: Han, Han, et al.
Pubblicazione: (2024)
Effect Handlers for Programmable Inference
di: Nguyen, Minh, et al.
Pubblicazione: (2023)
di: Nguyen, Minh, et al.
Pubblicazione: (2023)
Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases
di: Qiu, Pengcheng, et al.
Pubblicazione: (2025)
di: Qiu, Pengcheng, et al.
Pubblicazione: (2025)
Extracting and Combining Abilities For Building Multi-lingual Ability-enhanced Large Language Models
di: Chen, Zhipeng, et al.
Pubblicazione: (2024)
di: Chen, Zhipeng, et al.
Pubblicazione: (2024)
Advancing and Benchmarking Personalized Tool Invocation for LLMs
di: Huang, Xu, et al.
Pubblicazione: (2025)
di: Huang, Xu, et al.
Pubblicazione: (2025)
BiasAlert: A Plug-and-play Tool for Social Bias Detection in LLMs
di: Fan, Zhiting, et al.
Pubblicazione: (2024)
di: Fan, Zhiting, et al.
Pubblicazione: (2024)
GenTool: Enhancing Tool Generalization in Language Models through Zero-to-One and Weak-to-Strong Simulation
di: He, Jie, et al.
Pubblicazione: (2025)
di: He, Jie, et al.
Pubblicazione: (2025)
Embedding Self-Correction as an Inherent Ability in Large Language Models for Enhanced Mathematical Reasoning
di: Gao, Kuofeng, et al.
Pubblicazione: (2024)
di: Gao, Kuofeng, et al.
Pubblicazione: (2024)
ZPD-SCA: Unveiling the Blind Spots of LLMs in Assessing Students' Cognitive Abilities
di: Dong, Wenhan, et al.
Pubblicazione: (2025)
di: Dong, Wenhan, et al.
Pubblicazione: (2025)
On the Decision-Making Abilities in Role-Playing using Large Language Models
di: Shen, Chenglei, et al.
Pubblicazione: (2024)
di: Shen, Chenglei, et al.
Pubblicazione: (2024)
VeriAgent: A Tool-Integrated Multi-Agent System with Evolving Memory for PPA-Aware RTL Code Generation
di: Wang, Yaoxiang, et al.
Pubblicazione: (2026)
di: Wang, Yaoxiang, et al.
Pubblicazione: (2026)
Enhancing the Geometric Problem-Solving Ability of Multimodal LLMs via Symbolic-Neural Integration
di: Pan, Yicheng, et al.
Pubblicazione: (2025)
di: Pan, Yicheng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Empowering LLMs with Parameterized Skills for Adversarial Long-Horizon Planning
di: Cui, Sijia, et al.
Pubblicazione: (2025) -
Self-Guided Function Calling in Large Language Models via Stepwise Experience Recall
di: Cui, Sijia, et al.
Pubblicazione: (2025) -
StepTool: Enhancing Multi-Step Tool Usage in LLMs via Step-Grained Reinforcement Learning
di: Yu, Yuanqing, et al.
Pubblicazione: (2024) -
Do LLMs Have the Generalization Ability in Conducting Causal Inference?
di: Wang, Chen, et al.
Pubblicazione: (2024) -
Agentic MIP Research: Accelerated Constraint Handler Generation
di: Xu, Liding, et al.
Pubblicazione: (2026)