Small Language Models for Efficient Agentic Tool Calling: Outperforming Large Models with Targeted Fine-tuning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Jhandi, Polaris, Kazi, Owais, Subramanian, Shreyas, Sendas, Neel |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
VERAFI: Verified Agentic Financial Intelligence through Neurosymbolic Policy Generation
von: Akinfaderin, Adewale, et al.
Veröffentlicht: (2025)
von: Akinfaderin, Adewale, et al.
Veröffentlicht: (2025)
Plug-in and Fine-tuning: Bridging the Gap between Small Language Models and Large Language Models
von: Kim, Kyeonghyun, et al.
Veröffentlicht: (2025)
von: Kim, Kyeonghyun, et al.
Veröffentlicht: (2025)
Switchcraft: AI Model Router for Agentic Tool Calling
von: Agarwal, Sharad, et al.
Veröffentlicht: (2026)
von: Agarwal, Sharad, et al.
Veröffentlicht: (2026)
Fine-tuning Small Language Models as Efficient Enterprise Search Relevance Labelers
von: Kang, Yue, et al.
Veröffentlicht: (2026)
von: Kang, Yue, et al.
Veröffentlicht: (2026)
Sensitivity of Small Language Models to Fine-tuning Data Contamination
von: Scaria, Nicy, et al.
Veröffentlicht: (2025)
von: Scaria, Nicy, et al.
Veröffentlicht: (2025)
Semi-supervised Fine-tuning for Large Language Models
von: Luo, Junyu, et al.
Veröffentlicht: (2024)
von: Luo, Junyu, et al.
Veröffentlicht: (2024)
Small Language Models Fine-tuned to Coordinate Larger Language Models improve Complex Reasoning
von: Juneja, Gurusha, et al.
Veröffentlicht: (2023)
von: Juneja, Gurusha, et al.
Veröffentlicht: (2023)
SmallToLarge (S2L): Scalable Data Selection for Fine-tuning Large Language Models by Summarizing Training Trajectories of Small Models
von: Yang, Yu, et al.
Veröffentlicht: (2024)
von: Yang, Yu, et al.
Veröffentlicht: (2024)
Refine Large Language Model Fine-tuning via Instruction Vector
von: Jiang, Gangwei, et al.
Veröffentlicht: (2024)
von: Jiang, Gangwei, et al.
Veröffentlicht: (2024)
Privacy Issues in Large Language Models: A Survey
von: Neel, Seth, et al.
Veröffentlicht: (2023)
von: Neel, Seth, et al.
Veröffentlicht: (2023)
Improving Small-Scale Large Language Models Function Calling for Reasoning Tasks
von: Manduzio, Graziano A., et al.
Veröffentlicht: (2024)
von: Manduzio, Graziano A., et al.
Veröffentlicht: (2024)
Fine-tuning Large Language Model for Automated Algorithm Design
von: Liu, Fei, et al.
Veröffentlicht: (2025)
von: Liu, Fei, et al.
Veröffentlicht: (2025)
Federated Co-tuning Framework for Large and Small Language Models
von: Fan, Tao, et al.
Veröffentlicht: (2024)
von: Fan, Tao, et al.
Veröffentlicht: (2024)
Optimizing Agentic Language Model Inference via Speculative Tool Calls
von: Nichols, Daniel, et al.
Veröffentlicht: (2025)
von: Nichols, Daniel, et al.
Veröffentlicht: (2025)
Unlocking Large Language Model's Planning Capabilities with Maximum Diversity Fine-tuning
von: Li, Wenjun, et al.
Veröffentlicht: (2024)
von: Li, Wenjun, et al.
Veröffentlicht: (2024)
Privacy in Fine-tuning Large Language Models: Attacks, Defenses, and Future Directions
von: Du, Hao, et al.
Veröffentlicht: (2024)
von: Du, Hao, et al.
Veröffentlicht: (2024)
LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models
von: Chen, Yukang, et al.
Veröffentlicht: (2023)
von: Chen, Yukang, et al.
Veröffentlicht: (2023)
Dhati+: Fine-tuned Large Language Models for Arabic Subjectivity Evaluation
von: Bellaouar, Slimane, et al.
Veröffentlicht: (2025)
von: Bellaouar, Slimane, et al.
Veröffentlicht: (2025)
Compositional Subspace Representation Fine-tuning for Adaptive Large Language Models
von: Zhou, Andy
Veröffentlicht: (2025)
von: Zhou, Andy
Veröffentlicht: (2025)
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
von: Lyu, Yougang, et al.
Veröffentlicht: (2024)
von: Lyu, Yougang, et al.
Veröffentlicht: (2024)
JudgeLM: Fine-tuned Large Language Models are Scalable Judges
von: Zhu, Lianghui, et al.
Veröffentlicht: (2023)
von: Zhu, Lianghui, et al.
Veröffentlicht: (2023)
Privacy-preserving Fine-tuning of Large Language Models through Flatness
von: Chen, Tiejin, et al.
Veröffentlicht: (2024)
von: Chen, Tiejin, et al.
Veröffentlicht: (2024)
Plan-and-Write: Structure-Guided Length Control for LLMs without Model Retraining
von: Akinfaderin, Adewale, et al.
Veröffentlicht: (2025)
von: Akinfaderin, Adewale, et al.
Veröffentlicht: (2025)
Efficient End-to-end Language Model Fine-tuning on Graphs
von: Xue, Rui, et al.
Veröffentlicht: (2023)
von: Xue, Rui, et al.
Veröffentlicht: (2023)
Small Language Models are the Future of Agentic AI
von: Belcak, Peter, et al.
Veröffentlicht: (2025)
von: Belcak, Peter, et al.
Veröffentlicht: (2025)
PeFoMed: Parameter Efficient Fine-tuning of Multimodal Large Language Models for Medical Imaging
von: He, Jinlong, et al.
Veröffentlicht: (2024)
von: He, Jinlong, et al.
Veröffentlicht: (2024)
Lost in Execution: On the Multilingual Robustness of Tool Calling in Large Language Models
von: Luo, Zheng, et al.
Veröffentlicht: (2026)
von: Luo, Zheng, et al.
Veröffentlicht: (2026)
AutoTool: Efficient Tool Selection for Large Language Model Agents
von: Jia, Jingyi, et al.
Veröffentlicht: (2025)
von: Jia, Jingyi, et al.
Veröffentlicht: (2025)
Panacea: Mitigating Harmful Fine-tuning for Large Language Models via Post-fine-tuning Perturbation
von: Wang, Yibo, et al.
Veröffentlicht: (2025)
von: Wang, Yibo, et al.
Veröffentlicht: (2025)
Antidote: Post-fine-tuning Safety Alignment for Large Language Models against Harmful Fine-tuning
von: Huang, Tiansheng, et al.
Veröffentlicht: (2024)
von: Huang, Tiansheng, et al.
Veröffentlicht: (2024)
Systematic Analysis for Pretrained Language Model Priming for Parameter-Efficient Fine-tuning
von: Huang, Shih-Cheng, et al.
Veröffentlicht: (2022)
von: Huang, Shih-Cheng, et al.
Veröffentlicht: (2022)
Self-Healing Agentic Orchestrators for Reliable Tool-Augmented Large Language Model Systems
von: Babu, Rahul Suresh, et al.
Veröffentlicht: (2026)
von: Babu, Rahul Suresh, et al.
Veröffentlicht: (2026)
Language Models Coupled with Metacognition Can Outperform Reasoning Models
von: Khandelwal, Vedant, et al.
Veröffentlicht: (2025)
von: Khandelwal, Vedant, et al.
Veröffentlicht: (2025)
Prompting or Fine-tuning? Exploring Large Language Models for Causal Graph Validation
von: Susanti, Yuni, et al.
Veröffentlicht: (2024)
von: Susanti, Yuni, et al.
Veröffentlicht: (2024)
Demystifying Instruction Mixing for Fine-tuning Large Language Models
von: Wang, Renxi, et al.
Veröffentlicht: (2023)
von: Wang, Renxi, et al.
Veröffentlicht: (2023)
On Generalization in Agentic Tool Calling: CoreThink Agentic Reasoner and MAVEN Dataset
von: Bhat, Vishvesh, et al.
Veröffentlicht: (2025)
von: Bhat, Vishvesh, et al.
Veröffentlicht: (2025)
Pre-train and Fine-tune: Recommenders as Large Models
von: Jiang, Zhenhao, et al.
Veröffentlicht: (2025)
von: Jiang, Zhenhao, et al.
Veröffentlicht: (2025)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
von: Song, Weixi, et al.
Veröffentlicht: (2023)
von: Song, Weixi, et al.
Veröffentlicht: (2023)
You Only Fine-tune Once: Many-Shot In-Context Fine-Tuning for Large Language Models
von: He, Wenchong, et al.
Veröffentlicht: (2025)
von: He, Wenchong, et al.
Veröffentlicht: (2025)
Case Study: Fine-tuning Small Language Models for Accurate and Private CWE Detection in Python Code
von: Bappy, Md. Azizul Hakim, et al.
Veröffentlicht: (2025)
von: Bappy, Md. Azizul Hakim, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
VERAFI: Verified Agentic Financial Intelligence through Neurosymbolic Policy Generation
von: Akinfaderin, Adewale, et al.
Veröffentlicht: (2025) -
Plug-in and Fine-tuning: Bridging the Gap between Small Language Models and Large Language Models
von: Kim, Kyeonghyun, et al.
Veröffentlicht: (2025) -
Switchcraft: AI Model Router for Agentic Tool Calling
von: Agarwal, Sharad, et al.
Veröffentlicht: (2026) -
Fine-tuning Small Language Models as Efficient Enterprise Search Relevance Labelers
von: Kang, Yue, et al.
Veröffentlicht: (2026) -
Sensitivity of Small Language Models to Fine-tuning Data Contamination
von: Scaria, Nicy, et al.
Veröffentlicht: (2025)