Small Language Models for Efficient Agentic Tool Calling: Outperforming Large Models with Targeted Fine-tuning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jhandi, Polaris, Kazi, Owais, Subramanian, Shreyas, Sendas, Neel |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VERAFI: Verified Agentic Financial Intelligence through Neurosymbolic Policy Generation
par: Akinfaderin, Adewale, et autres
Publié: (2025)
par: Akinfaderin, Adewale, et autres
Publié: (2025)
Plug-in and Fine-tuning: Bridging the Gap between Small Language Models and Large Language Models
par: Kim, Kyeonghyun, et autres
Publié: (2025)
par: Kim, Kyeonghyun, et autres
Publié: (2025)
Switchcraft: AI Model Router for Agentic Tool Calling
par: Agarwal, Sharad, et autres
Publié: (2026)
par: Agarwal, Sharad, et autres
Publié: (2026)
Fine-tuning Small Language Models as Efficient Enterprise Search Relevance Labelers
par: Kang, Yue, et autres
Publié: (2026)
par: Kang, Yue, et autres
Publié: (2026)
Sensitivity of Small Language Models to Fine-tuning Data Contamination
par: Scaria, Nicy, et autres
Publié: (2025)
par: Scaria, Nicy, et autres
Publié: (2025)
Semi-supervised Fine-tuning for Large Language Models
par: Luo, Junyu, et autres
Publié: (2024)
par: Luo, Junyu, et autres
Publié: (2024)
Small Language Models Fine-tuned to Coordinate Larger Language Models improve Complex Reasoning
par: Juneja, Gurusha, et autres
Publié: (2023)
par: Juneja, Gurusha, et autres
Publié: (2023)
SmallToLarge (S2L): Scalable Data Selection for Fine-tuning Large Language Models by Summarizing Training Trajectories of Small Models
par: Yang, Yu, et autres
Publié: (2024)
par: Yang, Yu, et autres
Publié: (2024)
Refine Large Language Model Fine-tuning via Instruction Vector
par: Jiang, Gangwei, et autres
Publié: (2024)
par: Jiang, Gangwei, et autres
Publié: (2024)
Privacy Issues in Large Language Models: A Survey
par: Neel, Seth, et autres
Publié: (2023)
par: Neel, Seth, et autres
Publié: (2023)
Improving Small-Scale Large Language Models Function Calling for Reasoning Tasks
par: Manduzio, Graziano A., et autres
Publié: (2024)
par: Manduzio, Graziano A., et autres
Publié: (2024)
Fine-tuning Large Language Model for Automated Algorithm Design
par: Liu, Fei, et autres
Publié: (2025)
par: Liu, Fei, et autres
Publié: (2025)
Federated Co-tuning Framework for Large and Small Language Models
par: Fan, Tao, et autres
Publié: (2024)
par: Fan, Tao, et autres
Publié: (2024)
Optimizing Agentic Language Model Inference via Speculative Tool Calls
par: Nichols, Daniel, et autres
Publié: (2025)
par: Nichols, Daniel, et autres
Publié: (2025)
Unlocking Large Language Model's Planning Capabilities with Maximum Diversity Fine-tuning
par: Li, Wenjun, et autres
Publié: (2024)
par: Li, Wenjun, et autres
Publié: (2024)
Privacy in Fine-tuning Large Language Models: Attacks, Defenses, and Future Directions
par: Du, Hao, et autres
Publié: (2024)
par: Du, Hao, et autres
Publié: (2024)
LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models
par: Chen, Yukang, et autres
Publié: (2023)
par: Chen, Yukang, et autres
Publié: (2023)
Dhati+: Fine-tuned Large Language Models for Arabic Subjectivity Evaluation
par: Bellaouar, Slimane, et autres
Publié: (2025)
par: Bellaouar, Slimane, et autres
Publié: (2025)
Compositional Subspace Representation Fine-tuning for Adaptive Large Language Models
par: Zhou, Andy
Publié: (2025)
par: Zhou, Andy
Publié: (2025)
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
par: Lyu, Yougang, et autres
Publié: (2024)
par: Lyu, Yougang, et autres
Publié: (2024)
JudgeLM: Fine-tuned Large Language Models are Scalable Judges
par: Zhu, Lianghui, et autres
Publié: (2023)
par: Zhu, Lianghui, et autres
Publié: (2023)
Privacy-preserving Fine-tuning of Large Language Models through Flatness
par: Chen, Tiejin, et autres
Publié: (2024)
par: Chen, Tiejin, et autres
Publié: (2024)
Plan-and-Write: Structure-Guided Length Control for LLMs without Model Retraining
par: Akinfaderin, Adewale, et autres
Publié: (2025)
par: Akinfaderin, Adewale, et autres
Publié: (2025)
Efficient End-to-end Language Model Fine-tuning on Graphs
par: Xue, Rui, et autres
Publié: (2023)
par: Xue, Rui, et autres
Publié: (2023)
Small Language Models are the Future of Agentic AI
par: Belcak, Peter, et autres
Publié: (2025)
par: Belcak, Peter, et autres
Publié: (2025)
PeFoMed: Parameter Efficient Fine-tuning of Multimodal Large Language Models for Medical Imaging
par: He, Jinlong, et autres
Publié: (2024)
par: He, Jinlong, et autres
Publié: (2024)
Lost in Execution: On the Multilingual Robustness of Tool Calling in Large Language Models
par: Luo, Zheng, et autres
Publié: (2026)
par: Luo, Zheng, et autres
Publié: (2026)
AutoTool: Efficient Tool Selection for Large Language Model Agents
par: Jia, Jingyi, et autres
Publié: (2025)
par: Jia, Jingyi, et autres
Publié: (2025)
Panacea: Mitigating Harmful Fine-tuning for Large Language Models via Post-fine-tuning Perturbation
par: Wang, Yibo, et autres
Publié: (2025)
par: Wang, Yibo, et autres
Publié: (2025)
Antidote: Post-fine-tuning Safety Alignment for Large Language Models against Harmful Fine-tuning
par: Huang, Tiansheng, et autres
Publié: (2024)
par: Huang, Tiansheng, et autres
Publié: (2024)
Systematic Analysis for Pretrained Language Model Priming for Parameter-Efficient Fine-tuning
par: Huang, Shih-Cheng, et autres
Publié: (2022)
par: Huang, Shih-Cheng, et autres
Publié: (2022)
Self-Healing Agentic Orchestrators for Reliable Tool-Augmented Large Language Model Systems
par: Babu, Rahul Suresh, et autres
Publié: (2026)
par: Babu, Rahul Suresh, et autres
Publié: (2026)
Language Models Coupled with Metacognition Can Outperform Reasoning Models
par: Khandelwal, Vedant, et autres
Publié: (2025)
par: Khandelwal, Vedant, et autres
Publié: (2025)
Prompting or Fine-tuning? Exploring Large Language Models for Causal Graph Validation
par: Susanti, Yuni, et autres
Publié: (2024)
par: Susanti, Yuni, et autres
Publié: (2024)
Demystifying Instruction Mixing for Fine-tuning Large Language Models
par: Wang, Renxi, et autres
Publié: (2023)
par: Wang, Renxi, et autres
Publié: (2023)
On Generalization in Agentic Tool Calling: CoreThink Agentic Reasoner and MAVEN Dataset
par: Bhat, Vishvesh, et autres
Publié: (2025)
par: Bhat, Vishvesh, et autres
Publié: (2025)
Pre-train and Fine-tune: Recommenders as Large Models
par: Jiang, Zhenhao, et autres
Publié: (2025)
par: Jiang, Zhenhao, et autres
Publié: (2025)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
par: Song, Weixi, et autres
Publié: (2023)
par: Song, Weixi, et autres
Publié: (2023)
You Only Fine-tune Once: Many-Shot In-Context Fine-Tuning for Large Language Models
par: He, Wenchong, et autres
Publié: (2025)
par: He, Wenchong, et autres
Publié: (2025)
Case Study: Fine-tuning Small Language Models for Accurate and Private CWE Detection in Python Code
par: Bappy, Md. Azizul Hakim, et autres
Publié: (2025)
par: Bappy, Md. Azizul Hakim, et autres
Publié: (2025)
Documents similaires
-
VERAFI: Verified Agentic Financial Intelligence through Neurosymbolic Policy Generation
par: Akinfaderin, Adewale, et autres
Publié: (2025) -
Plug-in and Fine-tuning: Bridging the Gap between Small Language Models and Large Language Models
par: Kim, Kyeonghyun, et autres
Publié: (2025) -
Switchcraft: AI Model Router for Agentic Tool Calling
par: Agarwal, Sharad, et autres
Publié: (2026) -
Fine-tuning Small Language Models as Efficient Enterprise Search Relevance Labelers
par: Kang, Yue, et autres
Publié: (2026) -
Sensitivity of Small Language Models to Fine-tuning Data Contamination
par: Scaria, Nicy, et autres
Publié: (2025)