STAR: Similarity-guided Teacher-Assisted Refinement for Super-Tiny Function Calling Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ni, Jiliang, Pu, Jiachen, Yang, Zhongyi, Luo, Jingfeng, Hu, Conggang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
From Large to Super-Tiny: End-to-End Optimization for Cost-Efficient LLMs
par: Ni, Jiliang, et autres
Publié: (2025)
par: Ni, Jiliang, et autres
Publié: (2025)
Super Tiny Language Models
par: Hillier, Dylan, et autres
Publié: (2024)
par: Hillier, Dylan, et autres
Publié: (2024)
Improving Large Language Models Function Calling and Interpretability via Guided-Structured Templates
par: Dang, Hy, et autres
Publié: (2025)
par: Dang, Hy, et autres
Publié: (2025)
Tiny Refinements Elicit Resilience: Toward Efficient Prefix-Model Against LLM Red-Teaming
par: Liu, Jiaxu, et autres
Publié: (2024)
par: Liu, Jiaxu, et autres
Publié: (2024)
Large Language Model as a Policy Teacher for Training Reinforcement Learning Agents
par: Zhou, Zihao, et autres
Publié: (2023)
par: Zhou, Zihao, et autres
Publié: (2023)
Physics-Guided Tiny-Mamba Transformer for Reliability-Aware Early Fault Warning
par: Li, Changyu, et autres
Publié: (2026)
par: Li, Changyu, et autres
Publié: (2026)
Adversarial Generative Flow Network for Solving Vehicle Routing Problems
par: Zhang, Ni, et autres
Publié: (2025)
par: Zhang, Ni, et autres
Publié: (2025)
Probabilistic Tiny Recursive Model
par: Sghaier, Amin, et autres
Publié: (2026)
par: Sghaier, Amin, et autres
Publié: (2026)
TinyHelen's First Curriculum: Training and Evaluating Tiny Language Models in a Simpler Language Environment
par: Yang, Ke, et autres
Publié: (2024)
par: Yang, Ke, et autres
Publié: (2024)
Tiny Reward Models
par: Pan, Sarah
Publié: (2025)
par: Pan, Sarah
Publié: (2025)
Instruction-Following Evaluation in Function Calling for Large Language Models
par: Skripko, Nikolai
Publié: (2025)
par: Skripko, Nikolai
Publié: (2025)
Tiny Models are the Computational Saver for Large Models
par: Wang, Qingyuan, et autres
Publié: (2024)
par: Wang, Qingyuan, et autres
Publié: (2024)
Do Machines and Humans Focus on Similar Code? Exploring Explainability of Large Language Models in Code Summarization
par: Li, Jiliang, et autres
Publié: (2024)
par: Li, Jiliang, et autres
Publié: (2024)
Exploring Weaknesses in Function Call Models via Reinforcement Learning: An Adversarial Data Augmentation Approach
par: Guo, Weiran, et autres
Publié: (2026)
par: Guo, Weiran, et autres
Publié: (2026)
Enhancing Reinforcement Learning Fine-Tuning with an Online Refiner
par: Ma, Hao, et autres
Publié: (2026)
par: Ma, Hao, et autres
Publié: (2026)
PanGu-$π$ Pro:Rethinking Optimization and Architecture for Tiny Language Models
par: Tang, Yehui, et autres
Publié: (2024)
par: Tang, Yehui, et autres
Publié: (2024)
PR-CAD: Progressive Refinement for Unified Controllable and Faithful Text-to-CAD Generation with Large Language Models
par: An, Jiyuan, et autres
Publié: (2026)
par: An, Jiyuan, et autres
Publié: (2026)
CarbonCall: Sustainability-Aware Function Calling for Large Language Models on Edge Devices
par: Paramanayakam, Varatheepan, et autres
Publié: (2025)
par: Paramanayakam, Varatheepan, et autres
Publié: (2025)
RLIE: Rule Generation with Logistic Regression, Iterative Refinement, and Evaluation for Large Language Models
par: Yang, Yang, et autres
Publié: (2025)
par: Yang, Yang, et autres
Publié: (2025)
Asynchronous LLM Function Calling
par: Gim, In, et autres
Publié: (2024)
par: Gim, In, et autres
Publié: (2024)
M-STAR: Multi-Scale Spatiotemporal Autoregression for Human Mobility Modeling
par: Luo, Yuxiao, et autres
Publié: (2025)
par: Luo, Yuxiao, et autres
Publié: (2025)
Improving Small-Scale Large Language Models Function Calling for Reasoning Tasks
par: Manduzio, Graziano A., et autres
Publié: (2024)
par: Manduzio, Graziano A., et autres
Publié: (2024)
Regularized Q-Learning with Linear Function Approximation
par: Xi, Jiachen, et autres
Publié: (2024)
par: Xi, Jiachen, et autres
Publié: (2024)
Explainer-guided Targeted Adversarial Attacks against Binary Code Similarity Detection Models
par: Chen, Mingjie, et autres
Publié: (2025)
par: Chen, Mingjie, et autres
Publié: (2025)
Granite-Function Calling Model: Introducing Function Calling Abilities via Multi-task Learning of Granular Tasks
par: Abdelaziz, Ibrahim, et autres
Publié: (2024)
par: Abdelaziz, Ibrahim, et autres
Publié: (2024)
Interleaved Tool-Call Reasoning for Protein Function Understanding
par: Fan, Chuanliu, et autres
Publié: (2026)
par: Fan, Chuanliu, et autres
Publié: (2026)
TinyDrop: Tiny Model Guided Token Dropping for Vision Transformers
par: Wang, Guoxin, et autres
Publié: (2025)
par: Wang, Guoxin, et autres
Publié: (2025)
Assisting Research Proposal Writing with Large Language Models: Evaluation and Refinement
par: Ren, Jing, et autres
Publié: (2025)
par: Ren, Jing, et autres
Publié: (2025)
RL from Teacher-Model Refinement: Gradual Imitation Learning for Machine Translation
par: Lee, Dongyub Jude, et autres
Publié: (2025)
par: Lee, Dongyub Jude, et autres
Publié: (2025)
Querying Databases with Function Calling
par: Shorten, Connor, et autres
Publié: (2025)
par: Shorten, Connor, et autres
Publié: (2025)
Blue Teaming Function-Calling Agents
par: Dolcetti, Greta, et autres
Publié: (2026)
par: Dolcetti, Greta, et autres
Publié: (2026)
A Pure Transformer Pretraining Framework on Text-attributed Graphs
par: Song, Yu, et autres
Publié: (2024)
par: Song, Yu, et autres
Publié: (2024)
Tiny-QMoE
par: Cashman, Jack, et autres
Publié: (2025)
par: Cashman, Jack, et autres
Publié: (2025)
The Dark Side of Function Calling: Pathways to Jailbreaking Large Language Models
par: Wu, Zihui, et autres
Publié: (2024)
par: Wu, Zihui, et autres
Publié: (2024)
Test-time Adaptation of Tiny Recursive Models
par: McGovern, Ronan Killian
Publié: (2025)
par: McGovern, Ronan Killian
Publié: (2025)
Confidence-guided Refinement Reasoning for Zero-shot Question Answering
par: Jang, Youwon, et autres
Publié: (2025)
par: Jang, Youwon, et autres
Publié: (2025)
D-CoRP: Differentiable Connectivity Refinement for Functional Brain Networks
par: Hu, Haoyu, et autres
Publié: (2024)
par: Hu, Haoyu, et autres
Publié: (2024)
When Do Hallucinations Arise? A Graph Perspective on the Evolution of Path Reuse and Path Compression
par: Dai, Xinnan, et autres
Publié: (2026)
par: Dai, Xinnan, et autres
Publié: (2026)
Sigma-MoE-Tiny Technical Report
par: Hu, Qingguo, et autres
Publié: (2025)
par: Hu, Qingguo, et autres
Publié: (2025)
To Call or Not to Call: A Framework to Assess and Optimize LLM Tool Calling
par: Wu, Qinyuan, et autres
Publié: (2026)
par: Wu, Qinyuan, et autres
Publié: (2026)
Documents similaires
-
From Large to Super-Tiny: End-to-End Optimization for Cost-Efficient LLMs
par: Ni, Jiliang, et autres
Publié: (2025) -
Super Tiny Language Models
par: Hillier, Dylan, et autres
Publié: (2024) -
Improving Large Language Models Function Calling and Interpretability via Guided-Structured Templates
par: Dang, Hy, et autres
Publié: (2025) -
Tiny Refinements Elicit Resilience: Toward Efficient Prefix-Model Against LLM Red-Teaming
par: Liu, Jiaxu, et autres
Publié: (2024) -
Large Language Model as a Policy Teacher for Training Reinforcement Learning Agents
par: Zhou, Zihao, et autres
Publié: (2023)