Small Language Models for Application Interactions: A Case Study
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Li, Beibin, Zhang, Yi, Bubeck, Sébastien, Pathuri, Jeevan, Menache, Ishai |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Large Language Models for Supply Chain Decisions
von: Simchi-Levi, David, et al.
Veröffentlicht: (2025)
von: Simchi-Levi, David, et al.
Veröffentlicht: (2025)
Towards Foundation Models for Mixed Integer Linear Programming
von: Li, Sirui, et al.
Veröffentlicht: (2024)
von: Li, Sirui, et al.
Veröffentlicht: (2024)
Small Language Models: Survey, Measurements, and Insights
von: Lu, Zhenyan, et al.
Veröffentlicht: (2024)
von: Lu, Zhenyan, et al.
Veröffentlicht: (2024)
Are Small Language Models Ready to Compete with Large Language Models for Practical Applications?
von: Sinha, Neelabh, et al.
Veröffentlicht: (2024)
von: Sinha, Neelabh, et al.
Veröffentlicht: (2024)
Accurate Prediction of Ligand-Protein Interaction Affinities with Fine-Tuned Small Language Models
von: Fauber, Ben
Veröffentlicht: (2024)
von: Fauber, Ben
Veröffentlicht: (2024)
On the Emergence of Thinking in LLMs I: Searching for the Right Intuition
von: Ye, Guanghao, et al.
Veröffentlicht: (2025)
von: Ye, Guanghao, et al.
Veröffentlicht: (2025)
PhoneLM:an Efficient and Capable Small Language Model Family through Principled Pre-training
von: Yi, Rongjie, et al.
Veröffentlicht: (2024)
von: Yi, Rongjie, et al.
Veröffentlicht: (2024)
Designing Algorithms Empowered by Language Models: An Analytical Framework, Case Studies, and Insights
von: Chen, Yanxi, et al.
Veröffentlicht: (2024)
von: Chen, Yanxi, et al.
Veröffentlicht: (2024)
Small or Large? Zero-Shot or Finetuned? Guiding Language Model Choice for Specialized Applications in Healthcare
von: Gondara, Lovedeep, et al.
Veröffentlicht: (2025)
von: Gondara, Lovedeep, et al.
Veröffentlicht: (2025)
Stacking Small Language Models for Generalizability
von: Liang, Laurence
Veröffentlicht: (2024)
von: Liang, Laurence
Veröffentlicht: (2024)
All Language Models Large and Small
von: Chen, Zhixun, et al.
Veröffentlicht: (2024)
von: Chen, Zhixun, et al.
Veröffentlicht: (2024)
Mini-Giants: "Small" Language Models and Open Source Win-Win
von: Zhou, Zhengping, et al.
Veröffentlicht: (2023)
von: Zhou, Zhengping, et al.
Veröffentlicht: (2023)
Towards Interpreting Language Models: A Case Study in Multi-Hop Reasoning
von: Sakarvadia, Mansi
Veröffentlicht: (2024)
von: Sakarvadia, Mansi
Veröffentlicht: (2024)
Fox-1: Open Small Language Model for Cloud and Edge
von: Hu, Zijian, et al.
Veröffentlicht: (2024)
von: Hu, Zijian, et al.
Veröffentlicht: (2024)
Kakugo: Distillation of Low-Resource Languages into Small Language Models
von: Devine, Peter, et al.
Veröffentlicht: (2026)
von: Devine, Peter, et al.
Veröffentlicht: (2026)
Squat: Quant Small Language Models on the Edge
von: Shen, Xuan, et al.
Veröffentlicht: (2024)
von: Shen, Xuan, et al.
Veröffentlicht: (2024)
Towards Reasoning Ability of Small Language Models
von: Srivastava, Gaurav, et al.
Veröffentlicht: (2025)
von: Srivastava, Gaurav, et al.
Veröffentlicht: (2025)
Hymba: A Hybrid-head Architecture for Small Language Models
von: Dong, Xin, et al.
Veröffentlicht: (2024)
von: Dong, Xin, et al.
Veröffentlicht: (2024)
Adapt-Pruner: Adaptive Structural Pruning for Efficient Small Language Model Training
von: Pan, Rui, et al.
Veröffentlicht: (2025)
von: Pan, Rui, et al.
Veröffentlicht: (2025)
CASCADE: Case-Based Continual Adaptation for Large Language Models During Deployment
von: Guo, Siyuan, et al.
Veröffentlicht: (2026)
von: Guo, Siyuan, et al.
Veröffentlicht: (2026)
A Post-Training Enhanced Optimization Approach for Small Language Models
von: Zhai, Keke
Veröffentlicht: (2024)
von: Zhai, Keke
Veröffentlicht: (2024)
KIEval: A Knowledge-grounded Interactive Evaluation Framework for Large Language Models
von: Yu, Zhuohao, et al.
Veröffentlicht: (2024)
von: Yu, Zhuohao, et al.
Veröffentlicht: (2024)
Train Small, Infer Large: Memory-Efficient LoRA Training for Large Language Models
von: Zhang, Jun, et al.
Veröffentlicht: (2025)
von: Zhang, Jun, et al.
Veröffentlicht: (2025)
VocabTailor: Dynamic Vocabulary Selection for Downstream Tasks in Small Language Models
von: Zhang, Hanling, et al.
Veröffentlicht: (2025)
von: Zhang, Hanling, et al.
Veröffentlicht: (2025)
All or None: Identifiable Linear Properties of Next-token Predictors in Language Modeling
von: Marconato, Emanuele, et al.
Veröffentlicht: (2024)
von: Marconato, Emanuele, et al.
Veröffentlicht: (2024)
Sparse Shift Autoencoders for Identifying Concepts from Large Language Model Activations
von: Joshi, Shruti, et al.
Veröffentlicht: (2025)
von: Joshi, Shruti, et al.
Veröffentlicht: (2025)
Technical Report: Small Language Model for Japanese Clinical and Medicine
von: Watanabe, Shogo
Veröffentlicht: (2024)
von: Watanabe, Shogo
Veröffentlicht: (2024)
Domain-Adapted Small Language Models for Reliable Clinical Triage
von: Aljohani, Manar, et al.
Veröffentlicht: (2026)
von: Aljohani, Manar, et al.
Veröffentlicht: (2026)
MLB: A Scenario-Driven Benchmark for Evaluating Large Language Models in Clinical Applications
von: He, Qing, et al.
Veröffentlicht: (2026)
von: He, Qing, et al.
Veröffentlicht: (2026)
Rethinking LLM-as-a-Judge: Representation-as-a-Judge with Small Language Models via Semantic Capacity Asymmetry
von: Li, Zhuochun, et al.
Veröffentlicht: (2026)
von: Li, Zhuochun, et al.
Veröffentlicht: (2026)
Model-diff: A Tool for Comparative Study of Language Models in the Input Space
von: Liu, Weitang, et al.
Veröffentlicht: (2024)
von: Liu, Weitang, et al.
Veröffentlicht: (2024)
PlaSma: Making Small Language Models Better Procedural Knowledge Models for (Counterfactual) Planning
von: Brahman, Faeze, et al.
Veröffentlicht: (2023)
von: Brahman, Faeze, et al.
Veröffentlicht: (2023)
Weak-to-Strong Search: Align Large Language Models via Searching over Small Language Models
von: Zhou, Zhanhui, et al.
Veröffentlicht: (2024)
von: Zhou, Zhanhui, et al.
Veröffentlicht: (2024)
PARAMANU-GANITA: Can Small Math Language Models Rival with Large Language Models on Mathematical Reasoning?
von: Niyogi, Mitodru, et al.
Veröffentlicht: (2024)
von: Niyogi, Mitodru, et al.
Veröffentlicht: (2024)
Small Language Models for Privacy-Preserving Clinical Information Extraction in Low-Resource Languages
von: Ghaffarzadeh-Esfahani, Mohammadreza, et al.
Veröffentlicht: (2026)
von: Ghaffarzadeh-Esfahani, Mohammadreza, et al.
Veröffentlicht: (2026)
Aligning Language Models from User Interactions
von: Buening, Thomas Kleine, et al.
Veröffentlicht: (2026)
von: Buening, Thomas Kleine, et al.
Veröffentlicht: (2026)
SmallToLarge (S2L): Scalable Data Selection for Fine-tuning Large Language Models by Summarizing Training Trajectories of Small Models
von: Yang, Yu, et al.
Veröffentlicht: (2024)
von: Yang, Yu, et al.
Veröffentlicht: (2024)
Large Language Models Meet Text-Attributed Graphs: A Survey of Integration Frameworks and Applications
von: Su, Guangxin, et al.
Veröffentlicht: (2025)
von: Su, Guangxin, et al.
Veröffentlicht: (2025)
PMPO: Probabilistic Metric Prompt Optimization for Small and Large Language Models
von: Zhao, Chenzhuo, et al.
Veröffentlicht: (2025)
von: Zhao, Chenzhuo, et al.
Veröffentlicht: (2025)
Luna-2: Scalable Single-Token Evaluation with Small Language Models
von: Goel, Vatsal, et al.
Veröffentlicht: (2026)
von: Goel, Vatsal, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Large Language Models for Supply Chain Decisions
von: Simchi-Levi, David, et al.
Veröffentlicht: (2025) -
Towards Foundation Models for Mixed Integer Linear Programming
von: Li, Sirui, et al.
Veröffentlicht: (2024) -
Small Language Models: Survey, Measurements, and Insights
von: Lu, Zhenyan, et al.
Veröffentlicht: (2024) -
Are Small Language Models Ready to Compete with Large Language Models for Practical Applications?
von: Sinha, Neelabh, et al.
Veröffentlicht: (2024) -
Accurate Prediction of Ligand-Protein Interaction Affinities with Fine-Tuned Small Language Models
von: Fauber, Ben
Veröffentlicht: (2024)