Improving Large Models with Small models: Lower Costs and Better Performance
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Dong, Zhang, Shuo, Zhuang, Yueting, Tang, Siliang, Liu, Qidong, Wang, Hua, Xu, Mingliang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Logic Distillation: Learning from Code Function by Function for Decision-making Tasks
por: Chen, Dong, et al.
Publicado: (2024)
por: Chen, Dong, et al.
Publicado: (2024)
IDEAL: Leveraging Infinite and Dynamic Characterizations of Large Language Models for Query-focused Summarization
por: Cao, Jie, et al.
Publicado: (2024)
por: Cao, Jie, et al.
Publicado: (2024)
KKA: Improving Vision Anomaly Detection through Anomaly-related Knowledge from Large Language Models
por: Chen, Dong, et al.
Publicado: (2025)
por: Chen, Dong, et al.
Publicado: (2025)
Bridging Local Details and Global Context in Text-Attributed Graphs
por: Wang, Yaoke, et al.
Publicado: (2024)
por: Wang, Yaoke, et al.
Publicado: (2024)
DuetRAG: Collaborative Retrieval-Augmented Generation
por: Jiao, Dian, et al.
Publicado: (2024)
por: Jiao, Dian, et al.
Publicado: (2024)
MoA: Heterogeneous Mixture of Adapters for Parameter-Efficient Fine-Tuning of Large Language Models
por: Cao, Jie, et al.
Publicado: (2025)
por: Cao, Jie, et al.
Publicado: (2025)
Chart-HQA: A Benchmark for Hypothetical Question Answering in Charts
por: Chen, Xiangnan, et al.
Publicado: (2025)
por: Chen, Xiangnan, et al.
Publicado: (2025)
APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts
por: Dong, Honghua, et al.
Publicado: (2024)
por: Dong, Honghua, et al.
Publicado: (2024)
Training-free Ultra Small Model for Universal Sparse Reconstruction in Compressed Sensing
por: Tang, Chaoqing, et al.
Publicado: (2025)
por: Tang, Chaoqing, et al.
Publicado: (2025)
All Language Models Large and Small
por: Chen, Zhixun, et al.
Publicado: (2024)
por: Chen, Zhixun, et al.
Publicado: (2024)
Weak-to-Strong Search: Align Large Language Models via Searching over Small Language Models
por: Zhou, Zhanhui, et al.
Publicado: (2024)
por: Zhou, Zhanhui, et al.
Publicado: (2024)
Improving Phishing Email Detection Performance of Small Large Language Models
por: Lin, Zijie, et al.
Publicado: (2025)
por: Lin, Zijie, et al.
Publicado: (2025)
PlaSma: Making Small Language Models Better Procedural Knowledge Models for (Counterfactual) Planning
por: Brahman, Faeze, et al.
Publicado: (2023)
por: Brahman, Faeze, et al.
Publicado: (2023)
Self-Contrast: Better Reflection Through Inconsistent Solving Perspectives
por: Zhang, Wenqi, et al.
Publicado: (2024)
por: Zhang, Wenqi, et al.
Publicado: (2024)
Rephrase and Respond: Let Large Language Models Ask Better Questions for Themselves
por: Deng, Yihe, et al.
Publicado: (2023)
por: Deng, Yihe, et al.
Publicado: (2023)
QLLM: Accurate and Efficient Low-Bitwidth Quantization for Large Language Models
por: Liu, Jing, et al.
Publicado: (2023)
por: Liu, Jing, et al.
Publicado: (2023)
Meta-Reflection: A Feedback-Free Reflection Learning Framework
por: Wang, Yaoke, et al.
Publicado: (2024)
por: Wang, Yaoke, et al.
Publicado: (2024)
KCM: KAN-Based Collaboration Models Enhance Pretrained Large Models
por: Dai, Guangyu, et al.
Publicado: (2025)
por: Dai, Guangyu, et al.
Publicado: (2025)
Collaborative Performance Prediction for Large Language Models
por: Zhang, Qiyuan, et al.
Publicado: (2024)
por: Zhang, Qiyuan, et al.
Publicado: (2024)
Improving Reasoning Performance in Large Language Models via Representation Engineering
por: Højer, Bertram, et al.
Publicado: (2025)
por: Højer, Bertram, et al.
Publicado: (2025)
Language Models can Self-Improve at State-Value Estimation for Better Search
por: Mendes, Ethan, et al.
Publicado: (2025)
por: Mendes, Ethan, et al.
Publicado: (2025)
SPaR: Self-Play with Tree-Search Refinement to Improve Instruction-Following in Large Language Models
por: Cheng, Jiale, et al.
Publicado: (2024)
por: Cheng, Jiale, et al.
Publicado: (2024)
EvidenceMap: Learning Evidence Analysis to Unleash the Power of Small Language Models for Biomedical Question Answering
por: Zong, Chang, et al.
Publicado: (2025)
por: Zong, Chang, et al.
Publicado: (2025)
Conifer: Improving Complex Constrained Instruction-Following Ability of Large Language Models
por: Sun, Haoran, et al.
Publicado: (2024)
por: Sun, Haoran, et al.
Publicado: (2024)
Foundational Autoraters: Taming Large Language Models for Better Automatic Evaluation
por: Vu, Tu, et al.
Publicado: (2024)
por: Vu, Tu, et al.
Publicado: (2024)
Reasoning is Periodicity? Improving Large Language Models Through Effective Periodicity Modeling
por: Dong, Yihong, et al.
Publicado: (2025)
por: Dong, Yihong, et al.
Publicado: (2025)
Lexicon-Level Contrastive Visual-Grounding Improves Language Modeling
por: Zhuang, Chengxu, et al.
Publicado: (2024)
por: Zhuang, Chengxu, et al.
Publicado: (2024)
Neural Parameter Search for Slimmer Fine-Tuned Models and Better Transfer
por: Du, Guodong, et al.
Publicado: (2025)
por: Du, Guodong, et al.
Publicado: (2025)
Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models
por: Bello, Femi, et al.
Publicado: (2025)
por: Bello, Femi, et al.
Publicado: (2025)
Hephaestus: Improving Fundamental Agent Capabilities of Large Language Models through Continual Pre-Training
por: Zhuang, Yuchen, et al.
Publicado: (2025)
por: Zhuang, Yuchen, et al.
Publicado: (2025)
InftyThink: Breaking the Length Limits of Long-Context Reasoning in Large Language Models
por: Yan, Yuchen, et al.
Publicado: (2025)
por: Yan, Yuchen, et al.
Publicado: (2025)
Emissions and Performance Trade-off Between Small and Large Language Models
por: Garg, Anandita, et al.
Publicado: (2025)
por: Garg, Anandita, et al.
Publicado: (2025)
Does Biomedical Training Lead to Better Medical Performance?
por: Dada, Amin, et al.
Publicado: (2024)
por: Dada, Amin, et al.
Publicado: (2024)
A Simple and Effective Pruning Approach for Large Language Models
por: Sun, Mingjie, et al.
Publicado: (2023)
por: Sun, Mingjie, et al.
Publicado: (2023)
PMPO: Probabilistic Metric Prompt Optimization for Small and Large Language Models
por: Zhao, Chenzhuo, et al.
Publicado: (2025)
por: Zhao, Chenzhuo, et al.
Publicado: (2025)
Leveraging Group Relative Policy Optimization to Advance Large Language Models in Traditional Chinese Medicine
por: Xie, Jiacheng, et al.
Publicado: (2025)
por: Xie, Jiacheng, et al.
Publicado: (2025)
Cost-Optimal Grouped-Query Attention for Long-Context Modeling
por: Chen, Yingfa, et al.
Publicado: (2025)
por: Chen, Yingfa, et al.
Publicado: (2025)
SmallToLarge (S2L): Scalable Data Selection for Fine-tuning Large Language Models by Summarizing Training Trajectories of Small Models
por: Yang, Yu, et al.
Publicado: (2024)
por: Yang, Yu, et al.
Publicado: (2024)
Train Small, Infer Large: Memory-Efficient LoRA Training for Large Language Models
por: Zhang, Jun, et al.
Publicado: (2025)
por: Zhang, Jun, et al.
Publicado: (2025)
Rethinking Data: Towards Better Performing Domain-Specific Small Language Models
por: Nazarov, Boris, et al.
Publicado: (2025)
por: Nazarov, Boris, et al.
Publicado: (2025)
Ejemplares similares
-
Logic Distillation: Learning from Code Function by Function for Decision-making Tasks
por: Chen, Dong, et al.
Publicado: (2024) -
IDEAL: Leveraging Infinite and Dynamic Characterizations of Large Language Models for Query-focused Summarization
por: Cao, Jie, et al.
Publicado: (2024) -
KKA: Improving Vision Anomaly Detection through Anomaly-related Knowledge from Large Language Models
por: Chen, Dong, et al.
Publicado: (2025) -
Bridging Local Details and Global Context in Text-Attributed Graphs
por: Wang, Yaoke, et al.
Publicado: (2024) -
DuetRAG: Collaborative Retrieval-Augmented Generation
por: Jiao, Dian, et al.
Publicado: (2024)