Mini-Giants: "Small" Language Models and Open Source Win-Win
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhou, Zhengping, Li, Lezhi, Chen, Xinxi, Li, Andy |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Winning Amazon KDD Cup'24
par: Deotte, Chris, et autres
Publié: (2024)
par: Deotte, Chris, et autres
Publié: (2024)
ToolACE: Winning the Points of LLM Function Calling
par: Liu, Weiwen, et autres
Publié: (2024)
par: Liu, Weiwen, et autres
Publié: (2024)
Winning Big with Small Models: Knowledge Distillation vs. Self-Training for Reducing Hallucination in Product QA Agents
par: Lewis, Ashley, et autres
Publié: (2025)
par: Lewis, Ashley, et autres
Publié: (2025)
AIMO-2 Winning Solution: Building State-of-the-Art Mathematical Reasoning Models with OpenMathReasoning dataset
par: Moshkov, Ivan, et autres
Publié: (2025)
par: Moshkov, Ivan, et autres
Publié: (2025)
When Greedy Wins: Emergent Exploitation Bias in Meta-Bandit LLM Training
par: Chen, Sanxing, et autres
Publié: (2025)
par: Chen, Sanxing, et autres
Publié: (2025)
Random Masking Finds Winning Tickets for Parameter Efficient Fine-tuning
par: Xu, Jing, et autres
Publié: (2024)
par: Xu, Jing, et autres
Publié: (2024)
When Two LLMs Debate, Both Think They'll Win
par: Prasad, Pradyumna Shyama, et autres
Publié: (2025)
par: Prasad, Pradyumna Shyama, et autres
Publié: (2025)
When Shallow Wins: Silent Failures and the Depth-Accuracy Paradox in Latent Reasoning
par: Sahoo, Subramanyam, et autres
Publié: (2026)
par: Sahoo, Subramanyam, et autres
Publié: (2026)
Cheating Automatic LLM Benchmarks: Null Models Achieve High Win Rates
par: Zheng, Xiaosen, et autres
Publié: (2024)
par: Zheng, Xiaosen, et autres
Publié: (2024)
DeepSeek LLM: Scaling Open-Source Language Models with Longtermism
par: DeepSeek-AI, et autres
Publié: (2024)
par: DeepSeek-AI, et autres
Publié: (2024)
Fox-1: Open Small Language Model for Cloud and Edge
par: Hu, Zijian, et autres
Publié: (2024)
par: Hu, Zijian, et autres
Publié: (2024)
LOLA -- An Open-Source Massively Multilingual Large Language Model
par: Srivastava, Nikit, et autres
Publié: (2024)
par: Srivastava, Nikit, et autres
Publié: (2024)
Open-RAG: Enhanced Retrieval-Augmented Reasoning with Open-Source Large Language Models
par: Islam, Shayekh Bin, et autres
Publié: (2024)
par: Islam, Shayekh Bin, et autres
Publié: (2024)
Learn the Ropes, Then Trust the Wins: Self-imitation with Progressive Exploration for Agentic Reinforcement Learning
par: Qin, Yulei, et autres
Publié: (2025)
par: Qin, Yulei, et autres
Publié: (2025)
Hippocrates: An Open-Source Framework for Advancing Large Language Models in Healthcare
par: Acikgoz, Emre Can, et autres
Publié: (2024)
par: Acikgoz, Emre Can, et autres
Publié: (2024)
LLM-Match: An Open-Sourced Patient Matching Model Based on Large Language Models and Retrieval-Augmented Generation
par: Li, Xiaodi, et autres
Publié: (2025)
par: Li, Xiaodi, et autres
Publié: (2025)
The MiniMax-M2 Series: Mini Activations Unleashing Max Real-World Intelligence
par: MiniMax, et autres
Publié: (2026)
par: MiniMax, et autres
Publié: (2026)
MiniLingua: A Small Open-Source LLM for European Languages
par: Aksenova, Anna, et autres
Publié: (2025)
par: Aksenova, Anna, et autres
Publié: (2025)
All Language Models Large and Small
par: Chen, Zhixun, et autres
Publié: (2024)
par: Chen, Zhixun, et autres
Publié: (2024)
Can Large Language Models Play Text Games Well? Current State-of-the-Art and Open Questions
par: Tsai, Chen Feng, et autres
Publié: (2023)
par: Tsai, Chen Feng, et autres
Publié: (2023)
MiniCPM-SALA: Hybridizing Sparse and Linear Attention for Efficient Long-Context Modeling
par: MiniCPM Team, et autres
Publié: (2026)
par: MiniCPM Team, et autres
Publié: (2026)
Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs
par: Microsoft, et autres
Publié: (2025)
par: Microsoft, et autres
Publié: (2025)
Train Small, Infer Large: Memory-Efficient LoRA Training for Large Language Models
par: Zhang, Jun, et autres
Publié: (2025)
par: Zhang, Jun, et autres
Publié: (2025)
Mini-batch Coresets for Memory-efficient Language Model Training on Data Mixtures
par: Nguyen, Dang, et autres
Publié: (2024)
par: Nguyen, Dang, et autres
Publié: (2024)
MiniCache: KV Cache Compression in Depth Dimension for Large Language Models
par: Liu, Akide, et autres
Publié: (2024)
par: Liu, Akide, et autres
Publié: (2024)
Find A Winning Sign: Sign Is All We Need to Win the Lottery
par: Oh, Junghun, et autres
Publié: (2025)
par: Oh, Junghun, et autres
Publié: (2025)
Small Language Models: Survey, Measurements, and Insights
par: Lu, Zhenyan, et autres
Publié: (2024)
par: Lu, Zhenyan, et autres
Publié: (2024)
BioMistral: A Collection of Open-Source Pretrained Large Language Models for Medical Domains
par: Labrak, Yanis, et autres
Publié: (2024)
par: Labrak, Yanis, et autres
Publié: (2024)
Towards Adapting Open-Source Large Language Models for Expert-Level Clinical Note Generation
par: Wang, Hanyin, et autres
Publié: (2024)
par: Wang, Hanyin, et autres
Publié: (2024)
Robust Prompt Optimization for Defending Language Models Against Jailbreaking Attacks
par: Zhou, Andy, et autres
Publié: (2024)
par: Zhou, Andy, et autres
Publié: (2024)
Aurora-M: Open Source Continual Pre-training for Multilingual Language and Code
par: Nakamura, Taishi, et autres
Publié: (2024)
par: Nakamura, Taishi, et autres
Publié: (2024)
Small Language Models for Application Interactions: A Case Study
par: Li, Beibin, et autres
Publié: (2024)
par: Li, Beibin, et autres
Publié: (2024)
Agent Lumos: Unified and Modular Training for Open-Source Language Agents
par: Yin, Da, et autres
Publié: (2023)
par: Yin, Da, et autres
Publié: (2023)
MOM: Memory-Efficient Offloaded Mini-Sequence Inference for Long Context Language Models
par: Zhang, Junyang, et autres
Publié: (2025)
par: Zhang, Junyang, et autres
Publié: (2025)
Tamper-Resistant Safeguards for Open-Weight LLMs
par: Tamirisa, Rishub, et autres
Publié: (2024)
par: Tamirisa, Rishub, et autres
Publié: (2024)
Husky: A Unified, Open-Source Language Agent for Multi-Step Reasoning
par: Kim, Joongwon, et autres
Publié: (2024)
par: Kim, Joongwon, et autres
Publié: (2024)
Investigating Retrieval-Augmented Generation in Quranic Studies: A Study of 13 Open-Source Large Language Models
par: Khalila, Zahra, et autres
Publié: (2025)
par: Khalila, Zahra, et autres
Publié: (2025)
SpecForge: A Flexible and Efficient Open-Source Training Framework for Speculative Decoding
par: Li, Shenggui, et autres
Publié: (2026)
par: Li, Shenggui, et autres
Publié: (2026)
PhoneLM:an Efficient and Capable Small Language Model Family through Principled Pre-training
par: Yi, Rongjie, et autres
Publié: (2024)
par: Yi, Rongjie, et autres
Publié: (2024)
Weak-to-Strong Search: Align Large Language Models via Searching over Small Language Models
par: Zhou, Zhanhui, et autres
Publié: (2024)
par: Zhou, Zhanhui, et autres
Publié: (2024)
Documents similaires
-
Winning Amazon KDD Cup'24
par: Deotte, Chris, et autres
Publié: (2024) -
ToolACE: Winning the Points of LLM Function Calling
par: Liu, Weiwen, et autres
Publié: (2024) -
Winning Big with Small Models: Knowledge Distillation vs. Self-Training for Reducing Hallucination in Product QA Agents
par: Lewis, Ashley, et autres
Publié: (2025) -
AIMO-2 Winning Solution: Building State-of-the-Art Mathematical Reasoning Models with OpenMathReasoning dataset
par: Moshkov, Ivan, et autres
Publié: (2025) -
When Greedy Wins: Emergent Exploitation Bias in Meta-Bandit LLM Training
par: Chen, Sanxing, et autres
Publié: (2025)