EdgeMoE: Empowering Sparse Large Language Models on Mobile Devices
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yi, Rongjie, Guo, Liwei, Wei, Shiyun, Zhou, Ao, Wang, Shangguang, Xu, Mengwei |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2023
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
PhoneLM:an Efficient and Capable Small Language Model Family through Principled Pre-training
von: Yi, Rongjie, et al.
Veröffentlicht: (2024)
von: Yi, Rongjie, et al.
Veröffentlicht: (2024)
Recall: Empowering Multimodal Embedding for Edge Devices
von: Cai, Dongqi, et al.
Veröffentlicht: (2024)
von: Cai, Dongqi, et al.
Veröffentlicht: (2024)
LoRASuite: Efficient LoRA Adaptation Across Large Language Model Upgrades
von: Li, Yanan, et al.
Veröffentlicht: (2025)
von: Li, Yanan, et al.
Veröffentlicht: (2025)
LLaDA-MoE: A Sparse MoE Diffusion Language Model
von: Zhu, Fengqi, et al.
Veröffentlicht: (2025)
von: Zhu, Fengqi, et al.
Veröffentlicht: (2025)
Small Language Models: Survey, Measurements, and Insights
von: Lu, Zhenyan, et al.
Veröffentlicht: (2024)
von: Lu, Zhenyan, et al.
Veröffentlicht: (2024)
FedPT: Federated Proxy-Tuning of Large Language Models on Resource-Constrained Edge Devices
von: Gao, Zhidong, et al.
Veröffentlicht: (2024)
von: Gao, Zhidong, et al.
Veröffentlicht: (2024)
Empowering Working Memory for Large Language Model Agents
von: Guo, Jing, et al.
Veröffentlicht: (2023)
von: Guo, Jing, et al.
Veröffentlicht: (2023)
MobileMoE: Scaling On-Device Mixture of Experts
von: Chen, Yanbei, et al.
Veröffentlicht: (2026)
von: Chen, Yanbei, et al.
Veröffentlicht: (2026)
Focus on the Core: Empowering Diffusion Large Language Models by Self-Contrast
von: Feng, Jinyuan, et al.
Veröffentlicht: (2026)
von: Feng, Jinyuan, et al.
Veröffentlicht: (2026)
Chain-of-Rank: Enhancing Large Language Models for Domain-Specific RAG in Edge Device
von: Lee, Juntae, et al.
Veröffentlicht: (2025)
von: Lee, Juntae, et al.
Veröffentlicht: (2025)
Elastic On-Device LLM Service
von: Yin, Wangsong, et al.
Veröffentlicht: (2024)
von: Yin, Wangsong, et al.
Veröffentlicht: (2024)
CataLM: Empowering Catalyst Design Through Large Language Models
von: Wang, Ludi, et al.
Veröffentlicht: (2024)
von: Wang, Ludi, et al.
Veröffentlicht: (2024)
LocMoE: A Low-Overhead MoE for Large Language Model Training
von: Li, Jing, et al.
Veröffentlicht: (2024)
von: Li, Jing, et al.
Veröffentlicht: (2024)
Empowering Large Language Model Agents through Action Learning
von: Zhao, Haiteng, et al.
Veröffentlicht: (2024)
von: Zhao, Haiteng, et al.
Veröffentlicht: (2024)
OverleafCopilot: Empowering Academic Writing in Overleaf with Large Language Models
von: Wen, Haomin, et al.
Veröffentlicht: (2024)
von: Wen, Haomin, et al.
Veröffentlicht: (2024)
Empowering Large Language Models for Textual Data Augmentation
von: Li, Yichuan, et al.
Veröffentlicht: (2024)
von: Li, Yichuan, et al.
Veröffentlicht: (2024)
WizardCoder: Empowering Code Large Language Models with Evol-Instruct
von: Luo, Ziyang, et al.
Veröffentlicht: (2023)
von: Luo, Ziyang, et al.
Veröffentlicht: (2023)
Probing Multimodal Large Language Models for Global and Local Semantic Representations
von: Tao, Mingxu, et al.
Veröffentlicht: (2024)
von: Tao, Mingxu, et al.
Veröffentlicht: (2024)
AD-GPT: Large Language Models in Alzheimer's Disease
von: Liu, Ziyu, et al.
Veröffentlicht: (2025)
von: Liu, Ziyu, et al.
Veröffentlicht: (2025)
High-throughput Biomedical Relation Extraction for Semi-Structured Web Articles Empowered by Large Language Models
von: Zhou, Songchi, et al.
Veröffentlicht: (2023)
von: Zhou, Songchi, et al.
Veröffentlicht: (2023)
Sensitivity Meets Sparsity: The Impact of Extremely Sparse Parameter Patterns on Theory-of-Mind of Large Language Models
von: Wu, Yuheng, et al.
Veröffentlicht: (2025)
von: Wu, Yuheng, et al.
Veröffentlicht: (2025)
Mix-MoE: Improving Multilingual Machine Translation of Large Language Models through Mixed MoEs
von: Li, Bo, et al.
Veröffentlicht: (2026)
von: Li, Bo, et al.
Veröffentlicht: (2026)
CityGPT: Empowering Urban Spatial Cognition of Large Language Models
von: Feng, Jie, et al.
Veröffentlicht: (2024)
von: Feng, Jie, et al.
Veröffentlicht: (2024)
Empowering Private Tutoring by Chaining Large Language Models
von: Chen, Yulin, et al.
Veröffentlicht: (2023)
von: Chen, Yulin, et al.
Veröffentlicht: (2023)
SMAR: Soft Modality-Aware Routing Strategy for MoE-based Multimodal Large Language Models Preserving Language Capabilities
von: Xia, Guoyang, et al.
Veröffentlicht: (2025)
von: Xia, Guoyang, et al.
Veröffentlicht: (2025)
Evaluating Ill-Defined Tasks in Large Language Models
von: Zhou, Yi, et al.
Veröffentlicht: (2026)
von: Zhou, Yi, et al.
Veröffentlicht: (2026)
MedAide: Leveraging Large Language Models for On-Premise Medical Assistance on Edge Devices
von: Basit, Abdul, et al.
Veröffentlicht: (2024)
von: Basit, Abdul, et al.
Veröffentlicht: (2024)
GP-GPT: Large Language Model for Gene-Phenotype Mapping
von: Lyu, Yanjun, et al.
Veröffentlicht: (2024)
von: Lyu, Yanjun, et al.
Veröffentlicht: (2024)
Empowering Molecule Discovery for Molecule-Caption Translation with Large Language Models: A ChatGPT Perspective
von: Li, Jiatong, et al.
Veröffentlicht: (2023)
von: Li, Jiatong, et al.
Veröffentlicht: (2023)
CoME: Empowering Channel-of-Mobile-Experts with Informative Hybrid-Capabilities Reasoning
von: Liu, Yuxuan, et al.
Veröffentlicht: (2026)
von: Liu, Yuxuan, et al.
Veröffentlicht: (2026)
AquilaMoE: Efficient Training for MoE Models with Scale-Up and Scale-Out Strategies
von: Zhang, Bo-Wen, et al.
Veröffentlicht: (2024)
von: Zhang, Bo-Wen, et al.
Veröffentlicht: (2024)
GraphInstruct: Empowering Large Language Models with Graph Understanding and Reasoning Capability
von: Luo, Zihan, et al.
Veröffentlicht: (2024)
von: Luo, Zihan, et al.
Veröffentlicht: (2024)
A Large Language Model-Empowered Agent for Reliable and Robust Structural Analysis
von: Liu, Jiachen, et al.
Veröffentlicht: (2025)
von: Liu, Jiachen, et al.
Veröffentlicht: (2025)
MoE-Pruner: Pruning Mixture-of-Experts Large Language Model using the Hints from Its Router
von: Xie, Yanyue, et al.
Veröffentlicht: (2024)
von: Xie, Yanyue, et al.
Veröffentlicht: (2024)
Large Language Models Empowered Personalized Web Agents
von: Cai, Hongru, et al.
Veröffentlicht: (2024)
von: Cai, Hongru, et al.
Veröffentlicht: (2024)
DroidCall: A Dataset for LLM-powered Android Intent Invocation
von: Xie, Weikai, et al.
Veröffentlicht: (2024)
von: Xie, Weikai, et al.
Veröffentlicht: (2024)
Sparse Auto-Encoders and Holism about Large Language Models
von: Grindrod, Jumbly
Veröffentlicht: (2026)
von: Grindrod, Jumbly
Veröffentlicht: (2026)
MoZIP: A Multilingual Benchmark to Evaluate Large Language Models in Intellectual Property
von: Ni, Shiwen, et al.
Veröffentlicht: (2024)
von: Ni, Shiwen, et al.
Veröffentlicht: (2024)
Achieving Sparse Activation in Small Language Models
von: Song, Jifeng, et al.
Veröffentlicht: (2024)
von: Song, Jifeng, et al.
Veröffentlicht: (2024)
MoE-CT: A Novel Approach For Large Language Models Training With Resistance To Catastrophic Forgetting
von: Li, Tianhao, et al.
Veröffentlicht: (2024)
von: Li, Tianhao, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
PhoneLM:an Efficient and Capable Small Language Model Family through Principled Pre-training
von: Yi, Rongjie, et al.
Veröffentlicht: (2024) -
Recall: Empowering Multimodal Embedding for Edge Devices
von: Cai, Dongqi, et al.
Veröffentlicht: (2024) -
LoRASuite: Efficient LoRA Adaptation Across Large Language Model Upgrades
von: Li, Yanan, et al.
Veröffentlicht: (2025) -
LLaDA-MoE: A Sparse MoE Diffusion Language Model
von: Zhu, Fengqi, et al.
Veröffentlicht: (2025) -
Small Language Models: Survey, Measurements, and Insights
von: Lu, Zhenyan, et al.
Veröffentlicht: (2024)