From LLMs to Edge: Parameter-Efficient Fine-Tuning on Edge Devices
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Slamanig, Georg, Corti, Francesco, Saukh, Olga |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Forget the Data and Fine-Tuning! Just Fold the Network to Compress
von: Wang, Dong, et al.
Veröffentlicht: (2025)
von: Wang, Dong, et al.
Veröffentlicht: (2025)
Task-Aware Parameter-Efficient Fine-Tuning of Large Pre-Trained Models at the Edge
von: Hu, Senkang, et al.
Veröffentlicht: (2025)
von: Hu, Senkang, et al.
Veröffentlicht: (2025)
FED-FSTQ: Fisher-Guided Token Quantization for Communication-Efficient Federated Fine-Tuning of LLMs on Edge Devices
von: Li, Changyu, et al.
Veröffentlicht: (2026)
von: Li, Changyu, et al.
Veröffentlicht: (2026)
Empirical Guidelines for Deploying LLMs onto Resource-constrained Edge Devices
von: Qin, Ruiyang, et al.
Veröffentlicht: (2024)
von: Qin, Ruiyang, et al.
Veröffentlicht: (2024)
Efficiency vs. Alignment: Investigating Safety and Fairness Risks in Parameter-Efficient Fine-Tuning of LLMs
von: Taraghi, Mina, et al.
Veröffentlicht: (2025)
von: Taraghi, Mina, et al.
Veröffentlicht: (2025)
Parameter-Efficient Continual Fine-Tuning: A Survey
von: Coleman, Eric Nuertey, et al.
Veröffentlicht: (2025)
von: Coleman, Eric Nuertey, et al.
Veröffentlicht: (2025)
Parameter Efficiency Is Not Memory Efficiency: Rethinking Fine-Tuning for On-Device LLM Adaptation
von: Tenison, Irene, et al.
Veröffentlicht: (2026)
von: Tenison, Irene, et al.
Veröffentlicht: (2026)
Efficiently Distilling LLMs for Edge Applications
von: Kundu, Achintya, et al.
Veröffentlicht: (2024)
von: Kundu, Achintya, et al.
Veröffentlicht: (2024)
RevFFN: Memory-Efficient Full-Parameter Fine-Tuning of Mixture-of-Experts LLMs with Reversible Blocks
von: Liu, Ningyuan, et al.
Veröffentlicht: (2025)
von: Liu, Ningyuan, et al.
Veröffentlicht: (2025)
DyEdgeGAT: Dynamic Edge via Graph Attention for Early Fault Detection in IIoT Systems
von: Zhao, Mengjie, et al.
Veröffentlicht: (2023)
von: Zhao, Mengjie, et al.
Veröffentlicht: (2023)
Long Exposure: Accelerating Parameter-Efficient Fine-Tuning for LLMs under Shadowy Sparsity
von: Wang, Tuowei, et al.
Veröffentlicht: (2025)
von: Wang, Tuowei, et al.
Veröffentlicht: (2025)
Deconfounded Causality-aware Parameter-Efficient Fine-Tuning for Problem-Solving Improvement of LLMs
von: Wang, Ruoyu, et al.
Veröffentlicht: (2024)
von: Wang, Ruoyu, et al.
Veröffentlicht: (2024)
Position-Aware Parameter Efficient Fine-Tuning Approach for Reducing Positional Bias in LLMs
von: Zhang, Zheng, et al.
Veröffentlicht: (2024)
von: Zhang, Zheng, et al.
Veröffentlicht: (2024)
Parameter-Efficient Fine-Tuning for Foundation Models
von: Zhang, Dan, et al.
Veröffentlicht: (2025)
von: Zhang, Dan, et al.
Veröffentlicht: (2025)
Parameter-Efficient Fine-Tuning of LLMs with Mixture of Space Experts
von: Zhang, Buze, et al.
Veröffentlicht: (2026)
von: Zhang, Buze, et al.
Veröffentlicht: (2026)
PiCa: Parameter-Efficient Fine-Tuning with Column Space Projection
von: Hwang, Junseo, et al.
Veröffentlicht: (2025)
von: Hwang, Junseo, et al.
Veröffentlicht: (2025)
GateRA: Token-Aware Modulation for Parameter-Efficient Fine-Tuning
von: Ou, Jie, et al.
Veröffentlicht: (2025)
von: Ou, Jie, et al.
Veröffentlicht: (2025)
PERFT: Parameter-Efficient Routed Fine-Tuning for Mixture-of-Expert Model
von: Liu, Yilun, et al.
Veröffentlicht: (2024)
von: Liu, Yilun, et al.
Veröffentlicht: (2024)
Cut Less, Fold More: Model Compression through the Lens of Projection Geometry
von: Saukh, Olga, et al.
Veröffentlicht: (2026)
von: Saukh, Olga, et al.
Veröffentlicht: (2026)
Efficiently Learning at Test-Time: Active Fine-Tuning of LLMs
von: Hübotter, Jonas, et al.
Veröffentlicht: (2024)
von: Hübotter, Jonas, et al.
Veröffentlicht: (2024)
Edge-FIT: Federated Instruction Tuning of Quantized LLMs for Privacy-Preserving Smart Home Environments
von: Venkatesh, Vinay, et al.
Veröffentlicht: (2025)
von: Venkatesh, Vinay, et al.
Veröffentlicht: (2025)
Edge Prompt Tuning for Graph Neural Networks
von: Fu, Xingbo, et al.
Veröffentlicht: (2025)
von: Fu, Xingbo, et al.
Veröffentlicht: (2025)
FFT-MoE: Efficient Federated Fine-Tuning for Foundation Models via Large-scale Sparse MoE under Heterogeneous Edge
von: Hu, Gang, et al.
Veröffentlicht: (2025)
von: Hu, Gang, et al.
Veröffentlicht: (2025)
Parameter-Efficient Fine-Tuning with Discrete Fourier Transform
von: Gao, Ziqi, et al.
Veröffentlicht: (2024)
von: Gao, Ziqi, et al.
Veröffentlicht: (2024)
SVFT: Parameter-Efficient Fine-Tuning with Singular Vectors
von: Lingam, Vijay, et al.
Veröffentlicht: (2024)
von: Lingam, Vijay, et al.
Veröffentlicht: (2024)
Robust Federated Learning on Edge Devices with Domain Heterogeneity
von: Le, Huy Q., et al.
Veröffentlicht: (2025)
von: Le, Huy Q., et al.
Veröffentlicht: (2025)
Hardware-Aware DNN Compression for Homogeneous Edge Devices
von: Zhang, Kunlong, et al.
Veröffentlicht: (2025)
von: Zhang, Kunlong, et al.
Veröffentlicht: (2025)
EdgeLoRA: An Efficient Multi-Tenant LLM Serving System on Edge Devices
von: Shen, Zheyu, et al.
Veröffentlicht: (2025)
von: Shen, Zheyu, et al.
Veröffentlicht: (2025)
A Survey on Parameter-Efficient Fine-Tuning for Foundation Models in Federated Learning
von: Bian, Jieming, et al.
Veröffentlicht: (2025)
von: Bian, Jieming, et al.
Veröffentlicht: (2025)
LoCA: Location-Aware Cosine Adaptation for Parameter-Efficient Fine-Tuning
von: Du, Zhekai, et al.
Veröffentlicht: (2025)
von: Du, Zhekai, et al.
Veröffentlicht: (2025)
Automated Federated Pipeline for Parameter-Efficient Fine-Tuning of Large Language Models
von: Fang, Zihan, et al.
Veröffentlicht: (2024)
von: Fang, Zihan, et al.
Veröffentlicht: (2024)
Skip2-LoRA: A Lightweight On-device DNN Fine-tuning Method for Low-cost Edge Devices
von: Matsutani, Hiroki, et al.
Veröffentlicht: (2024)
von: Matsutani, Hiroki, et al.
Veröffentlicht: (2024)
REDS: Resource-Efficient Deep Subnetworks for Dynamic Resource Constraints
von: Corti, Francesco, et al.
Veröffentlicht: (2023)
von: Corti, Francesco, et al.
Veröffentlicht: (2023)
Efficient Edge LLMs Deployment via HessianAware Quantization and CPU GPU Collaborative
von: Zhang, Tuo, et al.
Veröffentlicht: (2025)
von: Zhang, Tuo, et al.
Veröffentlicht: (2025)
Quaff: Quantized Parameter-Efficient Fine-Tuning under Outlier Spatial Stability Hypothesis
von: Huang, Hong, et al.
Veröffentlicht: (2025)
von: Huang, Hong, et al.
Veröffentlicht: (2025)
A Bayesian Hybrid Parameter-Efficient Fine-Tuning Method for Large Language Models
von: Chai, Yidong, et al.
Veröffentlicht: (2025)
von: Chai, Yidong, et al.
Veröffentlicht: (2025)
GraLoRA: Granular Low-Rank Adaptation for Parameter-Efficient Fine-Tuning
von: Jung, Yeonjoon, et al.
Veröffentlicht: (2025)
von: Jung, Yeonjoon, et al.
Veröffentlicht: (2025)
Parameter-Efficient Fine-Tuning for Continual Learning: A Neural Tangent Kernel Perspective
von: Liu, Jingren, et al.
Veröffentlicht: (2024)
von: Liu, Jingren, et al.
Veröffentlicht: (2024)
Understanding and Guiding Layer Placement in Parameter-Efficient Fine-Tuning of Large Language Models
von: Xu, Yichen, et al.
Veröffentlicht: (2026)
von: Xu, Yichen, et al.
Veröffentlicht: (2026)
PrunePEFT: Iterative Hybrid Pruning for Parameter-Efficient Fine-tuning of LLMs
von: Yu, Tongzhou, et al.
Veröffentlicht: (2025)
von: Yu, Tongzhou, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Forget the Data and Fine-Tuning! Just Fold the Network to Compress
von: Wang, Dong, et al.
Veröffentlicht: (2025) -
Task-Aware Parameter-Efficient Fine-Tuning of Large Pre-Trained Models at the Edge
von: Hu, Senkang, et al.
Veröffentlicht: (2025) -
FED-FSTQ: Fisher-Guided Token Quantization for Communication-Efficient Federated Fine-Tuning of LLMs on Edge Devices
von: Li, Changyu, et al.
Veröffentlicht: (2026) -
Empirical Guidelines for Deploying LLMs onto Resource-constrained Edge Devices
von: Qin, Ruiyang, et al.
Veröffentlicht: (2024) -
Efficiency vs. Alignment: Investigating Safety and Fairness Risks in Parameter-Efficient Fine-Tuning of LLMs
von: Taraghi, Mina, et al.
Veröffentlicht: (2025)