RingAda: Pipelining Large Model Fine-Tuning on Edge Devices with Scheduled Layer Unfreezing
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Liang, Chen, Xiaopei, Wu, Wen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Memory-Efficient Split Federated Learning for LLM Fine-Tuning on Heterogeneous Mobile Devices
di: Chen, Xiaopei, et al.
Pubblicazione: (2025)
di: Chen, Xiaopei, et al.
Pubblicazione: (2025)
Memory-Efficient Federated Fine-Tuning of Large Language Models via Layer Pruning
di: Wu, Yebo, et al.
Pubblicazione: (2025)
di: Wu, Yebo, et al.
Pubblicazione: (2025)
Split Fine-Tuning for Large Language Models in Wireless Networks
di: Zhang, Songge, et al.
Pubblicazione: (2025)
di: Zhang, Songge, et al.
Pubblicazione: (2025)
A Reinforcement Learning-Driven Task Scheduling Algorithm for Multi-Tenant Distributed Systems
di: Zhang, Xiaopei, et al.
Pubblicazione: (2025)
di: Zhang, Xiaopei, et al.
Pubblicazione: (2025)
Energy-Efficient Split Learning for Fine-Tuning Large Language Models in Edge Networks
di: Li, Zuguang, et al.
Pubblicazione: (2024)
di: Li, Zuguang, et al.
Pubblicazione: (2024)
LRScheduler: A Layer-aware and Resource-adaptive Container Scheduler in Edge Computing
di: Tang, Zhiqing, et al.
Pubblicazione: (2025)
di: Tang, Zhiqing, et al.
Pubblicazione: (2025)
AdaPtis: Reducing Pipeline Bubbles with Adaptive Pipeline Parallelism on Heterogeneous Models
di: Guo, Jihu, et al.
Pubblicazione: (2025)
di: Guo, Jihu, et al.
Pubblicazione: (2025)
SLICE: SLO-Driven Scheduling for LLM Inference on Edge Computing Devices
di: Chow, Will
Pubblicazione: (2025)
di: Chow, Will
Pubblicazione: (2025)
Federated Fine-Tuning of Sparsely-Activated Large Language Models on Resource-Constrained Devices
di: Chen, Fahao, et al.
Pubblicazione: (2025)
di: Chen, Fahao, et al.
Pubblicazione: (2025)
EcoLoRA: Communication-Efficient Federated Fine-Tuning of Large Language Models
di: Liu, Han, et al.
Pubblicazione: (2025)
di: Liu, Han, et al.
Pubblicazione: (2025)
GenAI at the Edge: Comprehensive Survey on Empowering Edge Devices
di: Navardi, Mozhgan, et al.
Pubblicazione: (2025)
di: Navardi, Mozhgan, et al.
Pubblicazione: (2025)
A Predictive and Synergistic Two-Layer Scheduling Framework for LLM Serving
di: Zhang, Yue, et al.
Pubblicazione: (2025)
di: Zhang, Yue, et al.
Pubblicazione: (2025)
CrossPipe: Towards Optimal Pipeline Schedules for Cross-Datacenter Training
di: Chen, Tiancheng, et al.
Pubblicazione: (2025)
di: Chen, Tiancheng, et al.
Pubblicazione: (2025)
EDGE-LLM: Enabling Efficient Large Language Model Adaptation on Edge Devices via Layerwise Unified Compression and Adaptive Layer Tuning and Voting
di: Yu, Zhongzhi, et al.
Pubblicazione: (2024)
di: Yu, Zhongzhi, et al.
Pubblicazione: (2024)
Low-Latency Federated Fine-Tuning for Large Language Models Over Wireless Networks
di: Pang, Zhiwen, et al.
Pubblicazione: (2026)
di: Pang, Zhiwen, et al.
Pubblicazione: (2026)
SLO-Aware Scheduling for Large Language Model Inferences
di: Huang, Jinqi, et al.
Pubblicazione: (2025)
di: Huang, Jinqi, et al.
Pubblicazione: (2025)
AdaOper: Energy-efficient and Responsive Concurrent DNN Inference on Mobile Devices
di: Lin, Zheng, et al.
Pubblicazione: (2024)
di: Lin, Zheng, et al.
Pubblicazione: (2024)
TSFLora: Token-Compressed Split Fine-Tuning for Wireless Edge Networks
di: Qiang, Xianke, et al.
Pubblicazione: (2026)
di: Qiang, Xianke, et al.
Pubblicazione: (2026)
MemFine: Memory-Aware Fine-Grained Scheduling for MoE Training
di: Zhao, Lu, et al.
Pubblicazione: (2025)
di: Zhao, Lu, et al.
Pubblicazione: (2025)
AdaBridge: Dynamic Data and Computation Reuse for Efficient Multi-task DNN Co-evolution in Edge Systems
di: Wang, Lehao, et al.
Pubblicazione: (2024)
di: Wang, Lehao, et al.
Pubblicazione: (2024)
LoRA-C: Parameter-Efficient Fine-Tuning of Robust CNN for IoT Devices
di: Ding, Chuntao, et al.
Pubblicazione: (2024)
di: Ding, Chuntao, et al.
Pubblicazione: (2024)
Adaptive Configuration Selection for Multi-Model Inference Pipelines in Edge Computing
di: Sheng, Jinhao, et al.
Pubblicazione: (2025)
di: Sheng, Jinhao, et al.
Pubblicazione: (2025)
FedQuad: Adaptive Layer-wise LoRA Deployment and Activation Quantization for Federated Fine-Tuning
di: Li, Rukuo, et al.
Pubblicazione: (2025)
di: Li, Rukuo, et al.
Pubblicazione: (2025)
DiffusionPipe: Training Large Diffusion Models with Efficient Pipelines
di: Tian, Ye, et al.
Pubblicazione: (2024)
di: Tian, Ye, et al.
Pubblicazione: (2024)
CoEdge-RAG: Optimizing Hierarchical Scheduling for Retrieval-Augmented LLMs in Collaborative Edge Computing
di: Hong, Guihang, et al.
Pubblicazione: (2025)
di: Hong, Guihang, et al.
Pubblicazione: (2025)
Scale: Deep Reinforcement Learning for Container Scheduling in Serverless Edge Computing
di: Chen, Chen, et al.
Pubblicazione: (2026)
di: Chen, Chen, et al.
Pubblicazione: (2026)
Communication-Efficient Model Aggregation with Layer Divergence Feedback in Federated Learning
di: Wang, Liwei, et al.
Pubblicazione: (2024)
di: Wang, Liwei, et al.
Pubblicazione: (2024)
Elastic Mixture of Rank-Wise Experts for Knowledge Reuse in Federated Fine-Tuning
di: Wu, Yebo, et al.
Pubblicazione: (2025)
di: Wu, Yebo, et al.
Pubblicazione: (2025)
A Decentralized Microservice Scheduling Approach Using Service Mesh in Cloud-Edge Systems
di: Wen, Yangyang, et al.
Pubblicazione: (2025)
di: Wen, Yangyang, et al.
Pubblicazione: (2025)
Hermes: Memory-Efficient Pipeline Inference for Large Models on Edge Devices
di: Han, Xueyuan, et al.
Pubblicazione: (2024)
di: Han, Xueyuan, et al.
Pubblicazione: (2024)
HydraInfer: Hybrid Disaggregated Scheduling for Multimodal Large Language Model Serving
di: Dong, Xianzhe, et al.
Pubblicazione: (2025)
di: Dong, Xianzhe, et al.
Pubblicazione: (2025)
Environment-Aware Dynamic Pruning for Pipelined Edge Inference
di: O'Quinn, Austin, et al.
Pubblicazione: (2025)
di: O'Quinn, Austin, et al.
Pubblicazione: (2025)
Communication-Computation Pipeline Parallel Split Learning over Wireless Edge Networks
di: Liu, Chenyu, et al.
Pubblicazione: (2025)
di: Liu, Chenyu, et al.
Pubblicazione: (2025)
SneakPeek: Data-Aware Model Selection and Scheduling for Inference Serving on the Edge
di: Wolfrath, Joel, et al.
Pubblicazione: (2025)
di: Wolfrath, Joel, et al.
Pubblicazione: (2025)
Will LLMs Scaling Hit the Wall? Breaking Barriers via Distributed Resources on Massive Edge Devices
di: Shen, Tao, et al.
Pubblicazione: (2025)
di: Shen, Tao, et al.
Pubblicazione: (2025)
Flexible Personalized Split Federated Learning for On-Device Fine-Tuning of Foundation Models
di: Yuan, Tianjun, et al.
Pubblicazione: (2025)
di: Yuan, Tianjun, et al.
Pubblicazione: (2025)
SchEdge: A Dynamic, Multi-agent, and Scalable Scheduling Simulator for IoT Edge
di: Hamedi, Ali, et al.
Pubblicazione: (2025)
di: Hamedi, Ali, et al.
Pubblicazione: (2025)
Delay-Aware Large-Small Model Collaboration over LEO Satellite Networks
di: Guo, Mingyu, et al.
Pubblicazione: (2026)
di: Guo, Mingyu, et al.
Pubblicazione: (2026)
A Pipelined Collaborative Speculative Decoding Framework for Efficient Edge-Cloud LLM Inference
di: Zhang, Yida, et al.
Pubblicazione: (2026)
di: Zhang, Yida, et al.
Pubblicazione: (2026)
Exploring Selective Layer Fine-Tuning in Federated Learning
di: Sun, Yuchang, et al.
Pubblicazione: (2024)
di: Sun, Yuchang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Memory-Efficient Split Federated Learning for LLM Fine-Tuning on Heterogeneous Mobile Devices
di: Chen, Xiaopei, et al.
Pubblicazione: (2025) -
Memory-Efficient Federated Fine-Tuning of Large Language Models via Layer Pruning
di: Wu, Yebo, et al.
Pubblicazione: (2025) -
Split Fine-Tuning for Large Language Models in Wireless Networks
di: Zhang, Songge, et al.
Pubblicazione: (2025) -
A Reinforcement Learning-Driven Task Scheduling Algorithm for Multi-Tenant Distributed Systems
di: Zhang, Xiaopei, et al.
Pubblicazione: (2025) -
Energy-Efficient Split Learning for Fine-Tuning Large Language Models in Edge Networks
di: Li, Zuguang, et al.
Pubblicazione: (2024)