Adaptive Layer Splitting for Wireless LLM Inference in Edge Computing: A Model-Based Reinforcement Learning Approach
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Yuxuan, Li, Rongpeng, Yu, Xiaoxue, Zhao, Zhifeng, Zhang, Honggang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AirLLM: Diffusion Policy-based Adaptive LoRA for Remote Fine-Tuning of LLM over the Air
di: Yang, Shiyi, et al.
Pubblicazione: (2025)
di: Yang, Shiyi, et al.
Pubblicazione: (2025)
Tool-Aided Evolutionary LLM for Generative Policy Toward Efficient Resource Management in Wireless Federated Learning
di: Tan, Chongyang, et al.
Pubblicazione: (2025)
di: Tan, Chongyang, et al.
Pubblicazione: (2025)
Pareto Actor-Critic for Communication and Computation Co-Optimization in Non-Cooperative Federated Learning Services
di: Tan, Renxuan, et al.
Pubblicazione: (2025)
di: Tan, Renxuan, et al.
Pubblicazione: (2025)
Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game
di: Yuming, Xiang, et al.
Pubblicazione: (2025)
di: Yuming, Xiang, et al.
Pubblicazione: (2025)
Communications-Incentivized Collaborative Reasoning in NetGPT through Agentic Reinforcement Learning
di: Yu, Xiaoxue, et al.
Pubblicazione: (2026)
di: Yu, Xiaoxue, et al.
Pubblicazione: (2026)
Snake Learning: A Communication- and Computation-Efficient Distributed Learning Framework for 6G
di: Yu, Xiaoxue, et al.
Pubblicazione: (2024)
di: Yu, Xiaoxue, et al.
Pubblicazione: (2024)
Beyond Compromise: Pareto-Lenient Consensus for Efficient Multi-Preference LLM Alignment
di: Tan, Renxuan, et al.
Pubblicazione: (2026)
di: Tan, Renxuan, et al.
Pubblicazione: (2026)
MERLOT: A Distilled LLM-based Mixture-of-Experts Framework for Scalable Encrypted Traffic Classification
di: Chen, Yuxuan, et al.
Pubblicazione: (2024)
di: Chen, Yuxuan, et al.
Pubblicazione: (2024)
LLM-Empowered Agentic MAC Protocols: A Dynamic Stackelberg Game Approach
di: Tan, Renxuan, et al.
Pubblicazione: (2025)
di: Tan, Renxuan, et al.
Pubblicazione: (2025)
RALLY: Role-Adaptive LLM-Driven Yoked Navigation for Agentic UAV Swarms
di: Wang, Ziyao, et al.
Pubblicazione: (2025)
di: Wang, Ziyao, et al.
Pubblicazione: (2025)
Topology-Assisted Spatio-Temporal Pattern Disentangling for Scalable MARL in Large-scale Autonomous Traffic Control
di: Li, Rongpeng, et al.
Pubblicazione: (2025)
di: Li, Rongpeng, et al.
Pubblicazione: (2025)
Adaptive Split Learning over Energy-Constrained Wireless Edge Networks
di: Li, Zuguang, et al.
Pubblicazione: (2024)
di: Li, Zuguang, et al.
Pubblicazione: (2024)
Adaptive and Parallel Split Federated Learning in Vehicular Edge Computing
di: Qiang, Xianke, et al.
Pubblicazione: (2024)
di: Qiang, Xianke, et al.
Pubblicazione: (2024)
Memory- and Latency-Constrained Inference of Large Language Models via Adaptive Split Computing
di: Sung, Mingyu, et al.
Pubblicazione: (2025)
di: Sung, Mingyu, et al.
Pubblicazione: (2025)
NetWorld: Communication-Based Diffusion World Model for Multi-Agent Reinforcement Learning in Wireless Networks
di: Meng, Kechen, et al.
Pubblicazione: (2026)
di: Meng, Kechen, et al.
Pubblicazione: (2026)
Fate: Fast Edge Inference of Mixture-of-Experts Models via Cross-Layer Gate
di: Fang, Zhiyuan, et al.
Pubblicazione: (2025)
di: Fang, Zhiyuan, et al.
Pubblicazione: (2025)
Dynamic Quality-Latency Aware Routing for LLM Inference in Wireless Edge-Device Networks
di: Bao, Rui, et al.
Pubblicazione: (2025)
di: Bao, Rui, et al.
Pubblicazione: (2025)
Noise Distribution Decomposition based Multi-Agent Distributional Reinforcement Learning
di: Geng, Wei, et al.
Pubblicazione: (2023)
di: Geng, Wei, et al.
Pubblicazione: (2023)
EdgeRL: Reinforcement Learning-driven Deep Learning Model Inference Optimization at Edge
di: Mounesan, Motahare, et al.
Pubblicazione: (2024)
di: Mounesan, Motahare, et al.
Pubblicazione: (2024)
Structured Reinforcement Learning for Media Streaming at the Wireless Edge
di: Bura, Archana, et al.
Pubblicazione: (2024)
di: Bura, Archana, et al.
Pubblicazione: (2024)
Adaptive Layer Selection for Layer-Wise Token Pruning in LLM Inference
di: Taniguchi, Rei, et al.
Pubblicazione: (2026)
di: Taniguchi, Rei, et al.
Pubblicazione: (2026)
GHPO: Adaptive Guidance for Stable and Efficient LLM Reinforcement Learning
di: Liu, Ziru, et al.
Pubblicazione: (2025)
di: Liu, Ziru, et al.
Pubblicazione: (2025)
HiMAC: Hierarchical Macro-Micro Learning for Long-Horizon LLM Agents
di: Jin, Hongbo, et al.
Pubblicazione: (2026)
di: Jin, Hongbo, et al.
Pubblicazione: (2026)
Bounding-Box Inference for Error-Aware Model-Based Reinforcement Learning
di: Talvitie, Erin J., et al.
Pubblicazione: (2024)
di: Talvitie, Erin J., et al.
Pubblicazione: (2024)
The Edge-of-Reach Problem in Offline Model-Based Reinforcement Learning
di: Sims, Anya, et al.
Pubblicazione: (2024)
di: Sims, Anya, et al.
Pubblicazione: (2024)
Emergency Computing: An Adaptive Collaborative Inference Method Based on Hierarchical Reinforcement Learning
di: Fu, Weiqi, et al.
Pubblicazione: (2024)
di: Fu, Weiqi, et al.
Pubblicazione: (2024)
Diagnosing Training Inference Mismatch in LLM Reinforcement Learning
di: Zhong, Tianle, et al.
Pubblicazione: (2026)
di: Zhong, Tianle, et al.
Pubblicazione: (2026)
Reinforcement Learning-Based Heterogeneous Multi-Task Optimization in Semantic Broadcast Communications
di: Lu, Zhilin, et al.
Pubblicazione: (2025)
di: Lu, Zhilin, et al.
Pubblicazione: (2025)
Large Language Model (LLM)-enabled Reinforcement Learning for Wireless Network Optimization
di: Zheng, Jie, et al.
Pubblicazione: (2026)
di: Zheng, Jie, et al.
Pubblicazione: (2026)
ASFL: An Adaptive Model Splitting and Resource Allocation Framework for Split Federated Learning
di: Meng, Chuiyang, et al.
Pubblicazione: (2026)
di: Meng, Chuiyang, et al.
Pubblicazione: (2026)
RAMP: Reinforcement Adaptive Mixed Precision Quantization for Efficient On Device LLM Inference
di: Gautam, Arpit Singh, et al.
Pubblicazione: (2026)
di: Gautam, Arpit Singh, et al.
Pubblicazione: (2026)
HASFL: Heterogeneity-aware Split Federated Learning over Edge Computing Systems
di: Lin, Zheng, et al.
Pubblicazione: (2025)
di: Lin, Zheng, et al.
Pubblicazione: (2025)
Accelerating Mixture-of-Expert Inference with Adaptive Expert Split Mechanism
di: Yan, Jiaming, et al.
Pubblicazione: (2025)
di: Yan, Jiaming, et al.
Pubblicazione: (2025)
Fast AI Model Partition for Split Learning over Edge Networks
di: Li, Zuguang, et al.
Pubblicazione: (2025)
di: Li, Zuguang, et al.
Pubblicazione: (2025)
Select2Col: Leveraging Spatial-Temporal Importance of Semantic Information for Efficient Collaborative Perception
di: Liu, Yuntao, et al.
Pubblicazione: (2023)
di: Liu, Yuntao, et al.
Pubblicazione: (2023)
AdaptSFL: Adaptive Split Federated Learning in Resource-constrained Edge Networks
di: Lin, Zheng, et al.
Pubblicazione: (2024)
di: Lin, Zheng, et al.
Pubblicazione: (2024)
Multi-Agent Conditional Diffusion Model with Mean Field Communication as Wireless Resource Allocation Planner
di: Meng, Kechen, et al.
Pubblicazione: (2025)
di: Meng, Kechen, et al.
Pubblicazione: (2025)
Multi-Agent Reinforcement Learning for Task Offloading in Wireless Edge Networks
di: Fox, Andrea, et al.
Pubblicazione: (2025)
di: Fox, Andrea, et al.
Pubblicazione: (2025)
SplitMeanFlow: Interval Splitting Consistency in Few-Step Generative Modeling
di: Guo, Yi, et al.
Pubblicazione: (2025)
di: Guo, Yi, et al.
Pubblicazione: (2025)
Dynamic Semantic Compression for CNN Inference in Multi-access Edge Computing: A Graph Reinforcement Learning-based Autoencoder
di: Li, Nan, et al.
Pubblicazione: (2024)
di: Li, Nan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
AirLLM: Diffusion Policy-based Adaptive LoRA for Remote Fine-Tuning of LLM over the Air
di: Yang, Shiyi, et al.
Pubblicazione: (2025) -
Tool-Aided Evolutionary LLM for Generative Policy Toward Efficient Resource Management in Wireless Federated Learning
di: Tan, Chongyang, et al.
Pubblicazione: (2025) -
Pareto Actor-Critic for Communication and Computation Co-Optimization in Non-Cooperative Federated Learning Services
di: Tan, Renxuan, et al.
Pubblicazione: (2025) -
Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game
di: Yuming, Xiang, et al.
Pubblicazione: (2025) -
Communications-Incentivized Collaborative Reasoning in NetGPT through Agentic Reinforcement Learning
di: Yu, Xiaoxue, et al.
Pubblicazione: (2026)