Towards Integrated Fine-tuning and Inference when Generative AI meets Edge Intelligence
Fuente:
arXiv
Saved in:
| Main Authors: | Chen, Ning, Cheng, Zhipeng, Fan, Xuwei, Xia, Xiaoyu, Huang, Lianfen |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
QoE-oriented Dependent Task Scheduling under Multi-dimensional QoS Constraints over Distributed Networks
by: Fan, Xuwei, et al.
Published: (2023)
by: Fan, Xuwei, et al.
Published: (2023)
Integrated Sensing, Communication, and Computing: An Information-oriented Resource Transaction Mechanism
by: Chen, Ning, et al.
Published: (2024)
by: Chen, Ning, et al.
Published: (2024)
Two-Timescale Model Caching and Resource Allocation for Edge-Enabled AI-Generated Content Services
by: Liu, Zhang, et al.
Published: (2024)
by: Liu, Zhang, et al.
Published: (2024)
Fine-tuning Multimodal Transformers on Edge: A Parallel Split Learning Approach
by: Fudala, Timo, et al.
Published: (2025)
by: Fudala, Timo, et al.
Published: (2025)
AI-in-the-Loop Sensing and Communication Joint Design for Edge Intelligence
by: Cai, Zhijie, et al.
Published: (2025)
by: Cai, Zhijie, et al.
Published: (2025)
A Survey on Collaborative DNN Inference for Edge Intelligence
by: Ren, Weiqing, et al.
Published: (2022)
by: Ren, Weiqing, et al.
Published: (2022)
Intelligent Orchestration of Distributed Large Foundation Model Inference at the Edge
by: Koch, Fernando, et al.
Published: (2025)
by: Koch, Fernando, et al.
Published: (2025)
Semantic-aware Token Selection and Resource Optimization for Communication-efficient Split Federated Fine-tuning in Edge Intelligence
by: Qiang, Xianke, et al.
Published: (2026)
by: Qiang, Xianke, et al.
Published: (2026)
Unleashing the Power of Tree-of-Thoughts for Edge-Enabled AIGC Service Provisioning
by: Liu, Zhang, et al.
Published: (2026)
by: Liu, Zhang, et al.
Published: (2026)
MobiZO: Enabling Efficient LLM Fine-Tuning at the Edge via Inference Engines
by: Gao, Lei, et al.
Published: (2024)
by: Gao, Lei, et al.
Published: (2024)
Learning the Optimal Path and DNN Partition for Collaborative Edge Inference
by: Huang, Yin, et al.
Published: (2024)
by: Huang, Yin, et al.
Published: (2024)
PackInfer: Compute- and I/O-Efficient Attention for Batched LLM Inference
by: Ning, Rui, et al.
Published: (2026)
by: Ning, Rui, et al.
Published: (2026)
RBLA: Rank-Based-LoRA-Aggregation for Fine-tuning Heterogeneous Models in FLaaS
by: Chen, Shuaijun, et al.
Published: (2024)
by: Chen, Shuaijun, et al.
Published: (2024)
A Survey on Federated Fine-tuning of Large Language Models
by: Wu, Yebo, et al.
Published: (2025)
by: Wu, Yebo, et al.
Published: (2025)
Toward Sustainability-Aware LLM Inference on Edge Clusters
by: Rajashekar, Kolichala, et al.
Published: (2025)
by: Rajashekar, Kolichala, et al.
Published: (2025)
Heterogeneous LoRA for Federated Fine-tuning of On-Device Foundation Models
by: Cho, Yae Jee, et al.
Published: (2024)
by: Cho, Yae Jee, et al.
Published: (2024)
What happens when nanochat meets DiLoCo?
by: Acker, Alexander, et al.
Published: (2025)
by: Acker, Alexander, et al.
Published: (2025)
Priority-Aware Model-Distributed Inference at Edge Networks
by: Li, Teng, et al.
Published: (2024)
by: Li, Teng, et al.
Published: (2024)
Towards cost-effective and resource-aware aggregation at Edge for Federated Learning
by: Khan, Ahmad Faraz, et al.
Published: (2022)
by: Khan, Ahmad Faraz, et al.
Published: (2022)
Stabilizing Decentralized Federated Fine-Tuning via Topology-Aware Alternating LoRA
by: Wang, Xiaoyu, et al.
Published: (2026)
by: Wang, Xiaoyu, et al.
Published: (2026)
Rethinking Resource Management in Edge Learning: A Joint Pre-training and Fine-tuning Design Paradigm
by: Lyu, Zhonghao, et al.
Published: (2024)
by: Lyu, Zhonghao, et al.
Published: (2024)
Adaptive Stream Processing on Edge Devices through Active Inference
by: Sedlak, Boris, et al.
Published: (2024)
by: Sedlak, Boris, et al.
Published: (2024)
TSFLora: Token-Compressed Split Fine-Tuning for Wireless Edge Networks
by: Qiang, Xianke, et al.
Published: (2026)
by: Qiang, Xianke, et al.
Published: (2026)
SynergAI: Edge-to-Cloud Synergy for Architecture-Driven High-Performance Orchestration for AI Inference
by: Stathopoulou, Foteini, et al.
Published: (2025)
by: Stathopoulou, Foteini, et al.
Published: (2025)
Efficient Long Context Fine-tuning with Chunk Flow
by: Yuan, Xiulong, et al.
Published: (2025)
by: Yuan, Xiulong, et al.
Published: (2025)
FedGMI: Generative Model-Driven Federated Learning for Probabilistic Mixture Inference
by: Hou, Qijun, et al.
Published: (2026)
by: Hou, Qijun, et al.
Published: (2026)
OCTOPINF: Workload-Aware Inference Serving for Edge Video Analytics
by: Nguyen, Thanh-Tung, et al.
Published: (2025)
by: Nguyen, Thanh-Tung, et al.
Published: (2025)
Infer-EDGE: Dynamic DNN Inference Optimization in 'Just-in-time' Edge-AI Implementations
by: Mounesan, Motahare, et al.
Published: (2025)
by: Mounesan, Motahare, et al.
Published: (2025)
GenAI at the Edge: Comprehensive Survey on Empowering Edge Devices
by: Navardi, Mozhgan, et al.
Published: (2025)
by: Navardi, Mozhgan, et al.
Published: (2025)
Edge Intelligence in Satellite-Terrestrial Networks with Hybrid Quantum Computing
by: Huang, Siyue, et al.
Published: (2024)
by: Huang, Siyue, et al.
Published: (2024)
MultiTASC++: A Continuously Adaptive Scheduler for Edge-Based Multi-Device Cascade Inference
by: Nikolaidis, Sokratis, et al.
Published: (2024)
by: Nikolaidis, Sokratis, et al.
Published: (2024)
Early-Exit meets Model-Distributed Inference at Edge Networks
by: Colocrese, Marco, et al.
Published: (2024)
by: Colocrese, Marco, et al.
Published: (2024)
Towards 6G Intelligence: The Role of Generative AI in Future Wireless Networks
by: Mohsin, Muhammad Ahmed, et al.
Published: (2025)
by: Mohsin, Muhammad Ahmed, et al.
Published: (2025)
EdgeShard: Efficient LLM Inference via Collaborative Edge Computing
by: Zhang, Mingjin, et al.
Published: (2024)
by: Zhang, Mingjin, et al.
Published: (2024)
AIGC-assisted Federated Learning for Edge Intelligence: Architecture Design, Research Challenges and Future Directions
by: Qiang, Xianke, et al.
Published: (2025)
by: Qiang, Xianke, et al.
Published: (2025)
SkyMemory: A LEO Edge Cache for Transformer Inference Optimization and Scale Out
by: Sandholm, Thomas, et al.
Published: (2025)
by: Sandholm, Thomas, et al.
Published: (2025)
SlimCaching: Edge Caching of Mixture-of-Experts for Distributed Inference
by: Chen, Qian, et al.
Published: (2025)
by: Chen, Qian, et al.
Published: (2025)
MatchNAS: Optimizing Edge AI in Sparse-Label Data Contexts via Automating Deep Neural Network Porting for Mobile Deployment
by: Huang, Hongtao, et al.
Published: (2024)
by: Huang, Hongtao, et al.
Published: (2024)
Near-Zero-Overhead Freshness for Recommendation Systems via Inference-Side Model Updates
by: Yu, Wenjun, et al.
Published: (2025)
by: Yu, Wenjun, et al.
Published: (2025)
LobRA: Multi-tenant Fine-tuning over Heterogeneous Data
by: Lin, Sheng, et al.
Published: (2025)
by: Lin, Sheng, et al.
Published: (2025)
Similar Items
-
QoE-oriented Dependent Task Scheduling under Multi-dimensional QoS Constraints over Distributed Networks
by: Fan, Xuwei, et al.
Published: (2023) -
Integrated Sensing, Communication, and Computing: An Information-oriented Resource Transaction Mechanism
by: Chen, Ning, et al.
Published: (2024) -
Two-Timescale Model Caching and Resource Allocation for Edge-Enabled AI-Generated Content Services
by: Liu, Zhang, et al.
Published: (2024) -
Fine-tuning Multimodal Transformers on Edge: A Parallel Split Learning Approach
by: Fudala, Timo, et al.
Published: (2025) -
AI-in-the-Loop Sensing and Communication Joint Design for Edge Intelligence
by: Cai, Zhijie, et al.
Published: (2025)