Towards Integrated Fine-tuning and Inference when Generative AI meets Edge Intelligence
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Ning, Cheng, Zhipeng, Fan, Xuwei, Xia, Xiaoyu, Huang, Lianfen |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
QoE-oriented Dependent Task Scheduling under Multi-dimensional QoS Constraints over Distributed Networks
par: Fan, Xuwei, et autres
Publié: (2023)
par: Fan, Xuwei, et autres
Publié: (2023)
Integrated Sensing, Communication, and Computing: An Information-oriented Resource Transaction Mechanism
par: Chen, Ning, et autres
Publié: (2024)
par: Chen, Ning, et autres
Publié: (2024)
Two-Timescale Model Caching and Resource Allocation for Edge-Enabled AI-Generated Content Services
par: Liu, Zhang, et autres
Publié: (2024)
par: Liu, Zhang, et autres
Publié: (2024)
Fine-tuning Multimodal Transformers on Edge: A Parallel Split Learning Approach
par: Fudala, Timo, et autres
Publié: (2025)
par: Fudala, Timo, et autres
Publié: (2025)
AI-in-the-Loop Sensing and Communication Joint Design for Edge Intelligence
par: Cai, Zhijie, et autres
Publié: (2025)
par: Cai, Zhijie, et autres
Publié: (2025)
A Survey on Collaborative DNN Inference for Edge Intelligence
par: Ren, Weiqing, et autres
Publié: (2022)
par: Ren, Weiqing, et autres
Publié: (2022)
Intelligent Orchestration of Distributed Large Foundation Model Inference at the Edge
par: Koch, Fernando, et autres
Publié: (2025)
par: Koch, Fernando, et autres
Publié: (2025)
Semantic-aware Token Selection and Resource Optimization for Communication-efficient Split Federated Fine-tuning in Edge Intelligence
par: Qiang, Xianke, et autres
Publié: (2026)
par: Qiang, Xianke, et autres
Publié: (2026)
Unleashing the Power of Tree-of-Thoughts for Edge-Enabled AIGC Service Provisioning
par: Liu, Zhang, et autres
Publié: (2026)
par: Liu, Zhang, et autres
Publié: (2026)
MobiZO: Enabling Efficient LLM Fine-Tuning at the Edge via Inference Engines
par: Gao, Lei, et autres
Publié: (2024)
par: Gao, Lei, et autres
Publié: (2024)
Learning the Optimal Path and DNN Partition for Collaborative Edge Inference
par: Huang, Yin, et autres
Publié: (2024)
par: Huang, Yin, et autres
Publié: (2024)
PackInfer: Compute- and I/O-Efficient Attention for Batched LLM Inference
par: Ning, Rui, et autres
Publié: (2026)
par: Ning, Rui, et autres
Publié: (2026)
RBLA: Rank-Based-LoRA-Aggregation for Fine-tuning Heterogeneous Models in FLaaS
par: Chen, Shuaijun, et autres
Publié: (2024)
par: Chen, Shuaijun, et autres
Publié: (2024)
A Survey on Federated Fine-tuning of Large Language Models
par: Wu, Yebo, et autres
Publié: (2025)
par: Wu, Yebo, et autres
Publié: (2025)
Toward Sustainability-Aware LLM Inference on Edge Clusters
par: Rajashekar, Kolichala, et autres
Publié: (2025)
par: Rajashekar, Kolichala, et autres
Publié: (2025)
Heterogeneous LoRA for Federated Fine-tuning of On-Device Foundation Models
par: Cho, Yae Jee, et autres
Publié: (2024)
par: Cho, Yae Jee, et autres
Publié: (2024)
What happens when nanochat meets DiLoCo?
par: Acker, Alexander, et autres
Publié: (2025)
par: Acker, Alexander, et autres
Publié: (2025)
Priority-Aware Model-Distributed Inference at Edge Networks
par: Li, Teng, et autres
Publié: (2024)
par: Li, Teng, et autres
Publié: (2024)
Towards cost-effective and resource-aware aggregation at Edge for Federated Learning
par: Khan, Ahmad Faraz, et autres
Publié: (2022)
par: Khan, Ahmad Faraz, et autres
Publié: (2022)
Stabilizing Decentralized Federated Fine-Tuning via Topology-Aware Alternating LoRA
par: Wang, Xiaoyu, et autres
Publié: (2026)
par: Wang, Xiaoyu, et autres
Publié: (2026)
Rethinking Resource Management in Edge Learning: A Joint Pre-training and Fine-tuning Design Paradigm
par: Lyu, Zhonghao, et autres
Publié: (2024)
par: Lyu, Zhonghao, et autres
Publié: (2024)
Adaptive Stream Processing on Edge Devices through Active Inference
par: Sedlak, Boris, et autres
Publié: (2024)
par: Sedlak, Boris, et autres
Publié: (2024)
TSFLora: Token-Compressed Split Fine-Tuning for Wireless Edge Networks
par: Qiang, Xianke, et autres
Publié: (2026)
par: Qiang, Xianke, et autres
Publié: (2026)
SynergAI: Edge-to-Cloud Synergy for Architecture-Driven High-Performance Orchestration for AI Inference
par: Stathopoulou, Foteini, et autres
Publié: (2025)
par: Stathopoulou, Foteini, et autres
Publié: (2025)
Efficient Long Context Fine-tuning with Chunk Flow
par: Yuan, Xiulong, et autres
Publié: (2025)
par: Yuan, Xiulong, et autres
Publié: (2025)
FedGMI: Generative Model-Driven Federated Learning for Probabilistic Mixture Inference
par: Hou, Qijun, et autres
Publié: (2026)
par: Hou, Qijun, et autres
Publié: (2026)
OCTOPINF: Workload-Aware Inference Serving for Edge Video Analytics
par: Nguyen, Thanh-Tung, et autres
Publié: (2025)
par: Nguyen, Thanh-Tung, et autres
Publié: (2025)
Infer-EDGE: Dynamic DNN Inference Optimization in 'Just-in-time' Edge-AI Implementations
par: Mounesan, Motahare, et autres
Publié: (2025)
par: Mounesan, Motahare, et autres
Publié: (2025)
GenAI at the Edge: Comprehensive Survey on Empowering Edge Devices
par: Navardi, Mozhgan, et autres
Publié: (2025)
par: Navardi, Mozhgan, et autres
Publié: (2025)
Edge Intelligence in Satellite-Terrestrial Networks with Hybrid Quantum Computing
par: Huang, Siyue, et autres
Publié: (2024)
par: Huang, Siyue, et autres
Publié: (2024)
MultiTASC++: A Continuously Adaptive Scheduler for Edge-Based Multi-Device Cascade Inference
par: Nikolaidis, Sokratis, et autres
Publié: (2024)
par: Nikolaidis, Sokratis, et autres
Publié: (2024)
Early-Exit meets Model-Distributed Inference at Edge Networks
par: Colocrese, Marco, et autres
Publié: (2024)
par: Colocrese, Marco, et autres
Publié: (2024)
Towards 6G Intelligence: The Role of Generative AI in Future Wireless Networks
par: Mohsin, Muhammad Ahmed, et autres
Publié: (2025)
par: Mohsin, Muhammad Ahmed, et autres
Publié: (2025)
EdgeShard: Efficient LLM Inference via Collaborative Edge Computing
par: Zhang, Mingjin, et autres
Publié: (2024)
par: Zhang, Mingjin, et autres
Publié: (2024)
AIGC-assisted Federated Learning for Edge Intelligence: Architecture Design, Research Challenges and Future Directions
par: Qiang, Xianke, et autres
Publié: (2025)
par: Qiang, Xianke, et autres
Publié: (2025)
SkyMemory: A LEO Edge Cache for Transformer Inference Optimization and Scale Out
par: Sandholm, Thomas, et autres
Publié: (2025)
par: Sandholm, Thomas, et autres
Publié: (2025)
SlimCaching: Edge Caching of Mixture-of-Experts for Distributed Inference
par: Chen, Qian, et autres
Publié: (2025)
par: Chen, Qian, et autres
Publié: (2025)
MatchNAS: Optimizing Edge AI in Sparse-Label Data Contexts via Automating Deep Neural Network Porting for Mobile Deployment
par: Huang, Hongtao, et autres
Publié: (2024)
par: Huang, Hongtao, et autres
Publié: (2024)
Near-Zero-Overhead Freshness for Recommendation Systems via Inference-Side Model Updates
par: Yu, Wenjun, et autres
Publié: (2025)
par: Yu, Wenjun, et autres
Publié: (2025)
LobRA: Multi-tenant Fine-tuning over Heterogeneous Data
par: Lin, Sheng, et autres
Publié: (2025)
par: Lin, Sheng, et autres
Publié: (2025)
Documents similaires
-
QoE-oriented Dependent Task Scheduling under Multi-dimensional QoS Constraints over Distributed Networks
par: Fan, Xuwei, et autres
Publié: (2023) -
Integrated Sensing, Communication, and Computing: An Information-oriented Resource Transaction Mechanism
par: Chen, Ning, et autres
Publié: (2024) -
Two-Timescale Model Caching and Resource Allocation for Edge-Enabled AI-Generated Content Services
par: Liu, Zhang, et autres
Publié: (2024) -
Fine-tuning Multimodal Transformers on Edge: A Parallel Split Learning Approach
par: Fudala, Timo, et autres
Publié: (2025) -
AI-in-the-Loop Sensing and Communication Joint Design for Edge Intelligence
par: Cai, Zhijie, et autres
Publié: (2025)