Joint Model Assignment and Resource Allocation for Cost-Effective Mobile Generative Services
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gao, Shuangwei, Yang, Peng, Kong, Yuxin, Lyu, Feng, Zhang, Ning |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Two-Timescale Model Caching and Resource Allocation for Edge-Enabled AI-Generated Content Services
par: Liu, Zhang, et autres
Publié: (2024)
par: Liu, Zhang, et autres
Publié: (2024)
Heterogeneity-Aware Resource Allocation and Topology Design for Hierarchical Federated Edge Learning
par: Gao, Zhidong, et autres
Publié: (2024)
par: Gao, Zhidong, et autres
Publié: (2024)
Online Client Scheduling and Resource Allocation for Efficient Federated Edge Learning
par: Gao, Zhidong, et autres
Publié: (2024)
par: Gao, Zhidong, et autres
Publié: (2024)
Intelligent Resource Allocation Optimization for Cloud Computing via Machine Learning
par: Wang, Yuqing, et autres
Publié: (2025)
par: Wang, Yuqing, et autres
Publié: (2025)
FedSAC: Dynamic Submodel Allocation for Collaborative Fairness in Federated Learning
par: Wang, Zihui, et autres
Publié: (2024)
par: Wang, Zihui, et autres
Publié: (2024)
AIBrix: Towards Scalable, Cost-Effective Large Language Model Inference Infrastructure
par: The AIBrix Team, et autres
Publié: (2025)
par: The AIBrix Team, et autres
Publié: (2025)
Resource Allocation and Workload Scheduling for Large-Scale Distributed Deep Learning: A Survey
par: Liang, Feng, et autres
Publié: (2024)
par: Liang, Feng, et autres
Publié: (2024)
SatFed: A Resource-Efficient LEO Satellite-Assisted Heterogeneous Federated Learning Framework
par: Zhang, Yuxin, et autres
Publié: (2024)
par: Zhang, Yuxin, et autres
Publié: (2024)
Electricity Cost Minimization for Multi-Workflow Allocation in Geo-Distributed Data Centers
par: Wang, Shuang, et autres
Publié: (2025)
par: Wang, Shuang, et autres
Publié: (2025)
Adaptive and Resource-efficient Agentic AI Systems for Mobile and Embedded Devices: A Survey
par: Liu, Sicong, et autres
Publié: (2025)
par: Liu, Sicong, et autres
Publié: (2025)
Dynamic Resource Allocation for Virtual Machine Migration Optimization using Machine Learning
par: Gong, Yulu, et autres
Publié: (2024)
par: Gong, Yulu, et autres
Publié: (2024)
Joint Resource Optimization, Computation Offloading and Resource Slicing for Multi-Edge Traffic-Cognitive Networks
par: Xiaoyang, Ting, et autres
Publié: (2024)
par: Xiaoyang, Ting, et autres
Publié: (2024)
Characterizing Mobile SoC for Accelerating Heterogeneous LLM Inference
par: Chen, Le, et autres
Publié: (2025)
par: Chen, Le, et autres
Publié: (2025)
Optimized Cloud Resource Allocation Using Genetic Algorithms for Energy Efficiency and QoS Assurance
par: Panggabean, Caroline, et autres
Publié: (2025)
par: Panggabean, Caroline, et autres
Publié: (2025)
A Resource-Adaptive Approach for Federated Learning under Resource-Constrained Environments
par: Zhang, Ruirui, et autres
Publié: (2024)
par: Zhang, Ruirui, et autres
Publié: (2024)
Artificial Intelligence for Cost-Aware Resource Prediction in Big Data Pipelines
par: Goyal, Harshit
Publié: (2025)
par: Goyal, Harshit
Publié: (2025)
A Survey of Resource-efficient LLM and Multimodal Foundation Models
par: Xu, Mengwei, et autres
Publié: (2024)
par: Xu, Mengwei, et autres
Publié: (2024)
Fairness-Aware Job Scheduling for Multi-Job Federated Learning
par: Shi, Yuxin, et autres
Publié: (2024)
par: Shi, Yuxin, et autres
Publié: (2024)
Fire-Flyer AI-HPC: A Cost-Effective Software-Hardware Co-Design for Deep Learning
par: An, Wei, et autres
Publié: (2024)
par: An, Wei, et autres
Publié: (2024)
Deep Reinforcement Learning for Dynamic Resource Allocation in Wireless Networks
par: Malhotra, Shubham, et autres
Publié: (2025)
par: Malhotra, Shubham, et autres
Publié: (2025)
HSplitLoRA: A Heterogeneous Split Parameter-Efficient Fine-Tuning Framework for Large Language Models
par: Lin, Zheng, et autres
Publié: (2025)
par: Lin, Zheng, et autres
Publié: (2025)
ModTrans: Translating Real-world Models for Distributed Training Simulator
par: Lyu, Yi
Publié: (2026)
par: Lyu, Yi
Publié: (2026)
Effective Heterogeneous Federated Learning via Efficient Hypernetwork-based Weight Generation
par: Shin, Yujin, et autres
Publié: (2024)
par: Shin, Yujin, et autres
Publié: (2024)
Federated Fine-Tuning of Sparsely-Activated Large Language Models on Resource-Constrained Devices
par: Chen, Fahao, et autres
Publié: (2025)
par: Chen, Fahao, et autres
Publié: (2025)
Research on Edge Computing and Cloud Collaborative Resource Scheduling Optimization Based on Deep Reinforcement Learning
par: Wang, Yuqing, et autres
Publié: (2025)
par: Wang, Yuqing, et autres
Publié: (2025)
Combining Cloud and Mobile Computing for Machine Learning
par: Xu, Ruiqi, et autres
Publié: (2024)
par: Xu, Ruiqi, et autres
Publié: (2024)
FedRA: A Random Allocation Strategy for Federated Tuning to Unleash the Power of Heterogeneous Clients
par: Su, Shangchao, et autres
Publié: (2023)
par: Su, Shangchao, et autres
Publié: (2023)
Inference Offloading for Cost-Sensitive Binary Classification at the Edge
par: Moothedath, Vishnu Narayanan, et autres
Publié: (2025)
par: Moothedath, Vishnu Narayanan, et autres
Publié: (2025)
When Foundation Model Meets Federated Learning: Motivations, Challenges, and Future Directions
par: Zhuang, Weiming, et autres
Publié: (2023)
par: Zhuang, Weiming, et autres
Publié: (2023)
Piper: Efficient Large-Scale MoE Training via Resource Modeling and Pipelined Hybrid Parallelism
par: Dash, Sajal, et autres
Publié: (2026)
par: Dash, Sajal, et autres
Publié: (2026)
iScheduler: Reinforcement Learning-Driven Continual Optimization for Large-Scale Resource Investment Problems
par: Hu, Yi-Xiang, et autres
Publié: (2026)
par: Hu, Yi-Xiang, et autres
Publié: (2026)
Federated Neural Architecture Search with Model-Agnostic Meta Learning
par: Huang, Xinyuan, et autres
Publié: (2025)
par: Huang, Xinyuan, et autres
Publié: (2025)
IoT-MCP: Bridging LLMs and IoT Systems Through Model Context Protocol
par: Yang, Ningyuan, et autres
Publié: (2025)
par: Yang, Ningyuan, et autres
Publié: (2025)
Improved Methods of Task Assignment and Resource Allocation with Preemption in Edge Computing Systems
par: Rublein, Caroline, et autres
Publié: (2024)
par: Rublein, Caroline, et autres
Publié: (2024)
SFPrompt: Communication-Efficient Split Federated Fine-Tuning for Large Pre-Trained Models over Resource-Limited Devices
par: Cao, Linxiao, et autres
Publié: (2024)
par: Cao, Linxiao, et autres
Publié: (2024)
EDiT: A Local-SGD-Based Efficient Distributed Training Method for Large Language Models
par: Cheng, Jialiang, et autres
Publié: (2024)
par: Cheng, Jialiang, et autres
Publié: (2024)
Cost-Efficient Multimodal LLM Inference via Cross-Tier GPU Heterogeneity
par: Yu, Donglin
Publié: (2026)
par: Yu, Donglin
Publié: (2026)
SmartMem: Layout Transformation Elimination and Adaptation for Efficient DNN Execution on Mobile
par: Niu, Wei, et autres
Publié: (2024)
par: Niu, Wei, et autres
Publié: (2024)
Mobility Accelerates Learning: Convergence Analysis on Hierarchical Federated Learning in Vehicular Networks
par: Chen, Tan, et autres
Publié: (2024)
par: Chen, Tan, et autres
Publié: (2024)
Distributed Inference on Mobile Edge and Cloud: An Early Exit based Clustering Approach
par: Bajpai, Divya Jyoti, et autres
Publié: (2024)
par: Bajpai, Divya Jyoti, et autres
Publié: (2024)
Documents similaires
-
Two-Timescale Model Caching and Resource Allocation for Edge-Enabled AI-Generated Content Services
par: Liu, Zhang, et autres
Publié: (2024) -
Heterogeneity-Aware Resource Allocation and Topology Design for Hierarchical Federated Edge Learning
par: Gao, Zhidong, et autres
Publié: (2024) -
Online Client Scheduling and Resource Allocation for Efficient Federated Edge Learning
par: Gao, Zhidong, et autres
Publié: (2024) -
Intelligent Resource Allocation Optimization for Cloud Computing via Machine Learning
par: Wang, Yuqing, et autres
Publié: (2025) -
FedSAC: Dynamic Submodel Allocation for Collaborative Fairness in Federated Learning
par: Wang, Zihui, et autres
Publié: (2024)