Covariance-Guided Resource Adaptive Learning for Efficient Edge Inference
Fuente:
arXiv
Guardado en:
| Autores principales: | Nabhaan, Ahmad N. L., Sukma, Zaki, Rachmanto, Rakandhiya D., Santriaji, Muhammad Husni, Cho, Byungjin, Setyanto, Arief, Kim, In Kee |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
HybridFlow: Resource-Adaptive Subtask Routing for Efficient Edge-Cloud LLM Inference
por: Dong, Jiangwen, et al.
Publicado: (2025)
por: Dong, Jiangwen, et al.
Publicado: (2025)
EdgeShard: Efficient LLM Inference via Collaborative Edge Computing
por: Zhang, Mingjin, et al.
Publicado: (2024)
por: Zhang, Mingjin, et al.
Publicado: (2024)
MSAO: Adaptive Modality Sparsity-Aware Offloading with Edge-Cloud Collaboration for Efficient Multimodal LLM Inference
por: Yang, Zheming, et al.
Publicado: (2026)
por: Yang, Zheming, et al.
Publicado: (2026)
Improved Decision Module Selection for Hierarchical Inference in Resource-Constrained Edge Devices
por: Behera, Adarsh Prasad, et al.
Publicado: (2024)
por: Behera, Adarsh Prasad, et al.
Publicado: (2024)
Adaptive Configuration Selection for Multi-Model Inference Pipelines in Edge Computing
por: Sheng, Jinhao, et al.
Publicado: (2025)
por: Sheng, Jinhao, et al.
Publicado: (2025)
MoA-Off: Adaptive Heterogeneous Modality-Aware Offloading with Edge-Cloud Collaboration for Efficient Multimodal LLM Inference
por: Yang, Zheming, et al.
Publicado: (2025)
por: Yang, Zheming, et al.
Publicado: (2025)
Adaptive Heuristics for Scheduling DNN Inferencing on Edge and Cloud for Personalized UAV Fleets
por: Raj, Suman, et al.
Publicado: (2024)
por: Raj, Suman, et al.
Publicado: (2024)
Towards Resource-Efficient Serverless LLM Inference with SLINFER
por: Xu, Chuhao, et al.
Publicado: (2025)
por: Xu, Chuhao, et al.
Publicado: (2025)
GoodSpeed: Optimizing Fair Goodput with Adaptive Speculative Decoding in Distributed Edge Inference
por: Tran, Phuong, et al.
Publicado: (2025)
por: Tran, Phuong, et al.
Publicado: (2025)
Profiling-Driven Adaptive Distributed Transformer Inference on Embedded Edge Deployment
por: Qazi, Muhammad Azlan, et al.
Publicado: (2026)
por: Qazi, Muhammad Azlan, et al.
Publicado: (2026)
Efficient Routing of Inference Requests across LLM Instances in Cloud-Edge Computing
por: Yu, Shibo, et al.
Publicado: (2025)
por: Yu, Shibo, et al.
Publicado: (2025)
ACE-GNN: Adaptive GNN Co-Inference with System-Aware Scheduling in Dynamic Edge Environments
por: Zhou, Ao, et al.
Publicado: (2025)
por: Zhou, Ao, et al.
Publicado: (2025)
Adaptive Device-Edge Collaboration on DNN Inference in AIoT: A Digital Twin-Assisted Approach
por: Hu, Shisheng, et al.
Publicado: (2024)
por: Hu, Shisheng, et al.
Publicado: (2024)
Distributed Hierarchical Machine Learning for Joint Resource Allocation and Slice Selection in In-Network Edge Systems
por: Rashid, Sulaiman Muhammad, et al.
Publicado: (2025)
por: Rashid, Sulaiman Muhammad, et al.
Publicado: (2025)
Resilient Auto-Scaling of Microservice Architectures with Efficient Resource Management
por: Ahmad, Hussain, et al.
Publicado: (2025)
por: Ahmad, Hussain, et al.
Publicado: (2025)
HAP: Hybrid Adaptive Parallelism for Efficient Mixture-of-Experts Inference
por: Lin, Haoran, et al.
Publicado: (2025)
por: Lin, Haoran, et al.
Publicado: (2025)
A Pipelined Collaborative Speculative Decoding Framework for Efficient Edge-Cloud LLM Inference
por: Zhang, Yida, et al.
Publicado: (2026)
por: Zhang, Yida, et al.
Publicado: (2026)
PipeSD: An Efficient Cloud-Edge Collaborative Pipeline Inference Framework with Speculative Decoding
por: Han, Yunhe, et al.
Publicado: (2026)
por: Han, Yunhe, et al.
Publicado: (2026)
Energy-Efficient Real-Time Job Mapping and Resource Management in Mobile-Edge Computing
por: Gao, Chuanchao, et al.
Publicado: (2025)
por: Gao, Chuanchao, et al.
Publicado: (2025)
Fast and Interactive Byzantine Fault-tolerant Web Services via Session-Based Consensus Decoupling
por: Akmal, Ahmad Zaki, et al.
Publicado: (2025)
por: Akmal, Ahmad Zaki, et al.
Publicado: (2025)
Torpor: GPU-Enabled Serverless Computing for Low-Latency, Resource-Efficient Inference
por: Yu, Minchen, et al.
Publicado: (2023)
por: Yu, Minchen, et al.
Publicado: (2023)
Energy-Efficient Joint Offloading and Resource Allocation for Deadline-Constrained Tasks in Multi-Access Edge Computing
por: Gao, Chuanchao, et al.
Publicado: (2025)
por: Gao, Chuanchao, et al.
Publicado: (2025)
Understanding the Performance and Power of LLM Inferencing on Edge Accelerators
por: Arya, Mayank, et al.
Publicado: (2025)
por: Arya, Mayank, et al.
Publicado: (2025)
Toward Sustainability-Aware LLM Inference on Edge Clusters
por: Rajashekar, Kolichala, et al.
Publicado: (2025)
por: Rajashekar, Kolichala, et al.
Publicado: (2025)
Environment-Aware Dynamic Pruning for Pipelined Edge Inference
por: O'Quinn, Austin, et al.
Publicado: (2025)
por: O'Quinn, Austin, et al.
Publicado: (2025)
Dependency-aware Resource Allocation for Serverless Functions at the Edge
por: Baresi, Luciano, et al.
Publicado: (2023)
por: Baresi, Luciano, et al.
Publicado: (2023)
Mobile Edge Computing
por: Ahmed, Sohaib, et al.
Publicado: (2024)
por: Ahmed, Sohaib, et al.
Publicado: (2024)
Communication-and-Computation Efficient Split Federated Learning: Gradient Aggregation and Resource Management
por: Liang, Yipeng, et al.
Publicado: (2025)
por: Liang, Yipeng, et al.
Publicado: (2025)
AB-Sparse: Sparse Attention with Adaptive Block Size for Accurate and Efficient Long-Context Inference
por: Liu, Di, et al.
Publicado: (2026)
por: Liu, Di, et al.
Publicado: (2026)
ACE-Sync: An Adaptive Cloud-Edge Synchronization Framework for Communication-Efficient Large-Scale Distributed Model Training
por: Yang, Yi, et al.
Publicado: (2025)
por: Yang, Yi, et al.
Publicado: (2025)
Performance Characterization of Containerized DNN Training and Inference on Edge Accelerators
por: K., Prashanthi S., et al.
Publicado: (2023)
por: K., Prashanthi S., et al.
Publicado: (2023)
Fulcrum: Optimizing Concurrent DNN Training and Inferencing on Edge Accelerators
por: K., Prashanthi S., et al.
Publicado: (2025)
por: K., Prashanthi S., et al.
Publicado: (2025)
Decentralized LLM Inference over Edge Networks with Energy Harvesting
por: Khoshsirat, Aria, et al.
Publicado: (2024)
por: Khoshsirat, Aria, et al.
Publicado: (2024)
OCTOPINF: Workload-Aware Inference Serving for Edge Video Analytics
por: Nguyen, Thanh-Tung, et al.
Publicado: (2025)
por: Nguyen, Thanh-Tung, et al.
Publicado: (2025)
Distributed Resource Selection for Self-Organising Cloud-Edge Systems
por: Renau, Quentin, et al.
Publicado: (2025)
por: Renau, Quentin, et al.
Publicado: (2025)
Resource-efficient Parallel Split Learning in Heterogeneous Edge Computing
por: Zhang, Mingjin, et al.
Publicado: (2024)
por: Zhang, Mingjin, et al.
Publicado: (2024)
Totoro$^+$: An Adaptive and Scalable Edge Federated Learning System
por: Ching, Cheng-Wei, et al.
Publicado: (2026)
por: Ching, Cheng-Wei, et al.
Publicado: (2026)
Online Optimization of DNN Inference Network Utility in Collaborative Edge Computing
por: Li, Rui, et al.
Publicado: (2024)
por: Li, Rui, et al.
Publicado: (2024)
Evaluating Multi-Instance DNN Inferencing on Multiple Accelerators of an Edge Device
por: Tayal, Mumuksh, et al.
Publicado: (2025)
por: Tayal, Mumuksh, et al.
Publicado: (2025)
Modular Foundation Model Inference at the Edge: Network-Aware Microservice Optimization
por: Zhu, Juan, et al.
Publicado: (2026)
por: Zhu, Juan, et al.
Publicado: (2026)
Ejemplares similares
-
HybridFlow: Resource-Adaptive Subtask Routing for Efficient Edge-Cloud LLM Inference
por: Dong, Jiangwen, et al.
Publicado: (2025) -
EdgeShard: Efficient LLM Inference via Collaborative Edge Computing
por: Zhang, Mingjin, et al.
Publicado: (2024) -
MSAO: Adaptive Modality Sparsity-Aware Offloading with Edge-Cloud Collaboration for Efficient Multimodal LLM Inference
por: Yang, Zheming, et al.
Publicado: (2026) -
Improved Decision Module Selection for Hierarchical Inference in Resource-Constrained Edge Devices
por: Behera, Adarsh Prasad, et al.
Publicado: (2024) -
Adaptive Configuration Selection for Multi-Model Inference Pipelines in Edge Computing
por: Sheng, Jinhao, et al.
Publicado: (2025)