AdaOper: Energy-efficient and Responsive Concurrent DNN Inference on Mobile Devices
Fuente:
arXiv
Guardado en:
| Autores principales: | Lin, Zheng, Guo, Bin, Liu, Sicong, Zhou, Wentao, Ding, Yasan, Zhang, Yu, Yu, Zhiwen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
AdaBridge: Dynamic Data and Computation Reuse for Efficient Multi-task DNN Co-evolution in Edge Systems
por: Wang, Lehao, et al.
Publicado: (2024)
por: Wang, Lehao, et al.
Publicado: (2024)
EchoPFL: Asynchronous Personalized Federated Learning on Mobile Devices with On-Demand Staleness Control
por: Li, Xiaochen, et al.
Publicado: (2024)
por: Li, Xiaochen, et al.
Publicado: (2024)
Adaptive and Resource-efficient Agentic AI Systems for Mobile and Embedded Devices: A Survey
por: Liu, Sicong, et al.
Publicado: (2025)
por: Liu, Sicong, et al.
Publicado: (2025)
Fulcrum: Optimizing Concurrent DNN Training and Inferencing on Edge Accelerators
por: K., Prashanthi S., et al.
Publicado: (2025)
por: K., Prashanthi S., et al.
Publicado: (2025)
Evaluating Multi-Instance DNN Inferencing on Multiple Accelerators of an Edge Device
por: Tayal, Mumuksh, et al.
Publicado: (2025)
por: Tayal, Mumuksh, et al.
Publicado: (2025)
Adaptive Device-Edge Collaboration on DNN Inference in AIoT: A Digital Twin-Assisted Approach
por: Hu, Shisheng, et al.
Publicado: (2024)
por: Hu, Shisheng, et al.
Publicado: (2024)
CARIn: Constraint-Aware and Responsive Inference on Heterogeneous Devices for Single- and Multi-DNN Workloads
por: Panopoulos, Ioannis, et al.
Publicado: (2024)
por: Panopoulos, Ioannis, et al.
Publicado: (2024)
PICO: Pipeline Inference Framework for Versatile CNNs on Diverse Mobile Devices
por: Yang, Xiang, et al.
Publicado: (2022)
por: Yang, Xiang, et al.
Publicado: (2022)
Online Optimization of DNN Inference Network Utility in Collaborative Edge Computing
por: Li, Rui, et al.
Publicado: (2024)
por: Li, Rui, et al.
Publicado: (2024)
Preemption Aware Task Scheduling for Priority and Deadline Constrained DNN Inference Task Offloading in Homogeneous Mobile-Edge Networks
por: Cotter, Jamie, et al.
Publicado: (2025)
por: Cotter, Jamie, et al.
Publicado: (2025)
HarmonyBatch: Batching multi-SLO DNN Inference with Heterogeneous Serverless Functions
por: Chen, Jiabin, et al.
Publicado: (2024)
por: Chen, Jiabin, et al.
Publicado: (2024)
Performance Characterization of Containerized DNN Training and Inference on Edge Accelerators
por: K., Prashanthi S., et al.
Publicado: (2023)
por: K., Prashanthi S., et al.
Publicado: (2023)
Collaborative Inference in DNN-based Satellite Systems with Dynamic Task Streams
por: Guan, Jinglong, et al.
Publicado: (2023)
por: Guan, Jinglong, et al.
Publicado: (2023)
Nezha: Breaking Multi-Rail Network Barriers for Distributed DNN Training
por: Yu, Enda, et al.
Publicado: (2024)
por: Yu, Enda, et al.
Publicado: (2024)
Adaptive Heuristics for Scheduling DNN Inferencing on Edge and Cloud for Personalized UAV Fleets
por: Raj, Suman, et al.
Publicado: (2024)
por: Raj, Suman, et al.
Publicado: (2024)
Where to Split? A Pareto-Front Analysis of DNN Partitioning for Edge Inference
por: Masud, Adiba, et al.
Publicado: (2026)
por: Masud, Adiba, et al.
Publicado: (2026)
DARIS: An Oversubscribed Spatio-Temporal Scheduler for Real-Time DNN Inference on GPUs
por: Babaei, Amir Fakhim, et al.
Publicado: (2025)
por: Babaei, Amir Fakhim, et al.
Publicado: (2025)
RingAda: Pipelining Large Model Fine-Tuning on Edge Devices with Scheduled Layer Unfreezing
por: Li, Liang, et al.
Publicado: (2025)
por: Li, Liang, et al.
Publicado: (2025)
Pagoda: An Energy and Time Roofline Study for DNN Workloads on Edge Accelerators
por: K., Prashanthi S., et al.
Publicado: (2025)
por: K., Prashanthi S., et al.
Publicado: (2025)
Infer-EDGE: Dynamic DNN Inference Optimization in 'Just-in-time' Edge-AI Implementations
por: Mounesan, Motahare, et al.
Publicado: (2025)
por: Mounesan, Motahare, et al.
Publicado: (2025)
A Survey on Collaborative DNN Inference for Edge Intelligence
por: Ren, Weiqing, et al.
Publicado: (2022)
por: Ren, Weiqing, et al.
Publicado: (2022)
ParvaGPU: Efficient Spatial GPU Sharing for Large-Scale DNN Inference in Cloud Environments
por: Lee, Munkyu, et al.
Publicado: (2024)
por: Lee, Munkyu, et al.
Publicado: (2024)
VQ-LLM: High-performance Code Generation for Vector Quantization Augmented LLM Inference
por: Liu, Zihan, et al.
Publicado: (2025)
por: Liu, Zihan, et al.
Publicado: (2025)
EaCO: Resource Sharing Dynamics and Its Impact on Energy Efficiency for DNN Training
por: Haghshenas, Kawsar, et al.
Publicado: (2024)
por: Haghshenas, Kawsar, et al.
Publicado: (2024)
LIME:Accelerating Collaborative Lossless LLM Inference on Memory-Constrained Edge Devices
por: Sun, Mingyu, et al.
Publicado: (2025)
por: Sun, Mingyu, et al.
Publicado: (2025)
Poplar: Efficient Scaling of Distributed DNN Training on Heterogeneous GPU Clusters
por: Zhang, WenZheng, et al.
Publicado: (2024)
por: Zhang, WenZheng, et al.
Publicado: (2024)
Opara: Exploiting Operator Parallelism for Expediting DNN Inference on GPUs
por: Chen, Aodong, et al.
Publicado: (2023)
por: Chen, Aodong, et al.
Publicado: (2023)
Practical Performance Guarantees for Pipelined DNN Inference
por: Archer, Aaron, et al.
Publicado: (2023)
por: Archer, Aaron, et al.
Publicado: (2023)
CONCUR: High-Throughput Agentic Batch Inference of LLM via Congestion-Based Concurrency Control
por: Chen, Qiaoling, et al.
Publicado: (2026)
por: Chen, Qiaoling, et al.
Publicado: (2026)
HeteGen: Heterogeneous Parallel Inference for Large Language Models on Resource-Constrained Devices
por: Zhao, Xuanlei, et al.
Publicado: (2024)
por: Zhao, Xuanlei, et al.
Publicado: (2024)
Parcae: Proactive, Liveput-Optimized DNN Training on Preemptible Instances
por: Duan, Jiangfei, et al.
Publicado: (2024)
por: Duan, Jiangfei, et al.
Publicado: (2024)
Collaborative Satellite Computing through Adaptive DNN Task Splitting and Offloading
por: Peng, Shifeng, et al.
Publicado: (2024)
por: Peng, Shifeng, et al.
Publicado: (2024)
ESG: Pipeline-Conscious Efficient Scheduling of DNN Workflows on Serverless Platforms with Shareable GPUs
por: Hui, Xinning, et al.
Publicado: (2024)
por: Hui, Xinning, et al.
Publicado: (2024)
SwapNet: Efficient Swapping for DNN Inference on Edge AI Devices Beyond the Memory Budget
por: Wang, Kun, et al.
Publicado: (2024)
por: Wang, Kun, et al.
Publicado: (2024)
FlashMem: Supporting Modern DNN Workloads on Mobile with GPU Memory Hierarchy Optimizations
por: Shu, Zhihao, et al.
Publicado: (2026)
por: Shu, Zhihao, et al.
Publicado: (2026)
HAP: SPMD DNN Training on Heterogeneous GPU Clusters with Automated Program Synthesis
por: Zhang, Shiwei, et al.
Publicado: (2024)
por: Zhang, Shiwei, et al.
Publicado: (2024)
New Concurrent Order Maintenance Data Structure
por: Guo, Bin, et al.
Publicado: (2022)
por: Guo, Bin, et al.
Publicado: (2022)
Distributed On-Device LLM Inference With Over-the-Air Computation
por: Zhang, Kai, et al.
Publicado: (2025)
por: Zhang, Kai, et al.
Publicado: (2025)
Orchestrating Joint Offloading and Scheduling for Low-Latency Edge SLAM
por: Zhang, Yao, et al.
Publicado: (2025)
por: Zhang, Yao, et al.
Publicado: (2025)
Torpor: GPU-Enabled Serverless Computing for Low-Latency, Resource-Efficient Inference
por: Yu, Minchen, et al.
Publicado: (2023)
por: Yu, Minchen, et al.
Publicado: (2023)
Ejemplares similares
-
AdaBridge: Dynamic Data and Computation Reuse for Efficient Multi-task DNN Co-evolution in Edge Systems
por: Wang, Lehao, et al.
Publicado: (2024) -
EchoPFL: Asynchronous Personalized Federated Learning on Mobile Devices with On-Demand Staleness Control
por: Li, Xiaochen, et al.
Publicado: (2024) -
Adaptive and Resource-efficient Agentic AI Systems for Mobile and Embedded Devices: A Survey
por: Liu, Sicong, et al.
Publicado: (2025) -
Fulcrum: Optimizing Concurrent DNN Training and Inferencing on Edge Accelerators
por: K., Prashanthi S., et al.
Publicado: (2025) -
Evaluating Multi-Instance DNN Inferencing on Multiple Accelerators of an Edge Device
por: Tayal, Mumuksh, et al.
Publicado: (2025)