COHORT: Hybrid RL for Collaborative Large DNN Inference on Multi-Robot Systems Under Real-Time Constraints
Fuente:
arXiv
Salvato in:
| Autori principali: | Anwar, Mohammad Saeid, Ravi, Anuradha, Ghosh, Indrajeet, Shinde, Gaurav, Busart, Carl, Roy, Nirmalya |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Online Optimization of DNN Inference Network Utility in Collaborative Edge Computing
di: Li, Rui, et al.
Pubblicazione: (2024)
di: Li, Rui, et al.
Pubblicazione: (2024)
Collaborative Inference in DNN-based Satellite Systems with Dynamic Task Streams
di: Guan, Jinglong, et al.
Pubblicazione: (2023)
di: Guan, Jinglong, et al.
Pubblicazione: (2023)
A Survey on Collaborative DNN Inference for Edge Intelligence
di: Ren, Weiqing, et al.
Pubblicazione: (2022)
di: Ren, Weiqing, et al.
Pubblicazione: (2022)
DARIS: An Oversubscribed Spatio-Temporal Scheduler for Real-Time DNN Inference on GPUs
di: Babaei, Amir Fakhim, et al.
Pubblicazione: (2025)
di: Babaei, Amir Fakhim, et al.
Pubblicazione: (2025)
Adaptive Device-Edge Collaboration on DNN Inference in AIoT: A Digital Twin-Assisted Approach
di: Hu, Shisheng, et al.
Pubblicazione: (2024)
di: Hu, Shisheng, et al.
Pubblicazione: (2024)
Learning the Optimal Path and DNN Partition for Collaborative Edge Inference
di: Huang, Yin, et al.
Pubblicazione: (2024)
di: Huang, Yin, et al.
Pubblicazione: (2024)
Variational Autoencoder-Based Black-Box Adversarial Attack on Collaborative DNN Inference
di: Yousefi, Shima, et al.
Pubblicazione: (2025)
di: Yousefi, Shima, et al.
Pubblicazione: (2025)
CARIn: Constraint-Aware and Responsive Inference on Heterogeneous Devices for Single- and Multi-DNN Workloads
di: Panopoulos, Ioannis, et al.
Pubblicazione: (2024)
di: Panopoulos, Ioannis, et al.
Pubblicazione: (2024)
Performance Characterization of Containerized DNN Training and Inference on Edge Accelerators
di: K., Prashanthi S., et al.
Pubblicazione: (2023)
di: K., Prashanthi S., et al.
Pubblicazione: (2023)
Fulcrum: Optimizing Concurrent DNN Training and Inferencing on Edge Accelerators
di: K., Prashanthi S., et al.
Pubblicazione: (2025)
di: K., Prashanthi S., et al.
Pubblicazione: (2025)
SparOA: Sparse and Operator-aware Hybrid Scheduling for Edge DNN Inference
di: Zhang, Ziyang, et al.
Pubblicazione: (2025)
di: Zhang, Ziyang, et al.
Pubblicazione: (2025)
Collaborative Satellite Computing through Adaptive DNN Task Splitting and Offloading
di: Peng, Shifeng, et al.
Pubblicazione: (2024)
di: Peng, Shifeng, et al.
Pubblicazione: (2024)
Asynchronous Local Computations in Distributed Bayesian Learning
di: Bhar, Kinjal, et al.
Pubblicazione: (2023)
di: Bhar, Kinjal, et al.
Pubblicazione: (2023)
Evaluating Multi-Instance DNN Inferencing on Multiple Accelerators of an Edge Device
di: Tayal, Mumuksh, et al.
Pubblicazione: (2025)
di: Tayal, Mumuksh, et al.
Pubblicazione: (2025)
DataCenterGym: A Physics-Grounded Simulator for Multi-Objective Data Center Scheduling
di: Pathak, Nilavra, et al.
Pubblicazione: (2026)
di: Pathak, Nilavra, et al.
Pubblicazione: (2026)
HarmonyBatch: Batching multi-SLO DNN Inference with Heterogeneous Serverless Functions
di: Chen, Jiabin, et al.
Pubblicazione: (2024)
di: Chen, Jiabin, et al.
Pubblicazione: (2024)
Adaptive Heuristics for Scheduling DNN Inferencing on Edge and Cloud for Personalized UAV Fleets
di: Raj, Suman, et al.
Pubblicazione: (2024)
di: Raj, Suman, et al.
Pubblicazione: (2024)
AdaOper: Energy-efficient and Responsive Concurrent DNN Inference on Mobile Devices
di: Lin, Zheng, et al.
Pubblicazione: (2024)
di: Lin, Zheng, et al.
Pubblicazione: (2024)
Where to Split? A Pareto-Front Analysis of DNN Partitioning for Edge Inference
di: Masud, Adiba, et al.
Pubblicazione: (2026)
di: Masud, Adiba, et al.
Pubblicazione: (2026)
Accelerating ViT Inference on FPGA through Static and Dynamic Pruning
di: Parikh, Dhruv, et al.
Pubblicazione: (2024)
di: Parikh, Dhruv, et al.
Pubblicazione: (2024)
Robust DNN Partitioning and Resource Allocation Under Uncertain Inference Time
di: Nan, Zhaojun, et al.
Pubblicazione: (2025)
di: Nan, Zhaojun, et al.
Pubblicazione: (2025)
Infer-EDGE: Dynamic DNN Inference Optimization in 'Just-in-time' Edge-AI Implementations
di: Mounesan, Motahare, et al.
Pubblicazione: (2025)
di: Mounesan, Motahare, et al.
Pubblicazione: (2025)
Practical Performance Guarantees for Pipelined DNN Inference
di: Archer, Aaron, et al.
Pubblicazione: (2023)
di: Archer, Aaron, et al.
Pubblicazione: (2023)
ParvaGPU: Efficient Spatial GPU Sharing for Large-Scale DNN Inference in Cloud Environments
di: Lee, Munkyu, et al.
Pubblicazione: (2024)
di: Lee, Munkyu, et al.
Pubblicazione: (2024)
Sponge: Inference Serving with Dynamic SLOs Using In-Place Vertical Scaling
di: Razavi, Kamran, et al.
Pubblicazione: (2024)
di: Razavi, Kamran, et al.
Pubblicazione: (2024)
Opara: Exploiting Operator Parallelism for Expediting DNN Inference on GPUs
di: Chen, Aodong, et al.
Pubblicazione: (2023)
di: Chen, Aodong, et al.
Pubblicazione: (2023)
Preemption Aware Task Scheduling for Priority and Deadline Constrained DNN Inference Task Offloading in Homogeneous Mobile-Edge Networks
di: Cotter, Jamie, et al.
Pubblicazione: (2025)
di: Cotter, Jamie, et al.
Pubblicazione: (2025)
GCV-Turbo: End-to-end Acceleration of GNN-based Computer Vision Tasks on FPGA
di: Zhang, Bingyi, et al.
Pubblicazione: (2024)
di: Zhang, Bingyi, et al.
Pubblicazione: (2024)
Hybrid-Parallel: Achieving High Performance and Energy Efficient Distributed Inference on Robots
di: Sun, Zekai, et al.
Pubblicazione: (2024)
di: Sun, Zekai, et al.
Pubblicazione: (2024)
Federated Inference for Heterogeneous LLM Communication and Collaboration
di: Chen, Zihan, et al.
Pubblicazione: (2026)
di: Chen, Zihan, et al.
Pubblicazione: (2026)
KIS-S: A GPU-Aware Kubernetes Inference Simulator with RL-Based Auto-Scaling
di: Zhang, Guilin, et al.
Pubblicazione: (2025)
di: Zhang, Guilin, et al.
Pubblicazione: (2025)
Multi-DNN Inference of Sparse Models on Edge SoCs
di: Luo, Jiawei, et al.
Pubblicazione: (2026)
di: Luo, Jiawei, et al.
Pubblicazione: (2026)
Collaborative Inference Acceleration with Non-Penetrative Tensor Partitioning
di: Liu, Zhibang, et al.
Pubblicazione: (2025)
di: Liu, Zhibang, et al.
Pubblicazione: (2025)
Toward Self-Healing Networks-on-Chip: RL-Driven Routing in 2D Torus Architectures
di: Charrwi, Mohammad Walid, et al.
Pubblicazione: (2025)
di: Charrwi, Mohammad Walid, et al.
Pubblicazione: (2025)
ECCENTRIC: Edge-Cloud Collaboration Framework for Distributed Inference Using Knowledge Adaptation
di: Kamani, Mohammad Mahdi, et al.
Pubblicazione: (2025)
di: Kamani, Mohammad Mahdi, et al.
Pubblicazione: (2025)
Collaborative Inference for Large Models with Task Offloading and Early Exiting
di: Xie, Zuan, et al.
Pubblicazione: (2024)
di: Xie, Zuan, et al.
Pubblicazione: (2024)
Training DNN Models over Heterogeneous Clusters with Optimal Performance
di: Nie, Chengyi, et al.
Pubblicazione: (2024)
di: Nie, Chengyi, et al.
Pubblicazione: (2024)
Parcae: Proactive, Liveput-Optimized DNN Training on Preemptible Instances
di: Duan, Jiangfei, et al.
Pubblicazione: (2024)
di: Duan, Jiangfei, et al.
Pubblicazione: (2024)
EdgeServing: Deadline-Aware Multi-DNN Serving at the Edge
di: Cao, Jiahe, et al.
Pubblicazione: (2026)
di: Cao, Jiahe, et al.
Pubblicazione: (2026)
SWIFT: Expedited Failure Recovery for Large-scale DNN Training
di: Zhong, Yuchen, et al.
Pubblicazione: (2023)
di: Zhong, Yuchen, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Online Optimization of DNN Inference Network Utility in Collaborative Edge Computing
di: Li, Rui, et al.
Pubblicazione: (2024) -
Collaborative Inference in DNN-based Satellite Systems with Dynamic Task Streams
di: Guan, Jinglong, et al.
Pubblicazione: (2023) -
A Survey on Collaborative DNN Inference for Edge Intelligence
di: Ren, Weiqing, et al.
Pubblicazione: (2022) -
DARIS: An Oversubscribed Spatio-Temporal Scheduler for Real-Time DNN Inference on GPUs
di: Babaei, Amir Fakhim, et al.
Pubblicazione: (2025) -
Adaptive Device-Edge Collaboration on DNN Inference in AIoT: A Digital Twin-Assisted Approach
di: Hu, Shisheng, et al.
Pubblicazione: (2024)