R2E-VID: Two-Stage Robust Routing via Temporal Gating for Elastic Edge-Cloud Video Inference
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Zheming, Zuo, Lulu, Lu, Shun, Zhang, Yangyu, Li, Zhicheng, Li, Xiangyang, You, Yang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MSAO: Adaptive Modality Sparsity-Aware Offloading with Edge-Cloud Collaboration for Efficient Multimodal LLM Inference
di: Yang, Zheming, et al.
Pubblicazione: (2026)
di: Yang, Zheming, et al.
Pubblicazione: (2026)
MoA-Off: Adaptive Heterogeneous Modality-Aware Offloading with Edge-Cloud Collaboration for Efficient Multimodal LLM Inference
di: Yang, Zheming, et al.
Pubblicazione: (2025)
di: Yang, Zheming, et al.
Pubblicazione: (2025)
HybridFlow: Resource-Adaptive Subtask Routing for Efficient Edge-Cloud LLM Inference
di: Dong, Jiangwen, et al.
Pubblicazione: (2025)
di: Dong, Jiangwen, et al.
Pubblicazione: (2025)
EC2MoE: Adaptive End-Cloud Pipeline Collaboration Enabling Scalable Mixture-of-Experts Inference
di: Yang, Zheming, et al.
Pubblicazione: (2025)
di: Yang, Zheming, et al.
Pubblicazione: (2025)
Efficient Routing of Inference Requests across LLM Instances in Cloud-Edge Computing
di: Yu, Shibo, et al.
Pubblicazione: (2025)
di: Yu, Shibo, et al.
Pubblicazione: (2025)
PerLLM: Personalized Inference Scheduling with Edge-Cloud Collaboration for Diverse LLM Services
di: Yang, Zheming, et al.
Pubblicazione: (2024)
di: Yang, Zheming, et al.
Pubblicazione: (2024)
PICE: A Semantic-Driven Progressive Inference System for LLM Serving in Cloud-Edge Networks
di: Zhan, Huiyou, et al.
Pubblicazione: (2025)
di: Zhan, Huiyou, et al.
Pubblicazione: (2025)
Administrative Decentralization in Edge-Cloud Multi-Agent for Mobile Automation
di: Li, Senyao, et al.
Pubblicazione: (2026)
di: Li, Senyao, et al.
Pubblicazione: (2026)
A Pipelined Collaborative Speculative Decoding Framework for Efficient Edge-Cloud LLM Inference
di: Zhang, Yida, et al.
Pubblicazione: (2026)
di: Zhang, Yida, et al.
Pubblicazione: (2026)
Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges
di: Li, Senyao, et al.
Pubblicazione: (2025)
di: Li, Senyao, et al.
Pubblicazione: (2025)
Token Level Routing Inference System for Edge Devices
di: She, Jianshu, et al.
Pubblicazione: (2025)
di: She, Jianshu, et al.
Pubblicazione: (2025)
AnchorTP: Resilient LLM Inference with State-Preserving Elastic Tensor Parallelism
di: Xu, Wendong, et al.
Pubblicazione: (2025)
di: Xu, Wendong, et al.
Pubblicazione: (2025)
Adaptive Heuristics for Scheduling DNN Inferencing on Edge and Cloud for Personalized UAV Fleets
di: Raj, Suman, et al.
Pubblicazione: (2024)
di: Raj, Suman, et al.
Pubblicazione: (2024)
OCTOPINF: Workload-Aware Inference Serving for Edge Video Analytics
di: Nguyen, Thanh-Tung, et al.
Pubblicazione: (2025)
di: Nguyen, Thanh-Tung, et al.
Pubblicazione: (2025)
An Elastic Job Scheduler for HPC Applications on the Cloud
di: Bhosale, Aditya, et al.
Pubblicazione: (2025)
di: Bhosale, Aditya, et al.
Pubblicazione: (2025)
PipeSD: An Efficient Cloud-Edge Collaborative Pipeline Inference Framework with Speculative Decoding
di: Han, Yunhe, et al.
Pubblicazione: (2026)
di: Han, Yunhe, et al.
Pubblicazione: (2026)
Edge-Cloud Collaborative Pothole Detection via Onboard Event Screening and Federated Temporal Segmentation
di: Wu, Yingjie, et al.
Pubblicazione: (2026)
di: Wu, Yingjie, et al.
Pubblicazione: (2026)
SynergAI: Edge-to-Cloud Synergy for Architecture-Driven High-Performance Orchestration for AI Inference
di: Stathopoulou, Foteini, et al.
Pubblicazione: (2025)
di: Stathopoulou, Foteini, et al.
Pubblicazione: (2025)
RAPID: Redundancy-Aware and Compatibility-Optimal Edge-Cloud Partitioned Inference for Diverse VLA Models
di: Zheng, Zihao, et al.
Pubblicazione: (2026)
di: Zheng, Zihao, et al.
Pubblicazione: (2026)
Distributed Edge Analytics in Edge-Fog-Cloud Continuum
di: Srirama, Satish Narayana
Pubblicazione: (2024)
di: Srirama, Satish Narayana
Pubblicazione: (2024)
Accelerating Edge Inference for Distributed MoE Models with Latency-Optimized Expert Placement
di: Wu, Tian, et al.
Pubblicazione: (2025)
di: Wu, Tian, et al.
Pubblicazione: (2025)
ACE-Sync: An Adaptive Cloud-Edge Synchronization Framework for Communication-Efficient Large-Scale Distributed Model Training
di: Yang, Yi, et al.
Pubblicazione: (2025)
di: Yang, Yi, et al.
Pubblicazione: (2025)
KCES: A Workflow Containerization Scheduling Scheme Under Cloud-Edge Collaboration Framework
di: Shan, Chenggang, et al.
Pubblicazione: (2024)
di: Shan, Chenggang, et al.
Pubblicazione: (2024)
Collaborative Multi-Agent Reinforcement Learning Approach for Elastic Cloud Resource Scaling
di: Fang, Bruce, et al.
Pubblicazione: (2025)
di: Fang, Bruce, et al.
Pubblicazione: (2025)
GeoFaaS: An Edge-to-Cloud FaaS Platform
di: Malekabbasi, Mohammadreza, et al.
Pubblicazione: (2024)
di: Malekabbasi, Mohammadreza, et al.
Pubblicazione: (2024)
Online Optimization of DNN Inference Network Utility in Collaborative Edge Computing
di: Li, Rui, et al.
Pubblicazione: (2024)
di: Li, Rui, et al.
Pubblicazione: (2024)
EdgeShard: Efficient LLM Inference via Collaborative Edge Computing
di: Zhang, Mingjin, et al.
Pubblicazione: (2024)
di: Zhang, Mingjin, et al.
Pubblicazione: (2024)
Bridge the Present and Future: A Cross-Layer Matching Game in Dynamic Cloud-Aided Mobile Edge Networks
di: Qi, Houyi, et al.
Pubblicazione: (2023)
di: Qi, Houyi, et al.
Pubblicazione: (2023)
ElasticMM: Efficient Multimodal LLMs Serving with Elastic Multimodal Parallelism
di: Liu, Zedong, et al.
Pubblicazione: (2025)
di: Liu, Zedong, et al.
Pubblicazione: (2025)
EdgeFaaS: A Function-based Framework for Edge Computing
di: Jin, Runyu, et al.
Pubblicazione: (2022)
di: Jin, Runyu, et al.
Pubblicazione: (2022)
LIME:Accelerating Collaborative Lossless LLM Inference on Memory-Constrained Edge Devices
di: Sun, Mingyu, et al.
Pubblicazione: (2025)
di: Sun, Mingyu, et al.
Pubblicazione: (2025)
Cloud Native System for LLM Inference Serving
di: Xu, Minxian, et al.
Pubblicazione: (2025)
di: Xu, Minxian, et al.
Pubblicazione: (2025)
ACE-GNN: Adaptive GNN Co-Inference with System-Aware Scheduling in Dynamic Edge Environments
di: Zhou, Ao, et al.
Pubblicazione: (2025)
di: Zhou, Ao, et al.
Pubblicazione: (2025)
FlexSpec: Frozen Drafts Meet Evolving Targets in Edge-Cloud Collaborative LLM Speculative Decoding
di: Li, Yuchen, et al.
Pubblicazione: (2026)
di: Li, Yuchen, et al.
Pubblicazione: (2026)
Adaptive Device-Edge Collaboration on DNN Inference in AIoT: A Digital Twin-Assisted Approach
di: Hu, Shisheng, et al.
Pubblicazione: (2024)
di: Hu, Shisheng, et al.
Pubblicazione: (2024)
Distributed Resource Selection for Self-Organising Cloud-Edge Systems
di: Renau, Quentin, et al.
Pubblicazione: (2025)
di: Renau, Quentin, et al.
Pubblicazione: (2025)
Application-level observability for adaptive Edge to Cloud continuum systems
di: Sidi, Kaddour, et al.
Pubblicazione: (2026)
di: Sidi, Kaddour, et al.
Pubblicazione: (2026)
Towards Seamless Serverless Computing Across an Edge-Cloud Continuum
di: Simion, Emilian, et al.
Pubblicazione: (2024)
di: Simion, Emilian, et al.
Pubblicazione: (2024)
GMB-ECC: Guided Measuring and Benchmarking of the Edge Cloud Continuum
di: Jahnke, Brian-Frederik, et al.
Pubblicazione: (2025)
di: Jahnke, Brian-Frederik, et al.
Pubblicazione: (2025)
ContinuumConductor : Decentralized Process Mining on the Edge-Cloud Continuum
di: Reiter, Hendrik, et al.
Pubblicazione: (2025)
di: Reiter, Hendrik, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MSAO: Adaptive Modality Sparsity-Aware Offloading with Edge-Cloud Collaboration for Efficient Multimodal LLM Inference
di: Yang, Zheming, et al.
Pubblicazione: (2026) -
MoA-Off: Adaptive Heterogeneous Modality-Aware Offloading with Edge-Cloud Collaboration for Efficient Multimodal LLM Inference
di: Yang, Zheming, et al.
Pubblicazione: (2025) -
HybridFlow: Resource-Adaptive Subtask Routing for Efficient Edge-Cloud LLM Inference
di: Dong, Jiangwen, et al.
Pubblicazione: (2025) -
EC2MoE: Adaptive End-Cloud Pipeline Collaboration Enabling Scalable Mixture-of-Experts Inference
di: Yang, Zheming, et al.
Pubblicazione: (2025) -
Efficient Routing of Inference Requests across LLM Instances in Cloud-Edge Computing
di: Yu, Shibo, et al.
Pubblicazione: (2025)