R2E-VID: Two-Stage Robust Routing via Temporal Gating for Elastic Edge-Cloud Video Inference
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Zheming, Zuo, Lulu, Lu, Shun, Zhang, Yangyu, Li, Zhicheng, Li, Xiangyang, You, Yang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MSAO: Adaptive Modality Sparsity-Aware Offloading with Edge-Cloud Collaboration for Efficient Multimodal LLM Inference
par: Yang, Zheming, et autres
Publié: (2026)
par: Yang, Zheming, et autres
Publié: (2026)
MoA-Off: Adaptive Heterogeneous Modality-Aware Offloading with Edge-Cloud Collaboration for Efficient Multimodal LLM Inference
par: Yang, Zheming, et autres
Publié: (2025)
par: Yang, Zheming, et autres
Publié: (2025)
HybridFlow: Resource-Adaptive Subtask Routing for Efficient Edge-Cloud LLM Inference
par: Dong, Jiangwen, et autres
Publié: (2025)
par: Dong, Jiangwen, et autres
Publié: (2025)
EC2MoE: Adaptive End-Cloud Pipeline Collaboration Enabling Scalable Mixture-of-Experts Inference
par: Yang, Zheming, et autres
Publié: (2025)
par: Yang, Zheming, et autres
Publié: (2025)
Efficient Routing of Inference Requests across LLM Instances in Cloud-Edge Computing
par: Yu, Shibo, et autres
Publié: (2025)
par: Yu, Shibo, et autres
Publié: (2025)
PerLLM: Personalized Inference Scheduling with Edge-Cloud Collaboration for Diverse LLM Services
par: Yang, Zheming, et autres
Publié: (2024)
par: Yang, Zheming, et autres
Publié: (2024)
PICE: A Semantic-Driven Progressive Inference System for LLM Serving in Cloud-Edge Networks
par: Zhan, Huiyou, et autres
Publié: (2025)
par: Zhan, Huiyou, et autres
Publié: (2025)
Administrative Decentralization in Edge-Cloud Multi-Agent for Mobile Automation
par: Li, Senyao, et autres
Publié: (2026)
par: Li, Senyao, et autres
Publié: (2026)
A Pipelined Collaborative Speculative Decoding Framework for Efficient Edge-Cloud LLM Inference
par: Zhang, Yida, et autres
Publié: (2026)
par: Zhang, Yida, et autres
Publié: (2026)
Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges
par: Li, Senyao, et autres
Publié: (2025)
par: Li, Senyao, et autres
Publié: (2025)
Token Level Routing Inference System for Edge Devices
par: She, Jianshu, et autres
Publié: (2025)
par: She, Jianshu, et autres
Publié: (2025)
AnchorTP: Resilient LLM Inference with State-Preserving Elastic Tensor Parallelism
par: Xu, Wendong, et autres
Publié: (2025)
par: Xu, Wendong, et autres
Publié: (2025)
Adaptive Heuristics for Scheduling DNN Inferencing on Edge and Cloud for Personalized UAV Fleets
par: Raj, Suman, et autres
Publié: (2024)
par: Raj, Suman, et autres
Publié: (2024)
OCTOPINF: Workload-Aware Inference Serving for Edge Video Analytics
par: Nguyen, Thanh-Tung, et autres
Publié: (2025)
par: Nguyen, Thanh-Tung, et autres
Publié: (2025)
An Elastic Job Scheduler for HPC Applications on the Cloud
par: Bhosale, Aditya, et autres
Publié: (2025)
par: Bhosale, Aditya, et autres
Publié: (2025)
PipeSD: An Efficient Cloud-Edge Collaborative Pipeline Inference Framework with Speculative Decoding
par: Han, Yunhe, et autres
Publié: (2026)
par: Han, Yunhe, et autres
Publié: (2026)
Edge-Cloud Collaborative Pothole Detection via Onboard Event Screening and Federated Temporal Segmentation
par: Wu, Yingjie, et autres
Publié: (2026)
par: Wu, Yingjie, et autres
Publié: (2026)
SynergAI: Edge-to-Cloud Synergy for Architecture-Driven High-Performance Orchestration for AI Inference
par: Stathopoulou, Foteini, et autres
Publié: (2025)
par: Stathopoulou, Foteini, et autres
Publié: (2025)
RAPID: Redundancy-Aware and Compatibility-Optimal Edge-Cloud Partitioned Inference for Diverse VLA Models
par: Zheng, Zihao, et autres
Publié: (2026)
par: Zheng, Zihao, et autres
Publié: (2026)
Distributed Edge Analytics in Edge-Fog-Cloud Continuum
par: Srirama, Satish Narayana
Publié: (2024)
par: Srirama, Satish Narayana
Publié: (2024)
Accelerating Edge Inference for Distributed MoE Models with Latency-Optimized Expert Placement
par: Wu, Tian, et autres
Publié: (2025)
par: Wu, Tian, et autres
Publié: (2025)
ACE-Sync: An Adaptive Cloud-Edge Synchronization Framework for Communication-Efficient Large-Scale Distributed Model Training
par: Yang, Yi, et autres
Publié: (2025)
par: Yang, Yi, et autres
Publié: (2025)
KCES: A Workflow Containerization Scheduling Scheme Under Cloud-Edge Collaboration Framework
par: Shan, Chenggang, et autres
Publié: (2024)
par: Shan, Chenggang, et autres
Publié: (2024)
Collaborative Multi-Agent Reinforcement Learning Approach for Elastic Cloud Resource Scaling
par: Fang, Bruce, et autres
Publié: (2025)
par: Fang, Bruce, et autres
Publié: (2025)
GeoFaaS: An Edge-to-Cloud FaaS Platform
par: Malekabbasi, Mohammadreza, et autres
Publié: (2024)
par: Malekabbasi, Mohammadreza, et autres
Publié: (2024)
Online Optimization of DNN Inference Network Utility in Collaborative Edge Computing
par: Li, Rui, et autres
Publié: (2024)
par: Li, Rui, et autres
Publié: (2024)
EdgeShard: Efficient LLM Inference via Collaborative Edge Computing
par: Zhang, Mingjin, et autres
Publié: (2024)
par: Zhang, Mingjin, et autres
Publié: (2024)
Bridge the Present and Future: A Cross-Layer Matching Game in Dynamic Cloud-Aided Mobile Edge Networks
par: Qi, Houyi, et autres
Publié: (2023)
par: Qi, Houyi, et autres
Publié: (2023)
ElasticMM: Efficient Multimodal LLMs Serving with Elastic Multimodal Parallelism
par: Liu, Zedong, et autres
Publié: (2025)
par: Liu, Zedong, et autres
Publié: (2025)
EdgeFaaS: A Function-based Framework for Edge Computing
par: Jin, Runyu, et autres
Publié: (2022)
par: Jin, Runyu, et autres
Publié: (2022)
LIME:Accelerating Collaborative Lossless LLM Inference on Memory-Constrained Edge Devices
par: Sun, Mingyu, et autres
Publié: (2025)
par: Sun, Mingyu, et autres
Publié: (2025)
Cloud Native System for LLM Inference Serving
par: Xu, Minxian, et autres
Publié: (2025)
par: Xu, Minxian, et autres
Publié: (2025)
ACE-GNN: Adaptive GNN Co-Inference with System-Aware Scheduling in Dynamic Edge Environments
par: Zhou, Ao, et autres
Publié: (2025)
par: Zhou, Ao, et autres
Publié: (2025)
FlexSpec: Frozen Drafts Meet Evolving Targets in Edge-Cloud Collaborative LLM Speculative Decoding
par: Li, Yuchen, et autres
Publié: (2026)
par: Li, Yuchen, et autres
Publié: (2026)
Adaptive Device-Edge Collaboration on DNN Inference in AIoT: A Digital Twin-Assisted Approach
par: Hu, Shisheng, et autres
Publié: (2024)
par: Hu, Shisheng, et autres
Publié: (2024)
Distributed Resource Selection for Self-Organising Cloud-Edge Systems
par: Renau, Quentin, et autres
Publié: (2025)
par: Renau, Quentin, et autres
Publié: (2025)
Application-level observability for adaptive Edge to Cloud continuum systems
par: Sidi, Kaddour, et autres
Publié: (2026)
par: Sidi, Kaddour, et autres
Publié: (2026)
Towards Seamless Serverless Computing Across an Edge-Cloud Continuum
par: Simion, Emilian, et autres
Publié: (2024)
par: Simion, Emilian, et autres
Publié: (2024)
GMB-ECC: Guided Measuring and Benchmarking of the Edge Cloud Continuum
par: Jahnke, Brian-Frederik, et autres
Publié: (2025)
par: Jahnke, Brian-Frederik, et autres
Publié: (2025)
ContinuumConductor : Decentralized Process Mining on the Edge-Cloud Continuum
par: Reiter, Hendrik, et autres
Publié: (2025)
par: Reiter, Hendrik, et autres
Publié: (2025)
Documents similaires
-
MSAO: Adaptive Modality Sparsity-Aware Offloading with Edge-Cloud Collaboration for Efficient Multimodal LLM Inference
par: Yang, Zheming, et autres
Publié: (2026) -
MoA-Off: Adaptive Heterogeneous Modality-Aware Offloading with Edge-Cloud Collaboration for Efficient Multimodal LLM Inference
par: Yang, Zheming, et autres
Publié: (2025) -
HybridFlow: Resource-Adaptive Subtask Routing for Efficient Edge-Cloud LLM Inference
par: Dong, Jiangwen, et autres
Publié: (2025) -
EC2MoE: Adaptive End-Cloud Pipeline Collaboration Enabling Scalable Mixture-of-Experts Inference
par: Yang, Zheming, et autres
Publié: (2025) -
Efficient Routing of Inference Requests across LLM Instances in Cloud-Edge Computing
par: Yu, Shibo, et autres
Publié: (2025)