SynergAI: Edge-to-Cloud Synergy for Architecture-Driven High-Performance Orchestration for AI Inference
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Stathopoulou, Foteini, Ferikoglou, Aggelos, Katsaragakis, Manolis, Masouros, Dimosthenis, Xydis, Sotirios, Soudris, Dimitrios |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Leveraging Core and Uncore Frequency Scaling for Power-Efficient Serverless Workflows
par: Tzenetopoulos, Achilleas, et autres
Publié: (2024)
par: Tzenetopoulos, Achilleas, et autres
Publié: (2024)
SLO-aware GPU Frequency Scaling for Energy Efficient LLM Inference Serving
par: Kakolyris, Andreas Kosmas, et autres
Publié: (2024)
par: Kakolyris, Andreas Kosmas, et autres
Publié: (2024)
LLM-Driven Intent-Based Privacy-Aware Orchestration Across the Cloud-Edge Continuum
par: Su, Zijie, et autres
Publié: (2026)
par: Su, Zijie, et autres
Publié: (2026)
Synergizing Monetization, Orchestration, and Semantics in Computing Continuum
par: Dehury, Chinmaya Kumar, et autres
Publié: (2025)
par: Dehury, Chinmaya Kumar, et autres
Publié: (2025)
SmartPQ: An Adaptive Concurrent Priority Queue for NUMA Architectures
par: Giannoula, Christina, et autres
Publié: (2024)
par: Giannoula, Christina, et autres
Publié: (2024)
DECICE: AI-Driven Scheduling and Digital Twin Integration for the Cloud-HPC-Edge Compute Continuum
par: Sharma, Aasish Kumar, et autres
Publié: (2026)
par: Sharma, Aasish Kumar, et autres
Publié: (2026)
ML-ECS: A Collaborative Multimodal Learning Framework for Edge-Cloud Synergies
par: Liu, Yuze, et autres
Publié: (2026)
par: Liu, Yuze, et autres
Publié: (2026)
Orchestrating Serverless Applications in the Edge Cloud Space Continuum: What Breaks and What is Next?
par: Malazi, Hadi Tabatabaee, et autres
Publié: (2026)
par: Malazi, Hadi Tabatabaee, et autres
Publié: (2026)
PICE: A Semantic-Driven Progressive Inference System for LLM Serving in Cloud-Edge Networks
par: Zhan, Huiyou, et autres
Publié: (2025)
par: Zhan, Huiyou, et autres
Publié: (2025)
Resource Slicing through Intelligent Orchestration of Energy-aware IoT services in Edge-Cloud Continuum
par: Shahid, Hafiz Faheem, et autres
Publié: (2024)
par: Shahid, Hafiz Faheem, et autres
Publié: (2024)
Converter: A CEAML Reasoner Python package to Streamline Orchestration Across Cloud and Edge Continuum
par: Korontanis, Ioannis, et autres
Publié: (2024)
par: Korontanis, Ioannis, et autres
Publié: (2024)
Edge-Oriented Orchestration of Energy Services Using Graph-Driven Swarm Intelligence
par: Toderean, Liana, et autres
Publié: (2026)
par: Toderean, Liana, et autres
Publié: (2026)
Decoupled Access-Execute enabled DVFS for tinyML deployments on STM32 microcontrollers
par: Alvanaki, Elisavet Lydia, et autres
Publié: (2024)
par: Alvanaki, Elisavet Lydia, et autres
Publié: (2024)
FengHuang: Next-Generation Memory Orchestration for AI Inferencing
par: Li, Jiamin, et autres
Publié: (2025)
par: Li, Jiamin, et autres
Publié: (2025)
TD3-Sched: Learning to Orchestrate Container-based Cloud-Edge Resources via Distributed Reinforcement Learning
par: Song, Shengye, et autres
Publié: (2025)
par: Song, Shengye, et autres
Publié: (2025)
Infer-EDGE: Dynamic DNN Inference Optimization in 'Just-in-time' Edge-AI Implementations
par: Mounesan, Motahare, et autres
Publié: (2025)
par: Mounesan, Motahare, et autres
Publié: (2025)
AI-Driven Multi-Region Provisioning for Cloud Services Using Spot Fleets
par: Fabra, Javier, et autres
Publié: (2026)
par: Fabra, Javier, et autres
Publié: (2026)
Orchestrating the Execution of Serverless Functions in Hybrid Clouds
par: Peri, Aristotelis, et autres
Publié: (2024)
par: Peri, Aristotelis, et autres
Publié: (2024)
A DataOps Toolbox Enabling Continuous Semantic Integration of Devices for Edge-Cloud AI Applications
par: Scrocca, Mario, et autres
Publié: (2025)
par: Scrocca, Mario, et autres
Publié: (2025)
Cloud abstractions for AI workloads
par: Canini, Marco, et autres
Publié: (2025)
par: Canini, Marco, et autres
Publié: (2025)
Adaptive Heuristics for Scheduling DNN Inferencing on Edge and Cloud for Personalized UAV Fleets
par: Raj, Suman, et autres
Publié: (2024)
par: Raj, Suman, et autres
Publié: (2024)
Efficient Routing of Inference Requests across LLM Instances in Cloud-Edge Computing
par: Yu, Shibo, et autres
Publié: (2025)
par: Yu, Shibo, et autres
Publié: (2025)
HE2C: A Holistic Approach for Allocating Latency-Sensitive AI Tasks across Edge-Cloud
par: Kim, Minseo, et autres
Publié: (2024)
par: Kim, Minseo, et autres
Publié: (2024)
Intelligent Orchestration of Distributed Large Foundation Model Inference at the Edge
par: Koch, Fernando, et autres
Publié: (2025)
par: Koch, Fernando, et autres
Publié: (2025)
GenAI at the Edge: Comprehensive Survey on Empowering Edge Devices
par: Navardi, Mozhgan, et autres
Publié: (2025)
par: Navardi, Mozhgan, et autres
Publié: (2025)
A Pipelined Collaborative Speculative Decoding Framework for Efficient Edge-Cloud LLM Inference
par: Zhang, Yida, et autres
Publié: (2026)
par: Zhang, Yida, et autres
Publié: (2026)
HybridFlow: Resource-Adaptive Subtask Routing for Efficient Edge-Cloud LLM Inference
par: Dong, Jiangwen, et autres
Publié: (2025)
par: Dong, Jiangwen, et autres
Publié: (2025)
PipeSD: An Efficient Cloud-Edge Collaborative Pipeline Inference Framework with Speculative Decoding
par: Han, Yunhe, et autres
Publié: (2026)
par: Han, Yunhe, et autres
Publié: (2026)
Evaluating Container Orchestration for Neuromorphic Workloads in Virtual Edge Environments
par: Pham, Huyen, et autres
Publié: (2026)
par: Pham, Huyen, et autres
Publié: (2026)
An Analysis of HPC and Edge Architectures in the Cloud
par: Santillan, Steven, et autres
Publié: (2025)
par: Santillan, Steven, et autres
Publié: (2025)
SLICE: SLO-Driven Scheduling for LLM Inference on Edge Computing Devices
par: Chow, Will
Publié: (2025)
par: Chow, Will
Publié: (2025)
Orchestrating Mixed-Criticality Cloud Workloads in Reconfigurable Manufacturing Systems
par: Barletta, Marco, et autres
Publié: (2024)
par: Barletta, Marco, et autres
Publié: (2024)
Running Cloud-native Workloads on HPC with High-Performance Kubernetes
par: Chazapis, Antony, et autres
Publié: (2024)
par: Chazapis, Antony, et autres
Publié: (2024)
TIMBER: On supporting data pipelines in Mobile Cloud Environments
par: Tomaras, Dimitrios, et autres
Publié: (2024)
par: Tomaras, Dimitrios, et autres
Publié: (2024)
Inference Load-Aware Orchestration for Hierarchical Federated Learning
par: Lackinger, Anna, et autres
Publié: (2024)
par: Lackinger, Anna, et autres
Publié: (2024)
Decentralized Orchestration Architecture for Fluid Computing: A Secure Distributed AI Use Case
par: Cajaraville-Aboy, Diego, et autres
Publié: (2026)
par: Cajaraville-Aboy, Diego, et autres
Publié: (2026)
Distributed Load Orchestration for Vision Computing in Multi-Access Edge Computing
par: Boing, Ricardo N., et autres
Publié: (2022)
par: Boing, Ricardo N., et autres
Publié: (2022)
Environmentally-Conscious Cloud Orchestration Considering Geo-Distributed Data Centers
par: Attenni, Giulio, et autres
Publié: (2025)
par: Attenni, Giulio, et autres
Publié: (2025)
Distributed Edge Analytics in Edge-Fog-Cloud Continuum
par: Srirama, Satish Narayana
Publié: (2024)
par: Srirama, Satish Narayana
Publié: (2024)
MSAO: Adaptive Modality Sparsity-Aware Offloading with Edge-Cloud Collaboration for Efficient Multimodal LLM Inference
par: Yang, Zheming, et autres
Publié: (2026)
par: Yang, Zheming, et autres
Publié: (2026)
Documents similaires
-
Leveraging Core and Uncore Frequency Scaling for Power-Efficient Serverless Workflows
par: Tzenetopoulos, Achilleas, et autres
Publié: (2024) -
SLO-aware GPU Frequency Scaling for Energy Efficient LLM Inference Serving
par: Kakolyris, Andreas Kosmas, et autres
Publié: (2024) -
LLM-Driven Intent-Based Privacy-Aware Orchestration Across the Cloud-Edge Continuum
par: Su, Zijie, et autres
Publié: (2026) -
Synergizing Monetization, Orchestration, and Semantics in Computing Continuum
par: Dehury, Chinmaya Kumar, et autres
Publié: (2025) -
SmartPQ: An Adaptive Concurrent Priority Queue for NUMA Architectures
par: Giannoula, Christina, et autres
Publié: (2024)