Leveraging knowledge-as-a-service (KaaS) for QoS-aware resource management in multi-user video transcoding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Costero, Luis, Igual, Francisco D., Olcoz, Katzalin, Tirado, Francisco |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Energy efficiency optimization of task-parallel codes on asymmetric architectures
par: Costero, Luis, et autres
Publié: (2024)
par: Costero, Luis, et autres
Publié: (2024)
Balanced segmentation of CNNs for multi-TPU inference
par: Villarrubia, Jorge, et autres
Publié: (2025)
par: Villarrubia, Jorge, et autres
Publié: (2025)
Improving inference time in multi-TPU systems with profiled model segmentation
par: Villarrubia, Jorge, et autres
Publié: (2025)
par: Villarrubia, Jorge, et autres
Publié: (2025)
A comprehensive evaluation of spatial co-execution on GPUs using MPS and MIG technologies
par: Villarrubia, Jorge, et autres
Publié: (2026)
par: Villarrubia, Jorge, et autres
Publié: (2026)
Leveraging Multi-Instance GPUs through moldable task scheduling
par: Villarrubia, Jorge, et autres
Publié: (2025)
par: Villarrubia, Jorge, et autres
Publié: (2025)
QoS-aware Scheduling of Periodic Real-time Task Graphs on Heterogeneous Pre-occupied MECs
par: Shankar, Ashutosh, et autres
Publié: (2025)
par: Shankar, Ashutosh, et autres
Publié: (2025)
QoE-oriented Dependent Task Scheduling under Multi-dimensional QoS Constraints over Distributed Networks
par: Fan, Xuwei, et autres
Publié: (2023)
par: Fan, Xuwei, et autres
Publié: (2023)
QONNECT: A QoS-Aware Orchestration System for Distributed Kubernetes Clusters
par: Aslan, Haci Ismail, et autres
Publié: (2025)
par: Aslan, Haci Ismail, et autres
Publié: (2025)
QEdgeProxy: QoS-Aware Load Balancing for IoT Services in the Computing Continuum
par: Čilić, Ivan, et autres
Publié: (2024)
par: Čilić, Ivan, et autres
Publié: (2024)
Mercury: QoS-Aware Tiered Memory System
par: Lu, Jiaheng, et autres
Publié: (2024)
par: Lu, Jiaheng, et autres
Publié: (2024)
eBeeMetrics: An eBPF-based Library Framework for Feedback-free Observability of QoS Metrics
par: Ibnath, Muntaka, et autres
Publié: (2026)
par: Ibnath, Muntaka, et autres
Publié: (2026)
DuoServe-MoE: Dual-Phase Expert Prefetch and Caching for LLM Inference QoS Assurance
par: Zhang, Yuning, et autres
Publié: (2025)
par: Zhang, Yuning, et autres
Publié: (2025)
EAT: QoS-Aware Edge-Collaborative AIGC Task Scheduling via Attention-Guided Diffusion Reinforcement Learning
par: Xu, Zhifei, et autres
Publié: (2025)
par: Xu, Zhifei, et autres
Publié: (2025)
Large Language Model Aided QoS Prediction for Service Recommendation
par: Liu, Huiying, et autres
Publié: (2024)
par: Liu, Huiying, et autres
Publié: (2024)
QoS Aware Mixed-Criticality Task Scheduling in Vehicular Edge Cloud System
par: Sarkar, Suvarthi, et autres
Publié: (2024)
par: Sarkar, Suvarthi, et autres
Publié: (2024)
Optimized Cloud Resource Allocation Using Genetic Algorithms for Energy Efficiency and QoS Assurance
par: Panggabean, Caroline, et autres
Publié: (2025)
par: Panggabean, Caroline, et autres
Publié: (2025)
High Order Collaboration-Oriented Federated Graph Neural Network for Accurate QoS Prediction
par: Chen, Zehuan, et autres
Publié: (2025)
par: Chen, Zehuan, et autres
Publié: (2025)
QoS-Efficient Serving of Multiple Mixture-of-Expert LLMs Using Partial Runtime Reconfiguration
par: Imani, HamidReza, et autres
Publié: (2025)
par: Imani, HamidReza, et autres
Publié: (2025)
Analysis of wireless network access logs for a hierarchical characterization of user mobility
par: Talavera, Francisco, et autres
Publié: (2026)
par: Talavera, Francisco, et autres
Publié: (2026)
Hierarchical storage management in user space for neuroimaging applications
par: Hayot-Sasson, Valérie, et autres
Publié: (2024)
par: Hayot-Sasson, Valérie, et autres
Publié: (2024)
QoS-Aware Load Balancing in the Computing Continuum via Multi-Player Bandits
par: Čilić, Ivan, et autres
Publié: (2025)
par: Čilić, Ivan, et autres
Publié: (2025)
Genetic-based fog colony optimization hybridized with hierarchical clustering and its influence in the placement of fog services
par: Talavera, Francisco, et autres
Publié: (2022)
par: Talavera, Francisco, et autres
Publié: (2022)
Resource Slicing through Intelligent Orchestration of Energy-aware IoT services in Edge-Cloud Continuum
par: Shahid, Hafiz Faheem, et autres
Publié: (2024)
par: Shahid, Hafiz Faheem, et autres
Publié: (2024)
Adaptive multi-criteria-based load balancing technique for resource allocation in fog-cloud environments
par: Gad-Elrab, Ahmed A. A., et autres
Publié: (2024)
par: Gad-Elrab, Ahmed A. A., et autres
Publié: (2024)
Hardware-Level QoS Enforcement Features: Technologies, Use Cases, and Research Challenges
par: Larsson, Oliver, et autres
Publié: (2025)
par: Larsson, Oliver, et autres
Publié: (2025)
Feature Noise Resilient for QoS Prediction with Probabilistic Deep Supervision
par: Wang, Ziliang, et autres
Publié: (2023)
par: Wang, Ziliang, et autres
Publié: (2023)
From SLA to vendor-neutral metrics: An intelligent knowledge-based approach for multi-cloud SLA-based broker
par: Rampérez, Víctor, et autres
Publié: (2025)
par: Rampérez, Víctor, et autres
Publié: (2025)
Malicious node aware wireless multi hop networks: a systematic review of the literature and recommendations for future research
par: Pourdehghan, Shahram, et autres
Publié: (2025)
par: Pourdehghan, Shahram, et autres
Publié: (2025)
CloudFormer: An Attention-based Performance Prediction for Public Clouds with Unknown Workload
par: Shahbazinia, Amirhossein, et autres
Publié: (2025)
par: Shahbazinia, Amirhossein, et autres
Publié: (2025)
DAG-Based QoS-Aware Dynamic Task Placement for Networked Multi-Stage Control Pipelines
par: Tran, Thien, et autres
Publié: (2026)
par: Tran, Thien, et autres
Publié: (2026)
Leveraging Mathematical Reasoning of LLMs for Efficient GPU Thread Mapping
par: Maureira, Jose, et autres
Publié: (2026)
par: Maureira, Jose, et autres
Publié: (2026)
Integrated user scheduling and beam steering in over-the-air federated learning for mobile IoT
par: Liu, Shengheng, et autres
Publié: (2025)
par: Liu, Shengheng, et autres
Publié: (2025)
Towards cost-effective and resource-aware aggregation at Edge for Federated Learning
par: Khan, Ahmad Faraz, et autres
Publié: (2022)
par: Khan, Ahmad Faraz, et autres
Publié: (2022)
Continuous QoS-compliant Orchestration in the Cloud-Edge Continuum
par: Bisicchia, Giuseppe, et autres
Publié: (2023)
par: Bisicchia, Giuseppe, et autres
Publié: (2023)
Towards singular optimality in the presence of local initial knowledge
par: Ji, Hongyan, et autres
Publié: (2024)
par: Ji, Hongyan, et autres
Publié: (2024)
Affinity-aware Serverless Function Scheduling
par: De Palma, Giuseppe, et autres
Publié: (2024)
par: De Palma, Giuseppe, et autres
Publié: (2024)
GeoNimbus: A serverless framework to build earth observation and environmental services
par: Sánchez-Gallegos, Dante D., et autres
Publié: (2025)
par: Sánchez-Gallegos, Dante D., et autres
Publié: (2025)
QoSFlow: Ensuring Service Quality of Distributed Workflows Using Interpretable Sensitivity Models
par: Rashid, Md Hasanur, et autres
Publié: (2026)
par: Rashid, Md Hasanur, et autres
Publié: (2026)
Energy-aware operation of HPC systems in Germany
par: Suarez, Estela, et autres
Publié: (2024)
par: Suarez, Estela, et autres
Publié: (2024)
Prediction-driven resource provisioning for serverless container runtimes
par: Tomaras, Dimitrios, et autres
Publié: (2024)
par: Tomaras, Dimitrios, et autres
Publié: (2024)
Documents similaires
-
Energy efficiency optimization of task-parallel codes on asymmetric architectures
par: Costero, Luis, et autres
Publié: (2024) -
Balanced segmentation of CNNs for multi-TPU inference
par: Villarrubia, Jorge, et autres
Publié: (2025) -
Improving inference time in multi-TPU systems with profiled model segmentation
par: Villarrubia, Jorge, et autres
Publié: (2025) -
A comprehensive evaluation of spatial co-execution on GPUs using MPS and MIG technologies
par: Villarrubia, Jorge, et autres
Publié: (2026) -
Leveraging Multi-Instance GPUs through moldable task scheduling
par: Villarrubia, Jorge, et autres
Publié: (2025)