Optimizing video analytics inference pipelines: a case study
Fuente:
arXiv
Salvato in:
| Autori principali: | Ghafouri, Saeid, Ding, Yuming, Chito, Katerine Diaz, del Rincón, Jesús Martinez, O'Connell, Niamh, Vandierendonck, Hans |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference
di: Li, Xiangchen, et al.
Pubblicazione: (2025)
di: Li, Xiangchen, et al.
Pubblicazione: (2025)
Sponge: Inference Serving with Dynamic SLOs Using In-Place Vertical Scaling
di: Razavi, Kamran, et al.
Pubblicazione: (2024)
di: Razavi, Kamran, et al.
Pubblicazione: (2024)
TOD: Transprecise Object Detection to Maximise Real-Time Accuracy on the Edge
di: Lee, JunKyu, et al.
Pubblicazione: (2021)
di: Lee, JunKyu, et al.
Pubblicazione: (2021)
On Optimizing Locality of Graph Transposition on Modern Architectures
di: Esfahani, Mohsen Koohi, et al.
Pubblicazione: (2025)
di: Esfahani, Mohsen Koohi, et al.
Pubblicazione: (2025)
An approach to provide serverless scientific pipelines within the context of SKA
di: Ríos-Monje, Carlos, et al.
Pubblicazione: (2023)
di: Ríos-Monje, Carlos, et al.
Pubblicazione: (2023)
Optimal, Non-pipelined Reduce-scatter and Allreduce Algorithms
di: Träff, Jesper Larsson
Pubblicazione: (2024)
di: Träff, Jesper Larsson
Pubblicazione: (2024)
TIMBER: On supporting data pipelines in Mobile Cloud Environments
di: Tomaras, Dimitrios, et al.
Pubblicazione: (2024)
di: Tomaras, Dimitrios, et al.
Pubblicazione: (2024)
Performance Cost Tradeoffs in Intelligent Load Balancing for Multi Data Center Cloud Systems: From Static Policies to Adaptive Resource Distribution
di: Najafabadi, Saeid Aghasoleymani, et al.
Pubblicazione: (2025)
di: Najafabadi, Saeid Aghasoleymani, et al.
Pubblicazione: (2025)
Workflow as a Service Broker in Cloud Environment: A Systematic Mapping Study
di: Abrishami, Saeid, et al.
Pubblicazione: (2025)
di: Abrishami, Saeid, et al.
Pubblicazione: (2025)
Optimizing Communication in Byzantine Agreement Protocols with Slim-HBBFT
di: Sony, Nasit S, et al.
Pubblicazione: (2025)
di: Sony, Nasit S, et al.
Pubblicazione: (2025)
Slim-ABC: An Optimized Atomic Broadcast Protocol
di: Sony, Nasit S, et al.
Pubblicazione: (2024)
di: Sony, Nasit S, et al.
Pubblicazione: (2024)
IPA: Inference Pipeline Adaptation to Achieve High Accuracy and Cost-Efficiency
di: Ghafouri, Saeid, et al.
Pubblicazione: (2023)
di: Ghafouri, Saeid, et al.
Pubblicazione: (2023)
Multi-modal video data-pipelines for machine learning with minimal human supervision
di: Pîrvu, Mihai-Cristian, et al.
Pubblicazione: (2025)
di: Pîrvu, Mihai-Cristian, et al.
Pubblicazione: (2025)
Radar DataTree: A FAIR and Cloud-Native Framework for Scalable Weather Radar Archives
di: Ladino-Rincon, Alfonso, et al.
Pubblicazione: (2025)
di: Ladino-Rincon, Alfonso, et al.
Pubblicazione: (2025)
Optimization-based Proof of Useful Work: Framework, Modeling, and Security Analysis
di: Cao, Weihang, et al.
Pubblicazione: (2024)
di: Cao, Weihang, et al.
Pubblicazione: (2024)
Cronus: Efficient LLM inference on Heterogeneous GPU Clusters via Partially Disaggregated Prefill
di: Liu, Yunzhao, et al.
Pubblicazione: (2025)
di: Liu, Yunzhao, et al.
Pubblicazione: (2025)
inference-fleet-sim: A Queueing-Theory-Grounded Fleet Capacity Planner for LLM Inference
di: Chen, Huamin, et al.
Pubblicazione: (2026)
di: Chen, Huamin, et al.
Pubblicazione: (2026)
CoCoDiff: Optimizing Collective Communications for Distributed Diffusion Transformer Inference Under Ulysses Sequence Parallelism
di: Ma, Bin, et al.
Pubblicazione: (2026)
di: Ma, Bin, et al.
Pubblicazione: (2026)
Leveraging knowledge-as-a-service (KaaS) for QoS-aware resource management in multi-user video transcoding
di: Costero, Luis, et al.
Pubblicazione: (2024)
di: Costero, Luis, et al.
Pubblicazione: (2024)
Analysis and Optimization of Wireless Multimodal Federated Learning on Modal Heterogeneity
di: Han, Xuefeng, et al.
Pubblicazione: (2025)
di: Han, Xuefeng, et al.
Pubblicazione: (2025)
An MLIR pipeline for offloading Fortran to FPGAs via OpenMP
di: Rodriguez-Canal, Gabriel, et al.
Pubblicazione: (2025)
di: Rodriguez-Canal, Gabriel, et al.
Pubblicazione: (2025)
Propius: A Platform for Collaborative Machine Learning across the Edge and the Cloud
di: Ding, Eric
Pubblicazione: (2025)
di: Ding, Eric
Pubblicazione: (2025)
Unleashing Efficient Asynchronous RL Post-Training via Staleness-Constrained Rollout Coordination
di: Li, Haoyang, et al.
Pubblicazione: (2026)
di: Li, Haoyang, et al.
Pubblicazione: (2026)
Lower Bounds for $k$-Set Agreement in Fault-Prone Networks
di: Fraigniaud, Pierre, et al.
Pubblicazione: (2025)
di: Fraigniaud, Pierre, et al.
Pubblicazione: (2025)
Enhancing reliability in AI inference services: An empirical study on real production incidents
di: Ranganathan, Bhala, et al.
Pubblicazione: (2025)
di: Ranganathan, Bhala, et al.
Pubblicazione: (2025)
Prioritized-MVBA: A New Approach to Design an Optimal Asynchronous Byzantine Agreement Protocol
di: Sony, Nasit S, et al.
Pubblicazione: (2024)
di: Sony, Nasit S, et al.
Pubblicazione: (2024)
Scalable Distributed Vector Search via Accuracy Preserving Index Construction
di: Xu, Yuming, et al.
Pubblicazione: (2025)
di: Xu, Yuming, et al.
Pubblicazione: (2025)
COHORT: Hybrid RL for Collaborative Large DNN Inference on Multi-Robot Systems Under Real-Time Constraints
di: Anwar, Mohammad Saeid, et al.
Pubblicazione: (2026)
di: Anwar, Mohammad Saeid, et al.
Pubblicazione: (2026)
Stream-K Optimization and Exploration
di: Rackley, Nick, et al.
Pubblicazione: (2024)
di: Rackley, Nick, et al.
Pubblicazione: (2024)
Optimization of Hybrid Quantum-Classical Algorithms
di: Remme, Lian, et al.
Pubblicazione: (2025)
di: Remme, Lian, et al.
Pubblicazione: (2025)
Datacenter Energy Optimized Power Profiles
di: Narayanaswamy, Sreedhar, et al.
Pubblicazione: (2025)
di: Narayanaswamy, Sreedhar, et al.
Pubblicazione: (2025)
Optimizing sDTW for AMD GPUs
di: Latta-Lin, Daniel, et al.
Pubblicazione: (2024)
di: Latta-Lin, Daniel, et al.
Pubblicazione: (2024)
Research on the efficiency of data loading and storage in Data Lakehouse architectures for the formation of analytical data systems
di: Borodii, Ivan, et al.
Pubblicazione: (2026)
di: Borodii, Ivan, et al.
Pubblicazione: (2026)
Privacy in Federated Learning with Spiking Neural Networks
di: Aksu, Dogukan, et al.
Pubblicazione: (2025)
di: Aksu, Dogukan, et al.
Pubblicazione: (2025)
Lotus: Optimizing Disaggregated Transactions with Disaggregated Locks
di: Hu, Zhisheng, et al.
Pubblicazione: (2025)
di: Hu, Zhisheng, et al.
Pubblicazione: (2025)
Parallelized Multi-Agent Bayesian Optimization in Lava
di: Snyder, Shay, et al.
Pubblicazione: (2024)
di: Snyder, Shay, et al.
Pubblicazione: (2024)
Optimizing Bloom Filters for Modern GPU Architectures
di: Jünger, Daniel, et al.
Pubblicazione: (2025)
di: Jünger, Daniel, et al.
Pubblicazione: (2025)
Byzantine Fault-Tolerant Min-Max Optimization
di: Liu, Shuo, et al.
Pubblicazione: (2022)
di: Liu, Shuo, et al.
Pubblicazione: (2022)
Approximate Byzantine Fault-Tolerance in Distributed Optimization
di: Liu, Shuo, et al.
Pubblicazione: (2021)
di: Liu, Shuo, et al.
Pubblicazione: (2021)
Distributed Inference Performance Optimization for LLMs on CPUs
di: He, Pujiang, et al.
Pubblicazione: (2024)
di: He, Pujiang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference
di: Li, Xiangchen, et al.
Pubblicazione: (2025) -
Sponge: Inference Serving with Dynamic SLOs Using In-Place Vertical Scaling
di: Razavi, Kamran, et al.
Pubblicazione: (2024) -
TOD: Transprecise Object Detection to Maximise Real-Time Accuracy on the Edge
di: Lee, JunKyu, et al.
Pubblicazione: (2021) -
On Optimizing Locality of Graph Transposition on Modern Architectures
di: Esfahani, Mohsen Koohi, et al.
Pubblicazione: (2025) -
An approach to provide serverless scientific pipelines within the context of SKA
di: Ríos-Monje, Carlos, et al.
Pubblicazione: (2023)