Percepta: High Performance Stream Processing at the Edge
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sousa, Clarisse, Fonseca, Tiago, Ferreira, Luis Lino, Venâncio, Ricardo, Severino, Ricardo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Benchmarking of CPU-intensive Stream Data Processing in The Edge Computing Systems
par: Szydlo, Tomasz, et autres
Publié: (2025)
par: Szydlo, Tomasz, et autres
Publié: (2025)
StreamWise: Serving Multi-Modal Generation in Real-Time at Scale
par: Qiu, Haoran, et autres
Publié: (2026)
par: Qiu, Haoran, et autres
Publié: (2026)
Hardware Utilization and Inference Performance of Edge Object Detection Under Fault Injection
par: Pasandideh, Faezeh, et autres
Publié: (2026)
par: Pasandideh, Faezeh, et autres
Publié: (2026)
On the Impact of White-box Deployment Strategies for Edge AI on Latency and Model Performance
par: Singh, Jaskirat, et autres
Publié: (2024)
par: Singh, Jaskirat, et autres
Publié: (2024)
Multi-Dimensional Autoscaling of Stream Processing Services on Edge Devices
par: Sedlak, Boris, et autres
Publié: (2025)
par: Sedlak, Boris, et autres
Publié: (2025)
Towards Resource-Efficient Compound AI Systems
par: Chaudhry, Gohar Irfan, et autres
Publié: (2025)
par: Chaudhry, Gohar Irfan, et autres
Publié: (2025)
Benchmarking Federated Learning in Edge Computing Environments: A Systematic Review and Performance Evaluation
par: Aribe Jr., Sales, et autres
Publié: (2026)
par: Aribe Jr., Sales, et autres
Publié: (2026)
TAPAS: Thermal- and Power-Aware Scheduling for LLM Inference in Cloud Platforms
par: Stojkovic, Jovan, et autres
Publié: (2025)
par: Stojkovic, Jovan, et autres
Publié: (2025)
LLM & HPC:Benchmarking DeepSeek's Performance in High-Performance Computing Tasks
par: Nader, Noujoud, et autres
Publié: (2025)
par: Nader, Noujoud, et autres
Publié: (2025)
From Edge to HPC: Investigating Cross-Facility Data Streaming Architectures
par: George, Anjus, et autres
Publié: (2025)
par: George, Anjus, et autres
Publié: (2025)
What Artificial Intelligence can do for High-Performance Computing systems?
par: Pochelu, Pierrick, et autres
Publié: (2026)
par: Pochelu, Pierrick, et autres
Publié: (2026)
AgileLog: A Forkable Shared Log for Agents on Data Streams
par: Bhat, Shreesha G., et autres
Publié: (2026)
par: Bhat, Shreesha G., et autres
Publié: (2026)
Quality Scalable Quantization Methodology for Deep Learning on Edge
par: Khaliq, Salman Abdul, et autres
Publié: (2024)
par: Khaliq, Salman Abdul, et autres
Publié: (2024)
StreamServe: Adaptive Speculative Flows for Low-Latency Disaggregated LLM Serving
par: Kumar, Satyam, et autres
Publié: (2026)
par: Kumar, Satyam, et autres
Publié: (2026)
The DMA Streaming Framework: Kernel-Level Buffer Orchestration for High-Performance AI Data Paths
par: Graziano, Marco
Publié: (2026)
par: Graziano, Marco
Publié: (2026)
KVComp: A High-Performance, LLM-Aware, Lossy Compression Framework for KV Cache
par: Jiang, Bo, et autres
Publié: (2025)
par: Jiang, Bo, et autres
Publié: (2025)
DWDP: Distributed Weight Data Parallelism for High-Performance LLM Inference on NVL72
par: Li, Wanqian, et autres
Publié: (2026)
par: Li, Wanqian, et autres
Publié: (2026)
High-Dimensional Data Processing: Benchmarking Machine Learning and Deep Learning Architectures in Local and Distributed Environments
par: Rodriguez, Julian, et autres
Publié: (2025)
par: Rodriguez, Julian, et autres
Publié: (2025)
Large Language Model Partitioning for Low-Latency Inference at the Edge
par: Kafetzis, Dimitrios, et autres
Publié: (2025)
par: Kafetzis, Dimitrios, et autres
Publié: (2025)
High-Performance Parallel Optimization of the Fish School Behaviour on the Setonix Platform Using OpenMP
par: Wang, Haitian, et autres
Publié: (2025)
par: Wang, Haitian, et autres
Publié: (2025)
Delay-Aware Multi-Stage Edge Server Upgrade with Budget Constraint
par: Wihidayat, Endar Suprih, et autres
Publié: (2025)
par: Wihidayat, Endar Suprih, et autres
Publié: (2025)
Adaptive AI-based Decentralized Resource Management in the Cloud-Edge Continuum
par: Li, Lanpei, et autres
Publié: (2025)
par: Li, Lanpei, et autres
Publié: (2025)
Dora: QoE-Aware Hybrid Parallelism for Distributed Edge AI
par: Jin, Jianli, et autres
Publié: (2025)
par: Jin, Jianli, et autres
Publié: (2025)
Profiling-Driven Adaptive Distributed Transformer Inference on Embedded Edge Deployment
par: Qazi, Muhammad Azlan, et autres
Publié: (2026)
par: Qazi, Muhammad Azlan, et autres
Publié: (2026)
HPCTransCompile: An AI Compiler Generated Dataset for High-Performance CUDA Transpilation and LLM Preliminary Exploration
par: Lv, Jiaqi, et autres
Publié: (2025)
par: Lv, Jiaqi, et autres
Publié: (2025)
DGRAG: Distributed Graph-based Retrieval-Augmented Generation in Edge-Cloud Systems
par: Zhou, Wenqing, et autres
Publié: (2025)
par: Zhou, Wenqing, et autres
Publié: (2025)
A Model Aware AIGC Task Offloading Algorithm in IIoT Edge Computing
par: Wang, Xin, et autres
Publié: (2025)
par: Wang, Xin, et autres
Publié: (2025)
ECCENTRIC: Edge-Cloud Collaboration Framework for Distributed Inference Using Knowledge Adaptation
par: Kamani, Mohammad Mahdi, et autres
Publié: (2025)
par: Kamani, Mohammad Mahdi, et autres
Publié: (2025)
SparOA: Sparse and Operator-aware Hybrid Scheduling for Edge DNN Inference
par: Zhang, Ziyang, et autres
Publié: (2025)
par: Zhang, Ziyang, et autres
Publié: (2025)
Reinforcement Learning-driven Data-intensive Workflow Scheduling for Volunteer Edge-Cloud
par: Mounesan, Motahare, et autres
Publié: (2024)
par: Mounesan, Motahare, et autres
Publié: (2024)
Failure-Resilient Distributed Inference with Model Compression over Heterogeneous Edge Devices
par: Wang, Li, et autres
Publié: (2024)
par: Wang, Li, et autres
Publié: (2024)
CoRaiS: Lightweight Real-Time Scheduler for Multi-Edge Cooperative Computing
par: Hu, Yujiao, et autres
Publié: (2024)
par: Hu, Yujiao, et autres
Publié: (2024)
Decentralized Distributed Proximal Policy Optimization (DD-PPO) for High Performance Computing Scheduling on Multi-User Systems
par: Sgambati, Matthew, et autres
Publié: (2025)
par: Sgambati, Matthew, et autres
Publié: (2025)
Research on the Application of Spark Streaming Real-Time Data Analysis System and large language model Intelligent Agents
par: Wang, Jialin, et autres
Publié: (2024)
par: Wang, Jialin, et autres
Publié: (2024)
Accelerated Digital Twin Learning for Edge AI: A Comparison of FPGA and Mobile GPU
par: Xu, Bin, et autres
Publié: (2025)
par: Xu, Bin, et autres
Publié: (2025)
Venus: An Efficient Edge Memory-and-Retrieval System for VLM-based Online Video Understanding
par: Ye, Shengyuan, et autres
Publié: (2025)
par: Ye, Shengyuan, et autres
Publié: (2025)
Quantifying Energy and Cost Benefits of Hybrid Edge Cloud: Analysis of Traditional and Agentic Workloads
par: Alamouti, Siavash
Publié: (2025)
par: Alamouti, Siavash
Publié: (2025)
TS-EoH: An Edge Server Task Scheduling Algorithm Based on Evolution of Heuristic
par: Yatong, Wang, et autres
Publié: (2024)
par: Yatong, Wang, et autres
Publié: (2024)
A Scheduling Framework for Efficient MoE Inference on Edge GPU-NDP Systems
par: Wu, Qi, et autres
Publié: (2026)
par: Wu, Qi, et autres
Publié: (2026)
Distributed Inference on Mobile Edge and Cloud: A Data-Cartography based Clustering Approach
par: Bajpai, Divya Jyoti, et autres
Publié: (2024)
par: Bajpai, Divya Jyoti, et autres
Publié: (2024)
Documents similaires
-
Benchmarking of CPU-intensive Stream Data Processing in The Edge Computing Systems
par: Szydlo, Tomasz, et autres
Publié: (2025) -
StreamWise: Serving Multi-Modal Generation in Real-Time at Scale
par: Qiu, Haoran, et autres
Publié: (2026) -
Hardware Utilization and Inference Performance of Edge Object Detection Under Fault Injection
par: Pasandideh, Faezeh, et autres
Publié: (2026) -
On the Impact of White-box Deployment Strategies for Edge AI on Latency and Model Performance
par: Singh, Jaskirat, et autres
Publié: (2024) -
Multi-Dimensional Autoscaling of Stream Processing Services on Edge Devices
par: Sedlak, Boris, et autres
Publié: (2025)