Justin: Hybrid CPU/Memory Elastic Scaling for Distributed Stream Processing
Fuente:
arXiv
Guardado en:
| Autores principales: | Schmitz, Donatien, Rosinosky, Guillaume, Rivière, Etienne |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
COoL-TEE: Client-TEE Collaboration for Resilient Distributed Search
por: Bettinger, Matthieu, et al.
Publicado: (2025)
por: Bettinger, Matthieu, et al.
Publicado: (2025)
Breaking the Memory Wall: A Study of I/O Patterns and GPU Memory Utilization for Hybrid CPU-GPU Offloaded Optimizers
por: Maurya, Avinash, et al.
Publicado: (2024)
por: Maurya, Avinash, et al.
Publicado: (2024)
Benchmarking of CPU-intensive Stream Data Processing in The Edge Computing Systems
por: Szydlo, Tomasz, et al.
Publicado: (2025)
por: Szydlo, Tomasz, et al.
Publicado: (2025)
Efficient Graph Embedding at Scale: Optimizing CPU-GPU-SSD Integration
por: Li, Zhonggen, et al.
Publicado: (2025)
por: Li, Zhonggen, et al.
Publicado: (2025)
Dissecting the software-based measurement of CPU energy consumption: a comparative analysis
por: Raffin, Guillaume, et al.
Publicado: (2024)
por: Raffin, Guillaume, et al.
Publicado: (2024)
Efficient CPU-GPU Collaborative Inference for MoE-based LLMs on Memory-Limited Systems
por: Huang, En-Ming, et al.
Publicado: (2025)
por: Huang, En-Ming, et al.
Publicado: (2025)
Harnessing Integrated CPU-GPU System Memory for HPC: a first look into Grace Hopper
por: Schieffer, Gabin, et al.
Publicado: (2024)
por: Schieffer, Gabin, et al.
Publicado: (2024)
Serving Hybrid LLM Loads with SLO Guarantees Using CPU-GPU Attention Piggybacking
por: Mo, Zizhao, et al.
Publicado: (2026)
por: Mo, Zizhao, et al.
Publicado: (2026)
Pie: Pooling CPU Memory for LLM Inference
por: Xu, Yi, et al.
Publicado: (2024)
por: Xu, Yi, et al.
Publicado: (2024)
HybridGen: Efficient LLM Generative Inference via CPU-GPU Hybrid Computing
por: Lin, Mao, et al.
Publicado: (2026)
por: Lin, Mao, et al.
Publicado: (2026)
Towards CXL Resilience to CPU Failures
por: Psistakis, Antonis, et al.
Publicado: (2026)
por: Psistakis, Antonis, et al.
Publicado: (2026)
Daedalus: Self-Adaptive Horizontal Autoscaling for Resource Efficiency of Distributed Stream Processing Systems
por: Pfister, Benjamin J. J., et al.
Publicado: (2024)
por: Pfister, Benjamin J. J., et al.
Publicado: (2024)
Elastic Data Transfer Optimization with Hybrid Reinforcement Learning
por: Swargo, Rasman Mubtasim, et al.
Publicado: (2025)
por: Swargo, Rasman Mubtasim, et al.
Publicado: (2025)
StatuScale: Status-aware and Elastic Scaling Strategy for Microservice Applications
por: Wen, Linfeng, et al.
Publicado: (2024)
por: Wen, Linfeng, et al.
Publicado: (2024)
Demeter: Resource-Efficient Distributed Stream Processing under Dynamic Loads with Multi-Configuration Optimization
por: Geldenhuys, Morgan, et al.
Publicado: (2024)
por: Geldenhuys, Morgan, et al.
Publicado: (2024)
eLLM: Elastic Memory Management Framework for Efficient LLM Serving
por: Xu, Jiale, et al.
Publicado: (2025)
por: Xu, Jiale, et al.
Publicado: (2025)
Dissecting CPU-GPU Unified Physical Memory on AMD MI300A APUs
por: Wahlgren, Jacob, et al.
Publicado: (2025)
por: Wahlgren, Jacob, et al.
Publicado: (2025)
WindVE: Collaborative CPU-NPU Vector Embedding
por: Huang, Jinqi, et al.
Publicado: (2025)
por: Huang, Jinqi, et al.
Publicado: (2025)
Combining GPU and CPU for accelerating evolutionary computing workloads
por: Eynaliyev, Rustam, et al.
Publicado: (2025)
por: Eynaliyev, Rustam, et al.
Publicado: (2025)
A Unified CPU-GPU Protocol for GNN Training
por: Lin, Yi-Chien, et al.
Publicado: (2024)
por: Lin, Yi-Chien, et al.
Publicado: (2024)
MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool
por: Hu, Cunchen, et al.
Publicado: (2024)
por: Hu, Cunchen, et al.
Publicado: (2024)
Scaling Large-scale GNN Training to Thousands of Processors on CPU-based Supercomputers
por: Zhuang, Chen, et al.
Publicado: (2024)
por: Zhuang, Chen, et al.
Publicado: (2024)
ElasWave: An Elastic-Native System for Scalable Hybrid-Parallel Training
por: Kang, Xueze, et al.
Publicado: (2025)
por: Kang, Xueze, et al.
Publicado: (2025)
TURNIP: A "Nondeterministic" GPU Runtime with CPU RAM Offload
por: Ding, Zhimin, et al.
Publicado: (2024)
por: Ding, Zhimin, et al.
Publicado: (2024)
PDSP-Bench: A Benchmarking System for Parallel and Distributed Stream Processing
por: Agnihotri, Pratyush, et al.
Publicado: (2025)
por: Agnihotri, Pratyush, et al.
Publicado: (2025)
Efficient Column-Wise N:M Pruning on RISC-V CPU
por: Chu, Chi-Wei, et al.
Publicado: (2025)
por: Chu, Chi-Wei, et al.
Publicado: (2025)
A Unified Programming Model for Heterogeneous Computing with CPU and Accelerator Technologies
por: Xiong, Yuqing
Publicado: (2022)
por: Xiong, Yuqing
Publicado: (2022)
Collaborative Multi-Agent Reinforcement Learning Approach for Elastic Cloud Resource Scaling
por: Fang, Bruce, et al.
Publicado: (2025)
por: Fang, Bruce, et al.
Publicado: (2025)
ElasticMoE: An Efficient Auto Scaling Method for Mixture-of-Experts Models
por: Singh, Gursimran, et al.
Publicado: (2025)
por: Singh, Gursimran, et al.
Publicado: (2025)
Towards Affordable, Adaptive and Automatic GNN Training on CPU-GPU Heterogeneous Platforms
por: Qiao, Tong, et al.
Publicado: (2025)
por: Qiao, Tong, et al.
Publicado: (2025)
MMStencil: Optimizing High-order Stencils on Multicore CPU using Matrix Unit
por: Wang, Yinuo, et al.
Publicado: (2025)
por: Wang, Yinuo, et al.
Publicado: (2025)
Performance characterisation of the 64-core SG2042 RISC-V CPU for HPC
por: Brown, Nick, et al.
Publicado: (2024)
por: Brown, Nick, et al.
Publicado: (2024)
Taming GPU Underutilization via Static Partitioning and Fine-grained CPU Offloading
por: Schieffer, Gabin, et al.
Publicado: (2026)
por: Schieffer, Gabin, et al.
Publicado: (2026)
A Study of Performance Programming of CPU, GPU accelerated Computers and SIMD Architecture
por: Yi, Xinyao
Publicado: (2024)
por: Yi, Xinyao
Publicado: (2024)
Dual-pronged deep learning preprocessing on heterogeneous platforms with CPU, Accelerator and CSD
por: Wei, Jia, et al.
Publicado: (2024)
por: Wei, Jia, et al.
Publicado: (2024)
madupite: A High-Performance Distributed Solver for Large-Scale Markov Decision Processes
por: Gargiani, Matilde, et al.
Publicado: (2025)
por: Gargiani, Matilde, et al.
Publicado: (2025)
Towards Fine-Grained Scalability for Stateful Stream Processing Systems
por: Qing, Yunfan, et al.
Publicado: (2025)
por: Qing, Yunfan, et al.
Publicado: (2025)
StreamRL: Scalable, Heterogeneous, and Elastic RL for LLMs with Disaggregated Stream Generation
por: Zhong, Yinmin, et al.
Publicado: (2025)
por: Zhong, Yinmin, et al.
Publicado: (2025)
ShuffleBench: A Benchmark for Large-Scale Data Shuffling Operations with Distributed Stream Processing Frameworks
por: Henning, Sören, et al.
Publicado: (2024)
por: Henning, Sören, et al.
Publicado: (2024)
APEX: Asynchronous Parallel CPU-GPU Execution for Online LLM Inference on Constrained GPUs
por: Fan, Jiakun, et al.
Publicado: (2025)
por: Fan, Jiakun, et al.
Publicado: (2025)
Ejemplares similares
-
COoL-TEE: Client-TEE Collaboration for Resilient Distributed Search
por: Bettinger, Matthieu, et al.
Publicado: (2025) -
Breaking the Memory Wall: A Study of I/O Patterns and GPU Memory Utilization for Hybrid CPU-GPU Offloaded Optimizers
por: Maurya, Avinash, et al.
Publicado: (2024) -
Benchmarking of CPU-intensive Stream Data Processing in The Edge Computing Systems
por: Szydlo, Tomasz, et al.
Publicado: (2025) -
Efficient Graph Embedding at Scale: Optimizing CPU-GPU-SSD Integration
por: Li, Zhonggen, et al.
Publicado: (2025) -
Dissecting the software-based measurement of CPU energy consumption: a comparative analysis
por: Raffin, Guillaume, et al.
Publicado: (2024)