HeteroPod: XPU-Accelerated Infrastructure Offloading for Commodity Cloud-Native Applications
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Bicheng, He, Jingkai, Du, Dong, Xia, Yubin, Chen, Haibo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Holistic Heterogeneous Scheduling for Autonomous Applications using Fine-grained, Multi-XPU Abstraction
par: Han, Mingcong, et autres
Publié: (2025)
par: Han, Mingcong, et autres
Publié: (2025)
DeltaBox: Scaling Stateful AI Agents with Millisecond-Level Sandbox Checkpoint/Rollback
par: Dong, Yunpeng, et autres
Publié: (2026)
par: Dong, Yunpeng, et autres
Publié: (2026)
Sharpen the Spec, Cut the Code: A Case for Generative File System with SYSSPEC
par: Liu, Qingyuan, et autres
Publié: (2025)
par: Liu, Qingyuan, et autres
Publié: (2025)
CXLAimPod: CXL Memory is all you need in AI era
par: Yang, Yiwei, et autres
Publié: (2025)
par: Yang, Yiwei, et autres
Publié: (2025)
Idleness is Relative: Exploiting Tool-Call Idle Windows for Offloading in Agentic Systems with MORI
par: Xia, Tian, et autres
Publié: (2026)
par: Xia, Tian, et autres
Publié: (2026)
Optimizing Tree-structure Indexes for CXL-based Heterogeneous Memory with SINLK
par: Zhao, Haoru, et autres
Publié: (2025)
par: Zhao, Haoru, et autres
Publié: (2025)
Wave: Offloading Resource Management to SmartNIC Cores
par: Humphries, Jack Tigar, et autres
Publié: (2024)
par: Humphries, Jack Tigar, et autres
Publié: (2024)
TUNA: Tuning Unstable and Noisy Cloud Applications
par: Freischuetz, Johannes, et autres
Publié: (2025)
par: Freischuetz, Johannes, et autres
Publié: (2025)
Guidelines for Building Indexes on Partially Cache-Coherent CXL Shared Memory
par: Wu, Fangnuo, et autres
Publié: (2025)
par: Wu, Fangnuo, et autres
Publié: (2025)
"Range as a Key" is the Key! Fast and Compact Cloud Block Store Index with RASK
par: Zhao, Haoru, et autres
Publié: (2026)
par: Zhao, Haoru, et autres
Publié: (2026)
CRISP: Confidentiality, Rollback, and Integrity Storage Protection for Confidential Cloud-Native Computing
par: Hartono, Ardhi Putra Pratama, et autres
Publié: (2024)
par: Hartono, Ardhi Putra Pratama, et autres
Publié: (2024)
Taiji: A DPU Memory Elasticity Solution for In-production Cloud Environments
par: Zheng, Hao, et autres
Publié: (2025)
par: Zheng, Hao, et autres
Publié: (2025)
Towards Fully-fledged GPU Multitasking via Proactive Memory Scheduling
par: Shen, Weihang, et autres
Publié: (2025)
par: Shen, Weihang, et autres
Publié: (2025)
Funky: Cloud-Native FPGA Virtualization and Orchestration
par: Koshiba, Atsushi, et autres
Publié: (2025)
par: Koshiba, Atsushi, et autres
Publié: (2025)
DFUSE: Strongly Consistent Write-Back Kernel Caching for Distributed Userspace File Systems
par: Li, Haoyu, et autres
Publié: (2025)
par: Li, Haoyu, et autres
Publié: (2025)
FlexInfer: Breaking Memory Constraint via Flexible and Efficient Offloading for On-Device LLM Inference
par: Du, Hongchao, et autres
Publié: (2025)
par: Du, Hongchao, et autres
Publié: (2025)
Unlocking True Elasticity for the Cloud-Native Era with Dandelion
par: Kuchler, Tom, et autres
Publié: (2025)
par: Kuchler, Tom, et autres
Publié: (2025)
Arcus: SLO Management for Accelerators in the Cloud with Traffic Shaping
par: Zhao, Jiechen, et autres
Publié: (2024)
par: Zhao, Jiechen, et autres
Publié: (2024)
CHRONOS: Compensating Hardware Related Overheads with Native Multi Timer Support for Real-Time Operating Systems
par: Heider, Kay, et autres
Publié: (2025)
par: Heider, Kay, et autres
Publié: (2025)
ParaCell: Paravirtualized Secure Containers with Lightweight Intra-Container Isolation and Intent-Driven Memory Management
par: Wu, Yiyang, et autres
Publié: (2026)
par: Wu, Yiyang, et autres
Publié: (2026)
EdgeWeaver: Accelerating IoT Application Development Across Edge-Cloud Continuum
par: Lertpongrujikorn, Pawissanutt, et autres
Publié: (2026)
par: Lertpongrujikorn, Pawissanutt, et autres
Publié: (2026)
Vmem: A Lightweight Hot-Upgradable Memory Management for In-production Cloud Environment
par: Zheng, Hao, et autres
Publié: (2025)
par: Zheng, Hao, et autres
Publié: (2025)
Characterizing Network Requirements for GPU API Remoting in AI Applications
par: Wang, Tianxia, et autres
Publié: (2024)
par: Wang, Tianxia, et autres
Publié: (2024)
Wasm-bpf: Streamlining eBPF Deployment in Cloud Environments with WebAssembly
par: Zheng, Yusheng, et autres
Publié: (2024)
par: Zheng, Yusheng, et autres
Publié: (2024)
Leveraging OS-Level Primitives for Robotic Action Management
par: Zheng, Wenxin, et autres
Publié: (2025)
par: Zheng, Wenxin, et autres
Publié: (2025)
FlexBSO: Flexible Block Storage Offload for Datacenters
par: Aschenbrenner, Vojtech, et autres
Publié: (2024)
par: Aschenbrenner, Vojtech, et autres
Publié: (2024)
FlexServe: A Fast and Secure LLM Serving System for Mobile Devices with Flexible Resource Isolation
par: Wu, Yinpeng, et autres
Publié: (2026)
par: Wu, Yinpeng, et autres
Publié: (2026)
Coach: Exploiting Temporal Patterns for All-Resource Oversubscription in Cloud Platforms
par: Reidys, Benjamin, et autres
Publié: (2025)
par: Reidys, Benjamin, et autres
Publié: (2025)
PowerInfer: Fast Large Language Model Serving with a Consumer-grade GPU
par: Song, Yixin, et autres
Publié: (2023)
par: Song, Yixin, et autres
Publié: (2023)
Using SBPF to Accelerate Kernel Memory Access From Userspace
par: Kong, Boming, et autres
Publié: (2025)
par: Kong, Boming, et autres
Publié: (2025)
Rethinking Inter-Process Communication with Memory Operation Offloading
par: Park, Misun, et autres
Publié: (2026)
par: Park, Misun, et autres
Publié: (2026)
Securing Cloud File Systems with Trusted Execution
par: Burke, Quinn, et autres
Publié: (2023)
par: Burke, Quinn, et autres
Publié: (2023)
Joyride: Rethinking Linux's network stack design for better performance, security, and reliability
par: Du, Yanlin, et autres
Publié: (2025)
par: Du, Yanlin, et autres
Publié: (2025)
SVFF: An Automated Framework for SR-IOV Virtual Function Management in FPGA Accelerated Virtualized Environments
par: Cirici, Stefano, et autres
Publié: (2024)
par: Cirici, Stefano, et autres
Publié: (2024)
Performance Isolation and Semantic Determinism in Efficient GPU Spatial Sharing
par: Yang, Zhenyuan, et autres
Publié: (2026)
par: Yang, Zhenyuan, et autres
Publié: (2026)
Object as a Service: Simplifying Cloud-Native Development through Serverless Object Abstraction
par: Lertpongrujikorn, Pawissanutt, et autres
Publié: (2024)
par: Lertpongrujikorn, Pawissanutt, et autres
Publié: (2024)
Nexus: Transparent I/O Offloading for High-Density Serverless Computing
par: Park, JooYoung, et autres
Publié: (2026)
par: Park, JooYoung, et autres
Publié: (2026)
Exploiting Application-to-Architecture Dependencies for Designing Scalable OS
par: Xiao, Yao, et autres
Publié: (2025)
par: Xiao, Yao, et autres
Publié: (2025)
Hybrid Adaptive Tuning for Tiered Memory Systems
par: Wang, Xi, et autres
Publié: (2026)
par: Wang, Xi, et autres
Publié: (2026)
Plug. Play. Persist. Inside a Ready-to-Go Havoc C2 Infrastructure
par: Di Santo, Alessio
Publié: (2025)
par: Di Santo, Alessio
Publié: (2025)
Documents similaires
-
Holistic Heterogeneous Scheduling for Autonomous Applications using Fine-grained, Multi-XPU Abstraction
par: Han, Mingcong, et autres
Publié: (2025) -
DeltaBox: Scaling Stateful AI Agents with Millisecond-Level Sandbox Checkpoint/Rollback
par: Dong, Yunpeng, et autres
Publié: (2026) -
Sharpen the Spec, Cut the Code: A Case for Generative File System with SYSSPEC
par: Liu, Qingyuan, et autres
Publié: (2025) -
CXLAimPod: CXL Memory is all you need in AI era
par: Yang, Yiwei, et autres
Publié: (2025) -
Idleness is Relative: Exploiting Tool-Call Idle Windows for Offloading in Agentic Systems with MORI
par: Xia, Tian, et autres
Publié: (2026)