CRIUgpu: Transparent Checkpointing of GPU-Accelerated Workloads
Fuente:
arXiv
Salvato in:
| Autori principali: | Stoyanov, Radostin, Spišaková, Viktória, Ramos, Jesus, Gurfinkel, Steven, Vagin, Andrei, Reber, Adrian, Armour, Wesley, Bruno, Rodrigo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Part-time Power Measurements: nvidia-smi's Lack of Attention
di: Yang, Zeyu, et al.
Pubblicazione: (2023)
di: Yang, Zeyu, et al.
Pubblicazione: (2023)
MERBIT: A GPU-Based SpMV Method for Iterative Workloads
di: Zhang, Qi, et al.
Pubblicazione: (2026)
di: Zhang, Qi, et al.
Pubblicazione: (2026)
Characterizing Production GPU Workloads using System-wide Telemetry Data
di: Cankur, Onur, et al.
Pubblicazione: (2025)
di: Cankur, Onur, et al.
Pubblicazione: (2025)
Accelerating Compound LLM Training Workloads with Maestro
di: Yuan, Xiulong, et al.
Pubblicazione: (2026)
di: Yuan, Xiulong, et al.
Pubblicazione: (2026)
PAL: A Variability-Aware Policy for Scheduling ML Workloads in GPU Clusters
di: Jain, Rutwik, et al.
Pubblicazione: (2024)
di: Jain, Rutwik, et al.
Pubblicazione: (2024)
PRISM: Dynamic Primitive-Based Forecasting for Large-Scale GPU Cluster Workloads
di: Wu, Xin, et al.
Pubblicazione: (2026)
di: Wu, Xin, et al.
Pubblicazione: (2026)
Union: An Automatic Workload Manager for Accelerating Network Simulation
di: Wang, Xin, et al.
Pubblicazione: (2024)
di: Wang, Xin, et al.
Pubblicazione: (2024)
An Online Fragmentation-Aware Scheduler for Managing GPU-Sharing Workloads on Multi-Instance GPUs
di: Ting, Hsu-Tzu, et al.
Pubblicazione: (2025)
di: Ting, Hsu-Tzu, et al.
Pubblicazione: (2025)
Beyond Microservices: Testing Web-Scale RCA Methods on GPU-Driven LLM Workloads
di: Scheinert, Dominik, et al.
Pubblicazione: (2026)
di: Scheinert, Dominik, et al.
Pubblicazione: (2026)
Accelerating Biclique Counting on GPU
di: Qiu, Linshan, et al.
Pubblicazione: (2024)
di: Qiu, Linshan, et al.
Pubblicazione: (2024)
Hybrid Cloud Architectures for Research Computing: Applications and Use Cases
di: Stiensmeier, Xaver, et al.
Pubblicazione: (2026)
di: Stiensmeier, Xaver, et al.
Pubblicazione: (2026)
Accelerating Heterogeneous Tensor Parallelism via Flexible Workload Control
di: Wang, Zhigang, et al.
Pubblicazione: (2024)
di: Wang, Zhigang, et al.
Pubblicazione: (2024)
GPU Accelerated Sparse Cholesky Factorization
di: Karsavuran, M. Ozan, et al.
Pubblicazione: (2024)
di: Karsavuran, M. Ozan, et al.
Pubblicazione: (2024)
Pagoda: An Energy and Time Roofline Study for DNN Workloads on Edge Accelerators
di: K., Prashanthi S., et al.
Pubblicazione: (2025)
di: K., Prashanthi S., et al.
Pubblicazione: (2025)
OServe: Accelerating LLM Serving via Spatial-Temporal Workload Orchestration
di: Jiang, Youhe, et al.
Pubblicazione: (2026)
di: Jiang, Youhe, et al.
Pubblicazione: (2026)
FastTrack: GPU-Accelerated Tracking for Visual SLAM
di: Khabiri, Kimia, et al.
Pubblicazione: (2025)
di: Khabiri, Kimia, et al.
Pubblicazione: (2025)
GPU-Accelerated Batch-Dynamic Subgraph Matching
di: Qiu, Linshan, et al.
Pubblicazione: (2024)
di: Qiu, Linshan, et al.
Pubblicazione: (2024)
Minos: Systematically Classifying Performance and Power Characteristics of GPU Workloads on HPC Clusters
di: Jain, Rutwik, et al.
Pubblicazione: (2026)
di: Jain, Rutwik, et al.
Pubblicazione: (2026)
Accelerating Intra-Node GPU-to-GPU Communication Through Multi-Path Transfers with CUDA Graphs
di: Sojoodi, Amirhossein, et al.
Pubblicazione: (2026)
di: Sojoodi, Amirhossein, et al.
Pubblicazione: (2026)
Accelerating Sparse MTTKRP for Small Tensor Decomposition on GPU
di: Wijeratne, Sasindu, et al.
Pubblicazione: (2025)
di: Wijeratne, Sasindu, et al.
Pubblicazione: (2025)
PICO: Accelerating All k-Core Paradigms on GPU
di: Zhao, Chen, et al.
Pubblicazione: (2024)
di: Zhao, Chen, et al.
Pubblicazione: (2024)
GPZ: GPU-Accelerated Lossy Compressor for Particle Data
di: Li, Ruoyu, et al.
Pubblicazione: (2025)
di: Li, Ruoyu, et al.
Pubblicazione: (2025)
Efficient Accelerated Graph Edit Distance Computation on GPU
di: Dabah, Adel, et al.
Pubblicazione: (2026)
di: Dabah, Adel, et al.
Pubblicazione: (2026)
A Preliminary Study on Accelerating Simulation Optimization with GPU Implementation
di: He, Jinghai, et al.
Pubblicazione: (2024)
di: He, Jinghai, et al.
Pubblicazione: (2024)
GPU-Accelerated Distributed QAOA on Large-scale HPC Ecosystems
di: Xu, Zhihao, et al.
Pubblicazione: (2025)
di: Xu, Zhihao, et al.
Pubblicazione: (2025)
PilotANN: Memory-Bounded GPU Acceleration for Vector Search
di: Gui, Yuntao, et al.
Pubblicazione: (2025)
di: Gui, Yuntao, et al.
Pubblicazione: (2025)
A Practical GPU-Accelerated Implementation of Orthogonal Matching Pursuit
di: Lubonja, Ariel, et al.
Pubblicazione: (2024)
di: Lubonja, Ariel, et al.
Pubblicazione: (2024)
GPU Acceleration for Faster Evolutionary Spatial Cyclic Game Systems
di: Sinadjan, Louie
Pubblicazione: (2025)
di: Sinadjan, Louie
Pubblicazione: (2025)
Accelerating Drug Discovery in AutoDock-GPU with Tensor Cores
di: Schieffer, Gabin, et al.
Pubblicazione: (2024)
di: Schieffer, Gabin, et al.
Pubblicazione: (2024)
SOLANET: Distributed Neighbor Graph Construction on GPU-Accelerated Systems
di: Iwabuchi, Keita, et al.
Pubblicazione: (2026)
di: Iwabuchi, Keita, et al.
Pubblicazione: (2026)
GMLake: Efficient and Transparent GPU Memory Defragmentation for Large-scale DNN Training with Virtual Memory Stitching
di: Guo, Cong, et al.
Pubblicazione: (2024)
di: Guo, Cong, et al.
Pubblicazione: (2024)
Dataflow-Oriented Classification and Performance Analysis of GPU-Accelerated Homomorphic Encryption
di: Nozaki, Ai, et al.
Pubblicazione: (2026)
di: Nozaki, Ai, et al.
Pubblicazione: (2026)
A GPU Accelerated Temporal Window-Based Random Walk Sampler
di: Salehin, Md Ashfaq, et al.
Pubblicazione: (2026)
di: Salehin, Md Ashfaq, et al.
Pubblicazione: (2026)
GPU-Accelerated Modified Bessel Function of the Second Kind for Gaussian Processes
di: Geng, Zipei, et al.
Pubblicazione: (2025)
di: Geng, Zipei, et al.
Pubblicazione: (2025)
GPU-Accelerated Selected Basis Diagonalization with Thrust for SQD-based Algorithms
di: Doi, Jun, et al.
Pubblicazione: (2026)
di: Doi, Jun, et al.
Pubblicazione: (2026)
gZCCL: Compression-Accelerated Collective Communication Framework for GPU Clusters
di: Huang, Jiajun, et al.
Pubblicazione: (2023)
di: Huang, Jiajun, et al.
Pubblicazione: (2023)
VDCores: Resource Decoupled Programming and Execution for Asynchronous GPU
di: He, Zijian, et al.
Pubblicazione: (2026)
di: He, Zijian, et al.
Pubblicazione: (2026)
PhoenixOS: Concurrent OS-level GPU Checkpoint and Restore with Validated Speculation
di: Wei, Xingda, et al.
Pubblicazione: (2024)
di: Wei, Xingda, et al.
Pubblicazione: (2024)
Distributed OpenMP Offloading of OpenMC on Intel GPU MAX Accelerators
di: Fridman, Yehonatan, et al.
Pubblicazione: (2024)
di: Fridman, Yehonatan, et al.
Pubblicazione: (2024)
AQUA: Network-Accelerated Memory Offloading for LLMs in Scale-Up GPU Domains
di: Kumar, Abhishek Vijaya, et al.
Pubblicazione: (2024)
di: Kumar, Abhishek Vijaya, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Part-time Power Measurements: nvidia-smi's Lack of Attention
di: Yang, Zeyu, et al.
Pubblicazione: (2023) -
MERBIT: A GPU-Based SpMV Method for Iterative Workloads
di: Zhang, Qi, et al.
Pubblicazione: (2026) -
Characterizing Production GPU Workloads using System-wide Telemetry Data
di: Cankur, Onur, et al.
Pubblicazione: (2025) -
Accelerating Compound LLM Training Workloads with Maestro
di: Yuan, Xiulong, et al.
Pubblicazione: (2026) -
PAL: A Variability-Aware Policy for Scheduling ML Workloads in GPU Clusters
di: Jain, Rutwik, et al.
Pubblicazione: (2024)