VersaSlot: Efficient Fine-grained FPGA Sharing with Big.Little Slots and Live Migration in FPGA Cluster
Fuente:
arXiv
Salvato in:
| Autori principali: | Gu, Jianfeng, Wang, Hao, Guo, Xiaorang, Schulz, Martin, Gerndt, Michael |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HAS-GPU: Efficient Hybrid Auto-scaling with Fine-grained GPU Allocation for SLO-aware Serverless Inferences
di: Gu, Jianfeng, et al.
Pubblicazione: (2025)
di: Gu, Jianfeng, et al.
Pubblicazione: (2025)
3-Slot-Finality Protocol for Ethereum
di: D'Amato, Francesco, et al.
Pubblicazione: (2024)
di: D'Amato, Francesco, et al.
Pubblicazione: (2024)
Apodotiko: Enabling Efficient Serverless Federated Learning in Heterogeneous Environments
di: Chadha, Mohak, et al.
Pubblicazione: (2024)
di: Chadha, Mohak, et al.
Pubblicazione: (2024)
Towards Single Slot Finality: Evaluating Consensus Mechanisms and Methods for Faster Ethereum Finality
di: Murr, Lincoln
Pubblicazione: (2024)
di: Murr, Lincoln
Pubblicazione: (2024)
A flexible FPGA accelerator for convolutional neural networks
di: Majumder, Kingshuk, et al.
Pubblicazione: (2019)
di: Majumder, Kingshuk, et al.
Pubblicazione: (2019)
LAAFD: LLM-based Agents for Accelerated FPGA Design
di: Moraru, Maxim, et al.
Pubblicazione: (2026)
di: Moraru, Maxim, et al.
Pubblicazione: (2026)
Fast Online Digital Twinning on FPGA for Mission Critical Applications
di: Xu, Bin, et al.
Pubblicazione: (2025)
di: Xu, Bin, et al.
Pubblicazione: (2025)
Accelerating Dynamic Image Graph Construction on FPGA for Vision GNNs
di: Ramachandran, Anvitha, et al.
Pubblicazione: (2025)
di: Ramachandran, Anvitha, et al.
Pubblicazione: (2025)
Arbitration-Free Consistency is Available (and Vice Versa)
di: Attiya, Hagit, et al.
Pubblicazione: (2025)
di: Attiya, Hagit, et al.
Pubblicazione: (2025)
Exact Nearest-Neighbor Search on Energy-Efficient FPGA Devices
di: Dazzi, Patrizio, et al.
Pubblicazione: (2025)
di: Dazzi, Patrizio, et al.
Pubblicazione: (2025)
SafarDB: FPGA-Accelerated Distributed Transactions via Replicated Data Types
di: Saberlatibari, Javad, et al.
Pubblicazione: (2026)
di: Saberlatibari, Javad, et al.
Pubblicazione: (2026)
Efficient Split Learning LSTM Models for FPGA-based Edge IoT Devices
di: Molina, Romina Soledad, et al.
Pubblicazione: (2025)
di: Molina, Romina Soledad, et al.
Pubblicazione: (2025)
Funky: Cloud-Native FPGA Virtualization and Orchestration
di: Koshiba, Atsushi, et al.
Pubblicazione: (2025)
di: Koshiba, Atsushi, et al.
Pubblicazione: (2025)
Hetis: Serving LLMs in Heterogeneous GPU Clusters with Fine-grained and Dynamic Parallelism
di: Mo, Zizhao, et al.
Pubblicazione: (2025)
di: Mo, Zizhao, et al.
Pubblicazione: (2025)
FPGA-based Distributed Union-Find Decoder for Surface Codes
di: Liyanage, Namitha, et al.
Pubblicazione: (2024)
di: Liyanage, Namitha, et al.
Pubblicazione: (2024)
FPGA Innovation Research in the Netherlands: Present Landscape and Future Outlook
di: Alachiotis, Nikolaos, et al.
Pubblicazione: (2025)
di: Alachiotis, Nikolaos, et al.
Pubblicazione: (2025)
Training Heterogeneous Client Models using Knowledge Distillation in Serverless Federated Learning
di: Chadha, Mohak, et al.
Pubblicazione: (2024)
di: Chadha, Mohak, et al.
Pubblicazione: (2024)
EPOCH: Enabling Preemption Operation for Context Saving in Heterogeneous FPGA Systems
di: Malik, Arsalan Ali, et al.
Pubblicazione: (2025)
di: Malik, Arsalan Ali, et al.
Pubblicazione: (2025)
Design of A Low-Latency and Parallelizable SVD Dataflow Architecture on FPGA
di: Du, Fangqiang, et al.
Pubblicazione: (2025)
di: Du, Fangqiang, et al.
Pubblicazione: (2025)
Seamless Transitions: A Comprehensive Review of Live Migration Technologies
di: Attar-Khorasani, Sima, et al.
Pubblicazione: (2025)
di: Attar-Khorasani, Sima, et al.
Pubblicazione: (2025)
Enabling Time-Aware Priority Traffic Management over Distributed FPGA Nodes
di: Scionti, Alberto, et al.
Pubblicazione: (2025)
di: Scionti, Alberto, et al.
Pubblicazione: (2025)
FLEX: Leveraging FPGA-CPU Synergy for Mixed-Cell-Height Legalization Acceleration
di: Liu, Xingyu, et al.
Pubblicazione: (2025)
di: Liu, Xingyu, et al.
Pubblicazione: (2025)
LiveR: Fine-Grained Elasticity via Live Reconfiguration for Model Training
di: Liu, Haoyuan, et al.
Pubblicazione: (2026)
di: Liu, Haoyuan, et al.
Pubblicazione: (2026)
HotSwap: Enabling Live Dependency Sharing in Serverless Computing
di: Li, Rui, et al.
Pubblicazione: (2024)
di: Li, Rui, et al.
Pubblicazione: (2024)
Simopt -- Simulation pass for Speculative Optimisation of FPGA-CAD flow
di: Wadhwa, Eashan, et al.
Pubblicazione: (2024)
di: Wadhwa, Eashan, et al.
Pubblicazione: (2024)
Accelerated Digital Twin Learning for Edge AI: A Comparison of FPGA and Mobile GPU
di: Xu, Bin, et al.
Pubblicazione: (2025)
di: Xu, Bin, et al.
Pubblicazione: (2025)
RapidOMS: FPGA-based Open Modification Spectral Library Searching with HD Computing
di: Pinge, Sumukh, et al.
Pubblicazione: (2024)
di: Pinge, Sumukh, et al.
Pubblicazione: (2024)
Efficient Edge AI: Deploying Convolutional Neural Networks on FPGA with the Gemmini Accelerator
di: Peccia, Federico Nicolas, et al.
Pubblicazione: (2024)
di: Peccia, Federico Nicolas, et al.
Pubblicazione: (2024)
gFaaS: Enabling Generic Functions in Serverless Computing
di: Chadha, Mohak, et al.
Pubblicazione: (2024)
di: Chadha, Mohak, et al.
Pubblicazione: (2024)
A Taxonomy of Schedulers -- Operating Systems, Clusters and Big Data Frameworks
di: Sliwko, Leszek
Pubblicazione: (2025)
di: Sliwko, Leszek
Pubblicazione: (2025)
TeraNoC: A Multi-Channel 32-bit Fine-Grained, Hybrid Mesh-Crossbar NoC for Efficient Scale-up of 1000+ Core Shared-L1-Memory Clusters
di: Zhang, Yichao, et al.
Pubblicazione: (2025)
di: Zhang, Yichao, et al.
Pubblicazione: (2025)
Context-aware Simopt-Power: Using structural data with simulation metadata to optimise FPGA designs
di: Wadhwa, Eashan, et al.
Pubblicazione: (2026)
di: Wadhwa, Eashan, et al.
Pubblicazione: (2026)
Fine-grained MoE Load Balancing with Linear Programming
di: Zhao, Chenqi, et al.
Pubblicazione: (2025)
di: Zhao, Chenqi, et al.
Pubblicazione: (2025)
Exploring Fine-grained Task Parallelism on Simultaneous Multithreading Cores
di: Los, Denis, et al.
Pubblicazione: (2024)
di: Los, Denis, et al.
Pubblicazione: (2024)
Communication-Efficient Sparsely-Activated Model Training via Sequence Migration and Token Condensation
di: Chen, Fahao, et al.
Pubblicazione: (2024)
di: Chen, Fahao, et al.
Pubblicazione: (2024)
Accelerating Transposed Convolutions on FPGA-based Edge Devices
di: Haris, Jude, et al.
Pubblicazione: (2025)
di: Haris, Jude, et al.
Pubblicazione: (2025)
Unlock the Potential of Fine-grained LLM Serving via Dynamic Module Scaling
di: Wu, Jingfeng, et al.
Pubblicazione: (2025)
di: Wu, Jingfeng, et al.
Pubblicazione: (2025)
Taming GPU Underutilization via Static Partitioning and Fine-grained CPU Offloading
di: Schieffer, Gabin, et al.
Pubblicazione: (2026)
di: Schieffer, Gabin, et al.
Pubblicazione: (2026)
Optimizing Long-context LLM Serving via Fine-grained Sequence Parallelism
di: Li, Cong, et al.
Pubblicazione: (2025)
di: Li, Cong, et al.
Pubblicazione: (2025)
MANOJAVAM: A Scalable, Unified FPGA Accelerator for Matrix Multiplication and Singular Value Decomposition in Principal Component Analysis
di: Ramasubramanian, Srivaths, et al.
Pubblicazione: (2026)
di: Ramasubramanian, Srivaths, et al.
Pubblicazione: (2026)
Documenti analoghi
-
HAS-GPU: Efficient Hybrid Auto-scaling with Fine-grained GPU Allocation for SLO-aware Serverless Inferences
di: Gu, Jianfeng, et al.
Pubblicazione: (2025) -
3-Slot-Finality Protocol for Ethereum
di: D'Amato, Francesco, et al.
Pubblicazione: (2024) -
Apodotiko: Enabling Efficient Serverless Federated Learning in Heterogeneous Environments
di: Chadha, Mohak, et al.
Pubblicazione: (2024) -
Towards Single Slot Finality: Evaluating Consensus Mechanisms and Methods for Faster Ethereum Finality
di: Murr, Lincoln
Pubblicazione: (2024) -
A flexible FPGA accelerator for convolutional neural networks
di: Majumder, Kingshuk, et al.
Pubblicazione: (2019)