SCENIC: Stream Computation-Enhanced SmartNIC
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ramhorst, Benjamin, Heer, Maximilian Jakob, Liu, Luhao, Kim, Heejae, Dann, Jonas, Kim, Jin-Soo, Alonso, Gustavo |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RoCE BALBOA: Service-enhanced Data Center RDMA for SmartNICs
par: Heer, Maximilian Jakob, et autres
Publié: (2025)
par: Heer, Maximilian Jakob, et autres
Publié: (2025)
Meili: Enabling SmartNIC as a Service in the Cloud
par: Su, Qiang, et autres
Publié: (2023)
par: Su, Qiang, et autres
Publié: (2023)
cMPI: Using CXL Memory Sharing for MPI One-Sided and Two-Sided Inter-Node Communications
par: Wang, Xi, et autres
Publié: (2025)
par: Wang, Xi, et autres
Publié: (2025)
MOFCO: Mobility- and Migration-Aware Task Offloading in Three-Layer Fog Computing Environments
par: Mahdizadeh, Soheil, et autres
Publié: (2025)
par: Mahdizadeh, Soheil, et autres
Publié: (2025)
Analysing Mechanisms for Virtual Channel Management in Low-Diameter networks
par: Cano, Alejandro, et autres
Publié: (2023)
par: Cano, Alejandro, et autres
Publié: (2023)
RailX: A Flexible, Scalable, and Low-Cost Network Architecture for Hyper-Scale LLM Training Systems
par: Feng, Yinxiao, et autres
Publié: (2025)
par: Feng, Yinxiao, et autres
Publié: (2025)
CRAFT: Latency and Cost-Aware Genetic-Based Framework for Node Placement in Edge-Fog Environments
par: Mahdizadeh, Soheil, et autres
Publié: (2025)
par: Mahdizadeh, Soheil, et autres
Publié: (2025)
LACIN: Linearly Arranged Complete Interconnection Networks
par: Beivide, Ramón, et autres
Publié: (2026)
par: Beivide, Ramón, et autres
Publié: (2026)
A Chronological Analysis of the Evolution of SmartNICs
par: Ajayi, Olasupo, et autres
Publié: (2025)
par: Ajayi, Olasupo, et autres
Publié: (2025)
Coyote v2: Raising the Level of Abstraction for Data Center FPGAs
par: Ramhorst, Benjamin, et autres
Publié: (2025)
par: Ramhorst, Benjamin, et autres
Publié: (2025)
A VM-HDL Co-Simulation Framework for Systems with PCIe-Connected FPGAs
par: Cho, Shenghsun, et autres
Publié: (2025)
par: Cho, Shenghsun, et autres
Publié: (2025)
FpgaHub: Fpga-centric Hyper-heterogeneous Computing Platform for Big Data Analytics
par: Wang, Zeke, et autres
Publié: (2025)
par: Wang, Zeke, et autres
Publié: (2025)
PID-Comm: A Fast and Flexible Collective Communication Framework for Commodity Processing-in-DIMM Devices
par: Noh, Si Ung, et autres
Publié: (2024)
par: Noh, Si Ung, et autres
Publié: (2024)
SwarmIO: Towards 100 Million IOPS SSD Emulation for Next-generation GPU-centric Storage Systems
par: Kim, Hyeseong, et autres
Publié: (2026)
par: Kim, Hyeseong, et autres
Publié: (2026)
Real-Time In-Network Machine Learning on P4-Programmable FPGA SmartNICs with Fixed-Point Arithmetic and Taylor
par: Sada, Mohammad Firas, et autres
Publié: (2025)
par: Sada, Mohammad Firas, et autres
Publié: (2025)
Memory-Centric Computing: Solving Computing's Memory Problem
par: Mutlu, Onur, et autres
Publié: (2025)
par: Mutlu, Onur, et autres
Publié: (2025)
Characterizing CPU-Induced Slowdowns in Multi-GPU LLM Inference
par: Chung, Euijun, et autres
Publié: (2026)
par: Chung, Euijun, et autres
Publié: (2026)
Accelerating Recommender Model ETL with a Streaming FPGA-GPU Dataflow
par: Zhu, Yu, et autres
Publié: (2025)
par: Zhu, Yu, et autres
Publié: (2025)
Towards Compute-Aware In-Switch Computing for LLMs Tensor-Parallelism on Multi-GPU Systems
par: Zhang, Chen, et autres
Publié: (2026)
par: Zhang, Chen, et autres
Publié: (2026)
Ultra Ethernet's Design Principles and Architectural Innovations
par: Hoefler, Torsten, et autres
Publié: (2025)
par: Hoefler, Torsten, et autres
Publié: (2025)
Accelerator-as-a-Service in Public Clouds: An Intra-Host Traffic Management View for Performance Isolation in the Wild
par: Zhao, Jiechen, et autres
Publié: (2024)
par: Zhao, Jiechen, et autres
Publié: (2024)
OptiNIC: A Resilient and Tail-Optimal RDMA NIC for Distributed ML Workloads
par: Warraich, Ertza, et autres
Publié: (2025)
par: Warraich, Ertza, et autres
Publié: (2025)
Revisiting Computational Storage for Data Integrity and Security
par: Shi, Chao, et autres
Publié: (2025)
par: Shi, Chao, et autres
Publié: (2025)
Optimizing Task Scheduling in Fog Computing with Deadline Awareness
par: Sirjani, Mohammad Sadegh, et autres
Publié: (2025)
par: Sirjani, Mohammad Sadegh, et autres
Publié: (2025)
Memory-Centric Computing: Recent Advances in Processing-in-DRAM
par: Mutlu, Onur, et autres
Publié: (2024)
par: Mutlu, Onur, et autres
Publié: (2024)
Optimizing Distributed ML Communication with Fused Computation-Collective Operations
par: Punniyamurthy, Kishore, et autres
Publié: (2023)
par: Punniyamurthy, Kishore, et autres
Publié: (2023)
Optimizing ML Concurrent Computation and Communication with GPU DMA Engines
par: Agrawal, Anirudha, et autres
Publié: (2024)
par: Agrawal, Anirudha, et autres
Publié: (2024)
Accelerating MoE with Dynamic In-Switch Computing on Multi-GPUs
par: Zhang, Qijun, et autres
Publié: (2026)
par: Zhang, Qijun, et autres
Publié: (2026)
Knowledge-Guided Attention-Inspired Learning for Task Offloading in Vehicle Edge Computing
par: Ma, Ke, et autres
Publié: (2025)
par: Ma, Ke, et autres
Publié: (2025)
BlockAMC: Scalable In-Memory Analog Matrix Computing for Solving Linear Systems
par: Pan, Lunshuai, et autres
Publié: (2024)
par: Pan, Lunshuai, et autres
Publié: (2024)
Deep Learning and Machine Learning with GPGPU and CUDA: Unlocking the Power of Parallel Computing
par: Li, Ming, et autres
Publié: (2024)
par: Li, Ming, et autres
Publié: (2024)
How Fast Can Graph Computations Go on Fine-grained Parallel Architectures
par: Wang, Yuqing, et autres
Publié: (2025)
par: Wang, Yuqing, et autres
Publié: (2025)
UniFormer: Unified and Efficient Transformer for Reasoning Across General and Custom Computing
par: Ran, Zhuoheng, et autres
Publié: (2025)
par: Ran, Zhuoheng, et autres
Publié: (2025)
Understanding Bottlenecks for Efficiently Serving LLM Inference With KV Offloading
par: Meng, William, et autres
Publié: (2025)
par: Meng, William, et autres
Publié: (2025)
RapidOMS: FPGA-based Open Modification Spectral Library Searching with HD Computing
par: Pinge, Sumukh, et autres
Publié: (2024)
par: Pinge, Sumukh, et autres
Publié: (2024)
CCSS: Hardware-Accelerated RTL Simulation with Fast Combinational Logic Computing and Sequential Logic Synchronization
par: Feng, Weigang, et autres
Publié: (2025)
par: Feng, Weigang, et autres
Publié: (2025)
PULSAR: Simultaneous Many-Row Activation for Reliable and High-Performance Computing in Off-the-Shelf DRAM Chips
par: Yuksel, Ismail Emir, et autres
Publié: (2023)
par: Yuksel, Ismail Emir, et autres
Publié: (2023)
Next-generation Probabilistic Computing Hardware with 3D MOSAICs, Illusion Scale-up, and Co-design
par: Srimani, Tathagata, et autres
Publié: (2024)
par: Srimani, Tathagata, et autres
Publié: (2024)
Conduit: Programmer-Transparent Near-Data Processing Using Multiple Compute-Capable Resources in Solid State Drives
par: Nadig, Rakesh, et autres
Publié: (2026)
par: Nadig, Rakesh, et autres
Publié: (2026)
RevaMp3D: Architecting the Processor Core and Cache Hierarchy for Systems with Monolithically-Integrated Logic and Memory
par: Ghiasi, Nika Mansouri, et autres
Publié: (2022)
par: Ghiasi, Nika Mansouri, et autres
Publié: (2022)
Documents similaires
-
RoCE BALBOA: Service-enhanced Data Center RDMA for SmartNICs
par: Heer, Maximilian Jakob, et autres
Publié: (2025) -
Meili: Enabling SmartNIC as a Service in the Cloud
par: Su, Qiang, et autres
Publié: (2023) -
cMPI: Using CXL Memory Sharing for MPI One-Sided and Two-Sided Inter-Node Communications
par: Wang, Xi, et autres
Publié: (2025) -
MOFCO: Mobility- and Migration-Aware Task Offloading in Three-Layer Fog Computing Environments
par: Mahdizadeh, Soheil, et autres
Publié: (2025) -
Analysing Mechanisms for Virtual Channel Management in Low-Diameter networks
par: Cano, Alejandro, et autres
Publié: (2023)