Enregistré dans:
| Auteurs principaux: | Yang, Yu, González, Jordi Altayó, Delestrac, Paul, Hemani, Ahmed |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2407.00207 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Addressing memory bandwidth scalability in vector processors for streaming applications
par: Altayo, Jordi, et autres
Publié: (2025)
par: Altayo, Jordi, et autres
Publié: (2025)
'1'-bit Count-based Sorting Unit to Reduce Link Power in DNN Accelerators
par: Han, Ruichi, et autres
Publié: (2026)
par: Han, Ruichi, et autres
Publié: (2026)
pHNSW: PCA-Based Filtering to Accelerate HNSW Approximate Nearest Neighbor Search
par: Li, Zheng, et autres
Publié: (2026)
par: Li, Zheng, et autres
Publié: (2026)
Late Breaking Results: Quamba-SE: Soft-edge Quantizer for Activations in State Space Models
par: Chen, Yizhi, et autres
Publié: (2026)
par: Chen, Yizhi, et autres
Publié: (2026)
Demystifying the 7-D Convolution Loop Nest for Data and Instruction Streaming in Reconfigurable AI Accelerators
par: Chowdhury, Md Rownak Hossain, et autres
Publié: (2025)
par: Chowdhury, Md Rownak Hossain, et autres
Publié: (2025)
Mozart: A Chiplet Ecosystem-Accelerator Codesign Framework for Composable Bespoke Application Specific Integrated Circuits
par: Jin, Haoran, et autres
Publié: (2025)
par: Jin, Haoran, et autres
Publié: (2025)
ARISE: Automating RISC-V Instruction Set Extension
par: Hager-Clukas, Andreas, et autres
Publié: (2025)
par: Hager-Clukas, Andreas, et autres
Publié: (2025)
A Dense and Efficient Instruction Set Architecture Encoding
par: Maroun, Emad Jacob
Publié: (2025)
par: Maroun, Emad Jacob
Publié: (2025)
Sparsity-Aware Streaming SNN Accelerator with Output-Channel Dataflow for Automatic Modulation Classification
par: Yang, Kuilian, et autres
Publié: (2026)
par: Yang, Kuilian, et autres
Publié: (2026)
Composing Mini Oscilloscope on Embedded Systems
par: Romero, Brennan, et autres
Publié: (2025)
par: Romero, Brennan, et autres
Publié: (2025)
FILCO: Flexible Composing Architecture with Real-Time Reconfigurability for DNN Acceleration
par: Chen, Xingzhen, et autres
Publié: (2026)
par: Chen, Xingzhen, et autres
Publié: (2026)
Rainbow: A Composable Coherence Protocol for Multi-Chip Servers
par: Menezo, Lucia G., et autres
Publié: (2020)
par: Menezo, Lucia G., et autres
Publié: (2020)
Control Flow Management in Modern GPUs
par: Shoushtary, Mojtaba Abaie, et autres
Publié: (2024)
par: Shoushtary, Mojtaba Abaie, et autres
Publié: (2024)
StreamGrid: Streaming Point Cloud Analytics via Compulsory Splitting and Deterministic Termination
par: Feng, Yu, et autres
Publié: (2025)
par: Feng, Yu, et autres
Publié: (2025)
Reconfigurable Quantum Instruction Set Computers for High Performance Attainable on Hardware
par: Yang, Zhaohui, et autres
Publié: (2025)
par: Yang, Zhaohui, et autres
Publié: (2025)
Mitigating the Bandwidth Wall via Data-Streaming System-Accelerator Co-Design
par: Liu, Qunyou, et autres
Publié: (2026)
par: Liu, Qunyou, et autres
Publié: (2026)
StreamTensor: Make Tensors Stream in Dataflow Accelerators for LLMs
par: Ye, Hanchen, et autres
Publié: (2025)
par: Ye, Hanchen, et autres
Publié: (2025)
DataMaestro: A Versatile and Efficient Data Streaming Engine Bringing Decoupled Memory Access To Dataflow Accelerators
par: Yi, Xiaoling, et autres
Publié: (2025)
par: Yi, Xiaoling, et autres
Publié: (2025)
Pedagogically Motivated and Composable Open-Source RISC-V Processors for Computer Science Education
par: McDougall, Ian, et autres
Publié: (2025)
par: McDougall, Ian, et autres
Publié: (2025)
fSEAD: a Composable FPGA-based Streaming Ensemble Anomaly Detection Library
par: Lou, Binglei, et autres
Publié: (2024)
par: Lou, Binglei, et autres
Publié: (2024)
A Composable Dynamic Sparse Dataflow Architecture for Efficient Event-based Vision Processing on FPGA
par: Gao, Yizhao, et autres
Publié: (2024)
par: Gao, Yizhao, et autres
Publié: (2024)
GraCo -- A Graph Composer for Integrated Circuits
par: Uhlich, Stefan, et autres
Publié: (2024)
par: Uhlich, Stefan, et autres
Publié: (2024)
Algorithms for Improving the Automatically Synthesized Instruction Set of an Extensible Processor
par: Sovietov, Peter
Publié: (2024)
par: Sovietov, Peter
Publié: (2024)
Reconfigurable Stream Network Architecture
par: Wang, Chengyue, et autres
Publié: (2024)
par: Wang, Chengyue, et autres
Publié: (2024)
SpikeStream: Accelerating Spiking Neural Network Inference on RISC-V Clusters with Sparse Computation Extensions
par: Manoni, Simone, et autres
Publié: (2025)
par: Manoni, Simone, et autres
Publié: (2025)
DORA: Dataflow-Instruction Orchestration Architecture for DNN Acceleration
par: Chen, Xingzhen, et autres
Publié: (2026)
par: Chen, Xingzhen, et autres
Publié: (2026)
MINISA: Minimal Instruction Set Architecture for Next-gen Reconfigurable Inference Accelerator
par: Tong, Jianming, et autres
Publié: (2026)
par: Tong, Jianming, et autres
Publié: (2026)
Stream-HLS: Towards Automatic Dataflow Acceleration
par: Basalama, Suhail, et autres
Publié: (2025)
par: Basalama, Suhail, et autres
Publié: (2025)
StreamDCIM: A Tile-based Streaming Digital CIM Accelerator with Mixed-stationary Cross-forwarding Dataflow for Multimodal Transformer
par: Qin, Shantian, et autres
Publié: (2025)
par: Qin, Shantian, et autres
Publié: (2025)
Garibaldi: A Pairwise Instruction-Data Management for Enhancing Shared Last-Level Cache Performance in Server Workloads
par: Kwon, Jaewon, et autres
Publié: (2025)
par: Kwon, Jaewon, et autres
Publié: (2025)
Instruction Scheduling in the Saturn Vector Unit
par: Zhao, Jerry, et autres
Publié: (2024)
par: Zhao, Jerry, et autres
Publié: (2024)
Implementing and Optimizing the Scaled Dot-Product Attention on Streaming Dataflow
par: Sohn, Gina, et autres
Publié: (2024)
par: Sohn, Gina, et autres
Publié: (2024)
A Quantitative Analysis and Guidelines of Data Streaming Accelerator in Modern Intel Xeon Scalable Processors
par: Kuper, Reese, et autres
Publié: (2023)
par: Kuper, Reese, et autres
Publié: (2023)
FastFlow in FPGA Stacks of Data Centers
par: Paul, Rourab, et autres
Publié: (2024)
par: Paul, Rourab, et autres
Publié: (2024)
Focus: A Streaming Concentration Architecture for Efficient Vision-Language Models
par: Wei, Chiyue, et autres
Publié: (2025)
par: Wei, Chiyue, et autres
Publié: (2025)
Multi-Dimensional Reconfigurable, Physically Composable Hybrid Diffractive Optical Neural Network
par: Yin, Ziang, et autres
Publié: (2024)
par: Yin, Ziang, et autres
Publié: (2024)
Shared-PIM: Enabling Concurrent Computation and Data Flow for Faster Processing-in-DRAM
par: Mamdouh, Ahmed, et autres
Publié: (2024)
par: Mamdouh, Ahmed, et autres
Publié: (2024)
LUTstructions: Self-loading FPGA-based Reconfigurable Instructions
par: Papaphilippou, Philippos
Publié: (2026)
par: Papaphilippou, Philippos
Publié: (2026)
Efficient Implementation of RISC-V Vector Permutation Instructions
par: Titopoulos, Vasileios, et autres
Publié: (2025)
par: Titopoulos, Vasileios, et autres
Publié: (2025)
Stream: Design Space Exploration of Layer-Fused DNNs on Heterogeneous Dataflow Accelerators
par: Symons, Arne, et autres
Publié: (2022)
par: Symons, Arne, et autres
Publié: (2022)
Documents similaires
-
Addressing memory bandwidth scalability in vector processors for streaming applications
par: Altayo, Jordi, et autres
Publié: (2025) -
'1'-bit Count-based Sorting Unit to Reduce Link Power in DNN Accelerators
par: Han, Ruichi, et autres
Publié: (2026) -
pHNSW: PCA-Based Filtering to Accelerate HNSW Approximate Nearest Neighbor Search
par: Li, Zheng, et autres
Publié: (2026) -
Late Breaking Results: Quamba-SE: Soft-edge Quantizer for Activations in State Space Models
par: Chen, Yizhi, et autres
Publié: (2026) -
Demystifying the 7-D Convolution Loop Nest for Data and Instruction Streaming in Reconfigurable AI Accelerators
par: Chowdhury, Md Rownak Hossain, et autres
Publié: (2025)