Tailors: Accelerating Sparse Tensor Algebra by Overbooking Buffer Capacity
Fuente:
arXiv
Salvato in:
| Autori principali: | Xue, Zi Yu, Wu, Yannan Nellie, Emer, Joel S., Sze, Vivienne |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LoopTree: Exploring the Fused-layer Dataflow Accelerator Design Space
di: Gilbert, Michael, et al.
Pubblicazione: (2024)
di: Gilbert, Michael, et al.
Pubblicazione: (2024)
CiMLoop: A Flexible, Accurate, and Fast Compute-In-Memory Modeling Tool
di: Andrulis, Tanner, et al.
Pubblicazione: (2024)
di: Andrulis, Tanner, et al.
Pubblicazione: (2024)
Fast and Fusiest: An Optimal Fusion-Aware Mapper for Accelerator Design
di: Andrulis, Tanner, et al.
Pubblicazione: (2026)
di: Andrulis, Tanner, et al.
Pubblicazione: (2026)
The Turbo-Charged Mapper: Fast and Optimal Mapping for Energy-efficient and Low-latency Accelerator Design
di: Gilbert, Michael, et al.
Pubblicazione: (2026)
di: Gilbert, Michael, et al.
Pubblicazione: (2026)
Modeling Analog-Digital-Converter Energy and Area for Compute-In-Memory Accelerator Design
di: Andrulis, Tanner, et al.
Pubblicazione: (2024)
di: Andrulis, Tanner, et al.
Pubblicazione: (2024)
Architecture-Level Modeling of Photonic Deep Neural Network Accelerators
di: Andrulis, Tanner, et al.
Pubblicazione: (2024)
di: Andrulis, Tanner, et al.
Pubblicazione: (2024)
TeAAL: A Declarative Framework for Modeling Sparse Tensor Accelerators
di: Nayak, Nandeeka, et al.
Pubblicazione: (2023)
di: Nayak, Nandeeka, et al.
Pubblicazione: (2023)
Systolic Sparse Tensor Slices: FPGA Building Blocks for Sparse and Dense AI Acceleration
di: Taka, Endri, et al.
Pubblicazione: (2025)
di: Taka, Endri, et al.
Pubblicazione: (2025)
FuseMax: Leveraging Extended Einsums to Optimize Attention Accelerator Design
di: Nayak, Nandeeka, et al.
Pubblicazione: (2024)
di: Nayak, Nandeeka, et al.
Pubblicazione: (2024)
RTeAAL Sim: Using Tensor Algebra to Represent and Accelerate RTL Simulation (Extended Version)
di: Zhu, Yan, et al.
Pubblicazione: (2026)
di: Zhu, Yan, et al.
Pubblicazione: (2026)
Accelerating Sparse Graph Neural Networks with Tensor Core Optimization
di: Wu, Ka Wai
Pubblicazione: (2024)
di: Wu, Ka Wai
Pubblicazione: (2024)
Mambalaya: Einsum-Based Fusion Optimizations on State-Space Models
di: Odemuyiwa, Toluwanimi O., et al.
Pubblicazione: (2026)
di: Odemuyiwa, Toluwanimi O., et al.
Pubblicazione: (2026)
StreamTensor: Make Tensors Stream in Dataflow Accelerators for LLMs
di: Ye, Hanchen, et al.
Pubblicazione: (2025)
di: Ye, Hanchen, et al.
Pubblicazione: (2025)
Error Checking for Sparse Systolic Tensor Arrays
di: Peltekis, Christodoulos, et al.
Pubblicazione: (2024)
di: Peltekis, Christodoulos, et al.
Pubblicazione: (2024)
FLAASH: Flexible Accelerator Architecture for Sparse High-Order Tensor Contraction
di: Kulp, Gabriel, et al.
Pubblicazione: (2024)
di: Kulp, Gabriel, et al.
Pubblicazione: (2024)
Open-source Stand-Alone Versatile Tensor Accelerator
di: Faure-Gignoux, Anthony, et al.
Pubblicazione: (2025)
di: Faure-Gignoux, Anthony, et al.
Pubblicazione: (2025)
ATLAAS: Automatic Tensor-Level Abstraction of Accelerator Semantics
di: Gao, Ruijie, et al.
Pubblicazione: (2026)
di: Gao, Ruijie, et al.
Pubblicazione: (2026)
Sparse MTTKRP Acceleration for Tensor Decomposition on GPU
di: Wijeratne, Sasindu, et al.
Pubblicazione: (2024)
di: Wijeratne, Sasindu, et al.
Pubblicazione: (2024)
A Tensor-Train Decomposition based Compression of LLMs on Group Vector Systolic Accelerator
di: Huang, Sixiao, et al.
Pubblicazione: (2025)
di: Huang, Sixiao, et al.
Pubblicazione: (2025)
AME-PIM: Can Memory be Your Next Tensor Accelerator?
di: Venieri, Emanuele, et al.
Pubblicazione: (2026)
di: Venieri, Emanuele, et al.
Pubblicazione: (2026)
FETTA: Flexible and Efficient Hardware Accelerator for Tensorized Neural Network Training
di: Lu, Jinming, et al.
Pubblicazione: (2025)
di: Lu, Jinming, et al.
Pubblicazione: (2025)
FADiff: Fusion-Aware Differentiable Optimization for DNN Scheduling on Tensor Accelerators
di: Jia, Shuao, et al.
Pubblicazione: (2025)
di: Jia, Shuao, et al.
Pubblicazione: (2025)
An Efficient Sparse Hardware Accelerator for Spike-Driven Transformer
di: Li, Zhengke, et al.
Pubblicazione: (2025)
di: Li, Zhengke, et al.
Pubblicazione: (2025)
Systolic Array Acceleration of Diagonal-Optimized Sparse-Sparse Matrix Multiplication for Efficient Quantum Simulation
di: Su, Yuchao, et al.
Pubblicazione: (2025)
di: Su, Yuchao, et al.
Pubblicazione: (2025)
Branch Target Buffer Reverse Engineering on Arm
di: Wan, Junpeng
Pubblicazione: (2024)
di: Wan, Junpeng
Pubblicazione: (2024)
Sparse-on-Dense: Area and Energy-Efficient Computing of Sparse Neural Networks on Dense Matrix Multiplication Accelerators
di: Yoon, Hyunsung, et al.
Pubblicazione: (2026)
di: Yoon, Hyunsung, et al.
Pubblicazione: (2026)
SnipSnap: A Joint Compression Format and Dataflow Co-Optimization Framework for Efficient Sparse LLM Accelerator Design
di: Wu, Junyi, et al.
Pubblicazione: (2025)
di: Wu, Junyi, et al.
Pubblicazione: (2025)
Platinum: Path-Adaptable LUT-Based Accelerator Tailored for Low-Bit Weight Matrix Multiplication
di: Shan, Haoxuan, et al.
Pubblicazione: (2025)
di: Shan, Haoxuan, et al.
Pubblicazione: (2025)
GTA: a new General Tensor Accelerator with Better Area Efficiency and Data Reuse
di: Ai, Chenyang, et al.
Pubblicazione: (2024)
di: Ai, Chenyang, et al.
Pubblicazione: (2024)
SuperUROP: An FPGA-Based Spatial Accelerator for Sparse Matrix Operations
di: Parthasarathy, Rishab
Pubblicazione: (2025)
di: Parthasarathy, Rishab
Pubblicazione: (2025)
VitaLLM: A Versatile, Ultra-Compact Ternary LLM Accelerator with Dependency-Aware Scheduling
di: Lin, Zi-Wei, et al.
Pubblicazione: (2026)
di: Lin, Zi-Wei, et al.
Pubblicazione: (2026)
VitaLLM: A Versatile and Tiny Accelerator for Mixed-Precision LLM Inference on Edge Devices
di: Lin, Zi-Wei, et al.
Pubblicazione: (2026)
di: Lin, Zi-Wei, et al.
Pubblicazione: (2026)
Energy-adaptive Buffering for Efficient, Responsive, and Persistent Batteryless Systems
di: Williams, Harrison, et al.
Pubblicazione: (2024)
di: Williams, Harrison, et al.
Pubblicazione: (2024)
LMB: Augmenting PCIe Devices with CXL-Linked Memory Buffer
di: Wang, Jiapin, et al.
Pubblicazione: (2024)
di: Wang, Jiapin, et al.
Pubblicazione: (2024)
FAST-Prefill: FPGA Accelerated Sparse Attention for Long Context LLM Prefill
di: Jayanth, Rakshith, et al.
Pubblicazione: (2026)
di: Jayanth, Rakshith, et al.
Pubblicazione: (2026)
A Low-Power Sparse Deep Learning Accelerator with Optimized Data Reuse
di: Hsu, Kai-Chieh, et al.
Pubblicazione: (2025)
di: Hsu, Kai-Chieh, et al.
Pubblicazione: (2025)
GUST: Graph Edge-Coloring Utilization for Accelerating Sparse Matrix Vector Multiplication
di: Gerami, Armin, et al.
Pubblicazione: (2024)
di: Gerami, Armin, et al.
Pubblicazione: (2024)
ADE-HGNN: Accelerating HGNNs through Attention Disparity Exploitation
di: Han, Dengke, et al.
Pubblicazione: (2024)
di: Han, Dengke, et al.
Pubblicazione: (2024)
LogicSparse: Enabling Engine-Free Unstructured Sparsity for Quantised Deep-learning Accelerators
di: Li, Changhong, et al.
Pubblicazione: (2025)
di: Li, Changhong, et al.
Pubblicazione: (2025)
CIM-Tuner: Balancing the Compute and Storage Capacity of SRAM-CIM Accelerator via Hardware-mapping Co-exploration
di: Chen, Jinwu, et al.
Pubblicazione: (2026)
di: Chen, Jinwu, et al.
Pubblicazione: (2026)
Documenti analoghi
-
LoopTree: Exploring the Fused-layer Dataflow Accelerator Design Space
di: Gilbert, Michael, et al.
Pubblicazione: (2024) -
CiMLoop: A Flexible, Accurate, and Fast Compute-In-Memory Modeling Tool
di: Andrulis, Tanner, et al.
Pubblicazione: (2024) -
Fast and Fusiest: An Optimal Fusion-Aware Mapper for Accelerator Design
di: Andrulis, Tanner, et al.
Pubblicazione: (2026) -
The Turbo-Charged Mapper: Fast and Optimal Mapping for Energy-efficient and Low-latency Accelerator Design
di: Gilbert, Michael, et al.
Pubblicazione: (2026) -
Modeling Analog-Digital-Converter Energy and Area for Compute-In-Memory Accelerator Design
di: Andrulis, Tanner, et al.
Pubblicazione: (2024)