TeAAL: A Declarative Framework for Modeling Sparse Tensor Accelerators
Fuente:
arXiv
Salvato in:
| Autori principali: | Nayak, Nandeeka, Odemuyiwa, Toluwanimi O., Ugare, Shubham, Fletcher, Christopher W., Pellauer, Michael, Emer, Joel S. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FuseMax: Leveraging Extended Einsums to Optimize Attention Accelerator Design
di: Nayak, Nandeeka, et al.
Pubblicazione: (2024)
di: Nayak, Nandeeka, et al.
Pubblicazione: (2024)
Mambalaya: Einsum-Based Fusion Optimizations on State-Space Models
di: Odemuyiwa, Toluwanimi O., et al.
Pubblicazione: (2026)
di: Odemuyiwa, Toluwanimi O., et al.
Pubblicazione: (2026)
RTeAAL Sim: Using Tensor Algebra to Represent and Accelerate RTL Simulation (Extended Version)
di: Zhu, Yan, et al.
Pubblicazione: (2026)
di: Zhu, Yan, et al.
Pubblicazione: (2026)
Tailors: Accelerating Sparse Tensor Algebra by Overbooking Buffer Capacity
di: Xue, Zi Yu, et al.
Pubblicazione: (2023)
di: Xue, Zi Yu, et al.
Pubblicazione: (2023)
LoopTree: Exploring the Fused-layer Dataflow Accelerator Design Space
di: Gilbert, Michael, et al.
Pubblicazione: (2024)
di: Gilbert, Michael, et al.
Pubblicazione: (2024)
HaShiFlex: A High-Throughput Hardened Shifter DNN Accelerator with Fine-Tuning Flexibility
di: Herbst, Jonathan, et al.
Pubblicazione: (2025)
di: Herbst, Jonathan, et al.
Pubblicazione: (2025)
Modeling Analog-Digital-Converter Energy and Area for Compute-In-Memory Accelerator Design
di: Andrulis, Tanner, et al.
Pubblicazione: (2024)
di: Andrulis, Tanner, et al.
Pubblicazione: (2024)
CiMLoop: A Flexible, Accurate, and Fast Compute-In-Memory Modeling Tool
di: Andrulis, Tanner, et al.
Pubblicazione: (2024)
di: Andrulis, Tanner, et al.
Pubblicazione: (2024)
Fast and Fusiest: An Optimal Fusion-Aware Mapper for Accelerator Design
di: Andrulis, Tanner, et al.
Pubblicazione: (2026)
di: Andrulis, Tanner, et al.
Pubblicazione: (2026)
The Turbo-Charged Mapper: Fast and Optimal Mapping for Energy-efficient and Low-latency Accelerator Design
di: Gilbert, Michael, et al.
Pubblicazione: (2026)
di: Gilbert, Michael, et al.
Pubblicazione: (2026)
CELLO: Co-designing Schedule and Hybrid Implicit/Explicit Buffer for Complex Tensor Reuse
di: Garg, Raveesh, et al.
Pubblicazione: (2023)
di: Garg, Raveesh, et al.
Pubblicazione: (2023)
Systolic Sparse Tensor Slices: FPGA Building Blocks for Sparse and Dense AI Acceleration
di: Taka, Endri, et al.
Pubblicazione: (2025)
di: Taka, Endri, et al.
Pubblicazione: (2025)
Architecture-Level Modeling of Photonic Deep Neural Network Accelerators
di: Andrulis, Tanner, et al.
Pubblicazione: (2024)
di: Andrulis, Tanner, et al.
Pubblicazione: (2024)
StreamTensor: Make Tensors Stream in Dataflow Accelerators for LLMs
di: Ye, Hanchen, et al.
Pubblicazione: (2025)
di: Ye, Hanchen, et al.
Pubblicazione: (2025)
HARP: A Taxonomy for Heterogeneous and Hierarchical Processors for Mixed-reuse Workloads
di: Garg, Raveesh, et al.
Pubblicazione: (2025)
di: Garg, Raveesh, et al.
Pubblicazione: (2025)
Accelerating Sparse Graph Neural Networks with Tensor Core Optimization
di: Wu, Ka Wai
Pubblicazione: (2024)
di: Wu, Ka Wai
Pubblicazione: (2024)
Error Checking for Sparse Systolic Tensor Arrays
di: Peltekis, Christodoulos, et al.
Pubblicazione: (2024)
di: Peltekis, Christodoulos, et al.
Pubblicazione: (2024)
FLAASH: Flexible Accelerator Architecture for Sparse High-Order Tensor Contraction
di: Kulp, Gabriel, et al.
Pubblicazione: (2024)
di: Kulp, Gabriel, et al.
Pubblicazione: (2024)
Open-source Stand-Alone Versatile Tensor Accelerator
di: Faure-Gignoux, Anthony, et al.
Pubblicazione: (2025)
di: Faure-Gignoux, Anthony, et al.
Pubblicazione: (2025)
ATLAAS: Automatic Tensor-Level Abstraction of Accelerator Semantics
di: Gao, Ruijie, et al.
Pubblicazione: (2026)
di: Gao, Ruijie, et al.
Pubblicazione: (2026)
Sparse MTTKRP Acceleration for Tensor Decomposition on GPU
di: Wijeratne, Sasindu, et al.
Pubblicazione: (2024)
di: Wijeratne, Sasindu, et al.
Pubblicazione: (2024)
AME-PIM: Can Memory be Your Next Tensor Accelerator?
di: Venieri, Emanuele, et al.
Pubblicazione: (2026)
di: Venieri, Emanuele, et al.
Pubblicazione: (2026)
Holistic Optimization Framework for FPGA Accelerators
di: Pouget, Stéphane, et al.
Pubblicazione: (2025)
di: Pouget, Stéphane, et al.
Pubblicazione: (2025)
FETTA: Flexible and Efficient Hardware Accelerator for Tensorized Neural Network Training
di: Lu, Jinming, et al.
Pubblicazione: (2025)
di: Lu, Jinming, et al.
Pubblicazione: (2025)
FADiff: Fusion-Aware Differentiable Optimization for DNN Scheduling on Tensor Accelerators
di: Jia, Shuao, et al.
Pubblicazione: (2025)
di: Jia, Shuao, et al.
Pubblicazione: (2025)
An Efficient Sparse Hardware Accelerator for Spike-Driven Transformer
di: Li, Zhengke, et al.
Pubblicazione: (2025)
di: Li, Zhengke, et al.
Pubblicazione: (2025)
Systolic Array Acceleration of Diagonal-Optimized Sparse-Sparse Matrix Multiplication for Efficient Quantum Simulation
di: Su, Yuchao, et al.
Pubblicazione: (2025)
di: Su, Yuchao, et al.
Pubblicazione: (2025)
HCiM: ADC-Less Hybrid Analog-Digital Compute in Memory Accelerator for Deep Learning Workloads
di: Negi, Shubham, et al.
Pubblicazione: (2024)
di: Negi, Shubham, et al.
Pubblicazione: (2024)
SnipSnap: A Joint Compression Format and Dataflow Co-Optimization Framework for Efficient Sparse LLM Accelerator Design
di: Wu, Junyi, et al.
Pubblicazione: (2025)
di: Wu, Junyi, et al.
Pubblicazione: (2025)
Sparse-on-Dense: Area and Energy-Efficient Computing of Sparse Neural Networks on Dense Matrix Multiplication Accelerators
di: Yoon, Hyunsung, et al.
Pubblicazione: (2026)
di: Yoon, Hyunsung, et al.
Pubblicazione: (2026)
GTA: a new General Tensor Accelerator with Better Area Efficiency and Data Reuse
di: Ai, Chenyang, et al.
Pubblicazione: (2024)
di: Ai, Chenyang, et al.
Pubblicazione: (2024)
A Tensor-Train Decomposition based Compression of LLMs on Group Vector Systolic Accelerator
di: Huang, Sixiao, et al.
Pubblicazione: (2025)
di: Huang, Sixiao, et al.
Pubblicazione: (2025)
SuperUROP: An FPGA-Based Spatial Accelerator for Sparse Matrix Operations
di: Parthasarathy, Rishab
Pubblicazione: (2025)
di: Parthasarathy, Rishab
Pubblicazione: (2025)
FAST-Prefill: FPGA Accelerated Sparse Attention for Long Context LLM Prefill
di: Jayanth, Rakshith, et al.
Pubblicazione: (2026)
di: Jayanth, Rakshith, et al.
Pubblicazione: (2026)
A Low-Power Sparse Deep Learning Accelerator with Optimized Data Reuse
di: Hsu, Kai-Chieh, et al.
Pubblicazione: (2025)
di: Hsu, Kai-Chieh, et al.
Pubblicazione: (2025)
GUST: Graph Edge-Coloring Utilization for Accelerating Sparse Matrix Vector Multiplication
di: Gerami, Armin, et al.
Pubblicazione: (2024)
di: Gerami, Armin, et al.
Pubblicazione: (2024)
COFFEE: A Carbon-Modeling and Optimization Framework for HZO-based FeFET eNVMs
di: Wu, Hongbang, et al.
Pubblicazione: (2026)
di: Wu, Hongbang, et al.
Pubblicazione: (2026)
LogicSparse: Enabling Engine-Free Unstructured Sparsity for Quantised Deep-learning Accelerators
di: Li, Changhong, et al.
Pubblicazione: (2025)
di: Li, Changhong, et al.
Pubblicazione: (2025)
Enabling Unstructured Sparse Acceleration on Structured Sparse Accelerators
di: Jeong, Geonhwa, et al.
Pubblicazione: (2024)
di: Jeong, Geonhwa, et al.
Pubblicazione: (2024)
Periodic Online Testing for Sparse Systolic Tensor Arrays
di: Peltekis, Christodoulos, et al.
Pubblicazione: (2025)
di: Peltekis, Christodoulos, et al.
Pubblicazione: (2025)
Documenti analoghi
-
FuseMax: Leveraging Extended Einsums to Optimize Attention Accelerator Design
di: Nayak, Nandeeka, et al.
Pubblicazione: (2024) -
Mambalaya: Einsum-Based Fusion Optimizations on State-Space Models
di: Odemuyiwa, Toluwanimi O., et al.
Pubblicazione: (2026) -
RTeAAL Sim: Using Tensor Algebra to Represent and Accelerate RTL Simulation (Extended Version)
di: Zhu, Yan, et al.
Pubblicazione: (2026) -
Tailors: Accelerating Sparse Tensor Algebra by Overbooking Buffer Capacity
di: Xue, Zi Yu, et al.
Pubblicazione: (2023) -
LoopTree: Exploring the Fused-layer Dataflow Accelerator Design Space
di: Gilbert, Michael, et al.
Pubblicazione: (2024)