Accelerating Sparse Tensor Decomposition Using Adaptive Linearized Representation
Fuente:
arXiv
Salvato in:
| Autori principali: | Laukemann, Jan, Helal, Ahmed E., Anderson, S. Isaac Geronimo, Checconi, Fabio, Soh, Yongseok, Tithi, Jesmin Jahan, Ranadive, Teresa, Gravelle, Brian J, Petrini, Fabrizio, Choi, Jee |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ReLATE: Learning Efficient Sparse Encoding for High-Performance Tensor Decomposition
di: Helal, Ahmed E., et al.
Pubblicazione: (2025)
di: Helal, Ahmed E., et al.
Pubblicazione: (2025)
Ridgeline: A 2D Roofline Model for Distributed Systems
di: Checconi, Fabio, et al.
Pubblicazione: (2022)
di: Checconi, Fabio, et al.
Pubblicazione: (2022)
Efficient Parallel Multi-Hop Reasoning: A Scalable Approach for Knowledge Graph Analysis
di: Tithi, Jesmin Jahan, et al.
Pubblicazione: (2024)
di: Tithi, Jesmin Jahan, et al.
Pubblicazione: (2024)
Scaling Intelligence: Designing Data Centers for Next-Gen Language Models
di: Tithi, Jesmin Jahan, et al.
Pubblicazione: (2025)
di: Tithi, Jesmin Jahan, et al.
Pubblicazione: (2025)
Enhancing Scalability and Performance in Influence Maximization with Optimized Parallel Processing
di: Wu, Hanjiang, et al.
Pubblicazione: (2024)
di: Wu, Hanjiang, et al.
Pubblicazione: (2024)
MAGNUS: Generating Data Locality to Accelerate Sparse Matrix-Matrix Multiplication on CPUs
di: Wolfson-Pou, Jordi, et al.
Pubblicazione: (2025)
di: Wolfson-Pou, Jordi, et al.
Pubblicazione: (2025)
Microarchitectural comparison and in-core modeling of state-of-the-art CPUs: Grace, Sapphire Rapids, and Genoa
di: Laukemann, Jan, et al.
Pubblicazione: (2024)
di: Laukemann, Jan, et al.
Pubblicazione: (2024)
cuTeSpMM: Accelerating Sparse-Dense Matrix Multiplication using GPU Tensor Cores
di: Xiang, Lizhi, et al.
Pubblicazione: (2025)
di: Xiang, Lizhi, et al.
Pubblicazione: (2025)
CloverLeaf on Intel Multi-Core CPUs: A Case Study in Write-Allocate Evasion
di: Laukemann, Jan, et al.
Pubblicazione: (2023)
di: Laukemann, Jan, et al.
Pubblicazione: (2023)
Accelerating Machine Learning Queries with Linear Algebra Query Processing
di: Sun, Wenbo, et al.
Pubblicazione: (2023)
di: Sun, Wenbo, et al.
Pubblicazione: (2023)
Accelerating Sparse Ternary GEMM for Quantized ML on Apple Silicon
di: Lipshitz, Baraq, et al.
Pubblicazione: (2025)
di: Lipshitz, Baraq, et al.
Pubblicazione: (2025)
Dynamic Precision Math Engine for Linear Algebra and Trigonometry Acceleration on Xtensa LX6 Microcontrollers
di: Preciado, Elian Alfonso Lopez
Pubblicazione: (2026)
di: Preciado, Elian Alfonso Lopez
Pubblicazione: (2026)
sTiles: An Accelerated Computational Framework for Sparse Factorizations of Structured Matrices
di: Fattah, Esmail Abdul, et al.
Pubblicazione: (2025)
di: Fattah, Esmail Abdul, et al.
Pubblicazione: (2025)
A Technical Survey of Sparse Linear Solvers in Electronic Design Automation
di: Rai, Nityanand
Pubblicazione: (2025)
di: Rai, Nityanand
Pubblicazione: (2025)
CoNST: Code Generator for Sparse Tensor Networks
di: Raje, Saurabh, et al.
Pubblicazione: (2024)
di: Raje, Saurabh, et al.
Pubblicazione: (2024)
Acceleration of Tensor-Product Operations with Tensor Cores
di: Cui, Cu
Pubblicazione: (2024)
di: Cui, Cu
Pubblicazione: (2024)
TINA: Acceleration of Non-NN Signal Processing Algorithms Using NN Accelerators
di: Boerkamp, Christiaan, et al.
Pubblicazione: (2024)
di: Boerkamp, Christiaan, et al.
Pubblicazione: (2024)
Fast Entropy Decoding for Sparse MVM on GPUs
di: Schätzle, Emil, et al.
Pubblicazione: (2026)
di: Schätzle, Emil, et al.
Pubblicazione: (2026)
Heavy-Traffic Optimal Size- and State-Aware Dispatching
di: Xie, Runhan, et al.
Pubblicazione: (2023)
di: Xie, Runhan, et al.
Pubblicazione: (2023)
Improving Multiresource Job Scheduling with Markovian Service Rate Policies
di: Chen, Zhongrui, et al.
Pubblicazione: (2025)
di: Chen, Zhongrui, et al.
Pubblicazione: (2025)
Improving Multiresource Job Scheduling with Markovian Service Rate Policies
di: Chen, Zhongrui, et al.
Pubblicazione: (2024)
di: Chen, Zhongrui, et al.
Pubblicazione: (2024)
Benchmark-based Study of CPU/GPU Power-Related Features through JAX and TensorFlow
di: Tchakoute, Roblex Nana, et al.
Pubblicazione: (2025)
di: Tchakoute, Roblex Nana, et al.
Pubblicazione: (2025)
Multiserver-job Response Time under Multilevel Scaling
di: Grosof, Isaac, et al.
Pubblicazione: (2025)
di: Grosof, Isaac, et al.
Pubblicazione: (2025)
Graph-Based Product Form
di: Comte, Céline, et al.
Pubblicazione: (2025)
di: Comte, Céline, et al.
Pubblicazione: (2025)
Explainable Port Mapping Inference with Sparse Performance Counters for AMD's Zen Architectures
di: Ritter, Fabian, et al.
Pubblicazione: (2024)
di: Ritter, Fabian, et al.
Pubblicazione: (2024)
SparseInfer: Training-free Prediction of Activation Sparsity for Fast LLM Inference
di: Shin, Jiho, et al.
Pubblicazione: (2024)
di: Shin, Jiho, et al.
Pubblicazione: (2024)
GoldbachGPU: An Open Source GPU-Accelerated Framework for Verification of Goldbach's Conjecture
di: Llorente-Saguer, Isaac
Pubblicazione: (2026)
di: Llorente-Saguer, Isaac
Pubblicazione: (2026)
SparseX: Efficient Segment-Level KV Cache Sharing for Interleaved LLM Serving
di: Zhang, Quqing, et al.
Pubblicazione: (2026)
di: Zhang, Quqing, et al.
Pubblicazione: (2026)
Numerical Kernels on a Spatial Accelerator: A Study of Tenstorrent Wormhole
di: Taylor, Maya, et al.
Pubblicazione: (2026)
di: Taylor, Maya, et al.
Pubblicazione: (2026)
AFarePart: Accuracy-aware Fault-resilient Partitioner for DNN Edge Accelerators
di: Debnath, Mukta, et al.
Pubblicazione: (2025)
di: Debnath, Mukta, et al.
Pubblicazione: (2025)
Accelerating High-Order Finite Element Simulations at Extreme Scale with FP64 Tensor Cores
di: Tu, Jiqun, et al.
Pubblicazione: (2026)
di: Tu, Jiqun, et al.
Pubblicazione: (2026)
H2EAL: Hybrid-Bonding Architecture with Hybrid Sparse Attention for Efficient Long-Context LLM Inference
di: Fu, Zizhuo, et al.
Pubblicazione: (2025)
di: Fu, Zizhuo, et al.
Pubblicazione: (2025)
Analysis of Markovian Arrivals and Service with Applications to Intermittent Overload
di: Grosof, Isaac, et al.
Pubblicazione: (2024)
di: Grosof, Isaac, et al.
Pubblicazione: (2024)
D-com: Accelerating Iterative Processing to Enable Low-rank Decomposition of Activations
di: Tahmasebi, Faraz, et al.
Pubblicazione: (2025)
di: Tahmasebi, Faraz, et al.
Pubblicazione: (2025)
Mapping Sparse Triangular Solves to GPUs via Fine-grained Domain Decomposition
di: Gondhalekar, Atharva, et al.
Pubblicazione: (2025)
di: Gondhalekar, Atharva, et al.
Pubblicazione: (2025)
Caspar: CUDA Accelerator for Symbolic Programming with Adaptive Reordering
di: Martens, Emil, et al.
Pubblicazione: (2026)
di: Martens, Emil, et al.
Pubblicazione: (2026)
FlexiSAGA: A Flexible Systolic Array GEMM Accelerator for Sparse and Dense Processing
di: Müller, Mika Markus, et al.
Pubblicazione: (2025)
di: Müller, Mika Markus, et al.
Pubblicazione: (2025)
Accelerating Vertical Federated Learning
di: Cai, Dongqi, et al.
Pubblicazione: (2022)
di: Cai, Dongqi, et al.
Pubblicazione: (2022)
CORD: Co-design of Resource Allocation and Deadline Decomposition with Generative Profiling
di: Gifford, Robert, et al.
Pubblicazione: (2025)
di: Gifford, Robert, et al.
Pubblicazione: (2025)
Acceleration and energy consumption optimization in cascading classifiers for face detection on low-cost ARM big.LITTLE asymmetric architectures
di: Corpas, Alberto, et al.
Pubblicazione: (2024)
di: Corpas, Alberto, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ReLATE: Learning Efficient Sparse Encoding for High-Performance Tensor Decomposition
di: Helal, Ahmed E., et al.
Pubblicazione: (2025) -
Ridgeline: A 2D Roofline Model for Distributed Systems
di: Checconi, Fabio, et al.
Pubblicazione: (2022) -
Efficient Parallel Multi-Hop Reasoning: A Scalable Approach for Knowledge Graph Analysis
di: Tithi, Jesmin Jahan, et al.
Pubblicazione: (2024) -
Scaling Intelligence: Designing Data Centers for Next-Gen Language Models
di: Tithi, Jesmin Jahan, et al.
Pubblicazione: (2025) -
Enhancing Scalability and Performance in Influence Maximization with Optimized Parallel Processing
di: Wu, Hanjiang, et al.
Pubblicazione: (2024)