A Matrix Decomposition Method for Odd-Type Gaussian Normal Basis Multiplication
Fuente:
arXiv
Salvato in:
| Autori principali: | Phalakarn, Kittiphon, Surarerks, Athasit |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
bitSMM: A bit-Serial Matrix Multiplication Accelerator
di: Antunes, Pedro, et al.
Pubblicazione: (2026)
di: Antunes, Pedro, et al.
Pubblicazione: (2026)
Floating-Point Multiply-Add with Approximate Normalization for Low-Cost Matrix Engines
di: Alexandridis, Kosmas, et al.
Pubblicazione: (2024)
di: Alexandridis, Kosmas, et al.
Pubblicazione: (2024)
Co-Design of CNN Accelerators for TinyML using Approximate Matrix Decomposition
di: Morales, José Juan Hernández, et al.
Pubblicazione: (2026)
di: Morales, José Juan Hernández, et al.
Pubblicazione: (2026)
Performance Analysis of Matrix Multiplication for Deep Learning on the Edge
di: Ramírez, Cristian, et al.
Pubblicazione: (2024)
di: Ramírez, Cristian, et al.
Pubblicazione: (2024)
Empowering Vector Architectures for ML: The CAMP Architecture for Matrix Multiplication
di: Nojehdeh, Mohammadreza Esmali, et al.
Pubblicazione: (2025)
di: Nojehdeh, Mohammadreza Esmali, et al.
Pubblicazione: (2025)
ADiP: Adaptive-Precision Systolic Array for Matrix Multiplication Acceleration
di: Abdelmaksoud, Ahmed J., et al.
Pubblicazione: (2025)
di: Abdelmaksoud, Ahmed J., et al.
Pubblicazione: (2025)
Optimizing Structured-Sparse Matrix Multiplication in RISC-V Vector Processors
di: Titopoulos, Vasileios, et al.
Pubblicazione: (2025)
di: Titopoulos, Vasileios, et al.
Pubblicazione: (2025)
DeMM: A Decoupled Matrix Multiplication Engine Supporting Relaxed Structured Sparsity
di: Peltekis, Christodoulos, et al.
Pubblicazione: (2024)
di: Peltekis, Christodoulos, et al.
Pubblicazione: (2024)
D-Legion: A Scalable Many-Core Architecture for Accelerating Matrix Multiplication in Quantized LLMs
di: Abdelmaksoud, Ahmed J., et al.
Pubblicazione: (2026)
di: Abdelmaksoud, Ahmed J., et al.
Pubblicazione: (2026)
Systolic Array Data Flows for Efficient Matrix Multiplication in Deep Neural Networks
di: Raja, Tejas
Pubblicazione: (2024)
di: Raja, Tejas
Pubblicazione: (2024)
GUST: Graph Edge-Coloring Utilization for Accelerating Sparse Matrix Vector Multiplication
di: Gerami, Armin, et al.
Pubblicazione: (2024)
di: Gerami, Armin, et al.
Pubblicazione: (2024)
Fair and Square: Replacing One Real Multiplication with a Single Square and One Complex Multiplication with Three Squares When Performing Matrix Multiplication and Convolutions
di: Liguori, Vincenzo
Pubblicazione: (2026)
di: Liguori, Vincenzo
Pubblicazione: (2026)
Platinum: Path-Adaptable LUT-Based Accelerator Tailored for Low-Bit Weight Matrix Multiplication
di: Shan, Haoxuan, et al.
Pubblicazione: (2025)
di: Shan, Haoxuan, et al.
Pubblicazione: (2025)
Systolic Array Acceleration of Diagonal-Optimized Sparse-Sparse Matrix Multiplication for Efficient Quantum Simulation
di: Su, Yuchao, et al.
Pubblicazione: (2025)
di: Su, Yuchao, et al.
Pubblicazione: (2025)
Towards Zero-Stall Matrix Multiplication on Energy-Efficient RISC-V Clusters for Machine Learning Acceleration
di: Colagrande, Luca, et al.
Pubblicazione: (2025)
di: Colagrande, Luca, et al.
Pubblicazione: (2025)
MX: Enhancing RISC-V's Vector ISA for Ultra-Low Overhead, Energy-Efficient Matrix Multiplication
di: Perotti, Matteo, et al.
Pubblicazione: (2024)
di: Perotti, Matteo, et al.
Pubblicazione: (2024)
Sparse-on-Dense: Area and Energy-Efficient Computing of Sparse Neural Networks on Dense Matrix Multiplication Accelerators
di: Yoon, Hyunsung, et al.
Pubblicazione: (2026)
di: Yoon, Hyunsung, et al.
Pubblicazione: (2026)
Theoretical Analysis of the Efficient-Memory Matrix Storage Method for Quantum Emulation Accelerators with Gate Fusion on FPGAs
di: Le, Tran Xuan Hieu, et al.
Pubblicazione: (2024)
di: Le, Tran Xuan Hieu, et al.
Pubblicazione: (2024)
MANOJAVAM: A Scalable, Unified FPGA Accelerator for Matrix Multiplication and Singular Value Decomposition in Principal Component Analysis
di: Ramasubramanian, Srivaths, et al.
Pubblicazione: (2026)
di: Ramasubramanian, Srivaths, et al.
Pubblicazione: (2026)
FAME: FPGA Acceleration of Secure Matrix Multiplication with Homomorphic Encryption
di: Xu, Zhihan, et al.
Pubblicazione: (2025)
di: Xu, Zhihan, et al.
Pubblicazione: (2025)
HAAN: A Holistic Approach for Accelerating Normalization Operations in Large Language Models
di: Peng, Tianfan, et al.
Pubblicazione: (2025)
di: Peng, Tianfan, et al.
Pubblicazione: (2025)
Leveraging FPGAs for Homomorphic Matrix-Vector Multiplication in Oblivious Message Retrieval
di: Bosworth, Grant, et al.
Pubblicazione: (2025)
di: Bosworth, Grant, et al.
Pubblicazione: (2025)
Investigating Energy Bounds of Analog Compute-in-Memory with Local Normalization
di: Rojkov, Brian, et al.
Pubblicazione: (2026)
di: Rojkov, Brian, et al.
Pubblicazione: (2026)
A Tensor-Train Decomposition based Compression of LLMs on Group Vector Systolic Accelerator
di: Huang, Sixiao, et al.
Pubblicazione: (2025)
di: Huang, Sixiao, et al.
Pubblicazione: (2025)
Basis Selection: Low-Rank Decomposition of Pretrained Large Language Models for Target Applications
di: Li, Yang, et al.
Pubblicazione: (2024)
di: Li, Yang, et al.
Pubblicazione: (2024)
SuperUROP: An FPGA-Based Spatial Accelerator for Sparse Matrix Operations
di: Parthasarathy, Rishab
Pubblicazione: (2025)
di: Parthasarathy, Rishab
Pubblicazione: (2025)
Veritas: Deterministic Verilog Code Synthesis from LLM-Generated Conjunctive Normal Form
di: Roy, Prithwish Basu, et al.
Pubblicazione: (2025)
di: Roy, Prithwish Basu, et al.
Pubblicazione: (2025)
Fast and Practical Strassen's Matrix Multiplication using FPGAs
di: Ahmad, Afzal, et al.
Pubblicazione: (2024)
di: Ahmad, Afzal, et al.
Pubblicazione: (2024)
FPGA-Optimized Hardware Accelerator for Fast Fourier Transform and Singular Value Decomposition in AI
di: Ding, Hong, et al.
Pubblicazione: (2025)
di: Ding, Hong, et al.
Pubblicazione: (2025)
MatrixFlow: System-Accelerator co-design for high-performance transformer applications
di: Liu, Qunyou, et al.
Pubblicazione: (2025)
di: Liu, Qunyou, et al.
Pubblicazione: (2025)
Virgo: Cluster-level Matrix Unit Integration in GPUs for Scalability and Energy Efficiency
di: Kim, Hansung, et al.
Pubblicazione: (2024)
di: Kim, Hansung, et al.
Pubblicazione: (2024)
FTTN: Feature-Targeted Testing for Numerical Properties of NVIDIA & AMD Matrix Accelerators
di: Li, Xinyi, et al.
Pubblicazione: (2024)
di: Li, Xinyi, et al.
Pubblicazione: (2024)
Revealing Untapped DSP Optimization Potentials for FPGA-Based Systolic Matrix Engines
di: Li, Jindong, et al.
Pubblicazione: (2024)
di: Li, Jindong, et al.
Pubblicazione: (2024)
Karatsuba Matrix Multiplication and its Efficient Custom Hardware Implementations
di: Pogue, Trevor E., et al.
Pubblicazione: (2025)
di: Pogue, Trevor E., et al.
Pubblicazione: (2025)
ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition
di: Zheng, Keran, et al.
Pubblicazione: (2025)
di: Zheng, Keran, et al.
Pubblicazione: (2025)
CuLifter: Lifting GPU Binaries to Typed IR
di: Zhao, Jisheng, et al.
Pubblicazione: (2026)
di: Zhao, Jisheng, et al.
Pubblicazione: (2026)
GCC: A 3DGS Inference Architecture with Gaussian-Wise and Cross-Stage Conditional Processing
di: Pei, Minnan, et al.
Pubblicazione: (2025)
di: Pei, Minnan, et al.
Pubblicazione: (2025)
VESTA: A Versatile SNN-Based Transformer Accelerator with Unified PEs for Multiple Computational Layers
di: Chen, Ching-Yao, et al.
Pubblicazione: (2025)
di: Chen, Ching-Yao, et al.
Pubblicazione: (2025)
A Digital SRAM-Based Compute-In-Memory Macro for Weight-Stationary Dynamic Matrix Multiplication in Transformer Attention Score Computation
di: Yu, Jianyi, et al.
Pubblicazione: (2025)
di: Yu, Jianyi, et al.
Pubblicazione: (2025)
Analog Solver Circuit for Linear Symmetric Positive-Definite Systems at a Complexity Independent of Matrix Size
di: Abdelaleim, Osama, et al.
Pubblicazione: (2025)
di: Abdelaleim, Osama, et al.
Pubblicazione: (2025)
Documenti analoghi
-
bitSMM: A bit-Serial Matrix Multiplication Accelerator
di: Antunes, Pedro, et al.
Pubblicazione: (2026) -
Floating-Point Multiply-Add with Approximate Normalization for Low-Cost Matrix Engines
di: Alexandridis, Kosmas, et al.
Pubblicazione: (2024) -
Co-Design of CNN Accelerators for TinyML using Approximate Matrix Decomposition
di: Morales, José Juan Hernández, et al.
Pubblicazione: (2026) -
Performance Analysis of Matrix Multiplication for Deep Learning on the Edge
di: Ramírez, Cristian, et al.
Pubblicazione: (2024) -
Empowering Vector Architectures for ML: The CAMP Architecture for Matrix Multiplication
di: Nojehdeh, Mohammadreza Esmali, et al.
Pubblicazione: (2025)