Hardware for converting floating-point to the microscaling (MX) format
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gorodecky, Danila, Sousa, Leonel |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Efficient Precision-Scalable Hardware for Microscaling (MX) Processing in Robotics Learning
par: Cuyckens, Stef, et autres
Publié: (2025)
par: Cuyckens, Stef, et autres
Publié: (2025)
Constant Depth Threshold Circuits For Exhaustive Epistasis Detection
par: Ribeiro, André, et autres
Publié: (2026)
par: Ribeiro, André, et autres
Publié: (2026)
VMXDOTP: A RISC-V Vector ISA Extension for Efficient Microscaling (MX) Format Acceleration
par: Wipfli, Max, et autres
Publié: (2026)
par: Wipfli, Max, et autres
Publié: (2026)
Exploring FPGA designs for MX and beyond
par: Samson, Ebby, et autres
Publié: (2024)
par: Samson, Ebby, et autres
Publié: (2024)
MX: Enhancing RISC-V's Vector ISA for Ultra-Low Overhead, Energy-Efficient Matrix Multiplication
par: Perotti, Matteo, et autres
Publié: (2024)
par: Perotti, Matteo, et autres
Publié: (2024)
MXDOTP: A RISC-V ISA Extension for Enabling Microscaling (MX) Floating-Point Dot Products
par: İslamoğlu, Gamze, et autres
Publié: (2025)
par: İslamoğlu, Gamze, et autres
Publié: (2025)
Sustainable Hardware Specialization
par: Dangi, Pranav, et autres
Publié: (2024)
par: Dangi, Pranav, et autres
Publié: (2024)
MX+: Pushing the Limits of Microscaling Formats for Efficient Large Language Model Serving
par: Lee, Jungi, et autres
Publié: (2025)
par: Lee, Jungi, et autres
Publié: (2025)
MixDiT: Accelerating Image Diffusion Transformer Inference with Mixed-Precision MX Quantization
par: Kim, Daeun, et autres
Publié: (2025)
par: Kim, Daeun, et autres
Publié: (2025)
Analyzing and Improving Hardware Modeling of Accel-Sim
par: Huerta, Rodrigo, et autres
Publié: (2024)
par: Huerta, Rodrigo, et autres
Publié: (2024)
QED: Scalable Verification of Hardware Memory Consistency
par: Ravi, Gokulan, et autres
Publié: (2024)
par: Ravi, Gokulan, et autres
Publié: (2024)
NeuroVM: Dynamic Neuromorphic Hardware Virtualization
par: Isik, Murat, et autres
Publié: (2024)
par: Isik, Murat, et autres
Publié: (2024)
In-Memory Computing Architecture for Efficient Hardware Security
par: Ajmi, Hala, et autres
Publié: (2024)
par: Ajmi, Hala, et autres
Publié: (2024)
Hardware and software build flow with SoCMake
par: Pejašinović, Risto, et autres
Publié: (2025)
par: Pejašinović, Risto, et autres
Publié: (2025)
Look-Up Table based Neural Network Hardware
par: Sen, Ovishake, et autres
Publié: (2024)
par: Sen, Ovishake, et autres
Publié: (2024)
A Power-Efficient Hardware Implementation of L-Mul
par: Chen, Ruiqi, et autres
Publié: (2024)
par: Chen, Ruiqi, et autres
Publié: (2024)
Hardware-Aware DNN Compression for Homogeneous Edge Devices
par: Zhang, Kunlong, et autres
Publié: (2025)
par: Zhang, Kunlong, et autres
Publié: (2025)
Direct Integer Division in RNS and its Hardware Solutions
par: Olsen, Eric B.
Publié: (2026)
par: Olsen, Eric B.
Publié: (2026)
Bombyx: OpenCilk Compilation for FPGA Hardware Acceleration
par: Shahawy, Mohamed, et autres
Publié: (2025)
par: Shahawy, Mohamed, et autres
Publié: (2025)
Closing the Gap Between Float and Posit Hardware Efficiency
par: Jonnalagadda, Aditya Anirudh, et autres
Publié: (2026)
par: Jonnalagadda, Aditya Anirudh, et autres
Publié: (2026)
HLStrans: Dataset for C-to-HLS Hardware Code Synthesis
par: Zou, Qingyun, et autres
Publié: (2025)
par: Zou, Qingyun, et autres
Publié: (2025)
An Efficient Sparse Hardware Accelerator for Spike-Driven Transformer
par: Li, Zhengke, et autres
Publié: (2025)
par: Li, Zhengke, et autres
Publié: (2025)
Taming Performance Variability caused by Client-Side Hardware Configuration
par: Antoniou, Georgia, et autres
Publié: (2024)
par: Antoniou, Georgia, et autres
Publié: (2024)
Xpikeformer: Hybrid Analog-Digital Hardware Acceleration for Spiking Transformers
par: Song, Zihang, et autres
Publié: (2024)
par: Song, Zihang, et autres
Publié: (2024)
MX-SAFE: Versatile Inference- and Training-Proof Microscaling Format with On-the-Fly Exponent and Mantissa Bit Allocation
par: Park, Dahoon, et autres
Publié: (2026)
par: Park, Dahoon, et autres
Publié: (2026)
Towards An Approach to Identify Divergences in Hardware Designs for HPC Workloads
par: Popovici, Doru Thom, et autres
Publié: (2025)
par: Popovici, Doru Thom, et autres
Publié: (2025)
HyDRA: Deadline and Reuse-Aware Cacheability for Hardware Accelerators
par: Agarwal, Ayushi, et autres
Publié: (2026)
par: Agarwal, Ayushi, et autres
Publié: (2026)
Energy-Efficient Hardware Acceleration of Whisper ASR on a CGLA
par: Ando, Takuto, et autres
Publié: (2025)
par: Ando, Takuto, et autres
Publié: (2025)
Static Hardware Partitioning on RISC-V -- Shortcomings, Limitations, and Prospects
par: Ramsauer, Ralf, et autres
Publié: (2022)
par: Ramsauer, Ralf, et autres
Publié: (2022)
Hardware Acceleration in Portable MRIs: State of the Art and Future Prospects
par: Habsi, Omar Al, et autres
Publié: (2025)
par: Habsi, Omar Al, et autres
Publié: (2025)
Hardware Acceleration of Kolmogorov-Arnold Network (KAN) for Lightweight Edge Inference
par: Huang, Wei-Hsing, et autres
Publié: (2024)
par: Huang, Wei-Hsing, et autres
Publié: (2024)
Educating for Hardware Specialization in the Chiplet Era: A Path for the HPC Community
par: Yoshii, Kazutomo, et autres
Publié: (2024)
par: Yoshii, Kazutomo, et autres
Publié: (2024)
ONNX-to-Hardware Design Flow for Adaptive Neural-Network Inference on FPGAs
par: Manca, Federico, et autres
Publié: (2024)
par: Manca, Federico, et autres
Publié: (2024)
Evaluating the Effectiveness of Microarchitectural Hardware Fault Detection for Application-Specific Requirements
par: Papadopoulos, Konstantinos-Nikolaos, et autres
Publié: (2024)
par: Papadopoulos, Konstantinos-Nikolaos, et autres
Publié: (2024)
FETTA: Flexible and Efficient Hardware Accelerator for Tensorized Neural Network Training
par: Lu, Jinming, et autres
Publié: (2025)
par: Lu, Jinming, et autres
Publié: (2025)
Hardware-Centric Analysis of DeepSeek's Multi-Head Latent Attention
par: Geens, Robin, et autres
Publié: (2025)
par: Geens, Robin, et autres
Publié: (2025)
Memory-Guided Unified Hardware Accelerator for Mixed-Precision Scientific Computing
par: Wang, Chuanzhen, et autres
Publié: (2026)
par: Wang, Chuanzhen, et autres
Publié: (2026)
TurboFuzz: FPGA Accelerated Hardware Fuzzing for Processor Agile Verification
par: Zhong, Yang, et autres
Publié: (2025)
par: Zhong, Yang, et autres
Publié: (2025)
CHAOS: Controlled Hardware fAult injectOr System for gem5
par: Vinciguerra, Elio, et autres
Publié: (2026)
par: Vinciguerra, Elio, et autres
Publié: (2026)
TTP: A Hardware-Efficient Design for Precise Prefetching in Ray Tracing
par: Tozlu, Yavuz Selim, et autres
Publié: (2026)
par: Tozlu, Yavuz Selim, et autres
Publié: (2026)
Documents similaires
-
Efficient Precision-Scalable Hardware for Microscaling (MX) Processing in Robotics Learning
par: Cuyckens, Stef, et autres
Publié: (2025) -
Constant Depth Threshold Circuits For Exhaustive Epistasis Detection
par: Ribeiro, André, et autres
Publié: (2026) -
VMXDOTP: A RISC-V Vector ISA Extension for Efficient Microscaling (MX) Format Acceleration
par: Wipfli, Max, et autres
Publié: (2026) -
Exploring FPGA designs for MX and beyond
par: Samson, Ebby, et autres
Publié: (2024) -
MX: Enhancing RISC-V's Vector ISA for Ultra-Low Overhead, Energy-Efficient Matrix Multiplication
par: Perotti, Matteo, et autres
Publié: (2024)