Data Transfer Optimizations for Host-CPU and Accelerators in AXI4MLIR
Fuente:
arXiv
Salvato in:
| Autori principali: | Haris, Jude, Agostini, Nicolas Bohm, Tumeo, Antonino, Kaeli, David, Cano, José |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AXI4MLIR: User-Driven Automatic Host Code Generation for Custom AXI-Based Accelerators
di: Agostini, Nicolas Bohm, et al.
Pubblicazione: (2023)
di: Agostini, Nicolas Bohm, et al.
Pubblicazione: (2023)
HEC: Equivalence Verification Checking for Code Transformation via Equality Saturation
di: Yin, Jiaqi, et al.
Pubblicazione: (2025)
di: Yin, Jiaqi, et al.
Pubblicazione: (2025)
PoTAcc: A Pipeline for End-to-End Acceleration of Power-of-Two Quantized DNNs
di: Saha, Rappy, et al.
Pubblicazione: (2026)
di: Saha, Rappy, et al.
Pubblicazione: (2026)
An Optimizing Framework on MLIR for Efficient FPGA-based Accelerator Generation
di: Zhang, Weichuang, et al.
Pubblicazione: (2024)
di: Zhang, Weichuang, et al.
Pubblicazione: (2024)
Practical Formal Verification for MLIR Programs
di: Tucker, Emily, et al.
Pubblicazione: (2026)
di: Tucker, Emily, et al.
Pubblicazione: (2026)
Building Bridges: Julia as an MLIR Frontend
di: Merckx, Jules
Pubblicazione: (2025)
di: Merckx, Jules
Pubblicazione: (2025)
MLIR-Forge: A Modular Framework for Language Smiths
di: Ates, Berke, et al.
Pubblicazione: (2026)
di: Ates, Berke, et al.
Pubblicazione: (2026)
Nice to Meet You: Synthesizing Practical MLIR Abstract Transformers
di: Peng, Xuanyu, et al.
Pubblicazione: (2025)
di: Peng, Xuanyu, et al.
Pubblicazione: (2025)
WAMI: Compilation to WebAssembly through MLIR without Losing Abstraction
di: Kang, Byeongjee, et al.
Pubblicazione: (2025)
di: Kang, Byeongjee, et al.
Pubblicazione: (2025)
An MLIR pipeline for offloading Fortran to FPGAs via OpenMP
di: Rodriguez-Canal, Gabriel, et al.
Pubblicazione: (2025)
di: Rodriguez-Canal, Gabriel, et al.
Pubblicazione: (2025)
The MLIR Transform Dialect. Your compiler is more powerful than you think
di: Lücke, Martin Paul, et al.
Pubblicazione: (2024)
di: Lücke, Martin Paul, et al.
Pubblicazione: (2024)
Accelerating Transposed Convolutions on FPGA-based Edge Devices
di: Haris, Jude, et al.
Pubblicazione: (2025)
di: Haris, Jude, et al.
Pubblicazione: (2025)
An MLIR Lowering Pipeline for Stencils at Wafer-Scale
di: Stawinoga, Nicolai, et al.
Pubblicazione: (2026)
di: Stawinoga, Nicolai, et al.
Pubblicazione: (2026)
F-BFQ: Flexible Block Floating-Point Quantization Accelerator for LLMs
di: Haris, Jude, et al.
Pubblicazione: (2025)
di: Haris, Jude, et al.
Pubblicazione: (2025)
Demonstrating a Future for MLIR-native DSL Compilers on a NumPy-like Example
di: Friebel, Karl F. A., et al.
Pubblicazione: (2026)
di: Friebel, Karl F. A., et al.
Pubblicazione: (2026)
Analyzing Latency Hiding and Parallelism in an MLIR-based AI Kernel Compiler
di: Absar, Javed, et al.
Pubblicazione: (2026)
di: Absar, Javed, et al.
Pubblicazione: (2026)
Fully integrating the Flang Fortran compiler with standard MLIR
di: Brown, Nick
Pubblicazione: (2024)
di: Brown, Nick
Pubblicazione: (2024)
Hexagon-MLIR: An AI Compilation Stack For Qualcomm's Neural Processing Units (NPUs)
di: Absar, Mohammed Javed, et al.
Pubblicazione: (2026)
di: Absar, Mohammed Javed, et al.
Pubblicazione: (2026)
MLIR-Smith: A Novel Random Program Generator for Evaluating Compiler Pipelines
di: Ates, Berke, et al.
Pubblicazione: (2026)
di: Ates, Berke, et al.
Pubblicazione: (2026)
Is It a Good Idea to Build an HLS Tool on Top of MLIR? Experience from Building the Dynamatic HLS Compiler
di: Xu, Jiahui, et al.
Pubblicazione: (2026)
di: Xu, Jiahui, et al.
Pubblicazione: (2026)
Hardware.jl - An MLIR-based Julia HLS Flow (Work in Progress)
di: Short, Benedict, et al.
Pubblicazione: (2025)
di: Short, Benedict, et al.
Pubblicazione: (2025)
Accelerating PoT Quantization on Edge Devices
di: Saha, Rappy, et al.
Pubblicazione: (2024)
di: Saha, Rappy, et al.
Pubblicazione: (2024)
Towards a high-performance AI compiler with upstream MLIR
di: Golin, Renato, et al.
Pubblicazione: (2024)
di: Golin, Renato, et al.
Pubblicazione: (2024)
DSP-MLIR: A MLIR Dialect for Digital Signal Processing
di: Kumar, Abhinav, et al.
Pubblicazione: (2024)
di: Kumar, Abhinav, et al.
Pubblicazione: (2024)
NeuraChip: Accelerating GNN Computations with a Hash-based Decoupled Spatial Accelerator
di: Shivdikar, Kaustubh, et al.
Pubblicazione: (2024)
di: Shivdikar, Kaustubh, et al.
Pubblicazione: (2024)
Designing Efficient LLM Accelerators for Edge Devices
di: Haris, Jude, et al.
Pubblicazione: (2024)
di: Haris, Jude, et al.
Pubblicazione: (2024)
Mojo: MLIR-Based Performance-Portable HPC Science Kernels on GPUs for the Python Ecosystem
di: Godoy, William F., et al.
Pubblicazione: (2025)
di: Godoy, William F., et al.
Pubblicazione: (2025)
LLM-Driven Design Space Exploration of FPGA-based Accelerators
di: Sharma, Vinamra, et al.
Pubblicazione: (2026)
di: Sharma, Vinamra, et al.
Pubblicazione: (2026)
CPU-less parallel execution of lambda calculus in digital logic
di: Fitchett, Harry, et al.
Pubblicazione: (2026)
di: Fitchett, Harry, et al.
Pubblicazione: (2026)
A Data-driven Analysis of Code Optimizations
di: Hakimi, Yacine, et al.
Pubblicazione: (2025)
di: Hakimi, Yacine, et al.
Pubblicazione: (2025)
Expression Acceleration: Seamless Parallelization of Typed High-Level Languages
di: Hummelgren, Lars, et al.
Pubblicazione: (2022)
di: Hummelgren, Lars, et al.
Pubblicazione: (2022)
Massimult: A Novel Parallel CPU Architecture Based on Combinator Reduction
di: Nicklisch-Franken, Jurgen, et al.
Pubblicazione: (2024)
di: Nicklisch-Franken, Jurgen, et al.
Pubblicazione: (2024)
An Optimizing Just-In-Time Compiler for Rotor
di: Trindade, João H., et al.
Pubblicazione: (2024)
di: Trindade, João H., et al.
Pubblicazione: (2024)
Cage: Hardware-Accelerated Safe WebAssembly
di: Fink, Martin, et al.
Pubblicazione: (2024)
di: Fink, Martin, et al.
Pubblicazione: (2024)
Sandwich: Joint Configuration Search and Hot-Switching for Efficient CPU LLM Serving
di: Zhao, Juntao, et al.
Pubblicazione: (2025)
di: Zhao, Juntao, et al.
Pubblicazione: (2025)
HPVM-HDC: A Heterogeneous Programming System for Accelerating Hyperdimensional Computing
di: Arbore, Russel, et al.
Pubblicazione: (2024)
di: Arbore, Russel, et al.
Pubblicazione: (2024)
Filling the Gaps of Polarity: Implementing Dependent Data and Codata Types with Implicit Arguments
di: Liesnikov, Bohdan, et al.
Pubblicazione: (2025)
di: Liesnikov, Bohdan, et al.
Pubblicazione: (2025)
Pushing Tensor Accelerators Beyond MatMul in a User-Schedulable Language
di: Zhang, Yihong, et al.
Pubblicazione: (2025)
di: Zhang, Yihong, et al.
Pubblicazione: (2025)
Exploiting Multiple Abstract Call Patterns for Optimizing Run-Time Checks
di: Ferreiro, Daniela, et al.
Pubblicazione: (2026)
di: Ferreiro, Daniela, et al.
Pubblicazione: (2026)
Automated Profile-Guided Replacement of Data Structures to Reduce Memory Allocation
di: Makor, Lukas, et al.
Pubblicazione: (2025)
di: Makor, Lukas, et al.
Pubblicazione: (2025)
Documenti analoghi
-
AXI4MLIR: User-Driven Automatic Host Code Generation for Custom AXI-Based Accelerators
di: Agostini, Nicolas Bohm, et al.
Pubblicazione: (2023) -
HEC: Equivalence Verification Checking for Code Transformation via Equality Saturation
di: Yin, Jiaqi, et al.
Pubblicazione: (2025) -
PoTAcc: A Pipeline for End-to-End Acceleration of Power-of-Two Quantized DNNs
di: Saha, Rappy, et al.
Pubblicazione: (2026) -
An Optimizing Framework on MLIR for Efficient FPGA-based Accelerator Generation
di: Zhang, Weichuang, et al.
Pubblicazione: (2024) -
Practical Formal Verification for MLIR Programs
di: Tucker, Emily, et al.
Pubblicazione: (2026)