Pushing Tensor Accelerators Beyond MatMul in a User-Schedulable Language
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Yihong, Gerstmann, Derek, Adams, Andrew, Ahmad, Maaz Bin Safeer |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Scalable MatMul-free Language Modeling
par: Zhu, Rui-Jie, et autres
Publié: (2024)
par: Zhu, Rui-Jie, et autres
Publié: (2024)
Assessing Tenstorrent's RISC-V MatMul Acceleration Capabilities
par: Cavagna, Hiari Pizzini, et autres
Publié: (2025)
par: Cavagna, Hiari Pizzini, et autres
Publié: (2025)
Changing Base Without Losing Pace: A GPU-Efficient Alternative to MatMul in DNNs
par: Ailon, Nir, et autres
Publié: (2025)
par: Ailon, Nir, et autres
Publié: (2025)
Chameleon: A MatMul-Free Temporal Convolutional Network Accelerator for End-to-End Few-Shot and Continual Learning from Sequential Data
par: Blanken, Douwe den, et autres
Publié: (2025)
par: Blanken, Douwe den, et autres
Publié: (2025)
SparseAuto: An Auto-Scheduler for Sparse Tensor Computations Using Recursive Loop Nest Restructuring
par: Dias, Adhitha, et autres
Publié: (2023)
par: Dias, Adhitha, et autres
Publié: (2023)
Domain-Specific Tensor Languages
par: Bernardy, Jean-Philippe, et autres
Publié: (2023)
par: Bernardy, Jean-Philippe, et autres
Publié: (2023)
Exo 2: Growing a Scheduling Language
par: Ikarashi, Yuka, et autres
Publié: (2024)
par: Ikarashi, Yuka, et autres
Publié: (2024)
Nautilus: An Auto-Scheduling Tensor Compiler for Efficient Tiled GPU Kernels
par: Zhao, Yifan, et autres
Publié: (2026)
par: Zhao, Yifan, et autres
Publié: (2026)
LLM-Aided Compilation for Tensor Accelerators
par: Hong, Charles, et autres
Publié: (2024)
par: Hong, Charles, et autres
Publié: (2024)
A Solver-Aided Hierarchical Language for LLM-Driven CAD Design
par: Jones, Benjamin T., et autres
Publié: (2025)
par: Jones, Benjamin T., et autres
Publié: (2025)
Mat2Boundary: Treating User-Defined Boundary Condition as SpMV for Distributed PDE Solvers on Block-Structured Grids
par: Cai, Yanzheng, et autres
Publié: (2026)
par: Cai, Yanzheng, et autres
Publié: (2026)
Effects and Coeffects in Call-By-Push-Value (Extended Version)
par: Torczon, Cassia, et autres
Publié: (2023)
par: Torczon, Cassia, et autres
Publié: (2023)
Verifying Correctness of Shared Channels in a Cooperatively Scheduled Process-Oriented Language
par: Pedersen, Jan, et autres
Publié: (2025)
par: Pedersen, Jan, et autres
Publié: (2025)
How Programming Concepts and Neurons Are Shared in Code Language Models
par: Kargaran, Amir Hossein, et autres
Publié: (2025)
par: Kargaran, Amir Hossein, et autres
Publié: (2025)
ACT: Automatically Generating Compiler Backends from Tensor Accelerator ISA Descriptions
par: Jain, Devansh, et autres
Publié: (2025)
par: Jain, Devansh, et autres
Publié: (2025)
Rewrite System Showdown: Stochastic Search vs. EqSat
par: Hong, Qiantan, et autres
Publié: (2026)
par: Hong, Qiantan, et autres
Publié: (2026)
CLMTracing: Black-box User-level Watermarking for Code Language Model Tracing
par: Zhang, Boyu, et autres
Publié: (2025)
par: Zhang, Boyu, et autres
Publié: (2025)
Semantic foundations of equality saturation
par: Suciu, Dan, et autres
Publié: (2025)
par: Suciu, Dan, et autres
Publié: (2025)
Expression Acceleration: Seamless Parallelization of Typed High-Level Languages
par: Hummelgren, Lars, et autres
Publié: (2022)
par: Hummelgren, Lars, et autres
Publié: (2022)
Abstract Operational Methods for Call-by-Push-Value
par: Goncharov, Sergey, et autres
Publié: (2024)
par: Goncharov, Sergey, et autres
Publié: (2024)
Autocomp: A Powerful and Portable Code Optimizer for Tensor Accelerators
par: Hong, Charles, et autres
Publié: (2025)
par: Hong, Charles, et autres
Publié: (2025)
Monk: Opportunistic Scheduling to Delay Horizontal Scaling
par: Shimchenko, Marina, et autres
Publié: (2025)
par: Shimchenko, Marina, et autres
Publié: (2025)
Task-Based Tensor Computations on Modern GPUs
par: Yadav, Rohan, et autres
Publié: (2025)
par: Yadav, Rohan, et autres
Publié: (2025)
The Continuous Tensor Abstraction: Where Indices are Real
par: Won, Jaeyeon, et autres
Publié: (2024)
par: Won, Jaeyeon, et autres
Publié: (2024)
HaliVer: Deductive Verification and Scheduling Languages Join Forces
par: Haak, Lars B. van den, et autres
Publié: (2024)
par: Haak, Lars B. van den, et autres
Publié: (2024)
LLMigrate: Transforming "Lazy" Large Language Models into Efficient Source Code Migrators
par: Liu, Yuchen, et autres
Publié: (2025)
par: Liu, Yuchen, et autres
Publié: (2025)
Scheduling Garbage Collection for Energy Efficiency on Asymmetric Multicore Processors
par: Shimchenko, Marina, et autres
Publié: (2024)
par: Shimchenko, Marina, et autres
Publié: (2024)
Tensor Evolution: A Framework for Fast Evaluation of Tensor Computations using Recurrences
par: Absar, Javed, et autres
Publié: (2025)
par: Absar, Javed, et autres
Publié: (2025)
TENSURE: Fuzzing Sparse Tensor Compilers (Registered Report)
par: Mahathevan, Kabilan, et autres
Publié: (2026)
par: Mahathevan, Kabilan, et autres
Publié: (2026)
SkyEgg: Joint Implementation Selection and Scheduling for Hardware Synthesis using E-graphs
par: Xiao, Youwei, et autres
Publié: (2025)
par: Xiao, Youwei, et autres
Publié: (2025)
DITRON: Distributed Multi-level Tiling Compiler for Parallel Tensor Programs
par: Zheng, Size, et autres
Publié: (2026)
par: Zheng, Size, et autres
Publié: (2026)
Cedar: A New Language for Expressive, Fast, Safe, and Analyzable Authorization (Extended Version)
par: Cutler, Joseph W., et autres
Publié: (2024)
par: Cutler, Joseph W., et autres
Publié: (2024)
Tenspiler: A Verified Lifting-Based Compiler for Tensor Operations (Extended Version)
par: Qiu, Jie, et autres
Publié: (2024)
par: Qiu, Jie, et autres
Publié: (2024)
Scheduling Languages: A Past, Present, and Future Taxonomy
par: Hall, Mary, et autres
Publié: (2024)
par: Hall, Mary, et autres
Publié: (2024)
Galley: Modern Query Optimization for Sparse Tensor Programs
par: Deeds, Kyle, et autres
Publié: (2024)
par: Deeds, Kyle, et autres
Publié: (2024)
Dual-Numbers Reverse AD for Functional Array Languages
par: Smeding, Tom, et autres
Publié: (2025)
par: Smeding, Tom, et autres
Publié: (2025)
Beyond SICP -- Design and Implementation of a Notional Machine for Scheme
par: Abad, Kyriel, et autres
Publié: (2024)
par: Abad, Kyriel, et autres
Publié: (2024)
Disassembly as Weighted Interval Scheduling with Learned Weights
par: Flores-Montoya, Antonio, et autres
Publié: (2025)
par: Flores-Montoya, Antonio, et autres
Publié: (2025)
Hybrid Structured Editing: Structures for Tools, Text for Users
par: Beckmann, Tom, et autres
Publié: (2026)
par: Beckmann, Tom, et autres
Publié: (2026)
Cage: Hardware-Accelerated Safe WebAssembly
par: Fink, Martin, et autres
Publié: (2024)
par: Fink, Martin, et autres
Publié: (2024)
Documents similaires
-
Scalable MatMul-free Language Modeling
par: Zhu, Rui-Jie, et autres
Publié: (2024) -
Assessing Tenstorrent's RISC-V MatMul Acceleration Capabilities
par: Cavagna, Hiari Pizzini, et autres
Publié: (2025) -
Changing Base Without Losing Pace: A GPU-Efficient Alternative to MatMul in DNNs
par: Ailon, Nir, et autres
Publié: (2025) -
Chameleon: A MatMul-Free Temporal Convolutional Network Accelerator for End-to-End Few-Shot and Continual Learning from Sequential Data
par: Blanken, Douwe den, et autres
Publié: (2025) -
SparseAuto: An Auto-Scheduler for Sparse Tensor Computations Using Recursive Loop Nest Restructuring
par: Dias, Adhitha, et autres
Publié: (2023)