CIM-MLC: A Multi-level Compilation Stack for Computing-In-Memory Accelerators
Fuente:
arXiv
Salvato in:
| Autori principali: | Qu, Songyun, Zhao, Shixin, Li, Bing, He, Yintao, Cai, Xuyi, Zhang, Lei, Wang, Ying |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Be CIM or Be Memory: A Dual-mode-aware DNN Compiler for CIM Accelerators
di: Zhao, Shixin, et al.
Pubblicazione: (2025)
di: Zhao, Shixin, et al.
Pubblicazione: (2025)
Weight Block Sparsity: Training, Compilation, and AI Engine Accelerators
di: D'Alberto, Paolo, et al.
Pubblicazione: (2024)
di: D'Alberto, Paolo, et al.
Pubblicazione: (2024)
Optimization of 32-bit Unsigned Division by Constants on 64-bit Targets
di: Mitsunari, Shigeo, et al.
Pubblicazione: (2026)
di: Mitsunari, Shigeo, et al.
Pubblicazione: (2026)
A Compilation Framework for Quantum Circuits with Mid-Circuit Measurement Error Awareness
di: Zhong, Ming, et al.
Pubblicazione: (2025)
di: Zhong, Ming, et al.
Pubblicazione: (2025)
Inside VOLT: Designing an Open-Source GPU Compiler
di: Jeong, Shinnung, et al.
Pubblicazione: (2025)
di: Jeong, Shinnung, et al.
Pubblicazione: (2025)
Vectorization of Verilog Designs and its Effects on Verification and Synthesis
di: Guimarães, Maria Fernanda Oliveira, et al.
Pubblicazione: (2026)
di: Guimarães, Maria Fernanda Oliveira, et al.
Pubblicazione: (2026)
AccelCIM: Systematic Dataflow Exploration for SRAM Compute-in-Memory Accelerator
di: Xue, Chenhao, et al.
Pubblicazione: (2026)
di: Xue, Chenhao, et al.
Pubblicazione: (2026)
FusionCIM: Accelerating LLM Inference with Fusion-Driven Computing-in-Memory Architecture
di: Xuan, Zihao, et al.
Pubblicazione: (2026)
di: Xuan, Zihao, et al.
Pubblicazione: (2026)
Toward a Universal GPU Instruction Set Architecture: A Cross-Vendor Analysis of Hardware-Invariant Computational Primitives in Parallel Processors
di: Abraham, Ojima, et al.
Pubblicazione: (2026)
di: Abraham, Ojima, et al.
Pubblicazione: (2026)
RCW-CIM: A Digital CIM-based LLM Accelerator with Read-Compute/Write
di: Guo, Yan-Cheng, et al.
Pubblicazione: (2026)
di: Guo, Yan-Cheng, et al.
Pubblicazione: (2026)
CIM-Tuner: Balancing the Compute and Storage Capacity of SRAM-CIM Accelerator via Hardware-mapping Co-exploration
di: Chen, Jinwu, et al.
Pubblicazione: (2026)
di: Chen, Jinwu, et al.
Pubblicazione: (2026)
Ember: A Compiler for Efficient Embedding Operations on Decoupled Access-Execute Architectures
di: Siracusa, Marco, et al.
Pubblicazione: (2025)
di: Siracusa, Marco, et al.
Pubblicazione: (2025)
Ouroboros: Wafer-Scale SRAM CIM with Token-Grained Pipelining for Large Language Model Inference
di: Liu, Yiqi, et al.
Pubblicazione: (2026)
di: Liu, Yiqi, et al.
Pubblicazione: (2026)
Voxel-CIM: An Efficient Compute-in-Memory Accelerator for Voxel-based Point Cloud Neural Networks
di: Lin, Xipeng, et al.
Pubblicazione: (2024)
di: Lin, Xipeng, et al.
Pubblicazione: (2024)
A Flower-Inspired Solution for Computer Memory Wear-Leveling
di: Shen, Elizabeth, et al.
Pubblicazione: (2025)
di: Shen, Elizabeth, et al.
Pubblicazione: (2025)
Kernel Looping: Eliminating Synchronization Boundaries for Peak Inference Performance
di: Koeplinger, David, et al.
Pubblicazione: (2024)
di: Koeplinger, David, et al.
Pubblicazione: (2024)
Unicorn-CIM: Uncovering the Vulnerability and Improving the Resilience of High-Precision Compute-in-Memory
di: Li, Qiufeng, et al.
Pubblicazione: (2025)
di: Li, Qiufeng, et al.
Pubblicazione: (2025)
PAM: Processing Across Memory Hierarchy for Efficient KV-centric LLM Serving System
di: Liu, Lian, et al.
Pubblicazione: (2026)
di: Liu, Lian, et al.
Pubblicazione: (2026)
Hybrid SLC-MLC RRAM Mixed-Signal Processing-in-Memory Architecture for Transformer Acceleration via Gradient Redistribution
di: Song, Chang Eun, et al.
Pubblicazione: (2025)
di: Song, Chang Eun, et al.
Pubblicazione: (2025)
Noncontact Multi-Point Vital Sign Monitoring with mmWave MIMO Radar
di: Ren, Wei, et al.
Pubblicazione: (2024)
di: Ren, Wei, et al.
Pubblicazione: (2024)
Bottom-Up Generation of Verilog Designs for Testing EDA Tools
di: Vieira, João Victor Amorim, et al.
Pubblicazione: (2025)
di: Vieira, João Victor Amorim, et al.
Pubblicazione: (2025)
SynDCIM: A Performance-Aware Digital Computing-in-Memory Compiler with Multi-Spec-Oriented Subcircuit Synthesis
di: Shao, Kunming, et al.
Pubblicazione: (2024)
di: Shao, Kunming, et al.
Pubblicazione: (2024)
PIMCOMP: An End-to-End DNN Compiler for Processing-In-Memory Accelerators
di: Sun, Xiaotian, et al.
Pubblicazione: (2024)
di: Sun, Xiaotian, et al.
Pubblicazione: (2024)
SEGA-DCIM: Design Space Exploration-Guided Automatic Digital CIM Compiler with Multiple Precision Support
di: Diao, Haikang, et al.
Pubblicazione: (2025)
di: Diao, Haikang, et al.
Pubblicazione: (2025)
GEM3D CIM General Purpose Matrix Computation Using 3D Integrated SRAM eDRAM Hybrid Compute In Memory on Memory Architecture
di: Chakraborty, Subhradip, et al.
Pubblicazione: (2026)
di: Chakraborty, Subhradip, et al.
Pubblicazione: (2026)
CINM (Cinnamon): A Compilation Infrastructure for Heterogeneous Compute In-Memory and Compute Near-Memory Paradigms
di: Khan, Asif Ali, et al.
Pubblicazione: (2022)
di: Khan, Asif Ali, et al.
Pubblicazione: (2022)
3DGauCIM: Accelerating Static/Dynamic 3D Gaussian Splatting via Digital CIM for High Frame Rate Real-Time Edge Rendering
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2025)
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2025)
Balancing FP8 Computation Accuracy and Efficiency on Digital CIM via Shift-Aware On-the-fly Aligned-Mantissa Bitwidth Prediction
di: Zhao, Liang, et al.
Pubblicazione: (2026)
di: Zhao, Liang, et al.
Pubblicazione: (2026)
DS-CIM: Digital Stochastic Computing-In-Memory Featuring Accurate OR-Accumulation via Sample Region Remapping for Edge AI Models
di: Shao, Kunming, et al.
Pubblicazione: (2026)
di: Shao, Kunming, et al.
Pubblicazione: (2026)
Hardware/Algorithm Co-design for Real-Time I/O Control with Improved Timing Accuracy and Robustness
di: Jiang, Zhe, et al.
Pubblicazione: (2024)
di: Jiang, Zhe, et al.
Pubblicazione: (2024)
CIMinus: Empowering Sparse DNN Workloads Modeling and Exploration on SRAM-based CIM Architectures
di: Qi, Yingjie, et al.
Pubblicazione: (2025)
di: Qi, Yingjie, et al.
Pubblicazione: (2025)
EdgeCIM: A Hardware-Software Co-Design for CIM-Based Acceleration of Small Language Models
di: Bazzi, Jinane, et al.
Pubblicazione: (2026)
di: Bazzi, Jinane, et al.
Pubblicazione: (2026)
PC2IM: An Efficient In-Memory Computing Accelerator for 3D Point Cloud
di: Wang, Dengfeng, et al.
Pubblicazione: (2026)
di: Wang, Dengfeng, et al.
Pubblicazione: (2026)
Accelerating Multi-Scale Deformable Attention Using Near-Memory-Processing Architecture
di: Li, Huize, et al.
Pubblicazione: (2026)
di: Li, Huize, et al.
Pubblicazione: (2026)
Heterogeneous Memory Design Exploration for AI Accelerators with a Gain Cell Memory Compiler
di: Wang, Xinxin, et al.
Pubblicazione: (2026)
di: Wang, Xinxin, et al.
Pubblicazione: (2026)
Sky$^ε$-Tree: Embracing the Batch Updates of B$^ε$-trees through Access Port Parallelism on Skyrmion Racetrack Memory
di: Tsai, Yu-Shiang, et al.
Pubblicazione: (2024)
di: Tsai, Yu-Shiang, et al.
Pubblicazione: (2024)
CIMR-V: An End-to-End SRAM-based CIM Accelerator with RISC-V for AI Edge Device
di: and, Yan-Cheng Guo, et al.
Pubblicazione: (2025)
di: and, Yan-Cheng Guo, et al.
Pubblicazione: (2025)
Acore-CIM: build accurate and reliable mixed-signal CIM cores with RISC-V controlled self-calibration
di: Numan, Omar, et al.
Pubblicazione: (2025)
di: Numan, Omar, et al.
Pubblicazione: (2025)
Compiler Testing With Relaxed Memory Models
di: Geeson, Luke, et al.
Pubblicazione: (2023)
di: Geeson, Luke, et al.
Pubblicazione: (2023)
MIREDO: MIP-Driven Resource-Efficient Dataflow Optimization for Computing-in-Memory Accelerator
di: He, Xiaolin, et al.
Pubblicazione: (2025)
di: He, Xiaolin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Be CIM or Be Memory: A Dual-mode-aware DNN Compiler for CIM Accelerators
di: Zhao, Shixin, et al.
Pubblicazione: (2025) -
Weight Block Sparsity: Training, Compilation, and AI Engine Accelerators
di: D'Alberto, Paolo, et al.
Pubblicazione: (2024) -
Optimization of 32-bit Unsigned Division by Constants on 64-bit Targets
di: Mitsunari, Shigeo, et al.
Pubblicazione: (2026) -
A Compilation Framework for Quantum Circuits with Mid-Circuit Measurement Error Awareness
di: Zhong, Ming, et al.
Pubblicazione: (2025) -
Inside VOLT: Designing an Open-Source GPU Compiler
di: Jeong, Shinnung, et al.
Pubblicazione: (2025)