RCW-CIM: A Digital CIM-based LLM Accelerator with Read-Compute/Write
Fuente:
arXiv
Salvato in:
| Autori principali: | Guo, Yan-Cheng, Chang, Tian-Sheuan, Su, Jian-Wei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CIMR-V: An End-to-End SRAM-based CIM Accelerator with RISC-V for AI Edge Device
di: and, Yan-Cheng Guo, et al.
Pubblicazione: (2025)
di: and, Yan-Cheng Guo, et al.
Pubblicazione: (2025)
3DGauCIM: Accelerating Static/Dynamic 3D Gaussian Splatting via Digital CIM for High Frame Rate Real-Time Edge Rendering
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2025)
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2025)
Be CIM or Be Memory: A Dual-mode-aware DNN Compiler for CIM Accelerators
di: Zhao, Shixin, et al.
Pubblicazione: (2025)
di: Zhao, Shixin, et al.
Pubblicazione: (2025)
FusionCIM: Accelerating LLM Inference with Fusion-Driven Computing-in-Memory Architecture
di: Xuan, Zihao, et al.
Pubblicazione: (2026)
di: Xuan, Zihao, et al.
Pubblicazione: (2026)
CIM-Tuner: Balancing the Compute and Storage Capacity of SRAM-CIM Accelerator via Hardware-mapping Co-exploration
di: Chen, Jinwu, et al.
Pubblicazione: (2026)
di: Chen, Jinwu, et al.
Pubblicazione: (2026)
AccelCIM: Systematic Dataflow Exploration for SRAM Compute-in-Memory Accelerator
di: Xue, Chenhao, et al.
Pubblicazione: (2026)
di: Xue, Chenhao, et al.
Pubblicazione: (2026)
VitaLLM: A Versatile, Ultra-Compact Ternary LLM Accelerator with Dependency-Aware Scheduling
di: Lin, Zi-Wei, et al.
Pubblicazione: (2026)
di: Lin, Zi-Wei, et al.
Pubblicazione: (2026)
VitaLLM: A Versatile and Tiny Accelerator for Mixed-Precision LLM Inference on Edge Devices
di: Lin, Zi-Wei, et al.
Pubblicazione: (2026)
di: Lin, Zi-Wei, et al.
Pubblicazione: (2026)
Voxel-CIM: An Efficient Compute-in-Memory Accelerator for Voxel-based Point Cloud Neural Networks
di: Lin, Xipeng, et al.
Pubblicazione: (2024)
di: Lin, Xipeng, et al.
Pubblicazione: (2024)
EdgeCIM: A Hardware-Software Co-Design for CIM-Based Acceleration of Small Language Models
di: Bazzi, Jinane, et al.
Pubblicazione: (2026)
di: Bazzi, Jinane, et al.
Pubblicazione: (2026)
Hardware Efficient Accelerator for Spiking Transformer With Reconfigurable Parallel Time Step Computing
di: Chen, Bo-Yu, et al.
Pubblicazione: (2025)
di: Chen, Bo-Yu, et al.
Pubblicazione: (2025)
Acore-CIM: build accurate and reliable mixed-signal CIM cores with RISC-V controlled self-calibration
di: Numan, Omar, et al.
Pubblicazione: (2025)
di: Numan, Omar, et al.
Pubblicazione: (2025)
StreamDCIM: A Tile-based Streaming Digital CIM Accelerator with Mixed-stationary Cross-forwarding Dataflow for Multimodal Transformer
di: Qin, Shantian, et al.
Pubblicazione: (2025)
di: Qin, Shantian, et al.
Pubblicazione: (2025)
Unicorn-CIM: Uncovering the Vulnerability and Improving the Resilience of High-Precision Compute-in-Memory
di: Li, Qiufeng, et al.
Pubblicazione: (2025)
di: Li, Qiufeng, et al.
Pubblicazione: (2025)
Balancing FP8 Computation Accuracy and Efficiency on Digital CIM via Shift-Aware On-the-fly Aligned-Mantissa Bitwidth Prediction
di: Zhao, Liang, et al.
Pubblicazione: (2026)
di: Zhao, Liang, et al.
Pubblicazione: (2026)
A Low-Power Sparse Deep Learning Accelerator with Optimized Data Reuse
di: Hsu, Kai-Chieh, et al.
Pubblicazione: (2025)
di: Hsu, Kai-Chieh, et al.
Pubblicazione: (2025)
VESTA: A Versatile SNN-Based Transformer Accelerator with Unified PEs for Multiple Computational Layers
di: Chen, Ching-Yao, et al.
Pubblicazione: (2025)
di: Chen, Ching-Yao, et al.
Pubblicazione: (2025)
Computing-In-Memory Aware Model Adaption For Edge Devices
di: Lin, Ming-Han, et al.
Pubblicazione: (2025)
di: Lin, Ming-Han, et al.
Pubblicazione: (2025)
CIMFlow: An Integrated Framework for Systematic Design and Evaluation of Digital CIM Architectures
di: Qi, Yingjie, et al.
Pubblicazione: (2025)
di: Qi, Yingjie, et al.
Pubblicazione: (2025)
High-Level Surface Code Decoding via Parallel FFNNs on CIM Platforms
di: Wang, Hao, et al.
Pubblicazione: (2024)
di: Wang, Hao, et al.
Pubblicazione: (2024)
CIMinus: Empowering Sparse DNN Workloads Modeling and Exploration on SRAM-based CIM Architectures
di: Qi, Yingjie, et al.
Pubblicazione: (2025)
di: Qi, Yingjie, et al.
Pubblicazione: (2025)
CIMple: Standard-cell SRAM-based CIM with LUT-based split softmax for attention acceleration
di: Ahn, Bas, et al.
Pubblicazione: (2026)
di: Ahn, Bas, et al.
Pubblicazione: (2026)
SEGA-DCIM: Design Space Exploration-Guided Automatic Digital CIM Compiler with Multiple Precision Support
di: Diao, Haikang, et al.
Pubblicazione: (2025)
di: Diao, Haikang, et al.
Pubblicazione: (2025)
CIM-MLC: A Multi-level Compilation Stack for Computing-In-Memory Accelerators
di: Qu, Songyun, et al.
Pubblicazione: (2024)
di: Qu, Songyun, et al.
Pubblicazione: (2024)
DS-CIM: Digital Stochastic Computing-In-Memory Featuring Accurate OR-Accumulation via Sample Region Remapping for Edge AI Models
di: Shao, Kunming, et al.
Pubblicazione: (2026)
di: Shao, Kunming, et al.
Pubblicazione: (2026)
NASiC: 3D NAND-based CAM-Selected Multibit CIM Architecture for Efficient On-Device Mixture-of-Experts LLM Inference
di: Xu, Weikai, et al.
Pubblicazione: (2026)
di: Xu, Weikai, et al.
Pubblicazione: (2026)
An Efficient Data Reuse with Tile-Based Adaptive Stationary for Transformer Accelerators
di: Li, Tseng-Jen, et al.
Pubblicazione: (2025)
di: Li, Tseng-Jen, et al.
Pubblicazione: (2025)
Low Power Vision Transformer Accelerator with Hardware-Aware Pruning and Optimized Dataflow
di: Hsiung, Ching-Lin, et al.
Pubblicazione: (2025)
di: Hsiung, Ching-Lin, et al.
Pubblicazione: (2025)
Ouroboros: Wafer-Scale SRAM CIM with Token-Grained Pipelining for Large Language Model Inference
di: Liu, Yiqi, et al.
Pubblicazione: (2026)
di: Liu, Yiqi, et al.
Pubblicazione: (2026)
UniCAIM: A Unified CAM/CIM Architecture with Static-Dynamic KV Cache Pruning for Efficient Long-Context LLM Inference
di: Xu, Weikai, et al.
Pubblicazione: (2025)
di: Xu, Weikai, et al.
Pubblicazione: (2025)
CLSA-CIM: A Cross-Layer Scheduling Approach for Computing-in-Memory Architectures
di: Pelke, Rebecca, et al.
Pubblicazione: (2024)
di: Pelke, Rebecca, et al.
Pubblicazione: (2024)
GEM3D CIM General Purpose Matrix Computation Using 3D Integrated SRAM eDRAM Hybrid Compute In Memory on Memory Architecture
di: Chakraborty, Subhradip, et al.
Pubblicazione: (2026)
di: Chakraborty, Subhradip, et al.
Pubblicazione: (2026)
A 129FPS Full HD Real-Time Accelerator for 3D Gaussian Splatting
di: Chang, Fang-Chi, et al.
Pubblicazione: (2026)
di: Chang, Fang-Chi, et al.
Pubblicazione: (2026)
ASDR: Exploiting Adaptive Sampling and Data Reuse for CIM-based Instant Neural Rendering
di: Liu, Fangxin, et al.
Pubblicazione: (2025)
di: Liu, Fangxin, et al.
Pubblicazione: (2025)
A 28nm 1.80Mb/mm2 Digital/Analog Hybrid SRAM-CIM Macro Using 2D-Weighted Capacitor Array for Complex Number Mac Operations
di: Konno, Shota, et al.
Pubblicazione: (2025)
di: Konno, Shota, et al.
Pubblicazione: (2025)
H3DFact: Heterogeneous 3D Integrated CIM for Factorization with Holographic Perceptual Representations
di: Wan, Zishen, et al.
Pubblicazione: (2024)
di: Wan, Zishen, et al.
Pubblicazione: (2024)
A 71.2-$μ$W Speech Recognition Accelerator with Recurrent Spiking Neural Network
di: Yang, Chih-Chyau, et al.
Pubblicazione: (2025)
di: Yang, Chih-Chyau, et al.
Pubblicazione: (2025)
Enhancing Finite State Machine Design Automation with Large Language Models and Prompt Engineering Techniques
di: Lin, Qun-Kai, et al.
Pubblicazione: (2025)
di: Lin, Qun-Kai, et al.
Pubblicazione: (2025)
Dynamic Gradient Sparse Update for Edge Training
di: Li, I-Hsuan, et al.
Pubblicazione: (2025)
di: Li, I-Hsuan, et al.
Pubblicazione: (2025)
A 14uJ/Decision Keyword Spotting Accelerator with In-SRAM-Computing and On Chip Learning for Customization
di: Chiang, Yu-Hsiang, et al.
Pubblicazione: (2022)
di: Chiang, Yu-Hsiang, et al.
Pubblicazione: (2022)
Documenti analoghi
-
CIMR-V: An End-to-End SRAM-based CIM Accelerator with RISC-V for AI Edge Device
di: and, Yan-Cheng Guo, et al.
Pubblicazione: (2025) -
3DGauCIM: Accelerating Static/Dynamic 3D Gaussian Splatting via Digital CIM for High Frame Rate Real-Time Edge Rendering
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2025) -
Be CIM or Be Memory: A Dual-mode-aware DNN Compiler for CIM Accelerators
di: Zhao, Shixin, et al.
Pubblicazione: (2025) -
FusionCIM: Accelerating LLM Inference with Fusion-Driven Computing-in-Memory Architecture
di: Xuan, Zihao, et al.
Pubblicazione: (2026) -
CIM-Tuner: Balancing the Compute and Storage Capacity of SRAM-CIM Accelerator via Hardware-mapping Co-exploration
di: Chen, Jinwu, et al.
Pubblicazione: (2026)