Salvato in:
| Autori principali: | Zhao, Liang, Shao, Kunming, Liao, Zhipeng, Huang, Xijie, Cheng, Tim Kwang-Ting, Tsui, Chi-Ying, Zou, Yi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.05743 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DS-CIM: Digital Stochastic Computing-In-Memory Featuring Accurate OR-Accumulation via Sample Region Remapping for Edge AI Models
di: Shao, Kunming, et al.
Pubblicazione: (2026)
di: Shao, Kunming, et al.
Pubblicazione: (2026)
DIRC-RAG: Accelerating Edge RAG with Robust High-Density and High-Loading-Bandwidth Digital In-ReRAM Computation
di: Shao, Kunming, et al.
Pubblicazione: (2025)
di: Shao, Kunming, et al.
Pubblicazione: (2025)
A Memory-Efficient Retrieval Architecture for RAG-Enabled Wearable Medical LLMs-Agents
di: Liao, Zhipeng, et al.
Pubblicazione: (2025)
di: Liao, Zhipeng, et al.
Pubblicazione: (2025)
A Flexible Precision Scaling Deep Neural Network Accelerator with Efficient Weight Combination
di: Zhao, Liang, et al.
Pubblicazione: (2025)
di: Zhao, Liang, et al.
Pubblicazione: (2025)
SynDCIM: A Performance-Aware Digital Computing-in-Memory Compiler with Multi-Spec-Oriented Subcircuit Synthesis
di: Shao, Kunming, et al.
Pubblicazione: (2024)
di: Shao, Kunming, et al.
Pubblicazione: (2024)
RCW-CIM: A Digital CIM-based LLM Accelerator with Read-Compute/Write
di: Guo, Yan-Cheng, et al.
Pubblicazione: (2026)
di: Guo, Yan-Cheng, et al.
Pubblicazione: (2026)
LLM-FP4: 4-Bit Floating-Point Quantized Transformers
di: Liu, Shih-yang, et al.
Pubblicazione: (2023)
di: Liu, Shih-yang, et al.
Pubblicazione: (2023)
CIM-Tuner: Balancing the Compute and Storage Capacity of SRAM-CIM Accelerator via Hardware-mapping Co-exploration
di: Chen, Jinwu, et al.
Pubblicazione: (2026)
di: Chen, Jinwu, et al.
Pubblicazione: (2026)
Be CIM or Be Memory: A Dual-mode-aware DNN Compiler for CIM Accelerators
di: Zhao, Shixin, et al.
Pubblicazione: (2025)
di: Zhao, Shixin, et al.
Pubblicazione: (2025)
MixFP4: Enhancing NVFP4 with Adaptive FP4/INT4 Block Representations
di: Zou, Jiaxiang, et al.
Pubblicazione: (2026)
di: Zou, Jiaxiang, et al.
Pubblicazione: (2026)
3DGauCIM: Accelerating Static/Dynamic 3D Gaussian Splatting via Digital CIM for High Frame Rate Real-Time Edge Rendering
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2025)
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2025)
31.1 A 14.08-to-135.69Token/s ReRAM-on-Logic Stacked Outlier-Free Large-Language-Model Accelerator with Block-Clustered Weight-Compression and Adaptive Parallel-Speculative-Decoding
di: Dong, Pingcheng, et al.
Pubblicazione: (2026)
di: Dong, Pingcheng, et al.
Pubblicazione: (2026)
Acore-CIM: build accurate and reliable mixed-signal CIM cores with RISC-V controlled self-calibration
di: Numan, Omar, et al.
Pubblicazione: (2025)
di: Numan, Omar, et al.
Pubblicazione: (2025)
SEGA-DCIM: Design Space Exploration-Guided Automatic Digital CIM Compiler with Multiple Precision Support
di: Diao, Haikang, et al.
Pubblicazione: (2025)
di: Diao, Haikang, et al.
Pubblicazione: (2025)
CIMFlow: An Integrated Framework for Systematic Design and Evaluation of Digital CIM Architectures
di: Qi, Yingjie, et al.
Pubblicazione: (2025)
di: Qi, Yingjie, et al.
Pubblicazione: (2025)
MX-SAFE: Versatile Inference- and Training-Proof Microscaling Format with On-the-Fly Exponent and Mantissa Bit Allocation
di: Park, Dahoon, et al.
Pubblicazione: (2026)
di: Park, Dahoon, et al.
Pubblicazione: (2026)
StreamDCIM: A Tile-based Streaming Digital CIM Accelerator with Mixed-stationary Cross-forwarding Dataflow for Multimodal Transformer
di: Qin, Shantian, et al.
Pubblicazione: (2025)
di: Qin, Shantian, et al.
Pubblicazione: (2025)
MGS: Markov Greedy Sums for Accurate Low-Bitwidth Floating-Point Accumulation
di: Natesh, Vikas, et al.
Pubblicazione: (2025)
di: Natesh, Vikas, et al.
Pubblicazione: (2025)
AccelCIM: Systematic Dataflow Exploration for SRAM Compute-in-Memory Accelerator
di: Xue, Chenhao, et al.
Pubblicazione: (2026)
di: Xue, Chenhao, et al.
Pubblicazione: (2026)
EdgeCIM: A Hardware-Software Co-Design for CIM-Based Acceleration of Small Language Models
di: Bazzi, Jinane, et al.
Pubblicazione: (2026)
di: Bazzi, Jinane, et al.
Pubblicazione: (2026)
Unicorn-CIM: Uncovering the Vulnerability and Improving the Resilience of High-Precision Compute-in-Memory
di: Li, Qiufeng, et al.
Pubblicazione: (2025)
di: Li, Qiufeng, et al.
Pubblicazione: (2025)
High-Level Surface Code Decoding via Parallel FFNNs on CIM Platforms
di: Wang, Hao, et al.
Pubblicazione: (2024)
di: Wang, Hao, et al.
Pubblicazione: (2024)
FusionCIM: Accelerating LLM Inference with Fusion-Driven Computing-in-Memory Architecture
di: Xuan, Zihao, et al.
Pubblicazione: (2026)
di: Xuan, Zihao, et al.
Pubblicazione: (2026)
CIMinus: Empowering Sparse DNN Workloads Modeling and Exploration on SRAM-based CIM Architectures
di: Qi, Yingjie, et al.
Pubblicazione: (2025)
di: Qi, Yingjie, et al.
Pubblicazione: (2025)
CIMple: Standard-cell SRAM-based CIM with LUT-based split softmax for attention acceleration
di: Ahn, Bas, et al.
Pubblicazione: (2026)
di: Ahn, Bas, et al.
Pubblicazione: (2026)
Voxel-CIM: An Efficient Compute-in-Memory Accelerator for Voxel-based Point Cloud Neural Networks
di: Lin, Xipeng, et al.
Pubblicazione: (2024)
di: Lin, Xipeng, et al.
Pubblicazione: (2024)
Ouroboros: Wafer-Scale SRAM CIM with Token-Grained Pipelining for Large Language Model Inference
di: Liu, Yiqi, et al.
Pubblicazione: (2026)
di: Liu, Yiqi, et al.
Pubblicazione: (2026)
CIMR-V: An End-to-End SRAM-based CIM Accelerator with RISC-V for AI Edge Device
di: and, Yan-Cheng Guo, et al.
Pubblicazione: (2025)
di: and, Yan-Cheng Guo, et al.
Pubblicazione: (2025)
Enhancing CGRA Efficiency Through Aligned Compute and Communication Provisioning
di: Li, Zhaoying, et al.
Pubblicazione: (2024)
di: Li, Zhaoying, et al.
Pubblicazione: (2024)
Faster Inference of LLMs using FP8 on the Intel Gaudi
di: Lee, Joonhyung, et al.
Pubblicazione: (2025)
di: Lee, Joonhyung, et al.
Pubblicazione: (2025)
A 28nm 1.80Mb/mm2 Digital/Analog Hybrid SRAM-CIM Macro Using 2D-Weighted Capacitor Array for Complex Number Mac Operations
di: Konno, Shota, et al.
Pubblicazione: (2025)
di: Konno, Shota, et al.
Pubblicazione: (2025)
Hardware-Efficient CNNs: Interleaved Approximate FP32 Multipliers for Kernel Computation
di: Gowda, Bindu G, et al.
Pubblicazione: (2025)
di: Gowda, Bindu G, et al.
Pubblicazione: (2025)
DGEMM without FP64 Arithmetic - Using FP64 Emulation and FP8 Tensor Cores with Ozaki Scheme
di: Mukunoki, Daichi
Pubblicazione: (2025)
di: Mukunoki, Daichi
Pubblicazione: (2025)
APSQ: Additive Partial Sum Quantization with Algorithm-Hardware Co-Design
di: Tan, Yonghao, et al.
Pubblicazione: (2025)
di: Tan, Yonghao, et al.
Pubblicazione: (2025)
NASiC: 3D NAND-based CAM-Selected Multibit CIM Architecture for Efficient On-Device Mixture-of-Experts LLM Inference
di: Xu, Weikai, et al.
Pubblicazione: (2026)
di: Xu, Weikai, et al.
Pubblicazione: (2026)
UniCAIM: A Unified CAM/CIM Architecture with Static-Dynamic KV Cache Pruning for Efficient Long-Context LLM Inference
di: Xu, Weikai, et al.
Pubblicazione: (2025)
di: Xu, Weikai, et al.
Pubblicazione: (2025)
FIGLUT: An Energy-Efficient Accelerator Design for FP-INT GEMM Using Look-Up Tables
di: Park, Gunho, et al.
Pubblicazione: (2025)
di: Park, Gunho, et al.
Pubblicazione: (2025)
GEM3D CIM General Purpose Matrix Computation Using 3D Integrated SRAM eDRAM Hybrid Compute In Memory on Memory Architecture
di: Chakraborty, Subhradip, et al.
Pubblicazione: (2026)
di: Chakraborty, Subhradip, et al.
Pubblicazione: (2026)
TMA-Adaptive FP8 Grouped GEMM: Eliminating Padding Requirements in Low-Precision Training and Inference on Hopper
di: Su, Zhongling, et al.
Pubblicazione: (2025)
di: Su, Zhongling, et al.
Pubblicazione: (2025)
Shift-Left Techniques in Electronic Design Automation: A Survey
di: Wu, Xinyue, et al.
Pubblicazione: (2025)
di: Wu, Xinyue, et al.
Pubblicazione: (2025)
Documenti analoghi
-
DS-CIM: Digital Stochastic Computing-In-Memory Featuring Accurate OR-Accumulation via Sample Region Remapping for Edge AI Models
di: Shao, Kunming, et al.
Pubblicazione: (2026) -
DIRC-RAG: Accelerating Edge RAG with Robust High-Density and High-Loading-Bandwidth Digital In-ReRAM Computation
di: Shao, Kunming, et al.
Pubblicazione: (2025) -
A Memory-Efficient Retrieval Architecture for RAG-Enabled Wearable Medical LLMs-Agents
di: Liao, Zhipeng, et al.
Pubblicazione: (2025) -
A Flexible Precision Scaling Deep Neural Network Accelerator with Efficient Weight Combination
di: Zhao, Liang, et al.
Pubblicazione: (2025) -
SynDCIM: A Performance-Aware Digital Computing-in-Memory Compiler with Multi-Spec-Oriented Subcircuit Synthesis
di: Shao, Kunming, et al.
Pubblicazione: (2024)