Efficient yet Accurate End-to-End SC Accelerator Design
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Meng, Hu, Yixuan, Zhang, Tengyu, Wei, Renjie, Zhang, Yawen, Huang, Ru, Wang, Runsheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
EasyACIM: An End-to-End Automated Analog CIM with Synthesizable Architecture and Agile Design Space Exploration
por: Zhang, Haoyi, et al.
Publicado: (2024)
por: Zhang, Haoyi, et al.
Publicado: (2024)
The Quest for Reliable AI Accelerators: Cross-Layer Evaluation and Design Optimization
por: Li, Meng, et al.
Publicado: (2026)
por: Li, Meng, et al.
Publicado: (2026)
Aging Aware Adaptive Voltage Scaling for Reliable and Efficient AI Accelerators
por: Xie, Tong, et al.
Publicado: (2026)
por: Xie, Tong, et al.
Publicado: (2026)
PIMCOMP: An End-to-End DNN Compiler for Processing-In-Memory Accelerators
por: Sun, Xiaotian, et al.
Publicado: (2024)
por: Sun, Xiaotian, et al.
Publicado: (2024)
Voyager: An End-to-End Framework for Design-Space Exploration and Generation of DNN Accelerators
por: Prabhu, Kartik, et al.
Publicado: (2025)
por: Prabhu, Kartik, et al.
Publicado: (2025)
ReaLM: Reliable and Efficient Large Language Model Inference with Statistical Algorithm-Based Fault Tolerance
por: Xie, Tong, et al.
Publicado: (2025)
por: Xie, Tong, et al.
Publicado: (2025)
FIXME: Towards End-to-End Benchmarking of LLM-Aided Design Verification
por: Wan, Gwok-Waa, et al.
Publicado: (2025)
por: Wan, Gwok-Waa, et al.
Publicado: (2025)
CREATE: Cross-Layer Resilience Characterization and Optimization for Efficient yet Reliable Embodied AI Systems
por: Xie, Tong, et al.
Publicado: (2026)
por: Xie, Tong, et al.
Publicado: (2026)
TeLLMe v2: An Efficient End-to-End Ternary LLM Prefill and Decode Accelerator with Table-Lookup Matmul on Edge FPGAs
por: Qiao, Ye, et al.
Publicado: (2025)
por: Qiao, Ye, et al.
Publicado: (2025)
T-MAN: Enabling End-to-End Low-Bit LLM Inference on NPUs via Unified Table Lookup
por: Wei, Jianyu, et al.
Publicado: (2025)
por: Wei, Jianyu, et al.
Publicado: (2025)
Mamba-X: An End-to-End Vision Mamba Accelerator for Edge Computing Devices
por: Yoon, Dongho, et al.
Publicado: (2025)
por: Yoon, Dongho, et al.
Publicado: (2025)
EasyDRAM: An FPGA-based Infrastructure for Fast and Accurate End-to-End Evaluation of Emerging DRAM Techniques
por: Canpolat, Oğuzhan, et al.
Publicado: (2025)
por: Canpolat, Oğuzhan, et al.
Publicado: (2025)
CIMR-V: An End-to-End SRAM-based CIM Accelerator with RISC-V for AI Edge Device
por: and, Yan-Cheng Guo, et al.
Publicado: (2025)
por: and, Yan-Cheng Guo, et al.
Publicado: (2025)
DRIFT: Harnessing Inherent Fault Tolerance for Efficient and Reliable Diffusion Model Inference
por: Wen, Jinqi, et al.
Publicado: (2026)
por: Wen, Jinqi, et al.
Publicado: (2026)
FASE: FPGA-Assisted Syscall Emulation for Rapid End-to-End Processor Performance Validation
por: Meng, Chengzhen, et al.
Publicado: (2025)
por: Meng, Chengzhen, et al.
Publicado: (2025)
LayoutCopilot: An LLM-powered Multi-agent Collaborative Framework for Interactive Analog Layout Design
por: Liu, Bingyang, et al.
Publicado: (2024)
por: Liu, Bingyang, et al.
Publicado: (2024)
SLDB: An End-To-End Heterogeneous System-on-Chip Benchmark Suite for LLM-Aided Design
por: Alvanaki, Elisavet Lydia, et al.
Publicado: (2025)
por: Alvanaki, Elisavet Lydia, et al.
Publicado: (2025)
PD-Swap: Prefill-Decode Logic Swapping for End-to-End LLM Inference on Edge FPGAs via Dynamic Partial Reconfiguration
por: Zhang, Yifan, et al.
Publicado: (2025)
por: Zhang, Yifan, et al.
Publicado: (2025)
ASCEND: Accurate yet Efficient End-to-End Stochastic Computing Acceleration of Vision Transformer
por: Xie, Tong, et al.
Publicado: (2024)
por: Xie, Tong, et al.
Publicado: (2024)
HyperCroc: End-to-End Open-Source RISC-V MCU with a Plug-In Interface for Domain-Specific Accelerators
por: Sauter, Philippe, et al.
Publicado: (2026)
por: Sauter, Philippe, et al.
Publicado: (2026)
End-to-End Transformer Acceleration Through Processing-in-Memory Architectures
por: Yang, Xiaoxuan, et al.
Publicado: (2025)
por: Yang, Xiaoxuan, et al.
Publicado: (2025)
System-Level Design Space Exploration for High-Level Synthesis under End-to-End Latency Constraints
por: Liao, Yuchao, et al.
Publicado: (2024)
por: Liao, Yuchao, et al.
Publicado: (2024)
GenPairX: A Hardware-Algorithm Co-Designed Accelerator for Paired-End Read Mapping
por: Eudine, Julien, et al.
Publicado: (2026)
por: Eudine, Julien, et al.
Publicado: (2026)
Cool-3D: An End-to-End Thermal-Aware Framework for Early-Phase Design Space Exploration of Microfluidic-Cooled 3DICs
por: Wang, Runxi, et al.
Publicado: (2025)
por: Wang, Runxi, et al.
Publicado: (2025)
ENFOR-SA: End-to-end Cross-layer Transient Fault Injector for Efficient and Accurate DNN Reliability Assessment on Systolic Arrays
por: Tonetto, Rafael Billig, et al.
Publicado: (2026)
por: Tonetto, Rafael Billig, et al.
Publicado: (2026)
Huff-LLM: End-to-End Lossless Compression for Efficient LLM Inference
por: Yubeaton, Patrick, et al.
Publicado: (2025)
por: Yubeaton, Patrick, et al.
Publicado: (2025)
PowerFlow-DNN: Compiler-Directed Fine-Grained Power Orchestration for End-to-End Edge AI Inference
por: Chen, Paul, et al.
Publicado: (2026)
por: Chen, Paul, et al.
Publicado: (2026)
TriGen: NPU Architecture for End-to-End Acceleration of Large Language Models based on SW-HW Co-Design
por: Lee, Jonghun, et al.
Publicado: (2026)
por: Lee, Jonghun, et al.
Publicado: (2026)
AutoGNN: End-to-End Hardware-Driven Graph Preprocessing for Enhanced GNN Performance
por: Kang, Seungkwan, et al.
Publicado: (2026)
por: Kang, Seungkwan, et al.
Publicado: (2026)
MemIntelli: A Generic End-to-End Simulation Framework for Memristive Intelligent Computing
por: Zhou, Houji, et al.
Publicado: (2025)
por: Zhou, Houji, et al.
Publicado: (2025)
Torch2Chip: An End-to-end Customizable Deep Neural Network Compression and Deployment Toolkit for Prototype Hardware Accelerator Design
por: Meng, Jian, et al.
Publicado: (2024)
por: Meng, Jian, et al.
Publicado: (2024)
ESACT: An End-to-End Sparse Accelerator for Compute-Intensive Transformers via Local Similarity
por: Liu, Hongxiang, et al.
Publicado: (2025)
por: Liu, Hongxiang, et al.
Publicado: (2025)
Ironman: Accelerating Oblivious Transfer Extension for Privacy-Preserving AI with Near-Memory Processing
por: Lin, Chenqi, et al.
Publicado: (2025)
por: Lin, Chenqi, et al.
Publicado: (2025)
RePart: Efficient Hypergraph Partitioning with Logic Replication Optimization for Multi-FPGA System
por: Fu, Zizhuo, et al.
Publicado: (2026)
por: Fu, Zizhuo, et al.
Publicado: (2026)
Theseus: Exploring Efficient Wafer-Scale Chip Design for Large Language Models
por: Zhu, Jingchen, et al.
Publicado: (2024)
por: Zhu, Jingchen, et al.
Publicado: (2024)
No Redundancy, No Stall: Lightweight Streaming 3D Gaussian Splatting for Real-time Rendering
por: Wei, Linye, et al.
Publicado: (2025)
por: Wei, Linye, et al.
Publicado: (2025)
Towards an End-To-End System for Real-Time Gesture Recognition from Surface Vibrations
por: Hettstedt, Florian, et al.
Publicado: (2026)
por: Hettstedt, Florian, et al.
Publicado: (2026)
MCMComm: Hardware-Software Co-Optimization for End-to-End Communication in Multi-Chip-Modules
por: Raj, Ritik, et al.
Publicado: (2025)
por: Raj, Ritik, et al.
Publicado: (2025)
UniCAIM: A Unified CAM/CIM Architecture with Static-Dynamic KV Cache Pruning for Efficient Long-Context LLM Inference
por: Xu, Weikai, et al.
Publicado: (2025)
por: Xu, Weikai, et al.
Publicado: (2025)
Benchmarking End-To-End Performance of AI-Based Chip Placement Algorithms
por: Wang, Zhihai, et al.
Publicado: (2024)
por: Wang, Zhihai, et al.
Publicado: (2024)
Ejemplares similares
-
EasyACIM: An End-to-End Automated Analog CIM with Synthesizable Architecture and Agile Design Space Exploration
por: Zhang, Haoyi, et al.
Publicado: (2024) -
The Quest for Reliable AI Accelerators: Cross-Layer Evaluation and Design Optimization
por: Li, Meng, et al.
Publicado: (2026) -
Aging Aware Adaptive Voltage Scaling for Reliable and Efficient AI Accelerators
por: Xie, Tong, et al.
Publicado: (2026) -
PIMCOMP: An End-to-End DNN Compiler for Processing-In-Memory Accelerators
por: Sun, Xiaotian, et al.
Publicado: (2024) -
Voyager: An End-to-End Framework for Design-Space Exploration and Generation of DNN Accelerators
por: Prabhu, Kartik, et al.
Publicado: (2025)