TaiBai: A fully programmable brain-inspired processor with topology-aware efficiency
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Qianpeng, Song, Yu, Liu, Xin, Song, Wenna, Zhao, Boshi, Wang, Zhichao, Chen, Aoxin, Zhang, Tielin, Chen, Liang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RARO: Reliability-aware Conversion with Enhanced Read Performance for QLC SSDs
di: Wang, Yanyun, et al.
Pubblicazione: (2025)
di: Wang, Yanyun, et al.
Pubblicazione: (2025)
A complete discussion on fully reconfigurable, digital, scalable, graph and sparsity-aware near-memory accelerator for graph neural networks
di: Raman, Siddhartha Raman Sundara, et al.
Pubblicazione: (2026)
di: Raman, Siddhartha Raman Sundara, et al.
Pubblicazione: (2026)
PIVOT- Input-aware Path Selection for Energy-efficient ViT Inference
di: Moitra, Abhishek, et al.
Pubblicazione: (2024)
di: Moitra, Abhishek, et al.
Pubblicazione: (2024)
Versatile silicon integrated photonic processor: a reconfigurable solution for next-generation AI clusters
di: Zhu, Ying, et al.
Pubblicazione: (2025)
di: Zhu, Ying, et al.
Pubblicazione: (2025)
Addressing memory bandwidth scalability in vector processors for streaming applications
di: Altayo, Jordi, et al.
Pubblicazione: (2025)
di: Altayo, Jordi, et al.
Pubblicazione: (2025)
BoolE: Exact Symbolic Reasoning via Boolean Equality Saturation
di: Yin, Jiaqi, et al.
Pubblicazione: (2025)
di: Yin, Jiaqi, et al.
Pubblicazione: (2025)
RISC-V processor enhanced with a dynamic micro-decoder unit
di: Pottier, Juliette, et al.
Pubblicazione: (2024)
di: Pottier, Juliette, et al.
Pubblicazione: (2024)
DAG-aware Synthesis Orchestration
di: Li, Yingjie, et al.
Pubblicazione: (2023)
di: Li, Yingjie, et al.
Pubblicazione: (2023)
YAP+: Pad-Layout-Aware Yield Modeling and Simulation for Hybrid Bonding
di: Chen, Zhichao, et al.
Pubblicazione: (2025)
di: Chen, Zhichao, et al.
Pubblicazione: (2025)
Allspark: Workload Orchestration for Visual Transformers on Processing In-Memory Systems
di: Ge, Mengke, et al.
Pubblicazione: (2024)
di: Ge, Mengke, et al.
Pubblicazione: (2024)
Accelerating Multi-Scale Deformable Attention Using Near-Memory-Processing Architecture
di: Li, Huize, et al.
Pubblicazione: (2026)
di: Li, Huize, et al.
Pubblicazione: (2026)
Quadrilatero: A RISC-V programmable matrix coprocessor for low-power edge applications
di: Cammarata, Danilo, et al.
Pubblicazione: (2025)
di: Cammarata, Danilo, et al.
Pubblicazione: (2025)
Be CIM or Be Memory: A Dual-mode-aware DNN Compiler for CIM Accelerators
di: Zhao, Shixin, et al.
Pubblicazione: (2025)
di: Zhao, Shixin, et al.
Pubblicazione: (2025)
Ecco: Improving Memory Bandwidth and Capacity for LLMs via Entropy-aware Cache Compression
di: Cheng, Feng, et al.
Pubblicazione: (2025)
di: Cheng, Feng, et al.
Pubblicazione: (2025)
SSRESF: Sensitivity-aware Single-particle Radiation Effects Simulation Framework in SoC Platforms based on SVM Algorithm
di: Liu, Meng, et al.
Pubblicazione: (2024)
di: Liu, Meng, et al.
Pubblicazione: (2024)
Cambricon-LLM: A Chiplet-Based Hybrid Architecture for On-Device Inference of 70B LLM
di: Yu, Zhongkai, et al.
Pubblicazione: (2024)
di: Yu, Zhongkai, et al.
Pubblicazione: (2024)
TransDot: An Area-efficient Reconfigurable Floating-Point Unit for Trans-Precision Dot-Product Accumulation for FPGA AI Engines
di: Wang, Jiayi, et al.
Pubblicazione: (2026)
di: Wang, Jiayi, et al.
Pubblicazione: (2026)
Transitive Array: An Efficient GEMM Accelerator with Result Reuse
di: Guo, Cong, et al.
Pubblicazione: (2025)
di: Guo, Cong, et al.
Pubblicazione: (2025)
EnergAIzer: Fast and Accurate GPU Power Estimation Framework for AI Workloads
di: Lee, Kyungmi, et al.
Pubblicazione: (2026)
di: Lee, Kyungmi, et al.
Pubblicazione: (2026)
31.1 A 14.08-to-135.69Token/s ReRAM-on-Logic Stacked Outlier-Free Large-Language-Model Accelerator with Block-Clustered Weight-Compression and Adaptive Parallel-Speculative-Decoding
di: Dong, Pingcheng, et al.
Pubblicazione: (2026)
di: Dong, Pingcheng, et al.
Pubblicazione: (2026)
VeriGRAG: Enhancing LLM-Based Verilog Code Generation with Structure-Aware Soft Prompts
di: Zhao, Jiayu, et al.
Pubblicazione: (2025)
di: Zhao, Jiayu, et al.
Pubblicazione: (2025)
Theseus: Exploring Efficient Wafer-Scale Chip Design for Large Language Models
di: Zhu, Jingchen, et al.
Pubblicazione: (2024)
di: Zhu, Jingchen, et al.
Pubblicazione: (2024)
GSIM: Accelerating RTL Simulation for Large-Scale Designs
di: Chen, Lu, et al.
Pubblicazione: (2025)
di: Chen, Lu, et al.
Pubblicazione: (2025)
Accelerating GNN Training through Locality-aware Dropout and Merge
di: Sun, Gongjian, et al.
Pubblicazione: (2025)
di: Sun, Gongjian, et al.
Pubblicazione: (2025)
e-boost: Boosted E-Graph Extraction with Adaptive Heuristics and Exact Solving
di: Yin, Jiaqi, et al.
Pubblicazione: (2025)
di: Yin, Jiaqi, et al.
Pubblicazione: (2025)
TATAA: Programmable Mixed-Precision Transformer Acceleration with a Transformable Arithmetic Architecture
di: Wu, Jiajun, et al.
Pubblicazione: (2024)
di: Wu, Jiajun, et al.
Pubblicazione: (2024)
Achieving Trustworthy Real-Time Decision Support Systems with Low-Latency Interpretable AI Models
di: Deng, Zechun, et al.
Pubblicazione: (2025)
di: Deng, Zechun, et al.
Pubblicazione: (2025)
NDSEARCH: Accelerating Graph-Traversal-Based Approximate Nearest Neighbor Search through Near Data Processing
di: Wang, Yitu, et al.
Pubblicazione: (2023)
di: Wang, Yitu, et al.
Pubblicazione: (2023)
CoFHEE: A Co-processor for Fully Homomorphic Encryption Execution (Extended Version)
di: Nabeel, Mohammed, et al.
Pubblicazione: (2022)
di: Nabeel, Mohammed, et al.
Pubblicazione: (2022)
A High-Throughput Hardware Accelerator for Lempel-Ziv 4 Compression Algorithm
di: Chen, Tao, et al.
Pubblicazione: (2024)
di: Chen, Tao, et al.
Pubblicazione: (2024)
RFAmpDesigner: A Self-Evolving Multi-Agent LLM Framework for Automated Radio Frequency Amplifier Design
di: Lu, Hang, et al.
Pubblicazione: (2026)
di: Lu, Hang, et al.
Pubblicazione: (2026)
Xpikeformer: Hybrid Analog-Digital Hardware Acceleration for Spiking Transformers
di: Song, Zihang, et al.
Pubblicazione: (2024)
di: Song, Zihang, et al.
Pubblicazione: (2024)
AGS: Accelerating 3D Gaussian Splatting SLAM via CODEC-Assisted Frame Covisibility Detection
di: He, Houshu, et al.
Pubblicazione: (2025)
di: He, Houshu, et al.
Pubblicazione: (2025)
FluxEDA: A Unified Execution Infrastructure for Stateful Agentic EDA
di: Chen, Zhengrui, et al.
Pubblicazione: (2026)
di: Chen, Zhengrui, et al.
Pubblicazione: (2026)
E-morphic: Scalable Equality Saturation for Structural Exploration in Logic Synthesis
di: Chen, Chen, et al.
Pubblicazione: (2025)
di: Chen, Chen, et al.
Pubblicazione: (2025)
GCC: A 3DGS Inference Architecture with Gaussian-Wise and Cross-Stage Conditional Processing
di: Pei, Minnan, et al.
Pubblicazione: (2025)
di: Pei, Minnan, et al.
Pubblicazione: (2025)
Hardware Efficient Accelerator for Spiking Transformer With Reconfigurable Parallel Time Step Computing
di: Chen, Bo-Yu, et al.
Pubblicazione: (2025)
di: Chen, Bo-Yu, et al.
Pubblicazione: (2025)
Bespoke Co-processor for Energy-Efficient Health Monitoring on RISC-V-based Flexible Wearables
di: Vergos, Theofanis, et al.
Pubblicazione: (2025)
di: Vergos, Theofanis, et al.
Pubblicazione: (2025)
A System Architecture for Low Latency Multiprogramming Quantum Computing
di: Zhao, Yilun, et al.
Pubblicazione: (2026)
di: Zhao, Yilun, et al.
Pubblicazione: (2026)
SD-Acc: Accelerating Stable Diffusion through Phase-aware Sampling and Hardware Co-Optimizations
di: Wang, Zhican, et al.
Pubblicazione: (2025)
di: Wang, Zhican, et al.
Pubblicazione: (2025)
Documenti analoghi
-
RARO: Reliability-aware Conversion with Enhanced Read Performance for QLC SSDs
di: Wang, Yanyun, et al.
Pubblicazione: (2025) -
A complete discussion on fully reconfigurable, digital, scalable, graph and sparsity-aware near-memory accelerator for graph neural networks
di: Raman, Siddhartha Raman Sundara, et al.
Pubblicazione: (2026) -
PIVOT- Input-aware Path Selection for Energy-efficient ViT Inference
di: Moitra, Abhishek, et al.
Pubblicazione: (2024) -
Versatile silicon integrated photonic processor: a reconfigurable solution for next-generation AI clusters
di: Zhu, Ying, et al.
Pubblicazione: (2025) -
Addressing memory bandwidth scalability in vector processors for streaming applications
di: Altayo, Jordi, et al.
Pubblicazione: (2025)