Dataflow-Aware PIM-Enabled Manycore Architecture for Deep Learning Workloads
Fuente:
arXiv
Guardado en:
| Autores principales: | Sharma, Harsh, Narang, Gaurav, Doppa, Janardhan Rao, Ogras, Umit, Pande, Partha Pratim |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
THERMOS: Thermally-Aware Multi-Objective Scheduling of AI Workloads on Heterogeneous Multi-Chiplet PIM Architectures
por: Kanani, Alish, et al.
Publicado: (2025)
por: Kanani, Alish, et al.
Publicado: (2025)
HePGA: A Heterogeneous Processing-in-Memory based GNN Training Accelerator
por: Ogbogu, Chukwufumnanya, et al.
Publicado: (2025)
por: Ogbogu, Chukwufumnanya, et al.
Publicado: (2025)
Designing High-Performance and Thermally Feasible Multi-Chiplet Architectures enabled by Non-bendable Glass Interposer
por: Sharma, Harsh, et al.
Publicado: (2025)
por: Sharma, Harsh, et al.
Publicado: (2025)
Atleus: Accelerating Transformers on the Edge Enabled by 3D Heterogeneous Manycore Architectures
por: Dhingra, Pratyush, et al.
Publicado: (2025)
por: Dhingra, Pratyush, et al.
Publicado: (2025)
A Heterogeneous Chiplet Architecture for Accelerating End-to-End Transformer Models
por: Sharma, Harsh, et al.
Publicado: (2023)
por: Sharma, Harsh, et al.
Publicado: (2023)
CHIPSIM: A Co-Simulation Framework for Deep Learning on Chiplet-Based Systems
por: Pfromm, Lukas, et al.
Publicado: (2025)
por: Pfromm, Lukas, et al.
Publicado: (2025)
HeTraX: Energy Efficient 3D Heterogeneous Manycore Architecture for Transformer Acceleration
por: Dhingra, Pratyush, et al.
Publicado: (2024)
por: Dhingra, Pratyush, et al.
Publicado: (2024)
MFIT: Multi-Fidelity Thermal Modeling for 2.5D and 3D Multi-Chiplet Architectures
por: Pfromm, Lukas, et al.
Publicado: (2024)
por: Pfromm, Lukas, et al.
Publicado: (2024)
FARe: Fault-Aware GNN Training on ReRAM-based PIM Accelerators
por: Dhingra, Pratyush, et al.
Publicado: (2024)
por: Dhingra, Pratyush, et al.
Publicado: (2024)
CrossNAS: A Cross-Layer Neural Architecture Search Framework for PIM Systems
por: Amin, Md Hasibul, et al.
Publicado: (2025)
por: Amin, Md Hasibul, et al.
Publicado: (2025)
Architecture-Level Modeling of Photonic Deep Neural Network Accelerators
por: Andrulis, Tanner, et al.
Publicado: (2024)
por: Andrulis, Tanner, et al.
Publicado: (2024)
Architectural and System Implications of CXL-enabled Tiered Memory
por: Yang, Yujie, et al.
Publicado: (2025)
por: Yang, Yujie, et al.
Publicado: (2025)
H3PIMAP: A Heterogeneity-Aware Multi-Objective DNN Mapping Framework on Electronic-Photonic Processing-in-Memory Architectures
por: Yin, Ziang, et al.
Publicado: (2025)
por: Yin, Ziang, et al.
Publicado: (2025)
CQ-CiM: Hardware-Aware Embedding Shaping for Robust CiM-Based Retrieval
por: Li, Xinzhao, et al.
Publicado: (2026)
por: Li, Xinzhao, et al.
Publicado: (2026)
Online Soft Error Tolerance in ReRAM Crossbars for Deep Learning Accelerators
por: Khezeli, Benyamin, et al.
Publicado: (2024)
por: Khezeli, Benyamin, et al.
Publicado: (2024)
Modeling and Simulation Frameworks for Processing-in-Memory Architectures
por: Aghaei, Mahdi, et al.
Publicado: (2025)
por: Aghaei, Mahdi, et al.
Publicado: (2025)
OISMA: On-the-fly In-memory Stochastic Multiplication Architecture for Matrix-Multiplication Workloads
por: Agwa, Shady, et al.
Publicado: (2025)
por: Agwa, Shady, et al.
Publicado: (2025)
Cognition Engines: A Row-Scale HVDC Architecture for Computational Continuity of AI
por: Churnock, Paul
Publicado: (2025)
por: Churnock, Paul
Publicado: (2025)
A Novel Low-Power Cache Architecture Based on 6-Transistor SRAM Cells
por: Dizabadi, Naser Khatti, et al.
Publicado: (2026)
por: Dizabadi, Naser Khatti, et al.
Publicado: (2026)
ARMAN: A Reconfigurable Monolithic 3D Accelerator Architecture for Convolutional Neural Networks
por: Sedaghatgoo, Ali, et al.
Publicado: (2024)
por: Sedaghatgoo, Ali, et al.
Publicado: (2024)
PEARL: Power- and Energy-Aware Multicore Intermittent Computing
por: Akhunov, Khakim, et al.
Publicado: (2025)
por: Akhunov, Khakim, et al.
Publicado: (2025)
Stoch-IMC: A Bit-Parallel Stochastic In-Memory Computing Architecture Based on STT-MRAM
por: Hajisadeghi, Amir M., et al.
Publicado: (2024)
por: Hajisadeghi, Amir M., et al.
Publicado: (2024)
A Novel 8T SRAM-Based In-Memory Computing Architecture for MAC-Derived Logical Functions
por: M, Amogh K, et al.
Publicado: (2025)
por: M, Amogh K, et al.
Publicado: (2025)
MPAI: A Co-Processing Architecture with MPSoC & AI Accelerators for Vision Applications in Space
por: Leon, Vasileios, et al.
Publicado: (2024)
por: Leon, Vasileios, et al.
Publicado: (2024)
Frequency as Aperture: Enabling Embeddable Near-Field Sensing for 6G Wireless Radios
por: Ho, Pin-Han, et al.
Publicado: (2026)
por: Ho, Pin-Han, et al.
Publicado: (2026)
Toward Digital Twins in 3D IC Packaging: A Critical Review of Physics, Data, and Hybrid Architectures
por: Datta, Gourab, et al.
Publicado: (2026)
por: Datta, Gourab, et al.
Publicado: (2026)
Sensitivity-Aware Mixed-Precision Quantization for ReRAM-based Computing-in-Memory
por: Chen, Guan-Cheng, et al.
Publicado: (2025)
por: Chen, Guan-Cheng, et al.
Publicado: (2025)
Enhancing Test Efficiency through Automated ATPG-Aware Lightweight Scan Instrumentation
por: Paria, Sudipta, et al.
Publicado: (2025)
por: Paria, Sudipta, et al.
Publicado: (2025)
SKYLIGHT: A Scalable Hundred-Channel 3D Photonic In-Memory Tensor Core Architecture for Real-time AI Inference
por: Zhang, Meng, et al.
Publicado: (2026)
por: Zhang, Meng, et al.
Publicado: (2026)
HEANA: A Hybrid Time-Amplitude Analog Optical Accelerator with Flexible Dataflows for Energy-Efficient CNN Inference
por: Vatsavai, Sairam Sri, et al.
Publicado: (2024)
por: Vatsavai, Sairam Sri, et al.
Publicado: (2024)
Through Silicon Via Aware Design Planning for Thermally Efficient 3-D Integrated Circuits
por: Chen, Yibo, et al.
Publicado: (2025)
por: Chen, Yibo, et al.
Publicado: (2025)
STAMP-2.5D: Structural and Thermal Aware Methodology for Placement in 2.5D Integration
por: Parekh, Varun Darshana, et al.
Publicado: (2025)
por: Parekh, Varun Darshana, et al.
Publicado: (2025)
SMART-WRITE: Adaptive Learning-based Write Energy Optimization for Phase Change Memory
por: Desai, Mahek, et al.
Publicado: (2025)
por: Desai, Mahek, et al.
Publicado: (2025)
XL-HD: Extended Learning in Hyperdimensional Computing via Deterministic Projections for In-Memory Accelerators
por: Moon, Sabrina Hassan, et al.
Publicado: (2026)
por: Moon, Sabrina Hassan, et al.
Publicado: (2026)
Look-Up Table based Neural Network Hardware
por: Sen, Ovishake, et al.
Publicado: (2024)
por: Sen, Ovishake, et al.
Publicado: (2024)
PIM-AI: A Novel Architecture for High-Efficiency LLM Inference
por: Ortega, Cristobal, et al.
Publicado: (2024)
por: Ortega, Cristobal, et al.
Publicado: (2024)
Trace-Based Reconstruction of Quantum Circuit Dataflow in Surface Codes
por: Trochatos, Theodoros, et al.
Publicado: (2025)
por: Trochatos, Theodoros, et al.
Publicado: (2025)
A Novel Thermal Network Model and Electro-Thermal Coupling Study for NSFETs and CFETs Considering Thermal Crosstalk
por: Miao, Tianci, et al.
Publicado: (2025)
por: Miao, Tianci, et al.
Publicado: (2025)
Length-Matching Routing for Programmable Photonic Circuits Using Best-First Strategy
por: Wang, Xiaoke, et al.
Publicado: (2025)
por: Wang, Xiaoke, et al.
Publicado: (2025)
PICO-RAM: A PVT-Insensitive Analog Compute-In-Memory SRAM Macro with In-Situ Multi-Bit Charge Computing and 6T Thin-Cell-Compatible Layout
por: Chen, Zhiyu, et al.
Publicado: (2024)
por: Chen, Zhiyu, et al.
Publicado: (2024)
Ejemplares similares
-
THERMOS: Thermally-Aware Multi-Objective Scheduling of AI Workloads on Heterogeneous Multi-Chiplet PIM Architectures
por: Kanani, Alish, et al.
Publicado: (2025) -
HePGA: A Heterogeneous Processing-in-Memory based GNN Training Accelerator
por: Ogbogu, Chukwufumnanya, et al.
Publicado: (2025) -
Designing High-Performance and Thermally Feasible Multi-Chiplet Architectures enabled by Non-bendable Glass Interposer
por: Sharma, Harsh, et al.
Publicado: (2025) -
Atleus: Accelerating Transformers on the Edge Enabled by 3D Heterogeneous Manycore Architectures
por: Dhingra, Pratyush, et al.
Publicado: (2025) -
A Heterogeneous Chiplet Architecture for Accelerating End-to-End Transformer Models
por: Sharma, Harsh, et al.
Publicado: (2023)