HH-PIM: Dynamic Optimization of Power and Performance with Heterogeneous-Hybrid PIM for Edge AI Devices
Fuente:
arXiv
Guardado en:
| Autores principales: | Jeon, Sangmin, Lee, Kangju, Lee, Kyeongwon, Lee, Woojoo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ProactivePIM: Accelerating Weight-Sharing Embedding Layer with PIM for Scalable Recommendation System
por: Kim, Youngsuk, et al.
Publicado: (2024)
por: Kim, Youngsuk, et al.
Publicado: (2024)
SA-Kura: An Energy-Efficient Systolic Array Accelerator for Locally-Coupled Kuramoto Drift in Diffusion Sampling
por: Jin, Jeongmin, et al.
Publicado: (2026)
por: Jin, Jeongmin, et al.
Publicado: (2026)
PIM-LLM: A High-Throughput Hybrid PIM Architecture for 1-bit LLMs
por: Malekar, Jinendra, et al.
Publicado: (2025)
por: Malekar, Jinendra, et al.
Publicado: (2025)
CMAX-CAMEL: A Coarse-to-Fine Adaptive, Memory-Efficient, and Low-Power Edge Processor for Contrast Maximization
por: Min, Kyeongpil, et al.
Publicado: (2026)
por: Min, Kyeongpil, et al.
Publicado: (2026)
LP5X-PIM Sim: A High-Fidelity HW/SW Integrated Simulator for LPDDR5X-PIM
por: Cha, SangHoon, et al.
Publicado: (2026)
por: Cha, SangHoon, et al.
Publicado: (2026)
LoRA-Edge: Tensor-Train-Assisted LoRA for Practical CNN Fine-Tuning on Edge Devices
por: Kwak, Hyunseok, et al.
Publicado: (2025)
por: Kwak, Hyunseok, et al.
Publicado: (2025)
PIMphony: Overcoming Bandwidth and Capacity Inefficiency in PIM-based Long-Context LLM Inference System
por: Kwon, Hyucksung, et al.
Publicado: (2024)
por: Kwon, Hyucksung, et al.
Publicado: (2024)
PIM-malloc: A Fast and Scalable Dynamic Memory Allocator for Processing-In-Memory (PIM) Architectures
por: Lee, Dongjae, et al.
Publicado: (2025)
por: Lee, Dongjae, et al.
Publicado: (2025)
Pathfinding Future PIM Architectures by Demystifying a Commercial PIM Technology
por: Hyun, Bongjoon, et al.
Publicado: (2023)
por: Hyun, Bongjoon, et al.
Publicado: (2023)
TT-Edge: A Hardware-Software Co-Design for Energy-Efficient Tensor-Train Decomposition on Edge AI
por: Kwak, Hyunseok, et al.
Publicado: (2025)
por: Kwak, Hyunseok, et al.
Publicado: (2025)
PIM-MMU: A Memory Management Unit for Accelerating Data Transfers in Commercial PIM Systems
por: Lee, Dongjae, et al.
Publicado: (2024)
por: Lee, Dongjae, et al.
Publicado: (2024)
NeuPIMs: NPU-PIM Heterogeneous Acceleration for Batched LLM Inferencing
por: Heo, Guseul, et al.
Publicado: (2024)
por: Heo, Guseul, et al.
Publicado: (2024)
Sangam: Chiplet-Based DRAM-PIM Accelerator with CXL Integration for LLM Inferencing
por: Kiyawat, Khyati, et al.
Publicado: (2025)
por: Kiyawat, Khyati, et al.
Publicado: (2025)
CD-PIM: A High-Bandwidth and Compute-Efficient LPDDR5-Based PIM for Low-Batch LLM Acceleration on Edge-Device
por: Lin, Ye, et al.
Publicado: (2026)
por: Lin, Ye, et al.
Publicado: (2026)
Dataflow-Aware PIM-Enabled Manycore Architecture for Deep Learning Workloads
por: Sharma, Harsh, et al.
Publicado: (2024)
por: Sharma, Harsh, et al.
Publicado: (2024)
AQPIM: Breaking the PIM Capacity Wall for LLMs with In-Memory Activation Quantization
por: Matsushima, Kosuke, et al.
Publicado: (2026)
por: Matsushima, Kosuke, et al.
Publicado: (2026)
Annotated PIM Bibliography
por: Kogge, Peter M.
Publicado: (2026)
por: Kogge, Peter M.
Publicado: (2026)
Inclusive-PIM: Hardware-Software Co-design for Broad Acceleration on Commercial PIM Architectures
por: Alsop, Johnathan, et al.
Publicado: (2023)
por: Alsop, Johnathan, et al.
Publicado: (2023)
AIM: Software and Hardware Co-design for Architecture-level IR-drop Mitigation in High-performance PIM
por: Zhang, Yuanpeng, et al.
Publicado: (2025)
por: Zhang, Yuanpeng, et al.
Publicado: (2025)
PIM-AI: A Novel Architecture for High-Efficiency LLM Inference
por: Ortega, Cristobal, et al.
Publicado: (2024)
por: Ortega, Cristobal, et al.
Publicado: (2024)
IANUS: Integrated Accelerator based on NPU-PIM Unified Memory System
por: Seo, Minseok, et al.
Publicado: (2024)
por: Seo, Minseok, et al.
Publicado: (2024)
PIM-GPT: A Hybrid Process-in-Memory Accelerator for Autoregressive Transformers
por: Wu, Yuting, et al.
Publicado: (2023)
por: Wu, Yuting, et al.
Publicado: (2023)
THERMOS: Thermally-Aware Multi-Objective Scheduling of AI Workloads on Heterogeneous Multi-Chiplet PIM Architectures
por: Kanani, Alish, et al.
Publicado: (2025)
por: Kanani, Alish, et al.
Publicado: (2025)
Dissecting and Re-architecting 3D NAND Flash PIM Arrays for Efficient Single-Batch Token Generation in LLMs
por: Jang, Yongjoo, et al.
Publicado: (2025)
por: Jang, Yongjoo, et al.
Publicado: (2025)
LOCALUT: Harnessing Capacity-Computation Tradeoffs for LUT-Based Inference in DRAM-PIM
por: Hong, Junguk, et al.
Publicado: (2026)
por: Hong, Junguk, et al.
Publicado: (2026)
Sieve: Dynamic Expert-Aware PIM Acceleration for Evolving Mixture-of-Experts Models
por: Kim, Jungwoo, et al.
Publicado: (2026)
por: Kim, Jungwoo, et al.
Publicado: (2026)
PIM-Opt: Demystifying Distributed Optimization Algorithms on a Real-World Processing-In-Memory System
por: Rhyner, Steve, et al.
Publicado: (2024)
por: Rhyner, Steve, et al.
Publicado: (2024)
Towards Efficient LUT-based PIM: A Scalable and Low-Power Approach for Modern Workloads
por: Khabbazan, Bahareh, et al.
Publicado: (2025)
por: Khabbazan, Bahareh, et al.
Publicado: (2025)
DL-PIM: Improving Data Locality in Processing-in-Memory Systems
por: Tian, Parker Hao, et al.
Publicado: (2025)
por: Tian, Parker Hao, et al.
Publicado: (2025)
AME-PIM: Can Memory be Your Next Tensor Accelerator?
por: Venieri, Emanuele, et al.
Publicado: (2026)
por: Venieri, Emanuele, et al.
Publicado: (2026)
TriGen: NPU Architecture for End-to-End Acceleration of Large Language Models based on SW-HW Co-Design
por: Lee, Jonghun, et al.
Publicado: (2026)
por: Lee, Jonghun, et al.
Publicado: (2026)
PIMfused: Near-Bank DRAM-PIM with Fused-layer Dataflow for CNN Data Transfer Optimization
por: Yang, Simei, et al.
Publicado: (2025)
por: Yang, Simei, et al.
Publicado: (2025)
Hybrid Systolic Array Accelerator with Optimized Dataflow for Edge Large Language Model Inference
por: Chen, Chun-Ting, et al.
Publicado: (2025)
por: Chen, Chun-Ting, et al.
Publicado: (2025)
P3-LLM: An Integrated NPU-PIM Accelerator for Edge LLM Inference Using Hybrid Numerical Formats
por: Chen, Yuzong, et al.
Publicado: (2025)
por: Chen, Yuzong, et al.
Publicado: (2025)
AI-Powered Agile Analog Circuit Design and Optimization
por: Hu, Jinhai, et al.
Publicado: (2025)
por: Hu, Jinhai, et al.
Publicado: (2025)
Membrane: Accelerating Database Analytics with Bank-Level DRAM-PIM Filtering
por: Shekar, Akhil, et al.
Publicado: (2025)
por: Shekar, Akhil, et al.
Publicado: (2025)
FiCABU: A Fisher-Based, Context-Adaptive Machine Unlearning Processor for Edge AI
por: Cho, Eun-Su, et al.
Publicado: (2025)
por: Cho, Eun-Su, et al.
Publicado: (2025)
GEN-Graph: Heterogeneous PIM Accelerator for General Computational Patterns in Graph-based Dynamic Programming
por: Chen, Yanru, et al.
Publicado: (2026)
por: Chen, Yanru, et al.
Publicado: (2026)
Sustainable AI Processing at the Edge
por: Ollivier, Sébastien, et al.
Publicado: (2022)
por: Ollivier, Sébastien, et al.
Publicado: (2022)
Shared-PIM: Enabling Concurrent Computation and Data Flow for Faster Processing-in-DRAM
por: Mamdouh, Ahmed, et al.
Publicado: (2024)
por: Mamdouh, Ahmed, et al.
Publicado: (2024)
Ejemplares similares
-
ProactivePIM: Accelerating Weight-Sharing Embedding Layer with PIM for Scalable Recommendation System
por: Kim, Youngsuk, et al.
Publicado: (2024) -
SA-Kura: An Energy-Efficient Systolic Array Accelerator for Locally-Coupled Kuramoto Drift in Diffusion Sampling
por: Jin, Jeongmin, et al.
Publicado: (2026) -
PIM-LLM: A High-Throughput Hybrid PIM Architecture for 1-bit LLMs
por: Malekar, Jinendra, et al.
Publicado: (2025) -
CMAX-CAMEL: A Coarse-to-Fine Adaptive, Memory-Efficient, and Low-Power Edge Processor for Contrast Maximization
por: Min, Kyeongpil, et al.
Publicado: (2026) -
LP5X-PIM Sim: A High-Fidelity HW/SW Integrated Simulator for LPDDR5X-PIM
por: Cha, SangHoon, et al.
Publicado: (2026)