Machine Learning-Driven Intelligent Memory System Design: From On-Chip Caches to Storage
Fuente:
arXiv
Salvato in:
| Autori principali: | Bera, Rahul, Nadig, Rakesh, Mutlu, Onur |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Athena: Synergizing Data Prefetching and Off-Chip Prediction via Online Reinforcement Learning
di: Bera, Rahul, et al.
Pubblicazione: (2026)
di: Bera, Rahul, et al.
Pubblicazione: (2026)
CIPHERMATCH: Accelerating Homomorphic Encryption-Based String Matching via Memory-Efficient Data Packing and In-Flash Processing
di: Kabra, Mayank, et al.
Pubblicazione: (2025)
di: Kabra, Mayank, et al.
Pubblicazione: (2025)
Mitigating the Memory Bottleneck with Machine Learning-Driven and Data-Aware Microarchitectural Techniques
di: Bera, Rahul
Pubblicazione: (2026)
di: Bera, Rahul
Pubblicazione: (2026)
Conduit: Programmer-Transparent Near-Data Processing Using Multiple Compute-Capable Resources in Solid State Drives
di: Nadig, Rakesh, et al.
Pubblicazione: (2026)
di: Nadig, Rakesh, et al.
Pubblicazione: (2026)
Memory-Centric Computing: Solving Computing's Memory Problem
di: Mutlu, Onur, et al.
Pubblicazione: (2025)
di: Mutlu, Onur, et al.
Pubblicazione: (2025)
Accelerating Triangle Counting with Real Processing-in-Memory Systems
di: Asquini, Lorenzo, et al.
Pubblicazione: (2025)
di: Asquini, Lorenzo, et al.
Pubblicazione: (2025)
RevaMp3D: Architecting the Processor Core and Cache Hierarchy for Systems with Monolithically-Integrated Logic and Memory
di: Ghiasi, Nika Mansouri, et al.
Pubblicazione: (2022)
di: Ghiasi, Nika Mansouri, et al.
Pubblicazione: (2022)
SAGe: A Lightweight Algorithm-Architecture Co-Design for Mitigating the Data Preparation Bottleneck in Large-Scale Genome Sequence Analysis
di: Ghiasi, Nika Mansouri, et al.
Pubblicazione: (2025)
di: Ghiasi, Nika Mansouri, et al.
Pubblicazione: (2025)
Memory-Centric Computing: Recent Advances in Processing-in-DRAM
di: Mutlu, Onur, et al.
Pubblicazione: (2024)
di: Mutlu, Onur, et al.
Pubblicazione: (2024)
PIMDAL: Mitigating the Memory Bottleneck in Data Analytics using a Real Processing-in-Memory System
di: Frouzakis, Manos, et al.
Pubblicazione: (2025)
di: Frouzakis, Manos, et al.
Pubblicazione: (2025)
A Modern Primer on Processing in Memory
di: Mutlu, Onur, et al.
Pubblicazione: (2020)
di: Mutlu, Onur, et al.
Pubblicazione: (2020)
LLaMCAT: Optimizing Large Language Model Inference with Cache Arbitration and Throttling
di: Zhou, Zhongchun, et al.
Pubblicazione: (2025)
di: Zhou, Zhongchun, et al.
Pubblicazione: (2025)
ALPHA-PIM: Analysis of Linear Algebraic Processing for High-Performance Graph Applications on a Real Processing-In-Memory System
di: Barkhordar, Marzieh, et al.
Pubblicazione: (2026)
di: Barkhordar, Marzieh, et al.
Pubblicazione: (2026)
Functionally-Complete Boolean Logic in Real DRAM Chips: Experimental Characterization and Analysis
di: Yuksel, Ismail Emir, et al.
Pubblicazione: (2024)
di: Yuksel, Ismail Emir, et al.
Pubblicazione: (2024)
Intent-Driven Storage Systems: From Low-Level Tuning to High-Level Understanding
di: Bergman, Shai, et al.
Pubblicazione: (2025)
di: Bergman, Shai, et al.
Pubblicazione: (2025)
Simultaneous Many-Row Activation in Off-the-Shelf DRAM Chips: Experimental Characterization and Analysis
di: Yuksel, Ismail Emir, et al.
Pubblicazione: (2024)
di: Yuksel, Ismail Emir, et al.
Pubblicazione: (2024)
PULSAR: Simultaneous Many-Row Activation for Reliable and High-Performance Computing in Off-the-Shelf DRAM Chips
di: Yuksel, Ismail Emir, et al.
Pubblicazione: (2023)
di: Yuksel, Ismail Emir, et al.
Pubblicazione: (2023)
Muchisim: A Simulation Framework for Design Exploration of Multi-Chip Manycore Systems
di: Orenes-Vera, Marcelo, et al.
Pubblicazione: (2023)
di: Orenes-Vera, Marcelo, et al.
Pubblicazione: (2023)
Adaptive Multi-Objective Tiered Storage Configuration for KV Cache in LLM Service
di: Zheng, Xianzhe, et al.
Pubblicazione: (2026)
di: Zheng, Xianzhe, et al.
Pubblicazione: (2026)
DCC: Data-Centric Compilation of Machine Learning Kernels for Processing-In-Memory Architectures
di: Yang, Peiming, et al.
Pubblicazione: (2025)
di: Yang, Peiming, et al.
Pubblicazione: (2025)
RUBICON: A Framework for Designing Efficient Deep Learning-Based Genomic Basecallers
di: Singh, Gagandeep, et al.
Pubblicazione: (2022)
di: Singh, Gagandeep, et al.
Pubblicazione: (2022)
MIMDRAM: An End-to-End Processing-Using-DRAM System for High-Throughput, Energy-Efficient and Programmer-Transparent Multiple-Instruction Multiple-Data Processing
di: Oliveira, Geraldo F., et al.
Pubblicazione: (2024)
di: Oliveira, Geraldo F., et al.
Pubblicazione: (2024)
PiKV: KV Cache Management System for Mixture of Experts
di: Liu, Dong, et al.
Pubblicazione: (2025)
di: Liu, Dong, et al.
Pubblicazione: (2025)
Taking Cryptography Out of the Data Path via Near-Memory Processing in DRAM
di: Barcarolo, Nicola, et al.
Pubblicazione: (2026)
di: Barcarolo, Nicola, et al.
Pubblicazione: (2026)
PIM-Opt: Demystifying Distributed Optimization Algorithms on a Real-World Processing-In-Memory System
di: Rhyner, Steve, et al.
Pubblicazione: (2024)
di: Rhyner, Steve, et al.
Pubblicazione: (2024)
PAPI: Exploiting Dynamic Parallelism in Large Language Model Decoding with a Processing-In-Memory-Enabled Computing System
di: He, Yintao, et al.
Pubblicazione: (2025)
di: He, Yintao, et al.
Pubblicazione: (2025)
MegIS: High-Performance, Energy-Efficient, and Low-Cost Metagenomic Analysis with In-Storage Processing
di: Ghiasi, Nika Mansouri, et al.
Pubblicazione: (2024)
di: Ghiasi, Nika Mansouri, et al.
Pubblicazione: (2024)
Cache Your Prompt When It's Green: Carbon-Aware Caching for Large Language Model Serving
di: Tian, Yuyang, et al.
Pubblicazione: (2025)
di: Tian, Yuyang, et al.
Pubblicazione: (2025)
In-DRAM True Random Number Generation Using Simultaneous Multiple-Row Activation: An Experimental Study of Real DRAM Chips
di: Yuksel, Ismail Emir, et al.
Pubblicazione: (2025)
di: Yuksel, Ismail Emir, et al.
Pubblicazione: (2025)
HyperOffload: Graph-Driven Hierarchical Memory Management for Large Language Models on SuperNode Architectures
di: Liu, Fangxin, et al.
Pubblicazione: (2026)
di: Liu, Fangxin, et al.
Pubblicazione: (2026)
DCO: Dynamic Cache Orchestration for LLM Accelerators through Predictive Management
di: Zhou, Zhongchun, et al.
Pubblicazione: (2025)
di: Zhou, Zhongchun, et al.
Pubblicazione: (2025)
PRESERVE: Prefetching Model Weights and KV-Cache in Distributed LLM Serving
di: Yüzügüler, Ahmet Caner, et al.
Pubblicazione: (2025)
di: Yüzügüler, Ahmet Caner, et al.
Pubblicazione: (2025)
Proteus: Enabling High-Performance Processing-Using-DRAM with Dynamic Bit-Precision, Adaptive Data Representation, and Flexible Arithmetic
di: Oliveira, Geraldo F., et al.
Pubblicazione: (2025)
di: Oliveira, Geraldo F., et al.
Pubblicazione: (2025)
TeraPool: A Physical Design Aware, 1024 RISC-V Cores Shared-L1-Memory Scaled-up Cluster Design with High Bandwidth Main Memory Link
di: Zhang, Yichao, et al.
Pubblicazione: (2026)
di: Zhang, Yichao, et al.
Pubblicazione: (2026)
Adaptive KV Cache Reuse for Fast Long-Context LLM Serving
di: li, Fei, et al.
Pubblicazione: (2026)
di: li, Fei, et al.
Pubblicazione: (2026)
New Tools, Programming Models, and System Support for Processing-in-Memory Architectures
di: Oliveira, Geraldo F.
Pubblicazione: (2025)
di: Oliveira, Geraldo F.
Pubblicazione: (2025)
ARKV: Adaptive and Resource-Efficient KV Cache Management under Limited Memory Budget for Long-Context Inference in LLMs
di: Lei, Jianlong, et al.
Pubblicazione: (2026)
di: Lei, Jianlong, et al.
Pubblicazione: (2026)
LFOC: A Lightweight Fairness-Oriented Cache Clustering Policy for Commodity Multicores
di: García-García, Adrián, et al.
Pubblicazione: (2024)
di: García-García, Adrián, et al.
Pubblicazione: (2024)
pLUTo: Enabling Massively Parallel Computation in DRAM via Lookup Tables
di: Ferreira, João Dinis, et al.
Pubblicazione: (2021)
di: Ferreira, João Dinis, et al.
Pubblicazione: (2021)
BlockAMC: Scalable In-Memory Analog Matrix Computing for Solving Linear Systems
di: Pan, Lunshuai, et al.
Pubblicazione: (2024)
di: Pan, Lunshuai, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Athena: Synergizing Data Prefetching and Off-Chip Prediction via Online Reinforcement Learning
di: Bera, Rahul, et al.
Pubblicazione: (2026) -
CIPHERMATCH: Accelerating Homomorphic Encryption-Based String Matching via Memory-Efficient Data Packing and In-Flash Processing
di: Kabra, Mayank, et al.
Pubblicazione: (2025) -
Mitigating the Memory Bottleneck with Machine Learning-Driven and Data-Aware Microarchitectural Techniques
di: Bera, Rahul
Pubblicazione: (2026) -
Conduit: Programmer-Transparent Near-Data Processing Using Multiple Compute-Capable Resources in Solid State Drives
di: Nadig, Rakesh, et al.
Pubblicazione: (2026) -
Memory-Centric Computing: Solving Computing's Memory Problem
di: Mutlu, Onur, et al.
Pubblicazione: (2025)