Accelerating String-Key Learned Index Structures via Memoization-based Incremental Training
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Kim, Minsu, Hwang, Jinwoo, Heo, Guseul, Cho, Seiyeon, Mahajan, Divya, Park, Jongse |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
NeuPIMs: NPU-PIM Heterogeneous Acceleration for Batched LLM Inferencing
von: Heo, Guseul, et al.
Veröffentlicht: (2024)
von: Heo, Guseul, et al.
Veröffentlicht: (2024)
MixDiT: Accelerating Image Diffusion Transformer Inference with Mixed-Precision MX Quantization
von: Kim, Daeun, et al.
Veröffentlicht: (2025)
von: Kim, Daeun, et al.
Veröffentlicht: (2025)
Pimba: A Processing-in-Memory Acceleration for Post-Transformer Large Language Model Serving
von: Kim, Wonung, et al.
Veröffentlicht: (2025)
von: Kim, Wonung, et al.
Veröffentlicht: (2025)
ONNXim: A Fast, Cycle-level Multi-core NPU Simulator
von: Ham, Hyungkyu, et al.
Veröffentlicht: (2024)
von: Ham, Hyungkyu, et al.
Veröffentlicht: (2024)
Neo: Real-Time On-Device 3D Gaussian Splatting with Reuse-and-Update Sorting Acceleration
von: Oh, Changhun, et al.
Veröffentlicht: (2025)
von: Oh, Changhun, et al.
Veröffentlicht: (2025)
DaCapo: Accelerating Continuous Learning in Autonomous Systems for Video Analytics
von: Kim, Yoonsung, et al.
Veröffentlicht: (2024)
von: Kim, Yoonsung, et al.
Veröffentlicht: (2024)
JSPIM: A Skew-Aware PIM Accelerator for High-Performance Databases Join and Select Operations
von: Tajdari, Sabiha, et al.
Veröffentlicht: (2025)
von: Tajdari, Sabiha, et al.
Veröffentlicht: (2025)
Déjà Vu Packing: Optimizing FPGA Logic Clustering Runtime via Pattern Memoization
von: Liebster, Milo, et al.
Veröffentlicht: (2026)
von: Liebster, Milo, et al.
Veröffentlicht: (2026)
Diba: A Re-configurable Stream Processor
von: Najafi, Mohammadreza, et al.
Veröffentlicht: (2023)
von: Najafi, Mohammadreza, et al.
Veröffentlicht: (2023)
SpANNS: Optimizing Approximate Nearest Neighbor Search for Sparse Vectors Using Near Memory Processing
von: Zhang, Tianqi, et al.
Veröffentlicht: (2026)
von: Zhang, Tianqi, et al.
Veröffentlicht: (2026)
Enthuse: Efficient Adaptable High-throughput Streaming Aggregation Engines
von: Papaphilippou, Philippos, et al.
Veröffentlicht: (2024)
von: Papaphilippou, Philippos, et al.
Veröffentlicht: (2024)
HDDB: Efficient In-Storage SQL Database Search Using Hyperdimensional Computing on Ferroelectric NAND Flash
von: Zhao, Quanling, et al.
Veröffentlicht: (2025)
von: Zhao, Quanling, et al.
Veröffentlicht: (2025)
SwiftSpatial: Spatial Joins on Modern Hardware
von: Jiang, Wenqi, et al.
Veröffentlicht: (2023)
von: Jiang, Wenqi, et al.
Veröffentlicht: (2023)
Analyzing Performance Characteristics of PostgreSQL and MariaDB on NVMeVirt
von: Han, Juhee, et al.
Veröffentlicht: (2024)
von: Han, Juhee, et al.
Veröffentlicht: (2024)
GraphMatch: Subgraph Query Processing on FPGAs
von: Dann, Jonas, et al.
Veröffentlicht: (2024)
von: Dann, Jonas, et al.
Veröffentlicht: (2024)
Oaken: Fast and Efficient LLM Serving with Online-Offline Hybrid KV Cache Quantization
von: Kim, Minsu, et al.
Veröffentlicht: (2025)
von: Kim, Minsu, et al.
Veröffentlicht: (2025)
Heterogeneous Acceleration Pipeline for Recommendation System Training
von: Adnan, Muhammad, et al.
Veröffentlicht: (2022)
von: Adnan, Muhammad, et al.
Veröffentlicht: (2022)
Efficient Batch Search Algorithm for B+ Tree Index Structures with Level-Wise Traversal on FPGAs
von: Tzschoppe, Max, et al.
Veröffentlicht: (2026)
von: Tzschoppe, Max, et al.
Veröffentlicht: (2026)
APINT: A Full-Stack Framework for Acceleration of Privacy-Preserving Inference of Transformers based on Garbled Circuits
von: Cho, Hyunjun, et al.
Veröffentlicht: (2025)
von: Cho, Hyunjun, et al.
Veröffentlicht: (2025)
DiSC: Resolution-Scalable Acceleration of Diffusion Models by Exploiting Sparsity and Cached Token Reuse with Hash-based Distribution
von: Yoon, Jieon, et al.
Veröffentlicht: (2026)
von: Yoon, Jieon, et al.
Veröffentlicht: (2026)
LPU: A Latency-Optimized and Highly Scalable Processor for Large Language Model Inference
von: Moon, Seungjae, et al.
Veröffentlicht: (2024)
von: Moon, Seungjae, et al.
Veröffentlicht: (2024)
Workload-Aware Hardware Accelerator Mining for Distributed Deep Learning Training
von: Adnan, Muhammad, et al.
Veröffentlicht: (2024)
von: Adnan, Muhammad, et al.
Veröffentlicht: (2024)
A Host-SSD Collaborative Write Accelerator for LSM-Tree-Based Key-Value Stores
von: Kim, KiHwan, et al.
Veröffentlicht: (2024)
von: Kim, KiHwan, et al.
Veröffentlicht: (2024)
IANUS: Integrated Accelerator based on NPU-PIM Unified Memory System
von: Seo, Minseok, et al.
Veröffentlicht: (2024)
von: Seo, Minseok, et al.
Veröffentlicht: (2024)
Towards Efficient Flash Caches with Emerging NVMe Flexible Data Placement SSDs
von: Allison, Michael, et al.
Veröffentlicht: (2025)
von: Allison, Michael, et al.
Veröffentlicht: (2025)
Qute: Towards Quantum-Native Database
von: Chen, Muzhi, et al.
Veröffentlicht: (2026)
von: Chen, Muzhi, et al.
Veröffentlicht: (2026)
NasZip: Software and Hardware Co-Design to Accelerate Approximate Nearest Neighbor Search with DIMM-Based Near-Data Processing
von: Zou, Cheng, et al.
Veröffentlicht: (2026)
von: Zou, Cheng, et al.
Veröffentlicht: (2026)
Don't Persist All : Efficient Persistent Data Structures
von: Mahapatra, Pratyush, et al.
Veröffentlicht: (2019)
von: Mahapatra, Pratyush, et al.
Veröffentlicht: (2019)
HURRY: Highly Utilized, Reconfigurable ReRAM-based In-situ Accelerator with Multifunctionality
von: Shin, Hery, et al.
Veröffentlicht: (2024)
von: Shin, Hery, et al.
Veröffentlicht: (2024)
AERO: Adaptive Erase Operation for Improving Lifetime and Performance of Modern NAND Flash-Based SSDs
von: Cho, Sungjun, et al.
Veröffentlicht: (2024)
von: Cho, Sungjun, et al.
Veröffentlicht: (2024)
ZipFlow: a Compiler-based Framework to Unleash Compressed Data Movement for Modern GPUs
von: Yeo, Gwangoo, et al.
Veröffentlicht: (2026)
von: Yeo, Gwangoo, et al.
Veröffentlicht: (2026)
An Analog and Digital Hybrid Attention Accelerator for Transformers with Charge-based In-memory Computing
von: Moradifirouzabadi, Ashkan, et al.
Veröffentlicht: (2024)
von: Moradifirouzabadi, Ashkan, et al.
Veröffentlicht: (2024)
Memory Hierarchy Design for Caching Middleware in the Age of NVM
von: Ghandeharizadeh, Shahram, et al.
Veröffentlicht: (2025)
von: Ghandeharizadeh, Shahram, et al.
Veröffentlicht: (2025)
SAL-PIM: A Subarray-level Processing-in-Memory Architecture with LUT-based Linear Interpolation for Transformer-based Text Generation
von: Han, Wontak, et al.
Veröffentlicht: (2024)
von: Han, Wontak, et al.
Veröffentlicht: (2024)
Hardware-based Heterogeneous Memory Management for Large Language Model Inference
von: Hwang, Soojin, et al.
Veröffentlicht: (2025)
von: Hwang, Soojin, et al.
Veröffentlicht: (2025)
SAIL: SRAM-Accelerated LLM Inference System with Lookup-Table-based GEMV
von: Zhang, Jingyao, et al.
Veröffentlicht: (2025)
von: Zhang, Jingyao, et al.
Veröffentlicht: (2025)
A Tensor-Train Decomposition based Compression of LLMs on Group Vector Systolic Accelerator
von: Huang, Sixiao, et al.
Veröffentlicht: (2025)
von: Huang, Sixiao, et al.
Veröffentlicht: (2025)
MASQ: Accelerating Masked Diffusion via Stage-Wise Multi-Precision Quantization
von: Kim, Seeyeon, et al.
Veröffentlicht: (2026)
von: Kim, Seeyeon, et al.
Veröffentlicht: (2026)
FIGLUT: An Energy-Efficient Accelerator Design for FP-INT GEMM Using Look-Up Tables
von: Park, Gunho, et al.
Veröffentlicht: (2025)
von: Park, Gunho, et al.
Veröffentlicht: (2025)
All-rounder: A Flexible AI Accelerator with Diverse Data Format Support and Morphable Structure for Multi-DNN Processing
von: Noh, Seock-Hwan, et al.
Veröffentlicht: (2023)
von: Noh, Seock-Hwan, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
NeuPIMs: NPU-PIM Heterogeneous Acceleration for Batched LLM Inferencing
von: Heo, Guseul, et al.
Veröffentlicht: (2024) -
MixDiT: Accelerating Image Diffusion Transformer Inference with Mixed-Precision MX Quantization
von: Kim, Daeun, et al.
Veröffentlicht: (2025) -
Pimba: A Processing-in-Memory Acceleration for Post-Transformer Large Language Model Serving
von: Kim, Wonung, et al.
Veröffentlicht: (2025) -
ONNXim: A Fast, Cycle-level Multi-core NPU Simulator
von: Ham, Hyungkyu, et al.
Veröffentlicht: (2024) -
Neo: Real-Time On-Device 3D Gaussian Splatting with Reuse-and-Update Sorting Acceleration
von: Oh, Changhun, et al.
Veröffentlicht: (2025)