HAVEN: High-Bandwidth Flash Augmented Vector Engine for Large-Scale Approximate Nearest-Neighbor Search Acceleration
Fuente:
arXiv
Guardado en:
| Autores principales: | Hsu, Po-Kai, Xu, Weihong, Liu, Qunyou, Rosing, Tajana, Yu, Shimeng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Proxima: Near-storage Acceleration for Graph-based Approximate Nearest Neighbor Search in 3D NAND
por: Xu, Weihong, et al.
Publicado: (2023)
por: Xu, Weihong, et al.
Publicado: (2023)
Stratum: System-Hardware Co-Design with Tiered Monolithic 3D-Stackable DRAM for Efficient MoE Serving
por: Pan, Yue, et al.
Publicado: (2025)
por: Pan, Yue, et al.
Publicado: (2025)
SpANNS: Optimizing Approximate Nearest Neighbor Search for Sparse Vectors Using Near Memory Processing
por: Zhang, Tianqi, et al.
Publicado: (2026)
por: Zhang, Tianqi, et al.
Publicado: (2026)
SpecPCM: A Low-power PCM-based In-Memory Computing Accelerator for Full-stack Mass Spectrometry Analysis
por: Fan, Keming, et al.
Publicado: (2024)
por: Fan, Keming, et al.
Publicado: (2024)
Cognition Engines: A Row-Scale HVDC Architecture for Computational Continuity of AI
por: Churnock, Paul
Publicado: (2025)
por: Churnock, Paul
Publicado: (2025)
Scalable Digital Compute-in-Memory Ising Machines for Robustness Verification of Binary Neural Networks
por: Vadlamani, Madhav, et al.
Publicado: (2026)
por: Vadlamani, Madhav, et al.
Publicado: (2026)
SLIM: A Heterogeneous Accelerator for Edge Inference of Sparse Large Language Model via Adaptive Thresholding
por: Xu, Weihong, et al.
Publicado: (2025)
por: Xu, Weihong, et al.
Publicado: (2025)
RACE-IT: A Reconfigurable Analog Computing Engine for In-Memory Transformer Acceleration
por: Zhao, Lei, et al.
Publicado: (2023)
por: Zhao, Lei, et al.
Publicado: (2023)
Hardware Accelerators for Artificial Intelligence
por: Ahsan, S M Mojahidul, et al.
Publicado: (2024)
por: Ahsan, S M Mojahidul, et al.
Publicado: (2024)
Towards Efficient Flash Caches with Emerging NVMe Flexible Data Placement SSDs
por: Allison, Michael, et al.
Publicado: (2025)
por: Allison, Michael, et al.
Publicado: (2025)
Function Approximation Using Analog Building Blocks in Flexible Electronics
por: Duarte, Paula Carolina Lozano, et al.
Publicado: (2025)
por: Duarte, Paula Carolina Lozano, et al.
Publicado: (2025)
Hybrid Temporal Computing for Lower Power Hardware Accelerators
por: Tasnim, Maliha, et al.
Publicado: (2024)
por: Tasnim, Maliha, et al.
Publicado: (2024)
Architecture-Level Modeling of Photonic Deep Neural Network Accelerators
por: Andrulis, Tanner, et al.
Publicado: (2024)
por: Andrulis, Tanner, et al.
Publicado: (2024)
KVNAND: Efficient On-Device Large Language Model Inference Using DRAM-Free In-Flash Computing
por: Deng, Lishuo, et al.
Publicado: (2025)
por: Deng, Lishuo, et al.
Publicado: (2025)
Fault Tolerant Design of IGZO-based Binary Search ADCs
por: Duarte, Paula Carolina Lozano, et al.
Publicado: (2026)
por: Duarte, Paula Carolina Lozano, et al.
Publicado: (2026)
Online Soft Error Tolerance in ReRAM Crossbars for Deep Learning Accelerators
por: Khezeli, Benyamin, et al.
Publicado: (2024)
por: Khezeli, Benyamin, et al.
Publicado: (2024)
Content Addressable Memory Design with Reference Resistor for Improved Search Resolution
por: Narla, Siri, et al.
Publicado: (2025)
por: Narla, Siri, et al.
Publicado: (2025)
XL-HD: Extended Learning in Hyperdimensional Computing via Deterministic Projections for In-Memory Accelerators
por: Moon, Sabrina Hassan, et al.
Publicado: (2026)
por: Moon, Sabrina Hassan, et al.
Publicado: (2026)
ARMAN: A Reconfigurable Monolithic 3D Accelerator Architecture for Convolutional Neural Networks
por: Sedaghatgoo, Ali, et al.
Publicado: (2024)
por: Sedaghatgoo, Ali, et al.
Publicado: (2024)
Scaling Analog Photonic Accelerators for Byte-Size, Integer General Matrix Multiply (GEMM) Kernels
por: Alo, Oluwaseun Adewunmi, et al.
Publicado: (2024)
por: Alo, Oluwaseun Adewunmi, et al.
Publicado: (2024)
MPAI: A Co-Processing Architecture with MPSoC & AI Accelerators for Vision Applications in Space
por: Leon, Vasileios, et al.
Publicado: (2024)
por: Leon, Vasileios, et al.
Publicado: (2024)
Cross-layer Modeling and Design of Content Addressable Memories in Advanced Technology Nodes for Similarity Search
por: Narla, Siri, et al.
Publicado: (2024)
por: Narla, Siri, et al.
Publicado: (2024)
Scaling up Reversible Logic with HKI Superconducting Inductors
por: DeBenedictis, Erik P.
Publicado: (2025)
por: DeBenedictis, Erik P.
Publicado: (2025)
A 5T-2MTJ STT-assisted Spin Orbit Torque based Ternary Content Addressable Memory for Hardware Accelerators
por: Narla, Siri, et al.
Publicado: (2024)
por: Narla, Siri, et al.
Publicado: (2024)
Characterization of Off-wafer Pulse Communication in BrainScaleS Neuromorphic System
por: Vogginger, Bernhard, et al.
Publicado: (2026)
por: Vogginger, Bernhard, et al.
Publicado: (2026)
The Dawn of AI-Native EDA: Opportunities and Challenges of Large Circuit Models
por: Chen, Lei, et al.
Publicado: (2024)
por: Chen, Lei, et al.
Publicado: (2024)
STAMP-2.5D: Structural and Thermal Aware Methodology for Placement in 2.5D Integration
por: Parekh, Varun Darshana, et al.
Publicado: (2025)
por: Parekh, Varun Darshana, et al.
Publicado: (2025)
CQ-CiM: Hardware-Aware Embedding Shaping for Robust CiM-Based Retrieval
por: Li, Xinzhao, et al.
Publicado: (2026)
por: Li, Xinzhao, et al.
Publicado: (2026)
Single-Cell Universal Logic-in-Memory Using 2T-nC FeRAM: An Area and Energy-Efficient Approach for Bulk Bitwise Computation
por: Biswas, Rudra, et al.
Publicado: (2025)
por: Biswas, Rudra, et al.
Publicado: (2025)
Probabilistic approximate optimization using single-photon avalanche diode arrays
por: Alswaidan, Ziyad, et al.
Publicado: (2026)
por: Alswaidan, Ziyad, et al.
Publicado: (2026)
Lightening-Transformer: A Dynamically-operated Optically-interconnected Photonic Transformer Accelerator
por: Zhu, Hanqing, et al.
Publicado: (2023)
por: Zhu, Hanqing, et al.
Publicado: (2023)
Approximate Computing Survey, Part I: Terminology and Software & Hardware Approximation Techniques
por: Leon, Vasileios, et al.
Publicado: (2023)
por: Leon, Vasileios, et al.
Publicado: (2023)
A Novel Thermal Network Model and Electro-Thermal Coupling Study for NSFETs and CFETs Considering Thermal Crosstalk
por: Miao, Tianci, et al.
Publicado: (2025)
por: Miao, Tianci, et al.
Publicado: (2025)
Length-Matching Routing for Programmable Photonic Circuits Using Best-First Strategy
por: Wang, Xiaoke, et al.
Publicado: (2025)
por: Wang, Xiaoke, et al.
Publicado: (2025)
Frequency as Aperture: Enabling Embeddable Near-Field Sensing for 6G Wireless Radios
por: Ho, Pin-Han, et al.
Publicado: (2026)
por: Ho, Pin-Han, et al.
Publicado: (2026)
PICO-RAM: A PVT-Insensitive Analog Compute-In-Memory SRAM Macro with In-Situ Multi-Bit Charge Computing and 6T Thin-Cell-Compatible Layout
por: Chen, Zhiyu, et al.
Publicado: (2024)
por: Chen, Zhiyu, et al.
Publicado: (2024)
SuperFlow: A Fully-Customized RTL-to-GDS Design Automation Flow for Adiabatic Quantum-Flux-Parametron Superconducting Circuits
por: Xie, Yanyue, et al.
Publicado: (2024)
por: Xie, Yanyue, et al.
Publicado: (2024)
Everything You Wanted to Know About Consumer Light Management in Smart Energy
por: Mohanty, Prajnyajit, et al.
Publicado: (2024)
por: Mohanty, Prajnyajit, et al.
Publicado: (2024)
Opportunities and Challenges for 3D Systems and Their Design
por: Emma, Philip, et al.
Publicado: (2025)
por: Emma, Philip, et al.
Publicado: (2025)
Sequencing on Silicon: AI SoC Design for Mobile Genomics at the Edge
por: Magierowski, Sebastian, et al.
Publicado: (2025)
por: Magierowski, Sebastian, et al.
Publicado: (2025)
Ejemplares similares
-
Proxima: Near-storage Acceleration for Graph-based Approximate Nearest Neighbor Search in 3D NAND
por: Xu, Weihong, et al.
Publicado: (2023) -
Stratum: System-Hardware Co-Design with Tiered Monolithic 3D-Stackable DRAM for Efficient MoE Serving
por: Pan, Yue, et al.
Publicado: (2025) -
SpANNS: Optimizing Approximate Nearest Neighbor Search for Sparse Vectors Using Near Memory Processing
por: Zhang, Tianqi, et al.
Publicado: (2026) -
SpecPCM: A Low-power PCM-based In-Memory Computing Accelerator for Full-stack Mass Spectrometry Analysis
por: Fan, Keming, et al.
Publicado: (2024) -
Cognition Engines: A Row-Scale HVDC Architecture for Computational Continuity of AI
por: Churnock, Paul
Publicado: (2025)