Online Vector Quantized Attention
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Alonso, Nick, Figliolia, Tomas, Millidge, Beren |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Toward Conversational Agents with Context and Time Sensitive Long-term Memory
par: Alonso, Nick, et autres
Publié: (2024)
par: Alonso, Nick, et autres
Publié: (2024)
Hybrid Associative Memories
par: Lufkin, Leon, et autres
Publié: (2026)
par: Lufkin, Leon, et autres
Publié: (2026)
Mixture-of-PageRanks: Replacing Long-Context with Real-Time, Sparse GraphRAG
par: Alonso, Nicholas, et autres
Publié: (2024)
par: Alonso, Nicholas, et autres
Publié: (2024)
Generalising E-prop to Deep Networks
par: Millidge, Beren
Publié: (2025)
par: Millidge, Beren
Publié: (2025)
Compressed Convolutional Attention: Efficient Attention in a Compressed Latent Space
par: Figliolia, Tomas, et autres
Publié: (2025)
par: Figliolia, Tomas, et autres
Publié: (2025)
Tree Attention: Topology-aware Decoding for Long-Context Attention on GPU clusters
par: Shyam, Vasudev, et autres
Publié: (2024)
par: Shyam, Vasudev, et autres
Publié: (2024)
Predictive Coding beyond Correlations
par: Salvatori, Tommaso, et autres
Publié: (2023)
par: Salvatori, Tommaso, et autres
Publié: (2023)
BlackMamba: Mixture of Experts for State-Space Models
par: Anthony, Quentin, et autres
Publié: (2024)
par: Anthony, Quentin, et autres
Publié: (2024)
Equivalence of Personalized PageRank and Successor Representations
par: Millidge, Beren
Publié: (2025)
par: Millidge, Beren
Publié: (2025)
A Review of Neuroscience-Inspired Machine Learning
par: Ororbia, Alexander, et autres
Publié: (2024)
par: Ororbia, Alexander, et autres
Publié: (2024)
ZUNA: Flexible EEG Superresolution with Position-Aware Diffusion Autoencoders
par: Warner, Christopher, et autres
Publié: (2026)
par: Warner, Christopher, et autres
Publié: (2026)
Associative Memories in the Feature Space
par: Salvatori, Tommaso, et autres
Publié: (2024)
par: Salvatori, Tommaso, et autres
Publié: (2024)
Zamba: A Compact 7B SSM Hybrid Model
par: Glorioso, Paolo, et autres
Publié: (2024)
par: Glorioso, Paolo, et autres
Publié: (2024)
The Zamba2 Suite: Technical Report
par: Glorioso, Paolo, et autres
Publié: (2024)
par: Glorioso, Paolo, et autres
Publié: (2024)
Pyramid Vector Quantization for LLMs
par: van der Ouderaa, Tycho F. A., et autres
Publié: (2024)
par: van der Ouderaa, Tycho F. A., et autres
Publié: (2024)
A Stable, Fast, and Fully Automatic Learning Algorithm for Predictive Coding Networks
par: Salvatori, Tommaso, et autres
Publié: (2022)
par: Salvatori, Tommaso, et autres
Publié: (2022)
Masked Vector Quantization
par: Nguyen, David D., et autres
Publié: (2023)
par: Nguyen, David D., et autres
Publié: (2023)
TurboQuant: Online Vector Quantization with Near-optimal Distortion Rate
par: Zandieh, Amir, et autres
Publié: (2025)
par: Zandieh, Amir, et autres
Publié: (2025)
Representation Collapsing Problems in Vector Quantization
par: Zhao, Wenhao, et autres
Publié: (2024)
par: Zhao, Wenhao, et autres
Publié: (2024)
Leech Lattice Vector Quantization for Efficient LLM Compression
par: van der Ouderaa, Tycho F. A., et autres
Publié: (2026)
par: van der Ouderaa, Tycho F. A., et autres
Publié: (2026)
Task Vector Quantization for Memory-Efficient Model Merging
par: Kim, Youngeun, et autres
Publié: (2025)
par: Kim, Youngeun, et autres
Publié: (2025)
Gaussian Mixture Vector Quantization with Aggregated Categorical Posterior
par: Yan, Mingyuan, et autres
Publié: (2024)
par: Yan, Mingyuan, et autres
Publié: (2024)
VP-VAE: Rethinking Vector Quantization via Adaptive Vector Perturbation
par: Zhai, Linwei, et autres
Publié: (2026)
par: Zhai, Linwei, et autres
Publié: (2026)
Mitigating Premature Discretization with Progressive Quantization for Robust Vector Tokenization
par: Zhao, Wenhao, et autres
Publié: (2026)
par: Zhao, Wenhao, et autres
Publié: (2026)
Generalized Radius and Integrated Codebook Transforms for Differentiable Vector Quantization
par: You, Haochen, et autres
Publié: (2026)
par: You, Haochen, et autres
Publié: (2026)
A Vector-Quantized Foundation Model for Patient Behavior Monitoring
par: Oliver, Rodrigo, et autres
Publié: (2025)
par: Oliver, Rodrigo, et autres
Publié: (2025)
SBVR: Summation of BitVector Representation for Efficient LLM Quantization
par: Bang, Wonjun, et autres
Publié: (2025)
par: Bang, Wonjun, et autres
Publié: (2025)
Efficient Generative Modeling with Residual Vector Quantization-Based Tokens
par: Kim, Jaehyeon, et autres
Publié: (2024)
par: Kim, Jaehyeon, et autres
Publié: (2024)
RWKVQuant: Quantizing the RWKV Family with Proxy Guided Hybrid of Scalar and Vector Quantization
par: Xu, Chen, et autres
Publié: (2025)
par: Xu, Chen, et autres
Publié: (2025)
4bit-Quantization in Vector-Embedding for RAG
par: Jeong, Taehee
Publié: (2025)
par: Jeong, Taehee
Publié: (2025)
Kernel $k$-Medoids as General Vector Quantization
par: Gerlach, Thore, et autres
Publié: (2025)
par: Gerlach, Thore, et autres
Publié: (2025)
Locally-Adaptive Quantization for Streaming Vector Search
par: Aguerrebere, Cecilia, et autres
Publié: (2024)
par: Aguerrebere, Cecilia, et autres
Publié: (2024)
Robust Training of Vector Quantized Bottleneck Models
par: Łańcucki, Adrian, et autres
Publié: (2020)
par: Łańcucki, Adrian, et autres
Publié: (2020)
BandVQ: Band-Wise Vector-Quantized EEG Foundation Model
par: Sukhbaatar, Jamiyan, et autres
Publié: (2026)
par: Sukhbaatar, Jamiyan, et autres
Publié: (2026)
Vector Quantization Prompting for Continual Learning
par: Jiao, Li, et autres
Publié: (2024)
par: Jiao, Li, et autres
Publié: (2024)
Restructuring Vector Quantization with the Rotation Trick
par: Fifty, Christopher, et autres
Publié: (2024)
par: Fifty, Christopher, et autres
Publié: (2024)
DiVeQ: Differentiable Vector Quantization Using the Reparameterization Trick
par: Vali, Mohammad Hassan, et autres
Publié: (2025)
par: Vali, Mohammad Hassan, et autres
Publié: (2025)
RAVQ-HoloNet: Rate-Adaptive Vector-Quantized Hologram Compression
par: Rafiei, Shima, et autres
Publié: (2025)
par: Rafiei, Shima, et autres
Publié: (2025)
LongVQ: Long Sequence Modeling with Vector Quantization on Structured Memory
par: Liu, Zicheng, et autres
Publié: (2024)
par: Liu, Zicheng, et autres
Publié: (2024)
Improving Vector-Quantized Image Modeling with Latent Consistency-Matching Diffusion
par: Nguyen, Bac, et autres
Publié: (2024)
par: Nguyen, Bac, et autres
Publié: (2024)
Documents similaires
-
Toward Conversational Agents with Context and Time Sensitive Long-term Memory
par: Alonso, Nick, et autres
Publié: (2024) -
Hybrid Associative Memories
par: Lufkin, Leon, et autres
Publié: (2026) -
Mixture-of-PageRanks: Replacing Long-Context with Real-Time, Sparse GraphRAG
par: Alonso, Nicholas, et autres
Publié: (2024) -
Generalising E-prop to Deep Networks
par: Millidge, Beren
Publié: (2025) -
Compressed Convolutional Attention: Efficient Attention in a Compressed Latent Space
par: Figliolia, Tomas, et autres
Publié: (2025)