SOCKET: SOft Collision Kernel EsTimator for Sparse Attention
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Joshi, Sahil, Chowdhury, Agniva, Bellinger, Wyatt, Kanakamedala, Amar, Singh, Ekam, Le, Hoang Anh Duy, Desai, Aditya, Shrivastava, Anshumali |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RACE Attention: A Strictly Linear-Time Attention Layer for Training on Outrageously Large Contexts
par: Joshi, Sahil, et autres
Publié: (2025)
par: Joshi, Sahil, et autres
Publié: (2025)
Scout Before You Attend: Sketch-and-Walk Sparse Attention for Efficient LLM Inference
par: Le, Hoang Anh Duy, et autres
Publié: (2026)
par: Le, Hoang Anh Duy, et autres
Publié: (2026)
ZETA: a library for Zonotope-based EsTimation and fAult diagnosis of discrete-time systems
par: Rego, Brenner S., et autres
Publié: (2025)
par: Rego, Brenner S., et autres
Publié: (2025)
Inference Time Context Sparsity: Illusion or Opportunity?
par: Joshi, Sahil, et autres
Publié: (2026)
par: Joshi, Sahil, et autres
Publié: (2026)
IDentity with Locality: An ideal hash for gene sequence search
par: Desai, Aditya, et autres
Publié: (2024)
par: Desai, Aditya, et autres
Publié: (2024)
LeanQuant: Accurate and Scalable Large Language Model Quantization with Loss-error-aware Grid
par: Zhang, Tianyi, et autres
Publié: (2024)
par: Zhang, Tianyi, et autres
Publié: (2024)
Sketch to Adapt: Fine-Tunable Sketches for Efficient LLM Adaptation
par: Zhang, Tianyi, et autres
Publié: (2024)
par: Zhang, Tianyi, et autres
Publié: (2024)
NoMAD-Attention: Efficient LLM Inference on CPUs Through Multiply-add-free Attention
par: Zhang, Tianyi, et autres
Publié: (2024)
par: Zhang, Tianyi, et autres
Publié: (2024)
An Energy-Efficient Spiking Neural Network Architecture for Predictive Insulin Delivery
par: Shrivastava, Sahil
Publié: (2026)
par: Shrivastava, Sahil
Publié: (2026)
A Note on Kernel Functions of Dirichlet Spaces
par: Gehlawat, Sahil, et autres
Publié: (2024)
par: Gehlawat, Sahil, et autres
Publié: (2024)
A Provably Accurate Randomized Sampling Algorithm for Logistic Regression
par: Chowdhury, Agniva, et autres
Publié: (2024)
par: Chowdhury, Agniva, et autres
Publié: (2024)
KV Cache is 1 Bit Per Channel: Efficient Large Language Model Inference with Coupled Quantization
par: Zhang, Tianyi, et autres
Publié: (2024)
par: Zhang, Tianyi, et autres
Publié: (2024)
Superintelligent Retrieval Agent: The Next Frontier of Information Retrieval
par: Yang, Zeyu, et autres
Publié: (2026)
par: Yang, Zeyu, et autres
Publié: (2026)
What am I missing here?: Evaluating Large Language Models for Masked Sentence Prediction
par: Wyatt, Charlie, et autres
Publié: (2025)
par: Wyatt, Charlie, et autres
Publié: (2025)
Alternatives To Next Token Prediction In Text Generation -- A Survey
par: Wyatt, Charlie, et autres
Publié: (2025)
par: Wyatt, Charlie, et autres
Publié: (2025)
Revisiting Kernel Attention with Correlated Gaussian Process Representation
par: Bui, Long Minh, et autres
Publié: (2025)
par: Bui, Long Minh, et autres
Publié: (2025)
vAttention: Verified Sparse Attention
par: Desai, Aditya, et autres
Publié: (2025)
par: Desai, Aditya, et autres
Publié: (2025)
PERSOMA: PERsonalized SOft ProMpt Adapter Architecture for Personalized Language Prompting
par: Hebert, Liam, et autres
Publié: (2024)
par: Hebert, Liam, et autres
Publié: (2024)
Learning Scalable Structural Representations for Link Prediction with Bloom Signatures
par: Zhang, Tianyi, et autres
Publié: (2023)
par: Zhang, Tianyi, et autres
Publié: (2023)
CoSMoEs: Compact Sparse Mixture of Experts
par: Huber, Patrick, et autres
Publié: (2025)
par: Huber, Patrick, et autres
Publié: (2025)
ALGORITHM FOR THE PREDICTION OF THE REACTIVE FORCES DEVELOPED IN THE SOCKET OF TRANSFEMORAL AMPUTEES
par: JUAN FERNANDO RAMÍREZ
Publié: (2012)
par: JUAN FERNANDO RAMÍREZ
Publié: (2012)
CARAMEL: A Succinct Read-Only Lookup Table via Compressed Static Functions
par: Coleman, Benjamin, et autres
Publié: (2023)
par: Coleman, Benjamin, et autres
Publié: (2023)
Sparse Attention as Compact Kernel Regression
par: Santos, Saul, et autres
Publié: (2026)
par: Santos, Saul, et autres
Publié: (2026)
Empowering Distributed Training with Sparsity-driven Data Synchronization
par: Wang, Zhuang, et autres
Publié: (2023)
par: Wang, Zhuang, et autres
Publié: (2023)
To Compress or Not? Pushing the Frontier of Lossless GenAI Model Weights Compression with Exponent Concentration
par: Yang, Zeyu, et autres
Publié: (2025)
par: Yang, Zeyu, et autres
Publié: (2025)
CoVE: Compressed Vocabulary Expansion Makes Better LLM-based Recommender Systems
par: Zhang, Haochen, et autres
Publié: (2025)
par: Zhang, Haochen, et autres
Publié: (2025)
REFRAG: Rethinking RAG based Decoding
par: Lin, Xiaoqiang, et autres
Publié: (2025)
par: Lin, Xiaoqiang, et autres
Publié: (2025)
TP-GMOT: Tracking Generic Multiple Object by Textual Prompt with Motion-Appearance Cost (MAC) SORT
par: Anh, Duy Le Dinh, et autres
Publié: (2024)
par: Anh, Duy Le Dinh, et autres
Publié: (2024)
Sparse Robust Classification via the Kernel Mean
par: van Rooyen, Brendan, et autres
Publié: (2015)
par: van Rooyen, Brendan, et autres
Publié: (2015)
Parameter Estimation Limits in Blazars
par: Roychowdhury, Agniva
Publié: (2026)
par: Roychowdhury, Agniva
Publié: (2026)
Short Second Moment Bound for GL(2) $L$-functions in $q$-Aspect
par: Dasgupta, Agniva
Publié: (2023)
par: Dasgupta, Agniva
Publié: (2023)
Dual realizations of Bergman spaces on strongly convex domains
par: Chatterjee, Agniva
Publié: (2025)
par: Chatterjee, Agniva
Publié: (2025)
Minijets and Broken Stationarity in a Blazar : Novel Insights into the Origin of $γ$-ray Variability in CTA 102
par: Roychowdhury, Agniva
Publié: (2025)
par: Roychowdhury, Agniva
Publié: (2025)
Constructions and Isotopies of High-Dimensional Legendrian Spheres
par: Roy, Agniva
Publié: (2022)
par: Roy, Agniva
Publié: (2022)
The Laplace and Leray transforms on some (weakly) convex domains in $\mathbb{C}^2$
par: Chatterjee, Agniva
Publié: (2024)
par: Chatterjee, Agniva
Publié: (2024)
Reconnection-driven State Transitions in Flat Spectrum Radio Quasars
par: Roychowdhury, Agniva
Publié: (2026)
par: Roychowdhury, Agniva
Publié: (2026)
Grundbildung Medien im Studiengang Erwachsenenbildung
par: Bellinger, Franziska
Publié: (2023)
par: Bellinger, Franziska
Publié: (2023)
The Transformation from Microfilm to Digital Storage and Access.
par: Bellinger, Meg
Publié: (1998)
par: Bellinger, Meg
Publié: (1998)
Silence in the Quagmire: The Vietnam War in U.S. Comics. By Harriet, E. H. Earle Lincoln, NE: University of Nebraska Press, 2025. 198 Pages. $30.00 (paperback). ISBN: 978‐1‐4962‐4054‐5
par: Gwendolyn Bellinger
Publié: (2026)
par: Gwendolyn Bellinger
Publié: (2026)
Linearity of Structure Kernels in Main-sequence and Subgiant Solar-like Oscillators
par: Buchele, Lynn, et autres
Publié: (2025)
par: Buchele, Lynn, et autres
Publié: (2025)
Documents similaires
-
RACE Attention: A Strictly Linear-Time Attention Layer for Training on Outrageously Large Contexts
par: Joshi, Sahil, et autres
Publié: (2025) -
Scout Before You Attend: Sketch-and-Walk Sparse Attention for Efficient LLM Inference
par: Le, Hoang Anh Duy, et autres
Publié: (2026) -
ZETA: a library for Zonotope-based EsTimation and fAult diagnosis of discrete-time systems
par: Rego, Brenner S., et autres
Publié: (2025) -
Inference Time Context Sparsity: Illusion or Opportunity?
par: Joshi, Sahil, et autres
Publié: (2026) -
IDentity with Locality: An ideal hash for gene sequence search
par: Desai, Aditya, et autres
Publié: (2024)