Learning Linear Attention in Polynomial Time
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yau, Morris, Akyürek, Ekin, Mao, Jiayuan, Tenenbaum, Joshua B., Jegelka, Stefanie, Andreas, Jacob |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Are Graph Neural Networks Optimal Approximation Algorithms?
par: Yau, Morris, et autres
Publié: (2023)
par: Yau, Morris, et autres
Publié: (2023)
Polynomial-Time Approximability of Constrained Reinforcement Learning
par: McMahan, Jeremy
Publié: (2025)
par: McMahan, Jeremy
Publié: (2025)
A Polynomial-Time Approximation for Pairwise Fair $k$-Median Clustering
par: Bandyapadhyay, Sayan, et autres
Publié: (2024)
par: Bandyapadhyay, Sayan, et autres
Publié: (2024)
GateLoop: Fully Data-Controlled Linear Recurrence for Sequence Modeling
par: Katsch, Tobias
Publié: (2023)
par: Katsch, Tobias
Publié: (2023)
Learning to Approximate Uniform Facility Location via Graph Neural Networks
par: Qian, Chendi, et autres
Publié: (2026)
par: Qian, Chendi, et autres
Publié: (2026)
Identification for Tree-shaped Structural Causal Models in Polynomial Time
par: Gupta, Aaryan, et autres
Publié: (2023)
par: Gupta, Aaryan, et autres
Publié: (2023)
HashEvict: A Pre-Attention KV Cache Eviction Strategy using Locality-Sensitive Hashing
par: Liu, Minghui, et autres
Publié: (2024)
par: Liu, Minghui, et autres
Publié: (2024)
Linear-Time Algorithms for Front-Door Adjustment in Causal Graphs
par: Wienöbst, Marcel, et autres
Publié: (2022)
par: Wienöbst, Marcel, et autres
Publié: (2022)
Linear-Time Primitives for Algorithm Development in Graphical Causal Inference
par: Wienöbst, Marcel, et autres
Publié: (2025)
par: Wienöbst, Marcel, et autres
Publié: (2025)
Streaming Attention Approximation via Discrepancy Theory
par: Kochetkova, Ekaterina, et autres
Publié: (2025)
par: Kochetkova, Ekaterina, et autres
Publié: (2025)
Positional Attention: Expressivity and Learnability of Algorithmic Computation
par: de Luca, Artur Back, et autres
Publié: (2024)
par: de Luca, Artur Back, et autres
Publié: (2024)
On Characterizations for Language Generation: Interplay of Hallucinations, Breadth, and Stability
par: Kalavasis, Alkis, et autres
Publié: (2024)
par: Kalavasis, Alkis, et autres
Publié: (2024)
On the Limits of Language Generation: Trade-Offs Between Hallucination and Mode Collapse
par: Kalavasis, Alkis, et autres
Publié: (2024)
par: Kalavasis, Alkis, et autres
Publié: (2024)
On Language Generation in the Limit with Bounded Memory
par: Kleinberg, Jon, et autres
Publié: (2026)
par: Kleinberg, Jon, et autres
Publié: (2026)
Language Generation in the Limit
par: Kleinberg, Jon, et autres
Publié: (2024)
par: Kleinberg, Jon, et autres
Publié: (2024)
Differentially Private Language Generation and Identification in the Limit
par: Mehrotra, Anay, et autres
Publié: (2026)
par: Mehrotra, Anay, et autres
Publié: (2026)
Exploring Facets of Language Generation in the Limit
par: Charikar, Moses, et autres
Publié: (2024)
par: Charikar, Moses, et autres
Publié: (2024)
The CLRS-Text Algorithmic Reasoning Language Benchmark
par: Markeeva, Larisa, et autres
Publié: (2024)
par: Markeeva, Larisa, et autres
Publié: (2024)
Contrastive Identification and Generation in the Limit
par: Li, Xiaoyu, et autres
Publié: (2026)
par: Li, Xiaoyu, et autres
Publié: (2026)
Language Generation with Infinite Contamination
par: Mehrotra, Anay, et autres
Publié: (2025)
par: Mehrotra, Anay, et autres
Publié: (2025)
A Characterization of List Language Identification in the Limit
par: Charikar, Moses, et autres
Publié: (2025)
par: Charikar, Moses, et autres
Publié: (2025)
Pareto-optimal Non-uniform Language Generation
par: Charikar, Moses, et autres
Publié: (2025)
par: Charikar, Moses, et autres
Publié: (2025)
A Tighter Complexity Analysis of SparseGPT
par: Li, Xiaoyu, et autres
Publié: (2024)
par: Li, Xiaoyu, et autres
Publié: (2024)
The Library Theorem: How External Organization Governs Agentic Reasoning Capacity
par: Mainen, Zachary F.
Publié: (2026)
par: Mainen, Zachary F.
Publié: (2026)
Extremely Simple Streaming Forest
par: Xu, Haoyin, et autres
Publié: (2021)
par: Xu, Haoyin, et autres
Publié: (2021)
Anytime-Constrained Equilibria in Polynomial Time
par: McMahan, Jeremy
Publié: (2024)
par: McMahan, Jeremy
Publié: (2024)
SubGen: Token Generation in Sublinear Time and Memory
par: Zandieh, Amir, et autres
Publié: (2024)
par: Zandieh, Amir, et autres
Publié: (2024)
Nearly Optimal Attention Coresets
par: Liberty, Edo, et autres
Publié: (2026)
par: Liberty, Edo, et autres
Publié: (2026)
Learning Algorithms in the Limit
par: Papazov, Hristo, et autres
Publié: (2025)
par: Papazov, Hristo, et autres
Publié: (2025)
Computing Optimal Regularizers for Online Linear Optimization
par: Gatmiry, Khashayar, et autres
Publié: (2024)
par: Gatmiry, Khashayar, et autres
Publié: (2024)
Anytime-Constrained Reinforcement Learning
par: McMahan, Jeremy, et autres
Publié: (2023)
par: McMahan, Jeremy, et autres
Publié: (2023)
Learning-Augmented Priority Queues
par: Benomar, Ziyad, et autres
Publié: (2024)
par: Benomar, Ziyad, et autres
Publié: (2024)
On Tradeoffs in Learning-Augmented Algorithms
par: Benomar, Ziyad, et autres
Publié: (2025)
par: Benomar, Ziyad, et autres
Publié: (2025)
Learning-Augmented Online Bipartite Fractional Matching
par: Choo, Davin, et autres
Publié: (2025)
par: Choo, Davin, et autres
Publié: (2025)
Learning-Based Algorithms for Graph Searching Problems
par: DePavia, Adela Frances, et autres
Publié: (2024)
par: DePavia, Adela Frances, et autres
Publié: (2024)
Neuro-symbolic Syntactic Parsing: Shaping a Neural Network with the CYK Algorithm
par: Zanzotto, Fabio Massimo, et autres
Publié: (2026)
par: Zanzotto, Fabio Massimo, et autres
Publié: (2026)
A Partition Cover Approach to Tokenization
par: Lim, Jia Peng, et autres
Publié: (2025)
par: Lim, Jia Peng, et autres
Publié: (2025)
Algorithmically Establishing Trust in Evaluators
par: de Wynter, Adrian
Publié: (2025)
par: de Wynter, Adrian
Publié: (2025)
An Algorithm for Learning Smaller Representations of Models With Scarce Data
par: de Wynter, Adrian
Publié: (2020)
par: de Wynter, Adrian
Publié: (2020)
Efficiently Learning Branching Networks for Multitask Algorithmic Reasoning
par: Li, Dongyue, et autres
Publié: (2025)
par: Li, Dongyue, et autres
Publié: (2025)
Documents similaires
-
Are Graph Neural Networks Optimal Approximation Algorithms?
par: Yau, Morris, et autres
Publié: (2023) -
Polynomial-Time Approximability of Constrained Reinforcement Learning
par: McMahan, Jeremy
Publié: (2025) -
A Polynomial-Time Approximation for Pairwise Fair $k$-Median Clustering
par: Bandyapadhyay, Sayan, et autres
Publié: (2024) -
GateLoop: Fully Data-Controlled Linear Recurrence for Sequence Modeling
par: Katsch, Tobias
Publié: (2023) -
Learning to Approximate Uniform Facility Location via Graph Neural Networks
par: Qian, Chendi, et autres
Publié: (2026)