FlashRNN: I/O-Aware Optimization of Traditional RNNs on modern hardware
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pöppel, Korbinian, Beck, Maximilian, Hochreiter, Sepp |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Tiled Flash Linear Attention: More Efficient Linear RNN and xLSTM Kernels
par: Beck, Maximilian, et autres
Publié: (2025)
par: Beck, Maximilian, et autres
Publié: (2025)
Vision-LSTM: xLSTM as Generic Vision Backbone
par: Alkin, Benedikt, et autres
Publié: (2024)
par: Alkin, Benedikt, et autres
Publié: (2024)
A Large Recurrent Action Model: xLSTM enables Fast Inference for Robotics Tasks
par: Schmied, Thomas, et autres
Publié: (2024)
par: Schmied, Thomas, et autres
Publié: (2024)
xLSTM: Extended Long Short-Term Memory
par: Beck, Maximilian, et autres
Publié: (2024)
par: Beck, Maximilian, et autres
Publié: (2024)
xLSTM 7B: A Recurrent LLM for Fast and Efficient Inference
par: Beck, Maximilian, et autres
Publié: (2025)
par: Beck, Maximilian, et autres
Publié: (2025)
HadamRNN: Binary and Sparse Ternary Orthogonal RNNs
par: Foucault, Armand, et autres
Publié: (2025)
par: Foucault, Armand, et autres
Publié: (2025)
A Diffusion Model Framework for Unsupervised Neural Combinatorial Optimization
par: Sanokowski, Sebastian, et autres
Publié: (2024)
par: Sanokowski, Sebastian, et autres
Publié: (2024)
Adaptive Retrieval helps Reasoning in LLMs -- but mostly if it's not used
par: Shakya, Srijan, et autres
Publié: (2026)
par: Shakya, Srijan, et autres
Publié: (2026)
pLSTM: parallelizable Linear Source Transition Mark networks
par: Pöppel, Korbinian, et autres
Publié: (2025)
par: Pöppel, Korbinian, et autres
Publié: (2025)
M$^2$RNN: Non-Linear RNNs with Matrix-Valued States for Scalable Language Modeling
par: Mishra, Mayank, et autres
Publié: (2026)
par: Mishra, Mayank, et autres
Publié: (2026)
On Information-Theoretic Measures of Predictive Uncertainty
par: Schweighofer, Kajetan, et autres
Publié: (2024)
par: Schweighofer, Kajetan, et autres
Publié: (2024)
Improving Uncertainty Estimation through Semantically Diverse Language Generation
par: Aichberger, Lukas, et autres
Publié: (2024)
par: Aichberger, Lukas, et autres
Publié: (2024)
Contrastive Abstraction for Reinforcement Learning
par: Patil, Vihang, et autres
Publié: (2024)
par: Patil, Vihang, et autres
Publié: (2024)
Addressing Pitfalls in the Evaluation of Uncertainty Estimation Methods for Natural Language Generation
par: Ielanskyi, Mykyta, et autres
Publié: (2025)
par: Ielanskyi, Mykyta, et autres
Publié: (2025)
The Disparate Benefits of Deep Ensembles
par: Schweighofer, Kajetan, et autres
Publié: (2024)
par: Schweighofer, Kajetan, et autres
Publié: (2024)
Rethinking Losses for Diffusion Bridge Samplers
par: Sanokowski, Sebastian, et autres
Publié: (2025)
par: Sanokowski, Sebastian, et autres
Publié: (2025)
Retrieval-Augmented Decision Transformer: External Memory for In-context RL
par: Schmied, Thomas, et autres
Publié: (2024)
par: Schmied, Thomas, et autres
Publié: (2024)
MIM-Refiner: A Contrastive Learning Boost from Intermediate Pre-Trained Representations
par: Alkin, Benedikt, et autres
Publié: (2024)
par: Alkin, Benedikt, et autres
Publié: (2024)
VN-EGNN: E(3)-Equivariant Graph Neural Networks with Virtual Nodes Enhance Protein Binding Site Identification
par: Sestak, Florian, et autres
Publié: (2024)
par: Sestak, Florian, et autres
Publié: (2024)
Scalable Discrete Diffusion Samplers: Combinatorial Optimization and Statistical Physics
par: Sanokowski, Sebastian, et autres
Publié: (2025)
par: Sanokowski, Sebastian, et autres
Publié: (2025)
Were RNNs All We Needed?
par: Feng, Leo, et autres
Publié: (2024)
par: Feng, Leo, et autres
Publié: (2024)
Memory Caching: RNNs with Growing Memory
par: Behrouz, Ali, et autres
Publié: (2026)
par: Behrouz, Ali, et autres
Publié: (2026)
Pessimistic Iterative Planning with RNNs for Robust POMDPs
par: Galesloot, Maris F. L., et autres
Publié: (2024)
par: Galesloot, Maris F. L., et autres
Publié: (2024)
$\texttt{lrnnx}$: A library for Linear RNNs
par: Bania, Karan, et autres
Publié: (2026)
par: Bania, Karan, et autres
Publié: (2026)
Parameter Efficient Fine-tuning via Explained Variance Adaptation
par: Paischer, Fabian, et autres
Publié: (2024)
par: Paischer, Fabian, et autres
Publié: (2024)
FlashOptim: Optimizers for Memory-Efficient Training
par: Ortiz, Jose Javier Gonzalez, et autres
Publié: (2026)
par: Ortiz, Jose Javier Gonzalez, et autres
Publié: (2026)
Balancing Sparse RNNs with Hyperparameterization Benefiting Meta-Learning
par: Hershey, Quincy, et autres
Publié: (2025)
par: Hershey, Quincy, et autres
Publié: (2025)
Implicit Language Models are RNNs: Balancing Parallelization and Expressivity
par: Schöne, Mark, et autres
Publié: (2025)
par: Schöne, Mark, et autres
Publié: (2025)
Stabilizing RNN Gradients through Pre-training
par: Herranz-Celotti, Luca, et autres
Publié: (2023)
par: Herranz-Celotti, Luca, et autres
Publié: (2023)
Does Transformer Interpretability Transfer to RNNs?
par: Paulo, Gonçalo, et autres
Publié: (2024)
par: Paulo, Gonçalo, et autres
Publié: (2024)
Towards Flash Thinking via Decoupled Advantage Policy Optimization
par: Tan, Zezhong, et autres
Publié: (2025)
par: Tan, Zezhong, et autres
Publié: (2025)
SymbolicAI: A framework for logic-based approaches combining generative models and solvers
par: Dinu, Marius-Constantin, et autres
Publié: (2024)
par: Dinu, Marius-Constantin, et autres
Publié: (2024)
Paradoxical noise preference in RNNs
par: Eckstein, Noah, et autres
Publié: (2026)
par: Eckstein, Noah, et autres
Publié: (2026)
xLSTM Scaling Laws: Competitive Performance with Linear Time-Complexity
par: Beck, Maximilian, et autres
Publié: (2025)
par: Beck, Maximilian, et autres
Publié: (2025)
Large Language Models Can Self-Improve At Web Agent Tasks
par: Patel, Ajay, et autres
Publié: (2024)
par: Patel, Ajay, et autres
Publié: (2024)
Learning Dynamics of RNNs in Closed-Loop Environments
par: Ger, Yoav, et autres
Publié: (2025)
par: Ger, Yoav, et autres
Publié: (2025)
Compositional Reasoning with Transformers, RNNs, and Chain of Thought
par: Yehudai, Gilad, et autres
Publié: (2025)
par: Yehudai, Gilad, et autres
Publié: (2025)
INT-FlashAttention: Enabling Flash Attention for INT8 Quantization
par: Chen, Shimao, et autres
Publié: (2024)
par: Chen, Shimao, et autres
Publié: (2024)
Utilizing RNN for Real-time Cryptocurrency Price Prediction and Trading Strategy Optimization
par: Tumpa, Shamima Nasrin, et autres
Publié: (2024)
par: Tumpa, Shamima Nasrin, et autres
Publié: (2024)
Flash PD-SSM: Memory-Optimized Structured Sparse State-Space Models
par: Terzić, Aleksandar, et autres
Publié: (2026)
par: Terzić, Aleksandar, et autres
Publié: (2026)
Documents similaires
-
Tiled Flash Linear Attention: More Efficient Linear RNN and xLSTM Kernels
par: Beck, Maximilian, et autres
Publié: (2025) -
Vision-LSTM: xLSTM as Generic Vision Backbone
par: Alkin, Benedikt, et autres
Publié: (2024) -
A Large Recurrent Action Model: xLSTM enables Fast Inference for Robotics Tasks
par: Schmied, Thomas, et autres
Publié: (2024) -
xLSTM: Extended Long Short-Term Memory
par: Beck, Maximilian, et autres
Publié: (2024) -
xLSTM 7B: A Recurrent LLM for Fast and Efficient Inference
par: Beck, Maximilian, et autres
Publié: (2025)