xLSTM 7B: A Recurrent LLM for Fast and Efficient Inference
Fuente:
arXiv
Guardado en:
| Autores principales: | Beck, Maximilian, Pöppel, Korbinian, Lippe, Phillip, Kurle, Richard, Blies, Patrick M., Klambauer, Günter, Böck, Sebastian, Hochreiter, Sepp |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Tiled Flash Linear Attention: More Efficient Linear RNN and xLSTM Kernels
por: Beck, Maximilian, et al.
Publicado: (2025)
por: Beck, Maximilian, et al.
Publicado: (2025)
A Large Recurrent Action Model: xLSTM enables Fast Inference for Robotics Tasks
por: Schmied, Thomas, et al.
Publicado: (2024)
por: Schmied, Thomas, et al.
Publicado: (2024)
Vision-LSTM: xLSTM as Generic Vision Backbone
por: Alkin, Benedikt, et al.
Publicado: (2024)
por: Alkin, Benedikt, et al.
Publicado: (2024)
xLSTM: Extended Long Short-Term Memory
por: Beck, Maximilian, et al.
Publicado: (2024)
por: Beck, Maximilian, et al.
Publicado: (2024)
Effective Distillation to Hybrid xLSTM Architectures
por: Hauzenberger, Lukas, et al.
Publicado: (2026)
por: Hauzenberger, Lukas, et al.
Publicado: (2026)
xLSTM Scaling Laws: Competitive Performance with Linear Time-Complexity
por: Beck, Maximilian, et al.
Publicado: (2025)
por: Beck, Maximilian, et al.
Publicado: (2025)
FlashRNN: I/O-Aware Optimization of Traditional RNNs on modern hardware
por: Pöppel, Korbinian, et al.
Publicado: (2024)
por: Pöppel, Korbinian, et al.
Publicado: (2024)
Bio-xLSTM: Generative modeling, representation and in-context learning of biological and chemical sequences
por: Schmidinger, Niklas, et al.
Publicado: (2024)
por: Schmidinger, Niklas, et al.
Publicado: (2024)
pLSTM: parallelizable Linear Source Transition Mark networks
por: Pöppel, Korbinian, et al.
Publicado: (2025)
por: Pöppel, Korbinian, et al.
Publicado: (2025)
TiRex: Zero-Shot Forecasting Across Long and Short Horizons with Enhanced In-Context Learning
por: Auer, Andreas, et al.
Publicado: (2025)
por: Auer, Andreas, et al.
Publicado: (2025)
Adaptive Retrieval helps Reasoning in LLMs -- but mostly if it's not used
por: Shakya, Srijan, et al.
Publicado: (2026)
por: Shakya, Srijan, et al.
Publicado: (2026)
xLSTM-SENet: xLSTM for Single-Channel Speech Enhancement
por: Kühne, Nikolai Lund, et al.
Publicado: (2025)
por: Kühne, Nikolai Lund, et al.
Publicado: (2025)
When Mamba Meets xLSTM: An Efficient and Precise Method with the xLSTM-VMUNet Model for Skin lesion Segmentation
por: Fang, Zhuoyi, et al.
Publicado: (2024)
por: Fang, Zhuoyi, et al.
Publicado: (2024)
xLSTM-ECG: Multi-label ECG Classification via Feature Fusion with xLSTM
por: Kang, Lei, et al.
Publicado: (2025)
por: Kang, Lei, et al.
Publicado: (2025)
Distil-xLSTM: Learning Attention Mechanisms through Recurrent Structures
por: Thiombiano, Abdoul Majid O., et al.
Publicado: (2025)
por: Thiombiano, Abdoul Majid O., et al.
Publicado: (2025)
VN-EGNN: E(3)-Equivariant Graph Neural Networks with Virtual Nodes Enhance Protein Binding Site Identification
por: Sestak, Florian, et al.
Publicado: (2024)
por: Sestak, Florian, et al.
Publicado: (2024)
xLSTMTime : Long-term Time Series Forecasting With xLSTM
por: Alharthi, Musleh, et al.
Publicado: (2024)
por: Alharthi, Musleh, et al.
Publicado: (2024)
Seg-LSTM: Performance of xLSTM for Semantic Segmentation of Remotely Sensed Images
por: Zhu, Qinfeng, et al.
Publicado: (2024)
por: Zhu, Qinfeng, et al.
Publicado: (2024)
Symbol-Equivariant Recurrent Reasoning Models
por: Freinschlag, Richard, et al.
Publicado: (2026)
por: Freinschlag, Richard, et al.
Publicado: (2026)
MolGraph-xLSTM: A graph-based dual-level xLSTM framework with multi-head mixture-of-experts for enhanced molecular representation and interpretability
por: Sun, Yan, et al.
Publicado: (2025)
por: Sun, Yan, et al.
Publicado: (2025)
xLSTMAD: A Powerful xLSTM-based Method for Anomaly Detection
por: Faber, Kamil, et al.
Publicado: (2025)
por: Faber, Kamil, et al.
Publicado: (2025)
Benchmarking Transformer and xLSTM for Time-Series Forecasting of Heat Consumption
por: Wahl, Marja, et al.
Publicado: (2026)
por: Wahl, Marja, et al.
Publicado: (2026)
Pre-trained Forecasting Models: Strong Zero-Shot Feature Extractors for Time Series Classification
por: Auer, Andreas, et al.
Publicado: (2025)
por: Auer, Andreas, et al.
Publicado: (2025)
MoxE: Mixture of xLSTM Experts with Entropy-Aware Routing for Efficient Language Modeling
por: Thiombiano, Abdoul Majid O., et al.
Publicado: (2025)
por: Thiombiano, Abdoul Majid O., et al.
Publicado: (2025)
Enhancing Spatiotemporal Networks with xLSTM: A Scalar LSTM Approach for Cellular Traffic Forecasting
por: Ali, Khalid, et al.
Publicado: (2025)
por: Ali, Khalid, et al.
Publicado: (2025)
A Diffusion Model Framework for Unsupervised Neural Combinatorial Optimization
por: Sanokowski, Sebastian, et al.
Publicado: (2024)
por: Sanokowski, Sebastian, et al.
Publicado: (2024)
xLSTM-PINN: Memory-Gated Spectral Remodeling for Physics-Informed Learning
por: Tao, Ze, et al.
Publicado: (2025)
por: Tao, Ze, et al.
Publicado: (2025)
xLSTM-Mixer: Multivariate Time Series Forecasting by Mixing via Scalar Memories
por: Kraus, Maurice, et al.
Publicado: (2024)
por: Kraus, Maurice, et al.
Publicado: (2024)
MAL: Cluster-Masked and Multi-Task Pretraining for Enhanced xLSTM Vision Performance
por: Huang, Wenjun, et al.
Publicado: (2024)
por: Huang, Wenjun, et al.
Publicado: (2024)
Unlocking the Working Memory of Large Language Models for Latent Reasoning
por: Aichberger, Lukas, et al.
Publicado: (2026)
por: Aichberger, Lukas, et al.
Publicado: (2026)
AF-MAT: Aspect-aware Flip-and-Fuse xLSTM for Aspect-based Sentiment Analysis
por: Lawan, Adamu, et al.
Publicado: (2025)
por: Lawan, Adamu, et al.
Publicado: (2025)
Are Vision xLSTM Embedded UNet More Reliable in Medical 3D Image Segmentation?
por: Dutta, Pallabi, et al.
Publicado: (2024)
por: Dutta, Pallabi, et al.
Publicado: (2024)
A Deep Reinforcement Learning Approach to Automated Stock Trading, using xLSTM Networks
por: Sarlakifar, Faezeh, et al.
Publicado: (2025)
por: Sarlakifar, Faezeh, et al.
Publicado: (2025)
BALI: Learning Neural Networks via Bayesian Layerwise Inference
por: Kurle, Richard, et al.
Publicado: (2024)
por: Kurle, Richard, et al.
Publicado: (2024)
xLSTM-FER: Enhancing Student Expression Recognition with Extended Vision Long Short-Term Memory Network
por: Huang, Qionghao, et al.
Publicado: (2024)
por: Huang, Qionghao, et al.
Publicado: (2024)
Rethinking Uncertainty Estimation in LLMs: A Principled Single-Sequence Measure
por: Aichberger, Lukas, et al.
Publicado: (2024)
por: Aichberger, Lukas, et al.
Publicado: (2024)
Rethinking Losses for Diffusion Bridge Samplers
por: Sanokowski, Sebastian, et al.
Publicado: (2025)
por: Sanokowski, Sebastian, et al.
Publicado: (2025)
Learning Interactive World Model for Object-Centric Reinforcement Learning
por: Feng, Fan, et al.
Publicado: (2025)
por: Feng, Fan, et al.
Publicado: (2025)
AGA3DNet: Anatomy-Guided Gaussian Priors with Multi-view xLSTM for 3D Brain MRI Subtype Classification
por: Duan, Peiyu, et al.
Publicado: (2026)
por: Duan, Peiyu, et al.
Publicado: (2026)
xLSTM-UNet can be an Effective 2D & 3D Medical Image Segmentation Backbone with Vision-LSTM (ViL) better than its Mamba Counterpart
por: Chen, Tianrun, et al.
Publicado: (2024)
por: Chen, Tianrun, et al.
Publicado: (2024)
Ejemplares similares
-
Tiled Flash Linear Attention: More Efficient Linear RNN and xLSTM Kernels
por: Beck, Maximilian, et al.
Publicado: (2025) -
A Large Recurrent Action Model: xLSTM enables Fast Inference for Robotics Tasks
por: Schmied, Thomas, et al.
Publicado: (2024) -
Vision-LSTM: xLSTM as Generic Vision Backbone
por: Alkin, Benedikt, et al.
Publicado: (2024) -
xLSTM: Extended Long Short-Term Memory
por: Beck, Maximilian, et al.
Publicado: (2024) -
Effective Distillation to Hybrid xLSTM Architectures
por: Hauzenberger, Lukas, et al.
Publicado: (2026)