On the Expressivity of Selective State-Space Layers: A Multivariate Polynomial Approach
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cohen-Karlik, Edo, Zimerman, Itamar, Galanti, Liane, Atad, Ido, Globerson, Amir, Wolf, Lior |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TensorLens: End-to-End Transformer Analysis via High-Order Attention Tensors
par: Atad, Ido Andrew, et autres
Publié: (2026)
par: Atad, Ido Andrew, et autres
Publié: (2026)
The Hidden Attention of Mamba Models
par: Ali, Ameen, et autres
Publié: (2024)
par: Ali, Ameen, et autres
Publié: (2024)
Explaining Modern Gated-Linear RNNs via a Unified Implicit Attention Formulation
par: Zimerman, Itamar, et autres
Publié: (2024)
par: Zimerman, Itamar, et autres
Publié: (2024)
Overclocking LLM Reasoning: Monitoring and Controlling Thinking Path Lengths in LLMs
par: Eisenstadt, Roy, et autres
Publié: (2025)
par: Eisenstadt, Roy, et autres
Publié: (2025)
Revisiting LRP: Positional Attribution as the Missing Ingredient for Transformer Explainability
par: Bakish, Yarden, et autres
Publié: (2025)
par: Bakish, Yarden, et autres
Publié: (2025)
MEMTIER: Tiered Memory Architecture and Retrieval Bottleneck Analysis for Long-Running Autonomous AI Agents
par: Sidik, Bronislav, et autres
Publié: (2026)
par: Sidik, Bronislav, et autres
Publié: (2026)
Power-Softmax: Towards Secure LLM Inference over Encrypted Data
par: Zimerman, Itamar, et autres
Publié: (2024)
par: Zimerman, Itamar, et autres
Publié: (2024)
SeRpEnt: Selective Resampling for Expressive State Space Models
par: Rando, Stefano, et autres
Publié: (2025)
par: Rando, Stefano, et autres
Publié: (2025)
Observation of unconventional van der Waals multiferroics near room temperature
par: Wu, Yangliu, et autres
Publié: (2023)
par: Wu, Yangliu, et autres
Publié: (2023)
Leveraging Log Probabilities in Language Models to Forecast Future Events
par: Soru, Tommaso, et autres
Publié: (2025)
par: Soru, Tommaso, et autres
Publié: (2025)
RWKV-7 "Goose" with Expressive Dynamic State Evolution
par: Peng, Bo, et autres
Publié: (2025)
par: Peng, Bo, et autres
Publié: (2025)
NeuronSpark: A Spiking Neural Network Language Model with Selective State Space Dynamics
par: Tang, Zhengzheng
Publié: (2026)
par: Tang, Zhengzheng
Publié: (2026)
Compact 780 nm Rb Optical Clock
par: Chen, Zhendong, et autres
Publié: (2025)
par: Chen, Zhendong, et autres
Publié: (2025)
A Batch Update Using Multiplicative Noise Modelling for Extended Object Tracking
par: Gramsch, Christian, et autres
Publié: (2024)
par: Gramsch, Christian, et autres
Publié: (2024)
CBR -- Boosting Adaptive Classification By Retrieval of Encrypted Network Traffic with Out-of-distribution
par: Lukach, Amir, et autres
Publié: (2024)
par: Lukach, Amir, et autres
Publié: (2024)
An Explainable Collaborative Dialogue System using a Theory of Mind
par: Cohen, Philip R., et autres
Publié: (2023)
par: Cohen, Philip R., et autres
Publié: (2023)
From Learning to Analytics: Improving Model Efficacy with Goal-Directed Client Selection
par: Tong, Jingwen, et autres
Publié: (2024)
par: Tong, Jingwen, et autres
Publié: (2024)
EnergyMamba: An Uncertainty-Aware Graph-Enhanced Selective State Space Model for Energy Consumption Prediction
par: Yu, Dahai, et autres
Publié: (2026)
par: Yu, Dahai, et autres
Publié: (2026)
Combined DL-UL Distributed Beamforming Design for Cell-Free Massive MIMO
par: Gouda, Bikshapathi, et autres
Publié: (2024)
par: Gouda, Bikshapathi, et autres
Publié: (2024)
Pilot-Aided Distributed Multi-Group Multicast Precoding Design for Cell-Free Massive MIMO
par: Gouda, Bikshapathi, et autres
Publié: (2022)
par: Gouda, Bikshapathi, et autres
Publié: (2022)
Circularity and Symmetries of $p$ and $p^{2}$-polygons
par: Haag, Rolf
Publié: (2025)
par: Haag, Rolf
Publié: (2025)
Toward Architecture-Aware Evaluation Metrics for LLM Agents
par: Souza, Débora, et autres
Publié: (2026)
par: Souza, Débora, et autres
Publié: (2026)
The Curious Case of In-Training Compression of State Space Models
par: Chahine, Makram, et autres
Publié: (2025)
par: Chahine, Makram, et autres
Publié: (2025)
Layer-Aware Embedding Fusion for LLMs in Text Classifications
par: Gwak, Jiho, et autres
Publié: (2025)
par: Gwak, Jiho, et autres
Publié: (2025)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
par: Peters, Sydney, et autres
Publié: (2025)
par: Peters, Sydney, et autres
Publié: (2025)
CRISP: Persistent Concept Unlearning via Sparse Autoencoders
par: Ashuach, Tomer, et autres
Publié: (2025)
par: Ashuach, Tomer, et autres
Publié: (2025)
Personality, Role, and Expressive Style in Large Language Models: An Interactionist Analysis
par: Nagao, Moe, et autres
Publié: (2026)
par: Nagao, Moe, et autres
Publié: (2026)
Mobile Phone Sensor-based Nigerian Driving Dataset to Detect Alcohol-influenced Behaviours
par: Thompson, Iniakpokeikiye Peter, et autres
Publié: (2025)
par: Thompson, Iniakpokeikiye Peter, et autres
Publié: (2025)
Random Heterogeneous Neurochaos Learning Architecture for Data Classification
par: S, Remya Ajai A, et autres
Publié: (2024)
par: S, Remya Ajai A, et autres
Publié: (2024)
PromptSAM+: Malware Detection based on Prompt Segment Anything Model
par: Wei, Xingyuan, et autres
Publié: (2024)
par: Wei, Xingyuan, et autres
Publié: (2024)
Simulating Influence Dynamics with LLM Agents
par: Nasim, Mehwish, et autres
Publié: (2025)
par: Nasim, Mehwish, et autres
Publié: (2025)
Evaluating the efficacy of LLM Safety Solutions : The Palit Benchmark Dataset
par: Palit, Sayon, et autres
Publié: (2025)
par: Palit, Sayon, et autres
Publié: (2025)
Revisiting Intermediate-Layer Matching in Knowledge Distillation: Layer-Selection Strategy Doesn't Matter (Much)
par: Yu, Zony, et autres
Publié: (2025)
par: Yu, Zony, et autres
Publié: (2025)
LLM Questionnaire Completion for Automatic Psychiatric Assessment
par: Rosenman, Gony, et autres
Publié: (2024)
par: Rosenman, Gony, et autres
Publié: (2024)
From Pixels to Privacy: Temporally Consistent Video Anonymization via Token Pruning for Privacy Preserving Action Recognition
par: Aslam, Nazia, et autres
Publié: (2026)
par: Aslam, Nazia, et autres
Publié: (2026)
LLM-Rubric: A Multidimensional, Calibrated Approach to Automated Evaluation of Natural Language Texts
par: Hashemi, Helia, et autres
Publié: (2024)
par: Hashemi, Helia, et autres
Publié: (2024)
Automated Bug Triaging using Instruction-Tuned Large Language Models
par: Kiashemshaki, Kiana, et autres
Publié: (2025)
par: Kiashemshaki, Kiana, et autres
Publié: (2025)
Merge-Bench: Resolve Merge Conflicts with Large Language Models
par: Schesch, Benedikt, et autres
Publié: (2026)
par: Schesch, Benedikt, et autres
Publié: (2026)
Sequential Cohort Selection
par: Nana, Hortence Phalonne, et autres
Publié: (2025)
par: Nana, Hortence Phalonne, et autres
Publié: (2025)
Software Implementation of Digital Filtering via Tustin's Bilinear Transform
par: Herron, Connor W.
Publié: (2024)
par: Herron, Connor W.
Publié: (2024)
Documents similaires
-
TensorLens: End-to-End Transformer Analysis via High-Order Attention Tensors
par: Atad, Ido Andrew, et autres
Publié: (2026) -
The Hidden Attention of Mamba Models
par: Ali, Ameen, et autres
Publié: (2024) -
Explaining Modern Gated-Linear RNNs via a Unified Implicit Attention Formulation
par: Zimerman, Itamar, et autres
Publié: (2024) -
Overclocking LLM Reasoning: Monitoring and Controlling Thinking Path Lengths in LLMs
par: Eisenstadt, Roy, et autres
Publié: (2025) -
Revisiting LRP: Positional Attribution as the Missing Ingredient for Transformer Explainability
par: Bakish, Yarden, et autres
Publié: (2025)