Closing the Theory-Practice Gap in Spiking Transformers via Effective Dimension
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Guo, Dongxin, Wu, Jikun, Yiu, Siu Ming |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SigGate-GT: Taming Over-Smoothing in Graph Transformers via Sigmoid-Gated Attention
par: Guo, Dongxin, et autres
Publié: (2026)
par: Guo, Dongxin, et autres
Publié: (2026)
SafeAnchor: Preventing Cumulative Safety Erosion in Continual Domain Adaptation of Large Language Models
par: Guo, Dongxin, et autres
Publié: (2026)
par: Guo, Dongxin, et autres
Publié: (2026)
mlx-snn: Spiking Neural Networks on Apple Silicon via MLX
par: Qin, Jiahao
Publié: (2026)
par: Qin, Jiahao
Publié: (2026)
PH-VAE: A Polynomial Hierarchical Variational Autoencoder Towards Disentangled Representation Learning
par: Chen, Xi, et autres
Publié: (2025)
par: Chen, Xi, et autres
Publié: (2025)
Optimizing Inference in Transformer-Based Models: A Multi-Method Benchmark
par: Ho, Siu Hang, et autres
Publié: (2025)
par: Ho, Siu Hang, et autres
Publié: (2025)
Spiking Sequence Machines and Transformers
par: Bose, Joy
Publié: (2026)
par: Bose, Joy
Publié: (2026)
A Boltzmann-machine-enhanced Transformer For DNA Sequence Classification
par: Cao, Zhixuan, et autres
Publié: (2026)
par: Cao, Zhixuan, et autres
Publié: (2026)
Geometric Metrics for MoE Specialization: From Fisher Information to Early Failure Detection
par: Guo, Dongxin, et autres
Publié: (2026)
par: Guo, Dongxin, et autres
Publié: (2026)
KAN vs LSTM Performance in Time Series Forecasting
par: Rather, Tabish Ali, et autres
Publié: (2025)
par: Rather, Tabish Ali, et autres
Publié: (2025)
Explicit Dropout: Deterministic Regularization for Transformer Architectures
par: Agrawal, Vidhi, et autres
Publié: (2026)
par: Agrawal, Vidhi, et autres
Publié: (2026)
CellARC: Measuring Intelligence with Cellular Automata
par: Lžičař, Miroslav
Publié: (2025)
par: Lžičař, Miroslav
Publié: (2025)
Parameter-Efficient Neuroevolution for Diverse LLM Generation: Quality-Diversity Optimization via Prompt Embedding Evolution
par: Guo, Dongxin, et autres
Publié: (2026)
par: Guo, Dongxin, et autres
Publié: (2026)
When Do Early-Exit Networks Generalize? A PAC-Bayesian Theory of Adaptive Depth
par: Guo, Dongxin, et autres
Publié: (2026)
par: Guo, Dongxin, et autres
Publié: (2026)
Guiding Sparse Neural Networks with Neurobiological Principles to Elicit Biologically Plausible Representations
par: Inoue, Patrick, et autres
Publié: (2026)
par: Inoue, Patrick, et autres
Publié: (2026)
Perforated Neural Networks for Keyword Spotting
par: Gopal, Vishy, et autres
Publié: (2026)
par: Gopal, Vishy, et autres
Publié: (2026)
Estimating the Event-Related Potential from Few EEG Trials
par: Nørskov, Anders Vestergaard, et autres
Publié: (2025)
par: Nørskov, Anders Vestergaard, et autres
Publié: (2025)
Massive Redundancy in Gradient Transport Enables Sparse Online Learning
par: Merin, Aur Shalev
Publié: (2026)
par: Merin, Aur Shalev
Publié: (2026)
Is Cambodia the World's Largest Cashew Producer?
par: Chaya, Veasna, et autres
Publié: (2024)
par: Chaya, Veasna, et autres
Publié: (2024)
Unifying Physics- and Data-Driven Modeling via Novel Causal Spatiotemporal Graph Neural Network for Interpretable Epidemic Forecasting
par: Han, Shuai, et autres
Publié: (2025)
par: Han, Shuai, et autres
Publié: (2025)
Complex-Valued Phase-Coherent Transformer
par: Hioki, Leona
Publié: (2026)
par: Hioki, Leona
Publié: (2026)
torchsom: The Reference PyTorch Library for Self-Organizing Maps
par: Berthier, Louis, et autres
Publié: (2025)
par: Berthier, Louis, et autres
Publié: (2025)
The Coordinate System Problem in Persistent Structural Memory for Neural Architectures
par: Basu, Abhinaba
Publié: (2026)
par: Basu, Abhinaba
Publié: (2026)
CNN-LSTM Hybrid Model for AI-Driven Prediction of COVID-19 Severity from Spike Sequences and Clinical Data
par: Cheohen, Caio, et autres
Publié: (2025)
par: Cheohen, Caio, et autres
Publié: (2025)
Forecasting Coccidioidomycosis (Valley Fever) in Arizona: A Graph Neural Network Approach
par: Sarabi, Ali, et autres
Publié: (2025)
par: Sarabi, Ali, et autres
Publié: (2025)
A Hybrid Inductive-Transductive Network for Traffic Flow Imputation on Unsampled Locations
par: Rahimiasl, Mohammadmahdi, et autres
Publié: (2025)
par: Rahimiasl, Mohammadmahdi, et autres
Publié: (2025)
Mathematical Foundations of Neural Tangents and Infinite-Width Networks
par: Mysore, Rachana, et autres
Publié: (2025)
par: Mysore, Rachana, et autres
Publié: (2025)
Functional Similarity Metric for Neural Networks: Overcoming Parametric Ambiguity via Activation Region Analysis
par: Hennadii, Kutomanov
Publié: (2026)
par: Hennadii, Kutomanov
Publié: (2026)
H-Model: Dynamic Neural Architectures for Adaptive Processing
par: Hospodarchuk, Dmytro
Publié: (2025)
par: Hospodarchuk, Dmytro
Publié: (2025)
multivariateGPT: a decoder-only transformer for multivariate categorical and numeric data
par: Loza, Andrew J., et autres
Publié: (2025)
par: Loza, Andrew J., et autres
Publié: (2025)
VDW-GNNs: Vector diffusion wavelets for geometric graph neural networks
par: Johnson, David R., et autres
Publié: (2025)
par: Johnson, David R., et autres
Publié: (2025)
DecompKAN: Decomposed Patch-KAN for Long-Term Time Series Forecasting
par: Mysore, Naveen
Publié: (2026)
par: Mysore, Naveen
Publié: (2026)
Scaling Laws in the Tiny Regime: How Small Models Change Their Mistakes
par: Alnemari, Mohammed, et autres
Publié: (2026)
par: Alnemari, Mohammed, et autres
Publié: (2026)
Automated Detection of Circadian-Dependent Epileptic Biomarkers for Seizure Localization: A Machine Learning and Signal Processing Framework
par: Gashti, Mehdi Zekriyapanah, et autres
Publié: (2025)
par: Gashti, Mehdi Zekriyapanah, et autres
Publié: (2025)
An in-depth look at approximation via deep and narrow neural networks
par: Dommel, Joris, et autres
Publié: (2025)
par: Dommel, Joris, et autres
Publié: (2025)
CVCM Track Circuits Pre-emptive Failure Diagnostics for Predictive Maintenance Using Deep Neural Networks
par: Mukherjee, Debdeep, et autres
Publié: (2025)
par: Mukherjee, Debdeep, et autres
Publié: (2025)
EchoLSTM: A Self-Reflective Recurrent Network for Stabilizing Long-Range Memory
par: K, Prasanth K, et autres
Publié: (2025)
par: K, Prasanth K, et autres
Publié: (2025)
Efficient Morphology-Control Co-Design via Stackelberg Proximal Policy Optimization
par: Dai, Yanning, et autres
Publié: (2026)
par: Dai, Yanning, et autres
Publié: (2026)
GRALIS: A Unified Canonical Framework for Linear Attribution Methods via Riesz Representation
par: Fanale, Raimondo
Publié: (2026)
par: Fanale, Raimondo
Publié: (2026)
KEMP-PIP: A Feature-Fusion Based Approach for Pro-inflammatory Peptide Prediction
par: Niloy, Soumik Deb, et autres
Publié: (2026)
par: Niloy, Soumik Deb, et autres
Publié: (2026)
Tricks and Plug-ins for Gradient Boosting with Transformers
par: Fang, Biyi, et autres
Publié: (2025)
par: Fang, Biyi, et autres
Publié: (2025)
Documents similaires
-
SigGate-GT: Taming Over-Smoothing in Graph Transformers via Sigmoid-Gated Attention
par: Guo, Dongxin, et autres
Publié: (2026) -
SafeAnchor: Preventing Cumulative Safety Erosion in Continual Domain Adaptation of Large Language Models
par: Guo, Dongxin, et autres
Publié: (2026) -
mlx-snn: Spiking Neural Networks on Apple Silicon via MLX
par: Qin, Jiahao
Publié: (2026) -
PH-VAE: A Polynomial Hierarchical Variational Autoencoder Towards Disentangled Representation Learning
par: Chen, Xi, et autres
Publié: (2025) -
Optimizing Inference in Transformer-Based Models: A Multi-Method Benchmark
par: Ho, Siu Hang, et autres
Publié: (2025)