FourierNAT: A Fourier-Mixing-Based Non-Autoregressive Transformer for Parallel Sequence Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Kiruluta, Andrew, Lundy, Eric, Lemos, Andreas |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond Self Attention: A Subquadratic Fourier Wavelet Transformer with Multi Modal Fusion
di: Kiruluta, Andrew, et al.
Pubblicazione: (2021)
di: Kiruluta, Andrew, et al.
Pubblicazione: (2021)
State Fourier Diffusion Language Model (SFDLM): A Scalable, Novel Iterative Approach to Language Modeling
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
A Hybrid Wavelet-Fourier Method for Next-Generation Conditional Diffusion Models
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
Adaptive Two Sided Laplace Transforms: A Learnable, Interpretable, and Scalable Replacement for Self-Attention
di: Kiruluta, Andrew
Pubblicazione: (2025)
di: Kiruluta, Andrew
Pubblicazione: (2025)
Data-Driven Variational Basis Learning Beyond Neural Networks: A Non-Neural Framework for Adaptive Basis Discovery
di: Kiruluta, Andrew
Pubblicazione: (2026)
di: Kiruluta, Andrew
Pubblicazione: (2026)
Spectral Generative Flow Models: A Physics-Inspired Replacement for Vectorized Large Language Models
di: Kiruluta, Andrew
Pubblicazione: (2026)
di: Kiruluta, Andrew
Pubblicazione: (2026)
Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
Entropic-Time Inference: Self-Organizing Large Language Model Decoding Beyond Attention
di: Kiruluta, Andrew
Pubblicazione: (2026)
di: Kiruluta, Andrew
Pubblicazione: (2026)
From Gradients to Riccati Geometry: Kalman World Models for Single-Pass Learning
di: Kiruluta, Andrew
Pubblicazione: (2026)
di: Kiruluta, Andrew
Pubblicazione: (2026)
Learnable Multi-Scale Wavelet Transformer: A Novel Alternative to Self-Attention
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
Filtering Beats Fine Tuning: A Bayesian Kalman View of In Context Learning in LLMs
di: Kiruluta, Andrew
Pubblicazione: (2026)
di: Kiruluta, Andrew
Pubblicazione: (2026)
Breaking Quadratic Barriers: A Non-Attention LLM for Ultra-Long Context Horizons
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
Reducing Deep Network Complexity via Sparse Hierarchical Fourier Interaction Networks
di: Kiruluta, Andrew, et al.
Pubblicazione: (2017)
di: Kiruluta, Andrew, et al.
Pubblicazione: (2017)
Hierarchical Attention Diffusion Networks with Object Priors for Video Change Detection
di: Kiruluta, Andrew, et al.
Pubblicazione: (2024)
di: Kiruluta, Andrew, et al.
Pubblicazione: (2024)
From Eigenmodes to Proofs: Integrating Graph Spectral Operators with Symbolic Interpretable Reasoning
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
Operator-Based Machine Intelligence: A Hilbert Space Framework for Spectral Learning and Symbolic Reasoning
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
Unsupervised Machine Learning Hybrid Approach Integrating Linear Programming in Loss Function: A Robust Optimization Technique
di: Kiruluta, Andrew, et al.
Pubblicazione: (2024)
di: Kiruluta, Andrew, et al.
Pubblicazione: (2024)
Parameter-Efficient Fine-Tuning with Discrete Fourier Transform
di: Gao, Ziqi, et al.
Pubblicazione: (2024)
di: Gao, Ziqi, et al.
Pubblicazione: (2024)
Parallelizing Linear Transformers with the Delta Rule over Sequence Length
di: Yang, Songlin, et al.
Pubblicazione: (2024)
di: Yang, Songlin, et al.
Pubblicazione: (2024)
Structured Recurrent Mixers for Massively Parallelized Sequence Generation
di: Badger, Benjamin L.
Pubblicazione: (2026)
di: Badger, Benjamin L.
Pubblicazione: (2026)
Dimensionality Reduction in Sentence Transformer Vector Databases with Fast Fourier Transform
di: Bulgakov, Vitaly, et al.
Pubblicazione: (2024)
di: Bulgakov, Vitaly, et al.
Pubblicazione: (2024)
History-Aware Cross-Attention Reinforcement: Self-Supervised Multi Turn and Chain-of-Thought Fine-Tuning with vLLM
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
Linear Attention Sequence Parallelism
di: Sun, Weigao, et al.
Pubblicazione: (2024)
di: Sun, Weigao, et al.
Pubblicazione: (2024)
Robust and Unbounded Length Generalization in Autoregressive Transformer-Based Text-to-Speech
di: Battenberg, Eric, et al.
Pubblicazione: (2024)
di: Battenberg, Eric, et al.
Pubblicazione: (2024)
FAN: Fourier Analysis Networks
di: Dong, Yihong, et al.
Pubblicazione: (2024)
di: Dong, Yihong, et al.
Pubblicazione: (2024)
Beyond Neural Networks: Symbolic Reasoning over Wavelet Logic Graph Signals
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
Quantum Spectral Reasoning: A Non-Neural Architecture for Interpretable Machine Learning
di: Kiruluta, Andrew
Pubblicazione: (2025)
di: Kiruluta, Andrew
Pubblicazione: (2025)
Learning Extrapolative Sequence Transformations from Markov Chains
di: Hager, Sophia, et al.
Pubblicazione: (2025)
di: Hager, Sophia, et al.
Pubblicazione: (2025)
Reviving Any-Subset Autoregressive Models with Principled Parallel Sampling and Speculative Decoding
di: Guo, Gabe, et al.
Pubblicazione: (2025)
di: Guo, Gabe, et al.
Pubblicazione: (2025)
FourierMoE: Fourier Mixture-of-Experts Adaptation of Large Language Models
di: Jiang, Juyong, et al.
Pubblicazione: (2026)
di: Jiang, Juyong, et al.
Pubblicazione: (2026)
Transforming Chatbot Text: A Sequence-to-Sequence Approach
di: Reddy, Natesh, et al.
Pubblicazione: (2025)
di: Reddy, Natesh, et al.
Pubblicazione: (2025)
Cognitive Fatigue in Autoregressive Transformers: Formalization and Measurement
di: Marwah, Riju, et al.
Pubblicazione: (2026)
di: Marwah, Riju, et al.
Pubblicazione: (2026)
FoNE: Precise Single-Token Number Embeddings via Fourier Features
di: Zhou, Tianyi, et al.
Pubblicazione: (2025)
di: Zhou, Tianyi, et al.
Pubblicazione: (2025)
Pre-trained Large Language Models Use Fourier Features to Compute Addition
di: Zhou, Tianyi, et al.
Pubblicazione: (2024)
di: Zhou, Tianyi, et al.
Pubblicazione: (2024)
Dynamic Context Pruning for Efficient and Interpretable Autoregressive Transformers
di: Anagnostidis, Sotiris, et al.
Pubblicazione: (2023)
di: Anagnostidis, Sotiris, et al.
Pubblicazione: (2023)
On Mesa-Optimization in Autoregressively Trained Transformers: Emergence and Capability
di: Zheng, Chenyu, et al.
Pubblicazione: (2024)
di: Zheng, Chenyu, et al.
Pubblicazione: (2024)
When Latent Geometry Is Not Enough: Draft-Conditioned Latent Refinement for Non-Autoregressive Text Generation
di: Zhang, De Shuai
Pubblicazione: (2026)
di: Zhang, De Shuai
Pubblicazione: (2026)
Logit-KL Flow Matching: Non-Autoregressive Text Generation via Sampling-Hybrid Inference
di: Sevriugov, Egor, et al.
Pubblicazione: (2024)
di: Sevriugov, Egor, et al.
Pubblicazione: (2024)
ReFusion: A Diffusion Large Language Model with Parallel Autoregressive Decoding
di: Li, Jia-Nan, et al.
Pubblicazione: (2025)
di: Li, Jia-Nan, et al.
Pubblicazione: (2025)
Gated Associative Memory: A Parallel O(N) Architecture for Efficient Sequence Modeling
di: Acharya, Rishiraj
Pubblicazione: (2025)
di: Acharya, Rishiraj
Pubblicazione: (2025)
Documenti analoghi
-
Beyond Self Attention: A Subquadratic Fourier Wavelet Transformer with Multi Modal Fusion
di: Kiruluta, Andrew, et al.
Pubblicazione: (2021) -
State Fourier Diffusion Language Model (SFDLM): A Scalable, Novel Iterative Approach to Language Modeling
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025) -
A Hybrid Wavelet-Fourier Method for Next-Generation Conditional Diffusion Models
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025) -
Adaptive Two Sided Laplace Transforms: A Learnable, Interpretable, and Scalable Replacement for Self-Attention
di: Kiruluta, Andrew
Pubblicazione: (2025) -
Data-Driven Variational Basis Learning Beyond Neural Networks: A Non-Neural Framework for Adaptive Basis Discovery
di: Kiruluta, Andrew
Pubblicazione: (2026)