State Fourier Diffusion Language Model (SFDLM): A Scalable, Novel Iterative Approach to Language Modeling
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kiruluta, Andrew, Lemos, Andreas |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FourierNAT: A Fourier-Mixing-Based Non-Autoregressive Transformer for Parallel Sequence Generation
par: Kiruluta, Andrew, et autres
Publié: (2025)
par: Kiruluta, Andrew, et autres
Publié: (2025)
Beyond Self Attention: A Subquadratic Fourier Wavelet Transformer with Multi Modal Fusion
par: Kiruluta, Andrew, et autres
Publié: (2021)
par: Kiruluta, Andrew, et autres
Publié: (2021)
Spectral Generative Flow Models: A Physics-Inspired Replacement for Vectorized Large Language Models
par: Kiruluta, Andrew
Publié: (2026)
par: Kiruluta, Andrew
Publié: (2026)
A Hybrid Wavelet-Fourier Method for Next-Generation Conditional Diffusion Models
par: Kiruluta, Andrew, et autres
Publié: (2025)
par: Kiruluta, Andrew, et autres
Publié: (2025)
Entropic-Time Inference: Self-Organizing Large Language Model Decoding Beyond Attention
par: Kiruluta, Andrew
Publié: (2026)
par: Kiruluta, Andrew
Publié: (2026)
Adaptive Two Sided Laplace Transforms: A Learnable, Interpretable, and Scalable Replacement for Self-Attention
par: Kiruluta, Andrew
Publié: (2025)
par: Kiruluta, Andrew
Publié: (2025)
From Gradients to Riccati Geometry: Kalman World Models for Single-Pass Learning
par: Kiruluta, Andrew
Publié: (2026)
par: Kiruluta, Andrew
Publié: (2026)
Data-Driven Variational Basis Learning Beyond Neural Networks: A Non-Neural Framework for Adaptive Basis Discovery
par: Kiruluta, Andrew
Publié: (2026)
par: Kiruluta, Andrew
Publié: (2026)
Learnable Multi-Scale Wavelet Transformer: A Novel Alternative to Self-Attention
par: Kiruluta, Andrew, et autres
Publié: (2025)
par: Kiruluta, Andrew, et autres
Publié: (2025)
Filtering Beats Fine Tuning: A Bayesian Kalman View of In Context Learning in LLMs
par: Kiruluta, Andrew
Publié: (2026)
par: Kiruluta, Andrew
Publié: (2026)
Unsupervised Machine Learning Hybrid Approach Integrating Linear Programming in Loss Function: A Robust Optimization Technique
par: Kiruluta, Andrew, et autres
Publié: (2024)
par: Kiruluta, Andrew, et autres
Publié: (2024)
Breaking Quadratic Barriers: A Non-Attention LLM for Ultra-Long Context Horizons
par: Kiruluta, Andrew, et autres
Publié: (2025)
par: Kiruluta, Andrew, et autres
Publié: (2025)
From Eigenmodes to Proofs: Integrating Graph Spectral Operators with Symbolic Interpretable Reasoning
par: Kiruluta, Andrew, et autres
Publié: (2025)
par: Kiruluta, Andrew, et autres
Publié: (2025)
From Attention to Atoms: Spectral Dictionary Learning for Fast, Interpretable Language Models
par: Kiruluta, Andrew
Publié: (2025)
par: Kiruluta, Andrew
Publié: (2025)
Compressed-Sensing-Guided, Inference-Aware Structured Reduction for Large Language Models
par: Kiruluta, Andrew
Publié: (2026)
par: Kiruluta, Andrew
Publié: (2026)
Diffusion-State Policy Optimization for Masked Diffusion Language Models
par: Oba, Daisuke, et autres
Publié: (2026)
par: Oba, Daisuke, et autres
Publié: (2026)
Robust and Scalable Model Editing for Large Language Models
par: Chen, Yingfa, et autres
Publié: (2024)
par: Chen, Yingfa, et autres
Publié: (2024)
PIP: Perturbation-based Iterative Pruning for Large Language Models
par: Cao, Yi, et autres
Publié: (2025)
par: Cao, Yi, et autres
Publié: (2025)
Sequential Diffusion Language Models
par: Liu, Yangzhou, et autres
Publié: (2025)
par: Liu, Yangzhou, et autres
Publié: (2025)
Large Language Diffusion Models
par: Nie, Shen, et autres
Publié: (2025)
par: Nie, Shen, et autres
Publié: (2025)
Anchored Diffusion Language Model
par: Rout, Litu, et autres
Publié: (2025)
par: Rout, Litu, et autres
Publié: (2025)
Diffusion Guided Language Modeling
par: Lovelace, Justin, et autres
Publié: (2024)
par: Lovelace, Justin, et autres
Publié: (2024)
Iterative Layer-wise Distillation for Efficient Compression of Large Language Models
par: Kovalev, Grigory, et autres
Publié: (2025)
par: Kovalev, Grigory, et autres
Publié: (2025)
Reducing Deep Network Complexity via Sparse Hierarchical Fourier Interaction Networks
par: Kiruluta, Andrew, et autres
Publié: (2017)
par: Kiruluta, Andrew, et autres
Publié: (2017)
(How) Do Language Models Track State?
par: Li, Belinda Z., et autres
Publié: (2025)
par: Li, Belinda Z., et autres
Publié: (2025)
Pre-trained Large Language Models Use Fourier Features to Compute Addition
par: Zhou, Tianyi, et autres
Publié: (2024)
par: Zhou, Tianyi, et autres
Publié: (2024)
GPT-4o as the Gold Standard: A Scalable and General Purpose Approach to Filter Language Model Pretraining Data
par: Zhang, Jifan, et autres
Publié: (2024)
par: Zhang, Jifan, et autres
Publié: (2024)
Operator-Based Machine Intelligence: A Hilbert Space Framework for Spectral Learning and Symbolic Reasoning
par: Kiruluta, Andrew, et autres
Publié: (2025)
par: Kiruluta, Andrew, et autres
Publié: (2025)
Unforgettable Generalization in Language Models
par: Zhang, Eric, et autres
Publié: (2024)
par: Zhang, Eric, et autres
Publié: (2024)
History-Aware Cross-Attention Reinforcement: Self-Supervised Multi Turn and Chain-of-Thought Fine-Tuning with vLLM
par: Kiruluta, Andrew, et autres
Publié: (2025)
par: Kiruluta, Andrew, et autres
Publié: (2025)
Enhancing Authorship Attribution through Embedding Fusion: A Novel Approach with Masked and Encoder-Decoder Language Models
par: Kaushik, Arjun Ramesh, et autres
Publié: (2024)
par: Kaushik, Arjun Ramesh, et autres
Publié: (2024)
Diffusion Language Models Are Natively Length-Aware
par: Rossi, Vittorio, et autres
Publié: (2026)
par: Rossi, Vittorio, et autres
Publié: (2026)
Stability-Weighted Decoding for Diffusion Language Models
par: Wu, Yue, et autres
Publié: (2026)
par: Wu, Yue, et autres
Publié: (2026)
Scaling Beyond Masked Diffusion Language Models
par: Sahoo, Subham Sekhar, et autres
Publié: (2026)
par: Sahoo, Subham Sekhar, et autres
Publié: (2026)
Attention-Based Sampler for Diffusion Language Models
par: Zhou, Yuyan, et autres
Publié: (2026)
par: Zhou, Yuyan, et autres
Publié: (2026)
Forcing Diffuse Distributions out of Language Models
par: Zhang, Yiming, et autres
Publié: (2024)
par: Zhang, Yiming, et autres
Publié: (2024)
Decentralized Arena: Towards Democratic and Scalable Automatic Evaluation of Language Models
par: Yin, Yanbin, et autres
Publié: (2025)
par: Yin, Yanbin, et autres
Publié: (2025)
MONA: Muon Optimizer with Nesterov Acceleration for Scalable Language Model Training
par: Li, Jiacheng, et autres
Publié: (2026)
par: Li, Jiacheng, et autres
Publié: (2026)
Sparse Autoencoders Enable Scalable and Reliable Circuit Identification in Language Models
par: O'Neill, Charles, et autres
Publié: (2024)
par: O'Neill, Charles, et autres
Publié: (2024)
Faithfulness Measurable Masked Language Models
par: Madsen, Andreas, et autres
Publié: (2023)
par: Madsen, Andreas, et autres
Publié: (2023)
Documents similaires
-
FourierNAT: A Fourier-Mixing-Based Non-Autoregressive Transformer for Parallel Sequence Generation
par: Kiruluta, Andrew, et autres
Publié: (2025) -
Beyond Self Attention: A Subquadratic Fourier Wavelet Transformer with Multi Modal Fusion
par: Kiruluta, Andrew, et autres
Publié: (2021) -
Spectral Generative Flow Models: A Physics-Inspired Replacement for Vectorized Large Language Models
par: Kiruluta, Andrew
Publié: (2026) -
A Hybrid Wavelet-Fourier Method for Next-Generation Conditional Diffusion Models
par: Kiruluta, Andrew, et autres
Publié: (2025) -
Entropic-Time Inference: Self-Organizing Large Language Model Decoding Beyond Attention
par: Kiruluta, Andrew
Publié: (2026)