Compressed-Sensing-Guided, Inference-Aware Structured Reduction for Large Language Models
Fuente:
arXiv
Gespeichert in:
| 1. Verfasser: | Kiruluta, Andrew |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Entropic-Time Inference: Self-Organizing Large Language Model Decoding Beyond Attention
von: Kiruluta, Andrew
Veröffentlicht: (2026)
von: Kiruluta, Andrew
Veröffentlicht: (2026)
Spectral Generative Flow Models: A Physics-Inspired Replacement for Vectorized Large Language Models
von: Kiruluta, Andrew
Veröffentlicht: (2026)
von: Kiruluta, Andrew
Veröffentlicht: (2026)
From Attention to Atoms: Spectral Dictionary Learning for Fast, Interpretable Language Models
von: Kiruluta, Andrew
Veröffentlicht: (2025)
von: Kiruluta, Andrew
Veröffentlicht: (2025)
State Fourier Diffusion Language Model (SFDLM): A Scalable, Novel Iterative Approach to Language Modeling
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
From Gradients to Riccati Geometry: Kalman World Models for Single-Pass Learning
von: Kiruluta, Andrew
Veröffentlicht: (2026)
von: Kiruluta, Andrew
Veröffentlicht: (2026)
Data-Driven Variational Basis Learning Beyond Neural Networks: A Non-Neural Framework for Adaptive Basis Discovery
von: Kiruluta, Andrew
Veröffentlicht: (2026)
von: Kiruluta, Andrew
Veröffentlicht: (2026)
Adaptive Two Sided Laplace Transforms: A Learnable, Interpretable, and Scalable Replacement for Self-Attention
von: Kiruluta, Andrew
Veröffentlicht: (2025)
von: Kiruluta, Andrew
Veröffentlicht: (2025)
A Novel Architecture for Symbolic Reasoning with Decision Trees and LLM Agents
von: Kiruluta, Andrew
Veröffentlicht: (2025)
von: Kiruluta, Andrew
Veröffentlicht: (2025)
Filtering Beats Fine Tuning: A Bayesian Kalman View of In Context Learning in LLMs
von: Kiruluta, Andrew
Veröffentlicht: (2026)
von: Kiruluta, Andrew
Veröffentlicht: (2026)
History-Aware Cross-Attention Reinforcement: Self-Supervised Multi Turn and Chain-of-Thought Fine-Tuning with vLLM
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
Spectral Neuro-Symbolic Reasoning II: Semantic Node Merging, Entailment Filtering, and Knowledge Graph Alignment
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
Compressed Sensing for Capability Localization in Large Language Models
von: Bair, Anna, et al.
Veröffentlicht: (2026)
von: Bair, Anna, et al.
Veröffentlicht: (2026)
CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
From Eigenmodes to Proofs: Integrating Graph Spectral Operators with Symbolic Interpretable Reasoning
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
Capability-Guided Compression: Toward Interpretability-Aware Budget Allocation for Large Language Models
von: Gupta, Rishaank
Veröffentlicht: (2026)
von: Gupta, Rishaank
Veröffentlicht: (2026)
Breaking Quadratic Barriers: A Non-Attention LLM for Ultra-Long Context Horizons
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
Learnable Multi-Scale Wavelet Transformer: A Novel Alternative to Self-Attention
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
FourierNAT: A Fourier-Mixing-Based Non-Autoregressive Transformer for Parallel Sequence Generation
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
Beyond Self Attention: A Subquadratic Fourier Wavelet Transformer with Multi Modal Fusion
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2021)
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2021)
Dynamic Compressing Prompts for Efficient Inference of Large Language Models
von: Hu, Jinwu, et al.
Veröffentlicht: (2025)
von: Hu, Jinwu, et al.
Veröffentlicht: (2025)
Enhancing and Accelerating Large Language Models via Instruction-Aware Contextual Compression
von: Hou, Haowen, et al.
Veröffentlicht: (2024)
von: Hou, Haowen, et al.
Veröffentlicht: (2024)
Structural Embedding Projection for Contextual Large Language Model Inference
von: Enoasmo, Vincent, et al.
Veröffentlicht: (2025)
von: Enoasmo, Vincent, et al.
Veröffentlicht: (2025)
Inference-Cost-Aware Dynamic Tree Construction for Efficient Inference in Large Language Models
von: Hong, Yinrong, et al.
Veröffentlicht: (2025)
von: Hong, Yinrong, et al.
Veröffentlicht: (2025)
Model Compression and Efficient Inference for Large Language Models: A Survey
von: Wang, Wenxiao, et al.
Veröffentlicht: (2024)
von: Wang, Wenxiao, et al.
Veröffentlicht: (2024)
Compression Laws for Large Language Models
von: Sengupta, Ayan, et al.
Veröffentlicht: (2025)
von: Sengupta, Ayan, et al.
Veröffentlicht: (2025)
Steering Vector Fields for Context-Aware Inference-Time Control in Large Language Models
von: Li, Jiaqian, et al.
Veröffentlicht: (2026)
von: Li, Jiaqian, et al.
Veröffentlicht: (2026)
Equipping Retrieval-Augmented Large Language Models with Document Structure Awareness
von: Xu, Lingnan, et al.
Veröffentlicht: (2025)
von: Xu, Lingnan, et al.
Veröffentlicht: (2025)
OWQ: Outlier-Aware Weight Quantization for Efficient Fine-Tuning and Inference of Large Language Models
von: Lee, Changhun, et al.
Veröffentlicht: (2023)
von: Lee, Changhun, et al.
Veröffentlicht: (2023)
Spectral Dictionary Learning for Generative Image Modeling
von: Kiruluta, Andrew
Veröffentlicht: (2025)
von: Kiruluta, Andrew
Veröffentlicht: (2025)
TRIM: Token Reduction and Inference Modeling for Cost-Effective Language Generation
von: Ruiz, Alfredo Garrachón, et al.
Veröffentlicht: (2024)
von: Ruiz, Alfredo Garrachón, et al.
Veröffentlicht: (2024)
Inference-Aware Prompt Optimization for Aligning Black-Box Large Language Models
von: Mahmud, Saaduddin, et al.
Veröffentlicht: (2025)
von: Mahmud, Saaduddin, et al.
Veröffentlicht: (2025)
Feasibility of Structuring Stress Documentation Using an Ontology-Guided Large Language Model
von: Kim, Hyeoneui, et al.
Veröffentlicht: (2025)
von: Kim, Hyeoneui, et al.
Veröffentlicht: (2025)
SoT: Structured-of-Thought Prompting Guides Multilingual Reasoning in Large Language Models
von: Qi, Rui, et al.
Veröffentlicht: (2025)
von: Qi, Rui, et al.
Veröffentlicht: (2025)
Structure Guided Large Language Model for SQL Generation
von: Zhang, Qinggang, et al.
Veröffentlicht: (2024)
von: Zhang, Qinggang, et al.
Veröffentlicht: (2024)
Lost in Inference: Rediscovering the Role of Natural Language Inference for Large Language Models
von: Madaan, Lovish, et al.
Veröffentlicht: (2024)
von: Madaan, Lovish, et al.
Veröffentlicht: (2024)
Position-Aware Depth Decay Decoding ($D^3$): Boosting Large Language Model Inference Efficiency
von: Fan, Siqi, et al.
Veröffentlicht: (2025)
von: Fan, Siqi, et al.
Veröffentlicht: (2025)
SPQ: An Ensemble Technique for Large Language Model Compression
von: Yao, Jiamin, et al.
Veröffentlicht: (2026)
von: Yao, Jiamin, et al.
Veröffentlicht: (2026)
Prompt Compression for Large Language Models: A Survey
von: Li, Zongqian, et al.
Veröffentlicht: (2024)
von: Li, Zongqian, et al.
Veröffentlicht: (2024)
Optimizing Singular Spectrum for Large Language Model Compression
von: Li, Dengjie, et al.
Veröffentlicht: (2025)
von: Li, Dengjie, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Entropic-Time Inference: Self-Organizing Large Language Model Decoding Beyond Attention
von: Kiruluta, Andrew
Veröffentlicht: (2026) -
Spectral Generative Flow Models: A Physics-Inspired Replacement for Vectorized Large Language Models
von: Kiruluta, Andrew
Veröffentlicht: (2026) -
From Attention to Atoms: Spectral Dictionary Learning for Fast, Interpretable Language Models
von: Kiruluta, Andrew
Veröffentlicht: (2025) -
State Fourier Diffusion Language Model (SFDLM): A Scalable, Novel Iterative Approach to Language Modeling
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025) -
From Gradients to Riccati Geometry: Kalman World Models for Single-Pass Learning
von: Kiruluta, Andrew
Veröffentlicht: (2026)