Structure and Redundancy in Large Language Models: A Spectral Study via Random Matrix Theory
Fuente:
arXiv
Salvato in:
| Autore principale: | Ettori, Davide |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Spectral Geometry for Deep Learning: Compression and Hallucination Detection via Random Matrix Theory
di: Ettori, Davide
Pubblicazione: (2026)
di: Ettori, Davide
Pubblicazione: (2026)
Exploring Graph Structure Comprehension Ability of Multimodal Large Language Models: Case Studies
di: Zhong, Zhiqiang, et al.
Pubblicazione: (2024)
di: Zhong, Zhiqiang, et al.
Pubblicazione: (2024)
Beyond Frequency: The Role of Redundancy in Large Language Model Memorization
di: Zhang, Jie, et al.
Pubblicazione: (2025)
di: Zhang, Jie, et al.
Pubblicazione: (2025)
Model-Distributed Inference for Large Language Models at the Edge
di: Macario, Davide, et al.
Pubblicazione: (2025)
di: Macario, Davide, et al.
Pubblicazione: (2025)
Quantifying the Reconstructability of Astrophysical Methods with Large Language Models and Information Theory: A Case Study in Spectral Reconstruction
di: Lin, Hsing Wen, et al.
Pubblicazione: (2026)
di: Lin, Hsing Wen, et al.
Pubblicazione: (2026)
$R^2$-dLLM: Accelerating Diffusion Large Language Models via Spatio-Temporal Redundancy Reduction
di: Du, Zhenbang, et al.
Pubblicazione: (2026)
di: Du, Zhenbang, et al.
Pubblicazione: (2026)
Detecting overfitting in Neural Networks during long-horizon grokking using Random Matrix Theory
di: Prakash, Hari K., et al.
Pubblicazione: (2026)
di: Prakash, Hari K., et al.
Pubblicazione: (2026)
TLoRA: Tri-Matrix Low-Rank Adaptation of Large Language Models
di: Islam, Tanvir
Pubblicazione: (2025)
di: Islam, Tanvir
Pubblicazione: (2025)
Redundancy and Concept Analysis for Code-trained Language Models
di: Sharma, Arushi, et al.
Pubblicazione: (2023)
di: Sharma, Arushi, et al.
Pubblicazione: (2023)
SPARC: Subspace-Aware Prompt Adaptation for Robust Continual Learning in LLMs
di: Jayasuriya, Dinithi, et al.
Pubblicazione: (2025)
di: Jayasuriya, Dinithi, et al.
Pubblicazione: (2025)
Maximizing the Potential of Synthetic Data: Insights from Random Matrix Theory
di: Firdoussi, Aymane El, et al.
Pubblicazione: (2024)
di: Firdoussi, Aymane El, et al.
Pubblicazione: (2024)
Intrinsic Muon: Spectral Optimization on Riemannian Matrix Manifolds
di: Li, Yibang, et al.
Pubblicazione: (2026)
di: Li, Yibang, et al.
Pubblicazione: (2026)
PRISM: Structured Optimization via Anisotropic Spectral Shaping
di: Yang, Yujie
Pubblicazione: (2026)
di: Yang, Yujie
Pubblicazione: (2026)
Spectral Editing of Activations for Large Language Model Alignment
di: Qiu, Yifu, et al.
Pubblicazione: (2024)
di: Qiu, Yifu, et al.
Pubblicazione: (2024)
Latent Structure of Affective Representations in Large Language Models
di: Choi, Benjamin J., et al.
Pubblicazione: (2026)
di: Choi, Benjamin J., et al.
Pubblicazione: (2026)
ElastiFormer: Learned Redundancy Reduction in Transformer via Self-Distillation
di: Liu, Junzhang, et al.
Pubblicazione: (2024)
di: Liu, Junzhang, et al.
Pubblicazione: (2024)
Interpretable Robot Control via Structured Behavior Trees and Large Language Models
di: Chekam, Ingrid Maéva, et al.
Pubblicazione: (2025)
di: Chekam, Ingrid Maéva, et al.
Pubblicazione: (2025)
A Systematic Study of Compression Ordering for Large Language Models
di: Chhawri, Shivansh, et al.
Pubblicazione: (2025)
di: Chhawri, Shivansh, et al.
Pubblicazione: (2025)
Redundancy as a Structural Information Principle for Learning and Generalization
di: Bi, Yuda, et al.
Pubblicazione: (2025)
di: Bi, Yuda, et al.
Pubblicazione: (2025)
Towards Machine Theory of Mind with Large Language Model-Augmented Inverse Planning
di: Gelpí, Rebekah A., et al.
Pubblicazione: (2025)
di: Gelpí, Rebekah A., et al.
Pubblicazione: (2025)
Understanding Post-Training Structural Changes in Large Language Models
di: He, Xinyu, et al.
Pubblicazione: (2025)
di: He, Xinyu, et al.
Pubblicazione: (2025)
GraphEdit: Large Language Models for Graph Structure Learning
di: Guo, Zirui, et al.
Pubblicazione: (2024)
di: Guo, Zirui, et al.
Pubblicazione: (2024)
Model-Based Reinforcement Learning under Random Observation Delays
di: Karamzade, Armin, et al.
Pubblicazione: (2025)
di: Karamzade, Armin, et al.
Pubblicazione: (2025)
Discrete World Models via Regularization
di: Bizzaro, Davide, et al.
Pubblicazione: (2026)
di: Bizzaro, Davide, et al.
Pubblicazione: (2026)
RMT-KD: Random Matrix Theoretic Causal Knowledge Distillation
di: Ettori, Davide, et al.
Pubblicazione: (2025)
di: Ettori, Davide, et al.
Pubblicazione: (2025)
GPrune-LLM: Generalization-Aware Structured Pruning for Large Language Models
di: Liu, Xiaoyun, et al.
Pubblicazione: (2026)
di: Liu, Xiaoyun, et al.
Pubblicazione: (2026)
The Structural Scalpel: Automated Contiguous Layer Pruning for Large Language Models
di: Lu, Yao, et al.
Pubblicazione: (2025)
di: Lu, Yao, et al.
Pubblicazione: (2025)
Bridging Large Language Models and Graph Structure Learning Models for Robust Representation Learning
di: Su, Guangxin, et al.
Pubblicazione: (2024)
di: Su, Guangxin, et al.
Pubblicazione: (2024)
Automatic Parameter Selection for Non-Redundant Clustering
di: Leiber, Collin, et al.
Pubblicazione: (2023)
di: Leiber, Collin, et al.
Pubblicazione: (2023)
A Unified Theory of Random Projection for Influence Functions
di: Hu, Pingbang, et al.
Pubblicazione: (2026)
di: Hu, Pingbang, et al.
Pubblicazione: (2026)
Inertial Confinement Fusion Forecasting via Large Language Models
di: Chen, Mingkai, et al.
Pubblicazione: (2024)
di: Chen, Mingkai, et al.
Pubblicazione: (2024)
Distillation of Large Language Models via Concrete Score Matching
di: Kim, Yeongmin, et al.
Pubblicazione: (2025)
di: Kim, Yeongmin, et al.
Pubblicazione: (2025)
Structured Matrix Scaling for Multi-Class Calibration
di: Berta, Eugène, et al.
Pubblicazione: (2025)
di: Berta, Eugène, et al.
Pubblicazione: (2025)
The Hidden Bias: A Study on Explicit and Implicit Political Stereotypes in Large Language Models
di: Löhr, Konrad, et al.
Pubblicazione: (2025)
di: Löhr, Konrad, et al.
Pubblicazione: (2025)
Enhancing Transformer-based models for Long Sequence Time Series Forecasting via Structured Matrix
di: Zhang, Zhicheng, et al.
Pubblicazione: (2024)
di: Zhang, Zhicheng, et al.
Pubblicazione: (2024)
Latency-Response Theory Model: Evaluating Large Language Models via Response Accuracy and Chain-of-Thought Length
di: Xu, Zhiyu, et al.
Pubblicazione: (2025)
di: Xu, Zhiyu, et al.
Pubblicazione: (2025)
Align to Structure: Aligning Large Language Models with Structural Information
di: Kim, Zae Myung, et al.
Pubblicazione: (2025)
di: Kim, Zae Myung, et al.
Pubblicazione: (2025)
Locality-Aware Redundancy Pruning for LLM Depth Compression
di: Yun, Vincent-Daniel, et al.
Pubblicazione: (2026)
di: Yun, Vincent-Daniel, et al.
Pubblicazione: (2026)
Fusing Urban Structure and Semantics: A Conditional Diffusion Model for Cross-City OD Matrix Generation
di: Chen, Bin, et al.
Pubblicazione: (2026)
di: Chen, Bin, et al.
Pubblicazione: (2026)
Adaptive Redundancy Regulation for Balanced Multimodal Information Refinement
di: Yang, Zhe, et al.
Pubblicazione: (2025)
di: Yang, Zhe, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Spectral Geometry for Deep Learning: Compression and Hallucination Detection via Random Matrix Theory
di: Ettori, Davide
Pubblicazione: (2026) -
Exploring Graph Structure Comprehension Ability of Multimodal Large Language Models: Case Studies
di: Zhong, Zhiqiang, et al.
Pubblicazione: (2024) -
Beyond Frequency: The Role of Redundancy in Large Language Model Memorization
di: Zhang, Jie, et al.
Pubblicazione: (2025) -
Model-Distributed Inference for Large Language Models at the Edge
di: Macario, Davide, et al.
Pubblicazione: (2025) -
Quantifying the Reconstructability of Astrophysical Methods with Large Language Models and Information Theory: A Case Study in Spectral Reconstruction
di: Lin, Hsing Wen, et al.
Pubblicazione: (2026)