Only relative ranks matter in weight-clustered large language models
Fuente:
arXiv
Salvato in:
| Autori principali: | Aizpurua, Borja, Singh, Sukhbinder, Orús, Román |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Quantum Large Language Models via Tensor Network Disentanglers
di: Aizpurua, Borja, et al.
Pubblicazione: (2024)
di: Aizpurua, Borja, et al.
Pubblicazione: (2024)
Classical Neural Networks on Quantum Devices via Tensor Network Disentanglers: A Case Study in Image Classification
di: Aizpurua, Borja, et al.
Pubblicazione: (2025)
di: Aizpurua, Borja, et al.
Pubblicazione: (2025)
Quantum-enhanced Large Language Models on Quantum Hardware via Cayley Unitary Adapters
di: Aizpurua, Borja, et al.
Pubblicazione: (2026)
di: Aizpurua, Borja, et al.
Pubblicazione: (2026)
Tensor network compressibility of convolutional models
di: Singh, Sukhbinder, et al.
Pubblicazione: (2024)
di: Singh, Sukhbinder, et al.
Pubblicazione: (2024)
Block removal for large language models through constrained binary optimization
di: Jansen, David, et al.
Pubblicazione: (2026)
di: Jansen, David, et al.
Pubblicazione: (2026)
Globally optimized SVD compression of LLMs via Fermi-function-based rank selection and gauge fixing
di: Rausch, Roman, et al.
Pubblicazione: (2025)
di: Rausch, Roman, et al.
Pubblicazione: (2025)
Fast Tensorization of Neural Networks via Slice-wise Feature Distillation
di: Hamreras, Safa, et al.
Pubblicazione: (2026)
di: Hamreras, Safa, et al.
Pubblicazione: (2026)
Improving Gradient Methods via Coordinate Transformations: Applications to Quantum Machine Learning
di: Bermejo, Pablo, et al.
Pubblicazione: (2023)
di: Bermejo, Pablo, et al.
Pubblicazione: (2023)
Tensor Networks for Explainable Machine Learning in Cybersecurity
di: Aizpurua, Borja, et al.
Pubblicazione: (2023)
di: Aizpurua, Borja, et al.
Pubblicazione: (2023)
Tensorization is a powerful but underexplored tool for compression and interpretability of neural networks
di: Hamreras, Safa, et al.
Pubblicazione: (2025)
di: Hamreras, Safa, et al.
Pubblicazione: (2025)
Efficient tensor network simulation of IBM's largest quantum processors
di: Patra, Siddhartha, et al.
Pubblicazione: (2023)
di: Patra, Siddhartha, et al.
Pubblicazione: (2023)
Human-interpretable clustering of short-text using large language models
di: Miller, Justin K., et al.
Pubblicazione: (2024)
di: Miller, Justin K., et al.
Pubblicazione: (2024)
Hacking Cryptographic Protocols with Advanced Variational Quantum Attacks
di: Aizpurua, Borja, et al.
Pubblicazione: (2023)
di: Aizpurua, Borja, et al.
Pubblicazione: (2023)
Amortizing intractable inference in large language models
di: Hu, Edward J., et al.
Pubblicazione: (2023)
di: Hu, Edward J., et al.
Pubblicazione: (2023)
Representation in large language models
di: Yetman, Cameron
Pubblicazione: (2025)
di: Yetman, Cameron
Pubblicazione: (2025)
Prompt reinforcing for long-term planning of large language models
di: Lin, Hsien-Chin, et al.
Pubblicazione: (2025)
di: Lin, Hsien-Chin, et al.
Pubblicazione: (2025)
AI-AI Bias: large language models favor communications generated by large language models
di: Laurito, Walter, et al.
Pubblicazione: (2024)
di: Laurito, Walter, et al.
Pubblicazione: (2024)
Alignment faking in large language models
di: Greenblatt, Ryan, et al.
Pubblicazione: (2024)
di: Greenblatt, Ryan, et al.
Pubblicazione: (2024)
Zero-shot generation of synthetic neurosurgical data with large language models
di: Barr, Austin A., et al.
Pubblicazione: (2025)
di: Barr, Austin A., et al.
Pubblicazione: (2025)
Long-form factuality in large language models
di: Wei, Jerry, et al.
Pubblicazione: (2024)
di: Wei, Jerry, et al.
Pubblicazione: (2024)
Can large language models explore in-context?
di: Krishnamurthy, Akshay, et al.
Pubblicazione: (2024)
di: Krishnamurthy, Akshay, et al.
Pubblicazione: (2024)
Quantifying perturbation impacts for large language models
di: Rauba, Paulius, et al.
Pubblicazione: (2024)
di: Rauba, Paulius, et al.
Pubblicazione: (2024)
Question answering system of bridge design specification based on large language model
di: Zhang, Leye, et al.
Pubblicazione: (2024)
di: Zhang, Leye, et al.
Pubblicazione: (2024)
B-score: Detecting biases in large language models using response history
di: Vo, An, et al.
Pubblicazione: (2025)
di: Vo, An, et al.
Pubblicazione: (2025)
The representation landscape of few-shot learning and fine-tuning in large language models
di: Doimo, Diego, et al.
Pubblicazione: (2024)
di: Doimo, Diego, et al.
Pubblicazione: (2024)
Leveraging large language models for structured information extraction from pathology reports
di: Balasubramanian, Jeya Balaji, et al.
Pubblicazione: (2025)
di: Balasubramanian, Jeya Balaji, et al.
Pubblicazione: (2025)
ECG-LLM -- training and evaluation of domain-specific large language models for electrocardiography
di: Ahrens, Lara, et al.
Pubblicazione: (2025)
di: Ahrens, Lara, et al.
Pubblicazione: (2025)
Extracting memorized pieces of (copyrighted) books from open-weight language models
di: Cooper, A. Feder, et al.
Pubblicazione: (2025)
di: Cooper, A. Feder, et al.
Pubblicazione: (2025)
TAGLAS: An atlas of text-attributed graph datasets in the era of large graph and language models
di: Feng, Jiarui, et al.
Pubblicazione: (2024)
di: Feng, Jiarui, et al.
Pubblicazione: (2024)
Scaling behavior of large language models in emotional safety classification across sizes and tasks
di: Pinzuti, Edoardo, et al.
Pubblicazione: (2025)
di: Pinzuti, Edoardo, et al.
Pubblicazione: (2025)
Inducing anxiety in large language models can induce bias
di: Coda-Forno, Julian, et al.
Pubblicazione: (2023)
di: Coda-Forno, Julian, et al.
Pubblicazione: (2023)
A comparative study of zero-shot inference with large language models and supervised modeling in breast cancer pathology classification
di: Sushil, Madhumita, et al.
Pubblicazione: (2024)
di: Sushil, Madhumita, et al.
Pubblicazione: (2024)
Mathematics with large language models as provers and verifiers
di: Duc, Hieu Le, et al.
Pubblicazione: (2025)
di: Duc, Hieu Le, et al.
Pubblicazione: (2025)
Boosting Defect Detection in Manufacturing using Tensor Convolutional Neural Networks
di: Martin-Ramiro, Pablo, et al.
Pubblicazione: (2023)
di: Martin-Ramiro, Pablo, et al.
Pubblicazione: (2023)
Queue management for slo-oriented large language model serving
di: Patke, Archit, et al.
Pubblicazione: (2024)
di: Patke, Archit, et al.
Pubblicazione: (2024)
Post-training makes large language models less human-like
di: Binz, Marcel, et al.
Pubblicazione: (2026)
di: Binz, Marcel, et al.
Pubblicazione: (2026)
Generative adversarial networks vs large language models: a comparative study on synthetic tabular data generation
di: Barr, Austin A., et al.
Pubblicazione: (2025)
di: Barr, Austin A., et al.
Pubblicazione: (2025)
Benchmarking large language models for biomedical natural language processing applications and recommendations
di: Chen, Qingyu, et al.
Pubblicazione: (2023)
di: Chen, Qingyu, et al.
Pubblicazione: (2023)
Physical models realizing the transformer architecture of large language models
di: Chen, Zeqian
Pubblicazione: (2025)
di: Chen, Zeqian
Pubblicazione: (2025)
Safety and accuracy follow different scaling laws in clinical large language models
di: Wind, Sebastian, et al.
Pubblicazione: (2026)
di: Wind, Sebastian, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Quantum Large Language Models via Tensor Network Disentanglers
di: Aizpurua, Borja, et al.
Pubblicazione: (2024) -
Classical Neural Networks on Quantum Devices via Tensor Network Disentanglers: A Case Study in Image Classification
di: Aizpurua, Borja, et al.
Pubblicazione: (2025) -
Quantum-enhanced Large Language Models on Quantum Hardware via Cayley Unitary Adapters
di: Aizpurua, Borja, et al.
Pubblicazione: (2026) -
Tensor network compressibility of convolutional models
di: Singh, Sukhbinder, et al.
Pubblicazione: (2024) -
Block removal for large language models through constrained binary optimization
di: Jansen, David, et al.
Pubblicazione: (2026)