SPQ: An Ensemble Technique for Large Language Model Compression
Fuente:
arXiv
Salvato in:
| Autori principali: | Yao, Jiamin, Gultepe, Eren |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mapping Hymns and Organizing Concepts in the Rigveda: Quantitatively Connecting the Vedic Suktas
di: Bollineni, Venkatesh, et al.
Pubblicazione: (2025)
di: Bollineni, Venkatesh, et al.
Pubblicazione: (2025)
Evaluating the Impact of Compression Techniques on Task-Specific Performance of Large Language Models
di: Khanal, Bishwash, et al.
Pubblicazione: (2024)
di: Khanal, Bishwash, et al.
Pubblicazione: (2024)
Ensemble Watermarks for Large Language Models
di: Niess, Georg, et al.
Pubblicazione: (2024)
di: Niess, Georg, et al.
Pubblicazione: (2024)
Determine-Then-Ensemble: Necessity of Top-k Union for Large Language Model Ensembling
di: Yao, Yuxuan, et al.
Pubblicazione: (2024)
di: Yao, Yuxuan, et al.
Pubblicazione: (2024)
FineZip : Pushing the Limits of Large Language Models for Practical Lossless Text Compression
di: Mittu, Fazal, et al.
Pubblicazione: (2024)
di: Mittu, Fazal, et al.
Pubblicazione: (2024)
Optimizing Singular Spectrum for Large Language Model Compression
di: Li, Dengjie, et al.
Pubblicazione: (2025)
di: Li, Dengjie, et al.
Pubblicazione: (2025)
Decision-Level Ordinal Modeling for Multimodal Essay Scoring with Large Language Models
di: Zhang, Han, et al.
Pubblicazione: (2026)
di: Zhang, Han, et al.
Pubblicazione: (2026)
Compression Laws for Large Language Models
di: Sengupta, Ayan, et al.
Pubblicazione: (2025)
di: Sengupta, Ayan, et al.
Pubblicazione: (2025)
Aggressive Post-Training Compression on Extremely Large Language Models
di: Zhang, Zining, et al.
Pubblicazione: (2024)
di: Zhang, Zining, et al.
Pubblicazione: (2024)
Investigating Structural Pruning and Recovery Techniques for Compressing Multimodal Large Language Models: An Empirical Study
di: Huang, Yiran, et al.
Pubblicazione: (2025)
di: Huang, Yiran, et al.
Pubblicazione: (2025)
Prompt Programming for Cultural Bias and Alignment of Large Language Models
di: Eren, Maksim, et al.
Pubblicazione: (2026)
di: Eren, Maksim, et al.
Pubblicazione: (2026)
Detection Avoidance Techniques for Large Language Models
di: Schneider, Sinclair, et al.
Pubblicazione: (2025)
di: Schneider, Sinclair, et al.
Pubblicazione: (2025)
LLMs in the Classroom: Outcomes and Perceptions of Questions Written with the Aid of AI
di: Witsken, Gavin, et al.
Pubblicazione: (2025)
di: Witsken, Gavin, et al.
Pubblicazione: (2025)
Compressed Sensing for Capability Localization in Large Language Models
di: Bair, Anna, et al.
Pubblicazione: (2026)
di: Bair, Anna, et al.
Pubblicazione: (2026)
Prompt Compression for Large Language Models: A Survey
di: Li, Zongqian, et al.
Pubblicazione: (2024)
di: Li, Zongqian, et al.
Pubblicazione: (2024)
Hit the Sweet Spot! Span-Level Ensemble for Large Language Models
di: Xu, Yangyifan, et al.
Pubblicazione: (2024)
di: Xu, Yangyifan, et al.
Pubblicazione: (2024)
Decomposing Uncertainty for Large Language Models through Input Clarification Ensembling
di: Hou, Bairu, et al.
Pubblicazione: (2023)
di: Hou, Bairu, et al.
Pubblicazione: (2023)
Harnessing Multiple Large Language Models: A Survey on LLM Ensemble
di: Chen, Zhijun, et al.
Pubblicazione: (2025)
di: Chen, Zhijun, et al.
Pubblicazione: (2025)
Ensemble Learning for Heterogeneous Large Language Models with Deep Parallel Collaboration
di: Huang, Yichong, et al.
Pubblicazione: (2024)
di: Huang, Yichong, et al.
Pubblicazione: (2024)
When Compression Meets Model Compression: Memory-Efficient Double Compression for Large Language Models
di: Wang, Weilan, et al.
Pubblicazione: (2025)
di: Wang, Weilan, et al.
Pubblicazione: (2025)
Multi-Programming Language Ensemble for Code Generation in Large Language Model
di: Xue, Tengfei, et al.
Pubblicazione: (2024)
di: Xue, Tengfei, et al.
Pubblicazione: (2024)
Data-free Weight Compress and Denoise for Large Language Models
di: Peng, Runyu, et al.
Pubblicazione: (2024)
di: Peng, Runyu, et al.
Pubblicazione: (2024)
Compressing Large Language Models with Automated Sub-Network Search
di: Sukthanker, Rhea Sanjay, et al.
Pubblicazione: (2024)
di: Sukthanker, Rhea Sanjay, et al.
Pubblicazione: (2024)
A Survey on Model Compression for Large Language Models
di: Zhu, Xunyu, et al.
Pubblicazione: (2023)
di: Zhu, Xunyu, et al.
Pubblicazione: (2023)
Large Language Models Are Still Misled by Simple Bias Ensembles
di: Sun, Zhouhao, et al.
Pubblicazione: (2025)
di: Sun, Zhouhao, et al.
Pubblicazione: (2025)
Knowledge Editing for Large Language Model with Knowledge Neuronal Ensemble
di: Li, Yongchang, et al.
Pubblicazione: (2024)
di: Li, Yongchang, et al.
Pubblicazione: (2024)
Ensemble Debates with Local Large Language Models for AI Alignment
di: Sarabamoun, Ephraiem
Pubblicazione: (2025)
di: Sarabamoun, Ephraiem
Pubblicazione: (2025)
On the Compressibility of Quantized Large Language Models
di: Mao, Yu, et al.
Pubblicazione: (2024)
di: Mao, Yu, et al.
Pubblicazione: (2024)
Vision-centric Token Compression in Large Language Model
di: Xing, Ling, et al.
Pubblicazione: (2025)
di: Xing, Ling, et al.
Pubblicazione: (2025)
In-Context Former: Lightning-fast Compressing Context for Large Language Model
di: Wang, Xiangfeng, et al.
Pubblicazione: (2024)
di: Wang, Xiangfeng, et al.
Pubblicazione: (2024)
500xCompressor: Generalized Prompt Compression for Large Language Models
di: Li, Zongqian, et al.
Pubblicazione: (2024)
di: Li, Zongqian, et al.
Pubblicazione: (2024)
Multilingual Brain Surgeon: Large Language Models Can be Compressed Leaving No Language Behind
di: Zeng, Hongchuan, et al.
Pubblicazione: (2024)
di: Zeng, Hongchuan, et al.
Pubblicazione: (2024)
Efficient Inference for Large Vision-Language Models: Bottlenecks, Techniques, and Prospects
di: Zhang, Jun, et al.
Pubblicazione: (2026)
di: Zhang, Jun, et al.
Pubblicazione: (2026)
A Comprehensive Survey of Hallucination Mitigation Techniques in Large Language Models
di: Tonmoy, S. M Towhidul Islam, et al.
Pubblicazione: (2024)
di: Tonmoy, S. M Towhidul Islam, et al.
Pubblicazione: (2024)
Merge, Ensemble, and Cooperate! A Survey on Collaborative Strategies in the Era of Large Language Models
di: Lu, Jinliang, et al.
Pubblicazione: (2024)
di: Lu, Jinliang, et al.
Pubblicazione: (2024)
An Empirical Study on Prompt Compression for Large Language Models
di: Zhang, Zheng, et al.
Pubblicazione: (2025)
di: Zhang, Zheng, et al.
Pubblicazione: (2025)
TensorGPT: Efficient Compression of Large Language Models based on Tensor-Train Decomposition
di: Xu, Mingxue, et al.
Pubblicazione: (2023)
di: Xu, Mingxue, et al.
Pubblicazione: (2023)
Measuring Maximum Activations in Open Large Language Models
di: Chen, Luxuan, et al.
Pubblicazione: (2026)
di: Chen, Luxuan, et al.
Pubblicazione: (2026)
One-for-All Pruning: A Universal Model for Customized Compression of Large Language Models
di: Ye, Rongguang, et al.
Pubblicazione: (2025)
di: Ye, Rongguang, et al.
Pubblicazione: (2025)
M-Ped: Multi-Prompt Ensemble Decoding for Large Language Models
di: Guo, Jiaxin, et al.
Pubblicazione: (2024)
di: Guo, Jiaxin, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Mapping Hymns and Organizing Concepts in the Rigveda: Quantitatively Connecting the Vedic Suktas
di: Bollineni, Venkatesh, et al.
Pubblicazione: (2025) -
Evaluating the Impact of Compression Techniques on Task-Specific Performance of Large Language Models
di: Khanal, Bishwash, et al.
Pubblicazione: (2024) -
Ensemble Watermarks for Large Language Models
di: Niess, Georg, et al.
Pubblicazione: (2024) -
Determine-Then-Ensemble: Necessity of Top-k Union for Large Language Model Ensembling
di: Yao, Yuxuan, et al.
Pubblicazione: (2024) -
FineZip : Pushing the Limits of Large Language Models for Practical Lossless Text Compression
di: Mittu, Fazal, et al.
Pubblicazione: (2024)