SPQ: An Ensemble Technique for Large Language Model Compression
Fuente:
arXiv
Guardado en:
| Autores principales: | Yao, Jiamin, Gultepe, Eren |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Mapping Hymns and Organizing Concepts in the Rigveda: Quantitatively Connecting the Vedic Suktas
por: Bollineni, Venkatesh, et al.
Publicado: (2025)
por: Bollineni, Venkatesh, et al.
Publicado: (2025)
Evaluating the Impact of Compression Techniques on Task-Specific Performance of Large Language Models
por: Khanal, Bishwash, et al.
Publicado: (2024)
por: Khanal, Bishwash, et al.
Publicado: (2024)
Ensemble Watermarks for Large Language Models
por: Niess, Georg, et al.
Publicado: (2024)
por: Niess, Georg, et al.
Publicado: (2024)
Determine-Then-Ensemble: Necessity of Top-k Union for Large Language Model Ensembling
por: Yao, Yuxuan, et al.
Publicado: (2024)
por: Yao, Yuxuan, et al.
Publicado: (2024)
FineZip : Pushing the Limits of Large Language Models for Practical Lossless Text Compression
por: Mittu, Fazal, et al.
Publicado: (2024)
por: Mittu, Fazal, et al.
Publicado: (2024)
Optimizing Singular Spectrum for Large Language Model Compression
por: Li, Dengjie, et al.
Publicado: (2025)
por: Li, Dengjie, et al.
Publicado: (2025)
Decision-Level Ordinal Modeling for Multimodal Essay Scoring with Large Language Models
por: Zhang, Han, et al.
Publicado: (2026)
por: Zhang, Han, et al.
Publicado: (2026)
Compression Laws for Large Language Models
por: Sengupta, Ayan, et al.
Publicado: (2025)
por: Sengupta, Ayan, et al.
Publicado: (2025)
Aggressive Post-Training Compression on Extremely Large Language Models
por: Zhang, Zining, et al.
Publicado: (2024)
por: Zhang, Zining, et al.
Publicado: (2024)
Investigating Structural Pruning and Recovery Techniques for Compressing Multimodal Large Language Models: An Empirical Study
por: Huang, Yiran, et al.
Publicado: (2025)
por: Huang, Yiran, et al.
Publicado: (2025)
Prompt Programming for Cultural Bias and Alignment of Large Language Models
por: Eren, Maksim, et al.
Publicado: (2026)
por: Eren, Maksim, et al.
Publicado: (2026)
Detection Avoidance Techniques for Large Language Models
por: Schneider, Sinclair, et al.
Publicado: (2025)
por: Schneider, Sinclair, et al.
Publicado: (2025)
LLMs in the Classroom: Outcomes and Perceptions of Questions Written with the Aid of AI
por: Witsken, Gavin, et al.
Publicado: (2025)
por: Witsken, Gavin, et al.
Publicado: (2025)
Compressed Sensing for Capability Localization in Large Language Models
por: Bair, Anna, et al.
Publicado: (2026)
por: Bair, Anna, et al.
Publicado: (2026)
Prompt Compression for Large Language Models: A Survey
por: Li, Zongqian, et al.
Publicado: (2024)
por: Li, Zongqian, et al.
Publicado: (2024)
Hit the Sweet Spot! Span-Level Ensemble for Large Language Models
por: Xu, Yangyifan, et al.
Publicado: (2024)
por: Xu, Yangyifan, et al.
Publicado: (2024)
Decomposing Uncertainty for Large Language Models through Input Clarification Ensembling
por: Hou, Bairu, et al.
Publicado: (2023)
por: Hou, Bairu, et al.
Publicado: (2023)
Harnessing Multiple Large Language Models: A Survey on LLM Ensemble
por: Chen, Zhijun, et al.
Publicado: (2025)
por: Chen, Zhijun, et al.
Publicado: (2025)
Ensemble Learning for Heterogeneous Large Language Models with Deep Parallel Collaboration
por: Huang, Yichong, et al.
Publicado: (2024)
por: Huang, Yichong, et al.
Publicado: (2024)
When Compression Meets Model Compression: Memory-Efficient Double Compression for Large Language Models
por: Wang, Weilan, et al.
Publicado: (2025)
por: Wang, Weilan, et al.
Publicado: (2025)
Multi-Programming Language Ensemble for Code Generation in Large Language Model
por: Xue, Tengfei, et al.
Publicado: (2024)
por: Xue, Tengfei, et al.
Publicado: (2024)
Data-free Weight Compress and Denoise for Large Language Models
por: Peng, Runyu, et al.
Publicado: (2024)
por: Peng, Runyu, et al.
Publicado: (2024)
Compressing Large Language Models with Automated Sub-Network Search
por: Sukthanker, Rhea Sanjay, et al.
Publicado: (2024)
por: Sukthanker, Rhea Sanjay, et al.
Publicado: (2024)
A Survey on Model Compression for Large Language Models
por: Zhu, Xunyu, et al.
Publicado: (2023)
por: Zhu, Xunyu, et al.
Publicado: (2023)
Large Language Models Are Still Misled by Simple Bias Ensembles
por: Sun, Zhouhao, et al.
Publicado: (2025)
por: Sun, Zhouhao, et al.
Publicado: (2025)
Knowledge Editing for Large Language Model with Knowledge Neuronal Ensemble
por: Li, Yongchang, et al.
Publicado: (2024)
por: Li, Yongchang, et al.
Publicado: (2024)
Ensemble Debates with Local Large Language Models for AI Alignment
por: Sarabamoun, Ephraiem
Publicado: (2025)
por: Sarabamoun, Ephraiem
Publicado: (2025)
On the Compressibility of Quantized Large Language Models
por: Mao, Yu, et al.
Publicado: (2024)
por: Mao, Yu, et al.
Publicado: (2024)
Vision-centric Token Compression in Large Language Model
por: Xing, Ling, et al.
Publicado: (2025)
por: Xing, Ling, et al.
Publicado: (2025)
In-Context Former: Lightning-fast Compressing Context for Large Language Model
por: Wang, Xiangfeng, et al.
Publicado: (2024)
por: Wang, Xiangfeng, et al.
Publicado: (2024)
500xCompressor: Generalized Prompt Compression for Large Language Models
por: Li, Zongqian, et al.
Publicado: (2024)
por: Li, Zongqian, et al.
Publicado: (2024)
Multilingual Brain Surgeon: Large Language Models Can be Compressed Leaving No Language Behind
por: Zeng, Hongchuan, et al.
Publicado: (2024)
por: Zeng, Hongchuan, et al.
Publicado: (2024)
Efficient Inference for Large Vision-Language Models: Bottlenecks, Techniques, and Prospects
por: Zhang, Jun, et al.
Publicado: (2026)
por: Zhang, Jun, et al.
Publicado: (2026)
A Comprehensive Survey of Hallucination Mitigation Techniques in Large Language Models
por: Tonmoy, S. M Towhidul Islam, et al.
Publicado: (2024)
por: Tonmoy, S. M Towhidul Islam, et al.
Publicado: (2024)
Merge, Ensemble, and Cooperate! A Survey on Collaborative Strategies in the Era of Large Language Models
por: Lu, Jinliang, et al.
Publicado: (2024)
por: Lu, Jinliang, et al.
Publicado: (2024)
An Empirical Study on Prompt Compression for Large Language Models
por: Zhang, Zheng, et al.
Publicado: (2025)
por: Zhang, Zheng, et al.
Publicado: (2025)
TensorGPT: Efficient Compression of Large Language Models based on Tensor-Train Decomposition
por: Xu, Mingxue, et al.
Publicado: (2023)
por: Xu, Mingxue, et al.
Publicado: (2023)
Measuring Maximum Activations in Open Large Language Models
por: Chen, Luxuan, et al.
Publicado: (2026)
por: Chen, Luxuan, et al.
Publicado: (2026)
One-for-All Pruning: A Universal Model for Customized Compression of Large Language Models
por: Ye, Rongguang, et al.
Publicado: (2025)
por: Ye, Rongguang, et al.
Publicado: (2025)
M-Ped: Multi-Prompt Ensemble Decoding for Large Language Models
por: Guo, Jiaxin, et al.
Publicado: (2024)
por: Guo, Jiaxin, et al.
Publicado: (2024)
Ejemplares similares
-
Mapping Hymns and Organizing Concepts in the Rigveda: Quantitatively Connecting the Vedic Suktas
por: Bollineni, Venkatesh, et al.
Publicado: (2025) -
Evaluating the Impact of Compression Techniques on Task-Specific Performance of Large Language Models
por: Khanal, Bishwash, et al.
Publicado: (2024) -
Ensemble Watermarks for Large Language Models
por: Niess, Georg, et al.
Publicado: (2024) -
Determine-Then-Ensemble: Necessity of Top-k Union for Large Language Model Ensembling
por: Yao, Yuxuan, et al.
Publicado: (2024) -
FineZip : Pushing the Limits of Large Language Models for Practical Lossless Text Compression
por: Mittu, Fazal, et al.
Publicado: (2024)