A Comprehensive Survey of Compression Algorithms for Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Park, Seungcheol, Choi, Jaehyeon, Lee, Sojin, Kang, U |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Accurate Sublayer Pruning for Large Language Models by Exploiting Latency and Tunability Information
par: Park, Seungcheol, et autres
Publié: (2025)
par: Park, Seungcheol, et autres
Publié: (2025)
Accurate Retraining-free Pruning for Pretrained Encoder-based Language Models
par: Park, Seungcheol, et autres
Publié: (2023)
par: Park, Seungcheol, et autres
Publié: (2023)
Unifying Uniform and Binary-coding Quantization for Accurate Compression of Large Language Models
par: Park, Seungcheol, et autres
Publié: (2025)
par: Park, Seungcheol, et autres
Publié: (2025)
Tokenization Is More Than Compression
par: Schmidt, Craig W., et autres
Publié: (2024)
par: Schmidt, Craig W., et autres
Publié: (2024)
K-MetBench: A Multi-Dimensional Benchmark for Fine-Grained Evaluation of Expert Reasoning, Locality, and Multimodality in Meteorology
par: Kim, Soyeon, et autres
Publié: (2026)
par: Kim, Soyeon, et autres
Publié: (2026)
Revealing the Parametric Knowledge of Language Models: A Unified Framework for Attribution Methods
par: Yu, Haeun, et autres
Publié: (2024)
par: Yu, Haeun, et autres
Publié: (2024)
Align-to-Distill: Trainable Attention Alignment for Knowledge Distillation in Neural Machine Translation
par: Jin, Heegon, et autres
Publié: (2024)
par: Jin, Heegon, et autres
Publié: (2024)
DYNAMICQA: Tracing Internal Knowledge Conflicts in Language Models
par: Marjanović, Sara Vera, et autres
Publié: (2024)
par: Marjanović, Sara Vera, et autres
Publié: (2024)
Model Misalignment and Language Change: Traces of AI-Associated Language in Unscripted Spoken English
par: Anderson, Bryce, et autres
Publié: (2025)
par: Anderson, Bryce, et autres
Publié: (2025)
The Impact of Role Design in In-Context Learning for Large Language Models
par: Rouzegar, Hamidreza, et autres
Publié: (2025)
par: Rouzegar, Hamidreza, et autres
Publié: (2025)
Efficient Adaptive Rejection Sampling for Accelerating Speculative Decoding in Large Language Models
par: Sun, Chendong, et autres
Publié: (2025)
par: Sun, Chendong, et autres
Publié: (2025)
Multi-chain Graph Refinement and Selection for Reliable Reasoning in Large Language Models
par: Yang, Yujiao, et autres
Publié: (2025)
par: Yang, Yujiao, et autres
Publié: (2025)
LayerTracer: A Joint Task-Particle and Vulnerable-Layer Analysis framework for Arbitrary Large Language Model Architectures
par: Wu, Yuhang, et autres
Publié: (2026)
par: Wu, Yuhang, et autres
Publié: (2026)
Decouple Searching from Training: Scaling Data Mixing via Model Merging for Large Language Model Pre-training
par: Li, Shengrui, et autres
Publié: (2026)
par: Li, Shengrui, et autres
Publié: (2026)
ADE: Adaptive Dictionary Embeddings -- Scaling Multi-Anchor Representations to Large Language Models
par: Demirci, Orhan, et autres
Publié: (2026)
par: Demirci, Orhan, et autres
Publié: (2026)
Raw Text is All you Need: Knowledge-intensive Multi-turn Instruction Tuning for Large Language Model
par: Hou, Xia, et autres
Publié: (2024)
par: Hou, Xia, et autres
Publié: (2024)
A Study on Bias Detection and Classification in Natural Language Processing
par: Evans, Ana Sofia, et autres
Publié: (2024)
par: Evans, Ana Sofia, et autres
Publié: (2024)
CLMN: Concept based Language Models via Neural Symbolic Reasoning
par: Yang, Yibo
Publié: (2025)
par: Yang, Yibo
Publié: (2025)
Language corpora for the Dutch medical domain
par: van Es, B.
Publié: (2026)
par: van Es, B.
Publié: (2026)
TREX: Tokenizer Regression for Optimal Data Mixture
par: Won, Inho, et autres
Publié: (2026)
par: Won, Inho, et autres
Publié: (2026)
RV-HATE: Reinforced Multi-Module Voting for Implicit Hate Speech Detection
par: Lee, Yejin, et autres
Publié: (2025)
par: Lee, Yejin, et autres
Publié: (2025)
ExpliCa: Evaluating Explicit Causal Reasoning in Large Language Models
par: Miliani, Martina, et autres
Publié: (2025)
par: Miliani, Martina, et autres
Publié: (2025)
UnifiedCrawl: Aggregated Common Crawl for Affordable Adaptation of LLMs on Low-Resource Languages
par: Tessema, Bethel Melesse, et autres
Publié: (2024)
par: Tessema, Bethel Melesse, et autres
Publié: (2024)
A Survey of Text Watermarking in the Era of Large Language Models
par: Liu, Aiwei, et autres
Publié: (2023)
par: Liu, Aiwei, et autres
Publié: (2023)
Obfuscation Rules for Detecting and Detoxifying Korean Toxicity
par: Lee, Yejin, et autres
Publié: (2025)
par: Lee, Yejin, et autres
Publié: (2025)
S2vNTM: Semi-supervised vMF Neural Topic Modeling
par: Xu, Weijie, et autres
Publié: (2023)
par: Xu, Weijie, et autres
Publié: (2023)
Multi-Model Synthetic Training for Mission-Critical Small Language Models
par: Platt, Nolan, et autres
Publié: (2025)
par: Platt, Nolan, et autres
Publié: (2025)
Topeax -- An Improved Clustering Topic Model with Density Peak Detection and Lexical-Semantic Term Importance
par: Kardos, Márton
Publié: (2026)
par: Kardos, Márton
Publié: (2026)
Learning When to Think: Shaping Adaptive Reasoning in R1-Style Models via Multi-Stage RL
par: Tu, Songjun, et autres
Publié: (2025)
par: Tu, Songjun, et autres
Publié: (2025)
"As Eastern Powers, I will veto." : An Investigation of Nation-level Bias of Large Language Models in International Relations
par: Choi, Jonghyeon, et autres
Publié: (2025)
par: Choi, Jonghyeon, et autres
Publié: (2025)
Prompt Compression in Production Task Orchestration: A Pre-Registered Randomized Trial
par: Johnson, Warren, et autres
Publié: (2026)
par: Johnson, Warren, et autres
Publié: (2026)
Survey and Evaluation of Converging Architecture in LLMs based on Footsteps of Operations
par: Kim, Seongho, et autres
Publié: (2024)
par: Kim, Seongho, et autres
Publié: (2024)
Towards Ontology-Enhanced Representation Learning for Large Language Models
par: Ronzano, Francesco, et autres
Publié: (2024)
par: Ronzano, Francesco, et autres
Publié: (2024)
Large Language Models(LLMs) on Tabular Data: Prediction, Generation, and Understanding -- A Survey
par: Fang, Xi, et autres
Publié: (2024)
par: Fang, Xi, et autres
Publié: (2024)
A Survey on Natural Language Counterfactual Generation
par: Wang, Yongjie, et autres
Publié: (2024)
par: Wang, Yongjie, et autres
Publié: (2024)
MORABLES: A Benchmark for Assessing Abstract Moral Reasoning in LLMs with Fables
par: Marcuzzo, Matteo, et autres
Publié: (2025)
par: Marcuzzo, Matteo, et autres
Publié: (2025)
A Graph-based Approach for Multi-Modal Question Answering from Flowcharts in Telecom Documents
par: Soman, Sumit, et autres
Publié: (2025)
par: Soman, Sumit, et autres
Publié: (2025)
Isolating LLM Lexical Bias: A Curation-Free Triangulated Metric for Preference-Stage Learning
par: Ming, Xiaoyang, et autres
Publié: (2026)
par: Ming, Xiaoyang, et autres
Publié: (2026)
HR-MultiWOZ: A Task Oriented Dialogue (TOD) Dataset for HR LLM Agent
par: Xu, Weijie, et autres
Publié: (2024)
par: Xu, Weijie, et autres
Publié: (2024)
AIPsy-Affect: A Keyword-Free Clinical Stimulus Battery for Mechanistic Interpretability of Emotion in Language Models
par: Keeman, Michael
Publié: (2026)
par: Keeman, Michael
Publié: (2026)
Documents similaires
-
Accurate Sublayer Pruning for Large Language Models by Exploiting Latency and Tunability Information
par: Park, Seungcheol, et autres
Publié: (2025) -
Accurate Retraining-free Pruning for Pretrained Encoder-based Language Models
par: Park, Seungcheol, et autres
Publié: (2023) -
Unifying Uniform and Binary-coding Quantization for Accurate Compression of Large Language Models
par: Park, Seungcheol, et autres
Publié: (2025) -
Tokenization Is More Than Compression
par: Schmidt, Craig W., et autres
Publié: (2024) -
K-MetBench: A Multi-Dimensional Benchmark for Fine-Grained Evaluation of Expert Reasoning, Locality, and Multimodality in Meteorology
par: Kim, Soyeon, et autres
Publié: (2026)