ClusComp: A Simple Paradigm for Model Compression and Efficient Finetuning
Fuente:
arXiv
Salvato in:
| Autori principali: | Liao, Baohao, Herold, Christian, Hashemi, Seyyed Hadi, Vasilev, Stefan, Khadivi, Shahram, Monz, Christof |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Unilogit: Robust Machine Unlearning for LLMs Using Uniform-Target Self-Distillation
di: Vasilev, Stefan, et al.
Pubblicazione: (2025)
di: Vasilev, Stefan, et al.
Pubblicazione: (2025)
ApiQ: Finetuning of 2-Bit Quantized Large Language Model
di: Liao, Baohao, et al.
Pubblicazione: (2024)
di: Liao, Baohao, et al.
Pubblicazione: (2024)
3-in-1: 2D Rotary Adaptation for Efficient Finetuning, Efficient Batching and Composability
di: Liao, Baohao, et al.
Pubblicazione: (2024)
di: Liao, Baohao, et al.
Pubblicazione: (2024)
IKUN for WMT24 General MT Task: LLMs Are here for Multilingual Machine Translation
di: Liao, Baohao, et al.
Pubblicazione: (2024)
di: Liao, Baohao, et al.
Pubblicazione: (2024)
Is It a Free Lunch for Removing Outliers during Pretraining?
di: Liao, Baohao, et al.
Pubblicazione: (2024)
di: Liao, Baohao, et al.
Pubblicazione: (2024)
Self-Hinting Language Models Enhance Reinforcement Learning
di: Liao, Baohao, et al.
Pubblicazione: (2026)
di: Liao, Baohao, et al.
Pubblicazione: (2026)
Reward-Guided Speculative Decoding for Efficient LLM Reasoning
di: Liao, Baohao, et al.
Pubblicazione: (2025)
di: Liao, Baohao, et al.
Pubblicazione: (2025)
Fractured Chain-of-Thought Reasoning
di: Liao, Baohao, et al.
Pubblicazione: (2025)
di: Liao, Baohao, et al.
Pubblicazione: (2025)
Meeting SLOs, Slashing Hours: Automated Enterprise LLM Optimization with OptiKIT
di: Santavas, Nicholas, et al.
Pubblicazione: (2026)
di: Santavas, Nicholas, et al.
Pubblicazione: (2026)
Analyzing the Evaluation of Cross-Lingual Knowledge Transfer in Multilingual Language Models
di: Rajaee, Sara, et al.
Pubblicazione: (2024)
di: Rajaee, Sara, et al.
Pubblicazione: (2024)
Do Language Models Reason Across Languages?
di: Meng, Yan, et al.
Pubblicazione: (2026)
di: Meng, Yan, et al.
Pubblicazione: (2026)
Reinforce-Ada: An Adaptive Sampling Framework under Non-linear RL Objectives
di: Xiong, Wei, et al.
Pubblicazione: (2025)
di: Xiong, Wei, et al.
Pubblicazione: (2025)
Disentangling the Roles of Target-Side Transfer and Regularization in Multilingual Machine Translation
di: Meng, Yan, et al.
Pubblicazione: (2024)
di: Meng, Yan, et al.
Pubblicazione: (2024)
How to Learn in a Noisy World? Self-Correcting the Real-World Data Noise in Machine Translation
di: Meng, Yan, et al.
Pubblicazione: (2024)
di: Meng, Yan, et al.
Pubblicazione: (2024)
Best-of-L: Cross-Lingual Reward Modeling for Mathematical Reasoning
di: Rajaee, Sara, et al.
Pubblicazione: (2025)
di: Rajaee, Sara, et al.
Pubblicazione: (2025)
Communicating with Speakers and Listeners of Different Pragmatic Levels
di: Naszadi, Kata, et al.
Pubblicazione: (2024)
di: Naszadi, Kata, et al.
Pubblicazione: (2024)
Domain Adaptation of Foundation LLMs for e-Commerce
di: Herold, Christian, et al.
Pubblicazione: (2025)
di: Herold, Christian, et al.
Pubblicazione: (2025)
On the Evaluation Practices in Multilingual NLP: Can Machine Translation Offer an Alternative to Human Translations?
di: Choenni, Rochelle, et al.
Pubblicazione: (2024)
di: Choenni, Rochelle, et al.
Pubblicazione: (2024)
Adapting Vision-Language Models for E-commerce Understanding at Scale
di: Nulli, Matteo, et al.
Pubblicazione: (2026)
di: Nulli, Matteo, et al.
Pubblicazione: (2026)
Vocabulary Customization for Efficient Domain-Specific LLM Deployment
di: Herold, Christian, et al.
Pubblicazione: (2025)
di: Herold, Christian, et al.
Pubblicazione: (2025)
A Tutorial on the Pretrain-Finetune Paradigm for Natural Language Processing
di: Wang, Yu, et al.
Pubblicazione: (2024)
di: Wang, Yu, et al.
Pubblicazione: (2024)
A Simple "Motivation" Can Enhance Reinforcement Finetuning of Large Reasoning Models
di: Zhang, Junjie, et al.
Pubblicazione: (2025)
di: Zhang, Junjie, et al.
Pubblicazione: (2025)
Lost at the Beginning of Reasoning
di: Liao, Baohao, et al.
Pubblicazione: (2025)
di: Liao, Baohao, et al.
Pubblicazione: (2025)
ITEm: Unsupervised Image-Text Embedding Learning for eCommerce
di: Liao, Baohao, et al.
Pubblicazione: (2023)
di: Liao, Baohao, et al.
Pubblicazione: (2023)
AdaComp: Extractive Context Compression with Adaptive Predictor for Retrieval-Augmented Large Language Models
di: Zhang, Qianchi, et al.
Pubblicazione: (2024)
di: Zhang, Qianchi, et al.
Pubblicazione: (2024)
Control the Temperature: Selective Sampling for Diverse and High-Quality LLM Outputs
di: Troshin, Sergey, et al.
Pubblicazione: (2025)
di: Troshin, Sergey, et al.
Pubblicazione: (2025)
Improving Task Diversity in Label Efficient Supervised Finetuning of LLMs
di: Arabelly, Abhinav, et al.
Pubblicazione: (2025)
di: Arabelly, Abhinav, et al.
Pubblicazione: (2025)
The SIFo Benchmark: Investigating the Sequential Instruction Following Ability of Large Language Models
di: Chen, Xinyi, et al.
Pubblicazione: (2024)
di: Chen, Xinyi, et al.
Pubblicazione: (2024)
On Instruction-Finetuning Neural Machine Translation Models
di: Raunak, Vikas, et al.
Pubblicazione: (2024)
di: Raunak, Vikas, et al.
Pubblicazione: (2024)
Risk-Averse Finetuning of Large Language Models
di: Chaudhary, Sapana, et al.
Pubblicazione: (2025)
di: Chaudhary, Sapana, et al.
Pubblicazione: (2025)
When Compression Meets Model Compression: Memory-Efficient Double Compression for Large Language Models
di: Wang, Weilan, et al.
Pubblicazione: (2025)
di: Wang, Weilan, et al.
Pubblicazione: (2025)
SEP-Attack: A Simple and Effective Paradigm for Transfer-Based Textual Adversarial Attack
di: Liu, Han, et al.
Pubblicazione: (2026)
di: Liu, Han, et al.
Pubblicazione: (2026)
ReaComp: Compiling LLM Reasoning into Symbolic Solvers for Efficient Program Synthesis
di: Naik, Atharva, et al.
Pubblicazione: (2026)
di: Naik, Atharva, et al.
Pubblicazione: (2026)
An Experimental Design Framework for Label-Efficient Supervised Finetuning of Large Language Models
di: Bhatt, Gantavya, et al.
Pubblicazione: (2024)
di: Bhatt, Gantavya, et al.
Pubblicazione: (2024)
A Human Word Association based model for topic detection in social networks
di: Khadivi, Mehrdad Ranjbar, et al.
Pubblicazione: (2023)
di: Khadivi, Mehrdad Ranjbar, et al.
Pubblicazione: (2023)
Time Sensitive Knowledge Editing through Efficient Finetuning
di: Ge, Xiou, et al.
Pubblicazione: (2024)
di: Ge, Xiou, et al.
Pubblicazione: (2024)
Whisper Finetuning on Nepali Language
di: Rijal, Sanjay, et al.
Pubblicazione: (2024)
di: Rijal, Sanjay, et al.
Pubblicazione: (2024)
OneComp: One-Line Revolution for Generative AI Model Compression
di: Ichikawa, Yuma, et al.
Pubblicazione: (2026)
di: Ichikawa, Yuma, et al.
Pubblicazione: (2026)
LMFlow: An Extensible Toolkit for Finetuning and Inference of Large Foundation Models
di: Diao, Shizhe, et al.
Pubblicazione: (2023)
di: Diao, Shizhe, et al.
Pubblicazione: (2023)
Squeeze the Soaked Sponge: Efficient Off-policy Reinforcement Finetuning for Large Language Model
di: Liang, Jing, et al.
Pubblicazione: (2025)
di: Liang, Jing, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Unilogit: Robust Machine Unlearning for LLMs Using Uniform-Target Self-Distillation
di: Vasilev, Stefan, et al.
Pubblicazione: (2025) -
ApiQ: Finetuning of 2-Bit Quantized Large Language Model
di: Liao, Baohao, et al.
Pubblicazione: (2024) -
3-in-1: 2D Rotary Adaptation for Efficient Finetuning, Efficient Batching and Composability
di: Liao, Baohao, et al.
Pubblicazione: (2024) -
IKUN for WMT24 General MT Task: LLMs Are here for Multilingual Machine Translation
di: Liao, Baohao, et al.
Pubblicazione: (2024) -
Is It a Free Lunch for Removing Outliers during Pretraining?
di: Liao, Baohao, et al.
Pubblicazione: (2024)