Quantized Side Tuning: Fast and Memory-Efficient Tuning of Quantized Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Zhengxin, Zhao, Dan, Miao, Xupeng, Oliaro, Gabriele, Li, Qing, Jiang, Yong, Jia, Zhihao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Executing Arithmetic: Fine-Tuning Large Language Models as Turing Machines
par: Lai, Junyu, et autres
Publié: (2024)
par: Lai, Junyu, et autres
Publié: (2024)
Compensate Quantization Errors+: Quantized Models Are Inquisitive Learners
par: Gao, Yifei, et autres
Publié: (2024)
par: Gao, Yifei, et autres
Publié: (2024)
QUAD: Quantization and Parameter-Efficient Tuning of LLM with Activation Decomposition
par: Hu, Yuxuan, et autres
Publié: (2025)
par: Hu, Yuxuan, et autres
Publié: (2025)
Frequency Matters: Fast Model-Agnostic Data Curation for Pruning and Quantization
par: Monaco, Francesco Pio, et autres
Publié: (2026)
par: Monaco, Francesco Pio, et autres
Publié: (2026)
Automated Bug Triaging using Instruction-Tuned Large Language Models
par: Kiashemshaki, Kiana, et autres
Publié: (2025)
par: Kiashemshaki, Kiana, et autres
Publié: (2025)
A Performance Evaluation of a Quantized Large Language Model on Various Smartphones
par: Çöplü, Tolga, et autres
Publié: (2023)
par: Çöplü, Tolga, et autres
Publié: (2023)
RUQuant: Towards Refining Uniform Quantization for Large Language Models
par: Liu, Han, et autres
Publié: (2026)
par: Liu, Han, et autres
Publié: (2026)
FED-FSTQ: Fisher-Guided Token Quantization for Communication-Efficient Federated Fine-Tuning of LLMs on Edge Devices
par: Li, Changyu, et autres
Publié: (2026)
par: Li, Changyu, et autres
Publié: (2026)
ConPET: Continual Parameter-Efficient Tuning for Large Language Models
par: Song, Chenyang, et autres
Publié: (2023)
par: Song, Chenyang, et autres
Publié: (2023)
Fine-Tuned Large Language Models for Logical Translation: Reducing Hallucinations with Lang2Logic
par: Pan, Muyu, et autres
Publié: (2025)
par: Pan, Muyu, et autres
Publié: (2025)
BitCal-TTS: Bit-Calibrated Test-Time Scaling for Quantized Reasoning Models
par: Patarlapalli, Sai Babu, et autres
Publié: (2026)
par: Patarlapalli, Sai Babu, et autres
Publié: (2026)
SEPTQ: A Simple and Effective Post-Training Quantization Paradigm for Large Language Models
par: Liu, Han, et autres
Publié: (2026)
par: Liu, Han, et autres
Publié: (2026)
Effective and Efficient Schema-aware Information Extraction Using On-Device Large Language Models
par: Wen, Zhihao, et autres
Publié: (2025)
par: Wen, Zhihao, et autres
Publié: (2025)
FlexQuant: A Flexible and Efficient Dynamic Precision Switching Framework for LLM Quantization
par: Liu, Fangxin, et autres
Publié: (2025)
par: Liu, Fangxin, et autres
Publié: (2025)
Preventing Safety Drift in Large Language Models via Coupled Weight and Activation Constraints
par: Peng, Songping, et autres
Publié: (2026)
par: Peng, Songping, et autres
Publié: (2026)
Quantization Undoes Alignment: Bias Emergence in Compressed LLMs Across Models and Precision Levels
par: Rath, Plawan Kumar, et autres
Publié: (2026)
par: Rath, Plawan Kumar, et autres
Publié: (2026)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
par: Peters, Sydney, et autres
Publié: (2025)
par: Peters, Sydney, et autres
Publié: (2025)
Quantifying Self-Preservation Bias in Large Language Models
par: Migliarini, Matteo, et autres
Publié: (2026)
par: Migliarini, Matteo, et autres
Publié: (2026)
Multi-Turn Interactions for Text-to-SQL with Large Language Models
par: Xiong, Guanming, et autres
Publié: (2024)
par: Xiong, Guanming, et autres
Publié: (2024)
Unifying Uniform and Binary-coding Quantization for Accurate Compression of Large Language Models
par: Park, Seungcheol, et autres
Publié: (2025)
par: Park, Seungcheol, et autres
Publié: (2025)
Layer-Wise Quantization: A Pragmatic and Effective Method for Quantizing LLMs Beyond Integer Bit-Levels
par: Dumitru, Razvan-Gabriel, et autres
Publié: (2024)
par: Dumitru, Razvan-Gabriel, et autres
Publié: (2024)
Efficient Toxicity Detection in Gaming Chats: A Comparative Study of Embeddings, Fine-Tuned Transformers and LLMs
par: Tereshchenko, Yehor, et autres
Publié: (2025)
par: Tereshchenko, Yehor, et autres
Publié: (2025)
Large Language Model (LLM) Bias Index -- LLMBI
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
RAudit: A Blind Auditing Protocol for Large Language Model Reasoning
par: Chang, Edward Y., et autres
Publié: (2026)
par: Chang, Edward Y., et autres
Publié: (2026)
A Multi-Encoder Frozen-Decoder Approach for Fine-Tuning Large Language Models
par: Dhole, Kaustubh D.
Publié: (2025)
par: Dhole, Kaustubh D.
Publié: (2025)
Raw Text is All you Need: Knowledge-intensive Multi-turn Instruction Tuning for Large Language Model
par: Hou, Xia, et autres
Publié: (2024)
par: Hou, Xia, et autres
Publié: (2024)
Robustness of Large Language Models to Perturbations in Text
par: Singh, Ayush, et autres
Publié: (2024)
par: Singh, Ayush, et autres
Publié: (2024)
Towards Alignment-Centric Paradigm: A Survey of Instruction Tuning in Large Language Models
par: Han, Xudong, et autres
Publié: (2025)
par: Han, Xudong, et autres
Publié: (2025)
Unlocking the Wisdom of Large Language Models: An Introduction to The Path to Artificial General Intelligence
par: Chang, Edward Y.
Publié: (2024)
par: Chang, Edward Y.
Publié: (2024)
Adaptive Focus Memory for Language Models
par: Cruz, Christopher
Publié: (2025)
par: Cruz, Christopher
Publié: (2025)
Beyond Prefixes: Graph-as-Memory Cross-Attention for Knowledge Graph Completion with Large Language Models
par: Liu, Ruitong, et autres
Publié: (2025)
par: Liu, Ruitong, et autres
Publié: (2025)
ToolWeaver: Weaving Collaborative Semantics for Scalable Tool Use in Large Language Models
par: Fang, Bowen, et autres
Publié: (2026)
par: Fang, Bowen, et autres
Publié: (2026)
A Fuzzy Logic Prompting Framework for Large Language Models in Adaptive and Uncertain Tasks
par: Figueiredo, Vanessa
Publié: (2025)
par: Figueiredo, Vanessa
Publié: (2025)
Leveraging Large Language Models for Accurate Sign Language Translation in Low-Resource Scenarios
par: Bulla, Luana, et autres
Publié: (2025)
par: Bulla, Luana, et autres
Publié: (2025)
Large Language Models as Oracles for Ontology Alignment
par: Lushnei, Sviatoslav, et autres
Publié: (2025)
par: Lushnei, Sviatoslav, et autres
Publié: (2025)
ELMTEX: Fine-Tuning Large Language Models for Structured Clinical Information Extraction. A Case Study on Clinical Reports
par: Guluzade, Aynur, et autres
Publié: (2025)
par: Guluzade, Aynur, et autres
Publié: (2025)
Exploring Model Invariance with Discrete Search for Ultra-Low-Bit Quantization
par: Wen, Yuqiao, et autres
Publié: (2025)
par: Wen, Yuqiao, et autres
Publié: (2025)
On Semantic Loss Fine-Tuning Approach for Preventing Model Collapse in Causal Reasoning
par: Deshmukh, Pratik, et autres
Publié: (2026)
par: Deshmukh, Pratik, et autres
Publié: (2026)
Pre-trained Language Model with Prompts for Temporal Knowledge Graph Completion
par: Xu, Wenjie, et autres
Publié: (2023)
par: Xu, Wenjie, et autres
Publié: (2023)
mEdIT: Multilingual Text Editing via Instruction Tuning
par: Raheja, Vipul, et autres
Publié: (2024)
par: Raheja, Vipul, et autres
Publié: (2024)
Documents similaires
-
Executing Arithmetic: Fine-Tuning Large Language Models as Turing Machines
par: Lai, Junyu, et autres
Publié: (2024) -
Compensate Quantization Errors+: Quantized Models Are Inquisitive Learners
par: Gao, Yifei, et autres
Publié: (2024) -
QUAD: Quantization and Parameter-Efficient Tuning of LLM with Activation Decomposition
par: Hu, Yuxuan, et autres
Publié: (2025) -
Frequency Matters: Fast Model-Agnostic Data Curation for Pruning and Quantization
par: Monaco, Francesco Pio, et autres
Publié: (2026) -
Automated Bug Triaging using Instruction-Tuned Large Language Models
par: Kiashemshaki, Kiana, et autres
Publié: (2025)