Quaff: Quantized Parameter-Efficient Fine-Tuning under Outlier Spatial Stability Hypothesis
Fuente:
arXiv
Saved in:
| Main Authors: | Huang, Hong, Wu, Dapeng |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Sherry: Hardware-Efficient 1.25-Bit Ternary Quantization via Fine-grained Sparsification
by: Huang, Hong, et al.
Published: (2026)
by: Huang, Hong, et al.
Published: (2026)
Parameter-Efficient Continual Fine-Tuning: A Survey
by: Coleman, Eric Nuertey, et al.
Published: (2025)
by: Coleman, Eric Nuertey, et al.
Published: (2025)
On-the-Fly Adaptation to Quantization: Configuration-Aware LoRA for Efficient Fine-Tuning of Quantized LLMs
by: Ye, Rongguang, et al.
Published: (2025)
by: Ye, Rongguang, et al.
Published: (2025)
A Survey on Parameter-Efficient Fine-Tuning for Foundation Models in Federated Learning
by: Bian, Jieming, et al.
Published: (2025)
by: Bian, Jieming, et al.
Published: (2025)
RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models
by: Wei, Quan, et al.
Published: (2025)
by: Wei, Quan, et al.
Published: (2025)
Parameter-Efficient Fine-Tuning with Discrete Fourier Transform
by: Gao, Ziqi, et al.
Published: (2024)
by: Gao, Ziqi, et al.
Published: (2024)
Parameter-Efficient Fine-Tuning for Foundation Models
by: Zhang, Dan, et al.
Published: (2025)
by: Zhang, Dan, et al.
Published: (2025)
PiCa: Parameter-Efficient Fine-Tuning with Column Space Projection
by: Hwang, Junseo, et al.
Published: (2025)
by: Hwang, Junseo, et al.
Published: (2025)
From LLMs to Edge: Parameter-Efficient Fine-Tuning on Edge Devices
by: Slamanig, Georg, et al.
Published: (2025)
by: Slamanig, Georg, et al.
Published: (2025)
GateRA: Token-Aware Modulation for Parameter-Efficient Fine-Tuning
by: Ou, Jie, et al.
Published: (2025)
by: Ou, Jie, et al.
Published: (2025)
PERFT: Parameter-Efficient Routed Fine-Tuning for Mixture-of-Expert Model
by: Liu, Yilun, et al.
Published: (2024)
by: Liu, Yilun, et al.
Published: (2024)
Long Exposure: Accelerating Parameter-Efficient Fine-Tuning for LLMs under Shadowy Sparsity
by: Wang, Tuowei, et al.
Published: (2025)
by: Wang, Tuowei, et al.
Published: (2025)
SVFT: Parameter-Efficient Fine-Tuning with Singular Vectors
by: Lingam, Vijay, et al.
Published: (2024)
by: Lingam, Vijay, et al.
Published: (2024)
LoCA: Location-Aware Cosine Adaptation for Parameter-Efficient Fine-Tuning
by: Du, Zhekai, et al.
Published: (2025)
by: Du, Zhekai, et al.
Published: (2025)
Automated Federated Pipeline for Parameter-Efficient Fine-Tuning of Large Language Models
by: Fang, Zihan, et al.
Published: (2024)
by: Fang, Zihan, et al.
Published: (2024)
RoLoRA: Fine-tuning Rotated Outlier-free LLMs for Effective Weight-Activation Quantization
by: Huang, Xijie, et al.
Published: (2024)
by: Huang, Xijie, et al.
Published: (2024)
AutoMixQ: Self-Adjusting Quantization for High Performance Memory-Efficient Fine-Tuning
by: Zhou, Changhai, et al.
Published: (2024)
by: Zhou, Changhai, et al.
Published: (2024)
MoRe Fine-Tuning with 10x Fewer Parameters
by: Tan, Wenxuan, et al.
Published: (2024)
by: Tan, Wenxuan, et al.
Published: (2024)
Task-Aware Parameter-Efficient Fine-Tuning of Large Pre-Trained Models at the Edge
by: Hu, Senkang, et al.
Published: (2025)
by: Hu, Senkang, et al.
Published: (2025)
A Bayesian Hybrid Parameter-Efficient Fine-Tuning Method for Large Language Models
by: Chai, Yidong, et al.
Published: (2025)
by: Chai, Yidong, et al.
Published: (2025)
GraLoRA: Granular Low-Rank Adaptation for Parameter-Efficient Fine-Tuning
by: Jung, Yeonjoon, et al.
Published: (2025)
by: Jung, Yeonjoon, et al.
Published: (2025)
Parameter-Efficient Fine-Tuning for Continual Learning: A Neural Tangent Kernel Perspective
by: Liu, Jingren, et al.
Published: (2024)
by: Liu, Jingren, et al.
Published: (2024)
Understanding and Guiding Layer Placement in Parameter-Efficient Fine-Tuning of Large Language Models
by: Xu, Yichen, et al.
Published: (2026)
by: Xu, Yichen, et al.
Published: (2026)
Tequila: Trapping-free Ternary Quantization for Large Language Models
by: Huang, Hong, et al.
Published: (2025)
by: Huang, Hong, et al.
Published: (2025)
Magnitude-Modulated Equivariant Adapter for Parameter-Efficient Fine-Tuning of Equivariant Graph Neural Networks
by: Jin, Dian, et al.
Published: (2025)
by: Jin, Dian, et al.
Published: (2025)
Parameter-Efficient Fine-Tuning for HAR: Integrating LoRA and QLoRA into Transformer Models
by: Seregina, Irina, et al.
Published: (2025)
by: Seregina, Irina, et al.
Published: (2025)
Efficiency vs. Alignment: Investigating Safety and Fairness Risks in Parameter-Efficient Fine-Tuning of LLMs
by: Taraghi, Mina, et al.
Published: (2025)
by: Taraghi, Mina, et al.
Published: (2025)
Echo-LoRA: Parameter-Efficient Fine-Tuning via Cross-Layer Representation Injection
by: Peng, Yihang, et al.
Published: (2026)
by: Peng, Yihang, et al.
Published: (2026)
CleaR: Towards Robust and Generalized Parameter-Efficient Fine-Tuning for Noisy Label Learning
by: Kim, Yeachan, et al.
Published: (2024)
by: Kim, Yeachan, et al.
Published: (2024)
Widening the Gap: Exploiting LLM Quantization via Outlier Injection
by: Zhan, Xiaohua, et al.
Published: (2026)
by: Zhan, Xiaohua, et al.
Published: (2026)
OSC: Hardware Efficient W4A4 Quantization via Outlier Separation in Channel Dimension
by: Zhang, Zhiyuan, et al.
Published: (2026)
by: Zhang, Zhiyuan, et al.
Published: (2026)
Q-ROAR: Outlier-Aware Rescaling for RoPE Position Interpolation in Quantized Long-Context LLMs
by: Qiao, Ye, et al.
Published: (2025)
by: Qiao, Ye, et al.
Published: (2025)
Solo Connection: A Parameter Efficient Fine-Tuning Technique for Transformers
by: Pathak, Harsh Nilesh, et al.
Published: (2025)
by: Pathak, Harsh Nilesh, et al.
Published: (2025)
Parameter Efficient Fine Tuning: A Comprehensive Analysis Across Applications
by: Balne, Charith Chandra Sai, et al.
Published: (2024)
by: Balne, Charith Chandra Sai, et al.
Published: (2024)
Parameter-Efficient Fine-Tuning in Large Models: A Survey of Methodologies
by: Wang, Luping, et al.
Published: (2024)
by: Wang, Luping, et al.
Published: (2024)
Graph Adapter of EEG Foundation Models for Parameter Efficient Fine Tuning
by: Suzumura, Toyotaro, et al.
Published: (2024)
by: Suzumura, Toyotaro, et al.
Published: (2024)
Parameter Efficient Quasi-Orthogonal Fine-Tuning via Givens Rotation
by: Ma, Xinyu, et al.
Published: (2024)
by: Ma, Xinyu, et al.
Published: (2024)
AutoPEFT: Automatic Configuration Search for Parameter-Efficient Fine-Tuning
by: Zhou, Han, et al.
Published: (2023)
by: Zhou, Han, et al.
Published: (2023)
AMAQ: Adaptive Mixed-bit Activation Quantization for Collaborative Parameter Efficient Fine-tuning
by: Song, Yurun, et al.
Published: (2025)
by: Song, Yurun, et al.
Published: (2025)
An Efficient Sparse Fine-Tuning with Low Quantization Error via Neural Network Pruning
by: Li, Cen-Jhih, et al.
Published: (2025)
by: Li, Cen-Jhih, et al.
Published: (2025)
Similar Items
-
Sherry: Hardware-Efficient 1.25-Bit Ternary Quantization via Fine-grained Sparsification
by: Huang, Hong, et al.
Published: (2026) -
Parameter-Efficient Continual Fine-Tuning: A Survey
by: Coleman, Eric Nuertey, et al.
Published: (2025) -
On-the-Fly Adaptation to Quantization: Configuration-Aware LoRA for Efficient Fine-Tuning of Quantized LLMs
by: Ye, Rongguang, et al.
Published: (2025) -
A Survey on Parameter-Efficient Fine-Tuning for Foundation Models in Federated Learning
by: Bian, Jieming, et al.
Published: (2025) -
RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models
by: Wei, Quan, et al.
Published: (2025)