Salvato in:
| Autori principali: | Zhou, Changhai, Zhang, Shiyang, Zhou, Yuhua, Qiao, Qian, Gao, Jun, Jin, Cheng, Qin, Kaizhou, Zhang, Weizhong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.22268 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Balancing Fidelity and Plasticity: Aligning Mixed-Precision Fine-Tuning with Linguistic Hierarchies
di: Zhou, Changhai, et al.
Pubblicazione: (2025)
di: Zhou, Changhai, et al.
Pubblicazione: (2025)
AutoMixQ: Self-Adjusting Quantization for High Performance Memory-Efficient Fine-Tuning
di: Zhou, Changhai, et al.
Pubblicazione: (2024)
di: Zhou, Changhai, et al.
Pubblicazione: (2024)
Large Language Model Compression with Global Rank and Sparsity Optimization
di: Zhou, Changhai, et al.
Pubblicazione: (2025)
di: Zhou, Changhai, et al.
Pubblicazione: (2025)
CoRE: A Fine-Grained Code Reasoning Benchmark Beyond Output Prediction
di: Gao, Jun, et al.
Pubblicazione: (2026)
di: Gao, Jun, et al.
Pubblicazione: (2026)
QPruner: Probabilistic Decision Quantization for Structured Pruning in Large Language Models
di: Zhou, Changhai, et al.
Pubblicazione: (2024)
di: Zhou, Changhai, et al.
Pubblicazione: (2024)
RankAdaptor: Hierarchical Rank Allocation for Efficient Fine-Tuning Pruned LLMs via Performance Model
di: Zhou, Changhai, et al.
Pubblicazione: (2024)
di: Zhou, Changhai, et al.
Pubblicazione: (2024)
Data-Free Quantization via Mixed-Precision Compensation without Fine-Tuning
di: Chen, Jun, et al.
Pubblicazione: (2023)
di: Chen, Jun, et al.
Pubblicazione: (2023)
Exploring Training on Heterogeneous Data with Mixture of Low-rank Adapters
di: Zhou, Yuhang, et al.
Pubblicazione: (2024)
di: Zhou, Yuhang, et al.
Pubblicazione: (2024)
Scalable Variational Bayesian Fine-Tuning of LLMs via Orthogonalized Low-Rank Adapters
di: Xiang, Haotian, et al.
Pubblicazione: (2026)
di: Xiang, Haotian, et al.
Pubblicazione: (2026)
Spectral Adapter: Fine-Tuning in Spectral Space
di: Zhang, Fangzhao, et al.
Pubblicazione: (2024)
di: Zhang, Fangzhao, et al.
Pubblicazione: (2024)
Pear: Pruning and Sharing Adapters in Visual Parameter-Efficient Fine-Tuning
di: Zhong, Yibo, et al.
Pubblicazione: (2024)
di: Zhong, Yibo, et al.
Pubblicazione: (2024)
ExpertWeave: Efficiently Serving Expert-Specialized Fine-Tuned Adapters at Scale
di: Shi, Ge, et al.
Pubblicazione: (2025)
di: Shi, Ge, et al.
Pubblicazione: (2025)
Safeti QRA- more than just compliance
di: Cavanagh, Nic
Pubblicazione: (2007)
di: Cavanagh, Nic
Pubblicazione: (2007)
FineQ: Software-Hardware Co-Design for Low-Bit Fine-Grained Mixed-Precision Quantization of LLMs
di: Xie, Xilong, et al.
Pubblicazione: (2025)
di: Xie, Xilong, et al.
Pubblicazione: (2025)
SliM-LLM: Salience-Driven Mixed-Precision Quantization for Large Language Models
di: Huang, Wei, et al.
Pubblicazione: (2024)
di: Huang, Wei, et al.
Pubblicazione: (2024)
FGMP: Fine-Grained Mixed-Precision Weight and Activation Quantization for Hardware-Accelerated LLM Inference
di: Hooper, Coleman, et al.
Pubblicazione: (2025)
di: Hooper, Coleman, et al.
Pubblicazione: (2025)
MELoRA: Mini-Ensemble Low-Rank Adapters for Parameter-Efficient Fine-Tuning
di: Ren, Pengjie, et al.
Pubblicazione: (2024)
di: Ren, Pengjie, et al.
Pubblicazione: (2024)
SMoA: Spectrum Modulation Adapter for Parameter-Efficient Fine-Tuning
di: Liu, Yongkang, et al.
Pubblicazione: (2026)
di: Liu, Yongkang, et al.
Pubblicazione: (2026)
EfficientDM: Efficient Quantization-Aware Fine-Tuning of Low-Bit Diffusion Models
di: He, Yefei, et al.
Pubblicazione: (2023)
di: He, Yefei, et al.
Pubblicazione: (2023)
Iterative Low-rank Network for Hyperspectral Image Denoising
di: Ye, Jin, et al.
Pubblicazione: (2025)
di: Ye, Jin, et al.
Pubblicazione: (2025)
On-Chip Hardware-Aware Quantization for Mixed Precision Neural Networks
di: Huang, Wei, et al.
Pubblicazione: (2023)
di: Huang, Wei, et al.
Pubblicazione: (2023)
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
di: Feng, Weilun, et al.
Pubblicazione: (2024)
di: Feng, Weilun, et al.
Pubblicazione: (2024)
Parameter-Efficient Fine-Tuning With Adapters
di: Chen, Keyu, et al.
Pubblicazione: (2024)
di: Chen, Keyu, et al.
Pubblicazione: (2024)
Low-rank Attention Side-Tuning for Parameter-Efficient Fine-Tuning
di: Tang, Ningyuan, et al.
Pubblicazione: (2024)
di: Tang, Ningyuan, et al.
Pubblicazione: (2024)
Cocktail: Chunk-Adaptive Mixed-Precision Quantization for Long-Context LLM Inference
di: Tao, Wei, et al.
Pubblicazione: (2025)
di: Tao, Wei, et al.
Pubblicazione: (2025)
Mixture of Physical Priors Adapter for Parameter-Efficient Fine-Tuning
di: Wang, Zhaozhi, et al.
Pubblicazione: (2024)
di: Wang, Zhaozhi, et al.
Pubblicazione: (2024)
A Coarse-to-Fine Human Pose Estimation Method based on Two-stage Distillation and Progressive Graph Neural Network
di: Ji, Zhangjian, et al.
Pubblicazione: (2025)
di: Ji, Zhangjian, et al.
Pubblicazione: (2025)
SONIQ: System-Optimized Noise-Injected Ultra-Low-Precision Quantization with Full-Precision Parity
di: Zhou, Cyrus, et al.
Pubblicazione: (2023)
di: Zhou, Cyrus, et al.
Pubblicazione: (2023)
Mixed-Precision Graph Neural Quantization for Low Bit Large Language Models
di: Liu, Wanlong, et al.
Pubblicazione: (2025)
di: Liu, Wanlong, et al.
Pubblicazione: (2025)
AutoFT: Learning an Objective for Robust Fine-Tuning
di: Choi, Caroline, et al.
Pubblicazione: (2024)
di: Choi, Caroline, et al.
Pubblicazione: (2024)
ProjQ: Project-and-Quantize for Adapter-Aware LLM Compression
di: Yu, Wneya, et al.
Pubblicazione: (2026)
di: Yu, Wneya, et al.
Pubblicazione: (2026)
OMPQ: Orthogonal Mixed Precision Quantization
di: Ma, Yuexiao, et al.
Pubblicazione: (2021)
di: Ma, Yuexiao, et al.
Pubblicazione: (2021)
STaMP: Sequence Transformation and Mixed Precision for Low-Precision Activation Quantization
di: Federici, Marco, et al.
Pubblicazione: (2025)
di: Federici, Marco, et al.
Pubblicazione: (2025)
Noni Fruit Polysaccharide Derivatives: Preparation, Structural Characterization, and Antioxidant Activities Evaluation
di: Shiyang Zhou, et al.
Pubblicazione: (2026)
di: Shiyang Zhou, et al.
Pubblicazione: (2026)
Low-rank Optimization Trajectories Modeling for LLM RLVR Acceleration
di: Chen, Zhipeng, et al.
Pubblicazione: (2026)
di: Chen, Zhipeng, et al.
Pubblicazione: (2026)
MoQAE: Mixed-Precision Quantization for Long-Context LLM Inference via Mixture of Quantization-Aware Experts
di: Tao, Wei, et al.
Pubblicazione: (2025)
di: Tao, Wei, et al.
Pubblicazione: (2025)
AutoPEFT: Automatic Configuration Search for Parameter-Efficient Fine-Tuning
di: Zhou, Han, et al.
Pubblicazione: (2023)
di: Zhou, Han, et al.
Pubblicazione: (2023)
Symbiosis: Multi-Adapter Inference and Fine-Tuning
di: Gupta, Saransh, et al.
Pubblicazione: (2025)
di: Gupta, Saransh, et al.
Pubblicazione: (2025)
QEFT: Quantization for Efficient Fine-Tuning of LLMs
di: Lee, Changhun, et al.
Pubblicazione: (2024)
di: Lee, Changhun, et al.
Pubblicazione: (2024)
TAGCOS: Task-agnostic Gradient Clustered Coreset Selection for Instruction Tuning Data
di: Zhang, Jipeng, et al.
Pubblicazione: (2024)
di: Zhang, Jipeng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Balancing Fidelity and Plasticity: Aligning Mixed-Precision Fine-Tuning with Linguistic Hierarchies
di: Zhou, Changhai, et al.
Pubblicazione: (2025) -
AutoMixQ: Self-Adjusting Quantization for High Performance Memory-Efficient Fine-Tuning
di: Zhou, Changhai, et al.
Pubblicazione: (2024) -
Large Language Model Compression with Global Rank and Sparsity Optimization
di: Zhou, Changhai, et al.
Pubblicazione: (2025) -
CoRE: A Fine-Grained Code Reasoning Benchmark Beyond Output Prediction
di: Gao, Jun, et al.
Pubblicazione: (2026) -
QPruner: Probabilistic Decision Quantization for Structured Pruning in Large Language Models
di: Zhou, Changhai, et al.
Pubblicazione: (2024)