Enregistré dans:
| Auteurs principaux: | Zhou, Changhai, Zhang, Shiyang, Zhou, Yuhua, Qiao, Qian, Gao, Jun, Jin, Cheng, Qin, Kaizhou, Zhang, Weizhong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.22268 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Balancing Fidelity and Plasticity: Aligning Mixed-Precision Fine-Tuning with Linguistic Hierarchies
par: Zhou, Changhai, et autres
Publié: (2025)
par: Zhou, Changhai, et autres
Publié: (2025)
AutoMixQ: Self-Adjusting Quantization for High Performance Memory-Efficient Fine-Tuning
par: Zhou, Changhai, et autres
Publié: (2024)
par: Zhou, Changhai, et autres
Publié: (2024)
Large Language Model Compression with Global Rank and Sparsity Optimization
par: Zhou, Changhai, et autres
Publié: (2025)
par: Zhou, Changhai, et autres
Publié: (2025)
CoRE: A Fine-Grained Code Reasoning Benchmark Beyond Output Prediction
par: Gao, Jun, et autres
Publié: (2026)
par: Gao, Jun, et autres
Publié: (2026)
QPruner: Probabilistic Decision Quantization for Structured Pruning in Large Language Models
par: Zhou, Changhai, et autres
Publié: (2024)
par: Zhou, Changhai, et autres
Publié: (2024)
RankAdaptor: Hierarchical Rank Allocation for Efficient Fine-Tuning Pruned LLMs via Performance Model
par: Zhou, Changhai, et autres
Publié: (2024)
par: Zhou, Changhai, et autres
Publié: (2024)
Data-Free Quantization via Mixed-Precision Compensation without Fine-Tuning
par: Chen, Jun, et autres
Publié: (2023)
par: Chen, Jun, et autres
Publié: (2023)
Exploring Training on Heterogeneous Data with Mixture of Low-rank Adapters
par: Zhou, Yuhang, et autres
Publié: (2024)
par: Zhou, Yuhang, et autres
Publié: (2024)
Scalable Variational Bayesian Fine-Tuning of LLMs via Orthogonalized Low-Rank Adapters
par: Xiang, Haotian, et autres
Publié: (2026)
par: Xiang, Haotian, et autres
Publié: (2026)
Spectral Adapter: Fine-Tuning in Spectral Space
par: Zhang, Fangzhao, et autres
Publié: (2024)
par: Zhang, Fangzhao, et autres
Publié: (2024)
Pear: Pruning and Sharing Adapters in Visual Parameter-Efficient Fine-Tuning
par: Zhong, Yibo, et autres
Publié: (2024)
par: Zhong, Yibo, et autres
Publié: (2024)
ExpertWeave: Efficiently Serving Expert-Specialized Fine-Tuned Adapters at Scale
par: Shi, Ge, et autres
Publié: (2025)
par: Shi, Ge, et autres
Publié: (2025)
Safeti QRA- more than just compliance
par: Cavanagh, Nic
Publié: (2007)
par: Cavanagh, Nic
Publié: (2007)
FineQ: Software-Hardware Co-Design for Low-Bit Fine-Grained Mixed-Precision Quantization of LLMs
par: Xie, Xilong, et autres
Publié: (2025)
par: Xie, Xilong, et autres
Publié: (2025)
SliM-LLM: Salience-Driven Mixed-Precision Quantization for Large Language Models
par: Huang, Wei, et autres
Publié: (2024)
par: Huang, Wei, et autres
Publié: (2024)
FGMP: Fine-Grained Mixed-Precision Weight and Activation Quantization for Hardware-Accelerated LLM Inference
par: Hooper, Coleman, et autres
Publié: (2025)
par: Hooper, Coleman, et autres
Publié: (2025)
MELoRA: Mini-Ensemble Low-Rank Adapters for Parameter-Efficient Fine-Tuning
par: Ren, Pengjie, et autres
Publié: (2024)
par: Ren, Pengjie, et autres
Publié: (2024)
SMoA: Spectrum Modulation Adapter for Parameter-Efficient Fine-Tuning
par: Liu, Yongkang, et autres
Publié: (2026)
par: Liu, Yongkang, et autres
Publié: (2026)
EfficientDM: Efficient Quantization-Aware Fine-Tuning of Low-Bit Diffusion Models
par: He, Yefei, et autres
Publié: (2023)
par: He, Yefei, et autres
Publié: (2023)
Iterative Low-rank Network for Hyperspectral Image Denoising
par: Ye, Jin, et autres
Publié: (2025)
par: Ye, Jin, et autres
Publié: (2025)
On-Chip Hardware-Aware Quantization for Mixed Precision Neural Networks
par: Huang, Wei, et autres
Publié: (2023)
par: Huang, Wei, et autres
Publié: (2023)
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
par: Feng, Weilun, et autres
Publié: (2024)
par: Feng, Weilun, et autres
Publié: (2024)
Parameter-Efficient Fine-Tuning With Adapters
par: Chen, Keyu, et autres
Publié: (2024)
par: Chen, Keyu, et autres
Publié: (2024)
Low-rank Attention Side-Tuning for Parameter-Efficient Fine-Tuning
par: Tang, Ningyuan, et autres
Publié: (2024)
par: Tang, Ningyuan, et autres
Publié: (2024)
Cocktail: Chunk-Adaptive Mixed-Precision Quantization for Long-Context LLM Inference
par: Tao, Wei, et autres
Publié: (2025)
par: Tao, Wei, et autres
Publié: (2025)
Mixture of Physical Priors Adapter for Parameter-Efficient Fine-Tuning
par: Wang, Zhaozhi, et autres
Publié: (2024)
par: Wang, Zhaozhi, et autres
Publié: (2024)
A Coarse-to-Fine Human Pose Estimation Method based on Two-stage Distillation and Progressive Graph Neural Network
par: Ji, Zhangjian, et autres
Publié: (2025)
par: Ji, Zhangjian, et autres
Publié: (2025)
SONIQ: System-Optimized Noise-Injected Ultra-Low-Precision Quantization with Full-Precision Parity
par: Zhou, Cyrus, et autres
Publié: (2023)
par: Zhou, Cyrus, et autres
Publié: (2023)
Mixed-Precision Graph Neural Quantization for Low Bit Large Language Models
par: Liu, Wanlong, et autres
Publié: (2025)
par: Liu, Wanlong, et autres
Publié: (2025)
AutoFT: Learning an Objective for Robust Fine-Tuning
par: Choi, Caroline, et autres
Publié: (2024)
par: Choi, Caroline, et autres
Publié: (2024)
ProjQ: Project-and-Quantize for Adapter-Aware LLM Compression
par: Yu, Wneya, et autres
Publié: (2026)
par: Yu, Wneya, et autres
Publié: (2026)
OMPQ: Orthogonal Mixed Precision Quantization
par: Ma, Yuexiao, et autres
Publié: (2021)
par: Ma, Yuexiao, et autres
Publié: (2021)
STaMP: Sequence Transformation and Mixed Precision for Low-Precision Activation Quantization
par: Federici, Marco, et autres
Publié: (2025)
par: Federici, Marco, et autres
Publié: (2025)
Noni Fruit Polysaccharide Derivatives: Preparation, Structural Characterization, and Antioxidant Activities Evaluation
par: Shiyang Zhou, et autres
Publié: (2026)
par: Shiyang Zhou, et autres
Publié: (2026)
Low-rank Optimization Trajectories Modeling for LLM RLVR Acceleration
par: Chen, Zhipeng, et autres
Publié: (2026)
par: Chen, Zhipeng, et autres
Publié: (2026)
MoQAE: Mixed-Precision Quantization for Long-Context LLM Inference via Mixture of Quantization-Aware Experts
par: Tao, Wei, et autres
Publié: (2025)
par: Tao, Wei, et autres
Publié: (2025)
AutoPEFT: Automatic Configuration Search for Parameter-Efficient Fine-Tuning
par: Zhou, Han, et autres
Publié: (2023)
par: Zhou, Han, et autres
Publié: (2023)
Symbiosis: Multi-Adapter Inference and Fine-Tuning
par: Gupta, Saransh, et autres
Publié: (2025)
par: Gupta, Saransh, et autres
Publié: (2025)
QEFT: Quantization for Efficient Fine-Tuning of LLMs
par: Lee, Changhun, et autres
Publié: (2024)
par: Lee, Changhun, et autres
Publié: (2024)
TAGCOS: Task-agnostic Gradient Clustered Coreset Selection for Instruction Tuning Data
par: Zhang, Jipeng, et autres
Publié: (2024)
par: Zhang, Jipeng, et autres
Publié: (2024)
Documents similaires
-
Balancing Fidelity and Plasticity: Aligning Mixed-Precision Fine-Tuning with Linguistic Hierarchies
par: Zhou, Changhai, et autres
Publié: (2025) -
AutoMixQ: Self-Adjusting Quantization for High Performance Memory-Efficient Fine-Tuning
par: Zhou, Changhai, et autres
Publié: (2024) -
Large Language Model Compression with Global Rank and Sparsity Optimization
par: Zhou, Changhai, et autres
Publié: (2025) -
CoRE: A Fine-Grained Code Reasoning Benchmark Beyond Output Prediction
par: Gao, Jun, et autres
Publié: (2026) -
QPruner: Probabilistic Decision Quantization for Structured Pruning in Large Language Models
par: Zhou, Changhai, et autres
Publié: (2024)