Salvato in:
| Autori principali: | Cui, Wanyun, Wang, Qianle |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2404.02837 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Ada-Instruct: Adapting Instruction Generators for Complex Reasoning
di: Cui, Wanyun, et al.
Pubblicazione: (2023)
di: Cui, Wanyun, et al.
Pubblicazione: (2023)
Homogeneous Keys, Heterogeneous Values: Exploiting Local KV Cache Asymmetry for Long-Context LLMs
di: Cui, Wanyun, et al.
Pubblicazione: (2025)
di: Cui, Wanyun, et al.
Pubblicazione: (2025)
Leveraging Logical Rules in Knowledge Editing: A Cherry on the Top
di: Cheng, Keyuan, et al.
Pubblicazione: (2024)
di: Cheng, Keyuan, et al.
Pubblicazione: (2024)
Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning
di: Xie, Wanyun, et al.
Pubblicazione: (2025)
di: Xie, Wanyun, et al.
Pubblicazione: (2025)
Evaluating Quantized Large Language Models
di: Li, Shiyao, et al.
Pubblicazione: (2024)
di: Li, Shiyao, et al.
Pubblicazione: (2024)
QWHA: Quantization-Aware Walsh-Hadamard Adaptation for Parameter-Efficient Fine-Tuning on Large Language Models
di: Jeon, Hyesung, et al.
Pubblicazione: (2025)
di: Jeon, Hyesung, et al.
Pubblicazione: (2025)
OpenCoder: The Open Cookbook for Top-Tier Code Large Language Models
di: Huang, Siming, et al.
Pubblicazione: (2024)
di: Huang, Siming, et al.
Pubblicazione: (2024)
L4Q: Parameter Efficient Quantization-Aware Fine-Tuning on Large Language Models
di: Jeon, Hyesung, et al.
Pubblicazione: (2024)
di: Jeon, Hyesung, et al.
Pubblicazione: (2024)
The Mercurial Top-Level Ontology of Large Language Models
di: Köhler, Nele, et al.
Pubblicazione: (2024)
di: Köhler, Nele, et al.
Pubblicazione: (2024)
On the Compressibility of Quantized Large Language Models
di: Mao, Yu, et al.
Pubblicazione: (2024)
di: Mao, Yu, et al.
Pubblicazione: (2024)
TopK Language Models
di: Takahashi, Ryosuke, et al.
Pubblicazione: (2025)
di: Takahashi, Ryosuke, et al.
Pubblicazione: (2025)
OutlierTune: Efficient Channel-Wise Quantization for Large Language Models
di: Wang, Jinguang, et al.
Pubblicazione: (2024)
di: Wang, Jinguang, et al.
Pubblicazione: (2024)
MoA: Heterogeneous Mixture of Adapters for Parameter-Efficient Fine-Tuning of Large Language Models
di: Cao, Jie, et al.
Pubblicazione: (2025)
di: Cao, Jie, et al.
Pubblicazione: (2025)
Distribution-Aware Companding Quantization of Large Language Models
di: Radhakrishnan, Athul, et al.
Pubblicazione: (2026)
di: Radhakrishnan, Athul, et al.
Pubblicazione: (2026)
On Context-aware Detection of Cherry-picking in News Reporting
di: Jaradat, Israa, et al.
Pubblicazione: (2024)
di: Jaradat, Israa, et al.
Pubblicazione: (2024)
Heterogeneous Value Alignment Evaluation for Large Language Models
di: Zhang, Zhaowei, et al.
Pubblicazione: (2023)
di: Zhang, Zhaowei, et al.
Pubblicazione: (2023)
CBQ: Cross-Block Quantization for Large Language Models
di: Ding, Xin, et al.
Pubblicazione: (2023)
di: Ding, Xin, et al.
Pubblicazione: (2023)
Quantization of Large Language Models with an Overdetermined Basis
di: Merkulov, Daniil, et al.
Pubblicazione: (2024)
di: Merkulov, Daniil, et al.
Pubblicazione: (2024)
BAQ: Efficient Bit Allocation Quantization for Large Language Models
di: Zhang, Chao, et al.
Pubblicazione: (2025)
di: Zhang, Chao, et al.
Pubblicazione: (2025)
LSAQ: Layer-Specific Adaptive Quantization for Large Language Model Deployment
di: Zeng, Binrui, et al.
Pubblicazione: (2024)
di: Zeng, Binrui, et al.
Pubblicazione: (2024)
Scaling Laws for Post Training Quantized Large Language Models
di: Xu, Zifei, et al.
Pubblicazione: (2024)
di: Xu, Zifei, et al.
Pubblicazione: (2024)
Fair-GPTQ: Bias-Aware Quantization for Large Language Models
di: Proskurina, Irina, et al.
Pubblicazione: (2025)
di: Proskurina, Irina, et al.
Pubblicazione: (2025)
A Comprehensive Evaluation of Quantization Strategies for Large Language Models
di: Jin, Renren, et al.
Pubblicazione: (2024)
di: Jin, Renren, et al.
Pubblicazione: (2024)
Self-Updatable Large Language Models by Integrating Context into Model Parameters
di: Wang, Yu, et al.
Pubblicazione: (2024)
di: Wang, Yu, et al.
Pubblicazione: (2024)
Advantageous Parameter Expansion Training Makes Better Large Language Models
di: Gu, Naibin, et al.
Pubblicazione: (2025)
di: Gu, Naibin, et al.
Pubblicazione: (2025)
Quantized Large Language Models in Biomedical Natural Language Processing: Evaluation and Recommendation
di: Zhan, Zaifu, et al.
Pubblicazione: (2025)
di: Zhan, Zaifu, et al.
Pubblicazione: (2025)
When Quantization Affects Confidence of Large Language Models?
di: Proskurina, Irina, et al.
Pubblicazione: (2024)
di: Proskurina, Irina, et al.
Pubblicazione: (2024)
FBQuant: FeedBack Quantization for Large Language Models
di: Liu, Yijiang, et al.
Pubblicazione: (2025)
di: Liu, Yijiang, et al.
Pubblicazione: (2025)
DLLMQuant: Quantizing Diffusion-based Large Language Models
di: Xu, Chen, et al.
Pubblicazione: (2025)
di: Xu, Chen, et al.
Pubblicazione: (2025)
How Quantization Shapes Bias in Large Language Models
di: Marcuzzi, Federico, et al.
Pubblicazione: (2025)
di: Marcuzzi, Federico, et al.
Pubblicazione: (2025)
RUQuant: Towards Refining Uniform Quantization for Large Language Models
di: Liu, Han, et al.
Pubblicazione: (2026)
di: Liu, Han, et al.
Pubblicazione: (2026)
Determine-Then-Ensemble: Necessity of Top-k Union for Large Language Model Ensembling
di: Yao, Yuxuan, et al.
Pubblicazione: (2024)
di: Yao, Yuxuan, et al.
Pubblicazione: (2024)
Uncertainty Drives Social Bias Changes in Quantized Large Language Models
di: Hua, Stanley Z., et al.
Pubblicazione: (2026)
di: Hua, Stanley Z., et al.
Pubblicazione: (2026)
1bit-Merging: Dynamic Quantized Merging for Large Language Models
di: Liu, Shuqi, et al.
Pubblicazione: (2025)
di: Liu, Shuqi, et al.
Pubblicazione: (2025)
Using Large Language Models to Construct Virtual Top Managers: A Method for Organizational Research
di: Garzon-Vico, Antonio, et al.
Pubblicazione: (2026)
di: Garzon-Vico, Antonio, et al.
Pubblicazione: (2026)
Ensemble Learning for Heterogeneous Large Language Models with Deep Parallel Collaboration
di: Huang, Yichong, et al.
Pubblicazione: (2024)
di: Huang, Yichong, et al.
Pubblicazione: (2024)
Precise In-Parameter Concept Erasure in Large Language Models
di: Gur-Arieh, Yoav, et al.
Pubblicazione: (2025)
di: Gur-Arieh, Yoav, et al.
Pubblicazione: (2025)
Optimizing Large Language Model Training Using FP4 Quantization
di: Wang, Ruizhe, et al.
Pubblicazione: (2025)
di: Wang, Ruizhe, et al.
Pubblicazione: (2025)
Channel-Wise Mixed-Precision Quantization for Large Language Models
di: Chen, Zihan, et al.
Pubblicazione: (2024)
di: Chen, Zihan, et al.
Pubblicazione: (2024)
Extreme Compression of Large Language Models via Additive Quantization
di: Egiazarian, Vage, et al.
Pubblicazione: (2024)
di: Egiazarian, Vage, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Ada-Instruct: Adapting Instruction Generators for Complex Reasoning
di: Cui, Wanyun, et al.
Pubblicazione: (2023) -
Homogeneous Keys, Heterogeneous Values: Exploiting Local KV Cache Asymmetry for Long-Context LLMs
di: Cui, Wanyun, et al.
Pubblicazione: (2025) -
Leveraging Logical Rules in Knowledge Editing: A Cherry on the Top
di: Cheng, Keyuan, et al.
Pubblicazione: (2024) -
Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning
di: Xie, Wanyun, et al.
Pubblicazione: (2025) -
Evaluating Quantized Large Language Models
di: Li, Shiyao, et al.
Pubblicazione: (2024)