DLLMQuant: Quantizing Diffusion-based Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Chen, Yang, Dawei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models
di: Hu, Xing, et al.
Pubblicazione: (2024)
di: Hu, Xing, et al.
Pubblicazione: (2024)
Evaluating Quantized Large Language Models
di: Li, Shiyao, et al.
Pubblicazione: (2024)
di: Li, Shiyao, et al.
Pubblicazione: (2024)
Quantized Embedding Vectors for Controllable Diffusion Language Models
di: Kang, Cheng, et al.
Pubblicazione: (2024)
di: Kang, Cheng, et al.
Pubblicazione: (2024)
Beyond the Speculative Game: A Survey of Speculative Execution in Large Language Models
di: Zhang, Chen, et al.
Pubblicazione: (2024)
di: Zhang, Chen, et al.
Pubblicazione: (2024)
Channel-Wise Mixed-Precision Quantization for Large Language Models
di: Chen, Zihan, et al.
Pubblicazione: (2024)
di: Chen, Zihan, et al.
Pubblicazione: (2024)
Contextualization Distillation from Large Language Model for Knowledge Graph Completion
di: Li, Dawei, et al.
Pubblicazione: (2024)
di: Li, Dawei, et al.
Pubblicazione: (2024)
Quantized Large Language Models in Biomedical Natural Language Processing: Evaluation and Recommendation
di: Zhan, Zaifu, et al.
Pubblicazione: (2025)
di: Zhan, Zaifu, et al.
Pubblicazione: (2025)
When Quantization Affects Confidence of Large Language Models?
di: Proskurina, Irina, et al.
Pubblicazione: (2024)
di: Proskurina, Irina, et al.
Pubblicazione: (2024)
SASQ: Static Activation Scaling for Quantization-Aware Training in Large Language Models
di: Mao, Shizhuo, et al.
Pubblicazione: (2025)
di: Mao, Shizhuo, et al.
Pubblicazione: (2025)
Qibo: A Large Language Model for Traditional Chinese Medicine
di: Zhang, Heyi, et al.
Pubblicazione: (2024)
di: Zhang, Heyi, et al.
Pubblicazione: (2024)
ReaLM: Residual Quantization Bridging Knowledge Graph Embeddings and Large Language Models
di: Guo, Wenbin, et al.
Pubblicazione: (2025)
di: Guo, Wenbin, et al.
Pubblicazione: (2025)
ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models
di: Yoon, Junho, et al.
Pubblicazione: (2025)
di: Yoon, Junho, et al.
Pubblicazione: (2025)
A Comprehensive Evaluation of Quantization Strategies for Large Language Models
di: Jin, Renren, et al.
Pubblicazione: (2024)
di: Jin, Renren, et al.
Pubblicazione: (2024)
Self-supervised Quantized Representation for Seamlessly Integrating Knowledge Graphs with Large Language Models
di: Lin, Qika, et al.
Pubblicazione: (2025)
di: Lin, Qika, et al.
Pubblicazione: (2025)
EfficientQAT: Efficient Quantization-Aware Training for Large Language Models
di: Chen, Mengzhao, et al.
Pubblicazione: (2024)
di: Chen, Mengzhao, et al.
Pubblicazione: (2024)
On the Compressibility of Quantized Large Language Models
di: Mao, Yu, et al.
Pubblicazione: (2024)
di: Mao, Yu, et al.
Pubblicazione: (2024)
IntactKV: Improving Large Language Model Quantization by Keeping Pivot Tokens Intact
di: Liu, Ruikang, et al.
Pubblicazione: (2024)
di: Liu, Ruikang, et al.
Pubblicazione: (2024)
Beyond Accuracy: The Role of Calibration in Self-Improving Large Language Models
di: Huang, Liangjie, et al.
Pubblicazione: (2025)
di: Huang, Liangjie, et al.
Pubblicazione: (2025)
The Real, the Better: Aligning Large Language Models with Online Human Behaviors
di: Jiang, Guanying, et al.
Pubblicazione: (2024)
di: Jiang, Guanying, et al.
Pubblicazione: (2024)
Tool Learning with Large Language Models: A Survey
di: Qu, Changle, et al.
Pubblicazione: (2024)
di: Qu, Changle, et al.
Pubblicazione: (2024)
A Survey on Large Language Model based Autonomous Agents
di: Wang, Lei, et al.
Pubblicazione: (2023)
di: Wang, Lei, et al.
Pubblicazione: (2023)
R2Q: Towards Robust 2-Bit Large Language Models via Residual Refinement Quantization
di: Chen, Jiayi, et al.
Pubblicazione: (2025)
di: Chen, Jiayi, et al.
Pubblicazione: (2025)
GraphGPT: Graph Instruction Tuning for Large Language Models
di: Tang, Jiabin, et al.
Pubblicazione: (2023)
di: Tang, Jiabin, et al.
Pubblicazione: (2023)
UrbanGPT: Spatio-Temporal Large Language Models
di: Li, Zhonghang, et al.
Pubblicazione: (2024)
di: Li, Zhonghang, et al.
Pubblicazione: (2024)
Anchor-based Large Language Models
di: Pang, Jianhui, et al.
Pubblicazione: (2024)
di: Pang, Jianhui, et al.
Pubblicazione: (2024)
GWQ: Gradient-Aware Weight Quantization for Large Language Models
di: Shao, Yihua, et al.
Pubblicazione: (2024)
di: Shao, Yihua, et al.
Pubblicazione: (2024)
MALM: A Multi-Information Adapter for Large Language Models to Mitigate Hallucination
di: Jia, Ao, et al.
Pubblicazione: (2025)
di: Jia, Ao, et al.
Pubblicazione: (2025)
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
di: Lyu, Yougang, et al.
Pubblicazione: (2024)
di: Lyu, Yougang, et al.
Pubblicazione: (2024)
Deferred Commitment Decoding for Diffusion Language Models
di: Shu, Yingte, et al.
Pubblicazione: (2026)
di: Shu, Yingte, et al.
Pubblicazione: (2026)
Quantization Meets dLLMs: A Systematic Study of Post-training Quantization for Diffusion LLMs
di: Lin, Haokun, et al.
Pubblicazione: (2025)
di: Lin, Haokun, et al.
Pubblicazione: (2025)
Focus on the Core: Empowering Diffusion Large Language Models by Self-Contrast
di: Feng, Jinyuan, et al.
Pubblicazione: (2026)
di: Feng, Jinyuan, et al.
Pubblicazione: (2026)
Benchmarking Post-Training Quantization of Large Language Models under Microscaling Floating Point Formats
di: Zhang, Manyi, et al.
Pubblicazione: (2026)
di: Zhang, Manyi, et al.
Pubblicazione: (2026)
MambaQuant: Quantizing the Mamba Family with Variance Aligned Rotation Methods
di: Xu, Zukang, et al.
Pubblicazione: (2025)
di: Xu, Zukang, et al.
Pubblicazione: (2025)
LLMC: Benchmarking Large Language Model Quantization with a Versatile Compression Toolkit
di: Gong, Ruihao, et al.
Pubblicazione: (2024)
di: Gong, Ruihao, et al.
Pubblicazione: (2024)
DIP: Dynamic In-Context Planner For Diffusion Language Models
di: Li, Yang, et al.
Pubblicazione: (2026)
di: Li, Yang, et al.
Pubblicazione: (2026)
GPTQT: Quantize Large Language Models Twice to Push the Efficiency
di: Guo, Yipin, et al.
Pubblicazione: (2024)
di: Guo, Yipin, et al.
Pubblicazione: (2024)
A Comprehensive Study on Quantization Techniques for Large Language Models
di: Lang, Jiedong, et al.
Pubblicazione: (2024)
di: Lang, Jiedong, et al.
Pubblicazione: (2024)
Mitigating Hidden Confounding by Progressive Confounder Imputation via Large Language Models
di: Yang, Hao, et al.
Pubblicazione: (2025)
di: Yang, Hao, et al.
Pubblicazione: (2025)
Prompt Compression in Diffusion Large Language Models: Evaluating LLMLingua-2 on LLaDA
di: Huang, Sterling, et al.
Pubblicazione: (2026)
di: Huang, Sterling, et al.
Pubblicazione: (2026)
Knowledge Tagging with Large Language Model based Multi-Agent System
di: Li, Hang, et al.
Pubblicazione: (2024)
di: Li, Hang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models
di: Hu, Xing, et al.
Pubblicazione: (2024) -
Evaluating Quantized Large Language Models
di: Li, Shiyao, et al.
Pubblicazione: (2024) -
Quantized Embedding Vectors for Controllable Diffusion Language Models
di: Kang, Cheng, et al.
Pubblicazione: (2024) -
Beyond the Speculative Game: A Survey of Speculative Execution in Large Language Models
di: Zhang, Chen, et al.
Pubblicazione: (2024) -
Channel-Wise Mixed-Precision Quantization for Large Language Models
di: Chen, Zihan, et al.
Pubblicazione: (2024)