RUQuant: Towards Refining Uniform Quantization for Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Han, Gao, Haotian, Li, Changya, Zhang, Feng, Zhang, Xiaotong, Wang, Wei, Yu, Hong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SEPTQ: A Simple and Effective Post-Training Quantization Paradigm for Large Language Models
par: Liu, Han, et autres
Publié: (2026)
par: Liu, Han, et autres
Publié: (2026)
Unifying Uniform and Binary-coding Quantization for Accurate Compression of Large Language Models
par: Park, Seungcheol, et autres
Publié: (2025)
par: Park, Seungcheol, et autres
Publié: (2025)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
par: Peters, Sydney, et autres
Publié: (2025)
par: Peters, Sydney, et autres
Publié: (2025)
LoRS: Efficient Low-Rank Adaptation for Sparse Large Language Model
par: Hu, Yuxuan, et autres
Publié: (2025)
par: Hu, Yuxuan, et autres
Publié: (2025)
LinkNER: Linking Local Named Entity Recognition Models to Large Language Models using Uncertainty
par: Zhang, Zhen, et autres
Publié: (2024)
par: Zhang, Zhen, et autres
Publié: (2024)
Learning From Failure: Integrating Negative Examples when Fine-tuning Large Language Models as Agents
par: Wang, Renxi, et autres
Publié: (2024)
par: Wang, Renxi, et autres
Publié: (2024)
Towards Greater Leverage: Scaling Laws for Efficient Mixture-of-Experts Language Models
par: Tian, Changxin, et autres
Publié: (2025)
par: Tian, Changxin, et autres
Publié: (2025)
Towards Fundamental Language Models: Does Linguistic Competence Scale with Model Size?
par: Collado-Montañez, Jaime, et autres
Publié: (2025)
par: Collado-Montañez, Jaime, et autres
Publié: (2025)
Towards Alignment-Centric Paradigm: A Survey of Instruction Tuning in Large Language Models
par: Han, Xudong, et autres
Publié: (2025)
par: Han, Xudong, et autres
Publié: (2025)
Towards Human Understanding of Paraphrase Types in Large Language Models
par: Meier, Dominik, et autres
Publié: (2024)
par: Meier, Dominik, et autres
Publié: (2024)
OPOR-Bench: Evaluating Large Language Models on Online Public Opinion Report Generation
par: Yu, Jinzheng, et autres
Publié: (2025)
par: Yu, Jinzheng, et autres
Publié: (2025)
ConPET: Continual Parameter-Efficient Tuning for Large Language Models
par: Song, Chenyang, et autres
Publié: (2023)
par: Song, Chenyang, et autres
Publié: (2023)
Refining Packing and Shuffling Strategies for Enhanced Performance in Generative Language Models
par: Chen, Yanbing, et autres
Publié: (2024)
par: Chen, Yanbing, et autres
Publié: (2024)
Effective and Efficient Schema-aware Information Extraction Using On-Device Large Language Models
par: Wen, Zhihao, et autres
Publié: (2025)
par: Wen, Zhihao, et autres
Publié: (2025)
Sparsing Law: Towards Large Language Models with Greater Activation Sparsity
par: Luo, Yuqi, et autres
Publié: (2024)
par: Luo, Yuqi, et autres
Publié: (2024)
Multi-Hierarchical Feature Detection for Large Language Model Generated Text
par: Zhang, Luyan, et autres
Publié: (2025)
par: Zhang, Luyan, et autres
Publié: (2025)
MCP: A Control-Theoretic Orchestration Framework for Synergistic Efficiency and Interpretability in Multimodal Large Language Models
par: Zhang, Luyan
Publié: (2025)
par: Zhang, Luyan
Publié: (2025)
Streamlining Redundant Layers to Compress Large Language Models
par: Chen, Xiaodong, et autres
Publié: (2024)
par: Chen, Xiaodong, et autres
Publié: (2024)
Credit C-GPT: A Domain-Specialized Large Language Model for Conversational Understanding in Vietnamese Debt Collection
par: Hong, Nhung Nguyen Thi, et autres
Publié: (2026)
par: Hong, Nhung Nguyen Thi, et autres
Publié: (2026)
Compensate Quantization Errors+: Quantized Models Are Inquisitive Learners
par: Gao, Yifei, et autres
Publié: (2024)
par: Gao, Yifei, et autres
Publié: (2024)
SciEx: Benchmarking Large Language Models on Scientific Exams with Human Expert Grading and Automatic Grading
par: Dinh, Tu Anh, et autres
Publié: (2024)
par: Dinh, Tu Anh, et autres
Publié: (2024)
Precise Length Control in Large Language Models
par: Butcher, Bradley, et autres
Publié: (2024)
par: Butcher, Bradley, et autres
Publié: (2024)
Large Language Models for Biomedical Article Classification
par: Proboszcz, Jakub, et autres
Publié: (2026)
par: Proboszcz, Jakub, et autres
Publié: (2026)
QUAD: Quantization and Parameter-Efficient Tuning of LLM with Activation Decomposition
par: Hu, Yuxuan, et autres
Publié: (2025)
par: Hu, Yuxuan, et autres
Publié: (2025)
Demystifying Instruction Mixing for Fine-tuning Large Language Models
par: Wang, Renxi, et autres
Publié: (2023)
par: Wang, Renxi, et autres
Publié: (2023)
Strategy Adaptation in Large Language Model Werewolf Agents
par: Nakamori, Fuya, et autres
Publié: (2025)
par: Nakamori, Fuya, et autres
Publié: (2025)
Socially Responsible Data for Large Multilingual Language Models
par: Smart, Andrew, et autres
Publié: (2024)
par: Smart, Andrew, et autres
Publié: (2024)
CRISP: Persistent Concept Unlearning via Sparse Autoencoders
par: Ashuach, Tomer, et autres
Publié: (2025)
par: Ashuach, Tomer, et autres
Publié: (2025)
Towards Explainable Fake Image Detection with Multi-Modal Large Language Models
par: Ji, Yikun, et autres
Publié: (2025)
par: Ji, Yikun, et autres
Publié: (2025)
Large Language Models for Persian $ \leftrightarrow $ English Idiom Translation
par: Rezaeimanesh, Sara, et autres
Publié: (2024)
par: Rezaeimanesh, Sara, et autres
Publié: (2024)
Qomhra: A Bilingual Irish and English Large Language Model
par: McInerney, Joseph, et autres
Publié: (2025)
par: McInerney, Joseph, et autres
Publié: (2025)
Dialect Normalization using Large Language Models and Morphological Rules
par: Dimakis, Antonios, et autres
Publié: (2025)
par: Dimakis, Antonios, et autres
Publié: (2025)
A Survey of Text Watermarking in the Era of Large Language Models
par: Liu, Aiwei, et autres
Publié: (2023)
par: Liu, Aiwei, et autres
Publié: (2023)
A RoBERTa-Based Functional Syntax Annotation Model for Chinese Texts
par: Xiaohui, Han, et autres
Publié: (2025)
par: Xiaohui, Han, et autres
Publié: (2025)
After Retrieval, Before Generation: Enhancing the Trustworthiness of Large Language Models in Retrieval-Augmented Generation
par: Dai, Xinbang, et autres
Publié: (2025)
par: Dai, Xinbang, et autres
Publié: (2025)
A Domain-Based Taxonomy of Jailbreak Vulnerabilities in Large Language Models
par: Peláez-González, Carlos, et autres
Publié: (2025)
par: Peláez-González, Carlos, et autres
Publié: (2025)
Personality, Role, and Expressive Style in Large Language Models: An Interactionist Analysis
par: Nagao, Moe, et autres
Publié: (2026)
par: Nagao, Moe, et autres
Publié: (2026)
Aligning Large Language Models for Faithful Integrity Against Opposing Argument
par: Zhao, Yong, et autres
Publié: (2025)
par: Zhao, Yong, et autres
Publié: (2025)
Robustness of Large Language Models to Perturbations in Text
par: Singh, Ayush, et autres
Publié: (2024)
par: Singh, Ayush, et autres
Publié: (2024)
Unveiling Attractor Cycles in Large Language Models: A Dynamical Systems View of Successive Paraphrasing
par: Wang, Zhilin, et autres
Publié: (2025)
par: Wang, Zhilin, et autres
Publié: (2025)
Documents similaires
-
SEPTQ: A Simple and Effective Post-Training Quantization Paradigm for Large Language Models
par: Liu, Han, et autres
Publié: (2026) -
Unifying Uniform and Binary-coding Quantization for Accurate Compression of Large Language Models
par: Park, Seungcheol, et autres
Publié: (2025) -
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
par: Peters, Sydney, et autres
Publié: (2025) -
LoRS: Efficient Low-Rank Adaptation for Sparse Large Language Model
par: Hu, Yuxuan, et autres
Publié: (2025) -
LinkNER: Linking Local Named Entity Recognition Models to Large Language Models using Uncertainty
par: Zhang, Zhen, et autres
Publié: (2024)