Guardado en:
| Autores principales: | Han, Yichen, Hao, Xiaoyang, Chen, Keming, Xiong, Weibo, He, Jun, Zhang, Ruonan, Cao, Junjie, Liu, Yue, Li, Bowen, Zhang, Dongrui, Xia, Hui, Fu, Huilei, Jia, Kai, Guo, Kaixuan, Jin, Mingli, Meng, Qingyun, Ma, Ruidong, Fang, Ruiqian, Guo, Shaotong, Li, Xuhui, Xiang, Yang, Zhang, Ying, Liu, Yulong, Li, Yunfeng, Zhang, Yuyi, Zhou, Yuze, Wang, Zhen, Chen, Zhaowen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2507.12197 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Quantization Meets dLLMs: A Systematic Study of Post-training Quantization for Diffusion LLMs
por: Lin, Haokun, et al.
Publicado: (2025)
por: Lin, Haokun, et al.
Publicado: (2025)
Aquila: A Hierarchically Aligned Visual-Language Model for Enhanced Remote Sensing Image Comprehension
por: Lu, Kaixuan, et al.
Publicado: (2024)
por: Lu, Kaixuan, et al.
Publicado: (2024)
FAQ: Mitigating Quantization Error via Regenerating Calibration Data with Family-Aware Quantization
por: Xiao, Haiyang, et al.
Publicado: (2026)
por: Xiao, Haiyang, et al.
Publicado: (2026)
Local Differential Privacy via Dynamic Quantization in Distributed Online Stochastic Optimization
por: Zhang, Zhiguo, et al.
Publicado: (2026)
por: Zhang, Zhiguo, et al.
Publicado: (2026)
Graph is a Natural Regularization: Revisiting Vector Quantization for Graph Representation Learning
por: Zhai, Zian, et al.
Publicado: (2025)
por: Zhai, Zian, et al.
Publicado: (2025)
MBCodec:Thorough disentangle for high-fidelity audio compression
por: Zhang, Ruonan, et al.
Publicado: (2025)
por: Zhang, Ruonan, et al.
Publicado: (2025)
Q-resafe: Assessing Safety Risks and Quantization-aware Safety Patching for Quantized Large Language Models
por: Chen, Kejia, et al.
Publicado: (2025)
por: Chen, Kejia, et al.
Publicado: (2025)
DynaQuant: Dynamic Mixed-Precision Quantization for Learned Image Compression
por: Bao, Youneng, et al.
Publicado: (2025)
por: Bao, Youneng, et al.
Publicado: (2025)
Enhancing Photocatalytic Hydrogen Evolution by Improving the Morphology of Organic Semiconductor Nanoparticles with TCB Additive
por: Tong Liu, et al.
Publicado: (2025)
por: Tong Liu, et al.
Publicado: (2025)
QuantDemoire: Quantization with Outlier Aware for Image Demoiréing
por: Chen, Zheng, et al.
Publicado: (2025)
por: Chen, Zheng, et al.
Publicado: (2025)
RDKV: Rate-Distortion Bit Allocation for Joint Eviction and Quantization of the KV Cache
por: Zhang, Junkai, et al.
Publicado: (2026)
por: Zhang, Junkai, et al.
Publicado: (2026)
BiDM: Pushing the Limit of Quantization for Diffusion Models
por: Zheng, Xingyu, et al.
Publicado: (2024)
por: Zheng, Xingyu, et al.
Publicado: (2024)
Quantized Spike-driven Transformer
por: Qiu, Xuerui, et al.
Publicado: (2025)
por: Qiu, Xuerui, et al.
Publicado: (2025)
decoupleQ: Towards 2-bit Post-Training Uniform Quantization via decoupling Parameters into Integer and Floating Points
por: Guo, Yi, et al.
Publicado: (2024)
por: Guo, Yi, et al.
Publicado: (2024)
Quantize What Counts: More for Keys, Less for Values
por: Hariri, Mohsen, et al.
Publicado: (2025)
por: Hariri, Mohsen, et al.
Publicado: (2025)
Quantized Topological Anderson-Thouless Pump
por: Wu, Yi-Piao, et al.
Publicado: (2022)
por: Wu, Yi-Piao, et al.
Publicado: (2022)
MGVQ: Could VQ-VAE Beat VAE? A Generalizable Tokenizer with Multi-group Quantization
por: Jia, Mingkai, et al.
Publicado: (2025)
por: Jia, Mingkai, et al.
Publicado: (2025)
Forget by Uncertainty: Orthogonal Entropy Unlearning for Quantized Neural Networks
por: Zhang, Tian, et al.
Publicado: (2026)
por: Zhang, Tian, et al.
Publicado: (2026)
ASER: Activation Smoothing and Error Reconstruction for Large Language Model Quantization
por: Zhao, Weibo, et al.
Publicado: (2024)
por: Zhao, Weibo, et al.
Publicado: (2024)
Does ESG Report Tone Influence ESG Rating Divergence? Evidence From China
por: Yanmei Luo, et al.
Publicado: (2025)
por: Yanmei Luo, et al.
Publicado: (2025)
Three‐dimensional Numerical Simulation of Local Scour of Bridge Piers under Constant Current using Asynchronous Time Marching Scheme
por: Ruiqian Zhang, et al.
Publicado: (2025)
por: Ruiqian Zhang, et al.
Publicado: (2025)
Diffusion Model Quantization: A Review
por: Zeng, Qian, et al.
Publicado: (2025)
por: Zeng, Qian, et al.
Publicado: (2025)
Adaptive Dataset Quantization
por: Li, Muquan, et al.
Publicado: (2024)
por: Li, Muquan, et al.
Publicado: (2024)
Quantized Andreev conductance in semiconductor nanowires
por: Gao, Yichun, et al.
Publicado: (2024)
por: Gao, Yichun, et al.
Publicado: (2024)
Quant-dLLM: Post-Training Extreme Low-Bit Quantization for Diffusion Large Language Models
por: Zhang, Tianao, et al.
Publicado: (2025)
por: Zhang, Tianao, et al.
Publicado: (2025)
MoQAE: Mixed-Precision Quantization for Long-Context LLM Inference via Mixture of Quantization-Aware Experts
por: Tao, Wei, et al.
Publicado: (2025)
por: Tao, Wei, et al.
Publicado: (2025)
Efficient Edge LLMs Deployment via HessianAware Quantization and CPU GPU Collaborative
por: Zhang, Tuo, et al.
Publicado: (2025)
por: Zhang, Tuo, et al.
Publicado: (2025)
Quantization Aware Attack: Enhancing Transferable Adversarial Attacks by Model Quantization
por: Yang, Yulong, et al.
Publicado: (2023)
por: Yang, Yulong, et al.
Publicado: (2023)
Memory-Free and Parallel Computation for Quantized Spiking Neural Networks
por: Zhang, Dehao, et al.
Publicado: (2025)
por: Zhang, Dehao, et al.
Publicado: (2025)
Genomic Differentiation and Adaptation of Rattus nitidus Across Spatial Scales
por: Mingyu Zhang, et al.
Publicado: (2025)
por: Mingyu Zhang, et al.
Publicado: (2025)
Generalized i-boson model and boxed BUC plane partitions
por: Zhang, Shengyu, et al.
Publicado: (2026)
por: Zhang, Shengyu, et al.
Publicado: (2026)
Soft then Hard: Rethinking the Quantization in Neural Image Compression
por: Guo, Zongyu, et al.
Publicado: (2021)
por: Guo, Zongyu, et al.
Publicado: (2021)
Sampling-Aware Quantization for Diffusion Models
por: Zeng, Qian, et al.
Publicado: (2025)
por: Zeng, Qian, et al.
Publicado: (2025)
MoQE: Improve Quantization Model performance via Mixture of Quantization Experts
por: Zhang, Jinhao, et al.
Publicado: (2025)
por: Zhang, Jinhao, et al.
Publicado: (2025)
BiSup: Bidirectional Quantization Error Suppression for Large Language Models
por: Zou, Minghui, et al.
Publicado: (2024)
por: Zou, Minghui, et al.
Publicado: (2024)
Optimal Brain Restoration for Joint Quantization and Sparsification of LLMs
por: Guo, Hang, et al.
Publicado: (2025)
por: Guo, Hang, et al.
Publicado: (2025)
Cocktail: Chunk-Adaptive Mixed-Precision Quantization for Long-Context LLM Inference
por: Tao, Wei, et al.
Publicado: (2025)
por: Tao, Wei, et al.
Publicado: (2025)
Accurate LoRA-Finetuning Quantization of LLMs via Information Retention
por: Qin, Haotong, et al.
Publicado: (2024)
por: Qin, Haotong, et al.
Publicado: (2024)
Pack-PTQ: Advancing Post-training Quantization of Neural Networks by Pack-wise Reconstruction
por: Li, Changjun, et al.
Publicado: (2025)
por: Li, Changjun, et al.
Publicado: (2025)
Explain Less, Understand More: Jargon Detection via Personalized Parameter-Efficient Fine-tuning
por: Wu, Bohao, et al.
Publicado: (2025)
por: Wu, Bohao, et al.
Publicado: (2025)
Ejemplares similares
-
Quantization Meets dLLMs: A Systematic Study of Post-training Quantization for Diffusion LLMs
por: Lin, Haokun, et al.
Publicado: (2025) -
Aquila: A Hierarchically Aligned Visual-Language Model for Enhanced Remote Sensing Image Comprehension
por: Lu, Kaixuan, et al.
Publicado: (2024) -
FAQ: Mitigating Quantization Error via Regenerating Calibration Data with Family-Aware Quantization
por: Xiao, Haiyang, et al.
Publicado: (2026) -
Local Differential Privacy via Dynamic Quantization in Distributed Online Stochastic Optimization
por: Zhang, Zhiguo, et al.
Publicado: (2026) -
Graph is a Natural Regularization: Revisiting Vector Quantization for Graph Representation Learning
por: Zhai, Zian, et al.
Publicado: (2025)