BinaryDM: Accurate Weight Binarization for Efficient Diffusion Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zheng, Xingyu, Liu, Xianglong, Qin, Haotong, Ma, Xudong, Zhang, Mingyuan, Hao, Haojie, Wang, Jiakai, Zhao, Zixiang, Guo, Jinyang, Magno, Michele |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
BiDM: Pushing the Limit of Quantization for Diffusion Models
von: Zheng, Xingyu, et al.
Veröffentlicht: (2024)
von: Zheng, Xingyu, et al.
Veröffentlicht: (2024)
BiVM: Accurate Binarized Neural Network for Efficient Video Matting
von: Qin, Haotong, et al.
Veröffentlicht: (2025)
von: Qin, Haotong, et al.
Veröffentlicht: (2025)
First-Order Error Matters: Accurate Compensation for Quantized Large Language Models
von: Zheng, Xingyu, et al.
Veröffentlicht: (2025)
von: Zheng, Xingyu, et al.
Veröffentlicht: (2025)
DB-LLM: Accurate Dual-Binarization for Efficient LLMs
von: Chen, Hong, et al.
Veröffentlicht: (2024)
von: Chen, Hong, et al.
Veröffentlicht: (2024)
QuantSR+: Pushing the Limit of Quantized Image Super-Resolution Networks
von: Qin, Haotong, et al.
Veröffentlicht: (2026)
von: Qin, Haotong, et al.
Veröffentlicht: (2026)
Accurate LoRA-Finetuning Quantization of LLMs via Information Retention
von: Qin, Haotong, et al.
Veröffentlicht: (2024)
von: Qin, Haotong, et al.
Veröffentlicht: (2024)
BWTA: Accurate and Efficient Binarized Transformer by Algorithm-Hardware Co-design
von: Ding, Yifu, et al.
Veröffentlicht: (2026)
von: Ding, Yifu, et al.
Veröffentlicht: (2026)
An Empirical Study of Qwen3 Quantization
von: Zheng, Xingyu, et al.
Veröffentlicht: (2025)
von: Zheng, Xingyu, et al.
Veröffentlicht: (2025)
A Survey of Low-bit Large Language Models: Basics, Systems, and Algorithms
von: Gong, Ruihao, et al.
Veröffentlicht: (2024)
von: Gong, Ruihao, et al.
Veröffentlicht: (2024)
Progressive Binarization with Semi-Structured Pruning for LLMs
von: Yan, Xianglong, et al.
Veröffentlicht: (2025)
von: Yan, Xianglong, et al.
Veröffentlicht: (2025)
Binarized Diffusion Model for Image Super-Resolution
von: Chen, Zheng, et al.
Veröffentlicht: (2024)
von: Chen, Zheng, et al.
Veröffentlicht: (2024)
Event-Priori-Based Vision-Language Model for Efficient Visual Understanding
von: Qin, Haotong, et al.
Veröffentlicht: (2025)
von: Qin, Haotong, et al.
Veröffentlicht: (2025)
An empirical study of LLaMA3 quantization: from LLMs to MLLMs
von: Huang, Wei, et al.
Veröffentlicht: (2024)
von: Huang, Wei, et al.
Veröffentlicht: (2024)
Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers
von: Feng, Weilun, et al.
Veröffentlicht: (2025)
von: Feng, Weilun, et al.
Veröffentlicht: (2025)
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
von: Feng, Weilun, et al.
Veröffentlicht: (2024)
von: Feng, Weilun, et al.
Veröffentlicht: (2024)
Q-SAM2: Accurate Quantization for Segment Anything Model 2
von: Farronato, Nicola, et al.
Veröffentlicht: (2025)
von: Farronato, Nicola, et al.
Veröffentlicht: (2025)
BinaryHPE: 3D Human Pose and Shape Estimation via Binarization
von: Li, Zhiteng, et al.
Veröffentlicht: (2023)
von: Li, Zhiteng, et al.
Veröffentlicht: (2023)
Q-MambaIR: Accurate Quantized Mamba for Efficient Image Restoration
von: Chen, Yujie, et al.
Veröffentlicht: (2025)
von: Chen, Yujie, et al.
Veröffentlicht: (2025)
ARB-LLM: Alternating Refined Binarizations for Large Language Models
von: Li, Zhiteng, et al.
Veröffentlicht: (2024)
von: Li, Zhiteng, et al.
Veröffentlicht: (2024)
BiDense: Binarization for Dense Prediction
von: Yin, Rui, et al.
Veröffentlicht: (2024)
von: Yin, Rui, et al.
Veröffentlicht: (2024)
LLMCBench: Benchmarking Large Language Model Compression for Efficient Deployment
von: Yang, Ge, et al.
Veröffentlicht: (2024)
von: Yang, Ge, et al.
Veröffentlicht: (2024)
S$^2$Q-VDiT: Accurate Quantized Video Diffusion Transformer with Salient Data and Sparse Token Distillation
von: Feng, Weilun, et al.
Veröffentlicht: (2025)
von: Feng, Weilun, et al.
Veröffentlicht: (2025)
DynamicPAE: Generating Scene-Aware Physical Adversarial Examples in Real-Time
von: Hu, Jin, et al.
Veröffentlicht: (2024)
von: Hu, Jin, et al.
Veröffentlicht: (2024)
BiLLM: Pushing the Limit of Post-Training Quantization for LLMs
von: Huang, Wei, et al.
Veröffentlicht: (2024)
von: Huang, Wei, et al.
Veröffentlicht: (2024)
Quant-dLLM: Post-Training Extreme Low-Bit Quantization for Diffusion Large Language Models
von: Zhang, Tianao, et al.
Veröffentlicht: (2025)
von: Zhang, Tianao, et al.
Veröffentlicht: (2025)
PicoSAM2: Low-Latency Segmentation In-Sensor for Edge Vision Applications
von: Bonazzi, Pietro, et al.
Veröffentlicht: (2025)
von: Bonazzi, Pietro, et al.
Veröffentlicht: (2025)
PicoSAM3: Real-Time In-Sensor Region-of-Interest Segmentation
von: Bonazzi, Pietro, et al.
Veröffentlicht: (2026)
von: Bonazzi, Pietro, et al.
Veröffentlicht: (2026)
Efficient and Accurate Downfacing Visual Inertial Odometry
von: Kühne, Jonas, et al.
Veröffentlicht: (2025)
von: Kühne, Jonas, et al.
Veröffentlicht: (2025)
TCAQ-DM: Timestep-Channel Adaptive Quantization for Diffusion Models
von: Huang, Haocheng, et al.
Veröffentlicht: (2024)
von: Huang, Haocheng, et al.
Veröffentlicht: (2024)
RaBiT: Residual-Aware Binarization Training for Accurate and Efficient LLMs
von: You, Youngcheon, et al.
Veröffentlicht: (2026)
von: You, Youngcheon, et al.
Veröffentlicht: (2026)
BinaryDemoire: Moiré-Aware Binarization for Image Demoiréing
von: Chen, Zheng, et al.
Veröffentlicht: (2026)
von: Chen, Zheng, et al.
Veröffentlicht: (2026)
MambaVF: State Space Model for Efficient Video Fusion
von: Zhao, Zixiang, et al.
Veröffentlicht: (2026)
von: Zhao, Zixiang, et al.
Veröffentlicht: (2026)
Exploring Semantic-constrained Adversarial Example with Instruction Uncertainty Reduction
von: Hu, Jin, et al.
Veröffentlicht: (2025)
von: Hu, Jin, et al.
Veröffentlicht: (2025)
Post-Training Quantization for Video Matting
von: Zhu, Tianrui, et al.
Veröffentlicht: (2025)
von: Zhu, Tianrui, et al.
Veröffentlicht: (2025)
SliM-LLM: Salience-Driven Mixed-Precision Quantization for Large Language Models
von: Huang, Wei, et al.
Veröffentlicht: (2024)
von: Huang, Wei, et al.
Veröffentlicht: (2024)
Vision-fused Attack: Advancing Aggressive and Stealthy Adversarial Text against Neural Machine Translation
von: Xue, Yanni, et al.
Veröffentlicht: (2024)
von: Xue, Yanni, et al.
Veröffentlicht: (2024)
TFMQ-DM: Temporal Feature Maintenance Quantization for Diffusion Models
von: Huang, Yushi, et al.
Veröffentlicht: (2023)
von: Huang, Yushi, et al.
Veröffentlicht: (2023)
CipherDM: Secure Three-Party Inference for Diffusion Model Sampling
von: Zhao, Xin, et al.
Veröffentlicht: (2024)
von: Zhao, Xin, et al.
Veröffentlicht: (2024)
AGENTSAFE: Benchmarking the Safety of Embodied Agents on Hazardous Instructions
von: Ying, Zonghao, et al.
Veröffentlicht: (2025)
von: Ying, Zonghao, et al.
Veröffentlicht: (2025)
Collaborative Few-Step Distillation and Low-Bit Quantization for Wan2.2 Dual-Expert Video Diffusion Models
von: Du, Jinyang, et al.
Veröffentlicht: (2026)
von: Du, Jinyang, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
BiDM: Pushing the Limit of Quantization for Diffusion Models
von: Zheng, Xingyu, et al.
Veröffentlicht: (2024) -
BiVM: Accurate Binarized Neural Network for Efficient Video Matting
von: Qin, Haotong, et al.
Veröffentlicht: (2025) -
First-Order Error Matters: Accurate Compensation for Quantized Large Language Models
von: Zheng, Xingyu, et al.
Veröffentlicht: (2025) -
DB-LLM: Accurate Dual-Binarization for Efficient LLMs
von: Chen, Hong, et al.
Veröffentlicht: (2024) -
QuantSR+: Pushing the Limit of Quantized Image Super-Resolution Networks
von: Qin, Haotong, et al.
Veröffentlicht: (2026)