Retraining-free Model Quantization via One-Shot Weight-Coupling Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Tang, Chen, Meng, Yuan, Jiang, Jiacheng, Xie, Shuzhao, Lu, Rongwei, Ma, Xinzhu, Wang, Zhi, Zhu, Wenwu |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
RTF-Q: Efficient Unsupervised Domain Adaptation with Retraining-free Quantization
by: Du, Nanyang, et al.
Published: (2024)
by: Du, Nanyang, et al.
Published: (2024)
Q-DiT: Accurate Post-Training Quantization for Diffusion Transformers
by: Chen, Lei, et al.
Published: (2024)
by: Chen, Lei, et al.
Published: (2024)
TMPQ-DM: Joint Timestep Reduction and Quantization Precision Selection for Efficient Diffusion Models
by: Sun, Haojun, et al.
Published: (2024)
by: Sun, Haojun, et al.
Published: (2024)
Quantization Meets OOD: Generalizable Quantization-aware Training from a Flatness Perspective
by: Jiang, Jiacheng, et al.
Published: (2025)
by: Jiang, Jiacheng, et al.
Published: (2025)
MesonGS: Post-training Compression of 3D Gaussians via Efficient Attribute Transformation
by: Xie, Shuzhao, et al.
Published: (2024)
by: Xie, Shuzhao, et al.
Published: (2024)
PRANCE: Joint Token-Optimization and Structural Channel-Pruning for Adaptive ViT Inference
by: Li, Ye, et al.
Published: (2024)
by: Li, Ye, et al.
Published: (2024)
GAQAT: gradient-adaptive quantization-aware training for domain generalization
by: Jiang, Jiacheng, et al.
Published: (2024)
by: Jiang, Jiacheng, et al.
Published: (2024)
QArtSR: Quantization via Reverse-Module and Timestep-Retraining in One-Step Diffusion based Image Super-Resolution
by: Zhu, Libo, et al.
Published: (2025)
by: Zhu, Libo, et al.
Published: (2025)
SP-VLA: A Joint Model Scheduling and Token Pruning Approach for VLA Model Acceleration
by: Li, Ye, et al.
Published: (2025)
by: Li, Ye, et al.
Published: (2025)
Tail-Aware Post-Training Quantization for 3D Geometry Models
by: Pan, Sicheng, et al.
Published: (2026)
by: Pan, Sicheng, et al.
Published: (2026)
Expansive Supervision for Neural Radiance Field
by: Zhang, Weixiang, et al.
Published: (2024)
by: Zhang, Weixiang, et al.
Published: (2024)
Enhancing Implicit Neural Representations via Symmetric Power Transformation
by: Zhang, Weixiang, et al.
Published: (2024)
by: Zhang, Weixiang, et al.
Published: (2024)
Tuning-Free Visual Customization via View Iterative Self-Attention Control
by: Li, Xiaojie, et al.
Published: (2024)
by: Li, Xiaojie, et al.
Published: (2024)
Zero-Shot Quantization via Weight-Space Arithmetic
by: Solombrino, Daniele, et al.
Published: (2026)
by: Solombrino, Daniele, et al.
Published: (2026)
JAQ: Joint Efficient Architecture Design and Low-Bit Quantization with Hardware-Software Co-Exploration
by: Wang, Mingzi, et al.
Published: (2025)
by: Wang, Mingzi, et al.
Published: (2025)
Towards Unbiased Source-Free Object Detection via Vision Foundation Models
by: Cai, Zhi, et al.
Published: (2026)
by: Cai, Zhi, et al.
Published: (2026)
EVOS: Efficient Implicit Neural Training via EVOlutionary Selector
by: Zhang, Weixiang, et al.
Published: (2024)
by: Zhang, Weixiang, et al.
Published: (2024)
VVS: Accelerating Speculative Decoding for Visual Autoregressive Generation via Partial Verification Skipping
by: Dong, Haotian, et al.
Published: (2025)
by: Dong, Haotian, et al.
Published: (2025)
Few-Shot Learning with Adaptive Weight Masking in Conditional GANs
by: Hu, Jiacheng, et al.
Published: (2024)
by: Hu, Jiacheng, et al.
Published: (2024)
Point2Primitive: CAD Reconstruction from Point Cloud by Direct Primitive Prediction
by: Ma, Xinzhu, et al.
Published: (2025)
by: Ma, Xinzhu, et al.
Published: (2025)
DragScene: Interactive 3D Scene Editing with Single-view Drag Instructions
by: Gu, Chenghao, et al.
Published: (2024)
by: Gu, Chenghao, et al.
Published: (2024)
Accelerating Parallel Diffusion Model Serving with Residual Compression
by: Luo, Jiajun, et al.
Published: (2025)
by: Luo, Jiajun, et al.
Published: (2025)
Adapting In-Domain Few-Shot Segmentation to New Domains without Source Domain Retraining
by: Fan, Qi, et al.
Published: (2025)
by: Fan, Qi, et al.
Published: (2025)
One-Shot Learning for Pose-Guided Person Image Synthesis in the Wild
by: Fan, Dongqi, et al.
Published: (2024)
by: Fan, Dongqi, et al.
Published: (2024)
Post-training Quantization for Text-to-Image Diffusion Models with Progressive Calibration and Activation Relaxing
by: Tang, Siao, et al.
Published: (2023)
by: Tang, Siao, et al.
Published: (2023)
Object-Driven One-Shot Fine-tuning of Text-to-Image Diffusion with Prototypical Embedding
by: Lu, Jianxiang, et al.
Published: (2024)
by: Lu, Jianxiang, et al.
Published: (2024)
SizeGS: Size-aware Compression of 3D Gaussian Splatting via Mixed Integer Programming
by: Xie, Shuzhao, et al.
Published: (2024)
by: Xie, Shuzhao, et al.
Published: (2024)
One Polyp Identifies All: One-Shot Polyp Segmentation with SAM via Cascaded Priors and Iterative Prompt Evolution
by: Mao, Xinyu, et al.
Published: (2025)
by: Mao, Xinyu, et al.
Published: (2025)
CTCal: Rethinking Text-to-Image Diffusion Models via Cross-Timestep Self-Calibration
by: Guo, Xiefan, et al.
Published: (2026)
by: Guo, Xiefan, et al.
Published: (2026)
Global Prompt Refinement with Non-Interfering Attention Masking for One-Shot Federated Learning
by: Qi, Zhuang, et al.
Published: (2025)
by: Qi, Zhuang, et al.
Published: (2025)
One-Shot Action Recognition via Multi-Scale Spatial-Temporal Skeleton Matching
by: Yang, Siyuan, et al.
Published: (2023)
by: Yang, Siyuan, et al.
Published: (2023)
Learning from Loss Landscape: Generalizable Mixed-Precision Quantization via Adaptive Sharpness-Aware Gradient Aligning
by: Ma, Lianbo, et al.
Published: (2025)
by: Ma, Lianbo, et al.
Published: (2025)
Spatial Policy: Guiding Visuomotor Robotic Manipulation with Spatial-Aware Modeling and Reasoning
by: Liu, Yijun, et al.
Published: (2025)
by: Liu, Yijun, et al.
Published: (2025)
MotionCrafter: One-Shot Motion Customization of Diffusion Models
by: Zhang, Yuxin, et al.
Published: (2023)
by: Zhang, Yuxin, et al.
Published: (2023)
GraspLDP: Towards Generalizable Grasping Policy via Latent Diffusion
by: Xiang, Enda, et al.
Published: (2026)
by: Xiang, Enda, et al.
Published: (2026)
FLIQS: One-Shot Mixed-Precision Floating-Point and Integer Quantization Search
by: Dotzel, Jordan, et al.
Published: (2023)
by: Dotzel, Jordan, et al.
Published: (2023)
MindShot: A Few-Shot Brain Decoding Framework via Transferring Cross-Subject Prior and Distilling Frequency Domain Knowledge
by: Jiang, Shuai, et al.
Published: (2024)
by: Jiang, Shuai, et al.
Published: (2024)
DilateQuant: Accurate and Efficient Diffusion Quantization via Weight Dilation
by: Liu, Xuewen, et al.
Published: (2024)
by: Liu, Xuewen, et al.
Published: (2024)
Correlation Weighted Prototype-based Self-Supervised One-Shot Segmentation of Medical Images
by: Manna, Siladittya, et al.
Published: (2024)
by: Manna, Siladittya, et al.
Published: (2024)
Temporal-adaptive Weight Quantization for Spiking Neural Networks
by: Zhang, Han, et al.
Published: (2025)
by: Zhang, Han, et al.
Published: (2025)
Similar Items
-
RTF-Q: Efficient Unsupervised Domain Adaptation with Retraining-free Quantization
by: Du, Nanyang, et al.
Published: (2024) -
Q-DiT: Accurate Post-Training Quantization for Diffusion Transformers
by: Chen, Lei, et al.
Published: (2024) -
TMPQ-DM: Joint Timestep Reduction and Quantization Precision Selection for Efficient Diffusion Models
by: Sun, Haojun, et al.
Published: (2024) -
Quantization Meets OOD: Generalizable Quantization-aware Training from a Flatness Perspective
by: Jiang, Jiacheng, et al.
Published: (2025) -
MesonGS: Post-training Compression of 3D Gaussians via Efficient Attribute Transformation
by: Xie, Shuzhao, et al.
Published: (2024)