An Empirical Study of World Model Quantization
Fuente:
arXiv
Salvato in:
| Autori principali: | Fu, Zhongqian, Zhao, Tianyi, Han, Kai, Zhou, Hang, Chen, Xinghao, Wang, Yunhe |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GPT4Image: Large Pre-trained Models Help Vision Models Learn Better on Perception Task
di: Ding, Ning, et al.
Pubblicazione: (2023)
di: Ding, Ning, et al.
Pubblicazione: (2023)
Enhancing Vector Quantization with Distributional Matching: A Theoretical and Empirical Study
di: Fang, Xianghong, et al.
Pubblicazione: (2025)
di: Fang, Xianghong, et al.
Pubblicazione: (2025)
Balance of Number of Embedding and their Dimensions in Vector Quantization
di: Chen, Hang, et al.
Pubblicazione: (2024)
di: Chen, Hang, et al.
Pubblicazione: (2024)
Revealing the Power of Post-Training for Small Language Models via Knowledge Distillation
di: Rang, Miao, et al.
Pubblicazione: (2025)
di: Rang, Miao, et al.
Pubblicazione: (2025)
An Empirical Study of Scaling Law for OCR
di: Rang, Miao, et al.
Pubblicazione: (2023)
di: Rang, Miao, et al.
Pubblicazione: (2023)
Memorization in 3D Shape Generation: An Empirical Study
di: Pu, Shu, et al.
Pubblicazione: (2025)
di: Pu, Shu, et al.
Pubblicazione: (2025)
Does Vector Quantization Fail in Spatio-Temporal Forecasting? Exploring a Differentiable Sparse Soft-Vector Quantization Approach
di: Chen, Chao, et al.
Pubblicazione: (2023)
di: Chen, Chao, et al.
Pubblicazione: (2023)
Memory-Space Visual Prompting for Efficient Vision-Language Fine-Tuning
di: Jie, Shibo, et al.
Pubblicazione: (2024)
di: Jie, Shibo, et al.
Pubblicazione: (2024)
Aligning Human Knowledge with Visual Concepts Towards Explainable Medical Image Classification
di: Gao, Yunhe, et al.
Pubblicazione: (2024)
di: Gao, Yunhe, et al.
Pubblicazione: (2024)
Beyond Simple Fusion: Adaptive Gated Fusion for Robust Multimodal Sentiment Analysis
di: Wu, Han, et al.
Pubblicazione: (2025)
di: Wu, Han, et al.
Pubblicazione: (2025)
WorldVQA: Measuring Atomic World Knowledge in Multimodal Large Language Models
di: Zhou, Runjie, et al.
Pubblicazione: (2026)
di: Zhou, Runjie, et al.
Pubblicazione: (2026)
A Survey on Transformer Compression
di: Tang, Yehui, et al.
Pubblicazione: (2024)
di: Tang, Yehui, et al.
Pubblicazione: (2024)
Visual Knowledge in the Big Model Era: Retrospect and Prospect
di: Wang, Wenguan, et al.
Pubblicazione: (2024)
di: Wang, Wenguan, et al.
Pubblicazione: (2024)
An Empirical Study Into What Matters for Calibrating Vision-Language Models
di: Tu, Weijie, et al.
Pubblicazione: (2024)
di: Tu, Weijie, et al.
Pubblicazione: (2024)
D$^2$-DPM: Dual Denoising for Quantized Diffusion Probabilistic Models
di: Zeng, Qian, et al.
Pubblicazione: (2025)
di: Zeng, Qian, et al.
Pubblicazione: (2025)
1-Bit FQT: Pushing the Limit of Fully Quantized Training to 1-bit
di: Gao, Chang, et al.
Pubblicazione: (2024)
di: Gao, Chang, et al.
Pubblicazione: (2024)
MPQ-Diff: Mixed Precision Quantization for Diffusion Models
di: Maruzzelli, Rocco Manz, et al.
Pubblicazione: (2024)
di: Maruzzelli, Rocco Manz, et al.
Pubblicazione: (2024)
VLM-Pruner: Buffering for Spatial Sparsity in an Efficient VLM Centrifugal Token Pruning Paradigm
di: Wu, Zhenkai, et al.
Pubblicazione: (2025)
di: Wu, Zhenkai, et al.
Pubblicazione: (2025)
PQD: Post-training Quantization for Efficient Diffusion Models
di: Ye, Jiaojiao, et al.
Pubblicazione: (2024)
di: Ye, Jiaojiao, et al.
Pubblicazione: (2024)
Anatomy-VLM: A Fine-grained Vision-Language Model for Medical Interpretation
di: Gu, Difei, et al.
Pubblicazione: (2025)
di: Gu, Difei, et al.
Pubblicazione: (2025)
LLaVA-Critic-R1: Your Critic Model is Secretly a Strong Policy Model
di: Wang, Xiyao, et al.
Pubblicazione: (2025)
di: Wang, Xiyao, et al.
Pubblicazione: (2025)
EaqVLA: Encoding-aligned Quantization for Vision-Language-Action Models
di: Jiang, Feng, et al.
Pubblicazione: (2025)
di: Jiang, Feng, et al.
Pubblicazione: (2025)
Data-Augmented Quantization-Aware Knowledge Distillation
di: Kur, Justin, et al.
Pubblicazione: (2025)
di: Kur, Justin, et al.
Pubblicazione: (2025)
Vid2World: Crafting Video Diffusion Models to Interactive World Models
di: Huang, Siqiao, et al.
Pubblicazione: (2025)
di: Huang, Siqiao, et al.
Pubblicazione: (2025)
Modulated Diffusion: Accelerating Generative Modeling with Modulated Quantization
di: Gao, Weizhi, et al.
Pubblicazione: (2025)
di: Gao, Weizhi, et al.
Pubblicazione: (2025)
Progressive Element-wise Gradient Estimation for Neural Network Quantization
di: Zhao, Kaiqi
Pubblicazione: (2025)
di: Zhao, Kaiqi
Pubblicazione: (2025)
Data-independent Module-aware Pruning for Hierarchical Vision Transformers
di: He, Yang, et al.
Pubblicazione: (2024)
di: He, Yang, et al.
Pubblicazione: (2024)
Post-training Quantization for Text-to-Image Diffusion Models with Progressive Calibration and Activation Relaxing
di: Tang, Siao, et al.
Pubblicazione: (2023)
di: Tang, Siao, et al.
Pubblicazione: (2023)
TMPQ-DM: Joint Timestep Reduction and Quantization Precision Selection for Efficient Diffusion Models
di: Sun, Haojun, et al.
Pubblicazione: (2024)
di: Sun, Haojun, et al.
Pubblicazione: (2024)
Value-Driven Mixed-Precision Quantization for Patch-Based Inference on Microcontrollers
di: Tao, Wei, et al.
Pubblicazione: (2024)
di: Tao, Wei, et al.
Pubblicazione: (2024)
Enhancing Zero-Shot Image Recognition in Vision-Language Models through Human-like Concept Guidance
di: Liu, Hui, et al.
Pubblicazione: (2025)
di: Liu, Hui, et al.
Pubblicazione: (2025)
Task-customized Masked AutoEncoder via Mixture of Cluster-conditional Experts
di: Liu, Zhili, et al.
Pubblicazione: (2024)
di: Liu, Zhili, et al.
Pubblicazione: (2024)
Motus: A Unified Latent Action World Model
di: Bi, Hongzhe, et al.
Pubblicazione: (2025)
di: Bi, Hongzhe, et al.
Pubblicazione: (2025)
Progressive Compression with Universally Quantized Diffusion Models
di: Yang, Yibo, et al.
Pubblicazione: (2024)
di: Yang, Yibo, et al.
Pubblicazione: (2024)
Quantize-then-Rectify: Efficient VQ-VAE Training
di: Zhang, Borui, et al.
Pubblicazione: (2025)
di: Zhang, Borui, et al.
Pubblicazione: (2025)
Classes Are Not Equal: An Empirical Study on Image Recognition Fairness
di: Cui, Jiequan, et al.
Pubblicazione: (2024)
di: Cui, Jiequan, et al.
Pubblicazione: (2024)
Semantic-Guided Generative Image Augmentation Method with Diffusion Models for Image Classification
di: Li, Bohan, et al.
Pubblicazione: (2023)
di: Li, Bohan, et al.
Pubblicazione: (2023)
EDA-DM: Enhanced Distribution Alignment for Post-Training Quantization of Diffusion Models
di: Liu, Xuewen, et al.
Pubblicazione: (2024)
di: Liu, Xuewen, et al.
Pubblicazione: (2024)
Planning-Guided Diffusion Policy Learning for Generalizable Contact-Rich Bimanual Manipulation
di: Li, Xuanlin, et al.
Pubblicazione: (2024)
di: Li, Xuanlin, et al.
Pubblicazione: (2024)
Qua$^2$SeDiMo: Quantifiable Quantization Sensitivity of Diffusion Models
di: Mills, Keith G., et al.
Pubblicazione: (2024)
di: Mills, Keith G., et al.
Pubblicazione: (2024)
Documenti analoghi
-
GPT4Image: Large Pre-trained Models Help Vision Models Learn Better on Perception Task
di: Ding, Ning, et al.
Pubblicazione: (2023) -
Enhancing Vector Quantization with Distributional Matching: A Theoretical and Empirical Study
di: Fang, Xianghong, et al.
Pubblicazione: (2025) -
Balance of Number of Embedding and their Dimensions in Vector Quantization
di: Chen, Hang, et al.
Pubblicazione: (2024) -
Revealing the Power of Post-Training for Small Language Models via Knowledge Distillation
di: Rang, Miao, et al.
Pubblicazione: (2025) -
An Empirical Study of Scaling Law for OCR
di: Rang, Miao, et al.
Pubblicazione: (2023)