QuantVLA: Scale-Calibrated Post-Training Quantization for Vision-Language-Action Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Jingxuan, Hsieh, Yunta, Wan, Zhongwei, Lin, Haokun, Wang, Xin, Wang, Ziqi, Lei, Yingtie, Zhang, Mi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MMSpec: Benchmarking Speculative Decoding for Vision-Language Models
por: Shen, Hui, et al.
Publicado: (2026)
por: Shen, Hui, et al.
Publicado: (2026)
EfficientVLA: Training-Free Acceleration and Compression for Vision-Language-Action Models
por: Yang, Yantai, et al.
Publicado: (2025)
por: Yang, Yantai, et al.
Publicado: (2025)
SkillEvolBench: Benchmarking the Evolution from Episodic Experience to Procedural Skills
por: Lei, Yingtie, et al.
Publicado: (2026)
por: Lei, Yingtie, et al.
Publicado: (2026)
RobustVLA: Robustness-Aware Reinforcement Post-Training for Vision-Language-Action Models
por: Zhang, Hongyin, et al.
Publicado: (2025)
por: Zhang, Hongyin, et al.
Publicado: (2025)
SliderQuant: Accurate Post-Training Quantization for LLMs
por: Wang, Shigeng, et al.
Publicado: (2026)
por: Wang, Shigeng, et al.
Publicado: (2026)
CrossQuant: A Post-Training Quantization Method with Smaller Quantization Kernel for Precise Large Language Model Compression
por: Liu, Wenyuan, et al.
Publicado: (2024)
por: Liu, Wenyuan, et al.
Publicado: (2024)
HBVLA: Pushing 1-Bit Post-Training Quantization for Vision-Language-Action Models
por: Yan, Xin, et al.
Publicado: (2026)
por: Yan, Xin, et al.
Publicado: (2026)
VQ-VLA: Improving Vision-Language-Action Models via Scaling Vector-Quantized Action Tokenizers
por: Wang, Yating, et al.
Publicado: (2025)
por: Wang, Yating, et al.
Publicado: (2025)
SmoothQuant: Accurate and Efficient Post-Training Quantization for Large Language Models
por: Xiao, Guangxuan, et al.
Publicado: (2022)
por: Xiao, Guangxuan, et al.
Publicado: (2022)
Famba-V: Fast Vision Mamba with Cross-Layer Token Fusion
por: Shen, Hui, et al.
Publicado: (2024)
por: Shen, Hui, et al.
Publicado: (2024)
Enhancing Test-Time Scaling of Large Language Models with Hierarchical Retrieval-Augmented MCTS
por: Dou, Alex ZH, et al.
Publicado: (2025)
por: Dou, Alex ZH, et al.
Publicado: (2025)
StereoVLA: Enhancing Vision-Language-Action Models with Stereo Vision
por: Deng, Shengliang, et al.
Publicado: (2025)
por: Deng, Shengliang, et al.
Publicado: (2025)
OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models
por: Shao, Wenqi, et al.
Publicado: (2023)
por: Shao, Wenqi, et al.
Publicado: (2023)
DA-PTQ: Drift-Aware Post-Training Quantization for Efficient Vision-Language-Action Models
por: Xu, Siyuan, et al.
Publicado: (2026)
por: Xu, Siyuan, et al.
Publicado: (2026)
RepQuant: Towards Accurate Post-Training Quantization of Large Transformer Models via Scale Reparameterization
por: Li, Zhikai, et al.
Publicado: (2024)
por: Li, Zhikai, et al.
Publicado: (2024)
SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression
por: Wang, Xin, et al.
Publicado: (2024)
por: Wang, Xin, et al.
Publicado: (2024)
Quant-dLLM: Post-Training Extreme Low-Bit Quantization for Diffusion Large Language Models
por: Zhang, Tianao, et al.
Publicado: (2025)
por: Zhang, Tianao, et al.
Publicado: (2025)
FocusVLA: Focused Visual Utilization for Vision-Language-Action Models
por: Zhang, Yichi, et al.
Publicado: (2026)
por: Zhang, Yichi, et al.
Publicado: (2026)
D$^2$Quant: Accurate Low-bit Post-Training Weight Quantization for LLMs
por: Yan, Xianglong, et al.
Publicado: (2026)
por: Yan, Xianglong, et al.
Publicado: (2026)
DartQuant: Efficient Rotational Distribution Calibration for LLM Quantization
por: Shao, Yuantian, et al.
Publicado: (2025)
por: Shao, Yuantian, et al.
Publicado: (2025)
CRL-VLA: Continual Vision-Language-Action Learning
por: Zeng, Qixin, et al.
Publicado: (2026)
por: Zeng, Qixin, et al.
Publicado: (2026)
ST4VLA: Spatially Guided Training for Vision-Language-Action Models
por: Ye, Jinhui, et al.
Publicado: (2026)
por: Ye, Jinhui, et al.
Publicado: (2026)
QDepth-VLA: Quantized Depth Prediction as Auxiliary Supervision for Vision-Language-Action Models
por: Li, Yixuan, et al.
Publicado: (2025)
por: Li, Yixuan, et al.
Publicado: (2025)
Scaling Laws for Post Training Quantized Large Language Models
por: Xu, Zifei, et al.
Publicado: (2024)
por: Xu, Zifei, et al.
Publicado: (2024)
4D-VLA: Spatiotemporal Vision-Language-Action Pretraining with Cross-Scene Calibration
por: Zhang, Jiahui, et al.
Publicado: (2025)
por: Zhang, Jiahui, et al.
Publicado: (2025)
VLA-Adapter: An Effective Paradigm for Tiny-Scale Vision-Language-Action Model
por: Wang, Yihao, et al.
Publicado: (2025)
por: Wang, Yihao, et al.
Publicado: (2025)
EaqVLA: Encoding-aligned Quantization for Vision-Language-Action Models
por: Jiang, Feng, et al.
Publicado: (2025)
por: Jiang, Feng, et al.
Publicado: (2025)
VLM4VLA: Revisiting Vision-Language-Models in Vision-Language-Action Models
por: Zhang, Jianke, et al.
Publicado: (2026)
por: Zhang, Jianke, et al.
Publicado: (2026)
DopQ-ViT: Towards Distribution-Friendly and Outlier-Aware Post-Training Quantization for Vision Transformers
por: Yang, Lianwei, et al.
Publicado: (2024)
por: Yang, Lianwei, et al.
Publicado: (2024)
NestQuant: Post-Training Integer-Nesting Quantization for On-Device DNN
por: Xie, Jianhang, et al.
Publicado: (2025)
por: Xie, Jianhang, et al.
Publicado: (2025)
VLA-R1: Enhancing Reasoning in Vision-Language-Action Models
por: Ye, Angen, et al.
Publicado: (2025)
por: Ye, Angen, et al.
Publicado: (2025)
CrossVLA: Cross-Paradigm Post-Training and Inference Optimization for Vision-Language-Action Models
por: Liu, Zhi
Publicado: (2026)
por: Liu, Zhi
Publicado: (2026)
UrbanVLA: A Vision-Language-Action Model for Urban Micromobility
por: Li, Anqi, et al.
Publicado: (2025)
por: Li, Anqi, et al.
Publicado: (2025)
QuantVSR: Low-Bit Post-Training Quantization for Real-World Video Super-Resolution
por: Chai, Bowen, et al.
Publicado: (2025)
por: Chai, Bowen, et al.
Publicado: (2025)
QUAR-VLA: Vision-Language-Action Model for Quadruped Robots
por: Ding, Pengxiang, et al.
Publicado: (2023)
por: Ding, Pengxiang, et al.
Publicado: (2023)
DuQuant: Distributing Outliers via Dual Transformation Makes Stronger Quantized LLMs
por: Lin, Haokun, et al.
Publicado: (2024)
por: Lin, Haokun, et al.
Publicado: (2024)
DuQuant++: Fine-grained Rotation Enhances Microscaling FP4 Quantization
por: Lin, Haokun, et al.
Publicado: (2026)
por: Lin, Haokun, et al.
Publicado: (2026)
JARVIS-VLA: Post-Training Large-Scale Vision Language Models to Play Visual Games with Keyboards and Mouse
por: Li, Muyao, et al.
Publicado: (2025)
por: Li, Muyao, et al.
Publicado: (2025)
SVD-LLM V2: Optimizing Singular Value Truncation for Large Language Model Compression
por: Wang, Xin, et al.
Publicado: (2025)
por: Wang, Xin, et al.
Publicado: (2025)
FreezeVLA: Action-Freezing Attacks against Vision-Language-Action Models
por: Wang, Xin, et al.
Publicado: (2025)
por: Wang, Xin, et al.
Publicado: (2025)
Ejemplares similares
-
MMSpec: Benchmarking Speculative Decoding for Vision-Language Models
por: Shen, Hui, et al.
Publicado: (2026) -
EfficientVLA: Training-Free Acceleration and Compression for Vision-Language-Action Models
por: Yang, Yantai, et al.
Publicado: (2025) -
SkillEvolBench: Benchmarking the Evolution from Episodic Experience to Procedural Skills
por: Lei, Yingtie, et al.
Publicado: (2026) -
RobustVLA: Robustness-Aware Reinforcement Post-Training for Vision-Language-Action Models
por: Zhang, Hongyin, et al.
Publicado: (2025) -
SliderQuant: Accurate Post-Training Quantization for LLMs
por: Wang, Shigeng, et al.
Publicado: (2026)