Post-Training Quantization for Vision Mamba with k-Scaled Quantization and Reparameterization
Fuente:
arXiv
Guardado en:
| Autores principales: | Shi, Bo-Yun, Lo, Yi-Cheng, An-Yeu, Wu, Tsai, Yi-Min |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CompSRT: Quantization and Pruning for Image Super Resolution Transformers
por: Zeinali, Dorsa, et al.
Publicado: (2026)
por: Zeinali, Dorsa, et al.
Publicado: (2026)
Variable Resolution Pixel Quantization for Low Power Machine Vision Application on Edge
por: Deb, Senorita, et al.
Publicado: (2024)
por: Deb, Senorita, et al.
Publicado: (2024)
TaQ-DiT: Time-aware Quantization for Diffusion Transformers
por: Liu, Xinyan, et al.
Publicado: (2024)
por: Liu, Xinyan, et al.
Publicado: (2024)
On Quantizing Neural Representation for Variable-Rate Video Coding
por: Shi, Junqi, et al.
Publicado: (2025)
por: Shi, Junqi, et al.
Publicado: (2025)
Encoder-Quantization-Motion-based Video Quality Metrics
por: Chen, Yixu, et al.
Publicado: (2024)
por: Chen, Yixu, et al.
Publicado: (2024)
HarmoQ: Harmonized Post-Training Quantization for High-Fidelity Image
por: Wang, Hongjun, et al.
Publicado: (2025)
por: Wang, Hongjun, et al.
Publicado: (2025)
Activation Map-based Vector Quantization for 360-degree Image Semantic Communication
por: Ma, Yang, et al.
Publicado: (2024)
por: Ma, Yang, et al.
Publicado: (2024)
UU-Mamba: Uncertainty-aware U-Mamba for Cardiac Image Segmentation
por: Tsai, Ting Yu, et al.
Publicado: (2024)
por: Tsai, Ting Yu, et al.
Publicado: (2024)
Invited Paper: BitMedViT: Ternary-Quantized Vision Transformer for Medical AI Assistants on the Edge
por: Walczak, Mikolaj, et al.
Publicado: (2025)
por: Walczak, Mikolaj, et al.
Publicado: (2025)
Structured Pruning and Quantization for Learned Image Compression
por: Hossain, Md Adnan Faisal, et al.
Publicado: (2025)
por: Hossain, Md Adnan Faisal, et al.
Publicado: (2025)
Soft then Hard: Rethinking the Quantization in Neural Image Compression
por: Guo, Zongyu, et al.
Publicado: (2021)
por: Guo, Zongyu, et al.
Publicado: (2021)
Quantized Decoder in Learned Image Compression for Deterministic Reconstruction
por: Koyuncu, Esin, et al.
Publicado: (2023)
por: Koyuncu, Esin, et al.
Publicado: (2023)
Approximate DCT and Quantization Techniques for Energy-Constrained Image Sensors
por: Li, Ming-Che, et al.
Publicado: (2024)
por: Li, Ming-Che, et al.
Publicado: (2024)
QuATON: Quantization Aware Training of Optical Neurons
por: Kariyawasam, Hasindu, et al.
Publicado: (2023)
por: Kariyawasam, Hasindu, et al.
Publicado: (2023)
Bridging the Gap between Gaussian Diffusion Models and Universal Quantization for Image Compression
por: Relic, Lucas, et al.
Publicado: (2025)
por: Relic, Lucas, et al.
Publicado: (2025)
Performance Analysis of Post-Training Quantization for CNN-based Conjunctival Pallor Anemia Detection
por: Romero, Sebastian A. Cruz, et al.
Publicado: (2025)
por: Romero, Sebastian A. Cruz, et al.
Publicado: (2025)
LATTE: Low-Precision Approximate Attention with Head-wise Trainable Threshold for Efficient Transformer
por: Wang, Jiing-Ping, et al.
Publicado: (2024)
por: Wang, Jiing-Ping, et al.
Publicado: (2024)
Differentiable Search for Finding Optimal Quantization Strategy
por: Li, Lianqiang, et al.
Publicado: (2024)
por: Li, Lianqiang, et al.
Publicado: (2024)
MDN: Mamba-Driven Dualstream Network For Medical Hyperspectral Image Segmentation
por: Lin, Shijie, et al.
Publicado: (2025)
por: Lin, Shijie, et al.
Publicado: (2025)
Flexible Mixed Precision Quantization for Learned Image Compression
por: Hossain, Md Adnan Faisal, et al.
Publicado: (2025)
por: Hossain, Md Adnan Faisal, et al.
Publicado: (2025)
CLAMP-ViT: Contrastive Data-Free Learning for Adaptive Post-Training Quantization of ViTs
por: Ramachandran, Akshat, et al.
Publicado: (2024)
por: Ramachandran, Akshat, et al.
Publicado: (2024)
MedMambaLite: Hardware-Aware Mamba for Medical Image Classification
por: Aalishah, Romina, et al.
Publicado: (2025)
por: Aalishah, Romina, et al.
Publicado: (2025)
Training-Free Adaptive Quantization for Variable Rate Image Coding for Machines
por: Tatsumi, Yui, et al.
Publicado: (2025)
por: Tatsumi, Yui, et al.
Publicado: (2025)
HyperVQ: MLR-based Vector Quantization in Hyperbolic Space
por: Goswami, Nabarun, et al.
Publicado: (2024)
por: Goswami, Nabarun, et al.
Publicado: (2024)
2DQuant: Low-bit Post-Training Quantization for Image Super-Resolution
por: Liu, Kai, et al.
Publicado: (2024)
por: Liu, Kai, et al.
Publicado: (2024)
When Mamba Meets xLSTM: An Efficient and Precise Method with the xLSTM-VMUNet Model for Skin lesion Segmentation
por: Fang, Zhuoyi, et al.
Publicado: (2024)
por: Fang, Zhuoyi, et al.
Publicado: (2024)
Channel-Aware Vector Quantization for Robust Semantic Communication on Discrete Channels
por: Meng, Zian, et al.
Publicado: (2025)
por: Meng, Zian, et al.
Publicado: (2025)
SegRet: An Efficient Design for Semantic Segmentation with Retentive Network
por: Li, Zhiyuan, et al.
Publicado: (2025)
por: Li, Zhiyuan, et al.
Publicado: (2025)
Infrared Computer Vision for Utility-Scale Photovoltaic Array Inspection
por: Ramirez, David F., et al.
Publicado: (2024)
por: Ramirez, David F., et al.
Publicado: (2024)
Learning Optimal Lattice Vector Quantizers for End-to-end Neural Image Compression
por: Zhang, Xi, et al.
Publicado: (2024)
por: Zhang, Xi, et al.
Publicado: (2024)
DynaQuant: Dynamic Mixed-Precision Quantization for Learned Image Compression
por: Bao, Youneng, et al.
Publicado: (2025)
por: Bao, Youneng, et al.
Publicado: (2025)
EdgeNavMamba: Mamba Optimized Object Detection for Energy Efficient Edge Devices
por: Aalishah, Romina, et al.
Publicado: (2025)
por: Aalishah, Romina, et al.
Publicado: (2025)
MSV-Mamba: A Multiscale Vision Mamba Network for Echocardiography Segmentation
por: Yang, Xiaoxian, et al.
Publicado: (2025)
por: Yang, Xiaoxian, et al.
Publicado: (2025)
MaDiNet: Mamba Diffusion Network for SAR Target Detection
por: Zhou, Jie, et al.
Publicado: (2024)
por: Zhou, Jie, et al.
Publicado: (2024)
Starting Positions Matter: A Study on Better Weight Initialization for Neural Network Quantization
por: Yun, Stone, et al.
Publicado: (2025)
por: Yun, Stone, et al.
Publicado: (2025)
A Mamba-based Perceptual Loss Function for Learning-based UGC Transcoding
por: Qi, Zihao, et al.
Publicado: (2026)
por: Qi, Zihao, et al.
Publicado: (2026)
DeflareMamba: Hierarchical Vision Mamba for Contextually Consistent Lens Flare Removal
por: Huang, Yihang, et al.
Publicado: (2025)
por: Huang, Yihang, et al.
Publicado: (2025)
Transformer-based Learned Image Compression for Joint Decoding and Denoising
por: Chen, Yi-Hsin, et al.
Publicado: (2024)
por: Chen, Yi-Hsin, et al.
Publicado: (2024)
TKwinFormer: Top k Window Attention in Vision Transformers for Feature Matching
por: Liao, Yun, et al.
Publicado: (2023)
por: Liao, Yun, et al.
Publicado: (2023)
GAMBAS: Generalised-Hilbert Mamba for Super-resolution of Paediatric Ultra-Low-Field MRI
por: Baljer, Levente, et al.
Publicado: (2025)
por: Baljer, Levente, et al.
Publicado: (2025)
Ejemplares similares
-
CompSRT: Quantization and Pruning for Image Super Resolution Transformers
por: Zeinali, Dorsa, et al.
Publicado: (2026) -
Variable Resolution Pixel Quantization for Low Power Machine Vision Application on Edge
por: Deb, Senorita, et al.
Publicado: (2024) -
TaQ-DiT: Time-aware Quantization for Diffusion Transformers
por: Liu, Xinyan, et al.
Publicado: (2024) -
On Quantizing Neural Representation for Variable-Rate Video Coding
por: Shi, Junqi, et al.
Publicado: (2025) -
Encoder-Quantization-Motion-based Video Quality Metrics
por: Chen, Yixu, et al.
Publicado: (2024)