PQV-Mobile: A Combined Pruning and Quantization Toolkit to Optimize Vision Transformers for Mobile Applications
Fuente:
arXiv
Salvato in:
| Autore principale: | Bhardwaj, Kshitij |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models
di: Wang, Xinhao, et al.
Pubblicazione: (2026)
di: Wang, Xinhao, et al.
Pubblicazione: (2026)
MobileUNETR: A Lightweight End-To-End Hybrid Vision Transformer For Efficient Medical Image Segmentation
di: Perera, Shehan, et al.
Pubblicazione: (2024)
di: Perera, Shehan, et al.
Pubblicazione: (2024)
Mixed Non-linear Quantization for Vision Transformers
di: Kim, Gihwan, et al.
Pubblicazione: (2024)
di: Kim, Gihwan, et al.
Pubblicazione: (2024)
iFormer: Integrating ConvNet and Transformer for Mobile Application
di: Zheng, Chuanyang
Pubblicazione: (2025)
di: Zheng, Chuanyang
Pubblicazione: (2025)
Amortized-Precision Quantization for Early-Exit Vision Transformers
di: Fang, Rui, et al.
Pubblicazione: (2026)
di: Fang, Rui, et al.
Pubblicazione: (2026)
SQAP-VLA: A Synergistic Quantization-Aware Pruning Framework for High-Performance Vision-Language-Action Models
di: Fang, Hengyu, et al.
Pubblicazione: (2025)
di: Fang, Hengyu, et al.
Pubblicazione: (2025)
Token Pruning using a Lightweight Background Aware Vision Transformer
di: Sah, Sudhakar, et al.
Pubblicazione: (2024)
di: Sah, Sudhakar, et al.
Pubblicazione: (2024)
A Mobile Application for Flower Recognition System Based on Convolutional Neural Networks
di: Yurdakul, Mustafa, et al.
Pubblicazione: (2026)
di: Yurdakul, Mustafa, et al.
Pubblicazione: (2026)
MobileVLM V2: Faster and Stronger Baseline for Vision Language Model
di: Chu, Xiangxiang, et al.
Pubblicazione: (2024)
di: Chu, Xiangxiang, et al.
Pubblicazione: (2024)
Leveraging Computer Vision in the Intensive Care Unit (ICU) for Examining Visitation and Mobility
di: Siegel, Scott, et al.
Pubblicazione: (2024)
di: Siegel, Scott, et al.
Pubblicazione: (2024)
MobileAgeNet: Lightweight Facial Age Estimation for Mobile Deployment
di: Kumar, Arun, et al.
Pubblicazione: (2026)
di: Kumar, Arun, et al.
Pubblicazione: (2026)
Clinically-Validated Innovative Mobile Application for Assessing Blinking and Eyelid Movements
di: Bonesso, Gustavo Adolpho, et al.
Pubblicazione: (2025)
di: Bonesso, Gustavo Adolpho, et al.
Pubblicazione: (2025)
Balanced Token Pruning: Accelerating Vision Language Models Beyond Local Optimization
di: Li, Kaiyuan, et al.
Pubblicazione: (2025)
di: Li, Kaiyuan, et al.
Pubblicazione: (2025)
Mobile Video Diffusion
di: Yahia, Haitam Ben, et al.
Pubblicazione: (2024)
di: Yahia, Haitam Ben, et al.
Pubblicazione: (2024)
DFQ-ViT: Data-Free Quantization for Vision Transformers without Fine-tuning
di: Tong, Yujia, et al.
Pubblicazione: (2025)
di: Tong, Yujia, et al.
Pubblicazione: (2025)
Align-KD: Distilling Cross-Modal Alignment Knowledge for Mobile Vision-Language Model
di: Feng, Qianhan, et al.
Pubblicazione: (2024)
di: Feng, Qianhan, et al.
Pubblicazione: (2024)
Pruning By Explaining Revisited: Optimizing Attribution Methods to Prune CNNs and Transformers
di: Hatefi, Sayed Mohammad Vakilzadeh, et al.
Pubblicazione: (2024)
di: Hatefi, Sayed Mohammad Vakilzadeh, et al.
Pubblicazione: (2024)
An Enhancement of CNN Algorithm for Rice Leaf Disease Image Classification in Mobile Applications
di: Rodrigo, Kayne Uriel K., et al.
Pubblicazione: (2024)
di: Rodrigo, Kayne Uriel K., et al.
Pubblicazione: (2024)
MobilePortrait: Real-Time One-Shot Neural Head Avatars on Mobile Devices
di: Jiang, Jianwen, et al.
Pubblicazione: (2024)
di: Jiang, Jianwen, et al.
Pubblicazione: (2024)
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
di: Li, Ao, et al.
Pubblicazione: (2025)
di: Li, Ao, et al.
Pubblicazione: (2025)
IWP: Token Pruning as Implicit Weight Pruning in Large Vision Language Models
di: Lee, Dong-Jae, et al.
Pubblicazione: (2026)
di: Lee, Dong-Jae, et al.
Pubblicazione: (2026)
Trio-ViT: Post-Training Quantization and Acceleration for Softmax-Free Efficient Vision Transformer
di: Shi, Huihong, et al.
Pubblicazione: (2024)
di: Shi, Huihong, et al.
Pubblicazione: (2024)
Object-Centric Vision Token Pruning for Vision Language Models
di: Li, Guangyuan, et al.
Pubblicazione: (2025)
di: Li, Guangyuan, et al.
Pubblicazione: (2025)
Towards Safe Mobility: A Unified Transportation Foundation Model enabled by Open-Ended Vision-Language Dataset
di: Huang, Wenhui, et al.
Pubblicazione: (2026)
di: Huang, Wenhui, et al.
Pubblicazione: (2026)
HiPP-Prune: Hierarchical Preference-Conditioned Structured Pruning for Vision-Language Models
di: Bai, Lincen, et al.
Pubblicazione: (2026)
di: Bai, Lincen, et al.
Pubblicazione: (2026)
Progressive Fine-to-Coarse Reconstruction for Accurate Low-Bit Post-Training Quantization in Vision Transformers
di: Ding, Rui, et al.
Pubblicazione: (2024)
di: Ding, Rui, et al.
Pubblicazione: (2024)
IPTQ-ViT: Post-Training Quantization of Non-linear Functions for Integer-only Vision Transformers
di: Kim, Gihwan, et al.
Pubblicazione: (2025)
di: Kim, Gihwan, et al.
Pubblicazione: (2025)
Mobile-Seed: Joint Semantic Segmentation and Boundary Detection for Mobile Robots
di: Liao, Youqi, et al.
Pubblicazione: (2023)
di: Liao, Youqi, et al.
Pubblicazione: (2023)
DISSECT: Diagnosing Where Vision Ends and Language Priors Begin in Scientific VLMs
di: Kukreja, Dikshant, et al.
Pubblicazione: (2026)
di: Kukreja, Dikshant, et al.
Pubblicazione: (2026)
Mobile-friendly Image de-noising: Hardware Conscious Optimization for Edge Application
di: Miriyala, Srinivas, et al.
Pubblicazione: (2026)
di: Miriyala, Srinivas, et al.
Pubblicazione: (2026)
ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving
di: Sha, Lin, et al.
Pubblicazione: (2026)
di: Sha, Lin, et al.
Pubblicazione: (2026)
DinoTwins: Combining DINO and Barlow Twins for Robust, Label-Efficient Vision Transformers
di: Podsiadly, Michael, et al.
Pubblicazione: (2025)
di: Podsiadly, Michael, et al.
Pubblicazione: (2025)
Data-driven Exploration of Mobility Interaction Patterns
di: Galatolo, Gabriele, et al.
Pubblicazione: (2025)
di: Galatolo, Gabriele, et al.
Pubblicazione: (2025)
Q-HyViT: Post-Training Quantization of Hybrid Vision Transformers with Bridge Block Reconstruction for IoT Systems
di: Lee, Jemin, et al.
Pubblicazione: (2023)
di: Lee, Jemin, et al.
Pubblicazione: (2023)
Adaptive Dataset Quantization: A New Direction for Dataset Pruning
di: Yu, Chenyue, et al.
Pubblicazione: (2025)
di: Yu, Chenyue, et al.
Pubblicazione: (2025)
TopV: Compatible Token Pruning with Inference Time Optimization for Fast and Low-Memory Multimodal Vision Language Model
di: Yang, Cheng, et al.
Pubblicazione: (2025)
di: Yang, Cheng, et al.
Pubblicazione: (2025)
FESS Loss: Feature-Enhanced Spatial Segmentation Loss for Optimizing Medical Image Analysis
di: Chodvadiya, Charulkumar, et al.
Pubblicazione: (2024)
di: Chodvadiya, Charulkumar, et al.
Pubblicazione: (2024)
MagicVL-2B: Empowering Vision-Language Models on Mobile Devices with Lightweight Visual Encoders via Curriculum Learning
di: Liu, Yi, et al.
Pubblicazione: (2025)
di: Liu, Yi, et al.
Pubblicazione: (2025)
Beyond Attention Scores: SVD-Based Vision Token Pruning for Efficient Vision-Language Models
di: Apedo, Yvon, et al.
Pubblicazione: (2026)
di: Apedo, Yvon, et al.
Pubblicazione: (2026)
TAP-ViTs: Task-Adaptive Pruning for On-Device Deployment of Vision Transformers
di: Wang, Zhibo, et al.
Pubblicazione: (2026)
di: Wang, Zhibo, et al.
Pubblicazione: (2026)
Documenti analoghi
-
QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models
di: Wang, Xinhao, et al.
Pubblicazione: (2026) -
MobileUNETR: A Lightweight End-To-End Hybrid Vision Transformer For Efficient Medical Image Segmentation
di: Perera, Shehan, et al.
Pubblicazione: (2024) -
Mixed Non-linear Quantization for Vision Transformers
di: Kim, Gihwan, et al.
Pubblicazione: (2024) -
iFormer: Integrating ConvNet and Transformer for Mobile Application
di: Zheng, Chuanyang
Pubblicazione: (2025) -
Amortized-Precision Quantization for Early-Exit Vision Transformers
di: Fang, Rui, et al.
Pubblicazione: (2026)