Aligned Vector Quantization for Edge-Cloud Collabrative Vision-Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Xiao, Zhang, Lijun, Ganesan, Deepak, Guan, Hui |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
WildFit: Autonomous In-situ Model Adaptation for Resource-Constrained IoT Systems
di: Rastikerdar, Mohammad Mehdi, et al.
Pubblicazione: (2024)
di: Rastikerdar, Mohammad Mehdi, et al.
Pubblicazione: (2024)
VEQ: Modality-Adaptive Quantization for MoE Vision-Language Models
di: Qin, Guangshuo, et al.
Pubblicazione: (2026)
di: Qin, Guangshuo, et al.
Pubblicazione: (2026)
MBQ: Modality-Balanced Quantization for Large Vision-Language Models
di: Li, Shiyao, et al.
Pubblicazione: (2024)
di: Li, Shiyao, et al.
Pubblicazione: (2024)
Channel-wise Vector Quantization
di: Song, Wei, et al.
Pubblicazione: (2026)
di: Song, Wei, et al.
Pubblicazione: (2026)
VFIG: Vectorizing Complex Figures in SVG with Vision-Language Models
di: He, Qijia, et al.
Pubblicazione: (2026)
di: He, Qijia, et al.
Pubblicazione: (2026)
Breaking Modality Heterogeneity in Low-Bit Quantization for Large Vision-Language Models
di: Zhong, Yi, et al.
Pubblicazione: (2026)
di: Zhong, Yi, et al.
Pubblicazione: (2026)
Fine-Grained Post-Training Quantization for Large Vision Language Models with Quantization-Aware Integrated Gradients
di: Xiang, Ziwei, et al.
Pubblicazione: (2026)
di: Xiang, Ziwei, et al.
Pubblicazione: (2026)
Revisiting the Role of Language Priors in Vision-Language Models
di: Lin, Zhiqiu, et al.
Pubblicazione: (2023)
di: Lin, Zhiqiu, et al.
Pubblicazione: (2023)
Collaborative Edge-to-Server Inference for Vision-Language Models
di: Song, Soochang, et al.
Pubblicazione: (2025)
di: Song, Soochang, et al.
Pubblicazione: (2025)
Attack-Resilient Image Watermarking Using Stable Diffusion
di: Zhang, Lijun, et al.
Pubblicazione: (2024)
di: Zhang, Lijun, et al.
Pubblicazione: (2024)
TagAlign: Improving Vision-Language Alignment with Multi-Tag Classification
di: Liu, Qinying, et al.
Pubblicazione: (2023)
di: Liu, Qinying, et al.
Pubblicazione: (2023)
VQ-Map: Bird's-Eye-View Map Layout Estimation in Tokenized Discrete Space via Vector Quantization
di: Zhang, Yiwei, et al.
Pubblicazione: (2024)
di: Zhang, Yiwei, et al.
Pubblicazione: (2024)
Difference Vector Equalization for Robust Fine-tuning of Vision-Language Models
di: Suzuki, Satoshi, et al.
Pubblicazione: (2025)
di: Suzuki, Satoshi, et al.
Pubblicazione: (2025)
Rotation-Aligned Key Channel Pruning for Efficient Vision-Language Model Inference
di: Kang, Beomseok, et al.
Pubblicazione: (2026)
di: Kang, Beomseok, et al.
Pubblicazione: (2026)
Meta-Entity Driven Triplet Mining for Aligning Medical Vision-Language Models
di: Ozturk, Saban, et al.
Pubblicazione: (2025)
di: Ozturk, Saban, et al.
Pubblicazione: (2025)
QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models
di: Wang, Xinhao, et al.
Pubblicazione: (2026)
di: Wang, Xinhao, et al.
Pubblicazione: (2026)
Towards Long-horizon Embodied Agents with Tool-Aligned Vision-Language-Action Models
di: Lei, Zixing, et al.
Pubblicazione: (2026)
di: Lei, Zixing, et al.
Pubblicazione: (2026)
Detecting Performance Degradation under Data Shift in Pathology Vision-Language Model
di: Guan, Hao, et al.
Pubblicazione: (2026)
di: Guan, Hao, et al.
Pubblicazione: (2026)
Aligning Vision Models with Human Aesthetics in Retrieval: Benchmarks and Algorithms
di: Zhang, Miaosen, et al.
Pubblicazione: (2024)
di: Zhang, Miaosen, et al.
Pubblicazione: (2024)
T2S-GPT: Dynamic Vector Quantization for Autoregressive Sign Language Production from Text
di: Yin, Aoxiong, et al.
Pubblicazione: (2024)
di: Yin, Aoxiong, et al.
Pubblicazione: (2024)
Align-KD: Distilling Cross-Modal Alignment Knowledge for Mobile Vision-Language Model
di: Feng, Qianhan, et al.
Pubblicazione: (2024)
di: Feng, Qianhan, et al.
Pubblicazione: (2024)
SQAP-VLA: A Synergistic Quantization-Aware Pruning Framework for High-Performance Vision-Language-Action Models
di: Fang, Hengyu, et al.
Pubblicazione: (2025)
di: Fang, Hengyu, et al.
Pubblicazione: (2025)
Privacy-Preserving SAM Quantization for Efficient Edge Intelligence in Healthcare
di: Li, Zhikai, et al.
Pubblicazione: (2024)
di: Li, Zhikai, et al.
Pubblicazione: (2024)
Aquila: A Hierarchically Aligned Visual-Language Model for Enhanced Remote Sensing Image Comprehension
di: Lu, Kaixuan, et al.
Pubblicazione: (2024)
di: Lu, Kaixuan, et al.
Pubblicazione: (2024)
Aligning Neuronal Coding of Dynamic Visual Scenes with Foundation Vision Models
di: Wu, Rining, et al.
Pubblicazione: (2024)
di: Wu, Rining, et al.
Pubblicazione: (2024)
Quant Experts: Token-aware Adaptive Error Reconstruction with Mixture of Experts for Large Vision-Language Models Quantization
di: Jia, Chenwei, et al.
Pubblicazione: (2026)
di: Jia, Chenwei, et al.
Pubblicazione: (2026)
SAEC: Scene-Aware Enhanced Edge-Cloud Collaborative Industrial Vision Inspection with Multimodal LLM
di: Tian, Yuhao, et al.
Pubblicazione: (2025)
di: Tian, Yuhao, et al.
Pubblicazione: (2025)
INSIGHT: Enhancing Autonomous Driving Safety through Vision-Language Models on Context-Aware Hazard Detection and Edge Case Evaluation
di: Chen, Dianwei, et al.
Pubblicazione: (2025)
di: Chen, Dianwei, et al.
Pubblicazione: (2025)
EQ-CBM: A Probabilistic Concept Bottleneck with Energy-based Models and Quantized Vectors
di: Kim, Sangwon, et al.
Pubblicazione: (2024)
di: Kim, Sangwon, et al.
Pubblicazione: (2024)
Vision-Language Models for Edge Networks: A Comprehensive Survey
di: Sharshar, Ahmed, et al.
Pubblicazione: (2025)
di: Sharshar, Ahmed, et al.
Pubblicazione: (2025)
Dynamic Token Reduction during Generation for Vision Language Models
di: Liang, Xiaoyu, et al.
Pubblicazione: (2025)
di: Liang, Xiaoyu, et al.
Pubblicazione: (2025)
Aligning Vision to Language: Annotation-Free Multimodal Knowledge Graph Construction for Enhanced LLMs Reasoning
di: Liu, Junming, et al.
Pubblicazione: (2025)
di: Liu, Junming, et al.
Pubblicazione: (2025)
VL-DPO: Vision-Language-Guided Finetuning for Preference-Aligned Autonomous Driving
di: Xu, Zhefan, et al.
Pubblicazione: (2026)
di: Xu, Zhefan, et al.
Pubblicazione: (2026)
From Clouds to Hallucinations: Atmospheric Retrieval Hijacking in Remote Sensing Vision-Language RAG
di: Han, Jiaju, et al.
Pubblicazione: (2026)
di: Han, Jiaju, et al.
Pubblicazione: (2026)
DFQ-ViT: Data-Free Quantization for Vision Transformers without Fine-tuning
di: Tong, Yujia, et al.
Pubblicazione: (2025)
di: Tong, Yujia, et al.
Pubblicazione: (2025)
Continual Learning in Vision-Language Models via Aligned Model Merging
di: Sokar, Ghada, et al.
Pubblicazione: (2025)
di: Sokar, Ghada, et al.
Pubblicazione: (2025)
Reinforcing Spatial Reasoning in Vision-Language Models with Interwoven Thinking and Visual Drawing
di: Wu, Junfei, et al.
Pubblicazione: (2025)
di: Wu, Junfei, et al.
Pubblicazione: (2025)
UniFashion: A Unified Vision-Language Model for Multimodal Fashion Retrieval and Generation
di: Zhao, Xiangyu, et al.
Pubblicazione: (2024)
di: Zhao, Xiangyu, et al.
Pubblicazione: (2024)
Modality-Aware and Anatomical Vector-Quantized Autoencoding for Multimodal Brain MRI
di: Li, Mingjie, et al.
Pubblicazione: (2026)
di: Li, Mingjie, et al.
Pubblicazione: (2026)
RAU: Reference-based Anatomical Understanding with Vision Language Models
di: Li, Yiwei, et al.
Pubblicazione: (2025)
di: Li, Yiwei, et al.
Pubblicazione: (2025)
Documenti analoghi
-
WildFit: Autonomous In-situ Model Adaptation for Resource-Constrained IoT Systems
di: Rastikerdar, Mohammad Mehdi, et al.
Pubblicazione: (2024) -
VEQ: Modality-Adaptive Quantization for MoE Vision-Language Models
di: Qin, Guangshuo, et al.
Pubblicazione: (2026) -
MBQ: Modality-Balanced Quantization for Large Vision-Language Models
di: Li, Shiyao, et al.
Pubblicazione: (2024) -
Channel-wise Vector Quantization
di: Song, Wei, et al.
Pubblicazione: (2026) -
VFIG: Vectorizing Complex Figures in SVG with Vision-Language Models
di: He, Qijia, et al.
Pubblicazione: (2026)