CARVQ: Corrective Adaptor with Group Residual Vector Quantization for LLM Embedding Compression
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gou, Dayin, Byun, Sanghyun, Malpeddi, Nilesh, De Micheli, Gabrielle, Vaste, Prathamesh, Song, Jacob, Chung, Woo Seong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MultiDepth: Multi-Sample Priors for Refining Monocular Metric Depth Estimations in Indoor Scenes
par: Byun, Sanghyun, et autres
Publié: (2024)
par: Byun, Sanghyun, et autres
Publié: (2024)
APCE: Adaptive Progressive Context Expansion for Long Context Processing
par: Lee, Baisub, et autres
Publié: (2025)
par: Lee, Baisub, et autres
Publié: (2025)
OneNet: A Channel-Wise 1D Convolutional U-Net
par: Byun, Sanghyun, et autres
Publié: (2024)
par: Byun, Sanghyun, et autres
Publié: (2024)
Unifying Vision-Language Latents for Zero-label Image Caption Enhancement
par: Byun, Sanghyun, et autres
Publié: (2025)
par: Byun, Sanghyun, et autres
Publié: (2025)
3-Model Speculative Decoding
par: Byun, Sanghyun, et autres
Publié: (2025)
par: Byun, Sanghyun, et autres
Publié: (2025)
Learning Grouped Lattice Vector Quantizers for Low-Bit LLM Compression
par: Zhang, Xi, et autres
Publié: (2025)
par: Zhang, Xi, et autres
Publié: (2025)
ProGIC: Progressive and Lightweight Generative Image Compression with Residual Vector Quantization
par: Cao, Hao, et autres
Publié: (2026)
par: Cao, Hao, et autres
Publié: (2026)
RQ-MoE: Residual Quantization via Mixture of Experts for Efficient Input-Dependent Vector Compression
par: Zhong, Zhengjia, et autres
Publié: (2026)
par: Zhong, Zhengjia, et autres
Publié: (2026)
Leech Lattice Vector Quantization for Efficient LLM Compression
par: van der Ouderaa, Tycho F. A., et autres
Publié: (2026)
par: van der Ouderaa, Tycho F. A., et autres
Publié: (2026)
Search-Adaptor: Embedding Customization for Information Retrieval
par: Yoon, Jinsung, et autres
Publié: (2023)
par: Yoon, Jinsung, et autres
Publié: (2023)
Variable Bitrate Residual Vector Quantization for Audio Coding
par: Chae, Yunkee, et autres
Publié: (2024)
par: Chae, Yunkee, et autres
Publié: (2024)
Matryoshka-Adaptor: Unsupervised and Supervised Tuning for Smaller Embedding Dimensions
par: Yoon, Jinsung, et autres
Publié: (2024)
par: Yoon, Jinsung, et autres
Publié: (2024)
HE-LRM: Efficient Private Embedding Lookups for Neural Inference Using Fully Homomorphic Encryption
par: Garimella, Karthik, et autres
Publié: (2025)
par: Garimella, Karthik, et autres
Publié: (2025)
HAS-VQ: Hessian-Adaptive Sparse Vector Quantization for High-Fidelity LLM Compression
par: Khasia, Vladimer
Publié: (2026)
par: Khasia, Vladimer
Publié: (2026)
Robust Residual Finite Scalar Quantization for Neural Compression
par: Zhu, Xiaoxu, et autres
Publié: (2025)
par: Zhu, Xiaoxu, et autres
Publié: (2025)
4bit-Quantization in Vector-Embedding for RAG
par: Jeong, Taehee
Publié: (2025)
par: Jeong, Taehee
Publié: (2025)
Balance of Number of Embedding and their Dimensions in Vector Quantization
par: Chen, Hang, et autres
Publié: (2024)
par: Chen, Hang, et autres
Publié: (2024)
Residual Vector Quantization For Communication-Efficient Multi-Agent Perception
par: Shenkut, Dereje, et autres
Publié: (2025)
par: Shenkut, Dereje, et autres
Publié: (2025)
Efficient Generative Modeling with Residual Vector Quantization-Based Tokens
par: Kim, Jaehyeon, et autres
Publié: (2024)
par: Kim, Jaehyeon, et autres
Publié: (2024)
Residual Governance
par: Hecht, Gabrielle
Publié: (2023)
par: Hecht, Gabrielle
Publié: (2023)
FaTRQ: Tiered Residual Quantization for LLM Vector Search in Far-Memory-Aware ANNS Systems
par: Zhang, Tianqi, et autres
Publié: (2026)
par: Zhang, Tianqi, et autres
Publié: (2026)
Mamba-Adaptor: State Space Model Adaptor for Visual Recognition
par: Xie, Fei, et autres
Publié: (2025)
par: Xie, Fei, et autres
Publié: (2025)
Vector-Quantized Soft Label Compression for Dataset Distillation
par: Abbasi, Ali, et autres
Publié: (2026)
par: Abbasi, Ali, et autres
Publié: (2026)
LitE-SQL: A Lightweight and Efficient Text-to-SQL Framework with Vector-based Schema Linking and Execution-Guided Self-Correction
par: Piao, Shengmin, et autres
Publié: (2025)
par: Piao, Shengmin, et autres
Publié: (2025)
QET: Enhancing Quantized LLM Parameters and KV cache Compression through Element Substitution and Residual Clustering
par: Wang, Yanshu, et autres
Publié: (2024)
par: Wang, Yanshu, et autres
Publié: (2024)
The Impact of Teacher Social‐Emotional Competence Training on Students' Social‐Emotional Competence: A Theoretical Framework Based on the KAB Model and Empirical Analysis Using SSES Data
par: Dayin Li, et autres
Publié: (2025)
par: Dayin Li, et autres
Publié: (2025)
Low-Rank Adapters Meet Neural Architecture Search for LLM Compression
par: Muñoz, J. Pablo, et autres
Publié: (2025)
par: Muñoz, J. Pablo, et autres
Publié: (2025)
Quantized Embedding Vectors for Controllable Diffusion Language Models
par: Kang, Cheng, et autres
Publié: (2024)
par: Kang, Cheng, et autres
Publié: (2024)
GranQ: Efficient Channel-wise Quantization via Vectorized Pre-Scaling for Zero-Shot QAT
par: Hong, Inpyo, et autres
Publié: (2025)
par: Hong, Inpyo, et autres
Publié: (2025)
CommVQ: Commutative Vector Quantization for KV Cache Compression
par: Li, Junyan, et autres
Publié: (2025)
par: Li, Junyan, et autres
Publié: (2025)
CRVQ: Channel-Relaxed Vector Quantization for Extreme Compression of LLMs
par: Xu, Yuzhuang, et autres
Publié: (2024)
par: Xu, Yuzhuang, et autres
Publié: (2024)
ESC: Efficient Speech Coding with Cross-Scale Residual Vector Quantized Transformers
par: Gu, Yuzhe, et autres
Publié: (2024)
par: Gu, Yuzhe, et autres
Publié: (2024)
Making Pose Representations More Expressive and Disentangled via Residual Vector Quantization
par: Jeong, Sukhyun, et autres
Publié: (2025)
par: Jeong, Sukhyun, et autres
Publié: (2025)
Rethinking Residual Errors in Compensation-based LLM Quantization
par: Li, Shuaiting, et autres
Publié: (2026)
par: Li, Shuaiting, et autres
Publié: (2026)
Minecraft-ify: Minecraft Style Image Generation with Text-guided Image Editing for In-Game Application
par: Kim, Bumsoo, et autres
Publié: (2024)
par: Kim, Bumsoo, et autres
Publié: (2024)
SkillAdaptor: Self-Adapting Skills for LLM Agents from Trajectories
par: Yu, Zhuoyun, et autres
Publié: (2026)
par: Yu, Zhuoyun, et autres
Publié: (2026)
RAVE: Residual Vector Embedding for CLIP-Guided Backlit Image Enhancement
par: Gaintseva, Tatiana, et autres
Publié: (2024)
par: Gaintseva, Tatiana, et autres
Publié: (2024)
Hierarchical Vector-Quantized Latents for Perceptual Low-Resolution Video Compression
par: Kotthapalli, Manikanta, et autres
Publié: (2025)
par: Kotthapalli, Manikanta, et autres
Publié: (2025)
RAVQ-HoloNet: Rate-Adaptive Vector-Quantized Hologram Compression
par: Rafiei, Shima, et autres
Publié: (2025)
par: Rafiei, Shima, et autres
Publié: (2025)
Differentiable Vector Quantization for Rate-Distortion Optimization of Generative Image Compression
par: Jiang, Shiyin, et autres
Publié: (2026)
par: Jiang, Shiyin, et autres
Publié: (2026)
Documents similaires
-
MultiDepth: Multi-Sample Priors for Refining Monocular Metric Depth Estimations in Indoor Scenes
par: Byun, Sanghyun, et autres
Publié: (2024) -
APCE: Adaptive Progressive Context Expansion for Long Context Processing
par: Lee, Baisub, et autres
Publié: (2025) -
OneNet: A Channel-Wise 1D Convolutional U-Net
par: Byun, Sanghyun, et autres
Publié: (2024) -
Unifying Vision-Language Latents for Zero-label Image Caption Enhancement
par: Byun, Sanghyun, et autres
Publié: (2025) -
3-Model Speculative Decoding
par: Byun, Sanghyun, et autres
Publié: (2025)