Switchable Token-Specific Codebook Quantization For Face Image Compression
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Yongbo, Wang, Haonan, Mu, Guodong, Zhang, Ruixin, Chen, Jiaqi, Zhang, Jingyun, Wang, Jun, Xie, Yuan, Zhang, Zhizhong, Ding, Shouhong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
From Enhancement to Understanding: Build a Generalized Bridge for Low-light Vision via Semantically Consistent Unsupervised Fine-tuning
por: Wang, Sen, et al.
Publicado: (2025)
por: Wang, Sen, et al.
Publicado: (2025)
GloTok: Global Perspective Tokenizer for Image Reconstruction and Generation
por: Zhao, Xuan, et al.
Publicado: (2025)
por: Zhao, Xuan, et al.
Publicado: (2025)
SlerpFace: Face Template Protection via Spherical Linear Interpolation
por: Zhong, Zhizhou, et al.
Publicado: (2024)
por: Zhong, Zhizhou, et al.
Publicado: (2024)
SDPose: Tokenized Pose Estimation via Circulation-Guide Self-Distillation
por: Chen, Sichen, et al.
Publicado: (2024)
por: Chen, Sichen, et al.
Publicado: (2024)
Codebook Transfer with Part-of-Speech for Vector-Quantized Image Modeling
por: Zhang, Baoquan, et al.
Publicado: (2024)
por: Zhang, Baoquan, et al.
Publicado: (2024)
Building a Strong Pre-Training Baseline for Universal 3D Large-Scale Perception
por: Chen, Haoming, et al.
Publicado: (2024)
por: Chen, Haoming, et al.
Publicado: (2024)
PVTree: Realistic and Controllable Palm Vein Generation for Recognition Tasks
por: Shang, Sheng, et al.
Publicado: (2025)
por: Shang, Sheng, et al.
Publicado: (2025)
Diff-Palm: Realistic Palmprint Generation with Polynomial Creases and Intra-Class Variation Controllable Diffusion Models
por: Jin, Jianlong, et al.
Publicado: (2025)
por: Jin, Jianlong, et al.
Publicado: (2025)
Layton: Latent Consistency Tokenizer for 1024-pixel Image Reconstruction and Generation by 256 Tokens
por: Xie, Qingsong, et al.
Publicado: (2025)
por: Xie, Qingsong, et al.
Publicado: (2025)
HybridFlow: Infusing Continuity into Masked Codebook for Extreme Low-Bitrate Image Compression
por: Lu, Lei, et al.
Publicado: (2024)
por: Lu, Lei, et al.
Publicado: (2024)
PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control
por: Wang, Ruichen, et al.
Publicado: (2024)
por: Wang, Ruichen, et al.
Publicado: (2024)
Guard Me If You Know Me: Protecting Specific Face-Identity from Deepfakes
por: Lin, Kaiqing, et al.
Publicado: (2025)
por: Lin, Kaiqing, et al.
Publicado: (2025)
A Simple Low-bit Quantization Framework for Video Snapshot Compressive Imaging
por: Cao, Miao, et al.
Publicado: (2024)
por: Cao, Miao, et al.
Publicado: (2024)
Privacy-Preserving Face Recognition Using Trainable Feature Subtraction
por: Mi, Yuxi, et al.
Publicado: (2024)
por: Mi, Yuxi, et al.
Publicado: (2024)
Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization
por: Chang, Yifan, et al.
Publicado: (2025)
por: Chang, Yifan, et al.
Publicado: (2025)
Test-Time Domain Generalization for Face Anti-Spoofing
por: Zhou, Qianyu, et al.
Publicado: (2024)
por: Zhou, Qianyu, et al.
Publicado: (2024)
MergeTok: Unified Continuous and Discrete Visual Tokenization via Token Merging
por: Zhang, Luyuan, et al.
Publicado: (2026)
por: Zhang, Luyuan, et al.
Publicado: (2026)
Navigating the Emotion Tree: Hierarchical Hyperbolic RAG for Multimodal Emotion Recognition
por: Wang, Zeheng, et al.
Publicado: (2026)
por: Wang, Zeheng, et al.
Publicado: (2026)
QuantFace: Efficient Quantization for Face Restoration
por: Li, Jiatong, et al.
Publicado: (2025)
por: Li, Jiatong, et al.
Publicado: (2025)
Scaling Image Tokenizers with Grouped Spherical Quantization
por: Wang, Jiangtao, et al.
Publicado: (2024)
por: Wang, Jiangtao, et al.
Publicado: (2024)
Complementarity-Supervised Spectral-Band Routing for Multimodal Emotion Recognition
por: Huang, Zhexian, et al.
Publicado: (2026)
por: Huang, Zhexian, et al.
Publicado: (2026)
Exploiting Discriminative Codebook Prior for Autoregressive Image Generation
por: Tang, Longxiang, et al.
Publicado: (2025)
por: Tang, Longxiang, et al.
Publicado: (2025)
All-in-One Medical Image Restoration with Latent Diffusion-Enhanced Vector-Quantized Codebook Prior
por: Chen, Haowei, et al.
Publicado: (2025)
por: Chen, Haowei, et al.
Publicado: (2025)
Hierarchical Separable Video Transformer for Snapshot Compressive Imaging
por: Wang, Ping, et al.
Publicado: (2024)
por: Wang, Ping, et al.
Publicado: (2024)
MergeVQ: A Unified Framework for Visual Generation and Representation with Disentangled Token Merging and Quantization
por: Li, Siyuan, et al.
Publicado: (2025)
por: Li, Siyuan, et al.
Publicado: (2025)
D2Pruner: Debiased Importance and Structural Diversity for MLLM Token Pruning
por: Zhang, Evelyn, et al.
Publicado: (2025)
por: Zhang, Evelyn, et al.
Publicado: (2025)
Codebook-Based Adaptive Feature Compression With Semantic Enhancement for Edge-Cloud Systems
por: Wang, Xinyu, et al.
Publicado: (2025)
por: Wang, Xinyu, et al.
Publicado: (2025)
Exploring the Adversarial Robustness of Face Forgery Detection with Decision-based Black-box Attacks
por: Chen, Zhaoyu, et al.
Publicado: (2023)
por: Chen, Zhaoyu, et al.
Publicado: (2023)
Rank-based No-reference Quality Assessment for Face Swapping
por: Zhou, Xinghui, et al.
Publicado: (2024)
por: Zhou, Xinghui, et al.
Publicado: (2024)
Adapting Foundation Models for Few-Shot Medical Image Segmentation: Actively and Sequentially
por: Yang, Jingyun, et al.
Publicado: (2025)
por: Yang, Jingyun, et al.
Publicado: (2025)
Mutual Information Guided Optimal Transport for Unsupervised Visible-Infrared Person Re-identification
por: Zhang, Zhizhong, et al.
Publicado: (2024)
por: Zhang, Zhizhong, et al.
Publicado: (2024)
Deep Probabilistic Unfolding for Quantized Compressive Sensing
por: Qu, Gang, et al.
Publicado: (2026)
por: Qu, Gang, et al.
Publicado: (2026)
Semantic One-Dimensional Tokenizer for Image Reconstruction and Generation
por: Qu, Yunpeng, et al.
Publicado: (2026)
por: Qu, Yunpeng, et al.
Publicado: (2026)
Beyond GFVC: A Progressive Face Video Compression Framework with Adaptive Visual Tokens
por: Chen, Bolin, et al.
Publicado: (2024)
por: Chen, Bolin, et al.
Publicado: (2024)
DicFace: Dirichlet-Constrained Variational Codebook Learning for Temporally Coherent Video Face Restoration
por: Chen, Yan, et al.
Publicado: (2025)
por: Chen, Yan, et al.
Publicado: (2025)
LAFR: Efficient Diffusion-based Blind Face Restoration via Latent Codebook Alignment Adapter
por: Li, Runyi, et al.
Publicado: (2025)
por: Li, Runyi, et al.
Publicado: (2025)
A Survey of Token Compression for Efficient Multimodal Large Language Models
por: Shao, Kele, et al.
Publicado: (2025)
por: Shao, Kele, et al.
Publicado: (2025)
TokenCompose: Text-to-Image Diffusion with Token-level Supervision
por: Wang, Zirui, et al.
Publicado: (2023)
por: Wang, Zirui, et al.
Publicado: (2023)
Scalable Image Tokenization with Index Backpropagation Quantization
por: Shi, Fengyuan, et al.
Publicado: (2024)
por: Shi, Fengyuan, et al.
Publicado: (2024)
SemHiTok: A Unified Image Tokenizer via Semantic-Guided Hierarchical Codebook for Multimodal Understanding and Generation
por: Chen, Zisheng, et al.
Publicado: (2025)
por: Chen, Zisheng, et al.
Publicado: (2025)
Ejemplares similares
-
From Enhancement to Understanding: Build a Generalized Bridge for Low-light Vision via Semantically Consistent Unsupervised Fine-tuning
por: Wang, Sen, et al.
Publicado: (2025) -
GloTok: Global Perspective Tokenizer for Image Reconstruction and Generation
por: Zhao, Xuan, et al.
Publicado: (2025) -
SlerpFace: Face Template Protection via Spherical Linear Interpolation
por: Zhong, Zhizhou, et al.
Publicado: (2024) -
SDPose: Tokenized Pose Estimation via Circulation-Guide Self-Distillation
por: Chen, Sichen, et al.
Publicado: (2024) -
Codebook Transfer with Part-of-Speech for Vector-Quantized Image Modeling
por: Zhang, Baoquan, et al.
Publicado: (2024)