Guardado en:
| Autores principales: | Ding, Xin, Cao, Shijie, Cao, Ting, Chen, Zhibo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2501.06218 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Q&C: When Quantization Meets Cache in Efficient Image Generation
por: Ding, Xin, et al.
Publicado: (2025)
por: Ding, Xin, et al.
Publicado: (2025)
Quantized Prompt for Efficient Generalization of Vision-Language Models
por: Hao, Tianxiang, et al.
Publicado: (2024)
por: Hao, Tianxiang, et al.
Publicado: (2024)
BitsFusion: 1.99 bits Weight Quantization of Diffusion Model
por: Sui, Yang, et al.
Publicado: (2024)
por: Sui, Yang, et al.
Publicado: (2024)
StreamMind: Unlocking Full Frame Rate Streaming Video Dialogue through Event-Gated Cognition
por: Ding, Xin, et al.
Publicado: (2025)
por: Ding, Xin, et al.
Publicado: (2025)
Progressive Fine-to-Coarse Reconstruction for Accurate Low-Bit Post-Training Quantization in Vision Transformers
por: Ding, Rui, et al.
Publicado: (2024)
por: Ding, Rui, et al.
Publicado: (2024)
Exploring Scalable Unified Modeling for General Low-Level Vision
por: Chen, Xiangyu, et al.
Publicado: (2025)
por: Chen, Xiangyu, et al.
Publicado: (2025)
Breaking Modality Heterogeneity in Low-Bit Quantization for Large Vision-Language Models
por: Zhong, Yi, et al.
Publicado: (2026)
por: Zhong, Yi, et al.
Publicado: (2026)
Diff-ICMH: Harmonizing Machine and Human Vision in Image Compression with Generative Prior
por: Feng, Ruoyu, et al.
Publicado: (2025)
por: Feng, Ruoyu, et al.
Publicado: (2025)
MambaCSR: Dual-Interleaved Scanning for Compressed Image Super-Resolution With SSMs
por: Ren, Yulin, et al.
Publicado: (2024)
por: Ren, Yulin, et al.
Publicado: (2024)
Boosting the Generalization and Reasoning of Vision Language Models with Curriculum Reinforcement Learning
por: Deng, Huilin, et al.
Publicado: (2025)
por: Deng, Huilin, et al.
Publicado: (2025)
Learning Visual Grounding from Generative Vision and Language Model
por: Wang, Shijie, et al.
Publicado: (2024)
por: Wang, Shijie, et al.
Publicado: (2024)
6Bit-Diffusion: Inference-Time Mixed-Precision Quantization for Video Diffusion Models
por: Su, Rundong, et al.
Publicado: (2026)
por: Su, Rundong, et al.
Publicado: (2026)
BitDance: Scaling Autoregressive Generative Models with Binary Tokens
por: Ai, Yuang, et al.
Publicado: (2026)
por: Ai, Yuang, et al.
Publicado: (2026)
Autoregressive Image Generation with Masked Bit Modeling
por: Yu, Qihang, et al.
Publicado: (2026)
por: Yu, Qihang, et al.
Publicado: (2026)
Hyper Adversarial Tuning for Boosting Adversarial Robustness of Pretrained Large Vision Models
por: Lv, Kangtao, et al.
Publicado: (2024)
por: Lv, Kangtao, et al.
Publicado: (2024)
A Simple Low-bit Quantization Framework for Video Snapshot Compressive Imaging
por: Cao, Miao, et al.
Publicado: (2024)
por: Cao, Miao, et al.
Publicado: (2024)
MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models
por: Feng, Weilun, et al.
Publicado: (2024)
por: Feng, Weilun, et al.
Publicado: (2024)
Why Compress What You Can Generate? When GPT-4o Generation Ushers in Image Compression Fields
por: Gao, Yixin, et al.
Publicado: (2025)
por: Gao, Yixin, et al.
Publicado: (2025)
JAQ: Joint Efficient Architecture Design and Low-Bit Quantization with Hardware-Software Co-Exploration
por: Wang, Mingzi, et al.
Publicado: (2025)
por: Wang, Mingzi, et al.
Publicado: (2025)
HQ-DM: Single Hadamard Transformation-Based Quantization-Aware Training for Low-Bit Diffusion Models
por: Mao, Shizhuo, et al.
Publicado: (2025)
por: Mao, Shizhuo, et al.
Publicado: (2025)
Training-free Camera Control for Video Generation
por: Hou, Chen, et al.
Publicado: (2024)
por: Hou, Chen, et al.
Publicado: (2024)
LDP-Slicing: Local Differential Privacy for Images via Randomized Bit-Plane Slicing
por: Cao, Yuanming, et al.
Publicado: (2026)
por: Cao, Yuanming, et al.
Publicado: (2026)
EfficientDM: Efficient Quantization-Aware Fine-Tuning of Low-Bit Diffusion Models
por: He, Yefei, et al.
Publicado: (2023)
por: He, Yefei, et al.
Publicado: (2023)
Towards Joint Quantization and Token Pruning of Vision-Language Models
por: Li, Xinqing, et al.
Publicado: (2026)
por: Li, Xinqing, et al.
Publicado: (2026)
Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws
por: Wei, Xiyuan, et al.
Publicado: (2025)
por: Wei, Xiyuan, et al.
Publicado: (2025)
LL-Bench: Rethinking Low-Level Vision Evaluation in the Era of Large-Scale Generative Models
por: Liu, Lu, et al.
Publicado: (2026)
por: Liu, Lu, et al.
Publicado: (2026)
CalibQuant: 1-Bit KV Cache Quantization for Multimodal LLMs
por: Han, Insu, et al.
Publicado: (2025)
por: Han, Insu, et al.
Publicado: (2025)
CondiQuant: Condition Number Based Low-Bit Quantization for Image Super-Resolution
por: Liu, Kai, et al.
Publicado: (2025)
por: Liu, Kai, et al.
Publicado: (2025)
Outlier-Aware Training for Low-Bit Quantization of Structural Re-Parameterized Networks
por: Niu, Muqun, et al.
Publicado: (2024)
por: Niu, Muqun, et al.
Publicado: (2024)
Plug-and-Play 1.x-Bit KV Cache Quantization for Video Large Language Models
por: Tao, Keda, et al.
Publicado: (2025)
por: Tao, Keda, et al.
Publicado: (2025)
GRIP-VLM: Group-Relative Importance Pruning for Efficient Vision-Language Models
por: Huang, Mingzhe, et al.
Publicado: (2026)
por: Huang, Mingzhe, et al.
Publicado: (2026)
MSPE: Multi-Scale Patch Embedding Prompts Vision Transformers to Any Resolution
por: Liu, Wenzhuo, et al.
Publicado: (2024)
por: Liu, Wenzhuo, et al.
Publicado: (2024)
PromptCIR: Blind Compressed Image Restoration with Prompt Learning
por: Li, Bingchen, et al.
Publicado: (2024)
por: Li, Bingchen, et al.
Publicado: (2024)
Quantization Variation: A New Perspective on Training Transformers with Low-Bit Precision
por: Huang, Xijie, et al.
Publicado: (2023)
por: Huang, Xijie, et al.
Publicado: (2023)
ProGIC: Progressive and Lightweight Generative Image Compression with Residual Vector Quantization
por: Cao, Hao, et al.
Publicado: (2026)
por: Cao, Hao, et al.
Publicado: (2026)
QuantVSR: Low-Bit Post-Training Quantization for Real-World Video Super-Resolution
por: Chai, Bowen, et al.
Publicado: (2025)
por: Chai, Bowen, et al.
Publicado: (2025)
CoNo: Consistency Noise Injection for Tuning-free Long Video Diffusion
por: Wang, Xingrui, et al.
Publicado: (2024)
por: Wang, Xingrui, et al.
Publicado: (2024)
LLM-FP4: 4-Bit Floating-Point Quantized Transformers
por: Liu, Shih-yang, et al.
Publicado: (2023)
por: Liu, Shih-yang, et al.
Publicado: (2023)
$S^3$: Synonymous Semantic Space for Improving Zero-Shot Generalization of Vision-Language Models
por: Yin, Xiaojie, et al.
Publicado: (2024)
por: Yin, Xiaojie, et al.
Publicado: (2024)
BitVLA: 1-bit Vision-Language-Action Models for Robotics Manipulation
por: Wang, Hongyu, et al.
Publicado: (2025)
por: Wang, Hongyu, et al.
Publicado: (2025)
Ejemplares similares
-
Q&C: When Quantization Meets Cache in Efficient Image Generation
por: Ding, Xin, et al.
Publicado: (2025) -
Quantized Prompt for Efficient Generalization of Vision-Language Models
por: Hao, Tianxiang, et al.
Publicado: (2024) -
BitsFusion: 1.99 bits Weight Quantization of Diffusion Model
por: Sui, Yang, et al.
Publicado: (2024) -
StreamMind: Unlocking Full Frame Rate Streaming Video Dialogue through Event-Gated Cognition
por: Ding, Xin, et al.
Publicado: (2025) -
Progressive Fine-to-Coarse Reconstruction for Accurate Low-Bit Post-Training Quantization in Vision Transformers
por: Ding, Rui, et al.
Publicado: (2024)