MISC: Ultra-low Bitrate Image Semantic Compression Driven by Large Multimodal Model
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Chunyi, Lu, Guo, Feng, Donghui, Wu, Haoning, Zhang, Zicheng, Liu, Xiaohong, Zhai, Guangtao, Lin, Weisi, Zhang, Wenjun |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
CMC-Bench: Towards a New Paradigm of Visual Signal Compression
by: Li, Chunyi, et al.
Published: (2024)
by: Li, Chunyi, et al.
Published: (2024)
Embodied Image Compression
by: Li, Chunyi, et al.
Published: (2025)
by: Li, Chunyi, et al.
Published: (2025)
R-Bench: Are your Large Multimodal Model Robust to Real-world Corruptions?
by: Li, Chunyi, et al.
Published: (2024)
by: Li, Chunyi, et al.
Published: (2024)
Q-Refine: A Perceptual Quality Refiner for AI-Generated Image
by: Li, Chunyi, et al.
Published: (2024)
by: Li, Chunyi, et al.
Published: (2024)
Image Quality Assessment: From Human to Machine Preference
by: Li, Chunyi, et al.
Published: (2025)
by: Li, Chunyi, et al.
Published: (2025)
Just Noticeable Difference for Large Multimodal Models
by: Chen, Zijian, et al.
Published: (2025)
by: Chen, Zijian, et al.
Published: (2025)
Adaptive Image Quality Assessment via Teaching Large Multimodal Model to Compare
by: Zhu, Hanwei, et al.
Published: (2024)
by: Zhu, Hanwei, et al.
Published: (2024)
Your Demands Deserve More Bits: Referring Semantic Image Compression at Ultra-low Bitrate
by: Wu, Chenhao, et al.
Published: (2025)
by: Wu, Chenhao, et al.
Published: (2025)
AsymLLIC: Asymmetric Lightweight Learned Image Compression
by: Wang, Shen, et al.
Published: (2024)
by: Wang, Shen, et al.
Published: (2024)
Q-Agent: Quality-Driven Chain-of-Thought Image Restoration Agent through Robust Multimodal Large Language Model
by: Zhou, Yingjie, et al.
Published: (2025)
by: Zhou, Yingjie, et al.
Published: (2025)
GMS-3DQA: Projection-based Grid Mini-patch Sampling for 3D Model Quality Assessment
by: Zhang, Zicheng, et al.
Published: (2023)
by: Zhang, Zicheng, et al.
Published: (2023)
Generative Latent Coding for Ultra-Low Bitrate Image Compression
by: Jia, Zhaoyang, et al.
Published: (2025)
by: Jia, Zhaoyang, et al.
Published: (2025)
A Coding Framework and Benchmark towards Low-Bitrate Video Understanding
by: Tian, Yuan, et al.
Published: (2022)
by: Tian, Yuan, et al.
Published: (2022)
Generative Latent Coding for Ultra-Low Bitrate Image and Video Compression
by: Qi, Linfeng, et al.
Published: (2025)
by: Qi, Linfeng, et al.
Published: (2025)
AU-IQA: A Benchmark Dataset for Perceptual Quality Assessment of AI-Enhanced User-Generated Content
by: Wang, Shushi, et al.
Published: (2025)
by: Wang, Shushi, et al.
Published: (2025)
Single-step Diffusion for Image Compression at Ultra-Low Bitrates
by: Park, Chanung, et al.
Published: (2025)
by: Park, Chanung, et al.
Published: (2025)
SG-JND: Semantic-Guided Just Noticeable Distortion Predictor For Image Compression
by: Cao, Linhan, et al.
Published: (2024)
by: Cao, Linhan, et al.
Published: (2024)
Charting the Path Forward: CT Image Quality Assessment -- An In-Depth Review
by: Xun, Siyi, et al.
Published: (2024)
by: Xun, Siyi, et al.
Published: (2024)
Saliency-aware End-to-end Learned Variable-Bitrate 360-degree Image Compression
by: Gungordu, Oguzhan, et al.
Published: (2024)
by: Gungordu, Oguzhan, et al.
Published: (2024)
S2CFormer: Revisiting the RD-Latency Trade-off in Transformer-based Learned Image Compression
by: Chen, Yunuo, et al.
Published: (2025)
by: Chen, Yunuo, et al.
Published: (2025)
Resolution-Agnostic Neural Compression for High-Fidelity Portrait Video Conferencing via Implicit Radiance Fields
by: Li, Yifei, et al.
Published: (2024)
by: Li, Yifei, et al.
Published: (2024)
Ultra Lowrate Image Compression with Semantic Residual Coding and Compression-aware Diffusion
by: Ke, Anle, et al.
Published: (2025)
by: Ke, Anle, et al.
Published: (2025)
Semantic Communications with Explicit Semantic Base for Image Transmission
by: Zheng, Yuan, et al.
Published: (2023)
by: Zheng, Yuan, et al.
Published: (2023)
Audio-Visual Driven Compression for Low-Bitrate Talking Head Videos
by: Takahashi, Riku, et al.
Published: (2025)
by: Takahashi, Riku, et al.
Published: (2025)
Soft then Hard: Rethinking the Quantization in Neural Image Compression
by: Guo, Zongyu, et al.
Published: (2021)
by: Guo, Zongyu, et al.
Published: (2021)
HybridFlow: Infusing Continuity into Masked Codebook for Extreme Low-Bitrate Image Compression
by: Lu, Lei, et al.
Published: (2024)
by: Lu, Lei, et al.
Published: (2024)
THQA: A Perceptual Quality Assessment Database for Talking Heads
by: Zhou, Yingjie, et al.
Published: (2024)
by: Zhou, Yingjie, et al.
Published: (2024)
3DGCQA: A Quality Assessment Database for 3D AI-Generated Contents
by: Zhou, Yingjie, et al.
Published: (2024)
by: Zhou, Yingjie, et al.
Published: (2024)
UNQA: Unified No-Reference Quality Assessment for Audio, Image, Video, and Audio-Visual Content
by: Cao, Yuqin, et al.
Published: (2024)
by: Cao, Yuqin, et al.
Published: (2024)
Compression-Realized Deep Structural Network for Video Quality Enhancement
by: Sun, Hanchi, et al.
Published: (2024)
by: Sun, Hanchi, et al.
Published: (2024)
Large Language Model for Lossless Image Compression with Visual Prompts
by: Du, Junhao, et al.
Published: (2025)
by: Du, Junhao, et al.
Published: (2025)
Exploiting Inter-Image Similarity Prior for Low-Bitrate Remote Sensing Image Compression
by: Li, Junhui, et al.
Published: (2024)
by: Li, Junhui, et al.
Published: (2024)
Leveraging Compression to Construct Transferable Bitrate Ladders
by: Durbha, Krishna Srikar, et al.
Published: (2025)
by: Durbha, Krishna Srikar, et al.
Published: (2025)
DiV-INR: Extreme Low-Bitrate Diffusion Video Compression with INR Conditioning
by: Çetin, Eren, et al.
Published: (2026)
by: Çetin, Eren, et al.
Published: (2026)
Semantics-Guided Generative Image Compression
by: Wu, Cheng-Lin, et al.
Published: (2025)
by: Wu, Cheng-Lin, et al.
Published: (2025)
Customizable ROI-Based Deep Image Compression
by: Jin, Jian, et al.
Published: (2025)
by: Jin, Jian, et al.
Published: (2025)
MLICv2: Enhanced Multi-Reference Entropy Modeling for Learned Image Compression
by: Jiang, Wei, et al.
Published: (2025)
by: Jiang, Wei, et al.
Published: (2025)
Who is a Better Talker: Subjective and Objective Quality Assessment for AI-Generated Talking Heads
by: Zhou, Yingjie, et al.
Published: (2025)
by: Zhou, Yingjie, et al.
Published: (2025)
No-Reference Point Cloud Quality Assessment via Graph Convolutional Network
by: Chen, Wu, et al.
Published: (2024)
by: Chen, Wu, et al.
Published: (2024)
Assessing UHD Image Quality from Aesthetics, Distortions, and Saliency
by: Sun, Wei, et al.
Published: (2024)
by: Sun, Wei, et al.
Published: (2024)
Similar Items
-
CMC-Bench: Towards a New Paradigm of Visual Signal Compression
by: Li, Chunyi, et al.
Published: (2024) -
Embodied Image Compression
by: Li, Chunyi, et al.
Published: (2025) -
R-Bench: Are your Large Multimodal Model Robust to Real-world Corruptions?
by: Li, Chunyi, et al.
Published: (2024) -
Q-Refine: A Perceptual Quality Refiner for AI-Generated Image
by: Li, Chunyi, et al.
Published: (2024) -
Image Quality Assessment: From Human to Machine Preference
by: Li, Chunyi, et al.
Published: (2025)