Neural Image Compression with Text-guided Encoding for both Pixel-level and Perceptual Fidelity
Fuente:
arXiv
Saved in:
| Main Authors: | Lee, Hagyeong, Kim, Minkyu, Kim, Jun-Hyuk, Kim, Seungeon, Oh, Dokwan, Lee, Jaeho |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Diversify, Contextualize, and Adapt: Efficient Entropy Modeling for Neural Image Codec
by: Kim, Jun-Hyuk, et al.
Published: (2024)
by: Kim, Jun-Hyuk, et al.
Published: (2024)
Discovering and Mitigating Visual Biases through Keyword Explanation
by: Kim, Younghyun, et al.
Published: (2023)
by: Kim, Younghyun, et al.
Published: (2023)
Neural Weight Compression for Language Models
by: Ryu, Jegwang, et al.
Published: (2025)
by: Ryu, Jegwang, et al.
Published: (2025)
Efficient Neural Video Representation with Temporally Coherent Modulation
by: Shin, Seungjun, et al.
Published: (2025)
by: Shin, Seungjun, et al.
Published: (2025)
In Search of a Data Transformation That Accelerates Neural Field Training
by: Seo, Junwon, et al.
Published: (2023)
by: Seo, Junwon, et al.
Published: (2023)
Progressive Learned Image Compression for Machine Perception
by: Kim, Jungwoo, et al.
Published: (2025)
by: Kim, Jungwoo, et al.
Published: (2025)
Coarse-to-Fine: Progressive Image Compression for Semantically Hierarchical Classification
by: Kim, Jungwoo, et al.
Published: (2026)
by: Kim, Jungwoo, et al.
Published: (2026)
Beyond Image Super-Resolution for Image Recognition with Task-Driven Perceptual Loss
by: Kim, Jaeha, et al.
Published: (2024)
by: Kim, Jaeha, et al.
Published: (2024)
Text Change Detection in Multilingual Documents Using Image Comparison
by: Park, Doyoung, et al.
Published: (2024)
by: Park, Doyoung, et al.
Published: (2024)
Text-Aware Image Restoration with Diffusion Models
by: Min, Jaewon, et al.
Published: (2025)
by: Min, Jaewon, et al.
Published: (2025)
VLM-SubtleBench: How Far Are VLMs from Human-Level Subtle Comparative Reasoning?
by: Kim, Minkyu, et al.
Published: (2026)
by: Kim, Minkyu, et al.
Published: (2026)
Diffusion-based Data Augmentation and Knowledge Distillation with Generated Soft Labels Solving Data Scarcity Problems of SAR Oil Spill Segmentation
by: Moon, Jaeho, et al.
Published: (2024)
by: Moon, Jaeho, et al.
Published: (2024)
Activation Quantization of Vision Encoders Needs Prefixing Registers
by: Kim, Seunghyeon, et al.
Published: (2025)
by: Kim, Seunghyeon, et al.
Published: (2025)
ZIP: An Efficient Zeroth-order Prompt Tuning for Black-box Vision-Language Models
by: Park, Seonghwan, et al.
Published: (2025)
by: Park, Seonghwan, et al.
Published: (2025)
InterRVOS: Interaction-aware Referring Video Object Segmentation
by: Jin, Woojeong, et al.
Published: (2025)
by: Jin, Woojeong, et al.
Published: (2025)
Multi-frame Restoration for High-rate Lissajous Confocal Laser Endomicroscopy
by: Lee, Minhee, et al.
Published: (2026)
by: Lee, Minhee, et al.
Published: (2026)
SLIM: Semantic-based Low-bitrate Image compression for Machines by leveraging diffusion
by: Lee, Hyeonjin, et al.
Published: (2025)
by: Lee, Hyeonjin, et al.
Published: (2025)
Image Clustering Conditioned on Text Criteria
by: Kwon, Sehyun, et al.
Published: (2023)
by: Kwon, Sehyun, et al.
Published: (2023)
Test-time Alignment of Diffusion Models without Reward Over-optimization
by: Kim, Sunwoo, et al.
Published: (2025)
by: Kim, Sunwoo, et al.
Published: (2025)
Zero-shot Text-guided Infinite Image Synthesis with LLM guidance
by: Kwon, Soyeong, et al.
Published: (2024)
by: Kwon, Soyeong, et al.
Published: (2024)
LayerMerge: Neural Network Depth Compression through Layer Pruning and Merging
by: Kim, Jinuk, et al.
Published: (2024)
by: Kim, Jinuk, et al.
Published: (2024)
Parallel Tempering Initial Sampling in Inference-Time Reward Alignment
by: Oh, Myeongjun, et al.
Published: (2026)
by: Oh, Myeongjun, et al.
Published: (2026)
Decoder-Free Distillation for Quantized Image Restoration
by: Sharif, S. M. A., et al.
Published: (2026)
by: Sharif, S. M. A., et al.
Published: (2026)
DiffBlender: Composable and Versatile Multimodal Text-to-Image Diffusion Models
by: Kim, Sungnyun, et al.
Published: (2023)
by: Kim, Sungnyun, et al.
Published: (2023)
Holistic Unlearning Benchmark: A Multi-Faceted Evaluation for Text-to-Image Diffusion Model Unlearning
by: Moon, Saemi, et al.
Published: (2024)
by: Moon, Saemi, et al.
Published: (2024)
ViPCap: Retrieval Text-Based Visual Prompts for Lightweight Image Captioning
by: Kim, Taewhan, et al.
Published: (2024)
by: Kim, Taewhan, et al.
Published: (2024)
DebFilter: Eradicating Biases Stashed in Value
by: Lee, Seung Hyuk, et al.
Published: (2026)
by: Lee, Seung Hyuk, et al.
Published: (2026)
Towards Scalable Human-aligned Benchmark for Text-guided Image Editing
by: Ryu, Suho, et al.
Published: (2025)
by: Ryu, Suho, et al.
Published: (2025)
Auto-Encoded Supervision for Perceptual Image Super-Resolution
by: Lee, MinKyu, et al.
Published: (2024)
by: Lee, MinKyu, et al.
Published: (2024)
Improving Diagnostic Accuracy for Oral Cancer with inpainting Synthesis Lesions Generated Using Diffusion Models
by: Lee, Yong Oh, et al.
Published: (2025)
by: Lee, Yong Oh, et al.
Published: (2025)
Rare-to-Frequent: Unlocking Compositional Generation Power of Diffusion Models on Rare Concepts with LLM Guidance
by: Park, Dongmin, et al.
Published: (2024)
by: Park, Dongmin, et al.
Published: (2024)
Linear Algebraic Approaches to Neuroimaging Data Compression: A Comparative Analysis of Matrix and Tensor Decomposition Methods for High-Dimensional Medical Images
by: Kim, Jaeho, et al.
Published: (2025)
by: Kim, Jaeho, et al.
Published: (2025)
SurrogateSHAP: Training-Free Contributor Attribution for Text-to-Image (T2I) Models
by: Lu, Mingyu, et al.
Published: (2026)
by: Lu, Mingyu, et al.
Published: (2026)
DESSERT: Diffusion-based Event-driven Single-frame Synthesis via Residual Training
by: Kong, Jiyun, et al.
Published: (2025)
by: Kong, Jiyun, et al.
Published: (2025)
Performance Plateaus in Inference-Time Scaling for Text-to-Image Diffusion Without External Models
by: Choi, Changhyun, et al.
Published: (2025)
by: Choi, Changhyun, et al.
Published: (2025)
Learning 3D Scene Analogies with Neural Contextual Scene Maps
by: Kim, Junho, et al.
Published: (2025)
by: Kim, Junho, et al.
Published: (2025)
EmerDiff: Emerging Pixel-level Semantic Knowledge in Diffusion Models
by: Namekata, Koichi, et al.
Published: (2024)
by: Namekata, Koichi, et al.
Published: (2024)
ABBSPO: Adaptive Bounding Box Scaling and Symmetric Prior based Orientation Prediction for Detecting Aerial Image Objects
by: Lee, Woojin, et al.
Published: (2025)
by: Lee, Woojin, et al.
Published: (2025)
EdgeFusion: On-Device Text-to-Image Generation
by: Castells, Thibault, et al.
Published: (2024)
by: Castells, Thibault, et al.
Published: (2024)
OSPO: Object-Centric Self-Improving Preference Optimization for Text-to-Image Generation
by: Oh, Yoonjin, et al.
Published: (2025)
by: Oh, Yoonjin, et al.
Published: (2025)
Similar Items
-
Diversify, Contextualize, and Adapt: Efficient Entropy Modeling for Neural Image Codec
by: Kim, Jun-Hyuk, et al.
Published: (2024) -
Discovering and Mitigating Visual Biases through Keyword Explanation
by: Kim, Younghyun, et al.
Published: (2023) -
Neural Weight Compression for Language Models
by: Ryu, Jegwang, et al.
Published: (2025) -
Efficient Neural Video Representation with Temporally Coherent Modulation
by: Shin, Seungjun, et al.
Published: (2025) -
In Search of a Data Transformation That Accelerates Neural Field Training
by: Seo, Junwon, et al.
Published: (2023)