Machine Perception-Driven Image Compression: A Layered Generative Approach
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Yuefeng, Jia, Chuanmin, Chang, Jiannhui, Ma, Siwei |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
CAMSIC: Content-aware Masked Image Modeling Transformer for Stereo Image Compression
by: Zhang, Xinjie, et al.
Published: (2024)
by: Zhang, Xinjie, et al.
Published: (2024)
GaussianImage: 1000 FPS Image Representation and Compression by 2D Gaussian Splatting
by: Zhang, Xinjie, et al.
Published: (2024)
by: Zhang, Xinjie, et al.
Published: (2024)
A Joint Visual Compression and Perception Framework for Neuralmorphic Spiking Camera
by: Feng, Kexiang, et al.
Published: (2025)
by: Feng, Kexiang, et al.
Published: (2025)
End-to-End RGB-IR Joint Image Compression With Channel-wise Cross-modality Entropy Model
by: Wang, Haofeng, et al.
Published: (2025)
by: Wang, Haofeng, et al.
Published: (2025)
DietDelta: A Vision-Language Approach for Dietary Assessment via Before-and-After Images
by: Vinod, Gautham, et al.
Published: (2026)
by: Vinod, Gautham, et al.
Published: (2026)
RAISE: Realness Assessment for Image Synthesis and Evaluation
by: Mukherjee, Aniruddha, et al.
Published: (2025)
by: Mukherjee, Aniruddha, et al.
Published: (2025)
Towards Point Cloud Compression for Machine Perception: A Simple and Strong Baseline by Learning the Octree Depth Level Predictor
by: Liu, Lei, et al.
Published: (2024)
by: Liu, Lei, et al.
Published: (2024)
VineetVC: Adaptive Video Conferencing Under Severe Bandwidth Constraints Using Audio-Driven Talking-Head Reconstruction
by: Rakesh, Vineet Kumar, et al.
Published: (2026)
by: Rakesh, Vineet Kumar, et al.
Published: (2026)
SurFITR: A Dataset for Surveillance Image Forgery Detection and Localisation
by: Wang, Qizhou, et al.
Published: (2026)
by: Wang, Qizhou, et al.
Published: (2026)
PixelBoost: Leveraging Brownian Motion for Realistic-Image Super-Resolution
by: Mishra, Aradhana, et al.
Published: (2025)
by: Mishra, Aradhana, et al.
Published: (2025)
ML-CLIPSim: Multi-Layer CLIP Similarity for Machine-Oriented Image Quality
by: Ding, Feng, et al.
Published: (2026)
by: Ding, Feng, et al.
Published: (2026)
Generative Preprocessing for Image Compression with Pre-trained Diffusion Models
by: Guo, Mengxi, et al.
Published: (2025)
by: Guo, Mengxi, et al.
Published: (2025)
Toward Scalable Image Feature Compression: A Content-Adaptive and Diffusion-Based Approach
by: Guo, Sha, et al.
Published: (2024)
by: Guo, Sha, et al.
Published: (2024)
Once-for-All: Controllable Generative Image Compression with Dynamic Granularity Adaptation
by: Li, Anqi, et al.
Published: (2024)
by: Li, Anqi, et al.
Published: (2024)
CAMP-VQA: Caption-Embedded Multimodal Perception for No-Reference Quality Assessment of Compressed Video
by: Wang, Xinyi, et al.
Published: (2025)
by: Wang, Xinyi, et al.
Published: (2025)
Automated Retinal Image Analysis and Medical Report Generation through Deep Learning
by: Huang, Jia-Hong
Published: (2024)
by: Huang, Jia-Hong
Published: (2024)
Image Quality Assessment: From Human to Machine Preference
by: Li, Chunyi, et al.
Published: (2025)
by: Li, Chunyi, et al.
Published: (2025)
Transferable Learned Image Compression-Resistant Adversarial Perturbations
by: Sui, Yang, et al.
Published: (2024)
by: Sui, Yang, et al.
Published: (2024)
Learned Image Compression with Hierarchical Progressive Context Modeling
by: Li, Yuqi, et al.
Published: (2025)
by: Li, Yuqi, et al.
Published: (2025)
Channel-wise Feature Decorrelation for Enhanced Learned Image Compression
by: Pakdaman, Farhad, et al.
Published: (2024)
by: Pakdaman, Farhad, et al.
Published: (2024)
Dynamic Kernel-Based Adaptive Spatial Aggregation for Learned Image Compression
by: Wang, Huairui, et al.
Published: (2023)
by: Wang, Huairui, et al.
Published: (2023)
Enhancing Learned Image Compression via Cross Window-based Attention
by: Mudgal, Priyanka, et al.
Published: (2024)
by: Mudgal, Priyanka, et al.
Published: (2024)
Towards Real-world Video Face Restoration: A New Benchmark
by: Chen, Ziyan, et al.
Published: (2024)
by: Chen, Ziyan, et al.
Published: (2024)
EVAN: Evolutional Video Streaming Adaptation via Neural Representation
by: Liu, Mufan, et al.
Published: (2024)
by: Liu, Mufan, et al.
Published: (2024)
Change Detection Between Optical Remote Sensing Imagery and Map Data via Segment Anything Model (SAM)
by: Chen, Hongruixuan, et al.
Published: (2024)
by: Chen, Hongruixuan, et al.
Published: (2024)
Visual and Text Prompt Segmentation: A Novel Multi-Model Framework for Remote Sensing
by: Zi, Xing, et al.
Published: (2025)
by: Zi, Xing, et al.
Published: (2025)
Towards Blind Bitstream-corrupted Video Recovery via a Visual Foundation Model-driven Framework
by: Liu, Tianyi, et al.
Published: (2025)
by: Liu, Tianyi, et al.
Published: (2025)
Food Portion Estimation: From Pixels to Calories
by: Vinod, Gautham, et al.
Published: (2026)
by: Vinod, Gautham, et al.
Published: (2026)
From Darkness to Detail: Frequency-Aware SSMs for Low-Light Vision
by: Adhikarla, Eashan, et al.
Published: (2024)
by: Adhikarla, Eashan, et al.
Published: (2024)
Optimal Transcoding Resolution Prediction for Efficient Per-Title Bitrate Ladder Estimation
by: Yang, Jinhai, et al.
Published: (2024)
by: Yang, Jinhai, et al.
Published: (2024)
Movie Trailer Genre Classification Using Multimodal Pretrained Features
by: Sulun, Serkan, et al.
Published: (2024)
by: Sulun, Serkan, et al.
Published: (2024)
Perceptual Learned Image Compression via End-to-End JND-Based Optimization
by: Pakdaman, Farhad, et al.
Published: (2024)
by: Pakdaman, Farhad, et al.
Published: (2024)
HiDE: Hierarchical Dictionary-Based Entropy Modeling for Learned Image Compression
by: Xiong, Haoxuan, et al.
Published: (2026)
by: Xiong, Haoxuan, et al.
Published: (2026)
d-Sketch: Improving Visual Fidelity of Sketch-to-Image Translation with Pretrained Latent Diffusion Models without Retraining
by: Roy, Prasun, et al.
Published: (2025)
by: Roy, Prasun, et al.
Published: (2025)
DrawVideo: Generating Long Video from Storyboard Keyframe Sketches
by: Xu, Chuanzhi, et al.
Published: (2026)
by: Xu, Chuanzhi, et al.
Published: (2026)
Not Your Stereo-Typical Estimator: Combining Vision and Language for Volume Perception
by: Vinod, Gautham, et al.
Published: (2026)
by: Vinod, Gautham, et al.
Published: (2026)
Hierarchical Prior-based Super Resolution for Point Cloud Geometry Compression
by: Li, Dingquan, et al.
Published: (2024)
by: Li, Dingquan, et al.
Published: (2024)
LLIC: Large Receptive Field Transform Coding with Adaptive Weights for Learned Image Compression
by: Jiang, Wei, et al.
Published: (2023)
by: Jiang, Wei, et al.
Published: (2023)
Variable Rate Image Compression via N-Gram Context based Swin-transformer
by: Mudgal, Priyanka
Published: (2025)
by: Mudgal, Priyanka
Published: (2025)
ReCon-GS: Continuum-Preserved Gaussian Streaming for Fast and Compact Reconstruction of Dynamic Scenes
by: Fu, Jiaye, et al.
Published: (2025)
by: Fu, Jiaye, et al.
Published: (2025)
Similar Items
-
CAMSIC: Content-aware Masked Image Modeling Transformer for Stereo Image Compression
by: Zhang, Xinjie, et al.
Published: (2024) -
GaussianImage: 1000 FPS Image Representation and Compression by 2D Gaussian Splatting
by: Zhang, Xinjie, et al.
Published: (2024) -
A Joint Visual Compression and Perception Framework for Neuralmorphic Spiking Camera
by: Feng, Kexiang, et al.
Published: (2025) -
End-to-End RGB-IR Joint Image Compression With Channel-wise Cross-modality Entropy Model
by: Wang, Haofeng, et al.
Published: (2025) -
DietDelta: A Vision-Language Approach for Dietary Assessment via Before-and-After Images
by: Vinod, Gautham, et al.
Published: (2026)