A Rate-Distortion-Classification Approach for Lossy Image Compression
Fuente:
arXiv
Salvato in:
| Autore principale: | Zhang, Yuefeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Adaptive Rate Control for Deep Video Compression with Rate-Distortion Prediction
di: Gu, Bowen, et al.
Pubblicazione: (2024)
di: Gu, Bowen, et al.
Pubblicazione: (2024)
End-to-End Optimized Image Compression with the Frequency-Oriented Transform
di: Zhang, Yuefeng, et al.
Pubblicazione: (2024)
di: Zhang, Yuefeng, et al.
Pubblicazione: (2024)
Machine Perception-Driven Image Compression: A Layered Generative Approach
di: Zhang, Yuefeng, et al.
Pubblicazione: (2023)
di: Zhang, Yuefeng, et al.
Pubblicazione: (2023)
Universal Representations for Classification-enhanced Lossy Compression
di: Nguyen, Nam
Pubblicazione: (2025)
di: Nguyen, Nam
Pubblicazione: (2025)
CrisisViT: A Robust Vision Transformer for Crisis Image Classification
di: Long, Zijun, et al.
Pubblicazione: (2024)
di: Long, Zijun, et al.
Pubblicazione: (2024)
A Comprehensive Survey on Composed Image Retrieval
di: Song, Xuemeng, et al.
Pubblicazione: (2025)
di: Song, Xuemeng, et al.
Pubblicazione: (2025)
JPEG AI Image Compression Visual Artifacts: Detection Methods and Dataset
di: Tsereh, Daria, et al.
Pubblicazione: (2024)
di: Tsereh, Daria, et al.
Pubblicazione: (2024)
Feature CAM: Interpretable AI in Image Classification
di: Clement, Frincy, et al.
Pubblicazione: (2024)
di: Clement, Frincy, et al.
Pubblicazione: (2024)
Robust Latent Representation Tuning for Image-text Classification
di: Sun, Hao, et al.
Pubblicazione: (2024)
di: Sun, Hao, et al.
Pubblicazione: (2024)
LazyVLM: Neuro-Symbolic Approach to Video Analytics
di: Jian, Xiangru, et al.
Pubblicazione: (2025)
di: Jian, Xiangru, et al.
Pubblicazione: (2025)
A Survey of Multimodal Composite Editing and Retrieval
di: Li, Suyan, et al.
Pubblicazione: (2024)
di: Li, Suyan, et al.
Pubblicazione: (2024)
Towards Efficient Low-rate Image Compression with Frequency-aware Diffusion Prior Refinement
di: Xia, Yichong, et al.
Pubblicazione: (2026)
di: Xia, Yichong, et al.
Pubblicazione: (2026)
Extreme Compression of Adaptive Neural Images
di: Hoshikawa, Leo, et al.
Pubblicazione: (2024)
di: Hoshikawa, Leo, et al.
Pubblicazione: (2024)
MimicMotion: High-Quality Human Motion Video Generation with Confidence-aware Pose Guidance
di: Zhang, Yuang, et al.
Pubblicazione: (2024)
di: Zhang, Yuang, et al.
Pubblicazione: (2024)
Balancing Privacy and Action Performance: A Penalty-Driven Approach to Image Anonymization
di: Aslam, Nazia, et al.
Pubblicazione: (2025)
di: Aslam, Nazia, et al.
Pubblicazione: (2025)
Cross-Modal Retrieval with Cauchy-Schwarz Divergence
di: Zhang, Jiahao, et al.
Pubblicazione: (2025)
di: Zhang, Jiahao, et al.
Pubblicazione: (2025)
HSVLT: Hierarchical Scale-Aware Vision-Language Transformer for Multi-Label Image Classification
di: Ouyang, Shuyi, et al.
Pubblicazione: (2024)
di: Ouyang, Shuyi, et al.
Pubblicazione: (2024)
PhotoBench: Beyond Visual Matching Towards Personalized Intent-Driven Photo Retrieval
di: Xu, Tianyi, et al.
Pubblicazione: (2026)
di: Xu, Tianyi, et al.
Pubblicazione: (2026)
MagicLens: Self-Supervised Image Retrieval with Open-Ended Instructions
di: Zhang, Kai, et al.
Pubblicazione: (2024)
di: Zhang, Kai, et al.
Pubblicazione: (2024)
3D-LMVIC: Learning-based Multi-View Image Coding with 3D Gaussian Geometric Priors
di: Huang, Yujun, et al.
Pubblicazione: (2024)
di: Huang, Yujun, et al.
Pubblicazione: (2024)
A Matter of Time: Revealing the Structure of Time in Vision-Language Models
di: Tekaya, Nidham, et al.
Pubblicazione: (2025)
di: Tekaya, Nidham, et al.
Pubblicazione: (2025)
ROI-based Deep Image Compression with Implicit Bit Allocation
di: Hu, Kai, et al.
Pubblicazione: (2025)
di: Hu, Kai, et al.
Pubblicazione: (2025)
An Empirical Study of Excitation and Aggregation Design Adaptions in CLIP4Clip for Video-Text Retrieval
di: Jing, Xiaolun, et al.
Pubblicazione: (2024)
di: Jing, Xiaolun, et al.
Pubblicazione: (2024)
MIRe: Enhancing Multimodal Queries Representation via Fusion-Free Modality Interaction for Multimodal Retrieval
di: Ju, Yeong-Joon, et al.
Pubblicazione: (2024)
di: Ju, Yeong-Joon, et al.
Pubblicazione: (2024)
The CASTLE 2024 Dataset: Advancing the Art of Multimodal Understanding
di: Rossetto, Luca, et al.
Pubblicazione: (2025)
di: Rossetto, Luca, et al.
Pubblicazione: (2025)
GMMFormer: Gaussian-Mixture-Model Based Transformer for Efficient Partially Relevant Video Retrieval
di: Wang, Yuting, et al.
Pubblicazione: (2023)
di: Wang, Yuting, et al.
Pubblicazione: (2023)
Multi-Modal Cross-Domain Alignment Network for Video Moment Retrieval
di: Fang, Xiang, et al.
Pubblicazione: (2022)
di: Fang, Xiang, et al.
Pubblicazione: (2022)
Beyond Final Answers: CRYSTAL Benchmark for Transparent Multimodal Reasoning Evaluation
di: Barrios, Wayner, et al.
Pubblicazione: (2026)
di: Barrios, Wayner, et al.
Pubblicazione: (2026)
VeriTaS: The First Dynamic Benchmark for Multimodal Automated Fact-Checking
di: Rothermel, Mark, et al.
Pubblicazione: (2026)
di: Rothermel, Mark, et al.
Pubblicazione: (2026)
Very Efficient Listwise Multimodal Reranking for Long Documents
di: Sun, Yiqun, et al.
Pubblicazione: (2026)
di: Sun, Yiqun, et al.
Pubblicazione: (2026)
PromptHash: Affinity-Prompted Collaborative Cross-Modal Learning for Adaptive Hashing Retrieval
di: Zou, Qiang, et al.
Pubblicazione: (2025)
di: Zou, Qiang, et al.
Pubblicazione: (2025)
Epistemic-aware Vision-Language Foundation Model for Fetal Ultrasound Interpretation
di: He, Xiao, et al.
Pubblicazione: (2025)
di: He, Xiao, et al.
Pubblicazione: (2025)
Compressed Deepfake Video Detection Based on 3D Spatiotemporal Trajectories
di: Chen, Zongmei, et al.
Pubblicazione: (2024)
di: Chen, Zongmei, et al.
Pubblicazione: (2024)
AdaCoder: Adaptive Prompt Compression for Programmatic Visual Question Answering
di: Ukai, Mahiro, et al.
Pubblicazione: (2024)
di: Ukai, Mahiro, et al.
Pubblicazione: (2024)
Generative Cross-Modal Retrieval: Memorizing Images in Multimodal Language Models for Retrieval and Beyond
di: Li, Yongqi, et al.
Pubblicazione: (2024)
di: Li, Yongqi, et al.
Pubblicazione: (2024)
Harnessing Self-Supervised Features for Art Classification
di: Melis, Federico, et al.
Pubblicazione: (2026)
di: Melis, Federico, et al.
Pubblicazione: (2026)
MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering
di: Xiao, Junbin, et al.
Pubblicazione: (2026)
di: Xiao, Junbin, et al.
Pubblicazione: (2026)
PC$^2$: Pseudo-Classification Based Pseudo-Captioning for Noisy Correspondence Learning in Cross-Modal Retrieval
di: Duan, Yue, et al.
Pubblicazione: (2024)
di: Duan, Yue, et al.
Pubblicazione: (2024)
A User-Friendly Framework for Generating Model-Preferred Prompts in Text-to-Image Synthesis
di: Hei, Nailei, et al.
Pubblicazione: (2024)
di: Hei, Nailei, et al.
Pubblicazione: (2024)
Composing Concepts from Images and Videos via Concept-prompt Binding
di: Kong, Xianghao, et al.
Pubblicazione: (2025)
di: Kong, Xianghao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Adaptive Rate Control for Deep Video Compression with Rate-Distortion Prediction
di: Gu, Bowen, et al.
Pubblicazione: (2024) -
End-to-End Optimized Image Compression with the Frequency-Oriented Transform
di: Zhang, Yuefeng, et al.
Pubblicazione: (2024) -
Machine Perception-Driven Image Compression: A Layered Generative Approach
di: Zhang, Yuefeng, et al.
Pubblicazione: (2023) -
Universal Representations for Classification-enhanced Lossy Compression
di: Nguyen, Nam
Pubblicazione: (2025) -
CrisisViT: A Robust Vision Transformer for Crisis Image Classification
di: Long, Zijun, et al.
Pubblicazione: (2024)