Improving Image Coding for Machines through Optimizing Encoder via Auxiliary Loss
Fuente:
arXiv
Salvato in:
| Autori principali: | Iino, Kei, Akamatsu, Shunsuke, Watanabe, Hiroshi, Enomoto, Shohei, Sakamoto, Akira, Eda, Takeharu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Inter-Feature-Map Differential Coding of Surveillance Video
di: Iino, Kei, et al.
Pubblicazione: (2024)
di: Iino, Kei, et al.
Pubblicazione: (2024)
Dynamic Test-Time Augmentation via Differentiable Functions
di: Enomoto, Shohei, et al.
Pubblicazione: (2022)
di: Enomoto, Shohei, et al.
Pubblicazione: (2022)
Test-time Adaptation Meets Image Enhancement: Improving Accuracy via Uncertainty-aware Logit Switching
di: Enomoto, Shohei, et al.
Pubblicazione: (2024)
di: Enomoto, Shohei, et al.
Pubblicazione: (2024)
Enhancing Visual Prompting through Expanded Transformation Space and Overfitting Mitigation
di: Enomoto, Shohei
Pubblicazione: (2025)
di: Enomoto, Shohei
Pubblicazione: (2025)
Neural Video Representation for Redundancy Reduction and Consistency Preservation
di: Hayami, Taiga, et al.
Pubblicazione: (2024)
di: Hayami, Taiga, et al.
Pubblicazione: (2024)
EntProp: High Entropy Propagation for Improving Accuracy and Robustness
di: Enomoto, Shohei
Pubblicazione: (2024)
di: Enomoto, Shohei
Pubblicazione: (2024)
Classification in Japanese Sign Language Based on Dynamic Facial Expressions
di: Tatsumi, Yui, et al.
Pubblicazione: (2024)
di: Tatsumi, Yui, et al.
Pubblicazione: (2024)
Pseudo Multi-Source Domain Generalization: Bridging the Gap Between Single and Multi-Source Domain Generalization
di: Enomoto, Shohei
Pubblicazione: (2025)
di: Enomoto, Shohei
Pubblicazione: (2025)
Image Coding for Machines with Edge Information Learning Using Segment Anything
di: Shindo, Takahiro, et al.
Pubblicazione: (2024)
di: Shindo, Takahiro, et al.
Pubblicazione: (2024)
Scalable Image Coding for Humans and Machines Using Feature Fusion Network
di: Shindo, Takahiro, et al.
Pubblicazione: (2024)
di: Shindo, Takahiro, et al.
Pubblicazione: (2024)
MultiModal Fine-tuning with Synthetic Captions
di: Enomoto, Shohei, et al.
Pubblicazione: (2026)
di: Enomoto, Shohei, et al.
Pubblicazione: (2026)
Training-Free Continuous Bitrate Control for Scalable Image Coding for Humans and Machines
di: Tatsumi, Yui, et al.
Pubblicazione: (2026)
di: Tatsumi, Yui, et al.
Pubblicazione: (2026)
Explicit Residual-Based Scalable Image Coding for Humans and Machines
di: Tatsumi, Yui, et al.
Pubblicazione: (2025)
di: Tatsumi, Yui, et al.
Pubblicazione: (2025)
Training-Free Adaptive Quantization for Variable Rate Image Coding for Machines
di: Tatsumi, Yui, et al.
Pubblicazione: (2025)
di: Tatsumi, Yui, et al.
Pubblicazione: (2025)
Improving Deep Representation Learning via Auxiliary Learnable Target Coding
di: Liu, Kangjun, et al.
Pubblicazione: (2023)
di: Liu, Kangjun, et al.
Pubblicazione: (2023)
Test-time Similarity Modification for Person Re-identification toward Temporal Distribution Shift
di: Adachi, Kazuki, et al.
Pubblicazione: (2024)
di: Adachi, Kazuki, et al.
Pubblicazione: (2024)
Seed Selection for Human-Oriented Image Reconstruction via Guided Diffusion
di: Tatsumi, Yui, et al.
Pubblicazione: (2025)
di: Tatsumi, Yui, et al.
Pubblicazione: (2025)
Refining Coded Image in Human Vision Layer Using CNN-Based Post-Processing
di: Shindo, Takahiro, et al.
Pubblicazione: (2024)
di: Shindo, Takahiro, et al.
Pubblicazione: (2024)
Adapting Image-to-Video Diffusion Models for Large-Motion Frame Interpolation
di: Jin, Luoxu, et al.
Pubblicazione: (2024)
di: Jin, Luoxu, et al.
Pubblicazione: (2024)
InterpIoU: Rethinking Bounding Box Regression with Interpolation-Based IoU Optimization
di: Liu, Haoyuan, et al.
Pubblicazione: (2025)
di: Liu, Haoyuan, et al.
Pubblicazione: (2025)
EnsemHalDet: Robust VLM Hallucination Detection via Ensemble of Internal State Detectors
di: Miyazato, Ryuhei, et al.
Pubblicazione: (2026)
di: Miyazato, Ryuhei, et al.
Pubblicazione: (2026)
Deformable Image Registration with Multi-scale Feature Fusion from Shared Encoder, Auxiliary and Pyramid Decoders
di: Zhou, Hongchao, et al.
Pubblicazione: (2024)
di: Zhou, Hongchao, et al.
Pubblicazione: (2024)
FlowLoss: Dynamic Flow-Conditioned Loss Strategy for Video Diffusion Models
di: Wu, Kuanting, et al.
Pubblicazione: (2025)
di: Wu, Kuanting, et al.
Pubblicazione: (2025)
OOS-DSD: Improving Out-of-stock Detection in Retail Images using Auxiliary Tasks
di: Šikić, Franko, et al.
Pubblicazione: (2025)
di: Šikić, Franko, et al.
Pubblicazione: (2025)
Correlates of Image Memorability in Vision Encoders: Activations, Attention Entropy, Patch Uniformity and Autoencoder Losses
di: Takmaz, Ece, et al.
Pubblicazione: (2025)
di: Takmaz, Ece, et al.
Pubblicazione: (2025)
Improving Domain Generalization on Gaze Estimation via Branch-out Auxiliary Regularization
di: Zhao, Ruijie, et al.
Pubblicazione: (2024)
di: Zhao, Ruijie, et al.
Pubblicazione: (2024)
Image Coding for Machines via Feature-Preserving Rate-Distortion Optimization
di: Fernández-Menduiña, Samuel, et al.
Pubblicazione: (2025)
di: Fernández-Menduiña, Samuel, et al.
Pubblicazione: (2025)
SR-NeRV: Improving Embedding Efficiency of Neural Video Representation via Super-Resolution
di: Hayami, Taiga, et al.
Pubblicazione: (2025)
di: Hayami, Taiga, et al.
Pubblicazione: (2025)
Optimizing Skin Lesion Classification via Multimodal Data and Auxiliary Task Integration
di: Khurshid, Mahapara, et al.
Pubblicazione: (2024)
di: Khurshid, Mahapara, et al.
Pubblicazione: (2024)
EasyControlEdge: A Foundation-Model Fine-Tuning for Edge Detection
di: Nakamura, Hiroki, et al.
Pubblicazione: (2026)
di: Nakamura, Hiroki, et al.
Pubblicazione: (2026)
PAT-VCM: Plug-and-Play Auxiliary Tokens for Video Coding for Machines
di: Jiang, Wei, et al.
Pubblicazione: (2026)
di: Jiang, Wei, et al.
Pubblicazione: (2026)
Accurate and Efficient Surface Reconstruction from Point Clouds via Geometry-Aware Local Adaptation
di: Ogawa, Eito, et al.
Pubblicazione: (2025)
di: Ogawa, Eito, et al.
Pubblicazione: (2025)
Guided Diffusion for the Extension of Machine Vision to Human Visual Perception
di: Shindo, Takahiro, et al.
Pubblicazione: (2025)
di: Shindo, Takahiro, et al.
Pubblicazione: (2025)
A Novel Generator with Auxiliary Branch for Improving GAN Performance
di: Park, Seung, et al.
Pubblicazione: (2021)
di: Park, Seung, et al.
Pubblicazione: (2021)
Encoder-Only Image Registration
di: Chen, Xiang, et al.
Pubblicazione: (2025)
di: Chen, Xiang, et al.
Pubblicazione: (2025)
Beyond the Encoder: Joint Encoder-Decoder Contrastive Pre-Training Improves Dense Prediction
di: Quetin, Sébastien, et al.
Pubblicazione: (2025)
di: Quetin, Sébastien, et al.
Pubblicazione: (2025)
CodeV: Code with Images for Faithful Visual Reasoning via Tool-Aware Policy Optimization
di: Hou, Xinhai, et al.
Pubblicazione: (2025)
di: Hou, Xinhai, et al.
Pubblicazione: (2025)
Contrastive Learning through Auxiliary Branch for Video Object Detection
di: Rakotoarivony, Lucas
Pubblicazione: (2025)
di: Rakotoarivony, Lucas
Pubblicazione: (2025)
A Cat Is A Cat (Not A Dog!): Unraveling Information Mix-ups in Text-to-Image Encoders through Causal Analysis and Embedding Optimization
di: Chen, Chieh-Yun, et al.
Pubblicazione: (2024)
di: Chen, Chieh-Yun, et al.
Pubblicazione: (2024)
Fuse after Align: Improving Face-Voice Association Learning via Multimodal Encoder
di: Peng, Chong, et al.
Pubblicazione: (2024)
di: Peng, Chong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Inter-Feature-Map Differential Coding of Surveillance Video
di: Iino, Kei, et al.
Pubblicazione: (2024) -
Dynamic Test-Time Augmentation via Differentiable Functions
di: Enomoto, Shohei, et al.
Pubblicazione: (2022) -
Test-time Adaptation Meets Image Enhancement: Improving Accuracy via Uncertainty-aware Logit Switching
di: Enomoto, Shohei, et al.
Pubblicazione: (2024) -
Enhancing Visual Prompting through Expanded Transformation Space and Overfitting Mitigation
di: Enomoto, Shohei
Pubblicazione: (2025) -
Neural Video Representation for Redundancy Reduction and Consistency Preservation
di: Hayami, Taiga, et al.
Pubblicazione: (2024)