Scalable Image Coding for Humans and Machines Using Feature Fusion Network
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shindo, Takahiro, Watanabe, Taiju, Tatsumi, Yui, Watanabe, Hiroshi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Refining Coded Image in Human Vision Layer Using CNN-Based Post-Processing
par: Shindo, Takahiro, et autres
Publié: (2024)
par: Shindo, Takahiro, et autres
Publié: (2024)
Guided Diffusion for the Extension of Machine Vision to Human Visual Perception
par: Shindo, Takahiro, et autres
Publié: (2025)
par: Shindo, Takahiro, et autres
Publié: (2025)
Delta-ICM: Entropy Modeling with Delta Function for Learned Image Compression
par: Shindo, Takahiro, et autres
Publié: (2024)
par: Shindo, Takahiro, et autres
Publié: (2024)
Image Coding for Machines with Edge Information Learning Using Segment Anything
par: Shindo, Takahiro, et autres
Publié: (2024)
par: Shindo, Takahiro, et autres
Publié: (2024)
Training-Free Continuous Bitrate Control for Scalable Image Coding for Humans and Machines
par: Tatsumi, Yui, et autres
Publié: (2026)
par: Tatsumi, Yui, et autres
Publié: (2026)
Explicit Residual-Based Scalable Image Coding for Humans and Machines
par: Tatsumi, Yui, et autres
Publié: (2025)
par: Tatsumi, Yui, et autres
Publié: (2025)
Classification in Japanese Sign Language Based on Dynamic Facial Expressions
par: Tatsumi, Yui, et autres
Publié: (2024)
par: Tatsumi, Yui, et autres
Publié: (2024)
Training-Free Adaptive Quantization for Variable Rate Image Coding for Machines
par: Tatsumi, Yui, et autres
Publié: (2025)
par: Tatsumi, Yui, et autres
Publié: (2025)
Seed Selection for Human-Oriented Image Reconstruction via Guided Diffusion
par: Tatsumi, Yui, et autres
Publié: (2025)
par: Tatsumi, Yui, et autres
Publié: (2025)
FoodLogAthl-218: Constructing a Real-World Food Image Dataset Using Dietary Management Applications
par: Watanabe, Mitsuki, et autres
Publié: (2025)
par: Watanabe, Mitsuki, et autres
Publié: (2025)
Multiscale Feature Importance-based Bit Allocation for End-to-End Feature Coding for Machines
par: Liu, Junle, et autres
Publié: (2025)
par: Liu, Junle, et autres
Publié: (2025)
SFFNet: Synergistic Feature Fusion Network With Dual-Domain Edge Enhancement for UAV Image Object Detection
par: Zhang, Wenfeng, et autres
Publié: (2026)
par: Zhang, Wenfeng, et autres
Publié: (2026)
Multi-Modal Image Fusion via Intervention-Stable Feature Learning
par: Wang, Xue, et autres
Publié: (2026)
par: Wang, Xue, et autres
Publié: (2026)
SmartSplat: Feature-Smart Gaussians for Scalable Compression of Ultra-High-Resolution Images
par: Li, Linfei, et autres
Publié: (2025)
par: Li, Linfei, et autres
Publié: (2025)
Unified Coding for Both Human Perception and Generalized Machine Analytics with CLIP Supervision
par: Yin, Kangsheng, et autres
Publié: (2025)
par: Yin, Kangsheng, et autres
Publié: (2025)
Reinforcing Pre-trained Models Using Counterfactual Images
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
Depth and Image Fusion for Road Obstacle Detection Using Stereo Camera
par: Perezyabov, Oleg, et autres
Publié: (2025)
par: Perezyabov, Oleg, et autres
Publié: (2025)
Interactive Spatial-Frequency Fusion Mamba for Multi-Modal Image Fusion
par: Zhu, Yixin, et autres
Publié: (2026)
par: Zhu, Yixin, et autres
Publié: (2026)
TMFNet: Two-Stream Multi-Channels Fusion Networks for Color Image Operation Chain Detection
par: Niu, Yakun, et autres
Publié: (2024)
par: Niu, Yakun, et autres
Publié: (2024)
Cross-Attention Fusion of Visual and Geometric Features for Large Vocabulary Arabic Lipreading
par: Daou, Samar, et autres
Publié: (2024)
par: Daou, Samar, et autres
Publié: (2024)
MoRAG -- Multi-Fusion Retrieval Augmented Generation for Human Motion
par: Kalakonda, Sai Shashank, et autres
Publié: (2024)
par: Kalakonda, Sai Shashank, et autres
Publié: (2024)
Full-reference Point Cloud Quality Assessment Using Spectral Graph Wavelets
par: Watanabe, Ryosuke, et autres
Publié: (2024)
par: Watanabe, Ryosuke, et autres
Publié: (2024)
DT-UFC: Universal Large Model Feature Coding via Peaky-to-Balanced Distribution Transformation
par: Gao, Changsheng, et autres
Publié: (2025)
par: Gao, Changsheng, et autres
Publié: (2025)
P-GSVC: Layered Progressive 2D Gaussian Splatting for Scalable Image and Video
par: Wang, Longan, et autres
Publié: (2026)
par: Wang, Longan, et autres
Publié: (2026)
Joint Flow And Feature Refinement Using Attention For Video Restoration
par: Merugu, Ranjith, et autres
Publié: (2025)
par: Merugu, Ranjith, et autres
Publié: (2025)
DepthGait: Multi-Scale Cross-Level Feature Fusion of RGB-Derived Depth and Silhouette Sequences for Robust Gait Recognition
par: Li, Xinzhu, et autres
Publié: (2025)
par: Li, Xinzhu, et autres
Publié: (2025)
Residual Prior-driven Frequency-aware Network for Image Fusion
par: Zheng, Guan, et autres
Publié: (2025)
par: Zheng, Guan, et autres
Publié: (2025)
Transcending Fusion: A Multi-Scale Alignment Method for Remote Sensing Image-Text Retrieval
par: Yang, Rui, et autres
Publié: (2024)
par: Yang, Rui, et autres
Publié: (2024)
ROI-Guided Point Cloud Geometry Compression Towards Human and Machine Vision
par: Liang, Xie, et autres
Publié: (2025)
par: Liang, Xie, et autres
Publié: (2025)
GMFVAD: Using Grained Multi-modal Feature to Improve Video Anomaly Detection
par: Dai, Guangyu, et autres
Publié: (2025)
par: Dai, Guangyu, et autres
Publié: (2025)
Multi-modal Speech Emotion Recognition via Feature Distribution Adaptation Network
par: Li, Shaokai, et autres
Publié: (2024)
par: Li, Shaokai, et autres
Publié: (2024)
Predicting Satisfied User and Machine Ratio for Compressed Images: A Unified Approach
par: Zhang, Qi, et autres
Publié: (2024)
par: Zhang, Qi, et autres
Publié: (2024)
Single Image Dehazing Using Scene Depth Ordering
par: Ling, Pengyang, et autres
Publié: (2024)
par: Ling, Pengyang, et autres
Publié: (2024)
Dual-Branch Network for Portrait Image Quality Assessment
par: Sun, Wei, et autres
Publié: (2024)
par: Sun, Wei, et autres
Publié: (2024)
Multimodal Large Language Model is a Human-Aligned Annotator for Text-to-Image Generation
par: Wu, Xun, et autres
Publié: (2024)
par: Wu, Xun, et autres
Publié: (2024)
UniAnimate-DiT: Human Image Animation with Large-Scale Video Diffusion Transformer
par: Wang, Xiang, et autres
Publié: (2025)
par: Wang, Xiang, et autres
Publié: (2025)
Neural Video Representation for Redundancy Reduction and Consistency Preservation
par: Hayami, Taiga, et autres
Publié: (2024)
par: Hayami, Taiga, et autres
Publié: (2024)
Toward Scalable Image Feature Compression: A Content-Adaptive and Diffusion-Based Approach
par: Guo, Sha, et autres
Publié: (2024)
par: Guo, Sha, et autres
Publié: (2024)
Scalable Diffusion Models with State Space Backbone
par: Fei, Zhengcong, et autres
Publié: (2024)
par: Fei, Zhengcong, et autres
Publié: (2024)
FeatDistill: A Feature Distillation Enhanced Multi-Expert Ensemble Framework for Robust AI-generated Image Detection
par: Tu, Zhilin, et autres
Publié: (2026)
par: Tu, Zhilin, et autres
Publié: (2026)
Documents similaires
-
Refining Coded Image in Human Vision Layer Using CNN-Based Post-Processing
par: Shindo, Takahiro, et autres
Publié: (2024) -
Guided Diffusion for the Extension of Machine Vision to Human Visual Perception
par: Shindo, Takahiro, et autres
Publié: (2025) -
Delta-ICM: Entropy Modeling with Delta Function for Learned Image Compression
par: Shindo, Takahiro, et autres
Publié: (2024) -
Image Coding for Machines with Edge Information Learning Using Segment Anything
par: Shindo, Takahiro, et autres
Publié: (2024) -
Training-Free Continuous Bitrate Control for Scalable Image Coding for Humans and Machines
par: Tatsumi, Yui, et autres
Publié: (2026)