Improving Image De-raining Using Reference-Guided Transformers
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ye, Zihao, Cho, Jaehoon, Oh, Changjae |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Prototype Unit for Image De-raining using Time-Lapse Data
par: Cho, Jaehoon, et autres
Publié: (2024)
par: Cho, Jaehoon, et autres
Publié: (2024)
The Detector Teaches Itself: Lightweight Self-Supervised Adaptation for Open-Vocabulary Object Detection
par: Wan, Yazhe, et autres
Publié: (2026)
par: Wan, Yazhe, et autres
Publié: (2026)
Chain-of-Caption: Training-free improvement of multimodal large language model on referring expression comprehension
par: Pang, Yik Lung, et autres
Publié: (2026)
par: Pang, Yik Lung, et autres
Publié: (2026)
Improving Generalization of Language-Conditioned Robot Manipulation
par: Cui, Chenglin, et autres
Publié: (2025)
par: Cui, Chenglin, et autres
Publié: (2025)
FlowOVD: Learning Generative Latent Flows for Zero-shot Open-vocabulary Detection
par: Wei, Yao, et autres
Publié: (2026)
par: Wei, Yao, et autres
Publié: (2026)
Diffusion-driven GAN Inversion for Multi-Modal Face Image Generation
par: Kim, Jihyun, et autres
Publié: (2024)
par: Kim, Jihyun, et autres
Publié: (2024)
Sparse multi-view hand-object reconstruction for unseen environments
par: Pang, Yik Lung, et autres
Publié: (2024)
par: Pang, Yik Lung, et autres
Publié: (2024)
Elevating Flow-Guided Video Inpainting with Reference Generation
par: Cho, Suhwan, et autres
Publié: (2024)
par: Cho, Suhwan, et autres
Publié: (2024)
Learning by Erasing: Conditional Entropy based Transferable Out-Of-Distribution Detection
par: Xing, Meng, et autres
Publié: (2022)
par: Xing, Meng, et autres
Publié: (2022)
Adaptive Multi-Modal Control of Digital Human Hand Synthesis Using a Region-Aware Cycle Loss
par: Fu, Qifan, et autres
Publié: (2024)
par: Fu, Qifan, et autres
Publié: (2024)
HanDrawer: Leveraging Spatial Information to Render Realistic Hands Using a Conditional Diffusion Model in Single Stage
par: Fu, Qifan, et autres
Publié: (2025)
par: Fu, Qifan, et autres
Publié: (2025)
TransRef: Multi-Scale Reference Embedding Transformer for Reference-Guided Image Inpainting
par: Liu, Taorong, et autres
Publié: (2023)
par: Liu, Taorong, et autres
Publié: (2023)
Open-vocabulary object 6D pose estimation
par: Corsetti, Jaime, et autres
Publié: (2023)
par: Corsetti, Jaime, et autres
Publié: (2023)
Stereo Hand-Object Reconstruction for Human-to-Robot Handover
par: Pang, Yik Lung, et autres
Publié: (2024)
par: Pang, Yik Lung, et autres
Publié: (2024)
Learning human-to-robot handovers through 3D scene reconstruction
par: Wu, Yuekun, et autres
Publié: (2025)
par: Wu, Yuekun, et autres
Publié: (2025)
High-resolution open-vocabulary object 6D pose estimation
par: Corsetti, Jaime, et autres
Publié: (2024)
par: Corsetti, Jaime, et autres
Publié: (2024)
Improved Masked Image Generation with Knowledge-Augmented Token Representations
par: Liang, Guotao, et autres
Publié: (2025)
par: Liang, Guotao, et autres
Publié: (2025)
Toward Human-Robot Teaming: Learning Handover Behaviors from 3D Scenes
par: Wu, Yuekun, et autres
Publié: (2025)
par: Wu, Yuekun, et autres
Publié: (2025)
Transforming Static Images Using Generative Models for Video Salient Object Detection
par: Cho, Suhwan, et autres
Publié: (2024)
par: Cho, Suhwan, et autres
Publié: (2024)
Griffin: Generative Reference and Layout Guided Image Composition
par: Mikaeili, Aryan, et autres
Publié: (2025)
par: Mikaeili, Aryan, et autres
Publié: (2025)
AeroReformer: Aerial Referring Transformer for UAV-based Referring Image Segmentation
par: Li, Rui, et autres
Publié: (2025)
par: Li, Rui, et autres
Publié: (2025)
Contrastive Local Manifold Learning for No-Reference Image Quality Assessment
par: Huang, Zihao, et autres
Publié: (2024)
par: Huang, Zihao, et autres
Publié: (2024)
Brain-Streams: fMRI-to-Image Reconstruction with Multi-modal Guidance
par: Joo, Jaehoon, et autres
Publié: (2024)
par: Joo, Jaehoon, et autres
Publié: (2024)
Cross-aware Early Fusion with Stage-divided Vision and Language Transformer Encoders for Referring Image Segmentation
par: Cho, Yubin, et autres
Publié: (2024)
par: Cho, Yubin, et autres
Publié: (2024)
Preference-Guided Debiasing for No-Reference Enhancement Image Quality Assessment
par: Gao, Shiqi, et autres
Publié: (2026)
par: Gao, Shiqi, et autres
Publié: (2026)
Towards Better De-raining Generalization via Rainy Characteristics Memorization and Replay
par: Wang, Kunyu, et autres
Publié: (2025)
par: Wang, Kunyu, et autres
Publié: (2025)
ImageRAG: Dynamic Image Retrieval for Reference-Guided Image Generation
par: Shalev-Arkushin, Rotem, et autres
Publié: (2025)
par: Shalev-Arkushin, Rotem, et autres
Publié: (2025)
Key-point Guided Deformable Image Manipulation Using Diffusion Model
par: Oh, Seok-Hwan, et autres
Publié: (2024)
par: Oh, Seok-Hwan, et autres
Publié: (2024)
Durian: Dual Reference Image-Guided Portrait Animation with Attribute Transfer
par: Cha, Hyunsoo, et autres
Publié: (2025)
par: Cha, Hyunsoo, et autres
Publié: (2025)
Progressive Prompt-Guided Cross-Modal Reasoning for Referring Image Segmentation
par: Li, Jiachen, et autres
Publié: (2026)
par: Li, Jiachen, et autres
Publié: (2026)
EviRCOD: Evidence-Guided Probabilistic Decoding for Referring Camouflaged Object Detection
par: Wang, Ye, et autres
Publié: (2026)
par: Wang, Ye, et autres
Publié: (2026)
ContactGen: Contact-Guided Interactive 3D Human Generation for Partners
par: Gu, Dongjun, et autres
Publié: (2024)
par: Gu, Dongjun, et autres
Publié: (2024)
GSFixer: Improving 3D Gaussian Splatting with Reference-Guided Video Diffusion Priors
par: Yin, Xingyilang, et autres
Publié: (2025)
par: Yin, Xingyilang, et autres
Publié: (2025)
RefMask3D: Language-Guided Transformer for 3D Referring Segmentation
par: He, Shuting, et autres
Publié: (2024)
par: He, Shuting, et autres
Publié: (2024)
MangaDiT: Reference-Guided Line Art Colorization with Hierarchical Attention in Diffusion Transformers
par: Qiu, Qianru, et autres
Publié: (2025)
par: Qiu, Qianru, et autres
Publié: (2025)
ConTEXTure: Consistent Multiview Images to Texture
par: Ahn, Jaehoon, et autres
Publié: (2024)
par: Ahn, Jaehoon, et autres
Publié: (2024)
Channel Attention-Guided Cross-Modal Knowledge Distillation for Referring Image Segmentation
par: Yang, Chen
Publié: (2026)
par: Yang, Chen
Publié: (2026)
You Only Pose Once: A Minimalist's Detection Transformer for Monocular RGB Category-level 9D Multi-Object Pose Estimation
par: Lee, Hakjin, et autres
Publié: (2025)
par: Lee, Hakjin, et autres
Publié: (2025)
Learning Object-Centric Representations in SAR Images with Multi-Level Feature Fusion
par: Jang, Oh-Tae, et autres
Publié: (2025)
par: Jang, Oh-Tae, et autres
Publié: (2025)
TP3M: Transformer-based Pseudo 3D Image Matching with Reference Image
par: Han, Liming, et autres
Publié: (2024)
par: Han, Liming, et autres
Publié: (2024)
Documents similaires
-
A Prototype Unit for Image De-raining using Time-Lapse Data
par: Cho, Jaehoon, et autres
Publié: (2024) -
The Detector Teaches Itself: Lightweight Self-Supervised Adaptation for Open-Vocabulary Object Detection
par: Wan, Yazhe, et autres
Publié: (2026) -
Chain-of-Caption: Training-free improvement of multimodal large language model on referring expression comprehension
par: Pang, Yik Lung, et autres
Publié: (2026) -
Improving Generalization of Language-Conditioned Robot Manipulation
par: Cui, Chenglin, et autres
Publié: (2025) -
FlowOVD: Learning Generative Latent Flows for Zero-shot Open-vocabulary Detection
par: Wei, Yao, et autres
Publié: (2026)