Retrieval Augmented Image Harmonization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Haolin, Liu, Ming, Yan, Zifei, Zhou, Chao, Xiao, Longan, Zuo, Wangmeng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Learning Spatially Decoupled Color Representations for Facial Image Colorization
par: Zhu, Hangyan, et autres
Publié: (2024)
par: Zhu, Hangyan, et autres
Publié: (2024)
GLAD: Towards Better Reconstruction with Global and Local Adaptive Diffusion Models for Unsupervised Anomaly Detection
par: Yao, Hang, et autres
Publié: (2024)
par: Yao, Hang, et autres
Publié: (2024)
Deblur4DGS: 4D Gaussian Splatting from Blurry Monocular Video
par: Wu, Renlong, et autres
Publié: (2024)
par: Wu, Renlong, et autres
Publié: (2024)
Combining Generative and Geometry Priors for Wide-Angle Portrait Correction
par: Yao, Lan, et autres
Publié: (2024)
par: Yao, Lan, et autres
Publié: (2024)
Exposure Bracketing Is All You Need For A High-Quality Image
par: Zhang, Zhilu, et autres
Publié: (2024)
par: Zhang, Zhilu, et autres
Publié: (2024)
OPERA: An Agent for Image Restoration with End-to-End Joint Planning-Execution Optimization
par: Zhu, Feng, et autres
Publié: (2026)
par: Zhu, Feng, et autres
Publié: (2026)
Triad: Empowering LMM-based Anomaly Detection with Vision Expert-guided Visual Tokenizer and Manufacturing Process
par: Li, Yuanze, et autres
Publié: (2025)
par: Li, Yuanze, et autres
Publié: (2025)
Leveraging Retrieval Augment Approach for Multimodal Emotion Recognition Under Missing Modalities
par: Fan, Qi, et autres
Publié: (2024)
par: Fan, Qi, et autres
Publié: (2024)
Enhanced Generative Structure Prior for Chinese Text Image Super-resolution
par: Li, Xiaoming, et autres
Publié: (2025)
par: Li, Xiaoming, et autres
Publié: (2025)
Myriad: Large Multimodal Model by Applying Vision Experts for Industrial Anomaly Detection
par: Li, Yuanze, et autres
Publié: (2023)
par: Li, Yuanze, et autres
Publié: (2023)
Self-Supervised High Dynamic Range Imaging with Multi-Exposure Images in Dynamic Scenes
par: Zhang, Zhilu, et autres
Publié: (2023)
par: Zhang, Zhilu, et autres
Publié: (2023)
P-GSVC: Layered Progressive 2D Gaussian Splatting for Scalable Image and Video
par: Wang, Longan, et autres
Publié: (2026)
par: Wang, Longan, et autres
Publié: (2026)
Image Demoiréing Using Dual Camera Fusion on Mobile Phones
par: Mei, Yanting, et autres
Publié: (2025)
par: Mei, Yanting, et autres
Publié: (2025)
Personalized Image Generation with Deep Generative Models: A Decade Survey
par: Wei, Yuxiang, et autres
Publié: (2025)
par: Wei, Yuxiang, et autres
Publié: (2025)
NIR-Assisted Image Denoising: A Selective Fusion Approach and A Real-World Benchmark Dataset
par: Xu, Rongjian, et autres
Publié: (2024)
par: Xu, Rongjian, et autres
Publié: (2024)
Diffusion-Enhanced Test-time Adaptation with Text and Image Augmentation
par: Feng, Chun-Mei, et autres
Publié: (2024)
par: Feng, Chun-Mei, et autres
Publié: (2024)
AnimateAnywhere: Rouse the Background in Human Image Animation
par: Liu, Xiaoyu, et autres
Publié: (2025)
par: Liu, Xiaoyu, et autres
Publié: (2025)
FramePainter: Endowing Interactive Image Editing with Video Diffusion Priors
par: Zhang, Yabo, et autres
Publié: (2025)
par: Zhang, Yabo, et autres
Publié: (2025)
LPT++: Efficient Training on Mixture of Long-tailed Experts
par: Dong, Bowen, et autres
Publié: (2024)
par: Dong, Bowen, et autres
Publié: (2024)
Lie Flow: Video Dynamic Fields Modeling and Predicting with Lie Algebra as Geometric Physics Principle
par: Qiao, Weidong, et autres
Publié: (2026)
par: Qiao, Weidong, et autres
Publié: (2026)
PLACE: Adaptive Layout-Semantic Fusion for Semantic Image Synthesis
par: Lv, Zhengyao, et autres
Publié: (2024)
par: Lv, Zhengyao, et autres
Publié: (2024)
AR-GRPO: Training Autoregressive Image Generation Models via Reinforcement Learning
par: Yuan, Shihao, et autres
Publié: (2025)
par: Yuan, Shihao, et autres
Publié: (2025)
MetricDepth: Enhancing Monocular Depth Estimation with Deep Metric Learning
par: Liu, Chunpu, et autres
Publié: (2024)
par: Liu, Chunpu, et autres
Publié: (2024)
Rethinking Transformer-Based Blind-Spot Network for Self-Supervised Image Denoising
par: Li, Junyi, et autres
Publié: (2024)
par: Li, Junyi, et autres
Publié: (2024)
ACE: Anti-Editing Concept Erasure in Text-to-Image Models
par: Wang, Zihao, et autres
Publié: (2025)
par: Wang, Zihao, et autres
Publié: (2025)
ScrollScape: Unlocking 32K Image Generation With Video Diffusion Priors
par: Yu, Haodong, et autres
Publié: (2026)
par: Yu, Haodong, et autres
Publié: (2026)
Self-Supervised Learning for Real-World Super-Resolution from Dual and Multiple Zoomed Observations
par: Zhang, Zhilu, et autres
Publié: (2024)
par: Zhang, Zhilu, et autres
Publié: (2024)
DIR: Retrieval-Augmented Image Captioning with Comprehensive Understanding
par: Wu, Hao, et autres
Publié: (2024)
par: Wu, Hao, et autres
Publié: (2024)
InterCoG: Towards Spatially Precise Image Editing with Interleaved Chain-of-Grounding Reasoning
par: Wan, Yecong, et autres
Publié: (2026)
par: Wan, Yecong, et autres
Publié: (2026)
GSVC: Efficient Video Representation and Compression Through 2D Gaussian Splatting
par: Wang, Longan, et autres
Publié: (2025)
par: Wang, Longan, et autres
Publié: (2025)
Premier: Personalized Preference Modulation with Learnable User Embedding in Text-to-Image Generation
par: Wang, Zihao, et autres
Publié: (2026)
par: Wang, Zihao, et autres
Publié: (2026)
RefSTAR: Blind Facial Image Restoration with Reference Selection, Transfer, and Reconstruction
par: Yin, Zhicun, et autres
Publié: (2025)
par: Yin, Zhicun, et autres
Publié: (2025)
Cross-Modal Bidirectional Interaction Model for Referring Remote Sensing Image Segmentation
par: Dong, Zhe, et autres
Publié: (2024)
par: Dong, Zhe, et autres
Publié: (2024)
SmartControl: Enhancing ControlNet for Handling Rough Visual Conditions
par: Liu, Xiaoyu, et autres
Publié: (2024)
par: Liu, Xiaoyu, et autres
Publié: (2024)
Improving Image Restoration through Removing Degradations in Textual Representations
par: Lin, Jingbo, et autres
Publié: (2023)
par: Lin, Jingbo, et autres
Publié: (2023)
MasterWeaver: Taming Editability and Face Identity for Personalized Text-to-Image Generation
par: Wei, Yuxiang, et autres
Publié: (2024)
par: Wei, Yuxiang, et autres
Publié: (2024)
A cross-modal network for facial expression recognition
par: Tian, Chunwei, et autres
Publié: (2026)
par: Tian, Chunwei, et autres
Publié: (2026)
Retrieval Augmented Comic Image Generation
par: Shui, Yunhao, et autres
Publié: (2025)
par: Shui, Yunhao, et autres
Publié: (2025)
ArtHOI: Taming Foundation Models for Monocular 4D Reconstruction of Hand-Articulated-Object Interactions
par: Wang, Zikai, et autres
Publié: (2026)
par: Wang, Zikai, et autres
Publié: (2026)
ConSept: Continual Semantic Segmentation via Adapter-based Vision Transformer
par: Dong, Bowen, et autres
Publié: (2024)
par: Dong, Bowen, et autres
Publié: (2024)
Documents similaires
-
Learning Spatially Decoupled Color Representations for Facial Image Colorization
par: Zhu, Hangyan, et autres
Publié: (2024) -
GLAD: Towards Better Reconstruction with Global and Local Adaptive Diffusion Models for Unsupervised Anomaly Detection
par: Yao, Hang, et autres
Publié: (2024) -
Deblur4DGS: 4D Gaussian Splatting from Blurry Monocular Video
par: Wu, Renlong, et autres
Publié: (2024) -
Combining Generative and Geometry Priors for Wide-Angle Portrait Correction
par: Yao, Lan, et autres
Publié: (2024) -
Exposure Bracketing Is All You Need For A High-Quality Image
par: Zhang, Zhilu, et autres
Publié: (2024)