RefDrop: Controllable Consistency in Image or Video Generation via Reference Feature Guidance
Fuente:
arXiv
Saved in:
| Main Authors: | Fan, Jiaojiao, Xue, Haotian, Zhang, Qinsheng, Chen, Yongxin |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
RefCut: Interactive Segmentation with Reference Guidance
by: Lin, Zheng, et al.
Published: (2025)
by: Lin, Zheng, et al.
Published: (2025)
MultiRef: Controllable Image Generation with Multiple Visual References
by: Chen, Ruoxi, et al.
Published: (2025)
by: Chen, Ruoxi, et al.
Published: (2025)
UniRef-Image-Edit: Towards Scalable and Consistent Multi-Reference Image Editing
by: Wei, Hongyang, et al.
Published: (2026)
by: Wei, Hongyang, et al.
Published: (2026)
RefTok: Reference-Based Tokenization for Video Generation
by: Fan, Xiang, et al.
Published: (2025)
by: Fan, Xiang, et al.
Published: (2025)
Immune2V: Image Immunization Against Dual-Stream Image-to-Video Generation
by: Long, Zeqian, et al.
Published: (2026)
by: Long, Zeqian, et al.
Published: (2026)
RefAlign: Representation Alignment for Reference-to-Video Generation
by: Wang, Lei, et al.
Published: (2026)
by: Wang, Lei, et al.
Published: (2026)
CETCAM: Camera-Controllable Video Generation via Consistent and Extensible Tokenization
by: Zhao, Zelin, et al.
Published: (2025)
by: Zhao, Zelin, et al.
Published: (2025)
EasyRef: Omni-Generalized Group Image Reference for Diffusion Models via Multimodal LLM
by: Zong, Zhuofan, et al.
Published: (2024)
by: Zong, Zhuofan, et al.
Published: (2024)
Consistent Video Colorization via Palette Guidance
by: Wang, Han, et al.
Published: (2025)
by: Wang, Han, et al.
Published: (2025)
RefVSR++: Exploiting Reference Inputs for Reference-based Video Super-resolution
by: Zou, Han, et al.
Published: (2023)
by: Zou, Han, et al.
Published: (2023)
Diffusion-Based Adversarial Sample Generation for Improved Stealthiness and Controllability
by: Xue, Haotian, et al.
Published: (2023)
by: Xue, Haotian, et al.
Published: (2023)
RefSTAR: Blind Facial Image Restoration with Reference Selection, Transfer, and Reconstruction
by: Yin, Zhicun, et al.
Published: (2025)
by: Yin, Zhicun, et al.
Published: (2025)
Pixel is a Barrier: Diffusion Models Are More Adversarially Robust Than We Think
by: Xue, Haotian, et al.
Published: (2024)
by: Xue, Haotian, et al.
Published: (2024)
Diffusion Policy Attacker: Crafting Adversarial Attacks for Diffusion-based Policies
by: Chen, Yipu, et al.
Published: (2024)
by: Chen, Yipu, et al.
Published: (2024)
TransRef: Multi-Scale Reference Embedding Transformer for Reference-Guided Image Inpainting
by: Liu, Taorong, et al.
Published: (2023)
by: Liu, Taorong, et al.
Published: (2023)
BluRef: Unsupervised Image Deblurring with Dense-Matching References
by: Pham, Bang-Dang, et al.
Published: (2026)
by: Pham, Bang-Dang, et al.
Published: (2026)
Improving Viewpoint Consistency in 3D Generation via Structure Feature and CLIP Guidance
by: Zhang, Qing, et al.
Published: (2024)
by: Zhang, Qing, et al.
Published: (2024)
FancyVideo: Towards Dynamic and Consistent Video Generation via Cross-frame Textual Guidance
by: Feng, Jiasong, et al.
Published: (2024)
by: Feng, Jiasong, et al.
Published: (2024)
ACWM-Phys: Investigating Generalized Physical Interaction in Action-Conditioned Video World Models
by: Xue, Haotian, et al.
Published: (2026)
by: Xue, Haotian, et al.
Published: (2026)
RefQSR: Reference-based Quantization for Image Super-Resolution Networks
by: Lee, Hongjae, et al.
Published: (2024)
by: Lee, Hongjae, et al.
Published: (2024)
RefAerial: A Benchmark and Approach for Referring Detection in Aerial Images
by: Hu, Guyue, et al.
Published: (2026)
by: Hu, Guyue, et al.
Published: (2026)
RefOnce: Distilling References into a Prototype Memory for Referring Camouflaged Object Detection
by: Wu, Yu-Huan, et al.
Published: (2025)
by: Wu, Yu-Huan, et al.
Published: (2025)
NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration
by: Dong, Haotian, et al.
Published: (2025)
by: Dong, Haotian, et al.
Published: (2025)
MoGAN: Improving Motion Quality in Video Diffusion via Few-Step Motion Adversarial Post-Training
by: Xue, Haotian, et al.
Published: (2025)
by: Xue, Haotian, et al.
Published: (2025)
Point-It-Out: Benchmarking Embodied Reasoning for Vision Language Models in Multi-Stage Visual Grounding
by: Xue, Haotian, et al.
Published: (2025)
by: Xue, Haotian, et al.
Published: (2025)
Conditional Text-to-Image Generation with Reference Guidance
by: Kim, Taewook, et al.
Published: (2024)
by: Kim, Taewook, et al.
Published: (2024)
SpecRef: A Fast Training-free Baseline of Specific Reference-Condition Real Image Editing
by: Chen, Songyan, et al.
Published: (2024)
by: Chen, Songyan, et al.
Published: (2024)
RefDecoder: Enhancing Visual Generation with Conditional Video Decoding
by: Fan, Xiang, et al.
Published: (2026)
by: Fan, Xiang, et al.
Published: (2026)
BadRefSR: Backdoor Attacks Against Reference-based Image Super Resolution
by: Yang, Xue, et al.
Published: (2025)
by: Yang, Xue, et al.
Published: (2025)
Laplacian Multi-scale Flow Matching for Generative Modeling
by: Zhao, Zelin, et al.
Published: (2026)
by: Zhao, Zelin, et al.
Published: (2026)
RefSAM: Efficiently Adapting Segmenting Anything Model for Referring Video Object Segmentation
by: Li, Yonglin, et al.
Published: (2023)
by: Li, Yonglin, et al.
Published: (2023)
Condition-Aware Neural Network for Controlled Image Generation
by: Cai, Han, et al.
Published: (2024)
by: Cai, Han, et al.
Published: (2024)
Champ: Controllable and Consistent Human Image Animation with 3D Parametric Guidance
by: Zhu, Shenhao, et al.
Published: (2024)
by: Zhu, Shenhao, et al.
Published: (2024)
RefTon: Reference person shot assist virtual Try-on
by: Li, Liuzhuozheng, et al.
Published: (2025)
by: Li, Liuzhuozheng, et al.
Published: (2025)
AlcheMinT: Fine-grained Temporal Control for Multi-Reference Consistent Video Generation
by: Girish, Sharath, et al.
Published: (2025)
by: Girish, Sharath, et al.
Published: (2025)
CareCom: Generative Image Composition with Calibrated Reference Features
by: Chen, Jiaxuan, et al.
Published: (2025)
by: Chen, Jiaxuan, et al.
Published: (2025)
ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation
by: Ren, Weiming, et al.
Published: (2024)
by: Ren, Weiming, et al.
Published: (2024)
MaterialRefGS: Reflective Gaussian Splatting with Multi-view Consistent Material Inference
by: Zhang, Wenyuan, et al.
Published: (2025)
by: Zhang, Wenyuan, et al.
Published: (2025)
HECTOR: Hybrid Editable Compositional Object References for Video Generation
by: Zhang, Guofeng, et al.
Published: (2026)
by: Zhang, Guofeng, et al.
Published: (2026)
RefEdit: A Benchmark and Method for Improving Instruction-based Image Editing Model on Referring Expressions
by: Pathiraja, Bimsara, et al.
Published: (2025)
by: Pathiraja, Bimsara, et al.
Published: (2025)
Similar Items
-
RefCut: Interactive Segmentation with Reference Guidance
by: Lin, Zheng, et al.
Published: (2025) -
MultiRef: Controllable Image Generation with Multiple Visual References
by: Chen, Ruoxi, et al.
Published: (2025) -
UniRef-Image-Edit: Towards Scalable and Consistent Multi-Reference Image Editing
by: Wei, Hongyang, et al.
Published: (2026) -
RefTok: Reference-Based Tokenization for Video Generation
by: Fan, Xiang, et al.
Published: (2025) -
Immune2V: Image Immunization Against Dual-Stream Image-to-Video Generation
by: Long, Zeqian, et al.
Published: (2026)