AnyDoor: Zero-shot Object-level Image Customization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Xi, Huang, Lianghua, Liu, Yu, Shen, Yujun, Zhao, Deli, Zhao, Hengshuang |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Zero-shot Image Editing with Reference Imitation
par: Chen, Xi, et autres
Publié: (2024)
par: Chen, Xi, et autres
Publié: (2024)
DiffDoctor: Diagnosing Image Diffusion Models Before Treating
par: Wang, Yiyang, et autres
Publié: (2025)
par: Wang, Yiyang, et autres
Publié: (2025)
FocalClick-XL: Towards Unified and High-quality Interactive Segmentation
par: Chen, Xi, et autres
Publié: (2025)
par: Chen, Xi, et autres
Publié: (2025)
LogoSticker: Inserting Logos into Diffusion Models for Customized Generation
par: Zhu, Mingkang, et autres
Publié: (2024)
par: Zhu, Mingkang, et autres
Publié: (2024)
Modular Customization of Diffusion Models via Blockwise-Parameterized Low-Rank Adaptation
par: Zhu, Mingkang, et autres
Publié: (2025)
par: Zhu, Mingkang, et autres
Publié: (2025)
DiffCamera: Arbitrary Refocusing on Images
par: Wang, Yiyang, et autres
Publié: (2025)
par: Wang, Yiyang, et autres
Publié: (2025)
Depth Anything with Any Prior
par: Wang, Zehan, et autres
Publié: (2025)
par: Wang, Zehan, et autres
Publié: (2025)
Lipschitz Singularities in Diffusion Models
par: Yang, Zhantao, et autres
Publié: (2023)
par: Yang, Zhantao, et autres
Publié: (2023)
Visual Programming for Zero-shot Open-Vocabulary 3D Visual Grounding
par: Yuan, Zhihao, et autres
Publié: (2023)
par: Yuan, Zhihao, et autres
Publié: (2023)
FlashFace: Human Image Personalization with High-fidelity Identity Preservation
par: Zhang, Shilong, et autres
Publié: (2024)
par: Zhang, Shilong, et autres
Publié: (2024)
Depth-aware Test-Time Training for Zero-shot Video Object Segmentation
par: Liu, Weihuang, et autres
Publié: (2024)
par: Liu, Weihuang, et autres
Publié: (2024)
SynMotion: Semantic-Visual Adaptation for Motion Customized Video Generation
par: Tan, Shuai, et autres
Publié: (2025)
par: Tan, Shuai, et autres
Publié: (2025)
Task-Specific Zero-shot Quantization-Aware Training for Object Detection
par: Li, Changhao, et autres
Publié: (2025)
par: Li, Changhao, et autres
Publié: (2025)
GDRO: Group-level Reward Post-training Suitable for Diffusion Models
par: Wang, Yiyang, et autres
Publié: (2026)
par: Wang, Yiyang, et autres
Publié: (2026)
VideoAnydoor: High-fidelity Video Object Insertion with Precise Motion Control
par: Tu, Yuanpeng, et autres
Publié: (2025)
par: Tu, Yuanpeng, et autres
Publié: (2025)
Data-Efficient Generalization for Zero-shot Composed Image Retrieval
par: Chen, Zining, et autres
Publié: (2025)
par: Chen, Zining, et autres
Publié: (2025)
Calligrapher: Freestyle Text Image Customization
par: Ma, Yue, et autres
Publié: (2025)
par: Ma, Yue, et autres
Publié: (2025)
ZeroPose: CAD-Prompted Zero-shot Object 6D Pose Estimation in Cluttered Scenes
par: Chen, Jianqiu, et autres
Publié: (2023)
par: Chen, Jianqiu, et autres
Publié: (2023)
FashionComposer: Compositional Fashion Image Generation
par: Ji, Sihui, et autres
Publié: (2024)
par: Ji, Sihui, et autres
Publié: (2024)
Seg-VAR: Image Segmentation with Visual Autoregressive Modeling
par: Zheng, Rongkun, et autres
Publié: (2025)
par: Zheng, Rongkun, et autres
Publié: (2025)
Zero-shot Object Counting with Good Exemplars
par: Zhu, Huilin, et autres
Publié: (2024)
par: Zhu, Huilin, et autres
Publié: (2024)
Adaptive Multi-source Predictor for Zero-shot Video Object Segmentation
par: Zhao, Xiaoqi, et autres
Publié: (2023)
par: Zhao, Xiaoqi, et autres
Publié: (2023)
ZeroComp: Zero-shot Object Compositing from Image Intrinsics via Diffusion
par: Zhang, Zitian, et autres
Publié: (2024)
par: Zhang, Zitian, et autres
Publié: (2024)
FreeCustom: Tuning-Free Customized Image Generation for Multi-Concept Composition
par: Ding, Ganggui, et autres
Publié: (2024)
par: Ding, Ganggui, et autres
Publié: (2024)
Animate-X++: Universal Character Image Animation with Dynamic Backgrounds
par: Tan, Shuai, et autres
Publié: (2025)
par: Tan, Shuai, et autres
Publié: (2025)
VideoMaker: Zero-shot Customized Video Generation with the Inherent Force of Video Diffusion Models
par: Wu, Tao, et autres
Publié: (2024)
par: Wu, Tao, et autres
Publié: (2024)
DreamMask: Boosting Open-vocabulary Panoptic Segmentation with Synthetic Data
par: Tu, Yuanpeng, et autres
Publié: (2025)
par: Tu, Yuanpeng, et autres
Publié: (2025)
Zero-BEV: Zero-shot Projection of Any First-Person Modality to BEV Maps
par: Monaci, Gianluca, et autres
Publié: (2024)
par: Monaci, Gianluca, et autres
Publié: (2024)
One for All: Multi-Domain Joint Training for Point Cloud Based 3D Object Detection
par: Wang, Zhenyu, et autres
Publié: (2024)
par: Wang, Zhenyu, et autres
Publié: (2024)
Tailor3D: Customized 3D Assets Editing and Generation with Dual-Side Images
par: Qi, Zhangyang, et autres
Publié: (2024)
par: Qi, Zhangyang, et autres
Publié: (2024)
AnomalyCLIP: Object-agnostic Prompt Learning for Zero-shot Anomaly Detection
par: Zhou, Qihang, et autres
Publié: (2023)
par: Zhou, Qihang, et autres
Publié: (2023)
Exploring Iterative Manifold Constraint for Zero-shot Image Editing
par: Li, Maomao, et autres
Publié: (2025)
par: Li, Maomao, et autres
Publié: (2025)
MTFusion: Reconstructing Any 3D Object from Single Image Using Multi-word Textual Inversion
par: Liu, Yu, et autres
Publié: (2024)
par: Liu, Yu, et autres
Publié: (2024)
Towards More Accurate Diffusion Model Acceleration with A Timestep Tuner
par: Xia, Mengfei, et autres
Publié: (2023)
par: Xia, Mengfei, et autres
Publié: (2023)
Learning Disentangled Identifiers for Action-Customized Text-to-Image Generation
par: Huang, Siteng, et autres
Publié: (2023)
par: Huang, Siteng, et autres
Publié: (2023)
Towards Unified 3D Object Detection via Algorithm and Data Unification
par: Li, Zhuoling, et autres
Publié: (2024)
par: Li, Zhuoling, et autres
Publié: (2024)
OpenIns3D: Snap and Lookup for 3D Open-vocabulary Instance Segmentation
par: Huang, Zhening, et autres
Publié: (2023)
par: Huang, Zhening, et autres
Publié: (2023)
A Lightweight Clustering Framework for Unsupervised Semantic Segmentation
par: Cheung, Yau Shing Jonathan, et autres
Publié: (2023)
par: Cheung, Yau Shing Jonathan, et autres
Publié: (2023)
PhysMaster: Mastering Physical Representation for Video Generation via Reinforcement Learning
par: Ji, Sihui, et autres
Publié: (2025)
par: Ji, Sihui, et autres
Publié: (2025)
Scanning Only Once: An End-to-end Framework for Fast Temporal Grounding in Long Videos
par: Pan, Yulin, et autres
Publié: (2023)
par: Pan, Yulin, et autres
Publié: (2023)
Documents similaires
-
Zero-shot Image Editing with Reference Imitation
par: Chen, Xi, et autres
Publié: (2024) -
DiffDoctor: Diagnosing Image Diffusion Models Before Treating
par: Wang, Yiyang, et autres
Publié: (2025) -
FocalClick-XL: Towards Unified and High-quality Interactive Segmentation
par: Chen, Xi, et autres
Publié: (2025) -
LogoSticker: Inserting Logos into Diffusion Models for Customized Generation
par: Zhu, Mingkang, et autres
Publié: (2024) -
Modular Customization of Diffusion Models via Blockwise-Parameterized Low-Rank Adaptation
par: Zhu, Mingkang, et autres
Publié: (2025)