Object-Driven One-Shot Fine-tuning of Text-to-Image Diffusion with Prototypical Embedding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lu, Jianxiang, Xie, Cong, Guo, Hui |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Prototype-Driven Adaptation for Few-Shot Object Detection
par: Huang, Yushen, et autres
Publié: (2025)
par: Huang, Yushen, et autres
Publié: (2025)
Fine-Grained Prototypes Distillation for Few-Shot Object Detection
par: Wang, Zichen, et autres
Publié: (2024)
par: Wang, Zichen, et autres
Publié: (2024)
Prototypical Contrastive Learning-based CLIP Fine-tuning for Object Re-identification
par: Li, Jiachen, et autres
Publié: (2023)
par: Li, Jiachen, et autres
Publié: (2023)
One-Shot Diffusion Mimicker for Handwritten Text Generation
par: Dai, Gang, et autres
Publié: (2024)
par: Dai, Gang, et autres
Publié: (2024)
Subject-Diffusion:Open Domain Personalized Text-to-Image Generation without Test-time Fine-tuning
par: Ma, Jian, et autres
Publié: (2023)
par: Ma, Jian, et autres
Publié: (2023)
DPL: Spatial-Conditioned Diffusion Prototype Enhancement for One-Shot Medical Segmentation
par: Gao, Ziyuan, et autres
Publié: (2025)
par: Gao, Ziyuan, et autres
Publié: (2025)
FT-Shield: A Watermark Against Unauthorized Fine-tuning in Text-to-Image Diffusion Models
par: Cui, Yingqian, et autres
Publié: (2023)
par: Cui, Yingqian, et autres
Publié: (2023)
Learning Multi-Modal Prototypes for Cross-Domain Few-Shot Object Detection
par: Wang, Wanqi, et autres
Publié: (2026)
par: Wang, Wanqi, et autres
Publié: (2026)
Correlation Weighted Prototype-based Self-Supervised One-Shot Segmentation of Medical Images
par: Manna, Siladittya, et autres
Publié: (2024)
par: Manna, Siladittya, et autres
Publié: (2024)
Fine-Grained Zero-Shot Object Detection
par: Ma, Hongxu, et autres
Publié: (2025)
par: Ma, Hongxu, et autres
Publié: (2025)
DiffExp: Efficient Exploration in Reward Fine-tuning for Text-to-Image Diffusion Models
par: Chae, Daewon, et autres
Publié: (2025)
par: Chae, Daewon, et autres
Publié: (2025)
One-Shot Learning Meets Depth Diffusion in Multi-Object Videos
par: Jain, Anisha
Publié: (2024)
par: Jain, Anisha
Publié: (2024)
DreamBlend: Advancing Personalized Fine-tuning of Text-to-Image Diffusion Models
par: Ram, Shwetha, et autres
Publié: (2024)
par: Ram, Shwetha, et autres
Publié: (2024)
Coffee: Controllable Diffusion Fine-tuning
par: Zeng, Ziyao, et autres
Publié: (2025)
par: Zeng, Ziyao, et autres
Publié: (2025)
Layered Diffusion Model for One-Shot High Resolution Text-to-Image Synthesis
par: Khwaja, Emaad, et autres
Publié: (2024)
par: Khwaja, Emaad, et autres
Publié: (2024)
DriveDiTFit: Fine-tuning Diffusion Transformers for Autonomous Driving
par: Tu, Jiahang, et autres
Publié: (2024)
par: Tu, Jiahang, et autres
Publié: (2024)
Prototype-Guided Curriculum Learning for Zero-Shot Learning
par: Wang, Lei, et autres
Publié: (2025)
par: Wang, Lei, et autres
Publié: (2025)
CrowdMoGen: Zero-Shot Text-Driven Collective Motion Generation
par: Cao, Yukang, et autres
Publié: (2024)
par: Cao, Yukang, et autres
Publié: (2024)
Harmonizing Visual and Textual Embeddings for Zero-Shot Text-to-Image Customization
par: Song, Yeji, et autres
Publié: (2024)
par: Song, Yeji, et autres
Publié: (2024)
DOS: Directional Object Separation in Text Embeddings for Multi-Object Image Generation
par: Byun, Dongnam, et autres
Publié: (2025)
par: Byun, Dongnam, et autres
Publié: (2025)
Prototype Embedding Optimization for Human-Object Interaction Detection in Livestreaming
par: Zhang, Menghui, et autres
Publié: (2025)
par: Zhang, Menghui, et autres
Publié: (2025)
Setting the Stage: Text-Driven Scene-Consistent Image Generation
par: Xie, Cong, et autres
Publié: (2025)
par: Xie, Cong, et autres
Publié: (2025)
MedDiff-FT: Data-Efficient Diffusion Model Fine-tuning with Structural Guidance for Controllable Medical Image Synthesis
par: Xie, Jianhao, et autres
Publié: (2025)
par: Xie, Jianhao, et autres
Publié: (2025)
Query-guided Prototype Evolution Network for Few-Shot Segmentation
par: Cong, Runmin, et autres
Publié: (2024)
par: Cong, Runmin, et autres
Publié: (2024)
Is Foreground Prototype Sufficient? Few-Shot Medical Image Segmentation with Background-Fused Prototype
par: Tang, Song, et autres
Publié: (2024)
par: Tang, Song, et autres
Publié: (2024)
Fully Fine-tuned CLIP Models are Efficient Few-Shot Learners
par: Liu, Mushui, et autres
Publié: (2024)
par: Liu, Mushui, et autres
Publié: (2024)
Singular Value Fine-tuning for Few-Shot Class-Incremental Learning
par: Wang, Zhiwu, et autres
Publié: (2025)
par: Wang, Zhiwu, et autres
Publié: (2025)
Articulate3D: Zero-Shot Text-Driven 3D Object Posing
par: Deb, Oishi, et autres
Publié: (2025)
par: Deb, Oishi, et autres
Publié: (2025)
Versatile Diffusion: Text, Images and Variations All in One Diffusion Model
par: Xu, Xingqian, et autres
Publié: (2022)
par: Xu, Xingqian, et autres
Publié: (2022)
Customizing Text-to-Image Diffusion with Object Viewpoint Control
par: Kumari, Nupur, et autres
Publié: (2024)
par: Kumari, Nupur, et autres
Publié: (2024)
Customize-A-Video: One-Shot Motion Customization of Text-to-Video Diffusion Models
par: Ren, Yixuan, et autres
Publié: (2024)
par: Ren, Yixuan, et autres
Publié: (2024)
Fine Tuning Text-to-Image Diffusion Models for Correcting Anomalous Images
par: Yoo, Hyunwoo
Publié: (2024)
par: Yoo, Hyunwoo
Publié: (2024)
HOI-Diff: Text-Driven Synthesis of 3D Human-Object Interactions using Diffusion Models
par: Peng, Xiaogang, et autres
Publié: (2023)
par: Peng, Xiaogang, et autres
Publié: (2023)
Studying Image Diffusion Features for Zero-Shot Video Object Segmentation
par: Delatolas, Thanos, et autres
Publié: (2025)
par: Delatolas, Thanos, et autres
Publié: (2025)
A Simple and Effective Reinforcement Learning Method for Text-to-Image Diffusion Fine-tuning
par: Gupta, Shashank, et autres
Publié: (2025)
par: Gupta, Shashank, et autres
Publié: (2025)
Learning Class Prototypes for Unified Sparse Supervised 3D Object Detection
par: Zhu, Yun, et autres
Publié: (2025)
par: Zhu, Yun, et autres
Publié: (2025)
Addressing Text Embedding Leakage in Diffusion-based Image Editing
par: Mun, Sunung, et autres
Publié: (2024)
par: Mun, Sunung, et autres
Publié: (2024)
Safety Alignment Backfires: Preventing the Re-emergence of Suppressed Concepts in Fine-tuned Text-to-Image Diffusion Models
par: Kim, Sanghyun, et autres
Publié: (2024)
par: Kim, Sanghyun, et autres
Publié: (2024)
Exploiting Temporal Audio-Visual Correlation Embedding for Audio-Driven One-Shot Talking Head Animation
par: Xu, Zhihua, et autres
Publié: (2025)
par: Xu, Zhihua, et autres
Publié: (2025)
Diffusion-Sharpening: Fine-tuning Diffusion Models with Denoising Trajectory Sharpening
par: Tian, Ye, et autres
Publié: (2025)
par: Tian, Ye, et autres
Publié: (2025)
Documents similaires
-
Prototype-Driven Adaptation for Few-Shot Object Detection
par: Huang, Yushen, et autres
Publié: (2025) -
Fine-Grained Prototypes Distillation for Few-Shot Object Detection
par: Wang, Zichen, et autres
Publié: (2024) -
Prototypical Contrastive Learning-based CLIP Fine-tuning for Object Re-identification
par: Li, Jiachen, et autres
Publié: (2023) -
One-Shot Diffusion Mimicker for Handwritten Text Generation
par: Dai, Gang, et autres
Publié: (2024) -
Subject-Diffusion:Open Domain Personalized Text-to-Image Generation without Test-time Fine-tuning
par: Ma, Jian, et autres
Publié: (2023)