A Survey on Personalized Content Synthesis with Diffusion Models
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Xulu, Wei, Xiaoyong, Hu, Wentao, Wu, Jinlin, Wu, Jiaxin, Zhang, Wengyu, Zhang, Zhaoxiang, Lei, Zhen, Li, Qing |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Generative Active Learning for Image Synthesis Personalization
by: Zhang, Xulu, et al.
Published: (2024)
by: Zhang, Xulu, et al.
Published: (2024)
Generating on Generated: An Approach Towards Self-Evolving Diffusion Models
by: Zhang, Xulu, et al.
Published: (2025)
by: Zhang, Xulu, et al.
Published: (2025)
Compositional Inversion for Stable Diffusion Models
by: Zhang, Xulu, et al.
Published: (2023)
by: Zhang, Xulu, et al.
Published: (2023)
Prior Knowledge Integration via LLM Encoding and Pseudo Event Regulation for Video Moment Retrieval
by: Jiang, Yiyang, et al.
Published: (2024)
by: Jiang, Yiyang, et al.
Published: (2024)
Mean of Means: A 10-dollar Solution for Human Localization with Calibration-free and Unconstrained Camera Settings
by: Zhang, Tianyi, et al.
Published: (2024)
by: Zhang, Tianyi, et al.
Published: (2024)
Mean of Means: Human Localization with Calibration-free and Unconstrained Camera Settings (extended version)
by: Zhang, Tianyi, et al.
Published: (2025)
by: Zhang, Tianyi, et al.
Published: (2025)
OmniColor: A Unified Framework for Multi-modal Lineart Colorization
by: Zhang, Xulu, et al.
Published: (2026)
by: Zhang, Xulu, et al.
Published: (2026)
PolySmart @ TRECVid 2024 Video Captioning (VTT)
by: Wu, Jiaxin, et al.
Published: (2024)
by: Wu, Jiaxin, et al.
Published: (2024)
Expanding Scene Graph Boundaries: Fully Open-vocabulary Scene Graph Generation via Visual-Concept Alignment and Retention
by: Chen, Zuyao, et al.
Published: (2023)
by: Chen, Zuyao, et al.
Published: (2023)
GPT4SGG: Synthesizing Scene Graphs from Holistic and Region-specific Narratives
by: Chen, Zuyao, et al.
Published: (2023)
by: Chen, Zuyao, et al.
Published: (2023)
Seek for Incantations: Towards Accurate Text-to-Image Diffusion Synthesis through Prompt Engineering
by: Yu, Chang, et al.
Published: (2024)
by: Yu, Chang, et al.
Published: (2024)
LLM-Enabled Style and Content Regularization for Personalized Text-to-Image Generation
by: Yu, Anran, et al.
Published: (2025)
by: Yu, Anran, et al.
Published: (2025)
From Competition to Coopetition: Coopetitive Training-Free Image Editing Based on Text Guidance
by: Shen, Jinhao, et al.
Published: (2026)
by: Shen, Jinhao, et al.
Published: (2026)
Self-similarity Driven Scale-invariant Learning for Weakly Supervised Person Search
by: Wang, Benzhi, et al.
Published: (2023)
by: Wang, Benzhi, et al.
Published: (2023)
EmoDiffusion: Enhancing Emotional 3D Facial Animation with Latent Diffusion Models
by: Zhang, Yixuan, et al.
Published: (2025)
by: Zhang, Yixuan, et al.
Published: (2025)
SA-Person: Text-Based Person Retrieval with Scene-aware Re-ranking
by: Xu, Yingjia, et al.
Published: (2025)
by: Xu, Yingjia, et al.
Published: (2025)
From Data to Modeling: Fully Open-vocabulary Scene Graph Generation
by: Chen, Zuyao, et al.
Published: (2025)
by: Chen, Zuyao, et al.
Published: (2025)
Voxel Mamba: Group-Free State Space Models for Point Cloud based 3D Object Detection
by: Zhang, Guowen, et al.
Published: (2024)
by: Zhang, Guowen, et al.
Published: (2024)
FIRM: Flexible Interactive Reflection reMoval
by: Chen, Xiao, et al.
Published: (2024)
by: Chen, Xiao, et al.
Published: (2024)
Open Vocabulary 3D Scene Understanding via Geometry Guided Self-Distillation
by: Wang, Pengfei, et al.
Published: (2024)
by: Wang, Pengfei, et al.
Published: (2024)
Towards Realistic Hand-Object Interaction with Gravity-Field Based Diffusion Bridge
by: Xu, Miao, et al.
Published: (2025)
by: Xu, Miao, et al.
Published: (2025)
General Geometry-aware Weakly Supervised 3D Object Detection
by: Zhang, Guowen, et al.
Published: (2024)
by: Zhang, Guowen, et al.
Published: (2024)
Improving Large Vision-Language Models' Understanding for Flow Field Data
by: Zhang, Xiaomei, et al.
Published: (2025)
by: Zhang, Xiaomei, et al.
Published: (2025)
Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects
by: Li, Wei, et al.
Published: (2025)
by: Li, Wei, et al.
Published: (2025)
Top-Down Guidance for Learning Object-Centric Representations
by: Zou, Junhong, et al.
Published: (2024)
by: Zou, Junhong, et al.
Published: (2024)
Personalized Image Generation with Deep Generative Models: A Decade Survey
by: Wei, Yuxiang, et al.
Published: (2025)
by: Wei, Yuxiang, et al.
Published: (2025)
SurgVisAgent: Multimodal Agentic Model for Versatile Surgical Visual Enhancement
by: Lei, Zeyu, et al.
Published: (2025)
by: Lei, Zeyu, et al.
Published: (2025)
What Makes a Scene ? Scene Graph-based Evaluation and Feedback for Controllable Generation
by: Chen, Zuyao, et al.
Published: (2024)
by: Chen, Zuyao, et al.
Published: (2024)
OMG: Occlusion-friendly Personalized Multi-concept Generation in Diffusion Models
by: Kong, Zhe, et al.
Published: (2024)
by: Kong, Zhe, et al.
Published: (2024)
Diffusion Models in 3D Vision: A Survey
by: Wang, Zhen, et al.
Published: (2024)
by: Wang, Zhen, et al.
Published: (2024)
Pixel-Aware Stable Diffusion for Realistic Image Super-resolution and Personalized Stylization
by: Yang, Tao, et al.
Published: (2023)
by: Yang, Tao, et al.
Published: (2023)
Improving the Stability and Efficiency of Diffusion Models for Content Consistent Super-Resolution
by: Sun, Lingchen, et al.
Published: (2023)
by: Sun, Lingchen, et al.
Published: (2023)
SAGD: Boundary-Enhanced Segment Anything in 3D Gaussian via Gaussian Decomposition
by: Hu, Xu, et al.
Published: (2024)
by: Hu, Xu, et al.
Published: (2024)
UniDA3D: A Unified Domain-Adaptive Framework for Multi-View 3D Object Detection
by: Wu, Hongjing, et al.
Published: (2026)
by: Wu, Hongjing, et al.
Published: (2026)
DiffSpeaker: Speech-Driven 3D Facial Animation with Diffusion Transformer
by: Ma, Zhiyuan, et al.
Published: (2024)
by: Ma, Zhiyuan, et al.
Published: (2024)
GoClick: Lightweight Element Grounding Model for Autonomous GUI Interaction
by: Li, Hongxin, et al.
Published: (2026)
by: Li, Hongxin, et al.
Published: (2026)
Retrieval-Augmented Generation for AI-Generated Content: A Survey
by: Zhao, Penghao, et al.
Published: (2024)
by: Zhao, Penghao, et al.
Published: (2024)
Modeling Spoof Noise by De-spoofing Diffusion and its Application in Face Anti-spoofing
by: Zhang, Bin, et al.
Published: (2024)
by: Zhang, Bin, et al.
Published: (2024)
DiffusionTrack: Diffusion Model For Multi-Object Tracking
by: Luo, Run, et al.
Published: (2023)
by: Luo, Run, et al.
Published: (2023)
6DAttack: Backdoor Attacks in the 6DoF Pose Estimation
by: Guo, Jihui, et al.
Published: (2025)
by: Guo, Jihui, et al.
Published: (2025)
Similar Items
-
Generative Active Learning for Image Synthesis Personalization
by: Zhang, Xulu, et al.
Published: (2024) -
Generating on Generated: An Approach Towards Self-Evolving Diffusion Models
by: Zhang, Xulu, et al.
Published: (2025) -
Compositional Inversion for Stable Diffusion Models
by: Zhang, Xulu, et al.
Published: (2023) -
Prior Knowledge Integration via LLM Encoding and Pseudo Event Regulation for Video Moment Retrieval
by: Jiang, Yiyang, et al.
Published: (2024) -
Mean of Means: A 10-dollar Solution for Human Localization with Calibration-free and Unconstrained Camera Settings
by: Zhang, Tianyi, et al.
Published: (2024)