Generative Active Learning for Image Synthesis Personalization
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Xulu, Zhang, Wengyu, Wei, Xiao-Yong, Wu, Jinlin, Zhang, Zhaoxiang, Lei, Zhen, Li, Qing |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
A Survey on Personalized Content Synthesis with Diffusion Models
by: Zhang, Xulu, et al.
Published: (2024)
by: Zhang, Xulu, et al.
Published: (2024)
Generating on Generated: An Approach Towards Self-Evolving Diffusion Models
by: Zhang, Xulu, et al.
Published: (2025)
by: Zhang, Xulu, et al.
Published: (2025)
Compositional Inversion for Stable Diffusion Models
by: Zhang, Xulu, et al.
Published: (2023)
by: Zhang, Xulu, et al.
Published: (2023)
Mean of Means: A 10-dollar Solution for Human Localization with Calibration-free and Unconstrained Camera Settings
by: Zhang, Tianyi, et al.
Published: (2024)
by: Zhang, Tianyi, et al.
Published: (2024)
Mean of Means: Human Localization with Calibration-free and Unconstrained Camera Settings (extended version)
by: Zhang, Tianyi, et al.
Published: (2025)
by: Zhang, Tianyi, et al.
Published: (2025)
Prior Knowledge Integration via LLM Encoding and Pseudo Event Regulation for Video Moment Retrieval
by: Jiang, Yiyang, et al.
Published: (2024)
by: Jiang, Yiyang, et al.
Published: (2024)
PolySmart @ TRECVid 2024 Video Captioning (VTT)
by: Wu, Jiaxin, et al.
Published: (2024)
by: Wu, Jiaxin, et al.
Published: (2024)
From Competition to Coopetition: Coopetitive Training-Free Image Editing Based on Text Guidance
by: Shen, Jinhao, et al.
Published: (2026)
by: Shen, Jinhao, et al.
Published: (2026)
Expanding Scene Graph Boundaries: Fully Open-vocabulary Scene Graph Generation via Visual-Concept Alignment and Retention
by: Chen, Zuyao, et al.
Published: (2023)
by: Chen, Zuyao, et al.
Published: (2023)
GPT4SGG: Synthesizing Scene Graphs from Holistic and Region-specific Narratives
by: Chen, Zuyao, et al.
Published: (2023)
by: Chen, Zuyao, et al.
Published: (2023)
OmniColor: A Unified Framework for Multi-modal Lineart Colorization
by: Zhang, Xulu, et al.
Published: (2026)
by: Zhang, Xulu, et al.
Published: (2026)
Seek for Incantations: Towards Accurate Text-to-Image Diffusion Synthesis through Prompt Engineering
by: Yu, Chang, et al.
Published: (2024)
by: Yu, Chang, et al.
Published: (2024)
General Geometry-aware Weakly Supervised 3D Object Detection
by: Zhang, Guowen, et al.
Published: (2024)
by: Zhang, Guowen, et al.
Published: (2024)
Self-similarity Driven Scale-invariant Learning for Weakly Supervised Person Search
by: Wang, Benzhi, et al.
Published: (2023)
by: Wang, Benzhi, et al.
Published: (2023)
FIRM: Flexible Interactive Reflection reMoval
by: Chen, Xiao, et al.
Published: (2024)
by: Chen, Xiao, et al.
Published: (2024)
Top-Down Guidance for Learning Object-Centric Representations
by: Zou, Junhong, et al.
Published: (2024)
by: Zou, Junhong, et al.
Published: (2024)
LLM-Enabled Style and Content Regularization for Personalized Text-to-Image Generation
by: Yu, Anran, et al.
Published: (2025)
by: Yu, Anran, et al.
Published: (2025)
SA-Person: Text-Based Person Retrieval with Scene-aware Re-ranking
by: Xu, Yingjia, et al.
Published: (2025)
by: Xu, Yingjia, et al.
Published: (2025)
Open Vocabulary 3D Scene Understanding via Geometry Guided Self-Distillation
by: Wang, Pengfei, et al.
Published: (2024)
by: Wang, Pengfei, et al.
Published: (2024)
Personalized Image Generation with Deep Generative Models: A Decade Survey
by: Wei, Yuxiang, et al.
Published: (2025)
by: Wei, Yuxiang, et al.
Published: (2025)
From Data to Modeling: Fully Open-vocabulary Scene Graph Generation
by: Chen, Zuyao, et al.
Published: (2025)
by: Chen, Zuyao, et al.
Published: (2025)
SimCMF: A Simple Cross-modal Fine-tuning Strategy from Vision Foundation Models to Any Imaging Modality
by: Lei, Chenyang, et al.
Published: (2024)
by: Lei, Chenyang, et al.
Published: (2024)
What Makes a Scene ? Scene Graph-based Evaluation and Feedback for Controllable Generation
by: Chen, Zuyao, et al.
Published: (2024)
by: Chen, Zuyao, et al.
Published: (2024)
MasterWeaver: Taming Editability and Face Identity for Personalized Text-to-Image Generation
by: Wei, Yuxiang, et al.
Published: (2024)
by: Wei, Yuxiang, et al.
Published: (2024)
Voxel Mamba: Group-Free State Space Models for Point Cloud based 3D Object Detection
by: Zhang, Guowen, et al.
Published: (2024)
by: Zhang, Guowen, et al.
Published: (2024)
SimMAT: Exploring Transferability from Vision Foundation Models to Any Image Modality
by: Lei, Chenyang, et al.
Published: (2024)
by: Lei, Chenyang, et al.
Published: (2024)
FreeVS: Generative View Synthesis on Free Driving Trajectory
by: Wang, Qitai, et al.
Published: (2024)
by: Wang, Qitai, et al.
Published: (2024)
Improving Large Vision-Language Models' Understanding for Flow Field Data
by: Zhang, Xiaomei, et al.
Published: (2025)
by: Zhang, Xiaomei, et al.
Published: (2025)
RoGSplat: Learning Robust Generalizable Human Gaussian Splatting from Sparse Multi-View Images
by: Xiao, Junjin, et al.
Published: (2025)
by: Xiao, Junjin, et al.
Published: (2025)
Compile Scene Graphs with Reinforcement Learning
by: Chen, Zuyao, et al.
Published: (2025)
by: Chen, Zuyao, et al.
Published: (2025)
Self-Paced Learning for Images of Antinuclear Antibodies
by: Jiang, Yiyang, et al.
Published: (2025)
by: Jiang, Yiyang, et al.
Published: (2025)
CoRe: Context-Regularized Text Embedding Learning for Text-to-Image Personalization
by: Wu, Feize, et al.
Published: (2024)
by: Wu, Feize, et al.
Published: (2024)
Dual-Image Enhanced CLIP for Zero-Shot Anomaly Detection
by: Zhang, Zhaoxiang, et al.
Published: (2024)
by: Zhang, Zhaoxiang, et al.
Published: (2024)
Think in Latent Thoughts: A New Paradigm for Gloss-Free Sign Language Translation
by: Jiang, Yiyang, et al.
Published: (2026)
by: Jiang, Yiyang, et al.
Published: (2026)
Integrating View Conditions for Image Synthesis
by: Bai, Jinbin, et al.
Published: (2023)
by: Bai, Jinbin, et al.
Published: (2023)
Revisiting Marr in Face: The Building of 2D--2.5D--3D Representations in Deep Neural Networks
by: Zhu, Xiangyu, et al.
Published: (2024)
by: Zhu, Xiangyu, et al.
Published: (2024)
Powerful and Flexible: Personalized Text-to-Image Generation via Reinforcement Learning
by: Wei, Fanyue, et al.
Published: (2024)
by: Wei, Fanyue, et al.
Published: (2024)
SAGD: Boundary-Enhanced Segment Anything in 3D Gaussian via Gaussian Decomposition
by: Hu, Xu, et al.
Published: (2024)
by: Hu, Xu, et al.
Published: (2024)
Learning Human Skill Generators at Key-Step Levels
by: Wu, Yilu, et al.
Published: (2025)
by: Wu, Yilu, et al.
Published: (2025)
Cross-view Masked Diffusion Transformers for Person Image Synthesis
by: Pham, Trung X., et al.
Published: (2024)
by: Pham, Trung X., et al.
Published: (2024)
Similar Items
-
A Survey on Personalized Content Synthesis with Diffusion Models
by: Zhang, Xulu, et al.
Published: (2024) -
Generating on Generated: An Approach Towards Self-Evolving Diffusion Models
by: Zhang, Xulu, et al.
Published: (2025) -
Compositional Inversion for Stable Diffusion Models
by: Zhang, Xulu, et al.
Published: (2023) -
Mean of Means: A 10-dollar Solution for Human Localization with Calibration-free and Unconstrained Camera Settings
by: Zhang, Tianyi, et al.
Published: (2024) -
Mean of Means: Human Localization with Calibration-free and Unconstrained Camera Settings (extended version)
by: Zhang, Tianyi, et al.
Published: (2025)