Generating on Generated: An Approach Towards Self-Evolving Diffusion Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Xulu, Wei, Xiaoyong, Wu, Jinlin, Wu, Jiaxin, Zhang, Zhaoxiang, Lei, Zhen, Li, Qing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Survey on Personalized Content Synthesis with Diffusion Models
por: Zhang, Xulu, et al.
Publicado: (2024)
por: Zhang, Xulu, et al.
Publicado: (2024)
Compositional Inversion for Stable Diffusion Models
por: Zhang, Xulu, et al.
Publicado: (2023)
por: Zhang, Xulu, et al.
Publicado: (2023)
Generative Active Learning for Image Synthesis Personalization
por: Zhang, Xulu, et al.
Publicado: (2024)
por: Zhang, Xulu, et al.
Publicado: (2024)
OmniColor: A Unified Framework for Multi-modal Lineart Colorization
por: Zhang, Xulu, et al.
Publicado: (2026)
por: Zhang, Xulu, et al.
Publicado: (2026)
Expanding Scene Graph Boundaries: Fully Open-vocabulary Scene Graph Generation via Visual-Concept Alignment and Retention
por: Chen, Zuyao, et al.
Publicado: (2023)
por: Chen, Zuyao, et al.
Publicado: (2023)
GPT4SGG: Synthesizing Scene Graphs from Holistic and Region-specific Narratives
por: Chen, Zuyao, et al.
Publicado: (2023)
por: Chen, Zuyao, et al.
Publicado: (2023)
Prior Knowledge Integration via LLM Encoding and Pseudo Event Regulation for Video Moment Retrieval
por: Jiang, Yiyang, et al.
Publicado: (2024)
por: Jiang, Yiyang, et al.
Publicado: (2024)
From Data to Modeling: Fully Open-vocabulary Scene Graph Generation
por: Chen, Zuyao, et al.
Publicado: (2025)
por: Chen, Zuyao, et al.
Publicado: (2025)
Mean of Means: A 10-dollar Solution for Human Localization with Calibration-free and Unconstrained Camera Settings
por: Zhang, Tianyi, et al.
Publicado: (2024)
por: Zhang, Tianyi, et al.
Publicado: (2024)
Mean of Means: Human Localization with Calibration-free and Unconstrained Camera Settings (extended version)
por: Zhang, Tianyi, et al.
Publicado: (2025)
por: Zhang, Tianyi, et al.
Publicado: (2025)
Towards Realistic Hand-Object Interaction with Gravity-Field Based Diffusion Bridge
por: Xu, Miao, et al.
Publicado: (2025)
por: Xu, Miao, et al.
Publicado: (2025)
What Makes a Scene ? Scene Graph-based Evaluation and Feedback for Controllable Generation
por: Chen, Zuyao, et al.
Publicado: (2024)
por: Chen, Zuyao, et al.
Publicado: (2024)
General Geometry-aware Weakly Supervised 3D Object Detection
por: Zhang, Guowen, et al.
Publicado: (2024)
por: Zhang, Guowen, et al.
Publicado: (2024)
Seek for Incantations: Towards Accurate Text-to-Image Diffusion Synthesis through Prompt Engineering
por: Yu, Chang, et al.
Publicado: (2024)
por: Yu, Chang, et al.
Publicado: (2024)
EvolveDirector: Approaching Advanced Text-to-Image Generation with Large Vision-Language Models
por: Zhao, Rui, et al.
Publicado: (2024)
por: Zhao, Rui, et al.
Publicado: (2024)
Open Vocabulary 3D Scene Understanding via Geometry Guided Self-Distillation
por: Wang, Pengfei, et al.
Publicado: (2024)
por: Wang, Pengfei, et al.
Publicado: (2024)
From Competition to Coopetition: Coopetitive Training-Free Image Editing Based on Text Guidance
por: Shen, Jinhao, et al.
Publicado: (2026)
por: Shen, Jinhao, et al.
Publicado: (2026)
Self-similarity Driven Scale-invariant Learning for Weakly Supervised Person Search
por: Wang, Benzhi, et al.
Publicado: (2023)
por: Wang, Benzhi, et al.
Publicado: (2023)
EmoDiffusion: Enhancing Emotional 3D Facial Animation with Latent Diffusion Models
por: Zhang, Yixuan, et al.
Publicado: (2025)
por: Zhang, Yixuan, et al.
Publicado: (2025)
A Curriculum-style Self-training Approach for Source-Free Semantic Segmentation
por: Wang, Yuxi, et al.
Publicado: (2021)
por: Wang, Yuxi, et al.
Publicado: (2021)
GA-Drive: Geometry-Appearance Decoupled Modeling for Free-viewpoint Driving Scene Generation
por: Zhang, Hao, et al.
Publicado: (2026)
por: Zhang, Hao, et al.
Publicado: (2026)
SurgVisAgent: Multimodal Agentic Model for Versatile Surgical Visual Enhancement
por: Lei, Zeyu, et al.
Publicado: (2025)
por: Lei, Zeyu, et al.
Publicado: (2025)
StableMoFusion: Towards Robust and Efficient Diffusion-based Motion Generation Framework
por: Huang, Yiheng, et al.
Publicado: (2024)
por: Huang, Yiheng, et al.
Publicado: (2024)
FIRM: Flexible Interactive Reflection reMoval
por: Chen, Xiao, et al.
Publicado: (2024)
por: Chen, Xiao, et al.
Publicado: (2024)
Planning and Rendering: Towards Product Poster Generation with Diffusion Models
por: Li, Zhaochen, et al.
Publicado: (2023)
por: Li, Zhaochen, et al.
Publicado: (2023)
Top-Down Guidance for Learning Object-Centric Representations
por: Zou, Junhong, et al.
Publicado: (2024)
por: Zou, Junhong, et al.
Publicado: (2024)
Non-confusing Generation of Customized Concepts in Diffusion Models
por: Lin, Wang, et al.
Publicado: (2024)
por: Lin, Wang, et al.
Publicado: (2024)
Improving Large Vision-Language Models' Understanding for Flow Field Data
por: Zhang, Xiaomei, et al.
Publicado: (2025)
por: Zhang, Xiaomei, et al.
Publicado: (2025)
Voxel Mamba: Group-Free State Space Models for Point Cloud based 3D Object Detection
por: Zhang, Guowen, et al.
Publicado: (2024)
por: Zhang, Guowen, et al.
Publicado: (2024)
MPDS: A Movie Posters Dataset for Image Generation with Diffusion Model
por: Xu, Meng, et al.
Publicado: (2024)
por: Xu, Meng, et al.
Publicado: (2024)
ReinDriveGen: Reinforcement Post-Training for Out-of-Distribution Driving Scene Generation
por: Zhang, Hao, et al.
Publicado: (2026)
por: Zhang, Hao, et al.
Publicado: (2026)
Self-Paced Learning for Images of Antinuclear Antibodies
por: Jiang, Yiyang, et al.
Publicado: (2025)
por: Jiang, Yiyang, et al.
Publicado: (2025)
Boosting Diffusion-Based Text Image Super-Resolution Model Towards Generalized Real-World Scenarios
por: Pan, Chenglu, et al.
Publicado: (2025)
por: Pan, Chenglu, et al.
Publicado: (2025)
Generalization of Diffusion Models Arises with a Balanced Representation Space
por: Zhang, Zekai, et al.
Publicado: (2025)
por: Zhang, Zekai, et al.
Publicado: (2025)
UniDA3D: A Unified Domain-Adaptive Framework for Multi-View 3D Object Detection
por: Wu, Hongjing, et al.
Publicado: (2026)
por: Wu, Hongjing, et al.
Publicado: (2026)
SuperEdge: Towards a Generalization Model for Self-Supervised Edge Detection
por: Kai, Leng, et al.
Publicado: (2024)
por: Kai, Leng, et al.
Publicado: (2024)
Toward Generalized Image Quality Assessment: Relaxing the Perfect Reference Quality Assumption
por: Chen, Du, et al.
Publicado: (2025)
por: Chen, Du, et al.
Publicado: (2025)
PolySmart @ TRECVid 2024 Video Captioning (VTT)
por: Wu, Jiaxin, et al.
Publicado: (2024)
por: Wu, Jiaxin, et al.
Publicado: (2024)
GenRec: Unifying Video Generation and Recognition with Diffusion Models
por: Weng, Zejia, et al.
Publicado: (2024)
por: Weng, Zejia, et al.
Publicado: (2024)
GenEvolve: Self-Evolving Image Generation Agents via Tool-Orchestrated Visual Experience Distillation
por: Chen, Sixiang, et al.
Publicado: (2026)
por: Chen, Sixiang, et al.
Publicado: (2026)
Ejemplares similares
-
A Survey on Personalized Content Synthesis with Diffusion Models
por: Zhang, Xulu, et al.
Publicado: (2024) -
Compositional Inversion for Stable Diffusion Models
por: Zhang, Xulu, et al.
Publicado: (2023) -
Generative Active Learning for Image Synthesis Personalization
por: Zhang, Xulu, et al.
Publicado: (2024) -
OmniColor: A Unified Framework for Multi-modal Lineart Colorization
por: Zhang, Xulu, et al.
Publicado: (2026) -
Expanding Scene Graph Boundaries: Fully Open-vocabulary Scene Graph Generation via Visual-Concept Alignment and Retention
por: Chen, Zuyao, et al.
Publicado: (2023)