Prompt-Free Conditional Diffusion for Multi-object Image Augmentation
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Haoyu, Zhang, Lei, Wei, Wei, Ding, Chen, Zhang, Yanning |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
JoDiffusion: Jointly Diffusing Image with Pixel-Level Annotations for Semantic Segmentation Promotion
por: Wang, Haoyu, et al.
Publicado: (2025)
por: Wang, Haoyu, et al.
Publicado: (2025)
No Other Representation Component Is Needed: Diffusion Transformers Can Provide Representation Guidance by Themselves
por: Jiang, Dengyang, et al.
Publicado: (2025)
por: Jiang, Dengyang, et al.
Publicado: (2025)
DCI: Dual-Conditional Inversion for Boosting Diffusion-Based Image Editing
por: Li, Zixiang, et al.
Publicado: (2025)
por: Li, Zixiang, et al.
Publicado: (2025)
Low-Biased General Annotated Dataset Generation
por: Jiang, Dengyang, et al.
Publicado: (2024)
por: Jiang, Dengyang, et al.
Publicado: (2024)
Dual-Modal Prompting for Sketch-Based Image Retrieval
por: Gao, Liying, et al.
Publicado: (2024)
por: Gao, Liying, et al.
Publicado: (2024)
Meta-Exploiting Frequency Prior for Cross-Domain Few-Shot Learning
por: Zhou, Fei, et al.
Publicado: (2024)
por: Zhou, Fei, et al.
Publicado: (2024)
TINA: Text-Free Inversion Attack for Unlearned Text-to-Image Diffusion Models
por: Xiang, Qianlong, et al.
Publicado: (2026)
por: Xiang, Qianlong, et al.
Publicado: (2026)
Visual Prompt Selection for In-Context Learning Segmentation
por: Suo, Wei, et al.
Publicado: (2024)
por: Suo, Wei, et al.
Publicado: (2024)
Dynamic Prompting of Frozen Text-to-Image Diffusion Models for Panoptic Narrative Grounding
por: Li, Hongyu, et al.
Publicado: (2024)
por: Li, Hongyu, et al.
Publicado: (2024)
Self-Supervised High Dynamic Range Imaging with Multi-Exposure Images in Dynamic Scenes
por: Zhang, Zhilu, et al.
Publicado: (2023)
por: Zhang, Zhilu, et al.
Publicado: (2023)
A Plug-and-Play Method for Rare Human-Object Interactions Detection by Bridging Domain Gap
por: Zhang, Lijun, et al.
Publicado: (2024)
por: Zhang, Lijun, et al.
Publicado: (2024)
UniTriGen: Unified Triplet Generation of Aligned Visible-Infrared-Label for Few-Shot RGB-T Semantic Segmentation
por: Zhou, Ping, et al.
Publicado: (2026)
por: Zhou, Ping, et al.
Publicado: (2026)
Advancing Pose-Guided Image Synthesis with Progressive Conditional Diffusion Models
por: Shen, Fei, et al.
Publicado: (2023)
por: Shen, Fei, et al.
Publicado: (2023)
Prompt-Softbox-Prompt: A Free-Text Embedding Control for Image Editing
por: Yang, Yitong, et al.
Publicado: (2024)
por: Yang, Yitong, et al.
Publicado: (2024)
Source Prompt Disentangled Inversion for Boosting Image Editability with Diffusion Models
por: Li, Ruibin, et al.
Publicado: (2024)
por: Li, Ruibin, et al.
Publicado: (2024)
Short-LVLM: Compressing and Accelerating Large Vision-Language Models by Pruning Redundant Layers
por: Ma, Ji, et al.
Publicado: (2025)
por: Ma, Ji, et al.
Publicado: (2025)
C3L: Content Correlated Vision-Language Instruction Tuning Data Generation via Contrastive Learning
por: Ma, Ji, et al.
Publicado: (2024)
por: Ma, Ji, et al.
Publicado: (2024)
Understanding and Mitigating Hallucinations in Multimodal Chain-of-Thought Models
por: Ma, Ji, et al.
Publicado: (2026)
por: Ma, Ji, et al.
Publicado: (2026)
Multi-focal Conditioned Latent Diffusion for Person Image Synthesis
por: Liu, Jiaqi, et al.
Publicado: (2025)
por: Liu, Jiaqi, et al.
Publicado: (2025)
CCDM: Continuous Conditional Diffusion Models for Image Generation
por: Ding, Xin, et al.
Publicado: (2024)
por: Ding, Xin, et al.
Publicado: (2024)
Image Super-Resolution with Text Prompt Diffusion
por: Chen, Zheng, et al.
Publicado: (2023)
por: Chen, Zheng, et al.
Publicado: (2023)
EMMA: Your Text-to-Image Diffusion Model Can Secretly Accept Multi-Modal Prompts
por: Han, Yucheng, et al.
Publicado: (2024)
por: Han, Yucheng, et al.
Publicado: (2024)
Adaptive Spatial Augmentation for Semi-supervised Semantic Segmentation
por: Ran, Lingyan, et al.
Publicado: (2025)
por: Ran, Lingyan, et al.
Publicado: (2025)
Local Conditional Controlling for Text-to-Image Diffusion Models
por: Zhao, Yibo, et al.
Publicado: (2023)
por: Zhao, Yibo, et al.
Publicado: (2023)
Towards Flexible, Scalable, and Adaptive Multi-Modal Conditioned Face Synthesis
por: Ren, Jingjing, et al.
Publicado: (2023)
por: Ren, Jingjing, et al.
Publicado: (2023)
Human-Free Automated Prompting for Vision-Language Anomaly Detection: Prompt Optimization with Meta-guiding Prompt Scheme
por: Chen, Pi-Wei, et al.
Publicado: (2024)
por: Chen, Pi-Wei, et al.
Publicado: (2024)
MV-VTON: Multi-View Virtual Try-On with Diffusion Models
por: Wang, Haoyu, et al.
Publicado: (2024)
por: Wang, Haoyu, et al.
Publicado: (2024)
PromptRR: Diffusion Models as Prompt Generators for Single Image Reflection Removal
por: Wang, Tao, et al.
Publicado: (2024)
por: Wang, Tao, et al.
Publicado: (2024)
Skip and Skip: Segmenting Medical Images with Prompts
por: Chen, Jiawei, et al.
Publicado: (2024)
por: Chen, Jiawei, et al.
Publicado: (2024)
MP-HSIR: A Multi-Prompt Framework for Universal Hyperspectral Image Restoration
por: Wu, Zhehui, et al.
Publicado: (2025)
por: Wu, Zhehui, et al.
Publicado: (2025)
FreeGraftor: Training-Free Cross-Image Feature Grafting for Subject-Driven Text-to-Image Generation
por: Yao, Zebin, et al.
Publicado: (2025)
por: Yao, Zebin, et al.
Publicado: (2025)
MAPLE: Multi-scale Attribute-enhanced Prompt Learning for Few-shot Whole Slide Image Classification
por: Zhou, Junjie, et al.
Publicado: (2025)
por: Zhou, Junjie, et al.
Publicado: (2025)
MultiDiffSense: Diffusion-Based Multi-Modal Visuo-Tactile Image Generation Conditioned on Object Shape and Contact Pose
por: Bhouri, Sirine, et al.
Publicado: (2026)
por: Bhouri, Sirine, et al.
Publicado: (2026)
Prior Normality Prompt Transformer for Multi-class Industrial Image Anomaly Detection
por: Yao, Haiming, et al.
Publicado: (2024)
por: Yao, Haiming, et al.
Publicado: (2024)
Hierarchical Self-Prompting SAM: A Prompt-Free Medical Image Segmentation Framework
por: Zhang, Mengmeng, et al.
Publicado: (2025)
por: Zhang, Mengmeng, et al.
Publicado: (2025)
Uncertainty-Aware Source-Free Adaptive Image Super-Resolution with Wavelet Augmentation Transformer
por: Ai, Yuang, et al.
Publicado: (2023)
por: Ai, Yuang, et al.
Publicado: (2023)
Rethinking Diffusion Model for Multi-Contrast MRI Super-Resolution
por: Li, Guangyuan, et al.
Publicado: (2024)
por: Li, Guangyuan, et al.
Publicado: (2024)
Prompting4Debugging: Red-Teaming Text-to-Image Diffusion Models by Finding Problematic Prompts
por: Chin, Zhi-Yi, et al.
Publicado: (2023)
por: Chin, Zhi-Yi, et al.
Publicado: (2023)
Multi-Scale Diffusion: Enhancing Spatial Layout in High-Resolution Panoramic Image Generation
por: Zhang, Xiaoyu, et al.
Publicado: (2024)
por: Zhang, Xiaoyu, et al.
Publicado: (2024)
CBDiff:Conditional Bernoulli Diffusion Models for Image Forgery Localization
por: Lei, Zhou, et al.
Publicado: (2025)
por: Lei, Zhou, et al.
Publicado: (2025)
Ejemplares similares
-
JoDiffusion: Jointly Diffusing Image with Pixel-Level Annotations for Semantic Segmentation Promotion
por: Wang, Haoyu, et al.
Publicado: (2025) -
No Other Representation Component Is Needed: Diffusion Transformers Can Provide Representation Guidance by Themselves
por: Jiang, Dengyang, et al.
Publicado: (2025) -
DCI: Dual-Conditional Inversion for Boosting Diffusion-Based Image Editing
por: Li, Zixiang, et al.
Publicado: (2025) -
Low-Biased General Annotated Dataset Generation
por: Jiang, Dengyang, et al.
Publicado: (2024) -
Dual-Modal Prompting for Sketch-Based Image Retrieval
por: Gao, Liying, et al.
Publicado: (2024)