Diff-Prompt: Diffusion-Driven Prompt Generator with Mask Supervision
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yan, Weicai, Lin, Wang, Guo, Zirun, Wang, Ye, Feng, Fangming, Yang, Xiaoda, Wang, Zehan, Jin, Tao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Low-rank Prompt Interaction for Continual Vision-Language Retrieval
par: Yan, Weicai, et autres
Publié: (2025)
par: Yan, Weicai, et autres
Publié: (2025)
Efficient Prompting for Continual Adaptation to Missing Modalities
par: Guo, Zirun, et autres
Publié: (2025)
par: Guo, Zirun, et autres
Publié: (2025)
Multimodal Prompt Learning with Missing Modalities for Sentiment Analysis and Emotion Recognition
par: Guo, Zirun, et autres
Publié: (2024)
par: Guo, Zirun, et autres
Publié: (2024)
ConceptGuard: Continual Personalized Text-to-Image Generation with Forgetting and Confusion Mitigation
par: Guo, Zirun, et autres
Publié: (2025)
par: Guo, Zirun, et autres
Publié: (2025)
PromptRR: Diffusion Models as Prompt Generators for Single Image Reflection Removal
par: Wang, Tao, et autres
Publié: (2024)
par: Wang, Tao, et autres
Publié: (2024)
Mask-ControlNet: Higher-Quality Image Generation with An Additional Mask Prompt
par: Huang, Zhiqi, et autres
Publié: (2024)
par: Huang, Zhiqi, et autres
Publié: (2024)
PromptMRG: Diagnosis-Driven Prompts for Medical Report Generation
par: Jin, Haibo, et autres
Publié: (2023)
par: Jin, Haibo, et autres
Publié: (2023)
Pro2SAM: Mask Prompt to SAM with Grid Points for Weakly Supervised Object Localization
par: Yang, Xi, et autres
Publié: (2025)
par: Yang, Xi, et autres
Publié: (2025)
Smoothing the Shift: Towards Stable Test-Time Adaptation under Complex Multimodal Noises
par: Guo, Zirun, et autres
Publié: (2025)
par: Guo, Zirun, et autres
Publié: (2025)
Determinism of Randomness: Prompt-Residual Seed Shaping for Diffusion Generation
par: Yan, Song, et autres
Publié: (2025)
par: Yan, Song, et autres
Publié: (2025)
Generalizable Prompt Learning of CLIP: A Brief Overview
par: Cui, Fangming, et autres
Publié: (2025)
par: Cui, Fangming, et autres
Publié: (2025)
APO: Enhancing Reasoning Ability of MLLMs via Asymmetric Policy Optimization
par: Hong, Minjie, et autres
Publié: (2025)
par: Hong, Minjie, et autres
Publié: (2025)
DiffVP: Differential Visual Semantic Prompting for LLM-Based CT Report Generation
par: Tian, Yuhe, et autres
Publié: (2026)
par: Tian, Yuhe, et autres
Publié: (2026)
DiffAtlas: GenAI-fying Atlas Segmentation via Image-Mask Diffusion
par: Zhang, Hantao, et autres
Publié: (2025)
par: Zhang, Hantao, et autres
Publié: (2025)
ProGiDiff: Prompt-Guided Diffusion-Based Medical Image Segmentation
par: Lin, Yuan, et autres
Publié: (2026)
par: Lin, Yuan, et autres
Publié: (2026)
DiffBench Meets DiffAgent: End-to-End LLM-Driven Diffusion Acceleration Code Generation
par: jiao, Jiajun, et autres
Publié: (2026)
par: jiao, Jiajun, et autres
Publié: (2026)
AutoPrompt: Automated Red-Teaming of Text-to-Image Models via LLM-Driven Adversarial Prompts
par: Liu, Yufan, et autres
Publié: (2025)
par: Liu, Yufan, et autres
Publié: (2025)
IP-SAM: Prompt-Space Conditioning for Prompt-Absent Camouflaged Object Detection
par: Zhang, Huiyao, et autres
Publié: (2026)
par: Zhang, Huiyao, et autres
Publié: (2026)
Advancing Prompt Learning through an External Layer
par: Cui, Fangming, et autres
Publié: (2024)
par: Cui, Fangming, et autres
Publié: (2024)
Denoise and Align: Diffusion-Driven Foreground Knowledge Prompting for Open-Vocabulary Temporal Action Detection
par: Zhu, Sa, et autres
Publié: (2026)
par: Zhu, Sa, et autres
Publié: (2026)
Sample-specific Masks for Visual Reprogramming-based Prompting
par: Cai, Chengyi, et autres
Publié: (2024)
par: Cai, Chengyi, et autres
Publié: (2024)
Prompt Reinjection: Alleviating Prompt Forgetting in Multimodal Diffusion Transformers
par: Yao, Yuxuan, et autres
Publié: (2026)
par: Yao, Yuxuan, et autres
Publié: (2026)
ChangeDiff: A Multi-Temporal Change Detection Data Generator with Flexible Text Prompts via Diffusion Model
par: Zang, Qi, et autres
Publié: (2024)
par: Zang, Qi, et autres
Publié: (2024)
PromptDresser: Improving the Quality and Controllability of Virtual Try-On via Generative Textual Prompt and Prompt-aware Mask
par: Kim, Jeongho, et autres
Publié: (2024)
par: Kim, Jeongho, et autres
Publié: (2024)
Vision-guided and Mask-enhanced Adaptive Denoising for Prompt-based Image Editing
par: Wang, Kejie, et autres
Publié: (2024)
par: Wang, Kejie, et autres
Publié: (2024)
TextDiff: Mask-Guided Residual Diffusion Models for Scene Text Image Super-Resolution
par: Liu, Baolin, et autres
Publié: (2023)
par: Liu, Baolin, et autres
Publié: (2023)
Prompt-Driven Feature Diffusion for Open-World Semi-Supervised Learning
par: Heidari, Marzi, et autres
Publié: (2024)
par: Heidari, Marzi, et autres
Publié: (2024)
Text-Guided Multi-Scale Frequency Representation Adaptation
par: Yan, Weicai, et autres
Publié: (2026)
par: Yan, Weicai, et autres
Publié: (2026)
Enhancing Prompt Following with Visual Control Through Training-Free Mask-Guided Diffusion
par: Chen, Hongyu, et autres
Publié: (2024)
par: Chen, Hongyu, et autres
Publié: (2024)
LLM-I: LLMs are Naturally Interleaved Multimodal Creators
par: Guo, Zirun, et autres
Publié: (2025)
par: Guo, Zirun, et autres
Publié: (2025)
Pixel-Perfect Depth with Semantics-Prompted Diffusion Transformers
par: Xu, Gangwei, et autres
Publié: (2025)
par: Xu, Gangwei, et autres
Publié: (2025)
ImVideoEdit: Image-learning Video Editing via 2D Spatial Difference Attention Blocks
par: Xu, Jiayang, et autres
Publié: (2026)
par: Xu, Jiayang, et autres
Publié: (2026)
Decoupling Stability and Plasticity for Multi-Modal Test-Time Adaptation
par: He, Yongbo, et autres
Publié: (2026)
par: He, Yongbo, et autres
Publié: (2026)
Diff-Restorer: Unleashing Visual Prompts for Diffusion-based Universal Image Restoration
par: Zhang, Yuhong, et autres
Publié: (2024)
par: Zhang, Yuhong, et autres
Publié: (2024)
PromptStereo: Zero-Shot Stereo Matching via Structure and Motion Prompts
par: Wang, Xianqi, et autres
Publié: (2026)
par: Wang, Xianqi, et autres
Publié: (2026)
Climate Prompting: Generating the Madden-Julian Oscillation using Video Diffusion and Low-Dimensional Conditioning
par: Thual, Sulian, et autres
Publié: (2026)
par: Thual, Sulian, et autres
Publié: (2026)
PromptMono: Cross Prompting Attention for Self-Supervised Monocular Depth Estimation in Challenging Environments
par: Wang, Changhao, et autres
Publié: (2025)
par: Wang, Changhao, et autres
Publié: (2025)
Regressor-Segmenter Mutual Prompt Learning for Crowd Counting
par: Guo, Mingyue, et autres
Publié: (2023)
par: Guo, Mingyue, et autres
Publié: (2023)
Transitive Vision-Language Prompt Learning for Domain Generalization
par: Wang, Liyuan, et autres
Publié: (2024)
par: Wang, Liyuan, et autres
Publié: (2024)
Diffusion-Based sRGB Real Noise Generation via Prompt-Driven Noise Representation Learning
par: Ko, Jaekyun, et autres
Publié: (2026)
par: Ko, Jaekyun, et autres
Publié: (2026)
Documents similaires
-
Low-rank Prompt Interaction for Continual Vision-Language Retrieval
par: Yan, Weicai, et autres
Publié: (2025) -
Efficient Prompting for Continual Adaptation to Missing Modalities
par: Guo, Zirun, et autres
Publié: (2025) -
Multimodal Prompt Learning with Missing Modalities for Sentiment Analysis and Emotion Recognition
par: Guo, Zirun, et autres
Publié: (2024) -
ConceptGuard: Continual Personalized Text-to-Image Generation with Forgetting and Confusion Mitigation
par: Guo, Zirun, et autres
Publié: (2025) -
PromptRR: Diffusion Models as Prompt Generators for Single Image Reflection Removal
par: Wang, Tao, et autres
Publié: (2024)