DTVI: Dual-Stage Textual and Visual Intervention for Safe Text-to-Image Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Tan, Binhong, Wang, Zhaoxin, Wang, Handing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Token-Level Constraint Boundary Search for Jailbreaking Text-to-Image Models
di: Liu, Jiangtao, et al.
Pubblicazione: (2025)
di: Liu, Jiangtao, et al.
Pubblicazione: (2025)
Preventing Catastrophic Overfitting in Fast Adversarial Training: A Bi-level Optimization Perspective
di: Wang, Zhaoxin, et al.
Pubblicazione: (2024)
di: Wang, Zhaoxin, et al.
Pubblicazione: (2024)
Safe-VAR: Safe Visual Autoregressive Model for Text-to-Image Generative Watermarking
di: Wang, Ziyi, et al.
Pubblicazione: (2025)
di: Wang, Ziyi, et al.
Pubblicazione: (2025)
Modular Energy Steering for Safe Text-to-Image Generation with Foundation Models
di: Tan, Yaoteng, et al.
Pubblicazione: (2026)
di: Tan, Yaoteng, et al.
Pubblicazione: (2026)
OrienText: Surface Oriented Textual Image Generation
di: Paliwal, Shubham Singh, et al.
Pubblicazione: (2025)
di: Paliwal, Shubham Singh, et al.
Pubblicazione: (2025)
Universal Prompt Optimizer for Safe Text-to-Image Generation
di: Wu, Zongyu, et al.
Pubblicazione: (2024)
di: Wu, Zongyu, et al.
Pubblicazione: (2024)
Harmonizing Visual and Textual Embeddings for Zero-Shot Text-to-Image Customization
di: Song, Yeji, et al.
Pubblicazione: (2024)
di: Song, Yeji, et al.
Pubblicazione: (2024)
Mismatch Quest: Visual and Textual Feedback for Image-Text Misalignment
di: Gordon, Brian, et al.
Pubblicazione: (2023)
di: Gordon, Brian, et al.
Pubblicazione: (2023)
Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation
di: Luo, Minxing, et al.
Pubblicazione: (2025)
di: Luo, Minxing, et al.
Pubblicazione: (2025)
PromptSafe: Gated Prompt Tuning for Safe Text-to-Image Generation
di: Jing, Zonglei, et al.
Pubblicazione: (2025)
di: Jing, Zonglei, et al.
Pubblicazione: (2025)
Setting the Stage: Text-Driven Scene-Consistent Image Generation
di: Xie, Cong, et al.
Pubblicazione: (2025)
di: Xie, Cong, et al.
Pubblicazione: (2025)
An Empirical Study and Analysis of Text-to-Image Generation Using Large Language Model-Powered Textual Representation
di: Tan, Zhiyu, et al.
Pubblicazione: (2024)
di: Tan, Zhiyu, et al.
Pubblicazione: (2024)
Textual Localization: Decomposing Multi-concept Images for Subject-Driven Text-to-Image Generation
di: Shentu, Junjie, et al.
Pubblicazione: (2024)
di: Shentu, Junjie, et al.
Pubblicazione: (2024)
Beyond the Textual: Generating Coherent Visual Options for MCQs
di: Wang, Wanqiang, et al.
Pubblicazione: (2025)
di: Wang, Wanqiang, et al.
Pubblicazione: (2025)
Visual-CoG: Stage-Aware Reinforcement Learning with Chain of Guidance for Text-to-Image Generation
di: Li, Yaqi, et al.
Pubblicazione: (2025)
di: Li, Yaqi, et al.
Pubblicazione: (2025)
Directional Textual Inversion for Personalized Text-to-Image Generation
di: Kim, Kunhee, et al.
Pubblicazione: (2025)
di: Kim, Kunhee, et al.
Pubblicazione: (2025)
Visual Textualization for Image Prompted Object Detection
di: Wu, Yongjian, et al.
Pubblicazione: (2025)
di: Wu, Yongjian, et al.
Pubblicazione: (2025)
ID-EA: Identity-driven Text Enhancement and Adaptation with Textual Inversion for Personalized Text-to-Image Generation
di: Jin, Hyun-Jun, et al.
Pubblicazione: (2025)
di: Jin, Hyun-Jun, et al.
Pubblicazione: (2025)
Bridging Visual Affective Gap: Borrowing Textual Knowledge by Learning from Noisy Image-Text Pairs
di: Wu, Daiqing, et al.
Pubblicazione: (2025)
di: Wu, Daiqing, et al.
Pubblicazione: (2025)
SafeMo: Linguistically Grounded Unlearning for Trustworthy Text-to-Motion Generation
di: Wang, Yiling, et al.
Pubblicazione: (2026)
di: Wang, Yiling, et al.
Pubblicazione: (2026)
PurifyGen: A Risk-Discrimination and Semantic-Purification Model for Safe Text-to-Image Generation
di: Cao, Zongsheng, et al.
Pubblicazione: (2025)
di: Cao, Zongsheng, et al.
Pubblicazione: (2025)
Beyond Textual CoT: Interleaved Text-Image Chains with Deep Confidence Reasoning for Image Editing
di: Zou, Zhentao, et al.
Pubblicazione: (2025)
di: Zou, Zhentao, et al.
Pubblicazione: (2025)
NSFW-Classifier Guided Prompt Sanitization for Safe Text-to-Image Generation
di: Xie, Yu, et al.
Pubblicazione: (2025)
di: Xie, Yu, et al.
Pubblicazione: (2025)
CustomText: Customized Textual Image Generation using Diffusion Models
di: Paliwal, Shubham, et al.
Pubblicazione: (2024)
di: Paliwal, Shubham, et al.
Pubblicazione: (2024)
Visual Text Generation in the Wild
di: Zhu, Yuanzhi, et al.
Pubblicazione: (2024)
di: Zhu, Yuanzhi, et al.
Pubblicazione: (2024)
Evaluating the Generation of Spatial Relations in Text and Image Generative Models
di: Sim, Shang Hong, et al.
Pubblicazione: (2024)
di: Sim, Shang Hong, et al.
Pubblicazione: (2024)
VCE: Safe Autoregressive Image Generation via Visual Contrast Exploitation
di: Han, Feng, et al.
Pubblicazione: (2025)
di: Han, Feng, et al.
Pubblicazione: (2025)
Render-of-Thought: Rendering Textual Chain-of-Thought as Images for Visual Latent Reasoning
di: Wang, Yifan, et al.
Pubblicazione: (2026)
di: Wang, Yifan, et al.
Pubblicazione: (2026)
Textual Decomposition Then Sub-motion-space Scattering for Open-Vocabulary Motion Generation
di: Fan, Ke, et al.
Pubblicazione: (2024)
di: Fan, Ke, et al.
Pubblicazione: (2024)
SafeGen-Bench: Benchmarking Safety in Image-Conditioned Text-to-Video Generation
di: Ma, Yingzi, et al.
Pubblicazione: (2026)
di: Ma, Yingzi, et al.
Pubblicazione: (2026)
CogBlender: Towards Continuous Cognitive Intervention in Text-to-Image Generation
di: Dang, Shengqi, et al.
Pubblicazione: (2026)
di: Dang, Shengqi, et al.
Pubblicazione: (2026)
From Unlearning to UNBRANDING: A Benchmark for Trademark-Safe Text-to-Image Generation
di: Malarz, Dawid, et al.
Pubblicazione: (2025)
di: Malarz, Dawid, et al.
Pubblicazione: (2025)
Textualize Visual Prompt for Image Editing via Diffusion Bridge
di: Xu, Pengcheng, et al.
Pubblicazione: (2025)
di: Xu, Pengcheng, et al.
Pubblicazione: (2025)
Restore Text First, Enhance Image Later: Two-Stage Scene Text Image Super-Resolution with Glyph Structure Guidance
di: Luo, Minxing, et al.
Pubblicazione: (2025)
di: Luo, Minxing, et al.
Pubblicazione: (2025)
Safe-Sora: Safe Text-to-Video Generation via Graphical Watermarking
di: Su, Zihan, et al.
Pubblicazione: (2025)
di: Su, Zihan, et al.
Pubblicazione: (2025)
TextPSG: Panoptic Scene Graph Generation from Textual Descriptions
di: Zhao, Chengyang, et al.
Pubblicazione: (2023)
di: Zhao, Chengyang, et al.
Pubblicazione: (2023)
UPAM: Unified Prompt Attack in Text-to-Image Generation Models Against Both Textual Filters and Visual Checkers
di: Peng, Duo, et al.
Pubblicazione: (2024)
di: Peng, Duo, et al.
Pubblicazione: (2024)
Probing CLIP's Comprehension of 360-Degree Textual and Visual Semantics
di: Wang, Hai, et al.
Pubblicazione: (2026)
di: Wang, Hai, et al.
Pubblicazione: (2026)
VisualPrompter: Semantic-Aware Prompt Optimization with Visual Feedback for Text-to-Image Synthesis
di: Wu, Shiyu, et al.
Pubblicazione: (2025)
di: Wu, Shiyu, et al.
Pubblicazione: (2025)
Visual and Textual Prompts in VLLMs for Enhancing Emotion Recognition
di: Wang, Zhifeng, et al.
Pubblicazione: (2025)
di: Wang, Zhifeng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Token-Level Constraint Boundary Search for Jailbreaking Text-to-Image Models
di: Liu, Jiangtao, et al.
Pubblicazione: (2025) -
Preventing Catastrophic Overfitting in Fast Adversarial Training: A Bi-level Optimization Perspective
di: Wang, Zhaoxin, et al.
Pubblicazione: (2024) -
Safe-VAR: Safe Visual Autoregressive Model for Text-to-Image Generative Watermarking
di: Wang, Ziyi, et al.
Pubblicazione: (2025) -
Modular Energy Steering for Safe Text-to-Image Generation with Foundation Models
di: Tan, Yaoteng, et al.
Pubblicazione: (2026) -
OrienText: Surface Oriented Textual Image Generation
di: Paliwal, Shubham Singh, et al.
Pubblicazione: (2025)