Exposing Text-Image Inconsistency Using Diffusion Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Mingzhen, Jia, Shan, Zhou, Zhou, Ju, Yan, Cai, Jialing, Lyu, Siwei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ParallelEdits: Efficient Multi-object Image Editing
di: Huang, Mingzhen, et al.
Pubblicazione: (2024)
di: Huang, Mingzhen, et al.
Pubblicazione: (2024)
Exposing Lip-syncing Deepfakes from Mouth Inconsistencies
di: Datta, Soumyya Kanti, et al.
Pubblicazione: (2024)
di: Datta, Soumyya Kanti, et al.
Pubblicazione: (2024)
Detecting Lip-Syncing Deepfakes: Vision Temporal Transformer for Analyzing Mouth Inconsistencies
di: Datta, Soumyya Kanti, et al.
Pubblicazione: (2025)
di: Datta, Soumyya Kanti, et al.
Pubblicazione: (2025)
Analyzing and Improving Fast Sampling of Text-to-Image Diffusion Models
di: Zhou, Zhenyu, et al.
Pubblicazione: (2026)
di: Zhou, Zhenyu, et al.
Pubblicazione: (2026)
Dense Feature Interaction Network for Image Inpainting Localization
di: Yao, Ye, et al.
Pubblicazione: (2024)
di: Yao, Ye, et al.
Pubblicazione: (2024)
Simple and Fast Distillation of Diffusion Models
di: Zhou, Zhenyu, et al.
Pubblicazione: (2024)
di: Zhou, Zhenyu, et al.
Pubblicazione: (2024)
A Single Neuron Works: Precise Concept Erasure in Text-to-Image Diffusion Models
di: He, Qinqin, et al.
Pubblicazione: (2025)
di: He, Qinqin, et al.
Pubblicazione: (2025)
From Text to Mask: Localizing Entities Using the Attention of Text-to-Image Diffusion Models
di: Xiao, Changming, et al.
Pubblicazione: (2023)
di: Xiao, Changming, et al.
Pubblicazione: (2023)
DICE: Distilling Classifier-Free Guidance into Text Embeddings
di: Zhou, Zhenyu, et al.
Pubblicazione: (2025)
di: Zhou, Zhenyu, et al.
Pubblicazione: (2025)
Your Text Encoder Can Be An Object-Level Watermarking Controller
di: Devulapally, Naresh Kumar, et al.
Pubblicazione: (2025)
di: Devulapally, Naresh Kumar, et al.
Pubblicazione: (2025)
Exploring Specular Reflection Inconsistency for Generalizable Face Forgery Detection
di: Fei, Hongyan, et al.
Pubblicazione: (2026)
di: Fei, Hongyan, et al.
Pubblicazione: (2026)
HMGIE: Hierarchical and Multi-Grained Inconsistency Evaluation for Vision-Language Data Cleansing
di: Zhu, Zihao, et al.
Pubblicazione: (2024)
di: Zhu, Zihao, et al.
Pubblicazione: (2024)
EruDiff: Refactoring Knowledge in Diffusion Models for Advanced Text-to-Image Synthesis
di: Guo, Xiefan, et al.
Pubblicazione: (2026)
di: Guo, Xiefan, et al.
Pubblicazione: (2026)
Geometric Regularity in Deterministic Sampling Dynamics of Diffusion-based Generative Models
di: Chen, Defang, et al.
Pubblicazione: (2025)
di: Chen, Defang, et al.
Pubblicazione: (2025)
TextDiff: Mask-Guided Residual Diffusion Models for Scene Text Image Super-Resolution
di: Liu, Baolin, et al.
Pubblicazione: (2023)
di: Liu, Baolin, et al.
Pubblicazione: (2023)
Controllable Generation with Text-to-Image Diffusion Models: A Survey
di: Cao, Pu, et al.
Pubblicazione: (2024)
di: Cao, Pu, et al.
Pubblicazione: (2024)
Image2Text2Image: A Novel Framework for Label-Free Evaluation of Image-to-Text Generation with Text-to-Image Diffusion Models
di: Huang, Jia-Hong, et al.
Pubblicazione: (2024)
di: Huang, Jia-Hong, et al.
Pubblicazione: (2024)
DiT-Air: Revisiting the Efficiency of Diffusion Model Architecture Design in Text to Image Generation
di: Chen, Chen, et al.
Pubblicazione: (2025)
di: Chen, Chen, et al.
Pubblicazione: (2025)
T2IShield: Defending Against Backdoors on Text-to-Image Diffusion Models
di: Wang, Zhongqi, et al.
Pubblicazione: (2024)
di: Wang, Zhongqi, et al.
Pubblicazione: (2024)
Bokeh Diffusion: Defocus Blur Control in Text-to-Image Diffusion Models
di: Fortes, Armando, et al.
Pubblicazione: (2025)
di: Fortes, Armando, et al.
Pubblicazione: (2025)
Dynamic Attention Analysis for Backdoor Detection in Text-to-Image Diffusion Models
di: Wang, Zhongqi, et al.
Pubblicazione: (2025)
di: Wang, Zhongqi, et al.
Pubblicazione: (2025)
Exposing and Defending the Achilles' Heel of Video Mixture-of-Experts
di: Wang, Songping, et al.
Pubblicazione: (2026)
di: Wang, Songping, et al.
Pubblicazione: (2026)
DesignDiffusion: High-Quality Text-to-Design Image Generation with Diffusion Models
di: Wang, Zhendong, et al.
Pubblicazione: (2025)
di: Wang, Zhendong, et al.
Pubblicazione: (2025)
StyleInject: Parameter Efficient Tuning of Text-to-Image Diffusion Models
di: Zhou, Mohan, et al.
Pubblicazione: (2024)
di: Zhou, Mohan, et al.
Pubblicazione: (2024)
On the Trajectory Regularity of ODE-based Diffusion Sampling
di: Chen, Defang, et al.
Pubblicazione: (2024)
di: Chen, Defang, et al.
Pubblicazione: (2024)
Progressive Text-to-Image Diffusion with Soft Latent Direction
di: Ye, YuTeng, et al.
Pubblicazione: (2023)
di: Ye, YuTeng, et al.
Pubblicazione: (2023)
CoDA: From Text-to-Image Diffusion Models to Training-Free Dataset Distillation
di: Zhou, Letian, et al.
Pubblicazione: (2025)
di: Zhou, Letian, et al.
Pubblicazione: (2025)
StyleBlend: Enhancing Style-Specific Content Creation in Text-to-Image Diffusion Models
di: Chen, Zichong, et al.
Pubblicazione: (2025)
di: Chen, Zichong, et al.
Pubblicazione: (2025)
VisualPrompter: Semantic-Aware Prompt Optimization with Visual Feedback for Text-to-Image Synthesis
di: Wu, Shiyu, et al.
Pubblicazione: (2025)
di: Wu, Shiyu, et al.
Pubblicazione: (2025)
CaO$_2$: Rectifying Inconsistencies in Diffusion-Based Dataset Distillation
di: Wang, Haoxuan, et al.
Pubblicazione: (2025)
di: Wang, Haoxuan, et al.
Pubblicazione: (2025)
Stable Diffusion Exposed: Gender Bias from Prompt to Image
di: Wu, Yankun, et al.
Pubblicazione: (2023)
di: Wu, Yankun, et al.
Pubblicazione: (2023)
A Dataset and Benchmark for Copyright Infringement Unlearning from Text-to-Image Diffusion Models
di: Ma, Rui, et al.
Pubblicazione: (2024)
di: Ma, Rui, et al.
Pubblicazione: (2024)
DeepFake-O-Meter v2.0: An Open Platform for DeepFake Detection
di: Ju, Yan, et al.
Pubblicazione: (2024)
di: Ju, Yan, et al.
Pubblicazione: (2024)
EfficientMT: Efficient Temporal Adaptation for Motion Transfer in Text-to-Video Diffusion Models
di: Cai, Yufei, et al.
Pubblicazione: (2025)
di: Cai, Yufei, et al.
Pubblicazione: (2025)
Unsupervised Modality Adaptation with Text-to-Image Diffusion Models for Semantic Segmentation
di: Xia, Ruihao, et al.
Pubblicazione: (2024)
di: Xia, Ruihao, et al.
Pubblicazione: (2024)
A Dense Reward View on Aligning Text-to-Image Diffusion with Preference
di: Yang, Shentao, et al.
Pubblicazione: (2024)
di: Yang, Shentao, et al.
Pubblicazione: (2024)
CAT Pruning: Cluster-Aware Token Pruning For Text-to-Image Diffusion Models
di: Cheng, Xinle, et al.
Pubblicazione: (2025)
di: Cheng, Xinle, et al.
Pubblicazione: (2025)
Tamper-evident Image using JPEG Fixed Points
di: Si, Zhaofeng, et al.
Pubblicazione: (2025)
di: Si, Zhaofeng, et al.
Pubblicazione: (2025)
EmoGen: Emotional Image Content Generation with Text-to-Image Diffusion Models
di: Yang, Jingyuan, et al.
Pubblicazione: (2024)
di: Yang, Jingyuan, et al.
Pubblicazione: (2024)
Test-time Conditional Text-to-Image Synthesis Using Diffusion Models
di: Shukla, Tripti, et al.
Pubblicazione: (2024)
di: Shukla, Tripti, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ParallelEdits: Efficient Multi-object Image Editing
di: Huang, Mingzhen, et al.
Pubblicazione: (2024) -
Exposing Lip-syncing Deepfakes from Mouth Inconsistencies
di: Datta, Soumyya Kanti, et al.
Pubblicazione: (2024) -
Detecting Lip-Syncing Deepfakes: Vision Temporal Transformer for Analyzing Mouth Inconsistencies
di: Datta, Soumyya Kanti, et al.
Pubblicazione: (2025) -
Analyzing and Improving Fast Sampling of Text-to-Image Diffusion Models
di: Zhou, Zhenyu, et al.
Pubblicazione: (2026) -
Dense Feature Interaction Network for Image Inpainting Localization
di: Yao, Ye, et al.
Pubblicazione: (2024)