Towards Reliable Identification of Diffusion-based Image Manipulations
Fuente:
arXiv
Salvato in:
| Autori principali: | Costanzino, Alex, Bayliss, Woody, Sock, Juil, Blanch, Marc Gorriz, Horak, Danijela, Laptev, Ivan, Torr, Philip, Pizzati, Fabio |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LikePhys: Evaluating Intuitive Physics Understanding in Video Diffusion Models via Likelihood Preference
di: Yuan, Jianhao, et al.
Pubblicazione: (2025)
di: Yuan, Jianhao, et al.
Pubblicazione: (2025)
Specify and Edit: Overcoming Ambiguity in Text-Based Image Editing
di: Iakovleva, Ekaterina, et al.
Pubblicazione: (2024)
di: Iakovleva, Ekaterina, et al.
Pubblicazione: (2024)
Video Motion Transfer with Diffusion Transformers
di: Pondaven, Alexander, et al.
Pubblicazione: (2024)
di: Pondaven, Alexander, et al.
Pubblicazione: (2024)
Toward Robust Real-World Audio Deepfake Detection: Closing the Explainability Gap
di: Channing, Georgia, et al.
Pubblicazione: (2024)
di: Channing, Georgia, et al.
Pubblicazione: (2024)
MessyKitchens: Contact-rich object-level 3D scene reconstruction
di: Ansari, Junaid Ahmed, et al.
Pubblicazione: (2026)
di: Ansari, Junaid Ahmed, et al.
Pubblicazione: (2026)
Learning to Generate Rigid Body Interactions with Video Diffusion Models
di: Romero, David, et al.
Pubblicazione: (2025)
di: Romero, David, et al.
Pubblicazione: (2025)
ActCam: Zero-Shot Joint Camera and 3D Motion Control for Video Generation
di: Khalifi, Omar El, et al.
Pubblicazione: (2026)
di: Khalifi, Omar El, et al.
Pubblicazione: (2026)
MatchDiffusion: Training-free Generation of Match-cuts
di: Pardo, Alejandro, et al.
Pubblicazione: (2024)
di: Pardo, Alejandro, et al.
Pubblicazione: (2024)
Latent Guard: a Safety Framework for Text-to-image Generation
di: Liu, Runtao, et al.
Pubblicazione: (2024)
di: Liu, Runtao, et al.
Pubblicazione: (2024)
SALAD: Part-Level Latent Diffusion for 3D Shape Generation and Manipulation
di: Koo, Juil, et al.
Pubblicazione: (2023)
di: Koo, Juil, et al.
Pubblicazione: (2023)
ActionParty: Multi-Subject Action Binding in Generative Video Games
di: Pondaven, Alexander, et al.
Pubblicazione: (2026)
di: Pondaven, Alexander, et al.
Pubblicazione: (2026)
MAD-Sherlock: Multi-Agent Debate for Visual Misinformation Detection
di: Lakara, Kumud, et al.
Pubblicazione: (2024)
di: Lakara, Kumud, et al.
Pubblicazione: (2024)
AlignGuard: Scalable Safety Alignment for Text-to-Image Generation
di: Liu, Runtao, et al.
Pubblicazione: (2024)
di: Liu, Runtao, et al.
Pubblicazione: (2024)
On Pretraining Data Diversity for Self-Supervised Learning
di: Hammoud, Hasan Abed Al Kader, et al.
Pubblicazione: (2024)
di: Hammoud, Hasan Abed Al Kader, et al.
Pubblicazione: (2024)
SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?
di: Hammoud, Hasan Abed Al Kader, et al.
Pubblicazione: (2024)
di: Hammoud, Hasan Abed Al Kader, et al.
Pubblicazione: (2024)
PhysMoDPO: Physically-Plausible Humanoid Motion with Preference Optimization
di: Zhang, Yangsong, et al.
Pubblicazione: (2026)
di: Zhang, Yangsong, et al.
Pubblicazione: (2026)
Booster: a Benchmark for Depth from Images of Specular and Transparent Surfaces
di: Ramirez, Pierluigi Zama, et al.
Pubblicazione: (2023)
di: Ramirez, Pierluigi Zama, et al.
Pubblicazione: (2023)
ViViDex: Learning Vision-based Dexterous Manipulation from Human Videos
di: Chen, Zerui, et al.
Pubblicazione: (2024)
di: Chen, Zerui, et al.
Pubblicazione: (2024)
DreamPolisher: Towards High-Quality Text-to-3D Generation via Geometric Diffusion
di: Lin, Yuanze, et al.
Pubblicazione: (2024)
di: Lin, Yuanze, et al.
Pubblicazione: (2024)
BLAZER: Bootstrapping LLM-based Manipulation Agents with Zero-Shot Data Generation
di: Das, Rocktim Jyoti, et al.
Pubblicazione: (2025)
di: Das, Rocktim Jyoti, et al.
Pubblicazione: (2025)
Not Just Pretty Pictures: Toward Interventional Data Augmentation Using Text-to-Image Generators
di: Yuan, Jianhao, et al.
Pubblicazione: (2022)
di: Yuan, Jianhao, et al.
Pubblicazione: (2022)
Multimodal Industrial Anomaly Detection by Crossmodal Feature Mapping
di: Costanzino, Alex, et al.
Pubblicazione: (2023)
di: Costanzino, Alex, et al.
Pubblicazione: (2023)
Modulate-and-Map: Crossmodal Feature Mapping with Cross-View Modulation for 3D Anomaly Detection
di: Costanzino, Alex, et al.
Pubblicazione: (2026)
di: Costanzino, Alex, et al.
Pubblicazione: (2026)
Learning to Be a Transformer to Pinpoint Anomalies
di: Costanzino, Alex, et al.
Pubblicazione: (2024)
di: Costanzino, Alex, et al.
Pubblicazione: (2024)
SyncTweedies: A General Generative Framework Based on Synchronized Diffusions
di: Kim, Jaihoon, et al.
Pubblicazione: (2024)
di: Kim, Jaihoon, et al.
Pubblicazione: (2024)
Self-Discovering Interpretable Diffusion Latent Directions for Responsible Text-to-Image Generation
di: Li, Hang, et al.
Pubblicazione: (2023)
di: Li, Hang, et al.
Pubblicazione: (2023)
VFusion3D: Learning Scalable 3D Generative Models from Video Diffusion Models
di: Han, Junlin, et al.
Pubblicazione: (2024)
di: Han, Junlin, et al.
Pubblicazione: (2024)
Posterior Distillation Sampling
di: Koo, Juil, et al.
Pubblicazione: (2023)
di: Koo, Juil, et al.
Pubblicazione: (2023)
Toward Ambulatory Vision: Learning Visually-Grounded Active View Selection
di: Koo, Juil, et al.
Pubblicazione: (2025)
di: Koo, Juil, et al.
Pubblicazione: (2025)
WildVidFit: Video Virtual Try-On in the Wild via Image-Based Controlled Diffusion Models
di: He, Zijian, et al.
Pubblicazione: (2024)
di: He, Zijian, et al.
Pubblicazione: (2024)
PSyDUCK: Training-Free Steganography for Latent Diffusion
di: Mahfuz, Aqib, et al.
Pubblicazione: (2025)
di: Mahfuz, Aqib, et al.
Pubblicazione: (2025)
An Image Is Worth 1000 Lies: Adversarial Transferability across Prompts on Vision-Language Models
di: Luo, Haochen, et al.
Pubblicazione: (2024)
di: Luo, Haochen, et al.
Pubblicazione: (2024)
Beyond Sliders: Mastering the Art of Diffusion-based Image Manipulation
di: Tang, Yufei, et al.
Pubblicazione: (2025)
di: Tang, Yufei, et al.
Pubblicazione: (2025)
MALT: Improving Reasoning with Multi-Agent LLM Training
di: Motwani, Sumeet Ramesh, et al.
Pubblicazione: (2024)
di: Motwani, Sumeet Ramesh, et al.
Pubblicazione: (2024)
SUGAR: Pre-training 3D Visual Representations for Robotics
di: Chen, Shizhe, et al.
Pubblicazione: (2024)
di: Chen, Shizhe, et al.
Pubblicazione: (2024)
SF20K Competition 2025: Summary and findings
di: Ghermi, Ridouane, et al.
Pubblicazione: (2026)
di: Ghermi, Ridouane, et al.
Pubblicazione: (2026)
ScanEdit: Hierarchically-Guided Functional 3D Scan Editing
di: Boudjoghra, Mohamed el amine, et al.
Pubblicazione: (2025)
di: Boudjoghra, Mohamed el amine, et al.
Pubblicazione: (2025)
TRCE: Towards Reliable Malicious Concept Erasure in Text-to-Image Diffusion Models
di: Chen, Ruidong, et al.
Pubblicazione: (2025)
di: Chen, Ruidong, et al.
Pubblicazione: (2025)
Towards Generalized Image Manipulation Localization via Score-based Model
di: Wang, Yunfei, et al.
Pubblicazione: (2026)
di: Wang, Yunfei, et al.
Pubblicazione: (2026)
DEFT: Decompositional Efficient Fine-Tuning for Text-to-Image Models
di: Kumar, Komal, et al.
Pubblicazione: (2025)
di: Kumar, Komal, et al.
Pubblicazione: (2025)
Documenti analoghi
-
LikePhys: Evaluating Intuitive Physics Understanding in Video Diffusion Models via Likelihood Preference
di: Yuan, Jianhao, et al.
Pubblicazione: (2025) -
Specify and Edit: Overcoming Ambiguity in Text-Based Image Editing
di: Iakovleva, Ekaterina, et al.
Pubblicazione: (2024) -
Video Motion Transfer with Diffusion Transformers
di: Pondaven, Alexander, et al.
Pubblicazione: (2024) -
Toward Robust Real-World Audio Deepfake Detection: Closing the Explainability Gap
di: Channing, Georgia, et al.
Pubblicazione: (2024) -
MessyKitchens: Contact-rich object-level 3D scene reconstruction
di: Ansari, Junaid Ahmed, et al.
Pubblicazione: (2026)