Immune2V: Image Immunization Against Dual-Stream Image-to-Video Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Long, Zeqian, Kara, Ozgur, Xue, Haotian, Chen, Yongxin, Rehg, James M. |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DiffVax: Optimization-Free Image Immunization Against Diffusion-Based Editing
par: Ozden, Tarik Can, et autres
Publié: (2024)
par: Ozden, Tarik Can, et autres
Publié: (2024)
DiffEye: Diffusion-Based Continuous Eye-Tracking Data Generation Conditioned on Natural Images
par: Kara, Ozgur, et autres
Publié: (2025)
par: Kara, Ozgur, et autres
Publié: (2025)
RefDrop: Controllable Consistency in Image or Video Generation via Reference Feature Guidance
par: Fan, Jiaojiao, et autres
Publié: (2024)
par: Fan, Jiaojiao, et autres
Publié: (2024)
ShotAdapter: Text-to-Multi-Shot Video Generation with Diffusion Models
par: Kara, Ozgur, et autres
Publié: (2025)
par: Kara, Ozgur, et autres
Publié: (2025)
Layer-Aware Video Composition via Split-then-Merge
par: Kara, Ozgur, et autres
Publié: (2025)
par: Kara, Ozgur, et autres
Publié: (2025)
Cue3D: Quantifying the Role of Image Cues in Single-Image 3D Generation
par: Li, Xiang, et autres
Publié: (2025)
par: Li, Xiang, et autres
Publié: (2025)
Symmetry Strikes Back: From Single-Image Symmetry Detection to 3D Generation
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
Pixel is a Barrier: Diffusion Models Are More Adversarially Robust Than We Think
par: Xue, Haotian, et autres
Publié: (2024)
par: Xue, Haotian, et autres
Publié: (2024)
Diffusion Policy Attacker: Crafting Adversarial Attacks for Diffusion-based Policies
par: Chen, Yipu, et autres
Publié: (2024)
par: Chen, Yipu, et autres
Publié: (2024)
Unified Text-Image-to-Video Generation: A Training-Free Approach to Flexible Visual Conditioning
par: Lai, Bolin, et autres
Publié: (2025)
par: Lai, Bolin, et autres
Publié: (2025)
ACWM-Phys: Investigating Generalized Physical Interaction in Action-Conditioned Video World Models
par: Xue, Haotian, et autres
Publié: (2026)
par: Xue, Haotian, et autres
Publié: (2026)
Immunizing Images from Text to Image Editing via Adversarial Cross-Attention
par: Trippodo, Matteo, et autres
Publié: (2025)
par: Trippodo, Matteo, et autres
Publié: (2025)
STRIDE: When to Speak Meets Sequence Denoising for Streaming Video Understanding
par: Kim, Junho, et autres
Publié: (2026)
par: Kim, Junho, et autres
Publié: (2026)
Learning Streaming Video Representation via Multitask Training
par: Yan, Yibin, et autres
Publié: (2025)
par: Yan, Yibin, et autres
Publié: (2025)
Universal Image Immunization against Diffusion-based Image Editing via Semantic Injection
par: Lee, Chanhui, et autres
Publié: (2026)
par: Lee, Chanhui, et autres
Publié: (2026)
Laplacian Multi-scale Flow Matching for Generative Modeling
par: Zhao, Zelin, et autres
Publié: (2026)
par: Zhao, Zelin, et autres
Publié: (2026)
Diffusion-Based Adversarial Sample Generation for Improved Stealthiness and Controllability
par: Xue, Haotian, et autres
Publié: (2023)
par: Xue, Haotian, et autres
Publié: (2023)
RetinexDualV2: Physically-Grounded Dual Retinex for Generalized UHD Image Restoration
par: Kishawy, Mohab, et autres
Publié: (2026)
par: Kishawy, Mohab, et autres
Publié: (2026)
DenseStep2M: A Scalable, Training-Free Pipeline for Dense Instructional Video Annotation
par: Ge, Mingji, et autres
Publié: (2026)
par: Ge, Mingji, et autres
Publié: (2026)
SwiftI2V: Efficient High-Resolution Image-to-Video Generation via Conditional Segment-wise Generation
par: Liu, YaoYang, et autres
Publié: (2026)
par: Liu, YaoYang, et autres
Publié: (2026)
Dual-Stream Collaborative Transformer for Image Captioning
par: Wan, Jun, et autres
Publié: (2026)
par: Wan, Jun, et autres
Publié: (2026)
MoGAN: Improving Motion Quality in Video Diffusion via Few-Step Motion Adversarial Post-Training
par: Xue, Haotian, et autres
Publié: (2025)
par: Xue, Haotian, et autres
Publié: (2025)
Dual-Stream Diffusion Net for Text-to-Video Generation
par: Liu, Binhui, et autres
Publié: (2023)
par: Liu, Binhui, et autres
Publié: (2023)
TAIJI: Textual Anchoring for Immunizing Jailbreak Images in Vision Language Models
par: Yin, Xiangyu, et autres
Publié: (2025)
par: Yin, Xiangyu, et autres
Publié: (2025)
Immunizing 3D Gaussian Generative Models Against Unauthorized Fine-Tuning via Attribute-Space Traps
par: Zhang, Jianwei, et autres
Publié: (2026)
par: Zhang, Jianwei, et autres
Publié: (2026)
ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation
par: Ren, Weiming, et autres
Publié: (2024)
par: Ren, Weiming, et autres
Publié: (2024)
ShotStream: Streaming Multi-Shot Video Generation for Interactive Storytelling
par: Luo, Yawen, et autres
Publié: (2026)
par: Luo, Yawen, et autres
Publié: (2026)
SPAR3D: Stable Point-Aware Reconstruction of 3D Objects from Single Images
par: Huang, Zixuan, et autres
Publié: (2025)
par: Huang, Zixuan, et autres
Publié: (2025)
Toward effective protection against diffusion based mimicry through score distillation
par: Xue, Haotian, et autres
Publié: (2023)
par: Xue, Haotian, et autres
Publié: (2023)
Follow-Your-Shape: Shape-Aware Image Editing via Trajectory-Guided Region Control
par: Long, Zeqian, et autres
Publié: (2025)
par: Long, Zeqian, et autres
Publié: (2025)
Universal Video Temporal Grounding with Generative Multi-modal Large Language Models
par: Li, Zeqian, et autres
Publié: (2025)
par: Li, Zeqian, et autres
Publié: (2025)
DCMorph: Face Morphing via Dual-Stream Cross-Attention Diffusion
par: Chettaoui, Tahar, et autres
Publié: (2026)
par: Chettaoui, Tahar, et autres
Publié: (2026)
Leveraging Object Priors for Point Tracking
par: Boote, Bikram, et autres
Publié: (2024)
par: Boote, Bikram, et autres
Publié: (2024)
TIP-I2V: A Million-Scale Real Text and Image Prompt Dataset for Image-to-Video Generation
par: Wang, Wenhao, et autres
Publié: (2024)
par: Wang, Wenhao, et autres
Publié: (2024)
FlashI2V: Fourier-Guided Latent Shifting Prevents Conditional Image Leakage in Image-to-Video Generation
par: Ge, Yunyang, et autres
Publié: (2025)
par: Ge, Yunyang, et autres
Publié: (2025)
I2V-Adapter: A General Image-to-Video Adapter for Diffusion Models
par: Guo, Xun, et autres
Publié: (2023)
par: Guo, Xun, et autres
Publié: (2023)
How Much 3D Do Video Foundation Models Encode?
par: Huang, Zixuan, et autres
Publié: (2025)
par: Huang, Zixuan, et autres
Publié: (2025)
StreamDiffusionV2: A Streaming System for Dynamic and Interactive Video Generation
par: Feng, Tianrui, et autres
Publié: (2025)
par: Feng, Tianrui, et autres
Publié: (2025)
Multi-Sentence Grounding for Long-term Instructional Video
par: Li, Zeqian, et autres
Publié: (2023)
par: Li, Zeqian, et autres
Publié: (2023)
When Eyes Betray AI: Social Gaze Consistency as a Semantic Cue for AI-Generated Image Detection
par: Kim, Jihyeon, et autres
Publié: (2026)
par: Kim, Jihyeon, et autres
Publié: (2026)
Documents similaires
-
DiffVax: Optimization-Free Image Immunization Against Diffusion-Based Editing
par: Ozden, Tarik Can, et autres
Publié: (2024) -
DiffEye: Diffusion-Based Continuous Eye-Tracking Data Generation Conditioned on Natural Images
par: Kara, Ozgur, et autres
Publié: (2025) -
RefDrop: Controllable Consistency in Image or Video Generation via Reference Feature Guidance
par: Fan, Jiaojiao, et autres
Publié: (2024) -
ShotAdapter: Text-to-Multi-Shot Video Generation with Diffusion Models
par: Kara, Ozgur, et autres
Publié: (2025) -
Layer-Aware Video Composition via Split-then-Merge
par: Kara, Ozgur, et autres
Publié: (2025)