Factorized Diffusion: Perceptual Illusions by Noise Decomposition
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Geng, Daniel, Park, Inbum, Owens, Andrew |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Visual Anagrams: Generating Multi-View Optical Illusions with Diffusion Models
par: Geng, Daniel, et autres
Publié: (2023)
par: Geng, Daniel, et autres
Publié: (2023)
Motion Guidance: Diffusion-Based Image Editing with Differentiable Motion Estimators
par: Geng, Daniel, et autres
Publié: (2024)
par: Geng, Daniel, et autres
Publié: (2024)
Point Prompting: Counterfactual Tracking with Video Diffusion Models
par: Shrivastava, Ayush, et autres
Publié: (2025)
par: Shrivastava, Ayush, et autres
Publié: (2025)
LED Benchmark: Diagnosing Structural Layout Errors for Document Layout Analysis
par: Heo, Inbum, et autres
Publié: (2025)
par: Heo, Inbum, et autres
Publié: (2025)
Illusion3D: 3D Multiview Illusion with 2D Diffusion Priors
par: Feng, Yue, et autres
Publié: (2024)
par: Feng, Yue, et autres
Publié: (2024)
Community Forensics: Using Thousands of Generators to Train Fake Image Detectors
par: Park, Jeongsoo, et autres
Publié: (2024)
par: Park, Jeongsoo, et autres
Publié: (2024)
LED: A Benchmark for Evaluating Layout Error Detection in Document Analysis
par: Heo, Inbum, et autres
Publié: (2026)
par: Heo, Inbum, et autres
Publié: (2026)
Boosting Latent Diffusion with Perceptual Objectives
par: Berrada, Tariq, et autres
Publié: (2024)
par: Berrada, Tariq, et autres
Publié: (2024)
The Art of Deception: Color Visual Illusions and Diffusion Models
par: Gomez-Villa, Alex, et autres
Publié: (2024)
par: Gomez-Villa, Alex, et autres
Publié: (2024)
Leveraging Geometric Visual Illusions as Perceptual Inductive Biases for Vision Models
par: Yang, Haobo, et autres
Publié: (2025)
par: Yang, Haobo, et autres
Publié: (2025)
Masked Diffusion Captioning for Visual Feature Learning
par: Feng, Chao, et autres
Publié: (2025)
par: Feng, Chao, et autres
Publié: (2025)
One-Step Diffusion for Perceptual Image Compression
par: Jia, Yiwen, et autres
Publié: (2026)
par: Jia, Yiwen, et autres
Publié: (2026)
Beyond the Cartesian Illusion: Testing Two-Stage Multi-Modal Theory of Mind under Perceptual Bottlenecks
par: Zhou, Yajing, et autres
Publié: (2026)
par: Zhou, Yajing, et autres
Publié: (2026)
Illusion-Aware Visual Preprocessing and Anti-Illusion Prompting for Classic Illusion Understanding in Vision-Language Models
par: Zha, Junli, et autres
Publié: (2026)
par: Zha, Junli, et autres
Publié: (2026)
Improved Noise Schedule for Diffusion Training
par: Hang, Tiankai, et autres
Publié: (2024)
par: Hang, Tiankai, et autres
Publié: (2024)
DiffusionPID: Interpreting Diffusion via Partial Information Decomposition
par: Zawar, Rushikesh, et autres
Publié: (2024)
par: Zawar, Rushikesh, et autres
Publié: (2024)
PICD: Versatile Perceptual Image Compression with Diffusion Rendering
par: Xu, Tongda, et autres
Publié: (2025)
par: Xu, Tongda, et autres
Publié: (2025)
Burst Super-Resolution with Diffusion Models for Improving Perceptual Quality
par: Tokoro, Kyotaro, et autres
Publié: (2024)
par: Tokoro, Kyotaro, et autres
Publié: (2024)
DICEPTION: A Generalist Diffusion Model for Visual Perceptual Tasks
par: Zhao, Canyu, et autres
Publié: (2025)
par: Zhao, Canyu, et autres
Publié: (2025)
ViThinker: Active Vision-Language Reasoning via Dynamic Perceptual Querying
par: You, Weihang, et autres
Publié: (2026)
par: You, Weihang, et autres
Publié: (2026)
IMPUS: Image Morphing with Perceptually-Uniform Sampling Using Diffusion Models
par: Yang, Zhaoyuan, et autres
Publié: (2023)
par: Yang, Zhaoyuan, et autres
Publié: (2023)
NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration
par: Dong, Haotian, et autres
Publié: (2025)
par: Dong, Haotian, et autres
Publié: (2025)
Overcoming False Illusions in Real-World Face Restoration with Multi-Modal Guided Diffusion Model
par: Tao, Keda, et autres
Publié: (2024)
par: Tao, Keda, et autres
Publié: (2024)
PTDiffusion: Free Lunch for Generating Optical Illusion Hidden Pictures with Phase-Transferred Diffusion Model
par: Gao, Xiang, et autres
Publié: (2025)
par: Gao, Xiang, et autres
Publié: (2025)
Perceptual-GS: Scene-adaptive Perceptual Densification for Gaussian Splatting
par: Zhou, Hongbi, et autres
Publié: (2025)
par: Zhou, Hongbi, et autres
Publié: (2025)
Perceptual Classifiers: Detecting Generative Images using Perceptual Features
par: Durbha, Krishna Srikar, et autres
Publié: (2025)
par: Durbha, Krishna Srikar, et autres
Publié: (2025)
Semi-Supervised Defect Detection via Conditional Diffusion and CLIP-Guided Noise Filtering
par: Li, Shuai, et autres
Publié: (2025)
par: Li, Shuai, et autres
Publié: (2025)
E2VIDiff: Perceptual Events-to-Video Reconstruction using Diffusion Priors
par: Liang, Jinxiu, et autres
Publié: (2024)
par: Liang, Jinxiu, et autres
Publié: (2024)
The Illusion-Illusion: Vision Language Models See Illusions Where There are None
par: Ullman, Tomer
Publié: (2024)
par: Ullman, Tomer
Publié: (2024)
IllusionBench+: A Large-scale and Comprehensive Benchmark for Visual Illusion Understanding in Vision-Language Models
par: Zhang, Yiming, et autres
Publié: (2025)
par: Zhang, Yiming, et autres
Publié: (2025)
Scaling Properties of Diffusion Models for Perceptual Tasks
par: Ravishankar, Rahul, et autres
Publié: (2024)
par: Ravishankar, Rahul, et autres
Publié: (2024)
Latent Guidance in Diffusion Models for Perceptual Evaluations
par: Saini, Shreshth, et autres
Publié: (2025)
par: Saini, Shreshth, et autres
Publié: (2025)
Noise Matters: Optimizing Matching Noise for Diffusion Classifiers
par: Wang, Yanghao, et autres
Publié: (2025)
par: Wang, Yanghao, et autres
Publié: (2025)
IllusionVQA: A Challenging Optical Illusion Dataset for Vision Language Models
par: Shahgir, Haz Sameen, et autres
Publié: (2024)
par: Shahgir, Haz Sameen, et autres
Publié: (2024)
PerCo (SD): Open Perceptual Compression
par: Körber, Nikolai, et autres
Publié: (2024)
par: Körber, Nikolai, et autres
Publié: (2024)
SECOND: Mitigating Perceptual Hallucination in Vision-Language Models via Selective and Contrastive Decoding
par: Park, Woohyeon, et autres
Publié: (2025)
par: Park, Woohyeon, et autres
Publié: (2025)
Self-Supervised Any-Point Tracking by Contrastive Random Walks
par: Shrivastava, Ayush, et autres
Publié: (2024)
par: Shrivastava, Ayush, et autres
Publié: (2024)
Diffusion-based Aesthetic QR Code Generation via Scanning-Robust Perceptual Guidance
par: Liao, Jia-Wei, et autres
Publié: (2024)
par: Liao, Jia-Wei, et autres
Publié: (2024)
Self-Supervised Spatial Correspondence Across Modalities
par: Shrivastava, Ayush, et autres
Publié: (2025)
par: Shrivastava, Ayush, et autres
Publié: (2025)
Colored Noise Diffusion Sampling
par: Davidson, Hadar, et autres
Publié: (2026)
par: Davidson, Hadar, et autres
Publié: (2026)
Documents similaires
-
Visual Anagrams: Generating Multi-View Optical Illusions with Diffusion Models
par: Geng, Daniel, et autres
Publié: (2023) -
Motion Guidance: Diffusion-Based Image Editing with Differentiable Motion Estimators
par: Geng, Daniel, et autres
Publié: (2024) -
Point Prompting: Counterfactual Tracking with Video Diffusion Models
par: Shrivastava, Ayush, et autres
Publié: (2025) -
LED Benchmark: Diagnosing Structural Layout Errors for Document Layout Analysis
par: Heo, Inbum, et autres
Publié: (2025) -
Illusion3D: 3D Multiview Illusion with 2D Diffusion Priors
par: Feng, Yue, et autres
Publié: (2024)