PTDiffusion: Free Lunch for Generating Optical Illusion Hidden Pictures with Phase-Transferred Diffusion Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Gao, Xiang, Yang, Shuai, Liu, Jiaying |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Free Lunch for Generating Effective Outlier Supervision
por: Pei, Sen, et al.
Publicado: (2023)
por: Pei, Sen, et al.
Publicado: (2023)
FreeCus: Free Lunch Subject-driven Customization in Diffusion Transformers
por: Zhang, Yanbing, et al.
Publicado: (2025)
por: Zhang, Yanbing, et al.
Publicado: (2025)
Shortcutting Pre-trained Flow Matching Diffusion Models is Almost Free Lunch
por: Cai, Xu, et al.
Publicado: (2025)
por: Cai, Xu, et al.
Publicado: (2025)
FreeInv: Free Lunch for Improving DDIM Inversion
por: Bao, Yuxiang, et al.
Publicado: (2025)
por: Bao, Yuxiang, et al.
Publicado: (2025)
Visual Anagrams: Generating Multi-View Optical Illusions with Diffusion Models
por: Geng, Daniel, et al.
Publicado: (2023)
por: Geng, Daniel, et al.
Publicado: (2023)
FreeStyle: Free Lunch for Text-guided Style Transfer using Diffusion Models
por: He, Feihong, et al.
Publicado: (2024)
por: He, Feihong, et al.
Publicado: (2024)
Free-Lunch Color-Texture Disentanglement for Stylized Image Generation
por: Qin, Jiang, et al.
Publicado: (2025)
por: Qin, Jiang, et al.
Publicado: (2025)
Frequency-Controlled Diffusion Model for Versatile Text-Guided Image-to-Image Translation
por: Gao, Xiang, et al.
Publicado: (2024)
por: Gao, Xiang, et al.
Publicado: (2024)
FBSDiff: Plug-and-Play Frequency Band Substitution of Diffusion Features for Highly Controllable Text-Driven Image Translation
por: Gao, Xiang, et al.
Publicado: (2024)
por: Gao, Xiang, et al.
Publicado: (2024)
RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers
por: Zhao, Min, et al.
Publicado: (2025)
por: Zhao, Min, et al.
Publicado: (2025)
CineScale: Free Lunch in High-Resolution Cinematic Visual Generation
por: Qiu, Haonan, et al.
Publicado: (2025)
por: Qiu, Haonan, et al.
Publicado: (2025)
Free Lunch Alignment of Text-to-Image Diffusion Models without Preference Image Pairs
por: Xian, Jia Jun Cheng, et al.
Publicado: (2025)
por: Xian, Jia Jun Cheng, et al.
Publicado: (2025)
FreeCond: Free Lunch in the Input Conditions of Text-Guided Inpainting
por: Hsiao, Teng-Fang, et al.
Publicado: (2024)
por: Hsiao, Teng-Fang, et al.
Publicado: (2024)
IllusionVQA: A Challenging Optical Illusion Dataset for Vision Language Models
por: Shahgir, Haz Sameen, et al.
Publicado: (2024)
por: Shahgir, Haz Sameen, et al.
Publicado: (2024)
InstantStyle: Free Lunch towards Style-Preserving in Text-to-Image Generation
por: Wang, Haofan, et al.
Publicado: (2024)
por: Wang, Haofan, et al.
Publicado: (2024)
Sparse-to-Dense: A Free Lunch for Lossless Acceleration of Video Understanding in LLMs
por: Zhang, Xuan, et al.
Publicado: (2025)
por: Zhang, Xuan, et al.
Publicado: (2025)
Energy-Calibrated VAE with Test Time Free Lunch
por: Luo, Yihong, et al.
Publicado: (2023)
por: Luo, Yihong, et al.
Publicado: (2023)
Leveraging Semantic Attribute Binding for Free-Lunch Color Control in Diffusion Models
por: Laria, Héctor, et al.
Publicado: (2025)
por: Laria, Héctor, et al.
Publicado: (2025)
Language-based Image Colorization: A Benchmark and Beyond
por: Li, Yifan, et al.
Publicado: (2025)
por: Li, Yifan, et al.
Publicado: (2025)
The Art of Deception: Color Visual Illusions and Diffusion Models
por: Gomez-Villa, Alex, et al.
Publicado: (2024)
por: Gomez-Villa, Alex, et al.
Publicado: (2024)
Switch EMA: A Free Lunch for Better Flatness and Sharpness
por: Li, Siyuan, et al.
Publicado: (2024)
por: Li, Siyuan, et al.
Publicado: (2024)
Spatial Reasoning is Not a Free Lunch: A Controlled Study on LLaVA
por: Alam, Nahid, et al.
Publicado: (2026)
por: Alam, Nahid, et al.
Publicado: (2026)
Alias-Free Latent Diffusion Models: Improving Fractional Shift Equivariance of Diffusion Latent Space
por: Zhou, Yifan, et al.
Publicado: (2025)
por: Zhou, Yifan, et al.
Publicado: (2025)
Free Lunch in Pathology Foundation Model: Task-specific Model Adaptation with Concept-Guided Feature Enhancement
por: Huang, Yanyan, et al.
Publicado: (2024)
por: Huang, Yanyan, et al.
Publicado: (2024)
Free Lunch for Stabilizing Rectified Flow Inversion
por: Wang, Chenru, et al.
Publicado: (2026)
por: Wang, Chenru, et al.
Publicado: (2026)
Illusion3D: 3D Multiview Illusion with 2D Diffusion Priors
por: Feng, Yue, et al.
Publicado: (2024)
por: Feng, Yue, et al.
Publicado: (2024)
FreeBind: Free Lunch in Unified Multimodal Space via Knowledge Fusion
por: Wang, Zehan, et al.
Publicado: (2024)
por: Wang, Zehan, et al.
Publicado: (2024)
Free Lunch for Unified Multimodal Models: Enhancing Generation via Reflective Rectification with Inherent Understanding
por: Jiang, Yibo, et al.
Publicado: (2026)
por: Jiang, Yibo, et al.
Publicado: (2026)
Factorized Diffusion: Perceptual Illusions by Noise Decomposition
por: Geng, Daniel, et al.
Publicado: (2024)
por: Geng, Daniel, et al.
Publicado: (2024)
Illusion-Aware Visual Preprocessing and Anti-Illusion Prompting for Classic Illusion Understanding in Vision-Language Models
por: Zha, Junli, et al.
Publicado: (2026)
por: Zha, Junli, et al.
Publicado: (2026)
FLOSS: Free Lunch in Open-vocabulary Semantic Segmentation
por: Benigmim, Yasser, et al.
Publicado: (2025)
por: Benigmim, Yasser, et al.
Publicado: (2025)
Exploring Data-Free LoRA Transferability for Video Diffusion Models
por: Wang, Yuchen, et al.
Publicado: (2026)
por: Wang, Yuchen, et al.
Publicado: (2026)
Self-Supervised Skeleton-Based Action Representation Learning: A Benchmark and Beyond
por: Zhang, Jiahang, et al.
Publicado: (2024)
por: Zhang, Jiahang, et al.
Publicado: (2024)
Intelligent Artistic Typography: A Comprehensive Review of Artistic Text Design and Generation
por: Bai, Yuhang, et al.
Publicado: (2024)
por: Bai, Yuhang, et al.
Publicado: (2024)
Freeplane: Unlocking Free Lunch in Triplane-Based Sparse-View Reconstruction Models
por: Sun, Wenqiang, et al.
Publicado: (2024)
por: Sun, Wenqiang, et al.
Publicado: (2024)
FreeMorph: Tuning-Free Generalized Image Morphing with Diffusion Model
por: Cao, Yukang, et al.
Publicado: (2025)
por: Cao, Yukang, et al.
Publicado: (2025)
IllusionBench+: A Large-scale and Comprehensive Benchmark for Visual Illusion Understanding in Vision-Language Models
por: Zhang, Yiming, et al.
Publicado: (2025)
por: Zhang, Yiming, et al.
Publicado: (2025)
Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation
por: Wang, Wenjing, et al.
Publicado: (2023)
por: Wang, Wenjing, et al.
Publicado: (2023)
Efficient Generation of Targeted and Transferable Adversarial Examples for Vision-Language Models Via Diffusion Models
por: Guo, Qi, et al.
Publicado: (2024)
por: Guo, Qi, et al.
Publicado: (2024)
No Free Lunch in Annotation either: An objective evaluation of foundation models for streamlining annotation in animal tracking
por: Mededovic, Emil, et al.
Publicado: (2025)
por: Mededovic, Emil, et al.
Publicado: (2025)
Ejemplares similares
-
Free Lunch for Generating Effective Outlier Supervision
por: Pei, Sen, et al.
Publicado: (2023) -
FreeCus: Free Lunch Subject-driven Customization in Diffusion Transformers
por: Zhang, Yanbing, et al.
Publicado: (2025) -
Shortcutting Pre-trained Flow Matching Diffusion Models is Almost Free Lunch
por: Cai, Xu, et al.
Publicado: (2025) -
FreeInv: Free Lunch for Improving DDIM Inversion
por: Bao, Yuxiang, et al.
Publicado: (2025) -
Visual Anagrams: Generating Multi-View Optical Illusions with Diffusion Models
por: Geng, Daniel, et al.
Publicado: (2023)