Harnessing the Latent Diffusion Model for Training-Free Image Style Transfer
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Masui, Kento, Otani, Mayu, Nomura, Masahiro, Nakayama, Hideki |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DiffuseST: Unleashing the Capability of the Diffusion Model for Style Transfer
par: Hu, Ying, et autres
Publié: (2024)
par: Hu, Ying, et autres
Publié: (2024)
LayoutFlow: Flow Matching for Layout Generation
par: Guerreiro, Julian Jorge Andrade, et autres
Publié: (2024)
par: Guerreiro, Julian Jorge Andrade, et autres
Publié: (2024)
Multimodal Markup Document Models for Graphic Design Completion
par: Kikuchi, Kotaro, et autres
Publié: (2024)
par: Kikuchi, Kotaro, et autres
Publié: (2024)
TALE: Training-free Cross-domain Image Composition via Adaptive Latent Manipulation and Energy-guided Optimization
par: Pham, Kien T., et autres
Publié: (2024)
par: Pham, Kien T., et autres
Publié: (2024)
ReactDiff: Latent Diffusion for Facial Reaction Generation
par: Li, Jiaming, et autres
Publié: (2025)
par: Li, Jiaming, et autres
Publié: (2025)
Identity-Preserving Text-to-Video Generation via Training-Free Prompt, Image, and Guidance Enhancement
par: Gao, Jiayi, et autres
Publié: (2025)
par: Gao, Jiayi, et autres
Publié: (2025)
A Novel Approach to Industrial Defect Generation through Blended Latent Diffusion Model with Online Adaptation
par: Li, Hanxi, et autres
Publié: (2024)
par: Li, Hanxi, et autres
Publié: (2024)
StyleAR: Customizing Multimodal Autoregressive Model for Style-Aligned Text-to-Image Generation
par: Wu, Yi, et autres
Publié: (2025)
par: Wu, Yi, et autres
Publié: (2025)
Training-and-Prompt-Free General Painterly Harmonization via Zero-Shot Disentenglement on Style and Content References
par: Hsiao, Teng-Fang, et autres
Publié: (2024)
par: Hsiao, Teng-Fang, et autres
Publié: (2024)
TRIP: Temporal Residual Learning with Image Noise Prior for Image-to-Video Diffusion Models
par: Zhang, Zhongwei, et autres
Publié: (2024)
par: Zhang, Zhongwei, et autres
Publié: (2024)
Exploring Phrase-Level Grounding with Text-to-Image Diffusion Model
par: Yang, Danni, et autres
Publié: (2024)
par: Yang, Danni, et autres
Publié: (2024)
DIVA: Harnessing the Representation Divergence in Unified Multimodal Models for Mutual Reinforcement
par: Lu, Renjie, et autres
Publié: (2026)
par: Lu, Renjie, et autres
Publié: (2026)
InteractDiffusion: Interaction Control in Text-to-Image Diffusion Models
par: Hoe, Jiun Tian, et autres
Publié: (2023)
par: Hoe, Jiun Tian, et autres
Publié: (2023)
FreeEnhance: Tuning-Free Image Enhancement via Content-Consistent Noising-and-Denoising Process
par: Luo, Yang, et autres
Publié: (2024)
par: Luo, Yang, et autres
Publié: (2024)
SmartFreeEdit: Mask-Free Spatial-Aware Image Editing with Complex Instruction Understanding
par: Sun, Qianqian, et autres
Publié: (2025)
par: Sun, Qianqian, et autres
Publié: (2025)
Synthetic Perception: Can Generated Images Unlock Latent Visual Prior for Text-Centric Reasoning?
par: Huang, Yuesheng, et autres
Publié: (2025)
par: Huang, Yuesheng, et autres
Publié: (2025)
JIGMARK: A Black-Box Approach for Enhancing Image Watermarks against Diffusion Model Edits
par: Pan, Minzhou, et autres
Publié: (2024)
par: Pan, Minzhou, et autres
Publié: (2024)
Guided Masked Self-Distillation Modeling for Distributed Multimedia Sensor Event Analysis
par: Yasuda, Masahiro, et autres
Publié: (2024)
par: Yasuda, Masahiro, et autres
Publié: (2024)
Hi3D: Pursuing High-Resolution Image-to-3D Generation with Video Diffusion Models
par: Yang, Haibo, et autres
Publié: (2024)
par: Yang, Haibo, et autres
Publié: (2024)
HiDream-I1: A High-Efficient Image Generative Foundation Model with Sparse Diffusion Transformer
par: Cai, Qi, et autres
Publié: (2025)
par: Cai, Qi, et autres
Publié: (2025)
HDCompression: Hybrid-Diffusion Image Compression for Ultra-Low Bitrates
par: Lu, Lei, et autres
Publié: (2025)
par: Lu, Lei, et autres
Publié: (2025)
Bridging Compressed Image Latents and Multimodal Large Language Models
par: Kao, Chia-Hao, et autres
Publié: (2024)
par: Kao, Chia-Hao, et autres
Publié: (2024)
DreamCinema: Cinematic Transfer with Free Camera and 3D Character
par: Chen, Weiliang, et autres
Publié: (2024)
par: Chen, Weiliang, et autres
Publié: (2024)
Unveiling Encoder-Free Vision-Language Models
par: Diao, Haiwen, et autres
Publié: (2024)
par: Diao, Haiwen, et autres
Publié: (2024)
Magic3DSketch: Create Colorful 3D Models From Sketch-Based 3D Modeling Guided by Text and Language-Image Pre-Training
par: Zang, Ying, et autres
Publié: (2024)
par: Zang, Ying, et autres
Publié: (2024)
Bernini: Latent Semantic Planning for Video Diffusion
par: Bernini Team, et autres
Publié: (2026)
par: Bernini Team, et autres
Publié: (2026)
Protégé: Learn and Generate Basic Makeup Styles with Generative Adversarial Networks (GANs)
par: Sii, Jia Wei, et autres
Publié: (2024)
par: Sii, Jia Wei, et autres
Publié: (2024)
UniAnimate-DiT: Human Image Animation with Large-Scale Video Diffusion Transformer
par: Wang, Xiang, et autres
Publié: (2025)
par: Wang, Xiang, et autres
Publié: (2025)
MSPT: A Lightweight Face Image Quality Assessment Method with Multi-stage Progressive Training
par: Xiao, Xiongwei, et autres
Publié: (2025)
par: Xiao, Xiongwei, et autres
Publié: (2025)
Scalable Diffusion Models with State Space Backbone
par: Fei, Zhengcong, et autres
Publié: (2024)
par: Fei, Zhengcong, et autres
Publié: (2024)
Language-Guided Diffusion Model for Visual Grounding
par: Chen, Sijia, et autres
Publié: (2023)
par: Chen, Sijia, et autres
Publié: (2023)
Improving Virtual Try-On with Garment-focused Diffusion Models
par: Wan, Siqi, et autres
Publié: (2024)
par: Wan, Siqi, et autres
Publié: (2024)
Incorporating Visual Correspondence into Diffusion Model for Virtual Try-On
par: Wan, Siqi, et autres
Publié: (2025)
par: Wan, Siqi, et autres
Publié: (2025)
DIVE: Inverting Conditional Diffusion Models for Discriminative Tasks
par: Li, Yinqi, et autres
Publié: (2025)
par: Li, Yinqi, et autres
Publié: (2025)
Connecting Giants: Synergistic Knowledge Transfer of Large Multimodal Models for Few-Shot Learning
par: Tang, Hao, et autres
Publié: (2025)
par: Tang, Hao, et autres
Publié: (2025)
Kiss3DGen: Repurposing Image Diffusion Models for 3D Asset Generation
par: Lin, Jiantao, et autres
Publié: (2025)
par: Lin, Jiantao, et autres
Publié: (2025)
Unified Generative and Discriminative Training for Multi-modal Large Language Models
par: Chow, Wei, et autres
Publié: (2024)
par: Chow, Wei, et autres
Publié: (2024)
Towards Training-free Multimodal Hate Localisation with Large Language Models
par: Sun, Yueming, et autres
Publié: (2026)
par: Sun, Yueming, et autres
Publié: (2026)
Latent Reconstruction from Generated Data for Multimodal Misinformation Detection
par: Papadopoulos, Stefanos-Iordanis, et autres
Publié: (2025)
par: Papadopoulos, Stefanos-Iordanis, et autres
Publié: (2025)
Boosting Diffusion Models with Moving Average Sampling in Frequency Domain
par: Qian, Yurui, et autres
Publié: (2024)
par: Qian, Yurui, et autres
Publié: (2024)
Documents similaires
-
DiffuseST: Unleashing the Capability of the Diffusion Model for Style Transfer
par: Hu, Ying, et autres
Publié: (2024) -
LayoutFlow: Flow Matching for Layout Generation
par: Guerreiro, Julian Jorge Andrade, et autres
Publié: (2024) -
Multimodal Markup Document Models for Graphic Design Completion
par: Kikuchi, Kotaro, et autres
Publié: (2024) -
TALE: Training-free Cross-domain Image Composition via Adaptive Latent Manipulation and Energy-guided Optimization
par: Pham, Kien T., et autres
Publié: (2024) -
ReactDiff: Latent Diffusion for Facial Reaction Generation
par: Li, Jiaming, et autres
Publié: (2025)