FreeCus: Free Lunch Subject-driven Customization in Diffusion Transformers
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yanbing, Wang, Zhe, Zhou, Qin, Yang, Mengping |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Attention Calibration for Disentangled Text-to-Image Personalization
di: Zhang, Yanbing, et al.
Pubblicazione: (2024)
di: Zhang, Yanbing, et al.
Pubblicazione: (2024)
CusConcept: Customized Visual Concept Decomposition with Diffusion Models
di: Xu, Zhi, et al.
Pubblicazione: (2024)
di: Xu, Zhi, et al.
Pubblicazione: (2024)
RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers
di: Zhao, Min, et al.
Pubblicazione: (2025)
di: Zhao, Min, et al.
Pubblicazione: (2025)
Free-Lunch Color-Texture Disentanglement for Stylized Image Generation
di: Qin, Jiang, et al.
Pubblicazione: (2025)
di: Qin, Jiang, et al.
Pubblicazione: (2025)
FreeInv: Free Lunch for Improving DDIM Inversion
di: Bao, Yuxiang, et al.
Pubblicazione: (2025)
di: Bao, Yuxiang, et al.
Pubblicazione: (2025)
InstantStyle: Free Lunch towards Style-Preserving in Text-to-Image Generation
di: Wang, Haofan, et al.
Pubblicazione: (2024)
di: Wang, Haofan, et al.
Pubblicazione: (2024)
FreeStyle: Free Lunch for Text-guided Style Transfer using Diffusion Models
di: He, Feihong, et al.
Pubblicazione: (2024)
di: He, Feihong, et al.
Pubblicazione: (2024)
Free Lunch for Stabilizing Rectified Flow Inversion
di: Wang, Chenru, et al.
Pubblicazione: (2026)
di: Wang, Chenru, et al.
Pubblicazione: (2026)
OmniVCus: Feedforward Subject-driven Video Customization with Multimodal Control Conditions
di: Cai, Yuanhao, et al.
Pubblicazione: (2025)
di: Cai, Yuanhao, et al.
Pubblicazione: (2025)
PTDiffusion: Free Lunch for Generating Optical Illusion Hidden Pictures with Phase-Transferred Diffusion Model
di: Gao, Xiang, et al.
Pubblicazione: (2025)
di: Gao, Xiang, et al.
Pubblicazione: (2025)
Free Lunch for Generating Effective Outlier Supervision
di: Pei, Sen, et al.
Pubblicazione: (2023)
di: Pei, Sen, et al.
Pubblicazione: (2023)
Leveraging Semantic Attribute Binding for Free-Lunch Color Control in Diffusion Models
di: Laria, Héctor, et al.
Pubblicazione: (2025)
di: Laria, Héctor, et al.
Pubblicazione: (2025)
Image Synthesis under Limited Data: A Survey and Taxonomy
di: Yang, Mengping, et al.
Pubblicazione: (2023)
di: Yang, Mengping, et al.
Pubblicazione: (2023)
Shortcutting Pre-trained Flow Matching Diffusion Models is Almost Free Lunch
di: Cai, Xu, et al.
Pubblicazione: (2025)
di: Cai, Xu, et al.
Pubblicazione: (2025)
FreeCustom: Tuning-Free Customized Image Generation for Multi-Concept Composition
di: Ding, Ganggui, et al.
Pubblicazione: (2024)
di: Ding, Ganggui, et al.
Pubblicazione: (2024)
Energy-Calibrated VAE with Test Time Free Lunch
di: Luo, Yihong, et al.
Pubblicazione: (2023)
di: Luo, Yihong, et al.
Pubblicazione: (2023)
FreeBind: Free Lunch in Unified Multimodal Space via Knowledge Fusion
di: Wang, Zehan, et al.
Pubblicazione: (2024)
di: Wang, Zehan, et al.
Pubblicazione: (2024)
Free Lunch Alignment of Text-to-Image Diffusion Models without Preference Image Pairs
di: Xian, Jia Jun Cheng, et al.
Pubblicazione: (2025)
di: Xian, Jia Jun Cheng, et al.
Pubblicazione: (2025)
FreeCond: Free Lunch in the Input Conditions of Text-Guided Inpainting
di: Hsiao, Teng-Fang, et al.
Pubblicazione: (2024)
di: Hsiao, Teng-Fang, et al.
Pubblicazione: (2024)
Switch EMA: A Free Lunch for Better Flatness and Sharpness
di: Li, Siyuan, et al.
Pubblicazione: (2024)
di: Li, Siyuan, et al.
Pubblicazione: (2024)
Free Lunch to Meet the Gap: Intermediate Domain Reconstruction for Cross-Domain Few-Shot Learning
di: Zhang, Tong, et al.
Pubblicazione: (2025)
di: Zhang, Tong, et al.
Pubblicazione: (2025)
CineScale: Free Lunch in High-Resolution Cinematic Visual Generation
di: Qiu, Haonan, et al.
Pubblicazione: (2025)
di: Qiu, Haonan, et al.
Pubblicazione: (2025)
CusEnhancer: A Zero-Shot Scene and Controllability Enhancement Method for Photo Customization via ResInversion
di: Ren, Maoye, et al.
Pubblicazione: (2025)
di: Ren, Maoye, et al.
Pubblicazione: (2025)
Sparse-to-Dense: A Free Lunch for Lossless Acceleration of Video Understanding in LLMs
di: Zhang, Xuan, et al.
Pubblicazione: (2025)
di: Zhang, Xuan, et al.
Pubblicazione: (2025)
FLOSS: Free Lunch in Open-vocabulary Semantic Segmentation
di: Benigmim, Yasser, et al.
Pubblicazione: (2025)
di: Benigmim, Yasser, et al.
Pubblicazione: (2025)
Freeplane: Unlocking Free Lunch in Triplane-Based Sparse-View Reconstruction Models
di: Sun, Wenqiang, et al.
Pubblicazione: (2024)
di: Sun, Wenqiang, et al.
Pubblicazione: (2024)
Spatial Reasoning is Not a Free Lunch: A Controlled Study on LLaVA
di: Alam, Nahid, et al.
Pubblicazione: (2026)
di: Alam, Nahid, et al.
Pubblicazione: (2026)
DiverseDiT: Towards Diverse Representation Learning in Diffusion Transformers
di: Yang, Mengping, et al.
Pubblicazione: (2026)
di: Yang, Mengping, et al.
Pubblicazione: (2026)
FreeTuner: Any Subject in Any Style with Training-free Diffusion
di: Xu, Youcan, et al.
Pubblicazione: (2024)
di: Xu, Youcan, et al.
Pubblicazione: (2024)
ChatDiT: A Training-Free Baseline for Task-Agnostic Free-Form Chatting with Diffusion Transformers
di: Huang, Lianghua, et al.
Pubblicazione: (2024)
di: Huang, Lianghua, et al.
Pubblicazione: (2024)
FreeText: Training-Free Text Rendering in Diffusion Transformers via Attention Localization and Spectral Glyph Injection
di: Zhang, Ruiqiang, et al.
Pubblicazione: (2026)
di: Zhang, Ruiqiang, et al.
Pubblicazione: (2026)
Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation
di: Zhang, Zhenghao, et al.
Pubblicazione: (2025)
di: Zhang, Zhenghao, et al.
Pubblicazione: (2025)
Personalize Anything for Free with Diffusion Transformer
di: Feng, Haoran, et al.
Pubblicazione: (2025)
di: Feng, Haoran, et al.
Pubblicazione: (2025)
Free Lunch for Unified Multimodal Models: Enhancing Generation via Reflective Rectification with Inherent Understanding
di: Jiang, Yibo, et al.
Pubblicazione: (2026)
di: Jiang, Yibo, et al.
Pubblicazione: (2026)
LoRA-Composer: Leveraging Low-Rank Adaptation for Multi-Concept Customization in Training-Free Diffusion Models
di: Yang, Yang, et al.
Pubblicazione: (2024)
di: Yang, Yang, et al.
Pubblicazione: (2024)
VideoMage: Multi-Subject and Motion Customization of Text-to-Video Diffusion Models
di: Huang, Chi-Pin, et al.
Pubblicazione: (2025)
di: Huang, Chi-Pin, et al.
Pubblicazione: (2025)
No Free Lunch in Annotation either: An objective evaluation of foundation models for streamlining annotation in animal tracking
di: Mededovic, Emil, et al.
Pubblicazione: (2025)
di: Mededovic, Emil, et al.
Pubblicazione: (2025)
Self-Consistency as a Free Lunch: Reducing Hallucinations in Vision-Language Models via Self-Reflection
di: Han, Mingfei, et al.
Pubblicazione: (2025)
di: Han, Mingfei, et al.
Pubblicazione: (2025)
Free Lunch in Pathology Foundation Model: Task-specific Model Adaptation with Concept-Guided Feature Enhancement
di: Huang, Yanyan, et al.
Pubblicazione: (2024)
di: Huang, Yanyan, et al.
Pubblicazione: (2024)
InstantCharacter: Personalize Any Characters with a Scalable Diffusion Transformer Framework
di: Tao, Jiale, et al.
Pubblicazione: (2025)
di: Tao, Jiale, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Attention Calibration for Disentangled Text-to-Image Personalization
di: Zhang, Yanbing, et al.
Pubblicazione: (2024) -
CusConcept: Customized Visual Concept Decomposition with Diffusion Models
di: Xu, Zhi, et al.
Pubblicazione: (2024) -
RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers
di: Zhao, Min, et al.
Pubblicazione: (2025) -
Free-Lunch Color-Texture Disentanglement for Stylized Image Generation
di: Qin, Jiang, et al.
Pubblicazione: (2025) -
FreeInv: Free Lunch for Improving DDIM Inversion
di: Bao, Yuxiang, et al.
Pubblicazione: (2025)