Controlling Text-to-Image Diffusion by Orthogonal Finetuning
Fuente:
arXiv
Salvato in:
| Autori principali: | Qiu, Zeju, Liu, Weiyang, Feng, Haiwen, Xue, Yuxuan, Feng, Yao, Liu, Zhen, Zhang, Dan, Weller, Adrian, Schölkopf, Bernhard |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Orthogonal Finetuning Made Scalable
di: Qiu, Zeju, et al.
Pubblicazione: (2025)
di: Qiu, Zeju, et al.
Pubblicazione: (2025)
Parameter-Efficient Orthogonal Finetuning via Butterfly Factorization
di: Liu, Weiyang, et al.
Pubblicazione: (2023)
di: Liu, Weiyang, et al.
Pubblicazione: (2023)
Ghost on the Shell: An Expressive Representation of General 3D Shapes
di: Liu, Zhen, et al.
Pubblicazione: (2023)
di: Liu, Zhen, et al.
Pubblicazione: (2023)
GraphDreamer: Compositional 3D Scene Synthesis from Scene Graphs
di: Gao, Gege, et al.
Pubblicazione: (2023)
di: Gao, Gege, et al.
Pubblicazione: (2023)
JeDi: Joint-Image Diffusion Models for Finetuning-Free Personalized Text-to-Image Generation
di: Zeng, Yu, et al.
Pubblicazione: (2024)
di: Zeng, Yu, et al.
Pubblicazione: (2024)
GenLit: Reformulating Single-Image Relighting as Video Generation
di: Bharadwaj, Shrisha, et al.
Pubblicazione: (2024)
di: Bharadwaj, Shrisha, et al.
Pubblicazione: (2024)
Bokeh Diffusion: Defocus Blur Control in Text-to-Image Diffusion Models
di: Fortes, Armando, et al.
Pubblicazione: (2025)
di: Fortes, Armando, et al.
Pubblicazione: (2025)
InteractDiffusion: Interaction Control in Text-to-Image Diffusion Models
di: Hoe, Jiun Tian, et al.
Pubblicazione: (2023)
di: Hoe, Jiun Tian, et al.
Pubblicazione: (2023)
LGTM: Training-Free Light-Guided Text-to-Image Diffusion Model via Initial Noise Manipulation
di: Morita, Ryugo, et al.
Pubblicazione: (2026)
di: Morita, Ryugo, et al.
Pubblicazione: (2026)
DreamBlend: Advancing Personalized Fine-tuning of Text-to-Image Diffusion Models
di: Ram, Shwetha, et al.
Pubblicazione: (2024)
di: Ram, Shwetha, et al.
Pubblicazione: (2024)
Style Customization of Text-to-Vector Generation with Image Diffusion Priors
di: Zhang, Peiying, et al.
Pubblicazione: (2025)
di: Zhang, Peiying, et al.
Pubblicazione: (2025)
Controllable Weather Synthesis and Removal with Video Diffusion Models
di: Lin, Chih-Hao, et al.
Pubblicazione: (2025)
di: Lin, Chih-Hao, et al.
Pubblicazione: (2025)
Generating Human Interaction Motions in Scenes with Text Control
di: Yi, Hongwei, et al.
Pubblicazione: (2024)
di: Yi, Hongwei, et al.
Pubblicazione: (2024)
Can Large Language Models Understand Symbolic Graphics Programs?
di: Qiu, Zeju, et al.
Pubblicazione: (2024)
di: Qiu, Zeju, et al.
Pubblicazione: (2024)
Geometry Image Diffusion: Fast and Data-Efficient Text-to-3D with Image-Based Surface Representation
di: Elizarov, Slava, et al.
Pubblicazione: (2024)
di: Elizarov, Slava, et al.
Pubblicazione: (2024)
Agentic Design of Compositional Machines
di: Zhang, Wenqian, et al.
Pubblicazione: (2025)
di: Zhang, Wenqian, et al.
Pubblicazione: (2025)
Taming Real-World Space-Time Video Super-Resolution with One-Step Diffusion
di: Wei, Shuoyan, et al.
Pubblicazione: (2026)
di: Wei, Shuoyan, et al.
Pubblicazione: (2026)
CtrlVDiff: Controllable Video Generation via Unified Multimodal Video Diffusion
di: Xi, Dianbing, et al.
Pubblicazione: (2025)
di: Xi, Dianbing, et al.
Pubblicazione: (2025)
DartControl: A Diffusion-Based Autoregressive Motion Model for Real-Time Text-Driven Motion Control
di: Zhao, Kaifeng, et al.
Pubblicazione: (2024)
di: Zhao, Kaifeng, et al.
Pubblicazione: (2024)
TurboEdit: Text-Based Image Editing Using Few-Step Diffusion Models
di: Deutch, Gilad, et al.
Pubblicazione: (2024)
di: Deutch, Gilad, et al.
Pubblicazione: (2024)
Controlling Avatar Diffusion with Learnable Gaussian Embedding
di: Gao, Xuan, et al.
Pubblicazione: (2025)
di: Gao, Xuan, et al.
Pubblicazione: (2025)
LightLab: Controlling Light Sources in Images with Diffusion Models
di: Magar, Nadav, et al.
Pubblicazione: (2025)
di: Magar, Nadav, et al.
Pubblicazione: (2025)
Endoscopic Depth Estimation Based on Deep Learning: A Survey
di: Niu, Ke, et al.
Pubblicazione: (2025)
di: Niu, Ke, et al.
Pubblicazione: (2025)
In-Context LoRA for Diffusion Transformers
di: Huang, Lianghua, et al.
Pubblicazione: (2024)
di: Huang, Lianghua, et al.
Pubblicazione: (2024)
ETCH: Generalizing Body Fitting to Clothed Humans via Equivariant Tightness
di: Li, Boqian, et al.
Pubblicazione: (2025)
di: Li, Boqian, et al.
Pubblicazione: (2025)
Diffusion as Shader: 3D-aware Video Diffusion for Versatile Video Generation Control
di: Gu, Zekai, et al.
Pubblicazione: (2025)
di: Gu, Zekai, et al.
Pubblicazione: (2025)
DressCode: Autoregressively Sewing and Generating Garments from Text Guidance
di: He, Kai, et al.
Pubblicazione: (2024)
di: He, Kai, et al.
Pubblicazione: (2024)
TextToon: Real-Time Text Toonify Head Avatar from Single Video
di: Song, Luchuan, et al.
Pubblicazione: (2024)
di: Song, Luchuan, et al.
Pubblicazione: (2024)
DiLightNet: Fine-grained Lighting Control for Diffusion-based Image Generation
di: Zeng, Chong, et al.
Pubblicazione: (2024)
di: Zeng, Chong, et al.
Pubblicazione: (2024)
HPR3D: Hierarchical Proxy Representation for High-Fidelity 3D Reconstruction and Controllable Editing
di: Wang, Tielong, et al.
Pubblicazione: (2025)
di: Wang, Tielong, et al.
Pubblicazione: (2025)
TexControl: Sketch-Based Two-Stage Fashion Image Generation Using Diffusion Model
di: Zhang, Yongming, et al.
Pubblicazione: (2024)
di: Zhang, Yongming, et al.
Pubblicazione: (2024)
Improved 3D Scene Stylization via Text-Guided Generative Image Editing with Region-Based Control
di: Fujiwara, Haruo, et al.
Pubblicazione: (2025)
di: Fujiwara, Haruo, et al.
Pubblicazione: (2025)
Image Sculpting: Precise Object Editing with 3D Geometry Control
di: Yenphraphai, Jiraphon, et al.
Pubblicazione: (2024)
di: Yenphraphai, Jiraphon, et al.
Pubblicazione: (2024)
Shape Conditioned Human Motion Generation with Diffusion Model
di: Xue, Kebing, et al.
Pubblicazione: (2024)
di: Xue, Kebing, et al.
Pubblicazione: (2024)
Human-VDM: Learning Single-Image 3D Human Gaussian Splatting from Video Diffusion Models
di: Liu, Zhibin, et al.
Pubblicazione: (2024)
di: Liu, Zhibin, et al.
Pubblicazione: (2024)
Generic 3D Diffusion Adapter Using Controlled Multi-View Editing
di: Chen, Hansheng, et al.
Pubblicazione: (2024)
di: Chen, Hansheng, et al.
Pubblicazione: (2024)
MIND: Multi-Scale Intent Diffusion for Text-Driven Physics-Based Humanoid Control
di: Li, Bin, et al.
Pubblicazione: (2026)
di: Li, Bin, et al.
Pubblicazione: (2026)
Surf3R: Rapid Surface Reconstruction from Sparse RGB Views in Seconds
di: Zhu, Haodong, et al.
Pubblicazione: (2025)
di: Zhu, Haodong, et al.
Pubblicazione: (2025)
Controllable Video Generation: A Survey
di: Ma, Yue, et al.
Pubblicazione: (2025)
di: Ma, Yue, et al.
Pubblicazione: (2025)
GaussianDreamer: Fast Generation from Text to 3D Gaussians by Bridging 2D and 3D Diffusion Models
di: Yi, Taoran, et al.
Pubblicazione: (2023)
di: Yi, Taoran, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Orthogonal Finetuning Made Scalable
di: Qiu, Zeju, et al.
Pubblicazione: (2025) -
Parameter-Efficient Orthogonal Finetuning via Butterfly Factorization
di: Liu, Weiyang, et al.
Pubblicazione: (2023) -
Ghost on the Shell: An Expressive Representation of General 3D Shapes
di: Liu, Zhen, et al.
Pubblicazione: (2023) -
GraphDreamer: Compositional 3D Scene Synthesis from Scene Graphs
di: Gao, Gege, et al.
Pubblicazione: (2023) -
JeDi: Joint-Image Diffusion Models for Finetuning-Free Personalized Text-to-Image Generation
di: Zeng, Yu, et al.
Pubblicazione: (2024)