U-StyDiT: Ultra-high Quality Artistic Style Transfer Using Diffusion Transformers
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Zhanjie, Ma, Ao, Cao, Ke, Wang, Jing, Liu, Shanyuan, Ma, Yuhang, Cheng, Bo, Leng, Dawei, Yin, Yuhui |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
StyMam: A Mamba-Based Generator for Artistic Style Transfer
von: Hong, Zhou, et al.
Veröffentlicht: (2026)
von: Hong, Zhou, et al.
Veröffentlicht: (2026)
Bridge Diffusion Model: Bridge Chinese Text-to-Image Diffusion Model with English Communities
von: Liu, Shanyuan, et al.
Veröffentlicht: (2023)
von: Liu, Shanyuan, et al.
Veröffentlicht: (2023)
HiCo: Hierarchical Controllable Diffusion Model for Layout-to-image Generation
von: Cheng, Bo, et al.
Veröffentlicht: (2024)
von: Cheng, Bo, et al.
Veröffentlicht: (2024)
WISA: World Simulator Assistant for Physics-Aware Text-to-Video Generation
von: Wang, Jing, et al.
Veröffentlicht: (2025)
von: Wang, Jing, et al.
Veröffentlicht: (2025)
NAMI: Efficient Image Generation via Bridged Progressive Rectified Flow Transformers
von: Ma, Yuhang, et al.
Veröffentlicht: (2025)
von: Ma, Yuhang, et al.
Veröffentlicht: (2025)
FLUX-Makeup: High-Fidelity, Identity-Consistent, and Robust Makeup Transfer via Diffusion Transformer
von: Zhu, Jian, et al.
Veröffentlicht: (2025)
von: Zhu, Jian, et al.
Veröffentlicht: (2025)
Qihoo-T2X: An Efficient Proxy-Tokenized Diffusion Transformer for Text-to-Any-Task
von: Wang, Jing, et al.
Veröffentlicht: (2024)
von: Wang, Jing, et al.
Veröffentlicht: (2024)
PlanGen: Towards Unified Layout Planning and Image Generation in Auto-Regressive Vision Language Models
von: He, Runze, et al.
Veröffentlicht: (2025)
von: He, Runze, et al.
Veröffentlicht: (2025)
NanoControl: A Lightweight Framework for Precise and Efficient Control in Diffusion Transformer
von: Liu, Shanyuan, et al.
Veröffentlicht: (2025)
von: Liu, Shanyuan, et al.
Veröffentlicht: (2025)
CTA-Flux: Integrating Chinese Cultural Semantics into High-Quality English Text-to-Image Communities
von: Gong, Yue, et al.
Veröffentlicht: (2025)
von: Gong, Yue, et al.
Veröffentlicht: (2025)
RevealLayer: Disentangling Hidden and Visible Layers via Occlusion-Aware Image Decomposition
von: Wang, Binhao, et al.
Veröffentlicht: (2026)
von: Wang, Binhao, et al.
Veröffentlicht: (2026)
DyArtbank: Diverse Artistic Style Transfer via Pre-trained Stable Diffusion and Dynamic Style Prompt Artbank
von: Zhang, Zhanjie, et al.
Veröffentlicht: (2025)
von: Zhang, Zhanjie, et al.
Veröffentlicht: (2025)
Artistic Neural Style Transfer Algorithms with Activation Smoothing
von: Li, Xiangtian, et al.
Veröffentlicht: (2024)
von: Li, Xiangtian, et al.
Veröffentlicht: (2024)
Lay2Story: Extending Diffusion Transformers for Layout-Togglable Story Generation
von: Ma, Ao, et al.
Veröffentlicht: (2025)
von: Ma, Ao, et al.
Veröffentlicht: (2025)
RefTon: Reference person shot assist virtual Try-on
von: Li, Liuzhuozheng, et al.
Veröffentlicht: (2025)
von: Li, Liuzhuozheng, et al.
Veröffentlicht: (2025)
FancyVideo: Towards Dynamic and Consistent Video Generation via Cross-frame Textual Guidance
von: Feng, Jiasong, et al.
Veröffentlicht: (2024)
von: Feng, Jiasong, et al.
Veröffentlicht: (2024)
RPiAE: A Representation-Pivoted Autoencoder Enhancing Both Image Generation and Editing
von: Gong, Yue, et al.
Veröffentlicht: (2026)
von: Gong, Yue, et al.
Veröffentlicht: (2026)
StyDeco: Unsupervised Style Transfer with Distilling Priors and Semantic Decoupling
von: Yang, Yuanlin, et al.
Veröffentlicht: (2025)
von: Yang, Yuanlin, et al.
Veröffentlicht: (2025)
Towards Highly Realistic Artistic Style Transfer via Stable Diffusion with Step-aware and Layer-aware Prompt
von: Zhang, Zhanjie, et al.
Veröffentlicht: (2024)
von: Zhang, Zhanjie, et al.
Veröffentlicht: (2024)
FedCVU: Federated Learning for Cross-View Video Understanding
von: Zhang, Shenghan, et al.
Veröffentlicht: (2026)
von: Zhang, Shenghan, et al.
Veröffentlicht: (2026)
LMM-Det: Make Large Multimodal Models Excel in Object Detection
von: Li, Jincheng, et al.
Veröffentlicht: (2025)
von: Li, Jincheng, et al.
Veröffentlicht: (2025)
ResDiT: Evoking the Intrinsic Resolution Scalability in Diffusion Transformers
von: Ma, Yiyang, et al.
Veröffentlicht: (2025)
von: Ma, Yiyang, et al.
Veröffentlicht: (2025)
Rethink Arbitrary Style Transfer with Transformer and Contrastive Learning
von: Zhang, Zhanjie, et al.
Veröffentlicht: (2024)
von: Zhang, Zhanjie, et al.
Veröffentlicht: (2024)
ConStyX: Content Style Augmentation for Generalizable Medical Image Segmentation
von: Chen, Xi, et al.
Veröffentlicht: (2025)
von: Chen, Xi, et al.
Veröffentlicht: (2025)
Coarse-to-Fine Structure-Aware Artistic Style Transfer
von: Liu, Kunxiao, et al.
Veröffentlicht: (2025)
von: Liu, Kunxiao, et al.
Veröffentlicht: (2025)
Learning Artistic Signatures: Symmetry Discovery and Style Transfer
von: Finn, Emma, et al.
Veröffentlicht: (2024)
von: Finn, Emma, et al.
Veröffentlicht: (2024)
Artistic Style Transfer Based on Attention with Knowledge Distillation
von: Hanadi Al‐Mekhlafi, et al.
Veröffentlicht: (2024)
von: Hanadi Al‐Mekhlafi, et al.
Veröffentlicht: (2024)
Edge Caching‐Enabled Artistic Painting Style Transfer
von: Rusi Gao
Veröffentlicht: (2026)
von: Rusi Gao
Veröffentlicht: (2026)
RelaCtrl: Relevance-Guided Efficient Control for Diffusion Transformers
von: Cao, Ke, et al.
Veröffentlicht: (2025)
von: Cao, Ke, et al.
Veröffentlicht: (2025)
IAA: Inner-Adaptor Architecture Empowers Frozen Large Language Model with Multimodal Capabilities
von: Wang, Bin, et al.
Veröffentlicht: (2024)
von: Wang, Bin, et al.
Veröffentlicht: (2024)
Neural Artistic Style and Color Transfer Using Deep Learning
von: London, Justin
Veröffentlicht: (2025)
von: London, Justin
Veröffentlicht: (2025)
SPAST: Arbitrary Style Transfer with Style Priors via Pre-trained Large-scale Model
von: Zhang, Zhanjie, et al.
Veröffentlicht: (2025)
von: Zhang, Zhanjie, et al.
Veröffentlicht: (2025)
DiT-IC: Aligned Diffusion Transformer for Efficient Image Compression
von: Shi, Junqi, et al.
Veröffentlicht: (2026)
von: Shi, Junqi, et al.
Veröffentlicht: (2026)
FG-CLIP 2: A Bilingual Fine-grained Vision-Language Alignment Model
von: Xie, Chunyu, et al.
Veröffentlicht: (2025)
von: Xie, Chunyu, et al.
Veröffentlicht: (2025)
WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization
von: Zhuoqi, Ma, et al.
Veröffentlicht: (2024)
von: Zhuoqi, Ma, et al.
Veröffentlicht: (2024)
StyDeSty: Min-Max Stylization and Destylization for Single Domain Generalization
von: Liu, Songhua, et al.
Veröffentlicht: (2024)
von: Liu, Songhua, et al.
Veröffentlicht: (2024)
StyleRWKV: High-Quality and High-Efficiency Style Transfer with RWKV-like Architecture
von: Dai, Miaomiao, et al.
Veröffentlicht: (2024)
von: Dai, Miaomiao, et al.
Veröffentlicht: (2024)
DiTalker: A Unified DiT-based Framework for High-Quality and Speaking Styles Controllable Portrait Animation
von: Feng, He, et al.
Veröffentlicht: (2025)
von: Feng, He, et al.
Veröffentlicht: (2025)
StyleDecoupler: Generalizable Artistic Style Disentanglement
von: Jia, Zexi, et al.
Veröffentlicht: (2026)
von: Jia, Zexi, et al.
Veröffentlicht: (2026)
OmniStyle: Filtering High Quality Style Transfer Data at Scale
von: Wang, Ye, et al.
Veröffentlicht: (2025)
von: Wang, Ye, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
StyMam: A Mamba-Based Generator for Artistic Style Transfer
von: Hong, Zhou, et al.
Veröffentlicht: (2026) -
Bridge Diffusion Model: Bridge Chinese Text-to-Image Diffusion Model with English Communities
von: Liu, Shanyuan, et al.
Veröffentlicht: (2023) -
HiCo: Hierarchical Controllable Diffusion Model for Layout-to-image Generation
von: Cheng, Bo, et al.
Veröffentlicht: (2024) -
WISA: World Simulator Assistant for Physics-Aware Text-to-Video Generation
von: Wang, Jing, et al.
Veröffentlicht: (2025) -
NAMI: Efficient Image Generation via Bridged Progressive Rectified Flow Transformers
von: Ma, Yuhang, et al.
Veröffentlicht: (2025)