DiT-VTON: Diffusion Transformer Framework for Unified Multi-Category Virtual Try-On and Virtual Try-All with Integrated Image Editing
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Li, Qi, Qiu, Shuwen, Han, Julien, Xu, Xingzi, Seyfioglu, Mehmet Saygin, Koo, Kee Kiat, Bouyarmane, Karim |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Efficient Encoder-Free Pose Conditioning and Pose Control for Virtual Try-On
von: Li, Qi, et al.
Veröffentlicht: (2025)
von: Li, Qi, et al.
Veröffentlicht: (2025)
InstructVTON: Optimal Auto-Masking and Natural-Language-Guided Interactive Style Control for Inpainting-Based Virtual Try-On
von: Han, Julien, et al.
Veröffentlicht: (2025)
von: Han, Julien, et al.
Veröffentlicht: (2025)
DEFT-VTON: Efficient Virtual Try-On with Consistent Generalised H-Transform
von: Xu, Xingzi, et al.
Veröffentlicht: (2025)
von: Xu, Xingzi, et al.
Veröffentlicht: (2025)
Style-Instructed Mask-Free Virtual Try On
von: Zhang, Mengqi, et al.
Veröffentlicht: (2026)
von: Zhang, Mengqi, et al.
Veröffentlicht: (2026)
Diffuse to Choose: Enriching Image Conditioned Inpainting in Latent Diffusion Models for Virtual Try-All
von: Seyfioglu, Mehmet Saygin, et al.
Veröffentlicht: (2024)
von: Seyfioglu, Mehmet Saygin, et al.
Veröffentlicht: (2024)
When Rubrics Fail: Error Enumeration as Reward in Reference-Free RL Post-Training for Virtual Try-On
von: Ikezogwo, Wisdom, et al.
Veröffentlicht: (2026)
von: Ikezogwo, Wisdom, et al.
Veröffentlicht: (2026)
MC-VTON: Minimal Control Virtual Try-On Diffusion Transformer
von: Luan, Junsheng, et al.
Veröffentlicht: (2025)
von: Luan, Junsheng, et al.
Veröffentlicht: (2025)
FLDM-VTON: Faithful Latent Diffusion Model for Virtual Try-on
von: Wang, Chenhui, et al.
Veröffentlicht: (2024)
von: Wang, Chenhui, et al.
Veröffentlicht: (2024)
CatVTON: Concatenation Is All You Need for Virtual Try-On with Diffusion Models
von: Chong, Zheng, et al.
Veröffentlicht: (2024)
von: Chong, Zheng, et al.
Veröffentlicht: (2024)
VTON-IT: Virtual Try-On using Image Translation
von: Adhikari, Santosh, et al.
Veröffentlicht: (2023)
von: Adhikari, Santosh, et al.
Veröffentlicht: (2023)
MV-VTON: Multi-View Virtual Try-On with Diffusion Models
von: Wang, Haoyu, et al.
Veröffentlicht: (2024)
von: Wang, Haoyu, et al.
Veröffentlicht: (2024)
ACDG-VTON: Accurate and Contained Diffusion Generation for Virtual Try-On
von: Zhang, Jeffrey, et al.
Veröffentlicht: (2024)
von: Zhang, Jeffrey, et al.
Veröffentlicht: (2024)
Mobile-VTON: High-Fidelity On-Device Virtual Try-On
von: Wan, Zhenchen, et al.
Veröffentlicht: (2026)
von: Wan, Zhenchen, et al.
Veröffentlicht: (2026)
OmniVTON: Training-Free Universal Virtual Try-On
von: Yang, Zhaotong, et al.
Veröffentlicht: (2025)
von: Yang, Zhaotong, et al.
Veröffentlicht: (2025)
MuGa-VTON: Multi-Garment Virtual Try-On via Diffusion Transformers with Prompt Customization
von: Deria, Ankan, et al.
Veröffentlicht: (2025)
von: Deria, Ankan, et al.
Veröffentlicht: (2025)
MFP-VTON: Enhancing Mask-Free Person-to-Person Virtual Try-On via Diffusion Transformer
von: Shen, Le, et al.
Veröffentlicht: (2025)
von: Shen, Le, et al.
Veröffentlicht: (2025)
DreamVTON: Customizing 3D Virtual Try-on with Personalized Diffusion Models
von: Xie, Zhenyu, et al.
Veröffentlicht: (2024)
von: Xie, Zhenyu, et al.
Veröffentlicht: (2024)
FW-VTON: Flattening-and-Warping for Person-to-Person Virtual Try-on
von: Wang, Zheng, et al.
Veröffentlicht: (2025)
von: Wang, Zheng, et al.
Veröffentlicht: (2025)
AvatarVTON: 4D Virtual Try-On for Animatable Avatars
von: Jiang, Zicheng, et al.
Veröffentlicht: (2025)
von: Jiang, Zicheng, et al.
Veröffentlicht: (2025)
Confidence-Aware Sub-Structure Beam Search (CABS): Mitigating Hallucination in Structured Data Generation with Large Language Models
von: Wei, Chengwei, et al.
Veröffentlicht: (2024)
von: Wei, Chengwei, et al.
Veröffentlicht: (2024)
D$^4$-VTON: Dynamic Semantics Disentangling for Differential Diffusion based Virtual Try-On
von: Yang, Zhaotong, et al.
Veröffentlicht: (2024)
von: Yang, Zhaotong, et al.
Veröffentlicht: (2024)
GS-VTON: Controllable 3D Virtual Try-on with Gaussian Splatting
von: Cao, Yukang, et al.
Veröffentlicht: (2024)
von: Cao, Yukang, et al.
Veröffentlicht: (2024)
SIFT-VTON: Geometric Correspondence Supervision on Cross-Attention for Virtual Try-On
von: Takemoto, Kosuke, et al.
Veröffentlicht: (2026)
von: Takemoto, Kosuke, et al.
Veröffentlicht: (2026)
Voost: A Unified and Scalable Diffusion Transformer for Bidirectional Virtual Try-On and Try-Off
von: Lee, Seungyong, et al.
Veröffentlicht: (2025)
von: Lee, Seungyong, et al.
Veröffentlicht: (2025)
CrossVTON: Mimicking the Logic Reasoning on Cross-category Virtual Try-on guided by Tri-zone Priors
von: Luo, Donghao, et al.
Veröffentlicht: (2025)
von: Luo, Donghao, et al.
Veröffentlicht: (2025)
HF-VTON: High-Fidelity Virtual Try-On via Consistent Geometric and Semantic Alignment
von: Meng, Ming, et al.
Veröffentlicht: (2025)
von: Meng, Ming, et al.
Veröffentlicht: (2025)
OmniVTON++: Training-Free Universal Virtual Try-On with Principal Pose Guidance
von: Yang, Zhaotong, et al.
Veröffentlicht: (2026)
von: Yang, Zhaotong, et al.
Veröffentlicht: (2026)
VTON 360: High-Fidelity Virtual Try-On from Any Viewing Direction
von: He, Zijian, et al.
Veröffentlicht: (2025)
von: He, Zijian, et al.
Veröffentlicht: (2025)
DS-VTON: An Enhanced Dual-Scale Coarse-to-Fine Framework for Virtual Try-On
von: Sun, Xianbing, et al.
Veröffentlicht: (2025)
von: Sun, Xianbing, et al.
Veröffentlicht: (2025)
Once Is Enough: Lightweight DiT-Based Video Virtual Try-On via One-Time Garment Appearance Injection
von: Pan, Yanjie, et al.
Veröffentlicht: (2025)
von: Pan, Yanjie, et al.
Veröffentlicht: (2025)
Structured Object Language Modeling (SoLM): Native Structured Objects Generation Conforming to Complex Schemas with Self-Supervised Denoising
von: Tavanaei, Amir, et al.
Veröffentlicht: (2024)
von: Tavanaei, Amir, et al.
Veröffentlicht: (2024)
DH-VTON: Deep Text-Driven Virtual Try-On via Hybrid Attention Learning
von: Wei, Jiabao, et al.
Veröffentlicht: (2024)
von: Wei, Jiabao, et al.
Veröffentlicht: (2024)
GaussianVTON: 3D Human Virtual Try-ON via Multi-Stage Gaussian Splatting Editing with Image Prompting
von: Chen, Haodong, et al.
Veröffentlicht: (2024)
von: Chen, Haodong, et al.
Veröffentlicht: (2024)
MagicTryOn: Harnessing Diffusion Transformer for Garment-Preserving Video Virtual Try-on
von: Li, Guangyuan, et al.
Veröffentlicht: (2025)
von: Li, Guangyuan, et al.
Veröffentlicht: (2025)
Dress-ED: Instruction-Guided Editing for Virtual Try-On and Try-Off
von: Sanguigni, Fulvio, et al.
Veröffentlicht: (2026)
von: Sanguigni, Fulvio, et al.
Veröffentlicht: (2026)
DiT4Edit: Diffusion Transformer for Image Editing
von: Feng, Kunyu, et al.
Veröffentlicht: (2024)
von: Feng, Kunyu, et al.
Veröffentlicht: (2024)
ITVTON: Virtual Try-On Diffusion Transformer Based on Integrated Image and Text
von: Ni, Haifeng, et al.
Veröffentlicht: (2025)
von: Ni, Haifeng, et al.
Veröffentlicht: (2025)
VITON-DiT: Learning In-the-Wild Video Try-On from Human Dance Videos via Diffusion Transformers
von: Zheng, Jun, et al.
Veröffentlicht: (2024)
von: Zheng, Jun, et al.
Veröffentlicht: (2024)
LPH-VTON: Resolving the Structure-Texture Dilemma of Virtual Try-On via Latent Process Handover
von: Liu, Yixin, et al.
Veröffentlicht: (2026)
von: Liu, Yixin, et al.
Veröffentlicht: (2026)
VTON-HandFit: Virtual Try-on for Arbitrary Hand Pose Guided by Hand Priors Embedding
von: Liang, Yujie, et al.
Veröffentlicht: (2024)
von: Liang, Yujie, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Efficient Encoder-Free Pose Conditioning and Pose Control for Virtual Try-On
von: Li, Qi, et al.
Veröffentlicht: (2025) -
InstructVTON: Optimal Auto-Masking and Natural-Language-Guided Interactive Style Control for Inpainting-Based Virtual Try-On
von: Han, Julien, et al.
Veröffentlicht: (2025) -
DEFT-VTON: Efficient Virtual Try-On with Consistent Generalised H-Transform
von: Xu, Xingzi, et al.
Veröffentlicht: (2025) -
Style-Instructed Mask-Free Virtual Try On
von: Zhang, Mengqi, et al.
Veröffentlicht: (2026) -
Diffuse to Choose: Enriching Image Conditioned Inpainting in Latent Diffusion Models for Virtual Try-All
von: Seyfioglu, Mehmet Saygin, et al.
Veröffentlicht: (2024)