ITA-MDT: Image-Timestep-Adaptive Masked Diffusion Transformer Framework for Image-Based Virtual Try-On
Fuente:
arXiv
Saved in:
| Main Authors: | Hong, Ji Woo, Ton, Tri, Pham, Trung X., Koo, Gwanhyeong, Yoon, Sunjae, Yoo, Chang D. |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Wavelet-Guided Acceleration of Text Inversion in Diffusion-Based Image Editing
by: Koo, Gwanhyeong, et al.
Published: (2024)
by: Koo, Gwanhyeong, et al.
Published: (2024)
DNI: Dilutional Noise Initialization for Diffusion Video Editing
by: Yoon, Sunjae, et al.
Published: (2024)
by: Yoon, Sunjae, et al.
Published: (2024)
MDSGen: Fast and Efficient Masked Diffusion Temporal-Aware Transformers for Open-Domain Sound Generation
by: Pham, Trung X., et al.
Published: (2024)
by: Pham, Trung X., et al.
Published: (2024)
TPC: Test-time Procrustes Calibration for Diffusion-based Human Image Animation
by: Yoon, Sunjae, et al.
Published: (2024)
by: Yoon, Sunjae, et al.
Published: (2024)
FlowDrag: 3D-aware Drag-based Image Editing with Mesh-guided Deformation Vector Flow Fields
by: Koo, Gwanhyeong, et al.
Published: (2025)
by: Koo, Gwanhyeong, et al.
Published: (2025)
FlexiEdit: Frequency-Aware Latent Refinement for Enhanced Non-Rigid Editing
by: Koo, Gwanhyeong, et al.
Published: (2024)
by: Koo, Gwanhyeong, et al.
Published: (2024)
TARO: Timestep-Adaptive Representation Alignment with Onset-Aware Conditioning for Synchronized Video-to-Audio Synthesis
by: Ton, Tri, et al.
Published: (2025)
by: Ton, Tri, et al.
Published: (2025)
FRAG: Frequency Adapting Group for Diffusion Video Editing
by: Yoon, Sunjae, et al.
Published: (2024)
by: Yoon, Sunjae, et al.
Published: (2024)
Occlusion-robust Stylization for Drawing-based 3D Animation
by: Yoon, Sunjae, et al.
Published: (2025)
by: Yoon, Sunjae, et al.
Published: (2025)
Cross-view Masked Diffusion Transformers for Person Image Synthesis
by: Pham, Trung X., et al.
Published: (2024)
by: Pham, Trung X., et al.
Published: (2024)
SCANet: Scene Complexity Aware Network for Weakly-Supervised Video Moment Retrieval
by: Yoon, Sunjae, et al.
Published: (2023)
by: Yoon, Sunjae, et al.
Published: (2023)
E-MD3C: Taming Masked Diffusion Transformers for Efficient Zero-Shot Object Customization
by: Pham, Trung X., et al.
Published: (2025)
by: Pham, Trung X., et al.
Published: (2025)
A Hidden Semantic Bottleneck in Conditional Embeddings of Diffusion Transformers
by: Pham, Trung X., et al.
Published: (2026)
by: Pham, Trung X., et al.
Published: (2026)
High-Fidelity Text-to-Image Generation from Pre-Trained Vision-Language Models via Distribution-Conditioned Diffusion Decoding
by: Hong, Ji Woo, et al.
Published: (2026)
by: Hong, Ji Woo, et al.
Published: (2026)
DiT-VTON: Diffusion Transformer Framework for Unified Multi-Category Virtual Try-On and Virtual Try-All with Integrated Image Editing
by: Li, Qi, et al.
Published: (2025)
by: Li, Qi, et al.
Published: (2025)
Zero-Shot Dual-Path Integration Framework for Open-Vocabulary 3D Instance Segmentation
by: Ton, Tri, et al.
Published: (2024)
by: Ton, Tri, et al.
Published: (2024)
PDCR: Perception-Decomposed Confidence Reward for Vision-Language Reasoning
by: Yoon, Hee Suk, et al.
Published: (2026)
by: Yoon, Hee Suk, et al.
Published: (2026)
Selective Query-guided Debiasing for Video Corpus Moment Retrieval
by: Yoon, Sunjae, et al.
Published: (2022)
by: Yoon, Sunjae, et al.
Published: (2022)
ITVTON: Virtual Try-On Diffusion Transformer Based on Integrated Image and Text
by: Ni, Haifeng, et al.
Published: (2025)
by: Ni, Haifeng, et al.
Published: (2025)
MDT-A2G: Exploring Masked Diffusion Transformers for Co-Speech Gesture Generation
by: Mao, Xiaofeng, et al.
Published: (2024)
by: Mao, Xiaofeng, et al.
Published: (2024)
On the Perturbed States for Transformed Input-robust Reinforcement Learning
by: Luu, Tung M., et al.
Published: (2024)
by: Luu, Tung M., et al.
Published: (2024)
Uncertainty-Aware Rank-One MIMO Q Network Framework for Accelerated Offline Reinforcement Learning
by: Nguyen, Thanh, et al.
Published: (2026)
by: Nguyen, Thanh, et al.
Published: (2026)
JCo-MVTON: Jointly Controllable Multi-Modal Diffusion Transformer for Mask-Free Virtual Try-on
by: Wang, Aowen, et al.
Published: (2025)
by: Wang, Aowen, et al.
Published: (2025)
MFP-VTON: Enhancing Mask-Free Person-to-Person Virtual Try-On via Diffusion Transformer
by: Shen, Le, et al.
Published: (2025)
by: Shen, Le, et al.
Published: (2025)
Timestep-Aware Diffusion Model for Extreme Image Rescaling
by: Wang, Ce, et al.
Published: (2024)
by: Wang, Ce, et al.
Published: (2024)
OmniTry: Virtual Try-On Anything without Masks
by: Feng, Yutong, et al.
Published: (2025)
by: Feng, Yutong, et al.
Published: (2025)
TiNO-Edit: Timestep and Noise Optimization for Robust Diffusion-Based Image Editing
by: Chen, Sherry X., et al.
Published: (2024)
by: Chen, Sherry X., et al.
Published: (2024)
Street TryOn: Learning In-the-Wild Virtual Try-On from Unpaired Person Images
by: Cui, Aiyu, et al.
Published: (2023)
by: Cui, Aiyu, et al.
Published: (2023)
Towards Robust Policy: Enhancing Offline Reinforcement Learning with Adversarial Attacks and Defenses
by: Nguyen, Thanh, et al.
Published: (2024)
by: Nguyen, Thanh, et al.
Published: (2024)
Vanast: Virtual Try-On with Human Image Animation via Synthetic Triplet Supervision
by: Cha, Hyunsoo, et al.
Published: (2026)
by: Cha, Hyunsoo, et al.
Published: (2026)
SimPSI: A Simple Strategy to Preserve Spectral Information in Time Series Data Augmentation
by: Ryu, Hyun, et al.
Published: (2023)
by: Ryu, Hyun, et al.
Published: (2023)
Timestep-Aware Block Masking for Efficient Diffusion Model Inference
by: He, Haodong, et al.
Published: (2026)
by: He, Haodong, et al.
Published: (2026)
Explainable Synthetic Image Detection through Diffusion Timestep Ensembling
by: Wu, Yixin, et al.
Published: (2025)
by: Wu, Yixin, et al.
Published: (2025)
TASR: Timestep-Aware Diffusion Model for Image Super-Resolution
by: Lin, Qinwei, et al.
Published: (2024)
by: Lin, Qinwei, et al.
Published: (2024)
Layer- and Timestep-Adaptive Differentiable Token Compression Ratios for Efficient Diffusion Transformers
by: You, Haoran, et al.
Published: (2024)
by: You, Haoran, et al.
Published: (2024)
MagicTryOn: Harnessing Diffusion Transformer for Garment-Preserving Video Virtual Try-on
by: Li, Guangyuan, et al.
Published: (2025)
by: Li, Guangyuan, et al.
Published: (2025)
Video Virtual Try-on with Conditional Diffusion Transformer Inpainter
by: Zou, Cheng, et al.
Published: (2025)
by: Zou, Cheng, et al.
Published: (2025)
Fashion-VDM: Video Diffusion Model for Virtual Try-On
by: Karras, Johanna, et al.
Published: (2024)
by: Karras, Johanna, et al.
Published: (2024)
Style-Instructed Mask-Free Virtual Try On
by: Zhang, Mengqi, et al.
Published: (2026)
by: Zhang, Mengqi, et al.
Published: (2026)
Voost: A Unified and Scalable Diffusion Transformer for Bidirectional Virtual Try-On and Try-Off
by: Lee, Seungyong, et al.
Published: (2025)
by: Lee, Seungyong, et al.
Published: (2025)
Similar Items
-
Wavelet-Guided Acceleration of Text Inversion in Diffusion-Based Image Editing
by: Koo, Gwanhyeong, et al.
Published: (2024) -
DNI: Dilutional Noise Initialization for Diffusion Video Editing
by: Yoon, Sunjae, et al.
Published: (2024) -
MDSGen: Fast and Efficient Masked Diffusion Temporal-Aware Transformers for Open-Domain Sound Generation
by: Pham, Trung X., et al.
Published: (2024) -
TPC: Test-time Procrustes Calibration for Diffusion-based Human Image Animation
by: Yoon, Sunjae, et al.
Published: (2024) -
FlowDrag: 3D-aware Drag-based Image Editing with Mesh-guided Deformation Vector Flow Fields
by: Koo, Gwanhyeong, et al.
Published: (2025)