Dress-ED: Instruction-Guided Editing for Virtual Try-On and Try-Off
Fuente:
arXiv
Salvato in:
| Autori principali: | Sanguigni, Fulvio, Lobba, Davide, Ren, Bin, Cornia, Marcella, Sebe, Nicu, Cucchiara, Rita |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Inverse Virtual Try-On: Generating Multi-Category Product-Style Images from Clothed Individuals
di: Lobba, Davide, et al.
Pubblicazione: (2025)
di: Lobba, Davide, et al.
Pubblicazione: (2025)
Fashion-RAG: Multimodal Fashion Image Editing via Retrieval-Augmented Generation
di: Sanguigni, Fulvio, et al.
Pubblicazione: (2025)
di: Sanguigni, Fulvio, et al.
Pubblicazione: (2025)
Hierarchical Cross-Attention Network for Virtual Try-On
di: Tang, Hao, et al.
Pubblicazione: (2024)
di: Tang, Hao, et al.
Pubblicazione: (2024)
What Changed? Detecting and Evaluating Instruction-Guided Image Edits with Multimodal Large Language Models
di: Baraldi, Lorenzo, et al.
Pubblicazione: (2025)
di: Baraldi, Lorenzo, et al.
Pubblicazione: (2025)
Multimodal-Conditioned Latent Diffusion Models for Fashion Image Editing
di: Baldrati, Alberto, et al.
Pubblicazione: (2024)
di: Baldrati, Alberto, et al.
Pubblicazione: (2024)
Image Captioning Evaluation in the Age of Multimodal LLMs: Challenges and Future Perspectives
di: Sarto, Sara, et al.
Pubblicazione: (2025)
di: Sarto, Sara, et al.
Pubblicazione: (2025)
Fluent and Accurate Image Captioning with a Self-Trained Reward Model
di: Moratelli, Nicholas, et al.
Pubblicazione: (2024)
di: Moratelli, Nicholas, et al.
Pubblicazione: (2024)
Unveiling the Truth: Exploring Human Gaze Patterns in Fake Images
di: Cartella, Giuseppe, et al.
Pubblicazione: (2024)
di: Cartella, Giuseppe, et al.
Pubblicazione: (2024)
Recurrence-Enhanced Vision-and-Language Transformers for Robust Multimodal Document Retrieval
di: Caffagni, Davide, et al.
Pubblicazione: (2025)
di: Caffagni, Davide, et al.
Pubblicazione: (2025)
Recurrence Meets Transformers for Universal Multimodal Retrieval
di: Caffagni, Davide, et al.
Pubblicazione: (2025)
di: Caffagni, Davide, et al.
Pubblicazione: (2025)
Revisiting Image Captioning Training Paradigm via Direct CLIP-based Optimization
di: Moratelli, Nicholas, et al.
Pubblicazione: (2024)
di: Moratelli, Nicholas, et al.
Pubblicazione: (2024)
Personalizing Multimodal Large Language Models for Image Captioning: An Experimental Analysis
di: Bucciarelli, Davide, et al.
Pubblicazione: (2024)
di: Bucciarelli, Davide, et al.
Pubblicazione: (2024)
Training-Free Open-Vocabulary Segmentation with Offline Diffusion-Augmented Prototype Generation
di: Barsellotti, Luca, et al.
Pubblicazione: (2024)
di: Barsellotti, Luca, et al.
Pubblicazione: (2024)
BRIDGE: Bridging Gaps in Image Captioning Evaluation with Stronger Visual Cues
di: Sarto, Sara, et al.
Pubblicazione: (2024)
di: Sarto, Sara, et al.
Pubblicazione: (2024)
Hallucination Early Detection in Diffusion Models
di: Betti, Federico, et al.
Pubblicazione: (2026)
di: Betti, Federico, et al.
Pubblicazione: (2026)
Optimizing Resource Consumption in Diffusion Models through Hallucination Early Detection
di: Betti, Federico, et al.
Pubblicazione: (2024)
di: Betti, Federico, et al.
Pubblicazione: (2024)
LLaVA-MORE: A Comparative Study of LLMs and Visual Backbones for Enhanced Visual Instruction Tuning
di: Cocchi, Federico, et al.
Pubblicazione: (2025)
di: Cocchi, Federico, et al.
Pubblicazione: (2025)
Personalized Instance-based Navigation Toward User-Specific Objects in Realistic Environments
di: Barsellotti, Luca, et al.
Pubblicazione: (2024)
di: Barsellotti, Luca, et al.
Pubblicazione: (2024)
OmniTry: Virtual Try-On Anything without Masks
di: Feng, Yutong, et al.
Pubblicazione: (2025)
di: Feng, Yutong, et al.
Pubblicazione: (2025)
TryOffAnyone: Tiled Cloth Generation from a Dressed Person
di: Xarchakos, Ioannis, et al.
Pubblicazione: (2024)
di: Xarchakos, Ioannis, et al.
Pubblicazione: (2024)
Tiny Inference-Time Scaling with Latent Verifiers
di: Bucciarelli, Davide, et al.
Pubblicazione: (2026)
di: Bucciarelli, Davide, et al.
Pubblicazione: (2026)
Mitigating Hallucinations in Multimodal LLMs via Object-aware Preference Optimization
di: Compagnoni, Alberto, et al.
Pubblicazione: (2025)
di: Compagnoni, Alberto, et al.
Pubblicazione: (2025)
A Unified Masked Jigsaw Puzzle Framework for Vision and Language Models
di: Ye, Weixin, et al.
Pubblicazione: (2026)
di: Ye, Weixin, et al.
Pubblicazione: (2026)
TryOffDiff: Virtual-Try-Off via High-Fidelity Garment Reconstruction using Diffusion Models
di: Velioglu, Riza, et al.
Pubblicazione: (2024)
di: Velioglu, Riza, et al.
Pubblicazione: (2024)
Shape-Guided Clothing Warping for Virtual Try-On
di: Han, Xiaoyu, et al.
Pubblicazione: (2025)
di: Han, Xiaoyu, et al.
Pubblicazione: (2025)
Parents and Children: Distinguishing Multimodal DeepFakes from Natural Images
di: Amoroso, Roberto, et al.
Pubblicazione: (2023)
di: Amoroso, Roberto, et al.
Pubblicazione: (2023)
Positive-Augmented Contrastive Learning for Vision-and-Language Evaluation and Training
di: Sarto, Sara, et al.
Pubblicazione: (2024)
di: Sarto, Sara, et al.
Pubblicazione: (2024)
Towards Retrieval-Augmented Architectures for Image Captioning
di: Sarto, Sara, et al.
Pubblicazione: (2024)
di: Sarto, Sara, et al.
Pubblicazione: (2024)
Embodied Agents for Efficient Exploration and Smart Scene Description
di: Bigazzi, Roberto, et al.
Pubblicazione: (2023)
di: Bigazzi, Roberto, et al.
Pubblicazione: (2023)
Augmenting Multimodal LLMs with Self-Reflective Tokens for Knowledge-based Visual Question Answering
di: Cocchi, Federico, et al.
Pubblicazione: (2024)
di: Cocchi, Federico, et al.
Pubblicazione: (2024)
Multi-Class Unlearning for Image Classification via Weight Filtering
di: Poppi, Samuele, et al.
Pubblicazione: (2023)
di: Poppi, Samuele, et al.
Pubblicazione: (2023)
GlamTry: Advancing Virtual Try-On for High-End Accessories
di: Chang, Ting-Yu, et al.
Pubblicazione: (2024)
di: Chang, Ting-Yu, et al.
Pubblicazione: (2024)
M&M VTO: Multi-Garment Virtual Try-On and Editing
di: Zhu, Luyang, et al.
Pubblicazione: (2024)
di: Zhu, Luyang, et al.
Pubblicazione: (2024)
MGT: Extending Virtual Try-Off to Multi-Garment Scenarios
di: Velioglu, Riza, et al.
Pubblicazione: (2025)
di: Velioglu, Riza, et al.
Pubblicazione: (2025)
Dynamic Try-On: Taming Video Virtual Try-on with Dynamic Attention Mechanism
di: Zheng, Jun, et al.
Pubblicazione: (2024)
di: Zheng, Jun, et al.
Pubblicazione: (2024)
Wiki-LLaVA: Hierarchical Retrieval-Augmented Generation for Multimodal LLMs
di: Caffagni, Davide, et al.
Pubblicazione: (2024)
di: Caffagni, Davide, et al.
Pubblicazione: (2024)
DiT-VTON: Diffusion Transformer Framework for Unified Multi-Category Virtual Try-On and Virtual Try-All with Integrated Image Editing
di: Li, Qi, et al.
Pubblicazione: (2025)
di: Li, Qi, et al.
Pubblicazione: (2025)
Voost: A Unified and Scalable Diffusion Transformer for Bidirectional Virtual Try-On and Try-Off
di: Lee, Seungyong, et al.
Pubblicazione: (2025)
di: Lee, Seungyong, et al.
Pubblicazione: (2025)
Learning to Mask and Permute Visual Tokens for Vision Transformer Pre-Training
di: Baraldi, Lorenzo, et al.
Pubblicazione: (2023)
di: Baraldi, Lorenzo, et al.
Pubblicazione: (2023)
Spot the Difference: A Novel Task for Embodied Agents in Changing Environments
di: Landi, Federico, et al.
Pubblicazione: (2022)
di: Landi, Federico, et al.
Pubblicazione: (2022)
Documenti analoghi
-
Inverse Virtual Try-On: Generating Multi-Category Product-Style Images from Clothed Individuals
di: Lobba, Davide, et al.
Pubblicazione: (2025) -
Fashion-RAG: Multimodal Fashion Image Editing via Retrieval-Augmented Generation
di: Sanguigni, Fulvio, et al.
Pubblicazione: (2025) -
Hierarchical Cross-Attention Network for Virtual Try-On
di: Tang, Hao, et al.
Pubblicazione: (2024) -
What Changed? Detecting and Evaluating Instruction-Guided Image Edits with Multimodal Large Language Models
di: Baraldi, Lorenzo, et al.
Pubblicazione: (2025) -
Multimodal-Conditioned Latent Diffusion Models for Fashion Image Editing
di: Baldrati, Alberto, et al.
Pubblicazione: (2024)