TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hu, Yujie, Zhang, Xuanyu, Li, Weiqi, Zhang, Jian |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TalkPhoto: A Versatile Training-Free Conversational Assistant for Intelligent Image Editing
par: Hu, Yujie, et autres
Publié: (2026)
par: Hu, Yujie, et autres
Publié: (2026)
Fashion-VDM: Video Diffusion Model for Virtual Try-On
par: Karras, Johanna, et autres
Publié: (2024)
par: Karras, Johanna, et autres
Publié: (2024)
FashionLOGO: Prompting Multimodal Large Language Models for Fashion Logo Embeddings
par: Wang, Zhen, et autres
Publié: (2023)
par: Wang, Zhen, et autres
Publié: (2023)
DiffusionTrend: A Minimalist Approach to Virtual Fashion Try-On
par: Zhan, Wengyi, et autres
Publié: (2024)
par: Zhan, Wengyi, et autres
Publié: (2024)
Tstars-Tryon 1.0: Robust and Realistic Virtual Try-On for Diverse Fashion Items
par: Chen, Mengting, et autres
Publié: (2026)
par: Chen, Mengting, et autres
Publié: (2026)
FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model
par: Pang, Kaicheng, et autres
Publié: (2025)
par: Pang, Kaicheng, et autres
Publié: (2025)
AgriDoctor: A Multimodal Intelligent Assistant for Agriculture
par: Zhang, Mingqing, et autres
Publié: (2025)
par: Zhang, Mingqing, et autres
Publié: (2025)
VTBench: Comprehensive Benchmark Suite Towards Real-World Virtual Try-on Models
par: Xiaobin, Hu, et autres
Publié: (2025)
par: Xiaobin, Hu, et autres
Publié: (2025)
VQ-Insight: Teaching VLMs for AI-Generated Video Quality Understanding via Progressive Visual Reinforcement Learning
par: Zhang, Xuanyu, et autres
Publié: (2025)
par: Zhang, Xuanyu, et autres
Publié: (2025)
OmniTry: Virtual Try-On Anything without Masks
par: Feng, Yutong, et autres
Publié: (2025)
par: Feng, Yutong, et autres
Publié: (2025)
OmniFashion: Towards Generalist Fashion Intelligence via Multi-Task Vision-Language Learning
par: Yang, Zhengwei, et autres
Publié: (2026)
par: Yang, Zhengwei, et autres
Publié: (2026)
UniFashion: A Unified Vision-Language Model for Multimodal Fashion Retrieval and Generation
par: Zhao, Xiangyu, et autres
Publié: (2024)
par: Zhao, Xiangyu, et autres
Publié: (2024)
UARE: A Unified Vision-Language Model for Image Quality Assessment, Restoration, and Enhancement
par: Li, Weiqi, et autres
Publié: (2025)
par: Li, Weiqi, et autres
Publié: (2025)
MV-Fashion: Towards Enabling Virtual Try-On and Size Estimation with Multi-View Paired Data
par: Laczkó, Hunor, et autres
Publié: (2026)
par: Laczkó, Hunor, et autres
Publié: (2026)
Q-Insight: Understanding Image Quality via Visual Reinforcement Learning
par: Li, Weiqi, et autres
Publié: (2025)
par: Li, Weiqi, et autres
Publié: (2025)
Reasoning as Representation: Rethinking Visual Reinforcement Learning in Image Quality Assessment
par: Zhao, Shijie, et autres
Publié: (2025)
par: Zhao, Shijie, et autres
Publié: (2025)
Improved Adversarial Diffusion Compression for Real-World Video Super-Resolution
par: Chen, Bin, et autres
Publié: (2026)
par: Chen, Bin, et autres
Publié: (2026)
Exploring AI in Fashion: A Review of Aesthetics, Personalization, Virtual Try-On, and Forecasting
par: Khalid, Laila, et autres
Publié: (2021)
par: Khalid, Laila, et autres
Publié: (2021)
Image-Based Virtual Try-On: A Survey
par: Song, Dan, et autres
Publié: (2023)
par: Song, Dan, et autres
Publié: (2023)
LLMGA: Multimodal Large Language Model based Generation Assistant
par: Xia, Bin, et autres
Publié: (2023)
par: Xia, Bin, et autres
Publié: (2023)
CrossVTON: Mimicking the Logic Reasoning on Cross-category Virtual Try-on guided by Tri-zone Priors
par: Luo, Donghao, et autres
Publié: (2025)
par: Luo, Donghao, et autres
Publié: (2025)
Progressive Limb-Aware Virtual Try-On
par: Han, Xiaoyu, et autres
Publié: (2025)
par: Han, Xiaoyu, et autres
Publié: (2025)
V2A-Mark: Versatile Deep Visual-Audio Watermarking for Manipulation Localization and Copyright Protection
par: Zhang, Xuanyu, et autres
Publié: (2024)
par: Zhang, Xuanyu, et autres
Publié: (2024)
DirectTryOn: One-Step Virtual Try-On via Straightened Conditional Transport
par: Sun, Xianbing, et autres
Publié: (2026)
par: Sun, Xianbing, et autres
Publié: (2026)
MV-VTON: Multi-View Virtual Try-On with Diffusion Models
par: Wang, Haoyu, et autres
Publié: (2024)
par: Wang, Haoyu, et autres
Publié: (2024)
BTCChat: Advancing Remote Sensing Bi-temporal Change Captioning with Multimodal Large Language Model
par: Li, Yujie, et autres
Publié: (2025)
par: Li, Yujie, et autres
Publié: (2025)
FashionFAE: Fine-grained Attributes Enhanced Fashion Vision-Language Pre-training
par: Huang, Jiale, et autres
Publié: (2024)
par: Huang, Jiale, et autres
Publié: (2024)
MagicTryOn: Harnessing Diffusion Transformer for Garment-Preserving Video Virtual Try-on
par: Li, Guangyuan, et autres
Publié: (2025)
par: Li, Guangyuan, et autres
Publié: (2025)
ENC-Bench: A Benchmark for Evaluating Multimodal Large Language Models in Electronic Navigational Chart Understanding
par: Cheng, Ao, et autres
Publié: (2026)
par: Cheng, Ao, et autres
Publié: (2026)
Dynamic Try-On: Taming Video Virtual Try-on with Dynamic Attention Mechanism
par: Zheng, Jun, et autres
Publié: (2024)
par: Zheng, Jun, et autres
Publié: (2024)
A Novel Garment Transfer Method Supervised by Distilled Knowledge of Virtual Try-on Model
par: Fang, Naiyu, et autres
Publié: (2024)
par: Fang, Naiyu, et autres
Publié: (2024)
LamRA: Large Multimodal Model as Your Advanced Retrieval Assistant
par: Liu, Yikun, et autres
Publié: (2024)
par: Liu, Yikun, et autres
Publié: (2024)
FakeShield: Explainable Image Forgery Detection and Localization via Multi-modal Large Language Models
par: Xu, Zhipei, et autres
Publié: (2024)
par: Xu, Zhipei, et autres
Publié: (2024)
VTON-HandFit: Virtual Try-on for Arbitrary Hand Pose Guided by Hand Priors Embedding
par: Liang, Yujie, et autres
Publié: (2024)
par: Liang, Yujie, et autres
Publié: (2024)
VQ-Jarvis: Retrieval-Augmented Video Restoration Agent with Sharp Vision and Fast Thought
par: Zhang, Xuanyu, et autres
Publié: (2026)
par: Zhang, Xuanyu, et autres
Publié: (2026)
GO-MLVTON: Garment Occlusion-Aware Multi-Layer Virtual Try-On with Diffusion Models
par: Yu, Yang, et autres
Publié: (2026)
par: Yu, Yang, et autres
Publié: (2026)
iTryOn: Mastering Interactive Video Virtual Try-On with Spatial-Semantic Guidance
par: Zheng, Jun, et autres
Publié: (2026)
par: Zheng, Jun, et autres
Publié: (2026)
FW-VTON: Flattening-and-Warping for Person-to-Person Virtual Try-on
par: Wang, Zheng, et autres
Publié: (2025)
par: Wang, Zheng, et autres
Publié: (2025)
OutfitAnyone: Ultra-high Quality Virtual Try-On for Any Clothing and Any Person
par: Sun, Ke, et autres
Publié: (2024)
par: Sun, Ke, et autres
Publié: (2024)
VITON-DRR: Details Retention Virtual Try-on via Non-rigid Registration
par: Li, Ben, et autres
Publié: (2025)
par: Li, Ben, et autres
Publié: (2025)
Documents similaires
-
TalkPhoto: A Versatile Training-Free Conversational Assistant for Intelligent Image Editing
par: Hu, Yujie, et autres
Publié: (2026) -
Fashion-VDM: Video Diffusion Model for Virtual Try-On
par: Karras, Johanna, et autres
Publié: (2024) -
FashionLOGO: Prompting Multimodal Large Language Models for Fashion Logo Embeddings
par: Wang, Zhen, et autres
Publié: (2023) -
DiffusionTrend: A Minimalist Approach to Virtual Fashion Try-On
par: Zhan, Wengyi, et autres
Publié: (2024) -
Tstars-Tryon 1.0: Robust and Realistic Virtual Try-On for Diverse Fashion Items
par: Chen, Mengting, et autres
Publié: (2026)