FashionLens: Toward Versatile Fashion Image Retrieval via Task-Adaptive Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wen, Haokun, Song, Xuemeng, Xie, Xinghao, Chen, Xiaolin, Zhao, Xiangyu, Guan, Weili |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
UniCVR: From Alignment to Reranking for Unified Zero-Shot Composed Visual Retrieval
par: Wen, Haokun, et autres
Publié: (2026)
par: Wen, Haokun, et autres
Publié: (2026)
Fashion-RAG: Multimodal Fashion Image Editing via Retrieval-Augmented Generation
par: Sanguigni, Fulvio, et autres
Publié: (2025)
par: Sanguigni, Fulvio, et autres
Publié: (2025)
Pseudo-triplet Guided Few-shot Composed Image Retrieval
par: Hou, Bohan, et autres
Publié: (2024)
par: Hou, Bohan, et autres
Publié: (2024)
Fine-grained Textual Inversion Network for Zero-Shot Composed Image Retrieval
par: Lin, Haoqiang, et autres
Publié: (2025)
par: Lin, Haoqiang, et autres
Publié: (2025)
Dual Knowledge-Enhanced Two-Stage Reasoner for Multimodal Dialog Systems
par: Chen, Xiaolin, et autres
Publié: (2025)
par: Chen, Xiaolin, et autres
Publié: (2025)
Self-Training Boosted Multi-Factor Matching Network for Composed Image Retrieval
par: Wen, Haokun, et autres
Publié: (2023)
par: Wen, Haokun, et autres
Publié: (2023)
HUD: Hierarchical Uncertainty-Aware Disambiguation Network for Composed Video Retrieval
par: Chen, Zhiwei, et autres
Publié: (2025)
par: Chen, Zhiwei, et autres
Publié: (2025)
A Comprehensive Survey on Composed Image Retrieval
par: Song, Xuemeng, et autres
Publié: (2025)
par: Song, Xuemeng, et autres
Publié: (2025)
Self-distilled Dynamic Fusion Network for Language-based Fashion Retrieval
par: Wu, Yiming, et autres
Publié: (2024)
par: Wu, Yiming, et autres
Publié: (2024)
FCBoost-Net: A Generative Network for Synthesizing Multiple Collocated Outfits via Fashion Compatibility Boosting
par: Zhou, Dongliang, et autres
Publié: (2025)
par: Zhou, Dongliang, et autres
Publié: (2025)
PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning
par: Lyu, Yibo, et autres
Publié: (2025)
par: Lyu, Yibo, et autres
Publié: (2025)
Simple but Effective Raw-Data Level Multimodal Fusion for Composed Image Retrieval
par: Wen, Haokun, et autres
Publié: (2024)
par: Wen, Haokun, et autres
Publié: (2024)
COutfitGAN: Learning to Synthesize Compatible Outfits Supervised by Silhouette Masks and Fashion Styles
par: Zhou, Dongliang, et autres
Publié: (2025)
par: Zhou, Dongliang, et autres
Publié: (2025)
ENCLIP: Ensembling and Clustering-Based Contrastive Language-Image Pretraining for Fashion Multimodal Search with Limited Data and Low-Quality Images
par: Naik, Prithviraj Purushottam, et autres
Publié: (2024)
par: Naik, Prithviraj Purushottam, et autres
Publié: (2024)
CAMeL: Cross-modality Adaptive Meta-Learning for Text-based Person Retrieval
par: Yu, Hang, et autres
Publié: (2025)
par: Yu, Hang, et autres
Publié: (2025)
TALDS-Net: Task-Aware Adaptive Local Descriptors Selection for Few-shot Image Classification
par: Qiao, Qian, et autres
Publié: (2023)
par: Qiao, Qian, et autres
Publié: (2023)
Towards Unbiased Cross-Modal Representation Learning for Food Image-to-Recipe Retrieval
par: Wang, Qing, et autres
Publié: (2025)
par: Wang, Qing, et autres
Publié: (2025)
TR-DETR: Task-Reciprocal Transformer for Joint Moment Retrieval and Highlight Detection
par: Sun, Hao, et autres
Publié: (2024)
par: Sun, Hao, et autres
Publié: (2024)
Multi-Modal Image Fusion via Intervention-Stable Feature Learning
par: Wang, Xue, et autres
Publié: (2026)
par: Wang, Xue, et autres
Publié: (2026)
Beyond Semantic Search: Towards Referential Anchoring in Composed Image Retrieval
par: Yang, Yuxin, et autres
Publié: (2026)
par: Yang, Yuxin, et autres
Publié: (2026)
Fine-grained Image Retrieval via Dual-Vision Adaptation
par: Jiang, Xin, et autres
Publié: (2025)
par: Jiang, Xin, et autres
Publié: (2025)
Deep Reversible Consistency Learning for Cross-modal Retrieval
par: Pu, Ruitao, et autres
Publié: (2025)
par: Pu, Ruitao, et autres
Publié: (2025)
Enhancing Partially Relevant Video Retrieval with Robust Alignment Learning
par: Zhang, Long, et autres
Publié: (2025)
par: Zhang, Long, et autres
Publié: (2025)
Learning Generalizable and Efficient Image Watermarking via Hierarchical Two-Stage Optimization
par: Liu, Ke, et autres
Publié: (2025)
par: Liu, Ke, et autres
Publié: (2025)
Adaptive Low Light Enhancement via Joint Global-Local Illumination Adjustment
par: Wang, Haodian, et autres
Publié: (2025)
par: Wang, Haodian, et autres
Publié: (2025)
OmniFashion: Towards Generalist Fashion Intelligence via Multi-Task Vision-Language Learning
par: Yang, Zhengwei, et autres
Publié: (2026)
par: Yang, Zhengwei, et autres
Publié: (2026)
UniFashion: A Unified Vision-Language Model for Multimodal Fashion Retrieval and Generation
par: Zhao, Xiangyu, et autres
Publié: (2024)
par: Zhao, Xiangyu, et autres
Publié: (2024)
Vision-Language Models Learn Super Images for Efficient Partially Relevant Video Retrieval
par: Nishimura, Taichi, et autres
Publié: (2023)
par: Nishimura, Taichi, et autres
Publié: (2023)
DVF: Advancing Robust and Accurate Fine-Grained Image Retrieval with Retrieval Guidelines
par: Jiang, Xin, et autres
Publié: (2024)
par: Jiang, Xin, et autres
Publié: (2024)
FashionReGen: LLM-Empowered Fashion Report Generation
par: Ding, Yujuan, et autres
Publié: (2024)
par: Ding, Yujuan, et autres
Publié: (2024)
T2VParser: Adaptive Decomposition Tokens for Partial Alignment in Text to Video Retrieval
par: Li, Yili, et autres
Publié: (2025)
par: Li, Yili, et autres
Publié: (2025)
Transcending Fusion: A Multi-Scale Alignment Method for Remote Sensing Image-Text Retrieval
par: Yang, Rui, et autres
Publié: (2024)
par: Yang, Rui, et autres
Publié: (2024)
UniAV: Unified Audio-Visual Perception for Multi-Task Video Event Localization
par: Geng, Tiantian, et autres
Publié: (2024)
par: Geng, Tiantian, et autres
Publié: (2024)
Towards Efficient SDRTV-to-HDRTV by Learning from Image Formation
par: Chen, Xiangyu, et autres
Publié: (2023)
par: Chen, Xiangyu, et autres
Publié: (2023)
Scaling Prompt Instructed Zero Shot Composed Image Retrieval with Image-Only Data
par: Duan, Yiqun, et autres
Publié: (2025)
par: Duan, Yiqun, et autres
Publié: (2025)
Towards Realistic Low-Light Image Enhancement via ISP Driven Data Modeling
par: Wang, Zhihua, et autres
Publié: (2025)
par: Wang, Zhihua, et autres
Publié: (2025)
FashionDPO:Fine-tune Fashion Outfit Generation Model using Direct Preference Optimization
par: Yu, Mingzhe, et autres
Publié: (2025)
par: Yu, Mingzhe, et autres
Publié: (2025)
TraveLLaMA: A Multimodal Travel Assistant with Large-Scale Dataset and Structured Reasoning
par: Chu, Meng, et autres
Publié: (2025)
par: Chu, Meng, et autres
Publié: (2025)
3D Gaussian Editing with A Single Image
par: Luo, Guan, et autres
Publié: (2024)
par: Luo, Guan, et autres
Publié: (2024)
A Simple Task-aware Contrastive Local Descriptor Selection Strategy for Few-shot Learning between inter class and intra class
par: Qiao, Qian, et autres
Publié: (2024)
par: Qiao, Qian, et autres
Publié: (2024)
Documents similaires
-
UniCVR: From Alignment to Reranking for Unified Zero-Shot Composed Visual Retrieval
par: Wen, Haokun, et autres
Publié: (2026) -
Fashion-RAG: Multimodal Fashion Image Editing via Retrieval-Augmented Generation
par: Sanguigni, Fulvio, et autres
Publié: (2025) -
Pseudo-triplet Guided Few-shot Composed Image Retrieval
par: Hou, Bohan, et autres
Publié: (2024) -
Fine-grained Textual Inversion Network for Zero-Shot Composed Image Retrieval
par: Lin, Haoqiang, et autres
Publié: (2025) -
Dual Knowledge-Enhanced Two-Stage Reasoner for Multimodal Dialog Systems
par: Chen, Xiaolin, et autres
Publié: (2025)