Attribute-Guided Multi-Level Attention Network for Fine-Grained Fashion Retrieval
Fuente:
arXiv
Salvato in:
| Autori principali: | Xiao, Ling, Yamasaki, Toshihiko |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Multihead Continual Learning Framework for Fine-Grained Fashion Image Retrieval with Contrastive Learning and Exponential Moving Average Distillation
di: Xiao, Ling, et al.
Pubblicazione: (2026)
di: Xiao, Ling, et al.
Pubblicazione: (2026)
ITSELF: Attention Guided Fine-Grained Alignment for Vision-Language Retrieval
di: Nguyen, Tien-Huy, et al.
Pubblicazione: (2026)
di: Nguyen, Tien-Huy, et al.
Pubblicazione: (2026)
Attributes Grouping and Mining Hashing for Fine-Grained Image Retrieval
di: Lu, Xin, et al.
Pubblicazione: (2023)
di: Lu, Xin, et al.
Pubblicazione: (2023)
LookSync: Large-Scale Visual Product Search System for AI-Generated Fashion Looks
di: M, Pradeep, et al.
Pubblicazione: (2025)
di: M, Pradeep, et al.
Pubblicazione: (2025)
Reasoning-Augmented Representations for Multimodal Retrieval
di: Zhang, Jianrui, et al.
Pubblicazione: (2026)
di: Zhang, Jianrui, et al.
Pubblicazione: (2026)
PHPQ: Pyramid Hybrid Pooling Quantization for Efficient Fine-Grained Image Retrieval
di: Zeng, Ziyun, et al.
Pubblicazione: (2021)
di: Zeng, Ziyun, et al.
Pubblicazione: (2021)
Open Multimodal Retrieval-Augmented Factual Image Generation
di: Tian, Yang, et al.
Pubblicazione: (2025)
di: Tian, Yang, et al.
Pubblicazione: (2025)
CaReBench: A Fine-Grained Benchmark for Video Captioning and Retrieval
di: Xu, Yifan, et al.
Pubblicazione: (2024)
di: Xu, Yifan, et al.
Pubblicazione: (2024)
Utility-Oriented Visual Evidence Selection for Multimodal Retrieval-Augmented Generation
di: Luo, Weiqing, et al.
Pubblicazione: (2026)
di: Luo, Weiqing, et al.
Pubblicazione: (2026)
Chain of Evidence: Pixel-Level Visual Attribution for Iterative Retrieval-Augmented Generation
di: Liu, Peiyang, et al.
Pubblicazione: (2026)
di: Liu, Peiyang, et al.
Pubblicazione: (2026)
EIVEN: Efficient Implicit Attribute Value Extraction using Multimodal LLM
di: Zou, Henry Peng, et al.
Pubblicazione: (2024)
di: Zou, Henry Peng, et al.
Pubblicazione: (2024)
MS-DPPs: Multi-Source Determinantal Point Processes for Contextual Diversity Refinement of Composite Attributes in Text to Image Retrieval
di: Sogi, Naoya, et al.
Pubblicazione: (2025)
di: Sogi, Naoya, et al.
Pubblicazione: (2025)
Knowledge Graphs Meet Multi-Modal Learning: A Comprehensive Survey
di: Chen, Zhuo, et al.
Pubblicazione: (2024)
di: Chen, Zhuo, et al.
Pubblicazione: (2024)
ImplicitAVE: An Open-Source Dataset and Multimodal LLMs Benchmark for Implicit Attribute Value Extraction
di: Zou, Henry Peng, et al.
Pubblicazione: (2024)
di: Zou, Henry Peng, et al.
Pubblicazione: (2024)
Distribution-Consistency-Guided Multi-modal Hashing
di: Liu, Jin-Yu, et al.
Pubblicazione: (2024)
di: Liu, Jin-Yu, et al.
Pubblicazione: (2024)
A Signer-Invariant Conformer and Multi-Scale Fusion Transformer for Continuous Sign Language Recognition
di: Haque, Md Rezwanul, et al.
Pubblicazione: (2025)
di: Haque, Md Rezwanul, et al.
Pubblicazione: (2025)
Image Complexity-Aware Adaptive Retrieval for Efficient Vision-Language Models
di: Williams-Lekuona, Mikel, et al.
Pubblicazione: (2025)
di: Williams-Lekuona, Mikel, et al.
Pubblicazione: (2025)
Revisit Anything: Visual Place Recognition via Image Segment Retrieval
di: Garg, Kartik, et al.
Pubblicazione: (2024)
di: Garg, Kartik, et al.
Pubblicazione: (2024)
MM-Embed: Universal Multimodal Retrieval with Multimodal LLMs
di: Lin, Sheng-Chieh, et al.
Pubblicazione: (2024)
di: Lin, Sheng-Chieh, et al.
Pubblicazione: (2024)
Retrieval-augmented Prompt Learning for Pre-trained Foundation Models
di: Chen, Xiang, et al.
Pubblicazione: (2025)
di: Chen, Xiang, et al.
Pubblicazione: (2025)
VideoRAG: Retrieval-Augmented Generation over Video Corpus
di: Jeong, Soyeong, et al.
Pubblicazione: (2025)
di: Jeong, Soyeong, et al.
Pubblicazione: (2025)
PC$^2$: Pseudo-Classification Based Pseudo-Captioning for Noisy Correspondence Learning in Cross-Modal Retrieval
di: Duan, Yue, et al.
Pubblicazione: (2024)
di: Duan, Yue, et al.
Pubblicazione: (2024)
Multi-Grained Query-Guided Set Prediction Network for Grounded Multimodal Named Entity Recognition
di: Tang, Jielong, et al.
Pubblicazione: (2024)
di: Tang, Jielong, et al.
Pubblicazione: (2024)
Benchmarking Robustness of Contrastive Learning Models for Medical Image-Report Retrieval
di: Deanda, Demetrio, et al.
Pubblicazione: (2025)
di: Deanda, Demetrio, et al.
Pubblicazione: (2025)
UniversalRAG: Retrieval-Augmented Generation over Corpora of Diverse Modalities and Granularities
di: Yeo, Woongyeong, et al.
Pubblicazione: (2025)
di: Yeo, Woongyeong, et al.
Pubblicazione: (2025)
Retrieval-Guided Generation for Safer Histopathology Image Captioning
di: Hoq, Md. Enamul, et al.
Pubblicazione: (2026)
di: Hoq, Md. Enamul, et al.
Pubblicazione: (2026)
Reversed in Time: A Novel Temporal-Emphasized Benchmark for Cross-Modal Video-Text Retrieval
di: Du, Yang, et al.
Pubblicazione: (2024)
di: Du, Yang, et al.
Pubblicazione: (2024)
Towards Universal Video Retrieval: Generalizing Video Embedding via Synthesized Multimodal Pyramid Curriculum
di: Guo, Zhuoning, et al.
Pubblicazione: (2025)
di: Guo, Zhuoning, et al.
Pubblicazione: (2025)
A Fashion Item Recommendation Model in Hyperbolic Space
di: Shimizu, Ryotaro, et al.
Pubblicazione: (2024)
di: Shimizu, Ryotaro, et al.
Pubblicazione: (2024)
TabRAG: Improving Tabular Document Question Answering for Retrieval Augmented Generation via Structured Representations
di: Si, Jacob, et al.
Pubblicazione: (2025)
di: Si, Jacob, et al.
Pubblicazione: (2025)
TelcoAI: Advancing 3GPP Technical Specification Search through Agentic Multi-Modal Retrieval-Augmented Generation
di: Ghosh, Rahul, et al.
Pubblicazione: (2025)
di: Ghosh, Rahul, et al.
Pubblicazione: (2025)
Automatic Synthetic Data and Fine-grained Adaptive Feature Alignment for Composed Person Retrieval
di: Liu, Delong, et al.
Pubblicazione: (2023)
di: Liu, Delong, et al.
Pubblicazione: (2023)
FOR: Finetuning for Object Level Open Vocabulary Image Retrieval
di: Levi, Hila, et al.
Pubblicazione: (2024)
di: Levi, Hila, et al.
Pubblicazione: (2024)
Transfer Learning and Mixup for Fine-Grained Few-Shot Fungi Classification
di: Tam, Jason Kahei, et al.
Pubblicazione: (2025)
di: Tam, Jason Kahei, et al.
Pubblicazione: (2025)
Attribute-Aware Implicit Modality Alignment for Text Attribute Person Search
di: Wang, Xin, et al.
Pubblicazione: (2024)
di: Wang, Xin, et al.
Pubblicazione: (2024)
Efficient Table QA via TableGrid Navigation and Progressive Inference Prompting
di: Maurya, Amritansh, et al.
Pubblicazione: (2026)
di: Maurya, Amritansh, et al.
Pubblicazione: (2026)
Vision Search Assistant: Empower Vision-Language Models as Multimodal Search Engines
di: Zhang, Zhixin, et al.
Pubblicazione: (2024)
di: Zhang, Zhixin, et al.
Pubblicazione: (2024)
MOON3.0: Reasoning-aware Multimodal Representation Learning for E-commerce Product Understanding
di: Wu, Junxian, et al.
Pubblicazione: (2026)
di: Wu, Junxian, et al.
Pubblicazione: (2026)
FeatUp: A Model-Agnostic Framework for Features at Any Resolution
di: Fu, Stephanie, et al.
Pubblicazione: (2024)
di: Fu, Stephanie, et al.
Pubblicazione: (2024)
Data-Centric Approach to Constrained Machine Learning: A Case Study on Conway's Game of Life
di: Bibin, Anton, et al.
Pubblicazione: (2024)
di: Bibin, Anton, et al.
Pubblicazione: (2024)
Documenti analoghi
-
A Multihead Continual Learning Framework for Fine-Grained Fashion Image Retrieval with Contrastive Learning and Exponential Moving Average Distillation
di: Xiao, Ling, et al.
Pubblicazione: (2026) -
ITSELF: Attention Guided Fine-Grained Alignment for Vision-Language Retrieval
di: Nguyen, Tien-Huy, et al.
Pubblicazione: (2026) -
Attributes Grouping and Mining Hashing for Fine-Grained Image Retrieval
di: Lu, Xin, et al.
Pubblicazione: (2023) -
LookSync: Large-Scale Visual Product Search System for AI-Generated Fashion Looks
di: M, Pradeep, et al.
Pubblicazione: (2025) -
Reasoning-Augmented Representations for Multimodal Retrieval
di: Zhang, Jianrui, et al.
Pubblicazione: (2026)