TEMA: Anchor the Image, Follow the Text for Multi-Modification Composed Image Retrieval
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Zixu, Hu, Yupeng, Fu, Zhiheng, Chen, Zhiwei, Li, Yongqi, Nie, Liqiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FineCIR: Explicit Parsing of Fine-Grained Modification Semantics for Composed Image Retrieval
por: Li, Zixu, et al.
Publicado: (2025)
por: Li, Zixu, et al.
Publicado: (2025)
OFFSET: Segmentation-based Focus Shift Revision for Composed Image Retrieval
por: Chen, Zhiwei, et al.
Publicado: (2025)
por: Chen, Zhiwei, et al.
Publicado: (2025)
ConeSep: Cone-based Robust Noise-Unlearning Compositional Network for Composed Image Retrieval
por: Li, Zixu, et al.
Publicado: (2026)
por: Li, Zixu, et al.
Publicado: (2026)
R^3: Composed Video Retrieval via Reasoning-Guided Recalling and Re-ranking
por: Li, Zixu, et al.
Publicado: (2026)
por: Li, Zixu, et al.
Publicado: (2026)
MELT: Improve Composed Image Retrieval via the Modification Frequentation-Rarity Balance Network
por: Qiu, Guozhi, et al.
Publicado: (2026)
por: Qiu, Guozhi, et al.
Publicado: (2026)
Air-Know: Arbiter-Calibrated Knowledge-Internalizing Robust Network for Composed Image Retrieval
por: Fu, Zhiheng, et al.
Publicado: (2026)
por: Fu, Zhiheng, et al.
Publicado: (2026)
HINT: Composed Image Retrieval with Dual-path Compositional Contextualized Network
por: Zhang, Mingyu, et al.
Publicado: (2026)
por: Zhang, Mingyu, et al.
Publicado: (2026)
ReTrack: Evidence-Driven Dual-Stream Directional Anchor Calibration Network for Composed Video Retrieval
por: Li, Zixu, et al.
Publicado: (2026)
por: Li, Zixu, et al.
Publicado: (2026)
INTENT: Invariance and Discrimination-aware Noise Mitigation for Robust Composed Image Retrieval
por: Chen, Zhiwei, et al.
Publicado: (2026)
por: Chen, Zhiwei, et al.
Publicado: (2026)
HABIT: Chrono-Synergia Robust Progressive Learning Framework for Composed Image Retrieval
por: Li, Zixu, et al.
Publicado: (2026)
por: Li, Zixu, et al.
Publicado: (2026)
TempRet: Temporal Enhancement and Two-Stage Reranking for CVPR 2026 EPIC-KITCHENS-100 Multi-Instance Retrieval Challenge
por: Li, Zixu, et al.
Publicado: (2026)
por: Li, Zixu, et al.
Publicado: (2026)
HUD: Hierarchical Uncertainty-Aware Disambiguation Network for Composed Video Retrieval
por: Chen, Zhiwei, et al.
Publicado: (2025)
por: Chen, Zhiwei, et al.
Publicado: (2025)
EgoAdapt: A Multi-Scene Egocentric Adaptation Method for CVPR 2026 HD-EPIC VQA Challenge
por: Chen, Zhiwei, et al.
Publicado: (2026)
por: Chen, Zhiwei, et al.
Publicado: (2026)
OmniEgo-R$^2$: A Routed Reasoning Framework for the 1st Cross-Domain EgoCross Challenge at CVPR 2026
por: Li, Zixu, et al.
Publicado: (2026)
por: Li, Zixu, et al.
Publicado: (2026)
EgoAction: Egocentric Action Composition with Reliability-Aware Temporal Fusion for the EPIC-KITCHENS Action Detection Challenge at CVPR 2026
por: Fu, Zhiheng, et al.
Publicado: (2026)
por: Fu, Zhiheng, et al.
Publicado: (2026)
Fine-grained Textual Inversion Network for Zero-Shot Composed Image Retrieval
por: Lin, Haoqiang, et al.
Publicado: (2025)
por: Lin, Haoqiang, et al.
Publicado: (2025)
Revolutionizing Text-to-Image Retrieval as Autoregressive Token-to-Voken Generation
por: Li, Yongqi, et al.
Publicado: (2024)
por: Li, Yongqi, et al.
Publicado: (2024)
Reasoning in the Dark: Interleaved Vision-Text Reasoning in Latent Space
por: Chen, Chao, et al.
Publicado: (2025)
por: Chen, Chao, et al.
Publicado: (2025)
Scale Up Composed Image Retrieval Learning via Modification Text Generation
por: Zhou, Yinan, et al.
Publicado: (2025)
por: Zhou, Yinan, et al.
Publicado: (2025)
StructAlign: Structured Cross-Modal Alignment for Continual Text-to-Video Retrieval
por: Wang, Shaokun, et al.
Publicado: (2026)
por: Wang, Shaokun, et al.
Publicado: (2026)
A Comprehensive Survey on Composed Image Retrieval
por: Song, Xuemeng, et al.
Publicado: (2025)
por: Song, Xuemeng, et al.
Publicado: (2025)
TIGeR: Unifying Text-to-Image Generation and Retrieval with Large Multimodal Models
por: Qu, Leigang, et al.
Publicado: (2024)
por: Qu, Leigang, et al.
Publicado: (2024)
Zero-shot Composed Text-Image Retrieval
por: Liu, Yikun, et al.
Publicado: (2023)
por: Liu, Yikun, et al.
Publicado: (2023)
Composed Image Retrieval with Text Feedback via Multi-grained Uncertainty Regularization
por: Chen, Yiyang, et al.
Publicado: (2022)
por: Chen, Yiyang, et al.
Publicado: (2022)
Discriminative Probing and Tuning for Text-to-Image Generation
por: Qu, Leigang, et al.
Publicado: (2024)
por: Qu, Leigang, et al.
Publicado: (2024)
Generative Cross-Modal Retrieval: Memorizing Images in Multimodal Language Models for Retrieval and Beyond
por: Li, Yongqi, et al.
Publicado: (2024)
por: Li, Yongqi, et al.
Publicado: (2024)
Open Multimodal Retrieval-Augmented Factual Image Generation
por: Tian, Yang, et al.
Publicado: (2025)
por: Tian, Yang, et al.
Publicado: (2025)
TCMA: Text-Conditioned Multi-granularity Alignment for Drone Cross-Modal Text-Video Retrieval
por: Zhao, Zixu, et al.
Publicado: (2025)
por: Zhao, Zixu, et al.
Publicado: (2025)
Instance-Level Composed Image Retrieval
por: Psomas, Bill, et al.
Publicado: (2025)
por: Psomas, Bill, et al.
Publicado: (2025)
Zero Shot Composed Image Retrieval
por: Kakarla, Santhosh, et al.
Publicado: (2025)
por: Kakarla, Santhosh, et al.
Publicado: (2025)
Composed Image Retrieval for Remote Sensing
por: Psomas, Bill, et al.
Publicado: (2024)
por: Psomas, Bill, et al.
Publicado: (2024)
Imagine and Seek: Improving Composed Image Retrieval with an Imagined Proxy
por: Li, You, et al.
Publicado: (2024)
por: Li, You, et al.
Publicado: (2024)
Image2Sentence based Asymmetrical Zero-shot Composed Image Retrieval
por: Du, Yongchao, et al.
Publicado: (2024)
por: Du, Yongchao, et al.
Publicado: (2024)
CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion
por: Li, Yanyu, et al.
Publicado: (2025)
por: Li, Yanyu, et al.
Publicado: (2025)
Beyond Semantic Search: Towards Referential Anchoring in Composed Image Retrieval
por: Yang, Yuxin, et al.
Publicado: (2026)
por: Yang, Yuxin, et al.
Publicado: (2026)
NCL-CIR: Noise-aware Contrastive Learning for Composed Image Retrieval
por: Gao, Peng, et al.
Publicado: (2025)
por: Gao, Peng, et al.
Publicado: (2025)
Towards Text-Image Interleaved Retrieval
por: Zhang, Xin, et al.
Publicado: (2025)
por: Zhang, Xin, et al.
Publicado: (2025)
Improving Composed Image Retrieval via Contrastive Learning with Scaling Positives and Negatives
por: Feng, Zhangchi, et al.
Publicado: (2024)
por: Feng, Zhangchi, et al.
Publicado: (2024)
A Sanity Check on Composed Image Retrieval
por: Liu, Yikun, et al.
Publicado: (2026)
por: Liu, Yikun, et al.
Publicado: (2026)
ConText-CIR: Learning from Concepts in Text for Composed Image Retrieval
por: Xing, Eric, et al.
Publicado: (2025)
por: Xing, Eric, et al.
Publicado: (2025)
Ejemplares similares
-
FineCIR: Explicit Parsing of Fine-Grained Modification Semantics for Composed Image Retrieval
por: Li, Zixu, et al.
Publicado: (2025) -
OFFSET: Segmentation-based Focus Shift Revision for Composed Image Retrieval
por: Chen, Zhiwei, et al.
Publicado: (2025) -
ConeSep: Cone-based Robust Noise-Unlearning Compositional Network for Composed Image Retrieval
por: Li, Zixu, et al.
Publicado: (2026) -
R^3: Composed Video Retrieval via Reasoning-Guided Recalling and Re-ranking
por: Li, Zixu, et al.
Publicado: (2026) -
MELT: Improve Composed Image Retrieval via the Modification Frequentation-Rarity Balance Network
por: Qiu, Guozhi, et al.
Publicado: (2026)