Reason, Retrieve, Re-rank: A Zero-Shot Reasoning-Aware Framework for Composed Video Retrieval
Fuente:
arXiv
Salvato in:
| Autore principale: | Alavi, Ali |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TLG: Temporal-Logic Grounding for Video Question Answering via Source-Annotation Reconstruction and Category-Targeted Reasoning
di: Alavi, Ali
Pubblicazione: (2026)
di: Alavi, Ali
Pubblicazione: (2026)
R^3: Composed Video Retrieval via Reasoning-Guided Recalling and Re-ranking
di: Li, Zixu, et al.
Pubblicazione: (2026)
di: Li, Zixu, et al.
Pubblicazione: (2026)
FIRE-CIR: Fine-grained Reasoning for Composed Fashion Image Retrieval
di: Gardères, François, et al.
Pubblicazione: (2026)
di: Gardères, François, et al.
Pubblicazione: (2026)
Candidate Set Re-ranking for Composed Image Retrieval with Dual Multi-modal Encoder
di: Liu, Zheyuan, et al.
Pubblicazione: (2023)
di: Liu, Zheyuan, et al.
Pubblicazione: (2023)
Multimodal Reasoning Agent for Zero-Shot Composed Image Retrieval
di: Tu, Rong-Cheng, et al.
Pubblicazione: (2025)
di: Tu, Rong-Cheng, et al.
Pubblicazione: (2025)
Perception First: A Frontier Native-Video Model with Self-Consistency for Implicit Video Question Answering
di: Alavi, Ali
Pubblicazione: (2026)
di: Alavi, Ali
Pubblicazione: (2026)
CoVR-R:Reason-Aware Composed Video Retrieval
di: Thawakar, Omkar, et al.
Pubblicazione: (2026)
di: Thawakar, Omkar, et al.
Pubblicazione: (2026)
Zero Shot Composed Image Retrieval
di: Kakarla, Santhosh, et al.
Pubblicazione: (2025)
di: Kakarla, Santhosh, et al.
Pubblicazione: (2025)
Reason-before-Retrieve: One-Stage Reflective Chain-of-Thoughts for Training-Free Zero-Shot Composed Image Retrieval
di: Tang, Yuanmin, et al.
Pubblicazione: (2024)
di: Tang, Yuanmin, et al.
Pubblicazione: (2024)
G-MIXER: Geodesic Mixup-based Implicit Semantic Expansion and Explicit Semantic Re-ranking for Zero-Shot Composed Image Retrieval
di: Lim, Jiyoung, et al.
Pubblicazione: (2026)
di: Lim, Jiyoung, et al.
Pubblicazione: (2026)
Re-ranking the Context for Multimodal Retrieval Augmented Generation
di: Mortaheb, Matin, et al.
Pubblicazione: (2025)
di: Mortaheb, Matin, et al.
Pubblicazione: (2025)
ConText-CIR: Learning from Concepts in Text for Composed Image Retrieval
di: Xing, Eric, et al.
Pubblicazione: (2025)
di: Xing, Eric, et al.
Pubblicazione: (2025)
GranAlign: Granularity-Aware Alignment Framework for Zero-Shot Video Moment Retrieval
di: Jeon, Mingyu, et al.
Pubblicazione: (2026)
di: Jeon, Mingyu, et al.
Pubblicazione: (2026)
Multimedia-Aware Question Answering: A Review of Retrieval and Cross-Modal Reasoning Architectures
di: Raja, Rahul, et al.
Pubblicazione: (2025)
di: Raja, Rahul, et al.
Pubblicazione: (2025)
Unlocking Zero-Shot Geospatial Reasoning via Indirect Rewards
di: Xu, Chenhui, et al.
Pubblicazione: (2025)
di: Xu, Chenhui, et al.
Pubblicazione: (2025)
Domain-Aware Continual Zero-Shot Learning
di: Yi, Kai, et al.
Pubblicazione: (2021)
di: Yi, Kai, et al.
Pubblicazione: (2021)
CoTMR: Chain-of-Thought Multi-Scale Reasoning for Training-Free Zero-Shot Composed Image Retrieval
di: Sun, Zelong, et al.
Pubblicazione: (2025)
di: Sun, Zelong, et al.
Pubblicazione: (2025)
SAM-Aware Graph Prompt Reasoning Network for Cross-Domain Few-Shot Segmentation
di: Peng, Shi-Feng, et al.
Pubblicazione: (2024)
di: Peng, Shi-Feng, et al.
Pubblicazione: (2024)
ReLaX: Reasoning with Latent Exploration for Large Reasoning Models
di: Zhang, Shimin, et al.
Pubblicazione: (2025)
di: Zhang, Shimin, et al.
Pubblicazione: (2025)
CaReBench: A Fine-Grained Benchmark for Video Captioning and Retrieval
di: Xu, Yifan, et al.
Pubblicazione: (2024)
di: Xu, Yifan, et al.
Pubblicazione: (2024)
Generating a Paracosm for Training-Free Zero-Shot Composed Image Retrieval
di: Wang, Tong, et al.
Pubblicazione: (2026)
di: Wang, Tong, et al.
Pubblicazione: (2026)
HyCIR: Boosting Zero-Shot Composed Image Retrieval with Synthetic Labels
di: Jiang, Yingying, et al.
Pubblicazione: (2024)
di: Jiang, Yingying, et al.
Pubblicazione: (2024)
MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval
di: Park, Jeong-Woo, et al.
Pubblicazione: (2025)
di: Park, Jeong-Woo, et al.
Pubblicazione: (2025)
Beyond Closed-Pool Video Retrieval: A Benchmark and Agent Framework for Real-World Video Search and Moment Localization
di: Yu, Tao, et al.
Pubblicazione: (2026)
di: Yu, Tao, et al.
Pubblicazione: (2026)
Reasoning-Augmented Representations for Multimodal Retrieval
di: Zhang, Jianrui, et al.
Pubblicazione: (2026)
di: Zhang, Jianrui, et al.
Pubblicazione: (2026)
Density-Aware Translation of Spurious Correlations in Zero-Shot VLMs
di: Hasanebrahimi, Afsaneh, et al.
Pubblicazione: (2026)
di: Hasanebrahimi, Afsaneh, et al.
Pubblicazione: (2026)
Cluster-Aware Similarity Diffusion for Instance Retrieval
di: Luo, Jifei, et al.
Pubblicazione: (2024)
di: Luo, Jifei, et al.
Pubblicazione: (2024)
From Mapping to Composing: A Two-Stage Framework for Zero-shot Composed Image Retrieval
di: Wang, Yabing, et al.
Pubblicazione: (2025)
di: Wang, Yabing, et al.
Pubblicazione: (2025)
Re-ranking Reasoning Context with Tree Search Makes Large Vision-Language Models Stronger
di: Yang, Qi, et al.
Pubblicazione: (2025)
di: Yang, Qi, et al.
Pubblicazione: (2025)
Zero-Shot Visual Reasoning by Vision-Language Models: Benchmarking and Analysis
di: Nagar, Aishik, et al.
Pubblicazione: (2024)
di: Nagar, Aishik, et al.
Pubblicazione: (2024)
Fine-Grained Zero-Shot Composed Image Retrieval with Complementary Visual-Semantic Integration
di: Ye, Yongcong, et al.
Pubblicazione: (2026)
di: Ye, Yongcong, et al.
Pubblicazione: (2026)
Generative Editing in the Joint Vision-Language Space for Zero-Shot Composed Image Retrieval
di: Wang, Xin, et al.
Pubblicazione: (2025)
di: Wang, Xin, et al.
Pubblicazione: (2025)
Beyond Training: Dynamic Token Merging for Zero-Shot Video Understanding
di: Zhang, Yiming, et al.
Pubblicazione: (2024)
di: Zhang, Yiming, et al.
Pubblicazione: (2024)
Zero-Shot Vehicle Model Recognition via Text-Based Retrieval-Augmented Generation
di: Chang, Wei-Chia, et al.
Pubblicazione: (2025)
di: Chang, Wei-Chia, et al.
Pubblicazione: (2025)
FilterRAG: Zero-Shot Informed Retrieval-Augmented Generation to Mitigate Hallucinations in VQA
di: Sarwar, Nobin
Pubblicazione: (2025)
di: Sarwar, Nobin
Pubblicazione: (2025)
Detect in Any Scene: An Agentic Framework for Object Detection with Experience-Aware Reasoning
di: Zhang, Wenlun, et al.
Pubblicazione: (2026)
di: Zhang, Wenlun, et al.
Pubblicazione: (2026)
Fine-grained Textual Inversion Network for Zero-Shot Composed Image Retrieval
di: Lin, Haoqiang, et al.
Pubblicazione: (2025)
di: Lin, Haoqiang, et al.
Pubblicazione: (2025)
Zero-shot Composed Text-Image Retrieval
di: Liu, Yikun, et al.
Pubblicazione: (2023)
di: Liu, Yikun, et al.
Pubblicazione: (2023)
Towards Sparse Video Understanding and Reasoning
di: Xu, Chenwei, et al.
Pubblicazione: (2026)
di: Xu, Chenwei, et al.
Pubblicazione: (2026)
MINERVA: Evaluating Complex Video Reasoning
di: Nagrani, Arsha, et al.
Pubblicazione: (2025)
di: Nagrani, Arsha, et al.
Pubblicazione: (2025)
Documenti analoghi
-
TLG: Temporal-Logic Grounding for Video Question Answering via Source-Annotation Reconstruction and Category-Targeted Reasoning
di: Alavi, Ali
Pubblicazione: (2026) -
R^3: Composed Video Retrieval via Reasoning-Guided Recalling and Re-ranking
di: Li, Zixu, et al.
Pubblicazione: (2026) -
FIRE-CIR: Fine-grained Reasoning for Composed Fashion Image Retrieval
di: Gardères, François, et al.
Pubblicazione: (2026) -
Candidate Set Re-ranking for Composed Image Retrieval with Dual Multi-modal Encoder
di: Liu, Zheyuan, et al.
Pubblicazione: (2023) -
Multimodal Reasoning Agent for Zero-Shot Composed Image Retrieval
di: Tu, Rong-Cheng, et al.
Pubblicazione: (2025)