WISER: Wider Search, Deeper Thinking, and Adaptive Fusion for Training-Free Zero-Shot Composed Image Retrieval
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Tianyue, Qu, Leigang, Yang, Tianyu, Hao, Xiangzhao, Xu, Yifan, Guo, Haiyun, Wang, Jinqiao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ReCALL: Recalibrating Capability Degradation for MLLM-based Composed Image Retrieval
por: Yang, Tianyu, et al.
Publicado: (2026)
por: Yang, Tianyu, et al.
Publicado: (2026)
TRACE: Task-Adaptive Reasoning and Representation Learning for Universal Multimodal Retrieval
por: Hao, Xiangzhao, et al.
Publicado: (2026)
por: Hao, Xiangzhao, et al.
Publicado: (2026)
UniFGVC: Universal Training-Free Few-Shot Fine-Grained Vision Classification via Attribute-Aware Multimodal Retrieval
por: Guo, Hongyu, et al.
Publicado: (2025)
por: Guo, Hongyu, et al.
Publicado: (2025)
Generating a Paracosm for Training-Free Zero-Shot Composed Image Retrieval
por: Wang, Tong, et al.
Publicado: (2026)
por: Wang, Tong, et al.
Publicado: (2026)
Referring Expression Instance Retrieval and A Strong End-to-End Baseline
por: Hao, Xiangzhao, et al.
Publicado: (2025)
por: Hao, Xiangzhao, et al.
Publicado: (2025)
STiTch: Semantic Transition and Transportation in Collaboration for Training-Free Zero-Shot Composed Image Retrieval
por: Li, Miaoge, et al.
Publicado: (2026)
por: Li, Miaoge, et al.
Publicado: (2026)
Zero Shot Composed Image Retrieval
por: Kakarla, Santhosh, et al.
Publicado: (2025)
por: Kakarla, Santhosh, et al.
Publicado: (2025)
SDR-CIR: Semantic Debias Retrieval Framework for Training-Free Zero-Shot Composed Image Retrieval
por: Sun, Yi, et al.
Publicado: (2026)
por: Sun, Yi, et al.
Publicado: (2026)
HyCIR: Boosting Zero-Shot Composed Image Retrieval with Synthetic Labels
por: Jiang, Yingying, et al.
Publicado: (2024)
por: Jiang, Yingying, et al.
Publicado: (2024)
Composed Image Retrieval with Text Feedback via Multi-grained Uncertainty Regularization
por: Chen, Yiyang, et al.
Publicado: (2022)
por: Chen, Yiyang, et al.
Publicado: (2022)
FreeCompose: Generic Zero-Shot Image Composition with Diffusion Prior
por: Chen, Zhekai, et al.
Publicado: (2024)
por: Chen, Zhekai, et al.
Publicado: (2024)
Wider or Deeper? Scaling LLM Inference-Time Compute with Adaptive Branching Tree Search
por: Inoue, Yuichi, et al.
Publicado: (2025)
por: Inoue, Yuichi, et al.
Publicado: (2025)
PLUME: Latent Reasoning Based Universal Multimodal Embedding
por: He, Chenwei, et al.
Publicado: (2026)
por: He, Chenwei, et al.
Publicado: (2026)
Reason-before-Retrieve: One-Stage Reflective Chain-of-Thoughts for Training-Free Zero-Shot Composed Image Retrieval
por: Tang, Yuanmin, et al.
Publicado: (2024)
por: Tang, Yuanmin, et al.
Publicado: (2024)
Multimodal Reasoning Agent for Zero-Shot Composed Image Retrieval
por: Tu, Rong-Cheng, et al.
Publicado: (2025)
por: Tu, Rong-Cheng, et al.
Publicado: (2025)
CoTMR: Chain-of-Thought Multi-Scale Reasoning for Training-Free Zero-Shot Composed Image Retrieval
por: Sun, Zelong, et al.
Publicado: (2025)
por: Sun, Zelong, et al.
Publicado: (2025)
SQUARE: Semantic Query-Augmented Fusion and Efficient Batch Reranking for Training-free Zero-Shot Composed Image Retrieval
por: Wu, Ren-Di, et al.
Publicado: (2025)
por: Wu, Ren-Di, et al.
Publicado: (2025)
MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval
por: Park, Jeong-Woo, et al.
Publicado: (2025)
por: Park, Jeong-Woo, et al.
Publicado: (2025)
Fast Think-on-Graph: Wider, Deeper and Faster Reasoning of Large Language Model on Knowledge Graph
por: Liang, Xujian, et al.
Publicado: (2025)
por: Liang, Xujian, et al.
Publicado: (2025)
Watch Wider and Think Deeper: Collaborative Cross-modal Chain-of-Thought for Complex Visual Reasoning
por: Lu, Wenting, et al.
Publicado: (2026)
por: Lu, Wenting, et al.
Publicado: (2026)
Training-free Zero-shot Composed Image Retrieval via Weighted Modality Fusion and Similarity
por: Wu, Ren-Di, et al.
Publicado: (2024)
por: Wu, Ren-Di, et al.
Publicado: (2024)
Generative Editing in the Joint Vision-Language Space for Zero-Shot Composed Image Retrieval
por: Wang, Xin, et al.
Publicado: (2025)
por: Wang, Xin, et al.
Publicado: (2025)
From Mapping to Composing: A Two-Stage Framework for Zero-shot Composed Image Retrieval
por: Wang, Yabing, et al.
Publicado: (2025)
por: Wang, Yabing, et al.
Publicado: (2025)
ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving
por: Sha, Lin, et al.
Publicado: (2026)
por: Sha, Lin, et al.
Publicado: (2026)
Composed Image Retrieval for Training-Free Domain Conversion
por: Efthymiadis, Nikos, et al.
Publicado: (2024)
por: Efthymiadis, Nikos, et al.
Publicado: (2024)
The Depth Delusion: Why Transformers Should Be Wider, Not Deeper
por: Fahim, Md Muhtasim Munif, et al.
Publicado: (2026)
por: Fahim, Md Muhtasim Munif, et al.
Publicado: (2026)
Optimize Wider, Not Deeper: Consensus Aggregation for Policy Optimization
por: Su, Zelal, et al.
Publicado: (2026)
por: Su, Zelal, et al.
Publicado: (2026)
Zero-shot Composed Text-Image Retrieval
por: Liu, Yikun, et al.
Publicado: (2023)
por: Liu, Yikun, et al.
Publicado: (2023)
DAFM: Dynamic Adaptive Fusion for Multi-Model Collaboration in Composed Image Retrieval
por: Cai, Yawei, et al.
Publicado: (2025)
por: Cai, Yawei, et al.
Publicado: (2025)
Scaling Prompt Instructed Zero Shot Composed Image Retrieval with Image-Only Data
por: Duan, Yiqun, et al.
Publicado: (2025)
por: Duan, Yiqun, et al.
Publicado: (2025)
Decoupling Endpoint and Semantic Transition Learning for Zero-Shot Composed Image Retrieval
por: Liu, Mingyu, et al.
Publicado: (2026)
por: Liu, Mingyu, et al.
Publicado: (2026)
iSEARLE: Improving Textual Inversion for Zero-Shot Composed Image Retrieval
por: Agnolucci, Lorenzo, et al.
Publicado: (2024)
por: Agnolucci, Lorenzo, et al.
Publicado: (2024)
Fine-grained Textual Inversion Network for Zero-Shot Composed Image Retrieval
por: Lin, Haoqiang, et al.
Publicado: (2025)
por: Lin, Haoqiang, et al.
Publicado: (2025)
MLLM-Guided VLM Fine-Tuning with Joint Inference for Zero-Shot Composed Image Retrieval
por: Tu, Rong-Cheng, et al.
Publicado: (2025)
por: Tu, Rong-Cheng, et al.
Publicado: (2025)
Deeper and Wider Networks for Performance Metrics Prediction in Communication Networks
por: Liu, Aijia, et al.
Publicado: (2023)
por: Liu, Aijia, et al.
Publicado: (2023)
Language-only Efficient Training of Zero-shot Composed Image Retrieval
por: Gu, Geonmo, et al.
Publicado: (2023)
por: Gu, Geonmo, et al.
Publicado: (2023)
A Fast-cadenced Search for Gamma-Ray Burst Orphan Afterglows with the Deeper, Wider, Faster Programme
por: Freeburn, James, et al.
Publicado: (2024)
por: Freeburn, James, et al.
Publicado: (2024)
Fine-Grained Zero-Shot Composed Image Retrieval with Complementary Visual-Semantic Integration
por: Ye, Yongcong, et al.
Publicado: (2026)
por: Ye, Yongcong, et al.
Publicado: (2026)
Generative Cross-Modal Retrieval: Memorizing Images in Multimodal Language Models for Retrieval and Beyond
por: Li, Yongqi, et al.
Publicado: (2024)
por: Li, Yongqi, et al.
Publicado: (2024)
The Deeper, Wider, Faster programme's first DECam optical data release
por: Freeburn, James, et al.
Publicado: (2026)
por: Freeburn, James, et al.
Publicado: (2026)
Ejemplares similares
-
ReCALL: Recalibrating Capability Degradation for MLLM-based Composed Image Retrieval
por: Yang, Tianyu, et al.
Publicado: (2026) -
TRACE: Task-Adaptive Reasoning and Representation Learning for Universal Multimodal Retrieval
por: Hao, Xiangzhao, et al.
Publicado: (2026) -
UniFGVC: Universal Training-Free Few-Shot Fine-Grained Vision Classification via Attribute-Aware Multimodal Retrieval
por: Guo, Hongyu, et al.
Publicado: (2025) -
Generating a Paracosm for Training-Free Zero-Shot Composed Image Retrieval
por: Wang, Tong, et al.
Publicado: (2026) -
Referring Expression Instance Retrieval and A Strong End-to-End Baseline
por: Hao, Xiangzhao, et al.
Publicado: (2025)