ProPy: Building Interactive Prompt Pyramids upon CLIP for Partially Relevant Video Retrieval
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pan, Yi, Zhang, Yujia, Kampffmeyer, Michael, Zhao, Xiaoguang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Revisiting Relevance Feedback for CLIP-based Interactive Image Retrieval
par: Nara, Ryoya, et autres
Publié: (2024)
par: Nara, Ryoya, et autres
Publié: (2024)
PRVR: Partially Relevant Video Retrieval
par: Chen, Xianke, et autres
Publié: (2022)
par: Chen, Xianke, et autres
Publié: (2022)
Uneven Event Modeling for Partially Relevant Video Retrieval
par: Zhu, Sa, et autres
Publié: (2025)
par: Zhu, Sa, et autres
Publié: (2025)
Towards Efficient Partially Relevant Video Retrieval with Active Moment Discovering
par: Song, Peipei, et autres
Publié: (2025)
par: Song, Peipei, et autres
Publié: (2025)
Enhancing Partially Relevant Video Retrieval with Robust Alignment Learning
par: Zhang, Long, et autres
Publié: (2025)
par: Zhang, Long, et autres
Publié: (2025)
Mitigating Semantic Collapse in Partially Relevant Video Retrieval
par: Moon, WonJun, et autres
Publié: (2025)
par: Moon, WonJun, et autres
Publié: (2025)
GMMFormer v2: An Uncertainty-aware Framework for Partially Relevant Video Retrieval
par: Wang, Yuting, et autres
Publié: (2024)
par: Wang, Yuting, et autres
Publié: (2024)
MamFusion: Multi-Mamba with Temporal Fusion for Partially Relevant Video Retrieval
par: Ying, Xinru, et autres
Publié: (2025)
par: Ying, Xinru, et autres
Publié: (2025)
Enhanced Partially Relevant Video Retrieval through Inter- and Intra-Sample Analysis with Coherence Prediction
par: Ren, Junlong, et autres
Publié: (2025)
par: Ren, Junlong, et autres
Publié: (2025)
VTD-CLIP: Video-to-Text Discretization via Prompting CLIP
par: Zhu, Wencheng, et autres
Publié: (2025)
par: Zhu, Wencheng, et autres
Publié: (2025)
Improving Video Corpus Moment Retrieval with Partial Relevance Enhancement
par: Hou, Danyang, et autres
Publié: (2024)
par: Hou, Danyang, et autres
Publié: (2024)
Dual Learning with Dynamic Knowledge Distillation and Soft Alignment for Partially Relevant Video Retrieval
par: Dong, Jianfeng, et autres
Publié: (2025)
par: Dong, Jianfeng, et autres
Publié: (2025)
HLFormer: Enhancing Partially Relevant Video Retrieval with Hyperbolic Learning
par: Li, Jun, et autres
Publié: (2025)
par: Li, Jun, et autres
Publié: (2025)
Ambiguity-Restrained Text-Video Representation Learning for Partially Relevant Video Retrieval
par: Cho, CH, et autres
Publié: (2025)
par: Cho, CH, et autres
Publié: (2025)
Prototypes are Balanced Units for Efficient and Effective Partially Relevant Video Retrieval
par: Moon, WonJun, et autres
Publié: (2025)
par: Moon, WonJun, et autres
Publié: (2025)
Vision-Language Models Learn Super Images for Efficient Partially Relevant Video Retrieval
par: Nishimura, Taichi, et autres
Publié: (2023)
par: Nishimura, Taichi, et autres
Publié: (2023)
Knowledge-Refined Dual Context-Aware Network for Partially Relevant Video Retrieval
par: Yang, Junkai, et autres
Publié: (2026)
par: Yang, Junkai, et autres
Publié: (2026)
Multi-Granularity and Multi-modal Feature Interaction Approach for Text Video Retrieval
par: Li, Wenjun, et autres
Publié: (2024)
par: Li, Wenjun, et autres
Publié: (2024)
Revisiting Uncertainty: On Evidential Learning for Partially Relevant Video Retrieval
par: Li, Jun, et autres
Publié: (2026)
par: Li, Jun, et autres
Publié: (2026)
MINT: Memory-Infused Prompt Tuning at Test-time for CLIP
par: Yi, Jiaming, et autres
Publié: (2025)
par: Yi, Jiaming, et autres
Publié: (2025)
ProMamba: Prompt-Mamba for polyp segmentation
par: Xie, Jianhao, et autres
Publié: (2024)
par: Xie, Jianhao, et autres
Publié: (2024)
PyramidalWan: On Making Pretrained Video Model Pyramidal for Efficient Inference
par: Korzhenkov, Denis, et autres
Publié: (2026)
par: Korzhenkov, Denis, et autres
Publié: (2026)
PyFi: Toward Pyramid-like Financial Image Understanding for VLMs via Adversarial Agents
par: Zhang, Yuqun, et autres
Publié: (2025)
par: Zhang, Yuqun, et autres
Publié: (2025)
ProS: Prompting-to-simulate Generalized knowledge for Universal Cross-Domain Retrieval
par: Fang, Kaipeng, et autres
Publié: (2023)
par: Fang, Kaipeng, et autres
Publié: (2023)
Prompt Tuning for CLIP on the Pretrained Manifold
par: Yang, Xi, et autres
Publié: (2026)
par: Yang, Xi, et autres
Publié: (2026)
PyGS: Large-scale Scene Representation with Pyramidal 3D Gaussian Splatting
par: Wang, Zipeng, et autres
Publié: (2024)
par: Wang, Zipeng, et autres
Publié: (2024)
Imagine Before Concentration: Diffusion-Guided Registers Enhance Partially Relevant Video Retrieval
par: Li, Jun, et autres
Publié: (2026)
par: Li, Jun, et autres
Publié: (2026)
Pyramid Forcing: Head-Aware Pyramid KV Cache Policy for High-Quality Long Video Generation
par: Chen, Jiayu, et autres
Publié: (2026)
par: Chen, Jiayu, et autres
Publié: (2026)
Building Vision Models upon Heat Conduction
par: Wang, Zhaozhi, et autres
Publié: (2024)
par: Wang, Zhaozhi, et autres
Publié: (2024)
ProTA: Probabilistic Token Aggregation for Text-Video Retrieval
par: Fang, Han, et autres
Publié: (2024)
par: Fang, Han, et autres
Publié: (2024)
DGL: Dynamic Global-Local Prompt Tuning for Text-Video Retrieval
par: Yang, Xiangpeng, et autres
Publié: (2024)
par: Yang, Xiangpeng, et autres
Publié: (2024)
AD-CLIP: Adapting Domains in Prompt Space Using CLIP
par: Singha, Mainak, et autres
Publié: (2023)
par: Singha, Mainak, et autres
Publié: (2023)
Focus, Distinguish, and Prompt: Unleashing CLIP for Efficient and Flexible Scene Text Retrieval
par: Zeng, Gangyan, et autres
Publié: (2024)
par: Zeng, Gangyan, et autres
Publié: (2024)
GA2-CLIP: Generic Attribute Anchor for Efficient Prompt Tuningin Video-Language Models
par: Wang, Bin, et autres
Publié: (2025)
par: Wang, Bin, et autres
Publié: (2025)
Mammo-CLIP Dissect: A Framework for Analysing Mammography Concepts in Vision-Language Models
par: Salahuddin, Suaiba Amina, et autres
Publié: (2025)
par: Salahuddin, Suaiba Amina, et autres
Publié: (2025)
Low-rank Prompt Interaction for Continual Vision-Language Retrieval
par: Yan, Weicai, et autres
Publié: (2025)
par: Yan, Weicai, et autres
Publié: (2025)
VidProM: A Million-scale Real Prompt-Gallery Dataset for Text-to-Video Diffusion Models
par: Wang, Wenhao, et autres
Publié: (2024)
par: Wang, Wenhao, et autres
Publié: (2024)
AdaCLIP: Adapting CLIP with Hybrid Learnable Prompts for Zero-Shot Anomaly Detection
par: Cao, Yunkang, et autres
Publié: (2024)
par: Cao, Yunkang, et autres
Publié: (2024)
Long-CLIP: Unlocking the Long-Text Capability of CLIP
par: Zhang, Beichen, et autres
Publié: (2024)
par: Zhang, Beichen, et autres
Publié: (2024)
AttriPrompt: Dynamic Prompt Composition Learning for CLIP
par: Zhan, Qiqi, et autres
Publié: (2025)
par: Zhan, Qiqi, et autres
Publié: (2025)
Documents similaires
-
Revisiting Relevance Feedback for CLIP-based Interactive Image Retrieval
par: Nara, Ryoya, et autres
Publié: (2024) -
PRVR: Partially Relevant Video Retrieval
par: Chen, Xianke, et autres
Publié: (2022) -
Uneven Event Modeling for Partially Relevant Video Retrieval
par: Zhu, Sa, et autres
Publié: (2025) -
Towards Efficient Partially Relevant Video Retrieval with Active Moment Discovering
par: Song, Peipei, et autres
Publié: (2025) -
Enhancing Partially Relevant Video Retrieval with Robust Alignment Learning
par: Zhang, Long, et autres
Publié: (2025)