GMMFormer v2: An Uncertainty-aware Framework for Partially Relevant Video Retrieval
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Yuting, Wang, Jinpeng, Chen, Bin, Dai, Tao, Luo, Ruisheng, Xia, Shu-Tao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
GMMFormer: Gaussian-Mixture-Model Based Transformer for Efficient Partially Relevant Video Retrieval
por: Wang, Yuting, et al.
Publicado: (2023)
por: Wang, Yuting, et al.
Publicado: (2023)
Revisiting Uncertainty: On Evidential Learning for Partially Relevant Video Retrieval
por: Li, Jun, et al.
Publicado: (2026)
por: Li, Jun, et al.
Publicado: (2026)
Imagine Before Concentration: Diffusion-Guided Registers Enhance Partially Relevant Video Retrieval
por: Li, Jun, et al.
Publicado: (2026)
por: Li, Jun, et al.
Publicado: (2026)
HLFormer: Enhancing Partially Relevant Video Retrieval with Hyperbolic Learning
por: Li, Jun, et al.
Publicado: (2025)
por: Li, Jun, et al.
Publicado: (2025)
Heterogeneous Uncertainty-Guided Composed Image Retrieval with Fine-Grained Probabilistic Learning
por: Tang, Haomiao, et al.
Publicado: (2026)
por: Tang, Haomiao, et al.
Publicado: (2026)
Pre-training Point Cloud Compact Model with Partial-aware Reconstruction
por: Zha, Yaohua, et al.
Publicado: (2024)
por: Zha, Yaohua, et al.
Publicado: (2024)
AutoSSVH: Exploring Automated Frame Sampling for Efficient Self-Supervised Video Hashing
por: Lian, Niu, et al.
Publicado: (2025)
por: Lian, Niu, et al.
Publicado: (2025)
PHPQ: Pyramid Hybrid Pooling Quantization for Efficient Fine-Grained Image Retrieval
por: Zeng, Ziyun, et al.
Publicado: (2021)
por: Zeng, Ziyun, et al.
Publicado: (2021)
Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning
por: Wang, Jinpeng, et al.
Publicado: (2025)
por: Wang, Jinpeng, et al.
Publicado: (2025)
BoostAdapter: Improving Vision-Language Test-Time Adaptation via Regional Bootstrapping
por: Zhang, Taolin, et al.
Publicado: (2024)
por: Zhang, Taolin, et al.
Publicado: (2024)
PRVR: Partially Relevant Video Retrieval
por: Chen, Xianke, et al.
Publicado: (2022)
por: Chen, Xianke, et al.
Publicado: (2022)
Efficient Self-Supervised Video Hashing with Selective State Spaces
por: Wang, Jinpeng, et al.
Publicado: (2024)
por: Wang, Jinpeng, et al.
Publicado: (2024)
Towards Efficient Partially Relevant Video Retrieval with Active Moment Discovering
por: Song, Peipei, et al.
Publicado: (2025)
por: Song, Peipei, et al.
Publicado: (2025)
Enhanced Partially Relevant Video Retrieval through Inter- and Intra-Sample Analysis with Coherence Prediction
por: Ren, Junlong, et al.
Publicado: (2025)
por: Ren, Junlong, et al.
Publicado: (2025)
Weakly Supervised Deep Hyperspherical Quantization for Image Retrieval
por: Wang, Jinpeng, et al.
Publicado: (2024)
por: Wang, Jinpeng, et al.
Publicado: (2024)
Dual Learning with Dynamic Knowledge Distillation and Soft Alignment for Partially Relevant Video Retrieval
por: Dong, Jianfeng, et al.
Publicado: (2025)
por: Dong, Jianfeng, et al.
Publicado: (2025)
From Verbatim to Gist: Distilling Pyramidal Multimodal Memory via Semantic Information Bottleneck for Long-Horizon Video Agents
por: Lian, Niu, et al.
Publicado: (2026)
por: Lian, Niu, et al.
Publicado: (2026)
Love Me, Love My Label: Rethinking the Role of Labels in Prompt Retrieval for Visual In-Context Learning
por: Luo, Tianci, et al.
Publicado: (2026)
por: Luo, Tianci, et al.
Publicado: (2026)
RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization
por: Huang, Wen, et al.
Publicado: (2025)
por: Huang, Wen, et al.
Publicado: (2025)
PMA: Towards Parameter-Efficient Point Cloud Understanding via Point Mamba Adapter
por: Zha, Yaohua, et al.
Publicado: (2025)
por: Zha, Yaohua, et al.
Publicado: (2025)
MamFusion: Multi-Mamba with Temporal Fusion for Partially Relevant Video Retrieval
por: Ying, Xinru, et al.
Publicado: (2025)
por: Ying, Xinru, et al.
Publicado: (2025)
Boundary-aware Decoupled Flow Networks for Realistic Extreme Rescaling
por: Li, Jinmin, et al.
Publicado: (2024)
por: Li, Jinmin, et al.
Publicado: (2024)
Uneven Event Modeling for Partially Relevant Video Retrieval
por: Zhu, Sa, et al.
Publicado: (2025)
por: Zhu, Sa, et al.
Publicado: (2025)
Enhancing Partially Relevant Video Retrieval with Robust Alignment Learning
por: Zhang, Long, et al.
Publicado: (2025)
por: Zhang, Long, et al.
Publicado: (2025)
Towards Efficient Low-rate Image Compression with Frequency-aware Diffusion Prior Refinement
por: Xia, Yichong, et al.
Publicado: (2026)
por: Xia, Yichong, et al.
Publicado: (2026)
Mitigating Semantic Collapse in Partially Relevant Video Retrieval
por: Moon, WonJun, et al.
Publicado: (2025)
por: Moon, WonJun, et al.
Publicado: (2025)
ReFIR: Grounding Large Restoration Models with Retrieval Augmentation
por: Guo, Hang, et al.
Publicado: (2024)
por: Guo, Hang, et al.
Publicado: (2024)
Point Cloud Mixture-of-Domain-Experts Model for 3D Self-supervised Learning
por: Zha, Yaohua, et al.
Publicado: (2024)
por: Zha, Yaohua, et al.
Publicado: (2024)
Knowledge-Refined Dual Context-Aware Network for Partially Relevant Video Retrieval
por: Yang, Junkai, et al.
Publicado: (2026)
por: Yang, Junkai, et al.
Publicado: (2026)
Improving Video Corpus Moment Retrieval with Partial Relevance Enhancement
por: Hou, Danyang, et al.
Publicado: (2024)
por: Hou, Danyang, et al.
Publicado: (2024)
CLIP-Guided Generative Networks for Transferable Targeted Adversarial Attacks
por: Fang, Hao, et al.
Publicado: (2024)
por: Fang, Hao, et al.
Publicado: (2024)
Ambiguity-Restrained Text-Video Representation Learning for Partially Relevant Video Retrieval
por: Cho, CH, et al.
Publicado: (2025)
por: Cho, CH, et al.
Publicado: (2025)
Invertible Residual Rescaling Models
por: Li, Jinmin, et al.
Publicado: (2024)
por: Li, Jinmin, et al.
Publicado: (2024)
PromptHub: Enhancing Multi-Prompt Visual In-Context Learning with Locality-Aware Fusion, Concentration and Alignment
por: Luo, Tianci, et al.
Publicado: (2026)
por: Luo, Tianci, et al.
Publicado: (2026)
ProPy: Building Interactive Prompt Pyramids upon CLIP for Partially Relevant Video Retrieval
por: Pan, Yi, et al.
Publicado: (2025)
por: Pan, Yi, et al.
Publicado: (2025)
Prototypes are Balanced Units for Efficient and Effective Partially Relevant Video Retrieval
por: Moon, WonJun, et al.
Publicado: (2025)
por: Moon, WonJun, et al.
Publicado: (2025)
Vision-Language Models Learn Super Images for Efficient Partially Relevant Video Retrieval
por: Nishimura, Taichi, et al.
Publicado: (2023)
por: Nishimura, Taichi, et al.
Publicado: (2023)
Explicit Uncertainty Modeling for Active CLIP Adaptation with Dual Prompt Tuning
por: Wang, Qian-Wei, et al.
Publicado: (2026)
por: Wang, Qian-Wei, et al.
Publicado: (2026)
Bridging Weakly-Supervised Learning and VLM Distillation: Noisy Partial Label Learning for Efficient Downstream Adaptation
por: Wang, Qian-Wei, et al.
Publicado: (2025)
por: Wang, Qian-Wei, et al.
Publicado: (2025)
Retrievals Can Be Detrimental: Unveiling the Backdoor Vulnerability of Retrieval-Augmented Diffusion Models
por: Fang, Hao, et al.
Publicado: (2025)
por: Fang, Hao, et al.
Publicado: (2025)
Ejemplares similares
-
GMMFormer: Gaussian-Mixture-Model Based Transformer for Efficient Partially Relevant Video Retrieval
por: Wang, Yuting, et al.
Publicado: (2023) -
Revisiting Uncertainty: On Evidential Learning for Partially Relevant Video Retrieval
por: Li, Jun, et al.
Publicado: (2026) -
Imagine Before Concentration: Diffusion-Guided Registers Enhance Partially Relevant Video Retrieval
por: Li, Jun, et al.
Publicado: (2026) -
HLFormer: Enhancing Partially Relevant Video Retrieval with Hyperbolic Learning
por: Li, Jun, et al.
Publicado: (2025) -
Heterogeneous Uncertainty-Guided Composed Image Retrieval with Fine-Grained Probabilistic Learning
por: Tang, Haomiao, et al.
Publicado: (2026)