Hybrid-Learning Video Moment Retrieval across Multi-Domain Labels
Fuente:
arXiv
Guardado en:
| Autores principales: | Cai, Weitong, Huang, Jiabo, Gong, Shaogang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MLLM as Video Narrator: Mitigating Modality Imbalance in Video Moment Retrieval
por: Cai, Weitong, et al.
Publicado: (2024)
por: Cai, Weitong, et al.
Publicado: (2024)
Generative Video Diffusion for Unseen Novel Semantic Video Moment Retrieval
por: Luo, Dezhao, et al.
Publicado: (2024)
por: Luo, Dezhao, et al.
Publicado: (2024)
Neuro-Symbolic Spatial Reasoning in Segmentation
por: Lin, Jiayi, et al.
Publicado: (2025)
por: Lin, Jiayi, et al.
Publicado: (2025)
InvSeg: Test-Time Prompt Inversion for Semantic Segmentation
por: Lin, Jiayi, et al.
Publicado: (2024)
por: Lin, Jiayi, et al.
Publicado: (2024)
Grounding Video Reasoning in Physical Signals
por: Osmanli, Alibay, et al.
Publicado: (2026)
por: Osmanli, Alibay, et al.
Publicado: (2026)
Training-free Zero-shot Composed Image Retrieval with Local Concept Reranking
por: Sun, Shitong, et al.
Publicado: (2023)
por: Sun, Shitong, et al.
Publicado: (2023)
Background-aware Moment Detection for Video Moment Retrieval
por: Jung, Minjoon, et al.
Publicado: (2023)
por: Jung, Minjoon, et al.
Publicado: (2023)
Few-Shot Image Generation by Conditional Relaxing Diffusion Inversion
por: Cao, Yu, et al.
Publicado: (2024)
por: Cao, Yu, et al.
Publicado: (2024)
Moment of Untruth: Dealing with Negative Queries in Video Moment Retrieval
por: Flanagan, Kevin, et al.
Publicado: (2025)
por: Flanagan, Kevin, et al.
Publicado: (2025)
Denoise-then-Retrieve: Text-Conditioned Video Denoising for Video Moment Retrieval
por: Liu, Weijia, et al.
Publicado: (2025)
por: Liu, Weijia, et al.
Publicado: (2025)
ViSMaP: Unsupervised Hour-long Video Summarisation by Meta-Prompting
por: Hu, Jian, et al.
Publicado: (2025)
por: Hu, Jian, et al.
Publicado: (2025)
CoS: Chain-of-Shot Prompting for Long Video Understanding
por: Hu, Jian, et al.
Publicado: (2025)
por: Hu, Jian, et al.
Publicado: (2025)
EgoGraph: Temporal Knowledge Graph for Egocentric Video Understanding
por: Sun, Shitong, et al.
Publicado: (2026)
por: Sun, Shitong, et al.
Publicado: (2026)
Multi-Modal Cross-Domain Alignment Network for Video Moment Retrieval
por: Fang, Xiang, et al.
Publicado: (2022)
por: Fang, Xiang, et al.
Publicado: (2022)
Object-Centric Framework for Video Moment Retrieval
por: Li, Zongyao, et al.
Publicado: (2025)
por: Li, Zongyao, et al.
Publicado: (2025)
V-STaR: Benchmarking Video-LLMs on Video Spatio-Temporal Reasoning
por: Cheng, Zixu, et al.
Publicado: (2025)
por: Cheng, Zixu, et al.
Publicado: (2025)
Adaptive Domain Shift in Diffusion Models for Cross-Modality Image Translation
por: Wang, Zihao, et al.
Publicado: (2026)
por: Wang, Zihao, et al.
Publicado: (2026)
MaRI: Material Retrieval Integration across Domains
por: Wang, Jianhui, et al.
Publicado: (2025)
por: Wang, Jianhui, et al.
Publicado: (2025)
Multi-modal Fusion and Query Refinement Network for Video Moment Retrieval and Highlight Detection
por: Xu, Yifang, et al.
Publicado: (2025)
por: Xu, Yifang, et al.
Publicado: (2025)
Beyond Caption-Based Queries for Video Moment Retrieval
por: Pujol-Perich, David, et al.
Publicado: (2026)
por: Pujol-Perich, David, et al.
Publicado: (2026)
INT: Instance-Specific Negative Mining for Task-Generic Promptable Segmentation
por: Hu, Jian, et al.
Publicado: (2025)
por: Hu, Jian, et al.
Publicado: (2025)
Multi-proposal Collaboration and Multi-task Training for Weakly-supervised Video Moment Retrieval
por: Zhang, Bolin, et al.
Publicado: (2026)
por: Zhang, Bolin, et al.
Publicado: (2026)
Vid-Morp: Video Moment Retrieval Pretraining from Unlabeled Videos in the Wild
por: Bao, Peijun, et al.
Publicado: (2024)
por: Bao, Peijun, et al.
Publicado: (2024)
XFMamba: Cross-Fusion Mamba for Multi-View Medical Image Classification
por: Zheng, Xiaoyu, et al.
Publicado: (2025)
por: Zheng, Xiaoyu, et al.
Publicado: (2025)
Selective Query-guided Debiasing for Video Corpus Moment Retrieval
por: Yoon, Sunjae, et al.
Publicado: (2022)
por: Yoon, Sunjae, et al.
Publicado: (2022)
HybridMamba: A Dual-domain Mamba for 3D Medical Image Segmentation
por: Wu, Weitong, et al.
Publicado: (2025)
por: Wu, Weitong, et al.
Publicado: (2025)
Source-free Video Domain Adaptation by Learning from Noisy Labels
por: Dasgupta, Avijit, et al.
Publicado: (2023)
por: Dasgupta, Avijit, et al.
Publicado: (2023)
Towards Efficient Partially Relevant Video Retrieval with Active Moment Discovering
por: Song, Peipei, et al.
Publicado: (2025)
por: Song, Peipei, et al.
Publicado: (2025)
Adaptive Evidential Learning for Temporal-Semantic Robustness in Moment Retrieval
por: Huang, Haojian, et al.
Publicado: (2025)
por: Huang, Haojian, et al.
Publicado: (2025)
Text-Video Multi-Grained Integration for Video Moment Montage
por: Yin, Zhihui, et al.
Publicado: (2024)
por: Yin, Zhihui, et al.
Publicado: (2024)
Event-aware Video Corpus Moment Retrieval
por: Hou, Danyang, et al.
Publicado: (2024)
por: Hou, Danyang, et al.
Publicado: (2024)
GIRL-DETR: Gradient-Isolated Reinforcement Learning for Video Moment Retrieval
por: Zhang, Shihang, et al.
Publicado: (2026)
por: Zhang, Shihang, et al.
Publicado: (2026)
MomentSeeker: A Task-Oriented Benchmark For Long-Video Moment Retrieval
por: Yuan, Huaying, et al.
Publicado: (2025)
por: Yuan, Huaying, et al.
Publicado: (2025)
MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning
por: Ma, Hongxu, et al.
Publicado: (2025)
por: Ma, Hongxu, et al.
Publicado: (2025)
Context-Enhanced Video Moment Retrieval with Large Language Models
por: Liu, Weijia, et al.
Publicado: (2024)
por: Liu, Weijia, et al.
Publicado: (2024)
Leveraging Hallucinations to Reduce Manual Prompt Dependency in Promptable Segmentation
por: Hu, Jian, et al.
Publicado: (2024)
por: Hu, Jian, et al.
Publicado: (2024)
Enhancing Zero-Shot Facial Expression Recognition by LLM Knowledge Transfer
por: Zhao, Zengqun, et al.
Publicado: (2024)
por: Zhao, Zengqun, et al.
Publicado: (2024)
GraphThinker: Reinforcing Temporally Grounded Video Reasoning with Event Graph Thinking
por: Cheng, Zixu, et al.
Publicado: (2026)
por: Cheng, Zixu, et al.
Publicado: (2026)
Temporal Score Analysis for Understanding and Correcting Diffusion Artifacts
por: Cao, Yu, et al.
Publicado: (2025)
por: Cao, Yu, et al.
Publicado: (2025)
LLaVA-MR: Large Language-and-Vision Assistant for Video Moment Retrieval
por: Lu, Weiheng, et al.
Publicado: (2024)
por: Lu, Weiheng, et al.
Publicado: (2024)
Ejemplares similares
-
MLLM as Video Narrator: Mitigating Modality Imbalance in Video Moment Retrieval
por: Cai, Weitong, et al.
Publicado: (2024) -
Generative Video Diffusion for Unseen Novel Semantic Video Moment Retrieval
por: Luo, Dezhao, et al.
Publicado: (2024) -
Neuro-Symbolic Spatial Reasoning in Segmentation
por: Lin, Jiayi, et al.
Publicado: (2025) -
InvSeg: Test-Time Prompt Inversion for Semantic Segmentation
por: Lin, Jiayi, et al.
Publicado: (2024) -
Grounding Video Reasoning in Physical Signals
por: Osmanli, Alibay, et al.
Publicado: (2026)