Generative Video Diffusion for Unseen Novel Semantic Video Moment Retrieval
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Luo, Dezhao, Gong, Shaogang, Huang, Jiabo, Jin, Hailin, Liu, Yang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MLLM as Video Narrator: Mitigating Modality Imbalance in Video Moment Retrieval
par: Cai, Weitong, et autres
Publié: (2024)
par: Cai, Weitong, et autres
Publié: (2024)
Hybrid-Learning Video Moment Retrieval across Multi-Domain Labels
par: Cai, Weitong, et autres
Publié: (2024)
par: Cai, Weitong, et autres
Publié: (2024)
InvSeg: Test-Time Prompt Inversion for Semantic Segmentation
par: Lin, Jiayi, et autres
Publié: (2024)
par: Lin, Jiayi, et autres
Publié: (2024)
Neuro-Symbolic Spatial Reasoning in Segmentation
par: Lin, Jiayi, et autres
Publié: (2025)
par: Lin, Jiayi, et autres
Publié: (2025)
Point to Span: Zero-Shot Moment Retrieval for Navigating Unseen Hour-Long Videos
par: Jeon, Mingyu, et autres
Publié: (2025)
par: Jeon, Mingyu, et autres
Publié: (2025)
Grounding Video Reasoning in Physical Signals
par: Osmanli, Alibay, et autres
Publié: (2026)
par: Osmanli, Alibay, et autres
Publié: (2026)
Background-aware Moment Detection for Video Moment Retrieval
par: Jung, Minjoon, et autres
Publié: (2023)
par: Jung, Minjoon, et autres
Publié: (2023)
Few-Shot Image Generation by Conditional Relaxing Diffusion Inversion
par: Cao, Yu, et autres
Publié: (2024)
par: Cao, Yu, et autres
Publié: (2024)
Denoise-then-Retrieve: Text-Conditioned Video Denoising for Video Moment Retrieval
par: Liu, Weijia, et autres
Publié: (2025)
par: Liu, Weijia, et autres
Publié: (2025)
The Role of Video Generation in Enhancing Data-Limited Action Understanding
par: Li, Wei, et autres
Publié: (2025)
par: Li, Wei, et autres
Publié: (2025)
V-STaR: Benchmarking Video-LLMs on Video Spatio-Temporal Reasoning
par: Cheng, Zixu, et autres
Publié: (2025)
par: Cheng, Zixu, et autres
Publié: (2025)
DiffusionVMR: Diffusion Model for Joint Video Moment Retrieval and Highlight Detection
par: Zhao, Henghao, et autres
Publié: (2023)
par: Zhao, Henghao, et autres
Publié: (2023)
Object-Centric Framework for Video Moment Retrieval
par: Li, Zongyao, et autres
Publié: (2025)
par: Li, Zongyao, et autres
Publié: (2025)
Moment of Untruth: Dealing with Negative Queries in Video Moment Retrieval
par: Flanagan, Kevin, et autres
Publié: (2025)
par: Flanagan, Kevin, et autres
Publié: (2025)
Beyond Closed-Pool Video Retrieval: A Benchmark and Agent Framework for Real-World Video Search and Moment Localization
par: Yu, Tao, et autres
Publié: (2026)
par: Yu, Tao, et autres
Publié: (2026)
CoS: Chain-of-Shot Prompting for Long Video Understanding
par: Hu, Jian, et autres
Publié: (2025)
par: Hu, Jian, et autres
Publié: (2025)
ViSMaP: Unsupervised Hour-long Video Summarisation by Meta-Prompting
par: Hu, Jian, et autres
Publié: (2025)
par: Hu, Jian, et autres
Publié: (2025)
LatSearch: Latent Reward-Guided Search for Faster Inference-Time Scaling in Video Diffusion
par: Zhao, Zengqun, et autres
Publié: (2026)
par: Zhao, Zengqun, et autres
Publié: (2026)
OrbitNVS: Harnessing Video Diffusion Priors for Novel View Synthesis
par: Liang, Jinglin, et autres
Publié: (2026)
par: Liang, Jinglin, et autres
Publié: (2026)
Training-free Zero-shot Composed Image Retrieval with Local Concept Reranking
par: Sun, Shitong, et autres
Publié: (2023)
par: Sun, Shitong, et autres
Publié: (2023)
Vid-Morp: Video Moment Retrieval Pretraining from Unlabeled Videos in the Wild
par: Bao, Peijun, et autres
Publié: (2024)
par: Bao, Peijun, et autres
Publié: (2024)
Beyond Caption-Based Queries for Video Moment Retrieval
par: Pujol-Perich, David, et autres
Publié: (2026)
par: Pujol-Perich, David, et autres
Publié: (2026)
Context-Enhanced Video Moment Retrieval with Large Language Models
par: Liu, Weijia, et autres
Publié: (2024)
par: Liu, Weijia, et autres
Publié: (2024)
Towards Efficient Partially Relevant Video Retrieval with Active Moment Discovering
par: Song, Peipei, et autres
Publié: (2025)
par: Song, Peipei, et autres
Publié: (2025)
Generative Neural Video Compression via Video Diffusion Prior
par: Mao, Qi, et autres
Publié: (2025)
par: Mao, Qi, et autres
Publié: (2025)
MS-DETR: Towards Effective Video Moment Retrieval and Highlight Detection by Joint Motion-Semantic Learning
par: Ma, Hongxu, et autres
Publié: (2025)
par: Ma, Hongxu, et autres
Publié: (2025)
Selective Query-guided Debiasing for Video Corpus Moment Retrieval
par: Yoon, Sunjae, et autres
Publié: (2022)
par: Yoon, Sunjae, et autres
Publié: (2022)
VERIFIED: A Video Corpus Moment Retrieval Benchmark for Fine-Grained Video Understanding
par: Chen, Houlun, et autres
Publié: (2024)
par: Chen, Houlun, et autres
Publié: (2024)
GraphThinker: Reinforcing Temporally Grounded Video Reasoning with Event Graph Thinking
par: Cheng, Zixu, et autres
Publié: (2026)
par: Cheng, Zixu, et autres
Publié: (2026)
Event-aware Video Corpus Moment Retrieval
par: Hou, Danyang, et autres
Publié: (2024)
par: Hou, Danyang, et autres
Publié: (2024)
MomentSeeker: A Task-Oriented Benchmark For Long-Video Moment Retrieval
par: Yuan, Huaying, et autres
Publié: (2025)
par: Yuan, Huaying, et autres
Publié: (2025)
Adaptive Evidential Learning for Temporal-Semantic Robustness in Moment Retrieval
par: Huang, Haojian, et autres
Publié: (2025)
par: Huang, Haojian, et autres
Publié: (2025)
Omni-Video 2: Scaling MLLM-Conditioned Diffusion for Unified Video Generation and Editing
par: Yang, Hao, et autres
Publié: (2026)
par: Yang, Hao, et autres
Publié: (2026)
MomentSeg: Moment-Centric Sampling for Enhanced Video Pixel Understanding
par: Dai, Ming, et autres
Publié: (2025)
par: Dai, Ming, et autres
Publié: (2025)
INT: Instance-Specific Negative Mining for Task-Generic Promptable Segmentation
par: Hu, Jian, et autres
Publié: (2025)
par: Hu, Jian, et autres
Publié: (2025)
Temporal Score Analysis for Understanding and Correcting Diffusion Artifacts
par: Cao, Yu, et autres
Publié: (2025)
par: Cao, Yu, et autres
Publié: (2025)
Novel View Extrapolation with Video Diffusion Priors
par: Liu, Kunhao, et autres
Publié: (2024)
par: Liu, Kunhao, et autres
Publié: (2024)
MV-Adapter: Multimodal Video Transfer Learning for Video Text Retrieval
par: Jin, Xiaojie, et autres
Publié: (2023)
par: Jin, Xiaojie, et autres
Publié: (2023)
Not All Inputs Are Valid: Towards Open-Set Video Moment Retrieval Using Language
par: Fang, Xiang, et autres
Publié: (2026)
par: Fang, Xiang, et autres
Publié: (2026)
Turing Patterns for Multimedia: Reaction-Diffusion Multi-Modal Fusion for Language-Guided Video Moment Retrieval
par: Fang, Xiang, et autres
Publié: (2026)
par: Fang, Xiang, et autres
Publié: (2026)
Documents similaires
-
MLLM as Video Narrator: Mitigating Modality Imbalance in Video Moment Retrieval
par: Cai, Weitong, et autres
Publié: (2024) -
Hybrid-Learning Video Moment Retrieval across Multi-Domain Labels
par: Cai, Weitong, et autres
Publié: (2024) -
InvSeg: Test-Time Prompt Inversion for Semantic Segmentation
par: Lin, Jiayi, et autres
Publié: (2024) -
Neuro-Symbolic Spatial Reasoning in Segmentation
par: Lin, Jiayi, et autres
Publié: (2025) -
Point to Span: Zero-Shot Moment Retrieval for Navigating Unseen Hour-Long Videos
par: Jeon, Mingyu, et autres
Publié: (2025)