Uneven Event Modeling for Partially Relevant Video Retrieval
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhu, Sa, Chen, Huashan, Zhang, Wanqian, Zhang, Jinchao, Yang, Zexian, Hao, Xiaoshuai, Li, Bo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Mitigating Semantic Collapse in Partially Relevant Video Retrieval
por: Moon, WonJun, et al.
Publicado: (2025)
por: Moon, WonJun, et al.
Publicado: (2025)
Knowledge-Refined Dual Context-Aware Network for Partially Relevant Video Retrieval
por: Yang, Junkai, et al.
Publicado: (2026)
por: Yang, Junkai, et al.
Publicado: (2026)
Ambiguity-Restrained Text-Video Representation Learning for Partially Relevant Video Retrieval
por: Cho, CH, et al.
Publicado: (2025)
por: Cho, CH, et al.
Publicado: (2025)
Prototypes are Balanced Units for Efficient and Effective Partially Relevant Video Retrieval
por: Moon, WonJun, et al.
Publicado: (2025)
por: Moon, WonJun, et al.
Publicado: (2025)
GMMFormer: Gaussian-Mixture-Model Based Transformer for Efficient Partially Relevant Video Retrieval
por: Wang, Yuting, et al.
Publicado: (2023)
por: Wang, Yuting, et al.
Publicado: (2023)
Denoise and Align: Diffusion-Driven Foreground Knowledge Prompting for Open-Vocabulary Temporal Action Detection
por: Zhu, Sa, et al.
Publicado: (2026)
por: Zhu, Sa, et al.
Publicado: (2026)
Decompose and Transfer: CoT-Prompting Enhanced Alignment for Open-Vocabulary Temporal Action Detection
por: Zhu, Sa, et al.
Publicado: (2026)
por: Zhu, Sa, et al.
Publicado: (2026)
ILDiff: Generate Transparent Animated Stickers by Implicit Layout Distillation
por: Zhang, Ting, et al.
Publicado: (2024)
por: Zhang, Ting, et al.
Publicado: (2024)
Moment-Video: Diagnosing Temporal Fidelity of Video MLLMs on Momentary Visual Events
por: Liu, Xiaolin, et al.
Publicado: (2026)
por: Liu, Xiaolin, et al.
Publicado: (2026)
Scaling the Long Video Understanding of Multimodal Large Language Models via Visual Memory Mechanism
por: Chen, Tao, et al.
Publicado: (2026)
por: Chen, Tao, et al.
Publicado: (2026)
Event-VStream: Event-Driven Real-Time Understanding for Long Video Streams
por: Guo, Zhenghui, et al.
Publicado: (2026)
por: Guo, Zhenghui, et al.
Publicado: (2026)
Uneven Evolution of Cognition Across Generations of Generative AI Models
por: Galatzer-Levy, Isaac, et al.
Publicado: (2026)
por: Galatzer-Levy, Isaac, et al.
Publicado: (2026)
VERHallu: Evaluating and Mitigating Event Relation Hallucination in Video Large Language Models
por: Zhang, Zefan, et al.
Publicado: (2026)
por: Zhang, Zefan, et al.
Publicado: (2026)
VERIFIED: A Video Corpus Moment Retrieval Benchmark for Fine-Grained Video Understanding
por: Chen, Houlun, et al.
Publicado: (2024)
por: Chen, Houlun, et al.
Publicado: (2024)
PRVR: Partially Relevant Video Retrieval
por: Chen, Xianke, et al.
Publicado: (2022)
por: Chen, Xianke, et al.
Publicado: (2022)
Compressed Deepfake Video Detection Based on 3D Spatiotemporal Trajectories
por: Chen, Zongmei, et al.
Publicado: (2024)
por: Chen, Zongmei, et al.
Publicado: (2024)
YOLO-RD: Introducing Relevant and Compact Explicit Knowledge to YOLO by Retriever-Dictionary
por: Tsui, Hao-Tang, et al.
Publicado: (2024)
por: Tsui, Hao-Tang, et al.
Publicado: (2024)
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
por: Tan, Huajie, et al.
Publicado: (2025)
por: Tan, Huajie, et al.
Publicado: (2025)
Enhancing Visual Reliance in Text Generation: A Bayesian Perspective on Mitigating Hallucination in Large Vision-Language Models
por: Hu, Nanxing, et al.
Publicado: (2025)
por: Hu, Nanxing, et al.
Publicado: (2025)
WalkVLM:Aid Visually Impaired People Walking by Vision Language Model
por: Yuan, Zhiqiang, et al.
Publicado: (2024)
por: Yuan, Zhiqiang, et al.
Publicado: (2024)
MADTempo: An Interactive System for Multi-Event Temporal Video Retrieval with Query Augmentation
por: Vu, Huu-An, et al.
Publicado: (2025)
por: Vu, Huu-An, et al.
Publicado: (2025)
Video-EM: Event-Centric Episodic Memory for Long-Form Video Understanding
por: Wang, Yun, et al.
Publicado: (2025)
por: Wang, Yun, et al.
Publicado: (2025)
Enhancing Long Video Understanding via Hierarchical Event-Based Memory
por: Cheng, Dingxin, et al.
Publicado: (2024)
por: Cheng, Dingxin, et al.
Publicado: (2024)
Towards Video Anomaly Retrieval from Video Anomaly Detection: New Benchmarks and Model
por: Wu, Peng, et al.
Publicado: (2023)
por: Wu, Peng, et al.
Publicado: (2023)
ShotFinder: Imagination-Driven Open-Domain Video Shot Retrieval via Web Search
por: Yu, Tao, et al.
Publicado: (2026)
por: Yu, Tao, et al.
Publicado: (2026)
Enhancing Partially Relevant Video Retrieval with Robust Alignment Learning
por: Zhang, Long, et al.
Publicado: (2025)
por: Zhang, Long, et al.
Publicado: (2025)
Any-to-Bokeh: Arbitrary-Subject Video Refocusing with Video Diffusion Model
por: Yang, Yang, et al.
Publicado: (2025)
por: Yang, Yang, et al.
Publicado: (2025)
Enhancing Adversarial Robustness of Vision-Language Models through Low-Rank Adaptation
por: Ji, Yuheng, et al.
Publicado: (2024)
por: Ji, Yuheng, et al.
Publicado: (2024)
VidEvent: A Large Dataset for Understanding Dynamic Evolution of Events in Videos
por: Liang, Baoyu, et al.
Publicado: (2025)
por: Liang, Baoyu, et al.
Publicado: (2025)
Localizing Events in Videos with Multimodal Queries
por: Zhang, Gengyuan, et al.
Publicado: (2024)
por: Zhang, Gengyuan, et al.
Publicado: (2024)
Unleashing the Power of CNN and Transformer for Balanced RGB-Event Video Recognition
por: Wang, Xiao, et al.
Publicado: (2023)
por: Wang, Xiao, et al.
Publicado: (2023)
Event-Enhanced Blurry Video Super-Resolution
por: Kai, Dachun, et al.
Publicado: (2025)
por: Kai, Dachun, et al.
Publicado: (2025)
AdvDMD: Adversarial Reward Meets DMD For High-Quality Few-Step Generation
por: Wang, Xu, et al.
Publicado: (2026)
por: Wang, Xu, et al.
Publicado: (2026)
Towards Efficient Partially Relevant Video Retrieval with Active Moment Discovering
por: Song, Peipei, et al.
Publicado: (2025)
por: Song, Peipei, et al.
Publicado: (2025)
QuRe: Query-Relevant Retrieval through Hard Negative Sampling in Composed Image Retrieval
por: Kwak, Jaehyun, et al.
Publicado: (2025)
por: Kwak, Jaehyun, et al.
Publicado: (2025)
Adversarial Attack for RGB-Event based Visual Object Tracking
por: Chen, Qiang, et al.
Publicado: (2025)
por: Chen, Qiang, et al.
Publicado: (2025)
GIRL-DETR: Gradient-Isolated Reinforcement Learning for Video Moment Retrieval
por: Zhang, Shihang, et al.
Publicado: (2026)
por: Zhang, Shihang, et al.
Publicado: (2026)
Event-Causal RAG: A Retrieval-Augmented Generation Framework for Long Video Reasoning in Complex Scenarios
por: Yan, Peizheng, et al.
Publicado: (2026)
por: Yan, Peizheng, et al.
Publicado: (2026)
REGen: Multimodal Retrieval-Embedded Generation for Long-to-Short Video Editing
por: Xu, Weihan, et al.
Publicado: (2025)
por: Xu, Weihan, et al.
Publicado: (2025)
AdaFocus: Adaptive Relevance-Diversity Sampling with Zero-Cache Look-back for Efficient Long Video Understanding
por: Yang, Xiao, et al.
Publicado: (2026)
por: Yang, Xiao, et al.
Publicado: (2026)
Ejemplares similares
-
Mitigating Semantic Collapse in Partially Relevant Video Retrieval
por: Moon, WonJun, et al.
Publicado: (2025) -
Knowledge-Refined Dual Context-Aware Network for Partially Relevant Video Retrieval
por: Yang, Junkai, et al.
Publicado: (2026) -
Ambiguity-Restrained Text-Video Representation Learning for Partially Relevant Video Retrieval
por: Cho, CH, et al.
Publicado: (2025) -
Prototypes are Balanced Units for Efficient and Effective Partially Relevant Video Retrieval
por: Moon, WonJun, et al.
Publicado: (2025) -
GMMFormer: Gaussian-Mixture-Model Based Transformer for Efficient Partially Relevant Video Retrieval
por: Wang, Yuting, et al.
Publicado: (2023)