Task Presentation and Human Perception in Interactive Video Retrieval
Fuente:
arXiv
Guardado en:
| Autores principales: | Willis, Nina, Bernstein, Abraham, Rossetto, Luca |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Performance Evaluation in Multimedia Retrieval
por: Sauter, Loris, et al.
Publicado: (2024)
por: Sauter, Loris, et al.
Publicado: (2024)
Results of the 2024 Video Browser Showdown
por: Rossetto, Luca, et al.
Publicado: (2024)
por: Rossetto, Luca, et al.
Publicado: (2024)
Results of the 2025 Video Browser Showdown
por: Rossetto, Luca, et al.
Publicado: (2025)
por: Rossetto, Luca, et al.
Publicado: (2025)
On the Brittleness of CLIP Text Encoders
por: Tran, Allie, et al.
Publicado: (2025)
por: Tran, Allie, et al.
Publicado: (2025)
Integrated Semantic and Temporal Alignment for Interactive Video Retrieval
por: Luu, Thanh-Danh, et al.
Publicado: (2025)
por: Luu, Thanh-Danh, et al.
Publicado: (2025)
Delving Deeper: Hierarchical Visual Perception for Robust Video-Text Retrieval
por: Xie, Zequn, et al.
Publicado: (2026)
por: Xie, Zequn, et al.
Publicado: (2026)
The State-of-the-Art in Lifelog Retrieval: A Review of Progress at the ACM Lifelog Search Challenge Workshop 2022-24
por: Tran, Allie, et al.
Publicado: (2025)
por: Tran, Allie, et al.
Publicado: (2025)
Interactive Multi-Turn Retrieval for Health Videos
por: Wu, Chengzheng, et al.
Publicado: (2026)
por: Wu, Chengzheng, et al.
Publicado: (2026)
FLARE: Full-Modality Long-Video Audiovisual Retrieval Benchmark with User-Simulated Queries
por: You, Qijie, et al.
Publicado: (2026)
por: You, Qijie, et al.
Publicado: (2026)
VCR: Video representation for Contextual Retrieval
por: Nir, Oron, et al.
Publicado: (2024)
por: Nir, Oron, et al.
Publicado: (2024)
Multimodal Interaction Modeling via Self-Supervised Multi-Task Learning for Review Helpfulness Prediction
por: Gong, HongLin, et al.
Publicado: (2024)
por: Gong, HongLin, et al.
Publicado: (2024)
TPIFM: A Task-Aware Model for Evaluating Perceptual Interaction Fluency in Remote AR Collaboration
por: Song, Jiarun, et al.
Publicado: (2026)
por: Song, Jiarun, et al.
Publicado: (2026)
Perception-Aware Video Semantic Communication
por: Huang, Yinhuan, et al.
Publicado: (2026)
por: Huang, Yinhuan, et al.
Publicado: (2026)
diveXplore 6.0: ITEC's Interactive Video Exploration System at VBS 2022
por: Leibetseder, Andreas, et al.
Publicado: (2025)
por: Leibetseder, Andreas, et al.
Publicado: (2025)
VARFVV: View-Adaptive Real-Time Interactive Free-View Video Streaming with Edge Computing
por: Hu, Qiang, et al.
Publicado: (2025)
por: Hu, Qiang, et al.
Publicado: (2025)
360CityGML: Realistic and Interactive Urban Visualization System Integrating CityGML Model and 360° Videos
por: Banno, Tatsuro, et al.
Publicado: (2025)
por: Banno, Tatsuro, et al.
Publicado: (2025)
PRVR: Partially Relevant Video Retrieval
por: Chen, Xianke, et al.
Publicado: (2022)
por: Chen, Xianke, et al.
Publicado: (2022)
Robust Relevance Feedback for Interactive Known-Item Video Search
por: Ma, Zhixin, et al.
Publicado: (2025)
por: Ma, Zhixin, et al.
Publicado: (2025)
Interdisciplinary Translations: Sensory Perception as a Universal Language
por: Kang, Xindi, et al.
Publicado: (2024)
por: Kang, Xindi, et al.
Publicado: (2024)
Synchronized Video Storytelling: Generating Video Narrations with Structured Storyline
por: Yang, Dingyi, et al.
Publicado: (2024)
por: Yang, Dingyi, et al.
Publicado: (2024)
Reply with Sticker: New Dataset and Model for Sticker Retrieval
por: Liang, Bin, et al.
Publicado: (2024)
por: Liang, Bin, et al.
Publicado: (2024)
Adaptive Multi-Agent Reasoning for Text-to-Video Retrieval
por: Wu, Jiaxin, et al.
Publicado: (2025)
por: Wu, Jiaxin, et al.
Publicado: (2025)
Memory-enhanced Retrieval Augmentation for Long Video Understanding
por: Yuan, Huaying, et al.
Publicado: (2025)
por: Yuan, Huaying, et al.
Publicado: (2025)
UniAV: Unified Audio-Visual Perception for Multi-Task Video Event Localization
por: Geng, Tiantian, et al.
Publicado: (2024)
por: Geng, Tiantian, et al.
Publicado: (2024)
Retrieval Augmented Verification for Zero-Shot Detection of Multimodal Disinformation
por: Dey, Arka Ujjal, et al.
Publicado: (2024)
por: Dey, Arka Ujjal, et al.
Publicado: (2024)
CustomDancer: Customized Dance Recommendation by Text-Dance Retrieval
por: Qin, Yawen, et al.
Publicado: (2026)
por: Qin, Yawen, et al.
Publicado: (2026)
Music Grounding by Short Video
por: Xin, Zijie, et al.
Publicado: (2024)
por: Xin, Zijie, et al.
Publicado: (2024)
Generative AI-enabled Mobile Tactical Multimedia Networks: Distribution, Generation, and Perception
por: Xu, Minrui, et al.
Publicado: (2024)
por: Xu, Minrui, et al.
Publicado: (2024)
Hallucination Localization in Video Captioning
por: Nakada, Shota, et al.
Publicado: (2025)
por: Nakada, Shota, et al.
Publicado: (2025)
SVD: Spatial Video Dataset
por: Izadimehr, M. H., et al.
Publicado: (2025)
por: Izadimehr, M. H., et al.
Publicado: (2025)
Music4All A+A: A Multimodal Dataset for Music Information Retrieval Tasks
por: Geiger, Jonas, et al.
Publicado: (2025)
por: Geiger, Jonas, et al.
Publicado: (2025)
Rethinking Vision Transformer for Large-Scale Fine-Grained Image Retrieval
por: Jiang, Xin, et al.
Publicado: (2025)
por: Jiang, Xin, et al.
Publicado: (2025)
Semi-Supervised Contrastive Learning for Controllable Video-to-Music Retrieval
por: Stewart, Shanti, et al.
Publicado: (2024)
por: Stewart, Shanti, et al.
Publicado: (2024)
Context-Enhanced Video Moment Retrieval with Large Language Models
por: Liu, Weijia, et al.
Publicado: (2024)
por: Liu, Weijia, et al.
Publicado: (2024)
Prompt-aware of Frame Sampling for Efficient Text-Video Retrieval
por: Zhang, Deyu, et al.
Publicado: (2025)
por: Zhang, Deyu, et al.
Publicado: (2025)
Enhancing Partially Relevant Video Retrieval with Robust Alignment Learning
por: Zhang, Long, et al.
Publicado: (2025)
por: Zhang, Long, et al.
Publicado: (2025)
Human-centered Interactive Learning via MLLMs for Text-to-Image Person Re-identification
por: Qin, Yang, et al.
Publicado: (2025)
por: Qin, Yang, et al.
Publicado: (2025)
From Perception to Cognition: How Latency Affects Interaction Fluency and Social Presence in VR Conferencing
por: Song, Jiarun, et al.
Publicado: (2026)
por: Song, Jiarun, et al.
Publicado: (2026)
Towards Alleviating Text-to-Image Retrieval Hallucination for CLIP in Zero-shot Learning
por: Wang, Hanyao, et al.
Publicado: (2024)
por: Wang, Hanyao, et al.
Publicado: (2024)
Simple but Effective Raw-Data Level Multimodal Fusion for Composed Image Retrieval
por: Wen, Haokun, et al.
Publicado: (2024)
por: Wen, Haokun, et al.
Publicado: (2024)
Ejemplares similares
-
Performance Evaluation in Multimedia Retrieval
por: Sauter, Loris, et al.
Publicado: (2024) -
Results of the 2024 Video Browser Showdown
por: Rossetto, Luca, et al.
Publicado: (2024) -
Results of the 2025 Video Browser Showdown
por: Rossetto, Luca, et al.
Publicado: (2025) -
On the Brittleness of CLIP Text Encoders
por: Tran, Allie, et al.
Publicado: (2025) -
Integrated Semantic and Temporal Alignment for Interactive Video Retrieval
por: Luu, Thanh-Danh, et al.
Publicado: (2025)