SLVideo: A Sign Language Video Moment Retrieval Framework
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Martins, Gonçalo Vinagre, Magalhães, João, Quinaz, Afonso, Viegas, Carla, Cavaco, Sofia |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
MomentSeeker: A Task-Oriented Benchmark For Long-Video Moment Retrieval
von: Yuan, Huaying, et al.
Veröffentlicht: (2025)
von: Yuan, Huaying, et al.
Veröffentlicht: (2025)
VERIFIED: A Video Corpus Moment Retrieval Benchmark for Fine-Grained Video Understanding
von: Chen, Houlun, et al.
Veröffentlicht: (2024)
von: Chen, Houlun, et al.
Veröffentlicht: (2024)
MVMR: A New Framework for Evaluating Faithfulness of Video Moment Retrieval against Multiple Distractors
von: Yang, Nakyeong, et al.
Veröffentlicht: (2023)
von: Yang, Nakyeong, et al.
Veröffentlicht: (2023)
GIRL-DETR: Gradient-Isolated Reinforcement Learning for Video Moment Retrieval
von: Zhang, Shihang, et al.
Veröffentlicht: (2026)
von: Zhang, Shihang, et al.
Veröffentlicht: (2026)
A Conformal Risk Control Framework for Granular Word Assessment and Uncertainty Calibration of CLIPScore Quality Estimates
von: Gomes, Gonçalo, et al.
Veröffentlicht: (2025)
von: Gomes, Gonçalo, et al.
Veröffentlicht: (2025)
SMART: Shot-Aware Multimodal Video Moment Retrieval with Audio-Enhanced MLLM
von: Yu, An, et al.
Veröffentlicht: (2025)
von: Yu, An, et al.
Veröffentlicht: (2025)
When One Moment Isn't Enough: Multi-Moment Retrieval with Cross-Moment Interactions
von: Cao, Zhuo, et al.
Veröffentlicht: (2025)
von: Cao, Zhuo, et al.
Veröffentlicht: (2025)
VideoLights: Feature Refinement and Cross-Task Alignment Transformer for Joint Video Highlight Detection and Moment Retrieval
von: Paul, Dhiman, et al.
Veröffentlicht: (2024)
von: Paul, Dhiman, et al.
Veröffentlicht: (2024)
Who Can We Trust? Scope-Aware Video Moment Retrieval with Multi-Agent Conflict
von: Wu, Chaochen, et al.
Veröffentlicht: (2025)
von: Wu, Chaochen, et al.
Veröffentlicht: (2025)
Watch Video, Catch Keyword: Context-aware Keyword Attention for Moment Retrieval and Highlight Detection
von: Um, Sung Jin, et al.
Veröffentlicht: (2025)
von: Um, Sung Jin, et al.
Veröffentlicht: (2025)
MomentMix Augmentation with Length-Aware DETR for Temporally Robust Moment Retrieval
von: Park, Seojeong, et al.
Veröffentlicht: (2024)
von: Park, Seojeong, et al.
Veröffentlicht: (2024)
Advanced Sign Language Video Generation with Compressed and Quantized Multi-Condition Tokenization
von: Wang, Cong, et al.
Veröffentlicht: (2025)
von: Wang, Cong, et al.
Veröffentlicht: (2025)
Large Sign Language Models: Toward 3D American Sign Language Translation
von: Zhang, Sen, et al.
Veröffentlicht: (2025)
von: Zhang, Sen, et al.
Veröffentlicht: (2025)
Moment-Video: Diagnosing Temporal Fidelity of Video MLLMs on Momentary Visual Events
von: Liu, Xiaolin, et al.
Veröffentlicht: (2026)
von: Liu, Xiaolin, et al.
Veröffentlicht: (2026)
Multi-Modal Cross-Domain Alignment Network for Video Moment Retrieval
von: Fang, Xiang, et al.
Veröffentlicht: (2022)
von: Fang, Xiang, et al.
Veröffentlicht: (2022)
Moment Sampling in Video LLMs for Long-Form Video QA
von: Chasmai, Mustafa, et al.
Veröffentlicht: (2025)
von: Chasmai, Mustafa, et al.
Veröffentlicht: (2025)
SignMouth: Leveraging Mouthing Cues for Sign Language Translation by Multimodal Contrastive Fusion
von: Wu, Wenfang, et al.
Veröffentlicht: (2025)
von: Wu, Wenfang, et al.
Veröffentlicht: (2025)
Tamaththul3D: High-Fidelity 3D Saudi Sign Language Avatars from Monocular Video
von: Alghamdi, Eyad, et al.
Veröffentlicht: (2026)
von: Alghamdi, Eyad, et al.
Veröffentlicht: (2026)
GPTSee: Enhancing Moment Retrieval and Highlight Detection via Description-Based Similarity Features
von: Sun, Yunzhuo, et al.
Veröffentlicht: (2024)
von: Sun, Yunzhuo, et al.
Veröffentlicht: (2024)
Event-Causal RAG: A Retrieval-Augmented Generation Framework for Long Video Reasoning in Complex Scenarios
von: Yan, Peizheng, et al.
Veröffentlicht: (2026)
von: Yan, Peizheng, et al.
Veröffentlicht: (2026)
Task-Driven Exploration: Decoupling and Inter-Task Feedback for Joint Moment Retrieval and Highlight Detection
von: Yang, Jin, et al.
Veröffentlicht: (2024)
von: Yang, Jin, et al.
Veröffentlicht: (2024)
Arabic Sign Language Recognition using Multimodal Approach
von: Alanazi, Ghadeer, et al.
Veröffentlicht: (2026)
von: Alanazi, Ghadeer, et al.
Veröffentlicht: (2026)
Sign Spotting Disambiguation using Large Language Models
von: Low, JianHe, et al.
Veröffentlicht: (2025)
von: Low, JianHe, et al.
Veröffentlicht: (2025)
A real-time Artificial Intelligence system for learning Sign Language
von: Cabana, Elisa
Veröffentlicht: (2024)
von: Cabana, Elisa
Veröffentlicht: (2024)
Generation and Detection of Sign Language Deepfakes - A Linguistic and Visual Analysis
von: Naeem, Shahzeb, et al.
Veröffentlicht: (2024)
von: Naeem, Shahzeb, et al.
Veröffentlicht: (2024)
ClipTBP: Clip-Pair based Temporal Boundary Prediction with Boundary-Aware Learning for Moment Retrieval
von: Kim, Ji-Hyeon, et al.
Veröffentlicht: (2026)
von: Kim, Ji-Hyeon, et al.
Veröffentlicht: (2026)
SSLR: A Semi-Supervised Learning Method for Isolated Sign Language Recognition
von: Algafri, Hasan, et al.
Veröffentlicht: (2025)
von: Algafri, Hasan, et al.
Veröffentlicht: (2025)
American Sign Language Alphabet Recognition using Deep Learning
von: Kasukurthi, Nikhil, et al.
Veröffentlicht: (2019)
von: Kasukurthi, Nikhil, et al.
Veröffentlicht: (2019)
AutoSign: Direct Pose-to-Text Translation for Continuous Sign Language Recognition
von: Johnny, Samuel Ebimobowei, et al.
Veröffentlicht: (2025)
von: Johnny, Samuel Ebimobowei, et al.
Veröffentlicht: (2025)
Video-RAG: Visually-aligned Retrieval-Augmented Long Video Comprehension
von: Luo, Yongdong, et al.
Veröffentlicht: (2024)
von: Luo, Yongdong, et al.
Veröffentlicht: (2024)
VidVec: Unlocking Video MLLM Embeddings for Video-Text Retrieval
von: Tzachor, Issar, et al.
Veröffentlicht: (2026)
von: Tzachor, Issar, et al.
Veröffentlicht: (2026)
2DP-2MRC: 2-Dimensional Pointer-based Machine Reading Comprehension Method for Multimodal Moment Retrieval
von: He, Jiajun, et al.
Veröffentlicht: (2024)
von: He, Jiajun, et al.
Veröffentlicht: (2024)
Exploiting Ensemble Learning for Cross-View Isolated Sign Language Recognition
von: Wang, Fei, et al.
Veröffentlicht: (2025)
von: Wang, Fei, et al.
Veröffentlicht: (2025)
Continuous Sign Language Recognition Using Intra-inter Gloss Attention
von: Ranjbar, Hossein, et al.
Veröffentlicht: (2024)
von: Ranjbar, Hossein, et al.
Veröffentlicht: (2024)
Ambiguity-Restrained Text-Video Representation Learning for Partially Relevant Video Retrieval
von: Cho, CH, et al.
Veröffentlicht: (2025)
von: Cho, CH, et al.
Veröffentlicht: (2025)
RadiomicsRetrieval: A Customizable Framework for Medical Image Retrieval Using Radiomics Features
von: Na, Inye, et al.
Veröffentlicht: (2025)
von: Na, Inye, et al.
Veröffentlicht: (2025)
Query-centric Audio-Visual Cognition Network for Moment Retrieval, Segmentation and Step-Captioning
von: Tu, Yunbin, et al.
Veröffentlicht: (2024)
von: Tu, Yunbin, et al.
Veröffentlicht: (2024)
SignVerse-2M: A Two-Million-Clip Pose-Native Universe of 55+ Sign Languages
von: Fang, Sen, et al.
Veröffentlicht: (2026)
von: Fang, Sen, et al.
Veröffentlicht: (2026)
3D-LEX v1.0: 3D Lexicons for American Sign Language and Sign Language of the Netherlands
von: Ranum, Oline, et al.
Veröffentlicht: (2024)
von: Ranum, Oline, et al.
Veröffentlicht: (2024)
Multimodal Contextualized Support for Enhancing Video Retrieval System
von: Nguyen-Le, Quoc-Bao, et al.
Veröffentlicht: (2024)
von: Nguyen-Le, Quoc-Bao, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
MomentSeeker: A Task-Oriented Benchmark For Long-Video Moment Retrieval
von: Yuan, Huaying, et al.
Veröffentlicht: (2025) -
VERIFIED: A Video Corpus Moment Retrieval Benchmark for Fine-Grained Video Understanding
von: Chen, Houlun, et al.
Veröffentlicht: (2024) -
MVMR: A New Framework for Evaluating Faithfulness of Video Moment Retrieval against Multiple Distractors
von: Yang, Nakyeong, et al.
Veröffentlicht: (2023) -
GIRL-DETR: Gradient-Isolated Reinforcement Learning for Video Moment Retrieval
von: Zhang, Shihang, et al.
Veröffentlicht: (2026) -
A Conformal Risk Control Framework for Granular Word Assessment and Uncertainty Calibration of CLIPScore Quality Estimates
von: Gomes, Gonçalo, et al.
Veröffentlicht: (2025)