Hybrid Structure-from-Motion and Camera Relocalization for Enhanced Egocentric Localization
Fuente:
arXiv
Salvato in:
| Autori principali: | Mai, Jinjie, Hamdi, Abdullah, Giancola, Silvio, Zhao, Chen, Ghanem, Bernard |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MVTN: Learning Multi-View Transformations for 3D Understanding
di: Hamdi, Abdullah, et al.
Pubblicazione: (2022)
di: Hamdi, Abdullah, et al.
Pubblicazione: (2022)
TrackNeRF: Bundle Adjusting NeRF from Sparse and Noisy Views via Feature Tracks
di: Mai, Jinjie, et al.
Pubblicazione: (2024)
di: Mai, Jinjie, et al.
Pubblicazione: (2024)
VARS: Video Assistant Referee System for Automated Soccer Decision Making from Multiple Views
di: Held, Jan, et al.
Pubblicazione: (2023)
di: Held, Jan, et al.
Pubblicazione: (2023)
Investigating Event-Based Cameras for Video Frame Interpolation in Sports
di: Deckyvere, Antoine, et al.
Pubblicazione: (2024)
di: Deckyvere, Antoine, et al.
Pubblicazione: (2024)
Towards AI-Powered Video Assistant Referee System (VARS) for Association Football
di: Held, Jan, et al.
Pubblicazione: (2024)
di: Held, Jan, et al.
Pubblicazione: (2024)
Deep learning for action spotting in association football videos
di: Giancola, Silvio, et al.
Pubblicazione: (2024)
di: Giancola, Silvio, et al.
Pubblicazione: (2024)
GoTTA be Diverse: Rethinking Memory Policies for Test-Time Adaptation
di: Alhuwaider, Shyma, et al.
Pubblicazione: (2026)
di: Alhuwaider, Shyma, et al.
Pubblicazione: (2026)
Pixels or Positions? Benchmarking Modalities in Group Activity Recognition
di: Karki, Drishya, et al.
Pubblicazione: (2025)
di: Karki, Drishya, et al.
Pubblicazione: (2025)
3D Convex Splatting: Radiance Field Rendering with 3D Smooth Convexes
di: Held, Jan, et al.
Pubblicazione: (2024)
di: Held, Jan, et al.
Pubblicazione: (2024)
Learning Semantic Segmentation with Query Points Supervision on Aerial Images
di: Rivier, Santiago, et al.
Pubblicazione: (2023)
di: Rivier, Santiago, et al.
Pubblicazione: (2023)
SoccerNet-Caption: Dense Video Captioning for Soccer Broadcasts Commentaries
di: Mkhallati, Hassan, et al.
Pubblicazione: (2023)
di: Mkhallati, Hassan, et al.
Pubblicazione: (2023)
Pix4Point: Image Pretrained Standard Transformers for 3D Point Cloud Understanding
di: Qian, Guocheng, et al.
Pubblicazione: (2022)
di: Qian, Guocheng, et al.
Pubblicazione: (2022)
Triangle Splatting for Real-Time Radiance Field Rendering
di: Held, Jan, et al.
Pubblicazione: (2025)
di: Held, Jan, et al.
Pubblicazione: (2025)
SPARF: Large-Scale Learning of 3D Sparse Radiance Fields from Few Input Images
di: Hamdi, Abdullah, et al.
Pubblicazione: (2022)
di: Hamdi, Abdullah, et al.
Pubblicazione: (2022)
X-VARS: Introducing Explainability in Football Refereeing with Multi-Modal Large Language Model
di: Held, Jan, et al.
Pubblicazione: (2024)
di: Held, Jan, et al.
Pubblicazione: (2024)
OSL-ActionSpotting: A Unified Library for Action Spotting in Sports Videos
di: Benzakour, Yassine, et al.
Pubblicazione: (2024)
di: Benzakour, Yassine, et al.
Pubblicazione: (2024)
GES: Generalized Exponential Splatting for Efficient Radiance Field Rendering
di: Hamdi, Abdullah, et al.
Pubblicazione: (2024)
di: Hamdi, Abdullah, et al.
Pubblicazione: (2024)
Exploring Missing Modality in Multimodal Egocentric Datasets
di: Ramazanova, Merey, et al.
Pubblicazione: (2024)
di: Ramazanova, Merey, et al.
Pubblicazione: (2024)
SoccerLens: Grounded Soccer Video Understanding Beyond Accuracy
di: Elsharkawi, Ismael, et al.
Pubblicazione: (2026)
di: Elsharkawi, Ismael, et al.
Pubblicazione: (2026)
4D-Bench: Benchmarking Multi-modal Large Language Models for 4D Object Understanding
di: Zhu, Wenxuan, et al.
Pubblicazione: (2025)
di: Zhu, Wenxuan, et al.
Pubblicazione: (2025)
Video Self-Stitching Graph Network for Temporal Action Localization
di: Zhao, Chen, et al.
Pubblicazione: (2020)
di: Zhao, Chen, et al.
Pubblicazione: (2020)
Test-Time Adaptation for Combating Missing Modalities in Egocentric Videos
di: Ramazanova, Merey, et al.
Pubblicazione: (2024)
di: Ramazanova, Merey, et al.
Pubblicazione: (2024)
Towards Active Learning for Action Spotting in Association Football Videos
di: Giancola, Silvio, et al.
Pubblicazione: (2023)
di: Giancola, Silvio, et al.
Pubblicazione: (2023)
SoccerNet-Tracking: Multiple Object Tracking Dataset and Benchmark in Soccer Videos
di: Cioppa, Anthony, et al.
Pubblicazione: (2022)
di: Cioppa, Anthony, et al.
Pubblicazione: (2022)
SMILE: Infusing Spatial and Motion Semantics in Masked Video Learning
di: Thoker, Fida Mohammad, et al.
Pubblicazione: (2025)
di: Thoker, Fida Mohammad, et al.
Pubblicazione: (2025)
Vivid-ZOO: Multi-View Video Generation with Diffusion Model
di: Li, Bing, et al.
Pubblicazione: (2024)
di: Li, Bing, et al.
Pubblicazione: (2024)
Can Video Diffusion Model Reconstruct 4D Geometry?
di: Mai, Jinjie, et al.
Pubblicazione: (2025)
di: Mai, Jinjie, et al.
Pubblicazione: (2025)
Camera Relocalization in Shadow-free Neural Radiance Fields
di: Xu, Shiyao, et al.
Pubblicazione: (2024)
di: Xu, Shiyao, et al.
Pubblicazione: (2024)
OmniEgoCap: Camera-Agnostic Sequence-Level Egocentric Motion Reconstruction
di: Cho, Kyungwon, et al.
Pubblicazione: (2025)
di: Cho, Kyungwon, et al.
Pubblicazione: (2025)
Efficient Image Pre-Training with Siamese Cropped Masked Autoencoders
di: Eymaël, Alexandre, et al.
Pubblicazione: (2024)
di: Eymaël, Alexandre, et al.
Pubblicazione: (2024)
WSCLoc: Weakly-Supervised Sparse-View Camera Relocalization
di: Wang, Jialu, et al.
Pubblicazione: (2024)
di: Wang, Jialu, et al.
Pubblicazione: (2024)
Differentiable Product Quantization for Memory Efficient Camera Relocalization
di: Laskar, Zakaria, et al.
Pubblicazione: (2024)
di: Laskar, Zakaria, et al.
Pubblicazione: (2024)
Estimating 2D Camera Motion with Hybrid Motion Basis
di: Li, Haipeng, et al.
Pubblicazione: (2025)
di: Li, Haipeng, et al.
Pubblicazione: (2025)
Semantic Object-level Modeling for Robust Visual Camera Relocalization
di: Zhu, Yifan, et al.
Pubblicazione: (2024)
di: Zhu, Yifan, et al.
Pubblicazione: (2024)
EffLoc: Lightweight Vision Transformer for Efficient 6-DOF Camera Relocalization
di: Xiao, Zhendong, et al.
Pubblicazione: (2024)
di: Xiao, Zhendong, et al.
Pubblicazione: (2024)
Improved 3D Point-Line Mapping Regression for Camera Relocalization
di: Bui, Bach-Thuan, et al.
Pubblicazione: (2025)
di: Bui, Bach-Thuan, et al.
Pubblicazione: (2025)
OpenTAD: A Unified Framework and Comprehensive Study of Temporal Action Detection
di: Liu, Shuming, et al.
Pubblicazione: (2025)
di: Liu, Shuming, et al.
Pubblicazione: (2025)
Reloc3r: Large-Scale Training of Relative Camera Pose Regression for Generalizable, Fast, and Accurate Visual Localization
di: Dong, Siyan, et al.
Pubblicazione: (2024)
di: Dong, Siyan, et al.
Pubblicazione: (2024)
BOLT: Boost Large Vision-Language Model Without Training for Long-form Video Understanding
di: Liu, Shuming, et al.
Pubblicazione: (2025)
di: Liu, Shuming, et al.
Pubblicazione: (2025)
$β$-CLIP: Text-Conditioned Contrastive Learning for Multi-Granular Vision-Language Alignment
di: Zohra, Fatimah, et al.
Pubblicazione: (2025)
di: Zohra, Fatimah, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MVTN: Learning Multi-View Transformations for 3D Understanding
di: Hamdi, Abdullah, et al.
Pubblicazione: (2022) -
TrackNeRF: Bundle Adjusting NeRF from Sparse and Noisy Views via Feature Tracks
di: Mai, Jinjie, et al.
Pubblicazione: (2024) -
VARS: Video Assistant Referee System for Automated Soccer Decision Making from Multiple Views
di: Held, Jan, et al.
Pubblicazione: (2023) -
Investigating Event-Based Cameras for Video Frame Interpolation in Sports
di: Deckyvere, Antoine, et al.
Pubblicazione: (2024) -
Towards AI-Powered Video Assistant Referee System (VARS) for Association Football
di: Held, Jan, et al.
Pubblicazione: (2024)