Enregistré dans:
| Auteurs principaux: | Mai, Jinjie, Hamdi, Abdullah, Giancola, Silvio, Zhao, Chen, Ghanem, Bernard |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2407.08023 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MVTN: Learning Multi-View Transformations for 3D Understanding
par: Hamdi, Abdullah, et autres
Publié: (2022)
par: Hamdi, Abdullah, et autres
Publié: (2022)
TrackNeRF: Bundle Adjusting NeRF from Sparse and Noisy Views via Feature Tracks
par: Mai, Jinjie, et autres
Publié: (2024)
par: Mai, Jinjie, et autres
Publié: (2024)
VARS: Video Assistant Referee System for Automated Soccer Decision Making from Multiple Views
par: Held, Jan, et autres
Publié: (2023)
par: Held, Jan, et autres
Publié: (2023)
Investigating Event-Based Cameras for Video Frame Interpolation in Sports
par: Deckyvere, Antoine, et autres
Publié: (2024)
par: Deckyvere, Antoine, et autres
Publié: (2024)
Towards AI-Powered Video Assistant Referee System (VARS) for Association Football
par: Held, Jan, et autres
Publié: (2024)
par: Held, Jan, et autres
Publié: (2024)
Deep learning for action spotting in association football videos
par: Giancola, Silvio, et autres
Publié: (2024)
par: Giancola, Silvio, et autres
Publié: (2024)
3D Convex Splatting: Radiance Field Rendering with 3D Smooth Convexes
par: Held, Jan, et autres
Publié: (2024)
par: Held, Jan, et autres
Publié: (2024)
GoTTA be Diverse: Rethinking Memory Policies for Test-Time Adaptation
par: Alhuwaider, Shyma, et autres
Publié: (2026)
par: Alhuwaider, Shyma, et autres
Publié: (2026)
Pixels or Positions? Benchmarking Modalities in Group Activity Recognition
par: Karki, Drishya, et autres
Publié: (2025)
par: Karki, Drishya, et autres
Publié: (2025)
Learning Semantic Segmentation with Query Points Supervision on Aerial Images
par: Rivier, Santiago, et autres
Publié: (2023)
par: Rivier, Santiago, et autres
Publié: (2023)
SoccerNet-Caption: Dense Video Captioning for Soccer Broadcasts Commentaries
par: Mkhallati, Hassan, et autres
Publié: (2023)
par: Mkhallati, Hassan, et autres
Publié: (2023)
Triangle Splatting for Real-Time Radiance Field Rendering
par: Held, Jan, et autres
Publié: (2025)
par: Held, Jan, et autres
Publié: (2025)
SPARF: Large-Scale Learning of 3D Sparse Radiance Fields from Few Input Images
par: Hamdi, Abdullah, et autres
Publié: (2022)
par: Hamdi, Abdullah, et autres
Publié: (2022)
Pix4Point: Image Pretrained Standard Transformers for 3D Point Cloud Understanding
par: Qian, Guocheng, et autres
Publié: (2022)
par: Qian, Guocheng, et autres
Publié: (2022)
X-VARS: Introducing Explainability in Football Refereeing with Multi-Modal Large Language Model
par: Held, Jan, et autres
Publié: (2024)
par: Held, Jan, et autres
Publié: (2024)
OSL-ActionSpotting: A Unified Library for Action Spotting in Sports Videos
par: Benzakour, Yassine, et autres
Publié: (2024)
par: Benzakour, Yassine, et autres
Publié: (2024)
GES: Generalized Exponential Splatting for Efficient Radiance Field Rendering
par: Hamdi, Abdullah, et autres
Publié: (2024)
par: Hamdi, Abdullah, et autres
Publié: (2024)
SoccerLens: Grounded Soccer Video Understanding Beyond Accuracy
par: Elsharkawi, Ismael, et autres
Publié: (2026)
par: Elsharkawi, Ismael, et autres
Publié: (2026)
4D-Bench: Benchmarking Multi-modal Large Language Models for 4D Object Understanding
par: Zhu, Wenxuan, et autres
Publié: (2025)
par: Zhu, Wenxuan, et autres
Publié: (2025)
Exploring Missing Modality in Multimodal Egocentric Datasets
par: Ramazanova, Merey, et autres
Publié: (2024)
par: Ramazanova, Merey, et autres
Publié: (2024)
Towards Active Learning for Action Spotting in Association Football Videos
par: Giancola, Silvio, et autres
Publié: (2023)
par: Giancola, Silvio, et autres
Publié: (2023)
SoccerNet-Tracking: Multiple Object Tracking Dataset and Benchmark in Soccer Videos
par: Cioppa, Anthony, et autres
Publié: (2022)
par: Cioppa, Anthony, et autres
Publié: (2022)
Video Self-Stitching Graph Network for Temporal Action Localization
par: Zhao, Chen, et autres
Publié: (2020)
par: Zhao, Chen, et autres
Publié: (2020)
Test-Time Adaptation for Combating Missing Modalities in Egocentric Videos
par: Ramazanova, Merey, et autres
Publié: (2024)
par: Ramazanova, Merey, et autres
Publié: (2024)
Efficient Image Pre-Training with Siamese Cropped Masked Autoencoders
par: Eymaël, Alexandre, et autres
Publié: (2024)
par: Eymaël, Alexandre, et autres
Publié: (2024)
Vivid-ZOO: Multi-View Video Generation with Diffusion Model
par: Li, Bing, et autres
Publié: (2024)
par: Li, Bing, et autres
Publié: (2024)
Can Video Diffusion Model Reconstruct 4D Geometry?
par: Mai, Jinjie, et autres
Publié: (2025)
par: Mai, Jinjie, et autres
Publié: (2025)
SMILE: Infusing Spatial and Motion Semantics in Masked Video Learning
par: Thoker, Fida Mohammad, et autres
Publié: (2025)
par: Thoker, Fida Mohammad, et autres
Publié: (2025)
Camera Relocalization in Shadow-free Neural Radiance Fields
par: Xu, Shiyao, et autres
Publié: (2024)
par: Xu, Shiyao, et autres
Publié: (2024)
OpenTAD: A Unified Framework and Comprehensive Study of Temporal Action Detection
par: Liu, Shuming, et autres
Publié: (2025)
par: Liu, Shuming, et autres
Publié: (2025)
WSCLoc: Weakly-Supervised Sparse-View Camera Relocalization
par: Wang, Jialu, et autres
Publié: (2024)
par: Wang, Jialu, et autres
Publié: (2024)
Differentiable Product Quantization for Memory Efficient Camera Relocalization
par: Laskar, Zakaria, et autres
Publié: (2024)
par: Laskar, Zakaria, et autres
Publié: (2024)
OmniEgoCap: Camera-Agnostic Sequence-Level Egocentric Motion Reconstruction
par: Cho, Kyungwon, et autres
Publié: (2025)
par: Cho, Kyungwon, et autres
Publié: (2025)
Semantic Object-level Modeling for Robust Visual Camera Relocalization
par: Zhu, Yifan, et autres
Publié: (2024)
par: Zhu, Yifan, et autres
Publié: (2024)
EasyV2V: A High-quality Instruction-based Video Editing Framework
par: Mai, Jinjie, et autres
Publié: (2025)
par: Mai, Jinjie, et autres
Publié: (2025)
Estimating 2D Camera Motion with Hybrid Motion Basis
par: Li, Haipeng, et autres
Publié: (2025)
par: Li, Haipeng, et autres
Publié: (2025)
EffLoc: Lightweight Vision Transformer for Efficient 6-DOF Camera Relocalization
par: Xiao, Zhendong, et autres
Publié: (2024)
par: Xiao, Zhendong, et autres
Publié: (2024)
Action Anticipation from SoccerNet Football Video Broadcasts
par: Dalal, Mohamad, et autres
Publié: (2025)
par: Dalal, Mohamad, et autres
Publié: (2025)
Improved 3D Point-Line Mapping Regression for Camera Relocalization
par: Bui, Bach-Thuan, et autres
Publié: (2025)
par: Bui, Bach-Thuan, et autres
Publié: (2025)
BOLT: Boost Large Vision-Language Model Without Training for Long-form Video Understanding
par: Liu, Shuming, et autres
Publié: (2025)
par: Liu, Shuming, et autres
Publié: (2025)
Documents similaires
-
MVTN: Learning Multi-View Transformations for 3D Understanding
par: Hamdi, Abdullah, et autres
Publié: (2022) -
TrackNeRF: Bundle Adjusting NeRF from Sparse and Noisy Views via Feature Tracks
par: Mai, Jinjie, et autres
Publié: (2024) -
VARS: Video Assistant Referee System for Automated Soccer Decision Making from Multiple Views
par: Held, Jan, et autres
Publié: (2023) -
Investigating Event-Based Cameras for Video Frame Interpolation in Sports
par: Deckyvere, Antoine, et autres
Publié: (2024) -
Towards AI-Powered Video Assistant Referee System (VARS) for Association Football
par: Held, Jan, et autres
Publié: (2024)