Multi-Modal Soccer Scene Analysis with Masked Pre-Training
Fuente:
arXiv
Salvato in:
| Autori principali: | Peral, Marc, Capellera, Guillem, Ferraz, Luis, Rubio, Antonio, Agudo, Antonio |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Unified Uncertainty-Aware Diffusion for Multi-Agent Trajectory Modeling
di: Capellera, Guillem, et al.
Pubblicazione: (2025)
di: Capellera, Guillem, et al.
Pubblicazione: (2025)
FootBots: A Transformer-based Architecture for Motion Prediction in Soccer
di: Capellera, Guillem, et al.
Pubblicazione: (2024)
di: Capellera, Guillem, et al.
Pubblicazione: (2024)
Heteroscedastic Diffusion for Multi-Agent Trajectory Modeling
di: Capellera, Guillem, et al.
Pubblicazione: (2026)
di: Capellera, Guillem, et al.
Pubblicazione: (2026)
JointDiff: Bridging Continuous and Discrete in Multi-Agent Trajectory Generation
di: Capellera, Guillem, et al.
Pubblicazione: (2025)
di: Capellera, Guillem, et al.
Pubblicazione: (2025)
TranSPORTmer: A Holistic Approach to Trajectory Understanding in Multi-Agent Sports
di: Capellera, Guillem, et al.
Pubblicazione: (2024)
di: Capellera, Guillem, et al.
Pubblicazione: (2024)
SoccerNet-v3D: Leveraging Sports Broadcast Replays for 3D Scene Understanding
di: Gutiérrez-Pérez, Marc, et al.
Pubblicazione: (2025)
di: Gutiérrez-Pérez, Marc, et al.
Pubblicazione: (2025)
MMRPT: MultiModal Reinforcement Pre-Training via Masked Vision-Dependent Reasoning
di: Zheng, Xuhui, et al.
Pubblicazione: (2025)
di: Zheng, Xuhui, et al.
Pubblicazione: (2025)
Semi-Supervised Training to Improve Player and Ball Detection in Soccer
di: Vandeghen, Renaud, et al.
Pubblicazione: (2022)
di: Vandeghen, Renaud, et al.
Pubblicazione: (2022)
MiM: Mask in Mask Self-Supervised Pre-Training for 3D Medical Image Analysis
di: Zhuang, Jiaxin, et al.
Pubblicazione: (2024)
di: Zhuang, Jiaxin, et al.
Pubblicazione: (2024)
SoccerNet-Caption: Dense Video Captioning for Soccer Broadcasts Commentaries
di: Mkhallati, Hassan, et al.
Pubblicazione: (2023)
di: Mkhallati, Hassan, et al.
Pubblicazione: (2023)
A Two-Stage Progressive Pre-training using Multi-Modal Contrastive Masked Autoencoders
di: Jamal, Muhammad Abdullah, et al.
Pubblicazione: (2024)
di: Jamal, Muhammad Abdullah, et al.
Pubblicazione: (2024)
Breaking the Sub-Millimeter Barrier: Eyeframe Acquisition from Color Images
di: Guzmán, Manel, et al.
Pubblicazione: (2026)
di: Guzmán, Manel, et al.
Pubblicazione: (2026)
SoccerNet-Tracking: Multiple Object Tracking Dataset and Benchmark in Soccer Videos
di: Cioppa, Anthony, et al.
Pubblicazione: (2022)
di: Cioppa, Anthony, et al.
Pubblicazione: (2022)
Masked Autoencoder Self Pre-Training for Defect Detection in Microelectronics
di: Röhrich, Nikolai, et al.
Pubblicazione: (2025)
di: Röhrich, Nikolai, et al.
Pubblicazione: (2025)
Asymmetric Masked Distillation for Pre-Training Small Foundation Models
di: Zhao, Zhiyu, et al.
Pubblicazione: (2023)
di: Zhao, Zhiyu, et al.
Pubblicazione: (2023)
Do You Need Text Rectification? Soft Attention Mask Embedding for Rectification-Free Scene Text Spotting
di: Colombo, Antonio, et al.
Pubblicazione: (2026)
di: Colombo, Antonio, et al.
Pubblicazione: (2026)
Meteorological data and Sky Images meets Neural Models for Photovoltaic Power Forecasting
di: Montoya-Espinagosa, Ines, et al.
Pubblicazione: (2026)
di: Montoya-Espinagosa, Ines, et al.
Pubblicazione: (2026)
NeRFscopy: Neural Radiance Fields for in-vivo Time-Varying Tissues from Endoscopy
di: Salort-Benejam, Laura, et al.
Pubblicazione: (2026)
di: Salort-Benejam, Laura, et al.
Pubblicazione: (2026)
Robust Pre-Training of Medical Vision-and-Language Models with Domain-Invariant Multi-Modal Masked Reconstruction
di: Filvantorkaman, Melika, et al.
Pubblicazione: (2026)
di: Filvantorkaman, Melika, et al.
Pubblicazione: (2026)
BroadTrack: Broadcast Camera Tracking for Soccer
di: Magera, Floriane, et al.
Pubblicazione: (2024)
di: Magera, Floriane, et al.
Pubblicazione: (2024)
Decoder Pre-Training with only Text for Scene Text Recognition
di: Zhao, Shuai, et al.
Pubblicazione: (2024)
di: Zhao, Shuai, et al.
Pubblicazione: (2024)
Multi-Agent System for Comprehensive Soccer Understanding
di: Rao, Jiayuan, et al.
Pubblicazione: (2025)
di: Rao, Jiayuan, et al.
Pubblicazione: (2025)
MultiModal Action Conditioned Video Generation
di: Li, Yichen, et al.
Pubblicazione: (2025)
di: Li, Yichen, et al.
Pubblicazione: (2025)
MaskFuser: Masked Fusion of Joint Multi-Modal Tokenization for End-to-End Autonomous Driving
di: Duan, Yiqun, et al.
Pubblicazione: (2024)
di: Duan, Yiqun, et al.
Pubblicazione: (2024)
SoccerTrack v2: A Full-Pitch Multi-View Soccer Dataset for Game State Reconstruction
di: Scott, Atom, et al.
Pubblicazione: (2025)
di: Scott, Atom, et al.
Pubblicazione: (2025)
4DPV: 4D Pet from Videos by Coarse-to-Fine Non-Rigid Radiance Fields
di: de Paco, Sergio M., et al.
Pubblicazione: (2024)
di: de Paco, Sergio M., et al.
Pubblicazione: (2024)
Mask$^2$DiT: Dual Mask-based Diffusion Transformer for Multi-Scene Long Video Generation
di: Qi, Tianhao, et al.
Pubblicazione: (2025)
di: Qi, Tianhao, et al.
Pubblicazione: (2025)
Pre-Trained Masked Image Model for Mobile Robot Navigation
di: Sharma, Vishnu Dutt, et al.
Pubblicazione: (2023)
di: Sharma, Vishnu Dutt, et al.
Pubblicazione: (2023)
Audio-Visual Generalized Zero-Shot Learning using Pre-Trained Large Multi-Modal Models
di: Kurzendörfer, David, et al.
Pubblicazione: (2024)
di: Kurzendörfer, David, et al.
Pubblicazione: (2024)
SceneGraphLoc: Cross-Modal Coarse Visual Localization on 3D Scene Graphs
di: Miao, Yang, et al.
Pubblicazione: (2024)
di: Miao, Yang, et al.
Pubblicazione: (2024)
Probabilistic Deep Discriminant Analysis for Wind Blade Segmentation
di: Pérez-Gonzalo, Raül, et al.
Pubblicazione: (2026)
di: Pérez-Gonzalo, Raül, et al.
Pubblicazione: (2026)
Centered Masking for Language-Image Pre-Training
di: Liang, Mingliang, et al.
Pubblicazione: (2024)
di: Liang, Mingliang, et al.
Pubblicazione: (2024)
CrossOver: 3D Scene Cross-Modal Alignment
di: Sarkar, Sayan Deb, et al.
Pubblicazione: (2025)
di: Sarkar, Sayan Deb, et al.
Pubblicazione: (2025)
SoccerSynth-Detection: A Synthetic Dataset for Soccer Player Detection
di: Qin, Haobin, et al.
Pubblicazione: (2025)
di: Qin, Haobin, et al.
Pubblicazione: (2025)
SoccerNet 2025 Challenges Results
di: Giancola, Silvio, et al.
Pubblicazione: (2025)
di: Giancola, Silvio, et al.
Pubblicazione: (2025)
MMCLIP: Cross-modal Attention Masked Modelling for Medical Language-Image Pre-Training
di: Wu, Biao, et al.
Pubblicazione: (2024)
di: Wu, Biao, et al.
Pubblicazione: (2024)
Robust Multi-Modal Image Stitching for Improved Scene Understanding
di: Dutta, Aritra, et al.
Pubblicazione: (2023)
di: Dutta, Aritra, et al.
Pubblicazione: (2023)
Forging Spatial Intelligence: A Roadmap of Multi-Modal Data Pre-Training for Autonomous Systems
di: Wang, Song, et al.
Pubblicazione: (2025)
di: Wang, Song, et al.
Pubblicazione: (2025)
Unsupervised Video Domain Adaptation with Masked Pre-Training and Collaborative Self-Training
di: Reddy, Arun, et al.
Pubblicazione: (2023)
di: Reddy, Arun, et al.
Pubblicazione: (2023)
Multimodal Masked Autoencoder Pre-training for 3D MRI-Based Brain Tumor Analysis with Missing Modalities
di: Robinet, Lucas, et al.
Pubblicazione: (2025)
di: Robinet, Lucas, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Unified Uncertainty-Aware Diffusion for Multi-Agent Trajectory Modeling
di: Capellera, Guillem, et al.
Pubblicazione: (2025) -
FootBots: A Transformer-based Architecture for Motion Prediction in Soccer
di: Capellera, Guillem, et al.
Pubblicazione: (2024) -
Heteroscedastic Diffusion for Multi-Agent Trajectory Modeling
di: Capellera, Guillem, et al.
Pubblicazione: (2026) -
JointDiff: Bridging Continuous and Discrete in Multi-Agent Trajectory Generation
di: Capellera, Guillem, et al.
Pubblicazione: (2025) -
TranSPORTmer: A Holistic Approach to Trajectory Understanding in Multi-Agent Sports
di: Capellera, Guillem, et al.
Pubblicazione: (2024)