Temporal Embeddings: Scalable Self-Supervised Temporal Representation Learning from Spatiotemporal Data for Multimodal Computer Vision
Fuente:
arXiv
Salvato in:
| Autori principali: | Cao, Yi, Ganguli, Swetava, Pandey, Vipul |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
S4-Driver: Scalable Self-Supervised Driving Multimodal Large Language Modelwith Spatio-Temporal Visual Representation
di: Xie, Yichen, et al.
Pubblicazione: (2025)
di: Xie, Yichen, et al.
Pubblicazione: (2025)
Multitask Multimodal Self-Supervised Learning for Medical Images
di: Simionescu, Cristian
Pubblicazione: (2025)
di: Simionescu, Cristian
Pubblicazione: (2025)
LeJEPA: Provable and Scalable Self-Supervised Learning Without the Heuristics
di: Balestriero, Randall, et al.
Pubblicazione: (2025)
di: Balestriero, Randall, et al.
Pubblicazione: (2025)
TEOChat: A Large Vision-Language Assistant for Temporal Earth Observation Data
di: Irvin, Jeremy Andrew, et al.
Pubblicazione: (2024)
di: Irvin, Jeremy Andrew, et al.
Pubblicazione: (2024)
A Survey of the Self Supervised Learning Mechanisms for Vision Transformers
di: Khan, Asifullah, et al.
Pubblicazione: (2024)
di: Khan, Asifullah, et al.
Pubblicazione: (2024)
On Pretraining Data Diversity for Self-Supervised Learning
di: Hammoud, Hasan Abed Al Kader, et al.
Pubblicazione: (2024)
di: Hammoud, Hasan Abed Al Kader, et al.
Pubblicazione: (2024)
On the Temporality for Sketch Representation Learning
di: Junior, Marcelo Isaias de Moraes, et al.
Pubblicazione: (2025)
di: Junior, Marcelo Isaias de Moraes, et al.
Pubblicazione: (2025)
GenMM: Geometrically and Temporally Consistent Multimodal Data Generation for Video and LiDAR
di: Singh, Bharat, et al.
Pubblicazione: (2024)
di: Singh, Bharat, et al.
Pubblicazione: (2024)
Action-Agnostic Point-Level Supervision for Temporal Action Detection
di: Yoshida, Shuhei M., et al.
Pubblicazione: (2024)
di: Yoshida, Shuhei M., et al.
Pubblicazione: (2024)
SENSE: Self-Supervised Neural Embeddings for Spatial Ensembles
di: Gadirov, Hamid, et al.
Pubblicazione: (2025)
di: Gadirov, Hamid, et al.
Pubblicazione: (2025)
Temporal-consistent CAMs for Weakly Supervised Video Segmentation in Waste Sorting
di: Marelli, Andrea, et al.
Pubblicazione: (2025)
di: Marelli, Andrea, et al.
Pubblicazione: (2025)
Context-Aware Temporal Embedding of Objects in Video Data
di: Farhan, Ahnaf, et al.
Pubblicazione: (2024)
di: Farhan, Ahnaf, et al.
Pubblicazione: (2024)
Uncertainties of Latent Representations in Computer Vision
di: Kirchhof, Michael
Pubblicazione: (2024)
di: Kirchhof, Michael
Pubblicazione: (2024)
Joint Embedding vs Reconstruction: Provable Benefits of Latent Space Prediction for Self Supervised Learning
di: Van Assel, Hugues, et al.
Pubblicazione: (2025)
di: Van Assel, Hugues, et al.
Pubblicazione: (2025)
Towards Scalable SOAP Note Generation: A Weakly Supervised Multimodal Framework
di: Kamal, Sadia, et al.
Pubblicazione: (2025)
di: Kamal, Sadia, et al.
Pubblicazione: (2025)
When Multi-Task Learning Meets Partial Supervision: A Computer Vision Review
di: Fontana, Maxime, et al.
Pubblicazione: (2023)
di: Fontana, Maxime, et al.
Pubblicazione: (2023)
Exploring Scalability of Self-Training for Open-Vocabulary Temporal Action Localization
di: Hyun, Jeongseok, et al.
Pubblicazione: (2024)
di: Hyun, Jeongseok, et al.
Pubblicazione: (2024)
Self-Supervised Anomaly Detection in the Wild: Favor Joint Embeddings Methods
di: Otero, Daniel, et al.
Pubblicazione: (2024)
di: Otero, Daniel, et al.
Pubblicazione: (2024)
The Temporal Trap: Entanglement in Pre-Trained Visual Representations for Visuomotor Policy Learning
di: Tsagkas, Nikolaos, et al.
Pubblicazione: (2025)
di: Tsagkas, Nikolaos, et al.
Pubblicazione: (2025)
TemporalBench: Benchmarking Fine-grained Temporal Understanding for Multimodal Video Models
di: Cai, Mu, et al.
Pubblicazione: (2024)
di: Cai, Mu, et al.
Pubblicazione: (2024)
Learning Relative Representations for Fine-Grained Multimodal Alignment with Limited Data
di: Kim, Shiwon, et al.
Pubblicazione: (2026)
di: Kim, Shiwon, et al.
Pubblicazione: (2026)
Dataset Distillation for Pre-Trained Self-Supervised Vision Models
di: Cazenavette, George, et al.
Pubblicazione: (2025)
di: Cazenavette, George, et al.
Pubblicazione: (2025)
Joint Self-Supervised and Supervised Contrastive Learning for Multimodal MRI Data: Towards Predicting Abnormal Neurodevelopment
di: Li, Zhiyuan, et al.
Pubblicazione: (2023)
di: Li, Zhiyuan, et al.
Pubblicazione: (2023)
Handling Spatial-Temporal Data Heterogeneity for Federated Continual Learning via Tail Anchor
di: Yu, Hao, et al.
Pubblicazione: (2024)
di: Yu, Hao, et al.
Pubblicazione: (2024)
Automatic Data Curation for Self-Supervised Learning: A Clustering-Based Approach
di: Vo, Huy V., et al.
Pubblicazione: (2024)
di: Vo, Huy V., et al.
Pubblicazione: (2024)
Temporally-Aware Supervised Contrastive Learning for Polyp Counting in Colonoscopy
di: Parolari, Luca, et al.
Pubblicazione: (2025)
di: Parolari, Luca, et al.
Pubblicazione: (2025)
Unified Supervision For Vision-Language Modeling in 3D Computed Tomography
di: Lee, Hao-Chih, et al.
Pubblicazione: (2025)
di: Lee, Hao-Chih, et al.
Pubblicazione: (2025)
MOON Embedding: Multimodal Representation Learning for E-commerce Search Advertising
di: Fu, Chenghan, et al.
Pubblicazione: (2025)
di: Fu, Chenghan, et al.
Pubblicazione: (2025)
Blockwise Self-Supervised Learning at Scale
di: Siddiqui, Shoaib Ahmed, et al.
Pubblicazione: (2023)
di: Siddiqui, Shoaib Ahmed, et al.
Pubblicazione: (2023)
On Background Bias of Post-Hoc Concept Embeddings in Computer Vision DNNs
di: Schwalbe, Gesina, et al.
Pubblicazione: (2025)
di: Schwalbe, Gesina, et al.
Pubblicazione: (2025)
Self-Supervised Learning of Color Constancy
di: Ernst, Markus R., et al.
Pubblicazione: (2024)
di: Ernst, Markus R., et al.
Pubblicazione: (2024)
Deploying Self-Supervised Learning for Real Seismic Data Denoising
di: Arboleda, Giovanny A. M., et al.
Pubblicazione: (2026)
di: Arboleda, Giovanny A. M., et al.
Pubblicazione: (2026)
Ditch the Denoiser: Emergence of Noise Robustness in Self-Supervised Learning from Data Curriculum
di: Lu, Wenquan, et al.
Pubblicazione: (2025)
di: Lu, Wenquan, et al.
Pubblicazione: (2025)
Can We Break Free from Strong Data Augmentations in Self-Supervised Learning?
di: Gowda, Shruthi, et al.
Pubblicazione: (2024)
di: Gowda, Shruthi, et al.
Pubblicazione: (2024)
Gramian Multimodal Representation Learning and Alignment
di: Cicchetti, Giordano, et al.
Pubblicazione: (2024)
di: Cicchetti, Giordano, et al.
Pubblicazione: (2024)
RayDer: Scalable Self-Supervised Novel View Synthesis from Real-World Video
di: Prestel, Ulrich, et al.
Pubblicazione: (2026)
di: Prestel, Ulrich, et al.
Pubblicazione: (2026)
Emergent Visual Grounding in Large Multimodal Models Without Grounding Supervision
di: Cao, Shengcao, et al.
Pubblicazione: (2024)
di: Cao, Shengcao, et al.
Pubblicazione: (2024)
Self-Supervised Disentanglement by Leveraging Structure in Data Augmentations
di: Eastwood, Cian, et al.
Pubblicazione: (2023)
di: Eastwood, Cian, et al.
Pubblicazione: (2023)
Using Self-Supervised Auxiliary Tasks to Improve Fine-Grained Facial Representation
di: Pourmirzaei, Mahdi, et al.
Pubblicazione: (2021)
di: Pourmirzaei, Mahdi, et al.
Pubblicazione: (2021)
EUDA: An Efficient Unsupervised Domain Adaptation via Self-Supervised Vision Transformer
di: Abedi, Ali, et al.
Pubblicazione: (2024)
di: Abedi, Ali, et al.
Pubblicazione: (2024)
Documenti analoghi
-
S4-Driver: Scalable Self-Supervised Driving Multimodal Large Language Modelwith Spatio-Temporal Visual Representation
di: Xie, Yichen, et al.
Pubblicazione: (2025) -
Multitask Multimodal Self-Supervised Learning for Medical Images
di: Simionescu, Cristian
Pubblicazione: (2025) -
LeJEPA: Provable and Scalable Self-Supervised Learning Without the Heuristics
di: Balestriero, Randall, et al.
Pubblicazione: (2025) -
TEOChat: A Large Vision-Language Assistant for Temporal Earth Observation Data
di: Irvin, Jeremy Andrew, et al.
Pubblicazione: (2024) -
A Survey of the Self Supervised Learning Mechanisms for Vision Transformers
di: Khan, Asifullah, et al.
Pubblicazione: (2024)