FILS: Self-Supervised Video Feature Prediction In Semantic Language Space
Fuente:
arXiv
Salvato in:
| Autori principali: | Ahmadian, Mona, Guerin, Frank, Gilbert, Andrew |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DEL: Dense Event Localization for Multi-modal Audio-Visual Understanding
di: Ahmadian, Mona, et al.
Pubblicazione: (2025)
di: Ahmadian, Mona, et al.
Pubblicazione: (2025)
Joint Embedding vs Reconstruction: Provable Benefits of Latent Space Prediction for Self Supervised Learning
di: Van Assel, Hugues, et al.
Pubblicazione: (2025)
di: Van Assel, Hugues, et al.
Pubblicazione: (2025)
Subimage Overlap Prediction: Task-Aligned Self-Supervised Pretraining For Semantic Segmentation In Remote Sensing Imagery
di: Sharma, Lakshay, et al.
Pubblicazione: (2026)
di: Sharma, Lakshay, et al.
Pubblicazione: (2026)
Interpretable Action Recognition on Hard to Classify Actions
di: Anichenko, Anastasia, et al.
Pubblicazione: (2024)
di: Anichenko, Anastasia, et al.
Pubblicazione: (2024)
From Semantic To Instance: A Semi-Self-Supervised Learning Approach
di: Najafian, Keyhan, et al.
Pubblicazione: (2025)
di: Najafian, Keyhan, et al.
Pubblicazione: (2025)
V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning
di: Assran, Mido, et al.
Pubblicazione: (2025)
di: Assran, Mido, et al.
Pubblicazione: (2025)
Multi-Modal Video Feature Extraction for Popularity Prediction
di: Liu, Haixu, et al.
Pubblicazione: (2025)
di: Liu, Haixu, et al.
Pubblicazione: (2025)
Temporal Test-Time Adaptation with State-Space Models
di: Schirmer, Mona, et al.
Pubblicazione: (2024)
di: Schirmer, Mona, et al.
Pubblicazione: (2024)
Revisiting Feature Prediction for Learning Visual Representations from Video
di: Bardes, Adrien, et al.
Pubblicazione: (2024)
di: Bardes, Adrien, et al.
Pubblicazione: (2024)
Visual Lexicon: Rich Image Features in Language Space
di: Wang, XuDong, et al.
Pubblicazione: (2024)
di: Wang, XuDong, et al.
Pubblicazione: (2024)
VESSA: Video-based objEct-centric Self-Supervised Adaptation for Visual Foundation Models
di: Barreto, Jesimon, et al.
Pubblicazione: (2025)
di: Barreto, Jesimon, et al.
Pubblicazione: (2025)
RayDer: Scalable Self-Supervised Novel View Synthesis from Real-World Video
di: Prestel, Ulrich, et al.
Pubblicazione: (2026)
di: Prestel, Ulrich, et al.
Pubblicazione: (2026)
Self-Supervised Bootstrapping of Action-Predictive Embodied Reasoning
di: Ganai, Milan, et al.
Pubblicazione: (2026)
di: Ganai, Milan, et al.
Pubblicazione: (2026)
ConformalSAM: Unlocking the Potential of Foundational Segmentation Models in Semi-Supervised Semantic Segmentation with Conformal Prediction
di: Chen, Danhui, et al.
Pubblicazione: (2025)
di: Chen, Danhui, et al.
Pubblicazione: (2025)
Programmatic Video Prediction Using Large Language Models
di: Tang, Hao, et al.
Pubblicazione: (2025)
di: Tang, Hao, et al.
Pubblicazione: (2025)
A Self-Supervised Framework for Improved Generalisability in Ultrasound B-mode Image Segmentation
di: Ellis, Edward, et al.
Pubblicazione: (2025)
di: Ellis, Edward, et al.
Pubblicazione: (2025)
Integration of Self-Supervised BYOL in Semi-Supervised Medical Image Recognition
di: Feng, Hao, et al.
Pubblicazione: (2024)
di: Feng, Hao, et al.
Pubblicazione: (2024)
Self-Supervised Learning of Color Constancy
di: Ernst, Markus R., et al.
Pubblicazione: (2024)
di: Ernst, Markus R., et al.
Pubblicazione: (2024)
Blockwise Self-Supervised Learning at Scale
di: Siddiqui, Shoaib Ahmed, et al.
Pubblicazione: (2023)
di: Siddiqui, Shoaib Ahmed, et al.
Pubblicazione: (2023)
Learning Semantic Segmentation with Query Points Supervision on Aerial Images
di: Rivier, Santiago, et al.
Pubblicazione: (2023)
di: Rivier, Santiago, et al.
Pubblicazione: (2023)
ε-Seg: Sparsely Supervised Semantic Segmentation of Microscopy Data
di: Kordasiabi, Sheida Rahnamai, et al.
Pubblicazione: (2025)
di: Kordasiabi, Sheida Rahnamai, et al.
Pubblicazione: (2025)
MotionMatcher: Motion Customization of Text-to-Video Diffusion Models via Motion Feature Matching
di: Wu, Yen-Siang, et al.
Pubblicazione: (2025)
di: Wu, Yen-Siang, et al.
Pubblicazione: (2025)
On Pretraining Data Diversity for Self-Supervised Learning
di: Hammoud, Hasan Abed Al Kader, et al.
Pubblicazione: (2024)
di: Hammoud, Hasan Abed Al Kader, et al.
Pubblicazione: (2024)
Rethinking The Uniformity Metric in Self-Supervised Learning
di: Fang, Xianghong, et al.
Pubblicazione: (2024)
di: Fang, Xianghong, et al.
Pubblicazione: (2024)
Self-Supervised Quantization-Aware Knowledge Distillation
di: Zhao, Kaiqi, et al.
Pubblicazione: (2024)
di: Zhao, Kaiqi, et al.
Pubblicazione: (2024)
Matrix Information Theory for Self-Supervised Learning
di: Zhang, Yifan, et al.
Pubblicazione: (2023)
di: Zhang, Yifan, et al.
Pubblicazione: (2023)
Prompt-Driven Feature Diffusion for Open-World Semi-Supervised Learning
di: Heidari, Marzi, et al.
Pubblicazione: (2024)
di: Heidari, Marzi, et al.
Pubblicazione: (2024)
HASSOD: Hierarchical Adaptive Self-Supervised Object Detection
di: Cao, Shengcao, et al.
Pubblicazione: (2024)
di: Cao, Shengcao, et al.
Pubblicazione: (2024)
Self-Supervised Learning for Identifying Defects in Sewer Footage
di: Otero, Daniel, et al.
Pubblicazione: (2024)
di: Otero, Daniel, et al.
Pubblicazione: (2024)
LDReg: Local Dimensionality Regularized Self-Supervised Learning
di: Huang, Hanxun, et al.
Pubblicazione: (2024)
di: Huang, Hanxun, et al.
Pubblicazione: (2024)
Self-Supervised Multi-Frame Neural Scene Flow
di: Liu, Dongrui, et al.
Pubblicazione: (2024)
di: Liu, Dongrui, et al.
Pubblicazione: (2024)
True Self-Supervised Novel View Synthesis is Transferable
di: Mitchel, Thomas W., et al.
Pubblicazione: (2025)
di: Mitchel, Thomas W., et al.
Pubblicazione: (2025)
Self-Supervised Disentanglement by Leveraging Structure in Data Augmentations
di: Eastwood, Cian, et al.
Pubblicazione: (2023)
di: Eastwood, Cian, et al.
Pubblicazione: (2023)
SENSE: Self-Supervised Neural Embeddings for Spatial Ensembles
di: Gadirov, Hamid, et al.
Pubblicazione: (2025)
di: Gadirov, Hamid, et al.
Pubblicazione: (2025)
Multitask Multimodal Self-Supervised Learning for Medical Images
di: Simionescu, Cristian
Pubblicazione: (2025)
di: Simionescu, Cristian
Pubblicazione: (2025)
TA-Prompting: Enhancing Video Large Language Models for Dense Video Captioning via Temporal Anchors
di: Cheng, Wei-Yuan, et al.
Pubblicazione: (2026)
di: Cheng, Wei-Yuan, et al.
Pubblicazione: (2026)
A Survey of the Self Supervised Learning Mechanisms for Vision Transformers
di: Khan, Asifullah, et al.
Pubblicazione: (2024)
di: Khan, Asifullah, et al.
Pubblicazione: (2024)
An Empirical Study into Clustering of Unseen Datasets with Self-Supervised Encoders
di: Lowe, Scott C., et al.
Pubblicazione: (2024)
di: Lowe, Scott C., et al.
Pubblicazione: (2024)
On Partial Prototype Collapse in the DINO Family of Self-Supervised Methods
di: Govindarajan, Hariprasath, et al.
Pubblicazione: (2024)
di: Govindarajan, Hariprasath, et al.
Pubblicazione: (2024)
Temporal-consistent CAMs for Weakly Supervised Video Segmentation in Waste Sorting
di: Marelli, Andrea, et al.
Pubblicazione: (2025)
di: Marelli, Andrea, et al.
Pubblicazione: (2025)
Documenti analoghi
-
DEL: Dense Event Localization for Multi-modal Audio-Visual Understanding
di: Ahmadian, Mona, et al.
Pubblicazione: (2025) -
Joint Embedding vs Reconstruction: Provable Benefits of Latent Space Prediction for Self Supervised Learning
di: Van Assel, Hugues, et al.
Pubblicazione: (2025) -
Subimage Overlap Prediction: Task-Aligned Self-Supervised Pretraining For Semantic Segmentation In Remote Sensing Imagery
di: Sharma, Lakshay, et al.
Pubblicazione: (2026) -
Interpretable Action Recognition on Hard to Classify Actions
di: Anichenko, Anastasia, et al.
Pubblicazione: (2024) -
From Semantic To Instance: A Semi-Self-Supervised Learning Approach
di: Najafian, Keyhan, et al.
Pubblicazione: (2025)