Self-supervised Learning on Camera Trap Footage Yields a Strong Universal Face Embedder
Fuente:
arXiv
Salvato in:
| Autori principali: | Iashin, Vladimir, Lee, Horace, Schofield, Dan, Zisserman, Andrew |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Self-Supervised Learning for Identifying Defects in Sewer Footage
di: Otero, Daniel, et al.
Pubblicazione: (2024)
di: Otero, Daniel, et al.
Pubblicazione: (2024)
Federated Learning for Face Recognition via Intra-subject Self-supervised Learning
di: Kim, Hansol, et al.
Pubblicazione: (2024)
di: Kim, Hansol, et al.
Pubblicazione: (2024)
Synchformer: Efficient Synchronization from Sparse Cues
di: Iashin, Vladimir, et al.
Pubblicazione: (2024)
di: Iashin, Vladimir, et al.
Pubblicazione: (2024)
Visual Timelines of Police Encounters in Body-Worn Camera Footage: Operational Context and Activity Cataloging for Training and Analysis in OpenBWC
di: Srbinovska, Angela, et al.
Pubblicazione: (2026)
di: Srbinovska, Angela, et al.
Pubblicazione: (2026)
VIRTUE: Visual-Interactive Text-Image Universal Embedder
di: Wang, Wei-Yao, et al.
Pubblicazione: (2025)
di: Wang, Wei-Yao, et al.
Pubblicazione: (2025)
Self-supervised Transformation Learning for Equivariant Representations
di: Yu, Jaemyung, et al.
Pubblicazione: (2025)
di: Yu, Jaemyung, et al.
Pubblicazione: (2025)
Towards AI-Driven Policing: Interdisciplinary Knowledge Discovery from Police Body-Worn Camera Footage
di: Srbinovska, Anita, et al.
Pubblicazione: (2025)
di: Srbinovska, Anita, et al.
Pubblicazione: (2025)
OVR: A Dataset for Open Vocabulary Temporal Repetition Counting in Videos
di: Dwibedi, Debidatta, et al.
Pubblicazione: (2024)
di: Dwibedi, Debidatta, et al.
Pubblicazione: (2024)
LAFS: Landmark-based Facial Self-supervised Learning for Face Recognition
di: Sun, Zhonglin, et al.
Pubblicazione: (2024)
di: Sun, Zhonglin, et al.
Pubblicazione: (2024)
Self-supervised Learning for Hyperspectral Images of Trees
di: Rahman, Moqsadur, et al.
Pubblicazione: (2025)
di: Rahman, Moqsadur, et al.
Pubblicazione: (2025)
SST: Self-training with Self-adaptive Thresholding for Semi-supervised Learning
di: Zhao, Shuai, et al.
Pubblicazione: (2025)
di: Zhao, Shuai, et al.
Pubblicazione: (2025)
Open-World Object Counting in Videos
di: Amini-Naieni, Niki, et al.
Pubblicazione: (2025)
di: Amini-Naieni, Niki, et al.
Pubblicazione: (2025)
A Short Note on Evaluating RepNet for Temporal Repetition Counting in Videos
di: Dwibedi, Debidatta, et al.
Pubblicazione: (2024)
di: Dwibedi, Debidatta, et al.
Pubblicazione: (2024)
E3: Ensemble of Expert Embedders for Adapting Synthetic Image Detectors to New Generators Using Limited Data
di: Azizpour, Aref, et al.
Pubblicazione: (2024)
di: Azizpour, Aref, et al.
Pubblicazione: (2024)
The SA-FARI Dataset: Segment Anything in Footage of Animals for Recognition and Identification
di: Wasmuht, Dante Francisco, et al.
Pubblicazione: (2025)
di: Wasmuht, Dante Francisco, et al.
Pubblicazione: (2025)
Camera Movement Classification in Historical Footage: A Comparative Study of Deep Video Models
di: Lin, Tingyu, et al.
Pubblicazione: (2025)
di: Lin, Tingyu, et al.
Pubblicazione: (2025)
New keypoint-based approach for recognising British Sign Language (BSL) from sequences
di: Deb, Oishi, et al.
Pubblicazione: (2024)
di: Deb, Oishi, et al.
Pubblicazione: (2024)
mEOL: Training-Free Instruction-Guided Multimodal Embedder for Vector Graphics and Image Retrieval
di: Kim, Kyeong Seon, et al.
Pubblicazione: (2026)
di: Kim, Kyeong Seon, et al.
Pubblicazione: (2026)
MOCA: Self-supervised Representation Learning by Predicting Masked Online Codebook Assignments
di: Gidaris, Spyros, et al.
Pubblicazione: (2023)
di: Gidaris, Spyros, et al.
Pubblicazione: (2023)
Feature Hallucination for Self-supervised Action Recognition
di: Wang, Lei, et al.
Pubblicazione: (2025)
di: Wang, Lei, et al.
Pubblicazione: (2025)
Self-supervised Pre-training of Text Recognizers
di: Kišš, Martin, et al.
Pubblicazione: (2024)
di: Kišš, Martin, et al.
Pubblicazione: (2024)
3D-Aware Instance Segmentation and Tracking in Egocentric Videos
di: Bhalgat, Yash, et al.
Pubblicazione: (2024)
di: Bhalgat, Yash, et al.
Pubblicazione: (2024)
Wildlife Target Re-Identification Using Self-supervised Learning in Non-Urban Settings
di: Muthivhi, Mufhumudzi, et al.
Pubblicazione: (2025)
di: Muthivhi, Mufhumudzi, et al.
Pubblicazione: (2025)
A Simple and Effective Temporal Grounding Pipeline for Basketball Broadcast Footage
di: Harris, Levi
Pubblicazione: (2024)
di: Harris, Levi
Pubblicazione: (2024)
Understanding the Role of Equivariance in Self-supervised Learning
di: Wang, Yifei, et al.
Pubblicazione: (2024)
di: Wang, Yifei, et al.
Pubblicazione: (2024)
N2F2: Hierarchical Scene Understanding with Nested Neural Feature Fields
di: Bhalgat, Yash, et al.
Pubblicazione: (2024)
di: Bhalgat, Yash, et al.
Pubblicazione: (2024)
Imperative Learning: A Self-supervised Neuro-Symbolic Learning Framework for Robot Autonomy
di: Wang, Chen, et al.
Pubblicazione: (2024)
di: Wang, Chen, et al.
Pubblicazione: (2024)
Can We Break Free from Strong Data Augmentations in Self-Supervised Learning?
di: Gowda, Shruthi, et al.
Pubblicazione: (2024)
di: Gowda, Shruthi, et al.
Pubblicazione: (2024)
FlexCap: Describe Anything in Images in Controllable Detail
di: Dwibedi, Debidatta, et al.
Pubblicazione: (2024)
di: Dwibedi, Debidatta, et al.
Pubblicazione: (2024)
Masked Face Recognition with Generative-to-Discriminative Representations
di: Ge, Shiming, et al.
Pubblicazione: (2024)
di: Ge, Shiming, et al.
Pubblicazione: (2024)
TAPVid-3D: A Benchmark for Tracking Any Point in 3D
di: Koppula, Skanda, et al.
Pubblicazione: (2024)
di: Koppula, Skanda, et al.
Pubblicazione: (2024)
Exploring the Camera Bias of Person Re-identification
di: Song, Myungseo, et al.
Pubblicazione: (2025)
di: Song, Myungseo, et al.
Pubblicazione: (2025)
Made to Order: Discovering monotonic temporal changes via self-supervised video ordering
di: Yang, Charig, et al.
Pubblicazione: (2024)
di: Yang, Charig, et al.
Pubblicazione: (2024)
Video Face Re-Aging: Toward Temporally Consistent Face Re-Aging
di: Muqeet, Abdul, et al.
Pubblicazione: (2023)
di: Muqeet, Abdul, et al.
Pubblicazione: (2023)
Learning to Control Camera Exposure via Reinforcement Learning
di: Lee, Kyunghyun, et al.
Pubblicazione: (2024)
di: Lee, Kyunghyun, et al.
Pubblicazione: (2024)
Towards Multimodal Open-Set Domain Generalization and Adaptation through Self-supervision
di: Dong, Hao, et al.
Pubblicazione: (2024)
di: Dong, Hao, et al.
Pubblicazione: (2024)
Self-supervised video pretraining yields robust and more human-aligned visual representations
di: Parthasarathy, Nikhil, et al.
Pubblicazione: (2022)
di: Parthasarathy, Nikhil, et al.
Pubblicazione: (2022)
HiT-JEPA: A Hierarchical Self-supervised Trajectory Embedding Framework for Similarity Computation
di: Li, Lihuan, et al.
Pubblicazione: (2025)
di: Li, Lihuan, et al.
Pubblicazione: (2025)
Evaluating Image-Based Face and Eye Tracking with Event Cameras
di: Iddrisu, Khadija, et al.
Pubblicazione: (2024)
di: Iddrisu, Khadija, et al.
Pubblicazione: (2024)
CARL: Camera-Agnostic Representation Learning for Spectral Image Analysis
di: Baumann, Alexander, et al.
Pubblicazione: (2025)
di: Baumann, Alexander, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Self-Supervised Learning for Identifying Defects in Sewer Footage
di: Otero, Daniel, et al.
Pubblicazione: (2024) -
Federated Learning for Face Recognition via Intra-subject Self-supervised Learning
di: Kim, Hansol, et al.
Pubblicazione: (2024) -
Synchformer: Efficient Synchronization from Sparse Cues
di: Iashin, Vladimir, et al.
Pubblicazione: (2024) -
Visual Timelines of Police Encounters in Body-Worn Camera Footage: Operational Context and Activity Cataloging for Training and Analysis in OpenBWC
di: Srbinovska, Angela, et al.
Pubblicazione: (2026) -
VIRTUE: Visual-Interactive Text-Image Universal Embedder
di: Wang, Wei-Yao, et al.
Pubblicazione: (2025)