Leveraging Transformers for Weakly Supervised Object Localization in Unconstrained Videos
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Murtaza, Shakeeb, Pedersoli, Marco, Sarraf, Aydin, Granger, Eric |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Realistic Protocol for Evaluation of Weakly Supervised Object Localization
par: Murtaza, Shakeeb, et autres
Publié: (2024)
par: Murtaza, Shakeeb, et autres
Publié: (2024)
TeD-Loc: Text Distillation for Weakly Supervised Object Localization
par: Murtaza, Shakeeb, et autres
Publié: (2025)
par: Murtaza, Shakeeb, et autres
Publié: (2025)
CoLo-CAM: Class Activation Mapping for Object Co-Localization in Weakly-Labeled Unconstrained Videos
par: Belharbi, Soufiane, et autres
Publié: (2023)
par: Belharbi, Soufiane, et autres
Publié: (2023)
Source-Free Domain Adaptation of Weakly-Supervised Object Localization Models for Histology
par: Guichemerre, Alexis, et autres
Publié: (2024)
par: Guichemerre, Alexis, et autres
Publié: (2024)
Source-Free Domain Adaptation for YOLO Object Detection
par: Varailhon, Simon, et autres
Publié: (2024)
par: Varailhon, Simon, et autres
Publié: (2024)
Attention-based Class-Conditioned Alignment for Multi-Source Domain Adaptation of Object Detectors
par: Belal, Atif, et autres
Publié: (2024)
par: Belal, Atif, et autres
Publié: (2024)
Revisiting Mixout: An Overlooked Path to Robust Finetuning
par: Aminbeidokhti, Masih, et autres
Publié: (2025)
par: Aminbeidokhti, Masih, et autres
Publié: (2025)
Visual Modality Prompt for Adapting Vision-Language Object Detectors
par: Medeiros, Heitor R., et autres
Publié: (2024)
par: Medeiros, Heitor R., et autres
Publié: (2024)
LT-Soups: Bridging Head and Tail Classes via Subsampled Model Soups
par: Aminbeidokhti, Masih, et autres
Publié: (2025)
par: Aminbeidokhti, Masih, et autres
Publié: (2025)
Spatial Action Unit Cues for Interpretable Deep Facial Expression Recognition
par: Belharbi, Soufiane, et autres
Publié: (2024)
par: Belharbi, Soufiane, et autres
Publié: (2024)
High-Rate Mixout: Revisiting Mixout for Robust Domain Generalization
par: Aminbeidokhti, Masih, et autres
Publié: (2025)
par: Aminbeidokhti, Masih, et autres
Publié: (2025)
SR-CACO-2: A Dataset for Confocal Fluorescence Microscopy Image Super-Resolution
par: Belharbi, Soufiane, et autres
Publié: (2024)
par: Belharbi, Soufiane, et autres
Publié: (2024)
DART$^3$: Leveraging Distance for Test Time Adaptation in Person Re-Identification
par: Bhattacharya, Rajarshi, et autres
Publié: (2025)
par: Bhattacharya, Rajarshi, et autres
Publié: (2025)
Seeing What Shouldn't Be There: Counterfactual GANs for Medical Image Attribution
par: Murtaza, Shakeeb
Publié: (2026)
par: Murtaza, Shakeeb
Publié: (2026)
InterPartAbility: Text-Guided Part Matching for Interpretable Person Re-Identification
par: Murtaza, Shakeeb, et autres
Publié: (2026)
par: Murtaza, Shakeeb, et autres
Publié: (2026)
Deep Weakly-Supervised Domain Adaptation for Pain Localization in Videos
par: Praveen, R. Gnana, et autres
Publié: (2019)
par: Praveen, R. Gnana, et autres
Publié: (2019)
Domain Generalization by Rejecting Extreme Augmentations
par: Aminbeidokhti, Masih, et autres
Publié: (2023)
par: Aminbeidokhti, Masih, et autres
Publié: (2023)
BAH Dataset for Ambivalence/Hesitancy Recognition in Videos for Digital Behavioural Change
par: González-González, Manuela, et autres
Publié: (2025)
par: González-González, Manuela, et autres
Publié: (2025)
VLOD-TTA: Test-Time Adaptation of Vision-Language Object Detectors
par: Belal, Atif, et autres
Publié: (2025)
par: Belal, Atif, et autres
Publié: (2025)
MiPa: Mixed Patch Infrared-Visible Modality Agnostic Object Detection
par: Medeiros, Heitor R., et autres
Publié: (2024)
par: Medeiros, Heitor R., et autres
Publié: (2024)
Joint Multimodal Transformer for Emotion Recognition in the Wild
par: Waligora, Paul, et autres
Publié: (2024)
par: Waligora, Paul, et autres
Publié: (2024)
Weakly Supervised Object Segmentation by Background Conditional Divergence
par: Baker, Hassan, et autres
Publié: (2025)
par: Baker, Hassan, et autres
Publié: (2025)
Masked Multi-Query Slot Attention for Unsupervised Object Discovery
par: Pramanik, Rishav, et autres
Publié: (2024)
par: Pramanik, Rishav, et autres
Publié: (2024)
Infrared Object Detection with Ultra Small ConvNets: Is ImageNet Pretraining Still Useful?
par: Muralidharan, Srikanth, et autres
Publié: (2025)
par: Muralidharan, Srikanth, et autres
Publié: (2025)
Multimodal Ambivalence/Hesitancy Recognition in Videos for Personalized Digital Health Interventions
par: González-González, Manuela, et autres
Publié: (2026)
par: González-González, Manuela, et autres
Publié: (2026)
WiSE-OD: Benchmarking Robustness in Infrared Object Detection
par: Medeiros, Heitor R., et autres
Publié: (2025)
par: Medeiros, Heitor R., et autres
Publié: (2025)
Multi-Source Domain Adaptation for Object Detection with Prototype-based Mean-teacher
par: Belal, Atif, et autres
Publié: (2023)
par: Belal, Atif, et autres
Publié: (2023)
PASTA: Vision Transformer Patch Aggregation for Weakly Supervised Target and Anomaly Segmentation
par: Neubauer, Melanie, et autres
Publié: (2026)
par: Neubauer, Melanie, et autres
Publié: (2026)
Weakly Supervised Concept Learning for Object-centric Visual Reasoning
par: Tiwari, Sparsh, et autres
Publié: (2026)
par: Tiwari, Sparsh, et autres
Publié: (2026)
Multi Teacher Privileged Knowledge Distillation for Multimodal Expression Recognition
par: Aslam, Muhammad Haseeb, et autres
Publié: (2024)
par: Aslam, Muhammad Haseeb, et autres
Publié: (2024)
Weakly Supervised Object Detection in Chest X-Rays with Differentiable ROI Proposal Networks and Soft ROI Pooling
par: Müller, Philip, et autres
Publié: (2024)
par: Müller, Philip, et autres
Publié: (2024)
Memory Storyboard: Leveraging Temporal Segmentation for Streaming Self-Supervised Learning from Egocentric Videos
par: Yang, Yanlai, et autres
Publié: (2025)
par: Yang, Yanlai, et autres
Publié: (2025)
Test-Time Adaptation via Cache Personalization for Facial Expression Recognition in Videos
par: Sharafi, Masoumeh, et autres
Publié: (2026)
par: Sharafi, Masoumeh, et autres
Publié: (2026)
Do not trust what you trust: Miscalibration in Semi-supervised Learning
par: Mishra, Shambhavi, et autres
Publié: (2024)
par: Mishra, Shambhavi, et autres
Publié: (2024)
Weakly Supervised Learning for Facial Affective Behavior Analysis : A Review
par: Praveen, R. Gnana, et autres
Publié: (2021)
par: Praveen, R. Gnana, et autres
Publié: (2021)
Towards Stable Self-Supervised Object Representations in Unconstrained Egocentric Video
par: Tan, Yuting, et autres
Publié: (2026)
par: Tan, Yuting, et autres
Publié: (2026)
CLIP-AUTT: Test-Time Personalization with Action Unit Prompting for Fine-Grained Video Emotion Recognition
par: Zeeshan, Muhammad Osama, et autres
Publié: (2026)
par: Zeeshan, Muhammad Osama, et autres
Publié: (2026)
Weakly-Supervised Anomaly Detection in Surveillance Videos Based on Two-Stream I3D Convolution Network
par: Nejad, Sareh Soltani, et autres
Publié: (2024)
par: Nejad, Sareh Soltani, et autres
Publié: (2024)
RADLER: Radar Object Detection Leveraging Semantic 3D City Models and Self-Supervised Radar-Image Learning
par: Luo, Yuan, et autres
Publié: (2025)
par: Luo, Yuan, et autres
Publié: (2025)
Leveraging Self-Supervised Vision Transformers for Segmentation-based Transfer Function Design
par: Engel, Dominik, et autres
Publié: (2023)
par: Engel, Dominik, et autres
Publié: (2023)
Documents similaires
-
A Realistic Protocol for Evaluation of Weakly Supervised Object Localization
par: Murtaza, Shakeeb, et autres
Publié: (2024) -
TeD-Loc: Text Distillation for Weakly Supervised Object Localization
par: Murtaza, Shakeeb, et autres
Publié: (2025) -
CoLo-CAM: Class Activation Mapping for Object Co-Localization in Weakly-Labeled Unconstrained Videos
par: Belharbi, Soufiane, et autres
Publié: (2023) -
Source-Free Domain Adaptation of Weakly-Supervised Object Localization Models for Histology
par: Guichemerre, Alexis, et autres
Publié: (2024) -
Source-Free Domain Adaptation for YOLO Object Detection
par: Varailhon, Simon, et autres
Publié: (2024)