MOD-UV: Learning Mobile Object Detectors from Unlabeled Videos
Fuente:
arXiv
Salvato in:
| Autori principali: | Sun, Yihong, Hariharan, Bharath |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Tracking and Understanding Object Transformations
di: Sun, Yihong, et al.
Pubblicazione: (2025)
di: Sun, Yihong, et al.
Pubblicazione: (2025)
Live Interactive Training for Video Segmentation
di: Yang, Xinyu, et al.
Pubblicazione: (2026)
di: Yang, Xinyu, et al.
Pubblicazione: (2026)
Video Creation by Demonstration
di: Sun, Yihong, et al.
Pubblicazione: (2024)
di: Sun, Yihong, et al.
Pubblicazione: (2024)
Learning Feature Descriptors using Camera Pose Supervision
di: Wang, Qianqian, et al.
Pubblicazione: (2020)
di: Wang, Qianqian, et al.
Pubblicazione: (2020)
MovieRecapsQA: A Multimodal Open-Ended Video Question-Answering Benchmark
di: Shaar, Shaden, et al.
Pubblicazione: (2026)
di: Shaar, Shaden, et al.
Pubblicazione: (2026)
Composing People Together: Iterative Pose-Image Generation for Multi-Person Interaction Scenes
di: Peng, Wenxuan, et al.
Pubblicazione: (2026)
di: Peng, Wenxuan, et al.
Pubblicazione: (2026)
VideoWorld: Exploring Knowledge Learning from Unlabeled Videos
di: Ren, Zhongwei, et al.
Pubblicazione: (2025)
di: Ren, Zhongwei, et al.
Pubblicazione: (2025)
Learning 3D Perception from Others' Predictions
di: Yoo, Jinsu, et al.
Pubblicazione: (2024)
di: Yoo, Jinsu, et al.
Pubblicazione: (2024)
ObjectCarver: Semi-automatic segmentation, reconstruction and separation of 3D objects
di: Hassena, Gemmechu, et al.
Pubblicazione: (2024)
di: Hassena, Gemmechu, et al.
Pubblicazione: (2024)
MOD-CL: Multi-label Object Detection with Constrained Loss
di: Moriyama, Sota, et al.
Pubblicazione: (2024)
di: Moriyama, Sota, et al.
Pubblicazione: (2024)
Ponymation: Learning Articulated 3D Animal Motions from Unlabeled Online Videos
di: Sun, Keqiang, et al.
Pubblicazione: (2023)
di: Sun, Keqiang, et al.
Pubblicazione: (2023)
Pre-Training LiDAR-Based 3D Object Detectors Through Colorization
di: Pan, Tai-Yu, et al.
Pubblicazione: (2023)
di: Pan, Tai-Yu, et al.
Pubblicazione: (2023)
Lost and Found: Overcoming Detector Failures in Online Multi-Object Tracking
di: Vaquero, Lorenzo, et al.
Pubblicazione: (2024)
di: Vaquero, Lorenzo, et al.
Pubblicazione: (2024)
C3Po: Cross-View Cross-Modality Correspondence by Pointmap Prediction
di: Huang, Kuan Wei, et al.
Pubblicazione: (2025)
di: Huang, Kuan Wei, et al.
Pubblicazione: (2025)
KFC-W: Generating 3D-Consistent Videos from Unposed Internet Photos
di: Chou, Gene, et al.
Pubblicazione: (2024)
di: Chou, Gene, et al.
Pubblicazione: (2024)
Better Monocular 3D Detectors with LiDAR from the Past
di: You, Yurong, et al.
Pubblicazione: (2024)
di: You, Yurong, et al.
Pubblicazione: (2024)
Sports Re-ID: Improving Re-Identification Of Players In Broadcast Videos Of Team Sports
di: Comandur, Bharath
Pubblicazione: (2022)
di: Comandur, Bharath
Pubblicazione: (2022)
Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos
di: Majumder, Sagnik, et al.
Pubblicazione: (2024)
di: Majumder, Sagnik, et al.
Pubblicazione: (2024)
Color Bind: Exploring Color Perception in Text-to-Image Models
di: Shomer-Chai, Shay, et al.
Pubblicazione: (2025)
di: Shomer-Chai, Shay, et al.
Pubblicazione: (2025)
FlashDepth: Real-time Streaming Video Depth Estimation at 2K Resolution
di: Chou, Gene, et al.
Pubblicazione: (2025)
di: Chou, Gene, et al.
Pubblicazione: (2025)
xMOD: Cross-Modal Distillation for 2D/3D Multi-Object Discovery from 2D motion
di: Lahlali, Saad, et al.
Pubblicazione: (2025)
di: Lahlali, Saad, et al.
Pubblicazione: (2025)
Vid-Morp: Video Moment Retrieval Pretraining from Unlabeled Videos in the Wild
di: Bao, Peijun, et al.
Pubblicazione: (2024)
di: Bao, Peijun, et al.
Pubblicazione: (2024)
On the Feasibility and Opportunity of Autoregressive 3D Object Detection
di: Huang, Zanming, et al.
Pubblicazione: (2026)
di: Huang, Zanming, et al.
Pubblicazione: (2026)
Scale-Aware Recognition in Satellite Images under Resource Constraints
di: Revankar, Shreelekha, et al.
Pubblicazione: (2024)
di: Revankar, Shreelekha, et al.
Pubblicazione: (2024)
MONITRS: Multimodal Observations of Natural Incidents Through Remote Sensing
di: Revankar, Shreelekha, et al.
Pubblicazione: (2025)
di: Revankar, Shreelekha, et al.
Pubblicazione: (2025)
SOOD++: Leveraging Unlabeled Data to Boost Oriented Object Detection
di: Liang, Dingkang, et al.
Pubblicazione: (2024)
di: Liang, Dingkang, et al.
Pubblicazione: (2024)
Adaptive Pseudo Label Selection for Individual Unlabeled Data by Positive and Unlabeled Learning
di: Yamane, Takehiro, et al.
Pubblicazione: (2025)
di: Yamane, Takehiro, et al.
Pubblicazione: (2025)
CityRAG: Stepping Into a City via Spatially-Grounded Video Generation
di: Chou, Gene, et al.
Pubblicazione: (2026)
di: Chou, Gene, et al.
Pubblicazione: (2026)
$Δ$ynamics: Language-Based Representation for Inferring Rigid-Body Dynamics From Videos
di: Kao, Chia-Hsiang, et al.
Pubblicazione: (2026)
di: Kao, Chia-Hsiang, et al.
Pubblicazione: (2026)
Advancing Human Action Recognition with Foundation Models trained on Unlabeled Public Videos
di: Qian, Yang, et al.
Pubblicazione: (2024)
di: Qian, Yang, et al.
Pubblicazione: (2024)
Fine-Tuning Video-Text Contrastive Model for Primate Behavior Retrieval from Unlabeled Raw Videos
di: Santo, Giulio Cesare Mastrocinque, et al.
Pubblicazione: (2025)
di: Santo, Giulio Cesare Mastrocinque, et al.
Pubblicazione: (2025)
DiSciPLE: Learning Interpretable Programs for Scientific Visual Discovery
di: Mall, Utkarsh, et al.
Pubblicazione: (2025)
di: Mall, Utkarsh, et al.
Pubblicazione: (2025)
Towards Unstructured Unlabeled Optical Mocap: A Video Helps!
di: Milef, Nicholas, et al.
Pubblicazione: (2024)
di: Milef, Nicholas, et al.
Pubblicazione: (2024)
Task Integration Distillation for Object Detectors
di: Su, Hai, et al.
Pubblicazione: (2024)
di: Su, Hai, et al.
Pubblicazione: (2024)
DiffuBox: Refining 3D Object Detection with Point Diffusion
di: Chen, Xiangyu, et al.
Pubblicazione: (2024)
di: Chen, Xiangyu, et al.
Pubblicazione: (2024)
Automatic Retrieval of Specific Cows from Unlabeled Videos
di: Lyu, Jiawen, et al.
Pubblicazione: (2025)
di: Lyu, Jiawen, et al.
Pubblicazione: (2025)
On Calibration of Object Detectors: Pitfalls, Evaluation and Baselines
di: Kuzucu, Selim, et al.
Pubblicazione: (2024)
di: Kuzucu, Selim, et al.
Pubblicazione: (2024)
Domain Adaptation for Large-Vocabulary Object Detectors
di: Jiang, Kai, et al.
Pubblicazione: (2024)
di: Jiang, Kai, et al.
Pubblicazione: (2024)
Calibrating Probabilistic Object Detectors with Annotator Disagreement
di: Tan, Zhi Qin, et al.
Pubblicazione: (2026)
di: Tan, Zhi Qin, et al.
Pubblicazione: (2026)
DiffMOD: Progressive Diffusion Point Denoising for Moving Object Detection in Remote Sensing
di: Zhang, Jinyue, et al.
Pubblicazione: (2025)
di: Zhang, Jinyue, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Tracking and Understanding Object Transformations
di: Sun, Yihong, et al.
Pubblicazione: (2025) -
Live Interactive Training for Video Segmentation
di: Yang, Xinyu, et al.
Pubblicazione: (2026) -
Video Creation by Demonstration
di: Sun, Yihong, et al.
Pubblicazione: (2024) -
Learning Feature Descriptors using Camera Pose Supervision
di: Wang, Qianqian, et al.
Pubblicazione: (2020) -
MovieRecapsQA: A Multimodal Open-Ended Video Question-Answering Benchmark
di: Shaar, Shaden, et al.
Pubblicazione: (2026)