OCTrack: Benchmarking the Open-Corpus Multi-Object Tracking
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qian, Zekun, Han, Ruize, Feng, Wei, Hou, Junhui, Song, Linqi, Wang, Song |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VOVTrack: Exploring the Potentiality in Videos for Open-Vocabulary Object Tracking
par: Qian, Zekun, et autres
Publié: (2024)
par: Qian, Zekun, et autres
Publié: (2024)
Unveiling the Power of Self-supervision for Multi-view Multi-human Association and Tracking
par: Feng, Wei, et autres
Publié: (2024)
par: Feng, Wei, et autres
Publié: (2024)
COVTrack++: Learning Open-Vocabulary Multi-Object Tracking from Continuous Videos via a Synergistic Paradigm
par: Qian, Zekun, et autres
Publié: (2026)
par: Qian, Zekun, et autres
Publié: (2026)
BoxTuning: Directly Injecting the Object Box for Multimodal Model Fine-Tuning
par: Qian, Zekun, et autres
Publié: (2026)
par: Qian, Zekun, et autres
Publié: (2026)
Synthetic-To-Real Video Person Re-ID
par: Zhang, Xiangqun, et autres
Publié: (2024)
par: Zhang, Xiangqun, et autres
Publié: (2024)
OVT-B: A New Large-Scale Benchmark for Open-Vocabulary Multi-Object Tracking
par: Liang, Haiji, et autres
Publié: (2024)
par: Liang, Haiji, et autres
Publié: (2024)
From a Bird's Eye View to See: Joint Camera and Subject Registration without the Camera Calibration
par: Qian, Zekun, et autres
Publié: (2022)
par: Qian, Zekun, et autres
Publié: (2022)
MITracker: Multi-View Integration for Visual Object Tracking
par: Xu, Mengjie, et autres
Publié: (2025)
par: Xu, Mengjie, et autres
Publié: (2025)
RTAT: A Robust Two-stage Association Tracker for Multi-Object Tracking
par: Guo, Song, et autres
Publié: (2024)
par: Guo, Song, et autres
Publié: (2024)
ODOV: Benchmark the Open-Domain Open-Vocabulary Object Detection
par: Zhang, Yupeng, et autres
Publié: (2025)
par: Zhang, Yupeng, et autres
Publié: (2025)
LV-OSD: Language-Vision-Complementary Open-Set Object Detection
par: Zhang, Yupeng, et autres
Publié: (2026)
par: Zhang, Yupeng, et autres
Publié: (2026)
MOSABench: Multi-Object Sentiment Analysis Benchmark for Evaluating Multimodal Large Language Models Understanding of Complex Image
par: Song, Shezheng, et autres
Publié: (2024)
par: Song, Shezheng, et autres
Publié: (2024)
Motion Estimation for Multi-Object Tracking using KalmanNet with Semantic-Independent Encoding
par: Song, Jian, et autres
Publié: (2025)
par: Song, Jian, et autres
Publié: (2025)
FastTrackTr:Towards Fast Multi-Object Tracking with Transformers
par: Liao, Pan, et autres
Publié: (2024)
par: Liao, Pan, et autres
Publié: (2024)
Uncertainty-Encoded Multi-Modal Fusion for Robust Object Detection in Autonomous Driving
par: Lou, Yang, et autres
Publié: (2023)
par: Lou, Yang, et autres
Publié: (2023)
Awesome Multi-modal Object Tracking
par: Zhang, Chunhui, et autres
Publié: (2024)
par: Zhang, Chunhui, et autres
Publié: (2024)
VERIFIED: A Video Corpus Moment Retrieval Benchmark for Fine-Grained Video Understanding
par: Chen, Houlun, et autres
Publié: (2024)
par: Chen, Houlun, et autres
Publié: (2024)
Is Contrastive Distillation Enough for Learning Comprehensive 3D Representations?
par: Zhang, Yifan, et autres
Publié: (2024)
par: Zhang, Yifan, et autres
Publié: (2024)
LLMTrack: Semantic Multi-Object Tracking with Multi-modal Large Language Models
par: Liao, Pan, et autres
Publié: (2026)
par: Liao, Pan, et autres
Publié: (2026)
Serial Over Parallel: Learning Continual Unification for Multi-Modal Visual Object Tracking and Benchmarking
par: Tang, Zhangyong, et autres
Publié: (2025)
par: Tang, Zhangyong, et autres
Publié: (2025)
Knowledge Amalgamation for Object Detection with Transformers
par: Zhang, Haofei, et autres
Publié: (2022)
par: Zhang, Haofei, et autres
Publié: (2022)
Enhancing Self-Supervised Fine-Grained Video Object Tracking with Dynamic Memory Prediction
par: Zhou, Zihan, et autres
Publié: (2025)
par: Zhou, Zihan, et autres
Publié: (2025)
UniSOT: A Unified Framework for Multi-Modality Single Object Tracking
par: Ma, Yinchao, et autres
Publié: (2025)
par: Ma, Yinchao, et autres
Publié: (2025)
Cross-View Referring Multi-Object Tracking
par: Chen, Sijia, et autres
Publié: (2024)
par: Chen, Sijia, et autres
Publié: (2024)
GRASPTrack: Geometry-Reasoned Association via Segmentation and Projection for Multi-Object Tracking
par: Han, Xudong, et autres
Publié: (2025)
par: Han, Xudong, et autres
Publié: (2025)
3D Shape Completion on Unseen Categories:A Weakly-supervised Approach
par: Wu, Lintai, et autres
Publié: (2024)
par: Wu, Lintai, et autres
Publié: (2024)
STORM: End-to-End Referring Multi-Object Tracking in Videos
par: Lu, Zijia, et autres
Publié: (2026)
par: Lu, Zijia, et autres
Publié: (2026)
Visual Object Tracking across Diverse Data Modalities: A Review
par: Wang, Mengmeng, et autres
Publié: (2024)
par: Wang, Mengmeng, et autres
Publié: (2024)
Event Stream-based Visual Object Tracking: HDETrack V2 and A High-Definition Benchmark
par: Wang, Shiao, et autres
Publié: (2025)
par: Wang, Shiao, et autres
Publié: (2025)
Self-Supervised Multi-Object Tracking with Path Consistency
par: Lu, Zijia, et autres
Publié: (2024)
par: Lu, Zijia, et autres
Publié: (2024)
MoPE-CLIP: Structured Pruning for Efficient Vision-Language Models with Module-wise Pruning Error Metric
par: Lin, Haokun, et autres
Publié: (2024)
par: Lin, Haokun, et autres
Publié: (2024)
MMReason: An Open-Ended Multi-Modal Multi-Step Reasoning Benchmark for MLLMs Toward AGI
par: Yao, Huanjin, et autres
Publié: (2025)
par: Yao, Huanjin, et autres
Publié: (2025)
FC-Track: Overlap-Aware Post-Association Correction for Online Multi-Object Tracking
par: Ju, Cheng, et autres
Publié: (2026)
par: Ju, Cheng, et autres
Publié: (2026)
Diffusion Image Generation with Explicit Modeling of Data Manifold Geometry
par: Xue, Duoduo, et autres
Publié: (2026)
par: Xue, Duoduo, et autres
Publié: (2026)
LEGO: Learning and Graph-Optimized Modular Tracker for Online Multi-Object Tracking with Point Clouds
par: Zhang, Zhenrong, et autres
Publié: (2023)
par: Zhang, Zhenrong, et autres
Publié: (2023)
WebUOT-1M: Advancing Deep Underwater Object Tracking with A Million-Scale Benchmark
par: Zhang, Chunhui, et autres
Publié: (2024)
par: Zhang, Chunhui, et autres
Publié: (2024)
MEX: Memory-efficient Approach to Referring Multi-Object Tracking
par: Tran, Huu-Thien, et autres
Publié: (2025)
par: Tran, Huu-Thien, et autres
Publié: (2025)
A Light-Weight Framework for Open-Set Object Detection with Decoupled Feature Alignment in Joint Space
par: He, Yonghao, et autres
Publié: (2024)
par: He, Yonghao, et autres
Publié: (2024)
Heterogeneous Graph Transformer for Multiple Tiny Object Tracking in RGB-T Videos
par: Xu, Qingyu, et autres
Publié: (2024)
par: Xu, Qingyu, et autres
Publié: (2024)
FireSentry: A Multi-Modal Spatio-temporal Benchmark Dataset for Fine-Grained Wildfire Spread Forecasting
par: Zhou, Nan, et autres
Publié: (2025)
par: Zhou, Nan, et autres
Publié: (2025)
Documents similaires
-
VOVTrack: Exploring the Potentiality in Videos for Open-Vocabulary Object Tracking
par: Qian, Zekun, et autres
Publié: (2024) -
Unveiling the Power of Self-supervision for Multi-view Multi-human Association and Tracking
par: Feng, Wei, et autres
Publié: (2024) -
COVTrack++: Learning Open-Vocabulary Multi-Object Tracking from Continuous Videos via a Synergistic Paradigm
par: Qian, Zekun, et autres
Publié: (2026) -
BoxTuning: Directly Injecting the Object Box for Multimodal Model Fine-Tuning
par: Qian, Zekun, et autres
Publié: (2026) -
Synthetic-To-Real Video Person Re-ID
par: Zhang, Xiangqun, et autres
Publié: (2024)