MPT: A Large-scale Multi-Phytoplankton Tracking Benchmark
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Yang, Li, Yuezun, Sun, Xin, Dong, Junyu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PhyTracker: An Online Tracker for Phytoplankton
par: Yu, Yang, et autres
Publié: (2024)
par: Yu, Yang, et autres
Publié: (2024)
MPT-PAR:Mix-Parameters Transformer for Panoramic Activity Recognition
par: Gan, Wenqing, et autres
Publié: (2024)
par: Gan, Wenqing, et autres
Publié: (2024)
An Open-Source Benchmark and Baseline for Multi-temporal Referring Segmentation
par: Li, Bingyu, et autres
Publié: (2026)
par: Li, Bingyu, et autres
Publié: (2026)
ForensicsForest Family: A Series of Multi-scale Hierarchical Cascade Forests for Detecting GAN-generated Faces
par: Lu, Jiucui, et autres
Publié: (2023)
par: Lu, Jiucui, et autres
Publié: (2023)
LLMTrack: Semantic Multi-Object Tracking with Multi-modal Large Language Models
par: Liao, Pan, et autres
Publié: (2026)
par: Liao, Pan, et autres
Publié: (2026)
All in One: Exploring Unified Vision-Language Tracking with Multi-Modal Alignment
par: Zhang, Chunhui, et autres
Publié: (2023)
par: Zhang, Chunhui, et autres
Publié: (2023)
NT-VOT211: A Large-Scale Benchmark for Night-time Visual Object Tracking
par: Liu, Yu, et autres
Publié: (2024)
par: Liu, Yu, et autres
Publié: (2024)
OCTrack: Benchmarking the Open-Corpus Multi-Object Tracking
par: Qian, Zekun, et autres
Publié: (2024)
par: Qian, Zekun, et autres
Publié: (2024)
Celeb-DF++: A Large-scale Challenging Video DeepFake Benchmark for Generalizable Forensics
par: Li, Yuezun, et autres
Publié: (2025)
par: Li, Yuezun, et autres
Publié: (2025)
VT-Bench: A Unified Benchmark for Visual-Tabular Multi-Modal Learning
par: Jia, Zi-Yi, et autres
Publié: (2026)
par: Jia, Zi-Yi, et autres
Publié: (2026)
CrowdTrack: A Benchmark for Difficult Multiple Pedestrian Tracking in Real Scenarios
par: Fu, Teng, et autres
Publié: (2025)
par: Fu, Teng, et autres
Publié: (2025)
FastTrackTr:Towards Fast Multi-Object Tracking with Transformers
par: Liao, Pan, et autres
Publié: (2024)
par: Liao, Pan, et autres
Publié: (2024)
A Large-scale Universal Evaluation Benchmark For Face Forgery Detection
par: Bei, Yijun, et autres
Publié: (2024)
par: Bei, Yijun, et autres
Publié: (2024)
Where the Devil Hides: Deepfake Detectors Can No Longer Be Trusted
par: Yuan, Shuaiwei, et autres
Publié: (2025)
par: Yuan, Shuaiwei, et autres
Publié: (2025)
UrBench: A Comprehensive Benchmark for Evaluating Large Multimodal Models in Multi-View Urban Scenarios
par: Zhou, Baichuan, et autres
Publié: (2024)
par: Zhou, Baichuan, et autres
Publié: (2024)
AgroVG: A Large-Scale Multi-Source Benchmark for Agricultural Visual Grounding
par: Li, Haocheng, et autres
Publié: (2026)
par: Li, Haocheng, et autres
Publié: (2026)
MDK12-Bench: A Multi-Discipline Benchmark for Evaluating Reasoning in Multimodal Large Language Models
par: Zhou, Pengfei, et autres
Publié: (2025)
par: Zhou, Pengfei, et autres
Publié: (2025)
EmbodiedBench: Comprehensive Benchmarking Multi-modal Large Language Models for Vision-Driven Embodied Agents
par: Yang, Rui, et autres
Publié: (2025)
par: Yang, Rui, et autres
Publié: (2025)
From Captions to Rewards (CAREVL): Leveraging Large Language Model Experts for Enhanced Reward Modeling in Large Vision-Language Models
par: Dai, Muzhi, et autres
Publié: (2025)
par: Dai, Muzhi, et autres
Publié: (2025)
RELO: Reinforcement Learning to Localize for Visual Object Tracking
par: Chen, Xin, et autres
Publié: (2026)
par: Chen, Xin, et autres
Publié: (2026)
A Large-scale Dataset for Robust Complex Anime Scene Text Detection
par: Dong, Ziyi, et autres
Publié: (2025)
par: Dong, Ziyi, et autres
Publié: (2025)
STAR: A First-Ever Dataset and A Large-Scale Benchmark for Scene Graph Generation in Large-Size Satellite Imagery
par: Li, Yansheng, et autres
Publié: (2024)
par: Li, Yansheng, et autres
Publié: (2024)
A Large-scale Medical Visual Task Adaptation Benchmark
par: Mo, Shentong, et autres
Publié: (2024)
par: Mo, Shentong, et autres
Publié: (2024)
RefBench-PRO: Perceptual and Reasoning Oriented Benchmark for Referring Expression Comprehension
par: Gao, Tianyi, et autres
Publié: (2025)
par: Gao, Tianyi, et autres
Publié: (2025)
Structure-aware World Model for Probe Guidance via Large-scale Self-supervised Pre-train
par: Jiang, Haojun, et autres
Publié: (2024)
par: Jiang, Haojun, et autres
Publié: (2024)
Weakly Supervised Camouflaged Object Detection Based on the SAM Model and Mask Guidance
par: Li, Xia, et autres
Publié: (2026)
par: Li, Xia, et autres
Publié: (2026)
Cross-View Referring Multi-Object Tracking
par: Chen, Sijia, et autres
Publié: (2024)
par: Chen, Sijia, et autres
Publié: (2024)
JMed48k: A Multi-Profession Japanese Medical Licensing Benchmark for Vision-Language Model Evaluation
par: Xun, Yue, et autres
Publié: (2026)
par: Xun, Yue, et autres
Publié: (2026)
DRMOT: A Dataset and Framework for RGBD Referring Multi-Object Tracking
par: Chen, Sijia, et autres
Publié: (2026)
par: Chen, Sijia, et autres
Publié: (2026)
Towards Fine-Grained Recognition with Large Visual Language Models: Benchmark and Optimization Strategies
par: Pang, Cong, et autres
Publié: (2025)
par: Pang, Cong, et autres
Publié: (2025)
UWStereo: A Large Synthetic Dataset for Underwater Stereo Matching
par: Lv, Qingxuan, et autres
Publié: (2024)
par: Lv, Qingxuan, et autres
Publié: (2024)
Serial Over Parallel: Learning Continual Unification for Multi-Modal Visual Object Tracking and Benchmarking
par: Tang, Zhangyong, et autres
Publié: (2025)
par: Tang, Zhangyong, et autres
Publié: (2025)
Hydra-Bench: A Benchmark for Multi-Modal Leaf Wetness Sensing
par: Liu, Yimeng, et autres
Publié: (2025)
par: Liu, Yimeng, et autres
Publié: (2025)
PASSION: Towards Effective Incomplete Multi-Modal Medical Image Segmentation with Imbalanced Missing Rates
par: Shi, Junjie, et autres
Publié: (2024)
par: Shi, Junjie, et autres
Publié: (2024)
SurgBench: A Unified Large-Scale Benchmark for Surgical Video Analysis
par: Wei, Jianhui, et autres
Publié: (2025)
par: Wei, Jianhui, et autres
Publié: (2025)
EVC-MF: End-to-end Video Captioning Network with Multi-scale Features
par: Niu, Tian-Zi, et autres
Publié: (2024)
par: Niu, Tian-Zi, et autres
Publié: (2024)
LithoBench: Benchmarking Large Multimodal Models for Remote-Sensing Lithology Interpretation
par: Wang, Jun, et autres
Publié: (2026)
par: Wang, Jun, et autres
Publié: (2026)
Awesome Multi-modal Object Tracking
par: Zhang, Chunhui, et autres
Publié: (2024)
par: Zhang, Chunhui, et autres
Publié: (2024)
A Large-Scale Multimodal Dataset and Benchmarks for Human Activity Scene Understanding and Reasoning
par: Jiang, Siyang, et autres
Publié: (2025)
par: Jiang, Siyang, et autres
Publié: (2025)
OMIBench: Benchmarking Olympiad-Level Multi-Image Reasoning in Large Vision-Language Model
par: Chen, Qiguang, et autres
Publié: (2026)
par: Chen, Qiguang, et autres
Publié: (2026)
Documents similaires
-
PhyTracker: An Online Tracker for Phytoplankton
par: Yu, Yang, et autres
Publié: (2024) -
MPT-PAR:Mix-Parameters Transformer for Panoramic Activity Recognition
par: Gan, Wenqing, et autres
Publié: (2024) -
An Open-Source Benchmark and Baseline for Multi-temporal Referring Segmentation
par: Li, Bingyu, et autres
Publié: (2026) -
ForensicsForest Family: A Series of Multi-scale Hierarchical Cascade Forests for Detecting GAN-generated Faces
par: Lu, Jiucui, et autres
Publié: (2023) -
LLMTrack: Semantic Multi-Object Tracking with Multi-modal Large Language Models
par: Liao, Pan, et autres
Publié: (2026)