Online Reasoning Video Object Segmentation
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Jinyuan, Wang, Yang, Zhao, Zeyu, Li, Weixin, Wang, Song, Han, Ruize |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LV-OSD: Language-Vision-Complementary Open-Set Object Detection
por: Zhang, Yupeng, et al.
Publicado: (2026)
por: Zhang, Yupeng, et al.
Publicado: (2026)
VOVTrack: Exploring the Potentiality in Videos for Open-Vocabulary Object Tracking
por: Qian, Zekun, et al.
Publicado: (2024)
por: Qian, Zekun, et al.
Publicado: (2024)
OVT-B: A New Large-Scale Benchmark for Open-Vocabulary Multi-Object Tracking
por: Liang, Haiji, et al.
Publicado: (2024)
por: Liang, Haiji, et al.
Publicado: (2024)
Online Unsupervised Video Object Segmentation via Contrastive Motion Clustering
por: Xi, Lin, et al.
Publicado: (2023)
por: Xi, Lin, et al.
Publicado: (2023)
VideoSeg-R1:Reasoning Video Object Segmentation via Reinforcement Learning
por: Xu, Zishan, et al.
Publicado: (2025)
por: Xu, Zishan, et al.
Publicado: (2025)
Scalable Video Object Segmentation with Identification Mechanism
por: Yang, Zongxin, et al.
Publicado: (2022)
por: Yang, Zongxin, et al.
Publicado: (2022)
Synthetic-To-Real Video Person Re-ID
por: Zhang, Xiangqun, et al.
Publicado: (2024)
por: Zhang, Xiangqun, et al.
Publicado: (2024)
VFM$^{4}$SDG: Unveiling the Power of VFMs for Single-Domain Generalized Object Detection
por: Zhang, Yupeng, et al.
Publicado: (2026)
por: Zhang, Yupeng, et al.
Publicado: (2026)
From Indoor To Outdoor: Unsupervised Domain Adaptive Gait Recognition
por: Wang, Likai, et al.
Publicado: (2022)
por: Wang, Likai, et al.
Publicado: (2022)
LiVOS: Light Video Object Segmentation with Gated Linear Matching
por: Liu, Qin, et al.
Publicado: (2024)
por: Liu, Qin, et al.
Publicado: (2024)
SCRNet: Spatial-Channel Regulation Network for Medical Ultrasound Image Segmentation
por: Xu, Weixin, et al.
Publicado: (2025)
por: Xu, Weixin, et al.
Publicado: (2025)
OCTrack: Benchmarking the Open-Corpus Multi-Object Tracking
por: Qian, Zekun, et al.
Publicado: (2024)
por: Qian, Zekun, et al.
Publicado: (2024)
VISA: Reasoning Video Object Segmentation via Large Language Models
por: Yan, Cilin, et al.
Publicado: (2024)
por: Yan, Cilin, et al.
Publicado: (2024)
Training-Free Spatio-temporal Decoupled Reasoning Video Segmentation with Adaptive Object Memory
por: Zhu, Zhengtong, et al.
Publicado: (2026)
por: Zhu, Zhengtong, et al.
Publicado: (2026)
COVTrack++: Learning Open-Vocabulary Multi-Object Tracking from Continuous Videos via a Synergistic Paradigm
por: Qian, Zekun, et al.
Publicado: (2026)
por: Qian, Zekun, et al.
Publicado: (2026)
Unleashing the Temporal-Spatial Reasoning Capacity of GPT for Training-Free Audio and Language Referenced Video Object Segmentation
por: Huang, Shaofei, et al.
Publicado: (2024)
por: Huang, Shaofei, et al.
Publicado: (2024)
Online Pseudo-Label Unified Object Detection for Multiple Datasets Training
por: Tang, XiaoJun, et al.
Publicado: (2024)
por: Tang, XiaoJun, et al.
Publicado: (2024)
Robust Egocentric Referring Video Object Segmentation via Dual-Modal Causal Intervention
por: Liu, Haijing, et al.
Publicado: (2025)
por: Liu, Haijing, et al.
Publicado: (2025)
Temporal Prompting Matters: Rethinking Referring Video Object Segmentation
por: Lin, Ci-Siang, et al.
Publicado: (2025)
por: Lin, Ci-Siang, et al.
Publicado: (2025)
From a Bird's Eye View to See: Joint Camera and Subject Registration without the Camera Calibration
por: Qian, Zekun, et al.
Publicado: (2022)
por: Qian, Zekun, et al.
Publicado: (2022)
Video Demoireing using Focused-Defocused Dual-Camera System
por: Dong, Xuan, et al.
Publicado: (2025)
por: Dong, Xuan, et al.
Publicado: (2025)
Training-Free Robust Interactive Video Object Segmentation
por: Wei, Xiaoli, et al.
Publicado: (2024)
por: Wei, Xiaoli, et al.
Publicado: (2024)
ViLLa: Video Reasoning Segmentation with Large Language Model
por: Zheng, Rongkun, et al.
Publicado: (2024)
por: Zheng, Rongkun, et al.
Publicado: (2024)
Referring Video Object Segmentation with Cross-Modality Proxy Queries
por: Sun, Baoli, et al.
Publicado: (2025)
por: Sun, Baoli, et al.
Publicado: (2025)
Context Propagation from Proposals for Semantic Video Object Segmentation
por: Wang, Tinghuai
Publicado: (2024)
por: Wang, Tinghuai
Publicado: (2024)
EventRR: Event Referential Reasoning for Referring Video Object Segmentation
por: Xu, Huihui, et al.
Publicado: (2025)
por: Xu, Huihui, et al.
Publicado: (2025)
Un-EVIMO: Unsupervised Event-Based Independent Motion Segmentation
por: Wang, Ziyun, et al.
Publicado: (2023)
por: Wang, Ziyun, et al.
Publicado: (2023)
Event-assisted Low-Light Video Object Segmentation
por: Li, Hebei, et al.
Publicado: (2024)
por: Li, Hebei, et al.
Publicado: (2024)
Non-parametric Contextual Relationship Learning for Semantic Video Object Segmentation
por: Wang, Tinghuai, et al.
Publicado: (2024)
por: Wang, Tinghuai, et al.
Publicado: (2024)
Online Reasoning Video Segmentation with Just-in-Time Digital Twins
por: Shen, Yiqing, et al.
Publicado: (2025)
por: Shen, Yiqing, et al.
Publicado: (2025)
ArgusCogito: Chain-of-Thought for Cross-Modal Synergy and Omnidirectional Reasoning in Camouflaged Object Segmentation
por: Tan, Jianwen, et al.
Publicado: (2025)
por: Tan, Jianwen, et al.
Publicado: (2025)
BoxTuning: Directly Injecting the Object Box for Multimodal Model Fine-Tuning
por: Qian, Zekun, et al.
Publicado: (2026)
por: Qian, Zekun, et al.
Publicado: (2026)
AgentRVOS: Reasoning over Object Tracks for Zero-Shot Referring Video Object Segmentation
por: Jin, Woojeong, et al.
Publicado: (2026)
por: Jin, Woojeong, et al.
Publicado: (2026)
UW-VOS: A Large-Scale Dataset for Underwater Video Object Segmentation
por: Zhao, Hongshen, et al.
Publicado: (2026)
por: Zhao, Hongshen, et al.
Publicado: (2026)
Reasoning Segmentation for Images and Videos: A Survey
por: Shen, Yiqing, et al.
Publicado: (2025)
por: Shen, Yiqing, et al.
Publicado: (2025)
ODOV: Benchmark the Open-Domain Open-Vocabulary Object Detection
por: Zhang, Yupeng, et al.
Publicado: (2025)
por: Zhang, Yupeng, et al.
Publicado: (2025)
Segment Anything for Video: A Comprehensive Review of Video Object Segmentation and Tracking from Past to Future
por: Xu, Guoping, et al.
Publicado: (2025)
por: Xu, Guoping, et al.
Publicado: (2025)
GroPrompt: Efficient Grounded Prompting and Adaptation for Referring Video Object Segmentation
por: Lin, Ci-Siang, et al.
Publicado: (2024)
por: Lin, Ci-Siang, et al.
Publicado: (2024)
Depth-Driven Geometric Prompt Learning for Laparoscopic Liver Landmark Detection
por: Pei, Jialun, et al.
Publicado: (2024)
por: Pei, Jialun, et al.
Publicado: (2024)
NoOVD: Novel Category Discovery and Embedding for Open-Vocabulary Object Detection
por: Zhang, Yupeng, et al.
Publicado: (2026)
por: Zhang, Yupeng, et al.
Publicado: (2026)
Ejemplares similares
-
LV-OSD: Language-Vision-Complementary Open-Set Object Detection
por: Zhang, Yupeng, et al.
Publicado: (2026) -
VOVTrack: Exploring the Potentiality in Videos for Open-Vocabulary Object Tracking
por: Qian, Zekun, et al.
Publicado: (2024) -
OVT-B: A New Large-Scale Benchmark for Open-Vocabulary Multi-Object Tracking
por: Liang, Haiji, et al.
Publicado: (2024) -
Online Unsupervised Video Object Segmentation via Contrastive Motion Clustering
por: Xi, Lin, et al.
Publicado: (2023) -
VideoSeg-R1:Reasoning Video Object Segmentation via Reinforcement Learning
por: Xu, Zishan, et al.
Publicado: (2025)