Beyond Appearance: Geometric Cues for Robust Video Instance Segmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | Niu, Quanzhu, Zhou, Yikang, Chen, Shihao, Zhang, Tao, Ji, Shunping |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SaSaSaSa2VA: 2nd Place of the 5th PVUW MeViS-Text Track
di: Gong, Dengxian, et al.
Pubblicazione: (2026)
di: Gong, Dengxian, et al.
Pubblicazione: (2026)
The 1st Solution for 7th LSVOS RVOS Track: SaSaSa2VA
di: Niu, Quanzhu, et al.
Pubblicazione: (2025)
di: Niu, Quanzhu, et al.
Pubblicazione: (2025)
DVIS-DAQ: Improving Video Segmentation via Dynamic Anchor Queries
di: Zhou, Yikang, et al.
Pubblicazione: (2024)
di: Zhou, Yikang, et al.
Pubblicazione: (2024)
A Novel Shape Guided Transformer Network for Instance Segmentation in Remote Sensing Images
di: Yu, Dawen, et al.
Pubblicazione: (2024)
di: Yu, Dawen, et al.
Pubblicazione: (2024)
VISAGE: Video Instance Segmentation with Appearance-Guided Enhancement
di: Kim, Hanjung, et al.
Pubblicazione: (2023)
di: Kim, Hanjung, et al.
Pubblicazione: (2023)
Dense360: Dense Understanding from Omnidirectional Panoramas
di: Zhou, Yikang, et al.
Pubblicazione: (2025)
di: Zhou, Yikang, et al.
Pubblicazione: (2025)
P2PFormer: A Primitive-to-polygon Method for Regular Building Contour Extraction from Remote Sensing Images
di: Zhang, Tao, et al.
Pubblicazione: (2024)
di: Zhang, Tao, et al.
Pubblicazione: (2024)
Are They the Same? Exploring Visual Correspondence Shortcomings of Multimodal LLMs
di: Zhou, Yikang, et al.
Pubblicazione: (2025)
di: Zhou, Yikang, et al.
Pubblicazione: (2025)
VectorLLM: Human-like Extraction of Structured Building Contours vis Multimodal LLMs
di: Zhang, Tao, et al.
Pubblicazione: (2025)
di: Zhang, Tao, et al.
Pubblicazione: (2025)
Instance Brownian Bridge as Texts for Open-vocabulary Video Instance Segmentation
di: Cheng, Zesen, et al.
Pubblicazione: (2024)
di: Cheng, Zesen, et al.
Pubblicazione: (2024)
DeH4R: A Decoupled and Hybrid Method for Road Network Graph Extraction
di: Gong, Dengxian, et al.
Pubblicazione: (2025)
di: Gong, Dengxian, et al.
Pubblicazione: (2025)
Point Tracking as a Temporal Cue for Robust Myocardial Segmentation in Echocardiography Videos
di: Khodabakhshian, Bahar, et al.
Pubblicazione: (2026)
di: Khodabakhshian, Bahar, et al.
Pubblicazione: (2026)
SimTxtSeg: Weakly-Supervised Medical Image Segmentation with Simple Text Cues
di: Xie, Yuxin, et al.
Pubblicazione: (2024)
di: Xie, Yuxin, et al.
Pubblicazione: (2024)
Learning Appearance and Motion Cues for Panoptic Tracking
di: Hurtado, Juana Valeria, et al.
Pubblicazione: (2025)
di: Hurtado, Juana Valeria, et al.
Pubblicazione: (2025)
Beyond Visual Cues: Leveraging General Semantics as Support for Few-Shot Segmentation
di: Wang, Jin, et al.
Pubblicazione: (2025)
di: Wang, Jin, et al.
Pubblicazione: (2025)
Pixel-SAIL: Single Transformer For Pixel-Grounded Understanding
di: Zhang, Tao, et al.
Pubblicazione: (2025)
di: Zhang, Tao, et al.
Pubblicazione: (2025)
OpenVIS: Open-vocabulary Video Instance Segmentation
di: Guo, Pinxue, et al.
Pubblicazione: (2023)
di: Guo, Pinxue, et al.
Pubblicazione: (2023)
InstanceGaussian: Appearance-Semantic Joint Gaussian Representation for 3D Instance-Level Perception
di: Li, Haijie, et al.
Pubblicazione: (2024)
di: Li, Haijie, et al.
Pubblicazione: (2024)
Learning Motion and Temporal Cues for Unsupervised Video Object Segmentation
di: Zhuge, Yunzhi, et al.
Pubblicazione: (2025)
di: Zhuge, Yunzhi, et al.
Pubblicazione: (2025)
SyncVIS: Synchronized Video Instance Segmentation
di: Zheng, Rongkun, et al.
Pubblicazione: (2024)
di: Zheng, Rongkun, et al.
Pubblicazione: (2024)
A Temporal Modeling Framework for Video Pre-Training on Video Instance Segmentation
di: Zhong, Qing, et al.
Pubblicazione: (2025)
di: Zhong, Qing, et al.
Pubblicazione: (2025)
LSVOS 2025 Challenge Report: Recent Advances in Complex Video Object Segmentation
di: Liu, Chang, et al.
Pubblicazione: (2025)
di: Liu, Chang, et al.
Pubblicazione: (2025)
UVIS: Unsupervised Video Instance Segmentation
di: Huang, Shuaiyi, et al.
Pubblicazione: (2024)
di: Huang, Shuaiyi, et al.
Pubblicazione: (2024)
Unseen Object Reasoning with Shared Appearance Cues
di: Singh, Paridhi, et al.
Pubblicazione: (2024)
di: Singh, Paridhi, et al.
Pubblicazione: (2024)
Instance-Aware Robust Consistency Regularization for Semi-Supervised Nuclei Instance Segmentation
di: Lin, Zenan, et al.
Pubblicazione: (2025)
di: Lin, Zenan, et al.
Pubblicazione: (2025)
Self-supervised Video Instance Segmentation Can Boost Geographic Entity Alignment in Historical Maps
di: Xia, Xue, et al.
Pubblicazione: (2024)
di: Xia, Xue, et al.
Pubblicazione: (2024)
Integrating Language-Derived Appearance Elements with Visual Cues in Pedestrian Detection
di: Park, Sungjune, et al.
Pubblicazione: (2023)
di: Park, Sungjune, et al.
Pubblicazione: (2023)
Local2Global query Alignment for Video Instance Segmentation
di: Koner, Rajat, et al.
Pubblicazione: (2025)
di: Koner, Rajat, et al.
Pubblicazione: (2025)
CAVIS: Context-Aware Video Instance Segmentation
di: Lee, Seunghun, et al.
Pubblicazione: (2024)
di: Lee, Seunghun, et al.
Pubblicazione: (2024)
DAM-VSR: Disentanglement of Appearance and Motion for Video Super-Resolution
di: Kong, Zhe, et al.
Pubblicazione: (2025)
di: Kong, Zhe, et al.
Pubblicazione: (2025)
SDI-Paste: Synthetic Dynamic Instance Copy-Paste for Video Instance Segmentation
di: Shrestha, Sahir, et al.
Pubblicazione: (2024)
di: Shrestha, Sahir, et al.
Pubblicazione: (2024)
The Four Color Theorem for Cell Instance Segmentation
di: Zhang, Ye, et al.
Pubblicazione: (2025)
di: Zhang, Ye, et al.
Pubblicazione: (2025)
Unified Embedding Alignment for Open-Vocabulary Video Instance Segmentation
di: Fang, Hao, et al.
Pubblicazione: (2024)
di: Fang, Hao, et al.
Pubblicazione: (2024)
InstanceV: Instance-Level Video Generation
di: Chen, Yuheng, et al.
Pubblicazione: (2025)
di: Chen, Yuheng, et al.
Pubblicazione: (2025)
Opt3DGS: Optimizing 3D Gaussian Splatting with Adaptive Exploration and Curvature-Aware Exploitation
di: Huang, Ziyang, et al.
Pubblicazione: (2025)
di: Huang, Ziyang, et al.
Pubblicazione: (2025)
VRR-QA: Visual Relational Reasoning in Videos Beyond Explicit Cues
di: Swetha, Sirnam, et al.
Pubblicazione: (2025)
di: Swetha, Sirnam, et al.
Pubblicazione: (2025)
Depth-Guided Semi-Supervised Instance Segmentation
di: Chen, Xin, et al.
Pubblicazione: (2024)
di: Chen, Xin, et al.
Pubblicazione: (2024)
What is Point Supervision Worth in Video Instance Segmentation?
di: Huang, Shuaiyi, et al.
Pubblicazione: (2024)
di: Huang, Shuaiyi, et al.
Pubblicazione: (2024)
3D Gaussian Splatting for Large-scale Surface Reconstruction from Aerial Images
di: Wu, YuanZheng, et al.
Pubblicazione: (2024)
di: Wu, YuanZheng, et al.
Pubblicazione: (2024)
Tracking the Unstable: Appearance-Guided Motion Modeling for Robust Multi-Object Tracking in UAV-Captured Videos
di: Ma, Jianbo, et al.
Pubblicazione: (2025)
di: Ma, Jianbo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SaSaSaSa2VA: 2nd Place of the 5th PVUW MeViS-Text Track
di: Gong, Dengxian, et al.
Pubblicazione: (2026) -
The 1st Solution for 7th LSVOS RVOS Track: SaSaSa2VA
di: Niu, Quanzhu, et al.
Pubblicazione: (2025) -
DVIS-DAQ: Improving Video Segmentation via Dynamic Anchor Queries
di: Zhou, Yikang, et al.
Pubblicazione: (2024) -
A Novel Shape Guided Transformer Network for Instance Segmentation in Remote Sensing Images
di: Yu, Dawen, et al.
Pubblicazione: (2024) -
VISAGE: Video Instance Segmentation with Appearance-Guided Enhancement
di: Kim, Hanjung, et al.
Pubblicazione: (2023)