M$^3$-VOS: Multi-Phase, Multi-Transition, and Multi-Scenery Video Object Segmentation
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Zixuan, Li, Jiaxin, Tan, Liming, Guo, Yejie, Liang, Junxuan, Lu, Cewu, Li, Yong-Lu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
From Category to Scenery: An End-to-End Framework for Multi-Person Human-Object Interaction Recognition in Videos
por: Qiao, Tanqiu, et al.
Publicado: (2024)
por: Qiao, Tanqiu, et al.
Publicado: (2024)
ClickVOS: Click Video Object Segmentation
por: Guo, Pinxue, et al.
Publicado: (2024)
por: Guo, Pinxue, et al.
Publicado: (2024)
Homogeneous Dynamics Space for Heterogeneous Humans
por: Liu, Xinpeng, et al.
Publicado: (2024)
por: Liu, Xinpeng, et al.
Publicado: (2024)
OneVOS: Unifying Video Object Segmentation with All-in-One Transformer Framework
por: Li, Wanyun, et al.
Publicado: (2024)
por: Li, Wanyun, et al.
Publicado: (2024)
Point-VOS: Pointing Up Video Object Segmentation
por: Zulfikar, Idil Esen, et al.
Publicado: (2024)
por: Zulfikar, Idil Esen, et al.
Publicado: (2024)
ActionVOS: Actions as Prompts for Video Object Segmentation
por: Ouyang, Liangyang, et al.
Publicado: (2024)
por: Ouyang, Liangyang, et al.
Publicado: (2024)
ImDy: Human Inverse Dynamics from Imitated Observations
por: Liu, Xinpeng, et al.
Publicado: (2024)
por: Liu, Xinpeng, et al.
Publicado: (2024)
LiVOS: Light Video Object Segmentation with Gated Linear Matching
por: Liu, Qin, et al.
Publicado: (2024)
por: Liu, Qin, et al.
Publicado: (2024)
Video Object Segmentation via SAM 2: The 4th Solution for LSVOS Challenge VOS Track
por: Pan, Feiyu, et al.
Publicado: (2024)
por: Pan, Feiyu, et al.
Publicado: (2024)
Spatial-Temporal Multi-level Association for Video Object Segmentation
por: Miao, Deshui, et al.
Publicado: (2024)
por: Miao, Deshui, et al.
Publicado: (2024)
Adaptive Multi-source Predictor for Zero-shot Video Object Segmentation
por: Zhao, Xiaoqi, et al.
Publicado: (2023)
por: Zhao, Xiaoqi, et al.
Publicado: (2023)
Multi-Granularity Video Object Segmentation
por: Lim, Sangbeom, et al.
Publicado: (2024)
por: Lim, Sangbeom, et al.
Publicado: (2024)
X-Prompt: Multi-modal Visual Prompt for Video Object Segmentation
por: Guo, Pinxue, et al.
Publicado: (2024)
por: Guo, Pinxue, et al.
Publicado: (2024)
MUVOD: A Novel Multi-view Video Object Segmentation Dataset and A Benchmark for 3D Segmentation
por: Wei, Bangning, et al.
Publicado: (2025)
por: Wei, Bangning, et al.
Publicado: (2025)
DeVOS: Flow-Guided Deformable Transformer for Video Object Segmentation
por: Fedynyak, Volodymyr, et al.
Publicado: (2024)
por: Fedynyak, Volodymyr, et al.
Publicado: (2024)
The Labyrinth of Links: Navigating the Associative Maze of Multi-modal LLMs
por: Li, Hong, et al.
Publicado: (2024)
por: Li, Hong, et al.
Publicado: (2024)
Dancing with Still Images: Video Distillation via Static-Dynamic Disentanglement
por: Wang, Ziyu, et al.
Publicado: (2023)
por: Wang, Ziyu, et al.
Publicado: (2023)
M4-SAR: A Multi-Resolution, Multi-Polarization, Multi-Scene, Multi-Source Dataset and Benchmark for optical-SAR Object Detection
por: Wang, Chao, et al.
Publicado: (2025)
por: Wang, Chao, et al.
Publicado: (2025)
UW-VOS: A Large-Scale Dataset for Underwater Video Object Segmentation
por: Zhao, Hongshen, et al.
Publicado: (2026)
por: Zhao, Hongshen, et al.
Publicado: (2026)
MAVIN: Multi-Action Video Generation with Diffusion Models via Transition Video Infilling
por: Zhang, Bowen, et al.
Publicado: (2024)
por: Zhang, Bowen, et al.
Publicado: (2024)
Efficient Temporal Sentence Grounding in Videos with Multi-Teacher Knowledge Distillation
por: Liang, Renjie, et al.
Publicado: (2023)
por: Liang, Renjie, et al.
Publicado: (2023)
M^3Detection: Multi-Frame Multi-Level Feature Fusion for Multi-Modal 3D Object Detection with Camera and 4D Imaging Radar
por: Li, Xiaozhi, et al.
Publicado: (2025)
por: Li, Xiaozhi, et al.
Publicado: (2025)
VideoSeg-R1:Reasoning Video Object Segmentation via Reinforcement Learning
por: Xu, Zishan, et al.
Publicado: (2025)
por: Xu, Zishan, et al.
Publicado: (2025)
iTACO: Interactable Digital Twins of Articulated Objects from Casually Captured RGBD Videos
por: Peng, Weikun, et al.
Publicado: (2025)
por: Peng, Weikun, et al.
Publicado: (2025)
Physically Ground Commonsense Knowledge for Articulated Object Manipulation with Analytic Concepts
por: Wei, Jiude, et al.
Publicado: (2025)
por: Wei, Jiude, et al.
Publicado: (2025)
Optimized Unet with Attention Mechanism for Multi-Scale Semantic Segmentation
por: Li, Xuan, et al.
Publicado: (2025)
por: Li, Xuan, et al.
Publicado: (2025)
Efficient and Scalable Monocular Human-Object Interaction Motion Reconstruction
por: Wen, Boran, et al.
Publicado: (2025)
por: Wen, Boran, et al.
Publicado: (2025)
STORM: End-to-End Referring Multi-Object Tracking in Videos
por: Lu, Zijia, et al.
Publicado: (2026)
por: Lu, Zijia, et al.
Publicado: (2026)
Multi-Context Temporal Consistent Modeling for Referring Video Object Segmentation
por: Choi, Sun-Hyuk, et al.
Publicado: (2025)
por: Choi, Sun-Hyuk, et al.
Publicado: (2025)
IPFormer-VideoLLM: Enhancing Multi-modal Video Understanding for Multi-shot Scenes
por: Liang, Yujia, et al.
Publicado: (2025)
por: Liang, Yujia, et al.
Publicado: (2025)
Discovering Conceptual Knowledge with Analytic Ontology Templates for Articulated Objects
por: Sun, Jianhua, et al.
Publicado: (2024)
por: Sun, Jianhua, et al.
Publicado: (2024)
Refer-Agent: A Collaborative Multi-Agent System with Reasoning and Reflection for Referring Video Object Segmentation
por: Jiang, Haichao, et al.
Publicado: (2026)
por: Jiang, Haichao, et al.
Publicado: (2026)
MUSDA: Multi-source Multi-modality Unsupervised Domain Adaptive 3D Object Detection for Autonomous Driving
por: Lu, Xiaohu, et al.
Publicado: (2026)
por: Lu, Xiaohu, et al.
Publicado: (2026)
MOSIV: Multi-Object System Identification from Videos
por: Liu, Chunjiang, et al.
Publicado: (2026)
por: Liu, Chunjiang, et al.
Publicado: (2026)
MCBLT: Multi-Camera Multi-Object 3D Tracking in Long Videos
por: Wang, Yizhou, et al.
Publicado: (2024)
por: Wang, Yizhou, et al.
Publicado: (2024)
Multi-Scale and Detail-Enhanced Segment Anything Model for Salient Object Detection
por: Gao, Shixuan, et al.
Publicado: (2024)
por: Gao, Shixuan, et al.
Publicado: (2024)
Turbulence-Robust Dynamic Object Segmentation with Multi-Signal Priors and SAM2 Refinement
por: Peng, Bolian, et al.
Publicado: (2026)
por: Peng, Bolian, et al.
Publicado: (2026)
Multi-view Hand Reconstruction with a Point-Embedded Transformer
por: Yang, Lixin, et al.
Publicado: (2024)
por: Yang, Lixin, et al.
Publicado: (2024)
DISCO: Embodied Navigation and Interaction via Differentiable Scene Semantics and Dual-level Control
por: Xu, Xinyu, et al.
Publicado: (2024)
por: Xu, Xinyu, et al.
Publicado: (2024)
M$^{2}$SNet: Multi-scale in Multi-scale Subtraction Network for Medical Image Segmentation
por: Zhao, Xiaoqi, et al.
Publicado: (2023)
por: Zhao, Xiaoqi, et al.
Publicado: (2023)
Ejemplares similares
-
From Category to Scenery: An End-to-End Framework for Multi-Person Human-Object Interaction Recognition in Videos
por: Qiao, Tanqiu, et al.
Publicado: (2024) -
ClickVOS: Click Video Object Segmentation
por: Guo, Pinxue, et al.
Publicado: (2024) -
Homogeneous Dynamics Space for Heterogeneous Humans
por: Liu, Xinpeng, et al.
Publicado: (2024) -
OneVOS: Unifying Video Object Segmentation with All-in-One Transformer Framework
por: Li, Wanyun, et al.
Publicado: (2024) -
Point-VOS: Pointing Up Video Object Segmentation
por: Zulfikar, Idil Esen, et al.
Publicado: (2024)