Re-Prompting SAM 3 via Object Retrieval: 3rd of the 5th PVUW MOSE Track
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Gao, Mingqi, Li, Sijie, Han, Jungong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
FVOS for MOSE Track of 4th PVUW Challenge: 3rd Place Solution
von: Wang, Mengjiao, et al.
Veröffentlicht: (2025)
von: Wang, Mengjiao, et al.
Veröffentlicht: (2025)
OAMVOS:2nd Report for 5th PVUW MOSE Track
von: Miao, Deshui, et al.
Veröffentlicht: (2026)
von: Miao, Deshui, et al.
Veröffentlicht: (2026)
3rd Place Solution for MOSE Track in CVPR 2024 PVUW workshop: Complex Video Object Segmentation
von: Liu, Xinyu, et al.
Veröffentlicht: (2024)
von: Liu, Xinyu, et al.
Veröffentlicht: (2024)
Advancing Complex Video Object Segmentation via Tracking-Enhanced Prompt: The 1st Winner for 5th PVUW MOSE Challenge
von: Zhang, Jinrong, et al.
Veröffentlicht: (2026)
von: Zhang, Jinrong, et al.
Veröffentlicht: (2026)
MASSeg : 2nd Technical Report for 4th PVUW MOSE Track
von: Cao, Xuqiang, et al.
Veröffentlicht: (2025)
von: Cao, Xuqiang, et al.
Veröffentlicht: (2025)
1st Place Solution for MeViS Track in CVPR 2024 PVUW Workshop: Motion Expression guided Video Segmentation
von: Gao, Mingqi, et al.
Veröffentlicht: (2024)
von: Gao, Mingqi, et al.
Veröffentlicht: (2024)
STSeg-Complex Video Object Segmentation: The 1st Solution for 4th PVUW MOSE Challenge
von: Song, Kehuan, et al.
Veröffentlicht: (2025)
von: Song, Kehuan, et al.
Veröffentlicht: (2025)
3rd Place of MeViS-Audio Track of the 5th PVUW: VIRST-Audio
von: Hong, Jihwan, et al.
Veröffentlicht: (2026)
von: Hong, Jihwan, et al.
Veröffentlicht: (2026)
Point Linguist Model: Segment Any Object via Bridged Large 3D-Language Model
von: Huang, Zhuoxu, et al.
Veröffentlicht: (2025)
von: Huang, Zhuoxu, et al.
Veröffentlicht: (2025)
AgentRVOS for MeViS-Text Track of 5th PVUW Challenge: 3rd Method
von: Miao, Deshui, et al.
Veröffentlicht: (2026)
von: Miao, Deshui, et al.
Veröffentlicht: (2026)
1st Place Solution for MOSE Track in CVPR 2024 PVUW Workshop: Complex Video Object Segmentation
von: Miao, Deshui, et al.
Veröffentlicht: (2024)
von: Miao, Deshui, et al.
Veröffentlicht: (2024)
SAM-Body4D: Training-Free 4D Human Body Mesh Recovery from Videos
von: Gao, Mingqi, et al.
Veröffentlicht: (2025)
von: Gao, Mingqi, et al.
Veröffentlicht: (2025)
2nd Place Solution for MOSE Track in CVPR 2024 PVUW workshop: Complex Video Object Segmentation
von: Xu, Zhensong, et al.
Veröffentlicht: (2024)
von: Xu, Zhensong, et al.
Veröffentlicht: (2024)
4th PVUW MeViS 3rd Place Report: Sa2VA
von: Yuan, Haobo, et al.
Veröffentlicht: (2025)
von: Yuan, Haobo, et al.
Veröffentlicht: (2025)
3rd Place Solution for PVUW Challenge 2024: Video Panoptic Segmentation
von: Wu, Ruipu, et al.
Veröffentlicht: (2024)
von: Wu, Ruipu, et al.
Veröffentlicht: (2024)
THU-Warwick Submission for EPIC-KITCHEN Challenge 2025: Semi-Supervised Video Object Segmentation
von: Gao, Mingqi, et al.
Veröffentlicht: (2025)
von: Gao, Mingqi, et al.
Veröffentlicht: (2025)
The 1st Winner for 5th PVUW MeViS-Text Challenge: Strong MLLMs Meet SAM3 for Referring Video Object Segmentation
von: He, Xusheng, et al.
Veröffentlicht: (2026)
von: He, Xusheng, et al.
Veröffentlicht: (2026)
Reinforcing 3D Understanding in Point-VLMs via Geometric Reward Credit Assignment
von: Chen, Jingkun, et al.
Veröffentlicht: (2026)
von: Chen, Jingkun, et al.
Veröffentlicht: (2026)
Report of the 5th PVUW Challenge: Towards More Diverse Modalities in Pixel-Level Understanding
von: Liu, Chang, et al.
Veröffentlicht: (2026)
von: Liu, Chang, et al.
Veröffentlicht: (2026)
3rd Place Solution for MeViS Track in CVPR 2024 PVUW workshop: Motion Expression guided Video Segmentation
von: Pan, Feiyu, et al.
Veröffentlicht: (2024)
von: Pan, Feiyu, et al.
Veröffentlicht: (2024)
SimMLM: A Simple Framework for Multi-modal Learning with Missing Modality
von: Li, Sijie, et al.
Veröffentlicht: (2025)
von: Li, Sijie, et al.
Veröffentlicht: (2025)
2nd of the 5th PVUW MeViS-Audio Track: ASR-SaSaSa2VA
von: Wang, Zhiyu, et al.
Veröffentlicht: (2026)
von: Wang, Zhiyu, et al.
Veröffentlicht: (2026)
Show Me When and Where: Towards Referring Video Object Segmentation in the Wild
von: Gao, Mingqi, et al.
Veröffentlicht: (2026)
von: Gao, Mingqi, et al.
Veröffentlicht: (2026)
MOSE: Boosting Vision-based Roadside 3D Object Detection with Scene Cues
von: Chen, Xiahan, et al.
Veröffentlicht: (2024)
von: Chen, Xiahan, et al.
Veröffentlicht: (2024)
The 1st Solution for MOSEv2 Challenge 2025: Long-term and Concept-aware Video Segmentation via SeC
von: Gao, Mingqi, et al.
Veröffentlicht: (2025)
von: Gao, Mingqi, et al.
Veröffentlicht: (2025)
Mostly Text, Smart Visuals: Asymmetric Text-Visual Pruning for Large Vision-Language Models
von: Li, Sijie, et al.
Veröffentlicht: (2026)
von: Li, Sijie, et al.
Veröffentlicht: (2026)
SAMITE: Position Prompted SAM2 with Calibrated Memory for Visual Object Tracking
von: Xu, Qianxiong, et al.
Veröffentlicht: (2025)
von: Xu, Qianxiong, et al.
Veröffentlicht: (2025)
SaSaSaSa2VA: 2nd Place of the 5th PVUW MeViS-Text Track
von: Gong, Dengxian, et al.
Veröffentlicht: (2026)
von: Gong, Dengxian, et al.
Veröffentlicht: (2026)
Modality Prompts for Arbitrary Modality Salient Object Detection
von: Huang, Nianchang, et al.
Veröffentlicht: (2024)
von: Huang, Nianchang, et al.
Veröffentlicht: (2024)
Video Object Segmentation via SAM 2: The 4th Solution for LSVOS Challenge VOS Track
von: Pan, Feiyu, et al.
Veröffentlicht: (2024)
von: Pan, Feiyu, et al.
Veröffentlicht: (2024)
PVUW 2024 Challenge on Complex Video Understanding: Methods and Results
von: Ding, Henghui, et al.
Veröffentlicht: (2024)
von: Ding, Henghui, et al.
Veröffentlicht: (2024)
ReSurgSAM2: Referring Segment Anything in Surgical Video via Credible Long-term Tracking
von: Liu, Haofeng, et al.
Veröffentlicht: (2025)
von: Liu, Haofeng, et al.
Veröffentlicht: (2025)
P2RBox: Point Prompt Oriented Object Detection with SAM
von: Cao, Guangming, et al.
Veröffentlicht: (2023)
von: Cao, Guangming, et al.
Veröffentlicht: (2023)
Pro2SAM: Mask Prompt to SAM with Grid Points for Weakly Supervised Object Localization
von: Yang, Xi, et al.
Veröffentlicht: (2025)
von: Yang, Xi, et al.
Veröffentlicht: (2025)
Memory-SAM: Human-Prompt-Free Tongue Segmentation via Retrieval-to-Prompt
von: Chae, Joongwon, et al.
Veröffentlicht: (2025)
von: Chae, Joongwon, et al.
Veröffentlicht: (2025)
RepViT-SAM: Towards Real-Time Segmenting Anything
von: Wang, Ao, et al.
Veröffentlicht: (2023)
von: Wang, Ao, et al.
Veröffentlicht: (2023)
CAD-Prompted SAM3: Geometry-Conditioned Instance Segmentation for Industrial Objects
von: Tang, Zhenran, et al.
Veröffentlicht: (2026)
von: Tang, Zhenran, et al.
Veröffentlicht: (2026)
IP-SAM: Prompt-Space Conditioning for Prompt-Absent Camouflaged Object Detection
von: Zhang, Huiyao, et al.
Veröffentlicht: (2026)
von: Zhang, Huiyao, et al.
Veröffentlicht: (2026)
Unlocking the Potential of Diffusion Priors in Blind Face Restoration
von: Miao, Yunqi, et al.
Veröffentlicht: (2025)
von: Miao, Yunqi, et al.
Veröffentlicht: (2025)
Efficient-SAM2: Accelerating SAM2 with Object-Aware Visual Encoding and Memory Retrieval
von: Zhang, Jing, et al.
Veröffentlicht: (2026)
von: Zhang, Jing, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
FVOS for MOSE Track of 4th PVUW Challenge: 3rd Place Solution
von: Wang, Mengjiao, et al.
Veröffentlicht: (2025) -
OAMVOS:2nd Report for 5th PVUW MOSE Track
von: Miao, Deshui, et al.
Veröffentlicht: (2026) -
3rd Place Solution for MOSE Track in CVPR 2024 PVUW workshop: Complex Video Object Segmentation
von: Liu, Xinyu, et al.
Veröffentlicht: (2024) -
Advancing Complex Video Object Segmentation via Tracking-Enhanced Prompt: The 1st Winner for 5th PVUW MOSE Challenge
von: Zhang, Jinrong, et al.
Veröffentlicht: (2026) -
MASSeg : 2nd Technical Report for 4th PVUW MOSE Track
von: Cao, Xuqiang, et al.
Veröffentlicht: (2025)