Moving Object Segmentation: All You Need Is SAM (and Flow)
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xie, Junyu, Yang, Charig, Xie, Weidi, Zisserman, Andrew |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GMOS: Grounding Moving Object Segmentation in 3D Space and Time
par: Xie, Junyu, et autres
Publié: (2026)
par: Xie, Junyu, et autres
Publié: (2026)
Appearance-Based Refinement for Object-Centric Motion Segmentation
par: Xie, Junyu, et autres
Publié: (2023)
par: Xie, Junyu, et autres
Publié: (2023)
Made to Order: Discovering monotonic temporal changes via self-supervised video ordering
par: Yang, Charig, et autres
Publié: (2024)
par: Yang, Charig, et autres
Publié: (2024)
Character-Centric Understanding of Animated Movies
par: Gui, Zhongrui, et autres
Publié: (2025)
par: Gui, Zhongrui, et autres
Publié: (2025)
AutoAD-Zero: A Training-Free Framework for Zero-Shot Audio Description
par: Xie, Junyu, et autres
Publié: (2024)
par: Xie, Junyu, et autres
Publié: (2024)
Amodal Ground Truth and Completion in the Wild
par: Zhan, Guanqi, et autres
Publié: (2023)
par: Zhan, Guanqi, et autres
Publié: (2023)
A General Protocol to Probe Large Vision Models for 3D Physical Understanding
par: Zhan, Guanqi, et autres
Publié: (2023)
par: Zhan, Guanqi, et autres
Publié: (2023)
ROS-SAM: High-Quality Interactive Segmentation for Remote Sensing Moving Object
par: Shan, Zhe, et autres
Publié: (2025)
par: Shan, Zhe, et autres
Publié: (2025)
Shot-by-Shot: Film-Grammar-Aware Training-Free Audio Description Generation
par: Xie, Junyu, et autres
Publié: (2025)
par: Xie, Junyu, et autres
Publié: (2025)
Inferring Dynamic Physical Properties from Video Foundation Models
par: Zhan, Guanqi, et autres
Publié: (2025)
par: Zhan, Guanqi, et autres
Publié: (2025)
ELIP: Enhanced Visual-Language Foundation Models for Image Retrieval
par: Zhan, Guanqi, et autres
Publié: (2025)
par: Zhan, Guanqi, et autres
Publié: (2025)
SVAC: Scaling Is All You Need For Referring Video Object Segmentation
par: Zhang, Li, et autres
Publié: (2025)
par: Zhang, Li, et autres
Publié: (2025)
AutoAD III: The Prequel -- Back to the Pixels
par: Han, Tengda, et autres
Publié: (2024)
par: Han, Tengda, et autres
Publié: (2024)
Synchformer: Efficient Synchronization from Sparse Cues
par: Iashin, Vladimir, et autres
Publié: (2024)
par: Iashin, Vladimir, et autres
Publié: (2024)
Lite-SAM Is Actually What You Need for Segment Everything
par: Fu, Jianhai, et autres
Publié: (2024)
par: Fu, Jianhai, et autres
Publié: (2024)
EMA-SAM: Exponential Moving-average for SAM-based PTMC Segmentation
par: Dialameh, Maryam, et autres
Publié: (2025)
par: Dialameh, Maryam, et autres
Publié: (2025)
MovSAM: A Single-image Moving Object Segmentation Framework Based on Deep Thinking
par: Nie, Chang, et autres
Publié: (2025)
par: Nie, Chang, et autres
Publié: (2025)
Ideal Registration? Segmentation is All You Need
par: Chen, Xiang, et autres
Publié: (2025)
par: Chen, Xiang, et autres
Publié: (2025)
Similarity Memory Prior is All You Need for Medical Image Segmentation
par: Tang, Hao, et autres
Publié: (2025)
par: Tang, Hao, et autres
Publié: (2025)
EchoSight: Advancing Visual-Language Models with Wiki Knowledge
par: Yan, Yibin, et autres
Publié: (2024)
par: Yan, Yibin, et autres
Publié: (2024)
Grounded Question-Answering in Long Egocentric Videos
par: Di, Shangzhe, et autres
Publié: (2023)
par: Di, Shangzhe, et autres
Publié: (2023)
Open-World Object Counting in Videos
par: Amini-Naieni, Niki, et autres
Publié: (2025)
par: Amini-Naieni, Niki, et autres
Publié: (2025)
VISA: Reasoning Video Object Segmentation via Large Language Models
par: Yan, Cilin, et autres
Publié: (2024)
par: Yan, Cilin, et autres
Publié: (2024)
SAM-CP: Marrying SAM with Composable Prompts for Versatile Segmentation
par: Chen, Pengfei, et autres
Publié: (2024)
par: Chen, Pengfei, et autres
Publié: (2024)
Self-Prompt SAM: Medical Image Segmentation via Automatic Prompt SAM Adaptation
par: Xie, Bin, et autres
Publié: (2025)
par: Xie, Bin, et autres
Publié: (2025)
Pairwise Comparisons Are All You Need
par: Chahine, Nicolas, et autres
Publié: (2024)
par: Chahine, Nicolas, et autres
Publié: (2024)
RFMedSAM 2: Automatic Prompt Refinement for Enhanced Volumetric Medical Image Segmentation with SAM 2
par: Xie, Bin, et autres
Publié: (2025)
par: Xie, Bin, et autres
Publié: (2025)
InstaGen: Enhancing Object Detection by Training on Synthetic Dataset
par: Feng, Chengjian, et autres
Publié: (2024)
par: Feng, Chengjian, et autres
Publié: (2024)
Is Discretization Fusion All You Need for Collaborative Perception?
par: Yang, Kang, et autres
Publié: (2025)
par: Yang, Kang, et autres
Publié: (2025)
Aerial Monocular 3D Object Detection
par: Hu, Yue, et autres
Publié: (2022)
par: Hu, Yue, et autres
Publié: (2022)
Synthesis4AD: Synthetic Anomalies are All You Need for 3D Anomaly Detection
par: Sun, Yihan, et autres
Publié: (2026)
par: Sun, Yihan, et autres
Publié: (2026)
MaskSAM: Towards Auto-prompt SAM with Mask Classification for Volumetric Medical Image Segmentation
par: Xie, Bin, et autres
Publié: (2024)
par: Xie, Bin, et autres
Publié: (2024)
FAIL: Flow Matching Adversarial Imitation Learning for Image Generation
par: Ma, Yeyao, et autres
Publié: (2026)
par: Ma, Yeyao, et autres
Publié: (2026)
BLO-Inst: Bi-Level Optimization Based Alignment of YOLO and SAM for Robust Instance Segmentation
par: Zhang, Li, et autres
Publié: (2026)
par: Zhang, Li, et autres
Publié: (2026)
ParameterNet: Parameters Are All You Need
par: Han, Kai, et autres
Publié: (2023)
par: Han, Kai, et autres
Publié: (2023)
Moving Object Proposals with Deep Learned Optical Flow for Video Object Segmentation
par: Shi, Ge, et autres
Publié: (2024)
par: Shi, Ge, et autres
Publié: (2024)
The Manga Whisperer: Automatically Generating Transcriptions for Comics
par: Sachdeva, Ragav, et autres
Publié: (2024)
par: Sachdeva, Ragav, et autres
Publié: (2024)
Personalizing Retrieval using Joint Embeddings or "the Return of Fluffy"
par: Korbar, Bruno, et autres
Publié: (2025)
par: Korbar, Bruno, et autres
Publié: (2025)
Chirality in Action: Time-Aware Video Representation Learning by Latent Straightening
par: Bagad, Piyush, et autres
Publié: (2025)
par: Bagad, Piyush, et autres
Publié: (2025)
From Panels to Prose: Generating Literary Narratives from Comics
par: Sachdeva, Ragav, et autres
Publié: (2025)
par: Sachdeva, Ragav, et autres
Publié: (2025)
Documents similaires
-
GMOS: Grounding Moving Object Segmentation in 3D Space and Time
par: Xie, Junyu, et autres
Publié: (2026) -
Appearance-Based Refinement for Object-Centric Motion Segmentation
par: Xie, Junyu, et autres
Publié: (2023) -
Made to Order: Discovering monotonic temporal changes via self-supervised video ordering
par: Yang, Charig, et autres
Publié: (2024) -
Character-Centric Understanding of Animated Movies
par: Gui, Zhongrui, et autres
Publié: (2025) -
AutoAD-Zero: A Training-Free Framework for Zero-Shot Audio Description
par: Xie, Junyu, et autres
Publié: (2024)