Segment Anything for Videos: A Systematic Survey
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Chunhui, Cui, Yawen, Lin, Weilin, Huang, Guanjie, Rong, Yan, Liu, Li, Shan, Shiguang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Comprehensive Survey on Human Video Generation: Challenges, Methods, and Insights
por: Lei, Wentao, et al.
Publicado: (2024)
por: Lei, Wentao, et al.
Publicado: (2024)
RefSAM: Efficiently Adapting Segmenting Anything Model for Referring Video Object Segmentation
por: Li, Yonglin, et al.
Publicado: (2023)
por: Li, Yonglin, et al.
Publicado: (2023)
WebUOT-1M: Advancing Deep Underwater Object Tracking with A Million-Scale Benchmark
por: Zhang, Chunhui, et al.
Publicado: (2024)
por: Zhang, Chunhui, et al.
Publicado: (2024)
LensWalk: Agentic Video Understanding by Planning How You See in Videos
por: Li, Keliang, et al.
Publicado: (2026)
por: Li, Keliang, et al.
Publicado: (2026)
SAMAug: Point Prompt Augmentation for Segment Anything Model
por: Dai, Haixing, et al.
Publicado: (2023)
por: Dai, Haixing, et al.
Publicado: (2023)
CamSAM2: Segment Anything Accurately in Camouflaged Videos
por: Zhou, Yuli, et al.
Publicado: (2025)
por: Zhou, Yuli, et al.
Publicado: (2025)
X-SAM: From Segment Anything to Any Segmentation
por: Wang, Hao, et al.
Publicado: (2025)
por: Wang, Hao, et al.
Publicado: (2025)
INFACT: A Diagnostic Benchmark for Induced Faithfulness and Factuality Hallucinations in Video-LLMs
por: Yang, Junqi, et al.
Publicado: (2026)
por: Yang, Junqi, et al.
Publicado: (2026)
Describe Anything: Detailed Localized Image and Video Captioning
por: Lian, Long, et al.
Publicado: (2025)
por: Lian, Long, et al.
Publicado: (2025)
Underwater Camouflaged Object Tracking Meets Vision-Language SAM2
por: Zhang, Chunhui, et al.
Publicado: (2024)
por: Zhang, Chunhui, et al.
Publicado: (2024)
Segment-Anything Models Achieve Zero-shot Robustness in Autonomous Driving
por: Yan, Jun, et al.
Publicado: (2024)
por: Yan, Jun, et al.
Publicado: (2024)
SAM 3: Segment Anything with Concepts
por: Carion, Nicolas, et al.
Publicado: (2025)
por: Carion, Nicolas, et al.
Publicado: (2025)
LENS: Learning to Segment Anything with Unified Reinforced Reasoning
por: Zhu, Lianghui, et al.
Publicado: (2025)
por: Zhu, Lianghui, et al.
Publicado: (2025)
Video Depth Anything: Consistent Depth Estimation for Super-Long Videos
por: Chen, Sili, et al.
Publicado: (2025)
por: Chen, Sili, et al.
Publicado: (2025)
WeakSAM: Segment Anything Meets Weakly-supervised Instance-level Recognition
por: Zhu, Lianghui, et al.
Publicado: (2024)
por: Zhu, Lianghui, et al.
Publicado: (2024)
SAM 2: Segment Anything in Images and Videos
por: Ravi, Nikhila, et al.
Publicado: (2024)
por: Ravi, Nikhila, et al.
Publicado: (2024)
Segment Anything in Pathology Images with Natural Language
por: Chen, Zhixuan, et al.
Publicado: (2025)
por: Chen, Zhixuan, et al.
Publicado: (2025)
Measuring the Measurers: Quality Evaluation of Hallucination Benchmarks for Large Vision-Language Models
por: Yan, Bei, et al.
Publicado: (2024)
por: Yan, Bei, et al.
Publicado: (2024)
MM-MoralBench: A MultiModal Moral Evaluation Benchmark for Large Vision-Language Models
por: Yan, Bei, et al.
Publicado: (2024)
por: Yan, Bei, et al.
Publicado: (2024)
Segment and Matte Anything in a Unified Model
por: Fan, Zezhong, et al.
Publicado: (2026)
por: Fan, Zezhong, et al.
Publicado: (2026)
ALPS: An Auto-Labeling and Pre-training Scheme for Remote Sensing Segmentation With Segment Anything Model
por: Zhang, Song, et al.
Publicado: (2024)
por: Zhang, Song, et al.
Publicado: (2024)
Tracking and Segmenting Anything in Any Modality
por: Zhang, Tianlu, et al.
Publicado: (2025)
por: Zhang, Tianlu, et al.
Publicado: (2025)
Compress Any Segment Anything Model (SAM)
por: Fan, Juntong, et al.
Publicado: (2025)
por: Fan, Juntong, et al.
Publicado: (2025)
Promoting Segment Anything Model towards Highly Accurate Dichotomous Image Segmentation
por: Liu, Xianjie, et al.
Publicado: (2023)
por: Liu, Xianjie, et al.
Publicado: (2023)
Trigger without Trace: Towards Stealthy Backdoor Attack on Text-to-Image Diffusion Models
por: Zhang, Jie, et al.
Publicado: (2025)
por: Zhang, Jie, et al.
Publicado: (2025)
MedSAM3: Delving into Segment Anything with Medical Concepts
por: Liu, Anglin, et al.
Publicado: (2025)
por: Liu, Anglin, et al.
Publicado: (2025)
Customize Segment Anything Model for Multi-Modal Semantic Segmentation with Mixture of LoRA Experts
por: Zhu, Chenyang, et al.
Publicado: (2024)
por: Zhu, Chenyang, et al.
Publicado: (2024)
Semantic Localization Guiding Segment Anything Model For Reference Remote Sensing Image Segmentation
por: Li, Shuyang, et al.
Publicado: (2025)
por: Li, Shuyang, et al.
Publicado: (2025)
MetricAnything: Scaling Metric Depth Pretraining with Noisy Heterogeneous Sources
por: Ma, Baorui, et al.
Publicado: (2026)
por: Ma, Baorui, et al.
Publicado: (2026)
SAM2 for Image and Video Segmentation: A Comprehensive Survey
por: Jiaxing, Zhang, et al.
Publicado: (2025)
por: Jiaxing, Zhang, et al.
Publicado: (2025)
RASA: Replace Anyone, Say Anything -- A Training-Free Framework for Audio-Driven and Universal Portrait Video Editing
por: Pan, Tianrui, et al.
Publicado: (2025)
por: Pan, Tianrui, et al.
Publicado: (2025)
Annolid: Annotate, Segment, and Track Anything You Need
por: Yang, Chen, et al.
Publicado: (2024)
por: Yang, Chen, et al.
Publicado: (2024)
UniPose: A Unified Multimodal Framework for Human Pose Comprehension, Generation and Editing
por: Li, Yiheng, et al.
Publicado: (2024)
por: Li, Yiheng, et al.
Publicado: (2024)
Efficient Quantization-Aware Training on Segment Anything Model in Medical Images and Its Deployment
por: Lu, Haisheng, et al.
Publicado: (2024)
por: Lu, Haisheng, et al.
Publicado: (2024)
SparseSAM: Structured Sparsification of Activations in Segment Anything Models
por: Tran, Hoai-Chau, et al.
Publicado: (2026)
por: Tran, Hoai-Chau, et al.
Publicado: (2026)
Gaussian Grouping: Segment and Edit Anything in 3D Scenes
por: Ye, Mingqiao, et al.
Publicado: (2023)
por: Ye, Mingqiao, et al.
Publicado: (2023)
Adapting Segment Anything Model to Melanoma Segmentation in Microscopy Slide Images
por: Liu, Qingyuan, et al.
Publicado: (2024)
por: Liu, Qingyuan, et al.
Publicado: (2024)
Task Me Anything
por: Zhang, Jieyu, et al.
Publicado: (2024)
por: Zhang, Jieyu, et al.
Publicado: (2024)
Prior-free Balanced Replay: Uncertainty-guided Reservoir Sampling for Long-Tailed Continual Learning
por: Liu, Lei, et al.
Publicado: (2024)
por: Liu, Lei, et al.
Publicado: (2024)
AnyMo: Scaling Any-Modality Conditional Motion Generation with Masked Modeling
por: Li, Yiheng, et al.
Publicado: (2026)
por: Li, Yiheng, et al.
Publicado: (2026)
Ejemplares similares
-
A Comprehensive Survey on Human Video Generation: Challenges, Methods, and Insights
por: Lei, Wentao, et al.
Publicado: (2024) -
RefSAM: Efficiently Adapting Segmenting Anything Model for Referring Video Object Segmentation
por: Li, Yonglin, et al.
Publicado: (2023) -
WebUOT-1M: Advancing Deep Underwater Object Tracking with A Million-Scale Benchmark
por: Zhang, Chunhui, et al.
Publicado: (2024) -
LensWalk: Agentic Video Understanding by Planning How You See in Videos
por: Li, Keliang, et al.
Publicado: (2026) -
SAMAug: Point Prompt Augmentation for Segment Anything Model
por: Dai, Haixing, et al.
Publicado: (2023)