RMem: Restricted Memory Banks Improve Video Object Segmentation
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhou, Junbao, Pang, Ziqi, Wang, Yu-Xiong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Memory-Efficient Continual Learning Object Segmentation for Long Video
por: Nazemi, Amir, et al.
Publicado: (2023)
por: Nazemi, Amir, et al.
Publicado: (2023)
PPTArena: A Benchmark for Agentic PowerPoint Editing
por: Ofengenden, Michael, et al.
Publicado: (2025)
por: Ofengenden, Michael, et al.
Publicado: (2025)
Shallow Features Matter: Hierarchical Memory with Heterogeneous Interaction for Unsupervised Video Object Segmentation
por: Xiangyu, Zheng, et al.
Publicado: (2025)
por: Xiangyu, Zheng, et al.
Publicado: (2025)
Enhancing Self-Supervised Fine-Grained Video Object Tracking with Dynamic Memory Prediction
por: Zhou, Zihan, et al.
Publicado: (2025)
por: Zhou, Zihan, et al.
Publicado: (2025)
Learning Spatial-Semantic Features for Robust Video Object Segmentation
por: Li, Xin, et al.
Publicado: (2024)
por: Li, Xin, et al.
Publicado: (2024)
MR. Video: "MapReduce" is the Principle for Long Video Understanding
por: Pang, Ziqi, et al.
Publicado: (2025)
por: Pang, Ziqi, et al.
Publicado: (2025)
On Moving Object Segmentation from Monocular Video with Transformers
por: Homeyer, Christian, et al.
Publicado: (2024)
por: Homeyer, Christian, et al.
Publicado: (2024)
Space-time Reinforcement Network for Video Object Segmentation
por: Chen, Yadang, et al.
Publicado: (2024)
por: Chen, Yadang, et al.
Publicado: (2024)
Advancing Complex Video Object Segmentation via Progressive Concept Construction
por: Zhang, Zhixiong, et al.
Publicado: (2025)
por: Zhang, Zhixiong, et al.
Publicado: (2025)
RefSAM: Efficiently Adapting Segmenting Anything Model for Referring Video Object Segmentation
por: Li, Yonglin, et al.
Publicado: (2023)
por: Li, Yonglin, et al.
Publicado: (2023)
Investigation of Frame Differences as Motion Cues for Video Object Segmentation
por: Kawamura, Sota, et al.
Publicado: (2025)
por: Kawamura, Sota, et al.
Publicado: (2025)
Mitigating Query Selection Bias in Referring Video Object Segmentation
por: Zhang, Dingwei, et al.
Publicado: (2025)
por: Zhang, Dingwei, et al.
Publicado: (2025)
Synthetic Object Compositions for Scalable and Accurate Learning in Detection, Segmentation, and Grounding
por: Huang, Weikai, et al.
Publicado: (2025)
por: Huang, Weikai, et al.
Publicado: (2025)
When SAM2 Meets Video Camouflaged Object Segmentation: A Comprehensive Evaluation and Adaptation
por: Zhou, Yuli, et al.
Publicado: (2024)
por: Zhou, Yuli, et al.
Publicado: (2024)
Frozen Transformers in Language Models Are Effective Visual Encoder Layers
por: Pang, Ziqi, et al.
Publicado: (2023)
por: Pang, Ziqi, et al.
Publicado: (2023)
Streaming Video Understanding and Multi-round Interaction with Memory-enhanced Knowledge
por: Xiong, Haomiao, et al.
Publicado: (2025)
por: Xiong, Haomiao, et al.
Publicado: (2025)
SlotMatch: Distilling Object-Centric Representations for Unsupervised Video Segmentation
por: Grigore, Diana-Nicoleta, et al.
Publicado: (2025)
por: Grigore, Diana-Nicoleta, et al.
Publicado: (2025)
Vision-Language Model for Object Detection and Segmentation: A Review and Evaluation
por: Feng, Yongchao, et al.
Publicado: (2025)
por: Feng, Yongchao, et al.
Publicado: (2025)
Restrictive Hierarchical Semantic Segmentation for Stratified Tooth Layer Detection
por: Banks, Ryan, et al.
Publicado: (2025)
por: Banks, Ryan, et al.
Publicado: (2025)
1st Place Solution for 5th LSVOS Challenge: Referring Video Object Segmentation
por: Luo, Zhuoyan, et al.
Publicado: (2024)
por: Luo, Zhuoyan, et al.
Publicado: (2024)
RandAR: Decoder-only Autoregressive Visual Generation in Random Orders
por: Pang, Ziqi, et al.
Publicado: (2024)
por: Pang, Ziqi, et al.
Publicado: (2024)
GLUS: Global-Local Reasoning Unified into A Single Large Language Model for Video Segmentation
por: Lin, Lang, et al.
Publicado: (2025)
por: Lin, Lang, et al.
Publicado: (2025)
Ref-AVS: Refer and Segment Objects in Audio-Visual Scenes
por: Wang, Yaoting, et al.
Publicado: (2024)
por: Wang, Yaoting, et al.
Publicado: (2024)
TrackTeller: Temporal Multimodal 3D Grounding for Behavior-Dependent Object References
por: Yu, Jiahong, et al.
Publicado: (2025)
por: Yu, Jiahong, et al.
Publicado: (2025)
Dynamic Attention Mechanism in Spatiotemporal Memory Networks for Object Tracking
por: Zhou, Meng, et al.
Publicado: (2025)
por: Zhou, Meng, et al.
Publicado: (2025)
PB-UAP: Hybrid Universal Adversarial Attack For Image Segmentation
por: Song, Yufei, et al.
Publicado: (2024)
por: Song, Yufei, et al.
Publicado: (2024)
M$^3$-VOS: Multi-Phase, Multi-Transition, and Multi-Scenery Video Object Segmentation
por: Chen, Zixuan, et al.
Publicado: (2024)
por: Chen, Zixuan, et al.
Publicado: (2024)
Unleashing Hierarchical Reasoning: An LLM-Driven Framework for Training-Free Referring Video Object Segmentation
por: Zhao, Bingrui, et al.
Publicado: (2025)
por: Zhao, Bingrui, et al.
Publicado: (2025)
EchoPilot: Training-Free Ultrasound Video Segmentation via Scale-Space Semantic Prompting and Reliability-Gated Memory
por: Xiao, Ruiqiang, et al.
Publicado: (2026)
por: Xiao, Ruiqiang, et al.
Publicado: (2026)
ObjectMover: Generative Object Movement with Video Prior
por: Yu, Xin, et al.
Publicado: (2025)
por: Yu, Xin, et al.
Publicado: (2025)
TMUAD: Enhancing Logical Capabilities in Unified Anomaly Detection Models with a Text Memory Bank
por: Liu, Jiawei, et al.
Publicado: (2025)
por: Liu, Jiawei, et al.
Publicado: (2025)
InterDreamer: Zero-Shot Text to 3D Dynamic Human-Object Interaction
por: Xu, Sirui, et al.
Publicado: (2024)
por: Xu, Sirui, et al.
Publicado: (2024)
General and Task-Oriented Video Segmentation
por: Chen, Mu, et al.
Publicado: (2024)
por: Chen, Mu, et al.
Publicado: (2024)
CSMCIR: CoT-Enhanced Symmetric Alignment with Memory Bank for Composed Image Retrieval
por: Qian, Zhipeng, et al.
Publicado: (2026)
por: Qian, Zhipeng, et al.
Publicado: (2026)
3rd Place Solution for MOSE Track in CVPR 2024 PVUW workshop: Complex Video Object Segmentation
por: Liu, Xinyu, et al.
Publicado: (2024)
por: Liu, Xinyu, et al.
Publicado: (2024)
SeaBird: Segmentation in Bird's View with Dice Loss Improves Monocular 3D Detection of Large Objects
por: Kumar, Abhinav, et al.
Publicado: (2024)
por: Kumar, Abhinav, et al.
Publicado: (2024)
Learning Plug-and-play Memory for Guiding Video Diffusion Models
por: Song, Selena, et al.
Publicado: (2025)
por: Song, Selena, et al.
Publicado: (2025)
ALPS: An Auto-Labeling and Pre-training Scheme for Remote Sensing Segmentation With Segment Anything Model
por: Zhang, Song, et al.
Publicado: (2024)
por: Zhang, Song, et al.
Publicado: (2024)
Segment Concealed Objects with Incomplete Supervision
por: He, Chunming, et al.
Publicado: (2025)
por: He, Chunming, et al.
Publicado: (2025)
DIVD: Deblurring with Improved Video Diffusion Model
por: Long, Haoyang, et al.
Publicado: (2024)
por: Long, Haoyang, et al.
Publicado: (2024)
Ejemplares similares
-
Memory-Efficient Continual Learning Object Segmentation for Long Video
por: Nazemi, Amir, et al.
Publicado: (2023) -
PPTArena: A Benchmark for Agentic PowerPoint Editing
por: Ofengenden, Michael, et al.
Publicado: (2025) -
Shallow Features Matter: Hierarchical Memory with Heterogeneous Interaction for Unsupervised Video Object Segmentation
por: Xiangyu, Zheng, et al.
Publicado: (2025) -
Enhancing Self-Supervised Fine-Grained Video Object Tracking with Dynamic Memory Prediction
por: Zhou, Zihan, et al.
Publicado: (2025) -
Learning Spatial-Semantic Features for Robust Video Object Segmentation
por: Li, Xin, et al.
Publicado: (2024)