Joint Modeling of Feature, Correspondence, and a Compressed Memory for Video Object Segmentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Jiaming, Cui, Yutao, Wu, Gangshan, Wang, Limin |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RGB-D Video Object Segmentation via Enhanced Multi-store Feature Memory
par: Xu, Boyue, et autres
Publié: (2025)
par: Xu, Boyue, et autres
Publié: (2025)
MixFormerV2: Efficient Fully Transformer Tracking
par: Cui, Yutao, et autres
Publié: (2023)
par: Cui, Yutao, et autres
Publié: (2023)
SportsHHI: A Dataset for Human-Human Interaction Detection in Sports Videos
par: Wu, Tao, et autres
Publié: (2024)
par: Wu, Tao, et autres
Publié: (2024)
MotionRAG: Motion Retrieval-Augmented Image-to-Video Generation
par: Zhu, Chenhui, et autres
Publié: (2025)
par: Zhu, Chenhui, et autres
Publié: (2025)
SAM 2++: Tracking Anything at Any Granularity
par: Zhang, Jiaming, et autres
Publié: (2025)
par: Zhang, Jiaming, et autres
Publié: (2025)
SteadyDancer: Harmonized and Coherent Human Image Animation with First-Frame Preservation
par: Zhang, Jiaming, et autres
Publié: (2025)
par: Zhang, Jiaming, et autres
Publié: (2025)
AWT: Transferring Vision-Language Models via Augmentation, Weighting, and Transportation
par: Zhu, Yuhan, et autres
Publié: (2024)
par: Zhu, Yuhan, et autres
Publié: (2024)
KAN-SAM: Kolmogorov-Arnold Network Guided Segment Anything Model for RGB-T Salient Object Detection
par: Li, Xingyuan, et autres
Publié: (2025)
par: Li, Xingyuan, et autres
Publié: (2025)
Dual DETRs for Multi-Label Temporal Action Detection
par: Zhu, Yuhan, et autres
Publié: (2024)
par: Zhu, Yuhan, et autres
Publié: (2024)
VFIMamba: Video Frame Interpolation with State Space Models
par: Zhang, Guozhen, et autres
Publié: (2024)
par: Zhang, Guozhen, et autres
Publié: (2024)
STMixer: A One-Stage Sparse Action Detector
par: Wu, Tao, et autres
Publié: (2024)
par: Wu, Tao, et autres
Publié: (2024)
Open-Vocabulary Spatio-Temporal Action Detection
par: Wu, Tao, et autres
Publié: (2024)
par: Wu, Tao, et autres
Publié: (2024)
Dynamic in Static: Hybrid Visual Correspondence for Self-Supervised Video Object Segmentation
par: Pei, Gensheng, et autres
Publié: (2024)
par: Pei, Gensheng, et autres
Publié: (2024)
Learning Frequency and Memory-Aware Prompts for Multi-Modal Object Tracking
par: Xu, Boyue, et autres
Publié: (2025)
par: Xu, Boyue, et autres
Publié: (2025)
HyPSAM: Hybrid Prompt-driven Segment Anything Model for RGB-Thermal Salient Object Detection
par: Hou, Ruichao, et autres
Publié: (2025)
par: Hou, Ruichao, et autres
Publié: (2025)
Memory Matching is not Enough: Jointly Improving Memory Matching and Decoding for Video Object Segmentation
par: Zheng, Jintu, et autres
Publié: (2024)
par: Zheng, Jintu, et autres
Publié: (2024)
Asymmetric Masked Distillation for Pre-Training Small Foundation Models
par: Zhao, Zhiyu, et autres
Publié: (2023)
par: Zhao, Zhiyu, et autres
Publié: (2023)
Concealed Object Segmentation with Hierarchical Coherence Modeling
par: Xiao, Fengyang, et autres
Publié: (2024)
par: Xiao, Fengyang, et autres
Publié: (2024)
Efficient Test-Time Prompt Tuning for Vision-Language Models
par: Zhu, Yuhan, et autres
Publié: (2024)
par: Zhu, Yuhan, et autres
Publié: (2024)
MeMOTR: Long-Term Memory-Augmented Transformer for Multi-Object Tracking
par: Gao, Ruopeng, et autres
Publié: (2023)
par: Gao, Ruopeng, et autres
Publié: (2023)
Shallow Features Matter: Hierarchical Memory with Heterogeneous Interaction for Unsupervised Video Object Segmentation
par: Xiangyu, Zheng, et autres
Publié: (2025)
par: Xiangyu, Zheng, et autres
Publié: (2025)
VMonarch: Efficient Video Diffusion Transformers with Structured Attention
par: Liang, Cheng, et autres
Publié: (2026)
par: Liang, Cheng, et autres
Publié: (2026)
GLAD: Generative Language-Assisted Visual Tracking for Low-Semantic Templates
par: Luo, Xingyu, et autres
Publié: (2026)
par: Luo, Xingyu, et autres
Publié: (2026)
Temporally Consistent Referring Video Object Segmentation with Hybrid Memory
par: Miao, Bo, et autres
Publié: (2024)
par: Miao, Bo, et autres
Publié: (2024)
SlotMemory: Object-Centric KV Memory for Streaming Long-Video Generation
par: Dou, Weijia, et autres
Publié: (2026)
par: Dou, Weijia, et autres
Publié: (2026)
Spatial-Temporal Human-Object Interaction Detection
par: Sun, Xu, et autres
Publié: (2025)
par: Sun, Xu, et autres
Publié: (2025)
History-Aware Transformation of ReID Features for Multiple Object Tracking
par: Gao, Ruopeng, et autres
Publié: (2025)
par: Gao, Ruopeng, et autres
Publié: (2025)
Correspondence as Video: Test-Time Adaption on SAM2 for Reference Segmentation in the Wild
par: Wang, Haoran, et autres
Publié: (2025)
par: Wang, Haoran, et autres
Publié: (2025)
COVE: Unleashing the Diffusion Feature Correspondence for Consistent Video Editing
par: Wang, Jiangshan, et autres
Publié: (2024)
par: Wang, Jiangshan, et autres
Publié: (2024)
Latest Object Memory Management for Temporally Consistent Video Instance Segmentation
par: Lee, Seunghun, et autres
Publié: (2025)
par: Lee, Seunghun, et autres
Publié: (2025)
Efficient Video Object Segmentation via Modulated Cross-Attention Memory
par: Shaker, Abdelrahman, et autres
Publié: (2024)
par: Shaker, Abdelrahman, et autres
Publié: (2024)
Open-Vocabulary Camouflaged Object Segmentation
par: Pang, Youwei, et autres
Publié: (2023)
par: Pang, Youwei, et autres
Publié: (2023)
CoMo: Learning Continuous Latent Motion from Internet Videos for Scalable Robot Learning
par: Yang, Jiange, et autres
Publié: (2025)
par: Yang, Jiange, et autres
Publié: (2025)
Dynamic and Compressive Adaptation of Transformers From Images to Videos
par: Zhang, Guozhen, et autres
Publié: (2024)
par: Zhang, Guozhen, et autres
Publié: (2024)
StableDrag: Stable Dragging for Point-based Image Editing
par: Cui, Yutao, et autres
Publié: (2024)
par: Cui, Yutao, et autres
Publié: (2024)
Motion-Aware Generative Frame Interpolation
par: Zhang, Guozhen, et autres
Publié: (2025)
par: Zhang, Guozhen, et autres
Publié: (2025)
RMem: Restricted Memory Banks Improve Video Object Segmentation
par: Zhou, Junbao, et autres
Publié: (2024)
par: Zhou, Junbao, et autres
Publié: (2024)
Studying Image Diffusion Features for Zero-Shot Video Object Segmentation
par: Delatolas, Thanos, et autres
Publié: (2025)
par: Delatolas, Thanos, et autres
Publié: (2025)
PanoSAM2: Lightweight Distortion- and Memory-aware Adaptions of SAM2 for 360 Video Object Segmentation
par: Xiao, Dingwen, et autres
Publié: (2026)
par: Xiao, Dingwen, et autres
Publié: (2026)
Enhancing Video Object Segmentation in TrackRAD Using XMem Memory Network
par: Deng, Pengchao, et autres
Publié: (2025)
par: Deng, Pengchao, et autres
Publié: (2025)
Documents similaires
-
RGB-D Video Object Segmentation via Enhanced Multi-store Feature Memory
par: Xu, Boyue, et autres
Publié: (2025) -
MixFormerV2: Efficient Fully Transformer Tracking
par: Cui, Yutao, et autres
Publié: (2023) -
SportsHHI: A Dataset for Human-Human Interaction Detection in Sports Videos
par: Wu, Tao, et autres
Publié: (2024) -
MotionRAG: Motion Retrieval-Augmented Image-to-Video Generation
par: Zhu, Chenhui, et autres
Publié: (2025) -
SAM 2++: Tracking Anything at Any Granularity
par: Zhang, Jiaming, et autres
Publié: (2025)