RS-SSM: Refining Forgotten Specifics in State Space Model for Video Semantic Segmentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhu, Kai, Cui, Zhenyu, Zang, Zehua, Zhou, Jiahuan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
State Space Prompting via Gathering and Spreading Spatio-Temporal Information for Video Understanding
par: Zhou, Jiahuan, et autres
Publié: (2025)
par: Zhou, Jiahuan, et autres
Publié: (2025)
LaSSM: Efficient Semantic-Spatial Query Decoding via Local Aggregation and State Space Models for 3D Instance Segmentation
par: Yao, Lei, et autres
Publié: (2026)
par: Yao, Lei, et autres
Publié: (2026)
VideoSSM: Autoregressive Long Video Generation with Hybrid State-Space Memory
par: Yu, Yifei, et autres
Publié: (2025)
par: Yu, Yifei, et autres
Publié: (2025)
Bi-C2R: Bidirectional Continual Compatible Representation for Re-indexing Free Lifelong Person Re-identification
par: Cui, Zhenyu, et autres
Publié: (2025)
par: Cui, Zhenyu, et autres
Publié: (2025)
CKDA: Cross-modality Knowledge Disentanglement and Alignment for Visible-Infrared Lifelong Person Re-identification
par: Cui, Zhenyu, et autres
Publié: (2025)
par: Cui, Zhenyu, et autres
Publié: (2025)
RS3Mamba: Visual State Space Model for Remote Sensing Images Semantic Segmentation
par: Ma, Xianping, et autres
Publié: (2024)
par: Ma, Xianping, et autres
Publié: (2024)
Test-Time Perturbation Learning with Delayed Feedback for Vision-Language-Action Models
par: Zang, Zehua, et autres
Publié: (2026)
par: Zang, Zehua, et autres
Publié: (2026)
TrackSSM: A General Motion Predictor by State-Space Model
par: Hu, Bin, et autres
Publié: (2024)
par: Hu, Bin, et autres
Publié: (2024)
UST-SSM: Unified Spatio-Temporal State Space Models for Point Cloud Video Modeling
par: Li, Peiming, et autres
Publié: (2025)
par: Li, Peiming, et autres
Publié: (2025)
SSM Meets Video Diffusion Models: Efficient Long-Term Video Generation with Structured State Spaces
par: Oshima, Yuta, et autres
Publié: (2024)
par: Oshima, Yuta, et autres
Publié: (2024)
UPP: Unified Point-Level Prompting for Robust Point Cloud Analysis
par: Ai, Zixiang, et autres
Publié: (2025)
par: Ai, Zixiang, et autres
Publié: (2025)
Samba: Semantic Segmentation of Remotely Sensed Images with State Space Model
par: Zhu, Qinfeng, et autres
Publié: (2024)
par: Zhu, Qinfeng, et autres
Publié: (2024)
Class-aware Domain Knowledge Fusion and Fission for Continual Test-Time Adaptation
par: Zhou, Jiahuan, et autres
Publié: (2025)
par: Zhou, Jiahuan, et autres
Publié: (2025)
GAPrompt: Geometry-Aware Point Cloud Prompt for 3D Vision Model
par: Ai, Zixiang, et autres
Publié: (2025)
par: Ai, Zixiang, et autres
Publié: (2025)
RSGMamba: Reliability-Aware Self-Gated State Space Model for Multimodal Semantic Segmentation
par: Xu, Guoan, et autres
Publié: (2026)
par: Xu, Guoan, et autres
Publié: (2026)
TRUST: Test-Time Refinement using Uncertainty-Guided SSM Traverses
par: Dastani, Sahar, et autres
Publié: (2025)
par: Dastani, Sahar, et autres
Publié: (2025)
TCP-SSM: Efficient Vision State Space Models with Token-Conditioned Poles
par: Shoouri, Sara, et autres
Publié: (2026)
par: Shoouri, Sara, et autres
Publié: (2026)
MV-SSM: Multi-View State Space Modeling for 3D Human Pose Estimation
par: Chharia, Aviral, et autres
Publié: (2025)
par: Chharia, Aviral, et autres
Publié: (2025)
VFIMamba: Video Frame Interpolation with State Space Models
par: Zhang, Guozhen, et autres
Publié: (2024)
par: Zhang, Guozhen, et autres
Publié: (2024)
Vision Graph Prompting via Semantic Low-Rank Decomposition
par: Ai, Zixiang, et autres
Publié: (2025)
par: Ai, Zixiang, et autres
Publié: (2025)
Pixel-Level Domain Adaptation: A New Perspective for Enhancing Weakly Supervised Semantic Segmentation
par: Du, Ye, et autres
Publié: (2024)
par: Du, Ye, et autres
Publié: (2024)
Refining Segmentation On-the-Fly: An Interactive Framework for Point Cloud Semantic Segmentation
par: Zhang, Peng, et autres
Publié: (2024)
par: Zhang, Peng, et autres
Publié: (2024)
Selective Visual Prompting in Vision Mamba
par: Yao, Yifeng, et autres
Publié: (2024)
par: Yao, Yifeng, et autres
Publié: (2024)
Sparse Refinement for Efficient High-Resolution Semantic Segmentation
par: Liu, Zhijian, et autres
Publié: (2024)
par: Liu, Zhijian, et autres
Publié: (2024)
MambaVF: State Space Model for Efficient Video Fusion
par: Zhao, Zixiang, et autres
Publié: (2026)
par: Zhao, Zixiang, et autres
Publié: (2026)
MambaVLT: Time-Evolving Multimodal State Space Model for Vision-Language Tracking
par: Liu, Xinqi, et autres
Publié: (2024)
par: Liu, Xinqi, et autres
Publié: (2024)
CAPrompt: Cyclic Prompt Aggregation for Pre-Trained Model Based Class Incremental Learning
par: Li, Qiwei, et autres
Publié: (2024)
par: Li, Qiwei, et autres
Publié: (2024)
Harnessing Vision-Language Pretrained Models with Temporal-Aware Adaptation for Referring Video Object Segmentation
par: Zhou, Zikun, et autres
Publié: (2024)
par: Zhou, Zikun, et autres
Publié: (2024)
RainMamba: Enhanced Locality Learning with State Space Models for Video Deraining
par: Wu, Hongtao, et autres
Publié: (2024)
par: Wu, Hongtao, et autres
Publié: (2024)
Cortical-SSM: A Deep State Space Model for EEG and ECoG Motor Imagery Decoding
par: Suzuki, Shuntaro, et autres
Publié: (2025)
par: Suzuki, Shuntaro, et autres
Publié: (2025)
SegMAN: Omni-scale Context Modeling with State Space Models and Local Attention for Semantic Segmentation
par: Fu, Yunxiang, et autres
Publié: (2024)
par: Fu, Yunxiang, et autres
Publié: (2024)
Cross-modal State Space Modeling for Real-time RGB-thermal Wild Scene Semantic Segmentation
par: Guo, Xiaodong, et autres
Publié: (2025)
par: Guo, Xiaodong, et autres
Publié: (2025)
PPMamba: A Pyramid Pooling Local Auxiliary SSM-Based Model for Remote Sensing Image Semantic Segmentation
par: Hu, Yin, et autres
Publié: (2024)
par: Hu, Yin, et autres
Publié: (2024)
Generative Refinement Networks for Visual Synthesis
par: Han, Jian, et autres
Publié: (2026)
par: Han, Jian, et autres
Publié: (2026)
RefineAnything: Multimodal Region-Specific Refinement for Perfect Local Details
par: Zhou, Dewei, et autres
Publié: (2026)
par: Zhou, Dewei, et autres
Publié: (2026)
Planner-Refiner: Dynamic Space-Time Refinement for Vision-Language Alignment in Videos
par: Tran, Tuyen, et autres
Publié: (2025)
par: Tran, Tuyen, et autres
Publié: (2025)
AFRDA: Attentive Feature Refinement for Domain Adaptive Semantic Segmentation
par: Khan, Md. Al-Masrur, et autres
Publié: (2025)
par: Khan, Md. Al-Masrur, et autres
Publié: (2025)
SemanticGen: Video Generation in Semantic Space
par: Bai, Jianhong, et autres
Publié: (2025)
par: Bai, Jianhong, et autres
Publié: (2025)
Learning Spatial-Semantic Features for Robust Video Object Segmentation
par: Li, Xin, et autres
Publié: (2024)
par: Li, Xin, et autres
Publié: (2024)
Exploring State Space Model in Wavelet Domain: An Infrared and Visible Image Fusion Network via Wavelet Transform and State Space Model
par: Zhang, Tianpei, et autres
Publié: (2025)
par: Zhang, Tianpei, et autres
Publié: (2025)
Documents similaires
-
State Space Prompting via Gathering and Spreading Spatio-Temporal Information for Video Understanding
par: Zhou, Jiahuan, et autres
Publié: (2025) -
LaSSM: Efficient Semantic-Spatial Query Decoding via Local Aggregation and State Space Models for 3D Instance Segmentation
par: Yao, Lei, et autres
Publié: (2026) -
VideoSSM: Autoregressive Long Video Generation with Hybrid State-Space Memory
par: Yu, Yifei, et autres
Publié: (2025) -
Bi-C2R: Bidirectional Continual Compatible Representation for Re-indexing Free Lifelong Person Re-identification
par: Cui, Zhenyu, et autres
Publié: (2025) -
CKDA: Cross-modality Knowledge Disentanglement and Alignment for Visible-Infrared Lifelong Person Re-identification
par: Cui, Zhenyu, et autres
Publié: (2025)