MambaMOS: LiDAR-based 3D Moving Object Segmentation with Motion-aware State Space Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zeng, Kang, Shi, Hao, Lin, Jiacheng, Li, Siyu, Cheng, Jintao, Wang, Kaiwei, Li, Zhiyong, Yang, Kailun |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CFMW: Cross-modality Fusion Mamba for Robust Object Detection under Adverse Weather
par: Li, Haoyuan, et autres
Publié: (2024)
par: Li, Haoyuan, et autres
Publié: (2024)
Is there a relationship between Mean Opinion Score (MOS) and Just Noticeable Difference (JND)?
par: Zhu, Jingwen, et autres
Publié: (2026)
par: Zhu, Jingwen, et autres
Publié: (2026)
Inter-LPCM: Learning-based Inter-Frame Predictive Coding for LiDAR Point Cloud Compression
par: Sun, Chang, et autres
Publié: (2026)
par: Sun, Chang, et autres
Publié: (2026)
E-VLA: Event-Augmented Vision-Language-Action Model for Dark and Blurred Scenes
par: Zhai, Jiajun, et autres
Publié: (2026)
par: Zhai, Jiajun, et autres
Publié: (2026)
EvEnhancer: Empowering Effectiveness, Efficiency and Generalizability for Continuous Space-Time Video Super-Resolution with Events
par: Wei, Shuoyan, et autres
Publié: (2025)
par: Wei, Shuoyan, et autres
Publié: (2025)
A H.265/HEVC Fine-Grained ROI Video Encryption Algorithm Based on Coding Unit and Prompt Segmentation
par: Zhang, Xiang, et autres
Publié: (2026)
par: Zhang, Xiang, et autres
Publié: (2026)
Efficient Sub-pixel Motion Compensation in Learned Video Codecs
par: Ladune, Théo, et autres
Publié: (2025)
par: Ladune, Théo, et autres
Publié: (2025)
AV1 Motion Vector Fidelity and Application for Efficient Optical Flow
par: Zouein, Julien, et autres
Publié: (2025)
par: Zouein, Julien, et autres
Publié: (2025)
Exploring Event-based Human Pose Estimation with 3D Event Representations
par: Yin, Xiaoting, et autres
Publié: (2023)
par: Yin, Xiaoting, et autres
Publié: (2023)
Prompt-based Multimodal Semantic Communication for Multi-spectral Image Segmentation
par: Zhang, Haoshuo, et autres
Publié: (2025)
par: Zhang, Haoshuo, et autres
Publié: (2025)
Robust Multi-modal Task-oriented Communications with Redundancy-aware Representations
par: Fu, Jingwen, et autres
Publié: (2025)
par: Fu, Jingwen, et autres
Publié: (2025)
Audio-Visual Cross-Modal Compression for Generative Face Video Coding
par: Xu, Youmin, et autres
Publié: (2025)
par: Xu, Youmin, et autres
Publié: (2025)
Dual Inverse Degradation Network for Real-World SDRTV-to-HDRTV Conversion
par: Xu, Kepeng, et autres
Publié: (2023)
par: Xu, Kepeng, et autres
Publié: (2023)
Modeling Beyond MOS: Quality Assessment Models Must Integrate Context, Reasoning, and Multimodality
par: Kerkouri, Mohamed Amine, et autres
Publié: (2025)
par: Kerkouri, Mohamed Amine, et autres
Publié: (2025)
Towards User-level QoE: Large-scale Practice in Personalized Optimization of Adaptive Video Streaming
par: Jia, Lianchen, et autres
Publié: (2025)
par: Jia, Lianchen, et autres
Publié: (2025)
Progressive Frame Patching for FoV-based Point Cloud Video Streaming
par: Zong, Tongyu, et autres
Publié: (2023)
par: Zong, Tongyu, et autres
Publié: (2023)
TVMC: Time-Varying Mesh Compression via Multi-Stage Anchor Mesh Generation
par: Huang, He, et autres
Publié: (2025)
par: Huang, He, et autres
Publié: (2025)
Memory-Anchored Multimodal Reasoning for Explainable Video Forensics
par: Chen, Chen, et autres
Publié: (2025)
par: Chen, Chen, et autres
Publié: (2025)
Enhanced Quality Aware-Scalable Underwater Image Compression
par: Zhu, Linwei, et autres
Publié: (2025)
par: Zhu, Linwei, et autres
Publié: (2025)
ABC: Adaptive BayesNet Structure Learning for Computational Scalable Multi-task Image Compression
par: Zhang, Yufeng, et autres
Publié: (2025)
par: Zhang, Yufeng, et autres
Publié: (2025)
HippoMM: Hippocampal-inspired Multimodal Memory for Long Audiovisual Event Understanding
par: Lin, Yueqian, et autres
Publié: (2025)
par: Lin, Yueqian, et autres
Publié: (2025)
Camel: Frame-Level Bandwidth Estimation for Low-Latency Live Streaming under Video Bitrate Undershooting
par: Liu, Liming, et autres
Publié: (2026)
par: Liu, Liming, et autres
Publié: (2026)
AdaptiveClick: Clicks-aware Transformer with Adaptive Focal Loss for Interactive Image Segmentation
par: Lin, Jiacheng, et autres
Publié: (2023)
par: Lin, Jiacheng, et autres
Publié: (2023)
RefAtomNet++: Advancing Referring Atomic Video Action Recognition using Semantic Retrieval based Multi-Trajectory Mamba
par: Peng, Kunyu, et autres
Publié: (2025)
par: Peng, Kunyu, et autres
Publié: (2025)
In-Loop Filtering Using Learned Look-Up Tables for Video Coding
par: Li, Zhuoyuan, et autres
Publié: (2025)
par: Li, Zhuoyuan, et autres
Publié: (2025)
Towards Consistent Object Detection via LiDAR-Camera Synergy
par: Luo, Kai, et autres
Publié: (2024)
par: Luo, Kai, et autres
Publié: (2024)
Robust Live Streaming over LEO Satellite Constellations: Measurement, Analysis, and Handover-Aware Adaptation
par: Fang, Hao, et autres
Publié: (2025)
par: Fang, Hao, et autres
Publié: (2025)
Enhanced Template-based Intra Mode Derivation with Adaptive Block Vector Replacement
par: Zhang, Jiaqi, et autres
Publié: (2025)
par: Zhang, Jiaqi, et autres
Publié: (2025)
Transform and Entropy Coding in AV2
par: Nalci, Alican, et autres
Publié: (2026)
par: Nalci, Alican, et autres
Publié: (2026)
Tube-Structured Incremental Semantic HARQ for Generative Video Receivers
par: Wang, Xuesong, et autres
Publié: (2026)
par: Wang, Xuesong, et autres
Publié: (2026)
Rate-Quality or Energy-Quality Pareto Fronts for Adaptive Video Streaming?
par: Katsenou, Angeliki, et autres
Publié: (2024)
par: Katsenou, Angeliki, et autres
Publié: (2024)
Smaller is Better: Generative Models Can Power Short Video Preloading
par: Liu, Liming, et autres
Publié: (2026)
par: Liu, Liming, et autres
Publié: (2026)
NiMark: A Non-intrusive Watermarking Framework against Screen-shooting Attacks
par: Wu, Yufeng, et autres
Publié: (2026)
par: Wu, Yufeng, et autres
Publié: (2026)
Fast Multirate Encoding for 360° Video in OMAF Streaming Workflows
par: Premkumar, Amritha, et autres
Publié: (2026)
par: Premkumar, Amritha, et autres
Publié: (2026)
Decoding Complexity-Rate-Quality Pareto-Front for Adaptive VVC Streaming
par: Katsenou, Angeliki, et autres
Publié: (2024)
par: Katsenou, Angeliki, et autres
Publié: (2024)
GScomp-QA: A Subjective Dataset for Quality Assessment of Compressed Gaussian Splatting
par: Martin, Pedro, et autres
Publié: (2026)
par: Martin, Pedro, et autres
Publié: (2026)
Unravelling the Power of Single-Pass Look-Ahead in Modern Codecs for Optimized Transcoding Deployment
par: Vibhoothi, Vibhoothi, et autres
Publié: (2024)
par: Vibhoothi, Vibhoothi, et autres
Publié: (2024)
Perception-Aware Video Semantic Communication
par: Huang, Yinhuan, et autres
Publié: (2026)
par: Huang, Yinhuan, et autres
Publié: (2026)
Video Compression Beyond VVC: Quantitative Analysis of Intra Coding Tools in Enhanced Compression Model (ECM)
par: Abdoli, Mohsen, et autres
Publié: (2024)
par: Abdoli, Mohsen, et autres
Publié: (2024)
Dynamic resolution switching for live streaming
par: Xiong, Xin, et autres
Publié: (2026)
par: Xiong, Xin, et autres
Publié: (2026)
Documents similaires
-
CFMW: Cross-modality Fusion Mamba for Robust Object Detection under Adverse Weather
par: Li, Haoyuan, et autres
Publié: (2024) -
Is there a relationship between Mean Opinion Score (MOS) and Just Noticeable Difference (JND)?
par: Zhu, Jingwen, et autres
Publié: (2026) -
Inter-LPCM: Learning-based Inter-Frame Predictive Coding for LiDAR Point Cloud Compression
par: Sun, Chang, et autres
Publié: (2026) -
E-VLA: Event-Augmented Vision-Language-Action Model for Dark and Blurred Scenes
par: Zhai, Jiajun, et autres
Publié: (2026) -
EvEnhancer: Empowering Effectiveness, Efficiency and Generalizability for Continuous Space-Time Video Super-Resolution with Events
par: Wei, Shuoyan, et autres
Publié: (2025)