Mamba-360: Survey of State Space Models as Transformer Alternative for Long Sequence Modelling: Methods, Applications, and Challenges
Fuente:
arXiv
Saved in:
| Main Authors: | Patro, Badri Narayana, Agneeswaran, Vijay Srinivas |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
HAMSA: Scanning-Free Vision State Space Models via SpectralPulseNet
by: Patro, Badri N., et al.
Published: (2026)
by: Patro, Badri N., et al.
Published: (2026)
SiMBA: Simplified Mamba-Based Architecture for Vision and Multivariate Time series
by: Patro, Badri N., et al.
Published: (2024)
by: Patro, Badri N., et al.
Published: (2024)
LLMOrbit: A Circular Taxonomy of Large Language Models -From Scaling Walls to Agentic AI Systems
by: Patro, Badri N., et al.
Published: (2026)
by: Patro, Badri N., et al.
Published: (2026)
MambaMOS: LiDAR-based 3D Moving Object Segmentation with Motion-aware State Space Model
by: Zeng, Kang, et al.
Published: (2024)
by: Zeng, Kang, et al.
Published: (2024)
NeRV360: Neural Representation for 360-Degree Videos with a Viewport Decoder
by: Arai, Daichi, et al.
Published: (2025)
by: Arai, Daichi, et al.
Published: (2025)
Sphere-GAN: a GAN-based Approach for Saliency Estimation in 360° Videos
by: Wahba, Mahmoud Z. A., et al.
Published: (2025)
by: Wahba, Mahmoud Z. A., et al.
Published: (2025)
AIM 2024 Challenge on Compressed Video Quality Assessment: Methods and Results
by: Smirnov, Maksim, et al.
Published: (2024)
by: Smirnov, Maksim, et al.
Published: (2024)
AIM 2024 Challenge on Video Super-Resolution Quality Assessment: Methods and Results
by: Molodetskikh, Ivan, et al.
Published: (2024)
by: Molodetskikh, Ivan, et al.
Published: (2024)
Multi-task Just Recognizable Difference for Video Coding for Machines: Database, Model, and Coding Application
by: Liu, Junqi, et al.
Published: (2026)
by: Liu, Junqi, et al.
Published: (2026)
Perceptual Video Quality Assessment: A Survey
by: Min, Xiongkuo, et al.
Published: (2024)
by: Min, Xiongkuo, et al.
Published: (2024)
NAKUL-Med: Spectral-Graph State Space Models with Dynamics Kernels for Medical Signals
by: Patro, Badri N., et al.
Published: (2026)
by: Patro, Badri N., et al.
Published: (2026)
Modeling Beyond MOS: Quality Assessment Models Must Integrate Context, Reasoning, and Multimodality
by: Kerkouri, Mohamed Amine, et al.
Published: (2025)
by: Kerkouri, Mohamed Amine, et al.
Published: (2025)
CFMW: Cross-modality Fusion Mamba for Robust Object Detection under Adverse Weather
by: Li, Haoyuan, et al.
Published: (2024)
by: Li, Haoyuan, et al.
Published: (2024)
ICME 2025 Grand Challenge on Video Super-Resolution for Video Conferencing
by: Naderi, Babak, et al.
Published: (2025)
by: Naderi, Babak, et al.
Published: (2025)
ICME 2025 Generalizable HDR and SDR Video Quality Measurement Grand Challenge
by: Chen, Yixu, et al.
Published: (2025)
by: Chen, Yixu, et al.
Published: (2025)
LFACon: Introducing Anglewise Attention to No-Reference Quality Assessment in Light Field Space
by: Qu, Qiang, et al.
Published: (2023)
by: Qu, Qiang, et al.
Published: (2023)
Towards Robust and Generalizable Continuous Space-Time Video Super-Resolution with Events
by: Wei, Shuoyan, et al.
Published: (2025)
by: Wei, Shuoyan, et al.
Published: (2025)
py360tool: Um framework para manipulação de vídeo 360$^\circ$ com ladrilhos
by: Garcia, Henrique Domingues, et al.
Published: (2025)
by: Garcia, Henrique Domingues, et al.
Published: (2025)
Learned Image Compression with Hierarchical Progressive Context Modeling
by: Li, Yuqi, et al.
Published: (2025)
by: Li, Yuqi, et al.
Published: (2025)
Optimizing Multimodal LLMs for Egocentric Video Understanding: A Solution for the HD-EPIC VQA Challenge
by: Yang, Sicheng, et al.
Published: (2026)
by: Yang, Sicheng, et al.
Published: (2026)
EditMGT: Unleashing Potentials of Masked Generative Transformers in Image Editing
by: Chow, Wei, et al.
Published: (2025)
by: Chow, Wei, et al.
Published: (2025)
Event Camera Demosaicing via Swin Transformer and Pixel-focus Loss
by: Lu, Yunfan, et al.
Published: (2024)
by: Lu, Yunfan, et al.
Published: (2024)
Off-the-shelf Vision Models Benefit Image Manipulation Localization
by: Zhang, Zhengxuan, et al.
Published: (2026)
by: Zhang, Zhengxuan, et al.
Published: (2026)
Generative Preprocessing for Image Compression with Pre-trained Diffusion Models
by: Guo, Mengxi, et al.
Published: (2025)
by: Guo, Mengxi, et al.
Published: (2025)
A Dynamic Prognostic Prediction Method for Colorectal Cancer Liver Metastasis
by: Yang, Wei, et al.
Published: (2025)
by: Yang, Wei, et al.
Published: (2025)
Audio-Visual Quality Assessment for User Generated Content: Database and Method
by: Cao, Yuqin, et al.
Published: (2023)
by: Cao, Yuqin, et al.
Published: (2023)
An Adaptive Method for Camera Attribution under Complex Radial Distortion Corrections
by: Montibeller, Andrea, et al.
Published: (2023)
by: Montibeller, Andrea, et al.
Published: (2023)
Context and Pixel Aware Large Language Model for Video Quality Assessment
by: Wen, Wen, et al.
Published: (2025)
by: Wen, Wen, et al.
Published: (2025)
LLIC: Large Receptive Field Transform Coding with Adaptive Weights for Learned Image Compression
by: Jiang, Wei, et al.
Published: (2023)
by: Jiang, Wei, et al.
Published: (2023)
Analysis of Video Quality Datasets via Design of Minimalistic Video Quality Models
by: Sun, Wei, et al.
Published: (2023)
by: Sun, Wei, et al.
Published: (2023)
R-Bench: Are your Large Multimodal Model Robust to Real-world Corruptions?
by: Li, Chunyi, et al.
Published: (2024)
by: Li, Chunyi, et al.
Published: (2024)
HiDE: Hierarchical Dictionary-Based Entropy Modeling for Learned Image Compression
by: Xiong, Haoxuan, et al.
Published: (2026)
by: Xiong, Haoxuan, et al.
Published: (2026)
Safe-VAR: Safe Visual Autoregressive Model for Text-to-Image Generative Watermarking
by: Wang, Ziyi, et al.
Published: (2025)
by: Wang, Ziyi, et al.
Published: (2025)
Beyond Alignment: Blind Video Face Restoration via Parsing-Guided Temporal-Coherent Transformer
by: Xu, Kepeng, et al.
Published: (2024)
by: Xu, Kepeng, et al.
Published: (2024)
RoWSFormer: A Robust Watermarking Framework with Swin Transformer for Enhanced Geometric Attack Resilience
by: Chen, Weitong, et al.
Published: (2024)
by: Chen, Weitong, et al.
Published: (2024)
Surveillance Facial Image Quality Assessment: A Multi-dimensional Dataset and Lightweight Model
by: Jiang, Yanwei, et al.
Published: (2026)
by: Jiang, Yanwei, et al.
Published: (2026)
MMFusion: Multi-modality Diffusion Model for Lymph Node Metastasis Diagnosis in Esophageal Cancer
by: Wu, Chengyu, et al.
Published: (2024)
by: Wu, Chengyu, et al.
Published: (2024)
LAR-IQA: A Lightweight, Accurate, and Robust No-Reference Image Quality Assessment Model
by: Avanaki, Nasim Jamshidi, et al.
Published: (2024)
by: Avanaki, Nasim Jamshidi, et al.
Published: (2024)
RefAtomNet++: Advancing Referring Atomic Video Action Recognition using Semantic Retrieval based Multi-Trajectory Mamba
by: Peng, Kunyu, et al.
Published: (2025)
by: Peng, Kunyu, et al.
Published: (2025)
Exploration of Learned Lifting-Based Transform Structures for Fully Scalable and Accessible Wavelet-Like Image Compression
by: Li, Xinyue, et al.
Published: (2024)
by: Li, Xinyue, et al.
Published: (2024)
Similar Items
-
HAMSA: Scanning-Free Vision State Space Models via SpectralPulseNet
by: Patro, Badri N., et al.
Published: (2026) -
SiMBA: Simplified Mamba-Based Architecture for Vision and Multivariate Time series
by: Patro, Badri N., et al.
Published: (2024) -
LLMOrbit: A Circular Taxonomy of Large Language Models -From Scaling Walls to Agentic AI Systems
by: Patro, Badri N., et al.
Published: (2026) -
MambaMOS: LiDAR-based 3D Moving Object Segmentation with Motion-aware State Space Model
by: Zeng, Kang, et al.
Published: (2024) -
NeRV360: Neural Representation for 360-Degree Videos with a Viewport Decoder
by: Arai, Daichi, et al.
Published: (2025)