Surgical-MambaLLM: Mamba2-enhanced Multimodal Large Language Model for VQLA in Robotic Surgery
Fuente:
arXiv
Saved in:
| Main Authors: | Hao, Pengfei, Wang, Hongqiu, Li, Shuaibo, Xing, Zhaohu, Yang, Guang, Wu, Kaishun, Zhu, Lei |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning
by: Hao, Pengfei, et al.
Published: (2025)
by: Hao, Pengfei, et al.
Published: (2025)
SegMamba: Long-range Sequential Modeling Mamba For 3D Medical Image Segmentation
by: Xing, Zhaohu, et al.
Published: (2024)
by: Xing, Zhaohu, et al.
Published: (2024)
Toward Medical Deepfake Detection: A Comprehensive Dataset and Novel Method
by: Li, Shuaibo, et al.
Published: (2025)
by: Li, Shuaibo, et al.
Published: (2025)
HybridMamba: A Dual-domain Mamba for 3D Medical Image Segmentation
by: Wu, Weitong, et al.
Published: (2025)
by: Wu, Weitong, et al.
Published: (2025)
Vivim: a Video Vision Mamba for Medical Video Segmentation
by: Yang, Yijun, et al.
Published: (2024)
by: Yang, Yijun, et al.
Published: (2024)
SegDINO: An Efficient Design for Medical and Natural Image Segmentation with DINO-V3
by: Yang, Sicheng, et al.
Published: (2025)
by: Yang, Sicheng, et al.
Published: (2025)
Surgical-VQLA++: Adversarial Contrastive Learning for Calibrated Robust Visual Question-Localized Answering in Robotic Surgery
by: Bai, Long, et al.
Published: (2024)
by: Bai, Long, et al.
Published: (2024)
Serp-Mamba: Advancing High-Resolution Retinal Vessel Segmentation with Selective State-Space Model
by: Wang, Hongqiu, et al.
Published: (2024)
by: Wang, Hongqiu, et al.
Published: (2024)
Toward Real-World High-Precision Image Matting and Segmentation
by: Zhou, Haipeng, et al.
Published: (2026)
by: Zhou, Haipeng, et al.
Published: (2026)
EchoPilot: Training-Free Ultrasound Video Segmentation via Scale-Space Semantic Prompting and Reliability-Gated Memory
by: Xiao, Ruiqiang, et al.
Published: (2026)
by: Xiao, Ruiqiang, et al.
Published: (2026)
Period-LLM: Extending the Periodic Capability of Multimodal Large Language Model
by: Zhang, Yuting, et al.
Published: (2025)
by: Zhang, Yuting, et al.
Published: (2025)
ColorMamba: Towards High-quality NIR-to-RGB Spectral Translation with Mamba
by: Zhai, Huiyu, et al.
Published: (2024)
by: Zhai, Huiyu, et al.
Published: (2024)
VQ-Seg: Vector-Quantized Token Perturbation for Semi-Supervised Medical Image Segmentation
by: Yang, Sicheng, et al.
Published: (2026)
by: Yang, Sicheng, et al.
Published: (2026)
AlignMamba: Enhancing Multimodal Mamba with Local and Global Cross-modal Alignment
by: Li, Yan, et al.
Published: (2024)
by: Li, Yan, et al.
Published: (2024)
InceptionMamba: An Efficient Hybrid Network with Large Band Convolution and Bottleneck Mamba
by: Wang, Yuhang, et al.
Published: (2025)
by: Wang, Yuhang, et al.
Published: (2025)
DAPointMamba: Domain Adaptive Point Mamba for Point Cloud Completion
by: Li, Yinghui, et al.
Published: (2025)
by: Li, Yinghui, et al.
Published: (2025)
UAVD-Mamba: Deformable Token Fusion Vision Mamba for Multimodal UAV Detection
by: Li, Wei, et al.
Published: (2025)
by: Li, Wei, et al.
Published: (2025)
Non-Invasive to Invasive: Enhancing FFA Synthesis from CFP with a Benchmark Dataset and a Novel Network
by: Wang, Hongqiu, et al.
Published: (2024)
by: Wang, Hongqiu, et al.
Published: (2024)
ML-Mamba: Efficient Multi-Modal Large Language Model Utilizing Mamba-2
by: Huang, Wenjun, et al.
Published: (2024)
by: Huang, Wenjun, et al.
Published: (2024)
HGP-Mamba: Integrating Histology and Generated Protein Features for Mamba-based Multimodal Survival Risk Prediction
by: Dai, Jing, et al.
Published: (2026)
by: Dai, Jing, et al.
Published: (2026)
FusionMamba: Dynamic Feature Enhancement for Multimodal Image Fusion with Mamba
by: Xie, Xinyu, et al.
Published: (2024)
by: Xie, Xinyu, et al.
Published: (2024)
Diversity-enhanced Collaborative Mamba for Semi-supervised Medical Image Segmentation
by: Li, Shumeng, et al.
Published: (2025)
by: Li, Shumeng, et al.
Published: (2025)
HilbertMamba: Local-Global Reciprocal Network for Uterine Fibroid Segmentation in Ultrasound Videos
by: Xu, Huihui, et al.
Published: (2024)
by: Xu, Huihui, et al.
Published: (2024)
MSCrackMamba: Leveraging Vision Mamba for Crack Detection in Fused Multispectral Imagery
by: Zhu, Qinfeng, et al.
Published: (2024)
by: Zhu, Qinfeng, et al.
Published: (2024)
ProMamba: Prompt-Mamba for polyp segmentation
by: Xie, Jianhao, et al.
Published: (2024)
by: Xie, Jianhao, et al.
Published: (2024)
MobileMamba: Lightweight Multi-Receptive Visual Mamba Network
by: He, Haoyang, et al.
Published: (2024)
by: He, Haoyang, et al.
Published: (2024)
RS-Mamba for Large Remote Sensing Image Dense Prediction
by: Zhao, Sijie, et al.
Published: (2024)
by: Zhao, Sijie, et al.
Published: (2024)
K-Stain: Keypoint-Driven Correspondence for H&E-to-IHC Virtual Staining
by: Yang, Sicheng, et al.
Published: (2025)
by: Yang, Sicheng, et al.
Published: (2025)
Mamba-YOLO-World: Marrying YOLO-World with Mamba for Open-Vocabulary Detection
by: Wang, Haoxuan, et al.
Published: (2024)
by: Wang, Haoxuan, et al.
Published: (2024)
MambaRain: Multi-Scale Mamba-Attention Framework for 0-3 Hour Precipitation Nowcasting
by: Shi, Chunlei, et al.
Published: (2026)
by: Shi, Chunlei, et al.
Published: (2026)
Mamba-in-Mamba: Centralized Mamba-Cross-Scan in Tokenized Mamba Model for Hyperspectral Image Classification
by: Zhou, Weilian, et al.
Published: (2024)
by: Zhou, Weilian, et al.
Published: (2024)
UNetMamba: An Efficient UNet-Like Mamba for Semantic Segmentation of High-Resolution Remote Sensing Images
by: Zhu, Enze, et al.
Published: (2024)
by: Zhu, Enze, et al.
Published: (2024)
MambaMIR: An Arbitrary-Masked Mamba for Joint Medical Image Reconstruction and Uncertainty Estimation
by: Huang, Jiahao, et al.
Published: (2024)
by: Huang, Jiahao, et al.
Published: (2024)
SPRMamba: Surgical Phase Recognition for Endoscopic Submucosal Dissection with Mamba
by: Zhang, Xiangning, et al.
Published: (2024)
by: Zhang, Xiangning, et al.
Published: (2024)
WaveMamba: Wavelet-Driven Mamba Fusion for RGB-Infrared Object Detection
by: Zhu, Haodong, et al.
Published: (2025)
by: Zhu, Haodong, et al.
Published: (2025)
RoboMamba: Efficient Vision-Language-Action Model for Robotic Reasoning and Manipulation
by: Liu, Jiaming, et al.
Published: (2024)
by: Liu, Jiaming, et al.
Published: (2024)
SwinMamba: A hybrid local-global mamba framework for enhancing semantic segmentation of remotely sensed images
by: Zhu, Qinfeng, et al.
Published: (2025)
by: Zhu, Qinfeng, et al.
Published: (2025)
DepMamba: Progressive Fusion Mamba for Multimodal Depression Detection
by: Ye, Jiaxin, et al.
Published: (2024)
by: Ye, Jiaxin, et al.
Published: (2024)
MambaNUT: Nighttime UAV Tracking via Mamba-based Adaptive Curriculum Learning
by: Wu, You, et al.
Published: (2024)
by: Wu, You, et al.
Published: (2024)
MambaBEV: An EV-based 3D detection model with Mamba2
by: You, Zihan, et al.
Published: (2024)
by: You, Zihan, et al.
Published: (2024)
Similar Items
-
Surgery-R1: Advancing Surgical-VQLA with Reasoning Multimodal Large Language Model via Reinforcement Learning
by: Hao, Pengfei, et al.
Published: (2025) -
SegMamba: Long-range Sequential Modeling Mamba For 3D Medical Image Segmentation
by: Xing, Zhaohu, et al.
Published: (2024) -
Toward Medical Deepfake Detection: A Comprehensive Dataset and Novel Method
by: Li, Shuaibo, et al.
Published: (2025) -
HybridMamba: A Dual-domain Mamba for 3D Medical Image Segmentation
by: Wu, Weitong, et al.
Published: (2025) -
Vivim: a Video Vision Mamba for Medical Video Segmentation
by: Yang, Yijun, et al.
Published: (2024)