EndoMamba: An Efficient Foundation Model for Endoscopic Videos via Hierarchical Pre-training
Fuente:
arXiv
Salvato in:
| Autori principali: | Tian, Qingyao, Liao, Huai, Huang, Xinyan, Yang, Bingyu, Lei, Dongdong, Ourselin, Sebastien, Liu, Hongbin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
EndoMatcher: Generalizable Endoscopic Image Matcher via Multi-Domain Pre-training for Robot-Assisted Surgery
di: Yang, Bingyu, et al.
Pubblicazione: (2025)
di: Yang, Bingyu, et al.
Pubblicazione: (2025)
EndoOmni: Zero-Shot Cross-Dataset Depth Estimation in Endoscopy by Robust Self-Learning from Noisy Labels
di: Tian, Qingyao, et al.
Pubblicazione: (2024)
di: Tian, Qingyao, et al.
Pubblicazione: (2024)
Harnessing Foundation Models for Robust and Generalizable 6-DOF Bronchoscopy Localization
di: Tian, Qingyao, et al.
Pubblicazione: (2025)
di: Tian, Qingyao, et al.
Pubblicazione: (2025)
DD-VNB: A Depth-based Dual-Loop Framework for Real-time Visually Navigated Bronchoscopy
di: Tian, Qingyao, et al.
Pubblicazione: (2024)
di: Tian, Qingyao, et al.
Pubblicazione: (2024)
BREATH-VL: Vision-Language-Guided 6-DoF Bronchoscopy Localization via Semantic-Geometric Fusion
di: Tian, Qingyao, et al.
Pubblicazione: (2026)
di: Tian, Qingyao, et al.
Pubblicazione: (2026)
PANS: Probabilistic Airway Navigation System for Real-time Robust Bronchoscope Localization
di: Tian, Qingyao, et al.
Pubblicazione: (2024)
di: Tian, Qingyao, et al.
Pubblicazione: (2024)
Progressive Curriculum Learning with Scale-Enhanced U-Net for Continuous Airway Segmentation
di: Yang, Bingyu, et al.
Pubblicazione: (2024)
di: Yang, Bingyu, et al.
Pubblicazione: (2024)
BronchoTrack: Airway Lumen Tracking for Branch-Level Bronchoscopic Localization
di: Tian, Qingyao, et al.
Pubblicazione: (2024)
di: Tian, Qingyao, et al.
Pubblicazione: (2024)
Enhancing Bronchoscopy Depth Estimation through Synthetic-to-Real Domain Adaptation
di: Tian, Qingyao, et al.
Pubblicazione: (2024)
di: Tian, Qingyao, et al.
Pubblicazione: (2024)
Endo-4DGX: Robust Endoscopic Scene Reconstruction and Illumination Correction with Gaussian Splatting
di: Huang, Yiming, et al.
Pubblicazione: (2025)
di: Huang, Yiming, et al.
Pubblicazione: (2025)
EndoGen: Conditional Autoregressive Endoscopic Video Generation
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
EndoChat: Grounded Multimodal Large Language Model for Endoscopic Surgery
di: Wang, Guankun, et al.
Pubblicazione: (2025)
di: Wang, Guankun, et al.
Pubblicazione: (2025)
Endo-FASt3r: Endoscopic Foundation model Adaptation for Structure from motion
di: Zeinoddin, Mona Sheikh, et al.
Pubblicazione: (2025)
di: Zeinoddin, Mona Sheikh, et al.
Pubblicazione: (2025)
Endo-SemiS: Towards Robust Semi-Supervised Image Segmentation for Endoscopic Video
di: Li, Hao, et al.
Pubblicazione: (2025)
di: Li, Hao, et al.
Pubblicazione: (2025)
Endo3R: Unified Online Reconstruction from Dynamic Monocular Endoscopic Video
di: Guo, Jiaxin, et al.
Pubblicazione: (2025)
di: Guo, Jiaxin, et al.
Pubblicazione: (2025)
EndoARSS: Adapting Spatially-Aware Foundation Model for Efficient Activity Recognition and Semantic Segmentation in Endoscopic Surgery
di: Wang, Guankun, et al.
Pubblicazione: (2025)
di: Wang, Guankun, et al.
Pubblicazione: (2025)
EndoDAC: Efficient Adapting Foundation Model for Self-Supervised Depth Estimation from Any Endoscopic Camera
di: Cui, Beilei, et al.
Pubblicazione: (2024)
di: Cui, Beilei, et al.
Pubblicazione: (2024)
Endo-CLIP: Progressive Self-Supervised Pre-training on Raw Colonoscopy Records
di: He, Yili, et al.
Pubblicazione: (2025)
di: He, Yili, et al.
Pubblicazione: (2025)
MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
di: Yahathugoda, Yovin, et al.
Pubblicazione: (2025)
di: Yahathugoda, Yovin, et al.
Pubblicazione: (2025)
Towards Data-Efficient Video Pre-training with Frozen Image Foundation Models
di: Orlova, Svetlana, et al.
Pubblicazione: (2026)
di: Orlova, Svetlana, et al.
Pubblicazione: (2026)
EndoStreamDepth: Temporally Consistent Monocular Depth Estimation for Endoscopic Video Streams
di: Li, Hao, et al.
Pubblicazione: (2025)
di: Li, Hao, et al.
Pubblicazione: (2025)
CellMamba: Adaptive Mamba for Accurate and Efficient Cell Detection
di: Liu, Ruochen, et al.
Pubblicazione: (2025)
di: Liu, Ruochen, et al.
Pubblicazione: (2025)
Hi-Mamba: Hierarchical Mamba for Efficient Image Super-Resolution
di: Qiao, Junbo, et al.
Pubblicazione: (2024)
di: Qiao, Junbo, et al.
Pubblicazione: (2024)
DaFoEs: Mixing Datasets towards the generalization of vision-state deep-learning Force Estimation in Minimally Invasive Robotic Surgery
di: Reyzabal, Mikel De Iturrate, et al.
Pubblicazione: (2024)
di: Reyzabal, Mikel De Iturrate, et al.
Pubblicazione: (2024)
Exploring Pre-trained Text-to-Video Diffusion Models for Referring Video Object Segmentation
di: Zhu, Zixin, et al.
Pubblicazione: (2024)
di: Zhu, Zixin, et al.
Pubblicazione: (2024)
HieraMamba: Video Temporal Grounding via Hierarchical Anchor-Mamba Pooling
di: An, Joungbin, et al.
Pubblicazione: (2025)
di: An, Joungbin, et al.
Pubblicazione: (2025)
EndoGaussian: Real-time Gaussian Splatting for Dynamic Endoscopic Scene Reconstruction
di: Liu, Yifan, et al.
Pubblicazione: (2024)
di: Liu, Yifan, et al.
Pubblicazione: (2024)
EndoDDC: Learning Sparse to Dense Reconstruction for Endoscopic Robotic Navigation via Diffusion Depth Completion
di: Lin, Yinheng, et al.
Pubblicazione: (2026)
di: Lin, Yinheng, et al.
Pubblicazione: (2026)
SurgeMOD: Translating image-space tissue motions into vision-based surgical forces
di: Reyzabal, Mikel De Iturrate, et al.
Pubblicazione: (2024)
di: Reyzabal, Mikel De Iturrate, et al.
Pubblicazione: (2024)
EndoGS: Deformable Endoscopic Tissues Reconstruction with Gaussian Splatting
di: Zhu, Lingting, et al.
Pubblicazione: (2024)
di: Zhu, Lingting, et al.
Pubblicazione: (2024)
EndoWave: Rational-Wavelet 4D Gaussian Splatting for Endoscopic Reconstruction
di: Wu, Taoyu, et al.
Pubblicazione: (2025)
di: Wu, Taoyu, et al.
Pubblicazione: (2025)
LapFM: A Laparoscopic Segmentation Foundation Model via Hierarchical Concept Evolving Pre-training
di: Xu, Qing, et al.
Pubblicazione: (2025)
di: Xu, Qing, et al.
Pubblicazione: (2025)
EndoCaver: Handling Fog, Blur and Glare in Endoscopic Images via Joint Deblurring-Segmentation
di: Wu, Zhuoyu, et al.
Pubblicazione: (2026)
di: Wu, Zhuoyu, et al.
Pubblicazione: (2026)
Endo-4DGS: Endoscopic Monocular Scene Reconstruction with 4D Gaussian Splatting
di: Huang, Yiming, et al.
Pubblicazione: (2024)
di: Huang, Yiming, et al.
Pubblicazione: (2024)
EndoGSim: Physics-Aware 4D Dynamic Endoscopic Scene Simulations via MLLM-Guided Gaussian Splatting
di: Liu, Changjing, et al.
Pubblicazione: (2026)
di: Liu, Changjing, et al.
Pubblicazione: (2026)
EndoDepth: A Benchmark for Assessing Robustness in Endoscopic Depth Prediction
di: Reyes-Amezcua, Ivan, et al.
Pubblicazione: (2024)
di: Reyes-Amezcua, Ivan, et al.
Pubblicazione: (2024)
Foundation Model for Endoscopy Video Analysis via Large-scale Self-supervised Pre-train
di: Wang, Zhao, et al.
Pubblicazione: (2023)
di: Wang, Zhao, et al.
Pubblicazione: (2023)
HOLA: Enhancing Audio-visual Deepfake Detection via Hierarchical Contextual Aggregations and Efficient Pre-training
di: Wu, Xuecheng, et al.
Pubblicazione: (2025)
di: Wu, Xuecheng, et al.
Pubblicazione: (2025)
EndoLRMGS: Complete Endoscopic Scene Reconstruction combining Large Reconstruction Modelling and Gaussian Splatting
di: Wang, Xu, et al.
Pubblicazione: (2025)
di: Wang, Xu, et al.
Pubblicazione: (2025)
EndoGSLAM: Real-Time Dense Reconstruction and Tracking in Endoscopic Surgeries using Gaussian Splatting
di: Wang, Kailing, et al.
Pubblicazione: (2024)
di: Wang, Kailing, et al.
Pubblicazione: (2024)
Documenti analoghi
-
EndoMatcher: Generalizable Endoscopic Image Matcher via Multi-Domain Pre-training for Robot-Assisted Surgery
di: Yang, Bingyu, et al.
Pubblicazione: (2025) -
EndoOmni: Zero-Shot Cross-Dataset Depth Estimation in Endoscopy by Robust Self-Learning from Noisy Labels
di: Tian, Qingyao, et al.
Pubblicazione: (2024) -
Harnessing Foundation Models for Robust and Generalizable 6-DOF Bronchoscopy Localization
di: Tian, Qingyao, et al.
Pubblicazione: (2025) -
DD-VNB: A Depth-based Dual-Loop Framework for Real-time Visually Navigated Bronchoscopy
di: Tian, Qingyao, et al.
Pubblicazione: (2024) -
BREATH-VL: Vision-Language-Guided 6-DoF Bronchoscopy Localization via Semantic-Geometric Fusion
di: Tian, Qingyao, et al.
Pubblicazione: (2026)