Surgical-DINO: Adapter Learning of Foundation Models for Depth Estimation in Endoscopic Surgery
Fuente:
arXiv
Guardado en:
| Autores principales: | Cui, Beilei, Islam, Mobarakol, Bai, Long, Ren, Hongliang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
EndoDAC: Efficient Adapting Foundation Model for Self-Supervised Depth Estimation from Any Endoscopic Camera
por: Cui, Beilei, et al.
Publicado: (2024)
por: Cui, Beilei, et al.
Publicado: (2024)
OSSAR: Towards Open-Set Surgical Activity Recognition in Robot-assisted Surgery
por: Bai, Long, et al.
Publicado: (2024)
por: Bai, Long, et al.
Publicado: (2024)
Endo-4DGS: Endoscopic Monocular Scene Reconstruction with 4D Gaussian Splatting
por: Huang, Yiming, et al.
Publicado: (2024)
por: Huang, Yiming, et al.
Publicado: (2024)
CoGE: Sim-to-Real Online Geometric Estimation for Monocular Colonoscopy
por: Shao, Liangjing, et al.
Publicado: (2026)
por: Shao, Liangjing, et al.
Publicado: (2026)
EndoARSS: Adapting Spatially-Aware Foundation Model for Efficient Activity Recognition and Semantic Segmentation in Endoscopic Surgery
por: Wang, Guankun, et al.
Publicado: (2025)
por: Wang, Guankun, et al.
Publicado: (2025)
Learning to Efficiently Adapt Foundation Models for Self-Supervised Endoscopic 3D Scene Reconstruction from Any Cameras
por: Cui, Beilei, et al.
Publicado: (2025)
por: Cui, Beilei, et al.
Publicado: (2025)
Privacy-Preserving Synthetic Continual Semantic Segmentation for Robotic Surgery
por: Xu, Mengya, et al.
Publicado: (2024)
por: Xu, Mengya, et al.
Publicado: (2024)
Surgical-VQLA++: Adversarial Contrastive Learning for Calibrated Robust Visual Question-Localized Answering in Robotic Surgery
por: Bai, Long, et al.
Publicado: (2024)
por: Bai, Long, et al.
Publicado: (2024)
Surgical-LVLM: Learning to Adapt Large Vision-Language Model for Grounded Visual Question Answering in Robotic Surgery
por: Wang, Guankun, et al.
Publicado: (2024)
por: Wang, Guankun, et al.
Publicado: (2024)
Registering Neural 4D Gaussians for Endoscopic Surgery
por: Huang, Yiming, et al.
Publicado: (2024)
por: Huang, Yiming, et al.
Publicado: (2024)
TR2M: Transferring Monocular Relative Depth to Metric Depth with Language Descriptions and Dual-Level Scale-Oriented Contrast
por: Cui, Beilei, et al.
Publicado: (2025)
por: Cui, Beilei, et al.
Publicado: (2025)
Benchmarking Robustness of Endoscopic Depth Estimation with Synthetically Corrupted Data
por: Wang, An, et al.
Publicado: (2024)
por: Wang, An, et al.
Publicado: (2024)
EndoDDC: Learning Sparse to Dense Reconstruction for Endoscopic Robotic Navigation via Diffusion Depth Completion
por: Lin, Yinheng, et al.
Publicado: (2026)
por: Lin, Yinheng, et al.
Publicado: (2026)
EndoGSim: Physics-Aware 4D Dynamic Endoscopic Scene Simulations via MLLM-Guided Gaussian Splatting
por: Liu, Changjing, et al.
Publicado: (2026)
por: Liu, Changjing, et al.
Publicado: (2026)
Multimodal Graph Representation Learning for Robust Surgical Workflow Recognition with Adversarial Feature Disentanglement
por: Bai, Long, et al.
Publicado: (2025)
por: Bai, Long, et al.
Publicado: (2025)
V$^2$-SfMLearner: Learning Monocular Depth and Ego-motion for Multimodal Wireless Capsule Endoscopy
por: Bai, Long, et al.
Publicado: (2024)
por: Bai, Long, et al.
Publicado: (2024)
DINO-R1: Incentivizing Reasoning Capability in Vision Foundation Models
por: Pan, Chenbin, et al.
Publicado: (2025)
por: Pan, Chenbin, et al.
Publicado: (2025)
SAM 2 in Robotic Surgery: An Empirical Evaluation for Robustness and Generalization in Surgical Video Segmentation
por: Yu, Jieming, et al.
Publicado: (2024)
por: Yu, Jieming, et al.
Publicado: (2024)
EndoOOD: Uncertainty-aware Out-of-distribution Detection in Capsule Endoscopy Diagnosis
por: Tan, Qiaozhi, et al.
Publicado: (2024)
por: Tan, Qiaozhi, et al.
Publicado: (2024)
PDZSeg: Adapting the Foundation Model for Dissection Zone Segmentation with Visual Prompts in Robot-assisted Endoscopic Submucosal Dissection
por: Xu, Mengya, et al.
Publicado: (2024)
por: Xu, Mengya, et al.
Publicado: (2024)
Head Pose Estimation and 3D Neural Surface Reconstruction via Monocular Camera in situ for Navigation and Safe Insertion into Natural Openings
por: Tang, Ruijie, et al.
Publicado: (2024)
por: Tang, Ruijie, et al.
Publicado: (2024)
SurgSora: Object-Aware Diffusion Model for Controllable Surgical Video Generation
por: Chen, Tong, et al.
Publicado: (2024)
por: Chen, Tong, et al.
Publicado: (2024)
DARES: Depth Anything in Robotic Endoscopic Surgery with Self-supervised Vector-LoRA of the Foundation Model
por: Zeinoddin, Mona Sheikh, et al.
Publicado: (2024)
por: Zeinoddin, Mona Sheikh, et al.
Publicado: (2024)
PitVQA++: Vector Matrix-Low-Rank Adaptation for Open-Ended Visual Question Answering in Pituitary Surgery
por: He, Runlong, et al.
Publicado: (2025)
por: He, Runlong, et al.
Publicado: (2025)
Surgical-DeSAM: Decoupling SAM for Instrument Segmentation in Robotic Surgery
por: Sheng, Yuyang, et al.
Publicado: (2024)
por: Sheng, Yuyang, et al.
Publicado: (2024)
Where It Moves, It Matters: Referring Surgical Instrument Segmentation via Motion
por: Wei, Meng, et al.
Publicado: (2026)
por: Wei, Meng, et al.
Publicado: (2026)
Advancing Dense Endoscopic Reconstruction with Gaussian Splatting-driven Surface Normal-aware Tracking and Mapping
por: Huang, Yiming, et al.
Publicado: (2025)
por: Huang, Yiming, et al.
Publicado: (2025)
Vanishing Depth: A Depth Adapter with Positional Depth Encoding for Generalized Image Encoders
por: Koch, Paul, et al.
Publicado: (2025)
por: Koch, Paul, et al.
Publicado: (2025)
BrainDINO: A Brain MRI Foundation Model for Generalizable Clinical Representation Learning
por: Wu, Yizhou, et al.
Publicado: (2026)
por: Wu, Yizhou, et al.
Publicado: (2026)
Towards Full-parameter and Parameter-efficient Self-learning For Endoscopic Camera Depth Estimation
por: Zhao, Shuting, et al.
Publicado: (2024)
por: Zhao, Shuting, et al.
Publicado: (2024)
SurgVidLM: Towards Multi-grained Surgical Video Understanding with Large Language Model
por: Wang, Guankun, et al.
Publicado: (2025)
por: Wang, Guankun, et al.
Publicado: (2025)
SurgPLAN++: Universal Surgical Phase Localization Network for Online and Offline Inference
por: Chen, Zhen, et al.
Publicado: (2024)
por: Chen, Zhen, et al.
Publicado: (2024)
EndoVGGT: GNN-Enhanced Depth Estimation for Surgical 3D Reconstruction
por: Fan, Falong, et al.
Publicado: (2026)
por: Fan, Falong, et al.
Publicado: (2026)
Data-Efficient Surgical Phase Segmentation in Small-Incision Cataract Surgery: A Controlled Study of Vision Foundation Models
por: Spencer, Lincoln, et al.
Publicado: (2026)
por: Spencer, Lincoln, et al.
Publicado: (2026)
DINO-VO: A Feature-based Visual Odometry Leveraging a Visual Foundation Model
por: Azhari, Maulana Bisyir, et al.
Publicado: (2025)
por: Azhari, Maulana Bisyir, et al.
Publicado: (2025)
EndoGMDE: Generalizable Monocular Depth Estimation with Mixture of Low-Rank Experts for Diverse Endoscopic Scenes
por: Shao, Liangjing, et al.
Publicado: (2025)
por: Shao, Liangjing, et al.
Publicado: (2025)
BleedOrigin: Dynamic Bleeding Source Localization in Endoscopic Submucosal Dissection via Dual-Stage Detection and Tracking
por: Xu, Mengya, et al.
Publicado: (2025)
por: Xu, Mengya, et al.
Publicado: (2025)
OVS-DINO: Open-Vocabulary Segmentation via Structure-Aligned SAM-DINO with Language Guidance
por: Zeng, Haoxi, et al.
Publicado: (2026)
por: Zeng, Haoxi, et al.
Publicado: (2026)
Endo-4DGX: Robust Endoscopic Scene Reconstruction and Illumination Correction with Gaussian Splatting
por: Huang, Yiming, et al.
Publicado: (2025)
por: Huang, Yiming, et al.
Publicado: (2025)
DINO-MX: A Modular & Flexible Framework for Self-Supervised Learning
por: Gokmen, Mahmut Selman, et al.
Publicado: (2025)
por: Gokmen, Mahmut Selman, et al.
Publicado: (2025)
Ejemplares similares
-
EndoDAC: Efficient Adapting Foundation Model for Self-Supervised Depth Estimation from Any Endoscopic Camera
por: Cui, Beilei, et al.
Publicado: (2024) -
OSSAR: Towards Open-Set Surgical Activity Recognition in Robot-assisted Surgery
por: Bai, Long, et al.
Publicado: (2024) -
Endo-4DGS: Endoscopic Monocular Scene Reconstruction with 4D Gaussian Splatting
por: Huang, Yiming, et al.
Publicado: (2024) -
CoGE: Sim-to-Real Online Geometric Estimation for Monocular Colonoscopy
por: Shao, Liangjing, et al.
Publicado: (2026) -
EndoARSS: Adapting Spatially-Aware Foundation Model for Efficient Activity Recognition and Semantic Segmentation in Endoscopic Surgery
por: Wang, Guankun, et al.
Publicado: (2025)