DARES: Depth Anything in Robotic Endoscopic Surgery with Self-supervised Vector-LoRA of the Foundation Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Zeinoddin, Mona Sheikh, Lena, Chiara, Qu, Jiongqi, Carlini, Luca, Magro, Mattia, Kim, Seunghoi, De Momi, Elena, Bano, Sophia, Grech-Sollars, Matthew, Mazomenos, Evangelos, Alexander, Daniel C., Stoyanov, Danail, Clarkson, Matthew J., Islam, Mobarakol |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Endo-FASt3r: Endoscopic Foundation model Adaptation for Structure from motion
por: Zeinoddin, Mona Sheikh, et al.
Publicado: (2025)
por: Zeinoddin, Mona Sheikh, et al.
Publicado: (2025)
PitVQA++: Vector Matrix-Low-Rank Adaptation for Open-Ended Visual Question Answering in Pituitary Surgery
por: He, Runlong, et al.
Publicado: (2025)
por: He, Runlong, et al.
Publicado: (2025)
TemporalDoRA: Temporal PEFT for Robust Surgical Video Question Answering
por: Carlini, Luca, et al.
Publicado: (2026)
por: Carlini, Luca, et al.
Publicado: (2026)
EndoLRMGS: Complete Endoscopic Scene Reconstruction combining Large Reconstruction Modelling and Gaussian Splatting
por: Wang, Xu, et al.
Publicado: (2025)
por: Wang, Xu, et al.
Publicado: (2025)
Diff2DGS: Reliable Reconstruction of Occluded Surgical Scenes via 2D Gaussian Splatting
por: Song, Tianyi, et al.
Publicado: (2026)
por: Song, Tianyi, et al.
Publicado: (2026)
SEDMamba: Enhancing Selective State Space Modelling with Bottleneck Mechanism and Fine-to-Coarse Temporal Fusion for Efficient Error Detection in Robot-Assisted Surgery
por: Xu, Jialang, et al.
Publicado: (2024)
por: Xu, Jialang, et al.
Publicado: (2024)
Surgical-DeSAM: Decoupling SAM for Instrument Segmentation in Robotic Surgery
por: Sheng, Yuyang, et al.
Publicado: (2024)
por: Sheng, Yuyang, et al.
Publicado: (2024)
Evaluating the sensitivity and reliability of hippocampal segmentation for dementia using deep learning
por: Jiongqi Qu, et al.
Publicado: (2025)
por: Jiongqi Qu, et al.
Publicado: (2025)
Warm-Started Reinforcement Learning for Iterative 3D/2D Liver Registration
por: Zhang, Hanyuan, et al.
Publicado: (2026)
por: Zhang, Hanyuan, et al.
Publicado: (2026)
Think Step by Step: Chain-of-Gesture Prompting for Error Detection in Robotic Surgical Videos
por: Shao, Zhimin, et al.
Publicado: (2024)
por: Shao, Zhimin, et al.
Publicado: (2024)
PitVQA: Image-grounded Text Embedding LLM for Visual Question Answering in Pituitary Surgery
por: He, Runlong, et al.
Publicado: (2024)
por: He, Runlong, et al.
Publicado: (2024)
Multi-Modal Monocular Endoscopic Depth and Pose Estimation with Edge-Guided Self-Supervision
por: Ju, Xinwei, et al.
Publicado: (2026)
por: Ju, Xinwei, et al.
Publicado: (2026)
SurgAnt-ViVQA: Learning to Anticipate Surgical Events through GRU-Driven Temporal Cross-Attention
por: Dhake, Shreyas C., et al.
Publicado: (2025)
por: Dhake, Shreyas C., et al.
Publicado: (2025)
Depth Augmented and FE Free 3D/2D Liver Registration for Laparoscopic Liver AR
por: Zhang, Hanyuan, et al.
Publicado: (2026)
por: Zhang, Hanyuan, et al.
Publicado: (2026)
Surgical AI Copilot: Energy-Based Fourier Gradient Low-Rank Adaptation for Surgical LLM Agent Reasoning and Planning
por: Huang, Jiayuan, et al.
Publicado: (2025)
por: Huang, Jiayuan, et al.
Publicado: (2025)
StereoMamba: Real-time and Robust Intraoperative Stereo Disparity Estimation via Long-range Spatial Dependencies
por: Wang, Xu, et al.
Publicado: (2025)
por: Wang, Xu, et al.
Publicado: (2025)
3D Acetabular Surface Reconstruction from 2D Pre-operative X-ray Images using SRVF Elastic Registration and Deformation Graph
por: Zhang, Shuai, et al.
Publicado: (2025)
por: Zhang, Shuai, et al.
Publicado: (2025)
Personalizing Federated Instrument Segmentation with Visual Trait Priors in Robotic Surgery
por: Xu, Jialang, et al.
Publicado: (2024)
por: Xu, Jialang, et al.
Publicado: (2024)
Gaussian Pancakes: Geometrically-Regularized 3D Gaussian Splatting for Realistic Endoscopic Reconstruction
por: Bonilla, Sierra, et al.
Publicado: (2024)
por: Bonilla, Sierra, et al.
Publicado: (2024)
When to Trust the Answer: Question-Aligned Semantic Nearest Neighbor Entropy for Safer Surgical VQA
por: Carlini, Luca, et al.
Publicado: (2025)
por: Carlini, Luca, et al.
Publicado: (2025)
Learning from Single Timestamps: Complexity Estimation in Laparoscopic Cholecystectomy
por: Anastasiou, Dimitrios, et al.
Publicado: (2025)
por: Anastasiou, Dimitrios, et al.
Publicado: (2025)
Temporal Cluster Assignment for Efficient Real-Time Video Segmentation
por: Yung, Ka-Wai, et al.
Publicado: (2025)
por: Yung, Ka-Wai, et al.
Publicado: (2025)
CoRe-DA: Contrastive Regression for Unsupervised Domain Adaptation in Surgical Skill Assessment
por: Anastasiou, Dimitrios, et al.
Publicado: (2026)
por: Anastasiou, Dimitrios, et al.
Publicado: (2026)
SHADeS: Self-supervised Monocular Depth Estimation Through Non-Lambertian Image Decomposition
por: Daher, Rema, et al.
Publicado: (2025)
por: Daher, Rema, et al.
Publicado: (2025)
SurgViVQA: Temporally-Grounded Video Question Answering for Surgical Scene Understanding
por: Drago, Mauro Orazio, et al.
Publicado: (2025)
por: Drago, Mauro Orazio, et al.
Publicado: (2025)
Automated Surgical Skill Assessment in Endoscopic Pituitary Surgery using Real-time Instrument Tracking on a High-fidelity Bench-top Phantom
por: Das, Adrito, et al.
Publicado: (2024)
por: Das, Adrito, et al.
Publicado: (2024)
HUP-3D: A 3D multi-view synthetic dataset for assisted-egocentric hand-ultrasound pose estimation
por: Birlo, Manuel, et al.
Publicado: (2024)
por: Birlo, Manuel, et al.
Publicado: (2024)
RRT-GPMP2: A Motion Planner for Mobile Robots in Complex Maze Environments
por: Meng, Jiawei, et al.
Publicado: (2024)
por: Meng, Jiawei, et al.
Publicado: (2024)
EndoSfM3D: Learning to 3D Reconstruct Any Endoscopic Surgery Scene using Self-supervised Foundation Model
por: Zhang, Changhao, et al.
Publicado: (2025)
por: Zhang, Changhao, et al.
Publicado: (2025)
SurgicalGS: Dynamic 3D Gaussian Splatting for Accurate Robotic-Assisted Surgical Scene Reconstruction
por: Chen, Jialei, et al.
Publicado: (2024)
por: Chen, Jialei, et al.
Publicado: (2024)
High-fidelity Endoscopic Image Synthesis by Utilizing Depth-guided Neural Surfaces
por: Huang, Baoru, et al.
Publicado: (2024)
por: Huang, Baoru, et al.
Publicado: (2024)
PitRSDNet: Predicting Intra-operative Remaining Surgery Duration in Endoscopic Pituitary Surgery
por: Wijekoon, Anjana, et al.
Publicado: (2024)
por: Wijekoon, Anjana, et al.
Publicado: (2024)
Self-Supervised Contrastive Embedding Adaptation for Endoscopic Image Matching
por: Rota, Alberto, et al.
Publicado: (2025)
por: Rota, Alberto, et al.
Publicado: (2025)
Dynamic Obstacle Avoidance of Unmanned Surface Vehicles in Maritime Environments Using Gaussian Processes Based Motion Planning
por: Meng, Jiawei, et al.
Publicado: (2024)
por: Meng, Jiawei, et al.
Publicado: (2024)
Illumination Histogram Consistency Metric for Quantitative Assessment of Video Sequences
por: Chen, Long, et al.
Publicado: (2024)
por: Chen, Long, et al.
Publicado: (2024)
Convolution Meets LoRA: Parameter Efficient Finetuning for Segment Anything Model
por: Zhong, Zihan, et al.
Publicado: (2024)
por: Zhong, Zihan, et al.
Publicado: (2024)
SurgFusion-Net: Diversified Adaptive Multimodal Fusion Network for Surgical Skill Assessment
por: He, Runlong, et al.
Publicado: (2026)
por: He, Runlong, et al.
Publicado: (2026)
Zero-shot Monocular Metric Depth for Endoscopic Images
por: Toussaint, Nicolas, et al.
Publicado: (2025)
por: Toussaint, Nicolas, et al.
Publicado: (2025)
Exploring Pre-training Across Domains for Few-Shot Surgical Skill Assessment
por: Anastasiou, Dimitrios, et al.
Publicado: (2025)
por: Anastasiou, Dimitrios, et al.
Publicado: (2025)
Mismatched: Evaluating the Limits of Image Matching Approaches and Benchmarks
por: Bonilla, Sierra, et al.
Publicado: (2024)
por: Bonilla, Sierra, et al.
Publicado: (2024)
Ejemplares similares
-
Endo-FASt3r: Endoscopic Foundation model Adaptation for Structure from motion
por: Zeinoddin, Mona Sheikh, et al.
Publicado: (2025) -
PitVQA++: Vector Matrix-Low-Rank Adaptation for Open-Ended Visual Question Answering in Pituitary Surgery
por: He, Runlong, et al.
Publicado: (2025) -
TemporalDoRA: Temporal PEFT for Robust Surgical Video Question Answering
por: Carlini, Luca, et al.
Publicado: (2026) -
EndoLRMGS: Complete Endoscopic Scene Reconstruction combining Large Reconstruction Modelling and Gaussian Splatting
por: Wang, Xu, et al.
Publicado: (2025) -
Diff2DGS: Reliable Reconstruction of Occluded Surgical Scenes via 2D Gaussian Splatting
por: Song, Tianyi, et al.
Publicado: (2026)