Where It Moves, It Matters: Referring Surgical Instrument Segmentation via Motion
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wei, Meng, Yuan, Kun, Li, Shi, Zhou, Yue, Bai, Long, Navab, Nassir, Ren, Hongliang, Lee, Hong Joo, Vercauteren, Tom, Padoy, Nicolas |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Procedure-Aware Surgical Video-language Pretraining with Hierarchical Knowledge Augmentation
von: Yuan, Kun, et al.
Veröffentlicht: (2024)
von: Yuan, Kun, et al.
Veröffentlicht: (2024)
HecVL: Hierarchical Video-Language Pretraining for Zero-shot Surgical Phase Recognition
von: Yuan, Kun, et al.
Veröffentlicht: (2024)
von: Yuan, Kun, et al.
Veröffentlicht: (2024)
Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis
von: Chen, Tingxuan, et al.
Veröffentlicht: (2025)
von: Chen, Tingxuan, et al.
Veröffentlicht: (2025)
SurgTPGS: Semantic 3D Surgical Scene Understanding with Text Promptable Gaussian Splatting
von: Huang, Yiming, et al.
Veröffentlicht: (2025)
von: Huang, Yiming, et al.
Veröffentlicht: (2025)
CliPPER: Contextual Video-Language Pretraining on Long-form Intraoperative Surgical Procedures for Event Recognition
von: Stilz, Florian, et al.
Veröffentlicht: (2026)
von: Stilz, Florian, et al.
Veröffentlicht: (2026)
Advancing Surgical VQA with Scene Graph Knowledge
von: Yuan, Kun, et al.
Veröffentlicht: (2023)
von: Yuan, Kun, et al.
Veröffentlicht: (2023)
Text Promptable Surgical Instrument Segmentation with Vision-Language Models
von: Zhou, Zijian, et al.
Veröffentlicht: (2023)
von: Zhou, Zijian, et al.
Veröffentlicht: (2023)
Recognizing Surgical Phases Anywhere: Few-Shot Test-time Adaptation and Task-graph Guided Refinement
von: Yuan, Kun, et al.
Veröffentlicht: (2025)
von: Yuan, Kun, et al.
Veröffentlicht: (2025)
SurgOnAir: Hierarchy-Aware Real-Time Surgical Video Commentary
von: He, Jingyi, et al.
Veröffentlicht: (2026)
von: He, Jingyi, et al.
Veröffentlicht: (2026)
Grounding Surgical Action Triplets with Instrument Instance Segmentation: A Dataset and Target-Aware Fusion Approach
von: Alabi, Oluwatosin, et al.
Veröffentlicht: (2025)
von: Alabi, Oluwatosin, et al.
Veröffentlicht: (2025)
SurgVidLM: Towards Multi-grained Surgical Video Understanding with Large Language Model
von: Wang, Guankun, et al.
Veröffentlicht: (2025)
von: Wang, Guankun, et al.
Veröffentlicht: (2025)
Learning Multi-modal Representations by Watching Hundreds of Surgical Video Lectures
von: Yuan, Kun, et al.
Veröffentlicht: (2023)
von: Yuan, Kun, et al.
Veröffentlicht: (2023)
Adapting SAM for Surgical Instrument Tracking and Segmentation in Endoscopic Submucosal Dissection Videos
von: Yu, Jieming, et al.
Veröffentlicht: (2024)
von: Yu, Jieming, et al.
Veröffentlicht: (2024)
Medical Multimodal Model Stealing Attacks via Adversarial Domain Alignment
von: Shen, Yaling, et al.
Veröffentlicht: (2025)
von: Shen, Yaling, et al.
Veröffentlicht: (2025)
ASI-Seg: Audio-Driven Surgical Instrument Segmentation with Surgeon Intention Understanding
von: Chen, Zhen, et al.
Veröffentlicht: (2024)
von: Chen, Zhen, et al.
Veröffentlicht: (2024)
ROBUST-MIPS: A Combined Skeletal Pose and Instance Segmentation Dataset for Laparoscopic Surgical Instruments
von: Han, Zhe, et al.
Veröffentlicht: (2025)
von: Han, Zhe, et al.
Veröffentlicht: (2025)
SurgPIS: Surgical-instrument-level Instances and Part-level Semantics for Weakly-supervised Part-aware Instance Segmentation
von: Wei, Meng, et al.
Veröffentlicht: (2025)
von: Wei, Meng, et al.
Veröffentlicht: (2025)
SURGIVID: Annotation-Efficient Surgical Video Object Discovery
von: Köksal, Çağhan, et al.
Veröffentlicht: (2024)
von: Köksal, Çağhan, et al.
Veröffentlicht: (2024)
From Adaptation to Generalization: Adaptive Visual Prompting for Medical Image Segmentation
von: Çetinkaya, Evren, et al.
Veröffentlicht: (2026)
von: Çetinkaya, Evren, et al.
Veröffentlicht: (2026)
Multitask Learning in Minimally Invasive Surgical Vision: A Review
von: Alabi, Oluwatosin, et al.
Veröffentlicht: (2024)
von: Alabi, Oluwatosin, et al.
Veröffentlicht: (2024)
HieraSurg: Hierarchy-Aware Diffusion Model for Surgical Video Generation
von: Biagini, Diego, et al.
Veröffentlicht: (2025)
von: Biagini, Diego, et al.
Veröffentlicht: (2025)
Multimodal Graph Representation Learning for Robust Surgical Workflow Recognition with Adversarial Feature Disentanglement
von: Bai, Long, et al.
Veröffentlicht: (2025)
von: Bai, Long, et al.
Veröffentlicht: (2025)
Transferring Relative Monocular Depth to Surgical Vision with Temporal Consistency
von: Budd, Charlie, et al.
Veröffentlicht: (2024)
von: Budd, Charlie, et al.
Veröffentlicht: (2024)
ProtoFlow: Interpretable and Robust Surgical Workflow Modeling with Learned Dynamic Scene Graph Prototypes
von: Holm, Felix, et al.
Veröffentlicht: (2025)
von: Holm, Felix, et al.
Veröffentlicht: (2025)
SurgGoal: Rethinking Surgical Planning Evaluation via Goal-Satisfiability
von: Li, Ruochen, et al.
Veröffentlicht: (2026)
von: Li, Ruochen, et al.
Veröffentlicht: (2026)
EndoChat: Grounded Multimodal Large Language Model for Endoscopic Surgery
von: Wang, Guankun, et al.
Veröffentlicht: (2025)
von: Wang, Guankun, et al.
Veröffentlicht: (2025)
SANGRIA: Surgical Video Scene Graph Optimization for Surgical Workflow Prediction
von: Köksal, Çağhan, et al.
Veröffentlicht: (2024)
von: Köksal, Çağhan, et al.
Veröffentlicht: (2024)
Needle Segmentation Using GAN: Restoring Thin Instrument Visibility in Robotic Ultrasound
von: Jiang, Zhongliang, et al.
Veröffentlicht: (2024)
von: Jiang, Zhongliang, et al.
Veröffentlicht: (2024)
From Panel to Pixel: Zoom-In Vision-Language Pretraining from Biomedical Scientific Literature
von: Yuan, Kun, et al.
Veröffentlicht: (2025)
von: Yuan, Kun, et al.
Veröffentlicht: (2025)
Mitigating Biases in Surgical Operating Rooms with Geometry
von: Wang, Tony Danjun, et al.
Veröffentlicht: (2025)
von: Wang, Tony Danjun, et al.
Veröffentlicht: (2025)
SurgicalPart-SAM: Part-to-Whole Collaborative Prompting for Surgical Instrument Segmentation
von: Yue, Wenxi, et al.
Veröffentlicht: (2023)
von: Yue, Wenxi, et al.
Veröffentlicht: (2023)
Next-generation Surgical Navigation: Marker-less Multi-view 6DoF Pose Estimation of Surgical Instruments
von: Hein, Jonas, et al.
Veröffentlicht: (2023)
von: Hein, Jonas, et al.
Veröffentlicht: (2023)
SurgiTrack: Fine-Grained Multi-Class Multi-Tool Tracking in Surgical Videos
von: Nwoye, Chinedu Innocent, et al.
Veröffentlicht: (2024)
von: Nwoye, Chinedu Innocent, et al.
Veröffentlicht: (2024)
SimGen: A Diffusion-Based Framework for Simultaneous Surgical Image and Segmentation Mask Generation
von: Bhat, Aditya, et al.
Veröffentlicht: (2025)
von: Bhat, Aditya, et al.
Veröffentlicht: (2025)
Ultrasound-Guided Real-Time Spinal Motion Visualization for Spinal Instability Assessment
von: Li, Feng, et al.
Veröffentlicht: (2026)
von: Li, Feng, et al.
Veröffentlicht: (2026)
Surgical-DINO: Adapter Learning of Foundation Models for Depth Estimation in Endoscopic Surgery
von: Cui, Beilei, et al.
Veröffentlicht: (2024)
von: Cui, Beilei, et al.
Veröffentlicht: (2024)
Dyadic Partnership(DP): A Missing Link Towards Full Autonomy in Medical Robotics
von: Navab, Nassir, et al.
Veröffentlicht: (2026)
von: Navab, Nassir, et al.
Veröffentlicht: (2026)
Language-Guided Open-World Anomaly Segmentation
von: Reichard, Klara, et al.
Veröffentlicht: (2025)
von: Reichard, Klara, et al.
Veröffentlicht: (2025)
LapFM: A Laparoscopic Segmentation Foundation Model via Hierarchical Concept Evolving Pre-training
von: Xu, Qing, et al.
Veröffentlicht: (2025)
von: Xu, Qing, et al.
Veröffentlicht: (2025)
SAM 2 in Robotic Surgery: An Empirical Evaluation for Robustness and Generalization in Surgical Video Segmentation
von: Yu, Jieming, et al.
Veröffentlicht: (2024)
von: Yu, Jieming, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Procedure-Aware Surgical Video-language Pretraining with Hierarchical Knowledge Augmentation
von: Yuan, Kun, et al.
Veröffentlicht: (2024) -
HecVL: Hierarchical Video-Language Pretraining for Zero-shot Surgical Phase Recognition
von: Yuan, Kun, et al.
Veröffentlicht: (2024) -
Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis
von: Chen, Tingxuan, et al.
Veröffentlicht: (2025) -
SurgTPGS: Semantic 3D Surgical Scene Understanding with Text Promptable Gaussian Splatting
von: Huang, Yiming, et al.
Veröffentlicht: (2025) -
CliPPER: Contextual Video-Language Pretraining on Long-form Intraoperative Surgical Procedures for Event Recognition
von: Stilz, Florian, et al.
Veröffentlicht: (2026)