SANGRIA: Surgical Video Scene Graph Optimization for Surgical Workflow Prediction
Fuente:
arXiv
Salvato in:
| Autori principali: | Köksal, Çağhan, Ghazaei, Ghazal, Holm, Felix, Farshad, Azade, Navab, Nassir |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SURGIVID: Annotation-Efficient Surgical Video Object Discovery
di: Köksal, Çağhan, et al.
Pubblicazione: (2024)
di: Köksal, Çağhan, et al.
Pubblicazione: (2024)
ProtoFlow: Interpretable and Robust Surgical Workflow Modeling with Learned Dynamic Scene Graph Prototypes
di: Holm, Felix, et al.
Pubblicazione: (2025)
di: Holm, Felix, et al.
Pubblicazione: (2025)
CAT-SG: A Large Dynamic Scene Graph Dataset for Fine-Grained Understanding of Cataract Surgery
di: Holm, Felix, et al.
Pubblicazione: (2025)
di: Holm, Felix, et al.
Pubblicazione: (2025)
HieraSurg: Hierarchy-Aware Diffusion Model for Surgical Video Generation
di: Biagini, Diego, et al.
Pubblicazione: (2025)
di: Biagini, Diego, et al.
Pubblicazione: (2025)
SurGrID: Controllable Surgical Simulation via Scene Graph to Image Diffusion
di: Frisch, Yannik, et al.
Pubblicazione: (2025)
di: Frisch, Yannik, et al.
Pubblicazione: (2025)
Advancing Surgical VQA with Scene Graph Knowledge
di: Yuan, Kun, et al.
Pubblicazione: (2023)
di: Yuan, Kun, et al.
Pubblicazione: (2023)
Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis
di: Chen, Tingxuan, et al.
Pubblicazione: (2025)
di: Chen, Tingxuan, et al.
Pubblicazione: (2025)
VISAGE: Video Synthesis using Action Graphs for Surgery
di: Yeganeh, Yousef, et al.
Pubblicazione: (2024)
di: Yeganeh, Yousef, et al.
Pubblicazione: (2024)
Towards Comprehensive Real-Time Scene Understanding in Ophthalmic Surgery through Multimodal Image Fusion
di: Rohrmoser, Nikolo, et al.
Pubblicazione: (2026)
di: Rohrmoser, Nikolo, et al.
Pubblicazione: (2026)
Procedure-Aware Surgical Video-language Pretraining with Hierarchical Knowledge Augmentation
di: Yuan, Kun, et al.
Pubblicazione: (2024)
di: Yuan, Kun, et al.
Pubblicazione: (2024)
HecVL: Hierarchical Video-Language Pretraining for Zero-shot Surgical Phase Recognition
di: Yuan, Kun, et al.
Pubblicazione: (2024)
di: Yuan, Kun, et al.
Pubblicazione: (2024)
CliPPER: Contextual Video-Language Pretraining on Long-form Intraoperative Surgical Procedures for Event Recognition
di: Stilz, Florian, et al.
Pubblicazione: (2026)
di: Stilz, Florian, et al.
Pubblicazione: (2026)
DeepAf: One-Shot Spatiospectral Auto-Focus Model for Digital Pathology
di: Yeganeh, Yousef, et al.
Pubblicazione: (2025)
di: Yeganeh, Yousef, et al.
Pubblicazione: (2025)
Watch and Learn: Leveraging Expert Knowledge and Language for Surgical Video Understanding
di: Gastager, David, et al.
Pubblicazione: (2025)
di: Gastager, David, et al.
Pubblicazione: (2025)
Stress-Aware Resilient Neural Training
di: Shakarami, Ashkan, et al.
Pubblicazione: (2025)
di: Shakarami, Ashkan, et al.
Pubblicazione: (2025)
VeLU: Variance-enhanced Learning Unit for Deep Neural Networks
di: Shakarami, Ashkan, et al.
Pubblicazione: (2025)
di: Shakarami, Ashkan, et al.
Pubblicazione: (2025)
Learning Multi-modal Representations by Watching Hundreds of Surgical Video Lectures
di: Yuan, Kun, et al.
Pubblicazione: (2023)
di: Yuan, Kun, et al.
Pubblicazione: (2023)
Latent Drifting in Diffusion Models for Counterfactual Medical Image Synthesis
di: Yeganeh, Yousef, et al.
Pubblicazione: (2024)
di: Yeganeh, Yousef, et al.
Pubblicazione: (2024)
How Far Are Surgeons from Surgical World Models? A Pilot Study on Zero-shot Surgical Video Generation with Expert Assessment
di: Chen, Zhen, et al.
Pubblicazione: (2025)
di: Chen, Zhen, et al.
Pubblicazione: (2025)
Unit-Based Histopathology Tissue Segmentation via Multi-Level Feature Representation
di: Shakarami, Ashkan, et al.
Pubblicazione: (2025)
di: Shakarami, Ashkan, et al.
Pubblicazione: (2025)
SurgVidLM: Towards Multi-grained Surgical Video Understanding with Large Language Model
di: Wang, Guankun, et al.
Pubblicazione: (2025)
di: Wang, Guankun, et al.
Pubblicazione: (2025)
Where It Moves, It Matters: Referring Surgical Instrument Segmentation via Motion
di: Wei, Meng, et al.
Pubblicazione: (2026)
di: Wei, Meng, et al.
Pubblicazione: (2026)
SG2VID: Scene Graphs Enable Fine-Grained Control for Video Synthesis
di: Sivakumar, Ssharvien Kumar, et al.
Pubblicazione: (2025)
di: Sivakumar, Ssharvien Kumar, et al.
Pubblicazione: (2025)
SurgLLM: A Versatile Large Multimodal Model with Spatial Focus and Temporal Awareness for Surgical Video Understanding
di: Chen, Zhen, et al.
Pubblicazione: (2025)
di: Chen, Zhen, et al.
Pubblicazione: (2025)
Towards Holistic Surgical Scene Understanding
di: Valderrama, Natalia, et al.
Pubblicazione: (2022)
di: Valderrama, Natalia, et al.
Pubblicazione: (2022)
EchoScene: Indoor Scene Generation via Information Echo over Scene Graph Diffusion
di: Zhai, Guangyao, et al.
Pubblicazione: (2024)
di: Zhai, Guangyao, et al.
Pubblicazione: (2024)
Location-Free Scene Graph Generation
di: Özsoy, Ege, et al.
Pubblicazione: (2023)
di: Özsoy, Ege, et al.
Pubblicazione: (2023)
Physics-Informed Latent Diffusion for Multimodal Brain MRI Synthesis
di: Lüpke, Sven, et al.
Pubblicazione: (2024)
di: Lüpke, Sven, et al.
Pubblicazione: (2024)
Conformable Convolution for Topologically Aware Learning of Complex Anatomical Structures
di: Yeganeh, Yousef, et al.
Pubblicazione: (2024)
di: Yeganeh, Yousef, et al.
Pubblicazione: (2024)
DSTED: Decoupling Temporal Stabilization and Discriminative Enhancement for Surgical Workflow Recognition
di: Chen, Yueyao, et al.
Pubblicazione: (2025)
di: Chen, Yueyao, et al.
Pubblicazione: (2025)
Semantic Scene Graph for Ultrasound Image Explanation and Scanning Guidance
di: Li, Xuesong, et al.
Pubblicazione: (2025)
di: Li, Xuesong, et al.
Pubblicazione: (2025)
Millimeter-wave Imaging for Anthropometric Body Measurement
di: Senne, Miriam, et al.
Pubblicazione: (2026)
di: Senne, Miriam, et al.
Pubblicazione: (2026)
LLaVA-Surg: Towards Multimodal Surgical Assistant via Structured Surgical Video Learning
di: Li, Jiajie, et al.
Pubblicazione: (2024)
di: Li, Jiajie, et al.
Pubblicazione: (2024)
Mitigating Biases in Surgical Operating Rooms with Geometry
di: Wang, Tony Danjun, et al.
Pubblicazione: (2025)
di: Wang, Tony Danjun, et al.
Pubblicazione: (2025)
SurgOnAir: Hierarchy-Aware Real-Time Surgical Video Commentary
di: He, Jingyi, et al.
Pubblicazione: (2026)
di: He, Jingyi, et al.
Pubblicazione: (2026)
Multimodal Graph Representation Learning for Robust Surgical Workflow Recognition with Adversarial Feature Disentanglement
di: Bai, Long, et al.
Pubblicazione: (2025)
di: Bai, Long, et al.
Pubblicazione: (2025)
Measuring Prediction Uncertainty in Neural Cellular Automata
di: Sadafi, Ario, et al.
Pubblicazione: (2026)
di: Sadafi, Ario, et al.
Pubblicazione: (2026)
Next-generation Surgical Navigation: Marker-less Multi-view 6DoF Pose Estimation of Surgical Instruments
di: Hein, Jonas, et al.
Pubblicazione: (2023)
di: Hein, Jonas, et al.
Pubblicazione: (2023)
Image Synthesis with Class-Aware Semantic Diffusion Models for Surgical Scene Segmentation
di: Zhou, Yihang, et al.
Pubblicazione: (2024)
di: Zhou, Yihang, et al.
Pubblicazione: (2024)
Towards Unified Surgical Scene Understanding:Bridging Reasoning and Grounding via MLLMs
di: Huang, Jincai, et al.
Pubblicazione: (2026)
di: Huang, Jincai, et al.
Pubblicazione: (2026)
Documenti analoghi
-
SURGIVID: Annotation-Efficient Surgical Video Object Discovery
di: Köksal, Çağhan, et al.
Pubblicazione: (2024) -
ProtoFlow: Interpretable and Robust Surgical Workflow Modeling with Learned Dynamic Scene Graph Prototypes
di: Holm, Felix, et al.
Pubblicazione: (2025) -
CAT-SG: A Large Dynamic Scene Graph Dataset for Fine-Grained Understanding of Cataract Surgery
di: Holm, Felix, et al.
Pubblicazione: (2025) -
HieraSurg: Hierarchy-Aware Diffusion Model for Surgical Video Generation
di: Biagini, Diego, et al.
Pubblicazione: (2025) -
SurGrID: Controllable Surgical Simulation via Scene Graph to Image Diffusion
di: Frisch, Yannik, et al.
Pubblicazione: (2025)