ProtoFlow: Interpretable and Robust Surgical Workflow Modeling with Learned Dynamic Scene Graph Prototypes
Fuente:
arXiv
Guardado en:
| Autores principales: | Holm, Felix, Ghazaei, Ghazal, Navab, Nassir |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Decoding the Surgical Scene: A Scoping Review of Scene Graphs in Surgery
por: Henriques, Angelo, et al.
Publicado: (2025)
por: Henriques, Angelo, et al.
Publicado: (2025)
SANGRIA: Surgical Video Scene Graph Optimization for Surgical Workflow Prediction
por: Köksal, Çağhan, et al.
Publicado: (2024)
por: Köksal, Çağhan, et al.
Publicado: (2024)
CAT-SG: A Large Dynamic Scene Graph Dataset for Fine-Grained Understanding of Cataract Surgery
por: Holm, Felix, et al.
Publicado: (2025)
por: Holm, Felix, et al.
Publicado: (2025)
UniQ: Unified Decoder with Task-specific Queries for Efficient Scene Graph Generation
por: Liao, Xinyao, et al.
Publicado: (2025)
por: Liao, Xinyao, et al.
Publicado: (2025)
FlowIBR: Leveraging Pre-Training for Efficient Neural Image-Based Rendering of Dynamic Scenes
por: Büsching, Marcel, et al.
Publicado: (2023)
por: Büsching, Marcel, et al.
Publicado: (2023)
SURGIVID: Annotation-Efficient Surgical Video Object Discovery
por: Köksal, Çağhan, et al.
Publicado: (2024)
por: Köksal, Çağhan, et al.
Publicado: (2024)
A Reverse Causal Framework to Mitigate Spurious Correlations for Debiasing Scene Graph Generation
por: Sun, Shuzhou, et al.
Publicado: (2025)
por: Sun, Shuzhou, et al.
Publicado: (2025)
ROSGS: Relightable Outdoor Scenes With Gaussian Splatting
por: Liao, Lianjun, et al.
Publicado: (2025)
por: Liao, Lianjun, et al.
Publicado: (2025)
ViG-LRGC: Vision Graph Neural Networks with Learnable Reparameterized Graph Construction
por: Elsharkawi, Ismael, et al.
Publicado: (2025)
por: Elsharkawi, Ismael, et al.
Publicado: (2025)
U-Net-Like Spiking Neural Networks for Single Image Dehazing
por: Li, Huibin, et al.
Publicado: (2025)
por: Li, Huibin, et al.
Publicado: (2025)
SimWorld: A Unified Benchmark for Simulator-Conditioned Scene Generation via World Model
por: Li, Xinqing, et al.
Publicado: (2025)
por: Li, Xinqing, et al.
Publicado: (2025)
FUSE-Flow: Scalable Real-Time Multi-View Point Cloud Reconstruction Using Confidence
por: Sun, Chentian
Publicado: (2026)
por: Sun, Chentian
Publicado: (2026)
Distinguishing Visually Similar Actions: Prompt-Guided Semantic Prototype Modulation for Few-Shot Action Recognition
por: Li, Xiaoyang, et al.
Publicado: (2025)
por: Li, Xiaoyang, et al.
Publicado: (2025)
RGB-Only Gaussian Splatting SLAM for Unbounded Outdoor Scenes
por: Yu, Sicheng, et al.
Publicado: (2025)
por: Yu, Sicheng, et al.
Publicado: (2025)
DynFocus: Dynamic Cooperative Network Empowers LLMs with Video Understanding
por: Han, Yudong, et al.
Publicado: (2024)
por: Han, Yudong, et al.
Publicado: (2024)
4DThinker: Thinking with 4D Imagery for Dynamic Spatial Understanding
por: Chen, Zhangquan, et al.
Publicado: (2026)
por: Chen, Zhangquan, et al.
Publicado: (2026)
vS-Graphs: Tightly Coupling Visual SLAM and 3D Scene Graphs Exploiting Hierarchical Scene Understanding
por: Tourani, Ali, et al.
Publicado: (2025)
por: Tourani, Ali, et al.
Publicado: (2025)
SurgVLM: A Large Vision-Language Model and Systematic Evaluation Benchmark for Surgical Intelligence
por: Zeng, Zhitao, et al.
Publicado: (2025)
por: Zeng, Zhitao, et al.
Publicado: (2025)
ReSpace: Text-Driven Autoregressive 3D Indoor Scene Synthesis and Editing
por: Bucher, Martin JJ., et al.
Publicado: (2025)
por: Bucher, Martin JJ., et al.
Publicado: (2025)
LESV: Language Embedded Sparse Voxel Fusion for Open-Vocabulary 3D Scene Understanding
por: Wang, Fusang, et al.
Publicado: (2026)
por: Wang, Fusang, et al.
Publicado: (2026)
Escaping The Big Data Paradigm in Self-Supervised Representation Learning
por: García, Carlos Vélez, et al.
Publicado: (2025)
por: García, Carlos Vélez, et al.
Publicado: (2025)
Voxel Scene Graph for Intracranial Hemorrhage
por: Sanner, Antoine P., et al.
Publicado: (2024)
por: Sanner, Antoine P., et al.
Publicado: (2024)
FoR-Net: Learning to Focus on Hard Regions for Efficient Semantic Segmentation
por: Chan, Sheng-Wei, et al.
Publicado: (2026)
por: Chan, Sheng-Wei, et al.
Publicado: (2026)
BlindSight: Harnessing Sparsity for Efficient Vision-Language Models
por: Srikrishnan, Tharun Adithya, et al.
Publicado: (2025)
por: Srikrishnan, Tharun Adithya, et al.
Publicado: (2025)
One Leaf Reveals the Season: Occlusion-Based Contrastive Learning with Semantic-Aware Views for Efficient Visual Representation
por: Yang, Xiaoyu, et al.
Publicado: (2024)
por: Yang, Xiaoyu, et al.
Publicado: (2024)
Breaking the Resource Wall: Geometry-Guided Sequence Modeling for Efficient Semantic Segmentation
por: Chan, Sheng-Wei, et al.
Publicado: (2026)
por: Chan, Sheng-Wei, et al.
Publicado: (2026)
MINT: Mitigating Hallucinations in Large Vision-Language Models via Token Reduction
por: Wang, Chao, et al.
Publicado: (2025)
por: Wang, Chao, et al.
Publicado: (2025)
EmoVerse: A MLLMs-Driven Emotion Representation Dataset for Interpretable Visual Emotion Analysis
por: Guo, Yijie, et al.
Publicado: (2025)
por: Guo, Yijie, et al.
Publicado: (2025)
Clustering Guided Domain-Specific Pretrained Foundation Model Very High-Resolution Arctic Remote Sensing
por: Perera, Amal S., et al.
Publicado: (2026)
por: Perera, Amal S., et al.
Publicado: (2026)
Robust Confidence Intervals in Stereo Matching using Possibility Theory
por: Malinowski, Roman, et al.
Publicado: (2024)
por: Malinowski, Roman, et al.
Publicado: (2024)
Accelerating Post-Tornado Disaster Assessment Using Advanced Deep Learning Models
por: Umeike, Robinson, et al.
Publicado: (2024)
por: Umeike, Robinson, et al.
Publicado: (2024)
UTAL-GNN: Unsupervised Temporal Action Localization using Graph Neural Networks
por: Badatya, Bikash Kumar, et al.
Publicado: (2025)
por: Badatya, Bikash Kumar, et al.
Publicado: (2025)
Learning Association via Track-Detection Matching for Multi-Object Tracking
por: Adžemović, Momir
Publicado: (2025)
por: Adžemović, Momir
Publicado: (2025)
Multi-Scale Spatial-Temporal Self-Attention Graph Convolutional Networks for Skeleton-based Action Recognition
por: Nakamura, Ikuo
Publicado: (2024)
por: Nakamura, Ikuo
Publicado: (2024)
GIIM: Graph-based Learning of Inter- and Intra-view Dependencies for Multi-view Medical Image Diagnosis
por: Sam, Tran Bao, et al.
Publicado: (2026)
por: Sam, Tran Bao, et al.
Publicado: (2026)
OmniFall: From Staged Through Synthetic to Wild, A Unified Multi-Domain Dataset for Robust Fall Detection
por: Schneider, David, et al.
Publicado: (2025)
por: Schneider, David, et al.
Publicado: (2025)
An Evaluation of a Visual Question Answering Strategy for Zero-shot Facial Expression Recognition in Still Images
por: Castrillón-Santana, Modesto, et al.
Publicado: (2025)
por: Castrillón-Santana, Modesto, et al.
Publicado: (2025)
A Challenging Benchmark of Anime Style Recognition
por: Li, Haotang, et al.
Publicado: (2022)
por: Li, Haotang, et al.
Publicado: (2022)
Textual and Visual Guided Task Adaptation for Source-Free Cross-Domain Few-Shot Segmentation
por: Liu, Jianming, et al.
Publicado: (2025)
por: Liu, Jianming, et al.
Publicado: (2025)
YotoR-You Only Transform One Representation
por: Villa, José Ignacio Díaz, et al.
Publicado: (2024)
por: Villa, José Ignacio Díaz, et al.
Publicado: (2024)
Ejemplares similares
-
Decoding the Surgical Scene: A Scoping Review of Scene Graphs in Surgery
por: Henriques, Angelo, et al.
Publicado: (2025) -
SANGRIA: Surgical Video Scene Graph Optimization for Surgical Workflow Prediction
por: Köksal, Çağhan, et al.
Publicado: (2024) -
CAT-SG: A Large Dynamic Scene Graph Dataset for Fine-Grained Understanding of Cataract Surgery
por: Holm, Felix, et al.
Publicado: (2025) -
UniQ: Unified Decoder with Task-specific Queries for Efficient Scene Graph Generation
por: Liao, Xinyao, et al.
Publicado: (2025) -
FlowIBR: Leveraging Pre-Training for Efficient Neural Image-Based Rendering of Dynamic Scenes
por: Büsching, Marcel, et al.
Publicado: (2023)