Towards Holistic Surgical Scene Understanding
Fuente:
arXiv
Guardado en:
| Autores principales: | Valderrama, Natalia, Puentes, Paola Ruiz, Hernández, Isabela, Ayobi, Nicolás, Verlyk, Mathilde, Santander, Jessica, Caicedo, Juan, Fernández, Nicolás, Arbeláez, Pablo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2022
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Pixel-Wise Recognition for Holistic Surgical Scene Understanding
por: Ayobi, Nicolás, et al.
Publicado: (2024)
por: Ayobi, Nicolás, et al.
Publicado: (2024)
MATIS: Masked-Attention Transformers for Surgical Instrument Segmentation
por: Ayobi, Nicolás, et al.
Publicado: (2023)
por: Ayobi, Nicolás, et al.
Publicado: (2023)
MuST: Multi-Scale Transformers for Surgical Phase Recognition
por: Pérez, Alejandra, et al.
Publicado: (2024)
por: Pérez, Alejandra, et al.
Publicado: (2024)
Towards Holistic Surgical Scene Graph
por: Shin, Jongmin, et al.
Publicado: (2025)
por: Shin, Jongmin, et al.
Publicado: (2025)
Towards Automated Petrography
por: Chacón, Isai Daniel, et al.
Publicado: (2025)
por: Chacón, Isai Daniel, et al.
Publicado: (2025)
Language and Geometry Grounded Sparse Voxel Representations for Holistic Scene Understanding
por: Wu, Guile, et al.
Publicado: (2026)
por: Wu, Guile, et al.
Publicado: (2026)
Articulate3D: Holistic Understanding of 3D Scenes as Universal Scene Description
por: Halacheva, Anna-Maria, et al.
Publicado: (2024)
por: Halacheva, Anna-Maria, et al.
Publicado: (2024)
CycleSAM: Few-Shot Surgical Scene Segmentation with Cycle- and Scene-Consistent Feature Matching
por: Murali, Aditya, et al.
Publicado: (2024)
por: Murali, Aditya, et al.
Publicado: (2024)
STRIDE: Street View-based Environmental Feature Detection and Pedestrian Collision Prediction
por: González, Cristina, et al.
Publicado: (2023)
por: González, Cristina, et al.
Publicado: (2023)
Advancing Surgical VQA with Scene Graph Knowledge
por: Yuan, Kun, et al.
Publicado: (2023)
por: Yuan, Kun, et al.
Publicado: (2023)
HUGS: Holistic Urban 3D Scene Understanding via Gaussian Splatting
por: Zhou, Hongyu, et al.
Publicado: (2024)
por: Zhou, Hongyu, et al.
Publicado: (2024)
Towards Unified Surgical Scene Understanding:Bridging Reasoning and Grounding via MLLMs
por: Huang, Jincai, et al.
Publicado: (2026)
por: Huang, Jincai, et al.
Publicado: (2026)
Optimizing Latent Graph Representations of Surgical Scenes for Zero-Shot Domain Transfer
por: Satyanaik, Siddhant, et al.
Publicado: (2024)
por: Satyanaik, Siddhant, et al.
Publicado: (2024)
Semi-Supervised Crowd Counting with Contextual Modeling: Facilitating Holistic Understanding of Crowd Scenes
por: Qian, Yifei, et al.
Publicado: (2023)
por: Qian, Yifei, et al.
Publicado: (2023)
SurgTPGS: Semantic 3D Surgical Scene Understanding with Text Promptable Gaussian Splatting
por: Huang, Yiming, et al.
Publicado: (2025)
por: Huang, Yiming, et al.
Publicado: (2025)
GaussianGPT: Towards Autoregressive 3D Gaussian Scene Generation
por: von Lützow, Nicolas, et al.
Publicado: (2026)
por: von Lützow, Nicolas, et al.
Publicado: (2026)
Surgical Scene Understanding in the Era of Foundation AI Models: A Comprehensive Review
por: Khan, Ufaq, et al.
Publicado: (2025)
por: Khan, Ufaq, et al.
Publicado: (2025)
Surg-SegFormer: A Dual Transformer-Based Model for Holistic Surgical Scene Segmentation
por: Ahmed, Fatimaelzahraa, et al.
Publicado: (2025)
por: Ahmed, Fatimaelzahraa, et al.
Publicado: (2025)
EgoCast: Forecasting Egocentric Human Pose in the Wild
por: Escobar, Maria, et al.
Publicado: (2024)
por: Escobar, Maria, et al.
Publicado: (2024)
Towards Video Thinking Test: A Holistic Benchmark for Advanced Video Reasoning and Understanding
por: Zhang, Yuanhan, et al.
Publicado: (2025)
por: Zhang, Yuanhan, et al.
Publicado: (2025)
SurgViVQA: Temporally-Grounded Video Question Answering for Surgical Scene Understanding
por: Drago, Mauro Orazio, et al.
Publicado: (2025)
por: Drago, Mauro Orazio, et al.
Publicado: (2025)
FMGS: Foundation Model Embedded 3D Gaussian Splatting for Holistic 3D Scene Understanding
por: Zuo, Xingxing, et al.
Publicado: (2024)
por: Zuo, Xingxing, et al.
Publicado: (2024)
SurgVidLM: Towards Multi-grained Surgical Video Understanding with Large Language Model
por: Wang, Guankun, et al.
Publicado: (2025)
por: Wang, Guankun, et al.
Publicado: (2025)
PPTBench: Towards Holistic Evaluation of Large Language Models for PowerPoint Layout and Design Understanding
por: Huang, Zheng, et al.
Publicado: (2025)
por: Huang, Zheng, et al.
Publicado: (2025)
Holistic Order Prediction in Natural Scenes
por: Musacchio, Pierre, et al.
Publicado: (2025)
por: Musacchio, Pierre, et al.
Publicado: (2025)
Holistic Large-Scale Scene Reconstruction via Mixed Gaussian Splatting
por: Liu, Chuandong, et al.
Publicado: (2025)
por: Liu, Chuandong, et al.
Publicado: (2025)
SurgiTrack: Fine-Grained Multi-Class Multi-Tool Tracking in Surgical Videos
por: Nwoye, Chinedu Innocent, et al.
Publicado: (2024)
por: Nwoye, Chinedu Innocent, et al.
Publicado: (2024)
SurgCUT3R: Surgical Scene-Aware Continuous Understanding of Temporal 3D Representation
por: Xu, Kaiyuan, et al.
Publicado: (2026)
por: Xu, Kaiyuan, et al.
Publicado: (2026)
The Endoscapes Dataset for Surgical Scene Segmentation, Object Detection, and Critical View of Safety Assessment: Official Splits and Benchmark
por: Murali, Aditya, et al.
Publicado: (2023)
por: Murali, Aditya, et al.
Publicado: (2023)
Chorus: Multi-Teacher Pretraining for Holistic 3D Gaussian Scene Encoding
por: Li, Yue, et al.
Publicado: (2025)
por: Li, Yue, et al.
Publicado: (2025)
Surgical Depth Anything: Depth Estimation for Surgical Scenes using Foundation Models
por: Lou, Ange, et al.
Publicado: (2024)
por: Lou, Ange, et al.
Publicado: (2024)
SEPAL: Spatial Gene Expression Prediction from Local Graphs
por: Mejia, Gabriel, et al.
Publicado: (2023)
por: Mejia, Gabriel, et al.
Publicado: (2023)
Latent Gene Diffusion for Spatial Transcriptomics Completion
por: Cárdenas, Paula, et al.
Publicado: (2025)
por: Cárdenas, Paula, et al.
Publicado: (2025)
Cholec80-port: A Geometrically Consistent Trocar Port Segmentation Dataset for Robust Surgical Scene Understanding
por: Kikuchi, Shunsuke, et al.
Publicado: (2026)
por: Kikuchi, Shunsuke, et al.
Publicado: (2026)
Surgical-LLaVA: Toward Surgical Scenario Understanding via Large Language and Vision Models
por: Jin, Juseong, et al.
Publicado: (2024)
por: Jin, Juseong, et al.
Publicado: (2024)
HIS-GPT: Towards 3D Human-In-Scene Multimodal Understanding
por: Zhao, Jiahe, et al.
Publicado: (2025)
por: Zhao, Jiahe, et al.
Publicado: (2025)
Part-Whole Relational Fusion Towards Multi-Modal Scene Understanding
por: Liu, Yi, et al.
Publicado: (2024)
por: Liu, Yi, et al.
Publicado: (2024)
SurgicalGaussian: Deformable 3D Gaussians for High-Fidelity Surgical Scene Reconstruction
por: Xie, Weixing, et al.
Publicado: (2024)
por: Xie, Weixing, et al.
Publicado: (2024)
SurgMLLMBench: A Multimodal Large Language Model Benchmark Dataset for Surgical Scene Understanding
por: Choi, Tae-Min, et al.
Publicado: (2025)
por: Choi, Tae-Min, et al.
Publicado: (2025)
fine-CLIP: Enhancing Zero-Shot Fine-Grained Surgical Action Recognition with Vision-Language Models
por: Sharma, Saurav, et al.
Publicado: (2025)
por: Sharma, Saurav, et al.
Publicado: (2025)
Ejemplares similares
-
Pixel-Wise Recognition for Holistic Surgical Scene Understanding
por: Ayobi, Nicolás, et al.
Publicado: (2024) -
MATIS: Masked-Attention Transformers for Surgical Instrument Segmentation
por: Ayobi, Nicolás, et al.
Publicado: (2023) -
MuST: Multi-Scale Transformers for Surgical Phase Recognition
por: Pérez, Alejandra, et al.
Publicado: (2024) -
Towards Holistic Surgical Scene Graph
por: Shin, Jongmin, et al.
Publicado: (2025) -
Towards Automated Petrography
por: Chacón, Isai Daniel, et al.
Publicado: (2025)