Salvato in:
| Autori principali: | Peterson, Ethan, Zhan, Huixin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2603.05732 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Agentic Surgical AI: Surgeon Style Fingerprinting and Privacy Risk Quantification via Discrete Diffusion in a Vision-Language-Action Framework
di: Zhan, Huixin, et al.
Pubblicazione: (2025)
di: Zhan, Huixin, et al.
Pubblicazione: (2025)
Enhancing Surgical Performance in Cardiothoracic Surgery with Innovations from Computer Vision and Artificial Intelligence: A Narrative Review
di: Constable, Merryn D., et al.
Pubblicazione: (2024)
di: Constable, Merryn D., et al.
Pubblicazione: (2024)
Robust Surgical Phase Recognition From Annotation Efficient Supervision
di: Rubin, Or, et al.
Pubblicazione: (2024)
di: Rubin, Or, et al.
Pubblicazione: (2024)
Surgformer: Surgical Transformer with Hierarchical Temporal Attention for Surgical Phase Recognition
di: Yang, Shu, et al.
Pubblicazione: (2024)
di: Yang, Shu, et al.
Pubblicazione: (2024)
Contextual AD Narration with Interleaved Multimodal Sequence
di: Wang, Hanlin, et al.
Pubblicazione: (2024)
di: Wang, Hanlin, et al.
Pubblicazione: (2024)
Enriching Phrases with Coupled Pixel and Object Contexts for Panoptic Narrative Grounding
di: Hui, Tianrui, et al.
Pubblicazione: (2023)
di: Hui, Tianrui, et al.
Pubblicazione: (2023)
SurgPETL: Parameter-Efficient Image-to-Surgical-Video Transfer Learning for Surgical Phase Recognition
di: Yang, Shu, et al.
Pubblicazione: (2024)
di: Yang, Shu, et al.
Pubblicazione: (2024)
Thoracic Surgery Video Analysis for Surgical Phase Recognition
di: Mateen, Syed Abdul, et al.
Pubblicazione: (2024)
di: Mateen, Syed Abdul, et al.
Pubblicazione: (2024)
Dynamic Prompting of Frozen Text-to-Image Diffusion Models for Panoptic Narrative Grounding
di: Li, Hongyu, et al.
Pubblicazione: (2024)
di: Li, Hongyu, et al.
Pubblicazione: (2024)
Beyond Isolated Facts: Synthesizing Narrative and Grounded Supervision for VideoQA
di: Liang, Jianxin, et al.
Pubblicazione: (2025)
di: Liang, Jianxin, et al.
Pubblicazione: (2025)
Amodal Ground Truth and Completion in the Wild
di: Zhan, Guanqi, et al.
Pubblicazione: (2023)
di: Zhan, Guanqi, et al.
Pubblicazione: (2023)
SPRMamba: Surgical Phase Recognition for Endoscopic Submucosal Dissection with Mamba
di: Zhang, Xiangning, et al.
Pubblicazione: (2024)
di: Zhang, Xiangning, et al.
Pubblicazione: (2024)
Moondream Segmentation: From Words to Masks
di: Reid, Ethan
Pubblicazione: (2026)
di: Reid, Ethan
Pubblicazione: (2026)
GroundedSurg: A Multi-Procedure Benchmark for Language-Conditioned Surgical Tool Segmentation
di: Ashraf, Tajamul, et al.
Pubblicazione: (2026)
di: Ashraf, Tajamul, et al.
Pubblicazione: (2026)
SurgViVQA: Temporally-Grounded Video Question Answering for Surgical Scene Understanding
di: Drago, Mauro Orazio, et al.
Pubblicazione: (2025)
di: Drago, Mauro Orazio, et al.
Pubblicazione: (2025)
SuPRA: Surgical Phase Recognition and Anticipation for Intra-Operative Planning
di: Boels, Maxence, et al.
Pubblicazione: (2024)
di: Boels, Maxence, et al.
Pubblicazione: (2024)
SurgX: Neuron-Concept Association for Explainable Surgical Phase Recognition
di: Kim, Ka Young, et al.
Pubblicazione: (2025)
di: Kim, Ka Young, et al.
Pubblicazione: (2025)
Benchmarking and Enhancing Surgical Phase Recognition Models for Robotic-Assisted Esophagectomy
di: Li, Yiping, et al.
Pubblicazione: (2024)
di: Li, Yiping, et al.
Pubblicazione: (2024)
SR-Mamba: Effective Surgical Phase Recognition with State Space Model
di: Cao, Rui, et al.
Pubblicazione: (2024)
di: Cao, Rui, et al.
Pubblicazione: (2024)
DSLO: Deep Sequence LiDAR Odometry Based on Inconsistent Spatio-temporal Propagation
di: Zhang, Huixin, et al.
Pubblicazione: (2024)
di: Zhang, Huixin, et al.
Pubblicazione: (2024)
Visually Grounded Narratives: Reducing Cognitive Burden in Researcher-Participant Interaction
di: Wu, Runtong, et al.
Pubblicazione: (2025)
di: Wu, Runtong, et al.
Pubblicazione: (2025)
MoSFormer: Augmenting Temporal Context with Memory of Surgery for Surgical Phase Recognition
di: Ding, Hao, et al.
Pubblicazione: (2025)
di: Ding, Hao, et al.
Pubblicazione: (2025)
Towards Robust Algorithms for Surgical Phase Recognition via Digital Twin Representation
di: Ding, Hao, et al.
Pubblicazione: (2024)
di: Ding, Hao, et al.
Pubblicazione: (2024)
SemiVT-Surge: Semi-Supervised Video Transformer for Surgical Phase Recognition
di: Li, Yiping, et al.
Pubblicazione: (2025)
di: Li, Yiping, et al.
Pubblicazione: (2025)
From Panels to Prose: Generating Literary Narratives from Comics
di: Sachdeva, Ragav, et al.
Pubblicazione: (2025)
di: Sachdeva, Ragav, et al.
Pubblicazione: (2025)
Grounding Surgical Action Triplets with Instrument Instance Segmentation: A Dataset and Target-Aware Fusion Approach
di: Alabi, Oluwatosin, et al.
Pubblicazione: (2025)
di: Alabi, Oluwatosin, et al.
Pubblicazione: (2025)
Uncertainty-Aware Gradient Stabilization for Small Object Detection
di: Sun, Huixin, et al.
Pubblicazione: (2023)
di: Sun, Huixin, et al.
Pubblicazione: (2023)
Mask-ControlNet: Higher-Quality Image Generation with An Additional Mask Prompt
di: Huang, Zhiqi, et al.
Pubblicazione: (2024)
di: Huang, Zhiqi, et al.
Pubblicazione: (2024)
Video Dataset for Surgical Phase, Keypoint, and Instrument Recognition in Laparoscopic Surgery (PhaKIR)
di: Rueckert, Tobias, et al.
Pubblicazione: (2025)
di: Rueckert, Tobias, et al.
Pubblicazione: (2025)
EGM: Efficient Visual Grounding Language Models
di: Zhan, Guanqi, et al.
Pubblicazione: (2026)
di: Zhan, Guanqi, et al.
Pubblicazione: (2026)
T2T-VICL: Unlocking the Boundaries of Cross-Task Visual In-Context Learning via Implicit Text-Driven VLMs
di: Xia, Shao-Jun, et al.
Pubblicazione: (2025)
di: Xia, Shao-Jun, et al.
Pubblicazione: (2025)
What, when, and where? -- Self-Supervised Spatio-Temporal Grounding in Untrimmed Multi-Action Videos from Narrated Instructions
di: Chen, Brian, et al.
Pubblicazione: (2023)
di: Chen, Brian, et al.
Pubblicazione: (2023)
TUNeS: A Temporal U-Net with Self-Attention for Video-based Surgical Phase Recognition
di: Funke, Isabel, et al.
Pubblicazione: (2023)
di: Funke, Isabel, et al.
Pubblicazione: (2023)
From Generalization to Precision: Exploring SAM for Tool Segmentation in Surgical Environments
di: Oguine, Kanyifeechukwu J., et al.
Pubblicazione: (2024)
di: Oguine, Kanyifeechukwu J., et al.
Pubblicazione: (2024)
Towards Unified Surgical Scene Understanding:Bridging Reasoning and Grounding via MLLMs
di: Huang, Jincai, et al.
Pubblicazione: (2026)
di: Huang, Jincai, et al.
Pubblicazione: (2026)
HOTFormerLoc: Hierarchical Octree Transformer for Versatile Lidar Place Recognition Across Ground and Aerial Views
di: Griffiths, Ethan, et al.
Pubblicazione: (2025)
di: Griffiths, Ethan, et al.
Pubblicazione: (2025)
SF-TMN: SlowFast Temporal Modeling Network for Surgical Phase Recognition
di: Zhang, Bokai, et al.
Pubblicazione: (2023)
di: Zhang, Bokai, et al.
Pubblicazione: (2023)
Stabilizing Temporal Inference Dynamics for Online Surgical Phase Recognition
di: Liu, Yang, et al.
Pubblicazione: (2026)
di: Liu, Yang, et al.
Pubblicazione: (2026)
LoViT: Long Video Transformer for Surgical Phase Recognition
di: Liu, Yang, et al.
Pubblicazione: (2023)
di: Liu, Yang, et al.
Pubblicazione: (2023)
MuST: Multi-Scale Transformers for Surgical Phase Recognition
di: Pérez, Alejandra, et al.
Pubblicazione: (2024)
di: Pérez, Alejandra, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Agentic Surgical AI: Surgeon Style Fingerprinting and Privacy Risk Quantification via Discrete Diffusion in a Vision-Language-Action Framework
di: Zhan, Huixin, et al.
Pubblicazione: (2025) -
Enhancing Surgical Performance in Cardiothoracic Surgery with Innovations from Computer Vision and Artificial Intelligence: A Narrative Review
di: Constable, Merryn D., et al.
Pubblicazione: (2024) -
Robust Surgical Phase Recognition From Annotation Efficient Supervision
di: Rubin, Or, et al.
Pubblicazione: (2024) -
Surgformer: Surgical Transformer with Hierarchical Temporal Attention for Surgical Phase Recognition
di: Yang, Shu, et al.
Pubblicazione: (2024) -
Contextual AD Narration with Interleaved Multimodal Sequence
di: Wang, Hanlin, et al.
Pubblicazione: (2024)