Surgical Text-to-Image Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nwoye, Chinedu Innocent, Bose, Rupak, Elgohary, Kareem, Arboit, Lorenzo, Carlino, Giorgio, Lavanchy, Joël L., Mascagni, Pietro, Padoy, Nicolas |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SimGen: A Diffusion-Based Framework for Simultaneous Surgical Image and Segmentation Mask Generation
par: Bhat, Aditya, et autres
Publié: (2025)
par: Bhat, Aditya, et autres
Publié: (2025)
CholecTrack20: A Multi-Perspective Tracking Dataset for Surgical Tools
par: Nwoye, Chinedu Innocent, et autres
Publié: (2023)
par: Nwoye, Chinedu Innocent, et autres
Publié: (2023)
Feature Mixing Approach for Detecting Intraoperative Adverse Events in Laparoscopic Roux-en-Y Gastric Bypass Surgery
par: Bose, Rupak, et autres
Publié: (2025)
par: Bose, Rupak, et autres
Publié: (2025)
CoSimGen: Controllable Diffusion Model for Simultaneous Image and Mask Generation
par: Bose, Rupak, et autres
Publié: (2025)
par: Bose, Rupak, et autres
Publié: (2025)
SurgiTrack: Fine-Grained Multi-Class Multi-Tool Tracking in Surgical Videos
par: Nwoye, Chinedu Innocent, et autres
Publié: (2024)
par: Nwoye, Chinedu Innocent, et autres
Publié: (2024)
State-Change Learning for Prediction of Future Events in Endoscopic Videos
par: Sharma, Saurav, et autres
Publié: (2025)
par: Sharma, Saurav, et autres
Publié: (2025)
Endoshare: A Publicly Available, Surgeons-Friendly Solution to De-Identify and Manage Surgical Videos
par: Arboit, Lorenzo, et autres
Publié: (2025)
par: Arboit, Lorenzo, et autres
Publié: (2025)
SurgTEMP: Temporal-Aware Surgical Video Question Answering with Text-guided Visual Memory for Laparoscopic Cholecystectomy
par: Li, Shi, et autres
Publié: (2026)
par: Li, Shi, et autres
Publié: (2026)
Learning Multi-modal Representations by Watching Hundreds of Surgical Video Lectures
par: Yuan, Kun, et autres
Publié: (2023)
par: Yuan, Kun, et autres
Publié: (2023)
Optimizing Latent Graph Representations of Surgical Scenes for Zero-Shot Domain Transfer
par: Satyanaik, Siddhant, et autres
Publié: (2024)
par: Satyanaik, Siddhant, et autres
Publié: (2024)
CycleSAM: Few-Shot Surgical Scene Segmentation with Cycle- and Scene-Consistent Feature Matching
par: Murali, Aditya, et autres
Publié: (2024)
par: Murali, Aditya, et autres
Publié: (2024)
Advancing Surgical VQA with Scene Graph Knowledge
par: Yuan, Kun, et autres
Publié: (2023)
par: Yuan, Kun, et autres
Publié: (2023)
Jumpstarting Surgical Computer Vision
par: Alapatt, Deepak, et autres
Publié: (2023)
par: Alapatt, Deepak, et autres
Publié: (2023)
Surgeons Awareness, Expectations, and Involvement with Artificial Intelligence: a Survey Pre and Post the GPT Era
par: Arboit, Lorenzo, et autres
Publié: (2025)
par: Arboit, Lorenzo, et autres
Publié: (2025)
S4M: 4-points to Segment Anything
par: Meyer, Adrien, et autres
Publié: (2025)
par: Meyer, Adrien, et autres
Publié: (2025)
SurgLaVi: Large-Scale Hierarchical Dataset for Surgical Vision-Language Representation Learning
par: Perez, Alejandra, et autres
Publié: (2025)
par: Perez, Alejandra, et autres
Publié: (2025)
Multi-modal Representations for Fine-grained Multi-label Critical View of Safety Recognition
par: Baby, Britty, et autres
Publié: (2025)
par: Baby, Britty, et autres
Publié: (2025)
The Endoscapes Dataset for Surgical Scene Segmentation, Object Detection, and Critical View of Safety Assessment: Official Splits and Benchmark
par: Murali, Aditya, et autres
Publié: (2023)
par: Murali, Aditya, et autres
Publié: (2023)
Leveraging Generic Foundation Models for Multimodal Surgical Data Analysis
par: Pezold, Simon, et autres
Publié: (2025)
par: Pezold, Simon, et autres
Publié: (2025)
Recognizing Surgical Phases Anywhere: Few-Shot Test-time Adaptation and Task-graph Guided Refinement
par: Yuan, Kun, et autres
Publié: (2025)
par: Yuan, Kun, et autres
Publié: (2025)
When do they StOP?: A First Step Towards Automatically Identifying Team Communication in the Operating Room
par: Chen, Keqi, et autres
Publié: (2025)
par: Chen, Keqi, et autres
Publié: (2025)
SUREON: A Benchmark and Vision-Language-Model for Surgical Reasoning
par: Perez, Alejandra, et autres
Publié: (2026)
par: Perez, Alejandra, et autres
Publié: (2026)
fine-CLIP: Enhancing Zero-Shot Fine-Grained Surgical Action Recognition with Vision-Language Models
par: Sharma, Saurav, et autres
Publié: (2025)
par: Sharma, Saurav, et autres
Publié: (2025)
On the Role of Depth in Surgical Vision Foundation Models: An Empirical Study of RGB-D Pre-training
par: Han, John J., et autres
Publié: (2026)
par: Han, John J., et autres
Publié: (2026)
Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis
par: Chen, Tingxuan, et autres
Publié: (2025)
par: Chen, Tingxuan, et autres
Publié: (2025)
Early Operative Difficulty Assessment in Laparoscopic Cholecystectomy via Snapshot-Centric Video Analysis
par: Sharma, Saurav, et autres
Publié: (2025)
par: Sharma, Saurav, et autres
Publié: (2025)
Expert Consensus-based Video-Based Assessment Tool for Workflow Analysis in Minimally Invasive Colorectal Surgery: Development and Validation of ColoWorkflow
par: Jain, Pooja P, et autres
Publié: (2025)
par: Jain, Pooja P, et autres
Publié: (2025)
Procedure-Aware Surgical Video-language Pretraining with Hierarchical Knowledge Augmentation
par: Yuan, Kun, et autres
Publié: (2024)
par: Yuan, Kun, et autres
Publié: (2024)
DExTeR: Weakly Semi-Supervised Object Detection with Class and Instance Experts for Medical Imaging
par: Meyer, Adrien, et autres
Publié: (2026)
par: Meyer, Adrien, et autres
Publié: (2026)
Adaptation of Multi-modal Representation Models for Multi-task Surgical Computer Vision
par: Walimbe, Soham, et autres
Publié: (2025)
par: Walimbe, Soham, et autres
Publié: (2025)
HecVL: Hierarchical Video-Language Pretraining for Zero-shot Surgical Phase Recognition
par: Yuan, Kun, et autres
Publié: (2024)
par: Yuan, Kun, et autres
Publié: (2024)
CliPPER: Contextual Video-Language Pretraining on Long-form Intraoperative Surgical Procedures for Event Recognition
par: Stilz, Florian, et autres
Publié: (2026)
par: Stilz, Florian, et autres
Publié: (2026)
Learning from Sparse Point Labels for Dense Carcinosis Localization in Advanced Ovarian Cancer Assessment
par: Zarin, Farahdiba, et autres
Publié: (2025)
par: Zarin, Farahdiba, et autres
Publié: (2025)
Overcoming Dimensional Collapse in Self-supervised Contrastive Learning for Medical Image Segmentation
par: Hassanpour, Jamshid, et autres
Publié: (2024)
par: Hassanpour, Jamshid, et autres
Publié: (2024)
Multi-view Video-Pose Pretraining for Operating Room Surgical Activity Recognition
par: Hamoud, Idris, et autres
Publié: (2025)
par: Hamoud, Idris, et autres
Publié: (2025)
End-to-End Learning of Multi-Organ Implicit Surfaces from 3D Medical Imaging Data
par: Zarin, Farahdiba, et autres
Publié: (2025)
par: Zarin, Farahdiba, et autres
Publié: (2025)
SelfPose3d: Self-Supervised Multi-Person Multi-View 3d Pose Estimation
par: Srivastav, Vinkle, et autres
Publié: (2024)
par: Srivastav, Vinkle, et autres
Publié: (2024)
Blending Concepts with Text-to-Image Diffusion Models
par: Olearo, Lorenzo, et autres
Publié: (2025)
par: Olearo, Lorenzo, et autres
Publié: (2025)
SurgTPGS: Semantic 3D Surgical Scene Understanding with Text Promptable Gaussian Splatting
par: Huang, Yiming, et autres
Publié: (2025)
par: Huang, Yiming, et autres
Publié: (2025)
Realistic Surgical Image Dataset Generation Based On 3D Gaussian Splatting
par: Zeng, Tianle, et autres
Publié: (2024)
par: Zeng, Tianle, et autres
Publié: (2024)
Documents similaires
-
SimGen: A Diffusion-Based Framework for Simultaneous Surgical Image and Segmentation Mask Generation
par: Bhat, Aditya, et autres
Publié: (2025) -
CholecTrack20: A Multi-Perspective Tracking Dataset for Surgical Tools
par: Nwoye, Chinedu Innocent, et autres
Publié: (2023) -
Feature Mixing Approach for Detecting Intraoperative Adverse Events in Laparoscopic Roux-en-Y Gastric Bypass Surgery
par: Bose, Rupak, et autres
Publié: (2025) -
CoSimGen: Controllable Diffusion Model for Simultaneous Image and Mask Generation
par: Bose, Rupak, et autres
Publié: (2025) -
SurgiTrack: Fine-Grained Multi-Class Multi-Tool Tracking in Surgical Videos
par: Nwoye, Chinedu Innocent, et autres
Publié: (2024)