Multitask Learning in Minimally Invasive Surgical Vision: A Review
Fuente:
arXiv
Salvato in:
| Autori principali: | Alabi, Oluwatosin, Vercauteren, Tom, Shi, Miaojing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Text Promptable Surgical Instrument Segmentation with Vision-Language Models
di: Zhou, Zijian, et al.
Pubblicazione: (2023)
di: Zhou, Zijian, et al.
Pubblicazione: (2023)
Grounding Surgical Action Triplets with Instrument Instance Segmentation: A Dataset and Target-Aware Fusion Approach
di: Alabi, Oluwatosin, et al.
Pubblicazione: (2025)
di: Alabi, Oluwatosin, et al.
Pubblicazione: (2025)
SurgPIS: Surgical-instrument-level Instances and Part-level Semantics for Weakly-supervised Part-aware Instance Segmentation
di: Wei, Meng, et al.
Pubblicazione: (2025)
di: Wei, Meng, et al.
Pubblicazione: (2025)
Large Model driven Radiology Report Generation with Clinical Quality Reinforcement Learning
di: Zhou, Zijian, et al.
Pubblicazione: (2024)
di: Zhou, Zijian, et al.
Pubblicazione: (2024)
CholecInstanceSeg: A Tool Instance Segmentation Dataset for Laparoscopic Surgery
di: Alabi, Oluwatosin, et al.
Pubblicazione: (2024)
di: Alabi, Oluwatosin, et al.
Pubblicazione: (2024)
Transferring Relative Monocular Depth to Surgical Vision with Temporal Consistency
di: Budd, Charlie, et al.
Pubblicazione: (2024)
di: Budd, Charlie, et al.
Pubblicazione: (2024)
When Multi-Task Learning Meets Partial Supervision: A Computer Vision Review
di: Fontana, Maxime, et al.
Pubblicazione: (2023)
di: Fontana, Maxime, et al.
Pubblicazione: (2023)
VLPrompt: Vision-Language Prompting for Panoptic Scene Graph Generation
di: Zhou, Zijian, et al.
Pubblicazione: (2023)
di: Zhou, Zijian, et al.
Pubblicazione: (2023)
SegMatch: A semi-supervised learning method for surgical instrument segmentation
di: Wei, Meng, et al.
Pubblicazione: (2023)
di: Wei, Meng, et al.
Pubblicazione: (2023)
Enhancing Space-time Video Super-resolution via Spatial-temporal Feature Interaction
di: Yue, Zijie, et al.
Pubblicazione: (2022)
di: Yue, Zijie, et al.
Pubblicazione: (2022)
Learning-based sound speed estimation and aberration correction in linear-array photoacoustic imaging
di: Shi, Mengjie, et al.
Pubblicazione: (2023)
di: Shi, Mengjie, et al.
Pubblicazione: (2023)
ROBUST-MIPS: A Combined Skeletal Pose and Instance Segmentation Dataset for Laparoscopic Surgical Instruments
di: Han, Zhe, et al.
Pubblicazione: (2025)
di: Han, Zhe, et al.
Pubblicazione: (2025)
LEMON: A Large Endoscopic MONocular Dataset and Foundation Model for Perception in Surgical Settings
di: Che, Chengan, et al.
Pubblicazione: (2025)
di: Che, Chengan, et al.
Pubblicazione: (2025)
Memory-guided Network with Uncertainty-based Feature Augmentation for Few-shot Semantic Segmentation
di: Chen, Xinyue, et al.
Pubblicazione: (2024)
di: Chen, Xinyue, et al.
Pubblicazione: (2024)
FAAR: Efficient Frequency-Aware Multi-Task Fine-Tuning via Automatic Rank Selection
di: Fontana, Maxime, et al.
Pubblicazione: (2026)
di: Fontana, Maxime, et al.
Pubblicazione: (2026)
Boosting Object Detection with Zero-Shot Day-Night Domain Adaptation
di: Du, Zhipeng, et al.
Pubblicazione: (2023)
di: Du, Zhipeng, et al.
Pubblicazione: (2023)
Bootstrapping Vision-language Models for Self-supervised Remote Physiological Measurement
di: Yue, Zijie, et al.
Pubblicazione: (2024)
di: Yue, Zijie, et al.
Pubblicazione: (2024)
Label merge-and-split: A graph-colouring approach for memory-efficient brain parcellation
di: Kujawa, Aaron, et al.
Pubblicazione: (2024)
di: Kujawa, Aaron, et al.
Pubblicazione: (2024)
UltraFlwr -- An Efficient Federated Surgical Object Detection Framework
di: Li, Yang, et al.
Pubblicazione: (2025)
di: Li, Yang, et al.
Pubblicazione: (2025)
OpenPSG: Open-set Panoptic Scene Graph Generation via Large Multimodal Models
di: Zhou, Zijian, et al.
Pubblicazione: (2024)
di: Zhou, Zijian, et al.
Pubblicazione: (2024)
Weakly-Supervised Referring Video Object Segmentation through Text Supervision
di: Shi, Miaojing, et al.
Pubblicazione: (2026)
di: Shi, Miaojing, et al.
Pubblicazione: (2026)
LoSh: Long-Short Text Joint Prediction Network for Referring Video Object Segmentation
di: Yuan, Linfeng, et al.
Pubblicazione: (2023)
di: Yuan, Linfeng, et al.
Pubblicazione: (2023)
Optimizing Dense Visual Predictions Through Multi-Task Coherence and Prioritization
di: Fontana, Maxime, et al.
Pubblicazione: (2024)
di: Fontana, Maxime, et al.
Pubblicazione: (2024)
Where It Moves, It Matters: Referring Surgical Instrument Segmentation via Motion
di: Wei, Meng, et al.
Pubblicazione: (2026)
di: Wei, Meng, et al.
Pubblicazione: (2026)
LoViT: Long Video Transformer for Surgical Phase Recognition
di: Liu, Yang, et al.
Pubblicazione: (2023)
di: Liu, Yang, et al.
Pubblicazione: (2023)
IMITATE: Clinical Prior Guided Hierarchical Vision-Language Pre-training
di: Liu, Che, et al.
Pubblicazione: (2023)
di: Liu, Che, et al.
Pubblicazione: (2023)
Learning Streaming Video Representation via Multitask Training
di: Yan, Yibin, et al.
Pubblicazione: (2025)
di: Yan, Yibin, et al.
Pubblicazione: (2025)
Beyond one-hot encoding? Journey into compact encoding for large multi-class segmentation
di: Kujawa, Aaron, et al.
Pubblicazione: (2025)
di: Kujawa, Aaron, et al.
Pubblicazione: (2025)
Enhancing Generalized Few-Shot Semantic Segmentation via Effective Knowledge Transfer
di: Chen, Xinyue, et al.
Pubblicazione: (2024)
di: Chen, Xinyue, et al.
Pubblicazione: (2024)
MPDrive: Improving Spatial Understanding with Marker-Based Prompt Learning for Autonomous Driving
di: Zhang, Zhiyuan, et al.
Pubblicazione: (2025)
di: Zhang, Zhiyuan, et al.
Pubblicazione: (2025)
OOD-SEG: Exploiting out-of-distribution detection techniques for learning image segmentation from sparse multi-class positive-only annotations
di: Wang, Junwen, et al.
Pubblicazione: (2024)
di: Wang, Junwen, et al.
Pubblicazione: (2024)
Confidence-aware Monocular Depth Estimation for Minimally Invasive Surgery
di: Asad, Muhammad, et al.
Pubblicazione: (2026)
di: Asad, Muhammad, et al.
Pubblicazione: (2026)
RAVEN: Multitask Retrieval Augmented Vision-Language Learning
di: Rao, Varun Nagaraj, et al.
Pubblicazione: (2024)
di: Rao, Varun Nagaraj, et al.
Pubblicazione: (2024)
HyKey: Hyperspectral Keypoint Detection and Matching in Minimally Invasive Surgery
di: Saikia, Alexander, et al.
Pubblicazione: (2026)
di: Saikia, Alexander, et al.
Pubblicazione: (2026)
SEG-SAM: Semantic-Guided SAM for Unified Medical Image Segmentation
di: Huang, Shuangping, et al.
Pubblicazione: (2024)
di: Huang, Shuangping, et al.
Pubblicazione: (2024)
Bootstrapping MLLM for Weakly-Supervised Class-Agnostic Object Counting
di: Zhang, Xiaowen, et al.
Pubblicazione: (2026)
di: Zhang, Xiaowen, et al.
Pubblicazione: (2026)
Text-promptable Object Counting via Quantity Awareness Enhancement
di: Shi, Miaojing, et al.
Pubblicazione: (2025)
di: Shi, Miaojing, et al.
Pubblicazione: (2025)
Tree-based Semantic Losses: Application to Sparsely-supervised Large Multi-class Hyperspectral Segmentation
di: Wang, Junwen, et al.
Pubblicazione: (2025)
di: Wang, Junwen, et al.
Pubblicazione: (2025)
Jumpstarting Surgical Computer Vision
di: Alapatt, Deepak, et al.
Pubblicazione: (2023)
di: Alapatt, Deepak, et al.
Pubblicazione: (2023)
Group Diffusion Transformers are Unsupervised Multitask Learners
di: Huang, Lianghua, et al.
Pubblicazione: (2024)
di: Huang, Lianghua, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Text Promptable Surgical Instrument Segmentation with Vision-Language Models
di: Zhou, Zijian, et al.
Pubblicazione: (2023) -
Grounding Surgical Action Triplets with Instrument Instance Segmentation: A Dataset and Target-Aware Fusion Approach
di: Alabi, Oluwatosin, et al.
Pubblicazione: (2025) -
SurgPIS: Surgical-instrument-level Instances and Part-level Semantics for Weakly-supervised Part-aware Instance Segmentation
di: Wei, Meng, et al.
Pubblicazione: (2025) -
Large Model driven Radiology Report Generation with Clinical Quality Reinforcement Learning
di: Zhou, Zijian, et al.
Pubblicazione: (2024) -
CholecInstanceSeg: A Tool Instance Segmentation Dataset for Laparoscopic Surgery
di: Alabi, Oluwatosin, et al.
Pubblicazione: (2024)