SurgFed: Language-guided Multi-Task Federated Learning for Surgical Video Understanding
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Fang, Zheng, Niu, Ziwei, Wang, Ziyue, Zhuo, Zhu, Liu, Haofeng, Qian, Shuyang, Xia, Jun, Jin, Yueming |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
SurgRAW: Multi-Agent Workflow with Chain of Thought Reasoning for Robotic Surgical Video Analysis
von: Low, Chang Han, et al.
Veröffentlicht: (2025)
von: Low, Chang Han, et al.
Veröffentlicht: (2025)
ReSurgSAM2: Referring Segment Anything in Surgical Video via Credible Long-term Tracking
von: Liu, Haofeng, et al.
Veröffentlicht: (2025)
von: Liu, Haofeng, et al.
Veröffentlicht: (2025)
UniSurgSAM: A Unified Promptable Model for Reliable Surgical Video Segmentation
von: Liu, Haofeng, et al.
Veröffentlicht: (2026)
von: Liu, Haofeng, et al.
Veröffentlicht: (2026)
Surgical SAM 2: Real-time Segment Anything in Surgical Video by Efficient Frame Pruning
von: Liu, Haofeng, et al.
Veröffentlicht: (2024)
von: Liu, Haofeng, et al.
Veröffentlicht: (2024)
SAM2S: Segment Anything in Surgical Videos via Semantic Long-term Tracking
von: Liu, Haofeng, et al.
Veröffentlicht: (2025)
von: Liu, Haofeng, et al.
Veröffentlicht: (2025)
Spatio-Temporal Representation Decoupling and Enhancement for Federated Instrument Segmentation in Surgical Videos
von: Fang, Zheng, et al.
Veröffentlicht: (2025)
von: Fang, Zheng, et al.
Veröffentlicht: (2025)
SurgVLM: A Large Vision-Language Model and Systematic Evaluation Benchmark for Surgical Intelligence
von: Zeng, Zhitao, et al.
Veröffentlicht: (2025)
von: Zeng, Zhitao, et al.
Veröffentlicht: (2025)
SurgVidLM: Towards Multi-grained Surgical Video Understanding with Large Language Model
von: Wang, Guankun, et al.
Veröffentlicht: (2025)
von: Wang, Guankun, et al.
Veröffentlicht: (2025)
SurGo-R1: Benchmarking and Modeling Contextual Reasoning for Operative Zone in Surgical Video
von: Qin, Guanyi, et al.
Veröffentlicht: (2026)
von: Qin, Guanyi, et al.
Veröffentlicht: (2026)
SurfSurg6D: Geometry Consistent Dense Correspondence for Textureless Surgical Instrument Pose Estimation
von: Shen, Daiyun, et al.
Veröffentlicht: (2026)
von: Shen, Daiyun, et al.
Veröffentlicht: (2026)
Federated Learning for Surgical Vision in Appendicitis Classification: Results of the FedSurg EndoVis 2024 Challenge
von: Kirchner, Max, et al.
Veröffentlicht: (2025)
von: Kirchner, Max, et al.
Veröffentlicht: (2025)
Structure Matters: Revisiting Boundary Refinement in Video Object Segmentation
von: Qin, Guanyi, et al.
Veröffentlicht: (2025)
von: Qin, Guanyi, et al.
Veröffentlicht: (2025)
SurgMotion: A Video-Native Foundation Model for Universal Understanding of Surgical Videos
von: Wu, Jinlin, et al.
Veröffentlicht: (2026)
von: Wu, Jinlin, et al.
Veröffentlicht: (2026)
Surgical Visual Understanding (SurgVU) Dataset
von: Zia, Aneeq, et al.
Veröffentlicht: (2025)
von: Zia, Aneeq, et al.
Veröffentlicht: (2025)
Surg$Σ$: A Spectrum of Large-Scale Multimodal Data and Foundation Models for Surgical Intelligence
von: Zeng, Zhitao, et al.
Veröffentlicht: (2026)
von: Zeng, Zhitao, et al.
Veröffentlicht: (2026)
SurgViVQA: Temporally-Grounded Video Question Answering for Surgical Scene Understanding
von: Drago, Mauro Orazio, et al.
Veröffentlicht: (2025)
von: Drago, Mauro Orazio, et al.
Veröffentlicht: (2025)
SurgPub-Video: A Comprehensive Surgical Video Dataset for Enhanced Surgical Intelligence in Vision-Language Model
von: Li, Yaoqian, et al.
Veröffentlicht: (2025)
von: Li, Yaoqian, et al.
Veröffentlicht: (2025)
FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models
von: Zheng, Weiying, et al.
Veröffentlicht: (2025)
von: Zheng, Weiying, et al.
Veröffentlicht: (2025)
SurgTEMP: Temporal-Aware Surgical Video Question Answering with Text-guided Visual Memory for Laparoscopic Cholecystectomy
von: Li, Shi, et al.
Veröffentlicht: (2026)
von: Li, Shi, et al.
Veröffentlicht: (2026)
Surg-R1: A Hierarchical Reasoning Foundation Model for Scalable and Interpretable Surgical Decision Support with Multi-Center Clinical Validation
von: Jiang, Jian, et al.
Veröffentlicht: (2026)
von: Jiang, Jian, et al.
Veröffentlicht: (2026)
SurgMLLMBench: A Multimodal Large Language Model Benchmark Dataset for Surgical Scene Understanding
von: Choi, Tae-Min, et al.
Veröffentlicht: (2025)
von: Choi, Tae-Min, et al.
Veröffentlicht: (2025)
FedCVU: Federated Learning for Cross-View Video Understanding
von: Zhang, Shenghan, et al.
Veröffentlicht: (2026)
von: Zhang, Shenghan, et al.
Veröffentlicht: (2026)
SurgGoal: Rethinking Surgical Planning Evaluation via Goal-Satisfiability
von: Li, Ruochen, et al.
Veröffentlicht: (2026)
von: Li, Ruochen, et al.
Veröffentlicht: (2026)
SurgLLM: A Versatile Large Multimodal Model with Spatial Focus and Temporal Awareness for Surgical Video Understanding
von: Chen, Zhen, et al.
Veröffentlicht: (2025)
von: Chen, Zhen, et al.
Veröffentlicht: (2025)
HieraSurg: Hierarchy-Aware Diffusion Model for Surgical Video Generation
von: Biagini, Diego, et al.
Veröffentlicht: (2025)
von: Biagini, Diego, et al.
Veröffentlicht: (2025)
SurgLQA: Scalable Long-Horizon Surgical Video Question Answering
von: Guo, Diandian, et al.
Veröffentlicht: (2026)
von: Guo, Diandian, et al.
Veröffentlicht: (2026)
SurgOnAir: Hierarchy-Aware Real-Time Surgical Video Commentary
von: He, Jingyi, et al.
Veröffentlicht: (2026)
von: He, Jingyi, et al.
Veröffentlicht: (2026)
SurgPETL: Parameter-Efficient Image-to-Surgical-Video Transfer Learning for Surgical Phase Recognition
von: Yang, Shu, et al.
Veröffentlicht: (2024)
von: Yang, Shu, et al.
Veröffentlicht: (2024)
LLaVA-Surg: Towards Multimodal Surgical Assistant via Structured Surgical Video Learning
von: Li, Jiajie, et al.
Veröffentlicht: (2024)
von: Li, Jiajie, et al.
Veröffentlicht: (2024)
GroundedSurg: A Multi-Procedure Benchmark for Language-Conditioned Surgical Tool Segmentation
von: Ashraf, Tajamul, et al.
Veröffentlicht: (2026)
von: Ashraf, Tajamul, et al.
Veröffentlicht: (2026)
3DMedAgent: Unified Perception-to-Understanding for 3D Medical Analysis
von: Wang, Ziyue, et al.
Veröffentlicht: (2026)
von: Wang, Ziyue, et al.
Veröffentlicht: (2026)
Free-DyGS: Camera-Pose-Free Scene Reconstruction for Dynamic Surgical Videos with Gaussian Splatting
von: Li, Qian, et al.
Veröffentlicht: (2024)
von: Li, Qian, et al.
Veröffentlicht: (2024)
FedBRB: An Effective Solution to the Small-to-Large Scenario in Device-Heterogeneity Federated Learning
von: Xu, Ziyue, et al.
Veröffentlicht: (2024)
von: Xu, Ziyue, et al.
Veröffentlicht: (2024)
SurgBench: A Unified Large-Scale Benchmark for Surgical Video Analysis
von: Wei, Jianhui, et al.
Veröffentlicht: (2025)
von: Wei, Jianhui, et al.
Veröffentlicht: (2025)
SemiVT-Surge: Semi-Supervised Video Transformer for Surgical Phase Recognition
von: Li, Yiping, et al.
Veröffentlicht: (2025)
von: Li, Yiping, et al.
Veröffentlicht: (2025)
SurgSora: Object-Aware Diffusion Model for Controllable Surgical Video Generation
von: Chen, Tong, et al.
Veröffentlicht: (2024)
von: Chen, Tong, et al.
Veröffentlicht: (2024)
Think Step by Step: Chain-of-Gesture Prompting for Error Detection in Robotic Surgical Videos
von: Shao, Zhimin, et al.
Veröffentlicht: (2024)
von: Shao, Zhimin, et al.
Veröffentlicht: (2024)
Intuitive Surgical SurgToolLoc and SurgVU Challenges Results: 2022-2025
von: Zia, Aneeq, et al.
Veröffentlicht: (2023)
von: Zia, Aneeq, et al.
Veröffentlicht: (2023)
Multi-Task Semantic Communications via Large Models
von: Ni, Wanli, et al.
Veröffentlicht: (2025)
von: Ni, Wanli, et al.
Veröffentlicht: (2025)
Language-guided Image Reflection Separation
von: Zhong, Haofeng, et al.
Veröffentlicht: (2024)
von: Zhong, Haofeng, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
SurgRAW: Multi-Agent Workflow with Chain of Thought Reasoning for Robotic Surgical Video Analysis
von: Low, Chang Han, et al.
Veröffentlicht: (2025) -
ReSurgSAM2: Referring Segment Anything in Surgical Video via Credible Long-term Tracking
von: Liu, Haofeng, et al.
Veröffentlicht: (2025) -
UniSurgSAM: A Unified Promptable Model for Reliable Surgical Video Segmentation
von: Liu, Haofeng, et al.
Veröffentlicht: (2026) -
Surgical SAM 2: Real-time Segment Anything in Surgical Video by Efficient Frame Pruning
von: Liu, Haofeng, et al.
Veröffentlicht: (2024) -
SAM2S: Segment Anything in Surgical Videos via Semantic Long-term Tracking
von: Liu, Haofeng, et al.
Veröffentlicht: (2025)