PitVQA++: Vector Matrix-Low-Rank Adaptation for Open-Ended Visual Question Answering in Pituitary Surgery
Fuente:
arXiv
Salvato in:
| Autori principali: | He, Runlong, Khan, Danyal Z., Mazomenos, Evangelos B., Marcus, Hani J., Stoyanov, Danail, Clarkson, Matthew J., Islam, Mobarakol |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PitVQA: Image-grounded Text Embedding LLM for Visual Question Answering in Pituitary Surgery
di: He, Runlong, et al.
Pubblicazione: (2024)
di: He, Runlong, et al.
Pubblicazione: (2024)
Surgical AI Copilot: Energy-Based Fourier Gradient Low-Rank Adaptation for Surgical LLM Agent Reasoning and Planning
di: Huang, Jiayuan, et al.
Pubblicazione: (2025)
di: Huang, Jiayuan, et al.
Pubblicazione: (2025)
PitRSDNet: Predicting Intra-operative Remaining Surgery Duration in Endoscopic Pituitary Surgery
di: Wijekoon, Anjana, et al.
Pubblicazione: (2024)
di: Wijekoon, Anjana, et al.
Pubblicazione: (2024)
SurgAnt-ViVQA: Learning to Anticipate Surgical Events through GRU-Driven Temporal Cross-Attention
di: Dhake, Shreyas C., et al.
Pubblicazione: (2025)
di: Dhake, Shreyas C., et al.
Pubblicazione: (2025)
Automated Surgical Skill Assessment in Endoscopic Pituitary Surgery using Real-time Instrument Tracking on a High-fidelity Bench-top Phantom
di: Das, Adrito, et al.
Pubblicazione: (2024)
di: Das, Adrito, et al.
Pubblicazione: (2024)
Diff2DGS: Reliable Reconstruction of Occluded Surgical Scenes via 2D Gaussian Splatting
di: Song, Tianyi, et al.
Pubblicazione: (2026)
di: Song, Tianyi, et al.
Pubblicazione: (2026)
PitVis-2023 Challenge: Workflow Recognition in videos of Endoscopic Pituitary Surgery
di: Das, Adrito, et al.
Pubblicazione: (2024)
di: Das, Adrito, et al.
Pubblicazione: (2024)
Endo-FASt3r: Endoscopic Foundation model Adaptation for Structure from motion
di: Zeinoddin, Mona Sheikh, et al.
Pubblicazione: (2025)
di: Zeinoddin, Mona Sheikh, et al.
Pubblicazione: (2025)
DARES: Depth Anything in Robotic Endoscopic Surgery with Self-supervised Vector-LoRA of the Foundation Model
di: Zeinoddin, Mona Sheikh, et al.
Pubblicazione: (2024)
di: Zeinoddin, Mona Sheikh, et al.
Pubblicazione: (2024)
Personalizing Federated Instrument Segmentation with Visual Trait Priors in Robotic Surgery
di: Xu, Jialang, et al.
Pubblicazione: (2024)
di: Xu, Jialang, et al.
Pubblicazione: (2024)
SEDMamba: Enhancing Selective State Space Modelling with Bottleneck Mechanism and Fine-to-Coarse Temporal Fusion for Efficient Error Detection in Robot-Assisted Surgery
di: Xu, Jialang, et al.
Pubblicazione: (2024)
di: Xu, Jialang, et al.
Pubblicazione: (2024)
Depth Augmented and FE Free 3D/2D Liver Registration for Laparoscopic Liver AR
di: Zhang, Hanyuan, et al.
Pubblicazione: (2026)
di: Zhang, Hanyuan, et al.
Pubblicazione: (2026)
CoRe-DA: Contrastive Regression for Unsupervised Domain Adaptation in Surgical Skill Assessment
di: Anastasiou, Dimitrios, et al.
Pubblicazione: (2026)
di: Anastasiou, Dimitrios, et al.
Pubblicazione: (2026)
EndoLRMGS: Complete Endoscopic Scene Reconstruction combining Large Reconstruction Modelling and Gaussian Splatting
di: Wang, Xu, et al.
Pubblicazione: (2025)
di: Wang, Xu, et al.
Pubblicazione: (2025)
Think Step by Step: Chain-of-Gesture Prompting for Error Detection in Robotic Surgical Videos
di: Shao, Zhimin, et al.
Pubblicazione: (2024)
di: Shao, Zhimin, et al.
Pubblicazione: (2024)
Surgical-DeSAM: Decoupling SAM for Instrument Segmentation in Robotic Surgery
di: Sheng, Yuyang, et al.
Pubblicazione: (2024)
di: Sheng, Yuyang, et al.
Pubblicazione: (2024)
Warm-Started Reinforcement Learning for Iterative 3D/2D Liver Registration
di: Zhang, Hanyuan, et al.
Pubblicazione: (2026)
di: Zhang, Hanyuan, et al.
Pubblicazione: (2026)
StereoMamba: Real-time and Robust Intraoperative Stereo Disparity Estimation via Long-range Spatial Dependencies
di: Wang, Xu, et al.
Pubblicazione: (2025)
di: Wang, Xu, et al.
Pubblicazione: (2025)
3D Acetabular Surface Reconstruction from 2D Pre-operative X-ray Images using SRVF Elastic Registration and Deformation Graph
di: Zhang, Shuai, et al.
Pubblicazione: (2025)
di: Zhang, Shuai, et al.
Pubblicazione: (2025)
Temporal Cluster Assignment for Efficient Real-Time Video Segmentation
di: Yung, Ka-Wai, et al.
Pubblicazione: (2025)
di: Yung, Ka-Wai, et al.
Pubblicazione: (2025)
SurgViVQA: Temporally-Grounded Video Question Answering for Surgical Scene Understanding
di: Drago, Mauro Orazio, et al.
Pubblicazione: (2025)
di: Drago, Mauro Orazio, et al.
Pubblicazione: (2025)
Artificial intelligence in histopathological image analysis of central nervous system tumours: A systematic review
di: Melanie P. Jensen, et al.
Pubblicazione: (2024)
di: Melanie P. Jensen, et al.
Pubblicazione: (2024)
Surgical-VQLA++: Adversarial Contrastive Learning for Calibrated Robust Visual Question-Localized Answering in Robotic Surgery
di: Bai, Long, et al.
Pubblicazione: (2024)
di: Bai, Long, et al.
Pubblicazione: (2024)
Learning from Single Timestamps: Complexity Estimation in Laparoscopic Cholecystectomy
di: Anastasiou, Dimitrios, et al.
Pubblicazione: (2025)
di: Anastasiou, Dimitrios, et al.
Pubblicazione: (2025)
SurgicalGS: Dynamic 3D Gaussian Splatting for Accurate Robotic-Assisted Surgical Scene Reconstruction
di: Chen, Jialei, et al.
Pubblicazione: (2024)
di: Chen, Jialei, et al.
Pubblicazione: (2024)
Illumination Histogram Consistency Metric for Quantitative Assessment of Video Sequences
di: Chen, Long, et al.
Pubblicazione: (2024)
di: Chen, Long, et al.
Pubblicazione: (2024)
Ranking Distillation for Open-Ended Video Question Answering with Insufficient Labels
di: Liang, Tianming, et al.
Pubblicazione: (2024)
di: Liang, Tianming, et al.
Pubblicazione: (2024)
LLM-Assisted Multi-Teacher Continual Learning for Visual Question Answering in Robotic Surgery
di: Du, Yuyang, et al.
Pubblicazione: (2024)
di: Du, Yuyang, et al.
Pubblicazione: (2024)
RRT-GPMP2: A Motion Planner for Mobile Robots in Complex Maze Environments
di: Meng, Jiawei, et al.
Pubblicazione: (2024)
di: Meng, Jiawei, et al.
Pubblicazione: (2024)
TemporalDoRA: Temporal PEFT for Robust Surgical Video Question Answering
di: Carlini, Luca, et al.
Pubblicazione: (2026)
di: Carlini, Luca, et al.
Pubblicazione: (2026)
When to Trust the Answer: Question-Aligned Semantic Nearest Neighbor Entropy for Safer Surgical VQA
di: Carlini, Luca, et al.
Pubblicazione: (2025)
di: Carlini, Luca, et al.
Pubblicazione: (2025)
CARES: Collaborative Agentic Reasoning for Error Detection in Surgery
di: Low, Chang Han, et al.
Pubblicazione: (2025)
di: Low, Chang Han, et al.
Pubblicazione: (2025)
Surgical-LVLM: Learning to Adapt Large Vision-Language Model for Grounded Visual Question Answering in Robotic Surgery
di: Wang, Guankun, et al.
Pubblicazione: (2024)
di: Wang, Guankun, et al.
Pubblicazione: (2024)
HUP-3D: A 3D multi-view synthetic dataset for assisted-egocentric hand-ultrasound pose estimation
di: Birlo, Manuel, et al.
Pubblicazione: (2024)
di: Birlo, Manuel, et al.
Pubblicazione: (2024)
BERT-VQA: Visual Question Answering on Plots
di: Vu, Tai, et al.
Pubblicazione: (2025)
di: Vu, Tai, et al.
Pubblicazione: (2025)
Privacy-Preserving Synthetic Continual Semantic Segmentation for Robotic Surgery
di: Xu, Mengya, et al.
Pubblicazione: (2024)
di: Xu, Mengya, et al.
Pubblicazione: (2024)
SurgFusion-Net: Diversified Adaptive Multimodal Fusion Network for Surgical Skill Assessment
di: He, Runlong, et al.
Pubblicazione: (2026)
di: He, Runlong, et al.
Pubblicazione: (2026)
Mapping Pituitary Neuroendocrine Tumors: An Annotated MRI Dataset Profiling Tumor and Carotid Characteristics
di: Anand S. Pandit, et al.
Pubblicazione: (2025)
di: Anand S. Pandit, et al.
Pubblicazione: (2025)
DermaVQA-DAS: Dermatology Assessment Schema (DAS) & Datasets for Closed-Ended Question Answering & Segmentation in Patient-Generated Dermatology Images
di: Yim, Wen-wai, et al.
Pubblicazione: (2025)
di: Yim, Wen-wai, et al.
Pubblicazione: (2025)
Surgical-DINO: Adapter Learning of Foundation Models for Depth Estimation in Endoscopic Surgery
di: Cui, Beilei, et al.
Pubblicazione: (2024)
di: Cui, Beilei, et al.
Pubblicazione: (2024)
Documenti analoghi
-
PitVQA: Image-grounded Text Embedding LLM for Visual Question Answering in Pituitary Surgery
di: He, Runlong, et al.
Pubblicazione: (2024) -
Surgical AI Copilot: Energy-Based Fourier Gradient Low-Rank Adaptation for Surgical LLM Agent Reasoning and Planning
di: Huang, Jiayuan, et al.
Pubblicazione: (2025) -
PitRSDNet: Predicting Intra-operative Remaining Surgery Duration in Endoscopic Pituitary Surgery
di: Wijekoon, Anjana, et al.
Pubblicazione: (2024) -
SurgAnt-ViVQA: Learning to Anticipate Surgical Events through GRU-Driven Temporal Cross-Attention
di: Dhake, Shreyas C., et al.
Pubblicazione: (2025) -
Automated Surgical Skill Assessment in Endoscopic Pituitary Surgery using Real-time Instrument Tracking on a High-fidelity Bench-top Phantom
di: Das, Adrito, et al.
Pubblicazione: (2024)