Multi-Modal Self-Supervised Learning for Surgical Feedback Effectiveness Assessment
Fuente:
arXiv
Guardado en:
| Autores principales: | Gupta, Arushi, Kocielnik, Rafal, Wang, Jiayun, Nasriddinov, Firdavs, Yang, Cherine, Wong, Elyssa, Anandkumar, Anima, Hung, Andrew |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Generating Natural-Language Surgical Feedback: From Structured Representation to Domain-Grounded Evaluation
por: Nasriddinov, Firdavs, et al.
Publicado: (2025)
por: Nasriddinov, Firdavs, et al.
Publicado: (2025)
Automating Feedback Analysis in Surgical Training: Detection, Categorization, and Assessment
por: Nasriddinov, Firdavs, et al.
Publicado: (2024)
por: Nasriddinov, Firdavs, et al.
Publicado: (2024)
Advancing Brain Tumor Segmentation via Attention-based 3D U-Net Architecture and Digital Image Processing
por: Gad, Eyad, et al.
Publicado: (2025)
por: Gad, Eyad, et al.
Publicado: (2025)
Personalised aesthetics with residual adapters
por: Rodríguez-Pardo, Carlos, et al.
Publicado: (2019)
por: Rodríguez-Pardo, Carlos, et al.
Publicado: (2019)
AQFusionNet: Multimodal Deep Learning for Air Quality Index Prediction with Imagery and Sensor Data
por: Kushal, Koushik Ahmed, et al.
Publicado: (2025)
por: Kushal, Koushik Ahmed, et al.
Publicado: (2025)
TRACES: Temporal Recall with Contextual Embeddings for Real-Time Video Anomaly Detection
por: Siddiqui, Yousuf Ahmed, et al.
Publicado: (2025)
por: Siddiqui, Yousuf Ahmed, et al.
Publicado: (2025)
AIDOVECL: AI-generated Dataset of Outpainted Vehicles for Eye-level Classification and Localization
por: Kazemi, Amir, et al.
Publicado: (2024)
por: Kazemi, Amir, et al.
Publicado: (2024)
AVATAAR: Agentic Video Answering via Temporal Adaptive Alignment and Reasoning
por: Patel, Urjitkumar, et al.
Publicado: (2025)
por: Patel, Urjitkumar, et al.
Publicado: (2025)
GIQ: Benchmarking 3D Geometric Reasoning of Vision Foundation Models with Simulated and Real Polyhedra
por: Michalkiewicz, Mateusz, et al.
Publicado: (2025)
por: Michalkiewicz, Mateusz, et al.
Publicado: (2025)
TerraSeg: Self-Supervised Ground Segmentation for Any LiDAR
por: Lentsch, Ted, et al.
Publicado: (2026)
por: Lentsch, Ted, et al.
Publicado: (2026)
Heart Failure Prediction using Modal Decomposition and Masked Autoencoders for Scarce Echocardiography Databases
por: Bell-Navas, Andrés, et al.
Publicado: (2025)
por: Bell-Navas, Andrés, et al.
Publicado: (2025)
Smelly, dense, and spreaded: The Object Detection for Olfactory References (ODOR) dataset
por: Zinnen, Mathias, et al.
Publicado: (2025)
por: Zinnen, Mathias, et al.
Publicado: (2025)
Learning Association via Track-Detection Matching for Multi-Object Tracking
por: Adžemović, Momir
Publicado: (2025)
por: Adžemović, Momir
Publicado: (2025)
TowerVision: Understanding and Improving Multilinguality in Vision-Language Models
por: Viveiros, André G., et al.
Publicado: (2025)
por: Viveiros, André G., et al.
Publicado: (2025)
YOLO Ensemble for UAV-based Multispectral Defect Detection in Wind Turbine Components
por: Svystun, Serhii, et al.
Publicado: (2025)
por: Svystun, Serhii, et al.
Publicado: (2025)
UNION: Unsupervised 3D Object Detection using Object Appearance-based Pseudo-Classes
por: Lentsch, Ted, et al.
Publicado: (2024)
por: Lentsch, Ted, et al.
Publicado: (2024)
ARTPS: Depth-Enhanced Hybrid Anomaly Detection and Learnable Curiosity Score for Autonomous Rover Target Prioritization
por: Baydemir, Poyraz
Publicado: (2025)
por: Baydemir, Poyraz
Publicado: (2025)
Fast 3D point clouds retrieval for Large-scale 3D Place Recognition
por: Zede, Chahine-Nicolas, et al.
Publicado: (2025)
por: Zede, Chahine-Nicolas, et al.
Publicado: (2025)
An M-Health Algorithmic Approach to Identify and Assess Physiotherapy Exercises in Real Time
por: Kandylakis, Stylianos, et al.
Publicado: (2025)
por: Kandylakis, Stylianos, et al.
Publicado: (2025)
ROI-GS: Interest-based Local Quality 3D Gaussian Splatting
por: Bui, Quoc-Anh, et al.
Publicado: (2025)
por: Bui, Quoc-Anh, et al.
Publicado: (2025)
ROI-NeRFs: Hi-Fi Visualization of Objects of Interest within a Scene by NeRFs Composition
por: Bui, Quoc-Anh, et al.
Publicado: (2025)
por: Bui, Quoc-Anh, et al.
Publicado: (2025)
CaLoRAify: Calorie Estimation with Visual-Text Pairing and LoRA-Driven Visual Language Models
por: Yao, Dongyu, et al.
Publicado: (2024)
por: Yao, Dongyu, et al.
Publicado: (2024)
Graph-PiT: Enhancing Structural Coherence in Part-Based Image Synthesis via Graph Priors
por: Zhang, Junbin, et al.
Publicado: (2026)
por: Zhang, Junbin, et al.
Publicado: (2026)
A Novel Approach to Breast Cancer Segmentation using U-Net Model with Attention Mechanisms and FedProx
por: Gad, Eyad, et al.
Publicado: (2025)
por: Gad, Eyad, et al.
Publicado: (2025)
Fairness Without Labels: Pseudo-Balancing for Bias Mitigation in Face Gender Classification
por: Dong, Haohua, et al.
Publicado: (2025)
por: Dong, Haohua, et al.
Publicado: (2025)
Parameter-efficient fine-tuning (PEFT) of Vision Foundation Models for Atypical Mitotic Figure Classification
por: Ramchandani, Lavish, et al.
Publicado: (2025)
por: Ramchandani, Lavish, et al.
Publicado: (2025)
TexTile: A Differentiable Metric for Texture Tileability
por: Rodriguez-Pardo, Carlos, et al.
Publicado: (2024)
por: Rodriguez-Pardo, Carlos, et al.
Publicado: (2024)
BG-YOLO: A Bidirectional-Guided Method for Underwater Object Detection
por: Zhang, Jian, et al.
Publicado: (2024)
por: Zhang, Jian, et al.
Publicado: (2024)
Polarization-Based Eye Tracking with Personalized Siamese Architectures
por: Kalkanli, Beyza, et al.
Publicado: (2026)
por: Kalkanli, Beyza, et al.
Publicado: (2026)
Sat-JEPA-Diff: Bridging Self-Supervised Learning and Generative Diffusion for Remote Sensing
por: Komurcu, Kursat, et al.
Publicado: (2026)
por: Komurcu, Kursat, et al.
Publicado: (2026)
Transforming faces into video stories -- VideoFace2.0
por: Brkljač, Branko, et al.
Publicado: (2025)
por: Brkljač, Branko, et al.
Publicado: (2025)
HieraEdgeNet: A Multi-Scale Edge-Enhanced Framework for Automated Pollen Recognition
por: Long, Yuchong, et al.
Publicado: (2025)
por: Long, Yuchong, et al.
Publicado: (2025)
Corn Ear Detection and Orientation Estimation Using Deep Learning
por: Sprague, Nathan, et al.
Publicado: (2024)
por: Sprague, Nathan, et al.
Publicado: (2024)
Gr-IoU: Ground-Intersection over Union for Robust Multi-Object Tracking with 3D Geometric Constraints
por: Toida, Keisuke, et al.
Publicado: (2024)
por: Toida, Keisuke, et al.
Publicado: (2024)
Non-Robust Features are Not Always Useful in One-Class Classification
por: Lau, Matthew, et al.
Publicado: (2024)
por: Lau, Matthew, et al.
Publicado: (2024)
Task-Aligned Self-Supervised Learning for Medical Image Analysis: A Systematic Review and Practical Design Guidelines
por: Wimalasiri, Chathura
Publicado: (2026)
por: Wimalasiri, Chathura
Publicado: (2026)
Differentiable Hierarchical Visual Tokenization
por: Aasan, Marius, et al.
Publicado: (2025)
por: Aasan, Marius, et al.
Publicado: (2025)
A Hybrid Multimodal Deep Learning Framework for Intelligent Fashion Recommendation
por: Kalashi, Kamand, et al.
Publicado: (2025)
por: Kalashi, Kamand, et al.
Publicado: (2025)
Skullptor: High Fidelity 3D Head Reconstruction in Seconds with Multi-View Normal Prediction
por: Artru, Noé, et al.
Publicado: (2026)
por: Artru, Noé, et al.
Publicado: (2026)
A Landmark-Aware Visual Navigation Dataset
por: Johnson, Faith, et al.
Publicado: (2024)
por: Johnson, Faith, et al.
Publicado: (2024)
Ejemplares similares
-
Generating Natural-Language Surgical Feedback: From Structured Representation to Domain-Grounded Evaluation
por: Nasriddinov, Firdavs, et al.
Publicado: (2025) -
Automating Feedback Analysis in Surgical Training: Detection, Categorization, and Assessment
por: Nasriddinov, Firdavs, et al.
Publicado: (2024) -
Advancing Brain Tumor Segmentation via Attention-based 3D U-Net Architecture and Digital Image Processing
por: Gad, Eyad, et al.
Publicado: (2025) -
Personalised aesthetics with residual adapters
por: Rodríguez-Pardo, Carlos, et al.
Publicado: (2019) -
AQFusionNet: Multimodal Deep Learning for Air Quality Index Prediction with Imagery and Sensor Data
por: Kushal, Koushik Ahmed, et al.
Publicado: (2025)