From Scope to Script: An Automated Report Generation Model for Gastrointestinal Endoscopy
Fuente:
arXiv
Salvato in:
| Autori principali: | Kaklamanos, Evandros, Kristinsdottir, Kristjana, Huang, Jonathan, Carlson, Dustin, Keswani, Rajesh, Pandolfino, John, Etemadi, Mozziyar |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Endoscopic Prediction of Achalasia: Putting the CART Before the CARS
di: Meng Li, et al.
Pubblicazione: (2025)
di: Meng Li, et al.
Pubblicazione: (2025)
Analogical Reasoning as a Doctor: A Foundation Model for Gastrointestinal Endoscopy Diagnosis
di: Peng, Peixi, et al.
Pubblicazione: (2026)
di: Peng, Peixi, et al.
Pubblicazione: (2026)
Parameter-Efficient VLMs for Gastrointestinal Endoscopy: Medical Image Generation and Clinical Visual Question Answering
di: Peter, Ojonugwa Oluwafemi Ejiga, et al.
Pubblicazione: (2026)
di: Peter, Ojonugwa Oluwafemi Ejiga, et al.
Pubblicazione: (2026)
A Study on Self-Supervised Pretraining for Vision Problems in Gastrointestinal Endoscopy
di: Sanderson, Edward, et al.
Pubblicazione: (2024)
di: Sanderson, Edward, et al.
Pubblicazione: (2024)
Domain-Adaptive Pre-training of Self-Supervised Foundation Models for Medical Image Classification in Gastrointestinal Endoscopy
di: Roth, Marcel, et al.
Pubblicazione: (2024)
di: Roth, Marcel, et al.
Pubblicazione: (2024)
Endora: Video Generation Models as Endoscopy Simulators
di: Li, Chenxin, et al.
Pubblicazione: (2024)
di: Li, Chenxin, et al.
Pubblicazione: (2024)
Pairing-free Group-level Knowledge Distillation for Robust Gastrointestinal Lesion Classification in White-Light Endoscopy
di: Hu, Qiang, et al.
Pubblicazione: (2026)
di: Hu, Qiang, et al.
Pubblicazione: (2026)
Artificial Intelligence in Gastrointestinal Bleeding Analysis for Video Capsule Endoscopy: Insights, Innovations, and Prospects (2008-2023)
di: Singh, Tanisha, et al.
Pubblicazione: (2024)
di: Singh, Tanisha, et al.
Pubblicazione: (2024)
MetaScope: Optics-Driven Neural Network for Ultra-Micro Metalens Endoscopy
di: Li, Wuyang, et al.
Pubblicazione: (2025)
di: Li, Wuyang, et al.
Pubblicazione: (2025)
Capsule Vision Challenge 2024: Multi-Class Abnormality Classification for Video Capsule Endoscopy
di: Bansal, Aakarsh, et al.
Pubblicazione: (2024)
di: Bansal, Aakarsh, et al.
Pubblicazione: (2024)
GI-Bench: A Panoramic Benchmark Revealing the Knowledge-Experience Dissociation of Multimodal Large Language Models in Gastrointestinal Endoscopy Against Clinical Standards
di: Zhu, Yan, et al.
Pubblicazione: (2026)
di: Zhu, Yan, et al.
Pubblicazione: (2026)
Exploring Self-Supervised Learning with U-Net Masked Autoencoders and EfficientNet-B7 for Improved Gastrointestinal Abnormality Classification in Video Capsule Endoscopy
di: Kancharla, Vamshi Krishna, et al.
Pubblicazione: (2024)
di: Kancharla, Vamshi Krishna, et al.
Pubblicazione: (2024)
Transformer-Enhanced Iterative Feedback Mechanism for Polyp Segmentation
di: Tomar, Nikhil Kumar, et al.
Pubblicazione: (2024)
di: Tomar, Nikhil Kumar, et al.
Pubblicazione: (2024)
OmniScript: Towards Audio-Visual Script Generation for Long-Form Cinematic Video
di: Pu, Junfu, et al.
Pubblicazione: (2026)
di: Pu, Junfu, et al.
Pubblicazione: (2026)
Automated Bleeding Detection and Classification in Wireless Capsule Endoscopy with YOLOv8-X
di: Shekar, Pavan C, et al.
Pubblicazione: (2024)
di: Shekar, Pavan C, et al.
Pubblicazione: (2024)
Diff-Oracle: Deciphering Oracle Bone Scripts with Controllable Diffusion Model
di: Li, Jing, et al.
Pubblicazione: (2023)
di: Li, Jing, et al.
Pubblicazione: (2023)
A Highlight Removal Method for Capsule Endoscopy Images
di: Zhang, Shaojie, et al.
Pubblicazione: (2024)
di: Zhang, Shaojie, et al.
Pubblicazione: (2024)
Capsule Endoscopy Image Enhancement for Small Intestinal Villi Clarity
di: Zhang, Shaojie, et al.
Pubblicazione: (2024)
di: Zhang, Shaojie, et al.
Pubblicazione: (2024)
Multimedia Generative Script Learning for Task Planning
di: Wang, Qingyun, et al.
Pubblicazione: (2022)
di: Wang, Qingyun, et al.
Pubblicazione: (2022)
Script-to-Slide Grounding: Grounding Script Sentences to Slide Objects for Automatic Instructional Video Generation
di: Suzuki, Rena, et al.
Pubblicazione: (2026)
di: Suzuki, Rena, et al.
Pubblicazione: (2026)
Learning to Adapt Foundation Model DINOv2 for Capsule Endoscopy Diagnosis
di: Zhang, Bowen, et al.
Pubblicazione: (2024)
di: Zhang, Bowen, et al.
Pubblicazione: (2024)
Vision-Language Models for Automated 3D PET/CT Report Generation
di: Jiao, Wenpei, et al.
Pubblicazione: (2025)
di: Jiao, Wenpei, et al.
Pubblicazione: (2025)
GPT4Motion: Scripting Physical Motions in Text-to-Video Generation via Blender-Oriented GPT Planning
di: Lv, Jiaxi, et al.
Pubblicazione: (2023)
di: Lv, Jiaxi, et al.
Pubblicazione: (2023)
FakeScope: Large Multimodal Expert Model for Transparent AI-Generated Image Forensics
di: Li, Yixuan, et al.
Pubblicazione: (2025)
di: Li, Yixuan, et al.
Pubblicazione: (2025)
DeepGI: An Automated Approach for Gastrointestinal Tract Segmentation in MRI Scans
di: Zhang, Ye, et al.
Pubblicazione: (2024)
di: Zhang, Ye, et al.
Pubblicazione: (2024)
SceneScript: Reconstructing Scenes With An Autoregressive Structured Language Model
di: Avetisyan, Armen, et al.
Pubblicazione: (2024)
di: Avetisyan, Armen, et al.
Pubblicazione: (2024)
MDIW-13: a New Multi-Lingual and Multi-Script Database and Benchmark for Script Identification
di: Ferrer, Miguel A., et al.
Pubblicazione: (2024)
di: Ferrer, Miguel A., et al.
Pubblicazione: (2024)
ScriptHOI: Learning Scripted State Transitions for Open-Vocabulary Human-Object Interaction Detection
di: Nguyen, Minh Anh, et al.
Pubblicazione: (2026)
di: Nguyen, Minh Anh, et al.
Pubblicazione: (2026)
Foundational Models for Pathology and Endoscopy Images: Application for Gastric Inflammation
di: Kerdegari, Hamideh, et al.
Pubblicazione: (2024)
di: Kerdegari, Hamideh, et al.
Pubblicazione: (2024)
EndoDINO: A Foundation Model for GI Endoscopy
di: Dermyer, Patrick, et al.
Pubblicazione: (2025)
di: Dermyer, Patrick, et al.
Pubblicazione: (2025)
Ancient Script Image Recognition and Processing: A Review
di: Diao, Xiaolei, et al.
Pubblicazione: (2025)
di: Diao, Xiaolei, et al.
Pubblicazione: (2025)
Prediction of Rectal Cancer Regrowth from Longitudinal Endoscopy
di: Gomez, Jorge Tapias, et al.
Pubblicazione: (2026)
di: Gomez, Jorge Tapias, et al.
Pubblicazione: (2026)
CAVE-Net: Classifying Abnormalities in Video Capsule Endoscopy
di: Harish, Ishita, et al.
Pubblicazione: (2024)
di: Harish, Ishita, et al.
Pubblicazione: (2024)
ACM Multimedia Grand Challenge on ENT Endoscopy Analysis
di: Nguyen, Trong-Thuan, et al.
Pubblicazione: (2025)
di: Nguyen, Trong-Thuan, et al.
Pubblicazione: (2025)
CrossPan: A Comprehensive Benchmark for Cross-Sequence Pancreas MRI Segmentation and Generalization
di: Peng, Linkai, et al.
Pubblicazione: (2026)
di: Peng, Linkai, et al.
Pubblicazione: (2026)
MeshBrush: Painting the Anatomical Mesh with Neural Stylization for Endoscopy
di: Han, John J., et al.
Pubblicazione: (2024)
di: Han, John J., et al.
Pubblicazione: (2024)
Historic Scripts to Modern Vision: A Novel Dataset and A VLM Framework for Transliteration of Modi Script to Devanagari
di: Kausadikar, Harshal, et al.
Pubblicazione: (2025)
di: Kausadikar, Harshal, et al.
Pubblicazione: (2025)
Advancing Depth Anything Model for Unsupervised Monocular Depth Estimation in Endoscopy
di: Li, Bojian, et al.
Pubblicazione: (2024)
di: Li, Bojian, et al.
Pubblicazione: (2024)
Foundation Model for Endoscopy Video Analysis via Large-scale Self-supervised Pre-train
di: Wang, Zhao, et al.
Pubblicazione: (2023)
di: Wang, Zhao, et al.
Pubblicazione: (2023)
EndoBench: A Comprehensive Evaluation of Multi-Modal Large Language Models for Endoscopy Analysis
di: Liu, Shengyuan, et al.
Pubblicazione: (2025)
di: Liu, Shengyuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Endoscopic Prediction of Achalasia: Putting the CART Before the CARS
di: Meng Li, et al.
Pubblicazione: (2025) -
Analogical Reasoning as a Doctor: A Foundation Model for Gastrointestinal Endoscopy Diagnosis
di: Peng, Peixi, et al.
Pubblicazione: (2026) -
Parameter-Efficient VLMs for Gastrointestinal Endoscopy: Medical Image Generation and Clinical Visual Question Answering
di: Peter, Ojonugwa Oluwafemi Ejiga, et al.
Pubblicazione: (2026) -
A Study on Self-Supervised Pretraining for Vision Problems in Gastrointestinal Endoscopy
di: Sanderson, Edward, et al.
Pubblicazione: (2024) -
Domain-Adaptive Pre-training of Self-Supervised Foundation Models for Medical Image Classification in Gastrointestinal Endoscopy
di: Roth, Marcel, et al.
Pubblicazione: (2024)