LLM-Driven Medical Document Analysis: Enhancing Trustworthy Pathology and Differential Diagnosis
Fuente:
arXiv
Salvato in:
| Autori principali: | Kang, Lei, Fu, Xuanshuo, Terrades, Oriol Ramos, Vazquez-Corral, Javier, Valveny, Ernest, Karatzas, Dimosthenis |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
xLSTM-ECG: Multi-label ECG Classification via Feature Fusion with xLSTM
di: Kang, Lei, et al.
Pubblicazione: (2025)
di: Kang, Lei, et al.
Pubblicazione: (2025)
Reading in the Dark: Low-light Scene Text Recognition
di: Fu, Xuanshuo, et al.
Pubblicazione: (2026)
di: Fu, Xuanshuo, et al.
Pubblicazione: (2026)
Preserving Privacy Without Compromising Accuracy: Machine Unlearning for Handwritten Text Recognition
di: Kang, Lei, et al.
Pubblicazione: (2025)
di: Kang, Lei, et al.
Pubblicazione: (2025)
Multi-Page Document Visual Question Answering using Self-Attention Scoring Mechanism
di: Kang, Lei, et al.
Pubblicazione: (2024)
di: Kang, Lei, et al.
Pubblicazione: (2024)
Machine Unlearning for Document Classification
di: Kang, Lei, et al.
Pubblicazione: (2024)
di: Kang, Lei, et al.
Pubblicazione: (2024)
A Benchmark for Symbolic Reasoning from Pixel Sequences: Grid-Level Visual Completion and Correction
di: Kang, Lei, et al.
Pubblicazione: (2025)
di: Kang, Lei, et al.
Pubblicazione: (2025)
Learning Quantifiable Visual Explanations Without Ground-Truth
di: Singh, Amritpal, et al.
Pubblicazione: (2026)
di: Singh, Amritpal, et al.
Pubblicazione: (2026)
Image-text matching for large-scale book collections
di: Llabrés, Artemis, et al.
Pubblicazione: (2024)
di: Llabrés, Artemis, et al.
Pubblicazione: (2024)
Retrieval Augmented Verification for Zero-Shot Detection of Multimodal Disinformation
di: Dey, Arka Ujjal, et al.
Pubblicazione: (2024)
di: Dey, Arka Ujjal, et al.
Pubblicazione: (2024)
GRIF-DM: Generation of Rich Impression Fonts using Diffusion Models
di: Kang, Lei, et al.
Pubblicazione: (2024)
di: Kang, Lei, et al.
Pubblicazione: (2024)
Diffusion-Based Low-Light Image Enhancement with Color and Luminance Priors
di: Fu, Xuanshuo, et al.
Pubblicazione: (2026)
di: Fu, Xuanshuo, et al.
Pubblicazione: (2026)
SIMI: Self-information Mining Network for Low-light Image Enhancement
di: Fu, Xuanshuo, et al.
Pubblicazione: (2026)
di: Fu, Xuanshuo, et al.
Pubblicazione: (2026)
Federated Document Visual Question Answering: A Pilot Study
di: Nguyen, Khanh, et al.
Pubblicazione: (2024)
di: Nguyen, Khanh, et al.
Pubblicazione: (2024)
Multimodal Transformer for Comics Text-Cloze
di: Vivoli, Emanuele, et al.
Pubblicazione: (2024)
di: Vivoli, Emanuele, et al.
Pubblicazione: (2024)
LayeredDoc: Domain Adaptive Document Restoration with a Layer Separation Approach
di: Pilligua, Maria, et al.
Pubblicazione: (2024)
di: Pilligua, Maria, et al.
Pubblicazione: (2024)
DocVXQA: Context-Aware Visual Explanations for Document Question Answering
di: Souibgui, Mohamed Ali, et al.
Pubblicazione: (2025)
di: Souibgui, Mohamed Ali, et al.
Pubblicazione: (2025)
ODE-ViT: Plug & Play Attention Layer from the Generalization of the ViT as an Ordinary Differential Equation
di: Riera, Carlos Boned, et al.
Pubblicazione: (2025)
di: Riera, Carlos Boned, et al.
Pubblicazione: (2025)
Visual Model Checking: Graph-Based Inference of Visual Routines for Image Retrieval
di: Molina, Adrià, et al.
Pubblicazione: (2026)
di: Molina, Adrià, et al.
Pubblicazione: (2026)
The Role of Generative Systems in Historical Photography Management: A Case Study on Catalan Archives
di: Śanchez, Èric, et al.
Pubblicazione: (2024)
di: Śanchez, Èric, et al.
Pubblicazione: (2024)
Privacy-Aware Document Visual Question Answering
di: Tito, Rubèn, et al.
Pubblicazione: (2023)
di: Tito, Rubèn, et al.
Pubblicazione: (2023)
Bit-depth color recovery via off-the-shelf super-resolution models
di: Fu, Xuanshuo, et al.
Pubblicazione: (2025)
di: Fu, Xuanshuo, et al.
Pubblicazione: (2025)
ComicsPAP: understanding comic strips by picking the correct panel
di: Vivoli, Emanuele, et al.
Pubblicazione: (2025)
di: Vivoli, Emanuele, et al.
Pubblicazione: (2025)
Spatially Grounded Explanations in Vision Language Models for Document Visual Question Answering
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
TRIMMER: A New Paradigm for Video Summarization through Self-Supervised Reinforcement Learning
di: Mishra, Pritam, et al.
Pubblicazione: (2026)
di: Mishra, Pritam, et al.
Pubblicazione: (2026)
Fetch-A-Set: A Large-Scale OCR-Free Benchmark for Historical Document Retrieval
di: Molina, Adrià, et al.
Pubblicazione: (2024)
di: Molina, Adrià, et al.
Pubblicazione: (2024)
AVIR: Adaptive Visual In-Document Retrieval for Efficient Multi-Page Document Question Answering
di: Li, Zongmin, et al.
Pubblicazione: (2026)
di: Li, Zongmin, et al.
Pubblicazione: (2026)
Enhancing Document VQA Models via Retrieval-Augmented Generation
di: López, Eric, et al.
Pubblicazione: (2025)
di: López, Eric, et al.
Pubblicazione: (2025)
A Fast Hierarchical Method for Multi-script and Arbitrary Oriented Scene Text Extraction
di: Gomez, Lluis, et al.
Pubblicazione: (2014)
di: Gomez, Lluis, et al.
Pubblicazione: (2014)
The OCR Quest for Generalization: Learning to recognize low-resource alphabets with model editing
di: Rodríguez, Adrià Molina, et al.
Pubblicazione: (2025)
di: Rodríguez, Adrià Molina, et al.
Pubblicazione: (2025)
Persistent and Conversational Multi-Method Explainability for Trustworthy Financial AI
di: Makridis, Georgios, et al.
Pubblicazione: (2026)
di: Makridis, Georgios, et al.
Pubblicazione: (2026)
DocMIA: Document-Level Membership Inference Attacks against DocVQA Models
di: Nguyen, Khanh, et al.
Pubblicazione: (2025)
di: Nguyen, Khanh, et al.
Pubblicazione: (2025)
Counterfeit Answers: Adversarial Forgery against OCR-Free Document Visual Question Answering
di: Pintore, Marco, et al.
Pubblicazione: (2025)
di: Pintore, Marco, et al.
Pubblicazione: (2025)
From Subtle to Significant: Prompt-Driven Self-Improving Optimization in Test-Time Graph OOD Detection
di: Wang, Luzhi, et al.
Pubblicazione: (2026)
di: Wang, Luzhi, et al.
Pubblicazione: (2026)
Pathology-Aware Prototype Evolution via LLM-Driven Semantic Disambiguation for Multicenter Diabetic Retinopathy Diagnosis
di: Zhu, Chunzheng, et al.
Pubblicazione: (2025)
di: Zhu, Chunzheng, et al.
Pubblicazione: (2025)
Enhancing Cancer Diagnosis with Explainable & Trustworthy Deep Learning Models
di: Olumuyiwa, Badaru I., et al.
Pubblicazione: (2024)
di: Olumuyiwa, Badaru I., et al.
Pubblicazione: (2024)
TRIM: A Self-Supervised Video Summarization Framework Maximizing Temporal Relative Information and Representativeness
di: Mishra, Pritam, et al.
Pubblicazione: (2025)
di: Mishra, Pritam, et al.
Pubblicazione: (2025)
CoMix: A Comprehensive Benchmark for Multi-Task Comic Understanding
di: Vivoli, Emanuele, et al.
Pubblicazione: (2024)
di: Vivoli, Emanuele, et al.
Pubblicazione: (2024)
Leveraging Evidence-Guided LLMs to Enhance Trustworthy Depression Diagnosis
di: Yuan, Yining, et al.
Pubblicazione: (2025)
di: Yuan, Yining, et al.
Pubblicazione: (2025)
Structured Analysis and Comparison of Alphabets in Historical Handwritten Ciphers
di: Méndez, Martín, et al.
Pubblicazione: (2024)
di: Méndez, Martín, et al.
Pubblicazione: (2024)
Synthetic dataset of ID and Travel Document
di: Boned, Carlos, et al.
Pubblicazione: (2024)
di: Boned, Carlos, et al.
Pubblicazione: (2024)
Documenti analoghi
-
xLSTM-ECG: Multi-label ECG Classification via Feature Fusion with xLSTM
di: Kang, Lei, et al.
Pubblicazione: (2025) -
Reading in the Dark: Low-light Scene Text Recognition
di: Fu, Xuanshuo, et al.
Pubblicazione: (2026) -
Preserving Privacy Without Compromising Accuracy: Machine Unlearning for Handwritten Text Recognition
di: Kang, Lei, et al.
Pubblicazione: (2025) -
Multi-Page Document Visual Question Answering using Self-Attention Scoring Mechanism
di: Kang, Lei, et al.
Pubblicazione: (2024) -
Machine Unlearning for Document Classification
di: Kang, Lei, et al.
Pubblicazione: (2024)