MiniGPT-Med: Large Language Model as a General Interface for Radiology Diagnosis
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Alkhaldi, Asma, Alnajim, Raneem, Alabdullatef, Layan, Alyahya, Rawan, Chen, Jun, Zhu, Deyao, Alsinan, Ahmed, Elhoseiny, Mohamed |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MiniGPT4-Video: Advancing Multimodal LLMs for Video Understanding with Interleaved Visual-Textual Tokens
par: Ataallah, Kirolos, et autres
Publié: (2024)
par: Ataallah, Kirolos, et autres
Publié: (2024)
M-MiniGPT4: Multilingual VLLM Alignment via Translated Data
par: Han, Seung Hun, et autres
Publié: (2026)
par: Han, Seung Hun, et autres
Publié: (2026)
MiniGPT-Reverse-Designing: Predicting Image Adjustments Utilizing MiniGPT-4
par: Azizi, Vahid, et autres
Publié: (2024)
par: Azizi, Vahid, et autres
Publié: (2024)
MiniGPT: Rebuilding GPT from First Principles
par: Joseph, Jibin
Publié: (2026)
par: Joseph, Jibin
Publié: (2026)
Multi-View MRI Approach for Classification of MGMT Methylation in Glioblastoma Patients
par: Alyahya, Rawan, et autres
Publié: (2025)
par: Alyahya, Rawan, et autres
Publié: (2025)
MiniGPT-Pancreas: Multimodal Large Language Model for Pancreas Cancer Classification and Detection
par: Moglia, Andrea, et autres
Publié: (2024)
par: Moglia, Andrea, et autres
Publié: (2024)
MiniGPT-5: Interleaved Vision-and-Language Generation via Generative Vokens
par: Zheng, Kaizhi, et autres
Publié: (2023)
par: Zheng, Kaizhi, et autres
Publié: (2023)
StoryGPT-V: Large Language Models as Consistent Story Visualizers
par: Shen, Xiaoqian, et autres
Publié: (2023)
par: Shen, Xiaoqian, et autres
Publié: (2023)
MiniGPT-3D: Efficiently Aligning 3D Point Clouds with Large Language Models using 2D Priors
par: Tang, Yuan, et autres
Publié: (2024)
par: Tang, Yuan, et autres
Publié: (2024)
Radiology-GPT: A Large Language Model for Radiology
par: Liu, Zhengliang, et autres
Publié: (2023)
par: Liu, Zhengliang, et autres
Publié: (2023)
How Well Can Vision Language Models See Image Details?
par: Gou, Chenhui, et autres
Publié: (2024)
par: Gou, Chenhui, et autres
Publié: (2024)
Goldfish: Vision-Language Understanding of Arbitrarily Long Videos
par: Ataallah, Kirolos, et autres
Publié: (2024)
par: Ataallah, Kirolos, et autres
Publié: (2024)
3DCoMPaT200: Language-Grounded Compositional Understanding of Parts and Materials of 3D Shapes
par: Ahmed, Mahmoud, et autres
Publié: (2025)
par: Ahmed, Mahmoud, et autres
Publié: (2025)
The Prompting Brain: Neurocognitive Markers of Expertise in Guiding Large Language Models
par: Al-Khalifa, Hend, et autres
Publié: (2025)
par: Al-Khalifa, Hend, et autres
Publié: (2025)
VRSBench: A Versatile Vision-Language Benchmark Dataset for Remote Sensing Image Understanding
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
Kestrel: 3D Multimodal LLM for Part-Aware Grounded Description
par: Ahmed, Mahmoud, et autres
Publié: (2024)
par: Ahmed, Mahmoud, et autres
Publié: (2024)
DiversityMedQA: Assessing Demographic Biases in Medical Diagnosis using Large Language Models
par: Rawat, Rajat, et autres
Publié: (2024)
par: Rawat, Rajat, et autres
Publié: (2024)
ALLaM: Large Language Models for Arabic and English
par: Bari, M Saiful, et autres
Publié: (2024)
par: Bari, M Saiful, et autres
Publié: (2024)
CoT3DRef: Chain-of-Thoughts Data-Efficient 3D Visual Grounding
par: Abdelrahman, Eslam, et autres
Publié: (2023)
par: Abdelrahman, Eslam, et autres
Publié: (2023)
Fine-Tuning In-House Large Language Models to Infer Differential Diagnosis from Radiology Reports
par: Chen, Luoyao, et autres
Publié: (2024)
par: Chen, Luoyao, et autres
Publié: (2024)
Efficient Self-supervised Vision Pretraining with Local Masked Reconstruction
par: Chen, Jun, et autres
Publié: (2022)
par: Chen, Jun, et autres
Publié: (2022)
Vgent: Graph-based Retrieval-Reasoning-Augmented Generation For Long Video Understanding
par: Shen, Xiaoqian, et autres
Publié: (2025)
par: Shen, Xiaoqian, et autres
Publié: (2025)
Evaluating Large Language Models for Radiology Natural Language Processing
par: Liu, Zhengliang, et autres
Publié: (2023)
par: Liu, Zhengliang, et autres
Publié: (2023)
Enhancing Medical Support in the Arabic Language Through Personalized ChatGPT Assistance
par: Issa, Mohamed, et autres
Publié: (2024)
par: Issa, Mohamed, et autres
Publié: (2024)
Large-scale Long-tailed Disease Diagnosis on Radiology Images
par: Zheng, Qiaoyu, et autres
Publié: (2023)
par: Zheng, Qiaoyu, et autres
Publié: (2023)
Document Haystacks: Vision-Language Reasoning Over Piles of 1000+ Documents
par: Chen, Jun, et autres
Publié: (2024)
par: Chen, Jun, et autres
Publié: (2024)
Hatred Stems from Ignorance! Distillation of the Persuasion Modes in Countering Conversational Hate Speech
par: Alyahya, Ghadi, et autres
Publié: (2024)
par: Alyahya, Ghadi, et autres
Publié: (2024)
3rd Place at CVPR 2026 CASTLE Challenge: Agentic Multi-View Long-Context Video Understanding via Hierarchical Knowledge Graph Retrieval
par: Albusayes, Raghad, et autres
Publié: (2026)
par: Albusayes, Raghad, et autres
Publié: (2026)
3D-CT-GPT: Generating 3D Radiology Reports through Integration of Large Vision-Language Models
par: Chen, Hao, et autres
Publié: (2024)
par: Chen, Hao, et autres
Publié: (2024)
Time Blindness: Why Video-Language Models Can't See What Humans Can?
par: Upadhyay, Ujjwal, et autres
Publié: (2025)
par: Upadhyay, Ujjwal, et autres
Publié: (2025)
Meerkat: Audio-Visual Large Language Model for Grounding in Space and Time
par: Chowdhury, Sanjoy, et autres
Publié: (2024)
par: Chowdhury, Sanjoy, et autres
Publié: (2024)
GPT-4V Cannot Generate Radiology Reports Yet
par: Jiang, Yuyang, et autres
Publié: (2024)
par: Jiang, Yuyang, et autres
Publié: (2024)
XProvence: Zero-Cost Multilingual Context Pruning for Retrieval-Augmented Generation
par: Mohamed, Youssef, et autres
Publié: (2026)
par: Mohamed, Youssef, et autres
Publié: (2026)
InfiniBench: A Benchmark for Large Multi-Modal Models in Long-Form Movies and TV Shows
par: Ataallah, Kirolos, et autres
Publié: (2024)
par: Ataallah, Kirolos, et autres
Publié: (2024)
ResumeAtlas: Revisiting Resume Classification with Large-Scale Datasets and Large Language Models
par: Heakl, Ahmed, et autres
Publié: (2024)
par: Heakl, Ahmed, et autres
Publié: (2024)
Bi-Factorial Preference Optimization: Balancing Safety-Helpfulness in Language Models
par: Zhang, Wenxuan, et autres
Publié: (2024)
par: Zhang, Wenxuan, et autres
Publié: (2024)
DirectGPT: A Direct Manipulation Interface to Interact with Large Language Models
par: Masson, Damien, et autres
Publié: (2023)
par: Masson, Damien, et autres
Publié: (2023)
Neural Catalog: Scaling Species Recognition with Catalog of Life-Augmented Generation
par: Khan, Faizan Farooq, et autres
Publié: (2025)
par: Khan, Faizan Farooq, et autres
Publié: (2025)
Context Matters: Incorporating Target Awareness in Conversational Abusive Language Detection
par: Alharthi, Raneem, et autres
Publié: (2025)
par: Alharthi, Raneem, et autres
Publié: (2025)
VERT: Reliable LLM Judges for Radiology Report Evaluation
par: Bologna, Federica, et autres
Publié: (2026)
par: Bologna, Federica, et autres
Publié: (2026)
Documents similaires
-
MiniGPT4-Video: Advancing Multimodal LLMs for Video Understanding with Interleaved Visual-Textual Tokens
par: Ataallah, Kirolos, et autres
Publié: (2024) -
M-MiniGPT4: Multilingual VLLM Alignment via Translated Data
par: Han, Seung Hun, et autres
Publié: (2026) -
MiniGPT-Reverse-Designing: Predicting Image Adjustments Utilizing MiniGPT-4
par: Azizi, Vahid, et autres
Publié: (2024) -
MiniGPT: Rebuilding GPT from First Principles
par: Joseph, Jibin
Publié: (2026) -
Multi-View MRI Approach for Classification of MGMT Methylation in Glioblastoma Patients
par: Alyahya, Rawan, et autres
Publié: (2025)