MiniGPT-Pancreas: Multimodal Large Language Model for Pancreas Cancer Classification and Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Moglia, Andrea, Nastasio, Elia Clement, Mainardi, Luca, Cerveri, Pietro |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Deep Learning for Pancreas Segmentation: a Systematic Review
par: Moglia, Andrea, et autres
Publié: (2024)
par: Moglia, Andrea, et autres
Publié: (2024)
MiniGPT-Reverse-Designing: Predicting Image Adjustments Utilizing MiniGPT-4
par: Azizi, Vahid, et autres
Publié: (2024)
par: Azizi, Vahid, et autres
Publié: (2024)
Cascade learning in multi-task encoder-decoder networks for concurrent bone segmentation and glenohumeral joint assessment in shoulder CT scans
par: Marsilio, Luca, et autres
Publié: (2024)
par: Marsilio, Luca, et autres
Publié: (2024)
MiniGPT-Med: Large Language Model as a General Interface for Radiology Diagnosis
par: Alkhaldi, Asma, et autres
Publié: (2024)
par: Alkhaldi, Asma, et autres
Publié: (2024)
MiniGPT-5: Interleaved Vision-and-Language Generation via Generative Vokens
par: Zheng, Kaizhi, et autres
Publié: (2023)
par: Zheng, Kaizhi, et autres
Publié: (2023)
Optimized two-stage AI-based Neural Decoding for Enhanced Visual Stimulus Reconstruction from fMRI Data
par: Veronese, Lorenzo, et autres
Publié: (2024)
par: Veronese, Lorenzo, et autres
Publié: (2024)
Generalist Models in Medical Image Segmentation: A Survey and Performance Comparison with Task-Specific Approaches
par: Moglia, Andrea, et autres
Publié: (2025)
par: Moglia, Andrea, et autres
Publié: (2025)
Pancreas Part Segmentation under Federated Learning Paradigm
par: Hong, Ziliang, et autres
Publié: (2025)
par: Hong, Ziliang, et autres
Publié: (2025)
MiniGPT-3D: Efficiently Aligning 3D Point Clouds with Large Language Models using 2D Priors
par: Tang, Yuan, et autres
Publié: (2024)
par: Tang, Yuan, et autres
Publié: (2024)
Utility of Pancreas Surface Lobularity as a CT Biomarker for Opportunistic Screening of Type 2 Diabetes
par: Mathai, Tejas Sudharshan, et autres
Publié: (2025)
par: Mathai, Tejas Sudharshan, et autres
Publié: (2025)
Leveraging Anatomical Priors for Automated Pancreas Segmentation on Abdominal CT
par: Prasad, Anisa V., et autres
Publié: (2025)
par: Prasad, Anisa V., et autres
Publié: (2025)
MiniGPT4-Video: Advancing Multimodal LLMs for Video Understanding with Interleaved Visual-Textual Tokens
par: Ataallah, Kirolos, et autres
Publié: (2024)
par: Ataallah, Kirolos, et autres
Publié: (2024)
A Unified Framework for the Detection and Classification of Fatty Pancreas in Ultrasound Images
par: Anghel, Ioan-Tudor-Alexandru, et autres
Publié: (2026)
par: Anghel, Ioan-Tudor-Alexandru, et autres
Publié: (2026)
Contextual Object Detection with Multimodal Large Language Models
par: Zang, Yuhang, et autres
Publié: (2023)
par: Zang, Yuhang, et autres
Publié: (2023)
Can GPT tell us why these images are synthesized? Empowering Multimodal Large Language Models for Forensics
par: He, Yiran, et autres
Publié: (2025)
par: He, Yiran, et autres
Publié: (2025)
GPT-4 Enhanced Multimodal Grounding for Autonomous Driving: Leveraging Cross-Modal Attention with Large Language Models
par: Liao, Haicheng, et autres
Publié: (2023)
par: Liao, Haicheng, et autres
Publié: (2023)
UlcerGPT: A Multimodal Approach Leveraging Large Language and Vision Models for Diabetic Foot Ulcer Image Transcription
par: Basiri, Reza, et autres
Publié: (2024)
par: Basiri, Reza, et autres
Publié: (2024)
MMR-AD: A Large-Scale Multimodal Dataset for Benchmarking General Anomaly Detection with Multimodal Large Language Models
par: Yao, Xincheng, et autres
Publié: (2026)
par: Yao, Xincheng, et autres
Publié: (2026)
Leveraging Chat-Based Large Vision Language Models for Multimodal Out-Of-Context Detection
par: Shalabi, Fatma, et autres
Publié: (2024)
par: Shalabi, Fatma, et autres
Publié: (2024)
MMAD: A Comprehensive Benchmark for Multimodal Large Language Models in Industrial Anomaly Detection
par: Jiang, Xi, et autres
Publié: (2024)
par: Jiang, Xi, et autres
Publié: (2024)
Large Language Model Guided Progressive Feature Alignment for Multimodal UAV Object Detection
par: Wu, Wentao, et autres
Publié: (2025)
par: Wu, Wentao, et autres
Publié: (2025)
Check Field Detection Agent (CFD-Agent) using Multimodal Large Language and Vision Language Models
par: Halder, Sourav, et autres
Publié: (2025)
par: Halder, Sourav, et autres
Publié: (2025)
GeoMotionGPT: Geometry-Aligned Motion Understanding with Large Language Models
par: Ye, Zhankai, et autres
Publié: (2026)
par: Ye, Zhankai, et autres
Publié: (2026)
ForgeryGPT: A Multimodal LLM for Interpretable Image Forgery Detection and Localization
par: Zhang, Fanrui, et autres
Publié: (2024)
par: Zhang, Fanrui, et autres
Publié: (2024)
LLaVA-Mini: Efficient Image and Video Large Multimodal Models with One Vision Token
par: Zhang, Shaolei, et autres
Publié: (2025)
par: Zhang, Shaolei, et autres
Publié: (2025)
Enhancing Few-Shot Vision-Language Classification with Large Multimodal Model Features
par: Mitra, Chancharik, et autres
Publié: (2024)
par: Mitra, Chancharik, et autres
Publié: (2024)
The Paradigm Shift: A Comprehensive Survey on Large Vision Language Models for Multimodal Fake News Detection
par: Ai, Wei, et autres
Publié: (2026)
par: Ai, Wei, et autres
Publié: (2026)
EDVD-LLaMA: Explainable Deepfake Video Detection via Multimodal Large Language Model Reasoning
par: Sun, Haoran, et autres
Publié: (2025)
par: Sun, Haoran, et autres
Publié: (2025)
HOI-R1: Exploring the Potential of Multimodal Large Language Models for Human-Object Interaction Detection
par: Chen, Junwen, et autres
Publié: (2025)
par: Chen, Junwen, et autres
Publié: (2025)
Efficient Multimodal Large Language Models: A Survey
par: Jin, Yizhang, et autres
Publié: (2024)
par: Jin, Yizhang, et autres
Publié: (2024)
Toward Cognitive Supersensing in Multimodal Large Language Model
par: Li, Boyi, et autres
Publié: (2026)
par: Li, Boyi, et autres
Publié: (2026)
Speculative Decoding Reimagined for Multimodal Large Language Models
par: Lin, Luxi, et autres
Publié: (2025)
par: Lin, Luxi, et autres
Publié: (2025)
On the Out-Of-Distribution Generalization of Multimodal Large Language Models
par: Zhang, Xingxuan, et autres
Publié: (2024)
par: Zhang, Xingxuan, et autres
Publié: (2024)
Neuromorphic Drone Detection: an Event-RGB Multimodal Approach
par: Magrini, Gabriele, et autres
Publié: (2024)
par: Magrini, Gabriele, et autres
Publié: (2024)
DecepGPT: Schema-Driven Deception Detection with Multicultural Datasets and Robust Multimodal Learning
par: Huang, Jiajian, et autres
Publié: (2026)
par: Huang, Jiajian, et autres
Publié: (2026)
A Geometric Multimodal Foundation Model Integrating Bp-MRI and Clinical Reports in Prostate Cancer Classification
par: Olmos, Juan A., et autres
Publié: (2026)
par: Olmos, Juan A., et autres
Publié: (2026)
A Simple Aerial Detection Baseline of Multimodal Language Models
par: Li, Qingyun, et autres
Publié: (2025)
par: Li, Qingyun, et autres
Publié: (2025)
Integrating Multimodal Large Language Model Knowledge into Amodal Completion
par: Yun, Heecheol, et autres
Publié: (2026)
par: Yun, Heecheol, et autres
Publié: (2026)
Temporal Grounding of Activities using Multimodal Large Language Models
par: Song, Young Chol
Publié: (2024)
par: Song, Young Chol
Publié: (2024)
Demystifying the Visual Quality Paradox in Multimodal Large Language Models
par: Xing, Shuo, et autres
Publié: (2025)
par: Xing, Shuo, et autres
Publié: (2025)
Documents similaires
-
Deep Learning for Pancreas Segmentation: a Systematic Review
par: Moglia, Andrea, et autres
Publié: (2024) -
MiniGPT-Reverse-Designing: Predicting Image Adjustments Utilizing MiniGPT-4
par: Azizi, Vahid, et autres
Publié: (2024) -
Cascade learning in multi-task encoder-decoder networks for concurrent bone segmentation and glenohumeral joint assessment in shoulder CT scans
par: Marsilio, Luca, et autres
Publié: (2024) -
MiniGPT-Med: Large Language Model as a General Interface for Radiology Diagnosis
par: Alkhaldi, Asma, et autres
Publié: (2024) -
MiniGPT-5: Interleaved Vision-and-Language Generation via Generative Vokens
par: Zheng, Kaizhi, et autres
Publié: (2023)