Insights into a radiology-specialised multimodal large language model with sparse autoencoders
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bouzid, Kenza, Bannur, Shruthi, Meissen, Felix, de Castro, Daniel Coelho, Schwaighofer, Anton, Alvarez-Valle, Javier, Hyland, Stephanie L. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MAIRA-1: A specialised large multimodal model for radiology report generation
par: Hyland, Stephanie L., et autres
Publié: (2023)
par: Hyland, Stephanie L., et autres
Publié: (2023)
NOVA: An Agentic Framework for Automated Histopathology Analysis and Discovery
par: Vaidya, Anurag J., et autres
Publié: (2025)
par: Vaidya, Anurag J., et autres
Publié: (2025)
Learning to Exploit Temporal Structure for Biomedical Vision-Language Processing
par: Bannur, Shruthi, et autres
Publié: (2023)
par: Bannur, Shruthi, et autres
Publié: (2023)
Exploring scalable medical image encoders beyond text supervision
par: Pérez-García, Fernando, et autres
Publié: (2024)
par: Pérez-García, Fernando, et autres
Publié: (2024)
MAIRA-Seg: Enhancing Radiology Report Generation with Segmentation-Aware Multimodal Large Language Models
par: Sharma, Harshita, et autres
Publié: (2024)
par: Sharma, Harshita, et autres
Publié: (2024)
MAIRA-2: Grounded Radiology Report Generation
par: Bannur, Shruthi, et autres
Publié: (2024)
par: Bannur, Shruthi, et autres
Publié: (2024)
Multimodal Healthcare AI: Identifying and Designing Clinically Relevant Vision-Language Applications for Radiology
par: Yildirim, Nur, et autres
Publié: (2024)
par: Yildirim, Nur, et autres
Publié: (2024)
PadChest-GR: A Bilingual Chest X-ray Dataset for Grounded Radiology Report Generation
par: Castro, Daniel C., et autres
Publié: (2024)
par: Castro, Daniel C., et autres
Publié: (2024)
Applying sparse autoencoders to unlearn knowledge in language models
par: Farrell, Eoin, et autres
Publié: (2024)
par: Farrell, Eoin, et autres
Publié: (2024)
Decomposing multimodal embedding spaces with group-sparse autoencoders
par: Kaushik, Chiraag, et autres
Publié: (2026)
par: Kaushik, Chiraag, et autres
Publié: (2026)
Challenges for Responsible AI Design and Workflow Integration in Healthcare: A Case Study of Automatic Feeding Tube Qualification in Radiology
par: Thieme, Anja, et autres
Publié: (2024)
par: Thieme, Anja, et autres
Publié: (2024)
Embodiment in multimodal large language models
par: Kadambi, Akila, et autres
Publié: (2025)
par: Kadambi, Akila, et autres
Publié: (2025)
The current status of large language models in summarizing radiology report impressions
par: Hu, Danqing, et autres
Publié: (2024)
par: Hu, Danqing, et autres
Publié: (2024)
Visual cognition in multimodal large language models
par: Buschoff, Luca M. Schulze, et autres
Publié: (2023)
par: Buschoff, Luca M. Schulze, et autres
Publié: (2023)
Multi-step retrieval and reasoning improves radiology question answering with large language models
par: Wind, Sebastian, et autres
Publié: (2025)
par: Wind, Sebastian, et autres
Publié: (2025)
Scaling and evaluating sparse autoencoders
par: Gao, Leo, et autres
Publié: (2024)
par: Gao, Leo, et autres
Publié: (2024)
Closing the Performance Gap Between AI and Radiologists in Chest X-Ray Reporting
par: Sharma, Harshita, et autres
Publié: (2025)
par: Sharma, Harshita, et autres
Publié: (2025)
Protecting multimodal large language models against misleading visualizations
par: Tonglet, Jonathan, et autres
Publié: (2025)
par: Tonglet, Jonathan, et autres
Publié: (2025)
Analyzing multimodal probability measures with autoencoders
par: Lelièvre, Tony, et autres
Publié: (2023)
par: Lelièvre, Tony, et autres
Publié: (2023)
Weakly Supervised Object Detection in Chest X-Rays with Differentiable ROI Proposal Networks and Soft ROI Pooling
par: Müller, Philip, et autres
Publié: (2024)
par: Müller, Philip, et autres
Publié: (2024)
Evaluation of Language Models in the Medical Context Under Resource-Constrained Settings
par: Posada, Andrea, et autres
Publié: (2024)
par: Posada, Andrea, et autres
Publié: (2024)
Evaluating point-light biological motion in multimodal large language models
par: Kadambi, Akila, et autres
Publié: (2025)
par: Kadambi, Akila, et autres
Publié: (2025)
Is your multimodal large language model a good science tutor?
par: Liu, Ming, et autres
Publié: (2025)
par: Liu, Ming, et autres
Publié: (2025)
Steering CLIP's vision transformer with sparse autoencoders
par: Joseph, Sonia, et autres
Publié: (2025)
par: Joseph, Sonia, et autres
Publié: (2025)
In-context learning enables multimodal large language models to classify cancer pathology images
par: Ferber, Dyke, et autres
Publié: (2024)
par: Ferber, Dyke, et autres
Publié: (2024)
Learning biologically relevant features in a pathology foundation model using sparse autoencoders
par: Le, Nhat Minh, et autres
Publié: (2024)
par: Le, Nhat Minh, et autres
Publié: (2024)
Can sparse autoencoders make sense of gene expression latent variable models?
par: Schuster, Viktoria
Publié: (2024)
par: Schuster, Viktoria
Publié: (2024)
Retrieval-augmented in-context learning for multimodal large language models in disease classification
par: Zhan, Zaifu, et autres
Publié: (2025)
par: Zhan, Zaifu, et autres
Publié: (2025)
A benchmark multimodal oro-dental dataset for large vision-language models
par: Lv, Haoxin, et autres
Publié: (2025)
par: Lv, Haoxin, et autres
Publié: (2025)
Medical large language models are easily distracted
par: Vishwanath, Krithik, et autres
Publié: (2025)
par: Vishwanath, Krithik, et autres
Publié: (2025)
Understanding sparse autoencoder scaling in the presence of feature manifolds
par: Michaud, Eric J., et autres
Publié: (2025)
par: Michaud, Eric J., et autres
Publié: (2025)
Can large language models build causal graphs?
par: Long, Stephanie, et autres
Publié: (2023)
par: Long, Stephanie, et autres
Publié: (2023)
Human-like object concept representations emerge naturally in multimodal large language models
par: Du, Changde, et autres
Publié: (2024)
par: Du, Changde, et autres
Publié: (2024)
Interactive Generation of Laparoscopic Videos with Diffusion Models
par: Iliash, Ivan, et autres
Publié: (2024)
par: Iliash, Ivan, et autres
Publié: (2024)
Opportunities and challenges in the application of large artificial intelligence models in radiology
par: Pan, Liangrui, et autres
Publié: (2024)
par: Pan, Liangrui, et autres
Publié: (2024)
Ultrasound of the uterosacral ligaments: A reliability study for diagnosing endometriosis in Australian non‐specialised medical imaging and radiology settings
par: Shae Maple, et autres
Publié: (2025)
par: Shae Maple, et autres
Publié: (2025)
Can sparse autoencoders be used to decompose and interpret steering vectors?
par: Mayne, Harry, et autres
Publié: (2024)
par: Mayne, Harry, et autres
Publié: (2024)
Investigating task-specific prompts and sparse autoencoders for activation monitoring
par: Tillman, Henk, et autres
Publié: (2025)
par: Tillman, Henk, et autres
Publié: (2025)
MNAFT: modality neuron-aware fine-tuning of multimodal large language models for image translation
par: Li, Bo, et autres
Publié: (2026)
par: Li, Bo, et autres
Publié: (2026)
CXR-LLAVA: a multimodal large language model for interpreting chest X-ray images
par: Lee, Seowoo, et autres
Publié: (2023)
par: Lee, Seowoo, et autres
Publié: (2023)
Documents similaires
-
MAIRA-1: A specialised large multimodal model for radiology report generation
par: Hyland, Stephanie L., et autres
Publié: (2023) -
NOVA: An Agentic Framework for Automated Histopathology Analysis and Discovery
par: Vaidya, Anurag J., et autres
Publié: (2025) -
Learning to Exploit Temporal Structure for Biomedical Vision-Language Processing
par: Bannur, Shruthi, et autres
Publié: (2023) -
Exploring scalable medical image encoders beyond text supervision
par: Pérez-García, Fernando, et autres
Publié: (2024) -
MAIRA-Seg: Enhancing Radiology Report Generation with Segmentation-Aware Multimodal Large Language Models
par: Sharma, Harshita, et autres
Publié: (2024)