Exploring scalable medical image encoders beyond text supervision
Fuente:
arXiv
Salvato in:
| Autori principali: | Pérez-García, Fernando, Sharma, Harshita, Bond-Taylor, Sam, Bouzid, Kenza, Salvatelli, Valentina, Ilse, Maximilian, Bannur, Shruthi, Castro, Daniel C., Schwaighofer, Anton, Lungren, Matthew P., Wetscherek, Maria Teodora, Codella, Noel, Hyland, Stephanie L., Alvarez-Valle, Javier, Oktay, Ozan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MAIRA-1: A specialised large multimodal model for radiology report generation
di: Hyland, Stephanie L., et al.
Pubblicazione: (2023)
di: Hyland, Stephanie L., et al.
Pubblicazione: (2023)
MAIRA-2: Grounded Radiology Report Generation
di: Bannur, Shruthi, et al.
Pubblicazione: (2024)
di: Bannur, Shruthi, et al.
Pubblicazione: (2024)
Learning to Exploit Temporal Structure for Biomedical Vision-Language Processing
di: Bannur, Shruthi, et al.
Pubblicazione: (2023)
di: Bannur, Shruthi, et al.
Pubblicazione: (2023)
MAIRA-Seg: Enhancing Radiology Report Generation with Segmentation-Aware Multimodal Large Language Models
di: Sharma, Harshita, et al.
Pubblicazione: (2024)
di: Sharma, Harshita, et al.
Pubblicazione: (2024)
Insights into a radiology-specialised multimodal large language model with sparse autoencoders
di: Bouzid, Kenza, et al.
Pubblicazione: (2025)
di: Bouzid, Kenza, et al.
Pubblicazione: (2025)
Comprehensive language-image pre-training for 3D medical image understanding
di: Wald, Tassilo, et al.
Pubblicazione: (2025)
di: Wald, Tassilo, et al.
Pubblicazione: (2025)
Multimodal Healthcare AI: Identifying and Designing Clinically Relevant Vision-Language Applications for Radiology
di: Yildirim, Nur, et al.
Pubblicazione: (2024)
di: Yildirim, Nur, et al.
Pubblicazione: (2024)
Challenges for Responsible AI Design and Workflow Integration in Healthcare: A Case Study of Automatic Feeding Tube Qualification in Radiology
di: Thieme, Anja, et al.
Pubblicazione: (2024)
di: Thieme, Anja, et al.
Pubblicazione: (2024)
RadEdit: stress-testing biomedical vision models via diffusion image editing
di: Pérez-García, Fernando, et al.
Pubblicazione: (2023)
di: Pérez-García, Fernando, et al.
Pubblicazione: (2023)
Data Scaling Laws for Radiology Foundation Models
di: Ilse, Maximilian, et al.
Pubblicazione: (2025)
di: Ilse, Maximilian, et al.
Pubblicazione: (2025)
Closing the Performance Gap Between AI and Radiologists in Chest X-Ray Reporting
di: Sharma, Harshita, et al.
Pubblicazione: (2025)
di: Sharma, Harshita, et al.
Pubblicazione: (2025)
PadChest-GR: A Bilingual Chest X-ray Dataset for Grounded Radiology Report Generation
di: Castro, Daniel C., et al.
Pubblicazione: (2024)
di: Castro, Daniel C., et al.
Pubblicazione: (2024)
NOVA: An Agentic Framework for Automated Histopathology Analysis and Discovery
di: Vaidya, Anurag J., et al.
Pubblicazione: (2025)
di: Vaidya, Anurag J., et al.
Pubblicazione: (2025)
Cellular Outline Segmentation using Fractal Estimators
di: Adrian Salvatelli
Pubblicazione: (2007)
di: Adrian Salvatelli
Pubblicazione: (2007)
Editorial for “Reproducibility and Repeatability of Intravoxel Incoherent Motion MRI Acquisition Methods in Liver”
di: Andreas Wetscherek
Pubblicazione: (2024)
di: Andreas Wetscherek
Pubblicazione: (2024)
SpATr: MoCap 3D Human Action Recognition based on Spiral Auto-encoder and Transformer Network
di: Bouzid, Hamza, et al.
Pubblicazione: (2023)
di: Bouzid, Hamza, et al.
Pubblicazione: (2023)
Synthetically generated text for supervised text analysis
di: Halterman, Andrew
Pubblicazione: (2023)
di: Halterman, Andrew
Pubblicazione: (2023)
Block-level Text Spotting with LLMs
di: Bannur, Ganesh, et al.
Pubblicazione: (2024)
di: Bannur, Ganesh, et al.
Pubblicazione: (2024)
Fourier Splatting: Generalized Fourier encoded primitives for scalable radiance fields
di: Jurca, Mihnea-Bogdan, et al.
Pubblicazione: (2026)
di: Jurca, Mihnea-Bogdan, et al.
Pubblicazione: (2026)
The motivic Galois group for a double zeta value
di: Memlouk, Kenza
Pubblicazione: (2025)
di: Memlouk, Kenza
Pubblicazione: (2025)
FEMMES MAROCAINES MIGRANTES: MOBILITE, PROJETS ET REALITES
di: Kenza Elghali
Pubblicazione: (2007)
di: Kenza Elghali
Pubblicazione: (2007)
Social Justice Agenda for Community Organizations in Morocco (Equity, Diversity, and Inclusion Reconsidered)
di: Kenza Oumlil
Pubblicazione: (2025)
di: Kenza Oumlil
Pubblicazione: (2025)
MedImageInsight: An Open-Source Embedding Model for General Domain Medical Imaging
di: Codella, Noel C. F., et al.
Pubblicazione: (2024)
di: Codella, Noel C. F., et al.
Pubblicazione: (2024)
DiverseNet: Decision Diversified Semi-supervised Semantic Segmentation Networks for Remote Sensing Imagery
di: Ma, Wanli, et al.
Pubblicazione: (2023)
di: Ma, Wanli, et al.
Pubblicazione: (2023)
Using text embedding models as text classifiers with medical data
di: Goel, Rishabh
Pubblicazione: (2024)
di: Goel, Rishabh
Pubblicazione: (2024)
ResidualPlanner+: a scalable matrix mechanism for marginals and beyond
di: Xiao, Yingtai, et al.
Pubblicazione: (2023)
di: Xiao, Yingtai, et al.
Pubblicazione: (2023)
Uncertainty-aware abstention in medical diagnosis based on medical texts
di: Vazhentsev, Artem, et al.
Pubblicazione: (2025)
di: Vazhentsev, Artem, et al.
Pubblicazione: (2025)
Demo: Healthcare Agent Orchestrator (HAO) for Patient Summarization in Molecular Tumor Boards
di: Blondeel, Matthias, et al.
Pubblicazione: (2025)
di: Blondeel, Matthias, et al.
Pubblicazione: (2025)
Generalization in medical AI: a perspective on developing scalable models
di: Zvuloni, Eran, et al.
Pubblicazione: (2023)
di: Zvuloni, Eran, et al.
Pubblicazione: (2023)
A Comparative Ontological Study in Light of the A-B.F-N Model and the Quranic Vision of the Soul and Internal Sovereignty
di: Bouzid, Fatiha
Pubblicazione: (2026)
di: Bouzid, Fatiha
Pubblicazione: (2026)
Dólar, petróleo e novas práticas de comércio internacional
di: Bouzid Izerrougene
Pubblicazione: (2011)
di: Bouzid Izerrougene
Pubblicazione: (2011)
t-gems: text-guided exit modules for decreasing clip image encoder
di: Presta, Alberto, et al.
Pubblicazione: (2026)
di: Presta, Alberto, et al.
Pubblicazione: (2026)
Clinical ModernBERT: An efficient and long context encoder for biomedical text
di: Lee, Simon A., et al.
Pubblicazione: (2025)
di: Lee, Simon A., et al.
Pubblicazione: (2025)
Design of scalable orthogonal digital encoding architecture for large-area flexible tactile sensing in robotics
di: Liu, Weijie, et al.
Pubblicazione: (2025)
di: Liu, Weijie, et al.
Pubblicazione: (2025)
Projecting an academic identity in some reflective genres
di: Ken Hyland
Pubblicazione: (2011)
di: Ken Hyland
Pubblicazione: (2011)
The Mexican American in Library Materials.
di: Hyland, Anne
Pubblicazione: (1974)
di: Hyland, Anne
Pubblicazione: (1974)
Desert Island Books: An Essential TESOL Library.
di: Hyland, Ken
Pubblicazione: (1995)
di: Hyland, Ken
Pubblicazione: (1995)
The PTSD Gestalt switch
di: Philip Hyland
Pubblicazione: (2025)
di: Philip Hyland
Pubblicazione: (2025)
Ecosystem characterizations at multiple spatial scales: coastal ocean, estuaries, NOAA Managed Areas [Poster]
di: Hyland, Jeff
Pubblicazione: (2011)
di: Hyland, Jeff
Pubblicazione: (2011)
"The past is the future with the lights on": Reflections on AELFE's 20th birthday
di: Ken Hyland
Pubblicazione: (2012)
di: Ken Hyland
Pubblicazione: (2012)
Documenti analoghi
-
MAIRA-1: A specialised large multimodal model for radiology report generation
di: Hyland, Stephanie L., et al.
Pubblicazione: (2023) -
MAIRA-2: Grounded Radiology Report Generation
di: Bannur, Shruthi, et al.
Pubblicazione: (2024) -
Learning to Exploit Temporal Structure for Biomedical Vision-Language Processing
di: Bannur, Shruthi, et al.
Pubblicazione: (2023) -
MAIRA-Seg: Enhancing Radiology Report Generation with Segmentation-Aware Multimodal Large Language Models
di: Sharma, Harshita, et al.
Pubblicazione: (2024) -
Insights into a radiology-specialised multimodal large language model with sparse autoencoders
di: Bouzid, Kenza, et al.
Pubblicazione: (2025)