MAM-CLIP: Vision-Language Pretraining on Mammography Atlases for BI-RADS Classification
Fuente:
arXiv
Salvato in:
| Autori principali: | Gulluk, Halil Ibrahim, Gevaert, Olivier |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Improving Medical VQA through Trajectory-Aware Process Supervision
di: Gulluk, Halil Ibrahim, et al.
Pubblicazione: (2026)
di: Gulluk, Halil Ibrahim, et al.
Pubblicazione: (2026)
SemEnrich: Self-Supervised Semantic Enrichment of Radiology Reports for Vision-Language Learning
di: Gulluk, Halil Ibrahim, et al.
Pubblicazione: (2026)
di: Gulluk, Halil Ibrahim, et al.
Pubblicazione: (2026)
CLIP with Quality Captions: A Strong Pretraining for Vision Tasks
di: Vasu, Pavan Kumar Anasosalu, et al.
Pubblicazione: (2024)
di: Vasu, Pavan Kumar Anasosalu, et al.
Pubblicazione: (2024)
Region-of-Interest Augmentation for Mammography Classification under Patient-Level Cross-Validation
di: Bigdeli, Farbod, et al.
Pubblicazione: (2025)
di: Bigdeli, Farbod, et al.
Pubblicazione: (2025)
RankCLIP: Ranking-Consistent Language-Image Pretraining
di: Zhang, Yiming, et al.
Pubblicazione: (2024)
di: Zhang, Yiming, et al.
Pubblicazione: (2024)
HyperCLIP: Adapting Vision-Language models with Hypernetworks
di: Akinwande, Victor, et al.
Pubblicazione: (2024)
di: Akinwande, Victor, et al.
Pubblicazione: (2024)
Online Zero-Shot Classification with CLIP
di: Qian, Qi, et al.
Pubblicazione: (2024)
di: Qian, Qi, et al.
Pubblicazione: (2024)
Modeling Caption Diversity in Contrastive Vision-Language Pretraining
di: Lavoie, Samuel, et al.
Pubblicazione: (2024)
di: Lavoie, Samuel, et al.
Pubblicazione: (2024)
Filter Like You Test: Data-Driven Data Filtering for CLIP Pretraining
di: Shechter, Mikey, et al.
Pubblicazione: (2025)
di: Shechter, Mikey, et al.
Pubblicazione: (2025)
GoldiCLIP: The Goldilocks Approach for Balancing Explicit Supervision for Language-Image Pretraining
di: Mohan, Deen Dayal, et al.
Pubblicazione: (2026)
di: Mohan, Deen Dayal, et al.
Pubblicazione: (2026)
Negative Label Guided OOD Detection with Pretrained Vision-Language Models
di: Jiang, Xue, et al.
Pubblicazione: (2024)
di: Jiang, Xue, et al.
Pubblicazione: (2024)
Mammo-CLIP Dissect: A Framework for Analysing Mammography Concepts in Vision-Language Models
di: Salahuddin, Suaiba Amina, et al.
Pubblicazione: (2025)
di: Salahuddin, Suaiba Amina, et al.
Pubblicazione: (2025)
Advancing Vision-based Human Action Recognition: Exploring Vision-Language CLIP Model for Generalisation in Domain-Independent Tasks
di: Shandilya, Utkarsh, et al.
Pubblicazione: (2025)
di: Shandilya, Utkarsh, et al.
Pubblicazione: (2025)
Universal Pose Pretraining for Generalizable Vision-Language-Action Policies
di: Lin, Haitao, et al.
Pubblicazione: (2026)
di: Lin, Haitao, et al.
Pubblicazione: (2026)
CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning
di: Ahmed, Fatmaelzahraa Ali, et al.
Pubblicazione: (2025)
di: Ahmed, Fatmaelzahraa Ali, et al.
Pubblicazione: (2025)
Multimodal Machine Learning in Image-Based and Clinical Biomedicine: Survey and Prospects
di: Warner, Elisa, et al.
Pubblicazione: (2023)
di: Warner, Elisa, et al.
Pubblicazione: (2023)
Object-level Self-Distillation for Vision Pretraining
di: Hızlı, Çağlar, et al.
Pubblicazione: (2025)
di: Hızlı, Çağlar, et al.
Pubblicazione: (2025)
Time Series Representations for Classification Lie Hidden in Pretrained Vision Transformers
di: Roschmann, Simon, et al.
Pubblicazione: (2025)
di: Roschmann, Simon, et al.
Pubblicazione: (2025)
SpikeCLIP: A Contrastive Language-Image Pretrained Spiking Neural Network
di: Lv, Changze, et al.
Pubblicazione: (2023)
di: Lv, Changze, et al.
Pubblicazione: (2023)
LLM-Guided Diagnostic Evidence Alignment for Medical Vision-Language Pretraining under Limited Pairing
di: Yan, Huimin, et al.
Pubblicazione: (2026)
di: Yan, Huimin, et al.
Pubblicazione: (2026)
On the Reproducibility of "FairCLIP: Harnessing Fairness in Vision-Language Learning''
di: Bakker, Hua Chang, et al.
Pubblicazione: (2025)
di: Bakker, Hua Chang, et al.
Pubblicazione: (2025)
Full Field Digital Mammography Dataset from a Population Screening Program
di: Kendall, Edward, et al.
Pubblicazione: (2024)
di: Kendall, Edward, et al.
Pubblicazione: (2024)
PHyCLIP: $\ell_1$-Product of Hyperbolic Factors Unifies Hierarchy and Compositionality in Vision-Language Representation Learning
di: Yoshikawa, Daiki, et al.
Pubblicazione: (2025)
di: Yoshikawa, Daiki, et al.
Pubblicazione: (2025)
Deep BI-RADS Network for Improved Cancer Detection from Mammograms
di: Ben-Artzi, Gil, et al.
Pubblicazione: (2024)
di: Ben-Artzi, Gil, et al.
Pubblicazione: (2024)
Language-Pretraining-Induced Bias: A Strong Foundation for General Vision Tasks
di: Luo, Yaxin, et al.
Pubblicazione: (2026)
di: Luo, Yaxin, et al.
Pubblicazione: (2026)
2.5 Years in Class: A Multimodal Textbook for Vision-Language Pretraining
di: Zhang, Wenqi, et al.
Pubblicazione: (2025)
di: Zhang, Wenqi, et al.
Pubblicazione: (2025)
Renaissance: Investigating the Pretraining of Vision-Language Encoders
di: Fields, Clayton, et al.
Pubblicazione: (2024)
di: Fields, Clayton, et al.
Pubblicazione: (2024)
SAM-CLIP: Merging Vision Foundation Models towards Semantic and Spatial Understanding
di: Wang, Haoxiang, et al.
Pubblicazione: (2023)
di: Wang, Haoxiang, et al.
Pubblicazione: (2023)
If CLIP Could Talk: Understanding Vision-Language Model Representations Through Their Preferred Concept Descriptions
di: Esfandiarpoor, Reza, et al.
Pubblicazione: (2024)
di: Esfandiarpoor, Reza, et al.
Pubblicazione: (2024)
RNNs, CNNs and Transformers in Human Action Recognition: A Survey and a Hybrid Model
di: Alomar, Khaled, et al.
Pubblicazione: (2024)
di: Alomar, Khaled, et al.
Pubblicazione: (2024)
Label Propagation for Zero-shot Classification with Vision-Language Models
di: Stojnić, Vladan, et al.
Pubblicazione: (2024)
di: Stojnić, Vladan, et al.
Pubblicazione: (2024)
Reflecting on the State of Rehearsal-free Continual Learning with Pretrained Models
di: Thede, Lukas, et al.
Pubblicazione: (2024)
di: Thede, Lukas, et al.
Pubblicazione: (2024)
Lightweight Unsupervised Federated Learning with Pretrained Vision Language Model
di: Yan, Hao, et al.
Pubblicazione: (2024)
di: Yan, Hao, et al.
Pubblicazione: (2024)
Multi-View and Multi-Scale Alignment for Contrastive Language-Image Pre-training in Mammography
di: Du, Yuexi, et al.
Pubblicazione: (2024)
di: Du, Yuexi, et al.
Pubblicazione: (2024)
Context-Aware Multimodal Pretraining
di: Roth, Karsten, et al.
Pubblicazione: (2024)
di: Roth, Karsten, et al.
Pubblicazione: (2024)
DeCLIP: Decoding CLIP representations for deepfake localization
di: Smeu, Stefan, et al.
Pubblicazione: (2024)
di: Smeu, Stefan, et al.
Pubblicazione: (2024)
AutoCLIP: Auto-tuning Zero-Shot Classifiers for Vision-Language Models
di: Metzen, Jan Hendrik, et al.
Pubblicazione: (2023)
di: Metzen, Jan Hendrik, et al.
Pubblicazione: (2023)
Robust CLIP: Unsupervised Adversarial Fine-Tuning of Vision Embeddings for Robust Large Vision-Language Models
di: Schlarmann, Christian, et al.
Pubblicazione: (2024)
di: Schlarmann, Christian, et al.
Pubblicazione: (2024)
A Study on Self-Supervised Pretraining for Vision Problems in Gastrointestinal Endoscopy
di: Sanderson, Edward, et al.
Pubblicazione: (2024)
di: Sanderson, Edward, et al.
Pubblicazione: (2024)
Toward Modality Gap: Vision Prototype Learning for Weakly-supervised Semantic Segmentation with CLIP
di: Xu, Zhongxing, et al.
Pubblicazione: (2024)
di: Xu, Zhongxing, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Improving Medical VQA through Trajectory-Aware Process Supervision
di: Gulluk, Halil Ibrahim, et al.
Pubblicazione: (2026) -
SemEnrich: Self-Supervised Semantic Enrichment of Radiology Reports for Vision-Language Learning
di: Gulluk, Halil Ibrahim, et al.
Pubblicazione: (2026) -
CLIP with Quality Captions: A Strong Pretraining for Vision Tasks
di: Vasu, Pavan Kumar Anasosalu, et al.
Pubblicazione: (2024) -
Region-of-Interest Augmentation for Mammography Classification under Patient-Level Cross-Validation
di: Bigdeli, Farbod, et al.
Pubblicazione: (2025) -
RankCLIP: Ranking-Consistent Language-Image Pretraining
di: Zhang, Yiming, et al.
Pubblicazione: (2024)