Meta-Entity Driven Triplet Mining for Aligning Medical Vision-Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Ozturk, Saban, Yilmaz, Melih B., Kara, Muti, Yavuz, M. Talat, Koç, Aykut, Çukur, Tolga |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ACE-LoRA: Graph-Attentive Context Enhancement for Parameter-Efficient Adaptation of Medical Vision-Language Models
by: Aydın, M. Arda, et al.
Published: (2026)
by: Aydın, M. Arda, et al.
Published: (2026)
DenoMamba: A fused state-space model for low-dose CT denoising
by: Öztürk, Şaban, et al.
Published: (2024)
by: Öztürk, Şaban, et al.
Published: (2024)
Physics-Driven Autoregressive State Space Models for Medical Image Reconstruction
by: Kabas, Bilal, et al.
Published: (2024)
by: Kabas, Bilal, et al.
Published: (2024)
Self-Supervised MRI Reconstruction with Unrolled Diffusion Models
by: Korkmaz, Yilmaz, et al.
Published: (2023)
by: Korkmaz, Yilmaz, et al.
Published: (2023)
Bayesian Conditioned Diffusion Models for Inverse Problems
by: Güngör, Alper, et al.
Published: (2024)
by: Güngör, Alper, et al.
Published: (2024)
Self-Consistent Recursive Diffusion Bridge for Medical Image Translation
by: Arslan, Fuat, et al.
Published: (2024)
by: Arslan, Fuat, et al.
Published: (2024)
KPL: Training-Free Medical Knowledge Mining of Vision-Language Models
by: Liu, Jiaxiang, et al.
Published: (2025)
by: Liu, Jiaxiang, et al.
Published: (2025)
Beyond Gaussian Bottlenecks: Topologically Aligned Encoding of Vision-Transformer Feature Spaces
by: Bond, Andrew, et al.
Published: (2026)
by: Bond, Andrew, et al.
Published: (2026)
ECAMP: Entity-centered Context-aware Medical Vision Language Pre-training
by: Wang, Rongsheng, et al.
Published: (2023)
by: Wang, Rongsheng, et al.
Published: (2023)
Generative Autoregressive Transformers for Model-Agnostic Federated MRI Reconstruction
by: Nezhad, Valiyeh A., et al.
Published: (2025)
by: Nezhad, Valiyeh A., et al.
Published: (2025)
Towards Responsible Multimodal Medical Reasoning via Context-Aligned Vision-Language Models
by: Khan, Sumra, et al.
Published: (2026)
by: Khan, Sumra, et al.
Published: (2026)
A Vision-Language Framework for Multispectral Scene Representation Using Language-Grounded Features
by: Karanfil, Enes, et al.
Published: (2025)
by: Karanfil, Enes, et al.
Published: (2025)
HSCR: Hierarchical Self-Contrastive Rewarding for Aligning Medical Vision Language Models
by: Jiang, Songtao, et al.
Published: (2025)
by: Jiang, Songtao, et al.
Published: (2025)
Trident: Detecting Face Forgeries with Adversarial Triplet Learning
by: Kara, Mustafa Hakan, et al.
Published: (2025)
by: Kara, Mustafa Hakan, et al.
Published: (2025)
Uncertainty-Driven Expert Control: Enhancing the Reliability of Medical Vision-Language Models
by: Liang, Xiao, et al.
Published: (2025)
by: Liang, Xiao, et al.
Published: (2025)
Large Learning Rates Simultaneously Achieve Robustness to Spurious Correlations and Compressibility
by: Barsbey, Melih, et al.
Published: (2025)
by: Barsbey, Melih, et al.
Published: (2025)
Adversarial Attacks Leverage Interference Between Features in Superposition
by: Stevinson, Edward, et al.
Published: (2025)
by: Stevinson, Edward, et al.
Published: (2025)
CogVLA: Cognition-Aligned Vision-Language-Action Model via Instruction-Driven Routing & Sparsification
by: Li, Wei, et al.
Published: (2025)
by: Li, Wei, et al.
Published: (2025)
Adapting Foundation Vision-Language Models to Medical Diagnosis via Query-Driven Expert Bridging
by: Li, Yitong, et al.
Published: (2025)
by: Li, Yitong, et al.
Published: (2025)
Aligning Medical Images with General Knowledge from Large Language Models
by: Fang, Xiao, et al.
Published: (2024)
by: Fang, Xiao, et al.
Published: (2024)
Modest-Align: Data-Efficient Alignment for Vision-Language Models
by: Liu, Jiaxiang, et al.
Published: (2025)
by: Liu, Jiaxiang, et al.
Published: (2025)
ComAlign: Compositional Alignment in Vision-Language Models
by: Abdollah, Ali, et al.
Published: (2024)
by: Abdollah, Ali, et al.
Published: (2024)
On the Interaction of Compressibility and Adversarial Robustness
by: Barsbey, Melih, et al.
Published: (2025)
by: Barsbey, Melih, et al.
Published: (2025)
I2I-Mamba: Multi-modal medical image synthesis via selective state space modeling
by: Atli, Omer F., et al.
Published: (2024)
by: Atli, Omer F., et al.
Published: (2024)
HARMONY: Hidden Activation Representations and Model Output-Aware Uncertainty Estimation for Vision-Language Models
by: Mushtaq, Erum, et al.
Published: (2025)
by: Mushtaq, Erum, et al.
Published: (2025)
Interpretable Zero-Shot Learning with Locally-Aligned Vision-Language Model
by: Chen, Shiming, et al.
Published: (2025)
by: Chen, Shiming, et al.
Published: (2025)
VLMine: Long-Tail Data Mining with Vision Language Models
by: Ye, Mao, et al.
Published: (2024)
by: Ye, Mao, et al.
Published: (2024)
MetaTPT: Meta Test-time Prompt Tuning for Vision-Language Models
by: Lei, Yuqing, et al.
Published: (2025)
by: Lei, Yuqing, et al.
Published: (2025)
HUE Dataset: High-Resolution Event and Frame Sequences for Low-Light Vision
by: Ercan, Burak, et al.
Published: (2024)
by: Ercan, Burak, et al.
Published: (2024)
MicarVLMoE: A Modern Gated Cross-Aligned Vision-Language Mixture of Experts Model for Medical Image Captioning and Report Generation
by: Izhar, Amaan, et al.
Published: (2025)
by: Izhar, Amaan, et al.
Published: (2025)
MedKCO: Medical Vision-Language Pretraining via Knowledge-Driven Cognitive Orchestration
by: Zhang, Chenran, et al.
Published: (2026)
by: Zhang, Chenran, et al.
Published: (2026)
Few-shot Adaptation of Medical Vision-Language Models
by: Shakeri, Fereshteh, et al.
Published: (2024)
by: Shakeri, Fereshteh, et al.
Published: (2024)
Full Conformal Adaptation of Medical Vision-Language Models
by: Silva-Rodríguez, Julio, et al.
Published: (2025)
by: Silva-Rodríguez, Julio, et al.
Published: (2025)
On the Robustness of Medical Vision-Language Models: Are they Truly Generalizable?
by: Imam, Raza, et al.
Published: (2025)
by: Imam, Raza, et al.
Published: (2025)
Grokking at the Edge of Numerical Stability
by: Prieto, Lucas, et al.
Published: (2025)
by: Prieto, Lucas, et al.
Published: (2025)
Aligning What Vision-Language Models See and Perceive with Adaptive Information Flow
by: Liu, Chengxin, et al.
Published: (2026)
by: Liu, Chengxin, et al.
Published: (2026)
VLIC: Vision-Language Models As Perceptual Judges for Human-Aligned Image Compression
by: Sargent, Kyle, et al.
Published: (2025)
by: Sargent, Kyle, et al.
Published: (2025)
Unified Triplet-Level Hallucination Evaluation for Large Vision-Language Models
by: Wu, Junjie, et al.
Published: (2024)
by: Wu, Junjie, et al.
Published: (2024)
LLaVA-LE: Large Language-and-Vision Assistant for Lunar Exploration
by: Inal, Gokce, et al.
Published: (2026)
by: Inal, Gokce, et al.
Published: (2026)
Re-Align: Aligning Vision Language Models via Retrieval-Augmented Direct Preference Optimization
by: Xing, Shuo, et al.
Published: (2025)
by: Xing, Shuo, et al.
Published: (2025)
Similar Items
-
ACE-LoRA: Graph-Attentive Context Enhancement for Parameter-Efficient Adaptation of Medical Vision-Language Models
by: Aydın, M. Arda, et al.
Published: (2026) -
DenoMamba: A fused state-space model for low-dose CT denoising
by: Öztürk, Şaban, et al.
Published: (2024) -
Physics-Driven Autoregressive State Space Models for Medical Image Reconstruction
by: Kabas, Bilal, et al.
Published: (2024) -
Self-Supervised MRI Reconstruction with Unrolled Diffusion Models
by: Korkmaz, Yilmaz, et al.
Published: (2023) -
Bayesian Conditioned Diffusion Models for Inverse Problems
by: Güngör, Alper, et al.
Published: (2024)