Focus on What Matters: Enhancing Medical Vision-Language Models with Automatic Attention Alignment Tuning
Fuente:
arXiv
Saved in:
| Main Authors: | Chang, Aofei, Huang, Le, Boyd, Alex James, Bhatia, Parminder, Kass-Hout, Taha, Xiao, Cao, Ma, Fenglong |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MedHEval: Benchmarking Hallucinations and Mitigation Strategies in Medical Large Vision-Language Models
by: Chang, Aofei, et al.
Published: (2025)
by: Chang, Aofei, et al.
Published: (2025)
Hyper Hawkes Processes: Interpretable Models of Marked Temporal Point Processes
by: Boyd, Alex, et al.
Published: (2025)
by: Boyd, Alex, et al.
Published: (2025)
Deep Continuous-Time State-Space Models for Marked Event Sequences
by: Chang, Yuxin, et al.
Published: (2024)
by: Chang, Yuxin, et al.
Published: (2024)
Enhancing Medical Large Vision-Language Models via Alignment Distillation
by: Chang, Aofei, et al.
Published: (2025)
by: Chang, Aofei, et al.
Published: (2025)
MammoDINO: Anatomically Aware Self-Supervision for Mammographic Images
by: Zhou, Sicheng, et al.
Published: (2025)
by: Zhou, Sicheng, et al.
Published: (2025)
Enhancing SAM with Efficient Prompting and Preference Optimization for Semi-supervised Medical Image Segmentation
by: Konwer, Aishik, et al.
Published: (2025)
by: Konwer, Aishik, et al.
Published: (2025)
Dynamic Uncertainty Ranking: Enhancing Retrieval-Augmented In-Context Learning for Long-Tail Knowledge in LLMs
by: Yu, Shuyang, et al.
Published: (2024)
by: Yu, Shuyang, et al.
Published: (2024)
BIPEFT: Budget-Guided Iterative Search for Parameter Efficient Fine-Tuning of Large Pretrained Language Models
by: Chang, Aofei, et al.
Published: (2024)
by: Chang, Aofei, et al.
Published: (2024)
Segment as You Wish -- Free-Form Language-Based Segmentation for Medical Images
by: Da, Longchao, et al.
Published: (2024)
by: Da, Longchao, et al.
Published: (2024)
Bi-level Contrastive Learning for Knowledge-Enhanced Molecule Representations
by: Jiang, Pengcheng, et al.
Published: (2023)
by: Jiang, Pengcheng, et al.
Published: (2023)
Reasoning-Enhanced Healthcare Predictions with Knowledge Graph Community Retrieval
by: Jiang, Pengcheng, et al.
Published: (2024)
by: Jiang, Pengcheng, et al.
Published: (2024)
Any Large Language Model Can Be a Reliable Judge: Debiasing with a Reasoning-based Bias Detector
by: Yang, Haoyan, et al.
Published: (2025)
by: Yang, Haoyan, et al.
Published: (2025)
Stabilizing Off-Policy Training for Long-Horizon LLM Agent via Turn-Level Importance Sampling and Clipping-Triggered Normalization
by: Li, Chenliang, et al.
Published: (2025)
by: Li, Chenliang, et al.
Published: (2025)
CoRelation: Boosting Automatic ICD Coding Through Contextualized Code Relation Learning
by: Luo, Junyu, et al.
Published: (2024)
by: Luo, Junyu, et al.
Published: (2024)
KG-FIT: Knowledge Graph Fine-Tuning Upon Open-World Knowledge
by: Jiang, Pengcheng, et al.
Published: (2024)
by: Jiang, Pengcheng, et al.
Published: (2024)
Decipher-MR: A Vision-Language Foundation Model for 3D MRI Representations
by: Yang, Zhijian, et al.
Published: (2025)
by: Yang, Zhijian, et al.
Published: (2025)
Enhancing Visual-Language Modality Alignment in Large Vision Language Models via Self-Improvement
by: Wang, Xiyao, et al.
Published: (2024)
by: Wang, Xiyao, et al.
Published: (2024)
TriSum: Learning Summarization Ability from Large Language Models with Structured Rationale
by: Jiang, Pengcheng, et al.
Published: (2024)
by: Jiang, Pengcheng, et al.
Published: (2024)
Linear Spaces of Meanings: Compositional Structures in Vision-Language Models
by: Trager, Matthew, et al.
Published: (2023)
by: Trager, Matthew, et al.
Published: (2023)
Recent Advances in Predictive Modeling with Electronic Health Records
by: Wang, Jiaqi, et al.
Published: (2024)
by: Wang, Jiaqi, et al.
Published: (2024)
Thermodynamics of the FRW Universe in Generalized Proca Theory
by: Sang, Aofei
Published: (2026)
by: Sang, Aofei
Published: (2026)
Analyst Coverage and Synchronous Knowledge Search: Evidence from a Natural Experiment
by: Fenglong Xiao
Published: (2024)
by: Fenglong Xiao
Published: (2024)
FEDKIM: Adaptive Federated Knowledge Injection into Medical Foundation Models
by: Wang, Xiaochen, et al.
Published: (2024)
by: Wang, Xiaochen, et al.
Published: (2024)
Evi-Steer: Learning to Steer Biomedical Vision-Language Models through Efficient and Generalizable Evidential Tuning
by: Koleilat, Taha, et al.
Published: (2026)
by: Koleilat, Taha, et al.
Published: (2026)
Focusing on What Matters: Object-Agent-centric Tokenization for Vision Language Action models
by: Bendikas, Rokas, et al.
Published: (2025)
by: Bendikas, Rokas, et al.
Published: (2025)
SynAT: Enhancing Security Knowledge Bases via Automatic Synthesizing Attack Tree from Crowd Discussions
by: Jiang, Ziyou, et al.
Published: (2026)
by: Jiang, Ziyou, et al.
Published: (2026)
What Matters For Safety Alignment?
by: Li, Xing, et al.
Published: (2026)
by: Li, Xing, et al.
Published: (2026)
Attention, Please! PixelSHAP Reveals What Vision-Language Models Actually Focus On
by: Goldshmidt, Roni
Published: (2025)
by: Goldshmidt, Roni
Published: (2025)
Focus Where It Matters: Graph Selective State Focused Attention Networks
by: Vashistha, Shikhar, et al.
Published: (2024)
by: Vashistha, Shikhar, et al.
Published: (2024)
Knowing Where to Focus: Attention-Guided Alignment for Text-based Person Search
by: Tan, Lei, et al.
Published: (2024)
by: Tan, Lei, et al.
Published: (2024)
Brain Effective Connectivity Estimation via Fourier Spatiotemporal Attention
by: Xiong, Wen, et al.
Published: (2025)
by: Xiong, Wen, et al.
Published: (2025)
Focus On What Matters: Separated Models For Visual-Based RL Generalization
by: Zhang, Di, et al.
Published: (2024)
by: Zhang, Di, et al.
Published: (2024)
Clean Sweep or Just a Wash? What BAL Lymphocytes Really Say About Steroid Outcomes in ILD
by: Jasmine Vakhshoorzadeh, et al.
Published: (2025)
by: Jasmine Vakhshoorzadeh, et al.
Published: (2025)
Pay Attention to What Matters
by: Silva, Pedro Luiz, et al.
Published: (2024)
by: Silva, Pedro Luiz, et al.
Published: (2024)
Medical Image Classification with KAN-Integrated Transformers and Dilated Neighborhood Attention
by: Manzari, Omid Nejati, et al.
Published: (2025)
by: Manzari, Omid Nejati, et al.
Published: (2025)
A Matter of Charge: Electrostatically Tuned Coassembly of Amphiphilic Peptides
by: Elad Arad, et al.
Published: (2024)
by: Elad Arad, et al.
Published: (2024)
Attention Guided Alignment in Efficient Vision-Language Models
by: Mahajan, Shweta, et al.
Published: (2025)
by: Mahajan, Shweta, et al.
Published: (2025)
What Makes Good Data for Alignment? A Comprehensive Study of Automatic Data Selection in Instruction Tuning
by: Liu, Wei, et al.
Published: (2023)
by: Liu, Wei, et al.
Published: (2023)
“Trees give life. Police take it”: Building and Fighting for Abolitionist Life‐Worlds, from the Weelaunee Forest to Georgia's Jails
by: Hannah Kass
Published: (2025)
by: Hannah Kass
Published: (2025)
Los 100 : sobrevivir s a lo desconocido / Kass Morgan ; traductor, Victoria Simó
by: Morgan, Kass
Published: (2014)
by: Morgan, Kass
Published: (2014)
Similar Items
-
MedHEval: Benchmarking Hallucinations and Mitigation Strategies in Medical Large Vision-Language Models
by: Chang, Aofei, et al.
Published: (2025) -
Hyper Hawkes Processes: Interpretable Models of Marked Temporal Point Processes
by: Boyd, Alex, et al.
Published: (2025) -
Deep Continuous-Time State-Space Models for Marked Event Sequences
by: Chang, Yuxin, et al.
Published: (2024) -
Enhancing Medical Large Vision-Language Models via Alignment Distillation
by: Chang, Aofei, et al.
Published: (2025) -
MammoDINO: Anatomically Aware Self-Supervision for Mammographic Images
by: Zhou, Sicheng, et al.
Published: (2025)