Salvato in:
| Autori principali: | Muppidi, Akshay, Radfar, Martin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2510.06064 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
EmoHRNet: High-Resolution Neural Network Based Speech Emotion Recognition
di: Muppidi, Akshay, et al.
Pubblicazione: (2025)
di: Muppidi, Akshay, et al.
Pubblicazione: (2025)
Interpreting Neurons in Deep Vision Networks with Language Models
di: Bai, Nicholas, et al.
Pubblicazione: (2024)
di: Bai, Nicholas, et al.
Pubblicazione: (2024)
Fairness-Aware Fine-Tuning of Vision-Language Models for Medical Glaucoma Diagnosis
di: Gu, Zijian, et al.
Pubblicazione: (2025)
di: Gu, Zijian, et al.
Pubblicazione: (2025)
PSF-Med: Measuring and Explaining Paraphrase Sensitivity in Medical Vision Language Models
di: Sadanandan, Binesh, et al.
Pubblicazione: (2026)
di: Sadanandan, Binesh, et al.
Pubblicazione: (2026)
Vision-Language Models Encode Clinical Guidelines for Concept-Based Medical Reasoning
di: Harmanani, Mohamed, et al.
Pubblicazione: (2026)
di: Harmanani, Mohamed, et al.
Pubblicazione: (2026)
Uncertainty-Aware Vision-Language Segmentation for Medical Imaging
di: Das, Aryan, et al.
Pubblicazione: (2026)
di: Das, Aryan, et al.
Pubblicazione: (2026)
Vision-Language Models for Medical Report Generation and Visual Question Answering: A Review
di: Hartsock, Iryna, et al.
Pubblicazione: (2024)
di: Hartsock, Iryna, et al.
Pubblicazione: (2024)
Benchmarking Vision, Language, & Action Models on Robotic Learning Tasks
di: Guruprasad, Pranav, et al.
Pubblicazione: (2024)
di: Guruprasad, Pranav, et al.
Pubblicazione: (2024)
Benchmarking Vision-Language Contrastive Methods for Medical Representation Learning
di: Roy, Shuvendu, et al.
Pubblicazione: (2024)
di: Roy, Shuvendu, et al.
Pubblicazione: (2024)
Calibrated and Robust Foundation Models for Vision-Language and Medical Image Tasks Under Distribution Shift
di: Khan, Behraj, et al.
Pubblicazione: (2025)
di: Khan, Behraj, et al.
Pubblicazione: (2025)
RadFlag: A Black-Box Hallucination Detection Method for Medical Vision Language Models
di: Zhang, Serena, et al.
Pubblicazione: (2024)
di: Zhang, Serena, et al.
Pubblicazione: (2024)
Efficient Medical Vision-Language Alignment Through Adapting Masked Vision Models
di: Lian, Chenyu, et al.
Pubblicazione: (2025)
di: Lian, Chenyu, et al.
Pubblicazione: (2025)
MMed-RAG: Versatile Multimodal RAG System for Medical Vision Language Models
di: Xia, Peng, et al.
Pubblicazione: (2024)
di: Xia, Peng, et al.
Pubblicazione: (2024)
DiWA: Diffusion Policy Adaptation with World Models
di: Chandra, Akshay L, et al.
Pubblicazione: (2025)
di: Chandra, Akshay L, et al.
Pubblicazione: (2025)
Post-hoc Probabilistic Vision-Language Models
di: Baumann, Anton, et al.
Pubblicazione: (2024)
di: Baumann, Anton, et al.
Pubblicazione: (2024)
PRPO: Paragraph-level Policy Optimization for Vision-Language Deepfake Detection
di: Nguyen, Tuan, et al.
Pubblicazione: (2025)
di: Nguyen, Tuan, et al.
Pubblicazione: (2025)
LLaRA: Supercharging Robot Learning Data for Vision-Language Policy
di: Li, Xiang, et al.
Pubblicazione: (2024)
di: Li, Xiang, et al.
Pubblicazione: (2024)
Light-weight Fine-tuning Method for Defending Adversarial Noise in Pre-trained Medical Vision-Language Models
di: Han, Xu, et al.
Pubblicazione: (2024)
di: Han, Xu, et al.
Pubblicazione: (2024)
MARVL: Multi-Stage Guidance for Robotic Manipulation via Vision-Language Models
di: Zhou, Xunlan, et al.
Pubblicazione: (2026)
di: Zhou, Xunlan, et al.
Pubblicazione: (2026)
Enhancing Generalization in Vision-Language-Action Models by Preserving Pretrained Representations
di: Grover, Shresth, et al.
Pubblicazione: (2025)
di: Grover, Shresth, et al.
Pubblicazione: (2025)
Semi-off-Policy Reinforcement Learning for Vision-Language Slow-Thinking Reasoning
di: Shen, Junhao, et al.
Pubblicazione: (2025)
di: Shen, Junhao, et al.
Pubblicazione: (2025)
VO-DP: Semantic-Geometric Adaptive Diffusion Policy for Vision-Only Robotic Manipulation
di: Ni, Zehao, et al.
Pubblicazione: (2025)
di: Ni, Zehao, et al.
Pubblicazione: (2025)
Vision Language Models are Biased
di: Vo, An, et al.
Pubblicazione: (2025)
di: Vo, An, et al.
Pubblicazione: (2025)
A Lightweight Large Vision-language Model for Multimodal Medical Images
di: Alsinglawi, Belal, et al.
Pubblicazione: (2025)
di: Alsinglawi, Belal, et al.
Pubblicazione: (2025)
ChatVLA: Unified Multimodal Understanding and Robot Control with Vision-Language-Action Model
di: Zhou, Zhongyi, et al.
Pubblicazione: (2025)
di: Zhou, Zhongyi, et al.
Pubblicazione: (2025)
CARES: A Comprehensive Benchmark of Trustworthiness in Medical Vision Language Models
di: Xia, Peng, et al.
Pubblicazione: (2024)
di: Xia, Peng, et al.
Pubblicazione: (2024)
Universal Pose Pretraining for Generalizable Vision-Language-Action Policies
di: Lin, Haitao, et al.
Pubblicazione: (2026)
di: Lin, Haitao, et al.
Pubblicazione: (2026)
Anatomy-VLM: A Fine-grained Vision-Language Model for Medical Interpretation
di: Gu, Difei, et al.
Pubblicazione: (2025)
di: Gu, Difei, et al.
Pubblicazione: (2025)
LLM-Guided Diagnostic Evidence Alignment for Medical Vision-Language Pretraining under Limited Pairing
di: Yan, Huimin, et al.
Pubblicazione: (2026)
di: Yan, Huimin, et al.
Pubblicazione: (2026)
Utilizing Synthetic Data for Medical Vision-Language Pre-training: Bypassing the Need for Real Images
di: Liu, Che, et al.
Pubblicazione: (2023)
di: Liu, Che, et al.
Pubblicazione: (2023)
STLLaVA-Med: Self-Training Large Language and Vision Assistant for Medical Question-Answering
di: Sun, Guohao, et al.
Pubblicazione: (2024)
di: Sun, Guohao, et al.
Pubblicazione: (2024)
Do Vision Foundation Models Enhance Domain Generalization in Medical Image Segmentation?
di: Cekmeceli, Kerem, et al.
Pubblicazione: (2024)
di: Cekmeceli, Kerem, et al.
Pubblicazione: (2024)
Stable Vision Concept Transformers for Medical Diagnosis
di: Hu, Lijie, et al.
Pubblicazione: (2025)
di: Hu, Lijie, et al.
Pubblicazione: (2025)
Improving Medical Large Vision-Language Models with Abnormal-Aware Feedback
di: Zhou, Yucheng, et al.
Pubblicazione: (2025)
di: Zhou, Yucheng, et al.
Pubblicazione: (2025)
Understanding Task Transfer in Vision-Language Models
di: Sachdeva, Bhuvan, et al.
Pubblicazione: (2025)
di: Sachdeva, Bhuvan, et al.
Pubblicazione: (2025)
Neutral-Reference Prompting for Vision-Language Models
di: Tian, Senmao, et al.
Pubblicazione: (2026)
di: Tian, Senmao, et al.
Pubblicazione: (2026)
Learning without Forgetting for Vision-Language Models
di: Zhou, Da-Wei, et al.
Pubblicazione: (2023)
di: Zhou, Da-Wei, et al.
Pubblicazione: (2023)
Déjà Vu Memorization in Vision-Language Models
di: Jayaraman, Bargav, et al.
Pubblicazione: (2024)
di: Jayaraman, Bargav, et al.
Pubblicazione: (2024)
Time-to-Event Pretraining for 3D Medical Imaging
di: Huo, Zepeng, et al.
Pubblicazione: (2024)
di: Huo, Zepeng, et al.
Pubblicazione: (2024)
Exploring Transfer Learning in Medical Image Segmentation using Vision-Language Models
di: Poudel, Kanchan, et al.
Pubblicazione: (2023)
di: Poudel, Kanchan, et al.
Pubblicazione: (2023)
Documenti analoghi
-
EmoHRNet: High-Resolution Neural Network Based Speech Emotion Recognition
di: Muppidi, Akshay, et al.
Pubblicazione: (2025) -
Interpreting Neurons in Deep Vision Networks with Language Models
di: Bai, Nicholas, et al.
Pubblicazione: (2024) -
Fairness-Aware Fine-Tuning of Vision-Language Models for Medical Glaucoma Diagnosis
di: Gu, Zijian, et al.
Pubblicazione: (2025) -
PSF-Med: Measuring and Explaining Paraphrase Sensitivity in Medical Vision Language Models
di: Sadanandan, Binesh, et al.
Pubblicazione: (2026) -
Vision-Language Models Encode Clinical Guidelines for Concept-Based Medical Reasoning
di: Harmanani, Mohamed, et al.
Pubblicazione: (2026)