Uncertainty-Aware Evaluation for Vision-Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Kostumov, Vasily, Nutfullin, Bulat, Pilipenko, Oleg, Ilyushin, Eugene |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FFF: Fixing Flawed Foundations in contrastive pre-training results in very strong Vision-Language models
por: Bulat, Adrian, et al.
Publicado: (2024)
por: Bulat, Adrian, et al.
Publicado: (2024)
VAUQ: Vision-Aware Uncertainty Quantification for LVLM Self-Evaluation
por: Park, Seongheon, et al.
Publicado: (2026)
por: Park, Seongheon, et al.
Publicado: (2026)
MedPruner: Training-Free Hierarchical Token Pruning for Efficient 3D Medical Image Understanding in Vision-Language Models
por: Liu, Shengyuan, et al.
Publicado: (2026)
por: Liu, Shengyuan, et al.
Publicado: (2026)
Hierarchy-Aware Fine-Tuning of Vision-Language Models
por: Li, Jiayu, et al.
Publicado: (2025)
por: Li, Jiayu, et al.
Publicado: (2025)
Evaluating Vision-Language Models on Bistable Images
por: Panagopoulou, Artemis, et al.
Publicado: (2024)
por: Panagopoulou, Artemis, et al.
Publicado: (2024)
Large Vision-Language Models as Emotion Recognizers in Context Awareness
por: Lei, Yuxuan, et al.
Publicado: (2024)
por: Lei, Yuxuan, et al.
Publicado: (2024)
Improving Medical Diagnostics with Vision-Language Models: Convex Hull-Based Uncertainty Analysis
por: Catak, Ferhat Ozgur, et al.
Publicado: (2024)
por: Catak, Ferhat Ozgur, et al.
Publicado: (2024)
Representation Calibration and Uncertainty Guidance for Class-Incremental Learning based on Vision Language Model
por: Tan, Jiantao, et al.
Publicado: (2025)
por: Tan, Jiantao, et al.
Publicado: (2025)
VHELM: A Holistic Evaluation of Vision Language Models
por: Lee, Tony, et al.
Publicado: (2024)
por: Lee, Tony, et al.
Publicado: (2024)
VLM4D: Towards Spatiotemporal Awareness in Vision Language Models
por: Zhou, Shijie, et al.
Publicado: (2025)
por: Zhou, Shijie, et al.
Publicado: (2025)
SIA: Enhancing Safety via Intent Awareness for Vision-Language Models
por: Na, Youngjin, et al.
Publicado: (2025)
por: Na, Youngjin, et al.
Publicado: (2025)
Uncertainty-guided Compositional Alignment with Part-to-Whole Semantic Representativeness in Hyperbolic Vision-Language Models
por: Kim, Hayeon, et al.
Publicado: (2026)
por: Kim, Hayeon, et al.
Publicado: (2026)
INSIGHT: Enhancing Autonomous Driving Safety through Vision-Language Models on Context-Aware Hazard Detection and Edge Case Evaluation
por: Chen, Dianwei, et al.
Publicado: (2025)
por: Chen, Dianwei, et al.
Publicado: (2025)
LocateBench: Evaluating the Locating Ability of Vision Language Models
por: Chiang, Ting-Rui, et al.
Publicado: (2024)
por: Chiang, Ting-Rui, et al.
Publicado: (2024)
3D-Aware Vision-Language Models Fine-Tuning with Geometric Distillation
por: Lee, Seonho, et al.
Publicado: (2025)
por: Lee, Seonho, et al.
Publicado: (2025)
QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models
por: Wang, Xinhao, et al.
Publicado: (2026)
por: Wang, Xinhao, et al.
Publicado: (2026)
ZSPAPrune: Zero-Shot Prompt-Aware Token Pruning for Vision-Language Models
por: Zhang, Pu, et al.
Publicado: (2025)
por: Zhang, Pu, et al.
Publicado: (2025)
ClaudesLens: Uncertainty Quantification in Computer Vision Models
por: Shaar, Mohamad Al, et al.
Publicado: (2024)
por: Shaar, Mohamad Al, et al.
Publicado: (2024)
DriveCritic: Towards Context-Aware, Human-Aligned Evaluation for Autonomous Driving with Vision-Language Models
por: Song, Jingyu, et al.
Publicado: (2025)
por: Song, Jingyu, et al.
Publicado: (2025)
Uncertainty-Aware Concept Bottleneck Models with Enhanced Interpretability
por: Zhang, Haifei, et al.
Publicado: (2025)
por: Zhang, Haifei, et al.
Publicado: (2025)
Multimodal RewardBench: Holistic Evaluation of Reward Models for Vision Language Models
por: Yasunaga, Michihiro, et al.
Publicado: (2025)
por: Yasunaga, Michihiro, et al.
Publicado: (2025)
TAP-VL: Text Layout-Aware Pre-training for Enriched Vision-Language Models
por: Fhima, Jonathan, et al.
Publicado: (2024)
por: Fhima, Jonathan, et al.
Publicado: (2024)
ClinCoT: Clinical-Aware Visual Chain-of-Thought for Medical Vision Language Models
por: Liu, Xiwei, et al.
Publicado: (2026)
por: Liu, Xiwei, et al.
Publicado: (2026)
Understanding Pruning Regimes in Vision-Language Models Through Domain-Aware Layer Selection
por: Khaki, Saeed, et al.
Publicado: (2026)
por: Khaki, Saeed, et al.
Publicado: (2026)
Towards a Systematic Evaluation of Hallucinations in Large-Vision Language Models
por: Seth, Ashish, et al.
Publicado: (2024)
por: Seth, Ashish, et al.
Publicado: (2024)
FlowLearn: Evaluating Large Vision-Language Models on Flowchart Understanding
por: Pan, Huitong, et al.
Publicado: (2024)
por: Pan, Huitong, et al.
Publicado: (2024)
Evaluating Vision Language Models (VLMs) for Radiology: A Comprehensive Analysis
por: Li, Frank, et al.
Publicado: (2025)
por: Li, Frank, et al.
Publicado: (2025)
Evaluation of Safety Cognition Capability in Vision-Language Models for Autonomous Driving
por: Zhang, Enming, et al.
Publicado: (2025)
por: Zhang, Enming, et al.
Publicado: (2025)
Beyond Recognition: Evaluating Visual Perspective Taking in Vision Language Models
por: Góral, Gracjan, et al.
Publicado: (2025)
por: Góral, Gracjan, et al.
Publicado: (2025)
Vision-Language Model for Object Detection and Segmentation: A Review and Evaluation
por: Feng, Yongchao, et al.
Publicado: (2025)
por: Feng, Yongchao, et al.
Publicado: (2025)
Systematic Evaluation of Large Vision-Language Models for Surgical Artificial Intelligence
por: Rau, Anita, et al.
Publicado: (2025)
por: Rau, Anita, et al.
Publicado: (2025)
Evaluating Small Vision-Language Models on Distance-Dependent Traffic Perception
por: Theodoridis, Nikos, et al.
Publicado: (2025)
por: Theodoridis, Nikos, et al.
Publicado: (2025)
On Epistemic Uncertainty of Visual Tokens for Object Hallucinations in Large Vision-Language Models
por: Seo, Hoigi, et al.
Publicado: (2025)
por: Seo, Hoigi, et al.
Publicado: (2025)
Evaluating Hallucination in Large Vision-Language Models based on Context-Aware Object Similarities
por: Datta, Shounak, et al.
Publicado: (2025)
por: Datta, Shounak, et al.
Publicado: (2025)
Cross-Cultural Value Awareness in Large Vision-Language Models
por: Howard, Phillip, et al.
Publicado: (2026)
por: Howard, Phillip, et al.
Publicado: (2026)
WildVision: Evaluating Vision-Language Models in the Wild with Human Preferences
por: Lu, Yujie, et al.
Publicado: (2024)
por: Lu, Yujie, et al.
Publicado: (2024)
Hyperbolic Safety-Aware Vision-Language Models
por: Poppi, Tobia, et al.
Publicado: (2025)
por: Poppi, Tobia, et al.
Publicado: (2025)
IDA-VLM: Towards Movie Understanding via ID-Aware Large Vision-Language Model
por: Ji, Yatai, et al.
Publicado: (2024)
por: Ji, Yatai, et al.
Publicado: (2024)
FDBPL: Faster Distillation-Based Prompt Learning for Region-Aware Vision-Language Models Adaptation
por: Zhang, Zherui, et al.
Publicado: (2025)
por: Zhang, Zherui, et al.
Publicado: (2025)
Spatial 3D-LLM: Exploring Spatial Awareness in 3D Vision-Language Models
por: Wang, Xiaoyan, et al.
Publicado: (2025)
por: Wang, Xiaoyan, et al.
Publicado: (2025)
Ejemplares similares
-
FFF: Fixing Flawed Foundations in contrastive pre-training results in very strong Vision-Language models
por: Bulat, Adrian, et al.
Publicado: (2024) -
VAUQ: Vision-Aware Uncertainty Quantification for LVLM Self-Evaluation
por: Park, Seongheon, et al.
Publicado: (2026) -
MedPruner: Training-Free Hierarchical Token Pruning for Efficient 3D Medical Image Understanding in Vision-Language Models
por: Liu, Shengyuan, et al.
Publicado: (2026) -
Hierarchy-Aware Fine-Tuning of Vision-Language Models
por: Li, Jiayu, et al.
Publicado: (2025) -
Evaluating Vision-Language Models on Bistable Images
por: Panagopoulou, Artemis, et al.
Publicado: (2024)