OODBench: Out-of-Distribution Benchmark for Large Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lin, Ling, Bai, Yang, Su, Heng, Zhu, Congcong, Wang, Yaoxing, Zhou, Yang, Fu, Huazhu, Chen, Jingrun |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
R4-CGQA: Retrieval-based Vision Language Models for Computer Graphics Image Quality Assessment
par: Li, Zhuangzi, et autres
Publié: (2026)
par: Li, Zhuangzi, et autres
Publié: (2026)
MarineEval: Assessing the Marine Intelligence of Vision-Language Models
par: Wong, YuK-Kwan, et autres
Publié: (2025)
par: Wong, YuK-Kwan, et autres
Publié: (2025)
Vision meets algae: A novel way for microalgae recognization and health monitor
par: Zhou, Shizheng, et autres
Publié: (2022)
par: Zhou, Shizheng, et autres
Publié: (2022)
Harnessing Large Language and Vision-Language Models for Robust Out-of-Distribution Detection
par: Lee, Pei-Kang, et autres
Publié: (2025)
par: Lee, Pei-Kang, et autres
Publié: (2025)
OS-W2S: An Automatic Labeling Engine for Language-Guided Open-Set Aerial Object Detection
par: Wei, Guoting, et autres
Publié: (2025)
par: Wei, Guoting, et autres
Publié: (2025)
FineState-Bench: Benchmarking State-Conditioned Grounding for Fine-grained GUI State Setting
par: Ji, Fengxian, et autres
Publié: (2026)
par: Ji, Fengxian, et autres
Publié: (2026)
Delving into Out-of-Distribution Detection with Medical Vision-Language Models
par: Ju, Lie, et autres
Publié: (2025)
par: Ju, Lie, et autres
Publié: (2025)
Vision-Language Model IP Protection via Prompt-based Learning
par: Wang, Lianyu, et autres
Publié: (2025)
par: Wang, Lianyu, et autres
Publié: (2025)
Backdooring Vision-Language Models with Out-Of-Distribution Data
par: Lyu, Weimin, et autres
Publié: (2024)
par: Lyu, Weimin, et autres
Publié: (2024)
YUV20K: A Complexity-Driven Benchmark and Trajectory-Aware Alignment Model for Video Camouflaged Object Detection
par: Liu, Yiyu, et autres
Publié: (2026)
par: Liu, Yiyu, et autres
Publié: (2026)
DPCD: A Quality Assessment Database for Dynamic Point Clouds
par: Liu, Yating, et autres
Publié: (2025)
par: Liu, Yating, et autres
Publié: (2025)
Out-Of-Distribution Detection with Diversification (Provably)
par: Yao, Haiyun, et autres
Publié: (2024)
par: Yao, Haiyun, et autres
Publié: (2024)
STSA: Spatial-Temporal Semantic Alignment for Visual Dubbing
par: Ding, Zijun, et autres
Publié: (2025)
par: Ding, Zijun, et autres
Publié: (2025)
Phase Matching for Out-of-Distribution Generalization
par: Hu, Chengming, et autres
Publié: (2023)
par: Hu, Chengming, et autres
Publié: (2023)
Vision Also You Need: Navigating Out-of-Distribution Detection with Multimodal Large Language Model
par: Xu, Haoran, et autres
Publié: (2026)
par: Xu, Haoran, et autres
Publié: (2026)
Vivim: a Video Vision Mamba for Medical Video Segmentation
par: Yang, Yijun, et autres
Publié: (2024)
par: Yang, Yijun, et autres
Publié: (2024)
Benchmarking and Improving Large Vision-Language Models for Fundamental Visual Graph Understanding and Reasoning
par: Zhu, Yingjie, et autres
Publié: (2024)
par: Zhu, Yingjie, et autres
Publié: (2024)
ORIC: Benchmarking Object Recognition under Contextual Incongruity in Large Vision-Language Models
par: Li, Zhaoyang, et autres
Publié: (2025)
par: Li, Zhaoyang, et autres
Publié: (2025)
Few-Shot Learning from Gigapixel Images via Hierarchical Vision-Language Alignment and Modeling
par: Wong, Bryan, et autres
Publié: (2025)
par: Wong, Bryan, et autres
Publié: (2025)
A Benchmark and Evaluation for Real-World Out-of-Distribution Detection Using Vision-Language Models
par: Noda, Shiho, et autres
Publié: (2025)
par: Noda, Shiho, et autres
Publié: (2025)
K-FACE: A Large-Scale KIST Face Database in Consideration with Unconstrained Environments
par: Choi, Yeji, et autres
Publié: (2021)
par: Choi, Yeji, et autres
Publié: (2021)
OmniEarth: A Benchmark for Evaluating Vision-Language Models in Geospatial Tasks
par: Fu, Ronghao, et autres
Publié: (2026)
par: Fu, Ronghao, et autres
Publié: (2026)
Reducing Hallucination in Vision-Language Models via Stage-wise Preference Optimization under Distribution Shift
par: Xu, Qinwu
Publié: (2026)
par: Xu, Qinwu
Publié: (2026)
Out-of-Distribution Detection Using Peer-Class Generated by Large Language Model
par: Huang, K, et autres
Publié: (2024)
par: Huang, K, et autres
Publié: (2024)
TokBench: Evaluating Your Visual Tokenizer before Visual Generation
par: Wu, Junfeng, et autres
Publié: (2025)
par: Wu, Junfeng, et autres
Publié: (2025)
LEAML: Label-Efficient Adaptation to Out-of-Distribution Visual Tasks for Multimodal Large Language Models
par: Lin, Ci-Siang, et autres
Publié: (2025)
par: Lin, Ci-Siang, et autres
Publié: (2025)
AutoTrust: Benchmarking Trustworthiness in Large Vision Language Models for Autonomous Driving
par: Xing, Shuo, et autres
Publié: (2024)
par: Xing, Shuo, et autres
Publié: (2024)
TextAlign: Preference Alignment for Text Rendering with Hierarchical Rewards
par: Cui, Mingxuan, et autres
Publié: (2026)
par: Cui, Mingxuan, et autres
Publié: (2026)
STLLaVA-Med: Self-Training Large Language and Vision Assistant for Medical Question-Answering
par: Sun, Guohao, et autres
Publié: (2024)
par: Sun, Guohao, et autres
Publié: (2024)
DarkDriving: A Real-World Day and Night Aligned Dataset for Autonomous Driving in the Dark Environment
par: Wang, Wuqi, et autres
Publié: (2026)
par: Wang, Wuqi, et autres
Publié: (2026)
MLLM4TS: Leveraging Vision and Multimodal Language Models for General Time-Series Analysis
par: Liu, Qinghua, et autres
Publié: (2025)
par: Liu, Qinghua, et autres
Publié: (2025)
TWIX: Automatically Reconstructing Structured Data from Templatized Documents
par: Lin, Yiming, et autres
Publié: (2025)
par: Lin, Yiming, et autres
Publié: (2025)
Is Dataset Quality Still a Concern in Diagnosis Using Large Foundation Model?
par: Lin, Ziqin, et autres
Publié: (2024)
par: Lin, Ziqin, et autres
Publié: (2024)
Knowledge Regularized Negative Feature Tuning of Vision-Language Models for Out-of-Distribution Detection
par: Zhu, Wenjie, et autres
Publié: (2025)
par: Zhu, Wenjie, et autres
Publié: (2025)
On the Out-Of-Distribution Generalization of Multimodal Large Language Models
par: Zhang, Xingxuan, et autres
Publié: (2024)
par: Zhang, Xingxuan, et autres
Publié: (2024)
LOVO: Efficient Complex Object Query in Large-Scale Video Datasets
par: Liu, Yuxin, et autres
Publié: (2025)
par: Liu, Yuxin, et autres
Publié: (2025)
BACON: Improving Clarity of Image Captions via Bag-of-Concept Graphs
par: Yang, Zhantao, et autres
Publié: (2024)
par: Yang, Zhantao, et autres
Publié: (2024)
MMVR: Millimeter-wave Multi-View Radar Dataset and Benchmark for Indoor Perception
par: Rahman, M. Mahbubur, et autres
Publié: (2024)
par: Rahman, M. Mahbubur, et autres
Publié: (2024)
ViLa-MIL: Dual-scale Vision-Language Multiple Instance Learning for Whole Slide Image Classification
par: Shi, Jiangbo, et autres
Publié: (2025)
par: Shi, Jiangbo, et autres
Publié: (2025)
UniVRSE: Unified Vision-conditioned Response Semantic Entropy for Hallucination Detection in Medical Vision-Language Models
par: Liao, Zehui, et autres
Publié: (2025)
par: Liao, Zehui, et autres
Publié: (2025)
Documents similaires
-
R4-CGQA: Retrieval-based Vision Language Models for Computer Graphics Image Quality Assessment
par: Li, Zhuangzi, et autres
Publié: (2026) -
MarineEval: Assessing the Marine Intelligence of Vision-Language Models
par: Wong, YuK-Kwan, et autres
Publié: (2025) -
Vision meets algae: A novel way for microalgae recognization and health monitor
par: Zhou, Shizheng, et autres
Publié: (2022) -
Harnessing Large Language and Vision-Language Models for Robust Out-of-Distribution Detection
par: Lee, Pei-Kang, et autres
Publié: (2025) -
OS-W2S: An Automatic Labeling Engine for Language-Guided Open-Set Aerial Object Detection
par: Wei, Guoting, et autres
Publié: (2025)