REVAL: A Comprehension Evaluation on Reliability and Values of Large Vision-Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Jie, Yuan, Zheng, Wang, Zhongqi, Yan, Bei, Wang, Sibo, Cao, Xiangkui, Guo, Zonghui, Shan, Shiguang, Chen, Xilin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
VLBiasBench: A Comprehensive Benchmark for Evaluating Bias in Large Vision-Language Model
por: Wang, Sibo, et al.
Publicado: (2024)
por: Wang, Sibo, et al.
Publicado: (2024)
Measuring the Measurers: Quality Evaluation of Hallucination Benchmarks for Large Vision-Language Models
por: Yan, Bei, et al.
Publicado: (2024)
por: Yan, Bei, et al.
Publicado: (2024)
Assimilation Matters: Model-level Backdoor Detection in Vision-Language Pretrained Models
por: Wang, Zhongqi, et al.
Publicado: (2025)
por: Wang, Zhongqi, et al.
Publicado: (2025)
Dysca: A Dynamic and Scalable Benchmark for Evaluating Perception Ability of LVLMs
por: Zhang, Jie, et al.
Publicado: (2024)
por: Zhang, Jie, et al.
Publicado: (2024)
MM-MoralBench: A MultiModal Moral Evaluation Benchmark for Large Vision-Language Models
por: Yan, Bei, et al.
Publicado: (2024)
por: Yan, Bei, et al.
Publicado: (2024)
Neural Gate: Mitigating Privacy Risks in LVLMs via Neuron-Level Gradient Gating
por: Cao, Xiangkui, et al.
Publicado: (2026)
por: Cao, Xiangkui, et al.
Publicado: (2026)
Dynamic Attention Analysis for Backdoor Detection in Text-to-Image Diffusion Models
por: Wang, Zhongqi, et al.
Publicado: (2025)
por: Wang, Zhongqi, et al.
Publicado: (2025)
T2IShield: Defending Against Backdoors on Text-to-Image Diffusion Models
por: Wang, Zhongqi, et al.
Publicado: (2024)
por: Wang, Zhongqi, et al.
Publicado: (2024)
What Makes VLMs Robust? Towards Reconciling Robustness and Accuracy in Vision-Language Models
por: Nie, Sen, et al.
Publicado: (2026)
por: Nie, Sen, et al.
Publicado: (2026)
Trigger without Trace: Towards Stealthy Backdoor Attack on Text-to-Image Diffusion Models
por: Zhang, Jie, et al.
Publicado: (2025)
por: Zhang, Jie, et al.
Publicado: (2025)
FullLoRA: Efficiently Boosting the Robustness of Pretrained Vision Transformers
por: Yuan, Zheng, et al.
Publicado: (2024)
por: Yuan, Zheng, et al.
Publicado: (2024)
EntropyScan: Towards Model-level Backdoor Detection in LVLMs via Visual Attention Entropy
por: Ge, Xuanyu, et al.
Publicado: (2026)
por: Ge, Xuanyu, et al.
Publicado: (2026)
Pre-trained Model Guided Fine-Tuning for Zero-Shot Adversarial Robustness
por: Wang, Sibo, et al.
Publicado: (2024)
por: Wang, Sibo, et al.
Publicado: (2024)
VOPE: Revisiting Hallucination of Vision-Language Models in Voluntary Imagination Task
por: Long, Xingming, et al.
Publicado: (2025)
por: Long, Xingming, et al.
Publicado: (2025)
ACT Now: Preempting LVLM Hallucinations via Adaptive Context Integration
por: Yan, Bei, et al.
Publicado: (2026)
por: Yan, Bei, et al.
Publicado: (2026)
Revisiting Face Forgery Detection: From Facial Representation to Forgery Detection
por: Guo, Zonghui, et al.
Publicado: (2024)
por: Guo, Zonghui, et al.
Publicado: (2024)
Multi-PA: A Multi-perspective Benchmark on Privacy Assessment for Large Vision-Language Models
por: Zhang, Jie, et al.
Publicado: (2024)
por: Zhang, Jie, et al.
Publicado: (2024)
V-Attack: Targeting Disentangled Value Features for Controllable Adversarial Attacks on LVLMs
por: Nie, Sen, et al.
Publicado: (2025)
por: Nie, Sen, et al.
Publicado: (2025)
Towards Robust Semantic Segmentation against Patch-based Attack via Attention Refinement
por: Yuan, Zheng, et al.
Publicado: (2024)
por: Yuan, Zheng, et al.
Publicado: (2024)
Rethinking the Evaluation of Out-of-Distribution Detection: A Sorites Paradox
por: Long, Xingming, et al.
Publicado: (2024)
por: Long, Xingming, et al.
Publicado: (2024)
Semantic or Covariate? A Study on the Intractable Case of Out-of-Distribution Detection
por: Long, Xingming, et al.
Publicado: (2024)
por: Long, Xingming, et al.
Publicado: (2024)
A Survey of Multimodal Hallucination Evaluation and Detection
por: Chen, Zhiyuan, et al.
Publicado: (2025)
por: Chen, Zhiyuan, et al.
Publicado: (2025)
T2VAttack: Adversarial Attack on Text-to-Video Diffusion Models
por: Li, Changzhen, et al.
Publicado: (2025)
por: Li, Changzhen, et al.
Publicado: (2025)
Contrastive Spectral Rectification: Test-Time Defense towards Zero-shot Adversarial Robustness of CLIP
por: Nie, Sen, et al.
Publicado: (2026)
por: Nie, Sen, et al.
Publicado: (2026)
SHALE: A Scalable Benchmark for Fine-grained Hallucination Evaluation in LVLMs
por: Yan, Bei, et al.
Publicado: (2025)
por: Yan, Bei, et al.
Publicado: (2025)
UMFC: Unsupervised Multi-Domain Feature Calibration for Vision-Language Models
por: Liang, Jiachen, et al.
Publicado: (2024)
por: Liang, Jiachen, et al.
Publicado: (2024)
Confidence Aware Learning for Reliable Face Anti-spoofing
por: Long, Xingming, et al.
Publicado: (2024)
por: Long, Xingming, et al.
Publicado: (2024)
GLip: A Global-Local Integrated Progressive Framework for Robust Visual Speech Recognition
por: Wang, Tianyue, et al.
Publicado: (2025)
por: Wang, Tianyue, et al.
Publicado: (2025)
Revisiting Logit Distributions for Reliable Out-of-Distribution Detection
por: Liang, Jiachen, et al.
Publicado: (2025)
por: Liang, Jiachen, et al.
Publicado: (2025)
UniPose: A Unified Multimodal Framework for Human Pose Comprehension, Generation and Editing
por: Li, Yiheng, et al.
Publicado: (2024)
por: Li, Yiheng, et al.
Publicado: (2024)
CtrLoRA: An Extensible and Efficient Framework for Controllable Image Generation
por: Xu, Yifeng, et al.
Publicado: (2024)
por: Xu, Yifeng, et al.
Publicado: (2024)
Dual Attention Guided Defense Against Malicious Edits
por: Zhang, Jie, et al.
Publicado: (2025)
por: Zhang, Jie, et al.
Publicado: (2025)
Towards Transferable Defense Against Malicious Image Edits
por: Zhang, Jie, et al.
Publicado: (2025)
por: Zhang, Jie, et al.
Publicado: (2025)
EgoMotion: Hierarchical Reasoning and Diffusion for Egocentric Vision-Language Motion Generation
por: Hou, Ruibing, et al.
Publicado: (2026)
por: Hou, Ruibing, et al.
Publicado: (2026)
INFACT: A Diagnostic Benchmark for Induced Faithfulness and Factuality Hallucinations in Video-LLMs
por: Yang, Junqi, et al.
Publicado: (2026)
por: Yang, Junqi, et al.
Publicado: (2026)
Steering Vision-Language Pre-trained Models for Incremental Face Presentation Attack Detection
por: Li, Haoze, et al.
Publicado: (2025)
por: Li, Haoze, et al.
Publicado: (2025)
Component-Based Out-of-Distribution Detection
por: Liu, Wenrui, et al.
Publicado: (2026)
por: Liu, Wenrui, et al.
Publicado: (2026)
EfficientMT: Efficient Temporal Adaptation for Motion Transfer in Text-to-Video Diffusion Models
por: Cai, Yufei, et al.
Publicado: (2025)
por: Cai, Yufei, et al.
Publicado: (2025)
Task-adaptive Q-Face
por: Sun, Haomiao, et al.
Publicado: (2024)
por: Sun, Haomiao, et al.
Publicado: (2024)
Evaluating Attribute Comprehension in Large Vision-Language Models
por: Zhang, Haiwen, et al.
Publicado: (2024)
por: Zhang, Haiwen, et al.
Publicado: (2024)
Ejemplares similares
-
VLBiasBench: A Comprehensive Benchmark for Evaluating Bias in Large Vision-Language Model
por: Wang, Sibo, et al.
Publicado: (2024) -
Measuring the Measurers: Quality Evaluation of Hallucination Benchmarks for Large Vision-Language Models
por: Yan, Bei, et al.
Publicado: (2024) -
Assimilation Matters: Model-level Backdoor Detection in Vision-Language Pretrained Models
por: Wang, Zhongqi, et al.
Publicado: (2025) -
Dysca: A Dynamic and Scalable Benchmark for Evaluating Perception Ability of LVLMs
por: Zhang, Jie, et al.
Publicado: (2024) -
MM-MoralBench: A MultiModal Moral Evaluation Benchmark for Large Vision-Language Models
por: Yan, Bei, et al.
Publicado: (2024)