Saliency-Bench: A Comprehensive Benchmark for Evaluating Visual Explanations
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yifei, Song, James, Gu, Siyi, Jiang, Tianxu, Pan, Bo, Bai, Guangji, Zhao, Liang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MEGL: Multimodal Explanation-Guided Learning
di: Zhang, Yifei, et al.
Pubblicazione: (2024)
di: Zhang, Yifei, et al.
Pubblicazione: (2024)
Visual Attention Prompted Prediction and Learning
di: Zhang, Yifei, et al.
Pubblicazione: (2023)
di: Zhang, Yifei, et al.
Pubblicazione: (2023)
DUE: Dynamic Uncertainty-Aware Explanation Supervision via 3D Imputation
di: Zhao, Qilong, et al.
Pubblicazione: (2024)
di: Zhao, Qilong, et al.
Pubblicazione: (2024)
Graphical Perception of Saliency-based Model Explanations
di: Zhao, Yayan, et al.
Pubblicazione: (2024)
di: Zhao, Yayan, et al.
Pubblicazione: (2024)
ViStoryBench: Comprehensive Benchmark Suite for Story Visualization
di: Zhuang, Cailin, et al.
Pubblicazione: (2025)
di: Zhuang, Cailin, et al.
Pubblicazione: (2025)
Towards A Comprehensive Visual Saliency Explanation Framework for AI-based Face Recognition Systems
di: Lu, Yuhang, et al.
Pubblicazione: (2024)
di: Lu, Yuhang, et al.
Pubblicazione: (2024)
ICE-Bench: A Unified and Comprehensive Benchmark for Image Creating and Editing
di: Pan, Yulin, et al.
Pubblicazione: (2025)
di: Pan, Yulin, et al.
Pubblicazione: (2025)
MVI-Bench: A Comprehensive Benchmark for Evaluating Robustness to Misleading Visual Inputs in LVLMs
di: Chen, Huiyi, et al.
Pubblicazione: (2025)
di: Chen, Huiyi, et al.
Pubblicazione: (2025)
Cross-modal RAG: Sub-dimensional Text-to-Image Retrieval-Augmented Generation
di: Zhu, Mengdan, et al.
Pubblicazione: (2025)
di: Zhu, Mengdan, et al.
Pubblicazione: (2025)
OCRGenBench: A Comprehensive Benchmark for Evaluating OCR Generative Capabilities
di: Zhang, Peirong, et al.
Pubblicazione: (2025)
di: Zhang, Peirong, et al.
Pubblicazione: (2025)
VP-Bench: A Comprehensive Benchmark for Visual Prompting in Multimodal Large Language Models
di: Xu, Mingjie, et al.
Pubblicazione: (2025)
di: Xu, Mingjie, et al.
Pubblicazione: (2025)
EventBench: Towards Comprehensive Benchmarking of Event-based MLLMs
di: Liu, Shaoyu, et al.
Pubblicazione: (2025)
di: Liu, Shaoyu, et al.
Pubblicazione: (2025)
LongInsightBench: A Comprehensive Benchmark for Evaluating Omni-Modal Models on Human-Centric Long-Video Understanding
di: Han, ZhaoYang, et al.
Pubblicazione: (2025)
di: Han, ZhaoYang, et al.
Pubblicazione: (2025)
IllusionBench+: A Large-scale and Comprehensive Benchmark for Visual Illusion Understanding in Vision-Language Models
di: Zhang, Yiming, et al.
Pubblicazione: (2025)
di: Zhang, Yiming, et al.
Pubblicazione: (2025)
T2VWorldBench: A Benchmark for Evaluating World Knowledge in Text-to-Video Generation
di: Chen, Yubin, et al.
Pubblicazione: (2025)
di: Chen, Yubin, et al.
Pubblicazione: (2025)
IF-Bench: Benchmarking and Enhancing MLLMs for Infrared Images with Generative Visual Prompting
di: Zhang, Tao, et al.
Pubblicazione: (2025)
di: Zhang, Tao, et al.
Pubblicazione: (2025)
TIR-Bench: A Comprehensive Benchmark for Agentic Thinking-with-Images Reasoning
di: Li, Ming, et al.
Pubblicazione: (2025)
di: Li, Ming, et al.
Pubblicazione: (2025)
XBench: A Comprehensive Benchmark for Visual-Language Explanations in Chest Radiography
di: Luo, Haozhe, et al.
Pubblicazione: (2025)
di: Luo, Haozhe, et al.
Pubblicazione: (2025)
VTEdit-Bench: A Comprehensive Benchmark for Multi-Reference Image Editing Models in Virtual Try-On
di: Liang, Xiaoye, et al.
Pubblicazione: (2026)
di: Liang, Xiaoye, et al.
Pubblicazione: (2026)
SEED-Bench-2-Plus: Benchmarking Multimodal Large Language Models with Text-Rich Visual Comprehension
di: Li, Bohao, et al.
Pubblicazione: (2024)
di: Li, Bohao, et al.
Pubblicazione: (2024)
Relevance-guided Audio Visual Fusion for Video Saliency Prediction
di: Yu, Li, et al.
Pubblicazione: (2024)
di: Yu, Li, et al.
Pubblicazione: (2024)
VERIFY: A Benchmark of Visual Explanation and Reasoning for Investigating Multimodal Reasoning Fidelity
di: Bi, Jing, et al.
Pubblicazione: (2025)
di: Bi, Jing, et al.
Pubblicazione: (2025)
TokBench: Evaluating Your Visual Tokenizer before Visual Generation
di: Wu, Junfeng, et al.
Pubblicazione: (2025)
di: Wu, Junfeng, et al.
Pubblicazione: (2025)
GeoR-Bench: Evaluating Geoscience Visual Reasoning
di: Zheng, Yushuo, et al.
Pubblicazione: (2026)
di: Zheng, Yushuo, et al.
Pubblicazione: (2026)
FinChart-Bench: Benchmarking Financial Chart Comprehension in Vision-Language Models
di: Shu, Dong, et al.
Pubblicazione: (2025)
di: Shu, Dong, et al.
Pubblicazione: (2025)
On the Evaluation Consistency of Attribution-based Explanations
di: Duan, Jiarui, et al.
Pubblicazione: (2024)
di: Duan, Jiarui, et al.
Pubblicazione: (2024)
FineState-Bench: A Comprehensive Benchmark for Fine-Grained State Control in GUI Agents
di: Ji, Fengxian, et al.
Pubblicazione: (2025)
di: Ji, Fengxian, et al.
Pubblicazione: (2025)
UrBench: A Comprehensive Benchmark for Evaluating Large Multimodal Models in Multi-View Urban Scenarios
di: Zhou, Baichuan, et al.
Pubblicazione: (2024)
di: Zhou, Baichuan, et al.
Pubblicazione: (2024)
VST++: Efficient and Stronger Visual Saliency Transformer
di: Liu, Nian, et al.
Pubblicazione: (2023)
di: Liu, Nian, et al.
Pubblicazione: (2023)
VSAS-Bench: Real-Time Evaluation of Visual Streaming Assistant Models
di: Vasu, Pavan Kumar Anasosalu, et al.
Pubblicazione: (2026)
di: Vasu, Pavan Kumar Anasosalu, et al.
Pubblicazione: (2026)
BackdoorBench: A Comprehensive Benchmark and Analysis of Backdoor Learning
di: Wu, Baoyuan, et al.
Pubblicazione: (2024)
di: Wu, Baoyuan, et al.
Pubblicazione: (2024)
MMT-Bench: A Comprehensive Multimodal Benchmark for Evaluating Large Vision-Language Models Towards Multitask AGI
di: Ying, Kaining, et al.
Pubblicazione: (2024)
di: Ying, Kaining, et al.
Pubblicazione: (2024)
ConvBench: A Comprehensive Benchmark for 2D Convolution Primitive Evaluation
di: Alvarenga, Lucas, et al.
Pubblicazione: (2024)
di: Alvarenga, Lucas, et al.
Pubblicazione: (2024)
PAI-Bench: A Comprehensive Benchmark For Physical AI
di: Zhou, Fengzhe, et al.
Pubblicazione: (2025)
di: Zhou, Fengzhe, et al.
Pubblicazione: (2025)
PhenoBench: A Comprehensive Benchmark for Cell Phenotyping
di: Winklmayr, Claudia, et al.
Pubblicazione: (2025)
di: Winklmayr, Claudia, et al.
Pubblicazione: (2025)
MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations
di: Ma, Yubo, et al.
Pubblicazione: (2024)
di: Ma, Yubo, et al.
Pubblicazione: (2024)
Waste-Bench: A Comprehensive Benchmark for Evaluating VLLMs in Cluttered Environments
di: Ali, Muhammad, et al.
Pubblicazione: (2025)
di: Ali, Muhammad, et al.
Pubblicazione: (2025)
M-ErasureBench: A Comprehensive Multimodal Evaluation Benchmark for Concept Erasure in Diffusion Models
di: Weng, Ju-Hsuan, et al.
Pubblicazione: (2025)
di: Weng, Ju-Hsuan, et al.
Pubblicazione: (2025)
TraceAV-Bench: Benchmarking Multi-Hop Trajectory Reasoning over Long Audio-Visual Videos
di: Feng, Hengyi, et al.
Pubblicazione: (2026)
di: Feng, Hengyi, et al.
Pubblicazione: (2026)
GT23D-Bench: A Comprehensive General Text-to-3D Generation Benchmark
di: Cai, Xiao, et al.
Pubblicazione: (2024)
di: Cai, Xiao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
MEGL: Multimodal Explanation-Guided Learning
di: Zhang, Yifei, et al.
Pubblicazione: (2024) -
Visual Attention Prompted Prediction and Learning
di: Zhang, Yifei, et al.
Pubblicazione: (2023) -
DUE: Dynamic Uncertainty-Aware Explanation Supervision via 3D Imputation
di: Zhao, Qilong, et al.
Pubblicazione: (2024) -
Graphical Perception of Saliency-based Model Explanations
di: Zhao, Yayan, et al.
Pubblicazione: (2024) -
ViStoryBench: Comprehensive Benchmark Suite for Story Visualization
di: Zhuang, Cailin, et al.
Pubblicazione: (2025)