XIMAGENET-12: An Explainable AI Benchmark Dataset for Model Robustness Evaluation
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Qiang, Zhang, Dan, Lei, Shengzhao, Zhao, Xun, Kamnoedboon, Porawit, Li, WeiWei, Dong, Junhao, Li, Shuyan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MHPR: Multidimensional Human Perception and Reasoning Benchmark for Large Vision-Languate Models
por: Wang, Kangkang, et al.
Publicado: (2026)
por: Wang, Kangkang, et al.
Publicado: (2026)
A Systematic Review and Meta‐Analysis of the Global Prevalence of Dry Mouth in Older Adults
por: Porawit Kamnoedboon, et al.
Publicado: (2026)
por: Porawit Kamnoedboon, et al.
Publicado: (2026)
DD-RobustBench: An Adversarial Robustness Benchmark for Dataset Distillation
por: Wu, Yifan, et al.
Publicado: (2024)
por: Wu, Yifan, et al.
Publicado: (2024)
Robust Dataset Distillation by Matching Adversarial Trajectories
por: Lai, Wei, et al.
Publicado: (2025)
por: Lai, Wei, et al.
Publicado: (2025)
MCOD: The First Challenging Benchmark for Multispectral Camouflaged Object Detection
por: Li, Yang, et al.
Publicado: (2025)
por: Li, Yang, et al.
Publicado: (2025)
LocateEdit-Bench: A Benchmark for Instruction-Based Editing Localization
por: Wu, Shiyu, et al.
Publicado: (2026)
por: Wu, Shiyu, et al.
Publicado: (2026)
Benchmarking Fish Dataset and Evaluation Metric in Keypoint Detection -- Towards Precise Fish Morphological Assessment in Aquaculture Breeding
por: Liu, Weizhen, et al.
Publicado: (2024)
por: Liu, Weizhen, et al.
Publicado: (2024)
DDFAV: Remote Sensing Large Vision Language Models Dataset and Evaluation Benchmark
por: Li, Haodong, et al.
Publicado: (2024)
por: Li, Haodong, et al.
Publicado: (2024)
Video Understanding Reward Modeling: A Robust Benchmark and Performant Reward Models
por: Wei, Yuancheng, et al.
Publicado: (2026)
por: Wei, Yuancheng, et al.
Publicado: (2026)
A Large-Scale Referring Remote Sensing Image Segmentation Dataset and Benchmark
por: Yang, Zhigang, et al.
Publicado: (2025)
por: Yang, Zhigang, et al.
Publicado: (2025)
Benchmarking Micro-action Recognition: Dataset, Methods, and Applications
por: Guo, Dan, et al.
Publicado: (2024)
por: Guo, Dan, et al.
Publicado: (2024)
Human-Activity AGV Quality Assessment: A Benchmark Dataset and an Objective Evaluation Metric
por: Zhang, Zhichao, et al.
Publicado: (2024)
por: Zhang, Zhichao, et al.
Publicado: (2024)
FunnyNodules: A Customizable Medical Dataset Tailored for Evaluating Explainable AI
por: Gallée, Luisa, et al.
Publicado: (2025)
por: Gallée, Luisa, et al.
Publicado: (2025)
M4-SAR: A Multi-Resolution, Multi-Polarization, Multi-Scene, Multi-Source Dataset and Benchmark for optical-SAR Object Detection
por: Wang, Chao, et al.
Publicado: (2025)
por: Wang, Chao, et al.
Publicado: (2025)
Benchmarking Badminton Action Recognition with a New Fine-Grained Dataset
por: Li, Qi, et al.
Publicado: (2024)
por: Li, Qi, et al.
Publicado: (2024)
AU-IQA: A Benchmark Dataset for Perceptual Quality Assessment of AI-Enhanced User-Generated Content
por: Wang, Shushi, et al.
Publicado: (2025)
por: Wang, Shushi, et al.
Publicado: (2025)
BihoT: A Large-Scale Dataset and Benchmark for Hyperspectral Camouflaged Object Tracking
por: Wang, Hanzheng, et al.
Publicado: (2024)
por: Wang, Hanzheng, et al.
Publicado: (2024)
BEARD: Benchmarking the Adversarial Robustness for Dataset Distillation
por: Zhou, Zheng, et al.
Publicado: (2024)
por: Zhou, Zheng, et al.
Publicado: (2024)
MVAD: A Benchmark Dataset for Multimodal AI-Generated Video-Audio Detection
por: Hu, Mengxue, et al.
Publicado: (2025)
por: Hu, Mengxue, et al.
Publicado: (2025)
Event-based Tiny Object Detection: A Benchmark Dataset and Baseline
por: Chen, Nuo, et al.
Publicado: (2025)
por: Chen, Nuo, et al.
Publicado: (2025)
Evaluating Durability: Benchmark Insights into Multimodal Watermarking
por: Qiu, Jielin, et al.
Publicado: (2024)
por: Qiu, Jielin, et al.
Publicado: (2024)
Exploring Spatiotemporal Feature Propagation for Video-Level Compressive Spectral Reconstruction: Dataset, Model and Benchmark
por: Cai, Lijing, et al.
Publicado: (2026)
por: Cai, Lijing, et al.
Publicado: (2026)
Adaptive Dataset Quantization
por: Li, Muquan, et al.
Publicado: (2024)
por: Li, Muquan, et al.
Publicado: (2024)
DiffCap-Bench: A Comprehensive, Challenging, Robust Benchmark for Image Difference Captioning
por: Wei, Yuancheng, et al.
Publicado: (2026)
por: Wei, Yuancheng, et al.
Publicado: (2026)
Rethinking Noise-Robust Training for Frozen Vision Foundation Models: A Cross-Dataset Benchmark with a Case Study of Small-Loss Failure
por: Li, Zitong, et al.
Publicado: (2026)
por: Li, Zitong, et al.
Publicado: (2026)
Benchmarking Robustness of Multimodal Image-Text Models under Distribution Shift
por: Qiu, Jielin, et al.
Publicado: (2022)
por: Qiu, Jielin, et al.
Publicado: (2022)
Visible-Thermal Tiny Object Detection: A Benchmark Dataset and Baselines
por: Ying, Xinyi, et al.
Publicado: (2024)
por: Ying, Xinyi, et al.
Publicado: (2024)
Explainable Forensics of Manipulated Segments in Untrimmed Long Videos
por: Feng, Yue, et al.
Publicado: (2026)
por: Feng, Yue, et al.
Publicado: (2026)
PartImageNet++ Dataset: Scaling up Part-based Models for Robust Recognition
por: Li, Xiao, et al.
Publicado: (2024)
por: Li, Xiao, et al.
Publicado: (2024)
Benchmarking Multi-dimensional AIGC Video Quality Assessment: A Dataset and Unified Model
por: Zhang, Zhichao, et al.
Publicado: (2024)
por: Zhang, Zhichao, et al.
Publicado: (2024)
Pansharpening for Thin-Cloud Contaminated Remote Sensing Images: A Unified Framework and Benchmark Dataset
por: Du, Songcheng, et al.
Publicado: (2026)
por: Du, Songcheng, et al.
Publicado: (2026)
AI-Face: A Million-Scale Demographically Annotated AI-Generated Face Dataset and Fairness Benchmark
por: Lin, Li, et al.
Publicado: (2024)
por: Lin, Li, et al.
Publicado: (2024)
Deep Robust Reversible Watermarking
por: Chen, Jiale, et al.
Publicado: (2025)
por: Chen, Jiale, et al.
Publicado: (2025)
VC-Bench: Pioneering the Video Connecting Benchmark with a Dataset and Evaluation Metrics
por: Yin, Zhiyu, et al.
Publicado: (2026)
por: Yin, Zhiyu, et al.
Publicado: (2026)
UMAD: University of Macau Anomaly Detection Benchmark Dataset
por: Li, Dong, et al.
Publicado: (2024)
por: Li, Dong, et al.
Publicado: (2024)
ForenX: Towards Explainable AI-Generated Image Detection with Multimodal Large Language Models
por: Tan, Chuangchuang, et al.
Publicado: (2025)
por: Tan, Chuangchuang, et al.
Publicado: (2025)
A Dataset and Benchmark for Copyright Infringement Unlearning from Text-to-Image Diffusion Models
por: Ma, Rui, et al.
Publicado: (2024)
por: Ma, Rui, et al.
Publicado: (2024)
Multiple Object Tracking in Video SAR: A Benchmark and Tracking Baseline
por: Chen, Haoxiang, et al.
Publicado: (2025)
por: Chen, Haoxiang, et al.
Publicado: (2025)
VGGT-CD: Training-Free Robust Registration for 3D Change Detection
por: Zhang, Wei, et al.
Publicado: (2026)
por: Zhang, Wei, et al.
Publicado: (2026)
Pore-scale Image Patch Dataset and A Comparative Evaluation of Pore-scale Facial Features
por: Li, Dong, et al.
Publicado: (2025)
por: Li, Dong, et al.
Publicado: (2025)
Ejemplares similares
-
MHPR: Multidimensional Human Perception and Reasoning Benchmark for Large Vision-Languate Models
por: Wang, Kangkang, et al.
Publicado: (2026) -
A Systematic Review and Meta‐Analysis of the Global Prevalence of Dry Mouth in Older Adults
por: Porawit Kamnoedboon, et al.
Publicado: (2026) -
DD-RobustBench: An Adversarial Robustness Benchmark for Dataset Distillation
por: Wu, Yifan, et al.
Publicado: (2024) -
Robust Dataset Distillation by Matching Adversarial Trajectories
por: Lai, Wei, et al.
Publicado: (2025) -
MCOD: The First Challenging Benchmark for Multispectral Camouflaged Object Detection
por: Li, Yang, et al.
Publicado: (2025)