MMKU-Bench: A Multimodal Update Benchmark for Diverse Visual Knowledge
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Fu, Baochen, Du, Yuntao, Chang, Cheng, Jin, Baihao, Deng, Wenzhi, Xu, Muhao, Yan, Hongmei, Song, Weiye, Wan, Yi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MMKE-Bench: A Multimodal Editing Benchmark for Diverse Visual Knowledge
par: Du, Yuntao, et autres
Publié: (2025)
par: Du, Yuntao, et autres
Publié: (2025)
MINED: Probing and Updating with Multimodal Time-Sensitive Knowledge for Large Multimodal Models
par: Jiang, Kailin, et autres
Publié: (2025)
par: Jiang, Kailin, et autres
Publié: (2025)
Benchmarking Multimodal Knowledge Conflict for Large Multimodal Models
par: Jia, Yifan, et autres
Publié: (2025)
par: Jia, Yifan, et autres
Publié: (2025)
Seeking and Updating with Live Visual Knowledge
par: Fu, Mingyang, et autres
Publié: (2025)
par: Fu, Mingyang, et autres
Publié: (2025)
CLOVA: A Closed-Loop Visual Assistant with Tool Usage and Update
par: Gao, Zhi, et autres
Publié: (2023)
par: Gao, Zhi, et autres
Publié: (2023)
Fault Localization in Digital Power Distribution Networks Using a Chaotic Binary Particle Swarm Optimization–Enhanced Matrix Algorithm
par: Li Wan, et autres
Publié: (2024)
par: Li Wan, et autres
Publié: (2024)
AntiLeakBench: Preventing Data Contamination by Automatically Constructing Benchmarks with Updated Real-World Knowledge
par: Wu, Xiaobao, et autres
Publié: (2024)
par: Wu, Xiaobao, et autres
Publié: (2024)
VisBrowse-Bench: Benchmarking Visual-Native Search for Multimodal Browsing Agents
par: Zhang, Zhengbo, et autres
Publié: (2026)
par: Zhang, Zhengbo, et autres
Publié: (2026)
Can Visual Input Be Compressed? A Visual Token Compression Benchmark for Large Multimodal Models
par: Peng, Tianfan, et autres
Publié: (2025)
par: Peng, Tianfan, et autres
Publié: (2025)
Normality Prior Guided Multi-Semantic Fusion Network for Unsupervised Image Anomaly Detection
par: Xu, Muhao, et autres
Publié: (2025)
par: Xu, Muhao, et autres
Publié: (2025)
ZeroBench: An Impossible Visual Benchmark for Contemporary Large Multimodal Models
par: Roberts, Jonathan, et autres
Publié: (2025)
par: Roberts, Jonathan, et autres
Publié: (2025)
M-ErasureBench: A Comprehensive Multimodal Evaluation Benchmark for Concept Erasure in Diffusion Models
par: Weng, Ju-Hsuan, et autres
Publié: (2025)
par: Weng, Ju-Hsuan, et autres
Publié: (2025)
FlowMur: A Stealthy and Practical Audio Backdoor Attack with Limited Knowledge
par: Lan, Jiahe, et autres
Publié: (2023)
par: Lan, Jiahe, et autres
Publié: (2023)
PRISM-Bench: A Benchmark of Puzzle-Based Visual Tasks with CoT Error Detection
par: Qian, Yusu, et autres
Publié: (2025)
par: Qian, Yusu, et autres
Publié: (2025)
VP-Bench: A Comprehensive Benchmark for Visual Prompting in Multimodal Large Language Models
par: Xu, Mingjie, et autres
Publié: (2025)
par: Xu, Mingjie, et autres
Publié: (2025)
Pilot: Building the Federated Multimodal Instruction Tuning Framework
par: Xiong, Baochen, et autres
Publié: (2025)
par: Xiong, Baochen, et autres
Publié: (2025)
MU-Bench: A Multitask Multimodal Benchmark for Machine Unlearning
par: Cheng, Jiali, et autres
Publié: (2024)
par: Cheng, Jiali, et autres
Publié: (2024)
SE-Bench: Benchmarking Self-Evolution with Knowledge Internalization
par: Yuan, Jiarui, et autres
Publié: (2026)
par: Yuan, Jiarui, et autres
Publié: (2026)
Joining Entities Across Relation and Graph with a Unified Model
par: Fu, Wenzhi
Publié: (2024)
par: Fu, Wenzhi
Publié: (2024)
SEED-Bench-2-Plus: Benchmarking Multimodal Large Language Models with Text-Rich Visual Comprehension
par: Li, Bohao, et autres
Publié: (2024)
par: Li, Bohao, et autres
Publié: (2024)
VisualAgentBench: Towards Large Multimodal Models as Visual Foundation Agents
par: Liu, Xiao, et autres
Publié: (2024)
par: Liu, Xiao, et autres
Publié: (2024)
CameraBench: Benchmarking Visual Reasoning in MLLMs via Photography
par: Fang, I-Sheng, et autres
Publié: (2025)
par: Fang, I-Sheng, et autres
Publié: (2025)
BilliardPhys-Bench: Benchmarking Physical Reasoning and Visual Dynamics of Multimodal LLMs
par: Wang, Ben, et autres
Publié: (2026)
par: Wang, Ben, et autres
Publié: (2026)
PunchBench: Benchmarking MLLMs in Multimodal Punchline Comprehension
par: Ouyang, Kun, et autres
Publié: (2024)
par: Ouyang, Kun, et autres
Publié: (2024)
MVI-Bench: A Comprehensive Benchmark for Evaluating Robustness to Misleading Visual Inputs in LVLMs
par: Chen, Huiyi, et autres
Publié: (2025)
par: Chen, Huiyi, et autres
Publié: (2025)
Cross-Domain Generalization of Multimodal LLMs for Global Photovoltaic Assessment
par: Guo, Muhao, et autres
Publié: (2025)
par: Guo, Muhao, et autres
Publié: (2025)
ChartBench: A Benchmark for Complex Visual Reasoning in Charts
par: Xu, Zhengzhuo, et autres
Publié: (2023)
par: Xu, Zhengzhuo, et autres
Publié: (2023)
MMDeepResearch-Bench: A Benchmark for Multimodal Deep Research Agents
par: Huang, Peizhou, et autres
Publié: (2026)
par: Huang, Peizhou, et autres
Publié: (2026)
DeepEdit: Knowledge Editing as Decoding with Constraints
par: Wang, Yiwei, et autres
Publié: (2024)
par: Wang, Yiwei, et autres
Publié: (2024)
EVADE-Bench: Multimodal Benchmark for Evaluating and Enhancing Evasive Content Detection
par: Xu, Ancheng, et autres
Publié: (2025)
par: Xu, Ancheng, et autres
Publié: (2025)
IsoBench: Benchmarking Multimodal Foundation Models on Isomorphic Representations
par: Fu, Deqing, et autres
Publié: (2024)
par: Fu, Deqing, et autres
Publié: (2024)
AccidentBench: Benchmarking Multimodal Understanding and Reasoning in Vehicle Accidents and Beyond
par: Gu, Shangding, et autres
Publié: (2025)
par: Gu, Shangding, et autres
Publié: (2025)
OutSafe-Bench: A Benchmark for Multimodal Offensive Content Detection in Large Language Models
par: Yan, Yuping, et autres
Publié: (2025)
par: Yan, Yuping, et autres
Publié: (2025)
CodeUpdateArena: Benchmarking Knowledge Editing on API Updates
par: Liu, Zeyu Leo, et autres
Publié: (2024)
par: Liu, Zeyu Leo, et autres
Publié: (2024)
Defect‐Assisted Self‐Trapped Exciton Emission in Zero‐Dimensional K 3 InCl 6 Perovskite: Reversible Hydration Switching Toward Multimodal Anti‐Counterfeiting
par: Xianzhong Shi, et autres
Publié: (2026)
par: Xianzhong Shi, et autres
Publié: (2026)
SpatialViz-Bench: A Cognitively-Grounded Benchmark for Diagnosing Spatial Visualization in MLLMs
par: Wang, Siting, et autres
Publié: (2025)
par: Wang, Siting, et autres
Publié: (2025)
Neural Surveillance: Live-Update Visualization of Latent Training Dynamics
par: Yang, Xianglin, et autres
Publié: (2024)
par: Yang, Xianglin, et autres
Publié: (2024)
MileBench: Benchmarking MLLMs in Long Context
par: Song, Dingjie, et autres
Publié: (2024)
par: Song, Dingjie, et autres
Publié: (2024)
CodecBench: A Comprehensive Benchmark for Acoustic and Semantic Evaluation
par: Deng, Ruifan, et autres
Publié: (2025)
par: Deng, Ruifan, et autres
Publié: (2025)
FaithBench: A Diverse Hallucination Benchmark for Summarization by Modern LLMs
par: Bao, Forrest Sheng, et autres
Publié: (2024)
par: Bao, Forrest Sheng, et autres
Publié: (2024)
Documents similaires
-
MMKE-Bench: A Multimodal Editing Benchmark for Diverse Visual Knowledge
par: Du, Yuntao, et autres
Publié: (2025) -
MINED: Probing and Updating with Multimodal Time-Sensitive Knowledge for Large Multimodal Models
par: Jiang, Kailin, et autres
Publié: (2025) -
Benchmarking Multimodal Knowledge Conflict for Large Multimodal Models
par: Jia, Yifan, et autres
Publié: (2025) -
Seeking and Updating with Live Visual Knowledge
par: Fu, Mingyang, et autres
Publié: (2025) -
CLOVA: A Closed-Loop Visual Assistant with Tool Usage and Update
par: Gao, Zhi, et autres
Publié: (2023)