VNU-Bench: A Benchmarking Dataset for Multi-Source Multimodal News Video Understanding
Fuente:
arXiv
Saved in:
| Main Authors: | Liu, Zibo, Li, Muyang, Jiang, Zhe, Chen, Shigang |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Multi-View Neural Differential Equations for Continuous-Time Stream Data in Long-Term Traffic Forecasting
by: Liu, Zibo, et al.
Published: (2024)
by: Liu, Zibo, et al.
Published: (2024)
Spatio-Temporal Partial Sensing Forecast for Long-term Traffic
by: Liu, Zibo, et al.
Published: (2024)
by: Liu, Zibo, et al.
Published: (2024)
Spatio-temporal Multivariate Time Series Forecast with Chosen Variables
by: Liu, Zibo, et al.
Published: (2025)
by: Liu, Zibo, et al.
Published: (2025)
AccidentBench: Benchmarking Multimodal Understanding and Reasoning in Vehicle Accidents and Beyond
by: Gu, Shangding, et al.
Published: (2025)
by: Gu, Shangding, et al.
Published: (2025)
LongVideoBench: A Benchmark for Long-context Interleaved Video-Language Understanding
by: Wu, Haoning, et al.
Published: (2024)
by: Wu, Haoning, et al.
Published: (2024)
TemporalBench: Benchmarking Fine-grained Temporal Understanding for Multimodal Video Models
by: Cai, Mu, et al.
Published: (2024)
by: Cai, Mu, et al.
Published: (2024)
XTSFormer: Cross-Temporal-Scale Transformer for Irregular-Time Event Prediction in Clinical Applications
by: Xiao, Tingsong, et al.
Published: (2024)
by: Xiao, Tingsong, et al.
Published: (2024)
EarthSpatialBench: Benchmarking Spatial Reasoning Capabilities of Multimodal LLMs on Earth Imagery
by: Xu, Zelin, et al.
Published: (2026)
by: Xu, Zelin, et al.
Published: (2026)
MRAMG-Bench: A Comprehensive Benchmark for Advancing Multimodal Retrieval-Augmented Multimodal Generation
by: Yu, Qinhan, et al.
Published: (2025)
by: Yu, Qinhan, et al.
Published: (2025)
RouterBench: A Benchmark for Multi-LLM Routing System
by: Hu, Qitian Jason, et al.
Published: (2024)
by: Hu, Qitian Jason, et al.
Published: (2024)
FedRS-Bench: Realistic Federated Learning Datasets and Benchmarks in Remote Sensing
by: Zhao, Haodong, et al.
Published: (2025)
by: Zhao, Haodong, et al.
Published: (2025)
S2SServiceBench: A Multimodal Benchmark for Last-Mile S2S Climate Services
by: Li, Chenyue, et al.
Published: (2026)
by: Li, Chenyue, et al.
Published: (2026)
VideoMarkBench: Benchmarking Robustness of Video Watermarking
by: Jiang, Zhengyuan, et al.
Published: (2025)
by: Jiang, Zhengyuan, et al.
Published: (2025)
NYU CTF Bench: A Scalable Open-Source Benchmark Dataset for Evaluating LLMs in Offensive Security
by: Shao, Minghao, et al.
Published: (2024)
by: Shao, Minghao, et al.
Published: (2024)
EpiCastBench: Datasets and Benchmarks for Multivariate Epidemic Forecasting
by: Panja, Madhurima, et al.
Published: (2026)
by: Panja, Madhurima, et al.
Published: (2026)
MU-Bench: A Multitask Multimodal Benchmark for Machine Unlearning
by: Cheng, Jiali, et al.
Published: (2024)
by: Cheng, Jiali, et al.
Published: (2024)
TSFM-Bench: A Comprehensive and Unified Benchmark of Foundation Models for Time Series Forecasting
by: Li, Zhe, et al.
Published: (2024)
by: Li, Zhe, et al.
Published: (2024)
GraphAllocBench: A Flexible Benchmark for Preference-Conditioned Multi-Objective Policy Learning
by: Jiang, Zhiheng, et al.
Published: (2026)
by: Jiang, Zhiheng, et al.
Published: (2026)
QCircuitBench: A Large-Scale Dataset for Benchmarking Quantum Algorithm Design
by: Yang, Rui, et al.
Published: (2024)
by: Yang, Rui, et al.
Published: (2024)
OceanForecastBench: A Benchmark Dataset for Data-Driven Global Ocean Forecasting
by: Jia, Haoming, et al.
Published: (2025)
by: Jia, Haoming, et al.
Published: (2025)
CHIMERA-Bench: A Benchmark Dataset for Epitope-Specific Antibody Design
by: Ahmed, Mansoor, et al.
Published: (2026)
by: Ahmed, Mansoor, et al.
Published: (2026)
MMSciBench: Benchmarking Language Models on Chinese Multimodal Scientific Problems
by: Ye, Xinwu, et al.
Published: (2025)
by: Ye, Xinwu, et al.
Published: (2025)
DanmakuTPPBench: A Multi-modal Benchmark for Temporal Point Process Modeling and Understanding
by: Jiang, Yue, et al.
Published: (2025)
by: Jiang, Yue, et al.
Published: (2025)
JailNewsBench: Multi-Lingual and Regional Benchmark for Fake News Generation under Jailbreak Attacks
by: Kaneko, Masahiro, et al.
Published: (2026)
by: Kaneko, Masahiro, et al.
Published: (2026)
Biology-Instructions: A Dataset and Benchmark for Multi-Omics Sequence Understanding Capability of Large Language Models
by: He, Haonan, et al.
Published: (2024)
by: He, Haonan, et al.
Published: (2024)
Landsat-Bench: Datasets and Benchmarks for Landsat Foundation Models
by: Corley, Isaac, et al.
Published: (2025)
by: Corley, Isaac, et al.
Published: (2025)
Large-Scale Mixed-Traffic and Intersection Control using Multi-agent Reinforcement Learning
by: Liu, Songyang, et al.
Published: (2025)
by: Liu, Songyang, et al.
Published: (2025)
OutSafe-Bench: A Benchmark for Multimodal Offensive Content Detection in Large Language Models
by: Yan, Yuping, et al.
Published: (2025)
by: Yan, Yuping, et al.
Published: (2025)
MultiKernelBench: A Multi-Platform Benchmark for Kernel Generation
by: Wen, Zhongzhen, et al.
Published: (2025)
by: Wen, Zhongzhen, et al.
Published: (2025)
TeleEmbedBench: A Multi-Corpus Embedding Benchmark for RAG in Telecommunications
by: Gajjar, Pranshav, et al.
Published: (2026)
by: Gajjar, Pranshav, et al.
Published: (2026)
OSS-Bench: Benchmark Generator for Coding LLMs
by: Jiang, Yuancheng, et al.
Published: (2025)
by: Jiang, Yuancheng, et al.
Published: (2025)
Large-scale Dataset Pruning with Dynamic Uncertainty
by: He, Muyang, et al.
Published: (2023)
by: He, Muyang, et al.
Published: (2023)
Benchmarking Multimodal Variational Autoencoders: CdSprites+ Dataset and Toolkit
by: Sejnova, Gabriela, et al.
Published: (2022)
by: Sejnova, Gabriela, et al.
Published: (2022)
Deep-Bench: Deep Learning Benchmark Dataset for Code Generation
by: Daghighfarsoodeh, Alireza, et al.
Published: (2025)
by: Daghighfarsoodeh, Alireza, et al.
Published: (2025)
MacrOData: New Benchmarks of Thousands of Datasets for Tabular Outlier Detection
by: Ding, Xueying, et al.
Published: (2026)
by: Ding, Xueying, et al.
Published: (2026)
BuildingsBench: A Large-Scale Dataset of 900K Buildings and Benchmark for Short-Term Load Forecasting
by: Emami, Patrick, et al.
Published: (2023)
by: Emami, Patrick, et al.
Published: (2023)
GC-Bench: An Open and Unified Benchmark for Graph Condensation
by: Sun, Qingyun, et al.
Published: (2024)
by: Sun, Qingyun, et al.
Published: (2024)
KernelBenchX: A Comprehensive Benchmark for Evaluating LLM-Generated GPU Kernels
by: Wang, Han, et al.
Published: (2026)
by: Wang, Han, et al.
Published: (2026)
MIKE: A New Benchmark for Fine-grained Multimodal Entity Knowledge Editing
by: Li, Jiaqi, et al.
Published: (2024)
by: Li, Jiaqi, et al.
Published: (2024)
BackdoorBench: A Comprehensive Benchmark and Analysis of Backdoor Learning
by: Wu, Baoyuan, et al.
Published: (2024)
by: Wu, Baoyuan, et al.
Published: (2024)
Similar Items
-
Multi-View Neural Differential Equations for Continuous-Time Stream Data in Long-Term Traffic Forecasting
by: Liu, Zibo, et al.
Published: (2024) -
Spatio-Temporal Partial Sensing Forecast for Long-term Traffic
by: Liu, Zibo, et al.
Published: (2024) -
Spatio-temporal Multivariate Time Series Forecast with Chosen Variables
by: Liu, Zibo, et al.
Published: (2025) -
AccidentBench: Benchmarking Multimodal Understanding and Reasoning in Vehicle Accidents and Beyond
by: Gu, Shangding, et al.
Published: (2025) -
LongVideoBench: A Benchmark for Long-context Interleaved Video-Language Understanding
by: Wu, Haoning, et al.
Published: (2024)