SciVQR: A Multidisciplinary Multimodal Benchmark for Advanced Scientific Reasoning Evaluation
Fuente:
arXiv
Guardado en:
| Autores principales: | Guo, Longteng, Lin, Xuanxu, Hao, Dongze, Yue, Tongtian, Huo, Pengkang, Ma, Jiatong, Liu, Yuchen, Liu, Jing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
M$^3$-VQA: A Benchmark for Multimodal, Multi-Entity, Multi-Hop Visual Question Answering
por: Ma, Jiatong, et al.
Publicado: (2026)
por: Ma, Jiatong, et al.
Publicado: (2026)
S1-MMAlign: A Large-Scale, Multi-Disciplinary Dataset for Scientific Figure-Text Understanding
por: Wang, He, et al.
Publicado: (2026)
por: Wang, He, et al.
Publicado: (2026)
Can MLLMs Reason Beyond Language? VisReason: A Comprehensive Benchmark for Vision-Centric Reasoning
por: Guo, Longteng, et al.
Publicado: (2026)
por: Guo, Longteng, et al.
Publicado: (2026)
Ada-K Routing: Boosting the Efficiency of MoE-based LLMs
por: Yue, Tongtian, et al.
Publicado: (2024)
por: Yue, Tongtian, et al.
Publicado: (2024)
Self-Bootstrapped Visual-Language Model for Knowledge Selection and Question Answering
por: Hao, Dongze, et al.
Publicado: (2024)
por: Hao, Dongze, et al.
Publicado: (2024)
Needle In A Video Haystack: A Scalable Synthetic Evaluator for Video MLLMs
por: Zhao, Zijia, et al.
Publicado: (2024)
por: Zhao, Zijia, et al.
Publicado: (2024)
OneDiff: A Generalist Model for Image Difference Captioning
por: Hu, Erdong, et al.
Publicado: (2024)
por: Hu, Erdong, et al.
Publicado: (2024)
Efficient Motion-Aware Video MLLM
por: Zhao, Zijia, et al.
Publicado: (2025)
por: Zhao, Zijia, et al.
Publicado: (2025)
Mario: Multimodal Graph Reasoning with Large Language Models
por: Sun, Yuanfu, et al.
Publicado: (2026)
por: Sun, Yuanfu, et al.
Publicado: (2026)
SciMDR: Advancing Scientific Multimodal Document Reasoning
por: Chen, Ziyu, et al.
Publicado: (2026)
por: Chen, Ziyu, et al.
Publicado: (2026)
LaVi: Efficient Large Vision-Language Models via Internal Feature Modulation
por: Yue, Tongtian, et al.
Publicado: (2025)
por: Yue, Tongtian, et al.
Publicado: (2025)
BrainGPT: Unleashing the Potential of EEG Generalist Foundation Model by Autoregressive Pre-training
por: Yue, Tongtian, et al.
Publicado: (2024)
por: Yue, Tongtian, et al.
Publicado: (2024)
Unveiling Parts Beyond Objects:Towards Finer-Granularity Referring Expression Segmentation
por: Wang, Wenxuan, et al.
Publicado: (2023)
por: Wang, Wenxuan, et al.
Publicado: (2023)
ATLAS: A High-Difficulty, Multidisciplinary Benchmark for Frontier Scientific Reasoning
por: Liu, Hongwei, et al.
Publicado: (2025)
por: Liu, Hongwei, et al.
Publicado: (2025)
Prefix Grouper: Efficient GRPO Training through Shared-Prefix Forward
por: Liu, Zikang, et al.
Publicado: (2025)
por: Liu, Zikang, et al.
Publicado: (2025)
VRoPE: Rotary Position Embedding for Video Large Language Models
por: Liu, Zikang, et al.
Publicado: (2025)
por: Liu, Zikang, et al.
Publicado: (2025)
Towards Unified Referring Expression Segmentation Across Omni-Level Visual Target Granularities
por: Liu, Jing, et al.
Publicado: (2025)
por: Liu, Jing, et al.
Publicado: (2025)
ChatSearch: a Dataset and a Generative Retrieval Model for General Conversational Image Retrieval
por: Zhao, Zijia, et al.
Publicado: (2024)
por: Zhao, Zijia, et al.
Publicado: (2024)
WildSci: Advancing Scientific Reasoning from In-the-Wild Literature
por: Liu, Tengxiao, et al.
Publicado: (2026)
por: Liu, Tengxiao, et al.
Publicado: (2026)
SciVideoBench: Benchmarking Scientific Video Reasoning in Large Multimodal Models
por: Deng, Andong, et al.
Publicado: (2025)
por: Deng, Andong, et al.
Publicado: (2025)
Knowledge Condensation and Reasoning for Knowledge-based VQA
por: Hao, Dongze, et al.
Publicado: (2024)
por: Hao, Dongze, et al.
Publicado: (2024)
SC-Tune: Unleashing Self-Consistent Referential Comprehension in Large Vision Language Models
por: Yue, Tongtian, et al.
Publicado: (2024)
por: Yue, Tongtian, et al.
Publicado: (2024)
SciReasoner: Laying the Scientific Reasoning Ground Across Disciplines
por: Wang, Yizhou, et al.
Publicado: (2025)
por: Wang, Yizhou, et al.
Publicado: (2025)
SciFIBench: Benchmarking Large Multimodal Models for Scientific Figure Interpretation
por: Roberts, Jonathan, et al.
Publicado: (2024)
por: Roberts, Jonathan, et al.
Publicado: (2024)
SciVisAgentBench: A Benchmark for Evaluating Scientific Data Analysis and Visualization Agents
por: Ai, Kuangshi, et al.
Publicado: (2026)
por: Ai, Kuangshi, et al.
Publicado: (2026)
PaperArena: An Evaluation Benchmark for Tool-Augmented Agentic Reasoning on Scientific Literature
por: Wang, Daoyu, et al.
Publicado: (2025)
por: Wang, Daoyu, et al.
Publicado: (2025)
Does Table Source Matter? Benchmarking and Improving Multimodal Scientific Table Understanding and Reasoning
por: Yang, Bohao, et al.
Publicado: (2025)
por: Yang, Bohao, et al.
Publicado: (2025)
Breaking the Encoder Barrier for Seamless Video-Language Understanding
por: Li, Handong, et al.
Publicado: (2025)
por: Li, Handong, et al.
Publicado: (2025)
SciAgent: Tool-augmented Language Models for Scientific Reasoning
por: Ma, Yubo, et al.
Publicado: (2024)
por: Ma, Yubo, et al.
Publicado: (2024)
Position: Multimodal Large Language Models Can Significantly Advance Scientific Reasoning
por: Yan, Yibo, et al.
Publicado: (2025)
por: Yan, Yibo, et al.
Publicado: (2025)
SciIF: Benchmarking Scientific Instruction Following Towards Rigorous Scientific Intelligence
por: Su, Encheng, et al.
Publicado: (2026)
por: Su, Encheng, et al.
Publicado: (2026)
SciVer: Evaluating Foundation Models for Multimodal Scientific Claim Verification
por: Wang, Chengye, et al.
Publicado: (2025)
por: Wang, Chengye, et al.
Publicado: (2025)
SciMMIR: Benchmarking Scientific Multi-modal Information Retrieval
por: Wu, Siwei, et al.
Publicado: (2024)
por: Wu, Siwei, et al.
Publicado: (2024)
SciAgent: A Unified Multi-Agent System for Generalistic Scientific Reasoning
por: Li, Xuchen, et al.
Publicado: (2025)
por: Li, Xuchen, et al.
Publicado: (2025)
SciEval: A Multi-Level Large Language Model Evaluation Benchmark for Scientific Research
por: Sun, Liangtai, et al.
Publicado: (2023)
por: Sun, Liangtai, et al.
Publicado: (2023)
MRMR: A Realistic and Expert-Level Multidisciplinary Benchmark for Reasoning-Intensive Multimodal Retrieval
por: Zhang, Siyue, et al.
Publicado: (2025)
por: Zhang, Siyue, et al.
Publicado: (2025)
SciAssess: Benchmarking LLM Proficiency in Scientific Literature Analysis
por: Cai, Hengxing, et al.
Publicado: (2024)
por: Cai, Hengxing, et al.
Publicado: (2024)
2nd Place Solution for MeViS Track in CVPR 2024 PVUW Workshop: Motion Expression guided Video Segmentation
por: Cao, Bin, et al.
Publicado: (2024)
por: Cao, Bin, et al.
Publicado: (2024)
AdaSpark: Adaptive Sparsity for Efficient Long-Video Understanding
por: Li, Handong, et al.
Publicado: (2026)
por: Li, Handong, et al.
Publicado: (2026)
PRiSM: An Agentic Multimodal Benchmark for Scientific Reasoning via Python-Grounded Evaluation
por: Imani, Shima, et al.
Publicado: (2025)
por: Imani, Shima, et al.
Publicado: (2025)
Ejemplares similares
-
M$^3$-VQA: A Benchmark for Multimodal, Multi-Entity, Multi-Hop Visual Question Answering
por: Ma, Jiatong, et al.
Publicado: (2026) -
S1-MMAlign: A Large-Scale, Multi-Disciplinary Dataset for Scientific Figure-Text Understanding
por: Wang, He, et al.
Publicado: (2026) -
Can MLLMs Reason Beyond Language? VisReason: A Comprehensive Benchmark for Vision-Centric Reasoning
por: Guo, Longteng, et al.
Publicado: (2026) -
Ada-K Routing: Boosting the Efficiency of MoE-based LLMs
por: Yue, Tongtian, et al.
Publicado: (2024) -
Self-Bootstrapped Visual-Language Model for Knowledge Selection and Question Answering
por: Hao, Dongze, et al.
Publicado: (2024)