DeepVision-103K: A Visually Diverse, Broad-Coverage, and Verifiable Mathematical Dataset for Multimodal Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Sun, Haoxiang, Xu, Lizhen, Zhao, Bing, Yin, Wotao, Wang, Wei, Yang, Boyu, Wang, Rui, Wei, Hu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DeepMath-103K: A Large-Scale, Challenging, Decontaminated, and Verifiable Mathematical Dataset for Advancing Reasoning
di: He, Zhiwei, et al.
Pubblicazione: (2025)
di: He, Zhiwei, et al.
Pubblicazione: (2025)
Measuring Multimodal Mathematical Reasoning with MATH-Vision Dataset
di: Wang, Ke, et al.
Pubblicazione: (2024)
di: Wang, Ke, et al.
Pubblicazione: (2024)
Benchmarking Multimodal Mathematical Reasoning with Explicit Visual Dependency
di: Wang, Zhikai, et al.
Pubblicazione: (2025)
di: Wang, Zhikai, et al.
Pubblicazione: (2025)
Unmasking Reasoning Processes: A Process-aware Benchmark for Evaluating Structural Mathematical Reasoning in LLMs
di: Zheng, Xiang, et al.
Pubblicazione: (2026)
di: Zheng, Xiang, et al.
Pubblicazione: (2026)
AdapThink: Adaptive Thinking Preferences for Reasoning Language Model
di: Wan, Xu, et al.
Pubblicazione: (2025)
di: Wan, Xu, et al.
Pubblicazione: (2025)
Multimodal Mathematical Reasoning with Diverse Solving Perspective
di: Shi, Wenhao, et al.
Pubblicazione: (2025)
di: Shi, Wenhao, et al.
Pubblicazione: (2025)
Decomposition Methods for Global Solutions of Mixed-Integer Linear Programs
di: Sun, Kaizhao, et al.
Pubblicazione: (2021)
di: Sun, Kaizhao, et al.
Pubblicazione: (2021)
AccelSync: Verifying Synchronization Coverage in Accelerator Pipeline Programs
di: An, Hangcheng, et al.
Pubblicazione: (2026)
di: An, Hangcheng, et al.
Pubblicazione: (2026)
MathCanvas: Intrinsic Visual Chain-of-Thought for Multimodal Mathematical Reasoning
di: Shi, Weikang, et al.
Pubblicazione: (2025)
di: Shi, Weikang, et al.
Pubblicazione: (2025)
Block Acceleration Without Momentum: On Optimal Stepsizes of Block Gradient Descent for Least-Squares
di: Peng, Liangzu, et al.
Pubblicazione: (2024)
di: Peng, Liangzu, et al.
Pubblicazione: (2024)
MindOpt Adapter for CPLEX Benchmarking Performance Analysis
di: Sun, Mou, et al.
Pubblicazione: (2023)
di: Sun, Mou, et al.
Pubblicazione: (2023)
DeepSeekMath-V2: Towards Self-Verifiable Mathematical Reasoning
di: Shao, Zhihong, et al.
Pubblicazione: (2025)
di: Shao, Zhihong, et al.
Pubblicazione: (2025)
BilliardPhys-Bench: Benchmarking Physical Reasoning and Visual Dynamics of Multimodal LLMs
di: Wang, Ben, et al.
Pubblicazione: (2026)
di: Wang, Ben, et al.
Pubblicazione: (2026)
MathCoder-VL: Bridging Vision and Code for Enhanced Multimodal Mathematical Reasoning
di: Wang, Ke, et al.
Pubblicazione: (2025)
di: Wang, Ke, et al.
Pubblicazione: (2025)
Scaling Flaws of Verifier-Guided Search in Mathematical Reasoning
di: Yu, Fei, et al.
Pubblicazione: (2025)
di: Yu, Fei, et al.
Pubblicazione: (2025)
OneLatent: Single-Token Compression for Visual Latent Reasoning
di: Lv, Bo, et al.
Pubblicazione: (2026)
di: Lv, Bo, et al.
Pubblicazione: (2026)
LogicVista: Multimodal LLM Logical Reasoning Benchmark in Visual Contexts
di: Xiao, Yijia, et al.
Pubblicazione: (2024)
di: Xiao, Yijia, et al.
Pubblicazione: (2024)
Seed-Prover: Deep and Broad Reasoning for Automated Theorem Proving
di: Chen, Luoxin, et al.
Pubblicazione: (2025)
di: Chen, Luoxin, et al.
Pubblicazione: (2025)
No Labels, No Problem: Training Visual Reasoners with Multimodal Verifiers
di: Marsili, Damiano, et al.
Pubblicazione: (2025)
di: Marsili, Damiano, et al.
Pubblicazione: (2025)
Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models
di: Shi, Wenhao, et al.
Pubblicazione: (2024)
di: Shi, Wenhao, et al.
Pubblicazione: (2024)
MM-Verify: Enhancing Multimodal Reasoning with Chain-of-Thought Verification
di: Sun, Linzhuang, et al.
Pubblicazione: (2025)
di: Sun, Linzhuang, et al.
Pubblicazione: (2025)
HERMES: Towards Efficient and Verifiable Mathematical Reasoning in LLMs
di: Ospanov, Azim, et al.
Pubblicazione: (2025)
di: Ospanov, Azim, et al.
Pubblicazione: (2025)
The Role of Visual Modality in Multimodal Mathematical Reasoning: Challenges and Insights
di: Liu, Yufang, et al.
Pubblicazione: (2025)
di: Liu, Yufang, et al.
Pubblicazione: (2025)
Self-Rewarded Multimodal Coherent Reasoning Across Diverse Visual Domains
di: Zhang, Jesen, et al.
Pubblicazione: (2025)
di: Zhang, Jesen, et al.
Pubblicazione: (2025)
Multimodal Fact-Level Attribution for Verifiable Reasoning
di: Wan, David, et al.
Pubblicazione: (2026)
di: Wan, David, et al.
Pubblicazione: (2026)
DynaMath: A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models
di: Zou, Chengke, et al.
Pubblicazione: (2024)
di: Zou, Chengke, et al.
Pubblicazione: (2024)
Guided Verifier: Collaborative Multimodal Reasoning via Dynamic Process Supervision
di: Sun, Lingzhuang, et al.
Pubblicazione: (2026)
di: Sun, Lingzhuang, et al.
Pubblicazione: (2026)
SPR-128K: A New Benchmark for Spatial Plausibility Reasoning with Multimodal Large Language Models
di: Hu, Zhiyuan, et al.
Pubblicazione: (2025)
di: Hu, Zhiyuan, et al.
Pubblicazione: (2025)
VisionGraph: Leveraging Large Multimodal Models for Graph Theory Problems in Visual Context
di: Li, Yunxin, et al.
Pubblicazione: (2024)
di: Li, Yunxin, et al.
Pubblicazione: (2024)
StructVRM: Aligning Multimodal Reasoning with Structured and Verifiable Reward Models
di: Zhang, Xiangxiang, et al.
Pubblicazione: (2025)
di: Zhang, Xiangxiang, et al.
Pubblicazione: (2025)
Symbolic-Neural Soft-Logic Reasoning: Towards Robust and Verifiable Thinking Chains via Cooperative Evolution
di: Wang, Rui, et al.
Pubblicazione: (2026)
di: Wang, Rui, et al.
Pubblicazione: (2026)
KodCode: A Diverse, Challenging, and Verifiable Synthetic Dataset for Coding
di: Xu, Zhangchen, et al.
Pubblicazione: (2025)
di: Xu, Zhangchen, et al.
Pubblicazione: (2025)
A Pre-trained Deep Potential Model for Sulfide Solid Electrolytes with Broad Coverage and High Accuracy
di: Wang, Ruoyu, et al.
Pubblicazione: (2024)
di: Wang, Ruoyu, et al.
Pubblicazione: (2024)
Efficient Algorithms for Sum-of-Minimum Optimization
di: Ding, Lisang, et al.
Pubblicazione: (2024)
di: Ding, Lisang, et al.
Pubblicazione: (2024)
Automating Reformulation for Parallel ADMM
di: Sun, Kaizhao, et al.
Pubblicazione: (2026)
di: Sun, Kaizhao, et al.
Pubblicazione: (2026)
Open Vision Reasoner: Transferring Linguistic Cognitive Behavior for Visual Reasoning
di: Wei, Yana, et al.
Pubblicazione: (2025)
di: Wei, Yana, et al.
Pubblicazione: (2025)
Learning to optimize: A tutorial for continuous and mixed-integer optimization
di: Chen, Xiaohan, et al.
Pubblicazione: (2024)
di: Chen, Xiaohan, et al.
Pubblicazione: (2024)
ODE-based Learning to Optimize
di: Xie, Zhonglin, et al.
Pubblicazione: (2024)
di: Xie, Zhonglin, et al.
Pubblicazione: (2024)
CoTEvol: Self-Evolving Chain-of-Thoughts for Data Synthesis in Mathematical Reasoning
di: Wang, Zhuo, et al.
Pubblicazione: (2026)
di: Wang, Zhuo, et al.
Pubblicazione: (2026)
DARL: Encouraging Diverse Answers for General Reasoning without Verifiers
di: Huang, Chongxuan, et al.
Pubblicazione: (2026)
di: Huang, Chongxuan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
DeepMath-103K: A Large-Scale, Challenging, Decontaminated, and Verifiable Mathematical Dataset for Advancing Reasoning
di: He, Zhiwei, et al.
Pubblicazione: (2025) -
Measuring Multimodal Mathematical Reasoning with MATH-Vision Dataset
di: Wang, Ke, et al.
Pubblicazione: (2024) -
Benchmarking Multimodal Mathematical Reasoning with Explicit Visual Dependency
di: Wang, Zhikai, et al.
Pubblicazione: (2025) -
Unmasking Reasoning Processes: A Process-aware Benchmark for Evaluating Structural Mathematical Reasoning in LLMs
di: Zheng, Xiang, et al.
Pubblicazione: (2026) -
AdapThink: Adaptive Thinking Preferences for Reasoning Language Model
di: Wan, Xu, et al.
Pubblicazione: (2025)