Salvato in:
| Autori principali: | Yang, Cheng, Wan, Haiyuan, Peng, Yiran, Cheng, Xin, Yu, Zhaoyang, Zhang, Jiayi, Yu, Junchi, Yu, Xinlei, Zheng, Xiawu, Zhou, Dongzhan, Wu, Chenglin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2511.15065 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DeepResearch Arena: The First Exam of LLMs' Research Abilities via Seminar-Grounded Tasks
di: Wan, Haiyuan, et al.
Pubblicazione: (2025)
di: Wan, Haiyuan, et al.
Pubblicazione: (2025)
From What to Why: A Multi-Agent System for Evidence-based Chemical Reaction Condition Reasoning
di: Yang, Cheng, et al.
Pubblicazione: (2025)
di: Yang, Cheng, et al.
Pubblicazione: (2025)
Video Models Reason Early: Exploiting Plan Commitment for Maze Solving
di: Newman, Kaleb, et al.
Pubblicazione: (2026)
di: Newman, Kaleb, et al.
Pubblicazione: (2026)
Scaling Physical Reasoning with the PHYSICS Dataset
di: Zheng, Shenghe, et al.
Pubblicazione: (2025)
di: Zheng, Shenghe, et al.
Pubblicazione: (2025)
VideoREPA: Learning Physics for Video Generation through Relational Alignment with Foundation Models
di: Zhang, Xiangdong, et al.
Pubblicazione: (2025)
di: Zhang, Xiangdong, et al.
Pubblicazione: (2025)
Benchmarking Abstract and Reasoning Abilities Through A Theoretical Perspective
di: Ma, Qingchuan, et al.
Pubblicazione: (2025)
di: Ma, Qingchuan, et al.
Pubblicazione: (2025)
Evaluating the Logical Reasoning Abilities of Large Reasoning Models
di: Liu, Hanmeng, et al.
Pubblicazione: (2025)
di: Liu, Hanmeng, et al.
Pubblicazione: (2025)
P1-VL: Bridging Visual Perception and Scientific Reasoning in Physics Olympiads
di: Luo, Yun, et al.
Pubblicazione: (2026)
di: Luo, Yun, et al.
Pubblicazione: (2026)
VideoCogQA: A Controllable Benchmark for Evaluating Cognitive Abilities in Video-Language Models
di: Li, Chenglin, et al.
Pubblicazione: (2024)
di: Li, Chenglin, et al.
Pubblicazione: (2024)
Unveiling the Compositional Ability Gap in Vision-Language Reasoning Model
di: Li, Tianle, et al.
Pubblicazione: (2025)
di: Li, Tianle, et al.
Pubblicazione: (2025)
Learning Video Representations without Natural Videos
di: Yu, Xueyang, et al.
Pubblicazione: (2024)
di: Yu, Xueyang, et al.
Pubblicazione: (2024)
Beyond Static Tools: Test-Time Tool Evolution for Scientific Reasoning
di: Lu, Jiaxuan, et al.
Pubblicazione: (2026)
di: Lu, Jiaxuan, et al.
Pubblicazione: (2026)
Can Knowledge-Graph-based Retrieval Augmented Generation Really Retrieve What You Need?
di: Yu, Junchi, et al.
Pubblicazione: (2025)
di: Yu, Junchi, et al.
Pubblicazione: (2025)
HiPhO: How Far Are (M)LLMs from Humans in the Latest High School Physics Olympiad Benchmark?
di: Yu, Fangchen, et al.
Pubblicazione: (2025)
di: Yu, Fangchen, et al.
Pubblicazione: (2025)
ReasonAgain: Using Extractable Symbolic Programs to Evaluate Mathematical Reasoning
di: Yu, Xiaodong, et al.
Pubblicazione: (2024)
di: Yu, Xiaodong, et al.
Pubblicazione: (2024)
SocialMaze: A Benchmark for Evaluating Social Reasoning in Large Language Models
di: Xu, Zixiang, et al.
Pubblicazione: (2025)
di: Xu, Zixiang, et al.
Pubblicazione: (2025)
VideoTree: Adaptive Tree-based Video Representation for LLM Reasoning on Long Videos
di: Wang, Ziyang, et al.
Pubblicazione: (2024)
di: Wang, Ziyang, et al.
Pubblicazione: (2024)
SketchThinker-R1: Towards Efficient Sketch-Style Reasoning in Large Multimodal Models
di: Zhang, Ruiyang, et al.
Pubblicazione: (2026)
di: Zhang, Ruiyang, et al.
Pubblicazione: (2026)
AutoLogi: Automated Generation of Logic Puzzles for Evaluating Reasoning Abilities of Large Language Models
di: Zhu, Qin, et al.
Pubblicazione: (2025)
di: Zhu, Qin, et al.
Pubblicazione: (2025)
PhysicsMinions: Winning Gold Medals in the Latest Physics Olympiads with a Coevolutionary Multimodal Multi-Agent System
di: Yu, Fangchen, et al.
Pubblicazione: (2025)
di: Yu, Fangchen, et al.
Pubblicazione: (2025)
ARCHE: A Novel Task to Evaluate LLMs on Latent Reasoning Chain Extraction
di: Li, Pengze, et al.
Pubblicazione: (2025)
di: Li, Pengze, et al.
Pubblicazione: (2025)
Finding Libraries in the Video Maze.
di: Sessions, Judith A., et al.
Pubblicazione: (1981)
di: Sessions, Judith A., et al.
Pubblicazione: (1981)
Video Evidence to Reasoning Efficient Video Understanding via Explicit Evidence Grounding
di: Huang, Yanxiang, et al.
Pubblicazione: (2026)
di: Huang, Yanxiang, et al.
Pubblicazione: (2026)
VideoForest: Person-Anchored Hierarchical Reasoning for Cross-Video Question Answering
di: Meng, Yiran, et al.
Pubblicazione: (2025)
di: Meng, Yiran, et al.
Pubblicazione: (2025)
Thought Propagation: An Analogical Approach to Complex Reasoning with Large Language Models
di: Yu, Junchi, et al.
Pubblicazione: (2023)
di: Yu, Junchi, et al.
Pubblicazione: (2023)
Thinking with Drafts: Speculative Temporal Reasoning for Efficient Long Video Understanding
di: Hu, Pengfei, et al.
Pubblicazione: (2025)
di: Hu, Pengfei, et al.
Pubblicazione: (2025)
VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization
di: Cheng, Junhao, et al.
Pubblicazione: (2026)
di: Cheng, Junhao, et al.
Pubblicazione: (2026)
Instance Brownian Bridge as Texts for Open-vocabulary Video Instance Segmentation
di: Cheng, Zesen, et al.
Pubblicazione: (2024)
di: Cheng, Zesen, et al.
Pubblicazione: (2024)
TiViBench: Benchmarking Think-in-Video Reasoning for Video Generative Models
di: Chen, Harold Haodong, et al.
Pubblicazione: (2025)
di: Chen, Harold Haodong, et al.
Pubblicazione: (2025)
Motion-aware Latent Diffusion Models for Video Frame Interpolation
di: Huang, Zhilin, et al.
Pubblicazione: (2024)
di: Huang, Zhilin, et al.
Pubblicazione: (2024)
Video-ToC: Video Tree-of-Cue Reasoning
di: Tan, Qizhong, et al.
Pubblicazione: (2026)
di: Tan, Qizhong, et al.
Pubblicazione: (2026)
Grounding Video Reasoning in Physical Signals
di: Osmanli, Alibay, et al.
Pubblicazione: (2026)
di: Osmanli, Alibay, et al.
Pubblicazione: (2026)
Video Models Start to Solve Chess, Maze, Sudoku, Mental Rotation, and Raven' Matrices
di: Deng, Hokin
Pubblicazione: (2025)
di: Deng, Hokin
Pubblicazione: (2025)
Transformers Use Causal World Models in Maze-Solving Tasks
di: Spies, Alex F., et al.
Pubblicazione: (2024)
di: Spies, Alex F., et al.
Pubblicazione: (2024)
Scientists' First Exam: Probing Cognitive Abilities of MLLM via Perception, Understanding, and Reasoning
di: Zhou, Yuhao, et al.
Pubblicazione: (2025)
di: Zhou, Yuhao, et al.
Pubblicazione: (2025)
VideoRFT: Incentivizing Video Reasoning Capability in MLLMs via Reinforced Fine-Tuning
di: Wang, Qi, et al.
Pubblicazione: (2025)
di: Wang, Qi, et al.
Pubblicazione: (2025)
Skyra: AI-Generated Video Detection via Grounded Artifact Reasoning
di: Li, Yifei, et al.
Pubblicazione: (2025)
di: Li, Yifei, et al.
Pubblicazione: (2025)
VideoPro: Adaptive Program Reasoning for Long Video Understanding
di: Li, Chenglin, et al.
Pubblicazione: (2025)
di: Li, Chenglin, et al.
Pubblicazione: (2025)
VideoThinker: Building Agentic VideoLLMs with LLM-Guided Tool Reasoning
di: Li, Chenglin, et al.
Pubblicazione: (2026)
di: Li, Chenglin, et al.
Pubblicazione: (2026)
TimeBench: A Comprehensive Evaluation of Temporal Reasoning Abilities in Large Language Models
di: Chu, Zheng, et al.
Pubblicazione: (2023)
di: Chu, Zheng, et al.
Pubblicazione: (2023)
Documenti analoghi
-
DeepResearch Arena: The First Exam of LLMs' Research Abilities via Seminar-Grounded Tasks
di: Wan, Haiyuan, et al.
Pubblicazione: (2025) -
From What to Why: A Multi-Agent System for Evidence-based Chemical Reaction Condition Reasoning
di: Yang, Cheng, et al.
Pubblicazione: (2025) -
Video Models Reason Early: Exploiting Plan Commitment for Maze Solving
di: Newman, Kaleb, et al.
Pubblicazione: (2026) -
Scaling Physical Reasoning with the PHYSICS Dataset
di: Zheng, Shenghe, et al.
Pubblicazione: (2025) -
VideoREPA: Learning Physics for Video Generation through Relational Alignment with Foundation Models
di: Zhang, Xiangdong, et al.
Pubblicazione: (2025)