Video Evidence to Reasoning Efficient Video Understanding via Explicit Evidence Grounding
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Yanxiang, Gao, Guohua, Wei, Zhaoyang, Ni, Jianyuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Open-o3-Video: Grounded Video Reasoning with Explicit Spatio-Temporal Evidence
di: Meng, Jiahao, et al.
Pubblicazione: (2025)
di: Meng, Jiahao, et al.
Pubblicazione: (2025)
Keeping the Evidence Chain: Semantic Evidence Allocation for Training-Free Token Pruning in Video Temporal Grounding
di: Li, Jiaqi, et al.
Pubblicazione: (2026)
di: Li, Jiaqi, et al.
Pubblicazione: (2026)
Foresee-to-Ground: From Predictive Temporal Perception to Evidence-Driven Reasoning for Video Temporal Grounding
di: Zheng, Zelin, et al.
Pubblicazione: (2026)
di: Zheng, Zelin, et al.
Pubblicazione: (2026)
TRACE: Evidence Grounding-Guided Multi-Video Event Understanding and Claim Generation
di: Yan, Pengyu, et al.
Pubblicazione: (2026)
di: Yan, Pengyu, et al.
Pubblicazione: (2026)
VideoTIR: Accurate Understanding for Long Videos with Efficient Tool-Integrated Reasoning
di: Gao, Zhe, et al.
Pubblicazione: (2026)
di: Gao, Zhe, et al.
Pubblicazione: (2026)
Video-MTR: Reinforced Multi-Turn Reasoning for Long Video Understanding
di: Xie, Yuan, et al.
Pubblicazione: (2025)
di: Xie, Yuan, et al.
Pubblicazione: (2025)
Think with Grounding: Curriculum Reinforced Reasoning with Video Grounding for Long Video Understanding
di: Chen, Houlun, et al.
Pubblicazione: (2026)
di: Chen, Houlun, et al.
Pubblicazione: (2026)
Question-Aware Evidence Ledgers for Video Relational Reasoning
di: Ou, Yilin, et al.
Pubblicazione: (2026)
di: Ou, Yilin, et al.
Pubblicazione: (2026)
An Efficient Streaming Video Understanding Framework with Agentic Control
di: Liu, Jinming, et al.
Pubblicazione: (2026)
di: Liu, Jinming, et al.
Pubblicazione: (2026)
StreamOV: Streaming Omni-Video Understanding via Evidence-Guided Memory and Response Triggering
di: Xie, Ming, et al.
Pubblicazione: (2026)
di: Xie, Ming, et al.
Pubblicazione: (2026)
Chain-of-Glimpse: Search-Guided Progressive Object-Grounded Reasoning for Video Understanding
di: Wu, Zhixuan, et al.
Pubblicazione: (2026)
di: Wu, Zhixuan, et al.
Pubblicazione: (2026)
Select Less, Reason More: Prioritizing Evidence Purity for Video Reasoning
di: Li, Xuchen, et al.
Pubblicazione: (2025)
di: Li, Xuchen, et al.
Pubblicazione: (2025)
Clinically-Grounded Counterfactual Reasoning for Medical Video Diagnosis
di: Gao, Jianzhe, et al.
Pubblicazione: (2026)
di: Gao, Jianzhe, et al.
Pubblicazione: (2026)
VideoMathQA: Benchmarking Mathematical Reasoning via Multimodal Understanding in Videos
di: Rasheed, Hanoona, et al.
Pubblicazione: (2025)
di: Rasheed, Hanoona, et al.
Pubblicazione: (2025)
Grounding Video Reasoning in Physical Signals
di: Osmanli, Alibay, et al.
Pubblicazione: (2026)
di: Osmanli, Alibay, et al.
Pubblicazione: (2026)
Free Video-LLM: Prompt-guided Visual Perception for Efficient Training-free Video LLMs
di: Han, Kai, et al.
Pubblicazione: (2024)
di: Han, Kai, et al.
Pubblicazione: (2024)
Semantic and Visual Evidence for Efficient Long-Video Reasoning: A Solution for the HD-EPIC VQA Challenge
di: Xu, Yinsong, et al.
Pubblicazione: (2026)
di: Xu, Yinsong, et al.
Pubblicazione: (2026)
EVIDENT: Routing MLLM Adaptation through Entity-Grounded Visual Evidence for Cross-Domain Video Temporal Grounding
di: Ahn, Geo, et al.
Pubblicazione: (2026)
di: Ahn, Geo, et al.
Pubblicazione: (2026)
Adaptive Dense Evidence Refinement for Video Relational Reasoning for VRR-QA Challenge
di: Sun, Yuyang, et al.
Pubblicazione: (2026)
di: Sun, Yuyang, et al.
Pubblicazione: (2026)
STVG-R1: Incentivizing Instance-Level Reasoning and Grounding in Videos via Reinforcement Learning
di: Zhang, Xiaowen, et al.
Pubblicazione: (2026)
di: Zhang, Xiaowen, et al.
Pubblicazione: (2026)
Active Video Perception: Iterative Evidence Seeking for Agentic Long Video Understanding
di: Wang, Ziyang, et al.
Pubblicazione: (2025)
di: Wang, Ziyang, et al.
Pubblicazione: (2025)
Video-in-the-Loop: Span-Grounded Long Video QA with Interleaved Reasoning
di: Wang, Chendong, et al.
Pubblicazione: (2025)
di: Wang, Chendong, et al.
Pubblicazione: (2025)
VideoITG: Multimodal Video Understanding with Instructed Temporal Grounding
di: Wang, Shihao, et al.
Pubblicazione: (2025)
di: Wang, Shihao, et al.
Pubblicazione: (2025)
Cambrian-P: Pose-Grounded Video Understanding
di: Yang, Jihan, et al.
Pubblicazione: (2026)
di: Yang, Jihan, et al.
Pubblicazione: (2026)
VideoTemp-o3: Harmonizing Temporal Grounding and Video Understanding in Agentic Thinking-with-Videos
di: Liu, Wenqi, et al.
Pubblicazione: (2026)
di: Liu, Wenqi, et al.
Pubblicazione: (2026)
Skyra: AI-Generated Video Detection via Grounded Artifact Reasoning
di: Li, Yifei, et al.
Pubblicazione: (2025)
di: Li, Yifei, et al.
Pubblicazione: (2025)
VideoPro: Adaptive Program Reasoning for Long Video Understanding
di: Li, Chenglin, et al.
Pubblicazione: (2025)
di: Li, Chenglin, et al.
Pubblicazione: (2025)
SeViCES: Unifying Semantic-Visual Evidence Consensus for Long Video Understanding
di: Sheng, Yuan, et al.
Pubblicazione: (2025)
di: Sheng, Yuan, et al.
Pubblicazione: (2025)
Thinking with Drafts: Speculative Temporal Reasoning for Efficient Long Video Understanding
di: Hu, Pengfei, et al.
Pubblicazione: (2025)
di: Hu, Pengfei, et al.
Pubblicazione: (2025)
$R^2$-Tuning: Efficient Image-to-Video Transfer Learning for Video Temporal Grounding
di: Liu, Ye, et al.
Pubblicazione: (2024)
di: Liu, Ye, et al.
Pubblicazione: (2024)
An LMM for Efficient Video Understanding via Reinforced Compression of Video Cubes
di: Qi, Ji, et al.
Pubblicazione: (2025)
di: Qi, Ji, et al.
Pubblicazione: (2025)
NeuS-QA: Grounding Long-Form Video Understanding in Temporal Logic and Neuro-Symbolic Reasoning
di: Shah, Sahil, et al.
Pubblicazione: (2025)
di: Shah, Sahil, et al.
Pubblicazione: (2025)
Motion-Grounded Video Reasoning: Understanding and Perceiving Motion at Pixel Level
di: Deng, Andong, et al.
Pubblicazione: (2024)
di: Deng, Andong, et al.
Pubblicazione: (2024)
VRR-QA: Visual Relational Reasoning in Videos Beyond Explicit Cues
di: Swetha, Sirnam, et al.
Pubblicazione: (2025)
di: Swetha, Sirnam, et al.
Pubblicazione: (2025)
Reasoning over Video: Evaluating How MLLMs Extract, Integrate, and Reconstruct Spatiotemporal Evidence
di: Bang, Seunghwan, et al.
Pubblicazione: (2026)
di: Bang, Seunghwan, et al.
Pubblicazione: (2026)
VideoSEAL: Mitigating Evidence Misalignment in Agentic Long Video Understanding by Decoupling Answer Authority
di: Qiu, Chenhao, et al.
Pubblicazione: (2026)
di: Qiu, Chenhao, et al.
Pubblicazione: (2026)
VER-Bench: Evaluating MLLMs on Reasoning with Fine-Grained Visual Evidence
di: Qiang, Chenhui, et al.
Pubblicazione: (2025)
di: Qiang, Chenhui, et al.
Pubblicazione: (2025)
VideoLLM-online: Online Video Large Language Model for Streaming Video
di: Chen, Joya, et al.
Pubblicazione: (2024)
di: Chen, Joya, et al.
Pubblicazione: (2024)
GeoWeaver: Grounding Visual Tokens with Geometric Evidence before Scene Reasoning
di: Miao, Deshui, et al.
Pubblicazione: (2026)
di: Miao, Deshui, et al.
Pubblicazione: (2026)
Harnessing Object Grounding for Time-Sensitive Video Understanding
di: Wu, Tz-Ying, et al.
Pubblicazione: (2025)
di: Wu, Tz-Ying, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Open-o3-Video: Grounded Video Reasoning with Explicit Spatio-Temporal Evidence
di: Meng, Jiahao, et al.
Pubblicazione: (2025) -
Keeping the Evidence Chain: Semantic Evidence Allocation for Training-Free Token Pruning in Video Temporal Grounding
di: Li, Jiaqi, et al.
Pubblicazione: (2026) -
Foresee-to-Ground: From Predictive Temporal Perception to Evidence-Driven Reasoning for Video Temporal Grounding
di: Zheng, Zelin, et al.
Pubblicazione: (2026) -
TRACE: Evidence Grounding-Guided Multi-Video Event Understanding and Claim Generation
di: Yan, Pengyu, et al.
Pubblicazione: (2026) -
VideoTIR: Accurate Understanding for Long Videos with Efficient Tool-Integrated Reasoning
di: Gao, Zhe, et al.
Pubblicazione: (2026)