Reinforce to Learn, Elect to Reason: A Dual Paradigm for Video Reasoning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yang, Songyuan, Yu, Weijiang, Ma, Jilin, Liu, Ziyu, Tang, Guijian, Yang, Wenjing, Tan, Huibin, Xiao, Nong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Graph-to-Frame RAG: Visual-Space Knowledge Fusion for Training-Free and Auditable Video Reasoning
von: Yang, Songyuan, et al.
Veröffentlicht: (2026)
von: Yang, Songyuan, et al.
Veröffentlicht: (2026)
AnyUser: Translating Sketched User Intent into Domestic Robots
von: Yang, Songyuan, et al.
Veröffentlicht: (2026)
von: Yang, Songyuan, et al.
Veröffentlicht: (2026)
Exploring Low-Resource Medical Image Classification with Weakly Supervised Prompt Learning
von: Zheng, Fudan, et al.
Veröffentlicht: (2024)
von: Zheng, Fudan, et al.
Veröffentlicht: (2024)
Thinking With Videos: Multimodal Tool-Augmented Reinforcement Learning for Long Video Reasoning
von: Zhang, Haoji, et al.
Veröffentlicht: (2025)
von: Zhang, Haoji, et al.
Veröffentlicht: (2025)
VideoZoomer: Reinforcement-Learned Temporal Focusing for Long Video Reasoning
von: Ding, Yang, et al.
Veröffentlicht: (2025)
von: Ding, Yang, et al.
Veröffentlicht: (2025)
VideoSeg-R1:Reasoning Video Object Segmentation via Reinforcement Learning
von: Xu, Zishan, et al.
Veröffentlicht: (2025)
von: Xu, Zishan, et al.
Veröffentlicht: (2025)
Wan-R1: Verifiable-Reinforcement Learning for Video Reasoning
von: Liu, Ming, et al.
Veröffentlicht: (2026)
von: Liu, Ming, et al.
Veröffentlicht: (2026)
Boosting the Generalization and Reasoning of Vision Language Models with Curriculum Reinforcement Learning
von: Deng, Huilin, et al.
Veröffentlicht: (2025)
von: Deng, Huilin, et al.
Veröffentlicht: (2025)
Thinking with Video: Video Generation as a Promising Multimodal Reasoning Paradigm
von: Tong, Jingqi, et al.
Veröffentlicht: (2025)
von: Tong, Jingqi, et al.
Veröffentlicht: (2025)
Uni-Synergy: Bridging Understanding and Generation for Personalized Reasoning via Co-operative Reinforcement Learning
von: Shen, Zijun, et al.
Veröffentlicht: (2026)
von: Shen, Zijun, et al.
Veröffentlicht: (2026)
MOSS-ChatV: Reinforcement Learning with Process Reasoning Reward for Video Temporal Reasoning
von: Tao, Sicheng, et al.
Veröffentlicht: (2025)
von: Tao, Sicheng, et al.
Veröffentlicht: (2025)
V-ReasonBench: Toward Unified Reasoning Benchmark Suite for Video Generation Models
von: Luo, Yang, et al.
Veröffentlicht: (2025)
von: Luo, Yang, et al.
Veröffentlicht: (2025)
VisionReasoner: Unified Reasoning-Integrated Visual Perception via Reinforcement Learning
von: Liu, Yuqi, et al.
Veröffentlicht: (2025)
von: Liu, Yuqi, et al.
Veröffentlicht: (2025)
VideoCoF: Unified Video Editing with Temporal Reasoner
von: Yang, Xiangpeng, et al.
Veröffentlicht: (2025)
von: Yang, Xiangpeng, et al.
Veröffentlicht: (2025)
Dual-stream Feature Augmentation for Domain Generalization
von: Wang, Shanshan, et al.
Veröffentlicht: (2024)
von: Wang, Shanshan, et al.
Veröffentlicht: (2024)
Perceptual-Evidence Anchored Reinforced Learning for Multimodal Reasoning
von: Zhang, Chi, et al.
Veröffentlicht: (2025)
von: Zhang, Chi, et al.
Veröffentlicht: (2025)
BeyondFacial: Identity-Preserving Personalized Generation Beyond Facial Close-ups
von: Zhang, Songsong, et al.
Veröffentlicht: (2025)
von: Zhang, Songsong, et al.
Veröffentlicht: (2025)
Video-ToC: Video Tree-of-Cue Reasoning
von: Tan, Qizhong, et al.
Veröffentlicht: (2026)
von: Tan, Qizhong, et al.
Veröffentlicht: (2026)
Reinforcing Video Reasoning with Focused Thinking
von: Dang, Jisheng, et al.
Veröffentlicht: (2025)
von: Dang, Jisheng, et al.
Veröffentlicht: (2025)
MedReason-R1: Learning to Reason for CT Diagnosis with Reinforcement Learning and Local Zoom
von: Li, Yifan, et al.
Veröffentlicht: (2025)
von: Li, Yifan, et al.
Veröffentlicht: (2025)
SpaceR: Reinforcing MLLMs in Video Spatial Reasoning
von: Ouyang, Kun, et al.
Veröffentlicht: (2025)
von: Ouyang, Kun, et al.
Veröffentlicht: (2025)
Learning Transferable Temporal Primitives for Video Reasoning via Synthetic Videos
von: Jiang, Songtao, et al.
Veröffentlicht: (2026)
von: Jiang, Songtao, et al.
Veröffentlicht: (2026)
Video-R4: Reinforcing Text-Rich Video Reasoning with Visual Rumination
von: Tang, Yolo Y., et al.
Veröffentlicht: (2025)
von: Tang, Yolo Y., et al.
Veröffentlicht: (2025)
AVATAR: Reinforcement Learning to See, Hear, and Reason Over Video
von: Kulkarni, Yogesh, et al.
Veröffentlicht: (2025)
von: Kulkarni, Yogesh, et al.
Veröffentlicht: (2025)
MedReasoner: Reinforcement Learning Drives Reasoning Grounding from Clinical Thought to Pixel-Level Precision
von: Yan, Zhonghao, et al.
Veröffentlicht: (2025)
von: Yan, Zhonghao, et al.
Veröffentlicht: (2025)
Video-R1: Reinforcing Video Reasoning in MLLMs
von: Feng, Kaituo, et al.
Veröffentlicht: (2025)
von: Feng, Kaituo, et al.
Veröffentlicht: (2025)
DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing
von: Yang, Hanqing, et al.
Veröffentlicht: (2026)
von: Yang, Hanqing, et al.
Veröffentlicht: (2026)
SAGE: Training Smart Any-Horizon Agents for Long Video Reasoning with Reinforcement Learning
von: Jain, Jitesh, et al.
Veröffentlicht: (2025)
von: Jain, Jitesh, et al.
Veröffentlicht: (2025)
Learning Only with Images: Visual Reinforcement Learning with Reasoning, Rendering, and Visual Feedback
von: Chen, Yang, et al.
Veröffentlicht: (2025)
von: Chen, Yang, et al.
Veröffentlicht: (2025)
MECD: Unlocking Multi-Event Causal Discovery in Video Reasoning
von: Chen, Tieyuan, et al.
Veröffentlicht: (2024)
von: Chen, Tieyuan, et al.
Veröffentlicht: (2024)
Online Reasoning Video Object Segmentation
von: Liu, Jinyuan, et al.
Veröffentlicht: (2026)
von: Liu, Jinyuan, et al.
Veröffentlicht: (2026)
Reason-SVG: Enhancing Structured Reasoning for Vector Graphics Generation with Reinforcement Learning
von: Xing, Ximing, et al.
Veröffentlicht: (2025)
von: Xing, Ximing, et al.
Veröffentlicht: (2025)
Visual Reasoning through Tool-supervised Reinforcement Learning
von: Dong, Qihua, et al.
Veröffentlicht: (2026)
von: Dong, Qihua, et al.
Veröffentlicht: (2026)
VideoRFT: Incentivizing Video Reasoning Capability in MLLMs via Reinforced Fine-Tuning
von: Wang, Qi, et al.
Veröffentlicht: (2025)
von: Wang, Qi, et al.
Veröffentlicht: (2025)
Pest-Thinker: Learning to Think and Reason like Entomologists via Reinforcement Learning
von: Li, Xueheng, et al.
Veröffentlicht: (2026)
von: Li, Xueheng, et al.
Veröffentlicht: (2026)
VEGGIE: Instructional Editing and Reasoning Video Concepts with Grounded Generation
von: Yu, Shoubin, et al.
Veröffentlicht: (2025)
von: Yu, Shoubin, et al.
Veröffentlicht: (2025)
GMAI-VL-R1: Harnessing Reinforcement Learning for Multimodal Medical Reasoning
von: Su, Yanzhou, et al.
Veröffentlicht: (2025)
von: Su, Yanzhou, et al.
Veröffentlicht: (2025)
WeThink: Toward General-purpose Vision-Language Reasoning via Reinforcement Learning
von: Yang, Jie, et al.
Veröffentlicht: (2025)
von: Yang, Jie, et al.
Veröffentlicht: (2025)
VReST: Enhancing Reasoning in Large Vision-Language Models through Tree Search and Self-Reward Mechanism
von: Zhang, Congzhi, et al.
Veröffentlicht: (2025)
von: Zhang, Congzhi, et al.
Veröffentlicht: (2025)
Reasoning Physical Video Generation with Diffusion Timestep Tokens via Reinforcement Learning
von: Lin, Wang, et al.
Veröffentlicht: (2025)
von: Lin, Wang, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Graph-to-Frame RAG: Visual-Space Knowledge Fusion for Training-Free and Auditable Video Reasoning
von: Yang, Songyuan, et al.
Veröffentlicht: (2026) -
AnyUser: Translating Sketched User Intent into Domestic Robots
von: Yang, Songyuan, et al.
Veröffentlicht: (2026) -
Exploring Low-Resource Medical Image Classification with Weakly Supervised Prompt Learning
von: Zheng, Fudan, et al.
Veröffentlicht: (2024) -
Thinking With Videos: Multimodal Tool-Augmented Reinforcement Learning for Long Video Reasoning
von: Zhang, Haoji, et al.
Veröffentlicht: (2025) -
VideoZoomer: Reinforcement-Learned Temporal Focusing for Long Video Reasoning
von: Ding, Yang, et al.
Veröffentlicht: (2025)