MOSS-ChatV: Reinforcement Learning with Process Reasoning Reward for Video Temporal Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Tao, Sicheng, Li, Jungang, Yan, Yibo, Zhang, Junyan, Gao, Yubo, Li, Hanqian, Xun, ShuHang, Fan, Yuxuan, Chen, Hong, He, Jianxiang, Hu, Xuming |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PhysicsArena: The First Multimodal Physics Reasoning Benchmark Exploring Variable, Process, and Solution Dimensions
di: Dai, Song, et al.
Pubblicazione: (2025)
di: Dai, Song, et al.
Pubblicazione: (2025)
RTV-Bench: Benchmarking MLLM Continuous Perception, Understanding and Reasoning through Real-Time Video
di: Xun, Shuhang, et al.
Pubblicazione: (2025)
di: Xun, Shuhang, et al.
Pubblicazione: (2025)
Temporal Gains, Spatial Costs: Revisiting Video Fine-Tuning in Multimodal Large Language Models
di: Zhang, Linghao, et al.
Pubblicazione: (2026)
di: Zhang, Linghao, et al.
Pubblicazione: (2026)
Thinking Economically: A Hierarchical Framework for Adaptive-Complexity Reasoning in LLMs
di: Gao, Yubo, et al.
Pubblicazione: (2026)
di: Gao, Yubo, et al.
Pubblicazione: (2026)
Unveiling Instruction-Specific Neurons & Experts: An Analytical Framework for LLM's Instruction-Following Capabilities
di: Zhang, Junyan, et al.
Pubblicazione: (2025)
di: Zhang, Junyan, et al.
Pubblicazione: (2025)
VideoMark: A Distortion-Free Robust Watermarking Framework for Video Diffusion Models
di: Hu, Xuming, et al.
Pubblicazione: (2025)
di: Hu, Xuming, et al.
Pubblicazione: (2025)
VSI: Visual Subtitle Integration for Keyframe Selection to enhance Long Video Understanding
di: He, Jianxiang, et al.
Pubblicazione: (2025)
di: He, Jianxiang, et al.
Pubblicazione: (2025)
SAVEn-Vid: Synergistic Audio-Visual Integration for Enhanced Understanding in Long Video Context
di: Li, Jungang, et al.
Pubblicazione: (2024)
di: Li, Jungang, et al.
Pubblicazione: (2024)
GM-PRM: A Generative Multimodal Process Reward Model for Multimodal Mathematical Reasoning
di: Zhang, Jianghangfan, et al.
Pubblicazione: (2025)
di: Zhang, Jianghangfan, et al.
Pubblicazione: (2025)
CoheMark: A Novel Sentence-Level Watermark for Enhanced Text Quality
di: Zhang, Junyan, et al.
Pubblicazione: (2025)
di: Zhang, Junyan, et al.
Pubblicazione: (2025)
Video Signature: Implicit Watermarking for Video Diffusion Models
di: Huang, Yu, et al.
Pubblicazione: (2025)
di: Huang, Yu, et al.
Pubblicazione: (2025)
EffiReason-Bench: A Unified Benchmark for Evaluating and Advancing Efficient Reasoning in Large Language Models
di: Huang, Junquan, et al.
Pubblicazione: (2025)
di: Huang, Junquan, et al.
Pubblicazione: (2025)
Sharp Eyes and Memory for VideoLLMs: Information-Aware Visual Token Pruning for Efficient and Reliable VideoLLM Reasoning
di: Qin, Jialong, et al.
Pubblicazione: (2025)
di: Qin, Jialong, et al.
Pubblicazione: (2025)
Reward Reasoning Model
di: Guo, Jiaxin, et al.
Pubblicazione: (2025)
di: Guo, Jiaxin, et al.
Pubblicazione: (2025)
A Visual Semantic Adaptive Watermark grounded by Prefix-Tuning for Large Vision-Language Model
di: Zheng, Qi, et al.
Pubblicazione: (2026)
di: Zheng, Qi, et al.
Pubblicazione: (2026)
RewardMap: Tackling Sparse Rewards in Fine-grained Visual Reasoning via Multi-Stage Reinforcement Learning
di: Feng, Sicheng, et al.
Pubblicazione: (2025)
di: Feng, Sicheng, et al.
Pubblicazione: (2025)
Rewarding Graph Reasoning Process makes LLMs more Generalized Reasoners
di: Peng, Miao, et al.
Pubblicazione: (2025)
di: Peng, Miao, et al.
Pubblicazione: (2025)
ReCode: Reinforcing Code Generation with Reasoning-Process Rewards
di: Fan, Lishui, et al.
Pubblicazione: (2025)
di: Fan, Lishui, et al.
Pubblicazione: (2025)
V-STaR: Benchmarking Video-LLMs on Video Spatio-Temporal Reasoning
di: Cheng, Zixu, et al.
Pubblicazione: (2025)
di: Cheng, Zixu, et al.
Pubblicazione: (2025)
GraphThinker: Reinforcing Temporally Grounded Video Reasoning with Event Graph Thinking
di: Cheng, Zixu, et al.
Pubblicazione: (2026)
di: Cheng, Zixu, et al.
Pubblicazione: (2026)
KnowMT-Bench: Benchmarking Knowledge-Intensive Long-Form Question Answering in Multi-Turn Dialogues
di: Chen, Junhao, et al.
Pubblicazione: (2025)
di: Chen, Junhao, et al.
Pubblicazione: (2025)
Outcome Accuracy is Not Enough: Aligning the Reasoning Process of Reward Models
di: Wang, Binghai, et al.
Pubblicazione: (2026)
di: Wang, Binghai, et al.
Pubblicazione: (2026)
Reducing Belief Deviation in Reinforcement Learning for Active Reasoning
di: Zou, Deyu, et al.
Pubblicazione: (2025)
di: Zou, Deyu, et al.
Pubblicazione: (2025)
A Survey of Mathematical Reasoning in the Era of Multimodal Large Language Model: Benchmark, Method & Challenges
di: Yan, Yibo, et al.
Pubblicazione: (2024)
di: Yan, Yibo, et al.
Pubblicazione: (2024)
Video Models Can Reason with Verifiable Rewards
di: Zhu, Tinghui, et al.
Pubblicazione: (2026)
di: Zhu, Tinghui, et al.
Pubblicazione: (2026)
Do BERT-Like Bidirectional Models Still Perform Better on Text Classification in the Era of LLMs?
di: Zhang, Junyan, et al.
Pubblicazione: (2025)
di: Zhang, Junyan, et al.
Pubblicazione: (2025)
VideoZoomer: Reinforcement-Learned Temporal Focusing for Long Video Reasoning
di: Ding, Yang, et al.
Pubblicazione: (2025)
di: Ding, Yang, et al.
Pubblicazione: (2025)
Verifiable Process Rewards for Agentic Reasoning
di: Yuan, Huining, et al.
Pubblicazione: (2026)
di: Yuan, Huining, et al.
Pubblicazione: (2026)
STAIR: Spatial-Temporal Reasoning with Auditable Intermediate Results for Video Question Answering
di: Wang, Yueqian, et al.
Pubblicazione: (2024)
di: Wang, Yueqian, et al.
Pubblicazione: (2024)
ReasonSTL: Bridging Natural Language and Signal Temporal Logic via Tool-Augmented Process-Rewarded Learning
di: Ye, Bowen, et al.
Pubblicazione: (2026)
di: Ye, Bowen, et al.
Pubblicazione: (2026)
Video-STR: Reinforcing MLLMs in Video Spatio-Temporal Reasoning with Relation Graph
di: Wang, Wentao, et al.
Pubblicazione: (2025)
di: Wang, Wentao, et al.
Pubblicazione: (2025)
Think, then Score: Decoupled Reasoning and Scoring for Video Reward Modeling
di: Wang, Yuan, et al.
Pubblicazione: (2026)
di: Wang, Yuan, et al.
Pubblicazione: (2026)
SARL: Label-Free Reinforcement Learning by Rewarding Reasoning Topology
di: Wang, Yifan, et al.
Pubblicazione: (2026)
di: Wang, Yifan, et al.
Pubblicazione: (2026)
Linking Process to Outcome: Conditional Reward Modeling for LLM Reasoning
di: Zhang, Zheng, et al.
Pubblicazione: (2025)
di: Zhang, Zheng, et al.
Pubblicazione: (2025)
VTimeCoT: Thinking by Drawing for Video Temporal Grounding and Reasoning
di: Zhang, Jinglei, et al.
Pubblicazione: (2025)
di: Zhang, Jinglei, et al.
Pubblicazione: (2025)
MMR-V: What's Left Unsaid? A Benchmark for Multimodal Deep Reasoning in Videos
di: Zhu, Kejian, et al.
Pubblicazione: (2025)
di: Zhu, Kejian, et al.
Pubblicazione: (2025)
HyperG: Hypergraph-Enhanced LLMs for Structured Knowledge
di: Huang, Sirui, et al.
Pubblicazione: (2025)
di: Huang, Sirui, et al.
Pubblicazione: (2025)
Reasoning-SQL: Reinforcement Learning with SQL Tailored Partial Rewards for Reasoning-Enhanced Text-to-SQL
di: Pourreza, Mohammadreza, et al.
Pubblicazione: (2025)
di: Pourreza, Mohammadreza, et al.
Pubblicazione: (2025)
Reward-SQL: Boosting Text-to-SQL via Stepwise Reasoning and Process-Supervised Rewards
di: Zhang, Yuxin, et al.
Pubblicazione: (2025)
di: Zhang, Yuxin, et al.
Pubblicazione: (2025)
VideoChat-R1.5: Visual Test-Time Scaling to Reinforce Multimodal Reasoning by Iterative Perception
di: Yan, Ziang, et al.
Pubblicazione: (2025)
di: Yan, Ziang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
PhysicsArena: The First Multimodal Physics Reasoning Benchmark Exploring Variable, Process, and Solution Dimensions
di: Dai, Song, et al.
Pubblicazione: (2025) -
RTV-Bench: Benchmarking MLLM Continuous Perception, Understanding and Reasoning through Real-Time Video
di: Xun, Shuhang, et al.
Pubblicazione: (2025) -
Temporal Gains, Spatial Costs: Revisiting Video Fine-Tuning in Multimodal Large Language Models
di: Zhang, Linghao, et al.
Pubblicazione: (2026) -
Thinking Economically: A Hierarchical Framework for Adaptive-Complexity Reasoning in LLMs
di: Gao, Yubo, et al.
Pubblicazione: (2026) -
Unveiling Instruction-Specific Neurons & Experts: An Analytical Framework for LLM's Instruction-Following Capabilities
di: Zhang, Junyan, et al.
Pubblicazione: (2025)