Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wang, Peiyu, Wei, Yichen, Peng, Yi, Wang, Xiaokun, Qiu, Weijie, Shen, Wei, Xie, Tianyidan, Pei, Jiangbo, Zhang, Jianhao, Hao, Yunzhuo, Song, Xuchen, Liu, Yang, Zhou, Yahui |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Skywork R1V: Pioneering Multimodal Reasoning with Chain-of-Thought
von: Peng, Yi, et al.
Veröffentlicht: (2025)
von: Peng, Yi, et al.
Veröffentlicht: (2025)
Skywork-VL Reward: An Effective Reward Model for Multimodal Understanding and Reasoning
von: Wang, Xiaokun, et al.
Veröffentlicht: (2025)
von: Wang, Xiaokun, et al.
Veröffentlicht: (2025)
Skywork-R1V3 Technical Report
von: Shen, Wei, et al.
Veröffentlicht: (2025)
von: Shen, Wei, et al.
Veröffentlicht: (2025)
CSVQA: A Chinese Multimodal Benchmark for Evaluating STEM Reasoning Capabilities of VLMs
von: Jian, Ai, et al.
Veröffentlicht: (2025)
von: Jian, Ai, et al.
Veröffentlicht: (2025)
Skywork-R1V4: Toward Agentic Multimodal Intelligence through Interleaved Thinking with Images and DeepResearch
von: Zhang, Yifan, et al.
Veröffentlicht: (2025)
von: Zhang, Yifan, et al.
Veröffentlicht: (2025)
Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation
von: Wang, Peiyu, et al.
Veröffentlicht: (2025)
von: Wang, Peiyu, et al.
Veröffentlicht: (2025)
Skywork UniPic 2.0: Building Kontext Model with Online RL for Unified Multimodal Model
von: Wei, Hongyang, et al.
Veröffentlicht: (2025)
von: Wei, Hongyang, et al.
Veröffentlicht: (2025)
Skywork UniPic 3.0: Unified Multi-Image Composition via Sequence Modeling
von: Wei, Hongyang, et al.
Veröffentlicht: (2026)
von: Wei, Hongyang, et al.
Veröffentlicht: (2026)
Skywork Open Reasoner 1 Technical Report
von: He, Jujie, et al.
Veröffentlicht: (2025)
von: He, Jujie, et al.
Veröffentlicht: (2025)
Skywork-SWE: Unveiling Data Scaling Laws for Software Engineering in LLMs
von: Zeng, Liang, et al.
Veröffentlicht: (2025)
von: Zeng, Liang, et al.
Veröffentlicht: (2025)
Skywork-MoE: A Deep Dive into Training Techniques for Mixture-of-Experts Language Models
von: Wei, Tianwen, et al.
Veröffentlicht: (2024)
von: Wei, Tianwen, et al.
Veröffentlicht: (2024)
Skywork-Reward-V2: Scaling Preference Data Curation via Human-AI Synergy
von: Liu, Chris Yuhao, et al.
Veröffentlicht: (2025)
von: Liu, Chris Yuhao, et al.
Veröffentlicht: (2025)
Skywork-Math: Data Scaling Laws for Mathematical Reasoning in Large Language Models -- The Story Goes On
von: Zeng, Liang, et al.
Veröffentlicht: (2024)
von: Zeng, Liang, et al.
Veröffentlicht: (2024)
Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs
von: Liu, Chris Yuhao, et al.
Veröffentlicht: (2024)
von: Liu, Chris Yuhao, et al.
Veröffentlicht: (2024)
MedSeg-R: Reasoning Segmentation in Medical Images with Multimodal Large Language Models
von: Huang, Yu, et al.
Veröffentlicht: (2025)
von: Huang, Yu, et al.
Veröffentlicht: (2025)
LongSkywork: A Training Recipe for Efficiently Extending Context Length in Large Language Models
von: Zhao, Liang, et al.
Veröffentlicht: (2024)
von: Zhao, Liang, et al.
Veröffentlicht: (2024)
PhysCodeBench: Benchmarking Physics-Aware Symbolic Simulation of 3D Scenes via Self-Corrective Multi-Agent Refinement
von: Xie, Tianyidan, et al.
Veröffentlicht: (2026)
von: Xie, Tianyidan, et al.
Veröffentlicht: (2026)
SATORI-R1: Incentivizing Multimodal Reasoning through Explicit Visual Anchoring
von: Shen, Chuming, et al.
Veröffentlicht: (2025)
von: Shen, Chuming, et al.
Veröffentlicht: (2025)
Training Deep Normalization-Free Spiking Neural Networks with Lateral Inhibition
von: Liu, Peiyu, et al.
Veröffentlicht: (2025)
von: Liu, Peiyu, et al.
Veröffentlicht: (2025)
Can MLLMs Reason in Multimodality? EMMA: An Enhanced MultiModal ReAsoning Benchmark
von: Hao, Yunzhuo, et al.
Veröffentlicht: (2025)
von: Hao, Yunzhuo, et al.
Veröffentlicht: (2025)
R-C2: Cycle-Consistent Reinforcement Learning Improves Multimodal Reasoning
von: Zhang, Zirui, et al.
Veröffentlicht: (2026)
von: Zhang, Zirui, et al.
Veröffentlicht: (2026)
Symbolic-Neural Soft-Logic Reasoning: Towards Robust and Verifiable Thinking Chains via Cooperative Evolution
von: Wang, Rui, et al.
Veröffentlicht: (2026)
von: Wang, Rui, et al.
Veröffentlicht: (2026)
SubstationAI: Multimodal Large Model-Based Approaches for Analyzing Substation Equipment Faults
von: Wang, Jinzhi, et al.
Veröffentlicht: (2024)
von: Wang, Jinzhi, et al.
Veröffentlicht: (2024)
ThinkMorph: Emergent Properties in Multimodal Interleaved Chain-of-Thought Reasoning
von: Gu, Jiawei, et al.
Veröffentlicht: (2025)
von: Gu, Jiawei, et al.
Veröffentlicht: (2025)
V-Zero: Self-Improving Multimodal Reasoning with Zero Annotation
von: Wang, Han, et al.
Veröffentlicht: (2026)
von: Wang, Han, et al.
Veröffentlicht: (2026)
Advancing Multimodal Reasoning via Reinforcement Learning with Cold Start
von: Wei, Lai, et al.
Veröffentlicht: (2025)
von: Wei, Lai, et al.
Veröffentlicht: (2025)
ConvSearch-R1: Enhancing Query Reformulation for Conversational Search with Reasoning via Reinforcement Learning
von: Zhu, Changtai, et al.
Veröffentlicht: (2025)
von: Zhu, Changtai, et al.
Veröffentlicht: (2025)
On the sharp quantitative stability of critical points of the Hardy-Littlewood-Sobolev inequality in $\mathbb{R}^{n}$ with $n\geq3$
von: Dai, Wei, et al.
Veröffentlicht: (2025)
von: Dai, Wei, et al.
Veröffentlicht: (2025)
R$^3$L: Reflect-then-Retry Reinforcement Learning with Language-Guided Exploration, Pivotal Credit, and Positive Amplification
von: Shi, Weijie, et al.
Veröffentlicht: (2026)
von: Shi, Weijie, et al.
Veröffentlicht: (2026)
Agent-Omni: Test-Time Multimodal Reasoning via Model Coordination for Understanding Anything
von: Lin, Huawei, et al.
Veröffentlicht: (2025)
von: Lin, Huawei, et al.
Veröffentlicht: (2025)
Metis-HOME: Hybrid Optimized Mixture-of-Experts for Multimodal Reasoning
von: Lan, Xiaohan, et al.
Veröffentlicht: (2025)
von: Lan, Xiaohan, et al.
Veröffentlicht: (2025)
Enhancing Blind Face Restoration through Online Reinforcement Learning
von: Wu, Bin, et al.
Veröffentlicht: (2025)
von: Wu, Bin, et al.
Veröffentlicht: (2025)
Improving Medical Reasoning with Curriculum-Aware Reinforcement Learning
von: Rui, Shaohao, et al.
Veröffentlicht: (2025)
von: Rui, Shaohao, et al.
Veröffentlicht: (2025)
Matrix-Game 3.0: Real-Time and Streaming Interactive World Model with Long-Horizon Memory
von: Wang, Zile, et al.
Veröffentlicht: (2026)
von: Wang, Zile, et al.
Veröffentlicht: (2026)
Perceptual-Evidence Anchored Reinforced Learning for Multimodal Reasoning
von: Zhang, Chi, et al.
Veröffentlicht: (2025)
von: Zhang, Chi, et al.
Veröffentlicht: (2025)
Reinforced MLLM: A Survey on RL-Based Reasoning in Multimodal Large Language Models
von: Zhou, Guanghao, et al.
Veröffentlicht: (2025)
von: Zhou, Guanghao, et al.
Veröffentlicht: (2025)
Zero-Shot Hashing Based on Reconstruction With Part Alignment
von: Jiang, Yan, et al.
Veröffentlicht: (2025)
von: Jiang, Yan, et al.
Veröffentlicht: (2025)
EMO-R3: Reflective Reinforcement Learning for Emotional Reasoning in Multimodal Large Language Models
von: Fang, Yiyang, et al.
Veröffentlicht: (2026)
von: Fang, Yiyang, et al.
Veröffentlicht: (2026)
Zeta Functions for Spherical Tits Buildings of Finite General Linear Groups
von: Shen, Jianhao
Veröffentlicht: (2023)
von: Shen, Jianhao
Veröffentlicht: (2023)
Edge Zeta Functions and Eigenvalues for Buildings of Finite Groups of Lie Type
von: Shen, Jianhao
Veröffentlicht: (2024)
von: Shen, Jianhao
Veröffentlicht: (2024)
Ähnliche Einträge
-
Skywork R1V: Pioneering Multimodal Reasoning with Chain-of-Thought
von: Peng, Yi, et al.
Veröffentlicht: (2025) -
Skywork-VL Reward: An Effective Reward Model for Multimodal Understanding and Reasoning
von: Wang, Xiaokun, et al.
Veröffentlicht: (2025) -
Skywork-R1V3 Technical Report
von: Shen, Wei, et al.
Veröffentlicht: (2025) -
CSVQA: A Chinese Multimodal Benchmark for Evaluating STEM Reasoning Capabilities of VLMs
von: Jian, Ai, et al.
Veröffentlicht: (2025) -
Skywork-R1V4: Toward Agentic Multimodal Intelligence through Interleaved Thinking with Images and DeepResearch
von: Zhang, Yifan, et al.
Veröffentlicht: (2025)