Weather-R1: Logically Consistent Reinforcement Fine-Tuning for Multimodal Reasoning in Meteorology
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wu, Kaiyu, Han, Pucheng, Zhang, Hualong, Wu, Naigeng, Wang, Keze |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhancing Visual Programming for Visual Reasoning via Probabilistic Graphs
par: Wan, Wentao, et autres
Publié: (2025)
par: Wan, Wentao, et autres
Publié: (2025)
Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models
par: Sun, Haoyuan, et autres
Publié: (2025)
par: Sun, Haoyuan, et autres
Publié: (2025)
GeoVLM-R1: Reinforcement Fine-Tuning for Improved Remote Sensing Reasoning
par: Fiaz, Mustansar, et autres
Publié: (2025)
par: Fiaz, Mustansar, et autres
Publié: (2025)
VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning
par: Qi, Zhangyang, et autres
Publié: (2025)
par: Qi, Zhangyang, et autres
Publié: (2025)
Video-R2: Reinforcing Consistent and Grounded Reasoning in Multimodal Language Models
par: Maaz, Muhammad, et autres
Publié: (2025)
par: Maaz, Muhammad, et autres
Publié: (2025)
ConsistentRFT: Reducing Visual Hallucinations in Flow-based Reinforcement Fine-Tuning
par: Tan, Xiaofeng, et autres
Publié: (2026)
par: Tan, Xiaofeng, et autres
Publié: (2026)
R1-Reward: Training Multimodal Reward Model Through Stable Reinforcement Learning
par: Zhang, Yi-Fan, et autres
Publié: (2025)
par: Zhang, Yi-Fan, et autres
Publié: (2025)
R-C2: Cycle-Consistent Reinforcement Learning Improves Multimodal Reasoning
par: Zhang, Zirui, et autres
Publié: (2026)
par: Zhang, Zirui, et autres
Publié: (2026)
Improving Network Interpretability via Explanation Consistency Evaluation
par: Wu, Hefeng, et autres
Publié: (2024)
par: Wu, Hefeng, et autres
Publié: (2024)
Improving Few-Shot Change Detection Visual Question Answering via Decision-Ambiguity-guided Reinforcement Fine-Tuning
par: Dong, Fuyu, et autres
Publié: (2025)
par: Dong, Fuyu, et autres
Publié: (2025)
Unified Multimodal Chain-of-Thought Reward Model through Reinforcement Fine-Tuning
par: Wang, Yibin, et autres
Publié: (2025)
par: Wang, Yibin, et autres
Publié: (2025)
Video-R1: Reinforcing Video Reasoning in MLLMs
par: Feng, Kaituo, et autres
Publié: (2025)
par: Feng, Kaituo, et autres
Publié: (2025)
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
par: Tan, Huajie, et autres
Publié: (2025)
par: Tan, Huajie, et autres
Publié: (2025)
VideoChat-R1: Enhancing Spatio-Temporal Perception via Reinforcement Fine-Tuning
par: Li, Xinhao, et autres
Publié: (2025)
par: Li, Xinhao, et autres
Publié: (2025)
Skywork R1V2: Multimodal Hybrid Reinforcement Learning for Reasoning
par: Wang, Peiyu, et autres
Publié: (2025)
par: Wang, Peiyu, et autres
Publié: (2025)
MMAT-1M: A Large Reasoning Dataset for Multimodal Agent Tuning
par: Gao, Tianhong, et autres
Publié: (2025)
par: Gao, Tianhong, et autres
Publié: (2025)
SVQA-R1: Reinforcing Spatial Reasoning in MLLMs via View-Consistent Reward Optimization
par: Wang, Peiyao, et autres
Publié: (2025)
par: Wang, Peiyao, et autres
Publié: (2025)
CAPO: Reinforcing Consistent Reasoning in Medical Decision-Making
par: Jiang, Songtao, et autres
Publié: (2025)
par: Jiang, Songtao, et autres
Publié: (2025)
DRIFT: Transferring Reasoning Priors for Efficient MLLM Fine-Tuning
par: Huang, Chao, et autres
Publié: (2025)
par: Huang, Chao, et autres
Publié: (2025)
ViSS-R1: Self-Supervised Reinforcement Video Reasoning
par: Fang, Bo, et autres
Publié: (2025)
par: Fang, Bo, et autres
Publié: (2025)
VAU-R1: Advancing Video Anomaly Understanding via Reinforcement Fine-Tuning
par: Zhu, Liyun, et autres
Publié: (2025)
par: Zhu, Liyun, et autres
Publié: (2025)
STAR-R1: Spatial TrAnsformation Reasoning by Reinforcing Multimodal LLMs
par: Li, Zongzhao, et autres
Publié: (2025)
par: Li, Zongzhao, et autres
Publié: (2025)
VideoRFT: Incentivizing Video Reasoning Capability in MLLMs via Reinforced Fine-Tuning
par: Wang, Qi, et autres
Publié: (2025)
par: Wang, Qi, et autres
Publié: (2025)
Affordance-R1: Reinforcement Learning for Generalizable Affordance Reasoning in Multimodal Large Language Model
par: Wang, Hanqing, et autres
Publié: (2025)
par: Wang, Hanqing, et autres
Publié: (2025)
Interpretable Logical Anomaly Classification via Constraint Decomposition and Instruction Fine-Tuning
par: Zhang, Xufei, et autres
Publié: (2026)
par: Zhang, Xufei, et autres
Publié: (2026)
MuSLR: Multimodal Symbolic Logical Reasoning
par: Xu, Jundong, et autres
Publié: (2025)
par: Xu, Jundong, et autres
Publié: (2025)
Cultivating Forensic Reasoning for Generalizable Multimodal Manipulation Detection
par: Zhang, Yuchen, et autres
Publié: (2026)
par: Zhang, Yuchen, et autres
Publié: (2026)
TempSamp-R1: Effective Temporal Sampling with Reinforcement Fine-Tuning for Video LLMs
par: Li, Yunheng, et autres
Publié: (2025)
par: Li, Yunheng, et autres
Publié: (2025)
MedAD-R1: Eliciting Consistent Reasoning in Interpretible Medical Anomaly Detection via Consistency-Reinforced Policy Optimization
par: Zhang, Haitao, et autres
Publié: (2026)
par: Zhang, Haitao, et autres
Publié: (2026)
Med-CMR: A Fine-Grained Benchmark Integrating Visual Evidence and Clinical Logic for Medical Complex Multimodal Reasoning
par: Gong, Haozhen, et autres
Publié: (2025)
par: Gong, Haozhen, et autres
Publié: (2025)
GeoReason: Aligning Thinking And Answering In Remote Sensing Vision-Language Models Via Logical Consistency Reinforcement Learning
par: Li, Wenshuai, et autres
Publié: (2026)
par: Li, Wenshuai, et autres
Publié: (2026)
GMAI-VL-R1: Harnessing Reinforcement Learning for Multimodal Medical Reasoning
par: Su, Yanzhou, et autres
Publié: (2025)
par: Su, Yanzhou, et autres
Publié: (2025)
Retrv-R1: A Reasoning-Driven MLLM Framework for Universal and Efficient Multimodal Retrieval
par: Zhu, Lanyun, et autres
Publié: (2025)
par: Zhu, Lanyun, et autres
Publié: (2025)
LogicNet: A Logical Consistency Embedded Face Attribute Learning Network
par: Wu, Haiyu, et autres
Publié: (2023)
par: Wu, Haiyu, et autres
Publié: (2023)
IAD-R1: Reinforcing Consistent Reasoning in Industrial Anomaly Detection
par: Li, Yanhui, et autres
Publié: (2025)
par: Li, Yanhui, et autres
Publié: (2025)
Wan-R1: Verifiable-Reinforcement Learning for Video Reasoning
par: Liu, Ming, et autres
Publié: (2026)
par: Liu, Ming, et autres
Publié: (2026)
MMhops-R1: Multimodal Multi-hop Reasoning
par: Zhang, Tao, et autres
Publié: (2025)
par: Zhang, Tao, et autres
Publié: (2025)
Visual-RFT: Visual Reinforcement Fine-Tuning
par: Liu, Ziyu, et autres
Publié: (2025)
par: Liu, Ziyu, et autres
Publié: (2025)
RGBX-R1: Visual Modality Chain-of-Thought Guided Reinforcement Learning for Multimodal Grounding
par: Wu, Jiahe, et autres
Publié: (2026)
par: Wu, Jiahe, et autres
Publié: (2026)
VisualQuality-R1: Reasoning-Induced Image Quality Assessment via Reinforcement Learning to Rank
par: Wu, Tianhe, et autres
Publié: (2025)
par: Wu, Tianhe, et autres
Publié: (2025)
Documents similaires
-
Enhancing Visual Programming for Visual Reasoning via Probabilistic Graphs
par: Wan, Wentao, et autres
Publié: (2025) -
Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models
par: Sun, Haoyuan, et autres
Publié: (2025) -
GeoVLM-R1: Reinforcement Fine-Tuning for Improved Remote Sensing Reasoning
par: Fiaz, Mustansar, et autres
Publié: (2025) -
VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning
par: Qi, Zhangyang, et autres
Publié: (2025) -
Video-R2: Reinforcing Consistent and Grounded Reasoning in Multimodal Language Models
par: Maaz, Muhammad, et autres
Publié: (2025)