NoisyRollout: Reinforcing Visual Reasoning with Data Augmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Xiangyan, Ni, Jinjie, Wu, Zijian, Du, Chao, Dou, Longxu, Wang, Haonan, Pang, Tianyu, Shieh, Michael Qizhe |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis
di: Wu, Zijian, et al.
Pubblicazione: (2025)
di: Wu, Zijian, et al.
Pubblicazione: (2025)
Diffusion Language Models are Super Data Learners
di: Ni, Jinjie, et al.
Pubblicazione: (2025)
di: Ni, Jinjie, et al.
Pubblicazione: (2025)
Training Optimal Large Diffusion Language Models
di: Ni, Jinjie, et al.
Pubblicazione: (2025)
di: Ni, Jinjie, et al.
Pubblicazione: (2025)
Fostering Video Reasoning via Next-Event Prediction
di: Wang, Haonan, et al.
Pubblicazione: (2025)
di: Wang, Haonan, et al.
Pubblicazione: (2025)
Improving Autoregressive Image Generation through Coarse-to-Fine Token Prediction
di: Guo, Ziyao, et al.
Pubblicazione: (2025)
di: Guo, Ziyao, et al.
Pubblicazione: (2025)
Gym-V: A Unified Vision Environment System for Agentic Vision Research
di: Meng, Fanqing, et al.
Pubblicazione: (2026)
di: Meng, Fanqing, et al.
Pubblicazione: (2026)
ImageEdit-R1: Boosting Multi-Agent Image Editing via Reinforcement Learning
di: Zhao, Yiran, et al.
Pubblicazione: (2026)
di: Zhao, Yiran, et al.
Pubblicazione: (2026)
SAVAA: Mitigating Hallucinations in LVLMs via Step-wise Adaptive Visual Attention Amplification
di: Zhang, Jiacheng, et al.
Pubblicazione: (2026)
di: Zhang, Jiacheng, et al.
Pubblicazione: (2026)
ThinkMorph: Emergent Properties in Multimodal Interleaved Chain-of-Thought Reasoning
di: Gu, Jiawei, et al.
Pubblicazione: (2025)
di: Gu, Jiawei, et al.
Pubblicazione: (2025)
RAPID: Long-Context Inference with Retrieval-Augmented Speculative Decoding
di: Chen, Guanzheng, et al.
Pubblicazione: (2025)
di: Chen, Guanzheng, et al.
Pubblicazione: (2025)
Efficient Process Reward Model Training via Active Learning
di: Duan, Keyu, et al.
Pubblicazione: (2025)
di: Duan, Keyu, et al.
Pubblicazione: (2025)
Improving Medical Visual Reinforcement Fine-Tuning via Perception and Reasoning Augmentation
di: Yang, Guangjing, et al.
Pubblicazione: (2026)
di: Yang, Guangjing, et al.
Pubblicazione: (2026)
Intriguing Properties of Data Attribution on Diffusion Models
di: Zheng, Xiaosen, et al.
Pubblicazione: (2023)
di: Zheng, Xiaosen, et al.
Pubblicazione: (2023)
Improved Visual-Spatial Reasoning via R1-Zero-Like Training
di: Liao, Zhenyi, et al.
Pubblicazione: (2025)
di: Liao, Zhenyi, et al.
Pubblicazione: (2025)
Video Spatial Reasoning with Object-Centric 3D Rollout
di: Tang, Haoran, et al.
Pubblicazione: (2025)
di: Tang, Haoran, et al.
Pubblicazione: (2025)
Unnatural Languages Are Not Bugs but Features for LLMs
di: Duan, Keyu, et al.
Pubblicazione: (2025)
di: Duan, Keyu, et al.
Pubblicazione: (2025)
Grounded Reinforcement Learning for Visual Reasoning
di: Sarch, Gabriel, et al.
Pubblicazione: (2025)
di: Sarch, Gabriel, et al.
Pubblicazione: (2025)
Point-RFT: Improving Multimodal Reasoning with Visually Grounded Reinforcement Finetuning
di: Ni, Minheng, et al.
Pubblicazione: (2025)
di: Ni, Minheng, et al.
Pubblicazione: (2025)
ADLDA: A Method to Reduce the Harm of Data Distribution Shift in Data Augmentation
di: Wang, Haonan
Pubblicazione: (2024)
di: Wang, Haonan
Pubblicazione: (2024)
MoSA: Mixture of Sparse Adapters for Visual Efficient Tuning
di: Zhang, Qizhe, et al.
Pubblicazione: (2023)
di: Zhang, Qizhe, et al.
Pubblicazione: (2023)
Look Less, Reason More: Rollout-Guided Adaptive Pixel-Space Reasoning
di: Li, Xuchen, et al.
Pubblicazione: (2025)
di: Li, Xuchen, et al.
Pubblicazione: (2025)
AURORA:Augmented Understanding via Structured Reasoning and Reinforcement Learning for Reference Audio-Visual Segmentation
di: Luo, Ziyang, et al.
Pubblicazione: (2025)
di: Luo, Ziyang, et al.
Pubblicazione: (2025)
A Comprehensive Survey of Data Augmentation in Visual Reinforcement Learning
di: Ma, Guozheng, et al.
Pubblicazione: (2022)
di: Ma, Guozheng, et al.
Pubblicazione: (2022)
QuickVideo: Real-Time Long Video Understanding with System Algorithm Co-Design
di: Schneider, Benjamin, et al.
Pubblicazione: (2025)
di: Schneider, Benjamin, et al.
Pubblicazione: (2025)
PROPA: Toward Process-level Optimization in Visual Reasoning via Reinforcement Learning
di: Jiang, Yanbei, et al.
Pubblicazione: (2025)
di: Jiang, Yanbei, et al.
Pubblicazione: (2025)
CamReasoner: Reinforcing Camera Movement Understanding via Structured Spatial Reasoning
di: Wu, Hang, et al.
Pubblicazione: (2026)
di: Wu, Hang, et al.
Pubblicazione: (2026)
Orient Anything: Learning Robust Object Orientation Estimation from Rendering 3D Models
di: Wang, Zehan, et al.
Pubblicazione: (2024)
di: Wang, Zehan, et al.
Pubblicazione: (2024)
Real-time Identity Defenses against Malicious Personalization of Diffusion Models
di: Guo, Hanzhong, et al.
Pubblicazione: (2024)
di: Guo, Hanzhong, et al.
Pubblicazione: (2024)
VIKSER: Visual Knowledge-Driven Self-Reinforcing Reasoning Framework
di: Wang, Chao, et al.
Pubblicazione: (2025)
di: Wang, Chao, et al.
Pubblicazione: (2025)
FrameMind: Frame-Interleaved Video Reasoning via Reinforcement Learning
di: Ge, Haonan, et al.
Pubblicazione: (2025)
di: Ge, Haonan, et al.
Pubblicazione: (2025)
VACoT: Rethinking Visual Data Augmentation with VLMs
di: Xu, Zhengzhuo, et al.
Pubblicazione: (2025)
di: Xu, Zhengzhuo, et al.
Pubblicazione: (2025)
A Recipe for Unbounded Data Augmentation in Visual Reinforcement Learning
di: Almuzairee, Abdulaziz, et al.
Pubblicazione: (2024)
di: Almuzairee, Abdulaziz, et al.
Pubblicazione: (2024)
VGR: Visual Grounded Reasoning
di: Wang, Jiacong, et al.
Pubblicazione: (2025)
di: Wang, Jiacong, et al.
Pubblicazione: (2025)
Video-R4: Reinforcing Text-Rich Video Reasoning with Visual Rumination
di: Tang, Yolo Y., et al.
Pubblicazione: (2025)
di: Tang, Yolo Y., et al.
Pubblicazione: (2025)
FlowReasoner: Reinforcing Query-Level Meta-Agents
di: Gao, Hongcheng, et al.
Pubblicazione: (2025)
di: Gao, Hongcheng, et al.
Pubblicazione: (2025)
MiCo: Multi-image Contrast for Reinforcement Visual Reasoning
di: Chen, Xi, et al.
Pubblicazione: (2025)
di: Chen, Xi, et al.
Pubblicazione: (2025)
Learning Self-Correction in Vision-Language Models via Rollout Augmentation
di: Ding, Yi, et al.
Pubblicazione: (2026)
di: Ding, Yi, et al.
Pubblicazione: (2026)
Persistent Robot World Models: Stabilizing Multi-Step Rollouts via Reinforcement Learning
di: Bardhan, Jai, et al.
Pubblicazione: (2026)
di: Bardhan, Jai, et al.
Pubblicazione: (2026)
Remote Sensing ChatGPT: Solving Remote Sensing Tasks with ChatGPT and Visual Models
di: Guo, Haonan, et al.
Pubblicazione: (2024)
di: Guo, Haonan, et al.
Pubblicazione: (2024)
Stable and Efficient Single-Rollout RL for Multimodal Reasoning
di: Liu, Rui, et al.
Pubblicazione: (2025)
di: Liu, Rui, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis
di: Wu, Zijian, et al.
Pubblicazione: (2025) -
Diffusion Language Models are Super Data Learners
di: Ni, Jinjie, et al.
Pubblicazione: (2025) -
Training Optimal Large Diffusion Language Models
di: Ni, Jinjie, et al.
Pubblicazione: (2025) -
Fostering Video Reasoning via Next-Event Prediction
di: Wang, Haonan, et al.
Pubblicazione: (2025) -
Improving Autoregressive Image Generation through Coarse-to-Fine Token Prediction
di: Guo, Ziyao, et al.
Pubblicazione: (2025)