Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization
Fuente:
arXiv
Saved in:
| Main Authors: | Luo, Yifu, Sun, Haoyuan, Hu, Xinhao, Du, Penghui, Fan, Keyu, Li, Bo, Du, Sinan, Wan, Xu, Chen, Zhiyu, Xia, Bo, Zhang, Tiantian, Chang, Yongzhe, Yu, Changqian, Gai, Kun, Wang, Xueqian |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Reinforcement Learning Meets Masked Generative Models: Mask-GRPO for Text-to-Image Generation
by: Luo, Yifu, et al.
Published: (2025)
by: Luo, Yifu, et al.
Published: (2025)
Generalizing Alignment Paradigm of Text-to-Image Generation with Preferences through $f$-divergence Minimization
by: Sun, Haoyuan, et al.
Published: (2024)
by: Sun, Haoyuan, et al.
Published: (2024)
A Method on Searching Better Activation Functions
by: Sun, Haoyuan, et al.
Published: (2024)
by: Sun, Haoyuan, et al.
Published: (2024)
Wavelet Fourier Diffuser: Frequency-Aware Diffusion Model for Reinforcement Learning
by: Luo, Yifu, et al.
Published: (2025)
by: Luo, Yifu, et al.
Published: (2025)
Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models
by: Sun, Haoyuan, et al.
Published: (2025)
by: Sun, Haoyuan, et al.
Published: (2025)
DEER: A Delay-Resilient Framework for Reinforcement Learning with Variable Delays
by: Xia, Bo, et al.
Published: (2024)
by: Xia, Bo, et al.
Published: (2024)
UACER: An Uncertainty-Adaptive Critic Ensemble Framework for Robust Adversarial Reinforcement Learning
by: Wu, Jiaxi, et al.
Published: (2025)
by: Wu, Jiaxi, et al.
Published: (2025)
Embodied Co-Design for Rapidly Evolving Agents: Taxonomy, Frontiers, and Challenges
by: Wang, Yuxing, et al.
Published: (2025)
by: Wang, Yuxing, et al.
Published: (2025)
FlowErase-RL: Rethinking Concept Erasure as Reward Optimization in Flow Matching Models
by: Sun, Yi, et al.
Published: (2026)
by: Sun, Yi, et al.
Published: (2026)
Go Beyond Black-box Policies: Rethinking the Design of Learning Agent for Interpretable and Verifiable HVAC Control
by: An, Zhiyu, et al.
Published: (2024)
by: An, Zhiyu, et al.
Published: (2024)
IS-Diff: Improving Diffusion-Based Inpainting with Better Initial Seed
by: Lyu, Yongzhe, et al.
Published: (2025)
by: Lyu, Yongzhe, et al.
Published: (2025)
SSCFormer: Push the Limit of Chunk-wise Conformer for Streaming ASR Using Sequentially Sampled Chunks and Chunked Causal Convolution
by: Wang, Fangyuan, et al.
Published: (2022)
by: Wang, Fangyuan, et al.
Published: (2022)
VQRAE: Representation Quantization Autoencoders for Multimodal Understanding, Generation and Reconstruction
by: Du, Sinan, et al.
Published: (2025)
by: Du, Sinan, et al.
Published: (2025)
Open Problems in Differentiable Social Choice: Learning Mechanisms, Decisions, and Alignment
by: An, Zhiyu, et al.
Published: (2026)
by: An, Zhiyu, et al.
Published: (2026)
DIML: Differentiable Inverse Mechanism Learning from Behaviors of Multi-Agent Learning Trajectories
by: An, Zhiyu, et al.
Published: (2026)
by: An, Zhiyu, et al.
Published: (2026)
MoralReason: Generalizable Moral Decision Alignment For LLM Agents Using Reasoning-Level Reinforcement Learning
by: An, Zhiyu, et al.
Published: (2025)
by: An, Zhiyu, et al.
Published: (2025)
Representational Homomorphism Predicts and Improves Compositional Generalization In Transformer Language Model
by: An, Zhiyu, et al.
Published: (2026)
by: An, Zhiyu, et al.
Published: (2026)
FocalPolicy: Frequency-Optimized Chunking and Locally Anchored Flow Matching for Coherent Visuomotor Policy
by: He, Qian, et al.
Published: (2026)
by: He, Qian, et al.
Published: (2026)
Generative Modeling with Orbit-Space Particle Flow Matching
by: Wang, Sinan, et al.
Published: (2026)
by: Wang, Sinan, et al.
Published: (2026)
HiChunk: Evaluating and Enhancing Retrieval-Augmented Generation with Hierarchical Chunking
by: Lu, Wensheng, et al.
Published: (2025)
by: Lu, Wensheng, et al.
Published: (2025)
Lagrangian Flow Matching: A Least-Action Framework for Principled Path Design
by: Du, Shukai, et al.
Published: (2026)
by: Du, Shukai, et al.
Published: (2026)
Power Reinforcement Post-Training of Text-to-Image Models with Super-Linear Advantage Shaping
by: Sun, Haoyuan, et al.
Published: (2026)
by: Sun, Haoyuan, et al.
Published: (2026)
FM-IRL: Flow-Matching for Reward Modeling and Policy Regularization in Reinforcement Learning
by: Wan, Zhenglin, et al.
Published: (2025)
by: Wan, Zhenglin, et al.
Published: (2025)
FlowRL: A Taxonomy and Modular Framework for Reinforcement Learning with Diffusion Policies
by: Gao, Chenxiao, et al.
Published: (2026)
by: Gao, Chenxiao, et al.
Published: (2026)
Evolving Diffusion and Flow Matching Policies for Online Reinforcement Learning
by: Zhang, Chubin, et al.
Published: (2025)
by: Zhang, Chubin, et al.
Published: (2025)
Differential Voting: Loss Functions For Axiomatically Diverse Aggregation of Heterogeneous Preferences
by: An, Zhiyu, et al.
Published: (2026)
by: An, Zhiyu, et al.
Published: (2026)
Reward Bound for Behavioral Guarantee of Model-based Planning Agents
by: An, Zhiyu, et al.
Published: (2024)
by: An, Zhiyu, et al.
Published: (2024)
Beyond Noisy-TVs: Noise-Robust Exploration Via Learning Progress Monitoring
by: Hou, Zhibo, et al.
Published: (2025)
by: Hou, Zhibo, et al.
Published: (2025)
Disentangling Uncertainties by Learning Compressed Data Representation
by: An, Zhiyu, et al.
Published: (2025)
by: An, Zhiyu, et al.
Published: (2025)
When Less Latent Leads to Better Relay: Information-Preserving Compression for Latent Multi-Agent LLM Collaboration
by: Li, Yiping, et al.
Published: (2026)
by: Li, Yiping, et al.
Published: (2026)
PaddingFlow: Improving Normalizing Flows with Padding-Dimensional Noise
by: Meng, Qinglong, et al.
Published: (2024)
by: Meng, Qinglong, et al.
Published: (2024)
Learning Native Continuation for Action Chunking Flow Policies
by: Liu, Yufeng, et al.
Published: (2026)
by: Liu, Yufeng, et al.
Published: (2026)
Real-Time Execution of Action Chunking Flow Policies
by: Black, Kevin, et al.
Published: (2025)
by: Black, Kevin, et al.
Published: (2025)
Emerging Technologies
by: Küfeoğlu, Sinan
Published: (2022)
by: Küfeoğlu, Sinan
Published: (2022)
Visual Generation Tuning
by: Guo, Jiahao, et al.
Published: (2025)
by: Guo, Jiahao, et al.
Published: (2025)
Flow-GRPO: Training Flow Matching Models via Online RL
by: Liu, Jie, et al.
Published: (2025)
by: Liu, Jie, et al.
Published: (2025)
Virtual specialness of the double
by: Li, Changqian
Published: (2026)
by: Li, Changqian
Published: (2026)
Finite Stature in Graphs of Cube Complexes with Cyclonormal Edges
by: Li, Changqian
Published: (2026)
by: Li, Changqian
Published: (2026)
LongSpec: Long-Context Lossless Speculative Decoding with Efficient Drafting and Verification
by: Yang, Penghui, et al.
Published: (2025)
by: Yang, Penghui, et al.
Published: (2025)
Exploring the Impact of Resistance to AI , Cultural Openness and Collaboration on STEM Teachers' Professional Development: A Structural Equation Modelling Study
by: Bo Sun, et al.
Published: (2025)
by: Bo Sun, et al.
Published: (2025)
Similar Items
-
Reinforcement Learning Meets Masked Generative Models: Mask-GRPO for Text-to-Image Generation
by: Luo, Yifu, et al.
Published: (2025) -
Generalizing Alignment Paradigm of Text-to-Image Generation with Preferences through $f$-divergence Minimization
by: Sun, Haoyuan, et al.
Published: (2024) -
A Method on Searching Better Activation Functions
by: Sun, Haoyuan, et al.
Published: (2024) -
Wavelet Fourier Diffuser: Frequency-Aware Diffusion Model for Reinforcement Learning
by: Luo, Yifu, et al.
Published: (2025) -
Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models
by: Sun, Haoyuan, et al.
Published: (2025)