CreFlow: Corrective Reflow for Sparse-Reward Embodied Video Diffusion RL
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ni, Zhenyang, Li, Yijiang, Jiao, Ruochen, Zhan, Simon Sinong, Chen, Sipeng, Yin, Zhenfei, Chen, Minshuo, Torr, Philip, Wang, Zhaoran, Zhu, Qi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhancing Inverse Reinforcement Learning through Encoding Dynamic Information in Reward Shaping
par: Zhan, Simon Sinong, et autres
Publié: (2024)
par: Zhan, Simon Sinong, et autres
Publié: (2024)
CoMAS: Co-Evolving Multi-Agent Systems via Interaction Rewards
par: Xue, Xiangyuan, et autres
Publié: (2025)
par: Xue, Xiangyuan, et autres
Publié: (2025)
Empowering Autonomous Driving with Large Language Models: A Safety Perspective
par: Wang, Yixuan, et autres
Publié: (2023)
par: Wang, Yixuan, et autres
Publié: (2023)
Training-Free Adaptation of Diffusion Models via Doob's $h$-Transform
par: Zhu, Qijie, et autres
Publié: (2026)
par: Zhu, Qijie, et autres
Publié: (2026)
ProReflow: Progressive Reflow with Decomposed Velocity
par: Ke, Lei, et autres
Publié: (2025)
par: Ke, Lei, et autres
Publié: (2025)
VIKI-R: Coordinating Embodied Multi-Agent Cooperation via Reinforcement Learning
par: Kang, Li, et autres
Publié: (2025)
par: Kang, Li, et autres
Publié: (2025)
VideoOrion: Tokenizing Object Dynamics in Videos
par: Feng, Yicheng, et autres
Publié: (2024)
par: Feng, Yicheng, et autres
Publié: (2024)
Dual-Granularity Contrastive Reward via Generated Episodic Guidance for Efficient Embodied RL
par: Liu, Xin, et autres
Publié: (2026)
par: Liu, Xin, et autres
Publié: (2026)
Inverse Delayed Reinforcement Learning
par: Zhan, Simon Sinong, et autres
Publié: (2024)
par: Zhan, Simon Sinong, et autres
Publié: (2024)
Diffusion Transformers for Imputation: Statistical Efficiency and Uncertainty Quantification
par: Ye, Zeqi, et autres
Publié: (2025)
par: Ye, Zeqi, et autres
Publié: (2025)
STO-RL: Offline RL under Sparse Rewards via LLM-Guided Subgoal Temporal Order
par: Gu, Chengyang, et autres
Publié: (2026)
par: Gu, Chengyang, et autres
Publié: (2026)
Improving Offline RL by Blending Heuristics
par: Geng, Sinong, et autres
Publié: (2023)
par: Geng, Sinong, et autres
Publié: (2023)
Efficient Molecular Conformer Generation with SO(3)-Averaged Flow Matching and Reflow
par: Cao, Zhonglin, et autres
Publié: (2025)
par: Cao, Zhonglin, et autres
Publié: (2025)
Language-Model-Assisted Bi-Level Programming for Reward Learning from Internet Videos
par: Mahesheka, Harsh, et autres
Publié: (2024)
par: Mahesheka, Harsh, et autres
Publié: (2024)
Behavioral Consistency Validation for LLM Agents: An Analysis of Trading-Style Switching through Stock-Market Simulation
par: Li, Zeping, et autres
Publié: (2026)
par: Li, Zeping, et autres
Publié: (2026)
A Theoretical Perspective for Speculative Decoding Algorithm
par: Yin, Ming, et autres
Publié: (2024)
par: Yin, Ming, et autres
Publié: (2024)
Reward-Decomposed Reinforcement Learning for Immersive Video Role-Playing
par: Wang, Miao, et autres
Publié: (2026)
par: Wang, Miao, et autres
Publié: (2026)
Beyond Correctness: Harmonizing Process and Outcome Rewards through RL Training
par: Ye, Chenlu, et autres
Publié: (2025)
par: Ye, Chenlu, et autres
Publié: (2025)
FlowRL: Matching Reward Distributions for LLM Reasoning
par: Zhu, Xuekai, et autres
Publié: (2025)
par: Zhu, Xuekai, et autres
Publié: (2025)
Can We Trust Embodied Agents? Exploring Backdoor Attacks against Embodied LLM-based Decision-Making Systems
par: Jiao, Ruochen, et autres
Publié: (2024)
par: Jiao, Ruochen, et autres
Publié: (2024)
FlowErase-RL: Rethinking Concept Erasure as Reward Optimization in Flow Matching Models
par: Sun, Yi, et autres
Publié: (2026)
par: Sun, Yi, et autres
Publié: (2026)
Comparative analysis of two newly established Cre rat lines, NeuN‐Cre and Thy1‐Cre, for neurological research
par: Keru Li, et autres
Publié: (2025)
par: Keru Li, et autres
Publié: (2025)
Evaluating Model Robustness Using Adaptive Sparse L0 Regularization
par: Liu, Weiyou, et autres
Publié: (2024)
par: Liu, Weiyou, et autres
Publié: (2024)
Ego to World: Collaborative Spatial Reasoning in Embodied Systems via Reinforcement Learning
par: Zhou, Heng, et autres
Publié: (2026)
par: Zhou, Heng, et autres
Publié: (2026)
Lineage labeling with zebrafish hand2 Cre and CreERT2 recombinase CRISPR knock‐ins
par: Zhitao Ming, et autres
Publié: (2025)
par: Zhitao Ming, et autres
Publié: (2025)
Switching Controller Synthesis for Hybrid Systems Against STL Formulas
par: Su, Han, et autres
Publié: (2024)
par: Su, Han, et autres
Publié: (2024)
Dynamic Mixture of Latent Memories for Self-Evolving Agents
par: Yu, Dianzhi, et autres
Publié: (2026)
par: Yu, Dianzhi, et autres
Publié: (2026)
Multi-Fidelity Flow Matching: Cascaded Refinement of PDE Solutions
par: Chen, Sipeng, et autres
Publié: (2026)
par: Chen, Sipeng, et autres
Publié: (2026)
Beyond Reward Hacking: Causal Rewards for Large Language Model Alignment
par: Wang, Chaoqi, et autres
Publié: (2025)
par: Wang, Chaoqi, et autres
Publié: (2025)
Parameter-Efficient Subspace Optimization for LLM Fine-Tuning
par: Lou, Yuchen, et autres
Publié: (2025)
par: Lou, Yuchen, et autres
Publié: (2025)
Effect of Thermal Reflow on Microstructural Morphology and Contact Mechanics in the Photo‐Lithographic Fabrication of Biomimetic Adhesive Materials
par: Conghui Li, et autres
Publié: (2025)
par: Conghui Li, et autres
Publié: (2025)
Goldilocks RL: Tuning Task Difficulty to Escape Sparse Rewards for Reasoning
par: Mahrooghi, Ilia, et autres
Publié: (2026)
par: Mahrooghi, Ilia, et autres
Publié: (2026)
StraTA: Incentivizing Agentic Reinforcement Learning with Strategic Trajectory Abstraction
par: Xue, Xiangyuan, et autres
Publié: (2026)
par: Xue, Xiangyuan, et autres
Publié: (2026)
Breaking the Barrier: Unraveling the No‐Reflow Phenomenon in Cardiovascular Medicine
par: Stephanie Howes, et autres
Publié: (2025)
par: Stephanie Howes, et autres
Publié: (2025)
Acan_Cre_BARseq3
par: Cheron, Julian, et autres
Publié: (2026)
par: Cheron, Julian, et autres
Publié: (2026)
Shop-R1: Rewarding LLMs to Simulate Human Behavior in Online Shopping via Reinforcement Learning
par: Zhang, Yimeng, et autres
Publié: (2025)
par: Zhang, Yimeng, et autres
Publié: (2025)
Do Sparse Autoencoders Generalize? A Case Study of Answerability
par: Heindrich, Lovis, et autres
Publié: (2025)
par: Heindrich, Lovis, et autres
Publié: (2025)
Are Transformers Able to Reason by Connecting Separated Knowledge in Training Data?
par: Yin, Yutong, et autres
Publié: (2025)
par: Yin, Yutong, et autres
Publié: (2025)
From Inference Efficiency to Embodied Efficiency: Revisiting Efficiency Metrics for Vision-Language-Action Models
par: Li, Zhuofan, et autres
Publié: (2026)
par: Li, Zhuofan, et autres
Publié: (2026)
UNEX-RL: Reinforcing Long-Term Rewards in Multi-Stage Recommender Systems with UNidirectional EXecution
par: Zhang, Gengrui, et autres
Publié: (2024)
par: Zhang, Gengrui, et autres
Publié: (2024)
Documents similaires
-
Enhancing Inverse Reinforcement Learning through Encoding Dynamic Information in Reward Shaping
par: Zhan, Simon Sinong, et autres
Publié: (2024) -
CoMAS: Co-Evolving Multi-Agent Systems via Interaction Rewards
par: Xue, Xiangyuan, et autres
Publié: (2025) -
Empowering Autonomous Driving with Large Language Models: A Safety Perspective
par: Wang, Yixuan, et autres
Publié: (2023) -
Training-Free Adaptation of Diffusion Models via Doob's $h$-Transform
par: Zhu, Qijie, et autres
Publié: (2026) -
ProReflow: Progressive Reflow with Decomposed Velocity
par: Ke, Lei, et autres
Publié: (2025)