How to Guide Your Flow: Few-Step Alignment via Flow Map Reward Guidance
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Jerry Y., Lin, Justin, Shah, Sheel, Nair, Kartik, Boffi, Nicholas M. |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Diamond Maps: Efficient Reward Alignment via Stochastic Flow Maps
par: Holderrieth, Peter, et autres
Publié: (2026)
par: Holderrieth, Peter, et autres
Publié: (2026)
Flow Map Language Models: One-step Language Modeling via Continuous Denoising
par: Lee, Chanhyuk, et autres
Publié: (2026)
par: Lee, Chanhyuk, et autres
Publié: (2026)
Generalised Flow Maps for Few-Step Generative Modelling on Riemannian Manifolds
par: Davis, Oscar, et autres
Publié: (2025)
par: Davis, Oscar, et autres
Publié: (2025)
Flow-Direct: Feedback-Efficient and Reusable Guidance for Flow Models via Non-Parametric Guidance Field
par: Tan, Kim Yong, et autres
Publié: (2026)
par: Tan, Kim Yong, et autres
Publié: (2026)
SplitMeanFlow: Interval Splitting Consistency in Few-Step Generative Modeling
par: Guo, Yi, et autres
Publié: (2025)
par: Guo, Yi, et autres
Publié: (2025)
Trajectory as the Teacher: Few-Step Discrete Flow Matching via Energy-Navigated Distillation
par: Monsefi, Amin Karimi, et autres
Publié: (2026)
par: Monsefi, Amin Karimi, et autres
Publié: (2026)
Variational Flow Models: Flowing in Your Style
par: Do, Kien, et autres
Publié: (2024)
par: Do, Kien, et autres
Publié: (2024)
FlowLM: Few-Step Language Modeling via Diffusion-to-Flow Adaptation
par: Zhang, Runzhe, et autres
Publié: (2026)
par: Zhang, Runzhe, et autres
Publié: (2026)
pi-Flow: Policy-Based Few-Step Generation via Imitation Distillation
par: Chen, Hansheng, et autres
Publié: (2025)
par: Chen, Hansheng, et autres
Publié: (2025)
Boosting Reinforcement Learning with Verifiable Rewards via Randomly Selected Few-Shot Guidance
par: Yan, Kai, et autres
Publié: (2026)
par: Yan, Kai, et autres
Publié: (2026)
Let Physics Guide Your Protein Flows: Topology-aware Unfolding and Generation
par: Verma, Yogesh, et autres
Publié: (2025)
par: Verma, Yogesh, et autres
Publié: (2025)
Sharpen Your Flow: Sharpness-Aware Sampling for Flow Matching
par: Gupta, Aditi, et autres
Publié: (2026)
par: Gupta, Aditi, et autres
Publié: (2026)
LLM Reasoning with Process Rewards for Outcome-Guided Steps
par: Rezaei, Mohammad, et autres
Publié: (2026)
par: Rezaei, Mohammad, et autres
Publié: (2026)
Discrete MeanFlow: One-Step Generation via Conditional Transition Kernels
par: Khan, Fairoz Nower, et autres
Publié: (2026)
par: Khan, Fairoz Nower, et autres
Publié: (2026)
Conflict-Aware Additive Guidance for Flow Models under Compositional Rewards
par: Yu, Xuehui, et autres
Publié: (2026)
par: Yu, Xuehui, et autres
Publié: (2026)
ProFlow: Zero-Shot Physics-Consistent Sampling via Proximal Flow Guidance
par: Yu, Zichao, et autres
Publié: (2026)
par: Yu, Zichao, et autres
Publié: (2026)
Entropy Aware Reward Guidance for Diffusion Language Model Alignment
par: Tejaswi, Atula, et autres
Publié: (2026)
par: Tejaswi, Atula, et autres
Publié: (2026)
TFG-Flow: Training-free Guidance in Multimodal Generative Flow
par: Lin, Haowei, et autres
Publié: (2025)
par: Lin, Haowei, et autres
Publié: (2025)
Few-shot Steerable Alignment: Adapting Rewards and LLM Policies with Neural Processes
par: Kobalczyk, Katarzyna, et autres
Publié: (2024)
par: Kobalczyk, Katarzyna, et autres
Publié: (2024)
GLASS Flows: Transition Sampling for Alignment of Flow and Diffusion Models
par: Holderrieth, Peter, et autres
Publié: (2025)
par: Holderrieth, Peter, et autres
Publié: (2025)
ARGS: Alignment as Reward-Guided Search
par: Khanov, Maxim, et autres
Publié: (2024)
par: Khanov, Maxim, et autres
Publié: (2024)
Maximize Your Diffusion: A Study into Reward Maximization and Alignment for Diffusion-based Control
par: Huh, Dom, et autres
Publié: (2025)
par: Huh, Dom, et autres
Publié: (2025)
Strong Stochastic Flow Maps
par: McCallum, Sam, et autres
Publié: (2026)
par: McCallum, Sam, et autres
Publié: (2026)
FALCON: Few-step Accurate Likelihoods for Continuous Flows
par: Rehman, Danyal, et autres
Publié: (2025)
par: Rehman, Danyal, et autres
Publié: (2025)
Boosting Maximum Entropy Reinforcement Learning via One-Step Flow Matching
par: Li, Zeqiao, et autres
Publié: (2026)
par: Li, Zeqiao, et autres
Publié: (2026)
Where and How to Perturb: On the Design of Perturbation Guidance in Diffusion and Flow Models
par: Ahn, Donghoon, et autres
Publié: (2025)
par: Ahn, Donghoon, et autres
Publié: (2025)
LatentFlow: Cross-Frequency Experimental Flow Reconstruction from Sparse Pressure via Latent Mapping
par: Liu, Junle, et autres
Publié: (2025)
par: Liu, Junle, et autres
Publié: (2025)
FlowSteer: Guiding Few-Step Image Synthesis with Authentic Trajectories
par: Ke, Lei, et autres
Publié: (2025)
par: Ke, Lei, et autres
Publié: (2025)
FlowRL: Matching Reward Distributions for LLM Reasoning
par: Zhu, Xuekai, et autres
Publié: (2025)
par: Zhu, Xuekai, et autres
Publié: (2025)
CoFlow: Coordinated Few-Step Flow for Offline Multi-Agent Decision Making
par: Zou, Guowei, et autres
Publié: (2026)
par: Zou, Guowei, et autres
Publié: (2026)
Guided Flow Policy: Learning from High-Value Actions in Offline Reinforcement Learning
par: Tiofack, Franki Nguimatsia, et autres
Publié: (2025)
par: Tiofack, Franki Nguimatsia, et autres
Publié: (2025)
FlashMotion: Few-Step Controllable Video Generation with Trajectory Guidance
par: Li, Quanhao, et autres
Publié: (2026)
par: Li, Quanhao, et autres
Publié: (2026)
FlowDistill: Scalable Traffic Flow Prediction via Distillation from LLMs
par: Yu, Chenyang, et autres
Publié: (2025)
par: Yu, Chenyang, et autres
Publié: (2025)
Scalable, Explainable and Provably Robust Anomaly Detection with One-Step Flow Matching
par: Li, Zhong, et autres
Publié: (2025)
par: Li, Zhong, et autres
Publié: (2025)
GEM: Generative Entropy-Guided Preference Modeling for Few-shot Alignment of LLMs
par: Zhao, Yiyang, et autres
Publié: (2025)
par: Zhao, Yiyang, et autres
Publié: (2025)
Energy Guided Geometric Flow Matching
par: Zweig, Aaron, et autres
Publié: (2025)
par: Zweig, Aaron, et autres
Publié: (2025)
Evolution Guided Generative Flow Networks
par: Ikram, Zarif, et autres
Publié: (2024)
par: Ikram, Zarif, et autres
Publié: (2024)
Self-Guided Process Reward Optimization with Redefined Step-wise Advantage for Process Reinforcement Learning
par: Fei, Wu, et autres
Publié: (2025)
par: Fei, Wu, et autres
Publié: (2025)
FlowQ: Energy-Guided Flow Policies for Offline Reinforcement Learning
par: Alles, Marvin, et autres
Publié: (2025)
par: Alles, Marvin, et autres
Publié: (2025)
Path-Guided Flow Matching for Dataset Distillation
par: Li, Xuhui, et autres
Publié: (2026)
par: Li, Xuhui, et autres
Publié: (2026)
Documents similaires
-
Diamond Maps: Efficient Reward Alignment via Stochastic Flow Maps
par: Holderrieth, Peter, et autres
Publié: (2026) -
Flow Map Language Models: One-step Language Modeling via Continuous Denoising
par: Lee, Chanhyuk, et autres
Publié: (2026) -
Generalised Flow Maps for Few-Step Generative Modelling on Riemannian Manifolds
par: Davis, Oscar, et autres
Publié: (2025) -
Flow-Direct: Feedback-Efficient and Reusable Guidance for Flow Models via Non-Parametric Guidance Field
par: Tan, Kim Yong, et autres
Publié: (2026) -
SplitMeanFlow: Interval Splitting Consistency in Few-Step Generative Modeling
par: Guo, Yi, et autres
Publié: (2025)