Value-Guidance MeanFlow for Offline Multi-Agent Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Pang, Teng, Dong, Zhiqiang, Zhang, Yan, Xu, Rongjian, Wu, Guoqiang, Yin, Yilong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Equivariant Efficient Joint Discrete and Continuous MeanFlow for Molecular Graph Generation
von: Xu, Rongjian, et al.
Veröffentlicht: (2026)
von: Xu, Rongjian, et al.
Veröffentlicht: (2026)
Efficient Hierarchical Implicit Flow Q-learning for Offline Goal-conditioned Reinforcement Learning
von: Dong, Zhiqiang, et al.
Veröffentlicht: (2026)
von: Dong, Zhiqiang, et al.
Veröffentlicht: (2026)
Diffusion Classifier-Driven Reward for Offline Preference-based Reinforcement Learning
von: Pang, Teng, et al.
Veröffentlicht: (2025)
von: Pang, Teng, et al.
Veröffentlicht: (2025)
Riemannian MeanFlow for One-Step Generation on Manifolds
von: Zhong, Zichen, et al.
Veröffentlicht: (2026)
von: Zhong, Zichen, et al.
Veröffentlicht: (2026)
Towards Macro-AUC oriented Imbalanced Multi-Label Continual Learning
von: Zhang, Yan, et al.
Veröffentlicht: (2024)
von: Zhang, Yan, et al.
Veröffentlicht: (2024)
Riemannian MeanFlow
von: Woo, Dongyeop, et al.
Veröffentlicht: (2026)
von: Woo, Dongyeop, et al.
Veröffentlicht: (2026)
MeanFlow Transformers with Representation Autoencoders
von: Hu, Zheyuan, et al.
Veröffentlicht: (2025)
von: Hu, Zheyuan, et al.
Veröffentlicht: (2025)
AlphaFlow: Understanding and Improving MeanFlow Models
von: Zhang, Huijie, et al.
Veröffentlicht: (2025)
von: Zhang, Huijie, et al.
Veröffentlicht: (2025)
Understanding, Accelerating, and Improving MeanFlow Training
von: Kim, Jin-Young, et al.
Veröffentlicht: (2025)
von: Kim, Jin-Young, et al.
Veröffentlicht: (2025)
One-Step Generative Policies with Q-Learning: A Reformulation of MeanFlow
von: Wang, Zeyuan, et al.
Veröffentlicht: (2025)
von: Wang, Zeyuan, et al.
Veröffentlicht: (2025)
MENO: MeanFlow-Enhanced Neural Operators for Dynamical Systems
von: Yang, Tianyue, et al.
Veröffentlicht: (2026)
von: Yang, Tianyue, et al.
Veröffentlicht: (2026)
Score-Based One-step MeanFlow Policy Optimization
von: Kim, Kyungyoon, et al.
Veröffentlicht: (2026)
von: Kim, Kyungyoon, et al.
Veröffentlicht: (2026)
Learning Sampled-data Control for Swarms via MeanFlow
von: Dong, Anqi, et al.
Veröffentlicht: (2026)
von: Dong, Anqi, et al.
Veröffentlicht: (2026)
Physics-Informed Neural PDE Solvers via Spatio-Temporal MeanFlow
von: Bai, Hanru, et al.
Veröffentlicht: (2026)
von: Bai, Hanru, et al.
Veröffentlicht: (2026)
Modular MeanFlow: Towards Stable and Scalable One-Step Generative Modeling
von: You, Haochen, et al.
Veröffentlicht: (2025)
von: You, Haochen, et al.
Veröffentlicht: (2025)
SAMG: Offline-to-Online Reinforcement Learning via State-Action-Conditional Offline Model Guidance
von: Zhang, Liyu, et al.
Veröffentlicht: (2024)
von: Zhang, Liyu, et al.
Veröffentlicht: (2024)
OM2P: Offline Multi-Agent Mean-Flow Policy
von: Li, Zhuoran, et al.
Veröffentlicht: (2025)
von: Li, Zhuoran, et al.
Veröffentlicht: (2025)
Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning
von: Mao, Liyuan, et al.
Veröffentlicht: (2024)
von: Mao, Liyuan, et al.
Veröffentlicht: (2024)
Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning
von: Ma, Yunchang, et al.
Veröffentlicht: (2025)
von: Ma, Yunchang, et al.
Veröffentlicht: (2025)
Discrete MeanFlow: One-Step Generation via Conditional Transition Kernels
von: Khan, Fairoz Nower, et al.
Veröffentlicht: (2026)
von: Khan, Fairoz Nower, et al.
Veröffentlicht: (2026)
Diffusion Self-Weighted Guidance for Offline Reinforcement Learning
von: Tagle, Augusto, et al.
Veröffentlicht: (2025)
von: Tagle, Augusto, et al.
Veröffentlicht: (2025)
Stochastic MeanFlow Policies: One-Step Generative Control with Entropic Mirror Descent
von: Wang, Zeyuan, et al.
Veröffentlicht: (2026)
von: Wang, Zeyuan, et al.
Veröffentlicht: (2026)
Energy-Weighted Flow Matching for Offline Reinforcement Learning
von: Zhang, Shiyuan, et al.
Veröffentlicht: (2025)
von: Zhang, Shiyuan, et al.
Veröffentlicht: (2025)
Decoupled Guidance Diffusion for Adaptive Offline Safe Reinforcement Learning
von: Chen, Rufeng, et al.
Veröffentlicht: (2026)
von: Chen, Rufeng, et al.
Veröffentlicht: (2026)
Scalable Multi-Agent Offline Reinforcement Learning and the Role of Information
von: Zamboni, Riccardo, et al.
Veröffentlicht: (2025)
von: Zamboni, Riccardo, et al.
Veröffentlicht: (2025)
VIPO: Value Function Inconsistency Penalized Offline Reinforcement Learning
von: Chen, Xuyang, et al.
Veröffentlicht: (2025)
von: Chen, Xuyang, et al.
Veröffentlicht: (2025)
Guided Flow Policy: Learning from High-Value Actions in Offline Reinforcement Learning
von: Tiofack, Franki Nguimatsia, et al.
Veröffentlicht: (2025)
von: Tiofack, Franki Nguimatsia, et al.
Veröffentlicht: (2025)
Q-value Regularized Decision ConvFormer for Offline Reinforcement Learning
von: Yan, Teng, et al.
Veröffentlicht: (2024)
von: Yan, Teng, et al.
Veröffentlicht: (2024)
OT-MeanFlow3D: Bridging Optimal Transport and Meanflow for Efficient 3D Point Cloud Generation
von: Akbari, Elaheh, et al.
Veröffentlicht: (2025)
von: Akbari, Elaheh, et al.
Veröffentlicht: (2025)
VLGOR: Visual-Language Knowledge Guided Offline Reinforcement Learning for Generalizable Agents
von: Liu, Pengsen, et al.
Veröffentlicht: (2026)
von: Liu, Pengsen, et al.
Veröffentlicht: (2026)
Offline Reinforcement Learning for LLM Multi-Step Reasoning
von: Wang, Huaijie, et al.
Veröffentlicht: (2024)
von: Wang, Huaijie, et al.
Veröffentlicht: (2024)
Diffusion-based Episodes Augmentation for Offline Multi-Agent Reinforcement Learning
von: Oh, Jihwan, et al.
Veröffentlicht: (2024)
von: Oh, Jihwan, et al.
Veröffentlicht: (2024)
GTA: Generative Trajectory Augmentation with Guidance for Offline Reinforcement Learning
von: Lee, Jaewoo, et al.
Veröffentlicht: (2024)
von: Lee, Jaewoo, et al.
Veröffentlicht: (2024)
Scalable Offline Reinforcement Learning for Mean Field Games
von: Brunnbauer, Axel, et al.
Veröffentlicht: (2024)
von: Brunnbauer, Axel, et al.
Veröffentlicht: (2024)
Conservative and Risk-Aware Offline Multi-Agent Reinforcement Learning
von: Eldeeb, Eslam, et al.
Veröffentlicht: (2024)
von: Eldeeb, Eslam, et al.
Veröffentlicht: (2024)
Offline Multi-Agent Reinforcement Learning via In-Sample Sequential Policy Optimization
von: Liu, Zongkai, et al.
Veröffentlicht: (2024)
von: Liu, Zongkai, et al.
Veröffentlicht: (2024)
Instrumental Variable Value Iteration for Causal Offline Reinforcement Learning
von: Liao, Luofeng, et al.
Veröffentlicht: (2021)
von: Liao, Luofeng, et al.
Veröffentlicht: (2021)
Flow Matching for Offline Reinforcement Learning with Discrete Actions
von: Khan, Fairoz Nower, et al.
Veröffentlicht: (2026)
von: Khan, Fairoz Nower, et al.
Veröffentlicht: (2026)
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
von: Bai, Chenjia, et al.
Veröffentlicht: (2024)
von: Bai, Chenjia, et al.
Veröffentlicht: (2024)
Reinforcement Learning via Value Gradient Flow
von: Xu, Haoran, et al.
Veröffentlicht: (2026)
von: Xu, Haoran, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Equivariant Efficient Joint Discrete and Continuous MeanFlow for Molecular Graph Generation
von: Xu, Rongjian, et al.
Veröffentlicht: (2026) -
Efficient Hierarchical Implicit Flow Q-learning for Offline Goal-conditioned Reinforcement Learning
von: Dong, Zhiqiang, et al.
Veröffentlicht: (2026) -
Diffusion Classifier-Driven Reward for Offline Preference-based Reinforcement Learning
von: Pang, Teng, et al.
Veröffentlicht: (2025) -
Riemannian MeanFlow for One-Step Generation on Manifolds
von: Zhong, Zichen, et al.
Veröffentlicht: (2026) -
Towards Macro-AUC oriented Imbalanced Multi-Label Continual Learning
von: Zhang, Yan, et al.
Veröffentlicht: (2024)