Flow Matching Policy Optimization with Mirror Descent and Entropy Constraints
Fuente:
arXiv
Guardado en:
| Autores principales: | Gao, Ting, Orfanoudakis, Stavros, Lin, Nan, Daamen, Winnie, Hoogendoorn, Serge, Isufi, Elvin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Q-Net: Queue Length Estimation via Kalman-based Neural Networks
por: Gao, Ting, et al.
Publicado: (2025)
por: Gao, Ting, et al.
Publicado: (2025)
Sparse Covariance Neural Networks
por: Cavallo, Andrea, et al.
Publicado: (2024)
por: Cavallo, Andrea, et al.
Publicado: (2024)
Online Graph Filtering Over Expanding Graphs
por: Das, Bishwadeep, et al.
Publicado: (2024)
por: Das, Bishwadeep, et al.
Publicado: (2024)
SAVGO: Learning State-Action Value Geometry with Cosine Similarity for Continuous Control
por: Orfanoudakis, Stavros, et al.
Publicado: (2026)
por: Orfanoudakis, Stavros, et al.
Publicado: (2026)
Stochastic Sequential Decision Making over Expanding Networks with Graph Filtering
por: Gao, Zhan, et al.
Publicado: (2026)
por: Gao, Zhan, et al.
Publicado: (2026)
Beyond State-Wise Mirror Descent: Offline Policy Optimization with Parametric Policies
por: Li, Xiang, et al.
Publicado: (2026)
por: Li, Xiang, et al.
Publicado: (2026)
One-Step Flow Policy Mirror Descent
por: Chen, Tianyi, et al.
Publicado: (2025)
por: Chen, Tianyi, et al.
Publicado: (2025)
PowerFlowNet: Power Flow Approximation Using Message Passing Graph Neural Networks
por: Lin, Nan, et al.
Publicado: (2023)
por: Lin, Nan, et al.
Publicado: (2023)
Optimizing Electric Vehicles Charging using Large Language Models and Graph Neural Networks
por: Orfanoudakis, Stavros, et al.
Publicado: (2025)
por: Orfanoudakis, Stavros, et al.
Publicado: (2025)
Matched Topological Subspace Detector
por: Liu, Chengen, et al.
Publicado: (2025)
por: Liu, Chengen, et al.
Publicado: (2025)
On the Convergence of Policy in Unregularized Policy Mirror Descent
por: Lin, Dachao, et al.
Publicado: (2022)
por: Lin, Dachao, et al.
Publicado: (2022)
GKNet: Graph Kalman Filtering and Model Inference via Model-based Deep Learning
por: Sabbaqi, Mohammad, et al.
Publicado: (2025)
por: Sabbaqi, Mohammad, et al.
Publicado: (2025)
Spatiotemporal Covariance Neural Networks
por: Cavallo, Andrea, et al.
Publicado: (2024)
por: Cavallo, Andrea, et al.
Publicado: (2024)
Hodge-Compositional Edge Gaussian Processes
por: Yang, Maosheng, et al.
Publicado: (2023)
por: Yang, Maosheng, et al.
Publicado: (2023)
CoVariance Filters and Neural Networks over Hilbert Spaces
por: Battiloro, Claudio, et al.
Publicado: (2025)
por: Battiloro, Claudio, et al.
Publicado: (2025)
Online Learning Of Expanding Graphs
por: Rey, Samuel, et al.
Publicado: (2024)
por: Rey, Samuel, et al.
Publicado: (2024)
On the Effect of Regularization in Policy Mirror Descent
por: Kleuker, Jan Felix, et al.
Publicado: (2025)
por: Kleuker, Jan Felix, et al.
Publicado: (2025)
Policy Mirror Descent with Lookahead
por: Protopapas, Kimon, et al.
Publicado: (2024)
por: Protopapas, Kimon, et al.
Publicado: (2024)
Sample Complexity of Neural Policy Mirror Descent for Policy Optimization on Low-Dimensional Manifolds
por: Xu, Zhenghao, et al.
Publicado: (2023)
por: Xu, Zhenghao, et al.
Publicado: (2023)
Fair CoVariance Neural Networks
por: Cavallo, Andrea, et al.
Publicado: (2024)
por: Cavallo, Andrea, et al.
Publicado: (2024)
Functional Acceleration for Policy Mirror Descent
por: Chelu, Veronica, et al.
Publicado: (2024)
por: Chelu, Veronica, et al.
Publicado: (2024)
GNN-DT: Graph Neural Network Enhanced Decision Transformer for Efficient Optimization in Dynamic Environments
por: Orfanoudakis, Stavros, et al.
Publicado: (2025)
por: Orfanoudakis, Stavros, et al.
Publicado: (2025)
Topological Kalman Filtering on Cell Complexes
por: Liu, Chengen, et al.
Publicado: (2026)
por: Liu, Chengen, et al.
Publicado: (2026)
Precision Neural Networks: Joint Graph And Relational Learning
por: Cavallo, Andrea, et al.
Publicado: (2025)
por: Cavallo, Andrea, et al.
Publicado: (2025)
Covariance Scattering Transforms
por: Cavallo, Andrea, et al.
Publicado: (2025)
por: Cavallo, Andrea, et al.
Publicado: (2025)
Never Saddle for Reparameterized Steepest Descent as Mirror Flow
por: Jacobs, Tom, et al.
Publicado: (2026)
por: Jacobs, Tom, et al.
Publicado: (2026)
Stochastic MeanFlow Policies: One-Step Generative Control with Entropic Mirror Descent
por: Wang, Zeyuan, et al.
Publicado: (2026)
por: Wang, Zeyuan, et al.
Publicado: (2026)
Topology-Aware Graph Reinforcement Learning for Energy Storage Systems Optimal Dispatch in Distribution Networks
por: Gao, Shuyi, et al.
Publicado: (2026)
por: Gao, Shuyi, et al.
Publicado: (2026)
Higher-Order Topological Directionality and Directed Simplicial Neural Networks
por: Lecha, Manuel, et al.
Publicado: (2024)
por: Lecha, Manuel, et al.
Publicado: (2024)
Graph Filters for Signal Processing and Machine Learning on Graphs
por: Isufi, Elvin, et al.
Publicado: (2022)
por: Isufi, Elvin, et al.
Publicado: (2022)
On the Convergence of Policy Mirror Descent with Temporal Difference Evaluation
por: Liu, Jiacai, et al.
Publicado: (2025)
por: Liu, Jiacai, et al.
Publicado: (2025)
Mirror Descent-Type Algorithms for the Variational Inequality Problem with Functional Constraints
por: Alkousa, Mohammad S., et al.
Publicado: (2026)
por: Alkousa, Mohammad S., et al.
Publicado: (2026)
Convergence of Policy Mirror Descent Beyond Compatible Function Approximation
por: Sherman, Uri, et al.
Publicado: (2025)
por: Sherman, Uri, et al.
Publicado: (2025)
StaQ it! Growing neural networks for Policy Mirror Descent
por: Shilova, Alena, et al.
Publicado: (2025)
por: Shilova, Alena, et al.
Publicado: (2025)
Reference-Sampled Boltzmann Projection for KL-Regularized RLVR: Target-Matched Weighted SFT, Finite One-Shot Gaps, and Policy Mirror Descent
por: Shu, Yao, et al.
Publicado: (2026)
por: Shu, Yao, et al.
Publicado: (2026)
Group Entropies and Mirror Duality: A Class of Flexible Mirror Descent Updates for Machine Learning
por: Cichocki, Andrzej, et al.
Publicado: (2026)
por: Cichocki, Andrzej, et al.
Publicado: (2026)
Simplicial Convolutional Filters
por: Yang, Maosheng, et al.
Publicado: (2022)
por: Yang, Maosheng, et al.
Publicado: (2022)
Path-Space Mirror Descent for On-Policy Reinforcement Learning under the Generalized Schrödinger Bridge
por: Gong, Yuehu, et al.
Publicado: (2026)
por: Gong, Yuehu, et al.
Publicado: (2026)
Mirror Descent on Riemannian Manifolds
por: Jiang, Jiaxin, et al.
Publicado: (2026)
por: Jiang, Jiaxin, et al.
Publicado: (2026)
Parameter-free Mirror Descent
por: Jacobsen, Andrew, et al.
Publicado: (2022)
por: Jacobsen, Andrew, et al.
Publicado: (2022)
Ejemplares similares
-
Q-Net: Queue Length Estimation via Kalman-based Neural Networks
por: Gao, Ting, et al.
Publicado: (2025) -
Sparse Covariance Neural Networks
por: Cavallo, Andrea, et al.
Publicado: (2024) -
Online Graph Filtering Over Expanding Graphs
por: Das, Bishwadeep, et al.
Publicado: (2024) -
SAVGO: Learning State-Action Value Geometry with Cosine Similarity for Continuous Control
por: Orfanoudakis, Stavros, et al.
Publicado: (2026) -
Stochastic Sequential Decision Making over Expanding Networks with Graph Filtering
por: Gao, Zhan, et al.
Publicado: (2026)