Entropy-Regularized Adjoint Matching for Offline Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ghanem, Abdelghani, Ghogho, Mounir |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Confidence-gated training for efficient early-exit neural networks
par: Mokssit, Saad, et autres
Publié: (2025)
par: Mokssit, Saad, et autres
Publié: (2025)
Applications of machine learning and IoT for Outdoor Air Pollution Monitoring and Prediction: A Systematic Literature Review
par: Gryech, Ihsane, et autres
Publié: (2024)
par: Gryech, Ihsane, et autres
Publié: (2024)
Mutual Information Regularized Offline Reinforcement Learning
par: Ma, Xiao, et autres
Publié: (2022)
par: Ma, Xiao, et autres
Publié: (2022)
Mildly Conservative Regularized Evaluation for Offline Reinforcement Learning
par: Chen, Haohui, et autres
Publié: (2025)
par: Chen, Haohui, et autres
Publié: (2025)
Discrete Flow Matching for Offline-to-Online Reinforcement Learning
par: Khan, Fairoz Nower, et autres
Publié: (2026)
par: Khan, Fairoz Nower, et autres
Publié: (2026)
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
par: Gao, Chen-Xiao, et autres
Publié: (2025)
par: Gao, Chen-Xiao, et autres
Publié: (2025)
Flow Matching with Injected Noise for Offline-to-Online Reinforcement Learning
par: Shin, Yongjae, et autres
Publié: (2026)
par: Shin, Yongjae, et autres
Publié: (2026)
Adjoint Sampling: Highly Scalable Diffusion Samplers via Adjoint Matching
par: Havens, Aaron, et autres
Publié: (2025)
par: Havens, Aaron, et autres
Publié: (2025)
In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning
par: Tu, Songjun, et autres
Publié: (2024)
par: Tu, Songjun, et autres
Publié: (2024)
Epigraph-Guided Flow Matching for Safe and Performant Offline Reinforcement Learning
par: Tayal, Manan, et autres
Publié: (2026)
par: Tayal, Manan, et autres
Publié: (2026)
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
par: Liu, Tenglong, et autres
Publié: (2024)
par: Liu, Tenglong, et autres
Publié: (2024)
Q-learning with Adjoint Matching
par: Li, Qiyang, et autres
Publié: (2026)
par: Li, Qiyang, et autres
Publié: (2026)
Early Exiting Predictive Coding Neural Networks for Edge AI
par: Zniber, Alaa, et autres
Publié: (2023)
par: Zniber, Alaa, et autres
Publié: (2023)
Improving Offline-to-Online Reinforcement Learning with Q Conditioned State Entropy Exploration
par: Zhang, Ziqi, et autres
Publié: (2023)
par: Zhang, Ziqi, et autres
Publié: (2023)
Stable CDE Autoencoders with Acuity Regularization for Offline Reinforcement Learning in Sepsis Treatment
par: Gao, Yue
Publié: (2025)
par: Gao, Yue
Publié: (2025)
RAMAC: Multimodal Risk-Aware Offline Reinforcement Learning and the Role of Behavior Regularization
par: Fukazawa, Kai, et autres
Publié: (2025)
par: Fukazawa, Kai, et autres
Publié: (2025)
Robust Offline Reinforcement Learning with Linearly Structured f-Divergence Regularization
par: Tang, Cheng, et autres
Publié: (2024)
par: Tang, Cheng, et autres
Publié: (2024)
Offline Reinforcement Learning with Wasserstein Regularization via Optimal Transport Maps
par: Omura, Motoki, et autres
Publié: (2025)
par: Omura, Motoki, et autres
Publié: (2025)
Trust Region Q Adjoint Matching
par: Dong, Yonghoon, et autres
Publié: (2026)
par: Dong, Yonghoon, et autres
Publié: (2026)
Offline Trajectory Optimization for Offline Reinforcement Learning
par: Zhao, Ziqi, et autres
Publié: (2024)
par: Zhao, Ziqi, et autres
Publié: (2024)
Beyond Penalization: Diffusion-based Out-of-Distribution Detection and Selective Regularization in Offline Reinforcement Learning
par: Wang, Qingjun, et autres
Publié: (2026)
par: Wang, Qingjun, et autres
Publié: (2026)
Revisiting Neighborhood Aggregation in Graph Neural Networks for Node Classification using Statistical Signal Processing
par: Ghogho, Mounir
Publié: (2024)
par: Ghogho, Mounir
Publié: (2024)
Matching Problems to Solutions: An Explainable Way of Solving Machine Learning Problems
par: Saleh, Lokman, et autres
Publié: (2024)
par: Saleh, Lokman, et autres
Publié: (2024)
Boosting Maximum Entropy Reinforcement Learning via One-Step Flow Matching
par: Li, Zeqiao, et autres
Publié: (2026)
par: Li, Zeqiao, et autres
Publié: (2026)
The Role of Deep Learning Regularizations on Actors in Offline RL
par: Tarasov, Denis, et autres
Publié: (2024)
par: Tarasov, Denis, et autres
Publié: (2024)
Preference Elicitation for Offline Reinforcement Learning
par: Pace, Alizée, et autres
Publié: (2024)
par: Pace, Alizée, et autres
Publié: (2024)
Offline Reinforcement Learning with Imbalanced Datasets
par: Jiang, Li, et autres
Publié: (2023)
par: Jiang, Li, et autres
Publié: (2023)
Simple Ingredients for Offline Reinforcement Learning
par: Cetin, Edoardo, et autres
Publié: (2024)
par: Cetin, Edoardo, et autres
Publié: (2024)
State-Constrained Offline Reinforcement Learning
par: Hepburn, Charles A., et autres
Publié: (2024)
par: Hepburn, Charles A., et autres
Publié: (2024)
The Generalization Gap in Offline Reinforcement Learning
par: Mediratta, Ishita, et autres
Publié: (2023)
par: Mediratta, Ishita, et autres
Publié: (2023)
Dataset Distillation for Offline Reinforcement Learning
par: Light, Jonathan, et autres
Publié: (2024)
par: Light, Jonathan, et autres
Publié: (2024)
Offline Reinforcement Learning with Imputed Rewards
par: Romeo, Carlo, et autres
Publié: (2024)
par: Romeo, Carlo, et autres
Publié: (2024)
FLAC: Maximum Entropy RL via Kinetic Energy Regularized Bridge Matching
par: Lv, Lei, et autres
Publié: (2026)
par: Lv, Lei, et autres
Publié: (2026)
OffSim: Offline Simulator for Model-based Offline Inverse Reinforcement Learning
par: Ahn, Woo-Jin, et autres
Publié: (2025)
par: Ahn, Woo-Jin, et autres
Publié: (2025)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
par: Xu, Qiushui, et autres
Publié: (2025)
par: Xu, Qiushui, et autres
Publié: (2025)
Imagination-Limited Q-Learning for Offline Reinforcement Learning
par: Liu, Wenhui, et autres
Publié: (2025)
par: Liu, Wenhui, et autres
Publié: (2025)
Mildly Conservative Q-Learning for Offline Reinforcement Learning
par: Lyu, Jiafei, et autres
Publié: (2022)
par: Lyu, Jiafei, et autres
Publié: (2022)
Abstraction for Offline Goal-Conditioned Reinforcement Learning
par: Wibault, Clarisse, et autres
Publié: (2026)
par: Wibault, Clarisse, et autres
Publié: (2026)
Offline Reinforcement Learning with Universal Horizon Models
par: Chung, Hojun, et autres
Publié: (2026)
par: Chung, Hojun, et autres
Publié: (2026)
Flow Actor-Critic for Offline Reinforcement Learning
par: Chae, Jongseong, et autres
Publié: (2026)
par: Chae, Jongseong, et autres
Publié: (2026)
Documents similaires
-
Confidence-gated training for efficient early-exit neural networks
par: Mokssit, Saad, et autres
Publié: (2025) -
Applications of machine learning and IoT for Outdoor Air Pollution Monitoring and Prediction: A Systematic Literature Review
par: Gryech, Ihsane, et autres
Publié: (2024) -
Mutual Information Regularized Offline Reinforcement Learning
par: Ma, Xiao, et autres
Publié: (2022) -
Mildly Conservative Regularized Evaluation for Offline Reinforcement Learning
par: Chen, Haohui, et autres
Publié: (2025) -
Discrete Flow Matching for Offline-to-Online Reinforcement Learning
par: Khan, Fairoz Nower, et autres
Publié: (2026)