Entropy-Regularized Adjoint Matching for Offline Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Ghanem, Abdelghani, Ghogho, Mounir |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Confidence-gated training for efficient early-exit neural networks
di: Mokssit, Saad, et al.
Pubblicazione: (2025)
di: Mokssit, Saad, et al.
Pubblicazione: (2025)
Applications of machine learning and IoT for Outdoor Air Pollution Monitoring and Prediction: A Systematic Literature Review
di: Gryech, Ihsane, et al.
Pubblicazione: (2024)
di: Gryech, Ihsane, et al.
Pubblicazione: (2024)
Mutual Information Regularized Offline Reinforcement Learning
di: Ma, Xiao, et al.
Pubblicazione: (2022)
di: Ma, Xiao, et al.
Pubblicazione: (2022)
Mildly Conservative Regularized Evaluation for Offline Reinforcement Learning
di: Chen, Haohui, et al.
Pubblicazione: (2025)
di: Chen, Haohui, et al.
Pubblicazione: (2025)
Discrete Flow Matching for Offline-to-Online Reinforcement Learning
di: Khan, Fairoz Nower, et al.
Pubblicazione: (2026)
di: Khan, Fairoz Nower, et al.
Pubblicazione: (2026)
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2025)
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2025)
Flow Matching with Injected Noise for Offline-to-Online Reinforcement Learning
di: Shin, Yongjae, et al.
Pubblicazione: (2026)
di: Shin, Yongjae, et al.
Pubblicazione: (2026)
Adjoint Sampling: Highly Scalable Diffusion Samplers via Adjoint Matching
di: Havens, Aaron, et al.
Pubblicazione: (2025)
di: Havens, Aaron, et al.
Pubblicazione: (2025)
In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning
di: Tu, Songjun, et al.
Pubblicazione: (2024)
di: Tu, Songjun, et al.
Pubblicazione: (2024)
Epigraph-Guided Flow Matching for Safe and Performant Offline Reinforcement Learning
di: Tayal, Manan, et al.
Pubblicazione: (2026)
di: Tayal, Manan, et al.
Pubblicazione: (2026)
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
Q-learning with Adjoint Matching
di: Li, Qiyang, et al.
Pubblicazione: (2026)
di: Li, Qiyang, et al.
Pubblicazione: (2026)
Early Exiting Predictive Coding Neural Networks for Edge AI
di: Zniber, Alaa, et al.
Pubblicazione: (2023)
di: Zniber, Alaa, et al.
Pubblicazione: (2023)
Improving Offline-to-Online Reinforcement Learning with Q Conditioned State Entropy Exploration
di: Zhang, Ziqi, et al.
Pubblicazione: (2023)
di: Zhang, Ziqi, et al.
Pubblicazione: (2023)
Stable CDE Autoencoders with Acuity Regularization for Offline Reinforcement Learning in Sepsis Treatment
di: Gao, Yue
Pubblicazione: (2025)
di: Gao, Yue
Pubblicazione: (2025)
RAMAC: Multimodal Risk-Aware Offline Reinforcement Learning and the Role of Behavior Regularization
di: Fukazawa, Kai, et al.
Pubblicazione: (2025)
di: Fukazawa, Kai, et al.
Pubblicazione: (2025)
Robust Offline Reinforcement Learning with Linearly Structured f-Divergence Regularization
di: Tang, Cheng, et al.
Pubblicazione: (2024)
di: Tang, Cheng, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning with Wasserstein Regularization via Optimal Transport Maps
di: Omura, Motoki, et al.
Pubblicazione: (2025)
di: Omura, Motoki, et al.
Pubblicazione: (2025)
Trust Region Q Adjoint Matching
di: Dong, Yonghoon, et al.
Pubblicazione: (2026)
di: Dong, Yonghoon, et al.
Pubblicazione: (2026)
Offline Trajectory Optimization for Offline Reinforcement Learning
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
Beyond Penalization: Diffusion-based Out-of-Distribution Detection and Selective Regularization in Offline Reinforcement Learning
di: Wang, Qingjun, et al.
Pubblicazione: (2026)
di: Wang, Qingjun, et al.
Pubblicazione: (2026)
Matching Problems to Solutions: An Explainable Way of Solving Machine Learning Problems
di: Saleh, Lokman, et al.
Pubblicazione: (2024)
di: Saleh, Lokman, et al.
Pubblicazione: (2024)
Revisiting Neighborhood Aggregation in Graph Neural Networks for Node Classification using Statistical Signal Processing
di: Ghogho, Mounir
Pubblicazione: (2024)
di: Ghogho, Mounir
Pubblicazione: (2024)
Boosting Maximum Entropy Reinforcement Learning via One-Step Flow Matching
di: Li, Zeqiao, et al.
Pubblicazione: (2026)
di: Li, Zeqiao, et al.
Pubblicazione: (2026)
The Role of Deep Learning Regularizations on Actors in Offline RL
di: Tarasov, Denis, et al.
Pubblicazione: (2024)
di: Tarasov, Denis, et al.
Pubblicazione: (2024)
Preference Elicitation for Offline Reinforcement Learning
di: Pace, Alizée, et al.
Pubblicazione: (2024)
di: Pace, Alizée, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning with Imbalanced Datasets
di: Jiang, Li, et al.
Pubblicazione: (2023)
di: Jiang, Li, et al.
Pubblicazione: (2023)
Simple Ingredients for Offline Reinforcement Learning
di: Cetin, Edoardo, et al.
Pubblicazione: (2024)
di: Cetin, Edoardo, et al.
Pubblicazione: (2024)
State-Constrained Offline Reinforcement Learning
di: Hepburn, Charles A., et al.
Pubblicazione: (2024)
di: Hepburn, Charles A., et al.
Pubblicazione: (2024)
The Generalization Gap in Offline Reinforcement Learning
di: Mediratta, Ishita, et al.
Pubblicazione: (2023)
di: Mediratta, Ishita, et al.
Pubblicazione: (2023)
Dataset Distillation for Offline Reinforcement Learning
di: Light, Jonathan, et al.
Pubblicazione: (2024)
di: Light, Jonathan, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning with Imputed Rewards
di: Romeo, Carlo, et al.
Pubblicazione: (2024)
di: Romeo, Carlo, et al.
Pubblicazione: (2024)
FLAC: Maximum Entropy RL via Kinetic Energy Regularized Bridge Matching
di: Lv, Lei, et al.
Pubblicazione: (2026)
di: Lv, Lei, et al.
Pubblicazione: (2026)
OffSim: Offline Simulator for Model-based Offline Inverse Reinforcement Learning
di: Ahn, Woo-Jin, et al.
Pubblicazione: (2025)
di: Ahn, Woo-Jin, et al.
Pubblicazione: (2025)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
Imagination-Limited Q-Learning for Offline Reinforcement Learning
di: Liu, Wenhui, et al.
Pubblicazione: (2025)
di: Liu, Wenhui, et al.
Pubblicazione: (2025)
Mildly Conservative Q-Learning for Offline Reinforcement Learning
di: Lyu, Jiafei, et al.
Pubblicazione: (2022)
di: Lyu, Jiafei, et al.
Pubblicazione: (2022)
Abstraction for Offline Goal-Conditioned Reinforcement Learning
di: Wibault, Clarisse, et al.
Pubblicazione: (2026)
di: Wibault, Clarisse, et al.
Pubblicazione: (2026)
Offline Reinforcement Learning with Universal Horizon Models
di: Chung, Hojun, et al.
Pubblicazione: (2026)
di: Chung, Hojun, et al.
Pubblicazione: (2026)
Flow Actor-Critic for Offline Reinforcement Learning
di: Chae, Jongseong, et al.
Pubblicazione: (2026)
di: Chae, Jongseong, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Confidence-gated training for efficient early-exit neural networks
di: Mokssit, Saad, et al.
Pubblicazione: (2025) -
Applications of machine learning and IoT for Outdoor Air Pollution Monitoring and Prediction: A Systematic Literature Review
di: Gryech, Ihsane, et al.
Pubblicazione: (2024) -
Mutual Information Regularized Offline Reinforcement Learning
di: Ma, Xiao, et al.
Pubblicazione: (2022) -
Mildly Conservative Regularized Evaluation for Offline Reinforcement Learning
di: Chen, Haohui, et al.
Pubblicazione: (2025) -
Discrete Flow Matching for Offline-to-Online Reinforcement Learning
di: Khan, Fairoz Nower, et al.
Pubblicazione: (2026)