Learning First Integrals via Backward-Generated Data and Guided Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhong, Jingfeng, Liu, Zhengxiang, Wang, Zhijie, Li, Shuai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
QTMRL: An Agent for Quantitative Trading Decision-Making Based on Multi-Indicator Guided Reinforcement Learning
por: Pan, Jingfeng, et al.
Publicado: (2025)
por: Pan, Jingfeng, et al.
Publicado: (2025)
Soft Forward-Backward Representations for Zero-shot Reinforcement Learning with General Utilities
por: Bagatella, Marco, et al.
Publicado: (2026)
por: Bagatella, Marco, et al.
Publicado: (2026)
FedKL: Tackling Data Heterogeneity in Federated Reinforcement Learning by Penalizing KL Divergence
por: Xie, Zhijie, et al.
Publicado: (2022)
por: Xie, Zhijie, et al.
Publicado: (2022)
ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization
por: Yang, Letian, et al.
Publicado: (2026)
por: Yang, Letian, et al.
Publicado: (2026)
The Actor-Critic Update Order Matters for PPO in Federated Reinforcement Learning
por: Xie, Zhijie, et al.
Publicado: (2025)
por: Xie, Zhijie, et al.
Publicado: (2025)
Preference-Guided Reinforcement Learning for Efficient Exploration
por: Wang, Guojian, et al.
Publicado: (2024)
por: Wang, Guojian, et al.
Publicado: (2024)
LightningRL: Breaking the Accuracy-Parallelism Trade-off of Block-wise dLLMs via Reinforcement Learning
por: Hu, Yanzhe, et al.
Publicado: (2026)
por: Hu, Yanzhe, et al.
Publicado: (2026)
Guided Data Augmentation for Offline Reinforcement Learning and Imitation Learning
por: Corrado, Nicholas E., et al.
Publicado: (2023)
por: Corrado, Nicholas E., et al.
Publicado: (2023)
Sample Efficient Reinforcement Learning by Automatically Learning to Compose Subtasks
por: Han, Shuai, et al.
Publicado: (2024)
por: Han, Shuai, et al.
Publicado: (2024)
Offline-to-Online Reinforcement Learning with Classifier-Free Diffusion Generation
por: Huang, Xiao, et al.
Publicado: (2025)
por: Huang, Xiao, et al.
Publicado: (2025)
Labeled TrustSet Guided: Batch Active Learning with Reinforcement Learning
por: Cui, Guofeng, et al.
Publicado: (2026)
por: Cui, Guofeng, et al.
Publicado: (2026)
Goal-Guided Efficient Exploration via Large Language Model in Reinforcement Learning
por: Qi, Yajie, et al.
Publicado: (2025)
por: Qi, Yajie, et al.
Publicado: (2025)
SpecRLBench: A Benchmark for Generalization in Specification-Guided Reinforcement Learning
por: Guo, Zijian, et al.
Publicado: (2026)
por: Guo, Zijian, et al.
Publicado: (2026)
Fixed Design Analysis of Regularization-Based Continual Learning
por: Li, Haoran, et al.
Publicado: (2023)
por: Li, Haoran, et al.
Publicado: (2023)
Enhancing Geometric Perception in VLMs via Translator-Guided Reinforcement Learning
por: Yu, Hao, et al.
Publicado: (2026)
por: Yu, Hao, et al.
Publicado: (2026)
Neural Backward Filtering Forward Guiding
por: Yang, Gefan, et al.
Publicado: (2026)
por: Yang, Gefan, et al.
Publicado: (2026)
RL-Selector: Reinforcement Learning-Guided Data Selection via Redundancy Assessment
por: Yang, Suorong, et al.
Publicado: (2025)
por: Yang, Suorong, et al.
Publicado: (2025)
Combinatorial Multivariant Multi-Armed Bandits with Applications to Episodic Reinforcement Learning and Beyond
por: Liu, Xutong, et al.
Publicado: (2024)
por: Liu, Xutong, et al.
Publicado: (2024)
G-PCGRL: Procedural Graph Data Generation via Reinforcement Learning
por: Rupp, Florian, et al.
Publicado: (2024)
por: Rupp, Florian, et al.
Publicado: (2024)
Answer First, Reason Later: Aligning Search Relevance via Mode-Balanced Reinforcement Learning
por: Zhang, Shijie, et al.
Publicado: (2026)
por: Zhang, Shijie, et al.
Publicado: (2026)
Behavioral Entropy-Guided Dataset Generation for Offline Reinforcement Learning
por: Suttle, Wesley A., et al.
Publicado: (2025)
por: Suttle, Wesley A., et al.
Publicado: (2025)
Plasma Shape Control via Zero-shot Generative Reinforcement Learning
por: Wu, Niannian, et al.
Publicado: (2025)
por: Wu, Niannian, et al.
Publicado: (2025)
Backward Learning for Goal-Conditioned Policies
por: Höftmann, Marc, et al.
Publicado: (2023)
por: Höftmann, Marc, et al.
Publicado: (2023)
Guiding Diffusion Models with Reinforcement Learning for Stable Molecule Generation
por: Zhou, Zhijian, et al.
Publicado: (2025)
por: Zhou, Zhijian, et al.
Publicado: (2025)
Guiding Generative Models to Uncover Diverse and Novel Crystals via Reinforcement Learning
por: Park, Hyunsoo, et al.
Publicado: (2025)
por: Park, Hyunsoo, et al.
Publicado: (2025)
Hierarchical Reinforcement Learning with Uncertainty-Guided Diffusional Subgoals
por: Wang, Vivienne Huiling, et al.
Publicado: (2025)
por: Wang, Vivienne Huiling, et al.
Publicado: (2025)
Towards Generalizable Reinforcement Learning via Causality-Guided Self-Adaptive Representations
por: Yang, Yupei, et al.
Publicado: (2024)
por: Yang, Yupei, et al.
Publicado: (2024)
Privacy-Preserving Heterogeneous Federated Learning for Sensitive Healthcare Data
por: Xu, Yukai, et al.
Publicado: (2024)
por: Xu, Yukai, et al.
Publicado: (2024)
Tackling Data Heterogeneity in Federated Learning via Loss Decomposition
por: Zeng, Shuang, et al.
Publicado: (2024)
por: Zeng, Shuang, et al.
Publicado: (2024)
Guided Cooperation in Hierarchical Reinforcement Learning via Model-based Rollout
por: Wang, Haoran, et al.
Publicado: (2023)
por: Wang, Haoran, et al.
Publicado: (2023)
Learning Along the Arrow of Time: Hyperbolic Geometry for Backward-Compatible Representation Learning
por: Bui, Ngoc, et al.
Publicado: (2025)
por: Bui, Ngoc, et al.
Publicado: (2025)
LLaPipe: LLM-Guided Reinforcement Learning for Automated Data Preparation Pipeline Construction
por: Chang, Jing, et al.
Publicado: (2025)
por: Chang, Jing, et al.
Publicado: (2025)
Working Backwards: Learning to Place by Picking
por: Limoyo, Oliver, et al.
Publicado: (2023)
por: Limoyo, Oliver, et al.
Publicado: (2023)
Memory-Statistics Tradeoff in Continual Learning with Structural Regularization
por: Li, Haoran, et al.
Publicado: (2025)
por: Li, Haoran, et al.
Publicado: (2025)
SoftPipe: A Soft-Guided Reinforcement Learning Framework for Automated Data Preparation
por: Chang, Jing, et al.
Publicado: (2025)
por: Chang, Jing, et al.
Publicado: (2025)
Novelty-Guided Data Reuse for Efficient and Diversified Multi-Agent Reinforcement Learning
por: Chen, Yangkun, et al.
Publicado: (2024)
por: Chen, Yangkun, et al.
Publicado: (2024)
A Reinforcement Learning Approach to Synthetic Data Generation
por: Espinosa-Dice, Natalia, et al.
Publicado: (2025)
por: Espinosa-Dice, Natalia, et al.
Publicado: (2025)
Recursive Backwards Q-Learning in Deterministic Environments
por: Diekhoff, Jan, et al.
Publicado: (2024)
por: Diekhoff, Jan, et al.
Publicado: (2024)
SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning
por: Li, Na, et al.
Publicado: (2025)
por: Li, Na, et al.
Publicado: (2025)
First-order Sobolev Reinforcement Learning
por: Schramm, Fabian, et al.
Publicado: (2025)
por: Schramm, Fabian, et al.
Publicado: (2025)
Ejemplares similares
-
QTMRL: An Agent for Quantitative Trading Decision-Making Based on Multi-Indicator Guided Reinforcement Learning
por: Pan, Jingfeng, et al.
Publicado: (2025) -
Soft Forward-Backward Representations for Zero-shot Reinforcement Learning with General Utilities
por: Bagatella, Marco, et al.
Publicado: (2026) -
FedKL: Tackling Data Heterogeneity in Federated Reinforcement Learning by Penalizing KL Divergence
por: Xie, Zhijie, et al.
Publicado: (2022) -
ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization
por: Yang, Letian, et al.
Publicado: (2026) -
The Actor-Critic Update Order Matters for PPO in Federated Reinforcement Learning
por: Xie, Zhijie, et al.
Publicado: (2025)