SORREL: Suboptimal-Demonstration-Guided Reinforcement Learning for Learning to Branch
Fuente:
arXiv
Salvato in:
| Autori principali: | Feng, Shengyu, Yang, Yiming |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
In-Context Reinforcement Learning From Suboptimal Historical Data
di: Dong, Juncheng, et al.
Pubblicazione: (2026)
di: Dong, Juncheng, et al.
Pubblicazione: (2026)
Regularized Langevin Dynamics for Combinatorial Optimization
di: Feng, Shengyu, et al.
Pubblicazione: (2025)
di: Feng, Shengyu, et al.
Pubblicazione: (2025)
Imitation Learning from Suboptimal Demonstrations via Meta-Learning An Action Ranker
di: Fan, Jiangdong, et al.
Pubblicazione: (2024)
di: Fan, Jiangdong, et al.
Pubblicazione: (2024)
Reward Learning from Suboptimal Demonstrations with Applications in Surgical Electrocautery
di: Karimi, Zohre, et al.
Pubblicazione: (2024)
di: Karimi, Zohre, et al.
Pubblicazione: (2024)
Demonstration-Guided Continual Reinforcement Learning in Dynamic Environments
di: Yang, Xue, et al.
Pubblicazione: (2025)
di: Yang, Xue, et al.
Pubblicazione: (2025)
Learning from Ambiguous Demonstrations with Self-Explanation Guided Reinforcement Learning
di: Zha, Yantian, et al.
Pubblicazione: (2021)
di: Zha, Yantian, et al.
Pubblicazione: (2021)
Demonstration Guided Multi-Objective Reinforcement Learning
di: Lu, Junlin, et al.
Pubblicazione: (2024)
di: Lu, Junlin, et al.
Pubblicazione: (2024)
SPL-LNS: Sampling-Enhanced Large Neighborhood Search for Solving Integer Linear Programs
di: Feng, Shengyu, et al.
Pubblicazione: (2025)
di: Feng, Shengyu, et al.
Pubblicazione: (2025)
Unsupervised Diffusion Solver for Combinatorial Optimization via Combinatorial Adjoint Matching
di: Feng, Shengyu, et al.
Pubblicazione: (2026)
di: Feng, Shengyu, et al.
Pubblicazione: (2026)
FrontierCO: Real-World and Large-Scale Evaluation of Machine Learning Solvers for Combinatorial Optimization
di: Feng, Shengyu, et al.
Pubblicazione: (2025)
di: Feng, Shengyu, et al.
Pubblicazione: (2025)
Graph Learning Is Suboptimal in Causal Bandits
di: Shahverdikondori, Mohammad, et al.
Pubblicazione: (2025)
di: Shahverdikondori, Mohammad, et al.
Pubblicazione: (2025)
Generalizing Beyond Suboptimality: Offline Reinforcement Learning Learns Effective Scheduling through Random Data
di: van Remmerden, Jesse, et al.
Pubblicazione: (2025)
di: van Remmerden, Jesse, et al.
Pubblicazione: (2025)
ReviBranch: Deep Reinforcement Learning for Branch-and-Bound with Revived Trajectories
di: Jiabao, Dou, et al.
Pubblicazione: (2025)
di: Jiabao, Dou, et al.
Pubblicazione: (2025)
Reinforcement Learning for Node Selection in Branch-and-Bound
di: Mattick, Alexander, et al.
Pubblicazione: (2023)
di: Mattick, Alexander, et al.
Pubblicazione: (2023)
Learning from Suboptimal Data in Continuous Control via Auto-Regressive Soft Q-Network
di: Liu, Jijia, et al.
Pubblicazione: (2025)
di: Liu, Jijia, et al.
Pubblicazione: (2025)
Inverse Reinforcement Learning by Estimating Expertise of Demonstrators
di: Beliaev, Mark, et al.
Pubblicazione: (2024)
di: Beliaev, Mark, et al.
Pubblicazione: (2024)
ARIEL: Adversarial Graph Contrastive Learning
di: Feng, Shengyu, et al.
Pubblicazione: (2022)
di: Feng, Shengyu, et al.
Pubblicazione: (2022)
Token-based Decision Criteria Are Suboptimal in In-context Learning
di: Cho, Hakaze, et al.
Pubblicazione: (2024)
di: Cho, Hakaze, et al.
Pubblicazione: (2024)
On Learnable Parameters of Optimal and Suboptimal Deep Learning Models
di: Zheng, Ziwei, et al.
Pubblicazione: (2024)
di: Zheng, Ziwei, et al.
Pubblicazione: (2024)
Pruning the Path to Optimal Care: Identifying Systematically Suboptimal Medical Decision-Making with Inverse Reinforcement Learning
di: Bovenzi, Inko, et al.
Pubblicazione: (2024)
di: Bovenzi, Inko, et al.
Pubblicazione: (2024)
Towards Generalizable Reinforcement Learning via Causality-Guided Self-Adaptive Representations
di: Yang, Yupei, et al.
Pubblicazione: (2024)
di: Yang, Yupei, et al.
Pubblicazione: (2024)
Autonomous Assessment of Demonstration Sufficiency via Bayesian Inverse Reinforcement Learning
di: Trinh, Tu, et al.
Pubblicazione: (2022)
di: Trinh, Tu, et al.
Pubblicazione: (2022)
Fast Lifelong Adaptive Inverse Reinforcement Learning from Demonstrations
di: Chen, Letian, et al.
Pubblicazione: (2022)
di: Chen, Letian, et al.
Pubblicazione: (2022)
AlphaExploitem: Going Beyond the Nash Equilibrium in Poker by Learning to Exploit Suboptimal Play
di: Murgoci, Vlad, et al.
Pubblicazione: (2026)
di: Murgoci, Vlad, et al.
Pubblicazione: (2026)
Learning in Inverse Optimization: Incenter Cost, Augmented Suboptimality Loss, and Algorithms
di: Scroccaro, Pedro Zattoni, et al.
Pubblicazione: (2023)
di: Scroccaro, Pedro Zattoni, et al.
Pubblicazione: (2023)
Labeled TrustSet Guided: Batch Active Learning with Reinforcement Learning
di: Cui, Guofeng, et al.
Pubblicazione: (2026)
di: Cui, Guofeng, et al.
Pubblicazione: (2026)
How Does the Lagrangian Guide Safe Reinforcement Learning through Diffusion Models?
di: Cheng, Xiaoyuan, et al.
Pubblicazione: (2026)
di: Cheng, Xiaoyuan, et al.
Pubblicazione: (2026)
Adaptive Resolving Methods for Reinforcement Learning with Function Approximations
di: Jiang, Jiashuo, et al.
Pubblicazione: (2025)
di: Jiang, Jiashuo, et al.
Pubblicazione: (2025)
Reinforcement Learning by Guided Safe Exploration
di: Yang, Qisong, et al.
Pubblicazione: (2023)
di: Yang, Qisong, et al.
Pubblicazione: (2023)
Skill-Enhanced Reinforcement Learning Acceleration from Heterogeneous Demonstrations
di: Zhang, Hanping, et al.
Pubblicazione: (2024)
di: Zhang, Hanping, et al.
Pubblicazione: (2024)
Rainbow-DemoRL: Combining Improvements in Demonstration-Augmented Reinforcement Learning
di: Bhatt, Dwait, et al.
Pubblicazione: (2026)
di: Bhatt, Dwait, et al.
Pubblicazione: (2026)
Planning in Branch-and-Bound: Model-Based Reinforcement Learning for Exact Combinatorial Optimization
di: Strang, Paul, et al.
Pubblicazione: (2025)
di: Strang, Paul, et al.
Pubblicazione: (2025)
Reverse Forward Curriculum Learning for Extreme Sample and Demonstration Efficiency in Reinforcement Learning
di: Tao, Stone, et al.
Pubblicazione: (2024)
di: Tao, Stone, et al.
Pubblicazione: (2024)
Good Reasoning Makes Good Demonstrations: Implicit Reasoning Quality Supervision via In-Context Reinforcement Learning
di: Mei, Tiehua, et al.
Pubblicazione: (2026)
di: Mei, Tiehua, et al.
Pubblicazione: (2026)
Leveraging Genetic Algorithms for Efficient Demonstration Generation in Real-World Reinforcement Learning Environments
di: Maus, Tom, et al.
Pubblicazione: (2025)
di: Maus, Tom, et al.
Pubblicazione: (2025)
Opinion-Guided Reinforcement Learning
di: Dagenais, Kyanna, et al.
Pubblicazione: (2024)
di: Dagenais, Kyanna, et al.
Pubblicazione: (2024)
Reinforcement Learning-Guided Semi-Supervised Learning
di: Heidari, Marzi, et al.
Pubblicazione: (2024)
di: Heidari, Marzi, et al.
Pubblicazione: (2024)
Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning
di: Alagha, Ahmed, et al.
Pubblicazione: (2025)
di: Alagha, Ahmed, et al.
Pubblicazione: (2025)
Accelerating Reinforcement Learning for Wind Farm Control via Expert Demonstrations
di: Nilsen, Marcus Binder, et al.
Pubblicazione: (2026)
di: Nilsen, Marcus Binder, et al.
Pubblicazione: (2026)
Suboptimal Shapley Value Explanations
di: Lu, Xiaolei
Pubblicazione: (2025)
di: Lu, Xiaolei
Pubblicazione: (2025)
Documenti analoghi
-
In-Context Reinforcement Learning From Suboptimal Historical Data
di: Dong, Juncheng, et al.
Pubblicazione: (2026) -
Regularized Langevin Dynamics for Combinatorial Optimization
di: Feng, Shengyu, et al.
Pubblicazione: (2025) -
Imitation Learning from Suboptimal Demonstrations via Meta-Learning An Action Ranker
di: Fan, Jiangdong, et al.
Pubblicazione: (2024) -
Reward Learning from Suboptimal Demonstrations with Applications in Surgical Electrocautery
di: Karimi, Zohre, et al.
Pubblicazione: (2024) -
Demonstration-Guided Continual Reinforcement Learning in Dynamic Environments
di: Yang, Xue, et al.
Pubblicazione: (2025)