Saved in:
| Main Authors: | Molinghen, Yannick, Delecluse, Augustin, De Landtsheer, Renaud, Michelini, Stefano |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2601.07948 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Zero-Incentive Dynamics: a look at reward sparsity through the lens of unrewarded subgoals
by: Molinghen, Yannick, et al.
Published: (2025)
by: Molinghen, Yannick, et al.
Published: (2025)
FRAUD-RLA: A new reinforcement learning adversarial attack against credit card fraud detection
by: Lunghi, Daniele, et al.
Published: (2025)
by: Lunghi, Daniele, et al.
Published: (2025)
Laser Learning Environment: A new environment for coordination-critical multi-agent tasks
by: Molinghen, Yannick, et al.
Published: (2024)
by: Molinghen, Yannick, et al.
Published: (2024)
Online Control of Adaptive Large Neighborhood Search using Deep Reinforcement Learning
by: Reijnen, Robbert, et al.
Published: (2022)
by: Reijnen, Robbert, et al.
Published: (2022)
Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement Learning
by: Mao, Yixiu, et al.
Published: (2025)
by: Mao, Yixiu, et al.
Published: (2025)
Edge-Selector Model Applied for Local Search Neighborhood for Solving Vehicle Routing Problems
by: Herdianto, Bachtiar, et al.
Published: (2025)
by: Herdianto, Bachtiar, et al.
Published: (2025)
Sequence Variables: A Constraint Programming Computational Domain for Routing and Sequencing
by: Delecluse, Augustin, et al.
Published: (2025)
by: Delecluse, Augustin, et al.
Published: (2025)
CRoSS: A Continual Robotic Simulation Suite for Scalable Reinforcement Learning with High Task Diversity and Realistic Physics Simulation
by: Denker, Yannick, et al.
Published: (2026)
by: Denker, Yannick, et al.
Published: (2026)
ParBalans: Parallel Multi-Armed Bandits-based Adaptive Large Neighborhood Search
by: Yilmaz, Alican, et al.
Published: (2025)
by: Yilmaz, Alican, et al.
Published: (2025)
Evading Community Detection via Counterfactual Neighborhood Search
by: Bernini, Andrea, et al.
Published: (2023)
by: Bernini, Andrea, et al.
Published: (2023)
Tree Search for LLM Agent Reinforcement Learning
by: Ji, Yuxiang, et al.
Published: (2025)
by: Ji, Yuxiang, et al.
Published: (2025)
Locally Constrained Representations in Reinforcement Learning
by: Nath, Somjit, et al.
Published: (2022)
by: Nath, Somjit, et al.
Published: (2022)
Learning Local Constraints for Reinforcement-Learned Content Generators
by: Bhaumik, Debosmita, et al.
Published: (2026)
by: Bhaumik, Debosmita, et al.
Published: (2026)
Selecting Decision-Relevant Concepts in Reinforcement Learning
by: Raman, Naveen, et al.
Published: (2026)
by: Raman, Naveen, et al.
Published: (2026)
In Search for Architectures and Loss Functions in Multi-Objective Reinforcement Learning
by: Terekhov, Mikhail, et al.
Published: (2024)
by: Terekhov, Mikhail, et al.
Published: (2024)
Enhancing Reinforcement Learning for the Floorplanning of Analog ICs with Beam Search
by: Della Rovere, Sandro Junior, et al.
Published: (2025)
by: Della Rovere, Sandro Junior, et al.
Published: (2025)
A Survey on Neural Architecture Search Based on Reinforcement Learning
by: Shao, Wenzhu
Published: (2024)
by: Shao, Wenzhu
Published: (2024)
Learning the Neighborhood: Contrast-Free Multimodal Self-Supervised Molecular Graph Pretraining
by: Ariguib, Boshra, et al.
Published: (2025)
by: Ariguib, Boshra, et al.
Published: (2025)
Beyond Inference-Time Search: Reinforcement Learning Synthesizes Reusable Solvers
by: Massoudi, Soheyl, et al.
Published: (2026)
by: Massoudi, Soheyl, et al.
Published: (2026)
Search-Based Credit Assignment for Offline Preference-Based Reinforcement Learning
by: Gao, Xiancheng, et al.
Published: (2025)
by: Gao, Xiancheng, et al.
Published: (2025)
A Selective Learning Method for Temporal Graph Continual Learning
by: Liu, Hanmo, et al.
Published: (2025)
by: Liu, Hanmo, et al.
Published: (2025)
Learning to Guide Local Search for MPE Inference in Probabilistic Graphical Models
by: Malhotra, Brij, et al.
Published: (2026)
by: Malhotra, Brij, et al.
Published: (2026)
Policy Gradient Methods for Non-Markovian Reinforcement Learning
by: Kar, Avik, et al.
Published: (2026)
by: Kar, Avik, et al.
Published: (2026)
A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning
by: Adkins, Jacob, et al.
Published: (2024)
by: Adkins, Jacob, et al.
Published: (2024)
A Method for Fast Autonomy Transfer in Reinforcement Learning
by: Sahabandu, Dinuka, et al.
Published: (2024)
by: Sahabandu, Dinuka, et al.
Published: (2024)
When is Offline Policy Selection Sample Efficient for Reinforcement Learning?
by: Liu, Vincent, et al.
Published: (2023)
by: Liu, Vincent, et al.
Published: (2023)
Matrix-Space Reinforcement Learning for Reusing Local Transition Geometry
by: Zhang, Zuyuan, et al.
Published: (2026)
by: Zhang, Zuyuan, et al.
Published: (2026)
Local Pairwise Distance Matching for Backpropagation-Free Reinforcement Learning
by: Tanneberg, Daniel
Published: (2025)
by: Tanneberg, Daniel
Published: (2025)
LearnAlign: Data Selection for LLM Reinforcement Learning with Improved Gradient Alignment
by: Li, Shipeng, et al.
Published: (2025)
by: Li, Shipeng, et al.
Published: (2025)
Prompted Policy Search: Reinforcement Learning through Linguistic and Numerical Reasoning in LLMs
by: Zhou, Yifan, et al.
Published: (2025)
by: Zhou, Yifan, et al.
Published: (2025)
Monte Carlo Beam Search for Actor-Critic Reinforcement Learning in Continuous Control
by: Alzorgan, Hazim, et al.
Published: (2025)
by: Alzorgan, Hazim, et al.
Published: (2025)
Tree Search in DAG Space with Model-based Reinforcement Learning for Causal Discovery
by: Darvariu, Victor-Alexandru, et al.
Published: (2023)
by: Darvariu, Victor-Alexandru, et al.
Published: (2023)
Scaling of Search and Learning: A Roadmap to Reproduce o1 from Reinforcement Learning Perspective
by: Zeng, Zhiyuan, et al.
Published: (2024)
by: Zeng, Zhiyuan, et al.
Published: (2024)
SEABO: A Simple Search-Based Method for Offline Imitation Learning
by: Lyu, Jiafei, et al.
Published: (2024)
by: Lyu, Jiafei, et al.
Published: (2024)
Balans: Multi-Armed Bandits-based Adaptive Large Neighborhood Search for Mixed-Integer Programming Problem
by: Cai, Junyang, et al.
Published: (2024)
by: Cai, Junyang, et al.
Published: (2024)
Agentic Transformers Provably Learn to Search via Reinforcement Learning
by: Yang, Tong, et al.
Published: (2026)
by: Yang, Tong, et al.
Published: (2026)
The ODE Method for Stochastic Approximation and Reinforcement Learning with Markovian Noise
by: Liu, Shuze Daniel, et al.
Published: (2024)
by: Liu, Shuze Daniel, et al.
Published: (2024)
A Survey of Explainable Reinforcement Learning: Targets, Methods and Needs
by: Saulières, Léo
Published: (2025)
by: Saulières, Léo
Published: (2025)
Comparing Traditional and Reinforcement-Learning Methods for Energy Storage Control
by: Ginzburg, Elinor, et al.
Published: (2025)
by: Ginzburg, Elinor, et al.
Published: (2025)
A Review of Safe Reinforcement Learning: Methods, Theory and Applications
by: Gu, Shangding, et al.
Published: (2022)
by: Gu, Shangding, et al.
Published: (2022)
Similar Items
-
Zero-Incentive Dynamics: a look at reward sparsity through the lens of unrewarded subgoals
by: Molinghen, Yannick, et al.
Published: (2025) -
FRAUD-RLA: A new reinforcement learning adversarial attack against credit card fraud detection
by: Lunghi, Daniele, et al.
Published: (2025) -
Laser Learning Environment: A new environment for coordination-critical multi-agent tasks
by: Molinghen, Yannick, et al.
Published: (2024) -
Online Control of Adaptive Large Neighborhood Search using Deep Reinforcement Learning
by: Reijnen, Robbert, et al.
Published: (2022) -
Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement Learning
by: Mao, Yixiu, et al.
Published: (2025)