Quantum-Inspired Episode Selection for Monte Carlo Reinforcement Learning via QUBO Optimization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Salloum, Hadi, Jnadi, Ali, Kholodov, Yaroslav, Gasnikov, Alexander |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SCOPE: Smooth Convex Optimization for Planned Evolution of Deformable Linear Objects
par: Jnadi, Ali, et autres
Publié: (2026)
par: Jnadi, Ali, et autres
Publié: (2026)
Neural Network Pruning via QUBO Optimization
par: Orabi, Osama, et autres
Publié: (2026)
par: Orabi, Osama, et autres
Publié: (2026)
Comprehensive Overview of Reward Engineering and Shaping in Advancing Reinforcement Learning Applications
par: Ibrahim, Sinan, et autres
Publié: (2024)
par: Ibrahim, Sinan, et autres
Publié: (2024)
Training-Free Out-Of-Distribution Segmentation With Foundation Models
par: Nayal, Laith, et autres
Publié: (2025)
par: Nayal, Laith, et autres
Publié: (2025)
Activations and Gradients Compression for Model-Parallel Training
par: Rudakov, Mikhail, et autres
Publié: (2024)
par: Rudakov, Mikhail, et autres
Publié: (2024)
MoRe-ERL: Learning Motion Residuals using Episodic Reinforcement Learning
par: Huang, Xi, et autres
Publié: (2025)
par: Huang, Xi, et autres
Publié: (2025)
TOP-ERL: Transformer-based Off-Policy Episodic Reinforcement Learning
par: Li, Ge, et autres
Publié: (2024)
par: Li, Ge, et autres
Publié: (2024)
Diversity-Aware Adaptive Collocation for Physics-Informed Neural Networks via Sparse QUBO Optimization and Hybrid Coresets
par: Salloum, Hadi, et autres
Publié: (2026)
par: Salloum, Hadi, et autres
Publié: (2026)
Open the Black Box: Step-based Policy Updates for Temporally-Correlated Episodic Reinforcement Learning
par: Li, Ge, et autres
Publié: (2024)
par: Li, Ge, et autres
Publié: (2024)
Tempered Sequential Monte Carlo for Trajectory and Policy Optimization with Differentiable Dynamics
par: Yang, Heng
Publié: (2026)
par: Yang, Heng
Publié: (2026)
Continuous Monte Carlo Graph Search
par: Kujanpää, Kalle, et autres
Publié: (2022)
par: Kujanpää, Kalle, et autres
Publié: (2022)
ConceptACT: Episode-Level Concepts for Sample-Efficient Robotic Imitation Learning
par: Karalus, Jakob, et autres
Publié: (2026)
par: Karalus, Jakob, et autres
Publié: (2026)
Dual-Granularity Contrastive Reward via Generated Episodic Guidance for Efficient Embodied RL
par: Liu, Xin, et autres
Publié: (2026)
par: Liu, Xin, et autres
Publié: (2026)
Reinforcement Learning for Safe Autonomous Two Device Navigation of Cerebral Vessels in Mechanical Thrombectomy
par: Robertshaw, Harry, et autres
Publié: (2025)
par: Robertshaw, Harry, et autres
Publié: (2025)
ARC-RL: A Reinforcement Learning Playground Inspired by ARC Raiders
par: Romeo, Carlo, et autres
Publié: (2026)
par: Romeo, Carlo, et autres
Publié: (2026)
Vintix: Action Model via In-Context Reinforcement Learning
par: Polubarov, Andrey, et autres
Publié: (2025)
par: Polubarov, Andrey, et autres
Publié: (2025)
Shielded Reinforcement Learning Under Dynamic Temporal Logic Constraints
par: Yüksel, Sadık Bera, et autres
Publié: (2026)
par: Yüksel, Sadık Bera, et autres
Publié: (2026)
A Reinforcement Learning Inspired Latent Yield Based Adaptive Algorithm Switching Mechanism
par: Nair, Jayprakash S., et autres
Publié: (2026)
par: Nair, Jayprakash S., et autres
Publié: (2026)
PolicyFlow: Policy Optimization with Continuous Normalizing Flow in Reinforcement Learning
par: Yang, Shunpeng, et autres
Publié: (2026)
par: Yang, Shunpeng, et autres
Publié: (2026)
Safe Multi-Agent Reinforcement Learning with Bilevel Optimization in Autonomous Driving
par: Zheng, Zhi, et autres
Publié: (2024)
par: Zheng, Zhi, et autres
Publié: (2024)
Accelerating Model-Based Reinforcement Learning using Non-Linear Trajectory Optimization
par: Calì, Marco, et autres
Publié: (2025)
par: Calì, Marco, et autres
Publié: (2025)
High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures
par: Miller, AJ, et autres
Publié: (2025)
par: Miller, AJ, et autres
Publié: (2025)
Provably Efficient Long-Horizon Exploration in Monte Carlo Tree Search through State Occupancy Regularization
par: Schramm, Liam, et autres
Publié: (2024)
par: Schramm, Liam, et autres
Publié: (2024)
MPC-Inspired Reinforcement Learning for Verifiable Model-Free Control
par: Lu, Yiwen, et autres
Publié: (2023)
par: Lu, Yiwen, et autres
Publié: (2023)
Toward AI Autonomous Navigation for Mechanical Thrombectomy using Hierarchical Modular Multi-agent Reinforcement Learning (HM-MARL)
par: Robertshaw, Harry, et autres
Publié: (2026)
par: Robertshaw, Harry, et autres
Publié: (2026)
Adaptive Target Localization under Uncertainty using Multi-Agent Deep Reinforcement Learning with Knowledge Transfer
par: Alagha, Ahmed, et autres
Publié: (2025)
par: Alagha, Ahmed, et autres
Publié: (2025)
Adaptive Outer-Loop Control of Quadrotors via Reinforcement Learning
par: Saj, Vishnu, et autres
Publié: (2026)
par: Saj, Vishnu, et autres
Publié: (2026)
Apple: Toward General Active Perception via Reinforcement Learning
par: Schneider, Tim, et autres
Publié: (2025)
par: Schneider, Tim, et autres
Publié: (2025)
Deep Reinforcement Learning for Robotic Manipulation under Distribution Shift with Bounded Extremum Seeking
par: Saxena, Shaifalee, et autres
Publié: (2026)
par: Saxena, Shaifalee, et autres
Publié: (2026)
Formulating Reinforcement Learning for Human-Robot Collaboration through Off-Policy Evaluation
par: Singh, Saurav, et autres
Publié: (2026)
par: Singh, Saurav, et autres
Publié: (2026)
Learning When to Act: Communication-Efficient Reinforcement Learning via Run-Time Assurance
par: Haroon, Adam, et autres
Publié: (2026)
par: Haroon, Adam, et autres
Publié: (2026)
Safety Optimized Reinforcement Learning via Multi-Objective Policy Optimization
par: Honari, Homayoun, et autres
Publié: (2024)
par: Honari, Homayoun, et autres
Publié: (2024)
Vision-Guided Outdoor Flight and Obstacle Evasion via Reinforcement Learning
par: Dutta, Shiladitya, et autres
Publié: (2026)
par: Dutta, Shiladitya, et autres
Publié: (2026)
Robust Point Cloud Reinforcement Learning via PCA-Based Canonicalization
par: Bezick, Michael, et autres
Publié: (2025)
par: Bezick, Michael, et autres
Publié: (2025)
Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function
par: Chen, Donghe, et autres
Publié: (2025)
par: Chen, Donghe, et autres
Publié: (2025)
SATA: Safe and Adaptive Torque-Based Locomotion Policies Inspired by Animal Learning
par: Li, Peizhuo, et autres
Publié: (2025)
par: Li, Peizhuo, et autres
Publié: (2025)
Planning from Imagination: Episodic Simulation and Episodic Memory for Vision-and-Language Navigation
par: Pan, Yiyuan, et autres
Publié: (2024)
par: Pan, Yiyuan, et autres
Publié: (2024)
E2HiL: Entropy-Guided Sample Selection for Efficient Real-World Human-in-the-Loop Reinforcement Learning
par: Deng, Haoyuan, et autres
Publié: (2026)
par: Deng, Haoyuan, et autres
Publié: (2026)
Strategic Coordination of Drones via Short-term Distributed Optimization and Long-term Reinforcement Learning
par: Qin, Chuhao, et autres
Publié: (2023)
par: Qin, Chuhao, et autres
Publié: (2023)
Dynamics-Decoupled Trajectory Alignment for Sim-to-Real Transfer in Reinforcement Learning for Autonomous Driving
par: Steinecker, Thomas, et autres
Publié: (2025)
par: Steinecker, Thomas, et autres
Publié: (2025)
Documents similaires
-
SCOPE: Smooth Convex Optimization for Planned Evolution of Deformable Linear Objects
par: Jnadi, Ali, et autres
Publié: (2026) -
Neural Network Pruning via QUBO Optimization
par: Orabi, Osama, et autres
Publié: (2026) -
Comprehensive Overview of Reward Engineering and Shaping in Advancing Reinforcement Learning Applications
par: Ibrahim, Sinan, et autres
Publié: (2024) -
Training-Free Out-Of-Distribution Segmentation With Foundation Models
par: Nayal, Laith, et autres
Publié: (2025) -
Activations and Gradients Compression for Model-Parallel Training
par: Rudakov, Mikhail, et autres
Publié: (2024)