Do Not Imitate, Reinforce: Iterative Classification via Belief Refinement
Fuente:
arXiv
Salvato in:
| Autori principali: | Kallel, Mahdi, Tölle, Johannes, Hendawy, Ahmed, D'Eramo, Carlo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multi-Task Reinforcement Learning with Mixture of Orthogonal Experts
di: Hendawy, Ahmed, et al.
Pubblicazione: (2023)
di: Hendawy, Ahmed, et al.
Pubblicazione: (2023)
Use the Online Network If You Can: Towards Fast and Stable Reinforcement Learning
di: Hendawy, Ahmed, et al.
Pubblicazione: (2025)
di: Hendawy, Ahmed, et al.
Pubblicazione: (2025)
Augmented Bayesian Policy Search
di: Kallel, Mahdi, et al.
Pubblicazione: (2024)
di: Kallel, Mahdi, et al.
Pubblicazione: (2024)
Deterministic Exploration via Stationary Bellman Error Maximization
di: Griesbach, Sebastian, et al.
Pubblicazione: (2024)
di: Griesbach, Sebastian, et al.
Pubblicazione: (2024)
Learning to Explore in Diverse Reward Settings via Temporal-Difference-Error Maximization
di: Griesbach, Sebastian, et al.
Pubblicazione: (2025)
di: Griesbach, Sebastian, et al.
Pubblicazione: (2025)
Iterated $Q$-Network: Beyond One-Step Bellman Updates in Deep Reinforcement Learning
di: Vincent, Théo, et al.
Pubblicazione: (2024)
di: Vincent, Théo, et al.
Pubblicazione: (2024)
On the Benefit of Optimal Transport for Curriculum Reinforcement Learning
di: Klink, Pascal, et al.
Pubblicazione: (2023)
di: Klink, Pascal, et al.
Pubblicazione: (2023)
Streaming Reinforcement Learning under Partial Observability with Real-Time Recurrent Learning
di: Farr, Noah, et al.
Pubblicazione: (2026)
di: Farr, Noah, et al.
Pubblicazione: (2026)
Dynamic Obstacle Avoidance with Bounded Rationality Adversarial Reinforcement Learning
di: Holgado-Alvarez, Jose-Luis, et al.
Pubblicazione: (2025)
di: Holgado-Alvarez, Jose-Luis, et al.
Pubblicazione: (2025)
$K$-Level Policy Gradients for Multi-Agent Reinforcement Learning
di: Reddi, Aryaman, et al.
Pubblicazione: (2025)
di: Reddi, Aryaman, et al.
Pubblicazione: (2025)
Sharing Knowledge in Multi-Task Deep Reinforcement Learning
di: D'Eramo, Carlo, et al.
Pubblicazione: (2024)
di: D'Eramo, Carlo, et al.
Pubblicazione: (2024)
Adaptive $Q$-Network: On-the-fly Target Selection for Deep Reinforcement Learning
di: Vincent, Théo, et al.
Pubblicazione: (2024)
di: Vincent, Théo, et al.
Pubblicazione: (2024)
Eau De $Q$-Network: Adaptive Distillation of Neural Networks in Deep Reinforcement Learning
di: Vincent, Théo, et al.
Pubblicazione: (2025)
di: Vincent, Théo, et al.
Pubblicazione: (2025)
Gradient Iterated Temporal-Difference Learning
di: Vincent, Théo, et al.
Pubblicazione: (2026)
di: Vincent, Théo, et al.
Pubblicazione: (2026)
Domain Randomization via Entropy Maximization
di: Tiboni, Gabriele, et al.
Pubblicazione: (2023)
di: Tiboni, Gabriele, et al.
Pubblicazione: (2023)
Bridging the Performance Gap Between Target-Free and Target-Based Reinforcement Learning
di: Vincent, Théo, et al.
Pubblicazione: (2025)
di: Vincent, Théo, et al.
Pubblicazione: (2025)
Parameterized Projected Bellman Operator
di: Vincent, Théo, et al.
Pubblicazione: (2023)
di: Vincent, Théo, et al.
Pubblicazione: (2023)
Machine Learning with Physics Knowledge for Prediction: A Survey
di: Watson, Joe, et al.
Pubblicazione: (2024)
di: Watson, Joe, et al.
Pubblicazione: (2024)
Light to Heavy, Brief to Eternal: An Axion for Every Occasion (in the Early Universe)
di: D'Eramo, Francesco
Pubblicazione: (2026)
di: D'Eramo, Francesco
Pubblicazione: (2026)
Probing Non-Minimal Dark Sectors via the 21 cm Line at Cosmic Dawn
di: Cima, Federico, et al.
Pubblicazione: (2025)
di: Cima, Federico, et al.
Pubblicazione: (2025)
Back to the phase space: thermal axion dark radiation via couplings to standard model fermions
di: D'Eramo, Francesco, et al.
Pubblicazione: (2024)
di: D'Eramo, Francesco, et al.
Pubblicazione: (2024)
Symbolic Regression via Latent Iterative Refinement
di: Chu, Xieting, et al.
Pubblicazione: (2026)
di: Chu, Xieting, et al.
Pubblicazione: (2026)
Iterative Refinement of Flow Policies in Probability Space for Online Reinforcement Learning
di: Sun, Mingyang, et al.
Pubblicazione: (2025)
di: Sun, Mingyang, et al.
Pubblicazione: (2025)
Continual Learning Should Move Beyond Incremental Classification
di: Mitchell, Rupert, et al.
Pubblicazione: (2025)
di: Mitchell, Rupert, et al.
Pubblicazione: (2025)
Axion Portal to Scalar Dark Matter: Unveiling Stabilizing Symmetry Footprints
di: D'Eramo, Francesco, et al.
Pubblicazione: (2025)
di: D'Eramo, Francesco, et al.
Pubblicazione: (2025)
Reinforcement Learning via Implicit Imitation Guidance
di: Dong, Perry, et al.
Pubblicazione: (2025)
di: Dong, Perry, et al.
Pubblicazione: (2025)
From Imitation to Refinement -- Residual RL for Precise Assembly
di: Ankile, Lars, et al.
Pubblicazione: (2024)
di: Ankile, Lars, et al.
Pubblicazione: (2024)
Going Beyond Expert Performance via Deep Implicit Imitation Reinforcement Learning
di: Chrysomallis, Iason, et al.
Pubblicazione: (2025)
di: Chrysomallis, Iason, et al.
Pubblicazione: (2025)
Imitation Bootstrapped Reinforcement Learning
di: Hu, Hengyuan, et al.
Pubblicazione: (2023)
di: Hu, Hengyuan, et al.
Pubblicazione: (2023)
An Introduction to Deep Reinforcement and Imitation Learning
di: Santana, Pedro
Pubblicazione: (2025)
di: Santana, Pedro
Pubblicazione: (2025)
Neural Global Optimization via Iterative Refinement from Noisy Samples
di: Muzaffar, Qusay, et al.
Pubblicazione: (2026)
di: Muzaffar, Qusay, et al.
Pubblicazione: (2026)
Exploring Synthesizable Chemical Space with Iterative Pathway Refinements
di: Lee, Seul, et al.
Pubblicazione: (2025)
di: Lee, Seul, et al.
Pubblicazione: (2025)
Self-Refining Diffusion Samplers: Enabling Parallelization via Parareal Iterations
di: Selvam, Nikil Roashan, et al.
Pubblicazione: (2024)
di: Selvam, Nikil Roashan, et al.
Pubblicazione: (2024)
Cosmic-Ray Signatures of Annihilating and Semi-Annihilating Dark Matter via One-Step Cascades
di: D'Eramo, Francesco, et al.
Pubblicazione: (2026)
di: D'Eramo, Francesco, et al.
Pubblicazione: (2026)
Imitating Language via Scalable Inverse Reinforcement Learning
di: Wulfmeier, Markus, et al.
Pubblicazione: (2024)
di: Wulfmeier, Markus, et al.
Pubblicazione: (2024)
Improving Next Tokens via Second-to-Last Predictions with Generate and Refine
di: Schneider, Johannes
Pubblicazione: (2024)
di: Schneider, Johannes
Pubblicazione: (2024)
RILe: Reinforced Imitation Learning
di: Albaba, Mert, et al.
Pubblicazione: (2024)
di: Albaba, Mert, et al.
Pubblicazione: (2024)
Directly Forecasting Belief for Reinforcement Learning with Delays
di: Wu, Qingyuan, et al.
Pubblicazione: (2025)
di: Wu, Qingyuan, et al.
Pubblicazione: (2025)
Federated In-Context Learning: Iterative Refinement for Improved Answer Quality
di: Wang, Ruhan, et al.
Pubblicazione: (2025)
di: Wang, Ruhan, et al.
Pubblicazione: (2025)
Efficient Offline Reinforcement Learning: First Imitate, then Improve
di: Jelley, Adam, et al.
Pubblicazione: (2024)
di: Jelley, Adam, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Multi-Task Reinforcement Learning with Mixture of Orthogonal Experts
di: Hendawy, Ahmed, et al.
Pubblicazione: (2023) -
Use the Online Network If You Can: Towards Fast and Stable Reinforcement Learning
di: Hendawy, Ahmed, et al.
Pubblicazione: (2025) -
Augmented Bayesian Policy Search
di: Kallel, Mahdi, et al.
Pubblicazione: (2024) -
Deterministic Exploration via Stationary Bellman Error Maximization
di: Griesbach, Sebastian, et al.
Pubblicazione: (2024) -
Learning to Explore in Diverse Reward Settings via Temporal-Difference-Error Maximization
di: Griesbach, Sebastian, et al.
Pubblicazione: (2025)