Combining Trained Models in Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Patil, Ujjwal, Ghofrani, Javad |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reward-Modulated Local Learning in Spiking Encoders: Controlled Benchmarks with STDP and Hybrid Rate Readouts
di: Chakraborty, Debjyoti
Pubblicazione: (2026)
di: Chakraborty, Debjyoti
Pubblicazione: (2026)
Evolving Programmatic Skill Networks
di: Shi, Haochen, et al.
Pubblicazione: (2026)
di: Shi, Haochen, et al.
Pubblicazione: (2026)
Shapley Value-Guided Adaptive Ensemble Learning for Explainable Financial Fraud Detection with U.S. Regulatory Compliance Validation
di: Uddin, Mohammad Nasir, et al.
Pubblicazione: (2026)
di: Uddin, Mohammad Nasir, et al.
Pubblicazione: (2026)
CoupleEvo: Evolving Heuristics for Coupled Optimization Problems Using Large Language Models
di: Bömer, Thomas, et al.
Pubblicazione: (2026)
di: Bömer, Thomas, et al.
Pubblicazione: (2026)
Scalable Nested Optimization for Deep Learning
di: Lorraine, Jonathan
Pubblicazione: (2024)
di: Lorraine, Jonathan
Pubblicazione: (2024)
Safe Reinforcement Learning with Preference-based Constraint Inference
di: Li, Chenglin, et al.
Pubblicazione: (2026)
di: Li, Chenglin, et al.
Pubblicazione: (2026)
CORE: Towards Scalable and Efficient Causal Discovery with Reinforcement Learning
di: Sauter, Andreas W. M., et al.
Pubblicazione: (2024)
di: Sauter, Andreas W. M., et al.
Pubblicazione: (2024)
Resource-constrained Amazons chess decision framework integrating large language models and graph attention
di: Qian, Tianhao, et al.
Pubblicazione: (2026)
di: Qian, Tianhao, et al.
Pubblicazione: (2026)
GIRL: Generative Imagination Reinforcement Learning via Information-Theoretic Hallucination Control
di: Hiremath, Prakul Sunil
Pubblicazione: (2026)
di: Hiremath, Prakul Sunil
Pubblicazione: (2026)
Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems
di: Nuzhin, Egor E., et al.
Pubblicazione: (2024)
di: Nuzhin, Egor E., et al.
Pubblicazione: (2024)
AI and Machine Learning Approaches for Predicting Nanoparticles Toxicity The Critical Role of Physiochemical Properties
di: Yousaf, Iqra
Pubblicazione: (2024)
di: Yousaf, Iqra
Pubblicazione: (2024)
FF-INT8: Efficient Forward-Forward DNN Training on Edge Devices with INT8 Precision
di: Ma, Jingxiao, et al.
Pubblicazione: (2025)
di: Ma, Jingxiao, et al.
Pubblicazione: (2025)
Accelerating Model-Based Reinforcement Learning with State-Space World Models
di: Krinner, Maria, et al.
Pubblicazione: (2025)
di: Krinner, Maria, et al.
Pubblicazione: (2025)
Efficient and Flexible Neural Network Training through Layer-wise Feedback Propagation
di: Weber, Leander, et al.
Pubblicazione: (2023)
di: Weber, Leander, et al.
Pubblicazione: (2023)
Spiking Neural Network Architecture Search: A Survey
di: Svoboda, Kama, et al.
Pubblicazione: (2025)
di: Svoboda, Kama, et al.
Pubblicazione: (2025)
The Paradox of Success in Evolutionary and Bioinspired Optimization: Revisiting Critical Issues, Key Studies, and Methodological Pathways
di: Molina, Daniel, et al.
Pubblicazione: (2025)
di: Molina, Daniel, et al.
Pubblicazione: (2025)
What Do World Models Learn in RL? Probing Latent Representations in Learned Environment Simulators
di: Zhang, Xinyu
Pubblicazione: (2026)
di: Zhang, Xinyu
Pubblicazione: (2026)
Exploring Multi-Agent Reinforcement Learning for Unrelated Parallel Machine Scheduling
di: Zampella, Maria, et al.
Pubblicazione: (2024)
di: Zampella, Maria, et al.
Pubblicazione: (2024)
Zero-Shot Context Generalization in Reinforcement Learning from Few Training Contexts
di: Chapman, James, et al.
Pubblicazione: (2025)
di: Chapman, James, et al.
Pubblicazione: (2025)
Hybrid-AIRL: Enhancing Inverse Reinforcement Learning with Supervised Expert Guidance
di: Silue, Bram, et al.
Pubblicazione: (2025)
di: Silue, Bram, et al.
Pubblicazione: (2025)
Working Paper: Active Causal Structure Learning with Latent Variables: Towards Learning to Detour in Autonomous Robots
di: Riscos, Pablo de los, et al.
Pubblicazione: (2024)
di: Riscos, Pablo de los, et al.
Pubblicazione: (2024)
Evolving Code with A Large Language Model
di: Hemberg, Erik, et al.
Pubblicazione: (2024)
di: Hemberg, Erik, et al.
Pubblicazione: (2024)
Adaptable Hindsight Experience Replay for Search-Based Learning
di: Vazaios, Alexandros, et al.
Pubblicazione: (2025)
di: Vazaios, Alexandros, et al.
Pubblicazione: (2025)
SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks
di: Vincze, Mátyás, et al.
Pubblicazione: (2024)
di: Vincze, Mátyás, et al.
Pubblicazione: (2024)
Differentiable Symbolic Planning: A Neural Architecture for Constraint Reasoning with Learned Feasibility
di: Oruganti, Venkatakrishna Reddy
Pubblicazione: (2026)
di: Oruganti, Venkatakrishna Reddy
Pubblicazione: (2026)
AGWM: Affordance-Grounded World Models for Environments with Compositional Prerequisites
di: Zhang, Qinshi, et al.
Pubblicazione: (2026)
di: Zhang, Qinshi, et al.
Pubblicazione: (2026)
Random Search as a Baseline for Sparse Neural Network Architecture Search
di: Farahani, Rezsa
Pubblicazione: (2024)
di: Farahani, Rezsa
Pubblicazione: (2024)
On the Infinite Width and Depth Limits of Predictive Coding Networks
di: Innocenti, Francesco, et al.
Pubblicazione: (2026)
di: Innocenti, Francesco, et al.
Pubblicazione: (2026)
Efficient NAS with FaDE on Hierarchical Spaces
di: Neumeyer, Simon, et al.
Pubblicazione: (2024)
di: Neumeyer, Simon, et al.
Pubblicazione: (2024)
Only Strict Saddles in the Energy Landscape of Predictive Coding Networks?
di: Innocenti, Francesco, et al.
Pubblicazione: (2024)
di: Innocenti, Francesco, et al.
Pubblicazione: (2024)
$μ$PC: Scaling Predictive Coding to 100+ Layer Networks
di: Innocenti, Francesco, et al.
Pubblicazione: (2025)
di: Innocenti, Francesco, et al.
Pubblicazione: (2025)
Social Interpretable Reinforcement Learning
di: Custode, Leonardo Lucio, et al.
Pubblicazione: (2024)
di: Custode, Leonardo Lucio, et al.
Pubblicazione: (2024)
Resolving Action Bottleneck: Agentic Reinforcement Learning Informed by Token-Level Energy
di: He, Langzhou, et al.
Pubblicazione: (2026)
di: He, Langzhou, et al.
Pubblicazione: (2026)
A Parallel Hybrid Action Space Reinforcement Learning Model for Real-world Adaptive Traffic Signal Control
di: Wang, Yuxuan, et al.
Pubblicazione: (2025)
di: Wang, Yuxuan, et al.
Pubblicazione: (2025)
Trilevel Memetic Algorithm for the Electric Vehicle Routing Problem
di: Milinović, Ivan, et al.
Pubblicazione: (2025)
di: Milinović, Ivan, et al.
Pubblicazione: (2025)
Sketch Decompositions for Classical Planning via Deep Reinforcement Learning
di: Aichmüller, Michael, et al.
Pubblicazione: (2024)
di: Aichmüller, Michael, et al.
Pubblicazione: (2024)
Regret-Aware Policy Optimization: Environment-Level Memory for Replay Suppression under Delayed Harm
di: Hiremath, Prakul Sunil
Pubblicazione: (2026)
di: Hiremath, Prakul Sunil
Pubblicazione: (2026)
On the Generalization Gap in LLM Planning: Tests and Verifier-Reward RL
di: Belcamino, Valerio, et al.
Pubblicazione: (2026)
di: Belcamino, Valerio, et al.
Pubblicazione: (2026)
Not All Transitions Matter: Evidence from PPO
di: Basnet, Ajhesh
Pubblicazione: (2026)
di: Basnet, Ajhesh
Pubblicazione: (2026)
Embedded Safety-Aligned Intelligence via Differentiable Internal Alignment Embeddings
di: Rathva, Harsh, et al.
Pubblicazione: (2025)
di: Rathva, Harsh, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Reward-Modulated Local Learning in Spiking Encoders: Controlled Benchmarks with STDP and Hybrid Rate Readouts
di: Chakraborty, Debjyoti
Pubblicazione: (2026) -
Evolving Programmatic Skill Networks
di: Shi, Haochen, et al.
Pubblicazione: (2026) -
Shapley Value-Guided Adaptive Ensemble Learning for Explainable Financial Fraud Detection with U.S. Regulatory Compliance Validation
di: Uddin, Mohammad Nasir, et al.
Pubblicazione: (2026) -
CoupleEvo: Evolving Heuristics for Coupled Optimization Problems Using Large Language Models
di: Bömer, Thomas, et al.
Pubblicazione: (2026) -
Scalable Nested Optimization for Deep Learning
di: Lorraine, Jonathan
Pubblicazione: (2024)