Improved Exploration in GFlownets via Enhanced Epistemic Neural Networks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Muhammad, Sajan, Lahlou, Salem |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Score-informed Neural Operator for Enhancing Ordering-based Causal Discovery
par: Kang, Jiyeon, et autres
Publié: (2025)
par: Kang, Jiyeon, et autres
Publié: (2025)
Active Causal Experimentalist (ACE): Learning Intervention Strategies via Direct Preference Optimization
par: Cooper, Patrick, et autres
Publié: (2026)
par: Cooper, Patrick, et autres
Publié: (2026)
Graph Neural Networks are Heuristics
par: Min, Yimeng, et autres
Publié: (2026)
par: Min, Yimeng, et autres
Publié: (2026)
From Theory to Practice with RAVEN-UCB: Addressing Non-Stationarity in Multi-Armed Bandits through Variance Adaptation
par: Fang, Junyi, et autres
Publié: (2025)
par: Fang, Junyi, et autres
Publié: (2025)
Task Adaptation from Skills: Information Geometry, Disentanglement, and New Objectives for Unsupervised Reinforcement Learning
par: Yang, Yucheng, et autres
Publié: (2025)
par: Yang, Yucheng, et autres
Publié: (2025)
AI and Machine Learning Approaches for Predicting Nanoparticles Toxicity The Critical Role of Physiochemical Properties
par: Yousaf, Iqra
Publié: (2024)
par: Yousaf, Iqra
Publié: (2024)
Differentiable Symbolic Planning: A Neural Architecture for Constraint Reasoning with Learned Feasibility
par: Oruganti, Venkatakrishna Reddy
Publié: (2026)
par: Oruganti, Venkatakrishna Reddy
Publié: (2026)
Embedded Safety-Aligned Intelligence via Differentiable Internal Alignment Embeddings
par: Rathva, Harsh, et autres
Publié: (2025)
par: Rathva, Harsh, et autres
Publié: (2025)
GIRL: Generative Imagination Reinforcement Learning via Information-Theoretic Hallucination Control
par: Hiremath, Prakul Sunil
Publié: (2026)
par: Hiremath, Prakul Sunil
Publié: (2026)
The Reasoning-Creativity Trade-off: Toward Creativity-Driven Problem Solving
par: Luyten, Max Ruiz, et autres
Publié: (2026)
par: Luyten, Max Ruiz, et autres
Publié: (2026)
Multi-Task Genetic Algorithm with Multi-Granularity Encoding for Protein-Nucleotide Binding Site Prediction
par: Gao, Yiming, et autres
Publié: (2026)
par: Gao, Yiming, et autres
Publié: (2026)
RHiOTS: A Framework for Evaluating Hierarchical Time Series Forecasting Algorithms
par: Roque, Luis, et autres
Publié: (2024)
par: Roque, Luis, et autres
Publié: (2024)
Accuracy, Memory Efficiency and Generalization: A Comparative Study on Liquid Neural Networks and Recurrent Neural Networks
par: Zong, Shilong, et autres
Publié: (2025)
par: Zong, Shilong, et autres
Publié: (2025)
Adaptable Hindsight Experience Replay for Search-Based Learning
par: Vazaios, Alexandros, et autres
Publié: (2025)
par: Vazaios, Alexandros, et autres
Publié: (2025)
Safe Reinforcement Learning with Preference-based Constraint Inference
par: Li, Chenglin, et autres
Publié: (2026)
par: Li, Chenglin, et autres
Publié: (2026)
Working Paper: Active Causal Structure Learning with Latent Variables: Towards Learning to Detour in Autonomous Robots
par: Riscos, Pablo de los, et autres
Publié: (2024)
par: Riscos, Pablo de los, et autres
Publié: (2024)
Fast and Precise: Adjusting Planning Horizon with Adaptive Subgoal Search
par: Zawalski, Michał, et autres
Publié: (2022)
par: Zawalski, Michał, et autres
Publié: (2022)
Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems
par: Nuzhin, Egor E., et autres
Publié: (2024)
par: Nuzhin, Egor E., et autres
Publié: (2024)
Incentives for Responsiveness, Instrumental Control and Impact
par: Carey, Ryan, et autres
Publié: (2020)
par: Carey, Ryan, et autres
Publié: (2020)
Regret-Aware Policy Optimization: Environment-Level Memory for Replay Suppression under Delayed Harm
par: Hiremath, Prakul Sunil
Publié: (2026)
par: Hiremath, Prakul Sunil
Publié: (2026)
On the Generalization Gap in LLM Planning: Tests and Verifier-Reward RL
par: Belcamino, Valerio, et autres
Publié: (2026)
par: Belcamino, Valerio, et autres
Publié: (2026)
CORE: Towards Scalable and Efficient Causal Discovery with Reinforcement Learning
par: Sauter, Andreas W. M., et autres
Publié: (2024)
par: Sauter, Andreas W. M., et autres
Publié: (2024)
Not All Transitions Matter: Evidence from PPO
par: Basnet, Ajhesh
Publié: (2026)
par: Basnet, Ajhesh
Publié: (2026)
AGWM: Affordance-Grounded World Models for Environments with Compositional Prerequisites
par: Zhang, Qinshi, et autres
Publié: (2026)
par: Zhang, Qinshi, et autres
Publié: (2026)
What Do World Models Learn in RL? Probing Latent Representations in Learned Environment Simulators
par: Zhang, Xinyu
Publié: (2026)
par: Zhang, Xinyu
Publié: (2026)
Scalable and Interpretable Scientific Discovery via Sparse Variational Gaussian Process Kolmogorov-Arnold Networks (SVGP KAN)
par: Ju, Y. Sungtaek
Publié: (2025)
par: Ju, Y. Sungtaek
Publié: (2025)
Hybrid-AIRL: Enhancing Inverse Reinforcement Learning with Supervised Expert Guidance
par: Silue, Bram, et autres
Publié: (2025)
par: Silue, Bram, et autres
Publié: (2025)
Exploration with Foundation Models: Capabilities, Limitations, and Hybrid Approaches
par: Sasso, Remo, et autres
Publié: (2025)
par: Sasso, Remo, et autres
Publié: (2025)
LeanProgress: Guiding Search for Neural Theorem Proving via Proof Progress Prediction
par: George, Robert Joseph, et autres
Publié: (2025)
par: George, Robert Joseph, et autres
Publié: (2025)
On Divergence Measures for Training GFlowNets
par: da Silva, Tiago, et autres
Publié: (2024)
par: da Silva, Tiago, et autres
Publié: (2024)
Modeling and Controlling Deployment Reliability under Temporal Distribution Shift
par: Rahman, Naimur, et autres
Publié: (2026)
par: Rahman, Naimur, et autres
Publié: (2026)
Uncertainty Quantification for Scientific Machine Learning using Sparse Variational Gaussian Process Kolmogorov-Arnold Networks (SVGP KAN)
par: Ju, Y. Sungtaek
Publié: (2025)
par: Ju, Y. Sungtaek
Publié: (2025)
COBRA-PPM: A Causal Bayesian Reasoning Architecture Using Probabilistic Programming for Robot Manipulation Under Uncertainty
par: Cannizzaro, Ricardo, et autres
Publié: (2024)
par: Cannizzaro, Ricardo, et autres
Publié: (2024)
Towards Systematic Generalization for Power Grid Optimization Problems
par: Memon, Zeeshan, et autres
Publié: (2026)
par: Memon, Zeeshan, et autres
Publié: (2026)
SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks
par: Vincze, Mátyás, et autres
Publié: (2024)
par: Vincze, Mátyás, et autres
Publié: (2024)
Constrained Auto-Bidding via Generative Response Modeling
par: Yang, Eunseok, et autres
Publié: (2026)
par: Yang, Eunseok, et autres
Publié: (2026)
Sketch Decompositions for Classical Planning via Deep Reinforcement Learning
par: Aichmüller, Michael, et autres
Publié: (2024)
par: Aichmüller, Michael, et autres
Publié: (2024)
SCULPT: Constraint-Guided Pruned MCTS that Carves Efficient Paths for Mathematical Reasoning
par: Fang, Qitong, et autres
Publié: (2026)
par: Fang, Qitong, et autres
Publié: (2026)
On the Limits of Learned Importance Scoring for KV Cache Compression
par: Steele, Brady
Publié: (2026)
par: Steele, Brady
Publié: (2026)
Scaling Trends for Multi-Hop Contextual Reasoning in Mid-Scale Language Models
par: Steele, Brady, et autres
Publié: (2026)
par: Steele, Brady, et autres
Publié: (2026)
Documents similaires
-
Score-informed Neural Operator for Enhancing Ordering-based Causal Discovery
par: Kang, Jiyeon, et autres
Publié: (2025) -
Active Causal Experimentalist (ACE): Learning Intervention Strategies via Direct Preference Optimization
par: Cooper, Patrick, et autres
Publié: (2026) -
Graph Neural Networks are Heuristics
par: Min, Yimeng, et autres
Publié: (2026) -
From Theory to Practice with RAVEN-UCB: Addressing Non-Stationarity in Multi-Armed Bandits through Variance Adaptation
par: Fang, Junyi, et autres
Publié: (2025) -
Task Adaptation from Skills: Information Geometry, Disentanglement, and New Objectives for Unsupervised Reinforcement Learning
par: Yang, Yucheng, et autres
Publié: (2025)