Better Decisions through the Right Causal World Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Dillies, Elisabeth, Delfosse, Quentin, Blüml, Jannis, Emunds, Raban, Busch, Florian Peter, Kersting, Kristian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Deep Reinforcement Learning via Object-Centric Attention
di: Blüml, Jannis, et al.
Pubblicazione: (2025)
di: Blüml, Jannis, et al.
Pubblicazione: (2025)
Boosting deep Reinforcement Learning using pretraining with Logical Options
di: Ye, Zihan, et al.
Pubblicazione: (2026)
di: Ye, Zihan, et al.
Pubblicazione: (2026)
HackAtari: Atari Learning Environments for Robust and Continual Reinforcement Learning
di: Delfosse, Quentin, et al.
Pubblicazione: (2024)
di: Delfosse, Quentin, et al.
Pubblicazione: (2024)
Deep Reinforcement Learning Agents are not even close to Human Intelligence
di: Delfosse, Quentin, et al.
Pubblicazione: (2025)
di: Delfosse, Quentin, et al.
Pubblicazione: (2025)
OCAtari: Object-Centric Atari 2600 Reinforcement Learning Environments
di: Delfosse, Quentin, et al.
Pubblicazione: (2023)
di: Delfosse, Quentin, et al.
Pubblicazione: (2023)
GRAIL: Autonomous Concept Grounding for Neuro-Symbolic Reinforcement Learning
di: Shindo, Hikaru, et al.
Pubblicazione: (2026)
di: Shindo, Hikaru, et al.
Pubblicazione: (2026)
Tagged for Direction: Pinning Down Causal Edge Directions with Precision
di: Busch, Florian Peter, et al.
Pubblicazione: (2025)
di: Busch, Florian Peter, et al.
Pubblicazione: (2025)
OCALM: Object-Centric Assessment with Language Models
di: Kaufmann, Timo, et al.
Pubblicazione: (2024)
di: Kaufmann, Timo, et al.
Pubblicazione: (2024)
BlendRL: A Framework for Merging Symbolic and Neural Policy Learning
di: Shindo, Hikaru, et al.
Pubblicazione: (2024)
di: Shindo, Hikaru, et al.
Pubblicazione: (2024)
Interpretable and Editable Programmatic Tree Policies for Reinforcement Learning
di: Kohler, Hector, et al.
Pubblicazione: (2024)
di: Kohler, Hector, et al.
Pubblicazione: (2024)
Systems with Switching Causal Relations: A Meta-Causal Perspective
di: Willig, Moritz, et al.
Pubblicazione: (2024)
di: Willig, Moritz, et al.
Pubblicazione: (2024)
Representation Matters for Mastering Chess: Improved Feature Representation in AlphaZero Outperforms Switching to Transformers
di: Czech, Johannes, et al.
Pubblicazione: (2023)
di: Czech, Johannes, et al.
Pubblicazione: (2023)
Pix2Code: Learning to Compose Neural Visual Concepts as Programs
di: Wüst, Antonia, et al.
Pubblicazione: (2024)
di: Wüst, Antonia, et al.
Pubblicazione: (2024)
Interpretable end-to-end Neurosymbolic Reinforcement Learning agents
di: Grandien, Nils, et al.
Pubblicazione: (2024)
di: Grandien, Nils, et al.
Pubblicazione: (2024)
Polynomial Regret Concentration of UCB for Non-Deterministic State Transitions
di: Cömer, Can, et al.
Pubblicazione: (2025)
di: Cömer, Can, et al.
Pubblicazione: (2025)
LLMs Gaming Verifiers: RLVR can Lead to Reward Hacking
di: Helff, Lukas, et al.
Pubblicazione: (2026)
di: Helff, Lukas, et al.
Pubblicazione: (2026)
Amplifying Exploration in Monte-Carlo Tree Search by Focusing on the Unknown
di: Derstroff, Cedric, et al.
Pubblicazione: (2024)
di: Derstroff, Cedric, et al.
Pubblicazione: (2024)
Kintsugi: Learning Policies by Repairing Executable Knowledge Bases
di: Cao, Teng, et al.
Pubblicazione: (2026)
di: Cao, Teng, et al.
Pubblicazione: (2026)
Checkmating One, by Using Many: Combining Mixture of Experts with MCTS to Improve in Chess
di: Helfenstein, Felix, et al.
Pubblicazione: (2024)
di: Helfenstein, Felix, et al.
Pubblicazione: (2024)
Deep Classifier Mimicry without Data Access
di: Braun, Steven, et al.
Pubblicazione: (2023)
di: Braun, Steven, et al.
Pubblicazione: (2023)
$χ$SPN: Characteristic Interventional Sum-Product Networks for Causal Inference in Hybrid Domains
di: Poonia, Harsh, et al.
Pubblicazione: (2024)
di: Poonia, Harsh, et al.
Pubblicazione: (2024)
Exploring the Adversarial Capabilities of Large Language Models
di: Struppek, Lukas, et al.
Pubblicazione: (2024)
di: Struppek, Lukas, et al.
Pubblicazione: (2024)
Finding NeMo: Localizing Neurons Responsible For Memorization in Diffusion Models
di: Hintersdorf, Dominik, et al.
Pubblicazione: (2024)
di: Hintersdorf, Dominik, et al.
Pubblicazione: (2024)
Adaptable Hindsight Experience Replay for Search-Based Learning
di: Vazaios, Alexandros, et al.
Pubblicazione: (2025)
di: Vazaios, Alexandros, et al.
Pubblicazione: (2025)
Object Centric Concept Bottlenecks
di: Steinmann, David, et al.
Pubblicazione: (2025)
di: Steinmann, David, et al.
Pubblicazione: (2025)
Hyperparameter Optimization via Interacting with Probabilistic Circuits
di: Seng, Jonas, et al.
Pubblicazione: (2025)
di: Seng, Jonas, et al.
Pubblicazione: (2025)
Learning to Intervene on Concept Bottlenecks
di: Steinmann, David, et al.
Pubblicazione: (2023)
di: Steinmann, David, et al.
Pubblicazione: (2023)
Evaluating Interpretable Reinforcement Learning by Distilling Policies into Programs
di: Kohler, Hector, et al.
Pubblicazione: (2025)
di: Kohler, Hector, et al.
Pubblicazione: (2025)
Better World Models Can Lead to Better Post-Training Performance
di: Gupta, Prakhar, et al.
Pubblicazione: (2025)
di: Gupta, Prakhar, et al.
Pubblicazione: (2025)
Adaptive Rational Activations to Boost Deep Reinforcement Learning
di: Delfosse, Quentin, et al.
Pubblicazione: (2021)
di: Delfosse, Quentin, et al.
Pubblicazione: (2021)
EXPIL: Explanatory Predicate Invention for Learning in Games
di: Sha, Jingyuan, et al.
Pubblicazione: (2024)
di: Sha, Jingyuan, et al.
Pubblicazione: (2024)
Recursive Inference Machines for Neural Reasoning
di: Komisarczyk, Mieszko, et al.
Pubblicazione: (2026)
di: Komisarczyk, Mieszko, et al.
Pubblicazione: (2026)
Neural Concept Binder
di: Stammer, Wolfgang, et al.
Pubblicazione: (2024)
di: Stammer, Wolfgang, et al.
Pubblicazione: (2024)
Multiscale Byte Language Models -- A Hierarchical Architecture for Causal Million-Length Sequence Modeling
di: Egli, Eric, et al.
Pubblicazione: (2025)
di: Egli, Eric, et al.
Pubblicazione: (2025)
Interpretable Concept Bottlenecks to Align Reinforcement Learning Agents
di: Delfosse, Quentin, et al.
Pubblicazione: (2024)
di: Delfosse, Quentin, et al.
Pubblicazione: (2024)
Tractable Representation Learning with Probabilistic Circuits
di: Braun, Steven, et al.
Pubblicazione: (2025)
di: Braun, Steven, et al.
Pubblicazione: (2025)
AtMan: Understanding Transformer Predictions Through Memory Efficient Attention Manipulation
di: Deiseroth, Björn, et al.
Pubblicazione: (2023)
di: Deiseroth, Björn, et al.
Pubblicazione: (2023)
Learning by Self-Explaining
di: Stammer, Wolfgang, et al.
Pubblicazione: (2023)
di: Stammer, Wolfgang, et al.
Pubblicazione: (2023)
Credibility-Aware Multi-Modal Fusion Using Probabilistic Circuits
di: Sidheekh, Sahil, et al.
Pubblicazione: (2024)
di: Sidheekh, Sahil, et al.
Pubblicazione: (2024)
Where is the Truth? The Risk of Getting Confounded in a Continual World
di: Busch, Florian Peter, et al.
Pubblicazione: (2024)
di: Busch, Florian Peter, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Deep Reinforcement Learning via Object-Centric Attention
di: Blüml, Jannis, et al.
Pubblicazione: (2025) -
Boosting deep Reinforcement Learning using pretraining with Logical Options
di: Ye, Zihan, et al.
Pubblicazione: (2026) -
HackAtari: Atari Learning Environments for Robust and Continual Reinforcement Learning
di: Delfosse, Quentin, et al.
Pubblicazione: (2024) -
Deep Reinforcement Learning Agents are not even close to Human Intelligence
di: Delfosse, Quentin, et al.
Pubblicazione: (2025) -
OCAtari: Object-Centric Atari 2600 Reinforcement Learning Environments
di: Delfosse, Quentin, et al.
Pubblicazione: (2023)