Skill or Luck? Return Decomposition via Advantage Functions
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pan, Hsiao-Ru, Schölkopf, Bernhard |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Intrinsically Interpretable Attention via Sparse Post-Training
par: Draye, Florent, et autres
Publié: (2025)
par: Draye, Florent, et autres
Publié: (2025)
Homomorphism Autoencoder -- Learning Group Structured Representations from Observed Transitions
par: Keurti, Hamza, et autres
Publié: (2022)
par: Keurti, Hamza, et autres
Publié: (2022)
Geometry-Aware Instrumental Variable Regression
par: Kremer, Heiner, et autres
Publié: (2024)
par: Kremer, Heiner, et autres
Publié: (2024)
Robustness of Nonlinear Representation Learning
par: Buchholz, Simon, et autres
Publié: (2025)
par: Buchholz, Simon, et autres
Publié: (2025)
Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning
par: Reizinger, Patrik, et autres
Publié: (2025)
par: Reizinger, Patrik, et autres
Publié: (2025)
Physics of Learning: A Lagrangian perspective to different learning paradigms
par: Guo, Siyuan, et autres
Publié: (2025)
par: Guo, Siyuan, et autres
Publié: (2025)
Identifying Intervenable and Interpretable Features via Orthogonality Regularization
par: Miller, Moritz, et autres
Publié: (2026)
par: Miller, Moritz, et autres
Publié: (2026)
SPARTAN: A Sparse Transformer World Model Attending to What Matters
par: Lei, Anson, et autres
Publié: (2024)
par: Lei, Anson, et autres
Publié: (2024)
Causal Modeling with Stationary Diffusions
par: Lorch, Lars, et autres
Publié: (2023)
par: Lorch, Lars, et autres
Publié: (2023)
Online Learning and Unlearning
par: Hu, Yaxi, et autres
Publié: (2025)
par: Hu, Yaxi, et autres
Publié: (2025)
Targeted Reduction of Causal Models
par: Kekić, Armin, et autres
Publié: (2023)
par: Kekić, Armin, et autres
Publié: (2023)
Functional Generalized Empirical Likelihood Estimation for Conditional Moment Restrictions
par: Kremer, Heiner, et autres
Publié: (2022)
par: Kremer, Heiner, et autres
Publié: (2022)
PENEX: AdaBoost-Inspired Neural Network Regularization
par: Kladny, Klaus-Rudolf, et autres
Publié: (2025)
par: Kladny, Klaus-Rudolf, et autres
Publié: (2025)
A Probabilistic Model Behind Self-Supervised Learning
par: Bizeul, Alice, et autres
Publié: (2024)
par: Bizeul, Alice, et autres
Publié: (2024)
Causality can systematically address the monsters under the bench(marks)
par: Leeb, Felix, et autres
Publié: (2025)
par: Leeb, Felix, et autres
Publié: (2025)
Out-of-Variable Generalization for Discriminative Models
par: Guo, Siyuan, et autres
Publié: (2023)
par: Guo, Siyuan, et autres
Publié: (2023)
Computational Arbitrage in AI Model Markets
par: Olmedo, Ricardo, et autres
Publié: (2026)
par: Olmedo, Ricardo, et autres
Publié: (2026)
Compete and Compose: Learning Independent Mechanisms for Modular World Models
par: Lei, Anson, et autres
Publié: (2024)
par: Lei, Anson, et autres
Publié: (2024)
LoRA and Privacy: When Random Projections Help (and When They Don't)
par: Hu, Yaxi, et autres
Publié: (2026)
par: Hu, Yaxi, et autres
Publié: (2026)
Learning Joint Interventional Effects from Single-Variable Interventions in Additive Models
par: Kekić, Armin, et autres
Publié: (2025)
par: Kekić, Armin, et autres
Publié: (2025)
Conformal Generative Modeling with Improved Sample Efficiency through Sequential Greedy Filtering
par: Kladny, Klaus-Rudolf, et autres
Publié: (2024)
par: Kladny, Klaus-Rudolf, et autres
Publié: (2024)
Provable Privacy with Non-Private Pre-Processing
par: Hu, Yaxi, et autres
Publié: (2024)
par: Hu, Yaxi, et autres
Publié: (2024)
Gap-Dependent Bounds for Q-Learning using Reference-Advantage Decomposition
par: Zheng, Zhong, et autres
Publié: (2024)
par: Zheng, Zhong, et autres
Publié: (2024)
Adaptive Inverted-Index Routing for Granular Mixtures-of-Experts
par: Kladny, Klaus-Rudolf, et autres
Publié: (2026)
par: Kladny, Klaus-Rudolf, et autres
Publié: (2026)
Policy Optimization via Adv2: Adversarial Learning on Advantage Functions
par: Jonckheere, Matthieu, et autres
Publié: (2023)
par: Jonckheere, Matthieu, et autres
Publié: (2023)
Preference Elicitation for Offline Reinforcement Learning
par: Pace, Alizée, et autres
Publié: (2024)
par: Pace, Alizée, et autres
Publié: (2024)
Riemannian Networks over Full-Rank Correlation Matrices
par: Chen, Ziheng, et autres
Publié: (2026)
par: Chen, Ziheng, et autres
Publié: (2026)
Deriving Hyperparameter Scaling Laws via Modern Optimization Theory
par: Shulgin, Egor, et autres
Publié: (2026)
par: Shulgin, Egor, et autres
Publié: (2026)
Counterfactual reasoning: an analysis of in-context emergence
par: Miller, Moritz, et autres
Publié: (2025)
par: Miller, Moritz, et autres
Publié: (2025)
Algorithmic causal structure emerging through compression
par: Wendong, Liang, et autres
Publié: (2025)
par: Wendong, Liang, et autres
Publié: (2025)
Hyperbolic Busemann Neural Networks
par: Chen, Ziheng, et autres
Publié: (2026)
par: Chen, Ziheng, et autres
Publié: (2026)
Standardizing Structural Causal Models
par: Ormaniec, Weronika, et autres
Publié: (2024)
par: Ormaniec, Weronika, et autres
Publié: (2024)
Generative Intervention Models for Causal Perturbation Modeling
par: Schneider, Nora, et autres
Publié: (2024)
par: Schneider, Nora, et autres
Publié: (2024)
Causal de Finetti: On the Identification of Invariant Causal Structure in Exchangeable Data
par: Guo, Siyuan, et autres
Publié: (2022)
par: Guo, Siyuan, et autres
Publié: (2022)
Multi-Armed Bandits and Quantum Channel Oracles
par: Buchholz, Simon, et autres
Publié: (2023)
par: Buchholz, Simon, et autres
Publié: (2023)
Hallmarks of Optimization Trajectories in Neural Networks: Directional Exploration and Redundancy
par: Singh, Sidak Pal, et autres
Publié: (2024)
par: Singh, Sidak Pal, et autres
Publié: (2024)
Riemannian Batch Normalization: A Gyro Approach
par: Chen, Ziheng, et autres
Publié: (2025)
par: Chen, Ziheng, et autres
Publié: (2025)
On the Emergence and Test-Time Use of Structural Information in Large Language Models
par: Chen, Michelle Chao, et autres
Publié: (2026)
par: Chen, Michelle Chao, et autres
Publié: (2026)
Do Finetti: On Causal Effects for Exchangeable Data
par: Guo, Siyuan, et autres
Publié: (2024)
par: Guo, Siyuan, et autres
Publié: (2024)
Sim-to-Real Transfer for Muscle-Actuated Robots via Generalized Actuator Networks
par: Schneider, Jan, et autres
Publié: (2026)
par: Schneider, Jan, et autres
Publié: (2026)
Documents similaires
-
Intrinsically Interpretable Attention via Sparse Post-Training
par: Draye, Florent, et autres
Publié: (2025) -
Homomorphism Autoencoder -- Learning Group Structured Representations from Observed Transitions
par: Keurti, Hamza, et autres
Publié: (2022) -
Geometry-Aware Instrumental Variable Regression
par: Kremer, Heiner, et autres
Publié: (2024) -
Robustness of Nonlinear Representation Learning
par: Buchholz, Simon, et autres
Publié: (2025) -
Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning
par: Reizinger, Patrik, et autres
Publié: (2025)