Causal Imitation Learning under Expert-Observable and Expert-Unobservable Confounding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shao, Daqian, Buening, Thomas Kleine, Kwiatkowska, Marta |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Environment Design for Inverse Reinforcement Learning
par: Buening, Thomas Kleine, et autres
Publié: (2022)
par: Buening, Thomas Kleine, et autres
Publié: (2022)
Strategyproof Reinforcement Learning from Human Feedback
par: Buening, Thomas Kleine, et autres
Publié: (2025)
par: Buening, Thomas Kleine, et autres
Publié: (2025)
Confounded Causal Imitation Learning with Instrumental Variables
par: Zeng, Yan, et autres
Publié: (2025)
par: Zeng, Yan, et autres
Publié: (2025)
Causal Fairness under Unobserved Confounding: A Neural Sensitivity Framework
par: Schröder, Maresa, et autres
Publié: (2023)
par: Schröder, Maresa, et autres
Publié: (2023)
Stackelberg Learning from Human Feedback: Preference Optimization as a Sequential Game
par: Pásztor, Barna, et autres
Publié: (2025)
par: Pásztor, Barna, et autres
Publié: (2025)
Learning Optimal and Sample-Efficient Decision Policies with Guarantees
par: Shao, Daqian
Publié: (2026)
par: Shao, Daqian
Publié: (2026)
MAVRL: Learning Reward Functions from Multiple Feedback Types with Amortized Variational Inference
par: Baur, Raphaël, et autres
Publié: (2026)
par: Baur, Raphaël, et autres
Publié: (2026)
Double Machine Learning for Conditional Moment Restrictions: IV Regression, Proximal Causal Learning and Beyond
par: Shao, Daqian, et autres
Publié: (2025)
par: Shao, Daqian, et autres
Publié: (2025)
IDIL: Imitation Learning of Intent-Driven Expert Behavior
par: Seo, Sangwon, et autres
Publié: (2024)
par: Seo, Sangwon, et autres
Publié: (2024)
Peer Effect Estimation in the Presence of Simultaneous Feedback and Unobserved Confounders
par: Du, Xiaojing, et autres
Publié: (2025)
par: Du, Xiaojing, et autres
Publié: (2025)
Learning to Defer for Causal Discovery with Imperfect Experts
par: Clivio, Oscar, et autres
Publié: (2025)
par: Clivio, Oscar, et autres
Publié: (2025)
Aligning Language Models from User Interactions
par: Buening, Thomas Kleine, et autres
Publié: (2026)
par: Buening, Thomas Kleine, et autres
Publié: (2026)
Controlling for Unobserved Confounding with Large Language Model Classification of Patient Smoking Status
par: Lee, Samuel, et autres
Publié: (2024)
par: Lee, Samuel, et autres
Publié: (2024)
SENSOR: Imitate Third-Person Expert's Behaviors via Active Sensoring
par: Huang, Kaichen, et autres
Publié: (2024)
par: Huang, Kaichen, et autres
Publié: (2024)
Dynamic Expert-Guided Model Averaging for Causal Discovery
par: Tench, Adrick, et autres
Publié: (2026)
par: Tench, Adrick, et autres
Publié: (2026)
Reinforcement Learning via Self-Distillation
par: Hübotter, Jonas, et autres
Publié: (2026)
par: Hübotter, Jonas, et autres
Publié: (2026)
Beyond-Expert Performance with Limited Demonstrations: Efficient Imitation Learning with Double Exploration
par: Zhao, Heyang, et autres
Publié: (2025)
par: Zhao, Heyang, et autres
Publié: (2025)
Imitation Learning for Multi-turn LM Agents via On-policy Expert Corrections
par: Lauffer, Niklas, et autres
Publié: (2025)
par: Lauffer, Niklas, et autres
Publié: (2025)
Coupled Distributional Random Expert Distillation for World Model Online Imitation Learning
par: Li, Shangzhe, et autres
Publié: (2025)
par: Li, Shangzhe, et autres
Publié: (2025)
Learning What to Do and What Not To Do: Offline Imitation from Expert and Undesirable Demonstrations
par: Hoang, Huy, et autres
Publié: (2025)
par: Hoang, Huy, et autres
Publié: (2025)
STR-Cert: Robustness Certification for Deep Text Recognition on Deep Learning Pipelines and Vision Transformers
par: Shao, Daqian, et autres
Publié: (2023)
par: Shao, Daqian, et autres
Publié: (2023)
Using Non-Expert Data to Robustify Imitation Learning via Offline Reinforcement Learning
par: Huang, Kevin, et autres
Publié: (2025)
par: Huang, Kevin, et autres
Publié: (2025)
Learning Decision Policies with Instrumental Variables through Double Machine Learning
par: Shao, Daqian, et autres
Publié: (2024)
par: Shao, Daqian, et autres
Publié: (2024)
Information-Theoretic Causal Bounds under Unmeasured Confounding
par: Jung, Yonghan, et autres
Publié: (2026)
par: Jung, Yonghan, et autres
Publié: (2026)
CARE: Turning LLMs Into Causal Reasoning Expert
par: Dong, Juncheng, et autres
Publié: (2025)
par: Dong, Juncheng, et autres
Publié: (2025)
Sample-Efficient Expert Query Control in Active Imitation Learning via Conformal Prediction
par: Firouzkouhi, Arad, et autres
Publié: (2025)
par: Firouzkouhi, Arad, et autres
Publié: (2025)
Unveiling the Role of Expert Guidance: A Comparative Analysis of User-centered Imitation Learning and Traditional Reinforcement Learning
par: Gomaa, Amr, et autres
Publié: (2024)
par: Gomaa, Amr, et autres
Publié: (2024)
Federated Causal Discovery Across Heterogeneous Datasets under Latent Confounding
par: Hahn, Maximilian, et autres
Publié: (2026)
par: Hahn, Maximilian, et autres
Publié: (2026)
EAC-MoE: Expert-Selection Aware Compressor for Mixture-of-Experts Large Language Models
par: Chen, Yuanteng, et autres
Publié: (2025)
par: Chen, Yuanteng, et autres
Publié: (2025)
Learning Soft Driving Constraints from Vectorized Scene Embeddings while Imitating Expert Trajectories
par: Mobarakeh, Niloufar Saeidi, et autres
Publié: (2024)
par: Mobarakeh, Niloufar Saeidi, et autres
Publié: (2024)
Causal Discovery in Linear Models with Unobserved Variables and Measurement Error
par: Yang, Yuqin, et autres
Publié: (2024)
par: Yang, Yuqin, et autres
Publié: (2024)
Relational Causal Discovery with Latent Confounders
par: Negro, Matteo, et autres
Publié: (2025)
par: Negro, Matteo, et autres
Publié: (2025)
Meaningful Causal Aggregation and Paradoxical Confounding
par: Zhu, Yuchen, et autres
Publié: (2023)
par: Zhu, Yuchen, et autres
Publié: (2023)
Pessimistic Causal Reinforcement Learning with Mediators for Confounded Offline Data
par: Wang, Danyang, et autres
Publié: (2024)
par: Wang, Danyang, et autres
Publié: (2024)
MIBP-Cert: Certified Training against Data Perturbations with Mixed-Integer Bilinear Programs
par: Lorenz, Tobias, et autres
Publié: (2024)
par: Lorenz, Tobias, et autres
Publié: (2024)
Conformalized Interactive Imitation Learning: Handling Expert Shift and Intermittent Feedback
par: Zhao, Michelle, et autres
Publié: (2024)
par: Zhao, Michelle, et autres
Publié: (2024)
$ρ$-GNF: A Copula-based Sensitivity Analysis to Unobserved Confounding Using Normalizing Flows
par: Balgi, Sourabh, et autres
Publié: (2022)
par: Balgi, Sourabh, et autres
Publié: (2022)
Can LLMs Assist Expert Elicitation for Probabilistic Causal Modeling?
par: Shaposhnyk, Olha, et autres
Publié: (2025)
par: Shaposhnyk, Olha, et autres
Publié: (2025)
Aggregation Alignment for Federated Learning with Mixture-of-Experts under Data Heterogeneity
par: Fang, Zihan, et autres
Publié: (2026)
par: Fang, Zihan, et autres
Publié: (2026)
A Minimax Approach to Ad Hoc Teamwork
par: Villin, Victor, et autres
Publié: (2025)
par: Villin, Victor, et autres
Publié: (2025)
Documents similaires
-
Environment Design for Inverse Reinforcement Learning
par: Buening, Thomas Kleine, et autres
Publié: (2022) -
Strategyproof Reinforcement Learning from Human Feedback
par: Buening, Thomas Kleine, et autres
Publié: (2025) -
Confounded Causal Imitation Learning with Instrumental Variables
par: Zeng, Yan, et autres
Publié: (2025) -
Causal Fairness under Unobserved Confounding: A Neural Sensitivity Framework
par: Schröder, Maresa, et autres
Publié: (2023) -
Stackelberg Learning from Human Feedback: Preference Optimization as a Sequential Game
par: Pásztor, Barna, et autres
Publié: (2025)