Sequential Decision Making with Expert Demonstrations under Unobserved Heterogeneity
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Balazadeh, Vahid, Chidambaram, Keertana, Nguyen, Viet, Krishnan, Rahul G., Syrgkanis, Vasilis |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Direct Preference Optimization With Unobserved Preference Heterogeneity: The Necessity of Ternary Preferences
von: Chidambaram, Keertana, et al.
Veröffentlicht: (2024)
von: Chidambaram, Keertana, et al.
Veröffentlicht: (2024)
Personalized Adaptation via In-Context Preference Learning
von: Lau, Allison, et al.
Veröffentlicht: (2024)
von: Lau, Allison, et al.
Veröffentlicht: (2024)
Direct Preference Optimization with Unobserved Preference Heterogeneity: The Necessity of Ternary Preferences
von: Chidambaram, Keertana, et al.
Veröffentlicht: (2025)
von: Chidambaram, Keertana, et al.
Veröffentlicht: (2025)
Estimation of Treatment Effects in Extreme and Unobserved Data
von: Tan, Jiyuan, et al.
Veröffentlicht: (2025)
von: Tan, Jiyuan, et al.
Veröffentlicht: (2025)
Order-based Structure Learning with Normalizing Flows
von: Kamkari, Hamidreza, et al.
Veröffentlicht: (2023)
von: Kamkari, Hamidreza, et al.
Veröffentlicht: (2023)
Frequentist Consistency of Prior-Data Fitted Networks for Causal Inference
von: Melnychuk, Valentyn, et al.
Veröffentlicht: (2026)
von: Melnychuk, Valentyn, et al.
Veröffentlicht: (2026)
IV-ICL: Bounding Causal Effects with Instrumental Variables via In-Context Learning
von: Balazadeh, Vahid, et al.
Veröffentlicht: (2026)
von: Balazadeh, Vahid, et al.
Veröffentlicht: (2026)
The Partial Testimony of Logs: Evaluation of Language Model Generation under Confounded Model Choice
von: Jin, Jikai, et al.
Veröffentlicht: (2026)
von: Jin, Jikai, et al.
Veröffentlicht: (2026)
Causal Foundation Models with Continuous Treatments
von: Stith, Christopher, et al.
Veröffentlicht: (2026)
von: Stith, Christopher, et al.
Veröffentlicht: (2026)
SurvivalPFN: Amortizing Survival Prediction via In-Context Bayesian Inference
von: Qi, Shi-ang, et al.
Veröffentlicht: (2026)
von: Qi, Shi-ang, et al.
Veröffentlicht: (2026)
Adaptive Estimation and Inference in Conditional Moment Models via the Discrepancy Principle
von: Tan, Jiyuan, et al.
Veröffentlicht: (2026)
von: Tan, Jiyuan, et al.
Veröffentlicht: (2026)
A Meta-learner for Heterogeneous Effects in Difference-in-Differences
von: Lan, Hui, et al.
Veröffentlicht: (2025)
von: Lan, Hui, et al.
Veröffentlicht: (2025)
Post Reinforcement Learning Inference
von: Syrgkanis, Vasilis, et al.
Veröffentlicht: (2023)
von: Syrgkanis, Vasilis, et al.
Veröffentlicht: (2023)
Adversarial Estimation of Riesz Representers
von: Chernozhukov, Victor, et al.
Veröffentlicht: (2020)
von: Chernozhukov, Victor, et al.
Veröffentlicht: (2020)
Empirical Analysis of Model Selection for Heterogeneous Causal Effect Estimation
von: Mahajan, Divyat, et al.
Veröffentlicht: (2022)
von: Mahajan, Divyat, et al.
Veröffentlicht: (2022)
Structure-agnostic Optimality of Doubly Robust Learning for Treatment Effect Estimation
von: Jin, Jikai, et al.
Veröffentlicht: (2024)
von: Jin, Jikai, et al.
Veröffentlicht: (2024)
Learning Causal Representations from General Environments: Identifiability and Intrinsic Ambiguity
von: Jin, Jikai, et al.
Veröffentlicht: (2023)
von: Jin, Jikai, et al.
Veröffentlicht: (2023)
Sharp Structure-Agnostic Lower Bounds for General Linear Functional Estimation
von: Jin, Jikai, et al.
Veröffentlicht: (2025)
von: Jin, Jikai, et al.
Veröffentlicht: (2025)
CausalPFN: Amortized Causal Effect Estimation via In-Context Learning
von: Balazadeh, Vahid, et al.
Veröffentlicht: (2025)
von: Balazadeh, Vahid, et al.
Veröffentlicht: (2025)
Dynamic Local Average Treatment Effects
von: Sojitra, Ravi B., et al.
Veröffentlicht: (2024)
von: Sojitra, Ravi B., et al.
Veröffentlicht: (2024)
Predicting Long Term Sequential Policy Value Using Softer Surrogates
von: Nam, Hyunji, et al.
Veröffentlicht: (2024)
von: Nam, Hyunji, et al.
Veröffentlicht: (2024)
Order-Explicit Linearization of High-Dimensional $U$-Statistics
von: Ritzwoller, David M., et al.
Veröffentlicht: (2024)
von: Ritzwoller, David M., et al.
Veröffentlicht: (2024)
Detecting clinician implicit biases in diagnoses using proximal causal inference
von: Liu, Kara, et al.
Veröffentlicht: (2025)
von: Liu, Kara, et al.
Veröffentlicht: (2025)
Learning Treatment Representations for Downstream Instrumental Variable Regression
von: Lin, Shiangyi, et al.
Veröffentlicht: (2025)
von: Lin, Shiangyi, et al.
Veröffentlicht: (2025)
Consistency of Neural Causal Partial Identification
von: Tan, Jiyuan, et al.
Veröffentlicht: (2024)
von: Tan, Jiyuan, et al.
Veröffentlicht: (2024)
Statistical Inference and Learning for Shapley Additive Explanations (SHAP)
von: Whitehouse, Justin, et al.
Veröffentlicht: (2026)
von: Whitehouse, Justin, et al.
Veröffentlicht: (2026)
Mitigating Privacy Risk via Forget Set-Free Unlearning
von: Newatia, Aviraj, et al.
Veröffentlicht: (2026)
von: Newatia, Aviraj, et al.
Veröffentlicht: (2026)
Causal Q-Aggregation for CATE Model Selection
von: Lan, Hui, et al.
Veröffentlicht: (2023)
von: Lan, Hui, et al.
Veröffentlicht: (2023)
Robust Post-Training for Generative Recommenders: Why Exponential Reward-Weighted SFT Outperforms RLHF
von: Chidambaram, Keertana, et al.
Veröffentlicht: (2026)
von: Chidambaram, Keertana, et al.
Veröffentlicht: (2026)
Causal Imitation Learning under Expert-Observable and Expert-Unobservable Confounding
von: Shao, Daqian, et al.
Veröffentlicht: (2025)
von: Shao, Daqian, et al.
Veröffentlicht: (2025)
Reinforced Language Models for Sequential Decision Making
von: Dilkes, Jim, et al.
Veröffentlicht: (2025)
von: Dilkes, Jim, et al.
Veröffentlicht: (2025)
Preference Learning with Response Time: Robust Losses and Guarantees
von: Sawarni, Ayush, et al.
Veröffentlicht: (2025)
von: Sawarni, Ayush, et al.
Veröffentlicht: (2025)
It's Hard to Be Normal: The Impact of Noise on Structure-agnostic Estimation
von: Jin, Jikai, et al.
Veröffentlicht: (2025)
von: Jin, Jikai, et al.
Veröffentlicht: (2025)
Taking a Moment for Distributional Robustness
von: Hastings, Jabari, et al.
Veröffentlicht: (2024)
von: Hastings, Jabari, et al.
Veröffentlicht: (2024)
Policy Learning with Abstention
von: Sawarni, Ayush, et al.
Veröffentlicht: (2025)
von: Sawarni, Ayush, et al.
Veröffentlicht: (2025)
Towards efficient representation identification in supervised learning
von: Ahuja, Kartik, et al.
Veröffentlicht: (2022)
von: Ahuja, Kartik, et al.
Veröffentlicht: (2022)
Robust Fitted-Q-Evaluation and Iteration under Sequentially Exogenous Unobserved Confounders
von: Bruns-Smith, David, et al.
Veröffentlicht: (2023)
von: Bruns-Smith, David, et al.
Veröffentlicht: (2023)
Federated Learning for Heterogeneous Bandits with Unobserved Contexts
von: Lin, Jiabin, et al.
Veröffentlicht: (2023)
von: Lin, Jiabin, et al.
Veröffentlicht: (2023)
Automatic Doubly Robust Forests
von: Chen, Zhaomeng, et al.
Veröffentlicht: (2024)
von: Chen, Zhaomeng, et al.
Veröffentlicht: (2024)
Prescriptive Scaling Reveals the Evolution of Language Model Capabilities
von: Zhang, Hanlin, et al.
Veröffentlicht: (2026)
von: Zhang, Hanlin, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Direct Preference Optimization With Unobserved Preference Heterogeneity: The Necessity of Ternary Preferences
von: Chidambaram, Keertana, et al.
Veröffentlicht: (2024) -
Personalized Adaptation via In-Context Preference Learning
von: Lau, Allison, et al.
Veröffentlicht: (2024) -
Direct Preference Optimization with Unobserved Preference Heterogeneity: The Necessity of Ternary Preferences
von: Chidambaram, Keertana, et al.
Veröffentlicht: (2025) -
Estimation of Treatment Effects in Extreme and Unobserved Data
von: Tan, Jiyuan, et al.
Veröffentlicht: (2025) -
Order-based Structure Learning with Normalizing Flows
von: Kamkari, Hamidreza, et al.
Veröffentlicht: (2023)