Sequential Decision Making with Expert Demonstrations under Unobserved Heterogeneity
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Balazadeh, Vahid, Chidambaram, Keertana, Nguyen, Viet, Krishnan, Rahul G., Syrgkanis, Vasilis |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Direct Preference Optimization With Unobserved Preference Heterogeneity: The Necessity of Ternary Preferences
par: Chidambaram, Keertana, et autres
Publié: (2024)
par: Chidambaram, Keertana, et autres
Publié: (2024)
Personalized Adaptation via In-Context Preference Learning
par: Lau, Allison, et autres
Publié: (2024)
par: Lau, Allison, et autres
Publié: (2024)
Direct Preference Optimization with Unobserved Preference Heterogeneity: The Necessity of Ternary Preferences
par: Chidambaram, Keertana, et autres
Publié: (2025)
par: Chidambaram, Keertana, et autres
Publié: (2025)
Estimation of Treatment Effects in Extreme and Unobserved Data
par: Tan, Jiyuan, et autres
Publié: (2025)
par: Tan, Jiyuan, et autres
Publié: (2025)
Order-based Structure Learning with Normalizing Flows
par: Kamkari, Hamidreza, et autres
Publié: (2023)
par: Kamkari, Hamidreza, et autres
Publié: (2023)
Frequentist Consistency of Prior-Data Fitted Networks for Causal Inference
par: Melnychuk, Valentyn, et autres
Publié: (2026)
par: Melnychuk, Valentyn, et autres
Publié: (2026)
IV-ICL: Bounding Causal Effects with Instrumental Variables via In-Context Learning
par: Balazadeh, Vahid, et autres
Publié: (2026)
par: Balazadeh, Vahid, et autres
Publié: (2026)
The Partial Testimony of Logs: Evaluation of Language Model Generation under Confounded Model Choice
par: Jin, Jikai, et autres
Publié: (2026)
par: Jin, Jikai, et autres
Publié: (2026)
Causal Foundation Models with Continuous Treatments
par: Stith, Christopher, et autres
Publié: (2026)
par: Stith, Christopher, et autres
Publié: (2026)
SurvivalPFN: Amortizing Survival Prediction via In-Context Bayesian Inference
par: Qi, Shi-ang, et autres
Publié: (2026)
par: Qi, Shi-ang, et autres
Publié: (2026)
Adaptive Estimation and Inference in Conditional Moment Models via the Discrepancy Principle
par: Tan, Jiyuan, et autres
Publié: (2026)
par: Tan, Jiyuan, et autres
Publié: (2026)
A Meta-learner for Heterogeneous Effects in Difference-in-Differences
par: Lan, Hui, et autres
Publié: (2025)
par: Lan, Hui, et autres
Publié: (2025)
Post Reinforcement Learning Inference
par: Syrgkanis, Vasilis, et autres
Publié: (2023)
par: Syrgkanis, Vasilis, et autres
Publié: (2023)
Adversarial Estimation of Riesz Representers
par: Chernozhukov, Victor, et autres
Publié: (2020)
par: Chernozhukov, Victor, et autres
Publié: (2020)
Empirical Analysis of Model Selection for Heterogeneous Causal Effect Estimation
par: Mahajan, Divyat, et autres
Publié: (2022)
par: Mahajan, Divyat, et autres
Publié: (2022)
Structure-agnostic Optimality of Doubly Robust Learning for Treatment Effect Estimation
par: Jin, Jikai, et autres
Publié: (2024)
par: Jin, Jikai, et autres
Publié: (2024)
Learning Causal Representations from General Environments: Identifiability and Intrinsic Ambiguity
par: Jin, Jikai, et autres
Publié: (2023)
par: Jin, Jikai, et autres
Publié: (2023)
Sharp Structure-Agnostic Lower Bounds for General Linear Functional Estimation
par: Jin, Jikai, et autres
Publié: (2025)
par: Jin, Jikai, et autres
Publié: (2025)
CausalPFN: Amortized Causal Effect Estimation via In-Context Learning
par: Balazadeh, Vahid, et autres
Publié: (2025)
par: Balazadeh, Vahid, et autres
Publié: (2025)
Dynamic Local Average Treatment Effects
par: Sojitra, Ravi B., et autres
Publié: (2024)
par: Sojitra, Ravi B., et autres
Publié: (2024)
Predicting Long Term Sequential Policy Value Using Softer Surrogates
par: Nam, Hyunji, et autres
Publié: (2024)
par: Nam, Hyunji, et autres
Publié: (2024)
Order-Explicit Linearization of High-Dimensional $U$-Statistics
par: Ritzwoller, David M., et autres
Publié: (2024)
par: Ritzwoller, David M., et autres
Publié: (2024)
Detecting clinician implicit biases in diagnoses using proximal causal inference
par: Liu, Kara, et autres
Publié: (2025)
par: Liu, Kara, et autres
Publié: (2025)
Learning Treatment Representations for Downstream Instrumental Variable Regression
par: Lin, Shiangyi, et autres
Publié: (2025)
par: Lin, Shiangyi, et autres
Publié: (2025)
Consistency of Neural Causal Partial Identification
par: Tan, Jiyuan, et autres
Publié: (2024)
par: Tan, Jiyuan, et autres
Publié: (2024)
Statistical Inference and Learning for Shapley Additive Explanations (SHAP)
par: Whitehouse, Justin, et autres
Publié: (2026)
par: Whitehouse, Justin, et autres
Publié: (2026)
Mitigating Privacy Risk via Forget Set-Free Unlearning
par: Newatia, Aviraj, et autres
Publié: (2026)
par: Newatia, Aviraj, et autres
Publié: (2026)
Causal Q-Aggregation for CATE Model Selection
par: Lan, Hui, et autres
Publié: (2023)
par: Lan, Hui, et autres
Publié: (2023)
Robust Post-Training for Generative Recommenders: Why Exponential Reward-Weighted SFT Outperforms RLHF
par: Chidambaram, Keertana, et autres
Publié: (2026)
par: Chidambaram, Keertana, et autres
Publié: (2026)
Causal Imitation Learning under Expert-Observable and Expert-Unobservable Confounding
par: Shao, Daqian, et autres
Publié: (2025)
par: Shao, Daqian, et autres
Publié: (2025)
Reinforced Language Models for Sequential Decision Making
par: Dilkes, Jim, et autres
Publié: (2025)
par: Dilkes, Jim, et autres
Publié: (2025)
Preference Learning with Response Time: Robust Losses and Guarantees
par: Sawarni, Ayush, et autres
Publié: (2025)
par: Sawarni, Ayush, et autres
Publié: (2025)
It's Hard to Be Normal: The Impact of Noise on Structure-agnostic Estimation
par: Jin, Jikai, et autres
Publié: (2025)
par: Jin, Jikai, et autres
Publié: (2025)
Taking a Moment for Distributional Robustness
par: Hastings, Jabari, et autres
Publié: (2024)
par: Hastings, Jabari, et autres
Publié: (2024)
Policy Learning with Abstention
par: Sawarni, Ayush, et autres
Publié: (2025)
par: Sawarni, Ayush, et autres
Publié: (2025)
Towards efficient representation identification in supervised learning
par: Ahuja, Kartik, et autres
Publié: (2022)
par: Ahuja, Kartik, et autres
Publié: (2022)
Robust Fitted-Q-Evaluation and Iteration under Sequentially Exogenous Unobserved Confounders
par: Bruns-Smith, David, et autres
Publié: (2023)
par: Bruns-Smith, David, et autres
Publié: (2023)
Federated Learning for Heterogeneous Bandits with Unobserved Contexts
par: Lin, Jiabin, et autres
Publié: (2023)
par: Lin, Jiabin, et autres
Publié: (2023)
Automatic Doubly Robust Forests
par: Chen, Zhaomeng, et autres
Publié: (2024)
par: Chen, Zhaomeng, et autres
Publié: (2024)
Prescriptive Scaling Reveals the Evolution of Language Model Capabilities
par: Zhang, Hanlin, et autres
Publié: (2026)
par: Zhang, Hanlin, et autres
Publié: (2026)
Documents similaires
-
Direct Preference Optimization With Unobserved Preference Heterogeneity: The Necessity of Ternary Preferences
par: Chidambaram, Keertana, et autres
Publié: (2024) -
Personalized Adaptation via In-Context Preference Learning
par: Lau, Allison, et autres
Publié: (2024) -
Direct Preference Optimization with Unobserved Preference Heterogeneity: The Necessity of Ternary Preferences
par: Chidambaram, Keertana, et autres
Publié: (2025) -
Estimation of Treatment Effects in Extreme and Unobserved Data
par: Tan, Jiyuan, et autres
Publié: (2025) -
Order-based Structure Learning with Normalizing Flows
par: Kamkari, Hamidreza, et autres
Publié: (2023)