CANDOR: Counterfactual ANnotated DOubly Robust Off-Policy Evaluation
Fuente:
arXiv
Salvato in:
| Autori principali: | Mandyam, Aishwarya, Tang, Shengpu, Yao, Jiayu, Wiens, Jenna, Engelhardt, Barbara E. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Compositional Q-learning for electrolyte repletion with imbalanced patient sub-populations
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2021)
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2021)
APRIL: Annotations for Policy evaluation with Reliable Inference from LLMs
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2025)
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2025)
Kernel Density Bayesian Inverse Reinforcement Learning
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2023)
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2023)
PERRY: Policy Evaluation with Confidence Intervals using Auxiliary Data
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2025)
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2025)
Adaptive Interventions with User-Defined Goals for Health Behavior Change
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2023)
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2023)
From Biased Selective Labels to Pseudo-Labels: An Expectation-Maximization Framework for Learning from Biased Decisions
di: Chang, Trenton, et al.
Pubblicazione: (2024)
di: Chang, Trenton, et al.
Pubblicazione: (2024)
Inverse Reinforcement Learning with Multiple Planning Horizons
di: Yao, Jiayu, et al.
Pubblicazione: (2024)
di: Yao, Jiayu, et al.
Pubblicazione: (2024)
Random Search Neural Networks for Efficient and Expressive Graph Learning
di: Ito, Michael, et al.
Pubblicazione: (2025)
di: Ito, Michael, et al.
Pubblicazione: (2025)
Conditional Front-door Adjustment for Heterogeneous Treatment Assignment Effect Estimation Under Non-adherence
di: Chen, Winston, et al.
Pubblicazione: (2025)
di: Chen, Winston, et al.
Pubblicazione: (2025)
Understanding GNNs and Homophily in Dynamic Node Classification
di: Ito, Michael, et al.
Pubblicazione: (2025)
di: Ito, Michael, et al.
Pubblicazione: (2025)
A Course Correction in Steerability Evaluation: Revealing Miscalibration and Side Effects in LLMs
di: Chang, Trenton, et al.
Pubblicazione: (2025)
di: Chang, Trenton, et al.
Pubblicazione: (2025)
Exploring Time-Step Size in Reinforcement Learning for Sepsis Treatment
di: Sun, Yingchuan, et al.
Pubblicazione: (2025)
di: Sun, Yingchuan, et al.
Pubblicazione: (2025)
Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments
di: Guha, Ritam, et al.
Pubblicazione: (2025)
di: Guha, Ritam, et al.
Pubblicazione: (2025)
Doubly-Robust Off-Policy Evaluation with Estimated Logging Policy
di: Lee, Kyungbok, et al.
Pubblicazione: (2024)
di: Lee, Kyungbok, et al.
Pubblicazione: (2024)
Fast Graph Generation via Autoregressive Noisy Filtration Modeling
di: Krimmel, Markus, et al.
Pubblicazione: (2025)
di: Krimmel, Markus, et al.
Pubblicazione: (2025)
An Adaptive Machine Learning Triage Framework for Predicting Alzheimer's Disease Progression
di: Hou, Richard, et al.
Pubblicazione: (2025)
di: Hou, Richard, et al.
Pubblicazione: (2025)
Measuring Model Performance in the Presence of an Intervention
di: Chen, Winston, et al.
Pubblicazione: (2025)
di: Chen, Winston, et al.
Pubblicazione: (2025)
Assessing the Distributional Fidelity of Synthetic Chest X-rays using the Embedded Characteristic Score
di: Tam, Edric, et al.
Pubblicazione: (2025)
di: Tam, Edric, et al.
Pubblicazione: (2025)
Learning Laplacian Positional Encodings for Heterophilous Graphs
di: Ito, Michael, et al.
Pubblicazione: (2025)
di: Ito, Michael, et al.
Pubblicazione: (2025)
Robustness of Refugee-Matching Gains to Off-Policy Evaluation Choices
di: Bansak, Kirk, et al.
Pubblicazione: (2026)
di: Bansak, Kirk, et al.
Pubblicazione: (2026)
Doubly-Robust Estimation of Counterfactual Policy Mean Embeddings
di: Zenati, Houssam, et al.
Pubblicazione: (2025)
di: Zenati, Houssam, et al.
Pubblicazione: (2025)
Cross-Validated Off-Policy Evaluation
di: Cief, Matej, et al.
Pubblicazione: (2024)
di: Cief, Matej, et al.
Pubblicazione: (2024)
Efficient and Sharp Off-Policy Evaluation in Robust Markov Decision Processes
di: Bennett, Andrew, et al.
Pubblicazione: (2024)
di: Bennett, Andrew, et al.
Pubblicazione: (2024)
Hierarchical Deep Counterfactual Regret Minimization
di: Chen, Jiayu, et al.
Pubblicazione: (2023)
di: Chen, Jiayu, et al.
Pubblicazione: (2023)
Generalizability vs. Counterfactual Explainability Trade-Off
di: Veglianti, Fabiano, et al.
Pubblicazione: (2025)
di: Veglianti, Fabiano, et al.
Pubblicazione: (2025)
Off-Policy Evaluation for Ranking Policies under Deterministic Logging Policies
di: Tanaka, Koichi, et al.
Pubblicazione: (2026)
di: Tanaka, Koichi, et al.
Pubblicazione: (2026)
Long-term Off-Policy Evaluation and Learning
di: Saito, Yuta, et al.
Pubblicazione: (2024)
di: Saito, Yuta, et al.
Pubblicazione: (2024)
Off-Policy Evaluation of Slate Bandit Policies via Optimizing Abstraction
di: Kiyohara, Haruka, et al.
Pubblicazione: (2024)
di: Kiyohara, Haruka, et al.
Pubblicazione: (2024)
Concept-driven Off Policy Evaluation
di: Majumdar, Ritam, et al.
Pubblicazione: (2024)
di: Majumdar, Ritam, et al.
Pubblicazione: (2024)
Clustering Context in Off-Policy Evaluation
di: Guzman-Olivares, Daniel, et al.
Pubblicazione: (2025)
di: Guzman-Olivares, Daniel, et al.
Pubblicazione: (2025)
Off-Policy Evaluation from Logged Human Feedback
di: Bhargava, Aniruddha, et al.
Pubblicazione: (2024)
di: Bhargava, Aniruddha, et al.
Pubblicazione: (2024)
Off-Policy Evaluation for Recommendations with Missing-Not-At-Random Rewards
di: Takahashi, Tatsuki, et al.
Pubblicazione: (2025)
di: Takahashi, Tatsuki, et al.
Pubblicazione: (2025)
Off-Policy Evaluation Under Nonignorable Missing Data
di: Wang, Han, et al.
Pubblicazione: (2025)
di: Wang, Han, et al.
Pubblicazione: (2025)
POTEC: Off-Policy Learning for Large Action Spaces via Two-Stage Policy Decomposition
di: Saito, Yuta, et al.
Pubblicazione: (2024)
di: Saito, Yuta, et al.
Pubblicazione: (2024)
Off-Policy Evaluation and Learning for Matching Markets
di: Hayashi, Yudai, et al.
Pubblicazione: (2025)
di: Hayashi, Yudai, et al.
Pubblicazione: (2025)
Learning Action Embeddings for Off-Policy Evaluation
di: Cief, Matej, et al.
Pubblicazione: (2023)
di: Cief, Matej, et al.
Pubblicazione: (2023)
Machine Learning Research Has Outpaced Its Communication Norms and NeurIPS Should Act
di: Rangarajan, Ajay Mandyam, et al.
Pubblicazione: (2026)
di: Rangarajan, Ajay Mandyam, et al.
Pubblicazione: (2026)
Logarithmic Smoothing for Pessimistic Off-Policy Evaluation, Selection and Learning
di: Sakhi, Otmane, et al.
Pubblicazione: (2024)
di: Sakhi, Otmane, et al.
Pubblicazione: (2024)
Off-Policy Actor-Critic for Adversarial Observation Robustness: Virtual Alternative Training via Symmetric Policy Evaluation
di: Nakanishi, Kosuke, et al.
Pubblicazione: (2025)
di: Nakanishi, Kosuke, et al.
Pubblicazione: (2025)
Log-Sum-Exponential Estimator for Off-Policy Evaluation and Learning
di: Behnamnia, Armin, et al.
Pubblicazione: (2025)
di: Behnamnia, Armin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Compositional Q-learning for electrolyte repletion with imbalanced patient sub-populations
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2021) -
APRIL: Annotations for Policy evaluation with Reliable Inference from LLMs
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2025) -
Kernel Density Bayesian Inverse Reinforcement Learning
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2023) -
PERRY: Policy Evaluation with Confidence Intervals using Auxiliary Data
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2025) -
Adaptive Interventions with User-Defined Goals for Health Behavior Change
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2023)