Meta Off-Policy Estimation
Fuente:
arXiv
Saved in:
| Main Author: | Jeunen, Olivier |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Unifying On- and Off-Policy Variance Reduction Methods
by: Jeunen, Olivier
Published: (2026)
by: Jeunen, Olivier
Published: (2026)
Counterfactual Inference under Thompson Sampling
by: Jeunen, Olivier
Published: (2025)
by: Jeunen, Olivier
Published: (2025)
$Δ\text{-}{\rm OPE}$: Off-Policy Estimation with Pairs of Policies
by: Jeunen, Olivier, et al.
Published: (2024)
by: Jeunen, Olivier, et al.
Published: (2024)
Additive Control Variates Dominate Self-Normalisation in Off-Policy Evaluation
by: Jeunen, Olivier, et al.
Published: (2026)
by: Jeunen, Olivier, et al.
Published: (2026)
On (Normalised) Discounted Cumulative Gain as an Off-Policy Evaluation Metric for Top-$n$ Recommendation
by: Jeunen, Olivier, et al.
Published: (2023)
by: Jeunen, Olivier, et al.
Published: (2023)
Optimal Baseline Corrections for Off-Policy Contextual Bandits
by: Gupta, Shashank, et al.
Published: (2024)
by: Gupta, Shashank, et al.
Published: (2024)
A Simple Model to Estimate Sharing Effects in Social Networks
by: Jeunen, Olivier
Published: (2024)
by: Jeunen, Olivier
Published: (2024)
Learning Metrics that Maximise Power for Accelerated A/B-Tests
by: Jeunen, Olivier, et al.
Published: (2024)
by: Jeunen, Olivier, et al.
Published: (2024)
Behavioural Effects of Agentic Messaging: A Case Study on a Financial Service Application
by: Jeunen, Olivier, et al.
Published: (2025)
by: Jeunen, Olivier, et al.
Published: (2025)
Multi-Objective Recommendation via Multivariate Policy Learning
by: Jeunen, Olivier, et al.
Published: (2024)
by: Jeunen, Olivier, et al.
Published: (2024)
Variance Reduction in Ratio Metrics for Efficient Online Experiments
by: Baweja, Shubham, et al.
Published: (2024)
by: Baweja, Shubham, et al.
Published: (2024)
Two-stage Risk Control with Application to Ranked Retrieval
by: Xu, Yunpeng, et al.
Published: (2024)
by: Xu, Yunpeng, et al.
Published: (2024)
$t$-Testing the Waters: Empirically Validating Assumptions for Reliable A/B-Testing
by: Jeunen, Olivier
Published: (2025)
by: Jeunen, Olivier
Published: (2025)
Errors in AI-Assisted Retrieval of Medical Literature: A Comparative Study
by: Gao, Jenny, et al.
Published: (2026)
by: Gao, Jenny, et al.
Published: (2026)
dsld: A Socially Relevant Tool for Teaching Statistics
by: Mittal, Aditya, et al.
Published: (2024)
by: Mittal, Aditya, et al.
Published: (2024)
Agentic Personalisation of Cross-Channel Marketing Experiences
by: Abboud, Sami, et al.
Published: (2025)
by: Abboud, Sami, et al.
Published: (2025)
Off-Policy Evaluation and Learning for Matching Markets
by: Hayashi, Yudai, et al.
Published: (2025)
by: Hayashi, Yudai, et al.
Published: (2025)
LiDDA: Data Driven Attribution at LinkedIn
by: Bencina, John, et al.
Published: (2025)
by: Bencina, John, et al.
Published: (2025)
GACE: Learning Graph-Based Cross-Page Ads Embedding For Click-Through Rate Prediction
by: Wang, Haowen, et al.
Published: (2024)
by: Wang, Haowen, et al.
Published: (2024)
Separating and Learning Latent Confounders to Enhancing User Preferences Modeling
by: Xu, Hangtong, et al.
Published: (2023)
by: Xu, Hangtong, et al.
Published: (2023)
Causal Structure Representation Learning of Confounders in Latent Space for Recommendation
by: Xu, Hangtong, et al.
Published: (2023)
by: Xu, Hangtong, et al.
Published: (2023)
Isometry pursuit
by: Koelle, Samson, et al.
Published: (2024)
by: Koelle, Samson, et al.
Published: (2024)
IntOPE: Off-Policy Evaluation in the Presence of Interference
by: Bai, Yuqi, et al.
Published: (2024)
by: Bai, Yuqi, et al.
Published: (2024)
Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?
by: Li, Xiang, et al.
Published: (2025)
by: Li, Xiang, et al.
Published: (2025)
Pessimistic Off-Policy Optimization for Learning to Rank
by: Cief, Matej, et al.
Published: (2022)
by: Cief, Matej, et al.
Published: (2022)
Off-policy Evaluation for Payments at Adyen
by: Egg, Alex
Published: (2025)
by: Egg, Alex
Published: (2025)
Learning-to-Rank with Nested Feedback
by: Sagtani, Hitesh, et al.
Published: (2024)
by: Sagtani, Hitesh, et al.
Published: (2024)
Measuring Strategization in Recommendation: Users Adapt Their Behavior to Shape Future Content
by: Cen, Sarah H., et al.
Published: (2024)
by: Cen, Sarah H., et al.
Published: (2024)
Monitoring the Evolution of Behavioural Embeddings in Social Media Recommendation
by: Saket, Srijan, et al.
Published: (2023)
by: Saket, Srijan, et al.
Published: (2023)
Meta Clustering of Neural Bandits
by: Ban, Yikun, et al.
Published: (2024)
by: Ban, Yikun, et al.
Published: (2024)
A Multifacet Hierarchical Sentiment-Topic Model with Application to Multi-Brand Online Review Analysis
by: Liang, Qiao, et al.
Published: (2025)
by: Liang, Qiao, et al.
Published: (2025)
Musical Listening Qualia: A Multivariate Approach
by: Mizener, Brendon, et al.
Published: (2024)
by: Mizener, Brendon, et al.
Published: (2024)
Scalable recommender system based on factor analysis
by: Ghandwani, Disha, et al.
Published: (2024)
by: Ghandwani, Disha, et al.
Published: (2024)
Seller-Side Experiments under Interference Induced by Feedback Loops in Two-Sided Platforms
by: Zhu, Zhihua, et al.
Published: (2024)
by: Zhu, Zhihua, et al.
Published: (2024)
Logging Policy Design for Off-Policy Evaluation
by: Douglas, Connor, et al.
Published: (2026)
by: Douglas, Connor, et al.
Published: (2026)
Fast Slate Policy Optimization: Going Beyond Plackett-Luce
by: Sakhi, Otmane, et al.
Published: (2023)
by: Sakhi, Otmane, et al.
Published: (2023)
Meta-Learning and Targeted Differential Privacy to Improve the Accuracy-Privacy Trade-off in Recommendations
by: Müllner, Peter, et al.
Published: (2026)
by: Müllner, Peter, et al.
Published: (2026)
Intelligent Algorithm Selection for Recommender Systems: Meta-Learning via in-depth algorithm feature engineering
by: Decker, Jarne Mathi
Published: (2025)
by: Decker, Jarne Mathi
Published: (2025)
Policy-Guided Causal State Representation for Offline Reinforcement Learning Recommendation
by: Wang, Siyu, et al.
Published: (2025)
by: Wang, Siyu, et al.
Published: (2025)
Proximal Ranking Policy Optimization for Practical Safety in Counterfactual Learning to Rank
by: Gupta, Shashank, et al.
Published: (2024)
by: Gupta, Shashank, et al.
Published: (2024)
Similar Items
-
Unifying On- and Off-Policy Variance Reduction Methods
by: Jeunen, Olivier
Published: (2026) -
Counterfactual Inference under Thompson Sampling
by: Jeunen, Olivier
Published: (2025) -
$Δ\text{-}{\rm OPE}$: Off-Policy Estimation with Pairs of Policies
by: Jeunen, Olivier, et al.
Published: (2024) -
Additive Control Variates Dominate Self-Normalisation in Off-Policy Evaluation
by: Jeunen, Olivier, et al.
Published: (2026) -
On (Normalised) Discounted Cumulative Gain as an Off-Policy Evaluation Metric for Top-$n$ Recommendation
by: Jeunen, Olivier, et al.
Published: (2023)