Optimal Baseline Corrections for Off-Policy Contextual Bandits
Fuente:
arXiv
Salvato in:
| Autori principali: | Gupta, Shashank, Jeunen, Olivier, Oosterhuis, Harrie, de Rijke, Maarten |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Proximal Ranking Policy Optimization for Practical Safety in Counterfactual Learning to Rank
di: Gupta, Shashank, et al.
Pubblicazione: (2024)
di: Gupta, Shashank, et al.
Pubblicazione: (2024)
Practical and Robust Safety Guarantees for Advanced Counterfactual Learning to Rank
di: Gupta, Shashank, et al.
Pubblicazione: (2024)
di: Gupta, Shashank, et al.
Pubblicazione: (2024)
Additive Control Variates Dominate Self-Normalisation in Off-Policy Evaluation
di: Jeunen, Olivier, et al.
Pubblicazione: (2026)
di: Jeunen, Olivier, et al.
Pubblicazione: (2026)
Estimating the Hessian Matrix of Ranking Objectives for Stochastic Learning to Rank with Gradient Boosted Trees
di: Kang, Jingwei, et al.
Pubblicazione: (2024)
di: Kang, Jingwei, et al.
Pubblicazione: (2024)
A First Look at Selection Bias in Preference Elicitation for Recommendation
di: Gupta, Shashank, et al.
Pubblicazione: (2024)
di: Gupta, Shashank, et al.
Pubblicazione: (2024)
Meta Off-Policy Estimation
di: Jeunen, Olivier
Pubblicazione: (2025)
di: Jeunen, Olivier
Pubblicazione: (2025)
Unifying On- and Off-Policy Variance Reduction Methods
di: Jeunen, Olivier
Pubblicazione: (2026)
di: Jeunen, Olivier
Pubblicazione: (2026)
$Δ\text{-}{\rm OPE}$: Off-Policy Estimation with Pairs of Policies
di: Jeunen, Olivier, et al.
Pubblicazione: (2024)
di: Jeunen, Olivier, et al.
Pubblicazione: (2024)
Learning to Rank with Variable Result Presentation Lengths
di: Knyazev, Norman, et al.
Pubblicazione: (2025)
di: Knyazev, Norman, et al.
Pubblicazione: (2025)
On (Normalised) Discounted Cumulative Gain as an Off-Policy Evaluation Metric for Top-$n$ Recommendation
di: Jeunen, Olivier, et al.
Pubblicazione: (2023)
di: Jeunen, Olivier, et al.
Pubblicazione: (2023)
Following the Eye-Tracking Evidence: Established Web-Search Assumptions Fail in Carousel Interfaces
di: Kang, Jingwei, et al.
Pubblicazione: (2026)
di: Kang, Jingwei, et al.
Pubblicazione: (2026)
Going Beyond Popularity and Positivity Bias: Correcting for Multifactorial Bias in Recommender Systems
di: Huang, Jin, et al.
Pubblicazione: (2024)
di: Huang, Jin, et al.
Pubblicazione: (2024)
Rethinking Click Models in Light of Carousel Interfaces: Theory-Based Categorization and Design of Click Models
di: Kang, Jingwei, et al.
Pubblicazione: (2025)
di: Kang, Jingwei, et al.
Pubblicazione: (2025)
Counterfactual Inference under Thompson Sampling
di: Jeunen, Olivier
Pubblicazione: (2025)
di: Jeunen, Olivier
Pubblicazione: (2025)
A Simple Model to Estimate Sharing Effects in Social Networks
di: Jeunen, Olivier
Pubblicazione: (2024)
di: Jeunen, Olivier
Pubblicazione: (2024)
Reliable Confidence Intervals for Information Retrieval Evaluation Using Generative A.I
di: Oosterhuis, Harrie, et al.
Pubblicazione: (2024)
di: Oosterhuis, Harrie, et al.
Pubblicazione: (2024)
Optimizing Compound Retrieval Systems
di: Oosterhuis, Harrie, et al.
Pubblicazione: (2025)
di: Oosterhuis, Harrie, et al.
Pubblicazione: (2025)
Adaptive Orchestration of Modular Generative Information Access Systems
di: Hoveyda, Mohanna, et al.
Pubblicazione: (2025)
di: Hoveyda, Mohanna, et al.
Pubblicazione: (2025)
Learning Metrics that Maximise Power for Accelerated A/B-Tests
di: Jeunen, Olivier, et al.
Pubblicazione: (2024)
di: Jeunen, Olivier, et al.
Pubblicazione: (2024)
A Non-Parametric Choice Model That Learns How Users Choose Between Recommended Options
di: Krause, Thorsten, et al.
Pubblicazione: (2025)
di: Krause, Thorsten, et al.
Pubblicazione: (2025)
Behavioural Effects of Agentic Messaging: A Case Study on a Financial Service Application
di: Jeunen, Olivier, et al.
Pubblicazione: (2025)
di: Jeunen, Olivier, et al.
Pubblicazione: (2025)
Calibrated Recommendations with Contextual Bandits
di: Feijer, Diego, et al.
Pubblicazione: (2025)
di: Feijer, Diego, et al.
Pubblicazione: (2025)
Unidentified and Confounded? Understanding Two-Tower Models for Unbiased Learning to Rank
di: Hager, Philipp, et al.
Pubblicazione: (2025)
di: Hager, Philipp, et al.
Pubblicazione: (2025)
Multi-Objective Recommendation via Multivariate Policy Learning
di: Jeunen, Olivier, et al.
Pubblicazione: (2024)
di: Jeunen, Olivier, et al.
Pubblicazione: (2024)
Towards Two-Stage Counterfactual Learning to Rank
di: Gupta, Shashank, et al.
Pubblicazione: (2025)
di: Gupta, Shashank, et al.
Pubblicazione: (2025)
Contrastive Learning for Diversity-Aware Product Recommendations in Retail
di: Karlis, Vasileios, et al.
Pubblicazione: (2026)
di: Karlis, Vasileios, et al.
Pubblicazione: (2026)
Variance Reduction in Ratio Metrics for Efficient Online Experiments
di: Baweja, Shubham, et al.
Pubblicazione: (2024)
di: Baweja, Shubham, et al.
Pubblicazione: (2024)
CLAX: Fast and Flexible Neural Click Models in JAX
di: Hager, Philipp, et al.
Pubblicazione: (2025)
di: Hager, Philipp, et al.
Pubblicazione: (2025)
Contextual Bandits in Payment Processing: Non-uniform Exploration and Supervised Learning
di: Vangara, Akhila, et al.
Pubblicazione: (2024)
di: Vangara, Akhila, et al.
Pubblicazione: (2024)
RecGaze: The First Eye Tracking and User Interaction Dataset for Carousel Interfaces
di: de Leon-Martinez, Santiago, et al.
Pubblicazione: (2025)
di: de Leon-Martinez, Santiago, et al.
Pubblicazione: (2025)
Causal Feature Selection Method for Contextual Multi-Armed Bandits in Recommender System
di: Zhao, Zhenyu, et al.
Pubblicazione: (2024)
di: Zhao, Zhenyu, et al.
Pubblicazione: (2024)
Is Interpretable Machine Learning Effective at Feature Selection for Neural Learning-to-Rank?
di: Lyu, Lijun, et al.
Pubblicazione: (2024)
di: Lyu, Lijun, et al.
Pubblicazione: (2024)
Agentic Personalisation of Cross-Channel Marketing Experiences
di: Abboud, Sami, et al.
Pubblicazione: (2025)
di: Abboud, Sami, et al.
Pubblicazione: (2025)
Off-Policy Evaluation and Learning for Matching Markets
di: Hayashi, Yudai, et al.
Pubblicazione: (2025)
di: Hayashi, Yudai, et al.
Pubblicazione: (2025)
Contextual Bandit with Herding Effects: Algorithms and Recommendation Applications
di: Xu, Luyue, et al.
Pubblicazione: (2024)
di: Xu, Luyue, et al.
Pubblicazione: (2024)
IntOPE: Off-Policy Evaluation in the Presence of Interference
di: Bai, Yuqi, et al.
Pubblicazione: (2024)
di: Bai, Yuqi, et al.
Pubblicazione: (2024)
AdaptEx: A Self-Service Contextual Bandit Platform
di: Black, William, et al.
Pubblicazione: (2023)
di: Black, William, et al.
Pubblicazione: (2023)
Multi-granular Adversarial Attacks against Black-box Neural Ranking Models
di: Liu, Yu-An, et al.
Pubblicazione: (2024)
di: Liu, Yu-An, et al.
Pubblicazione: (2024)
Large Language Models for Next Point-of-Interest Recommendation
di: Li, Peibo, et al.
Pubblicazione: (2024)
di: Li, Peibo, et al.
Pubblicazione: (2024)
A Simpler Alternative to Variational Regularized Counterfactual Risk Minimization
di: Bakker, Hua Chang, et al.
Pubblicazione: (2024)
di: Bakker, Hua Chang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Proximal Ranking Policy Optimization for Practical Safety in Counterfactual Learning to Rank
di: Gupta, Shashank, et al.
Pubblicazione: (2024) -
Practical and Robust Safety Guarantees for Advanced Counterfactual Learning to Rank
di: Gupta, Shashank, et al.
Pubblicazione: (2024) -
Additive Control Variates Dominate Self-Normalisation in Off-Policy Evaluation
di: Jeunen, Olivier, et al.
Pubblicazione: (2026) -
Estimating the Hessian Matrix of Ranking Objectives for Stochastic Learning to Rank with Gradient Boosted Trees
di: Kang, Jingwei, et al.
Pubblicazione: (2024) -
A First Look at Selection Bias in Preference Elicitation for Recommendation
di: Gupta, Shashank, et al.
Pubblicazione: (2024)