Contextual Online Pricing with (Biased) Offline Data
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yixuan, Zhu, Ruihao, Xie, Qiaomin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
On the Peril of (Even a Little) Nonstationarity in Satisficing Regret Minimization
di: Zhang, Yixuan, et al.
Pubblicazione: (2026)
di: Zhang, Yixuan, et al.
Pubblicazione: (2026)
Wasserstein-p Central Limit Theorem Rates: From Local Dependence to Markov Chains
di: Zhang, Yixuan, et al.
Pubblicazione: (2026)
di: Zhang, Yixuan, et al.
Pubblicazione: (2026)
Constant Stepsize Q-learning: Distributional Convergence, Bias and Extrapolation
di: Zhang, Yixuan, et al.
Pubblicazione: (2024)
di: Zhang, Yixuan, et al.
Pubblicazione: (2024)
Stable Offline Value Function Learning with Bisimulation-based Representations
di: Pavse, Brahma S., et al.
Pubblicazione: (2024)
di: Pavse, Brahma S., et al.
Pubblicazione: (2024)
Prelimit Coupling and Steady-State Convergence of Constant-stepsize Nonsmooth Contractive SA
di: Zhang, Yixuan, et al.
Pubblicazione: (2024)
di: Zhang, Yixuan, et al.
Pubblicazione: (2024)
Online Bandits with (Biased) Offline Data: Adaptive Learning under Distribution Mismatch
di: Cheung, Wang Chi, et al.
Pubblicazione: (2024)
di: Cheung, Wang Chi, et al.
Pubblicazione: (2024)
The Collusion of Memory and Nonlinearity in Stochastic Approximation With Constant Stepsize
di: Huo, Dongyan, et al.
Pubblicazione: (2024)
di: Huo, Dongyan, et al.
Pubblicazione: (2024)
Simulating Biases for Interpretable Fairness in Offline and Online Classifiers
di: Inácio, Ricardo, et al.
Pubblicazione: (2025)
di: Inácio, Ricardo, et al.
Pubblicazione: (2025)
A Piecewise Lyapunov Analysis of Sub-quadratic SGD: Applications to Robust and Quantile Regression
di: Zhang, Yixuan, et al.
Pubblicazione: (2025)
di: Zhang, Yixuan, et al.
Pubblicazione: (2025)
Direction-Aware Offline-to-Online Learning in Linear Contextual Bandits
di: Han, Zean, et al.
Pubblicazione: (2026)
di: Han, Zean, et al.
Pubblicazione: (2026)
Coupling-based Convergence Diagnostic and Stepsize Scheme for Stochastic Gradient Descent
di: Li, Xiang, et al.
Pubblicazione: (2024)
di: Li, Xiang, et al.
Pubblicazione: (2024)
Learning to Stabilize Online Reinforcement Learning in Unbounded State Spaces
di: Pavse, Brahma S., et al.
Pubblicazione: (2023)
di: Pavse, Brahma S., et al.
Pubblicazione: (2023)
Benchmarks for Reinforcement Learning with Biased Offline Data and Imperfect Simulators
di: Linial, Ori, et al.
Pubblicazione: (2024)
di: Linial, Ori, et al.
Pubblicazione: (2024)
Bias and Extrapolation in Markovian Linear Stochastic Approximation with Constant Stepsizes
di: Huo, Dongyan, et al.
Pubblicazione: (2022)
di: Huo, Dongyan, et al.
Pubblicazione: (2022)
Leveraging Offline Data in Linear Latent Contextual Bandits
di: Kausik, Chinmaya, et al.
Pubblicazione: (2024)
di: Kausik, Chinmaya, et al.
Pubblicazione: (2024)
Best Arm Identification with Possibly Biased Offline Data
di: Yang, Le, et al.
Pubblicazione: (2025)
di: Yang, Le, et al.
Pubblicazione: (2025)
Group-Sensitive Offline Contextual Bandits
di: Guo, Yihong, et al.
Pubblicazione: (2025)
di: Guo, Yihong, et al.
Pubblicazione: (2025)
Bridging Online and Offline RL: Contextual Bandit Learning for Multi-Turn Code Generation
di: Chen, Ziru, et al.
Pubblicazione: (2026)
di: Chen, Ziru, et al.
Pubblicazione: (2026)
SPEED: Experimental Design for Policy Evaluation in Linear Heteroscedastic Bandits
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2023)
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2023)
Offline Contextual Bandit with Counterfactual Sample Identification
di: Gilotte, Alexandre, et al.
Pubblicazione: (2025)
di: Gilotte, Alexandre, et al.
Pubblicazione: (2025)
Offline Contextual Bandits in the Presence of New Actions
di: Kishimoto, Ren, et al.
Pubblicazione: (2026)
di: Kishimoto, Ren, et al.
Pubblicazione: (2026)
Data Poisoning to Fake a Nash Equilibrium in Markov Games
di: Wu, Young, et al.
Pubblicazione: (2023)
di: Wu, Young, et al.
Pubblicazione: (2023)
Pretraining Decision Transformers with Reward Prediction for In-Context Multi-task Structured Bandit Learning
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2024)
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2024)
C-kNN-LSH: A Nearest-Neighbor Algorithm for Sequential Counterfactual Inference
di: Wang, Jing, et al.
Pubblicazione: (2026)
di: Wang, Jing, et al.
Pubblicazione: (2026)
Active Advantage-Aligned Online Reinforcement Learning with Offline Data
di: Liu, Xuefeng, et al.
Pubblicazione: (2025)
di: Liu, Xuefeng, et al.
Pubblicazione: (2025)
Online Bandit Learning with Offline Preference Data for Improved RLHF
di: Agnihotri, Akhil, et al.
Pubblicazione: (2024)
di: Agnihotri, Akhil, et al.
Pubblicazione: (2024)
Contextual Dynamic Pricing with Heterogeneous Buyers
di: Lykouris, Thodoris, et al.
Pubblicazione: (2025)
di: Lykouris, Thodoris, et al.
Pubblicazione: (2025)
Online Assortment and Price Optimization Under Contextual Choice Models
di: Erginbas, Yigit Efe, et al.
Pubblicazione: (2025)
di: Erginbas, Yigit Efe, et al.
Pubblicazione: (2025)
Online Policy Learning from Offline Preferences
di: Zhang, Guoxi, et al.
Pubblicazione: (2024)
di: Zhang, Guoxi, et al.
Pubblicazione: (2024)
PAC-Bayes Meets Online Contextual Optimization
di: Xie, Zhuojun, et al.
Pubblicazione: (2025)
di: Xie, Zhuojun, et al.
Pubblicazione: (2025)
Minimax Optimality in Contextual Dynamic Pricing with General Valuation Models
di: Gong, Xueping, et al.
Pubblicazione: (2024)
di: Gong, Xueping, et al.
Pubblicazione: (2024)
How to Solve Contextual Goal-Oriented Problems with Offline Datasets?
di: Fan, Ying, et al.
Pubblicazione: (2024)
di: Fan, Ying, et al.
Pubblicazione: (2024)
Contextual Latent World Models for Offline Meta Reinforcement Learning
di: Nakheai, Mohammadreza, et al.
Pubblicazione: (2026)
di: Nakheai, Mohammadreza, et al.
Pubblicazione: (2026)
Online Pre-Training for Offline-to-Online Reinforcement Learning
di: Shin, Yongjae, et al.
Pubblicazione: (2025)
di: Shin, Yongjae, et al.
Pubblicazione: (2025)
Optimal Attack and Defense for Reinforcement Learning
di: McMahan, Jeremy, et al.
Pubblicazione: (2023)
di: McMahan, Jeremy, et al.
Pubblicazione: (2023)
Measuring and Mitigating Biases in Motor Insurance Pricing
di: Moriah, Mulah, et al.
Pubblicazione: (2023)
di: Moriah, Mulah, et al.
Pubblicazione: (2023)
Enhancing Online Reinforcement Learning with Meta-Learned Objective from Offline Data
di: Deng, Shilong, et al.
Pubblicazione: (2025)
di: Deng, Shilong, et al.
Pubblicazione: (2025)
Efficient Online Reinforcement Learning Fine-Tuning Need Not Retain Offline Data
di: Zhou, Zhiyuan, et al.
Pubblicazione: (2024)
di: Zhou, Zhiyuan, et al.
Pubblicazione: (2024)
Two-Timescale Linear Stochastic Approximation: Constant Stepsizes Go a Long Way
di: Kwon, Jeongyeol, et al.
Pubblicazione: (2024)
di: Kwon, Jeongyeol, et al.
Pubblicazione: (2024)
Adaptive Estimation and Optimal Control in Offline Contextual MDPs without Stationarity
di: Bhattacharyya, Riddhiman, et al.
Pubblicazione: (2026)
di: Bhattacharyya, Riddhiman, et al.
Pubblicazione: (2026)
Documenti analoghi
-
On the Peril of (Even a Little) Nonstationarity in Satisficing Regret Minimization
di: Zhang, Yixuan, et al.
Pubblicazione: (2026) -
Wasserstein-p Central Limit Theorem Rates: From Local Dependence to Markov Chains
di: Zhang, Yixuan, et al.
Pubblicazione: (2026) -
Constant Stepsize Q-learning: Distributional Convergence, Bias and Extrapolation
di: Zhang, Yixuan, et al.
Pubblicazione: (2024) -
Stable Offline Value Function Learning with Bisimulation-based Representations
di: Pavse, Brahma S., et al.
Pubblicazione: (2024) -
Prelimit Coupling and Steady-State Convergence of Constant-stepsize Nonsmooth Contractive SA
di: Zhang, Yixuan, et al.
Pubblicazione: (2024)