Bandits with Single-Peaked Preferences and Limited Resources
Fuente:
arXiv
Salvato in:
| Autori principali: | Ben-Porat, Omer, Keinan, Gur, Torkan, Rotem |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Modeling Churn in Recommender Systems with Aggregated Preferences
di: Keinan, Gur, et al.
Pubblicazione: (2025)
di: Keinan, Gur, et al.
Pubblicazione: (2025)
Churn-Aware Recommendation Planning under Aggregated Preference Feedback
di: Keinan, Gur, et al.
Pubblicazione: (2025)
di: Keinan, Gur, et al.
Pubblicazione: (2025)
Strategic Content Creation with Age of GenAI: To Share or Not to Share?
di: Keinan, Gur, et al.
Pubblicazione: (2025)
di: Keinan, Gur, et al.
Pubblicazione: (2025)
Envious Explore and Exploit
di: Ben-Porat, Omer, et al.
Pubblicazione: (2025)
di: Ben-Porat, Omer, et al.
Pubblicazione: (2025)
Neural Dueling Bandits: Preference-Based Optimization with Human Feedback
di: Verma, Arun, et al.
Pubblicazione: (2024)
di: Verma, Arun, et al.
Pubblicazione: (2024)
Geometric-Averaged Preference Optimization for Soft Preference Labels
di: Furuta, Hiroki, et al.
Pubblicazione: (2024)
di: Furuta, Hiroki, et al.
Pubblicazione: (2024)
Exposing Limitations of Language Model Agents in Sequential-Task Compositions on the Web
di: Furuta, Hiroki, et al.
Pubblicazione: (2023)
di: Furuta, Hiroki, et al.
Pubblicazione: (2023)
Semi-Supervised Preference Optimization with Limited Feedback
di: Lee, Seonggyun, et al.
Pubblicazione: (2025)
di: Lee, Seonggyun, et al.
Pubblicazione: (2025)
Hummer: Towards Limited Competitive Preference Dataset
di: Jiang, Li, et al.
Pubblicazione: (2024)
di: Jiang, Li, et al.
Pubblicazione: (2024)
Bi-Level Contextual Bandits for Individualized Resource Allocation under Delayed Feedback
di: Almasi, Mohammadsina, et al.
Pubblicazione: (2025)
di: Almasi, Mohammadsina, et al.
Pubblicazione: (2025)
Preferences Evolve And So Should Your Bandits: Bandits with Evolving States for Online Platforms
di: Khosravi, Khashayar, et al.
Pubblicazione: (2023)
di: Khosravi, Khashayar, et al.
Pubblicazione: (2023)
Diffusion-Driven Inertial Generated Data for Smartphone Location Classification
di: Cohen, Noa, et al.
Pubblicazione: (2025)
di: Cohen, Noa, et al.
Pubblicazione: (2025)
INSIGHTS: Demonstration-Based Summaries of Time Series Predictors
di: Porat, Bar Eini, et al.
Pubblicazione: (2026)
di: Porat, Bar Eini, et al.
Pubblicazione: (2026)
Peak-Detector: Explainable Peak Detection via Instruction-Tuned Large Language Models in Physiological Sign
di: Li, Jiahui, et al.
Pubblicazione: (2026)
di: Li, Jiahui, et al.
Pubblicazione: (2026)
Personalized Reinforcement Learning with a Budget of Policies
di: Ivanov, Dmitry, et al.
Pubblicazione: (2024)
di: Ivanov, Dmitry, et al.
Pubblicazione: (2024)
Bandits with Preference Feedback: A Stackelberg Game Perspective
di: Pásztor, Barna, et al.
Pubblicazione: (2024)
di: Pásztor, Barna, et al.
Pubblicazione: (2024)
BanditSpec: Adaptive Speculative Decoding via Bandit Algorithms
di: Hou, Yunlong, et al.
Pubblicazione: (2025)
di: Hou, Yunlong, et al.
Pubblicazione: (2025)
Incentivized Lipschitz Bandits
di: Chakraborty, Sourav, et al.
Pubblicazione: (2025)
di: Chakraborty, Sourav, et al.
Pubblicazione: (2025)
NestQuant: Nested Lattice Quantization for Matrix Products and LLMs
di: Savkin, Semyon, et al.
Pubblicazione: (2025)
di: Savkin, Semyon, et al.
Pubblicazione: (2025)
Modeling Attrition in Recommender Systems with Departing Bandits
di: Ben-Porat, Omer, et al.
Pubblicazione: (2022)
di: Ben-Porat, Omer, et al.
Pubblicazione: (2022)
Peak-Controlled Logits Poisoning Attack in Federated Distillation
di: Tang, Yuhan, et al.
Pubblicazione: (2024)
di: Tang, Yuhan, et al.
Pubblicazione: (2024)
Online Clustering of Dueling Bandits
di: Wang, Zhiyong, et al.
Pubblicazione: (2025)
di: Wang, Zhiyong, et al.
Pubblicazione: (2025)
Tree Ensembles for Contextual Bandits
di: Nilsson, Hannes, et al.
Pubblicazione: (2024)
di: Nilsson, Hannes, et al.
Pubblicazione: (2024)
Flickering Multi-Armed Bandits
di: Chakraborty, Sourav, et al.
Pubblicazione: (2026)
di: Chakraborty, Sourav, et al.
Pubblicazione: (2026)
EviTrack: Selection over Sampling for Delayed Disambiguation
di: Haq, Omer
Pubblicazione: (2026)
di: Haq, Omer
Pubblicazione: (2026)
Collaborating with GenAI: Incentives and Replacements
di: Taitler, Boaz, et al.
Pubblicazione: (2025)
di: Taitler, Boaz, et al.
Pubblicazione: (2025)
CollaFuse: Navigating Limited Resources and Privacy in Collaborative Generative AI
di: Zipperling, Domenique, et al.
Pubblicazione: (2024)
di: Zipperling, Domenique, et al.
Pubblicazione: (2024)
Enhancing Preference-based Linear Bandits via Human Response Time
di: Li, Shen, et al.
Pubblicazione: (2024)
di: Li, Shen, et al.
Pubblicazione: (2024)
Universal One-third Time Scaling in Learning Peaked Distributions
di: Liu, Yizhou, et al.
Pubblicazione: (2026)
di: Liu, Yizhou, et al.
Pubblicazione: (2026)
From Contextual Combinatorial Semi-Bandits to Bandit List Classification: Improved Sample Complexity with Sparse Rewards
di: Erez, Liad, et al.
Pubblicazione: (2025)
di: Erez, Liad, et al.
Pubblicazione: (2025)
Provably Efficient Reinforcement Learning for Adversarial Restless Multi-Armed Bandits with Unknown Transitions and Bandit Feedback
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
Tokenized Bandit for LLM Decoding and Alignment
di: Shin, Suho, et al.
Pubblicazione: (2025)
di: Shin, Suho, et al.
Pubblicazione: (2025)
Deceptive Exploration in Multi-armed Bandits
di: Vurankaya, I. Arda, et al.
Pubblicazione: (2025)
di: Vurankaya, I. Arda, et al.
Pubblicazione: (2025)
Causal Contextual Bandits with Adaptive Context
di: Madhavan, Rahul, et al.
Pubblicazione: (2024)
di: Madhavan, Rahul, et al.
Pubblicazione: (2024)
Causally Abstracted Multi-armed Bandits
di: Zennaro, Fabio Massimo, et al.
Pubblicazione: (2024)
di: Zennaro, Fabio Massimo, et al.
Pubblicazione: (2024)
Neural Active Learning Beyond Bandits
di: Ban, Yikun, et al.
Pubblicazione: (2024)
di: Ban, Yikun, et al.
Pubblicazione: (2024)
Diffusion Models Meet Contextual Bandits
di: Aouali, Imad
Pubblicazione: (2024)
di: Aouali, Imad
Pubblicazione: (2024)
Best-Arm Identification in Unimodal Bandits
di: Poiani, Riccardo, et al.
Pubblicazione: (2024)
di: Poiani, Riccardo, et al.
Pubblicazione: (2024)
Learning When to Trust in Contextual Bandits
di: Ghasemi, Majid, et al.
Pubblicazione: (2026)
di: Ghasemi, Majid, et al.
Pubblicazione: (2026)
Operationalizing Fairness: Post-Hoc Threshold Optimization Under Hard Resource Limits
di: Singh, Moirangthem Tiken, et al.
Pubblicazione: (2026)
di: Singh, Moirangthem Tiken, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Modeling Churn in Recommender Systems with Aggregated Preferences
di: Keinan, Gur, et al.
Pubblicazione: (2025) -
Churn-Aware Recommendation Planning under Aggregated Preference Feedback
di: Keinan, Gur, et al.
Pubblicazione: (2025) -
Strategic Content Creation with Age of GenAI: To Share or Not to Share?
di: Keinan, Gur, et al.
Pubblicazione: (2025) -
Envious Explore and Exploit
di: Ben-Porat, Omer, et al.
Pubblicazione: (2025) -
Neural Dueling Bandits: Preference-Based Optimization with Human Feedback
di: Verma, Arun, et al.
Pubblicazione: (2024)