Salvato in:
| Autori principali: | Sharma, Nihal, Basu, Soumya, Shanmugam, Karthikeyan, Shakkottai, Sanjay |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2020
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2002.08405 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Bandits with Stochastic Experts: Constant Regret, Empirical Experts and Episodes
di: Sharma, Nihal, et al.
Pubblicazione: (2021)
di: Sharma, Nihal, et al.
Pubblicazione: (2021)
Blocking Bandits
di: Basu, Soumya, et al.
Pubblicazione: (2019)
di: Basu, Soumya, et al.
Pubblicazione: (2019)
Efficient Approximate Posterior Sampling with Annealed Langevin Monte Carlo
di: Parulekar, Advait, et al.
Pubblicazione: (2025)
di: Parulekar, Advait, et al.
Pubblicazione: (2025)
Fine-Tuning Diffusion Models via Intermediate Distribution Shaping
di: Anil, Gautham Govind, et al.
Pubblicazione: (2025)
di: Anil, Gautham Govind, et al.
Pubblicazione: (2025)
Competing Bandits in Matching Markets via Super Stability
di: Basu, Soumya
Pubblicazione: (2025)
di: Basu, Soumya
Pubblicazione: (2025)
Asymptotically-Optimal Gaussian Bandits with Side Observations
di: Atsidakou, Alexia, et al.
Pubblicazione: (2025)
di: Atsidakou, Alexia, et al.
Pubblicazione: (2025)
Regret minimization in Linear Bandits with offline data via extended D-optimal exploration
di: Vijayan, Sushant, et al.
Pubblicazione: (2025)
di: Vijayan, Sushant, et al.
Pubblicazione: (2025)
Collaborative Multi-Agent Heterogeneous Multi-Armed Bandits
di: Chawla, Ronshee, et al.
Pubblicazione: (2023)
di: Chawla, Ronshee, et al.
Pubblicazione: (2023)
The Gossiping Insert-Eliminate Algorithm for Multi-Agent Bandits
di: Chawla, Ronshee, et al.
Pubblicazione: (2020)
di: Chawla, Ronshee, et al.
Pubblicazione: (2020)
Preference-centric Bandits: Optimality of Mixtures and Regret-efficient Algorithms
di: Tatlı, Meltem, et al.
Pubblicazione: (2025)
di: Tatlı, Meltem, et al.
Pubblicazione: (2025)
Risk-sensitive Bandits: Arm Mixture Optimality and Regret-efficient Algorithms
di: Tatlı, Meltem, et al.
Pubblicazione: (2025)
di: Tatlı, Meltem, et al.
Pubblicazione: (2025)
Competing Bandits in Decentralized Contextual Matching Markets
di: Parikh, Satush, et al.
Pubblicazione: (2024)
di: Parikh, Satush, et al.
Pubblicazione: (2024)
Bayesian Collaborative Bandits with Thompson Sampling for Improved Outreach in Maternal Health Program
di: Dasgupta, Arpan, et al.
Pubblicazione: (2024)
di: Dasgupta, Arpan, et al.
Pubblicazione: (2024)
Combinatorial Multi-armed Bandits: Arm Selection via Group Testing
di: Mukherjee, Arpan, et al.
Pubblicazione: (2024)
di: Mukherjee, Arpan, et al.
Pubblicazione: (2024)
Anchored Diffusion Language Model
di: Rout, Litu, et al.
Pubblicazione: (2025)
di: Rout, Litu, et al.
Pubblicazione: (2025)
Selective classification using a robust meta-learning approach
di: Jain, Nishant, et al.
Pubblicazione: (2022)
di: Jain, Nishant, et al.
Pubblicazione: (2022)
Glauber Generative Model: Discrete Diffusion Models via Binary Classification
di: Varma, Harshit, et al.
Pubblicazione: (2024)
di: Varma, Harshit, et al.
Pubblicazione: (2024)
Representation Learning Preserving Ignorability and Covariate Matching for Treatment Effects
di: Nanavati, Praharsh, et al.
Pubblicazione: (2025)
di: Nanavati, Praharsh, et al.
Pubblicazione: (2025)
Machine Unlearning under Overparameterization
di: Block, Jacob L., et al.
Pubblicazione: (2025)
di: Block, Jacob L., et al.
Pubblicazione: (2025)
Learning from Label Proportions: Bootstrapping Supervised Learners via Belief Propagation
di: Havaldar, Shreyas, et al.
Pubblicazione: (2023)
di: Havaldar, Shreyas, et al.
Pubblicazione: (2023)
AnCoder: Anchored Code Generation via Discrete Diffusion Models
di: Xue, Anton, et al.
Pubblicazione: (2026)
di: Xue, Anton, et al.
Pubblicazione: (2026)
Temper-Then-Tilt: Principled Unlearning for Generative Models through Tempering and Classifier Guidance
di: Block, Jacob L., et al.
Pubblicazione: (2026)
di: Block, Jacob L., et al.
Pubblicazione: (2026)
DOPL: Direct Online Preference Learning for Restless Bandits with Preference Feedback
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
General Identifiability and Achievability for Causal Representation Learning
di: Varıcı, Burak, et al.
Pubblicazione: (2023)
di: Varıcı, Burak, et al.
Pubblicazione: (2023)
Linear Causal Representation Learning from Unknown Multi-node Interventions
di: Varıcı, Burak, et al.
Pubblicazione: (2024)
di: Varıcı, Burak, et al.
Pubblicazione: (2024)
Provable Multi-Task Representation Learning by Two-Layer ReLU Neural Networks
di: Collins, Liam, et al.
Pubblicazione: (2023)
di: Collins, Liam, et al.
Pubblicazione: (2023)
Provable Meta-Learning with Low-Rank Adaptations
di: Block, Jacob L., et al.
Pubblicazione: (2024)
di: Block, Jacob L., et al.
Pubblicazione: (2024)
Diffusion-Based Posterior Sampling: A Feynman-Kac Analysis of Bias and Stability
di: Delgadino, Matias G., et al.
Pubblicazione: (2026)
di: Delgadino, Matias G., et al.
Pubblicazione: (2026)
Robust Reward Modeling via Causal Rubrics
di: Srivastava, Pragya, et al.
Pubblicazione: (2025)
di: Srivastava, Pragya, et al.
Pubblicazione: (2025)
Score-based Causal Representation Learning: Linear and General Transformations
di: Varıcı, Burak, et al.
Pubblicazione: (2024)
di: Varıcı, Burak, et al.
Pubblicazione: (2024)
Path-specific effects for pulse-oximetry guided decisions in critical care
di: Zhang, Kevin, et al.
Pubblicazione: (2025)
di: Zhang, Kevin, et al.
Pubblicazione: (2025)
In-Context Learning with Transformers: Softmax Attention Adapts to Function Lipschitzness
di: Collins, Liam, et al.
Pubblicazione: (2024)
di: Collins, Liam, et al.
Pubblicazione: (2024)
Entropy Aware Reward Guidance for Diffusion Language Model Alignment
di: Tejaswi, Atula, et al.
Pubblicazione: (2026)
di: Tejaswi, Atula, et al.
Pubblicazione: (2026)
Attribute Graphs Underlying Molecular Generative Models: Path to Learning with Limited Data
di: Hoffman, Samuel C., et al.
Pubblicazione: (2022)
di: Hoffman, Samuel C., et al.
Pubblicazione: (2022)
Fairness under Covariate Shift: Improving Fairness-Accuracy tradeoff with few Unlabeled Test Samples
di: Havaldar, Shreyas, et al.
Pubblicazione: (2023)
di: Havaldar, Shreyas, et al.
Pubblicazione: (2023)
Inferring Asteroseismic Parameters from Short Observations Using Deep Learning: Application to TESS and K2 Red Giants
di: Ghanghas, Nipun, et al.
Pubblicazione: (2026)
di: Ghanghas, Nipun, et al.
Pubblicazione: (2026)
Online Bidding under RoS Constraints without Knowing the Value
di: Vijayan, Sushant, et al.
Pubblicazione: (2025)
di: Vijayan, Sushant, et al.
Pubblicazione: (2025)
Stochastic Online Instrumental Variable Regression: Regrets for Endogeneity and Bandit Feedback
di: Della Vecchia, Riccardo, et al.
Pubblicazione: (2023)
di: Della Vecchia, Riccardo, et al.
Pubblicazione: (2023)
Interleaved Gibbs Diffusion: Generating Discrete-Continuous Data with Implicit Constraints
di: Anil, Gautham Govind, et al.
Pubblicazione: (2025)
di: Anil, Gautham Govind, et al.
Pubblicazione: (2025)
Concentrated Differential Privacy for Bandits
di: Azize, Achraf, et al.
Pubblicazione: (2023)
di: Azize, Achraf, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Bandits with Stochastic Experts: Constant Regret, Empirical Experts and Episodes
di: Sharma, Nihal, et al.
Pubblicazione: (2021) -
Blocking Bandits
di: Basu, Soumya, et al.
Pubblicazione: (2019) -
Efficient Approximate Posterior Sampling with Annealed Langevin Monte Carlo
di: Parulekar, Advait, et al.
Pubblicazione: (2025) -
Fine-Tuning Diffusion Models via Intermediate Distribution Shaping
di: Anil, Gautham Govind, et al.
Pubblicazione: (2025) -
Competing Bandits in Matching Markets via Super Stability
di: Basu, Soumya
Pubblicazione: (2025)