Salvato in:
| Autori principali: | Oh, Youngmin, Park, Jinje, Paik, Taejin, Park, Jaemin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2506.01250 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
M3: Mamba-assisted Multi-Circuit Optimization via MBRL with Effective Scheduling
di: Oh, Youngmin, et al.
Pubblicazione: (2024)
di: Oh, Youngmin, et al.
Pubblicazione: (2024)
Robust Linear Dueling Bandits with Post-serving Context under Unknown Delays and Adversarial Corruptions
di: Oh, Youngmin
Pubblicazione: (2026)
di: Oh, Youngmin
Pubblicazione: (2026)
Variance-Aware Regret Bounds for Stochastic Contextual Dueling Bandits
di: Di, Qiwei, et al.
Pubblicazione: (2023)
di: Di, Qiwei, et al.
Pubblicazione: (2023)
Linear and Neural Dueling Bandits with Delayed Feedback
di: Wang, Xiangyi, et al.
Pubblicazione: (2026)
di: Wang, Xiangyi, et al.
Pubblicazione: (2026)
Variance-Aware Linear UCB with Deep Representation for Neural Contextual Bandits
di: Bui, Ha Manh, et al.
Pubblicazione: (2024)
di: Bui, Ha Manh, et al.
Pubblicazione: (2024)
Federated Linear Dueling Bandits
di: Huang, Xuhan, et al.
Pubblicazione: (2025)
di: Huang, Xuhan, et al.
Pubblicazione: (2025)
PIG: Physics-Informed Gaussians as Adaptive Parametric Mesh Representations
di: Kang, Namgyu, et al.
Pubblicazione: (2024)
di: Kang, Namgyu, et al.
Pubblicazione: (2024)
Online Clustering of Dueling Bandits
di: Wang, Zhiyong, et al.
Pubblicazione: (2025)
di: Wang, Zhiyong, et al.
Pubblicazione: (2025)
Multi-Player Approaches for Dueling Bandits
di: Raveh, Or, et al.
Pubblicazione: (2024)
di: Raveh, Or, et al.
Pubblicazione: (2024)
Neural Dueling Bandits: Preference-Based Optimization with Human Feedback
di: Verma, Arun, et al.
Pubblicazione: (2024)
di: Verma, Arun, et al.
Pubblicazione: (2024)
Active Human Feedback Collection via Neural Contextual Dueling Bandits
di: Verma, Arun, et al.
Pubblicazione: (2025)
di: Verma, Arun, et al.
Pubblicazione: (2025)
Biased Dueling Bandits with Stochastic Delayed Feedback
di: Yi, Bongsoo, et al.
Pubblicazione: (2024)
di: Yi, Bongsoo, et al.
Pubblicazione: (2024)
Fusing Reward and Dueling Feedback in Stochastic Bandits
di: Wang, Xuchuang, et al.
Pubblicazione: (2025)
di: Wang, Xuchuang, et al.
Pubblicazione: (2025)
Conversational Dueling Bandits in Generalized Linear Models
di: Yang, Shuhua, et al.
Pubblicazione: (2024)
di: Yang, Shuhua, et al.
Pubblicazione: (2024)
The Sampling Complexity of Condorcet Winner Identification in Dueling Bandits
di: Saad, El Mehdi, et al.
Pubblicazione: (2026)
di: Saad, El Mehdi, et al.
Pubblicazione: (2026)
Infrequent Exploration in Linear Bandits
di: Lee, Harin, et al.
Pubblicazione: (2025)
di: Lee, Harin, et al.
Pubblicazione: (2025)
Feel-Good Thompson Sampling for Contextual Dueling Bandits
di: Li, Xuheng, et al.
Pubblicazione: (2024)
di: Li, Xuheng, et al.
Pubblicazione: (2024)
Recycling History: Efficient Recommendations from Contextual Dueling Bandits
di: Sankagiri, Suryanarayana, et al.
Pubblicazione: (2025)
di: Sankagiri, Suryanarayana, et al.
Pubblicazione: (2025)
Utility-based Dueling Bandits as a Partial Monitoring Game
di: Gajane, Pratik, et al.
Pubblicazione: (2015)
di: Gajane, Pratik, et al.
Pubblicazione: (2015)
PINT: Physics-Informed Neural Time Series Models with Applications to Long-term Inference on WeatherBench 2m-Temperature Data
di: Park, Keonvin, et al.
Pubblicazione: (2025)
di: Park, Keonvin, et al.
Pubblicazione: (2025)
FlexiQ: Adaptive Mixed-Precision Quantization for Latency/Accuracy Trade-Offs in Deep Neural Networks
di: Kim, Jaemin, et al.
Pubblicazione: (2025)
di: Kim, Jaemin, et al.
Pubblicazione: (2025)
Thompson Sampling for Multi-Objective Linear Contextual Bandit
di: Park, Somangchan, et al.
Pubblicazione: (2025)
di: Park, Somangchan, et al.
Pubblicazione: (2025)
Lipschitz Dueling Bandits over Continuous Action Spaces
di: Sharma, Mudit, et al.
Pubblicazione: (2026)
di: Sharma, Mudit, et al.
Pubblicazione: (2026)
When Can We Track Significant Preference Shifts in Dueling Bandits?
di: Suk, Joe, et al.
Pubblicazione: (2023)
di: Suk, Joe, et al.
Pubblicazione: (2023)
Nearly Optimal Algorithms for Contextual Dueling Bandits from Adversarial Feedback
di: Di, Qiwei, et al.
Pubblicazione: (2024)
di: Di, Qiwei, et al.
Pubblicazione: (2024)
Non-Stationary Dueling Bandits Under a Weighted Borda Criterion
di: Suk, Joe, et al.
Pubblicazione: (2024)
di: Suk, Joe, et al.
Pubblicazione: (2024)
Exploration via Feature Perturbation in Contextual Bandits
di: Yi, Seouh-won, et al.
Pubblicazione: (2025)
di: Yi, Seouh-won, et al.
Pubblicazione: (2025)
Reparameterizing 4DVAR with neural fields
di: Oh, Jaemin
Pubblicazione: (2025)
di: Oh, Jaemin
Pubblicazione: (2025)
Preference is More Than Comparisons: Rethinking Dueling Bandits with Augmented Human Feedback
di: Wang, Shengbo, et al.
Pubblicazione: (2025)
di: Wang, Shengbo, et al.
Pubblicazione: (2025)
Beyond Numeric Rewards: In-Context Dueling Bandits with LLM Agents
di: Xia, Fanzeng, et al.
Pubblicazione: (2024)
di: Xia, Fanzeng, et al.
Pubblicazione: (2024)
Linear Bandits with Partially Observable Features
di: Kim, Wonyoung, et al.
Pubblicazione: (2025)
di: Kim, Wonyoung, et al.
Pubblicazione: (2025)
Neural Exploitation and Exploration of Contextual Bandits
di: Ban, Yikun, et al.
Pubblicazione: (2023)
di: Ban, Yikun, et al.
Pubblicazione: (2023)
Coupling-Robust Accuracy in Multiphysics Physics Informed Neural Networks via Kronecker-Preconditioned Optimization
di: Park, Youngjae, et al.
Pubblicazione: (2026)
di: Park, Youngjae, et al.
Pubblicazione: (2026)
Multi-User Dueling Bandits: A Fair Approach using Nash Social Welfare
di: Ahmed, Maheed H., et al.
Pubblicazione: (2026)
di: Ahmed, Maheed H., et al.
Pubblicazione: (2026)
Separable Physics-informed Neural Networks for Solving the BGK Model of the Boltzmann Equation
di: Oh, Jaemin, et al.
Pubblicazione: (2024)
di: Oh, Jaemin, et al.
Pubblicazione: (2024)
Global Context-aware Representation Learning for Spatially Resolved Transcriptomics
di: Oh, Yunhak, et al.
Pubblicazione: (2025)
di: Oh, Yunhak, et al.
Pubblicazione: (2025)
Forward and Inverse Simulation of Pseudo-Two-Dimensional Model of Lithium-Ion Batteries Using Neural Networks
di: Lee, Myeong-Su, et al.
Pubblicazione: (2024)
di: Lee, Myeong-Su, et al.
Pubblicazione: (2024)
Dueling Deep Reinforcement Learning for Financial Time Series
di: Giorgio, Bruno
Pubblicazione: (2025)
di: Giorgio, Bruno
Pubblicazione: (2025)
Swish-T : Enhancing Swish Activation with Tanh Bias for Improved Neural Network Performance
di: Seo, Youngmin, et al.
Pubblicazione: (2024)
di: Seo, Youngmin, et al.
Pubblicazione: (2024)
Posterior Inference on Shallow Infinitely Wide Bayesian Neural Networks under Weights with Unbounded Variance
di: Loría, Jorge, et al.
Pubblicazione: (2023)
di: Loría, Jorge, et al.
Pubblicazione: (2023)
Documenti analoghi
-
M3: Mamba-assisted Multi-Circuit Optimization via MBRL with Effective Scheduling
di: Oh, Youngmin, et al.
Pubblicazione: (2024) -
Robust Linear Dueling Bandits with Post-serving Context under Unknown Delays and Adversarial Corruptions
di: Oh, Youngmin
Pubblicazione: (2026) -
Variance-Aware Regret Bounds for Stochastic Contextual Dueling Bandits
di: Di, Qiwei, et al.
Pubblicazione: (2023) -
Linear and Neural Dueling Bandits with Delayed Feedback
di: Wang, Xiangyi, et al.
Pubblicazione: (2026) -
Variance-Aware Linear UCB with Deep Representation for Neural Contextual Bandits
di: Bui, Ha Manh, et al.
Pubblicazione: (2024)