Multi-Metric Adaptive Experimental Design under Fixed Budget with Validation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Qining, Fiez, Tanner, Liu, Yi, Liu, Wenyang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Adaptive Experimentation When You Can't Experiment
par: Zhao, Yao, et autres
Publié: (2024)
par: Zhao, Yao, et autres
Publié: (2024)
Best of Three Worlds: Adaptive Experimentation for Digital Marketing in Practice
par: Fiez, Tanner, et autres
Publié: (2024)
par: Fiez, Tanner, et autres
Publié: (2024)
Convergence of Learning Dynamics in Stackelberg Games
par: Fiez, Tanner, et autres
Publié: (2019)
par: Fiez, Tanner, et autres
Publié: (2019)
Segment Discovery: Enhancing E-commerce Targeting
par: Li, Qiqi, et autres
Publié: (2024)
par: Li, Qiqi, et autres
Publié: (2024)
Provable Reinforcement Learning from Human Feedback with an Unknown Link Function
par: Zhang, Qining, et autres
Publié: (2025)
par: Zhang, Qining, et autres
Publié: (2025)
Zeroth-Order Policy Gradient for Reinforcement Learning from Human Feedback without Reward Inference
par: Zhang, Qining, et autres
Publié: (2024)
par: Zhang, Qining, et autres
Publié: (2024)
Fast and Regret Optimal Best Arm Identification: Fundamental Limits and Low-Complexity Algorithms
par: Zhang, Qining, et autres
Publié: (2023)
par: Zhang, Qining, et autres
Publié: (2023)
LinearAPT: An Adaptive Algorithm for the Fixed-Budget Thresholding Linear Bandit Problem
par: Wu, Yun-Ang, et autres
Publié: (2024)
par: Wu, Yun-Ang, et autres
Publié: (2024)
Adaptive LLM Routing under Budget Constraints
par: Panda, Pranoy, et autres
Publié: (2025)
par: Panda, Pranoy, et autres
Publié: (2025)
Dependent Randomized Rounding for Budget Constrained Experimental Design
par: Yamin, Khurram, et autres
Publié: (2025)
par: Yamin, Khurram, et autres
Publié: (2025)
Efficient Federated RLHF via Zeroth-Order Policy Optimization
par: Wang, Deyi, et autres
Publié: (2026)
par: Wang, Deyi, et autres
Publié: (2026)
Reinforcement Learning from Human Feedback without Reward Inference: Model-Free Algorithm and Instance-Dependent Analysis
par: Zhang, Qining, et autres
Publié: (2024)
par: Zhang, Qining, et autres
Publié: (2024)
Cost Aware Best Arm Identification
par: Kanarios, Kellen, et autres
Publié: (2024)
par: Kanarios, Kellen, et autres
Publié: (2024)
Observationally Informed Adaptive Causal Experimental Design
par: Gao, Erdun, et autres
Publié: (2026)
par: Gao, Erdun, et autres
Publié: (2026)
Risk-Averse Best Arm Set Identification with Fixed Budget and Fixed Confidence
par: Nonaga, Shunta, et autres
Publié: (2025)
par: Nonaga, Shunta, et autres
Publié: (2025)
Adaptive Head Budgeting for Efficient Multi-Head Attention
par: Faye, Bilal, et autres
Publié: (2026)
par: Faye, Bilal, et autres
Publié: (2026)
Bandit Pareto Set Identification: the Fixed Budget Setting
par: Kone, Cyrille, et autres
Publié: (2023)
par: Kone, Cyrille, et autres
Publié: (2023)
An Algorithm for Fixed Budget Best Arm Identification with Combinatorial Exploration
par: Parupudi, Siddhartha, et autres
Publié: (2025)
par: Parupudi, Siddhartha, et autres
Publié: (2025)
Fixed-Budget Change Point Identification in Piecewise Constant Bandits
par: Lazzaro, Joseph, et autres
Publié: (2025)
par: Lazzaro, Joseph, et autres
Publié: (2025)
UCB Exploration for Fixed-Budget Bayesian Best Arm Identification
par: Zhu, Rong J. B., et autres
Publié: (2024)
par: Zhu, Rong J. B., et autres
Publié: (2024)
Fixed-Budget Constrained Best Arm Identification in Grouped Bandits
par: Mukherjee, Raunak, et autres
Publié: (2026)
par: Mukherjee, Raunak, et autres
Publié: (2026)
An Experimental Design for Anytime-Valid Causal Inference on Multi-Armed Bandits
par: Liang, Biyonka, et autres
Publié: (2023)
par: Liang, Biyonka, et autres
Publié: (2023)
The Coupling Tax: How Shared Token Budgets Undermine Visible Chain-of-Thought Under Fixed Output Limits
par: Nie, Wenhua, et autres
Publié: (2026)
par: Nie, Wenhua, et autres
Publié: (2026)
BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens
par: Wen, Hao, et autres
Publié: (2025)
par: Wen, Hao, et autres
Publié: (2025)
MSTIM: A MindSpore-Based Model for Traffic Flow Prediction
par: Qin, Weiqi, et autres
Publié: (2025)
par: Qin, Weiqi, et autres
Publié: (2025)
Cooperative Multi-Agent Deep Reinforcement Learning in Content Ranking Optimization
par: Qin, Zhou, et autres
Publié: (2024)
par: Qin, Zhou, et autres
Publié: (2024)
Best Arm Identification with Fixed Budget: A Large Deviation Perspective
par: Wang, Po-An, et autres
Publié: (2023)
par: Wang, Po-An, et autres
Publié: (2023)
Accelerating Deep Learning with Fixed Time Budget
par: Khan, Muhammad Asif, et autres
Publié: (2024)
par: Khan, Muhammad Asif, et autres
Publié: (2024)
Fixed Budget is No Harder Than Fixed Confidence in Best-Arm Identification up to Logarithmic Factors
par: Balagopalan, Kapilan, et autres
Publié: (2026)
par: Balagopalan, Kapilan, et autres
Publié: (2026)
Adaptive Experiment Design with Synthetic Controls
par: Hüyük, Alihan, et autres
Publié: (2024)
par: Hüyük, Alihan, et autres
Publié: (2024)
Pure Exploration for Constrained Best Mixed Arm Identification with a Fixed Budget
par: Tang, Dengwang, et autres
Publié: (2024)
par: Tang, Dengwang, et autres
Publié: (2024)
$\varepsilon$-Good Action Identification in Fixed-Budget Monte Carlo Tree Search
par: Li, Yinan, et autres
Publié: (2026)
par: Li, Yinan, et autres
Publié: (2026)
Adaptive Policy Selection and Fine-Tuning under Interaction Budgets for Offline-to-Online Reinforcement Learning
par: Bozkurt, Alper Kamil, et autres
Publié: (2026)
par: Bozkurt, Alper Kamil, et autres
Publié: (2026)
An Innovative CGL-MHA Model for Sarcasm Sentiment Recognition Using the MindSpore Framework
par: Qin, Zhenkai, et autres
Publié: (2024)
par: Qin, Zhenkai, et autres
Publié: (2024)
ALPINE: Closed-Loop Adaptive Privacy Budget Allocation for Mobile Edge Crowdsensing
par: Cheng, Guanjie, et autres
Publié: (2025)
par: Cheng, Guanjie, et autres
Publié: (2025)
Prior-Dependent Allocations for Bayesian Fixed-Budget Best-Arm Identification in Structured Bandits
par: Nguyen, Nicolas, et autres
Publié: (2024)
par: Nguyen, Nicolas, et autres
Publié: (2024)
Design and Evaluation of Whole-Page Experience Optimization for E-commerce Search
par: Lahiri, Pratik, et autres
Publié: (2026)
par: Lahiri, Pratik, et autres
Publié: (2026)
Budgeted Recommendation with Delayed Feedback
par: Liu, Kweiguu, et autres
Publié: (2024)
par: Liu, Kweiguu, et autres
Publié: (2024)
Adaptive Budget Allocation in LLM-Augmented Surveys
par: Ye, Zikun, et autres
Publié: (2026)
par: Ye, Zikun, et autres
Publié: (2026)
Worst-Case Optimal Multi-Armed Gaussian Best Arm Identification with a Fixed Budget
par: Kato, Masahiro
Publié: (2023)
par: Kato, Masahiro
Publié: (2023)
Documents similaires
-
Adaptive Experimentation When You Can't Experiment
par: Zhao, Yao, et autres
Publié: (2024) -
Best of Three Worlds: Adaptive Experimentation for Digital Marketing in Practice
par: Fiez, Tanner, et autres
Publié: (2024) -
Convergence of Learning Dynamics in Stackelberg Games
par: Fiez, Tanner, et autres
Publié: (2019) -
Segment Discovery: Enhancing E-commerce Targeting
par: Li, Qiqi, et autres
Publié: (2024) -
Provable Reinforcement Learning from Human Feedback with an Unknown Link Function
par: Zhang, Qining, et autres
Publié: (2025)