AExGym: Benchmarks and Environments for Adaptive Experimentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Jimmy, Che, Ethan, Jiang, Daniel R., Namkoong, Hongseok |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Optimization-Driven Adaptive Experimentation
par: Che, Ethan, et autres
Publié: (2024)
par: Che, Ethan, et autres
Publié: (2024)
Differentiable Discrete Event Simulation for Queuing Network Control
par: Che, Ethan, et autres
Publié: (2024)
par: Che, Ethan, et autres
Publié: (2024)
Empirical Likelihood for Nonsmooth Functionals
par: Namkoong, Hongseok
Publié: (2026)
par: Namkoong, Hongseok
Publié: (2026)
Adaptive Elicitation of Latent Information Using Natural Language
par: Wang, Jimmy, et autres
Publié: (2025)
par: Wang, Jimmy, et autres
Publié: (2025)
QGym: Scalable Simulation and Benchmarking of Queuing Network Controllers
par: Chen, Haozhe, et autres
Publié: (2024)
par: Chen, Haozhe, et autres
Publié: (2024)
Exchangeable Sequence Models Quantify Uncertainty Over Latent Concepts
par: Ye, Naimeng, et autres
Publié: (2024)
par: Ye, Naimeng, et autres
Publié: (2024)
A Planning Framework for Adaptive Labeling
par: Mittal, Daksh, et autres
Publié: (2025)
par: Mittal, Daksh, et autres
Publié: (2025)
Benchmarking In-context Experiential Learning Through Repeated Product Recommendations
par: Yang, Gilbert, et autres
Publié: (2025)
par: Yang, Gilbert, et autres
Publié: (2025)
A Broader View of Thompson Sampling
par: Qu, Yanlin, et autres
Publié: (2025)
par: Qu, Yanlin, et autres
Publié: (2025)
A Sensitivity Approach to Causal Inference Under Limited Overlap
par: Ma, Yuanzhe, et autres
Publié: (2025)
par: Ma, Yuanzhe, et autres
Publié: (2025)
Design and Scheduling of an AI-based Queueing System
par: Lee, Jiung, et autres
Publié: (2024)
par: Lee, Jiung, et autres
Publié: (2024)
Distilled Thompson Sampling: Practical and Efficient Thompson Sampling via Imitation Learning
par: Namkoong, Hongseok, et autres
Publié: (2020)
par: Namkoong, Hongseok, et autres
Publié: (2020)
Minimax Optimal Estimation of Stability Under Distribution Shift
par: Namkoong, Hongseok, et autres
Publié: (2022)
par: Namkoong, Hongseok, et autres
Publié: (2022)
Data-Driven Stochastic Modeling Using Autoregressive Sequence Models: Translating Event Tables to Queueing Dynamics
par: Mittal, Daksh, et autres
Publié: (2025)
par: Mittal, Daksh, et autres
Publié: (2025)
Rethinking Distribution Shifts: Empirical Analysis and Inductive Modeling for Tabular Data
par: Wang, Tianyu, et autres
Publié: (2023)
par: Wang, Tianyu, et autres
Publié: (2023)
Active Exploration via Autoregressive Generation of Missing Data
par: Cai, Tiffany Tianhui, et autres
Publié: (2024)
par: Cai, Tiffany Tianhui, et autres
Publié: (2024)
C-Learner: Constrained Learning for Causal Inference
par: Cai, Tiffany Tianhui, et autres
Publié: (2024)
par: Cai, Tiffany Tianhui, et autres
Publié: (2024)
Evaluating Model Performance Under Worst-case Subpopulations
par: Li, Mike, et autres
Publié: (2024)
par: Li, Mike, et autres
Publié: (2024)
Architectural and Inferential Inductive Biases For Exchangeable Sequence Modeling
par: Mittal, Daksh, et autres
Publié: (2025)
par: Mittal, Daksh, et autres
Publié: (2025)
Contextual Thompson Sampling via Generation of Missing Data
par: Zhang, Kelly W., et autres
Publié: (2025)
par: Zhang, Kelly W., et autres
Publié: (2025)
LLM Embeddings Improve Test-time Adaptation to Tabular $Y|X$-Shifts
par: Zeng, Yibo, et autres
Publié: (2024)
par: Zeng, Yibo, et autres
Publié: (2024)
DRO: A Python Library for Distributionally Robust Optimization in Machine Learning
par: Liu, Jiashuo, et autres
Publié: (2025)
par: Liu, Jiashuo, et autres
Publié: (2025)
Data Mixture Optimization: A Multi-fidelity Multi-scale Bayesian Framework
par: Yen, Thomson, et autres
Publié: (2025)
par: Yen, Thomson, et autres
Publié: (2025)
LLM Swiss Round: Aggregating Multi-Benchmark Performance via Competitive Swiss-System Dynamics
par: Liu, Jiashuo, et autres
Publié: (2025)
par: Liu, Jiashuo, et autres
Publié: (2025)
BoxingGym: Benchmarking Progress in Automated Experimental Design and Model Discovery
par: Gandhi, Kanishk, et autres
Publié: (2025)
par: Gandhi, Kanishk, et autres
Publié: (2025)
OceanGym: A Benchmark Environment for Underwater Embodied Agents
par: Xue, Yida, et autres
Publié: (2025)
par: Xue, Yida, et autres
Publié: (2025)
Mining--Gym: A Configurable RL Benchmarking Environment for Truck Dispatch Scheduling
par: Banerjee, Chayan, et autres
Publié: (2025)
par: Banerjee, Chayan, et autres
Publié: (2025)
SeekerGym: A Benchmark for Reliable Information Seeking
par: Kim, Remy, et autres
Publié: (2026)
par: Kim, Remy, et autres
Publié: (2026)
Stochastic Gradient Descent with Adaptive Data
par: Che, Ethan, et autres
Publié: (2024)
par: Che, Ethan, et autres
Publié: (2024)
Gym-Anything: Turn any Software into an Agent Environment
par: Aggarwal, Pranjal, et autres
Publié: (2026)
par: Aggarwal, Pranjal, et autres
Publié: (2026)
BlenderGym: Benchmarking Foundational Model Systems for Graphics Editing
par: Gu, Yunqi, et autres
Publié: (2025)
par: Gu, Yunqi, et autres
Publié: (2025)
Memory Gym: Towards Endless Tasks to Benchmark Memory Capabilities of Agents
par: Pleines, Marco, et autres
Publié: (2023)
par: Pleines, Marco, et autres
Publié: (2023)
SynthTools: A Framework for Scaling Synthetic Tools for Agent Development
par: Castellani, Tommaso, et autres
Publié: (2025)
par: Castellani, Tommaso, et autres
Publié: (2025)
CUA-Gym: Scaling Verifiable Training Environments and Tasks for Computer-Use Agents
par: Wang, Bowen, et autres
Publié: (2026)
par: Wang, Bowen, et autres
Publié: (2026)
UserBench: An Interactive Gym Environment for User-Centric Agents
par: Qian, Cheng, et autres
Publié: (2025)
par: Qian, Cheng, et autres
Publié: (2025)
CrystalGym: A New Benchmark for Materials Discovery Using Reinforcement Learning
par: Govindarajan, Prashant, et autres
Publié: (2025)
par: Govindarajan, Prashant, et autres
Publié: (2025)
BVR Gym: A Reinforcement Learning Environment for Beyond-Visual-Range Air Combat
par: Scukins, Edvards, et autres
Publié: (2024)
par: Scukins, Edvards, et autres
Publié: (2024)
PeersimGym: An Environment for Solving the Task Offloading Problem with Reinforcement Learning
par: Metelo, Frederico, et autres
Publié: (2024)
par: Metelo, Frederico, et autres
Publié: (2024)
AbideGym: Turning Static RL Worlds into Adaptive Challenges
par: Aryan, Abi, et autres
Publié: (2025)
par: Aryan, Abi, et autres
Publié: (2025)
PersonalLLM: Tailoring LLMs to Individual Preferences
par: Zollo, Thomas P., et autres
Publié: (2024)
par: Zollo, Thomas P., et autres
Publié: (2024)
Documents similaires
-
Optimization-Driven Adaptive Experimentation
par: Che, Ethan, et autres
Publié: (2024) -
Differentiable Discrete Event Simulation for Queuing Network Control
par: Che, Ethan, et autres
Publié: (2024) -
Empirical Likelihood for Nonsmooth Functionals
par: Namkoong, Hongseok
Publié: (2026) -
Adaptive Elicitation of Latent Information Using Natural Language
par: Wang, Jimmy, et autres
Publié: (2025) -
QGym: Scalable Simulation and Benchmarking of Queuing Network Controllers
par: Chen, Haozhe, et autres
Publié: (2024)