Theoretical Foundations and Effective Algorithms for Policy-Aware Simulator Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Dann, Christoph, Mansour, Yishay, Mohri, Mehryar |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Rate-Preserving Reductions for Blackwell Approachability
por: Dann, Christoph, et al.
Publicado: (2024)
por: Dann, Christoph, et al.
Publicado: (2024)
Mind the Gap: Structure-Aware Consistency in Preference Learning
por: Mohri, Mehryar, et al.
Publicado: (2026)
por: Mohri, Mehryar, et al.
Publicado: (2026)
Predictor-Rejector Multi-Class Abstention: Theoretical Analysis and Algorithms
por: Mao, Anqi, et al.
Publicado: (2023)
por: Mao, Anqi, et al.
Publicado: (2023)
Principled Algorithms for Optimizing Generalized Metrics in Multi-Label Learning
por: Mohri, Mehryar, et al.
Publicado: (2026)
por: Mohri, Mehryar, et al.
Publicado: (2026)
Cost-Aware Learning
por: Mohri, Clara, et al.
Publicado: (2026)
por: Mohri, Clara, et al.
Publicado: (2026)
Theoretically Grounded Loss Functions and Algorithms for Score-Based Multi-Class Abstention
por: Mao, Anqi, et al.
Publicado: (2023)
por: Mao, Anqi, et al.
Publicado: (2023)
Balancing the Scales: A Theoretical and Algorithmic Framework for Learning from Imbalanced Data
por: Cortes, Corinna, et al.
Publicado: (2025)
por: Cortes, Corinna, et al.
Publicado: (2025)
Rational Transductors
por: Mohri, Mehryar
Publicado: (2026)
por: Mohri, Mehryar
Publicado: (2026)
A Theoretical Framework for Modular Learning of Robust Generative Models
por: Cortes, Corinna, et al.
Publicado: (2026)
por: Cortes, Corinna, et al.
Publicado: (2026)
Improved Balanced Classification with Theoretically Grounded Loss Functions
por: Cortes, Corinna, et al.
Publicado: (2025)
por: Cortes, Corinna, et al.
Publicado: (2025)
Algorithms for Learning Kernels Based on Centered Alignment
por: Cortes, Corinna, et al.
Publicado: (2012)
por: Cortes, Corinna, et al.
Publicado: (2012)
Swap Regret and Correlated Equilibria Beyond Normal-Form Games
por: Arunachaleswaran, Eshwar Ram, et al.
Publicado: (2025)
por: Arunachaleswaran, Eshwar Ram, et al.
Publicado: (2025)
Principled Algorithms for Optimizing Generalized Metrics in Binary Classification
por: Mao, Anqi, et al.
Publicado: (2025)
por: Mao, Anqi, et al.
Publicado: (2025)
Top-$k$ Classification and Cardinality-Aware Prediction
por: Mao, Anqi, et al.
Publicado: (2024)
por: Mao, Anqi, et al.
Publicado: (2024)
Cardinality-Aware Set Prediction and Top-$k$ Classification
por: Cortes, Corinna, et al.
Publicado: (2024)
por: Cortes, Corinna, et al.
Publicado: (2024)
Linear-Core Surrogates: Smooth Loss Functions with Linear Rates for Classification and Structured Prediction
por: Mohri, Mehryar, et al.
Publicado: (2026)
por: Mohri, Mehryar, et al.
Publicado: (2026)
Beyond Tsybakov: Model Margin Noise and $\mathcal{H}$-Consistency Bounds
por: Mohri, Mehryar, et al.
Publicado: (2025)
por: Mohri, Mehryar, et al.
Publicado: (2025)
Optimal Regret for Policy Optimization in Contextual Bandits
por: Levy, Orin, et al.
Publicado: (2026)
por: Levy, Orin, et al.
Publicado: (2026)
Principled Approaches for Learning to Defer with Multiple Experts
por: Mao, Anqi, et al.
Publicado: (2023)
por: Mao, Anqi, et al.
Publicado: (2023)
Multi-Label Learning with Stronger Consistency Guarantees
por: Mao, Anqi, et al.
Publicado: (2024)
por: Mao, Anqi, et al.
Publicado: (2024)
Differentially Private Domain Adaptation with Theoretical Guarantees
por: Bassily, Raef, et al.
Publicado: (2023)
por: Bassily, Raef, et al.
Publicado: (2023)
A Universal Growth Rate for Learning with Smooth Surrogate Losses
por: Mao, Anqi, et al.
Publicado: (2024)
por: Mao, Anqi, et al.
Publicado: (2024)
Near-optimal Regret Using Policy Optimization in Online MDPs with Aggregate Bandit Feedback
por: Lancewicki, Tal, et al.
Publicado: (2025)
por: Lancewicki, Tal, et al.
Publicado: (2025)
Realizable $H$-Consistent and Bayes-Consistent Loss Functions for Learning to Defer
por: Mao, Anqi, et al.
Publicado: (2024)
por: Mao, Anqi, et al.
Publicado: (2024)
Mastering Multiple-Expert Routing: Realizable $H$-Consistency and Strong Guarantees for Learning to Defer
por: Mao, Anqi, et al.
Publicado: (2025)
por: Mao, Anqi, et al.
Publicado: (2025)
Fast Inference via Hierarchical Speculative Decoding
por: Mohri, Clara, et al.
Publicado: (2025)
por: Mohri, Clara, et al.
Publicado: (2025)
Budgeted Multiple-Expert Deferral
por: DeSalvo, Giulia, et al.
Publicado: (2025)
por: DeSalvo, Giulia, et al.
Publicado: (2025)
Generalized Distributional Alignment Games for Unbiased Answer-Level Fine-Tuning
por: Mohri, Mehryar, et al.
Publicado: (2026)
por: Mohri, Mehryar, et al.
Publicado: (2026)
Regression with Multi-Expert Deferral
por: Mao, Anqi, et al.
Publicado: (2024)
por: Mao, Anqi, et al.
Publicado: (2024)
$H$-Consistency Guarantees for Regression
por: Mao, Anqi, et al.
Publicado: (2024)
por: Mao, Anqi, et al.
Publicado: (2024)
Coherence Mechanisms for Provable Self-Improvement
por: Mohri, Mehryar, et al.
Publicado: (2025)
por: Mohri, Mehryar, et al.
Publicado: (2025)
Enhanced $H$-Consistency Bounds
por: Mao, Anqi, et al.
Publicado: (2024)
por: Mao, Anqi, et al.
Publicado: (2024)
Learning-Augmented Algorithms with Explicit Predictors
por: Elias, Marek, et al.
Publicado: (2024)
por: Elias, Marek, et al.
Publicado: (2024)
Convergence of Policy Mirror Descent Beyond Compatible Function Approximation
por: Sherman, Uri, et al.
Publicado: (2025)
por: Sherman, Uri, et al.
Publicado: (2025)
Rising Rested MAB with Linear Drift
por: Amichay, Omer, et al.
Publicado: (2025)
por: Amichay, Omer, et al.
Publicado: (2025)
Non-stochastic Bandits With Evolving Observations
por: Bar-On, Yogev, et al.
Publicado: (2024)
por: Bar-On, Yogev, et al.
Publicado: (2024)
Adaptive Matrix Online Learning through Smoothing with Guarantees for Nonsmooth Nonconvex Optimization
por: Jiang, Ruichen, et al.
Publicado: (2026)
por: Jiang, Ruichen, et al.
Publicado: (2026)
Distributional Alignment Games for Answer-Level Fine-Tuning
por: Mohri, Mehryar, et al.
Publicado: (2026)
por: Mohri, Mehryar, et al.
Publicado: (2026)
A Theoretical Framework for Statistical Evaluability of Generative Models
por: Aiyer, Shashaank, et al.
Publicado: (2026)
por: Aiyer, Shashaank, et al.
Publicado: (2026)
Online Learning in MDPs with Partially Adversarial Transitions and Losses
por: Schlisselberg, Ofir, et al.
Publicado: (2026)
por: Schlisselberg, Ofir, et al.
Publicado: (2026)
Ejemplares similares
-
Rate-Preserving Reductions for Blackwell Approachability
por: Dann, Christoph, et al.
Publicado: (2024) -
Mind the Gap: Structure-Aware Consistency in Preference Learning
por: Mohri, Mehryar, et al.
Publicado: (2026) -
Predictor-Rejector Multi-Class Abstention: Theoretical Analysis and Algorithms
por: Mao, Anqi, et al.
Publicado: (2023) -
Principled Algorithms for Optimizing Generalized Metrics in Multi-Label Learning
por: Mohri, Mehryar, et al.
Publicado: (2026) -
Cost-Aware Learning
por: Mohri, Clara, et al.
Publicado: (2026)