What Does Preference Learning Recover from Pairwise Comparison Data?
Fuente:
arXiv
Guardado en:
| Autores principales: | Pukdee, Rattana, Balcan, Maria-Florina, Ravikumar, Pradeep |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Reward Learning from Best-of-$N$ Preference Data: Targets, Tradeoffs, and Design Principles
por: Pukdee, Rattana, et al.
Publicado: (2026)
por: Pukdee, Rattana, et al.
Publicado: (2026)
Spectrally Transformed Kernel Regression
por: Zhai, Runtian, et al.
Publicado: (2024)
por: Zhai, Runtian, et al.
Publicado: (2024)
Learning from Interval Targets
por: Pukdee, Rattana, et al.
Publicado: (2025)
por: Pukdee, Rattana, et al.
Publicado: (2025)
Learning accurate and interpretable tree-based models
por: Balcan, Maria-Florina, et al.
Publicado: (2024)
por: Balcan, Maria-Florina, et al.
Publicado: (2024)
New Guarantees for Learning Revenue Maximizing Menus of Lotteries and Two-Part Tariffs
por: Balcan, Maria-Florina, et al.
Publicado: (2023)
por: Balcan, Maria-Florina, et al.
Publicado: (2023)
The Active and Noise-Tolerant Strategic Perceptron
por: Balcan, Maria-Florina, et al.
Publicado: (2025)
por: Balcan, Maria-Florina, et al.
Publicado: (2025)
Learning in Structured Stackelberg Games
por: Balcan, Maria-Florina, et al.
Publicado: (2025)
por: Balcan, Maria-Florina, et al.
Publicado: (2025)
Distribution-dependent Generalization Bounds for Tuning Linear Regression Across Tasks
por: Balcan, Maria-Florina, et al.
Publicado: (2025)
por: Balcan, Maria-Florina, et al.
Publicado: (2025)
On Learning Verifiers and Implications to Chain-of-Thought Reasoning
por: Balcan, Maria-Florina, et al.
Publicado: (2025)
por: Balcan, Maria-Florina, et al.
Publicado: (2025)
Bayesian Neural Networks with Domain Knowledge Priors
por: Sam, Dylan, et al.
Publicado: (2024)
por: Sam, Dylan, et al.
Publicado: (2024)
Sample complexity of data-driven tuning of model hyperparameters in neural networks with structured parameter-dependent dual function
por: Balcan, Maria-Florina, et al.
Publicado: (2025)
por: Balcan, Maria-Florina, et al.
Publicado: (2025)
Accelerating ERM for data-driven algorithm design using output-sensitive techniques
por: Balcan, Maria-Florina, et al.
Publicado: (2022)
por: Balcan, Maria-Florina, et al.
Publicado: (2022)
Metric Learning from Limited Pairwise Preference Comparisons
por: Wang, Zhi, et al.
Publicado: (2024)
por: Wang, Zhi, et al.
Publicado: (2024)
Subsidy design for better social outcomes
por: Balcan, Maria-Florina, et al.
Publicado: (2024)
por: Balcan, Maria-Florina, et al.
Publicado: (2024)
Algorithm Configuration for Structured Pfaffian Settings
por: Balcan, Maria-Florina, et al.
Publicado: (2024)
por: Balcan, Maria-Florina, et al.
Publicado: (2024)
Provably tuning the ElasticNet across instances
por: Balcan, Maria-Florina, et al.
Publicado: (2022)
por: Balcan, Maria-Florina, et al.
Publicado: (2022)
Learning to Relax: Setting Solver Parameters Across a Sequence of Linear System Instances
por: Khodak, Mikhail, et al.
Publicado: (2023)
por: Khodak, Mikhail, et al.
Publicado: (2023)
Regret Minimization in Stackelberg Games with Side Information
por: Harris, Keegan, et al.
Publicado: (2024)
por: Harris, Keegan, et al.
Publicado: (2024)
Online Learnability of Chain-of-Thought Verifiers: Soundness and Completeness Trade-offs
por: Balcan, Maria-Florina, et al.
Publicado: (2026)
por: Balcan, Maria-Florina, et al.
Publicado: (2026)
Preference-based Reinforcement Learning beyond Pairwise Comparisons: Benefits of Multiple Options
por: Lee, Joongkyu, et al.
Publicado: (2025)
por: Lee, Joongkyu, et al.
Publicado: (2025)
Learning from Similarity/Dissimilarity and Pairwise Comparison
por: Tate, Tomoya, et al.
Publicado: (2026)
por: Tate, Tomoya, et al.
Publicado: (2026)
Nearly-Optimal Bandit Learning in Stackelberg Games with Side Information
por: Balcan, Maria-Florina, et al.
Publicado: (2025)
por: Balcan, Maria-Florina, et al.
Publicado: (2025)
Automata Learning of Preferences over Temporal Logic Formulas from Pairwise Comparisons
por: Rahmani, Hazhar, et al.
Publicado: (2025)
por: Rahmani, Hazhar, et al.
Publicado: (2025)
Fair Active Ranking from Pairwise Preferences
por: Gorantla, Sruthi, et al.
Publicado: (2024)
por: Gorantla, Sruthi, et al.
Publicado: (2024)
Markov Equivalence and Consistency in Differentiable Structure Learning
por: Deng, Chang, et al.
Publicado: (2024)
por: Deng, Chang, et al.
Publicado: (2024)
Reinforcement Learning with Pairwise Preferences in Long-Term Decision Problems
por: Carr, Jonathan Colaço, et al.
Publicado: (2026)
por: Carr, Jonathan Colaço, et al.
Publicado: (2026)
Understanding Augmentation-based Self-Supervised Representation Learning via RKHS Approximation and Regression
por: Zhai, Runtian, et al.
Publicado: (2023)
por: Zhai, Runtian, et al.
Publicado: (2023)
Learning Recourse Costs from Pairwise Feature Comparisons
por: Rawal, Kaivalya, et al.
Publicado: (2024)
por: Rawal, Kaivalya, et al.
Publicado: (2024)
Score-Based Density Estimation from Pairwise Comparisons
por: Mikkola, Petrus, et al.
Publicado: (2025)
por: Mikkola, Petrus, et al.
Publicado: (2025)
Eigenfunction Extraction for Ordered Representation Learning
por: Varıcı, Burak, et al.
Publicado: (2025)
por: Varıcı, Burak, et al.
Publicado: (2025)
Learning Interpretable Concepts: Unifying Causal Representation Learning and Foundation Models
por: Rajendran, Goutham, et al.
Publicado: (2024)
por: Rajendran, Goutham, et al.
Publicado: (2024)
Do LLMs dream of elephants (when told not to)? Latent concept association and associative memory in transformers
por: Jiang, Yibo, et al.
Publicado: (2024)
por: Jiang, Yibo, et al.
Publicado: (2024)
Online Rubrics Elicitation from Pairwise Comparisons
por: Rezaei, MohammadHossein, et al.
Publicado: (2025)
por: Rezaei, MohammadHossein, et al.
Publicado: (2025)
Continuum-armed Bandit Optimization with Batch Pairwise Comparison Oracles
por: Chang, Xiangyu, et al.
Publicado: (2025)
por: Chang, Xiangyu, et al.
Publicado: (2025)
Pairwise Comparisons without Stochastic Transitivity: Model, Theory and Applications
por: Lee, Sze Ming, et al.
Publicado: (2025)
por: Lee, Sze Ming, et al.
Publicado: (2025)
Optimal Differentially Private Ranking from Pairwise Comparisons
por: Cai, T. Tony, et al.
Publicado: (2025)
por: Cai, T. Tony, et al.
Publicado: (2025)
Learning Linear Utility Functions From Pairwise Comparison Queries
por: Ge, Luise, et al.
Publicado: (2024)
por: Ge, Luise, et al.
Publicado: (2024)
A Unifying Framework for Unsupervised Concept Extraction
por: Squires, Chandler, et al.
Publicado: (2026)
por: Squires, Chandler, et al.
Publicado: (2026)
Stochastic global optimization of continuous functions via random walks on Grassmannians
por: Gupta, Kartik, et al.
Publicado: (2026)
por: Gupta, Kartik, et al.
Publicado: (2026)
Efficient Bayesian Inference from Noisy Pairwise Comparisons
por: Aczel, Till, et al.
Publicado: (2025)
por: Aczel, Till, et al.
Publicado: (2025)
Ejemplares similares
-
Reward Learning from Best-of-$N$ Preference Data: Targets, Tradeoffs, and Design Principles
por: Pukdee, Rattana, et al.
Publicado: (2026) -
Spectrally Transformed Kernel Regression
por: Zhai, Runtian, et al.
Publicado: (2024) -
Learning from Interval Targets
por: Pukdee, Rattana, et al.
Publicado: (2025) -
Learning accurate and interpretable tree-based models
por: Balcan, Maria-Florina, et al.
Publicado: (2024) -
New Guarantees for Learning Revenue Maximizing Menus of Lotteries and Two-Part Tariffs
por: Balcan, Maria-Florina, et al.
Publicado: (2023)