Active Query Synthesis for Preference Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Nadagouda, Namrata, Ahad, Nauman, Tucker, Maegan, Davenport, Mark A. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Automata Learning from Preference and Equivalence Queries
di: Hsiung, Eric, et al.
Pubblicazione: (2023)
di: Hsiung, Eric, et al.
Pubblicazione: (2023)
Active Learning of General Halfspaces: Label Queries vs Membership Queries
di: Diakonikolas, Ilias, et al.
Pubblicazione: (2024)
di: Diakonikolas, Ilias, et al.
Pubblicazione: (2024)
Query-Policy Misalignment in Preference-Based Reinforcement Learning
di: Hu, Xiao, et al.
Pubblicazione: (2023)
di: Hu, Xiao, et al.
Pubblicazione: (2023)
Active Learning for Direct Preference Optimization
di: Kveton, Branislav, et al.
Pubblicazione: (2025)
di: Kveton, Branislav, et al.
Pubblicazione: (2025)
SGD Jittering: A Training Strategy for Robust and Accurate Model-Based Architectures
di: Guan, Peimeng, et al.
Pubblicazione: (2024)
di: Guan, Peimeng, et al.
Pubblicazione: (2024)
CLARIFY: Contrastive Preference Reinforcement Learning for Untangling Ambiguous Queries
di: Mu, Ni, et al.
Pubblicazione: (2025)
di: Mu, Ni, et al.
Pubblicazione: (2025)
Active Query Selection for Crowd-Based Reinforcement Learning
di: Erskine, Jonathan, et al.
Pubblicazione: (2025)
di: Erskine, Jonathan, et al.
Pubblicazione: (2025)
Preferential Multi-Objective Bayesian Optimization
di: Astudillo, Raul, et al.
Pubblicazione: (2024)
di: Astudillo, Raul, et al.
Pubblicazione: (2024)
Reward-Conditioned Reinforcement Learning
di: Nauman, Michal, et al.
Pubblicazione: (2026)
di: Nauman, Michal, et al.
Pubblicazione: (2026)
Offline Clustering of Preference Learning with Active-data Augmentation
di: Liu, Jingyuan, et al.
Pubblicazione: (2025)
di: Liu, Jingyuan, et al.
Pubblicazione: (2025)
Active Preference Learning for Ordering Items In- and Out-of-sample
di: Bergström, Herman, et al.
Pubblicazione: (2024)
di: Bergström, Herman, et al.
Pubblicazione: (2024)
Cumulative Meta-Learning from Active Learning Queries for Robustness to Spurious Correlations
di: Chew, Kin Whye, et al.
Pubblicazione: (2026)
di: Chew, Kin Whye, et al.
Pubblicazione: (2026)
Conformal confidence sets for biomedical image segmentation
di: Davenport, Samuel
Pubblicazione: (2024)
di: Davenport, Samuel
Pubblicazione: (2024)
AutoAL: Automated Active Learning with Differentiable Query Strategy Search
di: Wang, Yifeng, et al.
Pubblicazione: (2024)
di: Wang, Yifeng, et al.
Pubblicazione: (2024)
Cold-Start Active Preference Learning in Socio-Economic Domains
di: Fayaz-Bakhsh, Mojtaba, et al.
Pubblicazione: (2025)
di: Fayaz-Bakhsh, Mojtaba, et al.
Pubblicazione: (2025)
Comparison-based Active Preference Learning for Multi-dimensional Personalization
di: Oh, Minhyeon, et al.
Pubblicazione: (2024)
di: Oh, Minhyeon, et al.
Pubblicazione: (2024)
Learning Formal Specifications from Membership and Preference Queries
di: Shah, Ameesh, et al.
Pubblicazione: (2023)
di: Shah, Ameesh, et al.
Pubblicazione: (2023)
On the Theory of Risk-Aware Agents: Bridging Actor-Critic and Economics
di: Nauman, Michal, et al.
Pubblicazione: (2023)
di: Nauman, Michal, et al.
Pubblicazione: (2023)
Low-rank matrix completion and denoising under Poisson noise
di: McRae, Andrew D., et al.
Pubblicazione: (2019)
di: McRae, Andrew D., et al.
Pubblicazione: (2019)
Active Value Querying to Minimize Additive Error in Subadditive Set Function Learning
di: Černý, Martin, et al.
Pubblicazione: (2026)
di: Černý, Martin, et al.
Pubblicazione: (2026)
Fast and Sample Efficient Multi-Task Representation Learning in Stochastic Contextual Bandits
di: Lin, Jiabin, et al.
Pubblicazione: (2024)
di: Lin, Jiabin, et al.
Pubblicazione: (2024)
Nearly Optimal Active Preference Learning and Its Application to LLM Alignment
di: Zhao, Yao, et al.
Pubblicazione: (2026)
di: Zhao, Yao, et al.
Pubblicazione: (2026)
Querying Easily Flip-flopped Samples for Deep Active Learning
di: Cho, Seong Jin, et al.
Pubblicazione: (2024)
di: Cho, Seong Jin, et al.
Pubblicazione: (2024)
What Does Flow Matching Bring To TD Learning?
di: Agrawalla, Bhavya, et al.
Pubblicazione: (2026)
di: Agrawalla, Bhavya, et al.
Pubblicazione: (2026)
AltGDmin: Alternating GD and Minimization for Partly-Decoupled (Federated) Optimization
di: Vaswani, Namrata
Pubblicazione: (2025)
di: Vaswani, Namrata
Pubblicazione: (2025)
Active Preference Learning for Large Language Models
di: Muldrew, William, et al.
Pubblicazione: (2024)
di: Muldrew, William, et al.
Pubblicazione: (2024)
Inference-Time Personalized Alignment with a Few User Preference Queries
di: Pădurean, Victor-Alexandru, et al.
Pubblicazione: (2025)
di: Pădurean, Victor-Alexandru, et al.
Pubblicazione: (2025)
Sharpe Ratio-Guided Active Learning for Preference Optimization in RLHF
di: Belakaria, Syrine, et al.
Pubblicazione: (2025)
di: Belakaria, Syrine, et al.
Pubblicazione: (2025)
Efficient Training of Deep Networks using Guided Spectral Data Selection: A Step Toward Learning What You Need
di: Sharifi, Mohammadreza, et al.
Pubblicazione: (2025)
di: Sharifi, Mohammadreza, et al.
Pubblicazione: (2025)
ActiveUltraFeedback: Efficient Preference Data Generation using Active Learning
di: Melikidze, Davit, et al.
Pubblicazione: (2026)
di: Melikidze, Davit, et al.
Pubblicazione: (2026)
Optimizing Algorithms for Mobile Health Interventions with Active Querying Optimization
di: Rawashdeh, Aseel
Pubblicazione: (2025)
di: Rawashdeh, Aseel
Pubblicazione: (2025)
LORE: Jointly Learning the Intrinsic Dimensionality and Relative Similarity Structure From Ordinal Data
di: Anand, Vivek, et al.
Pubblicazione: (2026)
di: Anand, Vivek, et al.
Pubblicazione: (2026)
Enhancing Cost Efficiency in Active Learning with Candidate Set Query
di: Gwon, Yeho, et al.
Pubblicazione: (2025)
di: Gwon, Yeho, et al.
Pubblicazione: (2025)
Deep Bayesian Active Learning for Preference Modeling in Large Language Models
di: Melo, Luckeciano C., et al.
Pubblicazione: (2024)
di: Melo, Luckeciano C., et al.
Pubblicazione: (2024)
Batch Active Learning of Reward Functions from Human Preferences
di: Bıyık, Erdem, et al.
Pubblicazione: (2024)
di: Bıyık, Erdem, et al.
Pubblicazione: (2024)
Solving Inverse Problems with Model Mismatch using Untrained Neural Networks within Model-based Architectures
di: Guan, Peimeng, et al.
Pubblicazione: (2024)
di: Guan, Peimeng, et al.
Pubblicazione: (2024)
A Deep Positive-Negative Prototype Approach to Integrated Prototypical Discriminative Learning
di: Zarei-Sabzevar, Ramin, et al.
Pubblicazione: (2025)
di: Zarei-Sabzevar, Ramin, et al.
Pubblicazione: (2025)
DynaSTy: A Framework for SpatioTemporal Node Attribute Prediction in Dynamic Graphs
di: Banerji, Namrata, et al.
Pubblicazione: (2026)
di: Banerji, Namrata, et al.
Pubblicazione: (2026)
A Case for Validation Buffer in Pessimistic Actor-Critic
di: Nauman, Michal, et al.
Pubblicazione: (2024)
di: Nauman, Michal, et al.
Pubblicazione: (2024)
Reinforcement Learning from Human Feedback with Active Queries
di: Ji, Kaixuan, et al.
Pubblicazione: (2024)
di: Ji, Kaixuan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Automata Learning from Preference and Equivalence Queries
di: Hsiung, Eric, et al.
Pubblicazione: (2023) -
Active Learning of General Halfspaces: Label Queries vs Membership Queries
di: Diakonikolas, Ilias, et al.
Pubblicazione: (2024) -
Query-Policy Misalignment in Preference-Based Reinforcement Learning
di: Hu, Xiao, et al.
Pubblicazione: (2023) -
Active Learning for Direct Preference Optimization
di: Kveton, Branislav, et al.
Pubblicazione: (2025) -
SGD Jittering: A Training Strategy for Robust and Accurate Model-Based Architectures
di: Guan, Peimeng, et al.
Pubblicazione: (2024)