Deep Bayesian Active Learning for Preference Modeling in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Melo, Luckeciano C., Tigas, Panagiotis, Abate, Alessandro, Gal, Yarin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Temporal-Difference Variational Continual Learning
por: Melo, Luckeciano C., et al.
Publicado: (2024)
por: Melo, Luckeciano C., et al.
Publicado: (2024)
Stabilizing Policy Gradients for Sample-Efficient Reinforcement Learning in LLM Reasoning
por: Melo, Luckeciano C., et al.
Publicado: (2025)
por: Melo, Luckeciano C., et al.
Publicado: (2025)
Iterative Deployment Improves Planning Skills in LLMs
por: Corrêa, Augusto B., et al.
Publicado: (2025)
por: Corrêa, Augusto B., et al.
Publicado: (2025)
Fine-Tuning Large Language Models to Appropriately Abstain with Semantic Entropy
por: Tjandra, Benedict Aaron, et al.
Publicado: (2024)
por: Tjandra, Benedict Aaron, et al.
Publicado: (2024)
Active Preference Learning for Large Language Models
por: Muldrew, William, et al.
Publicado: (2024)
por: Muldrew, William, et al.
Publicado: (2024)
In-Context Learning Learns Label Relationships but Is Not Conventional Learning
por: Kossen, Jannik, et al.
Publicado: (2023)
por: Kossen, Jannik, et al.
Publicado: (2023)
Uncertainty-Aware Step-wise Verification with Generative Reward Models
por: Ye, Zihuiwen, et al.
Publicado: (2025)
por: Ye, Zihuiwen, et al.
Publicado: (2025)
Challenges and Considerations in the Evaluation of Bayesian Causal Discovery
por: Mamaghan, Amir Mohammad Karimi, et al.
Publicado: (2024)
por: Mamaghan, Amir Mohammad Karimi, et al.
Publicado: (2024)
Existing Large Language Model Unlearning Evaluations Are Inconclusive
por: Feng, Zhili, et al.
Publicado: (2025)
por: Feng, Zhili, et al.
Publicado: (2025)
Amortized Active Causal Induction with Deep Reinforcement Learning
por: Annadani, Yashas, et al.
Publicado: (2024)
por: Annadani, Yashas, et al.
Publicado: (2024)
MAPLE: A Framework for Active Preference Learning Guided by Large Language Models
por: Mahmud, Saaduddin, et al.
Publicado: (2024)
por: Mahmud, Saaduddin, et al.
Publicado: (2024)
Bayesian Preference Elicitation with Language Models
por: Handa, Kunal, et al.
Publicado: (2024)
por: Handa, Kunal, et al.
Publicado: (2024)
Evaluating & Reducing Deceptive Dialogue From Language Models with Multi-turn RL
por: Abdulhai, Marwa, et al.
Publicado: (2025)
por: Abdulhai, Marwa, et al.
Publicado: (2025)
Kernel Language Entropy: Fine-grained Uncertainty Quantification for LLMs from Semantic Similarities
por: Nikitin, Alexander, et al.
Publicado: (2024)
por: Nikitin, Alexander, et al.
Publicado: (2024)
Do Multilingual LLMs Think In English?
por: Schut, Lisa, et al.
Publicado: (2025)
por: Schut, Lisa, et al.
Publicado: (2025)
Active Model Selection for Large Language Models
por: Durmazkeser, Yavuz, et al.
Publicado: (2025)
por: Durmazkeser, Yavuz, et al.
Publicado: (2025)
Bayesian Preference Learning for Test-Time Steerable Reward Models
por: Hong, Jiwoo, et al.
Publicado: (2026)
por: Hong, Jiwoo, et al.
Publicado: (2026)
InfoQuest: Evaluating Multi-Turn Dialogue Agents for Open-Ended Conversations with Hidden Context
por: de Oliveira, Bryan L. M., et al.
Publicado: (2025)
por: de Oliveira, Bryan L. M., et al.
Publicado: (2025)
Reducing Large Language Model Safety Risks in Women's Health using Semantic Entropy
por: Penny-Dimri, Jahan C., et al.
Publicado: (2025)
por: Penny-Dimri, Jahan C., et al.
Publicado: (2025)
Multi-Reference Preference Optimization for Large Language Models
por: Le, Hung, et al.
Publicado: (2024)
por: Le, Hung, et al.
Publicado: (2024)
Improving Context-Aware Preference Modeling for Language Models
por: Pitis, Silviu, et al.
Publicado: (2024)
por: Pitis, Silviu, et al.
Publicado: (2024)
Bayesian Mixture of Experts For Large Language Models
por: Dialameh, Maryam, et al.
Publicado: (2025)
por: Dialameh, Maryam, et al.
Publicado: (2025)
Active Preference Inference using Language Models and Probabilistic Reasoning
por: Piriyakulkij, Wasu Top, et al.
Publicado: (2023)
por: Piriyakulkij, Wasu Top, et al.
Publicado: (2023)
InfiFPO: Implicit Model Fusion via Preference Optimization in Large Language Models
por: Gu, Yanggan, et al.
Publicado: (2025)
por: Gu, Yanggan, et al.
Publicado: (2025)
Alternate Preference Optimization for Unlearning Factual Knowledge in Large Language Models
por: Mekala, Anmol, et al.
Publicado: (2024)
por: Mekala, Anmol, et al.
Publicado: (2024)
Scaling Up Active Testing to Large Language Models
por: Berrada, Gabrielle, et al.
Publicado: (2025)
por: Berrada, Gabrielle, et al.
Publicado: (2025)
Bayesian Evaluation of Large Language Model Behavior
por: Longjohn, Rachel, et al.
Publicado: (2025)
por: Longjohn, Rachel, et al.
Publicado: (2025)
Experimental Design for Active Transductive Inference in Large Language Models
por: Mukherjee, Subhojyoti, et al.
Publicado: (2024)
por: Mukherjee, Subhojyoti, et al.
Publicado: (2024)
ROPO: Robust Preference Optimization for Large Language Models
por: Liang, Xize, et al.
Publicado: (2024)
por: Liang, Xize, et al.
Publicado: (2024)
Accelerated Preference Optimization for Large Language Model Alignment
por: He, Jiafan, et al.
Publicado: (2024)
por: He, Jiafan, et al.
Publicado: (2024)
FedPDPO: Federated Personalized Direct Preference Optimization for Large Language Model Alignment
por: Zhu, Kewen, et al.
Publicado: (2026)
por: Zhu, Kewen, et al.
Publicado: (2026)
MADE: Benchmark Environments for Closed-Loop Materials Discovery
por: Malik, Shreshth A, et al.
Publicado: (2026)
por: Malik, Shreshth A, et al.
Publicado: (2026)
Federated Fine-Tuning of Large Language Models: Kahneman-Tversky vs. Direct Preference Optimization
por: Spadea, Fernando, et al.
Publicado: (2025)
por: Spadea, Fernando, et al.
Publicado: (2025)
Superscopes: Amplifying Internal Feature Representations for Language Model Interpretation
por: Jacobi, Jonathan, et al.
Publicado: (2025)
por: Jacobi, Jonathan, et al.
Publicado: (2025)
Language Model-Driven Data Pruning Enables Efficient Active Learning
por: Azeemi, Abdul Hameed, et al.
Publicado: (2024)
por: Azeemi, Abdul Hameed, et al.
Publicado: (2024)
Reviving The Classics: Active Reward Modeling in Large Language Model Alignment
por: Shen, Yunyi, et al.
Publicado: (2025)
por: Shen, Yunyi, et al.
Publicado: (2025)
The Curse of Recursion: Training on Generated Data Makes Models Forget
por: Shumailov, Ilia, et al.
Publicado: (2023)
por: Shumailov, Ilia, et al.
Publicado: (2023)
Personalized Steering of Large Language Models: Versatile Steering Vectors Through Bi-directional Preference Optimization
por: Cao, Yuanpu, et al.
Publicado: (2024)
por: Cao, Yuanpu, et al.
Publicado: (2024)
DiaTool-DPO: Multi-Turn Direct Preference Optimization for Tool-Augmented Large Language Models
por: Jung, Sunghee, et al.
Publicado: (2025)
por: Jung, Sunghee, et al.
Publicado: (2025)
Semantic Entropy Probes: Robust and Cheap Hallucination Detection in LLMs
por: Kossen, Jannik, et al.
Publicado: (2024)
por: Kossen, Jannik, et al.
Publicado: (2024)
Ejemplares similares
-
Temporal-Difference Variational Continual Learning
por: Melo, Luckeciano C., et al.
Publicado: (2024) -
Stabilizing Policy Gradients for Sample-Efficient Reinforcement Learning in LLM Reasoning
por: Melo, Luckeciano C., et al.
Publicado: (2025) -
Iterative Deployment Improves Planning Skills in LLMs
por: Corrêa, Augusto B., et al.
Publicado: (2025) -
Fine-Tuning Large Language Models to Appropriately Abstain with Semantic Entropy
por: Tjandra, Benedict Aaron, et al.
Publicado: (2024) -
Active Preference Learning for Large Language Models
por: Muldrew, William, et al.
Publicado: (2024)