MAPLE: A Framework for Active Preference Learning Guided by Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Mahmud, Saaduddin, Nakamura, Mason, Zilberstein, Shlomo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Inference-Aware Prompt Optimization for Aligning Black-Box Large Language Models
di: Mahmud, Saaduddin, et al.
Pubblicazione: (2025)
di: Mahmud, Saaduddin, et al.
Pubblicazione: (2025)
Aligning LLMs on a Budget: Inference-Time Alignment with Heuristic Reward Models
di: Nakamura, Mason, et al.
Pubblicazione: (2025)
di: Nakamura, Mason, et al.
Pubblicazione: (2025)
Distributed Multi-Agent Coordination Using Multi-Modal Foundation Models
di: Mahmud, Saaduddin, et al.
Pubblicazione: (2025)
di: Mahmud, Saaduddin, et al.
Pubblicazione: (2025)
Terrarium: Revisiting the Blackboard for Multi-Agent Safety, Privacy, and Security Studies
di: Nakamura, Mason, et al.
Pubblicazione: (2025)
di: Nakamura, Mason, et al.
Pubblicazione: (2025)
Colosseum: Auditing Collusion in Cooperative Multi-Agent Systems
di: Nakamura, Mason, et al.
Pubblicazione: (2026)
di: Nakamura, Mason, et al.
Pubblicazione: (2026)
Verification Required: The Impact of Information Credibility on AI Persuasion
di: Mahmud, Saaduddin, et al.
Pubblicazione: (2026)
di: Mahmud, Saaduddin, et al.
Pubblicazione: (2026)
Active Preference Learning for Large Language Models
di: Muldrew, William, et al.
Pubblicazione: (2024)
di: Muldrew, William, et al.
Pubblicazione: (2024)
MAPLE: Metadata Augmented Private Language Evolution
di: Chien, Eli, et al.
Pubblicazione: (2026)
di: Chien, Eli, et al.
Pubblicazione: (2026)
MAPLE: Micro Analysis of Pairwise Language Evolution for Few-Shot Claim Verification
di: Zeng, Xia, et al.
Pubblicazione: (2024)
di: Zeng, Xia, et al.
Pubblicazione: (2024)
Active Preference Inference using Language Models and Probabilistic Reasoning
di: Piriyakulkij, Wasu Top, et al.
Pubblicazione: (2023)
di: Piriyakulkij, Wasu Top, et al.
Pubblicazione: (2023)
ROPO: Robust Preference Optimization for Large Language Models
di: Liang, Xize, et al.
Pubblicazione: (2024)
di: Liang, Xize, et al.
Pubblicazione: (2024)
Accelerated Preference Optimization for Large Language Model Alignment
di: He, Jiafan, et al.
Pubblicazione: (2024)
di: He, Jiafan, et al.
Pubblicazione: (2024)
ActiveUltraFeedback: Efficient Preference Data Generation using Active Learning
di: Melikidze, Davit, et al.
Pubblicazione: (2026)
di: Melikidze, Davit, et al.
Pubblicazione: (2026)
Group Preference Optimization: Few-Shot Alignment of Large Language Models
di: Zhao, Siyan, et al.
Pubblicazione: (2023)
di: Zhao, Siyan, et al.
Pubblicazione: (2023)
Sequence-level Large Language Model Training with Contrastive Preference Optimization
di: Feng, Zhili, et al.
Pubblicazione: (2025)
di: Feng, Zhili, et al.
Pubblicazione: (2025)
Reviving The Classics: Active Reward Modeling in Large Language Model Alignment
di: Shen, Yunyi, et al.
Pubblicazione: (2025)
di: Shen, Yunyi, et al.
Pubblicazione: (2025)
AMPO: Active Multi-Preference Optimization for Self-play Preference Selection
di: Gupta, Taneesh, et al.
Pubblicazione: (2025)
di: Gupta, Taneesh, et al.
Pubblicazione: (2025)
LAMPO: Large Language Models as Preference Machines for Few-shot Ordinal Classification
di: Qin, Zhen, et al.
Pubblicazione: (2024)
di: Qin, Zhen, et al.
Pubblicazione: (2024)
Aligning with Human Judgement: The Role of Pairwise Preference in Large Language Model Evaluators
di: Liu, Yinhong, et al.
Pubblicazione: (2024)
di: Liu, Yinhong, et al.
Pubblicazione: (2024)
Mitigating Hallucinated Translations in Large Language Models with Hallucination-focused Preference Optimization
di: Tang, Zilu, et al.
Pubblicazione: (2025)
di: Tang, Zilu, et al.
Pubblicazione: (2025)
Peering Through Preferences: Unraveling Feedback Acquisition for Aligning Large Language Models
di: Bansal, Hritik, et al.
Pubblicazione: (2023)
di: Bansal, Hritik, et al.
Pubblicazione: (2023)
Is Active Persona Inference Necessary for Aligning Small Models to Personal Preferences?
di: Tang, Zilu, et al.
Pubblicazione: (2025)
di: Tang, Zilu, et al.
Pubblicazione: (2025)
Publication Trend Analysis and Synthesis via Large Language Model: A Case Study of Engineering in PNAS
di: Smetana, Mason, et al.
Pubblicazione: (2025)
di: Smetana, Mason, et al.
Pubblicazione: (2025)
BAPO: Base-Anchored Preference Optimization for Overcoming Forgetting in Large Language Models Personalization
di: Lee, Gihun, et al.
Pubblicazione: (2024)
di: Lee, Gihun, et al.
Pubblicazione: (2024)
Active Preference Optimization for Sample Efficient RLHF
di: Das, Nirjhar, et al.
Pubblicazione: (2024)
di: Das, Nirjhar, et al.
Pubblicazione: (2024)
RL$^3$: Boosting Meta Reinforcement Learning via RL inside RL$^2$
di: Bhatia, Abhinav, et al.
Pubblicazione: (2023)
di: Bhatia, Abhinav, et al.
Pubblicazione: (2023)
Active Layer-Contrastive Decoding Reduces Hallucination in Large Language Model Generation
di: Zhang, Hongxiang, et al.
Pubblicazione: (2025)
di: Zhang, Hongxiang, et al.
Pubblicazione: (2025)
LifeAlign: Lifelong Alignment for Large Language Models with Memory-Augmented Focalized Preference Optimization
di: Li, Junsong, et al.
Pubblicazione: (2025)
di: Li, Junsong, et al.
Pubblicazione: (2025)
AttriLens-Mol: Attribute Guided Reinforcement Learning for Molecular Property Prediction with Large Language Models
di: Lin, Xuan, et al.
Pubblicazione: (2025)
di: Lin, Xuan, et al.
Pubblicazione: (2025)
Improving Context-Aware Preference Modeling for Language Models
di: Pitis, Silviu, et al.
Pubblicazione: (2024)
di: Pitis, Silviu, et al.
Pubblicazione: (2024)
Interpretable Steering of Large Language Models with Feature Guided Activation Additions
di: Soo, Samuel, et al.
Pubblicazione: (2025)
di: Soo, Samuel, et al.
Pubblicazione: (2025)
Graph Elicitation for Guiding Multi-Step Reasoning in Large Language Models
di: Park, Jinyoung, et al.
Pubblicazione: (2023)
di: Park, Jinyoung, et al.
Pubblicazione: (2023)
Learning to Detect Language Model Training Data via Active Reconstruction
di: Yin, Junjie Oscar, et al.
Pubblicazione: (2026)
di: Yin, Junjie Oscar, et al.
Pubblicazione: (2026)
Fine-tuning Large Language Models with Limited Data: A Survey and Practical Guide
di: Szep, Marton, et al.
Pubblicazione: (2024)
di: Szep, Marton, et al.
Pubblicazione: (2024)
Comparing Bad Apples to Good Oranges: Aligning Large Language Models via Joint Preference Optimization
di: Bansal, Hritik, et al.
Pubblicazione: (2024)
di: Bansal, Hritik, et al.
Pubblicazione: (2024)
Understanding Understanding: A Pragmatic Framework Motivated by Large Language Models
di: Leyton-Brown, Kevin, et al.
Pubblicazione: (2024)
di: Leyton-Brown, Kevin, et al.
Pubblicazione: (2024)
Lightweight Safety Classification Using Pruned Language Models
di: Sawtell, Mason, et al.
Pubblicazione: (2024)
di: Sawtell, Mason, et al.
Pubblicazione: (2024)
Fairer Preferences Elicit Improved Human-Aligned Large Language Model Judgments
di: Zhou, Han, et al.
Pubblicazione: (2024)
di: Zhou, Han, et al.
Pubblicazione: (2024)
Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment
di: Zhang, Yifan, et al.
Pubblicazione: (2024)
di: Zhang, Yifan, et al.
Pubblicazione: (2024)
Preference Learning Algorithms Do Not Learn Preference Rankings
di: Chen, Angelica, et al.
Pubblicazione: (2024)
di: Chen, Angelica, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Inference-Aware Prompt Optimization for Aligning Black-Box Large Language Models
di: Mahmud, Saaduddin, et al.
Pubblicazione: (2025) -
Aligning LLMs on a Budget: Inference-Time Alignment with Heuristic Reward Models
di: Nakamura, Mason, et al.
Pubblicazione: (2025) -
Distributed Multi-Agent Coordination Using Multi-Modal Foundation Models
di: Mahmud, Saaduddin, et al.
Pubblicazione: (2025) -
Terrarium: Revisiting the Blackboard for Multi-Agent Safety, Privacy, and Security Studies
di: Nakamura, Mason, et al.
Pubblicazione: (2025) -
Colosseum: Auditing Collusion in Cooperative Multi-Agent Systems
di: Nakamura, Mason, et al.
Pubblicazione: (2026)