LAMPO: Large Language Models as Preference Machines for Few-shot Ordinal Classification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qin, Zhen, Wu, Junru, Shen, Jiaming, Liu, Tianqi, Wang, Xuanhui |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Large Language Models are Effective Text Rankers with Pairwise Ranking Prompting
par: Qin, Zhen, et autres
Publié: (2023)
par: Qin, Zhen, et autres
Publié: (2023)
LiPO: Listwise Preference Optimization through Learning-to-Rank
par: Liu, Tianqi, et autres
Publié: (2024)
par: Liu, Tianqi, et autres
Publié: (2024)
Group Preference Optimization: Few-Shot Alignment of Large Language Models
par: Zhao, Siyan, et autres
Publié: (2023)
par: Zhao, Siyan, et autres
Publié: (2023)
A Zero-shot and Few-shot Study of Instruction-Finetuned Large Language Models Applied to Clinical and Biomedical Tasks
par: Labrak, Yanis, et autres
Publié: (2023)
par: Labrak, Yanis, et autres
Publié: (2023)
PLaD: Preference-based Large Language Model Distillation with Pseudo-Preference Pairs
par: Zhang, Rongzhi, et autres
Publié: (2024)
par: Zhang, Rongzhi, et autres
Publié: (2024)
ROPO: Robust Preference Optimization for Large Language Models
par: Liang, Xize, et autres
Publié: (2024)
par: Liang, Xize, et autres
Publié: (2024)
Federated Data-Efficient Instruction Tuning for Large Language Models
par: Qin, Zhen, et autres
Publié: (2024)
par: Qin, Zhen, et autres
Publié: (2024)
Pre-trained Language Models Improve the Few-shot Prompt Ability of Decision Transformer
par: Yang, Yu, et autres
Publié: (2024)
par: Yang, Yu, et autres
Publié: (2024)
Revisiting Chain-of-Thought Prompting: Zero-shot Can Be Stronger than Few-shot
par: Cheng, Xiang, et autres
Publié: (2025)
par: Cheng, Xiang, et autres
Publié: (2025)
Bridging the Gap Between Preference Alignment and Machine Unlearning
par: Feng, Xiaohua, et autres
Publié: (2025)
par: Feng, Xiaohua, et autres
Publié: (2025)
Reward Modeling with Ordinal Feedback: Wisdom of the Crowd
par: Liu, Shang, et autres
Publié: (2024)
par: Liu, Shang, et autres
Publié: (2024)
Active Preference Learning for Large Language Models
par: Muldrew, William, et autres
Publié: (2024)
par: Muldrew, William, et autres
Publié: (2024)
ICPL: Few-shot In-context Preference Learning via LLMs
par: Yu, Chao, et autres
Publié: (2024)
par: Yu, Chao, et autres
Publié: (2024)
Accelerated Preference Optimization for Large Language Model Alignment
par: He, Jiafan, et autres
Publié: (2024)
par: He, Jiafan, et autres
Publié: (2024)
Few-shot Personalization of LLMs with Mis-aligned Responses
par: Kim, Jaehyung, et autres
Publié: (2024)
par: Kim, Jaehyung, et autres
Publié: (2024)
ALPET: Active Few-shot Learning for Citation Worthiness Detection in Low-Resource Wikipedia Languages
par: Halitaj, Aida, et autres
Publié: (2025)
par: Halitaj, Aida, et autres
Publié: (2025)
Large Language Models are Few-shot Multivariate Time Series Classifiers
par: Chen, Yakun, et autres
Publié: (2025)
par: Chen, Yakun, et autres
Publié: (2025)
LifeAlign: Lifelong Alignment for Large Language Models with Memory-Augmented Focalized Preference Optimization
par: Li, Junsong, et autres
Publié: (2025)
par: Li, Junsong, et autres
Publié: (2025)
Chem-FINESE: Validating Fine-Grained Few-shot Entity Extraction through Text Reconstruction
par: Wang, Qingyun, et autres
Publié: (2024)
par: Wang, Qingyun, et autres
Publié: (2024)
Aligning with Human Judgement: The Role of Pairwise Preference in Large Language Model Evaluators
par: Liu, Yinhong, et autres
Publié: (2024)
par: Liu, Yinhong, et autres
Publié: (2024)
ZeroUnlearn: Few-Shot Knowledge Unlearning in Large Language Models
par: Lin, Yujie, et autres
Publié: (2026)
par: Lin, Yujie, et autres
Publié: (2026)
Structured Agent Distillation for Large Language Model
par: Liu, Jun, et autres
Publié: (2025)
par: Liu, Jun, et autres
Publié: (2025)
Few-Shot Cross-Lingual Transfer for Prompting Large Language Models in Low-Resource Languages
par: Toukmaji, Christopher
Publié: (2024)
par: Toukmaji, Christopher
Publié: (2024)
Sequence-level Large Language Model Training with Contrastive Preference Optimization
par: Feng, Zhili, et autres
Publié: (2025)
par: Feng, Zhili, et autres
Publié: (2025)
Large Language Models Synergize with Automated Machine Learning
par: Xu, Jinglue, et autres
Publié: (2024)
par: Xu, Jinglue, et autres
Publié: (2024)
Large Language Model Post-Training: A Unified View of Off-Policy and On-Policy Learning
par: Zhao, Shiwan, et autres
Publié: (2026)
par: Zhao, Shiwan, et autres
Publié: (2026)
Fast Large Language Model Collaborative Decoding via Speculation
par: Fu, Jiale, et autres
Publié: (2025)
par: Fu, Jiale, et autres
Publié: (2025)
Few-Shot Recalibration of Language Models
par: Li, Xiang Lisa, et autres
Publié: (2024)
par: Li, Xiang Lisa, et autres
Publié: (2024)
Towards Data-Centric RLHF: Simple Metrics for Preference Dataset Comparison
par: Shen, Judy Hanwen, et autres
Publié: (2024)
par: Shen, Judy Hanwen, et autres
Publié: (2024)
Label-free Node Classification on Graphs with Large Language Models (LLMS)
par: Chen, Zhikai, et autres
Publié: (2023)
par: Chen, Zhikai, et autres
Publié: (2023)
Self-Play Preference Optimization for Language Model Alignment
par: Wu, Yue, et autres
Publié: (2024)
par: Wu, Yue, et autres
Publié: (2024)
Mitigating Hallucinated Translations in Large Language Models with Hallucination-focused Preference Optimization
par: Tang, Zilu, et autres
Publié: (2025)
par: Tang, Zilu, et autres
Publié: (2025)
MAPLE: A Framework for Active Preference Learning Guided by Large Language Models
par: Mahmud, Saaduddin, et autres
Publié: (2024)
par: Mahmud, Saaduddin, et autres
Publié: (2024)
Peering Through Preferences: Unraveling Feedback Acquisition for Aligning Large Language Models
par: Bansal, Hritik, et autres
Publié: (2023)
par: Bansal, Hritik, et autres
Publié: (2023)
Towards Robust Alignment of Language Models: Distributionally Robustifying Direct Preference Optimization
par: Wu, Junkang, et autres
Publié: (2024)
par: Wu, Junkang, et autres
Publié: (2024)
SPIN: Sparsifying and Integrating Internal Neurons in Large Language Models for Text Classification
par: Jiao, Difan, et autres
Publié: (2023)
par: Jiao, Difan, et autres
Publié: (2023)
GEM: Generative Entropy-Guided Preference Modeling for Few-shot Alignment of LLMs
par: Zhao, Yiyang, et autres
Publié: (2025)
par: Zhao, Yiyang, et autres
Publié: (2025)
TableTime: Reformulating Time Series Classification as Training-Free Table Understanding with Large Language Models
par: Wang, Jiahao, et autres
Publié: (2024)
par: Wang, Jiahao, et autres
Publié: (2024)
CogGPT: Unleashing the Power of Cognitive Dynamics on Large Language Models
par: Lv, Yaojia, et autres
Publié: (2024)
par: Lv, Yaojia, et autres
Publié: (2024)
BAPO: Base-Anchored Preference Optimization for Overcoming Forgetting in Large Language Models Personalization
par: Lee, Gihun, et autres
Publié: (2024)
par: Lee, Gihun, et autres
Publié: (2024)
Documents similaires
-
Large Language Models are Effective Text Rankers with Pairwise Ranking Prompting
par: Qin, Zhen, et autres
Publié: (2023) -
LiPO: Listwise Preference Optimization through Learning-to-Rank
par: Liu, Tianqi, et autres
Publié: (2024) -
Group Preference Optimization: Few-Shot Alignment of Large Language Models
par: Zhao, Siyan, et autres
Publié: (2023) -
A Zero-shot and Few-shot Study of Instruction-Finetuned Large Language Models Applied to Clinical and Biomedical Tasks
par: Labrak, Yanis, et autres
Publié: (2023) -
PLaD: Preference-based Large Language Model Distillation with Pseudo-Preference Pairs
par: Zhang, Rongzhi, et autres
Publié: (2024)