A Survey on Human Preference Learning for Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Jiang, Ruili, Chen, Kehai, Bai, Xuefeng, He, Zhixuan, Li, Juntao, Yang, Muyun, Zhao, Tiejun, Nie, Liqiang, Zhang, Min |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Beyond Token-Level Policy Gradients for Complex Reasoning with Large Language Models
von: Xu, Mufan, et al.
Veröffentlicht: (2026)
von: Xu, Mufan, et al.
Veröffentlicht: (2026)
DUAL-REFLECT: Enhancing Large Language Models for Reflective Translation through Dual Learning Feedback Mechanisms
von: Chen, Andong, et al.
Veröffentlicht: (2024)
von: Chen, Andong, et al.
Veröffentlicht: (2024)
Efficient Safety Alignment of Large Language Models via Preference Re-ranking and Representation-based Reward Modeling
von: Deng, Qiyuan, et al.
Veröffentlicht: (2025)
von: Deng, Qiyuan, et al.
Veröffentlicht: (2025)
Large Language Models for Classical Chinese Poetry Translation: Benchmarking, Evaluating, and Improving
von: Chen, Andong, et al.
Veröffentlicht: (2024)
von: Chen, Andong, et al.
Veröffentlicht: (2024)
LLM-based Discriminative Reasoning for Knowledge Graph Question Answering
von: Xu, Mufan, et al.
Veröffentlicht: (2024)
von: Xu, Mufan, et al.
Veröffentlicht: (2024)
The Power of Personality: A Human Simulation Perspective to Investigate Large Language Model Agents
von: Duan, Yifan, et al.
Veröffentlicht: (2025)
von: Duan, Yifan, et al.
Veröffentlicht: (2025)
LLM-based Translation Inference with Iterative Bilingual Understanding
von: Chen, Andong, et al.
Veröffentlicht: (2024)
von: Chen, Andong, et al.
Veröffentlicht: (2024)
Make Imagination Clearer! Stable Diffusion-based Visual Imagination for Multimodal Machine Translation
von: Chen, Andong, et al.
Veröffentlicht: (2024)
von: Chen, Andong, et al.
Veröffentlicht: (2024)
Evaluating and Steering Modality Preferences in Multimodal Large Language Model
von: Zhang, Yu, et al.
Veröffentlicht: (2025)
von: Zhang, Yu, et al.
Veröffentlicht: (2025)
Agentic Tool Use in Large Language Models
von: Hu, Jinchao, et al.
Veröffentlicht: (2026)
von: Hu, Jinchao, et al.
Veröffentlicht: (2026)
Exploring the Translation Mechanism of Large Language Models
von: Zhang, Hongbin, et al.
Veröffentlicht: (2025)
von: Zhang, Hongbin, et al.
Veröffentlicht: (2025)
XIFBench: Evaluating Large Language Models on Multilingual Instruction Following
von: Li, Zhenyu, et al.
Veröffentlicht: (2025)
von: Li, Zhenyu, et al.
Veröffentlicht: (2025)
Paying More Attention to Source Context: Mitigating Unfaithful Translations from Large Language Model
von: Zhang, Hongbin, et al.
Veröffentlicht: (2024)
von: Zhang, Hongbin, et al.
Veröffentlicht: (2024)
Thinking in Character: Advancing Role-Playing Agents with Role-Aware Reasoning
von: Tang, Yihong, et al.
Veröffentlicht: (2025)
von: Tang, Yihong, et al.
Veröffentlicht: (2025)
User-Aware Active Knowledge Acquisition for Emotional Support Dialogue
von: Xu, Mufan, et al.
Veröffentlicht: (2026)
von: Xu, Mufan, et al.
Veröffentlicht: (2026)
Look Before You Leap: Enhancing Attention and Vigilance Regarding Harmful Content with GuidelineLLM
von: Zhang, Shaoqing, et al.
Veröffentlicht: (2024)
von: Zhang, Shaoqing, et al.
Veröffentlicht: (2024)
Evaluating o1-Like LLMs: Unlocking Reasoning for Translation through Comprehensive Analysis
von: Chen, Andong, et al.
Veröffentlicht: (2025)
von: Chen, Andong, et al.
Veröffentlicht: (2025)
ORPP: Self-Optimizing Role-playing Prompts to Enhance Language Model Capabilities
von: Duan, Yifan, et al.
Veröffentlicht: (2025)
von: Duan, Yifan, et al.
Veröffentlicht: (2025)
TF-Attack: Transferable and Fast Adversarial Attacks on Large Language Models
von: Li, Zelin, et al.
Veröffentlicht: (2024)
von: Li, Zelin, et al.
Veröffentlicht: (2024)
Generator-Assistant Stepwise Rollback Framework for Large Language Model Agent
von: Li, Xingzuo, et al.
Veröffentlicht: (2025)
von: Li, Xingzuo, et al.
Veröffentlicht: (2025)
Benchmarking and Improving Large Vision-Language Models for Fundamental Visual Graph Understanding and Reasoning
von: Zhu, Yingjie, et al.
Veröffentlicht: (2024)
von: Zhu, Yingjie, et al.
Veröffentlicht: (2024)
Memory-augmented Query Reconstruction for LLM-based Knowledge Graph Reasoning
von: Xu, Mufan, et al.
Veröffentlicht: (2025)
von: Xu, Mufan, et al.
Veröffentlicht: (2025)
LinguaLIFT: An Effective Two-stage Instruction Tuning Framework for Low-Resource Language Reasoning
von: Zhang, Hongbin, et al.
Veröffentlicht: (2024)
von: Zhang, Hongbin, et al.
Veröffentlicht: (2024)
Evaluating and Improving Cultural Awareness of Reward Models for LLM Alignment
von: Zhang, Hongbin, et al.
Veröffentlicht: (2025)
von: Zhang, Hongbin, et al.
Veröffentlicht: (2025)
Multimodal Large Language Model-Enabled Video Translation: A Role-Oriented Survey
von: Qu, Bingzheng, et al.
Veröffentlicht: (2026)
von: Qu, Bingzheng, et al.
Veröffentlicht: (2026)
HITSZ's End-To-End Speech Translation Systems Combining Sequence-to-Sequence Auto Speech Recognition Model and Indic Large Language Model for IWSLT 2025 in Indic Track
von: Wei, Xuchen, et al.
Veröffentlicht: (2025)
von: Wei, Xuchen, et al.
Veröffentlicht: (2025)
Toward Robust LLM-Based Judges: Taxonomic Bias Evaluation and Debiasing Optimization
von: Zhou, Hongli, et al.
Veröffentlicht: (2026)
von: Zhou, Hongli, et al.
Veröffentlicht: (2026)
Lost in Benchmarks? Rethinking Large Language Model Benchmarking with Item Response Theory
von: Zhou, Hongli, et al.
Veröffentlicht: (2025)
von: Zhou, Hongli, et al.
Veröffentlicht: (2025)
Through the Lens of Character: Resolving Modality-Role Interference in Multimodal Role-Playing Agent
von: Tang, Yihong, et al.
Veröffentlicht: (2026)
von: Tang, Yihong, et al.
Veröffentlicht: (2026)
Self-Evaluation of Large Language Model based on Glass-box Features
von: Huang, Hui, et al.
Veröffentlicht: (2024)
von: Huang, Hui, et al.
Veröffentlicht: (2024)
Long-form RewardBench: Evaluating Reward Models for Long-form Generation
von: Huang, Hui, et al.
Veröffentlicht: (2026)
von: Huang, Hui, et al.
Veröffentlicht: (2026)
Culture In a Frame: C$^3$B as a Comic-Based Benchmark for Multimodal Culturally Awareness
von: Song, Yuchen, et al.
Veröffentlicht: (2025)
von: Song, Yuchen, et al.
Veröffentlicht: (2025)
Mitigating the Bias of Large Language Model Evaluation
von: Zhou, Hongli, et al.
Veröffentlicht: (2024)
von: Zhou, Hongli, et al.
Veröffentlicht: (2024)
PMoL: Parameter Efficient MoE for Preference Mixing of LLM Alignment
von: Liu, Dongxu, et al.
Veröffentlicht: (2024)
von: Liu, Dongxu, et al.
Veröffentlicht: (2024)
Beyond the Vision Encoder: Identifying and Mitigating Spatial Bias in Large Vision-Language Models
von: Zhu, Yingjie, et al.
Veröffentlicht: (2025)
von: Zhu, Yingjie, et al.
Veröffentlicht: (2025)
A Survey: Spatiotemporal Consistency in Video Generation
von: Yin, Zhiyu, et al.
Veröffentlicht: (2025)
von: Yin, Zhiyu, et al.
Veröffentlicht: (2025)
From Perception to Reasoning: Deep Thinking Empowers Multimodal Large Language Models
von: Zhu, Wenxin, et al.
Veröffentlicht: (2025)
von: Zhu, Wenxin, et al.
Veröffentlicht: (2025)
Question-guided Knowledge Graph Re-scoring and Injection for Knowledge Graph Question Answering
von: Zhang, Yu, et al.
Veröffentlicht: (2024)
von: Zhang, Yu, et al.
Veröffentlicht: (2024)
MemLong: Memory-Augmented Retrieval for Long Text Modeling
von: Liu, Weijie, et al.
Veröffentlicht: (2024)
von: Liu, Weijie, et al.
Veröffentlicht: (2024)
Mitigating Multimodal Hallucination via Phase-wise Self-reward
von: Zhang, Yu, et al.
Veröffentlicht: (2026)
von: Zhang, Yu, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Beyond Token-Level Policy Gradients for Complex Reasoning with Large Language Models
von: Xu, Mufan, et al.
Veröffentlicht: (2026) -
DUAL-REFLECT: Enhancing Large Language Models for Reflective Translation through Dual Learning Feedback Mechanisms
von: Chen, Andong, et al.
Veröffentlicht: (2024) -
Efficient Safety Alignment of Large Language Models via Preference Re-ranking and Representation-based Reward Modeling
von: Deng, Qiyuan, et al.
Veröffentlicht: (2025) -
Large Language Models for Classical Chinese Poetry Translation: Benchmarking, Evaluating, and Improving
von: Chen, Andong, et al.
Veröffentlicht: (2024) -
LLM-based Discriminative Reasoning for Knowledge Graph Question Answering
von: Xu, Mufan, et al.
Veröffentlicht: (2024)