Aligning Large Language Model Behavior with Human Citation Preferences
Fuente:
arXiv
Guardado en:
| Autores principales: | Ando, Kenichiro, Harada, Tatsuya |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Steering Risk Preferences in Large Language Models by Aligning Behavioral and Neural Representations
por: Zhu, Jian-Qiao, et al.
Publicado: (2025)
por: Zhu, Jian-Qiao, et al.
Publicado: (2025)
Aligning Large Language Models with Searcher Preferences
por: Wu, Wei, et al.
Publicado: (2026)
por: Wu, Wei, et al.
Publicado: (2026)
The Real, the Better: Aligning Large Language Models with Online Human Behaviors
por: Jiang, Guanying, et al.
Publicado: (2024)
por: Jiang, Guanying, et al.
Publicado: (2024)
Aligning with Human Judgement: The Role of Pairwise Preference in Large Language Model Evaluators
por: Liu, Yinhong, et al.
Publicado: (2024)
por: Liu, Yinhong, et al.
Publicado: (2024)
Fairer Preferences Elicit Improved Human-Aligned Large Language Model Judgments
por: Zhou, Han, et al.
Publicado: (2024)
por: Zhou, Han, et al.
Publicado: (2024)
Capturing Nuanced Preferences: Preference-Aligned Distillation for Small Language Models
por: Gu, Yanggan, et al.
Publicado: (2025)
por: Gu, Yanggan, et al.
Publicado: (2025)
TPO: Aligning Large Language Models with Multi-branch & Multi-step Preference Trees
por: Liao, Weibin, et al.
Publicado: (2024)
por: Liao, Weibin, et al.
Publicado: (2024)
How does Misinformation Affect Large Language Model Behaviors and Preferences?
por: Peng, Miao, et al.
Publicado: (2025)
por: Peng, Miao, et al.
Publicado: (2025)
Align Generative Artificial Intelligence with Human Preferences: A Novel Large Language Model Fine-Tuning Method for Online Review Management
por: Wang, Yanan, et al.
Publicado: (2026)
por: Wang, Yanan, et al.
Publicado: (2026)
Safer-Instruct: Aligning Language Models with Automated Preference Data
por: Shi, Taiwei, et al.
Publicado: (2023)
por: Shi, Taiwei, et al.
Publicado: (2023)
Language Models Largely Exhibit Human-like Constituent Ordering Preferences
por: Tur, Ada Defne, et al.
Publicado: (2025)
por: Tur, Ada Defne, et al.
Publicado: (2025)
Aligning Model Evaluations with Human Preferences: Mitigating Token Count Bias in Language Model Assessments
por: Daynauth, Roland, et al.
Publicado: (2024)
por: Daynauth, Roland, et al.
Publicado: (2024)
SLMEval: Entropy-Based Calibration for Human-Aligned Evaluation of Large Language Models
por: Daynauth, Roland, et al.
Publicado: (2025)
por: Daynauth, Roland, et al.
Publicado: (2025)
Peering Through Preferences: Unraveling Feedback Acquisition for Aligning Large Language Models
por: Bansal, Hritik, et al.
Publicado: (2023)
por: Bansal, Hritik, et al.
Publicado: (2023)
SimulPL: Aligning Human Preferences in Simultaneous Machine Translation
por: Yu, Donglei, et al.
Publicado: (2025)
por: Yu, Donglei, et al.
Publicado: (2025)
Icon$^{2}$: Aligning Large Language Models Using Self-Synthetic Preference Data via Inherent Regulation
por: Chen, Qiyuan, et al.
Publicado: (2025)
por: Chen, Qiyuan, et al.
Publicado: (2025)
Aligning with Logic: Measuring, Evaluating and Improving Logical Preference Consistency in Large Language Models
por: Liu, Yinhong, et al.
Publicado: (2024)
por: Liu, Yinhong, et al.
Publicado: (2024)
Hierarchical Memorization in Large Language Models: Evidence from Citation Generation
por: Niimi, Junichiro
Publicado: (2025)
por: Niimi, Junichiro
Publicado: (2025)
Learning Fine-Grained Grounded Citations for Attributed Large Language Models
por: Huang, Lei, et al.
Publicado: (2024)
por: Huang, Lei, et al.
Publicado: (2024)
Citekit: A Modular Toolkit for Large Language Model Citation Generation
por: Shen, Jiajun, et al.
Publicado: (2024)
por: Shen, Jiajun, et al.
Publicado: (2024)
On the Capacity of Citation Generation by Large Language Models
por: Qian, Haosheng, et al.
Publicado: (2024)
por: Qian, Haosheng, et al.
Publicado: (2024)
Preference Packing: Efficient Preference Optimization for Large Language Models
por: Cho, Jaekyung
Publicado: (2026)
por: Cho, Jaekyung
Publicado: (2026)
Aligning Large Language Models with Counterfactual DPO
por: Butcher, Bradley
Publicado: (2024)
por: Butcher, Bradley
Publicado: (2024)
Attention-Aligned Reasoning for Large Language Models
por: Zhang, Hongxiang, et al.
Publicado: (2025)
por: Zhang, Hongxiang, et al.
Publicado: (2025)
Persona-Based Synthetic Data Generation Using Multi-Stage Conditioning with Large Language Models for Emotion Recognition
por: Inoshita, Keito, et al.
Publicado: (2025)
por: Inoshita, Keito, et al.
Publicado: (2025)
LifeAlign: Lifelong Alignment for Large Language Models with Memory-Augmented Focalized Preference Optimization
por: Li, Junsong, et al.
Publicado: (2025)
por: Li, Junsong, et al.
Publicado: (2025)
Large Language Models Align with the Human Brain during Creative Thinking
por: Ismayilzada, Mete, et al.
Publicado: (2026)
por: Ismayilzada, Mete, et al.
Publicado: (2026)
Beyond Labels: Aligning Large Language Models with Human-like Reasoning
por: Kabir, Muhammad Rafsan, et al.
Publicado: (2024)
por: Kabir, Muhammad Rafsan, et al.
Publicado: (2024)
MVPBench: A Benchmark and Fine-Tuning Framework for Aligning Large Language Models with Diverse Human Values
por: Liang, Yao, et al.
Publicado: (2025)
por: Liang, Yao, et al.
Publicado: (2025)
KG-CTG: Citation Generation through Knowledge Graph-guided Large Language Models
por: Anand, Avinash, et al.
Publicado: (2024)
por: Anand, Avinash, et al.
Publicado: (2024)
Task-Aligned Tool Recommendation for Large Language Models
por: Gao, Hang, et al.
Publicado: (2024)
por: Gao, Hang, et al.
Publicado: (2024)
Subjective Behaviors and Preferences in LLM: Language of Browsing
por: Sundaresan, Sai, et al.
Publicado: (2025)
por: Sundaresan, Sai, et al.
Publicado: (2025)
IIMedGPT: Promoting Large Language Model Capabilities of Medical Tasks by Efficient Human Preference Alignment
por: Zhang, Yiming, et al.
Publicado: (2025)
por: Zhang, Yiming, et al.
Publicado: (2025)
Comparing Bad Apples to Good Oranges: Aligning Large Language Models via Joint Preference Optimization
por: Bansal, Hritik, et al.
Publicado: (2024)
por: Bansal, Hritik, et al.
Publicado: (2024)
Weights-Rotated Preference Optimization for Large Language Models
por: Yang, Chenxu, et al.
Publicado: (2025)
por: Yang, Chenxu, et al.
Publicado: (2025)
Abductive Reasoning with Syllogistic Forms in Large Language Models
por: Abe, Hirohiko, et al.
Publicado: (2026)
por: Abe, Hirohiko, et al.
Publicado: (2026)
PLaD: Preference-based Large Language Model Distillation with Pseudo-Preference Pairs
por: Zhang, Rongzhi, et al.
Publicado: (2024)
por: Zhang, Rongzhi, et al.
Publicado: (2024)
SPRI: Aligning Large Language Models with Context-Situated Principles
por: Zhan, Hongli, et al.
Publicado: (2025)
por: Zhan, Hongli, et al.
Publicado: (2025)
Semantic Representation Attack against Aligned Large Language Models
por: Lian, Jiawei, et al.
Publicado: (2025)
por: Lian, Jiawei, et al.
Publicado: (2025)
Empathy by Design: Aligning Large Language Models for Healthcare Dialogue
por: Umucu, Emre, et al.
Publicado: (2025)
por: Umucu, Emre, et al.
Publicado: (2025)
Ejemplares similares
-
Steering Risk Preferences in Large Language Models by Aligning Behavioral and Neural Representations
por: Zhu, Jian-Qiao, et al.
Publicado: (2025) -
Aligning Large Language Models with Searcher Preferences
por: Wu, Wei, et al.
Publicado: (2026) -
The Real, the Better: Aligning Large Language Models with Online Human Behaviors
por: Jiang, Guanying, et al.
Publicado: (2024) -
Aligning with Human Judgement: The Role of Pairwise Preference in Large Language Model Evaluators
por: Liu, Yinhong, et al.
Publicado: (2024) -
Fairer Preferences Elicit Improved Human-Aligned Large Language Model Judgments
por: Zhou, Han, et al.
Publicado: (2024)