Beyond Under-Alignment: Atomic Preference Enhanced Factuality Tuning for Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yuan, Hongbang, Chen, Yubo, Cao, Pengfei, Jin, Zhuoran, Liu, Kang, Zhao, Jun |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
RAG-RewardBench: Benchmarking Reward Models in Retrieval Augmented Generation for Preference Alignment
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
Towards Robust Knowledge Unlearning: An Adversarial Framework for Assessing and Improving Unlearning Robustness in Large Language Models
von: Yuan, Hongbang, et al.
Veröffentlicht: (2024)
von: Yuan, Hongbang, et al.
Veröffentlicht: (2024)
Whispers that Shake Foundations: Analyzing and Mitigating False Premise Hallucinations in Large Language Models
von: Yuan, Hongbang, et al.
Veröffentlicht: (2024)
von: Yuan, Hongbang, et al.
Veröffentlicht: (2024)
Omni-Reward: Towards Generalist Omni-Modal Reward Modeling with Free-Form Preferences
von: Jin, Zhuoran, et al.
Veröffentlicht: (2025)
von: Jin, Zhuoran, et al.
Veröffentlicht: (2025)
RWKU: Benchmarking Real-World Knowledge Unlearning for Large Language Models
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
Cutting Off the Head Ends the Conflict: A Mechanism for Interpreting and Mitigating Knowledge Conflicts in Language Models
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
Cracking Factual Knowledge: A Comprehensive Analysis of Degenerate Knowledge Neurons in Large Language Models
von: Chen, Yuheng, et al.
Veröffentlicht: (2024)
von: Chen, Yuheng, et al.
Veröffentlicht: (2024)
MIRAGE: Evaluating and Explaining Inductive Reasoning Process in Language Models
von: Li, Jiachun, et al.
Veröffentlicht: (2024)
von: Li, Jiachun, et al.
Veröffentlicht: (2024)
Towards Atoms of Large Language Models
von: Hu, Chenhui, et al.
Veröffentlicht: (2025)
von: Hu, Chenhui, et al.
Veröffentlicht: (2025)
Agent-RewardBench: Towards a Unified Benchmark for Reward Modeling across Perception, Planning, and Safety in Real-World Multimodal Agents
von: Men, Tianyi, et al.
Veröffentlicht: (2025)
von: Men, Tianyi, et al.
Veröffentlicht: (2025)
LINKED: Eliciting, Filtering and Integrating Knowledge in Large Language Model for Commonsense Reasoning
von: Li, Jiachun, et al.
Veröffentlicht: (2024)
von: Li, Jiachun, et al.
Veröffentlicht: (2024)
One Mind, Many Tongues: A Deep Dive into Language-Agnostic Knowledge Neurons in Large Language Models
von: Cao, Pengfei, et al.
Veröffentlicht: (2024)
von: Cao, Pengfei, et al.
Veröffentlicht: (2024)
Unlocking the Future: Exploring Look-Ahead Planning Mechanistic Interpretability in Large Language Models
von: Men, Tianyi, et al.
Veröffentlicht: (2024)
von: Men, Tianyi, et al.
Veröffentlicht: (2024)
CITI: Enhancing Tool Utilizing Ability in Large Language Models without Sacrificing General Performance
von: Hao, Yupu, et al.
Veröffentlicht: (2024)
von: Hao, Yupu, et al.
Veröffentlicht: (2024)
Tug-of-War Between Knowledge: Exploring and Resolving Knowledge Conflicts in Retrieval-Augmented Language Models
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
Enhancing Large Language Models with Pseudo- and Multisource- Knowledge Graphs for Open-ended Question Answering
von: Liu, Jiaxiang, et al.
Veröffentlicht: (2024)
von: Liu, Jiaxiang, et al.
Veröffentlicht: (2024)
SemEval-2026 Task 12: Abductive Event Reasoning: Towards Real-World Event Causal Inference for Large Language Models
von: Cao, Pengfei, et al.
Veröffentlicht: (2026)
von: Cao, Pengfei, et al.
Veröffentlicht: (2026)
Zero-Shot Cross-Lingual Document-Level Event Causality Identification with Heterogeneous Graph Contrastive Transfer Learning
von: He, Zhitao, et al.
Veröffentlicht: (2024)
von: He, Zhitao, et al.
Veröffentlicht: (2024)
Focus on Your Question! Interpreting and Mitigating Toxic CoT Problems in Commonsense Reasoning
von: Li, Jiachun, et al.
Veröffentlicht: (2024)
von: Li, Jiachun, et al.
Veröffentlicht: (2024)
Fixing the Broken Compass: Diagnosing and Improving Inference-Time Reward Modeling
von: Li, Jiachun, et al.
Veröffentlicht: (2025)
von: Li, Jiachun, et al.
Veröffentlicht: (2025)
MMR-V: What's Left Unsaid? A Benchmark for Multimodal Deep Reasoning in Videos
von: Zhu, Kejian, et al.
Veröffentlicht: (2025)
von: Zhu, Kejian, et al.
Veröffentlicht: (2025)
Think While Watching: Online Streaming Segment-Level Memory for Multi-Turn Video Reasoning in Multimodal Large Language Models
von: Wang, Lu, et al.
Veröffentlicht: (2026)
von: Wang, Lu, et al.
Veröffentlicht: (2026)
Knowledge Localization: Mission Not Accomplished? Enter Query Localization!
von: Chen, Yuheng, et al.
Veröffentlicht: (2024)
von: Chen, Yuheng, et al.
Veröffentlicht: (2024)
FLAME: Factuality-Aware Alignment for Large Language Models
von: Lin, Sheng-Chieh, et al.
Veröffentlicht: (2024)
von: Lin, Sheng-Chieh, et al.
Veröffentlicht: (2024)
WilKE: Wise-Layer Knowledge Editor for Lifelong Knowledge Editing
von: Hu, Chenhui, et al.
Veröffentlicht: (2024)
von: Hu, Chenhui, et al.
Veröffentlicht: (2024)
MMR-Life: Piecing Together Real-life Scenes for Multimodal Multi-image Reasoning
von: Li, Jiachun, et al.
Veröffentlicht: (2026)
von: Li, Jiachun, et al.
Veröffentlicht: (2026)
Knowledge in Superposition: Unveiling the Failures of Lifelong Knowledge Editing for Large Language Models
von: Hu, Chenhui, et al.
Veröffentlicht: (2024)
von: Hu, Chenhui, et al.
Veröffentlicht: (2024)
A Troublemaker with Contagious Jailbreak Makes Chaos in Honest Towns
von: Men, Tianyi, et al.
Veröffentlicht: (2024)
von: Men, Tianyi, et al.
Veröffentlicht: (2024)
FactAlign: Long-form Factuality Alignment of Large Language Models
von: Huang, Chao-Wei, et al.
Veröffentlicht: (2024)
von: Huang, Chao-Wei, et al.
Veröffentlicht: (2024)
RULE: Reinforcement UnLEarning Achieves Forget-Retain Pareto Optimality
von: Zhang, Chenlong, et al.
Veröffentlicht: (2025)
von: Zhang, Chenlong, et al.
Veröffentlicht: (2025)
AgentsCourt: Building Judicial Decision-Making Agents with Court Debate Simulation and Legal Knowledge Augmentation
von: He, Zhitao, et al.
Veröffentlicht: (2024)
von: He, Zhitao, et al.
Veröffentlicht: (2024)
Enhancing Large Language Model for Knowledge Graph Completion via Structure-Aware Alignment-Tuning
von: Liu, Yu, et al.
Veröffentlicht: (2025)
von: Liu, Yu, et al.
Veröffentlicht: (2025)
Accelerated Preference Optimization for Large Language Model Alignment
von: He, Jiafan, et al.
Veröffentlicht: (2024)
von: He, Jiafan, et al.
Veröffentlicht: (2024)
DTELS: Towards Dynamic Granularity of Timeline Summarization
von: Zhang, Chenlong, et al.
Veröffentlicht: (2024)
von: Zhang, Chenlong, et al.
Veröffentlicht: (2024)
Evaluating Personalized Tool-Augmented LLMs from the Perspectives of Personalization and Proactivity
von: Hao, Yupu, et al.
Veröffentlicht: (2025)
von: Hao, Yupu, et al.
Veröffentlicht: (2025)
Citekit: A Modular Toolkit for Large Language Model Citation Generation
von: Shen, Jiajun, et al.
Veröffentlicht: (2024)
von: Shen, Jiajun, et al.
Veröffentlicht: (2024)
Enhancing Large Language Models through Structured Reasoning
von: Dong, Yubo, et al.
Veröffentlicht: (2025)
von: Dong, Yubo, et al.
Veröffentlicht: (2025)
Large Language Models for Planning: A Comprehensive and Systematic Survey
von: Cao, Pengfei, et al.
Veröffentlicht: (2025)
von: Cao, Pengfei, et al.
Veröffentlicht: (2025)
IIMedGPT: Promoting Large Language Model Capabilities of Medical Tasks by Efficient Human Preference Alignment
von: Zhang, Yiming, et al.
Veröffentlicht: (2025)
von: Zhang, Yiming, et al.
Veröffentlicht: (2025)
Factuality of Large Language Models: A Survey
von: Wang, Yuxia, et al.
Veröffentlicht: (2024)
von: Wang, Yuxia, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
RAG-RewardBench: Benchmarking Reward Models in Retrieval Augmented Generation for Preference Alignment
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024) -
Towards Robust Knowledge Unlearning: An Adversarial Framework for Assessing and Improving Unlearning Robustness in Large Language Models
von: Yuan, Hongbang, et al.
Veröffentlicht: (2024) -
Whispers that Shake Foundations: Analyzing and Mitigating False Premise Hallucinations in Large Language Models
von: Yuan, Hongbang, et al.
Veröffentlicht: (2024) -
Omni-Reward: Towards Generalist Omni-Modal Reward Modeling with Free-Form Preferences
von: Jin, Zhuoran, et al.
Veröffentlicht: (2025) -
RWKU: Benchmarking Real-World Knowledge Unlearning for Large Language Models
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)