Whispers that Shake Foundations: Analyzing and Mitigating False Premise Hallucinations in Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yuan, Hongbang, Cao, Pengfei, Jin, Zhuoran, Chen, Yubo, Zeng, Daojian, Liu, Kang, Zhao, Jun |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Beyond Under-Alignment: Atomic Preference Enhanced Factuality Tuning for Large Language Models
von: Yuan, Hongbang, et al.
Veröffentlicht: (2024)
von: Yuan, Hongbang, et al.
Veröffentlicht: (2024)
Towards Robust Knowledge Unlearning: An Adversarial Framework for Assessing and Improving Unlearning Robustness in Large Language Models
von: Yuan, Hongbang, et al.
Veröffentlicht: (2024)
von: Yuan, Hongbang, et al.
Veröffentlicht: (2024)
Focus on Your Question! Interpreting and Mitigating Toxic CoT Problems in Commonsense Reasoning
von: Li, Jiachun, et al.
Veröffentlicht: (2024)
von: Li, Jiachun, et al.
Veröffentlicht: (2024)
Cutting Off the Head Ends the Conflict: A Mechanism for Interpreting and Mitigating Knowledge Conflicts in Language Models
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
RWKU: Benchmarking Real-World Knowledge Unlearning for Large Language Models
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
RAG-RewardBench: Benchmarking Reward Models in Retrieval Augmented Generation for Preference Alignment
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
One Mind, Many Tongues: A Deep Dive into Language-Agnostic Knowledge Neurons in Large Language Models
von: Cao, Pengfei, et al.
Veröffentlicht: (2024)
von: Cao, Pengfei, et al.
Veröffentlicht: (2024)
Unlocking the Future: Exploring Look-Ahead Planning Mechanistic Interpretability in Large Language Models
von: Men, Tianyi, et al.
Veröffentlicht: (2024)
von: Men, Tianyi, et al.
Veröffentlicht: (2024)
Omni-Reward: Towards Generalist Omni-Modal Reward Modeling with Free-Form Preferences
von: Jin, Zhuoran, et al.
Veröffentlicht: (2025)
von: Jin, Zhuoran, et al.
Veröffentlicht: (2025)
CITI: Enhancing Tool Utilizing Ability in Large Language Models without Sacrificing General Performance
von: Hao, Yupu, et al.
Veröffentlicht: (2024)
von: Hao, Yupu, et al.
Veröffentlicht: (2024)
MIRAGE: Evaluating and Explaining Inductive Reasoning Process in Language Models
von: Li, Jiachun, et al.
Veröffentlicht: (2024)
von: Li, Jiachun, et al.
Veröffentlicht: (2024)
MMR-V: What's Left Unsaid? A Benchmark for Multimodal Deep Reasoning in Videos
von: Zhu, Kejian, et al.
Veröffentlicht: (2025)
von: Zhu, Kejian, et al.
Veröffentlicht: (2025)
DecoPrompt : Decoding Prompts Reduces Hallucinations when Large Language Models Meet False Premises
von: Xu, Nan, et al.
Veröffentlicht: (2024)
von: Xu, Nan, et al.
Veröffentlicht: (2024)
Towards Atoms of Large Language Models
von: Hu, Chenhui, et al.
Veröffentlicht: (2025)
von: Hu, Chenhui, et al.
Veröffentlicht: (2025)
EvoEdit: Lifelong Free-Text Knowledge Editing through Latent Perturbation Augmentation and Knowledge-driven Parameter Fusion
von: Cao, Pengfei, et al.
Veröffentlicht: (2025)
von: Cao, Pengfei, et al.
Veröffentlicht: (2025)
Agent-RewardBench: Towards a Unified Benchmark for Reward Modeling across Perception, Planning, and Safety in Real-World Multimodal Agents
von: Men, Tianyi, et al.
Veröffentlicht: (2025)
von: Men, Tianyi, et al.
Veröffentlicht: (2025)
Knowledge in Superposition: Unveiling the Failures of Lifelong Knowledge Editing for Large Language Models
von: Hu, Chenhui, et al.
Veröffentlicht: (2024)
von: Hu, Chenhui, et al.
Veröffentlicht: (2024)
A Troublemaker with Contagious Jailbreak Makes Chaos in Honest Towns
von: Men, Tianyi, et al.
Veröffentlicht: (2024)
von: Men, Tianyi, et al.
Veröffentlicht: (2024)
LINKED: Eliciting, Filtering and Integrating Knowledge in Large Language Model for Commonsense Reasoning
von: Li, Jiachun, et al.
Veröffentlicht: (2024)
von: Li, Jiachun, et al.
Veröffentlicht: (2024)
RULE: Reinforcement UnLEarning Achieves Forget-Retain Pareto Optimality
von: Zhang, Chenlong, et al.
Veröffentlicht: (2025)
von: Zhang, Chenlong, et al.
Veröffentlicht: (2025)
Tug-of-War Between Knowledge: Exploring and Resolving Knowledge Conflicts in Retrieval-Augmented Language Models
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
DTELS: Towards Dynamic Granularity of Timeline Summarization
von: Zhang, Chenlong, et al.
Veröffentlicht: (2024)
von: Zhang, Chenlong, et al.
Veröffentlicht: (2024)
Evaluating Personalized Tool-Augmented LLMs from the Perspectives of Personalization and Proactivity
von: Hao, Yupu, et al.
Veröffentlicht: (2025)
von: Hao, Yupu, et al.
Veröffentlicht: (2025)
Theoretical Foundations and Mitigation of Hallucination in Large Language Models
von: Gumaan, Esmail
Veröffentlicht: (2025)
von: Gumaan, Esmail
Veröffentlicht: (2025)
Don't Take the Premise for Granted: Evaluating the Premise Critique Ability of Large Language Models
von: Li, Jinzhe, et al.
Veröffentlicht: (2025)
von: Li, Jinzhe, et al.
Veröffentlicht: (2025)
Cracking Factual Knowledge: A Comprehensive Analysis of Degenerate Knowledge Neurons in Large Language Models
von: Chen, Yuheng, et al.
Veröffentlicht: (2024)
von: Chen, Yuheng, et al.
Veröffentlicht: (2024)
Analyzing and Mitigating Object Hallucination in Large Vision-Language Models
von: Zhou, Yiyang, et al.
Veröffentlicht: (2023)
von: Zhou, Yiyang, et al.
Veröffentlicht: (2023)
KG-FPQ: Evaluating Factuality Hallucination in LLMs with Knowledge Graph-based False Premise Questions
von: Zhu, Yanxu, et al.
Veröffentlicht: (2024)
von: Zhu, Yanxu, et al.
Veröffentlicht: (2024)
Think While Watching: Online Streaming Segment-Level Memory for Multi-Turn Video Reasoning in Multimodal Large Language Models
von: Wang, Lu, et al.
Veröffentlicht: (2026)
von: Wang, Lu, et al.
Veröffentlicht: (2026)
Zero-Shot Cross-Lingual Document-Level Event Causality Identification with Heterogeneous Graph Contrastive Transfer Learning
von: He, Zhitao, et al.
Veröffentlicht: (2024)
von: He, Zhitao, et al.
Veröffentlicht: (2024)
Fixing the Broken Compass: Diagnosing and Improving Inference-Time Reward Modeling
von: Li, Jiachun, et al.
Veröffentlicht: (2025)
von: Li, Jiachun, et al.
Veröffentlicht: (2025)
Mitigating Hallucinations in Large Vision-Language Models by Self-Injecting Hallucinations
von: Lu, Yifan, et al.
Veröffentlicht: (2025)
von: Lu, Yifan, et al.
Veröffentlicht: (2025)
CogMG: Collaborative Augmentation Between Large Language Model and Knowledge Graph
von: Zhou, Tong, et al.
Veröffentlicht: (2024)
von: Zhou, Tong, et al.
Veröffentlicht: (2024)
SemEval-2026 Task 12: Abductive Event Reasoning: Towards Real-World Event Causal Inference for Large Language Models
von: Cao, Pengfei, et al.
Veröffentlicht: (2026)
von: Cao, Pengfei, et al.
Veröffentlicht: (2026)
Analyzing Bias in False Refusal Behavior of Large Language Models for Hate Speech Detoxification
von: Im, Kyuri, et al.
Veröffentlicht: (2026)
von: Im, Kyuri, et al.
Veröffentlicht: (2026)
VLN-NF: Feasibility-Aware Vision-and-Language Navigation with False-Premise Instructions
von: Su, Hung-Ting, et al.
Veröffentlicht: (2026)
von: Su, Hung-Ting, et al.
Veröffentlicht: (2026)
Delta -- Contrastive Decoding Mitigates Text Hallucinations in Large Language Models
von: Huang, Cheng Peng, et al.
Veröffentlicht: (2025)
von: Huang, Cheng Peng, et al.
Veröffentlicht: (2025)
MMR-Life: Piecing Together Real-life Scenes for Multimodal Multi-image Reasoning
von: Li, Jiachun, et al.
Veröffentlicht: (2026)
von: Li, Jiachun, et al.
Veröffentlicht: (2026)
Revealing the Deceptiveness of Knowledge Editing: A Mechanistic Analysis of Superficial Editing
von: Xie, Jiakuan, et al.
Veröffentlicht: (2025)
von: Xie, Jiakuan, et al.
Veröffentlicht: (2025)
Knowledge Localization: Mission Not Accomplished? Enter Query Localization!
von: Chen, Yuheng, et al.
Veröffentlicht: (2024)
von: Chen, Yuheng, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Beyond Under-Alignment: Atomic Preference Enhanced Factuality Tuning for Large Language Models
von: Yuan, Hongbang, et al.
Veröffentlicht: (2024) -
Towards Robust Knowledge Unlearning: An Adversarial Framework for Assessing and Improving Unlearning Robustness in Large Language Models
von: Yuan, Hongbang, et al.
Veröffentlicht: (2024) -
Focus on Your Question! Interpreting and Mitigating Toxic CoT Problems in Commonsense Reasoning
von: Li, Jiachun, et al.
Veröffentlicht: (2024) -
Cutting Off the Head Ends the Conflict: A Mechanism for Interpreting and Mitigating Knowledge Conflicts in Language Models
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024) -
RWKU: Benchmarking Real-World Knowledge Unlearning for Large Language Models
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)