Don't Hallucinate, Abstain: Identifying LLM Knowledge Gaps via Multi-LLM Collaboration
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Feng, Shangbin, Shi, Weijia, Wang, Yike, Ding, Wenxuan, Balachandran, Vidhisha, Tsvetkov, Yulia |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Teaching LLMs to Abstain across Languages via Multilingual Feedback
von: Feng, Shangbin, et al.
Veröffentlicht: (2024)
von: Feng, Shangbin, et al.
Veröffentlicht: (2024)
Knowledge Card: Filling LLMs' Knowledge Gaps with Plug-in Specialized Language Models
von: Feng, Shangbin, et al.
Veröffentlicht: (2023)
von: Feng, Shangbin, et al.
Veröffentlicht: (2023)
Resolving Knowledge Conflicts in Large Language Models
von: Wang, Yike, et al.
Veröffentlicht: (2023)
von: Wang, Yike, et al.
Veröffentlicht: (2023)
Knowledge Crosswords: Geometric Knowledge Reasoning with Large Language Models
von: Ding, Wenxuan, et al.
Veröffentlicht: (2023)
von: Ding, Wenxuan, et al.
Veröffentlicht: (2023)
Data Swarms: Optimizable Generation of Synthetic Evaluation Data
von: Feng, Shangbin, et al.
Veröffentlicht: (2025)
von: Feng, Shangbin, et al.
Veröffentlicht: (2025)
Don't Throw Away Your Pretrained Model
von: Feng, Shangbin, et al.
Veröffentlicht: (2025)
von: Feng, Shangbin, et al.
Veröffentlicht: (2025)
When One LLM Drools, Multi-LLM Collaboration Rules
von: Feng, Shangbin, et al.
Veröffentlicht: (2025)
von: Feng, Shangbin, et al.
Veröffentlicht: (2025)
Among Us: Measuring and Mitigating Malicious Contributions in Model Collaboration Systems
von: Yang, Ziyuan, et al.
Veröffentlicht: (2026)
von: Yang, Ziyuan, et al.
Veröffentlicht: (2026)
KGQuiz: Evaluating the Generalization of Encoded Knowledge in Large Language Models
von: Bai, Yuyang, et al.
Veröffentlicht: (2023)
von: Bai, Yuyang, et al.
Veröffentlicht: (2023)
ScienceMeter: Tracking Scientific Knowledge Updates in Language Models
von: Wang, Yike, et al.
Veröffentlicht: (2025)
von: Wang, Yike, et al.
Veröffentlicht: (2025)
FACTS&EVIDENCE: An Interactive Tool for Transparent Fine-Grained Factual Verification of Machine-Generated Text
von: Boonsanong, Varich, et al.
Veröffentlicht: (2025)
von: Boonsanong, Varich, et al.
Veröffentlicht: (2025)
Modular Pluralism: Pluralistic Alignment via Multi-LLM Collaboration
von: Feng, Shangbin, et al.
Veröffentlicht: (2024)
von: Feng, Shangbin, et al.
Veröffentlicht: (2024)
Fine-grained Hallucination Detection and Editing for Language Models
von: Mishra, Abhika, et al.
Veröffentlicht: (2024)
von: Mishra, Abhika, et al.
Veröffentlicht: (2024)
The Single-Multi Evolution Loop for Self-Improving Model Collaboration Systems
von: Feng, Shangbin, et al.
Veröffentlicht: (2026)
von: Feng, Shangbin, et al.
Veröffentlicht: (2026)
Heterogeneous Swarms: Jointly Optimizing Model Roles and Weights for Multi-LLM Systems
von: Feng, Shangbin, et al.
Veröffentlicht: (2025)
von: Feng, Shangbin, et al.
Veröffentlicht: (2025)
P^3SUM: Preserving Author's Perspective in News Summarization with Diffusion Language Models
von: Liu, Yuhan, et al.
Veröffentlicht: (2023)
von: Liu, Yuhan, et al.
Veröffentlicht: (2023)
SPARTA ALIGNMENT: Collectively Aligning Multiple Language Models through Combat
von: Jiang, Yuru, et al.
Veröffentlicht: (2025)
von: Jiang, Yuru, et al.
Veröffentlicht: (2025)
MentorCollab: Selective Large-to-Small Inference-Time Guidance for Efficient Reasoning
von: Wang, Haojin, et al.
Veröffentlicht: (2026)
von: Wang, Haojin, et al.
Veröffentlicht: (2026)
MediQ: Question-Asking LLMs and a Benchmark for Reliable Interactive Clinical Reasoning
von: Li, Shuyue Stella, et al.
Veröffentlicht: (2024)
von: Li, Shuyue Stella, et al.
Veröffentlicht: (2024)
Small Reward Models via Backward Inference
von: Wang, Yike, et al.
Veröffentlicht: (2026)
von: Wang, Yike, et al.
Veröffentlicht: (2026)
Model Swarms: Collaborative Search to Adapt LLM Experts via Swarm Intelligence
von: Feng, Shangbin, et al.
Veröffentlicht: (2024)
von: Feng, Shangbin, et al.
Veröffentlicht: (2024)
Varying Shades of Wrong: Aligning LLMs with Wrong Answers Only
von: Yao, Jihan, et al.
Veröffentlicht: (2024)
von: Yao, Jihan, et al.
Veröffentlicht: (2024)
DELL: Generating Reactions and Explanations for LLM-Based Misinformation Detection
von: Wan, Herun, et al.
Veröffentlicht: (2024)
von: Wan, Herun, et al.
Veröffentlicht: (2024)
Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment
von: Zhang, Yizhuo, et al.
Veröffentlicht: (2025)
von: Zhang, Yizhuo, et al.
Veröffentlicht: (2025)
Can LLM Graph Reasoning Generalize beyond Pattern Memorization?
von: Zhang, Yizhuo, et al.
Veröffentlicht: (2024)
von: Zhang, Yizhuo, et al.
Veröffentlicht: (2024)
What Prompts Don't Say: Understanding and Managing Underspecification in LLM Prompts
von: Yang, Chenyang, et al.
Veröffentlicht: (2025)
von: Yang, Chenyang, et al.
Veröffentlicht: (2025)
Learning Syntax Without Planting Trees: Understanding Hierarchical Generalization in Transformers
von: Ahuja, Kabir, et al.
Veröffentlicht: (2024)
von: Ahuja, Kabir, et al.
Veröffentlicht: (2024)
MoCo: A One-Stop Shop for Model Collaboration Research
von: Feng, Shangbin, et al.
Veröffentlicht: (2026)
von: Feng, Shangbin, et al.
Veröffentlicht: (2026)
What Does the Bot Say? Opportunities and Risks of Large Language Models in Social Media Bot Detection
von: Feng, Shangbin, et al.
Veröffentlicht: (2024)
von: Feng, Shangbin, et al.
Veröffentlicht: (2024)
GuessBench: Sensemaking Multimodal Creativity in the Wild
von: Zhu, Zifeng, et al.
Veröffentlicht: (2025)
von: Zhu, Zifeng, et al.
Veröffentlicht: (2025)
Don't Say No: Jailbreaking LLM by Suppressing Refusal
von: Zhou, Yukai, et al.
Veröffentlicht: (2024)
von: Zhou, Yukai, et al.
Veröffentlicht: (2024)
Can Language Models Solve Graph Problems in Natural Language?
von: Wang, Heng, et al.
Veröffentlicht: (2023)
von: Wang, Heng, et al.
Veröffentlicht: (2023)
Know Your Limits: A Survey of Abstention in Large Language Models
von: Wen, Bingbing, et al.
Veröffentlicht: (2024)
von: Wen, Bingbing, et al.
Veröffentlicht: (2024)
Decomposed Prompting Does Not Fix Knowledge Gaps, But Helps Models Say "I Don't Know"
von: Madhwal, Dhruv, et al.
Veröffentlicht: (2026)
von: Madhwal, Dhruv, et al.
Veröffentlicht: (2026)
Don't Let It Hallucinate: Premise Verification via Retrieval-Augmented Logical Reasoning
von: Qin, Yuehan, et al.
Veröffentlicht: (2025)
von: Qin, Yuehan, et al.
Veröffentlicht: (2025)
David helps Goliath: Inference-Time Collaboration Between Small Specialized and Large General Diffusion LMs
von: Han, Xiaochuang, et al.
Veröffentlicht: (2023)
von: Han, Xiaochuang, et al.
Veröffentlicht: (2023)
Stumbling Blocks: Stress Testing the Robustness of Machine-Generated Text Detectors Under Attacks
von: Wang, Yichen, et al.
Veröffentlicht: (2024)
von: Wang, Yichen, et al.
Veröffentlicht: (2024)
Finding Flawed Fictions: Evaluating Complex Reasoning in Language Models via Plot Hole Detection
von: Ahuja, Kabir, et al.
Veröffentlicht: (2025)
von: Ahuja, Kabir, et al.
Veröffentlicht: (2025)
Insights into LLM Long-Context Failures: When Transformers Know but Don't Tell
von: Lu, Taiming, et al.
Veröffentlicht: (2024)
von: Lu, Taiming, et al.
Veröffentlicht: (2024)
Beyond "I Don't Know": Evaluating LLM Self-Awareness in Discriminating Data and Model Uncertainty
von: Ren, Jingyi, et al.
Veröffentlicht: (2026)
von: Ren, Jingyi, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Teaching LLMs to Abstain across Languages via Multilingual Feedback
von: Feng, Shangbin, et al.
Veröffentlicht: (2024) -
Knowledge Card: Filling LLMs' Knowledge Gaps with Plug-in Specialized Language Models
von: Feng, Shangbin, et al.
Veröffentlicht: (2023) -
Resolving Knowledge Conflicts in Large Language Models
von: Wang, Yike, et al.
Veröffentlicht: (2023) -
Knowledge Crosswords: Geometric Knowledge Reasoning with Large Language Models
von: Ding, Wenxuan, et al.
Veröffentlicht: (2023) -
Data Swarms: Optimizable Generation of Synthetic Evaluation Data
von: Feng, Shangbin, et al.
Veröffentlicht: (2025)