To Know or Not To Know? Analyzing Self-Consistency of Large Language Models under Ambiguity
Fuente:
arXiv
Saved in:
| Main Authors: | Sedova, Anastasiia, Litschko, Robert, Frassinelli, Diego, Roth, Benjamin, Plank, Barbara |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Resource-Lean Lexicon Induction for German Dialects
by: Litschko, Robert, et al.
Published: (2026)
by: Litschko, Robert, et al.
Published: (2026)
Make Every Letter Count: Building Dialect Variation Dictionaries from Monolingual Corpora
by: Litschko, Robert, et al.
Published: (2025)
by: Litschko, Robert, et al.
Published: (2025)
Analysing zero-shot temporal relation extraction on clinical notes using temporal consistency
by: Kougia, Vasiliki, et al.
Published: (2024)
by: Kougia, Vasiliki, et al.
Published: (2024)
Do Large Language Models Know How Much They Know?
by: Prato, Gabriele, et al.
Published: (2025)
by: Prato, Gabriele, et al.
Published: (2025)
Large Language Models Must Be Taught to Know What They Don't Know
by: Kapoor, Sanyam, et al.
Published: (2024)
by: Kapoor, Sanyam, et al.
Published: (2024)
ULF: Unsupervised Labeling Function Correction using Cross-Validation for Weak Supervision
by: Sedova, Anastasiia, et al.
Published: (2022)
by: Sedova, Anastasiia, et al.
Published: (2022)
Reason to Rote: Rethinking Memorization in Reasoning
by: Du, Yupei, et al.
Published: (2025)
by: Du, Yupei, et al.
Published: (2025)
What Large Language Models Know and What People Think They Know
by: Steyvers, Mark, et al.
Published: (2024)
by: Steyvers, Mark, et al.
Published: (2024)
NanoKnow: How to Know What Your Language Model Knows
by: Gu, Lingwei, et al.
Published: (2026)
by: Gu, Lingwei, et al.
Published: (2026)
MaiNLP at SemEval-2024 Task 1: Analyzing Source Language Selection in Cross-Lingual Textual Relatedness
by: Zhou, Shijia, et al.
Published: (2024)
by: Zhou, Shijia, et al.
Published: (2024)
Exploring prompts to elicit memorization in masked language model-based named entity recognition
by: Xia, Yuxi, et al.
Published: (2024)
by: Xia, Yuxi, et al.
Published: (2024)
Scaling Laws for Mixture Pretraining Under Data Constraints
by: Sedova, Anastasiia, et al.
Published: (2026)
by: Sedova, Anastasiia, et al.
Published: (2026)
Do LLMs Give Psychometrically Plausible Responses in Educational Assessments?
by: Säuberli, Andreas, et al.
Published: (2025)
by: Säuberli, Andreas, et al.
Published: (2025)
Mind the Uncertainty in Human Disagreement: Evaluating Discrepancies between Model Predictions and Human Responses in VQA
by: Lan, Jian, et al.
Published: (2024)
by: Lan, Jian, et al.
Published: (2024)
Evaluating Large Language Models for Cross-Lingual Retrieval
by: Zuo, Longfei, et al.
Published: (2025)
by: Zuo, Longfei, et al.
Published: (2025)
Exploring Large Language Models for Product Attribute Value Identification
by: Sabeh, Kassem, et al.
Published: (2024)
by: Sabeh, Kassem, et al.
Published: (2024)
Learning with Noisy Labels by Adaptive Gradient-Based Outlier Removal
by: Sedova, Anastasiia, et al.
Published: (2023)
by: Sedova, Anastasiia, et al.
Published: (2023)
Circuit Compositions: Exploring Modular Structures in Transformer-Based Language Models
by: Mondorf, Philipp, et al.
Published: (2024)
by: Mondorf, Philipp, et al.
Published: (2024)
CaRT: Teaching LLM Agents to Know When They Know Enough
by: Liu, Grace, et al.
Published: (2025)
by: Liu, Grace, et al.
Published: (2025)
Know Thyself? On the Incapability and Implications of AI Self-Recognition
by: Bai, Xiaoyan, et al.
Published: (2025)
by: Bai, Xiaoyan, et al.
Published: (2025)
I Don't Know: Explicit Modeling of Uncertainty with an [IDK] Token
by: Cohen, Roi, et al.
Published: (2024)
by: Cohen, Roi, et al.
Published: (2024)
Know When You're Wrong: Aligning Confidence with Correctness for LLM Error Detection
by: Xiaohu, Xie, et al.
Published: (2026)
by: Xiaohu, Xie, et al.
Published: (2026)
Do I Know This Entity? Knowledge Awareness and Hallucinations in Language Models
by: Ferrando, Javier, et al.
Published: (2024)
by: Ferrando, Javier, et al.
Published: (2024)
Know Your Limits: Entropy Estimation Modeling for Compression and Generalization
by: Badger, Benjamin L., et al.
Published: (2025)
by: Badger, Benjamin L., et al.
Published: (2025)
What Do Self-Supervised Speech Models Know About Words?
by: Pasad, Ankita, et al.
Published: (2023)
by: Pasad, Ankita, et al.
Published: (2023)
What Do Large Language Models Know? Tacit Knowledge as a Potential Causal-Explanatory Structure
by: Budding, Céline
Published: (2025)
by: Budding, Céline
Published: (2025)
What do Transformers Know about Government?
by: Hou, Jue, et al.
Published: (2024)
by: Hou, Jue, et al.
Published: (2024)
Cross-Dialect Information Retrieval: Information Access in Low-Resource and High-Variance Languages
by: Litschko, Robert, et al.
Published: (2024)
by: Litschko, Robert, et al.
Published: (2024)
Controlling Reading Ease with Gaze-Guided Text Generation
by: Säuberli, Andreas, et al.
Published: (2026)
by: Säuberli, Andreas, et al.
Published: (2026)
BertaQA: How Much Do Language Models Know About Local Culture?
by: Etxaniz, Julen, et al.
Published: (2024)
by: Etxaniz, Julen, et al.
Published: (2024)
Do Androids Know They're Only Dreaming of Electric Sheep?
by: CH-Wang, Sky, et al.
Published: (2023)
by: CH-Wang, Sky, et al.
Published: (2023)
Text Knows What, Tables Know When: Clinical Timeline Reconstruction via Retrieval-Augmented Multimodal Alignment
by: Kumar, Sayantan, et al.
Published: (2026)
by: Kumar, Sayantan, et al.
Published: (2026)
KnowLA: Enhancing Parameter-efficient Finetuning with Knowledgeable Adaptation
by: Luo, Xindi, et al.
Published: (2024)
by: Luo, Xindi, et al.
Published: (2024)
Knowing When to Defer: Selective Prediction for Responsible Knowledge Tracing
by: Mitton, Joshua, et al.
Published: (2025)
by: Mitton, Joshua, et al.
Published: (2025)
I Came, I Saw, I Explained: Benchmarking Multimodal LLMs on Figurative Meaning in Memes
by: Zhou, Shijia, et al.
Published: (2026)
by: Zhou, Shijia, et al.
Published: (2026)
LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations
by: Mayne, Harry, et al.
Published: (2025)
by: Mayne, Harry, et al.
Published: (2025)
Information Asymmetry across Language Varieties: A Case Study on Cantonese-Mandarin and Bavarian-German QA
by: Pei, Renhao, et al.
Published: (2026)
by: Pei, Renhao, et al.
Published: (2026)
Found in the Middle: Permutation Self-Consistency Improves Listwise Ranking in Large Language Models
by: Tang, Raphael, et al.
Published: (2023)
by: Tang, Raphael, et al.
Published: (2023)
MUCAR: Benchmarking Multilingual Cross-Modal Ambiguity Resolution for Multimodal Large Language Models
by: Wang, Xiaolong, et al.
Published: (2025)
by: Wang, Xiaolong, et al.
Published: (2025)
Stepwise Self-Consistent Mathematical Reasoning with Large Language Models
by: Zhao, Zilong, et al.
Published: (2024)
by: Zhao, Zilong, et al.
Published: (2024)
Similar Items
-
Resource-Lean Lexicon Induction for German Dialects
by: Litschko, Robert, et al.
Published: (2026) -
Make Every Letter Count: Building Dialect Variation Dictionaries from Monolingual Corpora
by: Litschko, Robert, et al.
Published: (2025) -
Analysing zero-shot temporal relation extraction on clinical notes using temporal consistency
by: Kougia, Vasiliki, et al.
Published: (2024) -
Do Large Language Models Know How Much They Know?
by: Prato, Gabriele, et al.
Published: (2025) -
Large Language Models Must Be Taught to Know What They Don't Know
by: Kapoor, Sanyam, et al.
Published: (2024)