Probability Consistency in Large Language Models: Theoretical Foundations Meet Empirical Discrepancies
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Luo, Xiaoliang, Xu, Xinyi, Ramscar, Michael, Love, Bradley C. |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Beyond Human-Like Processing: Large Language Models Perform Equivalently on Forward and Backward Scientific Text
von: Luo, Xiaoliang, et al.
Veröffentlicht: (2024)
von: Luo, Xiaoliang, et al.
Veröffentlicht: (2024)
Matching domain experts by training from scratch on domain knowledge
von: Luo, Xiaoliang, et al.
Veröffentlicht: (2024)
von: Luo, Xiaoliang, et al.
Veröffentlicht: (2024)
Language Models can Evaluate Themselves via Probability Discrepancy
von: Xia, Tingyu, et al.
Veröffentlicht: (2024)
von: Xia, Tingyu, et al.
Veröffentlicht: (2024)
An Empirical Analysis on Large Language Models in Debate Evaluation
von: Liu, Xinyi, et al.
Veröffentlicht: (2024)
von: Liu, Xinyi, et al.
Veröffentlicht: (2024)
Large Language Models as Foundations for Next-Gen Dense Retrieval: A Comprehensive Empirical Assessment
von: Luo, Kun, et al.
Veröffentlicht: (2024)
von: Luo, Kun, et al.
Veröffentlicht: (2024)
Theoretical Foundations and Mitigation of Hallucination in Large Language Models
von: Gumaan, Esmail
Veröffentlicht: (2025)
von: Gumaan, Esmail
Veröffentlicht: (2025)
DCR-Consistency: Divide-Conquer-Reasoning for Consistency Evaluation and Improvement of Large Language Models
von: Cui, Wendi, et al.
Veröffentlicht: (2024)
von: Cui, Wendi, et al.
Veröffentlicht: (2024)
Exploring Large Language Models for Communication Games: An Empirical Study on Werewolf
von: Xu, Yuzhuang, et al.
Veröffentlicht: (2023)
von: Xu, Yuzhuang, et al.
Veröffentlicht: (2023)
Cross-Modal Consistency in Multimodal Large Language Models
von: Zhang, Xiang, et al.
Veröffentlicht: (2024)
von: Zhang, Xiang, et al.
Veröffentlicht: (2024)
Large Language Models as Neurolinguistic Subjects: Discrepancy between Performance and Competence
von: He, Linyang, et al.
Veröffentlicht: (2024)
von: He, Linyang, et al.
Veröffentlicht: (2024)
SCE: Scalable Consistency Ensembles Make Blackbox Large Language Model Generation More Reliable
von: Zhang, Jiaxin, et al.
Veröffentlicht: (2025)
von: Zhang, Jiaxin, et al.
Veröffentlicht: (2025)
LaMP: When Large Language Models Meet Personalization
von: Salemi, Alireza, et al.
Veröffentlicht: (2023)
von: Salemi, Alireza, et al.
Veröffentlicht: (2023)
CONTESTS: a Framework for Consistency Testing of Span Probabilities in Language Models
von: Wagner, Eitan, et al.
Veröffentlicht: (2024)
von: Wagner, Eitan, et al.
Veröffentlicht: (2024)
Aligning Large Language Models with Counterfactual DPO
von: Butcher, Bradley
Veröffentlicht: (2024)
von: Butcher, Bradley
Veröffentlicht: (2024)
Prompting Large Language Models for Counterfactual Generation: An Empirical Study
von: Li, Yongqi, et al.
Veröffentlicht: (2023)
von: Li, Yongqi, et al.
Veröffentlicht: (2023)
Is Large Language Model Good at Triple Set Prediction? An Empirical Study
von: Yuan, Yuan, et al.
Veröffentlicht: (2024)
von: Yuan, Yuan, et al.
Veröffentlicht: (2024)
ANCHOR: Abductive Network Construction with Hierarchical Orchestration for Reliable Probability Inference in Large Language Models
von: Qiu, Wentao, et al.
Veröffentlicht: (2026)
von: Qiu, Wentao, et al.
Veröffentlicht: (2026)
LLM Meets Scene Graph: Can Large Language Models Understand and Generate Scene Graphs? A Benchmark and Empirical Study
von: Yang, Dongil, et al.
Veröffentlicht: (2025)
von: Yang, Dongil, et al.
Veröffentlicht: (2025)
Calibrating Verbalized Probabilities for Large Language Models
von: Wang, Cheng, et al.
Veröffentlicht: (2024)
von: Wang, Cheng, et al.
Veröffentlicht: (2024)
Incoherent Probability Judgments in Large Language Models
von: Zhu, Jian-Qiao, et al.
Veröffentlicht: (2024)
von: Zhu, Jian-Qiao, et al.
Veröffentlicht: (2024)
Beyond Probabilities: Unveiling the Misalignment in Evaluating Large Language Models
von: Lyu, Chenyang, et al.
Veröffentlicht: (2024)
von: Lyu, Chenyang, et al.
Veröffentlicht: (2024)
An Empirical Study of Multi-Generation Sampling for Jailbreak Detection in Large Language Models
von: Luo, Hanrui, et al.
Veröffentlicht: (2026)
von: Luo, Hanrui, et al.
Veröffentlicht: (2026)
Calibrating Large Language Models with Sample Consistency
von: Lyu, Qing, et al.
Veröffentlicht: (2024)
von: Lyu, Qing, et al.
Veröffentlicht: (2024)
Precise Length Control in Large Language Models
von: Butcher, Bradley, et al.
Veröffentlicht: (2024)
von: Butcher, Bradley, et al.
Veröffentlicht: (2024)
An Empirical Study of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning
von: Luo, Yun, et al.
Veröffentlicht: (2023)
von: Luo, Yun, et al.
Veröffentlicht: (2023)
Multilingual Machine Translation with Large Language Models: Empirical Results and Analysis
von: Zhu, Wenhao, et al.
Veröffentlicht: (2023)
von: Zhu, Wenhao, et al.
Veröffentlicht: (2023)
LaMsS: When Large Language Models Meet Self-Skepticism
von: Wu, Yetao, et al.
Veröffentlicht: (2024)
von: Wu, Yetao, et al.
Veröffentlicht: (2024)
Reasoning Meets Personalization: Unleashing the Potential of Large Reasoning Model for Personalized Generation
von: Luo, Sichun, et al.
Veröffentlicht: (2025)
von: Luo, Sichun, et al.
Veröffentlicht: (2025)
CM-Align: Consistency-based Multilingual Alignment for Large Language Models
von: Zhang, Xue, et al.
Veröffentlicht: (2025)
von: Zhang, Xue, et al.
Veröffentlicht: (2025)
If Probable, Then Acceptable? Understanding Conditional Acceptability Judgments in Large Language Models
von: Orth, Jasmin, et al.
Veröffentlicht: (2025)
von: Orth, Jasmin, et al.
Veröffentlicht: (2025)
Trajectory Prediction Meets Large Language Models: A Survey
von: Xu, Yi, et al.
Veröffentlicht: (2025)
von: Xu, Yi, et al.
Veröffentlicht: (2025)
Systematic Bias in Large Language Models: Discrepant Response Patterns in Binary vs. Continuous Judgment Tasks
von: Lu, Yi-Long, et al.
Veröffentlicht: (2025)
von: Lu, Yi-Long, et al.
Veröffentlicht: (2025)
LLM Can be a Dangerous Persuader: Empirical Study of Persuasion Safety in Large Language Models
von: Liu, Minqian, et al.
Veröffentlicht: (2025)
von: Liu, Minqian, et al.
Veröffentlicht: (2025)
Towards Distillation-Resistant Large Language Models: An Information-Theoretic Perspective
von: Fang, Hao, et al.
Veröffentlicht: (2026)
von: Fang, Hao, et al.
Veröffentlicht: (2026)
DecoPrompt : Decoding Prompts Reduces Hallucinations when Large Language Models Meet False Premises
von: Xu, Nan, et al.
Veröffentlicht: (2024)
von: Xu, Nan, et al.
Veröffentlicht: (2024)
CLLMs: Consistency Large Language Models
von: Kou, Siqi, et al.
Veröffentlicht: (2024)
von: Kou, Siqi, et al.
Veröffentlicht: (2024)
RCScore: Quantifying Response Consistency in Large Language Models
von: Jang, Dongjun, et al.
Veröffentlicht: (2025)
von: Jang, Dongjun, et al.
Veröffentlicht: (2025)
Logical Consistency of Large Language Models in Fact-checking
von: Ghosh, Bishwamittra, et al.
Veröffentlicht: (2024)
von: Ghosh, Bishwamittra, et al.
Veröffentlicht: (2024)
NILE: Internal Consistency Alignment in Large Language Models
von: Hu, Minda, et al.
Veröffentlicht: (2024)
von: Hu, Minda, et al.
Veröffentlicht: (2024)
Large Language Model Meets Constraint Propagation
von: Bonlarron, Alexandre, et al.
Veröffentlicht: (2025)
von: Bonlarron, Alexandre, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Beyond Human-Like Processing: Large Language Models Perform Equivalently on Forward and Backward Scientific Text
von: Luo, Xiaoliang, et al.
Veröffentlicht: (2024) -
Matching domain experts by training from scratch on domain knowledge
von: Luo, Xiaoliang, et al.
Veröffentlicht: (2024) -
Language Models can Evaluate Themselves via Probability Discrepancy
von: Xia, Tingyu, et al.
Veröffentlicht: (2024) -
An Empirical Analysis on Large Language Models in Debate Evaluation
von: Liu, Xinyi, et al.
Veröffentlicht: (2024) -
Large Language Models as Foundations for Next-Gen Dense Retrieval: A Comprehensive Empirical Assessment
von: Luo, Kun, et al.
Veröffentlicht: (2024)