Probability Consistency in Large Language Models: Theoretical Foundations Meet Empirical Discrepancies
Fuente:
arXiv
Guardado en:
| Autores principales: | Luo, Xiaoliang, Xu, Xinyi, Ramscar, Michael, Love, Bradley C. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Beyond Human-Like Processing: Large Language Models Perform Equivalently on Forward and Backward Scientific Text
por: Luo, Xiaoliang, et al.
Publicado: (2024)
por: Luo, Xiaoliang, et al.
Publicado: (2024)
Matching domain experts by training from scratch on domain knowledge
por: Luo, Xiaoliang, et al.
Publicado: (2024)
por: Luo, Xiaoliang, et al.
Publicado: (2024)
Language Models can Evaluate Themselves via Probability Discrepancy
por: Xia, Tingyu, et al.
Publicado: (2024)
por: Xia, Tingyu, et al.
Publicado: (2024)
An Empirical Analysis on Large Language Models in Debate Evaluation
por: Liu, Xinyi, et al.
Publicado: (2024)
por: Liu, Xinyi, et al.
Publicado: (2024)
Large Language Models as Foundations for Next-Gen Dense Retrieval: A Comprehensive Empirical Assessment
por: Luo, Kun, et al.
Publicado: (2024)
por: Luo, Kun, et al.
Publicado: (2024)
Theoretical Foundations and Mitigation of Hallucination in Large Language Models
por: Gumaan, Esmail
Publicado: (2025)
por: Gumaan, Esmail
Publicado: (2025)
DCR-Consistency: Divide-Conquer-Reasoning for Consistency Evaluation and Improvement of Large Language Models
por: Cui, Wendi, et al.
Publicado: (2024)
por: Cui, Wendi, et al.
Publicado: (2024)
Exploring Large Language Models for Communication Games: An Empirical Study on Werewolf
por: Xu, Yuzhuang, et al.
Publicado: (2023)
por: Xu, Yuzhuang, et al.
Publicado: (2023)
Cross-Modal Consistency in Multimodal Large Language Models
por: Zhang, Xiang, et al.
Publicado: (2024)
por: Zhang, Xiang, et al.
Publicado: (2024)
Large Language Models as Neurolinguistic Subjects: Discrepancy between Performance and Competence
por: He, Linyang, et al.
Publicado: (2024)
por: He, Linyang, et al.
Publicado: (2024)
SCE: Scalable Consistency Ensembles Make Blackbox Large Language Model Generation More Reliable
por: Zhang, Jiaxin, et al.
Publicado: (2025)
por: Zhang, Jiaxin, et al.
Publicado: (2025)
LaMP: When Large Language Models Meet Personalization
por: Salemi, Alireza, et al.
Publicado: (2023)
por: Salemi, Alireza, et al.
Publicado: (2023)
CONTESTS: a Framework for Consistency Testing of Span Probabilities in Language Models
por: Wagner, Eitan, et al.
Publicado: (2024)
por: Wagner, Eitan, et al.
Publicado: (2024)
Aligning Large Language Models with Counterfactual DPO
por: Butcher, Bradley
Publicado: (2024)
por: Butcher, Bradley
Publicado: (2024)
Prompting Large Language Models for Counterfactual Generation: An Empirical Study
por: Li, Yongqi, et al.
Publicado: (2023)
por: Li, Yongqi, et al.
Publicado: (2023)
Is Large Language Model Good at Triple Set Prediction? An Empirical Study
por: Yuan, Yuan, et al.
Publicado: (2024)
por: Yuan, Yuan, et al.
Publicado: (2024)
ANCHOR: Abductive Network Construction with Hierarchical Orchestration for Reliable Probability Inference in Large Language Models
por: Qiu, Wentao, et al.
Publicado: (2026)
por: Qiu, Wentao, et al.
Publicado: (2026)
LLM Meets Scene Graph: Can Large Language Models Understand and Generate Scene Graphs? A Benchmark and Empirical Study
por: Yang, Dongil, et al.
Publicado: (2025)
por: Yang, Dongil, et al.
Publicado: (2025)
Calibrating Verbalized Probabilities for Large Language Models
por: Wang, Cheng, et al.
Publicado: (2024)
por: Wang, Cheng, et al.
Publicado: (2024)
Incoherent Probability Judgments in Large Language Models
por: Zhu, Jian-Qiao, et al.
Publicado: (2024)
por: Zhu, Jian-Qiao, et al.
Publicado: (2024)
Beyond Probabilities: Unveiling the Misalignment in Evaluating Large Language Models
por: Lyu, Chenyang, et al.
Publicado: (2024)
por: Lyu, Chenyang, et al.
Publicado: (2024)
An Empirical Study of Multi-Generation Sampling for Jailbreak Detection in Large Language Models
por: Luo, Hanrui, et al.
Publicado: (2026)
por: Luo, Hanrui, et al.
Publicado: (2026)
Calibrating Large Language Models with Sample Consistency
por: Lyu, Qing, et al.
Publicado: (2024)
por: Lyu, Qing, et al.
Publicado: (2024)
Precise Length Control in Large Language Models
por: Butcher, Bradley, et al.
Publicado: (2024)
por: Butcher, Bradley, et al.
Publicado: (2024)
An Empirical Study of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning
por: Luo, Yun, et al.
Publicado: (2023)
por: Luo, Yun, et al.
Publicado: (2023)
Multilingual Machine Translation with Large Language Models: Empirical Results and Analysis
por: Zhu, Wenhao, et al.
Publicado: (2023)
por: Zhu, Wenhao, et al.
Publicado: (2023)
LaMsS: When Large Language Models Meet Self-Skepticism
por: Wu, Yetao, et al.
Publicado: (2024)
por: Wu, Yetao, et al.
Publicado: (2024)
Reasoning Meets Personalization: Unleashing the Potential of Large Reasoning Model for Personalized Generation
por: Luo, Sichun, et al.
Publicado: (2025)
por: Luo, Sichun, et al.
Publicado: (2025)
CM-Align: Consistency-based Multilingual Alignment for Large Language Models
por: Zhang, Xue, et al.
Publicado: (2025)
por: Zhang, Xue, et al.
Publicado: (2025)
If Probable, Then Acceptable? Understanding Conditional Acceptability Judgments in Large Language Models
por: Orth, Jasmin, et al.
Publicado: (2025)
por: Orth, Jasmin, et al.
Publicado: (2025)
Trajectory Prediction Meets Large Language Models: A Survey
por: Xu, Yi, et al.
Publicado: (2025)
por: Xu, Yi, et al.
Publicado: (2025)
Systematic Bias in Large Language Models: Discrepant Response Patterns in Binary vs. Continuous Judgment Tasks
por: Lu, Yi-Long, et al.
Publicado: (2025)
por: Lu, Yi-Long, et al.
Publicado: (2025)
LLM Can be a Dangerous Persuader: Empirical Study of Persuasion Safety in Large Language Models
por: Liu, Minqian, et al.
Publicado: (2025)
por: Liu, Minqian, et al.
Publicado: (2025)
Towards Distillation-Resistant Large Language Models: An Information-Theoretic Perspective
por: Fang, Hao, et al.
Publicado: (2026)
por: Fang, Hao, et al.
Publicado: (2026)
DecoPrompt : Decoding Prompts Reduces Hallucinations when Large Language Models Meet False Premises
por: Xu, Nan, et al.
Publicado: (2024)
por: Xu, Nan, et al.
Publicado: (2024)
CLLMs: Consistency Large Language Models
por: Kou, Siqi, et al.
Publicado: (2024)
por: Kou, Siqi, et al.
Publicado: (2024)
RCScore: Quantifying Response Consistency in Large Language Models
por: Jang, Dongjun, et al.
Publicado: (2025)
por: Jang, Dongjun, et al.
Publicado: (2025)
Logical Consistency of Large Language Models in Fact-checking
por: Ghosh, Bishwamittra, et al.
Publicado: (2024)
por: Ghosh, Bishwamittra, et al.
Publicado: (2024)
NILE: Internal Consistency Alignment in Large Language Models
por: Hu, Minda, et al.
Publicado: (2024)
por: Hu, Minda, et al.
Publicado: (2024)
Large Language Model Meets Constraint Propagation
por: Bonlarron, Alexandre, et al.
Publicado: (2025)
por: Bonlarron, Alexandre, et al.
Publicado: (2025)
Ejemplares similares
-
Beyond Human-Like Processing: Large Language Models Perform Equivalently on Forward and Backward Scientific Text
por: Luo, Xiaoliang, et al.
Publicado: (2024) -
Matching domain experts by training from scratch on domain knowledge
por: Luo, Xiaoliang, et al.
Publicado: (2024) -
Language Models can Evaluate Themselves via Probability Discrepancy
por: Xia, Tingyu, et al.
Publicado: (2024) -
An Empirical Analysis on Large Language Models in Debate Evaluation
por: Liu, Xinyi, et al.
Publicado: (2024) -
Large Language Models as Foundations for Next-Gen Dense Retrieval: A Comprehensive Empirical Assessment
por: Luo, Kun, et al.
Publicado: (2024)