SAC3: Reliable Hallucination Detection in Black-Box Language Models via Semantic-aware Cross-check Consistency
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Jiaxin, Li, Zhuohang, Das, Kamalika, Malin, Bradley A., Kumar, Sricharan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SCE: Scalable Consistency Ensembles Make Blackbox Large Language Model Generation More Reliable
di: Zhang, Jiaxin, et al.
Pubblicazione: (2025)
di: Zhang, Jiaxin, et al.
Pubblicazione: (2025)
DCR-Consistency: Divide-Conquer-Reasoning for Consistency Evaluation and Improvement of Large Language Models
di: Cui, Wendi, et al.
Pubblicazione: (2024)
di: Cui, Wendi, et al.
Pubblicazione: (2024)
Do You Know What You Are Talking About? Characterizing Query-Knowledge Relevance For Reliable Retrieval Augmented Generation
di: Li, Zhuohang, et al.
Pubblicazione: (2024)
di: Li, Zhuohang, et al.
Pubblicazione: (2024)
SEE: Strategic Exploration and Exploitation for Cohesive In-Context Prompt Optimization
di: Cui, Wendi, et al.
Pubblicazione: (2024)
di: Cui, Wendi, et al.
Pubblicazione: (2024)
A Survey of Automatic Prompt Optimization with Instruction-focused Heuristic-based Search Algorithm
di: Cui, Wendi, et al.
Pubblicazione: (2025)
di: Cui, Wendi, et al.
Pubblicazione: (2025)
Synthetic Knowledge Ingestion: Towards Knowledge Refinement and Injection for Enhancing Large Language Models
di: Zhang, Jiaxin, et al.
Pubblicazione: (2024)
di: Zhang, Jiaxin, et al.
Pubblicazione: (2024)
Discriminant Distance-Aware Representation on Deterministic Uncertainty Quantification Methods
di: Zhang, Jiaxin, et al.
Pubblicazione: (2024)
di: Zhang, Jiaxin, et al.
Pubblicazione: (2024)
Black-Box Hallucination Detection via Consistency Under the Uncertain Expression
di: Joo, Seongho, et al.
Pubblicazione: (2025)
di: Joo, Seongho, et al.
Pubblicazione: (2025)
Verify when Uncertain: Beyond Self-Consistency in Black Box Hallucination Detection
di: Xue, Yihao, et al.
Pubblicazione: (2025)
di: Xue, Yihao, et al.
Pubblicazione: (2025)
SPUQ: Perturbation-Based Uncertainty Quantification for Large Language Models
di: Gao, Xiang, et al.
Pubblicazione: (2024)
di: Gao, Xiang, et al.
Pubblicazione: (2024)
Towards Statistical Factuality Guarantee for Large Vision-Language Models
di: Li, Zhuohang, et al.
Pubblicazione: (2025)
di: Li, Zhuohang, et al.
Pubblicazione: (2025)
Customizing Language Model Responses with Contrastive In-Context Learning
di: Gao, Xiang, et al.
Pubblicazione: (2024)
di: Gao, Xiang, et al.
Pubblicazione: (2024)
Gradient-guided Attention Map Editing: Towards Efficient Contextual Hallucination Mitigation
di: Wang, Yu, et al.
Pubblicazione: (2025)
di: Wang, Yu, et al.
Pubblicazione: (2025)
Entity-aware Cross-lingual Claim Detection for Automated Fact-checking
di: Panchendrarajan, Rrubaa, et al.
Pubblicazione: (2025)
di: Panchendrarajan, Rrubaa, et al.
Pubblicazione: (2025)
Logical Consistency of Large Language Models in Fact-checking
di: Ghosh, Bishwamittra, et al.
Pubblicazione: (2024)
di: Ghosh, Bishwamittra, et al.
Pubblicazione: (2024)
Black-Box Reliability Certification for AI Agents via Self-Consistency Sampling and Conformal Calibration
di: Mouzouni, Charafeddine
Pubblicazione: (2026)
di: Mouzouni, Charafeddine
Pubblicazione: (2026)
Hallucination Detection via Internal States and Structured Reasoning Consistency in Large Language Models
di: Song, Yusheng, et al.
Pubblicazione: (2025)
di: Song, Yusheng, et al.
Pubblicazione: (2025)
Semantic Consistency for Assuring Reliability of Large Language Models
di: Raj, Harsh, et al.
Pubblicazione: (2023)
di: Raj, Harsh, et al.
Pubblicazione: (2023)
Blending Human and LLM Expertise to Detect Hallucinations and Omissions in Mental Health Chatbot Responses
di: Hussain, Khizar, et al.
Pubblicazione: (2026)
di: Hussain, Khizar, et al.
Pubblicazione: (2026)
LASH: Adaptive Semantic Hybridization for Black-Box Jailbreaking of Large Language Models
di: Nafi, Abdullah Al Nomaan, et al.
Pubblicazione: (2026)
di: Nafi, Abdullah Al Nomaan, et al.
Pubblicazione: (2026)
Hallucination Detection: Robustly Discerning Reliable Answers in Large Language Models
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
FactSelfCheck: Fact-Level Black-Box Hallucination Detection for LLMs
di: Sawczyn, Albert, et al.
Pubblicazione: (2025)
di: Sawczyn, Albert, et al.
Pubblicazione: (2025)
Lowest Span Confidence: A Zero-Shot Metric for Efficient and Black-Box Hallucination Detection in LLMs
di: Qiao, Yitong, et al.
Pubblicazione: (2026)
di: Qiao, Yitong, et al.
Pubblicazione: (2026)
Learned Hallucination Detection in Black-Box LLMs using Token-level Entropy Production Rate
di: Moslonka, Charles, et al.
Pubblicazione: (2025)
di: Moslonka, Charles, et al.
Pubblicazione: (2025)
Black-Box Visual Prompt Engineering for Mitigating Object Hallucination in Large Vision Language Models
di: Woo, Sangmin, et al.
Pubblicazione: (2025)
di: Woo, Sangmin, et al.
Pubblicazione: (2025)
Consistency Matters: Explore LLMs Consistency From a Black-Box Perspective
di: Zhao, Fufangchen, et al.
Pubblicazione: (2024)
di: Zhao, Fufangchen, et al.
Pubblicazione: (2024)
Survival of the Safest: Towards Secure Prompt Optimization through Interleaved Multi-Objective Evolution
di: Sinha, Ankita, et al.
Pubblicazione: (2024)
di: Sinha, Ankita, et al.
Pubblicazione: (2024)
Cross-Modal Consistency in Multimodal Large Language Models
di: Zhang, Xiang, et al.
Pubblicazione: (2024)
di: Zhang, Xiang, et al.
Pubblicazione: (2024)
Are Large Language Models Reliable AI Scientists? Assessing Reverse-Engineering of Black-Box Systems
di: Geng, Jiayi, et al.
Pubblicazione: (2025)
di: Geng, Jiayi, et al.
Pubblicazione: (2025)
Semantic Self-Consistency: Enhancing Language Model Reasoning via Semantic Weighting
di: Knappe, Tim, et al.
Pubblicazione: (2024)
di: Knappe, Tim, et al.
Pubblicazione: (2024)
You've Changed: Detecting Modification of Black-Box Large Language Models
di: Dima, Alden, et al.
Pubblicazione: (2025)
di: Dima, Alden, et al.
Pubblicazione: (2025)
Knowledge Distillation of Black-Box Large Language Models
di: Chen, Hongzhan, et al.
Pubblicazione: (2024)
di: Chen, Hongzhan, et al.
Pubblicazione: (2024)
Learning to Search Effective Example Sequences for In-Context Learning
di: Gao, Xiang, et al.
Pubblicazione: (2025)
di: Gao, Xiang, et al.
Pubblicazione: (2025)
Reducing Tool Hallucination via Reliability Alignment
di: Xu, Hongshen, et al.
Pubblicazione: (2024)
di: Xu, Hongshen, et al.
Pubblicazione: (2024)
Text Corpora as Concept Fields: Black-Box Hallucination and Novelty Measurement
di: Kersting, Nicholas S., et al.
Pubblicazione: (2026)
di: Kersting, Nicholas S., et al.
Pubblicazione: (2026)
Enhancing Uncertainty Modeling with Semantic Graph for Hallucination Detection
di: Chen, Kedi, et al.
Pubblicazione: (2025)
di: Chen, Kedi, et al.
Pubblicazione: (2025)
Joint Evaluation of Answer and Reasoning Consistency for Hallucination Detection in Large Reasoning Models
di: Wang, Changyue, et al.
Pubblicazione: (2025)
di: Wang, Changyue, et al.
Pubblicazione: (2025)
Large Language Model Confidence Estimation via Black-Box Access
di: Pedapati, Tejaswini, et al.
Pubblicazione: (2024)
di: Pedapati, Tejaswini, et al.
Pubblicazione: (2024)
Uncertainty-Based Abstention in LLMs Improves Safety and Reduces Hallucinations
di: Tomani, Christian, et al.
Pubblicazione: (2024)
di: Tomani, Christian, et al.
Pubblicazione: (2024)
Inside the Black Box: Detecting Data Leakage in Pre-trained Language Encoders
di: Xin, Yuan, et al.
Pubblicazione: (2024)
di: Xin, Yuan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
SCE: Scalable Consistency Ensembles Make Blackbox Large Language Model Generation More Reliable
di: Zhang, Jiaxin, et al.
Pubblicazione: (2025) -
DCR-Consistency: Divide-Conquer-Reasoning for Consistency Evaluation and Improvement of Large Language Models
di: Cui, Wendi, et al.
Pubblicazione: (2024) -
Do You Know What You Are Talking About? Characterizing Query-Knowledge Relevance For Reliable Retrieval Augmented Generation
di: Li, Zhuohang, et al.
Pubblicazione: (2024) -
SEE: Strategic Exploration and Exploitation for Cohesive In-Context Prompt Optimization
di: Cui, Wendi, et al.
Pubblicazione: (2024) -
A Survey of Automatic Prompt Optimization with Instruction-focused Heuristic-based Search Algorithm
di: Cui, Wendi, et al.
Pubblicazione: (2025)