Detecting Corpus-Level Knowledge Inconsistencies in Wikipedia with Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Semnani, Sina J., Burapacheep, Jirayu, Khatua, Arpandeep, Atchariyachanvanit, Thanawan, Wang, Zheng, Lam, Monica S. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
WikiChat: Stopping the Hallucination of Large Language Model Chatbots by Few-Shot Grounding on Wikipedia
di: Semnani, Sina J., et al.
Pubblicazione: (2023)
di: Semnani, Sina J., et al.
Pubblicazione: (2023)
ARGS: Alignment as Reward-Guided Search
di: Khanov, Maxim, et al.
Pubblicazione: (2024)
di: Khanov, Maxim, et al.
Pubblicazione: (2024)
ColorSwap: A Color and Word Order Dataset for Multimodal Evaluation
di: Burapacheep, Jirayu, et al.
Pubblicazione: (2024)
di: Burapacheep, Jirayu, et al.
Pubblicazione: (2024)
SUQL: Conversational Search over Structured and Unstructured Data with Large Language Models
di: Liu, Shicheng, et al.
Pubblicazione: (2023)
di: Liu, Shicheng, et al.
Pubblicazione: (2023)
CHURRO: Making History Readable with an Open-Weight Large Vision-Language Model for High-Accuracy, Low-Cost Historical Text Recognition
di: Semnani, Sina J., et al.
Pubblicazione: (2025)
di: Semnani, Sina J., et al.
Pubblicazione: (2025)
Your Classifier Can Be Secretly a Likelihood-Based OOD Detector
di: Burapacheep, Jirayu, et al.
Pubblicazione: (2024)
di: Burapacheep, Jirayu, et al.
Pubblicazione: (2024)
Into the Unknown Unknowns: Engaged Human Learning through Participation in Language Model Agent Conversations
di: Jiang, Yucheng, et al.
Pubblicazione: (2024)
di: Jiang, Yucheng, et al.
Pubblicazione: (2024)
Assisting in Writing Wikipedia-like Articles From Scratch with Large Language Models
di: Shao, Yijia, et al.
Pubblicazione: (2024)
di: Shao, Yijia, et al.
Pubblicazione: (2024)
SPAGHETTI: Open-Domain Question Answering from Heterogeneous Data Sources with Retrieval and Semantic Parsing
di: Zhang, Heidi C., et al.
Pubblicazione: (2024)
di: Zhang, Heidi C., et al.
Pubblicazione: (2024)
SPINACH: SPARQL-Based Information Navigation for Challenging Real-World Questions
di: Liu, Shicheng, et al.
Pubblicazione: (2024)
di: Liu, Shicheng, et al.
Pubblicazione: (2024)
Evaluating Knowledge-based Cross-lingual Inconsistency in Large Language Models
di: Xing, Xiaolin, et al.
Pubblicazione: (2024)
di: Xing, Xiaolin, et al.
Pubblicazione: (2024)
LEMONADE: A Large Multilingual Expert-Annotated Abstractive Event Dataset for the Real World
di: Semnani, Sina J., et al.
Pubblicazione: (2025)
di: Semnani, Sina J., et al.
Pubblicazione: (2025)
Factual Inconsistencies in Multilingual Wikipedia Tables
di: Cappa, Silvia, et al.
Pubblicazione: (2025)
di: Cappa, Silvia, et al.
Pubblicazione: (2025)
Automatic Construction of a Large-Scale Corpus for Geoparsing Using Wikipedia Hyperlinks
di: Ohno, Keyaki, et al.
Pubblicazione: (2024)
di: Ohno, Keyaki, et al.
Pubblicazione: (2024)
Measuring the Inconsistency of Large Language Models in Preferential Ranking
di: Zhao, Xiutian, et al.
Pubblicazione: (2024)
di: Zhao, Xiutian, et al.
Pubblicazione: (2024)
Locating Information Gaps and Narrative Inconsistencies Across Languages: A Case Study of LGBT People Portrayals on Wikipedia
di: Samir, Farhan, et al.
Pubblicazione: (2024)
di: Samir, Farhan, et al.
Pubblicazione: (2024)
Zero-shot Persuasive Chatbots with LLM-Generated Strategies and Information Retrieval
di: Furumai, Kazuaki, et al.
Pubblicazione: (2024)
di: Furumai, Kazuaki, et al.
Pubblicazione: (2024)
Lethe: Purifying Backdoored Large Language Models with Knowledge Dilution
di: Chen, Chen, et al.
Pubblicazione: (2025)
di: Chen, Chen, et al.
Pubblicazione: (2025)
Measuring Moral Inconsistencies in Large Language Models
di: Bonagiri, Vamshi Krishna, et al.
Pubblicazione: (2024)
di: Bonagiri, Vamshi Krishna, et al.
Pubblicazione: (2024)
Leveraging Corpus Metadata to Detect Template-based Translation: An Exploratory Case Study of the Egyptian Arabic Wikipedia Edition
di: Alshahrani, Saied, et al.
Pubblicazione: (2024)
di: Alshahrani, Saied, et al.
Pubblicazione: (2024)
Large Language Models on Wikipedia-Style Survey Generation: an Evaluation in NLP Concepts
di: Gao, Fan, et al.
Pubblicazione: (2023)
di: Gao, Fan, et al.
Pubblicazione: (2023)
Addressing Tokenization Inconsistency in Steganography and Watermarking Based on Large Language Models
di: Yan, Ruiyi, et al.
Pubblicazione: (2025)
di: Yan, Ruiyi, et al.
Pubblicazione: (2025)
Fantastic Bugs and Where to Find Them in AI Benchmarks
di: Truong, Sang, et al.
Pubblicazione: (2025)
di: Truong, Sang, et al.
Pubblicazione: (2025)
Towards Data Contamination Detection for Modern Large Language Models: Limitations, Inconsistencies, and Oracle Challenges
di: Samuel, Vinay, et al.
Pubblicazione: (2024)
di: Samuel, Vinay, et al.
Pubblicazione: (2024)
CorpusLM: Towards a Unified Language Model on Corpus for Knowledge-Intensive Tasks
di: Li, Xiaoxi, et al.
Pubblicazione: (2024)
di: Li, Xiaoxi, et al.
Pubblicazione: (2024)
Biomedical Entity Linking for Dutch: Fine-tuning a Self-alignment BERT Model on an Automatically Generated Wikipedia Corpus
di: Hartendorp, Fons, et al.
Pubblicazione: (2024)
di: Hartendorp, Fons, et al.
Pubblicazione: (2024)
Misleading through Inconsistency: A Benchmark for Political Inconsistencies Detection
di: Sagimbayeva, Nursulu, et al.
Pubblicazione: (2025)
di: Sagimbayeva, Nursulu, et al.
Pubblicazione: (2025)
Inconsistencies in Masked Language Models
di: Young, Tom, et al.
Pubblicazione: (2022)
di: Young, Tom, et al.
Pubblicazione: (2022)
CLaw: Benchmarking Chinese Legal Knowledge in Large Language Models - A Fine-grained Corpus and Reasoning Analysis
di: Xu, Xinzhe, et al.
Pubblicazione: (2025)
di: Xu, Xinzhe, et al.
Pubblicazione: (2025)
Neuron-Level Knowledge Attribution in Large Language Models
di: Yu, Zeping, et al.
Pubblicazione: (2023)
di: Yu, Zeping, et al.
Pubblicazione: (2023)
Jailbreaking Multimodal Large Language Models via Shuffle Inconsistency
di: Zhao, Shiji, et al.
Pubblicazione: (2025)
di: Zhao, Shiji, et al.
Pubblicazione: (2025)
Knowledge-Driven Agentic Scientific Corpus Distillation Framework for Biomedical Large Language Models Training
di: Xiao, Meng, et al.
Pubblicazione: (2025)
di: Xiao, Meng, et al.
Pubblicazione: (2025)
TherapyGym: Evaluating and Aligning Clinical Fidelity and Safety in Therapy Chatbots
di: Huang, Fangrui, et al.
Pubblicazione: (2026)
di: Huang, Fangrui, et al.
Pubblicazione: (2026)
Enhancing Large Language Models with Neurosymbolic Reasoning for Multilingual Tasks
di: Nezhad, Sina Bagheri, et al.
Pubblicazione: (2025)
di: Nezhad, Sina Bagheri, et al.
Pubblicazione: (2025)
Unraveling and Mitigating Retriever Inconsistencies in Retrieval-Augmented Large Language Models
di: Li, Mingda, et al.
Pubblicazione: (2024)
di: Li, Mingda, et al.
Pubblicazione: (2024)
HumanLM: Simulating Users with State Alignment Beats Response Imitation
di: Wu, Shirley, et al.
Pubblicazione: (2026)
di: Wu, Shirley, et al.
Pubblicazione: (2026)
Multilingual and Cross-Lingual Citation Needed Detection on Wikipedia for Lower-Resource Languages
di: Quaremba, Gerrit, et al.
Pubblicazione: (2026)
di: Quaremba, Gerrit, et al.
Pubblicazione: (2026)
Rethinking Personalization in Large Language Models at the Token Level
di: Zhang, Chenheng, et al.
Pubblicazione: (2026)
di: Zhang, Chenheng, et al.
Pubblicazione: (2026)
Reinforcement Learning Problem Solving with Large Language Models
di: Gholamian, Sina, et al.
Pubblicazione: (2024)
di: Gholamian, Sina, et al.
Pubblicazione: (2024)
The InviTE Corpus: Annotating Invectives in Tudor English Texts for Computational Modeling
di: Spliethoff, Sophie, et al.
Pubblicazione: (2025)
di: Spliethoff, Sophie, et al.
Pubblicazione: (2025)
Documenti analoghi
-
WikiChat: Stopping the Hallucination of Large Language Model Chatbots by Few-Shot Grounding on Wikipedia
di: Semnani, Sina J., et al.
Pubblicazione: (2023) -
ARGS: Alignment as Reward-Guided Search
di: Khanov, Maxim, et al.
Pubblicazione: (2024) -
ColorSwap: A Color and Word Order Dataset for Multimodal Evaluation
di: Burapacheep, Jirayu, et al.
Pubblicazione: (2024) -
SUQL: Conversational Search over Structured and Unstructured Data with Large Language Models
di: Liu, Shicheng, et al.
Pubblicazione: (2023) -
CHURRO: Making History Readable with an Open-Weight Large Vision-Language Model for High-Accuracy, Low-Cost Historical Text Recognition
di: Semnani, Sina J., et al.
Pubblicazione: (2025)