A Diagnostic Benchmark for Sweden-Related Factual Knowledge
Fuente:
arXiv
Salvato in:
| Autore principale: | Kunz, Jenny |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Preferences for Idiomatic Language are Acquired Slowly -- and Forgotten Quickly: A Case Study on Swedish
di: Kunz, Jenny
Pubblicazione: (2026)
di: Kunz, Jenny
Pubblicazione: (2026)
Training Models on Dialects of Translationese Shows How Lexical Diversity and Source-Target Syntactic Similarity Shape Learning
di: Kunz, Jenny
Pubblicazione: (2026)
di: Kunz, Jenny
Pubblicazione: (2026)
Train More Parameters But Mind Their Placement: Insights into Language Adaptation with PEFT
di: Kunz, Jenny
Pubblicazione: (2024)
di: Kunz, Jenny
Pubblicazione: (2024)
SimpleQA Verified: A Reliable Factuality Benchmark to Measure Parametric Knowledge
di: Haas, Lukas, et al.
Pubblicazione: (2025)
di: Haas, Lukas, et al.
Pubblicazione: (2025)
A Hypothesis-Driven Framework for the Analysis of Self-Rationalising Models
di: Braun, Marc, et al.
Pubblicazione: (2024)
di: Braun, Marc, et al.
Pubblicazione: (2024)
The Impact of Language Adapters in Cross-Lingual Transfer for NLU
di: Kunz, Jenny, et al.
Pubblicazione: (2024)
di: Kunz, Jenny, et al.
Pubblicazione: (2024)
How to Tune a Multilingual Encoder Model for Germanic Languages: A Study of PEFT, Full Fine-Tuning, and Language Adapters
di: Oji, Romina, et al.
Pubblicazione: (2025)
di: Oji, Romina, et al.
Pubblicazione: (2025)
A Dataset for Probing Translationese Preferences in English-to-Swedish Translation
di: Kunz, Jenny, et al.
Pubblicazione: (2026)
di: Kunz, Jenny, et al.
Pubblicazione: (2026)
Inside-Out: Hidden Factual Knowledge in LLMs
di: Gekhman, Zorik, et al.
Pubblicazione: (2025)
di: Gekhman, Zorik, et al.
Pubblicazione: (2025)
LLMs as Repositories of Factual Knowledge: Limitations and Solutions
di: Mousavi, Seyed Mahed, et al.
Pubblicazione: (2025)
di: Mousavi, Seyed Mahed, et al.
Pubblicazione: (2025)
Tracing Multilingual Factual Knowledge Acquisition in Pretraining
di: Liu, Yihong, et al.
Pubblicazione: (2025)
di: Liu, Yihong, et al.
Pubblicazione: (2025)
Understanding Finetuning for Factual Knowledge Extraction
di: Ghosal, Gaurav, et al.
Pubblicazione: (2024)
di: Ghosal, Gaurav, et al.
Pubblicazione: (2024)
Multilingual Knowledge Editing with Language-Agnostic Factual Neurons
di: Zhang, Xue, et al.
Pubblicazione: (2024)
di: Zhang, Xue, et al.
Pubblicazione: (2024)
Properties and Challenges of LLM-Generated Explanations
di: Kunz, Jenny, et al.
Pubblicazione: (2024)
di: Kunz, Jenny, et al.
Pubblicazione: (2024)
GPTKB v1.5: A Massive Knowledge Base for Exploring Factual LLM Knowledge
di: Hu, Yujia, et al.
Pubblicazione: (2025)
di: Hu, Yujia, et al.
Pubblicazione: (2025)
Generating Benchmarks for Factuality Evaluation of Language Models
di: Muhlgay, Dor, et al.
Pubblicazione: (2023)
di: Muhlgay, Dor, et al.
Pubblicazione: (2023)
Factuality or Fiction? Benchmarking Modern LLMs on Ambiguous QA with Citations
di: Patel, Maya, et al.
Pubblicazione: (2024)
di: Patel, Maya, et al.
Pubblicazione: (2024)
Mitigating Geospatial Knowledge Hallucination in Large Language Models: Benchmarking and Dynamic Factuality Aligning
di: Wang, Shengyuan, et al.
Pubblicazione: (2025)
di: Wang, Shengyuan, et al.
Pubblicazione: (2025)
UAQFact: Evaluating Factual Knowledge Utilization of LLMs on Unanswerable Questions
di: Tan, Chuanyuan, et al.
Pubblicazione: (2025)
di: Tan, Chuanyuan, et al.
Pubblicazione: (2025)
Persuasion Tokens for Editing Factual Knowledge in LLMs
di: Youssef, Paul, et al.
Pubblicazione: (2026)
di: Youssef, Paul, et al.
Pubblicazione: (2026)
Family Matters: Language Transfer and Merging for Adapting Small LLMs to Faroese
di: Kunz, Jenny, et al.
Pubblicazione: (2025)
di: Kunz, Jenny, et al.
Pubblicazione: (2025)
KoSimpleQA: A Korean Factuality Benchmark with an Analysis of Reasoning LLMs
di: Ko, Donghyeon, et al.
Pubblicazione: (2025)
di: Ko, Donghyeon, et al.
Pubblicazione: (2025)
SummExecEdit: A Factual Consistency Benchmark in Summarization with Executable Edits
di: Thorat, Onkar, et al.
Pubblicazione: (2024)
di: Thorat, Onkar, et al.
Pubblicazione: (2024)
FactBench: A Dynamic Benchmark for In-the-Wild Language Model Factuality Evaluation
di: Bayat, Farima Fatahi, et al.
Pubblicazione: (2024)
di: Bayat, Farima Fatahi, et al.
Pubblicazione: (2024)
A Factuality and Diversity Reconciled Decoding Method for Knowledge-Grounded Dialogue Generation
di: Yang, Chenxu, et al.
Pubblicazione: (2024)
di: Yang, Chenxu, et al.
Pubblicazione: (2024)
FactNet: A Billion-Scale Knowledge Graph for Multilingual Factual Grounding
di: Shen, Yingli, et al.
Pubblicazione: (2026)
di: Shen, Yingli, et al.
Pubblicazione: (2026)
Knowledgeable In-Context Tuning: Exploring and Exploiting Factual Knowledge for In-Context Learning
di: Wang, Jianing, et al.
Pubblicazione: (2023)
di: Wang, Jianing, et al.
Pubblicazione: (2023)
ACE: Attribution-Controlled Knowledge Editing for Multi-hop Factual Recall
di: Yang, Jiayu, et al.
Pubblicazione: (2025)
di: Yang, Jiayu, et al.
Pubblicazione: (2025)
Understanding New-Knowledge-Induced Factual Hallucinations in LLMs: Analysis and Interpretation
di: Dang, Renfei, et al.
Pubblicazione: (2025)
di: Dang, Renfei, et al.
Pubblicazione: (2025)
AdversaRiskQA: An Adversarial Factuality Benchmark for High-Risk Domains
di: Szelestey, Adam, et al.
Pubblicazione: (2026)
di: Szelestey, Adam, et al.
Pubblicazione: (2026)
Aligning Knowledge Graphs and Language Models for Factual Accuracy
di: Nishat, Nur A Zarin, et al.
Pubblicazione: (2025)
di: Nishat, Nur A Zarin, et al.
Pubblicazione: (2025)
CCFQA: A Benchmark for Cross-Lingual and Cross-Modal Speech and Text Factuality Evaluation
di: Du, Yexing, et al.
Pubblicazione: (2025)
di: Du, Yexing, et al.
Pubblicazione: (2025)
The FACTS Leaderboard: A Comprehensive Benchmark for Large Language Model Factuality
di: Cheng, Aileen, et al.
Pubblicazione: (2025)
di: Cheng, Aileen, et al.
Pubblicazione: (2025)
Exploring the Generalizability of Factual Hallucination Mitigation via Enhancing Precise Knowledge Utilization
di: Zhang, Siyuan, et al.
Pubblicazione: (2025)
di: Zhang, Siyuan, et al.
Pubblicazione: (2025)
UniArk: Improving Generalisation and Consistency for Factual Knowledge Extraction through Debiasing
di: Yang, Yijun, et al.
Pubblicazione: (2024)
di: Yang, Yijun, et al.
Pubblicazione: (2024)
Investigating Multi-Hop Factual Shortcuts in Knowledge Editing of Large Language Models
di: Ju, Tianjie, et al.
Pubblicazione: (2024)
di: Ju, Tianjie, et al.
Pubblicazione: (2024)
Cracking Factual Knowledge: A Comprehensive Analysis of Degenerate Knowledge Neurons in Large Language Models
di: Chen, Yuheng, et al.
Pubblicazione: (2024)
di: Chen, Yuheng, et al.
Pubblicazione: (2024)
Reasoning Factual Knowledge in Structured Data with Large Language Models
di: Huang, Sirui, et al.
Pubblicazione: (2024)
di: Huang, Sirui, et al.
Pubblicazione: (2024)
Learning from Semi-Factuals: A Debiased and Semantic-Aware Framework for Generalized Relation Discovery
di: Wang, Jiaxin, et al.
Pubblicazione: (2024)
di: Wang, Jiaxin, et al.
Pubblicazione: (2024)
When Benchmarks Age: Temporal Misalignment through Large Language Model Factuality Evaluation
di: Jiang, Xunyi, et al.
Pubblicazione: (2025)
di: Jiang, Xunyi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Preferences for Idiomatic Language are Acquired Slowly -- and Forgotten Quickly: A Case Study on Swedish
di: Kunz, Jenny
Pubblicazione: (2026) -
Training Models on Dialects of Translationese Shows How Lexical Diversity and Source-Target Syntactic Similarity Shape Learning
di: Kunz, Jenny
Pubblicazione: (2026) -
Train More Parameters But Mind Their Placement: Insights into Language Adaptation with PEFT
di: Kunz, Jenny
Pubblicazione: (2024) -
SimpleQA Verified: A Reliable Factuality Benchmark to Measure Parametric Knowledge
di: Haas, Lukas, et al.
Pubblicazione: (2025) -
A Hypothesis-Driven Framework for the Analysis of Self-Rationalising Models
di: Braun, Marc, et al.
Pubblicazione: (2024)