CUS-QA: Local-Knowledge-Oriented Open-Ended Question Answering Dataset
Fuente:
arXiv
Salvato in:
| Autori principali: | Libovický, Jindřich, Helcl, Jindřich, Manea, Andrei, Vico, Gianluca |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Lexically Grounded Subword Segmentation
di: Libovický, Jindřich, et al.
Pubblicazione: (2024)
di: Libovický, Jindřich, et al.
Pubblicazione: (2024)
Crowdsourcing Piedmontese to Test LLMs on Non-Standard Orthography
di: Vico, Gianluca, et al.
Pubblicazione: (2026)
di: Vico, Gianluca, et al.
Pubblicazione: (2026)
Different Time, Different Language: Revisiting the Bias Against Non-Native Speakers in GPT Detectors
di: Ali, Adnan Al, et al.
Pubblicazione: (2026)
di: Ali, Adnan Al, et al.
Pubblicazione: (2026)
Multilingual Vision-Language Models, A Survey
di: Manea, Andrei-Alexandru, et al.
Pubblicazione: (2025)
di: Manea, Andrei-Alexandru, et al.
Pubblicazione: (2025)
Investigating the Effect of Parallel Data in the Cross-Lingual Transfer for Vision-Language Encoders
di: Manea, Andrei-Alexandru, et al.
Pubblicazione: (2025)
di: Manea, Andrei-Alexandru, et al.
Pubblicazione: (2025)
On the Credibility of Evaluating LLMs using Survey Questions
di: Libovický, Jindřich
Pubblicazione: (2026)
di: Libovický, Jindřich
Pubblicazione: (2026)
Teaching LLMs at Charles University: Assignments and Activities
di: Helcl, Jindřich, et al.
Pubblicazione: (2024)
di: Helcl, Jindřich, et al.
Pubblicazione: (2024)
Evaluating Morphological Plausibility of Subword Tokenization via Statistical Alignment with Morpho-Syntactic Features
di: Stephen, Abishek, et al.
Pubblicazione: (2026)
di: Stephen, Abishek, et al.
Pubblicazione: (2026)
How Gender Interacts with Political Values: A Case Study on Czech BERT Models
di: Ali, Adnan Al, et al.
Pubblicazione: (2024)
di: Ali, Adnan Al, et al.
Pubblicazione: (2024)
Atyaephyra at SemEval-2025 Task 4: Low-Rank Negative Preference Optimization
di: Bronec, Jan, et al.
Pubblicazione: (2025)
di: Bronec, Jan, et al.
Pubblicazione: (2025)
Understanding Cross-Lingual Alignment -- A Survey
di: Hämmerl, Katharina, et al.
Pubblicazione: (2024)
di: Hämmerl, Katharina, et al.
Pubblicazione: (2024)
LLM as a Meta-Judge: Synthetic Data for NLP Evaluation Metric Validation
di: Eigler, Lukáš, et al.
Pubblicazione: (2026)
di: Eigler, Lukáš, et al.
Pubblicazione: (2026)
Charles Translator: A Machine Translation System between Ukrainian and Czech
di: Popel, Martin, et al.
Pubblicazione: (2024)
di: Popel, Martin, et al.
Pubblicazione: (2024)
Conditional Unigram Tokenization with Parallel Data
di: Vico, Gianluca, et al.
Pubblicazione: (2025)
di: Vico, Gianluca, et al.
Pubblicazione: (2025)
Beyond Literal Token Overlap: Token Alignability for Multilinguality
di: Hämmerl, Katharina, et al.
Pubblicazione: (2025)
di: Hämmerl, Katharina, et al.
Pubblicazione: (2025)
OpenLID-v3: Improving the Precision of Closely Related Language Identification -- An Experience Report
di: Fedorova, Mariia, et al.
Pubblicazione: (2026)
di: Fedorova, Mariia, et al.
Pubblicazione: (2026)
Enhancing Conceptual Understanding in Multimodal Contrastive Learning through Hard Negative Samples
di: Rösch, Philipp J., et al.
Pubblicazione: (2024)
di: Rösch, Philipp J., et al.
Pubblicazione: (2024)
KET-QA: A Dataset for Knowledge Enhanced Table Question Answering
di: Hu, Mengkang, et al.
Pubblicazione: (2024)
di: Hu, Mengkang, et al.
Pubblicazione: (2024)
PolQA: Polish Question Answering Dataset
di: Rybak, Piotr, et al.
Pubblicazione: (2022)
di: Rybak, Piotr, et al.
Pubblicazione: (2022)
DebateQA: Evaluating Question Answering on Debatable Knowledge
di: Xu, Rongwu, et al.
Pubblicazione: (2024)
di: Xu, Rongwu, et al.
Pubblicazione: (2024)
Multilingual Text-to-Image Generation Magnifies Gender Stereotypes and Prompt Engineering May Not Help You
di: Friedrich, Felix, et al.
Pubblicazione: (2024)
di: Friedrich, Felix, et al.
Pubblicazione: (2024)
SemEval-2025 Task 3: Mu-SHROOM, the Multilingual Shared Task on Hallucinations and Related Observable Overgeneration Mistakes
di: Vázquez, Raúl, et al.
Pubblicazione: (2025)
di: Vázquez, Raúl, et al.
Pubblicazione: (2025)
GRS-QA -- Graph Reasoning-Structured Question Answering Dataset
di: Pahilajani, Anish, et al.
Pubblicazione: (2024)
di: Pahilajani, Anish, et al.
Pubblicazione: (2024)
FoQA: A Faroese Question-Answering Dataset
di: Simonsen, Annika, et al.
Pubblicazione: (2025)
di: Simonsen, Annika, et al.
Pubblicazione: (2025)
From National Curricula to Cultural Awareness: Constructing Open-Ended Culture-Specific Question Answering Dataset
di: Yoo, Haneul, et al.
Pubblicazione: (2026)
di: Yoo, Haneul, et al.
Pubblicazione: (2026)
ArabicaQA: A Comprehensive Dataset for Arabic Question Answering
di: Abdallah, Abdelrahman, et al.
Pubblicazione: (2024)
di: Abdallah, Abdelrahman, et al.
Pubblicazione: (2024)
SyllabusQA: A Course Logistics Question Answering Dataset
di: Fernandez, Nigel, et al.
Pubblicazione: (2024)
di: Fernandez, Nigel, et al.
Pubblicazione: (2024)
CondAmbigQA: A Benchmark and Dataset for Conditional Ambiguous Question Answering
di: Li, Zongxi, et al.
Pubblicazione: (2025)
di: Li, Zongxi, et al.
Pubblicazione: (2025)
JDocQA: Japanese Document Question Answering Dataset for Generative Language Models
di: Onami, Eri, et al.
Pubblicazione: (2024)
di: Onami, Eri, et al.
Pubblicazione: (2024)
A Semantic-Sampling Framework for Evaluating Calibration in Open-Ended Question Answering
di: Wang, Zhanliang, et al.
Pubblicazione: (2026)
di: Wang, Zhanliang, et al.
Pubblicazione: (2026)
RetinaQA: A Robust Knowledge Base Question Answering Model for both Answerable and Unanswerable Questions
di: Faldu, Prayushi, et al.
Pubblicazione: (2024)
di: Faldu, Prayushi, et al.
Pubblicazione: (2024)
ComplexTempQA:A 100m Dataset for Complex Temporal Question Answering
di: Gruber, Raphael, et al.
Pubblicazione: (2024)
di: Gruber, Raphael, et al.
Pubblicazione: (2024)
EffiQA: Efficient Question-Answering with Strategic Multi-Model Collaboration on Knowledge Graphs
di: Dong, Zixuan, et al.
Pubblicazione: (2024)
di: Dong, Zixuan, et al.
Pubblicazione: (2024)
FinTextQA: A Dataset for Long-form Financial Question Answering
di: Chen, Jian, et al.
Pubblicazione: (2024)
di: Chen, Jian, et al.
Pubblicazione: (2024)
Beyond Factual QA: Mentorship-Oriented Question Answering over Long-Form Multilingual Content
di: Bhalerao, Parth, et al.
Pubblicazione: (2026)
di: Bhalerao, Parth, et al.
Pubblicazione: (2026)
MapQA: Open-domain Geospatial Question Answering on Map Data
di: Li, Zekun, et al.
Pubblicazione: (2025)
di: Li, Zekun, et al.
Pubblicazione: (2025)
O$^2$-Searcher: A Searching-based Agent Model for Open-Domain Open-Ended Question Answering
di: Mei, Jianbiao, et al.
Pubblicazione: (2025)
di: Mei, Jianbiao, et al.
Pubblicazione: (2025)
KazQAD: Kazakh Open-Domain Question Answering Dataset
di: Yeshpanov, Rustem, et al.
Pubblicazione: (2024)
di: Yeshpanov, Rustem, et al.
Pubblicazione: (2024)
DragonVerseQA: Open-Domain Long-Form Context-Aware Question-Answering
di: Lahiri, Aritra Kumar, et al.
Pubblicazione: (2024)
di: Lahiri, Aritra Kumar, et al.
Pubblicazione: (2024)
MFORT-QA: Multi-hop Few-shot Open Rich Table Question Answering
di: Guan, Che, et al.
Pubblicazione: (2024)
di: Guan, Che, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Lexically Grounded Subword Segmentation
di: Libovický, Jindřich, et al.
Pubblicazione: (2024) -
Crowdsourcing Piedmontese to Test LLMs on Non-Standard Orthography
di: Vico, Gianluca, et al.
Pubblicazione: (2026) -
Different Time, Different Language: Revisiting the Bias Against Non-Native Speakers in GPT Detectors
di: Ali, Adnan Al, et al.
Pubblicazione: (2026) -
Multilingual Vision-Language Models, A Survey
di: Manea, Andrei-Alexandru, et al.
Pubblicazione: (2025) -
Investigating the Effect of Parallel Data in the Cross-Lingual Transfer for Vision-Language Encoders
di: Manea, Andrei-Alexandru, et al.
Pubblicazione: (2025)