OpenStaxQA: A multilingual dataset based on open-source college textbooks
Fuente:
arXiv
Salvato in:
| Autore principale: | Gupta, Pranav |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SENSE models: an open source solution for multilingual and multimodal semantic-based tasks
di: Mdhaffar, Salima, et al.
Pubblicazione: (2025)
di: Mdhaffar, Salima, et al.
Pubblicazione: (2025)
WorldMedQA-V: a multilingual, multimodal medical examination dataset for multimodal language models evaluation
di: Matos, João, et al.
Pubblicazione: (2024)
di: Matos, João, et al.
Pubblicazione: (2024)
GLeMM: A large-scale multilingual dataset for morphological research
di: Nabil, Hathout, et al.
Pubblicazione: (2026)
di: Nabil, Hathout, et al.
Pubblicazione: (2026)
Automatic register identification for the open web using multilingual deep learning
di: Henriksson, Erik, et al.
Pubblicazione: (2024)
di: Henriksson, Erik, et al.
Pubblicazione: (2024)
CueBuddy: helping non-native English speakers navigate English-centric STEM education
di: Gupta, Pranav
Pubblicazione: (2025)
di: Gupta, Pranav
Pubblicazione: (2025)
A Breadth-First Catalog of Text Processing, Speech Processing and Multimodal Research in South Asian Languages
di: Gupta, Pranav
Pubblicazione: (2024)
di: Gupta, Pranav
Pubblicazione: (2024)
Figurative Archive: an open dataset and web-based application for the study of metaphor
di: Bressler, Maddalena, et al.
Pubblicazione: (2025)
di: Bressler, Maddalena, et al.
Pubblicazione: (2025)
ExpertGenQA: Open-ended QA generation in Specialized Domains
di: Shahgir, Haz Sameen, et al.
Pubblicazione: (2025)
di: Shahgir, Haz Sameen, et al.
Pubblicazione: (2025)
MedConceptsQA: Open Source Medical Concepts QA Benchmark
di: Shoham, Ofir Ben, et al.
Pubblicazione: (2024)
di: Shoham, Ofir Ben, et al.
Pubblicazione: (2024)
Optimal strategies to perform multilingual analysis of social content for a novel dataset in the tourism domain
di: Masson, Maxime, et al.
Pubblicazione: (2023)
di: Masson, Maxime, et al.
Pubblicazione: (2023)
Accurate and Nuanced Open-QA Evaluation Through Textual Entailment
di: Yao, Peiran, et al.
Pubblicazione: (2024)
di: Yao, Peiran, et al.
Pubblicazione: (2024)
Multilingual Open QA on the MIA Shared Task
di: Yarrabelly, Navya, et al.
Pubblicazione: (2025)
di: Yarrabelly, Navya, et al.
Pubblicazione: (2025)
HistoryBankQA: Multilingual Temporal Question Answering on Historical Events
di: Mandal, Biswadip, et al.
Pubblicazione: (2025)
di: Mandal, Biswadip, et al.
Pubblicazione: (2025)
TANQ: An open domain dataset of table answered questions
di: Akhtar, Mubashara, et al.
Pubblicazione: (2024)
di: Akhtar, Mubashara, et al.
Pubblicazione: (2024)
Who Judges the Judge? Evaluating LLM-as-a-Judge for French Medical open-ended QA
di: Belmadani, Ikram, et al.
Pubblicazione: (2026)
di: Belmadani, Ikram, et al.
Pubblicazione: (2026)
Building Efficient and Effective OpenQA Systems for Low-Resource Languages
di: Budur, Emrah, et al.
Pubblicazione: (2024)
di: Budur, Emrah, et al.
Pubblicazione: (2024)
RJUA-QA: A Comprehensive QA Dataset for Urology
di: Lyu, Shiwei, et al.
Pubblicazione: (2023)
di: Lyu, Shiwei, et al.
Pubblicazione: (2023)
BIT.UA-AAUBS at ArchEHR-QA 2026: Evaluating Open-Source and Proprietary LLMs via Prompting in Low-Resource QA
di: Jonker, Richard A. A., et al.
Pubblicazione: (2026)
di: Jonker, Richard A. A., et al.
Pubblicazione: (2026)
SEC-QA: A Systematic Evaluation Corpus for Financial QA
di: Lai, Viet Dac, et al.
Pubblicazione: (2024)
di: Lai, Viet Dac, et al.
Pubblicazione: (2024)
CUS-QA: Local-Knowledge-Oriented Open-Ended Question Answering Dataset
di: Libovický, Jindřich, et al.
Pubblicazione: (2025)
di: Libovický, Jindřich, et al.
Pubblicazione: (2025)
HelpSteer2: Open-source dataset for training top-performing reward models
di: Wang, Zhilin, et al.
Pubblicazione: (2024)
di: Wang, Zhilin, et al.
Pubblicazione: (2024)
Morphosyntactic probing of multilingual BERT models
di: Acs, Judit, et al.
Pubblicazione: (2023)
di: Acs, Judit, et al.
Pubblicazione: (2023)
How effective is Multi-source pivoting for Translation of Low Resource Indian Languages?
di: Gaikwad, Pranav, et al.
Pubblicazione: (2024)
di: Gaikwad, Pranav, et al.
Pubblicazione: (2024)
RealMedQA: A pilot biomedical question answering dataset containing realistic clinical questions
di: Kell, Gregory, et al.
Pubblicazione: (2024)
di: Kell, Gregory, et al.
Pubblicazione: (2024)
The Lucie-7B LLM and the Lucie Training Dataset: Open resources for multilingual language generation
di: Gouvert, Olivier, et al.
Pubblicazione: (2025)
di: Gouvert, Olivier, et al.
Pubblicazione: (2025)
An Answer is just the Start: Related Insight Generation for Open-Ended Document-Grounded QA
di: Sharma, Saransh, et al.
Pubblicazione: (2026)
di: Sharma, Saransh, et al.
Pubblicazione: (2026)
Open-sci-ref-0.01: open and reproducible reference baselines for language model and dataset comparison
di: Nezhurina, Marianna, et al.
Pubblicazione: (2025)
di: Nezhurina, Marianna, et al.
Pubblicazione: (2025)
Prompto: An open source library for asynchronous querying of LLM endpoints
di: Chan, Ryan Sze-Yin, et al.
Pubblicazione: (2024)
di: Chan, Ryan Sze-Yin, et al.
Pubblicazione: (2024)
A multilingual hallucination benchmark: MultiWikiQHalluA
di: Thoresen, Freja, et al.
Pubblicazione: (2026)
di: Thoresen, Freja, et al.
Pubblicazione: (2026)
BASE-SQL: A powerful open source Text-To-SQL baseline approach
di: Sheng, Lei, et al.
Pubblicazione: (2025)
di: Sheng, Lei, et al.
Pubblicazione: (2025)
Continuous sentiment scores for literary and multilingual contexts
di: Lyngbaek, Laurits, et al.
Pubblicazione: (2025)
di: Lyngbaek, Laurits, et al.
Pubblicazione: (2025)
Few-Shot Multilingual Open-Domain QA from 5 Examples
di: Jiang, Fan, et al.
Pubblicazione: (2025)
di: Jiang, Fan, et al.
Pubblicazione: (2025)
QA-LIGN: Aligning LLMs through Constitutionally Decomposed QA
di: Dineen, Jacob, et al.
Pubblicazione: (2025)
di: Dineen, Jacob, et al.
Pubblicazione: (2025)
BeanCounter: A low-toxicity, large-scale, and open dataset of business-oriented text
di: Wang, Siyan, et al.
Pubblicazione: (2024)
di: Wang, Siyan, et al.
Pubblicazione: (2024)
CRAFT: Training-Free Cascaded Retrieval for Tabular QA
di: Singh, Adarsh, et al.
Pubblicazione: (2025)
di: Singh, Adarsh, et al.
Pubblicazione: (2025)
MinosEval: Distinguishing Factoid and Non-Factoid for Tailored Open-Ended QA Evaluation with LLMs
di: Fan, Yongqi, et al.
Pubblicazione: (2025)
di: Fan, Yongqi, et al.
Pubblicazione: (2025)
NovelHopQA: Diagnosing Multi-Hop Reasoning Failures in Long Narrative Contexts
di: Gupta, Abhay, et al.
Pubblicazione: (2025)
di: Gupta, Abhay, et al.
Pubblicazione: (2025)
Evaluating open-source Large Language Models for automated fact-checking
di: Fontana, Nicolo', et al.
Pubblicazione: (2025)
di: Fontana, Nicolo', et al.
Pubblicazione: (2025)
OpenLLM-Ro -- Technical Report on Open-source Romanian LLMs
di: Masala, Mihai, et al.
Pubblicazione: (2024)
di: Masala, Mihai, et al.
Pubblicazione: (2024)
Contextual Breach: Assessing the Robustness of Transformer-based QA Models
di: Saadat, Asir, et al.
Pubblicazione: (2024)
di: Saadat, Asir, et al.
Pubblicazione: (2024)
Documenti analoghi
-
SENSE models: an open source solution for multilingual and multimodal semantic-based tasks
di: Mdhaffar, Salima, et al.
Pubblicazione: (2025) -
WorldMedQA-V: a multilingual, multimodal medical examination dataset for multimodal language models evaluation
di: Matos, João, et al.
Pubblicazione: (2024) -
GLeMM: A large-scale multilingual dataset for morphological research
di: Nabil, Hathout, et al.
Pubblicazione: (2026) -
Automatic register identification for the open web using multilingual deep learning
di: Henriksson, Erik, et al.
Pubblicazione: (2024) -
CueBuddy: helping non-native English speakers navigate English-centric STEM education
di: Gupta, Pranav
Pubblicazione: (2025)