Suvach -- Generated Hindi QA benchmark
Fuente:
arXiv
Salvato in:
| Autori principali: | Narayanan, Vaishak, KP, Prabin Raj, Nouphal, Saifudheen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HindiLLM: Large Language Model for Hindi
di: Chouhan, Sanjay, et al.
Pubblicazione: (2024)
di: Chouhan, Sanjay, et al.
Pubblicazione: (2024)
A Survey on Prompting Techniques in LLMs
di: Bhandari, Prabin
Pubblicazione: (2023)
di: Bhandari, Prabin
Pubblicazione: (2023)
Airavata: Introducing Hindi Instruction-tuned LLM
di: Gala, Jay, et al.
Pubblicazione: (2024)
di: Gala, Jay, et al.
Pubblicazione: (2024)
Zero, Finite, and Infinite Belief History of Theory of Mind Reasoning in Large Language Models
di: Tang, Weizhi, et al.
Pubblicazione: (2024)
di: Tang, Weizhi, et al.
Pubblicazione: (2024)
ToM-LM: Delegating Theory of Mind Reasoning to External Symbolic Executors in Large Language Models
di: Tang, Weizhi, et al.
Pubblicazione: (2024)
di: Tang, Weizhi, et al.
Pubblicazione: (2024)
Multilingual Mathematical Reasoning: Advancing Open-Source LLMs in Hindi and English
di: Anand, Avinash, et al.
Pubblicazione: (2024)
di: Anand, Avinash, et al.
Pubblicazione: (2024)
LTLBench: Towards Benchmarks for Evaluating Temporal Reasoning in Large Language Models
di: Tang, Weizhi, et al.
Pubblicazione: (2024)
di: Tang, Weizhi, et al.
Pubblicazione: (2024)
Multi-class Regret Detection in Hindi Devanagari Script
di: Sharma, Renuka, et al.
Pubblicazione: (2024)
di: Sharma, Renuka, et al.
Pubblicazione: (2024)
RAG-BioQA: A Retrieval-Augmented Generation Framework for Long-Form Biomedical Question Answering
di: Panchumarthi, Lovely Yeswanth, et al.
Pubblicazione: (2025)
di: Panchumarthi, Lovely Yeswanth, et al.
Pubblicazione: (2025)
Survey of Pseudonymization, Abstractive Summarization & Spell Checker for Hindi and Marathi
di: Ransing, Rasika, et al.
Pubblicazione: (2024)
di: Ransing, Rasika, et al.
Pubblicazione: (2024)
DeepRAG: Building a Custom Hindi Embedding Model for Retrieval Augmented Generation from Scratch
di: M, Nandakishor
Pubblicazione: (2025)
di: M, Nandakishor
Pubblicazione: (2025)
HLDC: Hindi Legal Documents Corpus
di: Kapoor, Arnav, et al.
Pubblicazione: (2022)
di: Kapoor, Arnav, et al.
Pubblicazione: (2022)
Multilingual LLMs Are Not Multilingual Thinkers: Evidence from Hindi Analogy Evaluation
di: Gupta, Ashray, et al.
Pubblicazione: (2025)
di: Gupta, Ashray, et al.
Pubblicazione: (2025)
Raising Bars, Not Parameters: LilMoo Compact Language Model for Hindi
di: Fatimah, Shiza, et al.
Pubblicazione: (2026)
di: Fatimah, Shiza, et al.
Pubblicazione: (2026)
'Since Lawyers are Males..': Examining Implicit Gender Bias in Hindi Language Generation by LLMs
di: Joshi, Ishika, et al.
Pubblicazione: (2024)
di: Joshi, Ishika, et al.
Pubblicazione: (2024)
Building pre-train LLM Dataset for the INDIC Languages: a case study on Hindi
di: Parida, Shantipriya, et al.
Pubblicazione: (2024)
di: Parida, Shantipriya, et al.
Pubblicazione: (2024)
An Under-Explored Application for Explainable Multimodal Misogyny Detection in code-mixed Hindi-English
di: Yadav, Sargam, et al.
Pubblicazione: (2026)
di: Yadav, Sargam, et al.
Pubblicazione: (2026)
LiteraryQA: Towards Effective Evaluation of Long-document Narrative QA
di: Bonomo, Tommaso, et al.
Pubblicazione: (2025)
di: Bonomo, Tommaso, et al.
Pubblicazione: (2025)
Social Bias Benchmark for Generation: A Comparison of Generation and QA-Based Evaluations
di: Jin, Jiho, et al.
Pubblicazione: (2025)
di: Jin, Jiho, et al.
Pubblicazione: (2025)
MedSumm: A Multimodal Approach to Summarizing Code-Mixed Hindi-English Clinical Queries
di: Ghosh, Akash, et al.
Pubblicazione: (2024)
di: Ghosh, Akash, et al.
Pubblicazione: (2024)
Bridging the Data Gap: Creating a Hindi Text Summarization Dataset from the English XSUM
di: Katwe, Praveenkumar, et al.
Pubblicazione: (2026)
di: Katwe, Praveenkumar, et al.
Pubblicazione: (2026)
COMI-LINGUA: Expert Annotated Large-Scale Dataset for Multitask NLP in Hindi-English Code-Mixing
di: Sheth, Rajvee, et al.
Pubblicazione: (2025)
di: Sheth, Rajvee, et al.
Pubblicazione: (2025)
AirQA: A Comprehensive QA Dataset for AI Research with Instance-Level Evaluation
di: Huang, Tiancheng, et al.
Pubblicazione: (2025)
di: Huang, Tiancheng, et al.
Pubblicazione: (2025)
Revealing the impact of synthetic native samples and multi-tasking strategies in Hindi-English code-mixed humour and sarcasm detection
di: Mazumder, Debajyoti, et al.
Pubblicazione: (2024)
di: Mazumder, Debajyoti, et al.
Pubblicazione: (2024)
Enhancing Hindi NER in Low Context: A Comparative study of Transformer-based models with vs. without Retrieval Augmentation
di: Singh, Sumit, et al.
Pubblicazione: (2025)
di: Singh, Sumit, et al.
Pubblicazione: (2025)
Human-1 by Josh Talks: A Full-Duplex Conversational Modeling Framework in Hindi using Real-World Conversations
di: Singh, Bhaskar, et al.
Pubblicazione: (2026)
di: Singh, Bhaskar, et al.
Pubblicazione: (2026)
FairytaleQA Translated: Enabling Educational Question and Answer Generation in Less-Resourced Languages
di: Leite, Bernardo, et al.
Pubblicazione: (2024)
di: Leite, Bernardo, et al.
Pubblicazione: (2024)
KGQuest: Template-Driven QA Generation from Knowledge Graphs with LLM-Based Refinement
di: Nayab, Sania, et al.
Pubblicazione: (2025)
di: Nayab, Sania, et al.
Pubblicazione: (2025)
SubjECTive-QA: Measuring Subjectivity in Earnings Call Transcripts' QA Through Six-Dimensional Feature Analysis
di: Pardawala, Huzaifa, et al.
Pubblicazione: (2024)
di: Pardawala, Huzaifa, et al.
Pubblicazione: (2024)
Advantages of Domain Knowledge Injection for Legal Document Summarization: A Case Study on Summarizing Indian Court Judgments in English and Hindi
di: Datta, Debtanu, et al.
Pubblicazione: (2026)
di: Datta, Debtanu, et al.
Pubblicazione: (2026)
M3SciQA: A Multi-Modal Multi-Document Scientific QA Benchmark for Evaluating Foundation Models
di: Li, Chuhan, et al.
Pubblicazione: (2024)
di: Li, Chuhan, et al.
Pubblicazione: (2024)
CF-RAG: A Dataset and Method for Carbon Footprint QA Using Retrieval-Augmented Generation
di: Zhao, Kaiwen, et al.
Pubblicazione: (2025)
di: Zhao, Kaiwen, et al.
Pubblicazione: (2025)
GRADE: Generating multi-hop QA and fine-gRAined Difficulty matrix for RAG Evaluation
di: Lee, Jeongsoo, et al.
Pubblicazione: (2025)
di: Lee, Jeongsoo, et al.
Pubblicazione: (2025)
TCE at Qur'an QA 2023 Shared Task: Low Resource Enhanced Transformer-based Ensemble Approach for Qur'anic QA
di: Elkomy, Mohammed Alaa, et al.
Pubblicazione: (2024)
di: Elkomy, Mohammed Alaa, et al.
Pubblicazione: (2024)
RE-RAG: Improving Open-Domain QA Performance and Interpretability with Relevance Estimator in Retrieval-Augmented Generation
di: Kim, Kiseung, et al.
Pubblicazione: (2024)
di: Kim, Kiseung, et al.
Pubblicazione: (2024)
RePPL: Recalibrating Perplexity by Uncertainty in Semantic Propagation and Language Generation for Explainable QA Hallucination Detection
di: Huang, Yiming, et al.
Pubblicazione: (2025)
di: Huang, Yiming, et al.
Pubblicazione: (2025)
TriNER: A Series of Named Entity Recognition Models For Hindi, Bengali & Marathi
di: Dhamaskar, Mohammed Amaan, et al.
Pubblicazione: (2025)
di: Dhamaskar, Mohammed Amaan, et al.
Pubblicazione: (2025)
WHODUNIT: Evaluation benchmark for culprit detection in mystery stories
di: Gupta, Kshitij
Pubblicazione: (2025)
di: Gupta, Kshitij
Pubblicazione: (2025)
DeCode: Decoupling Content and Delivery for Medical QA
di: Ko, Po-Jen, et al.
Pubblicazione: (2026)
di: Ko, Po-Jen, et al.
Pubblicazione: (2026)
ExpertQA: Expert-Curated Questions and Attributed Answers
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2023)
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2023)
Documenti analoghi
-
HindiLLM: Large Language Model for Hindi
di: Chouhan, Sanjay, et al.
Pubblicazione: (2024) -
A Survey on Prompting Techniques in LLMs
di: Bhandari, Prabin
Pubblicazione: (2023) -
Airavata: Introducing Hindi Instruction-tuned LLM
di: Gala, Jay, et al.
Pubblicazione: (2024) -
Zero, Finite, and Infinite Belief History of Theory of Mind Reasoning in Large Language Models
di: Tang, Weizhi, et al.
Pubblicazione: (2024) -
ToM-LM: Delegating Theory of Mind Reasoning to External Symbolic Executors in Large Language Models
di: Tang, Weizhi, et al.
Pubblicazione: (2024)