Multilingual Open QA on the MIA Shared Task
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yarrabelly, Navya, Mittal, Saloni, Todi, Ketan, Hasegawa, Kimihiro |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multimodal Multihop Source Retrieval for Web Question Answering
par: Yarrabelly, Navya, et autres
Publié: (2025)
par: Yarrabelly, Navya, et autres
Publié: (2025)
Mitigating Gender Bias in Contextual Word Embeddings
par: Yarrabelly, Navya, et autres
Publié: (2024)
par: Yarrabelly, Navya, et autres
Publié: (2024)
L3Cube-MahaNews: News-based Short Text and Long Document Classification Datasets in Marathi
par: Mittal, Saloni, et autres
Publié: (2024)
par: Mittal, Saloni, et autres
Publié: (2024)
MedConceptsQA: Open Source Medical Concepts QA Benchmark
par: Shoham, Ofir Ben, et autres
Publié: (2024)
par: Shoham, Ofir Ben, et autres
Publié: (2024)
GATech at AbjadGenEval Shared Task: Multilingual Embeddings for Arabic Machine-Generated Text Classification
par: Khamis, Ahmed Khaled
Publié: (2026)
par: Khamis, Ahmed Khaled
Publié: (2026)
Multi-Reference Preference Optimization for Large Language Models
par: Le, Hung, et autres
Publié: (2024)
par: Le, Hung, et autres
Publié: (2024)
TextGram: Towards a better domain-adaptive pretraining
par: Hiwarkhedkar, Sharayu, et autres
Publié: (2024)
par: Hiwarkhedkar, Sharayu, et autres
Publié: (2024)
Perhaps PTLMs Should Go to School -- A Task to Assess Open Book and Closed Book QA
par: Ciosici, Manuel R., et autres
Publié: (2021)
par: Ciosici, Manuel R., et autres
Publié: (2021)
Prompting Policies for Multi-step Reasoning and Tool-Use in Black-box LLMs with Iterative Distillation of Experience
par: Sayana, Krishna, et autres
Publié: (2026)
par: Sayana, Krishna, et autres
Publié: (2026)
Exploring the Limits of Model Compression in LLMs: A Knowledge Distillation Study on QA Tasks
par: Datta, Joyeeta, et autres
Publié: (2025)
par: Datta, Joyeeta, et autres
Publié: (2025)
Disentangling Language Roles in Multilingual LLM Task Execution
par: Zhan, Qishi, et autres
Publié: (2026)
par: Zhan, Qishi, et autres
Publié: (2026)
ConvKGYarn: Spinning Configurable and Scalable Conversational Knowledge Graph QA datasets with Large Language Models
par: Pradeep, Ronak, et autres
Publié: (2024)
par: Pradeep, Ronak, et autres
Publié: (2024)
Beyond Shared Vocabulary: Increasing Representational Word Similarities across Languages for Multilingual Machine Translation
par: Wu, Di, et autres
Publié: (2023)
par: Wu, Di, et autres
Publié: (2023)
Orion-14B: Open-source Multilingual Large Language Models
par: Chen, Du, et autres
Publié: (2024)
par: Chen, Du, et autres
Publié: (2024)
Data Contamination Report from the 2024 CONDA Shared Task
par: Sainz, Oscar, et autres
Publié: (2024)
par: Sainz, Oscar, et autres
Publié: (2024)
KG-TRICK: Unifying Textual and Relational Information Completion of Knowledge for Multilingual Knowledge Graphs
par: Zhou, Zelin, et autres
Publié: (2025)
par: Zhou, Zelin, et autres
Publié: (2025)
MIA-Tuner: Adapting Large Language Models as Pre-training Text Detector
par: Fu, Wenjie, et autres
Publié: (2024)
par: Fu, Wenjie, et autres
Publié: (2024)
Clinical QA 2.0: Multi-Task Learning for Answer Extraction and Categorization
par: Pattnayak, Priyaranjan, et autres
Publié: (2025)
par: Pattnayak, Priyaranjan, et autres
Publié: (2025)
DocMIA: Document-Level Membership Inference Attacks against DocVQA Models
par: Nguyen, Khanh, et autres
Publié: (2025)
par: Nguyen, Khanh, et autres
Publié: (2025)
LegalLens Shared Task 2024: Legal Violation Identification in Unstructured Text
par: Hagag, Ben, et autres
Publié: (2024)
par: Hagag, Ben, et autres
Publié: (2024)
Overview of the 2023 ICON Shared Task on Gendered Abuse Detection in Indic Languages
par: Vaidya, Aatman, et autres
Publié: (2024)
par: Vaidya, Aatman, et autres
Publié: (2024)
HMS-BERT: Hybrid Multi-Task Self-Training for Multilingual and Multi-Label Cyberbullying Detection
par: Feng, Zixin, et autres
Publié: (2026)
par: Feng, Zixin, et autres
Publié: (2026)
SuRe: Summarizing Retrievals using Answer Candidates for Open-domain QA of LLMs
par: Kim, Jaehyung, et autres
Publié: (2024)
par: Kim, Jaehyung, et autres
Publié: (2024)
QA-Calibration of Language Model Confidence Scores
par: Manggala, Putra, et autres
Publié: (2024)
par: Manggala, Putra, et autres
Publié: (2024)
Multilingual Amnesia: On the Transferability of Unlearning in Multilingual LLMs
par: Farashah, Alireza Dehghanpour, et autres
Publié: (2026)
par: Farashah, Alireza Dehghanpour, et autres
Publié: (2026)
LyS at SemEval 2025 Task 8: Zero-Shot Code Generation for Tabular QA
par: Gude, Adrián, et autres
Publié: (2025)
par: Gude, Adrián, et autres
Publié: (2025)
BlackboxNLP-2025 MIB Shared Task: Exploring Ensemble Strategies for Circuit Localization Methods
par: Mondorf, Philipp, et autres
Publié: (2025)
par: Mondorf, Philipp, et autres
Publié: (2025)
CVPD at QIAS 2025 Shared Task: An Efficient Encoder-Based Approach for Islamic Inheritance Reasoning
par: Bekhouche, Salah Eddine, et autres
Publié: (2025)
par: Bekhouche, Salah Eddine, et autres
Publié: (2025)
LOLA -- An Open-Source Massively Multilingual Large Language Model
par: Srivastava, Nikit, et autres
Publié: (2024)
par: Srivastava, Nikit, et autres
Publié: (2024)
FoQA: A Faroese Question-Answering Dataset
par: Simonsen, Annika, et autres
Publié: (2025)
par: Simonsen, Annika, et autres
Publié: (2025)
Do LLMs Follow Their Own Rules? A Reflexive Audit of Self-Stated Safety Policies
par: Mittal, Avni
Publié: (2026)
par: Mittal, Avni
Publié: (2026)
Did You Forget What I Asked? Prospective Memory Failures in Large Language Models
par: Mittal, Avni
Publié: (2026)
par: Mittal, Avni
Publié: (2026)
HiQA: A Hierarchical Contextual Augmentation RAG for Multi-Documents QA
par: Chen, Xinyue, et autres
Publié: (2024)
par: Chen, Xinyue, et autres
Publié: (2024)
FictionalQA: A Dataset for Studying Memorization and Knowledge Acquisition
par: Kirchenbauer, John, et autres
Publié: (2025)
par: Kirchenbauer, John, et autres
Publié: (2025)
Shared Lexical Task Representations Explain Behavioral Variability In LLMs
par: Yang, Zhuonan, et autres
Publié: (2026)
par: Yang, Zhuonan, et autres
Publié: (2026)
BigDocs: An Open Dataset for Training Multimodal Models on Document and Code Tasks
par: Rodriguez, Juan, et autres
Publié: (2024)
par: Rodriguez, Juan, et autres
Publié: (2024)
KInITVeraAI at SemEval-2023 Task 3: Simple yet Powerful Multilingual Fine-Tuning for Persuasion Techniques Detection
par: Hromadka, Timo, et autres
Publié: (2023)
par: Hromadka, Timo, et autres
Publié: (2023)
Aurora-M: Open Source Continual Pre-training for Multilingual Language and Code
par: Nakamura, Taishi, et autres
Publié: (2024)
par: Nakamura, Taishi, et autres
Publié: (2024)
MOSLD-Bench: Multilingual Open-Set Learning and Discovery Benchmark for Text Categorization
par: Costache, Adriana-Valentina, et autres
Publié: (2026)
par: Costache, Adriana-Valentina, et autres
Publié: (2026)
AutoSDT: Scaling Data-Driven Discovery Tasks Toward Open Co-Scientists
par: Li, Yifei, et autres
Publié: (2025)
par: Li, Yifei, et autres
Publié: (2025)
Documents similaires
-
Multimodal Multihop Source Retrieval for Web Question Answering
par: Yarrabelly, Navya, et autres
Publié: (2025) -
Mitigating Gender Bias in Contextual Word Embeddings
par: Yarrabelly, Navya, et autres
Publié: (2024) -
L3Cube-MahaNews: News-based Short Text and Long Document Classification Datasets in Marathi
par: Mittal, Saloni, et autres
Publié: (2024) -
MedConceptsQA: Open Source Medical Concepts QA Benchmark
par: Shoham, Ofir Ben, et autres
Publié: (2024) -
GATech at AbjadGenEval Shared Task: Multilingual Embeddings for Arabic Machine-Generated Text Classification
par: Khamis, Ahmed Khaled
Publié: (2026)