Discrepancy Detection at the Data Level: Toward Consistent Multilingual Question Answering
Fuente:
arXiv
Salvato in:
| Autori principali: | Calvo-Bartolomé, Lorena, Aldana, Valérie, Cantarero, Karla, de Mesa, Alonso Madroñal, Arenas-García, Jerónimo, Boyd-Graber, Jordan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ProxAnn: Use-Oriented Evaluations of Topic Models and Document Clustering
di: Hoyle, Alexander, et al.
Pubblicazione: (2025)
di: Hoyle, Alexander, et al.
Pubblicazione: (2025)
DiscoTrace: Representing and Comparing Answering Strategies of Humans and LLMs in Information-Seeking Question Answering
di: Srikanth, Neha, et al.
Pubblicazione: (2026)
di: Srikanth, Neha, et al.
Pubblicazione: (2026)
Do great minds think alike? Investigating Human-AI Complementarity in Question Answering with CAIMIRA
di: Gor, Maharshi, et al.
Pubblicazione: (2024)
di: Gor, Maharshi, et al.
Pubblicazione: (2024)
CFMatch: Aligning Automated Answer Equivalence Evaluation with Expert Judgments For Open-Domain Question Answering
di: Li, Zongxia, et al.
Pubblicazione: (2024)
di: Li, Zongxia, et al.
Pubblicazione: (2024)
Reverse Question Answering: Can an LLM Write a Question so Hard (or Bad) that it Can't Answer?
di: Balepur, Nishant, et al.
Pubblicazione: (2024)
di: Balepur, Nishant, et al.
Pubblicazione: (2024)
Pregnant Questions: The Importance of Pragmatic Awareness in Maternal Health Question Answering
di: Srikanth, Neha, et al.
Pubblicazione: (2023)
di: Srikanth, Neha, et al.
Pubblicazione: (2023)
Large Language Models Struggle to Describe the Haystack without Human Help: Human-in-the-loop Evaluation of Topic Models
di: Li, Zongxia, et al.
Pubblicazione: (2025)
di: Li, Zongxia, et al.
Pubblicazione: (2025)
How the Advent of Ubiquitous Large Language Models both Stymie and Turbocharge Dynamic Adversarial Question Generation
di: Sung, Yoo Yeon, et al.
Pubblicazione: (2024)
di: Sung, Yoo Yeon, et al.
Pubblicazione: (2024)
AI, Take the Wheel: What Drives Delegation and Trust in Human-Computer Cooperative Question Answering?
di: Gor, Maharshi, et al.
Pubblicazione: (2026)
di: Gor, Maharshi, et al.
Pubblicazione: (2026)
Towards Multilingual Audio-Visual Question Answering
di: Phukan, Orchid Chetia, et al.
Pubblicazione: (2024)
di: Phukan, Orchid Chetia, et al.
Pubblicazione: (2024)
Labeled Interactive Topic Models
di: Seelman, Kyle, et al.
Pubblicazione: (2023)
di: Seelman, Kyle, et al.
Pubblicazione: (2023)
Which of These Best Describes Multiple Choice Evaluation with LLMs? A) Forced B) Flawed C) Fixable D) All of the Above
di: Balepur, Nishant, et al.
Pubblicazione: (2025)
di: Balepur, Nishant, et al.
Pubblicazione: (2025)
On the Calibration of Multilingual Question Answering LLMs
di: Yang, Yahan, et al.
Pubblicazione: (2023)
di: Yang, Yahan, et al.
Pubblicazione: (2023)
MedExpQA: Multilingual Benchmarking of Large Language Models for Medical Question Answering
di: Alonso, Iñigo, et al.
Pubblicazione: (2024)
di: Alonso, Iñigo, et al.
Pubblicazione: (2024)
NAVIG: Natural Language-guided Analysis with Vision Language Models for Image Geo-localization
di: Zhang, Zheyuan, et al.
Pubblicazione: (2025)
di: Zhang, Zheyuan, et al.
Pubblicazione: (2025)
KARL: Knowledge-Aware Retrieval and Representations aid Retention and Learning in Students
di: Shu, Matthew, et al.
Pubblicazione: (2024)
di: Shu, Matthew, et al.
Pubblicazione: (2024)
Evaluating Robustness of LLMs in Question Answering on Multilingual Noisy OCR Data
di: Piryani, Bhawna, et al.
Pubblicazione: (2025)
di: Piryani, Bhawna, et al.
Pubblicazione: (2025)
Leveraging Synthetic Data for Question Answering with Multilingual LLMs in the Agricultural Domain
di: Kaur, Rishemjit, et al.
Pubblicazione: (2025)
di: Kaur, Rishemjit, et al.
Pubblicazione: (2025)
EVJVQA Challenge: Multilingual Visual Question Answering
di: Nguyen, Ngan Luu-Thuy, et al.
Pubblicazione: (2023)
di: Nguyen, Ngan Luu-Thuy, et al.
Pubblicazione: (2023)
SciDoc2Diagrammer-MAF: Towards Generation of Scientific Diagrams from Documents guided by Multi-Aspect Feedback Refinement
di: Mondal, Ishani, et al.
Pubblicazione: (2024)
di: Mondal, Ishani, et al.
Pubblicazione: (2024)
Consistency Training by Synthetic Question Generation for Conversational Question Answering
di: Hemati, Hamed Hematian, et al.
Pubblicazione: (2024)
di: Hemati, Hamed Hematian, et al.
Pubblicazione: (2024)
MULTITAT: Benchmarking Multilingual Table-and-Text Question Answering
di: Zhang, Xuanliang, et al.
Pubblicazione: (2025)
di: Zhang, Xuanliang, et al.
Pubblicazione: (2025)
Towards Probabilistic Question Answering Over Tabular Data
di: Shen, Chen, et al.
Pubblicazione: (2025)
di: Shen, Chen, et al.
Pubblicazione: (2025)
San Tirso de Toledo, tragedia perdida de Lope de Vega
di: Abraham Madroñal
Pubblicazione: (2014)
di: Abraham Madroñal
Pubblicazione: (2014)
UNA MEMORIA DE APARIENCIAS INÉDITA DE CALDERÓN Y OTROS DOCUMENTOS SOBRE LA REPRESENTACIÓN DE SUS AUTOS, Y LOS DE ROJAS ZORRILLA, EN TOLEDO ENTRE 1640 Y 1645
di: Abraham Madroñal
Pubblicazione: (2008)
di: Abraham Madroñal
Pubblicazione: (2008)
Los pajes golosos, un entremés novohispano del siglo XVIII inédito y desconocido
di: Abraham Madroñal
Pubblicazione: (2017)
di: Abraham Madroñal
Pubblicazione: (2017)
TM-PATHVQA:90000+ Textless Multilingual Questions for Medical Visual Question Answering
di: Rajkhowa, Tonmoy, et al.
Pubblicazione: (2024)
di: Rajkhowa, Tonmoy, et al.
Pubblicazione: (2024)
CVQA: Culturally-diverse Multilingual Visual Question Answering Benchmark
di: Romero, David, et al.
Pubblicazione: (2024)
di: Romero, David, et al.
Pubblicazione: (2024)
MTVQA: Benchmarking Multilingual Text-Centric Visual Question Answering
di: Tang, Jingqun, et al.
Pubblicazione: (2024)
di: Tang, Jingqun, et al.
Pubblicazione: (2024)
MST5 -- Multilingual Question Answering over Knowledge Graphs
di: Srivastava, Nikit, et al.
Pubblicazione: (2024)
di: Srivastava, Nikit, et al.
Pubblicazione: (2024)
M2QA: Multi-domain Multilingual Question Answering
di: Engländer, Leon, et al.
Pubblicazione: (2024)
di: Engländer, Leon, et al.
Pubblicazione: (2024)
Multilingual Medical Reasoning for Question Answering with Large Language Models
di: Ferrazzi, Pietro, et al.
Pubblicazione: (2025)
di: Ferrazzi, Pietro, et al.
Pubblicazione: (2025)
Effects of Cross-lingual Evidence in Multilingual Medical Question Answering
di: Yeginbergen, Anar, et al.
Pubblicazione: (2026)
di: Yeginbergen, Anar, et al.
Pubblicazione: (2026)
Multilingual Non-Factoid Question Answering with Answer Paragraph Selection
di: Mishra, Ritwik, et al.
Pubblicazione: (2024)
di: Mishra, Ritwik, et al.
Pubblicazione: (2024)
Tempus: An Evolutionary Mutation Testing System on Event‐Based Systems With Profile‐Based Individual Generation
di: Lorena Gutiérrez‐Madroñal, et al.
Pubblicazione: (2025)
di: Lorena Gutiérrez‐Madroñal, et al.
Pubblicazione: (2025)
Unlucky communication: Frases o actitudes desafortunadas en medicina
di: Amelia Cantarero García
Pubblicazione: (2018)
di: Amelia Cantarero García
Pubblicazione: (2018)
SMART-Editor: A Multi-Agent Framework for Human-Like Design Editing with Structural Integrity
di: Mondal, Ishani, et al.
Pubblicazione: (2025)
di: Mondal, Ishani, et al.
Pubblicazione: (2025)
PEDANTS: Cheap but Effective and Interpretable Answer Equivalence
di: Li, Zongxia, et al.
Pubblicazione: (2024)
di: Li, Zongxia, et al.
Pubblicazione: (2024)
FAMMA: A Benchmark for Financial Domain Multilingual Multimodal Question Answering
di: Xue, Siqiao, et al.
Pubblicazione: (2024)
di: Xue, Siqiao, et al.
Pubblicazione: (2024)
M3TQA: Massively Multilingual Multitask Table Question Answering
di: Shu, Daixin, et al.
Pubblicazione: (2025)
di: Shu, Daixin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ProxAnn: Use-Oriented Evaluations of Topic Models and Document Clustering
di: Hoyle, Alexander, et al.
Pubblicazione: (2025) -
DiscoTrace: Representing and Comparing Answering Strategies of Humans and LLMs in Information-Seeking Question Answering
di: Srikanth, Neha, et al.
Pubblicazione: (2026) -
Do great minds think alike? Investigating Human-AI Complementarity in Question Answering with CAIMIRA
di: Gor, Maharshi, et al.
Pubblicazione: (2024) -
CFMatch: Aligning Automated Answer Equivalence Evaluation with Expert Judgments For Open-Domain Question Answering
di: Li, Zongxia, et al.
Pubblicazione: (2024) -
Reverse Question Answering: Can an LLM Write a Question so Hard (or Bad) that it Can't Answer?
di: Balepur, Nishant, et al.
Pubblicazione: (2024)