Accurate and Nuanced Open-QA Evaluation Through Textual Entailment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yao, Peiran, Barbosa, Denilson |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Semantic Graphs for Syntactic Simplification: A Revisit from the Age of LLM
par: Yao, Peiran, et autres
Publié: (2024)
par: Yao, Peiran, et autres
Publié: (2024)
NLP Workbench: Efficient and Extensible Integration of State-of-the-art Text Mining Tools
par: Yao, Peiran, et autres
Publié: (2023)
par: Yao, Peiran, et autres
Publié: (2023)
Hyperbolic sentence representations for solving Textual Entailment
par: Petrovski, Igor
Publié: (2024)
par: Petrovski, Igor
Publié: (2024)
EntailE: Introducing Textual Entailment in Commonsense Knowledge Graph Completion
par: Su, Ying, et autres
Publié: (2024)
par: Su, Ying, et autres
Publié: (2024)
PatentEdits: Framing Patent Novelty as Textual Entailment
par: Lee, Ryan, et autres
Publié: (2024)
par: Lee, Ryan, et autres
Publié: (2024)
Textual Entailment for Effective Triple Validation in Object Prediction
par: García-Silva, Andrés, et autres
Publié: (2024)
par: García-Silva, Andrés, et autres
Publié: (2024)
VLSP 2023 -- LTER: A Summary of the Challenge on Legal Textual Entailment Recognition
par: Tran, Vu, et autres
Publié: (2024)
par: Tran, Vu, et autres
Publié: (2024)
X-PARADE: Cross-Lingual Textual Entailment and Information Divergence across Paragraphs
par: Rodriguez, Juan Diego, et autres
Publié: (2023)
par: Rodriguez, Juan Diego, et autres
Publié: (2023)
Textual Entailment Recognition with Semantic Features from Empirical Text Representation
par: Shajalal, Md, et autres
Publié: (2022)
par: Shajalal, Md, et autres
Publié: (2022)
Are Large Language Models Good Essay Graders?
par: Kundu, Anindita, et autres
Publié: (2024)
par: Kundu, Anindita, et autres
Publié: (2024)
Textual Entailment is not a Better Bias Metric than Token Probability
par: Felkner, Virginia K., et autres
Publié: (2025)
par: Felkner, Virginia K., et autres
Publié: (2025)
Entailment-Preserving First-order Logic Representations in Natural Language Entailment
par: Lee, Jinu, et autres
Publié: (2025)
par: Lee, Jinu, et autres
Publié: (2025)
Can You Learn Semantics Through Next-Word Prediction? The Case of Entailment
par: Merrill, William, et autres
Publié: (2024)
par: Merrill, William, et autres
Publié: (2024)
Evaluating Nuanced Bias in Large Language Model Free Response Answers
par: Healey, Jennifer, et autres
Publié: (2024)
par: Healey, Jennifer, et autres
Publié: (2024)
OpaqueToolsBench: Learning Nuances of Tool Behavior Through Interaction
par: Hallinan, Skyler, et autres
Publié: (2026)
par: Hallinan, Skyler, et autres
Publié: (2026)
BIT.UA-AAUBS at ArchEHR-QA 2026: Evaluating Open-Source and Proprietary LLMs via Prompting in Low-Resource QA
par: Jonker, Richard A. A., et autres
Publié: (2026)
par: Jonker, Richard A. A., et autres
Publié: (2026)
SEC-QA: A Systematic Evaluation Corpus for Financial QA
par: Lai, Viet Dac, et autres
Publié: (2024)
par: Lai, Viet Dac, et autres
Publié: (2024)
Leveraging Entailment Judgements in Cross-Lingual Summarisation
par: Zhang, Huajian, et autres
Publié: (2024)
par: Zhang, Huajian, et autres
Publié: (2024)
CLATTER: Comprehensive Entailment Reasoning for Hallucination Detection
par: Eliav, Ron, et autres
Publié: (2025)
par: Eliav, Ron, et autres
Publié: (2025)
ComparisonQA: Evaluating Factuality Robustness of LLMs Through Knowledge Frequency Control and Uncertainty
par: Zong, Qing, et autres
Publié: (2024)
par: Zong, Qing, et autres
Publié: (2024)
MedConceptsQA: Open Source Medical Concepts QA Benchmark
par: Shoham, Ofir Ben, et autres
Publié: (2024)
par: Shoham, Ofir Ben, et autres
Publié: (2024)
ExpertGenQA: Open-ended QA generation in Specialized Domains
par: Shahgir, Haz Sameen, et autres
Publié: (2025)
par: Shahgir, Haz Sameen, et autres
Publié: (2025)
MinosEval: Distinguishing Factoid and Non-Factoid for Tailored Open-Ended QA Evaluation with LLMs
par: Fan, Yongqi, et autres
Publié: (2025)
par: Fan, Yongqi, et autres
Publié: (2025)
Semantic Textual Entailment Recognition using UNL
par: Partha Pakray
Publié: (2011)
par: Partha Pakray
Publié: (2011)
Dataset Creation for Visual Entailment using Generative AI
par: Reijtenbach, Rob, et autres
Publié: (2025)
par: Reijtenbach, Rob, et autres
Publié: (2025)
Neutralizing Bias in LLM Reasoning using Entailment Graphs
par: Cheng, Liang, et autres
Publié: (2025)
par: Cheng, Liang, et autres
Publié: (2025)
Beyond Keywords: Evaluating Large Language Model Classification of Nuanced Ableism
par: Rizvi, Naba, et autres
Publié: (2025)
par: Rizvi, Naba, et autres
Publié: (2025)
Image Textualization: An Automatic Framework for Creating Accurate and Detailed Image Descriptions
par: Pi, Renjie, et autres
Publié: (2024)
par: Pi, Renjie, et autres
Publié: (2024)
Exploring Factual Entailment with NLI: A News Media Study
par: Mor-Lan, Guy, et autres
Publié: (2024)
par: Mor-Lan, Guy, et autres
Publié: (2024)
Plausible Extractive Rationalization through Semi-Supervised Entailment Signal
par: Yeo, Wei Jie, et autres
Publié: (2024)
par: Yeo, Wei Jie, et autres
Publié: (2024)
Beyond Metrics: Evaluating LLMs' Effectiveness in Culturally Nuanced, Low-Resource Real-World Scenarios
par: Ochieng, Millicent, et autres
Publié: (2024)
par: Ochieng, Millicent, et autres
Publié: (2024)
Entailment Semantics Can Be Extracted from an Ideal Language Model
par: Merrill, William, et autres
Publié: (2022)
par: Merrill, William, et autres
Publié: (2022)
Multilingual Evaluation of Semantic Textual Relatedness
par: Endait, Sharvi, et autres
Publié: (2024)
par: Endait, Sharvi, et autres
Publié: (2024)
A Straightforward Pipeline for Targeted Entailment and Contradiction Detection
par: Sulc, Antonin
Publié: (2025)
par: Sulc, Antonin
Publié: (2025)
Reframing Tax Law Entailment as Analogical Reasoning
par: Zou, Xinrui, et autres
Publié: (2024)
par: Zou, Xinrui, et autres
Publié: (2024)
Improve Dense Passage Retrieval with Entailment Tuning
par: Dai, Lu, et autres
Publié: (2024)
par: Dai, Lu, et autres
Publié: (2024)
Adversarial Attacks and Defense for Conversation Entailment Task
par: Yang, Zhenning, et autres
Publié: (2024)
par: Yang, Zhenning, et autres
Publié: (2024)
Decoding AI and Human Authorship: Nuances Revealed Through NLP and Statistical Analysis
par: Akinwande, Mayowa, et autres
Publié: (2024)
par: Akinwande, Mayowa, et autres
Publié: (2024)
LLMs Do Not Grade Essays Like Humans
par: Mathew, Jerin George, et autres
Publié: (2026)
par: Mathew, Jerin George, et autres
Publié: (2026)
Multilingual Open QA on the MIA Shared Task
par: Yarrabelly, Navya, et autres
Publié: (2025)
par: Yarrabelly, Navya, et autres
Publié: (2025)
Documents similaires
-
Semantic Graphs for Syntactic Simplification: A Revisit from the Age of LLM
par: Yao, Peiran, et autres
Publié: (2024) -
NLP Workbench: Efficient and Extensible Integration of State-of-the-art Text Mining Tools
par: Yao, Peiran, et autres
Publié: (2023) -
Hyperbolic sentence representations for solving Textual Entailment
par: Petrovski, Igor
Publié: (2024) -
EntailE: Introducing Textual Entailment in Commonsense Knowledge Graph Completion
par: Su, Ying, et autres
Publié: (2024) -
PatentEdits: Framing Patent Novelty as Textual Entailment
par: Lee, Ryan, et autres
Publié: (2024)