A MISMATCHED Benchmark for Scientific Natural Language Inference
Fuente:
arXiv
Saved in:
| Main Authors: | Shaik, Firoz, Sadat, Mobashir, Gautam, Nikita, Caragea, Doina, Caragea, Cornelia |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MSciNLI: A Diverse Benchmark for Scientific Natural Language Inference
by: Sadat, Mobashir, et al.
Published: (2024)
by: Sadat, Mobashir, et al.
Published: (2024)
Co-training for Low Resource Scientific Natural Language Inference
by: Sadat, Mobashir, et al.
Published: (2024)
by: Sadat, Mobashir, et al.
Published: (2024)
Let's Use ChatGPT To Write Our Paper! Benchmarking LLMs To Write the Introduction of a Research Paper
by: Garg, Krishna, et al.
Published: (2025)
by: Garg, Krishna, et al.
Published: (2025)
Evaluating Large Language Models for Stance Detection on Financial Targets from SEC Filing Reports and Earnings Call Transcripts
by: Gyawali, Nikesh, et al.
Published: (2025)
by: Gyawali, Nikesh, et al.
Published: (2025)
The Shifting Landscape of Vaccine Discourse: Insights From a Decade of Pre- to Post-COVID-19 Vaccine Posts on Social Media
by: Gyawali, Nikesh, et al.
Published: (2025)
by: Gyawali, Nikesh, et al.
Published: (2025)
BLooP: Zero-Shot Abstractive Summarization using Large Language Models with Bigram Lookahead Promotion
by: Iyer, Varun, et al.
Published: (2026)
by: Iyer, Varun, et al.
Published: (2026)
A Novel Cartography-Based Curriculum Learning Method Applied on RoNLI: The First Romanian Natural Language Inference Corpus
by: Poesina, Eduard, et al.
Published: (2024)
by: Poesina, Eduard, et al.
Published: (2024)
Stanceformer: Target-Aware Transformer for Stance Detection
by: Garg, Krishna, et al.
Published: (2024)
by: Garg, Krishna, et al.
Published: (2024)
LLM-guided Semi-Supervised Approaches for Social Media Crisis Data Classification
by: Ativo, Jacob, et al.
Published: (2026)
by: Ativo, Jacob, et al.
Published: (2026)
Leveraging Large Language Models for Automated Scalable Development of Open Scientific Databases
by: Gautam, Nikita, et al.
Published: (2026)
by: Gautam, Nikita, et al.
Published: (2026)
Zero-Shot Verification-guided Chain of Thoughts
by: Chowdhury, Jishnu Ray, et al.
Published: (2025)
by: Chowdhury, Jishnu Ray, et al.
Published: (2025)
MADIAVE: Multi-Agent Debate for Implicit Attribute Value Extraction
by: Huang, Wei-Chieh, et al.
Published: (2025)
by: Huang, Wei-Chieh, et al.
Published: (2025)
Language Models (Mostly) Do Not Consider Emotion Triggers When Predicting Emotion
by: Singh, Smriti, et al.
Published: (2023)
by: Singh, Smriti, et al.
Published: (2023)
How Hard is this Test Set? NLI Characterization by Exploiting Training Dynamics
by: Cosma, Adrian, et al.
Published: (2024)
by: Cosma, Adrian, et al.
Published: (2024)
Zero-Shot Keyphrase Generation: Investigating Specialized Instructions and Multi-Sample Aggregation on Large Language Models
by: Mohan, Jayanth, et al.
Published: (2025)
by: Mohan, Jayanth, et al.
Published: (2025)
MSGL-Transformer: A Multi-Scale Global-Local Transformer for Rodent Social Behavior Recognition
by: Sharif, Muhammad Imran, et al.
Published: (2026)
by: Sharif, Muhammad Imran, et al.
Published: (2026)
SciER: An Entity and Relation Extraction Dataset for Datasets, Methods, and Tasks in Scientific Documents
by: Zhang, Qi, et al.
Published: (2024)
by: Zhang, Qi, et al.
Published: (2024)
Investigating Recurrent Transformers with Dynamic Halt
by: Chowdhury, Jishnu Ray, et al.
Published: (2024)
by: Chowdhury, Jishnu Ray, et al.
Published: (2024)
DynClean: Training Dynamics-based Label Cleaning for Distantly-Supervised Named Entity Recognition
by: Zhang, Qi, et al.
Published: (2025)
by: Zhang, Qi, et al.
Published: (2025)
MultiMatch: Multihead Consistency Regularization Matching for Semi-Supervised Text Classification
by: Sirbu, Iustin, et al.
Published: (2025)
by: Sirbu, Iustin, et al.
Published: (2025)
Benchmarking Android Malware Detection: Traditional vs. Deep Learning Models
by: Liu, Guojun, et al.
Published: (2025)
by: Liu, Guojun, et al.
Published: (2025)
ImplicitAVE: An Open-Source Dataset and Multimodal LLMs Benchmark for Implicit Attribute Value Extraction
by: Zou, Henry Peng, et al.
Published: (2024)
by: Zou, Henry Peng, et al.
Published: (2024)
LLM-Guided Co-Training for Text Classification
by: Rahman, Md Mezbaur, et al.
Published: (2025)
by: Rahman, Md Mezbaur, et al.
Published: (2025)
On the Design Space Between Transformers and Recursive Neural Nets
by: Chowdhury, Jishnu Ray, et al.
Published: (2024)
by: Chowdhury, Jishnu Ray, et al.
Published: (2024)
Active Few-Shot Learning for Text Classification
by: Ahmadnia, Saeed, et al.
Published: (2025)
by: Ahmadnia, Saeed, et al.
Published: (2025)
Practical Insights into Semi-Supervised Object Detection Approaches
by: Wang, Chaoxin, et al.
Published: (2026)
by: Wang, Chaoxin, et al.
Published: (2026)
CalibrateMix: Guided-Mixup Calibration of Image Semi-Supervised Models
by: Rahman, Mehrab Mustafy, et al.
Published: (2025)
by: Rahman, Mehrab Mustafy, et al.
Published: (2025)
FlowLearn: Evaluating Large Vision-Language Models on Flowchart Understanding
by: Pan, Huitong, et al.
Published: (2024)
by: Pan, Huitong, et al.
Published: (2024)
The Impact of Train-Test Leakage on Machine Learning-based Android Malware Detection
by: Liu, Guojun, et al.
Published: (2024)
by: Liu, Guojun, et al.
Published: (2024)
EIVEN: Efficient Implicit Attribute Value Extraction using Multimodal LLM
by: Zou, Henry Peng, et al.
Published: (2024)
by: Zou, Henry Peng, et al.
Published: (2024)
SciDMT: A Large-Scale Corpus for Detecting Scientific Mentions
by: Pan, Huitong, et al.
Published: (2024)
by: Pan, Huitong, et al.
Published: (2024)
Natural Language Processing for Human Resources: A Survey
by: Otani, Naoki, et al.
Published: (2024)
by: Otani, Naoki, et al.
Published: (2024)
A New Benchmark Dataset and Mixture-of-Experts Language Models for Adversarial Natural Language Inference in Vietnamese
by: Van Huynh, Tin, et al.
Published: (2024)
by: Van Huynh, Tin, et al.
Published: (2024)
On the Effectiveness of Large Language Models in Automating Categorization of Scientific Texts
by: Shahi, Gautam Kishore, et al.
Published: (2025)
by: Shahi, Gautam Kishore, et al.
Published: (2025)
TuringQ: Benchmarking AI Comprehension in Theory of Computation
by: Zahraei, Pardis Sadat, et al.
Published: (2024)
by: Zahraei, Pardis Sadat, et al.
Published: (2024)
LogicDiff: Logic-Guided Denoising Improves Zero-Shot Reasoning in Masked Diffusion Language Models
by: Aman, Shaik
Published: (2026)
by: Aman, Shaik
Published: (2026)
A Large Language Model and Denoising Diffusion Framework for Targeted Design of Microstructures with Commands in Natural Language
by: Kartashov, Nikita, et al.
Published: (2024)
by: Kartashov, Nikita, et al.
Published: (2024)
Explicit Grammar Semantic Feature Fusion for Robust Text Classification
by: Sultana, Azrin, et al.
Published: (2026)
by: Sultana, Azrin, et al.
Published: (2026)
On Reference (In-)Determinacy in Natural Language Inference
by: Chen, Sihao, et al.
Published: (2025)
by: Chen, Sihao, et al.
Published: (2025)
Beyond Easy Wins: A Text Hardness-Aware Benchmark for LLM-generated Text Detection
by: Ayoobi, Navid, et al.
Published: (2025)
by: Ayoobi, Navid, et al.
Published: (2025)
Similar Items
-
MSciNLI: A Diverse Benchmark for Scientific Natural Language Inference
by: Sadat, Mobashir, et al.
Published: (2024) -
Co-training for Low Resource Scientific Natural Language Inference
by: Sadat, Mobashir, et al.
Published: (2024) -
Let's Use ChatGPT To Write Our Paper! Benchmarking LLMs To Write the Introduction of a Research Paper
by: Garg, Krishna, et al.
Published: (2025) -
Evaluating Large Language Models for Stance Detection on Financial Targets from SEC Filing Reports and Earnings Call Transcripts
by: Gyawali, Nikesh, et al.
Published: (2025) -
The Shifting Landscape of Vaccine Discourse: Insights From a Decade of Pre- to Post-COVID-19 Vaccine Posts on Social Media
by: Gyawali, Nikesh, et al.
Published: (2025)