Semantic Sensitivities and Inconsistent Predictions: Measuring the Fragility of NLI Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Arakelyan, Erik, Liu, Zhaoqi, Augenstein, Isabelle |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Reasoning Inconsistencies and How to Mitigate Them in Deep Learning
por: Arakelyan, Erik
Publicado: (2025)
por: Arakelyan, Erik
Publicado: (2025)
SynDARin: Synthesising Datasets for Automated Reasoning in Low-Resource Languages
por: Ghazaryan, Gayane, et al.
Publicado: (2024)
por: Ghazaryan, Gayane, et al.
Publicado: (2024)
FLARE: Faithful Logic-Aided Reasoning and Exploration
por: Arakelyan, Erik, et al.
Publicado: (2024)
por: Arakelyan, Erik, et al.
Publicado: (2024)
Epistemic Diversity and Knowledge Collapse in Large Language Models
por: Wright, Dustin, et al.
Publicado: (2025)
por: Wright, Dustin, et al.
Publicado: (2025)
Stress Testing Factual Consistency Metrics for Long-Document Summarization
por: Mujahid, Zain Muhammad, et al.
Publicado: (2025)
por: Mujahid, Zain Muhammad, et al.
Publicado: (2025)
Multi-Step Knowledge Interaction Analysis via Rank-2 Subspace Disentanglement
por: Islam, Sekh Mainul, et al.
Publicado: (2025)
por: Islam, Sekh Mainul, et al.
Publicado: (2025)
Why Should This Article Be Deleted? Transparent Stance Detection in Multilingual Wikipedia Editor Discussions
por: Kaffee, Lucie-Aimée, et al.
Publicado: (2023)
por: Kaffee, Lucie-Aimée, et al.
Publicado: (2023)
FragileFlow: Spectral Control of Correct-but-Fragile Predictions for Foundation Model Robustness
por: Li, Zhuoyun, et al.
Publicado: (2026)
por: Li, Zhuoyun, et al.
Publicado: (2026)
Do VLMs Have a Moral Backbone? A Study on the Fragile Morality of Vision-Language Models
por: Liu, Zhining, et al.
Publicado: (2026)
por: Liu, Zhining, et al.
Publicado: (2026)
Modeling Public Perceptions of Science in Media
por: Pei, Jiaxin, et al.
Publicado: (2025)
por: Pei, Jiaxin, et al.
Publicado: (2025)
Reducing Large Language Model Safety Risks in Women's Health using Semantic Entropy
por: Penny-Dimri, Jahan C., et al.
Publicado: (2025)
por: Penny-Dimri, Jahan C., et al.
Publicado: (2025)
The WMDP Benchmark: Measuring and Reducing Malicious Use With Unlearning
por: Li, Nathaniel, et al.
Publicado: (2024)
por: Li, Nathaniel, et al.
Publicado: (2024)
Investigating the Interplay between Contextual and Parametric Chain-of-Thought Faithfulness under Optimization
por: Sun, Jingyi, et al.
Publicado: (2026)
por: Sun, Jingyi, et al.
Publicado: (2026)
Efficient and Personalized Mobile Health Event Prediction via Small Language Models
por: Wang, Xin, et al.
Publicado: (2024)
por: Wang, Xin, et al.
Publicado: (2024)
Predicting Learning Performance with Large Language Models: A Study in Adult Literacy
por: Zhang, Liang, et al.
Publicado: (2024)
por: Zhang, Liang, et al.
Publicado: (2024)
Large Language Models Predict Functional Outcomes after Acute Ischemic Stroke
por: Kapoor, Anjali K., et al.
Publicado: (2026)
por: Kapoor, Anjali K., et al.
Publicado: (2026)
Subtle Biases Need Subtler Measures: Dual Metrics for Evaluating Representative and Affinity Bias in Large Language Models
por: Kumar, Abhishek, et al.
Publicado: (2024)
por: Kumar, Abhishek, et al.
Publicado: (2024)
Do Large Language Models Walk Their Talk? Measuring the Gap Between Implicit Associations, Self-Report, and Behavioral Altruism
por: Andric, Sandro
Publicado: (2025)
por: Andric, Sandro
Publicado: (2025)
Revealing Fine-Grained Values and Opinions in Large Language Models
por: Wright, Dustin, et al.
Publicado: (2024)
por: Wright, Dustin, et al.
Publicado: (2024)
Beyond Behaviorist Representational Harms: A Plan for Measurement and Mitigation
por: Chien, Jennifer, et al.
Publicado: (2024)
por: Chien, Jennifer, et al.
Publicado: (2024)
EigenBench: A Comparative Behavioral Measure of Value Alignment
por: Chang, Jonathn, et al.
Publicado: (2025)
por: Chang, Jonathn, et al.
Publicado: (2025)
Safetywashing: Do AI Safety Benchmarks Actually Measure Safety Progress?
por: Ren, Richard, et al.
Publicado: (2024)
por: Ren, Richard, et al.
Publicado: (2024)
Adapting Mental Health Prediction Tasks for Cross-lingual Learning via Meta-Training and In-context Learning with Large Language Model
por: Lifelo, Zita, et al.
Publicado: (2024)
por: Lifelo, Zita, et al.
Publicado: (2024)
Multi-Modal Framing Analysis of News
por: Arora, Arnav, et al.
Publicado: (2025)
por: Arora, Arnav, et al.
Publicado: (2025)
CEGI: Measuring the trade-off between efficiency and carbon emissions for SLMs and VLMs
por: Kumar, Abhas, et al.
Publicado: (2024)
por: Kumar, Abhas, et al.
Publicado: (2024)
Embedding Enhancement via Fine-Tuned Language Models for Learner-Item Cognitive Modeling
por: Liu, Yuanhao, et al.
Publicado: (2026)
por: Liu, Yuanhao, et al.
Publicado: (2026)
IatroBench: Pre-Registered Evidence of Iatrogenic Harm from AI Safety Measures
por: Gringras, David
Publicado: (2026)
por: Gringras, David
Publicado: (2026)
Measuring Free-Form Decision-Making Inconsistency of Language Models in Military Crisis Simulations
por: Shrivastava, Aryan, et al.
Publicado: (2024)
por: Shrivastava, Aryan, et al.
Publicado: (2024)
Computational Measurement of Political Positions: A Review of Text-Based Ideal Point Estimation Algorithms
por: Parschan, Patrick, et al.
Publicado: (2025)
por: Parschan, Patrick, et al.
Publicado: (2025)
Hypothesis Generation with Large Language Models
por: Zhou, Yangqiaoyu, et al.
Publicado: (2024)
por: Zhou, Yangqiaoyu, et al.
Publicado: (2024)
Sem-DPO: Mitigating Semantic Inconsistency in Preference Optimization for Prompt Engineering
por: Mohamed, Anas, et al.
Publicado: (2025)
por: Mohamed, Anas, et al.
Publicado: (2025)
AI-Augmented Predictions: LLM Assistants Improve Human Forecasting Accuracy
por: Schoenegger, Philipp, et al.
Publicado: (2024)
por: Schoenegger, Philipp, et al.
Publicado: (2024)
LLMCO2: Advancing Accurate Carbon Footprint Prediction for LLM Inferences
por: Fu, Zhenxiao, et al.
Publicado: (2024)
por: Fu, Zhenxiao, et al.
Publicado: (2024)
Predicting potentially abusive clauses in Chilean terms of services with natural language processing
por: Loeffler, Christoffer, et al.
Publicado: (2025)
por: Loeffler, Christoffer, et al.
Publicado: (2025)
Exploring Accuracy-Fairness Trade-off in Large Language Models
por: Zhang, Qingquan, et al.
Publicado: (2024)
por: Zhang, Qingquan, et al.
Publicado: (2024)
Unmasking and Improving Data Credibility: A Study with Datasets for Training Harmless Language Models
por: Zhu, Zhaowei, et al.
Publicado: (2023)
por: Zhu, Zhaowei, et al.
Publicado: (2023)
Wisdom of the Silicon Crowd: LLM Ensemble Prediction Capabilities Rival Human Crowd Accuracy
por: Schoenegger, Philipp, et al.
Publicado: (2024)
por: Schoenegger, Philipp, et al.
Publicado: (2024)
From Perceptions to Decisions: Wildfire Evacuation Decision Prediction with Behavioral Theory-informed LLMs
por: Chen, Ruxiao, et al.
Publicado: (2025)
por: Chen, Ruxiao, et al.
Publicado: (2025)
SUV: Scalable Large Language Model Copyright Compliance with Regularized Selective Unlearning
por: Xu, Tianyang, et al.
Publicado: (2025)
por: Xu, Tianyang, et al.
Publicado: (2025)
Fairer Preferences Elicit Improved Human-Aligned Large Language Model Judgments
por: Zhou, Han, et al.
Publicado: (2024)
por: Zhou, Han, et al.
Publicado: (2024)
Ejemplares similares
-
Reasoning Inconsistencies and How to Mitigate Them in Deep Learning
por: Arakelyan, Erik
Publicado: (2025) -
SynDARin: Synthesising Datasets for Automated Reasoning in Low-Resource Languages
por: Ghazaryan, Gayane, et al.
Publicado: (2024) -
FLARE: Faithful Logic-Aided Reasoning and Exploration
por: Arakelyan, Erik, et al.
Publicado: (2024) -
Epistemic Diversity and Knowledge Collapse in Large Language Models
por: Wright, Dustin, et al.
Publicado: (2025) -
Stress Testing Factual Consistency Metrics for Long-Document Summarization
por: Mujahid, Zain Muhammad, et al.
Publicado: (2025)