Enregistré dans:
| Auteurs principaux: | Aghaebe, Favour Yahdii, Apekey, Tanefa, Williams, Elizabeth, Moosavi, Nafise Sadat |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2601.04889 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LLMs Do Not See Age: Assessing Demographic Bias in Automated Systematic Review Synthesis
par: Aghaebe, Favour Yahdii, et autres
Publié: (2025)
par: Aghaebe, Favour Yahdii, et autres
Publié: (2025)
Exploring the Influence of Label Aggregation on Minority Voices: Implications for Dataset Bias and Model Training
par: Pandya, Mugdha, et autres
Publié: (2024)
par: Pandya, Mugdha, et autres
Publié: (2024)
How to Leverage Digit Embeddings to Represent Numbers?
par: Sivakumar, Jasivan Alex, et autres
Publié: (2024)
par: Sivakumar, Jasivan Alex, et autres
Publié: (2024)
Initialisation Determines the Basin: Efficient Codebook Optimisation for Extreme LLM Quantization
par: Kennedy, Ian W., et autres
Publié: (2026)
par: Kennedy, Ian W., et autres
Publié: (2026)
MultiHoax: A Dataset of Multi-hop False-Premise Questions
par: Shafiei, Mohammadamin, et autres
Publié: (2025)
par: Shafiei, Mohammadamin, et autres
Publié: (2025)
LLMs as Narcissistic Evaluators: When Ego Inflates Evaluation Scores
par: Liu, Yiqi, et autres
Publié: (2023)
par: Liu, Yiqi, et autres
Publié: (2023)
Rolling the DICE on Idiomaticity: How LLMs Fail to Grasp Context
par: Mi, Maggie, et autres
Publié: (2024)
par: Mi, Maggie, et autres
Publié: (2024)
From Input Perception to Predictive Insight: Modeling Model Blind Spots Before They Become Errors
par: Mi, Maggie, et autres
Publié: (2025)
par: Mi, Maggie, et autres
Publié: (2025)
More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning
par: Shafiei, Mohammadamin, et autres
Publié: (2025)
par: Shafiei, Mohammadamin, et autres
Publié: (2025)
Deconstructing Attention: Investigating Design Principles for Effective Language Modeling
par: Xue, Huiyin, et autres
Publié: (2025)
par: Xue, Huiyin, et autres
Publié: (2025)
Property Classification of Vacation Rental Properties during Covid-19
par: Aghaebe, Favour Yahdii, et autres
Publié: (2025)
par: Aghaebe, Favour Yahdii, et autres
Publié: (2025)
Decoding News Narratives: A Critical Analysis of Large Language Models in Framing Detection
par: Pastorino, Valeria, et autres
Publié: (2024)
par: Pastorino, Valeria, et autres
Publié: (2024)
No Shortcuts to Culture: Indonesian Multi-hop Question Answering for Complex Cultural Understanding
par: Permadi, Vynska Amalia, et autres
Publié: (2026)
par: Permadi, Vynska Amalia, et autres
Publié: (2026)
RIGOURATE: Quantifying Scientific Exaggeration with Evidence-Aligned Claim Evaluation
par: James, Joseph, et autres
Publié: (2026)
par: James, Joseph, et autres
Publié: (2026)
Beyond Hate Speech: NLP's Challenges and Opportunities in Uncovering Dehumanizing Language
par: Saffari, Hamidreza, et autres
Publié: (2024)
par: Saffari, Hamidreza, et autres
Publié: (2024)
Exploring Gender Disparities in Automatic Speech Recognition Technology
par: ElGhazaly, Hend, et autres
Publié: (2025)
par: ElGhazaly, Hend, et autres
Publié: (2025)
Hidden Failures in Robustness: Why Supervised Uncertainty Quantification Needs Better Evaluation
par: Stacey, Joe, et autres
Publié: (2026)
par: Stacey, Joe, et autres
Publié: (2026)
ContrastScore: Towards Higher Quality, Less Biased, More Efficient Evaluation Metrics with Contrastive Evaluation
par: Wang, Xiao, et autres
Publié: (2025)
par: Wang, Xiao, et autres
Publié: (2025)
Co‐Designing Recipe Resources to Support Healthy Eating in African‐Caribbeans in the United Kingdom: An Academic and Community Partnership Approach
par: Tanefa A. Apekey, et autres
Publié: (2024)
par: Tanefa A. Apekey, et autres
Publié: (2024)
Fine-Grained Natural Language Inference Based Faithfulness Evaluation for Diverse Summarisation Tasks
par: Zhang, Huajian, et autres
Publié: (2024)
par: Zhang, Huajian, et autres
Publié: (2024)
FaithRL: Learning to Reason Faithfully through Step-Level Faithfulness Maximization
par: Gui, Runquan, et autres
Publié: (2026)
par: Gui, Runquan, et autres
Publié: (2026)
When Disagreements Elicit Robustness: Investigating Self-Repair Capabilities under LLM Multi-Agent Disagreements
par: Ju, Tianjie, et autres
Publié: (2025)
par: Ju, Tianjie, et autres
Publié: (2025)
REFER: Mitigating Bias in Opinion Summarisation via Frequency Framed Prompting
par: Huang, Nannan, et autres
Publié: (2025)
par: Huang, Nannan, et autres
Publié: (2025)
Aggregate vs. Personalized Judges in Business Idea Evaluation: Evidence from Expert Disagreement
par: Hirota, Wataru, et autres
Publié: (2026)
par: Hirota, Wataru, et autres
Publié: (2026)
MARS: Multilingual Aspect-centric Review Summarisation
par: Mukku, Sandeep Sricharan, et autres
Publié: (2024)
par: Mukku, Sandeep Sricharan, et autres
Publié: (2024)
Leveraging Entailment Judgements in Cross-Lingual Summarisation
par: Zhang, Huajian, et autres
Publié: (2024)
par: Zhang, Huajian, et autres
Publié: (2024)
Log Summarisation for Defect Evolution Analysis
par: Dolga, Rares, et autres
Publié: (2024)
par: Dolga, Rares, et autres
Publié: (2024)
ATLAS: Improving Lay Summarisation with Attribute-based Control
par: Zhang, Zhihao, et autres
Publié: (2024)
par: Zhang, Zhihao, et autres
Publié: (2024)
Enhancing Faithfulness in Abstractive Summarization via Span-Level Fine-Tuning
par: Huang, Sicong, et autres
Publié: (2025)
par: Huang, Sicong, et autres
Publié: (2025)
FaithfulRAG: Fact-Level Conflict Modeling for Context-Faithful Retrieval-Augmented Generation
par: Zhang, Qinggang, et autres
Publié: (2025)
par: Zhang, Qinggang, et autres
Publié: (2025)
Evaluating LLM-Driven Summarisation of Parliamentary Debates with Computational Argumentation
par: Cunningham, Eoghan, et autres
Publié: (2026)
par: Cunningham, Eoghan, et autres
Publié: (2026)
Summarisation of German Judgments in conjunction with a Class-based Evaluation
par: Steffes, Bianca, et autres
Publié: (2025)
par: Steffes, Bianca, et autres
Publié: (2025)
Textual Summarisation of Large Sets: Towards a General Approach
par: Kuptavanich, Kittipitch, et autres
Publié: (2024)
par: Kuptavanich, Kittipitch, et autres
Publié: (2024)
Enhancing Long Document Long Form Summarisation with Self-Planning
par: Du, Xiaotang, et autres
Publié: (2025)
par: Du, Xiaotang, et autres
Publié: (2025)
M2DS: Multilingual Dataset for Multi-document Summarisation
par: Hewapathirana, Kushan, et autres
Publié: (2024)
par: Hewapathirana, Kushan, et autres
Publié: (2024)
A Critical Look at Meta-evaluating Summarisation Evaluation Metrics
par: Dai, Xiang, et autres
Publié: (2024)
par: Dai, Xiang, et autres
Publié: (2024)
Enhancing Uncertainty Estimation in LLMs with Expectation of Aggregated Internal Belief
par: Xiao, Zeguan, et autres
Publié: (2025)
par: Xiao, Zeguan, et autres
Publié: (2025)
AraFinNews: Arabic Financial Summarisation with Domain-Adapted LLMs
par: El-Haj, Mo, et autres
Publié: (2025)
par: El-Haj, Mo, et autres
Publié: (2025)
Transforming Science with Large Language Models: A Survey on AI-assisted Scientific Discovery, Experimentation, Content Generation, and Evaluation
par: Eger, Steffen, et autres
Publié: (2025)
par: Eger, Steffen, et autres
Publié: (2025)
Leveraging Large Language Models for Zero-shot Lay Summarisation in Biomedicine and Beyond
par: Goldsack, Tomas, et autres
Publié: (2025)
par: Goldsack, Tomas, et autres
Publié: (2025)
Documents similaires
-
LLMs Do Not See Age: Assessing Demographic Bias in Automated Systematic Review Synthesis
par: Aghaebe, Favour Yahdii, et autres
Publié: (2025) -
Exploring the Influence of Label Aggregation on Minority Voices: Implications for Dataset Bias and Model Training
par: Pandya, Mugdha, et autres
Publié: (2024) -
How to Leverage Digit Embeddings to Represent Numbers?
par: Sivakumar, Jasivan Alex, et autres
Publié: (2024) -
Initialisation Determines the Basin: Efficient Codebook Optimisation for Extreme LLM Quantization
par: Kennedy, Ian W., et autres
Publié: (2026) -
MultiHoax: A Dataset of Multi-hop False-Premise Questions
par: Shafiei, Mohammadamin, et autres
Publié: (2025)